검증된 한글
화면 속 모든 글자를 지정 · CER 0.000 · 5/5 프레임 정상
한국어 영상 모델 · 2026
대부분의 영상 모델은 아름다운 서울 거리를 만들어 냅니다. 다만 간판에 적힌 글자는 아무 뜻도 없습니다. 팔레트는 요청한 글자를 그대로 넣고, 다시 읽어서 증명합니다.
지금 만들어 보기↓프롬프트 하나, 글자 하나까지.
대기 중
GPU를 기다리는 중입니다.전달된 영상에서 측정한 화면 속 한국어
이 영상은 AI로 생성되었습니다. · This video was generated by AI.
여기 있는 모든 영상은 API와 같은 검사를 통과했습니다. 요청한 글자는 그대로 읽히고, 요청하지 않은 한국어는 화면에 없습니다. 각 항목에 적힌 숫자가 그 근거입니다.
화면 속 모든 글자를 지정 · CER 0.000 · 5/5 프레임 정상
첫 프레임에 조판 · 5/5 프레임 정상
신선한 딸기 · CER 0.000 · 10/10 프레임 정상
주차 금지 · CER 0.000 · 10/10 프레임 정상
동일 인물 유지 · 10/10 프레임 정상
군중 움직임 · 10/10 프레임 정상
반사와 얕은 심도 · 10/10 프레임 정상
한강 · 10/10 프레임 정상
네온 조명 · 10/10 프레임 정상
컷 사이 동선 유지 · 10/10 프레임 정상
손과 사물의 물리 · 10/10 프레임 정상
손에 든 제품 · 10/10 프레임 정상
공간감과 창빛 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
ASR CER 0.000 · 10/10 프레임 정상
주장하지 않고 측정합니다
자연어 지시만으로 장면을 만듭니다. 카메라 움직임, 한국어 대사, 동기화된 소리와 호흡까지 포함합니다.
입력한 한국어를 첫 프레임에 조판해 넣고 모델에는 움직임만 요청합니다. 글자는 운이 아니라 구조적으로 정확합니다.
제품 사진이나 브랜드 이미지를 넣으면 정체성과 스타일이 새 장면으로 이어집니다. 글자 규칙은 동일하게 적용됩니다.
이 페이지와 API는 같은 백엔드를 씁니다. 지정한 글자는 응답이 나가기 전에 검증되고, 측정된 오차는 코드에서 읽을 수 있는 필드로 함께 옵니다.
curl -sX POST "$BASE/v1/videos" \
-H "authorization: Bearer $KEY" \
-H 'content-type: application/json' \
-d '{"task":"t2v","guarantee_text":true,
"prompt":"A small Korean shopfront at dusk.",
"on_screen_text":["어서오세요"],
"target":{"duration_seconds":5}}'
# 폴링 후:
# "text_accuracy": {"per_string_cer": {"어서오세요": 0.0},
# "worst_cer": 0.0, "tolerance": 0.15, "passed": true}