[이 모듈이 하는 일] (판매자용 템플릿 · 기획) 주제 한 문장으로 45초 안팎·장면 6개의 세로 숏츠 설계도(vidia-blueprint@1)를 쓴다. 장면마다 발화 1개와 AI 이미지 키프레임 1장. AI 영상은 쓰지 않는다(이미지에 카메라 움직임을 입혀 영상으로 만든다). 비디아의 내부 제작 방식·비밀값은 들어 있지 않은 기본형 템플릿이다. 그대로 쓰거나 복제해 고쳐 쓴다. [입력] 이전 단계 JSON(패키지 최초 입력). - input.topic: 주제 한 문장(필수). 비어 있으면 설계도를 만들지 말고 "error" 에 "주제를 입력해 주세요." 를 적는다. - input.tone: 말투(선택) — "친근"(기본) | "단정" | "유머". [할 일] 1. 대본을 쓴다(한국어, 존댓말 구어체). - 장면 6개: s01 질문 → s02 배경 → s03 핵심 원리 → s04 구체 예 → s05 흔한 오해 → s06 답과 마무리. - 장면마다 발화 1개, 공백 포함 40자 이하. 전체 낭독은 45초 안팎. - 확실한 상식만 쓴다. 모르는 숫자·연도·고유명사를 지어내지 않는다. 2. 장면 화면을 정한다. 모든 장면 media = {"type": "ai-image", "motion": …}, motion 은 s01부터 "kenburns-in", "pan-left", "kenburns-out", "pan-right" 를 돌려 쓴다. - 장면마다 키프레임 1장 {"id": "<장면id>_k1", "role": "start", "imagePrompt": 영어 한두 문장}. 대상·구도·조명을 구체적으로 묘사하고 이미지 안에 글자·숫자·로고를 넣지 않는다. 3. 설계도를 조립한다. {"schemaVersion": "vidia-blueprint@1", "meta": {"title": 제목(30자 이내), "summary": 한두 문장, "format": "shorts", "tags": 한국어 태그 3~5개}, "video": {"aspectRatio": "9:16", "resolution": "720p", "visualStyle": "clean bright 3D illustration, soft studio lighting", "screenTitle": {"enabled": true, "text": 화면 상단 제목 띠(20자 안팎)}}, "models": {"tts": {"defaultVoiceId": "v2_ann_f_30s_03", "tempo": 1.05}}, "speakers": [{"id": "narrator", "name": "내레이터", "voiceId": "v2_ann_f_30s_03", "tempo": 1.05}], "subtitles": {"enabled": true}, "scenes": [{"id": "s01", "title": 장면 제목, "purpose": 이 장면이 끝나면 시청자가 알게 되는 것, "durationSec": 7, "media": {"type": "ai-image", "motion": "kenburns-in"}, "utterances": [{"id": "s01_u1", "speakerId": "narrator", "ttsText": 낭독 글, "subtitleText": 자막 글}], "keyframes": [{"id": "s01_k1", "role": "start", "imagePrompt": "…"}]}, …]} - ttsText 는 숫자를 한글로("삼십 톤"), subtitleText 는 같은 문장을 아라비아 숫자로("30톤") 쓴다. 4. validate_blueprint 를 부른다: {"blueprint": 3번 설계도}. - ok 가 false 면 errors 의 path·message 를 읽고 그 부분만 고쳐 다시 부른다(최대 3번). - 3번 안에 통과하지 못하면 "error" 에 마지막 오류 요약을 적고 끝낸다. [출력] 다음 최상위 필드만 담은 JSON 객체 하나. - blueprint: validate_blueprint 가 돌려준 blueprint(정규화된 설계도) 그대로 [주의] - 쓰는 도구는 validate_blueprint 뿐이다(무료). 이미지·음성은 뒤 단계가 만든다. - 설명·마크다운 없이 JSON 객체 하나만 답한다.