리믹스 레퍼런스 분석
레퍼런스 분석비디아 · v1 · 0회 사용 · 패키지 1개
레퍼런스 영상(주소 또는 파일)의 샷 흐름·컷 속도·카메라·훅을 뽑습니다.
설명서
하는 일 유튜브 숏츠 주소는 reference_fetch(음성 인식 포함), 올린 영상 파일은 analyze_visual(프레임 격자)로 분석해 비트·컷 수·페이싱·스타일·내레이션 유무를 정리합니다. 문장·화면은 옮기지 않고 구조만 남깁니다.
입력 input.reference_url 또는 input.reference_video(둘 중 하나 필수).
출력 reference{hook, beats[], cutCount, pacing, style, people, narrated, transcript, lessons}.
비용 주소: 영상 가져오기·음성 인식·화면 분석(60초 숏츠 약 수십 P). 파일: 시각 분석 LLM 1회.
지시서(스킬 txt)
txt 내려받기[이 모듈이 하는 일]
이미 반응이 좋은 영상 한 편(유튜브 숏츠 URL 또는 회원이 올린 영상 파일)을 레퍼런스로 분석해, 그 영상의 "뼈대"를 뽑는다.
뼈대란 샷 흐름·컷 속도·카메라 움직임·첫 장면의 훅·편집 리듬·내레이션 유무다. 다음 단계(트렌드 리믹스 기획)는 이 뼈대에 회원의 제품을 새로 입힌다.
레퍼런스의 화면·문장은 베끼기 위한 재료가 아니다. "어떤 순서와 리듬으로 보여 줬는가"를 배우는 재료다.
[입력]
이전 단계 JSON(패키지 최초 입력).
- input.reference_url: 레퍼런스 영상 주소(선택). 유튜브 /shorts/ · watch?v= · youtu.be 형식.
- input.reference_video: 회원이 올린 레퍼런스 영상 asset id(선택).
- 둘 다 없으면 도구를 부르지 말고 "error" 에 "레퍼런스 영상 주소나 파일을 넣어 주세요." 를 적어 끝낸다. 둘 다 있으면 올린 파일(reference_video)을 쓴다.
- reference: 이미 분석한 결과가 있고 같은 원본(url 또는 videoAssetId)이면 다시 분석하지 않고 그대로 둔다.
[할 일]
A. 올린 파일(input.reference_video)
1. analyze_visual 을 한 번 부른다: {"asset_id": input.reference_video, "focus": "reference_video", "frames": 9, "question": "샷이 몇 번 바뀌는지, 첫 장면이 어떻게 시선을 잡는지, 제품·사람이 어떤 순서로 나오는지"}.
2. 결과의 details 와 duration_sec 로 아래 [정리] 를 채운다. 파일에서는 음성을 알아낼 수 없으므로 narrated 는 false, transcript 는 "" 로 둔다.
3. 도구가 영상이 아니라거나 읽을 수 없다는 오류를 주면 "error" 에 "레퍼런스 영상을 읽을 수 없습니다: <도구 메시지>" 를 적어 끝낸다.
B. 주소(input.reference_url)
1. reference_fetch 를 한 번 부른다: {"url": 주소, "language": "ko", "frames": 9, "analyze_visual": true, "fetch_title": true}.
- REFERENCE_URL_INVALID 면 다시 부르지 않고 "error" 에 도구 메시지를 적는다.
- 다운로드 실패(비공개·삭제·지역 제한)면 한 번만 다시 부른다. 그래도 실패하면 "error" 에 "레퍼런스 영상을 받을 수 없습니다: <도구 메시지>" 를 적는다.
2. transcript.text 가 20자 이상이고 배경음악 가사가 아닌 말이면 narrated 는 true. 음성 인식 오류로 보이는 낱말은 문맥상 확실할 때만 고친다.
3. 결과의 visual(shots, pacing, visualStyle, onScreenText)과 duration_sec, frame_times_sec 로 [정리] 를 채운다.
[정리] (모두 한국어로 짧고 구체적으로, style 만 영어)
- durationSec: 레퍼런스 길이(초, 소수 첫째 자리).
- hook: 첫 1~2초가 시선을 잡는 방식 한 줄(결과 먼저 보여 주기, 손이 불쑥 등장, 클로즈업 충격, 질문 자막 등).
- beats: 흐름 3~7단계. 각 {"sec": 대략 시작 초, "role": "hook|problem|reveal|demo|detail|result|cta" 중 하나, "shot": 샷 크기(클로즈업·미디엄·와이드·손 접사·탑뷰), "action": 화면 속 동작 한 줄, "camera": 카메라 움직임(고정·핸드헬드·푸시인·팬·휙 넘기기 등)}.
- cutCount: 대략의 컷 수. pacing: 컷 속도 한 줄(예: "1초 안팎의 빠른 컷, 박자에 맞춰 넘김").
- style: 색감·조명·질감을 영어 한 줄(예: "bright handheld smartphone look, warm daylight, high contrast").
- onScreenText: 화면 글자를 어떻게 썼는지 한 줄(쓰지 않았으면 "없음"). 글자 내용은 옮기지 않는다.
- people: 사람이 나오는지, 어떻게 나오는지 한 줄(얼굴 없음·손만·셀카·전신 등).
- narrated: true/false. transcript: 정리한 대본 전문(narrated 일 때만, 1500자 이내).
- lessons: 새 영상에 가져갈 구조적 장점 2~4개(예: "제품이 0.5초 안에 등장", "전후 대비 컷이 1초씩 번갈아 나옴").
[출력]
다음 최상위 필드만 담은 JSON 객체 하나(적지 않은 최상위 필드는 입력값이 그대로 이어진다).
- reference: {"source": "upload" 또는 "url", "url": 주소(있을 때), "videoAssetId": 레퍼런스 영상 asset id(업로드 파일 또는 도구의 video_asset_id), "title": 제목(있을 때), "durationSec": …, "hook": …, "beats": [...], "cutCount": …, "pacing": …, "style": …, "onScreenText": …, "people": …, "narrated": …, "transcript": …, "lessons": [...]}
[주의]
- 쓰는 도구는 analyze_visual(올린 파일) 또는 reference_fetch(주소) 하나뿐이다. 둘 다 부르지 않는다.
- 레퍼런스 속 상표·인물 이름·문장을 새 영상 재료로 옮겨 적지 않는다. 구조와 리듬만 정리한다.
- 설명·마크다운 없이 JSON 객체 하나만 답한다.
버전 기록 1개
고칠 때마다 새 버전으로 쌓이고 지난 버전은 지워지지 않습니다. 패키지는 넣을 때의 버전으로 고정되어 동작합니다.
-
v1현재2026.09.29 14:57 · 4.6KB
시스템 모듈 등록
이 모듈을 쓰는 패키지
리뷰와 반응
불러오는 중…
사용 -건 · 사용 건수는 이 모듈을 실제로 실행한 제작 수입니다(성공률이 아닙니다). 별점은 실제 사용한 회원만 남길 수 있고, 좋아요·싫어요와는 따로 셉니다.