중국 AI 숏드라마 공장의 프롬프트 엔지니어링 해부: 1-Shot 90% 일관성 달성 비법과 실전 템플릿
중국 전문 제작팀 2곳이 80부작 AI 숏폼 드라마 양산에 사용한 프롬프트 전문을 역분석해 8대 설계 기법으로 정리하고, 컷 분할형·연속 촬영형 두 트랙의 실전 템플릿과 시리즈 연속성 관리법까지 제공합니다.
- 중국 도우인·홍궈·빌리빌리 80부작 숏드라마 전문팀 2곳의 1회 생성(1-Shot) 90% 일관성 프롬프트 전문 역분석
- 컷 분할형(애니)과 연속 촬영형(실사) 두 파이프라인을 분리하고, 얼굴 마스킹·조명 상대 비율·컷별 네거티브 등 8대 실무 기법 정리
- 클링·드림이나·런웨이·Veo에 바로 복사해 쓰는 트랙 A/B 실전 템플릿과 시리즈 연속성 원장 양식 제공

목차
- 초보자를 위한 핵심 용어 사전
- 사건의 전말: 유출된 중국 AI 숏폼 공장의 작업 지시서
- 핵심 전제: 유출된 프롬프트는 서로 다른 두 팀의 것이다
- 중국 전문팀의 8대 프롬프트 엔지니어링 핵심 기법
- 실전 적용 가이드: 트랙 A / 트랙 B 프롬프트 템플릿
- 시리즈 연속성 원장: 80편을 굴리는 실제 엔진
- 정리 및 차세대 AI 영상 제작의 시사점
초보자를 위한 핵심 용어 사전
AI 영상 제작을 처음 접하는 입문자분들도 쉽게 이해할 수 있도록 포스트에서 자주 쓰이는 핵심 용어들을 먼저 짚고 넘어가겠습니다.
- 1-Shot(원샷) 생성: 여러 번 다시 생성(리롤)하며 운에 맡기는 방식이 아니라, 잘 짜인 프롬프트 1회 입력만으로 목표한 퀄리티와 일관성을 한 번에 완성하는 생성 기법입니다.
- 리롤(Re-roll): AI 생성 결과물이 마음에 들지 않아 동일한 프롬프트로 재차 생성 버튼을 누르는 행위를 뜻하며, 비용과 시간이 크게 소모되는 주원인입니다.
- 캐릭터 시트(Character Sheet): 인물의 정면, 측면, 후면, 표정 등을 한 장에 정리한 설정 원화로, AI가 영상 전반에서 동일 인물임을 인식하도록 돕는 기준 이미지입니다.
- 광영(光影) 설계: 빛(Light)과 그림자(Shadow)의 위치, 각도, 색온도(Kelvin), 재질별 반사 강도를 3D 그래픽 엔진 파라미터처럼 정밀하게 정의하는 기법입니다.
- 림 라이트(Rim Light / 逆光): 피사체의 뒤편에서 비추어 인물의 윤곽선에 얇은 테두리 빛을 만들어내어 배경과 인물을 돋보이게 분리해 주는 조명입니다.
- 컷 인계(Cut Handover): 영상의 앞 컷이 끝나는 순간의 인물 동작·시선 상태를 다음 컷의 시작 상태와 텍스트로 결합하여 편집 시 튀는 현상(Jump cut)을 없애는 기술입니다.
- 네거티브 프롬프트(Negative Prompt): AI 생성 시 원치 않는 요소(예: 자막, 워터마크, 불필요한 배경음악)가 포함되지 않도록 사전에 제외 명령을 내리는 프롬프트입니다.
사건의 전말: 유출된 중국 AI 숏폼 공장의 작업 지시서
2026년 8월, 국내 AI 영상 SaaS 플랫폼인 툰킷(toonkit_official)이 수천만 원 규모의 대규모 매크로 어뷰징 공격을 받았습니다. 중국의 전문 제작 집단이 봇 프로그램을 이용해 플랫폼의 비디오 생성 크레딧을 무단으로 대량 소진한 사건이었습니다.
하지만 이 공격을 방어하고 사후 분석하는 과정에서 흥미로운 사실이 밝혀졌습니다. 어뷰징 봇들이 남기고 간 프롬프트 로그는 중국 틱톡(도우인), 홍궈(红果短剧), 빌리빌리 등에서 실제로 방영 중인 80부작 이상의 대형 상업용 AI 숏드라마 미공개 에피소드 제작용 프롬프트였습니다.

분석 결과, 이들은 감성적이거나 모호한 자연어를 사용하지 않았습니다. 한 편의 예술 영화를 만들기 위해 수십 번 리롤을 돌리는 대신, 마치 정밀한 공장의 작업 지시서처럼 구조화된 프롬프트를 설계하여 단 한 번의 생성으로 90% 이상의 일관성과 편집 연결성을 확보하고 있었습니다.
또한 원문은 어뷰징 계정 대다수가 비슷한 프롬프트 구조를 쓰는 2개의 전문 집단이었다고 밝혔습니다. 이 구분이 이후 내용을 이해하는 데 결정적이므로 먼저 짚고 가겠습니다.
핵심 전제: 유출된 프롬프트는 서로 다른 두 팀의 것이다
공개된 프롬프트 전문 3장은 한 팀의 것이 아닙니다. 3D 애니 숏드라마를 만드는 A팀과 실사 숏드라마를 만드는 B팀의 결과물이며, 시간 설계 철학이 정반대입니다. 두 방식을 하나의 프롬프트 안에서 섞으면 모델이 컷 경계를 판단하지 못하므로, 반드시 한쪽을 골라야 합니다.
| 항목 | 트랙 A — 컷 분할형 | 트랙 B — 연속 촬영형 |
|---|---|---|
| 원 사용처 | 3D 애니 숏드라마 | 실사 숏드라마 (即梦 Dreamina Seedance 2.5) |
| 시간 표기 | 컷1 | 4.5초, 컷2 | 1.5초 |
0—2초:, 2—4초: |
| 카메라 | 거의 지시하지 않음 (근경/아이레벨 정도) | 컷마다 렌즈 mm 명시 |
| 캐릭터 참조 | [@참고N] 태그 |
@이름 = image N = 파일명.png |
| 네거티브 | 컷 블록마다 반복 | 마지막 영어 블록 1회 |
| 강점 | 컷 길이를 정확히 통제, 리듬 편집이 쉬움 | 카메라 무빙이 살아있고 편집점 자체가 없음 |
| 약점 | 컷 사이 미세 점프 가능 | 컷 길이 통제가 모델 재량 |
선택 기준은 단순합니다. 대사 주도의 빠른 대화극이나 애니 룩이면 트랙 A, 카메라 무빙이 연출의 핵심이거나 실사 원테이크 느낌이면 트랙 B입니다. 판단이 서지 않으면 트랙 A를 고르세요. 실패해도 컷 단위로 부분 리롤이 가능해 비용이 덜 듭니다.
한 가지 더, 원문이 밝힌 A팀의 작업 철학은 이 글 전체를 관통하는 상위 원리입니다.
100%의 일관성을 시간과 비용을 들여 잡지 않습니다. 90%의 일관성을 단 한 번의 생성으로 잡습니다.
80편이 넘는 시리즈 전체를 제작하면서 이 팀이 프롬프트에서 바꾼 내용은 거의 없습니다. 각 컷의 액션은 서술형으로 짧게, 대사는 원작 대사를 그대로 붙여넣고, 시작과 끝 장면은 캐릭터별 상태를 딱 한 줄씩 적었습니다. 연출 품질을 올리는 데 리소스를 쓰지 않고, 그 예산을 전부 일관성과 연결성에 몰아넣은 구조입니다.
중국 전문팀의 8대 프롬프트 엔지니어링 핵심 기법
기법 1: 캐릭터 시트 의도적 훼손(얼굴 마스킹) 기법
기존 AI 영상 제작에서 가장 흔히 겪는 문제는 캐릭터 시트의 얼굴 사진을 레퍼런스로 주었을 때, AI가 해당 얼굴을 고정된 스티커처럼 복사하여 영상 속 인물의 표정이 굳어버리거나 클로즈업 시 디테일이 뭉개지는 현상입니다.
중국 전문 제작팀은 이 문제를 역발상으로 해결했습니다.
- 1단계는 힉스필드(Higgsfield)
Cully Hill Boys제작팀이 공개한 방식과 동일합니다. 얼굴이 없는 전신 이미지와 얼굴 클로즈업 이미지를 분리해서 함께 넣습니다. - 중국 팀은 여기서 한 단계 더 나아갑니다. 아이덴티티를 확인할 수 있는 요소(체형, 의상, 헤어스타일)만 남기고 클로즈업용 얼굴 섹션까지 의도적으로 훼손해서 넣습니다.
- 영상 생성 AI 모델이 레퍼런스 이미지로부터 고정된 얼굴 텍스처를 그대로 가져오는 것을 강제로 차단합니다.
- 모델은 인물의 복장과 체형 일관성만 레퍼런스에서 유지하고, 얼굴 표정과 디테일한 눈빛 연기는 프롬프트의 씬 지시문에 맞춰 실시간으로 자유롭게 렌더링하게 됩니다.
이 방식을 통해 80편이 넘는 장편 시리즈 내내 인물의 정체성은 유지하면서도 감정에 따른 생생한 클로즈업 연기를 구현할 수 있었습니다.
기법 2: 조명과 재질의 상대 비율 수치화 (광영 설계)
일반적인 초보자는 칼이 번쩍인다나 어두운 밤거리 같은 모호한 형용사를 사용합니다. 하지만 중국 팀은 프롬프트의 20% 이상을 오직 조명과 재질의 상대적 가중치 배율을 정의하는 데 할당했습니다.
【광영 설계】수행 5000K 냉백색; 45° 주(主) 사이드광 + 180° 림 역광 + 저강도 환경 보조광;
전역 심도 섀도(깊이 0.8 / 소프트엣지 0.2 / 거리 10m); 인물 얼굴 아이라이트;
장도 금속 하이라이트 ×1.5, 피부 하이라이트 ×0.5, 천 하이라이트 ×0.3
- 절대적인 광원 밝기 대신 재질별 상대 비율(
금속 ×1.5, 피부 ×0.5, 천 ×0.3)을 부여하여, 금속 무기만 선명하게 빛나고 피부와 옷감은 차분하게 톤다운되도록 설계했습니다. - 색온도(5000K)와 조명 각도(45° 사이드 + 180° 역광)를 명시하여 컷이 바뀌거나 카메라 화각이 변경되어도 전체 시리즈의 미장센과 톤앤매너가 완벽히 고정됩니다.
기법 3: 초 단위 타임라인 및 앞뒤 컷 양방향 인계
후반 편집(컷 편집) 시간을 없애기 위해, 이들은 시작 프레임과 종료 프레임의 상태를 텍스트 타임라인으로 철저히 고정했습니다.
여기서 놓치면 안 되는 전제가 있습니다. 이들은 시작 프레임과 엔드 프레임을 레퍼런스 이미지로 넣지 않습니다. 영상이 시작할 때와 끝날 때의 각 인물 상태를 오직 텍스트로만 고정합니다. 프레임을 이미지로 넣으면 컷마다 에셋을 새로 만들어야 해서 파이프라인이 멈추기 때문입니다. 텍스트로만 고정하기 때문에 다음 에피소드 프롬프트는 이 블록만 갈아끼우면 됩니다.
【10초 연속 촬영】
0~2초: S04의 신발 밑창이 화면을 채운 상태에서 시작. 35mm 지면 밀착 로우앵글.
2~4초: 24mm 미들샷 전환. 카메라가 신발에서 청죽 지팡이를 따라 빠르게 상승.
4~7.5초: 50mm 소식 미디엄클로즈업으로 전환. 대사 발화.
7.5~10초: 하드컷으로 50mm 여자아이 정면 미디엄클로즈업.
【종료 프레임과 S06 연결】
50mm 소식 리액션 클로즈업. 청죽 지팡이가 몸 옆에 세워져 있고 눈웃음을 띤 채 입술이 막 열리려는 상태.
S06은 소식의 답 대사부터 시작.
- 시작 프레임을 이전 씬(S04)의 마지막 동작 방향과 일치시키고, 종료 프레임을 다음 씬(S06)의 첫 대사와 첫 동작으로 인계하도록 명시합니다.
- 영상 편집 툴에서 컷을 자르고 다듬는 수작업 시간을 제로에 가깝게 줄여주며, 영상과 영상 사이의 부자연스러운 연결(Jump Cut)을 원천 차단합니다.
기법 4: 상수와 변수 분리 더빙 및 대사 싱크 락
대화와 호흡이 빠른 숏드라마의 특성에 맞춰 영상의 템포를 카메라 무빙이 아닌 더빙 지침으로 리드했습니다.
- 상수(고정값): 캐릭터의 음색(맑고 차가운 소년 음색), 기본 성격(과묵하고 차분함)
- 변수(변동값): 해당 컷의 감정 상태(조롱, 호쾌한 웃음), 어조(차갑고 느리게, 문장 끝 올림)
【더빙 지시: 고여[@참고1] | 차갑고 맑은 소년 음색 | 눌러 참고 자제함, 말수 적고 낮게 |
상태(조롱) | 어조(차갑게/느리게/문장 끝 올림): "네가 종문에서 저지른 짓들만 놓고 봐도, 내가 널 죽이는 건 종문의 해악을 제거하는 셈이지."】
뿐만 아니라 대사의 특정 단어가 발화되는 시점에 정확한 액션을 트리거하도록 지시했습니다.
예컨대 "괴상한"이라 말할 때 눈가 웃음주름이 펴지고, "그 신발"이라 말할 때 손가락이 신발을 가리키며, "변경"이라 말할 때 고개를 들어 상대방을 응시하도록 텍스트-액션 타임 싱크 락을 적용했습니다.
기법 5: 후반 작업을 고려한 네거티브 가이드라인 접미사
프롬프트의 마지막에는 모델이 엉뚱한 요소를 생성하지 못하도록 최우선 공통 규칙을 고정했습니다.
【CORE GUIDELINES | 최우선 접미】
Strictly follow the prompt descriptions without any deviation.
Absolutely NO background music (BGM); only retain ambient sound effects and raw character voices.
The spoken lines must perfectly match the exact words provided,
delivered fully and completely in Mandarin Chinese.
Absolutely NO subtitles.
- 배경음악(BGM)을 원천 배제하고 오직 현장 앰비언트 효과음과 인물 생목소리만 출력하도록 강제합니다.
- 화면에 AI가 멋대로 생성하는 텍스트나 자막, 워터마크를 완벽히 차단하여, 후반 작업 시 BGM 믹싱과 다국어 로컬라이징 자막 삽입을 자유롭게 진행할 수 있습니다.
delivered fully and completely in Mandarin Chinese조항은 더빙 언어를 강제하는 유일한 장치입니다. 이 문장을 빼면 모델이 영어나 다른 언어로 말하는 결과가 섞여 나오므로, 한국어 콘텐츠라면 이 부분만in Korean으로 바꿔 반드시 유지해야 합니다.- 이 블록만 영어로 작성된 점도 의도적입니다. 모델이 가장 확실하게 따르는 언어로 하드 제약만 골라 맨 끝에 배치한 설계입니다. 여기에 스타일 형용사를 섞으면 제약이 희석됩니다.
기법 6: 컷마다 반복하는 네거티브 리셋
가장 저평가되기 쉬운, 그러나 오늘 당장 따라 할 수 있는 가장 값싼 기법입니다. A팀은 네거티브를 프롬프트 맨 끝에 한 번만 두지 않았습니다. 모든 컷 블록의 마지막 줄마다 같은 문장을 반복합니다.
컷1 | 4.5초 | 근경/아이레벨 (조롱)
고여[@참고1]가 희롱하듯 웃는다. 칼끝은 미동도 없고, 시선은 차갑게 두림[@참고2]의 얼굴에 떨어진다.
【더빙 지시: ...】
본 컷은 위 내용만 표현. 언급되지 않은 인물·물체·이펙트·배경 추가 금지
컷2 | 1.5초 | 근경/아이레벨 (두림 실어)
두림[@참고2]이 두 눈을 부릅뜬다. 목울대가 움직이지만 한 글자도 내뱉지 못한다.
【더빙 지시: 없음】
본 컷은 위 내용만 표현. 언급되지 않은 인물·물체·이펙트·배경 추가 금지
- 프롬프트가 길어질수록 후반부 지시의 영향력이 떨어지는 특성을 아는 사람들의 설계입니다. 컷마다 제약을 리셋해 걸어주는 것입니다.
- 대사가 없는 컷도
【더빙 지시: 없음】으로 명시합니다. 생략하면 모델이 대사를 지어냅니다. - 캐스트 블록에도 같은 원리의 선언이 들어갑니다.
【여기 명시되지 않은 캐릭터, 캐릭터명의 어떠한 대체 호칭, 장면, 소도구 요소도 등장 금지】. 등장하는 것보다 등장하지 않아야 할 것의 선언이 모델의 자유 창작을 막는 유일한 문장입니다. - 부수적으로 A팀은 엑스트라를
배경 지배급 캐릭터라는 별도 등급으로 분리해, “옆에 서서 방관하되 선명한 주연 연기에는 참여하지 않음”이라고 못 박습니다.
기법 7: 파일명 규약으로 캐릭터를 바인딩하는 소재 관리
B팀은 캐릭터를 태그가 아니라 실제 에셋 파일명까지 프롬프트에 명시하는 방식으로 바인딩합니다.
【입력 모드와 인물 소재 바인딩】
Omni Reference / 3조 실사 참조 생성.
@여자아이 = image 1 = xiaoyu_girl_live_action_unobstructed_asset_v2.png:
여자아이의 유일한 실사 정체성 참조로서, 동일한 얼굴·실제 나이·양갈래 만두머리·일자 앞머리·
아동 체형, 그리고 흰 후드 스웨트셔츠·연회색 트레이닝 바지·흰 운동화를 고정.
@소식 = image 2 = tixilin_chr002_sushi_live_action_v1.png:
소식의 유일한 실사 정체성 참조로서, 동일한 얼굴·나이·상투·수염·체형·회청색 마 도포·
초혜·청죽 지팡이를 고정.
@산중 행인 = image 3 = tixilin_bg001_mountain_extras_live_action_v1.png:
원경의 승려·나무꾼·참배객의 시대 정체성과 복장만 담당하며,
여자아이와 소식의 얼굴은 바꾸지 않는다.
@태그는 소재 호출용일 뿐, 화면 문자로 생성하지 않는다.
- 파일명이
{작품코드}_{chr|bg}{번호}_{이름}_{live_action}_v{버전}.png규약을 따릅니다. 프롬프트가 아니라 파일 시스템이 일관성을 보장하게 만드는 구조로, 80편짜리 시리즈를 굴리는 팀의 실제 운영 방식이 여기서 드러납니다. - 엑스트라 소재(image 3)에는 “시대 정체성과 복장만 담당하며 주연들의 얼굴은 바꾸지 않는다”는 역할 제한이 붙습니다. 엑스트라 레퍼런스가 주연 얼굴을 오염시키는 흔한 사고를 프롬프트 단계에서 차단합니다.
- 마지막 줄의
@태그는 화면 문자로 생성하지 않는다는 태그명이 자막처럼 화면에 렌더링되는 사고를 막는 안전장치입니다.
기법 8: 드리프트를 특정해서 못 박는 인물·상태 연속성 블록
B팀은 타임라인 뒤에 연속성 전용 블록을 따로 둡니다. 핵심은 막연한 “의상 유지”가 아니라 그 모델이 실제로 자주 저지르는 드리프트를 특정해서 부정한다는 점입니다.
【인물·상태 연속성】
여자아이는 image 1만, 소식은 image 2만, 산중 행인은 image 3만 인식된다.
여자아이는 흰 운동화를 유지하며 주황 신발로 바뀌지 않는다;
소식의 상투·수염·회청 마 도포·검은 초혜·청죽 지팡이는 전 구간 일치한다.
인물은 고개를 숙이거나 들 때, 말할 때, 빠르게 컷이 전환될 때에도
각자 동일한 얼굴·나이·피부색·헤어스타일·체형·의상을 유지한다.
젖은 석계·이끼·안개 방향·인물의 입지가 연속된다.
주황 신발로 바뀌지 않는다처럼 오답을 콕 집어 부정하는 문장이 “의상을 유지하라”보다 훨씬 강하게 걸립니다. 자신이 쓰는 모델이 반복해서 틀리는 항목을 기록해두었다가 이 자리에 그대로 넣으세요.- 인물뿐 아니라 안개 방향, 젖은 표면, 이끼 같은 환경 속성의 연속성까지 명시합니다.
- 같은 맥락에서 B팀은 【연기와 리듬 락】 블록도 둡니다. 착지 → 미끄러짐 → 지팡이 착지를 “하나의 연속 동작 사슬”로 묶고, “군중은 원경 공간 레이어로만 기능하며 대사와 주체 시선을 빼앗지 않는다”고 지정합니다. 카메라가 아니라 동작 사슬로 컷을 잇는 발상입니다.
실전 적용 가이드: 트랙 A / 트랙 B 프롬프트 템플릿
앞서 정리한 8대 기법을 두 트랙으로 나눠 템플릿화했습니다. 하나를 골라 중괄호 슬롯만 채우면 됩니다. 두 템플릿을 섞지 마세요. 시간 설계 철학이 다르기 때문에 혼용하면 모델이 컷 경계를 판단하지 못합니다.
트랙 A 템플릿 — 컷 분할형 (애니 / 대사 주도)
Kling, Hailuo처럼 짧은 컷을 정확히 통제해야 하는 모델에 적합합니다.
【전역 스타일·질감】16:9 가로화면, {질감}, {세계관}, 4K 고화질, 초고밀도 디테일, 레이트레이싱, 영화급 섬세한 광량, {렌더 레퍼런스}, 고대비 명암 계조, 질감 사실적, 자막 없음, 워터마크 없음, 배경음악 없음, 캐릭터 얼굴 표정과 손 동작 명확. 본 컷의 주 이펙트는 {주이펙트}이며 소도구와 동작 변화에 밀착, 화면은 깔끔하게.
【광영 설계】{색온도}K {색감}, {각도}° 주 사이드광 + 180° 림 역광 + 저강도 환경 보조광, 전역 심도 섀도(깊이 0.8 / 소프트엣지 0.2 / 거리 10m), 인물 얼굴 아이라이트, {주오브젝트} 하이라이트 ×1.5, 피부 하이라이트 ×0.5, 천 하이라이트 ×0.3, 전역 노출 정상 유지, 광량 방향 단일.
【분경조 {n} | {제목} | 길이: {N}초】
장면: {장소}, {시간대}, {실내외}: 근경, {A}[@참고1]가 {자세}; 중경, {B}[@참고2]가 {자세}; 원경, {엑스트라} 실루엣; {광원 상태}.
캐릭터: {A}[@참고1], {B}[@참고2]
배경 지배급 캐릭터: {C}[@참고3] ({위치}에서 방관, 주연 연기에는 참여하지 않음)
소도구: {소도구}
【여기 명시되지 않은 캐릭터, 캐릭터명의 어떠한 대체 호칭, 장면, 소도구 요소도 등장 금지】
컷1 | {t1}초 | {샷}/{앵글} ({목적})
{A}[@참고1]가 {동작}. {시선 상태}.
【더빙 지시: {A}[@참고1] | {음색 상수} | {성격} | 상태({감정}) | 어조({속도}/{강약}/{끝}): "{대사}"】
본 컷은 위 내용만 표현. 언급되지 않은 인물·물체·이펙트·배경 추가 금지
컷2 | {t2}초 | {샷}/{앵글} ({목적})
{B}[@참고2]가 {동작}.
【더빙 지시: 없음】
본 컷은 위 내용만 표현. 언급되지 않은 인물·물체·이펙트·배경 추가 금지
컷3 | {t3}초 | {샷}/{앵글} ({목적})
{A}[@참고1]가 {동작}.
【더빙 지시: {A}[@참고1] | {음색 상수} | {성격} | 상태({감정}) | 어조({속도}/{강약}/{끝}): "{대사}"】
본 컷은 위 내용만 표현. 언급되지 않은 인물·물체·이펙트·배경 추가 금지
분경조 종료 시 고정 화면 주체와 상태: {A}는 {상태}; {B}는 {상태}; {C}는 {상태}.
【CORE GUIDELINES】
Strictly follow the prompt descriptions without any deviation. Absolutely NO background music (BGM); only retain ambient sound effects and raw character voices. The spoken lines must perfectly match the exact words provided, delivered fully and completely in Korean. Absolutely NO subtitles.
트랙 B 템플릿 — 연속 촬영형 (실사 / 카메라 주도)
Dreamina Seedance, Runway, Sora처럼 긴 지문과 카메라 지시를 잘 소화하는 모델에 적합합니다.
【{모델명} | 《{작품명}》 S{화번호} | {N}초 | 16:9 | 실사 촬영 속도감 버전】
【입력 모드와 인물 소재 바인딩】
Omni Reference / {N}조 실사 참조 생성.
@{A} = image 1 = {파일명1}.png: {A}의 유일한 실사 정체성 참조로서, 동일한 얼굴·실제 나이·{헤어}·{체형}, 그리고 {의상 전체}를 고정.
@{B} = image 2 = {파일명2}.png: {B}의 유일한 실사 정체성 참조로서, 동일한 얼굴·나이·{헤어}·{체형}·{의상}을 고정.
@{엑스트라} = image 3 = {파일명3}.png: 원경의 {역할}의 시대 정체성과 복장만 담당하며, {A}와 {B}의 얼굴은 바꾸지 않는다.
@태그는 소재 호출용일 뿐, 화면 문자로 생성하지 않는다.
【실사 스타일 락】
{모델명}로 {N}초·16:9 가로·24fps 실사 영화 촬영 영상 생성. 실제 배우, 자연스러운 피부, 낱낱이 분리된 머리카락, {의류 질감}, {환경 질감}. {장소}, {색조}. {렌즈1}mm {용도}, {렌즈2}mm {용도}, {렌즈3}mm {용도}를 빠르게 전환.
【{N}초 연속 촬영】
0—{a}초: {렌즈}mm {앵글}. {카메라 움직임}. {인물}가 {동작 사슬}. {사운드}.
{a}—{b}초: {렌즈}mm {샷}으로 전환. {카메라 움직임}. {동작}. {사운드}.
{b}—{c}초: {렌즈}mm {인물} 미디엄클로즈로 전환. {동작}. {감정}을 담아 온전히 말한다: "{대사}" "{단어1}"이라 말할 때 {동작1}, "{단어2}"라 말할 때 {동작2}, "{단어3}"이라 말할 때 {동작3}.
{c}—{N}초: 하드컷으로 {렌즈}mm {인물B} 정면 미디엄클로즈. {동작}. {감정}을 담아 묻는다: "{대사}" {단어별 싱크}.
【연기와 리듬 락】
{동작 사슬 서술}. {인물A}의 이행. {인물B}의 감정 상승. 군중은 원경 공간 레이어로만 기능하며 대사와 주체 시선을 빼앗지 않는다.
【인물·상태 연속성】
{A}는 image 1만, {B}는 image 2만, {엑스트라}는 image 3만 인식된다. {A}는 {핵심 의상}을 유지하며 {드리프트 경보}로 바뀌지 않는다. {B}의 {속성 목록}은 전 구간 일치한다. 인물은 고개를 숙이거나 들 때, 말할 때, 빠르게 컷이 전환될 때에도 각자 동일한 얼굴·나이·피부색·헤어스타일·체형·의상을 유지한다. {환경 속성}이 연속된다.
【종료 프레임과 S{n+1} 연결】
{렌즈}mm {인물} 리액션 클로즈업. {소도구 상태}, {표정}, {시선}, {직전 상태}. S{n+1}은 {인물}의 답 "{다음 화 첫 대사}"부터 시작.
【CORE GUIDELINES | 최우선 접미】
Strictly follow the prompt descriptions without any deviation. Absolutely NO background music (BGM); only retain ambient sound effects and raw character voices. The spoken lines must perfectly match the exact words provided, delivered fully and completely in Korean. Absolutely NO subtitles.
슬롯을 채울 때 쓰는 참조표
재질 하이라이트 비율은 장르에 따라 ×1.5를 받을 주인공 오브젝트가 달라집니다. ×1.5짜리는 반드시 하나만 두세요.
| 장르 | ×1.5를 받을 주오브젝트 | 피부 | 천/의상 | 배경 |
|---|---|---|---|---|
| 무협·검극 | 금속 도검 | ×0.5 | ×0.3 | ×0.2 |
| 현대 드라마 | 유리·액정·물기 | ×0.6 | ×0.3 | ×0.25 |
| 사극·시대극 | 목재·도자·마 직물 | ×0.55 | ×0.4 | ×0.3 |
| SF·사이버펑크 | 네온·홀로그램 | ×0.4 | ×0.35 | ×0.5 |
| 호러·스릴러 | 젖은 표면·핏기 | ×0.35 | ×0.2 | ×0.15 |
| 일상·로맨스 | 피부 (이때만 피부가 ×1.2) | — | ×0.5 | ×0.4 |
렌즈는 컷 전환 시 한 단계씩만 이동시킵니다. 24mm에서 85mm로 점프하면 모델이 인물 정합을 잃습니다.
| 렌즈 | 용도 | 부작용 |
|---|---|---|
| 24mm | 환경 미들샷, 공간 소개 | 인물 왜곡. 얼굴 클로즈업에는 금지 |
| 35mm | 지면 밀착 로우앵글, 걷기·발 | 배경이 많이 들어옴 |
| 50mm | 미디엄 클로즈업, 대사 발화 | 대사 컷의 기본값 |
| 85mm | 감정 클로즈업, 리액션 | 배경 완전 소실 |
색온도는 5000–5200K 냉백색(정오 야외·냉정한 대치), 6000–6500K 청백색(흐린 날·산중), 4000–4500K 중성(실내 형광), 3000–3200K 앰버(석양·회상)를 기준으로 잡으면 됩니다.
템플릿 활용 5단계 팁
- 캐릭터 시트는 얼굴이 없는 전신과 얼굴 클로즈업을 분리해서 준비하고, 클로즈업 쪽도 아이덴티티 요소만 남기고 마스킹해서 업로드합니다.
- 대사와 액션을 1:1로 매핑하여 특정 단어가 발화될 때의 손동작이나 시선 처리를 함께 적습니다.
- 컷의 시작과 끝에 렌즈 밀리미터를 지정하되 한 단계씩만 이동시킵니다.
- 트랙 A라면 모든 컷 블록 끝에 네거티브 문장을 반복합니다. 맨 끝에 한 번만 두지 마세요.
- 자신이 쓰는 모델이 반복해서 틀리는 항목(의상 색, 소도구 소실, 헤어 변형)을 기록해두었다가 【인물·상태 연속성】 블록에 오답을 콕 집어 부정하는 문장으로 넣습니다.
시리즈 연속성 원장: 80편을 굴리는 실제 엔진
2편 이상을 만들 계획이라면 프롬프트와 별도로 두 개의 관리 파일이 필요합니다. 이것이 없으면 5화쯤에서 주인공이 다른 사람이 됩니다.
캐릭터 바이블 — 에피소드 간 절대 불변값입니다.
## {이름}
- asset: {파일명}.png (얼굴 마스킹 버전 / 클로즈업 버전 별도)
- 고정 외형: {얼굴·나이·헤어·체형}
- 고정 의상: {상의·하의·신발·액세서리} ← 색상까지 명시
- 음색 상수: {음질} 음색 | {발화 습관} | {기본 성격}
- 드리프트 경보: {이 모델이 자주 틀리는 항목}
상태 원장 — 화별 인계 상태입니다.
| 화 | 종료 상태 | 다음 화 첫 대사 | 다음 화 첫 동작 |
|---|---|---|---|
| S05 | 리액션 클로즈업, 입술이 막 열리려는 상태 | “{첫 대사}” | 지팡이를 고쳐 쥠 |
새 에피소드 프롬프트는 원장에서 소재 바인딩과 종료 상태 블록을 그대로 끌어오고, 씬과 타임라인만 새로 씁니다. 원문이 말한 “80편이 넘는 시리즈 전체를 제작하면서 프롬프트에서 바꿔준 내용은 거의 없다”의 실체가 바로 이 분업입니다.
정리 및 차세대 AI 영상 제작의 시사점
이번 중국 전문 제작팀의 프롬프트 유출 사례는 AI 영상 제작의 패러다임이 단순한 우연에 기댄 리롤에서 시스템화된 엔지니어링 파이프라인으로 진화했음을 명확히 보여줍니다.
- 운에 기대는 확률 게임이 아닌, 조명 비율·타임코드·대사 싱크를 통제하는 결정론적 설계의 중요성
- 후반 편집 공정을 프롬프트 단계에서 미리 상쇄하는 설계 (원문 표현으로는 “후반 편집 공정을 상쇄하고, 생성된 영상과 영상 사이의 경계 연결을 자동화”)
- 개인 창작자도 캐릭터 바이블과 상태 원장만 갖추면 동일한 파이프라인을 축소 적용 가능
다만 짚어둘 점이 있습니다. 원문은 유출된 생성물 일부가 도우인·홍궈·빌리빌리에서 방영 중인 인기 시리즈의 미공개분이었다고 밝혔고, 실제로 프롬프트의 대사는 원작 대사를 그대로 붙여넣은 것이었습니다. 공정 설계 자체는 중립적인 엔지니어링이지만, 이 기법의 실전 사례가 기존 IP를 대사째로 재생산하는 작업일 가능성이 있다는 뜻입니다. 구조는 그대로 가져오되 소재는 자체 IP로 채우는 것이 안전합니다.
툰킷 측은 어뷰징을 당한 경위와 이 제작 방식이 공개된 배경을 별도로 공유하겠다고 예고했습니다. 후속 내용이 나오면 이 글에도 반영하겠습니다.
이제 위의 템플릿과 8대 기법을 여러분의 프로젝트에 직접 적용해 보시기 바랍니다. 수십 번의 리롤 없이도 원하는 퀄리티의 컷들이 하나의 서사로 매끄럽게 연결되는 생산성을 경험하실 수 있을 것입니다.