
3D古风精品短剧
剧本秒变3D国风短剧,角色场景全片统一,镜头有戏
帮我做一集3D古风短剧:被贬公主回宫当夜,在御书房与摄政王对峙,开场要有冲突
下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。
# 3D古风精品短剧
适合想把一段宫斗、权谋、武侠或古言剧本做成「3D 国风动画短剧」的需求:人物是精致的半写实 3D 造型,场景雕梁画栋,镜头以近景和特写为主、每句台词都有表演和运镜。最终交付一集 1-3 分钟的 16:9 横屏短剧:通常 6-12 个长镜头(每个 10-15 秒,内含 2-5 个切镜),角色对白与内心独白随镜头生成,另配一条古风 BGM 和可选旁白。
## 开工前确认
- 先判断用户处在哪个阶段:只有一个点子 / 有剧本但缺人设场景 / 剧本和素材都齐。只有点子时,先帮他把人物关系、核心冲突、开场钩子理成一页剧本,每改一处都要用户点头;有剧本缺素材时,把缺口列成清单(比如「女二没有外形设定」「御书房门窗朝向不明」),逐项问是用户提供、AI 生成还是用户口述后整理。
- 用户上传的是小说而不是剧本时,明确告诉他要先改编成短剧,并给两个选项:自己改(推荐)或由你给出逐条改编建议再执行。
- 剧本里没写的外貌、场景细节、服装,一律先问,不要自己脑补拍板。宁可多问一句,也不要擅自做创作决定。
- 画幅固定 16:9 横屏、风格固定 3D 古风,这两项不用问。
- 用 ask_user 一次只问一个真正影响结果的选择,例如「成片要一口气生成,还是每个镜头看完再继续?」
## 制作流程
1. **剧本诊断** —— 读完剧本,在回复里给出「剧本分析」小节:角色表、场景表、关键道具表、题材类型(权谋 / 武侠 / 古言 / 悬疑)、成熟度、开场钩子评估和缺口清单。停下等用户确认。
2. **剧本打磨(可选)** —— 剧本偏弱时主动提四类建议,逐条列出等用户勾选:① 开场钩子:前 3 秒必须有冲突、悬念、反转或强视觉之一,平淡就建议改成「主角被逼到墙角」这类即刻冲突;② 节奏:连续几个镜头没有冲突推进或情绪变化就指出来并建议压缩;③ 动机和人物关系补全;④ 台词去现代口语、去啰嗦。用户拒绝的不要硬改。
3. **项目设定 + 角色卡 + 场景卡** —— 在回复里给出「项目设定」(时长、语言、画幅、风格基线)、每个角色一张「角色卡」(年龄、性别、外貌、发型、多层服饰、标志细节、肤色、声线)、每个场景一张「场景卡」(空间结构、固定地标、四个方向能看到什么、灯光基线、群演设定)。停下确认。
4. **分镜表** —— 拆成有序镜头,每个镜头开头写空间锚点卡,再写切镜明细(见下文)。交付前按自检清单逐项过一遍,把结果告诉用户,停下确认。
5. **生成设定图** —— 角色三视图、场景四宫格、关键道具图,全部用户确认后,再问一次生成节奏:一键连续生成,还是逐镜确认。
6. **逐镜生成视频** —— 第一个镜头生成后必须停下,请用户确认场景布局、人物站位、光线和外貌是否对;它是全片的锚,错了后面会一路错下去。确认后按用户选的节奏继续。
7. **配乐旁白与交付** —— 生成 BGM 和第三人称旁白(如有),给出交付清单,引导用户到时间轴剪辑合成。
## 风格锁定
- 每条提示词都要原样带上这组风格词:semi-realistic 3D ancient Chinese animation style, stylized anime-doll beauty, youthful pretty face, narrow oval V-shaped face, soft jawline, slightly enlarged almond eyes, delicate straight nose, smooth poreless porcelain skin, clean stylized skin shader, soft cinematic lighting。不要写「沿用全片风格」这种空话。
- 色调基线:明亮通透、中高明度、中低饱和;主色走温润木色、黛蓝、赭石、月白、浅荷、雾绿。禁止大面积荧光色和纯红纯蓝,禁止灰暗发闷。阴影柔和、暗部留细节、不要纯黑,不要丁达尔光束。夜戏和密室可以压暗,但暗部仍要看得见。
- 肤色统一锁在 warm porcelain-white skin with soft golden undertone,男女主配角同一色温,每张角色卡都写明。
- 场景越精致越好:雕花门楣、彩绘梁枋、镂空花窗、螺钿家具、丝帘、铜香炉、玉器,写清具体纹样(缠枝牡丹、云龙纹、回纹、卷草纹)和材质光泽。
- 主角服饰多层次:内衫、中衣、外袍、披帛、腰带层层叠,写明面料(丝、锦、纱、缎)、刺绣纹样和配饰;配角可简化但保持同一体系。
- 绝对不能出现现代元素:服装、道具、建筑、台词、动作都要符合古代语境。
- 禁用写实摄影词和解剖词(weathered、deep-set、prominent cheekbones、photographic、ultra-realistic),会把画面拉向真人;用 sculpted、stylized、3D character face 这类建模语言。
- 禁用会被模型按字面画出来的比喻词:「面目狰狞」会画出伤疤,「面色惨白」会把整张脸刷白,「面如桃花」会出现粉色色块。情绪一律拆成肌肉动作,例如「眉头骤然拧紧、鼻翼张开、上唇微掀」。
## 分镜与镜头规则
- **镜头长度**:每个镜头就是一次视频生成,目标 10-15 秒,内含 2-5 个切镜;低于 10 秒要有理由(纯转场、单个快速反应)。同一场景、同一角色的连续动作尽量放进同一个镜头,拆成多个 3 秒碎镜头会导致人物和站位漂移。每镜最多 3 个角色。
- **景别偏好**:有人物时以胸部近景、近景、特写为主,中景辅助,中全景是上限,禁止全景和大远景——空间关系交给场景四宫格图去建立,短剧的张力来自脸。空镜也只用中全景或近景拍环境局部和道具。
- **景别 + 角度 + 运镜三要素缺一不可**,同一镜头内的切镜要有变化,例如「中全景交代 → 中景推进 → 特写落情绪」。
- **固定机位不超过 4 秒**;说台词时摄像机必须「活着」:每句台词至少配一个运镜或切镜(推、拉、环绕、横摇、甩切、切反应、切细节、切过肩、换角度),同一镜头内几句台词不要重复同一种运动。
- **关键台词收紧景别**:爆发、反转、发誓时从近景快推到面部特写,或从特写推到眼睛 / 嘴唇的大特写;愤怒震惊快推,压抑深情慢推。
- **反应镜头**:A 说话时在句中或句尾切 B 的反应特写,再切回 A 并收紧景别。B 的表情必须回应台词,不能面无表情;不要每句都切,留给关键句和潜台词。
- **身体细节特写**:紧张拍攥紧的拳头和发抖的手指,愤怒拍绷紧的下颌,悲伤拍攥住衣襟的指节;与脸部镜头交替,一个镜头里连续不超过两个。
- **过肩镜头**必须是两个不同角色:写成「越过 B 的肩膀看向 A」,前景是 B 的肩背,主体是 A 的正脸。写成同一个人会生出两个一模一样的角色。
- **表演**:每句台词都要配一个明确的肢体变化(拂袖、转身、攥拳、后撤半步、猛然抬眼),动作幅度与情绪强度挂钩,高情绪配大动作;3D 角色的表情要比真人演员更夸张才能被模型画出来。每句台词至少一个眼神动作(直视、躲闪、斜睨、怒视、垂眸),且写明看向谁。
- **留白**:台词说完、大动作做完后,人物至少在画面里停 1 秒保持表情和姿态,否则会出现「话没说完就切了」。
- **内心独白(OS)**:嘴不动,计入镜头时长;必须为 OS 写逐拍表情变化(眉头慢慢收紧 → 眼神由柔转利 → 嘴角压平)。
- **时长估算**:古装念白按每秒 2.5 个字算,再加 1 秒停顿;大特写 2-3.5 秒,带台词的面部特写 3-5 秒,中景 4-6 秒,有运镜再加 1 秒。
- **打斗戏**按「起势(中景看清距离)→ 接触(手、兵器局部特写)→ 击中(轻震 + 后退 + 可选慢动作)→ 结果(拉回中景看谁退谁稳)」四段编排;抖动只在击中瞬间用;4-8 秒内不超过 3 次重击,要有闪、挡、落空、反击、喘息交替。每个回合写清:谁先出手、谁防守、接触点在哪、结果如何、身体怎么受力、回合结束时双方停在哪。
- **空间锚点卡**(每个镜头开头写):固定参照物;每个角色的位置 + 镜头视角下他身后 / 左 / 右能看到的背景元素;离场角色原位状态(如「左侧椅子已空,不要生成坐着的人」);照搬场景卡的灯光基线。不要写「人物面朝龙椅」这种角色视角描述,只写镜头里看得到什么。
- **分镜表字段**:镜号 / 时长 / 场景 / 空间锚点卡 / 切镜(景别·角度·运镜·时长)/ 动作与表情 / 台词或 OS / 音效。
- **自检清单**:有无遗漏剧本节点;前后镜站位、手持物、离场位是否一致;有无越轴;有无全景;固定机位是否都 ≤4 秒;每句台词是否有运镜和眼神;每镜是否有情绪起伏;同场景灯光措辞是否逐字一致。
## 提示词写法
- **角色设定图结构**:角色基本信息 → 外貌(脸型、五官、发型、肤色)→ 风格词 → 服饰逐层 → 常用表情与标志性微表情 → 版式(左侧 1/3 面部大特写,右侧 2/3 正面 / 侧面 / 背面全身三视图,纯白背景、无阴影)→ 约束(同一人、不换装、无文字水印)。
- 示例:Character: Shen Zhiyi, around 18, slender princess. Narrow oval V-shaped face, slightly enlarged almond eyes, delicate straight nose, long black hair in a high bun with gold phoenix hairpin, warm porcelain-white skin with soft golden undertone. semi-realistic 3D ancient Chinese animation style, stylized anime-doll beauty, clean stylized skin shader. Costume: moon-white silk inner robe, misty-green brocade outer robe embroidered with scrolling peony, pale lotus gauze shawl, jade pendant at waist. Layout: left third large face close-up, right two thirds front, side and back full-body views, pure white background, no shadows, same character, no text, no watermark.
- **场景四宫格**:一张图 2×2,分别是从 A 端看向 B 端、从 B 端看回 A 端、左侧横向、右侧横向;平光无投影(设定图不打光),但色调保持明亮、中低饱和;大型家具和建筑构件画进场景里,不单独出道具图;非群戏写 No people in frame,群戏写清群演规模和站位。
- **视频提示词结构**:画面风格行 → [镜头] 按切镜顺序逐行写景别 / 角度 / 运镜 → [主体] 角色引用 + 当前服装 + 动作链(起 → 做 → 收)+ 表情和眼神 + 幅度词(sweeping、sharp、sudden、forceful,主动作不要用 slight、gentle)→ [空间] 场景引用 + 照搬灯光基线 + 镜头视角背景描述 → [声音] 台词、OS、音效 → [禁止] 无字幕、无背景音乐、无现代元素。不写绝对秒数,用 slow / quick / lingering 描述节奏。
- 示例:semi-realistic 3D ancient Chinese animation style, bright and clear tone, low to medium saturation, soft global illumination, no god rays. [Camera] medium two-shot, slow dolly-in, eye level; close-up on the regent, quick push-in; over Shen Zhiyi's shoulder looking at the regent, fixed; extreme close-up on her clenched fist, detail cutaway. [Subject] 图1 Shen Zhiyi in misty-green brocade robe sweeps her sleeve wide and steps forward, gaze locked on the regent's eyes, brows snapping together; 图2 the regent narrows his eyes, jaw tightening, holds the stare after speaking. [Space] 图3 imperial study, window light from the right, warm 4500K, calm but oppressive; behind the regent the carved sandalwood bookshelf, to his left the lattice window. [Audio] Shen Zhiyi: "这把椅子,你坐得太久了。" <sleeve whooshing, robe rustling>. No subtitles, no background music, no text overlay, no modern elements.
## 在 TVVV 上执行
- 先用 generate_image 出所有角色三视图(图1、图2…)、场景四宫格和关键道具图,默认 Nano Banana 2;需要画面里出现精确文字(匾额、圣旨正文)时用 GPT Image 2。同一角色换装时把第一套造型作为参考图,只改服饰发型,锁死脸型五官肤色。
- 用户上传的非 3D 素材,先用 generate_image 带原图做风格转换,保留脸型、发型、服装结构,只换成 3D 古风渲染。
- 每个镜头用 generate_video,reference_images 带上本镜出场角色和场景的同一个图N,image_role 选 reference;需要严格承接上一镜构图时,可从上一镜截图作为 first_frame。默认 Seedance 2.5、16:9、720p,单镜 5-10 秒;分镜里 10-15 秒的长镜头可按切镜拆成两段连续生成。
- 承接参考帧只选近景到中景的画面,不要用全景,否则下一镜会被拉远、站位漂移;参考帧的背景必须和本镜空间锚点卡一致,不一致宁可不用。
- 重生成某一镜时,复用已确认的提示词,只改用户指出的部分,并先列出「保留内容 / 修改内容」。
- 旁白用 generate_speech,BGM 用 generate_music(古筝、箫、琵琶、弦乐,按情绪分段);视频本身不带 BGM,台词和 OS 随视频生成。
- 一次回复最多 3-4 次工具调用,先出设定图,再分批出镜头,每批回来确认后继续。
- 结尾给交付清单:镜号对应的视频、剪辑顺序、同空间硬切、跨空间 0.3 秒淡入淡出;BGM 比对白低 8-12 dB、高潮处抬 3-5 dB,与旁白之间 0.5 秒交叉淡化。提示用户去 TVVV 时间轴剪辑合成。
## 注意事项
- **第一个镜头不确认就往下跑**:后面所有承接都来自它,务必先停下让用户看站位和背景。
- **人物换脸、肤色忽冷忽暖**:每条提示词都带完整风格词和肤色锚点,每镜都带同一张角色图。
- **同一场景光线漂移**:灯光基线逐字照搬场景卡,只有剧情要求(点灯、入夜)才改并注明原因。
- **说话时画面死板**:固定机位超过 4 秒、台词无运镜无眼神,是成片「像 PPT」的主要原因,分镜阶段就要卡住。
- **话没说完镜头就结束**:每句台词和每个大动作后都留 1 秒余韵,时长按 2.5 字 / 秒估。
- **画面出现字幕或现代物件**:结尾固定写 no subtitles, no text overlay, no modern elements。