
日系台式复古短剧
低饱和奶油色、柔焦自然光,用眼神与停顿讲含蓄的复古真人短剧
拍一部60秒复古短剧:夏夜便利店,打工女孩和每晚来买牛奶的男生第一次多说了一句话
下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。
# 日系台式复古短剧
适合拍日系、台式复古质感的真人短剧:夏夜便利店、老公寓窗边、海边小镇、放学后的教室。特点是低饱和的奶油色调、柔和的自然光和高光柔焦,情绪不靠台词,而靠眼神、停顿和手上的小动作推进。最终交付 4-8 个镜头、30-90 秒的 16:9 短剧,默认保留现场声和对白,不加背景音乐和字幕。
## 开工前确认
- 故事来源三选一:
- 用户给了剧本 → 角色、情节、台词原样保留,不改编。
- 用户只有概念 → 按「试探 — 克制回应 — 关系推进 — 结尾情绪反应」四段结构原创。
- 用户给了参考作品 → 只提取调色、镜头语言等风格,不抄人物身份和具体情节。
- 用户指定的人物、服装、对白语言和结局必须原样保留。**不要因为「复古日系」就自动把对白改成日语或台湾腔**。
- 用户上传的人物、场景图直接绑定,不重复生成。用 ask_user 一次只问一个问题(如时长或对白语言)。
- 用户只要图片时,出完图就停,不自动进入视频。
## 制作流程
1. **项目设定** —— 表格列出:片名、画幅、时长、画风、对白语言、故事来源。等确认。
2. **分镜表** —— 角色卡、场景卡、镜头列表、声音层。**停下等确认。**
3. **资产就绪** —— 已有的人物、场景图直接用;缺的用 generate_image 补齐。默认不生成分镜缩略图和首尾帧。展示后确认。
4. **逐段生成视频** —— 按镜头列表逐段生成,每批回来确认。某段失败只重试那一段,已确认的素材保留。
5. **声音** —— 保留现场声与对白;用户明确要求时才加旁白或配乐。
6. **交付清单** —— 剪辑顺序与衔接建议。
## 风格锁定
- 统一关键词:`retro Japanese-Taiwanese film look, low-saturation cream, beige and sage green palette, soft bloom on highlights, natural diffused light, vintage film grain, natural skin texture, sharp focus on eyes`。
- 色彩:全程低饱和奶油、米色、灰绿,高光带轻微柔焦光晕,不做高反差高饱和。
- 皮肤:保留自然肤质,不过度磨皮;眼睛和关键动作保持清晰,不被柔焦吞掉。
- 光线:白天是明亮但柔和的漫射自然光(色温约 5000-5500K);夜晚用局部暖光源——台灯、路灯、便利店招牌(约 3000-3500K),不要整体压暗,保留层次和反差。
- 必须避免:高饱和、硬反差、霓虹撞色、塑料磨皮、背景音乐抢戏、字幕。
## 分镜与镜头规则
- 单镜 8-15 秒,优先长镜头 + 镜内有节奏的动作,不切成一堆碎片。
- **表演节拍「看见 → 明白 → 停顿 → 反应」**:先写视线落在哪里,再写眉眼的变化,然后是一次短暂的停顿,最后才是反应动作。镜头结尾要给反应留够时间,反应没做完不切走。
- 位置和动作要写清:人物在左还是右、动作的起止状态和可见结果;道具状态随动作更新(拿起、放下、挪开)。
- 景别以中景、近景为主,焦段 35-50mm,固定或缓慢推轨、横移;不用快速运镜。
- **连续性**:下一镜开头的站位、道具状态和情绪,必须接住上一镜结尾,不跳、不矛盾。
- 原创故事的节奏:台词克制,一句话能不说就不说;关系推进靠视线、停顿和小动作。
- 分镜表字段:镜号 / 时长 / 场景编号 / 故事节拍(动作 + 台词 + 说话人)/ 表演节拍 / 站位与道具状态 / 景别 / 角度 / 运镜 / 光线方向与色温。
## 提示词写法
- **角色参考图**:用中性自然光,不加柔焦和降饱和(那是视频阶段的事),目的是看清脸型、发色、服装。横版:左边头肩特写锁脸,右边全身锁服装和体型。多个角色必须在发色、发型、服装色系、体型上明显区分,禁止同一张脸换衣服。
- 角色图示例:
```
Character reference sheet, horizontal layout: left a head-and-shoulders close-up, right a full-body view of the same young woman. About 22, oval face, slightly downturned eyes, natural pink lips, black straight shoulder-length hair with thin bangs, slim build, pale blue convenience-store vest over a white T-shirt, beige cotton trousers, white canvas shoes. Soft natural daylight, no stylized grading, plain light gray background.
```
- **场景/成片画面**:在描述里自然融入风格锚点——低饱和奶油灰绿色调 + 自然漫射光或局部暖光 + 轻柔光晕 + 保留肤质 + 复古胶片颗粒。场景写空间布局、光源方向和色温、主要道具位置;夜景写清暖光来自哪里。
- **视频提示词结构**:参考图身份 → 运镜(景别)→ 主体动作(身体细节、幅度、速度、起止状态)→ 场景或道具变化 → 声音(对白原文、音效)→ 负面词。不写「0-3 秒」这类时间码,用叙事节拍描述多个动作。
- 视频示例:
```
图1 is the clerk, 图2 is the regular customer, 图3 is the convenience store at night. Static medium shot from behind the counter. The boy on the right places a bottle of milk on the counter. The clerk on the left scans it, then her eyes land on the small bandage on his hand; her brows draw together slightly, a brief pause. She pushes a packet of plasters across the counter without looking up. He looks at it, then at her, and says softly: "Thanks... see you tomorrow." Warm fluorescent and shop-sign glow, low-saturation cream and sage palette, soft bloom, film grain. Sound: fridge hum, the door chime. No subtitles, no music, preserve original audio.
```
## 在 TVVV 上执行
- 缺失的人物、场景参考用 generate_image 补(默认 Nano Banana 2;画面里招牌、海报文字要准确时用 GPT Image 2)。每段 generate_video 的 reference_images 都带该段的角色图N和场景图N,image_role 用 reference;与上一段高度连续时,用上一段尾帧作 first_frame。
- 默认视频模型 Seedance 2.5,720p,16:9,单段 5-10 秒,长镜头可到 10-15 秒。
- 对白写进视频提示词同步生成,保留现场环境声。用户要旁白时用 generate_speech,定好语气、语速和情绪基线;用户明确要配乐时才用 generate_music,选轻柔的钢琴、木吉他或复古合成器,音量低于对白。
- 一次回复最多 3 次工具调用,分段生成,每段回来检查衔接再继续。生成失败只重试失败的那段,不自行换模型,需要额外重试先问用户。
- 交付清单:按镜号列视频与顺序;切点要落在动作或情绪完成之后,反应镜头不提前切走;相邻镜头色温、亮度、运镜方向保持一致。提示用户在 TVVV 时间轴里拼接导出,默认不加字幕和配乐轨。
## 注意事项
- **对白语言被改**:复古风格不等于日语,严格按用户指定的语言。
- **两个角色一张脸**:角色图阶段就把发色、发型、服装色系拉开差异。
- **柔焦糊成一片**:提示词里写 sharp focus on eyes,柔焦只作用在高光。
- **夜景一片黑**:夜景必须有明确的局部暖光源,保留层次。
- **反应没做完就切**:每镜结尾给 1-2 秒反应时间,这是这类片子情绪的落点。