
非线性时间叙事短片
双时间线、闭环结局的烧脑短片,冷峻建筑美学加低频配乐
做一部 2 分钟双时间线短片:一位工程师在废弃地铁站发现父亲留下的旧手表
下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。
# 非线性时间叙事短片
适合想做「看完还要想一会儿」的剧情短片:双时间线、倒叙、多层时间、开头和结尾咬合成环、真相反转。整体气质致敬诺兰式的冷峻叙事——巨大的建筑、冷灰色调、手表和钥匙这种承载时间的道具、低频持续的配乐。最终交付一部 1-3 分钟、16:9、12-24 个镜头的短片,附旁白、音效和配乐建议。
## 开工前确认
- 需要用户提供:一个故事核(一句话也行),或者一个主角 + 一个道具 + 一个地点。没有就由 AI 提 3 个故事核让用户挑。
- 有人物照片时作为主角身份参考;有场景照片时判断它在故事里最适合承担哪种功能:给信息、埋线索、揭真相、制造情绪执念、空间压迫,还是连接两段时间。
- 用 ask_user 一次只问一个问题,优先级:①时间结构选哪种 ②时长(默认 2 分钟)③对白/旁白语言。
- 场景优先选现实中的冷硬空间:地铁站、停车场、机场、隧道、桥梁、写字楼、档案室、实验室、雷达站、发射场、废弃工厂。不做魔法森林、动漫幻想空间。
## 制作流程
1. **故事拆解** —— 在回复里列出:主角、核心目标、核心冲突、时间结构的直觉、关键道具。停下来确认。
2. **时间结构设计** —— 从五种结构里推荐一种并说明理由:A 线性;B 双时间线交叉;C 三时间线;D 倒叙闪回;E 莫比乌斯环(结尾回到开头)。用表格画出每条时间线的段落顺序。停下来确认。
3. **视觉圣经** —— 定义建筑风格、光影规则、四层色彩系统(见下方)、镜头系统、服装系统。停下来确认。
4. **角色卡** —— 每个角色写:身份、缺陷、恐惧、执念、他相信的谎言、他最终面对的真相;同时写出片名、时长、画幅、年代、语言、视觉风格、主线梗概作为项目设定表。停下来确认。
5. **关键参考图** —— 用 generate_image 出角色设定图(同一人不同年龄/时间线时先出主身份图,再以它为参考出其他版本)、主要场景、关键道具、叙事符号。停下来确认。
6. **分镜表** —— 完整镜头列表;有对白时单独列出说话人、台词原文、声源和对应镜头,不要把台词混进画面描述。停下来确认。
7. **逐镜生成视频** —— 用户确认后用 generate_video 分批生成。
8. **旁白 / 音效 / 配乐** —— 旁白用 generate_speech(冷静、哲思的纪录片口吻),配乐用 generate_music(低频持续、钟表节奏、管风琴、弦乐层层堆叠)。
9. **交付清单** —— 镜头顺序、交叉剪辑点、声音分层建议,提示去 TVVV 时间轴合成。
## 风格锁定
- 统一画风关键词:`cinematic 35mm film still, IMAX large format, brutalist architecture, practical lighting, desaturated, fine film grain, anamorphic`。
- **四层色彩系统**(每个镜头都要标属于哪一层):
- 现实层:冷灰、钢蓝、黑、混凝土色 —— `cold grey, steel blue, concrete texture, desaturated`
- 记忆层:暖黄、琥珀、褪色棕 —— `warm amber, faded sepia, soft halation`
- 危机层:深蓝、黑、高反差 —— `deep navy, crushed blacks, high contrast`
- 真相层:纯白、硬光、极简色 —— `overexposed white, minimal palette, clinical light`
- 构图四法:建筑压迫(人物很小、建筑巨大,命运感);中心孤立(人物居中、两侧大片留白);几何秩序(走廊、楼梯、隧道、天线阵的重复透视);信息分层(前景细节、中景动作、背景线索同时清晰)。
- 道具规则:每个核心道具都要有叙事功能——第一次出现给信息,第二次给线索,第三次揭真相。
- 必须避免:奇幻元素、卡通、霓虹色、镜头光晕滥用、水印、画面文字、流行歌曲和带歌词的配乐。
## 分镜与镜头规则
- 2 分钟约 16-20 个镜头;危机层镜头可短于 3 秒,其他镜头 5-10 秒,保持沉浸感。
- 八种镜头语言(分镜表里用编号标注):
| 编号 | 名称 | 用法 |
|---|---|---|
| N-01 | 静止观察 | 机位固定,人物自己走进画面 |
| N-02 | 长焦缓推 | 慢慢逼近真相,主体逐渐填满画面 |
| N-03 | 超广角建立 | 交代空间尺度,人物极小 |
| N-04 | 环绕运动 | 表现认知发生转变 |
| N-05 | 时间切换 | 同一构图,光线从琥珀变冷灰(或反之) |
| N-06 | 交叉剪辑 | 平行时间线来回切 |
| N-07 | 时间膨胀 | 极慢动作,情绪高点 |
| N-08 | 主观意识 | 记忆、梦、幻觉,边缘虚化 |
- 结局至少满足一条:真相反转、身份反转、时间反转、认知反转、首尾闭环。不要把答案说满,让观众带着问题离开。
- 交叉剪辑段,两条时间线的镜头要用「相同构图」或「相同道具」做咬合点(N-05)。
- 分镜表字段:镜号 / 时间线 / 色彩层 / 时长 / 镜头编号 / 画面 / 运镜 / 对白(说话人+原文)/ 声音。
## 提示词写法
- **图片提示词**:导演视角一段话写完——主体 + 场景环境 + 光线色调 + 构图语言,只写看得见的东西,不写动机和背景故事。角色设定图固定格式:左边胸像特写(锁脸、肤色、发际线),右边全身(服装、配饰、站姿),同光线、中性白底。
- 图片示例:
```
A woman engineer in a worn grey work jacket stands alone at the center of an abandoned subway platform, tiny against massive brutalist concrete columns, one flickering practical light overhead, cold grey and steel blue palette, desaturated, symmetrical geometric perspective, vast negative space on both sides, cinematic 35mm film still, fine film grain. No fantasy elements, no neon, no text.
```
- **视频提示词结构**:参考绑定声明(图1 是谁、图2 是什么场景)→ 运镜 → 人物动作与表情节拍 → 空间/环境变化 → 声音标注。
- 视频示例:
```
图1 is Lin, 图2 is the abandoned subway platform, 图3 is the brass pocket watch. Slow telephoto push-in. Lin kneels, brushes dust off the watch, opens it; the hands are frozen at 4:17. Her breath catches, she looks up toward the dark tunnel. A distant train rumble that never arrives, dust drifting in the single overhead light. Cold grey reality layer, desaturated, film grain. Sound: low hum, faint ticking, her breath. No music, no subtitles.
```
## 在 TVVV 上执行
- 角色、场景、道具参考图用 generate_image 先出,默认 Nano Banana 2;同一角色不同年龄必须以已确认的主身份图为参考生成,不要重新文生图。
- 每个镜头 generate_video 都用 reference_images 带上对应角色、场景、道具的 图N(整片固定编号),image_role 选 reference;N-05 时间切换镜头可以把上一时间线的同构图画面设为 first_frame。
- 默认视频模型 Seedance 2.5,720p,16:9,单镜 5-10 秒。
- 一次回复最多 4 次工具调用,按时间线分批生成,每批回来检查服装、年代、道具状态再继续。
- 旁白用 generate_speech:简短、冷静、带哲学意味,例如「人们总以为时间在向前走。」「其实改变我们的,往往不是时间。」「而是某个被忽略的决定。」
- 配乐用 generate_music:持续低频、钟表般的节奏、管风琴和弦乐渐强,纯器乐。
- 交付清单里写清声音层级:对白 > 旁白 > 音效 > 配乐。对白出现时音效压低约 12 dB、配乐压低约 18 dB,结束后 0.5 秒内恢复;旁白与配乐重叠时配乐压低约 14 dB;片尾配乐淡出不少于 3 秒,与画面黑场同步。剪辑点优先对齐配乐重拍或旁白停顿。提示用户在 TVVV 时间轴里完成。
## 注意事项
- **时间线混乱**:观众分不清现在是哪一年。对策:严格执行四层色彩系统,每条时间线固定一个色层,并用同一道具做锚点。
- **同人不同脸**:年轻版和年老版像两个人。对策:先确认主身份图,再以它为参考出其他年龄版本。
- **交叉剪辑串音**:不同时间线共用同一段音效会让时空感崩掉。对策:每条时间线的环境声单独生成、单独铺。
- **结局说破**:旁白把谜底讲完就没有余味。对策:最后一镜只给画面和一个道具特写,把答案留给观众。
- **场景跑偏成奇幻**:提示词里不写冷硬现实空间,模型容易给出科幻花哨感。对策:场景清单只选现实建筑,负面写 no fantasy, no neon。