
Bullet Time Narrative Short
A narrative short built around a frozen-time orbit shot as its climax
Make a 45s bullet-time short: a rooftop at night in the rain, an assassin dodges a bullet
The full workflow below is sent to the Agent every turn.
# 子弹时间叙事短片
适合想要「时间凝固 + 摄像机环绕」那种视觉奇观、但又要有完整故事的需求:动作、枪战、运动、奇幻能力觉醒、高光时刻回放都行。最终交付一支 30-90 秒的 16:9 横屏短片:通常 5-9 个镜头,其中 1-2 个子弹时间高潮镜头,前后有正常速度的铺垫和快切收尾,配角色台词、独立旁白和 BGM。
## 开工前确认
- 需要用户提供:剧本、分镜表,或者至少一个点子。只有点子时先给 2-3 个故事方向(每个写明子弹时间放在哪一刻),选定后扩成分场剧本,再出分镜草稿,每步确认。
- 用户上传了剧本:剧本就是唯一蓝图,不增删场次、不改台词、不跳镜头;原剧本没写机位的地方可以补,但要标「补充项(原文没有)」让用户批准。
- 画风:剧本里写了风格就提取出来给用户确认;没写就按故事给 2-3 个风格推荐(例如「赛博雨夜霓虹」「写实黑色电影」「高饱和动漫」)并写理由。
- 角色声线:用户有声音文件就直接用;没有就为每个说话角色写声线卡(年龄、性格、音色),全片保持一致。
- 用 ask_user 一次只问一个,例如「整体走写实电影质感,还是风格化动画?」
## 制作流程
1. **故事与风格** —— 在回复里给出「项目设定」:标题、类型、16:9、目标时长、视觉风格、语言。停下确认。
2. **分镜表 + 剧本对照** —— 给出角色卡、场景卡、子弹时间道具卡(子弹、碎片、水花)和分镜表;若有原剧本,再给一张「剧本 → 分镜对照表」:原文摘要 / 对应镜号 / 呈现元素 / 待确认项,确认零遗漏。停下确认。
3. **设定图** —— 角色正侧背三视图、场景无人四宫格、关键道具图。停下确认。
4. **声线确认** —— 每个有台词或独白的角色声线卡确认完毕再进入视频生成。
5. **逐镜生成视频** —— 每镜生成前做六项检查(见下文),全部完成后停下确认。
6. **配乐旁白** —— 生成 BGM 和独立旁白,确认。
7. **交付清单** —— 剪辑顺序、音量层级和变速处理建议。
## 风格锁定
- 子弹时间核心词:extreme slow motion frozen moment, debris / liquid / bullets suspended in mid-air, sharp subject against motion-blurred trails, dramatic side and back rim lighting, high contrast, metallic sheen and fine material detail, cinematic low angle, rule of thirds。
- 选了写实风格时,每条图和视频提示词都要带 photorealistic, live-action cinematography, real skin texture, physically accurate lighting,并带排除词 no anime, no cartoon, no illustration, no 3D render;同时把 vibrant colors、cel-shading、stylized 这类会把画面拉向插画的词换掉。
- 色彩建议整片控制在一组对比色内(例如青蓝阴影 + 琥珀色主光),子弹时间那一刻可以把饱和度和对比再提一档。
- 灯光:主光方向和色温在分镜里写死,前后镜头保持一致。
- 避免:画面出现字幕、四宫格拼图画面、人物悬浮在模糊背景前(脚下没有地面)。
## 分镜与镜头规则
- **子弹时间三要素**,每个高潮镜头必须标清:① 触发节拍(哪一下开始慢放 / 凝固);② 摄像机环绕路径(顺时针还是逆时针、起止角度,例如从正面 0° 绕到右侧 120°、速度);③ 凝固瞬间的精确姿态(跳跃最高点、拳头接触瞬间、子弹离脸 10 厘米)。
- **在一个镜头里完成变速**:正常速度 → 慢放 → 凝固环绕 → 恢复速度,放在同一次生成里,比拆成多个碎镜头连贯得多。高潮镜头目标 8-10 秒,普通镜头 5-8 秒。
- **对比制造冲击**:高潮前用正常速度铺垫或短促快切,高潮后用快切收尾,凝固才显得震撼。
- **每镜描述包含**:场景(场景卡编号 + 四宫格里的哪一格,例如「仓库正门区域」)/ 动作时间线(慢放段 → 凝固时刻 → 恢复段)/ 台词与角色 / 景别、角度、运镜。
- **情绪戏四要素**:触发原因 + 面部细节(瞳孔放大、嘴角下压、眉头紧锁)+ 肢体动作(攥拳、肩膀塌下、后撤半步)+ 语气(低而发颤、语速渐慢、破音),四项都要写,不要用「很伤心」概括。
- **台词与旁白分开**:台词和内心独白写进镜头、随视频生成;旁白单独一条音轨,绝不写进视频提示词。两者不能出现相同或相近的句子,分镜阶段就逐场核对。
- **场景物理关系**:擂台、悬崖、甲板、车内、天台这类人物要站、坐、扶的空间,场景卡里写清承重面和围合结构(木地板和围绳、甲板纹理和栏杆),后面提示词才能让人物踩在实地上。
- **分镜表字段**:镜号 / 时长 / 场景与分区 / 速度段落(常速·慢放·凝固·恢复)/ 景别·角度 / 运镜与环绕路径 / 动作与表情 / 台词 / 音效。
## 提示词写法
- **图片提示词**:像导演加调色师给团队的视觉简报,一整段自然语言:主体 + 动作 + 环境,再接风格、色彩、光线、构图短语,只写镜头拍得到的东西。角色图写明 full body three-view, front / side / back, horizontal layout, 16:9;场景图写明 four-panel scene reference grid, four angles of the same location, no characters。
- 示例:Full body three-view of a female assassin, front, side and back, horizontal layout, 16:9. Late twenties, sharp jawline, black hair in a low ponytail, long matte black trench coat over a charcoal tactical vest, fingerless leather gloves, silver pistol holstered at the hip. Photorealistic, cinematic photography, real skin texture, neutral gray studio background, soft key light, no text, no extra people, no anime, no illustration.
- **视频提示词顺序**:参考图声明 → 镜头(环绕方向、起止角度、速度)→ 主体(具体到四肢的动作、慢放段与凝固姿态,按时间先后列)→ 空间(锁定四宫格分区特征、碎片和子弹轨迹、人物脚下的承重面、前一镜的视觉锚点:服装颜色材质、主光方向色温、背景标志物)→ 声音(音效、台词带语气修饰)→ 固定结尾 no music, no subtitles, single unified frame, no grid layout。不要写「0-3 秒」这类绝对时间,用故事节拍顺序描述。单条提示词控制在约 2000 字符以内,超了就删重复的背景和风格修饰,保住动作、台词和情绪四要素。
- 示例:图1 is the assassin, 图2 is the rooftop scene; shoot at the water-tank corner of the rooftop, wet concrete under her boots, rusted railing on her left, neon sign glowing behind. Camera starts at her front at eye level, then as time freezes orbits clockwise 120 degrees to her right side, slow and smooth, then snaps back to normal speed. She hears the shot, eyes widen, twists her torso sideways; motion slows; at full freeze her body leans back 30 degrees, coat flaring, raindrops hanging around her, a bullet with a spiral wake passes 10 cm from her cheek; time resumes, she rolls behind the tank. Cold teal shadows, amber rim light from the neon. <rain cuts to silence at the freeze, a deep heartbeat, then a crack of thunder>. She whispers, breathless: "差一点。" photorealistic, no anime, no music, no subtitles, single unified frame, no grid layout.
## 在 TVVV 上执行
- 先用 generate_image 出角色三视图、场景四宫格、道具图(图1、图2…),默认 Nano Banana 2;需要画面里有精确文字(招牌、弹壳刻字)时用 GPT Image 2。
- 每镜用 generate_video,reference_images 带上出场角色的三视图和场景图,image_role 选 reference;角色多时优先级是角色图 > 场景图 > 道具图,放不下的道具改用文字描述。需要严格承接上一镜时,从上一镜截一帧作 first_frame。默认 Seedance 2.5、16:9、720p,单镜 5-10 秒。
- **六项检查**(每镜生成前):场景图已引用且分区已锁定;所有出场角色图已引用;说话角色声线已确认;台词完整写入;旁白不在提示词里;分镜里的关键动作、姿态、节拍都已写进去。
- 生成失败可以直接重试;生成出来但质量不达标(构图、主体、风格不对)时,先给用户看并说明问题,确认后再重做,避免白白消耗。
- 旁白用 generate_speech,BGM 用 generate_music(例如 tense industrial pulse, heavy beat, drops out for the freeze),不写真实音乐人名字。
- 一次回复最多 3-4 次工具调用,分批生成,每批确认后继续。
- 交付清单:镜号对应视频与剪辑顺序;子弹时间镜头前后做缓入缓出,镜头内部不加转场特效;凝固瞬间 BGM 压到约 -30 dB 或直接静音,恢复后再推回;台词 -6 到 -3 dB 最响,旁白 -9 到 -6 dB,BGM -20 到 -18 dB,有台词时自动压低。旁白不要为了对齐镜头被剪断,可以自然延续到下一镜;时长差超过 30% 就回分镜调整。提示用户去 TVVV 时间轴剪辑合成。
## 注意事项
- **凝固不够「定」**:提示词要写死凝固姿态和悬浮物,并用环绕运镜体现时间停止,否则只是普通慢动作。
- **人物飘在背景前**:写清脚下承重面和围栏位置。
- **生成成四宫格画面**:结尾必须写 single unified frame, no grid layout,并点名用四宫格的哪一格。
- **旁白被模型念成台词**:旁白文本绝不进视频提示词,生成前和台词逐句比对去重。
- **写实片跑成动漫风**:写实锚定词和排除词每条都要带。