
穿进球赛倒挂金钩
看球时被球星拽进电视,空降球场完成子弹时间倒钩破门
用我的照片,做一段我看球时被拉进电视、在球场倒挂金钩进球的短片
下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。
# 穿进球赛倒挂金钩
适合世界杯、欧洲杯等赛事期间的趣味整活短片:主角窝在沙发上看球,电视里的球员忽然转头、伸手穿出屏幕把他拽了进去;下一秒主角出现在夜场球场,完成一次带子弹时间的倒挂金钩破门。最终交付 2 个镜头、合计约 14 秒的 16:9 短片(第一镜 3 秒穿越,第二镜 11 秒倒钩),音效内置,不配 BGM。
## 开工前确认
- 主角来源(用 ask_user 二选一):
- **上传照片**:用户本人正面或半身照,脸清楚、衣服完整可见。
- **AI 生成角色**:没有照片时,按用户描述(性别、年龄感、球衣颜色倾向)生成一个球迷角色。
- 如果用户上传照片,主角**穿照片里的衣服**进球场,不要擅自换成球衣——这是这个片子「穿越感」的笑点,也是两镜一致性的关键。只有照片本身穿着球衣才写球衣。
- 其余参数直接锁定,不再询问:总长 14 秒、16:9、两个镜头、无对白、无字幕、无配乐。
## 制作流程
1. **项目设定** —— 在回复里用小表格写清:主角来源、画幅 16:9、镜头 1(3 秒,客厅→电视穿越)、镜头 2(11 秒,球场倒钩)、音效方案。
2. **角色锁定** ——
- 有照片:在回复里给出一张「角色特征卡」:脸型与五官、发型发色发长、上衣款式/材质/领口/颜色、下装、鞋、配饰(眼镜、耳环、帽子)。这段文字要原样写进两个镜头的提示词。
- 无照片:用 generate_image 生成一张主角参考图(球迷造型,正面半身,球场背景),**停下等用户确认长相**。
3. **镜头 1:破屏穿越** —— generate_video 生成 4 秒(多 1 秒方便剪),后期裁成 3 秒。
4. **镜头 2:倒钩破门** —— generate_video 生成 11 秒,同一张主角参考图。
5. **预览确认** —— 两段都回来后停下,让用户看:人物是否一致、倒钩姿势是否正面可见、球是否进网。不满意的镜头单独重出。
6. **交付** —— 给出两段视频、剪辑点和音频处理建议,提示在 TVVV 时间轴里拼接。
## 风格锁定
- 统一画风关键词:`cinematic photorealistic, volumetric light, high detail, consistent character from 图1`。
- 镜头 1:暗室,唯一光源是电视的冷暖闪烁光(约 6500K 蓝白混着画面里的绿色草皮反光),过肩构图;液态水银般的屏幕涟漪,银蓝色光环外扩;结尾整屏刺白。
- 镜头 2:夜场体育场,球场大灯从高处打下的体积光,空气中有薄雾,镜头光晕明显;草皮写实,变速处有运动模糊。
- 必须避免:卡通化、主角衣服被换成球衣、真实球星的脸和名字、球队队徽、文字字幕、背景音乐。
## 分镜与镜头规则
两镜结构,不做一镜到底——空间跳跃靠「白光转场」解决,动作爆发靠镜头 2 内部的多次切角解决。
| 镜号 | 时长 | 景别/机位 | 画面 | 运镜 | 声音 |
|---|---|---|---|---|---|
| 1 | 3s(生成 4s) | 过肩中景→电视特写 | 主角坐沙发看球;电视里转播镜头从全场推到一名球员的脸;球员停下、转头直视镜头、伸手穿出水银般的屏幕抓住主角往里拽 | 持续缓慢前推,结尾推到电视特写后全屏白光 | 电视里的球场声、电流嗡鸣、噼啪声、穿越风啸 |
| 2a | ~2s | 面部大特写 | 主角站在球门前,额头细汗、眼神专注,像点球大战 | 固定 | 观众低吼 |
| 2b | ~2s | 背后过肩 | 主角背对镜头、面朝远处球门,腾空侧旋蓄力 | 跟拍,速度从常速降到极慢 | 风声 |
| 2c | ~4-5s | 正面低机位 | **子弹时间**:身体与地面平行、向左倾斜、腿后摆,倒钩姿势正面完整可见,球极慢地落到脚上方 | **完全固定** | 心跳般的低频、声音抽空 |
| 2d | ~1s | 背后视角 | 速度瞬间恢复常速,爆射,球飞向球门,重力回归 | 硬切 | 重击声 |
| 2e | ~1-2s | 背后视角延续 | 主角左手撑地安全落地,背景里球撕进网窝 | 固定 | 哨声、全场山呼 |
- 节奏口诀:**常速 → 慢 → 极慢 → 常速**。速度变化本身就是爽点,提示词里每一段都写明速度。
- 2c 必须是正面机位,否则观众看不到主角的脸和完整姿势,片子就没有「是我在踢」的代入感。
- 分镜表字段:镜号 / 时长 / 景别 / 画面 / 运镜与速度 / 声音。
## 提示词写法
- 提示词用英文。开头写技术声明,中间写内容,结尾写音效与渲染参数。主角每次出现都写「图1 + 角色特征卡文字」。
- **图片提示词结构(仅 AI 生成主角时)**:人物外貌 → 服装(指定颜色球衣)→ 背景 → 构图 → 光线 → 质感。
- 图片示例:
```
A vibrant young soccer fan in a deep blue jersey with white trim, short black hair, bright confident smile, front-facing half-body portrait, blurred night stadium with floodlights behind, cinematic photorealistic, sharp facial detail, 16:9.
```
- **视频提示词结构**:技术声明(写实/画幅/时长/速度)→ 场景与人物(含特征卡)→ 分段动作(每段写速度与机位)→ 音效声明 `No dialogue, no subtitles, no music. SFX: ...` → 渲染参数 → 一致性声明。
- 镜头 1 示例(节选):
```
Cinematic photorealistic interior, 16:9, 4 seconds, normal speed. A dim cozy living room, over-the-shoulder from behind a viewer (图1: young woman, long wavy blonde hair, cream knit cardigan) on a sofa watching a large TV. On screen, a soccer match: the broadcast camera pushes from the full pitch to one player's face. He stops, turns, looks straight into the lens, reaches out; his hand breaks through the screen, the glass liquefying like rippling mercury with silver-blue rings. He grabs the viewer and pulls her into a swirling vortex. The camera keeps pushing to a close-up of the TV, ending in a blinding pure white flash. No dialogue, no subtitles, no music. SFX: stadium hum from TV, static hum, electric crackle, loud portal whoosh.
```
- 镜头 2 写法要点:五段依次写 `Normal speed. Extreme close-up...` / `Speed ramps down to extreme slow motion. Back over-the-shoulder...` / `Bullet time. Front-view low angle, camera completely fixed...` / `Pacing snaps back to normal speed. Rear view...` / `Normal speed. She lands, cushioning with her left arm...`,结尾 `SFX: thunderous crowd roar, referee whistle, heavy ball strike, grass sliding rustle`,渲染参数 `volumetric floodlights, stadium mist, lens flare, motion blur on speed transitions`。
## 在 TVVV 上执行
- 无照片时用 generate_image(Nano Banana 2,16:9)出主角参考图,记为 图1;有照片则用户照片就是 图1。
- 两个镜头都用 generate_video,默认 Seedance 2.5、720p、16:9;reference_images 都带同一张 图1,image_role 选 `reference`(不要当首帧,首帧会把人物锁死在沙发/站姿上)。镜头 1 设 4 秒,镜头 2 设 11 秒;若模型单段上限不够,把 2a-2b 和 2c-2e 拆成两段生成。
- 本 skill 不用 generate_music 和 generate_speech,所有声音由视频模型生成。
- 一次回复最多 2 次视频生成调用,两个镜头可同一轮并行出。
- 交付清单:镜头 1(裁到 3 秒,音频在末尾 2 秒淡出接白光)→ 镜头 2(11 秒完整保留);提示用户在 TVVV 时间轴里拼接,白光处可加 3-5 帧白场叠化让转场更顺。
## 注意事项
- **衣服被换成球衣**:最常见的翻车。两镜提示词都要写特征卡里的具体服装,并在有照片时禁止出现 jersey/uniform。
- **倒钩变成背影**:2c 必须写 front-view、face and torso fully visible、camera completely fixed,否则模型会拍成侧面或背影。
- **球没进/球消失**:在 2d、2e 两段都写球进网,背景里要看到球网被撕扯。
- **电视里球员太像某位真实球星**:不写任何球星名字,只写 a player / an athlete。
- **穿越不够干脆**:镜头 1 结尾一定写 ending in a blinding pure white flash,留出硬转场空间;剪辑时在白光最亮那一帧切到镜头 2。