
双人DJ台蹦迪
上传两张照片,生成两人在DJ台后一本正经搞怪蹦迪的30秒热梗
用我和室友这两张照片做双人DJ蹦迪视频,我站左边穿红色,室友站右边穿白色
下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。
# 双人DJ台蹦迪
适合最近很火的「双人 DJ 台」热梗:两个人一左一右站在 DJ 台后面,一个穿红一个穿白,面无表情地跟着一段极简电子节拍点头、摆手、同步做怪动作,越认真越好笑。用户给两张人物或角色照片,交付一支约 30 秒、一个固定机位的 16:9 视频(分 3 段生成,首尾相接看起来是一镜到底),加一条节拍感强的电子配乐。
## 开工前确认
- 需要两张照片:两个人、两个卡通角色、两只宠物都可以,每张只有一个主体、脸清楚。只给了一张时,请用户补第二张,或问是否让 AI 设计第二个角色。
- **开工前必须用 ask_user 确认站位**:哪张图是左边的 A(红色系那位),哪张是右边的 B(白色系那位)。选项写成「图1 站左 / 图2 站右」和「图2 站左 / 图1 站右」。这一步不确认就不要往下做。
- 用户只给文字描述没有照片时,先问清两个人的性别、发型、服装风格,按描述各出一张全身参考图,确认满意后再确认站位。
- 用户手上有原版梗的模板截图,可以一起发来,当作舞台和构图参考。音频方面:不复刻任何原曲,配乐由 TVVV 生成一段同类风格的节拍;用户有自己想用的音频,可以在时间轴上替换。
## 制作流程
1. **项目设定** —— 表格列:A 和 B 分别对应哪张图、服装主色(A 红、B 白,可按用户要求改)、画幅 16:9、总长约 30 秒、3 段 × 10 秒、配乐风格。
2. **角色参考图** —— 每人一张「全身 + 头肩特写」的组合参考图;用户照片足够清楚时可以直接用原图,只在需要统一服装颜色时再出图。**停下来**确认长相和站位。
3. **舞台定帧** —— 出一张两人站在 DJ 台后的首帧:A 在左、B 在右,构图居中对称,这张就是第 1 段首帧。**停下来**确认。
4. **逐段生成视频** —— 第 1 段用定帧做首帧;第 2、3 段用上一段最后一帧做首帧,动作接着往下走。每段回来给用户看。
5. **配乐** —— 生成一条 30 秒左右的电子节拍。
6. **交付** —— 三段视频顺序、配乐对齐点、剪辑建议。
## 风格锁定
- 统一关键词:`two performers behind a DJ booth, dark club stage, haze, colorful moving spotlight beams, LED strips on the booth, deadpan expressions, playful synchronized dance, locked-off centered medium shot, symmetrical composition, crisp music video look`。
- 光线:舞台暗底,顶部和背后有彩色光束扫动(洋红、青、琥珀),两人脸上有一盏柔和正面补光,保证脸始终看得清,色温约 5000K。
- 服装:A 红色系、B 白色系,形成一左一右的强烈对比;具体款式按照片或用户描述。
- 气质:表情越平静越好笑 —— 面无表情、偶尔对视、动作却很投入。
- 必须避免:换机位、推拉摇、第三个人入镜、两人互换位置、字幕、文字、真实品牌 logo。
## 分镜与镜头规则
- **只有一个固定机位**,平视中景,两人从腰部以上入画,DJ 台横在画面下方三分之一处。30 秒分 3 段,每段 10 秒,后一段从前一段最后一帧继续。
- 动作节奏(跟着约 120 BPM 的节拍走,每 4 拍换一个动作):
| 时间 | A(左) | B(右) | 节奏 |
|---|---|---|---|
| 0-5s | 低头认真拧旋钮,跟拍点头 | 双手扶耳机,身体左右小幅摇 | 前奏,动作小 |
| 5-10s | 抬起一只手指向天空,停住 | 同步抬手,比 A 慢半拍 | 第一个笑点:没对上 |
| 10-15s | 双手在胸前做机械波浪 | 跟着做同样的波浪 | 进入同步 |
| 15-20s | 两人同时转头对视一秒,面无表情 | 同左 | 停顿笑点 |
| 20-25s | 一起左右滑步、肩膀耸动 | 同左 | 高潮,动作最大 |
| 25-30s | A 推一下推子,两人同时定格做收尾姿势 | 同左 | 收尾定格 |
- 动作幅度控制在上半身:点头、耸肩、手臂摆动、转头,不要转圈和跳跃,不然脸容易变形、人会走出画面。
- 两人全程站在各自位置,不交叉、不换边。
- 分镜表字段:段落 / 时间 / A 动作 / B 动作 / 灯光变化 / 节拍点。
## 提示词写法
- **参考图结构**:人物外貌(性别、发型、五官特征)→ 服装(颜色、款式)→ 姿态(正面站立)→ 构图(左边全身、右边头肩特写的组合)→ 干净浅灰背景、柔和影棚光。
- **舞台定帧示例**:
```
图1 is performer A, 图2 is performer B. Keep both faces exactly like their references. A stands on the left in a red bomber jacket, B stands on the right in a white oversized shirt, both behind a sleek DJ booth with glowing LED strips, hands on the decks, deadpan expressions. Dark club stage with light haze, magenta and cyan spotlight beams behind them, soft frontal fill on both faces. Locked-off centered medium shot from waist up, symmetrical composition, crisp music video look. No other people, no text, no logos.
```
- **视频提示词结构**:首帧与身份说明 → 固定机位声明 → 按秒写 A 和 B 的动作(各自写清身体部位和节奏)→ 灯光变化 → 声音(节拍、可以关掉人声)→ 负面词。
- 视频示例(第 2 段):
```
图1 is the first frame, 图2 is performer A, 图3 is performer B. Locked-off camera, no movement at all. 0-5s: both do a slow robotic wave with their arms in front of their chests, perfectly in sync, faces totally deadpan. 5-10s: they turn their heads to look at each other for one beat without any expression, then snap back to face forward and start bobbing their shoulders to the beat. A stays on the left, B on the right the whole time. Spotlight beams sweep from magenta to cyan on every fourth beat, haze drifts. Minimal electronic beat at 120 BPM, no vocals. No camera movement, no position swap, no third person, no subtitles, no text.
```
## 在 TVVV 上执行
- 参考图和舞台定帧用 generate_image,默认 Nano Banana 2,16:9,resolution 2K;定帧把两人的照片(或参考图)都放进 reference_images,用户发了模板截图也一起带上当构图参考。
- 视频用 generate_video,默认 Seedance 2.5、720p、16:9,每段 10 秒;第 1 段 image_role 用 first_frame,首帧是舞台定帧;第 2、3 段首帧换成上一段最后一帧(请用户截取后发回,或从结果里取尾帧),并把两人的参考图也带上防止脸走样。最终要用配乐时可以把 generate_audio 关掉,避免两段节拍打架。
- 配乐用 generate_music:`minimal deadpan electro house, steady 120 BPM four-on-the-floor, dry punchy kick, short synth stabs, catchy simple bassline, playful and hypnotic`,instrumental 为 true,长度 30 秒左右。不要写任何现成歌名或歌手名。
- 一次回复最多 2 次工具调用:定帧一轮,之后每轮生成一段视频(因为要等上一段尾帧);配乐可以和第 1 段视频放在同一轮。
- 交付清单:三段视频顺序(段与段之间硬接不加转场)、配乐从第 0 秒对齐、每 4 拍一个动作点可以对着音乐微调剪辑点;提示用户去 TVVV 时间轴拼接,把配乐作为唯一音轨,导出时不要加字幕。
## 注意事项
- **左右搞反**:定帧出来第一件事就是核对 A 在左、B 在右;每条视频提示词都重复一次站位。
- **脸越跳越不像**:第 2、3 段首帧都是上一段尾帧,误差会累积,所以每段都要额外带上两人的原始参考图。
- **动作不同步也不好笑**:同步和「差半拍」都是笑点,提示词里要写清楚哪一拍同步、哪一拍故意错开。
- **镜头乱动**:固定机位是这个梗的关键,负面词每次带 no camera movement。
- **版权**:不用原曲、不写原曲名和歌手名,舞台上不要出现真实品牌 logo;用户自己的音频由他在时间轴里替换并自行负责授权。