
Tractor Dance Remake
Your characters remake the center dancer's moves in a new scene, one 18s take
Make my orange cat in overalls do the 18s tractor dance in a wheat field, vertical
The full workflow below is sent to the Agent every turn.
# 拖拉机魔性舞翻跳
适合「把爆火的拖拉机舞让我的角色跳一遍」的需求:用一段无声的舞蹈参考作为动作蓝本,只取画面**中心位舞者**的舞步、节拍、走位、机位远近和剪辑节奏,由用户自己的角色在新场景里完整复刻。最终交付一条 18 秒、720p、横屏或竖屏的一镜到底舞蹈视频 + 一条最终配乐。
## 开工前确认
- **动作参考**:本技能以内置的无声舞蹈参考视频为固定前提,不需要也不要让用户再上传舞蹈视频;如果当前项目里找不到这段参考,直接说明「内置舞蹈参考未就绪」并暂停,不要换别的视频凑。用户主动上传了同一支舞的参考,可以用来补充动作蓝图。
- **画幅**:先用 ask_user 只问一个问题——16:9 横屏还是 9:16 竖屏。用户没选就不往下走,不套默认值;选定后全程只用这个画幅,不回到参考视频原本的构图比例。
- **角色**:
- 用户上传了角色图:先判断它是否已经在同一张图里同时有「全身造型 + 脸部细节特写」。有就直接用;没有就以这张图锁定身份、外貌、服装、比例、配色和识别特征,重新生成一张双视图角色参考图。
- 用户没给角色图:暂停,问想要什么角色类型、外貌和服装,**不要自己编角色**。
- 不做三视图/四视图转身图,参考图结构固定为一张「全身 + 脸部特写」双视图。
- **舞者人数 = 确认绑定的角色数**:一个角色就是独舞,多个角色就是这几位一起跳。不要因为参考视频里有很多人就克隆、加人或减人。
- **场景**:用户给了场景图就用;没给就按用户一句话描述生成。
- 角色和场景都确认后**暂停一次**,确认后才开始做舞蹈视频。
## 制作流程
1. **项目设定** —— 表格锁定:18 秒、720p、用户选的画幅、Seedance 2.5、舞者人数与名单、场景、视频静音、最终配乐来源。
2. **角色与场景资产** —— 出双视图角色参考图、场景图;场景按舞步的机位需求决定数量(见分镜规则)。**停下确认。**
3. **动作蓝图** —— 分析参考视频,忽略音频,按 0-18 秒时间顺序只记录中心位舞者:具体姿势组合、过渡动作、节拍点、走位、机位远近变化、移动方向、剪辑点。其他舞者的动作、站位、队形、互动、人物、服装、场景、文字和标志性画面全部标为「不继承」。用表格写在回复里,后面生成直接引用,避免舞步在环节之间丢失。
4. **分镜** —— 只有一个 18 秒镜头,一条连续动作视频承载完整编舞,不拆段。按人数重新编排站位和同步方式,按画幅重新构图,保证四肢和关键动作不出画。
5. **生成舞蹈视频** —— 生成前核对参考是否都已带上,缺任何一项就暂停。**生成后停下等用户确认。**
6. **配乐与交付** —— 确认视频后,把最终配乐叠上时间轴;视频原声静音。
## 风格锁定
- 风格以用户角色和场景为准(写实、3D 卡通、毛绒、像素都可以),但每条提示词都要带:`full-body dance performance, clear readable choreography, energetic rhythm, natural engaged facial expressions, consistent character design, stable full-body framing`
- 光线:明亮均匀的主光,避免暗部吞掉手脚动作;户外场景优先下午侧逆光,室内用柔和顶光加补光。
- 镜头质感:清晰、少运动模糊,舞蹈视频最怕手脚糊成一团。
- 必须避免:参考视频里其他舞者、原舞者的长相服装、原场景与文字、角色分身/克隆、多出来的路人舞者、面无表情的僵脸、四肢被画框切掉。
## 分镜与镜头规则
- 只做 1 个镜头,18 秒,完整覆盖 0-18 秒的中心位编舞、走位、机位远近、移动方向和剪辑节奏;不是借个舞风,而是逐拍复刻。
- 场景覆盖:舞步基本原地、机位固定 → 一张场景图够用;有明显走位、推拉或横摇 → 场景参考要覆盖主要机位角度(例如正面 + 斜侧 + 更宽的远景),保证运动中背景连续。
- 竖屏:全身占画面高度 70-80%,头顶留 8-10%,脚下留 10%,横向移动幅度收窄;多人改前后错位,不横排三人以上。
- 横屏:多人可以并排,但中心人物始终在画面中央三分之一。
- 动作蓝图表字段:时间段 / 节拍 / 姿势组合 / 过渡 / 走位方向 / 机位远近 / 剪辑点 / 表情强度。
## 提示词写法
**双视图角色参考图(用户图不达标时重做)**:
> 以图1 为角色身份和外貌来源,生成一张角色参考图:左侧全身正面站姿,完整呈现服装、配色、比例和标志物件;右侧同一角色脸部细节特写,五官和表情清晰可辨。锁定面部特征、发型/毛色、服装、身材比例、颜色和识别物件。纯净浅色背景,均匀柔光。不要其他人物,不要文字,不要多角度转身图。
**舞蹈视频提示词结构**:核心语句 → 舞者人数与身份声明 → 0-18 秒按时间顺序的编舞(姿势组合、过渡、走位、机位远近、移动方向、剪辑节奏)→ 画幅构图要求 → 表情要求 → 负面约束。总长度控制在 4500 字符以内。
核心语句:
> 图1 中的角色在图2 的场景里跳舞,舞蹈动作完整参照参考视频中**中心位舞者**一人的编舞,表情自然投入、随节奏变化清晰。
示例(单人竖屏):
> 图1 是穿蓝色背带裤的橘猫,图2 是麦田场景。9:16 竖屏,18 秒一镜到底。图1 中的角色在图2 的麦田里跳舞,舞蹈动作完整参照参考视频中心位舞者的编舞。画面中只有这一只橘猫在跳舞,没有其他舞者、分身或路人。0-3 秒:中景,双手握拳在胸前做开拖拉机的方向盘动作,上身左右律动;3-7 秒:机位拉到全身,原地踏步配合肩膀耸动,第 4 拍一个半蹲;7-12 秒:向镜头方向小步前进,双臂交替前推;12-16 秒:侧身转 90 度再转回,双手叉腰顶胯;16-18 秒:定格在单手指向镜头的结束姿势,咧嘴笑。全身始终在画面内,手脚清晰不出画。表情兴奋、眼睛跟着节拍有神。no music, no dialogue, no singing, no extra dancers, no clones, no text。
(上面 0-18 秒的分解只示范写法,实际必须按动作蓝图逐拍替换。)
**多人**:列出所有角色,写明「只有这几位角色一起跳,动作同步/错位按蓝图」,并禁止额外舞者和角色复制。
## 在 TVVV 上执行
- 双视图角色参考图、场景图用 generate_image,默认 Nano Banana 2;场景里需要清晰招牌文字时用 GPT Image 2。用户图不达标时用它作参考图重做双视图,身份外貌不改。
- 舞蹈视频用 generate_video:reference_images 带上所有已确认角色的同一张双视图 图N + 场景 图N,image_role 选 reference;如果平台支持视频参考,同时带上舞蹈参考视频作为动作参考,绝不用纯文字描述替代它。默认 Seedance 2.5,aspect 用用户选的画幅,720p,时长 18 秒(模型单次上限不够时,先告诉用户,再按蓝图在剪辑点处分两段、首尾帧衔接)。
- 视频本身必须无音乐、无对白、无歌声。最终配乐优先用本技能内置的原曲音频;内置音频不可用时说明情况,经用户同意再用 generate_music 生成一段 18 秒、节奏明快的替代配乐,或使用用户上传的音乐。配乐只用于成片时间轴,不作为生成视频的参考音频。
- 一次回复最多 3-4 次工具调用:资产一批、视频一批、配乐一批,每批结果回来确认后再继续。
- 交付清单:舞蹈视频(18 秒)、画幅、舞者名单、配乐来源;剪辑建议:视频轨静音,配乐与视频起点对齐;音乐长于 18 秒就保留主段、结尾自然淡出;短于 18 秒不自动循环。用户要求才替换、静音或移动音频。提示用户去 TVVV 时间轴剪辑合成。
## 注意事项
- **人数被参考视频带偏**:提示词里必须明说「画面中只有 N 位角色」,并列出名字;生成结果多出人就重做。
- **只学到舞风没学到舞步**:编舞要按时间顺序逐段写进提示词,不能只写「跳拖拉机舞」。
- **手脚出画**:竖屏全身舞最容易切脚,提示词写「全身始终在画面内」,并控制横向位移。
- **角色走样**:换装、毛色、配饰在快速动作里容易丢,参考图必须是同一张双视图,必要时缩短时长重试。
- **僵脸**:明确写表情随节奏变化,否则会得到面无表情的「AI 跳舞人偶」。
- **改时长改画幅**:用户中途想改,先确认这是新的需求,不要在当前这条里截断或拉长舞蹈。