Cheaper · 145 models · Invoices

See pricing
用这个 Skill 开始对话
MV名场面换角复刻

MV名场面换角复刻

换上你的主角、伙伴和场景,复刻一段MV的动作、走位和镜头节奏

用我和三个朋友的照片,复刻一段暴雨中群舞的MV名场面,30秒横屏,我站C位

下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。

# MV名场面换角复刻 适合「把我和朋友换进那段 MV 里」的需求:一段流行的群舞、合唱或走位名场面,保留它的动作编排、出场顺序、人数站位、镜头路径和剪辑节奏,只把人物身份、外貌、服装和场景换成用户自己的。交付一条约 30 秒(4 个镜头)的写实横屏视频,配上用户指定的那一首音乐,全片只有这一条音轨。 ## 开工前确认 - 需要三类素材: 1. **动作参考**:用户上传的参考视频,或 4-6 张关键截图 + 一句话描述(谁先出场、几个人、站位怎么变、镜头怎么走)。都没有时,请用户描述想复刻的名场面,AI 先写一版动作拍表给他确认。 2. **人物**:一张主角照片 + 一张或多张配角照片(脸清楚的正面或半身)。缺图时用 generate_image 按描述补一张写实人像。 3. **场景**:一张背景图,或一句场景描述(暴雨天台、霓虹街口、空旷仓库),缺图就生成一张空景。 - 音乐:用户上传的那首歌是唯一音轨;没有就用 generate_music 按参考的节奏和风格写一段 30 秒的器乐。全片不再叠加其它音乐、旁白或音效。 - 配角只给了一张时,在所有配角站位上复用这个人,补齐参考里的人数。 - 用 ask_user 一次只问一个最影响结果的问题,例如「主角站 C 位还是从侧面出场?」。 ## 制作流程 1. **复刻拍表** —— 在回复里用表格拆解参考:总时长、段落(前奏 / 主歌 / 副歌 / 收尾)、每段的人物出场顺序、人数与站位(左二 / C 位 / 右二)、核心动作、镜头路径(推 / 拉 / 环绕 / 升降)、景别变化、剪辑节奏和重拍位置。音乐有明显段落时标出每段起止秒数。停下等确认。 2. **登记角色与场景** —— 素材一到就在回复里登记成「主角 = 图1、配角 A = 图2、场景 = 图3」,后面全片沿用同一编号。缺什么就补生成什么,人像统一写实风,不等所有素材到齐才动。 3. **静态关键帧预览** —— 按参考的经典构图,用 generate_image 把主角、配角放进场景,出一张代表性的群像关键帧(人数和站位与参考一致)。停下给用户确认长相、站位和场景氛围。 4. **分镜关键帧** —— 按拍表把 30 秒拆成 4 个镜头,每个镜头出一张起始画面关键帧(同样带全部角色和场景参考),保证站位和光线连续。 5. **逐镜生成视频** —— 每个镜头用对应关键帧做首帧 generate_video,提示词里逐拍复述参考的动作、走位和运镜。每批回来自检人数、站位、动作节拍、人物长相。 6. **交付清单** —— 镜头顺序、与音乐重拍对齐的切点、音轨说明,提示用户去时间轴合成。 ## 风格锁定 - 统一关键词:`realistic music video cinematography, live-action, synchronized group choreography, cinematic lighting, shallow depth of field, film grain, 24fps motion blur`。 - 只替换四样东西:人物身份、外貌、服装、场景。动作编排、出场时机、人数、角色分工、镜头轨迹、景别和剪辑节奏都要和参考一致,不擅自加戏。 - 光线跟着场景走但全片统一:夜景雨戏用强逆光穿过雨丝 + 冷蓝环境光(约 6500K)+ 一侧暖色补光;白天户外用侧逆光 5500K;室内棚用硬顶光和轮廓光。 - 服装:群舞场面主角与配角用同一色系,主角加一个区别点(颜色更亮、多一件外套或配饰),保证 C 位在远景里也一眼可认。 - 必须避免:动漫化、人物换脸漂移、人数忽多忽少、额外台词和旁白、画面文字、水印、和参考无关的道具。 ## 分镜与镜头规则 - 30 秒拆 4 镜,每镜 7-8 秒,切点放在音乐的重拍或段落交界,不在一个舞蹈动作中途切。 - 典型结构(按参考调整): 1. 前奏建立:远景或升降机位,人物逐个入场或背身静止,交代场景; 2. 主歌推进:中景跟拍主角,配角在后方做同步动作,镜头缓推或横移; 3. 副歌高潮:全员齐舞的大全景或环绕,最有记忆点的定格 pose 落在重拍上; 4. 收尾:主角近景或低角度仰拍定格,配角在背景虚化里收势。 - 动作描述要具体到身体部位和节拍:「第 1 拍右脚踏前,第 2 拍双臂向上甩开,第 3-4 拍胯部左右顶,雨水从袖口甩出」,不要只写「跳舞」。 - 站位要写清每个人在画面中的位置和朝向,镜头运动中站位关系不能变。 - **分镜表字段**:镜号 / 时长 / 对应音乐段落 / 景别 / 运镜 / 站位(谁在哪)/ 逐拍动作 / 光线 / 切点说明。 ## 提示词写法 - **关键帧提示词结构**:参考图编号与身份对应(图1 主角、图2 配角、图3 场景)→ 人数与站位 → 姿势 → 服装 → 场景与光线 → 写实风格词 → 负面词。 - 关键帧示例:`Use image 1 as the lead dancer, image 2 for all four backup dancers, image 3 as the location. Five dancers on a wet night rooftop in heavy rain, lead at center front, two backup dancers on each side one step behind in a V formation, all in black cropped jackets and cargo pants, lead in a silver jacket. Everyone mid-pose with right arm thrust forward, heads down. Strong backlight cutting through rain streaks, cool blue ambient, puddle reflections. Realistic music video still, film grain, no text, no watermark.` - **视频提示词结构**:参考身份说明 → 运镜 → 逐拍动作与站位 → 环境动态(雨、烟、灯光闪)→ 与音乐节奏的对应 → 负面词。 - 视频示例:`Same five dancers and rooftop as the first frame. Slow low-angle push-in. On beat 1 all dancers snap their heads up together; beats 2-4 they sweep both arms outward and step left in unison, rain spraying off their sleeves; beats 5-8 the lead steps forward out of the V formation and spins once, backup dancers drop to one knee behind him. Lights flicker on the downbeat, rain keeps falling, puddles splash under their feet. Movement locked to a steady 100 BPM beat. Realistic MV look. No extra people, no face changes, no dialogue, no narration, no subtitles.` - 不要在视频提示词里描述参考视频本身(不写「像某某 MV」),只写具体动作、站位和镜头。 ## 在 TVVV 上执行 - 主角、配角、场景缺图时用 generate_image(默认 Nano Banana 2,写实人像风)补齐;群像关键帧和每镜起始帧也用 generate_image,在 reference_images 里同时带上主角 图N、配角 图N、场景 图N。 - 每个镜头 generate_video 用该镜关键帧做 reference_images 第一张,image_role 选 first_frame;如果某一镜更需要锁人物而不是构图,改用 reference 并带上主角和配角原图。 - 视频默认 Seedance 2.5,画幅 16:9,720p,单镜 7-8 秒。 - 音乐优先用用户上传的那首歌;需要新写时用 generate_music,写清 BPM、段落和 30 秒时长,只要器乐。这个 skill 不用 generate_speech。 - 一次回复最多 4 次工具调用:先一批关键帧,确认后一批视频。 - 交付清单:镜头顺序 + 每镜视频 + 每个切点对应的音乐秒数 + 「全片只保留这一条音乐,视频自带声音全部静音」的提醒,引导用户去 TVVV 时间轴对齐重拍合成。 ## 注意事项 - **人数不对**:每条提示词都写明总人数和每个人的位置,加 no extra people。 - **配角长得不一样**:只有一张配角照片时明确写「所有配角都使用图2 的同一个人」。 - **主角在远景里认不出**:给主角一个颜色或单品上的区别点,并保持在 C 位或固定位置。 - **动作和音乐对不上**:拍表里先标好重拍时间,提示词里用「第几拍」描述动作,剪辑时以音乐为准微调切点。 - **视频自带了乱七八糟的声音**:生成时写 no dialogue, no narration;合成时把视频原声静音,只留指定音乐。 - **照搬原作的商标或人物**:只复刻动作和镜头语言,不出现原 MV 的人物脸、logo 或片名。