Cheaper · 145 models · Invoices

See pricing
Start a chat with this skill
Side-Scroll Scene Swap

Side-Scroll Scene Swap

Fixed side-scroll shot where a duo walks left to right as outfits and worlds hard-cut

Make a 15s side-scroll swap: a couple walks from a city street to a starry bench through 10 hard-cut scenes

The full workflow below is sent to the Agent every turn.

# 横版穿越换景 适合当下流行的「两个人一直往前走,身后世界不停切换」短视频:机位完全固定,横版侧面中远景加黑色暗角,同一对人物始终从左往右走,每 1-2 秒一次硬切——服装、背景、特效同时换掉,像舞台背景一幕幕滚过去。最后一站打破行走节奏,变成奔跑、玩闹或跳舞,跑出画面右侧结束。最终交付约 15 秒(默认 10 站)的 16:9 一镜到底视频,附人物身份锚点、10 张分站参考图和声音设计。 ## 开工前确认 - 需要的信息(可任意组合,缺的由 AI 补): - 两个人的设定:性别、发色发型、体型对比、前后或并排关系;可以上传人物照片。 - 主题路线的情绪,例如「复古怀旧」「奇幻旅行」「四季」。 - 用户只说「两个人穿过很多场景」时,先补一句两人的小背景:关系 + 一个贯穿全片的视觉道具(例如两人共提的一个旅行箱、同一把伞)。 - 用 ask_user 一次只问一个:先问路线(默认路线 / 自定义),再问要不要音乐(默认环境声 + 跟随情绪的配乐,也可以只要音效)。 - 默认参数:10 站、每站 1-2 秒、总长约 15 秒、16:9、无站名字卡、移动方向始终从左到右。 ## 制作流程 1. **身份锚点与路线设定** —— 在回复里给出:每个人 1-2 个全程不变的身份锚点(发色、标志配饰、体型特征)、相对站位、10 站路线表(主题 / 服装 / 场景 / 道具与特效 / 色彩)、最后一站的高潮动作、每站时长。停下确认。 2. **分站参考图** —— 每站一张,两人穿着该站服装、拿着该站道具、保持行走姿态;最后一站是奔跑或跳舞姿态。每张都写进完整的身份锚点原文。停下确认。 3. **视频提示词** —— 写出覆盖全部站点的完整提示词给用户过目,确认后生成。 4. **生成视频** —— 按站点顺序生成(见下方分段方式),检查机位、方向、身份。 5. **交付清单** —— 视频、站点时间表、声音说明,提示去 TVVV 时间轴拼接和加音乐。 ## 风格锁定 - 统一画风关键词:`cinematic side-scrolling stage composition, fixed mid-to-far side view, black vignette framing, characters walking left to right, crisp illustrated realism, consistent character silhouettes`。 - 机位:唯一的机位描述写在第一站,之后每站只写「same fixed framing」。人物占画面高度约 1/2,水平居中略偏左,给前进方向留空间。 - 默认 10 站路线及要点: 1. 现代城市街道:日光、红绿灯、单行道路牌,两人拎购物袋。 2. 复古酒店:对称粉色立面,两人穿蓝色门童制服捧粉色礼盒,小雪飘落。 3. 海盗船甲板:海风、绳索、木桶,宽檐帽与马甲,暖橙黄昏。 4. 月球表面:宇航服、灰白月尘、地球挂在黑色天空,几乎无声。 5. 游乐园夜晚:摩天轮、彩灯、烟花在头顶炸开。 6. 春日樱花道:粉白花瓣飞舞,浅色针织衫。 7. 秋日林荫道:金黄落叶飘落,风衣围巾。 8. 冬日雪路:两人共撑一把伞,脚下踩雪。 9. 雨夜长椅:路灯下雨丝,地面积水倒影。 10. 星空长椅:银河、星光倒影,两人跳上长椅玩闹后奔出画面。 - 每站色彩要和前后站拉开对比(冷暖交替),硬切才有冲击。 - 必须避免:任何运镜、变焦、暗角样式变化;人物重新设计或锚点漂移;走向反转;前后站位互换;站点之间的渐变融合;最后一站之前就开始跑。 ## 分镜与镜头规则 - 这是一条「一镜到底」,换的是舞台背景,不是机位。转场的顺滑来自三件事:机位不动、方向不变、人物不变。 - 每次换站 = 服装 + 背景 + 特效在同一个切点同时硬切,不做风格渐变。 - 节奏:默认每站 1-2 秒,重要的站可以 2 秒,过场站 1 秒;最后一站延长到 2-3 秒。 - 最后一站必须打破行走:跳上长椅、牵手转圈、追逐奔跑,然后从右侧跑出画面,画面停在空景收尾。 - 声音随站硬切,不做交叉淡化:城市车流 → 酒店大堂人声 → 海风与木船吱呀 → 太空寂静 → 游乐园欢呼与烟花 → 鸟鸣微风 → 落叶沙沙 → 踩雪声 → 雨打伞面 → 雨后安静与笑声。配乐可以跟着整体情绪连续走,只在情绪大跳(太空 → 游乐园)时明显转向,最后一站变得明亮俏皮。 - 站点表字段:站号 / 起始时间 / 主题 / 服装 / 背景 / 道具与特效 / 动作 / 环境声。 ## 提示词写法 - **分站参考图**结构:站号与主题 → 两人身份锚点原文 + 行走方向与相对站位 → 场景 → 服装 → 道具与氛围 → 色彩 → 机位说明。不写运镜。示例: ``` Cinematic side-scrolling illustration, station 2: retro hotel. A petite woman with a bright copper-red bob and round gold glasses, and a tall broad-shouldered man with a silver buzz cut and a black scarf, walking left to right, the woman half a step in front. Scene: a symmetrical pastel pink retro hotel facade with arched windows and a striped awning. Costume: matching blue bellhop uniforms with brass buttons and pillbox hats. Props and atmosphere: each holds a pink gift box, gentle snow falling. Palette: pink, powder blue, cream. Fixed mid-to-far side view, black vignette, camera does not move. ``` - **视频提示词**按站分块,每块写起始时间、三项同步硬切(服装 / 背景 / 特效)、重复方向和站位、重复身份锚点原文。示例节选: ``` [Station 1] 00:00–01:50. Fixed mid-to-far side-scrolling shot with black vignette, camera stationary for the whole video. A petite woman with a bright copper-red bob and round gold glasses walks in front carrying a green shopping bag; a tall man with a silver buzz cut and a black scarf walks half a step behind with a paper bag; both move left to right at a steady pace along a busy modern city street with traffic lights and a "ONE WAY" sign. Sound: traffic, crosswalk beeps. [Station 2] At 01:50, hard cut: costume, background and atmosphere switch at the same instant — both now wear blue bellhop uniforms holding pink gift boxes, passing a symmetrical pink retro hotel facade under light snow. Same fixed framing, same left-to-right direction, woman still in front. Sound cuts instantly to hotel lobby murmur. ... No camera movement, no zoom, no change in vignette, no character redesign, no reversed direction, no swapped positions, no gradual blending between stations, no running before the final station, no subtitles. ``` ## 在 TVVV 上执行 - 分站参考图用 generate_image,默认 Nano Banana 2,16:9;用户给了人物照就放进 reference_images 锁脸。路牌、酒店招牌需要精确文字时用 GPT Image 2。先出第 1 站确认人物形象,后面各站都带上第 1 站图作人物参考,保证两人不变。 - 视频用 generate_video,默认 Seedance 2.5、16:9、720p。单段上限按 5-10 秒处理,所以默认 10 站分 2 段:第 1-5 站一段、第 6-10 站一段,各约 7-8 秒;每段 reference_images 带该段 5 张分站图(reference),第 2 段把第 1 段最后一帧设为 first_frame,人物位置和步伐接得上。站点多时依此类推,每段 4-5 站。 - 配乐(用户要时)用 generate_music:`light whimsical indie pop, steady walking tempo around 110 BPM, warm and nostalgic, turning bright and playful at the end`;环境声直接写进视频提示词让模型同步生成。 - 一次回复最多 2-3 次工具调用:参考图分两批出,每批 5 张;视频每段回来先检查再出下一段。 - 交付清单:两段视频的顺序与拼接点、站点时间表、配乐叠在环境声下方;提示用户在 TVVV 时间轴里把两段硬切拼成一条,拼接点选在某次换站的切点上,最自然。 ## 注意事项 - **机位偷偷动了**:模型喜欢加推拉。第一站写清固定机位,负面词反复写 no camera movement、no zoom。 - **两个人越走越不像**:身份锚点必须逐字重复,不要换说法;每站参考图都带第 1 站人物图。 - **换站变成渐变**:一旦写 transform、morph、gradually 就会糊成一团,只用 hard cut、switch at the same instant。 - **站位互换或反向**:每站都重复「左到右、女生在前」这类相对站位。 - **节奏拖沓**:每站超过 2 秒就失去「刷屏感」,宁可多加几站也不要拉长单站。