Cheaper · 145 models · Invoices

See pricing
Start a chat with this skill
Cursor Click Makeover

Cursor Click Makeover

A 15s pink-green pixel-UI makeover where every cursor click swaps the outfit

Make a 15s cursor-click makeover video, an East Asian woman in her 20s going from streetwear hoodie to office suit

The full workflow below is sent to the Agent every turn.

# 鼠标点击换装秀 一种很适合发社媒的潮流玩法:整支片就是「鼠标光标的第一人称视角」,光标冲进画面、点一下人物,粉色像素马赛克一炸就换一套衣服,中途人物失足坠落,最后被光标「点住」定格。最终交付一支 15 秒、16:9 横屏、固定八拍结构的换装短片,配电子流行背景乐和四种 UI 音效。 ## 开工前确认 - 需要用户选三样:人物外貌群体(东亚 / 南亚 / 欧美 / 非裔 / 拉丁裔等)、年龄段(十几岁 / 20 多岁 / 30 多岁 / 中年)、穿搭类型与套数(默认两套,如街头休闲、通勤正装、运动风、日系甜美)。 - 用户没想好时直接给推荐组合(例如「20 多岁东亚女生,第一套 oversize 卫衣 + 工装裤,第二套剪裁西装套装」),让他点头即可。 - 用户上传了自己的照片或衣服图:照片用来锁定脸,衣服图用来锁定换装款式。 - 用 ask_user 一次只问一个真正影响结果的选择。画面里的英文 UI 文字默认保持英文,用户要中文再改。 ## 制作流程 1. 项目设定 —— 在回复里用表格给出:时长 15 秒、16:9、粉绿像素 UI 风、人物外貌与年龄、两套衣服的具体描述(面料、颜色、版型、配饰)、核心视觉元素(粉色虚线框、粉色像素马赛克、粉色像素爱心、实体小老鼠道具、白粉色光标)。**停下等用户确认。** 2. 元素参考图 —— 依次生成:人物主参考(左头肩特写 + 右第一套全身)、第二套全身(基于主参考保持同一张脸)、光标图标、粉色像素小老鼠、亮绿色文字背景板、纯白空间背景板。**停下展示全部元素,等明确同意再进入视频。** 3. 视频生成 —— 把用户选择和元素图编号填进下文的八拍模板,分两段生成(前四拍约 8 秒、后四拍约 7 秒),第二段以第一段尾帧接续。**停下确认。** 4. 音乐与音效 —— 15 秒背景乐 + 四个 UI 音效。 5. 交付清单 —— 时间轴、音效落点、混音建议,提示去时间轴合成。 这个玩法的节奏是固定的,不需要另写分镜表,八拍模板本身就是分镜。 ## 风格锁定 - 统一画风关键词(每条提示词都带):`trendy Y2K pink and green UI aesthetic, pixel effects, cursor first-person POV, highly dynamic camera, crisp vivid lighting, clean digital look` - 色彩:亮绿色(开场背景)+ 纯白高曝光空间(坠落后的世界)+ 霓虹粉(虚线框、马赛克、爱心、LOOK 文字)。不要加第四种强调色。 - UI 元素:干净的矢量 / 像素风,粉色或白色,纯白背景出图,不加多余装饰。 - 人物:全程都在跳舞,每个八拍都有完整律动;换装后舞步自然接上,不准僵站。 - 镜头:整片就是光标本身,必须一直在动——推、拉、摇、横移、升降、环绕、俯冲轮番用;只有光标悬停锁定的一瞬间可以静止。快速移动带动态模糊和拖尾,每次点击都带全画面冲击抖动。 - 必须避免:静止机位、人物停下不动、换装后脸变了、马赛克颜色不是粉色、画面里出现大段可读字幕(屏幕上的短英文动效字除外)。 ## 分镜与镜头规则 固定八拍,每拍约 2 秒(最后一拍 1 秒),顺序不能改: | 拍 | 时间 | 名称 | 核心动作与镜头 | 屏幕文字 | 音效 | | --- | --- | --- | --- | --- | --- | | 1 | 0-2s | 亮绿开场 | 光标从右上斜冲入、带拖尾,左右大甩扫视后推到人物中景;人物在绿色背景前叉腰扭胯抖肩踩点;光标小幅环绕,粉色虚线框闪一下 | STYLE.EXE(像素打字机) | 光标滑入 | | 2 | 2-4s | 坠落剥离 | 极限后拉 + 鱼眼拉伸,人物被光标「勾」向后、瞬间失重;绿背景像贴纸一样剥落成左后方漂浮面板,世界切成纯白空间;后拉到底立刻 180 度环绕转到正面 | LOADING... NEW LOOK | 背景剥离 | | 3 | 4-6s | 换装一 | 失重中继续踢腿摆臂;镜头先斜上低角度扫全身,再急推锁定人物中心、悬停一帧、点击冲击抖动;粉色像素马赛克向外炸开后消散,换成第一套;人物悬空转身亮相,镜头侧向快速跟随 | LOOK 01 ✦(左下霓虹粉) | 马赛克消散 | | 4 | 6-8s | 换装二 | 落地瞬间镜头向下一顿再弹起;人物屈膝起身、右手撩发继续跳;低角度从鞋甩到头扫全身,再急推点击,马赛克覆盖消散换成第二套;右手比赞、左手叉腰,镜头微拉入全身 | LOOK 02 ✦(右侧滑入,与 01 对称) | 马赛克消散 | | 5 | 8-10s | 失去平衡 | 猫步夸张扭胯;光标高速 360 度水平环绕,有离心偏移,虚线框再闪;人物突然打滑,双臂大摆、身体重重歪向一边,表情从自信变惊恐;镜头跟着倾斜成强烈荷兰角 | WAIT-(白色斜体抖动) | 虚线框闪烁 | | 6 | 10-12s | 自由落体 | 光标和人物一起垂直高速下坠,镜头从正上方追拍,最强动态模糊、鱼眼、速度线,夹杂左右甩和斜向翻滚;人物四肢张成星形面朝镜头,衣服头发猛烈上翻,张嘴瞪眼抓空气 | FREE FALL ↓↓↓(白色重影) | — | | 7 | 12-14s | 聚焦实体化 | 俯冲急刹,画面一震后冻结在脸前(胸像特写);人物僵一拍后放松,舞步转慢动作,表情变俏皮淡定并眨眼,慢慢伸出一根手指指向镜头;极慢微推;粉色虚线对焦框从四角收拢锁定;光标在头顶一点,粉色小老鼠道具出现 | CLICK.(粉色像素单帧闪) | 对焦框收拢 + 点击 | | 8 | 14-15s | 定格收尾 | 光标再往前漂一小步后完全静止,像碰到屏幕冻住;人物头顶趴着小老鼠,歪头 45 度甜笑眨眼,最后轻轻抖肩;右下弹出粉色像素爱心,左侧绿色面板部分回来 | THE NEW YOU ♡(白色衬线逐字淡入) | 像素爱心弹出 | - 两套衣服对比要大:版型、颜色、风格至少有两项明显不同,观众一眼看出换了。 - 屏幕英文字都是短动效字,每个只停留不到 1 秒;如果要求字形精确,可以在后期叠加,视频提示词里只描述「文字动效出现的位置和风格」。 ## 提示词写法 - 图片提示词只写看得见的东西:外貌 / 材质 / 状态 → 构图与景别 → 光线与色调 → 风格锚点。人物主参考示例: `横向双联参考图:左侧头肩特写,右侧全身站姿。20 多岁东亚女性,黑色锁骨发,自然淡妆,暖调白皙肤色;全身穿灰粉色 oversize 连帽卫衣、卡其色工装阔腿裤、白色厚底运动鞋、银色细项链;纯白背景,均匀柔光,16:9,clean fashion lookbook photo, crisp detail,无文字` - 第二套用主参考做参考图生成,写明 `same face, same hairstyle and makeup as 图1, only the outfit changes to ...`。 - 文字背景板:亮绿纯色底,左侧预留黑色文字区;白色版保持同样的左侧文字区布局,两张版式一致。 - 视频提示词结构:先声明参考图编号对应的对象(图1 人物第一套、图2 人物第二套、图3 光标、图4 小老鼠、图5 绿色背景板、图6 白色背景板)→ 写「镜头规则:光标第一人称视角,全程高动态,禁止静止机位」→ 按八拍顺序用自然连贯的句子串起动作,不写时间戳 → 每拍末尾用尖括号写音效 → 负面词。前半段示例开头: `图1 为人物第一套,图2 为人物第二套,图3 为光标,图5 为亮绿背景,图6 为纯白空间。整支视频是鼠标光标的第一人称视角,镜头就是光标本身,全程高动态推拉摇移环绕,禁止静止机位,快速移动带动态模糊和拖尾,每次点击都有全画面冲击抖动。光标从右上角斜冲入画面带横向拖尾,左右大幅甩扫后急推到图1 人物中景,她在图5 亮绿色背景前叉腰扭胯、抖肩踩点……<光标滑入声> …… 不要字幕,不要背景音乐。` - 把 [第一套描述] [第二套描述] 换成确认过的具体面料、颜色、版型;外貌和年龄已经锁在参考图里,视频提示词不用重复写五官。 ## 在 TVVV 上执行 - 元素图全部用 generate_image:人物两套与小老鼠用默认的 Nano Banana 2;文字背景板和需要精确英文标题的 UI 图用 GPT Image 2。依次编号 图1-图6。第二套生成时 reference_images 带上 图1。 - 视频用 generate_video,默认 Seedance 2.5、16:9、720p。分两段:第一段(1-4 拍,约 8 秒)reference_images 带 图1、图2、图3、图5、图6,image_role 选 reference;第二段(5-8 拍,约 7 秒)把第一段尾帧截图作为 first_frame,再带 图2、图3、图4、图5 作为 reference,保证衣服和脸连续。如果某一拍效果不对,只重做那一段。 - 背景乐用 generate_music:明快潮流电子流行,约 120-130 BPM,15 秒,在 4 秒和 6 秒左右安排重拍对应两次换装,结尾干净收住。 - 四个音效也可用 generate_music 以纯音效描述生成(不带人声):光标点击(清脆短促约 0.3 秒)、马赛克消散(电子像素粒子散开约 0.5 秒)、虚线框闪烁(轻盈 UI 提示约 0.3 秒)、像素爱心弹出(可爱的像素 pop 约 0.4 秒)。视频本身带的点击声够用时可以不单独生成。 - 一次回复最多 4 次工具调用:先元素图,确认后再视频,最后音乐音效。 - 结尾给交付清单:两段视频的拼接点、八拍时间表、每个音效的落点。混音建议:背景乐比音效低约 6 dB,换装两拍的音乐重拍对齐马赛克炸开的那一帧,音效淡入淡出不超过 0.1 秒,最后半秒轻微定格并淡出音乐。提示用户在 TVVV 时间轴里拼接合成。 ## 注意事项 - 换装后脸变了是最常见的翻车:第二套一定基于第一套参考图生成,视频两段都带人物参考图。 - 镜头一旦静止就失去「光标视角」的爽感,提示词里反复写「全程高动态,禁止静止机位」。 - 两段拼接处容易跳:第二段必须用第一段尾帧作首帧,并保持同一套衣服和同一背景。 - 马赛克、虚线框、爱心都要是同一个霓虹粉,颜色不统一会显得很乱。 - 屏幕英文短字 AI 可能写错,错了就在剪辑时用文字层覆盖,不必整段重跑。