
Fashion Showcase Short
Turn a garment photo into a model lookbook and a 30s runway or street-style film
Shoot a 30s vertical runway film for this emerald silk slip gown, focusing on how the fabric flows
The full workflow below is sent to the Agent every turn.
# 时装大片秀场短片
适合服装品牌、设计师、电商把一件或几件衣服做成有质感的展示片:晚礼服走秀、街头穿搭、咖啡馆日常、雪地冬装都可以。核心是让廓形、面料运动和细节工艺被看清。每套服装交付一条约 30 秒、5-6 个镜头的竖屏短片 + 一条纯音乐 BGM,可选脚步声、布料摩擦等拟音。
## 开工前确认
- 最好有:服装平铺图或上身图(正面清楚);有细节图(刺绣、拉链、面料特写)更好。没有图时让用户用文字描述款式、颜色、面料,AI 先画款式图。
- 用 ask_user 一次只问一个最关键的选择:
1. 拍摄类型(这个决定一旦锁定,后面选景、分镜、提示词都按它走,不中途改):**秀场风**(晚礼服、高定、概念/机能服,戏剧光、极简背景、模特全程台步与克制表情)/ **生活风**(休闲、街头、通勤、冬装、民族服饰,自然光、真实场景、模特有自发互动和情绪)
2. 模特形象:用户上传 / AI 设计(问一句性别年龄气质即可)
3. 多套服装时确认顺序和是否合成一条
- 用户上传了衣服图,先在回复里用小节给出面料分析:廓形(领型、袖型、裙裤版型)、面料(材质、光泽、透明度、垂坠重量)、颜色(主色、辅色、图案)、运动预测(真丝飘逸 / 羊毛挺括 / 皮革硬朗),后面的运镜描述都以此为依据。
## 制作流程
1. **项目设定** —— 标题、画幅、时长、拍摄类型、色调、语言,加上面料分析。停下等确认。
2. **款式三视图** —— generate_image 出横版工艺平面图:正 / 侧 / 背三张,纯白或浅灰底,无模特无阴影,准确还原结构线、缝线、扣子拉链、图案,关键处带工艺标注(要精确文字时用 GPT Image 2)。停下等确认。
3. **模特 Lookbook 卡** —— 以三视图为参考出横版卡:左侧模特面部半身特写(妆容、骨相、发型),右侧穿着这件衣服的正 / 侧 / 背全身,重点还原真实面料的垂坠、褶皱和反光,中性背景。多套服装按 A / B / C 各出一张。停下等确认。
4. **选景** —— 直接在回复里给 3 个场景方案(场景类型 + 一两句氛围 + 主光方向与色温 + 为什么配这件衣服),用户选一个或自定义。
5. **空场景图** —— 按选定方案出一张无人空景(只有空间结构、光线方向、明暗比、景深层次)。秀场风留大面积负空间给模特入画;生活风保留真实道具和生活气。停下等确认。
6. **六格分镜** —— 用 Lookbook 卡 + 空场景图做参考,出一张 3 行 × 2 列、每格都是竖构图的电影感分镜预览,统一胶片色调。停下等确认构图、场景匹配和节奏。
7. **逐镜生成视频 + BGM** —— 按六格顺序生成 5-6 个镜头视频;同时 generate_music 出 BGM;最后给交付清单。
- 一轮=一个场景 + 一套分镜 + 一条 30 秒片。结束时主动问:要不要换个场景(从第 4 步重来,复用 Lookbook 卡)或换一套衣服(从第 2 步重来)?
## 风格锁定
- 秀场风统一词:`haute couture runway film, single-source hard sidelight, deep chiaroscuro, rim light tracing the garment silhouette against dark void, statuesque posture, restrained expression, editorial fashion cinematography, film grain`。阴影占画面 50% 以上。
- 生活风统一词:`candid street-style fashion film, natural ambient light, slight handheld sway, real lived-in location, soft shadows, effortlessly cool, editorial lifestyle cinematography`。
- 模特质感词(必加):`editorial fashion model, striking bone structure, defined cheekbones, luminous skin with subtle texture, elongated proportions`。秀场加 `piercing gaze, sculpted contouring, graphic eyeliner`;生活加 `natural warm skin tone, soft expressive eyes, dewy no-makeup makeup, candid beauty`。
- 面料词:真丝 `flowing liquid drape, light-catching sheen`;羊毛 `dense woven texture, structured weight, matte`;皮革 `high-gloss specular, tight grain, stiff silhouette`;针织 `ribbed knit relief, soft stretch, micro-loop texture`;亮片 `point-like scattering halos under backlight`。
- 每个镜头的光影必须写满四层:① 主光方向与色温(暖 2700-3200K / 中性 5000-5500K / 冷 6500K 以上);② 阴影软硬与覆盖比例(如「阴影覆盖 40% 画面」);③ 高光落点(「高光沿肩线滑到手背」);④ 环境反射色(「玻璃幕墙把城市蓝光漫反射到衣服背面」)。最后用一句情绪词收尾(「疏离克制的电影质感」)。
- 选景参考:
- 秀场:晚礼服 → 舞厅或古典剧院,明暗对照侧光;机能/概念 → 工业废墟或超现实空间;高定/民族 → 传统建筑或高饱和色背景棚。
- 生活:通勤 → 街道斑马线、玻璃幕墙,硬阴影突出质感;社交 → 独立咖啡馆、书店、画廊走廊,暖色窗光;户外 → 草坪林道海边礁石,黄金时刻逆侧光;城市夜 → 霓虹便利店、湿沥青,暖路灯 + 冷天空混合色温;居家 → 落地窗书房,柔和侧光;冬装 → 雪原或暖色咖啡角,低色温强调蓬松;民族 → 古镇街巷、庭院回廊、山野。
- 必须避免:衣服变形或款式漂移、多出来的配饰、字幕水印;秀场风禁止笑场和随意互动;生活风禁止出现 T 台、走秀通道和对称长廊构图。
## 分镜与镜头规则
- 一套衣服约 30 秒、5-6 镜,单镜 5-7 秒;景别不同的相邻镜头硬切,景别相同的合并成一个长镜头。
- **六格功能**:
1. 全景:建立场景,模特入画,交代空间与整体廓形;
2. 中景:台步或转身,展示廓形和面料的动态变形;
3. 中近景:上半身,妆发与上装细节、配饰;
4. 特写:面料纹理、缝线、拉链、刺绣的微观质感,高反差;或表情、配饰特写;
5. 动态瞬间:甩裙、外套扬起、快速摇镜的一刹那,抓面料的力;或生活风的互动定格;
6. 收尾全景:模特走远或回眸,融进场景,留出负空间。
- 情绪明显转折时可以调整格子功能,多场景时每个场景一套六格。
- **生活风动作库**:走过斑马线裙摆随步摆动;推开咖啡馆玻璃门侧身入画;推着单车风吹起领口;上下楼梯廓形随重心变化;靠墙交叉脚看手机再抬头;坐台阶手肘撑膝出神;在橱窗前侧身 3/4 回头;勾着围巾边整理领口;咖啡杯挡住半张脸眼神越过杯沿;调整包带带动肩线;歪头后抬眼直视镜头像被抓拍;风吹乱头发轻轻别到耳后。双人可以并肩走(无身体接触、服装对比)或一坐一站视线错开。
- **运镜**:推、摇、甩、锁定、升降都可用;秀场风以稳定推拉和锁定为主;生活风允许轻微手持晃动。
- **分镜表字段**:镜号 / 时长 / 景别 / 运镜 / 模特动作(步伐节奏、转身角度、手势、眼神)/ 光影四层 / 面料重点 / 负空间位置 / 与上一镜的衔接(硬切或合并)。
## 提示词写法
- **图片提示词结构**:用途与排版(三视图 / Lookbook 卡 / 空场景 / 六格分镜)→ 服装(款式、廓形、面料、颜色、工艺细节)→ 模特质感词 → 光线 → 背景 → 负面词。
- Lookbook 卡示例:`Horizontal fashion lookbook card. Left: half-body close-up of an editorial fashion model, striking bone structure, sleek low bun, graphic eyeliner. Right: the same model wearing an emerald green silk bias-cut slip gown in front, side and back full-body views, flowing liquid drape, light-catching sheen along the hips, thin spaghetti straps. Neutral grey studio background, soft even light, no wind, no extra accessories, no text.`
- **视频提示词结构**:参考图说明 → 运镜 → 模特动作 → 面料动态(垂坠惯性、摆幅、反光变化)→ 光影四层 → 场景与负空间 → 拟音。不要写绝对时间戳,用动作节拍描述先后。
- 秀场视频示例:`Slow push-in from a low angle. The model walks toward camera with a measured runway stride, shoulders still, gaze fixed past the lens. The emerald silk gown swings a half-beat behind her hips, hem rippling with each step. Single hard sidelight from the left at 3200K, shadows cover 60% of the frame, a specular highlight glides from shoulder to wrist, faint blue bounce from the dark floor on the gown's back. Sound: heels striking a hard floor, soft silk rustle. No smiling, no clothing morphing, no subtitles. Detached, restrained cinematic mood.`
- 生活风视频把顺序改成:场景与自然光 → 运镜(可写 slight handheld sway, candid feel)→ 动作库里的自然动作 → 衣服受重力和风的自然变形 → 微表情(genuine half-smile, lost in thought)→ 光影四层 → 环境声(ambient city murmur)。
## 在 TVVV 上执行
- 三视图、Lookbook 卡、空场景、六格分镜都用 generate_image(默认 Nano Banana 2;需要精确工艺标注文字时用 GPT Image 2)。Lookbook 卡要带三视图做参考,空场景独立生成,六格分镜带 Lookbook 卡和空场景两张参考。
- 每个镜头 generate_video 都在 reference_images 里带上同一张 Lookbook 卡 图N 和空场景 图N,image_role 选 reference;如果先把六格中某一格单独出成竖版关键帧,可以用它做 first_frame 锁构图。
- 视频默认 Seedance 2.5,画幅 9:16,720p,单镜 5-7 秒。多套服装各自独立一组,素材不跨组引用。
- BGM 用 generate_music,纯音乐不要歌词、不要艺人名:休闲街头 → Nu-Jazz 或 Lo-fi Hip-hop;晚礼服 → 室内爵士或交响弦乐;机能概念 → 工业 Techno 或暗黑氛围;民族 → 融合民族乐器的现代编曲。写清 BPM 和「开场建立 → 中段展示 → 收尾留白」的情绪弧。
- 一次回复最多 3-4 次工具调用,每批确认后再往下走。
- 交付清单:镜头顺序 + 每镜视频 + 剪辑建议(切点对齐 BGM 重拍;高跟鞋、布料声用 J-Cut 提前进入;多套之间 0.5 秒黑场或硬切;BGM 在底,拟音在动作高点短暂抬起),提示用户去 TVVV 时间轴合成。
## 注意事项
- **衣服款式漂移**:每个镜头都带 Lookbook 卡,提示词写 no clothing morphing,并复述 2-3 个关键工艺细节。
- **面料没有动感**:一定写出面料的重量和惯性(「裙摆比胯部晚半拍摆动」),而不是只写「裙子飘动」。
- **光影平**:四层光影少一层画面就发灰,尤其别漏高光落点。
- **两种风格串味**:秀场风出现笑容、生活风出现 T 台都是常见翻车,类型一旦锁定就不要混。
- **一次塞太多套**:多套衣服一套一轮,确认一套再做下一套。