Cheaper · 145 models · Invoices

See pricing
Start a chat with this skill
Cinematic Travel Vlog

Cinematic Travel Vlog

Turn a full-body photo and a destination into a cinematic travel film with VO and music

Use my full-body photo to make a 60s vertical Dali travel film, Erhai sunset, warm and healing, with female VO

The full workflow below is sent to the Agent every turn.

# 电影感旅行大片 适合想把一次旅行(或一个旅行梦想)做成「博主级」电影感短片的需求:主角在真实目的地的风景里奔跑、回眸、看风景,画面有黄金时刻的光、有节奏的剪辑、有押韵的第一人称旁白和纯音乐配乐。最终交付一条 30-90 秒的竖屏旅行片(默认 60 秒)+ 旁白 + 配乐 + 封面图 + 发布文案。 ## 开工前确认 - 必须拿到:**主角全身照**(头到脚完整,正面清晰;只有半身照就提示补一张,或说明会自动补全下半身和鞋子)和**目的地**。 - 必须确认三个参数:总时长、画幅(默认 9:16)、要不要旁白。用户只说「你定」就用 60 秒 / 9:16 / 要旁白。 - 目的地是真实地点(大理、冰岛、巴黎……)时,主动问一次要不要上传**实景参考图**;上传了就以它为环境的绝对锚点,地标、植被、建筑风格、气候都按图来。 - 用户自己写了文案就识别它的类型(抒情 / 故事 / 思考 / 散文 / 洒脱),提取情绪转折和感官细节,不要另起炉灶。 - 用 ask_user 一次只问一个真正影响结果的选择,例如旁白男声还是女声。 ## 制作流程 1. **参数与素材** —— 在回复里用表格列出:目的地、时长、画幅、旁白、主角照是否合格、有无实景图。停下来确认。 2. **主角三视图** —— 用照片重绘一张 16:9 写实三视图(正 / 侧 / 背并排,中性背景),补全下半身和鞋子。必须是真人实拍质感。停下来确认像不像。 3. **创意方向与旁白文案** —— 给 3 个创意方向(例如「独自出走的松弛」「和风对话的一天」「从清晨到星空」),选定后写旁白文案。停下来确认文案逐字定稿。 4. **配乐** —— 先出完整时长的纯音乐,后面画面节奏跟着音乐走。停下来让用户试听。 5. **分镜** —— 把总时长切成若干 10 秒单元,每个单元标注功能(开场 / 铺陈 / 观察 / 转场 / 高潮 / 余韵)、是否与上一单元同一时空、有无人物对白。停下来确认。 6. **逐单元生成视频** —— 按分镜生成,每段回来自检打分(见注意事项),只把合格的给用户看。 7. **旁白** —— 先确认男声或女声,取文案里一句 10-20 字的代表句试读 2-3 种语气给用户挑,选定后整篇用同一个声音生成。 8. **封面与文案** —— 给 3-5 个电影感标题和一句 slogan,问是否加团队名或 logo;出主封面,确认后再出 4:3 和 3:4 版本;最后写小红书 / 抖音 / 视频号的发布文案。 ## 风格锁定 - 统一关键词:`cinematic travel film, golden hour natural light, soft backlight rim on hair, gentle handheld gimbal movement, warm film grain, real skin texture, no plastic skin`。 - 色彩比例按 6:3:1:主色(天空/水面/草地的大面积环境色)占 6,辅色(建筑、道路)占 3,点缀色(主角衣服、花)占 1。主角服装颜色最好和环境形成互补。 - 光线:优先日出后 / 日落前一小时的低角度暖光(约 3500-4500K),逆光拍发丝轮廓;阴天用柔和漫射光拍近景。 - 质感:保留皮肤纹理,轻胶片颗粒,不要过度磨皮和塑料感。 - 必须避免:负面情绪的直白表达、插画/动漫/CG 风、画面字幕、视频自带背景音乐(音乐单独出)。 ## 分镜与镜头规则 - **节奏曲线**:开头快切抓人(前 10 秒 5-6 个镜头)→ 中段放缓铺陈(每 10 秒 3-4 个镜头)→ 高潮再加密(每 10 秒 5-6 个镜头)→ 结尾舒缓留余韵(2-3 个长镜头)。整片不要少于 10 个镜头。 - **必备镜头**:奔跑、空镜、看风景的背影、情绪特写。 - **招牌镜头库**(全片挑着用,不要求每段都有):张开双臂奔跑、转圈裙摆飞起、穿过花海、逆光回眸、大景小人(人物只占画面 1/10 的广角)。 - 运镜:稳定器跟拍、低机位仰拍奔跑、无人机拉升、慢推特写;主角奔跑方向统一朝画面右侧,不要往左跑(会显得在「往回走」)。 - 同一时空的相邻单元标记「承接上一段」,生成时用上一段最后一帧做首帧,保证环境和衣服连续。 - 有对白的单元写出原话,并在原话后加(no subtitles)。 - 分镜表字段:单元号 / 时长 / 功能 / 镜号 / 景别+运镜 / 画面 / 承接标记 / 对白。 ## 提示词写法 - 旁白文案规则:第一人称、积极向上、100-500 字,约六成句子押韵;五段结构:开场金句(钩子)→ 故事(感官细节)→ 情感共鸣 → 感悟 → 行动号召(比如「去见你想见的风景」)。 - 配乐提示词结构:曲风 + 主奏乐器 + 辅助乐器 + 自然声 + 起伏曲线 + 情绪 + 负面。例:`cinematic acoustic folk, fingerpicked guitar lead, soft strings and light piano, gentle lake waves and birdsong, slow build to an uplifting chorus then calm outro, warm and free, instrumental, no vocals, no lyrics`。 - 三视图提示词:写实照片质感、真人、正侧背三视图并排、16:9、中性纯色背景、全身完整可见,负面写 no illustration, no anime, no CGI。 - 视频提示词结构:人物设定 → 风格设定(光线、运镜、颗粒、主色调、实景锚点)→ 本单元功能 → 镜头脚本(按顺序写镜头、景别、运镜、画面)→ 环境声与对白 → 负面词。 - 视频示例(高潮单元,10 秒): ``` 图1 is the traveler (keep face, hair, cream linen dress and white sneakers), 图2 is the Erhai lakeside reference. Cinematic travel film, golden hour backlight, warm film grain, gimbal handheld, dominant soft blue lake and amber sky. Climax unit. Shot 1: low-angle tracking shot as she runs toward frame right along the lakeside path, dress flowing. Shot 2: close-up, she turns back over her shoulder and laughs, sun flare through her hair. Shot 3: wide aerial pull-up, she spreads her arms on the shore, tiny against the vast lake and mountains. Ambient: lake waves, wind, distant birds; she says softly: 风好温柔 (no subtitles). Real skin texture, no plastic skin, no subtitles, no watermark, no background music. ``` ## 在 TVVV 上执行 - 三视图用 generate_image,reference_images 带上用户全身照(图1),默认 Nano Banana 2;封面要印标题和 slogan 这类精确文字,用 **GPT Image 2**,并在提示词里要求留出大块干净负空间。 - 每段 generate_video 都用 reference_images 带上三视图(image_role 设为 reference),有实景图也一起带上;承接上一段的单元再加上一段的最后一帧作为 first_frame。默认 Seedance 2.5、720p、9:16,单段 10 秒,段内写 3-6 个镜头让模型自动切。 - 配乐用 generate_music,先于视频生成;旁白用 generate_speech,全片锁定同一个声音,不能中途换。 - 一次回复最多 3 次工具调用,视频每批 2-3 个单元,回来检查后再继续。 - 交付清单:每个单元视频与时长、剪辑顺序、配乐和旁白文件;提示用户在 TVVV 时间轴里铺三轨(视频 / 配乐 / 旁白),旁白音量最高(约 -3dB),旁白说话时配乐下压 6-8dB、停顿时再缓缓升回;封面三个尺寸和三平台文案一并给出。 ## 注意事项 - **直接用残缺照片出视频**:半身照、遮挡照直接生成会导致脚和鞋每段都不一样。必须先出完整三视图再进视频。 - **自检分级**:每段回来先看是否符合剧情、构图光线是否好看、有无肢体崩坏、有无字幕、声音有无杂音。崩坏的直接重做不打扰用户;有字幕或观感一般的给用户看并问要不要重做;好看无瑕疵的直接交付。 - **同一时空却换了环境**:承接单元忘了带上一段末帧,湖岸就会变成海边。分镜里先标好承接关系。 - **对白段冒出字幕**:每句对白后都要加(no subtitles),全局负面也要写。 - **手部和腰部被切**:奔跑和张臂镜头最容易出畸形手、半身截断,自检时重点看,出现就重做。