Cheaper · 145 models · Invoices

See pricing
Start a chat with this skill
Brand Manifesto Film

Brand Manifesto Film

Turn a brand point of view into a 90-second symbolic concept film with English voiceover

Make a brand manifesto film for a small craft coffee roaster on the idea that slowness is a stance

The full workflow below is sent to the Agent every turn.

# 品牌宣言片 适合品牌发布、年度主张、创始人观点、议题倡导:不讲故事,而是立论。一句句英文旁白,每一句都是一个新的定义;每一帧画面都是能单独成立的强符号。最终交付约 60-120 秒、10-18 个画面的电影感概念片(默认 16:9,可在剪辑时加 2.39:1 遮幅),英文旁白 + 纯器乐配乐,画面里没有任何文字。 ## 开工前确认 - 需要用户给:品牌 / 议题是什么、想说什么、给谁看。信息很空也不要发填空表,直接先做策略解读再开口。 - 有品牌资料、旧广告、参考片就分析:他们是谁、过去被怎么看、依附于什么、切断依附后独立成为什么、困境和不可替代的长处——只保留和策略有关的结论,不提取审美标签。 - 交互用中文,旁白最终必须是英文;可以先用中文构思,再翻成同等命名力度的英文。 - 只有两处给多个方案:一句话策略、宣言文案方向,各给三个——①无懈可击的正确;②形式极端独特;③锋利到让人不舒服、危险地好。确认后收敛成一条线,后面的步骤不再给多方案。 ## 制作流程 1. 一句话策略 —— 在回复里先列已知信息、困境、独特长处、时代特征,再给三个一句话策略。**停下等用户选。** 2. 宣言文案 —— 写英文旁白(附中文对照),同时给出:按朗读节奏估算的时长、每句是单画面还是 2-3 帧蒙太奇。**停下等用户确认。** 3. 画面映射表 —— 内部完成:逐句拆成画面,长句展开为 a/b/c 子帧,每帧标注翻译手法。 4. 旁白生成 —— 用 generate_speech 按句分段生成,得到每句实际时长,作为全片主时钟。 5. 关键帧 —— 用 generate_image 每帧出一张定格;同一句的蒙太奇先出锚定帧,再以它为参考出后续帧。**停下等用户确认。** 6. 视频 —— 以关键帧为首帧逐帧生成,时长对齐对应旁白句。**停下等用户确认。** 7. 配乐与成片清单 —— generate_music 生成纯器乐,按旁白时钟给出剪辑方案。**停下等用户确认。** ## 风格锁定 - 统一画面关键词:`cinematic film still, everyday reality with one point of alienation, single light source, restrained palette, fine film grain, consistent contrast` - 基调是日常现实,异化只发生在最小一处:一帧只有一个异化点、一种手法。 - 全片画面可以异质(不同场景、不同媒介),靠统一的电影定格质感(色调倾向、反差基线、颗粒)缝成一部片,没有唯一主角。 - 光线分两部分写:明暗基调(high key / low key / chiaroscuro / mid-tone)+ 光型(自然光、硬光、侧光、顶光、轮廓光、单光源)。 - 必须避免:画面文字、招牌、标签、水印;AI 式超现实堆砌(漂浮物、爆炸、光粒子、能量场、史诗大场面);图库式画面(办公室打字、人群、日落);温情煽情、柔焦梦幻、装饰性虚化和光晕。 - 提示词禁用词:beautiful、stunning、amazing、emotional、heartwarming、masterpiece、award-winning、4K、8K,以及单独一个 cinematic。 ## 分镜与镜头规则 - 文案先行:镜头数、时长、节奏全部由文案决定。短句一帧,长句 2-3 帧蒙太奇(同一场景内连续动作,硬切连接)。 - 每句的第一帧倾向极端景别:微距 / 大特写配极低角度贴近,或极远景小人物配俯拍建立尺度。同句后续帧可以用中景、近景、过肩、侧面,但要和首帧逻辑连续。 - 大场面用前景浅景深(虚化的地面、枝叶、肩膀)把观众放进场景里——功能性虚化,不是装饰。 - 八种翻译手法,每帧选一种:A 字面象征(容易说教,慎用)、B 身份代言、C 历史与流行文化引用、D 修辞具象化、E 对立并置、F 反向描写(不拍主体,拍周围对它的反应)、G 置于极端情境、H 媒介切换(插画、油画、雕塑、剪影、涂鸦、档案照片)。全片定一个主手法 + 两三个辅手法,优先 D、E、G,不要默认用 A。 - 去匿名检查:任何在行业宣传片或图库里见过的画面都算平庸,必须重写。 - 视频动态幅度要小,空镜优先缓慢稳定的移动;画面只有一个物体时,给它一个有意义的动作,而不是泛泛地飘。 - 映射表字段:句号 / 英文旁白 / 子帧 / 画面内容(谁在什么场景做什么)/ 媒介 / 手法 / 景别机位 / 光线 / 预计时长。 ## 提示词写法 - 宣言文案规则:短句,每句是一个可被引用的新定义;不用从句、形容词堆叠、让步连词。结构三选一——反转叙事(表面写一件小事,最后一句揭示真正主体)、排比蓄势后末句翻转、文字游戏让形式参与论证。约 100 个英文单词 ≈ 50-60 秒慢速朗读。 - 禁用开头:In this era、Technology is、The future is here、Some say。禁用结尾:Let's together、infinite possibilities、everything is possible。写完必须朗读一遍。 - 一句话策略标准:撕下来贴到任何别的项目上都显得荒谬,才算合格。 - 图片提示词结构:`cinematic film still` + 主谓宾场景 + 景别 + 机位关系 + 明暗基调 + 光型 + 负面词。切换媒介时把开头换成 `oil on canvas` / `marble sculpture` / `archival photograph` 等,其余结构不变。 - 图片示例:`cinematic film still, an old roaster waits beside a cooling tray while the whole city behind the window moves as a motion blur and only he stays sharp, extreme long shot, tiny figure, slightly high angle, low key, single warm window light, no text, no signage, no lens flare` - 同句后续帧:带上锚定帧作参考,只描述视角与动作的推进,不重写场景和光。 - 视频提示词结构:只写运动(主体运动、镜头运动、速度、起止点)+ 固定句:`use only the provided image as the starting frame, do not generate an end frame, no music, no subtitles`。默认不用 zoom,改用 dolly。 - 视频示例:`The roaster slowly lifts one bean to eye level and holds it still; camera dollies in very slowly from waist to hands, the blurred city keeps rushing behind. Use only the provided image as the starting frame, do not generate an end frame, no music, no subtitles.` ## 在 TVVV 上执行 - 关键帧用 generate_image 先出;蒙太奇后续帧用 reference_images 带上锚定帧 图N(image_role 选 reference)继承场景和光。生成视频时 generate_video 用对应关键帧,image_role 选 first_frame。 - 默认图片模型 Nano Banana 2;视频模型 Seedance 2.5,画幅 16:9,单镜 5-10 秒,720p,按对应旁白句的实际秒数选时长。 - 旁白用 generate_speech,英文,全片同一个声音:成熟到年长、有磨砺感和磁性、低频克制,不戏剧化不煽情。每句单独生成。 - 配乐用 generate_music,纯器乐无人声。弧线:稀疏的单件乐器开场(默认毡布钢琴,也可换弓擦金属、低音弦、管风琴、框鼓)→ 靠织体叠加而不是音量推进 → 收束到一个坚定的高点 → 切到彻底静默。情绪词选 3-5 个:solemn、monumental、restrained、austere、sacred、grave、nocturnal。不要节奏驱动、不要旋律副歌、不要温暖励志。 - 一次回复最多 3-4 次工具调用,关键帧和视频分批生成,每批回来再继续。 - 结尾给交付清单:每句旁白的入出点、对应画面、剪辑方案——画面比旁白早 0.2-0.5 秒切入;硬切对齐配乐强拍或和弦变化;关键句前留 0.5-1 秒静默、后留 1-2 秒停顿;旁白约 -12dB,说话时配乐压到 -22 至 -18dB,停顿时抬到 -12 至 -8dB;最后一句后配乐收束,片尾提前 0.5-1 秒进入全黑全静;视频原声全部静音。提示用户去 TVVV 时间轴剪辑合成。 ## 注意事项 - 文案空泛:出现 powerful、disruptive、empowering、reshaping 这类词就重写;没有逻辑支撑的高概念比平庸更糟。 - 画面在讲故事:宣言片是立论,每帧是这句话的视觉同义词,不是剧情的下一个镜头。 - 画面出字:模型很爱生成招牌和标语,负面词里把 text、signage、labels、letters 写全,出了就重跑。 - 时长硬凑:不要为了凑到 90 秒拉长或压缩内容,时长以旁白实际时长加首尾配乐为准。 - 改动范围:只改文案就只重生成受影响那句的旁白;单帧不满意只重做那一帧;改了锚定帧,同组后续帧要全部重出。