Cheaper · 145 models · Invoices

See pricing
用这个 Skill 开始对话
巨构科幻电影短片

巨构科幻电影短片

渺小人影对望巨型建筑,慢节奏低饱和的史诗科幻短片

做一支60秒科幻短片:一个披袍旅人穿过沙漠,走向地平线上一座黑色巨型石碑

下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。

# 巨构科幻电影短片 适合想做「很慢、很大、很安静」的科幻短片:渺小的人、巨大的几何建筑、大面积留白、雾与沙中的体积光、低频轰鸣与突然的寂静。整体是致敬维伦纽瓦式科幻的电影语言,强调压迫感、宿命感和庄严感。最终交付 6-10 个长镜头组成的 45-90 秒 16:9 短片,附低频氛围配乐和可选的独白旁白。 ## 开工前确认 - 用户只给一句灵感(例如「沙丘里一座被遗弃的雕像」)也能开工:先在回复里给 3 个情绪方向的故事选项,让用户挑一个: - **悲壮宿命**(黄沙荒原):个体在沙暴和烈日下向命运走去。 - **神圣空灵**(冷钢深蓝):光从巨构缝隙落下,人物顿悟或被启示。 - **冰冷绝望**(黑色工业巨构):冷雨、混凝土、阴影吞没一切。 - 用户有角色照片 / 场景参考 / 剧本:先读懂其五官、服装、建筑几何线条,后续只重塑质感和色调,不改核心特征。 - 用户有角色声音参考就沿用;没有就为角色定一套固定的音色描述,全片不变。 - 用 ask_user 一次只问一个问题,最该问的是「三个方向选哪个」;时长、是否要对白可以给默认值(60 秒、以独白旁白为主)。 ## 制作流程 1. **项目设定** —— 在回复里用表格写清:画幅 16:9、视觉子风格(三选一)、主色调、情绪关键词、时长、语言、是否有对白。**停下等用户确认风格子类型**,并告诉用户不满意可以换。 2. **剧本扩写** —— 把灵感扩成三段式情绪弧:**压抑**(雾锁、巨物静默)→ **逼近**(极慢推镜、呼吸声变重、尘埃浮动)→ **爆发或寂灭**(低频轰鸣或宿命判词,紧接着完全的声音真空)。用画面代替台词:巨物阴影吞没小人 = 无法抗拒的命运;孤身走在荒原 = 个体的虚无;阳光刺穿浓雾 = 理性觉醒。 3. **角色卡与场景卡** —— 角色:袍服 / 防护服 / 粗织衣物,表情极度克制,写清音色(胸腔共鸣、喉部压紧、尾音沙哑)。场景:粗糙清水混凝土、巨大立方体 / 锥体 / 无装饰巨柱、模板接缝里积着风沙和氧化痕迹、锈迹和雨痕。 4. **分镜表** —— 每镜写清角色、场景、对应参考图、运镜、时长、声音。**停下等用户确认**。 5. **生成参考图** —— 先出角色全身三视图(头到脚,正 / 侧 / 背,16:9)和每个场景的无人四宫格参考图(4:3;左上远景建立、右上道具特写、左下纵深透视、右下光影氛围)。给用户看,确认后再进视频。 6. **逐镜生成视频** —— 每批 2-3 镜,结果回来检查一致性再继续。 7. **配乐与旁白** —— 低频无旋律的环境配乐 + 缓慢的独白旁白;最后给交付清单。 ## 风格锁定 - 每个镜头都带的画风短语:`monumental sci-fi, brutalist megastructure, extreme scale contrast, vast negative space, muted desaturated palette, volumetric light through dust, chiaroscuro, 35mm anamorphic film look` - **比例**:人物占画面面积小于 1%-2%,人与建筑高度比 1:50 到 1:100。 - **构图**:中轴对称 + 两侧斜线向画面深处唯一的消失点汇聚;超广角全景用两侧巨柱 / 暗门洞做边缘遮挡,形成几何暗角,把视线压回中心。 - **色彩**(饱和度压到 80%-85% 去饱和): - 悲壮宿命:琥珀、赭石、沙金、焦褐;低垂的巨大落日、背光下发亮的沙粒。 - 神圣空灵:冷钢蓝、雾银、靛蓝阴影;45° 丁达尔光柱、光束边缘轻微色散。 - 冰冷绝望:铅灰、漆黑大阴影(阴影覆盖 >60%)、湿混凝土反光、垂直冷雨。 - **光**:必有逆光剪影;必有雾、尘、沙等大气介质;明暗对比强烈。任何小光源(屏幕、指示灯、余烬)只亮在自己范围内,不能把颜色染到周围墙面。 - **必须避免**:高饱和霓虹、快速剪辑、手持晃动、快速变焦 / 甩镜、杂乱的布料乱飘、画面里出现字幕和 logo。 ## 分镜与镜头规则 - **镜头数**:60 秒约 6-8 镜;单镜 5-10 秒,多用 8-10 秒长镜头,留足让观众「被震住」的时间。 - **单一运动矢量**:一个镜头只做一种运动——要么沿中轴极慢推进,要么极慢水平摇,要么完全静止。禁止边推边摇、摇中带俯仰。 - **静—动—静**:有运动的镜头,前 20%-30% 完全静止锁住构图,中间 50%-60% 匀速极慢运动,最后 10%-20% 落回静止,方便下一镜硬切。 - **运镜配比**:中轴慢推约 70%(主力,把视线压进消失点);水平慢摇约 20%(只用于荒原、巨墙的建立镜头,摇角 15°-30°,不超过 30° 以免边缘拉伸);完全静止约 10%(作为「呼吸镜头」)。 - **景别**:大量大远景 / 全景做「小人大环境」;关键情绪用中近景拍微表情:不眨眼的凝视、喉部收紧、缓慢吞咽、下眼睑轻颤、一次很长的呼气。袍子在风里要像有重量,缓慢起伏,不能高频乱抖。 - **对白**:极少,以画外独白为主;句子短、诗意、带宿命感,在文本里留停顿(「……已经开始了。……」)。两人对话时一方高压、语速稍快、音调高;另一方低声、慢、发抖,形成声压对抗。 - **同场景一致**:连续镜头在同一空间时,用同一张场景参考图、同一个四宫格分区,避免人物在不同分区之间「瞬移」。 - **分镜表字段**:镜号 / 时长 / 景别 / 画面(人物、建筑、介质)/ 运镜(类型 + 静动静比例)/ 对应参考图与分区 / 声音(环境声、配乐、对白)。 ## 提示词写法 - **图片提示词结构**:主体与格式(三视图或四宫格)→ 风格锚点 + 比例数字 → 构图(中轴对称、消失点)→ 材质细节 → 色调与光线 → 排除项。 - 示例(场景四宫格):`4-panel concept reference sheet of a desolate brutalist desert temple, NO humans. Top-left epic wide establishing shot of the monolithic space, top-right close-up of weathered stone carving with micro-fractures, bottom-left extreme depth perspective with converging diagonal walls, bottom-right volumetric light shafts through dust. Muted amber and ochre palette, 80% desaturated, chiaroscuro, sand settled in concrete formwork seams.` - **视频提示词结构**:参考图说明 → 只动画化哪一个分区、输出为单一全屏镜头(不要分屏)→ 场景与比例锁定 → 人物动作与微表情 → 环境介质的慢速运动 → 运镜(含静动静时间分配)→ 声音 / 对白 → 排除项。 - 示例:`Use 图2 as the scene: animate ONLY its top-left wide establishing view as a single seamless full-screen shot, no split screen. A tiny robed traveler (图1) occupies less than 1% of frame, walking along the central axis toward a colossal black monolith; perfect symmetry, diagonal dunes converging to a deep vanishing point. Golden dust drifts slowly in low backlight, robe sways heavily in slow wind. Camera holds still for 3s, then pushes in at an extremely slow crawl, settles static for the last 2s. Sound: deep 30Hz drone, coarse sand wind, slow tribal drum at 55 BPM. No music melody, no subtitles.` ## 在 TVVV 上执行 - 先用 generate_image 出角色全身三视图(图1)和每个场景的四宫格(图2、图3…);后续每个镜头的 generate_video 都在 reference_images 里带上同一个 图N。人物镜头带角色图 + 场景图,image_role 选 reference;需要严格从某张构图起步的镜头先出一张关键帧,再用 first_frame。 - 默认图片模型 Nano Banana 2;需要画面里出现精确文字排版时才用 GPT Image 2。默认视频模型 Seedance 2.5,画幅 16:9,单镜 5-10 秒,默认 720p。 - 旁白用 generate_speech,音色描述写具体:`deep gravelly baritone, slow solemn tempo, chest resonance, slight vocal fry at phrase endings, audible breaths`,并在文本中保留停顿。 - 配乐用 generate_music,要器乐、无明显旋律:低音弦乐持续音、原始打击乐脉冲、无词空灵人声、次低频空气震动;按子风格加部落鼓 / 金属摩擦 / 冷雨回声。 - 一次回复最多 3-4 次工具调用;参考图一批,视频每批 2-3 镜,回来检查再继续。 - 结尾给交付清单:每个镜号对应的视频、建议剪辑顺序、配乐与旁白怎么叠(对白时把低频和配乐压低 18-24dB),提醒用户去 TVVV 时间轴剪辑合成;镜头之间默认硬切,只有时间流逝 / 梦境过渡用慢溶。 ## 注意事项 - **四宫格被直接生成成分屏视频**:视频提示词里必须写明「只动画化某个分区、输出单一全屏镜头、不要分屏拼贴」。 - **人物越生成越大、建筑塌缩**:每镜重复写人物占比 <1%、1:100 比例、中轴对称,不要只写在第一镜。 - **运镜变快变乱**:明确写「极慢」「单一方向」「前 3 秒静止」,并排除手持晃动和变焦。 - **色彩被小光源污染**:写清局部光只亮在光源附近、周围保持低饱和。 - **声音太满**:关键时刻安排 2-3 秒的声音真空,只留风声或一口吸气,比任何配乐都更有力量。 - **字幕**:不要让模型在画面里生成文字,字幕在剪辑阶段用细字体放底部居中加。