Cheaper · 145 models · Invoices

See pricing
用这个 Skill 开始对话
末世废土科幻短片

末世废土科幻短片

半写实3D末世科幻:废土、异种生物与新中式科幻,出1-3分钟剧情短片

做一部2分钟末世短片:拾荒小队深入被肉质花海吞没的旧城,寻找失踪的队长

下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。

# 末世废土科幻短片 适合想做「文明崩塌后的人类挣扎」类剧情短片的需求:漫天孢子的地表废土、冷白色的高塔避难城、会呼吸的肉质异种生态、温暖的新中式山村据点,配上半写实 3D CG 的电影质感。默认交付一部 1-3 分钟、16:9、24fps 的剧情短片,约 6-25 个镜头,含角色对白、可选旁白和全片配乐。 ## 开工前确认 - 用户提供剧情点子即可;有剧本、角色设定图、场景图、角色配音样本时优先使用。用户素材风格不符(太二次元、太干净明亮、卡通化)时,以它为底按本风格重做一版,并说明偏差在哪。 - 只有一个模糊想法时,先给 3 个故事方向(每个一句话梗概 + 情绪基调)让用户选,选定后再扩写成分场剧本。 - 用 ask_user 一次只问一个关键选择,优先级:时长(默认 2 分钟)→ 导演风格(纪实沉浸 / 史诗悲壮 / 恐怖惊悚,可分段混用)→ 对白语言(默认中文)。 - 不使用任何现有动画作品的角色名、地名、怪物名;世界观名词全部原创。 ## 制作流程 1. **项目设定** —— 回复里用表格给出:片名、类型、16:9、时长、24fps、导演风格、对白语言、一句话主题。**停下等用户确认**。 2. **剧本与分镜** —— 分场剧本 → 分镜表(见下文字段)。标注每段的叙事弧阶段与转场意图,累加时长核对目标时长。**停下确认**,支持局部修改。 3. **资产设定图** —— 用 generate_image 一批出完:每个角色一张全身三视图(正 / 侧 / 背横排,16:9),每个场景一张无人物的 2×2 四宫格多角度图(4:3),异种生物 / 关键道具各一张(4:3)。有对白的角色给一段声线描述(性别年龄、质感、语速、语调、情绪底色)。**整批确认后再进入视频**。 4. **逐镜生成视频** —— 按场景段分批 generate_video,每段完成后让用户看一遍再继续下一段。 5. **旁白与配乐** —— 全片至少一条配乐;有旁白时用 generate_speech 生成。**停下确认**。 6. **交付清单** —— 镜头顺序、转场方式、音轨叠法,引导用户到 TVVV 时间轴剪辑合成。 ## 风格锁定 - 统一画风关键词(每条提示词都带):`cinematic 3D CGI, semi-realistic anime style, post-apocalyptic sci-fi, high-fidelity rendering, subsurface scattering skin, pore-level detail, dirty realism, volumetric light with dust particles, muted palette with selective vivid accents`。 - 定位在「写实渲染」和「风格化动漫」之间:脸接近真人,略加动漫美化(眼睛稍大、下颌利落),皮肤有毛孔、汗渍、血污;头发有真实重力。 - 四类场景配色: - 地表废土:沙埋的城市残骸、锈车、裂开的公路、昏黄或孢子暗天、远处巨物剪影;土黄 / 锈红 / 灰褐。 - 高塔城内部:冷白蓝 LED 金属走廊、密集控制台、监控感;工业冷灰 / 深蓝,硬质人造光。 - 异种生态核心:肉质花状结构、发光脉络、会起伏的黑色活土、孢子雾;暗红 / 荧光蓝 / 深紫,黏液与甲壳质感。 - 山村据点:梯田村落混搭高科技,暖黄火光,有「被救赎」的感觉。 - 光线:强明暗对比 + 丁达尔光(光束穿过废墟、孢子悬浮),材质必须有划痕、锈、油污、布料磨损。 - 必须避免:日系赛璐璐平涂、高饱和亮色、「崭新干净」、卡通 / Q 版怪物、魔法特效、过量霓虹赛博。 ## 分镜与镜头规则 - **镜头数量**:1 分钟约 6-10 镜,2 分钟 12-18 镜,3 分钟 18-25 镜。分镜写完必须累加时长核对。 - **合并优先**:同一时空、总长 ≤15 秒的一组节拍,合成一个镜头,用镜头内切换处理景别变化;超过 15 秒、时空明显跳转、叙事弧断开时才拆。 - **必须单独成镜的戏剧点**:目睹重大事件后的定格反应、改变走向的关键台词、需要观众「停下来消化」的转折,哪怕只有 4-6 秒也要独立,用景别突变制造对比。 - **按场景类型定时长**:废土探索 8-15 秒、内部 1-2 次缓慢切换;战斗 4-8 秒、2-4 次快切、关键打击 0.5-1 秒慢动作;情感 8-12 秒、浅景深特写或一次缓推;空镜 6-10 秒、固定或极慢摇;追逐 6-12 秒、跟拍 + 第一视角,匀速→急停→爆发冲刺。 - **开头 3 秒必须有钩子**:远方巨物现身、爆炸闪光、废墟中奔跑的背影;结尾用缓慢拉远废土、空镜渐黑或逆光剪影定格。 - **空镜三层纵深**:前景(脚边锈物、残破玩具、弹壳)+ 中景(人物或废弃建筑)+ 背景(巨物剪影 / 天际线 / 孢子天空)。用褪色海报、停摆的钟、半埋的日用品暗示崩塌前的日常,不用旁白解释。 - **战斗编排**:逐拍写清发起者、动作类型(劈 / 射 / 闪 / 格 / 擒)、空间方向(前冲 / 侧滚 / 后撤 / 跃起 / 攀爬);每一击写受力方向、位移、碎屑。攻击要有蓄力和收势,体力随战斗下降(喘息加重、汗血累积)。小队作战标注分工:牵制、输出、掩护、支援。开场用一个大远景交代地形,全程守 180° 轴线。 - **战斗节奏弧**:试探(0-1 次切换)→ 升级(2-3 次,中间插 1-2 秒对峙)→ 高潮(最密,甚至 0.5 秒闪切)→ 对峙收势(长静止镜头)。高潮后紧接 2-4 秒「以静衬动」:音乐骤停,只剩呼吸、风声或滴水。 - **重击瞬间微震**:命中时画面抖 0.1-0.3 秒后立刻稳住,力度分轻颤 / 明显震 / 剧震三档,不是持续手持晃动。 - **人 vs 异种**:异种的攻击无理性、多方向(触手绞杀、腐蚀黏液、六肢扑击、群围);人类靠地形卡位、打弱点(眼、关节膜、触手根)。伤势跨镜累积,不准「上一镜重伤下一镜完好」。 - **情绪公式**:起因 + 面部细节(瞳孔收缩、咬肌绷紧)+ 肢体(拳头发抖、肩膀垮下)+ 语气(哽咽、压低、停顿),四者方向一致。用微表情特写、手部特写、人物在巨大废墟中的占比来表达,景别从远推到近对应情绪逼近。 - **对话戏**:双人镜交代关系、过肩镜给情绪、关键台词推近;台词和真实意图不一致时切听者反应镜头。权力高的一方用俯拍压人,权力翻转时机位高度跟着变。3 轮以上对话景别逐步收紧。 - **悬疑段**:极慢推近未知物、声音先于画面出现异常、人物在画面里越来越小、越深入光越暗(标注起止光源)。 - **闪回**:去饱和暖黄旧胶片 / 柔焦光晕 / 收窄画幅加暗角,任选其一,进出用白闪渐变。 - 分镜表字段:镜号 / 时长 / 场景(四宫格哪一格)/ 叙事弧阶段 / 景别与机位高度 / 运镜 / 人物朝向(正 / 侧 / 背)/ 画面与动作 / 对白 / 声音 / 转场意图(动作剪辑、硬切、渐黑、叠化、白闪)。 ## 提示词写法 - 用户用中文时提示词主体写中文,风格锚点词保留英文。 - **图片提示词结构**:用途(三视图 / 四宫格)→ 主体外观 → 服装装备与磨损 → 光线 → 材质 → 风格锚点 → 构图与比例。 - 图片示例: ``` 全身角色三视图,正面|侧面|背面横向排列,统一光照与比例,16:9。年轻女性拾荒者,短发被汗黏在额头,半写实动漫脸,皮肤有毛孔和灰尘;深色贴身作战服、模块化战术背心、右臂机械外骨骼,护甲满是划痕、补丁和干涸血迹,高帮战术靴。cinematic 3D CGI, semi-realistic anime style, dirty realism, subsurface scattering skin, muted palette, neutral grey background. ``` - **视频提示词结构**:参考图绑定(图N 分别是谁 / 哪个场景)→ 「单一连续画面,禁止宫格分屏」+ 四宫格哪一格 → 上一镜视觉锚点(服装、光向、色温)→ 运镜 → 主体动作(具体部位、速度、力度)→ 空间与环境变化 → 声音(对白原文、音效)→ 负面约束。 - 背对镜头的镜头要在开头写明 rear view, back to camera,并描述背包、披风、背甲等背部特征,负面加 no turning around, no face visible。 - 速度用文字描述:「动作放慢到 0.3 倍,汗珠轨迹清晰」「骤停后瞬间爆发前冲」。 - 视频示例: ``` 图1 为角色三视图(使用背面视角),图2 为废土场景四宫格,镜头发生在左下格的断裂高架桥下。生成单一连续画面,禁止宫格或分屏。保持上一镜:暗灰作战服、右臂外骨骼、午后低角度暖光从画面右侧射入。手持跟拍,镜头低位贴近地面缓慢前移;角色背对镜头 rear view,沿裂开的公路走向远处的巨物剪影,背包上的天线随步伐晃动;风卷起沙尘穿过丁达尔光束。中途镜头缓慢上摇,露出半埋在沙里的褪色儿童三轮车。音效 <风穿过废墟的呼啸、碎石滚动、远处低频的巨物脚步>。no subtitles, no music, no turning around, no face visible. ``` ## 在 TVVV 上执行 - 三视图、四宫格、生物图都用 generate_image,默认 Nano Banana 2;需要片名卡上的精确中文字样时用 GPT Image 2。变体修改时把原图放进 reference_images 做图生图,保持一致。 - 视频用 generate_video,默认 Seedance 2.5、720p、16:9,单镜 5-10 秒(复杂段落可到 15 秒)。每个镜头的 reference_images 带上同一批 图N:角色三视图(按重要性,最多 5 个角色)→ 场景四宫格(1 张)→ 道具 / 生物,总数不超过 9 张,image_role 用 reference;需要严格接续上一镜时把上一镜末帧设为 first_frame。 - 生成前逐镜自检:场景图带了吗、角色图带了吗、对白完整吗、关键动作写进去了吗、参考图 ≤9 张吗。 - 旁白用 generate_speech:低沉、苍凉、带沙砾感的成熟声线,语速偏慢,句间留 1-2 秒;每 10 秒不超过约 30 个字;战斗段不加旁白,空镜和探索段是旁白的最佳位置。旁白不得复述同镜或相邻镜对白的意思,且时间上与对白错开至少 0.5-1 秒。 - 配乐用 generate_music:苍凉、压抑、史诗的管弦氛围,3 分钟以上可在转折点分段。 - 一次回复最多 4 次工具调用;资产一批、视频按场景段每批 3-4 镜,结果回来再继续。 - 交付清单:按镜号列视频与转场(战斗硬切 + 动作中途剪辑、情感叠化、章节渐黑停 1-2 秒、场景间用孢子 / 光束空镜衔接);对白和旁白时配乐压低到 -12 至 -15dB,高潮击杀落在配乐鼓点上;片头黑底渐显片名 2-3 秒,片尾留 3-5 秒拉远渐黑。提示用户在 TVVV 时间轴里完成剪辑与字幕轨,全片锁 24fps。 ## 注意事项 - **宫格被生成成视频**:场景四宫格作为参考时,模型可能直接输出分屏画面。每条视频提示词都写「单一连续画面,禁止宫格分屏」并指定哪一格。 - **背影被转成正脸**:视频模型爱把背对镜头的角色「纠正」成正面。开头声明背面视角 + 背部特征描述 + 负面约束三管齐下,且全文不出现「回头」「转身」。 - **镜间闪烁**:服装颜色、光向、伤势在镜头之间跳变。每条提示词都注入上一镜的锚点,跨场景的第一镜完整重述角色核心特征。 - **打成一团糊**:只写「激烈战斗」会得到看不清的乱斗。逐拍写攻防和空间方向,负面加 no floating combat, no rubber limbs, no teleport strikes, no weightless weapon swings。 - **风格漂成二次元或赛博霓虹**:提示词里别出现 anime cel shading、neon、clean、magic 之类词,始终带 dirty realism 和 muted palette。