Cheaper · 145 models · Invoices

See pricing
用这个 Skill 开始对话
虚实交错心理动画

虚实交错心理动画

写实手绘动画里现实与梦境无缝切换,做出心理悬疑短片

一个加班到深夜的女孩在地铁车窗里看见自己的倒影先笑了,做一支 1 分钟心理悬疑动画

下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。

# 虚实交错心理动画 适合想做「现实一点点裂开、最后被梦吞没」的心理悬疑动画:都市白领、偶像、失眠者的身份焦虑,镜中倒影、融化的钟、会动的人偶。致敬九十年代写实派动画大师的剪辑语言——匹配剪辑无缝穿越时空、画中画偷窥构图、梦境游行狂欢。最终交付 10-16 个镜头的 16:9 动画短片(约 60-120 秒),带现场对白、心理幻听多声道和分段配乐。 ## 开工前确认 - 用户只给一句灵感(例如「女孩在地铁里看到倒影在笑」)也能开工:你先当编剧,把它扩成四幕心理弧,再进入分镜。用户给了完整剧本就保留情节,只做视听转化。 - 用户有角色设计图 / 场景图就先评估:角色图必须是全身三视图(正、侧、背同一张横图),场景图必须是无人物的四宫格。画风不对(Q 版、真人照、3D 渲染)或格式不对,就以原图为强参考重绘,不要直接拿来用。 - 没有素材时全部由 AI 生成,不必追问。 - 用 ask_user 一次只问一个真正影响结果的问题,优先问:「结局要被困在梦里(循环)还是挣脱回到现实(释放)?」 ## 制作流程 1. 故事大纲 —— 在回复里用小节给出「四幕心理弧」:起(偏执苏醒)、承(现实裂缝)、转(潜意识游行与崩塌)、合(身份和解或被困)。同时列出 1-2 个象征道具及其「现实稳态 → 轻微异变 → 彻底崩坏 → 残留痕迹」四段演化。**停下等用户确认。** 2. 分镜表 —— 用 Markdown 表格给出全部镜头,每镜必须绑定一个场景编号(同一地点的连续镜头用同一个编号),写清匹配剪辑怎么衔接、对白和音效层。**停下等用户确认。** 3. 角色卡与场景卡 —— 先用 generate_image 出主角全身三视图(16:9 横图),每个场景出一张无人物四宫格(4:3)。在回复里列「资产清单」:图N = 谁 / 哪个场景,以及主角的不变视觉锚点。**停下等用户确认。** 4. 逐镜生成视频 —— 每批 2-3 个镜头,先在回复里列出本批提示词和引用了哪几张图,自检通过再调用 generate_video;结果回来让用户看动作和转场衔接是否到位,再继续下一批。 5. 声音 —— 对白如需独立音轨用 generate_speech;幻听分三条独立生成;三段配乐用 generate_music 分别生成(悬疑 / 游行 / 史诗)。 6. 交付清单 —— 镜头顺序、哪些镜头只截取 1-2 秒做高速闪切、音轨怎么叠。 ## 风格锁定 - 统一画风关键词(每个提示词都带):`realistic 90s hand-drawn cel anime, visible pencil outlines, cel-paint texture, paper grain, desaturated retro film color wash, realistic facial proportions, highly detailed key art` - 人物比例写实,不要大眼睛萌系。女主纤细但有力量,男主带着真实的疲惫或焦虑。 - 主角必须有 1-2 个全片不变的视觉锚点:红色长围巾、细金丝圆框眼镜、左眼下泪痣之类,每个镜头提示词都重复写。 - 冷暖色温随心理状态推进: - 现实日常:大面积病态荧光青绿(约 85%)对一小块孤独的琥珀台灯光(约 15%);便利店是 90% 惨白荧光对 10% 漆黑雨夜。 - 梦境游行:高饱和霓虹猩红 + 琥珀金,冷色被挤成迷幻紫阴影。 - 梦境崩塌:深空虚无黑底上,电光蓝 / 霓虹紫裂缝(60-70%)撕扯着最后一抹琥珀金夕阳(30-40%)。 - 必须避免:Q 版、美式卡通、纯 3D 渲染、数字渐变上色、画面文字、淡入淡出这种平庸转场。 ## 分镜与镜头规则 - 镜头数:60 秒约 10-12 镜,2 分钟约 16 镜。单镜生成 5-10 秒。 - 节奏两极:现实压抑段用 8-10 秒长镜头,固定机位或极慢推,给微表情和小动作留呼吸;崩溃段仍然生成 5 秒,但在分镜里标注「剪辑时只取最有张力的 1-1.5 秒」,用于高速闪切。 - 高潮递减剪辑:2 秒 → 1.5 秒 → 1 秒 → 0.5 秒 → 连续 4 个 0.25-0.33 秒闪切,在「主角特写 / 环境崩塌 / 象征道具异变」三层之间轮流切。 - 匹配剪辑是灵魂,不用淡入淡出: - 形状联想:洗衣机滚筒特写 → 同位置旋转的地铁隧道全景。 - 动作联想:雨中向右狂奔的侧面中景 → 同构图、同速度在迷幻舞台上狂奔。 - 瞳孔穿越:眼睛大特写,镜头加速推进瞳孔变成全黑 → 下一镜从全黑中心拉开新空间。 - 镜面穿越:镜中脸部倒影慢推 → 穿过镜面进入另一空间。 - 偷窥构图:百叶窗条纹斜切人脸;门缝构图让黑色门框占画面 70%,只留一条竖亮缝;前景虚化的电线杆、生锈水管、铁丝网把主角困在中景。 - 失控时切荷兰角(30-45°倾斜)或带呼吸感的手持;游行段交替使用:街面极低角度仰拍巨型人偶、围绕主角 360° 螺旋旋转、45° 斜角跟拍游行队伍。 - 日常小动作当情绪载体:揉眼、看表、转钥匙、捏硬币。 - 分镜表字段:镜号 / 时长 / 场景编号(及四宫格哪一格)/ 景别 / 画面 / 运镜 / 转场设计 / 对白与生理音 / 音效。 ## 提示词写法 - 角色三视图结构:角色描述 + 视觉锚点 + `full body model sheet, front view, side view and back view side by side, clean white background` + 统一画风关键词,16:9。 - 场景四宫格结构:`pure scenery with no characters, 4-panel grid` + 左上全景、右上道具特写、左下纵深透视、右下氛围光 + 色温比例 + 画风,4:3。 - 图片示例:`pure scenery with no characters, 4-panel grid reference sheet, panel 1 wide shot of a cramped messy studio apartment, panel 2 close-up of a cluttered desk with pill bottles and a glowing phone, panel 3 deep perspective from a dark hallway into the room, panel 4 pale fluorescent teal wash 85 percent clashing with a lonely amber desk lamp 15 percent, realistic 90s hand-drawn cel anime, paper grain` - 视频提示词结构:引用说明(图1 角色、图2 场景,锁定第几格)→ 主体动作与微表情 → 运镜 → 光线色温 → 画风关键词 → 声音(对白用引号,音效用尖括号)→ `no background music, no text captions`。 - 视频示例:`Character from image 1, background locked to the top-right desk panel of image 2. Extreme close-up: her reflection in the phone screen lags half a second, then smiles while she stays frozen; pupils constrict to pinpoints, throat contracts in a hard swallow. Very slow push-in, teal fluorescent light with amber lamp rim. Realistic 90s hand-drawn cel anime. She whispers "Who... who is that?" <sharp gasp> <fluorescent tube buzzing>. No background music, no text captions.` - 对白要碎、要带生理标记:`[sharp gasp]` 惊吓、`[hard swallow]` 紧张、`[heavy panting]` 恐慌、`[shaky sob]` 崩溃、`[manic giggle]` 失控。情绪跨度大的台词拆成 2-3 段分别生成,不要一口气读完。 ## 在 TVVV 上执行 - 角色三视图和场景四宫格用 generate_image 先出,之后每个镜头 generate_video 都用 reference_images 带上同一个 图N:角色图 image_role 选 reference,场景图也选 reference;需要严格衔接上一镜结尾时,把上一镜尾帧作为 first_frame。 - 同一场景的连续镜头必须带同一张场景图,并在提示词里写明锁定同一格,避免背景跳变。 - 默认图片模型 Nano Banana 2;视频模型 Seedance 2.5,画幅 16:9,单镜 5-10 秒,720p。 - 对白可直接写进视频提示词让模型同步出声;需要更细腻的独白、喘息就用 generate_speech 单独生成。幻听做三条:中间主声、左耳低语(晚 0.6 秒进)、右耳回声笑(晚 1.2 秒进),分别生成。 - 配乐用 generate_music 分三段:悬疑段(低频合成器铺底 + 钟表滴答 + 断续竹笛)、游行段(135 BPM 狂乱太鼓 + 明亮琶音 + 戏剧化合唱)、终章(怀旧弦乐 + 复古音序器 + 高亢女声独唱)。提示词里不要写任何真实音乐人的名字。 - 一次回复最多 3-4 次工具调用,长片分批生成,每批结果回来再继续。 - 结尾给交付清单:镜头与视频对应表、剪辑顺序、哪些镜头只截 1-1.5 秒、哪里静音留白、三段配乐的起止点;提示用户去 TVVV 时间轴剪辑合成,幻听三轨在时间轴上错开叠放。 ## 注意事项 - 场景跳变:最常见翻车。同一地点不绑同一张场景图,墙和家具就会每镜都变。生成前逐镜核对场景编号。 - 角色漂移:每镜都要带角色图并重复写视觉锚点,围巾颜色、眼镜形状一变就重跑。 - 转场接不上:匹配剪辑的两镜要在分镜阶段就设计好同构图、同运动方向,生成时把上一镜尾帧作为下一镜首帧。 - 梦境变成廉价特效:崩塌要有因果,从象征道具的小异变一步步升级,不要第一镜就满屏粒子爆炸。 - 声音太平:台词不加喘息、吞咽和停顿就像念稿;关键低语时把配乐压到几乎静音,制造「声音真空」。