
猫咪替你重温人生
猫的身体演人的处境,做一集能让人@朋友的治愈系列短片
做一集猫咪短片:三只猫替我们重温毕业季,教室、天台、最后一次合照
下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。
# 猫咪替你重温人生
适合做可连载的萌宠情感系列:猫的身体是可爱载体,人的处境是剧情来源,集体情绪是传播引擎。每集从一个「人的情绪」出发——毕业、加班、回老家、和爸妈告别——让猫咪演出来,看完的人会想 @ 某个具体的人。最终交付一集 30-60 秒的 9:16 竖屏真实感短片:3-6 个场景、6-10 个镜头(单镜 5-10 秒),配情绪 BGM、猫叫音效和口语化对白字幕。
## 开工前确认
- 需要用户提供:这一集想打的情绪或主题。没有就给 3 个选题让他挑,每个写成一句 logline:「猫咪替我们重温 ____。」
- 角色:用户有自家猫照片就用他的猫做主角;没有就用默认角色阵容(见下文)。
- 系列化:问是不是要做成系列。是的话角色卡定下来后全系列不变。
- 用 ask_user 一次只问一个,第一问通常是「这一集打哪种情绪:怀旧 / 想家 / 委屈 / 治愈 / 团圆?」
## 制作流程
1. **选情绪 + 选处境** —— 在回复里给出「项目设定」:集体情绪标签、对应的人类处境(童年 / 校园 / 职场 / 回家…)、logline、时长、9:16、语言。停下确认。
2. **拆场景 + 猫化翻译** —— 把处境拆成 3-6 个记忆锚点,每个锚点翻译成猫能演的具体动作场景,给出角色卡和分镜表。停下等用户确认镜头表。
3. **角色与场景设定图** —— 每只猫一张左侧头肩特写、右侧全身的横版参考图;关键场景各一张。停下确认。
4. **逐镜生成视频** —— 按镜头表顺序分批生成。确认。
5. **配乐与对白** —— 生成情绪 BGM,整理对白字幕稿和猫叫音效位置。确认。
6. **交付清单** —— 按三层结构给剪辑节奏,结尾留下一集钩子。
## 风格锁定
- 全片真实感:realistic photography, real cats, natural light, real-world settings, non-cartoon, no 3D animation。
- 光线色调随情绪:怀旧用午后暖阳和略褪色的暖调;想家用黄昏和窗边光;治愈用柔和晨光;委屈用阴天冷灰再在结尾给一束暖光。
- 道具按猫的体型缩放:「一个猫爪宽的玻璃汽水瓶」,而不是「一个玻璃瓶」。
- 人类出场不露脸:「爸妈」这类主人角色只用三种方式出现——主观视角、从画外伸进来的手、背影。公共场合的路人、服务员、老师可以是正常人类,猫可以和他们互动。
- 禁止:卡通化、拟人站立成常态、旁白式抒情字幕、刻意煽情。
## 分镜与镜头规则
- **创作公式**:猫的身体 × 人的处境 × 集体情绪,三者缺一不可;选题永远从「人」出发,猫只是演员。检验标准:这条能不能让人 @ 一个具体的人。
- **三层结构**,每层都要有:
- 萌点层(视觉钩子):开头 0-5 秒用最可爱或最反差的画面抓住人,并在全片持续撒萌点;开场平淡等于留存暴跌;
- 剧情层(拟人情节):占全片 60-70%,用 3-6 个场景的蒙太奇把人的处境翻译成猫的动作,不能只是流水账;
- 走心层(情绪共鸣):最后 10-15% 收尾升华,一句对白或一个空镜,把情绪还给观众;解释过多就会从「泪目」变成「尴尬」。
- **场景锚点要一眼认得出**:玻璃瓶汽水、跳房子、老式冰棍、满天星的天台、教室黑板、绿皮火车车窗;每个镜头都要有「场景地点」字段,直接写进提示词。场景数 3-6 个,多了节奏会散。
- **动物行为底线**:默认是自然猫行为——四脚走路、打哈欠、踩奶、甩尾巴、蹭人、趴窗台。穿衣服、开冰箱、用道具这类拟人动作,只在剧情明确需要的那一镜写出来;拟人但不去猫性。
- **角色卡三件套**:外形标志(视觉商标)+ 性格标志(一个稳定的小缺点比十个优点好用)+ 关系标志(和其他角色固定的关系线)。默认阵容可以这样起:
- 元宝:戴黄色渔夫帽的橘猫,主角,爱操心的大哥;
- 橘白:橘白花纹的小猫,年纪最小,什么都要问;
- 卷卷:卷毛猫,慢半拍,总在关键时刻睡着。
- **语言系统**:角色用自然的喵叫交流,字幕写成对白而不是旁白;对白要孩子气——短句、口语、有点傻。例:橘白:「喵?毕业是什么?」情绪不直说,让它从互动和画面里漏出来;最重的那句留给角色在结尾小声说,或者干脆留白,让评论区替观众说。
- **结尾钩子**:最后 2-3 秒给下一集留钩子:定格 + 一句问题字幕,或角色动作戛然而止。
- **分镜表字段**:层次(萌点 / 剧情 / 走心)/ 镜号 / 时长 / 场景地点 / 画面动作(标注自然行为还是拟人动作)/ 运镜 / 对白字幕 / 音效。
## 提示词写法
- **图片提示词**:一整段自然语言「主体 + 动作 + 场景地点 + 光线色调 + 构图」,不要写成标签列表。角色外貌靠参考图锁定,正文不要重复描述外貌,否则容易漂。
- 示例:图1 sits on an old wooden school desk by the window, front paws tucked in, gazing at a chalkboard covered in farewell doodles, a glass soda bottle the width of a cat's paw beside it, warm late-afternoon sunlight with floating dust, nostalgic slightly faded warm tones, realistic photography, low eye-level close shot, shallow depth of field.
- **视频提示词顺序**:运镜 → 主体动作(保留猫的本能)→ 空间与环境变化 → 音效和对白标记 → 结尾 no music, no subtitles。每只猫一个独立的参考图编号;人类只写看得见的部分(画外伸来的手、背影)。
- 示例:Slow push-in, low eye-level. 图1 and 图2 sit side by side on a rooftop edge at night, 图2 nudges 图1 with its head and kneads the concrete, 图1 flicks its tail and looks up at the stars; a human hand reaches in from off-camera and sets down two tiny paper party hats. Location: old apartment rooftop, string lights, city glow far below, cool night air with warm bulbs. <soft cat meow>, 图2: "喵?明天还能一起看吗?" realistic photography, no music, no subtitles.
## 在 TVVV 上执行
- 用 generate_image 为每只猫出一张横版参考图(左头肩特写,右全身带标志道具),关键场景各一张,编号图1、图2…;默认 Nano Banana 2,需要画面里出现精确文字(黑板字、车站牌)时用 GPT Image 2。用户上传的猫照片直接作为参考图使用。
- 每镜用 generate_video,reference_images 带上本镜所有出场猫的同一个图N,加场景图,image_role 选 reference;与上一镜动作强连续时,从上一镜截帧作 first_frame。默认 Seedance 2.5、9:16、720p,单镜 5-10 秒。
- BGM 用 generate_music,情绪对齐本集标签(nostalgic、healing、warm、longing),走心段落留出可淡出的尾巴。不做旁白;对白以字幕形式在剪辑时加,猫叫由视频音效生成。
- 一次回复最多 3-4 次工具调用,先设定图,再按层次分批生成镜头,每批确认后继续。
- 交付清单:按三层排好镜号顺序;第一镜直接进画面,不要黑场和片头 logo;剧情层场景之间用短暂黑场或叠化;走心层 BGM 降到 60-70% 或淡出,最后一个情绪镜头多留 0.5-1 秒,字幕淡入、停留到读得完再淡出到黑;最后 2-3 秒放下一集钩子。提示用户去 TVVV 时间轴剪辑合成。
## 注意事项
- **只有可爱没有故事**:三层结构缺剧情层就变成普通萌宠 vlog,分镜阶段先检查每个场景翻译的是哪个人类处境。
- **猫全程站着走路**:拟人动作只在需要的镜头写,其余默认自然行为,否则会显得诡异。
- **主人露脸**:提示词只写手和背影,避免出现一张随机生成的人脸。
- **字幕变成鸡汤旁白**:对白必须是角色说的短句,不写抒情旁白。
- **角色每集长得不一样**:系列化时每镜都带同一张角色参考图,外形标志(黄色渔夫帽)写进角色卡。