Cheaper · 145 models · Invoices

See pricing
用这个 Skill 开始对话
沉浸式手持跟拍

沉浸式手持跟拍

手持呼吸感+过肩跟拍,做贴身、有临场感的写实电影短片

雨夜街头,女孩追上要离开的男友,两人在路灯下争吵,用手持过肩跟拍,30秒

下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。

# 沉浸式手持跟拍 适合想要「摄影师就贴在角色身边」那种临场感的写实短片:跟着主角走过街道、穿过门、上楼梯、在路灯下吵架,镜头有呼吸、有脚步起伏、有惯性回弹。默认交付 6-10 个镜头、30-60 秒的横屏写实短片,带对白和环境声,默认无字幕、无配乐(用户要可以加)。 ## 开工前确认 - 需要的东西:剧本或一句创意;有角色照片最好(锁定长相),没有就由 AI 根据描述生成角色。有声音样本可以用来统一角色音色。 - 用 ask_user 一次只问一个问题,按优先级: 1. **过肩跟拍模式**是否开启(默认开):镜头贴在主角身后略高于肩,主角的肩/后脑做虚化前景。 2. **伪一镜到底**是否开启(默认关):开启后减少切镜,用动作匹配、眨眼黑场、穿门跟随来衔接。 - 其余默认:16:9、无字幕、无配乐,用户主动改才改。 - 角色照片里的「好看」「帅」要转成具体描述(高鼻梁、下颌线清晰、额头细纹、雀斑位置),后面每个镜头都靠这些描述加参考图锁脸。 ## 制作流程 1. **项目设定** —— 小表格:片名、画幅、时长、语言、风格(写实电影手持)、过肩模式开/关、伪一镜到底开/关、字幕/配乐开关。 2. **角色身份板** —— 每个角色出一张身份板:左半边四视图(正/左/右/背全身),右半边 2×2 四个微表情特写(平静/微笑/难过/紧张)。两三个角色可以并排出一张对比板,看清身高体型差。**停下等用户确认长相。** 3. **分镜表** —— 把剧本拆成镜头:动作、运镜、情绪强度、光源方向、对白节拍、道具状态、结尾衔接点。**停下等用户确认分镜、时长与运镜设计。** 4. **场景与道具参考** —— 场景氛围图、需要跨镜头追踪的道具(雨伞、手机、信封、戒指)白底多角度图;道具状态会变就每个状态各出一张。 5. **逐镜生成视频** —— 每批 2-3 镜,回来检查角色一致性、光向、动感,再继续。 6. **配音与音效(按需)** —— 视频模型同步对白不理想时单独生成对白,叠到时间轴上。 7. **交付** —— 交付清单 + 剪辑质检要点。 ## 风格锁定 - 每个视频提示词开头都带:`hyper-realistic cinematic handheld footage, film grain, real skin texture with pores, no skin smoothing, natural depth of field, 24fps`。 - **光线写实**:跟着场景走——白天自然光、阴天漫射、普通室内灯、夜街路灯与霓虹,不要硬套蓝橙对比调色。每个镜头写清主光方向,精确到「画面左后方 45°」这种程度,不要只写「侧光」「逆光」。 - **同场景锁光**:第一次定下主光方向后,同场景后续镜头逐字沿用;剧情里换光(从室外进室内)要在分镜里显式标出切换点和新参数。 - **人景融合**:人物肤色与服装色温跟环境一致(暖光下偏暖、冷夜景下偏冷),脚下影子方向与光源一致,湿地面要有倒影,不能有抠图感。 - **背景人群是活的**:街上的人各走各的方向、停下拍照、看手机、等车、骑车;咖啡馆里端盘子、喝咖啡;教室里低头写字、转笔、打哈欠。不同人穿着不同,不能复制粘贴,不挡主角、不跟主角互动。 - 情绪与场景气氛对应:压抑选阴天/雨夜/昏暗室内;温暖选阳光或傍晚路灯;悬疑选单侧光的走廊楼梯;日常选白天自然光。 - **必须避免**:固定机位(哪怕静止场景也要有呼吸微晃)、纯色背景、虚拟棚、CG 质感、塑料皮肤、动漫风、肢体穿模、无惯性滑行、关节反折。 ## 分镜与镜头规则 - **禁止写「固定镜头」**。静止画面写成「呼吸式微晃」。每支短片至少用到下面 4 种运镜: - 手持跟随:跟着脚步上下起伏,略滞后于人物,有物理跟随感。 - 慢推/慢拉:情绪推进或视觉收束,速度慢且匀。 - 甩镜:视线转移或突发事件,快速扫过环境带短暂动态模糊。 - 环绕:内心冲突或两人对峙,慢速绕人物画弧。 - 急推:震惊或情绪突变,一次短促快速推近。 - 惯性回弹:运镜急停或变向时带一点过冲再回正。 - 过肩跟拍(过肩模式开启时必用):镜头在主角身后略高于肩,肩/背/后脑做虚化前景,转弯时有轻微离心外甩再修正;前景不能挡住主角的脸。适合走路、跑、穿门、上楼、转身。 - **情绪驱动运镜,不能反过来**:情绪弱(压抑、内敛)用慢推、呼吸微晃、过肩跟随;情绪中(动摇、对峙开始)用环绕、加快跟随;情绪强(爆发、崩溃)用急推、甩镜。情绪跨级时运镜同步升级;不能为了用急推而硬造一个震惊点。 - **景别不能连续重复**:按「远景(交代环境)→ 全景 → 中景 → 中近景 → 特写」组织镜头组;对白里同景别正反打(中景 A → 中景 B)也禁止。 - **伪一镜到底**(开启时):每段长镜 10-15 秒,必要时分成两三段生成后用尾帧接首帧。高潮段给最长时长,开头结尾压短,形成「慢起—紧张加速—平静收尾」。每段内部有三层节奏:开场呼吸微晃建立空间 → 中段核心动作、运镜频率提高 → 结尾急推/甩镜到情绪顶点,或用惯性回弹引出下一镜的衔接动作。单段内运镜类型不超过 3 种。衔接只用三种:动作匹配(抬手 → 切手部特写)、眨眼黑场、跟着主角穿过门窗走廊。 - **对白节奏绑定运镜**: - 「……」短停:推进放慢但不停,脚步起伏周期变长。 - 「——」长停:运镜停下转成极轻的呼吸感,「屏住呼吸」等下一句;下一句情绪升级就用惯性回弹重新起步。 - 哽咽/吸气:停顿中镜头重心微沉,停完回正。 - 关键词(名字、转折词、否定词「算了」「别」「走」)出口的同一帧运镜达到峰值;最高点的单字(「滚!」「留下!」)配甩镜,甩完回正时人物正好完成动作。 - **多人对白切镜**:在下一位开口前一瞬就切过去并稳住;上一句尾音可以拖进下一镜。平静对话等对方快说完才切;争执时对方说过一半就切;爆发时允许在台词中间切,配甩镜或急推。每段对话至少 1-2 个反应镜头,写具体微动作(嘴角收紧、视线下垂又抬起、喉结滑动),不能写「默默看着」。对白段至少用两种机位:正反打、过肩、慢环绕、推拉、双人镜头。 - **情绪拆成生理表现**:不写「生气地说」,写成「[面部+身体+声音] + 台词」,例如「眉头压低、鼻翼张开、声音压低一字一字砸出来:你走吧。」一句里情绪转变就分两段写,中间放一个可见的过渡(叹气、视线下落)。 - **动作要物理真实**:大动作写出「起步 → 加速 → 匀速 → 减速收住」,落地膝盖微屈有重量感;转身写衣摆甩动方向;握伞、拥抱写清接触点状态,避免穿模。 - **道具状态追踪**:出现 2 次以上、会变状态或有象征意义的道具单独成卡,写清外观、初始状态和「镜 N → 状态」表;每个含道具的镜头开头先写道具当前状态(「右手握着已经撑开、伞面挂满雨水的黑伞」)。 - **每镜结尾写衔接提示**:人物最后的位置、朝向、动作,给下一镜接。 - **分镜表字段**:镜号 / 时长 / 景别 / 运镜 / 情绪强度 / 主光方向与色温 / 画面动作 / 道具状态 / 说话人与台词 / 对白节拍(T+秒)/ 声音 / 衔接提示。 ## 提示词写法 - **身份板图片结构**:版式(16:9、纯白背景、左四视图右 2×2 表情)→ 外貌具体描述 → 服装 → 皮肤细节(毛孔、胡茬、法令纹,不磨皮)→ 光源(身份板默认均匀柔光)→ 负面(no anime, no CG, no text)。 - 图片示例: ``` 16:9 landscape character sheet, pure white background, photorealistic cinematic photo. Left half: front, left, right and back full-body views on one ground line. Right half: 2x2 close-ups of calm, smile, sad, nervous expressions. 25-year-old East Asian woman, shoulder-length straight black hair, single eyelids, small mole under left eye, beige wool coat over gray knit, dark jeans, white sneakers. Visible skin pores, no smoothing. Soft even diffused light. No anime, no 3D, no CG, no text, no watermark. ``` - **视频提示词结构**:画质基准 → 运镜轨迹(开头就写)→ 主体动作与生理反应 → 场景与光线(含主光方向、色温、人景融合句)→ 背景人群三层(前景虚化、中景可辨、远景动态人群)→ 声音与对白 → 负面。 - 对白节奏要写进运镜描述里,不要单列时间码,例如「推进匀速,在第一句末尾的停顿处放慢,停顿结束后恢复」。 - 视频示例: ``` Hyper-realistic cinematic handheld footage, film grain, real skin pores, 24fps. Over-the-shoulder follow shot from just behind 图1's right shoulder, slightly above shoulder height; her blurred shoulder in the foreground, camera bobbing with her quick steps. She catches up with the man under a streetlight, grabs his sleeve; he turns. Camera slows its push-in as she pauses, then surges with a slight overshoot at the word "别走". Rainy night street, cold blue streetlight from back-left 45°, warm neon rim on her cheek, wet asphalt reflections, shadows consistent. Background passersby with umbrellas walking in different directions, slightly blurred. She says, voice cracking: "你……别走。" <rain hitting umbrellas>, <her quick breathing>. No music, no subtitles, no limb clipping, no floating, no plastic skin, consistent lighting direction. ``` ## 在 TVVV 上执行 - 身份板、场景氛围图、道具图用 generate_image,默认 Nano Banana 2;用户给了照片就作为参考带上。 - 每个镜头 generate_video:reference_images 带角色身份板图N(必须带,不能只靠文字)、场景图N、该状态的道具图N,image_role 选 `reference`;需要动作连续(伪一镜到底、动作匹配)时,把上一镜最后一帧作为下一镜的 `first_frame`。 - 默认视频模型 Seedance 2.5,720p,16:9,单镜 5-10 秒。 - 对白写进视频提示词让模型同步口型;特写要强调 precise lip-sync, natural lip closure,并写「只有某某说话,其他人闭嘴只做微反应」。模型对白不清或音色不稳时,用 generate_speech 按角色固定音色单独生成,再叠到时间轴。用户要配乐才用 generate_music,并在甩镜、急推的时间点卡拍或骤停。 - 每次回复最多 3 次工具调用:身份板一轮、场景道具一轮、之后每批 2-3 个镜头。 - **交付清单**:按镜号列视频、剪辑顺序、对白与音效位置。提醒用户在 TVVV 时间轴剪辑时检查:相邻镜头光向是否跳变、角色发型服装道具是否一致、是否越轴、对白是否在下一位开口前就切到、反应镜头是否过长;对白放最上轨,镜头间对白留极短间隙,环境声按画面对齐并做自然淡入淡出。 ## 注意事项 - **画面太稳**:模型常把手持生成成稳如三脚架。提示词里写 handheld breathing micro-sway, footsteps bobbing, slight inertia lag;剪辑时仍太平就轻微放大裁切后加一点平滑抖动。 - **长相漂移**:每个镜头都必须带身份板参考图,并在提示词里重复发型、服装关键状态。 - **光向乱跳**:同场景每镜逐字复用同一句主光描述;不同就会出现「上一镜光从左边、下一镜光从右边」。 - **不该说话的人在动嘴**:多人镜头必须写清谁说话、其他人闭嘴;特写口型不对就重出。 - **穿模和滑行**:拥抱、握物、转身写清接触点和惯性;出现肢体穿过身体或道具,换个描述重出,不要硬留。