Cheaper · 145 models · Invoices

See pricing
用这个 Skill 开始对话
县城纪实短片

县城纪实短片

用固定长镜头和环境声,拍出新旧并存的中国县城人间小事

一个返乡青年在拆迁中的老汽车站等末班车,犹豫要不要再回城里打工,做 1 分钟纪实短片

下面是这个 Skill 的完整创作流程,每轮对话都会完整给到 Agent。

# 县城纪实短片 适合社会纪实、独立文艺短片:县城青年、打工者、下岗工人、返乡者、小镇商贩的一件具体小事。不是拍灰暗破败,而是观察现代化、迁徙、消费文化冲刷下新与旧怎么在同一个画面里别扭地共存。致敬中国第六代导演的纪实美学。最终交付 6-12 个镜头、30-90 秒的 16:9 短片,只有环境声和现场方言碎片,默认无配乐、无旁白、无字幕。 ## 开工前确认 - 先判断用户给的是什么: - 完整剧本:保留人物、事件顺序、对白和结局,只调整镜头、表演、环境细节和声音;要动情节先提建议、等确认。 - 故事梗概:补足场景和可见动作,保留核心冲突和结局。 - 一句话想法:按本 skill 的规则扩成完整小故事。 - 什么都没有:请用户一句话描述一个场景,例如「一个年轻人在手机店门口等消息」。 - 用户有人物照片就提取脸型、肤色、发型、衣着磨损程度;照片有明显磨皮美颜,后续生成时要往真实质感纠正。 - 用 ask_user 一次只问一个问题,最关键的是节奏:A 慢(固定长镜头 ≥70%,单镜 8-10 秒)/ B 中(手持与固定各半,单镜 5-8 秒,默认)/ C 快(2-4 秒短切,会削弱纪实感,选它要再确认一次)。 ## 制作流程 1. 故事梳理 —— 在回复里给出「人物 / 任务 / 时代线 / 去留选择 / 结尾动作」五项摘要。**停下等用户确认。** 2. 节奏与总时长 —— 确认节奏档、运镜偏好(手持为主 / 固定为主 / 混合,默认混合:人走动时手持、静止时固定)和总时长(默认 30 秒,可 10-180 秒),给出预估镜头数。 3. 分镜表 —— Markdown 表格列出全部镜头,标出「观察镜头」「同框镜头」和流行文化声源。**停下等用户确认。** 4. 人物参考图 —— 只给出现两个镜头以上的主要人物出图:一张全身(在真实的街边、楼道、空地,不要白底影棚),一张正面半身近景。路人和背景人群不出图。多个人物一次性出完一起确认。 5. 逐镜生成视频 —— 每批 2-3 镜,带上人物图,环境声直接写进视频提示词。全部出完让用户预览。 6. 交付清单 —— 剪辑顺序、硬切位置、环境声层次。 ## 风格锁定 - 统一风格关键词:`documentary realism, real Chinese county town, natural on-site light, original colors of real objects, soft edges, handheld or fixed camera, no beauty filter, no cinematic color grading` - 光线一律来自现场:阴天、晴天硬光、室内窗光;夜里用路灯、店铺灯、车灯、电视、KTV 霓虹、手机屏。人物和环境共享同一光源,不给人物单独加轮廓光。允许局部过曝和偏色。 - 整体中低饱和,但招牌、塑料商品、廉价潮服、演出服可以保留局部高饱和——不要把所有鲜艳的颜色统一调灰。 - 媒介质感按故事年代选一种贯穿全片:九十年代用轻微胶片颗粒和有限宽容度;两千年初用轻微 DV 噪点和数码高光;当代县城用干净数码画面,不加复古滤镜。 - 必须避免:磨皮美颜、精致布景、广告大片调色、稳定器丝滑运镜、无人机航拍、为了风格硬塞「掉漆墙、锈铁门、晾衣服」。 ## 分镜与镜头规则 - 景别以远景、全景、中景为主,人和空间同时可见。人物不必居中,可以在画面边缘、门框里、街道深处、别人的活动中间。路人、车辆、店铺营生进入画面是真实的一部分,不要清掉。只有当某个动作或物件真正改变人物处境时才用特写。 - 机位以平视为主。固定长镜头完全不动或极慢横摇,让人物自己走进走出;手持跟拍带轻微、无规律的晃动。 - 默认单镜 6-10 秒,固定长镜头不少于 6 秒,不用 4 秒以下的快切。 - 双线叙事:人物线是一个具体、日常、看得见的任务(找人、等车、取钱、卖旧物、送东西、决定离开),必须是动作不是情绪;时代线是空间里正在发生的变化(拆迁、新楼盘、工厂停产、连锁店进驻、交通变化),通过建筑、交通、广告、广播自然入画,镜头不解释。 - 同框镜头:全片至少一个镜头让人物的小动作和时代变化在同一构图里。例如人物等车时,老车站的招牌正被拆下;人物在屋里修电扇,远处新楼盘的广告喇叭一直在响。 - 观察镜头:全片至少一个 8-10 秒(可多段拼到 30 秒)的镜头同时满足四条——主角在完成具体动作、背景有路人或车或广播、画面里有一条时代信息、镜头静止不推不拉无旁白。 - 新旧并存:每个主要场景至少有两个时代的痕迹,例如老家具上的智能手机、墙上旧标语和门口新广告、方言广播和不知哪里传来的短视频声。 - 流行文化刺入现实:全片至少一处来自画面内部的流行声源——KTV 歌声、店铺喇叭、婚礼音乐、车载电台、手机铃声、广场舞——和人物处境形成反差,镜头不强调。 - 允许俗气、幽默和尴尬:人物认真地做一件有点荒诞的事,比通篇沉重更像生活。 - 可选:全片最多一次克制的超现实事件(远处楼房缓缓升起、不明飞行物划过天空),人物照常反应,之后继续日常,不解释。 - 结尾:人物必须完成一个看得见的选择——上车、留下、交出钥匙、删掉号码、带走一件东西、独自返回。不用空镜和凝视代替。 - 三幕比例参考:开场环境建立 25%、人物状态 50%、时代留白 25%。 - 分镜表字段:镜号 / 时长 / 景别构图 / 人物动作 / 时代元素 / 运镜 / 现场光 / 环境声 / 标记(观察镜头、同框镜头、流行声源)。 ## 提示词写法 - 图片提示词结构:风格前缀 + 人物(年龄、职业、衣着颜色与磨损、发型、肤质)+ 真实场景 + 现场光 + `no skin smoothing, no beauty filter, skin texture preserved` + 禁止项(文字标签、白底影棚、多人拼贴)。 - 图片示例:纪实摄影风格,中国县城真实场景,保留物件原色。四十多岁男人,洗褪色的藏蓝工装,寸头,脸上有晒斑和皱纹,站在老家属楼楼道口,身后墙上贴着新楼盘传单,阴天漫射光,全身,皮肤纹理保留,不磨皮,无文字。 - 视频提示词结构:风格前缀 → 运镜(固定长镜头 / 手持轻晃)→ 景别与构图(人物偏画面一侧,大面积环境留白)→ 人物动作(慢、日常、不表演)→ 环境细节与时代元素 → 现场光 → 环境声(尖括号)→ 固定负面词。 - 视频示例:纪实风格,16:9,中国县城真实场景,保留现场原色,柔和边缘,无美颜,无稳定器质感。固定长镜头。全景,图1 中的男人在画面左侧,蹲在老汽车站门口数一沓零钱,右侧大面积留白,工人正在拆站名招牌,一辆电动三轮车从前景驶过,阴天漫射光。<远处电钻声,方言吆喝声断续,车站喇叭播放模糊的到站广播>。no music, no subtitles, no lip sync, no drone shot, no beauty filter, no cinematic lighting。 - 视频提示词里不要出现:精致、高饱和、鲜艳、滑轨、稳定器、航拍、口型同步、字幕。 ## 在 TVVV 上执行 - 人物参考图用 generate_image 先出,后面该人物的每个镜头 generate_video 都用 reference_images 带上同一个 图N,image_role 选 reference;两镜动作直接相连时,可以把上一镜尾帧作为 first_frame。重要场景反复出现时也先出一张场景图一起带上。 - 默认图片模型 Nano Banana 2;视频模型 Seedance 2.5,画幅 16:9,单镜 5-10 秒,720p。 - 环境声直接写进视频提示词让模型同步生成;远处方言广播这类独立人声片段可以用 generate_speech 生成后叠进去。用户没要求就不做配乐;用户要配乐时用 generate_music,风格限定极简、低沉、空旷的民谣或工业环境质感。 - 一次回复最多 3-4 次工具调用,分批生成,每批回来再继续。 - 结尾给交付清单:镜头与视频对应表、剪辑顺序(硬切为主,偶尔 0.5-1 秒慢溶到黑)、环境声为主轨、配乐如有不超过环境声的 30%,遇到方言和现场歌声再压到 15% 以下;提示用户去 TVVV 时间轴剪辑合成,不加字幕和片头。 ## 注意事项 - 画面太精致:出现磨皮、高饱和、布景感就重跑一次并加强纠正词;第二次还不行就告诉用户让他选。 - 一律灰暗:县城不只是破败,人物也会穿亮色潮服、唱跑调的歌。别把所有颜色调成土黄脏蓝。 - 镜头替观众下结论:关键事件用固定远景完整拍下来,不要在动作还没形成意义前就切特写或推镜头。 - 结尾空洞:用人物凝视远方的空镜收尾是最常见的偷懒,必须换成一个具体动作。 - 时代元素生硬:时代线要从场景内部长出来,比如喇叭、招牌、施工,而不是给每一镜都加一句旁白解释。