
Japanese Delinquent School Showdown
Old-DV handheld Japanese delinquent shorts: hallway standoffs, rooftop brawls, rain fights
Make a 30s clip: a bleached-blond delinquent blocks a transfer student in a rundown hallway, taunts him in Japanese, sets a rooftop fight
The full workflow below is sent to the Agent every turn.
# 日式不良校园对峙
适合拍世纪之交日本不良高中题材的短片:破旧走廊里的眼神对峙、成群结队的嚣张小团体、天台约架、雨中群殴,全程像有人拿着 90 年代家用 DV 跟拍,低饱和、微暖、带一点颗粒。角色说日语,嚣张、挑衅、有停顿。最终交付 1-4 段、每段不超过 15 秒的连续短片(总长 10-60 秒),自带同步日语对白和环境声,不配背景音乐。
## 开工前确认
- 画幅用 ask_user 让用户选:16:9(默认)/ 9:16 / 3:4,之后所有图和视频统一。
- 用户有参考图或视频:先分析人物造型、服装、色调、场景布局,后面全程沿用,不和用户给的形象冲突;需要时以参考图为底重绘。
- 用户只有一句点子:直接编人物和冲突,在设定表里给出,等确认。
- 提醒一句:DV 日期时间戳、REC 角标这类叠加文字不在生成阶段做,需要的话导出后在剪辑时加。
## 制作流程
1. **项目设定** —— 在回复里给设定表:标题、画幅、总时长、段数、出场人物、场景、核心冲突、日语台词风格。**停下确认。**
2. **角色卡与场景卡** —— 角色卡写发型、发色、眉眼、制服穿法、内搭、外套、配饰、伤痕;场景卡写空间、物件、天气光线。
3. **分镜表** —— 把多个节拍合进同一次生成,每段 ≤15 秒;超过就按剧情顺序拆段,并标出交接点(下一段第一镜如何接上一段最后一镜的姿势、视线、动势)。**停下确认。**
4. **生成参考图** —— 角色图纯白背景只出人,场景图只出空间不出人,分开生成。**展示确认。**
5. **逐段生成视频** —— 一段一段来,绝不同时提交多段。每段回来检查色调是否一致、台词前后有没有留气口、交接是否顺。
6. **交付清单** —— 段落顺序、硬切或极短叠化的接法。
## 风格锁定
- **固定色调块**(每个图片提示词末尾原样复制,不改词序):`shot on 1990s VHS camcorder, handheld POV camera, desaturated vintage tones, low contrast, faint warm color cast, subtle amber-beige color shift, slightly warm shadow tones, very minimal film grain, faint vignette, very slight chromatic aberration, muted warm palette, 1990s Japanese home video look, no heavy saturation, no cold blue tones, no neon tones`。
- **固定防时间戳后缀**(紧跟色调块):`no date stamp, no timestamp, no time display, no REC indicator, no camcorder overlay, no on-screen text, no timecode`。「90 年代摄像机」这类词会诱导模型自己加日期角标,所以这句每次都要带。
- **色调理解**:家用 DV 的微暖琥珀米色,饱和度降低但轮廓清楚,阴影偏暖,肤色自然微暖,颗粒很少,没有扫描线。各段之间色温、饱和度、偏色不能漂。
- **禁用词**:cinematic lighting、golden hour、4K、HD、sharp focus、35mm photography、heavy film grain、tape distortion、VHS tracking lines,以及会带来青灰、紫色、品红偏色的描述。
- **人物造型库**:
- 立领学生服:黑色立领外套全敞或只扣最下一颗,里面不穿规矩白衬衫,换成红色花衬衫、豹纹、蛇纹、夏威夷衫或宽松白 / 黑 V 领 T 恤,领口敞开露锁骨和项链。
- 西装校服:白衬衫 + 领带 + V 领毛背心或藏青西装外套,可配书包、厚课本(做「好学生 vs 不良」反差)。
- 外套:横须贺刺绣夹克、毛领飞行夹克、黑皮衣。
- 发型:厚发蜡飞机头、鸭尾头、卷烫短发、中分凌乱中长发、发蜡刺猬头、湿发背头、剃线寸头、莫霍克、脏辫、两侧推短的鲻鱼头;可漂金、染红、染金黄。
- 脸:细眉或剃眉、三白眼、下巴微收、直视挑衅的眼神。
- 打架痕迹:绷带缠手、脸上淤青、嘴角破口、血迹、尘土。配饰:细框复古眼镜、银十字架或狗牌项链、钱包链。
- **场景库**:废弃工厂、涂鸦旧走廊、天台铁丝网、雨夜街道、破败教室、校门、操场。
## 分镜与镜头规则
- **视角**:强 POV,镜头就是某个角色的眼睛,被人逼近、被人揪领子都直冲镜头。
- **运镜**:像真人努力端稳 DV——轻微、平静的呼吸摇摆,跟拍时基本稳定,只偶尔左右小漂移带一点走路节奏。不要写稳定器式的丝滑,也不要写剧烈晃动。
- **景别**:大量中近景和特写,脸、表情、身体动作居中。全景只用来交代人数和地形(一群人堵住走廊、天台两拨人对站)。
- **多镜合并**:一次生成里用「镜头1:… 镜头2:…」写 2-4 个节拍,单段 8-15 秒。典型一段:镜头1 走廊尽头三个人靠墙抽烟(3 秒)→ 镜头2 POV 被拦下,领头的逼近到特写(5 秒)→ 镜头3 他歪头说狠话、停顿、冷笑(5 秒)。
- **连续性**:相邻镜头要共享空间、视线方向或动作,不要无关跳切。拆段时下一段第一镜接上一段最后一镜的姿势、视线、动势,在分镜里写明交接理由,并标注「与上一段保持同样色调」。
- **台词留气口**:每句日语前后都写停顿,例如「短暂停顿后说:……然后保持表情一拍」,避免台词硬起硬断。台词嚣张、挑衅,像校园打架漫画里的口吻,例:「おい、どこ見てんだよ」「放課後、屋上に来い」「上等じゃねえか」。
- 分镜表字段:段号 / 镜号 / 时长 / 场景 / 出场人物 / 动作 / 日语台词(含停顿)/ 景别·角度·运镜 / 环境声 / 交接说明。
## 提示词写法
- 用户用中文交流时说明文字可用中文,但色调块和防时间戳后缀保持英文原样,日语台词保持日文。
- **角色图结构**(一段话写完):身份(某某,1990s Japanese delinquent high school student)→ 发型与面部 → 服装配饰 → 一个具体动作表情 → 纯白背景隔离句 → 色调块 → 防时间戳后缀。
```
Ryo as a 1990s Japanese delinquent high school student, slicked-back pompadour with heavy wax, bleached blonde, thin eyebrows, sanpaku eyes, open black stand-collar school uniform with a red patterned shirt underneath, silver cross necklace, wallet chain, bandaged hands, slight bruise on cheek, chin tucked, turning his head to stare at the camera with an arrogant look, isolated on a plain pure white background, no background scene, no environment, studio white backdrop. [固定色调块] [防时间戳后缀]
```
- **场景图结构**:场景类型 → 空间与物件 → 天气氛围 → 无人声明(`completely empty, no people, no characters, no figures, unoccupied scene`)→ 色调块 → 防时间戳后缀。
```
A rainy Japanese high school rooftop with rusted chain-link fencing, wet concrete floor, puddles reflecting dim overcast light, a broken bench, completely empty, no people, no characters, no figures, unoccupied scene. [固定色调块] [防时间戳后缀]
```
- **视频提示词**:图N 绑定人物和场景 → 固定运镜句 → 逐镜动作 / 镜头 / 台词 → 环境声 → 视频色调锚点 → 排除项。
- 固定运镜句:`steady handheld camera, no stabilizer, very subtle gentle sway, mostly stable with occasional very slight side-to-side drift when following the subject`。
- 视频色调锚点:`slightly desaturated, low contrast, faint warm color cast, subtle amber-beige color shift, slightly warm shadow tones, very minimal film grain, faint vignette, muted warm vintage tones, no cold blue tones, no neon tones`。
- 每个镜头块都要带防时间戳后缀,结尾加 `no subtitles, no background music`。
```
图1 is Ryo, 图2 is the transfer student, 图3 is the graffiti corridor. Steady handheld camera, no stabilizer, very subtle gentle sway. Shot 1: POV of the transfer student walking down the empty corridor, Ryo steps out from a doorway and blocks the way, medium close-up. Shot 2: Ryo leans in to a close-up, a short pause, then says in Japanese: 「おい、転校生。挨拶もなしか?」 and holds a cold smirk for a beat. Shot 3: two crew members lean on the wall behind him, laughing quietly. Sound: distant school bell, footsteps, uniform rustle. [视频色调锚点] No date stamp, no timestamp, no REC indicator, no on-screen text, no timecode, no subtitles, no background music.
```
- 表演只写微表情和小动作,不追求完美口型。
## 在 TVVV 上执行
- 角色图、场景图用 generate_image,默认 Nano Banana 2,比例跟随设定画幅;用户上传了参考图就放进 reference_images 以它为底重绘。不需要精确文字,一般用不到 GPT Image 2。
- 每段 generate_video:默认 Seedance 2.5、720p、设定画幅,单段 8-15 秒(一般 10 秒左右最稳);reference_images 带本段出场的所有角色图N 和场景图N,同一角色全程用同一张,image_role 用 reference。日语对白和环境声直接写进提示词让模型同步生成,不另外 generate_speech,不用 generate_music。
- 一次回复只提交 1 段视频,回来检查色调、气口、交接后再做下一段。
- 交付清单:按顺序列每段视频;15 秒以内只需掐头去尾,多段之间用硬切或极短叠化,保持动势和视线连贯;需要 DV 时间戳、双语字幕的,提示用户在 TVVV 时间轴里自己加文字层。
## 注意事项
- **自动冒出日期角标**:只要写了老摄像机就容易出现时间戳和 REC。每个图片和视频提示词(包括多镜里每个镜头块)都带防时间戳后缀。
- **段与段色调漂移**:一段偏青一段偏黄最出戏。色调块一个字都别改,禁用词一律不写,检查不一致立刻重出。
- **参考图被污染**:角色图带了背景、场景图里冒出路人,后面视频会多出人或背景错乱。坚持白底人物、空场景分开出。
- **晃得像地震**:写 shake、handheld chaos 会晃到看不清。只用固定运镜句。
- **台词被切断**:不写停顿,台词会贴着镜头开头和结尾。每句前后都写 pause 和 hold。
- **打斗尺度**:拳脚冲突点到为止,用推搡、揪领、挥拳落空、倒地后的喘息来表现,不拍血腥特写,避免被审核拦截。