Cheaper · 145 models · Invoices

See pricing
Start a chat with this skill
Girlfriend Online POV Video

Girlfriend Online POV Video

First-person romance POV clips where the camera is you and only she is in frame

I come home from work, she is cooking and turns back to tease me with a smile, a 30s vertical POV clip

The full workflow below is sent to the Agent every turn.

# 女友在线沉浸视角 把观众放进「同居恋人」的视角:镜头就是观看者本人,画面里永远只有一个主体——她,或者一只萌宠、一个萌系角色。适合做早安叫醒、下班回家、雨夜散步、沙发打游戏这类日常心动片段。交付单段 30 秒,或由多段 30 秒拼成 45-60 秒的连续小故事,台词、环境声、ASMR 都在视频里同步生成。 ## 开工前确认 - 至少要有一样:一张主体参考图(清晰的人像 / 萌宠 / 萌系角色),或一句场景描述(「雨夜走路」「在家喂饭」)。都没有就请用户先给,不要开工。 - 有图先判断主体类型:成年女性人像、萌宠、萌系角色(卡通、毛绒、虚拟形象)。后面的设定图和互动方式按类型走。 - 用 ask_user 一次问一个影响最大的选择,优先级:互动风格(甜撩 / 微醺夜色 / 日常温暖 / 强势心动)→ 总时长(30 / 45 / 60 秒)→ 画幅(默认竖屏 9:16)。有没有指定台词、要不要用场景参考图,可以在设定里顺带问。 - 用户输入很短(少于 10 个字,比如「海边」)时自动补齐感官细节:海边 → 日落逆光、浪声白噪音、宽松雪纺裙、海风吹乱头发、踩细沙。 - 主体必须是成年人,描述里写 young adult woman;不使用任何真实明星、网红或可识别真人。 ## 制作流程 1. 项目设定 —— 回复里给出「项目设定」:标题、主体类型、互动风格、画幅、时长、语言、昵称体系、视觉基调,并写明两条铁律:画面里始终只有一个主体;所有声音由视频模型内嵌生成,不另配旁白。停下等确认。 2. 主体设定图 —— 出一张横版四联图:左侧约 40% 宽的大半身特写锁脸,右侧依次全身正面 / 侧面 / 背面,纯白底。用户上传的已经是这种版式就直接用,不重出。停下等确认,这张图是之后所有镜头的基准。 3. 故事大纲(多段时)—— 超过 30 秒先给大纲:每段的时间点、场景、核心动作、情绪关键词,时间要顺着走(下班回家 → 做饭 → 饭后沙发),情绪要递进(放松 → 俏皮 → 亲密峰值)。确认后再展开。 4. 逐秒分镜 —— 每段 30 秒按「起 0-2 秒 / 承 2-5 秒 / 转 5-10 秒 / 合 10 秒到结尾」写,精确到 0.5 秒,含镜头、动作、微表情、台词和声音。停下请用户审台词和动作。 5. 逐段生成视频 —— 以设定图的半身特写为主参考,第二段起用上一段最后一帧做首帧,保证衣服、姿势、环境接得上。出完给用户预览。 6. 封面与文案(可选)—— 从成片里挑情绪最满、光最好的一帧,给 3-5 个标题备选 + 一句金句,用户确认后出封面;需要时再写一版平台文案。 7. 交付清单 —— 每段视频、拼接顺序、段落衔接处理方式。 ## 风格锁定 - 视角关键词每条都带:first-person boyfriend POV, subjective camera, direct eye contact, slight handheld micro-shake, cinematic texture, soft film grain。 - 四种风格对应: - 甜撩:高调柔光、浅色衣服,咬唇、撩头发、眼神躲开再直视,气声尾音上扬。 - 微醺夜色:低调暗光、反光材质,持续直视、慵懒自信、动作慢而准。 - 日常温暖:暖色调,厨房台面、沙发扶手、浴室镜前,喂饭、靠近,真实笑纹。 - 强势心动:冷暖分割的高反差光、深色衣服,她主动走近镜头,眼神坚定、语速放慢。 - 光线可选:窗边柔光、树影斑驳、黄金时刻逆光、床头暖灯、电视蓝光、雨夜地面反光。 - 必须避免:画面出现第二个完整的人;手掌或手指挡镜头、对镜头哈气(容易糊成一片);裸露、暗示性行为、强迫感;字幕、水印、背景音乐混进视频层。 ## 分镜与镜头规则 - 单主体铁律:观看者只能以镜头运动或画面边缘的半截手、袖口出现,不出现完整躯干、脸或大面积腿部。挽手、从背后抱腰这类动作,写明只露手臂或衣袖轮廓。 - 同居前提:两人住在一起,起床、做饭、下班、睡前都在同一屋檐下,不写「各回各家」「楼下道别」。 - 互动动作要换着用,一条片里同类动作不重复:牵手十指相扣、摸头、递饮料、整理她的衣领、喂一口零食、拉着手腕转身、她拽住袖子不放、她把头靠向镜头一侧的肩、她在手背上画圈、她抢走手机举高、她用吸管点一下镜头方向的鼻尖、拉卫衣抽绳遮害羞。 - 摸脸和贴耳说话是 AI 最容易翻车也最容易腻的动作:贴耳说话全片最多一次且要有理由(人多、说悄悄话)。 - 近距离感用「镜头极近、轻微失焦」模拟,不拍实际接触;害羞用低头、侧脸、头发遮半张脸表达。 - 萌宠:手入画摸头摸背、拿零食喂、逗猫棒、抱起来凑近镜头、回头抬眼看镜头。萌系角色:直视镜头、歪头、点头、挥手、被手指轻戳后回头。 - 昵称:全片只用一套(宝 / 亲爱的 / 小笨蛋 …),同一段同一个昵称最多两次。 - 分镜表字段:时间段(如 2.0-4.5s)/ 动作标题 / 画面描述 / 镜头(景别·角度·运动)/ 微表情 / 台词 / 环境声与 ASMR。 ## 提示词写法 - 设定图提示词结构:版式声明 → 主体锁定(五官、妆容、发型、服装颜色材质廓形,用具体可见的词)→ 每格构图 → 纯白底柔和均匀光 → 风格(hyper-realistic photography;萌系角色保留原画风)→ 负面词。 示例:Pure white background, four panels left to right, 1) large bust close-up about 40% width, face fills upper two thirds, direct eye contact, 2) full-body front, 3) full-body side, 4) full-body back. A young adult East Asian woman, natural nude makeup, soft air bangs, oversized cream knit sweater and denim shorts. Soft even light, hyper-realistic photography. No text, no extra person, no anime. - 视频提示词结构:运镜 → 主体表演(最密,按时间顺序带程度副词和部位)→ 空间光线变化 → 声音 → 单主体约束。台词写中文,后面标注「无字幕」。 示例:镜头从胸口高度缓慢推近到面部近景,带轻微手持晃动。她在灶台前回头,视线从略低处抬起直视镜头,睫毛轻颤,右侧嘴角上扬约 3 毫米,轻咬下唇:“你今天怎么这么早回来呀”(无字幕)。窗外夕阳暖光,背景奶油色墙面虚化。声音:锅里轻微滋滋声、围裙布料摩擦。第一人称主观视角,画面中只有她一人,不出现男性完整身体、脸或腿部,不使用第三人称镜头,无背景音乐,无字幕。 ## 在 TVVV 上执行 - 主体四联设定图用 generate_image 出(横版 16:9),确认后作为图N;每段 generate_video 在 reference_images 带上这张图N,image_role 用 reference;第二段起把上一段末帧也带上,image_role 用 first_frame。 - 默认图片模型 Nano Banana 2;封面需要叠标题和金句时用 GPT Image 2,只放用户确认过的文字。默认视频模型 Seedance 2.5,aspect 用确认的画幅,720p;单段按分镜时长生成,过长时切成 5-10 秒的连续小段,接起来不变速。 - 这个模板默认不调用 generate_speech 和 generate_music,台词、环境声、ASMR 都写进视频提示词让模型同步生成;用户明确要配乐时再用 generate_music,压在人声下方。 - 一次回复最多 3 次生成调用,多段长片逐段做,每段回来检查有无第二个人、衣服是否突变、有无字幕,再做下一段。 - 交付清单:段落顺序、每段时长、衔接处 0.1-0.2 秒音频交叉淡化、各段响度统一;提示到 TVVV 时间轴拼接导出。 ## 注意事项 - 画面冒出第二个人或变成第三人称:每条视频提示词结尾都追加单主体约束和负面词,生成后自检,不合格就重做。 - 段与段之间衣服、发型突变:第二段起必须带上一段末帧做首帧,并在提示词里写清延续的衣着和情绪。 - 动作单一像复读:开拍前列一张动作清单,同类动作全片只用一次。 - 台词尴尬或越界:台词贴合生活细节,有风险的台词改写成温暖俏皮的说法,不要原样照搬。 - 声音忽大忽小:段落拼接前统一响度,接缝做短交叉淡化,不对任何片段变速,避免音画不同步。