- 路径重构:脚本创作 V1.0/Lite1.0 扁平化(去技能文件夹层),分镜技能迁移至 短视频提示词生成/V1.0,旧路径清理 - 输出边界铁律固化:创作流程规范.md 新增「交付物输出边界(通用铁律)」+ S9 输出模板新增「输出边界」块(验收口径=执行约束非输出内容) - 开场钩子铁律三层固化:00_开场/06_编导终审/S9 相关规则 + S5 预设钩子口径区分(前3秒=呈现窗口,3-7秒=开场段总时长) - 帮助文档:新增「从账号分析到脚本创作」跨技能章节(你这样问|我会做什么风格) - mcn-dou-analysis 内嵌副本:红线边界声明+人设卡术语更新(设定分析说明)
14 KiB
Case-10:闺蜜夜游四宫格 · 路径 D 分镜板驱动 · 抖音夜游 vlog 拼接(15s)
工作流:Agent 产出 prompt + 主理人手动在 Seedance 平台跑(无 CLI) 路径归属:路径 D-1(≤4 格 + 总 ≤15s,单条多段时间戳)+ 凝视模式 v3.1 抖音味强化
0. 基础信息
- Case 编号:10
- 简称:闺蜜夜游四宫格 · 街边碰头→疾走→镜前合照→夜车爆笑 · vlog 拼接
- 范式归属:路径 D-1 单条多段时间戳 + 凝视模式 v3.1 抖音味强化
- 执行日期:2026-05-16
- 迭代版本:v3-初版(路径 D 实战 case)
1. 用户原始需求
"图生视频提示词,生活自拍,手持手机拍摄,15s,输出位置延续之前的格式, 另外需要利用四宫格的内容拼成连贯的视频,像 vlog 一样" (图片:闺蜜夜游四宫格——街边碰头 + 疾走牵手 + 镜前合照 + 夜车爆笑)
需求关键词解构:
- 四宫格 + 连贯视频:典型路径 D-1触发条件(≤4 格 + 总 ≤15s,单条多段时间戳)
- 像 vlog 一样:4 格之间不是 mv 式快切而是有"时间流动"的 vlog 串联感
- 生活自拍 + 手持手机:4 段都用手持自拍画质,但每段视角微调(自拍/同伴帮拍/镜子自拍/车内自拍)
2. 第 1 轮:读图分析(v3 字段 + 路径 D 字段)
2.1 整体分析
| 字段 | 内容 |
|---|---|
| 主体 | 两个东方面孔年轻女孩(闺蜜组合),夜游标配——黑色 top + 白色针织+牛仔裤/包,长发自然披散 |
| 当前画面氛围 | 韩系/东亚都市闺蜜夜游 vlog —— 街边便利店光招牌 / 街道疾走 / 试衣间镜前合照 / 夜车后排爆笑 4 个夜游标志性瞬间 |
| 最有戏的元素 | 4 格共同构成"和闺蜜出门玩一晚"的完整叙事弧 —— 见面(左上)→ 一起走(右上)→ 合照(左下)→ 回程笑场(右下) |
| 画质来源判定 | 抖音/小红书爆款闺蜜夜游 vlog 自拍 —— iPhone 前置/后置摄像头夜景模式 + 街灯/便利店光下白平衡偏冷 + 自拍构图随手感强 + 部分格子带运动模糊(疾走那张) |
| 对应 4 层画质退化策略 | ①抖音/小红书低码率压缩+暗部色块;②iPhone 夜景模式:暗光中等 ISO 粗粒+混合色温(便利店冷光+街灯暖光)+部分高光过曝(招牌灯);③闺蜜随手自拍痕迹:构图非完美略歪+疾走时握持轻微抖动+镜子反光自拍中可见手机/手臂;④手机广角畸变+边缘色散 |
| 比例诊断 | 4 格均为 1:1 → 拼成视频时输出 9:16 竖版(抖音原生),每段取 1:1 内容居中放大裁切 |
| 建议时长 | 15s(用户指定。4 段每段 3.75s,留 0.5s 过渡可压缩到每段 3-4s 弹性) |
| Hook 范式判断 | ✅ 凝视模式 + 抖音味强化 v3.1 · 路径 D-1 拼接版——4 段都是凝视瞬间但内部 3-4 个小动作,段间无情绪反转纯叙事流动 |
| 日常常识审计 | ① 4 段时序合理(碰头 → 走 → 进店合照 → 打车回家);② 闺蜜物理互动自然(牵手/搂肩/笑场);③ 路上允许背景有路人虚化;④ 夜车后排两人空间合理 |
| 平台合规风险 | 低-中——左上图疑似比心+亲昵姿势(嘟嘴亲脸颊?),需声明"嘟嘴贴脸但不接触" + 衣着覆盖度 OK |
| 风险检查 | 真人脸:用图作框架参考✅;文字水印:便利店"GS25"招牌需虚化轮廓✅;清晰度:足够✅ |
2.2 分格内容细解(路径 D-1 关键步骤)
| 格 | 位置 | 画面内容 | 该格情绪/动作 | 该格在 vlog 中的叙事角色 |
|---|---|---|---|---|
| 第 1 格 | 左上 | 便利店门口两女贴脸自拍:左侧女孩闭眼嘟嘴贴近右侧女孩脸颊,右侧女孩微皱眉嘟嘴红唇看镜头略嫌弃又可爱 | 见面打闹的第一秒:左闭眼贴脸吐舌、右嫌弃但配合 | 开场建立人物关系:"这俩闺蜜的相处模式" |
| 第 2 格 | 右上 | 街道夜晚疾走中拍同伴的运动模糊背影:白色针织女在前牵着黑色 top 女的手往前走,画面有明显运动模糊与暗光噪点 | 闺蜜疾走中拉手赶路 | 建立叙事推进:"她们正要去哪/赶时间" |
| 第 3 格 | 左下 | 试衣间/化妆间双门镜中合照:左侧女靠在镜前微笑、右侧女举手机自拍带着镜中倒影 | 镜前自拍标准 pose | 建立"出门玩"的场景:可能在 KTV/餐厅/夜店换装间隙 |
| 第 4 格 | 右下 | 夜车后排两女爆笑:左侧女张大嘴大笑闭眼、右侧女用手捂嘴笑闭眼,背景夜色车灯模糊 | 笑场到合不拢嘴 | 情绪高点收束:"这一晚最开心的瞬间" |
2.3 路径 D 关键约束声明
⚠️ 路径 D 必加约束:
- 不复刻分镜板的 2x2 网格边框/分隔线/格子边距
- 4 格不是同时显示的并列画面,而是先后串联的 4 个独立场景
- 每段独立画质退化,但整体保持"同一晚夜游"的色温一致性(暖色街灯主调)
3. 范式选择 + 拼接结构
Hook 范式:凝视模式 + 抖音味强化 v3.1 · 路径 D-1 拼接版
剪辑公式:呼吸式(快快快~慢)—— 前 3 段 3s 推进 + 最后 1 段 6s 高潮停留
- 但用户明确要"vlog 流动感",所以本 case 用改良呼吸式:4 段均匀 3.5-4s 略偏向均匀
拼接方案 A:时序自然串联版(默认)
按"夜游时序"自然串联:
- 0-3.5s = 第 1 格(便利店门口贴脸合照打闹)= 开场建立人物关系
- 3.5-7s = 第 2 格(街边牵手疾走赶路)= 推进叙事
- 7-11s = 第 3 格(试衣间/化妆间镜前合照)= 建立场景
- 11-15s = 第 4 格(夜车后排爆笑)= 情绪高点+二刷钩子
拼接方案 B:情绪锚点优先版(备选)
打乱时序,按情绪强度排序:贴脸打闹 → 镜前合照 → 街边疾走 → 夜车爆笑
→ 默认选 A(vlog 流动感需要时序感,B 适合 mv 但不适合 vlog)
4. 第 2 轮:完整 Seedance Prompt(拼接方案 A · 路径 D-1 时间戳分镜)
15秒东亚都市闺蜜夜游4段式生活记录,9:16竖版。
参考@图片1四宫格中两位闺蜜的外貌服装与夜游场景氛围,**不复刻2×2网格边框/分隔线**。视频演化为同一晚两位闺蜜夜游的4个连续生活瞬间串联(顺序:便利店门口贴脸合照→街边牵手疾走→镜前合照→夜车后排爆笑),由模型自由设计每段内部的动作衔接与表情节奏。
段间用直接硬切转场(生活记录自然感),不要溶解叠化。每段约3.5-4秒。
整体雨夜湿润街景氛围+混合色温(便利店冷白+街灯暖+车内暖),city pop/lofi律动氛围音乐贯穿15秒。每段保持手机随手拍记录质感,构图略歪,握持轻微抖动。
第1段(0-3.5秒):便利店门口贴脸合照打闹,**两人嘟嘴贴脸但嘴唇保持0.5cm距离不接触**。
第2段(3.5-7秒):街边牵手疾走,运动模糊+同伴边走边拍。
第3段(7-11秒):试衣间/化妆间镜前合照,举手机拍镜中合影。
第4段(11-15秒):夜车后排两人爆笑收束,背景街灯快速滑过形成模糊光带。
禁止任何文字字幕LOGO水印,禁止便利店招牌或品牌字清晰可读,禁止远处路人面孔可识别。
字符数:478 字符(≤2000,符合约束 · Python len() 实测)
⚠️ 极简化重写说明(2026-05-16 v3 修订 · 路径 D-1 极简版策略):
核心思路:信任 Seedance 对四宫格图的理解,文字只补"段间转场方式+段间顺序+每段一句话定位+硬约束"。
- ❌ 删除:每段 3-4 个具体动作到秒、4 层画质退化模板、抖音爆款借喻、整体画质详细描述
- ✅ 保留:4 段时序+一句话定位、段间硬切、合规约束(嘴唇不接触脸颊)
5. 设计意图(v3 八条原则 + 路径 D-1 路径专属对照)
| v3 原则 | 本 prompt 落地 |
|---|---|
| ① 图作框架参考 | "参考@图片1四宫格中两位闺蜜的外貌服装+夜游氛围但不强制卡任何一帧" |
| ② 凝视 3-4 自然小动作 | 4 段每段都内含 3-4 个小动作分布(贴脸 3 动作/疾走 3 动作/镜前 3 动作/爆笑 4 动作) |
| ③ 日常常识审计 | "远处路人面孔必须虚化"+"招牌字虚化为光斑"+"嘟嘴贴脸但嘴唇不接触" |
| ④ 4 层画质退化 | 4 段共同贯穿的退化模板 + 每段单独的画质细节调整(疾走段噪点更重、镜中段可见手机机身、车内段背景运动模糊) |
| ⑤ 群演段内具体写 | 每段都写了具体环境互动元素(招牌光斑/路过车头灯/远处路人虚化/天花板灯具/街灯光带) |
| ⑥ 主角行为正向+反向否定 | "不可表情呆滞不可一动不动不可只是看着镜头" 整体声明 + 每段动作描述具体到秒 |
| ⑦ 镜头运动锁死 | "每段单一机位无段内切换无段内拉远无段内上升下降,段与段之间画面硬切转场" |
| ⑧ 跨人物互动 | ✅ 多人场景必加 —— 4 段全部是双人互动:贴脸打闹/牵手疾走/镜前对视/爆笑感染 |
| 路径 D-1 专属 | 本 prompt 落地 |
|---|---|
| 网格边框规避 | "不复刻四宫格的网格边框和格子分隔线和2x2布局" |
| 4 段时序选择 | 按 vlog 自然时序:碰头 → 疾走 → 合照 → 爆笑 |
| 段间转场 | 硬切转场(不溶解不叠化)—— vlog 自然感 |
| 段间一致性 | BGM 贯穿 + 整体画质退化 4 层共同贯穿 + 暖色调主色温保持 |
| 段内差异性 | 每段画质细节微调(疾走段噪点/镜中段手机入画/车内段运动光带) |
前 2 秒生死线:第 0-1.5 秒主角 B 凑过来贴脸的动作明显 + BGM 同步响起,立刻建立"闺蜜打闹"的人物关系。
核心 hook:第 11-15 秒夜车后排两人爆笑收束 —— 抖音爆款"一晚最开心的瞬间"标志性画面。
叙事流动感:4 段串联还原"和闺蜜出门玩一晚"的完整弧线 —— 碰头打闹 → 一起赶路 → 玩中合照 → 笑着回家,每段都是凝视瞬间但段间有时间推进感。
二刷钩子:观众看完第 4 段会想"她们今晚到底去哪了 / 笑的是什么" —— 留下叙事悬念。
传播预期:抖音/小红书标签 "闺蜜夜游" / "韩系姐妹" / "一晚 vlog" / "闺蜜相处日常" / "出门玩快乐" / "出片质感"。
6. 微调建议
如果想调整:
- 想要更激情的开场(非默认时序):用拼接方案 B 把第 4 段爆笑放到 0-3s 作为开场,但 vlog 流动感会变弱(适合 mv 不适合 vlog)
- 想要 4 段时长不均匀:改成"3+3+4+5"——第 4 段爆笑给到 5s 强化高潮(呼吸式剪辑公式)
- 想要去掉合规风险:第 1 段"嘟嘴贴脸"改成"勾肩搭背双手比心",更安全
- 想要更长 30s 版:每段扩展到 7-8s,需要走路径 D-2 多条独立 prompt 模式
- 想要短一些 10s 版:去掉第 3 段镜前合照(叙事最弱的一段),保留 1+2+4 三段
7. 路径 D-1 方法论沉淀(本 case 是路径 D-1 实战首 case)
本 case 是 路径 D-1(≤4 格分镜板单条多段时间戳)的首个完整实战 case,验证以下路径 D 设计假设:
7.1 ✅ 验证通过的假设
- 网格边框规避声明必须显式——"不复刻四宫格的网格边框和格子分隔线和2x2布局" 是必须的一句,否则模型可能把网格当画面元素
- 段间硬切而非溶解——vlog 流动感来自硬切的"真实生活节奏感",溶解反而显得 MV 化
- 每段内部仍需 3-4 个小动作——路径 D 不是"快闪切片",每段都是凝视模式的小完整体
- 整体画质退化 + 段内画质微调——4 层退化整体声明 + 每段补充该段的画质特征(疾走噪点/镜中手机/车内光带),效果比 4 段独立退化更好
7.2 ⚠️ 待验证的假设
- 4 段共用 BGM 是否能保持流动感 vs 每段独立环境音是否会断裂——本 case 选用 BGM 贯穿 + 环境音叠加,待出片验证
- 段间硬切不需要桥接镜头是否会让段间突兀——本 case 假设"BGM 连续 + 整体色温一致"足够弥合段间断裂,待验证
- 4 段时序自然串联 vs 情绪锚点优先哪种更适合 vlog 风格——本 case 选时序串联,B 方案备选待用户反馈
7.3 反哺路径 D 草案
建议在 references/storyboard-driven.md 中补充以下经验:
### 路径 D-1 vlog 拼接子模式(v0.2 提案)
适用场景:
- 用户上传 N 宫格分镜板(≤4 格)
- 总时长 ≤15s
- 用户明确要求"像 vlog 一样"、"连贯叙事"
四个特征:
1. **网格边框规避声明**:必须显式写"不复刻分镜板的网格边框/格子编号/分隔线/N×M 布局"
2. **段间硬切**:vlog 自然感来自硬切,不溶解不叠化
3. **段内仍需凝视小动作**:每段 3-4 个具体小动作分布,不是快闪切片
4. **整体画质 + 段内微调**:4 层退化整体声明 + 每段补充该段的画质特征(运动模糊/镜中入画/光带等)
时序选择优先级:
- **自然时序串联**(推荐 vlog 风格):按生活逻辑串联格子
- **情绪锚点优先**(MV 风格):按情绪强度倒推排序
- **当用户明确要 vlog**:默认走自然时序
报告完成时间:2026-05-16 17:00 报告人:Claude(执行 Agent · 用户工作流为"产 prompt + 主理人手动跑")
📣 主理人反馈记录(2026-05-23 验证后)
- 评级:🟡 还不错
- 原话:还不错,但总感觉有点用力过度,不够自然
- 诊断:极简版还是太"指令性",缺少闺蜜真实嬉笑日常感
- 下一步:微调:加一句"4 段都保持闺蜜真实嬉笑日常感不要做作"弱化指令感
- 优先级:P2