Files
mcn-short-video/project/短视频提示词生成/V1.0/参考skills/seedance2.0-prompt-skill/experiments/cases/case-05-球场大屏.md
T
maogeigei b3685504d7 技能三副本迭代:路径重构+输出边界铁律+开场口径区分+审计修复
- 路径重构:脚本创作 V1.0/Lite1.0 扁平化(去技能文件夹层),分镜技能迁移至 短视频提示词生成/V1.0,旧路径清理
- 输出边界铁律固化:创作流程规范.md 新增「交付物输出边界(通用铁律)」+ S9 输出模板新增「输出边界」块(验收口径=执行约束非输出内容)
- 开场钩子铁律三层固化:00_开场/06_编导终审/S9 相关规则 + S5 预设钩子口径区分(前3秒=呈现窗口,3-7秒=开场段总时长)
- 帮助文档:新增「从账号分析到脚本创作」跨技能章节(你这样问|我会做什么风格)
- mcn-dou-analysis 内嵌副本:红线边界声明+人设卡术语更新(设定分析说明)
2026-08-26 17:28:21 +08:00

26 KiB
Raw Blame History

Case-05:球场看球凝视 · 路径 C v2→v3 验证

注意:本 case 的工作流是「Agent 产出 prompt + 主理人手动在 Seedance 平台跑」,非 CLI 自动化。CLI 字段省略。


1. 基础信息

  • Case 编号:05
  • 简称:球场看球凝视(v2 是大屏自我揭示+害羞反应、v3 是凝视模式)
  • 图片来源:用户提供(CodeX 内 GPT Image 生成)
  • 图片尺寸:9:16 竖版
  • 执行日期:2026-05-12 ~ 2026-05-13
  • 迭代版本:v2(已跑,反馈"还是太高清+应改为凝视模式")→ v3(待跑,方向重置)

2. 第 1 轮:读图分析(v2 字段必填)

字段 内容
主体 泰国棒球赛事看台第三排,年轻女观众(白色露肩长袖+深色短裙+腕带),目光投向画面外某处偏上方,表情停滞嘴唇微张
当前画面氛围 体育赛事直播录播切片质感(左上比分牌 PUR 1-GRY 1+右上 LIVE HD+左下 IG 风格 rimaaaaa___ 3 นาที 角标+#PURvsGRY #Matchday #StadiumVibes 标签);紫调(应援服)+体育场冷白光,泰式赛事现场感
最有戏的元素 她的表情+直播 UI 的存在(v2 解读为"大屏揭示装置",v3 重新理解为"自然凝视瞬间")
画质来源判定(v2) 直播录播切片/转播流截图(双重 UI、典型转播构图、紫色应援色饱和度偏暖、画面有数字电视压缩感)
对应画质策略(v2) 数字电视广播信号质感、轻微数字噪点、4:2:0 色度压缩感、HDR 色彩动态稍硬、紫色应援色偏暖、现场环境音必须贯穿全片
比例诊断 9:16 → 9:16(无需扩图)
建议时长(v2) 8 秒
推算理由(v2) 害羞反应弧(按物理时间常数 ≥2.5s 子节拍展开)+前置铺垫 2s+收束 1s≈8s(v3 改为 8s 凝视,结构调整)
平台合规风险(v2) 低(白色抹胸+应援服环境,无暴露危险区,无政治符号)
风险检查 真人脸: AI 生成 ✅ / 文字: 直播 UI 是核心视觉钩子+泰文角标易畸变需声明锁定 / 清晰度: ✅

3. 时序角色询问

主理人的回复:中(v2)→ 首(v3 反馈后改) 最终采用:

  • v2:中间关键帧(K=4.5s,第 4.5 秒画面演化抵达 @图片1 状态)
  • v3:首帧(0-1s 锁定原图)—— 主理人反馈后调整

v2 推荐中间帧的理由:图本身就是"高燃情绪定格",作首帧的话前面没东西可铺垫、害羞反应只能往后推;作中间帧能利用 0-4.5s 铺垫"她毫无察觉在玩手机 → 摄像师扫到她 → 她抬头那一刻"

v3 改为首帧的理由:主理人反馈"美女不需要害羞、自然神态、慢慢放大"——既然没有情绪反应弧线了,就不需要"中间帧+反应弧"结构,回到"首帧锁定+缓慢推进"的凝视模式


4. Hook 候选与选定

候选 A:导播 crowd cam 锁定 → 大屏揭示 × 害羞躲闪 ★★★★★(v2 已选)

  • 演化轨迹:0-1.5s 第三人称看台导播机位 → 2-3.5s crowd cam 扫场推进锁定+比分牌推进 PUR 1-GRY 1→PUR 1-GRY 2 → 4-5s 第 4.5 秒抵达图状态+关键帧定格 0.4s → 5-7.5s 害羞反应三拍子节拍展开(眼神飘 0.8s/低头抿唇 0.5s/耳根颧骨缓慢泛红 1.2s)→ 7.5-8s 收束指缝偷瞄
  • 传播因子:在大屏上看到自己=KissCam 经典梗+害羞反应按子节拍真实展开+直播 UI 0 解释成本+比分牌推进的二刷钩子
  • 适用度:★★★★★

候选 B:直播流→现实的第四面墙打破 ★★★★

  • 演化轨迹:0-3s 纯净直播流 → 4-10s 导播扫看台→ 11-15s 镜头停在女孩抬头愣住
  • 适用度:★★★★(铺垫长前 10s 用户可能划走)

主理人选定:A(v2 跑了 A 但反馈不佳,v3 重新设计)


5. 第 2 轮:v2 完整 Seedance 提示词

8秒泰国棒球赛事直播录播切片质感,9:16竖屏,第 4.5 秒画面演化抵达 @图片1 所示状态(中间关键帧)。

画质:直播录播切片,数字电视广播信号、数字噪点全程、4:2:0 色度压缩、HDR 动态稍硬、紫色应援色偏暖。非电影级稳定非 4K 锐利。全程保留直播 UI:左上 PUR vs GRY 比分牌、右上 LIVE HD、底部 IG 风格 #StadiumVibes 紫色标签。UI 文字保持稳定不畸变不变化,比分牌仅在第 3 秒做一次 PUR 1-GRY 1→PUR 1-GRY 2 推进。现场音贯穿全片不可任何段落寂静:球场欢呼声浪低频涌动、扩音解说员低沉泰语男声(语调起伏语义模糊)、远处拍手哄闹、PA 广播金属混响。

0-1.5秒:第三人称看台中景导播机位,@图片1 中女孩坐着低头刷手机毫无察觉。身边紫色应援服球迷起立挥手欢呼,群演必须自然微动不可静止如石。冷白射灯下光斑闪烁,手持微抖。

2-3.5秒:切换 crowd cam 扫场(Smooth Push In),从右上方扫过紫色球迷快速掠过 2-3 个夸张观众(举旗/捂脸/亲队旗),逐步锁定女孩。右上弹出 📺 ON SCREEN NOW 角标。她仍低头刷手机。解说员激动语调推进。

4-5秒:第 4.5 秒画面演化抵达 @图片1 完全一致状态,她抬头那一刻视线投向斜上方大屏方向、表情停滞嘴唇微张,关键帧定格 0.4 秒。环境音轻微下沉只剩远处欢呼回声做留白。

5-5.8秒:害羞第一拍·眼神飘(0.8 秒):意识到自己在大屏上眼睛瞬间睁大、视线在大屏和身边人之间快速来回飘两三次、呼吸微急身体未动,欢呼重新涌入。

5.8-6.3秒:第二拍·低头抿唇(0.5 秒):下意识低头视线落到手机屏、嘴角轻微抿紧、肩膀略内收,身边球迷开始转头看她。

6.3-7.5秒:第三拍·耳根颧骨缓慢泛红(1.2 秒渐变):仅耳根尖端+颧骨外侧从苍白到淡粉,不可全脸均匀不可瞬间,左手缓慢抬起遮半边脸害羞躲闪、肩膀微缩、身体向外侧轻转。女球迷用手肘轻撞她肩膀起哄,欢呼混入哄笑。

7.5-8秒:收束·指缝偷瞄:她从指缝偷瞄镜头嘴角不可控轻微上扬,最后 0.3 秒定格。音收束为欢呼+善意哄笑+解说员语调延续渐弱。

光影:冷白射灯主光+大屏追光让传感器轻微过曝、紫色应援服反光弥漫、HDR 动态溢出。

风格锁定:非电影级非 Cinematic;脸红仅在耳根+颧骨局部必须 1.2 秒渐变完成不可瞬间不可全脸均匀;群演全程必须自然微动不可静止如石;现场音贯穿全片不可寂静。禁止任何中文字幕、台词字幕、品牌 LOGO、水印(直播 UI 除外)。

字符数:~1900(≤ 2000 ✅,主理人确认未超平台限制)

自检 v2 字段:

  • 风格总纲含画质来源关键词("直播录播切片、数字电视广播信号、4:2:0 色度压缩")
  • 现实类反应按子节拍展开(害羞三拍:眼神飘 0.8s + 低头抿唇 0.5s + 耳根颧骨缓慢泛红 1.2s)
  • 图作为非首帧时显式写了时间锚点("第 4.5 秒画面演化抵达 @图片1 状态")
  • 时序角色显式(中间关键帧 K=4.5s)
  • 时长 = 推算值 8s(非默认 15)
  • 群演微动声明
  • 现场音贯穿声明
  • UI 文字不可变化声明(除比分牌指定推进)

6. 设计意图(v2)

  • 前 2 秒生死线:第 0 秒就是"看台+紫色应援欢呼浪+一个低头刷手机的女孩",画面信息密度足够
  • 核心 Hook:第 4.5 秒关键帧抵达+0.4 秒定格+环境音留白
  • 画质真实感:风格总纲明确写"直播录播切片质感、数字电视广播信号、轻微数字噪点、4:2:0 色度压缩、HDR 动态溢出",显式禁用电影级关键词
  • 物理时间常数:害羞反应严格拆 3 子节拍,强制声明"不可全脸均匀爆红、不可瞬间出现、必须 1.2 秒渐变完成"
  • 时长服从内容:8 秒(不是 15 秒)
  • 现场音贯穿全片(修复 v1 反馈)
  • 群演生命力(修复 v1 反馈)
  • 二刷钩子:比分牌推进暗示进球+第 7.5 秒指缝偷瞄+嘴角轻微上扬

7. v2 出片效果反馈(主理人 2026-05-13 早上反馈)

主理人原话:

现在看起来还是有点假,而且画面还是太高清没啥噪点,我在想是不是可以不要换动镜头,就是拍到美女,然后慢慢放大,美女也不需要害羞,就是他也没发现镜头在拍他,很自然的神态就行?

7.1 出戏点/翻车点

时间段 问题 严重度
全程 画面还是太高清没噪点(v2 已声明数字噪点+4:2:0 但模型未充分执行) ❌ 严重
全程 整体感觉假 ❌ 严重
2-3.5s 导播 crowd cam 切换镜头让画面看起来像剧本 ⚠️ 风格不对
5-7.5s 害羞反应弧让"美女"显得在表演 ⚠️ 主理人不要这个
4-5s 关键帧抵达定格的"瞬间发现"叙事让真实感打折 ⚠️ 主理人不要这个

7.2 v2 四原则验证

原则 通过/部分/失败 具体表现
1. 画质即风格 部分通过 画质来源判定正确(直播录播切片)但模型未充分执行噪点指令,画面还是太高清
2. 时序角色显式 通过但方向错 中间关键帧结构成立但不符合主理人真实诉求
3. 物理时间常数 通过但方向错 害羞子节拍展开成功,但主理人不要这个反应
4. 时长服从内容 通过 8s 节奏合理

7.3 反馈背后的真实诉求(v3 必须满足)—— ⚠️ 这是本次反馈最重要的 insight

主理人的反馈实际上揭示了 v2 方法论的一个盲区:

v2 强调"反应弧线+子节拍展开",但有时候用户根本不需要"反应",只需要"自然存在"。

主理人的真实诉求:

  1. 画质再脏一点——加噪点、加压缩、加业余感
  2. 不要切镜——单一缓慢推进运镜("慢慢放大")
  3. 删除害羞情绪反应——回归"专注看球的自然瞬间"
  4. 删除"她发现镜头"的叙事——她不知道被拍,自然神态

这是一种全新的 Hook 模式:"凝视模式"(vs v2 已有的"反应模式"):

维度 反应模式(v2 已有) 凝视模式(v2 缺失,v3 新增)
主体 有情绪变化(害羞/惊讶/被击中) 无情绪变化,自然存在
节奏 按子节拍展开 ≥X 秒 整段时间被时间本身展开
镜头 可切镜可定格 单一缓慢推进,不切不拉远
叙事 "她注意到了什么" "她不知道被偷拍"
美感来源 情绪反应的真实性 时间凝固的诗意

8. v3 改进方向 + 新版 Prompt

8.1 核心改造(凝视模式重写)

改造点 具体内容
删除整段害羞反应弧 5-7.5s 三拍子节拍全部删除——主角不需要任何"对镜头有反应"的动作
删除导播 crowd cam 切镜 2-3.5s 切镜删除——改为单一缓慢推进运镜
删除"关键帧抵达"叙事 "她抬头愣住"叙事删除——她全程"自然看比赛"
图的时序角色:中间帧→首帧 0-1s 锁定原图,后面 6 秒只是"这个瞬间被自然延续了"
单一镜头 Very Slow Push In 6 秒内只放大约 15%,慢到几乎不可察觉
画质再脏一点 加"业余手机偷拍录像、信号轻微马赛克、偶尔丢帧感、镜头脏点污染"
主角自然小动作 视线偶尔随场上动作微调(每 2-3s 一次)、嘴唇偶尔微动(像在低声评论)、手机偶尔抬起又放下(每 3-4s 一次)
群演微动加强 在 1-7s 段落具体写每个位置的群演动作(左侧球迷转头/右后方喝饮料/前景拍手/远处挥旗)

8.2 v3 Prompt(≤ 2000 字符)

8秒泰国棒球赛事看台业余手机偷拍录像质感,9:16竖屏,@图片1为0-1秒首帧锁定。

画质:业余手机偷拍录像,画面整体偏暗+高ISO噪点全程明显、信号轻微马赛克、偶尔丢帧感、摄像头自动曝光起伏白平衡漂移、握持微抖、镜头有轻微脏点污染、轻微广角畸变。非电影级非Cinematic非4K锐利。现场音贯穿全片不可寂静:球场欢呼声浪低频涌动、扩音解说员低沉泰语男声(语调起伏语义模糊)、远处拍手哄闹、PA广播金属混响、风扇噪声。

0-1秒:@图片1为静态首帧(中景平视四分之三侧偏远),女孩坐在看台座位上手握手机视线投向球场方向表情自然专注嘴唇微张,是看比赛过程中的真实瞬间她完全不知道镜头在拍她。身边紫色应援服球迷自然存在做小幅微动(呼吸/转头/喝饮料/拍腿),冷白射灯下光斑微闪。

1-7秒:镜头Very Slow Push In极缓慢推进(6秒内从中景缓慢推到中近景仅放大约15%),全程单一机位无任何切换无任何拉远,推进速度慢到几乎不可察觉。女孩全程保持自然看比赛状态——视线偶尔随场上动作微调位置(每2-3秒微转一次方向)、嘴唇偶尔微动(像在低声评论)、手中手机偶尔抬起又放下(每3-4秒一次),其余时间保持原图既定姿态。她不知道被拍所以没有任何对镜头的反应。身边球迷持续小幅微动:左侧球迷转头与人交谈、右后方球迷举起饮料喝一口、前景球迷拍手、远处有人挥旗。比分牌保持PUR 1-GRY 1状态不变化(仅最后1秒可微动到下一球进程)。

7-8秒:镜头到达最近位置略停顿(最后1秒推进速度更慢趋近静止),女孩仍保持自然看比赛状态视线投向球场某处嘴角带极轻微的关注表情。最后0.3秒画面凝固成一张"被偷拍的安静瞬间"静帧。音收束为欢呼+解说员语调延续渐弱。

光影:冷白射灯主光+紫色应援服反光弥漫+看台暖光从下方斜打+HDR动态范围溢出+紫调底色与白色露肩衣高光对比。

风格锁定:非电影级非Cinematic;紫色应援色调贯穿。镜头全程只做极缓慢推进运镜不可切换机位不可拉远不可上升下降不可切角度。女孩全程保持自然看比赛状态不可对镜头有任何反应不可害羞不可脸红不可遮脸不可发现自己被拍。直播UI(左上比分牌+右上LIVE HD+底部#StadiumVibes标签)保持稳定不畸变不变化。群演周围球迷必须自然微动(呼吸/转头/喝饮料/拍手等)不可静止如石。现场音贯穿全片不可任何段落寂静。禁止任何文字字幕、品牌LOGO、水印(直播UI除外)。

字符数:1023(≤ 2000 ✅)

8.3 v3 自检 v2 字段

  • 风格总纲含画质来源关键词(升级为"业余手机偷拍录像",更脏)
  • 时序角色显式(首帧——主理人反馈后调整)
  • 时长 = 推算值 8s
  • 群演微动声明(v3 加强:在段落内具体写每个位置的群演动作)
  • 现场音贯穿声明
  • 新增:运镜锁死声明("不可切换不可拉远不可上升下降不可切角度")
  • 新增:主角凝视模式声明("不可对镜头有任何反应不可害羞不可脸红不可遮脸不可发现自己被拍")
  • 新增:UI 文字锁定声明(直播 UI 保持稳定不畸变不变化)

9. v2 → v3 改进对照(重大方向调整)

v2(反应模式) v3(凝视模式)
中间关键帧 K=4.5s 首帧 0-1s 锁定
5-7.5s 害羞反应三拍子节拍 删除整段反应弧线——主角无情绪变化
2-3.5s crowd cam 切镜 删除切镜——单一 Very Slow Push In 推进
4-5s "关键帧抵达"叙事 删除发现叙事——她全程不知道被拍
画质:直播录播切片 画质升级:业余手机偷拍+信号马赛克+丢帧+镜头脏点
群演微动单句声明 群演微动段内具体写:左侧/右后方/前景/远处各自的动作
主角动作:低头刷手机→抬头愣住→害羞 主角动作:自然看比赛(视线随场微调+嘴唇低声评论+手机偶尔抬起又放下)

10. 给主理人的反馈

  • 本 case 是否值得保留作为典型 case:绝对是 —— 这是本次 v2 验证中最重要的方法论发现:v2 缺失"凝视模式"的概念

  • 方法论改进建议(最高优先级):

    1. v2 应新增"凝视模式"作为路径 C 的第二种 Hook 模式范式

      • 当前 v2 默认所有人像类视频都按"反应模式"(情绪反应+子节拍展开)
      • 实际上很多场景需要的是"凝视模式"(无情绪变化+时间本身展开)
      • 建议在 image-to-prompt.md 第 1 轮分析阶段,主动询问用户:"这张图你想要 ① 反应模式(主体有情绪变化)还是 ② 凝视模式(主体自然存在被偷拍)?"
    2. 凝视模式的核心约束模板(建议写入 v2 SKILL.md):

      • 画质:业余偷拍/低质感(永远不要电影级)
      • 运镜:单一 Very Slow Push In,否定句穷举禁止其他运镜
      • 主角:原图既定姿态+小动作(视线随场/嘴唇微动/手部偶尔活动),禁止任何对镜头的反应
      • 时序:图作首帧,整段是这个瞬间的"自然延续"
      • 美感来源:时间凝固的诗意+不知情的真实感
    3. v2 原则 5(物理时间常数)应允许"无反应"作为合法状态

      • 当前 v2 强调"现实类反应必须 ≥X 秒子节拍"
      • 但凝视模式下根本没有反应——应明确"凝视模式不适用物理时间常数"
    4. 画质指令"模型未充分执行"是 v2 的另一个发现

      • v2 已经在风格总纲写了"轻微数字噪点"等画质来源关键词,但模型仍倾向于生成偏干净的画面
      • 建议 v3 加强力度:用更激进的关键词如"信号马赛克、偶尔丢帧、镜头脏点污染、画面偏暗、白平衡漂移"等
      • 同时禁用清单要更明确:"禁用 4K、HD 高清、稳定器、Cinematic、电影级、调色精致" 多重否定

报告完成时间:2026-05-13 09:24 报告人:Claude(晚间执行 Agent · 用户工作流为"产 prompt + 主理人手动跑")


📌 v3 → v4 → v4.1 续篇(2026-05-13 晚间)

本 case 是凝视模式的"试金石" —— 主理人最早暴露 v2 盲区的就是这条 case,也是新方法论最早验证通过的

11. v3 出片效果反馈

主理人反馈:v3 凝视模式方向对了,但主角表情没有任何变化太呆滞,且"画面太干净了,干净的有点过于,很容易看出来是 AI 生成的"

⚠️ 这两个问题分别引出了凝视模式的两个深化:

  • 凝视 ≠ 一动不动(需要自然小动作)
  • 画质需要"双重画质退化"(仅声明业余偷拍不够,要叠加平台压缩 artifacts)

12. v4 改造(凝视模式 2.0)

v4 关键深化:

  1. 图作框架参考不卡帧:"参考@图片1的主角外貌服装与场景氛围但不强制卡任何一帧"
  2. 凝视≠呆滞:主角必须有 3-4 个自然小动作(视线随场上动作微转/嘴唇微反应/撩头发/瞥手机/前倾观看/随节拍点头)
  3. 群演具体动作分配:左侧球迷转头与人交谈、右后方喝饮料、前景拍手、远处挥旗
  4. 比分牌自然推进:第 5-6 秒 0-1→0-2 暗示场上得分
  5. 画质"4 层退化":业余手机偷拍 + 信号马赛克 + 镜头脏点 + 广角畸变

13. v4 出片效果反馈

主理人反馈:"这一次这个直播基本上对了,就是这种感觉" + "画面太干净了,干净的有点过于"

—— 主角行为/常识/凝视感全部到位 ✅,剩下的只是画质还不够脏

14. v4.1 改造(画质终极强化·"双重画质退化"完整模板)

v4.1 核心改进——画质从 1 层升级到 4 层堆叠:

层 内容
① 直播流压缩 artifacts —— H.264 低码率块状压缩感、画面边缘压缩抖动、暗部色块、彩色色噪、压缩色带
② 直播信号瑕疵 —— 第 3-4 秒画质瞬降 0.3 秒模拟信号波动、整体饱和度偏闷不锐利
③ 手机录屏特征 —— 极轻微屏幕摩尔纹、屏幕反光感、色温偏移
④ 底层手机相机 —— 自动曝光起伏、白平衡漂移、握持微抖、镜头脏点污染、广角畸变

禁用清单升级:从 6 个扩展到 9 个——禁用 4K 高清/Cinematic/电影级/稳定器质感/调色精致/工业渲染/画面锐利/清晰画质

风格锁定加正向强约束:"画质必须呈现明显的直播流压缩感和手机录屏感不可呈现 4K 锐利画质不可呈现电影级稳定画质"

15. v4.1 完整 Prompt(最终版)

8秒泰国棒球赛事看台手机录屏直播流偷拍质感,9:16竖屏,参考@图片1的主角外貌服装与场景氛围但不强制卡任何一帧,视频自由演化为日常看球自然瞬间。

画质:手机端观看赛事直播流的录屏偷拍质感(双重画质退化):①直播流压缩 artifacts——H.264 低码率块状压缩感全程明显、画面边缘有压缩抖动、暗部出现色块、彩色色噪、轻微压缩色带;②直播信号瑕疵——第3-4秒之间偶尔出现一次信号瞬抖让画质下降0.3秒(轻微马赛克模糊感)然后恢复、画面整体饱和度偏闷不锐利;③手机录屏特征——极轻微屏幕摩尔纹、屏幕反光感、画面有手机端拍摄屏幕的色温偏移;④底层手机相机:自动曝光起伏白平衡漂移、握持微抖、镜头有脏点污染、轻微广角畸变。禁用4K高清禁用Cinematic禁用电影级禁用稳定器质感禁用调色精致禁用工业渲染禁用画面锐利禁用清晰画质。

现场音贯穿全片不可任何段落寂静:球场欢呼声浪低频涌动随场上动作起伏、扩音解说员低沉泰语男声(语调起伏语义模糊)、远处拍手哄闹、PA广播金属混响、风扇噪声、近处球迷偶尔大喊。

主角:参考@图片1的女生外貌(长发、白色露肩长袖+深色短裙+腕带)和坐姿,坐在看台座位上手里拿着手机看比赛,她不知道自己正在被偷拍。

环境:体育场看台第三排,紫色应援服球迷围绕主角周围,前景偶尔有应援扇/饮料杯/座椅靠背入镜,远处球场有比赛正在进行(虽然画面看不清但通过欢呼起伏和身边人反应可感)。直播UI(左上PUR vs GRY比分牌+右上LIVE HD+底部#StadiumVibes紫色标签)保持稳定不畸变不变化。

0-8秒:镜头单一Very Slow Push In极缓慢推进(8秒内从中景缓慢推到中近景仅放大约15%),全程单一机位无任何切换无任何拉远不可上升下降不可切角度。镜头保持手持微抖。

主角自然行为分布(不需要严格对齐时间但要在8秒内自然发生3-4个):
- 视线随场上动作微转方向
- 看到精彩动作时嘴唇微张做出"哇"的无声反应/或微微抿唇
- 一次用手把垂到脸侧的发丝撩到耳后
- 一次低头瞥一眼手中的手机屏幕又抬头继续看比赛
- 偶尔随节拍小幅度点头或肩膀晃动配合远处欢呼
- 一次身体轻微前倾(看到关键比赛动作的本能反应)

环境同步演化:身边球迷必须有可见微动具体写——左侧紫色应援服女球迷和身边男生交头接耳指着场上方向、右后方男球迷举起饮料喝一口然后放下、前景一个观众随欢呼举起应援扇挥动两下、远处看台有一片观众随某次进攻起立又坐下。比分牌可以在第5-6秒之间发生一次0-1→0-2的自然推进暗示场上得分。

光影:冷白射灯主光+紫色应援服反光弥漫+看台暖光从下方斜打+HDR动态范围溢出但偏闷+紫调底色与白色露肩衣高光对比。

风格锁定:非电影级非Cinematic;紫色应援色调贯穿。镜头全程只做极缓慢推进运镜不可切换机位。主角全程是自然看比赛状态——不可表情呆滞一动不动必须有3-4个自然小动作分布、不可对镜头有任何反应不可发现自己被拍、不可害羞不可脸红。直播UI保持稳定不畸变不变化(仅比分牌允许一次自然推进)。群演周围球迷必须自然微动并具体执行上述动作分配不可静止如石。**画质必须呈现明显的直播流压缩感和手机录屏感不可呈现 4K 锐利画质不可呈现电影级稳定画质**。现场音贯穿全片不可任何段落寂静。禁止任何中文字幕、台词字幕、品牌LOGO、水印(直播UI除外)。

字符数:1408(≤ 2000 ✅)

16. 最终验证状态

✅ v4.1 跑完通过验证——主理人反馈"基本上对了,就是这种感觉"+ 后续追加反馈"画面太干净" → v4.1 修复后通过

17. v2 → v3 → v4 → v4.1 完整迭代追踪

版本 关键改动 主理人反馈
v2 中间关键帧 K=4.5s+害羞反应三拍+导播 crowd cam 切镜 还是太高清没噪点+就拍那个女生不要切镜+美女不需要害羞
v3 凝视模式 1.0:删 crowd cam 切镜+删害羞反应弧+主角姿态锁定 这次直播基本上对了,但表情太呆滞+画面太干净
v4 凝视 2.0:图作框架参考不卡帧+主角 3-4 个自然小动作+群演具体动作+比分牌推进 基本对了+但画面太干净 AI 生成感重
v4.1 画质 4 层退化(直播流压缩+信号瑕疵+录屏特征+底层相机)+9 个禁用清单+正向强约束 ✅ 通过

18. 本 case 的方法论意义

⭐ 本 case 是凝视模式的奠基 case ⭐

通过这条 case 的迭代沉淀出了路径 C v3 方法论的核心要素:

  • 凝视模式 vs 反应模式 的范式区分
  • 图作框架参考不卡帧 取代"图作具体某一帧"
  • 主角自然行为 3-4 个分布 让凝视≠呆滞
  • 画质 4 层退化模板 解决"AI 生成感"
  • 群演具体动作分配 取代单句"群演微动"声明
  • 9 个禁用清单 + 正向强约束 的画质防御性写法