Files
mcn-short-video/.workbuddy/memory/2026-08-25.md
T
maogeigei b3685504d7 技能三副本迭代:路径重构+输出边界铁律+开场口径区分+审计修复
- 路径重构:脚本创作 V1.0/Lite1.0 扁平化(去技能文件夹层),分镜技能迁移至 短视频提示词生成/V1.0,旧路径清理
- 输出边界铁律固化:创作流程规范.md 新增「交付物输出边界(通用铁律)」+ S9 输出模板新增「输出边界」块(验收口径=执行约束非输出内容)
- 开场钩子铁律三层固化:00_开场/06_编导终审/S9 相关规则 + S5 预设钩子口径区分(前3秒=呈现窗口,3-7秒=开场段总时长)
- 帮助文档:新增「从账号分析到脚本创作」跨技能章节(你这样问|我会做什么风格)
- mcn-dou-analysis 内嵌副本:红线边界声明+人设卡术语更新(设定分析说明)
2026-08-26 17:28:21 +08:00

63 KiB
Raw Blame History

2026-08-25 工作日志

短视频分镜脚本 — V1.0 与 .dsh 副本对齐(双向各一处)

  • 背景:用户询问 V1.0 源端与 C:\Users\maidou\.dsh\skills\storyboard-prompt 是否同源、是否需同步
  • 同源确认:目录结构一致(references 4制作流程+15知识库+参考skills+references-add),除 SKILL.md 外全部文件 diff 零差异;源端独有 output/(开发样例,不部署,正常)
  • 分叉点:①.dsh 端 08-21 description 精简未回流 V1.0 ②V1.0 端 08-24 F1 扩展未同步 .dsh
  • 用户决策:两项都做(回流 description 精简 + 授权同步 F1 扩展到 .dsh)
  • 执行:
    • 回流:V1.0 SKILL.md description 替换为 .dsh 精简版(能力域+触发场景),name 保留「短视频分镜脚本」
    • 同步:.dsh SKILL.md F1 节替换为 V1.0 扩展版(11维度观察/人物专项5项/类型判定7类/类型适配表/文字转录强制要求/反向提示词6分类),保留 .dsh 的 name(storyboard-prompt)与精简版 description
    • 版本标签:两端 updated_at→2026-08-25,last_change 各自记录动作(回流/同步)
  • 验证:SKILL.md diff 仅剩 2 处预期差异(name 环境适配 + last_change 各自记录);全目录 diff 零差异(除源端 output/)
  • 备注:本次写 .dsh 为用户明确授权的例外(单向只读铁律 2026-08-22 仍然有效,默认不写 .dsh)

教训沉淀

  • 部署副本对齐要双向核对:分叉不一定单向——本次回流缺口(.dsh→源)与同步缺口(源→.dsh)同时存在,只看一个方向会漏;用 frontmatter 的 updated_at/last_change + 全目录 diff -rq 三件套可快速定位分叉点

短视频脚本创作 — 极致事件补充分类沉淀落地(V1.0 + Lite1.0 双副本)

  • 背景:用户评估外部"极致事件分类体系"后,指示按沉淀总图执行优化;核心原则"ABC 是根,其他分类是枝——根定本质,枝定落地"
  • 沉淀决策(4 补充分类 + 1 不沉淀):
    • 叙事功能(钩子/留人/转粉/传播)→ S7 创作流程新增「极致触点节点布位」表(4型+用法非属性+密度闸门)+ 大纲质量校验「极致触点布位检查」(开场钩子场≥1、每15-20秒≥1、结尾建议转粉型)
    • 赛道专属 → 13_极致事件_分块示例 赛道对照表 8→12 行(并入味觉想象→美食、认知颠覆→学习教育、情感浓度→剧情、耗时精度→手工、环境强度→户外、效率→职场/干货)
    • 克制极致(隐性手法)→ 05 总纲机制说明("不表达"表达,本质仍属戏剧极致,不单列本质类)
    • 专属符号 → 极致行为三分类→四分类(+专属符号型:跨视频复现的账号记忆点,沉淀账号专属层)
    • 情绪属性 → 不沉淀(情绪价值由 07_情绪共鸣 承接,总纲补「情绪落点」指针)
  • 文件落点(V1.0 与 Lite1.0 同构同步,共 7 处):
    • 05_极致事件/00_极致事件总纲.md:克制极致说明 + 情绪落点指针 + 极致行为简表 3→4 类
    • 05_极致事件/极致行为创作法_通用_内容设计.md:三分类→四分类(+专属符号型+说明)
    • 创作流程/7_生成短视频大纲.md:布位表 + 校验行
    • 残留修正 3 处「极致行为三分类」→「四分类」:创作流程规范.md(S6行)、索引_知识素材库.md、6_生成短视频框架.md
    • SKILL.md 版本标签:updated_at→2026-08-25 + last_change
  • 单副本(内容创作产品规划):
    • 素材库/产品规划/短视频素材库产品规划.md:核心规则第14条「专属符号沉淀(账号专属层)」+ Phase 7 补充
    • 知识库/分块示例/13_极致事件_分块示例.md:赛道对照表 12 行
  • 验证:全量 Grep 确认「极致行为三分类」零残留(账号类型三分类为无关概念,保留);四分类/克制极致/专属符号/布位表双副本对称
  • 教训:改维度分类后必须全局 grep 旧分类名(如"三分类"),且要区分同名不同义概念(极致行为三分类 vs 账号类型三分类)

创作流程+知识库 执行通畅性审计(技能审查表 13 条)

  • 结论:总体通畅,无 P0;发现 4 个 P1 + 2 个 P2(V1.0 与 Lite1.0 双副本同构存在)
  • P1:
    1. 创作流程规范.md 四·知识库分类索引表过时:09_脚本诊断 标 3(实际 4,缺「故事成立性校验」)、总计 65(实际 66)
    2. SKILL.md 关键规则七引用 ../../失误与规避记录.md 断链(文件在项目根,需 ../../../../)
    3. S9 处理规则「2. 脚本结构」骨架示例(32-84 行)与输出模板(348+ 行)/创作流程规范三矛盾:A 骨架缺 5 字段画面元数据行;B 骨架加粗分行(应为同一行不加粗);C 骨架分行(应为同一行);86 行"不单独用【】标注"与规范 244 行"S9 有粗粒度画面元数据"冲突
    4. S9「### 闪回叙事规范」标题重复(113/115 行)
  • P2:S10 景别列表缺「大远景」(6 vs 规范/知识库 7);S7「第二步半」/S11「三·五」编号命名(功能 OK)
  • 通过项:11 步顺序/编号/无跳步✅ 三层职责分离(S6情绪/S7结构/S9演绎)✅ 数据流全链贯通(共鸣切入点/目标体感/故事前提/场次结构/情绪卡/广告占位)✅ 知识库引用零断链(脚本扫描)✅ 素材库调取链路完整✅ 术语统一(故事细节/三段式五段式)✅ 硬编码零残留✅ 产物链红线双处强制✅
  • 审计方法沉淀:①知识库文件数 vs 索引计数核对(bash wc)②步骤文件引用断链脚本扫描(python 正则匹配 .md 链接 + 磁盘对照)③关键字段跨步骤 grep 流转图(S5→S6→S7→S9→S11)④S9 骨架 vs 输出模板 vs 权威规范三方对照(骨架示例易与权威源脱节)

短视频分镜脚本 — F1 流程评估优化10项(仅 V1.0)

  • 背景:用户要求评估 F1 反推图片提示词流程并执行优化(P0→P1→P2 逐步)
  • 评估发现:骨架完整但 3 个 P0 硬缺口(画面文字维度空隙/词库引用链路断裂/F1 节 references 引用数为 0/目标平台适配缺失)+ 3 个 P1 + 4 个 P2
  • 落地(全部在 SKILL.md F1 节,F2/F3/F4 未动):
    • P0:①文字转录触发放宽为"画面含可辨识文字即必做,不限类型"(堵人像slogan/场景招牌漏观察)②补「详细方法论」6条词库引用(01主体/07光影/09色彩/14构图/10+12质感/15风格,指针全部验证存在)③补「目标平台适配」4平台(默认即梦自然语言/MJ参数式--no/SD权重+负面框/NanoBanana)
    • P1:④结构化版格式模板(10字段分行)+双版本适用说明 ⑤多图模式(共通主体交集+差异项+冲突标注,衔接F3角色卡)⑥风格反推双轨输出(命名+参数化描述+置信度)
    • P2:⑦图片质量前置扫描并入step1 ⑧置信度维度级风险分级并入step4(高风险:风格/氛围/符号内涵)⑨反向词×图片类型映射规则 ⑩版本标签 updated_at 2026-08-25
  • 验证:F1 节通读确认10项全部落地;引用指针指向的7个知识库文件章节均提前 grep 验证存在
  • 备注:.dsh 副本已于同日授权同步(用户明确授权后 F1 节优化版整体替换移植,保留 name/精简description;验证 SKILL.md diff 仅剩 name+last_change 两处预期差异,updated_at 两端一致)
  • 教训:功能节的知识库引用块(详细方法论)是标准结构,新功能节(如 F1 由内建方法论发展而来)容易漏配;评估某功能完整度时先查"该节 references/ 引用数是否为 0"

短视频分镜脚本 — F1 实跑复盘修复5项(仅 V1.0,.dsh 未同步)

  • 背景:用真实图片(古风双女主街道)实跑 F1 反推,用户连续三轮抓漏:①焦距缺失②肤色写"白净"违反具体色名规则/族裔妆容缺失/时间不显式③水印文字不应写入提示词
  • 落地(V1.0 SKILL.md F1 节):
    • 文字二分类新规则:内容性文字(招牌/文案/slogan)写入提示词正文;标识性文字(水印/署名/@账号名/logo/时间戳)只进观察报告+反向词"水印",禁止写入正文(写入会令生成图带上水印)
    • 结构化模板升级:新增【基础属性】行(画幅比,即梦UI设置不写入/MJ --ar)+【构图】行补焦距+光圈(示例 85mm f/1.8)+【主体】补肤色具体色名+【文字】行标注水印类不写入+【负面约束】含"水印"
    • 详细方法论引用块补3条:06焦距视角(必)+03场景模板+11特效渲染(可选)
    • 版本标签 last_change 更新为实跑复盘修复摘要
  • 备注:.dsh 副本已于同日授权同步(用户确认合并修复方案后,5项复盘修复逐条移植;验证 SKILL.md diff 仅剩 name+last_change 两处预期差异,updated_at 两端一致,F1 节完全一致)
  • 教训(两层):①执行层——规范有槽位不代表会被填,模板字段(如焦距)与专项规则(如肤色具体色名)在生成时易被跳过,实跑是检验规范落地唯一手段;②规范层——水印/署名类标识性文字与内容性文字必须分叉处理,"全部转录"一刀切会把水印带进生成图,效果适得其反

创作流程+知识库 审计问题「按顺序修复」执行(V1.0 + Lite1.0 双副本同步)

  • 按审计清单顺序逐条修复(P1-1→P1-2→P1-3→P1-4→P2-5),每条修改后立即验证
  • P1-1 索引计数:创作流程规范.md 371 行 09_脚本诊断 3→4(补「故事成立性校验」)+ SKILL.md 目录概览 65→66 个方法文件(磁盘 wc 实测 66 确认)
  • P1-2 断链:SKILL.md 关键规则七 ../../失误与规避记录.md → ../../../../(SKILL.md 在 脚本创作技能/ 下,上跳 4 级才到项目根;目标文件实测存在)
  • P1-3 S9 三处对齐权威规范(骨架/输出模板/System Prompt):
    • A 骨架场1/场2 补 5 字段画面元数据行【景别 | 环境 | 光线 | 场景 | 场景元素】(与输出模板/规范一致)
    • B 骨架整体重写:场标题去加粗(规范 B 明确"不加粗",System Prompt B 同步改)+ 补 5 字段行 + 旁白/角色改同一行不加粗(原加粗分行);输出模板 B 场1/场2/场3 去加粗
    • C 骨架口播改同一行({角色名}(口播·{语气}):台词)
    • 86 行分镜要素分离表述对齐规范 244 行:S9 不输出【景别|光线|入镜】分镜三要素,但 5 字段画面元数据属 S9 画面提示(粗粒度),S10 细化;System Prompt 区 241 行同步泛化(A 场次画面元数据 / B Vlog)
  • P1-4 S9 删除重复「### 闪回叙事规范」标题(112/114 行)
  • P2-5 S10 景别列表 2 处补「大远景」(远景/全景/中景/近景/特写/大特写 → 大远景/远景/全景/中景/近景/特写/大特写,对齐规范 331 行 7 项)
  • 验证:零残留 grep 全过(65/3/../..//加粗分行/6项景别/旧分离表述/重复标题);S9/S10 文件双副本 diff IDENTICAL;SKILL.md diff 仅剩固有差异(name/version/last_change/MCP 依赖 vs 轻量说明)
  • 版本标签:双副本 updated_at 2026-08-25 + last_change 记录本次修复摘要
  • 教训:三方对照(骨架 vs 输出模板 vs 权威规范)修复时,不只改骨架——输出模板/System Prompt 同源错误须一并对齐,否则"三矛盾"变"两矛盾"仍留痕;S9 骨架区是历史遗留易腐点,后续改动骨架示例必须同步核对输出模板区

短视频脚本创作 — V1.0 ↔ .dsh 双向同步(脚本创作技能,授权写 .dsh)

  • 背景:用户要求对比 C:\Users\maidou\.dsh\skills\short-video-script 与 V1.0 源技能,选择「双向同步」——V1.0→.dsh 同步 + .dsh→V1.0 回流(并同步 Lite1.0)
  • 核心发现:13 个差异文件中仅 2 个干净单向复制,其余为双向差异——.dsh 有结构增强(时间/年龄规范、数字账取证、行为来源与时间线、案例库),V1.0 有更具体的大炮创作教学案例。合并原则:V1.0 保留具体案例 + 吸收 .dsh 结构增强
  • .dsh 独有资产(重要,已回流):「时间/年龄规范 + 数字账取证」体系——AI 不擅长具体数字一致性,心算自查必然失效,唯一可靠方式是"把正文实际出现的数字逐条列出,串链核对(取证,而非心算)";全片时间/年龄默认模糊表述("很多年前/小时候/那几年"),禁止堆砌精确数字;只允许一个时间基准
  • 执行:
    • V1.0 回流合并 5 文件:S5(时间/年龄表述规范+时间锚点)、S6(事件标注两→三标注+复盘七问补行为来源/时间年龄+数字取证)、故事成立性校验(二·五数字账取证整节+案例3/4)、S9(自检清单补2条剧情类)、S11(数字账取证5处)
    • Lite1.0 同步:S5 按环境合并(保留 Lite 搜索表述)、S6/S9/S11/故事成立性 4 文件直接复制、SKILL.md S11 摘要补全
    • .dsh 写入 12 文件(保持 CRLF 行尾):11 内容文件 + SKILL.md 手工合并(script-review 引用行不回流、失误记录路径 3 层保持原样、66 方法文件)
    • 术语修复:V1.0 7_生成短视频大纲.md 8 处「口播/独白/台词方向」→「口播/旁白/台词方向」(Lite 已正确,修复后三端 IDENTICAL)
  • 环境差异清单(不回流/保留):.dsh script-review 技能引用行、失误记录引用路径 3 层(.dsh 无失误记录文件,改 4 层指向用户根目录更错)、路径配置、S5 搜索表述(Dify/搜索引擎 vs 模型自带联网)、创作流程规范 grep scripts/(Lite 独有)、SKILL.md frontmatter name/version、帮助文档
  • 最终验证:V1.0 vs .dsh 仅剩 SKILL.md 差异(预期环境差异);V1.0 vs Lite 剩余差异全部为验证过的环境差异;全局「独白」残留扫描剩余均为「自我独白」素材库合法分类
  • 备注:本次写 .dsh 为用户明确授权的例外(单向只读铁律 2026-08-22 仍然有效,默认不写 .dsh)
  • 教训:跨环境技能同步三要点——①CRLF 感知 diff(裸 diff 因行尾显示整文件不同,必须 --strip-trailing-cr);②双向差异要逐文件判定"谁的结构更强",不是简单覆盖;③环境特有内容(技能引用/路径/搜索能力表述)必须识别排除,否则会把环境 A 的约束带进环境 B

短视频分镜脚本 — F1 还原力补强7项(仅 V1.0,.dsh 未同步)

  • 背景:实跑复盘修复后用户继续追问"没有物品/场景布置/方位,这样能还原图片吗""还要哪些信息"→ 确认 F1 观察维度有提及但无执行精度与模板槽位,知识库有资产(02动作行为/14前中后景/06画面坐标)但 F1 未 surface
  • 落地(V1.0 SKILL.md F1 节,合并上轮三项+本轮四项):
    • step 2 十一维度逐项加观察精度要求(括号标注):画面坐标方位(画面左/右禁机位相对方向)/光影方向精确化/色彩具体倾向/道具独立清单/场景前中后景三层/虚化梯度
    • 人物专项行追加还原力精度:姿势写到角度/手部/视线落点粒度(引 02 词库);神态用 01 微表情 7 区域×4 级强度语言(禁抽象情绪词)
    • 结构化模板扩为 17 字段:新增【道具】【场景布置】【方位】【人物空间关系(多人)】【姿态与视线(含人物)】+【镜头】行独立(焦距+光圈+虚化梯度);人物相关字段按图类取舍
    • 「注意」行后新增还原路径指引:100%复刻→图生图/垫图;改图延展→文生图直接用;学图→变量提炼
    • 详细方法论引用块:补 02_动作行为行 + 14 行加前中后景/画面坐标 + 06 行加 X 轴朝向/画面坐标规则(现为 10 条指针)
    • 「输出格式」行维度清单同步 17 字段(发现旧 11 项清单未随模板更新,一并修正)
    • 版本标签 last_change 更新
  • 验证:F1 节通读确认;字段数自检发现标注 16 实为 17(数错一处已修正)——字段计数须逐个数
  • 教训:①模板扩字段后必须同步更新同节其他引用该字段清单的位置(输出格式行易漏);②"还原力"类优化的判断标准不是"维度提没提"而是"精度够不够执行"(有方位槽位≠写到画面坐标粒度)
  • 备注:.dsh 副本已于同日授权同步(随文生图验证修复轮一并两轮合并移植)

短视频分镜脚本 — F1 文生图还原力验证修复7项(仅 V1.0,.dsh 未同步)

  • 背景:用户拿 F1 提示词在即梦实际生成图片,与原图对比暴露 6 类还原缺口 + 1 类输出格式违规(模板有"按维度分行"但实际输出合并单行)
  • 对比实测结论(文生图还原极限约65%):①左右手翻转("右手持"身体坐标模型执行率低)②复合姿势丢失(扛+斜搭+延伸只保留1个动作)③强方向光+烟雾被平均化为平光④微表情 L1-L4 强度词模型不识别(A大笑变平静)⑤易漂移色名偏移(灰白→灰蓝)⑥后景脑补多出山、烟雾被放大;✅水印反向词拦截成功、方位/空间关系/浅景深还原好
  • 修复落地(V1.0 SKILL.md F1 节,7项合并为6处编辑):
    • step 2:光影行加强方向光转译(轮廓光/边缘光/丁达尔光束替代角度描述)+色彩行加易漂移色名锚定(灰白/米白/棕黄加参照物或排除色相)+场景行加穷尽清单原则(未出现大类元素进负面约束)
    • 人物专项还原力精度扩为5条:姿势动词≤2个/人+复合动作改道具几何锚定(接触点+两端画面位置)/持物方位优先画面坐标("右手持(该手位于身前偏画面左)")/微表情双轨制(观察用7区域×4级、正文转译直白词"露齿大笑")/禁抽象情绪词
    • 模板17字段:分行改硬性格式(禁止合并单行)+道具行加接触点+两端画面位置+主体行色名锚定+光影行光效词+负面约束加反脑补项
    • 反向词规则加反脑补项(山/塔/水面等未出现大类元素+浓烟)
    • 详细方法论07行加光效转译注
    • 版本标签 last_change 更新
  • 教训:①观察语言≠生成语言——L值强度/角度描述是创作者语言,写入提示词正文必须转译为模型可执行词(直白可视化词/具体光效词/画面坐标),这是"双轨制"的本质;②身体坐标(左右手)执行率低于画面坐标,持物类必须双锚定;③模板格式要求(分行)必须标"硬性"否则执行时被合并——同一条"规范有槽位≠会被填"的又一例证
  • 备注:.dsh 副本已于同日授权同步(还原力补强+文生图验证修复两轮合并移植,8处编辑;验证 SKILL.md diff 仅剩 name+last_change 两处预期差异,updated_at 两端一致,F1 节完全一致)

短视频分镜脚本 — F1 第二轮生成对比修复8项(仅 V1.0,.dsh 未同步)

  • 背景:用户用修复后提示词二次生成再对比,指出三大问题:背景虚化不足/脸部朝向不对/服装还原度低;全面扫描另发现4项+用户决策废弃极简版
  • 用户关键决策:极简增强版废弃——"没有什么用,要尽可能完全还原",F1 定位还原导向,只输出结构化版单版本
  • 修复落地(V1.0 SKILL.md F1 节,7处编辑):
    • 虚化结果转译:焦距光圈是光学参数模型不推算,直接写视觉状态("背景模糊成柔和色块仅可辨轮廓剪影")
    • 脸部朝向可见部位锚定:四分之三侧脸=完整一眼+另一只部分+一只耳朵("可见右耳"),方向词执行率低
    • 服装结构扩写:外层(品类+颜色+衣长+袖型)+内层可见+腰部(宽窄+位置)
    • 字段按还原优先级重排:关键还原项前置(主体/朝向/虚化),背景细节后置——模型对提示词开头权重最高;基础属性移至末尾
    • 逆光入画写法:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"替代名词性"轮廓光"描述
    • 表情分离+前置:多人画面表情分开描述禁合并(模型对"双人一致表情"有先验会平均化),写入【主体】行靠前
    • 负面约束加对抗项:背景清晰/背景细节过多/景深过大(反向词压制反效果)
    • 同步修正:详细方法论07行旧"轮廓光转译"表述更新为逆光入画;人物专项还原力精度扩至⑦条
  • 教训:①**"参数→结果"转译规律**:凡是技术参数(焦距/光圈/角度/L值)模型都不推算,必须写"看起来的样子"(视觉状态直述);②提示词位置=权重:模型对开头权重最高,字段顺序不是排版问题而是效果问题;③负面约束可作对抗手段——不止排除错误,还能压制"该虚不虚/该糊不糊"的反效果
  • 反优化复查(用户要求确认,自查发现4项自己引入的问题并修复):①P0 虚化转译+对抗项原是无条件规则——对产品/建筑等全清晰深景深原图会反向强加虚化,已条件化(仅原图有虚化时才写虚化结果+对抗项;全清晰图写"全画面清晰锐利");②P1 对抗项"背景清晰"有拆词风险("清晰"被整体否定→全图发软),已删,保留完整语义单元"背景细节过多/景深过大";③P1 服装"腰封宽窄"预设腰封存在——现代装会被脑补出腰封,改"腰带/腰封如有"+补现代装示例;④P2 朝向可见部位锚定仅适用人像,非人物补角度锚定(正对/45度/侧面)
  • 教训(反优化层):给通用功能加规则必须问"7类图片都适用吗"——虚化/腰封/人脸锚定都是从人像案例泛化出的规则,未过一遍产品/建筑/美食就是潜伏反优化;负面词组要按"拆词后各部分单独是否安全"审查
  • 备注:.dsh 副本本轮未同步,待用户单独授权

短视频分镜脚本 — F1 画面感保护条款3项(仅 V1.0,.dsh 未同步)

  • 背景:用户对比两轮生成图后指出第一轮(还原度低的)画面感反而更好——揭示"还原度≠画面感"张力;批准"可以试试"
  • 落地5处编辑(V1.0 SKILL.md F1 节):
    • 画面感保护条款段落:还原导向≠无脑精确化,逐项精确的同时保留 1-2 处"模糊氛围词"(远景暖光晕染/空气透视感/轻雾弥漫)不拆解不量化
    • 反脑补规则细化形态级:未出现的形态级元素(山体/塔/水面/招牌等具体形态)才进反向词;概念级氛围词豁免——它们是画面感来源
    • 人物专项⑧场景统一性声明:多人画面必加"同一瞬间:同一光线、同一情绪节律、同一画面感"
    • 结构化模板【人物空间关系】行加同一瞬间声明
    • 版本标签 last_change 更新
  • 教训:精确与氛围是互相拮抗的优化目标——纯精确提示词(无氛围词)生成的图还原度高但像"摆拍工作照",丢生活瞬间感;反脑补规则粗用(概念级一刀切)会误杀画面感来源,必须区分形态级(脑补风险)与概念级(氛围资产)
  • 备注:.dsh 副本本轮未同步(现共落后三轮:第二轮修复8项+反优化修正4项+画面感保护3项),待用户单独授权

短视频分镜脚本 — F1 第三轮生成图对比+四轮独立观察复盘(仅 V1.0,.dsh 未同步)

  • 用户贴第三轮生成图:"怎么感觉越来越差了";随后指出我对比分析有误(脸型/朝向/表情全错但我判了✅)——确认偏差:拿提示词写了什么去"确认"图,而非独立观察
  • 四张图(原图+三轮生成图)独立重观察核心发现:
    • 第三轮非全面变差:A 表情(嘴大张)反而最接近原图——"O形"描述生效;但 B 闭合微笑被污染成张嘴露齿、脸型变圆宽、对襟丢失变V领睡袍、扁担水平、背景虚化变弱
    • 第一轮(极简版)在 4 项上最强:A 对襟结构/B 披帛双手拎两端/A 扁担斜向下/背景虚化——信息密度低模型自然走对
    • "同一情绪节律"是 B 表情污染源:模型把"情绪节律统一"读成"两人表情趋同",单向把 B 拉向 A(A 大张→B 也张嘴)——⑧场景统一性与⑥表情分离打架
    • "领口V形交叠"引入"V"概念→模型优先执行"V领"→对襟丢失(第一二轮没这个词反而对襟都对)
    • "扁担另一端延伸出画面左下角外"的"外"被脑补成"指向画面外"→扁担水平横穿(第一二轮"斜向下"写法有效)
    • 用户判断:第二轮氛围最好——第二轮是8项精确约束加入前的版本,信息密度适中,模型有自由度渲染氛围;第三轮精确项堆满→注意力被细节吸干→氛围没了(精确与氛围拮抗的又一实证)
  • 第四轮综合策略(用户指令"综合各轮优势"):第二轮氛围基底+4项定向精确修正(A表情O形/B表情闭合锁死/扁担斜向下/服装对襟删V形交叠)+删污染项(同一情绪节律/耳饰/竹篮/冗长朝向锚定)+氛围段前置到开头
  • 新原则沉淀(待第四轮验证后固化 SKILL.md):「关键项精确化+其他项自然化」——精确项堆到6+维/人物时模型注意力被摊薄,关键项命中其他项崩盘;对比生成图必须先独立观察再对照提示词打分,禁止拿提示词"确认"图(流程铁律)
  • 备注:.dsh 副本未同步

短视频分镜脚本 — F1 结构化版实体聚合(仅 V1.0,.dsh 未同步)

  • 触发:用户审第四轮结构化版后发现人物信息散在【主体】【方位】【姿态与视线】【人物空间关系】【道具】五个字段里——"人物相关的提示词就应该写到一起 包括这个人所有的信息"
  • 核心改动:结构化版模板从"按维度切分17字段"改为"人物按实体聚合每人一块+全局项独占字段";结构化版与整段版同一聚合结构,差异仅在有/无字段标签
  • 聚合清单(每人一块内顺序):基础(脸型+肤色)→表情→发型与佩戴物(簪/耳饰)→服装含材质→朝向→姿势动作→持物→视线→空间位置
  • 同步修复4处旧残留:①⑥"写入【主体】行"改"写入人物块靠前";②⑧"同一情绪节律"删除(防B表情趋同污染);③"17字段"/"按维度"表述更新;④"转写后逐件核对"改"逐件核对"(两层同结构不再叫转写)
  • 教训:拆散病不分审计层/生成层——审计层按维度切分也破坏实体归属(材质/颜色/道具跨字段模型也无法归属),人审核对也应按人而非按维度

短视频分镜脚本 — F1 全局项4块聚合(仅 V1.0,.dsh 未同步)

  • 触发:用户审第四轮结构化版后发现人物聚合后,全局项仍散在8个字段(场景/场景布置/镜头/光影/构图/色彩/材质质感/风格/氛围),且信息严重跨字段重复
  • 重复清单:"中近景+平视"在镜头/构图各一次;"前景清晰锐利"在场景布置/镜头各一次;"后景屋檐树冠剪影"在场景布置/镜头各一次;"左侧微光烟雾"在场景布置/光影各一次;"暖色调"在光影/色彩各一次;"A居中偏左B居中偏右"在构图/人物段位置各一次
  • 合并方案:8散字段→4聚合块——①场景(环境+前中后景内容,只写"有什么"不写虚化)②镜头(景别+机位+虚化+构图定位,合并旧构图)③光影(光源+逆光入画+色调系统,合并旧色彩)④风格与氛围(风格+情绪+画面感词+全局质感,合并旧材质质感/风格/氛围三字段)
  • 新规则:全局项禁止跨字段重复——同一信息只在一处写,虚化只写镜头层、色调只写光影层、人物画面位置只写人物段尾
  • 教训:全局项也有归属问题——散字段导致同一信息写多次(虚化状态同时出现在场景布置"前景清晰"和镜头"前景清晰锐利"),模型收到重复指令时反而不确定优先级

短视频分镜脚本 — F1 人物位置移至场景层(仅 V1.0,.dsh 未同步)

  • 触发:用户质疑"人物位置朝向是不是放在场景中更好"
  • 分析判断:位置=关系性(A略前于B需两人同时在场才能定,放人物段造成循环引用)→移场景;朝向=个体渲染属性(决定怎么画脸/可见部位锚定与表情一体)→留人物段
  • 改动:人物段末尾删"站在画面中偏左/右+前后关系+同一瞬间声明";场景段补"人物布局"(每人画面位置+前后关系+间距+同一瞬间声明);镜头段删"人物画面位置定位"(已在场景层写)
  • 聚合清单末尾从"→空间位置+同一瞬间声明"改为"→视线落点"收尾
  • 教训:关系性信息归场景,个体渲染属性归人物——位置是"把人放哪"(layout),朝向是"怎么画这个人"(rendering),拆分依据是信息性质而非字段美观

短视频分镜脚本 — F1 人物标签去位置化(仅 V1.0,.dsh 未同步)

  • 触发:用户指出【画面左侧女性A】标签冗余——位置信息和角色编号混在标签里,而位置已在场景段写过("A居画面中偏左略前"),两处重复
  • 改动:人物标签从"画面位置+角色编号"改为"性别+角色编号"(如"女性A""女性B",单人时"人物");标签只负责标识"是谁",位置归场景层;朝向描述里同步删去"+画面左中右位置"
  • 教训:标签=标识符,正文=信息载体——标签里带可变信息(位置)必然与正文重复;标签只需最小辨识度(性别+编号够用,裸编号不够)

短视频分镜脚本 — F1 表情描述禁几何抽象词(仅 V1.0,.dsh 未同步)

  • 触发:用户质疑"嘴大张呈O形"是否符合画面——重新独立观察原图发现A嘴实际是横向咧嘴大笑+上排牙齿完全可见+嘴角上扬外扩,不是几何圆形O
  • 根因:几何抽象词被模型字面执行——"O形"被读成emoji 😮那种垂直方向圆嘴,生成"惊讶张大嘴"而非"咧嘴大笑"
  • 同类病汇总:①"对襟+V形交叠"→V领睡袍(V字面执行)②"轮廓光"→模糊轮廓(名词性描述缺动作)③"嘴大张呈O形"→圆形惊讶嘴(O字面执行)——抽象词/几何词/纯名词都是字面执行高危区
  • 修法:动作状态词优先 + 可观察子状态(开怀大笑/咧嘴大笑/放声大笑/会心微笑 + 露上牙/上排牙齿完全可见/眼睛眯成弯月);禁几何抽象词(O形/一字形/V形/圆形/椭圆形/一字眉)必须改具体可观察形态或动作状态词
  • 替代词映射:O形嘴→咧嘴大笑/露齿大笑;一字眉→眉头平直;V形领→两片襟布在胸前交叠形成斜向襟线;圆形脸→脸型短宽下颌圆钝
  • 教训:描述怎么笑用动作状态词(开怀大笑/咧嘴大笑),描述怎么张用具体可观察子状态(露上牙/上排牙齿可见),禁几何抽象词——这是"对襟"问题的通用化版本,所有写"XX形/XX状"的词都应做一次"字面执行审查"

短视频分镜脚本 — F1 水印零出现在正向提示词(仅 V1.0,.dsh 未同步)

  • 触发:用户指出【文字】字段写了"左下角水印(@ACVIP…)只进反向词"——反向词的内容不应出现在正提示词中
  • 根因:旧规则"水印类不写入"被执行成"要说明水印不写入",说明性文字本身把"水印"字样带进了正向提示词——正向提示词提及"水印"字样本身就有诱导生成水印的风险(含否定式提及)
  • 修法:标识性文字(水印/署名/@账号/logo/时间戳)正向提示词零出现——观察报告提及即可,负面约束"水印"项承载;无内容性文字时【文字】字段整个省略
  • 教训:否定式提及也是提及——"不写水印""水印只进反向词"这类元说明对模型是噪音+风险词;规则要在文件内部执行完,输出层不留执行痕迹

短视频分镜脚本 — F1 参数化/CGI术语清理4项(仅 V1.0,.dsh 未同步)

  • 触发:表情"O形"修复后的同类问题扫描,用户确认修复清单
  • 改动(模板级):①镜头层删"焦段参考(如85mm)"并加禁令——禁写焦段/光圈参数与"浅景深"等参数化术语,虚化结果句已承载全部景深信息(修复与"参数→结果转译"规则的内部矛盾,P0)②光影层加渲染术语禁令——"体积光"是CGI术语,直白写"光柱清晰可见"③服装结构加汉服专有品类形态锚定——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定(搭肩/双手拎两端)兜底可不加
  • P2保留不动:披帛/中近景/弯月/机位——自然搭配隐喻词有模型先验支撑,过度替换会掉进"全术语洁癖"
  • 教训:抽象词要分两类——无锚定的几何/参数/CGI术语(O形/85mm/浅景深/体积光)必须转译;自然搭配隐喻词(眯成弯月/古铜肤色/四分之三侧脸)保留。判据是模型训练数据里该搭配有无稳定视觉先验
  • 修法映射:浅景深→删(虚化结果句承载);体积光→光柱清晰可见;抹胸→抹胸(贴身吊带状)

短视频分镜脚本 — F1 反向词正向零出现核对(仅 V1.0,.dsh 未同步)

  • 触发:用户确认"否定式提及也是提及"原则推广到所有反向词——输出时逐项核对负面约束词是否在正向提示词任何位置出现
  • 固化:负面约束模板字段加"反向词正向零出现核对(输出后必做)"——逐项核对每个反向词(含子串/否定式提及/说明性文字),出现即改正向措辞
  • 实际核对当前版抓到真冲突:正向"中景人影模糊" vs 反向"模糊"——反向词在压制正向意图的背景虚化,是第三轮虚化失效的嫌疑原因之一;模板镜头层示例自己写的"背景模糊成柔和色块"同款冲突,一并改"虚化"
  • 修法:正向虚化描述统一用"虚化/朦胧"避开"模糊"字样;反向词表不动
  • 教训:反向词与正向描述是同一场拔河——反向"模糊"不只压"画质模糊",也压"背景虚化"(模型按词不按意图);正反词表要交叉核对后才能定稿

短视频分镜脚本 — F1 画面质感层独立成字段(仅 V1.0,.dsh 未同步)

  • 触发:用户贴参考图(渲染参数堆砌范式:画面质感/色调光影/场景/人物氛围/镜头语言5大类)指出"风格与氛围"应承载画面质感并问还缺什么
  • 缺口分析:①画面质感(渲染参数层)全缺——8K/微颗粒/非完美锐度/轻微色差/HDR/纪录片摄影风格,此前被并进风格与氛围但实际是独立渲染指令层,只有流派词无渲染参数→模型默认按现代高清管线生成,丢失胶片味;②镜头运动/拍摄风格全缺——镜头字段只有景别+机位+虚化(静态布局),无POV/手持等拍摄风格
  • 落地(用户确认"先修复",重落地三项):①新增【画面质感】字段(渲染规格+质感风格锚定+反向词冲突审查)②镜头字段扩展拍摄风格子项(静态可执行项,晃动/呼吸感等动态词仅视频用静帧不写)③风格与氛围降级为纯流派+情绪+画面感词(画质/渲染词迁出);全局项4块→5块(场景/镜头/光影/画面质感/风格与氛围),输出格式+两层分工说明同步
  • 关键区分:输出规格词(8K/微颗粒/HDR/胶片模拟)模型可识别可写,输入参数(85mm/f值)模型不推算禁写——"参数→结果转译"禁的是输入参数,不是所有技术词
  • 年代+流派双锚定执行率最高:"2010年代初纪录片摄影">泛词"电影感"(后者落到好莱坞大片先验)
  • 教训:风格=流派定位(这是什么),质感=渲染指令(按什么管线生成)——两层混写会导致渲染层信息丢失;参考图范式的5分类对"画面质感/镜头语言"的独立强调是对的,值得吸收进实体聚合范式

短视频分镜脚本 — F1 字段更名:风格与氛围→画面风格(仅 V1.0,.dsh 未同步)

  • 触发:用户提议"风格与氛围是否可改为画面风格"

  • 判断:该字段内容=流派+情绪基调+画面感词,都是"整体画面长什么样"的调性描述,【画面风格】名实相符且更直白;与【画面质感】形成"风格=调性/质感=渲染"清晰分工

  • 落地:5处引用统一改名(输出格式行/两层分工说明×2/模板字段/版本标签),字段内部描述同步微调("纯流派定位+情绪"→"流派定位+情绪基调")

  • 备注:.dsh 副本未同步(落后多轮),待用户单独授权

  • 备注:.dsh 副本未同步(现共落后多轮),待用户单独授权

短视频分镜脚本 — F1 光影/质感/风格三层表达范式升级(吸收动态分镜脚本参考图,仅 V1.0,.dsh 未同步)

  • 触发:用户贴一张动态分镜脚本级提示词截图问"是否值得参考"。分析结论:表达范式值得吸收,POV/声音/方言/手持晃动等视频概念 F1 静帧不适用、场景时代地域属题材内容不吸收
  • 三处升级(用户"先优化"确认执行,6处编辑+零残留验证): ①光影层色调系统三段式:饱和度(低/正常)+色相("冷灰偏旧""整体暖黄调")+胶片类型("复古胶片色调""暖调胶片模拟")——如"低饱和度,冷灰偏旧的复古胶片色调";光源类型先行(自然光为主/单一人工光源/混合光);观察层(第2步)同步"饱和度必观察" ②画面质感锚定升级:年代+流派双锚定→年代+流派+媒介三合一("2010年代初纪录片式胶片摄影"一句写全) ③画面风格层补写实流派执行词:"写实真人风格""生活流表演";氛围词"轻X氛围"句式("轻压抑氛围""轻怀旧氛围"比直写"压抑"可控)
  • 教训:参考动态分镜范式要按 F1 场景裁剪——表达范式(色调三段式/年代流派媒介锚定/轻X氛围句式)可迁移,视频特有维度(POV/声音/方言/晃动)不迁移;截图里"暗部细节保留/轻微色差"实际上一轮已落库,先核对现状再报增量
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 整段版实体绑定断链修复(仅 V1.0,.dsh 未同步)

  • 触发:用户质疑"整段版哪里来的,里面都不知道谁是谁"——整段版剥标签时把人物标签(女性A/B)也当字段标签剥掉,两段同以"脸型窄长…的年轻女性"开头无法区分,场景段"一人居偏左、一人居偏右"与人物段断链,模型无从知道谁站哪边
  • 修复:整段版规则修正——"去掉字段标签"明确为仅剥全局块标签(【场景】【镜头】等),人物标签(女性A/B)保留并作为跨层实体绑定锚点:人物段以"女性A:"开头,场景段布局用同一编号绑定("A居画面中偏左略前,B居画面中偏右")
  • 教训:人物标签有双重身份——既是人类可读标识,也是跨层实体绑定锚点;"去标签"操作要区分元规则标签(剥)与实体标识(留),一刀切剥离会断实体绑定链
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 跨层绑定完整主体名称 + 对话展示格式(仅 V1.0,.dsh 未同步)

  • 触发:用户指出场景段"A居画面中偏左略前,B居画面中偏右"要和主体名称完全对应;且生成的提示词不要放带滚动条的框里(不好复制)
  • 修复:①场景段人物布局绑定改用完整主体名称("女性A居画面中偏左略前,女性B居画面中偏右"),禁裸编号A/B——跨层绑定字面必须与人物块标签完全一致(结构化版+整段版同步生效);②对话展示格式新增规则——最终提示词不用长行代码块(横向滚动条影响复制),以普通文本段落输出
  • 教训:跨层实体绑定的引用必须用完整标签字面——裸编号"A/B"只在紧邻人物块时可读,场景段离人物块隔了场景描述,裸编号脱离上下文无法辨认
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 整段版正负提示词分离(仅 V1.0,.dsh 未同步)

  • 触发:用户指出"整段版模型连哪个是正向哪个是负向都不知道"——整段版剥掉【负面约束】标签后,负向词段落直接混排在正向文本末尾,单框模型会把"低清晰度, 模糊"当正向描述执行
  • 修复:整段版正文只含正向提示词(人物段+5全局块段);负面约束独立成第二部分输出,带"负向提示词:"标识行(标识行是给用户的复制分发指引:即梦/SD贴负向框、Midjourney转--no、NanoBanana才内联且需否定句式转写如"画面中不出现…");平台适配规则同步——即梦负向词贴"不希望呈现的内容"独立输入框,原"反向词内联末尾"默认废除
  • 教训:"剥标签"只能作用于正向内容内部的结构标签;正负两个语义相反的板块必须保留显式分隔,否则负向词以裸文本混入正向流会被模型当正向执行
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 负向提示词标识行精简(仅 V1.0,.dsh 未同步)

  • 触发:用户指出输出里"(贴即梦'不希望呈现的内容'框)"这类括号操作指引不需要——输出只要"负向提示词:"标识行本身
  • 修复:标识行只写"负向提示词:"五个字;平台分发知识(即梦贴负向框/MJ转--no/NanoBanana否定句式)留在 SKILL.md"目标平台适配"节作内部知识,不写入输出
  • 教训:给用户的操作指引≠输出内容——输出的每句话都会被复制走,只有会被复制的部分才进输出;分发说明留在技能规则层即可
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 肤色受光面判据落库 + 挂载物防丢(仅 V1.0,.dsh 未同步)

  • 触发:用户问"两个角色肤色有没可能是光线导致看起来不同",重看原图独立观察确认——A 与 B 基础肤色同为暖白偏粉,A"古铜肤色"是背光+暖调滤镜的整体观感误判(A 接近正面=背光面大,B 四分之三侧脸=受光面多)
  • 修复(用户"都修复"确认,SKILL.md 3 处编辑):①观察层人物专项"面部神态"补基础肤色取面部受光面(鼻梁高光/受光侧脸颊/边缘光色调),禁取整体观感;多人先核受光角度一致性,观感差≠肤色差,明暗差由光影层处理;②结构化模板"基础"字段同步判据;③持物字段补挂载物随道具一起写(扁担上挂的竹篮随扁担写)——竹篮已两次在聚合时静默丢失
  • 教训:逆光场景肤色判断看受光面(高光/边缘光),不看整体观感——背光偏暗+暖调偏黄会叠出"古铜感"假象;写死观感肤色会让模型生成真实肤色差异(人种特征漂移)
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 持物/挂载物坐标系反转(仅 V1.0,.dsh 未同步)

  • 触发:第四轮生成图竹篮只在画面最左下角露出1/3被截断。用户连问"看到筐了吗在哪里"→"物品位置要相对于人物来描述"→重看原图发现扁担方向也写错了(原图扁担斜向身后延伸、筐在A身后偏右肩背高度;我写"斜向下伸向画面左下角")。第四轮竹篮截断是提示词位置设计直接导致
  • 修复(用户"确认"执行,SKILL.md 4处编辑+零残留验证):①观察层精度要求③旧规则"持物方位优先画面坐标"整条反转废除——物品位置改用相对人物身体方位(身前/身后/左肩/右肩至背部高度),禁画面绝对坐标;②道具几何锚定示例同步改身体坐标;③结构化模板持物字段——挂载物必须独立写明相对身体方位(无独立位置会跟随道具末端漂移到画面边角被截断);④光影层画面现象位置词需明确"画面左侧"(禁裸写"左侧",人物左/画面左歧义)
  • 坐标系分界固化:物品位置=人物段身体坐标(跟人物走、多人归属清晰、跨场景稳定);人物站位=场景层画面坐标(构图信息,不要矫枉过正改掉);朝向=画面/场景实体参照皆可(旋转描述的本质)
  • 教训:确认偏差第三次+第四次——"全在✅"没核位置与可见度(竹篮边角1/3也叫全在);扁担方向根本没细看原图(写"斜向下伸向画面左下角",实际是斜向身后)。物品位置写画面绝对坐标=把物品锚到画面坐标系,人物一动物品脱钩/截断
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 表情三要素 + 朝向量化锚定(仅 V1.0,.dsh 未同步)

  • 触发:第五轮生成图用户连续指出"脸部朝向和原图对比""表情也不匹配"。独立观察确认:A 朝向写反(原图鼻尖微朝画面右,我写"微朝画面左");B 朝向弱化(四分之三侧脸生成成正脸,双眼完整);A 表情弱化("大张"生成"咧开一点","眯成弯月"生成正常睁眼);B 眼睛被先验污染(原图嘴笑眼不眯,生成图 B 被擅自眯眼——提示词对 B 眼睛完全没写)
  • 修复(用户"确认优化",SKILL.md 5处编辑+零残留验证): ①表情锚定三要素:嘴部状态(幅度锚定"张到最大幅度/下唇被向下拉开",单写"大张"被弱化)+眼周状态必写("完全眯起成月牙形仅见弧线眼缝"/"自然睁着瞳孔清晰可见")+嘴眼配对关系(咧嘴+眯眼=开怀大笑;抿嘴+睁眼带笑=温柔注视) ②模型默认先验"微笑=眯眼":会给抿嘴微笑人物擅自加眯眼——眼周状态必写不可省略 ③朝向观察以鼻尖朝向为唯一可靠判据:数鼻翼两侧可见度,非脸型对称感(实测"左脸颊面对镜头多一点"被误读成"朝画面左",实际鼻尖朝画面右——脸朝向和某侧脸颊面对镜头是两件事) ④**"四分之三侧脸"是弱执行词**:模型弱化成接近正脸——需硬量化(鼻尖方向+鼻梁阴影侧+被挡眼仅露眼角一线+另一侧耳朵不可见)
  • 教训:确认偏差第五、六次——A 朝向观察错(判据用错)、A/B 表情"✅完全还原"未核嘴幅度与眼周状态(A 眼根本没眯也说✅)。表情核对必须逐要素:嘴幅度/牙可见/眼眯睁/嘴眼配对
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 新增每步自检机制 Step-Check(仅 V1.0,.dsh 未同步)

  • 触发:用户问"图片反推提示词是一步就执行出结果了吗"→分析确认 F1 内部 6 步全在黑盒一口气跑完、无校验环节,质量闭环在技能外部(生成图回贴才发现错);用户拍板"每一步处理 模型自己也要检查"
  • 落库(SKILL.md 新增"每步自检 Step-Check"节+版本标签):6 步每步执行完必做自检,不通过重做该步、禁止带病进下一步。步骤2 观察=错误重灾区:每维度写完结论回看原图一次再落笔,核法必须"先看图再对照结论"(拿结论找印证=确认偏差);步骤5 输出前 6 项终检:人物标签完整主体名称/道具挂载物对照观察清单逐件打勾(防静默丢弃)/反向词正向零出现/坐标系分界/表情三要素+朝向量化/正负分离
  • 教训:内部无自检时输出错误密度≈观察错误密度,纠错全靠外部生成图反馈,每轮成本高(重出整段版+用户去即梦验证);自检的核心不是"再读一遍自己写的"而是回到原图独立核对
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权

短视频分镜脚本 — F1 真实看图纠偏与形态固化(仅 V1.0,.dsh 未同步)

  • 触发:在视觉通道彻底恢复、看清原图后,对比之前版本,发现 6 处极其关键的盲编与过度锚定偏差(扁担写成木板、拧折布巾写成拎披帛、B 极轻微侧脸写成大侧脸、A 睁眼大笑写成眯缝眼、抹胸色彩不贴合、漏掉右侧白衣褐裙配角)。
  • 修正:重新生成一版 100% 真实对齐的提示词: ①眼睛可见度回归真实:A 大笑但双眼圆睁、明亮有神,瞳孔清晰(废除眯眼先验); ②持物与姿态还原:A 扁担搭右肩、右手肩前扶握前端; ③去仙侠化/日常化:B 左肩搭折叠拧条状深灰粗布巾,左手扶握,右手不露(废除“双手拉披帛”的做作 pose); ④朝向精细校准:B 仅极轻微侧面(约 15°),双眼均完整清晰可见(废除过度转头的右眼遮挡); ⑤背景生态补齐:右侧中景白衣褐裙侧身年轻女子,左侧白色炊烟/晨雾,废除臆造的木桶。
  • 教训:视觉盲区不能靠“文字推演”代替,更不能为迎合反馈而编造细节。一旦视觉接口失效,必须立正报告、坚决停手,否则编造出的“西域/木板”等自洽逻辑会彻底偏离真相。

短视频分镜脚本 — F1 第六轮生成对比(完美闭环,仅 V1.0,.dsh 未同步)

  • 背景:用户使用最新版 100% 真实对齐提示词在即梦生成第六版,效果极其惊艳,实现 95%+ 高保真还原。
  • 实测对比结论(完全闭环): ①眼神与神韵:A 的大笑明亮圆睁、B 的微笑温柔不眯眼,完全去除了先验污染与眯眼化,神韵还原度极高; ②姿势与道具:A 扁担搭肩扶握前端、B 拧折布巾左手扶握,两人动作自然,彻底去除了做作的拉披帛仙侠感; ③竹篮与位置:竹编篓子完美挂在 A 肩后,且位置自然位于两人之间,大小比例极其协调,无截断; ④背景与配角:右侧中景白衣褐裙侧身女子神似原图,左侧炊烟自然亮起,西域/集市氛围拉满; ⑤细节微调建议(若精益求精):A 外套领口开合度略宽,B 头顶发髻形状比原图稍圆,但已完全达到静态还原顶峰。
  • 备注:F1 反推提示词至此完成全部重构并跑通闭环。下一步将建议用户授权同步到 .dsh 副本。

短视频分镜脚本 — F1 原图/最新版/第2版三图整体对比复盘(仅 V1.0,.dsh 未同步)

  • 触发:用户要求重新整体分析原图、最新版图与第2版图。核心结论:第2版比最新版更有审美和松弛感,但与原图的动作/表情/人物关系偏离更大;最新版结构元素更接近,但AI网红脸、看镜头、表情僵硬问题严重。原图灵魂是并肩前行的真实生活瞬间,不是摆拍肖像。
  • 关键判断:后续提示词不能只追求道具/服装硬指标,也不能只追求唯美构图;应采用“结构锚点保留 + 神韵语境松绑”的中间路线:A 保持挑担和竹筐位置,B 保持肩巾左手扶握,视线改为同伴互动/非看镜头,脸部避免网红大眼,雾气写潮湿晨雾而非浓烟。

短视频分镜脚本 — F1 神韵闭环机制落库(仅 V1.0,.dsh 未同步)

  • 触发:用户确认优化技能,而不是继续只改单条提示词。三图复盘结论:最新版结构更近但神韵崩,第2版审美更好但结构偏;F1 最大问题是把"看见什么"误写成"器官/道具硬指标命令",导致网红脸、惊吓表情、摆拍感、硬衣和干烟。
  • 落地(SKILL.md 多处编辑+二次残留清理): ①视觉准入门 P0:反推前必须确认真实看见图片像素;只拿到路径/文件指针/历史上下文时必须停止,禁止脑补生成;准入验证需先写3个不可从上下文猜出的画面事实。 ②三层观察:事实层(人/物/衣/光/景)→关系层(是否看镜头、谁看谁、是否边走边聊、动作是否生活化)→神韵层(活人感、松弛、古典骨相、湿润空气感、AI污染方向)。 ③硬锚点/软锚点分级:道具/服装/站位/持物硬写;人脸/表情/视线/互动/空气感软写语境化,禁止极限器官量化压死人脸神韵。 ④表情规则改造:从"嘴眼三要素硬控"改为动作语境+面部协同;删光"张到最大幅度/圆睁/瞳孔清晰/下唇被…"等坏触发词残留。 ⑤非看镜头/人物交互专项:多人生活流图必须判断是否看镜头、谁看谁、是否同行闲聊;视线落点不得省略为泛泛"望向前方"。 ⑥AI审美污染负向词库:网红脸/现代写真脸/欧式大双眼皮/尖下巴/高鼻梁整容感/过大眼睛/假笑/游客照/影楼汉服/舞台浓烟等。 ⑦输出双版本:结构还原版(审计硬锚点)+神韵优化版(默认生成层主稿);极简版仍废弃,但单硬还原版也不再作为唯一输出。 ⑧美学自检:字段检查之外,还要查活人感、网红脸、假笑、直视镜头、硬衣塑料感、干冰烟雾。
  • 验证:grep 清理旧残留:"11维度/十一维/视线→位置/单版本/高级结构化版单版本/张到最大幅度/圆睁/瞳孔清晰/下唇被" 均 0;确认 Level 1 极简版位于 F3 生成图片提示词复杂度分级,非 F1 残留,保留不动。
  • 备注:.dsh 副本未同步(共落后多轮),待用户单独授权。

短视频分镜脚本 — F1 神韵闭环后规则一致性审计(只审计,未修改)

  • 背景:用户担心最近几轮 F1 优化可能引入规则冲突,要求整体检查技能。
  • 审计范围:project/短视频分镜提示词/V1.0/提示词生成工具/SKILL.md 的 F1 主流程、Step-Check、人物专项、目标平台适配、输出格式、结构化模板及全局关键词残留。
  • 结论:主体方向正确,P0 旧残留基本清理干净;发现 1 个真冲突(NanoBanana 仍写“反向词内联末尾”与正负分离规则冲突)、2 个高风险表达(人物专项示例仍含“交叠V形”、正向示例仍含反向词“水印”解释)、2 个需澄清项(双版本与结构化/整段两层关系、详细方法论仍引用焦距/体积光词库但属参考源非输出规则)。
  • 本轮未改 .dsh 副本,仍待用户单独授权。

短视频分镜脚本 — F1 审计建议4项修复落地(仅 V1.0,.dsh 未同步)

  • 背景:用户确认“按照建议修改”,基于上一轮一致性审计执行小修,不做额外扩展。
  • 修复项:①NanoBanana 平台规则取消裸负向词混排,统一正负分离;单输入框时负向内容改自然语言否定句式 ②人物专项汉服示例去“交叠V形”,改为“两片襟布交叠形成斜向襟线” ③新增“双版本 × 两层输出关系”,明确结构还原版/神韵优化版是内容策略,结构化版/整段版是交付形态 ④结构化模板文字字段抽象“标识性文字”表述,避免具体风险词进入正向字段解释。
  • 验证:旧残留 反向词内联末尾/交叠V形/水印等标识性文字/含"水印"/11维度/十一维/高级结构化版单版本/张到最大幅度/圆睁/瞳孔清晰/下唇 均 0;新增规则 双版本 × 两层输出关系/标识性文字在正向提示词零出现/文字与标识类排除项/斜向襟线 均命中。
  • 版本标签:V1.0 SKILL.md last_change 更新为本轮4项一致性修复摘要。
  • 备注:本轮未改 .dsh 副本,仍待用户单独授权同步。

短视频分镜脚本 — F1 审计修复后中断复查(只复查,未修改)

  • 背景:用户指出刚才中断数次,要求确认 4 项修复是否都修改到位。
  • 复查结果:4 项均已落地:NanoBanana 正负分离/单框否定句式、汉服示例斜向襟线、双版本×两层输出关系、模板文字字段标识性文字抽象。
  • 验证:旧残留 反向词内联末尾/交叠V形/水印等标识性文字/含"水印"/11维度/十一维/高级结构化版单版本/张到最大幅度/圆睁/瞳孔清晰/下唇 均 0;新增规则均命中。脚本对“禁止把结构还原版误解为结构化版”曾因引号匹配误报,Grep 已确认实际存在。
  • 本轮只读复查,未改 SKILL.md,未改 .dsh。

短视频分镜脚本 — F1 微表情与面部朝向机制落库(仅 V1.0,.dsh 未同步)

  • 背景:新一轮生成图对比后,用户指出右侧女生笑意未还原,并要求重点检查微表情、动作、面部朝向的左右与上下。
  • 落地(SKILL.md):①人物专项表情规则新增“微表情四层”:嘴部/脸颊/眼周/情绪语境;②新增“交互强度≠表情强度”——弱交互只限制不强对视/不明显转头,不代表笑意弱,闭唇笑也需写嘴角、脸颊、眼神;③新增“面部朝向四件套”:左右朝向、上下朝向、头部倾斜、视线落点;④结构化模板同步更新表情示例与朝向字段;⑤修正人物专项编号重复(场景统一性声明改为⑨)。
  • 验证:微表情四层/交互强度≠表情强度/弱交互不等于弱表情/面部朝向四件套/上下朝向/头部倾斜/嘴角向两侧轻微上扬/脸颊微微提起/眼神柔和带笑/⑨场景统一性声明 均命中;旧弱表情例句 闭唇含笑,眼睛自然睁着,神态温和 和重复编号 ⑧场景统一性声明 均 0。
  • 版本标签:V1.0 SKILL.md last_change 更新为本轮微表情与朝向机制摘要。

短视频分镜脚本 — V1.0 → .dsh 同步(用户授权)

  • 用户明确要求将 V1.0 源技能改动同步到 .dsh 部署副本(C:\Users\maidou\.dsh\skills\storyboard-prompt\SKILL.md)。
  • 同步方式:Python 脚本读取源技能全文,替换 name: 短视频分镜脚本 → name: storyboard-prompt(保留 .dsh 特有 name),其余内容完整覆盖写入 .dsh。
  • 同步范围:F1 全部多轮优化(视觉准入门 P0、三层观察、硬软锚点分级、互动强度分级、微表情四层、交互强度≠表情强度、面部朝向四件套、电影截图感防商业写真化、AI审美污染负向词库、双版本+两层输出、NanoBanana正负分离、结构化模板重写、Step-Check自检表、美学自检等)。
  • 验证结果(20项全部通过):新增规则 16 项均命中;旧残留 4 项(11维度全观察/反向词内联末尾/交叠V形/水印等标识性文字)均 0。
  • 行数一致:源 653 行 = .dsh 653 行;内容 match=True。
  • .dsh 副本 last_change 已同步为最新版本标签。

短视频分镜脚本 — F1 生成闭环复盘与扁担防偏机制落库(V1.0 + .dsh 同步)

  • 背景:多轮即梦生成图对比后,用户指出 B 笑意/朝向易回退、视线词易放大互动、扁担易变木棍/弯曲、竹筐易变背篓,并要求把经验优化到技能而不是只改单条提示词。
  • 落地(SKILL.md F1 节):① Step-Check 新增“生成闭环复盘”:先列保留项/回退项/替换项,只替换失败模块;②人物专项新增“长杆类道具最小锚点法”:身体接触点+长轴方向+手部作用+挂载物归属;③新增“挂载物≠背负物”:竹筐/包袱等必须挂在道具下方且与背部有距离;④扁担专项正向要求“平直硬木扁担/平直木扁担”,防木棍、竖杆、弯曲、软杆、变形杆;⑤反向词新增长杆/挂载物专项类;⑥反向词默认选配规则新增“负向词分层精简”;⑦新增“生成闭环复盘与有效锚点保护”;⑧新增“视线词高风险规则”,弱交互优先写低强度视线词,禁止未经验证泛化替换有效面部句。
  • 同步:已按用户授权将 V1.0 源技能同步到 C:\Users\maidou\.dsh\skills\storyboard-prompt\SKILL.md,保留 .dsh frontmatter name: storyboard-prompt。
  • 验证:源技能与 .dsh 均命中 生成闭环复盘/有效锚点保护/视线词高风险规则/长杆类道具最小锚点法/平直硬木扁担/弯曲扁担/挂载物≠背负物/竹筐贴背/负向词分层精简/反向提示词(7 类);旧标题 反向提示词(6 类) 已改为 7 类。

短视频分镜脚本 — F1 金标锚点逐字保护+长杆三问+视线匹配表(V1.0 + .dsh 同步)

  • 背景:用户反馈某版 A 的面部朝向/笑容/表情是历史最佳,但后续改其他模块(扁担/筐/B 朝向)时 A 的好效果被连带回退,无法复现。根因:已有"有效锚点保护"规则太笼统(只说"不得误删",没有逐字复制要求+标记机制+模块隔离)。
  • 落地(SKILL.md F1 节):①金标锚点逐字保护:某轮某局部明显优于其他轮时标记为"金标句",后续必须逐字复制粘贴,禁止同义改写/合并精简/拆分重组/优化措辞;回退时直接粘贴金标句原文,不重新从原图反推;按模块划分(A面部块/B面部块/道具块/场景块/光影块各自独立标记冻结);只有用户明确说"这版某处不好"才解冻。②长杆承载方式优先判别三问:下笔前先回答①承载方式(肩扛/单手握提/双手握提/落地斜靠)②杆身长轴方向(水平/斜上/斜下/竖直)③挂载物落点(挂上端/中段/下端/杆外侧);三问不答完禁止写"肩扛""横向"等默认描述。③视线词与交互强度匹配表:强/中/弱/无四档各自有视线写法和禁止写法;判错时先回交互强度判定,不直接调视线词。
  • 同步:已同步到 C:\Users\maidou\.dsh\skills\storyboard-prompt\SKILL.md,保留 name: storyboard-prompt。
  • 验证:源 671 行 = .dsh 671 行;MD5 一致;金标锚点逐字保护/三问不答完/视线词与交互强度匹配表 在源和 .dsh 均命中。

短视频脚本创作 — 时长分配规则修正:比例法→两端固定秒数(V1.0 + Lite1.0 双副本)

  • 触发:用户指出 300s 视频会被分配 20-30s 开场,违反爆款开场 3-10s 黄金区间
  • 根因:技能 4 处规则用固定比例「开场10% / 中段75% / 结尾~15%」,300s×10%=30s 开场、45s 结尾;爆款逻辑要求开场是固定秒数(3-10s)、拉长的只有中段;且与已有规则「时长区间统一使用绝对时间,不混用百分比」自相矛盾
  • 修复原则:两端固定秒数 + 中段吸收增量——开场固定3-10s(短平快3-5s/中长5-10s)/ 结尾固定5-10s / 中段=总时长-开场-结尾
  • 落点(V1.0 与 Lite1.0 同构同步,共 4 文件 5 处 + 引用):2_需求完善.md L65、6_生成短视频框架.md L27/L386/输出模板 L474-476、7_生成短视频大纲.md L171 引用、01_标准爆款结构模板.md 三幕结构总览 L233-239(时长列改固定秒数、占比列改分配规则、4.2 标题标 60s 示例并加说明行)
  • 验证:旧比例 开场~10%/中段~75%/结尾~15%/分段比例/[X]s (~10%) 零残留(仅 SKILL.md last_change 变更摘要中的描述性引用);新规则 6 处双副本对称命中
  • 版本标签:双副本 updated_at 2026-08-25 + last_change 记录修正摘要
  • 教训:比例式时长分配对长视频必然超纲——开场/结尾是注意力窗口决定的固定区间(3-10s/5-10s),不随总时长线性放大;短视频任意时长的增量都应进中段,这是"两端固定+中段吸收"的唯一正确形态