Files
mcn-short-video/.workbuddy/memory/2026-08-25.md
T
maogeigei b3685504d7 技能三副本迭代:路径重构+输出边界铁律+开场口径区分+审计修复
- 路径重构:脚本创作 V1.0/Lite1.0 扁平化(去技能文件夹层),分镜技能迁移至 短视频提示词生成/V1.0,旧路径清理
- 输出边界铁律固化:创作流程规范.md 新增「交付物输出边界(通用铁律)」+ S9 输出模板新增「输出边界」块(验收口径=执行约束非输出内容)
- 开场钩子铁律三层固化:00_开场/06_编导终审/S9 相关规则 + S5 预设钩子口径区分(前3秒=呈现窗口,3-7秒=开场段总时长)
- 帮助文档:新增「从账号分析到脚本创作」跨技能章节(你这样问|我会做什么风格)
- mcn-dou-analysis 内嵌副本:红线边界声明+人设卡术语更新(设定分析说明)
2026-08-26 17:28:21 +08:00

409 lines
63 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 2026-08-25 工作日志
## 短视频分镜脚本 — V1.0 与 .dsh 副本对齐(双向各一处)
- 背景:用户询问 V1.0 源端与 `C:\Users\maidou\.dsh\skills\storyboard-prompt` 是否同源、是否需同步
- 同源确认:目录结构一致(references 4制作流程+15知识库+参考skills+references-add),除 SKILL.md 外全部文件 diff 零差异;源端独有 output/(开发样例,不部署,正常)
- 分叉点:①.dsh 端 08-21 description 精简未回流 V1.0 ②V1.0 端 08-24 F1 扩展未同步 .dsh
- 用户决策:两项都做(回流 description 精简 + 授权同步 F1 扩展到 .dsh)
- 执行:
- 回流:V1.0 SKILL.md description 替换为 .dsh 精简版(能力域+触发场景),name 保留「短视频分镜脚本」
- 同步:.dsh SKILL.md F1 节替换为 V1.0 扩展版(11维度观察/人物专项5项/类型判定7类/类型适配表/文字转录强制要求/反向提示词6分类),保留 .dsh 的 name(storyboard-prompt)与精简版 description
- 版本标签:两端 updated_at→2026-08-25,last_change 各自记录动作(回流/同步)
- 验证:SKILL.md diff 仅剩 2 处预期差异(name 环境适配 + last_change 各自记录);全目录 diff 零差异(除源端 output/)
- 备注:本次写 .dsh 为用户明确授权的例外(单向只读铁律 2026-08-22 仍然有效,默认不写 .dsh)
## 教训沉淀
- **部署副本对齐要双向核对**:分叉不一定单向——本次回流缺口(.dsh→源)与同步缺口(源→.dsh)同时存在,只看一个方向会漏;用 frontmatter 的 updated_at/last_change + 全目录 diff -rq 三件套可快速定位分叉点
## 短视频脚本创作 — 极致事件补充分类沉淀落地(V1.0 + Lite1.0 双副本)
- 背景:用户评估外部"极致事件分类体系"后,指示按沉淀总图执行优化;核心原则"ABC 是根,其他分类是枝——根定本质,枝定落地"
- 沉淀决策(4 补充分类 + 1 不沉淀):
- 叙事功能(钩子/留人/转粉/传播)→ S7 创作流程新增「极致触点节点布位」表(4型+用法非属性+密度闸门)+ 大纲质量校验「极致触点布位检查」(开场钩子场≥1、每15-20秒≥1、结尾建议转粉型)
- 赛道专属 → 13_极致事件_分块示例 赛道对照表 8→12 行(并入味觉想象→美食、认知颠覆→学习教育、情感浓度→剧情、耗时精度→手工、环境强度→户外、效率→职场/干货)
- 克制极致(隐性手法)→ 05 总纲机制说明("不表达"表达,本质仍属戏剧极致,不单列本质类)
- 专属符号 → 极致行为三分类→四分类(+专属符号型:跨视频复现的账号记忆点,沉淀账号专属层)
- 情绪属性 → 不沉淀(情绪价值由 07_情绪共鸣 承接,总纲补「情绪落点」指针)
- 文件落点(V1.0 与 Lite1.0 同构同步,共 7 处):
- `05_极致事件/00_极致事件总纲.md`:克制极致说明 + 情绪落点指针 + 极致行为简表 3→4 类
- `05_极致事件/极致行为创作法_通用_内容设计.md`:三分类→四分类(+专属符号型+说明)
- `创作流程/7_生成短视频大纲.md`:布位表 + 校验行
- 残留修正 3 处「极致行为三分类」→「四分类」:`创作流程规范.md`(S6行)、`索引_知识素材库.md`、`6_生成短视频框架.md`
- SKILL.md 版本标签:updated_at→2026-08-25 + last_change
- 单副本(内容创作产品规划):
- `素材库/产品规划/短视频素材库产品规划.md`:核心规则第14条「专属符号沉淀(账号专属层)」+ Phase 7 补充
- `知识库/分块示例/13_极致事件_分块示例.md`:赛道对照表 12 行
- 验证:全量 Grep 确认「极致行为三分类」零残留(账号类型三分类为无关概念,保留);四分类/克制极致/专属符号/布位表双副本对称
- 教训:改维度分类后必须全局 grep 旧分类名(如"三分类"),且要区分同名不同义概念(极致行为三分类 vs 账号类型三分类)
## 创作流程+知识库 执行通畅性审计(技能审查表 13 条)
- 结论:总体通畅,无 P0;发现 4 个 P1 + 2 个 P2(V1.0 与 Lite1.0 双副本同构存在)
- P1:
1. 创作流程规范.md 四·知识库分类索引表过时:09_脚本诊断 标 3(实际 4,缺「故事成立性校验」)、总计 65(实际 66)
2. SKILL.md 关键规则七引用 `../../失误与规避记录.md` 断链(文件在项目根,需 ../../../../)
3. S9 处理规则「2. 脚本结构」骨架示例(32-84 行)与输出模板(348+ 行)/创作流程规范三矛盾:A 骨架缺 5 字段画面元数据行;B 骨架加粗分行(应为同一行不加粗);C 骨架分行(应为同一行);86 行"不单独用【】标注"与规范 244 行"S9 有粗粒度画面元数据"冲突
4. S9「### 闪回叙事规范」标题重复(113/115 行)
- P2:S10 景别列表缺「大远景」(6 vs 规范/知识库 7);S7「第二步半」/S11「三·五」编号命名(功能 OK)
- 通过项:11 步顺序/编号/无跳步✅ 三层职责分离(S6情绪/S7结构/S9演绎)✅ 数据流全链贯通(共鸣切入点/目标体感/故事前提/场次结构/情绪卡/广告占位)✅ 知识库引用零断链(脚本扫描)✅ 素材库调取链路完整✅ 术语统一(故事细节/三段式五段式)✅ 硬编码零残留✅ 产物链红线双处强制✅
- 审计方法沉淀:①知识库文件数 vs 索引计数核对(bash wc)②步骤文件引用断链脚本扫描(python 正则匹配 .md 链接 + 磁盘对照)③关键字段跨步骤 grep 流转图(S5→S6→S7→S9→S11)④S9 骨架 vs 输出模板 vs 权威规范三方对照(骨架示例易与权威源脱节)
## 短视频分镜脚本 — F1 流程评估优化10项(仅 V1.0)
- 背景:用户要求评估 F1 反推图片提示词流程并执行优化(P0→P1→P2 逐步)
- 评估发现:骨架完整但 3 个 P0 硬缺口(画面文字维度空隙/词库引用链路断裂/F1 节 references 引用数为 0/目标平台适配缺失)+ 3 个 P1 + 4 个 P2
- 落地(全部在 SKILL.md F1 节,F2/F3/F4 未动):
- P0:①文字转录触发放宽为"画面含可辨识文字即必做,不限类型"(堵人像slogan/场景招牌漏观察)②补「详细方法论」6条词库引用(01主体/07光影/09色彩/14构图/10+12质感/15风格,指针全部验证存在)③补「目标平台适配」4平台(默认即梦自然语言/MJ参数式--no/SD权重+负面框/NanoBanana)
- P1:④结构化版格式模板(10字段分行)+双版本适用说明 ⑤多图模式(共通主体交集+差异项+冲突标注,衔接F3角色卡)⑥风格反推双轨输出(命名+参数化描述+置信度)
- P2:⑦图片质量前置扫描并入step1 ⑧置信度维度级风险分级并入step4(高风险:风格/氛围/符号内涵)⑨反向词×图片类型映射规则 ⑩版本标签 updated_at 2026-08-25
- 验证:F1 节通读确认10项全部落地;引用指针指向的7个知识库文件章节均提前 grep 验证存在
- 备注:**.dsh 副本已于同日授权同步**(用户明确授权后 F1 节优化版整体替换移植,保留 name/精简description;验证 SKILL.md diff 仅剩 name+last_change 两处预期差异,updated_at 两端一致)
- 教训:功能节的知识库引用块(详细方法论)是标准结构,新功能节(如 F1 由内建方法论发展而来)容易漏配;评估某功能完整度时先查"该节 references/ 引用数是否为 0"
## 短视频分镜脚本 — F1 实跑复盘修复5项(仅 V1.0,.dsh 未同步)
- 背景:用真实图片(古风双女主街道)实跑 F1 反推,用户连续三轮抓漏:①焦距缺失②肤色写"白净"违反具体色名规则/族裔妆容缺失/时间不显式③水印文字不应写入提示词
- 落地(V1.0 SKILL.md F1 节):
- 文字二分类新规则:内容性文字(招牌/文案/slogan)写入提示词正文;标识性文字(水印/署名/@账号名/logo/时间戳)只进观察报告+反向词"水印",禁止写入正文(写入会令生成图带上水印)
- 结构化模板升级:新增【基础属性】行(画幅比,即梦UI设置不写入/MJ --ar)+【构图】行补焦距+光圈(示例 85mm f/1.8)+【主体】补肤色具体色名+【文字】行标注水印类不写入+【负面约束】含"水印"
- 详细方法论引用块补3条:06焦距视角(必)+03场景模板+11特效渲染(可选)
- 版本标签 last_change 更新为实跑复盘修复摘要
- 备注:**.dsh 副本已于同日授权同步**(用户确认合并修复方案后,5项复盘修复逐条移植;验证 SKILL.md diff 仅剩 name+last_change 两处预期差异,updated_at 两端一致,F1 节完全一致)
- 教训(两层):①执行层——规范有槽位不代表会被填,模板字段(如焦距)与专项规则(如肤色具体色名)在生成时易被跳过,实跑是检验规范落地唯一手段;②规范层——水印/署名类标识性文字与内容性文字必须分叉处理,"全部转录"一刀切会把水印带进生成图,效果适得其反
## 创作流程+知识库 审计问题「按顺序修复」执行(V1.0 + Lite1.0 双副本同步)
- 按审计清单顺序逐条修复(P1-1→P1-2→P1-3→P1-4→P2-5),每条修改后立即验证
- P1-1 索引计数:创作流程规范.md 371 行 09_脚本诊断 3→4(补「故事成立性校验」)+ SKILL.md 目录概览 65→66 个方法文件(磁盘 wc 实测 66 确认)
- P1-2 断链:SKILL.md 关键规则七 `../../失误与规避记录.md` → `../../../../`(SKILL.md 在 脚本创作技能/ 下,上跳 4 级才到项目根;目标文件实测存在)
- P1-3 S9 三处对齐权威规范(骨架/输出模板/System Prompt):
- A 骨架场1/场2 补 5 字段画面元数据行【景别 | 环境 | 光线 | 场景 | 场景元素】(与输出模板/规范一致)
- B 骨架整体重写:场标题去加粗(规范 B 明确"不加粗",System Prompt B 同步改)+ 补 5 字段行 + 旁白/角色改同一行不加粗(原加粗分行);输出模板 B 场1/场2/场3 去加粗
- C 骨架口播改同一行(**{角色名}**(口播·{语气}):台词)
- 86 行分镜要素分离表述对齐规范 244 行:S9 不输出【景别|光线|入镜】分镜三要素,但 5 字段画面元数据属 S9 画面提示(粗粒度),S10 细化;System Prompt 区 241 行同步泛化(A 场次画面元数据 / B Vlog)
- P1-4 S9 删除重复「### 闪回叙事规范」标题(112/114 行)
- P2-5 S10 景别列表 2 处补「大远景」(远景/全景/中景/近景/特写/大特写 → 大远景/远景/全景/中景/近景/特写/大特写,对齐规范 331 行 7 项)
- 验证:零残留 grep 全过(65/3/../..//加粗分行/6项景别/旧分离表述/重复标题);S9/S10 文件双副本 diff IDENTICAL;SKILL.md diff 仅剩固有差异(name/version/last_change/MCP 依赖 vs 轻量说明)
- 版本标签:双副本 updated_at 2026-08-25 + last_change 记录本次修复摘要
- 教训:三方对照(骨架 vs 输出模板 vs 权威规范)修复时,不只改骨架——输出模板/System Prompt 同源错误须一并对齐,否则"三矛盾"变"两矛盾"仍留痕;S9 骨架区是历史遗留易腐点,后续改动骨架示例必须同步核对输出模板区
## 短视频脚本创作 — V1.0 ↔ .dsh 双向同步(脚本创作技能,授权写 .dsh)
- 背景:用户要求对比 `C:\Users\maidou\.dsh\skills\short-video-script` 与 V1.0 源技能,选择「双向同步」——V1.0→.dsh 同步 + .dsh→V1.0 回流(并同步 Lite1.0)
- 核心发现:13 个差异文件中仅 2 个干净单向复制,其余为双向差异——.dsh 有**结构增强**(时间/年龄规范、数字账取证、行为来源与时间线、案例库),V1.0 有更具体的大炮创作教学案例。合并原则:**V1.0 保留具体案例 + 吸收 .dsh 结构增强**
- .dsh 独有资产(重要,已回流):「时间/年龄规范 + 数字账取证」体系——AI 不擅长具体数字一致性,心算自查必然失效,唯一可靠方式是"把正文实际出现的数字逐条列出,串链核对(取证,而非心算)";全片时间/年龄默认模糊表述("很多年前/小时候/那几年"),禁止堆砌精确数字;只允许一个时间基准
- 执行:
- V1.0 回流合并 5 文件:S5(时间/年龄表述规范+时间锚点)、S6(事件标注两→三标注+复盘七问补行为来源/时间年龄+数字取证)、故事成立性校验(二·五数字账取证整节+案例3/4)、S9(自检清单补2条剧情类)、S11(数字账取证5处)
- Lite1.0 同步:S5 按环境合并(保留 Lite 搜索表述)、S6/S9/S11/故事成立性 4 文件直接复制、SKILL.md S11 摘要补全
- .dsh 写入 12 文件(保持 CRLF 行尾):11 内容文件 + SKILL.md 手工合并(script-review 引用行不回流、失误记录路径 3 层保持原样、66 方法文件)
- 术语修复:V1.0 7_生成短视频大纲.md 8 处「口播/独白/台词方向」→「口播/旁白/台词方向」(Lite 已正确,修复后三端 IDENTICAL)
- 环境差异清单(不回流/保留):.dsh script-review 技能引用行、失误记录引用路径 3 层(.dsh 无失误记录文件,改 4 层指向用户根目录更错)、路径配置、S5 搜索表述(Dify/搜索引擎 vs 模型自带联网)、创作流程规范 grep scripts/(Lite 独有)、SKILL.md frontmatter name/version、帮助文档
- 最终验证:V1.0 vs .dsh 仅剩 SKILL.md 差异(预期环境差异);V1.0 vs Lite 剩余差异全部为验证过的环境差异;全局「独白」残留扫描剩余均为「自我独白」素材库合法分类
- 备注:本次写 .dsh 为用户明确授权的例外(单向只读铁律 2026-08-22 仍然有效,默认不写 .dsh)
- 教训:跨环境技能同步三要点——①CRLF 感知 diff(裸 diff 因行尾显示整文件不同,必须 --strip-trailing-cr);②双向差异要逐文件判定"谁的结构更强",不是简单覆盖;③环境特有内容(技能引用/路径/搜索能力表述)必须识别排除,否则会把环境 A 的约束带进环境 B
## 短视频分镜脚本 — F1 还原力补强7项(仅 V1.0,.dsh 未同步)
- 背景:实跑复盘修复后用户继续追问"没有物品/场景布置/方位,这样能还原图片吗""还要哪些信息"→ 确认 F1 观察维度有提及但无执行精度与模板槽位,知识库有资产(02动作行为/14前中后景/06画面坐标)但 F1 未 surface
- 落地(V1.0 SKILL.md F1 节,合并上轮三项+本轮四项):
- step 2 十一维度逐项加观察精度要求(括号标注):画面坐标方位(画面左/右禁机位相对方向)/光影方向精确化/色彩具体倾向/道具独立清单/场景前中后景三层/虚化梯度
- 人物专项行追加还原力精度:姿势写到角度/手部/视线落点粒度(引 02 词库);神态用 01 微表情 7 区域×4 级强度语言(禁抽象情绪词)
- 结构化模板扩为 **17 字段**:新增【道具】【场景布置】【方位】【人物空间关系(多人)】【姿态与视线(含人物)】+【镜头】行独立(焦距+光圈+虚化梯度);人物相关字段按图类取舍
- 「注意」行后新增还原路径指引:100%复刻→图生图/垫图;改图延展→文生图直接用;学图→变量提炼
- 详细方法论引用块:补 02_动作行为行 + 14 行加前中后景/画面坐标 + 06 行加 X 轴朝向/画面坐标规则(现为 10 条指针)
- 「输出格式」行维度清单同步 17 字段(发现旧 11 项清单未随模板更新,一并修正)
- 版本标签 last_change 更新
- 验证:F1 节通读确认;字段数自检发现标注 16 实为 17(数错一处已修正)——字段计数须逐个数
- 教训:①模板扩字段后必须同步更新同节其他引用该字段清单的位置(输出格式行易漏);②"还原力"类优化的判断标准不是"维度提没提"而是"精度够不够执行"(有方位槽位≠写到画面坐标粒度)
- 备注:**.dsh 副本已于同日授权同步**(随文生图验证修复轮一并两轮合并移植)
## 短视频分镜脚本 — F1 文生图还原力验证修复7项(仅 V1.0,.dsh 未同步)
- 背景:用户拿 F1 提示词在即梦实际生成图片,与原图对比暴露 6 类还原缺口 + 1 类输出格式违规(模板有"按维度分行"但实际输出合并单行)
- 对比实测结论(文生图还原极限约65%):①左右手翻转("右手持"身体坐标模型执行率低)②复合姿势丢失(扛+斜搭+延伸只保留1个动作)③强方向光+烟雾被平均化为平光④微表情 L1-L4 强度词模型不识别(A大笑变平静)⑤易漂移色名偏移(灰白→灰蓝)⑥后景脑补多出山、烟雾被放大;✅水印反向词拦截成功、方位/空间关系/浅景深还原好
- 修复落地(V1.0 SKILL.md F1 节,7项合并为6处编辑):
- step 2:光影行加强方向光转译(轮廓光/边缘光/丁达尔光束替代角度描述)+色彩行加易漂移色名锚定(灰白/米白/棕黄加参照物或排除色相)+场景行加穷尽清单原则(未出现大类元素进负面约束)
- 人物专项还原力精度扩为5条:姿势动词≤2个/人+复合动作改道具几何锚定(接触点+两端画面位置)/持物方位优先画面坐标("右手持(该手位于身前偏画面左)")/微表情双轨制(观察用7区域×4级、正文转译直白词"露齿大笑")/禁抽象情绪词
- 模板17字段:分行改硬性格式(禁止合并单行)+道具行加接触点+两端画面位置+主体行色名锚定+光影行光效词+负面约束加反脑补项
- 反向词规则加反脑补项(山/塔/水面等未出现大类元素+浓烟)
- 详细方法论07行加光效转译注
- 版本标签 last_change 更新
- 教训:①**观察语言≠生成语言**——L值强度/角度描述是创作者语言,写入提示词正文必须转译为模型可执行词(直白可视化词/具体光效词/画面坐标),这是"双轨制"的本质;②**身体坐标(左右手)执行率低于画面坐标**,持物类必须双锚定;③模板格式要求(分行)必须标"硬性"否则执行时被合并——同一条"规范有槽位≠会被填"的又一例证
- 备注:**.dsh 副本已于同日授权同步**(还原力补强+文生图验证修复两轮合并移植,8处编辑;验证 SKILL.md diff 仅剩 name+last_change 两处预期差异,updated_at 两端一致,F1 节完全一致)
## 短视频分镜脚本 — F1 第二轮生成对比修复8项(仅 V1.0,.dsh 未同步)
- 背景:用户用修复后提示词二次生成再对比,指出三大问题:背景虚化不足/脸部朝向不对/服装还原度低;全面扫描另发现4项+用户决策废弃极简版
- 用户关键决策:**极简增强版废弃**——"没有什么用,要尽可能完全还原",F1 定位还原导向,只输出结构化版单版本
- 修复落地(V1.0 SKILL.md F1 节,7处编辑):
- 虚化结果转译:焦距光圈是光学参数模型不推算,直接写视觉状态("背景模糊成柔和色块仅可辨轮廓剪影")
- 脸部朝向可见部位锚定:四分之三侧脸=完整一眼+另一只部分+一只耳朵("可见右耳"),方向词执行率低
- 服装结构扩写:外层(品类+颜色+衣长+袖型)+内层可见+腰部(宽窄+位置)
- 字段按还原优先级重排:关键还原项前置(主体/朝向/虚化),背景细节后置——模型对提示词开头权重最高;基础属性移至末尾
- 逆光入画写法:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"替代名词性"轮廓光"描述
- 表情分离+前置:多人画面表情分开描述禁合并(模型对"双人一致表情"有先验会平均化),写入【主体】行靠前
- 负面约束加对抗项:背景清晰/背景细节过多/景深过大(反向词压制反效果)
- 同步修正:详细方法论07行旧"轮廓光转译"表述更新为逆光入画;人物专项还原力精度扩至⑦条
- 教训:①**"参数→结果"转译规律**:凡是技术参数(焦距/光圈/角度/L值)模型都不推算,必须写"看起来的样子"(视觉状态直述);②**提示词位置=权重**:模型对开头权重最高,字段顺序不是排版问题而是效果问题;③**负面约束可作对抗手段**——不止排除错误,还能压制"该虚不虚/该糊不糊"的反效果
- 反优化复查(用户要求确认,自查发现4项自己引入的问题并修复):①P0 虚化转译+对抗项原是无条件规则——对产品/建筑等全清晰深景深原图会反向强加虚化,已条件化(仅原图有虚化时才写虚化结果+对抗项;全清晰图写"全画面清晰锐利");②P1 对抗项"背景清晰"有拆词风险("清晰"被整体否定→全图发软),已删,保留完整语义单元"背景细节过多/景深过大";③P1 服装"腰封宽窄"预设腰封存在——现代装会被脑补出腰封,改"腰带/腰封如有"+补现代装示例;④P2 朝向可见部位锚定仅适用人像,非人物补角度锚定(正对/45度/侧面)
- 教训(反优化层):**给通用功能加规则必须问"7类图片都适用吗"**——虚化/腰封/人脸锚定都是从人像案例泛化出的规则,未过一遍产品/建筑/美食就是潜伏反优化;负面词组要按"拆词后各部分单独是否安全"审查
- 备注:.dsh 副本本轮未同步,待用户单独授权
## 短视频分镜脚本 — F1 画面感保护条款3项(仅 V1.0,.dsh 未同步)
- 背景:用户对比两轮生成图后指出第一轮(还原度低的)画面感反而更好——揭示"还原度≠画面感"张力;批准"可以试试"
- 落地5处编辑(V1.0 SKILL.md F1 节):
- 画面感保护条款段落:还原导向≠无脑精确化,逐项精确的同时保留 1-2 处"模糊氛围词"(远景暖光晕染/空气透视感/轻雾弥漫)不拆解不量化
- 反脑补规则细化形态级:未出现的**形态级**元素(山体/塔/水面/招牌等具体形态)才进反向词;**概念级氛围词豁免**——它们是画面感来源
- 人物专项⑧场景统一性声明:多人画面必加"同一瞬间:同一光线、同一情绪节律、同一画面感"
- 结构化模板【人物空间关系】行加同一瞬间声明
- 版本标签 last_change 更新
- 教训:**精确与氛围是互相拮抗的优化目标**——纯精确提示词(无氛围词)生成的图还原度高但像"摆拍工作照",丢生活瞬间感;反脑补规则粗用(概念级一刀切)会误杀画面感来源,必须区分形态级(脑补风险)与概念级(氛围资产)
- 备注:.dsh 副本本轮未同步(现共落后三轮:第二轮修复8项+反优化修正4项+画面感保护3项),待用户单独授权
## 短视频分镜脚本 — F1 第三轮生成图对比+四轮独立观察复盘(仅 V1.0,.dsh 未同步)
- 用户贴第三轮生成图:"怎么感觉越来越差了";随后指出我对比分析有误(脸型/朝向/表情全错但我判了✅)——**确认偏差**:拿提示词写了什么去"确认"图,而非独立观察
- 四张图(原图+三轮生成图)独立重观察核心发现:
- 第三轮非全面变差:A 表情(嘴大张)反而最接近原图——"O形"描述生效;但 B 闭合微笑被污染成张嘴露齿、脸型变圆宽、对襟丢失变V领睡袍、扁担水平、背景虚化变弱
- 第一轮(极简版)在 4 项上最强:A 对襟结构/B 披帛双手拎两端/A 扁担斜向下/背景虚化——**信息密度低模型自然走对**
- "同一情绪节律"是 B 表情污染源:模型把"情绪节律统一"读成"两人表情趋同",单向把 B 拉向 A(A 大张→B 也张嘴)——⑧场景统一性与⑥表情分离打架
- "领口V形交叠"引入"V"概念→模型优先执行"V领"→对襟丢失(第一二轮没这个词反而对襟都对)
- "扁担另一端延伸出画面左下角外"的"外"被脑补成"指向画面外"→扁担水平横穿(第一二轮"斜向下"写法有效)
- 用户判断:第二轮氛围最好——第二轮是8项精确约束加入前的版本,信息密度适中,模型有自由度渲染氛围;第三轮精确项堆满→注意力被细节吸干→氛围没了(精确与氛围拮抗的又一实证)
- 第四轮综合策略(用户指令"综合各轮优势"):第二轮氛围基底+4项定向精确修正(A表情O形/B表情闭合锁死/扁担斜向下/服装对襟删V形交叠)+删污染项(同一情绪节律/耳饰/竹篮/冗长朝向锚定)+氛围段前置到开头
- 新原则沉淀(待第四轮验证后固化 SKILL.md):**「关键项精确化+其他项自然化」**——精确项堆到6+维/人物时模型注意力被摊薄,关键项命中其他项崩盘;**对比生成图必须先独立观察再对照提示词打分,禁止拿提示词"确认"图**(流程铁律)
- 备注:.dsh 副本未同步
## 短视频分镜脚本 — F1 结构化版实体聚合(仅 V1.0,.dsh 未同步)
- 触发:用户审第四轮结构化版后发现人物信息散在【主体】【方位】【姿态与视线】【人物空间关系】【道具】五个字段里——"人物相关的提示词就应该写到一起 包括这个人所有的信息"
- 核心改动:结构化版模板从"按维度切分17字段"改为"人物按实体聚合每人一块+全局项独占字段";结构化版与整段版同一聚合结构,差异仅在有/无字段标签
- 聚合清单(每人一块内顺序):基础(脸型+肤色)→表情→发型与佩戴物(簪/耳饰)→服装含材质→朝向→姿势动作→持物→视线→空间位置
- 同步修复4处旧残留:①⑥"写入【主体】行"改"写入人物块靠前";②⑧"同一情绪节律"删除(防B表情趋同污染);③"17字段"/"按维度"表述更新;④"转写后逐件核对"改"逐件核对"(两层同结构不再叫转写)
- 教训:**拆散病不分审计层/生成层**——审计层按维度切分也破坏实体归属(材质/颜色/道具跨字段模型也无法归属),人审核对也应按人而非按维度
## 短视频分镜脚本 — F1 全局项4块聚合(仅 V1.0,.dsh 未同步)
- 触发:用户审第四轮结构化版后发现人物聚合后,全局项仍散在8个字段(场景/场景布置/镜头/光影/构图/色彩/材质质感/风格/氛围),且信息严重跨字段重复
- 重复清单:"中近景+平视"在镜头/构图各一次;"前景清晰锐利"在场景布置/镜头各一次;"后景屋檐树冠剪影"在场景布置/镜头各一次;"左侧微光烟雾"在场景布置/光影各一次;"暖色调"在光影/色彩各一次;"A居中偏左B居中偏右"在构图/人物段位置各一次
- 合并方案:8散字段→4聚合块——①场景(环境+前中后景内容,只写"有什么"不写虚化)②镜头(景别+机位+虚化+构图定位,合并旧构图)③光影(光源+逆光入画+色调系统,合并旧色彩)④风格与氛围(风格+情绪+画面感词+全局质感,合并旧材质质感/风格/氛围三字段)
- 新规则:**全局项禁止跨字段重复**——同一信息只在一处写,虚化只写镜头层、色调只写光影层、人物画面位置只写人物段尾
- 教训:**全局项也有归属问题**——散字段导致同一信息写多次(虚化状态同时出现在场景布置"前景清晰"和镜头"前景清晰锐利"),模型收到重复指令时反而不确定优先级
## 短视频分镜脚本 — F1 人物位置移至场景层(仅 V1.0,.dsh 未同步)
- 触发:用户质疑"人物位置朝向是不是放在场景中更好"
- 分析判断:位置=关系性(A略前于B需两人同时在场才能定,放人物段造成循环引用)→移场景;朝向=个体渲染属性(决定怎么画脸/可见部位锚定与表情一体)→留人物段
- 改动:人物段末尾删"站在画面中偏左/右+前后关系+同一瞬间声明";场景段补"人物布局"(每人画面位置+前后关系+间距+同一瞬间声明);镜头段删"人物画面位置定位"(已在场景层写)
- 聚合清单末尾从"→空间位置+同一瞬间声明"改为"→视线落点"收尾
- 教训:**关系性信息归场景,个体渲染属性归人物**——位置是"把人放哪"(layout),朝向是"怎么画这个人"(rendering),拆分依据是信息性质而非字段美观
## 短视频分镜脚本 — F1 人物标签去位置化(仅 V1.0,.dsh 未同步)
- 触发:用户指出【画面左侧女性A】标签冗余——位置信息和角色编号混在标签里,而位置已在场景段写过("A居画面中偏左略前"),两处重复
- 改动:人物标签从"画面位置+角色编号"改为"性别+角色编号"(如"女性A""女性B",单人时"人物");标签只负责标识"是谁",位置归场景层;朝向描述里同步删去"+画面左中右位置"
- 教训:**标签=标识符,正文=信息载体**——标签里带可变信息(位置)必然与正文重复;标签只需最小辨识度(性别+编号够用,裸编号不够)
## 短视频分镜脚本 — F1 表情描述禁几何抽象词(仅 V1.0,.dsh 未同步)
- 触发:用户质疑"嘴大张呈O形"是否符合画面——重新独立观察原图发现A嘴实际是**横向咧嘴大笑+上排牙齿完全可见+嘴角上扬外扩**,不是几何圆形O
- 根因:**几何抽象词被模型字面执行**——"O形"被读成emoji 😮那种垂直方向圆嘴,生成"惊讶张大嘴"而非"咧嘴大笑"
- 同类病汇总:①"对襟+V形交叠"→V领睡袍(V字面执行)②"轮廓光"→模糊轮廓(名词性描述缺动作)③"嘴大张呈O形"→圆形惊讶嘴(O字面执行)——抽象词/几何词/纯名词都是字面执行高危区
- 修法:**动作状态词优先 + 可观察子状态**(开怀大笑/咧嘴大笑/放声大笑/会心微笑 + 露上牙/上排牙齿完全可见/眼睛眯成弯月);**禁几何抽象词**(O形/一字形/V形/圆形/椭圆形/一字眉)必须改具体可观察形态或动作状态词
- 替代词映射:O形嘴→咧嘴大笑/露齿大笑;一字眉→眉头平直;V形领→两片襟布在胸前交叠形成斜向襟线;圆形脸→脸型短宽下颌圆钝
- 教训:**描述怎么笑用动作状态词(开怀大笑/咧嘴大笑),描述怎么张用具体可观察子状态(露上牙/上排牙齿可见),禁几何抽象词**——这是"对襟"问题的通用化版本,所有写"XX形/XX状"的词都应做一次"字面执行审查"
## 短视频分镜脚本 — F1 水印零出现在正向提示词(仅 V1.0,.dsh 未同步)
- 触发:用户指出【文字】字段写了"左下角水印(@ACVIP…)只进反向词"——反向词的内容不应出现在正提示词中
- 根因:旧规则"水印类不写入"被执行成"要说明水印不写入",说明性文字本身把"水印"字样带进了正向提示词——**正向提示词提及"水印"字样本身就有诱导生成水印的风险**(含否定式提及)
- 修法:标识性文字(水印/署名/@账号/logo/时间戳)正向提示词零出现——观察报告提及即可,负面约束"水印"项承载;无内容性文字时【文字】字段整个省略
- 教训:**否定式提及也是提及**——"不写水印""水印只进反向词"这类元说明对模型是噪音+风险词;规则要在文件内部执行完,输出层不留执行痕迹
## 短视频分镜脚本 — F1 参数化/CGI术语清理4项(仅 V1.0,.dsh 未同步)
- 触发:表情"O形"修复后的同类问题扫描,用户确认修复清单
- 改动(模板级):①镜头层删"焦段参考(如85mm)"并加禁令——禁写焦段/光圈参数与"浅景深"等参数化术语,虚化结果句已承载全部景深信息(修复与"参数→结果转译"规则的内部矛盾,P0)②光影层加渲染术语禁令——"体积光"是CGI术语,直白写"光柱清晰可见"③服装结构加汉服专有品类形态锚定——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定(搭肩/双手拎两端)兜底可不加
- P2保留不动:披帛/中近景/弯月/机位——自然搭配隐喻词有模型先验支撑,过度替换会掉进"全术语洁癖"
- 教训:**抽象词要分两类**——无锚定的几何/参数/CGI术语(O形/85mm/浅景深/体积光)必须转译;自然搭配隐喻词(眯成弯月/古铜肤色/四分之三侧脸)保留。判据是模型训练数据里该搭配有无稳定视觉先验
- 修法映射:浅景深→删(虚化结果句承载);体积光→光柱清晰可见;抹胸→抹胸(贴身吊带状)
## 短视频分镜脚本 — F1 反向词正向零出现核对(仅 V1.0,.dsh 未同步)
- 触发:用户确认"否定式提及也是提及"原则推广到所有反向词——输出时逐项核对负面约束词是否在正向提示词任何位置出现
- 固化:负面约束模板字段加"反向词正向零出现核对(输出后必做)"——逐项核对每个反向词(含子串/否定式提及/说明性文字),出现即改正向措辞
- 实际核对当前版抓到真冲突:正向"中景人影模糊" vs 反向"模糊"——反向词在压制正向意图的背景虚化,是第三轮虚化失效的嫌疑原因之一;模板镜头层示例自己写的"背景模糊成柔和色块"同款冲突,一并改"虚化"
- 修法:正向虚化描述统一用"虚化/朦胧"避开"模糊"字样;反向词表不动
- 教训:**反向词与正向描述是同一场拔河**——反向"模糊"不只压"画质模糊",也压"背景虚化"(模型按词不按意图);正反词表要交叉核对后才能定稿
## 短视频分镜脚本 — F1 画面质感层独立成字段(仅 V1.0,.dsh 未同步)
- 触发:用户贴参考图(渲染参数堆砌范式:画面质感/色调光影/场景/人物氛围/镜头语言5大类)指出"风格与氛围"应承载画面质感并问还缺什么
- 缺口分析:①**画面质感(渲染参数层)全缺**——8K/微颗粒/非完美锐度/轻微色差/HDR/纪录片摄影风格,此前被并进风格与氛围但实际是独立渲染指令层,只有流派词无渲染参数→模型默认按现代高清管线生成,丢失胶片味;②**镜头运动/拍摄风格全缺**——镜头字段只有景别+机位+虚化(静态布局),无POV/手持等拍摄风格
- 落地(用户确认"先修复",重落地三项):①新增【画面质感】字段(渲染规格+质感风格锚定+反向词冲突审查)②镜头字段扩展拍摄风格子项(静态可执行项,晃动/呼吸感等动态词仅视频用静帧不写)③风格与氛围降级为纯流派+情绪+画面感词(画质/渲染词迁出);全局项4块→5块(场景/镜头/光影/画面质感/风格与氛围),输出格式+两层分工说明同步
- 关键区分:**输出规格词(8K/微颗粒/HDR/胶片模拟)模型可识别可写,输入参数(85mm/f值)模型不推算禁写**——"参数→结果转译"禁的是输入参数,不是所有技术词
- 年代+流派双锚定执行率最高:"2010年代初纪录片摄影">泛词"电影感"(后者落到好莱坞大片先验)
- 教训:**风格=流派定位(这是什么),质感=渲染指令(按什么管线生成)**——两层混写会导致渲染层信息丢失;参考图范式的5分类对"画面质感/镜头语言"的独立强调是对的,值得吸收进实体聚合范式
## 短视频分镜脚本 — F1 字段更名:风格与氛围→画面风格(仅 V1.0,.dsh 未同步)
- 触发:用户提议"风格与氛围是否可改为画面风格"
- 判断:该字段内容=流派+情绪基调+画面感词,都是"整体画面长什么样"的调性描述,【画面风格】名实相符且更直白;与【画面质感】形成"风格=调性/质感=渲染"清晰分工
- 落地:5处引用统一改名(输出格式行/两层分工说明×2/模板字段/版本标签),字段内部描述同步微调("纯流派定位+情绪"→"流派定位+情绪基调")
- 备注:.dsh 副本未同步(落后多轮),待用户单独授权
- 备注:.dsh 副本未同步(现共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 光影/质感/风格三层表达范式升级(吸收动态分镜脚本参考图,仅 V1.0,.dsh 未同步)
- 触发:用户贴一张动态分镜脚本级提示词截图问"是否值得参考"。分析结论:表达范式值得吸收,POV/声音/方言/手持晃动等视频概念 F1 静帧不适用、场景时代地域属题材内容不吸收
- 三处升级(用户"先优化"确认执行,6处编辑+零残留验证):
①**光影层色调系统三段式**:饱和度(低/正常)+色相("冷灰偏旧""整体暖黄调")+胶片类型("复古胶片色调""暖调胶片模拟")——如"低饱和度,冷灰偏旧的复古胶片色调";光源类型先行(自然光为主/单一人工光源/混合光);观察层(第2步)同步"饱和度必观察"
②**画面质感锚定升级**:年代+流派双锚定→**年代+流派+媒介三合一**("2010年代初纪录片式胶片摄影"一句写全)
③**画面风格层补写实流派执行词**:"写实真人风格""生活流表演";氛围词"轻X氛围"句式("轻压抑氛围""轻怀旧氛围"比直写"压抑"可控)
- 教训:**参考动态分镜范式要按 F1 场景裁剪**——表达范式(色调三段式/年代流派媒介锚定/轻X氛围句式)可迁移,视频特有维度(POV/声音/方言/晃动)不迁移;截图里"暗部细节保留/轻微色差"实际上一轮已落库,先核对现状再报增量
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 整段版实体绑定断链修复(仅 V1.0,.dsh 未同步)
- 触发:用户质疑"整段版哪里来的,里面都不知道谁是谁"——整段版剥标签时把人物标签(女性A/B)也当字段标签剥掉,两段同以"脸型窄长…的年轻女性"开头无法区分,场景段"一人居偏左、一人居偏右"与人物段断链,模型无从知道谁站哪边
- 修复:整段版规则修正——"去掉字段标签"明确为**仅剥全局块标签(【场景】【镜头】等)**,**人物标签(女性A/B)保留**并作为跨层实体绑定锚点:人物段以"女性A:"开头,场景段布局用同一编号绑定("A居画面中偏左略前,B居画面中偏右")
- 教训:**人物标签有双重身份——既是人类可读标识,也是跨层实体绑定锚点**;"去标签"操作要区分元规则标签(剥)与实体标识(留),一刀切剥离会断实体绑定链
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 跨层绑定完整主体名称 + 对话展示格式(仅 V1.0,.dsh 未同步)
- 触发:用户指出场景段"A居画面中偏左略前,B居画面中偏右"要和主体名称完全对应;且生成的提示词不要放带滚动条的框里(不好复制)
- 修复:①场景段人物布局绑定改用完整主体名称("女性A居画面中偏左略前,女性B居画面中偏右"),禁裸编号A/B——跨层绑定字面必须与人物块标签完全一致(结构化版+整段版同步生效);②对话展示格式新增规则——最终提示词不用长行代码块(横向滚动条影响复制),以普通文本段落输出
- 教训:跨层实体绑定的引用必须用完整标签字面——裸编号"A/B"只在紧邻人物块时可读,场景段离人物块隔了场景描述,裸编号脱离上下文无法辨认
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 整段版正负提示词分离(仅 V1.0,.dsh 未同步)
- 触发:用户指出"整段版模型连哪个是正向哪个是负向都不知道"——整段版剥掉【负面约束】标签后,负向词段落直接混排在正向文本末尾,单框模型会把"低清晰度, 模糊"当正向描述执行
- 修复:整段版正文只含正向提示词(人物段+5全局块段);负面约束独立成第二部分输出,带"负向提示词:"标识行(标识行是给用户的复制分发指引:即梦/SD贴负向框、Midjourney转--no、NanoBanana才内联且需否定句式转写如"画面中不出现…");平台适配规则同步——即梦负向词贴"不希望呈现的内容"独立输入框,原"反向词内联末尾"默认废除
- 教训:**"剥标签"只能作用于正向内容内部的结构标签;正负两个语义相反的板块必须保留显式分隔**,否则负向词以裸文本混入正向流会被模型当正向执行
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 负向提示词标识行精简(仅 V1.0,.dsh 未同步)
- 触发:用户指出输出里"(贴即梦'不希望呈现的内容'框)"这类括号操作指引不需要——输出只要"负向提示词:"标识行本身
- 修复:标识行只写"负向提示词:"五个字;平台分发知识(即梦贴负向框/MJ转--no/NanoBanana否定句式)留在 SKILL.md"目标平台适配"节作内部知识,不写入输出
- 教训:**给用户的操作指引≠输出内容**——输出的每句话都会被复制走,只有会被复制的部分才进输出;分发说明留在技能规则层即可
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 肤色受光面判据落库 + 挂载物防丢(仅 V1.0,.dsh 未同步)
- 触发:用户问"两个角色肤色有没可能是光线导致看起来不同",重看原图独立观察确认——A 与 B 基础肤色同为暖白偏粉,A"古铜肤色"是背光+暖调滤镜的整体观感误判(A 接近正面=背光面大,B 四分之三侧脸=受光面多)
- 修复(用户"都修复"确认,SKILL.md 3 处编辑):①观察层人物专项"面部神态"补**基础肤色取面部受光面**(鼻梁高光/受光侧脸颊/边缘光色调),禁取整体观感;多人先核受光角度一致性,观感差≠肤色差,明暗差由光影层处理;②结构化模板"基础"字段同步判据;③持物字段补**挂载物随道具一起写**(扁担上挂的竹篮随扁担写)——竹篮已两次在聚合时静默丢失
- 教训:**逆光场景肤色判断看受光面(高光/边缘光),不看整体观感**——背光偏暗+暖调偏黄会叠出"古铜感"假象;写死观感肤色会让模型生成真实肤色差异(人种特征漂移)
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 持物/挂载物坐标系反转(仅 V1.0,.dsh 未同步)
- 触发:第四轮生成图竹篮只在画面最左下角露出1/3被截断。用户连问"看到筐了吗在哪里"→"物品位置要相对于人物来描述"→重看原图发现**扁担方向也写错了**(原图扁担斜向身后延伸、筐在A身后偏右肩背高度;我写"斜向下伸向画面左下角")。第四轮竹篮截断是提示词位置设计直接导致
- 修复(用户"确认"执行,SKILL.md 4处编辑+零残留验证):①观察层精度要求③**旧规则"持物方位优先画面坐标"整条反转废除**——物品位置改用相对人物身体方位(身前/身后/左肩/右肩至背部高度),禁画面绝对坐标;②道具几何锚定示例同步改身体坐标;③结构化模板持物字段——挂载物必须独立写明相对身体方位(无独立位置会跟随道具末端漂移到画面边角被截断);④光影层画面现象位置词需明确"画面左侧"(禁裸写"左侧",人物左/画面左歧义)
- **坐标系分界固化**:物品位置=人物段身体坐标(跟人物走、多人归属清晰、跨场景稳定);人物站位=场景层画面坐标(构图信息,不要矫枉过正改掉);朝向=画面/场景实体参照皆可(旋转描述的本质)
- 教训:**确认偏差第三次+第四次**——"全在✅"没核位置与可见度(竹篮边角1/3也叫全在);扁担方向根本没细看原图(写"斜向下伸向画面左下角",实际是斜向身后)。物品位置写画面绝对坐标=把物品锚到画面坐标系,人物一动物品脱钩/截断
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 表情三要素 + 朝向量化锚定(仅 V1.0,.dsh 未同步)
- 触发:第五轮生成图用户连续指出"脸部朝向和原图对比""表情也不匹配"。独立观察确认:A 朝向写反(原图鼻尖微朝画面右,我写"微朝画面左");B 朝向弱化(四分之三侧脸生成成正脸,双眼完整);A 表情弱化("大张"生成"咧开一点","眯成弯月"生成正常睁眼);B 眼睛被先验污染(原图嘴笑眼不眯,生成图 B 被擅自眯眼——提示词对 B 眼睛完全没写)
- 修复(用户"确认优化",SKILL.md 5处编辑+零残留验证):
①**表情锚定三要素**:嘴部状态(幅度锚定"张到最大幅度/下唇被向下拉开",单写"大张"被弱化)+眼周状态必写("完全眯起成月牙形仅见弧线眼缝"/"自然睁着瞳孔清晰可见")+嘴眼配对关系(咧嘴+眯眼=开怀大笑;抿嘴+睁眼带笑=温柔注视)
②**模型默认先验"微笑=眯眼"**:会给抿嘴微笑人物擅自加眯眼——眼周状态必写不可省略
③**朝向观察以鼻尖朝向为唯一可靠判据**:数鼻翼两侧可见度,非脸型对称感(实测"左脸颊面对镜头多一点"被误读成"朝画面左",实际鼻尖朝画面右——脸朝向和某侧脸颊面对镜头是两件事)
④**"四分之三侧脸"是弱执行词**:模型弱化成接近正脸——需硬量化(鼻尖方向+鼻梁阴影侧+被挡眼仅露眼角一线+另一侧耳朵不可见)
- 教训:确认偏差第五、六次——A 朝向观察错(判据用错)、A/B 表情"✅完全还原"未核嘴幅度与眼周状态(A 眼根本没眯也说✅)。表情核对必须逐要素:嘴幅度/牙可见/眼眯睁/嘴眼配对
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 新增每步自检机制 Step-Check(仅 V1.0,.dsh 未同步)
- 触发:用户问"图片反推提示词是一步就执行出结果了吗"→分析确认 F1 内部 6 步全在黑盒一口气跑完、无校验环节,质量闭环在技能外部(生成图回贴才发现错);用户拍板"每一步处理 模型自己也要检查"
- 落库(SKILL.md 新增"每步自检 Step-Check"节+版本标签):6 步每步执行完必做自检,不通过重做该步、禁止带病进下一步。步骤2 观察=错误重灾区:每维度写完结论**回看原图一次**再落笔,核法必须"先看图再对照结论"(拿结论找印证=确认偏差);步骤5 输出前 6 项终检:人物标签完整主体名称/道具挂载物对照观察清单逐件打勾(防静默丢弃)/反向词正向零出现/坐标系分界/表情三要素+朝向量化/正负分离
- 教训:内部无自检时输出错误密度≈观察错误密度,纠错全靠外部生成图反馈,每轮成本高(重出整段版+用户去即梦验证);自检的核心不是"再读一遍自己写的"而是**回到原图独立核对**
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权
## 短视频分镜脚本 — F1 真实看图纠偏与形态固化(仅 V1.0,.dsh 未同步)
- 触发:在视觉通道彻底恢复、看清原图后,对比之前版本,发现 6 处极其关键的盲编与过度锚定偏差(扁担写成木板、拧折布巾写成拎披帛、B 极轻微侧脸写成大侧脸、A 睁眼大笑写成眯缝眼、抹胸色彩不贴合、漏掉右侧白衣褐裙配角)。
- 修正:重新生成一版 100% 真实对齐的提示词:
①**眼睛可见度回归真实**:A 大笑但双眼圆睁、明亮有神,瞳孔清晰(废除眯眼先验);
②**持物与姿态还原**:A 扁担搭右肩、右手肩前扶握前端;
③**去仙侠化/日常化**:B 左肩搭折叠拧条状深灰粗布巾,左手扶握,右手不露(废除“双手拉披帛”的做作 pose);
④**朝向精细校准**:B 仅极轻微侧面(约 15°),双眼均完整清晰可见(废除过度转头的右眼遮挡);
⑤**背景生态补齐**:右侧中景白衣褐裙侧身年轻女子,左侧白色炊烟/晨雾,废除臆造的木桶。
- 教训:**视觉盲区不能靠“文字推演”代替,更不能为迎合反馈而编造细节**。一旦视觉接口失效,必须立正报告、坚决停手,否则编造出的“西域/木板”等自洽逻辑会彻底偏离真相。
## 短视频分镜脚本 — F1 第六轮生成对比(完美闭环,仅 V1.0,.dsh 未同步)
- 背景:用户使用最新版 100% 真实对齐提示词在即梦生成第六版,效果极其惊艳,实现 95%+ 高保真还原。
- 实测对比结论(完全闭环):
①**眼神与神韵**:A 的大笑明亮圆睁、B 的微笑温柔不眯眼,完全去除了先验污染与眯眼化,神韵还原度极高;
②**姿势与道具**:A 扁担搭肩扶握前端、B 拧折布巾左手扶握,两人动作自然,彻底去除了做作的拉披帛仙侠感;
③**竹篮与位置**:竹编篓子完美挂在 A 肩后,且位置自然位于两人之间,大小比例极其协调,无截断;
④**背景与配角**:右侧中景白衣褐裙侧身女子神似原图,左侧炊烟自然亮起,西域/集市氛围拉满;
⑤**细节微调建议(若精益求精)**:A 外套领口开合度略宽,B 头顶发髻形状比原图稍圆,但已完全达到静态还原顶峰。
- 备注:F1 反推提示词至此完成全部重构并跑通闭环。下一步将建议用户授权同步到 .dsh 副本。
## 短视频分镜脚本 — F1 原图/最新版/第2版三图整体对比复盘(仅 V1.0,.dsh 未同步)
- 触发:用户要求重新整体分析原图、最新版图与第2版图。核心结论:第2版比最新版更有审美和松弛感,但与原图的动作/表情/人物关系偏离更大;最新版结构元素更接近,但AI网红脸、看镜头、表情僵硬问题严重。原图灵魂是并肩前行的真实生活瞬间,不是摆拍肖像。
- 关键判断:后续提示词不能只追求道具/服装硬指标,也不能只追求唯美构图;应采用“结构锚点保留 + 神韵语境松绑”的中间路线:A 保持挑担和竹筐位置,B 保持肩巾左手扶握,视线改为同伴互动/非看镜头,脸部避免网红大眼,雾气写潮湿晨雾而非浓烟。
## 短视频分镜脚本 — F1 神韵闭环机制落库(仅 V1.0,.dsh 未同步)
- 触发:用户确认优化技能,而不是继续只改单条提示词。三图复盘结论:最新版结构更近但神韵崩,第2版审美更好但结构偏;F1 最大问题是把"看见什么"误写成"器官/道具硬指标命令",导致网红脸、惊吓表情、摆拍感、硬衣和干烟。
- 落地(SKILL.md 多处编辑+二次残留清理):
①**视觉准入门 P0**:反推前必须确认真实看见图片像素;只拿到路径/文件指针/历史上下文时必须停止,禁止脑补生成;准入验证需先写3个不可从上下文猜出的画面事实。
②**三层观察**:事实层(人/物/衣/光/景)→关系层(是否看镜头、谁看谁、是否边走边聊、动作是否生活化)→神韵层(活人感、松弛、古典骨相、湿润空气感、AI污染方向)。
③**硬锚点/软锚点分级**:道具/服装/站位/持物硬写;人脸/表情/视线/互动/空气感软写语境化,禁止极限器官量化压死人脸神韵。
④**表情规则改造**:从"嘴眼三要素硬控"改为动作语境+面部协同;删光"张到最大幅度/圆睁/瞳孔清晰/下唇被…"等坏触发词残留。
⑤**非看镜头/人物交互专项**:多人生活流图必须判断是否看镜头、谁看谁、是否同行闲聊;视线落点不得省略为泛泛"望向前方"。
⑥**AI审美污染负向词库**:网红脸/现代写真脸/欧式大双眼皮/尖下巴/高鼻梁整容感/过大眼睛/假笑/游客照/影楼汉服/舞台浓烟等。
⑦**输出双版本**:结构还原版(审计硬锚点)+神韵优化版(默认生成层主稿);极简版仍废弃,但单硬还原版也不再作为唯一输出。
⑧**美学自检**:字段检查之外,还要查活人感、网红脸、假笑、直视镜头、硬衣塑料感、干冰烟雾。
- 验证:grep 清理旧残留:"11维度/十一维/视线→位置/单版本/高级结构化版单版本/张到最大幅度/圆睁/瞳孔清晰/下唇被" 均 0;确认 Level 1 极简版位于 F3 生成图片提示词复杂度分级,非 F1 残留,保留不动。
- 备注:.dsh 副本未同步(共落后多轮),待用户单独授权。
## 短视频分镜脚本 — F1 神韵闭环后规则一致性审计(只审计,未修改)
- 背景:用户担心最近几轮 F1 优化可能引入规则冲突,要求整体检查技能。
- 审计范围:`project/短视频分镜提示词/V1.0/提示词生成工具/SKILL.md` 的 F1 主流程、Step-Check、人物专项、目标平台适配、输出格式、结构化模板及全局关键词残留。
- 结论:主体方向正确,P0 旧残留基本清理干净;发现 1 个真冲突(NanoBanana 仍写“反向词内联末尾”与正负分离规则冲突)、2 个高风险表达(人物专项示例仍含“交叠V形”、正向示例仍含反向词“水印”解释)、2 个需澄清项(双版本与结构化/整段两层关系、详细方法论仍引用焦距/体积光词库但属参考源非输出规则)。
- 本轮未改 `.dsh` 副本,仍待用户单独授权。
## 短视频分镜脚本 — F1 审计建议4项修复落地(仅 V1.0,.dsh 未同步)
- 背景:用户确认“按照建议修改”,基于上一轮一致性审计执行小修,不做额外扩展。
- 修复项:①NanoBanana 平台规则取消裸负向词混排,统一正负分离;单输入框时负向内容改自然语言否定句式 ②人物专项汉服示例去“交叠V形”,改为“两片襟布交叠形成斜向襟线” ③新增“双版本 × 两层输出关系”,明确结构还原版/神韵优化版是内容策略,结构化版/整段版是交付形态 ④结构化模板文字字段抽象“标识性文字”表述,避免具体风险词进入正向字段解释。
- 验证:旧残留 `反向词内联末尾/交叠V形/水印等标识性文字/含"水印"/11维度/十一维/高级结构化版单版本/张到最大幅度/圆睁/瞳孔清晰/下唇` 均 0;新增规则 `双版本 × 两层输出关系/标识性文字在正向提示词零出现/文字与标识类排除项/斜向襟线` 均命中。
- 版本标签:V1.0 SKILL.md `last_change` 更新为本轮4项一致性修复摘要。
- 备注:本轮未改 `.dsh` 副本,仍待用户单独授权同步。
## 短视频分镜脚本 — F1 审计修复后中断复查(只复查,未修改)
- 背景:用户指出刚才中断数次,要求确认 4 项修复是否都修改到位。
- 复查结果:4 项均已落地:NanoBanana 正负分离/单框否定句式、汉服示例斜向襟线、双版本×两层输出关系、模板文字字段标识性文字抽象。
- 验证:旧残留 `反向词内联末尾/交叠V形/水印等标识性文字/含"水印"/11维度/十一维/高级结构化版单版本/张到最大幅度/圆睁/瞳孔清晰/下唇` 均 0;新增规则均命中。脚本对“禁止把结构还原版误解为结构化版”曾因引号匹配误报,Grep 已确认实际存在。
- 本轮只读复查,未改 SKILL.md,未改 `.dsh`。
## 短视频分镜脚本 — F1 微表情与面部朝向机制落库(仅 V1.0,.dsh 未同步)
- 背景:新一轮生成图对比后,用户指出右侧女生笑意未还原,并要求重点检查微表情、动作、面部朝向的左右与上下。
- 落地(SKILL.md):①人物专项表情规则新增“微表情四层”:嘴部/脸颊/眼周/情绪语境;②新增“交互强度≠表情强度”——弱交互只限制不强对视/不明显转头,不代表笑意弱,闭唇笑也需写嘴角、脸颊、眼神;③新增“面部朝向四件套”:左右朝向、上下朝向、头部倾斜、视线落点;④结构化模板同步更新表情示例与朝向字段;⑤修正人物专项编号重复(场景统一性声明改为⑨)。
- 验证:`微表情四层/交互强度≠表情强度/弱交互不等于弱表情/面部朝向四件套/上下朝向/头部倾斜/嘴角向两侧轻微上扬/脸颊微微提起/眼神柔和带笑/⑨场景统一性声明` 均命中;旧弱表情例句 `闭唇含笑,眼睛自然睁着,神态温和` 和重复编号 `⑧场景统一性声明` 均 0。
- 版本标签:V1.0 SKILL.md `last_change` 更新为本轮微表情与朝向机制摘要。
## 短视频分镜脚本 — V1.0 → .dsh 同步(用户授权)
- 用户明确要求将 V1.0 源技能改动同步到 `.dsh` 部署副本(`C:\Users\maidou\.dsh\skills\storyboard-prompt\SKILL.md`)。
- 同步方式:Python 脚本读取源技能全文,替换 `name: 短视频分镜脚本` → `name: storyboard-prompt`(保留 .dsh 特有 name),其余内容完整覆盖写入 .dsh。
- 同步范围:F1 全部多轮优化(视觉准入门 P0、三层观察、硬软锚点分级、互动强度分级、微表情四层、交互强度≠表情强度、面部朝向四件套、电影截图感防商业写真化、AI审美污染负向词库、双版本+两层输出、NanoBanana正负分离、结构化模板重写、Step-Check自检表、美学自检等)。
- 验证结果(20项全部通过):新增规则 16 项均命中;旧残留 4 项(11维度全观察/反向词内联末尾/交叠V形/水印等标识性文字)均 0。
- 行数一致:源 653 行 = .dsh 653 行;内容 match=True。
- .dsh 副本 `last_change` 已同步为最新版本标签。
## 短视频分镜脚本 — F1 生成闭环复盘与扁担防偏机制落库(V1.0 + .dsh 同步)
- 背景:多轮即梦生成图对比后,用户指出 B 笑意/朝向易回退、视线词易放大互动、扁担易变木棍/弯曲、竹筐易变背篓,并要求把经验优化到技能而不是只改单条提示词。
- 落地(SKILL.md F1 节):① Step-Check 新增“生成闭环复盘”:先列保留项/回退项/替换项,只替换失败模块;②人物专项新增“长杆类道具最小锚点法”:身体接触点+长轴方向+手部作用+挂载物归属;③新增“挂载物≠背负物”:竹筐/包袱等必须挂在道具下方且与背部有距离;④扁担专项正向要求“平直硬木扁担/平直木扁担”,防木棍、竖杆、弯曲、软杆、变形杆;⑤反向词新增长杆/挂载物专项类;⑥反向词默认选配规则新增“负向词分层精简”;⑦新增“生成闭环复盘与有效锚点保护”;⑧新增“视线词高风险规则”,弱交互优先写低强度视线词,禁止未经验证泛化替换有效面部句。
- 同步:已按用户授权将 V1.0 源技能同步到 `C:\Users\maidou\.dsh\skills\storyboard-prompt\SKILL.md`,保留 `.dsh` frontmatter `name: storyboard-prompt`。
- 验证:源技能与 .dsh 均命中 `生成闭环复盘/有效锚点保护/视线词高风险规则/长杆类道具最小锚点法/平直硬木扁担/弯曲扁担/挂载物≠背负物/竹筐贴背/负向词分层精简/反向提示词(7 类)`;旧标题 `反向提示词(6 类)` 已改为 7 类。
## 短视频分镜脚本 — F1 金标锚点逐字保护+长杆三问+视线匹配表(V1.0 + .dsh 同步)
- 背景:用户反馈某版 A 的面部朝向/笑容/表情是历史最佳,但后续改其他模块(扁担/筐/B 朝向)时 A 的好效果被连带回退,无法复现。根因:已有"有效锚点保护"规则太笼统(只说"不得误删",没有逐字复制要求+标记机制+模块隔离)。
- 落地(SKILL.md F1 节):①**金标锚点逐字保护**:某轮某局部明显优于其他轮时标记为"金标句",后续必须逐字复制粘贴,禁止同义改写/合并精简/拆分重组/优化措辞;回退时直接粘贴金标句原文,不重新从原图反推;按模块划分(A面部块/B面部块/道具块/场景块/光影块各自独立标记冻结);只有用户明确说"这版某处不好"才解冻。②**长杆承载方式优先判别三问**:下笔前先回答①承载方式(肩扛/单手握提/双手握提/落地斜靠)②杆身长轴方向(水平/斜上/斜下/竖直)③挂载物落点(挂上端/中段/下端/杆外侧);三问不答完禁止写"肩扛""横向"等默认描述。③**视线词与交互强度匹配表**:强/中/弱/无四档各自有视线写法和禁止写法;判错时先回交互强度判定,不直接调视线词。
- 同步:已同步到 `C:\Users\maidou\.dsh\skills\storyboard-prompt\SKILL.md`,保留 `name: storyboard-prompt`。
- 验证:源 671 行 = .dsh 671 行;MD5 一致;`金标锚点逐字保护/三问不答完/视线词与交互强度匹配表` 在源和 .dsh 均命中。
## 短视频脚本创作 — 时长分配规则修正:比例法→两端固定秒数(V1.0 + Lite1.0 双副本)
- 触发:用户指出 300s 视频会被分配 20-30s 开场,违反爆款开场 3-10s 黄金区间
- 根因:技能 4 处规则用固定比例「开场~10% / 中段~75% / 结尾~15%」,300s×10%=30s 开场、45s 结尾;爆款逻辑要求开场是固定秒数(3-10s)、拉长的只有中段;且与已有规则「时长区间统一使用绝对时间,不混用百分比」自相矛盾
- 修复原则:**两端固定秒数 + 中段吸收增量**——开场固定3-10s(短平快3-5s/中长5-10s)/ 结尾固定5-10s / 中段=总时长-开场-结尾
- 落点(V1.0 与 Lite1.0 同构同步,共 4 文件 5 处 + 引用):`2_需求完善.md` L65、`6_生成短视频框架.md` L27/L386/输出模板 L474-476、`7_生成短视频大纲.md` L171 引用、`01_标准爆款结构模板.md` 三幕结构总览 L233-239(时长列改固定秒数、占比列改分配规则、4.2 标题标 60s 示例并加说明行)
- 验证:旧比例 `开场~10%/中段~75%/结尾~15%/分段比例/[X]s (~10%)` 零残留(仅 SKILL.md last_change 变更摘要中的描述性引用);新规则 6 处双副本对称命中
- 版本标签:双副本 updated_at 2026-08-25 + last_change 记录修正摘要
- 教训:**比例式时长分配对长视频必然超纲**——开场/结尾是注意力窗口决定的固定区间(3-10s/5-10s),不随总时长线性放大;短视频任意时长的增量都应进中段,这是"两端固定+中段吸收"的唯一正确形态