From 3ce08d5c266b7ba9ece437fed499fa873009e6fe Mon Sep 17 00:00:00 2001 From: maogeigei Date: Fri, 4 Sep 2026 17:57:23 +0800 Subject: [PATCH] =?UTF-8?q?R71+R73-R75:=20=E6=8A=80=E8=83=BD=E6=A0=91?= =?UTF-8?q?=E4=BD=93=E9=87=8F=E4=BC=98=E5=8C=96=E4=B8=8E=E4=BF=AE=E6=95=B4?= =?UTF-8?q?=E2=80=94mcn-video-prompt=20F1=E7=BB=86=E5=88=99=E4=B8=8B?= =?UTF-8?q?=E6=B2=89references/=E5=8A=9F=E8=83=BD(680=E2=86=92596=E8=A1=8C?= =?UTF-8?q?78.5=E2=86=9246.7KB)+=E4=B8=BBSKILL.md=E5=8E=8B=E7=BC=A9(last?= =?UTF-8?q?=5Fchange=E6=98=8E=E7=BB=86=E8=BF=81=E5=8F=98=E6=9B=B4=E6=97=A5?= =?UTF-8?q?=E5=BF=97.md/=E6=B5=81=E7=A8=8B=E5=9B=BE25=E2=86=925=E8=A1=8C/?= =?UTF-8?q?=E6=96=B0=E5=A2=9E=E9=98=85=E8=AF=BB=E5=88=86=E5=B1=82)+dou-ana?= =?UTF-8?q?lysis=E8=AE=BE=E5=AE=9A=E5=8D=A1=E6=9A=96=E6=9D=8F=E8=9C=9C?= =?UTF-8?q?=E6=A9=98=E9=85=8D=E8=89=B2+browser-harness=E5=88=A0=E9=99=A42?= =?UTF-8?q?=E4=B8=AA14B=E5=8D=A0=E4=BD=8DSKILL.md=E9=98=B2=E5=AE=BF?= =?UTF-8?q?=E4=B8=BB=E8=AF=AF=E6=B3=A8=E5=86=8C(=E5=A4=96=E9=83=A8?= =?UTF-8?q?=E4=BE=9D=E8=B5=96=E6=AE=B5=E8=A1=A5=E9=87=8D=E6=8B=B7=E6=8E=92?= =?UTF-8?q?=E9=99=A4=E6=8F=90=E7=A4=BA)?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- project/短视频脚本创作/V1.0/SKILL.md | 36 ++---- .../V1.0/references-add/变更日志.md | 30 +++++ .../skills/browser-harness/SKILL.md | 1 - .../src/browser_harness/SKILL.md | 1 - .../references/feature/06_生成账号设定卡片.md | 1 + .../V1.0/subskills/mcn-video-prompt/SKILL.md | 96 +--------------- .../references/功能/F1_图片反推细则.md | 108 ++++++++++++++++++ 7 files changed, 157 insertions(+), 116 deletions(-) create mode 100644 project/短视频脚本创作/V1.0/references-add/变更日志.md delete mode 100644 project/短视频脚本创作/V1.0/subskills/browser-harness/skills/browser-harness/SKILL.md delete mode 100644 project/短视频脚本创作/V1.0/subskills/browser-harness/src/browser_harness/SKILL.md create mode 100644 project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/references/功能/F1_图片反推细则.md diff --git a/project/短视频脚本创作/V1.0/SKILL.md b/project/短视频脚本创作/V1.0/SKILL.md index aa44d36..abb4ebd 100644 --- a/project/短视频脚本创作/V1.0/SKILL.md +++ b/project/短视频脚本创作/V1.0/SKILL.md @@ -9,7 +9,7 @@ description: > 诊断脚本质量、设计账号人设、选题策划、生成分镜、广告植入设计、生成创作回顾。 version: "1.0" updated_at: "2026-09-04" -last_change: "新增「子技能索引(subskills/)」章节(09-04):subskills 下 6 个子技能全部登记入主 SKILL.md(browser-harness/lieflat-charts/mcn-data-insight/mcn-dou-analysis/mcn-script-review/mcn-video-prompt),引用一律用相对路径 subskills/<目录>/SKILL.md;目录树补 subskills/ 行;修正外部技能依赖段落(09-04):mcn-dou-analysis 原「D:\AgentSkill 两步判定」规则废弃(独立仓库不存在,改 subskills/ + dsh 平级 ~/.dsh/skills 双描述);browser-harness 可执行文件改技能自带 venv 相对路径(原 uv 工具安装已废弃)、lieflat-charts 路径改相对;全文件旧绝对路径引用零残留;技能更名:短视频脚本创作→短视频工作台(09-03 用户定,对外统一名称;触发方式与引用结构不变);触发条件新增🧹后台任务清理场景:用户问后台任务/清理过期失败任务时按 references/接口调用/自动化任务清理规范.md 执行(09-03 新增,全环境通用:只清过期或错误失败的一次性任务,禁清未来/周期/运行中任务,删除走宿主工具禁直改库);09-02 前:工作台新增第7条「AI 任务入口技能契约(P0)」:所有 AI 会话任务入口须遵守功能入口×技能调用契约(prompt=技能前缀常量+业务正文+skills 参数级挂载),新增/修改入口前先读 mcn-work-shop/docs/AI会话任务输入输出对照.md(含新增入口检查清单7项)——防裸 prompt 跳步/技能声明混入业务串/BROWSER_HINT 误注入(09-02 提炼/分镜/复盘三入口缺约束修复后固化,data-pages.js 四前缀常量);原第7/8条顺延为8/9;09-02 前:工作台任务执行方式铁律固化(创作/改写/复盘必须走 POST /api/run+skills 参数,禁会话内手写草稿)+09-01 调度机制实测定稿+端口 8899→8900" +last_change: "09-04 技能树体量优化(R73/R74):frontmatter 历史明细迁 references-add/变更日志.md、流程总览压缩为行式 Gate 链、新增阅读分层说明;本技能近期实质变更(09-04 子技能索引登记+外部依赖路径修正、09-03 更名短视频工作台、09-02 AI任务入口契约+执行铁律)完整历史见 references-add/变更日志.md;browser-harness 2 个 14B 占位 SKILL.md 删除(防宿主误注册,外部依赖段补维护提示)" deployment: "source" agent_created: true --- @@ -31,6 +31,11 @@ agent_created: true **支持赛道:** 学习教育 / 小剧场 / 美食 / 生活vlog / 美妆 / 三农 / 财富理财 / 身体锻炼 / 游戏 / 更多… +> **📖 本文件阅读分层(R74):** 本 SKILL.md = 流程引擎 + 规则摘要,正文分三类,加载后按此区分—— +> - **🚫 红线/P0 铁律**(关键规则〇~七、Gate 确认句、工作台第 5~7 条等):**每次执行必读**,绝不下沉、不可跳过。 +> - **🔑 关键引用/导航行**(各步骤「详细见 → references/创作流程/NN.md」、🔗 外部技能锚点、子技能索引):**执行到对应步骤时必须打开引用文件**,禁止凭印象执行或跳读细则。 +> - 无标记正文(概述/模式说明/目录树):流程骨架,快速扫描即可,条件触发时回查。 + --- ## 创作模式(三态) @@ -120,6 +125,7 @@ agent_created: true 浏览器操作(账号搜索、视频列表抓取等)统一使用 **browser-harness**(2026-09-02 起挂在本技能下,不再挂在 mcn-dou-analysis 下): - **技能本体**:`subskills/browser-harness/`(相对本文件;含 `envs/browser-harness/` 自带环境与 `src/` 源码,随源仓库分发) +- **⚠️ 占位清理(09-04)**:上游 repo 自带 2 个 14B `../../SKILL.md` 占位(`skills/browser-harness/SKILL.md`、`src/browser_harness/SKILL.md`,Claude Code 分发入口),宿主递归扫描会将其误注册成坏技能变体 → **已删除**。**重拷上游整包时必须排除这 2 个文件**(只保留顶层 `SKILL.md`),否则重复注册复发 - **dsh 部署环境**:`~/.dsh/skills/browser-harness/`(随 dsh_MCNProject 仓库分发,换机器自带) - **可执行文件**:`subskills/browser-harness/envs/browser-harness/Scripts/browser-harness.exe`(Windows;macOS/Linux 为 `envs/browser-harness/bin/browser-harness`)——**技能自带 venv**(09-04 修复重建,含 python.exe/pyvenv.cfg/全部依赖),随源仓库分发、无需 PATH/uv 工具安装;原「uv 工具安装 ~/.local/bin/browser-harness.exe」已废弃(uv 工具残留 09-04 已清理) - **进程生命周期(红线,09-02 用户明确)**:已开启的 Chrome(9223 调试实例/用户手动开启的 Chrome)一律不主动关闭,除非用户明确要求;任务结束/失败都保留,承载登录态与标签页复用 @@ -142,29 +148,11 @@ agent_created: true ### 流程总览 ``` -用户输入 - │ - ├─ 步骤1: 意图识别 ──┐ - │ ├──→ [Gate-0 分析确认] - ├─ 步骤2: 需求完善 ─┘ - │ - ├─ 步骤3: 对标视频/账号拆解 🔶(可选步骤) - │ - ├─ 步骤4: 账号设定解析和确认 ──→ [Gate-1 人设确认] - │ - ├─ 步骤5: 生成短视频选题 ──────→ [Gate-2 用户选择选题] - │ - ├─ 步骤6: 生成短视频框架 ──────→ [Gate-3 框架确认] ← 情绪规划层:场次结构+情绪设计卡 - │ - ├─ 步骤7: 生成短视频大纲 ──┐ ← 结构搭建层:模板选择+分段展开+钩子匹配+素材填充+密度自检 - │ ├──→ [Gate-4 大纲确认] - ├─ 步骤8: 植入广告内容 ──┘ ← 可选步骤 - │ - ├─ 步骤9: 生成短视频脚本 ────→ [Gate-5 脚本确认] ← 情绪演绎层:台词+动作+多维度表达 - │ - ├─ 步骤10: 生成短视频分镜脚本 🔶 可选步骤 ← 分镜脚本(拍摄标注) - │ - └─ 步骤11: 脚本检查和诊断 ────→ [Gate-6 最终确认] +S1 意图识别 → S2 需求完善 → [G0 分析确认] + → S3 对标拆解 🔶 → S4 账号设定 → [G1 人设确认] + → S5 选题 → [G2 选题确认] → S6 框架 → [G3 框架确认] ← 情绪规划层 + → S7 大纲 →(S8 广告植入 🔶)→ [G4 大纲确认] ← 结构搭建层 + → S9 脚本 → [G5 脚本确认] ← 情绪演绎层 → S10 分镜 🔶 → S11 诊断 🔶 → [G6 最终确认] ``` > **模式说明:** 自动模式(默认)下,所有 Gate 自动通过、中间步骤后台静默,AI 一气呵成只交付目标产物;共创模式下,每个 Gate 必须等待用户确认后才能推进;开发模式下,Gate 自动通过且每步产物全落盘。详见 [创作流程规范.md](references/创作流程规范.md) 二、创作模式。 diff --git a/project/短视频脚本创作/V1.0/references-add/变更日志.md b/project/短视频脚本创作/V1.0/references-add/变更日志.md new file mode 100644 index 0000000..5d14f02 --- /dev/null +++ b/project/短视频脚本创作/V1.0/references-add/变更日志.md @@ -0,0 +1,30 @@ +# 变更日志(主 SKILL.md frontmatter last_change 历史归档,09-04 起) + +> 用途:SKILL.md frontmatter `last_change` 字段的历史明细归档处(该字段仅保留最近一次变更的**一行摘要**,完整明细按日期记于此)。 +> 维护规则:每次变更 SKILL.md 时——① 在下方**按日期追加**一条(新在上);② frontmatter `last_change` 更新为当次一行摘要。 +> 本文件位于 `references-add/`(运行时与标准库取并集加载,不影响创作执行逻辑,仅供维护追溯)。 + +--- + +## 2026-09-04(R73/R74 技能树体量优化) + +主 SKILL.md 压缩维护:frontmatter `last_change` 明细迁移至本文件(历史归档);11 步流程 ASCII 总览图压缩为行式 Gate 链(S1→[G0]→…→[G6]);文件底部新增「阅读分层」说明(🔑 导航行/🚫 红线/无标记正文三类)。 + +## 2026-09-04(子技能索引登记 + 外部依赖路径修正) + +- 新增「子技能索引(subskills/)」章节:subskills 下 6 个子技能全部登记入主 SKILL.md(browser-harness/lieflat-charts/mcn-data-insight/mcn-dou-analysis/mcn-script-review/mcn-video-prompt),引用一律相对路径 `subskills/<目录>/SKILL.md`;目录树补 `subskills/` 行。 +- 修正外部技能依赖段落:mcn-dou-analysis 原「D:\AgentSkill 两步判定」规则废弃(独立仓库不存在,改 subskills/ + dsh 平级 `~/.dsh/skills` 双描述);browser-harness 可执行文件改技能自带 venv 相对路径(原 uv 工具安装已废弃);lieflat-charts 路径改相对。 +- 全文件旧绝对路径引用零残留。 + +## 2026-09-03(技能更名 + 触发条件补清理场景) + +- 技能更名:短视频脚本创作 → **短视频工作台**(用户定,对外统一名称;触发方式与引用结构不变)。 +- 触发条件新增 🧹 后台任务清理场景:用户问后台任务/清理过期失败任务时按 `references/接口调用/自动化任务清理规范.md` 执行——只清过期或错误失败的一次性任务,禁清未来/周期/运行中任务,删除走宿主工具禁直改库。 + +## 2026-09-02(工作台 AI 任务契约与执行铁律) + +- 工作台新增第 7 条「AI 任务入口技能契约(P0)」:所有 AI 会话任务入口须遵守功能入口×技能调用契约(prompt=技能前缀常量+业务正文+skills 参数级挂载),新增/修改入口前先读 `mcn-work-shop/docs/AI会话任务输入输出对照.md`(含新增入口检查清单 7 项)——防裸 prompt 跳步/技能声明混入业务串/BROWSER_HINT 误注入;原第 7/8 条顺延为 8/9。 +- 工作台任务执行方式铁律固化:创作/改写/复盘必须走 `POST /api/run` + skills 参数,禁会话内手写草稿。 +- 调度机制实测定稿 + 端口 8899→8900。 + +> ⚠️ 仅记录 2026-09-02 起的变更明细(本文件创建前,更早历史未归档——如确需追溯请查 git 提交历史)。 diff --git a/project/短视频脚本创作/V1.0/subskills/browser-harness/skills/browser-harness/SKILL.md b/project/短视频脚本创作/V1.0/subskills/browser-harness/skills/browser-harness/SKILL.md deleted file mode 100644 index 4215fae..0000000 --- a/project/短视频脚本创作/V1.0/subskills/browser-harness/skills/browser-harness/SKILL.md +++ /dev/null @@ -1 +0,0 @@ -../../SKILL.md \ No newline at end of file diff --git a/project/短视频脚本创作/V1.0/subskills/browser-harness/src/browser_harness/SKILL.md b/project/短视频脚本创作/V1.0/subskills/browser-harness/src/browser_harness/SKILL.md deleted file mode 100644 index 4215fae..0000000 --- a/project/短视频脚本创作/V1.0/subskills/browser-harness/src/browser_harness/SKILL.md +++ /dev/null @@ -1 +0,0 @@ -../../SKILL.md \ No newline at end of file diff --git a/project/短视频脚本创作/V1.0/subskills/mcn-dou-analysis/references/feature/06_生成账号设定卡片.md b/project/短视频脚本创作/V1.0/subskills/mcn-dou-analysis/references/feature/06_生成账号设定卡片.md index 83c203e..3030e1f 100644 --- a/project/短视频脚本创作/V1.0/subskills/mcn-dou-analysis/references/feature/06_生成账号设定卡片.md +++ b/project/短视频脚本创作/V1.0/subskills/mcn-dou-analysis/references/feature/06_生成账号设定卡片.md @@ -139,6 +139,7 @@ | 潮流/都市/时尚(潮流风尚/颜值) | 深紫黑 `#17101F→#0C0810` | | 活力/运动/热血(身体锻炼/体育) | 深海军 `#0E1B2E→#080F1A` | | 甜美/少女/二次元(甜宠/乙女向) | 深莓紫 `#3A1E42→#22102A`(调性深沉时);**玫瑰金渐变 `#D6A3A9→#9A5563`(调性明快时,如王微斯·定稿)** | +| **萌宠拟人喜剧/古风糖水(橘猫IP明快型)** | 浅色系·**暖杏蜜橘渐变 `#FCE8CC→#F2BC82`**(如平凡的胡德禄·09-04 定稿);主色取橘猫虎斑+古风庭院暖黄糖水 → 提亮降饱和至中浅明度(≈80% 亮度),底偏暖偏糖水与玫瑰金(粉)/暖橙(亲子)形成区分。配套**内部元素走账号风格化变体**:白卡 `#FFFFFF` + 暖橙边 `#ECC494` + 深棕字 `#8A4B23`(同俊希先例,明快型账号可偏离浅色系默认粉色内部元素,按账号主色相走暖色系) | **背景色推导公式(表中未列的风格)**:取账号色彩体系主色 → 压暗至 15-25% 亮度 + 降饱和 → 得深色渐变底(**仅背景色**,内部元素色不变)。 diff --git a/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/SKILL.md b/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/SKILL.md index b968de5..734ec21 100644 --- a/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/SKILL.md +++ b/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/SKILL.md @@ -8,8 +8,8 @@ description: > 角色卡、首帧图、运镜、景别、时间戳分镜、图生视频。 version: "1.0" agent_created: true -updated_at: "2026-08-31" -last_change: "④主体设定→④设定 改名(20处全量替换:SKILL.md 6 + 分镜提示词制作流程.md 10 + 长视频分段制作流程.md 4);6层结构定稿:①主体列表→②画面质感→③色调光影→④设定(人物/场景/构图,每项1句)→⑤镜头叙事→⑥负面提示词;视觉基调前置(模型对提示词开头权重最高);站位/构图边界固化(08-31):构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写),注记入 3.2.2 输出格式块+适配表+SKILL.md F4 结构定义" +updated_at: "2026-09-04" +last_change: "09-04 R73 F1 细则下沉:F1 节保留骨架(流程0-6+Step-Check+词库导航行)+🔴必读指针;人物专项/类型适配表/文字转录/反向词7类/双版本×两层输出/金标锚点逐字保护/视线词表/结构化格式模板等完整细则迁 references/功能/F1_图片反推细则.md(执行 F1 先通读该文件再动手);细则内词库引用改相对自身路径 ../知识库/…;SKILL.md 680→596 行、78.5→46.7KB。此前(08-31):④主体设定→④设定 改名(20处全量替换:SKILL.md 6 + 分镜提示词制作流程.md 10 + 长视频分段制作流程.md 4);6层结构定稿:①主体列表→②画面质感→③色调光影→④设定(人物/场景/构图,每项1句)→⑤镜头叙事→⑥负面提示词;视觉基调前置(模型对提示词开头权重最高);站位/构图边界固化(08-31):构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写),注记入 3.2.2 输出格式块+适配表+SKILL.md F4 结构定义" deployment: source created_at: "2026-08-20" --- @@ -69,95 +69,8 @@ created_at: "2026-08-20" | 5.5 生成闭环复盘 | 多轮出图后先列保留项/回退项/替换项;已经实测有效的脸部、表情、视线、道具、场景锚点必须**逐字复制**(见"金标锚点逐字保护"),禁止同义改写;只替换失败模块,禁止一轮失败后全量重写导致上一轮优势丢失 | | 6 变量提炼 | 变量化不破坏实体聚合结构(同一人物属性不拆到多段) | -**人物专项(画面含人物时必做 5 项):** 服饰造型(**结构化描述**:外层(品类+颜色+衣长+袖型)+内层(可见部分)+腰部(腰带/腰封宽窄+位置,**如有**——无则省略防脑补);汉服示例"灰白交领长衫(过臀,宽袖垂坠),领口两片襟布在胸前交叠形成斜向襟线,露出白色内衬窄边,腰间深蓝宽腰封约一掌宽";现代装示例"oversized白色卫衣(过胯,落肩宽袖),胸前无图案,下摆罗纹收口")/ 身材比例 / 肢体姿势 / 脸型轮廓 / 面部神态(肤色用具体色名:象牙白/小麦色/古铜色/深棕色/暖黄调/冷白调,不写"白""黑";**基础肤色取面部受光面**——鼻梁高光/受光侧脸颊/边缘光的色调,**禁取整体面部观感**——逆光背光面偏暗、暖调滤镜偏黄都会造成"古铜感"误判(实测:逆光图A整体观感偏深被判"古铜肤色",实际受光面与B同为暖白偏粉;受光角度不同的两人观感差≠肤色差);**多人场景先核两人受光角度是否一致**——受光角度不同导致的观感差,写真实基础肤色即可,明暗差由光影层自然处理)。**还原力精度要求:** ①肢体姿势写到**角度/手部动作/视线落点**粒度(如"侧身约30度朝画面左,右手提裙摆,视线望向画面右上"),姿势语言用 `references/知识库/02_动作行为/动作行为词库.md`;②**姿势动词≤2个/人**——复合动作(扛+斜搭+延伸类)改用道具几何锚定:接触点+道具两端相对身体方位(如"扁担中段搭右肩,前端在身前右手握持处,后端斜向身后上方延伸");③**持物/挂载物位置用相对人物的身体方位,禁用画面绝对坐标**——身体锚点(身前/身后/左肩/右腰/腿侧/右肩至背部高度等),禁写"画面左下角/右上角"(实测:扁担末端写"伸向画面左下角"导致挂载竹篮被锚定到画面边角截断;正确写法"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")。**长杆类道具最小锚点法**:扁担/伞/棍/枪等长杆类道具不能只写名称,也不能写成机械长篇几何说明;**下笔前先回答三问**:①承载方式:肩扛 / 单手握提 / 双手握提 / 落地斜靠?(看杆与身体的接触点,不默认肩扛——实测:右手手提斜杆挂篮被误判成"肩扛横杆",导致筐被画到身后、手被解放空手)②杆身长轴方向:水平 / 斜上 / 斜下 / 竖直?(看杆在画面里的实际角度,不默认横向)③挂载物落点:挂上端 / 挂中段 / 挂下端 / 杆外侧?(看筐/篮在杆上的实际位置)。三问不答完,禁止写"肩扛""横向"等默认描述。答完后最少写清4个锚点:①身体接触点(搭在哪个肩/握在哪只手/贴近哪个身体部位);②长轴方向(横向/斜横向/竖向,尽量用相对身体方向);③手部作用(扶住/握住/自然垂放,不强行摆拍展示);④挂载物归属(挂在哪一端/哪一段)。**挂载物≠背负物**:挂在道具上的篮筐、包袱、灯笼等必须写成"挂在某段道具下方、与身体背部有距离",禁止写成贴背/背在身上/背篓;挂载物位置用"身后侧扁担段下方、右肩至背部高度"这类身体相对方位,避免漂移到画面边角或贴背。**扁担专项防偏**(仅在长杆三问①承载方式=肩扛时适用;三问=单手握提时按普通长杆最小锚点法处理,不触发扁担专项):原图确认为扁担时,正向必须写"平直硬木扁担/平直木扁担",并写"中段搭在肩上,长轴横向或斜横向延伸";禁止只写"木棍/长杆",否则易变竖直手杖;禁止写"弯曲、柔软、藤条感、绳状"等会让扁担变形的词。若生成图出现木棍、竖杆、弯杆、软杆、竹筐变背篓,则只局部修道具段与对应负向词,不重写脸部/表情/场景有效锚点。**坐标系分界**:物品位置=人物段用身体坐标(物品跟着人物走,换场景/多人归属均稳定);人物站位=场景层用画面坐标("居画面中偏左略前"是构图信息,归场景层——不要矫枉过正把站位也改成身体坐标);④**微表情双轨制**——观察分析用 `references/知识库/01_主体描述/主体描述词库.md` 的微表情7区域×4级强度(保观察精度),写入提示词正文时**转译为直白可视化词**("眉弯L3+嘴大L3"→"露齿大笑"),L值标注是创作语言、文生图模型不识别;**动作状态词优先**(开怀大笑/咧嘴大笑/放声大笑/会心微笑)+ **可观察子状态**(露上牙/上排牙齿完全可见/眼睛眯成弯月);**禁几何抽象词**("嘴大张呈O形""一字眉""V形领""圆形脸"等)——模型会把"O/一字/V/圆形"字面读成几何形态,生成"惊讶圆嘴/惊讶一字眉/V领睡袍/圆饼脸"等与原图不符结果,**几何抽象词用动作状态词或具体可观察形态替代**("O形嘴"→"咧嘴大笑";"一字眉"→"眉头平直";"V形领"→"两片襟布在胸前交叠形成斜向襟线";"圆形脸"→"脸型短宽,下颌圆钝");⑤禁写"开心""温柔"这类无法执行的抽象情绪词;⑥**表情分离+前置**——多人画面各人表情分开描述禁止合并(模型对"双人一致表情"有先验,合并会被平均化),表情写入各人物块靠前位置(模型对提示词开头权重最高);**表情写法从器官量化升级为动作语境+面部协同**——先判断表情发生在什么关系里(看同伴、听人说话、边走边笑、对镜头摆拍),再按**微表情四层**写少量可见状态:①嘴部(张口/闭唇/嘴角上扬/嘴角横向打开)②脸颊(提起/放松/紧绷)③眼周(自然睁着/眼神带笑/轻微眯起/不眯成线)④情绪语境(边走边说话/听到同伴说话后忍不住笑)。禁止把表情拆成极限器官命令(如强制最大张口、强制瞪眼、强制强调瞳孔细节、强制描述唇部机械拉伸等都会触发惊吓感和AI僵硬感);优先写"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"、"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑"。**交互强度≠表情强度**——弱交互只限制不强对视/不明显转头,不代表笑意弱;闭唇笑也可以有明显笑意,必须单独写嘴角、脸颊、眼神。**眼周状态仍需观察但不做极限硬控**——模型默认先验"微笑=眯眼"会污染抿嘴笑,应用"自然睁着、眼神柔和"这类软锚点对抗,而非逼写器官细节。;⑦**脸部朝向/视线/互动强度分离**——脸部朝向=头部转向,视线落点=眼睛看向哪里,互动强度=人物关系强弱,三者必须分别观察、分别写,禁止用"看同伴/边走边聊"自动推导成"头部明显转向同伴";弱交互写法用"接近正面,眼神略偏向同伴"、"轻微朝向同伴但不形成强对视",强交互只有原图明确互相凝视时才写"对视/凝视"。**面部朝向四件套**必须同时判断:①左右朝向(鼻尖朝画面左/右/正前)②上下朝向(下巴/鼻尖平视、微抬、微低或内收)③头部倾斜(是否歪头,默认无明显歪斜不写)④视线落点(眼睛看向哪里);只写左右会丢头部姿态。⑧**脸部朝向用可见部位锚定**——正脸=五官对称居中;四分之三侧脸=完整可见一只眼+另一只部分+一只耳朵;正侧脸=一只眼+一只耳朵(如"A 四分之三侧脸朝画面右,可见右耳,右脸颊占比大"),方向词"面朝画面右前方"执行率低;**观察朝向以鼻尖朝向为唯一可靠判据**(数鼻翼两侧可见度,不是看脸型对称感——实测把"左脸颊面对镜头多一点"误读成"朝画面左",实际鼻尖朝画面右);**"四分之三侧脸"是弱执行词,模型常弱化成接近正脸**(实测:写"四分之三侧脸朝画面左+完整可见左眼+部分右眼",生成图双眼完整可见成正脸)——需按**角度档位写可见状态**量化:四分之三侧脸(约45°)="鼻尖明显朝向画面X,X侧眼完整清晰,另一侧眼因侧转明显变窄但完整可见";接近正侧脸(60°以上)="接近正侧脸朝画面X,仅X侧眼完整可见,另一侧眼完全不可见";**禁遮挡机制词("被鼻梁挡住/被遮住")与模糊量词("一线/一抹")**——机制式描述(解释为什么看不见)模型执行弱,只写看到了什么;且角度档位要自洽——"四分之三侧脸"+"仅露眼角一线"是两档角度自相矛盾(45°时远侧眼应大部分可见,仅剩眼角是60°+的形态),混写等于同时下两个角度指令模型无所适从;可见程度用直白梯度词:完整清晰/明显变窄但完整可见/仅露眼尾/完全不可见;⑨**场景统一性声明(多人画面必加)**——提示词写明"所有人物处于同一瞬间、同一光线"(**不含情绪节律**——实测"情绪节律统一"被模型读成表情趋同,导致B的闭合微笑被拉高污染),避免模型把多人拆成独立任务导致元素各自为政 -**类型适配表(在事实层/关系层/神韵层三层观察底座上叠加专属栏目):** - -| 图片类型 | 专属叠加栏目 | -|---|---| -| 产品摄影/电商 | 卖点描述(质感/工艺/情绪价值,只描述可见卖点不编造功能) | -| 人像摄影 | 外貌细化(种族族裔+肤色具体色名+妆容发型气质) | -| 风景/自然 | 主体景观描述(地貌/植被/水体/季节天气) | -| 美食摄影 | 食欲感与新鲜感描述(温度感/水分感/光影对食物质感的强化) | -| 建筑/室内 | 空间结构描述(空间类型/层次纵深感/材质/陈设/风格定位) | -| 海报/文字图 | 文字与版式描述(逐字转录所有可辨识文字+位置+字体风格) | -| 抽象/艺术 | 主体元素+艺术风格(绘画媒介/图形类型/流派归类) | - -**文字转录强制要求(画面含可辨识文字即必做,不限图片类型):** 画面中所有可辨识文字逐字转录,注明位置("瓶身正面居中""右下角""T恤胸前""背景招牌")与字体风格(衬线/无衬线/手写/装饰体),不省略、不模糊、不合并、不虚构。非海报类图(人像服饰slogan、场景路牌招牌、产品包装等)同样适用。 - -**文字二分类(转录后决定去留):** ①内容性文字(招牌名/产品文案/海报标题/服饰slogan)→ 写入提示词正文(复刻需要);②标识性文字(水印/署名/@账号名/logo/时间戳/平台ID)→ **正向提示词零出现**(含否定式提及与说明性文字——"左下角水印只进反向词"这类描述也禁止写,正向提示词出现"水印"字样本身就有诱导生成水印的风险),只在观察报告提及+负面约束"水印"项承载。 - -**反向提示词(7 类,按图片类型筛选用项):** -- 画面质量类:低清晰度, 模糊, 噪点, 过曝, 欠曝, 画质低劣, 分辨率不足 -- 结构与比例类:透视错误, 比例错误, 主体变形, 构图杂乱, 边缘破损, 重复物体 -- 材质与色彩类:材质错误, 反光混乱, 阴影错误, 色彩过饱和, 色彩发灰, 廉价质感 -- 文字与标识类:文字乱码, 多余文字, 错误文字, 水印, 错误logo -- 人物类(含人物时):肢体错误, 手指错误, 面部崩坏, 皮肤塑料感, 眼神异常, 多余肢体 -- **AI审美污染类(含人物且原图为生活流/古典/自然人像时优先选配)**:网红脸, 现代写真脸, 现代商业写真感, 过度通透高清, 棚拍精修感, 欧式大双眼皮, 尖下巴, 高鼻梁整容感, 过大眼睛, 惊恐表情, 夸张张嘴, 僵硬笑容, 假笑, 摆拍感, 直视镜头, 游客照, 硬挺新衣, 化纤质感, 塑料感, 影楼汉服, 舞台浓烟, 干冰烟雾, 过度戏剧光 -- **长杆/挂载物专项类(原图有扁担、伞、杆、挂篮等长杆+挂载物时按失败项选配)**:手持木棍, 竖直木棍, 拐杖, 竖杆道具, 白色长棍, 弯曲扁担, 弯曲木杆, 软杆, 变形杆, 藤条弯杆, 背篓, 竹筐贴背, 竹筐落地, 竹筐贴边, 挂载物截断, 道具展示感 -- AI痕迹类:AI痕迹明显, 细节缺失, 不自然过渡 - -**反向词默认选配规则:** 画面质量+AI痕迹类必带;含人物加人物类;海报/文字图加文字标识类;产品/美食加材质色彩类;建筑/风景加结构比例类;有长杆/挂载物且生成失败时加长杆/挂载物专项类。**负向词分层精简**:按"通用质量/人脸审美污染/本图专属纠偏/风格场景误差"四层选配,不把所有历史失败无限堆叠进负向词;本图专属纠偏只针对当前图片或最近一轮真实失败项,问题消失后可下调或移除,避免负向词过重把正向主体也打散。**反脑补项**——场景观察为穷尽清单,原图未出现的**形态级**元素(山体/塔/水面/招牌等具体形态)逐项加入反向词;**概念级氛围词(远景暖光晕染/空气透视感/晨雾光感)豁免**,不进反脑补清单——它们是画面感来源;烟雾/雾气失控放大时反向词加"浓烟";**对抗项(仅原图背景虚化时加)**——背景细节过多, 景深过大(**禁用"背景清晰"**:拆词后会把"清晰"整体否定,导致全图发软)。 - -**目标平台适配(用户指明时按平台语法适配输出):** -- **默认即梦/通用自然语言**:自然语言描述;**正向与负向提示词分开输出**(即梦有"不希望呈现的内容"独立输入框,负向词贴该框;单输入框平台在负向部分用否定句式转写如"画面中不出现…",禁止与正向词混排——混排后模型无法区分正负,"低清晰度, 模糊"会被当正向描述执行) -- **Midjourney**:参数式语法(`--ar 16:9 --style raw --v 6`),负面词用 `--no` 承载 -- **Stable Diffusion**:权重语法(`(word:1.3)`),6分类反向词放独立负面词框(negative prompt) -- **NanoBanana**:自然语言;默认仍按正向提示词与负向提示词分开输出。若平台只支持单输入框,负向内容必须改写为自然语言否定句(如"画面中不出现…"),放在独立负向段落中,禁止裸负向词直接混排在正向文本末尾 -未指明平台时按即梦/通用输出,不强行参数化。 - -**输出格式:** 双版本输出(均按实体聚合+全局项聚合): -- **结构还原版**:保证道具、服装、场景、人物位置、持物关系不丢;适合审计硬锚点。 -- **神韵优化版(默认推荐生成)**:在保留硬锚点基础上,降低人脸/表情/视线/空气感的器官级硬量化,强化人物关系、生活流语境、古典骨相、软布料、湿润空气感;适合直接喂模型生成。 -人物按"每人一块全信息"组织(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;**人物画面位置不写在人物块,统一归场景层人物布局**),全局项合并为5块——场景(环境+人物布局+前中后景内容)/镜头(景别+机位+虚化+拍摄风格)/光影(光源类型+逆光入画+色调系统三段式)/画面质感(渲染规格+年代流派媒介三合一锚定)/画面风格(流派+情绪基调+画面感词),加文字/负面约束/基础属性 + 类型专属栏目。 - -**版本说明:** 极简版信息密度不足以承载还原约束,已废弃;但单一硬还原版会压死人脸神韵,改为"结构还原版+神韵优化版"双版本。默认把神韵优化版作为生成层主稿,结构还原版作为审计层硬锚点清单。 - -**双版本 × 两层输出关系:** "结构还原版/神韵优化版"是内容策略差异,"结构化版/整段版"是交付形态差异。两个版本都可按结构化版审计、再转为整段版生成;默认交付顺序为:先给结构还原版结构化审计层(核硬锚点)→再给神韵优化版整段生成层(直接用于生成)。禁止把"结构还原版"误解为"结构化版",也禁止把"神韵优化版"误解为只要整段不要审计。 - -**两层输出分工(审计层 vs 生成层):** 结构化版与整段版是两层产物,缺一不可: -- **结构化版=审计层**:按**实体聚合**组织——**每个人物一块写完全部个体信息**(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;位置归场景层人物布局),全局项按5块聚合(场景/镜头/光影/画面质感/画面风格),供人工逐人核对——**不直接喂模型** -- **整段版=生成层**:喂模型的最终提示词,与结构化版同一实体聚合结构,去掉**全局块字段标签**(【场景】【镜头】等)合并为流畅自然语言段——**人物标签(女性A/女性B)保留**,人物段以"女性A:"开头,场景段布局用**完整主体名称**绑定("女性A居画面中偏左略前,女性B居画面中偏右"——禁裸编号"A居""B居",必须与人物块标签字面完全一致)——**人物标签是跨层实体绑定锚点,剥掉后多人段落无法区分、布局与人物段断链**(实测:两段同以"脸型窄长…的年轻女性"开头,模型无从知道谁站哪边);**禁止把同一人的属性拆到多个段落**(拆散后模型要跨段拼装,归属断链——材质/颜色/道具会张冠李戴);**道具与佩戴物内联到持有者段落**;**正向与负向分开**——整段版正文只含正向提示词(人物段+场景/镜头/光影/画面质感/画面风格全局段),**负面约束独立成第二部分输出**,标识行只写"负向提示词:"五个字,**不带括号操作指引**("(贴即梦XX框)"之类的平台分发说明是技能内部知识,不写入输出——平台怎么分发由用户自行判断,规则留在"目标平台适配"节),**禁止负向词直接混排在正向文本末尾**——剥掉【负面约束】标签后模型无从区分正负,"低清晰度, 模糊"会被当作正向描述执行(实测用户抓出) -- **逐件核对**:结构化版→整段版转写后,确认所有道具/佩戴物已内联到对应人物块,禁止聚合时静默丢弃(实测:竹篮在观察层被发现,却在聚合写入时丢失) -- **对话展示格式**:最终提示词不用长行代码块展示(横向滚动条导致用户复制不便),以普通文本段落输出,段与段空行分隔 - -**画面感保护条款:** 还原导向≠无脑精确化。逐项精确(姿势/服饰/道具/虚化)的同时,**保留 1-2 处"模糊氛围词"**(如"远景暖光晕染""空气透视感""轻雾弥漫")不拆解、不量化、不进反脑补清单——过度具体化会让生成图变成"摆拍工作照",丢失"生活瞬间感"(实测:纯精确提示词生成的图还原度高但画面感弱于带氛围词的版本)。 - -**生成闭环复盘与有效锚点保护(多轮出图后必做):** 每轮生成图对比原图后,先列三栏再改提示词:①保留项(本轮比上一轮更接近原图的脸部、表情、朝向、道具、场景、光影、质感句);②回退项(上一轮好、本轮变差的局部);③替换项(当前明确失败的局部)。修改只动替换项所在模块,保留项原句不得因其他问题被顺手重写。尤其在修扁担/竹筐/背景时,不得误删已实测有效的面部朝向和表情锚点;在修视线/表情时,不得误伤扁担、挂载物、场景氛围锚点。 - -**金标锚点逐字保护(多轮出图核心机制):** 当某一轮生成图的某个局部(如 A 的面部朝向/笑容/表情)明显优于其他轮时,将该局部对应的提示词原句标记为"金标句"。金标句一经标记,后续所有轮次的提示词中该局部句子必须**逐字复制粘贴**,禁止同义改写、合并精简、拆分重组或"优化措辞"——实测:仅把"嘴角横向打开"改成"嘴角上扬"就导致笑容效果完全丢失。回退时不重新从原图反推,而是直接粘贴金标句原文。只有用户明确说"这版某处不好要改"时,才允许动对应金标句,且改后旧金标句仍需保留备查。金标句的标记范围按模块划分:A 面部块(脸型→表情→朝向→头部姿态)是一个可标记模块;B 面部块是另一个;道具块、场景块、光影块各自独立标记。标记后该模块在后续轮次中"冻结",非用户明确要求不得解冻。 - -**非看镜头/人物交互专项(人像多人图必做):** 判断人物是否看镜头、谁看谁、是否同行/闲聊/经过镜头、表情是否回应对方。若原图是生活流抓拍,提示词必须写"非看镜头"、"边走边聊"、"自然经过镜头前"、"动作不是摆拍展示道具"等关系语境;负向词加入"直视镜头/游客照/摆拍感/网红写真"。视线落点是人物关系信息,不得省略为泛泛"望向前方"。 - -**视线词高风险规则:** 视线是软锚点,高于普通表情词风险。"视线越过镜头右侧"可能减少直视镜头,也可能让模型误读为看镜头外展示;"视线轻轻落向同伴/含笑回应"容易把弱交互放大成互相凝视。处理多人弱交互时,优先写头部朝向与表情语境,视线只写低强度词(如"眼神略偏""不直视镜头"),慎写精确落点;只有原图明确看向某人时才写"看向同伴"。若某一版面部朝向/神态已经实测更接近原图,后续不得把该面部句泛化替换为未经验证的新视线句。 - -**视线词与交互强度匹配表(写下视线前先查表):** -| 交互强度 | 视线写法 | 禁止写法 | -|---|---|---| -| 强交互 | "看向女性A,目光落在她脸上" | 禁止弱化为"略偏向"——原图明确看人就不能写弱 | -| 中交互 | "脸朝女性A方向,目光大致落在她肩颈区域" | 禁止写"凝视/深情注视"——会升级成强对视 | -| 弱交互 | "眼神略偏,不直视镜头" | 禁止写具体落点("看向A/落向A")——会把弱放大成强 | -| 无交互 | "目光朝前方" | 禁止写"看向同伴" | - -交互强度判错时,先回到交互强度判定(无/弱/中/强),不直接调视线词——先定强度,再查表选视线写法。 - -**美学自检(输出前必做):** 字段检查通过不代表图会好看。输出前必须自问:人物像活人吗?是否出现网红脸/尖下巴/过大眼睛/高鼻梁整容感?表情是否惊吓、假笑或僵硬?人物是否不该看镜头却直视镜头?衣服是否硬挺新衣/塑料感/影楼汉服?雾气是否变干冰浓烟?若任一命中,降低人脸与表情的器官级量化,改用神态语境、古典骨相、软布料、湿润空气感与审美负向词。 - -**结构化版格式模板(人物按实体聚合每人一块+全局项5块聚合,每人一块内按聚合清单顺序写——分行是硬性格式,禁止合并单行;关键还原项前置(人物表情/服装/朝向/虚化),背景细节后置——模型对提示词开头权重最高。**输出产物禁带元规则标注**——"(穷尽清单)""(前置)""(画面感保护词)"等括号注记不写入观察报告/结构化版/整段版,规则术语只留在本技能文件,输出层用自然语言。**全局项禁止跨字段重复**——同一信息只在一处写,如虚化只写镜头层、色调只写光影层、人物画面位置只写场景层):** -> **人物标签=性别+角色编号**(如"女性A""女性B",单人时直接"人物"),禁止用裸编号"A""B"——脱离上下文无法辨认是谁;**标签不带画面位置**——位置是关系性信息,归场景层,标签重复写会冗余:[基础(脸型+肤色——**肤色取面部受光面色调,不取逆光/暖调下的整体观感**;易漂移色名加锚定如"灰白≈浅亚麻/不含蓝调")→表情(**动作语境+面部协同**:先写"看同伴/听人说话/边走边笑/非看镜头"等关系语境,再写少量可见状态;禁极限张口、强制瞪眼、强制强调瞳孔细节、机械唇部拉伸等器官命令;推荐"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"或"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑",多人分离描述;弱交互不等于弱表情,闭唇笑也要写清笑意强度)→发型与佩戴物(簪/耳饰)→服装含材质(外层品类+颜色+衣长+袖型+内层可见+腰部如有+材质内联如"亚麻粗织感";**汉服专有品类加形态锚定**——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定"搭肩/双手拎两端"兜底可不加)→朝向(**面部朝向四件套+可见部位锚定+角度档位自洽**:①左右朝向看鼻尖朝画面左/右/正前;②上下朝向看下巴/鼻尖平视、微抬、微低或内收;③头部倾斜看是否歪头,无明显歪斜不写;④视线落点看眼睛看向哪里。四分之三侧脸=完整一只眼+另一只**变窄但完整可见**+一只耳朵("鼻尖明显朝向画面左,左眼完整清晰,右眼因侧转明显变窄但完整可见");接近正侧脸=仅一只眼完整可见+另一只完全不可见——**禁遮挡机制词("被鼻梁挡住")与模糊量词("一线")**,只写可见状态;"四分之三侧脸"单独写会被弱化成正脸,可见部位量化才锁得住;非人物用角度锚定正对/45度/正侧面)→姿势动作→持物(名称+材质+接触点+**两端相对身体方位**,无则省略;**道具上挂载的其他物品(如扁担上挂的竹篮)随道具一起写,且独立写明相对身体方位**(如"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")——挂载物单独留在观察层会在聚合时静默丢失(实测竹篮两次被丢);挂载物不写独立位置会跟随道具末端漂移到画面边角被截断(实测第四轮竹篮只剩边角1/3))→视线落点]|场景:[环境类型+空间特征+**人物布局**(**用完整主体名称**(女性A/女性B)写每人画面位置+前后关系+间距——与人物块标签字面完全一致,禁裸编号A/B;多人加"同一瞬间、同一光线"——不含情绪节律,防表情趋同污染)+前中后景三层逐层列各层陈设(**只写"有什么",不写虚化**——虚化属镜头层;未出现的大类元素直接进负面约束)]|镜头:[景别+机位+虚化**结果转译**:原图有虚化写"背景虚化成柔和色块,仅可辨认轮廓剪影"(**用"虚化"不用"模糊"**——负面约束含"模糊",正向出现会与之打架、弱化景深执行);原图全清晰写"全画面清晰锐利,前后景均无虚化"——**禁写焦段/光圈参数(如85mm、f值)与"浅景深"等参数化术语**,虚化结果句已承载全部景深信息,重复写参数反而引入不确定性+**拍摄风格子项**(原图可辨的静态执行项):POV主观视角/手持拍摄感/俯拍仰拍等;**晃动感/呼吸感/跟拍节奏等动态词仅视频提示词用,静帧反推不写**]|光影:[**光源类型先行**(自然光为主/单一人工光源/混合光)+方向+行为;强方向光**逆光入画**:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"+**色调系统三段式**:饱和度(低饱和度/正常饱和度)+色相(如"冷灰偏旧""整体暖黄调")+胶片类型(如"复古胶片色调""暖调胶片模拟")——完整示例"低饱和度,冷灰偏旧的复古胶片色调"或"整体暖黄调,背景暖褐暖灰"(具体色名留在各实体内联处不重复);**渲染术语禁写**——"体积光"是CGI术语,直白写"光柱清晰可见";**画面现象的位置词需明确参照**——"光柱在画面左侧"(明确写"画面左侧"),禁裸写"左侧"(人物左还是画面左歧义)]|画面质感:[**渲染规格+质感风格锚定**——这是独立于"风格流派"的渲染指令层:①渲染规格(8K高清/微颗粒胶片感/非完美锐度/轻微色差/暗部细节保留/HDR等,**这些是输出规格词模型可识别,与禁写的"输入参数"85mm/f值不同**)②质感风格锚定("纪录片摄影风格""胶片模拟""柔光片效果"等——**年代+流派+媒介三合一锚定执行率最高**,如"2010年代初纪录片式胶片摄影"(年代+流派+媒介一句写全)比泛词"电影感"强,后者会落到好莱坞大片先验)③反向词冲突审查("非完美锐度"避开反向"低清晰度"、"轻微色差"避开反向"画质低劣"的语义场——写前核对)④**电影截图感防商业写真化**:若原图是电影截图/剧照/生活流古装片段,应写"电影截图感、低饱和暖灰胶片色调、边缘略柔、非完美锐度、背景压缩虚化、生活流抓拍",并在负向词加入"现代商业写真感、过度通透高清、棚拍精修感",避免生成过干净的商业人像]|画面风格:[**流派定位+情绪基调**——风格名(如"古风写实人像";写实类可加执行词"写实真人风格""生活流表演")+情绪(如"欢快温暖的生活瞬间";氛围词用"轻X氛围"句式如"轻压抑氛围""轻怀旧氛围"比直写"压抑"可控)+符号内涵+**画面感保护词**(保留1-2处模糊氛围词如"远景暖光晕染""晨雾光感"不拆解不量化);**禁写画质/渲染词**(8K/颗粒/HDR归画面质感层,色调归光影层——旧"全局性质感"已迁出至画面质感字段)]|文字:[仅内容性文字转录+位置+字体;**无内容性文字时省略整个字段**——标识性文字在正向提示词零出现,相关排除项由负面约束承载]|负面约束:[6分类筛选项+反脑补项(原图未出现的大类元素如山/塔/水面)+**对抗项(仅原图背景虚化时加):背景细节过多, 景深过大**+文字与标识类排除项;**反向词正向零出现核对(输出后必做)**——逐项核对每个反向词(含其作为子串/否定式提及/说明性文字)是否在正向提示词任何位置出现过,出现即改正向措辞(如正向写背景虚化用"虚化/朦胧"避开反向词"模糊";反向"模糊"与正向"中景人影模糊"打架会弱化景深执行——实测第三轮虚化失效的嫌疑原因之一)]|基础属性:[画幅比](即梦平台UI设置不写入提示词;Midjourney 用 `--ar`) - -**多图模式(同主体多角度/多张图反推,衔接 F3 角色卡):** -提取共通主体描述(多图高置信交集)+ 各图差异项(姿态/光线/景别/角度);冲突项标注"图A/B不一致"由用户裁定。输出可直接喂 F3 角色卡的一致性主体锚定 + 差异镜头库。 - -**风格反推双轨输出(艺术风格维度专用):** -风格维度同时输出「风格命名」(人类可读,如"韦斯·安德森式对称构图")+「参数化描述」(去名化、可直接用于生成,规则见 `references/知识库/15_视觉风格/视觉风格词库.md` 去名化使用规范);命名与描述均标注置信度。 - -**注意:** 不声称还原图片原始隐藏参数,说明这是对画面的实用重构。 - -**还原路径指引(输出后主动告知用户,按用途分流):** -- **100% 复刻原片** → 走图生图/垫图(把原图作为参考图喂给平台),F1 提示词仅作辅助约束;纯文生图无法逐像素复刻 -- **改图/延展(同构图换元素)** → 文生图直接使用本提示词,改动目标字段即可 -- **学图(提炼风格/结构复用)** → F1 提示词 + 第 6 步变量提炼,替换变量生成同风格新图 +🔴 **执行细则必读(R73):** F1 细则(人物专项/类型适配表/文字转录强制/反向词7类与选配/目标平台适配/输出双版本与两层分工/画面感保护/金标锚点逐字保护/视线词高风险与匹配表/结构化版格式模板/多图模式/风格反推双轨/还原路径指引)→ 完整细则见 `references/功能/F1_图片反推细则.md`,**执行 F1 时先通读该文件再动手**(细则为实测沉淀,跳过即复现踩坑)。 **详细方法论(观察维度→词库语言对照):** - 人物专项+微表情7区域拼乐高+反AI假脸四大陷阱:`references/知识库/01_主体描述/主体描述词库.md` @@ -170,6 +83,9 @@ created_at: "2026-08-20" - 纹理材质+画质质感(有机瑕疵+反塑料感套装+摄影质感维度表):`references/知识库/10_后期细节/后期细节词库.md` + `references/知识库/12_画质分辨率/画质分辨率词库.md`(反塑料感宣言+胶片型号) - 视觉风格反推(28+导演风格去名化规范+国际大师/中国影视/新媒体/特殊四类风格库):`references/知识库/15_视觉风格/视觉风格词库.md` +--- + + --- ### F2. 反推视频提示词 diff --git a/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/references/功能/F1_图片反推细则.md b/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/references/功能/F1_图片反推细则.md new file mode 100644 index 0000000..d3750e3 --- /dev/null +++ b/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/references/功能/F1_图片反推细则.md @@ -0,0 +1,108 @@ +--- +name: F1 图片反推细则 +description: > + mcn-video-prompt 技能 F1(反推图片提示词)完整细则库(R73 自 SKILL.md 下沉,09-04)。 + SKILL.md 的 F1 节仅保留流程骨架 + Step-Check + 必读指针;本文件为 F1 执行时必读的 + 完整细则(人物专项/类型适配表/文字转录/反向词/输出格式/金标锚点保护/视线词等), + 由 SKILL.md F1 节「🔴 必读指针」强制引用。禁止删除或改写(内容级变更须同步 SKILL.md 骨架)。 +agent_created: true +--- + +# F1 反推图片提示词 · 执行细则(R73 下沉自 SKILL.md) + +> 定位:本文件 = SKILL.md「### F1. 反推图片提示词」的**完整细则层**。执行 F1 时, +> 先读 SKILL.md F1 骨架(流程 0-6 + Step-Check),再**逐节通读本细则**并按对应步骤执行, +> 禁止跳读(细则含实测防坑规则,跳过即复现踩坑)。 +> 引用约定:本文件位于 `references/功能/`,引用知识库词库用相对路径 `../知识库/…`。 + +--- + +**人物专项(画面含人物时必做 5 项):** 服饰造型(**结构化描述**:外层(品类+颜色+衣长+袖型)+内层(可见部分)+腰部(腰带/腰封宽窄+位置,**如有**——无则省略防脑补);汉服示例"灰白交领长衫(过臀,宽袖垂坠),领口两片襟布在胸前交叠形成斜向襟线,露出白色内衬窄边,腰间深蓝宽腰封约一掌宽";现代装示例"oversized白色卫衣(过胯,落肩宽袖),胸前无图案,下摆罗纹收口")/ 身材比例 / 肢体姿势 / 脸型轮廓 / 面部神态(肤色用具体色名:象牙白/小麦色/古铜色/深棕色/暖黄调/冷白调,不写"白""黑";**基础肤色取面部受光面**——鼻梁高光/受光侧脸颊/边缘光的色调,**禁取整体面部观感**——逆光背光面偏暗、暖调滤镜偏黄都会造成"古铜感"误判(实测:逆光图A整体观感偏深被判"古铜肤色",实际受光面与B同为暖白偏粉;受光角度不同的两人观感差≠肤色差);**多人场景先核两人受光角度是否一致**——受光角度不同导致的观感差,写真实基础肤色即可,明暗差由光影层自然处理)。**还原力精度要求:** ①肢体姿势写到**角度/手部动作/视线落点**粒度(如"侧身约30度朝画面左,右手提裙摆,视线望向画面右上"),姿势语言用 `../知识库/02_动作行为/动作行为词库.md`;②**姿势动词≤2个/人**——复合动作(扛+斜搭+延伸类)改用道具几何锚定:接触点+道具两端相对身体方位(如"扁担中段搭右肩,前端在身前右手握持处,后端斜向身后上方延伸");③**持物/挂载物位置用相对人物的身体方位,禁用画面绝对坐标**——身体锚点(身前/身后/左肩/右腰/腿侧/右肩至背部高度等),禁写"画面左下角/右上角"(实测:扁担末端写"伸向画面左下角"导致挂载竹篮被锚定到画面边角截断;正确写法"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")。**长杆类道具最小锚点法**:扁担/伞/棍/枪等长杆类道具不能只写名称,也不能写成机械长篇几何说明;**下笔前先回答三问**:①承载方式:肩扛 / 单手握提 / 双手握提 / 落地斜靠?(看杆与身体的接触点,不默认肩扛——实测:右手手提斜杆挂篮被误判成"肩扛横杆",导致筐被画到身后、手被解放空手)②杆身长轴方向:水平 / 斜上 / 斜下 / 竖直?(看杆在画面里的实际角度,不默认横向)③挂载物落点:挂上端 / 挂中段 / 挂下端 / 杆外侧?(看筐/篮在杆上的实际位置)。三问不答完,禁止写"肩扛""横向"等默认描述。答完后最少写清4个锚点:①身体接触点(搭在哪个肩/握在哪只手/贴近哪个身体部位);②长轴方向(横向/斜横向/竖向,尽量用相对身体方向);③手部作用(扶住/握住/自然垂放,不强行摆拍展示);④挂载物归属(挂在哪一端/哪一段)。**挂载物≠背负物**:挂在道具上的篮筐、包袱、灯笼等必须写成"挂在某段道具下方、与身体背部有距离",禁止写成贴背/背在身上/背篓;挂载物位置用"身后侧扁担段下方、右肩至背部高度"这类身体相对方位,避免漂移到画面边角或贴背。**扁担专项防偏**(仅在长杆三问①承载方式=肩扛时适用;三问=单手握提时按普通长杆最小锚点法处理,不触发扁担专项):原图确认为扁担时,正向必须写"平直硬木扁担/平直木扁担",并写"中段搭在肩上,长轴横向或斜横向延伸";禁止只写"木棍/长杆",否则易变竖直手杖;禁止写"弯曲、柔软、藤条感、绳状"等会让扁担变形的词。若生成图出现木棍、竖杆、弯杆、软杆、竹筐变背篓,则只局部修道具段与对应负向词,不重写脸部/表情/场景有效锚点。**坐标系分界**:物品位置=人物段用身体坐标(物品跟着人物走,换场景/多人归属均稳定);人物站位=场景层用画面坐标("居画面中偏左略前"是构图信息,归场景层——不要矫枉过正把站位也改成身体坐标);④**微表情双轨制**——观察分析用 `../知识库/01_主体描述/主体描述词库.md` 的微表情7区域×4级强度(保观察精度),写入提示词正文时**转译为直白可视化词**("眉弯L3+嘴大L3"→"露齿大笑"),L值标注是创作语言、文生图模型不识别;**动作状态词优先**(开怀大笑/咧嘴大笑/放声大笑/会心微笑)+ **可观察子状态**(露上牙/上排牙齿完全可见/眼睛眯成弯月);**禁几何抽象词**("嘴大张呈O形""一字眉""V形领""圆形脸"等)——模型会把"O/一字/V/圆形"字面读成几何形态,生成"惊讶圆嘴/惊讶一字眉/V领睡袍/圆饼脸"等与原图不符结果,**几何抽象词用动作状态词或具体可观察形态替代**("O形嘴"→"咧嘴大笑";"一字眉"→"眉头平直";"V形领"→"两片襟布在胸前交叠形成斜向襟线";"圆形脸"→"脸型短宽,下颌圆钝");⑤禁写"开心""温柔"这类无法执行的抽象情绪词;⑥**表情分离+前置**——多人画面各人表情分开描述禁止合并(模型对"双人一致表情"有先验,合并会被平均化),表情写入各人物块靠前位置(模型对提示词开头权重最高);**表情写法从器官量化升级为动作语境+面部协同**——先判断表情发生在什么关系里(看同伴、听人说话、边走边笑、对镜头摆拍),再按**微表情四层**写少量可见状态:①嘴部(张口/闭唇/嘴角上扬/嘴角横向打开)②脸颊(提起/放松/紧绷)③眼周(自然睁着/眼神带笑/轻微眯起/不眯成线)④情绪语境(边走边说话/听到同伴说话后忍不住笑)。禁止把表情拆成极限器官命令(如强制最大张口、强制瞪眼、强制强调瞳孔细节、强制描述唇部机械拉伸等都会触发惊吓感和AI僵硬感);优先写"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"、"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑"。**交互强度≠表情强度**——弱交互只限制不强对视/不明显转头,不代表笑意弱;闭唇笑也可以有明显笑意,必须单独写嘴角、脸颊、眼神。**眼周状态仍需观察但不做极限硬控**——模型默认先验"微笑=眯眼"会污染抿嘴笑,应用"自然睁着、眼神柔和"这类软锚点对抗,而非逼写器官细节。;⑦**脸部朝向/视线/互动强度分离**——脸部朝向=头部转向,视线落点=眼睛看向哪里,互动强度=人物关系强弱,三者必须分别观察、分别写,禁止用"看同伴/边走边聊"自动推导成"头部明显转向同伴";弱交互写法用"接近正面,眼神略偏向同伴"、"轻微朝向同伴但不形成强对视",强交互只有原图明确互相凝视时才写"对视/凝视"。**面部朝向四件套**必须同时判断:①左右朝向(鼻尖朝画面左/右/正前)②上下朝向(下巴/鼻尖平视、微抬、微低或内收)③头部倾斜(是否歪头,默认无明显歪斜不写)④视线落点(眼睛看向哪里);只写左右会丢头部姿态。⑧**脸部朝向用可见部位锚定**——正脸=五官对称居中;四分之三侧脸=完整可见一只眼+另一只部分+一只耳朵;正侧脸=一只眼+一只耳朵(如"A 四分之三侧脸朝画面右,可见右耳,右脸颊占比大"),方向词"面朝画面右前方"执行率低;**观察朝向以鼻尖朝向为唯一可靠判据**(数鼻翼两侧可见度,不是看脸型对称感——实测把"左脸颊面对镜头多一点"误读成"朝画面左",实际鼻尖朝画面右);**"四分之三侧脸"是弱执行词,模型常弱化成接近正脸**(实测:写"四分之三侧脸朝画面左+完整可见左眼+部分右眼",生成图双眼完整可见成正脸)——需按**角度档位写可见状态**量化:四分之三侧脸(约45°)="鼻尖明显朝向画面X,X侧眼完整清晰,另一侧眼因侧转明显变窄但完整可见";接近正侧脸(60°以上)="接近正侧脸朝画面X,仅X侧眼完整可见,另一侧眼完全不可见";**禁遮挡机制词("被鼻梁挡住/被遮住")与模糊量词("一线/一抹")**——机制式描述(解释为什么看不见)模型执行弱,只写看到了什么;且角度档位要自洽——"四分之三侧脸"+"仅露眼角一线"是两档角度自相矛盾(45°时远侧眼应大部分可见,仅剩眼角是60°+的形态),混写等于同时下两个角度指令模型无所适从;可见程度用直白梯度词:完整清晰/明显变窄但完整可见/仅露眼尾/完全不可见;⑨**场景统一性声明(多人画面必加)**——提示词写明"所有人物处于同一瞬间、同一光线"(**不含情绪节律**——实测"情绪节律统一"被模型读成表情趋同,导致B的闭合微笑被拉高污染),避免模型把多人拆成独立任务导致元素各自为政 + +**类型适配表(在事实层/关系层/神韵层三层观察底座上叠加专属栏目):** + +| 图片类型 | 专属叠加栏目 | +|---|---| +| 产品摄影/电商 | 卖点描述(质感/工艺/情绪价值,只描述可见卖点不编造功能) | +| 人像摄影 | 外貌细化(种族族裔+肤色具体色名+妆容发型气质) | +| 风景/自然 | 主体景观描述(地貌/植被/水体/季节天气) | +| 美食摄影 | 食欲感与新鲜感描述(温度感/水分感/光影对食物质感的强化) | +| 建筑/室内 | 空间结构描述(空间类型/层次纵深感/材质/陈设/风格定位) | +| 海报/文字图 | 文字与版式描述(逐字转录所有可辨识文字+位置+字体风格) | +| 抽象/艺术 | 主体元素+艺术风格(绘画媒介/图形类型/流派归类) | + +**文字转录强制要求(画面含可辨识文字即必做,不限图片类型):** 画面中所有可辨识文字逐字转录,注明位置("瓶身正面居中""右下角""T恤胸前""背景招牌")与字体风格(衬线/无衬线/手写/装饰体),不省略、不模糊、不合并、不虚构。非海报类图(人像服饰slogan、场景路牌招牌、产品包装等)同样适用。 + +**文字二分类(转录后决定去留):** ①内容性文字(招牌名/产品文案/海报标题/服饰slogan)→ 写入提示词正文(复刻需要);②标识性文字(水印/署名/@账号名/logo/时间戳/平台ID)→ **正向提示词零出现**(含否定式提及与说明性文字——"左下角水印只进反向词"这类描述也禁止写,正向提示词出现"水印"字样本身就有诱导生成水印的风险),只在观察报告提及+负面约束"水印"项承载。 + +**反向提示词(7 类,按图片类型筛选用项):** +- 画面质量类:低清晰度, 模糊, 噪点, 过曝, 欠曝, 画质低劣, 分辨率不足 +- 结构与比例类:透视错误, 比例错误, 主体变形, 构图杂乱, 边缘破损, 重复物体 +- 材质与色彩类:材质错误, 反光混乱, 阴影错误, 色彩过饱和, 色彩发灰, 廉价质感 +- 文字与标识类:文字乱码, 多余文字, 错误文字, 水印, 错误logo +- 人物类(含人物时):肢体错误, 手指错误, 面部崩坏, 皮肤塑料感, 眼神异常, 多余肢体 +- **AI审美污染类(含人物且原图为生活流/古典/自然人像时优先选配)**:网红脸, 现代写真脸, 现代商业写真感, 过度通透高清, 棚拍精修感, 欧式大双眼皮, 尖下巴, 高鼻梁整容感, 过大眼睛, 惊恐表情, 夸张张嘴, 僵硬笑容, 假笑, 摆拍感, 直视镜头, 游客照, 硬挺新衣, 化纤质感, 塑料感, 影楼汉服, 舞台浓烟, 干冰烟雾, 过度戏剧光 +- **长杆/挂载物专项类(原图有扁担、伞、杆、挂篮等长杆+挂载物时按失败项选配)**:手持木棍, 竖直木棍, 拐杖, 竖杆道具, 白色长棍, 弯曲扁担, 弯曲木杆, 软杆, 变形杆, 藤条弯杆, 背篓, 竹筐贴背, 竹筐落地, 竹筐贴边, 挂载物截断, 道具展示感 +- AI痕迹类:AI痕迹明显, 细节缺失, 不自然过渡 + +**反向词默认选配规则:** 画面质量+AI痕迹类必带;含人物加人物类;海报/文字图加文字标识类;产品/美食加材质色彩类;建筑/风景加结构比例类;有长杆/挂载物且生成失败时加长杆/挂载物专项类。**负向词分层精简**:按"通用质量/人脸审美污染/本图专属纠偏/风格场景误差"四层选配,不把所有历史失败无限堆叠进负向词;本图专属纠偏只针对当前图片或最近一轮真实失败项,问题消失后可下调或移除,避免负向词过重把正向主体也打散。**反脑补项**——场景观察为穷尽清单,原图未出现的**形态级**元素(山体/塔/水面/招牌等具体形态)逐项加入反向词;**概念级氛围词(远景暖光晕染/空气透视感/晨雾光感)豁免**,不进反脑补清单——它们是画面感来源;烟雾/雾气失控放大时反向词加"浓烟";**对抗项(仅原图背景虚化时加)**——背景细节过多, 景深过大(**禁用"背景清晰"**:拆词后会把"清晰"整体否定,导致全图发软)。 + +**目标平台适配(用户指明时按平台语法适配输出):** +- **默认即梦/通用自然语言**:自然语言描述;**正向与负向提示词分开输出**(即梦有"不希望呈现的内容"独立输入框,负向词贴该框;单输入框平台在负向部分用否定句式转写如"画面中不出现…",禁止与正向词混排——混排后模型无法区分正负,"低清晰度, 模糊"会被当正向描述执行) +- **Midjourney**:参数式语法(`--ar 16:9 --style raw --v 6`),负面词用 `--no` 承载 +- **Stable Diffusion**:权重语法(`(word:1.3)`),6分类反向词放独立负面词框(negative prompt) +- **NanoBanana**:自然语言;默认仍按正向提示词与负向提示词分开输出。若平台只支持单输入框,负向内容必须改写为自然语言否定句(如"画面中不出现…"),放在独立负向段落中,禁止裸负向词直接混排在正向文本末尾 +未指明平台时按即梦/通用输出,不强行参数化。 + +**输出格式:** 双版本输出(均按实体聚合+全局项聚合): +- **结构还原版**:保证道具、服装、场景、人物位置、持物关系不丢;适合审计硬锚点。 +- **神韵优化版(默认推荐生成)**:在保留硬锚点基础上,降低人脸/表情/视线/空气感的器官级硬量化,强化人物关系、生活流语境、古典骨相、软布料、湿润空气感;适合直接喂模型生成。 +人物按"每人一块全信息"组织(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;**人物画面位置不写在人物块,统一归场景层人物布局**),全局项合并为5块——场景(环境+人物布局+前中后景内容)/镜头(景别+机位+虚化+拍摄风格)/光影(光源类型+逆光入画+色调系统三段式)/画面质感(渲染规格+年代流派媒介三合一锚定)/画面风格(流派+情绪基调+画面感词),加文字/负面约束/基础属性 + 类型专属栏目。 + +**版本说明:** 极简版信息密度不足以承载还原约束,已废弃;但单一硬还原版会压死人脸神韵,改为"结构还原版+神韵优化版"双版本。默认把神韵优化版作为生成层主稿,结构还原版作为审计层硬锚点清单。 + +**双版本 × 两层输出关系:** "结构还原版/神韵优化版"是内容策略差异,"结构化版/整段版"是交付形态差异。两个版本都可按结构化版审计、再转为整段版生成;默认交付顺序为:先给结构还原版结构化审计层(核硬锚点)→再给神韵优化版整段生成层(直接用于生成)。禁止把"结构还原版"误解为"结构化版",也禁止把"神韵优化版"误解为只要整段不要审计。 + +**两层输出分工(审计层 vs 生成层):** 结构化版与整段版是两层产物,缺一不可: +- **结构化版=审计层**:按**实体聚合**组织——**每个人物一块写完全部个体信息**(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;位置归场景层人物布局),全局项按5块聚合(场景/镜头/光影/画面质感/画面风格),供人工逐人核对——**不直接喂模型** +- **整段版=生成层**:喂模型的最终提示词,与结构化版同一实体聚合结构,去掉**全局块字段标签**(【场景】【镜头】等)合并为流畅自然语言段——**人物标签(女性A/女性B)保留**,人物段以"女性A:"开头,场景段布局用**完整主体名称**绑定("女性A居画面中偏左略前,女性B居画面中偏右"——禁裸编号"A居""B居",必须与人物块标签字面完全一致)——**人物标签是跨层实体绑定锚点,剥掉后多人段落无法区分、布局与人物段断链**(实测:两段同以"脸型窄长…的年轻女性"开头,模型无从知道谁站哪边);**禁止把同一人的属性拆到多个段落**(拆散后模型要跨段拼装,归属断链——材质/颜色/道具会张冠李戴);**道具与佩戴物内联到持有者段落**;**正向与负向分开**——整段版正文只含正向提示词(人物段+场景/镜头/光影/画面质感/画面风格全局段),**负面约束独立成第二部分输出**,标识行只写"负向提示词:"五个字,**不带括号操作指引**("(贴即梦XX框)"之类的平台分发说明是技能内部知识,不写入输出——平台怎么分发由用户自行判断,规则留在"目标平台适配"节),**禁止负向词直接混排在正向文本末尾**——剥掉【负面约束】标签后模型无从区分正负,"低清晰度, 模糊"会被当作正向描述执行(实测用户抓出) +- **逐件核对**:结构化版→整段版转写后,确认所有道具/佩戴物已内联到对应人物块,禁止聚合时静默丢弃(实测:竹篮在观察层被发现,却在聚合写入时丢失) +- **对话展示格式**:最终提示词不用长行代码块展示(横向滚动条导致用户复制不便),以普通文本段落输出,段与段空行分隔 + +**画面感保护条款:** 还原导向≠无脑精确化。逐项精确(姿势/服饰/道具/虚化)的同时,**保留 1-2 处"模糊氛围词"**(如"远景暖光晕染""空气透视感""轻雾弥漫")不拆解、不量化、不进反脑补清单——过度具体化会让生成图变成"摆拍工作照",丢失"生活瞬间感"(实测:纯精确提示词生成的图还原度高但画面感弱于带氛围词的版本)。 + +**生成闭环复盘与有效锚点保护(多轮出图后必做):** 每轮生成图对比原图后,先列三栏再改提示词:①保留项(本轮比上一轮更接近原图的脸部、表情、朝向、道具、场景、光影、质感句);②回退项(上一轮好、本轮变差的局部);③替换项(当前明确失败的局部)。修改只动替换项所在模块,保留项原句不得因其他问题被顺手重写。尤其在修扁担/竹筐/背景时,不得误删已实测有效的面部朝向和表情锚点;在修视线/表情时,不得误伤扁担、挂载物、场景氛围锚点。 + +**金标锚点逐字保护(多轮出图核心机制):** 当某一轮生成图的某个局部(如 A 的面部朝向/笑容/表情)明显优于其他轮时,将该局部对应的提示词原句标记为"金标句"。金标句一经标记,后续所有轮次的提示词中该局部句子必须**逐字复制粘贴**,禁止同义改写、合并精简、拆分重组或"优化措辞"——实测:仅把"嘴角横向打开"改成"嘴角上扬"就导致笑容效果完全丢失。回退时不重新从原图反推,而是直接粘贴金标句原文。只有用户明确说"这版某处不好要改"时,才允许动对应金标句,且改后旧金标句仍需保留备查。金标句的标记范围按模块划分:A 面部块(脸型→表情→朝向→头部姿态)是一个可标记模块;B 面部块是另一个;道具块、场景块、光影块各自独立标记。标记后该模块在后续轮次中"冻结",非用户明确要求不得解冻。 + +**非看镜头/人物交互专项(人像多人图必做):** 判断人物是否看镜头、谁看谁、是否同行/闲聊/经过镜头、表情是否回应对方。若原图是生活流抓拍,提示词必须写"非看镜头"、"边走边聊"、"自然经过镜头前"、"动作不是摆拍展示道具"等关系语境;负向词加入"直视镜头/游客照/摆拍感/网红写真"。视线落点是人物关系信息,不得省略为泛泛"望向前方"。 + +**视线词高风险规则:** 视线是软锚点,高于普通表情词风险。"视线越过镜头右侧"可能减少直视镜头,也可能让模型误读为看镜头外展示;"视线轻轻落向同伴/含笑回应"容易把弱交互放大成互相凝视。处理多人弱交互时,优先写头部朝向与表情语境,视线只写低强度词(如"眼神略偏""不直视镜头"),慎写精确落点;只有原图明确看向某人时才写"看向同伴"。若某一版面部朝向/神态已经实测更接近原图,后续不得把该面部句泛化替换为未经验证的新视线句。 + +**视线词与交互强度匹配表(写下视线前先查表):** +| 交互强度 | 视线写法 | 禁止写法 | +|---|---|---| +| 强交互 | "看向女性A,目光落在她脸上" | 禁止弱化为"略偏向"——原图明确看人就不能写弱 | +| 中交互 | "脸朝女性A方向,目光大致落在她肩颈区域" | 禁止写"凝视/深情注视"——会升级成强对视 | +| 弱交互 | "眼神略偏,不直视镜头" | 禁止写具体落点("看向A/落向A")——会把弱放大成强 | +| 无交互 | "目光朝前方" | 禁止写"看向同伴" | + +交互强度判错时,先回到交互强度判定(无/弱/中/强),不直接调视线词——先定强度,再查表选视线写法。 + +**美学自检(输出前必做):** 字段检查通过不代表图会好看。输出前必须自问:人物像活人吗?是否出现网红脸/尖下巴/过大眼睛/高鼻梁整容感?表情是否惊吓、假笑或僵硬?人物是否不该看镜头却直视镜头?衣服是否硬挺新衣/塑料感/影楼汉服?雾气是否变干冰浓烟?若任一命中,降低人脸与表情的器官级量化,改用神态语境、古典骨相、软布料、湿润空气感与审美负向词。 + +**结构化版格式模板(人物按实体聚合每人一块+全局项5块聚合,每人一块内按聚合清单顺序写——分行是硬性格式,禁止合并单行;关键还原项前置(人物表情/服装/朝向/虚化),背景细节后置——模型对提示词开头权重最高。**输出产物禁带元规则标注**——"(穷尽清单)""(前置)""(画面感保护词)"等括号注记不写入观察报告/结构化版/整段版,规则术语只留在本技能文件,输出层用自然语言。**全局项禁止跨字段重复**——同一信息只在一处写,如虚化只写镜头层、色调只写光影层、人物画面位置只写场景层):** +> **人物标签=性别+角色编号**(如"女性A""女性B",单人时直接"人物"),禁止用裸编号"A""B"——脱离上下文无法辨认是谁;**标签不带画面位置**——位置是关系性信息,归场景层,标签重复写会冗余:[基础(脸型+肤色——**肤色取面部受光面色调,不取逆光/暖调下的整体观感**;易漂移色名加锚定如"灰白≈浅亚麻/不含蓝调")→表情(**动作语境+面部协同**:先写"看同伴/听人说话/边走边笑/非看镜头"等关系语境,再写少量可见状态;禁极限张口、强制瞪眼、强制强调瞳孔细节、机械唇部拉伸等器官命令;推荐"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"或"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑",多人分离描述;弱交互不等于弱表情,闭唇笑也要写清笑意强度)→发型与佩戴物(簪/耳饰)→服装含材质(外层品类+颜色+衣长+袖型+内层可见+腰部如有+材质内联如"亚麻粗织感";**汉服专有品类加形态锚定**——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定"搭肩/双手拎两端"兜底可不加)→朝向(**面部朝向四件套+可见部位锚定+角度档位自洽**:①左右朝向看鼻尖朝画面左/右/正前;②上下朝向看下巴/鼻尖平视、微抬、微低或内收;③头部倾斜看是否歪头,无明显歪斜不写;④视线落点看眼睛看向哪里。四分之三侧脸=完整一只眼+另一只**变窄但完整可见**+一只耳朵("鼻尖明显朝向画面左,左眼完整清晰,右眼因侧转明显变窄但完整可见");接近正侧脸=仅一只眼完整可见+另一只完全不可见——**禁遮挡机制词("被鼻梁挡住")与模糊量词("一线")**,只写可见状态;"四分之三侧脸"单独写会被弱化成正脸,可见部位量化才锁得住;非人物用角度锚定正对/45度/正侧面)→姿势动作→持物(名称+材质+接触点+**两端相对身体方位**,无则省略;**道具上挂载的其他物品(如扁担上挂的竹篮)随道具一起写,且独立写明相对身体方位**(如"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")——挂载物单独留在观察层会在聚合时静默丢失(实测竹篮两次被丢);挂载物不写独立位置会跟随道具末端漂移到画面边角被截断(实测第四轮竹篮只剩边角1/3))→视线落点]|场景:[环境类型+空间特征+**人物布局**(**用完整主体名称**(女性A/女性B)写每人画面位置+前后关系+间距——与人物块标签字面完全一致,禁裸编号A/B;多人加"同一瞬间、同一光线"——不含情绪节律,防表情趋同污染)+前中后景三层逐层列各层陈设(**只写"有什么",不写虚化**——虚化属镜头层;未出现的大类元素直接进负面约束)]|镜头:[景别+机位+虚化**结果转译**:原图有虚化写"背景虚化成柔和色块,仅可辨认轮廓剪影"(**用"虚化"不用"模糊"**——负面约束含"模糊",正向出现会与之打架、弱化景深执行);原图全清晰写"全画面清晰锐利,前后景均无虚化"——**禁写焦段/光圈参数(如85mm、f值)与"浅景深"等参数化术语**,虚化结果句已承载全部景深信息,重复写参数反而引入不确定性+**拍摄风格子项**(原图可辨的静态执行项):POV主观视角/手持拍摄感/俯拍仰拍等;**晃动感/呼吸感/跟拍节奏等动态词仅视频提示词用,静帧反推不写**]|光影:[**光源类型先行**(自然光为主/单一人工光源/混合光)+方向+行为;强方向光**逆光入画**:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"+**色调系统三段式**:饱和度(低饱和度/正常饱和度)+色相(如"冷灰偏旧""整体暖黄调")+胶片类型(如"复古胶片色调""暖调胶片模拟")——完整示例"低饱和度,冷灰偏旧的复古胶片色调"或"整体暖黄调,背景暖褐暖灰"(具体色名留在各实体内联处不重复);**渲染术语禁写**——"体积光"是CGI术语,直白写"光柱清晰可见";**画面现象的位置词需明确参照**——"光柱在画面左侧"(明确写"画面左侧"),禁裸写"左侧"(人物左还是画面左歧义)]|画面质感:[**渲染规格+质感风格锚定**——这是独立于"风格流派"的渲染指令层:①渲染规格(8K高清/微颗粒胶片感/非完美锐度/轻微色差/暗部细节保留/HDR等,**这些是输出规格词模型可识别,与禁写的"输入参数"85mm/f值不同**)②质感风格锚定("纪录片摄影风格""胶片模拟""柔光片效果"等——**年代+流派+媒介三合一锚定执行率最高**,如"2010年代初纪录片式胶片摄影"(年代+流派+媒介一句写全)比泛词"电影感"强,后者会落到好莱坞大片先验)③反向词冲突审查("非完美锐度"避开反向"低清晰度"、"轻微色差"避开反向"画质低劣"的语义场——写前核对)④**电影截图感防商业写真化**:若原图是电影截图/剧照/生活流古装片段,应写"电影截图感、低饱和暖灰胶片色调、边缘略柔、非完美锐度、背景压缩虚化、生活流抓拍",并在负向词加入"现代商业写真感、过度通透高清、棚拍精修感",避免生成过干净的商业人像]|画面风格:[**流派定位+情绪基调**——风格名(如"古风写实人像";写实类可加执行词"写实真人风格""生活流表演")+情绪(如"欢快温暖的生活瞬间";氛围词用"轻X氛围"句式如"轻压抑氛围""轻怀旧氛围"比直写"压抑"可控)+符号内涵+**画面感保护词**(保留1-2处模糊氛围词如"远景暖光晕染""晨雾光感"不拆解不量化);**禁写画质/渲染词**(8K/颗粒/HDR归画面质感层,色调归光影层——旧"全局性质感"已迁出至画面质感字段)]|文字:[仅内容性文字转录+位置+字体;**无内容性文字时省略整个字段**——标识性文字在正向提示词零出现,相关排除项由负面约束承载]|负面约束:[6分类筛选项+反脑补项(原图未出现的大类元素如山/塔/水面)+**对抗项(仅原图背景虚化时加):背景细节过多, 景深过大**+文字与标识类排除项;**反向词正向零出现核对(输出后必做)**——逐项核对每个反向词(含其作为子串/否定式提及/说明性文字)是否在正向提示词任何位置出现过,出现即改正向措辞(如正向写背景虚化用"虚化/朦胧"避开反向词"模糊";反向"模糊"与正向"中景人影模糊"打架会弱化景深执行——实测第三轮虚化失效的嫌疑原因之一)]|基础属性:[画幅比](即梦平台UI设置不写入提示词;Midjourney 用 `--ar`) + +**多图模式(同主体多角度/多张图反推,衔接 F3 角色卡):** +提取共通主体描述(多图高置信交集)+ 各图差异项(姿态/光线/景别/角度);冲突项标注"图A/B不一致"由用户裁定。输出可直接喂 F3 角色卡的一致性主体锚定 + 差异镜头库。 + +**风格反推双轨输出(艺术风格维度专用):** +风格维度同时输出「风格命名」(人类可读,如"韦斯·安德森式对称构图")+「参数化描述」(去名化、可直接用于生成,规则见 `../知识库/15_视觉风格/视觉风格词库.md` 去名化使用规范);命名与描述均标注置信度。 + +**注意:** 不声称还原图片原始隐藏参数,说明这是对画面的实用重构。 + +**还原路径指引(输出后主动告知用户,按用途分流):** +- **100% 复刻原片** → 走图生图/垫图(把原图作为参考图喂给平台),F1 提示词仅作辅助约束;纯文生图无法逐像素复刻 +- **改图/延展(同构图换元素)** → 文生图直接使用本提示词,改动目标字段即可 +- **学图(提炼风格/结构复用)** → F1 提示词 + 第 6 步变量提炼,替换变量生成同风格新图