R71+R73-R75: 技能树体量优化与修整—mcn-video-prompt F1细则下沉references/功能(680→596行78.5→46.7KB)+主SKILL.md压缩(last_change明细迁变更日志.md/流程图25→5行/新增阅读分层)+dou-analysis设定卡暖杏蜜橘配色+browser-harness删除2个14B占位SKILL.md防宿主误注册(外部依赖段补重拷排除提示)
This commit is contained in:
1 parent
1a5d319bfc
commit
3ce08d5c26
7 files changed
+157
-116
No files matched your search
@@ -9,7 +9,7 @@ description: >
|
||||
诊断脚本质量、设计账号人设、选题策划、生成分镜、广告植入设计、生成创作回顾。
|
||||
version: "1.0"
|
||||
updated_at: "2026-09-04"
|
||||
last_change: "新增「子技能索引(subskills/)」章节(09-04):subskills 下 6 个子技能全部登记入主 SKILL.md(browser-harness/lieflat-charts/mcn-data-insight/mcn-dou-analysis/mcn-script-review/mcn-video-prompt),引用一律用相对路径 subskills/<目录>/SKILL.md;目录树补 subskills/ 行;修正外部技能依赖段落(09-04):mcn-dou-analysis 原「D:\AgentSkill 两步判定」规则废弃(独立仓库不存在,改 subskills/ + dsh 平级 ~/.dsh/skills 双描述);browser-harness 可执行文件改技能自带 venv 相对路径(原 uv 工具安装已废弃)、lieflat-charts 路径改相对;全文件旧绝对路径引用零残留;技能更名:短视频脚本创作→短视频工作台(09-03 用户定,对外统一名称;触发方式与引用结构不变);触发条件新增🧹后台任务清理场景:用户问后台任务/清理过期失败任务时按 references/接口调用/自动化任务清理规范.md 执行(09-03 新增,全环境通用:只清过期或错误失败的一次性任务,禁清未来/周期/运行中任务,删除走宿主工具禁直改库);09-02 前:工作台新增第7条「AI 任务入口技能契约(P0)」:所有 AI 会话任务入口须遵守功能入口×技能调用契约(prompt=技能前缀常量+业务正文+skills 参数级挂载),新增/修改入口前先读 mcn-work-shop/docs/AI会话任务输入输出对照.md(含新增入口检查清单7项)——防裸 prompt 跳步/技能声明混入业务串/BROWSER_HINT 误注入(09-02 提炼/分镜/复盘三入口缺约束修复后固化,data-pages.js 四前缀常量);原第7/8条顺延为8/9;09-02 前:工作台任务执行方式铁律固化(创作/改写/复盘必须走 POST /api/run+skills 参数,禁会话内手写草稿)+09-01 调度机制实测定稿+端口 8899→8900"
|
||||
last_change: "09-04 技能树体量优化(R73/R74):frontmatter 历史明细迁 references-add/变更日志.md、流程总览压缩为行式 Gate 链、新增阅读分层说明;本技能近期实质变更(09-04 子技能索引登记+外部依赖路径修正、09-03 更名短视频工作台、09-02 AI任务入口契约+执行铁律)完整历史见 references-add/变更日志.md;browser-harness 2 个 14B 占位 SKILL.md 删除(防宿主误注册,外部依赖段补维护提示)"
|
||||
deployment: "source"
|
||||
agent_created: true
|
||||
---
|
||||
@@ -31,6 +31,11 @@ agent_created: true
|
||||
|
||||
**支持赛道:** 学习教育 / 小剧场 / 美食 / 生活vlog / 美妆 / 三农 / 财富理财 / 身体锻炼 / 游戏 / 更多…
|
||||
|
||||
> **📖 本文件阅读分层(R74):** 本 SKILL.md = 流程引擎 + 规则摘要,正文分三类,加载后按此区分——
|
||||
> - **🚫 红线/P0 铁律**(关键规则〇~七、Gate 确认句、工作台第 5~7 条等):**每次执行必读**,绝不下沉、不可跳过。
|
||||
> - **🔑 关键引用/导航行**(各步骤「详细见 → references/创作流程/NN.md」、🔗 外部技能锚点、子技能索引):**执行到对应步骤时必须打开引用文件**,禁止凭印象执行或跳读细则。
|
||||
> - 无标记正文(概述/模式说明/目录树):流程骨架,快速扫描即可,条件触发时回查。
|
||||
|
||||
---
|
||||
|
||||
## 创作模式(三态)
|
||||
@@ -120,6 +125,7 @@ agent_created: true
|
||||
浏览器操作(账号搜索、视频列表抓取等)统一使用 **browser-harness**(2026-09-02 起挂在本技能下,不再挂在 mcn-dou-analysis 下):
|
||||
|
||||
- **技能本体**:`subskills/browser-harness/`(相对本文件;含 `envs/browser-harness/` 自带环境与 `src/` 源码,随源仓库分发)
|
||||
- **⚠️ 占位清理(09-04)**:上游 repo 自带 2 个 14B `../../SKILL.md` 占位(`skills/browser-harness/SKILL.md`、`src/browser_harness/SKILL.md`,Claude Code 分发入口),宿主递归扫描会将其误注册成坏技能变体 → **已删除**。**重拷上游整包时必须排除这 2 个文件**(只保留顶层 `SKILL.md`),否则重复注册复发
|
||||
- **dsh 部署环境**:`~/.dsh/skills/browser-harness/`(随 dsh_MCNProject 仓库分发,换机器自带)
|
||||
- **可执行文件**:`subskills/browser-harness/envs/browser-harness/Scripts/browser-harness.exe`(Windows;macOS/Linux 为 `envs/browser-harness/bin/browser-harness`)——**技能自带 venv**(09-04 修复重建,含 python.exe/pyvenv.cfg/全部依赖),随源仓库分发、无需 PATH/uv 工具安装;原「uv 工具安装 ~/.local/bin/browser-harness.exe」已废弃(uv 工具残留 09-04 已清理)
|
||||
- **进程生命周期(红线,09-02 用户明确)**:已开启的 Chrome(9223 调试实例/用户手动开启的 Chrome)一律不主动关闭,除非用户明确要求;任务结束/失败都保留,承载登录态与标签页复用
|
||||
@@ -142,29 +148,11 @@ agent_created: true
|
||||
### 流程总览
|
||||
|
||||
```
|
||||
用户输入
|
||||
│
|
||||
├─ 步骤1: 意图识别 ──┐
|
||||
│ ├──→ [Gate-0 分析确认]
|
||||
├─ 步骤2: 需求完善 ─┘
|
||||
│
|
||||
├─ 步骤3: 对标视频/账号拆解 🔶(可选步骤)
|
||||
│
|
||||
├─ 步骤4: 账号设定解析和确认 ──→ [Gate-1 人设确认]
|
||||
│
|
||||
├─ 步骤5: 生成短视频选题 ──────→ [Gate-2 用户选择选题]
|
||||
│
|
||||
├─ 步骤6: 生成短视频框架 ──────→ [Gate-3 框架确认] ← 情绪规划层:场次结构+情绪设计卡
|
||||
│
|
||||
├─ 步骤7: 生成短视频大纲 ──┐ ← 结构搭建层:模板选择+分段展开+钩子匹配+素材填充+密度自检
|
||||
│ ├──→ [Gate-4 大纲确认]
|
||||
├─ 步骤8: 植入广告内容 ──┘ ← 可选步骤
|
||||
│
|
||||
├─ 步骤9: 生成短视频脚本 ────→ [Gate-5 脚本确认] ← 情绪演绎层:台词+动作+多维度表达
|
||||
│
|
||||
├─ 步骤10: 生成短视频分镜脚本 🔶 可选步骤 ← 分镜脚本(拍摄标注)
|
||||
│
|
||||
└─ 步骤11: 脚本检查和诊断 ────→ [Gate-6 最终确认]
|
||||
S1 意图识别 → S2 需求完善 → [G0 分析确认]
|
||||
→ S3 对标拆解 🔶 → S4 账号设定 → [G1 人设确认]
|
||||
→ S5 选题 → [G2 选题确认] → S6 框架 → [G3 框架确认] ← 情绪规划层
|
||||
→ S7 大纲 →(S8 广告植入 🔶)→ [G4 大纲确认] ← 结构搭建层
|
||||
→ S9 脚本 → [G5 脚本确认] ← 情绪演绎层 → S10 分镜 🔶 → S11 诊断 🔶 → [G6 最终确认]
|
||||
```
|
||||
|
||||
> **模式说明:** 自动模式(默认)下,所有 Gate 自动通过、中间步骤后台静默,AI 一气呵成只交付目标产物;共创模式下,每个 Gate 必须等待用户确认后才能推进;开发模式下,Gate 自动通过且每步产物全落盘。详见 [创作流程规范.md](references/创作流程规范.md) 二、创作模式。
|
||||
|
||||
@@ -0,0 +1,30 @@
|
||||
# 变更日志(主 SKILL.md frontmatter last_change 历史归档,09-04 起)
|
||||
|
||||
> 用途:SKILL.md frontmatter `last_change` 字段的历史明细归档处(该字段仅保留最近一次变更的**一行摘要**,完整明细按日期记于此)。
|
||||
> 维护规则:每次变更 SKILL.md 时——① 在下方**按日期追加**一条(新在上);② frontmatter `last_change` 更新为当次一行摘要。
|
||||
> 本文件位于 `references-add/`(运行时与标准库取并集加载,不影响创作执行逻辑,仅供维护追溯)。
|
||||
|
||||
---
|
||||
|
||||
## 2026-09-04(R73/R74 技能树体量优化)
|
||||
|
||||
主 SKILL.md 压缩维护:frontmatter `last_change` 明细迁移至本文件(历史归档);11 步流程 ASCII 总览图压缩为行式 Gate 链(S1→[G0]→…→[G6]);文件底部新增「阅读分层」说明(🔑 导航行/🚫 红线/无标记正文三类)。
|
||||
|
||||
## 2026-09-04(子技能索引登记 + 外部依赖路径修正)
|
||||
|
||||
- 新增「子技能索引(subskills/)」章节:subskills 下 6 个子技能全部登记入主 SKILL.md(browser-harness/lieflat-charts/mcn-data-insight/mcn-dou-analysis/mcn-script-review/mcn-video-prompt),引用一律相对路径 `subskills/<目录>/SKILL.md`;目录树补 `subskills/` 行。
|
||||
- 修正外部技能依赖段落:mcn-dou-analysis 原「D:\AgentSkill 两步判定」规则废弃(独立仓库不存在,改 subskills/ + dsh 平级 `~/.dsh/skills` 双描述);browser-harness 可执行文件改技能自带 venv 相对路径(原 uv 工具安装已废弃);lieflat-charts 路径改相对。
|
||||
- 全文件旧绝对路径引用零残留。
|
||||
|
||||
## 2026-09-03(技能更名 + 触发条件补清理场景)
|
||||
|
||||
- 技能更名:短视频脚本创作 → **短视频工作台**(用户定,对外统一名称;触发方式与引用结构不变)。
|
||||
- 触发条件新增 🧹 后台任务清理场景:用户问后台任务/清理过期失败任务时按 `references/接口调用/自动化任务清理规范.md` 执行——只清过期或错误失败的一次性任务,禁清未来/周期/运行中任务,删除走宿主工具禁直改库。
|
||||
|
||||
## 2026-09-02(工作台 AI 任务契约与执行铁律)
|
||||
|
||||
- 工作台新增第 7 条「AI 任务入口技能契约(P0)」:所有 AI 会话任务入口须遵守功能入口×技能调用契约(prompt=技能前缀常量+业务正文+skills 参数级挂载),新增/修改入口前先读 `mcn-work-shop/docs/AI会话任务输入输出对照.md`(含新增入口检查清单 7 项)——防裸 prompt 跳步/技能声明混入业务串/BROWSER_HINT 误注入;原第 7/8 条顺延为 8/9。
|
||||
- 工作台任务执行方式铁律固化:创作/改写/复盘必须走 `POST /api/run` + skills 参数,禁会话内手写草稿。
|
||||
- 调度机制实测定稿 + 端口 8899→8900。
|
||||
|
||||
> ⚠️ 仅记录 2026-09-02 起的变更明细(本文件创建前,更早历史未归档——如确需追溯请查 git 提交历史)。
|
||||
@@ -1 +0,0 @@
|
||||
../../SKILL.md
|
||||
@@ -1 +0,0 @@
|
||||
../../SKILL.md
|
||||
@@ -139,6 +139,7 @@
|
||||
| 潮流/都市/时尚(潮流风尚/颜值) | 深紫黑 `#17101F→#0C0810` |
|
||||
| 活力/运动/热血(身体锻炼/体育) | 深海军 `#0E1B2E→#080F1A` |
|
||||
| 甜美/少女/二次元(甜宠/乙女向) | 深莓紫 `#3A1E42→#22102A`(调性深沉时);**玫瑰金渐变 `#D6A3A9→#9A5563`(调性明快时,如王微斯·定稿)** |
|
||||
| **萌宠拟人喜剧/古风糖水(橘猫IP明快型)** | 浅色系·**暖杏蜜橘渐变 `#FCE8CC→#F2BC82`**(如平凡的胡德禄·09-04 定稿);主色取橘猫虎斑+古风庭院暖黄糖水 → 提亮降饱和至中浅明度(≈80% 亮度),底偏暖偏糖水与玫瑰金(粉)/暖橙(亲子)形成区分。配套**内部元素走账号风格化变体**:白卡 `#FFFFFF` + 暖橙边 `#ECC494` + 深棕字 `#8A4B23`(同俊希先例,明快型账号可偏离浅色系默认粉色内部元素,按账号主色相走暖色系) |
|
||||
|
||||
**背景色推导公式(表中未列的风格)**:取账号色彩体系主色 → 压暗至 15-25% 亮度 + 降饱和 → 得深色渐变底(**仅背景色**,内部元素色不变)。
|
||||
|
||||
|
||||
@@ -8,8 +8,8 @@ description: >
|
||||
角色卡、首帧图、运镜、景别、时间戳分镜、图生视频。
|
||||
version: "1.0"
|
||||
agent_created: true
|
||||
updated_at: "2026-08-31"
|
||||
last_change: "④主体设定→④设定 改名(20处全量替换:SKILL.md 6 + 分镜提示词制作流程.md 10 + 长视频分段制作流程.md 4);6层结构定稿:①主体列表→②画面质感→③色调光影→④设定(人物/场景/构图,每项1句)→⑤镜头叙事→⑥负面提示词;视觉基调前置(模型对提示词开头权重最高);站位/构图边界固化(08-31):构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写),注记入 3.2.2 输出格式块+适配表+SKILL.md F4 结构定义"
|
||||
updated_at: "2026-09-04"
|
||||
last_change: "09-04 R73 F1 细则下沉:F1 节保留骨架(流程0-6+Step-Check+词库导航行)+🔴必读指针;人物专项/类型适配表/文字转录/反向词7类/双版本×两层输出/金标锚点逐字保护/视线词表/结构化格式模板等完整细则迁 references/功能/F1_图片反推细则.md(执行 F1 先通读该文件再动手);细则内词库引用改相对自身路径 ../知识库/…;SKILL.md 680→596 行、78.5→46.7KB。此前(08-31):④主体设定→④设定 改名(20处全量替换:SKILL.md 6 + 分镜提示词制作流程.md 10 + 长视频分段制作流程.md 4);6层结构定稿:①主体列表→②画面质感→③色调光影→④设定(人物/场景/构图,每项1句)→⑤镜头叙事→⑥负面提示词;视觉基调前置(模型对提示词开头权重最高);站位/构图边界固化(08-31):构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写),注记入 3.2.2 输出格式块+适配表+SKILL.md F4 结构定义"
|
||||
deployment: source
|
||||
created_at: "2026-08-20"
|
||||
---
|
||||
@@ -69,95 +69,8 @@ created_at: "2026-08-20"
|
||||
| 5.5 生成闭环复盘 | 多轮出图后先列保留项/回退项/替换项;已经实测有效的脸部、表情、视线、道具、场景锚点必须**逐字复制**(见"金标锚点逐字保护"),禁止同义改写;只替换失败模块,禁止一轮失败后全量重写导致上一轮优势丢失 |
|
||||
| 6 变量提炼 | 变量化不破坏实体聚合结构(同一人物属性不拆到多段) |
|
||||
|
||||
**人物专项(画面含人物时必做 5 项):** 服饰造型(**结构化描述**:外层(品类+颜色+衣长+袖型)+内层(可见部分)+腰部(腰带/腰封宽窄+位置,**如有**——无则省略防脑补);汉服示例"灰白交领长衫(过臀,宽袖垂坠),领口两片襟布在胸前交叠形成斜向襟线,露出白色内衬窄边,腰间深蓝宽腰封约一掌宽";现代装示例"oversized白色卫衣(过胯,落肩宽袖),胸前无图案,下摆罗纹收口")/ 身材比例 / 肢体姿势 / 脸型轮廓 / 面部神态(肤色用具体色名:象牙白/小麦色/古铜色/深棕色/暖黄调/冷白调,不写"白""黑";**基础肤色取面部受光面**——鼻梁高光/受光侧脸颊/边缘光的色调,**禁取整体面部观感**——逆光背光面偏暗、暖调滤镜偏黄都会造成"古铜感"误判(实测:逆光图A整体观感偏深被判"古铜肤色",实际受光面与B同为暖白偏粉;受光角度不同的两人观感差≠肤色差);**多人场景先核两人受光角度是否一致**——受光角度不同导致的观感差,写真实基础肤色即可,明暗差由光影层自然处理)。**还原力精度要求:** ①肢体姿势写到**角度/手部动作/视线落点**粒度(如"侧身约30度朝画面左,右手提裙摆,视线望向画面右上"),姿势语言用 `references/知识库/02_动作行为/动作行为词库.md`;②**姿势动词≤2个/人**——复合动作(扛+斜搭+延伸类)改用道具几何锚定:接触点+道具两端相对身体方位(如"扁担中段搭右肩,前端在身前右手握持处,后端斜向身后上方延伸");③**持物/挂载物位置用相对人物的身体方位,禁用画面绝对坐标**——身体锚点(身前/身后/左肩/右腰/腿侧/右肩至背部高度等),禁写"画面左下角/右上角"(实测:扁担末端写"伸向画面左下角"导致挂载竹篮被锚定到画面边角截断;正确写法"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")。**长杆类道具最小锚点法**:扁担/伞/棍/枪等长杆类道具不能只写名称,也不能写成机械长篇几何说明;**下笔前先回答三问**:①承载方式:肩扛 / 单手握提 / 双手握提 / 落地斜靠?(看杆与身体的接触点,不默认肩扛——实测:右手手提斜杆挂篮被误判成"肩扛横杆",导致筐被画到身后、手被解放空手)②杆身长轴方向:水平 / 斜上 / 斜下 / 竖直?(看杆在画面里的实际角度,不默认横向)③挂载物落点:挂上端 / 挂中段 / 挂下端 / 杆外侧?(看筐/篮在杆上的实际位置)。三问不答完,禁止写"肩扛""横向"等默认描述。答完后最少写清4个锚点:①身体接触点(搭在哪个肩/握在哪只手/贴近哪个身体部位);②长轴方向(横向/斜横向/竖向,尽量用相对身体方向);③手部作用(扶住/握住/自然垂放,不强行摆拍展示);④挂载物归属(挂在哪一端/哪一段)。**挂载物≠背负物**:挂在道具上的篮筐、包袱、灯笼等必须写成"挂在某段道具下方、与身体背部有距离",禁止写成贴背/背在身上/背篓;挂载物位置用"身后侧扁担段下方、右肩至背部高度"这类身体相对方位,避免漂移到画面边角或贴背。**扁担专项防偏**(仅在长杆三问①承载方式=肩扛时适用;三问=单手握提时按普通长杆最小锚点法处理,不触发扁担专项):原图确认为扁担时,正向必须写"平直硬木扁担/平直木扁担",并写"中段搭在肩上,长轴横向或斜横向延伸";禁止只写"木棍/长杆",否则易变竖直手杖;禁止写"弯曲、柔软、藤条感、绳状"等会让扁担变形的词。若生成图出现木棍、竖杆、弯杆、软杆、竹筐变背篓,则只局部修道具段与对应负向词,不重写脸部/表情/场景有效锚点。**坐标系分界**:物品位置=人物段用身体坐标(物品跟着人物走,换场景/多人归属均稳定);人物站位=场景层用画面坐标("居画面中偏左略前"是构图信息,归场景层——不要矫枉过正把站位也改成身体坐标);④**微表情双轨制**——观察分析用 `references/知识库/01_主体描述/主体描述词库.md` 的微表情7区域×4级强度(保观察精度),写入提示词正文时**转译为直白可视化词**("眉弯L3+嘴大L3"→"露齿大笑"),L值标注是创作语言、文生图模型不识别;**动作状态词优先**(开怀大笑/咧嘴大笑/放声大笑/会心微笑)+ **可观察子状态**(露上牙/上排牙齿完全可见/眼睛眯成弯月);**禁几何抽象词**("嘴大张呈O形""一字眉""V形领""圆形脸"等)——模型会把"O/一字/V/圆形"字面读成几何形态,生成"惊讶圆嘴/惊讶一字眉/V领睡袍/圆饼Line truncated
|
||||
|
||||
**类型适配表(在事实层/关系层/神韵层三层观察底座上叠加专属栏目):**
|
||||
|
||||
| 图片类型 | 专属叠加栏目 |
|
||||
|---|---|
|
||||
| 产品摄影/电商 | 卖点描述(质感/工艺/情绪价值,只描述可见卖点不编造功能) |
|
||||
| 人像摄影 | 外貌细化(种族族裔+肤色具体色名+妆容发型气质) |
|
||||
| 风景/自然 | 主体景观描述(地貌/植被/水体/季节天气) |
|
||||
| 美食摄影 | 食欲感与新鲜感描述(温度感/水分感/光影对食物质感的强化) |
|
||||
| 建筑/室内 | 空间结构描述(空间类型/层次纵深感/材质/陈设/风格定位) |
|
||||
| 海报/文字图 | 文字与版式描述(逐字转录所有可辨识文字+位置+字体风格) |
|
||||
| 抽象/艺术 | 主体元素+艺术风格(绘画媒介/图形类型/流派归类) |
|
||||
|
||||
**文字转录强制要求(画面含可辨识文字即必做,不限图片类型):** 画面中所有可辨识文字逐字转录,注明位置("瓶身正面居中""右下角""T恤胸前""背景招牌")与字体风格(衬线/无衬线/手写/装饰体),不省略、不模糊、不合并、不虚构。非海报类图(人像服饰slogan、场景路牌招牌、产品包装等)同样适用。
|
||||
|
||||
**文字二分类(转录后决定去留):** ①内容性文字(招牌名/产品文案/海报标题/服饰slogan)→ 写入提示词正文(复刻需要);②标识性文字(水印/署名/@账号名/logo/时间戳/平台ID)→ **正向提示词零出现**(含否定式提及与说明性文字——"左下角水印只进反向词"这类描述也禁止写,正向提示词出现"水印"字样本身就有诱导生成水印的风险),只在观察报告提及+负面约束"水印"项承载。
|
||||
|
||||
**反向提示词(7 类,按图片类型筛选用项):**
|
||||
- 画面质量类:低清晰度, 模糊, 噪点, 过曝, 欠曝, 画质低劣, 分辨率不足
|
||||
- 结构与比例类:透视错误, 比例错误, 主体变形, 构图杂乱, 边缘破损, 重复物体
|
||||
- 材质与色彩类:材质错误, 反光混乱, 阴影错误, 色彩过饱和, 色彩发灰, 廉价质感
|
||||
- 文字与标识类:文字乱码, 多余文字, 错误文字, 水印, 错误logo
|
||||
- 人物类(含人物时):肢体错误, 手指错误, 面部崩坏, 皮肤塑料感, 眼神异常, 多余肢体
|
||||
- **AI审美污染类(含人物且原图为生活流/古典/自然人像时优先选配)**:网红脸, 现代写真脸, 现代商业写真感, 过度通透高清, 棚拍精修感, 欧式大双眼皮, 尖下巴, 高鼻梁整容感, 过大眼睛, 惊恐表情, 夸张张嘴, 僵硬笑容, 假笑, 摆拍感, 直视镜头, 游客照, 硬挺新衣, 化纤质感, 塑料感, 影楼汉服, 舞台浓烟, 干冰烟雾, 过度戏剧光
|
||||
- **长杆/挂载物专项类(原图有扁担、伞、杆、挂篮等长杆+挂载物时按失败项选配)**:手持木棍, 竖直木棍, 拐杖, 竖杆道具, 白色长棍, 弯曲扁担, 弯曲木杆, 软杆, 变形杆, 藤条弯杆, 背篓, 竹筐贴背, 竹筐落地, 竹筐贴边, 挂载物截断, 道具展示感
|
||||
- AI痕迹类:AI痕迹明显, 细节缺失, 不自然过渡
|
||||
|
||||
**反向词默认选配规则:** 画面质量+AI痕迹类必带;含人物加人物类;海报/文字图加文字标识类;产品/美食加材质色彩类;建筑/风景加结构比例类;有长杆/挂载物且生成失败时加长杆/挂载物专项类。**负向词分层精简**:按"通用质量/人脸审美污染/本图专属纠偏/风格场景误差"四层选配,不把所有历史失败无限堆叠进负向词;本图专属纠偏只针对当前图片或最近一轮真实失败项,问题消失后可下调或移除,避免负向词过重把正向主体也打散。**反脑补项**——场景观察为穷尽清单,原图未出现的**形态级**元素(山体/塔/水面/招牌等具体形态)逐项加入反向词;**概念级氛围词(远景暖光晕染/空气透视感/晨雾光感)豁免**,不进反脑补清单——它们是画面感来源;烟雾/雾气失控放大时反向词加"浓烟";**对抗项(仅原图背景虚化时加)**——背景细节过多, 景深过大(**禁用"背景清晰"**:拆词后会把"清晰"整体否定,导致全图发软)。
|
||||
|
||||
**目标平台适配(用户指明时按平台语法适配输出):**
|
||||
- **默认即梦/通用自然语言**:自然语言描述;**正向与负向提示词分开输出**(即梦有"不希望呈现的内容"独立输入框,负向词贴该框;单输入框平台在负向部分用否定句式转写如"画面中不出现…",禁止与正向词混排——混排后模型无法区分正负,"低清晰度, 模糊"会被当正向描述执行)
|
||||
- **Midjourney**:参数式语法(`--ar 16:9 --style raw --v 6`),负面词用 `--no` 承载
|
||||
- **Stable Diffusion**:权重语法(`(word:1.3)`),6分类反向词放独立负面词框(negative prompt)
|
||||
- **NanoBanana**:自然语言;默认仍按正向提示词与负向提示词分开输出。若平台只支持单输入框,负向内容必须改写为自然语言否定句(如"画面中不出现…"),放在独立负向段落中,禁止裸负向词直接混排在正向文本末尾
|
||||
未指明平台时按即梦/通用输出,不强行参数化。
|
||||
|
||||
**输出格式:** 双版本输出(均按实体聚合+全局项聚合):
|
||||
- **结构还原版**:保证道具、服装、场景、人物位置、持物关系不丢;适合审计硬锚点。
|
||||
- **神韵优化版(默认推荐生成)**:在保留硬锚点基础上,降低人脸/表情/视线/空气感的器官级硬量化,强化人物关系、生活流语境、古典骨相、软布料、湿润空气感;适合直接喂模型生成。
|
||||
人物按"每人一块全信息"组织(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;**人物画面位置不写在人物块,统一归场景层人物布局**),全局项合并为5块——场景(环境+人物布局+前中后景内容)/镜头(景别+机位+虚化+拍摄风格)/光影(光源类型+逆光入画+色调系统三段式)/画面质感(渲染规格+年代流派媒介三合一锚定)/画面风格(流派+情绪基调+画面感词),加文字/负面约束/基础属性 + 类型专属栏目。
|
||||
|
||||
**版本说明:** 极简版信息密度不足以承载还原约束,已废弃;但单一硬还原版会压死人脸神韵,改为"结构还原版+神韵优化版"双版本。默认把神韵优化版作为生成层主稿,结构还原版作为审计层硬锚点清单。
|
||||
|
||||
**双版本 × 两层输出关系:** "结构还原版/神韵优化版"是内容策略差异,"结构化版/整段版"是交付形态差异。两个版本都可按结构化版审计、再转为整段版生成;默认交付顺序为:先给结构还原版结构化审计层(核硬锚点)→再给神韵优化版整段生成层(直接用于生成)。禁止把"结构还原版"误解为"结构化版",也禁止把"神韵优化版"误解为只要整段不要审计。
|
||||
|
||||
**两层输出分工(审计层 vs 生成层):** 结构化版与整段版是两层产物,缺一不可:
|
||||
- **结构化版=审计层**:按**实体聚合**组织——**每个人物一块写完全部个体信息**(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;位置归场景层人物布局),全局项按5块聚合(场景/镜头/光影/画面质感/画面风格),供人工逐人核对——**不直接喂模型**
|
||||
- **整段版=生成层**:喂模型的最终提示词,与结构化版同一实体聚合结构,去掉**全局块字段标签**(【场景】【镜头】等)合并为流畅自然语言段——**人物标签(女性A/女性B)保留**,人物段以"女性A:"开头,场景段布局用**完整主体名称**绑定("女性A居画面中偏左略前,女性B居画面中偏右"——禁裸编号"A居""B居",必须与人物块标签字面完全一致)——**人物标签是跨层实体绑定锚点,剥掉后多人段落无法区分、布局与人物段断链**(实测:两段同以"脸型窄长…的年轻女性"开头,模型无从知道谁站哪边);**禁止把同一人的属性拆到多个段落**(拆散后模型要跨段拼装,归属断链——材质/颜色/道具会张冠李戴);**道具与佩戴物内联到持有者段落**;**正向与负向分开**——整段版正文只含正向提示词(人物段+场景/镜头/光影/画面质感/画面风格全局段),**负面约束独立成第二部分输出**,标识行只写"负向提示词:"五个字,**不带括号操作指引**("(贴即梦XX框)"之类的平台分发说明是技能内部知识,不写入输出——平台怎么分发由用户自行判断,规则留在"目标平台适配"节),**禁止负向词直接混排在正向文本末尾**——剥掉【负面约束】标签后模型无从区分正负,"低清晰度, 模糊"会被当作正向描述执行(实测用户抓出)
|
||||
- **逐件核对**:结构化版→整段版转写后,确认所有道具/佩戴物已内联到对应人物块,禁止聚合时静默丢弃(实测:竹篮在观察层被发现,却在聚合写入时丢失)
|
||||
- **对话展示格式**:最终提示词不用长行代码块展示(横向滚动条导致用户复制不便),以普通文本段落输出,段与段空行分隔
|
||||
|
||||
**画面感保护条款:** 还原导向≠无脑精确化。逐项精确(姿势/服饰/道具/虚化)的同时,**保留 1-2 处"模糊氛围词"**(如"远景暖光晕染""空气透视感""轻雾弥漫")不拆解、不量化、不进反脑补清单——过度具体化会让生成图变成"摆拍工作照",丢失"生活瞬间感"(实测:纯精确提示词生成的图还原度高但画面感弱于带氛围词的版本)。
|
||||
|
||||
**生成闭环复盘与有效锚点保护(多轮出图后必做):** 每轮生成图对比原图后,先列三栏再改提示词:①保留项(本轮比上一轮更接近原图的脸部、表情、朝向、道具、场景、光影、质感句);②回退项(上一轮好、本轮变差的局部);③替换项(当前明确失败的局部)。修改只动替换项所在模块,保留项原句不得因其他问题被顺手重写。尤其在修扁担/竹筐/背景时,不得误删已实测有效的面部朝向和表情锚点;在修视线/表情时,不得误伤扁担、挂载物、场景氛围锚点。
|
||||
|
||||
**金标锚点逐字保护(多轮出图核心机制):** 当某一轮生成图的某个局部(如 A 的面部朝向/笑容/表情)明显优于其他轮时,将该局部对应的提示词原句标记为"金标句"。金标句一经标记,后续所有轮次的提示词中该局部句子必须**逐字复制粘贴**,禁止同义改写、合并精简、拆分重组或"优化措辞"——实测:仅把"嘴角横向打开"改成"嘴角上扬"就导致笑容效果完全丢失。回退时不重新从原图反推,而是直接粘贴金标句原文。只有用户明确说"这版某处不好要改"时,才允许动对应金标句,且改后旧金标句仍需保留备查。金标句的标记范围按模块划分:A 面部块(脸型→表情→朝向→头部姿态)是一个可标记模块;B 面部块是另一个;道具块、场景块、光影块各自独立标记。标记后该模块在后续轮次中"冻结",非用户明确要求不得解冻。
|
||||
|
||||
**非看镜头/人物交互专项(人像多人图必做):** 判断人物是否看镜头、谁看谁、是否同行/闲聊/经过镜头、表情是否回应对方。若原图是生活流抓拍,提示词必须写"非看镜头"、"边走边聊"、"自然经过镜头前"、"动作不是摆拍展示道具"等关系语境;负向词加入"直视镜头/游客照/摆拍感/网红写真"。视线落点是人物关系信息,不得省略为泛泛"望向前方"。
|
||||
|
||||
**视线词高风险规则:** 视线是软锚点,高于普通表情词风险。"视线越过镜头右侧"可能减少直视镜头,也可能让模型误读为看镜头外展示;"视线轻轻落向同伴/含笑回应"容易把弱交互放大成互相凝视。处理多人弱交互时,优先写头部朝向与表情语境,视线只写低强度词(如"眼神略偏""不直视镜头"),慎写精确落点;只有原图明确看向某人时才写"看向同伴"。若某一版面部朝向/神态已经实测更接近原图,后续不得把该面部句泛化替换为未经验证的新视线句。
|
||||
|
||||
**视线词与交互强度匹配表(写下视线前先查表):**
|
||||
| 交互强度 | 视线写法 | 禁止写法 |
|
||||
|---|---|---|
|
||||
| 强交互 | "看向女性A,目光落在她脸上" | 禁止弱化为"略偏向"——原图明确看人就不能写弱 |
|
||||
| 中交互 | "脸朝女性A方向,目光大致落在她肩颈区域" | 禁止写"凝视/深情注视"——会升级成强对视 |
|
||||
| 弱交互 | "眼神略偏,不直视镜头" | 禁止写具体落点("看向A/落向A")——会把弱放大成强 |
|
||||
| 无交互 | "目光朝前方" | 禁止写"看向同伴" |
|
||||
|
||||
交互强度判错时,先回到交互强度判定(无/弱/中/强),不直接调视线词——先定强度,再查表选视线写法。
|
||||
|
||||
**美学自检(输出前必做):** 字段检查通过不代表图会好看。输出前必须自问:人物像活人吗?是否出现网红脸/尖下巴/过大眼睛/高鼻梁整容感?表情是否惊吓、假笑或僵硬?人物是否不该看镜头却直视镜头?衣服是否硬挺新衣/塑料感/影楼汉服?雾气是否变干冰浓烟?若任一命中,降低人脸与表情的器官级量化,改用神态语境、古典骨相、软布料、湿润空气感与审美负向词。
|
||||
|
||||
**结构化版格式模板(人物按实体聚合每人一块+全局项5块聚合,每人一块内按聚合清单顺序写——分行是硬性格式,禁止合并单行;关键还原项前置(人物表情/服装/朝向/虚化),背景细节后置——模型对提示词开头权重最高。**输出产物禁带元规则标注**——"(穷尽清单)""(前置)""(画面感保护词)"等括号注记不写入观察报告/结构化版/整段版,规则术语只留在本技能文件,输出层用自然语言。**全局项禁止跨字段重复**——同一信息只在一处写,如虚化只写镜头层、色调只写光影层、人物画面位置只写场景层):**
|
||||
> **人物标签=性别+角色编号**(如"女性A""女性B",单人时直接"人物"),禁止用裸编号"A""B"——脱离上下文无法辨认是谁;**标签不带画面位置**——位置是关系性信息,归场景层,标签重复写会冗余:[基础(脸型+肤色——**肤色取面部受光面色调,不取逆光/暖调下的整体观感**;易漂移色名加锚定如"灰白≈浅亚麻/不含蓝调")→表情(**动作语境+面部协同**:先写"看同伴/听人说话/边走边笑/非看镜头"等关系语境,再写少量可见状态;禁极限张口、强制瞪眼、强制强调瞳孔细节、机械唇部拉伸等器官命令;推荐"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"或"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑",多人分离描述;弱交互不等于弱表情,闭唇笑也要写清笑意强度)→发型与佩戴物(簪/耳饰)→服装含材质(外层品类+颜色+衣长+袖型+内层可见+腰部如有+材质内联如"亚麻粗织感";**汉服专有品类加形态锚定**——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定"搭肩/双手拎两端"兜底可不加)→朝向(**面部朝向四件套+可见部位锚定+角度档位自洽**:①左右朝向看鼻尖朝画面左/右/正前;②上下朝向看下巴/鼻尖平视、微抬、微低或内收;③头部倾斜看是否歪头,无明显歪斜不写;④视线落点看眼睛看向哪里。四分之三侧脸=完整一只眼+另一只**变窄但完整可见**+一只耳朵("鼻尖明显朝向画面左,左眼完整清晰,右眼因侧转明显变窄但完整可见");接近正侧脸=仅一只眼完整可见+另一只完全不可见——**禁遮挡机制词("被鼻梁挡住")与模糊量词("一线")**,只写可见状态;"四分之三侧脸"单独写会被弱化成正脸,可见部位量化才锁得住;非人物用角度锚定正对/45度/正侧面)→姿势动作→持物(名称+材质+接触点+**两端相对身体方位**,无则省略;**道具上挂载的其他物品(如扁担上挂的竹篮)随道具一起写,且独立写明相对身体方位**(如"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")——挂载物单独留在观察层会在聚合时静默丢失(实测竹篮两次被丢);挂载物不写独立位置会跟随道具末端漂移到画面边角被截断(实测第四轮竹篮只剩边角1/3))→视线落点]|场景:[环境类型+空间特征+**人物布局**(**用完整主体名称**(女性A/女性B)写每人画面位置+前后关系+间距——与人物块标签字面完全一致,禁裸编号A/B;多人加"同一瞬间、同一光线"——不含情绪节律,防表情趋同污染)+前中后景三层逐层列各层陈设(**只写"有什么",不写虚化**——虚化属镜头层;未出现的大类元素直接进负面约束)]|镜头:[景别+机位+虚化**结果转译**:原图有虚化写"背景虚化成柔和色块,仅可辨认轮廓剪影"(**用"虚化"不用"模糊"**——负面约束含"模糊",正向出现会与之打架、弱化景深执行);原图全清晰写"全画面清晰锐利,前后景均无虚化"——**禁写焦段/光圈参数(如85mm、f值)与"浅景深"等参数化术语**,虚化结果句已承载全部景深信息,重复写参数反而引入不确定性+**拍摄风格子项**(原图可辨的静态执行项):POV主观视角/手持拍摄感/俯拍仰拍等;**晃动感/呼吸感/跟拍节奏等动态词仅视频提示词用,静帧反推不写**]|光影:[**光源类型先行**(自然光为主/单一人工光源/混合光)+方向+行为;强方向光**逆光入画**:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"+**色调系统三段式**:饱和度(低饱和度/正常饱和度)+色相(如"冷灰偏旧""整体暖黄调")+胶片类型(如"复古胶片色调""暖调胶片模拟")——完整示例"低饱和度,冷灰偏旧的复古胶片色调"或"整体暖黄调,背景暖褐暖灰"(具体色名留在各实体内联处不重复);**渲染术语禁写**——"体积光"是CGI术语,直白写"光柱清晰可见";**画面现象的位置词需明确参照**——"光柱在画面左侧"(明确写"画面左侧"),禁裸写"左侧"(人物左还是画面左歧义)]|画面质感:[**渲染规格+质感风格锚定**——这是独立于"风格流派"的渲染指令层:①渲染规格(8K高清/微颗粒胶片感/非完美锐度/轻微色差/暗部细节保留/HDR等,**这些是输出规格词模型可识别,与禁写的"输入参数"85mm/f值不同**)②质感风格锚定("纪录片摄影风格""胶片模拟""柔光片效果"等——*Line truncated
|
||||
|
||||
**多图模式(同主体多角度/多张图反推,衔接 F3 角色卡):**
|
||||
提取共通主体描述(多图高置信交集)+ 各图差异项(姿态/光线/景别/角度);冲突项标注"图A/B不一致"由用户裁定。输出可直接喂 F3 角色卡的一致性主体锚定 + 差异镜头库。
|
||||
|
||||
**风格反推双轨输出(艺术风格维度专用):**
|
||||
风格维度同时输出「风格命名」(人类可读,如"韦斯·安德森式对称构图")+「参数化描述」(去名化、可直接用于生成,规则见 `references/知识库/15_视觉风格/视觉风格词库.md` 去名化使用规范);命名与描述均标注置信度。
|
||||
|
||||
**注意:** 不声称还原图片原始隐藏参数,说明这是对画面的实用重构。
|
||||
|
||||
**还原路径指引(输出后主动告知用户,按用途分流):**
|
||||
- **100% 复刻原片** → 走图生图/垫图(把原图作为参考图喂给平台),F1 提示词仅作辅助约束;纯文生图无法逐像素复刻
|
||||
- **改图/延展(同构图换元素)** → 文生图直接使用本提示词,改动目标字段即可
|
||||
- **学图(提炼风格/结构复用)** → F1 提示词 + 第 6 步变量提炼,替换变量生成同风格新图
|
||||
🔴 **执行细则必读(R73):** F1 细则(人物专项/类型适配表/文字转录强制/反向词7类与选配/目标平台适配/输出双版本与两层分工/画面感保护/金标锚点逐字保护/视线词高风险与匹配表/结构化版格式模板/多图模式/风格反推双轨/还原路径指引)→ 完整细则见 `references/功能/F1_图片反推细则.md`,**执行 F1 时先通读该文件再动手**(细则为实测沉淀,跳过即复现踩坑)。
|
||||
|
||||
**详细方法论(观察维度→词库语言对照):**
|
||||
- 人物专项+微表情7区域拼乐高+反AI假脸四大陷阱:`references/知识库/01_主体描述/主体描述词库.md`
|
||||
@@ -170,6 +83,9 @@ created_at: "2026-08-20"
|
||||
- 纹理材质+画质质感(有机瑕疵+反塑料感套装+摄影质感维度表):`references/知识库/10_后期细节/后期细节词库.md` + `references/知识库/12_画质分辨率/画质分辨率词库.md`(反塑料感宣言+胶片型号)
|
||||
- 视觉风格反推(28+导演风格去名化规范+国际大师/中国影视/新媒体/特殊四类风格库):`references/知识库/15_视觉风格/视觉风格词库.md`
|
||||
|
||||
---
|
||||
|
||||
|
||||
---
|
||||
|
||||
### F2. 反推视频提示词
|
||||
|
||||
@@ -0,0 +1,108 @@
|
||||
---
|
||||
name: F1 图片反推细则
|
||||
description: >
|
||||
mcn-video-prompt 技能 F1(反推图片提示词)完整细则库(R73 自 SKILL.md 下沉,09-04)。
|
||||
SKILL.md 的 F1 节仅保留流程骨架 + Step-Check + 必读指针;本文件为 F1 执行时必读的
|
||||
完整细则(人物专项/类型适配表/文字转录/反向词/输出格式/金标锚点保护/视线词等),
|
||||
由 SKILL.md F1 节「🔴 必读指针」强制引用。禁止删除或改写(内容级变更须同步 SKILL.md 骨架)。
|
||||
agent_created: true
|
||||
---
|
||||
|
||||
# F1 反推图片提示词 · 执行细则(R73 下沉自 SKILL.md)
|
||||
|
||||
> 定位:本文件 = SKILL.md「### F1. 反推图片提示词」的**完整细则层**。执行 F1 时,
|
||||
> 先读 SKILL.md F1 骨架(流程 0-6 + Step-Check),再**逐节通读本细则**并按对应步骤执行,
|
||||
> 禁止跳读(细则含实测防坑规则,跳过即复现踩坑)。
|
||||
> 引用约定:本文件位于 `references/功能/`,引用知识库词库用相对路径 `../知识库/…`。
|
||||
|
||||
---
|
||||
|
||||
**人物专项(画面含人物时必做 5 项):** 服饰造型(**结构化描述**:外层(品类+颜色+衣长+袖型)+内层(可见部分)+腰部(腰带/腰封宽窄+位置,**如有**——无则省略防脑补);汉服示例"灰白交领长衫(过臀,宽袖垂坠),领口两片襟布在胸前交叠形成斜向襟线,露出白色内衬窄边,腰间深蓝宽腰封约一掌宽";现代装示例"oversized白色卫衣(过胯,落肩宽袖),胸前无图案,下摆罗纹收口")/ 身材比例 / 肢体姿势 / 脸型轮廓 / 面部神态(肤色用具体色名:象牙白/小麦色/古铜色/深棕色/暖黄调/冷白调,不写"白""黑";**基础肤色取面部受光面**——鼻梁高光/受光侧脸颊/边缘光的色调,**禁取整体面部观感**——逆光背光面偏暗、暖调滤镜偏黄都会造成"古铜感"误判(实测:逆光图A整体观感偏深被判"古铜肤色",实际受光面与B同为暖白偏粉;受光角度不同的两人观感差≠肤色差);**多人场景先核两人受光角度是否一致**——受光角度不同导致的观感差,写真实基础肤色即可,明暗差由光影层自然处理)。**还原力精度要求:** ①肢体姿势写到**角度/手部动作/视线落点**粒度(如"侧身约30度朝画面左,右手提裙摆,视线望向画面右上"),姿势语言用 `../知识库/02_动作行为/动作行为词库.md`;②**姿势动词≤2个/人**——复合动作(扛+斜搭+延伸类)改用道具几何锚定:接触点+道具两端相对身体方位(如"扁担中段搭右肩,前端在身前右手握持处,后端斜向身后上方延伸");③**持物/挂载物位置用相对人物的身体方位,禁用画面绝对坐标**——身体锚点(身前/身后/左肩/右腰/腿侧/右肩至背部高度等),禁写"画面左下角/右上角"(实测:扁担末端写"伸向画面左下角"导致挂载竹篮被锚定到画面边角截断;正确写法"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")。**长杆类道具最小锚点法**:扁担/伞/棍/枪等长杆类道具不能只写名称,也不能写成机械长篇几何说明;**下笔前先回答三问**:①承载方式:肩扛 / 单手握提 / 双手握提 / 落地斜靠?(看杆与身体的接触点,不默认肩扛——实测:右手手提斜杆挂篮被误判成"肩扛横杆",导致筐被画到身后、手被解放空手)②杆身长轴方向:水平 / 斜上 / 斜下 / 竖直?(看杆在画面里的实际角度,不默认横向)③挂载物落点:挂上端 / 挂中段 / 挂下端 / 杆外侧?(看筐/篮在杆上的实际位置)。三问不答完,禁止写"肩扛""横向"等默认描述。答完后最少写清4个锚点:①身体接触点(搭在哪个肩/握在哪只手/贴近哪个身体部位);②长轴方向(横向/斜横向/竖向,尽量用相对身体方向);③手部作用(扶住/握住/自然垂放,不强行摆拍展示);④挂载物归属(挂在哪一端/哪一段)。**挂载物≠背负物**:挂在道具上的篮筐、包袱、灯笼等必须写成"挂在某段道具下方、与身体背部有距离",禁止写成贴背/背在身上/背篓;挂载物位置用"身后侧扁担段下方、右肩至背部高度"这类身体相对方位,避免漂移到画面边角或贴背。**扁担专项防偏**(仅在长杆三问①承载方式=肩扛时适用;三问=单手握提时按普通长杆最小锚点法处理,不触发扁担专项):原图确认为扁担时,正向必须写"平直硬木扁担/平直木扁担",并写"中段搭在肩上,长轴横向或斜横向延伸";禁止只写"木棍/长杆",否则易变竖直手杖;禁止写"弯曲、柔软、藤条感、绳状"等会让扁担变形的词。若生成图出现木棍、竖杆、弯杆、软杆、竹筐变背篓,则只局部修道具段与对应负向词,不重写脸部/表情/场景有效锚点。**坐标系分界**:物品位置=人物段用身体坐标(物品跟着人物走,换场景/多人归属均稳定);人物站位=场景层用画面坐标("居画面中偏左略前"是构图信息,归场景层——不要矫枉过正把站位也改成身体坐标);④**微表情双轨制**——观察分析用 `../知识库/01_主体描述/主体描述词库.md` 的微表情7区域×4级强度(保观察精度),写入提示词正文时**转译为直白可视化词**("眉弯L3+嘴大L3"→"露齿大笑"),L值标注是创作语言、文生图模型不识别;**动作状态词优先**(开怀大笑/咧嘴大笑/放声大笑/会心微笑)+ **可观察子状态**(露上牙/上排牙齿完全可见/眼睛眯成弯月);**禁几何抽象词**("嘴大张呈O形""一字眉""V形领""圆形脸"等)——模型会把"O/一字/V/圆形"字面读成几何形态,生成"惊讶圆嘴/惊讶一字眉/V领睡袍/圆饼脸"等与原图Line truncated
|
||||
|
||||
**类型适配表(在事实层/关系层/神韵层三层观察底座上叠加专属栏目):**
|
||||
|
||||
| 图片类型 | 专属叠加栏目 |
|
||||
|---|---|
|
||||
| 产品摄影/电商 | 卖点描述(质感/工艺/情绪价值,只描述可见卖点不编造功能) |
|
||||
| 人像摄影 | 外貌细化(种族族裔+肤色具体色名+妆容发型气质) |
|
||||
| 风景/自然 | 主体景观描述(地貌/植被/水体/季节天气) |
|
||||
| 美食摄影 | 食欲感与新鲜感描述(温度感/水分感/光影对食物质感的强化) |
|
||||
| 建筑/室内 | 空间结构描述(空间类型/层次纵深感/材质/陈设/风格定位) |
|
||||
| 海报/文字图 | 文字与版式描述(逐字转录所有可辨识文字+位置+字体风格) |
|
||||
| 抽象/艺术 | 主体元素+艺术风格(绘画媒介/图形类型/流派归类) |
|
||||
|
||||
**文字转录强制要求(画面含可辨识文字即必做,不限图片类型):** 画面中所有可辨识文字逐字转录,注明位置("瓶身正面居中""右下角""T恤胸前""背景招牌")与字体风格(衬线/无衬线/手写/装饰体),不省略、不模糊、不合并、不虚构。非海报类图(人像服饰slogan、场景路牌招牌、产品包装等)同样适用。
|
||||
|
||||
**文字二分类(转录后决定去留):** ①内容性文字(招牌名/产品文案/海报标题/服饰slogan)→ 写入提示词正文(复刻需要);②标识性文字(水印/署名/@账号名/logo/时间戳/平台ID)→ **正向提示词零出现**(含否定式提及与说明性文字——"左下角水印只进反向词"这类描述也禁止写,正向提示词出现"水印"字样本身就有诱导生成水印的风险),只在观察报告提及+负面约束"水印"项承载。
|
||||
|
||||
**反向提示词(7 类,按图片类型筛选用项):**
|
||||
- 画面质量类:低清晰度, 模糊, 噪点, 过曝, 欠曝, 画质低劣, 分辨率不足
|
||||
- 结构与比例类:透视错误, 比例错误, 主体变形, 构图杂乱, 边缘破损, 重复物体
|
||||
- 材质与色彩类:材质错误, 反光混乱, 阴影错误, 色彩过饱和, 色彩发灰, 廉价质感
|
||||
- 文字与标识类:文字乱码, 多余文字, 错误文字, 水印, 错误logo
|
||||
- 人物类(含人物时):肢体错误, 手指错误, 面部崩坏, 皮肤塑料感, 眼神异常, 多余肢体
|
||||
- **AI审美污染类(含人物且原图为生活流/古典/自然人像时优先选配)**:网红脸, 现代写真脸, 现代商业写真感, 过度通透高清, 棚拍精修感, 欧式大双眼皮, 尖下巴, 高鼻梁整容感, 过大眼睛, 惊恐表情, 夸张张嘴, 僵硬笑容, 假笑, 摆拍感, 直视镜头, 游客照, 硬挺新衣, 化纤质感, 塑料感, 影楼汉服, 舞台浓烟, 干冰烟雾, 过度戏剧光
|
||||
- **长杆/挂载物专项类(原图有扁担、伞、杆、挂篮等长杆+挂载物时按失败项选配)**:手持木棍, 竖直木棍, 拐杖, 竖杆道具, 白色长棍, 弯曲扁担, 弯曲木杆, 软杆, 变形杆, 藤条弯杆, 背篓, 竹筐贴背, 竹筐落地, 竹筐贴边, 挂载物截断, 道具展示感
|
||||
- AI痕迹类:AI痕迹明显, 细节缺失, 不自然过渡
|
||||
|
||||
**反向词默认选配规则:** 画面质量+AI痕迹类必带;含人物加人物类;海报/文字图加文字标识类;产品/美食加材质色彩类;建筑/风景加结构比例类;有长杆/挂载物且生成失败时加长杆/挂载物专项类。**负向词分层精简**:按"通用质量/人脸审美污染/本图专属纠偏/风格场景误差"四层选配,不把所有历史失败无限堆叠进负向词;本图专属纠偏只针对当前图片或最近一轮真实失败项,问题消失后可下调或移除,避免负向词过重把正向主体也打散。**反脑补项**——场景观察为穷尽清单,原图未出现的**形态级**元素(山体/塔/水面/招牌等具体形态)逐项加入反向词;**概念级氛围词(远景暖光晕染/空气透视感/晨雾光感)豁免**,不进反脑补清单——它们是画面感来源;烟雾/雾气失控放大时反向词加"浓烟";**对抗项(仅原图背景虚化时加)**——背景细节过多, 景深过大(**禁用"背景清晰"**:拆词后会把"清晰"整体否定,导致全图发软)。
|
||||
|
||||
**目标平台适配(用户指明时按平台语法适配输出):**
|
||||
- **默认即梦/通用自然语言**:自然语言描述;**正向与负向提示词分开输出**(即梦有"不希望呈现的内容"独立输入框,负向词贴该框;单输入框平台在负向部分用否定句式转写如"画面中不出现…",禁止与正向词混排——混排后模型无法区分正负,"低清晰度, 模糊"会被当正向描述执行)
|
||||
- **Midjourney**:参数式语法(`--ar 16:9 --style raw --v 6`),负面词用 `--no` 承载
|
||||
- **Stable Diffusion**:权重语法(`(word:1.3)`),6分类反向词放独立负面词框(negative prompt)
|
||||
- **NanoBanana**:自然语言;默认仍按正向提示词与负向提示词分开输出。若平台只支持单输入框,负向内容必须改写为自然语言否定句(如"画面中不出现…"),放在独立负向段落中,禁止裸负向词直接混排在正向文本末尾
|
||||
未指明平台时按即梦/通用输出,不强行参数化。
|
||||
|
||||
**输出格式:** 双版本输出(均按实体聚合+全局项聚合):
|
||||
- **结构还原版**:保证道具、服装、场景、人物位置、持物关系不丢;适合审计硬锚点。
|
||||
- **神韵优化版(默认推荐生成)**:在保留硬锚点基础上,降低人脸/表情/视线/空气感的器官级硬量化,强化人物关系、生活流语境、古典骨相、软布料、湿润空气感;适合直接喂模型生成。
|
||||
人物按"每人一块全信息"组织(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;**人物画面位置不写在人物块,统一归场景层人物布局**),全局项合并为5块——场景(环境+人物布局+前中后景内容)/镜头(景别+机位+虚化+拍摄风格)/光影(光源类型+逆光入画+色调系统三段式)/画面质感(渲染规格+年代流派媒介三合一锚定)/画面风格(流派+情绪基调+画面感词),加文字/负面约束/基础属性 + 类型专属栏目。
|
||||
|
||||
**版本说明:** 极简版信息密度不足以承载还原约束,已废弃;但单一硬还原版会压死人脸神韵,改为"结构还原版+神韵优化版"双版本。默认把神韵优化版作为生成层主稿,结构还原版作为审计层硬锚点清单。
|
||||
|
||||
**双版本 × 两层输出关系:** "结构还原版/神韵优化版"是内容策略差异,"结构化版/整段版"是交付形态差异。两个版本都可按结构化版审计、再转为整段版生成;默认交付顺序为:先给结构还原版结构化审计层(核硬锚点)→再给神韵优化版整段生成层(直接用于生成)。禁止把"结构还原版"误解为"结构化版",也禁止把"神韵优化版"误解为只要整段不要审计。
|
||||
|
||||
**两层输出分工(审计层 vs 生成层):** 结构化版与整段版是两层产物,缺一不可:
|
||||
- **结构化版=审计层**:按**实体聚合**组织——**每个人物一块写完全部个体信息**(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;位置归场景层人物布局),全局项按5块聚合(场景/镜头/光影/画面质感/画面风格),供人工逐人核对——**不直接喂模型**
|
||||
- **整段版=生成层**:喂模型的最终提示词,与结构化版同一实体聚合结构,去掉**全局块字段标签**(【场景】【镜头】等)合并为流畅自然语言段——**人物标签(女性A/女性B)保留**,人物段以"女性A:"开头,场景段布局用**完整主体名称**绑定("女性A居画面中偏左略前,女性B居画面中偏右"——禁裸编号"A居""B居",必须与人物块标签字面完全一致)——**人物标签是跨层实体绑定锚点,剥掉后多人段落无法区分、布局与人物段断链**(实测:两段同以"脸型窄长…的年轻女性"开头,模型无从知道谁站哪边);**禁止把同一人的属性拆到多个段落**(拆散后模型要跨段拼装,归属断链——材质/颜色/道具会张冠李戴);**道具与佩戴物内联到持有者段落**;**正向与负向分开**——整段版正文只含正向提示词(人物段+场景/镜头/光影/画面质感/画面风格全局段),**负面约束独立成第二部分输出**,标识行只写"负向提示词:"五个字,**不带括号操作指引**("(贴即梦XX框)"之类的平台分发说明是技能内部知识,不写入输出——平台怎么分发由用户自行判断,规则留在"目标平台适配"节),**禁止负向词直接混排在正向文本末尾**——剥掉【负面约束】标签后模型无从区分正负,"低清晰度, 模糊"会被当作正向描述执行(实测用户抓出)
|
||||
- **逐件核对**:结构化版→整段版转写后,确认所有道具/佩戴物已内联到对应人物块,禁止聚合时静默丢弃(实测:竹篮在观察层被发现,却在聚合写入时丢失)
|
||||
- **对话展示格式**:最终提示词不用长行代码块展示(横向滚动条导致用户复制不便),以普通文本段落输出,段与段空行分隔
|
||||
|
||||
**画面感保护条款:** 还原导向≠无脑精确化。逐项精确(姿势/服饰/道具/虚化)的同时,**保留 1-2 处"模糊氛围词"**(如"远景暖光晕染""空气透视感""轻雾弥漫")不拆解、不量化、不进反脑补清单——过度具体化会让生成图变成"摆拍工作照",丢失"生活瞬间感"(实测:纯精确提示词生成的图还原度高但画面感弱于带氛围词的版本)。
|
||||
|
||||
**生成闭环复盘与有效锚点保护(多轮出图后必做):** 每轮生成图对比原图后,先列三栏再改提示词:①保留项(本轮比上一轮更接近原图的脸部、表情、朝向、道具、场景、光影、质感句);②回退项(上一轮好、本轮变差的局部);③替换项(当前明确失败的局部)。修改只动替换项所在模块,保留项原句不得因其他问题被顺手重写。尤其在修扁担/竹筐/背景时,不得误删已实测有效的面部朝向和表情锚点;在修视线/表情时,不得误伤扁担、挂载物、场景氛围锚点。
|
||||
|
||||
**金标锚点逐字保护(多轮出图核心机制):** 当某一轮生成图的某个局部(如 A 的面部朝向/笑容/表情)明显优于其他轮时,将该局部对应的提示词原句标记为"金标句"。金标句一经标记,后续所有轮次的提示词中该局部句子必须**逐字复制粘贴**,禁止同义改写、合并精简、拆分重组或"优化措辞"——实测:仅把"嘴角横向打开"改成"嘴角上扬"就导致笑容效果完全丢失。回退时不重新从原图反推,而是直接粘贴金标句原文。只有用户明确说"这版某处不好要改"时,才允许动对应金标句,且改后旧金标句仍需保留备查。金标句的标记范围按模块划分:A 面部块(脸型→表情→朝向→头部姿态)是一个可标记模块;B 面部块是另一个;道具块、场景块、光影块各自独立标记。标记后该模块在后续轮次中"冻结",非用户明确要求不得解冻。
|
||||
|
||||
**非看镜头/人物交互专项(人像多人图必做):** 判断人物是否看镜头、谁看谁、是否同行/闲聊/经过镜头、表情是否回应对方。若原图是生活流抓拍,提示词必须写"非看镜头"、"边走边聊"、"自然经过镜头前"、"动作不是摆拍展示道具"等关系语境;负向词加入"直视镜头/游客照/摆拍感/网红写真"。视线落点是人物关系信息,不得省略为泛泛"望向前方"。
|
||||
|
||||
**视线词高风险规则:** 视线是软锚点,高于普通表情词风险。"视线越过镜头右侧"可能减少直视镜头,也可能让模型误读为看镜头外展示;"视线轻轻落向同伴/含笑回应"容易把弱交互放大成互相凝视。处理多人弱交互时,优先写头部朝向与表情语境,视线只写低强度词(如"眼神略偏""不直视镜头"),慎写精确落点;只有原图明确看向某人时才写"看向同伴"。若某一版面部朝向/神态已经实测更接近原图,后续不得把该面部句泛化替换为未经验证的新视线句。
|
||||
|
||||
**视线词与交互强度匹配表(写下视线前先查表):**
|
||||
| 交互强度 | 视线写法 | 禁止写法 |
|
||||
|---|---|---|
|
||||
| 强交互 | "看向女性A,目光落在她脸上" | 禁止弱化为"略偏向"——原图明确看人就不能写弱 |
|
||||
| 中交互 | "脸朝女性A方向,目光大致落在她肩颈区域" | 禁止写"凝视/深情注视"——会升级成强对视 |
|
||||
| 弱交互 | "眼神略偏,不直视镜头" | 禁止写具体落点("看向A/落向A")——会把弱放大成强 |
|
||||
| 无交互 | "目光朝前方" | 禁止写"看向同伴" |
|
||||
|
||||
交互强度判错时,先回到交互强度判定(无/弱/中/强),不直接调视线词——先定强度,再查表选视线写法。
|
||||
|
||||
**美学自检(输出前必做):** 字段检查通过不代表图会好看。输出前必须自问:人物像活人吗?是否出现网红脸/尖下巴/过大眼睛/高鼻梁整容感?表情是否惊吓、假笑或僵硬?人物是否不该看镜头却直视镜头?衣服是否硬挺新衣/塑料感/影楼汉服?雾气是否变干冰浓烟?若任一命中,降低人脸与表情的器官级量化,改用神态语境、古典骨相、软布料、湿润空气感与审美负向词。
|
||||
|
||||
**结构化版格式模板(人物按实体聚合每人一块+全局项5块聚合,每人一块内按聚合清单顺序写——分行是硬性格式,禁止合并单行;关键还原项前置(人物表情/服装/朝向/虚化),背景细节后置——模型对提示词开头权重最高。**输出产物禁带元规则标注**——"(穷尽清单)""(前置)""(画面感保护词)"等括号注记不写入观察报告/结构化版/整段版,规则术语只留在本技能文件,输出层用自然语言。**全局项禁止跨字段重复**——同一信息只在一处写,如虚化只写镜头层、色调只写光影层、人物画面位置只写场景层):**
|
||||
> **人物标签=性别+角色编号**(如"女性A""女性B",单人时直接"人物"),禁止用裸编号"A""B"——脱离上下文无法辨认是谁;**标签不带画面位置**——位置是关系性信息,归场景层,标签重复写会冗余:[基础(脸型+肤色——**肤色取面部受光面色调,不取逆光/暖调下的整体观感**;易漂移色名加锚定如"灰白≈浅亚麻/不含蓝调")→表情(**动作语境+面部协同**:先写"看同伴/听人说话/边走边笑/非看镜头"等关系语境,再写少量可见状态;禁极限张口、强制瞪眼、强制强调瞳孔细节、机械唇部拉伸等器官命令;推荐"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"或"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑",多人分离描述;弱交互不等于弱表情,闭唇笑也要写清笑意强度)→发型与佩戴物(簪/耳饰)→服装含材质(外层品类+颜色+衣长+袖型+内层可见+腰部如有+材质内联如"亚麻粗织感";**汉服专有品类加形态锚定**——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定"搭肩/双手拎两端"兜底可不加)→朝向(**面部朝向四件套+可见部位锚定+角度档位自洽**:①左右朝向看鼻尖朝画面左/右/正前;②上下朝向看下巴/鼻尖平视、微抬、微低或内收;③头部倾斜看是否歪头,无明显歪斜不写;④视线落点看眼睛看向哪里。四分之三侧脸=完整一只眼+另一只**变窄但完整可见**+一只耳朵("鼻尖明显朝向画面左,左眼完整清晰,右眼因侧转明显变窄但完整可见");接近正侧脸=仅一只眼完整可见+另一只完全不可见——**禁遮挡机制词("被鼻梁挡住")与模糊量词("一线")**,只写可见状态;"四分之三侧脸"单独写会被弱化成正脸,可见部位量化才锁得住;非人物用角度锚定正对/45度/正侧面)→姿势动作→持物(名称+材质+接触点+**两端相对身体方位**,无则省略;**道具上挂载的其他物品(如扁担上挂的竹篮)随道具一起写,且独立写明相对身体方位**(如"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")——挂载物单独留在观察层会在聚合时静默丢失(实测竹篮两次被丢);挂载物不写独立位置会跟随道具末端漂移到画面边角被截断(实测第四轮竹篮只剩边角1/3))→视线落点]|场景:[环境类型+空间特征+**人物布局**(**用完整主体名称**(女性A/女性B)写每人画面位置+前后关系+间距——与人物块标签字面完全一致,禁裸编号A/B;多人加"同一瞬间、同一光线"——不含情绪节律,防表情趋同污染)+前中后景三层逐层列各层陈设(**只写"有什么",不写虚化**——虚化属镜头层;未出现的大类元素直接进负面约束)]|镜头:[景别+机位+虚化**结果转译**:原图有虚化写"背景虚化成柔和色块,仅可辨认轮廓剪影"(**用"虚化"不用"模糊"**——负面约束含"模糊",正向出现会与之打架、弱化景深执行);原图全清晰写"全画面清晰锐利,前后景均无虚化"——**禁写焦段/光圈参数(如85mm、f值)与"浅景深"等参数化术语**,虚化结果句已承载全部景深信息,重复写参数反而引入不确定性+**拍摄风格子项**(原图可辨的静态执行项):POV主观视角/手持拍摄感/俯拍仰拍等;**晃动感/呼吸感/跟拍节奏等动态词仅视频提示词用,静帧反推不写**]|光影:[**光源类型先行**(自然光为主/单一人工光源/混合光)+方向+行为;强方向光**逆光入画**:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"+**色调系统三段式**:饱和度(低饱和度/正常饱和度)+色相(如"冷灰偏旧""整体暖黄调")+胶片类型(如"复古胶片色调""暖调胶片模拟")——完整示例"低饱和度,冷灰偏旧的复古胶片色调"或"整体暖黄调,背景暖褐暖灰"(具体色名留在各实体内联处不重复);**渲染术语禁写**——"体积光"是CGI术语,直白写"光柱清晰可见";**画面现象的位置词需明确参照**——"光柱在画面左侧"(明确写"画面左侧"),禁裸写"左侧"(人物左还是画面左歧义)]|画面质感:[**渲染规格+质感风格锚定**——这是独立于"风格流派"的渲染指令层:①渲染规格(8K高清/微颗粒胶片感/非完美锐度/轻微色差/暗部细节保留/HDR等,**这些是输出规格词模型可识别,与禁写的"输入参数"85mm/f值不同**)②质感风格锚定("纪录片摄影风格""胶片模拟""柔光片效果"等——*Line truncated
|
||||
|
||||
**多图模式(同主体多角度/多张图反推,衔接 F3 角色卡):**
|
||||
提取共通主体描述(多图高置信交集)+ 各图差异项(姿态/光线/景别/角度);冲突项标注"图A/B不一致"由用户裁定。输出可直接喂 F3 角色卡的一致性主体锚定 + 差异镜头库。
|
||||
|
||||
**风格反推双轨输出(艺术风格维度专用):**
|
||||
风格维度同时输出「风格命名」(人类可读,如"韦斯·安德森式对称构图")+「参数化描述」(去名化、可直接用于生成,规则见 `../知识库/15_视觉风格/视觉风格词库.md` 去名化使用规范);命名与描述均标注置信度。
|
||||
|
||||
**注意:** 不声称还原图片原始隐藏参数,说明这是对画面的实用重构。
|
||||
|
||||
**还原路径指引(输出后主动告知用户,按用途分流):**
|
||||
- **100% 复刻原片** → 走图生图/垫图(把原图作为参考图喂给平台),F1 提示词仅作辅助约束;纯文生图无法逐像素复刻
|
||||
- **改图/延展(同构图换元素)** → 文生图直接使用本提示词,改动目标字段即可
|
||||
- **学图(提炼风格/结构复用)** → F1 提示词 + 第 6 步变量提炼,替换变量生成同风格新图
|
||||
Reference in new issue
Block a user