--- name: 短视频分镜脚本 description: > 短视频视觉创作提示词工程技能:图片提示词反推、视频提示词反推、 生图提示词生成、分镜提示词生成(脚本→分镜)。 适用于即梦 Seedance、Midjourney、Stable Diffusion 等 AI 生图/生视频平台。 触发场景:反推提示词、图生文、视频提示词、生图提示词、分镜提示词、 角色卡、首帧图、运镜、景别、时间戳分镜、图生视频。 version: "1.0" agent_created: true updated_at: "2026-08-31" last_change: "④主体设定→④设定 改名(20处全量替换:SKILL.md 6 + 分镜提示词制作流程.md 10 + 长视频分段制作流程.md 4);6层结构定稿:①主体列表→②画面质感→③色调光影→④设定(人物/场景/构图,每项1句)→⑤镜头叙事→⑥负面提示词;视觉基调前置(模型对提示词开头权重最高);站位/构图边界固化(08-31):构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写),注记入 3.2.2 输出格式块+适配表+SKILL.md F4 结构定义" deployment: source created_at: "2026-08-20" --- # 短视频分镜脚本 Skill ## 技能概述 本技能是一套**中文优先**的 AI 视觉提示词工程系统,专注于短视频分镜脚本创作场景。将图片、视频、文字描述、脚本等输入,转化为可直接用于 AI 生图/生视频平台的高质量提示词。 **四大核心功能:** | 功能 | 名称 | 输入 | 输出 | 主要参考技能 | |:---:|:---|:---|:---|:---| | F1 | 反推图片提示词 | 图片 | 图片生成提示词 | 内建方法论(观察→增强→结构化) | | F2 | 反推视频提示词 | 图片/视频 | 视频生成提示词 | references/制作流程(5步工作流+多模态参考+8项校验)+ seedance2.0(路径C/D+四维编码+版权铁律) | | F3 | 生成图片提示词 | 文字描述/概念 | 图片生成提示词 | 知识库/15维度(品质锚定+材质库+反塑料感) | | F4 | 生成分镜提示词 | 脚本/分镜板 | 分镜提示词序列 | references/制作流程(时间戳分镜+智能分段+长视频策略)+ seedance2.0(生产流水线+剪辑节奏) | **参考技能位置:** `参考skills/`(技能根目录下,1个外部参考技能,只读,提供基础方法论;ShotDesign/seedance25 方法论已提炼落库至 references/,源文件已移除) - `seedance2.0-prompt-skill/` — 视频/图片提示词生成(即梦 Seedance 2.0 专用,含四维编码、美学约束、剪辑节奏、生产流水线、30个实验案例) > 知识库采用三层引用架构:`参考skills/`(方法论源)→ `references/`(默认标准库)→ `references-add/`(用户增量)。详见下方「动态增量管理」节。 --- ## 四大核心功能 ### F1. 反推图片提示词 **适用场景:** - 用户上传/链接/引用一张图片 - "反推提示词""看图写提示词""图生文""img2prompt""根据这张图写提示词" **处理流程:** 0. **视觉准入门(P0)**:开始反推前必须确认模型真实看见图片像素,而不是只拿到文件路径/文件指针/历史上下文。准入验证方式:先写出3个不可从文件名、历史提示词或用户文字中猜出的画面事实(如具体人物动作、背景可见元素、光线落点)。若看不到图、图像未成功加载、视觉通道不确定,必须停止并告知"当前无法看见图片,不能反推提示词",**禁止根据历史描述、用户反馈、文件名、前轮提示词脑补生成**。 1. **判断图片类型**(7类:产品摄影/电商、人像、风景、美食、建筑室内、海报文字、抽象艺术;难判时用产品摄影模板),顺带扫描图片质量(模糊/过曝/裁切/水印),质量结果决定第4步"疑似"标注密度 2. **三层观察画面要素**(先事实层,再关系层,最后神韵层;缺一不可): - **事实层**:基础属性(画幅比)、构图透视+机位、光影布光、色彩色调、纹理材质、主体细节、道具清单、场景空间、画质质感。人物含服装结构(外层+内层+腰部如有)、持物/挂载物、发型佩戴、脸型肤色;场景按前中后景三层列出。 - **关系层**:人物是否看镜头、谁看谁、视线落点、人物之间是否有交互、动作是否像行走/闲聊/经过镜头而非摆拍、人物与道具是否是生活动作而非展示动作。多人图必须判断"同一瞬间"与"人物关系",不能只列人和物;**人物交互必须做强度分级**(无交互/弱交互/中交互/强交互):弱交互=同行交流感、眼神略偏、身体不明显转向;中交互=一方看向另一方但不互相凝视;强交互=双方明确对视/凝视/身体明显转向。原图是弱交互时,提示词只能写"轻微交流感/眼神略偏/非强对视",禁止自动升级成"互相看着对方/凝视/强对视"。 - **神韵层**:画面为什么像活人——清纯/松弛/灵动/古典/生活流/湿润晨雾/空气感/水润感/烟火气等;同时标出AI易污染方向(网红脸、摆拍感、假笑、硬衣、干冰烟雾、影楼感)。 3. **按类型叠加专属栏目**(见下方"类型适配表") 4. **置信分级与硬软锚点分级**:区分高置信观察和推测性风格词,严禁脑补画面不存在内容;低分辨率图用"疑似/隐约可见"标注。**硬锚点**用于道具、服装形制、人物站位、持物关系、前中后景元素;**软锚点**用于人脸、表情、视线、互动、气质、空气感和画面神韵。硬锚点要具体,软锚点要语境化,禁止用极限器官量化压死人脸神韵。 5. **输出双版本**:A.结构还原版(保道具/服装/场景/人物位置不丢);B.神韵优化版(保审美/表情/互动/空气感,适当松绑器官级硬量化)。默认优先交付神韵优化版,同时保留结构还原版供审计。 6. 如需复用,提炼 `{{variable}}` 变量并提供候选词组 **每步自检(Step-Check,每步执行完必做,不通过则重做该步,禁止带病进下一步):** | 步骤 | 自检判据(逐项回看原图核对) | |---|---| | 0 视觉准入 | 必须能说出3个不可从上下文猜出的画面事实;若只拿到路径/文件指针/历史描述,立即停止,禁止脑补生成 | | 1 类型判断 | 类型判定与质量扫描结论将落地到第4步标注密度;无"扫了一眼就定型" | | 2 三层观察 | **错误重灾区,每层写完结论后回看原图一次再落笔**:①事实层——朝向/肤色/持物/挂载物/服装/场景逐项核;②关系层——是否看镜头、谁看谁、是否边走边聊、动作是否生活化,并标注交互强度(无/弱/中/强),弱交互不得写成互相凝视;③神韵层——是否有活人感、松弛感、湿润空气感、古典骨相;④**核法必须是"先看图、再对照已写结论"**——拿结论去图里找印证=确认偏差 | | 3 类型叠加 | 专属栏目与三层观察底座无重复无遗漏 | | 4 置信+硬软锚点分级 | 所有推测词带"疑似";所见即所得维度无脑补;硬锚点(道具/服装/站位/持物)必须具体,软锚点(表情/脸/视线/空气感)禁止极限量化 | | 5 输出前美学自检 | ①人物标签=完整主体名称;②道具/挂载物逐件打勾;③反向词正向零出现;④坐标系分界;⑤正负提示词分离;⑥**活人感自检**:是否网红脸/假笑/惊恐张嘴/直视镜头游客照/硬衣塑料感/干冰烟雾;若出现,降低器官硬量化,改用神态语境与审美负向词 | | 5.5 生成闭环复盘 | 多轮出图后先列保留项/回退项/替换项;已经实测有效的脸部、表情、视线、道具、场景锚点必须**逐字复制**(见"金标锚点逐字保护"),禁止同义改写;只替换失败模块,禁止一轮失败后全量重写导致上一轮优势丢失 | | 6 变量提炼 | 变量化不破坏实体聚合结构(同一人物属性不拆到多段) | **人物专项(画面含人物时必做 5 项):** 服饰造型(**结构化描述**:外层(品类+颜色+衣长+袖型)+内层(可见部分)+腰部(腰带/腰封宽窄+位置,**如有**——无则省略防脑补);汉服示例"灰白交领长衫(过臀,宽袖垂坠),领口两片襟布在胸前交叠形成斜向襟线,露出白色内衬窄边,腰间深蓝宽腰封约一掌宽";现代装示例"oversized白色卫衣(过胯,落肩宽袖),胸前无图案,下摆罗纹收口")/ 身材比例 / 肢体姿势 / 脸型轮廓 / 面部神态(肤色用具体色名:象牙白/小麦色/古铜色/深棕色/暖黄调/冷白调,不写"白""黑";**基础肤色取面部受光面**——鼻梁高光/受光侧脸颊/边缘光的色调,**禁取整体面部观感**——逆光背光面偏暗、暖调滤镜偏黄都会造成"古铜感"误判(实测:逆光图A整体观感偏深被判"古铜肤色",实际受光面与B同为暖白偏粉;受光角度不同的两人观感差≠肤色差);**多人场景先核两人受光角度是否一致**——受光角度不同导致的观感差,写真实基础肤色即可,明暗差由光影层自然处理)。**还原力精度要求:** ①肢体姿势写到**角度/手部动作/视线落点**粒度(如"侧身约30度朝画面左,右手提裙摆,视线望向画面右上"),姿势语言用 `references/知识库/02_动作行为/动作行为词库.md`;②**姿势动词≤2个/人**——复合动作(扛+斜搭+延伸类)改用道具几何锚定:接触点+道具两端相对身体方位(如"扁担中段搭右肩,前端在身前右手握持处,后端斜向身后上方延伸");③**持物/挂载物位置用相对人物的身体方位,禁用画面绝对坐标**——身体锚点(身前/身后/左肩/右腰/腿侧/右肩至背部高度等),禁写"画面左下角/右上角"(实测:扁担末端写"伸向画面左下角"导致挂载竹篮被锚定到画面边角截断;正确写法"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")。**长杆类道具最小锚点法**:扁担/伞/棍/枪等长杆类道具不能只写名称,也不能写成机械长篇几何说明;**下笔前先回答三问**:①承载方式:肩扛 / 单手握提 / 双手握提 / 落地斜靠?(看杆与身体的接触点,不默认肩扛——实测:右手手提斜杆挂篮被误判成"肩扛横杆",导致筐被画到身后、手被解放空手)②杆身长轴方向:水平 / 斜上 / 斜下 / 竖直?(看杆在画面里的实际角度,不默认横向)③挂载物落点:挂上端 / 挂中段 / 挂下端 / 杆外侧?(看筐/篮在杆上的实际位置)。三问不答完,禁止写"肩扛""横向"等默认描述。答完后最少写清4个锚点:①身体接触点(搭在哪个肩/握在哪只手/贴近哪个身体部位);②长轴方向(横向/斜横向/竖向,尽量用相对身体方向);③手部作用(扶住/握住/自然垂放,不强行摆拍展示);④挂载物归属(挂在哪一端/哪一段)。**挂载物≠背负物**:挂在道具上的篮筐、包袱、灯笼等必须写成"挂在某段道具下方、与身体背部有距离",禁止写成贴背/背在身上/背篓;挂载物位置用"身后侧扁担段下方、右肩至背部高度"这类身体相对方位,避免漂移到画面边角或贴背。**扁担专项防偏**(仅在长杆三问①承载方式=肩扛时适用;三问=单手握提时按普通长杆最小锚点法处理,不触发扁担专项):原图确认为扁担时,正向必须写"平直硬木扁担/平直木扁担",并写"中段搭在肩上,长轴横向或斜横向延伸";禁止只写"木棍/长杆",否则易变竖直手杖;禁止写"弯曲、柔软、藤条感、绳状"等会让扁担变形的词。若生成图出现木棍、竖杆、弯杆、软杆、竹筐变背篓,则只局部修道具段与对应负向词,不重写脸部/表情/场景有效锚点。**坐标系分界**:物品位置=人物段用身体坐标(物品跟着人物走,换场景/多人归属均稳定);人物站位=场景层用画面坐标("居画面中偏左略前"是构图信息,归场景层——不要矫枉过正把站位也改成身体坐标);④**微表情双轨制**——观察分析用 `references/知识库/01_主体描述/主体描述词库.md` 的微表情7区域×4级强度(保观察精度),写入提示词正文时**转译为直白可视化词**("眉弯L3+嘴大L3"→"露齿大笑"),L值标注是创作语言、文生图模型不识别;**动作状态词优先**(开怀大笑/咧嘴大笑/放声大笑/会心微笑)+ **可观察子状态**(露上牙/上排牙齿完全可见/眼睛眯成弯月);**禁几何抽象词**("嘴大张呈O形""一字眉""V形领""圆形脸"等)——模型会把"O/一字/V/圆形"字面读成几何形态,生成"惊讶圆嘴/惊讶一字眉/V领睡袍/圆饼脸"等与原图不符结果,**几何抽象词用动作状态词或具体可观察形态替代**("O形嘴"→"咧嘴大笑";"一字眉"→"眉头平直";"V形领"→"两片襟布在胸前交叠形成斜向襟线";"圆形脸"→"脸型短宽,下颌圆钝");⑤禁写"开心""温柔"这类无法执行的抽象情绪词;⑥**表情分离+前置**——多人画面各人表情分开描述禁止合并(模型对"双人一致表情"有先验,合并会被平均化),表情写入各人物块靠前位置(模型对提示词开头权重最高);**表情写法从器官量化升级为动作语境+面部协同**——先判断表情发生在什么关系里(看同伴、听人说话、边走边笑、对镜头摆拍),再按**微表情四层**写少量可见状态:①嘴部(张口/闭唇/嘴角上扬/嘴角横向打开)②脸颊(提起/放松/紧绷)③眼周(自然睁着/眼神带笑/轻微眯起/不眯成线)④情绪语境(边走边说话/听到同伴说话后忍不住笑)。禁止把表情拆成极限器官命令(如强制最大张口、强制瞪眼、强制强调瞳孔细节、强制描述唇部机械拉伸等都会触发惊吓感和AI僵硬感);优先写"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"、"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑"。**交互强度≠表情强度**——弱交互只限制不强对视/不明显转头,不代表笑意弱;闭唇笑也可以有明显笑意,必须单独写嘴角、脸颊、眼神。**眼周状态仍需观察但不做极限硬控**——模型默认先验"微笑=眯眼"会污染抿嘴笑,应用"自然睁着、眼神柔和"这类软锚点对抗,而非逼写器官细节。;⑦**脸部朝向/视线/互动强度分离**——脸部朝向=头部转向,视线落点=眼睛看向哪里,互动强度=人物关系强弱,三者必须分别观察、分别写,禁止用"看同伴/边走边聊"自动推导成"头部明显转向同伴";弱交互写法用"接近正面,眼神略偏向同伴"、"轻微朝向同伴但不形成强对视",强交互只有原图明确互相凝视时才写"对视/凝视"。**面部朝向四件套**必须同时判断:①左右朝向(鼻尖朝画面左/右/正前)②上下朝向(下巴/鼻尖平视、微抬、微低或内收)③头部倾斜(是否歪头,默认无明显歪斜不写)④视线落点(眼睛看向哪里);只写左右会丢头部姿态。⑧**脸部朝向用可见部位锚定**——正脸=五官对称居中;四分之三侧脸=完整可见一只眼+另一只部分+一只耳朵;正侧脸=一只眼+一只耳朵(如"A 四分之三侧脸朝画面右,可见右耳,右脸颊占比大"),方向词"面朝画面右前方"执行率低;**观察朝向以鼻尖朝向为唯一可靠判据**(数鼻翼两侧可见度,不是看脸型对称感——实测把"左脸颊面对镜头多一点"误读成"朝画面左",实际鼻尖朝画面右);**"四分之三侧脸"是弱执行词,模型常弱化成接近正脸**(实测:写"四分之三侧脸朝画面左+完整可见左眼+部分右眼",生成图双眼完整可见成正脸)——需按**角度档位写可见状态**量化:四分之三侧脸(约45°)="鼻尖明显朝向画面X,X侧眼完整清晰,另一侧眼因侧转明显变窄但完整可见";接近正侧脸(60°以上)="接近正侧脸朝画面X,仅X侧眼完整可见,另一侧眼完全不可见";**禁遮挡机制词("被鼻梁挡住/被遮住")与模糊量词("一线/一抹")**——机制式描述(解释为什么看不见)模型执行弱,只写看到了什么;且角度档位要自洽——"四分之三侧脸"+"仅露眼角一线"是两档角度自相矛盾(45°时远侧眼应大部分可见,仅剩眼角是60°+的形态),混写等于同时下两个角度指令模型无所适从;可见程度用直白梯度词:完整清晰/明显变窄但完整可见/仅露眼尾/完全不可见;⑨**场景统一性声明(多人画面必加)**——提示词写明"所有人物处于同一瞬间、同一光线"(**不含情绪节律**——实测"情绪节律统一"被模型读成表情趋同,导致B的闭合微笑被拉高污染),避免模型把多人拆成独立任务导致元素各自为政 **类型适配表(在事实层/关系层/神韵层三层观察底座上叠加专属栏目):** | 图片类型 | 专属叠加栏目 | |---|---| | 产品摄影/电商 | 卖点描述(质感/工艺/情绪价值,只描述可见卖点不编造功能) | | 人像摄影 | 外貌细化(种族族裔+肤色具体色名+妆容发型气质) | | 风景/自然 | 主体景观描述(地貌/植被/水体/季节天气) | | 美食摄影 | 食欲感与新鲜感描述(温度感/水分感/光影对食物质感的强化) | | 建筑/室内 | 空间结构描述(空间类型/层次纵深感/材质/陈设/风格定位) | | 海报/文字图 | 文字与版式描述(逐字转录所有可辨识文字+位置+字体风格) | | 抽象/艺术 | 主体元素+艺术风格(绘画媒介/图形类型/流派归类) | **文字转录强制要求(画面含可辨识文字即必做,不限图片类型):** 画面中所有可辨识文字逐字转录,注明位置("瓶身正面居中""右下角""T恤胸前""背景招牌")与字体风格(衬线/无衬线/手写/装饰体),不省略、不模糊、不合并、不虚构。非海报类图(人像服饰slogan、场景路牌招牌、产品包装等)同样适用。 **文字二分类(转录后决定去留):** ①内容性文字(招牌名/产品文案/海报标题/服饰slogan)→ 写入提示词正文(复刻需要);②标识性文字(水印/署名/@账号名/logo/时间戳/平台ID)→ **正向提示词零出现**(含否定式提及与说明性文字——"左下角水印只进反向词"这类描述也禁止写,正向提示词出现"水印"字样本身就有诱导生成水印的风险),只在观察报告提及+负面约束"水印"项承载。 **反向提示词(7 类,按图片类型筛选用项):** - 画面质量类:低清晰度, 模糊, 噪点, 过曝, 欠曝, 画质低劣, 分辨率不足 - 结构与比例类:透视错误, 比例错误, 主体变形, 构图杂乱, 边缘破损, 重复物体 - 材质与色彩类:材质错误, 反光混乱, 阴影错误, 色彩过饱和, 色彩发灰, 廉价质感 - 文字与标识类:文字乱码, 多余文字, 错误文字, 水印, 错误logo - 人物类(含人物时):肢体错误, 手指错误, 面部崩坏, 皮肤塑料感, 眼神异常, 多余肢体 - **AI审美污染类(含人物且原图为生活流/古典/自然人像时优先选配)**:网红脸, 现代写真脸, 现代商业写真感, 过度通透高清, 棚拍精修感, 欧式大双眼皮, 尖下巴, 高鼻梁整容感, 过大眼睛, 惊恐表情, 夸张张嘴, 僵硬笑容, 假笑, 摆拍感, 直视镜头, 游客照, 硬挺新衣, 化纤质感, 塑料感, 影楼汉服, 舞台浓烟, 干冰烟雾, 过度戏剧光 - **长杆/挂载物专项类(原图有扁担、伞、杆、挂篮等长杆+挂载物时按失败项选配)**:手持木棍, 竖直木棍, 拐杖, 竖杆道具, 白色长棍, 弯曲扁担, 弯曲木杆, 软杆, 变形杆, 藤条弯杆, 背篓, 竹筐贴背, 竹筐落地, 竹筐贴边, 挂载物截断, 道具展示感 - AI痕迹类:AI痕迹明显, 细节缺失, 不自然过渡 **反向词默认选配规则:** 画面质量+AI痕迹类必带;含人物加人物类;海报/文字图加文字标识类;产品/美食加材质色彩类;建筑/风景加结构比例类;有长杆/挂载物且生成失败时加长杆/挂载物专项类。**负向词分层精简**:按"通用质量/人脸审美污染/本图专属纠偏/风格场景误差"四层选配,不把所有历史失败无限堆叠进负向词;本图专属纠偏只针对当前图片或最近一轮真实失败项,问题消失后可下调或移除,避免负向词过重把正向主体也打散。**反脑补项**——场景观察为穷尽清单,原图未出现的**形态级**元素(山体/塔/水面/招牌等具体形态)逐项加入反向词;**概念级氛围词(远景暖光晕染/空气透视感/晨雾光感)豁免**,不进反脑补清单——它们是画面感来源;烟雾/雾气失控放大时反向词加"浓烟";**对抗项(仅原图背景虚化时加)**——背景细节过多, 景深过大(**禁用"背景清晰"**:拆词后会把"清晰"整体否定,导致全图发软)。 **目标平台适配(用户指明时按平台语法适配输出):** - **默认即梦/通用自然语言**:自然语言描述;**正向与负向提示词分开输出**(即梦有"不希望呈现的内容"独立输入框,负向词贴该框;单输入框平台在负向部分用否定句式转写如"画面中不出现…",禁止与正向词混排——混排后模型无法区分正负,"低清晰度, 模糊"会被当正向描述执行) - **Midjourney**:参数式语法(`--ar 16:9 --style raw --v 6`),负面词用 `--no` 承载 - **Stable Diffusion**:权重语法(`(word:1.3)`),6分类反向词放独立负面词框(negative prompt) - **NanoBanana**:自然语言;默认仍按正向提示词与负向提示词分开输出。若平台只支持单输入框,负向内容必须改写为自然语言否定句(如"画面中不出现…"),放在独立负向段落中,禁止裸负向词直接混排在正向文本末尾 未指明平台时按即梦/通用输出,不强行参数化。 **输出格式:** 双版本输出(均按实体聚合+全局项聚合): - **结构还原版**:保证道具、服装、场景、人物位置、持物关系不丢;适合审计硬锚点。 - **神韵优化版(默认推荐生成)**:在保留硬锚点基础上,降低人脸/表情/视线/空气感的器官级硬量化,强化人物关系、生活流语境、古典骨相、软布料、湿润空气感;适合直接喂模型生成。 人物按"每人一块全信息"组织(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;**人物画面位置不写在人物块,统一归场景层人物布局**),全局项合并为5块——场景(环境+人物布局+前中后景内容)/镜头(景别+机位+虚化+拍摄风格)/光影(光源类型+逆光入画+色调系统三段式)/画面质感(渲染规格+年代流派媒介三合一锚定)/画面风格(流派+情绪基调+画面感词),加文字/负面约束/基础属性 + 类型专属栏目。 **版本说明:** 极简版信息密度不足以承载还原约束,已废弃;但单一硬还原版会压死人脸神韵,改为"结构还原版+神韵优化版"双版本。默认把神韵优化版作为生成层主稿,结构还原版作为审计层硬锚点清单。 **双版本 × 两层输出关系:** "结构还原版/神韵优化版"是内容策略差异,"结构化版/整段版"是交付形态差异。两个版本都可按结构化版审计、再转为整段版生成;默认交付顺序为:先给结构还原版结构化审计层(核硬锚点)→再给神韵优化版整段生成层(直接用于生成)。禁止把"结构还原版"误解为"结构化版",也禁止把"神韵优化版"误解为只要整段不要审计。 **两层输出分工(审计层 vs 生成层):** 结构化版与整段版是两层产物,缺一不可: - **结构化版=审计层**:按**实体聚合**组织——**每个人物一块写完全部个体信息**(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;位置归场景层人物布局),全局项按5块聚合(场景/镜头/光影/画面质感/画面风格),供人工逐人核对——**不直接喂模型** - **整段版=生成层**:喂模型的最终提示词,与结构化版同一实体聚合结构,去掉**全局块字段标签**(【场景】【镜头】等)合并为流畅自然语言段——**人物标签(女性A/女性B)保留**,人物段以"女性A:"开头,场景段布局用**完整主体名称**绑定("女性A居画面中偏左略前,女性B居画面中偏右"——禁裸编号"A居""B居",必须与人物块标签字面完全一致)——**人物标签是跨层实体绑定锚点,剥掉后多人段落无法区分、布局与人物段断链**(实测:两段同以"脸型窄长…的年轻女性"开头,模型无从知道谁站哪边);**禁止把同一人的属性拆到多个段落**(拆散后模型要跨段拼装,归属断链——材质/颜色/道具会张冠李戴);**道具与佩戴物内联到持有者段落**;**正向与负向分开**——整段版正文只含正向提示词(人物段+场景/镜头/光影/画面质感/画面风格全局段),**负面约束独立成第二部分输出**,标识行只写"负向提示词:"五个字,**不带括号操作指引**("(贴即梦XX框)"之类的平台分发说明是技能内部知识,不写入输出——平台怎么分发由用户自行判断,规则留在"目标平台适配"节),**禁止负向词直接混排在正向文本末尾**——剥掉【负面约束】标签后模型无从区分正负,"低清晰度, 模糊"会被当作正向描述执行(实测用户抓出) - **逐件核对**:结构化版→整段版转写后,确认所有道具/佩戴物已内联到对应人物块,禁止聚合时静默丢弃(实测:竹篮在观察层被发现,却在聚合写入时丢失) - **对话展示格式**:最终提示词不用长行代码块展示(横向滚动条导致用户复制不便),以普通文本段落输出,段与段空行分隔 **画面感保护条款:** 还原导向≠无脑精确化。逐项精确(姿势/服饰/道具/虚化)的同时,**保留 1-2 处"模糊氛围词"**(如"远景暖光晕染""空气透视感""轻雾弥漫")不拆解、不量化、不进反脑补清单——过度具体化会让生成图变成"摆拍工作照",丢失"生活瞬间感"(实测:纯精确提示词生成的图还原度高但画面感弱于带氛围词的版本)。 **生成闭环复盘与有效锚点保护(多轮出图后必做):** 每轮生成图对比原图后,先列三栏再改提示词:①保留项(本轮比上一轮更接近原图的脸部、表情、朝向、道具、场景、光影、质感句);②回退项(上一轮好、本轮变差的局部);③替换项(当前明确失败的局部)。修改只动替换项所在模块,保留项原句不得因其他问题被顺手重写。尤其在修扁担/竹筐/背景时,不得误删已实测有效的面部朝向和表情锚点;在修视线/表情时,不得误伤扁担、挂载物、场景氛围锚点。 **金标锚点逐字保护(多轮出图核心机制):** 当某一轮生成图的某个局部(如 A 的面部朝向/笑容/表情)明显优于其他轮时,将该局部对应的提示词原句标记为"金标句"。金标句一经标记,后续所有轮次的提示词中该局部句子必须**逐字复制粘贴**,禁止同义改写、合并精简、拆分重组或"优化措辞"——实测:仅把"嘴角横向打开"改成"嘴角上扬"就导致笑容效果完全丢失。回退时不重新从原图反推,而是直接粘贴金标句原文。只有用户明确说"这版某处不好要改"时,才允许动对应金标句,且改后旧金标句仍需保留备查。金标句的标记范围按模块划分:A 面部块(脸型→表情→朝向→头部姿态)是一个可标记模块;B 面部块是另一个;道具块、场景块、光影块各自独立标记。标记后该模块在后续轮次中"冻结",非用户明确要求不得解冻。 **非看镜头/人物交互专项(人像多人图必做):** 判断人物是否看镜头、谁看谁、是否同行/闲聊/经过镜头、表情是否回应对方。若原图是生活流抓拍,提示词必须写"非看镜头"、"边走边聊"、"自然经过镜头前"、"动作不是摆拍展示道具"等关系语境;负向词加入"直视镜头/游客照/摆拍感/网红写真"。视线落点是人物关系信息,不得省略为泛泛"望向前方"。 **视线词高风险规则:** 视线是软锚点,高于普通表情词风险。"视线越过镜头右侧"可能减少直视镜头,也可能让模型误读为看镜头外展示;"视线轻轻落向同伴/含笑回应"容易把弱交互放大成互相凝视。处理多人弱交互时,优先写头部朝向与表情语境,视线只写低强度词(如"眼神略偏""不直视镜头"),慎写精确落点;只有原图明确看向某人时才写"看向同伴"。若某一版面部朝向/神态已经实测更接近原图,后续不得把该面部句泛化替换为未经验证的新视线句。 **视线词与交互强度匹配表(写下视线前先查表):** | 交互强度 | 视线写法 | 禁止写法 | |---|---|---| | 强交互 | "看向女性A,目光落在她脸上" | 禁止弱化为"略偏向"——原图明确看人就不能写弱 | | 中交互 | "脸朝女性A方向,目光大致落在她肩颈区域" | 禁止写"凝视/深情注视"——会升级成强对视 | | 弱交互 | "眼神略偏,不直视镜头" | 禁止写具体落点("看向A/落向A")——会把弱放大成强 | | 无交互 | "目光朝前方" | 禁止写"看向同伴" | 交互强度判错时,先回到交互强度判定(无/弱/中/强),不直接调视线词——先定强度,再查表选视线写法。 **美学自检(输出前必做):** 字段检查通过不代表图会好看。输出前必须自问:人物像活人吗?是否出现网红脸/尖下巴/过大眼睛/高鼻梁整容感?表情是否惊吓、假笑或僵硬?人物是否不该看镜头却直视镜头?衣服是否硬挺新衣/塑料感/影楼汉服?雾气是否变干冰浓烟?若任一命中,降低人脸与表情的器官级量化,改用神态语境、古典骨相、软布料、湿润空气感与审美负向词。 **结构化版格式模板(人物按实体聚合每人一块+全局项5块聚合,每人一块内按聚合清单顺序写——分行是硬性格式,禁止合并单行;关键还原项前置(人物表情/服装/朝向/虚化),背景细节后置——模型对提示词开头权重最高。**输出产物禁带元规则标注**——"(穷尽清单)""(前置)""(画面感保护词)"等括号注记不写入观察报告/结构化版/整段版,规则术语只留在本技能文件,输出层用自然语言。**全局项禁止跨字段重复**——同一信息只在一处写,如虚化只写镜头层、色调只写光影层、人物画面位置只写场景层):** > **人物标签=性别+角色编号**(如"女性A""女性B",单人时直接"人物"),禁止用裸编号"A""B"——脱离上下文无法辨认是谁;**标签不带画面位置**——位置是关系性信息,归场景层,标签重复写会冗余:[基础(脸型+肤色——**肤色取面部受光面色调,不取逆光/暖调下的整体观感**;易漂移色名加锚定如"灰白≈浅亚麻/不含蓝调")→表情(**动作语境+面部协同**:先写"看同伴/听人说话/边走边笑/非看镜头"等关系语境,再写少量可见状态;禁极限张口、强制瞪眼、强制强调瞳孔细节、机械唇部拉伸等器官命令;推荐"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"或"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑",多人分离描述;弱交互不等于弱表情,闭唇笑也要写清笑意强度)→发型与佩戴物(簪/耳饰)→服装含材质(外层品类+颜色+衣长+袖型+内层可见+腰部如有+材质内联如"亚麻粗织感";**汉服专有品类加形态锚定**——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定"搭肩/双手拎两端"兜底可不加)→朝向(**面部朝向四件套+可见部位锚定+角度档位自洽**:①左右朝向看鼻尖朝画面左/右/正前;②上下朝向看下巴/鼻尖平视、微抬、微低或内收;③头部倾斜看是否歪头,无明显歪斜不写;④视线落点看眼睛看向哪里。四分之三侧脸=完整一只眼+另一只**变窄但完整可见**+一只耳朵("鼻尖明显朝向画面左,左眼完整清晰,右眼因侧转明显变窄但完整可见");接近正侧脸=仅一只眼完整可见+另一只完全不可见——**禁遮挡机制词("被鼻梁挡住")与模糊量词("一线")**,只写可见状态;"四分之三侧脸"单独写会被弱化成正脸,可见部位量化才锁得住;非人物用角度锚定正对/45度/正侧面)→姿势动作→持物(名称+材质+接触点+**两端相对身体方位**,无则省略;**道具上挂载的其他物品(如扁担上挂的竹篮)随道具一起写,且独立写明相对身体方位**(如"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")——挂载物单独留在观察层会在聚合时静默丢失(实测竹篮两次被丢);挂载物不写独立位置会跟随道具末端漂移到画面边角被截断(实测第四轮竹篮只剩边角1/3))→视线落点]|场景:[环境类型+空间特征+**人物布局**(**用完整主体名称**(女性A/女性B)写每人画面位置+前后关系+间距——与人物块标签字面完全一致,禁裸编号A/B;多人加"同一瞬间、同一光线"——不含情绪节律,防表情趋同污染)+前中后景三层逐层列各层陈设(**只写"有什么",不写虚化**——虚化属镜头层;未出现的大类元素直接进负面约束)]|镜头:[景别+机位+虚化**结果转译**:原图有虚化写"背景虚化成柔和色块,仅可辨认轮廓剪影"(**用"虚化"不用"模糊"**——负面约束含"模糊",正向出现会与之打架、弱化景深执行);原图全清晰写"全画面清晰锐利,前后景均无虚化"——**禁写焦段/光圈参数(如85mm、f值)与"浅景深"等参数化术语**,虚化结果句已承载全部景深信息,重复写参数反而引入不确定性+**拍摄风格子项**(原图可辨的静态执行项):POV主观视角/手持拍摄感/俯拍仰拍等;**晃动感/呼吸感/跟拍节奏等动态词仅视频提示词用,静帧反推不写**]|光影:[**光源类型先行**(自然光为主/单一人工光源/混合光)+方向+行为;强方向光**逆光入画**:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"+**色调系统三段式**:饱和度(低饱和度/正常饱和度)+色相(如"冷灰偏旧""整体暖黄调")+胶片类型(如"复古胶片色调""暖调胶片模拟")——完整示例"低饱和度,冷灰偏旧的复古胶片色调"或"整体暖黄调,背景暖褐暖灰"(具体色名留在各实体内联处不重复);**渲染术语禁写**——"体积光"是CGI术语,直白写"光柱清晰可见";**画面现象的位置词需明确参照**——"光柱在画面左侧"(明确写"画面左侧"),禁裸写"左侧"(人物左还是画面左歧义)]|画面质感:[**渲染规格+质感风格锚定**——这是独立于"风格流派"的渲染指令层:①渲染规格(8K高清/微颗粒胶片感/非完美锐度/轻微色差/暗部细节保留/HDR等,**这些是输出规格词模型可识别,与禁写的"输入参数"85mm/f值不同**)②质感风格锚定("纪录片摄影风格""胶片模拟""柔光片效果"等——**年代+流派+媒介三合一锚定执行率最高**,如"2010年代初纪录片式胶片摄影"(年代+流派+媒介一句写全)比泛词"电影感"强,后者会落到好莱坞大片先验)③反向词冲突审查("非完美锐度"避开反向"低清晰度"、"轻微色差"避开反向"画质低劣"的语义场——写前核对)④**电影截图感防商业写真化**:若原图是电影截图/剧照/生活流古装片段,应写"电影截图感、低饱和暖灰胶片色调、边缘略柔、非完美锐度、背景压缩虚化、生活流抓拍",并在负向词加入"现代商业写真感、过度通透高清、棚拍精修感",避免生成过干净的商业人像]|画面风格:[**流派定位+情绪基调**——风格名(如"古风写实人像";写实类可加执行词"写实真人风格""生活流表演")+情绪(如"欢快温暖的生活瞬间";氛围词用"轻X氛围"句式如"轻压抑氛围""轻怀旧氛围"比直写"压抑"可控)+符号内涵+**画面感保护词**(保留1-2处模糊氛围词如"远景暖光晕染""晨雾光感"不拆解不量化);**禁写画质/渲染词**(8K/颗粒/HDR归画面质感层,色调归光影层——旧"全局性质感"已迁出至画面质感字段)]|文字:[仅内容性文字转录+位置+字体;**无内容性文字时省略整个字段**——标识性文字在正向提示词零出现,相关排除项由负面约束承载]|负面约束:[6分类筛选项+反脑补项(原图未出现的大类元素如山/塔/水面)+**对抗项(仅原图背景虚化时加):背景细节过多, 景深过大**+文字与标识类排除项;**反向词正向零出现核对(输出后必做)**——逐项核对每个反向词(含其作为子串/否定式提及/说明性文字)是否在正向提示词任何位置出现过,出现即改正向措辞(如正向写背景虚化用"虚化/朦胧"避开反向词"模糊";反向"模糊"与正向"中景人影模糊"打架会弱化景深执行——实测第三轮虚化失效的嫌疑原因之一)]|基础属性:[画幅比](即梦平台UI设置不写入提示词;Midjourney 用 `--ar`) **多图模式(同主体多角度/多张图反推,衔接 F3 角色卡):** 提取共通主体描述(多图高置信交集)+ 各图差异项(姿态/光线/景别/角度);冲突项标注"图A/B不一致"由用户裁定。输出可直接喂 F3 角色卡的一致性主体锚定 + 差异镜头库。 **风格反推双轨输出(艺术风格维度专用):** 风格维度同时输出「风格命名」(人类可读,如"韦斯·安德森式对称构图")+「参数化描述」(去名化、可直接用于生成,规则见 `references/知识库/15_视觉风格/视觉风格词库.md` 去名化使用规范);命名与描述均标注置信度。 **注意:** 不声称还原图片原始隐藏参数,说明这是对画面的实用重构。 **还原路径指引(输出后主动告知用户,按用途分流):** - **100% 复刻原片** → 走图生图/垫图(把原图作为参考图喂给平台),F1 提示词仅作辅助约束;纯文生图无法逐像素复刻 - **改图/延展(同构图换元素)** → 文生图直接使用本提示词,改动目标字段即可 - **学图(提炼风格/结构复用)** → F1 提示词 + 第 6 步变量提炼,替换变量生成同风格新图 **详细方法论(观察维度→词库语言对照):** - 人物专项+微表情7区域拼乐高+反AI假脸四大陷阱:`references/知识库/01_主体描述/主体描述词库.md` - 姿势粒度语言(三层动作分级+运动强度修饰词,肢体姿势/手部/视线落点写法):`references/知识库/02_动作行为/动作行为词库.md` - 光影布光(光影三层:光源层/光行为层/色调层+常用灯光组合速查;强方向光用逆光入画写法——"光从人物背后X上方射入,发丝边缘发光(rim light glow)"):`references/知识库/07_光线时间/光线时间词库.md` - 色彩色调(冷暖色调六套预设+后期处理词+张力宣言):`references/知识库/09_色彩后期/色彩后期词库.md` - 构图透视+机位+**前中后景三层布置+画面坐标方位**(极简先锋五法则+构图几何词库+构图模板):`references/知识库/14_构图布局/构图布局词库.md` - 镜头焦距+光圈推断+**X轴朝向+画面坐标规则**(四维编码Y/X轴+摄影器材英文参数6.1):`references/知识库/06_焦距视角/焦距视角词库.md` + `references/知识库/10_后期细节/后期细节词库.md` - 场景模板与特效词(21类垂直场景+丁达尔/体积光,可选):`references/知识库/03_场景描述/场景描述词库.md` + `references/知识库/11_特效渲染/特效渲染词库.md` - 纹理材质+画质质感(有机瑕疵+反塑料感套装+摄影质感维度表):`references/知识库/10_后期细节/后期细节词库.md` + `references/知识库/12_画质分辨率/画质分辨率词库.md`(反塑料感宣言+胶片型号) - 视觉风格反推(28+导演风格去名化规范+国际大师/中国影视/新媒体/特殊四类风格库):`references/知识库/15_视觉风格/视觉风格词库.md` --- ### F2. 反推视频提示词 **适用场景:** - 用户上传图片要求"用这张图做视频""图生视频""根据图片生成视频" - 用户上传视频要求"分析这个视频的提示词""反推视频提示词" - "这张图怎么做成视频""图生视频提示词" **处理流程(5步工作流 + 两轮交互):** F2 在 5 步工作流框架内执行,其中步骤 2-3 包含两轮用户交互: | 步骤 | 名称 | F2 执行内容 | 交互 | |:---:|:---|:---|:---| | 1 | 需求解析 | 确认时长/比例/生成模式/风格/素材;能推理的不追问 | — | | 2 | 视觉诊断 | 读图/读视频→主体/氛围/最有戏元素/画质来源/4层退化策略/建议时长/比例诊断/平台合规风险 → 给出 2 个 Hook 候选(反应/凝视) | **第1轮:用户选定 Hook** | | 3 | 提示词构建 | 用户选定后,按基础六要素公式输出完整提示词(凝视/反应模式对应不同模板),一镜一动 | **第2轮:输出提示词** | | 4 | 强制校验 | 8 项校验规则逐条检查,有 error 必重写 | — | | 5 | 专业交付 | 代码块包裹提示词 + 主题 + 导演阐述 | — | > 5 步工作流详见下方「视频提示词工作流」节。两轮交互模式与 Hook 候选(反应/凝视)见 `references/制作流程/图生视频与分镜板制作流程.md` 路径C 双范式。 **核心约束:** - Seedance prompt 上限 2000 字符(Python `len()` 实测,平台接受上限);**品质最优区间 ≤500 字符**(超出导致模型注意力崩溃,详见下方冲突说明) - 版权敏感词必扫(5 条铁律:禁夜场BGM词/不凑齐夜场环境4元素/删涉灰场景词/多人场景用静态全景机位/禁人物×道具物理交互) - 运镜四维编码系统(Z/Y/X/F) - 前 2 秒生死线 > **⚠️ 字符限制冲突说明:** seedance2.0-prompt-skill 实测平台接受上限 2000 字符;Seedance2.0-ShotDesign v2.0 官方规范建议 ≤500 字符(中文)/ ≤1000 词(英文),品质最优区间 60-100 词(中文约 120-200 字符)。**以 500 字符为品质基准,2000 字符为硬性上限。** **详细方法论:** - 6步总流程+路径分流+6层结构(主体/画面质感/色调光影/设定/镜头叙事/负面词,视觉基调前置,11字段降为内部思考清单)+时长速查:`references/制作流程/分镜提示词制作流程.md` **详细方法论:** - 路径C双范式(反应/凝视)+11条核心原则+版权审查SOP:`references/制作流程/图生视频与分镜板制作流程.md` - 四维编码(Z景别/Y高度/X方位/F滤镜):`references/知识库/04_镜头类型/镜头景别词库.md` + `references/知识库/06_焦距视角/焦距视角词库.md` - 运镜安全写法+运动强度分级:`references/知识库/05_运镜方式/运镜方式词库.md` - 光影三层+品质锚定+反塑料感:`references/知识库/07_光线时间/光线时间词库.md` + `references/知识库/12_画质分辨率/画质分辨率词库.md` --- ### F3. 生成图片提示词 **适用场景:** - 用户提供一句话、关键词、草稿、半成品提示词 - "帮我写生图提示词""优化提示词""扩写提示词""变高级""结构化" - 视频生产前置:角色参考图、首帧图、关键帧图 **处理流程:** 1. 识别主体和目标图像类型 2. 补充必要维度:主体细节、场景、风格、构图、光影、色彩、材质、情绪、技术质量、画幅比例 3. 判断复杂度级别(极简/平衡/结构化) 4. 先输出可复制结果,再补充变量和建议 **复杂度分级:** | 级别 | 适用场景 | 格式 | |:---:|:---|:---| | Level 1 极简版 | 快速试图、不喜欢复杂结构 | `[主体],[核心风格],[场景/构图],[光影/氛围],[质量收尾]` | | Level 2 平衡版(默认) | 大多数用户 | `[主体+特征],[环境],[动作],[构图/镜头],[光影],[色彩],[风格],[质量],[画幅比]` | | Level 3 结构化版 | 模板化、商业级、可复用 | 分维度展开:主体/场景/构图/光影/色彩/风格/细节/质量/负面约束 | **图片类型:** - 角色参考图(9:16 竖版)— 视频生产前置步骤 - 首帧图(与视频画幅比一致) - 产品摄影、概念艺术、杂志封面等通用类型 **详细规范:** - 角色卡(10段结构)+首帧图+一致性锁定:`references/制作流程/长视频分段制作流程.md` - 材质质感库+反塑料感宣言+胶片型号+有机瑕疵:`references/知识库/10_后期细节/后期细节词库.md` + `references/知识库/12_画质分辨率/画质分辨率词库.md` - 导演风格参数化映射(28+风格去名化+四轴降解):`references/知识库/15_视觉风格/视觉风格词库.md` --- ### F4. 生成分镜提示词 **适用场景:** - 用户提供脚本/分镜板,要求"按分镜生成""拆分镜""分镜提示词" - 长视频(>15秒)需走完整前期制作流程 - 用户上传 N 宫格分镜板/漫画分镜 **前置:剧本分析(Step 1,必做)** 进入路径分流前,先完成剧本类型判定(A叙事剧情/B单人Vlog/C旁白知识/D产品展示/E纯氛围)+ 维度拆解(①节奏全类型必做,②-⑤按类型选做),产出驱动后续路径选择、景别设计、微表情弧线、台词语气修饰、6层格式适配。详见 `references/制作流程/分镜提示词制作流程.md` Step 1。 **处理流程(按路径分流):** | 路径 | 触发条件 | 核心任务 | |:---:|:---|:---| | A — ≤15秒单段 | 纯文字描述,无图片 | 找到单一视觉 hook,生成 2-3 个版本 | | B — >15秒长视频 | 需叙事/多镜头 | 走生产流水线:角色设计→角色卡片图→分镜脚本→分镜参考图→逐镜头提示词+剪辑方案 | | D — 分镜板驱动 | 上传 N 宫格分镜板 | 拆解多格→D-1(≤4格单条多段)/D-2(≥5格多条独立)→输出 prompt+剪辑节奏建议 | **输出格式:** F4 输出 = 主题 + 导演阐述 + 完整提示词(代码块包裹)。多镜头序列附过渡策略。 > 完整输出模板(基础结构/时间戳分段/时长服从内容/极简优先铁律)见 `references/制作流程/分镜提示词制作流程.md`。 **单段(路径 A,≤15s):** 主题 + 导演阐述 + 单块代码块提示词 提示词内部结构(6层结构,按类型适配):`①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先)→ ②画面质感(视觉风格+摄影质感参数,视觉基调前置)→ ③色调光影(光源+主光方向+亮暗区+色调/色温,1句)→ ④设定(人物逐人必写不可遗漏/场景/构图,每项1句,按类型取舍)→ ⑤镜头叙事(每镜头1段流畅描述:机位/景别/朝向+动作/变化+运镜嵌在动作中+有台词时带语气)→ ⑥负面提示词(放最后,3.3标准模板)`;**站位/构图边界**:构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写,词库03_场景描述·演员调度) > 11字段(一致性锚定/类型质感/人物设定/场景/景深对焦/摄影质感/表演幅度/背景动态/镜头空间/表演指令/负面词)降为**构建时内部思考清单**,不作为输出字段标签。详见制作流程第三节 3.2。 >5s 使用时间戳分段;≤5s 可用单段描述。 **史诗/大制作(可选,科幻/灾难/奇幻等高品质视觉):** 追加品质锚定(渲染引擎+VFX等级)+ 大气连贯声明 + 收束句 **多段分镜(路径 B,>15s):** 主题 + 总时长 + 过渡策略 + N 个独立分镜(每段≤15s,各含完整提示词代码块) **分镜板(路径 D):** D-1(≤4格)单条多段 / D-2(≥5格)多条独立提示词;格间关系三分类与决策见 `references/制作流程/图生视频与分镜板制作流程.md` > 时长、比例、分辨率在即梦平台 UI 底部控制栏设置,提示词中不重复指定。 **剪辑节奏公式(>15秒必选):** 呼吸式 / 心跳式 / 海浪式 / 子弹时间 / 脉冲式 / 静默锤击 **详细方法论:** - 创意策略+6步总流程+路径分流+6层结构(主体/画面质感/色调光影/设定/镜头叙事/负面词,视觉基调前置,11字段降为内部思考清单)+标准负面词:`references/制作流程/分镜提示词制作流程.md` - 长视频策略+生产流水线(25格聚合矩阵+节奏曲线+景别曲线+P0/P1/P2优先级):`references/制作流程/长视频分段制作流程.md` - 分镜板驱动(路径D格间关系三分类+三层动作分级):`references/制作流程/图生视频与分镜板制作流程.md` - 剪辑节奏(六大节奏公式+AI素材专属5对策+9步工作流):`references/制作流程/多镜头剪辑节奏流程.md` - **垂直场景模板(21类场景清单+演员调度三要素+过渡策略6种)**:`references/知识库/03_场景描述/场景描述词库.md` - **微表情系统(面部7区域+4级强度+情绪弧线编排,表演密集镜头专用)**:`references/知识库/01_主体描述/主体描述词库.md` - **音频与音效标签规范(空间声学+材质拟声+音色控制)**:`references/知识库/13_音效音频/音效音频词库.md` --- ## 触发条件 当用户表达以下意图时,加载并使用本技能: **F1 反推图片提示词:** - "反推提示词""看图写提示词""图生文""img2prompt" - 上传图片 + "帮我写提示词" **F2 反推视频提示词:** - "图生视频""根据图片生成视频""这张图怎么做成视频" - "反推视频提示词""分析这个视频的提示词" - 上传图片/视频 + "做成视频" **F3 生成图片提示词:** - "帮我写生图提示词""优化提示词""扩写提示词" - "角色参考图""首帧图""关键帧图""生成角色卡提示词" **F4 生成分镜提示词:** - "拆分镜""分镜提示词""按分镜生成""逐镜头提示词" - 上传 N 宫格分镜板 + "按这几格生成" - "长视频提示词""超长视频" **通用触发词:** 运镜、景别、机位、推拉摇移、四维编码、Z轴、Y轴、X轴、剪辑节奏、剪辑公式、25格、分镜流水线、美学约束、Octane渲染、冷暖色调、赛博霓虹、dreamina、即梦、Seedance、图生视频 --- ## 提示词维度 扩写或反推时,从以下维度中选择必要项,不机械塞满所有维度。各维度由知识库15维度文件覆盖: | 维度 | 说明 | 知识库位置 | |:---|:---|:---| | 主体描述 | 人/物/场景,含外貌细节与微表情 | `知识库/01_主体描述` | | 动作/行为 | 主体动作、姿势、互动 | `知识库/02_动作行为` | | 场景描述 | 背景、环境、时间、天气 | `知识库/03_场景描述` | | 镜头类型 | 景别(特写→远景) | `知识库/04_镜头类型` + 四维编码 Z 轴 | | 运镜方式 | 摄像机运动方式与节奏 | `知识库/05_运镜方式` + 四维编码运动维度 | | 焦距/视角 | 镜头焦段、拍摄角度 | `知识库/06_焦距视角` + 四维编码 Y/X/F 轴 | | 光线/时间 | 光源类型、方向、强弱 | `知识库/07_光线时间`(光影三层-光源层) | | 氛围/天气 | 情绪氛围、天气条件 | `知识库/08_氛围天气` | | 色彩风格/后期处理 | 调色、滤镜、电影质感 | `知识库/09_色彩后期`(光影三层-色调层 + 冷暖色调) | | 后期细节 | 磨皮、锐化、运动模糊、胶片颗粒 | `知识库/10_后期细节`(有机瑕疵) | | 特效/渲染 | 光效、散景、粒子、GI/SSS/体积光 | `知识库/11_特效渲染`(深度美学约束) | | 画质/分辨率 | 输出规格 | ⚠️ `知识库/12_画质分辨率`(平台 UI 设置,非提示词废话词;反塑料感宣言) | | 音效/音频 | 空间声学、材质拟声、音色控制 | `知识库/13_音效音频`(视频提示词 `音效:` 行专用) | | 构图/画面布局 | 构图法则、版式、画面布局 | `知识库/14_构图布局`(极简先锋构图法则) | | 视觉风格 | 导演风格参数化映射 + 艺术流派/渲染风格 | `知识库/15_视觉风格`(28+风格去名化) | > 完整维度候选词见 `references/知识库/` 各维度文件:镜头景别→`04_镜头类型/镜头景别词库.md`、运镜→`05_运镜方式/运镜方式词库.md`、焦距视角/四维编码→`06_焦距视角/焦距视角词库.md`、光影→`07_光线时间/光线时间词库.md`、有机瑕疵/反塑料感→`10_后期细节/后期细节词库.md`、胶片型号/画质→`12_画质分辨率/画质分辨率词库.md`、音效→`13_音效音频/音效音频词库.md`、构图→`14_构图布局/构图布局词库.md`、导演风格→`15_视觉风格/视觉风格词库.md`。F1/F3 图片提示词维度体系同上,不另设来源。 --- ## 运镜四维编码系统 一个完整镜头 = [Z 距离] + [Y 高度] + [X 方位] + [F 滤镜] + [运动] + [节奏] + [约束] > 完整编码表(Z1-Z9 景别/Y1-Y7 高度/X1-X4 方位/F 滤镜)、默认参数、焦段心理学见 `references/知识库/06_焦距视角/焦距视角词库.md`(Z 轴全表另见 `04_镜头类型/镜头景别词库.md`,运镜词库见 `05_运镜方式/运镜方式词库.md`)。 **两条铁律(强制):** 1. 每个镜头最多双轴运动,三轴同时变化 = 失控 2. Z1-Z3(近距)+ X 轴大幅旋转 = 崩脸陷阱,近景环绕应换 Z4+ 或减小旋转幅度 --- ## 变量规则 只有当用户需要复用、替换、选择或做模板时才使用变量(`{{variable_name}}`)。变量分类(character/item/action/location/visual/technical/other)、内联默认值、候选词组规则在本节内建。 --- ## 深度美学约束(商业级/电影级) 当项目要求商业级/电影级品质时,在基础结构之上叠加深度美学约束(渲染标准 GI/SSS/焦散/体积光、冷暖色调对比系统、极简先锋构图法则)。 > 渲染标准(GI/SSS/焦散/体积光)见 `references/知识库/11_特效渲染/特效渲染词库.md`;6 套冷暖色调 HEX 预设见 `references/知识库/09_色彩后期/色彩后期词库.md`;极简先锋构图法则见 `references/知识库/14_构图布局/构图布局词库.md`。 > 注意:3A 游戏风格图片(如"黑神话"系列)prompt 越短越有效,不要堆砌技术参数。 --- ## 视频提示词工作流(Seedance2.0-ShotDesign v2.0) > 详见 `references/制作流程/分镜提示词制作流程.md`(6步总流程+路径分流表+极简优先铁律)。本章节为 F2/F4 视频提示词的核心方法论框架。 ### F2 视频提示词工作流(5步) > F2(反推视频提示词)使用此5步工作流。F4(生成分镜提示词)在此基础上前置 Step 1 剧本分析,变为6步(详见 `references/制作流程/分镜提示词制作流程.md`)。 收到视频提示词需求后,严格按顺序执行: | 步骤 | 名称 | 核心任务 | |:---:|:---|:---| | 1 | 需求解析与参数确认 | 确认时长/比例/生成模式/风格/素材;智能推理原则——能推理的不追问,追问控制在 1-2 个问题内 | | 2 | 视觉诊断与分镜构思 | 三层知识库路由加载参考→构思分镜草案→选定导演风格与视觉方案 | | 3 | 提示词构建 | 按6层结构撰写提示词(按类型适配选层;构建时用11字段思考清单内部过目),时间轴分镜,一镜一动 | | 4 | 强制自我校验 | 8 项校验规则逐条检查,有 error 必重写,全部通过才可交付 | | 5 | 专业交付 | 主题+导演阐述+完整提示词(代码块包裹),多段分镜附过渡策略 | > **F2 的交互差异:** F2 在步骤 2-3 插入两轮用户交互(选定 Hook → 输出提示词)。F4 在步骤 2 根据路径分流(A≤15s/B>15s/D分镜板),步骤 3 按场次逐镜头组装,步骤 5 同时输出分镜表格和提示词序列。 ### 三层知识库路由 > 路由原则(以 `references/知识库/` 15 维度目录为路由目标):镜头类维度(04_镜头类型/05_运镜方式/06_焦距视角)+ 品质类维度(10_后期细节/12_画质分辨率)始终加载;其余维度(主体微表情/场景/光影/音效/风格等)按需求语义加载;用户显式指定维度时直接加载对应词库。核心原则:宁可多读不可少读。运行时 `references-add/知识库/` 同维度内容优先于 `references/知识库/`。 ### 提示词模板 > 详见 `references/制作流程/分镜提示词制作流程.md` 第三节:3.1 基础六要素(构建思考参考)+ 3.2 6层结构(输出格式,含11字段内部思考清单 3.2.1 + 6层式输出 3.2.2含类型适配表,负面词放最后)+ 3.3 标准负面词模板。 6层结构按Step 1类型判定适配:①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先)+ ②画面质感(视觉风格+摄影质感参数,视觉基调前置)+ ③色调光影(光源+主光方向+亮暗区+色调/色温,1句)+ ④设定(人物/场景/构图,每项1句,按类型取舍)+ ⑤镜头叙事(每镜头1段流畅描述,朝向必须写明,连续动作不拆,有台词时带语气)+ ⑥负面提示词(放最后,3.3标准模板)。构建时用11字段思考清单内部过目确保不遗漏(一致性锚定/类型质感/人物设定/场景/景深对焦/摄影质感/表演幅度/背景动态/镜头空间/表演指令/负面词),但最终输出不出现字段标签。 ### 光影三层结构 > 详见 `references/知识库/07_光线时间/光线时间词库.md`(光源层6类+光行为层9种+色调层8公式+灯光Recipes)。 ``` 光影:[光源词](光源层),[光行为词](光行为层),[色调公式](色调层)。 ``` 缺失任何一层视为不合格。从光线时间词库选取具体词汇填入。 > ⚠️ **冲突说明:** seedance2.0-prompt-skill 将光影三层视为史诗/大制作结构的**可选高级技巧**;Seedance2.0-ShotDesign v2.0 将其作为**每条视频提示词的强制规范**。本技能以 ShotDesign 强制规范为准。对于极简概念片(4-8s、无复杂光影需求),可使用简化光影描述但须包含三层基本要素。 ### 微表情系统(表演密集镜头专用) > 7 区域分区词库(眼/眉/唇/鼻/颌喉/额/面颊)、4 级强度体系(L1-L4,默认 L2 内敛)、2 秒精度情绪弧线编排、反 AI 假脸三黄金准则见 `references/知识库/01_主体描述/主体描述词库.md`。 ### 导演风格参数化映射 > 28+ 风格库(国际大师9位/中国影视4类/新媒体7类/特殊6类,每位含可直接嵌入的安全提示词)见 `references/知识库/15_视觉风格/视觉风格词库.md`。 **去名化规范(强制):** 最终提示词严禁出现导演名/IP名,必须降解为四轴物理参数(色彩/灯光/美术/机位),使用"安全提示词"行。 --- ## 核心规则 > 综合两大参考技能+1个2.5时间测算参考的最佳实践提炼,执行以本节为准。流程级规则详见 `references/制作流程/分镜提示词制作流程.md`。 **平台与合规:** 1. **提示词语言跟随用户**——中文用户→中文提示词,非中文用户→英文提示词(Seedance2.0-ShotDesign v2.0 双语自动检测) > ⚠️ **冲突说明:** seedance2.0-prompt-skill 规则 #1 要求"所有提示词必须使用中文"。本技能以 ShotDesign 双语规则为准——中文用户输出中文,非中文用户输出英文。加载 seedance2.0 参考技能时,其全中文规则仅适用于中文用户场景。 2. **@引用使用对应语言命名**:中文 `@图片1`,英文 `@Image1` 3. **不得包含写实真人面部素材** — 平台会自动拦截,建议面部模糊或转 3D/动画风格 4. **混合文件上限 12 个**(图片≤9+视频≤3+音频≤3) 5. **单次生成上限 15 秒**,超出需分段拼接(>15s 自动分段,每段≤15s,最短≥8s) **品质与长度:** 6. **提示词品质上限 ≤500 字符(中文)/ ≤1000 词(英文)**,最优区间 60-100 词(中文约 120-200 字符);平台硬性接受上限 ~2000 字符 7. **禁止废话词**——"杰作/4k/8k/超清晰/masterpiece/ultra HD" 等,用物理材质词替代(反塑料感宣言) 8. **具体优于模糊**——"穿红色风衣的女子在霓虹雨夜奔跑" >> "一个女人走路" **运镜与动作:** 9. **运镜术语消歧义**——中文用中文运镜词(推轨推进/航拍/摇臂升降),英文用完整短语(`dolly tracking shot`),禁止裸写 Dolly/Aerial/Crane/Pan/Arc/Dutch > ⚠️ **冲突说明:** seedance2.0-prompt-skill 的示例中大量混合中英文运镜词(如"Aerial大远景俯拍""Slow Crane Down""Smooth Orbit")。参考其案例时,**必须将示例中的裸英文运镜词转换为消歧义后的安全写法**(中文用中文运镜词,英文用完整短语),不可直接复制。 10. **一镜一动**——每个时间切片只指定一个运镜动作,主体运动和镜头运动分离描述(Seedance2.0-ShotDesign v2.0 新增) 11. **运动强度明确化**——使用具体修饰词(猛烈/渐进/丝滑/explosive/gradual/smooth),避免"糊动" **图生视频与叙事:** 12. **I2V 只写变化**——图生视频时不重复首帧已有内容,用 `保留原始构图和色彩` 锁定一致性 13. **描述性优于叙事性**——只写镜头看到的(视觉词),不写角色感受的(情绪词);情绪必须转化为可视化身体表现 14. **微表情克制原则**——按需触发+强度分级,默认 L2(内敛/可读),每切片表情描写不超过 40% **图片提示词:** 15. **不做机械直译**,英文提示词应使用图像模型常见表达 16. **画幅比已声明**,末尾有禁止项声明 --- ## 质量自检清单 > 综合 seedance2.0-prompt-skill 质量自检 + Seedance2.0-ShotDesign 8项强制校验规则。 > **⛔ 硬性规则:未通过校验的提示词禁止向用户展示。** **8项强制校验规则(视频提示词,Seedance2.0-ShotDesign v2.0):** - [ ] ① 长度检查:中文≤500字符 / 英文≤1000词(85%-100%为warning) - [ ] ② 时间切片检查:>5秒视频必须使用时间戳分镜,起点从0开始,无重叠,末端匹配 - [ ] ③ 运镜专业度:至少包含1个专业运镜术语(缺失=监控探头感) - [ ] ④ 废话词拦截:杰作/超清晰/masterpiece=硬阻断;4k/8k=软警告 - [ ] ⑤ 资产引用限制:图片≤9、视频≤3、音频≤3、混合≤12 - [ ] ⑥ 冲突检测:运动冲突(快速+慢动作)、光学冲突(超广角+浅景深)、风格冲突(IMAX vs VHS 等) - [ ] ⑦ 裸英文运镜词检测:Dolly/Aerial/Crane/Pan/Arc/Dutch/Steadicam → 中文或完整短语 - [ ] ⑧ 结构完整性:核心层(主体+负面词+镜头叙事)必须存在,②画面质感/③色调光影全类型必用,④设定按类型取舍(A/B全用/C人物可选/D/E人物省略,详见制作流程第三节 3.2.2 类型适配表) **通用:** - [ ] 提示词有清晰主体 - [ ] 输出复杂度符合用户需求 - [ ] 风格词和技术词有用而非堆砌 **视频提示词:** - [ ] @引用编号与素材清单一一对应 - [ ] 总文件数 ≤ 12 - [ ] 时间戳分镜覆盖完整时长 - [ ] 运镜坐标合规(无双轴以上同时运动) - [ ] 总字符数 ≤2000(Python `len()` 实测,品质基准 ≤500) - [ ] 版权敏感词已扫(5 条铁律) - [ ] 一镜一动(每切片单一运镜动作) - [ ] 光影三层结构完整(光源层+光行为层+色调层) - [ ] 音效行以 `音效:` 开头,禁止项行使用标准内容 - [ ] 输出语言与用户输入语言匹配 **图片提示词:** - [ ] 画幅比已声明 - [ ] 人种特征与主题一致 - [ ] 末尾有禁止项声明 - [ ] 全部中文(NanoBanana/即梦)或自然英文(MJ/SD) --- ## 文件目录结构 ### 一、技能文件目录(Skill 根目录) ``` 提示词生成工具/ ← Skill 根目录 ├── SKILL.md ← 技能入口文件(本文件) │ ├── 参考skills/ ← 知识库(1个外部参考技能,只读,方法论来源;ShotDesign/seedance25 已提炼落库至 references/) │ └── seedance2.0-prompt-skill/ ← F2/F4 视频提示词工程参考(四维编码体系) │ ├── SKILL.md ← 视频提示词完整方法论 │ ├── references/ ← 14 个专题参考文件 │ │ ├── camera-codec.md ← 四维编码系统(Z/Y/X/F) │ │ ├── aesthetic-constraints.md ← 深度美学约束 │ │ ├── production-pipeline.md ← 长视频生产流水线 │ │ ├── editing-rhythm.md ← 剪辑节奏公式 │ │ ├── image-generation.md ← 图片生成规范 │ │ ├── image-to-prompt.md ← 图生视频方法论(路径C) │ │ ├── storyboard-driven.md ← 分镜板驱动(路径D) │ │ ├── creative-strategy.md ← 创意策略 │ │ ├── long-video-strategy.md ← 长视频策略 │ │ ├── platform-specs.md ← 平台规范 │ │ ├── vocabulary.md ← 词汇库 │ │ ├── examples.md ← 示例库 │ │ └── cli-integration.md ← CLI 集成 │ ├── experiments/cases/ ← 30 个实验案例 │ └── projects/ ← 项目案例 │ ├── references/ ← 默认引用文件地址(标准库,出厂自带) │ ├── README.md ← 标准库说明 │ ├── 制作流程/ ← 标准制作流程(分镜提示词制作流程/长视频分段制作流程/图生视频与分镜板制作流程/多镜头剪辑节奏流程,共4文件) │ ├── 接口调用/ ← 接口定义与平台规范(当前平台规范见制作流程/分镜提示词制作流程.md 第六节;此目录预留给未来独立 API/MCP 文档) │ ├── _meta/ ← 辅助参考资料(案例库/术语表) │ └── 知识库/ ← 标准知识库(15 维度,按提示词组成要素分类) │ ├── 01_主体描述/ ← 人/物/场景,含外貌细节与微表情系统 │ ├── 02_动作行为/ ← 主体动作、姿势、互动、物理连贯性 │ ├── 03_场景描述/ ← 背景、环境、时间、天气、空间锚定 │ ├── 04_镜头类型/ ← 景别(特写→远景)+ 四维编码 Z 轴 │ ├── 05_运镜方式/ ← 摄像机运动方式与节奏 + 四维编码运动维度 │ ├── 06_焦距视角/ ← 镜头焦段、拍摄角度 + 四维编码 Y/X/F 轴 + 焦段心理学 │ ├── 07_光线时间/ ← 光源类型、方向、强弱 + 光影三层(光源层/光行为层/色调层) │ ├── 08_氛围天气/ ← 情绪氛围、天气条件 │ ├── 09_色彩后期/ ← 调色、滤镜、电影质感 + 冷暖色调对比系统 │ ├── 10_后期细节/ ← 磨皮、锐化、运动模糊、胶片颗粒 + 有机瑕疵 │ ├── 11_特效渲染/ ← 光效、散景、粒子、GI/SSS/体积光 + 深度美学约束 │ ├── 12_画质分辨率/ ← 输出规格 + 反塑料感宣言(平台 UI 设置,非提示词废话词) │ ├── 13_音效音频/ ← 空间声学、材质拟声、音色控制(视频提示词 `音效:` 行) │ ├── 14_构图布局/ ← 构图法则、版式、画面布局、极简先锋构图 │ └── 15_视觉风格/ ← 导演风格参数化映射(28+风格去名化)+ 艺术流派/渲染风格 │ └── references-add/ ← 用户部署后新增沉淀地(增量库,冲突时增量优先) ├── README.md ← 增量机制说明 ├── 制作流程/ ← 新增/变更的制作流程 ├── 接口调用/ ← 新增的 API 接口文档与平台规范 └── 知识库/ ← 新增知识(15 维度,与 references/ 结构对应) ├── 01_主体描述/ ← 人/物/场景,含外貌细节与微表情系统 ├── 02_动作行为/ ← 主体动作、姿势、互动、物理连贯性 ├── 03_场景描述/ ← 背景、环境、时间、天气、空间锚定 ├── 04_镜头类型/ ← 景别(特写→远景)+ 四维编码 Z 轴 ├── 05_运镜方式/ ← 摄像机运动方式与节奏 + 四维编码运动维度 ├── 06_焦距视角/ ← 镜头焦段、拍摄角度 + 四维编码 Y/X/F 轴 + 焦段心理学 ├── 07_光线时间/ ← 光源类型、方向、强弱 + 光影三层 ├── 08_氛围天气/ ← 情绪氛围、天气条件 ├── 09_色彩后期/ ← 调色、滤镜、电影质感 + 冷暖色调对比系统 ├── 10_后期细节/ ← 磨皮、锐化、运动模糊、胶片颗粒 + 有机瑕疵 ├── 11_特效渲染/ ← 光效、散景、粒子、GI/SSS/体积光 + 深度美学约束 ├── 12_画质分辨率/ ← 输出规格 + 反塑料感宣言 ├── 13_音效音频/ ← 空间声学、材质拟声、音色控制 ├── 14_构图布局/ ← 构图法则、版式、画面布局、极简先锋构图 └── 15_视觉风格/ ← 导演风格参数化映射 + 艺术流派/渲染风格 ``` ### 二、过程产物目录(产出落盘位置) > **⛔ 产出路径唯一权威:`references-add/路径配置.md`**。执行分镜创作前必须先读该文件;用户自定义路径优先。默认路径按运行环境判定(两步:第一步查本机 `D:\AgentSkill` 是否存在——**无 = ③用户环境**(技能无论装在哪、什么路径);有 → 第二步看技能自身路径——**在 `D:\AgentSkill\` 下 = ①开发机**、**含 `.dsh` = ②dsh 环境**):dsh 环境**优先操作主工作区** `D:\dshworkspace\创作任务\`(与脚本创作技能同根同构),无主工作区时兜底**用户桌面 `DSHSkill项目/`**;开发机/用户环境为**用户桌面 `MCNSkill项目/`**(**账号层直挂**:`{账号名}/提示词{编号}/`,与脚本创作「脚本{编号}」同构,Windows/macOS 自动适配)。按账号名/提示词编号建子目录(编号默认继承上游脚本编号)。 ``` D:\dshworkspace\创作任务\ ← dsh 环境优先根目录(主工作区「创作任务」,与脚本创作同根;无主工作区时兜底桌面 DSHSkill项目/) └── {账号名}/ ← 对应账号(从上游脚本创作上下文继承,来自 references-add/路径配置.md;开发机/用户环境为 桌面 MCNSkill项目/{账号名}/,账号层直挂) └── 提示词{编号}/ ← 与「脚本{编号}」平级(编号默认继承上游脚本编号) ├── 00_剧本分析.md ← Step 1 剧本分析(5维度) ├── 01_需求分析与路径.md ← Step 2-3 需求分析+路径分流 ├── 02_段1提示词.md ← Step 4 提示词构建(多段递增 03/04…) ├── 05_校验与交付.md ← Step 5-6 强制校验+交付 └── 分镜提示词_终版.md ← 最终交付物(可带模板版本命名) ``` > 首次创建时检查已有文件夹避免标题冲突;技能目录内 `output/` 仅存放开发期样例与审计报告,不作为用户产出位置。 --- ## 动态增量管理 本技能采用**三层引用架构**: | 层级 | 目录 | 定位 | 读写 | |:---:|:---|:---|:---| | 1 | `参考skills/` | 外部参考技能(方法论来源,已提炼落库至 references/) | 只读 | | 2 | `references/` | 默认引用文件地址(出厂自带标准库) | 开发环境可编辑;部署环境只读 | | 3 | `references-add/` | 用户部署后新增的流程/方法/知识库沉淀地 | 可读写,持续增长 | ### 部署环境检测 根据**两步判定模型**判断当前环境(第一步查本机 `D:\AgentSkill` 是否存在;有 → 第二步看技能自身路径): | 环境 | 判定条件 | 增量机制 | 新增内容写入位置 | |:---:|:---|:---|:---| | **①开发机** | 本机有 `D:\AgentSkill` 且技能路径在 `D:\AgentSkill\` 下 | 不启用 references-add/ | 直接写入 `references/` 对应子目录 | | **②dsh 部署环境** | 本机有 `D:\AgentSkill` 且技能路径含 `.dsh` | 启用 references-add/ | 写入 `references-add/` 对应子目录,不修改 `references/` | | **③用户环境** | 本机无 `D:\AgentSkill`(技能无论装在哪、什么路径,如 `~/.workbuddy/skills/...`) | 启用 references-add/ | 写入 `references-add/` 对应子目录,不修改 `references/` | ### 冲突检测与修复 用户在对话过程中新增方法、流程、知识库后,执行以下冲突检测流程: 1. **比对检测**:将新增内容与 `references/` 中同类内容逐一比对(同名文件、同主题内容) 2. **无冲突**:直接写入 `references-add/` 对应子目录 3. **有冲突**:以**新增内容为主**(写入 `references-add/`),同时在 `references/` 对应文件中加 ⚠️ 注释标注冲突点及增量库中的正确规则,不删除或覆盖标准库原始内容 ### 运行时引用优先级 技能执行过程中同时加载 `references/` 和 `references-add/`,两者内容冲突时**以 references-add/ 为主**: ``` 参考skills/(方法论源) → references/(默认标准库) → references-add/(用户增量,冲突时以此为准) ``` --- ## 快速启动模板 ### F1/F2 反推模式 ``` 【输入素材】 - 类型:[图片 / 视频] - 路径/URL:[粘贴路径] - 目标平台:[即梦Seedance / NanoBanana / Midjourney / SD] - 期望输出:[图片提示词 / 视频提示词] - 视频时长(F2):[4-8s / 9-12s / 13-15s / >15s] ``` ### F3 生成模式 ``` 【创作需求】 - 内容描述:[一句话描述你想要的画面] - 图像类型:[角色参考图 / 首帧图 / 产品摄影 / 概念艺术 / 其他] - 画幅比:[9:16 / 16:9 / 1:1 / 3:2 / 21:9] - 风格偏好:[写实 / 3D渲染 / 插画 / 概念艺术 / 其他] - 复杂度:[极简 / 平衡 / 结构化] ``` ### F4 分镜模式 ``` 【创作需求】 - 视频时长:[≤15s / >15s / >45s] - 视频比例:[9:16 / 16:9 / 1:1] - 脚本来源:[已有脚本粘贴 / 分镜板上传 / 需AI先生成] - 参考素材:[纯文本 / 有图片 / 有图片+视频] 【脚本内容】(如已有) - [粘贴脚本正文] 【分镜板】(如上传) - [上传 N 宫格分镜板图片] ```