Files
mcn-short-video/project/短视频提示词生成/V1.0/SKILL.md
T
maogeigei eada288999 技能三副本迭代:路径重构+输出边界铁律+开场口径区分+审计修复
- 路径重构:脚本创作 V1.0/Lite1.0 扁平化(去技能文件夹层),分镜技能迁移至 短视频提示词生成/V1.0,旧路径清理
- 输出边界铁律固化:创作流程规范.md 新增「交付物输出边界(通用铁律)」+ S9 输出模板新增「输出边界」块(验收口径=执行约束非输出内容)
- 开场钩子铁律三层固化:00_开场/06_编导终审/S9 相关规则 + S5 预设钩子口径区分(前3秒=呈现窗口,3-7秒=开场段总时长)
- 帮助文档:新增「从账号分析到脚本创作」跨技能章节(你这样问|我会做什么风格)
- mcn-dou-analysis 内嵌副本:红线边界声明+人设卡术语更新(设定分析说明)
2026-08-26 17:28:21 +08:00

76 KiB
Raw Blame History


name: 短视频分镜脚本 description: > 短视频视觉创作提示词工程技能:图片提示词反推、视频提示词反推、 生图提示词生成、分镜提示词生成(脚本→分镜)。 适用于即梦 Seedance、Midjourney、Stable Diffusion 等 AI 生图/生视频平台。 触发场景:反推提示词、图生文、视频提示词、生图提示词、分镜提示词、 角色卡、首帧图、运镜、景别、时间戳分镜、图生视频。 version: "1.0" agent_created: true updated_at: "2026-08-26" last_change: "产出结构定稿:①开发机与③用户环境产出根目录由 桌面 MCNSkill项目/分镜提示词/ 改为 桌面 MCNSkill项目/(账号层直挂:{账号名}/提示词{编号}/,去掉「分镜提示词」技能文件夹层,与脚本创作「脚本{编号}」同构);dsh 环境不变 工作区 D:\dshworkspace\创作任务{账号名}\提示词{编号}\(references-add/路径配置.md 判定表+执行规则+解析规则+示例+变更记录,SKILL.md 声明+示例树)" deployment: source created_at: "2026-08-20"

短视频分镜脚本 Skill

技能概述

本技能是一套中文优先的 AI 视觉提示词工程系统,专注于短视频分镜脚本创作场景。将图片、视频、文字描述、脚本等输入,转化为可直接用于 AI 生图/生视频平台的高质量提示词。

四大核心功能:

功能 名称 输入 输出 主要参考技能
F1 反推图片提示词 图片 图片生成提示词 内建方法论(观察→增强→结构化)
F2 反推视频提示词 图片/视频 视频生成提示词 references/制作流程(5步工作流+多模态参考+8项校验)+ seedance2.0(路径C/D+四维编码+版权铁律)
F3 生成图片提示词 文字描述/概念 图片生成提示词 知识库/15维度(品质锚定+材质库+反塑料感)
F4 生成分镜提示词 脚本/分镜板 分镜提示词序列 references/制作流程(时间戳分镜+智能分段+长视频策略)+ seedance2.0(生产流水线+剪辑节奏)

参考技能位置: 参考skills/(技能根目录下,1个外部参考技能,只读,提供基础方法论;ShotDesign/seedance25 方法论已提炼落库至 references/,源文件已移除)

  • seedance2.0-prompt-skill/ — 视频/图片提示词生成(即梦 Seedance 2.0 专用,含四维编码、美学约束、剪辑节奏、生产流水线、30个实验案例)

知识库采用三层引用架构:参考skills/(方法论源)→ references/(默认标准库)→ references-add/(用户增量)。详见下方「动态增量管理」节。


四大核心功能

F1. 反推图片提示词

适用场景:

  • 用户上传/链接/引用一张图片
  • "反推提示词""看图写提示词""图生文""img2prompt""根据这张图写提示词"

处理流程: 0. 视觉准入门(P0):开始反推前必须确认模型真实看见图片像素,而不是只拿到文件路径/文件指针/历史上下文。准入验证方式:先写出3个不可从文件名、历史提示词或用户文字中猜出的画面事实(如具体人物动作、背景可见元素、光线落点)。若看不到图、图像未成功加载、视觉通道不确定,必须停止并告知"当前无法看见图片,不能反推提示词",禁止根据历史描述、用户反馈、文件名、前轮提示词脑补生成。

  1. 判断图片类型(7类:产品摄影/电商、人像、风景、美食、建筑室内、海报文字、抽象艺术;难判时用产品摄影模板),顺带扫描图片质量(模糊/过曝/裁切/水印),质量结果决定第4步"疑似"标注密度
  2. 三层观察画面要素(先事实层,再关系层,最后神韵层;缺一不可):
    • 事实层:基础属性(画幅比)、构图透视+机位、光影布光、色彩色调、纹理材质、主体细节、道具清单、场景空间、画质质感。人物含服装结构(外层+内层+腰部如有)、持物/挂载物、发型佩戴、脸型肤色;场景按前中后景三层列出。
    • 关系层:人物是否看镜头、谁看谁、视线落点、人物之间是否有交互、动作是否像行走/闲聊/经过镜头而非摆拍、人物与道具是否是生活动作而非展示动作。多人图必须判断"同一瞬间"与"人物关系",不能只列人和物;人物交互必须做强度分级(无交互/弱交互/中交互/强交互):弱交互=同行交流感、眼神略偏、身体不明显转向;中交互=一方看向另一方但不互相凝视;强交互=双方明确对视/凝视/身体明显转向。原图是弱交互时,提示词只能写"轻微交流感/眼神略偏/非强对视",禁止自动升级成"互相看着对方/凝视/强对视"。
    • 神韵层:画面为什么像活人——清纯/松弛/灵动/古典/生活流/湿润晨雾/空气感/水润感/烟火气等;同时标出AI易污染方向(网红脸、摆拍感、假笑、硬衣、干冰烟雾、影楼感)。
  3. 按类型叠加专属栏目(见下方"类型适配表")
  4. 置信分级与硬软锚点分级:区分高置信观察和推测性风格词,严禁脑补画面不存在内容;低分辨率图用"疑似/隐约可见"标注。硬锚点用于道具、服装形制、人物站位、持物关系、前中后景元素;软锚点用于人脸、表情、视线、互动、气质、空气感和画面神韵。硬锚点要具体,软锚点要语境化,禁止用极限器官量化压死人脸神韵。
  5. 输出双版本:A.结构还原版(保道具/服装/场景/人物位置不丢);B.神韵优化版(保审美/表情/互动/空气感,适当松绑器官级硬量化)。默认优先交付神韵优化版,同时保留结构还原版供审计。
  6. 如需复用,提炼 {{variable}} 变量并提供候选词组

每步自检(Step-Check,每步执行完必做,不通过则重做该步,禁止带病进下一步):

步骤 自检判据(逐项回看原图核对)
0 视觉准入 必须能说出3个不可从上下文猜出的画面事实;若只拿到路径/文件指针/历史描述,立即停止,禁止脑补生成
1 类型判断 类型判定与质量扫描结论将落地到第4步标注密度;无"扫了一眼就定型"
2 三层观察 错误重灾区,每层写完结论后回看原图一次再落笔:①事实层——朝向/肤色/持物/挂载物/服装/场景逐项核;②关系层——是否看镜头、谁看谁、是否边走边聊、动作是否生活化,并标注交互强度(无/弱/中/强),弱交互不得写成互相凝视;③神韵层——是否有活人感、松弛感、湿润空气感、古典骨相;④核法必须是"先看图、再对照已写结论"——拿结论去图里找印证=确认偏差
3 类型叠加 专属栏目与三层观察底座无重复无遗漏
4 置信+硬软锚点分级 所有推测词带"疑似";所见即所得维度无脑补;硬锚点(道具/服装/站位/持物)必须具体,软锚点(表情/脸/视线/空气感)禁止极限量化
5 输出前美学自检 ①人物标签=完整主体名称;②道具/挂载物逐件打勾;③反向词正向零出现;④坐标系分界;⑤正负提示词分离;⑥活人感自检:是否网红脸/假笑/惊恐张嘴/直视镜头游客照/硬衣塑料感/干冰烟雾;若出现,降低器官硬量化,改用神态语境与审美负向词
5.5 生成闭环复盘 多轮出图后先列保留项/回退项/替换项;已经实测有效的脸部、表情、视线、道具、场景锚点必须逐字复制(见"金标锚点逐字保护"),禁止同义改写;只替换失败模块,禁止一轮失败后全量重写导致上一轮优势丢失
6 变量提炼 变量化不破坏实体聚合结构(同一人物属性不拆到多段)

人物专项(画面含人物时必做 5 项): 服饰造型(结构化描述:外层(品类+颜色+衣长+袖型)+内层(可见部分)+腰部(腰带/腰封宽窄+位置,如有——无则省略防脑补);汉服示例"灰白交领长衫(过臀,宽袖垂坠),领口两片襟布在胸前交叠形成斜向襟线,露出白色内衬窄边,腰间深蓝宽腰封约一掌宽";现代装示例"oversized白色卫衣(过胯,落肩宽袖),胸前无图案,下摆罗纹收口")/ 身材比例 / 肢体姿势 / 脸型轮廓 / 面部神态(肤色用具体色名:象牙白/小麦色/古铜色/深棕色/暖黄调/冷白调,不写"白""黑";基础肤色取面部受光面——鼻梁高光/受光侧脸颊/边缘光的色调,禁取整体面部观感——逆光背光面偏暗、暖调滤镜偏黄都会造成"古铜感"误判(实测:逆光图A整体观感偏深被判"古铜肤色",实际受光面与B同为暖白偏粉;受光角度不同的两人观感差≠肤色差);多人场景先核两人受光角度是否一致——受光角度不同导致的观感差,写真实基础肤色即可,明暗差由光影层自然处理)。还原力精度要求: ①肢体姿势写到角度/手部动作/视线落点粒度(如"侧身约30度朝画面左,右手提裙摆,视线望向画面右上"),姿势语言用 references/知识库/02_动作行为/动作行为词库.md;②姿势动词≤2个/人——复合动作(扛+斜搭+延伸类)改用道具几何锚定:接触点+道具两端相对身体方位(如"扁担中段搭右肩,前端在身前右手握持处,后端斜向身后上方延伸");③持物/挂载物位置用相对人物的身体方位,禁用画面绝对坐标——身体锚点(身前/身后/左肩/右腰/腿侧/右肩至背部高度等),禁写"画面左下角/右上角"(实测:扁担末端写"伸向画面左下角"导致挂载竹篮被锚定到画面边角截断;正确写法"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")。长杆类道具最小锚点法:扁担/伞/棍/枪等长杆类道具不能只写名称,也不能写成机械长篇几何说明;下笔前先回答三问:①承载方式:肩扛 / 单手握提 / 双手握提 / 落地斜靠?(看杆与身体的接触点,不默认肩扛——实测:右手手提斜杆挂篮被误判成"肩扛横杆",导致筐被画到身后、手被解放空手)②杆身长轴方向:水平 / 斜上 / 斜下 / 竖直?(看杆在画面里的实际角度,不默认横向)③挂载物落点:挂上端 / 挂中段 / 挂下端 / 杆外侧?(看筐/篮在杆上的实际位置)。三问不答完,禁止写"肩扛""横向"等默认描述。答完后最少写清4个锚点:①身体接触点(搭在哪个肩/握在哪只手/贴近哪个身体部位);②长轴方向(横向/斜横向/竖向,尽量用相对身体方向);③手部作用(扶住/握住/自然垂放,不强行摆拍展示);④挂载物归属(挂在哪一端/哪一段)。挂载物≠背负物:挂在道具上的篮筐、包袱、灯笼等必须写成"挂在某段道具下方、与身体背部有距离",禁止写成贴背/背在身上/背篓;挂载物位置用"身后侧扁担段下方、右肩至背部高度"这类身体相对方位,避免漂移到画面边角或贴背。扁担专项防偏(仅在长杆三问①承载方式=肩扛时适用;三问=单手握提时按普通长杆最小锚点法处理,不触发扁担专项):原图确认为扁担时,正向必须写"平直硬木扁担/平直木扁担",并写"中段搭在肩上,长轴横向或斜横向延伸";禁止只写"木棍/长杆",否则易变竖直手杖;禁止写"弯曲、柔软、藤条感、绳状"等会让扁担变形的词。若生成图出现木棍、竖杆、弯杆、软杆、竹筐变背篓,则只局部修道具段与对应负向词,不重写脸部/表情/场景有效锚点。坐标系分界:物品位置=人物段用身体坐标(物品跟着人物走,换场景/多人归属均稳定);人物站位=场景层用画面坐标("居画面中偏左略前"是构图信息,归场景层——不要矫枉过正把站位也改成身体坐标);④微表情双轨制——观察分析用 references/知识库/01_主体描述/主体描述词库.md 的微表情7区域×4级强度(保观察精度),写入提示词正文时转译为直白可视化词("眉弯L3+嘴大L3"→"露齿大笑"),L值标注是创作语言、文生图模型不识别;动作状态词优先(开怀大笑/咧嘴大笑/放声大笑/会心微笑)+ 可观察子状态(露上牙/上排牙齿完全可见/眼睛眯成弯月);禁几何抽象词("嘴大张呈O形""一字眉""V形领""圆形脸"等)——模型会把"O/一字/V/圆形"字面读成几何形态,生成"惊讶圆嘴/惊讶一字眉/V领睡袍/圆饼脸"等与原图不符结果,几何抽象词用动作状态词或具体可观察形态替代("O形嘴"→"咧嘴大笑";"一字眉"→"眉头平直";"V形领"→"两片襟布在胸前交叠形成斜向襟线";"圆形脸"→"脸型短宽,下颌圆钝");⑤禁写"开心""温柔"这类无法执行的抽象情绪词;⑥表情分离+前置——多人画面各人表情分开描述禁止合并(模型对"双人一致表情"有先验,合并会被平均化),表情写入各人物块靠前位置(模型对提示词开头权重最高);表情写法从器官量化升级为动作语境+面部协同——先判断表情发生在什么关系里(看同伴、听人说话、边走边笑、对镜头摆拍),再按微表情四层写少量可见状态:①嘴部(张口/闭唇/嘴角上扬/嘴角横向打开)②脸颊(提起/放松/紧绷)③眼周(自然睁着/眼神带笑/轻微眯起/不眯成线)④情绪语境(边走边说话/听到同伴说话后忍不住笑)。禁止把表情拆成极限器官命令(如强制最大张口、强制瞪眼、强制强调瞳孔细节、强制描述唇部机械拉伸等都会触发惊吓感和AI僵硬感);优先写"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"、"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑"。交互强度≠表情强度——弱交互只限制不强对视/不明显转头,不代表笑意弱;闭唇笑也可以有明显笑意,必须单独写嘴角、脸颊、眼神。眼周状态仍需观察但不做极限硬控——模型默认先验"微笑=眯眼"会污染抿嘴笑,应用"自然睁着、眼神柔和"这类软锚点对抗,而非逼写器官细节。;⑦脸部朝向/视线/互动强度分离——脸部朝向=头部转向,视线落点=眼睛看向哪里,互动强度=人物关系强弱,三者必须分别观察、分别写,禁止用"看同伴/边走边聊"自动推导成"头部明显转向同伴";弱交互写法用"接近正面,眼神略偏向同伴"、"轻微朝向同伴但不形成强对视",强交互只有原图明确互相凝视时才写"对视/凝视"。面部朝向四件套必须同时判断:①左右朝向(鼻尖朝画面左/右/正前)②上下朝向(下巴/鼻尖平视、微抬、微低或内收)③头部倾斜(是否歪头,默认无明显歪斜不写)④视线落点(眼睛看向哪里);只写左右会丢头部姿态。⑧脸部朝向用可见部位锚定——正脸=五官对称居中;四分之三侧脸=完整可见一只眼+另一只部分+一只耳朵;正侧脸=一只眼+一只耳朵(如"A 四分之三侧脸朝画面右,可见右耳,右脸颊占比大"),方向词"面朝画面右前方"执行率低;观察朝向以鼻尖朝向为唯一可靠判据(数鼻翼两侧可见度,不是看脸型对称感——实测把"左脸颊面对镜头多一点"误读成"朝画面左",实际鼻尖朝画面右);"四分之三侧脸"是弱执行词,模型常弱化成接近正脸(实测:写"四分之三侧脸朝画面左+完整可见左眼+部分右眼",生成图双眼完整可见成正脸)——需按角度档位写可见状态量化:四分之三侧脸(约45°)="鼻尖明显朝向画面X,X侧眼完整清晰,另一侧眼因侧转明显变窄但完整可见";接近正侧脸(60°以上)="接近正侧脸朝画面X,仅X侧眼完整可见,另一侧眼完全不可见";禁遮挡机制词("被鼻梁挡住/被遮住")与模糊量词("一线/一抹")——机制式描述(解释为什么看不见)模型执行弱,只写看到了什么;且角度档位要自洽——"四分之三侧脸"+"仅露眼角一线"是两档角度自相矛盾(45°时远侧眼应大部分可见,仅剩眼角是60°+的形态),混写等于同时下两个角度指令模型无所适从;可见程度用直白梯度词:完整清晰/明显变窄但完整可见/仅露眼尾/完全不可见;⑨场景统一性声明(多人画面必加)——提示词写明"所有人物处于同一瞬间、同一光线"(不含情绪节律——实测"情绪节律统一"被模型读成表情趋同,导致B的闭合微笑被拉高污染),避免模型把多人拆成独立任务导致元素各自为政

类型适配表(在事实层/关系层/神韵层三层观察底座上叠加专属栏目):

图片类型 专属叠加栏目
产品摄影/电商 卖点描述(质感/工艺/情绪价值,只描述可见卖点不编造功能)
人像摄影 外貌细化(种族族裔+肤色具体色名+妆容发型气质)
风景/自然 主体景观描述(地貌/植被/水体/季节天气)
美食摄影 食欲感与新鲜感描述(温度感/水分感/光影对食物质感的强化)
建筑/室内 空间结构描述(空间类型/层次纵深感/材质/陈设/风格定位)
海报/文字图 文字与版式描述(逐字转录所有可辨识文字+位置+字体风格)
抽象/艺术 主体元素+艺术风格(绘画媒介/图形类型/流派归类)

文字转录强制要求(画面含可辨识文字即必做,不限图片类型): 画面中所有可辨识文字逐字转录,注明位置("瓶身正面居中""右下角""T恤胸前""背景招牌")与字体风格(衬线/无衬线/手写/装饰体),不省略、不模糊、不合并、不虚构。非海报类图(人像服饰slogan、场景路牌招牌、产品包装等)同样适用。

文字二分类(转录后决定去留): ①内容性文字(招牌名/产品文案/海报标题/服饰slogan)→ 写入提示词正文(复刻需要);②标识性文字(水印/署名/@账号名/logo/时间戳/平台ID)→ 正向提示词零出现(含否定式提及与说明性文字——"左下角水印只进反向词"这类描述也禁止写,正向提示词出现"水印"字样本身就有诱导生成水印的风险),只在观察报告提及+负面约束"水印"项承载。

反向提示词(7 类,按图片类型筛选用项):

  • 画面质量类:低清晰度, 模糊, 噪点, 过曝, 欠曝, 画质低劣, 分辨率不足
  • 结构与比例类:透视错误, 比例错误, 主体变形, 构图杂乱, 边缘破损, 重复物体
  • 材质与色彩类:材质错误, 反光混乱, 阴影错误, 色彩过饱和, 色彩发灰, 廉价质感
  • 文字与标识类:文字乱码, 多余文字, 错误文字, 水印, 错误logo
  • 人物类(含人物时):肢体错误, 手指错误, 面部崩坏, 皮肤塑料感, 眼神异常, 多余肢体
  • AI审美污染类(含人物且原图为生活流/古典/自然人像时优先选配):网红脸, 现代写真脸, 现代商业写真感, 过度通透高清, 棚拍精修感, 欧式大双眼皮, 尖下巴, 高鼻梁整容感, 过大眼睛, 惊恐表情, 夸张张嘴, 僵硬笑容, 假笑, 摆拍感, 直视镜头, 游客照, 硬挺新衣, 化纤质感, 塑料感, 影楼汉服, 舞台浓烟, 干冰烟雾, 过度戏剧光
  • 长杆/挂载物专项类(原图有扁担、伞、杆、挂篮等长杆+挂载物时按失败项选配):手持木棍, 竖直木棍, 拐杖, 竖杆道具, 白色长棍, 弯曲扁担, 弯曲木杆, 软杆, 变形杆, 藤条弯杆, 背篓, 竹筐贴背, 竹筐落地, 竹筐贴边, 挂载物截断, 道具展示感
  • AI痕迹类:AI痕迹明显, 细节缺失, 不自然过渡

反向词默认选配规则: 画面质量+AI痕迹类必带;含人物加人物类;海报/文字图加文字标识类;产品/美食加材质色彩类;建筑/风景加结构比例类;有长杆/挂载物且生成失败时加长杆/挂载物专项类。负向词分层精简:按"通用质量/人脸审美污染/本图专属纠偏/风格场景误差"四层选配,不把所有历史失败无限堆叠进负向词;本图专属纠偏只针对当前图片或最近一轮真实失败项,问题消失后可下调或移除,避免负向词过重把正向主体也打散。反脑补项——场景观察为穷尽清单,原图未出现的形态级元素(山体/塔/水面/招牌等具体形态)逐项加入反向词;概念级氛围词(远景暖光晕染/空气透视感/晨雾光感)豁免,不进反脑补清单——它们是画面感来源;烟雾/雾气失控放大时反向词加"浓烟";对抗项(仅原图背景虚化时加)——背景细节过多, 景深过大(禁用"背景清晰":拆词后会把"清晰"整体否定,导致全图发软)。

目标平台适配(用户指明时按平台语法适配输出):

  • 默认即梦/通用自然语言:自然语言描述;正向与负向提示词分开输出(即梦有"不希望呈现的内容"独立输入框,负向词贴该框;单输入框平台在负向部分用否定句式转写如"画面中不出现…",禁止与正向词混排——混排后模型无法区分正负,"低清晰度, 模糊"会被当正向描述执行)
  • Midjourney:参数式语法(--ar 16:9 --style raw --v 6),负面词用 --no 承载
  • Stable Diffusion:权重语法((word:1.3)),6分类反向词放独立负面词框(negative prompt)
  • NanoBanana:自然语言;默认仍按正向提示词与负向提示词分开输出。若平台只支持单输入框,负向内容必须改写为自然语言否定句(如"画面中不出现…"),放在独立负向段落中,禁止裸负向词直接混排在正向文本末尾 未指明平台时按即梦/通用输出,不强行参数化。

输出格式: 双版本输出(均按实体聚合+全局项聚合):

  • 结构还原版:保证道具、服装、场景、人物位置、持物关系不丢;适合审计硬锚点。
  • 神韵优化版(默认推荐生成):在保留硬锚点基础上,降低人脸/表情/视线/空气感的器官级硬量化,强化人物关系、生活流语境、古典骨相、软布料、湿润空气感;适合直接喂模型生成。 人物按"每人一块全信息"组织(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;人物画面位置不写在人物块,统一归场景层人物布局),全局项合并为5块——场景(环境+人物布局+前中后景内容)/镜头(景别+机位+虚化+拍摄风格)/光影(光源类型+逆光入画+色调系统三段式)/画面质感(渲染规格+年代流派媒介三合一锚定)/画面风格(流派+情绪基调+画面感词),加文字/负面约束/基础属性 + 类型专属栏目。

版本说明: 极简版信息密度不足以承载还原约束,已废弃;但单一硬还原版会压死人脸神韵,改为"结构还原版+神韵优化版"双版本。默认把神韵优化版作为生成层主稿,结构还原版作为审计层硬锚点清单。

双版本 × 两层输出关系: "结构还原版/神韵优化版"是内容策略差异,"结构化版/整段版"是交付形态差异。两个版本都可按结构化版审计、再转为整段版生成;默认交付顺序为:先给结构还原版结构化审计层(核硬锚点)→再给神韵优化版整段生成层(直接用于生成)。禁止把"结构还原版"误解为"结构化版",也禁止把"神韵优化版"误解为只要整段不要审计。

两层输出分工(审计层 vs 生成层): 结构化版与整段版是两层产物,缺一不可:

  • 结构化版=审计层:按实体聚合组织——每个人物一块写完全部个体信息(基础→表情→发型佩戴→服装含材质→朝向→动作→持物→视线;位置归场景层人物布局),全局项按5块聚合(场景/镜头/光影/画面质感/画面风格),供人工逐人核对——不直接喂模型
  • 整段版=生成层:喂模型的最终提示词,与结构化版同一实体聚合结构,去掉全局块字段标签(【场景】【镜头】等)合并为流畅自然语言段——人物标签(女性A/女性B)保留,人物段以"女性A:"开头,场景段布局用完整主体名称绑定("女性A居画面中偏左略前,女性B居画面中偏右"——禁裸编号"A居""B居",必须与人物块标签字面完全一致)——人物标签是跨层实体绑定锚点,剥掉后多人段落无法区分、布局与人物段断链(实测:两段同以"脸型窄长…的年轻女性"开头,模型无从知道谁站哪边);禁止把同一人的属性拆到多个段落(拆散后模型要跨段拼装,归属断链——材质/颜色/道具会张冠李戴);道具与佩戴物内联到持有者段落;正向与负向分开——整段版正文只含正向提示词(人物段+场景/镜头/光影/画面质感/画面风格全局段),负面约束独立成第二部分输出,标识行只写"负向提示词:"五个字,不带括号操作指引("(贴即梦XX框)"之类的平台分发说明是技能内部知识,不写入输出——平台怎么分发由用户自行判断,规则留在"目标平台适配"节),禁止负向词直接混排在正向文本末尾——剥掉【负面约束】标签后模型无从区分正负,"低清晰度, 模糊"会被当作正向描述执行(实测用户抓出)
  • 逐件核对:结构化版→整段版转写后,确认所有道具/佩戴物已内联到对应人物块,禁止聚合时静默丢弃(实测:竹篮在观察层被发现,却在聚合写入时丢失)
  • 对话展示格式:最终提示词不用长行代码块展示(横向滚动条导致用户复制不便),以普通文本段落输出,段与段空行分隔

画面感保护条款: 还原导向≠无脑精确化。逐项精确(姿势/服饰/道具/虚化)的同时,保留 1-2 处"模糊氛围词"(如"远景暖光晕染""空气透视感""轻雾弥漫")不拆解、不量化、不进反脑补清单——过度具体化会让生成图变成"摆拍工作照",丢失"生活瞬间感"(实测:纯精确提示词生成的图还原度高但画面感弱于带氛围词的版本)。

生成闭环复盘与有效锚点保护(多轮出图后必做): 每轮生成图对比原图后,先列三栏再改提示词:①保留项(本轮比上一轮更接近原图的脸部、表情、朝向、道具、场景、光影、质感句);②回退项(上一轮好、本轮变差的局部);③替换项(当前明确失败的局部)。修改只动替换项所在模块,保留项原句不得因其他问题被顺手重写。尤其在修扁担/竹筐/背景时,不得误删已实测有效的面部朝向和表情锚点;在修视线/表情时,不得误伤扁担、挂载物、场景氛围锚点。

金标锚点逐字保护(多轮出图核心机制): 当某一轮生成图的某个局部(如 A 的面部朝向/笑容/表情)明显优于其他轮时,将该局部对应的提示词原句标记为"金标句"。金标句一经标记,后续所有轮次的提示词中该局部句子必须逐字复制粘贴,禁止同义改写、合并精简、拆分重组或"优化措辞"——实测:仅把"嘴角横向打开"改成"嘴角上扬"就导致笑容效果完全丢失。回退时不重新从原图反推,而是直接粘贴金标句原文。只有用户明确说"这版某处不好要改"时,才允许动对应金标句,且改后旧金标句仍需保留备查。金标句的标记范围按模块划分:A 面部块(脸型→表情→朝向→头部姿态)是一个可标记模块;B 面部块是另一个;道具块、场景块、光影块各自独立标记。标记后该模块在后续轮次中"冻结",非用户明确要求不得解冻。

非看镜头/人物交互专项(人像多人图必做): 判断人物是否看镜头、谁看谁、是否同行/闲聊/经过镜头、表情是否回应对方。若原图是生活流抓拍,提示词必须写"非看镜头"、"边走边聊"、"自然经过镜头前"、"动作不是摆拍展示道具"等关系语境;负向词加入"直视镜头/游客照/摆拍感/网红写真"。视线落点是人物关系信息,不得省略为泛泛"望向前方"。

视线词高风险规则: 视线是软锚点,高于普通表情词风险。"视线越过镜头右侧"可能减少直视镜头,也可能让模型误读为看镜头外展示;"视线轻轻落向同伴/含笑回应"容易把弱交互放大成互相凝视。处理多人弱交互时,优先写头部朝向与表情语境,视线只写低强度词(如"眼神略偏""不直视镜头"),慎写精确落点;只有原图明确看向某人时才写"看向同伴"。若某一版面部朝向/神态已经实测更接近原图,后续不得把该面部句泛化替换为未经验证的新视线句。

视线词与交互强度匹配表(写下视线前先查表):

交互强度 视线写法 禁止写法
强交互 "看向女性A,目光落在她脸上" 禁止弱化为"略偏向"——原图明确看人就不能写弱
中交互 "脸朝女性A方向,目光大致落在她肩颈区域" 禁止写"凝视/深情注视"——会升级成强对视
弱交互 "眼神略偏,不直视镜头" 禁止写具体落点("看向A/落向A")——会把弱放大成强
无交互 "目光朝前方" 禁止写"看向同伴"

交互强度判错时,先回到交互强度判定(无/弱/中/强),不直接调视线词——先定强度,再查表选视线写法。

美学自检(输出前必做): 字段检查通过不代表图会好看。输出前必须自问:人物像活人吗?是否出现网红脸/尖下巴/过大眼睛/高鼻梁整容感?表情是否惊吓、假笑或僵硬?人物是否不该看镜头却直视镜头?衣服是否硬挺新衣/塑料感/影楼汉服?雾气是否变干冰浓烟?若任一命中,降低人脸与表情的器官级量化,改用神态语境、古典骨相、软布料、湿润空气感与审美负向词。

结构化版格式模板(人物按实体聚合每人一块+全局项5块聚合,每人一块内按聚合清单顺序写——分行是硬性格式,禁止合并单行;关键还原项前置(人物表情/服装/朝向/虚化),背景细节后置——模型对提示词开头权重最高。输出产物禁带元规则标注——"(穷尽清单)""(前置)""(画面感保护词)"等括号注记不写入观察报告/结构化版/整段版,规则术语只留在本技能文件,输出层用自然语言。全局项禁止跨字段重复——同一信息只在一处写,如虚化只写镜头层、色调只写光影层、人物画面位置只写场景层):

人物标签=性别+角色编号(如"女性A""女性B",单人时直接"人物"),禁止用裸编号"A""B"——脱离上下文无法辨认是谁;标签不带画面位置——位置是关系性信息,归场景层,标签重复写会冗余:[基础(脸型+肤色——肤色取面部受光面色调,不取逆光/暖调下的整体观感;易漂移色名加锚定如"灰白≈浅亚麻/不含蓝调")→表情(动作语境+面部协同:先写"看同伴/听人说话/边走边笑/非看镜头"等关系语境,再写少量可见状态;禁极限张口、强制瞪眼、强制强调瞳孔细节、机械唇部拉伸等器官命令;推荐"自然开怀大笑,嘴角横向打开,露出上排牙,脸颊提起,眼周带笑但眼睛仍自然睁着,像边走边说话"或"闭唇但笑意明显,嘴角向两侧轻微上扬,脸颊微微提起,眼神柔和带笑,像听到同伴说话后忍不住笑",多人分离描述;弱交互不等于弱表情,闭唇笑也要写清笑意强度)→发型与佩戴物(簪/耳饰)→服装含材质(外层品类+颜色+衣长+袖型+内层可见+腰部如有+材质内联如"亚麻粗织感";汉服专有品类加形态锚定——"抹胸"补"(贴身吊带状)"防脑补成现代内衣,"披帛"有用法锚定"搭肩/双手拎两端"兜底可不加)→朝向(面部朝向四件套+可见部位锚定+角度档位自洽:①左右朝向看鼻尖朝画面左/右/正前;②上下朝向看下巴/鼻尖平视、微抬、微低或内收;③头部倾斜看是否歪头,无明显歪斜不写;④视线落点看眼睛看向哪里。四分之三侧脸=完整一只眼+另一只变窄但完整可见+一只耳朵("鼻尖明显朝向画面左,左眼完整清晰,右眼因侧转明显变窄但完整可见");接近正侧脸=仅一只眼完整可见+另一只完全不可见——禁遮挡机制词("被鼻梁挡住")与模糊量词("一线"),只写可见状态;"四分之三侧脸"单独写会被弱化成正脸,可见部位量化才锁得住;非人物用角度锚定正对/45度/正侧面)→姿势动作→持物(名称+材质+接触点+两端相对身体方位,无则省略;道具上挂载的其他物品(如扁担上挂的竹篮)随道具一起写,且独立写明相对身体方位(如"竹编篮筐挂在身后侧扁担段上,位于右肩至背部高度")——挂载物单独留在观察层会在聚合时静默丢失(实测竹篮两次被丢);挂载物不写独立位置会跟随道具末端漂移到画面边角被截断(实测第四轮竹篮只剩边角1/3))→视线落点]|场景:[环境类型+空间特征+人物布局(用完整主体名称(女性A/女性B)写每人画面位置+前后关系+间距——与人物块标签字面完全一致,禁裸编号A/B;多人加"同一瞬间、同一光线"——不含情绪节律,防表情趋同污染)+前中后景三层逐层列各层陈设(只写"有什么",不写虚化——虚化属镜头层;未出现的大类元素直接进负面约束)]|镜头:[景别+机位+虚化结果转译:原图有虚化写"背景虚化成柔和色块,仅可辨认轮廓剪影"(用"虚化"不用"模糊"——负面约束含"模糊",正向出现会与之打架、弱化景深执行);原图全清晰写"全画面清晰锐利,前后景均无虚化"——禁写焦段/光圈参数(如85mm、f值)与"浅景深"等参数化术语,虚化结果句已承载全部景深信息,重复写参数反而引入不确定性+拍摄风格子项(原图可辨的静态执行项):POV主观视角/手持拍摄感/俯拍仰拍等;晃动感/呼吸感/跟拍节奏等动态词仅视频提示词用,静帧反推不写]|光影:[光源类型先行(自然光为主/单一人工光源/混合光)+方向+行为;强方向光逆光入画:"光从人物背后左上方射入,发丝边缘发光(rim light glow)"+色调系统三段式:饱和度(低饱和度/正常饱和度)+色相(如"冷灰偏旧""整体暖黄调")+胶片类型(如"复古胶片色调""暖调胶片模拟")——完整示例"低饱和度,冷灰偏旧的复古胶片色调"或"整体暖黄调,背景暖褐暖灰"(具体色名留在各实体内联处不重复);渲染术语禁写——"体积光"是CGI术语,直白写"光柱清晰可见";画面现象的位置词需明确参照——"光柱在画面左侧"(明确写"画面左侧"),禁裸写"左侧"(人物左还是画面左歧义)]|画面质感:[渲染规格+质感风格锚定——这是独立于"风格流派"的渲染指令层:①渲染规格(8K高清/微颗粒胶片感/非完美锐度/轻微色差/暗部细节保留/HDR等,这些是输出规格词模型可识别,与禁写的"输入参数"85mm/f值不同)②质感风格锚定("纪录片摄影风格""胶片模拟""柔光片效果"等——年代+流派+媒介三合一锚定执行率最高,如"2010年代初纪录片式胶片摄影"(年代+流派+媒介一句写全)比泛词"电影感"强,后者会落到好莱坞大片先验)③反向词冲突审查("非完美锐度"避开反向"低清晰度"、"轻微色差"避开反向"画质低劣"的语义场——写前核对)④电影截图感防商业写真化:若原图是电影截图/剧照/生活流古装片段,应写"电影截图感、低饱和暖灰胶片色调、边缘略柔、非完美锐度、背景压缩虚化、生活流抓拍",并在负向词加入"现代商业写真感、过度通透高清、棚拍精修感",避免生成过干净的商业人像]|画面风格:[流派定位+情绪基调——风格名(如"古风写实人像";写实类可加执行词"写实真人风格""生活流表演")+情绪(如"欢快温暖的生活瞬间";氛围词用"轻X氛围"句式如"轻压抑氛围""轻怀旧氛围"比直写"压抑"可控)+符号内涵+画面感保护词(保留1-2处模糊氛围词如"远景暖光晕染""晨雾光感"不拆解不量化);禁写画质/渲染词(8K/颗粒/HDR归画面质感层,色调归光影层——旧"全局性质感"已迁出至画面质感字段)]|文字:[仅内容性文字转录+位置+字体;无内容性文字时省略整个字段——标识性文字在正向提示词零出现,相关排除项由负面约束承载]|负面约束:[6分类筛选项+反脑补项(原图未出现的大类元素如山/塔/水面)+对抗项(仅原图背景虚化时加):背景细节过多, 景深过大+文字与标识类排除项;反向词正向零出现核对(输出后必做)——逐项核对每个反向词(含其作为子串/否定式提及/说明性文字)是否在正向提示词任何位置出现过,出现即改正向措辞(如正向写背景虚化用"虚化/朦胧"避开反向词"模糊";反向"模糊"与正向"中景人影模糊"打架会弱化景深执行——实测第三轮虚化失效的嫌疑原因之一)]|基础属性:[画幅比](即梦平台UI设置不写入提示词;Midjourney 用 --ar)

多图模式(同主体多角度/多张图反推,衔接 F3 角色卡): 提取共通主体描述(多图高置信交集)+ 各图差异项(姿态/光线/景别/角度);冲突项标注"图A/B不一致"由用户裁定。输出可直接喂 F3 角色卡的一致性主体锚定 + 差异镜头库。

风格反推双轨输出(艺术风格维度专用): 风格维度同时输出「风格命名」(人类可读,如"韦斯·安德森式对称构图")+「参数化描述」(去名化、可直接用于生成,规则见 references/知识库/15_视觉风格/视觉风格词库.md 去名化使用规范);命名与描述均标注置信度。

注意: 不声称还原图片原始隐藏参数,说明这是对画面的实用重构。

还原路径指引(输出后主动告知用户,按用途分流):

  • 100% 复刻原片 → 走图生图/垫图(把原图作为参考图喂给平台),F1 提示词仅作辅助约束;纯文生图无法逐像素复刻
  • 改图/延展(同构图换元素) → 文生图直接使用本提示词,改动目标字段即可
  • 学图(提炼风格/结构复用) → F1 提示词 + 第 6 步变量提炼,替换变量生成同风格新图

详细方法论(观察维度→词库语言对照):

  • 人物专项+微表情7区域拼乐高+反AI假脸四大陷阱:references/知识库/01_主体描述/主体描述词库.md
  • 姿势粒度语言(三层动作分级+运动强度修饰词,肢体姿势/手部/视线落点写法):references/知识库/02_动作行为/动作行为词库.md
  • 光影布光(光影三层:光源层/光行为层/色调层+常用灯光组合速查;强方向光用逆光入画写法——"光从人物背后X上方射入,发丝边缘发光(rim light glow)"):references/知识库/07_光线时间/光线时间词库.md
  • 色彩色调(冷暖色调六套预设+后期处理词+张力宣言):references/知识库/09_色彩后期/色彩后期词库.md
  • 构图透视+机位+前中后景三层布置+画面坐标方位(极简先锋五法则+构图几何词库+构图模板):references/知识库/14_构图布局/构图布局词库.md
  • 镜头焦距+光圈推断+X轴朝向+画面坐标规则(四维编码Y/X轴+摄影器材英文参数6.1):references/知识库/06_焦距视角/焦距视角词库.md + references/知识库/10_后期细节/后期细节词库.md
  • 场景模板与特效词(21类垂直场景+丁达尔/体积光,可选):references/知识库/03_场景描述/场景描述词库.md + references/知识库/11_特效渲染/特效渲染词库.md
  • 纹理材质+画质质感(有机瑕疵+反塑料感套装+摄影质感维度表):references/知识库/10_后期细节/后期细节词库.md + references/知识库/12_画质分辨率/画质分辨率词库.md(反塑料感宣言+胶片型号)
  • 视觉风格反推(28+导演风格去名化规范+国际大师/中国影视/新媒体/特殊四类风格库):references/知识库/15_视觉风格/视觉风格词库.md

F2. 反推视频提示词

适用场景:

  • 用户上传图片要求"用这张图做视频""图生视频""根据图片生成视频"
  • 用户上传视频要求"分析这个视频的提示词""反推视频提示词"
  • "这张图怎么做成视频""图生视频提示词"

处理流程(5步工作流 + 两轮交互):

F2 在 5 步工作流框架内执行,其中步骤 2-3 包含两轮用户交互:

步骤 名称 F2 执行内容 交互
1 需求解析 确认时长/比例/生成模式/风格/素材;能推理的不追问 —
2 视觉诊断 读图/读视频→主体/氛围/最有戏元素/画质来源/4层退化策略/建议时长/比例诊断/平台合规风险 → 给出 2 个 Hook 候选(反应/凝视) 第1轮:用户选定 Hook
3 提示词构建 用户选定后,按基础六要素公式输出完整提示词(凝视/反应模式对应不同模板),一镜一动 第2轮:输出提示词
4 强制校验 8 项校验规则逐条检查,有 error 必重写 —
5 专业交付 代码块包裹提示词 + 主题 + 导演阐述 —

5 步工作流详见下方「视频提示词工作流」节。两轮交互模式与 Hook 候选(反应/凝视)见 references/制作流程/图生视频与分镜板制作流程.md 路径C 双范式。

核心约束:

  • Seedance prompt 上限 2000 字符(Python len() 实测,平台接受上限);品质最优区间 ≤500 字符(超出导致模型注意力崩溃,详见下方冲突说明)
  • 版权敏感词必扫(5 条铁律:禁夜场BGM词/不凑齐夜场环境4元素/删涉灰场景词/多人场景用静态全景机位/禁人物×道具物理交互)
  • 运镜四维编码系统(Z/Y/X/F)
  • 前 2 秒生死线

⚠️ 字符限制冲突说明: seedance2.0-prompt-skill 实测平台接受上限 2000 字符;Seedance2.0-ShotDesign v2.0 官方规范建议 ≤500 字符(中文)/ ≤1000 词(英文),品质最优区间 60-100 词(中文约 120-200 字符)。以 500 字符为品质基准,2000 字符为硬性上限。

详细方法论:

  • 6步总流程+路径分流+4层结构(主体按类别分行+负面词放最后+镜头朝向规则,11字段降为内部思考清单)+时长速查:references/制作流程/分镜提示词制作流程.md
  • 路径C双范式(反应/凝视)+11条核心原则+版权审查SOP:references/制作流程/图生视频与分镜板制作流程.md
  • 四维编码(Z景别/Y高度/X方位/F滤镜):references/知识库/04_镜头类型/镜头景别词库.md + references/知识库/06_焦距视角/焦距视角词库.md
  • 运镜安全写法+运动强度分级:references/知识库/05_运镜方式/运镜方式词库.md
  • 光影三层+品质锚定+反塑料感:references/知识库/07_光线时间/光线时间词库.md + references/知识库/12_画质分辨率/画质分辨率词库.md

F3. 生成图片提示词

适用场景:

  • 用户提供一句话、关键词、草稿、半成品提示词
  • "帮我写生图提示词""优化提示词""扩写提示词""变高级""结构化"
  • 视频生产前置:角色参考图、首帧图、关键帧图

处理流程:

  1. 识别主体和目标图像类型
  2. 补充必要维度:主体细节、场景、风格、构图、光影、色彩、材质、情绪、技术质量、画幅比例
  3. 判断复杂度级别(极简/平衡/结构化)
  4. 先输出可复制结果,再补充变量和建议

复杂度分级:

级别 适用场景 格式
Level 1 极简版 快速试图、不喜欢复杂结构 [主体],[核心风格],[场景/构图],[光影/氛围],[质量收尾]
Level 2 平衡版(默认) 大多数用户 [主体+特征],[环境],[动作],[构图/镜头],[光影],[色彩],[风格],[质量],[画幅比]
Level 3 结构化版 模板化、商业级、可复用 分维度展开:主体/场景/构图/光影/色彩/风格/细节/质量/负面约束

图片类型:

  • 角色参考图(9:16 竖版)— 视频生产前置步骤
  • 首帧图(与视频画幅比一致)
  • 产品摄影、概念艺术、杂志封面等通用类型

详细规范:

  • 角色卡(10段结构)+首帧图+一致性锁定:references/制作流程/长视频分段制作流程.md
  • 材质质感库+反塑料感宣言+胶片型号+有机瑕疵:references/知识库/10_后期细节/后期细节词库.md + references/知识库/12_画质分辨率/画质分辨率词库.md
  • 导演风格参数化映射(28+风格去名化+四轴降解):references/知识库/15_视觉风格/视觉风格词库.md

F4. 生成分镜提示词

适用场景:

  • 用户提供脚本/分镜板,要求"按分镜生成""拆分镜""分镜提示词"
  • 长视频(>15秒)需走完整前期制作流程
  • 用户上传 N 宫格分镜板/漫画分镜

前置:剧本分析(Step 1,必做)

进入路径分流前,先完成剧本类型判定(A叙事剧情/B单人Vlog/C旁白知识/D产品展示/E纯氛围)+ 维度拆解(①节奏全类型必做,②-⑤按类型选做),产出驱动后续路径选择、景别设计、微表情弧线、台词语气修饰、4层格式适配。详见 references/制作流程/分镜提示词制作流程.md Step 1。

处理流程(按路径分流):

路径 触发条件 核心任务
A — ≤15秒单段 纯文字描述,无图片 找到单一视觉 hook,生成 2-3 个版本
B — >15秒长视频 需叙事/多镜头 走生产流水线:角色设计→角色卡片图→分镜脚本→分镜参考图→逐镜头提示词+剪辑方案
D — 分镜板驱动 上传 N 宫格分镜板 拆解多格→D-1(≤4格单条多段)/D-2(≥5格多条独立)→输出 prompt+剪辑节奏建议

输出格式:

F4 输出 = 主题 + 导演阐述 + 完整提示词(代码块包裹)。多镜头序列附过渡策略。

完整输出模板(基础结构/时间戳分段/时长服从内容/极简优先铁律)见 references/制作流程/分镜提示词制作流程.md。

单段(路径 A,≤15s): 主题 + 导演阐述 + 单块代码块提示词

提示词内部结构(4层结构,按类型适配):①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先)→ ②设定(人物逐人必写不可遗漏/场景/光线/构图/视觉风格,每项1句,按类型取舍)→ ③镜头叙事(每镜头1段流畅描述:机位/景别/朝向+动作/变化+运镜嵌在动作中+有台词时带语气)→ ④负面提示词(放最后,3.3标准模板)

11字段(一致性锚定/类型质感/人物设定/场景/景深对焦/摄影质感/表演幅度/背景动态/镜头空间/表演指令/负面词)降为构建时内部思考清单,不作为输出字段标签。详见制作流程第三节 3.2。

5s 使用时间戳分段;≤5s 可用单段描述。

史诗/大制作(可选,科幻/灾难/奇幻等高品质视觉): 追加品质锚定(渲染引擎+VFX等级)+ 大气连贯声明 + 收束句

多段分镜(路径 B,>15s): 主题 + 总时长 + 过渡策略 + N 个独立分镜(每段≤15s,各含完整提示词代码块)

分镜板(路径 D): D-1(≤4格)单条多段 / D-2(≥5格)多条独立提示词;格间关系三分类与决策见 references/制作流程/图生视频与分镜板制作流程.md

时长、比例、分辨率在即梦平台 UI 底部控制栏设置,提示词中不重复指定。

剪辑节奏公式(>15秒必选): 呼吸式 / 心跳式 / 海浪式 / 子弹时间 / 脉冲式 / 静默锤击

详细方法论:

  • 创意策略+6步总流程+路径分流+4层结构(主体按类别分行+负面词放最后+镜头朝向规则,11字段降为内部思考清单)+标准负面词:references/制作流程/分镜提示词制作流程.md
  • 长视频策略+生产流水线(25格聚合矩阵+节奏曲线+景别曲线+P0/P1/P2优先级):references/制作流程/长视频分段制作流程.md
  • 分镜板驱动(路径D格间关系三分类+三层动作分级):references/制作流程/图生视频与分镜板制作流程.md
  • 剪辑节奏(六大节奏公式+AI素材专属5对策+9步工作流):references/制作流程/多镜头剪辑节奏流程.md
  • 垂直场景模板(21类场景清单+演员调度三要素+过渡策略6种):references/知识库/03_场景描述/场景描述词库.md
  • 微表情系统(面部7区域+4级强度+情绪弧线编排,表演密集镜头专用):references/知识库/01_主体描述/主体描述词库.md
  • 音频与音效标签规范(空间声学+材质拟声+音色控制):references/知识库/13_音效音频/音效音频词库.md

触发条件

当用户表达以下意图时,加载并使用本技能:

F1 反推图片提示词:

  • "反推提示词""看图写提示词""图生文""img2prompt"
  • 上传图片 + "帮我写提示词"

F2 反推视频提示词:

  • "图生视频""根据图片生成视频""这张图怎么做成视频"
  • "反推视频提示词""分析这个视频的提示词"
  • 上传图片/视频 + "做成视频"

F3 生成图片提示词:

  • "帮我写生图提示词""优化提示词""扩写提示词"
  • "角色参考图""首帧图""关键帧图""生成角色卡提示词"

F4 生成分镜提示词:

  • "拆分镜""分镜提示词""按分镜生成""逐镜头提示词"
  • 上传 N 宫格分镜板 + "按这几格生成"
  • "长视频提示词""超长视频"

通用触发词: 运镜、景别、机位、推拉摇移、四维编码、Z轴、Y轴、X轴、剪辑节奏、剪辑公式、25格、分镜流水线、美学约束、Octane渲染、冷暖色调、赛博霓虹、dreamina、即梦、Seedance、图生视频


提示词维度

扩写或反推时,从以下维度中选择必要项,不机械塞满所有维度。各维度由知识库15维度文件覆盖:

维度 说明 知识库位置
主体描述 人/物/场景,含外貌细节与微表情 知识库/01_主体描述
动作/行为 主体动作、姿势、互动 知识库/02_动作行为
场景描述 背景、环境、时间、天气 知识库/03_场景描述
镜头类型 景别(特写→远景) 知识库/04_镜头类型 + 四维编码 Z 轴
运镜方式 摄像机运动方式与节奏 知识库/05_运镜方式 + 四维编码运动维度
焦距/视角 镜头焦段、拍摄角度 知识库/06_焦距视角 + 四维编码 Y/X/F 轴
光线/时间 光源类型、方向、强弱 知识库/07_光线时间(光影三层-光源层)
氛围/天气 情绪氛围、天气条件 知识库/08_氛围天气
色彩风格/后期处理 调色、滤镜、电影质感 知识库/09_色彩后期(光影三层-色调层 + 冷暖色调)
后期细节 磨皮、锐化、运动模糊、胶片颗粒 知识库/10_后期细节(有机瑕疵)
特效/渲染 光效、散景、粒子、GI/SSS/体积光 知识库/11_特效渲染(深度美学约束)
画质/分辨率 输出规格 ⚠️ 知识库/12_画质分辨率(平台 UI 设置,非提示词废话词;反塑料感宣言)
音效/音频 空间声学、材质拟声、音色控制 知识库/13_音效音频(视频提示词 音效: 行专用)
构图/画面布局 构图法则、版式、画面布局 知识库/14_构图布局(极简先锋构图法则)
视觉风格 导演风格参数化映射 + 艺术流派/渲染风格 知识库/15_视觉风格(28+风格去名化)

完整维度候选词见 references/知识库/ 各维度文件:镜头景别→04_镜头类型/镜头景别词库.md、运镜→05_运镜方式/运镜方式词库.md、焦距视角/四维编码→06_焦距视角/焦距视角词库.md、光影→07_光线时间/光线时间词库.md、有机瑕疵/反塑料感→10_后期细节/后期细节词库.md、胶片型号/画质→12_画质分辨率/画质分辨率词库.md、音效→13_音效音频/音效音频词库.md、构图→14_构图布局/构图布局词库.md、导演风格→15_视觉风格/视觉风格词库.md。F1/F3 图片提示词维度体系同上,不另设来源。


运镜四维编码系统

一个完整镜头 = [Z 距离] + [Y 高度] + [X 方位] + [F 滤镜] + [运动] + [节奏] + [约束]

完整编码表(Z1-Z9 景别/Y1-Y7 高度/X1-X4 方位/F 滤镜)、默认参数、焦段心理学见 references/知识库/06_焦距视角/焦距视角词库.md(Z 轴全表另见 04_镜头类型/镜头景别词库.md,运镜词库见 05_运镜方式/运镜方式词库.md)。

两条铁律(强制):

  1. 每个镜头最多双轴运动,三轴同时变化 = 失控
  2. Z1-Z3(近距)+ X 轴大幅旋转 = 崩脸陷阱,近景环绕应换 Z4+ 或减小旋转幅度

变量规则

只有当用户需要复用、替换、选择或做模板时才使用变量({{variable_name}})。变量分类(character/item/action/location/visual/technical/other)、内联默认值、候选词组规则在本节内建。


深度美学约束(商业级/电影级)

当项目要求商业级/电影级品质时,在基础结构之上叠加深度美学约束(渲染标准 GI/SSS/焦散/体积光、冷暖色调对比系统、极简先锋构图法则)。

渲染标准(GI/SSS/焦散/体积光)见 references/知识库/11_特效渲染/特效渲染词库.md;6 套冷暖色调 HEX 预设见 references/知识库/09_色彩后期/色彩后期词库.md;极简先锋构图法则见 references/知识库/14_构图布局/构图布局词库.md。

注意:3A 游戏风格图片(如"黑神话"系列)prompt 越短越有效,不要堆砌技术参数。


视频提示词工作流(Seedance2.0-ShotDesign v2.0)

详见 references/制作流程/分镜提示词制作流程.md(6步总流程+路径分流表+极简优先铁律)。本章节为 F2/F4 视频提示词的核心方法论框架。

F2 视频提示词工作流(5步)

F2(反推视频提示词)使用此5步工作流。F4(生成分镜提示词)在此基础上前置 Step 1 剧本分析,变为6步(详见 references/制作流程/分镜提示词制作流程.md)。

收到视频提示词需求后,严格按顺序执行:

步骤 名称 核心任务
1 需求解析与参数确认 确认时长/比例/生成模式/风格/素材;智能推理原则——能推理的不追问,追问控制在 1-2 个问题内
2 视觉诊断与分镜构思 三层知识库路由加载参考→构思分镜草案→选定导演风格与视觉方案
3 提示词构建 按4层结构撰写提示词(按类型适配选层;构建时用11字段思考清单内部过目),时间轴分镜,一镜一动
4 强制自我校验 8 项校验规则逐条检查,有 error 必重写,全部通过才可交付
5 专业交付 主题+导演阐述+完整提示词(代码块包裹),多段分镜附过渡策略

F2 的交互差异: F2 在步骤 2-3 插入两轮用户交互(选定 Hook → 输出提示词)。F4 在步骤 2 根据路径分流(A≤15s/B>15s/D分镜板),步骤 3 按场次逐镜头组装,步骤 5 同时输出分镜表格和提示词序列。

三层知识库路由

路由原则(以 references/知识库/ 15 维度目录为路由目标):镜头类维度(04_镜头类型/05_运镜方式/06_焦距视角)+ 品质类维度(10_后期细节/12_画质分辨率)始终加载;其余维度(主体微表情/场景/光影/音效/风格等)按需求语义加载;用户显式指定维度时直接加载对应词库。核心原则:宁可多读不可少读。运行时 references-add/知识库/ 同维度内容优先于 references/知识库/。

提示词模板

详见 references/制作流程/分镜提示词制作流程.md 第三节:3.1 基础六要素(构建思考参考)+ 3.2 4层结构(输出格式,含11字段内部思考清单 3.2.1 + 4层式输出 3.2.2含类型适配表,负面词放最后)+ 3.3 标准负面词模板。

4层结构按Step 1类型判定适配:①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先)+ ②设定(人物/场景/光线/构图/视觉风格,每项1句,按类型取舍)+ ③镜头叙事(每镜头1段流畅描述,朝向必须写明,连续动作不拆,有台词时带语气)+ ④负面提示词(放最后,3.3标准模板)。构建时用11字段思考清单内部过目确保不遗漏(一致性锚定/类型质感/人物设定/场景/景深对焦/摄影质感/表演幅度/背景动态/镜头空间/表演指令/负面词),但最终输出不出现字段标签。

光影三层结构

详见 references/知识库/07_光线时间/光线时间词库.md(光源层6类+光行为层9种+色调层8公式+灯光Recipes)。

光影:[光源词](光源层),[光行为词](光行为层),[色调公式](色调层)。

缺失任何一层视为不合格。从光线时间词库选取具体词汇填入。

⚠️ 冲突说明: seedance2.0-prompt-skill 将光影三层视为史诗/大制作结构的可选高级技巧;Seedance2.0-ShotDesign v2.0 将其作为每条视频提示词的强制规范。本技能以 ShotDesign 强制规范为准。对于极简概念片(4-8s、无复杂光影需求),可使用简化光影描述但须包含三层基本要素。

微表情系统(表演密集镜头专用)

7 区域分区词库(眼/眉/唇/鼻/颌喉/额/面颊)、4 级强度体系(L1-L4,默认 L2 内敛)、2 秒精度情绪弧线编排、反 AI 假脸三黄金准则见 references/知识库/01_主体描述/主体描述词库.md。

导演风格参数化映射

28+ 风格库(国际大师9位/中国影视4类/新媒体7类/特殊6类,每位含可直接嵌入的安全提示词)见 references/知识库/15_视觉风格/视觉风格词库.md。

去名化规范(强制): 最终提示词严禁出现导演名/IP名,必须降解为四轴物理参数(色彩/灯光/美术/机位),使用"安全提示词"行。


核心规则

综合两大参考技能+1个2.5时间测算参考的最佳实践提炼,执行以本节为准。流程级规则详见 references/制作流程/分镜提示词制作流程.md。

平台与合规:

  1. 提示词语言跟随用户——中文用户→中文提示词,非中文用户→英文提示词(Seedance2.0-ShotDesign v2.0 双语自动检测)

    ⚠️ 冲突说明: seedance2.0-prompt-skill 规则 #1 要求"所有提示词必须使用中文"。本技能以 ShotDesign 双语规则为准——中文用户输出中文,非中文用户输出英文。加载 seedance2.0 参考技能时,其全中文规则仅适用于中文用户场景。

  2. @引用使用对应语言命名:中文 @图片1,英文 @Image1
  3. 不得包含写实真人面部素材 — 平台会自动拦截,建议面部模糊或转 3D/动画风格
  4. 混合文件上限 12 个(图片≤9+视频≤3+音频≤3)
  5. 单次生成上限 15 秒,超出需分段拼接(>15s 自动分段,每段≤15s,最短≥8s)

品质与长度: 6. 提示词品质上限 ≤500 字符(中文)/ ≤1000 词(英文),最优区间 60-100 词(中文约 120-200 字符);平台硬性接受上限 ~2000 字符 7. 禁止废话词——"杰作/4k/8k/超清晰/masterpiece/ultra HD" 等,用物理材质词替代(反塑料感宣言) 8. 具体优于模糊——"穿红色风衣的女子在霓虹雨夜奔跑" >> "一个女人走路"

运镜与动作: 9. 运镜术语消歧义——中文用中文运镜词(推轨推进/航拍/摇臂升降),英文用完整短语(dolly tracking shot),禁止裸写 Dolly/Aerial/Crane/Pan/Arc/Dutch

⚠️ 冲突说明: seedance2.0-prompt-skill 的示例中大量混合中英文运镜词(如"Aerial大远景俯拍""Slow Crane Down""Smooth Orbit")。参考其案例时,必须将示例中的裸英文运镜词转换为消歧义后的安全写法(中文用中文运镜词,英文用完整短语),不可直接复制。

  1. 一镜一动——每个时间切片只指定一个运镜动作,主体运动和镜头运动分离描述(Seedance2.0-ShotDesign v2.0 新增)
  2. 运动强度明确化——使用具体修饰词(猛烈/渐进/丝滑/explosive/gradual/smooth),避免"糊动"

图生视频与叙事: 12. I2V 只写变化——图生视频时不重复首帧已有内容,用 保留原始构图和色彩 锁定一致性 13. 描述性优于叙事性——只写镜头看到的(视觉词),不写角色感受的(情绪词);情绪必须转化为可视化身体表现 14. 微表情克制原则——按需触发+强度分级,默认 L2(内敛/可读),每切片表情描写不超过 40%

图片提示词: 15. 不做机械直译,英文提示词应使用图像模型常见表达 16. 画幅比已声明,末尾有禁止项声明


质量自检清单

综合 seedance2.0-prompt-skill 质量自检 + Seedance2.0-ShotDesign 8项强制校验规则。 ⛔ 硬性规则:未通过校验的提示词禁止向用户展示。

8项强制校验规则(视频提示词,Seedance2.0-ShotDesign v2.0):

  • ① 长度检查:中文≤500字符 / 英文≤1000词(85%-100%为warning)
  • ② 时间切片检查:>5秒视频必须使用时间戳分镜,起点从0开始,无重叠,末端匹配
  • ③ 运镜专业度:至少包含1个专业运镜术语(缺失=监控探头感)
  • ④ 废话词拦截:杰作/超清晰/masterpiece=硬阻断;4k/8k=软警告
  • ⑤ 资产引用限制:图片≤9、视频≤3、音频≤3、混合≤12
  • ⑥ 冲突检测:运动冲突(快速+慢动作)、光学冲突(超广角+浅景深)、风格冲突(IMAX vs VHS 等)
  • ⑦ 裸英文运镜词检测:Dolly/Aerial/Crane/Pan/Arc/Dutch/Steadicam → 中文或完整短语
  • ⑧ 结构完整性:核心层(主体+负面词+镜头叙事)必须存在,②设定按类型取舍(A/B全用/C人物可选/D/E人物省略,详见制作流程第三节 3.2.2 类型适配表)

通用:

  • 提示词有清晰主体
  • 输出复杂度符合用户需求
  • 风格词和技术词有用而非堆砌

视频提示词:

  • @引用编号与素材清单一一对应
  • 总文件数 ≤ 12
  • 时间戳分镜覆盖完整时长
  • 运镜坐标合规(无双轴以上同时运动)
  • 总字符数 ≤2000(Python len() 实测,品质基准 ≤500)
  • 版权敏感词已扫(5 条铁律)
  • 一镜一动(每切片单一运镜动作)
  • 光影三层结构完整(光源层+光行为层+色调层)
  • 音效行以 音效: 开头,禁止项行使用标准内容
  • 输出语言与用户输入语言匹配

图片提示词:

  • 画幅比已声明
  • 人种特征与主题一致
  • 末尾有禁止项声明
  • 全部中文(NanoBanana/即梦)或自然英文(MJ/SD)

文件目录结构

一、技能文件目录(Skill 根目录)

提示词生成工具/                        ← Skill 根目录
├── SKILL.md                              ← 技能入口文件(本文件)
│
├── 参考skills/                            ← 知识库(1个外部参考技能,只读,方法论来源;ShotDesign/seedance25 已提炼落库至 references/)
│   └── seedance2.0-prompt-skill/         ← F2/F4 视频提示词工程参考(四维编码体系)
│       ├── SKILL.md                      ← 视频提示词完整方法论
│       ├── references/                   ← 14 个专题参考文件
│       │   ├── camera-codec.md           ← 四维编码系统(Z/Y/X/F)
│       │   ├── aesthetic-constraints.md  ← 深度美学约束
│       │   ├── production-pipeline.md    ← 长视频生产流水线
│       │   ├── editing-rhythm.md         ← 剪辑节奏公式
│       │   ├── image-generation.md       ← 图片生成规范
│       │   ├── image-to-prompt.md        ← 图生视频方法论(路径C)
│       │   ├── storyboard-driven.md      ← 分镜板驱动(路径D)
│       │   ├── creative-strategy.md      ← 创意策略
│       │   ├── long-video-strategy.md    ← 长视频策略
│       │   ├── platform-specs.md         ← 平台规范
│       │   ├── vocabulary.md             ← 词汇库
│       │   ├── examples.md               ← 示例库
│       │   └── cli-integration.md        ← CLI 集成
│       ├── experiments/cases/            ← 30 个实验案例
│       └── projects/                     ← 项目案例
│
├── references/                           ← 默认引用文件地址(标准库,出厂自带)
│   ├── README.md                         ← 标准库说明
│   ├── 制作流程/                          ← 标准制作流程(分镜提示词制作流程/长视频分段制作流程/图生视频与分镜板制作流程/多镜头剪辑节奏流程,共4文件)
│   ├── 接口调用/                          ← 接口定义与平台规范(当前平台规范见制作流程/分镜提示词制作流程.md 第六节;此目录预留给未来独立 API/MCP 文档)
│   ├── _meta/                             ← 辅助参考资料(案例库/术语表)
│   └── 知识库/                            ← 标准知识库(15 维度,按提示词组成要素分类)
│       ├── 01_主体描述/                   ← 人/物/场景,含外貌细节与微表情系统
│       ├── 02_动作行为/                   ← 主体动作、姿势、互动、物理连贯性
│       ├── 03_场景描述/                   ← 背景、环境、时间、天气、空间锚定
│       ├── 04_镜头类型/                   ← 景别(特写→远景)+ 四维编码 Z 轴
│       ├── 05_运镜方式/                   ← 摄像机运动方式与节奏 + 四维编码运动维度
│       ├── 06_焦距视角/                   ← 镜头焦段、拍摄角度 + 四维编码 Y/X/F 轴 + 焦段心理学
│       ├── 07_光线时间/                   ← 光源类型、方向、强弱 + 光影三层(光源层/光行为层/色调层)
│       ├── 08_氛围天气/                   ← 情绪氛围、天气条件
│       ├── 09_色彩后期/                   ← 调色、滤镜、电影质感 + 冷暖色调对比系统
│       ├── 10_后期细节/                   ← 磨皮、锐化、运动模糊、胶片颗粒 + 有机瑕疵
│       ├── 11_特效渲染/                   ← 光效、散景、粒子、GI/SSS/体积光 + 深度美学约束
│       ├── 12_画质分辨率/                 ← 输出规格 + 反塑料感宣言(平台 UI 设置,非提示词废话词)
│       ├── 13_音效音频/                   ← 空间声学、材质拟声、音色控制(视频提示词 `音效:` 行)
│       ├── 14_构图布局/                   ← 构图法则、版式、画面布局、极简先锋构图
│       └── 15_视觉风格/                   ← 导演风格参数化映射(28+风格去名化)+ 艺术流派/渲染风格
│
└── references-add/                       ← 用户部署后新增沉淀地(增量库,冲突时增量优先)
    ├── README.md                         ← 增量机制说明
    ├── 制作流程/                          ← 新增/变更的制作流程
    ├── 接口调用/                          ← 新增的 API 接口文档与平台规范
    └── 知识库/                            ← 新增知识(15 维度,与 references/ 结构对应)
        ├── 01_主体描述/                   ← 人/物/场景,含外貌细节与微表情系统
        ├── 02_动作行为/                   ← 主体动作、姿势、互动、物理连贯性
        ├── 03_场景描述/                   ← 背景、环境、时间、天气、空间锚定
        ├── 04_镜头类型/                   ← 景别(特写→远景)+ 四维编码 Z 轴
        ├── 05_运镜方式/                   ← 摄像机运动方式与节奏 + 四维编码运动维度
        ├── 06_焦距视角/                   ← 镜头焦段、拍摄角度 + 四维编码 Y/X/F 轴 + 焦段心理学
        ├── 07_光线时间/                   ← 光源类型、方向、强弱 + 光影三层
        ├── 08_氛围天气/                   ← 情绪氛围、天气条件
        ├── 09_色彩后期/                   ← 调色、滤镜、电影质感 + 冷暖色调对比系统
        ├── 10_后期细节/                   ← 磨皮、锐化、运动模糊、胶片颗粒 + 有机瑕疵
        ├── 11_特效渲染/                   ← 光效、散景、粒子、GI/SSS/体积光 + 深度美学约束
        ├── 12_画质分辨率/                 ← 输出规格 + 反塑料感宣言
        ├── 13_音效音频/                   ← 空间声学、材质拟声、音色控制
        ├── 14_构图布局/                   ← 构图法则、版式、画面布局、极简先锋构图
        └── 15_视觉风格/                   ← 导演风格参数化映射 + 艺术流派/渲染风格

二、过程产物目录(产出落盘位置)

⛔ 产出路径唯一权威:references-add/路径配置.md。执行分镜创作前必须先读该文件;用户自定义路径优先。默认路径按运行环境判定(两步:第一步查本机 D:\AgentSkill 是否存在——无 = ③用户环境(技能无论装在哪、什么路径);有 → 第二步看技能自身路径——在 D:\AgentSkill\ 下 = ①开发机、含 .dsh = ②dsh 环境):dsh 环境优先操作主工作区 D:\dshworkspace\创作任务\(与脚本创作技能同根同构),无主工作区时兜底用户桌面 DSHSkill项目/;开发机/用户环境为用户桌面 MCNSkill项目/(账号层直挂:{账号名}/提示词{编号}/,与脚本创作「脚本{编号}」同构,Windows/macOS 自动适配)。按账号名/提示词编号建子目录(编号默认继承上游脚本编号)。

D:\dshworkspace\创作任务\              ← dsh 环境优先根目录(主工作区「创作任务」,与脚本创作同根;无主工作区时兜底桌面 DSHSkill项目/)
└── {账号名}/                            ← 对应账号(从上游脚本创作上下文继承,来自 references-add/路径配置.md;开发机/用户环境为 桌面 MCNSkill项目/{账号名}/,账号层直挂)
    └── 提示词{编号}/                    ← 与「脚本{编号}」平级(编号默认继承上游脚本编号)
        ├── 00_剧本分析.md               ← Step 1 剧本分析(5维度)
        ├── 01_需求分析与路径.md          ← Step 2-3 需求分析+路径分流
        ├── 02_段1提示词.md              ← Step 4 提示词构建(多段递增 03/04…)
        ├── 05_校验与交付.md             ← Step 5-6 强制校验+交付
        └── 分镜提示词_终版.md           ← 最终交付物(可带模板版本命名)

首次创建时检查已有文件夹避免标题冲突;技能目录内 output/ 仅存放开发期样例与审计报告,不作为用户产出位置。


动态增量管理

本技能采用三层引用架构:

层级 目录 定位 读写
1 参考skills/ 外部参考技能(方法论来源,已提炼落库至 references/) 只读
2 references/ 默认引用文件地址(出厂自带标准库) 开发环境可编辑;部署环境只读
3 references-add/ 用户部署后新增的流程/方法/知识库沉淀地 可读写,持续增长

部署环境检测

根据两步判定模型判断当前环境(第一步查本机 D:\AgentSkill 是否存在;有 → 第二步看技能自身路径):

环境 判定条件 增量机制 新增内容写入位置
①开发机 本机有 D:\AgentSkill 且技能路径在 D:\AgentSkill\ 下 不启用 references-add/ 直接写入 references/ 对应子目录
②dsh 部署环境 本机有 D:\AgentSkill 且技能路径含 .dsh 启用 references-add/ 写入 references-add/ 对应子目录,不修改 references/
③用户环境 本机无 D:\AgentSkill(技能无论装在哪、什么路径,如 ~/.workbuddy/skills/...) 启用 references-add/ 写入 references-add/ 对应子目录,不修改 references/

冲突检测与修复

用户在对话过程中新增方法、流程、知识库后,执行以下冲突检测流程:

  1. 比对检测:将新增内容与 references/ 中同类内容逐一比对(同名文件、同主题内容)
  2. 无冲突:直接写入 references-add/ 对应子目录
  3. 有冲突:以新增内容为主(写入 references-add/),同时在 references/ 对应文件中加 ⚠️ 注释标注冲突点及增量库中的正确规则,不删除或覆盖标准库原始内容

运行时引用优先级

技能执行过程中同时加载 references/ 和 references-add/,两者内容冲突时以 references-add/ 为主:

参考skills/(方法论源) → references/(默认标准库) → references-add/(用户增量,冲突时以此为准)

快速启动模板

F1/F2 反推模式

【输入素材】
- 类型:[图片 / 视频]
- 路径/URL:[粘贴路径]
- 目标平台:[即梦Seedance / NanoBanana / Midjourney / SD]
- 期望输出:[图片提示词 / 视频提示词]
- 视频时长(F2):[4-8s / 9-12s / 13-15s / >15s]

F3 生成模式

【创作需求】
- 内容描述:[一句话描述你想要的画面]
- 图像类型:[角色参考图 / 首帧图 / 产品摄影 / 概念艺术 / 其他]
- 画幅比:[9:16 / 16:9 / 1:1 / 3:2 / 21:9]
- 风格偏好:[写实 / 3D渲染 / 插画 / 概念艺术 / 其他]
- 复杂度:[极简 / 平衡 / 结构化]

F4 分镜模式

【创作需求】
- 视频时长:[≤15s / >15s / >45s]
- 视频比例:[9:16 / 16:9 / 1:1]
- 脚本来源:[已有脚本粘贴 / 分镜板上传 / 需AI先生成]
- 参考素材:[纯文本 / 有图片 / 有图片+视频]

【脚本内容】(如已有)
- [粘贴脚本正文]

【分镜板】(如上传)
- [上传 N 宫格分镜板图片]