Files
mcn-short-video/project/短视频脚本创作/V1.0/subskills/mcn-video-prompt/SKILL.md
T

46 KiB
Raw Blame History

name, description, version, agent_created, updated_at, last_change, deployment, created_at
name description version agent_created updated_at last_change deployment created_at
短视频分镜脚本 短视频视觉创作提示词工程技能:图片提示词反推、视频提示词反推、 生图提示词生成、分镜提示词生成(脚本→分镜)。 适用于即梦 Seedance、Midjourney、Stable Diffusion 等 AI 生图/生视频平台。 触发场景:反推提示词、图生文、视频提示词、生图提示词、分镜提示词、 角色卡、首帧图、运镜、景别、时间戳分镜、图生视频。 1.0 true 2026-09-04 09-04 R73 F1 细则下沉:F1 节保留骨架(流程0-6+Step-Check+词库导航行)+🔴必读指针;人物专项/类型适配表/文字转录/反向词7类/双版本×两层输出/金标锚点逐字保护/视线词表/结构化格式模板等完整细则迁 references/功能/F1_图片反推细则.md(执行 F1 先通读该文件再动手);细则内词库引用改相对自身路径 ../知识库/…;SKILL.md 680→596 行、78.5→46.7KB。此前(08-31):④主体设定→④设定 改名(20处全量替换:SKILL.md 6 + 分镜提示词制作流程.md 10 + 长视频分段制作流程.md 4);6层结构定稿:①主体列表→②画面质感→③色调光影→④设定(人物/场景/构图,每项1句)→⑤镜头叙事→⑥负面提示词;视觉基调前置(模型对提示词开头权重最高);站位/构图边界固化(08-31):构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写),注记入 3.2.2 输出格式块+适配表+SKILL.md F4 结构定义 source 2026-08-20

短视频分镜脚本 Skill

技能概述

本技能是一套中文优先的 AI 视觉提示词工程系统,专注于短视频分镜脚本创作场景。将图片、视频、文字描述、脚本等输入,转化为可直接用于 AI 生图/生视频平台的高质量提示词。

四大核心功能:

功能 名称 输入 输出 主要参考技能
F1 反推图片提示词 图片 图片生成提示词 内建方法论(观察→增强→结构化)
F2 反推视频提示词 图片/视频 视频生成提示词 references/制作流程(5步工作流+多模态参考+8项校验)+ seedance2.0(路径C/D+四维编码+版权铁律)
F3 生成图片提示词 文字描述/概念 图片生成提示词 知识库/15维度(品质锚定+材质库+反塑料感)
F4 生成分镜提示词 脚本/分镜板 分镜提示词序列 references/制作流程(时间戳分镜+智能分段+长视频策略)+ seedance2.0(生产流水线+剪辑节奏)

参考技能位置: 参考skills/(技能根目录下,1个外部参考技能,只读,提供基础方法论;ShotDesign/seedance25 方法论已提炼落库至 references/,源文件已移除)

  • seedance2.0-prompt-skill/ — 视频/图片提示词生成(即梦 Seedance 2.0 专用,含四维编码、美学约束、剪辑节奏、生产流水线、30个实验案例)

知识库采用三层引用架构:参考skills/(方法论源)→ references/(默认标准库)→ references-add/(用户增量)。详见下方「动态增量管理」节。


四大核心功能

F1. 反推图片提示词

适用场景:

  • 用户上传/链接/引用一张图片
  • "反推提示词""看图写提示词""图生文""img2prompt""根据这张图写提示词"

处理流程: 0. 视觉准入门(P0):开始反推前必须确认模型真实看见图片像素,而不是只拿到文件路径/文件指针/历史上下文。准入验证方式:先写出3个不可从文件名、历史提示词或用户文字中猜出的画面事实(如具体人物动作、背景可见元素、光线落点)。若看不到图、图像未成功加载、视觉通道不确定,必须停止并告知"当前无法看见图片,不能反推提示词",禁止根据历史描述、用户反馈、文件名、前轮提示词脑补生成。

  1. 判断图片类型(7类:产品摄影/电商、人像、风景、美食、建筑室内、海报文字、抽象艺术;难判时用产品摄影模板),顺带扫描图片质量(模糊/过曝/裁切/水印),质量结果决定第4步"疑似"标注密度
  2. 三层观察画面要素(先事实层,再关系层,最后神韵层;缺一不可):
    • 事实层:基础属性(画幅比)、构图透视+机位、光影布光、色彩色调、纹理材质、主体细节、道具清单、场景空间、画质质感。人物含服装结构(外层+内层+腰部如有)、持物/挂载物、发型佩戴、脸型肤色;场景按前中后景三层列出。
    • 关系层:人物是否看镜头、谁看谁、视线落点、人物之间是否有交互、动作是否像行走/闲聊/经过镜头而非摆拍、人物与道具是否是生活动作而非展示动作。多人图必须判断"同一瞬间"与"人物关系",不能只列人和物;人物交互必须做强度分级(无交互/弱交互/中交互/强交互):弱交互=同行交流感、眼神略偏、身体不明显转向;中交互=一方看向另一方但不互相凝视;强交互=双方明确对视/凝视/身体明显转向。原图是弱交互时,提示词只能写"轻微交流感/眼神略偏/非强对视",禁止自动升级成"互相看着对方/凝视/强对视"。
    • 神韵层:画面为什么像活人——清纯/松弛/灵动/古典/生活流/湿润晨雾/空气感/水润感/烟火气等;同时标出AI易污染方向(网红脸、摆拍感、假笑、硬衣、干冰烟雾、影楼感)。
  3. 按类型叠加专属栏目(见下方"类型适配表")
  4. 置信分级与硬软锚点分级:区分高置信观察和推测性风格词,严禁脑补画面不存在内容;低分辨率图用"疑似/隐约可见"标注。硬锚点用于道具、服装形制、人物站位、持物关系、前中后景元素;软锚点用于人脸、表情、视线、互动、气质、空气感和画面神韵。硬锚点要具体,软锚点要语境化,禁止用极限器官量化压死人脸神韵。
  5. 输出双版本:A.结构还原版(保道具/服装/场景/人物位置不丢);B.神韵优化版(保审美/表情/互动/空气感,适当松绑器官级硬量化)。默认优先交付神韵优化版,同时保留结构还原版供审计。
  6. 如需复用,提炼 {{variable}} 变量并提供候选词组

每步自检(Step-Check,每步执行完必做,不通过则重做该步,禁止带病进下一步):

步骤 自检判据(逐项回看原图核对)
0 视觉准入 必须能说出3个不可从上下文猜出的画面事实;若只拿到路径/文件指针/历史描述,立即停止,禁止脑补生成
1 类型判断 类型判定与质量扫描结论将落地到第4步标注密度;无"扫了一眼就定型"
2 三层观察 错误重灾区,每层写完结论后回看原图一次再落笔:①事实层——朝向/肤色/持物/挂载物/服装/场景逐项核;②关系层——是否看镜头、谁看谁、是否边走边聊、动作是否生活化,并标注交互强度(无/弱/中/强),弱交互不得写成互相凝视;③神韵层——是否有活人感、松弛感、湿润空气感、古典骨相;④核法必须是"先看图、再对照已写结论"——拿结论去图里找印证=确认偏差
3 类型叠加 专属栏目与三层观察底座无重复无遗漏
4 置信+硬软锚点分级 所有推测词带"疑似";所见即所得维度无脑补;硬锚点(道具/服装/站位/持物)必须具体,软锚点(表情/脸/视线/空气感)禁止极限量化
5 输出前美学自检 ①人物标签=完整主体名称;②道具/挂载物逐件打勾;③反向词正向零出现;④坐标系分界;⑤正负提示词分离;⑥活人感自检:是否网红脸/假笑/惊恐张嘴/直视镜头游客照/硬衣塑料感/干冰烟雾;若出现,降低器官硬量化,改用神态语境与审美负向词
5.5 生成闭环复盘 多轮出图后先列保留项/回退项/替换项;已经实测有效的脸部、表情、视线、道具、场景锚点必须逐字复制(见"金标锚点逐字保护"),禁止同义改写;只替换失败模块,禁止一轮失败后全量重写导致上一轮优势丢失
6 变量提炼 变量化不破坏实体聚合结构(同一人物属性不拆到多段)

🔴 执行细则必读(R73): F1 细则(人物专项/类型适配表/文字转录强制/反向词7类与选配/目标平台适配/输出双版本与两层分工/画面感保护/金标锚点逐字保护/视线词高风险与匹配表/结构化版格式模板/多图模式/风格反推双轨/还原路径指引)→ 完整细则见 references/功能/F1_图片反推细则.md,执行 F1 时先通读该文件再动手(细则为实测沉淀,跳过即复现踩坑)。

详细方法论(观察维度→词库语言对照):

  • 人物专项+微表情7区域拼乐高+反AI假脸四大陷阱:references/知识库/01_主体描述/主体描述词库.md
  • 姿势粒度语言(三层动作分级+运动强度修饰词,肢体姿势/手部/视线落点写法):references/知识库/02_动作行为/动作行为词库.md
  • 光影布光(光影三层:光源层/光行为层/色调层+常用灯光组合速查;强方向光用逆光入画写法——"光从人物背后X上方射入,发丝边缘发光(rim light glow)"):references/知识库/07_光线时间/光线时间词库.md
  • 色彩色调(冷暖色调六套预设+后期处理词+张力宣言):references/知识库/09_色彩后期/色彩后期词库.md
  • 构图透视+机位+前中后景三层布置+画面坐标方位(极简先锋五法则+构图几何词库+构图模板):references/知识库/14_构图布局/构图布局词库.md
  • 镜头焦距+光圈推断+X轴朝向+画面坐标规则(四维编码Y/X轴+摄影器材英文参数6.1):references/知识库/06_焦距视角/焦距视角词库.md + references/知识库/10_后期细节/后期细节词库.md
  • 场景模板与特效词(21类垂直场景+丁达尔/体积光,可选):references/知识库/03_场景描述/场景描述词库.md + references/知识库/11_特效渲染/特效渲染词库.md
  • 纹理材质+画质质感(有机瑕疵+反塑料感套装+摄影质感维度表):references/知识库/10_后期细节/后期细节词库.md + references/知识库/12_画质分辨率/画质分辨率词库.md(反塑料感宣言+胶片型号)
  • 视觉风格反推(28+导演风格去名化规范+国际大师/中国影视/新媒体/特殊四类风格库):references/知识库/15_视觉风格/视觉风格词库.md


F2. 反推视频提示词

适用场景:

  • 用户上传图片要求"用这张图做视频""图生视频""根据图片生成视频"
  • 用户上传视频要求"分析这个视频的提示词""反推视频提示词"
  • "这张图怎么做成视频""图生视频提示词"

处理流程(5步工作流 + 两轮交互):

F2 在 5 步工作流框架内执行,其中步骤 2-3 包含两轮用户交互:

步骤 名称 F2 执行内容 交互
1 需求解析 确认时长/比例/生成模式/风格/素材;能推理的不追问 —
2 视觉诊断 读图/读视频→主体/氛围/最有戏元素/画质来源/4层退化策略/建议时长/比例诊断/平台合规风险 → 给出 2 个 Hook 候选(反应/凝视) 第1轮:用户选定 Hook
3 提示词构建 用户选定后,按基础六要素公式输出完整提示词(凝视/反应模式对应不同模板),一镜一动 第2轮:输出提示词
4 强制校验 8 项校验规则逐条检查,有 error 必重写 —
5 专业交付 代码块包裹提示词 + 主题 + 导演阐述 —

5 步工作流详见下方「视频提示词工作流」节。两轮交互模式与 Hook 候选(反应/凝视)见 references/制作流程/图生视频与分镜板制作流程.md 路径C 双范式。

核心约束:

  • Seedance prompt 上限 2000 字符(Python len() 实测,平台接受上限);品质最优区间 ≤500 字符(超出导致模型注意力崩溃,详见下方冲突说明)
  • 版权敏感词必扫(5 条铁律:禁夜场BGM词/不凑齐夜场环境4元素/删涉灰场景词/多人场景用静态全景机位/禁人物×道具物理交互)
  • 运镜四维编码系统(Z/Y/X/F)
  • 前 2 秒生死线

⚠️ 字符限制冲突说明: seedance2.0-prompt-skill 实测平台接受上限 2000 字符;Seedance2.0-ShotDesign v2.0 官方规范建议 ≤500 字符(中文)/ ≤1000 词(英文),品质最优区间 60-100 词(中文约 120-200 字符)。以 500 字符为品质基准,2000 字符为硬性上限。

详细方法论:

  • 6步总流程+路径分流+6层结构(主体/画面质感/色调光影/设定/镜头叙事/负面词,视觉基调前置,11字段降为内部思考清单)+时长速查:references/制作流程/分镜提示词制作流程.md

详细方法论:

  • 路径C双范式(反应/凝视)+11条核心原则+版权审查SOP:references/制作流程/图生视频与分镜板制作流程.md
  • 四维编码(Z景别/Y高度/X方位/F滤镜):references/知识库/04_镜头类型/镜头景别词库.md + references/知识库/06_焦距视角/焦距视角词库.md
  • 运镜安全写法+运动强度分级:references/知识库/05_运镜方式/运镜方式词库.md
  • 光影三层+品质锚定+反塑料感:references/知识库/07_光线时间/光线时间词库.md + references/知识库/12_画质分辨率/画质分辨率词库.md

F3. 生成图片提示词

适用场景:

  • 用户提供一句话、关键词、草稿、半成品提示词
  • "帮我写生图提示词""优化提示词""扩写提示词""变高级""结构化"
  • 视频生产前置:角色参考图、首帧图、关键帧图

处理流程:

  1. 识别主体和目标图像类型
  2. 补充必要维度:主体细节、场景、风格、构图、光影、色彩、材质、情绪、技术质量、画幅比例
  3. 判断复杂度级别(极简/平衡/结构化)
  4. 先输出可复制结果,再补充变量和建议

复杂度分级:

级别 适用场景 格式
Level 1 极简版 快速试图、不喜欢复杂结构 [主体],[核心风格],[场景/构图],[光影/氛围],[质量收尾]
Level 2 平衡版(默认) 大多数用户 [主体+特征],[环境],[动作],[构图/镜头],[光影],[色彩],[风格],[质量],[画幅比]
Level 3 结构化版 模板化、商业级、可复用 分维度展开:主体/场景/构图/光影/色彩/风格/细节/质量/负面约束

图片类型:

  • 角色参考图(9:16 竖版)— 视频生产前置步骤
  • 首帧图(与视频画幅比一致)
  • 产品摄影、概念艺术、杂志封面等通用类型

详细规范:

  • 角色卡(10段结构)+首帧图+一致性锁定:references/制作流程/长视频分段制作流程.md
  • 材质质感库+反塑料感宣言+胶片型号+有机瑕疵:references/知识库/10_后期细节/后期细节词库.md + references/知识库/12_画质分辨率/画质分辨率词库.md
  • 导演风格参数化映射(28+风格去名化+四轴降解):references/知识库/15_视觉风格/视觉风格词库.md

F4. 生成分镜提示词

适用场景:

  • 用户提供脚本/分镜板,要求"按分镜生成""拆分镜""分镜提示词"
  • 长视频(>15秒)需走完整前期制作流程
  • 用户上传 N 宫格分镜板/漫画分镜

前置:剧本分析(Step 1,必做)

进入路径分流前,先完成剧本类型判定(A叙事剧情/B单人Vlog/C旁白知识/D产品展示/E纯氛围)+ 维度拆解(①节奏全类型必做,②-⑤按类型选做),产出驱动后续路径选择、景别设计、微表情弧线、台词语气修饰、6层格式适配。详见 references/制作流程/分镜提示词制作流程.md Step 1。

处理流程(按路径分流):

路径 触发条件 核心任务
A — ≤15秒单段 纯文字描述,无图片 找到单一视觉 hook,生成 2-3 个版本
B — >15秒长视频 需叙事/多镜头 走生产流水线:角色设计→角色卡片图→分镜脚本→分镜参考图→逐镜头提示词+剪辑方案
D — 分镜板驱动 上传 N 宫格分镜板 拆解多格→D-1(≤4格单条多段)/D-2(≥5格多条独立)→输出 prompt+剪辑节奏建议

输出格式:

F4 输出 = 主题 + 导演阐述 + 完整提示词(代码块包裹)。多镜头序列附过渡策略。

完整输出模板(基础结构/时间戳分段/时长服从内容/极简优先铁律)见 references/制作流程/分镜提示词制作流程.md。

单段(路径 A,≤15s): 主题 + 导演阐述 + 单块代码块提示词

提示词内部结构(6层结构,按类型适配):①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先)→ ②画面质感(视觉风格+摄影质感参数,视觉基调前置)→ ③色调光影(光源+主光方向+亮暗区+色调/色温,1句)→ ④设定(人物逐人必写不可遗漏/场景/构图,每项1句,按类型取舍)→ ⑤镜头叙事(每镜头1段流畅描述:机位/景别/朝向+动作/变化+运镜嵌在动作中+有台词时带语气)→ ⑥负面提示词(放最后,3.3标准模板);站位/构图边界:构图=画面布局归④设定-构图,站位=画面坐标归⑤镜头叙事(逐镜头写,词库03_场景描述·演员调度)

11字段(一致性锚定/类型质感/人物设定/场景/景深对焦/摄影质感/表演幅度/背景动态/镜头空间/表演指令/负面词)降为构建时内部思考清单,不作为输出字段标签。详见制作流程第三节 3.2。

5s 使用时间戳分段;≤5s 可用单段描述。

史诗/大制作(可选,科幻/灾难/奇幻等高品质视觉): 追加品质锚定(渲染引擎+VFX等级)+ 大气连贯声明 + 收束句

多段分镜(路径 B,>15s): 主题 + 总时长 + 过渡策略 + N 个独立分镜(每段≤15s,各含完整提示词代码块)

分镜板(路径 D): D-1(≤4格)单条多段 / D-2(≥5格)多条独立提示词;格间关系三分类与决策见 references/制作流程/图生视频与分镜板制作流程.md

时长、比例、分辨率在即梦平台 UI 底部控制栏设置,提示词中不重复指定。

剪辑节奏公式(>15秒必选): 呼吸式 / 心跳式 / 海浪式 / 子弹时间 / 脉冲式 / 静默锤击

详细方法论:

  • 创意策略+6步总流程+路径分流+6层结构(主体/画面质感/色调光影/设定/镜头叙事/负面词,视觉基调前置,11字段降为内部思考清单)+标准负面词:references/制作流程/分镜提示词制作流程.md
  • 长视频策略+生产流水线(25格聚合矩阵+节奏曲线+景别曲线+P0/P1/P2优先级):references/制作流程/长视频分段制作流程.md
  • 分镜板驱动(路径D格间关系三分类+三层动作分级):references/制作流程/图生视频与分镜板制作流程.md
  • 剪辑节奏(六大节奏公式+AI素材专属5对策+9步工作流):references/制作流程/多镜头剪辑节奏流程.md
  • 垂直场景模板(21类场景清单+演员调度三要素+过渡策略6种):references/知识库/03_场景描述/场景描述词库.md
  • 微表情系统(面部7区域+4级强度+情绪弧线编排,表演密集镜头专用):references/知识库/01_主体描述/主体描述词库.md
  • 音频与音效标签规范(空间声学+材质拟声+音色控制):references/知识库/13_音效音频/音效音频词库.md

触发条件

当用户表达以下意图时,加载并使用本技能:

F1 反推图片提示词:

  • "反推提示词""看图写提示词""图生文""img2prompt"
  • 上传图片 + "帮我写提示词"

F2 反推视频提示词:

  • "图生视频""根据图片生成视频""这张图怎么做成视频"
  • "反推视频提示词""分析这个视频的提示词"
  • 上传图片/视频 + "做成视频"

F3 生成图片提示词:

  • "帮我写生图提示词""优化提示词""扩写提示词"
  • "角色参考图""首帧图""关键帧图""生成角色卡提示词"

F4 生成分镜提示词:

  • "拆分镜""分镜提示词""按分镜生成""逐镜头提示词"
  • 上传 N 宫格分镜板 + "按这几格生成"
  • "长视频提示词""超长视频"

通用触发词: 运镜、景别、机位、推拉摇移、四维编码、Z轴、Y轴、X轴、剪辑节奏、剪辑公式、25格、分镜流水线、美学约束、Octane渲染、冷暖色调、赛博霓虹、dreamina、即梦、Seedance、图生视频


提示词维度

扩写或反推时,从以下维度中选择必要项,不机械塞满所有维度。各维度由知识库15维度文件覆盖:

维度 说明 知识库位置
主体描述 人/物/场景,含外貌细节与微表情 知识库/01_主体描述
动作/行为 主体动作、姿势、互动 知识库/02_动作行为
场景描述 背景、环境、时间、天气 知识库/03_场景描述
镜头类型 景别(特写→远景) 知识库/04_镜头类型 + 四维编码 Z 轴
运镜方式 摄像机运动方式与节奏 知识库/05_运镜方式 + 四维编码运动维度
焦距/视角 镜头焦段、拍摄角度 知识库/06_焦距视角 + 四维编码 Y/X/F 轴
光线/时间 光源类型、方向、强弱 知识库/07_光线时间(光影三层-光源层)
氛围/天气 情绪氛围、天气条件 知识库/08_氛围天气
色彩风格/后期处理 调色、滤镜、电影质感 知识库/09_色彩后期(光影三层-色调层 + 冷暖色调)
后期细节 磨皮、锐化、运动模糊、胶片颗粒 知识库/10_后期细节(有机瑕疵)
特效/渲染 光效、散景、粒子、GI/SSS/体积光 知识库/11_特效渲染(深度美学约束)
画质/分辨率 输出规格 ⚠️ 知识库/12_画质分辨率(平台 UI 设置,非提示词废话词;反塑料感宣言)
音效/音频 空间声学、材质拟声、音色控制 知识库/13_音效音频(视频提示词 音效: 行专用)
构图/画面布局 构图法则、版式、画面布局 知识库/14_构图布局(极简先锋构图法则)
视觉风格 导演风格参数化映射 + 艺术流派/渲染风格 知识库/15_视觉风格(28+风格去名化)

完整维度候选词见 references/知识库/ 各维度文件:镜头景别→04_镜头类型/镜头景别词库.md、运镜→05_运镜方式/运镜方式词库.md、焦距视角/四维编码→06_焦距视角/焦距视角词库.md、光影→07_光线时间/光线时间词库.md、有机瑕疵/反塑料感→10_后期细节/后期细节词库.md、胶片型号/画质→12_画质分辨率/画质分辨率词库.md、音效→13_音效音频/音效音频词库.md、构图→14_构图布局/构图布局词库.md、导演风格→15_视觉风格/视觉风格词库.md。F1/F3 图片提示词维度体系同上,不另设来源。


运镜四维编码系统

一个完整镜头 = [Z 距离] + [Y 高度] + [X 方位] + [F 滤镜] + [运动] + [节奏] + [约束]

完整编码表(Z1-Z9 景别/Y1-Y7 高度/X1-X4 方位/F 滤镜)、默认参数、焦段心理学见 references/知识库/06_焦距视角/焦距视角词库.md(Z 轴全表另见 04_镜头类型/镜头景别词库.md,运镜词库见 05_运镜方式/运镜方式词库.md)。

两条铁律(强制):

  1. 每个镜头最多双轴运动,三轴同时变化 = 失控
  2. Z1-Z3(近距)+ X 轴大幅旋转 = 崩脸陷阱,近景环绕应换 Z4+ 或减小旋转幅度

变量规则

只有当用户需要复用、替换、选择或做模板时才使用变量({{variable_name}})。变量分类(character/item/action/location/visual/technical/other)、内联默认值、候选词组规则在本节内建。


深度美学约束(商业级/电影级)

当项目要求商业级/电影级品质时,在基础结构之上叠加深度美学约束(渲染标准 GI/SSS/焦散/体积光、冷暖色调对比系统、极简先锋构图法则)。

渲染标准(GI/SSS/焦散/体积光)见 references/知识库/11_特效渲染/特效渲染词库.md;6 套冷暖色调 HEX 预设见 references/知识库/09_色彩后期/色彩后期词库.md;极简先锋构图法则见 references/知识库/14_构图布局/构图布局词库.md。

注意:3A 游戏风格图片(如"黑神话"系列)prompt 越短越有效,不要堆砌技术参数。


视频提示词工作流(Seedance2.0-ShotDesign v2.0)

详见 references/制作流程/分镜提示词制作流程.md(6步总流程+路径分流表+极简优先铁律)。本章节为 F2/F4 视频提示词的核心方法论框架。

F2 视频提示词工作流(5步)

F2(反推视频提示词)使用此5步工作流。F4(生成分镜提示词)在此基础上前置 Step 1 剧本分析,变为6步(详见 references/制作流程/分镜提示词制作流程.md)。

收到视频提示词需求后,严格按顺序执行:

步骤 名称 核心任务
1 需求解析与参数确认 确认时长/比例/生成模式/风格/素材;智能推理原则——能推理的不追问,追问控制在 1-2 个问题内
2 视觉诊断与分镜构思 三层知识库路由加载参考→构思分镜草案→选定导演风格与视觉方案
3 提示词构建 按6层结构撰写提示词(按类型适配选层;构建时用11字段思考清单内部过目),时间轴分镜,一镜一动
4 强制自我校验 8 项校验规则逐条检查,有 error 必重写,全部通过才可交付
5 专业交付 主题+导演阐述+完整提示词(代码块包裹),多段分镜附过渡策略

F2 的交互差异: F2 在步骤 2-3 插入两轮用户交互(选定 Hook → 输出提示词)。F4 在步骤 2 根据路径分流(A≤15s/B>15s/D分镜板),步骤 3 按场次逐镜头组装,步骤 5 同时输出分镜表格和提示词序列。

三层知识库路由

路由原则(以 references/知识库/ 15 维度目录为路由目标):镜头类维度(04_镜头类型/05_运镜方式/06_焦距视角)+ 品质类维度(10_后期细节/12_画质分辨率)始终加载;其余维度(主体微表情/场景/光影/音效/风格等)按需求语义加载;用户显式指定维度时直接加载对应词库。核心原则:宁可多读不可少读。运行时 references-add/知识库/ 同维度内容优先于 references/知识库/。

提示词模板

详见 references/制作流程/分镜提示词制作流程.md 第三节:3.1 基础六要素(构建思考参考)+ 3.2 6层结构(输出格式,含11字段内部思考清单 3.2.1 + 6层式输出 3.2.2含类型适配表,负面词放最后)+ 3.3 标准负面词模板。

6层结构按Step 1类型判定适配:①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先)+ ②画面质感(视觉风格+摄影质感参数,视觉基调前置)+ ③色调光影(光源+主光方向+亮暗区+色调/色温,1句)+ ④设定(人物/场景/构图,每项1句,按类型取舍)+ ⑤镜头叙事(每镜头1段流畅描述,朝向必须写明,连续动作不拆,有台词时带语气)+ ⑥负面提示词(放最后,3.3标准模板)。构建时用11字段思考清单内部过目确保不遗漏(一致性锚定/类型质感/人物设定/场景/景深对焦/摄影质感/表演幅度/背景动态/镜头空间/表演指令/负面词),但最终输出不出现字段标签。

光影三层结构

详见 references/知识库/07_光线时间/光线时间词库.md(光源层6类+光行为层9种+色调层8公式+灯光Recipes)。

光影:[光源词](光源层),[光行为词](光行为层),[色调公式](色调层)。

缺失任何一层视为不合格。从光线时间词库选取具体词汇填入。

⚠️ 冲突说明: seedance2.0-prompt-skill 将光影三层视为史诗/大制作结构的可选高级技巧;Seedance2.0-ShotDesign v2.0 将其作为每条视频提示词的强制规范。本技能以 ShotDesign 强制规范为准。对于极简概念片(4-8s、无复杂光影需求),可使用简化光影描述但须包含三层基本要素。

微表情系统(表演密集镜头专用)

7 区域分区词库(眼/眉/唇/鼻/颌喉/额/面颊)、4 级强度体系(L1-L4,默认 L2 内敛)、2 秒精度情绪弧线编排、反 AI 假脸三黄金准则见 references/知识库/01_主体描述/主体描述词库.md。

导演风格参数化映射

28+ 风格库(国际大师9位/中国影视4类/新媒体7类/特殊6类,每位含可直接嵌入的安全提示词)见 references/知识库/15_视觉风格/视觉风格词库.md。

去名化规范(强制): 最终提示词严禁出现导演名/IP名,必须降解为四轴物理参数(色彩/灯光/美术/机位),使用"安全提示词"行。


核心规则

🔴 技能内一切文件引用必须用相对路径(绝对路径随部署机器变化失效;md 链接相对自身文件解析、禁止越级出技能根)→ 路径引用规范.md

综合两大参考技能+1个2.5时间测算参考的最佳实践提炼,执行以本节为准。流程级规则详见 references/制作流程/分镜提示词制作流程.md。

平台与合规:

  1. 提示词语言跟随用户——中文用户→中文提示词,非中文用户→英文提示词(Seedance2.0-ShotDesign v2.0 双语自动检测)

    ⚠️ 冲突说明: seedance2.0-prompt-skill 规则 #1 要求"所有提示词必须使用中文"。本技能以 ShotDesign 双语规则为准——中文用户输出中文,非中文用户输出英文。加载 seedance2.0 参考技能时,其全中文规则仅适用于中文用户场景。

  2. @引用使用对应语言命名:中文 @图片1,英文 @Image1
  3. 不得包含写实真人面部素材 — 平台会自动拦截,建议面部模糊或转 3D/动画风格
  4. 混合文件上限 12 个(图片≤9+视频≤3+音频≤3)
  5. 单次生成上限 15 秒,超出需分段拼接(>15s 自动分段,每段≤15s,最短≥8s)

品质与长度: 6. 提示词品质上限 ≤500 字符(中文)/ ≤1000 词(英文),最优区间 60-100 词(中文约 120-200 字符);平台硬性接受上限 ~2000 字符 7. 禁止废话词——"杰作/4k/8k/超清晰/masterpiece/ultra HD" 等,用物理材质词替代(反塑料感宣言) 8. 具体优于模糊——"穿红色风衣的女子在霓虹雨夜奔跑" >> "一个女人走路"

运镜与动作: 9. 运镜术语消歧义——中文用中文运镜词(推轨推进/航拍/摇臂升降),英文用完整短语(dolly tracking shot),禁止裸写 Dolly/Aerial/Crane/Pan/Arc/Dutch

⚠️ 冲突说明: seedance2.0-prompt-skill 的示例中大量混合中英文运镜词(如"Aerial大远景俯拍""Slow Crane Down""Smooth Orbit")。参考其案例时,必须将示例中的裸英文运镜词转换为消歧义后的安全写法(中文用中文运镜词,英文用完整短语),不可直接复制。

  1. 一镜一动——每个时间切片只指定一个运镜动作,主体运动和镜头运动分离描述(Seedance2.0-ShotDesign v2.0 新增)
  2. 运动强度明确化——使用具体修饰词(猛烈/渐进/丝滑/explosive/gradual/smooth),避免"糊动"

图生视频与叙事: 12. I2V 只写变化——图生视频时不重复首帧已有内容,用 保留原始构图和色彩 锁定一致性 13. 描述性优于叙事性——只写镜头看到的(视觉词),不写角色感受的(情绪词);情绪必须转化为可视化身体表现 14. 微表情克制原则——按需触发+强度分级,默认 L2(内敛/可读),每切片表情描写不超过 40%

图片提示词: 15. 不做机械直译,英文提示词应使用图像模型常见表达 16. 画幅比已声明,末尾有禁止项声明


质量自检清单

综合 seedance2.0-prompt-skill 质量自检 + Seedance2.0-ShotDesign 8项强制校验规则。 ⛔ 硬性规则:未通过校验的提示词禁止向用户展示。

8项强制校验规则(视频提示词,Seedance2.0-ShotDesign v2.0):

  • ① 长度检查:中文≤500字符 / 英文≤1000词(85%-100%为warning)
  • ② 时间切片检查:>5秒视频必须使用时间戳分镜,起点从0开始,无重叠,末端匹配
  • ③ 运镜专业度:至少包含1个专业运镜术语(缺失=监控探头感)
  • ④ 废话词拦截:杰作/超清晰/masterpiece=硬阻断;4k/8k=软警告
  • ⑤ 资产引用限制:图片≤9、视频≤3、音频≤3、混合≤12
  • ⑥ 冲突检测:运动冲突(快速+慢动作)、光学冲突(超广角+浅景深)、风格冲突(IMAX vs VHS 等)
  • ⑦ 裸英文运镜词检测:Dolly/Aerial/Crane/Pan/Arc/Dutch/Steadicam → 中文或完整短语
  • ⑧ 结构完整性:核心层(主体+负面词+镜头叙事)必须存在,②画面质感/③色调光影全类型必用,④设定按类型取舍(A/B全用/C人物可选/D/E人物省略,详见制作流程第三节 3.2.2 类型适配表)

通用:

  • 提示词有清晰主体
  • 输出复杂度符合用户需求
  • 风格词和技术词有用而非堆砌

视频提示词:

  • @引用编号与素材清单一一对应
  • 总文件数 ≤ 12
  • 时间戳分镜覆盖完整时长
  • 运镜坐标合规(无双轴以上同时运动)
  • 总字符数 ≤2000(Python len() 实测,品质基准 ≤500)
  • 版权敏感词已扫(5 条铁律)
  • 一镜一动(每切片单一运镜动作)
  • 光影三层结构完整(光源层+光行为层+色调层)
  • 音效行以 音效: 开头,禁止项行使用标准内容
  • 输出语言与用户输入语言匹配

图片提示词:

  • 画幅比已声明
  • 人种特征与主题一致
  • 末尾有禁止项声明
  • 全部中文(NanoBanana/即梦)或自然英文(MJ/SD)

文件目录结构

一、技能文件目录(Skill 根目录)

提示词生成工具/                        ← Skill 根目录
├── SKILL.md                              ← 技能入口文件(本文件)
│
├── 参考skills/                            ← 知识库(1个外部参考技能,只读,方法论来源;ShotDesign/seedance25 已提炼落库至 references/)
│   └── seedance2.0-prompt-skill/         ← F2/F4 视频提示词工程参考(四维编码体系)
│       ├── SKILL.md                      ← 视频提示词完整方法论
│       ├── references/                   ← 14 个专题参考文件
│       │   ├── camera-codec.md           ← 四维编码系统(Z/Y/X/F)
│       │   ├── aesthetic-constraints.md  ← 深度美学约束
│       │   ├── production-pipeline.md    ← 长视频生产流水线
│       │   ├── editing-rhythm.md         ← 剪辑节奏公式
│       │   ├── image-generation.md       ← 图片生成规范
│       │   ├── image-to-prompt.md        ← 图生视频方法论(路径C)
│       │   ├── storyboard-driven.md      ← 分镜板驱动(路径D)
│       │   ├── creative-strategy.md      ← 创意策略
│       │   ├── long-video-strategy.md    ← 长视频策略
│       │   ├── platform-specs.md         ← 平台规范
│       │   ├── vocabulary.md             ← 词汇库
│       │   ├── examples.md               ← 示例库
│       │   └── cli-integration.md        ← CLI 集成
│       ├── experiments/cases/            ← 30 个实验案例
│       └── projects/                     ← 项目案例
│
├── references/                           ← 默认引用文件地址(标准库,出厂自带)
│   ├── README.md                         ← 标准库说明
│   ├── 制作流程/                          ← 标准制作流程(分镜提示词制作流程/长视频分段制作流程/图生视频与分镜板制作流程/多镜头剪辑节奏流程,共4文件)
│   ├── 接口调用/                          ← 接口定义与平台规范(当前平台规范见制作流程/分镜提示词制作流程.md 第六节;此目录预留给未来独立 API/MCP 文档)
│   ├── _meta/                             ← 辅助参考资料(案例库/术语表)
│   └── 知识库/                            ← 标准知识库(15 维度,按提示词组成要素分类)
│       ├── 01_主体描述/                   ← 人/物/场景,含外貌细节与微表情系统
│       ├── 02_动作行为/                   ← 主体动作、姿势、互动、物理连贯性
│       ├── 03_场景描述/                   ← 背景、环境、时间、天气、空间锚定
│       ├── 04_镜头类型/                   ← 景别(特写→远景)+ 四维编码 Z 轴
│       ├── 05_运镜方式/                   ← 摄像机运动方式与节奏 + 四维编码运动维度
│       ├── 06_焦距视角/                   ← 镜头焦段、拍摄角度 + 四维编码 Y/X/F 轴 + 焦段心理学
│       ├── 07_光线时间/                   ← 光源类型、方向、强弱 + 光影三层(光源层/光行为层/色调层)
│       ├── 08_氛围天气/                   ← 情绪氛围、天气条件
│       ├── 09_色彩后期/                   ← 调色、滤镜、电影质感 + 冷暖色调对比系统
│       ├── 10_后期细节/                   ← 磨皮、锐化、运动模糊、胶片颗粒 + 有机瑕疵
│       ├── 11_特效渲染/                   ← 光效、散景、粒子、GI/SSS/体积光 + 深度美学约束
│       ├── 12_画质分辨率/                 ← 输出规格 + 反塑料感宣言(平台 UI 设置,非提示词废话词)
│       ├── 13_音效音频/                   ← 空间声学、材质拟声、音色控制(视频提示词 `音效:` 行)
│       ├── 14_构图布局/                   ← 构图法则、版式、画面布局、极简先锋构图
│       └── 15_视觉风格/                   ← 导演风格参数化映射(28+风格去名化)+ 艺术流派/渲染风格
│
└── references-add/                       ← 用户部署后新增沉淀地(增量库,冲突时增量优先)
    ├── README.md                         ← 增量机制说明
    ├── 制作流程/                          ← 新增/变更的制作流程
    ├── 接口调用/                          ← 新增的 API 接口文档与平台规范
    └── 知识库/                            ← 新增知识(15 维度,与 references/ 结构对应)
        ├── 01_主体描述/                   ← 人/物/场景,含外貌细节与微表情系统
        ├── 02_动作行为/                   ← 主体动作、姿势、互动、物理连贯性
        ├── 03_场景描述/                   ← 背景、环境、时间、天气、空间锚定
        ├── 04_镜头类型/                   ← 景别(特写→远景)+ 四维编码 Z 轴
        ├── 05_运镜方式/                   ← 摄像机运动方式与节奏 + 四维编码运动维度
        ├── 06_焦距视角/                   ← 镜头焦段、拍摄角度 + 四维编码 Y/X/F 轴 + 焦段心理学
        ├── 07_光线时间/                   ← 光源类型、方向、强弱 + 光影三层
        ├── 08_氛围天气/                   ← 情绪氛围、天气条件
        ├── 09_色彩后期/                   ← 调色、滤镜、电影质感 + 冷暖色调对比系统
        ├── 10_后期细节/                   ← 磨皮、锐化、运动模糊、胶片颗粒 + 有机瑕疵
        ├── 11_特效渲染/                   ← 光效、散景、粒子、GI/SSS/体积光 + 深度美学约束
        ├── 12_画质分辨率/                 ← 输出规格 + 反塑料感宣言
        ├── 13_音效音频/                   ← 空间声学、材质拟声、音色控制
        ├── 14_构图布局/                   ← 构图法则、版式、画面布局、极简先锋构图
        └── 15_视觉风格/                   ← 导演风格参数化映射 + 艺术流派/渲染风格

二、过程产物目录(产出落盘位置)

⛔ 产出路径唯一权威:references-add/路径配置.md。执行分镜创作前必须先读该文件;用户自定义路径优先。默认路径按运行环境判定(两步:第一步查本机 D:\AgentSkill 是否存在——无 = ③用户环境(技能无论装在哪、什么路径);有 → 第二步看技能自身路径——在 D:\AgentSkill\ 下 = ①开发机、含 .dsh = ②dsh 环境):dsh 环境优先操作主工作区 D:\dshworkspace\创作任务\(与脚本创作技能同根同构),无主工作区时并入用户环境;开发机/用户环境为用户桌面 MCNSkill项目/(账号层直挂:{账号名}/提示词{编号}/,与脚本创作「脚本{编号}」同构,Windows/macOS 自动适配)。按账号名/提示词编号建子目录(编号默认继承上游脚本编号)。

D:\dshworkspace\创作任务\              ← dsh 环境优先根目录(主工作区「创作任务」,与脚本创作同根;无主工作区时并入用户环境)
└── {账号名}/                            ← 对应账号(从上游脚本创作上下文继承,来自 references-add/路径配置.md;开发机/用户环境为 桌面 MCNSkill项目/{账号名}/,账号层直挂)
    └── 提示词{编号}/                    ← 与「脚本{编号}」平级(编号默认继承上游脚本编号)
        ├── 00_剧本分析.md               ← Step 1 剧本分析(5维度)
        ├── 01_需求分析与路径.md          ← Step 2-3 需求分析+路径分流
        ├── 02_段1提示词.md              ← Step 4 提示词构建(多段递增 03/04…)
        ├── 05_校验与交付.md             ← Step 5-6 强制校验+交付
        └── 分镜提示词_终版.md           ← 最终交付物(可带模板版本命名)

首次创建时检查已有文件夹避免标题冲突;技能目录内 output/ 仅存放开发期样例与审计报告,不作为用户产出位置。


动态增量管理

本技能采用三层引用架构:

层级 目录 定位 读写
1 参考skills/ 外部参考技能(方法论来源,已提炼落库至 references/) 只读
2 references/ 默认引用文件地址(出厂自带标准库) 开发环境可编辑;部署环境只读
3 references-add/ 用户部署后新增的流程/方法/知识库沉淀地 可读写,持续增长

部署环境检测

根据两步判定模型判断当前环境(第一步查本机 D:\AgentSkill 是否存在;有 → 第二步看技能自身路径):

环境 判定条件 增量机制 新增内容写入位置
①开发机 本机有 D:\AgentSkill 且技能路径在 D:\AgentSkill\ 下 不启用 references-add/ 直接写入 references/ 对应子目录
②dsh 部署环境 本机有 D:\AgentSkill 且技能路径含 .dsh 启用 references-add/ 写入 references-add/ 对应子目录,不修改 references/
③用户环境 本机无 D:\AgentSkill(技能无论装在哪、什么路径,如 ~/.workbuddy/skills/...) 启用 references-add/ 写入 references-add/ 对应子目录,不修改 references/

冲突检测与修复

用户在对话过程中新增方法、流程、知识库后,执行以下冲突检测流程:

  1. 比对检测:将新增内容与 references/ 中同类内容逐一比对(同名文件、同主题内容)
  2. 无冲突:直接写入 references-add/ 对应子目录
  3. 有冲突:以新增内容为主(写入 references-add/),同时在 references/ 对应文件中加 ⚠️ 注释标注冲突点及增量库中的正确规则,不删除或覆盖标准库原始内容

运行时引用优先级

技能执行过程中同时加载 references/ 和 references-add/,两者内容冲突时以 references-add/ 为主:

参考skills/(方法论源) → references/(默认标准库) → references-add/(用户增量,冲突时以此为准)

快速启动模板

F1/F2 反推模式

【输入素材】
- 类型:[图片 / 视频]
- 路径/URL:[粘贴路径]
- 目标平台:[即梦Seedance / NanoBanana / Midjourney / SD]
- 期望输出:[图片提示词 / 视频提示词]
- 视频时长(F2):[4-8s / 9-12s / 13-15s / >15s]

F3 生成模式

【创作需求】
- 内容描述:[一句话描述你想要的画面]
- 图像类型:[角色参考图 / 首帧图 / 产品摄影 / 概念艺术 / 其他]
- 画幅比:[9:16 / 16:9 / 1:1 / 3:2 / 21:9]
- 风格偏好:[写实 / 3D渲染 / 插画 / 概念艺术 / 其他]
- 复杂度:[极简 / 平衡 / 结构化]

F4 分镜模式

【创作需求】
- 视频时长:[≤15s / >15s / >45s]
- 视频比例:[9:16 / 16:9 / 1:1]
- 脚本来源:[已有脚本粘贴 / 分镜板上传 / 需AI先生成]
- 参考素材:[纯文本 / 有图片 / 有图片+视频]

【脚本内容】(如已有)
- [粘贴脚本正文]

【分镜板】(如上传)
- [上传 N 宫格分镜板图片]