技能三副本迭代:路径重构+输出边界铁律+开场口径区分+审计修复

- 路径重构:脚本创作 V1.0/Lite1.0 扁平化(去技能文件夹层),分镜技能迁移至 短视频提示词生成/V1.0,旧路径清理
- 输出边界铁律固化:创作流程规范.md 新增「交付物输出边界(通用铁律)」+ S9 输出模板新增「输出边界」块(验收口径=执行约束非输出内容)
- 开场钩子铁律三层固化:00_开场/06_编导终审/S9 相关规则 + S5 预设钩子口径区分(前3秒=呈现窗口,3-7秒=开场段总时长)
- 帮助文档:新增「从账号分析到脚本创作」跨技能章节(你这样问|我会做什么风格)
- mcn-dou-analysis 内嵌副本:红线边界声明+人设卡术语更新(设定分析说明)
This commit is contained in:
maogeigei committed 2026-08-26 17:28:21 +08:00
1 parent 37eb75501b
commit b3685504d7
561 files changed
+47048 -1290

No files matched your search

@@ -0,0 +1,408 @@
# 分镜提示词制作流程
> 来源:ShotDesign 5步工作流 + seedance2.0-prompt-skill 路径分流/极简优先铁律 + seedance-specs 官方公式 + seedance25-timed-prompter 精准时间测算体系
> 适用:F3(生成图片)、F4(生成分镜)单镜头提示词的标准制作路径
## 一、总流程(6步)
```
①剧本分析 → ②需求分析 → ③路径分流 → ④提示词构建 → ⑤强制校验 → ⑥交付
```
### Step 1 剧本分析(生成提示词前必做)
> 产出仅在上下文中驱动下游,不单独落盘。**未完成此步骤不得进入提示词构建。**
**1a 剧本类型判定(先做):**
| 类型 | 特征 | 典型场景 |
|------|------|---------|
| A 叙事剧情 | 有角色+对白+情节弧线 | 短剧/情景喜剧/故事短片 |
| B 单人出镜 | 单人+口播/Vlog | 探店/美食/旅行/亲子Vlog |
| C 旁白知识 | 画外音驱动+无角色对白 | 科普/教程/纪录片/解说 |
| D 产品展示 | 产品为主体+人物为辅或无 | 产品广告/开箱/展示 |
| E 纯氛围 | 无人物无对白+纯视觉流 | 风景空镜/概念片/MV |
**1b 维度拆解(①全类型必做,②-⑤按类型选做):**
| 维度 | 拆解项 | 适用类型 | 产出 → 驱动下游 |
|------|--------|---------|----------------|
| ① 节奏·叙事逻辑 | 故事线/视觉节奏一句话概括 / 叙事结构(线性·倒叙·插叙·环形)/ 节奏图(铺陈→蓄力→爆发→余韵,标注时间区间)/ 叙事驱动类型(事件·对白·旁白·混合·视觉流)/ **台词风格**(方言·口语·书面·旁白语气——剧本未写但角色身份暗示的方言语气需在此提取) | 全类型 | → 路径分流 + 段落时长 + 台词语气修饰 |
| ② 爆点·情绪痛点 | 爆点定位(时间戳+触发事件+预期反应)/ 情绪痛点(观众共情触发点,非角色情绪)/ 视觉高潮点(非叙事类的画面冲击峰) | A/B/C | → 景别递进策略 + 运镜设计 |
| ③ 反转情节 | 反转类型(身份·认知·关系·命运)/ 反转锚点(铺垫在哪→引爆在哪)/ 前后对比(情绪·认知·关系变化) | A | → 镜头逻辑(一镜到底vs多段切换)+ 首末帧设计 |
| ④ 人物关系 | 关系图谱(主要角色+关系类型)/ 权力结构(谁主导·被动·被揭示)/ 关系变化弧线(反转前后) | A(多角色必做)/B(单人省略) | → 场景调度(站位·朝向·视线焦点)+ 景别选择 |
| ⑤ 情绪弱点 | 角色情绪弱点(内心最脆弱点=驱动力来源)/ 观众情绪弱点(什么击中观众=共鸣触发器)/ 弱点→爆点对应关系 | A/B | → 微表情弧线设计 + 动作时间常数选取 |
> D/E类:②-⑤均不适用,只做①(节奏+视觉流),驱动④层格式的镜头层(产品展示流程/氛围流变描述)
**分析 → 下游驱动关系:**
```
剧本分析
├─ 类型判定 → 4层格式适配(哪些层省略/变形,见3.2.2类型适配表)
├─①节奏+台词风格 → 路径分流 + 段落时长 + 台词语气修饰
├─②爆点/视觉高潮 → 景别递进 + 运镜设计(A/B/C类)
├─③反转 → 镜头逻辑 + 首末帧(A类)
├─④关系 → 场景调度 + 站位(A类多角色)
└─⑤弱点 → 微表情弧线 + 动作设计(A/B类)
↓
Step 4 提示词构建(按类型+场景选层)
```
> **示例A(叙事剧情类)——"母亲接到失踪儿子电话":**
> - 类型=A → 5维度全做
> - ①叙事逻辑=一镜到底(POV母亲眼睛)/ 线性 / 麻木→电话→紧张→不敢信→震惊→行动 → **路径C + 单段30秒**
> - ②爆点=电话铃声打破平静(第4-5秒)/ 痛点=长期消耗后的疲惫被一瞬间击碎 → **景别Z8→Z2递进 + 缓推→急推**
> - ③反转=认知反转(以为是日常→不是)/ 锚点=开头麻木日常铺垫→电话引爆 → **首帧=麻木日常 / 末帧=猛然行动**
> - ④关系=母子(但全程不露脸,只看苍老的手)/ 母亲被动·被揭示 → **调度=手部特写+环境 / 禁止面部镜头**
> - ⑤弱点=角色弱点=长期消耗后的疲惫 / 观众弱点=亲情本能触发 → **微表情降级L1 + 动作=从静止到猛然**
> **示例D(产品展示类)——"护肤品质地展示":**
> - 类型=D → 只做①,②-⑤跳过
> - ①节奏=视觉流:产品亮相→质地特写→涂抹过程→效果呈现 / 线性 / 铺陈(亮相)→蓄力(特写)→爆发(涂抹)→余韵(效果) → **路径A + 单段8秒**
> - 台词风格=N/A(无对白,可选旁白)
> - 驱动4层格式:①主体=护肤品(列道具行) ②设定-人物省略 ③镜头=产品展示流程(非角色动作)
### Step 2 需求分析
- 明确:时长、画幅(9:16 竖屏 / 16:9 横屏)、单镜头还是多镜头、有无参考素材
- 判断时长是否 >15 秒:超过则必须走《长视频分段制作流程》
- 判断叙事形态:瞬间反应 / 单一动作 / 情绪弧线 / 小剧情 / 完整叙事
- **结合 Step 1 剧本分析结论**:叙事结构决定镜头逻辑、节奏图决定段落时长、情绪弱点决定微表情弧线
### Step 3 路径分流(按输入素材类型)
| 路径 | 输入 | 方法 | 详见 |
|------|------|------|------|
| A 纯文本生成 | 无参考素材 | 官方公式直写 | 本文件第三节 |
| B 参考图/视频 | 图片或视频素材 | @引用锚定 + 补充描述 | 《图生视频与分镜板制作流程》 |
| C 图生视频(单图驱动) | 1 张图片 | 双范式:反应模式 / 凝视模式 | 《图生视频与分镜板制作流程》 |
| D 分镜板驱动 | 分镜脚本/多格规划 | 格间关系三分类 | 《图生视频与分镜板制作流程》 |
### Step 4 提示词构建
按第三节输出格式组装:按Step 1类型判定结果选择4层结构的适用层(见3.2.2类型适配表);构建时用11字段思考清单(3.2.1)内部过目确保不遗漏。词表从 `知识库/15维度` 各取所需。
**剧本分析(Step 1)产出是提示词组装的内容来源**:景别/运镜由爆点驱动、场景调度由人物关系驱动、微表情弧线由情绪弱点驱动、人物设定由角色定位驱动、表演指令由情绪弱点驱动、负面词由场景类型勾选。
### Step 5 强制校验(8项)
1. **字符数**:Python `len()` 实测,禁止估算;品质基准 ≤500 字符,硬性上限 ≤2000 字符(实测)
2. **结构完整性**:输出必须包含核心层(①主体 + ②设定 + ③镜头叙事 + ④负面词),②设定层按类型适配(A全用/B全用/C人物可选/D人物省略/E人物省略);顺序固定主体→设定→镜头→负面词
3. **版权扫描**:品牌词/风格借喻/涉灰场景词/夜场BGM词 四类扫描(详见《图生视频与分镜板制作流程》版权审查)
4. **导演去名化**:提示词中不得出现导演名/工作室名/IP名,只用参数化描述
5. **动作物理合理性**:三层动作分级检查(大动作禁止)
6. **多模态引用核对**:素材多时逐一检查 @对象指向正确;**素材编号一致性闸门**——同一角色/场景/道具在所有镜头必须用同一 @图片N,禁止编号混用(如镜头1用 @图片2 指男主、镜头2却用 @图片3 指男主)
7. **负面提示词**:标准化禁止清单(3.3)是否附上,通用项必须全带
8. **时长与内容匹配**:见"时长服从内容"速查
### Step 6 交付
- **镜头部分上方标注视频总时长**(如"视频总时长:8秒",放设定层之后、镜头段之前,属投喂信息不混入画面描述)
- 单镜头:代码块输出完整提示词
- 多镜头:逐镜头编号 + 代码块,附过渡策略(>15秒时);每段末尾写段末状态(可见姿态/视线/道具/光线/镜头方向),供下一段继承
## 二、极简优先铁律(跨路径通用)
- **默认 300-500 字符**,不是越多越好。实战数据:3102 字符违规 → 271 字符过审
- 文字只补 4 件事,其余交给参考图:
1. 图里没有的(新增元素)
2. 需强化的(图里弱但要突出的)
3. 需规避的(图里有但不要的)
4. 硬约束(画幅/时长/禁止项)
- 二分法定位问题:砍到极限版 30-50 字符 → 每次加 1 个元素 → 对比差异
## 三、结构化提示词模板(路径A)
### 3.1 基础六要素(构建思考参考,单镜头简单场景)
```
主体/角色 + 所在场景 + 核心动作/时序 + 镜头语言 + 画面风格/光影材质 + 音频要求
```
六要素词表对应:
| 要素 | 词库位置 |
|------|---------|
| 主体(外貌+微表情) | 知识库/01_主体描述 |
| 动作(物理阻尼+时间常数) | 知识库/02_动作行为 |
| 场景(环境+空间锚定) | 知识库/03_场景描述 |
| 镜头语言(景别Z+高度Y+方位X+焦段F) | 知识库/04~06 |
| 光影/风格/色彩 | 知识库/07~09、15 |
| 音效(原生音效优先) | 知识库/13_音效音频 |
### 3.2 输出格式(4层结构)
> **实战验证**(2026-08-20):编导手写提示词(~350字,叙事驱动)生成效果优于结构化11字段模板(~700字,技术参数驱动)。**模型吃故事,不吃参数表。**
> **改造原则**:11字段降为构建时**内部思考清单**(确保不遗漏),最终输出只写**4层结构**——主体置顶按类别分行、设定按类型分项、镜头叙事流畅、负面词放最后。技术参数溶解进设定各分项,表演靠动作暗示而非禁令。按Step 1类型判定结果选择4层的适用层。
#### 3.2.1 构建思考清单(内部,不落盘)
构建提示词时逐项过目,确保不遗漏。但**最终提示词中不出现字段标签**——信息溶解进叙事段落。
| 思考项 | 构建时想什么 | 输出时去哪 |
|--------|-------------|-----------|
| ①一致性锚定 | 角色服装/道具是否需文字锁定? | ①主体列表@图片引用锁定;无图才在②设定-人物补1句 |
| ②类型质感 | 画质/风格/光影基调? | ②设定-视觉风格(1句) |
| ③人物设定 | 逐角色外貌/着装/气质? | ①主体列表@图片锁定;无图在②设定-人物补1句(**主体中每个人物必写,不可遗漏**) |
| ④场景 | 空间布局/道具? | ②设定-场景(1句空间描述) |
| ⑤景深对焦 | 是否需非默认景深? | **默认不写**;特写需浅景深时加进②设定-构图 |
| ⑥摄影质感 | 机型/镜头/光圈/快门/ISO/色彩/光影/质感/动态范围? | 按维度自动生成英文摄影参数(从知识库/10_后期细节·摄影质感维度表取值,判断适用维度组合),排除画幅/帧率 |
| ⑦表演幅度 | 需禁某种表演? | **默认不写**;用动作暗示替代("鬼鬼祟祟地说"比"禁夸张表情"有效) |
| ⑧背景动态 | 需环境微动? | **默认不写**;仅在画面可能静止时加进③镜头动作描述 |
| ⑨镜头空间 | 机位/景别/朝向? | 溶进③镜头叙事("中景跟拍男主正面") |
| ⑩表演指令 | 逐beat微动作? | 溶进③镜头叙事的动作描述 |
| ⑪负面词 | 场景适配禁止项? | ④负面提示词(3.3标准模板) |
> **原则:能用@图片引用解决的,绝不写文字;能用动作暗示的,绝不写技术参数。**
#### 3.2.2 输出格式(4层结构)
```
①主体列表(置顶,按类别分行)
人物:[角色名] @[图片N] [角色名] @[图片N]
场景:[场景名] @[图片N]
道具:[物品名] @[图片N] [物品名] @[图片N]
> 所有出场人物、关键场景、道具分三类分行列,@图片引用优先,无图用1句简述
> 有哪类列哪类,无道具/无场景则省略该行;D类主体=产品(列道具行),E类主体=场景(列场景行)
> **人物锚定句(仅多角色+跨镜头复用时启用)**:`将 @图片N 中的[身份/外观/服装]定义为 <角色名>`,后续镜头用 `<角色名>` 指代、不再重复写外貌;**识别不到角色名时用角色代称锚定**(`<男主>` `<兄弟>` `<角色A>` 等代称);单人单段保持现状(`人物:男主 @图片2`),不写锚定句
②设定(分项,每项1句,按类型取舍)
人物:[角色]——[气质/状态1句];[角色]——[气质/状态1句]
> **主体中出现的每个人物,此处必须有对应设定,不可遗漏**——逐人写,用分号分隔
> @图片已锁定的不重复写外貌,只补气质/状态;无图时按知识库/01_主体描述外貌原则写(宁少写不错写);D/E类省略此行
场景:[空间布局+前中后景层次1句]
光线:[光源来源+主光方向+亮暗区+色温1句]
构图:[景别+前中后景层次+构图法则+视觉重心/留白1句]
视觉风格:[画质+风格+质感1句]
摄影质感:模型按维度自动生成英文摄影参数(机型/镜头/光圈/快门/ISO/色彩/光影/质感/动态范围),**用[]框起**,根据剧情场景判断适用维度,从知识库/10_后期细节·摄影质感维度表取值组合(不照搬固定示例);排除画幅/帧率(属平台参数放代码框外)
> 场景见知识库/03_场景描述(空间锚定三层);光线见知识库/07_光线时间(光影三层);构图见知识库/14_构图布局(五法则+构图几何+雷区规避);风格见知识库/15_视觉风格(去名化);朝向见知识库/06_焦距视角X轴
③镜头(每镜头1段流畅叙事)
镜头N:[机位/景别/朝向] + [动作/变化流程] + [运镜变化嵌在动作里] + [有台词时:(人物,语气):内容]
- 每镜头1段,按动作流自然叙述,不分beat罗列
- **朝向必须写明**:正面/背后/固定/侧面——用"正面拍摄""从背后拍摄""固定视角"等明确朝向(词库见知识库/06_焦距视角X轴+知识库/03_场景描述面部朝向/过肩);**主体位置用画面坐标**——写"男主位于画面右侧、四分之三侧朝镜头",不写"从男主右侧拍摄"(画面坐标优于主体坐标,生视频模型更易定位,词库见知识库/03_场景描述演员调度);**避开构图雷区**——默认不用"正面居中",改用 X2 四分之三侧/三分法偏移(雷区见知识库/14_构图布局)
- **机位高度默认平视**:视点与人物视线齐平(Y4 平视,词库见知识库/06_焦距视角Y轴);仅剧情需要压迫(俯视 Y6)或英雄感(仰视 Y2)时才偏离
- **空间方向一致性(多人/多镜头/有明确方位时写)**:锁定空间坐标("A在左、B在右、门在A背后")+ 移动方向一致("物体始终从右向左移动");禁止镜像翻转、禁止跨越180度轴线(词库见知识库/03_场景描述·空间锚定)
- **连续动作不拆**:同一空间内连续发生的动作链保持在一个镜头段内,不拆成多个镜头
- **衔接可见化**:镜头间/段间衔接必须写成可见动作转接或画面状态("镜头停在门框上的手""视线下移到腰侧血迹"),禁止写"接下一段/接分镜2/承接下一段"这类模型无法执行的衔接语
- 运镜写在动作流程中("镜头从正面绕到背后"),不独立成字段;固定/跟拍镜头可补"轻微手持呼吸感"增加活体感,避免死板的机械固定
- **有台词时**:台词带语气/方言/神态修饰,不用禁令式约束;台词格式+方言+情绪标签见知识库/13_音效音频·台词与情绪标签
- 时间戳可选标注在段首("0-3s:"),简单场景可不标
- 动作/变化要具体可视化(写"手指蘸取乳液在手腕推开"而非"涂抹"),不要泛泛
- **视听转译四步法**(内部思考,不落盘):遇到抽象情绪描述时依次问——①"演员用身体哪部分演?"(眼神/嘴角/手指/呼吸/步伐)②"摄影机用什么镜头能拍到?"(景别/焦段/角度/运镜)③"要不要靠声音/光线/物件辅助?"(环境音/道具状态变化/光线突变)。确保每句描述拍得到、录得到,不把心理活动当画面写
- **情绪铺垫分级(强情绪镜头)**:悲伤/愤怒/崩溃等强情绪不能第一帧满格爆发,按"克制→微表情泄露→情绪压上来→爆发"逐步递进(写"先愣住半秒、眼神失焦、嘴唇抿住、眼眶蓄泪、第一滴泪滑下",而非"突然崩溃大哭")。用动作暗示情绪递进,不写"禁止夸张表演"类禁令
- 有音效时:音效嵌在动作描述中自然出现("门铃声响起"、"啪的一声"),不独立成段
- **小道具朝向锁定**:手机/照片/证件/信封/戒指等有正反面的道具,必须写清朝向——屏幕或信息面朝镜头还是朝手心/桌面。写"手机背面朝镜头、屏幕朝向手心",不写"拿着手机"(模型默认会把信息面怼向镜头造成穿帮)
- **段末状态(仅多段连续输出时写,单段不写)**:每段末尾写一句"下一段可继承的可见状态"——角色姿态/视线方向/道具位置/光线方向/镜头方向,如"段末男主缩在门框边,薯片袋已被兄弟抢走,镜头停在两人对峙的正面"。用于跨段连续性的锚点
> D/E类镜头层写产品展示流程或氛围流变,不写角色动作
④负面提示词
负面提示词:[通用项] + [场景勾选项](见3.3)
> 负面词放最后——镜头叙事写完后整体排除
> BGM禁止由负面词覆盖(通用项已含"背景音乐,BGM,配乐"),不需要单独音频段
```
> **4层×5类型适配表(按Step 1类型判定结果选层):**
| 类型 | ①主体 | ②设定-人物 | ②设定-其余4项 | ③镜头-台词 | ③镜头-动作 |
|------|-------|-----------|-------------|-----------|-----------|
| A 叙事剧情 | 人物 | 全用 | 全用 | 对白格式 | 角色动作 |
| B 单人Vlog | 人物 | 全用 | 全用 | 口播(非对白) | 人物动作 |
| C 旁白知识 | 场景/道具 | 可选 | 全用 | 旁白格式 | 画面变化 |
| D 产品展示 | 产品 | 省略 | 全用 | 无(可选旁白) | 产品展示流程 |
| E 纯氛围 | 场景 | 省略 | 全用 | 无 | 氛围流变 |
> **编导式 vs 旧11字段版对比:**
>
> | 对比项 | 编导式(新) | 11字段版(旧) |
> |--------|-------------|---------------|
> | 字段标签 | 无,信息溶解进叙事 | 【一致性锚定】【景深对焦】等11个标签 |
> | 技术参数 | 溶进②设定层各分项 | 独立字段罗列(机型/f值/快门等) |
> | 表演控制 | 动作暗示("鬼鬼祟祟地说") | 禁令约束("禁夸张喜剧化表情") |
> | 镜头组织 | 每镜头1段流畅叙事 | 时间戳逐beat分段罗列 |
> | 字符量 | ~350字 | ~700字 |
> | 生成效果 | 实战验证更优 | token浪费在参数上 |
### 3.3 标准负面词模板
> 每次生成提示词时从以下分类中按场景选取,汇总为一条【负面词】段。通用项必须带,可选项按场景勾选。
**通用禁止项(每次必带):**
```
文字, 字幕, 水印, logo, 签名, 变形, 多手指, 少手指, 断肢, 肢体融合, 错误手部, 错误嘴型, 面部扭曲, 换脸, 穿模, 塑料人物质感, 过度磨皮, 蜡像感, CG感, 3D渲染感, 镜头焦点来回拉风箱游移, 不符合人类骨骼生理的关节弯曲
```
**按场景勾选:**
| 分类 | 禁止词 | 适用场景 |
|:---|:---|:---|
| 表演类 | 夸张表演, 油腻表演, 过度煽情, 人物表情木讷僵硬, 画面静止如照片 | 喜剧/生活流/剧情 |
| 运镜类 | 慢动作(非指定), 人物瞬移, 镜头漂浮, 机械云台感, 画面静止 | 动态场景 |
| 质感类 | 廉价电视剧质感, 网红短视频风格, 广告片质感, 平光, 过曝, 死黑, HDR, 劣质滤镜 | 通用 |
| 畸变类 | 鱼眼畸变, 桶形畸变, 枕形畸变, 超广角拉伸, 人脸边缘拉伸, 微缩景观感, 玩具模型感, 移轴效果 | 写实/建筑/室内/人物近景 |
| 风格类 | 与目标风格矛盾的词(如写实场景禁"卡通/二次元",古装禁"现代电器") | 按需 |
> 写法:`负面词:[通用项] + [勾选项]`,逗号分隔,不加解释。
## 四、时长服从内容(速查)
| 内容类型 | 建议时长 | 理由 |
|---------|---------|------|
| 一瞬间反应(一个眼神/一个动作) | 3-5 秒 | 短镜不拖 |
| 单一动作 + 一句台词 | 5-7 秒 | 刚好说完做完 |
| 两句台词交替 + 反应 | 7-10 秒 | 对话节奏 |
| 三句台词 + 走位 + 动作 | 10-12 秒 | 编排紧凑 |
| 追逐/打斗/复杂连招 | 12-15 秒(2.0)/ 12-30 秒(2.5) | 动作密度高不必硬切 |
| 古风台词(慢速)+ 情绪 | 比现代语速 +2-3 秒 | 古风语速 2-3 字/秒 |
| 完整叙事 | 12-15 秒(2.0)/ ≤30 秒(2.5) | 2.5 单次可达 30 秒 |
| 已有成片想继续演 | 延长段 ≤30 秒/次(2.5),总长 ≤60 秒 | 套娃延长 |
| 完整短片/MV/预告 | 超长视频模式 ≤180 秒(2.5) | 一次性直出,长时序一致性好 |
> 单次生成上限:2.0 = 15 秒;2.5 = 30 秒。更长的走分段流程或 2.5 超长/延长模式。
## 五、精准时间测算体系
> 来源:seedance25-timed-prompter。2.5 原生支持秒级/帧级时间戳控制——测算的每一秒模型都能精准执行。
**公式去向铁律**:测算公式(字数÷语速、步数×常数等)只出现在时间预算表等内部测算环节;**提示词正文只写时长结论**(如"(1.2s)"、"(3步,约1.5s)")。禁止把"4字÷3.5=1.2s"这类算式写进提示词正文——模型不做算术,算式是噪音且浪费字符额度。
### 5.1 台词语速公式表
| 台词类型 | 语速标准 | 测算公式 |
|---------|---------|---------|
| 普通中文对白 | 3-4 字/秒 | 字数 ÷ 3.5 = 秒数(取中值) |
| 情绪台词(哭腔/怒斥/颤抖/压抑) | 2-3 字/秒 | 字数 ÷ 2.5 = 秒数 |
| 古风台词/文言/诗词 | 2-3 字/秒 | 字数 ÷ 2.5 = 秒数 |
| 气声/耳语/低语 | 1.5-2 字/秒 | 字数 ÷ 1.8 = 秒数 |
| 外语对白(英/日/韩等) | 约 2.5-3 词/秒 | 词数 ÷ 2.8 = 秒数 |
| 停顿/迟疑/换气 | — | 每次 0.5-1 秒 |
| 表演补偿(开口前反应/说完后反应/视线变化) | — | 每次 0.5-1.5 秒 |
> 一句台词如果 >8 秒说不完 → 按自然停顿拆到多个时间戳区间,但原文不改。
### 5.2 动作时间常数表(14类)
| 动作类型 | 最短可看清时间 |
|---------|-------------|
| 简单表情反应(抬眉/抿嘴/眨眼) | 0.5-1 秒 |
| 关键眼神/对视 | 1-2 秒 |
| 转头/回身 | 1-2 秒 |
| 起身/坐下/蹲下 | 1.5-3 秒 |
| 走位(一步) | 0.5 秒/步 |
| 走位(从A点到B点,3-5步) | 2-4 秒 |
| 拔剑/推门/掀帘/摔杯 | 1-2 秒 |
| 单手交手一击 | 1-2 秒 |
| 连续交手(2-3个回合) | 3-5 秒 |
| 复杂长尾动作(后空翻+拔剑+落地连招) | 4-8 秒 |
| 物品拿起/递交/特写 | 1-2 秒 |
| 身体倒地/坠落 | 1.5-3 秒 |
| 害羞脸红 | ≥2.5 秒(视线躲闪→脸颊泛红→低头/抿嘴) |
| 落泪 | ≥3 秒(眼眶湿润→泪珠溢出→滑落) |
> 违反时间常数的动作会被 AI 压缩成"表情包式跳变",失去真实感。
### 5.3 运镜与衔接时间常数表
| 运镜类型 | 时间 |
|---------|------|
| 定场/环境建立 | 1-2 秒 |
| 推/拉镜头 | 1-3 秒 |
| 摇/移镜头 | 1-2 秒 |
| 跟拍 | 与主体动作同步 |
| 硬切 | 0-0.5 秒 |
| 淡入/淡出/叠化 | 1-2 秒 |
| 首帧承接(建立空间方位) | 1-2 秒 |
| 末帧钩子停留 | 1-2 秒 |
### 5.4 帧级时间戳换算(2.5 专用)
2.5 支持帧级时间戳。需要卡音乐点/精确到帧时使用:
**帧号 = 秒 × 24**(24fps)
- 3 秒 = 第 72 帧
- 10 秒 = 第 240 帧
- 提示词中可写 `第 0-90 帧 (0s-3s)` 双标注
- 时间戳前缀格式:`0-3s:` 或 `[00.0-03.0s]`,按时间顺序排列
### 5.5 时间预算表(必须输出)
**节奏档位判定(时间测算前置,先定档再定镜头数):**
| 节奏档位 | 适用 | 4-6秒 | 7-9秒 | 10-12秒 | 13-15秒 |
|---------|------|-------|-------|---------|---------|
| 电影感中速 | 剧情/文戏/生活流 | 1-2镜 | 2-3镜 | 3-5镜 | 4-6镜 |
| 短视频中高密度 | 抖音/竖屏默认 | 2镜 | 3-4镜 | 4-6镜 | 6-8镜 |
| 高密度动作或强钩子 | 打斗/追逐/强钩子 | 2-3镜 | 4-5镜 | 5-7镜 | 7-10镜 |
| 慢节奏但高信息 | 强情绪/仪式/悬疑凝视 | 按功能保留 | 按功能保留 | 可1-2镜(须说明慢镜头功能) | 可1-2镜(须说明慢镜头功能) |
> 按剧情功能+平台自动判档 → 定镜头数 → 逐项测算时长。10秒以上只有1-2镜时必须命中慢节奏档并写清慢镜头功能。
```
┌─────────────────────────────────────┐
│ 本段演出时长测算 │
├────────────────┬────────┬───────────┤
│ 项目 │ 详情 │ 测算时间 │
├────────────────┼────────┼───────────┤
│ 节奏档位 │ ... │ — │
│ 镜头数 │ ... │ N 镜 │
│ 台词口播 │ ... │ X.X 秒 │
│ 表情与表演 │ ... │ X.X 秒 │
│ 身体动作/走位 │ ... │ X.X 秒 │
│ 道具交互 │ ... │ X.X 秒 │
│ 运镜与转场 │ ... │ X.X 秒 │
│ 首帧承接 │ ... │ X.X 秒 │
│ 末帧钩子停留 │ ... │ X.X 秒 │
├────────────────┼────────┼───────────┤
│ 测算总时长 │ │ XX.X 秒 │
│ 规划时长 │ │ XX 秒 │
│ 结论 │ 通过/需调整 │
└────────────────┴────────┴───────────┘
```
### 5.6 超调处理优先级(测算总时长 > 规划时长)
1. 先延长到平台上限(2.0 = 15 秒 / 2.5 = 30 秒)
2. 仍不够 → 建议拆成"首段 + 延长段"(2.5 套娃延长,总长 ≤60 秒)或超长视频模式(≤180 秒)
3. 减少次要动作/反应镜头
4. 删减原创建议台词(非用户原文)
5. 用户原文台词按自然停顿拆分到下一时间戳区间/下一段
6. **用户原文台词绝不删改**
### 5.7 不足处理(测算总时长 < 规划时长)
- 不硬凑满额时长。4-30 秒内任何值都可以。
- 空余时间留给画面自然节奏,不是塞废话。
## 六、平台硬约束
### Seedance 2.0
- 提示词容量:中文 ≤500 字符(品质基准)/ 实测 ≤2000 字符(硬上限)
- 单次生成:4-15 秒;480p / 720p / 1080p;16:9 / 9:16 / 21:9 / 1:1 / 2.35:1
- 多模态:图片 9 张(<30MB)/ 视频 3 段(2-15s,<50MB)/ 音频 3 段(≤15s,<15MB)/ 合计 ≤12 个
- 不支持写实真人脸部素材(自动拦截);动漫角色卡需走真人化前缀或真人参考图
- @引用官方命名:`@图片N` / `@视频N` / `@音频N`(中文命名,不用英文)
### Seedance 2.5(相对 2.0 的关键变化)
| 能力 | 2.5 规格 | 对提示词的影响 |
|------|---------|--------------|
| 单次生成时长 | 最长 30 秒 | 单段规划区间从 4-15 秒扩大到 4-30 秒 |
| 视频延长 | 单次延长 ≤30 秒,可多次套娃,总长 ≤60 秒 | 可输出"接续上一段"的延长专用提示词 |
| 超长视频模式 | 一次性直出最长 180 秒 | 用"镜头N(0:00-0:08)"分镜脚本格式 |
| 时间戳文本控制 | 原生支持秒级 + 帧级(24fps) | 测算结果直接写成时间戳,模型按秒执行 |
| 多模态参考 | @图片/@视频/@音频/@音效,支持迁移运镜/光影/节奏 | @引用必须声明用途(参考什么、不参考什么) |
| 纯净素材 | 有效响应"无字幕、无背景音乐" | 需要干净底片时显式声明 |
| 去 AI 感 | 皮肤/毛发/长尾动作/切镜一致性大幅优化 | 可写复杂动作链;用"原生皮肤质感"等词 |
| 多语种 | 中/英/西/印尼/马来/泰/阿/葡/越/日/韩 | 台词可直接写目标语言,可声明口型同步 |
| 负向约束 | "禁止出现XX"响应可靠 | 禁止字幕/水印/BGM/IP 元素可放心写 |
> 2.5 @素材引用规则:必须声明用途,例:"@视频1仅参考运镜轨迹与动作节奏,不保留原画面质感"
> 2.5 纯净素材声明:"纯净视频,全程无字幕、无背景音乐";去除参考素材BGM:"去除@视频1中的背景音乐,仅保留人声"
> 2.5 多语种口型同步:声明"嘴型与台词发音严格同步"
## 七、双版本输出(2.5)
每个生成段输出两个版本:
1. **多模态版**(有 @素材时):包含全局约束声明 + @引用声明用途 + 时间戳分镜 + 负向约束
2. **纯文字版**(无素材可直接用):结构同上,@引用替换为完整文字描述
> 全局约束声明模板:视觉风格锁定 + 字幕与音频策略 + 参考素材用途声明 + 本段时长
> 负向约束模板:禁止出现[字幕/水印/无关BGM/IP元素等,按需声明]
@@ -0,0 +1,94 @@
# 图生视频与分镜板制作流程
> 来源:seedance2.0-prompt-skill `image-to-prompt.md`(路径C/D、版权审查、三层动作分级、极简优先)+ `storyboard-driven.md`(格间关系三分类)
> 适用:F1(反推图片)、F2(反推视频)之外的路径C(单图生视频)与路径D(分镜板驱动)
## 一、路径C:单图驱动生视频(双范式选择)
### 反应模式(高戏剧瞬间)
适用:情绪爆发、戏剧冲突的瞬间画面。
- 写法:核心反应 + **子节拍展开**(如"惊讶"拆为:瞳孔放大→捂嘴→后退半步)
- 时长 3-5 秒起,反应需符合物理时间常数(见《分镜提示词制作流程》第五节)
### 凝视模式(日常自然瞬间)
适用:日常、生活化、非戏剧性画面。
- **必须写 3-4 个自然小动作**:呼吸起伏 / 眨眼 / 肩颈微动 / 头发被风吹动
- 搭配慢推进(slow push-in),营造"被偷拍的真实感"
- 禁止大动作(防物理崩坏)
### 11条核心原则(按重要性排序)
1. 图作框架参考,不卡帧(参考不是逐帧还原)
2. 凝视必须 3-4 个自然小动作(防石像化)
3. 日常物理常识优先(水往低处流、风吹物动)
4. 画质 4 层退化预设 + 9 类禁用词
5. 群演段内具体写(每个群演给具体动作,不写"人群熙攘")
6. 正向夸张 + 反向否定双锁定("非常拥挤,无一人注意镜头")
7. 镜头运动锁死(否定句穷举:"无推拉、无横摇、无变焦")
8. 跨人物互动事件化(写"递给他"而非"两人互动")
9. 三层动作分级(见第三节)
10. 多人脸部不同质化 3 护栏(肤色差异/发型差异/年龄差异)
11. 防物理崩坏 3 铁律(禁手部特写复杂动作/禁多人交叉走位/禁道具物理交互)
## 二、路径D:分镜板驱动(格间关系三分类)
拿到分镜脚本后,**先判定格间关系**再选方法:
| 格间关系 | 判定标准 | 方法 |
|---------|---------|------|
| ①连续动作链 | 多格描述同一动作的分解 | **合并还原法**:多格合并为一条提示词,一镜到底 |
| ②顺承场景 | 格与格时间/空间顺承 | **D-1 时间戳分段**:一条视频内用时间戳分段,硬切或溶解 |
| ③独立场景蒙太奇 | 格与格无时空连续性 | **D-3 记忆/心境蒙太奇法**(见下) |
### D-3 记忆/心境蒙太奇法(三核心机制)
1. **情绪母题黏合剂**(最关键):所有独立场景共享一个情绪关键词(如"遗憾"),写进每段
2. **语义转场流**:用语义衔接替代硬时间戳("从指尖的婚戒→到空荡的床头")
3. **首尾呼应包裹**:首段与末段用相似画面闭环
两个子变体:
- 文艺溶解版:交叉溶解转场 / 舒缓配乐 / 慢节奏 / 16:9
- 轻快混剪版:硬切卡拍 / 活泼电子乐 / 快节奏 / 9:16
### 分镜板格线规避声明(强制)
分镜板图片必须附声明:"忽略画面中的网格线、格数编号、分隔线,它们是分镜板结构元素,不是画面内容"——否则 AI 会把格线渲染进视频。
### D-1 / D-2 选择
- ≤4 格:D-1 单条多段(时间戳分段)
- ≥5 格:D-2 多条独立生成 + 剪辑建议(转场方式写进交付物)
### 多帧故事(multiframe2video)
2-9 张关键帧 → 图片顺序即叙事顺序;每帧需内容有推进(同图复用无意义)。
## 三、三层动作分级(路径C/D通用)
| 层级 | 内容 | 目的 |
|------|------|------|
| 第1层 持续微动 | 呼吸/眨眼/肩颈/头发,X 秒不能停 | 防"石像化" |
| 第2层 被聚焦节拍回应 | 1 个主回应动作,具体到 3 个细节 | 承担叙事 |
| 第3层 大动作禁止 | 起身/走动/转身/换姿势/伸手拿物等穷举禁止 | 防物理崩坏 |
## 四、版权审查 SOP(即梦平台,5条铁律)
1. **禁夜场 BGM 词**:爵士钢琴 / Lounge / Bossa Nova / 萨克斯等——这些词触发夜场联想审查
2. **不凑齐夜场环境 4 元素**:霓虹灯+酒杯+沙发+昏暗,任意 3 个以内安全,4 个凑齐触发
3. **删涉灰场景词**:会所 / 公关 / 沙龙厅 / 夜店 → 替换为"私人俱乐部 / 会客室"等中性词
4. **多人场景改静态全景机位**:"镜头平移到第X位"改为"固定全景,众人各自交谈"——平移扫过多人易触发人脸审查
5. **禁人物×道具物理交互**:人物不与酒杯/扑克/钢管等敏感道具发生物理接触动作
被拒后的**二分法定位 SOP**:砍到极限版 30-50 字符 → 每次加回 1 个元素 → 对比找出触发词。
**核心认知**:审查看的是词汇/词组本身的"涉灰联想强度",不是整段语义——删词比改语义有效。
## 五、极简优先铁律
路径 C/D 默认 **300-500 字符**。文字只补 4 件事:图没有的 / 需强化的 / 需规避的 / 硬约束。
实战数据:3102 字符违规 → 271 字符过审(同一画面内容)。
## 六、画质 4 层退化预设(真实感来源)
真实拍摄素材天然包含 4 层"瑕疵",AI 默认输出过于完美反而假:
1. 平台压缩(轻微涂抹感)
2. 设备瑕疵(镜头炫光/暗角)
3. 现场瑕疵(背景路人/杂物)
4. 镜头变形(广角拉伸)
夜景/手机随拍风格需主动叠加:低照度噪点 + 手机画质退化 + 自然随机动作。
@@ -0,0 +1,69 @@
# 多镜头剪辑节奏流程
> 来源:seedance2.0-prompt-skill `editing-rhythm.md`
> 适用:多镜头分镜的节奏设计与 AI 素材后期拼接(D-2 多条独立生成后的剪辑指导)
## 一、核心认知
**剪辑本质 = 节奏控制;节奏 = 时间轴上信息密度的变化规律。**
## 二、AI 素材 5 特殊性(先懂素材再谈剪辑)
1. 单条素材 5-10 秒,必须拼接
2. 风格/光线不一致(同 prompt 多次生成也有差异)
3. 运镜起止有 AI 感(首尾 0.5-1 秒最明显)
4. 动作存在微妙畸变
5. 同 prompt 差异大(同批生成结果质量参差)
## 三、六大节奏公式
| 公式 | 节奏型 | 适用 | 要点 |
|------|--------|------|------|
| ①呼吸式 | 快快快慢 | 入门首选,万能 | 3 短 1 长,循环 |
| ②心跳式 | 均匀→加速 | 紧张感 | 间隔递减,最后停拍 |
| ③海浪式 | 小中大更大平静 | 情感叙事 | 层级递进后回落 |
| ④子弹时间 | 正常→慢动作→爆发 | 高潮瞬间 | 慢放蓄力,瞬间释放 |
| ⑤脉冲式 | 密度加倍→定格 | 预告片 | 快切堆叠后一帧定格 |
| ⑥静默锤击 | 安静→砰→更安静→砰砰 | 先锋艺术 | 以静衬动,留白即力量 |
## 四、AI 素材专属 5 对策
1. **首尾修剪 0.5-1 秒**:切掉运镜起止的 AI 感段落
2. **色彩统一 3 步**:选基准片(色调最理想的一条)→ 其余 LUT 向基准靠拢 → 后续生成时写色调锁定语句
3. **转场弥合**:5 种转场按需选(硬切/溶解/划像/遮罩/闪白)
4. **快节奏遮掩畸变**:切换越快,单帧畸变越不可见
5. **2-3 倍素材冗余**:每个镜头生成 2-3 条备选,剪辑时选优
## 五、节奏×镜头联动模式
| 联动 | 用法 |
|------|------|
| 海浪式 + 景别递进 | Z7 远景 → Z5 → Z3 → Z1 特写 → Z9 大远景,情绪随景别推进 |
| 脉冲式 + 情绪色调递进 | 冷色快切 → 暖色定格,色调变化承载情绪拐点 |
## 六、9 步标准剪辑工作流
```
①生成素材(每镜头 2-3 条冗余)
②筛选可用条(剔除畸变明显的)
③首尾修剪 0.5-1 秒
④按节奏公式排片序
⑤定基准片统一色彩
⑥选择转场弥合接缝
⑦铺音乐/音效
⑧全片回看检查连贯性
⑨导出交付
```
## 七、10 项剪辑自检清单
1. 每个镜头是否都有存在的叙事理由?
2. 有无两个镜头表达同一信息(可删一)?
3. 节奏是否符合选定公式的变化规律?
4. 高潮点是否落在总时长 70-80% 处?
5. 首尾是否修剪到位(无 AI 感残留)?
6. 色彩是否统一(无跳色)?
7. 转场是否服务于节奏而非炫技?
8. 音乐重音与画面切换是否卡点?
9. 动作畸变是否被节奏遮掩?
10. 最后一个镜头是否留有余韵(不戛然而止)?
@@ -0,0 +1,156 @@
# 长视频分段制作流程
> 来源:seedance2.0-prompt-skill `long-video-strategy.md` + `production-pipeline.md` + seedance25-timed-prompter 2.5 超长/延长模式
> 适用:>15 秒视频的完整前期制作与分段拼接(F4 多镜头分镜的标准路径)
> 平台差异:2.0 单次 ≤15 秒需手动分段;2.5 单次 ≤30 秒 + 套娃延长 ≤60 秒 + 超长模式 ≤180 秒
## 一、完整制作流水线(7步)
```
①概念/剧本 → ②角色设计 → ③角色卡片图 → ④分镜脚本 → ⑤分镜参考图 → ⑥逐镜头视频生成 → ⑦后期拼接
```
**核心原则:一致性来自"反复引用同一张参考图"**——角色卡片图质量直接决定成片一致性。
### 角色卡片图(9:16 竖版,10段固定结构)
画幅声明 → 风格锚定 → 构图 → 面部特征 → 发型 → 头饰 → 服装逐件描述 → 标志道具 → 体态 → 光影画质 + 禁止项
关键原则:
- 五官人种一致、服装忠实还原(**不美化**):宁少写不错写
- 风格锚定 5 级:photorealistic / semi-realistic / 3d-render 超写实 / 3d-render 游戏风 / anime
- 常见错误 7 条:唇色降级 / 服装开合错误 / 质感偏移 / 忽略污渍 / 美化倾向 / 遗漏头饰 / 编造细节
## 二、25格制作流水线(≥45秒或可交付规范方案)
### Phase 1 剧情拆解表
每格字段:格数 / 时长 / 画面内容 / 景别(Z轴)/ 运镜 / 美学 / 叙事功能
### Phase 2 聚合提示词矩阵
5×5 聚合:每 5 格聚合为 1 个生成单元(对应 15 秒上限)。
### 25格节奏曲线(叙事功能分配)
| 阶段 | 格数 | 功能 |
|------|------|------|
| 建立 | 1-5 | 世界/人物亮相 |
| 发展 | 6-10 | 事件推进 |
| 升温 | 11-16 | 冲突升级 |
| 高潮 | 17-19 | 情绪顶点 |
| 回落 | 20-23 | 收束 |
| 留白 | 24-25 | 余韵 |
### 25格景别曲线
Z8→Z5→Z5↔Z4→Z4→Z3→Z2→Z1→Z3→Z7→Z8→Z9(远景开场→中近推进→特写高潮→拉远收尾)
### 分镜图生成优先级
- **P0**(必出图):高潮帧 17-19 + 开场 01 + 结尾 25
- **P1**(转折帧):06 / 11 / 16 / 20
- **P2**(其余):时间允许再补
## 三、三段式叙事骨架(时长分配)
| 段落 | 占比 | 节奏 | 功能 |
|------|------|------|------|
| 建立世界 | 0-30% | 慢 | 环境、人物、基调 |
| 变化推进 | 30-75% | 略快 | 事件与冲突 |
| 情绪收束 | 75-100% | 慢 | 情感落点、留白 |
## 四、一致性锁定(每段必须执行)
> 4层结构中,一致性靠@图片引用+设定层统一实现,不需要额外写锁定语句。
| 类型 | 执行方式 | 在4层结构中去哪 |
|------|---------|----------------|
| 风格锁定 | 视觉风格跨段统一(首段定调后续段重复或引用) | ②设定-视觉风格 |
| 角色锁定 | @图片引用在每段①主体列表重复出现 | ①主体列表 |
| 场景锁定 | 场景延续时②设定-场景写"延续上一段场景",新场景写新描述 | ②设定-场景 |
## 五、分段规则
- 每段 ≤15 秒(2.0 平台上限)/ ≤30 秒(2.5 平台上限)
- **上段结尾状态 = 下段开始状态**(硬性)
- 延长段开头 0.8-1.5 秒微动作(呼吸/整理衣物),避免首帧跳变
推荐分段方案(2.0):
| 总时长 | 段数 |
|--------|------|
| 16-30 秒 | 2 段 |
| 31-45 秒 | 3 段 |
| 46-60 秒 | 4 段 |
| >60 秒 | 拆独立场景,走多镜头剪辑 |
推荐分段方案(2.5):
| 总时长 | 策略 |
|--------|------|
| 16-30 秒 | 单段直出(2.5 单次 30 秒) |
| 31-60 秒 | 首段 + 延长段(套娃延长,每段 ≤30 秒,总长 ≤60 秒) |
| >60 秒 | 超长视频模式(≤180 秒一次性直出)或拆独立场景多镜头剪辑 |
## 六、画面衔接 3 方法
1. **桥接镜头法**:段间插入 0.8-1.5 秒自然流动镜头(风吹树叶/脚步)
2. **同构图推进法**:两段用相同构图,只变内容(时间流逝感)
3. **时间流逝法**:光影变化直接表达时间推进
**尾帧延续法**:第 1 段结尾定格状态 + 第 2 段写"接续上一段最后一帧" + 前 1 秒微动作。
## 七、音乐衔接 4 法
1. 同曲分层(同一 BGM 不同段落配器)
2. 提前渐入(下段音乐在上段结尾 1-2 秒渐入)
3. 环境音桥接(用环境音过渡,音乐断开)
4. 结尾减速(结尾段落音乐 BPM 放慢收束)
## 八、输出模板(每段提示词结构)
### 简单段
```
①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先;D类主体=产品,E类主体=场景)
②设定(人物逐人必写不可遗漏/场景/光线/构图/视觉风格,每项1句,按类型取舍:D/E类省略人物;摄影质感默认生成参考值·[]框起)
③镜头叙事(1段流畅描述:机位/景别/朝向+动作/变化+运镜+有台词时带语气)
④负面提示词(放最后,3.3标准模板)
```
> 按Step 1类型判定适配4层,详见分镜提示词制作流程3.2.2类型适配表
### 复杂段(多角色/多场景切换时用)
```
①主体列表(置顶,按类别分行:人物/场景/道具,@图片引用优先,跨段每段重复出现)
②设定(人物逐人必写不可遗漏/场景/光线/构图/视觉风格,每项1句;场景变化时写新场景,跨段统一项不重复;摄影质感默认生成参考值·[]框起)
③镜头叙事(每镜头1段,多角色互动按动作流叙述,运镜嵌在动作中,朝向必须写明,连续动作不拆,有台词时带语气)
④负面提示词(放最后,3.3标准模板)
```
> 跨段一致性:角色@图片引用在每段重复出现,不需要额外写一致性锚定语句。
## 九、2.5 延长段专用格式
> 来源:seedance25-timed-prompter。当用户已有 2.5 成片想接续时使用。
```
> 接续上一段结尾:[一句话复述上一段末帧状态,确保无缝承接]。延长 X 秒。
> 0-Xs(延长段内时间轴):[新动作/新场景变化描述]
> [保持角色锚点重复;声明"画面风格、人物、场景与上一段保持一致"]
```
## 十、2.5 超长视频模式(≤180 秒)
> 来源:seedance25-timed-prompter。完整短片/MV/预告片,用户明确要求长片时使用。
格式:
```
> 【全局约束声明】(视觉风格锁定 + 字幕与音频策略 + 参考素材用途声明 + 本段时长)
> 镜头 1(0:00-0:08)运镜:[运镜]。画面:[画面描述]。台词:[角色]:"[原文]"。音效:[音效/BGM]。
> 镜头 2(0:08-0:15)运镜:...。画面:...。台词:...。音效:...。
> [按时间顺序排列所有镜头,镜头时间区间连续不重叠,总长 ≤180 秒]
```
与 25 格流水线的区别:
| 对比项 | 25 格流水线(2.0) | 超长视频模式(2.5) |
|--------|-------------------|-------------------|
| 生成方式 | 逐段生成后拼接 | 一次性直出 |
| 最大时长 | 逐段拼接无上限 | ≤180 秒 |
| 格式 | 每段独立提示词 | 镜头N(时间区间)连续排列 |
| 一致性 | 靠参考图反复引用 | 原生长时序一致性更好 |
| 适用场景 | 需要精细控制每段 | 快速产出完整短片 |