Files
mcn-short-video/project/内容创作产品规划/02_分析_没有素材库光靠模型能做到什么程度.md
T

157 lines
7.8 KiB
Markdown
Raw Normal View History

# 分析:没有素材库,光靠模型能做到什么程度?
> 分析时间:2026-08-10 ~ 08-11
> 分析对象:短视频脚本创作链路中「素材库」的边际价值
> 核心问题:如果完全没有素材库(只有人设卡片+提示词),模型生成的大纲能达到什么程度?
> 对照实验:做梦账号「1000块加班补偿餐」——AI 裸生成 vs 编导大纲(亚朵案例)
---
## 一、实验对照:同一选题,两种生成路径
### 1.1 输入对比
| 输入项 | 裸模型路径(无素材库) | 完整路径(有素材库) |
|--------|----------------------|---------------------|
| 人设卡片 | ✅ 有(12章节策略层) | ✅ 有 |
| 创作流程提示词 | ✅ 有(S5-S11 方法论) | ✅ 有 |
| 知识库方法论 | ✅ 有(12分类) | ✅ 有 |
| 素材库(具名物品/仪式/金句/环境) | ❌ 无 | ✅ 有 |
| 标杆参考 | ❌ 无 | ✅ 无(已移除,靠素材库替代) |
### 1.2 输出对比(同一「深夜上菜」场景)
| 维度 | 裸模型输出 | 有素材库输出 |
|------|-----------|-------------|
| 画面 | 「精致摆盘,端上桌」 | 白瓷盘从柜最深处取出 → 干冰倒盘底流雾 → 筷子调肉块角度 → 猛火收汁浇淋酱汁 |
| 物品 | 「一些食材」「几个道具」 | 铁棍山药/乌鸡/干冰/白瓷盘/亚朵枕头(具名+材质) |
| 动作 | 「细心照顾」「认真做饭」 | 8 步安睡仪式(拆床品不抖→除螨四角3秒→枕套开口朝外→袜子分层…) |
| 台词 | 「你辛苦了」「快吃吧」 | 「那你还做了这么多菜。」(口是心非式心疼) |
| 环境 | 「温馨的厨房」 | 只开灶台上方射灯+抽油烟机灯,窗外全黑,蒸汽漫反射 |
### 1.3 密度量化
| 指标 | 裸模型(≈25 单元) | 编导级(≈82 单元) | 差距 |
|------|:---:|:---:|:---:|
| 故事细节 | 25 | 82 | 3.3x |
| 具名物品 | ≤5 | 19 | 4x |
| 完整对话 | 1-2 组 | 14 组 | 7x |
| 步骤链 | 0-1 条 | ≥3 条 | — |
| 环境细节 | 2-3 条 | ≥10 条 | 4x |
---
## 二、模型"能做" vs "做不到"的分界线
### 2.1 光靠模型能做到的(骨架层)✅
| 能力 | 表现 | 为什么能做到 |
|------|------|-------------|
| 结构选择 | 五段式/三段式、叙事模型选择 | 方法论(知识库03)教过,属于"规则应用" |
| 情绪弧线 | 蓄力→转折→释放,钩子→主体→收尾 | 方法论(知识库07)可推理 |
| 钩子设计 | 反差/嘴替/反常识等类型选择 | 方法论(知识库04)给了分类 |
| 口播方向 | 符合人设的台词方向(非完整台词) | 人设卡片的表达 DNA 可约束 |
| 主题立意 | 选题的差异化方向 | 方法论(知识库02)可推理 |
| 分段规划 | 开场/中段/结尾的时长和看点分配 | 方法论(知识库03)给了节奏模板 |
### 2.2 光靠模型做不到的(血肉层)❌
| 能力 | 裸模型表现 | 为什么做不到 |
|------|-----------|-------------|
| 具名物品 | 「一个枕头」「一瓶喷雾」 | 模型的训练数据里没有"这个账号"的具体物品——只能泛称 |
| 品牌+材质 | 「高级床品」而非「亚朵Pro4.0气囊绵」 | 品牌是账号私有资产,模型不知道 |
| 服务步骤链 | 「收拾房间」而非 8 步安睡仪式 | 步骤链是"账号级的专业操作知识",不在通用训练数据中 |
| 完整对话 | 「她表达了感谢」而非具体台词 | 台词需要"人设×场景"的个性化创作,模型只能给概要 |
| 环境细节 | 「温馨的厨房」而非「4000K灯光+窗外全黑+蒸汽漫反射」 | 环境是账号固定的拍摄空间设定 |
| 情感微表情 | 「她很感动」而非「口是心非的低头喝汤」 | 微表情需要"关系历史"支撑(她为什么口是心非) |
### 2.3 分界线的本质
```
裸模型 = 规则推理器
输入:方法论 + 人设约束
输出:符合规则的"正确但泛化"内容(骨架)
完整链路 = 规则推理器 + 场景翻译器
输入:方法论 + 人设约束 + 具名素材弹药
输出:可直接拍摄的"具体场景"(骨架+血肉)
```
**模型不是不会写细节,而是它"不知道"这个账号的细节。** 通用训练数据让模型知道"做饭"通常什么样,但不知道"做梦账号"的饭桌什么样——这个信息只在编导的脑中和素材库里。
---
## 三、为什么"光靠模型"必然停留在 25 个单元
### 3.1 信息量天花板
| 层 | 裸模型可获得的信息 | 决定的内容 |
|----|-----------------|-----------|
| 通用常识 | 做饭/照顾/情侣日常(人人皆知) | 泛化事件(买菜→做饭→吃饭) |
| 人设卡片 | 账号定位/符号/法则(策略层) | 事件方向(经费机制/宠妻/金牌) |
| 方法论 | 结构/情绪/钩子规则 | 骨架(五段式/情绪弧线) |
| **素材库(缺失)** | **具名物品/步骤链/金句/环境** | **血肉(可拍摄细节)** |
没有素材库 = 模型的信息量被封顶在"策略层",永远够不到"拍摄层"。
### 3.2 模型的"完整性偏好"陷阱
当输入没有具名素材时,模型会激活**完整性偏好**:
- 知道要有"物品"→ 编造泛称「一些食材」(不敢编造品牌,因为不确定)
- 知道要有"对话"→ 写概要「她说他很贴心」(不敢写具体台词,因为不确定人物关系细节)
- 知道要有"步骤"→ 写「认真准备」(不敢写具体操作,因为不确定账号标准)
**模型宁可写"安全但泛化"的内容,也不愿编造"可能错误"的细节**——这是 LLM 的保守性,也是素材库存在的必要性:素材库让模型"确定地知道"而非"猜测地编造"。
### 3.3 编导 vs 模型的信息不对称
| 信息 | 编导掌握 | 模型(无素材库)掌握 |
|------|:---:|:---:|
| 账号的具名物品清单 | ✅ | ❌ |
| 账号的服务步骤标准 | ✅ | ❌ |
| 账号的台词风格记忆 | ✅ | ❌ |
| 账号的固定拍摄空间 | ✅ | ❌ |
| 账号的情感关系史 | ✅ | ❌ |
素材库的本质:**把编导脑中私有的账号知识,结构化转移到模型可调用的位置**。
---
## 四、结论:素材库的边际价值
### 4.1 一句话结论
**没有素材库,光靠模型 = 能搭出"正确的骨架",但写不出"可拍的细节"——25 个单元就是天花板;素材库的存在让模型从"规则推理"升级为"场景翻译",密度提升 3 倍以上(25→82)。**
### 4.2 素材库贡献了什么
| 贡献 | 量化效果 |
|------|---------|
| 具名物品弹药 | 物品泛称→具名(4x 提升) |
| 步骤链标准 | 无→可拍摄动作序列 |
| 对话素材 | 概要→完整台词(7x 提升) |
| 环境设定 | 空白→可拍摄空间 |
| 金句参考 | 大白话→有传播力的表达 |
### 4.3 极限边界(诚实评估)
素材库不是万能的,模型仍有其上限:
| 边界 | 说明 | 需要什么补足 |
|------|------|-------------|
| 创意发散 | 素材库给零件,不给创意方向 | 需要编导在 S5 选题阶段定方向 |
| 情感真实性 | 素材库能提供台词模板,但情感真实性依赖编导判断 | 需要 S11 人设匹配度校验 |
| 跨账号污染 | 做梦的素材不能给俊希用 | 双标签过滤(极致标签×适用场景)隔离 |
| 场景创新 | 素材库是已有经验的沉淀,新场景无素材 | 素材库随创作持续迭代补充 |
### 4.4 最终架构启示
```
创作流程(通用引擎)→ 知识库(方法论,怎么做)
→ 素材库(弹药,用什么)← 账号设定(人设卡片触发引用)
→ 模型(骨架生成器)
→ 编导(创意方向 + 最终判断)
```
**模型的角色定位**:不是"创作者",是"编导意图的执行放大器"——给多少弹药,放大多少细节。素材库就是那个弹药库。