Files
mcn-short-video/project/内容创作产品规划/02_分析_没有素材库光靠模型能做到什么程度.md
maogeigei d07049ecf1 chore(repo): 归集 09-14~09-29 工作产出(技能/知识库/工作台/报告)并收敛临时产物
- skill: 素材库分块定义(00~11)、05_极致事件知识库 4 篇、08_对话风格总纲、mcn-video-prompt 提示词质量门禁与外部语料检索流程

- workbench: mcn-work-shop 新增 cli-backend.js(本地 CLI 接入)、工作台视觉交互规范;移除旧 UI 规范

- docs: 根目录极致事件/素材卡/审计方案报告与热门短视频清单入库

- memory: 补 09-14~09-29 日志与自动化任务记忆

- chore: .gitignore 排除 tools/、.tmp-chrome-*/、_k_test.cjs
2026-09-29 18:56:24 +08:00

7.8 KiB
Raw Permalink Blame History

分析:没有素材库,光靠模型能做到什么程度?

分析时间:2026-08-10 ~ 08-11 分析对象:短视频脚本创作链路中「素材库」的边际价值 核心问题:如果完全没有素材库(只有人设卡片+提示词),模型生成的大纲能达到什么程度? 对照实验:做梦账号「1000块加班补偿餐」——AI 裸生成 vs 编导大纲(亚朵案例)


一、实验对照:同一选题,两种生成路径

1.1 输入对比

输入项 裸模型路径(无素材库) 完整路径(有素材库)
人设卡片 ✅ 有(12章节策略层) ✅ 有
创作流程提示词 ✅ 有(S5-S11 方法论) ✅ 有
知识库方法论 ✅ 有(12分类) ✅ 有
素材库(具名物品/仪式/金句/环境) ❌ 无 ✅ 有
标杆参考 ❌ 无 ✅ 无(已移除,靠素材库替代)

1.2 输出对比(同一「深夜上菜」场景)

维度 裸模型输出 有素材库输出
画面 「精致摆盘,端上桌」 白瓷盘从柜最深处取出 → 干冰倒盘底流雾 → 筷子调肉块角度 → 猛火收汁浇淋酱汁
物品 「一些食材」「几个道具」 铁棍山药/乌鸡/干冰/白瓷盘/亚朵枕头(具名+材质)
动作 「细心照顾」「认真做饭」 8 步安睡仪式(拆床品不抖→除螨四角3秒→枕套开口朝外→袜子分层…)
台词 「你辛苦了」「快吃吧」 「那你还做了这么多菜。」(口是心非式心疼)
环境 「温馨的厨房」 只开灶台上方射灯+抽油烟机灯,窗外全黑,蒸汽漫反射

1.3 密度量化

指标 裸模型(≈25 单元) 编导级(≈82 单元) 差距
故事细节 25 82 3.3x
具名物品 ≤5 19 4x
完整对话 1-2 组 14 组 7x
步骤链 0-1 条 ≥3 条 —
环境细节 2-3 条 ≥10 条 4x

二、模型"能做" vs "做不到"的分界线

2.1 光靠模型能做到的(骨架层)✅

能力 表现 为什么能做到
结构选择 五段式/三段式、叙事模型选择 方法论(知识库03)教过,属于"规则应用"
情绪弧线 蓄力→转折→释放,钩子→主体→收尾 方法论(知识库07)可推理
钩子设计 反差/嘴替/反常识等类型选择 方法论(知识库04)给了分类
口播方向 符合人设的台词方向(非完整台词) 人设卡片的表达 DNA 可约束
主题立意 选题的差异化方向 方法论(知识库02)可推理
分段规划 开场/中段/结尾的时长和看点分配 方法论(知识库03)给了节奏模板

2.2 光靠模型做不到的(血肉层)❌

能力 裸模型表现 为什么做不到
具名物品 「一个枕头」「一瓶喷雾」 模型的训练数据里没有"这个账号"的具体物品——只能泛称
品牌+材质 「高级床品」而非「亚朵Pro4.0气囊绵」 品牌是账号私有资产,模型不知道
服务步骤链 「收拾房间」而非 8 步安睡仪式 步骤链是"账号级的专业操作知识",不在通用训练数据中
完整对话 「她表达了感谢」而非具体台词 台词需要"人设×场景"的个性化创作,模型只能给概要
环境细节 「温馨的厨房」而非「4000K灯光+窗外全黑+蒸汽漫反射」 环境是账号固定的拍摄空间设定
情感微表情 「她很感动」而非「口是心非的低头喝汤」 微表情需要"关系历史"支撑(她为什么口是心非)

2.3 分界线的本质

裸模型 = 规则推理器
  输入:方法论 + 人设约束
  输出:符合规则的"正确但泛化"内容(骨架)

完整链路 = 规则推理器 + 场景翻译器
  输入:方法论 + 人设约束 + 具名素材弹药
  输出:可直接拍摄的"具体场景"(骨架+血肉)

模型不是不会写细节,而是它"不知道"这个账号的细节。 通用训练数据让模型知道"做饭"通常什么样,但不知道"做梦账号"的饭桌什么样——这个信息只在编导的脑中和素材库里。


三、为什么"光靠模型"必然停留在 25 个单元

3.1 信息量天花板

层 裸模型可获得的信息 决定的内容
通用常识 做饭/照顾/情侣日常(人人皆知) 泛化事件(买菜→做饭→吃饭)
人设卡片 账号定位/符号/法则(策略层) 事件方向(经费机制/宠妻/金牌)
方法论 结构/情绪/钩子规则 骨架(五段式/情绪弧线)
素材库(缺失) 具名物品/步骤链/金句/环境 血肉(可拍摄细节)

没有素材库 = 模型的信息量被封顶在"策略层",永远够不到"拍摄层"。

3.2 模型的"完整性偏好"陷阱

当输入没有具名素材时,模型会激活完整性偏好:

  • 知道要有"物品"→ 编造泛称「一些食材」(不敢编造品牌,因为不确定)
  • 知道要有"对话"→ 写概要「她说他很贴心」(不敢写具体台词,因为不确定人物关系细节)
  • 知道要有"步骤"→ 写「认真准备」(不敢写具体操作,因为不确定账号标准)

模型宁可写"安全但泛化"的内容,也不愿编造"可能错误"的细节——这是 LLM 的保守性,也是素材库存在的必要性:素材库让模型"确定地知道"而非"猜测地编造"。

3.3 编导 vs 模型的信息不对称

信息 编导掌握 模型(无素材库)掌握
账号的具名物品清单 ✅ ❌
账号的服务步骤标准 ✅ ❌
账号的台词风格记忆 ✅ ❌
账号的固定拍摄空间 ✅ ❌
账号的情感关系史 ✅ ❌

素材库的本质:把编导脑中私有的账号知识,结构化转移到模型可调用的位置。


四、结论:素材库的边际价值

4.1 一句话结论

没有素材库,光靠模型 = 能搭出"正确的骨架",但写不出"可拍的细节"——25 个单元就是天花板;素材库的存在让模型从"规则推理"升级为"场景翻译",密度提升 3 倍以上(25→82)。

4.2 素材库贡献了什么

贡献 量化效果
具名物品弹药 物品泛称→具名(4x 提升)
步骤链标准 无→可拍摄动作序列
对话素材 概要→完整台词(7x 提升)
环境设定 空白→可拍摄空间
金句参考 大白话→有传播力的表达

4.3 极限边界(诚实评估)

素材库不是万能的,模型仍有其上限:

边界 说明 需要什么补足
创意发散 素材库给零件,不给创意方向 需要编导在 S5 选题阶段定方向
情感真实性 素材库能提供台词模板,但情感真实性依赖编导判断 需要 S11 人设匹配度校验
跨账号污染 做梦的素材不能给俊希用 双标签过滤(极致标签×适用场景)隔离
场景创新 素材库是已有经验的沉淀,新场景无素材 素材库随创作持续迭代补充

4.4 最终架构启示

创作流程(通用引擎)→ 知识库(方法论,怎么做)
                    → 素材库(弹药,用什么)← 账号设定(人设卡片触发引用)
                    → 模型(骨架生成器)
                    → 编导(创意方向 + 最终判断)

模型的角色定位:不是"创作者",是"编导意图的执行放大器"——给多少弹药,放大多少细节。素材库就是那个弹药库。