短剧创作知识库 — 产品规划图

V5.0 | 2026-07-29 | 增加商业表现数据层 + 创作-评估-商业验证闭环
面向短剧全生命周期的结构化知识基础设施 — 地域×性别×题材×流派×变现模式 五维体系
整体规划
五大分类
12创作维度
商业数据
检索路由
知识库结构
建设计划
第1层:分类维度
第2层:标签层
第3层:创作维度
第4层:商业数据
第5层:元数据
第6层:检索引擎
L1
五大分类维度 顶层定位
知识库每条知识必须完成五维定位,决定分区路由和差异化评估
① 地域:国内 | 海外
② 性别:男频 | 女频
③ 题材:世界观+题材类型
④ 流派:叙事机制/风格流派
⑤ 变现:付费 | 免费 | IAP混合
▼
L2
核心设定与风格标签 精准定位
每条知识挂载三层标签:世界观 → 核心设定(身份+金手指) → 风格(风格+元素)
世界观标签
身份标签
金手指标签
风格标签
元素标签
▼
L3
12创作维度 内容分块组织
每个维度内容以分块(Chunk)形式入库,支持分类+标签+向量三检索模式
01 爆款选题
02 背景设定
03 故事框架
04 叙事节奏
05 人物设定
06 关键事件
07 台词对话
08 钩子开场
09 冲突反转
10 情绪共鸣
11 诊断评估
12 失败反常识
▼
L4
商业表现数据层 ★V5.0新增
每部剧关联真实市场表现数据,用商业结果校验创作方法论和评估权重,形成创作→评估→商业验证→反馈优化闭环
付费:7天付费量 / 付费转化率 / ARPU / ROI
免费:总播放量 / 完播率 / 3秒留存 / 广告填充率
IAP:综合收入 / 收入结构比例 / 综合ROI
▼
L5
元数据标签 检索定位
17项必填标签(创作) + 9项商业必填字段(剧级) + 4项选填标签
region/gender/genre/style/monetization
universe/identity/golden_finger/tone/element
dimension/chunk_type/vector_desc
drama_id/launch_date/7day_paid/roi
total_views/viewer_count/completion_rate
▼
L6
三检索模式引擎 组合·降级·加权
筛选阶段(分类+标签+商业数据)缩小候选范围 → 向量召回阶段做语义匹配 → Rerank仅对向量召回结果重排
① 分类检索:五维+维度→分区过滤
② 标签检索:核心设定+风格→精准匹配
③ 向量匹配:语义相似度→embedding检索
④ 商业数据检索:变现模式+指标区间→过滤排序
1
地域维度
地域核心平台受众特征集数/时长
国内番茄/抖音/快手/红果/微信爽感+情绪共鸣极高80-100集 × 1-2分钟
海外(美国)ReelShort/DramaBox/ShortTV叙事完整性+角色化学反应60-80集 × 2-3分钟
规则:国内创作方法论不得直接套用海外,反之亦然
2
性别维度
频段核心情绪节奏偏好典型钩子
男频逆袭征服/打脸爽感/力量掌控快节奏/高密度冲突/即时反馈身份反转/武力碾压/智谋揭穿
女频甜蜜恋爱/虐心共鸣/重生复仇情绪细腻/共鸣密集/治愈/虐心交替身份揭穿/误会反转/情感告白
规则:男频评估维度不得用于评判女频剧本,反之亦然
3
题材维度 — 世界观+题材类型两层组织
国内题材体系
世界观题材类型编号代表特征
现代都市都市逆袭M01贫→富、弱→强、被看不起→震惊全场
现代都市职场逆袭M02职场奋斗、能力证明、事业翻盘
现代都市家庭伦理M03婆媳冲突、婚姻保卫、家庭逆袭
古代/架空玄幻修真M04修仙/修真/玄幻体系升级
古代/架空武侠江湖M05武功升级、江湖义气、门派争斗
古代/架空历史权谋M06权谋智斗、势力角逐、帝王之路
悬疑犯罪悬疑推理M07伏笔密布、信息不对称、反转冲击
悬疑犯罪黑帮犯罪M08犯罪/黑帮/江湖道义
科幻未来科幻未来M09科技碾压、时间穿越、外星入侵
游戏异界无限流/闯关M10多副本闯关、无限复活、能力解锁
游戏异界电竞热血M11技术碾压、团队配合、赛场翻盘
海外女频题材体系(参考图片标签)
世界观题材类型编号代表特征
UrbanRomanceHF01都市恋爱、身份差异、化学反应
UrbanMarriageHF02婚姻契约、先婚后爱、婚姻保卫
BusinessRomanceHF03商业帝国、CEO恋情、办公室权力
AncientRomanceHF04古代言情、宫廷权谋、身份秘密
ABORomanceHF05ABO设定、信息素、宿命羁绊
Magic WorldFantasyHF06魔法世界、异世界冒险、奇幻恋爱
Sci-fiSci-fiHF07科幻未来、时间旅行、系统设定
UrbanFamily DramaHF08家庭矛盾、关系修复、情感治愈
UrbanMystery/SuspenseHF09悬疑线索、真相揭示、恋爱线交织
4
流派维度 — 叙事机制/风格流派
国内流派体系
编号流派名称核心机制
S01逆袭打脸从弱到强,持续打败对手
S02时间循环/轮回反复复活/轮回,渐进解谜
S03无限流/闯关多副本闯关,难度递增
S04悬疑反转信息逐步揭示,结尾反转
S05情绪治愈情绪共鸣为主,节奏偏慢
S06家庭现实真实接地气,社会议题嵌入
S07混合跨界多流派混搭
S08新兴流派待定义待验证
规则:严禁跨流派套用 — 逆袭打脸评估维度不得用于时间循环剧本
5
变现模式维度
模式核心指标节奏特征
付费付费转化率/ARPU/7天付费量关键集(8-12集)强付费卡点
免费完播率/3秒留存/总播放量每集独立爽点,开场3秒强钩子
IAP混合综合ROI/收入结构比例免费引流+关键集付费+长尾广告
规则:严禁跨变现模式套用 — 付费剧不能用免费剧的完播率标准评估
01
爆款选题
选题方法论、热点趋势、选题评估维度、选题组合公式
★ 新增
02
背景设定
世界观构建规则、时空设定、社会体系、核心设定逻辑
★ 新增
03
故事框架
三幕/五幕结构、场次划分、叙事弧线、付费卡点结构设计
原01_结构部分
04
叙事节奏
节奏范式、集间节奏、情绪节奏曲线、爽点密度
原01_节奏部分
05
人物设定
人物成长弧线、人设卡片、关系图谱、男频/女频差异化
原02_人物与人设
06
关键事件
事件设计方法论、转折点设计、伏笔-回收链、关键集设计
★ 新增
07
台词对话
爆款台词特征、对白节奏、台词风格库、地域差异化
原03_台词与对白
08
钩子与开场
开场公式、跨集钩子设计、悬念前置、集尾钩子
09
冲突与反转
冲突类型库、反转方法论、冲突升级路径
10
情绪与共鸣
情绪曲线设计、共鸣点分布、情绪拐点
11
诊断评估与优化
分五维组合Rubric评分维度、评估流水线
12
失败案例与反常识
失败案例库、反常识成功案例、常见陷阱

分块(Chunk)结构 — 每维度最小入库单元

① 分类字段 Classification
五维定位 + 维度编号 → 决定分区路由
region + gender + genre + style + monetization + dimension
② 标签字段 Tags
核心设定标签 + 风格标签 + chunk_type → 精准过滤
universe + identity + golden_finger + tone + element + chunk_type
③ 向量描述 Vector Description
vector_desc ≤50字语义摘要 → embedding检索
用于语义相似度匹配,创意描述模糊时的召回补充
④ 内容主体 Content Body
分块的实际知识内容
V5.0新增:关联drama_id指向商业数据

创作→评估→商业验证→反馈优化 闭环

① 创作阶段
检索同五维创作方法论
→
② 评估阶段
检索Rubric+失败案例
→
③ 商业验证
检索同五维爆款剧数据
→
④ 反馈优化
校验权重+调整方法论
↩

三种变现模式核心指标体系

付费模式 Paid
指标说明
上线时间首次上线日期
7天付费量上线7天总付费金额
付费转化率触达付费墙后实际付费比例
ARPU人均付费金额
付费墙通过率到达付费墙集数的用户比例
ROI总收入/总制作成本
观看人数独立观看用户数
7日留存率上线7天仍在观看的用户占比
免费模式 Free
指标说明
上线时间首次上线日期
总播放量全剧累计播放次数
观看人数独立观看用户数
完播率观看至最后一集的用户比例
3秒留存率前3秒未离开的用户比例
广告填充率广告位实际展示广告的比例
7日留存率上线7天仍在观看的用户占比
ROI广告收入/总制作成本
IAP混合 Hybrid
指标说明
上线时间首次上线日期
总播放量全剧累计播放次数
7天付费量上线7天总付费金额
付费转化率付费用户转化比例
ARPU人均付费金额
完播率观看至最后一集的用户比例
综合收入付费收入+广告收入
综合ROI综合收入/总制作成本

创作维度→商业结果关联映射示例

创作维度关联商业指标归因分析贡献度
03_故事框架 → 付费转化率第二幕双付费卡点(集8+集12)付费卡点位置与叙事框架直接相关★★★★
05_人物设定 → 7日留存率假女继承人人设的信息差利用人设的信息差金手指制造持续悬念★★★★
08_钩子开场 → 观看人数开场3分钟前世受害+重生触发情绪钩子与点击率直接相关★★★
06_关键事件 → 付费转化率付费墙集8"身份揭示事件"关键事件设计直接影响付费转化★★★
04_叙事节奏 → 完播率5集一小爽+10集一中爽节奏密度与完播率正相关★★★

检索流水线 — 筛选 → 向量召回 → Rerank重排

核心说明:分类、标签、时间、商业数据筛选是前置过滤,缩小候选范围;Rerank 仅对向量召回的结果做语义相关性重排,与分类/标签/时间/商业数据筛选无关。
🔹 筛选阶段 — 缩小候选范围(非Rerank职责)
①
五维定位识别
region + gender + genre + style + monetization
②
维度路由
按dimension(01-12)路由到对应创作维度目录
③
分区路由
按五维标签路由到对应知识库分区
④
核心设定+标签过滤
按 identity / golden_finger / universe / tone / element 过滤
⑤
商业数据筛选 ★V5.0新增
按变现模式+指标值区间过滤,缩小到有商业数据支撑的候选集
🔹 向量召回阶段 — 语义匹配
⑥
向量匹配召回
vector_desc embedding 语义相似度匹配,在筛选后的候选集内召回
🔹 Rerank阶段 — 仅重排向量召回结果
⑦
Rerank向量召回重排
仅对⑥向量召回的结果做语义相关性重排,与分类/标签/时间/商业数据筛选无关

三种检索模式

📁
分类检索
五维+维度 → 分区目录过滤
精度:最高
速度:最快
适用:已知明确分类
🏷️
标签检索
核心设定+风格 → 标签字段匹配
精度:高
速度:快
适用:已知核心设定/风格
🔍
向量匹配
语义描述 → embedding 相似度
精度:中
速度:中
适用:创意描述模糊

Rerank排序因子 — 仅作用于向量召回结果

Rerank 仅对向量召回的候选结果做语义相关性重排序,分类/标签/时间/商业数据筛选已在前置步骤完成,不参与 Rerank 排序。
排序因子权重说明
语义相关性40%query与chunk的语义匹配程度(cross-encoder精排)
内容质量25%分块内容的结构完整度、信息密度、方法论清晰度
上下文连贯性20%chunk与前后文、所属案例的关联完整度
结果多样性15%确保不同视角/案例/方法论都被召回,避免同质化

商业数据检索子类型 ★V5.0新增

检索子类型输入检索方式输出
同类型商业表现对比五维定位过滤同五维剧→按指定指标排序同类型剧商业数据列表
指标区间筛选变现模式+指标名+区间指标值范围过滤符合条件的剧列表
创作-商业归因五维定位+创作维度关联drama_id→归因分析维度→商业指标贡献度映射
评估权重校验五维定位+评估维度统计同类型爆款→相关性分析评估维度权重合理性
ROI选题推荐变现模式+题材按ROI排序→高ROI方向选题推荐+数据支撑

知识库结构

五大分类维度
① 地域:国内 | 海外
② 性别:男频 | 女频
③ 题材:世界观 + 题材类型
④ 流派:叙事机制/风格流派
⑤ 变现模式:付费 | 免费 | IAP混合
▼
核心设定与风格标签
世界观 身份标签 金手指标签 风格标签 元素标签
▼
12创作维度
01_爆款选题
02_背景设定
03_故事框架
04_叙事节奏
05_人物设定
06_关键事件
07_台词对话
08_钩子开场
09_冲突反转
10_情绪共鸣
11_诊断评估
12_失败反常识
每维度内容以分块(Chunk)形式入库,支持分类+标签+向量三检索模式
▼
商业表现数据层 ★V5.0新增
每部剧关联真实市场表现数据 ── 用商业结果校验创作方法论
付费模式
7天付费量 / 付费转化率 / ARPU / ROI
免费模式
总播放量 / 完播率 / 3秒留存 / 广告填充率
IAP混合
综合收入 / 收入结构比例 / 综合ROI
▼
元数据标签
五维定位:region | gender | genre | style | monetization
核心设定:universe | identity | golden_finger | tone | element
分块检索:dimension | chunk_type | vector_desc
商业数据:drama_id | launch_date | 7day_paid | roi | completion_rate 等
▼
三检索模式引擎
① 分类检索
五维+维度 → 分区过滤
② 标签检索
核心设定+风格 → 精准匹配
③ 向量匹配
语义相似度 → embedding 检索
▼

十大规则 V5.0

1
五维定位先行
检索前必须先确定地域×性别×题材×流派×变现模式
2
性别专属评估不得混用
男频评估维度不得用于评判女频剧本
3
严禁跨地域套用
国内创作方法论不得直接套用于海外剧本
4
严禁跨流派套用
逆袭打脸评估维度不得用于时间循环剧本
5
严禁跨变现模式套用
付费/免费/IAP混合评估标准不得混用
6
核心创意保护
优化建议严禁删除/篡改剧本核心设定
7
评估与优化解耦
两个任务必须由独立LLM节点执行
8
失败+反常识必召回
每次评估必须包含反面参照
9
商业数据必须真实 ★V5.0新增
商业表现数据必须来源于真实市场数据,严禁虚构推测
10
归因必须标注confidence ★V5.0新增
创作维度-商业结果归因分析必须标注相关性confidence,相关性≠因果性

四阶段建设计划

Phase 1
骨架搭建 + 国内核心分区填充
第1-2周
任务交付物验收标准
建立五维+12维度目录结构目录结构五维分层+12维度目录全部创建
建立核心设定标签库标签枚举表identity/golden_finger/tone/element全枚举
编写12维度分块示例规范12个分块示例文件每维度含分类+标签+向量+内容
★ 建立商业表现数据目录结构商业数据目录地域/性别/变现模式三层目录
★ 编写商业表现数据分块示例商业数据分块示例含分类+标签+商业数据+归因映射
填充国内男频M01+S01+付费/免费≥5案例+1方法论+1Rubric17项标签100%覆盖
填充国内女频F01+S05+付费/免费≥5案例+1方法论+1Rubric17项标签100%覆盖
★ 填充国内爆款剧商业表现数据≥10部剧完整数据9项商业必填字段100%覆盖
填充失败案例库+反常识案例库≥5条+≥3条跨维度混用案例优先
Phase 2
国内深度 + 海外基础 + 检索优化 + 商业数据关联
第3-4周
任务交付物验收标准
国内男频M07悬疑+M04玄幻填充每题材≥5案例流派交叉标注
国内女频F02宫廷+F04婆媳填充每题材≥5案例流派交叉标注
海外女频HF02+HS01基础填充≥5案例+海外Rubric海外差异标注
12创作维度全部覆盖基础内容每维度≥3条/每性别频段男女频差异化
★ 填充海外爆款剧商业表现数据≥5部剧完整数据海外指标100%覆盖
★ 创作维度-商业结果关联映射≥3组关联映射含创作维度+商业指标+归因分析
实现混合检索+Rerank+向量匹配检索策略代码Top-5召回准确率≥80%
实现评估与优化Agent解耦Dify工作流配置评估/优化独立节点
★ 实现商业数据检索+排序+筛选商业数据检索API按变现模式+指标区间过滤
Phase 3
规模化 + 自动化更新 + 商业数据校验
第5-8周
任务交付物验收标准
国内知识库总量≥150条覆盖主要五维组合男频女频各≥75条
海外知识库总量≥50条海外基础规模海外男频女频各≥25条
★ 国内商业数据≥50部剧国内爆款+非爆款数据9项商业必填100%覆盖
★ 海外商业数据≥20部剧海外爆款数据海外指标100%覆盖
12维度每维度≥10条/每性别频段12维度全覆盖男女频差异化
月度自动采集流水线采集脚本国内每月≥8条,海外每月≥3条
★ 评估权重季度商业校验校验报告评估维度权重与商业结果相关性分析
Phase 4
进阶增强 + 持续迭代 + 商业数据深度分析
第9周起
任务交付物验收标准
海外知识库深度填充海外总量≥100条每海外题材≥8案例
★ 商业数据深度归因分析工具归因分析API创作维度→商业结果统计相关性+因果推断
知识库与创作系统深度集成创作系统知识调用接口创作每步可调用对应分区+维度+商业数据
★ 商业数据驱动的选题推荐引擎选题推荐API按ROI/付费转化率/完播率排序的选题方向推荐
五维体系半年度评估评估报告是否有新题材/流派需独立建分区
知识库开放APIAPI文档外部系统可按五维+维度+向量+商业数据查询