Files
mcn-short-video/project/内容创作知识库/case_1/1_短剧创作知识库/产品规划/短剧创作知识库产品规划.md
T

68 KiB
Raw Blame History

短剧创作知识库 — 产品规划

版本:V5.0 | 日期:2026-07-29 | 状态:重构版(增加商业表现数据层 + 商业结果驱动的创作-评估闭环)


一、项目背景与核心问题

1.1 行业现状

短剧赛道在 2024-2026 年间经历了叙事范式、变现模式和目标受众的三重分化:

国内短剧市场:

  • 传统线性逆袭打脸爽剧仍是男频主流,但占比持续下降
  • 时间循环 / 无限复活 / 轮回解谜类非线性叙事成为新爆款范式
  • 微悬疑反转、情绪治愈、轻恐怖等新兴题材快速崛起
  • 变现模式:付费短剧(关键集付费墙)+ 免费短剧(广告变现 / 完播率驱动)并行

海外短剧市场(美国为主):

  • ReelShort、DramaBox、ShortTV 等平台快速增长
  • 女频 Billionaire Romance / Mafia Romance 是绝对主流
  • 男频 Action Thriller / Crime Noir 起步较晚但增长迅速
  • 变现模式:以 IAP(应用内购买)付费解锁为主,广告变现为辅

男频 vs 女频的核心差异:

  • 男频核心情绪:逆袭征服、打脸爽感、力量掌控、兄弟义气
  • 女频核心情绪:甜蜜恋爱、虐心共鸣、重生复仇、情感治愈

付费 vs 免费的核心差异:

  • 付费模式:关键集卡点设计、付费转化率、悬念钩子是硬指标
  • 免费模式:完播率、广告填充率、前 3 秒留存是硬指标
  • 同一剧本在两种变现模式下,节奏、钩子密度、集尾设计完全不同

1.2 AI 创作/评估系统的核心痛点(源自实战反馈)

痛点 表现 根因
叙事视野单一 只认"线性打脸爽文",遇到循环/轮回类剧本全面否定 知识库样本严重失衡,高频爽文垄断
评估标尺僵硬 用一套通用评分标准评判所有题材,强行套用线性范式 缺少叙事类型元数据,无法分类差异化评估
变现逻辑误判 用免费短剧的完播率标准评估付费短剧,或反之 未按付费/免费区分评估标尺
优化建议粗暴 直接删除核心创意设定(如要求取消循环机制改为"杀穿地牢") 评估与优化耦合,模型倾向简化复杂创意为熟悉范式
知识储备滞后 评估体感落后行业 1 年以上,缺少近 1-2 年新兴赛道案例 知识库更新停滞
检索策略固化 所有剧本使用同一套 Top-K 检索 缺少动态检索路由
缺乏地域区分 用国内创作方法论评判海外剧本,或反之 知识库未按地域分区
缺乏性别区分 用男频评估维度评判女频甜宠剧本 知识库未按性别分区
标签粒度不足 只有"题材"和"流派",缺少"世界观/核心设定/风格" 检索无法精准定位到同类剧本
创作维度缺失 缺少选题/背景/故事框架/关键事件等创作核心维度 知识库内容维度不够细
缺乏商业结果校验 评估标准凭主观经验,无法用真实市场数据校验评估维度权重 知识库只有创作方法论,没有市场表现数据
创作-评估脱节 不清楚哪些创作技法实际产生了商业回报 缺少创作维度与商业结果的关联映射

1.3 知识库是根因中的根因

上述问题的底层根源指向 知识库的质量和结构。结论:知识库的上限,直接决定 AI 创作/评估系统的上限。而市场数据是校验知识库质量的上限标尺。


二、知识库定位与核心价值

2.1 定位

短剧创作知识库是 面向短剧全生命周期(选题→创作→评估→优化→商业验证)的结构化知识基础设施,按 地域×性别×题材×流派×变现模式 五维体系组织,并在每条知识上挂载 世界观、核心设定(身份/金手指)、风格 三层标签,按 12 个创作维度 组织内容,每个维度内容以 分块(Chunk) 形式入库,支持 分类检索 + 标签检索 + 向量匹配 三种检索模式,并通过 商业表现数据层 将创作维度知识与真实市场结果数据关联,形成 创作→评估→商业验证→反馈优化 的闭环体系。

2.2 核心价值主张

价值维度 具体交付
五维精准分类 地域×性别×题材×流派×变现模式,知识库每条知识五维定位
三层精细标签 世界观 / 核心设定(身份+金手指) / 风格(风格+元素),提升检索精度
12创作维度覆盖 爆款选题/背景设定/故事框架/叙事节奏/人物设定/关键事件/台词对话/钩子开场/冲突反转/情绪共鸣/诊断评估/失败反常识
商业表现数据层 每部剧关联上线时间、总播放量、7天付费量、观看人数等市场数据,用真实商业结果校验创作方法论
三检索模式 分类过滤 + 标签过滤 + 向量语义匹配,三种模式可组合、可降级
分块示例规范 每个创作维度有标准分块模板,含分类字段+标签字段+向量描述
范式多元化 国内≥8 种主流流派 + 海外≥6 种主流流派,每种流派≥5 个标杆案例
变现差异化 付费 / 免费 / IAP 混合三种模式配备独立评估权重
评估差异化 每种五维组合配备独立 Rubric 评分维度
创作指导性 每种组合配备创作方法论、结构模板、节奏范式、常见陷阱
商业结果校验 评估维度权重可由真实市场数据校准(如:付费剧的付费卡点设计权重是否与7天付费量相关)
知识时效性 月度更新机制,知识库与行业最新趋势同步
反偏见校准 失败案例库 + 反常识成功案例库,打破模型认知锁定

2.3 与短视频创作知识库的关系

子项目 核心差异 共享层
短剧创作知识库 多集连续叙事、人物成长弧线、剧情伏笔/悬念管理、跨集钩子设计、付费卡点设计 选题策略、钩子开场、情绪共鸣、商业植入、商业表现数据结构
短视频创作知识库 单集独立完成、强开场 3 秒钩子、信息密度集中、快速情绪峰值 选题策略、钩子开场、情绪共鸣、商业植入、商业表现数据结构

三、知识库架构设计

3.1 总体架构:五维分类 + 三层标签 + 12创作维度 + 商业表现数据层 + 三检索模式

┌─────────────────────────────────────────────────────────────┐
│              短剧创作知识库 总体架构(V5.0)                   │
├─────────────────────────────────────────────────────────────┤
│                                                             │
│  ┌──────── 第1层:五大分类维度(顶层定位)────────────┐      │
│  │ ① 地域:国内 | 海外(美国为主)                    │      │
│  │ ② 性别:男频 | 女频                               │      │
│  │ ③ 题材:世界观 + 题材类型                          │      │
│  │ ④ 流派:叙事机制/风格流派                          │      │
│  │ ⑤ 变现模式:付费 | 免费 | IAP 混合                 │      │
│  └───────────────────────────────────────────────────┘      │
│                                                             │
│  ┌──────── 第2层:核心设定与风格标签(精准定位)─────┐      │
│  │ 世界观 | 身份标签 | 金手指标签 | 风格标签 | 元素标签│      │
│  └───────────────────────────────────────────────────┘      │
│                                                             │
│  ┌──────── 第3层:12创作维度(内容分块组织)─────────┐      │
│  │ 01_爆款选题  02_背景设定  03_故事框架              │      │
│  │ 04_叙事节奏  05_人物设定  06_关键事件              │      │
│  │ 07_台词对话  08_钩子开场  09_冲突反转              │      │
│  │ 10_情绪共鸣  11_诊断评估  12_失败反常识            │      │
│  │ ── 每维度内容以分块(Chunk)形式入库 ──              │      │
│  │ ── 分块支持分类+标签+向量三检索模式 ──             │      │
│  └───────────────────────────────────────────────────┘      │
│                                                             │
│  ┌──────── 第4层:商业表现数据层(市场校验)─────────┐      │
│  │ ── 每部剧关联真实市场表现数据 ──                   │      │
│  │ ── 数据按变现模式分指标体系 ──                     │      │
│  │ ── 用商业结果校验创作方法论和评估权重 ──           │      │
│  │ ── 形成创作→评估→商业验证→反馈优化闭环 ──        │      │
│  │                                                    │      │
│  │ 付费模式核心指标:                                 │      │
│  │   上线时间 / 7天付费量 / 付费转化率 / ARPU /       │      │
│  │   付费墙通过率 / ROI                               │      │
│  │                                                    │      │
│  │ 免费模式核心指标:                                 │      │
│  │   上线时间 / 总播放量 / 观看人数 / 完播率 /        │      │
│  │   3秒留存 / 广告填充率 / 7日留存率                 │      │
│  │                                                    │      │
│  │ IAP混合模式核心指标:                              │      │
│  │   上线时间 / 总播放量 / 7天付费量 / 付费转化率 /   │      │
│  │   ARPU / 完播率 / 综合ROI                          │      │
│  └───────────────────────────────────────────────────┘      │
│                                                             │
│  ┌──────── 第5层:元数据标签(检索定位)─────────────┐      │
│  │ region | gender | genre | style | monetization    │      │
│  │ universe | identity | golden_finger | tone | year │      │
│  │ platform | is_hit | core_conflict | core_hook     │      │
│  │ dimension | chunk_type | vector_desc              │      │
│  │ ── 新增商业数据字段 ──                             │      │
│  │ drama_id | launch_date | total_views | viewer_count│     │
│  │ 7day_paid | paid_conversion_rate | completion_rate│      │
│  │ arpu | 7day_retention | engagement_rate | roi     │      │
│  │ 3sec_retention | ad_fill_rate | hot_rank          │      │
│  └───────────────────────────────────────────────────┘      │
│                                                             │
│  ┌──────── 第6层:三检索模式引擎 ──────────────────┐      │
│  │ ① 分类检索:五维+维度 → 分区过滤                │      │
│  │ ② 标签检索:核心设定+风格 → 精准匹配           │      │
│  │ ③ 向量匹配:语义相似度 → embedding 检索         │      │
│  │ ── 三模式可组合、可降级、可加权 ──              │      │
│  │ ── 商业数据检索:按变现模式+指标值区间过滤 ──   │      │
│  └───────────────────────────────────────────────────┘      │
└─────────────────────────────────────────────────────────────┘

3.2 第1层:五大分类维度详解

① 地域维度

地域 核心平台 受众特征 创作惯例差异
国内 番茄短剧、抖音短剧、快手星芒、红果短剧、微信短剧 中文用户,对爽感/情绪共鸣要求极高 集数多(80-100 集),每集 1-2 分钟,节奏极快
海外(美国为主) ReelShort、DramaBox、ShortTV、GoodShort 英语用户,对叙事完整性、角色化学反应要求更高 集数较少(60-80 集),每集 2-3 分钟,叙事弧线更完整

地域分区规则:国内创作方法论不得直接套用于海外剧本,反之亦然。

② 性别维度

性别频段 核心情绪驱动 叙事节奏偏好 典型钩子类型
男频 逆袭征服、打脸爽感、力量掌控、兄弟义气、智谋碾压 快节奏、高密度冲突、即时反馈、升级递进 身份反转钩子、武力碾压钩子、智谋揭穿钩子
女频 甜蜜恋爱、虐心共鸣、重生复仇、情感治愈、自我成长 情绪细腻、情感转折多、共鸣点密集、治愈/虐心交替 身份揭穿钩子、误会反转钩子、情感告白钩子、重生复仇钩子

性别分区规则:男频评估维度不得用于评判女频剧本,反之亦然。

③ 题材维度:世界观 + 题材类型

题材采用 "世界观 → 题材类型" 两层组织,解决同一世界观下多种题材、同一题材跨世界观的问题。

国内题材体系:

世界观 题材类型 题材编号 代表特征
现代都市 都市逆袭 M01 贫→富、弱→强、被看不起→震惊全场
现代都市 职场逆袭 M02 职场奋斗、能力证明、事业翻盘
现代都市 家庭伦理 M03 婆媳冲突、婚姻保卫、家庭逆袭
古代/架空 玄幻修真 M04 修仙/修真/玄幻体系升级
古代/架空 武侠江湖 M05 武功升级、江湖义气、门派争斗
古代/架空 历史权谋 M06 权谋智斗、势力角逐、帝王之路
悬疑犯罪 悬疑推理 M07 伏笔密布、信息不对称、反转冲击
悬疑犯罪 黑帮犯罪 M08 犯罪/黑帮/江湖道义
科幻未来 科幻未来 M09 科技碾压、时间穿越、外星入侵
游戏异界 无限流/闯关 M10 多副本闯关、无限复活、能力解锁
游戏异界 电竞热血 M11 技术碾压、团队配合、赛场翻盘

海外男频题材体系(美国为主):

世界观 题材类型 题材编号 代表特征
Modern/Urban Action Thriller HM01 英雄崛起、武力碾压、正义伸张
Crime/Noir Crime Noir HM02 黑帮崛起、道德抉择、权力争夺
Sci-fi Sci-fi HM03 科技碾压、异世界探索、未来战争
Supernatural Horror/Supernatural HM04 恐惧驱动、超自然力量、生存挑战
Military Military/War HM05 热血激战、牺牲精神、英雄主义
Superhero Superhero HM06 超能力觉醒、正义伸张、反派对决

海外女频题材体系(美国为主,参考图片重构):

世界观 题材类型 题材编号 代表特征
Urban Romance HF01 都市恋爱、身份差异、化学反应
Urban Marriage HF02 婚姻契约、先婚后爱、婚姻保卫
Business Romance HF03 商业帝国、CEO 恋情、办公室权力
Ancient Romance HF04 古代言情、宫廷权谋、身份秘密
ABO Romance HF05 ABO 设定、信息素、宿命羁绊
Magic World Fantasy HF06 魔法世界、异世界冒险、奇幻恋爱
Sci-fi Sci-fi HF07 科幻未来、时间旅行、系统设定
Urban Family Drama HF08 家庭矛盾、关系修复、情感治愈
Urban Mystery/Suspense HF09 悬疑线索、真相揭示、恋爱线交织

④ 流派维度(叙事机制/风格流派)

流派 = "怎么讲故事"的叙事机制,区别于题材的"讲什么故事"。

国内流派体系:

流派编号 流派名称 核心机制 典型题材
S01 逆袭打脸 主角从弱到强,持续打败对手,即时反馈 都市逆袭、玄幻修真、武侠江湖
S02 时间循环/轮回解谜 反复复活/轮回,每轮信息增量,渐进解谜 悬疑推理、科幻未来、无限流
S03 无限流/闯关升级 多副本闯关,难度递增,能力渐进 无限流、科幻未来
S04 悬疑反转/闭环解谜 信息逐步揭示,伏笔密布,结尾反转 悬疑推理、黑帮犯罪、宫廷权谋
S05 情绪治愈/轻恐怖 情绪共鸣为主,节奏偏慢,治愈或微反转 甜宠虐恋、闺蜜情感、校园青春
S06 家庭现实/社会议题 真实接地气,社会议题嵌入 家庭伦理、职场逆袭、婆媳家庭
S07 混合型/跨界 多流派混搭(如逆袭+循环、悬疑+治愈) 跨题材适用
S08 新兴流派 新出现的叙事流派,待定义待验证 待定

海外女频流派体系(参考图片):

流派编号 流派名称 核心机制 典型题材
HS01 重生流 / Rebirth 主角死后重生回到过去,改写命运 都市恋爱、复仇、婚姻
HS02 穿越流 / Transmigration 主角穿越到另一个世界/身体,用现代知识碾压 古代言情、奇幻、ABO
HS03 魂穿 / Body Swap 灵魂进入他人身体,身份错位 豪门恩怨、婚姻、悬疑
HS04 复仇流 / Revenge 受害→积蓄力量→复仇翻盘 复仇剧、豪门恩怨、职场
HS05 后悔流 / Regret/Second Chance 错过后的重逢/追妻火葬场/追夫火葬场 甜宠虐恋、婚姻、豪门
HS06 逆袭流 / Comeback 从底层/被轻视到翻盘 职场、商业、校园
HS07 甜宠流 / Sweet Romance 甜蜜恋爱、治愈、无虐心 纯甜恋爱、校园、契约婚姻
HS08 新兴流派 待定义 待定

海外男频流派体系:

流派编号 流派名称 核心机制 典型题材
HM01 英雄旅程 / Hero Journey 英雄从弱到强的线性旅程 Action Thriller、Superhero
HM02 系统流 / System 获得系统,任务驱动升级 Sci-fi、无限流
HM03 末日生存 / Survival 末日/危机环境下生存崛起 Horror、Sci-fi、Military
HM04 黑帮崛起 / Crime Rise 从底层崛起为权力掌控者 Crime Noir、Mafia
HM05 军事行动 / Military Ops 军事任务、战略碾压、英雄主义 Military/War
HM06 超能力觉醒 / Superpower 超能力觉醒、正义伸张 Superhero、Sci-fi
HM07 新兴流派 待定义 待定

⑤ 变现模式维度

变现模式 核心指标 节奏特征 钩子特征 评估权重差异
付费 / Paid 付费转化率、ARPU、付费墙通过率、7天付费量 关键集(第 8-12 集)设置强付费卡点 每集结尾强悬念、关键信息 withholding 付费转化权重 15%
免费 / Free 完播率、3 秒留存、广告填充率、总播放量、观看人数 节奏更快、每集独立爽点、广告位自然 开场 3 秒强钩子、每集情绪峰值 完播率权重 15%
IAP 混合 / Hybrid 付费转化 + 广告变现综合 ROI 免费集引流 + 关键集付费 + 长尾广告 兼顾引流钩子与付费卡点 综合权重,按平台策略调整

变现模式规则:

  1. 付费短剧不能用免费短剧的完播率标准评估
  2. 免费短剧不能用付费短剧的付费转化标准评估
  3. 同一剧本改编为不同变现模式时,节奏和钩子设计必须重新调整

3.3 第2层:核心设定与风格标签

参考图片中的"核心设定"和"风格"列,每条知识必须挂载以下标签层。

世界观标签(universe)

标签值 说明 适用地域
都市 / Urban 现代都市背景 国内/海外
古代 / Ancient 古代/架空历史 国内/海外
玄幻 / Fantasy 修仙/魔法/异世界 国内/海外
科幻 / Sci-fi 未来/科技/外星 国内/海外
悬疑犯罪 / Crime 犯罪/黑帮/ noir 国内/海外
商业 / Business 商业帝国/职场高层 海外为主
娱乐 / Entertainment 娱乐圈/明星 海外为主
ABO ABO 世界观 海外女频
魔法世界 / Magic World 魔法学院/奇幻大陆 海外女频

身份标签(identity)

标签值 典型场景 主要性别频段
萌宝 / Cute Child 天才萌宝助攻父母恋情 女频
CEO/执行长 / CEO 霸总、商业帝国掌权者 女频/男频
企业家 / Entrepreneur 创业逆袭、商业斗争 男频/女频
女总裁 / Female President 强人、职场逆袭 女频
名人 / Celebrity 明星、网红、公众人物 频/男频
替身 / Substitute 替身文学、身份错位 女频
替罪新娘 / Scapegoat Bride 替嫁、替罪、身份替换 女频
代理新娘 / Surrogate Bride 代孕/代理新娘设定 海外女频
假女继承人 / Fake Heiress 真假千金、身份冒充 女频
废柴 / Underdog 底层逆袭、被轻视者 男频
特种兵 / Special Forces 军事/动作背景 男频
医生 / Doctor 天才医术、神医 男频/女频

金手指标签(golden_finger)

标签值 核心机制 典型流派
超能力 / Superpower 主角拥有特殊能力 英雄旅程、超能力觉醒
时间旅行 / Time Travel 穿越/重生/时间循环 重生流、穿越流、循环流
系统 / System 系统任务、奖励、升级 系统流、无限流
天才医术 / Medical Genius 医术通天、救人/打脸 逆袭打脸、重生流
传承觉醒 / Inheritance 获得前辈传承、觉醒血脉 玄幻修真、奇幻
巨大财富 / Huge Wealth 继承/获得巨额财富 逆袭打脸、霸总文
巨大权势 / Huge Power 获得权势/地位 逆袭打脸、黑帮崛起
信息差 / Information Gap 重生/穿越带来的先知优势 重生流、穿越流
神级技能 / God Skill 某项技能登峰造极 逆袭打脸、系统流

风格标签(tone)

标签值 情绪特征 主要性别频段
打脸爽剧 / Face-slapping 即时爽感、碾压对手 男频/女频
甜宠 / Sweet 甜蜜治愈、无虐心 频
虐恋 / Angst 虐心、误会、追妻/追夫 女频
喜剧 / Comedy 轻松搞笑、反差萌 全频段
女性成长 / Female Growth 女主自我成长、独立 女频
自我成长 / Self Growth 主角成长蜕变 全频段
暗黑 / Dark 压抑、复仇、道德灰色 男频/女频
悬疑 / Suspenseful 紧张、悬念、未知 全频段

风格元素标签(element)

标签值 情感内核 主要场景
爱恨交织 / Love-Hate 爱与恨交织 甜宠虐恋、豪门恩怨
有毒的爱 / Toxic Love 危险吸引力、不健康关系 Mafia Romance、暗黑
恨 / Hatred 复仇驱动 复仇流
背叛 / Betrayal 被背叛后的反击 ���仇流、重生流
命中注定的爱人 / Fated Mate 宿命感、ABO/灵魂伴侣 ABO、奇幻
相互的爱 / Mutual Love 双向奔赴 甜宠
保护欲 / Protectiveness 强者保护弱者 霸总、动作
身份错位 / Identity Swap 身份误会/错位 魂穿、真假千金

3.4 第3层:12创作维度(内容分块组织)

编号 维度名称 核心内容 V3.0对应
01 爆款选题 选题方法论、热点趋势、选题评估维度、选题组合公式 新增
02 背景设定 世界观构建规则、时空设定、社会体系、势力格局、核心设定(身份/金手指)逻辑 新增
03 故事框架 三幕/五幕/多幕结构、场次划分、叙事弧线、付费卡点结构设计 原01_结构部分
04 叙事节奏 节奏范式、集间节奏、情绪节奏曲线、信息揭示节奏、爽点密度 原01_节奏部分
05 人物设定 人物成长弧线、人设卡片模板、人物关系图谱、人设差异化(男频/女频) 原02_人物与人设
06 关键事件 事件设计方法论、转折点设计、伏笔-回收链、事件序列编排、关键集设计 新增
07 台词对话 爆款台词特征、对白节奏、台词风格库、台词差异化(男频/女频/地域) 原03_台词与对白
08 钩子与开场 开场公式、跨集钩子设计、悬念前置、集尾钩子、付费卡点钩子 原04(保留)
09 冲突与反转 冲突类型库、反转设计方法论、冲突升级路径、冲突差异化 原05(保留)
10 情绪与共鸣 情绪曲线设计、共鸣点分布、情绪拐点、情绪差异化 原06(保留)
11 诊断评估与优化 分五维组合的 Rubric 评分维度、评估流水线 原07(保留)
12 失败案例与反常识 失败案例库、反常识成功案例、常见陷阱 原08(保留)

3.5 第4层:商业表现数据层

V4.0→V5.0 关键变化:新增商业表现数据层,将每部剧的市场表现数据与创作维度知识关联,形成创作→评估→商业验证→反馈优化的闭环体系。

3.5.1 为什么需要独立的商业表现数据层?

理由 说明
创作方法论需要市场校验 当前评估维度权重凭主观经验设定,无法用真实数据校验
商业结果反哺创作 哪些创作技法实际产生了商业回报?哪些技法好评但无收益?需要数据关联才能回答
变现模式差异需要数据证明 付费/免费/IAP 的评估权重差异需要真实数据支撑
选题和优化需要数据驱动 "这个选题方向市场表现如何?"需要数据而非方法论回答
知识库质量需要量化评估 知识库提供的建议是否真的提升了商业结果?需要数据校验

3.5.2 商业表现数据结构

每部短剧在知识库中作为一个独立数据实体,关联以下商业表现指标:

通用指标(所有变现模式共享):

字段名 中文名 数据类型 说明 来源
drama_id 剧本唯一标识 string 知识库内唯一标识,用于关联创作维度知识 系统生成
drama_title 剧名 string 短剧正式名称 平台公开信息
launch_date 上线时间 date (YYYY-MM-DD) 短剧首次上线日期 平台公开信息
platform 上线平台 string 番茄短剧/ReelShort/DramaBox 等 平台公开信息
total_episodes 总集数 int 全剧集数 平台公开信息
total_views 总播放量 long 全剧累计播放次数 平台数据
viewer_count 观看人数 long 独立观看用户数 平台数据
7day_retention 7日留存率 float (%) 上线后7天仍在观看的用户占比 平台数据
engagement_rate 互动率 float (%) 评论+点赞+分享/播放量 平台数据
hot_rank 热搜排名 int 平台内热度排名峰值 平台数据
platform_rating 平台评分 float 平台用户评分(如有) 平台数据

付费模式专属指标:

字段名 中文名 数据类型 说明 来源
7day_paid 7天付费量 long (¥/$) 上线后7天内总付费金额 平台财务数据
paid_conversion_rate 付费转化率 float (%) 触达付费墙后实际付费的用户比例 平台财务数据
arpu ARPU(人均付费) float (¥/$) 平均每个付费用户的付费金额 平台财务数据
paid_wall_pass_rate 付费墙通过率 float (%) 到达付费墙集数的用户比例 平台数据
roi ROI float 总收入/总制作成本 财务数据

免费模式专属指标:

字段名 中文名 数据类型 说明 来源
completion_rate 完播率 float (%) 观看至最后一集的用户比例 平台数据
3sec_retention 3秒留存率 float (%) 前3秒未离开的用户比例 平台数据
ad_fill_rate 广告填充率 float (%) 广告位实际展示广告的比例 平台数据
ad_revenue 广告收入 long (¥/$) 全剧累计广告收入 平台财务数据

IAP 混合模式专属指标:合并付费模式 + 免费模式核心指标,另增:

字段名 中文名 数据类型 说明 来源
total_revenue 综合收入 long (¥/$) 付费收入 + 广告收入 平台财务数据
revenue_ratio 收入结构比例 string 付费占比:广告占比(如"60:40") 平台财务数据
hybrid_roi 综合 ROI float 综合收入/总制作成本 财务数据

3.5.3 商业表现数据分块结构

商业表现数据以 剧级实体 为最小入库单元(而非创作维度分块),每部剧对应一个完整数据分块:

商业表现数据分块模板:
┌────────────────────────────────────────────┐
│ ① 分类字段(Classification)                │
│   ── 五维定位 → 决定该剧归属分区              │
│                                            │
│ ② 标签字段(Tags)                          │
│   ── 核心设定标签 + 风格标签                   │
│   ── 用于关联同类型剧本的创作维度知识          │
│                                            │
│ ③ 商业数据字段(Business Data)              │
│   ── 按变现模式选择对应指标体系                │
│   ── 通用指标 + 变现模式专属指标               │
│                                            │
│ ④ 内容主体(Content Body)                  │
│   ── 商业表现分析:数据解读 + 商业结果归因    │
│   ── 创作维度-商业结果关联映射                │
└────────────────────────────────────────────┘

3.5.4 商业表现数据分块示例

# 商业表现数据示例:《重生千金逆袭记》

## ① 分类字段
- region: 国内
- gender: 女频
- genre: F03_重生复仇
- style: S03_重生复仇弧
- monetization: 付费

## ② 标签字段
- universe: 都市
- identity: 假女继承人
- golden_finger: 信息差
- tone: 暗黑
- element: 背叛,恨
- drama_id: DR-CN-F03-001
- drama_title: 重生千金逆袭记
- launch_date: 2025-03-15
- total_episodes: 80
- platform: 番茄短剧

## ③ 商业数据字段(付费模式)
- total_views: 12,000,000
- viewer_count: 3,500,000
- 7day_paid: ¥2,800,000
- paid_conversion_rate: 8.2%
- arpu: ¥28.5
- paid_wall_pass_rate: 42%
- roi: 3.8
- 7day_retention: 65%
- engagement_rate: 12.5%
- hot_rank: 3
- platform_rating: 4.2

## ④ 内容主体

### 商业表现分析
- **付费转化率 8.2%**:高于同类女频付费剧平均 6.5%,归因于付费卡点设计(集8身份揭示+集12真相揭示双卡点)
- **ARPU ¥28.5**:高于平均值 ¥22,归因于VIP解锁促销+全剧解锁组合策略
- **ROI 3.8**:制作成本约 ¥740,000,7天收入 ¥2,800,000,高ROI归因于低成本+强付费设计

### 创作维度-商业结果关联映射
| 创作维度 | 关联指标 | 关联分析 |
|----------|----------|----------|
| 03_故事框架 → 付费转化率 | 第二幕中段双付费卡点(集8+集12)是付费转化的关键驱动力 | 付费卡点位置与前世受害+重生身份揭示的叙事框架直接相关 |
| 05_人物设定 → 7day_retention | 假女继承人人设的"信息差利用+身份逐步揭示"是留存驱动力 | 人设的信息差金手指制造持续悬念 |
| 08_钩子开场 → viewer_count | 开场3分钟前世受害+重生触发的强情绪钩子驱动大量观看 | 情绪钩子与点击率直接相关 |
| 06_关键事件 → paid_conversion_rate | 付费墙集8的"身份揭示事件"是付费转化的核心驱动 | 关键事件设计直接影响付费转化 |
| 04_叙事节奏 → completion_rate | 集间节奏5集一小爽+10集一中爽保持观众追剧节奏 | 节奏密度与完播率正相关 |

### 商业结果归因总结
核心创作技法对商业结果的贡献度排序:
1. 付费卡点设计(03框架+06事件) → 付费转化率贡献度 ★★★★
2. 身份揭示悬念链(05人设+06事件) → 7日留存贡献度 ★★★★
3. 情绪钩子开场(08钩子) → 观看人数贡献度 ★★★
4. 复仇节奏密度(04节奏) → 完播率贡献度 ★★★

3.5.5 商业表现数据检索策略

检索场景 检索方式 示例
同类型剧的商业表现对比 五维定位过滤 → 商业数据排序 "国内女频重生复仇付费剧,按7天付费量排序"
特定指标区间筛选 变现模式+指标值区间过滤 "付费转化率≥8%的国内女频付费剧"
创作维度-商业结果关联 五维+维度 → 关联同类型剧的商业数据 "付费卡点设计对付费转化率的影响"
商业数据校验评估权重 五维定位 → 同类型爆款剧数据 → 统计分析 "付费剧中付费卡点设计权重是否与实际ROI正相关"
ROI驱动的选题筛选 变现模式+题材 → 按ROI排序 → 高ROI选题方向 "国内付费模式ROI最高的3个题材"

3.5.6 创作-评估-商业验证闭环

闭环流程:

① 创作阶段 → 从知识库检索同五维定位的创作方法论+分块
② 评估阶段 → 从知识库检索同五维定位的Rubric+失败案例 → 分维度评分
③ 商业验证 → 从知识库检索同五维定位的爆款剧商业数据 → 统计分析
④ 关联映射 → 将创作维度技法与商业结果指标做归因分析
⑤ 反馈优化 → 根据商业验证结果调整:
   - 评估Rubric权重(如:付费转化率数据证明付费卡点设计权重应提升)
   - 创作方法论优先级(如:ROI数据证明某技法比其他技法更有效)
   - 选题方向推荐(如:某题材ROI数据持续走高,推荐增加该题材选题)

3.6 第5层:元数据标签规范

必填标签(17 项 — 创作维度相关)

标签字段 值域 说明
region 国内/海外 地域分类
gender 男频/女频 性别频段分类
genre 题材编号 M01-M11 / HM01-HM06 / HF01-HF09
style 流派编号 S01-S08 / HS01-HS08 / HM01-HM07
monetization 付费/免费/IAP混合 变现模式
dimension 01-12 创作维度编号
universe 世界观标签 都市/古代/玄幻/科幻/ABO 等
identity 身份标签 可多个,逗号分隔
golden_finger 金手指标签 可多个,逗号分隔
tone 风格标签 可多个,逗号分隔
element 元素标签 可多个,逗号分隔
year 2024/2025/2026 上线年份
platform 平台名称 番茄/ReelShort/DramaBox 等
is_hit 是/否 是否为爆款
core_hook 自由文本(≤20 字) 核心叙事梗/卖点
chunk_type 方法论/案例复盘/模板/Rubric/失败案例/反常识案例/商业表现数据 分块内容类型
vector_desc 自由文本(≤50 字) 向量语义描述

商业数据必填字段(剧级实体专属)

字段 适用变现模式 说明
drama_id 全部 剧本唯一标识,用于关联创作维度知识
launch_date 全部 上线时间
total_views 全部 总播放量
viewer_count 全部 观看人数
7day_retention 全部 7日留存率
7day_paid 付费/IAP混合 7天付费量
paid_conversion_rate 付费/IAP混合 付费转化率
completion_rate 免费/IAP混合 完播率
roi 全部 ROI

选填标签(4 项 — 创作维度相关)

标签字段 值域 说明
data_performance 播放量/完播率/付费率/互动率等 数据表现
source_type 爆款复盘/方法论/论文/报告/编剧经验 来源类型
tag_version v1/v2/v3... 标签版本号
failure_type 暴力简化/跨维度套用/创意删除/结构崩塌/评估误判/其他 仅失败案例使用

标签使用规则

  1. 创作维度知识入库必须完成 17 项必填标签,缺标签拒绝入库
  2. 商业表现数据入库必须完成 drama_id + 9 项商业必填字段,缺字段拒绝入库
  3. 五维定位标签是检索第一优先过滤条件
  4. 创作维度标签(dimension)是第二优先过滤条件
  5. 核心设定标签(identity/golden_finger)是第三优先过滤条件
  6. 风格标签(tone/element)用于 Rerank 和内容相似度加权
  7. 向量描述(vector_desc)用于语义检索的 embedding 匹配
  8. 商业数据字段用于商业验证检索和创作-商业归因分析
  9. 检索时先按五维标签缩小范围,再按创作维度过滤,再按核心设定标签过滤,最后做向量语义匹配
  10. 商业验证时先按五维定位+变现模式过滤,再按商业数据指标排序/区间筛选,再关联创作维度知识做归因

四、创作维度分块示例规范

4.1 分块(Chunk)总体规范

每个创作维度的知识内容以 分块(Chunk) 为最小入库单元。每个分块必须包含三种检索模式所需的结构化字段:

分块通用模板:
┌────────────────────────────────────────────┐
│ ① 分类字段(Classification)                │
│   ── 五维定位 + 维度编号 → 决定分区路由      │
│                                            │
│ ② 标签字段(Tags)                          │
│   ── 核心设定标签 + 风格标签 + chunk_type    │
│   ── 用于精准过滤和加权                      │
│                                            │
│ ③ 向量描述字段(Vector Description)         │
│   ── vector_desc 语义摘要 → embedding 检索  │
│   ── 用于语义相似度匹配                      │
│                                            │
│ ④ 内容主体(Content Body)                  │
│   ── 分块的实际知识内容                      │
│   ── V5.0新增:关联drama_id指向商业数据      │
└────────────────────────────────────────────┘

三种检索模式的关系:

模式 检索方式 适用场景 精度 速度
分类检索 五维+维度 → 分区目录过滤 已知明确的分类定位 最高 最快
标签检索 核心设定+风格 → 标签字段匹配 已知核心设定/风格但分类模糊 高 快
向量匹配 语义描述 → embedding 相似度 创意描述模糊、需语义联想 中 中

组合检索策略:分类过滤(缩小范围)→ 标签过滤(精准定位)→ 向量匹配(语义召回)→ Rerank(综合排序)

4.2 每个创作维度的分块示例

(04_叙事节奏至12_失败反常识的分块示例与V4.0相同,此处保留01-03的更新版本——新增drama_id关联字段)

01_爆款选题 — 分块示例(V5.0更新:增加商业数据关联)

# 分块示例:01_爆款选题

## ① 分类字段
- region: 国内
- gender: 男频
- genre: M01_都市逆袭
- style: S01_逆袭打脸
- monetization: 付费
- dimension: 01

## ② 标签字段
- universe: 都市
- identity: 废柴,CEO
- golden_finger: 巨大财富,信息差
- tone: 打脸爽剧
- element: 背叛,身份错位
- chunk_type: 方法论
- year: 2025
- platform: 番茄短剧
- is_hit: 是
- core_hook: 底层逆袭打脸+身份反转

## ③ 向量描述
- vector_desc: "男频都市逆袭选题方法论:底层主角被看不起后突然获得财富/权势/能力,
  通过打脸碾压持续爽感递进,核心选题公式为'被轻视→获得金手指→打脸→升级→终极碾压'"

## ④ 内容主体
### 男频都市逆袭选题方法论

**选题公式**:被轻视(触发) → 获得金手指(转折) → 打脸碾压(爽感) → 升级挑战(递进) → 终极碾压(高潮)

**核心选题维度**:
1. **触发力**:主角被轻视的方式是否足够刺痛目标受众?
2. **金手指匹配度**:金手指是否与题材世界观自然融合?
3. **打脸密度**:每 5-8 集至少一次打脸,密度递增
4. **升级梯度**:对手实力逐级上升,主角成长曲线可见

**选题商业验证**(关联商业数据):
- 付费模式选题方向ROI排序:都市逆袭ROI=3.5 > 悬疑推理ROI=2.8 > 科幻未来ROI=2.2
- 爆款选题数据支撑:都市逆袭题材2025年付费剧平均7天付费量¥180万,付费转化率7.2%
- 关联drama_id: DR-CN-M01-005 / DR-CN-M01-012 / DR-CN-M01-023

02-12维度分块示例

(02_背景设定至12_失败反常识的分块示例结构与V4.0相同,此处省略重复内容,详见分块示例文件夹)


五、知识库内容规范

5.1 入库内容类型与质量标准

内容类型 chunk_type值 入库格式 质量标准 来源渠道
爆款案例复盘 案例复盘 结构化.md 必须有数据,必须标注五维标签 + 核心设定标签 + 风格标签 平台数据+编剧复盘
创作方法论 方法论 方法论.md ≥2 实例,标注适用范围 论文+报告+编剧经验
结构模板 模板 模板.md ≥1 成功案例验证 爆款拆解+编剧共创
评估 Rubric Rubric Rubric.md 每维度明确高分/低分判据 成熟平台+专家制定
失败案例 失败案例 案例.md 有数据支撑,标注 failure_type 崩盘案例+编剧反思
反常识成功案例 反常识案例 案例.md 解释"为什么不符合常识但成功了" 非传统爆款
商业表现数据 商业表现数据 商业数据.md 必须有真实数据,必须标注drama_id+五维定位+变现模式专属指标 平台公开数据+行业报告+采购数据

5.2 入库流程规范

入库流程(10步):

① 来源采集 → 从指定渠道获取原始素材
② 初筛质检 → 检查数据完整性、五维标签可填性
③ 五维定位 → 确定 region + gender + genre + style + monetization
④ 创作维度定位 → 确定 dimension(01-12)或商业数据类型
⑤ 核心设定标注 → 标注 universe + identity + golden_finger
⑥ 风格标注 → 标注 tone + element + chunk_type + vector_desc
⑦ 商业数据标注(如适用) → 标注 drama_id + launch_date + 变现模式专属指标
⑧ 结构化处理 → 按分块模板整理,填写必填标签
⑨ 商业-创作关联(如适用) → 关联drama_id到对应创作维度知识分块
⑩ 分区归类与审核 → 按五维+维度归入对应目录,管理员确认无跨维度混用后入库

5.3 切片策略

核心原则:保留完整叙事结构,拒绝字符级切碎

知识类型 切片策略 理由
爆款案例复盘 按三幕结构完整切片,每幕一个 chunk 三幕是最小完整叙事单元
创作方法论 按方法论步骤完整切片 步骤间有逻辑递进
结构模板 整体为一个 chunk 模板是完整框架
评估 Rubric 按维度切片 可按维度召回
失败/反常识案例 整体为一个 chunk 完整性是核心价值
商业表现数据 整部剧为一个 chunk(剧级实体) 商业数据不可拆分,必须整剧关联

六、检索与路由策略

6.1 核心原则:五维定位先行 + 维度过滤 + 标签精准 + 向量召回 + 商业数据校验

规则:检索前必须先确定地域×性别×题材×流派×变现模式五维定位,再按创作维度过滤,再按核心设定标签精准定位,最后做向量语义匹配。商业验证时必须用同五维定位的真实市场数据校验。

6.2 检索流水线 — 筛选 → 向量召回 → Rerank重排

核心说明:分类、标签、时间、商业数据筛选是前置过滤,缩小候选范围;Rerank 仅对向量召回的结果做语义相关性重排,与分类/标签/时间/商业数据筛选无关。

筛选阶段 — 缩小候选范围(非Rerank职责)

① 五维定位识别 → region+gender+genre+style+monetization
② 维度路由 → 按dimension(01-12)路由到对应创作维度目录
③ 分区路由 → 按五维标签路由到对应知识库分区
④ 核心设定+标签过滤 → 按 identity/golden_finger/universe/tone/element 过滤
⑤ 商业数据筛选 → 按变现模式+指标值区间过滤,缩小到有商业数据支撑的候选集

向量召回阶段 — 语义匹配

⑥ 向量匹配召回 → vector_desc embedding 语义相似度匹配,在筛选后的候选集内召回

Rerank阶段 — 仅重排向量召回结果

⑦ Rerank向量召回重排 → 仅对⑥向量召回的结果做语义相关性重排,与分类/标签/时间/商业数据筛选无关

⑥ 商业数据检索级详解

检索子类型 输入 检索方式 输出
同类型商业表现对比 五维定位 过滤同五维剧 → 按指定指标排序 同类型剧的商业数据列表
指标区间筛选 变现模式+指标名+区间 指标值范围过滤 符合条件的剧列表
创作-商业归因 五维定位+创作维度 关联drama_id → 读取商业数据 → 归因分析 创作维度→商业指标贡献度映射
评估权重校验 五维定位+评估维度 统计同类型爆款剧数据 → 相关性分析 评估维度权重是否与实际商业结果正相关
ROI选题推荐 变现模式+题材 按ROI排序 → 高ROI题材方向 选题推荐+数据支撑

⑦ Rerank向量召回重排(仅作用于向量召回结果)

Rerank 仅对向量召回的候选结果做语义相关性重排序,分类/标签/时间/商业数据筛选已在前置步骤完成,不参与 Rerank 排序。

排序因子 权重 说明
语义相关性 40% query与chunk的语义匹配程度(cross-encoder精排)
内容质量 25% 分块内容的结构完整度、信息密度、方法论清晰度
上下文连贯性 20% chunk与前后文、所属案例的关联完整度
结果多样性 15% 确保不同视角/案例/方法论都被召回,避免同质化

6.3 检索策略硬性约束

  1. 严禁跨维度粗暴套用
  2. 严禁跨流派粗暴套用
  3. 严禁跨变现模式套用
  4. 核心创意保护
  5. 失败案例必召回
  6. 反常识案例必召回
  7. 地域/性别优先匹配
  8. 核心设定标签优先匹配
  9. 时效性优先
  10. 向量匹配仅用于召回补充
  11. 商业验证必须用真实数据(不能用推测数据替代)
  12. 创作-商业归因必须标注confidence(相关度不等于因果性)

七、诊断评估与优化规范

7.1 分五维组合差异化评估 Rubric

通用评估维度(所有五维组合共享,40%)

维度 权重 说明
开场钩子吸引力 10% 前 3 分钟是否抓住目标受众
人物辨识度 10% 主角是否有清晰特征
情绪共鸣度 10% 目标受众是否能产生情感投射
拍摄可执行性 10% 场景/特效是否在预算内

地域差异维度(10%)

维度 国内权重 海外权重
文化适配度 5% 5%
平台规范符合度 5% 5%

性别差异维度(15%)

维度 男频权重 频权重
即时爽感反馈 12% 3%
情感共鸣深度 3% 12%

变现模式差异维度(15%)

维度 付费权重 免费权重 IAP 混合权重
付费卡点设计 10% 0% 5%
完播率设计 2% 12% 5%
悬念 withholding 3% 0% 2%
广告位自然度 0% 3% 3%

流派差异维度(20%)

流派 专属评估维度
逆袭打脸 打脸密度、即时反馈频率、情绪满足递进、对手升级梯度
时间循环 循环信息增量、失败动机合理性、悬念递进、循环疲劳规避、闭环逻辑
无限流 关卡难度梯度、闯关动机链、副本多样性、成长曲线
悬疑反转 伏笔密度、信息揭示节奏、反转逻辑自洽、悬念维持
情绪治愈 情感细腻度、氛围营造、共鸣深度、治愈感完成度
家庭现实 真实感、议题深度、关系复杂性、社会共鸣广度
重生流 前世铺垫合理性、重生动机、信息差利用、命运改写节奏
穿越流 穿越机制、文化冲突、现代知识碾压合理性
复仇流 受害铺垫、复仇升级、正义伸张、情绪宣泄
后悔流 错过合理性、追悔情绪、重逢设计、和解节奏
甜宠流 化学反应、甜蜜密度、冲突可接受度、治愈完成度

7.2 评估流水线设计

评估流水线(9步,评估与优化解耦 + 商业数据校验):

① 五维定位识别 → region+gender+genre+style+monetization
② 核心设定识别 → universe+identity+golden_finger+tone+element
③ 维度+分区路由检索 → 按dimension+五维定位+核心设定过滤
④ 加载差异化 Rubric → 通用+地域+性别+变现模式+流派专属
⑤ 商业数据校验 → 加载同五维定位爆款剧商业数据,统计验证评估维度权重合理性
⑥ 分项评估 → 逐维度打分 + 文本证据 + 商业数据对比
⑦ 核心创意锁定 → 确认不可删除/篡改的核心设定
⑧ 创意优化 → 在保留核心创意约束的前提下优化
⑨ 优化效果预估 → 基于同类型剧商业数据预估优化后的商业结果改善

关键工程约束

  1. 评估 Agent 与优化 Agent 必须拆分为两个独立 LLM 节点
  2. 优化 Agent 必须接收"核心创意约束"作为硬边界
  3. 严禁跨维度评估
  4. 严禁跨变现模式评估
  5. 每个维度评分必须附带文本证据
  6. 禁止使用抹平叙事特色的建议
  7. 商业数据校验必须标注 confidence(相关性≠因果性)
  8. 优化效果预估必须引用真实商业数据(不能用纯推测)

八、知识库更新与维护机制

8.1 更新频率与渠道

更新类型 频率 责任方
国内爆款案例入库 月度 内容运营
海外爆款案例入库 月度 内容运营
商业表现数据更新 月度 数据运营
新兴题材/流派收录 月度 内容运营
创作方法论更新 季度 方法论团队
评估 Rubric 校准 季度 评估校准团队
失败案例补充 月度 内容运营+评估
vector_desc 语义描述更新 季度 方法论团队
评估权重商业校验 季度 数据+评估团队
五维体系评估 半年度 架构团队

8.2 知识库质量巡检

巡检维度 频率 标准
五维均衡度 月度 每种地域×性别组合≥20 条,单题材占比≤30%
流派均衡度 月度 每种流派≥5 个案例,单流派占比≤40%
变现模式均衡度 月度 付费/免费/IAP 混合比例合理
创作维度覆盖度 月度 12 个维度每维度≥3 条/每性别频段
商业数据覆盖率 月度 每部爆款剧必须有完整商业数据分块
商业数据时效性 月度 近6个月上线剧的商业数据≥80%入库
vector_desc完整性 季度 100%分块有vector_desc字段
时效性 月度 近 2 年案例占比≥60%
标签完整性 季度 17 项必填标签 100%覆盖

九、分阶段建设计划

Phase 1:骨架搭建与国内核心分区填充(第 1-2 周)

任务 交付物 验收标准
建立五维+12维度目录结构 目录结构 五维分层目录 + 12创作维度目录全部创建
建立核心设定标签库 标签枚举表 identity/golden_finger/tone/element 全枚举
编写12维度分块示例规范 12个分块示例文件 每维度含分类+标签+向量描述+内容主体
建立商业表现数据目录结构 商业数据目录 地域/性别/变现模式三层目录
编写商业表现数据分块示例 商业数据分块示例文件 含分类+标签+商业数据+内容主体+归因映射
填充国内男频 M01 都市逆袭 + S01 逆袭 + 付费/免费 ≥5 案例 + 1 方法论 + 1 Rubric 17 项标签 100%覆盖
填充国内女频 F01 甜宠 + S05 治愈 + 付费/免费 ≥5 案例 + 1 方法论 + 1 Rubric 17 项标签 100%覆盖
填充海外女频 HF01 Urban Romance + HS07 甜宠 + 付费 ≥3 案例 + 1 方法论 海外标签 100%覆盖
填充国内爆款剧商业表现数据 ≥10部剧完整商业数据 9项商业必填字段100%覆盖
填充失败案例库 + 反常识案例库 ≥5 条 + ≥3 条 跨维度混用案例优先

Phase 2:国内深度 + 海外基础 + 检索优化 + 商业数据关联(第 3-4 周)

任务 交付物 验收标准
国内男频 M07 悬疑 + M04 玄幻填充 每题材≥5 案例 流派交叉标注
国内女频 F02 宫廷 + F04 婆媳填充 每题材≥5 案例 流派交叉标注
海外女频 HF02 Marriage + HS01 重生流填充 ≥5 案例 + 海外 Rubric 海外差异标注
海外男频 HM01 Action + HM01 英雄旅程基础填充 ≥3 案例 海外差异标注
12 创作维度全部覆盖基础内容 每维度≥3 条/每性别频段 男女频差异化
填充海外爆款剧商业表现数据 ≥5部剧完整商业数据 海外指标100%覆盖
创作维度-商业结果关联映射 ≥3组关联映射 每组含创作维度+商业指标+归因分析
实现混合检索 + Rerank + 向量匹配 检索策略代码 Top-5 召回准确率≥80%
实现评估与优化 Agent 解耦工作流 Dify 工作流配置 评估/优化独立节点
实现商业数据检索+排序+区间筛选 商业数据检索API 按变现模式+指标值区间过滤

Phase 3:规模化 + 自动化更新 + 商业数据校验(第 5-8 周)

任务 交付物 验收标准
国内知识库总量≥150 条 覆盖主要五维组合 男频女频各≥75 条
海外知识库总量≥50 条 海外基础规模 海外男频女频各≥25 条
国内商业数据≥50部剧 国内爆款+非爆款商业数据 9项商业必填字段100%覆盖
海外商业数据≥20部剧 海外爆款商业数据 海外指标100%覆盖
12维度每维度≥10条/每性别频段 12维度全覆盖 男女频差异化
月度自动采集流水线 采集脚本 国内每月≥8 条,海外每月≥3 条
月度商业数据自动更新流水线 数据采集脚本 国内每月≥5部剧数据更新
评估权重季度商业校验 校验报告 每个评估维度权重与商业结果的相关性分析
vector_desc 自动生成工具 embedding生成脚本 新入库知识自动生成vector_desc
知识库质量巡检自动化 巡检脚本 月度自动巡检报告

Phase 4:进阶增强 + 持续迭代 + 商业数据深度分析(第 9 周起)

任务 交付物 验收标准
海外知识库深度填充 海外总量≥100 条 每海外题材≥8 案例
商业数据深度归因分析工具 归因分析API 创作维度→商业结果的统计相关性+因果推断
知识库与创作系统深度集成 创作系统知识调用接口 创作每步可调用对应分区+维度知识+商业数据
叙事特征统计工具 前置统计 API 量化循环次数/冲突密度/付费卡点等
商业数据驱动的选题推荐引擎 选题推荐API 按ROI/付费转化率/完播率排序的选题方向推荐
五维体系半年度评估 评估报告 是否有新题材/流派需独立建分区
知识库开放 API API 文档 外部系统可按五维标签+维度+向量+商业数据查询

十、与创作/评估系统的集成方案

10.1 知识库在创作流程中的调用节点

创作步骤 dimension 调用知识库 五维定位要求 商业数据调用
选题阶段 01 01_爆款选题 必须确定地域+性别+变现模式 同题材ROI排序+爆款选题商业数据
背景设定 02 02_背景设定 必须确定地域+性别+题材+流派 同类型爆款剧背景设定-商业结果归因
框架阶段 03+04 03_故事框架 + 04_叙事节奏 必须确定地域+性别+流派+变现模式 付费剧→付费卡点-付费转化率归因
人设阶段 05 05_人物设定 必须确定地域+性别+流派+核心设定 同类型爆款剧人设-留存率归因
事件设计 06 06_关键事件 必须确定地域+性别+流派+变现模式 付费剧→关键事件-付费转化率归因
钩子开场 08 08_钩子与开场 必须确定地域+性别+题材+变现模式 同类型爆款剧钩子-观看人数归因
付费卡点设计 03+06 03_故事框架 + 06_关键事件 变现模式=付费/IAP 混合 付费卡点-7天付费量+付费转化率归因
大纲阶段 03+04+06+08+09 框架+节奏+事件+钩子+冲突 必须五维全确定 同类型爆款剧各维度-商业结果归因
脚本/台词阶段 07+09 07_台词对话 + 09_冲突反转 必须五维全确定 同类型爆款剧台词风格-互动率归因
评估阶段 11+12 11_诊断评估 + 12_失败反常识 必须五维全确定 + 核心设定标签 同五维定位爆款剧商业数据校验评估权重
优化阶段 多维度 同分区创作方法论 必须五维全确定 + 核心创意约束 优化效果预估引用真实商业数据

十一、风险与注意事项

11.1 核心风险

风险 影响 缓解措施
五维组合爆炸 目录过多,管理复杂 题材×流派×变现模式为交叉标签,目录按地域>性别>题材/流派组织
跨变现模式误用 付费标准评估免费剧本 变现模式标签强制绑定 Rubric
跨维度粗暴套用 男频标准评判女频剧本 检索路由规则 + Rubric 绑定
海外知识不足 海外分区知识密度过低 Phase 1 即搭建海外基础目录和样本
标签过细难以维护 identity/golden_finger 标签过多 先建立核心枚举,定期评审扩展
创意被暴力简化 优化建议删除核心设定 评估与优化 Agent 解耦 + 核心创意约束
向量匹配偏差 语义匹配召回不精准 向量匹配仅用于召回补充,不能作为唯一检索方式
维度扩展过多 12维度管理复杂 每维度独立目录,检索时按创作步骤路由
商业数据来源不稳定 平台数据不公开或口径不一致 多源采集(公开数据+行业报告+采购数据),标注数据来源和口径
商业数据时效性滞后 数据更新跟不上市场变化 月度更新机制,近6个月数据优先
归因分析混淆相关与因果 创作维度-商业结果的归因可能仅为相关而非因果 归因必须标注confidence,高confidence需要多剧统计验证
商业数据隐私合规 某些平台数据涉及商业机密 仅采集公开数据+行业报告数据,不采集非公开财务数据

11.2 十大规则(V5.0新增3条)

  1. 五维定位先行:检索前必须先确定地域×性别×题材×流派×变现模式
  2. 性别专属评估不得混用
  3. 严禁跨地域套用
  4. 严禁跨流派套用
  5. 严禁跨变现模式套用
  6. 核心创意保护:优化建议严禁删除/篡改剧本核心设定
  7. 评估与优化解耦:两个任务必须由独立 LLM 节点执行
  8. 失败+反常识必召回:每次评估必须包含反面参照
  9. 商业数据必须真实:商业表现数据必须来源于真实市场数据,严禁虚构推测
  10. 归因必须标注confidence:创作维度-商业结果归因分析必须标注相关性confidence,相关性≠因果性

附录 A:知识库目录结构(V5.0)

1_短剧创作知识库/
├── 产品规划/
│   └── 短剧创作知识库产品规划.md  ← 本文档
├── 知识库/
│   ├── 国内/
│   │   ├── 男频/
│   │   │   ├── 题材/ [M01-M11]
│   │   │   ├── 流派/ [S01-S08]
│   │   │   ├── 创作维度/ [01-12]
│   │   │   └── 商业表现数据/ ← V5.0新增
│   │   │       ├── 付费/
│   │   │       ├── 免费/
│   │   │       └── IAP混合/
│   │   ├── 女频/
│   │   │   ├── 题材/ [F01-F10]
│   │   │   ├── 流派/ [S01-S08(女频版)]
│   │   │   ├── 创作维度/ [01-12]
│   │   │   └── 商业表现数据/ ← V5.0新增
│   │   │       ├── 付费/
│   │   │       ├── 免费/
│   │   │       └── IAP混合/
│   │   └── 国内通用/
│   │       ├── 评估通用/
│   │       ├── 商业与广告/
│   │       ├── 失败案例_通用/
│   │       └── 商业表现数据_通用/ ← V5.0新增
│   ├── 海外/
│   │   ├── 男频/
│   │   │   ├── 题材/ [HM01-HM06]
│   │   │   ├── 流派/ [HM01-HM07]
│   │   │   ├── 创作维度/ [01-12]
│   │   │   └── 商业表现数据/ ← V5.0新增
│   │   │       ├── 付费/
│   │   │       ├── 免费/
│   │   │       └── IAP混合/
│   │   ├── 女频/
│   │   │   ├── 题材/ [HF01-HF09]
│   │   │   ├── 流派/ [HS01-HS08]
│   │   │   ├── 创作维度/ [01-12]
│   │   │   └── 商业表现数据/ ← V5.0新增
│   │   │       ├── 付费/
│   │   │       ├── 免费/
│   │   │       └── IAP混合/
│   │   └── 海外通用/
│   │       ├── 平台特征与受众差异/
│   │       ├── 文化适配与禁忌/
│   │       ├── 评估通用/
│   │       └── 商业表现数据_通用/ ← V5.0新增
│   └── 全局通用/
│       ├── 评估通用维度/
│       ├── 失败案例_跨维度/
│       ├── 反常识成功案例/
│       └── 商业表现数据_跨维度/ ← V5.0新增
├── 标签库/
│   ├── 世界观标签.md
│   ├── 身份标签.md
│   ├── 金手指标签.md
│   ├── 风格标签.md
│   ├── 元素标签.md
│   ├── 分块类型标签.md
│   └── 商业数据指标标签.md  ← V5.0新增
├── 分块示例/
│   ├── 01_爆款选题_分块示例.md
│   ├── 02_背景设定_分块示例.md
│   ├── ... [02-12维度同V4.0]
│   ├── 12_失败反常识_分块示例.md
│   └── 商业表现数据_分块示例.md  ← V5.0新增
└── 入库规范/
    ├── 元数据标签规范.md
    ├── 切片策略规范.md
    ├── 入库流程规范.md
    ├── 分块模板规范.md
    ├── 质量标准.md
    └── 商业数据入库规范.md  ← V5.0新增

附录 B:V4.0→V5.0 核心变化对照

变化项 V4.0 V5.0 原因
总体架构 5层(分类+标签+维度+元数据+检索) 6层(分类+标签+维度+商业数据+元数据+检索) 创作方法论需要市场数据校验,形成创作→评估→商业验证→反馈优化闭环
创作维度 12个 12个(不变) 维度体系稳定
商业表现数据层 无 新增第4层 用真实市场结果数据校验创作方法论和评估权重,形成闭环
chunk_type 6种 7种(新增商业表现数据) 商业数据作为独立入库类型
元数据标签 17必填+4选填 17必填+4选填+9商业必填字段 商业数据需要独立指标字段
检索流水线 6级 7级(新增商业数据检索级) 商业数据检索需要变现模式+指标值区间过滤
Rerank 4因子 5因子(新增商业数据权重20%) 爆款剧数据支撑的知识权重更高
评估流水线 7步 9步(新增商业数据校验+优化效果预估) 评估需要商业数据校验权重,优化需要效果预估
入库流程 8步 10步(新增商业数据标注+创作-商业关联) 商业数据需要独立标注和关联步骤
规则 8条 10条(新增商业数据必须真实+归因标注confidence) 商业数据真实性和归因严谨性需要规则保障
入库类型 6种 7种(新增商业表现数据) 商业数据作为独立入库类型
切片策略 6种 7种(新增商业数据:整部剧为一个chunk) 商业数据不可拆分,必须整剧关联
质量巡检 8维度 11维度(新增商业数据覆盖率+商业数据时效性+评估权重商业校验) 商业数据需要独立质量巡检
分阶段建设 4阶段 4阶段(每阶段增加商业数据相关任务) 商业数据建设需要与创作维度建设同步推进

下一步:基于 V5.0 规划启动 Phase 1,优先完成:

  1. 五维+12维度+商业数据目录结构重建
  2. 标签库枚举表建立 + 商业数据指标标签
  3. 12维度分块示例规范 + 商业数据分块示例
  4. 国内核心分区样本填充 + 国内爆款剧商业数据填充(≥10部)
  5. 商业数据-创作维度关联映射初步建立