短剧创作知识库 — 产品规划
版本:V5.0 | 日期:2026-07-29 | 状态:重构版(增加商业表现数据层 + 商业结果驱动的创作-评估闭环)
一、项目背景与核心问题
1.1 行业现状
短剧赛道在 2024-2026 年间经历了叙事范式、变现模式和目标受众的三重分化:
国内短剧市场:
- 传统线性逆袭打脸爽剧仍是男频主流,但占比持续下降
- 时间循环 / 无限复活 / 轮回解谜类非线性叙事成为新爆款范式
- 微悬疑反转、情绪治愈、轻恐怖等新兴题材快速崛起
- 变现模式:付费短剧(关键集付费墙)+ 免费短剧(广告变现 / 完播率驱动)并行
海外短剧市场(美国为主):
- ReelShort、DramaBox、ShortTV 等平台快速增长
- 女频 Billionaire Romance / Mafia Romance 是绝对主流
- 男频 Action Thriller / Crime Noir 起步较晚但增长迅速
- 变现模式:以 IAP(应用内购买)付费解锁为主,广告变现为辅
男频 vs 女频的核心差异:
- 男频核心情绪:逆袭征服、打脸爽感、力量掌控、兄弟义气
- 女频核心情绪:甜蜜恋爱、虐心共鸣、重生复仇、情感治愈
付费 vs 免费的核心差异:
- 付费模式:关键集卡点设计、付费转化率、悬念钩子是硬指标
- 免费模式:完播率、广告填充率、前 3 秒留存是硬指标
- 同一剧本在两种变现模式下,节奏、钩子密度、集尾设计完全不同
1.2 AI 创作/评估系统的核心痛点(源自实战反馈)
| 痛点 |
表现 |
根因 |
| 叙事视野单一 |
只认"线性打脸爽文",遇到循环/轮回类剧本全面否定 |
知识库样本严重失衡,高频爽文垄断 |
| 评估标尺僵硬 |
用一套通用评分标准评判所有题材,强行套用线性范式 |
缺少叙事类型元数据,无法分类差异化评估 |
| 变现逻辑误判 |
用免费短剧的完播率标准评估付费短剧,或反之 |
未按付费/免费区分评估标尺 |
| 优化建议粗暴 |
直接删除核心创意设定(如要求取消循环机制改为"杀穿地牢") |
评估与优化耦合,模型倾向简化复杂创意为熟悉范式 |
| 知识储备滞后 |
评估体感落后行业 1 年以上,缺少近 1-2 年新兴赛道案例 |
知识库更新停滞 |
| 检索策略固化 |
所有剧本使用同一套 Top-K 检索 |
缺少动态检索路由 |
| 缺乏地域区分 |
用国内创作方法论评判海外剧本,或反之 |
知识库未按地域分区 |
| 缺乏性别区分 |
用男频评估维度评判女频甜宠剧本 |
知识库未按性别分区 |
| 标签粒度不足 |
只有"题材"和"流派",缺少"世界观/核心设定/风格" |
检索无法精准定位到同类剧本 |
| 创作维度缺失 |
缺少选题/背景/故事框架/关键事件等创作核心维度 |
知识库内容维度不够细 |
| 缺乏商业结果校验 |
评估标准凭主观经验,无法用真实市场数据校验评估维度权重 |
知识库只有创作方法论,没有市场表现数据 |
| 创作-评估脱节 |
不清楚哪些创作技法实际产生了商业回报 |
缺少创作维度与商业结果的关联映射 |
1.3 知识库是根因中的根因
上述问题的底层根源指向 知识库的质量和结构。结论:知识库的上限,直接决定 AI 创作/评估系统的上限。而市场数据是校验知识库质量的上限标尺。
二、知识库定位与核心价值
2.1 定位
短剧创作知识库是 面向短剧全生命周期(选题→创作→评估→优化→商业验证)的结构化知识基础设施,按 地域×性别×题材×流派×变现模式 五维体系组织,并在每条知识上挂载 世界观、核心设定(身份/金手指)、风格 三层标签,按 12 个创作维度 组织内容,每个维度内容以 分块(Chunk) 形式入库,支持 分类检索 + 标签检索 + 向量匹配 三种检索模式,并通过 商业表现数据层 将创作维度知识与真实市场结果数据关联,形成 创作→评估→商业验证→反馈优化 的闭环体系。
2.2 核心价值主张
| 价值维度 |
具体交付 |
| 五维精准分类 |
地域×性别×题材×流派×变现模式,知识库每条知识五维定位 |
| 三层精细标签 |
世界观 / 核心设定(身份+金手指) / 风格(风格+元素),提升检索精度 |
| 12创作维度覆盖 |
爆款选题/背景设定/故事框架/叙事节奏/人物设定/关键事件/台词对话/钩子开场/冲突反转/情绪共鸣/诊断评估/失败反常识 |
| 商业表现数据层 |
每部剧关联上线时间、总播放量、7天付费量、观看人数等市场数据,用真实商业结果校验创作方法论 |
| 三检索模式 |
分类过滤 + 标签过滤 + 向量语义匹配,三种模式可组合、可降级 |
| 分块示例规范 |
每个创作维度有标准分块模板,含分类字段+标签字段+向量描述 |
| 范式多元化 |
国内≥8 种主流流派 + 海外≥6 种主流流派,每种流派≥5 个标杆案例 |
| 变现差异化 |
付费 / 免费 / IAP 混合三种模式配备独立评估权重 |
| 评估差异化 |
每种五维组合配备独立 Rubric 评分维度 |
| 创作指导性 |
每种组合配备创作方法论、结构模板、节奏范式、常见陷阱 |
| 商业结果校验 |
评估维度权重可由真实市场数据校准(如:付费剧的付费卡点设计权重是否与7天付费量相关) |
| 知识时效性 |
月度更新机制,知识库与行业最新趋势同步 |
| 反偏见校准 |
失败案例库 + 反常识成功案例库,打破模型认知锁定 |
2.3 与短视频创作知识库的关系
| 子项目 |
核心差异 |
共享层 |
| 短剧创作知识库 |
多集连续叙事、人物成长弧线、剧情伏笔/悬念管理、跨集钩子设计、付费卡点设计 |
选题策略、钩子开场、情绪共鸣、商业植入、商业表现数据结构 |
| 短视频创作知识库 |
单集独立完成、强开场 3 秒钩子、信息密度集中、快速情绪峰值 |
选题策略、钩子开场、情绪共鸣、商业植入、商业表现数据结构 |
三、知识库架构设计
3.1 总体架构:五维分类 + 三层标签 + 12创作维度 + 商业表现数据层 + 三检索模式
3.2 第1层:五大分类维度详解
① 地域维度
| 地域 |
核心平台 |
受众特征 |
创作惯例差异 |
| 国内 |
番茄短剧、抖音短剧、快手星芒、红果短剧、微信短剧 |
中文用户,对爽感/情绪共鸣要求极高 |
集数多(80-100 集),每集 1-2 分钟,节奏极快 |
| 海外(美国为主) |
ReelShort、DramaBox、ShortTV、GoodShort |
英语用户,对叙事完整性、角色化学反应要求更高 |
集数较少(60-80 集),每集 2-3 分钟,叙事弧线更完整 |
地域分区规则:国内创作方法论不得直接套用于海外剧本,反之亦然。
② 性别维度
| 性别频段 |
核心情绪驱动 |
叙事节奏偏好 |
典型钩子类型 |
| 男频 |
逆袭征服、打脸爽感、力量掌控、兄弟义气、智谋碾压 |
快节奏、高密度冲突、即时反馈、升级递进 |
身份反转钩子、武力碾压钩子、智谋揭穿钩子 |
| 女频 |
甜蜜恋爱、虐心共鸣、重生复仇、情感治愈、自我成长 |
情绪细腻、情感转折多、共鸣点密集、治愈/虐心交替 |
身份揭穿钩子、误会反转钩子、情感告白钩子、重生复仇钩子 |
性别分区规则:男频评估维度不得用于评判女频剧本,反之亦然。
③ 题材维度:世界观 + 题材类型
题材采用 "世界观 → 题材类型" 两层组织,解决同一世界观下多种题材、同一题材跨世界观的问题。
国内题材体系:
| 世界观 |
题材类型 |
题材编号 |
代表特征 |
| 现代都市 |
都市逆袭 |
M01 |
贫→富、弱→强、被看不起→震惊全场 |
| 现代都市 |
职场逆袭 |
M02 |
职场奋斗、能力证明、事业翻盘 |
| 现代都市 |
家庭伦理 |
M03 |
婆媳冲突、婚姻保卫、家庭逆袭 |
| 古代/架空 |
玄幻修真 |
M04 |
修仙/修真/玄幻体系升级 |
| 古代/架空 |
武侠江湖 |
M05 |
武功升级、江湖义气、门派争斗 |
| 古代/架空 |
历史权谋 |
M06 |
权谋智斗、势力角逐、帝王之路 |
| 悬疑犯罪 |
悬疑推理 |
M07 |
伏笔密布、信息不对称、反转冲击 |
| 悬疑犯罪 |
黑帮犯罪 |
M08 |
犯罪/黑帮/江湖道义 |
| 科幻未来 |
科幻未来 |
M09 |
科技碾压、时间穿越、外星入侵 |
| 游戏异界 |
无限流/闯关 |
M10 |
多副本闯关、无限复活、能力解锁 |
| 游戏异界 |
电竞热血 |
M11 |
技术碾压、团队配合、赛场翻盘 |
海外男频题材体系(美国为主):
| 世界观 |
题材类型 |
题材编号 |
代表特征 |
| Modern/Urban |
Action Thriller |
HM01 |
英雄崛起、武力碾压、正义伸张 |
| Crime/Noir |
Crime Noir |
HM02 |
黑帮崛起、道德抉择、权力争夺 |
| Sci-fi |
Sci-fi |
HM03 |
科技碾压、异世界探索、未来战争 |
| Supernatural |
Horror/Supernatural |
HM04 |
恐惧驱动、超自然力量、生存挑战 |
| Military |
Military/War |
HM05 |
热血激战、牺牲精神、英雄主义 |
| Superhero |
Superhero |
HM06 |
超能力觉醒、正义伸张、反派对决 |
海外女频题材体系(美国为主,参考图片重构):
| 世界观 |
题材类型 |
题材编号 |
代表特征 |
| Urban |
Romance |
HF01 |
都市恋爱、身份差异、化学反应 |
| Urban |
Marriage |
HF02 |
婚姻契约、先婚后爱、婚姻保卫 |
| Business |
Romance |
HF03 |
商业帝国、CEO 恋情、办公室权力 |
| Ancient |
Romance |
HF04 |
古代言情、宫廷权谋、身份秘密 |
| ABO |
Romance |
HF05 |
ABO 设定、信息素、宿命羁绊 |
| Magic World |
Fantasy |
HF06 |
魔法世界、异世界冒险、奇幻恋爱 |
| Sci-fi |
Sci-fi |
HF07 |
科幻未来、时间旅行、系统设定 |
| Urban |
Family Drama |
HF08 |
家庭矛盾、关系修复、情感治愈 |
| Urban |
Mystery/Suspense |
HF09 |
悬疑线索、真相揭示、恋爱线交织 |
④ 流派维度(叙事机制/风格流派)
流派 = "怎么讲故事"的叙事机制,区别于题材的"讲什么故事"。
国内流派体系:
| 流派编号 |
流派名称 |
核心机制 |
典型题材 |
| S01 |
逆袭打脸 |
主角从弱到强,持续打败对手,即时反馈 |
都市逆袭、玄幻修真、武侠江湖 |
| S02 |
时间循环/轮回解谜 |
反复复活/轮回,每轮信息增量,渐进解谜 |
悬疑推理、科幻未来、无限流 |
| S03 |
无限流/闯关升级 |
多副本闯关,难度递增,能力渐进 |
无限流、科幻未来 |
| S04 |
悬疑反转/闭环解谜 |
信息逐步揭示,伏笔密布,结尾反转 |
悬疑推理、黑帮犯罪、宫廷权谋 |
| S05 |
情绪治愈/轻恐怖 |
情绪共鸣为主,节奏偏慢,治愈或微反转 |
甜宠虐恋、闺蜜情感、校园青春 |
| S06 |
家庭现实/社会议题 |
真实接地气,社会议题嵌入 |
家庭伦理、职场逆袭、婆媳家庭 |
| S07 |
混合型/跨界 |
多流派混搭(如逆袭+循环、悬疑+治愈) |
跨题材适用 |
| S08 |
新兴流派 |
新出现的叙事流派,待定义待验证 |
待定 |
海外女频流派体系(参考图片):
| 流派编号 |
流派名称 |
核心机制 |
典型题材 |
| HS01 |
重生流 / Rebirth |
主角死后重生回到过去,改写命运 |
都市恋爱、复仇、婚姻 |
| HS02 |
穿越流 / Transmigration |
主角穿越到另一个世界/身体,用现代知识碾压 |
古代言情、奇幻、ABO |
| HS03 |
魂穿 / Body Swap |
灵魂进入他人身体,身份错位 |
豪门恩怨、婚姻、悬疑 |
| HS04 |
复仇流 / Revenge |
受害→积蓄力量→复仇翻盘 |
复仇剧、豪门恩怨、职场 |
| HS05 |
后悔流 / Regret/Second Chance |
错过后的重逢/追妻火葬场/追夫火葬场 |
甜宠虐恋、婚姻、豪门 |
| HS06 |
逆袭流 / Comeback |
从底层/被轻视到翻盘 |
职场、商业、校园 |
| HS07 |
甜宠流 / Sweet Romance |
甜蜜恋爱、治愈、无虐心 |
纯甜恋爱、校园、契约婚姻 |
| HS08 |
新兴流派 |
待定义 |
待定 |
海外男频流派体系:
| 流派编号 |
流派名称 |
核心机制 |
典型题材 |
| HM01 |
英雄旅程 / Hero Journey |
英雄从弱到强的线性旅程 |
Action Thriller、Superhero |
| HM02 |
系统流 / System |
获得系统,任务驱动升级 |
Sci-fi、无限流 |
| HM03 |
末日生存 / Survival |
末日/危机环境下生存崛起 |
Horror、Sci-fi、Military |
| HM04 |
黑帮崛起 / Crime Rise |
从底层崛起为权力掌控者 |
Crime Noir、Mafia |
| HM05 |
军事行动 / Military Ops |
军事任务、战略碾压、英雄主义 |
Military/War |
| HM06 |
超能力觉醒 / Superpower |
超能力觉醒、正义伸张 |
Superhero、Sci-fi |
| HM07 |
新兴流派 |
待定义 |
待定 |
⑤ 变现模式维度
| 变现模式 |
核心指标 |
节奏特征 |
钩子特征 |
评估权重差异 |
| 付费 / Paid |
付费转化率、ARPU、付费墙通过率、7天付费量 |
关键集(第 8-12 集)设置强付费卡点 |
每集结尾强悬念、关键信息 withholding |
付费转化权重 15% |
| 免费 / Free |
完播率、3 秒留存、广告填充率、总播放量、观看人数 |
节奏更快、每集独立爽点、广告位自然 |
开场 3 秒强钩子、每集情绪峰值 |
完播率权重 15% |
| IAP 混合 / Hybrid |
付费转化 + 广告变现综合 ROI |
免费集引流 + 关键集付费 + 长尾广告 |
兼顾引流钩子与付费卡点 |
综合权重,按平台策略调整 |
变现模式规则:
- 付费短剧不能用免费短剧的完播率标准评估
- 免费短剧不能用付费短剧的付费转化标准评估
- 同一剧本改编为不同变现模式时,节奏和钩子设计必须重新调整
3.3 第2层:核心设定与风格标签
参考图片中的"核心设定"和"风格"列,每条知识必须挂载以下标签层。
世界观标签(universe)
| 标签值 |
说明 |
适用地域 |
| 都市 / Urban |
现代都市背景 |
国内/海外 |
| 古代 / Ancient |
古代/架空历史 |
国内/海外 |
| 玄幻 / Fantasy |
修仙/魔法/异世界 |
国内/海外 |
| 科幻 / Sci-fi |
未来/科技/外星 |
国内/海外 |
| 悬疑犯罪 / Crime |
犯罪/黑帮/ noir |
国内/海外 |
| 商业 / Business |
商业帝国/职场高层 |
海外为主 |
| 娱乐 / Entertainment |
娱乐圈/明星 |
海外为主 |
| ABO |
ABO 世界观 |
海外女频 |
| 魔法世界 / Magic World |
魔法学院/奇幻大陆 |
海外女频 |
身份标签(identity)
| 标签值 |
典型场景 |
主要性别频段 |
| 萌宝 / Cute Child |
天才萌宝助攻父母恋情 |
女频 |
| CEO/执行长 / CEO |
霸总、商业帝国掌权者 |
女频/男频 |
| 企业家 / Entrepreneur |
创业逆袭、商业斗争 |
男频/女频 |
| 女总裁 / Female President |
强人、职场逆袭 |
女频 |
| 名人 / Celebrity |
明星、网红、公众人物 |
频/男频 |
| 替身 / Substitute |
替身文学、身份错位 |
女频 |
| 替罪新娘 / Scapegoat Bride |
替嫁、替罪、身份替换 |
女频 |
| 代理新娘 / Surrogate Bride |
代孕/代理新娘设定 |
海外女频 |
| 假女继承人 / Fake Heiress |
真假千金、身份冒充 |
女频 |
| 废柴 / Underdog |
底层逆袭、被轻视者 |
男频 |
| 特种兵 / Special Forces |
军事/动作背景 |
男频 |
| 医生 / Doctor |
天才医术、神医 |
男频/女频 |
金手指标签(golden_finger)
| 标签值 |
核心机制 |
典型流派 |
| 超能力 / Superpower |
主角拥有特殊能力 |
英雄旅程、超能力觉醒 |
| 时间旅行 / Time Travel |
穿越/重生/时间循环 |
重生流、穿越流、循环流 |
| 系统 / System |
系统任务、奖励、升级 |
系统流、无限流 |
| 天才医术 / Medical Genius |
医术通天、救人/打脸 |
逆袭打脸、重生流 |
| 传承觉醒 / Inheritance |
获得前辈传承、觉醒血脉 |
玄幻修真、奇幻 |
| 巨大财富 / Huge Wealth |
继承/获得巨额财富 |
逆袭打脸、霸总文 |
| 巨大权势 / Huge Power |
获得权势/地位 |
逆袭打脸、黑帮崛起 |
| 信息差 / Information Gap |
重生/穿越带来的先知优势 |
重生流、穿越流 |
| 神级技能 / God Skill |
某项技能登峰造极 |
逆袭打脸、系统流 |
风格标签(tone)
| 标签值 |
情绪特征 |
主要性别频段 |
| 打脸爽剧 / Face-slapping |
即时爽感、碾压对手 |
男频/女频 |
| 甜宠 / Sweet |
甜蜜治愈、无虐心 |
频 |
| 虐恋 / Angst |
虐心、误会、追妻/追夫 |
女频 |
| 喜剧 / Comedy |
轻松搞笑、反差萌 |
全频段 |
| 女性成长 / Female Growth |
女主自我成长、独立 |
女频 |
| 自我成长 / Self Growth |
主角成长蜕变 |
全频段 |
| 暗黑 / Dark |
压抑、复仇、道德灰色 |
男频/女频 |
| 悬疑 / Suspenseful |
紧张、悬念、未知 |
全频段 |
风格元素标签(element)
| 标签值 |
情感内核 |
主要场景 |
| 爱恨交织 / Love-Hate |
爱与恨交织 |
甜宠虐恋、豪门恩怨 |
| 有毒的爱 / Toxic Love |
危险吸引力、不健康关系 |
Mafia Romance、暗黑 |
| 恨 / Hatred |
复仇驱动 |
复仇流 |
| 背叛 / Betrayal |
被背叛后的反击 |
���仇流、重生流 |
| 命中注定的爱人 / Fated Mate |
宿命感、ABO/灵魂伴侣 |
ABO、奇幻 |
| 相互的爱 / Mutual Love |
双向奔赴 |
甜宠 |
| 保护欲 / Protectiveness |
强者保护弱者 |
霸总、动作 |
| 身份错位 / Identity Swap |
身份误会/错位 |
魂穿、真假千金 |
3.4 第3层:12创作维度(内容分块组织)
| 编号 |
维度名称 |
核心内容 |
V3.0对应 |
| 01 |
爆款选题 |
选题方法论、热点趋势、选题评估维度、选题组合公式 |
新增 |
| 02 |
背景设定 |
世界观构建规则、时空设定、社会体系、势力格局、核心设定(身份/金手指)逻辑 |
新增 |
| 03 |
故事框架 |
三幕/五幕/多幕结构、场次划分、叙事弧线、付费卡点结构设计 |
原01_结构部分 |
| 04 |
叙事节奏 |
节奏范式、集间节奏、情绪节奏曲线、信息揭示节奏、爽点密度 |
原01_节奏部分 |
| 05 |
人物设定 |
人物成长弧线、人设卡片模板、人物关系图谱、人设差异化(男频/女频) |
原02_人物与人设 |
| 06 |
关键事件 |
事件设计方法论、转折点设计、伏笔-回收链、事件序列编排、关键集设计 |
新增 |
| 07 |
台词对话 |
爆款台词特征、对白节奏、台词风格库、台词差异化(男频/女频/地域) |
原03_台词与对白 |
| 08 |
钩子与开场 |
开场公式、跨集钩子设计、悬念前置、集尾钩子、付费卡点钩子 |
原04(保留) |
| 09 |
冲突与反转 |
冲突类型库、反转设计方法论、冲突升级路径、冲突差异化 |
原05(保留) |
| 10 |
情绪与共鸣 |
情绪曲线设计、共鸣点分布、情绪拐点、情绪差异化 |
原06(保留) |
| 11 |
诊断评估与优化 |
分五维组合的 Rubric 评分维度、评估流水线 |
原07(保留) |
| 12 |
失败案例与反常识 |
失败案例库、反常识成功案例、常见陷阱 |
原08(保留) |
3.5 第4层:商业表现数据层
V4.0→V5.0 关键变化:新增商业表现数据层,将每部剧的市场表现数据与创作维度知识关联,形成创作→评估→商业验证→反馈优化的闭环体系。
3.5.1 为什么需要独立的商业表现数据层?
| 理由 |
说明 |
| 创作方法论需要市场校验 |
当前评估维度权重凭主观经验设定,无法用真实数据校验 |
| 商业结果反哺创作 |
哪些创作技法实际产生了商业回报?哪些技法好评但无收益?需要数据关联才能回答 |
| 变现模式差异需要数据证明 |
付费/免费/IAP 的评估权重差异需要真实数据支撑 |
| 选题和优化需要数据驱动 |
"这个选题方向市场表现如何?"需要数据而非方法论回答 |
| 知识库质量需要量化评估 |
知识库提供的建议是否真的提升了商业结果?需要数据校验 |
3.5.2 商业表现数据结构
每部短剧在知识库中作为一个独立数据实体,关联以下商业表现指标:
通用指标(所有变现模式共享):
| 字段名 |
中文名 |
数据类型 |
说明 |
来源 |
drama_id |
剧本唯一标识 |
string |
知识库内唯一标识,用于关联创作维度知识 |
系统生成 |
drama_title |
剧名 |
string |
短剧正式名称 |
平台公开信息 |
launch_date |
上线时间 |
date (YYYY-MM-DD) |
短剧首次上线日期 |
平台公开信息 |
platform |
上线平台 |
string |
番茄短剧/ReelShort/DramaBox 等 |
平台公开信息 |
total_episodes |
总集数 |
int |
全剧集数 |
平台公开信息 |
total_views |
总播放量 |
long |
全剧累计播放次数 |
平台数据 |
viewer_count |
观看人数 |
long |
独立观看用户数 |
平台数据 |
7day_retention |
7日留存率 |
float (%) |
上线后7天仍在观看的用户占比 |
平台数据 |
engagement_rate |
互动率 |
float (%) |
评论+点赞+分享/播放量 |
平台数据 |
hot_rank |
热搜排名 |
int |
平台内热度排名峰值 |
平台数据 |
platform_rating |
平台评分 |
float |
平台用户评分(如有) |
平台数据 |
付费模式专属指标:
| 字段名 |
中文名 |
数据类型 |
说明 |
来源 |
7day_paid |
7天付费量 |
long (¥/$) |
上线后7天内总付费金额 |
平台财务数据 |
paid_conversion_rate |
付费转化率 |
float (%) |
触达付费墙后实际付费的用户比例 |
平台财务数据 |
arpu |
ARPU(人均付费) |
float (¥/$) |
平均每个付费用户的付费金额 |
平台财务数据 |
paid_wall_pass_rate |
付费墙通过率 |
float (%) |
到达付费墙集数的用户比例 |
平台数据 |
roi |
ROI |
float |
总收入/总制作成本 |
财务数据 |
免费模式专属指标:
| 字段名 |
中文名 |
数据类型 |
说明 |
来源 |
completion_rate |
完播率 |
float (%) |
观看至最后一集的用户比例 |
平台数据 |
3sec_retention |
3秒留存率 |
float (%) |
前3秒未离开的用户比例 |
平台数据 |
ad_fill_rate |
广告填充率 |
float (%) |
广告位实际展示广告的比例 |
平台数据 |
ad_revenue |
广告收入 |
long (¥/$) |
全剧累计广告收入 |
平台财务数据 |
IAP 混合模式专属指标:合并付费模式 + 免费模式核心指标,另增:
| 字段名 |
中文名 |
数据类型 |
说明 |
来源 |
total_revenue |
综合收入 |
long (¥/$) |
付费收入 + 广告收入 |
平台财务数据 |
revenue_ratio |
收入结构比例 |
string |
付费占比:广告占比(如"60:40") |
平台财务数据 |
hybrid_roi |
综合 ROI |
float |
综合收入/总制作成本 |
财务数据 |
3.5.3 商业表现数据分块结构
商业表现数据以 剧级实体 为最小入库单元(而非创作维度分块),每部剧对应一个完整数据分块:
3.5.4 商业表现数据分块示例
3.5.5 商业表现数据检索策略
| 检索场景 |
检索方式 |
示例 |
| 同类型剧的商业表现对比 |
五维定位过滤 → 商业数据排序 |
"国内女频重生复仇付费剧,按7天付费量排序" |
| 特定指标区间筛选 |
变现模式+指标值区间过滤 |
"付费转化率≥8%的国内女频付费剧" |
| 创作维度-商业结果关联 |
五维+维度 → 关联同类型剧的商业数据 |
"付费卡点设计对付费转化率的影响" |
| 商业数据校验评估权重 |
五维定位 → 同类型爆款剧数据 → 统计分析 |
"付费剧中付费卡点设计权重是否与实际ROI正相关" |
| ROI驱动的选题筛选 |
变现模式+题材 → 按ROI排序 → 高ROI选题方向 |
"国内付费模式ROI最高的3个题材" |
3.5.6 创作-评估-商业验证闭环
3.6 第5层:元数据标签规范
必填标签(17 项 — 创作维度相关)
| 标签字段 |
值域 |
说明 |
region |
国内/海外 |
地域分类 |
gender |
男频/女频 |
性别频段分类 |
genre |
题材编号 |
M01-M11 / HM01-HM06 / HF01-HF09 |
style |
流派编号 |
S01-S08 / HS01-HS08 / HM01-HM07 |
monetization |
付费/免费/IAP混合 |
变现模式 |
dimension |
01-12 |
创作维度编号 |
universe |
世界观标签 |
都市/古代/玄幻/科幻/ABO 等 |
identity |
身份标签 |
可多个,逗号分隔 |
golden_finger |
金手指标签 |
可多个,逗号分隔 |
tone |
风格标签 |
可多个,逗号分隔 |
element |
元素标签 |
可多个,逗号分隔 |
year |
2024/2025/2026 |
上线年份 |
platform |
平台名称 |
番茄/ReelShort/DramaBox 等 |
is_hit |
是/否 |
是否为爆款 |
core_hook |
自由文本(≤20 字) |
核心叙事梗/卖点 |
chunk_type |
方法论/案例复盘/模板/Rubric/失败案例/反常识案例/商业表现数据 |
分块内容类型 |
vector_desc |
自由文本(≤50 字) |
向量语义描述 |
商业数据必填字段(剧级实体专属)
| 字段 |
适用变现模式 |
说明 |
drama_id |
全部 |
剧本唯一标识,用于关联创作维度知识 |
launch_date |
全部 |
上线时间 |
total_views |
全部 |
总播放量 |
viewer_count |
全部 |
观看人数 |
7day_retention |
全部 |
7日留存率 |
7day_paid |
付费/IAP混合 |
7天付费量 |
paid_conversion_rate |
付费/IAP混合 |
付费转化率 |
completion_rate |
免费/IAP混合 |
完播率 |
roi |
全部 |
ROI |
选填标签(4 项 — 创作维度相关)
| 标签字段 |
值域 |
说明 |
data_performance |
播放量/完播率/付费率/互动率等 |
数据表现 |
source_type |
爆款复盘/方法论/论文/报告/编剧经验 |
来源类型 |
tag_version |
v1/v2/v3... |
标签版本号 |
failure_type |
暴力简化/跨维度套用/创意删除/结构崩塌/评估误判/其他 |
仅失败案例使用 |
标签使用规则
- 创作维度知识入库必须完成 17 项必填标签,缺标签拒绝入库
- 商业表现数据入库必须完成 drama_id + 9 项商业必填字段,缺字段拒绝入库
- 五维定位标签是检索第一优先过滤条件
- 创作维度标签(dimension)是第二优先过滤条件
- 核心设定标签(identity/golden_finger)是第三优先过滤条件
- 风格标签(tone/element)用于 Rerank 和内容相似度加权
- 向量描述(vector_desc)用于语义检索的 embedding 匹配
- 商业数据字段用于商业验证检索和创作-商业归因分析
- 检索时先按五维标签缩小范围,再按创作维度过滤,再按核心设定标签过滤,最后做向量语义匹配
- 商业验证时先按五维定位+变现模式过滤,再按商业数据指标排序/区间筛选,再关联创作维度知识做归因
四、创作维度分块示例规范
4.1 分块(Chunk)总体规范
每个创作维度的知识内容以 分块(Chunk) 为最小入库单元。每个分块必须包含三种检索模式所需的结构化字段:
三种检索模式的关系:
| 模式 |
检索方式 |
适用场景 |
精度 |
速度 |
| 分类检索 |
五维+维度 → 分区目录过滤 |
已知明确的分类定位 |
最高 |
最快 |
| 标签检索 |
核心设定+风格 → 标签字段匹配 |
已知核心设定/风格但分类模糊 |
高 |
快 |
| 向量匹配 |
语义描述 → embedding 相似度 |
创意描述模糊、需语义联想 |
中 |
中 |
组合检索策略:分类过滤(缩小范围)→ 标签过滤(精准定位)→ 向量匹配(语义召回)→ Rerank(综合排序)
4.2 每个创作维度的分块示例
(04_叙事节奏至12_失败反常识的分块示例与V4.0相同,此处保留01-03的更新版本——新增drama_id关联字段)
01_爆款选题 — 分块示例(V5.0更新:增加商业数据关联)
02-12维度分块示例
(02_背景设定至12_失败反常识的分块示例结构与V4.0相同,此处省略重复内容,详见分块示例文件夹)
五、知识库内容规范
5.1 入库内容类型与质量标准
| 内容类型 |
chunk_type值 |
入库格式 |
质量标准 |
来源渠道 |
| 爆款案例复盘 |
案例复盘 |
结构化.md |
必须有数据,必须标注五维标签 + 核心设定标签 + 风格标签 |
平台数据+编剧复盘 |
| 创作方法论 |
方法论 |
方法论.md |
≥2 实例,标注适用范围 |
论文+报告+编剧经验 |
| 结构模板 |
模板 |
模板.md |
≥1 成功案例验证 |
爆款拆解+编剧共创 |
| 评估 Rubric |
Rubric |
Rubric.md |
每维度明确高分/低分判据 |
成熟平台+专家制定 |
| 失败案例 |
失败案例 |
案例.md |
有数据支撑,标注 failure_type |
崩盘案例+编剧反思 |
| 反常识成功案例 |
反常识案例 |
案例.md |
解释"为什么不符合常识但成功了" |
非传统爆款 |
| 商业表现数据 |
商业表现数据 |
商业数据.md |
必须有真实数据,必须标注drama_id+五维定位+变现模式专属指标 |
平台公开数据+行业报告+采购数据 |
5.2 入库流程规范
5.3 切片策略
核心原则:保留完整叙事结构,拒绝字符级切碎
| 知识类型 |
切片策略 |
理由 |
| 爆款案例复盘 |
按三幕结构完整切片,每幕一个 chunk |
三幕是最小完整叙事单元 |
| 创作方法论 |
按方法论步骤完整切片 |
步骤间有逻辑递进 |
| 结构模板 |
整体为一个 chunk |
模板是完整框架 |
| 评估 Rubric |
按维度切片 |
可按维度召回 |
| 失败/反常识案例 |
整体为一个 chunk |
完整性是核心价值 |
| 商业表现数据 |
整部剧为一个 chunk(剧级实体) |
商业数据不可拆分,必须整剧关联 |
六、检索与路由策略
6.1 核心原则:五维定位先行 + 维度过滤 + 标签精准 + 向量召回 + 商业数据校验
规则:检索前必须先确定地域×性别×题材×流派×变现模式五维定位,再按创作维度过滤,再按核心设定标签精准定位,最后做向量语义匹配。商业验证时必须用同五维定位的真实市场数据校验。
6.2 检索流水线 — 筛选 → 向量召回 → Rerank重排
核心说明:分类、标签、时间、商业数据筛选是前置过滤,缩小候选范围;Rerank 仅对向量召回的结果做语义相关性重排,与分类/标签/时间/商业数据筛选无关。
筛选阶段 — 缩小候选范围(非Rerank职责)
向量召回阶段 — 语义匹配
Rerank阶段 — 仅重排向量召回结果
⑥ 商业数据检索级详解
| 检索子类型 |
输入 |
检索方式 |
输出 |
| 同类型商业表现对比 |
五维定位 |
过滤同五维剧 → 按指定指标排序 |
同类型剧的商业数据列表 |
| 指标区间筛选 |
变现模式+指标名+区间 |
指标值范围过滤 |
符合条件的剧列表 |
| 创作-商业归因 |
五维定位+创作维度 |
关联drama_id → 读取商业数据 → 归因分析 |
创作维度→商业指标贡献度映射 |
| 评估权重校验 |
五维定位+评估维度 |
统计同类型爆款剧数据 → 相关性分析 |
评估维度权重是否与实际商业结果正相关 |
| ROI选题推荐 |
变现模式+题材 |
按ROI排序 → 高ROI题材方向 |
选题推荐+数据支撑 |
⑦ Rerank向量召回重排(仅作用于向量召回结果)
Rerank 仅对向量召回的候选结果做语义相关性重排序,分类/标签/时间/商业数据筛选已在前置步骤完成,不参与 Rerank 排序。
| 排序因子 |
权重 |
说明 |
| 语义相关性 |
40% |
query与chunk的语义匹配程度(cross-encoder精排) |
| 内容质量 |
25% |
分块内容的结构完整度、信息密度、方法论清晰度 |
| 上下文连贯性 |
20% |
chunk与前后文、所属案例的关联完整度 |
| 结果多样性 |
15% |
确保不同视角/案例/方法论都被召回,避免同质化 |
6.3 检索策略硬性约束
- 严禁跨维度粗暴套用
- 严禁跨流派粗暴套用
- 严禁跨变现模式套用
- 核心创意保护
- 失败案例必召回
- 反常识案例必召回
- 地域/性别优先匹配
- 核心设定标签优先匹配
- 时效性优先
- 向量匹配仅用于召回补充
- 商业验证必须用真实数据(不能用推测数据替代)
- 创作-商业归因必须标注confidence(相关度不等于因果性)
七、诊断评估与优化规范
7.1 分五维组合差异化评估 Rubric
通用评估维度(所有五维组合共享,40%)
| 维度 |
权重 |
说明 |
| 开场钩子吸引力 |
10% |
前 3 分钟是否抓住目标受众 |
| 人物辨识度 |
10% |
主角是否有清晰特征 |
| 情绪共鸣度 |
10% |
目标受众是否能产生情感投射 |
| 拍摄可执行性 |
10% |
场景/特效是否在预算内 |
地域差异维度(10%)
| 维度 |
国内权重 |
海外权重 |
| 文化适配度 |
5% |
5% |
| 平台规范符合度 |
5% |
5% |
性别差异维度(15%)
| 维度 |
男频权重 |
频权重 |
| 即时爽感反馈 |
12% |
3% |
| 情感共鸣深度 |
3% |
12% |
变现模式差异维度(15%)
| 维度 |
付费权重 |
免费权重 |
IAP 混合权重 |
| 付费卡点设计 |
10% |
0% |
5% |
| 完播率设计 |
2% |
12% |
5% |
| 悬念 withholding |
3% |
0% |
2% |
| 广告位自然度 |
0% |
3% |
3% |
流派差异维度(20%)
| 流派 |
专属评估维度 |
| 逆袭打脸 |
打脸密度、即时反馈频率、情绪满足递进、对手升级梯度 |
| 时间循环 |
循环信息增量、失败动机合理性、悬念递进、循环疲劳规避、闭环逻辑 |
| 无限流 |
关卡难度梯度、闯关动机链、副本多样性、成长曲线 |
| 悬疑反转 |
伏笔密度、信息揭示节奏、反转逻辑自洽、悬念维持 |
| 情绪治愈 |
情感细腻度、氛围营造、共鸣深度、治愈感完成度 |
| 家庭现实 |
真实感、议题深度、关系复杂性、社会共鸣广度 |
| 重生流 |
前世铺垫合理性、重生动机、信息差利用、命运改写节奏 |
| 穿越流 |
穿越机制、文化冲突、现代知识碾压合理性 |
| 复仇流 |
受害铺垫、复仇升级、正义伸张、情绪宣泄 |
| 后悔流 |
错过合理性、追悔情绪、重逢设计、和解节奏 |
| 甜宠流 |
化学反应、甜蜜密度、冲突可接受度、治愈完成度 |
7.2 评估流水线设计
关键工程约束
- 评估 Agent 与优化 Agent 必须拆分为两个独立 LLM 节点
- 优化 Agent 必须接收"核心创意约束"作为硬边界
- 严禁跨维度评估
- 严禁跨变现模式评估
- 每个维度评分必须附带文本证据
- 禁止使用抹平叙事特色的建议
- 商业数据校验必须标注 confidence(相关性≠因果性)
- 优化效果预估必须引用真实商业数据(不能用纯推测)
八、知识库更新与维护机制
8.1 更新频率与渠道
| 更新类型 |
频率 |
责任方 |
| 国内爆款案例入库 |
月度 |
内容运营 |
| 海外爆款案例入库 |
月度 |
内容运营 |
| 商业表现数据更新 |
月度 |
数据运营 |
| 新兴题材/流派收录 |
月度 |
内容运营 |
| 创作方法论更新 |
季度 |
方法论团队 |
| 评估 Rubric 校准 |
季度 |
评估校准团队 |
| 失败案例补充 |
月度 |
内容运营+评估 |
| vector_desc 语义描述更新 |
季度 |
方法论团队 |
| 评估权重商业校验 |
季度 |
数据+评估团队 |
| 五维体系评估 |
半年度 |
架构团队 |
8.2 知识库质量巡检
| 巡检维度 |
频率 |
标准 |
| 五维均衡度 |
月度 |
每种地域×性别组合≥20 条,单题材占比≤30% |
| 流派均衡度 |
月度 |
每种流派≥5 个案例,单流派占比≤40% |
| 变现模式均衡度 |
月度 |
付费/免费/IAP 混合比例合理 |
| 创作维度覆盖度 |
月度 |
12 个维度每维度≥3 条/每性别频段 |
| 商业数据覆盖率 |
月度 |
每部爆款剧必须有完整商业数据分块 |
| 商业数据时效性 |
月度 |
近6个月上线剧的商业数据≥80%入库 |
| vector_desc完整性 |
季度 |
100%分块有vector_desc字段 |
| 时效性 |
月度 |
近 2 年案例占比≥60% |
| 标签完整性 |
季度 |
17 项必填标签 100%覆盖 |
九、分阶段建设计划
Phase 1:骨架搭建与国内核心分区填充(第 1-2 周)
| 任务 |
交付物 |
验收标准 |
| 建立五维+12维度目录结构 |
目录结构 |
五维分层目录 + 12创作维度目录全部创建 |
| 建立核心设定标签库 |
标签枚举表 |
identity/golden_finger/tone/element 全枚举 |
| 编写12维度分块示例规范 |
12个分块示例文件 |
每维度含分类+标签+向量描述+内容主体 |
| 建立商业表现数据目录结构 |
商业数据目录 |
地域/性别/变现模式三层目录 |
| 编写商业表现数据分块示例 |
商业数据分块示例文件 |
含分类+标签+商业数据+内容主体+归因映射 |
| 填充国内男频 M01 都市逆袭 + S01 逆袭 + 付费/免费 |
≥5 案例 + 1 方法论 + 1 Rubric |
17 项标签 100%覆盖 |
| 填充国内女频 F01 甜宠 + S05 治愈 + 付费/免费 |
≥5 案例 + 1 方法论 + 1 Rubric |
17 项标签 100%覆盖 |
| 填充海外女频 HF01 Urban Romance + HS07 甜宠 + 付费 |
≥3 案例 + 1 方法论 |
海外标签 100%覆盖 |
| 填充国内爆款剧商业表现数据 |
≥10部剧完整商业数据 |
9项商业必填字段100%覆盖 |
| 填充失败案例库 + 反常识案例库 |
≥5 条 + ≥3 条 |
跨维度混用案例优先 |
Phase 2:国内深度 + 海外基础 + 检索优化 + 商业数据关联(第 3-4 周)
| 任务 |
交付物 |
验收标准 |
| 国内男频 M07 悬疑 + M04 玄幻填充 |
每题材≥5 案例 |
流派交叉标注 |
| 国内女频 F02 宫廷 + F04 婆媳填充 |
每题材≥5 案例 |
流派交叉标注 |
| 海外女频 HF02 Marriage + HS01 重生流填充 |
≥5 案例 + 海外 Rubric |
海外差异标注 |
| 海外男频 HM01 Action + HM01 英雄旅程基础填充 |
≥3 案例 |
海外差异标注 |
| 12 创作维度全部覆盖基础内容 |
每维度≥3 条/每性别频段 |
男女频差异化 |
| 填充海外爆款剧商业表现数据 |
≥5部剧完整商业数据 |
海外指标100%覆盖 |
| 创作维度-商业结果关联映射 |
≥3组关联映射 |
每组含创作维度+商业指标+归因分析 |
| 实现混合检索 + Rerank + 向量匹配 |
检索策略代码 |
Top-5 召回准确率≥80% |
| 实现评估与优化 Agent 解耦工作流 |
Dify 工作流配置 |
评估/优化独立节点 |
| 实现商业数据检索+排序+区间筛选 |
商业数据检索API |
按变现模式+指标值区间过滤 |
Phase 3:规模化 + 自动化更新 + 商业数据校验(第 5-8 周)
| 任务 |
交付物 |
验收标准 |
| 国内知识库总量≥150 条 |
覆盖主要五维组合 |
男频女频各≥75 条 |
| 海外知识库总量≥50 条 |
海外基础规模 |
海外男频女频各≥25 条 |
| 国内商业数据≥50部剧 |
国内爆款+非爆款商业数据 |
9项商业必填字段100%覆盖 |
| 海外商业数据≥20部剧 |
海外爆款商业数据 |
海外指标100%覆盖 |
| 12维度每维度≥10条/每性别频段 |
12维度全覆盖 |
男女频差异化 |
| 月度自动采集流水线 |
采集脚本 |
国内每月≥8 条,海外每月≥3 条 |
| 月度商业数据自动更新流水线 |
数据采集脚本 |
国内每月≥5部剧数据更新 |
| 评估权重季度商业校验 |
校验报告 |
每个评估维度权重与商业结果的相关性分析 |
| vector_desc 自动生成工具 |
embedding生成脚本 |
新入库知识自动生成vector_desc |
| 知识库质量巡检自动化 |
巡检脚本 |
月度自动巡检报告 |
Phase 4:进阶增强 + 持续迭代 + 商业数据深度分析(第 9 周起)
| 任务 |
交付物 |
验收标准 |
| 海外知识库深度填充 |
海外总量≥100 条 |
每海外题材≥8 案例 |
| 商业数据深度归因分析工具 |
归因分析API |
创作维度→商业结果的统计相关性+因果推断 |
| 知识库与创作系统深度集成 |
创作系统知识调用接口 |
创作每步可调用对应分区+维度知识+商业数据 |
| 叙事特征统计工具 |
前置统计 API |
量化循环次数/冲突密度/付费卡点等 |
| 商业数据驱动的选题推荐引擎 |
选题推荐API |
按ROI/付费转化率/完播率排序的选题方向推荐 |
| 五维体系半年度评估 |
评估报告 |
是否有新题材/流派需独立建分区 |
| 知识库开放 API |
API 文档 |
外部系统可按五维标签+维度+向量+商业数据查询 |
十、与创作/评估系统的集成方案
10.1 知识库在创作流程中的调用节点
| 创作步骤 |
dimension |
调用知识库 |
五维定位要求 |
商业数据调用 |
| 选题阶段 |
01 |
01_爆款选题 |
必须确定地域+性别+变现模式 |
同题材ROI排序+爆款选题商业数据 |
| 背景设定 |
02 |
02_背景设定 |
必须确定地域+性别+题材+流派 |
同类型爆款剧背景设定-商业结果归因 |
| 框架阶段 |
03+04 |
03_故事框架 + 04_叙事节奏 |
必须确定地域+性别+流派+变现模式 |
付费剧→付费卡点-付费转化率归因 |
| 人设阶段 |
05 |
05_人物设定 |
必须确定地域+性别+流派+核心设定 |
同类型爆款剧人设-留存率归因 |
| 事件设计 |
06 |
06_关键事件 |
必须确定地域+性别+流派+变现模式 |
付费剧→关键事件-付费转化率归因 |
| 钩子开场 |
08 |
08_钩子与开场 |
必须确定地域+性别+题材+变现模式 |
同类型爆款剧钩子-观看人数归因 |
| 付费卡点设计 |
03+06 |
03_故事框架 + 06_关键事件 |
变现模式=付费/IAP 混合 |
付费卡点-7天付费量+付费转化率归因 |
| 大纲阶段 |
03+04+06+08+09 |
框架+节奏+事件+钩子+冲突 |
必须五维全确定 |
同类型爆款剧各维度-商业结果归因 |
| 脚本/台词阶段 |
07+09 |
07_台词对话 + 09_冲突反转 |
必须五维全确定 |
同类型爆款剧台词风格-互动率归因 |
| 评估阶段 |
11+12 |
11_诊断评估 + 12_失败反常识 |
必须五维全确定 + 核心设定标签 |
同五维定位爆款剧商业数据校验评估权重 |
| 优化阶段 |
多维度 |
同分区创作方法论 |
必须五维全确定 + 核心创意约束 |
优化效果预估引用真实商业数据 |
十一、风险与注意事项
11.1 核心风险
| 风险 |
影响 |
缓解措施 |
| 五维组合爆炸 |
目录过多,管理复杂 |
题材×流派×变现模式为交叉标签,目录按地域>性别>题材/流派组织 |
| 跨变现模式误用 |
付费标准评估免费剧本 |
变现模式标签强制绑定 Rubric |
| 跨维度粗暴套用 |
男频标准评判女频剧本 |
检索路由规则 + Rubric 绑定 |
| 海外知识不足 |
海外分区知识密度过低 |
Phase 1 即搭建海外基础目录和样本 |
| 标签过细难以维护 |
identity/golden_finger 标签过多 |
先建立核心枚举,定期评审扩展 |
| 创意被暴力简化 |
优化建议删除核心设定 |
评估与优化 Agent 解耦 + 核心创意约束 |
| 向量匹配偏差 |
语义匹配召回不精准 |
向量匹配仅用于召回补充,不能作为唯一检索方式 |
| 维度扩展过多 |
12维度管理复杂 |
每维度独立目录,检索时按创作步骤路由 |
| 商业数据来源不稳定 |
平台数据不公开或口径不一致 |
多源采集(公开数据+行业报告+采购数据),标注数据来源和口径 |
| 商业数据时效性滞后 |
数据更新跟不上市场变化 |
月度更新机制,近6个月数据优先 |
| 归因分析混淆相关与因果 |
创作维度-商业结果的归因可能仅为相关而非因果 |
归因必须标注confidence,高confidence需要多剧统计验证 |
| 商业数据隐私合规 |
某些平台数据涉及商业机密 |
仅采集公开数据+行业报告数据,不采集非公开财务数据 |
11.2 十大规则(V5.0新增3条)
- 五维定位先行:检索前必须先确定地域×性别×题材×流派×变现模式
- 性别专属评估不得混用
- 严禁跨地域套用
- 严禁跨流派套用
- 严禁跨变现模式套用
- 核心创意保护:优化建议严禁删除/篡改剧本核心设定
- 评估与优化解耦:两个任务必须由独立 LLM 节点执行
- 失败+反常识必召回:每次评估必须包含反面参照
- 商业数据必须真实:商业表现数据必须来源于真实市场数据,严禁虚构推测
- 归因必须标注confidence:创作维度-商业结果归因分析必须标注相关性confidence,相关性≠因果性
附录 A:知识库目录结构(V5.0)
附录 B:V4.0→V5.0 核心变化对照
| 变化项 |
V4.0 |
V5.0 |
原因 |
| 总体架构 |
5层(分类+标签+维度+元数据+检索) |
6层(分类+标签+维度+商业数据+元数据+检索) |
创作方法论需要市场数据校验,形成创作→评估→商业验证→反馈优化闭环 |
| 创作维度 |
12个 |
12个(不变) |
维度体系稳定 |
| 商业表现数据层 |
无 |
新增第4层 |
用真实市场结果数据校验创作方法论和评估权重,形成闭环 |
| chunk_type |
6种 |
7种(新增商业表现数据) |
商业数据作为独立入库类型 |
| 元数据标签 |
17必填+4选填 |
17必填+4选填+9商业必填字段 |
商业数据需要独立指标字段 |
| 检索流水线 |
6级 |
7级(新增商业数据检索级) |
商业数据检索需要变现模式+指标值区间过滤 |
| Rerank |
4因子 |
5因子(新增商业数据权重20%) |
爆款剧数据支撑的知识权重更高 |
| 评估流水线 |
7步 |
9步(新增商业数据校验+优化效果预估) |
评估需要商业数据校验权重,优化需要效果预估 |
| 入库流程 |
8步 |
10步(新增商业数据标注+创作-商业关联) |
商业数据需要独立标注和关联步骤 |
| 规则 |
8条 |
10条(新增商业数据必须真实+归因标注confidence) |
商业数据真实性和归因严谨性需要规则保障 |
| 入库类型 |
6种 |
7种(新增商业表现数据) |
商业数据作为独立入库类型 |
| 切片策略 |
6种 |
7种(新增商业数据:整部剧为一个chunk) |
商业数据不可拆分,必须整剧关联 |
| 质量巡检 |
8维度 |
11维度(新增商业数据覆盖率+商业数据时效性+评估权重商业校验) |
商业数据需要独立质量巡检 |
| 分阶段建设 |
4阶段 |
4阶段(每阶段增加商业数据相关任务) |
商业数据建设需要与创作维度建设同步推进 |
下一步:基于 V5.0 规划启动 Phase 1,优先完成:
- 五维+12维度+商业数据目录结构重建
- 标签库枚举表建立 + 商业数据指标标签
- 12维度分块示例规范 + 商业数据分块示例
- 国内核心分区样本填充 + 国内爆款剧商业数据填充(≥10部)
- 商业数据-创作维度关联映射初步建立