18 KiB
产品架构:AI创作平台(ToC)
输出角色:产品架构师 | 版本:v1.0 | 日期:2026-07-14
一、系统概述
AI创作平台是面向个人创作者的短视频脚本创作工具。核心交互流程为:用户输入 → 分析整理 → 脚本生成(3版本) → 对话修改。系统借鉴短视频脚本创作项目的用户输入和分析整理层设计,但大幅简化——去掉 6 步后台创作链路,改为直接生成多版本脚本,并提供对话式修改能力。
核心差异(vs MCN 短视频脚本自动化项目):
- 目标用户:个人创作者(ToC)而非 MCN 编导(ToB)
- 创作流程:直接生成 3 版本脚本,而非 6 步后台链路
- 修改方式:对话式修改,而非重新生成
- 账号设定:不强制上传账号设定文档,AI 从输入中推理
- 广告植入:不内置广告 Brief 模块
1.1 系统四层架构
| 层级 | 名称 | 用户可见 | 核心职责 |
|---|---|---|---|
| 1 | 用户输入 | ✅ | 需求输入(简单模式/详细模式)+ 上传附件(文档/图片/抖音短视频地址) |
| 2 | 分析整理 | ✅ | 分析所有输入 → 解析到创作方法 → 完整性检查 → AI补充缺失 |
| 3 | 脚本生成 | ✅ | 一次性生成 3 个版本脚本 + 效果检测与1-2轮迭代优化 |
| 4 | 对话修改 | ✅ | 对话修改脚本 + 效果检测与1-2轮迭代优化 |
注:V1.0 创意生成仅覆盖层1-4。V1.1 创意分析的脚本诊断和短视频解析为独立入口,不纳入四层架构。
1.2 核心交互流程
┌──────────────┐ ┌──────────────┐ ┌──────────────┐ ┌──────────────┐
│ 阶段1 │ │ 阶段2 │ │ 阶段3 │ │ 阶段4 │
│ 用户输入 │───→│ 分析整理 │───→│ 脑本生成 │───→│ 对话修改 │
│ [用户可见] │ │ [用户可见] │ │ [用户可见] │ │ [用户可见] │
│ │ │ │ │ │ │ │
│ 填写需求 │ │ 查看解析结果 │ │ 3版本脚本 │ │ 局部修改 │
│ 上传附件 │ │ 补充缺失信息 │ │ 效果检测迭代 │ │ 效果检测迭代 │
│ 粘贴抖音链接 │ │ 补充缺失信息 │ │ 效果检测迭代 │ │ 效果检测迭代 │
└──────────────┘ └──────────────┘ └──────────────┘ └──────────────┘
二、用户输入定义(层1)
用户输入包含两个核心模块,UI 布局顺序为 ①需求输入 → ②上传附件。两个模块并列独立,用户可自由组合。
2.1 模块①:需求输入
简单模式:
| 属性 | 说明 |
|---|---|
| 输入方式 | 自由文本框,一句话或一段话 |
| 示例 | 「我想做一个职场干货视频,教大家怎么在面试里谈薪资,风格轻松一点,60秒」 |
| AI 处理 | 语义解析提取赛道/主题/风格/时长等,缺失信息在分析整理层补充 |
| 适用场景 | 灵感闪现、快速试方向 |
详细模式:
| 输入方式 | 说明 | 示例 |
|---|---|---|
| 手动填写 | 结构化字段逐项填写 | 赛道/主题/时长/风格等 |
| 粘贴抖音链接 | 一条抖音短视频地址 | 仅支持抖音平台 |
| 混合输入 | 手动填写 + 抖音链接 | 填基本信息 + 上传对标抖音视频 |
结构化字段定义:
| 字段类别 | 字段 | 必填 | 说明 |
|---|---|---|---|
| 基本信息 | 内容赛道 | 是 | 知识教学/剧情情感/美食生活/探店测评/Vlog记录/观点态度/视觉冲击等 |
| 基本信息 | 主题方向 | 是 | 本期视频的主题,如"面试技巧""好物推荐"等 |
| 基本信息 | 预计时长 | 是 | 视频时长(秒),默认60 |
| 基本信息 | 节奏 | 否 | 快节奏/中等节奏/慢节奏/先快后慢/先慢后快等,不填则AI自动匹配 |
| 风格偏好 | 内容风格 | 否 | 轻松幽默/严肃干货/温馨治愈/反转搞笑等 |
| 风格偏好 | 目标受众 | 否 | 主要面向的观众群体 |
| 风格偏好 | 框架偏好 | 否 | 三段式/PAS/SCQA/认知反差等,不填则AI自动匹配 |
2.2 模块②:上传附件(可选)
| 输入方式 | 说明 | 支持格式 |
|---|---|---|
| 上传文档 | 上传参考文档(账号设定/故事选题/对标脚本等) | .doc / .docx / .pdf / .ppt / .pptx / .xls / .xlsx / .txt |
| 上传图片 | 上传视觉参考图 | .jpg / .png / .webp |
| 粘贴抖音短视频地址 | 粘贴一条抖音短视频地址 | 仅支持抖音平台 |
说明:附件类型和数量受限,每种类型有上传数量上限。AI 在分析整理层统一解析所有输入。
三、分析整理定义(层2)
分析整理是用户输入与脚本生成之间的核心枢纽,承担三个功能:分析所有输入、解析到创作方法 和 AI补充缺失信息。
3.1 功能一:分析所有输入,解析到创作方法
根据用户输入的内容,进行以下处理:
| 输入类型 | 处理方式 | 整理产出 |
|---|---|---|
| 一段话描述(简单模式) | 语义解析,提取关键信息 | 账号设定/选题/框架/台词风格的初步草案 |
| 结构化字段(详细模式) | 字段映射与校验 | 标准格式的创作参数 |
| 上传文档 | 文件解析,提取关键信息 | 账号设定/故事选题/对标参考等结构化信息 |
| 上传图片 | 视觉风格提取 | 视觉参考、场景氛围标签 |
| 抖音短视频地址 | 视频内容解析 | 框架/爆点/台词风格/节奏参考 |
分析完成后,将所有输入信息解析到创作方法,以 五类信息卡片 结构化展示:
| 卡片 | 内容字段 | 来源 |
|---|---|---|
| 账号设定 | 身份人设/内容定位/性格人设/说话语态/视觉符号/差异化标签 | 文档解析 / 语义提取 / 详细模式字段 |
| 选题方向 | 选题方向/选题类别/对标参考 | 语义提取 / 详细模式字段 / 视频解析 |
| 内容框架 | 框架类型/预计时长/赛道类别 | 详细模式字段 / AI自动匹配 / 视频解析 |
| 台词风格 | 语态偏好/语速偏好/口头禅/情绪表达 | 语义提取 / 文档解析 / AI推理 |
| 附加素材 | 图片参考/文档参考/视频参考标签 | 附件直接映射 |
与 MCN 项目差异:附加素材卡片为新增(ToC 用户上传更多样),账号设定不强制要求文档上传(AI 从输入推理),无广告 Brief 卡片。
3.2 功能二:AI补充缺失信息
整理完成后,检查五类信息是否齐全。信息不完整时:
- AI 识别缺失维度,提示具体缺失项
- AI 基于已有信息和赛道常识,为每个缺失维度生成 2-3 个候选版本
- 每个版本附带生成理由
- 用户选择最合适的候选,或要求 AI 重新生成
- 信息齐全后自动触发脚本生成
重要界定:本层只判断信息全不全,不评判对不对。
四、脚本生成定义(层3)
信息齐全后,AI 一次性生成 3 个版本脚本:
4.1 三版本策略
| 版本 | 定位 | 说明 |
|---|---|---|
| 标准版 | 稳妥安全 | 基于 AI 最优判断生成的主推版本,严格匹配输入信息和赛道框架 |
| 版本2 | AI判断探索方向 | AI 根据用户输入判断最值得探索的方向,调整一个关键变量(如换钩子策略/换叙事视角/换情绪路线等) |
| 版本3 | AI判断探索方向 | AI 根据用户输入判断第二个值得探索的方向,尝试不同风格方向(如标准版偏干货→此版本偏剧情/标准版偏严肃→此版本偏幽默等) |
说明:版本2和版本3的探索方向由AI根据用户输入内容(赛道、主题、风格偏好、节奏等)综合判断,而非固定为"创意突破"和"风格探索"。不同输入组合下,两个版本的探索方向可能完全不同。
4.2 脚本输出格式
脚本采用 基于故事和事件的段落式结构,而非逐帧拍摄脚本:
| 字段 | 说明 |
|---|---|
| 段落编号 | 从1开始递增 |
| 段落标题 | 该段落的事件/场景名称 |
| 时长 | 该段落持续时间(秒) |
| 事件描述 | 段落内的故事事件、场景、角色动作 |
| 台词 | 口播文案(口语化) |
| 备注 | 拍摄注意事项/情绪提示 |
重要界定:脚本不含镜头编号和景别,以故事段落为单位组织内容,编导可自行决定拍摄方式。
4.3 生成界面展示
3 个版本以 Tab 切换 或 并排对比 方式展示:
- Tab 切换模式:默认显示标准版,用户可切换查看版本2/版本3
- 并排对比模式:3 个版本缩略版并排展示,点击展开查看完整脚本
- 用户可 选择一个版本进入对话修改
4.4 效果检测与迭代
脚本生成后,AI 自动进行效果检测,发现问题或可优化点时进行迭代优化:
| 步骤 | 说明 |
|---|---|
| 效果检测 | 检测内容生成效果(逻辑连贯性、口语化程度、节奏合理性等) |
| 复盘 | 发现潜在问题或可优化点 |
| 迭代优化 | 针对问题进行1-2轮迭代优化,每轮优化后再次检测 |
说明:此步骤为AI内部自动执行,用户无需操作。迭代优化在原始生成基础上调整,不改变脚本的基本框架和方向。
五、对话修改定义(层4)
脚本生成后,用户可通过继续对话来完善脚本。对话修改采用 Chat 交互模式。
5.1 修改能力范围
| 修改类型 | 说明 | 示例 |
|---|---|---|
| 局部修改 | 修改某一段台词/事件描述/时长 | "把第3段落的台词改得更口语化" |
| 风格调整 | 整体调整脚本风格/语态 | "整体风格改得更轻松幽默" |
| 内容增删 | 增加或删除某个段落/事件 | "在开头加一个悬念段落" "删掉第5段落" |
| 结构调整 | 调整脚本整体框架/节奏 | "换成PAS框架重新组织" |
| 广告植入 | 在脚本中自然植入产品信息 | "在第4段落加入XX产品的口播推荐" |
| 重新生成 | 基于当前对话上下文重新生成 | "完全重来,换一个选题方向" |
5.2 对话界面结构
┌─────────────────────────────────────────────────────┐
│ 顶部:当前脚本版本标识 + [切换版本] 按钮 │
├─────────────────────────────────────────────────────┤
│ │
│ ┌─────────────────────────┐ ┌─────────────────┐ │
│ │ 脚本预览区 │ │ 对话区 │ │
│ │ 段落式脚本实时展示 │ │ 用户消息 │ │
│ │ 修改后高亮标注 │ │ AI回复+修改说明 │ │
│ │ [下载] │ │ │ │
│ └─────────────────────────┘ │ ┌─────────────┐ │ │
│ │ │ 输入框 │ │ │
│ │ └─────────────┘ │ │
│ └─────────────────┘ │
│ │
├─────────────────────────────────────────────────────┤
│ 底部:[结束修改] [重新生成] │
└─────────────────────────────────────────────────────┘
5.3 修改交互逻辑
- 用户输入修改指令 → AI 根据意图调整创作方法 → 修改具体内容 → 展示修改结果
- 脚本预览区实时更新,修改部分 高亮标注(黄色底色 + 修改前后对比提示)
- AI 回复包含:修改说明 + 修改理由
- 支持多轮对话修改,每轮修改累积记录
- 用户可随时点击「撤销最近修改」回退到上一版本
- 修改过程中可切换查看其他版本脚本
5.4 效果检测与迭代
每轮对话修改后,AI 自动进行效果检测:
| 步骤 | 说明 |
|---|---|
| 效果检测 | 检测修改效果(修改意图是否达成、整体逻辑是否连贯等) |
| 复盘 | 发现潜在问题或可优化点 |
| 迭代优化 | 针对问题进行1-2轮迭代优化,每轮优化后再次检测 |
说明:此步骤为AI内部自动执行,用户无需操作。迭代优化不改变用户指定的修改方向,仅在此基础上微调优化。
六、状态机模型
┌──────────┐
│ IDLE │ ← 等待用户输入
└────┬─────┘
│ 用户输入需求
▼
┌──────────────────┐
│ INPUT │ ← 用户输入(可见)
│ 需求输入 │ 简单/详细模式
│ 上传附件 │ 文档/图片/抖音链接
└────────┬─────────┘
│ 用户提交
▼
┌──────────────────┐
│ ANALYSIS │ ← 分析整理(可见)
│ ①分析所有输入 │ 解析到创作方法
│ ②AI补充缺失信息 │ 候选选择/编辑
│ ③信息齐全→生成 │ 自动触发脚本生成
└────────┬─────────┘
│ 信息齐全自动触发
▼
┌──────────────────┐
│ GENERATING │ ← 脚本生成(可见,3版本)
│ 标准版+版本2+版本3 │ 一次性生成
│ 版本选择/对比 │ 用户选择一个版本
└────────┬─────────┘
│ 用户选择版本
▼
┌──────────────────┐
│ EDITING │ ← 对话修改(可见)
│ Chat交互修改 │ 局部/风格/结构
│ 实时脚本预览 │ 修改高亮标注
└────────┬─────────┘
用户满意 │ 用户不满意
结束修改 │ 重新生成
▼ ▼
┌──────────┐ ┌──────────────┐
│ DONE │ │ GENERATING │ ← 重新生成3版本
│ 交付完成 │ └──────────────┘
└──────────┘
异常处理:
- 生成失败 → 提示用户重试或修改输入
- 修改冲突(用户修改指令与脚本结构矛盾) → AI 提出替代方案
七、数据流定义
7.1 会话上下文对象
SessionContext {
input: { // 层1 产出
rawText: string, // 简单模式原始文本
structuredFields: { // 详细模式字段
track: string,
topic: string,
duration: number,
rhythm: string,
style: string,
audience: string,
framework: string
} | null,
attachments: Attachment[], // 上传附件列表
videoLinks: string[] // 抖音短视频地址列表
},
analysis: { // 层2 产出
persona: PersonaCard, // 账号设定卡片
topic: TopicCard, // 选题方向卡片
framework: FrameworkCard, // 内容框架卡片
style: StyleCard, // 台词风格卡片
materials: MaterialsCard, // 附加素材卡片
completeness: CompletenessReport // 完整性检查报告
},
scripts: { // 层3 产出
standard: Script, // 标准版脚本
version2: Script, // 版本2(AI判断探索方向)
version3: Script, // 版本3(AI判断探索方向)
selectedVersion: 'standard' | 'version2' | 'version3' // 用户选择版本
},
editHistory: EditRecord[], // 层4 修改记录
currentPhase: 'INPUT' | 'ANALYSIS' | 'GENERATING' | 'EDITING' | 'DONE'
}
八、V1.1 创意分析功能简要规划
8.1 脚本诊断(F3)
| 属性 | 说明 |
|---|---|
| 入口 | 独立入口,不纳入四层架构 |
| 输入 | 分析之前生成的脚本,也支持上传文档(.md/.txt/.doc/.docx/.pdf)分析文档中的脚本 |
| 处理 | AI 对脚本进行多维度诊断分析,发现问题并提供改进建议 |
| 输出 | 诊断内容 |
8.2 短视频解析(F4)
| 属性 | 说明 |
|---|---|
| 入口 | 独立入口,不纳入四层架构 |
| 输入 | 粘贴抖音短视频地址(仅支持抖音平台) |
| 处理 | AI 对短视频内容进行多维度解析分析 |
| 输出 | 提供解析内容 |
九、与短视频脚本自动化项目的对比
| 维度 | 短视频脚本自动化(ToB/MCN) | AI创作平台(ToC) |
|---|---|---|
| 目标用户 | MCN编导(专业) | 个人创作者(泛用户) |
| 创作流程 | 6步后台链路(用户不可见) | 直接生成3版本(用户可见) |
| 修改方式 | 重新生成(整条重跑) | 对话式修改(局部调整) |
| 账号设定 | 强制上传文档或详细填写 | 可选,AI从输入推理 |
| 广告植入 | 内置广告Brief模块 | 对话修改时可选植入 |
| 输出版本 | 单版本脚本 | 3版本对比选择 |
| 信息卡片 | 5类(含广告Brief) | 5类(含附加素材) |