369 lines
18 KiB
Markdown
369 lines
18 KiB
Markdown
# 产品架构:AI创作平台(ToC)
|
||
|
||
> 输出角色:产品架构师 | 版本:v1.0 | 日期:2026-07-14
|
||
|
||
---
|
||
|
||
## 一、系统概述
|
||
|
||
AI创作平台是面向个人创作者的短视频脚本创作工具。核心交互流程为:**用户输入 → 分析整理 → 脚本生成(3版本) → 对话修改**。系统借鉴短视频脚本创作项目的用户输入和分析整理层设计,但大幅简化——去掉 6 步后台创作链路,改为直接生成多版本脚本,并提供对话式修改能力。
|
||
|
||
> **核心差异(vs MCN 短视频脚本自动化项目)**:
|
||
> - 目标用户:个人创作者(ToC)而非 MCN 编导(ToB)
|
||
> - 创作流程:直接生成 3 版本脚本,而非 6 步后台链路
|
||
> - 修改方式:对话式修改,而非重新生成
|
||
> - 账号设定:不强制上传账号设定文档,AI 从输入中推理
|
||
> - 广告植入:不内置广告 Brief 模块
|
||
|
||
### 1.1 系统四层架构
|
||
|
||
| 层级 | 名称 | 用户可见 | 核心职责 |
|
||
|:---:|------|:---:|---------|
|
||
| 1 | **用户输入** | ✅ | 需求输入(简单模式/详细模式)+ 上传附件(文档/图片/抖音短视频地址) |
|
||
| 2 | **分析整理** | ✅ | 分析所有输入 → 解析到创作方法 → 完整性检查 → AI补充缺失 |
|
||
| 3 | **脚本生成** | ✅ | 一次性生成 3 个版本脚本 + 效果检测与1-2轮迭代优化 |
|
||
| 4 | **对话修改** | ✅ | 对话修改脚本 + 效果检测与1-2轮迭代优化 |
|
||
|
||
> 注:V1.0 创意生成仅覆盖层1-4。V1.1 创意分析的脚本诊断和短视频解析为独立入口,不纳入四层架构。
|
||
|
||
### 1.2 核心交互流程
|
||
|
||
```
|
||
┌──────────────┐ ┌──────────────┐ ┌──────────────┐ ┌──────────────┐
|
||
│ 阶段1 │ │ 阶段2 │ │ 阶段3 │ │ 阶段4 │
|
||
│ 用户输入 │───→│ 分析整理 │───→│ 脑本生成 │───→│ 对话修改 │
|
||
│ [用户可见] │ │ [用户可见] │ │ [用户可见] │ │ [用户可见] │
|
||
│ │ │ │ │ │ │ │
|
||
│ 填写需求 │ │ 查看解析结果 │ │ 3版本脚本 │ │ 局部修改 │
|
||
│ 上传附件 │ │ 补充缺失信息 │ │ 效果检测迭代 │ │ 效果检测迭代 │
|
||
│ 粘贴抖音链接 │ │ 补充缺失信息 │ │ 效果检测迭代 │ │ 效果检测迭代 │
|
||
└──────────────┘ └──────────────┘ └──────────────┘ └──────────────┘
|
||
```
|
||
|
||
---
|
||
|
||
## 二、用户输入定义(层1)
|
||
|
||
用户输入包含两个核心模块,UI 布局顺序为 **①需求输入 → ②上传附件**。两个模块并列独立,用户可自由组合。
|
||
|
||
### 2.1 模块①:需求输入
|
||
|
||
**简单模式**:
|
||
|
||
| 属性 | 说明 |
|
||
|------|------|
|
||
| 输入方式 | 自由文本框,一句话或一段话 |
|
||
| 示例 | 「我想做一个职场干货视频,教大家怎么在面试里谈薪资,风格轻松一点,60秒」 |
|
||
| AI 处理 | 语义解析提取赛道/主题/风格/时长等,缺失信息在分析整理层补充 |
|
||
| 适用场景 | 灵感闪现、快速试方向 |
|
||
|
||
**详细模式**:
|
||
|
||
| 输入方式 | 说明 | 示例 |
|
||
|---------|------|------|
|
||
| 手动填写 | 结构化字段逐项填写 | 赛道/主题/时长/风格等 |
|
||
| 粘贴抖音链接 | 一条抖音短视频地址 | 仅支持抖音平台 |
|
||
| 混合输入 | 手动填写 + 抖音链接 | 填基本信息 + 上传对标抖音视频 |
|
||
|
||
**结构化字段定义:**
|
||
|
||
| 字段类别 | 字段 | 必填 | 说明 |
|
||
|---------|------|:---:|------|
|
||
| 基本信息 | 内容赛道 | 是 | 知识教学/剧情情感/美食生活/探店测评/Vlog记录/观点态度/视觉冲击等 |
|
||
| 基本信息 | 主题方向 | 是 | 本期视频的主题,如"面试技巧""好物推荐"等 |
|
||
| 基本信息 | 预计时长 | 是 | 视频时长(秒),默认60 |
|
||
| 基本信息 | 节奏 | 否 | 快节奏/中等节奏/慢节奏/先快后慢/先慢后快等,不填则AI自动匹配 |
|
||
| 风格偏好 | 内容风格 | 否 | 轻松幽默/严肃干货/温馨治愈/反转搞笑等 |
|
||
| 风格偏好 | 目标受众 | 否 | 主要面向的观众群体 |
|
||
| 风格偏好 | 框架偏好 | 否 | 三段式/PAS/SCQA/认知反差等,不填则AI自动匹配 |
|
||
|
||
### 2.2 模块②:上传附件(可选)
|
||
|
||
| 输入方式 | 说明 | 支持格式 |
|
||
|---------|------|---------|
|
||
| 上传文档 | 上传参考文档(账号设定/故事选题/对标脚本等) | `.doc` / `.docx` / `.pdf` / `.ppt` / `.pptx` / `.xls` / `.xlsx` / `.txt` |
|
||
| 上传图片 | 上传视觉参考图 | `.jpg` / `.png` / `.webp` |
|
||
| 粘贴抖音短视频地址 | 粘贴一条抖音短视频地址 | 仅支持抖音平台 |
|
||
|
||
> **说明**:附件类型和数量受限,每种类型有上传数量上限。AI 在分析整理层统一解析所有输入。
|
||
|
||
---
|
||
|
||
## 三、分析整理定义(层2)
|
||
|
||
分析整理是用户输入与脚本生成之间的核心枢纽,承担三个功能:**分析所有输入**、**解析到创作方法** 和 **AI补充缺失信息**。
|
||
|
||
### 3.1 功能一:分析所有输入,解析到创作方法
|
||
|
||
根据用户输入的内容,进行以下处理:
|
||
|
||
| 输入类型 | 处理方式 | 整理产出 |
|
||
|---------|---------|---------|
|
||
| 一段话描述(简单模式) | 语义解析,提取关键信息 | 账号设定/选题/框架/台词风格的初步草案 |
|
||
| 结构化字段(详细模式) | 字段映射与校验 | 标准格式的创作参数 |
|
||
| 上传文档 | 文件解析,提取关键信息 | 账号设定/故事选题/对标参考等结构化信息 |
|
||
| 上传图片 | 视觉风格提取 | 视觉参考、场景氛围标签 |
|
||
| 抖音短视频地址 | 视频内容解析 | 框架/爆点/台词风格/节奏参考 |
|
||
|
||
分析完成后,将所有输入信息解析到创作方法,以 **五类信息卡片** 结构化展示:
|
||
|
||
| 卡片 | 内容字段 | 来源 |
|
||
|------|---------|------|
|
||
| 账号设定 | 身份人设/内容定位/性格人设/说话语态/视觉符号/差异化标签 | 文档解析 / 语义提取 / 详细模式字段 |
|
||
| 选题方向 | 选题方向/选题类别/对标参考 | 语义提取 / 详细模式字段 / 视频解析 |
|
||
| 内容框架 | 框架类型/预计时长/赛道类别 | 详细模式字段 / AI自动匹配 / 视频解析 |
|
||
| 台词风格 | 语态偏好/语速偏好/口头禅/情绪表达 | 语义提取 / 文档解析 / AI推理 |
|
||
| 附加素材 | 图片参考/文档参考/视频参考标签 | 附件直接映射 |
|
||
|
||
> 与 MCN 项目差异:附加素材卡片为新增(ToC 用户上传更多样),账号设定不强制要求文档上传(AI 从输入推理),无广告 Brief 卡片。
|
||
|
||
### 3.2 功能二:AI补充缺失信息
|
||
|
||
整理完成后,检查五类信息是否齐全。信息不完整时:
|
||
|
||
1. AI 识别缺失维度,提示具体缺失项
|
||
2. AI 基于已有信息和赛道常识,为每个缺失维度生成 **2-3 个候选版本**
|
||
3. 每个版本附带生成理由
|
||
4. 用户选择最合适的候选,或要求 AI 重新生成
|
||
5. 信息齐全后自动触发脚本生成
|
||
|
||
> **重要界定**:本层只判断信息**全不全**,不评判**对不对**。
|
||
|
||
---
|
||
|
||
## 四、脚本生成定义(层3)
|
||
|
||
信息齐全后,AI **一次性生成 3 个版本脚本**:
|
||
|
||
### 4.1 三版本策略
|
||
|
||
| 版本 | 定位 | 说明 |
|
||
|:---:|------|------|
|
||
| 标准版 | 稳妥安全 | 基于 AI 最优判断生成的主推版本,严格匹配输入信息和赛道框架 |
|
||
| 版本2 | AI判断探索方向 | AI 根据用户输入判断最值得探索的方向,调整一个关键变量(如换钩子策略/换叙事视角/换情绪路线等) |
|
||
| 版本3 | AI判断探索方向 | AI 根据用户输入判断第二个值得探索的方向,尝试不同风格方向(如标准版偏干货→此版本偏剧情/标准版偏严肃→此版本偏幽默等) |
|
||
|
||
> **说明**:版本2和版本3的探索方向由AI根据用户输入内容(赛道、主题、风格偏好、节奏等)综合判断,而非固定为"创意突破"和"风格探索"。不同输入组合下,两个版本的探索方向可能完全不同。
|
||
|
||
### 4.2 脚本输出格式
|
||
|
||
脚本采用 **基于故事和事件的段落式结构**,而非逐帧拍摄脚本:
|
||
|
||
| 字段 | 说明 |
|
||
|------|------|
|
||
| 段落编号 | 从1开始递增 |
|
||
| 段落标题 | 该段落的事件/场景名称 |
|
||
| 时长 | 该段落持续时间(秒) |
|
||
| 事件描述 | 段落内的故事事件、场景、角色动作 |
|
||
| 台词 | 口播文案(口语化) |
|
||
| 备注 | 拍摄注意事项/情绪提示 |
|
||
|
||
> **重要界定**:脚本不含镜头编号和景别,以故事段落为单位组织内容,编导可自行决定拍摄方式。
|
||
|
||
### 4.3 生成界面展示
|
||
|
||
3 个版本以 **Tab 切换** 或 **并排对比** 方式展示:
|
||
|
||
- Tab 切换模式:默认显示标准版,用户可切换查看版本2/版本3
|
||
- 并排对比模式:3 个版本缩略版并排展示,点击展开查看完整脚本
|
||
- 用户可 **选择一个版本进入对话修改**
|
||
|
||
### 4.4 效果检测与迭代
|
||
|
||
脚本生成后,AI 自动进行效果检测,发现问题或可优化点时进行迭代优化:
|
||
|
||
| 步骤 | 说明 |
|
||
|------|------|
|
||
| 效果检测 | 检测内容生成效果(逻辑连贯性、口语化程度、节奏合理性等) |
|
||
| 复盘 | 发现潜在问题或可优化点 |
|
||
| 迭代优化 | 针对问题进行1-2轮迭代优化,每轮优化后再次检测 |
|
||
|
||
> **说明**:此步骤为AI内部自动执行,用户无需操作。迭代优化在原始生成基础上调整,不改变脚本的基本框架和方向。
|
||
|
||
---
|
||
|
||
## 五、对话修改定义(层4)
|
||
|
||
脚本生成后,用户可通过继续对话来完善脚本。对话修改采用 **Chat 交互模式**。
|
||
|
||
### 5.1 修改能力范围
|
||
|
||
| 修改类型 | 说明 | 示例 |
|
||
|---------|------|------|
|
||
| 局部修改 | 修改某一段台词/事件描述/时长 | "把第3段落的台词改得更口语化" |
|
||
| 风格调整 | 整体调整脚本风格/语态 | "整体风格改得更轻松幽默" |
|
||
| 内容增删 | 增加或删除某个段落/事件 | "在开头加一个悬念段落" "删掉第5段落" |
|
||
| 结构调整 | 调整脚本整体框架/节奏 | "换成PAS框架重新组织" |
|
||
| 广告植入 | 在脚本中自然植入产品信息 | "在第4段落加入XX产品的口播推荐" |
|
||
| 重新生成 | 基于当前对话上下文重新生成 | "完全重来,换一个选题方向" |
|
||
|
||
### 5.2 对话界面结构
|
||
|
||
```
|
||
┌─────────────────────────────────────────────────────┐
|
||
│ 顶部:当前脚本版本标识 + [切换版本] 按钮 │
|
||
├─────────────────────────────────────────────────────┤
|
||
│ │
|
||
│ ┌─────────────────────────┐ ┌─────────────────┐ │
|
||
│ │ 脚本预览区 │ │ 对话区 │ │
|
||
│ │ 段落式脚本实时展示 │ │ 用户消息 │ │
|
||
│ │ 修改后高亮标注 │ │ AI回复+修改说明 │ │
|
||
│ │ [下载] │ │ │ │
|
||
│ └─────────────────────────┘ │ ┌─────────────┐ │ │
|
||
│ │ │ 输入框 │ │ │
|
||
│ │ └─────────────┘ │ │
|
||
│ └─────────────────┘ │
|
||
│ │
|
||
├─────────────────────────────────────────────────────┤
|
||
│ 底部:[结束修改] [重新生成] │
|
||
└─────────────────────────────────────────────────────┘
|
||
```
|
||
|
||
### 5.3 修改交互逻辑
|
||
|
||
1. 用户输入修改指令 → AI 根据意图调整创作方法 → 修改具体内容 → 展示修改结果
|
||
2. 脚本预览区实时更新,修改部分 **高亮标注**(黄色底色 + 修改前后对比提示)
|
||
3. AI 回复包含:修改说明 + 修改理由
|
||
4. 支持多轮对话修改,每轮修改累积记录
|
||
5. 用户可随时点击「撤销最近修改」回退到上一版本
|
||
6. 修改过程中可切换查看其他版本脚本
|
||
|
||
### 5.4 效果检测与迭代
|
||
|
||
每轮对话修改后,AI 自动进行效果检测:
|
||
|
||
| 步骤 | 说明 |
|
||
|------|------|
|
||
| 效果检测 | 检测修改效果(修改意图是否达成、整体逻辑是否连贯等) |
|
||
| 复盘 | 发现潜在问题或可优化点 |
|
||
| 迭代优化 | 针对问题进行1-2轮迭代优化,每轮优化后再次检测 |
|
||
|
||
> **说明**:此步骤为AI内部自动执行,用户无需操作。迭代优化不改变用户指定的修改方向,仅在此基础上微调优化。
|
||
|
||
---
|
||
|
||
## 六、状态机模型
|
||
|
||
```
|
||
┌──────────┐
|
||
│ IDLE │ ← 等待用户输入
|
||
└────┬─────┘
|
||
│ 用户输入需求
|
||
▼
|
||
┌──────────────────┐
|
||
│ INPUT │ ← 用户输入(可见)
|
||
│ 需求输入 │ 简单/详细模式
|
||
│ 上传附件 │ 文档/图片/抖音链接
|
||
└────────┬─────────┘
|
||
│ 用户提交
|
||
▼
|
||
┌──────────────────┐
|
||
│ ANALYSIS │ ← 分析整理(可见)
|
||
│ ①分析所有输入 │ 解析到创作方法
|
||
│ ②AI补充缺失信息 │ 候选选择/编辑
|
||
│ ③信息齐全→生成 │ 自动触发脚本生成
|
||
└────────┬─────────┘
|
||
│ 信息齐全自动触发
|
||
▼
|
||
┌──────────────────┐
|
||
│ GENERATING │ ← 脚本生成(可见,3版本)
|
||
│ 标准版+版本2+版本3 │ 一次性生成
|
||
│ 版本选择/对比 │ 用户选择一个版本
|
||
└────────┬─────────┘
|
||
│ 用户选择版本
|
||
▼
|
||
┌──────────────────┐
|
||
│ EDITING │ ← 对话修改(可见)
|
||
│ Chat交互修改 │ 局部/风格/结构
|
||
│ 实时脚本预览 │ 修改高亮标注
|
||
└────────┬─────────┘
|
||
用户满意 │ 用户不满意
|
||
结束修改 │ 重新生成
|
||
▼ ▼
|
||
┌──────────┐ ┌──────────────┐
|
||
│ DONE │ │ GENERATING │ ← 重新生成3版本
|
||
│ 交付完成 │ └──────────────┘
|
||
└──────────┘
|
||
```
|
||
|
||
**异常处理**:
|
||
- 生成失败 → 提示用户重试或修改输入
|
||
- 修改冲突(用户修改指令与脚本结构矛盾) → AI 提出替代方案
|
||
|
||
---
|
||
|
||
## 七、数据流定义
|
||
|
||
### 7.1 会话上下文对象
|
||
|
||
```
|
||
SessionContext {
|
||
input: { // 层1 产出
|
||
rawText: string, // 简单模式原始文本
|
||
structuredFields: { // 详细模式字段
|
||
track: string,
|
||
topic: string,
|
||
duration: number,
|
||
rhythm: string,
|
||
style: string,
|
||
audience: string,
|
||
framework: string
|
||
} | null,
|
||
attachments: Attachment[], // 上传附件列表
|
||
videoLinks: string[] // 抖音短视频地址列表
|
||
},
|
||
analysis: { // 层2 产出
|
||
persona: PersonaCard, // 账号设定卡片
|
||
topic: TopicCard, // 选题方向卡片
|
||
framework: FrameworkCard, // 内容框架卡片
|
||
style: StyleCard, // 台词风格卡片
|
||
materials: MaterialsCard, // 附加素材卡片
|
||
completeness: CompletenessReport // 完整性检查报告
|
||
},
|
||
scripts: { // 层3 产出
|
||
standard: Script, // 标准版脚本
|
||
version2: Script, // 版本2(AI判断探索方向)
|
||
version3: Script, // 版本3(AI判断探索方向)
|
||
selectedVersion: 'standard' | 'version2' | 'version3' // 用户选择版本
|
||
},
|
||
editHistory: EditRecord[], // 层4 修改记录
|
||
currentPhase: 'INPUT' | 'ANALYSIS' | 'GENERATING' | 'EDITING' | 'DONE'
|
||
}
|
||
```
|
||
|
||
---
|
||
|
||
## 八、V1.1 创意分析功能简要规划
|
||
|
||
### 8.1 脚本诊断(F3)
|
||
|
||
| 属性 | 说明 |
|
||
|------|------|
|
||
| 入口 | 独立入口,不纳入四层架构 |
|
||
| 输入 | 分析之前生成的脚本,也支持上传文档(.md/.txt/.doc/.docx/.pdf)分析文档中的脚本 |
|
||
| 处理 | AI 对脚本进行多维度诊断分析,发现问题并提供改进建议 |
|
||
| 输出 | 诊断内容 |
|
||
|
||
### 8.2 短视频解析(F4)
|
||
|
||
| 属性 | 说明 |
|
||
|------|------|
|
||
| 入口 | 独立入口,不纳入四层架构 |
|
||
| 输入 | 粘贴抖音短视频地址(仅支持抖音平台) |
|
||
| 处理 | AI 对短视频内容进行多维度解析分析 |
|
||
| 输出 | 提供解析内容 |
|
||
|
||
---
|
||
|
||
## 九、与短视频脚本自动化项目的对比
|
||
|
||
| 维度 | 短视频脚本自动化(ToB/MCN) | AI创作平台(ToC) |
|
||
|------|------|------|
|
||
| 目标用户 | MCN编导(专业) | 个人创作者(泛用户) |
|
||
| 创作流程 | 6步后台链路(用户不可见) | 直接生成3版本(用户可见) |
|
||
| 修改方式 | 重新生成(整条重跑) | 对话式修改(局部调整) |
|
||
| 账号设定 | 强制上传文档或详细填写 | 可选,AI从输入推理 |
|
||
| 广告植入 | 内置广告Brief模块 | 对话修改时可选植入 |
|
||
| 输出版本 | 单版本脚本 | 3版本对比选择 |
|
||
| 信息卡片 | 5类(含广告Brief) | 5类(含附加素材) |
|