Files
mcn-short-video/project/AI创作平台toc/case_1/02_产品架构.md
T

369 lines
18 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 产品架构:AI创作平台(ToC)
> 输出角色:产品架构师 | 版本:v1.0 | 日期:2026-07-14
---
## 一、系统概述
AI创作平台是面向个人创作者的短视频脚本创作工具。核心交互流程为:**用户输入 → 分析整理 → 脚本生成(3版本) → 对话修改**。系统借鉴短视频脚本创作项目的用户输入和分析整理层设计,但大幅简化——去掉 6 步后台创作链路,改为直接生成多版本脚本,并提供对话式修改能力。
> **核心差异(vs MCN 短视频脚本自动化项目)**:
> - 目标用户:个人创作者(ToC)而非 MCN 编导(ToB)
> - 创作流程:直接生成 3 版本脚本,而非 6 步后台链路
> - 修改方式:对话式修改,而非重新生成
> - 账号设定:不强制上传账号设定文档,AI 从输入中推理
> - 广告植入:不内置广告 Brief 模块
### 1.1 系统四层架构
| 层级 | 名称 | 用户可见 | 核心职责 |
|:---:|------|:---:|---------|
| 1 | **用户输入** | ✅ | 需求输入(简单模式/详细模式)+ 上传附件(文档/图片/抖音短视频地址) |
| 2 | **分析整理** | ✅ | 分析所有输入 → 解析到创作方法 → 完整性检查 → AI补充缺失 |
| 3 | **脚本生成** | ✅ | 一次性生成 3 个版本脚本 + 效果检测与1-2轮迭代优化 |
| 4 | **对话修改** | ✅ | 对话修改脚本 + 效果检测与1-2轮迭代优化 |
> 注:V1.0 创意生成仅覆盖层1-4。V1.1 创意分析的脚本诊断和短视频解析为独立入口,不纳入四层架构。
### 1.2 核心交互流程
```
┌──────────────┐ ┌──────────────┐ ┌──────────────┐ ┌──────────────┐
│ 阶段1 │ │ 阶段2 │ │ 阶段3 │ │ 阶段4 │
│ 用户输入 │───→│ 分析整理 │───→│ 脑本生成 │───→│ 对话修改 │
│ [用户可见] │ │ [用户可见] │ │ [用户可见] │ │ [用户可见] │
│ │ │ │ │ │ │ │
│ 填写需求 │ │ 查看解析结果 │ │ 3版本脚本 │ │ 局部修改 │
│ 上传附件 │ │ 补充缺失信息 │ │ 效果检测迭代 │ │ 效果检测迭代 │
│ 粘贴抖音链接 │ │ 补充缺失信息 │ │ 效果检测迭代 │ │ 效果检测迭代 │
└──────────────┘ └──────────────┘ └──────────────┘ └──────────────┘
```
---
## 二、用户输入定义(层1)
用户输入包含两个核心模块,UI 布局顺序为 **①需求输入 → ②上传附件**。两个模块并列独立,用户可自由组合。
### 2.1 模块①:需求输入
**简单模式**:
| 属性 | 说明 |
|------|------|
| 输入方式 | 自由文本框,一句话或一段话 |
| 示例 | 「我想做一个职场干货视频,教大家怎么在面试里谈薪资,风格轻松一点,60秒」 |
| AI 处理 | 语义解析提取赛道/主题/风格/时长等,缺失信息在分析整理层补充 |
| 适用场景 | 灵感闪现、快速试方向 |
**详细模式**:
| 输入方式 | 说明 | 示例 |
|---------|------|------|
| 手动填写 | 结构化字段逐项填写 | 赛道/主题/时长/风格等 |
| 粘贴抖音链接 | 一条抖音短视频地址 | 仅支持抖音平台 |
| 混合输入 | 手动填写 + 抖音链接 | 填基本信息 + 上传对标抖音视频 |
**结构化字段定义:**
| 字段类别 | 字段 | 必填 | 说明 |
|---------|------|:---:|------|
| 基本信息 | 内容赛道 | 是 | 知识教学/剧情情感/美食生活/探店测评/Vlog记录/观点态度/视觉冲击等 |
| 基本信息 | 主题方向 | 是 | 本期视频的主题,如"面试技巧""好物推荐"等 |
| 基本信息 | 预计时长 | 是 | 视频时长(秒),默认60 |
| 基本信息 | 节奏 | 否 | 快节奏/中等节奏/慢节奏/先快后慢/先慢后快等,不填则AI自动匹配 |
| 风格偏好 | 内容风格 | 否 | 轻松幽默/严肃干货/温馨治愈/反转搞笑等 |
| 风格偏好 | 目标受众 | 否 | 主要面向的观众群体 |
| 风格偏好 | 框架偏好 | 否 | 三段式/PAS/SCQA/认知反差等,不填则AI自动匹配 |
### 2.2 模块②:上传附件(可选)
| 输入方式 | 说明 | 支持格式 |
|---------|------|---------|
| 上传文档 | 上传参考文档(账号设定/故事选题/对标脚本等) | `.doc` / `.docx` / `.pdf` / `.ppt` / `.pptx` / `.xls` / `.xlsx` / `.txt` |
| 上传图片 | 上传视觉参考图 | `.jpg` / `.png` / `.webp` |
| 粘贴抖音短视频地址 | 粘贴一条抖音短视频地址 | 仅支持抖音平台 |
> **说明**:附件类型和数量受限,每种类型有上传数量上限。AI 在分析整理层统一解析所有输入。
---
## 三、分析整理定义(层2)
分析整理是用户输入与脚本生成之间的核心枢纽,承担三个功能:**分析所有输入**、**解析到创作方法** 和 **AI补充缺失信息**。
### 3.1 功能一:分析所有输入,解析到创作方法
根据用户输入的内容,进行以下处理:
| 输入类型 | 处理方式 | 整理产出 |
|---------|---------|---------|
| 一段话描述(简单模式) | 语义解析,提取关键信息 | 账号设定/选题/框架/台词风格的初步草案 |
| 结构化字段(详细模式) | 字段映射与校验 | 标准格式的创作参数 |
| 上传文档 | 文件解析,提取关键信息 | 账号设定/故事选题/对标参考等结构化信息 |
| 上传图片 | 视觉风格提取 | 视觉参考、场景氛围标签 |
| 抖音短视频地址 | 视频内容解析 | 框架/爆点/台词风格/节奏参考 |
分析完成后,将所有输入信息解析到创作方法,以 **五类信息卡片** 结构化展示:
| 卡片 | 内容字段 | 来源 |
|------|---------|------|
| 账号设定 | 身份人设/内容定位/性格人设/说话语态/视觉符号/差异化标签 | 文档解析 / 语义提取 / 详细模式字段 |
| 选题方向 | 选题方向/选题类别/对标参考 | 语义提取 / 详细模式字段 / 视频解析 |
| 内容框架 | 框架类型/预计时长/赛道类别 | 详细模式字段 / AI自动匹配 / 视频解析 |
| 台词风格 | 语态偏好/语速偏好/口头禅/情绪表达 | 语义提取 / 文档解析 / AI推理 |
| 附加素材 | 图片参考/文档参考/视频参考标签 | 附件直接映射 |
> 与 MCN 项目差异:附加素材卡片为新增(ToC 用户上传更多样),账号设定不强制要求文档上传(AI 从输入推理),无广告 Brief 卡片。
### 3.2 功能二:AI补充缺失信息
整理完成后,检查五类信息是否齐全。信息不完整时:
1. AI 识别缺失维度,提示具体缺失项
2. AI 基于已有信息和赛道常识,为每个缺失维度生成 **2-3 个候选版本**
3. 每个版本附带生成理由
4. 用户选择最合适的候选,或要求 AI 重新生成
5. 信息齐全后自动触发脚本生成
> **重要界定**:本层只判断信息**全不全**,不评判**对不对**。
---
## 四、脚本生成定义(层3)
信息齐全后,AI **一次性生成 3 个版本脚本**:
### 4.1 三版本策略
| 版本 | 定位 | 说明 |
|:---:|------|------|
| 标准版 | 稳妥安全 | 基于 AI 最优判断生成的主推版本,严格匹配输入信息和赛道框架 |
| 版本2 | AI判断探索方向 | AI 根据用户输入判断最值得探索的方向,调整一个关键变量(如换钩子策略/换叙事视角/换情绪路线等) |
| 版本3 | AI判断探索方向 | AI 根据用户输入判断第二个值得探索的方向,尝试不同风格方向(如标准版偏干货→此版本偏剧情/标准版偏严肃→此版本偏幽默等) |
> **说明**:版本2和版本3的探索方向由AI根据用户输入内容(赛道、主题、风格偏好、节奏等)综合判断,而非固定为"创意突破"和"风格探索"。不同输入组合下,两个版本的探索方向可能完全不同。
### 4.2 脚本输出格式
脚本采用 **基于故事和事件的段落式结构**,而非逐帧拍摄脚本:
| 字段 | 说明 |
|------|------|
| 段落编号 | 从1开始递增 |
| 段落标题 | 该段落的事件/场景名称 |
| 时长 | 该段落持续时间(秒) |
| 事件描述 | 段落内的故事事件、场景、角色动作 |
| 台词 | 口播文案(口语化) |
| 备注 | 拍摄注意事项/情绪提示 |
> **重要界定**:脚本不含镜头编号和景别,以故事段落为单位组织内容,编导可自行决定拍摄方式。
### 4.3 生成界面展示
3 个版本以 **Tab 切换** 或 **并排对比** 方式展示:
- Tab 切换模式:默认显示标准版,用户可切换查看版本2/版本3
- 并排对比模式:3 个版本缩略版并排展示,点击展开查看完整脚本
- 用户可 **选择一个版本进入对话修改**
### 4.4 效果检测与迭代
脚本生成后,AI 自动进行效果检测,发现问题或可优化点时进行迭代优化:
| 步骤 | 说明 |
|------|------|
| 效果检测 | 检测内容生成效果(逻辑连贯性、口语化程度、节奏合理性等) |
| 复盘 | 发现潜在问题或可优化点 |
| 迭代优化 | 针对问题进行1-2轮迭代优化,每轮优化后再次检测 |
> **说明**:此步骤为AI内部自动执行,用户无需操作。迭代优化在原始生成基础上调整,不改变脚本的基本框架和方向。
---
## 五、对话修改定义(层4)
脚本生成后,用户可通过继续对话来完善脚本。对话修改采用 **Chat 交互模式**。
### 5.1 修改能力范围
| 修改类型 | 说明 | 示例 |
|---------|------|------|
| 局部修改 | 修改某一段台词/事件描述/时长 | "把第3段落的台词改得更口语化" |
| 风格调整 | 整体调整脚本风格/语态 | "整体风格改得更轻松幽默" |
| 内容增删 | 增加或删除某个段落/事件 | "在开头加一个悬念段落" "删掉第5段落" |
| 结构调整 | 调整脚本整体框架/节奏 | "换成PAS框架重新组织" |
| 广告植入 | 在脚本中自然植入产品信息 | "在第4段落加入XX产品的口播推荐" |
| 重新生成 | 基于当前对话上下文重新生成 | "完全重来,换一个选题方向" |
### 5.2 对话界面结构
```
┌─────────────────────────────────────────────────────┐
│ 顶部:当前脚本版本标识 + [切换版本] 按钮 │
├─────────────────────────────────────────────────────┤
│ │
│ ┌─────────────────────────┐ ┌─────────────────┐ │
│ │ 脚本预览区 │ │ 对话区 │ │
│ │ 段落式脚本实时展示 │ │ 用户消息 │ │
│ │ 修改后高亮标注 │ │ AI回复+修改说明 │ │
│ │ [下载] │ │ │ │
│ └─────────────────────────┘ │ ┌─────────────┐ │ │
│ │ │ 输入框 │ │ │
│ │ └─────────────┘ │ │
│ └─────────────────┘ │
│ │
├─────────────────────────────────────────────────────┤
│ 底部:[结束修改] [重新生成] │
└─────────────────────────────────────────────────────┘
```
### 5.3 修改交互逻辑
1. 用户输入修改指令 → AI 根据意图调整创作方法 → 修改具体内容 → 展示修改结果
2. 脚本预览区实时更新,修改部分 **高亮标注**(黄色底色 + 修改前后对比提示)
3. AI 回复包含:修改说明 + 修改理由
4. 支持多轮对话修改,每轮修改累积记录
5. 用户可随时点击「撤销最近修改」回退到上一版本
6. 修改过程中可切换查看其他版本脚本
### 5.4 效果检测与迭代
每轮对话修改后,AI 自动进行效果检测:
| 步骤 | 说明 |
|------|------|
| 效果检测 | 检测修改效果(修改意图是否达成、整体逻辑是否连贯等) |
| 复盘 | 发现潜在问题或可优化点 |
| 迭代优化 | 针对问题进行1-2轮迭代优化,每轮优化后再次检测 |
> **说明**:此步骤为AI内部自动执行,用户无需操作。迭代优化不改变用户指定的修改方向,仅在此基础上微调优化。
---
## 六、状态机模型
```
┌──────────┐
│ IDLE │ ← 等待用户输入
└────┬─────┘
│ 用户输入需求
▼
┌──────────────────┐
│ INPUT │ ← 用户输入(可见)
│ 需求输入 │ 简单/详细模式
│ 上传附件 │ 文档/图片/抖音链接
└────────┬─────────┘
│ 用户提交
▼
┌──────────────────┐
│ ANALYSIS │ ← 分析整理(可见)
│ ①分析所有输入 │ 解析到创作方法
│ ②AI补充缺失信息 │ 候选选择/编辑
│ ③信息齐全→生成 │ 自动触发脚本生成
└────────┬─────────┘
│ 信息齐全自动触发
▼
┌──────────────────┐
│ GENERATING │ ← 脚本生成(可见,3版本)
│ 标准版+版本2+版本3 │ 一次性生成
│ 版本选择/对比 │ 用户选择一个版本
└────────┬─────────┘
│ 用户选择版本
▼
┌──────────────────┐
│ EDITING │ ← 对话修改(可见)
│ Chat交互修改 │ 局部/风格/结构
│ 实时脚本预览 │ 修改高亮标注
└────────┬─────────┘
用户满意 │ 用户不满意
结束修改 │ 重新生成
▼ ▼
┌──────────┐ ┌──────────────┐
│ DONE │ │ GENERATING │ ← 重新生成3版本
│ 交付完成 │ └──────────────┘
└──────────┘
```
**异常处理**:
- 生成失败 → 提示用户重试或修改输入
- 修改冲突(用户修改指令与脚本结构矛盾) → AI 提出替代方案
---
## 七、数据流定义
### 7.1 会话上下文对象
```
SessionContext {
input: { // 层1 产出
rawText: string, // 简单模式原始文本
structuredFields: { // 详细模式字段
track: string,
topic: string,
duration: number,
rhythm: string,
style: string,
audience: string,
framework: string
} | null,
attachments: Attachment[], // 上传附件列表
videoLinks: string[] // 抖音短视频地址列表
},
analysis: { // 层2 产出
persona: PersonaCard, // 账号设定卡片
topic: TopicCard, // 选题方向卡片
framework: FrameworkCard, // 内容框架卡片
style: StyleCard, // 台词风格卡片
materials: MaterialsCard, // 附加素材卡片
completeness: CompletenessReport // 完整性检查报告
},
scripts: { // 层3 产出
standard: Script, // 标准版脚本
version2: Script, // 版本2(AI判断探索方向)
version3: Script, // 版本3(AI判断探索方向)
selectedVersion: 'standard' | 'version2' | 'version3' // 用户选择版本
},
editHistory: EditRecord[], // 层4 修改记录
currentPhase: 'INPUT' | 'ANALYSIS' | 'GENERATING' | 'EDITING' | 'DONE'
}
```
---
## 八、V1.1 创意分析功能简要规划
### 8.1 脚本诊断(F3)
| 属性 | 说明 |
|------|------|
| 入口 | 独立入口,不纳入四层架构 |
| 输入 | 分析之前生成的脚本,也支持上传文档(.md/.txt/.doc/.docx/.pdf)分析文档中的脚本 |
| 处理 | AI 对脚本进行多维度诊断分析,发现问题并提供改进建议 |
| 输出 | 诊断内容 |
### 8.2 短视频解析(F4)
| 属性 | 说明 |
|------|------|
| 入口 | 独立入口,不纳入四层架构 |
| 输入 | 粘贴抖音短视频地址(仅支持抖音平台) |
| 处理 | AI 对短视频内容进行多维度解析分析 |
| 输出 | 提供解析内容 |
---
## 九、与短视频脚本自动化项目的对比
| 维度 | 短视频脚本自动化(ToB/MCN) | AI创作平台(ToC) |
|------|------|------|
| 目标用户 | MCN编导(专业) | 个人创作者(泛用户) |
| 创作流程 | 6步后台链路(用户不可见) | 直接生成3版本(用户可见) |
| 修改方式 | 重新生成(整条重跑) | 对话式修改(局部调整) |
| 账号设定 | 强制上传文档或详细填写 | 可选,AI从输入推理 |
| 广告植入 | 内置广告Brief模块 | 对话修改时可选植入 |
| 输出版本 | 单版本脚本 | 3版本对比选择 |
| 信息卡片 | 5类(含广告Brief) | 5类(含附加素材) |