# AI 产品与项目模板工具箱

使用方法：复制所需模板到项目目录，所有 `【填写】` 必须被替换；不适用项写“不适用 + 原因”，不要删除以假装没考虑。模板是提问清单，不替代判断。

## 目录

1. [产品简报](#01-产品简报-product-brief)
2. [用户访谈提纲](#02-用户访谈提纲)
3. [AI 场景机会评分卡](#03-ai-场景机会评分卡)
4. [商业论证](#04-商业论证)
5. [AI PRD](#05-ai-prd)
6. [评测计划](#06-评测计划)
7. [黄金集记录格式](#07-黄金集记录格式)
8. [模型与供应商选型评分卡](#08-模型与供应商选型评分卡)
9. [架构决策记录 ADR](#09-架构决策记录-adr)
10. [模型卡与数据卡](#10-模型卡与数据卡)
11. [AI 项目章程](#11-ai-项目章程)
12. [WBS 与里程碑计划](#12-wbs-与里程碑计划)
13. [RACI](#13-raci)
14. [RAID 台账](#14-raid-台账)
15. [实验卡](#15-实验卡)
16. [变更请求](#16-变更请求)
17. [项目周报](#17-项目周报)
18. [AI 风险评估](#18-ai-风险评估)
19. [AI 威胁模型](#19-ai-威胁模型)
20. [AI 供应商尽调](#20-ai-供应商尽调)
21. [验收计划](#21-验收计划)
22. [Go/No-Go 决策单](#22-gono-go-决策单)
23. [运行手册 Runbook](#23-运行手册-runbook)
24. [AI 事故报告](#24-ai-事故报告)
25. [复盘](#25-复盘)
26. [路线图与组合管理](#26-路线图与组合管理)
27. [AI 影响评估](#27-ai-影响评估)
28. [Agent 动作与委托契约](#28-agent-动作与委托契约)
29. [评分器卡与风险测试追踪](#29-评分器卡与风险测试追踪)
30. [透明标识与用户控制](#30-透明标识与用户控制)
31. [退役与退出计划](#31-退役与退出计划)

下载结构化资产：[20 项指标合同](../14_行业基线/assets/metric-contracts.csv) · [12 项证据台账](../14_行业基线/assets/evidence-register.csv) · [30 条合成 Agent 测试](../14_行业基线/assets/agent-test-cases.csv)。使用前替换成真实业务参数，测试结果留空。

---

## 01 产品简报 Product Brief

```markdown
# 【产品/场景】产品简报
Owner：【】  日期：【】  状态：Draft/Review/Approved

## 问题
- 目标用户：【】
- 发生情境与 JTBD：【】
- 最近一次真实案例：【】
- 当前流程/替代方案：【】
- 基线：量【】时长【】成功率【】成本【】风险【】

## 价值假设
- 若我们【改变】，用户将【行为】，从而【结果】。
- 证据：【访谈/数据/实验】
- 不做的代价：【】

## 为什么用 AI
- 规则/搜索/人工/传统 ML 基线：【】
- AI 的不可替代增量：【】
- 主要不确定性：【】

## 范围
- 做：【】
- 不做：【】
- 自主性：建议/草稿/确认后执行/有限自治

## 成功与停止
- 北极星与目标：【】
- 质量/风险/成本底线：【】
- 停止条件：【】
- 下一最小实验、负责人、日期：【】
```

## 02 用户访谈提纲

```markdown
# 访谈记录
研究问题：【】  受访者角色/分群：【】  日期：【】  研究者：【】
同意与数据处理：【已说明/取得】

## 行为回放
1. 上一次【任务】何时发生？请从触发开始逐步演示。
2. 每一步使用什么、找谁、等多久、怎样判断完成？
3. 哪里最费时/易错/焦虑？最近的失败是什么？
4. 错误怎样发现、由谁承担、如何补救？
5. 现在的替代方案为何仍被使用？

## AI 协作
- 哪一步愿意获得建议、草稿或自动执行？为什么？
- 什么证据会让你采纳？什么情况必须人工确认？
- 需要怎样纠错、撤销、申诉和退出？
- 哪些数据绝不愿提供？

## 证据
- 原话/行为：【】
- 痛点频率/强度：【】
- 观察到的变通行为：【】
- 研究者解释（与事实分开）：【】
- 反证/意外发现：【】
- 待验证问题：【】
```

## 03 AI 场景机会评分卡

每项 1–5 分，必须附证据。

| 项 | 分 | 证据/假设 |
|---|---:|---|
| 痛点强度 | 【】 | 【】 |
| 频率/规模 | 【】 | 【】 |
| 用户价值 | 【】 | 【】 |
| 业务价值 | 【】 | 【】 |
| AI 相对基线增量 | 【】 | 【】 |
| 数据可得/合法/代表 | 【】 | 【】 |
| 可评测性/反馈速度 | 【】 | 【】 |
| 采用与流程适配 | 【】 | 【】 |
| 错误可逆/可发现 | 【】 | 【】 |
| 技术/集成复杂度（反向） | 【】 | 【】 |
| 安全合规风险（反向） | 【】 | 【】 |
| 单位经济（正向） | 【】 | 【】 |

结论：探索 / 保留 / 停止。最大致命假设：【】。最小验证：【】。

## 04 商业论证

```markdown
# 【项目】商业论证
## 目标与基线
业务结果：【】  当前量/时长/成功/成本/损失：【】

## 方案
候选 A 不做/现状：【】
候选 B 规则/流程：【】
候选 C AI：【】

## 3 年情景
| 项 | 保底 | 目标 | 峰值/悲观 |
|---|---:|---:|---:|
| 用户/任务量 | | | |
| 成功任务率 | | | |
| 每成功任务价值 | | | |
| 构建成本 | | | |
| 运行成本 | | | |
| 人工复核/返工 | | | |
| 风险/迁移/退出 | | | |
| 净价值/回收期 | | | |

关键假设与敏感性：【】
不可量化战略价值：【】
最大下行风险与控制：【】
投资建议与下一阶段预算：【】
```

## 05 AI PRD

```markdown
# 【功能】AI PRD
版本：【】 Owner：【】 评审人：【】

## 1 背景、用户问题与现状基线
【用户/JTBD/真实案例/量/时长/错误/成本】

## 2 目标、非目标与成功指标
- 产品目标：【】
- 非目标：【】
- 北极星/领先/护栏：【】
- 质量、风险、成本停止线：【】

## 3 用户、场景与流程
- 目标/非目标用户：【】
- 主流程、异常、拒答、取消、撤销、申诉：【】
- AI 自主性与人工责任：【】

## 4 为何 AI 与基线
规则/搜索/人工/传统 ML/不做的比较：【】

## 5 功能需求
| ID | 用户故事/规则 | 优先级 | 验收 |
|---|---|---|---|

## 6 AI 输入输出契约
输入来源/Schema/语言/长度/敏感性：【】
输出 Schema/引用/状态/禁止内容：【】
工具、权限、确认、幂等/补偿：【】

## 7 数据与知识
来源/权利/质量/标注/更新/ACL/保留/删除：【】

## 8 技术方案
模型/Prompt/RAG/微调/工具/规则/路由/降级：【】
版本与复现指纹：【】

## 9 评测
黄金集/切片/Rubric/基线/阈值/人评/红队：【】

## 10 AI UX
能力告知/来源/不确定/纠错/确认/撤销/人工接管/记忆控制：【】

## 11 安全合规
风险等级、适用义务、隐私、版权、威胁、标识、审计：【】

## 12 非功能与运营
SLO/容量/成本/监控/告警/回滚/Runbook/支持：【】

## 13 发布
影子/灰度/放量/停止/回滚条件：【】

## 14 依赖、风险、开放问题、决策日志
【责任人 + 截止日】
```

## 06 评测计划

```markdown
# 【系统/版本】评测计划
评测问题：【是否足以做哪个决定】
候选与版本指纹：【】

## 任务与 Rubric
| 任务 | 维度 | 0/1/2/3 锚点 | 权重 | 硬门槛 |
|---|---|---|---:|---|

## 数据集
来源/授权/时间/去重/污染防护：【】
样本量与分层：任务【】用户【】语言【】风险【】难度【】
开发集/测试集/holdout/红队集：【】

## 评分
确定性检查：【】
人评：人数【】盲评【】一致性【】仲裁【】
LLM Judge：模型/Prompt【】人工校准【】偏差检查【】

## 指标与门槛
质量/拒答/关键失败/延迟/成本/安全：【】
置信区间、配对方法和停止规则：【】

## 输出
总体 + 切片 + 错误分类 + 代表样本 + 限制 + 建议决定。
```

## 07 黄金集记录格式

建议 JSONL/表格字段：

```json
{"case_id":"","task":"","user_segment":"","language":"zh-CN","risk":"high","input":"","context_refs":[],"expected":"","acceptable_variants":[],"must_include":[],"must_not_include":[],"should_refuse":false,"expected_tool_calls":[],"rubric_version":"","source":"real|expert|synthetic|incident","created_at":"","reviewers":[],"notes":""}
```

另建不可泄漏的 holdout；个人信息去标识；事故样本标严重度；任何标签变更保留历史。

## 08 模型与供应商选型评分卡

| 维度 | 权重/门槛 | 候选 A | 候选 B | 证据 |
|---|---:|---:|---:|---|
| 核心任务质量 | 【】 | | | |
| 关键切片/拒答 | 门槛 | | | |
| 安全/隐私/合规 | 门槛 | | | |
| P50/P95/吞吐/SLA | 【】 | | | |
| 每成功任务成本/3 年 TCO | 【】 | | | |
| 版本/日志/可控/回滚 | 【】 | | | |
| 区域/数据/子处理者 | 门槛 | | | |
| 集成/支持/路线图 | 【】 | | | |
| 锁定/迁移/退出 | 【】 | | | |

结论：【】；不选其他候选原因：【】；复核触发：【】。

## 09 架构决策记录 ADR

```markdown
# ADR-【编号】 【标题】
状态：Proposed/Accepted/Superseded  日期：【】 决策人：【】
## 背景与约束
【】
## 候选
1. 【方案/优点/缺点/证据】
2. 【】
3. 不做/延后：【】
## 决定与理由
【】
## 影响
质量【】成本【】安全【】运营【】锁定【】
## 风险与缓解
【】
## 复核触发
【时间/流量/事故/法规/供应商变化】
```

## 10 模型卡与数据卡

### 模型/系统卡

```markdown
名称/版本/Owner/日期：【】
目的与适用/禁用场景：【】
组成：模型、Prompt、RAG、工具、规则：【】
训练/适配数据概况：【】
评测：数据、总体、切片、安全、延迟、成本：【】
已知限制与失败模式：【】
公平/隐私/版权/安全考虑：【】
人类监督、告知、申诉：【】
部署、监控、回滚、退役：【】
```

### 数据卡

```markdown
数据集/版本/Owner/许可证：【】
目的与禁止用途：【】
来源/采集时间/授权链：【】
组成/规模/分群/缺失：【】
清洗/去标识/标注/一致性：【】
敏感属性/偏差/代表性/已知限制：【】
访问/保留/删除/跨境/下游：【】
质量指标与更新记录：【】
```

## 11 AI 项目章程

```markdown
# 【项目】章程
Sponsor：【】 产品负责人：【】 项目经理：【】 技术负责人：【】
## 目的与成功
业务目标/基线/目标/停止线：【】
## 范围
内：【】 外：【】 阶段：探索/PoC/试点/产品化/规模化
## 交付与里程碑
【阶段门、日期、证据】
## 资源与预算
【人员/数据/模型/供应商/储备】
## 约束、假设、依赖与 Top 风险
【】
## 治理
RACI【】决策权【】变更阈值【】升级【】Stop-the-line【】
## 验收、运营归属与关闭标准
【】
批准：Sponsor【】日期【】
```

## 12 WBS 与里程碑计划

| WBS | 交付物/工作包 | Owner | 前置依赖 | O/M/P | 目标日 | 验收证据 | 状态 |
|---|---|---|---|---|---|---|---|

AI 必查包：数据授权/标注、基线、黄金集、PoC、AI UX、红队/隐私、压测/成本、监控/回滚、培训/移交。

里程碑格式：`【日期】达成【证据事件】，通过条件【】，批准人【】`。

## 13 RACI

| 产物/决定 | Sponsor | AI PM | 项目经理 | 算法 | 工程 | SME | 安全/法务 | 运营 |
|---|---|---|---|---|---|---|---|---|

规则：每行一个 `A`；`R` 至少一个；`C` 必须在决定前；`I` 在决定后；空白即无责任。

## 14 RAID 台账

| ID | 类别 R/A/I/D | 描述 | 触发/证据 | 概率 | 影响 | Owner | 缓解 | 应急 | 日期 | 状态 |
|---|---|---|---|---:|---:|---|---|---|---|---|

每周关闭失效项、验证假设、升级逾期项；只写“关注”视为无措施。

## 15 实验卡

```markdown
# EXP-【编号】 【标题】
假设：若【】，则【指标】相对【基线】从【】到【】，因为【】。
要做的决定：【】
最小方法与候选版本：【】
数据/样本/切片/授权：【】
主指标/护栏/阈值/停止规则：【】
时间盒/预算/Owner：【】
结果（含不确定性和失败样本）：【】
结论：支持/不支持/不确定
决定：继续/调整/停止；新假设：【】
```

## 16 变更请求

```markdown
# CR-【编号】 【变更】
请求人/日期/原因：【】
现状与拟变更：【】
影响：范围【】日期【】成本【】质量【】安全合规【】运营【】
模型/Prompt/数据/索引/工具版本影响：【】
选项：拒绝【】替换【】延后【】增资【】改期【】
建议：【】 决策人/决定/日期：【】
实施、验证、沟通、回滚：【】
更新的基线/文档：【】
```

## 17 项目周报

```markdown
# 【项目】周报 YYYY-MM-DD
总体：绿/黄/红（理由与数据）
## 本周结果/证据
- 【不是活动列表】
## 基线偏差
范围【】进度【】成本【】质量【】风险【】
## Top RAID
| 项 | 趋势 | 行动/Owner/日期 |
## 下周里程碑
- 【】
## 需决策
【问题】建议【】最晚【】否则影响【】
```

## 18 AI 风险评估

```markdown
# 【系统】AI 风险评估
目的/用户/受影响者/地区/行业：【】
自主性/关键决策/可逆性/人工监督：【】
数据与供应商流：【】
适用义务与风险等级：【】

| 风险情景（不是抽象名词） | 受影响者 | 固有概率/影响 | 预防 | 检测 | 响应/补救 | 证据 | 残余风险 | Owner |
|---|---|---|---|---|---|---|---|---|

覆盖：质量、隐私、安全、公平、透明、内容、版权、人类自主、运营、环境。
例外/接受人/到期复核：【】
重大变更触发：【】
```

## 19 AI 威胁模型

```markdown
# 【系统】威胁模型
架构/信任边界/数据流：【链接】
资产：【数据/秘密/模型/工具/预算/声誉】
攻击者与能力：【外部用户/内部/供应链/内容提供者】
入口：【输入/文档/网页/工具/API/日志/模型】

| ID | 攻击路径 | 前置条件 | 影响 | 预防 | 检测/响应 | 测试用例 | 状态 |
|---|---|---|---|---|---|---|---|

必测：直接/间接注入、越狱、泄漏、跨租户、工具越权、投毒、资源耗尽、输出注入、依赖供应链。
```

## 20 AI 供应商尽调

```markdown
供应商/服务/Owner/日期：【】
1. 数据：输入输出/反馈是否训练？保留、区域、删除、子处理者？
2. 安全：认证、隔离、加密、密钥、漏洞、渗透、事故通知？
3. 模型：卡片、已知限制、版本锁定、变更/弃用、回退？
4. 合规/IP：许可、训练数据、版权、隐私、审计、行业要求？
5. 运行：SLA、速率、峰值、灾备、支持、状态与 RCA？
6. 商业：计价、失败/缓存计费、涨价、三年 TCO、最低承诺？
7. 退出：导出、删除证明、迁移协助、替代接口、终止费用？
8. PoC：同一数据/评分卡/人工干预披露/删除期限？
未解决红旗：【】  风险接受人：【】  建议：【】
```

## 21 验收计划

| ID | 需求/风险 | 测试环境与版本 | 数据/步骤 | 通过阈值 | 责任人 | 证据 | 结果 |
|---|---|---|---|---|---|---|---|

覆盖：范围、AI 质量切片、红队/隐私、性能/SLO、成本、权限/审计、故障/回滚、文档/培训/运营。写明 P0/P1/P2、整改时限、复验、条件验收和拒收权。

## 22 Go/No-Go 决策单

```markdown
# 【版本】发布决策
范围/流量/用户/区域/自主性：【】
证据链接：评测【】红队【】UAT【】压测【】合规【】
质量/性能/成本/风险门槛结果：【】
未关闭问题与残余风险：【】
灰度、监控、告警、回滚、人工接管：【】
培训/支持/用户告知：【】
建议：Go / Conditional Go / No-Go
条件与到期：【】
签字：业务【】产品【】项目【】技术【】安全/法务【】运营【】
```

## 23 运行手册 Runbook

```markdown
# 【服务】Runbook
Owner/值班/升级/供应商联系人：【】
架构、依赖、仪表盘、日志、版本注册表：【】
SLO/告警/错误预算/质量预算/成本预算：【】

## 常见事件
| 告警/症状 | 判断 | 立即动作 | 验证 | 升级 | 恢复 |

## 降级阶梯
关闭增强 → 限制输出/工具 → 备用模型/区域 → 搜索/规则 → 人工/暂停。
## 回滚
模型【】Prompt【】索引【】工具/规则【】数据【】
## 安全/隐私事故
止损、证据保护、通知、凭证撤销、用户补救：【】
## 恢复后
回归/灰度/沟通/复盘/评测集更新：【】
```

## 24 AI 事故报告

```markdown
# INC-【编号】 【标题】
级别：【】 状态：【】 指挥者：【】
检测/开始/控制/恢复时间：【】
影响用户/数据/地区/时长/损失：【】
当前是否仍发生：【】
时间线（只写事实）：【】
立即控制：【功能开关/撤权/回滚/通知】
根因：技术【】流程【】组织【】控制为何失效【】
通知：内部/用户/客户/供应商/监管/执法【】
修复与恢复验证：【】
行动项（Owner/日期/证据）：【】
经验加入哪些回归/红队/培训：【】
```

## 25 复盘

```markdown
# 【项目/里程碑】复盘
目标与结果（目标值/实际/证据）：【】
原始假设：支持【】证伪【】仍未知【】
时间线与关键决定：【】
做得好：【机制和证据，不只夸人】
未达预期：【事实和影响】
根因：目标/数据/模型/体验/工程/项目/组织/外部【】
若重做：保留【】停止【】开始【】
行动项：具体结果/Owner/日期/验证/优先级【】
需更新的标准、模板、评测集和路线图：【】
```

## 26 路线图与组合管理

路线图按结果主题，不按功能清单：

| 主题/场景 | 目标用户结果 | 当前证据 | 阶段 | 下一风险假设 | 里程碑/门槛 | 资源 | 决策日 |
|---|---|---|---|---|---|---|---|

组合季度评审：

- `Invest`：价值已证实，扩大能力/流量。
- `Explore`：用有限预算验证最大假设。
- `Hold`：依赖或时机未到，明确复核条件。
- `Stop`：证据不支持，回收资源和知识。

路线图同时展示平台能力（评测、知识、身份、治理）与场景产品，防每个团队重复造轮子。

---

## 27 AI 影响评估

用途/非用途【】法域/行业【】系统/数据/模型版本【】Owner【】专业复核【】

| 受影响者 | 影响路径/情景 | 严重度/条件 | 替代方案 | 控制与验证 | 残余影响 | 接受人/日期 |
|---|---|---|---|---|---|---|
| 【个人/群体】 | 【正常及失效时】 | 【】 | 【含不采用AI】 | 【证据链接】 | 【】 | 【】 |

个人信息、机会分配、心理、人身、财务、社会与环境影响：【】
复核触发：用途/地区/人群/自主性/数据/供应商变化、放量、事故、退役：【】
结论与未决项：【】；参考 [影响评估实践](../14_行业基线/06_交付_采购与证据包.md)。

## 28 Agent 动作与委托契约

任务ID【】用户/租户【】Agent身份【】凭证受众/范围/期限【】目标【】

| 资源 | 动作 | 条件/限额 | 需要确认 | 幂等键 | 完成凭据 | 撤销/补偿 |
|---|---|---|---|---|---|---|
| 【】 | 【读/草拟/提交/发送】 | 【金额/时间/数据】 | 【谁看到什么】 | 【】 | 【环境回读】 | 【】 |

委托链与授权来源【】工具/协议/SDK版本【】跨代理消息验证【】
步骤/时间/Token/金额/重试总预算【】无进展停止【】撤权传播【】人工接管【】
工具变更、注入、并发、部分失败和恢复测试证据【】。

## 29 评分器卡与风险测试追踪

评测决定【】样本总体/独立单位【】分层/权重【】集合/数据卡版本【】
评分器类型/模型/Prompt版本【】人工参考/校准集【】分歧/仲裁【】严重错误漏报【】
样本量依据、重复次数、区间/检验、比较预算及污染隔离【】

| 风险ID | 需求ID | 测试ID | 环境/初态 | 成功/终态断言 | 结果/证据 | 独立复核 | 重测触发 |
|---|---|---|---|---|---|---|---|
| 【】 | 【】 | 【】 | 【】 | 【】 | 【待测】 | 【】 | 【】 |

总体与关键切片、延迟/成本、无效样本、严重失败及限制【】
Go/No-Go、残余风险及接受人【】。方法见 [统计评测](../14_行业基线/01_统计评测与质量门禁.md)。

## 30 透明标识与用户控制

适用法域/条款/生效日【】价值链角色【】专业复核【】

| 对象/环节 | 应披露内容/标识 | 实施方式 | 验证样本 | Owner | 结论 |
|---|---|---|---|---|---|
| 用户交互 | 【AI身份/能力/限制】 | 【】 | 【】 | 【】 | 【】 |
| 生成/展示 | 【按模态与法域】 | 【】 | 【】 | 【】 | 【】 |
| 下载/复制/导出 | 【显式/隐式/元数据】 | 【】 | 【】 | 【】 | 【】 |
| 受影响人 | 【纠错/申诉/人工复核】 | 【】 | 【】 | 【】 | 【】 |

确认、取消、退出、删除和投诉路径【】；人工监督者的信息、时间和干预权限【】。

## 31 退役与退出计划

退出原因/触发【】服务Owner【】目标日期【】依赖/消费者【】用户通知【】

| 步骤 | 动作 | Owner | 可验证证据 | 恢复/保留边界 |
|---|---|---|---|---|
| 停新任务 | 【入口和调度】 | 【】 | 【新请求探针】 | 【】 |
| 在途收尾 | 【完成/取消/人工】 | 【】 | 【任务和回执】 | 【】 |
| 权限撤销 | 【凭证/委托/缓存】 | 【】 | 【撤权探针】 | 【】 |
| 数据处置 | 【原文/向量/导出/日志/备份】 | 【】 | 【删除传播与保留】 | 【】 |
| 供应商退出 | 【导出/合同/删除证明】 | 【】 | 【回读与迁移演练】 | 【】 |
| 关闭验收 | 【业务/风险/费用】 | 【】 | 【批准与归档】 | 【】 |

已确认保留记录、依据和期限【】；未完成项及责任【】。
