行业知识 · v2.3.0 · 资料核对 2026-10-03
AI 产品与项目模板工具箱
使用方法:复制所需模板到项目目录,所有 【填写】 必须被替换;不适用项写“不适用 + 原因”,不要删除以假装没考虑。模板是提问清单,不替代判断。
目录
- 产品简报
- 用户访谈提纲
- AI 场景机会评分卡
- 商业论证
- AI PRD
- 评测计划
- 黄金集记录格式
- 模型与供应商选型评分卡
- 架构决策记录 ADR
- 模型卡与数据卡
- AI 项目章程
- WBS 与里程碑计划
- RACI
- RAID 台账
- 实验卡
- 变更请求
- 项目周报
- AI 风险评估
- AI 威胁模型
- AI 供应商尽调
- 验收计划
- Go/No-Go 决策单
- 运行手册 Runbook
- AI 事故报告
- 复盘
- 路线图与组合管理
- AI 影响评估
- Agent 动作与委托契约
- 评分器卡与风险测试追踪
- 透明标识与用户控制
- 退役与退出计划
下载结构化资产:20 项指标合同 · 12 项证据台账 · 30 条合成 Agent 测试。使用前替换成真实业务参数,测试结果留空。
01 产品简报 Product Brief
# 【产品/场景】产品简报
Owner:【】 日期:【】 状态:Draft/Review/Approved
## 问题
- 目标用户:【】
- 发生情境与 JTBD:【】
- 最近一次真实案例:【】
- 当前流程/替代方案:【】
- 基线:量【】时长【】成功率【】成本【】风险【】
## 价值假设
- 若我们【改变】,用户将【行为】,从而【结果】。
- 证据:【访谈/数据/实验】
- 不做的代价:【】
## 为什么用 AI
- 规则/搜索/人工/传统 ML 基线:【】
- AI 的不可替代增量:【】
- 主要不确定性:【】
## 范围
- 做:【】
- 不做:【】
- 自主性:建议/草稿/确认后执行/有限自治
## 成功与停止
- 北极星与目标:【】
- 质量/风险/成本底线:【】
- 停止条件:【】
- 下一最小实验、负责人、日期:【】
02 用户访谈提纲
# 访谈记录
研究问题:【】 受访者角色/分群:【】 日期:【】 研究者:【】
同意与数据处理:【已说明/取得】
## 行为回放
1. 上一次【任务】何时发生?请从触发开始逐步演示。
2. 每一步使用什么、找谁、等多久、怎样判断完成?
3. 哪里最费时/易错/焦虑?最近的失败是什么?
4. 错误怎样发现、由谁承担、如何补救?
5. 现在的替代方案为何仍被使用?
## AI 协作
- 哪一步愿意获得建议、草稿或自动执行?为什么?
- 什么证据会让你采纳?什么情况必须人工确认?
- 需要怎样纠错、撤销、申诉和退出?
- 哪些数据绝不愿提供?
## 证据
- 原话/行为:【】
- 痛点频率/强度:【】
- 观察到的变通行为:【】
- 研究者解释(与事实分开):【】
- 反证/意外发现:【】
- 待验证问题:【】
03 AI 场景机会评分卡
每项 1–5 分,必须附证据。
| 项 | 分 | 证据/假设 |
|---|---|---|
| 痛点强度 | 【】 | 【】 |
| 频率/规模 | 【】 | 【】 |
| 用户价值 | 【】 | 【】 |
| 业务价值 | 【】 | 【】 |
| AI 相对基线增量 | 【】 | 【】 |
| 数据可得/合法/代表 | 【】 | 【】 |
| 可评测性/反馈速度 | 【】 | 【】 |
| 采用与流程适配 | 【】 | 【】 |
| 错误可逆/可发现 | 【】 | 【】 |
| 技术/集成复杂度(反向) | 【】 | 【】 |
| 安全合规风险(反向) | 【】 | 【】 |
| 单位经济(正向) | 【】 | 【】 |
结论:探索 / 保留 / 停止。最大致命假设:【】。最小验证:【】。
04 商业论证
# 【项目】商业论证
## 目标与基线
业务结果:【】 当前量/时长/成功/成本/损失:【】
## 方案
候选 A 不做/现状:【】
候选 B 规则/流程:【】
候选 C AI:【】
## 3 年情景
| 项 | 保底 | 目标 | 峰值/悲观 |
|---|---:|---:|---:|
| 用户/任务量 | | | |
| 成功任务率 | | | |
| 每成功任务价值 | | | |
| 构建成本 | | | |
| 运行成本 | | | |
| 人工复核/返工 | | | |
| 风险/迁移/退出 | | | |
| 净价值/回收期 | | | |
关键假设与敏感性:【】
不可量化战略价值:【】
最大下行风险与控制:【】
投资建议与下一阶段预算:【】
05 AI PRD
# 【功能】AI PRD
版本:【】 Owner:【】 评审人:【】
## 1 背景、用户问题与现状基线
【用户/JTBD/真实案例/量/时长/错误/成本】
## 2 目标、非目标与成功指标
- 产品目标:【】
- 非目标:【】
- 北极星/领先/护栏:【】
- 质量、风险、成本停止线:【】
## 3 用户、场景与流程
- 目标/非目标用户:【】
- 主流程、异常、拒答、取消、撤销、申诉:【】
- AI 自主性与人工责任:【】
## 4 为何 AI 与基线
规则/搜索/人工/传统 ML/不做的比较:【】
## 5 功能需求
| ID | 用户故事/规则 | 优先级 | 验收 |
|---|---|---|---|
## 6 AI 输入输出契约
输入来源/Schema/语言/长度/敏感性:【】
输出 Schema/引用/状态/禁止内容:【】
工具、权限、确认、幂等/补偿:【】
## 7 数据与知识
来源/权利/质量/标注/更新/ACL/保留/删除:【】
## 8 技术方案
模型/Prompt/RAG/微调/工具/规则/路由/降级:【】
版本与复现指纹:【】
## 9 评测
黄金集/切片/Rubric/基线/阈值/人评/红队:【】
## 10 AI UX
能力告知/来源/不确定/纠错/确认/撤销/人工接管/记忆控制:【】
## 11 安全合规
风险等级、适用义务、隐私、版权、威胁、标识、审计:【】
## 12 非功能与运营
SLO/容量/成本/监控/告警/回滚/Runbook/支持:【】
## 13 发布
影子/灰度/放量/停止/回滚条件:【】
## 14 依赖、风险、开放问题、决策日志
【责任人 + 截止日】
06 评测计划
# 【系统/版本】评测计划
评测问题:【是否足以做哪个决定】
候选与版本指纹:【】
## 任务与 Rubric
| 任务 | 维度 | 0/1/2/3 锚点 | 权重 | 硬门槛 |
|---|---|---|---:|---|
## 数据集
来源/授权/时间/去重/污染防护:【】
样本量与分层:任务【】用户【】语言【】风险【】难度【】
开发集/测试集/holdout/红队集:【】
## 评分
确定性检查:【】
人评:人数【】盲评【】一致性【】仲裁【】
LLM Judge:模型/Prompt【】人工校准【】偏差检查【】
## 指标与门槛
质量/拒答/关键失败/延迟/成本/安全:【】
置信区间、配对方法和停止规则:【】
## 输出
总体 + 切片 + 错误分类 + 代表样本 + 限制 + 建议决定。
07 黄金集记录格式
建议 JSONL/表格字段:
{"case_id":"","task":"","user_segment":"","language":"zh-CN","risk":"high","input":"","context_refs":[],"expected":"","acceptable_variants":[],"must_include":[],"must_not_include":[],"should_refuse":false,"expected_tool_calls":[],"rubric_version":"","source":"real|expert|synthetic|incident","created_at":"","reviewers":[],"notes":""}
另建不可泄漏的 holdout;个人信息去标识;事故样本标严重度;任何标签变更保留历史。
08 模型与供应商选型评分卡
| 维度 | 权重/门槛 | 候选 A | 候选 B | 证据 |
|---|---|---|---|---|
| 核心任务质量 | 【】 | |||
| 关键切片/拒答 | 门槛 | |||
| 安全/隐私/合规 | 门槛 | |||
| P50/P95/吞吐/SLA | 【】 | |||
| 每成功任务成本/3 年 TCO | 【】 | |||
| 版本/日志/可控/回滚 | 【】 | |||
| 区域/数据/子处理者 | 门槛 | |||
| 集成/支持/路线图 | 【】 | |||
| 锁定/迁移/退出 | 【】 |
结论:【】;不选其他候选原因:【】;复核触发:【】。
09 架构决策记录 ADR
# ADR-【编号】 【标题】
状态:Proposed/Accepted/Superseded 日期:【】 决策人:【】
## 背景与约束
【】
## 候选
1. 【方案/优点/缺点/证据】
2. 【】
3. 不做/延后:【】
## 决定与理由
【】
## 影响
质量【】成本【】安全【】运营【】锁定【】
## 风险与缓解
【】
## 复核触发
【时间/流量/事故/法规/供应商变化】
10 模型卡与数据卡
模型/系统卡
名称/版本/Owner/日期:【】
目的与适用/禁用场景:【】
组成:模型、Prompt、RAG、工具、规则:【】
训练/适配数据概况:【】
评测:数据、总体、切片、安全、延迟、成本:【】
已知限制与失败模式:【】
公平/隐私/版权/安全考虑:【】
人类监督、告知、申诉:【】
部署、监控、回滚、退役:【】
数据卡
数据集/版本/Owner/许可证:【】
目的与禁止用途:【】
来源/采集时间/授权链:【】
组成/规模/分群/缺失:【】
清洗/去标识/标注/一致性:【】
敏感属性/偏差/代表性/已知限制:【】
访问/保留/删除/跨境/下游:【】
质量指标与更新记录:【】
11 AI 项目章程
# 【项目】章程
Sponsor:【】 产品负责人:【】 项目经理:【】 技术负责人:【】
## 目的与成功
业务目标/基线/目标/停止线:【】
## 范围
内:【】 外:【】 阶段:探索/PoC/试点/产品化/规模化
## 交付与里程碑
【阶段门、日期、证据】
## 资源与预算
【人员/数据/模型/供应商/储备】
## 约束、假设、依赖与 Top 风险
【】
## 治理
RACI【】决策权【】变更阈值【】升级【】Stop-the-line【】
## 验收、运营归属与关闭标准
【】
批准:Sponsor【】日期【】
12 WBS 与里程碑计划
| WBS | 交付物/工作包 | Owner | 前置依赖 | O/M/P | 目标日 | 验收证据 | 状态 |
|---|
AI 必查包:数据授权/标注、基线、黄金集、PoC、AI UX、红队/隐私、压测/成本、监控/回滚、培训/移交。
里程碑格式:【日期】达成【证据事件】,通过条件【】,批准人【】。
13 RACI
| 产物/决定 | Sponsor | AI PM | 项目经理 | 算法 | 工程 | SME | 安全/法务 | 运营 |
|---|
规则:每行一个 A;R 至少一个;C 必须在决定前;I 在决定后;空白即无责任。
14 RAID 台账
| ID | 类别 R/A/I/D | 描述 | 触发/证据 | 概率 | 影响 | Owner | 缓解 | 应急 | 日期 | 状态 |
|---|
每周关闭失效项、验证假设、升级逾期项;只写“关注”视为无措施。
15 实验卡
# EXP-【编号】 【标题】
假设:若【】,则【指标】相对【基线】从【】到【】,因为【】。
要做的决定:【】
最小方法与候选版本:【】
数据/样本/切片/授权:【】
主指标/护栏/阈值/停止规则:【】
时间盒/预算/Owner:【】
结果(含不确定性和失败样本):【】
结论:支持/不支持/不确定
决定:继续/调整/停止;新假设:【】
16 变更请求
# CR-【编号】 【变更】
请求人/日期/原因:【】
现状与拟变更:【】
影响:范围【】日期【】成本【】质量【】安全合规【】运营【】
模型/Prompt/数据/索引/工具版本影响:【】
选项:拒绝【】替换【】延后【】增资【】改期【】
建议:【】 决策人/决定/日期:【】
实施、验证、沟通、回滚:【】
更新的基线/文档:【】
17 项目周报
# 【项目】周报 YYYY-MM-DD
总体:绿/黄/红(理由与数据)
## 本周结果/证据
- 【不是活动列表】
## 基线偏差
范围【】进度【】成本【】质量【】风险【】
## Top RAID
| 项 | 趋势 | 行动/Owner/日期 |
## 下周里程碑
- 【】
## 需决策
【问题】建议【】最晚【】否则影响【】
18 AI 风险评估
# 【系统】AI 风险评估
目的/用户/受影响者/地区/行业:【】
自主性/关键决策/可逆性/人工监督:【】
数据与供应商流:【】
适用义务与风险等级:【】
| 风险情景(不是抽象名词) | 受影响者 | 固有概率/影响 | 预防 | 检测 | 响应/补救 | 证据 | 残余风险 | Owner |
|---|---|---|---|---|---|---|---|---|
覆盖:质量、隐私、安全、公平、透明、内容、版权、人类自主、运营、环境。
例外/接受人/到期复核:【】
重大变更触发:【】
19 AI 威胁模型
# 【系统】威胁模型
架构/信任边界/数据流:【链接】
资产:【数据/秘密/模型/工具/预算/声誉】
攻击者与能力:【外部用户/内部/供应链/内容提供者】
入口:【输入/文档/网页/工具/API/日志/模型】
| ID | 攻击路径 | 前置条件 | 影响 | 预防 | 检测/响应 | 测试用例 | 状态 |
|---|---|---|---|---|---|---|---|
必测:直接/间接注入、越狱、泄漏、跨租户、工具越权、投毒、资源耗尽、输出注入、依赖供应链。
20 AI 供应商尽调
供应商/服务/Owner/日期:【】
1. 数据:输入输出/反馈是否训练?保留、区域、删除、子处理者?
2. 安全:认证、隔离、加密、密钥、漏洞、渗透、事故通知?
3. 模型:卡片、已知限制、版本锁定、变更/弃用、回退?
4. 合规/IP:许可、训练数据、版权、隐私、审计、行业要求?
5. 运行:SLA、速率、峰值、灾备、支持、状态与 RCA?
6. 商业:计价、失败/缓存计费、涨价、三年 TCO、最低承诺?
7. 退出:导出、删除证明、迁移协助、替代接口、终止费用?
8. PoC:同一数据/评分卡/人工干预披露/删除期限?
未解决红旗:【】 风险接受人:【】 建议:【】
21 验收计划
| ID | 需求/风险 | 测试环境与版本 | 数据/步骤 | 通过阈值 | 责任人 | 证据 | 结果 |
|---|
覆盖:范围、AI 质量切片、红队/隐私、性能/SLO、成本、权限/审计、故障/回滚、文档/培训/运营。写明 P0/P1/P2、整改时限、复验、条件验收和拒收权。
22 Go/No-Go 决策单
# 【版本】发布决策
范围/流量/用户/区域/自主性:【】
证据链接:评测【】红队【】UAT【】压测【】合规【】
质量/性能/成本/风险门槛结果:【】
未关闭问题与残余风险:【】
灰度、监控、告警、回滚、人工接管:【】
培训/支持/用户告知:【】
建议:Go / Conditional Go / No-Go
条件与到期:【】
签字:业务【】产品【】项目【】技术【】安全/法务【】运营【】
23 运行手册 Runbook
# 【服务】Runbook
Owner/值班/升级/供应商联系人:【】
架构、依赖、仪表盘、日志、版本注册表:【】
SLO/告警/错误预算/质量预算/成本预算:【】
## 常见事件
| 告警/症状 | 判断 | 立即动作 | 验证 | 升级 | 恢复 |
## 降级阶梯
关闭增强 → 限制输出/工具 → 备用模型/区域 → 搜索/规则 → 人工/暂停。
## 回滚
模型【】Prompt【】索引【】工具/规则【】数据【】
## 安全/隐私事故
止损、证据保护、通知、凭证撤销、用户补救:【】
## 恢复后
回归/灰度/沟通/复盘/评测集更新:【】
24 AI 事故报告
# INC-【编号】 【标题】
级别:【】 状态:【】 指挥者:【】
检测/开始/控制/恢复时间:【】
影响用户/数据/地区/时长/损失:【】
当前是否仍发生:【】
时间线(只写事实):【】
立即控制:【功能开关/撤权/回滚/通知】
根因:技术【】流程【】组织【】控制为何失效【】
通知:内部/用户/客户/供应商/监管/执法【】
修复与恢复验证:【】
行动项(Owner/日期/证据):【】
经验加入哪些回归/红队/培训:【】
25 复盘
# 【项目/里程碑】复盘
目标与结果(目标值/实际/证据):【】
原始假设:支持【】证伪【】仍未知【】
时间线与关键决定:【】
做得好:【机制和证据,不只夸人】
未达预期:【事实和影响】
根因:目标/数据/模型/体验/工程/项目/组织/外部【】
若重做:保留【】停止【】开始【】
行动项:具体结果/Owner/日期/验证/优先级【】
需更新的标准、模板、评测集和路线图:【】
26 路线图与组合管理
路线图按结果主题,不按功能清单:
| 主题/场景 | 目标用户结果 | 当前证据 | 阶段 | 下一风险假设 | 里程碑/门槛 | 资源 | 决策日 |
|---|
组合季度评审:
Invest:价值已证实,扩大能力/流量。Explore:用有限预算验证最大假设。Hold:依赖或时机未到,明确复核条件。Stop:证据不支持,回收资源和知识。
路线图同时展示平台能力(评测、知识、身份、治理)与场景产品,防每个团队重复造轮子。
27 AI 影响评估
用途/非用途【】法域/行业【】系统/数据/模型版本【】Owner【】专业复核【】
| 受影响者 | 影响路径/情景 | 严重度/条件 | 替代方案 | 控制与验证 | 残余影响 | 接受人/日期 |
|---|---|---|---|---|---|---|
| 【个人/群体】 | 【正常及失效时】 | 【】 | 【含不采用AI】 | 【证据链接】 | 【】 | 【】 |
个人信息、机会分配、心理、人身、财务、社会与环境影响:【】 复核触发:用途/地区/人群/自主性/数据/供应商变化、放量、事故、退役:【】 结论与未决项:【】;参考 影响评估实践。
28 Agent 动作与委托契约
任务ID【】用户/租户【】Agent身份【】凭证受众/范围/期限【】目标【】
| 资源 | 动作 | 条件/限额 | 需要确认 | 幂等键 | 完成凭据 | 撤销/补偿 |
|---|---|---|---|---|---|---|
| 【】 | 【读/草拟/提交/发送】 | 【金额/时间/数据】 | 【谁看到什么】 | 【】 | 【环境回读】 | 【】 |
委托链与授权来源【】工具/协议/SDK版本【】跨代理消息验证【】 步骤/时间/Token/金额/重试总预算【】无进展停止【】撤权传播【】人工接管【】 工具变更、注入、并发、部分失败和恢复测试证据【】。
29 评分器卡与风险测试追踪
评测决定【】样本总体/独立单位【】分层/权重【】集合/数据卡版本【】 评分器类型/模型/Prompt版本【】人工参考/校准集【】分歧/仲裁【】严重错误漏报【】 样本量依据、重复次数、区间/检验、比较预算及污染隔离【】
| 风险ID | 需求ID | 测试ID | 环境/初态 | 成功/终态断言 | 结果/证据 | 独立复核 | 重测触发 |
|---|---|---|---|---|---|---|---|
| 【】 | 【】 | 【】 | 【】 | 【】 | 【待测】 | 【】 | 【】 |
总体与关键切片、延迟/成本、无效样本、严重失败及限制【】 Go/No-Go、残余风险及接受人【】。方法见 统计评测。
30 透明标识与用户控制
适用法域/条款/生效日【】价值链角色【】专业复核【】
| 对象/环节 | 应披露内容/标识 | 实施方式 | 验证样本 | Owner | 结论 |
|---|---|---|---|---|---|
| 用户交互 | 【AI身份/能力/限制】 | 【】 | 【】 | 【】 | 【】 |
| 生成/展示 | 【按模态与法域】 | 【】 | 【】 | 【】 | 【】 |
| 下载/复制/导出 | 【显式/隐式/元数据】 | 【】 | 【】 | 【】 | 【】 |
| 受影响人 | 【纠错/申诉/人工复核】 | 【】 | 【】 | 【】 | 【】 |
确认、取消、退出、删除和投诉路径【】;人工监督者的信息、时间和干预权限【】。
31 退役与退出计划
退出原因/触发【】服务Owner【】目标日期【】依赖/消费者【】用户通知【】
| 步骤 | 动作 | Owner | 可验证证据 | 恢复/保留边界 |
|---|---|---|---|---|
| 停新任务 | 【入口和调度】 | 【】 | 【新请求探针】 | 【】 |
| 在途收尾 | 【完成/取消/人工】 | 【】 | 【任务和回执】 | 【】 |
| 权限撤销 | 【凭证/委托/缓存】 | 【】 | 【撤权探针】 | 【】 |
| 数据处置 | 【原文/向量/导出/日志/备份】 | 【】 | 【删除传播与保留】 | 【】 |
| 供应商退出 | 【导出/合同/删除证明】 | 【】 | 【回读与迁移演练】 | 【】 |
| 关闭验收 | 【业务/风险/费用】 | 【】 | 【批准与归档】 | 【】 |
已确认保留记录、依据和期限【】;未完成项及责任【】。