第 1 章讲了「AI 能做什么」的认知框架,这一章把它变成文档:能力声明表。为什么需要它?因为口头对齐的边界,三个月后一定失效——人换了、需求变了,当初说好的「只做摘要不做判断」就没人记得了。能力声明表是让边界可评审、可继承、可追究的载体。
能力声明表长什么样(核心四栏)
每个 AI 功能上线前,写一张这样的表:
功能:智能客服-退款咨询
【承诺】
- 能回答:退款流程、时效、进度查询(规则明确的高频问题)
- 能引用:答案附知识库出处,客服可一键核实
【不承诺】
- 不裁决:复杂/争议退款(多笔订单、纠纷)一律转人工
- 不承诺 100%:识别不了的问题明确转人工,不允许硬答
【度量目标】
- 任务成功率 ≥ 85%(评测集口径);拒绝转人工率 ≤ 30%
- 无引用不出答案(引用覆盖率 100%)
【验证方式】
- 每两周跑一次 100 条评测集;每月人工抽检 50 条对话
四个核心问题,正好对应你要的四个答案:承诺 = 该做什么;不承诺 = 能做什么的边界;度量目标 = 有什么效果;验证方式 = 做了什么来保证。
怎么写好这四栏:三个容易翻车的地方
1. 承诺要写「能做到的」,不写「希望做到的」:拿 demo 效果当承诺是翻车重灾区。「演示时答得好」和「线上能稳定做到」之间差着一个评测集——先跑效果度量再写承诺,顺序别反。
2. 「不承诺」栏比「承诺」栏更重要:边界通常写在「不做什么」里:不裁决、不承诺确定性、不接触敏感数据、不对超出知识库的问题硬答。写不承诺栏时,想象最坏的投诉场景——那条投诉往往就对应一个漏写的不承诺。
3. 度量目标要可验证:≥85% 比「效果不错」有用;拒绝转人工率 比「用户体验好」有用。每个目标都要能回答「这个数怎么测、谁来测、多久测一次」。
能力声明表的价值:让三方对齐
- 对产品:声明表 = 产品需求的验收标准,开发完没到线就是没交付完。
- 对业务:声明表 = 使用边界说明书,业务知道什么能依赖它、什么不能。
- 对技术:声明表 = 变更的护栏,改模型/改提示词后跑评测回归,就知道承诺有没有被破坏(第 8 章)。
什么场景都要写吗
不是所有 AI 功能都值得一张完整声明表,按风险分级:
- 低风险(内部草稿、摘要辅助):一张卡片写清「不承诺什么」即可。
- 中风险(面向用户的生成、检索问答):完整声明表 + 季度复审。
- 高风险(影响钱、合规、人身安全):声明表 + 独立评测责任人 + 上线前评审(验收清单)。
落地清单
- 用「承诺/不承诺/度量目标/验证方式」四栏给每个 AI 功能建表
- 承诺基于评测数据,不基于 demo
- 不承诺栏按「最坏投诉场景」反推补充
- 度量目标全部可验证(数值 + 口径 + 频率)
- 高风险功能声明表进评审
下一章,怎么判断一个任务到底该不该交给 AI:任务分流。