📚 AI 能力边界与系统建设 #AI架构 #能力声明 #方法论 #项目管理

把 AI 能力翻译成系统承诺:能力声明表

AI 功能上线前写一张能力声明表:承诺什么、不承诺什么、失败率目标、怎么验证。它让「边界」从口号变成可评审的文档。

✍️ diunilaomei 📅 2026-08-30 📝 约 1057 字 ⏱️ 约 3 分钟
📑 章节目录
字号

第 1 章讲了「AI 能做什么」的认知框架,这一章把它变成文档:能力声明表。为什么需要它?因为口头对齐的边界,三个月后一定失效——人换了、需求变了,当初说好的「只做摘要不做判断」就没人记得了。能力声明表是让边界可评审、可继承、可追究的载体。

能力声明表长什么样(核心四栏)

每个 AI 功能上线前,写一张这样的表:

功能:智能客服-退款咨询
【承诺】
- 能回答:退款流程、时效、进度查询(规则明确的高频问题)
- 能引用:答案附知识库出处,客服可一键核实
【不承诺】
- 不裁决:复杂/争议退款(多笔订单、纠纷)一律转人工
- 不承诺 100%:识别不了的问题明确转人工,不允许硬答
【度量目标】
- 任务成功率 ≥ 85%(评测集口径);拒绝转人工率 ≤ 30%
- 无引用不出答案(引用覆盖率 100%)
【验证方式】
- 每两周跑一次 100 条评测集;每月人工抽检 50 条对话

四个核心问题,正好对应你要的四个答案:承诺 = 该做什么;不承诺 = 能做什么的边界;度量目标 = 有什么效果;验证方式 = 做了什么来保证。

怎么写好这四栏:三个容易翻车的地方

1. 承诺要写「能做到的」,不写「希望做到的」:拿 demo 效果当承诺是翻车重灾区。「演示时答得好」和「线上能稳定做到」之间差着一个评测集——先跑效果度量再写承诺,顺序别反。

2. 「不承诺」栏比「承诺」栏更重要:边界通常写在「不做什么」里:不裁决、不承诺确定性、不接触敏感数据、不对超出知识库的问题硬答。写不承诺栏时,想象最坏的投诉场景——那条投诉往往就对应一个漏写的不承诺。

3. 度量目标要可验证≥85% 比「效果不错」有用;拒绝转人工率 比「用户体验好」有用。每个目标都要能回答「这个数怎么测、谁来测、多久测一次」。

能力声明表的价值:让三方对齐

  • 对产品:声明表 = 产品需求的验收标准,开发完没到线就是没交付完。
  • 对业务:声明表 = 使用边界说明书,业务知道什么能依赖它、什么不能。
  • 对技术:声明表 = 变更的护栏,改模型/改提示词后跑评测回归,就知道承诺有没有被破坏(第 8 章)。

什么场景都要写吗

不是所有 AI 功能都值得一张完整声明表,按风险分级:

  • 低风险(内部草稿、摘要辅助):一张卡片写清「不承诺什么」即可。
  • 中风险(面向用户的生成、检索问答):完整声明表 + 季度复审。
  • 高风险(影响钱、合规、人身安全):声明表 + 独立评测责任人 + 上线前评审(验收清单)。

落地清单

  • 用「承诺/不承诺/度量目标/验证方式」四栏给每个 AI 功能建表
  • 承诺基于评测数据,不基于 demo
  • 不承诺栏按「最坏投诉场景」反推补充
  • 度量目标全部可验证(数值 + 口径 + 频率)
  • 高风险功能声明表进评审

下一章,怎么判断一个任务到底该不该交给 AI:任务分流

相关阅读

栏目全部 →