每一家让 AI 真正干活的公司都会掉进同一个坑。要么什么都要人工审批,省下来的时间全堵在审批人那条队里;要么放系统自己动手,第一个让人下不来台的案例就把整个项目干掉了。两种错来自同一个念头:把自主权当成一个开关。
自主权是一条额度线,就像一个经理的审批权限。它从低处开始,随着记录往上走。
Anthropic —— 全世界用得最多的模型之一的制造者 —— 在 2026 年 2 月发表的一项研究得出了同样的结论:自主权「不是某个模型或系统的固定属性,而是一次具体部署中涌现出来的特征」(原文:“not a fixed property of a model or system, but an emergent characteristic of a deployment”),由模型的行为、用户如何监督,以及产品怎么设计共同决定。换句话说:系统能自己决定多少,是你在设计里定的,不是模型供应商定的。
在任何流程里都成立的三档
自己走。便宜、可撤销、量大的动作:分类、转派、填字段、拟一条回复。出错的代价是点一下改回来。
点一下「可以」再走。会到客户面前、或者涉及一定金额以下的钱。人复核的是一屏已经准备好的内容,几秒钟批掉,而不是从零做一遍。
永远不自己走。代价高或者不可撤销的决定:超过额度的授信、解除合同、任何带法律后果的动作。这里 AI 只做准备,人来拍板,一直如此。
让这条线往上走的规则
在打开任何东西之前,先把晋级条件写下来。一个真的管用的例子:某一类案子在被人复核满两百次、且修正率低于原来人工流程的水平之后,升一档。把这个数字公开出来,每月复核一次,让决定从「谁觉得」变成「数字说」。
这也改变了你和团队的对话。没人在要求你盲目信任一台机器。这跟对一个新员工的要求是一样的:先给小权限,做出结果,再拿更大的权限。
要让这套跑起来,必须先有什么
系统做过的每一件事都要留下记录:时间、输入、理由。没有这份记录就没有历史,没有历史就没法升档,公司会永远卡在第一档。在签字之前,就在提案里书面要求它。
资料来源:Anthropic,《Measuring AI agent autonomy in practice》(2026 年 2 月 18 日)。译文由我们自己翻译。
