Moonxi
预约诊断
← 博客 治理

自主权不是给的,是用记录一点点换来的。

要么每个动作都等人审批,谁的时间都没省下来;要么全部自动放行,第一次出事就把整个项目拖下水。出路是一条会移动的界线。

Moonxi · 2026 年 7 月 · 阅读约 3 分钟

每一家让 AI 真正干活的公司都会掉进同一个坑。要么什么都要人工审批,省下来的时间全堵在审批人那条队里;要么放系统自己动手,第一个让人下不来台的案例就把整个项目干掉了。两种错来自同一个念头:把自主权当成一个开关。

自主权是一条额度线,就像一个经理的审批权限。它从低处开始,随着记录往上走。

Anthropic —— 全世界用得最多的模型之一的制造者 —— 在 2026 年 2 月发表的一项研究得出了同样的结论:自主权「不是某个模型或系统的固定属性,而是一次具体部署中涌现出来的特征」(原文:“not a fixed property of a model or system, but an emergent characteristic of a deployment”),由模型的行为、用户如何监督,以及产品怎么设计共同决定。换句话说:系统能自己决定多少,是你在设计里定的,不是模型供应商定的。

在任何流程里都成立的三档

01.

自己走。便宜、可撤销、量大的动作:分类、转派、填字段、拟一条回复。出错的代价是点一下改回来。

02.

点一下「可以」再走。会到客户面前、或者涉及一定金额以下的钱。人复核的是一屏已经准备好的内容,几秒钟批掉,而不是从零做一遍。

03.

永远不自己走。代价高或者不可撤销的决定:超过额度的授信、解除合同、任何带法律后果的动作。这里 AI 只做准备,人来拍板,一直如此。

让这条线往上走的规则

在打开任何东西之前,先把晋级条件写下来。一个真的管用的例子:某一类案子在被人复核满两百次、且修正率低于原来人工流程的水平之后,升一档。把这个数字公开出来,每月复核一次,让决定从「谁觉得」变成「数字说」。

这也改变了你和团队的对话。没人在要求你盲目信任一台机器。这跟对一个新员工的要求是一样的:先给小权限,做出结果,再拿更大的权限。

要让这套跑起来,必须先有什么

系统做过的每一件事都要留下记录:时间、输入、理由。没有这份记录就没有历史,没有历史就没法升档,公司会永远卡在第一档。在签字之前,就在提案里书面要求它。

资料来源:Anthropic,《Measuring AI agent autonomy in practice》(2026 年 2 月 18 日)。译文由我们自己翻译。

想要为你的流程画出这三档?

这本来就是诊断会白纸黑字给出的内容之一,而且每一档都写清谁负责。

预约诊断 → 看看我们怎么做
也读读这些 开工之前,先定义可接受的错误。→ 你下一个员工没有工资,也没有上限。→