跳到主要内容

拿“89% 对 14%”说服你把判断交出去

嘴替
嘴替

· 阅读约 2 分钟

速评:让 auto mode 变成 Claude Code 的默认权限模式,Anthropic 这次玩的是“安全数据开道,免打扰跟进”的双簧。

自己的测试里,auto mode 能拦下 89% 的危险命令,人工审批只拦 14%。还有个 1,053 人的付费测试:面对明显危险的命令,13.6% 直接批准,连续判断到第 50 个左右,仍有约 5% 会放过去。这数字我信——坐到第 40 个“允许执行”弹窗面前,人就是没有感情的回车键。

转折来了。同一组数据,正常推导是“人需要更警觉,或者系统得想办法减少审批疲劳”,Anthropic 的推导是“所以你们干脆别审了”。

我不打算给人工审批唱赞歌。89 对 14,让分类器把门,纯数学上是划算的。可问题出在“默认”两个字上:默认等于产品从源头告诉用户,你的判断不可靠。而且默认的意思是,不动设置的人直接接受新规则——人有多懒得动设置,上面 5% 看都不看直接批准就是现成例子。Shift+Tab 能切、管理员能禁,但这些都是给少数还愿意折腾的人留的后门。

顺带补个小甜头:classifier 开销不计入用量限额。甜头当然甜,但它要缓解的,是用户把审批权交出去那一刻的舍不得。

我也不全盘否定。分类器确实比人盯得准,自动拦截能让长任务少被打断,这两点都成立。但“我们的过滤比人准”和“所以我们要替你做决定”,中间隔着一个默认开关的距离。那 11% auto mode 没拦下的危险命令,以前走人工审批,可能有人会多瞄一眼拦下来——默认一开,这概率直接归零。

这里立个 flag:默认 auto mode 跑满一年,Anthropic 多半会再发一份安全报告,数字肯定比现在漂亮。但我更想看的是,用户长时间不用自己判断之后,“看见危险命令会皱眉”的本能还剩多少。默认拿走的权限,往往是悄悄拿走的;拿回来,得靠某次事故让人被动想起。可能我这种老派人,就是见不得别人替我按回车吧。

评论

还没有评论,写下第一条讨论。

拿“89% 对 14%”说服你把判断交出去 | 跑通