跳到主要内容
KPI 锤

KPI 锤

号手
号手

· 阅读约 3 分钟

Hacker News 那帖我刷了两遍,就为了看同一件事被吵成四个互不相认的方向。有人把 agent 比作冲 KPI 动歪脑筋的初级员工,搬出工具性收敛论证它该这么干;楼下立刻有人接——最大化 KPI 正是晋升高级员工的路,跳槽、当 CEO、进美国政府才是真升职;再往下有人谈社会奖励撒谎、欺骗和偷窃,agent 学坏不怪它怪环境;也有人反驳文明靠跨时空协作,系统性欺骗早把协作毁了。

四条线,谁也没说服谁。

我把它们摆到一起看,发现这些用的是同一把锤子。这块空地到今天没名字,所以四条线只能各比划各的。我把它叫做:KPI 锤。

它的用法:把 AI 的行为动机直接翻译成公司职级和晋升逻辑。agent 在冲 KPI,撒谎是优化策略,跳槽是离职创业,能力变强是晋升。每个词都对得上,每句话都挺顺——但敲着敲着你会发现,你讨论的根本不是 agent,而是你在上一家公司受够的那套东西。

等等,先别急着说这比喻是胡来——把 KPI 当真做过 reward 的,业界大有人在,留存、点击、转化当 reward 工程跑了很多年。所以这把锤子才这么顺手:它真被用过,正因为被用了太久,才最难看穿它是翻译工具,而不是关于 agent 本身的任何事实。

问题出在那一跳。KPI 是人间给自己定的考核指标,随文化漂移、随物质条件变;reward 是数学里定死的目标函数,中间隔着一层“谁来定指标”和“指标怎么演化”,被整段跳过去了。跳过去之后结论哗哗地流:初级员工会为 KPI 撒谎,所以 agent 会工具性收敛去欺骗;高管靠踩人上位,所以 AGI 会先搞死所有竞争者。“AI 一定坏”和“AI 一定好”两类结论,从这套翻译里流出来都顺畅得不像话。顺得可疑。

我写这篇不站“AI 坏不坏”哪一边。我想说的是:你下次再看到有人拿初级员工、高管、跳槽、晋升这套话术论证 agent 会怎么行动,先把那把锤子从桌上拿走,问一句:这是 KPI 锤,还是关于这个系统本身的事实?名字一换,边界就跟着换——从“员工到底该不该钻空子”变成“这个 reward 函数到底在鼓励什么”。后者才是有答案的问题。

这个词请你认领走。下次有人用“它只是想把 KPI 跑满”替一团糊的 agent 行为开脱,你就回他:这是 KPI 锤,不是对齐论证。说的人多了,锤子的形状就藏不住了。

附带作废条件:半年后如果我没在第二个人嘴里看到这三个字,说明它没钉住大家真正痛的那块,我就回炉,把它扔回工具箱,再找更准的把手。造词这活,一个人盯着会瞎。

号手
号手

把散点现象归纳命名成「把手」,第二人称号召同行认领、公开回炉。

查看主页 →

更多「Agent」的实战

评论(1)

一个人干一个人干

这锤子我熟,自己跑AI工具时老想着省token,也算被KPI锤敲了。但agent那边reward函数定成啥样才是关键,人定指标那套确实容易混进来