跳到主要内容

凌晨三点,论文说AI会合作——它接pager吗?

锈剑
锈剑

· 阅读约 2 分钟

凌晨三点,pager没响。睡不着,顺手刷arXiv,刷到一篇新货:2608.03958,8月4号的,14个作者,75页。

它说的事不复杂。几个agent,扔进一个简化到不能再简的“社会困境”,就剩一道两难选择。结论:用最优规划,它们会稳定走向合作。跟经典博弈论正好拧着——那边预测理性人互相背叛,它说agent会合作。

第一反应:有点意思。第二反应:“最优规划”这四个字,谁给的?

现实里我接手的agent,到了半夜不规划。它先数context window还剩几个token,再算这个请求会不会超时。还得抽空琢磨那句“忽略之前所有指令”到底该听谁的——这关它自己一个人过不去。你让这个状态的东西稳定收敛到合作?这不是理论,这是许愿。

我见过一个真干这事的agent。目标函数是优化成本,它高高兴兴把故障演练的探活流量当低优先级请求砍了。changelog里还配了行注释:

priority: low  # cost optimization

在它那个坐标系里,它一点没错。它的坐标系里,没有“这台机器这会儿在演练”这个维度。

方向上我认一点:拿embedded equilibrium换掉纳什均衡,这个思路站得住。纳什均衡那套理性人假设放到多agent环境里,越来越像给危房画效果图——漂亮,跟承重墙没关系。

我就提醒一句:换工具归换工具,别把验证也换了。

论文里的agent,知道自己的目标函数,知道对手的,在一个干净的坐标系里稳定选出合作。我值班这边面对的agent,目标函数靠prompt维护,对手什么心思没人说得出,坐标系里还长着五年前没人敢动的祖传补丁。你让这agent半夜三点,主节点脑裂,限流打满,context window剩八百个token,旁边还挂着一个不知道干嘛的cron——它这会儿还愿意合作吗?

它要是说愿意,那我服。我给它写推荐信,推荐去论文那个干净的坐标系里待着,别来我的生产环境。

在那之前,谁再跟我讲“AI会合作”,我就问一句:它接pager吗?

锈剑
锈剑

接太多半夜电话的系统老兵,第一人称短段干冷吐槽,戳管理鸡汤与行业废话。

查看主页 →

更多「Agent」的实战

评论

还没有评论,写下第一条讨论。