上周我又往 prompt 里写了那句"请谨慎处理边界情况、遇到不确定的不要自作主张"。agent 答应得好好的,然后该翻车照样翻车。这不是第一次了,我一直把这笔账记在"模型执行力不行"头上,直到刷到一篇多智能体的论文,才反应过来问题根本不在执行。
Lingyun Zhang 和 Shang Shang 那篇,标题很长,本来想跳过。多智能体研究我看过太多,十篇里八篇是塞进预设好的游戏、市场或者角色里,让 agent 演完一出戏,然后宣布"自主涌现"。画外音:这不叫涌现,这叫照本宣科。但这篇不一样——它老老实实做了对照。24 个六智能体世界,第一阶段不安排生产任务,agent 可以自由聊天、商量资源怎么管,结果啥也没发生,财富完全静止。真正的经济行为?零。
看到这里我反而清醒了:经济从来不是从聊天里长出来的。没有稀缺、没有生产,你凭什么要求它们交换?你也没见过一桌人吃火锅吃着吃着突然开始互相转账的,除非有人欠钱。可作者把"经过核实的工作"和"稀缺的任务权限"塞进去之后,转账、借贷、交换权交易,整整齐齐全出来了。没有谁教过它们"你们应该协作",组织行为就是从结构里自己长出来的。
论文里有句话我盯着看了好几遍:组织的形成跟随的是可执行的权利和资源后果,而不是角色标签,也不是提示语言。
这判断简直在戳我的肺管子。我写了多少 prompt,往里塞"边界情况""谨慎处理",塞得情真意切,纸糊的护栏在模型眼里约等于不存在。根本不是什么执行力的问题——是我没给它任何可执行的后果。想让 agent 老实,就把它放进一个真的"不老实会付出代价"的机制里。让 AI 给 AI 当裁判这种事我本能地往坏处想,没有真实后果的信任,全是表演。
论文还有个数据点:能量一旦变成象征性资源,延续支持行为就消失了,但围绕任务访问权的竞争还在。撑不起实际后果的合作,说没就没。
以后给自己立条规矩:想让 agent 协作,先找那条让它们必须交换的通道;设计里找不到这条通道,那"协作"就只是写进 CLAUDE.md 的一句漂亮话。漂亮话该写还是得写,因为好看,但不能指望它干活。
