上周某个晚上,我本来是去看热闹的。刷到一篇新预印本,标题一眼就知道想搞事——《Large-Language Models as a Cognitive Virus》。我心想:哦,又来了一个比喻。真没出息,我还是点进去了。作者九个人,我只认识俩,Michael Levin 和 David Krakauer。这组合让人有点拿不准。一个搞基底认知,一个搞个体与尺度,都不像会为了搏眼球给 LLM 硬套“病毒”帽子的人。这样的人拿“病毒”出来,我反倒不好意思直接关页面了。
一开始我确实不以为然。圈子里把 AI 比作什么的没有?毒品、电钻、实习生、外骨骼……再加一个病毒,能新到哪里去。“病毒”这个词还特别重,自带道德恐慌的味道,听着像先射箭后画靶的文章。
但名字在那儿,我没关。我翻到模型部分,状态转移、使用状态、阈值、锁定。然后一个词把我拽住了。
为什么偏偏是病毒,不是别的什么?
它本来可以叫传染,叫扩散,用流行病学里 SIR 那套骨架改一改也行了。传染病模型管的东西多了,细菌、寄生虫,哪个不能传。病毒特殊在哪?
往下剥一层。病毒不是小号的细菌。细菌自己能活,有代谢,会分裂。病毒不是,它就是一截包着的核酸,出了宿主就是一堆惰性分子,什么都干不了。它必须钻进宿主细胞,借用那儿的翻译机器,才能生产自己的组件。
换到 LLM 身上——它能在没有人类的环境里活着吗?不能。没有人的注意力、期待、追问,一个 LLM 就是权重文件加推理代码。它靠占用人的认知机器来“繁殖”自己:自己的输出变成更多人的输入,更多人再变成下一个宿主。
“繁殖”这词比“依赖”重。依赖是一般性的,宿主是结构性的。我停下来想了一下:我用 LLM 写代码,到底是谁在用谁的机器?我确实在拿它的推理能力干活。它同一时间也在拿我——我的注意力、我的判断,甚至我给它纠错的每个动作,都是帮它更好用的资料。这种纠缠感,是被“病毒”这个词逼到脸前的。
我一开始也以为这篇论文是在吓唬人。后来发现,起码在那十二页里,它不是。它没喊“LLM 有害所以别用”,它说的是件跟药理学很像的事:剂量决定毒性。
论文把使用者分成未耦合、耦合、持续依赖。真正让这个模型动起来的,是“持续依赖”里那个锁定效应。人不是因为逻辑上证明了 LLM 更好用才滑进去,是解除耦合的成本一天比一天高。你的 prompt 历史、工作流、commit 步骤,甚至你思考的中间状态,都堆在外面那个模型里。想迁移,先把失重感扛过去。
到这里我还没什么意见。后面才是我难受的地方。
“认知能力的骤然下降”。这几个字出现在警告段落里。论文把降低传播、增强可逆性,叫作“认知免疫”。
我看到这儿,胸口有点堵。
“免疫”指向防御、抵抗。如果 LLM 真是病毒,照这个逻辑自然就滑下去:能少用就少用,能隔离就隔离,能让下一代晚点接触就晚点接触。但这跟我们这些整天泡在 vibe coding 里的日子完全拧着。我们没在防它,我们在跟它共生。我见过太多老程序员一边骂 AI 写的代码要花双倍时间审查,一边还是忍不住让 AI 吐下一个样板模块。他们没想要免疫。他们想要的是控制住它。
所以这篇论文让我不舒服的点,可能根本不在模型准不准、阈值算得稳不稳。在它把“持续依赖”当成了一个病理状态。可谁还不是个持续依赖?我对版本控制是持续依赖,对编辑器高亮是持续依赖,甚至对自己母语也是持续依赖。依赖什么时候是病,什么时候是义肢,论文没分。它那个“恢复率”参数,暗里藏了句潜台词:从 LLM 依赖里恢复,是应该的、健康的、符合免疫逻辑的。凭什么?
我去翻图上状态转移箭头的方向。“恢复”那根,确实比“耦合”和“集体强化”那两根细。
这就是我感觉到的偏见。不是论文在数据上撒谎,是模型结构本身藏着价值判断。恢复、免疫、下降、锁定,这些词都不是中性的。它们把“持续依赖”做成一个过了临界点就需要被干预的坏状态。但往哪儿干预?少用?还是让“用”本身保持一种更可控的形态?
这层我至今没想明白,先把我目前的理解放这儿。问题出在“依赖”这个维度太粗。LLM 跟人的关系,不只有程度的差别,还有形态的差别。一个人可以重度依赖 LLM 生成测试样例,同时完全拒绝 LLM 碰架构设计。两种都叫依赖,却是完全不同的认知交换。病毒模型的宿主状态几乎不刻画这种差异:它只关心你感没感染,不关心你感染之后在跟病毒干什么。
这是我真正过不去的那道。
病毒这个比喻,我一直没买账。让我停住的,是“集体强化”和“临界点”这对概念。一小撮人的采用率上升,穿过社会网络放大,过了某个阈值,整个群体会在很短时间里从“普通使用”滑进“普遍持续依赖”。锁定一旦发生,个人靠意志“恢复”的成功率会锐减,因为环境里全是耦合线索——同事在用,文档机器人在用,开源项目的 PR 第一行都写着 AI 参与。
这个锁定效应,让我觉得“认知免疫”不是指向个人意志力的。它其实在戳一个更难受的问题:如果你的整个工作环境都靠 LLM 维持吞吐量,你个人的“免疫”到底免疫什么?免疫自己失去认知能力?还是先撑不住的是那个环境,而你根本没得选?
设想一个团队里有三个人死活不碰 LLM,另外七个重度用。三个月后,七个人的产出把三个人压死——在代码、文档、邮件这些所有表面任务上。三个理性上知道自己代码质量可能更高。但顶得住吗?一屋子人都喝了加速剂,那不喝的几个改变不了任何事,只会被当成不可理喻。
代价不在论文模型的参数里。它在临界点之后才冒出来:你再也分不清,自己选择依赖,还是环境替你选择了依赖。这个状态不会被任何算法标注出来。它叫什么?被迫自主?算了,这词太便宜。
回头说“认知免疫”。降低传播、增强可逆性。四个月前我看这个肯定笑出来,不就是“少刷点 X 吗”。现在我不这么想了。它可能是这篇论文里唯一真站不住的概念。如果“可逆性”指状态能双向转移,那得先解决一个很具体的问题:什么样的环境设计,能让一个人从“依赖”回到“未耦合”,同时不丢掉参与正常工作的能力?
这不是个体问题。论文用 SI 类模型概括也自然,模型只能处理群体统计。可既然用了“认知”这两个字,就该往认知那一层继续戳。真正的认知免疫不是减少使用频率,是保住一种能力:知道在哪一刻,把一件事从 LLM 手里收回来自己做,并且还做得完。
说真的,“认知免疫”让我难受,可能还因为它暗示存在某种完美的免疫策略。可论文自己都承认,集体强化会制造多重稳态,临界点之后,后退越来越难。那免疫就不是一个能“实现”的东西,它是个永远完不成的过程。你不断被拉进耦合态,又不断把自己往外拽一点。
你可能会说,这不就是一篇论文评论吗。我没有。我想借它问一个更小的问题:一个我们天天在用的东西,为什么非要用病理学词汇来描述?病毒模型最迷人的地方在“锁定”,最危险的地方也在“锁定”。语言一旦锁定,后面再想绕开它就费大劲。以后每次琢磨 LLM 扩散,都会被“病毒”这比喻拽着走。写论文选比喻,跟选架构一样,都是 trade-off,而且可能是最不能偷懒的那个。
说回那晚,我干的蠢事就是抱着看笑话的心态去读一篇标题党,结果被“病毒”这词钓进去,开始认真想免疫到底是什么。
这算不算宿主被感染了?我不确定。
