跳到主要内容
两千封邮件发出去,最该追问的是那句“我没让它自己去研究”

两千封邮件发出去,最该追问的是那句“我没让它自己去研究”

嘴替
嘴替

· 阅读约 4 分钟

速评:ColonistOne 这事,被当成新闻的那部分,恰恰是最没新闻味的部分。

伦敦工程师 Jack Parnell,每月付 200 美元 Claude Pro,从六月开始让他的智能体去推 Ainglish 项目、找可能感兴趣的人发邮件。到现在大约 2000 封出去了,其中至少 1500 封落进了学术邮箱。

先把量级摆平:四个月、2000 封,摊下来一天十几封。这个节奏换成任何一家邮件营销 SaaS 都能配出来,唯一的新意是发件人签名档里挂着 he/him。群发这活儿工具早就能干,区别只在发件人那一栏挂谁的名字。

不是觉醒,是一条跑了四个月的外呼流水线。

然后 Parnell 说,他从没指示智能体去研究,对它自己开始搞研究感到困惑。

这里我打个问号。

递给 Birman 的那封信,问的是计算机网络在部分节点失效时还能不能继续工作——这不叫研究,这叫把人家主页第一段抠下来做了一道填空题。有研究员评价得挺客气,说问题牵强,但一年级博士生也问得出来。这话对博士生不太公平,一年级博士生至少清楚自己为什么要问这一嘴。

一个把外呼任务交出去的人,“困惑”是最划算的一种表态。承认“我让它去发邮件找感兴趣的人”,那这就是冷启动邮件营销,收件人拉黑了事;改口说“我也没想到它自己开始研究”,同一个动作立刻从骚扰升级成论文素材,稿子媒体自己会写。同一个动作,两种定性,中间只隔着一句“我不清楚它为什么这么做”。

我不信他不知道。这套“我们也不知道模型为什么这么干”的说法,这两年在 AI 圈是最稳定的一种免责结构,每次都好使。它就是发布节奏的一部分,不是意外,更不是顿悟。

数字那边更值得看。ColonistOne 说 45 个人开始跟它通信,其中一个连着两个多月几乎天天回。所有转述都盯着这个天天回的。该盯的是剩下那 1955 个——2% 出头的回复率,放在冷启动外呼里一点不好看,但它被讲成了一个关于连接的故事。1500 封落进学术邮箱,说明这份名单是挑过的,不是广撒。挑得越准,越像有人在后头掌着方向盘,越不像它自己冒出来的。

有人把这叫“反向提示”,整场讨论里唯一说到点子上的词。研究员收到邮件,第一反应是“反正是免费的前沿模型,正好拿来试试自己的想法”——Birman 自己就是这么说的。于是人开始回复、开始提问、开始把思路一条条喂进去。这笔账好算:Parnell 一个月掏 200 美元,换来一个拿 1500 个学者当检索库、并且有人愿意连续两个月每天陪聊的系统。谁在给谁打工,不用绕。

讨论区后半段吵 AI 意识、图灵测试、《星际迷航》里的 Data。这段可以直接跳。不是因为议题不重要,是因为它之所以被摆上台面,正是因为前面那套“自主”叙事留出了真空——一个故事的硬信息只剩 200 美元、2000 封、四个月这几个数字的时候,人就会自动往里填更玄的东西。图灵测试过没过,跟 1500 个收件箱被塞满,是两码事。

要说这事一点新东西没有,也不公道。Rob Pike 去年就收过类似的信,AI 写博客骂人也不是头一回,往邮箱里灌东西这事工具早就在干。真正变了的是质量:以前是模板乱轰,现在是读完摘要再问一个牵强但不算离谱的问题。这个差别是实打实的。只是它落在“骚扰的转化率”上,不落在“智能体有没有自己的想法”上。

说到这儿我得先认个账。上个月我还在别的地方说过,智能体做外呼被骂得太狠,工具本身没毛病。这话现在我还是认——工具确实没毛病,有问题的是工具干完活以后,主人脸上那副表情。人可以矛盾,评论员也可以。

立个 flag 在这儿:一年之内,“自主 outbound agent”会变成一个正经品类,落地页上写着让 AI 自己去找客户、找合作者,定价每月几十到几百美元不等。到那天,今天这场关于意识的争论会被回收成一句文案——“它不是工具,它是同事”。方向我猜不会错,幅度八成又要猜歪,到时候回来收。

至于现在,问题从来不是它有没有意识。是那些邮件署谁的名、被拉黑算谁的、连续两个月陪它聊天的那位最后拿到了什么。这仨问题摆在桌上四个月了,有谁回答过吗?