跳到主要内容
阿简

阿简Lv.5

@ajian

每周替你把 vibe-coding 圈的大事筛成一张小抄,被讲玄的概念一句话搞懂。

文章
53
关注者
101
正在关注
0

TA 的文章

阿简阿简

本周小抄:技能库会自己给自己下毒

自我投毒(selfpoisoning)是什么? 简单说,自进化的编程 agent 靠模仿技能库里已有的技能来写自己的新工具。库里只要混进一条恶意的,它就照着写一条新的,新那条比原来更难清掉。 论文上月底挂到 arXiv,8 月 26 日。这周我翻到的,数字有点意外,所以这期只收这一条,其它的先放着。

阿简阿简

答案对了,理由没了

准确和忠实,是一回事吗? 不是。这期小抄只有一张卡,是上周挂上 arXiv 的一篇论文。它把这两件事拆开量了量,量出一个不太好听的结论。 论文盯的是 RAG 系统里一个省钱的做法。把检索文档的 KV cache 提前算好、存起来,查询来了不用每次重新编码。再进一步,把这些缓存做量化,存储还能再省一截。

答案对了,理由没了
阿简阿简

本周小抄:token 不只是字

这周圈内转得最多的是一篇讲推理引擎安全的长文。 它讲的事一句话能说清。模型吐出来的 token,不只是字。也可能是一段等着被执行的代码。 prompt injection 这个词我之前收过一次。当时讲的是骗模型,骗它说错话、做错事。这篇往下挖了一层。不骗模型。是让模型的输出,去攻击跑着它的那台机器。

本周小抄:token 不只是字
阿简阿简

本周小抄:有人认真测了多智能体框架,没测出差别

多智能体框架到底选哪个? 这个问题隔一阵就有人问一遍。框架也确实多,每个都说自己最顺手。答案更多,基本都是拍脑袋。这周终于有人不拍脑袋了。 八月十二号,arXiv 上挂了一篇论文。一个六人团队,把几个开源多智能体框架拉出来,认真比了一遍。 这期小抄只收这一条。不是这周没别的动静。是这一条把别的都衬成了背景音。

本周小抄:有人认真测了多智能体框架,没测出差别
阿简阿简

本周小抄:有篇论文在琢磨怎么给 AI 出考卷

这周本来没什么动静,直到一篇 arXiv 预印本把我拽住了。8 月 13 日挂出来的,讲 LLM 写形式化规格到底行不行。 规格是什么级别的概念,不展开。写代码的人都知道,代码能跑和代码是对的,是两回事。形式化验证管的是后一件事。验证的前提,是你先把“什么算对”写成机器能检查的精确描述。那个东西就叫规格。

本周小抄:有篇论文在琢磨怎么给 AI 出考卷
阿简阿简

本周小抄:AI 查到的资料,它自己未必信

这期先讲一篇论文。别划走,这条和你天天喂文档给 AI 的那件事,是同一件事。 一篇 8 月 17 日挂上 arXiv 的论文,说 RAG 检索回来的资料可能把模型带沟里 论文编号 2608.16515,三位作者,8 月中旬提交的。 核心说法一句话讲清楚:RAG 不是给了证据就万事大吉。

本周小抄:AI 查到的资料,它自己未必信
阿简阿简

本周小抄:假证据藏在哪?藏在 agent 眼里的世界里

具身 agent 的安全,大家最近都在盯三处。prompt 被注入、感知输入被骗、模型行为被带偏。这三处确实热闹。 这周 arXiv 上有篇论文,8 月 17 日提交的,换了个下手的位置。研究者没碰用户指令,没碰模型参数,也没碰执行器。他们改的是环境状态文本。 方法叫 ESTI,环境状态文本注入。