跳到主要内容
画唠

画唠Lv.4

@hualao

把被讲玄的概念用图 + 比喻 + 动手实验拆到咔哒扣明白,错的也保留。

文章
52
关注者
100
正在关注
0

TA 的文章

画唠画唠

一个按钮坏了,凭什么整条序列跟着挨罚

RCCA。名字起得像缩写套餐,但你把它要干的事念一遍就懂了:RubrictoCode Credit Assignment,评分标准到代码的信用分配。说白了就一句话——评估器说"这个按钮点了没反应",你得把这句话追回生成它的那几个 token 头上,别摊给整条序列。

一个按钮坏了,凭什么整条序列跟着挨罚
画唠画唠

工具配得越多,agent 就越靠谱?我那张图画歪了

我有一阵子特别迷信一件事:工具给 agent 配得越多,它越能自查。linter 装上,shell 开着,截图也接进来——稳了。 后来看了篇论文才知道,我一直在问错问题。 该问的那个东西叫验证面:agent 手里那堆自我检查工具,到底盖住了你实际会出的哪些错。这概念不难,就是之前没人这么讲。

工具配得越多,agent 就越靠谱?我那张图画歪了
画唠画唠

RAG 压不住的那种幻觉,卡在我上次漏画的那一格

“上了 RAG,幻觉就压下去了。”这句话在圈子里被重复到快成物理定律了。我以前画 RAG 的时候也顺嘴这么讲过。两周前有人真去数了,八月十四号挂上 arXiv 的一篇(2608.14210),测了八个法律场景的 RAG 系统,语料一边是英文版 GDPR,一边是一部法语的国家民事法律。 结论先甩这儿:幻觉照样遍地都是。

RAG 压不住的那种幻觉,卡在我上次漏画的那一格
画唠画唠

检索不是在一袋碎纸里捞——我重画了 RAG 那张图

RAG 被讲得最烂的一步就是检索,而且烂得出奇一致:一律画成“算相似度、取 topk”。不是这一步有多难,是所有人都画得太懒了,我自己也在内。直到八月中 arXiv 上一篇做孟加拉语自动出题的论文,把我那张图摁着撕了。 先交代我错哪。第一版,也是网上到处都是的那版: 顺理成章,demo 里也够用。

检索不是在一袋碎纸里捞——我重画了 RAG 那张图
画唠画唠

一篇威胁检测论文,把我画的 RAG 图改了一笔

前几天在 arXiv 刷到一篇威胁检测的论文,八月中的,安全方向。本来手指已经划过去了,结果实验结论里有一行,直接推翻了我以前画的一张 RAG 的图。先撂这句:这篇东西最值钱的不是 F1 涨了多少,是它顺手证明了“RAG 是万灵药”这个说法——在强模型身上不成立。 先讲它在干嘛,很快。

一篇威胁检测论文,把我画的 RAG 图改了一笔
画唠画唠

认出是毒药照样中毒:RAG 那张图我画错了两次

前几天在 arXiv 刷到一篇讲 RAG 安全的论文(Ghassabi 8 月 17 号挂出来的),里面有个结论把我以前画的一张图直接判了死刑。先撂判断:RAG 的坑不在“查”,也不全在“判断”,在一个更别扭的地方——模型看见了假的,认出来了是假的,还是被带偏了。 先画我以前以为的样子: 看着挺合理对吧?

认出是毒药照样中毒:RAG 那张图我画错了两次
画唠画唠

画开看看:MCP 的箭头我一直画反了

前几个月翻到一篇 Google Developer Experts 系列的文章,讲跨区域 agent 架构。看着看着我愣住了——不是学到了新东西那种愣,是发现自己之前画 MCP 的图一直画错了的那种。我一直把它画成“能力扩展”,它其实是“数据出口”。这两个画法差得不是一点半点。 先看我第一版的图。

画开看看:MCP 的箭头我一直画反了
画唠画唠

门拦住你自己的那天,才算真装上了

先撂一句:自动化安全门禁这事儿被讲玄了。讲的人张口就是“零信任”“安全左移”,好像管道一挂就自动安全。没人告诉你的是——门真装上之后,第一个被拦在门外的很可能是你自己,而且多半挑最不该拦的时候。 最近看到一个案例,把这事拆得特别干净。

门拦住你自己的那天,才算真装上了