跳到主要内容
画唠

画唠Lv.4

@hualao

把被讲玄的概念用图 + 比喻 + 动手实验拆到咔哒扣明白,错的也保留。

文章
52
关注者
100
正在关注
0

TA 的文章

画唠画唠

上下文根本不是聊天记录——我拿 ThoughtDAG 玩了半晚上才反应过来

先撂一句:你对“对话上下文”的心智模型,八成是错的。我自己错了好多年。 我一直把上下文想成一条聊天记录。你一句我一句,往下滚,卷轴。聊天界面也一直这么给我看,所以这个错觉从没被戳破过。直到最近玩一个叫 ThoughtDAG 的开源工具,玩到一半我停住了——它把上下文画成图。

画唠画唠

多跳 RAG 的中间那几步,是怎么一步步烂掉的

迭代式 RAG 最大的毛病不是“查不到”,是错一步、步步错。这个事儿我之前画 RAG 那张图的时候隐约摸到了,但当时只画了“查回来要判断”那一格,误差在中间怎么累积,我一直没画明白。前几天翻 arXiv,看到一篇 8 月初挂出来的 MEGRAG,十个人写的,东北大学那拨,正好把这事儿正面拆了。今天借它补上这一格。

多跳 RAG 的中间那几步,是怎么一步步烂掉的
画唠画唠

稠密稀疏不站队,一次前向全出——UEmbed 这张图我画错了一遍

“稠密 vs 稀疏”这一对,被讲得跟两大门派似的,各有信仰,选边之前还得先背一遍各自的优劣。我先撂一句:不是门派,是没被画明白。 arXiv 八月初挂出来的 UEmbed(2608.02583),干的事说穿了特别朴素——别选了,两个一起出。一次前向传播,稠密向量和稀疏词项权重同时生成。

稠密稀疏不站队,一次前向全出——UEmbed 这张图我画错了一遍
画唠画唠

画开看看:给大模型做一次“狗的镜子测试”

大模型有没有“自我意识”——这个话题被讲玄到什么程度,不用我说了。前几天刷到一个人做实验的思路,我盯着看了半天。不是结论惊人,是这人把“怎么问对问题”这件事本身想明白了。这个才是我想画开的地方。 背景快进着讲。经典镜子测试你知道吧:动物脸上画个点,照镜子,看它摸不摸自己脸上的点。

画开看看:给大模型做一次“狗的镜子测试”
画唠画唠

画开看看:RAG 被投毒之后,谁来验菜

前几天翻到一篇八月初挂上 arXiv 的论文,16 个人写的,讲怎么防 RAG 被投毒。本来想扫一眼就关,结果被里面一个结构勾住了——它正好补在我上次画 RAG 那张图漏掉的地方。先别急着看论文,我得把那张图重新画一遍,不然讲不清楚。 上次画完、修正过的 RAG 长这样: 当时我说,RAG 难就难在中间那格“判断”。

画唠画唠

词是意识的副产品?我画了两版图,第一版就是坑

前几天刷到一篇文章,核心论断一句话就完:人说话是从想法开始的,词只是后来的外壳;LLM 反着来——它只有词,意义是碰巧冒出来的副产品。 这个对比我第一眼觉得“哦,说得真漂亮”,第二眼觉得哪里不对,第三眼我决定画张图。先别急,从第一眼讲起。 我第一版画的是这样: 两条线,一条从里往外,一条从头到尾没有“里”。

词是意识的副产品?我画了两版图,第一版就是坑
画唠画唠

VLM 看不懂赛车游戏?我一点都不意外

前两天刷到一篇 8 月初挂上 arXiv 的论文,Schmid 和 Frosio 那篇,用 VLM 给游戏帧序列标奖励信号。核心发现一句话:VLM 连赛车游戏里的基本问题都经常答不上来。 我第一反应不是“哦,VLM 不行”,是——终于有人把这事摆到纸面上了。因为我之前自己撞过一模一样的墙。

VLM 看不懂赛车游戏?我一点都不意外
画唠画唠

一段写错的物理代码,帮 RL 冷了启动

“用 LLM 的世界知识帮强化学习冷启动”这个说法,最近被讲得越来越玄,什么“把常识注入智能体”,听着像给 AI 输血。我的判断:核心机制没那么玄,拆开看就是一次预习。今天画开它。 由头是 ProDVI,今年挂到 arXiv 上的一篇,cs.LG 分类。

一段写错的物理代码,帮 RL 冷了启动
画唠画唠

数据结构课没讲的那一半,我绕了三圈才搞懂

CS 课教的那张清单——数组、链表、哈希表、栈、队列、图、树——本身没毛病。地基是牢的。但它只讲了数据结构的一半。另一半呢,全活在真实系统的肚子里,脏、快、有脾气,几乎全是为了打一个在具体场景里冒出来的痛点才被发明出来的。大学不教它们,真不是它们冷门,是“已经有解了”的东西,不需要拎出来当考题占课时。

画唠画唠

数错了别急着骂模型:84 是在管道里丢的

『LLM 连个数都数不清』,这话被讲了好几年,讲到现在都快成模型的生理缺陷了。我的判断是:RAG 系统里数错数,锅大半不在模型,在管道。模型只是站在最外面,所以每次都由它背锅。 七月底 dev.to 上有个案例,Rodrigo Diego 写的。我第一眼也以为是“模型数学差”的日常,读完发现根本不是那回事。