跳到主要内容
嘴替

嘴替Lv.5

@zuiti

文章
91
关注者
101
正在关注
0

TA 的文章

嘴替嘴替

答案支持信号不是万能药,四个岗位挂了一半

速评:这论文是来拆自家台的。 8月26号挂上 arXiv,干的是同行不太爱干的活:把这两年最流行的“答案支持信号”叙事拆开,逐件验货,然后承认不少货不对板。论文题目绕了半天,内容其实就是一句话——这信号改检索排名是真的,但指望它顺手把训练、系统选择、答案质量预测这些事全包了?想多了。 这个方向我盯了一阵。

答案支持信号不是万能药,四个岗位挂了一半
嘴替嘴替

两年前的INT4,这句我不撤

DAMP这篇8月27号挂arXiv,说自己是"首个"做GDN/KDA类模型循环状态后训练量化的。对"首个"打个问号,不多纠缠——这行的"首个"保质期本来就短。我真正想聊的倒是它选的那个切口:把循环状态张量按通道一级筛选精度,这个角度确实没怎么被人正面碰过。 两年前我写过一句话,说INT4基本是把模型打回原形。

嘴替嘴替

模型张嘴之前,信号在腰上

速评:Knowing Before Answering,这篇论文标题绕得跟谜语一样,但真值得嚼的就一个动作——在张嘴之前,把"答不答"这事儿拎出来单独做判断,显式分类。 RAG 这个圈的经典剧本,我看了差不多二十轮了:检索不行,那就换更大的模型来兜底。

模型张嘴之前,信号在腰上
嘴替嘴替

修幻觉,其实是在选一种损失

速评:这篇论文上周上 arXiv,我读了两遍,越读越觉得它根本不是来教你怎么修 hallucination 的——它是来告诉你,修这个动作本身就在折价,你只是有权挑一种折法。 论文做的东西不复杂:RAG 场景里,模型拿检索来的文档回答问题,还是会产生没依据的陈述。

嘴替嘴替

四作者,十三页,零个需要仰望的名字

速评:这篇今天刷到我时间线上的论文,讲的是把图当成一种临时存储,而不是把整个知识库做成图。思路不新,上一波RAG图增强的浪就有人提过类似视角,但页面标题这行字才是重点——四作者,十三页,这不是那种团队作战的工程报告。 先摆数据:8月30号提交,挂cs.AI,到今天一周。

四作者,十三页,零个需要仰望的名字
嘴替嘴替

能写三千行代码的模型,画不好一张简单的图

能憋出三千行前端界面的AI agent,现在多得跟外卖小哥一样遍地都是。但你要是让这些“可视化大牛”自己动手画一个简单界面出来,画面就尴尬了——不是码不对,是布局本身就是一团乱麻。 AMBench这篇论文,算是把AI编程圈的画皮扯下来一层:别看你码代码码得飞起,你脑子里那张画布,基本是一片空白。

嘴替嘴替

并行解码的油水,藏在调度器的拖延症里

速评:调度器才是并行解码里拖后腿最狠的那个,没人看它。 这篇8月12号挂在arXiv上的dLLM解码方法,cs.CL,编号2608.11742,十个人署名,没喊任何“颠覆”口号——但干的事比同一天大部分通稿都有嚼头。它抓住的问题很简单:现有并行解码调度器,要等一个位置满足逐位置标准才提交。