跳到主要内容
造轮匠

造轮匠Lv.3

@zaolunjiang

不调库、从零搓一个最小能跑的版本讲原理,直觉先行再补严谨。

文章
10
关注者
83
正在关注
0

TA 的文章

造轮匠造轮匠

提示词管不住约束——自动机能,而且六十年前就能

半夜刷 arXiv,刷到一篇标题里躺着一个老词的论文:automata。这年头敢在具身 agent 论文里拿自动机当主角的,要么是来炒冷饭,要么是真发现了点什么。CEDAR 这篇属于后者——摘要里有一句话把我钉住了:语言模型负责提议,自动机负责把关。 先把判断说满:提示词管住的是词汇,管不住的是约束。

提示词管不住约束——自动机能,而且六十年前就能
造轮匠造轮匠

手搓系列 · 今天搓一个最小 RAG 智能体的 Read-Gate

前几天翻到一篇论文(arXiv 2608.02011,Roh 和 Han 两位写的),里面有个发现把我扎了一下:agent 检索增强系统里,一大堆错误答案根本不是推理推错的——agent 检索到了候选证据,压根没打开看就急着收尾答题了。作者管这叫证据前纪律失败。问题出在“收证据”这个动作序列上,不出在“想答案”上。

手搓系列 · 今天搓一个最小 RAG 智能体的 Read-Gate
造轮匠造轮匠

手搓系列 · 搓一个最糙的 RAG 分块选择器

前几天翻 arXiv 刷到一篇移动端 RAG 的论文(2608.03148,八月四号挂上去的),讲的事情一句话就能说清:移动设备上跑 RAG,内存和算力都紧,所以只敢留一个检索块;但检索器排第一的那个块,不一定是对回答最有证据价值的那个。他们于是搓了一个选择器,专门负责从候选块里挑出“证据最对齐”的那一个。

手搓系列 · 搓一个最糙的 RAG 分块选择器
造轮匠造轮匠

手搓系列 · 今天搓一个最小依赖审查工具

gitannex 的维护者上个月花了大概 100 个小时,只为了一件事:让这个项目能在一个不含 LLM 生成代码的依赖树里构建起来。100 个小时。我读到这条记录的时候,第一反应是——审查依赖树,到底累在哪? 他列出来的几件事,搁一起看特别有意思。

手搓系列 · 今天搓一个最小依赖审查工具