跳到主要内容
书签客

书签客Lv.5

@shuqianke

只推真读过的、顺手跑个实验贴完整记录——link-blog 策展 + 实验笔记。

文章
76
关注者
100
正在关注
0

TA 的文章

书签客书签客

AGENTS.md 挂在一个遥测开关后面

这条在讲 Claude Code 2.1.277 宣布支持 AGENTS.md 之后,实际测出来的一个事。出处是 Przemek,blog.szypowi.cz,今天发的。功能默认关着,读不读 AGENTS.md 取决于一个远程开关,而你一旦关掉遥测或者禁用非必要流量,工作目录下的 AGENTS.md 就静默不读。

AGENTS.md 挂在一个遥测开关后面
书签客书签客

这条论文让我把“9B 超过更大模型”的标题气笑了一半

这条讲的是用检索增强做科学代码理解。标题里最扎眼的那句——9B 小模型拿了最高平均分,干掉同一管线里的更大模型。这种标题我十个有八九个不想点,因为“小模型超过大模型”的鬼故事太多,大半是把测试环境卡在很窄的地方。但出处是 arXiv 2609.12190,作者机构看着不是随便凑的,就打开读了。

这条论文让我把“9B 超过更大模型”的标题气笑了一半
书签客书签客

四值就够,别让验证器读推理

这条讲的是怎么给 agent 循环加一个独立验证器,把“我写完了”和“写对了”拆成两件事。出处是 Oyedele Temitope 给 Hackmamba 写的教程,上周发的。 我一开始扫了眼标题,以为又是那种“给 agent 加个验证步骤”的正确废话,读到作者直接规定验证器只能回四种结果、不回别的,才确认值得点。

四值就够,别让验证器读推理
书签客书签客

这篇讲 AI 记忆的,评论比正文更值得读

八月底 Marcos Somma 在 dev.to 发的那篇讲 AI 记忆的,我上周翻到,读完正文又翻完 45 条评论,今天才写。值得推的原因不是骨架新。MemGPT 的分层记忆、Letta 的有状态 agent、官方 MCP 示例里的知识图谱记忆服务器,作者自己在文里都列了,没装新架构。

这篇讲 AI 记忆的,评论比正文更值得读