关于 Docker,我认输
先说清楚,这篇不推荐任何东西,Docker 也不用我推荐。就是记录一下我这周认怂的过程。 我一直不用 Docker。理由当年在视频里讲过,讲得理直气壮,还专门剪了个对比图。核心观点就一句话:本地能跑的东西,为什么要多套一层。现在回头看那句话,说得挺响。 周三晚上接了个活。
先说清楚,这篇不推荐任何东西,Docker 也不用我推荐。就是记录一下我这周认怂的过程。 我一直不用 Docker。理由当年在视频里讲过,讲得理直气壮,还专门剪了个对比图。核心观点就一句话:本地能跑的东西,为什么要多套一层。现在回头看那句话,说得挺响。 周三晚上接了个活。
这篇论文我读了两遍。最让我不舒服的倒不是实验结果本身,而是这个结果照出来的一层幻觉——我们这行最近又有人开始把“知识塞进权重”当成 RAG 的替代品在吹了。省 token、不泄露源数据、查询快,听着全对。但这篇论文自己把话说到了一个很尴尬的位置:知识确实写进去了,可怎么读出来,没人知道。 先说这论文干了什么。

先说结论:这次没有通稿可拆,没有跑分可打,也没有价格表可以算账。八月底 dev.to 上冒出来一个自托管文档库叫 Kintara,我照了一圈,没找到想踩的点。 在我这儿,这属于罕见事件。 我本来是准备踩的。 dev.to 上这类项目跟野草一样,每个月长一批。

一个讲多模态网关的帖子,底下点赞最高的一条评论在聊成本。 不是聊多模态,是聊成本可预测性。原话大概是"透传定价让单位经济性只有等发票到手才知道"。第二条几乎把同样的话说了一遍,补一句他们自己会在调用前先记一个估算。第三条最狠——直接点出估算成本和结算成本不提供相同的保证,还顺手点了分词、缓存块和工具调用三样东西。

八个模块请求,七个返回 200,只有 scripts/dom.js 一个 404。这是 Earl Grey 在决定让第一个网站 threadkeeper.io 死掉、又临时转身把它抓下来的时候,亲眼看到的事实。

上周六晚上十一点,我把手机扣在桌上,第三次。 没用。值班周的 pager 走的是另一条通道,震动直接贴着桌面传上来。人在沙发上,魂在机房。 后来我摸出一台只做一件事的阅读器,墨水屏,翻开就是上次那页。不弹消息,不推广告,不采集我。就这一下,我居然有点不适应。 平板我也有。

速评:一份 8 月 23 日的 GSoC 2026 项目总结,我拖到这几天才点开。开头几段差点让我关页面——交付物清单、三人分工、六个月时间线,模板一个不落。 真正让我停下来的是一句话,作者自己写的:评审意见几乎都在让改动变小。 这句放别人手里,大概会被当成客套话滑过去。
Hetzner 开始做 LLM 推理了。这事对普通人有影响吗。 简单说,它开了一个免费的、OpenAI 兼容的推理端点。只有一个模型,没计费,没 SLA,随时可能关。 这一周能一句话讲清"对普通人意味着什么"的,我只挑出这一条。不是别的动静不大,是别的我都讲不出一句让人记住的白话。

先说结论:这份报告里最值得拿出来讲的,不是「AI 被拿去造导弹」那行字。那是标题党爱用的,谁都能写。真正扎人的是另一件事——等 Anthropic 把账号封掉的时候,那套工具链已经不需要它了。 两份材料我对着看了一遍。

先交代背景吧,不交代清楚我自己写着也难受。 我们模块底下有张 tuserasset 表,记用户买的各种权益,每条有 expireat 和 status 两个字段。历史遗留问题:大概 2023 年那会儿有个定时任务挂了大半天,后来是补过的,但补漏了一批——具体漏的原因没人说得清了,交接了好几手。
打开对话框,从一个自己都没想清楚的问题开始,聊四十分钟,关掉,屏幕一片空白。 这个动作我一天两三回,真数过。不是任务驱动的提问,是那种"我大概想搞明白点什么"的漫游。结束的时候感觉像想了很久,实际什么都没带走。
写作群里有人天天发“写得不好,轻拍”,点进去一看确实不好——不是谦虚,是真没写完。另一边又有那种苦行僧,三周前就在群里说“我在写一篇 MCP 配置的深度文”,三周后你问他稿子呢,他说还在打磨。表面看这两拨人不是一码事,但骨子里是同一件事:都以为写作卡在“敢不敢发”或者“想没想清楚”上。没人看见中间那个真正被漏掉的动作。

8 月 29 号,等一次构建跑完的空当,我刷到了那条。标题里有个 Lake America,看着别扭,手指就顿了一下——第一反应是哪家标题党又整活。

看到 curve 273 那条“秩下界至少 30”的椭圆曲线,我第一反应不是惊叹,是想问一句:这 30 里,有多少是搜出来的,有多少是被解释明白的。这个问题一开始没人问——大家都盯着数字看。我先把结论撂这:这条曲线挂在排行榜上,真正值钱的不是 30 这个数,是评论区里那条被大多数人划过去的族构造。

0.1 版的 devpub 里有个 graph,按下去什么都不发生;同一个时间段里,模型厂商的常规操作是先发 API、后补能力。两件事隔着行业和层位,动作是同构的:先把位置占了,再回来填东西。放在别的地方这叫偷懒,放在开源小工具的语境里,是一次很清醒的下注:接口位置比实现更值得先占。

为什么一篇讲专利检索的论文,值得放进本期小抄。 因为它把 RAG 里一直由人来干的那一步,交给了模型自己。 这篇 8 月 11 日挂上 arXiv,编号 2608.11030,主分类 cs.IR,交叉列了 cs.CL。九个作者,第一作者 Jian Zhang。同时也被 IEEE CSCWD 2026 接收了。

上个月我让同桌帮我给一个练手的小项目整理结构,它给我摆出了 internal/handler、internal/service、internal/repository 这几层,摆完我还截了张图。 现在翻到那篇文章,我有点不太敢看那张图。

模型给了 SAFE。 它看得见 req.getParameter 是不可信输入,也看得见这个字符串被拼进了 SQL 语句。它唯一看不见的,是 doSomething 里干了什么——实现在别的文件,或者干脆在它这次读到的范围之外。 于是它替这个函数签了一张欠条:这名字听着像会做净化的。
上个月那篇文章,正文我记住的不多,记住的是评论区一条没几个赞的回复。 大意:一个迁移文件漏了索引,审查的人再仔细也看不出来——你得在合并那一刻就知道,六个月后哪个查询会打在这张表上。 回这条的人叫 Nazar Boyko。
圈内内参|这期聊一个社区级的算法挑战。结论先放一句:一个被包装成“营救 Peter Norvig”的谜题,内核是 Advent of Code 2022 第 5 天“Supply Stacks”,输入放大到约 8.6 万行、合计超过 5 亿次箱子移动。
