上个月月初 dev.to 上有一篇长文,一口气给了 18 条关于 AI 市场走向的预测,时间线上被转了好几次。说实话,宏观的那部分我一条都不打算在这里复述——超级应用谁会赢、数据中心该投多少钱,这些我既验证不了,复述一遍也只是把别人的判断搬进我的笔记,三个月后自己都分不清哪句是谁说的。但这 18 条里有一条,是写代码的人当天就能动手试的:agent 正在变成默认用户,不为 agent 设计的产品——没有清晰的 API、文档、CLI、MCP——会变得「找不到」。这篇笔记就记这一条的验证过程:我拿自己维护的一个小仓库试了一遍,发现它对 agent 来说接近隐形,然后补了两处配置把它救了回来,读完你应该可以照着对自己的项目跑一遍。
先交代被测对象。是一个我维护的内部小工具,导数据用的,平时同事都照着口头交接在跑,README 只写了装依赖和一句启动命令。验证的思路是装作一个毫无背景的新用户,只给仓库本身,问一个新人第一天一定会问的问题。拆开看看是三步:
- 在仓库根目录起一个干净的新会话;
- 只问一句话,不给任何额外提示;
- 看它卡在哪一步。
claude "这个工具怎么认证?帮我在测试环境跑一次导出"
结果是装依赖一次过,README 里写了这一步;认证则卡住了,token 要去内部凭据页申请,环境变量叫什么,整个仓库没有任何一个文件提到。这里有个现象值得单独记:人卡在这一步会来提问,agent 卡在这一步不会,它会编一个看起来合理的变量名接着往下跑,然后在请求那里吃一个 401。我复现了三次,三次编的变量名都不一样,一开始以为是随机性,后来才想明白——文档里根本没写,它每次都在猜,猜错在它的流程里也只是一个普通报错而已。原理层面我说不全,但现象很稳定。这条记下来了,下次见到 agent 一本正经地填错配置,先查文档缺口,别急着怀疑模型。
修复没花多少时间,就是把这个缺口老老实实写下来。在仓库根目录补了一份 CLAUDE.md(怎么配之前那篇规则文件的笔记里写过,这里不重复),内容只有三样:
# 认证
- token 去内部凭据页申请,90 天过期
- 环境变量名:EXPORT_TOKEN,别猜别的名字
- 第一次跑:./export --dry-run --env test
顺手给主脚本补了一个完整的 --help。改完重新起会话问同一个问题,这次它先跑了一遍 dry-run,把将要动到的数据范围打印出来,我对着输出过了一遍 → 没问题才让它真跑。💡 小技巧:「别猜别的名字」这一行是故意的,与其指望它不猜,不如明说这里没有别的可选。
中间跑题记一下。那篇文章里传播最广的几条是成本相关的:Uber 四个月烧完了 2026 全年的 AI 预算,微软因为成本把工程师从 Claude Code 上挪走,Coinbase 换成 GLM 和 Kimi 之后开销砍了将近一半,Airbnb 和 Pinterest 用上了 Qwen。方向我信,因为我做过一次很小规模的对照:把一批无聊的活(给旧脚本补注释)交给便宜模型,质量够用,难的活还是留给旗舰。但「砍一半」这种数字我复现不了,只能记成「方向和我的一次小实验一致」,不能记成结论。这条留一个坑,等手上项目忙完,认真测一轮按任务类型分流的写法。
文章还有一个比喻我挺喜欢:不做 agent 入口的知识工作软件,有变成 dumb pipe 的风险,举的例子是 Google Workspace——用户让 Codex 去改 Docs,全程不碰界面。这条我暂时没能力验证,但我那个小仓库差点连 pipe 都算不上,是隐形的。它顺带还说了一句:在单个应用里塞一个聊天机器人救不了这个应用,因为只握着这一个应用上下文的 bot,打不过带着你日历、邮件、Slack 上下文跨应用跑的 agent。这个判断我没测过,但和我的使用体感对得上,先记下来不展开。
两个常见坑提前说一下。第一个坑是把「为 agent 写文档」当成额外负担,实际写完那份 CLAUDE.md 之后,新同事入职直接照它配环境,一份文档两个读者,比单独维护一份「给人看的」反而省事。第二个坑是以为加个机器人就等于为 agent 设计了,上面已经说过。这里可能有人会问:至于吗,我的工具就几个同事在用。我一开始也没搞懂这一步为什么要紧,后来才想明白——那篇文章底下点赞最高的评论问的就是「软件都为 agent 优化了,人往哪放」,而我的答案恰好是这次验证的副产品:人不在流程的两端,人在中间核对 dry-run 输出的那个窗口里。窗口没了,生成的东西直接
