圈内内参|这期聊 Claude Code 的账单结构。同一个模型,按座位订阅和按 token 付费,价差能到 40 倍。结论先放:这不是 Anthropic 定价黑,是市场分割——便宜座位卖的是习惯养成,真实收入在按 token 的企业端。信源说明:Jacek Migdal 的自测数据(确认)、SemiAnalysis 的实测(确认)、几位企业用户的迁移账单(未逐条交叉核实,后面会标)。
先说账单本身。Jacek Migdal 今年 7 月用 Claude Code 连开 24 小时,5 个并行 subagents 重构一个内部 web app,API 等价成本 $180.91——一天,顶一个月 Max 5x 订阅。其中缓存读出 $85.95,Opus 5 subagent $49.73,这两项就占了大头。他 8 月 11 日把这笔账写成文章:一样的 token,一样的模型,按座买和按 token 付,价差最高 40 倍。SemiAnalysis 之后拿 Max 20x 订阅实测一个 session,$200 的订阅对应约 $8,000 的 API 等价成本——40 倍不是标题党。
这个问题在圈内被聊成"Anthropic 黑不黑",实际是计价结构问题。Claude Max 订阅 $100–200/月,用量包在限额里;Claude Team 同样按座,$100–200/人/月,封顶 150 座;Claude Enterprise 授权费 $20/座,不含任何用量,之后每个 token 走 API 标准价——Opus 5 输入 $5/输出 $25 每百万 token,Fable 5 输入 $10/输出 $50,缓存写入是输入价的 1.25–2 倍,缓存读出 0.1 倍。(以上定价结构确认,Anthropic 公开定价页可核。)所以真正的分野不在"订阅 vs API",在两条线:150 座以内、不需要 SSO/审计日志/合规 API 的组织,可以留在便宜的座位区;一旦超出 150 座、或者需要企业级功能,就被推到按 token 计费的那一边。
Jacek 接触到的企业客户,口径几乎一致:从座位制迁到按 token 的 Enterprise 之后,账单至少翻倍,多数在 3 倍左右(未交叉核实,但和他文章里贴的具体案例对得上)。SemiAnalysis 估消费订阅只占 Anthropic 收入的 5% 上下,Sacra 把 Team 和 Enterprise 的座位部分全算进去,也就 10–15%。数据中心 capex 2025 年涨了 57%,今年奔着万亿去——这层资本开支总得有地方接住,订阅那 5–15% 接不住。(分析)所以这不是 bug,是市场分割。
企业端的例子现在随手能抓一把。Uber 2025 年 12 月接入 Claude Code,到今年 4 月把 2026 全年的 AI 编码预算烧完;The Information 报过好几家企业实际账单是预期的 2–3 倍。Pylon 的 CEO Marty Kausas 自己承认,在 Claude Code 里三天意外花了 $4,000;Pylon 拿 Claude Team 和 Claude Enterprise 各测一遍,年成本从约 $40 万到约 $140 万——同一个模型,同一批工程师,3.5 倍。
账单里最值得盯的不是总价,是缓存占比。Jacek 那个 24 小时 session 里,缓存读出 $85.95,缓存写入 $27.46,合计 $113.41,占 API 等价成本的 62.7%;所有 session 平均下来,缓存相关流量占 82%。(这个比例他自己也贴了,确认。)这跟 chat 的计费直觉完全是两回事:chat 时代按 input/output token 单价估成本就行;agent 的主循环反复读同一段 context,每次 0.1 倍输入价,看着便宜,但一天高频读几十上百次,最大的单一项是缓存,不是输出也不是输入。按 chat 的单价模型估 agent 成本,会低估将近一个数量级。我自己的观察和这个数对得上——缓存这块在算 ROI 时最容易被漏掉。一次误操作也会被这个结构放大:他那天把整个 claude-api 参考文档意外加载进 context,326k token 的缓存写入 $6.65,单看不贵,但作为 cache 挂在 session 上,之后每一次 cache read 都在替它付钱。
上面"市场分割"这个判断,我得收一下边。分割是真的,但代价落在谁头上还在动。Jacek 提到 Anthropic 此前试过给 Fable 5 做按量计费,再并回 Max 计划的每周限额、允许用到一半——说明他们清楚座位价是补贴,也一直在找时机往 metered 推。今年 4 月他们把 Claude Code 从 Pro 计划里拿掉试了一次,一天之内被骂到撤销。订阅用户能挡住"移除",但挡不住"限额悄悄降、用量悄悄升"。哪天竞争格局允许,同样的招数会再来一次。
几个值得盯的信号,不下注:
一、Anthropic 下次发布新款模型时,会不会再一次尝试把主力模型从 Max 计划里拿掉、改成单独计费。上次一天就反转了,但反转的原因大概率是 Pro 用户声量大,不是商业逻辑变了。
二、AWS Bedrock、Vertex AI、Microsoft Foundry 上同款模型的定价和 Anthropic API 的价差有没有拉开。现在基本持平,哪天云厂商开始用 token 定价做促销,Anthropic 的补贴逻辑会被从侧面捅一刀。
三、缓存这层成本有没有创业者进来做可视化。现在最大的可见性工具连"缓存读出和缓存写入分开看"都费劲,而这两项已经是 agent 成本结构里的大头。
四、Uber 那类"半年烧光全年预算"的公司,下季度是把封顶往上调、往下降,还是开始走自带 token 的私有化部署路线——这直接决定这轮"按 token 付费"的尽头是哪里。
这期到这。有更确凿的企业账单数据的,欢迎匿名补充。
