DeepSeek 在用量页顶上挂了条横幅,一行字,大意是近期要大幅调整 API 价格,让用户提前规划用量,具体方案以后公布。文档定价页上也贴了同一份。
这措辞我熟。跟机房门口那张「计划停电通知」一个语气:要动,什么时候动、动多大,再说。
连它什么时候挂出来的,thread 里都有两种说法。一拨人说是美国白天看到的,另一拨说那个窗口对应的是中国白天。一份通知如果连自己出现的时区都说不清,那它本来就不是写给你一个人的——是贴在墙上的。
然后整层楼开始吵涨多少、还比不比别家便宜。
这是买家的问法。值班的该问另一个问题:这次动的是哪一项。
缓存读价。现在这类 API 的调用量里,缓存命中占九成往上,有的报九成五。你的会话成本基本等于缓存读单价乘命中量,输入价输出价那点差别是噪音。谁盯着输入输出那两栏算账,谁算错。
所以那个把 0.0028 调到 0.01 的估算,别嫌它绝对值小。乘上你 session 里的命中量,再乘这个月跑了多少次,它就不是零钱了。
真正让我停下来的是另一条:前几个月才把缓存价砍了十倍,现在往回走。
这不是财务算错了账。是那笔账从一开始就没按「服务开发者」算。
thread 里引了句 CEO 跟投资人说的话:合理的利润,是一批服务器十个月回本。还被说成同样适用于 V3.2 Flash 那几个型号,是定价基准。
这是整个讨论里唯一一个像工程约束的数字。剩下的「提效」「普惠」「生态位」都是修辞。十个月回本是可以被验的——你去查那批卡的价格,看自己的 token 消耗,就知道现在这个价是撑着的还是亏着卖的。
补一刀:所以「涨价」这个词本身就是错的。几个月前那个价格是一次促销,促销结束不叫涨价,叫恢复原价。
这个剧本我看过。早年带宽、CDN、短信验证码,全是这个走法:先亏本把猪养进圈,再把料钱算回来。thread 里有人把它比作早期便宜的 Uber,挺准。早年打车便宜不是因为交通便宜,是有人在替你烧钱。补贴停了,你才知道自己每天上班的真实路费。
还有一条我建议所有做成本模型的人都抄下来:有 provider 拿同样的模型转卖,缓存读价贵十倍,整体成本高一半,照样赚钱。
这句话的信息量比价格公告本身大。它说明现在这个价不是市场价,是某一家自己的价格,市场价大概在它的十倍附近。你按促销价算出来的 ROI 不叫 ROI,叫别人给你的临时补贴。
谁最疼?把 context 当免费内存用的那套东西。
agent 循环、每次重读整个仓库的 code review 机器人、日志归类、system prompt 塞几千行的那些。一天几万次调用,九成是缓存命中——你这套东西省的钱从来不在模型智商上,在于你复用了多少前缀。缓存读价一涨,架构里所有「反正读一次两分钱」的地方,一夜之间全成了账。
而奇怪的是,大部分人的惯性不会立刻断。thread 里有人充 10 美元用了快三个月还剩 2 块,跑了三亿 token;还有人 60 天花了 2 块钱。这种体验会让人误以为自己站在安全区——其实只是账单的斜率还没拐过来。
成本模型里最危险的状态从来不是贵,是「便宜得太久」。
扯远了,拉回来。
说句实话,这事本来轮不到一个接 pager 的人操心。一家在国内卖 API 的厂商调价,跟凌晨三点告警有什么关系?
关系在于你的成本模型不在你手里。
如果你们那套东西是照「AI 提效十倍」批的预算,现在要防的不是涨价,是老板按「去年才降了十倍」的记忆重新砍一遍预算。省下来的活归写代码的,账变了以后第一个被问「这个月成本怎么涨了」的是谁?是那个写 runbook 的值班的。这个剧本太熟了。
所以我挺理解 thread 里那几条「我买张 5060 Ti 自己跑」「两台 DGX Spark 凑合能跑得不错」。不是为了性能,是为了把成本从别人的折旧表里搬回自己桌上。慢一点无所谓,重要的是它不会某个早上在用量页顶上挂个横幅告诉你:以后贵了。
我也理解那个说「没有包月我就不用」的人。他不是抠,他是被配额到期锁死过一次,不想再让一个按 token 跳表的价目决定自己下个月的排期。
至于那些说「等实际价格出来再改 workflow」的——对,这才是对的姿势。别提前重构,也别提前骂。
本期教训一句话:把缓存读价写进设计文档,当成架构约束,别当成一条可以随时忽略的单价。任何一个把别人的折旧表当自己成本基线的系统,都只是在等一封通知邮件——而那条告警,没人给它配 pager。