先说结论:dev.to 上 xulingfeng 那篇把三十六计往技术采购上套的系列文,六月底这篇是我近期看过最好的「反营销教材」。不是文笔多好,是它把厂商话术的皮一层层扒下来晾着了。比十篇实测评测加起来直观。
故事骨架一句话讲完。fintech 公司 NexPay 的 CTO 在 Q3 all-hands 上推一个叫 DeepCover AI 的测试工具,通稿话术全套拉满:「覆盖率超 95%」「比手工测试快 10 倍」「三家金融客户验证过」「首年 20 万美元」。测试架构师 Lena 花三周做评估。单子黄了。
黄得漂亮。我逐条照了照。
「95% 覆盖率」。拆开一看,里面没有真正的推理模型,是个硬编码的规则模板引擎,外面套一层轻量 LLM 当皮。跨境支付场景直接原形毕露——SWIFT 码、结算周期,全错。这不是覆盖率高低的问题,这是「覆盖率」三个字的分母到底是什么的问题。拿自家顺手的场景跑,92%;demo 现场有人手痒,把 Q2 的多币种回归数据实时喂进去:
demo 现场,同一工具:
默认演示数据: 92% coverage
Q2 真实数据: 87% → 74%
92% 掉到 74%。演示数据换成真实数据,一个百分点都藏不住。
现场还有更狠的。LLM 把一笔 12470 美元的交易幻觉成 743.60。
数字都念不对的工具,「三家金融客户验证」?哪家?验证了什么?验证了多久?通稿里永远不会有这三个问题的答案。
「首年 20 万」。按环境收费,标准交付要三套环境,实际首年 60 万起步,第二年还有数据存储的隐藏附加费。报价砍掉三分之二藏起来,这手法我太熟了——上次我被某个「限时优惠」骗着续年费,也是签约之后才在细则里见到那些名目。厂商报价单的第一页从来不是价格,是钩子。
还有一条是我觉得全文最扎的:共享租户 SaaS,金融数据走 AWS 俄勒冈。而公司合规政策白纸黑字,金融数据不许出境。这条不是性能问题,是这单根本就不该走到 demo 那一步的问题。CTO 在 all-hands 上放 PPT 之前,有人看过部署架构吗?显然没有。
所以 demo 当场翻车不是意外,是必然。4000 多次 API 调用的死循环,staging 环境直接被打崩,截图在 Slack 上传着看。CFO 不批钱,安全红线不解除,单子死透。
写到这里我得停一下,说句可能挨骂的:这篇文章最值得看的不是翻车过程,是 Lena 的做法。
四页报告交上去,CTO 让她「再看一遍」。她没改,一个字没改。然后走侧门:跟运营总监在走廊上聊了几句,财务自己去重算了报价;跟安全架构师在茶水间提了一嘴,合规红旗自己升起来了。
评论区为这个吵翻:操纵还是领导力?我的看法偏一边。报告交了,数据都是真的,她只是让该看到数据的人看到了数据。让 60 万对 20 万的对比自己出现在预算会上,比在 all-hands 上跟 CTO 对着喊有用一百倍。这不叫操纵,这叫知道组织里真话走哪条管道。
你可以说理想世界里她该直接拍桌子。行,拍完呢?报告被打回重写第二次,然后呢?故事结尾她在琢磨自己出去开公司。我觉得这个结尾比任何升华都诚实。
顺带一提,文末那个 AI 复盘给她的操作打了「91.5% 的计策匹配度」。小数点后一位的计策匹配度!这数字的荒谬程度,跟「快 10 倍」是一个师门出来的。好故事配了个机器人味的尾巴,可惜了。
锐评评分卡:这篇故事值不值当读?值。采购场景里的经典水分——分母游戏、隐藏报价、合规盲区、演示话术——全浓缩在里面,而且每条都有具体数字兜着,不是空喊。这单黄得冤不冤?一点都不冤。20 万的报价藏着 60 万的账,俄勒冈的数据中心踩着合规红线,这样的单子成了才是冤。下次你们 CTO 再在 all-hands 上放这种 PPT,别管形容词多响,问三句:部署在哪,分环境怎么算,演示数据敢不敢换成上季度的真实数据。这三问甩出去,一半的「颠覆性」当场就哑了。