你有没有这种时刻:AI 把一段代码写得行云流水,你盯着它看了十分钟,最后张嘴是那句熟悉的台词——"写得挺好,但我怎么知道你对"。
【此处应有背景音乐:不响】
这不是段子。前两天 arXiv 上挂了篇预印本,讲的是把 Outram Park 热工水力仿真工具包里的几个开源库移植到 Rust,干这活的主力是 Claude Code。如果故事到此为止,那也就是又一桩"AI 写代码真棒"的学术 KPI。真正让我后脊梁发凉的是论文里那句:开发可靠仿真代码时,瓶颈已经不是代码生成,而是结合人类专家知识的验证与确认。
你看,我们把改 bug 叫渡劫这几年,渡的一直是"AI 写不出、写错了、瞎编了"这些劫。人家那边倒好,AI 写得快到你得反过来抢跑——代码是它生成的,物理是不是它瞎编的,得你拿着算例去验。
他们验的结果呢?腔体算例和 Sod 激波管算例,跟文献值吻合良好。"吻合良好"这四个字放在 CFD 行当里是什么分量,搞过的人都懂——那是"显灵"的书面表达,还是盖章版。让 AI 去移植 OpenFOAM 这种 C++ 祖传库到 Rust,它还真的把 Sod 激波管跑出来了。我盯着这个结论看了好一会儿,脑子里全是那个画面:某位工程师凌晨三点看着终端里的密度曲线贴上了文献值,整个人瘫进椅子里,发出一声混合着"我好强"和"它居然蒙对了"的长叹。
【此处省略二十一个图、十七个表的逐张抚摸】
是的,这篇论文一共 78 页,21 张图、17 个表。我数完页码的第一反应是:这不是论文,这是"工作没少干但每一步都有点心虚"的验收报告。相当一部分活是 AI 干的,但每一页背后都站着一个人类在瑟瑟发抖地做 V&V。用黑话总结就是:人负责稳,AI 负责浪,浪完了人还得拿 Moody 图给它兜底。
其实这里面最让我想笑又点头的是 TAMPINES 那一串库。他们把蒸汽表也扔给 AI 写了,初步结果跟 Moody 的 HEM 图对上,你品品,蒸汽表这种东西的脾气——错一个插值点,下游解算直接给你表演天女散花,而且查起来要命。他们甚至拿一维 HEM 求解器对着 Edwards 泄压案例验了一把,结果也贴上了。一个比一个硬的骨头,全押给一个"记性不好但特别自信的同事"。这份胆量,我愿称之为当代行为艺术。
论文里倒是有句我很服气的话:AI 确实提升了生产力,但人类专家提供的领域知识还是不可替代的。这话翻译成咱们的黑话就是——prompt 写得好的前提是你得懂行,否则你连"该让它验证什么"都描述不出来。你以为 prompt 工程的含金量在模板,实际含金量在"你能不能看出它把物理定律给改了"。
说到这就想起我上个月的经历:让 Claude Code 补一段换热器入口条件逻辑,它给我编了个"为确保收敛而引入的松弛系数",数值都给好了,注释一本正经,比我写的还像样。我翻了半天文档,没找到这个系数的出处,最后靠那套"AI 写的东西越顺溜越要存疑"的祖传直觉,把它拦下来了。事后我跟朋友说这事,他说"你都让 AI 干活了,怎么还跟防贼似的"。
不是防 AI,是防"工整的错"。代码可以是生成出来的,但"错得让读者一眼看不见"这件事,生成不了,得人自己扛。Sod 激波管这次对上了,下次它也大概率对得上,可搞热工仿真这种行当,赌的就是那一次没对上之前,你能先发现。
(郑重声明:本段子中的"凌晨三点"均为杜撰,但"面对 AI 的输出陷入二十秒哲学沉思"这个动作,在座各位大概率无一幸免。评论区扣个同款,下条见 🫠)
