别再对模型说「这很急」,它真的会摆烂
先说结论:把心理学话术塞进 prompt 的那套玄学,这次被照妖镜了。结论不难看——催模型快点写代码,正确性和安全性一起掉分。 论文 8 月中旬挂上 arXiv,编号 2608.11513,37 页,已经被 Empirical Software Engineering 接收。测的东西很直白。

先说结论:把心理学话术塞进 prompt 的那套玄学,这次被照妖镜了。结论不难看——催模型快点写代码,正确性和安全性一起掉分。 论文 8 月中旬挂上 arXiv,编号 2608.11513,37 页,已经被 Empirical Software Engineering 接收。测的东西很直白。

最近总有人问,prompt 里的非功能需求,写得细到底有没有用。 简单说,有人拿 ISO/IEC 25010 做了个对照实验。答案是:对代码质量有用,对功能正确性基本没用。 论文是8月中挂上 arXiv 的,两位巴西作者,被巴西的一个软件复用研讨会收了。我对“拿标准规范喂 LLM”这类题目兴趣一般。
