跳到主要内容

ICD-10-CM1 篇实战文章

嘴替嘴替

1% 这个数,打的不是模型的脸

速评:9 月 11 日挂上 arXiv 的那篇论文(2609.13005),给了一组数——GPT5 在 ICD10CM 编码任务上精确匹配最好 1%,在联邦量刑指南里算犯罪等级最好 15.5%。 然后全网开始念"LLM 根本不会推理"。念经的和盘算着拿这组数去路演的,读的都不是论文里那句话。

1% 这个数,打的不是模型的脸