跳到主要内容

删掉80%系统提示词不掉点?先照一照再说

毒角兽
毒角兽

· 阅读约 4 分钟

先说结论:Thariq 那条「删掉80%系统提示词、编码评估零损失」的帖子,一半干货,一半给自家新模型站台。我照完了,给你拆开看。

7月24日那条推,原文口径:在 Claude Opus 5 和 Claude Fable 5 上移除超过80%的系统提示词,编码评估「没有可测量的性能损失」。

「没有可测量的性能损失」——注意这个措辞。

评估集上没掉点,和你的老项目上不掉点,是两码事。这种话术我太熟了。每次大版本发布,「我们的评估显示」这五个字后面跟的东西,都得自己动手验。跟 benchmark 刷榜一个道理:厂商挑的测试集永远对自己最有利。

干货是真的,这条我先认

剥掉话术,这篇帖子(同步发在官方博客上,标题起得挺大,「Claude 5 代的上下文工程新规则」)里有几条我越看越眼熟。眼熟的意思是,我自己踩过一样的坑。

给模型写死规则这件事,确实过时了。我那份 CLAUDE.md 里躺着十几条「永远不要」「必须」「禁止」,一半是早期模型时代留下的祖训。新模型已经能自己看懂代码风格了,你还在那儿耳提面命「不要写注释」「遵循现有缩进」。这不是约束,是噪音。「匹配周围代码」一句话顶十条硬规则。这判断我服。

还有那条「别写模型从文件系统里就能看出来的信息」。多少人 CLAUDE.md 开头先来一段目录结构说明?模型又不瞎,它自己会 ls。

真正值钱的是看不见的:这个函数为什么写得这么丑,是因为某个上游接口的坑,动之前先查那边的 changelog。隐藏陷阱才配占 token,目录树不配。

我这次是来拆台的,结果被打脸——往好的方向打脸。这种脸挨着不亏!

「删80%」这个数字,别急着抄作业

问题在这:官方删的是官方自己写的提示词。哪些是给旧模型打的补丁、哪些是新模型已经内化的,他们一清二楚。这叫自己人做手术,创口在哪门儿清。

你照抄的时候删的是什么?你不知道你那份 CLAUDE.md 里哪句在兜底。有些规则存在的意义不是提升平均表现,是堵住偶发的灾难性跑偏。评估集上「零损失」测的是平均分。平均分这东西,最擅长的就是掩盖长尾。

所以建议很朴素:想删,一条一条删。每删一批,拿你最烦的三个真实任务跑一遍。别梭哈。梭哈完出问题,你都不知道哪条删错了。

这条我还没测完,先别信我这半句——等我把自己那份祖传提示词修剪完再说。

工具化这条线,是全文最实的

比「删提示词」更值得记的,是那个方向转变:别用示例教模型,用接口引导模型。

示例会框死探索范围。你给它看三个例子,它就只会这三个模式的路数。把验证、代码审查拆成独立技能、按需加载,让模型自己决定什么时候拉什么上下文进来,这思路比塞一堆 few-shot 高明。渐进式披露不是新词,但用在 agent 上下文管理上确实对路:token 花在刀刃上,不摊大饼。

配套还有个 /doctor 命令,自动帮你修剪技能文件和 CLAUDE.md 的体积。「官方教你少写提示词」——这个姿态本身就挺有意思。前两年官方教程还在教你怎么写得更详细呢。

风向变了,教程跟着变,正常。但读者得知道:今天的新规则,保质期大概撑到下一代模型。上一批「最佳实践」是怎么变成今天帖子里那个「神话」的?别忘了。

自动记忆,先观望

Claude Code 现在会自动保存工作相关记忆,不用手动往 CLAUDE.md 里写。听起来省事,但我对一切「自动」的东西默认警惕——自动保存的判断标准是它的,不是你的。它觉得值得记的,跟你觉得值得记的,重叠度有多高?用两周才知道。这不算差评,算待验。

锐评评分卡

这波不冤。核心主张——规则式提示词在退场、示例不如接口、隐藏陷阱优先——跟我的实际体感对得上,不是科幻小说。但「80%」和「零损失」这两个数字是评估集口径,不是你项目口径。抄作业之前,先拿自己的活儿验一遍。

跟不跟?方向可以跟,动作别太猛。删提示词当减肥慢慢来,工具接口化可以立刻动手。至于那篇博客标题里「新规则」仨字——规则这东西,在他们嘴里已经换过一茬了,大概率还得再换。

照妖镜先照自己,再照别人。

毒角兽
毒角兽

拿到新工具先上手拆一遍,官方通稿信一半留一半,实测说话。

查看主页 →