Anthropic 删了 80% 提示词,但你不能照做

Anthropic 删了 80% 提示词,但你不能照做

💡 原文中文,约5000字,阅读约需12分钟。
📝

内容提要

Anthropic将Claude Code系统提示词删减超80%,评测显示无性能损失,但此结论不可推广。模型已掌握公共知识,删减的是冗余补丁;私有规则如团队约定、项目细节,模型无法自行推断,必须保留。控制应从事前规则转向事后验证,该薄的是公共部分,该厚的是私有部分,避免无评测的盲目删减。

🔎

延伸解读

删减的真相:补丁而非知识

Anthropic 删掉的 80% 提示词,大多是针对旧模型行为不稳定的“补丁”,而非传递新知识。例如“绝不要写多行注释”这类禁令,模型早已从训练语料中掌握,只是旧模型方差大,需要强规则压制。模型能力提升后,这些补丁自然冗余。因此,删减不掉分并不意外,但这一结论不可推广——你的提示词中补丁比例未必高,盲目模仿可能删掉真正有用的内容。

私有知识无法靠模型补足

模型学到的是世界的公共部分,而团队内部约定、项目细节等私有知识从未进入训练语料,模型再强也无法自行推断。例如“周五不发版”“禁用某库”等规则,必须显式写入提示词或文档。Anthropic 的 Claude Code 系统提示词面向所有用户,只能包含公共内容,因此删减安全;而你的 CLAUDE.md 和 skill 几乎全是私有知识,删减风险极高。

代价是迟到的:可追溯性与迁移性

删掉私有规则后,短期内可能看不出问题,但代价会在换模型或追溯决策时显现。写在文件里的知识可随模型迁移,而依赖模型“自己判断”的知识长在权重里,换模型即消失。此外,规则的价值一半在于留下决策痕迹,让模型自行判断会导致不可追溯,未来 code review 或事故复盘时无法解释“为什么这么写”。

控制位移:从事前规则到事后验证

Anthropic 的删减并非放弃控制,而是将控制从入口(事前规则)移到出口(事后验证)。事前规则只能接住你预料到的错误,而隐蔽错误需要测试、评分标准等事后验证来拦截。测试是二值的,不易被模型软性忽略,且留下明确的通过/失败记录。因此,总控制量并未减少,只是重心转移,读者不应误解为“什么都不用管”。

Q&A

Anthropic 删减 Claude Code 系统提示词超过 80% 后,编码评测结果如何?

Anthropic 删减了 Claude Code 系统提示词的 80% 以上,在其编码评测集上没有观察到可测量的性能损失。

为什么 Anthropic 能删掉 80% 的提示词而性能不下降?

因为被删掉的大部分是补丁,而非知识。这些补丁用于压制老模型的不稳定行为,例如禁止写多行注释,但模型已从训练语料中掌握了注释的写法,因此这些规则没有传递新信息。随着模型能力提升,这些补丁变得冗余。

为什么不能照搬 Anthropic 的做法删减自己的提示词?

因为 Anthropic 删减的是面向所有用户的公共提示词,其中补丁比例高,而用户的 CLAUDE.md 和 skill 中包含大量私有知识,如团队约定、项目细节,这些信息模型无法自行推断,删掉会导致性能下降。

哪些内容属于模型无法自行推断的私有知识?

私有知识包括团队内部约定(如周五不发版)、禁用库、项目特定结构(如类型定义集中在某文件)、审批流程、个人偏好(如“简洁”指不用黑话)等,这些从未进入训练语料,模型无法自行发现。

删减提示词后,代价为什么是迟到的?

因为删减后短期内可能看不出问题,但代价会在换模型时显现:写在文件里的知识可以迁移,而依赖模型判断的知识会丢失;另外,半年后可能无法追溯决策原因,因为推理过程被隐藏,规则的价值之一在于留下决策痕迹。

Anthropic 文章提到的六条‘过时的最佳实践’是什么?

六条包括:给模型定死规则改为让模型自己判断;给工具用法示例改为把语义设计进接口;把信息全部前置改为按需加载;重要的话说三遍改为说一次并放进工具描述;记忆写进 CLAUDE.md 改为让模型自动存取;用简单 markdown 写规格改为提供测试套件、代码、评分标准等丰富引用。

根据文章,应该如何区分该删和该留的提示词内容?

判据是这份知识模型能否自己重新发现。补丁(如别写多行注释)和环境信息(如类型定义位置)模型能自己发现,可以删;约定(如禁用库、发版窗口)读不出来但有文档,应薄成一个指针指向文档;取舍类知识(如术语要换白话)只在你脑子里,应写厚。

文章认为控制应该从哪个方向转变?

控制应从事前规则转向事后验证。事前规则只能接住预料得到的错误,而事后验证(测试、评分标准)能接住预料不到的隐蔽错误。总控制量没有减少,只是从入口挪到了出口。

🏷️

标签

➡️

继续阅读