内容提要
该文介绍开源工具iso-24495,它让AI编程助手遵循简明语言标准,减少回复废话。实验显示,应用后Claude代码审查回复字数减17%、句子数减32%,关键缺陷全保留;代码规则使入口函数位置更靠前,但仅对Claude效果显著。作者公开数据并承认测量错误,强调结论需谨慎验证。
延伸解读
规则只约束“说话”,不约束“写码”
实验显示,prose 风格规则只影响 AI 的注释和解释性文字,代码结构几乎不变:命名单元中位数从 11.5 变为 12,最长函数行数从 27 变为 21,文件总行数从 161.5 变为 154,所有实现均通过测试。作者明确表示,该工具针对“解释又臭又长”的问题,而非“代码没法看”的问题。读者应据此设定合理预期,避免误用。
模型差异显著:Claude 听话,Codex 和 Gemini 不听话
同样的代码规则,Claude 将所有入口函数放在文件前 22% 内,而 Codex 和 Gemini 在加入规则后,放在末尾的文件反而增多。作者推测 Codex 系统提示已含简明语言要求,对照组被污染;Gemini 注释极少,可能影响规则执行。这提醒我们,提示工程的效果因模型而异,不能一概而论。
测量陷阱与作者的自纠错
作者披露了三次测量错误:句子数降幅从 52% 修正为 32%,因句子分割器误判;早期实验因全局配置污染对照组而无效;第一版数据无法复现。测量脚本也经三次修复,最终采用语法树分析,并固定版本、公开哈希。这警示读者,AI 实验的测量极易出错,需谨慎核查。
结论的边界:支持与不支持
作者明确区分了支持与不支持的结论。支持的是:简明语言风格使代码审查回复缩短约六分之一,且关键缺陷未丢失;在 Claude 上,代码规则使入口点更靠前。不支持的是:任何“普遍提升代码质量”的说法,因为实验仅限单一模型、单一任务、单一语言,且入口位置指标是事后发现的,需预先注册并复现才能确认。
Q&A
iso-24495 是什么?它有什么作用?
iso-24495 是一个 MIT 许可的插件/技能包,旨在让 AI 编程助手(如 Claude Code、OpenAI Codex、Gemini)遵循 ISO 24495 简明语言标准来生成回复和代码。它通过约束 AI 的写作风格,使其用更短、更清晰的句子解释问题,减少冗余叙述,并附带代码规则来引导代码结构。
应用 iso-24495 后,Claude 的代码审查回复在字数和句子数上有什么变化?关键缺陷是否保留?
应用后,Claude 的代码审查回复平均字数减少 17%,句子数减少 32%,且关键缺陷(如依赖数组死循环)全部保留,仅省略少数次要观察。
iso-24495 的代码规则对 Claude 的代码结构有什么影响?
代码规则要求将公开入口函数放在文件最前面,每个单元只做一件事。在 Claude Opus 5 的测试中,应用代码规则后,所有生成的文件都将 evaluate 入口放在了文件前 22% 的位置,而对照组分散在开头或结尾。
iso-24495 对 Codex 和 Gemini 的效果如何?为什么?
对 Codex 和 Gemini 的效果不明显。可能原因:Codex 的系统提示中已有简明语言倾向,导致对照组被污染;Gemini 几乎不写注释,且其代码风格与规则不匹配。
作者在实验过程中犯了哪些错误?他是如何处理的?
作者犯了三次错误:1. 最初报道句子数减少 52%,后因句子分割器误判修正为 32%;2. 早期尝试因全局配置导致对照组失效;3. 第一版文章中的字数和句子数无法复现。他公开了所有数据、脚本和修复过程,并固定了脚本版本和哈希值。
作者明确支持和不支持的结论分别是什么?
支持的结论:简明语言风格使代码审查回复缩短约六分之一,同时抓住同样的主要缺陷;在 Claude 上,代码规则臂有更多命名单元和更靠前的入口点;全部 90 个实现通过 25 项测试。不支持的结论:任何关于“这能普遍提升代码质量”的说法,因为这只是单一模型、单一任务、单一语言的结果,且入口位置指标是事后发现的。
为什么 Codex 和 Gemini 在应用代码规则后,入口函数放在文件末尾的情况反而变多了?
作者认为这是“关联而非因果”,是“下一个该测的东西”。它指向了与规则目标相反的方向,但具体原因尚未明确。