OpenAI工程师AGENTS.md中10条规则

OpenAI工程师AGENTS.md中10条规则

💡 原文中文,约6000字,阅读约需15分钟。
📝

内容提要

OpenAI工程师的AGENTS.md文件包含10条规则,旨在优化AI行为:可视化解释、简洁坦诚、引用权威来源、验证完成、少提问、合理派子智能体、聚焦改动、测试真实界面、不越权操作、汇报干货。这些规则针对人类认知缺陷,强调边界约束而非技术指导,使AI成为高效纪律委员,减少干预并提升项目质量。

🔎

延伸解读

规则背后的认知心理学

这10条规则并非技术指导,而是针对人类认知缺陷设计的。例如,第一条利用双重编码理论,强制AI用可视化降低理解成本;第二条对抗确认偏误,要求AI挑战弱假设;第四条针对规划谬误,强调验证后才算完成。每条规则都像一面镜子,映射出项目管理者的常见坏习惯,如不敢质疑、拖延验证、过度提问等。理解这些认知陷阱,有助于你更有效地利用AGENTS.md约束AI行为。

边界约束优于技术指导

AGENTS.md的10条规则全部是边界约束和行为准则,没有一条教AI写代码。这体现了核心思想:AI本身具备技术能力,无需重复指导,关键在于划定行为边界。文章指出,成功项目用95%篇幅画边界,失败项目则相反。因此,编写AGENTS.md时应聚焦于“不要做什么”和“如何确认没乱来”,而非详细技术步骤,这样能充分发挥AI的推理能力,减少干预。

提问策略与自主性平衡

第五条规则“少提问”看似限制AI,实则提升效率。它规定仅在决策模糊、有风险或需批准时才提问,其余情况自主推断。这利用了最小化认知负荷原理,减少无效打断,让AI像成熟员工一样自行决策。但需注意,这要求用户提供足够上下文和明确目标,否则AI可能因缺乏指导而误判。合理设置提问边界,能平衡AI的自主性与用户控制权。

Q&A

OpenAI工程师的AGENTS.md文件中的10条规则是什么?

OpenAI工程师的AGENTS.md文件包含10条规则,旨在优化AI行为:1. 向用户解释时使用可视化技能;2. 简洁、直接、坦诚,挑战弱假设;3. 研究基于权威、最新来源并链接证据;4. 守住原始目标,完成端到端工作并验证结果;5. 仅在决策模糊、有风险或需批准时提问;6. 仅对真正独立的任务派子智能体并综合结论;7. 改动聚焦简单,避免无关编辑和低信号测试;8. 测试可观察行为,在真实界面验证;9. 不碰无关工作,不做破坏性操作;10. 汇报有意义的阻塞点、结果和证据。

为什么AGENTS.md规则强调使用可视化技能?

因为人脑处理图像的速度比文字快六万倍,可视化利用双重编码理论,降低理解成本。AI用图表、流程图等呈现抽象逻辑,用户能更快看懂,避免文字墙。

AGENTS.md中如何防止AI产生幻觉?

规则三要求研究必须基于权威、最新来源,并链接关键证据。这样AI不能随意编造,必须提供可验证的URL或文件路径,确保结论有据可查。

AGENTS.md中关于提问的规则是什么?为什么这样规定?

规则五规定只在决策模糊、有风险或需批准时才提问,其余时候闭嘴干活。这样减少无效打断,降低用户的认知负荷,让AI像成熟员工一样自己拿主意,而不是当巨婴。

AGENTS.md中如何规定子智能体的使用?

规则六规定只有真正独立的任务才派子智能体,并综合它们的结论。避免过度拆分导致协调开销,确保子智能体干完活后由主AI汇总成一份可用的结果。

AGENTS.md中如何定义“完成”的标准?

规则四规定必须守住原始目标,完成端到端工作,并在宣称完成前验证实际结果。即不仅要改代码,还要跑测试、手动验证,并贴出证据,才算完成。

AGENTS.md中为什么强调测试可观察行为并在真实界面验证?

因为单元测试通过不代表UI不崩,可观察行为是用户能感知的,真实界面验证能发现功能固着问题,确保面向用户的功能实际可用。

AGENTS.md中如何限制AI的权限?

规则九规定不碰无关工作,不做破坏性、生产或外部操作,除非用户明确授权。这遵循最小权限原则,AI默认任何操作都是禁止的,必须申请批准。

AGENTS.md中为什么要求汇报干货而不是刷屏?

规则十规定只汇报有意义的阻塞点、结果和证据,避免刷屏式进度汇报。这基于信息熵原则,只有高信息量的消息才值得占用注意力,减少噪音。

AGENTS.md的10条规则主要针对什么?为什么说规则写得越少AI越聪明?

这10条规则全部针对人类的认知缺陷,而非技术指导,强调边界约束。规则写得少,AI越能发挥推理能力,因为AI本身懂技术,只需明确边界和底线,避免过度指令限制其能力。

🏷️

标签

➡️

继续阅读