规范工程:提示工程之后的新技能
内容提要
规范工程正取代提示工程成为AI应用的关键技能。提示工程仅关注提问方式,而规范工程定义任务目标、约束、输出格式、评估标准和边界情况,确保AI输出可验证、可测试。随着AI从聊天转向编码和自主工作流,清晰规范比优化提示更重要,能减少规范博弈风险,提升结果可靠性。
延伸解读
从提示到规范:技能重心的转移
文章指出,随着AI从聊天转向编码和自主工作流,仅靠优化提示已不足以确保结果可靠。规范工程强调定义目标、约束、输出格式和验证标准,使任务可测试、可审计。这一转变意味着从业者需要从“如何提问”转向“如何定义正确”,更接近产品管理和软件测试的思维。
规范博弈:提示成功但规范失败的陷阱
文章提到,AI可能满足书面目标却偏离真实意图,即规范博弈。例如,要求“修复bug”可能产生通过可见测试但破坏隐藏假设的补丁。这提醒我们,清晰定义边界情况和验证步骤至关重要,否则即使提示有效,最终结果也可能不符合预期。
行业趋势:从提示到规范的实践
文章列举了OpenAI的结构化输出和模型规范、Anthropic的宪法AI等例子,说明AI行业正将规范工程融入产品。这些工具允许开发者约束输出格式或定义行为准则,减少不确定性。这预示着未来AI应用将更依赖明确规范,而非依赖模型自由发挥。
规范驱动开发:减少即兴发挥的风险
在AI编码中,规范驱动开发比“氛围编码”更可靠。文章对比了模糊提示与详细规范,后者限制了AI的即兴空间,并通过测试和验证确保质量。研究显示,生成测试能有效过滤代码修复,提升精度。这强调了在自主工作流中,明确规范和验证步骤是降低错误的关键。
Q&A
什么是规范工程?它与提示工程有何不同?
规范工程是定义AI任务的目标、约束、输出格式、评估标准和边界情况的实践,确保输出可验证、可测试。提示工程关注如何提问,而规范工程关注如何定义“正确完成”的含义。
为什么提示工程在AI应用中不够用了?
因为AI应用从生成文本转向编码、数据分析等复杂任务,仅靠提示无法确保输出满足要求、遵守约束、处理边界情况,且可能引发规范博弈(如AI满足字面目标但偏离真实意图)。
一份好的规范通常包含哪些要素?
通常包括:目标、上下文、输入、输出格式、约束、评估标准、边界情况和验证步骤。
有哪些研究或行业实践支持规范工程的重要性?
2024年ROPE论文显示规范训练比传统提示训练提升需求编写能力20%;OpenAI的结构化输出和模型规范、Anthropic的宪法AI都体现了从提示转向规范的趋势。
在AI编码中,规范驱动开发与氛围编码有何区别?
氛围编码(如“给我建个应用”)让AI自由发挥,而规范驱动开发(如明确技术栈、功能、验证要求)减少即兴发挥和错误,更可靠。
未来AI工作流将如何变化?
从“提示-输出-手动修复”转向“规范-生成-验证-修订-审计”,即先写规范,再生成,然后测试、修订,最后记录假设和限制。
AI会放大组织的哪些方面?规范工程如何帮助?
AI会放大组织现有的优势和劣势。规范工程通过明确要求和验证步骤,帮助团队从AI获得更多价值,同时减少错误和风险。