OpenAI在QCon AI NYC:企业的微调

OpenAI在QCon AI NYC:企业的微调

InfoQ InfoQ ·

在2025年QCon AI NYC大会上,OpenAI的Will Hang介绍了Agent RFT,这是一种强化微调方法,旨在提升工具使用代理的性能。他强调了优化提示和任务的重要性,并提出了监督微调和偏好优化等多种微调选项。Hang指出,强化微调适合需要探索策略的任务,并强调了在整个轨迹中进行信用分配的重要性。Zi展示了实际应用案例,强调了在工具调用预算下的有效内容定位。

原文英文,约700词,阅读约需3分钟。
阅读原文