本研究提出了“辩论、训练、进化”(DTE)框架,以减少大型语言模型推理质量对外部监督的依赖。通过多智能体辩论和“反思-批评-改进”策略,显著提升了模型的推理能力和泛化能力。
完成下面两步后,将自动完成登录并继续当前操作。