该研究系统评估了推理时扩展在本地计算机使用Agent中的效果,发现额外计算不提高成功率,仅改变失败模式。上下文扩展改善轨迹稳定性但收益饱和,时间扩展延长错误轨迹而非纠正。结构分解和并行扩展部分缓解问题但成本高昂,表明本地模型缺乏长程任务自我修正能力。
完成下面两步后,将自动完成登录并继续当前操作。