MirroS团队发布AgentGarten,将代码物理环境与神经渲染器结合,让智能体在可交互世界中反复试错。捉迷藏实验中,躲藏者第4轮学会搭掩体,搜寻者第10轮学会翻墙,远快于传统强化学习。智能体通过撰写实验手册复盘经验,实现跨任务迁移,探索物理世界的递归自我改进。
完成下面两步后,将自动完成登录并继续当前操作。