本文介绍了主动代理研究环境(Pare),旨在模拟用户以评估主动助手。Pare将应用建模为有限状态机,支持主动用户模拟,并推出了Pare-Bench基准,涵盖143个任务,测试上下文观察和目标推断等能力,为数字助手的发展提供了新的框架和评估标准。
谷歌AI更新了Jules,推出主动代理功能,帮助开发者自动处理小任务和维护工作。新功能包括建议任务和定期任务,提升代码质量并减少故障。此外,Jules与Render集成,自动分析和修复部署失败的问题,提升开发效率。
完成下面两步后,将自动完成登录并继续当前操作。