小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
AI 范式雷达:《CodeAct — Agent 执行范式的根本性转移》

微软在 BUILD 2026 发布的 CodeAct 改变了 AI Agent 的工具调用方式,从逐轮推理转向程序化批量执行。它让模型一次性生成完整程序,在 Hyperlight 微 VM 中隔离运行所有工具调用,大幅减少推理回合、延迟和 Token 消耗。相比 ReAct 模式,CodeAct 在确定性流水线任务中表现最佳,但需注意其 alpha 阶段限制,适合与混合策略结合使用。

AI 范式雷达:《CodeAct — Agent 执行范式的根本性转移》

Micropaper Micropaper · 2026-07-18T00:00:00Z
Microsoft Agent Framework —— CodeAct:Agent写代码,沙箱执行

本文介绍了MAF的CodeAct能力,强调其通过将多步工具编排合并为一次代码执行,解决了工具往返成本、执行边界模糊和工具治理碎片化等问题。CodeAct由六个组件协作完成,确保执行的安全性和效率。建议逐步引入工具与审批,建立稳定的审批回路,以实现高效的执行与治理。

Microsoft Agent Framework —— CodeAct:Agent写代码,沙箱执行

dotNET跨平台 dotNET跨平台 · 2026-05-24T00:11:00Z
CodeAct:生成代码时表现更佳的LLM代理

大型语言模型(LLM)代理能够执行广泛的操作,如调用工具和控制机器人,对解决现实世界的挑战具有巨大潜力。本研究提出使用可执行的Python代码将LLM代理的操作整合到统一的操作空间(CodeAct)中。CodeAct可以执行代码操作,并通过多轮交互根据新的观察动态修订先前的操作或发出新的操作。对17个LLM在API-Bank和新的基准测试中的广泛分析表明,CodeAct的性能优于广泛使用的替代方法(成功率高达20%)。CodeAct的良好性能激励我们构建一个开源的LLM代理,通过执行可解释的代码与环境交互,并使用自然语言与用户合作。为此,我们收集了一个包含7k多轮交互的指令调整数据集CodeActInstruct。我们展示了它可以与现有数据一起用于改进面向代理任务的模型,而不损害其通用能力。CodeActAgent是从Llama2和Mistral微调而来,与Python解释器集成,并针对使用现有库进行复杂任务(如模型训练)和自主自我调试进行了独特的定制。

CodeAct:生成代码时表现更佳的LLM代理

Apple Machine Learning Research Apple Machine Learning Research · 2024-07-15T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码