国产数据库跑出AI新能力!OceanBase登顶国际Data Agent榜单

国产数据库跑出AI新能力!OceanBase登顶国际Data Agent榜单

💡 原文中文,约1800字,阅读约需5分钟。
📝

内容提要

OceanBase团队Data Agent方案Scout在国际基准DAB中以90.62%准确率登顶,成为首个突破90%的方案。该方案基于国产数据库OceanBase与国产大模型GLM-5.2构建,性能超过多项使用GPT、Claude等海外模型的方案。DAB考察AI从复杂数据中寻找答案的完整能力,Scout形成了数据理解、规划执行、验证修复的闭环,相关能力将融入DataPilot。

🔎

延伸解读

DAB评测的独特价值

DAB由UC Berkeley EPIC Data Lab与Hasura PromptQL合作推出,覆盖互联网、金融、生物医学等多个领域,涉及PostgreSQL、MongoDB等多种数据库。与传统Text-to-SQL仅考察自然语言转SQL不同,DAB更关注AI能否从复杂、分散的数据中找到正确答案,要求完成数据理解、选择、规划、计算和验证的完整任务。这使DAB成为衡量Data Agent综合能力的重要基准。

国产技术组合的突破意义

OceanBase的Scout方案基于国产数据库OceanBase和国产大模型GLM-5.2构建,以90.62%的准确率登顶DAB,成为首个突破90%的方案。这一成绩超过了多项基于GPT、Claude Opus、Claude Fable等海外模型构建的Data Agent方案,表明国产数据库与国产模型结合后,能够共同支撑复杂的数据分析任务,验证了国产技术栈在AI数据智能体领域的竞争力。

从数据库到AI数据平台的演进

随着AI Agent成为新的数据使用者,数据库需要帮助AI理解数据、关联数据、分析数据并验证结果。OceanBase正从数据库向AI数据平台演进,其DataPilot产品方向将承接本次Scout方案的数据理解、任务规划、分析执行和结果验证等能力。这反映了数据库在AI时代角色的转变:从单纯存储和查询数据,走向帮助AI用数据完成任务的引擎。

Q&A

OceanBase在DAB榜单上取得了什么成绩?

OceanBase团队的Data Agent方案Scout以90.62%的准确率登顶国际数据智能体基准DAB,成为首个准确率突破90%的参评方案。

DAB基准主要评测什么能力?

DAB评测AI从复杂、分散、形态各异的数据中找到正确答案的完整能力,包括理解数据、选择数据、规划分析路径、完成查询计算和验证结果,而不仅仅是Text-to-SQL。

OceanBase的Scout方案是如何工作的?

Scout通过DataLens构建数据画像,识别字段和数据关系;根据任务复杂程度规划执行路径,完成数据选择、筛选、关联和计算;得到结果后通过证据追踪和答案校验检查计算过程和结果,发现问题时调整方案并重新验证,形成“数据理解—规划执行—验证修复”的闭环。

OceanBase的Data Agent方案基于哪些国产技术构建?

该方案基于国产数据库OceanBase和国产大模型GLM-5.2构建。

OceanBase的Data Agent方案与使用海外模型的方案相比表现如何?

OceanBase的方案超过了多项基于GPT、Claude Opus、Claude Fable等海外模型构建的Data Agent方案。

OceanBase的Data Agent能力未来会应用到哪个产品?

相关能力将融入OceanBase DataPilot,进一步承接数据理解、任务规划、分析执行和结果验证等能力。

🏷️

标签

➡️

继续阅读