小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

Gemini Robotics-ER 1.6是最新的机器人推理模型,提升了空间推理和多视角理解能力,使机器人能更精准地理解环境,执行复杂任务,如读取仪器数据,并在动态环境中进行推理。该模型增强了安全性,更好地遵循物理安全约束。开发者可通过Gemini API和Google AI Studio使用此模型。

Gemini Robotics-ER 1.6:通过增强的具身推理驱动现实世界的机器人任务

Google DeepMind Blog Google DeepMind Blog · 2026-04-13T15:52:13Z
DeepMind发布Gemini Robotics-ER 1.5,用于具身推理

谷歌DeepMind推出Gemini Robotics-ER 1.5,这是一个支持空间推理和多步骤规划的机器人推理模型。开发者可以通过Google AI Studio和Gemini API预览该模型,并调整思维预算以平衡响应延迟和推理准确性。Gemini Robotics结合了推理模型与视觉-语言-动作模型,提升了机器人的推理能力,并在15个基准测试中表现优异,适用于多种机器人平台。

DeepMind发布Gemini Robotics-ER 1.5,用于具身推理

InfoQ InfoQ · 2025-09-30T10:44:00Z

本文介绍了一种基于视觉语言模型的3D场景理解框架,旨在提升机器人在复杂环境中的推理能力。通过训练开放式模型RegionPLC,结合视觉提示和对比学习,显著提高了3D场景理解效果。同时,研究探讨了增强现实与知识推理的交互机制,以及利用大型语言模型提升3D视觉理解和导航能力,展示了在室内环境中实现复杂智能体交互的新可能性。

空间感知AI的多模态3D融合与现场学习

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-06T00:00:00Z

本文介绍了一种基于视觉语言模型的3D场景理解框架,涵盖了RegionPLC、Chat-3D和Scene-LLM等模型。这些模型结合了大型语言模型和3D视觉特征,提升了机器人在复杂环境中的推理和交互能力。研究表明,这些模型在多个3D基准测试中表现优越,展示了3D视觉与语言模型结合的潜力。

SceneGPT:一种用于三维场景理解的语言模型

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-13T00:00:00Z

本文介绍了基于大规模语言模型(LLM)和强化学习(RL)的新方法,如KSL、BLINDER和Statler。这些方法通过自我监督、状态表示和任务条件化,提高了任务成功率和样本效率,增强了机器人推理和决策能力,展示了LLM在RL中的应用潜力。

LLM 增强型状态表示用于强化学习

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-07-18T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码