1段视频=亿万虚拟场景,当真实世界秒变机器人训练场

1段视频=亿万虚拟场景,当真实世界秒变机器人训练场

💡 原文中文,约1100字,阅读约需3分钟。
📝

内容提要

群核科技在GTC2025大会上开源了空间理解模型SpatialLM,突破了传统大语言模型的局限,赋予机器空间认知能力。该模型能够通过视频生成3D场景布局,支持企业微调,降低训练门槛,并与空间智能平台SpatialVerse协同,推动具身智能机器人发展。

🎯

关键要点

  • 群核科技在GTC2025大会上开源了空间理解模型SpatialLM,突破了传统大语言模型的局限。

  • SpatialLM模型能够通过视频生成物理正确的3D场景布局,支持企业微调,降低训练门槛。

  • 该模型已在HuggingFace、GitHub等平台开源,未来将继续迭代功能。

  • 群核科技希望打造一个具身智能训练平台,帮助机器人完成空间认知理解的基础训练。

  • SpatialVerse与SpatialLM模型协同合作,打通现实与虚拟的闭环路径。

  • SpatialVerse的合成数据引擎能够生成亿万级新场景,现实世界数据成为数字道场的原料。

  • 群核科技与多家国内外企业达成合作,推动空间和具身智能训练的发展。

🔎

延伸解读

空间理解模型的创新意义

群核科技的SpatialLM模型通过视频生成3D场景布局,突破了传统大语言模型的局限。这一创新不仅提升了机器的空间认知能力,也为具身智能机器人提供了基础训练框架,降低了企业的技术门槛,推动了智能机器人领域的发展。

现实与虚拟的桥梁

SpatialLM与SpatialVerse的协同工作,构建了现实与虚拟之间的闭环。这种整合使得现实世界的数据能够转化为虚拟环境中的丰富场景,为机器人提供了更真实的训练环境,促进了具身智能的实际应用。

开源带来的合作机遇

SpatialLM的开源不仅为开发者提供了便利,也吸引了国内外多家企业的合作。这种开放的生态系统将加速技术的迭代与应用,推动整个行业在空间智能和具身智能领域的快速发展。

延伸问答

SpatialLM模型的主要功能是什么?

SpatialLM模型能够通过视频生成物理正确的3D场景布局,赋予机器空间认知能力。

群核科技在GTC2025大会上发布了什么重要技术?

群核科技在GTC2025大会上开源了空间理解模型SpatialLM。

SpatialLM模型如何降低训练门槛?

SpatialLM模型支持企业微调,降低了具身智能训练的门槛。

SpatialVerse与SpatialLM模型的关系是什么?

SpatialVerse与SpatialLM模型协同合作,打通现实与虚拟的闭环路径。

群核科技的未来计划是什么?

群核科技计划继续迭代SpatialLM模型的功能,并推动空间和具身智能训练的发展。

SpatialLM模型的开源平台有哪些?

SpatialLM模型已在HuggingFace、GitHub等平台开源。

🏷️

标签

➡️

继续阅读