DME-Driver: 自主驾驶中融合人类决策逻辑与 3D 场景感知

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

ADriver-I是一种基于多模态大语言模型和扩散技术的自主驾驶世界模型。通过预测当前帧的控制信号和历史的视觉-动作对,以及生成的控制信号来预测未来的帧,实现了自主驾驶。在nuScenes和私有数据集上的实验中,ADriver-I表现出卓越的性能。

🏷️

标签

➡️

继续阅读