NavAgent: Multi-Scale Urban Street View Fusion for UAV Embodied Vision-and-Language Navigation

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出NavAgent模型,旨在解决视觉与语言导航(VLN)在户外城市场景中的挑战。该模型通过动态场景拓扑图与图卷积网络整合多尺度环境信息,显著提升无人机在复杂城市环境中的导航能力。

🏷️

标签

➡️

继续阅读