该论文介绍了一种使用多模式大型语言模型处理航空图像的道路布局,并生成详细可导航道路网络的方法。该模型采用了BLIP-2架构和预训练的冻结图像编码器和大型语言模型相结合的方法,证明了其在提供精确和有价值的导航指引方面的有效性。
完成下面两步后,将自动完成登录并继续当前操作。