本文介绍了Med-HallMark基准,旨在提高医学多模态领域中大型视觉语言模型(LVLMs)的幻觉检测与评估。提出了MediHall Score和MediHallDetector,并分析了LVLMs中的幻觉问题,提供了缓解建议,建立了新的评估框架和数据集,以增强医疗领域语言模型的安全性和可靠性。
完成下面两步后,将自动完成登录并继续当前操作。