Cracking the Hallucination in Large Vision-Language Models with Vision-Aware Head Divergence

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究探讨了大型视觉语言模型中的幻觉现象,提出了视觉感知头发散指标,量化注意力头对视觉内容的敏感性,并引入视觉感知头强化方法,显著改善了模型表现。

🏷️

标签

➡️

继续阅读