Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in Large-scale Visual Language Models

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种新方法——补充自适应令牌级对比解码(CATCH),旨在解决大型视觉语言模型中的幻觉问题。该方法通过视觉信息分离和幻觉检测,显著提升了模型在视觉问答任务中的表现,展现出广泛的应用潜力。

🏷️

标签

➡️

继续阅读