MoE-LLaVA:大规模视觉语言模型的专家混合

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

本文介绍了MoE-tuning训练策略,解决了大型视觉语言模型的多模态学习和模型稀疏性带来的性能退化问题。实验证明,MoE-LLaVA在视觉理解方面表现出色,并在对象幻象基准测试中超越了LLaVA-1.5-13B,与LLaVA-1.5-7B相媲美。

🏷️

标签

➡️

继续阅读