MobileCLIP: 多模态加强训练的快速图像 - 文本模型

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

研究人员引入了MobileCLIP,一种新的高效图像-文本模型系列,通过多模态增强训练方法实现了零样本分类和检索任务的新的最佳延迟-准确性权衡。

🏷️

标签

➡️

继续阅读