MoTaDual: Modality-Task Dual Alignment for Enhanced Zero-shot Composed Image Retrieval
原文英文,约100词,阅读约需1分钟。
📝
内容提要
该研究提出了MoTaDual框架,旨在解决复合图像检索中的高成本和零-shot能力不足的问题。通过模态-任务双重对齐,显著提升了检索性能,降低了训练时间和计算成本。实验结果表明,该框架在多个基准测试中表现优异。
🎯
关键要点
-
该研究提出了MoTaDual框架,旨在解决复合图像检索中的高成本和零-shot能力不足的问题。
-
MoTaDual框架通过模态-任务双重对齐,显著提升了检索性能。
-
该框架有效减轻了任务和模态间的不一致性。
-
实验结果表明,MoTaDual在多个基准测试中表现优异,达到了最佳性能。
-
MoTaDual框架保持了低训练时间和计算成本。
🏷️