SpeechComposer: 统一多个语音任务的提示组合

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本研究使用提示调整的视觉语言模型改善复合分类器性能。通过约束提示调整,复合模型在对象分类和属性分类数据集上的准确度与最佳基本模型相差不到2.5%,在UTZappos上平均提高了8.45%分类准确率。

🏷️

标签

➡️

继续阅读