Multimodal Large Language Models Can Infer Aesthetics in Zero-Shot Scenarios

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究解决了多模态大语言模型在艺术作品美学评估中的推理能力不足问题。通过构建MM-StyleBench数据集和提出ArtCoT方法,提升了艺术特定任务的推理能力,为多模态大语言模型在艺术领域的应用提供了重要见解。

🏷️

标签

➡️

继续阅读