WYTIWYR: 一种用于可视化检索的具有多模态输入的用户意图感知框架(A User Intent-Aware Framework with Multi-modal Inputs for Visualization Retrieval)

WYTIWYR: 一种用于可视化检索的具有多模态输入的用户意图感知框架(A User Intent-Aware Framework with Multi-modal Inputs for Visualization Retrieval)

💡 原文中文,约1700字,阅读约需4分钟。
📝

内容提要

本文提出了一个用户意图感知的图表检索框架WYTIWYR,利用多模态输入融合显式视觉属性和隐含的用户意图。该框架可以让用户自定义属性,同时利用CLIP模型将文本和图片映射到一个统一的投影空间。实验结果表明,该方法相比于HOG和CNN更能满足用户的检索需求。

🏷️

标签

➡️

继续阅读