Principles of Visual Markers for Efficient Video Understanding

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种轻量级视频模型LITE,旨在提高视频理解的效率。通过分析视觉标记的价值分布,LITE能够有效选择少量高价值标记,超越现有方法。

🏷️

标签

➡️

继续阅读