EtC:弱监督视频定位的时序边界扩展再澄清方法(Multimodal 大型语言模型)

💡 原文中文,约200字,阅读约需1分钟。
📝

内容提要

UniVTG框架通过统一视频时序定位的标签和任务,提高定位能力。实验证明该框架在三项任务上有效灵活。

🏷️

标签

➡️

继续阅读