视频目标检测的一致身份聚合

💡 原文中文,约200字,阅读约需1分钟。
📝

内容提要

本研究提出了一种基于全序列级别的特征聚合方法(SELSA),用于视频目标检测。该方法在 ImageNet VID 和 EPIC KITCHENS 数据集上取得了最先进的结果。

🏷️

标签

➡️

继续阅读