自反馈 DETR 用于时态行为检测

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

本论文介绍了一种改进的DETR检测器,采用简洁设计,使用单尺度特征图和全局交叉注意力计算,没有特定的局部约束。通过添加盒子到像素相对位置偏差项和基于遮蔽图像模型的骨干预训练,改进的DETR检测器在原始DETR检测器的基础上取得了显著的改进。使用Object365数据集进行预训练,达到了63.9的平均精度(mAP),与最先进的检测器性能相媲美。

🎯

关键要点

  • 本论文介绍了一种改进的DETR检测器,采用简洁设计。
  • 改进的DETR使用单尺度特征图和全局交叉注意力计算,没有特定的局部约束。
  • 提出了两种技术来弥补多尺度特征图和局部性约束缺失的问题。
  • 第一种技术是将盒子到像素相对位置偏差项添加到交叉注意力公式中。
  • 第二种技术是基于遮蔽图像模型的骨干预训练,帮助学习细粒度定位能力的表示。
  • 结合这些技术和最新的训练方法,改进的DETR在原始DETR的基础上取得显著改进。
  • 使用Object365数据集进行预训练,达到了63.9的平均精度(mAP),与最先进的检测器性能相媲美。
  • 代码在指定的URL中提供。
➡️

继续阅读