SpikeVideoFormer: 一种高效的脉冲驱动视频变换器,具有汉明注意力和 $\mathcal{O}(T)$ 复杂度

💡 原文中文,约700字,阅读约需2分钟。
📝

内容提要

本研究提出了SpikeVideoFormer,一种高效的脉冲驱动视频变换器,采用汉明注意力和线性时间复杂度。该模型在视频分类、人类姿态跟踪和语义分割等任务中表现优越,显著提升了脉冲神经网络的能效和性能。

🏷️

标签

➡️

继续阅读