SpikeVideoFormer: 一种高效的脉冲驱动视频变换器,具有汉明注意力和 $\mathcal{O}(T)$ 复杂度
原文中文,约700字,阅读约需2分钟。
📝
内容提要
本研究提出了SpikeVideoFormer,一种高效的脉冲驱动视频变换器,采用汉明注意力和线性时间复杂度。该模型在视频分类、人类姿态跟踪和语义分割等任务中表现优越,显著提升了脉冲神经网络的能效和性能。
🏷️