A2Q: 累加器感知量化与溢出保护

💡 原文中文,约600字,阅读约需2分钟。
📝

内容提要

本文介绍了一种新颖的权重量化方法,用于训练量化神经网络(QNNs)以避免低精度累加器溢出问题。该方法通过受权重归一化启发的公式,限制模型权重的L1范数,促进非结构化权重稀疏性以避免溢出。实验结果表明,该方法可以训练适用于低精度累加器的QNNs,并在FPGA上部署模型时提高资源效率。

🏷️

标签

➡️

继续阅读