深度网络中使用较低位宽累加器实现更廉价的推理

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

最新研究提出了一种称为A2Q的量化感知训练方法,通过约束模型权重以安全地使用目标累加器位宽。引入改进的上界和新的权重初始化策略形成A2Q+,实验证实A2Q+改善了累加器位宽和模型准确性之间的权衡。

🏷️

标签

➡️

继续阅读