SALSA-CLRS:一种稀疏且可扩展的算法推理基准

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

本研究探讨了 Dynamic Sparse Training (DST) 在连续学习中的影响,发现在低稀疏度下,ERK 初始化更有效,而在高稀疏度下,均匀初始化更可靠。适应性是提升连续学习效果的有希望的方法。

🏷️

标签

➡️

继续阅读