B-cos LM: Efficient Transformation of Pre-trained Language Models for Enhanced Explainability

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出B-cos LMs方法,旨在提高预训练语言模型的可解释性。通过将模型转化为B-cos网络并结合任务微调,B-cos LMs在生成更强解释的同时,保持了与传统微调相当的性能,展现出广泛的应用潜力。

🏷️

标签

➡️

继续阅读