MiniPLM: Knowledge Distillation for Pre-trained Language Models

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了MiniPLM框架,解决了预训练语言模型知识蒸馏的效率与有效性问题。通过优化训练数据分布,显著提升了学生模型在多个任务上的性能,并降低了计算需求。

🏷️

标签

➡️

继续阅读