Unsupervised Topic Models as Data Mixers for Language Pre-training Models

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种细粒度主题的数据混合策略,旨在提升大语言模型在“科学”和“关系”主题上的表现,解决预训练数据的质量和多样性问题。

🏷️

标签

➡️

继续阅读