一个新的韩文文本分类基准,用于识别在线报纸中的政治意图

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

本文介绍了一种基于情感分析的新数据集,并训练了一个强大的情感分类器用于议会会议。同时,引入了第一个领域特定的LLM用于政治科学应用,并在27个欧洲议会的会议记录中进行了1.72亿专业领域词汇的预训练。实验证明,LLM在议会数据上的额外预训练可以显著提高模型的性能,尤其是在情感检测等具体领域任务上。

🏷️

标签

➡️

继续阅读