减轻人为偏见的冒犯性语言检测的语言模式开发

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文研究了使用乌克兰推文的伪标记敏感数据的方法,重点关注俄乌战争相关主题。通过实验,突出了数据标注的三个主要阶段,并对获得的数据进行了基础统计分析和模型评估。这为科学家在不涉及标注人员的情况下利用语料库进行更高级的研究提供了指导。

🏷️

标签

➡️

继续阅读