Are Large Language Models Better than Reported? Detecting Label Errors and Their Impact on Model Performance

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究探讨了自然语言处理基准数据集的标签质量问题,提出利用大语言模型检测标签错误。研究表明,纠正这些错误能显著提升模型性能,说明模型的不足主要源于标签问题,而非模型本身。

🏷️

标签

➡️

继续阅读