推进传统中文语言模型的评估:朝着综合基准套件迈进

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

该文章介绍了一项新的基准测试,专门针对传统汉语语言模型进行调整,评估结果表明,该模型在部分评估能力方面达到了与 GPT-3.5 相媲美的性能。

🏷️

标签

➡️

继续阅读