BLESS:句子简化上的大型语言模型基准测试

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

本文评估了四种大型语言模型在六个生物医学任务中的性能,结果显示零次矫正的LLMs在小训练集的生物医学数据集中效果超过了当前最先进的生物医学模型。不同LLMs的性能可能因任务而异。虽然LLMs的性能仍然相当差,但在缺乏大规模注释数据的生物医学任务中具有潜在的价值工具。

🏷️

标签

➡️

继续阅读