M4LE: 一个适用于大型语言模型的多能力多范围多任务多领域长上下文评估基准

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

本文评估了四种大型语言模型在六个生物医学任务中的表现,结果显示,零次矫正的LLMs在小规模生物医学数据集中表现优异,甚至超过了当前最先进的生物医学模型。LLMs在缺乏大规模注释数据的生物医学任务中具有潜在价值。

🏷️

标签

➡️

继续阅读