针对在线性侵犯聊天和辱骂性文本的细调 Llama 2 大型语言模型

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

本文对多种大语言模型进行了评估,包括Alpaca、Alpaca-LoRA和GPT-3.5,针对在线文本数据中的心理健康预测任务。实验结果显示,LLMs在零样本和少样本提示设计上有限但有希望的性能。指令微调可以显著提升LLMs在所有任务上的表现。最佳微调模型Mental-Alpaca在平衡精度上比GPT-3.5高出16.7%,与最先进的任务特定模型相媲美。提供了行动指南,介绍如何赋予LLMs更好的心理健康领域知识,并成为心理健康预测任务的专家。

🏷️

标签

➡️

继续阅读