小红花·文摘

研究评估了多种大语言模型在心理健康任务中的性能，发现LLMs在零样本和少样本提示设计上有限但有希望的表现。指令微调可以显著提升LLMs在所有任务上的性能。最佳微调模型Mental-Alpaca在平衡精度上比GPT-3.5高出16.7％，与最先进的任务特定模型相媲美。提供了行动指南，帮助研究人员、工程师和实践者在心理健康领域中使用LLMs。

LLM 指令微调的提示权重实验

BriefGPT - AI 论文速递 ·

研究评估了多种大语言模型在心理健康任务中的表现，发现LLMs在零样本和少样本提示设计上具有有限但有希望的性能。指令微调可以显著提升LLMs在所有任务上的表现。最佳微调模型Mental-Alpaca在平衡精度上比GPT-3.5高出16.7％，并与最先进的任务特定模型相媲美。研究总结了一系列行动指南，介绍如何赋予LLMs更好的心理健康领域知识，并成为心理健康预测任务的专家。

UQ 在 #SMM4H 2023 中：利用社交媒体进行公共卫生分析的 ALEX

BriefGPT - AI 论文速递 ·

本文对多种大语言模型进行了评估，包括Alpaca、Alpaca-LoRA和GPT-3.5，针对在线文本数据中的心理健康预测任务。实验结果显示，LLMs在零样本和少样本提示设计上有限但有希望的性能。指令微调可以显著提升LLMs在所有任务上的表现。最佳微调模型Mental-Alpaca在平衡精度上比GPT-3.5高出16.7％，与最先进的任务特定模型相媲美。提供了行动指南，介绍如何赋予LLMs更好的心理健康领域知识，并成为心理健康预测任务的专家。

针对在线性侵犯聊天和辱骂性文本的细调 Llama 2 大型语言模型

BriefGPT - AI 论文速递 ·

LLM 指令微调的提示权重实验

基于量化的 LLaMa 模型在巴西中学考试上的基准测试

大规模语言模型的公共卫生平衡和可解释的社交媒体分析

UQ 在 #SMM4H 2023 中：利用社交媒体进行公共卫生分析的 ALEX

针对在线性侵犯聊天和辱骂性文本的细调 Llama 2 大型语言模型