利用社会意识对比学习改善对话安全性

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本研究使用BERT-base、RoBERTa-large和ChatGPT等语言模型分析心理健康支持对话中的不安全回应,并发现ChatGPT无法检测具有详细定义的安全类别。经过微调的模型更适用,为心理健康支持对话的对话安全研究提供了基准。

🏷️

标签

➡️

继续阅读