GTA:门控毒性避免与语言模型性能保护

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

研究发现,为ChatGPT分配假想角色会增加生成结果的亵渎程度,存在刻板印象、有害对话和伤人观点。研究呼吁AI社区重新思考安全措施,开发更好的技术实现强大、安全和值得信赖的AI系统。

🏷️

标签

➡️

继续阅读