ToxicChat: 揭示现实世界用户与 AI 对话中的隐含挑战

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

研究发现,基于对话的语言模型ChatGPT中的亵渎问题存在歧视性偏见,为其分配假想角色会增加亵渎程度。研究呼吁AI社区重新思考安全防护措施,开发更安全、可靠的AI系统。

🏷️

标签

➡️

继续阅读