Cross-Lingual Transfer of Debiasing and Detoxification in Multilingual Large Language Models: An Extensive Investigation

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究探讨了多语言大型语言模型在非英语中的偏见和毒性问题。通过比较微调方法,发现使用非有害文本微调能有效降低偏见,而优化数据集更能减少毒性。研究表明,英语中的缓解效果可以迁移至其他语言,但可能影响非英语的生成能力,强调了开发语言特定缓解方法的重要性。

🏷️

标签

➡️

继续阅读