自护:赋予 LLM 保护自身能力

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

研究发现语言模型的人工智能安全训练和红队测试存在语言不平等性跨语言漏洞,呼吁加强整体红队测试工作,开发具有广泛语言覆盖能力的多语言安全保护措施。

🏷️

标签

➡️

继续阅读