理解DeepSeek模型安全边界的研究:评估与发现

💡 原文中文,约600字,阅读约需2分钟。
📝

内容提要

本研究首次全面评估DeepSeek模型的安全性,发现其在生成内容方面存在显著脆弱性,尤其在中国社会文化背景下。这为提升大型基础模型的安全性提供了重要见解。

🏷️

标签

➡️

继续阅读