CFSafety:针对大型语言模型的全面细化安全评估

💡 原文中文,约700字,阅读约需2分钟。
📝

内容提要

本研究针对大型语言模型(LLMs)的安全风险,提出了CFSafety评估基准,包含10个安全分类的问题集。评估结果显示,尽管GPT-4表现优异,但在安全有效性方面仍需改进,为未来模型安全性提升提供了重要参考。

🏷️

标签

➡️

继续阅读