Agent Safety Benchmark: Evaluating the Security of Large Language Model Agents

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了Agent-SafetyBench,评估16个大型语言模型(LLM)代理的安全性,结果显示所有代理的安全评分均未超过60%,表明其存在显著安全缺陷,亟需改进策略以提升安全性。

🏷️

标签

➡️

继续阅读