生成具有有效性和自然性的大型语言模型对抗样本

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

攻击者可以使用视觉对抗样本来影响与大型语言模型连接的用户资源的机密性和完整性。这些攻击可以操控LLM调用工具,并保持与原始图像的高相似度。然而,对话没有受到显著影响。

🏷️

标签

➡️

继续阅读