Instruct2Attack: 语言引导的语义对抗攻击

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

研究人员提出了一种名为Instruct2Attack(I2A)的基于语言引导的语义攻击方法,利用潜态扩散模型生成对抗性潜态编码,生成更自然和多样的对抗性样本。通过GPT-4自动化攻击过程,生成多样的图像特定文本指令。研究表明,I2A能够成功破解深度神经网络,并具有强大的迁移能力。

🏷️

标签

➡️

继续阅读