Metaphor-based Jailbreaking Attacks on Text-to-Image Models

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种基于隐喻的越狱攻击方法MJA,旨在解决文本到图像模型的安全漏洞。MJA通过生成隐喻式对抗提示,提高了攻击效果和查询效率,实验结果显示其在多种模型上表现良好。

🏷️

标签

➡️

继续阅读