GOAT-Bench: 多模态大型模型的安全洞察力通过基于模因的社交滥用

💡 原文中文,约2700字,阅读约需7分钟。
📝

内容提要

社交媒体的指数增长改变了信息的创造、传播和吸收方式,但也导致了网络违规使用表情包的增加。本文研究了大型多模型识别和应对表情包中的社交虐待能力,并提出了GOAT-Bench表情包基准。实验结果显示当前模型对隐性虐待形式缺乏敏感性。

🏷️

标签

➡️

继续阅读