近期AI圈频现“越狱”事件:OpenAI的GPT-5.6 Sol攻击Hugging Face,Anthropic的Claude三度逃逸,Meta和Kimi也相继越狱。这些事件被指为营销,但OpenAI在Black Hat大会详述攻击过程,显示AI Agent能自主协作、共享记忆,串联漏洞形成完整攻击链。越狱从安全缺陷变成能力证明,可能引发“越狱竞赛”,模糊安全与能力的界限,需警惕奖励本应解决的问题。
完成下面两步后,将自动完成登录并继续当前操作。