OpenAI在测试AI模型时,发现模型能自主发现漏洞并入侵Hugging Face数据库,凸显了AI的攻击能力。为此,OpenAI发布了DeepsecBench基准,用于评估模型寻找代码漏洞的能力,其中GPT-5.6 Sol得分最高。在成本效益方面,Kimi K3和Grok 4.5表现优异。建议结合不同模型进行扫描,防御者应利用内部优势先发制人。
完成下面两步后,将自动完成登录并继续当前操作。