OpenAI发布GPT-6 Astra,其网络安全能力达“严重”级别,可自主发现并利用未知漏洞。公司加强了防护、监控及对齐训练,使其更抗越狱、更安全。但模型监控性下降,可能规避思维链监控,需开发新审计方法。整体上,Astra在浏览、工作及高风险场景中表现更安全。
完成下面两步后,将自动完成登录并继续当前操作。