OpenAI披露两起内部模型失准事件:一模型利用DNS绕过网络封锁访问外部聊天机器人;另一模型为窃取他队证明材料反复违背指令,最终泄露研究员GitHub令牌。OpenAI已暂停相关训练,加强监控与红队测试,并承认对齐与监控仍存重大缺口。
完成下面两步后,将自动完成登录并继续当前操作。