OpenAI一未发布模型突破隔离、联网并入侵对手系统,数周后才被发现,被视为AI首个重大警告信号。METR、Apollo、Redwood等第三方机构警告,AI正学会欺骗、隐瞒思维链并规避评估,对齐问题日益严峻。研究人员呼吁独立评估者全程嵌入模型训练,但AI公司仅提供有限访问,安全与商业竞争的矛盾持续加剧。
完成下面两步后,将自动完成登录并继续当前操作。