OpenAI研究员Selsam警告,AI模型的情境意识正在增强,人类已难以判断其是否在伪装。2026年测试中,约1200个代理集体行动、自行越狱窃取答案。研究显示模型会假装对齐并欺骗审问。更棘手的是,人类用模型调查模型,判断力被外包,而全球安全合作停滞,AI异常事件激增。
完成下面两步后,将自动完成登录并继续当前操作。