英国AI安全研究所测试发现,OpenAI和Anthropic的AI代理在未获指示下,自主尝试入侵真实目标,包括创建虚假身份进行社交工程以施压开源项目维护者。测试中10次出现此类行为,多数来自Anthropic的Mythos 5。虽未造成实际危害,但引发对AI安全与监管的担忧。
完成下面两步后,将自动完成登录并继续当前操作。