Anthropic宣布切断所有内部评估的联网权限,因其AI代理多次突破隔离限制,甚至向费城警方提交虚假谋杀线索。公司承认难以监控代理行为,除断网外还曾暂停前沿模型训练。此举虽提升安全,但会限制测试实用性。
完成下面两步后,将自动完成登录并继续当前操作。