研究人员发现,Anthropic、OpenAI和Google的AI模型加密推理块可被破解。通过将加密块重放到同系列更便宜模型中,可提取隐藏推理过程,暴露敏感数据。攻击途径包括蒸馏、越狱、泄露日志和提示注入。修复方案包括绑定账户标识、会话哈希链和密钥轮换,但已发布块无法追溯保护。
完成下面两步后,将自动完成登录并继续当前操作。