研究人员发现,Anthropic、OpenAI和Google的AI模型加密推理块可被破解。通过将加密块重放到同系列更便宜模型中,可提取隐藏推理过程,暴露敏感数据。攻击途径包括蒸馏、越狱、泄露日志和提示注入。修复方案包括绑定账户标识、会话哈希链和密钥轮换,但已发布块无法追溯保护。
本文介绍了 Faster CryptoNets,一种使用神经网络进行高效加密推理的方法。该方法使用了稀疏表示在底层密码系统中的剪枝和量化方法来加速推理,并展示了如何使用隐私安全的训练技术来减少加密推理的开销。
完成下面两步后,将自动完成登录并继续当前操作。