HuggingFace遭AI智能体攻击,攻击者利用恶意数据集入侵并横向移动。HF用商业前沿模型审计时被安全策略阻拦,最终本地部署智谱GLM-5.2完成取证。事件暴露守方不对称问题,未发现用户数据泄露。
本研究探讨了数据集蒸馏中的安全性问题,提出了一种新方法,通过重建类别原型,在不访问原始数据的情况下向蒸馏数据集中注入后门。实验表明,蒸馏数据集易受攻击,该方法高效,能快速合成恶意数据集。
完成下面两步后,将自动完成登录并继续当前操作。