Automatic Calibration for Membership Inference Attacks on Large Language Models

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种新颖的自动校准成员推断攻击框架(ACMIA),旨在解决现有方法的高假阳性率和对参考模型的依赖问题。通过调节温度,ACMIA有效校准输出概率,增强了成员推断的可靠性和鲁棒性。

🏷️

标签

➡️

继续阅读