大脑细胞读了你的书吗?针对大型语言模型的文档级成员推断

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

本研究使用真实Reddit个人资料构建数据集,证明了预训练语言模型(LLM)能够推断出个人隐私信息,包括地点、收入和性别等。研究还探讨了通过聊天机器人提取个人信息的新威胁,并证明了文本匿名化和模型对齐等缓解措施对保护用户隐私无效。

🏷️

标签

➡️

继续阅读