大型语言模型的语义不变鲁棒水印

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

该文介绍了一种在自回归语言模型中种植水印的方法,可以在不改变文本分布的情况下对扰动具有鲁棒性。该方法在三个语言模型上进行了实验验证,即使在通过随机编辑破坏了40-50%的标记之后,仍然可以可靠地检测到带水印的文本。

🏷️

标签

➡️

继续阅读