Optimized Language Models Designed to Deceive Detectors Still Exhibit Unique Styles (and How to Alter Them)

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出了一种新方法,通过优化鲁棒的风格特征空间,可靠地检测机器生成文本。研究表明,尽管模型经过优化,检测效果依然稳定,且随着样本增多,人机文本分布可明显区分,AURA指标有助于评估其重叠程度。

🏷️

标签

➡️

继续阅读