OpenAI在欧盟ChatGPT和Codex中添加文字盲水印 相关检测器仅向专业机构开放

OpenAI在欧盟ChatGPT和Codex中添加文字盲水印 相关检测器仅向专业机构开放

💡 原文中文,约1100字,阅读约需3分钟。
📝

内容提要

OpenAI将在欧盟为ChatGPT和Codex添加隐形文本水印textGrain,以符合AI法案要求。该技术通过调整用词概率形成统计信号,不插入特殊字符,但改写会降低识别率。检测器暂不公开,仅向合格机构开放申请,未来计划开源。

🔎

延伸解读

水印技术原理:概率调整而非字符插入

textGrain 盲水印不依赖不可见字符或空格,而是通过微调模型生成时选择词语的概率,在文本中形成统计信号。这种设计使水印更隐蔽,不易被肉眼察觉,但检测器需要专门算法识别。由于信号基于词语选择,任何改写都可能破坏统计模式,导致检测率下降。

检测准确率受内容类型和长度影响

测试显示,在误报率1%时,心理学等词语选择空间大的内容,200-token文本检测率约80%,400-token约95%;而数学等词语受限的内容检测率明显更低。文本越长,统计信号越强,检测越准。但改写会显著削弱信号:400-token文本替换10%同义词后检测率从92%降至66%,替换25%后暴跌至17%。

检测器仅限专业机构,暂不公开

尽管盲水印即将在欧盟上线,OpenAI 暂不向公众开放检测器,仅允许符合条件的研究机构和专业组织申请使用。未来计划开源 textGrain 技术,供其他公司使用和外部研究改进。这种限制可能影响水印的透明度和公众监督,但有助于防止滥用。

欧盟先行,API 可选开启

盲水印仅在欧盟地区默认启用,覆盖所有套餐,以符合欧盟人工智能法案对AI生成内容来源标记的要求。API 开发者可为全球部分受支持模型主动开启,但默认关闭。这表明 OpenAI 在合规与全球策略间采取区域化处理,其他地区用户暂不受影响。

❓

Q&A

OpenAI为什么要在欧盟给ChatGPT和Codex加盲水印?

为了符合欧盟人工智能法案对AI生成内容来源标记的要求,该法案要求AI聊天机器人给内容输出添加盲水印并提供检测机制。

textGrain盲水印是怎么实现的?会插入特殊字符吗?

不会插入特殊字符、空格或可见标记。它通过微调模型生成内容时词语及词片段的选择概率,在整段内容中形成统计信号,检测器可据此识别AI生成内容。

textGrain盲水印的识别准确率如何?

在误报率1%时,对于词语选择空间大的内容(如心理学),200-token文本识别率约80%,400-token约95%;数学等词语受限的内容识别率明显更低。

改写内容会影响盲水印的检测吗?

会。改写会破坏词语盲水印,降低识别率。在400-token文本测试中,替换10%词语为同义词后检测率从92%降至约66%,替换25%后暴跌至17%。

普通用户能使用OpenAI的文本检测器吗?

暂时不能。OpenAI不准备对公众开放检测器,仅向符合条件的研究机构和专业组织提供申请,申请通过的组织才可使用。

盲水印会在全球范围启用吗?API调用者可以自己开启吗?

盲水印不会全球默认启用,目前仅在欧盟实施。API开发者可以为全球范围内部分受支持的模型主动开启,默认情况下API输出关闭盲水印。

🏷️

标签

➡️

继续阅读