Claude会为生成的内容添加水印,谢谢欧盟

Claude会为生成的内容添加水印,谢谢欧盟

💡 原文中文,约3000字,阅读约需7分钟。
📝

内容提要

Anthropic自2026年8月2日起在Claude输出中嵌入不可见统计水印及C2PA元数据,以符合欧盟AI法案,并覆盖所有用户。此外,Claude Code被发现含未告知的请求级隐写标记,用于追踪用户。此举引发信任争议,用户付费却遭监控,且水印易被绕过,仅防守规者,损害用户信任。

🔎

延伸解读

水印的两种类型与目的

Anthropic在Claude中嵌入两种水印:文本水印和C2PA元数据。文本水印通过统计方式在词汇选择上做微妙偏向,不可见且难以去除;C2PA元数据则附加在图片等文件上。前者用于识别内容是否AI生成,后者用于追溯来源。但Claude Code中的请求级隐写标记则用于追踪用户身份,与内容溯源不同,引发隐私担忧。

水印的局限与绕过

水印技术并非万无一失。官方承认检测是概率性的,编辑或格式转换可能导致水印丢失。开发者社区已提出多种绕过方法,如逐字复制、AI重写、OCR识别等。因此,水印只能防住守规矩的用户,无法阻止真正想作弊的人,反而让付费用户感到被当作潜在作弊者,损害信任。

信任成本高于技术成本

核心问题在于信任。Anthropic以合规为名,却暗中在Claude Code中嵌入用户追踪标记,且未事先告知,直到被开发者发现才承认。这种“透明”变成“隐形”的做法,让用户质疑公司的动机。信任一旦破裂,比水印本身更难以修复,用户可能因此转向更透明的AI服务。

Q&A

欧盟AI法案第50条何时生效,Anthropic如何响应?

欧盟《人工智能法案》第50条于2026年8月2日生效,Anthropic在同一天宣布所有新发布的Claude模型将在文本输出中嵌入不可感知的水印,且不分地区覆盖所有用户。

Claude的水印技术有哪些类型?它们分别如何工作?

Claude使用两种互补技术:文本水印和C2PA来源元数据。文本水印通过统计层面的操作,在AI生成文本时悄悄偏向某些概率相近的词,从而嵌入不可见的标记,复制粘贴和编辑后仍可能保留。C2PA元数据则用于支持的文件类型(如.svg、.png、.jpg),附加经过数字签名的元数据,以追溯内容来源。

Claude Code中的隐写标记是什么?它和官方水印有何不同?

2026年6月30日,开发者发现Claude Code在发往API的请求中嵌入了隐写标记,通过不可见的Unicode字符或特定格式模式嵌入提示词内容,用于追踪API key、账号和会话。这与官方宣布的文本水印不同:官方水印回答“这段文字是不是AI生成的”,而Claude Code的标记回答“这个请求是哪个用户发出的”,属于用户溯源,且未事先告知,引发信任争议。

为什么用户对Claude的水印和隐写标记感到不满?

用户不满的核心在于信任问题:用户付费使用AI服务,却被暗中标记,被视为潜在作弊者。尤其是Claude Code的隐写标记未事先告知,让用户感到被监控。用户认为,作为付费客户,不应被当作潜在的作弊者对待,这种隐形监控损害了用户信任。

文本水印是否容易被绕过?有哪些绕过方法?

是的,文本水印容易被绕过。官方也承认检测是概率性的,编辑或格式转换可能导致水印丢失。开发者社区提出了多种绕过方法,如逐字复制、将输出交给另一个AI模型重写、截图后用OCR识别、使用开源模型清洗响应等。GitHub上甚至已有“去Claude水印”的开源工具。因此,水印只能防住守规矩的人,无法阻止真正想作弊的人。

文章对欧盟AI法案和Anthropic的做法有何批评?

文章批评Anthropic以合规为名,却暗中监控用户,打着透明旗号干着隐形的事。虽然欧盟AI法案要求AI生成内容可被识别,立法意图合理,但Anthropic在合规之外偷偷在Claude Code中嵌入请求级标记,且三个月未告知,损害了用户信任。文章还指出,法案起草者可能将AI生成与机器自动化生成混为一谈,忽略了AI生成过程中用户的参与和调教。

🏷️

标签

➡️

继续阅读