事件:Anthropic 把"AI 内容可追溯"做成了默认能力
Anthropic 在 8 月初正式上线了 Claude 的机器可读水印方案,覆盖文本与生成文件两类产物,目的是满足欧盟 AI Act 第 50 条关于 AI 生成内容透明度的强制要求。该方案覆盖所有 8 月 2 日及之后在欧盟上线的 Claude 新模型,并将适用范围扩大到全球(在 Claude 提供的每一个地区都生效),包括 Claude 应用、API、Claude Code、Claude Cowork、Claude Tag,以及通过 AWS、Google Cloud、Microsoft Foundry 接入的 Claude 模型。
Anthropic 已签署欧盟"AI 生成内容透明度实践守则"(Code of Practice on Transparency of AI-Generated Content),这是欧盟为 AI Act 第 50 条配套推出的合规路径之一,8 月 2 日起与该条款同步强制执行。守则已有约 190 家机构签署,Google、Meta、Microsoft、OpenAI 等头部厂商也都在签署名单中(来源:Unite.AI)。
技术细节:两种水印,各管一摊
Anthropic 在支持页里把方案拆成两种互补的标记机制:
- 文本水印:模型在生成过程中把不可见水印"织"进文字本身。读者完全感知不到,语义、质量、可读性都不变。因为水印嵌在文本里,复制粘贴后会一起带走,部分编辑后也能保留。水印在模型层面生效,无论从哪个 Claude 入口输出都一致。
- 文件来源元数据:当 Claude 生成 .svg、.png、.jpg 这类支持的文件时,会附带 C2PA 标准的数字签名来源元数据。签名能让第三方工具确认"该文件经过 Claude 处理",并检测是否被篡改。C2PA 是行业内被广泛采用的内容来源开放标准。
支持页同时强调了两条边界:一是检测到水印只代表"内容可能经过 Claude",不能等同于完整出处证明——Claude 也常被用来校对、翻译、总结第三方内容;二是没检测到水印不代表内容不是 AI 生成的——前置模型输出、深度改写、极短片段、文件元数据被剥离或截图重存,都可能导致漏检。
行业对照:Anthropic 不是第一家,但动作最快
Google DeepMind 的 SynthID 是同类方案的先行者,覆盖文本、图像、音频多个模态。OpenAI 长期讨论水印方案,但实际部署明显更慢。Anthropic 这次的差异化在于三件事:
- 覆盖文本:SynthID 文本路径公开信息有限,Anthropic 把"文本水印"明确做成了产品默认;
- 全球生效:选择不在欧盟和非欧盟之间做产品分叉,而是把水印做成全球默认,实际等于把欧盟标准输出成了全球基线;
- 配套元数据:同步引入 C2PA 签名,把图像、矢量等文件来源追溯能力一并补上,而不是只给文本加水印。
Anthropic 自己也声明,目前检测工具还在完善中,完整的技术检测文档会"在未来发布"。
合规与边界:罚则、市场监督与"deployer 责任"
欧盟 AI Act 第 50 条透明度义务自 8 月 2 日起强制,违规最高可处 1500 万欧元或全球年营业额 3% 的罚款(以较高者为准,来源:Euronews)。执法由各成员国市场监督机构负责,欧盟委员会 AI Office 负责跨成员国和自有管辖范围的系统,并将在 2026 年 9 月召开两次工作组会议,让签署方交流落地实践、暴露代码要求与实际产品之间的差距。
支持页里有一段对企业用户特别关键:在自家产品里集成 Claude 的"deployer"需要自行评估 AI Act 对自己产品的要求——Anthropic 的水印只覆盖其作为模型提供方(provider)的义务,不会自动替下游产品满足它们自己的透明度义务。这个边界划得很清楚,也是接下来一段时间 AI 应用层公司需要单独投入合规工作的明确信号。
个人评论:为什么"全球默认"比"欧盟默认"更重要
从产品工程角度看,Anthropic 不做欧盟/非欧盟分叉是务实选择:同时维护两套行为差异的模型,推理路径、审计日志和客户支持都要翻倍。在水印这个场景里,水印本身不改变内容质量,做全球默认的边际成本接近于零,但带来的合规覆盖却覆盖了几乎所有头部客户。
从行业生态角度看,这意味着欧盟 AI Act 的实际外溢效应被一次又一次坐实——布鲁塞尔定下的规则,正在以"全球默认"的方式被美国头部 AI 公司自愿承接回去。下一步值得关注的两个变量:OpenAI 是否会在今年跟进文本水印的默认部署,以及 9 月的工作组会议会不会暴露出"签署守则但实际部署打折"的厂商。
所以呢:作为开发者,如果你正在基于 Claude 构建面向欧盟用户的产品,水印这事今天就要纳入到你的内容溯源策略里——别等到客户律师函寄到才动手。作为普通用户,从今天起,任何来自 Claude 的长文都"自带指纹",理论上可以在传播链路上被识别;但与此同时,你也该降低对"AI 检测工具"的期待——水印给的是概率信号,不是出处证明。
参考来源
- Anthropic 支持页《How Claude marks AI-generated content》 https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
- Unite.AI:Anthropic Watermarks Claude Text Output to Meet EU Transparency Rules https://www.unite.ai/anthropic-watermarks-claude-text-output-to-meet-eu-transparency-rules/
- Euronews:EU compliance, delivered globally — Anthropic to watermark Claude's output worldwide https://www.euronews.com/next/2026/08/11/eu-compliance-delivered-globally-anthropic-to-watermark-claudes-output-worldwide
- 奇客 Solidot:Claude 生成的文本添加看不见的水印 https://www.solidot.org/story?sid=85063