事件

Anthropic 8 月 10 日通过官方支持文档确认,自 2026 年 8 月 2 日起在欧盟上线或此后更新的 Claude 模型,从发布第一天起就内置机器可读的内容标记机制。文本走「嵌入式水印」路线,文件走 C2PA 标准路线。该机制覆盖 Anthropic 自家全部产品表面 —— Claude Platform API、Claude、Claude Code、Claude Cowork、Claude Tag —— 也覆盖 AWS、Google Cloud、Microsoft Foundry 等云厂商接入路径。适用范围不限于欧盟,Anthropic 表示该标记将跟随「Claude 在全球任何提供区域」生效。

水印是怎么工作的

文本侧:Claude 在生成阶段直接把不可见信号织进文本本身 —— 用户正常阅读看不到,也不改变语义、质量、可读性。因为信号是文本的一部分,复制粘贴后仍会跟着走,部分编辑后仍可残留。水印在模型层注入,所以无论来自哪条 Claude 产品线,输出都会带这个标记。

文件侧:对支持的文件类型(包括 .svg、.png、.jpg 等),Claude 会附加基于 C2PA(Coalition for Content Provenance and Authenticity) 开放标准的数字签名出处元数据。第三方可凭签名验证文件是否经过 Claude 处理、以及元数据是否被篡改。

第三方检测:Anthropic 将配套发布技术文档,帮助用户与第三方检测 Claude 的水印与 C2PA 元数据,但具体的水印嵌入算法细节目前尚未披露

已知边界(这点很关键)

Anthropic 自己把限制写得很坦白:

  • 检测到水印 ≠ Claude 是原作者:Claude 可能只是被用来校对、翻译、摘要、改写人类原创文本,输出仍可能携带水印。
  • 没检测到水印 ≠ 内容是人工写的:被 Claude 处理前的旧模型、重度改写、翻译、混入其它段落、过短的文本都可能让信号不可测;文件元数据可能在截图、格式转换、再保存后丢失。
  • 老模型有过渡期:2026 年 8 月 2 日之前发布的模型不立即覆盖,Anthropic 表示会在 AI 法案过渡期内补齐。
  • 因此,这个信号是「Claude 曾经处理过这段文字/文件的提示」,而非「这是 AI 原创」的硬证据。

来源与法律背景

该政策落地于 Anthropic 已签署的 欧盟 AI 法案第 50(2)条《AI 生成内容透明度实践守则》(Code of Practice on Transparency of AI-Generated Content)。Anthropic 同时作为「生成式 AI 模型」与「生成式 AI 系统」两类提供者参与承诺。Claude 模型在欧盟 8 月 2 日及之后上线的版本自发布即支持标记;之前的模型进入过渡期补齐计划。

行业影响

第三方 AI 文本检测厂商 —— 给学校、出版商、雇主做「这是不是 AI 写的」概率推断的那批公司 —— 的商业模式面临重写:

  • 从「推断」转向「查信号」:今天大多数检测器靠统计文本风格去猜;Anthropic 的做法是在自家输出里直接埋机器可读信号,平台与第三方只要跑检测器就能拿到确定性更高的判定。
  • 但短期冲击有限:水印会被重写、翻译、混合抹掉,老模型不受限,旧版 Claude 输出的内容依然「裸奔」。
  • 如果 OpenAI、Google、Meta 跟进:AI 文本检测可能从概率游戏升级为「出处平台」生意 —— 检测厂商要么转型做多源出处聚合,要么被模型厂商的原生信号挤压。

评论:这件事比技术更重要

Anthropic 这次真正的看点不是水印本身,而是 「模型厂商把可追溯性写进了产品里」 这个动作。复制粘贴 —— 这个 AI 时代最普通的行为 —— 即将多出一层隐性的可追溯性。短期对个人写作影响不大;但对学术诚信、新闻署名、合同生成、政务文档这些「必须人工署名」的场景,这是基础设施级的变化。

至于 OpenAI、Google、Meta 是否会同步跟进,把 AI 文本变成自带「AI 痕迹」的格式,2026 下半年会有答案。如果三家都跟,这件事就会从 Anthropic 的合规动作,变成整个 LLM 行业的默认设置。

参考资料:Anthropic 官方支持文档《How Claude marks AI-generated content》(support.claude.com)、TechStartups 2026-08-10 报道、Interesting Engineering 2026-08-11 报道、奇客 Solidot 2026-08-11 转载。