AI 企业 Anthropic 正式官宣,已在 Claude 大模型底层搭载不可见文本水印标记系统,覆盖旗下全部产品与全球合作云平台。该机制自 2026 年 8 月 2 日起发布的新模型原生启用,存量旧模型将在过渡期内完成升级部署,核心目的是响应欧盟《人工智能法案》透明度强制要求,实现 AI 生成内容全链路可追溯。
本次水印标记并非仅针对欧盟用户,而是面向全球所有 Claude 使用者,所有交互渠道统一生效:
原生产品:网页端 Claude、Claude Code、Claude Cowork、Claude API 开放平台;
第三方云服务:AWS、Google Cloud、Microsoft Foundry 上托管的 Claude 模型;
文件载体区分两套溯源方案:纯文本采用内嵌隐形水印,SVG、PNG、JPG 图像文件附加 C2PA 标准加密签名元数据。
官方说明提到,标记逻辑在模型生成层生效,无论用户通过哪种渠道发起提问,输出文本都会自动植入标记,不存在渠道豁免规则。对于 8 月 2 日前上线的历史模型,Anthropic 将分批次补加水印能力,欧盟监管为该升级预留了合规缓冲周期。
Anthropic 搭建两套独立且互补的溯源机制,分别适配文字与图像类输出:
1. 文本隐形水印(核心创新点)
水印并非附加在文件元数据中,而是直接嵌入文本词句的统计逻辑内,肉眼完全无法识别,同时不会改变原文语义、行文质量与阅读流畅度。 该标记具备极强传播稳定性:文本复制、粘贴至文档、社交平台、编辑器后,水印会同步迁移;即便用户对文字进行小幅改写、删减,多数情况下溯源信号仍可保留。 区别于传统外置标签,这套水印依附文本本体存在,不会因导出、复制丢失基础溯源信息。
2. C2PA 标准图像数字签名
针对 Claude 生成的图片、矢量图,系统会附加加密签名元数据,遵循国际开源内容溯源联盟 C2PA 规范。签名自带加密校验,一旦文件生成后被裁剪、修图、二次修改,校验工具可直接识别篡改痕迹,完整记录内容原始生成主体与后续编辑记录。
需要注意的是但该元数据存在短板:截图、格式批量转换会直接清除签名信息,失去溯源能力。
Anthropic 主动披露了这套水印体系的多项短板,明确检测到水印≠文本完全由 Claude 原创,无水印≠人工手写,存在大量识别失效场景:
水印检测阳性仅能证明文本经过 Claude 处理;很多场景下人类原稿会导入 Claude 做校对、翻译、精简、格式转换,即便核心创意、文字内容属于人类,输出文本依然会携带水印,无法单纯依靠标记判定内容是否为 AI 原创。同时,带水印文本若经大规模重写、全文翻译、多份素材拼接融合,底层溯源信号会被完全覆盖。
官方着重强调反向推论不成立:文本检测不到水印,不能证明该内容完全由人类创作,大幅改写、短句输出都会抹除标记,无法作为判定依据。
本次水印落地的直接动因,是 Anthropic 签署欧盟《AI 生成内容透明度实践准则》,履行《欧盟人工智能法案》(Regulation (EU) 2024/1689)第 50 条第二款法定义务。 该条款明确要求生成式 AI 服务商提供机器可读的内容标记,让使用者能够区分人工创作与 AI 生成素材,法规自 2026 年 8 月 2 日起正式强制执行。对于自研、嵌入 Claude 到自有产品的企业客户,Anthropic 提示需自行评估自身业务是否满足欧盟 AI 法案合规细则,承担对应法律责任。
Claude 全球上线隐形文本水印,标志着生成式 AI 内容溯源从可选功能转向全球合规标配。但受改写、短句、跨格式转换等因素限制,该机制仅能作为辅助核验手段,无法实现 AI 内容全覆盖精准甄别。
对于教育、出版、内容审核等行业,仅依靠水印标记不足以完整区分人机创作,仍需搭配人工复核、多维度文本特征检测共同使用。随着 OpenAI、Meta 等头部厂商陆续跟进同类溯源方案,AI 内容透明化监管将成为全球行业常态化标准。