每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

Anthropic 强制在全球范围为 Claude 生成内容添加水印

依据欧盟 AI 法案规定,从2026年8月起文本将嵌入隐形标记,图像将附加签名来源信息

이미지: METAL LAB 생성

摘要

  • Anthropic 签署欧盟 AI 法案透明度行为守则,将从2026年8月起在新版 Claude 模型中默认搭载标注功能
  • 生成的文本会附带即便复制粘贴也不会消失的隐形水印,图像等文件则会附加基于 C2PA 标准的签名来源元数据
  • 适用范围不局限于欧盟,将扩大到 API、Claude Code、Claude Cowork 等全球所有 Claude 产品
규약 서명
EU AI Act 투명성 코드 오브 프랙티스(Code of Practice) 서명
적용 시점
2026년 8월 2일 이후 EU에 출시되는 신규 Claude 모델부터 기본 탑재
적용 범위
전 세계, API·Claude·Claude Code·Claude Cowork·Claude Tag 포함
텍스트 라벨
눈에 보이지 않는 워터마크, 복사·붙여넣기 후에도 유지 가능
파일 라벨
C2PA 표준 기반 서명된 출처 메타데이터, .svg·.png·.jpg 지원
기존 모델
법상 전환 기간 부여, 앤트로픽은 소급 적용 작업 진행 중
검증 도구
제3자 검증용 도구 제공 예정이나 구체적 시기는 미정

即使复制粘贴也不会消失的标记

Anthropic 开始在 Claude 生成的文字中嵌入肉眼看不见的标记。即便将整份文档复制粘贴到其他文件,这个标记依然会保留下来。据公司介绍,这种水印完全不影响文本的含义、质量或可读性,而且"即使经过部分编辑也可能保留"。也就是说,这是一种人眼根本无法察觉、在模型层面植入的信号。

双轨标注:文本用水印,文件用签名

Anthropic 同时采用两种方式。Claude 生成的文本会附加上文提到的隐形水印,而 .svg、.png、.jpg 等文件则会附加基于 C2PA(Coalition for Content Provenance and Authenticity)标准的签名来源元数据。C2PA 是一项国际标准,专门用于追踪照片、视频等数字内容的创建时间、所用工具及修改记录,同时也能揭示图像日后是否遭到篡改。公司表示,在 AWS、Google Cloud、Microsoft Foundry 等云合作伙伴渠道中,文本水印同样可以运作,但签名元数据功能可能不受支持。

由欧盟监管催生的义务,适用范围扩展至全球

此次措施源于 Anthropic 签署了欧盟 AI 法案中有关透明度的行为守则。2026年8月2日之后在欧盟推出的新版 Claude 模型将默认配备这一标注功能。不过,Anthropic 并未将这一义务局限于欧盟境内,而是决定将其同等适用于包括 API、Claude、Claude Code、Claude Cowork、Claude Tag 在内的全球所有产品。已经发布的模型依法可获得一段过渡期,但公司表示正在推进将该功能追溯适用于现有模型的工作。将 Claude 集成到自身产品中的开发商需要自行判断自己的服务属于 AI 法案第50条中的哪一款。

承认"无法确保一定检测到水印"

Anthropic 也坦承了这种方式的局限性。由于很多人只是把 Claude 用于校对、翻译、摘要等用途,检测到水印并不意味着文章的构思本身就是由 AI 生成的。反过来说,没有检测到水印也不能就此放心。文章可能是用水印功能上线之前的模型生成的,也可能经过大幅编辑或翻译,还可能因为句子太短而难以检测,或者在截图、格式转换过程中元数据本身就已丢失。归根结底,这项技术是否真正有用,取决于标记能否在经过编辑、重组和翻译之后依然存活下来。

这意味着什么

此前也曾多次出现区分AI生成文字和人工撰写文字的尝试,但一直有人指出检测准确率偏低、且很容易被绕过。Anthropic 此次举措的不同之处在于,它并非依靠单独的检测工具,而是从模型发布阶段就开始打上标记,并将其纳入欧盟监管这一法律框架之内。Anthropic 近期一方面组建了自有芯片设计团队等,持续巩固整体基础设施,另一方面在8月初公开了 Claude 模型因评估环境配置错误而实际接触到企业系统的事件,持续应对安全性方面的问题。标注内容来源可以视为在此背景下推出的一项建立信任的举措。不过,水印验证工具将在何时以何种形式向公众开放,目前仍有待观察。