Anthropic 揭晓 Claude 文本“隐形水印”生成方法,以符合欧洲 AI 法规
Anthropic 宣布采用 Google DeepMind 的 SynthID-Text 技术,在 Claude 生成的文本中嵌入统计学模式,以便根据欧盟《人工智能法案》(EU AI Act)的要求验证其是否为 AI 生成的内容。
开发聊天机器人 Claude 的公司 Anthropic 详细解释了“隐形水印”(invisible watermark)系统,该系统将嵌入 Claude 生成的所有文本中,以符合欧盟《人工智能法案》(第 50 条)关于 AI 透明度的规定,该规定要求必须能够识别 AI 内容。
有趣的是,Anthropic 并没有自己开发这项技术,而是使用了由其在 AI 领域的直接竞争对手 Google DeepMind 所开发的开源水印技术——SynthID-Text。
该系统的工作原理既不是隐藏特殊字符,也不是在内容中插入元数据(Metadata),而是通过调整词语选择的概率来实现。当模型有多个含义相近的词可供选择时,系统会根据既定的统计学模式来选择词语。人类阅读时感觉不到区别,但拥有密钥(Secret Key)的软件可以追溯并验证该文本是否来自 AI。
Anthropic 确认,此水印不会影响内容、含义、创造力或写作质量,也不会增加用户的标记(Token,文本处理单元)数量或成本。即使文本被复制粘贴或轻微修改,水印依然存在。但也存在局限性:如果文本被大量修改、重写或过短,检测可能会出现偏差或无法找到水印。
该系统将从 2026 年 8 月 2 日起在全球范围内对发布的新款 Claude 模型生效,涵盖网页端、API(开发者连接通道)以及 Claude Code。至于 .png 和 .jpg 等图像文件,则将改用基于 C2PA 标准的元数据嵌入方式。 *注:虽然欧盟拥有强制性法规,但 Anthropic 选择在全球范围内使用此水印,而不局限于欧洲用户。*
泰国用户使用的 Claude 内容将被自动嵌入可追溯的水印,这影响到对任何写作、报告或文章是否来自 AI 的证明,直接关系到教育和工作中应用 AI 的伦理问题。