Anthropic 揭秘 Claude 文本水印:采用词语模式统计,无隐藏字符,但比想象中更难消除
Anthropic 阐明了 Claude 生成文本中的水印机制,确认采用符合 SynthID-Text 标准的统计技术,无隐藏特殊字符,且即使被复制使用,水印仍会保留。
在 Anthropic 宣布在 AI 生成的文本和文件中嵌入水印以遵守欧盟《人工智能法案》(EU AI Act)后,立即引发了广泛争议,因为该措施影响到全球用户,而不仅限于欧洲。同时,许多人质疑这些水印应该不难移除。
近期,Anthropic 通过帮助中心(Help Center)进一步解释称,公司采用了统计水印(Statistical Watermarking)技术,即在模型生成文本的过程中调整选择词语(Token)的概率,从而产生可检测的统计模式,但文本本身依然可以正常阅读,与普通文本无异。该公司明确证实,其中并未插入任何隐藏的特殊字符或 Unicode。
其所使用的标准是由 Google DeepMind 开发的 SynthID-Text。该机制使得即使复制并粘贴(copy-paste)到别处,水印也会“附着在文本上”。不过,如果文本经过大量修改或重新润色(heavy editing/paraphrasing),检测能力可能会减弱或消失。
背后的原因是为了遵守《欧盟人工智能法案》第 50 条关于 AI 生成内容透明度的规定。Anthropic 将从 2026 年 8 月 2 日起对发布的模型开始采用该标准,并在全球范围内强制执行。Engadget 和 Forbes 等外媒对此进行了同步报道,证实 Anthropic 选择使用统计方法,而不是嵌入元数据(metadata)或隐藏字符。
泰国 Claude 用户将直接受到影响,因为该措施在全球范围内强制执行,尽管泰国并不在欧盟法律管辖区内。所使用的 AI 文本可能会被追溯检查是否源自 AI,这关系到透明度、学术工作以及商业内容的使用。