Anthropic раскрыла секрет водяных знаков в Claude: используется статистический паттерн слов без скрытых символов, но удалить их сложнее, чем кажется
Anthropic пояснила механизм водяных знаков в тексах от Claude: подтверждено использование статистической техники SynthID-Text без скрытых спецсимволов, которые сохраняются даже при копировании.
После того как Anthropic объявила о политике внедрения водяных знаков (watermark) в текст и файлы, созданные ИИ, в соответствии с законом ЕС о регулировании искусственного интеллекта (EU AI Act), это вызвало немедленную волну критики, поскольку меры затрагивают пользователей по всему миру, а не только в Европе. При этом многие задавались вопросом, не так уж сложно ли удалить такие водяные знаки.
Недавно Anthropic опубликовала в своем справочном центре (Help Center) дополнительные разъяснения: компания использует метод статистического водяного знака (Statistical Watermarking), корректируя вероятность выбора слов (токенов) в процессе генерации текста моделью. Это создает обнаруживаемый статистический паттерн, но сам текст остается обычным для чтения и ничем не отличается от стандартного. Компания четко подтвердила, что никаких скрытых спецсимволов или Unicode-символов не внедряется.
Используется стандарт SynthID-Text, разработанный Google DeepMind. Этот механизм позволяет водяному знаку «сопровождать текст» даже после копирования и вставки (copy-paste) в другое место. Тем не менее, способность к обнаружению может снизиться или пропасть, если текст подвергнется сильной правке или перефразированию (heavy editing/paraphrasing).
Причина кроется в соблюдении статьи 50 EU AI Act, которая регламентирует прозрачность контента, созданного ИИ. Anthropic начнет внедрение для моделей, выпускаемых с 2 августа 2026 года, и сделает это обязательным на глобальном уровне. Эту информацию синхронно подтвердили такие зарубежные издания, как Engadget и Forbes, отметив, что Anthropic предпочла статистический метод вместо внедрения метаданных или скрытых символов.
Тайские пользователи Claude столкнутся с прямыми последствиями этого шага, так как мера действует во всем мире, даже несмотря на то, что Таиланд не входит в юрисдикцию ЕС. ИИ-контент, используемый в дальнейшем, сможет проходить проверку на то, был ли он создан искусственным интеллектом, что затрагивает вопросы прозрачности, академической честности и коммерческого использования контента.