Claude теперь ставит невидимый водяной знак на весь текст
Anthropic внедрила невидимые водяные знаки в весь текст Claude с 2 августа 2026 года. Без возможности отключить. Что это значит для пользователей?
Лид
Модели Claude, выпущенные с 2 августа 2026 года, встраивают невидимые водяные знаки в генерируемый текст и прикрепляют подписанные метаданные происхождения к поддерживаемым типам файлов. Эта глобальная политика без возможности отказа во многом продиктована статьёй 50 EU AI Act, обязывающей обеспечивать прозрачность в отношении AI-сгенерированного контента. Решение вызвало волну критики: пользователи, журналисты и эксперты поставили под сомнение саму природу такого «водяного знака» — и то, чьи интересы он защищает.
Как работает водяной знак
Текстовый водяной знак работает за счёт статистического смещения выбора слов Claude согласно ключу, которым владеет Anthropic. Отдельные выборы выглядят неприметно, но на достаточном объёме текста паттерн становится детектируемым.
Claude-сгенерированный текст несёт невидимый водяной знак, который «путешествует вместе с текстом при копировании и вставке в другое место».
Для файлов используется другой подход: когда Claude создаёт файл поддерживаемого типа (например, .png, .jpg или .svg), к метаданным файла прикрепляется криптографически подписанная запись о том, что файл был создан или обработан Claude. Это открытый отраслевой стандарт C2PA (Coalition for Content Provenance and Authenticity) — тот же, что используется производителями камер и в программах для редактирования фото.
Технические ограничения
Текстовые водяные знаки и файловые метаданные сталкиваются с разными техническими проблемами. Текстовый водяной знак может перемещаться вместе с скопированным контентом. Метаданные файла могут исчезнуть при конвертации форматов, создании скриншота или пересохранении.
| Тип контента | Метод маркировки | Сохраняется при копировании | Сохраняется при редактировании |
|---|---|---|---|
| Текст | Статистический паттерн в словах | ✅ Да | ⚠️ Частично |
| Изображения / SVG / файлы | C2PA-метаданные | ✅ Да | ❌ Может исчезнуть |
| Старые модели Claude (до 02.08.2026) | В разработке | — | — |
Почему Anthropic сделала это глобально
Anthropic вместе с рядом других крупных AI-провайдеров и примерно 190 другими подписантами подписала EU Code of Practice on Transparency of AI-Generated Content в июле 2026 года. Это требует от поставщиков AI-систем использовать методы «маркировки» AI-сгенерированного текста. Anthropic применяет водяные знаки глобально при запуске, поскольку пока не имеет надёжного способа ограничить это по регионам.
14 августа 2026 года Anthropic опубликовала полный FAQ о механизме, назвав его версией SynthID-Text от Google DeepMind.
graph TD
A[EU AI Act, статья 50] --> B[Anthropic подписывает EU Code of Practice]
B --> C[Дедлайн: 2 августа 2026]
C --> D[Водяной знак в тексте — SynthID-Text]
C --> E[C2PA-метаданные в файлах]
D --> F[Глобальное применение без opt-out]
E --> F
F --> G[Критика пользователей и экспертов]
Главные претензии критиков
Наиболее жёсткую оценку дал Джон Грубер на Daring Fireball, назвав происходящее «извращением письма» (perversion of writing).
Неприемлемо, чтобы инструмент жертвовал хотя бы йотой ясности, связности или смысла ради встраивания скрытых подсказок о происхождении текста.
Главная проблема — секретность. Когда только Anthropic владеет секретными ключами, которые и создают водяной знак, и производят его вероятностное обнаружение, всем остальным остаётся только гадать: не является ли читаемое или цитируемое скрытно размеченным, и не будет ли написанное ими несправедливо обвинено в том, что является AI-сгенерированным на основании секретов, которых они не знают и не могут увидеть.
Anthropic предупредила, что наличие водяного знака или метаданных «не является окончательным подтверждением» того, что контент полностью создан AI — лишь то, что он был обработан моделями Claude. Например, текст, изначально написанный человеком, но переданный в Claude для корректуры, перевода или резюмирования, будет нести водяной знак после обработки.
Что делают другие компании
Google маркирует AI-сгенерированные изображения с 2023 года и с тех пор распространила практику на текст, аудио и видео. OpenAI также использует невидимую маркировку для изображений. OpenAI давно имеет технологию водяных знаков для текстовых выводов моделей вроде ChatGPT, но решила её не применять.
Инженер Anthropic подтвердил, что другие лаборатории добавляют аналогичную маркировку.
Что будет дальше
Anthropic в ближайшее время планирует предложить API для обнаружения водяных знаков. Закон ЕС включает переходный период для моделей Anthropic, запущенных до 2 августа 2026 года — компания работает над добавлением водяных знаков и для них. Это будет развёртываться в течение ближайших месяцев.
Итог
Watermark в Claude — это одновременно регуляторная необходимость и этическая проблема. EU AI Act требует прозрачности, и Anthropic выполняет требование единственно доступным ей способом — через статистическое смещение слов. Но монополия на ключ, глобальное применение без opt-out и риск ложных обвинений в использовании AI ставят под удар доверие к инструменту. Следить за развитием событий стоит особенно внимательно тем, кто использует Claude в академической, юридической или журналистской работе.