Невидимая метка в каждом слове: что произошло

В августе 2026 года Anthropic объявила о внедрении технологии водяных знаков для всего текста, генерируемого Claude. Нет, речь не о маркере в углу страницы и не о скрытых символах — водяной знак встроен прямо в статистическую структуру текста и невидим человеческому глазу. При этом он путешествует вместе с контентом даже после копирования и вставки.

Anthropic опубликовала подробный технический разбор 14 августа 2026 года, идентифицировав свой метод как версию техники SynthID-Text, опубликованной Google DeepMind в рецензируемой статье в журнале Nature в 2024 году.

Каждая модель Claude, запущенная 2 августа 2026 года или позже, встраивает невидимый статистический водяной знак непосредственно в генерируемый текст — причём применяется он глобально, а не только в Европе, — что делает Claude первой крупной frontier AI-лабораторией, развернувшей текстовые водяные знаки в продакшене одновременно во всех своих продуктах.

ℹ Контекст
Водяные знаки для изображений уже давно используются в индустрии. Для текста — это принципиально иная и значительно более сложная задача, которую Claude решает впервые в масштабе реального производства.

Почему это произошло: регуляторный триггер

Компания объяснила техническое нововведение регуляторным обязательством: с 2 августа 2026 года Акт ЕС об ИИ требует от провайдеров, обслуживающих европейский рынок, маркировать контент, созданный ИИ. Anthropic подписала Кодекс прозрачности блока в июле 2026 года вместе примерно со 190 организациями.

Anthropic входит в число более чем 200 компаний — включая OpenAI, Meta, Google и Microsoft — подписавших Кодекс поведения ЕС по прозрачности ИИ.

Несоблюдение требований влечёт штрафы до €15 миллионов (примерно $17,3 млн) или 3% от мирового годового оборота — в зависимости от того, какая сумма больше.

Но Anthropic пошла дальше минимума, установленного регулятором:

Водяной знак будет применяться в каждом регионе, где доступен Claude, а не только в ЕС. Маркировка не ограничена Европой — это ещё один пример того, как стандарты ЕС распространяют своё влияние на глобальные нормы ИИ.

⚠ Важно для разработчиков
Маркировка работает на уровне модели, а не интерфейса. Это означает, что водяной знак присутствует при обращении через API, claude.ai, Claude Code и даже при использовании через AWS, Google Cloud и Microsoft Foundry.

Как работает текстовый водяной знак технически

Здесь начинается самое интересное. Забудьте про скрытые символы и специальные метаданные — механизм значительно элегантнее.

Как LLM генерирует текст

Большие языковые модели, такие как Claude, генерируют текст по одному слову за раз. Каждый раз, когда модель выбирает следующее слово, она перебирает список возможных кандидатов и в итоге выбирает наиболее подходящее или вероятное на основе предшествующего текста.

Возьмём пример: фраза «Погода сегодня была холодной и…» — следующим словом вряд ли окажется «сахарной». Но вполне могло бы быть «пасмурной» или «серой». Для читателя разницы нет — смысл предложения одинаков.

Замена источника случайности

Вместо добавления символов или изменения готового ответа после генерации, водяной знак Claude меняет источник случайности, используемый при выборе некоторых токенов.

Водяной знак заменяет произвольную случайность на случайность, производную от секретного ключа плюс предшествующих слов.

Аналогия: представьте шахматную партию, где в «равнозначных» ходах случайный выбор определяется не броском кубика, а числами из числа π. Если бы мы могли видеть последовательность всех ходов после игры (и знали бы значение π), мы могли бы определить, использовалось ли π для принятия решений. Такая игра в каком-то смысле «водяного знака» помечена.

«Водяной знак использует низкоставочные выборы — которые происходят многократно на протяжении всего сгенерированного текста — чтобы оставить паттерн в ответах Claude. Этот паттерн неразличим для читателя, но обнаруживаем для любого, у кого есть ключ, его кодирующий», — объяснил Anthropic.


graph TD
    A[Claude выбирает следующий токен] --> B{Равнозначные варианты?}
    B -- Нет --> C[Выбор наиболее вероятного слова]
    B -- Да --> D[Применяется секретный ключ + предыдущие слова]
    D --> E[Формируется статистический паттерн]
    E --> F[Текст с невидимым водяным знаком]
    C --> F
    F --> G[Детектор сравнивает паттерн с ключом]
    G --> H[Вероятность: создан ли текст Claude?]

Что водяной знак НЕ делает

По заявлению Anthropic, система не влияет на содержание или качество генерируемого текста, не оставляет скрытых символов и не требует дополнительных токенов.

СвойствоВодяной знак Claude
Видим читателю❌ Нет
Скрытые символы❌ Нет
Дополнительные токены❌ Нет
Идентифицирует пользователя❌ Нет
Влияет на качество текста❌ Нет
Увеличивает стоимость❌ Нет
Сохраняется при копировании✅ Да
Выживает при лёгком редактировании✅ Вероятно
Работает на коротких текстах⚠️ Ненадёжно

Что водяной знак может и чего не может доказать

Детекция отвечает только на вопрос «какова вероятность того, что это было частично написано Claude?» Она не может подтвердить, что текст написан человеком, не может идентифицировать вывод другой ИИ-системы — у каждого провайдера свой ключ и метод. Водяной знак не содержит ничего, что можно отследить до конкретного человека, организации или чата, и ничего не меняет в правах пользователей по условиям Anthropic.

📝 Пример из практики
Вы попросили Claude исправить орфографию в своём тексте. Результат может содержать водяной знак, хотя идеи и материал целиком принадлежат вам. Это важно понимать: водяной знак = «Claude обработал текст», а не «этот текст написан ИИ полностью».

Ограничения системы

Обнаружение водяного знака плохо работает на коротких фрагментах, где меньше вариантов выбора слов и, соответственно, меньше информации. По мере увеличения длины текста уверенность в причастности Claude тоже возрастает.

Anthropic заявил, что знаки могут быть неразличимы, если контент был создан более старой моделью, сильно отредактирован, перефразирован, переведён или смешан с другим текстом.

Компания отметила, что лёгкое редактирование, вероятно, не удалит водяной знак полностью, тогда как полная переработка с заменой каждого слова — удалит. «В последнем случае, конечно, спорно, можно ли всё ещё называть текст AI-generated», — заметила компания.

«К читателю водяной знак абсолютно незаметен. Но он присутствует статистически — как ДНК в структуре выбора слов.» — суть подхода Anthropic


Водяные знаки для файлов: отдельный механизм

Для нетекстовых файлов Anthropic использует другой подход:

Для форматов SVG, PNG и JPG Claude добавляет цифровые подписанные метаданные о происхождении на основе стандарта C2PA (Coalition for Content Provenance and Authenticity). Это позволяет определить, был ли файл обработан Claude, и выявить, были ли метаданные подделаны.

Встроенные водяные знаки также применяются при обращении к поддерживаемым моделям Claude через AWS, Google Cloud и Microsoft Foundry, хотя подписанные метаданные о происхождении могут быть доступны не на всех платформах.

Тип контентаМетод маркировкиСтандарт
ТекстСтатистический паттерн (SynthID-Text)Собственный ключ Anthropic
Изображения (PNG, JPG)Подписанные метаданныеC2PA
Векторная графика (SVG)Подписанные метаданныеC2PA
КодСтатистический паттерн*Собственный ключ Anthropic

*Для кода действуют особые условия — Anthropic уточняет детали отдельно.


Реакция рынка и что это значит для конкурентов

Анонс заполнил пробел, который TechTimes зафиксировал ещё 31 июля: собственное заявление OpenAI о соответствии требованиям ЕС подтвердило, что текстовые водяные знаки по-прежнему сложнее развёртывать в масштабе.

Другие крупные разработчики моделей подписали тот же Кодекс практики и будут внедрять собственные водяные знаки.

💡 Для разработчиков и бизнеса
Anthropic анонсировала API для обнаружения водяных знаков. Это откроет возможности для создания инструментов верификации AI-контента — например, для редакций СМИ, образовательных платформ и систем проверки подлинности.

Общественная реакция оказалась неоднозначной:

Критика плана Anthropic усилилась, когда пользователи начали выступать против идеи обнаруживаемости использования ИИ в их работе.

Здесь важно понимать разницу между тем, что водяной знак делает, и тем, чем он не является. Система не идентифицирует личность автора, не записывает чаты и не передаёт данные регуляторам — она лишь позволяет статистически оценить вероятность участия Claude в создании текста.


Заключение: новая эра прозрачности AI-контента

Водяной знак Claude — это элегантное техническое решение для сложной проблемы: как пометить AI-контент, не меняя его смысла и не снижая качества. Используя низкоставочные выборы токенов как носитель статистического паттерна, Anthropic реализовала то, что многие считали технически нетривиальным.

Ключевые выводы:

  • Невидим, но обнаруживаем: читатель ничего не замечает, машина — видит
  • Путешествует с текстом: водяной знак выживает при копировании и лёгком редактировании
  • Не является детектором авторства: только сигнал вероятности, не доказательство
  • Глобальный охват: применяется не только в ЕС, а по всему миру
  • Без дополнительных затрат: не влияет на скорость, стоимость и качество генерации

Мы стоим на пороге эпохи, когда происхождение контента станет такой же важной характеристикой, как его смысл. Водяной знак — первый шаг к инфраструктуре доверия в мире, где AI-текст стал нормой.