Текст, написанный Claude, скоро можно будет распознать даже без характерных оборотов и детекторов ИИ. Anthropic встроит в будущие модели скрытый статистический водяной знак, который не добавляет специальных символов, метаданных или видимых пометок. Читатель не заметит никакой разницы, но обладатель специального ключа сможет оценить вероятность участия Claude в создании текста.
Anthropic вводит такую систему ради требований европейского законодательства об ИИ. Компания вместе с другими разработчиками подписала в июле 2026 года европейский Кодекс практики по прозрачности контента, созданного ИИ. Новые механизмы маркировки Anthropic собирается включать по всему миру, поскольку компания пока не может надёжно ограничить работу водяного знака только европейскими пользователями.
Водяной знак работает совсем не так, как привычная подпись на фотографии. Claude генерирует текст последовательно и на каждом шаге выбирает следующий токен из нескольких подходящих вариантов. Когда несколько слов одинаково хорошо подходят по смыслу, обычная модель может выбрать вариант с помощью случайности. Система водяных знаков меняет источник такой случайности и связывает выбор с секретным ключом и предыдущими словами.
В результате в длинном тексте постепенно появляется статистический рисунок. Сам текст остаётся обычным, а слова не содержат скрытых символов. Если проверить последовательность специальным детектором и знать ключ, можно определить, насколько выбор слов соответствует работе Claude с включённым водяным знаком. Anthropic использует вариант технологии SynthID-Text, которую Google DeepMind описала в научной работе в Nature в 2024 году.
По данным внутренних тестов Anthropic, механизм не ухудшает качество, читаемость или творческие способности модели. SynthID-Text также проверяли на части трафика Gemini. Google DeepMind не обнаружила статистически значимой разницы в пользовательских оценках между ответами с водяным знаком и без него. Дополнительных токенов система не создаёт, поэтому стоимость генерации не увеличивается, а влияние на скорость Anthropic называет пренебрежимо малым.
Водяной знак не содержит идентификатора пользователя, компании или конкретного диалога. По найденной метке нельзя установить, кто отправил запрос Claude и из какого аккаунта появился текст. Детектор сможет говорить только о вероятности участия модели Anthropic в создании фрагмента.
У метода есть серьёзные ограничения. Чем короче текст, тем сложнее надёжно обнаружить статистический рисунок. В фактических ответах пространство для выбора тоже меньше. Если Claude пишет название книги Ньютона Principia Mathematica, модель не может заменить правильное слово другим только ради водяного знака. Аналогичная проблема возникает с программным кодом, формулами и другими фрагментами, где конкретный токен влияет на правильность результата.
Слабее всего водяной знак проявляется при лёгкой редактуре человеческого текста. Если пользователь просит исправить несколько опечаток и запятых, Claude меняет слишком мало слов, чтобы детектор уверенно увидел характерную последовательность. При переводе ситуация обратная. Модель заново выбирает практически каждое слово, поэтому перевод получает полноценный водяной знак.
Защита также не делает текст неуязвимым для переписывания. Небольшая редактура, по оценке Anthropic, обычно не уничтожит сигнал полностью, но полная переформулировка способна убрать его. Детектор при этом не сможет отличить текст, полностью написанный Claude, от материала, который модель сильно переработала.
Проверять такие тексты обычные пользователи пока не смогут. Anthropic готовит отдельный API для обнаружения водяных знаков и обещает раскрыть подробности позже. Старые модели Claude, выпущенные до 2 августа 2026 года, получили переходный период. Компания планирует постепенно добавить маркировку и для них в течение ближайших месяцев.
Для изображений и других поддерживаемых файлов Anthropic выбрала другой подход. PNG, JPG и SVG, созданные или обработанные Claude, будут получать криптографически подписанные данные C2PA в метаданных файла. Такая подпись сообщает об участии Claude, но не меняет содержимое картинки и также не хранит сведения о пользователе.
В результате привычные сервисы, которые пытаются угадать происхождение текста по стилю и типичным фразам нейросетей, получают принципиально другого конкурента. Водяной знак Anthropic ищет не характерный язык Claude, а статистическую последовательность решений, заложенную непосредственно во время генерации. Полностью доказать авторство такой метод всё равно не сможет, но длинный, практически неотредактированный текст, станет заметно проще связать с Claude.