Компания Anthropic объявила, что со 2 августа 2026 года новые модели Claude будут встраивать в генерируемый текст машиночитаемые невидимые водяные знаки. Это позволит идентифицировать созданный ИИ контент даже после его копирования.
Данное решение принято в соответствии с требованиями прозрачности, предусмотренными статьей 50 европейского Закона об искусственном интеллекте (EU AI Act). Anthropic также присоединилась к Кодексу практики Европейского Союза, касающемуся контента, созданного с помощью ИИ.
Как будет работать маркировка текста
Новые модели Claude будут маркировать сгенерированный контент на уровне самой модели. При этом маркировка будет применяться по всему миру, а не только для пользователей из Европы. Система использует разные подходы: для текста предусмотрены невидимые водяные знаки, а для файлов — подписанная информация о происхождении.
Невидимый сигнал встраивается непосредственно в текст, созданный Claude. Пользователи не заметят его при обычном чтении, однако знак сохранится при копировании и вставке ответов. По ожиданиям компании, часть водяных знаков переживет даже редактирование текста.
Маркировка на уровне модели охватит все продукты Anthropic: API, Claude, Claude Code, Claude Cowork и Claude Tag. Облачные клиенты также получат маркированный вывод при доступе к поддерживаемым моделям Claude через AWS, Google Cloud и Microsoft Foundry.
Цифровое происхождение файлов
Для поддерживаемых файлов, включая распространенные форматы изображений, Claude будет использовать отдельную систему. Сгенерированные файлы получат подписанные метаданные о происхождении на основе стандарта C2PA (Coalition for Content Provenance and Authenticity).
Подписанная запись может подтвердить, что Claude обработал файл, и указать, вносились ли изменения в данные о его происхождении. Выбор разных подходов обусловлен техническими различиями: текстовые водяные знаки сохраняются при копировании, тогда как метаданные файлов могут исчезать при конвертации форматов, создании скриншотов или повторном сохранении.
Ограничения системы
Anthropic предупреждает, что ни один из сигналов не является абсолютным доказательством авторства. Claude может обрабатывать материалы, созданные людьми: переводить, резюмировать или редактировать существующие работы, и полученный текст всё равно будет содержать отметку Claude.
Обратная ситуация также возможна: отсутствие метки не означает, что контент создан человеком. Интенсивное редактирование может ослабить текстовый водяной знак, а короткие отрывки могут не дать достаточного материала для надежного обнаружения. Старые модели Claude пока не получат маркировку — компания работает над внедрением этой возможности в переходный период действия EU AI Act.
Anthropic планирует опубликовать технические детали, которые позволят пользователям и третьим сторонам проверять контент на наличие маркировки Claude. Компания продолжит предоставлять техническую документацию по мере развития систем маркировки и обнаружения.