Anthropic начнёт наносить невидимые водяные знаки на тексты Claude из-за требований ЕС

Компания Anthropic с 2 августа 2026 года начнёт добавлять машиночитаемые водяные знаки в тексты, созданные новыми моделями искусственного интеллекта Claude.
Изменение связано с требованиями о прозрачности, предусмотренными статьёй 50 Закона Европейского союза об искусственном интеллекте, известного как EU AI Act. Anthropic также подписала Кодекс практики Европейского союза, регулирующий маркировку контента, созданного системами искусственного интеллекта.
Новые модели Claude, выпущенные начиная с этой даты, будут маркировать созданный ими контент непосредственно на уровне модели. При этом Anthropic заявляет, что новая система будет применяться во всём мире, а не только к пользователям из стран Европейского союза.
Для текста и поддерживаемых файлов компания будет использовать разные технологии. В текст будут добавляться невидимые водяные знаки, которые невозможно заметить при обычном чтении, а файлы смогут содержать криптографически подписанную информацию о происхождении контента.
Anthropic планирует встроить незаметный для человека сигнал непосредственно в текст, создаваемый Claude. Пользователь не увидит этот знак во время обычного чтения. При копировании и вставке ответа водяной знак должен сохраняться вместе с текстом. Компания также рассчитывает, что некоторые варианты маркировки смогут сохраняться даже после редактирования текста.
Размещение водяного знака на уровне самой модели позволит распространить маркировку на различные продукты Claude. Поддерживаемый контент будет получать такой сигнал при использовании API, Claude, Claude Code, Claude Cowork и Claude Tag.
Маркированный контент также смогут получать корпоративные клиенты облачных платформ, если они используют поддерживаемые модели Claude через крупные облачные сервисы. Anthropic отдельно указывает AWS, Google Cloud и Microsoft Foundry.
Новая система потенциально позволит платформам, компаниям и другим организациям дополнительно проверять, обрабатывался ли определённый текст с помощью Claude. Anthropic обещает опубликовать технические сведения о принципах обнаружения водяных знаков. Благодаря этому пользователи и сторонние организации смогут проверять текст на наличие соответствующей маркировки.
Старые модели Claude не получат такую систему сразу. Anthropic заявляет, что работает над добавлением возможностей маркировки и для них в течение переходного периода, предусмотренного Законом ЕС об искусственном интеллекте.
Для файлов компания будет использовать отдельную систему. Она будет применяться, в частности, к распространённым форматам изображений. Созданные Claude файлы смогут получать подписанные метаданные о происхождении контента на основе стандарта Coalition for Content Provenance and Authenticity, или C2PA.
C2PA представляет собой общий стандарт для записи информации о происхождении цифрового контента. Действительная криптографически подписанная запись может показать, что файл обрабатывался Claude, а также указать, подвергались ли изменениям данные о его происхождении.
Разделение этих технологий связано с тем, что текстовые водяные знаки и метаданные файлов сталкиваются с разными техническими проблемами. Водяной знак в тексте может сохраняться при копировании содержимого, тогда как метаданные файла могут исчезнуть при преобразовании формата, создании скриншота или повторном сохранении.
Anthropic при этом предупреждает, что ни один из этих сигналов нельзя рассматривать как абсолютное доказательство того, что контент полностью создан искусственным интеллектом.
Claude способен обрабатывать материалы, первоначально созданные людьми. Например, пользователь может попросить модель перевести, пересказать или отредактировать уже существующий текст. В результате обработанный материал всё равно может получить маркировку Claude, хотя его исходное содержание было создано человеком.
Существует и обратная проблема. Отсутствие водяного знака не обязательно означает, что текст был полностью написан человеком. Значительное редактирование способно ослабить или изменить водяной знак, а слишком короткий фрагмент может содержать недостаточно информации для его надёжного обнаружения.
Файлы также могут потерять данные о происхождении в результате обычной обработки. Кроме того, старые версии моделей Claude могут продолжать создавать контент без новой системы маркировки.
Для американских компаний, разработчиков и платформ, работающих с цифровым контентом, новая технология создаёт дополнительный технический сигнал, который можно использовать для выявления материалов, созданных или обработанных искусственным интеллектом.
Одновременно она позволит сделать результаты работы Claude машиночитаемыми с точки зрения их происхождения и сохранить эту информацию в некоторых последующих процессах обработки контента.
Anthropic планирует публиковать дополнительные технические документы по мере развития системы маркировки и технологий её обнаружения. Компания рассчитывает, что новая инфраструктура позволит сделать происхождение контента, созданного искусственным интеллектом, более прозрачным и проверяемым.