Claude метит свои тексты: невидимый водяной знак по требованию ЕС

12.08.2026 6 мин 9

Текст, написанный Claude, теперь несёт невидимый водяной знак. Anthropic подтвердила 11 августа 2026 года, что модели, вышедшие со 2 августа, встраивают машиночитаемый узор прямо в производимые слова, а сгенерированные файлы получают подписанные метаданные о происхождении. Поводом стал европейский закон, но метка включена по всему миру. Полезное в этой истории не сам факт её появления. Полезное - что именно метка способна и не способна сказать о куске текста.

Что именно включила Anthropic

Механизма два. Первый - незаметный узор, вплетённый в сгенерированный текст. Читателю он не виден, машиной определяется, путешествует вместе с текстом при копировании и вставке и, в осторожной формулировке самой компании, может пережить часть правок. Компания утверждает, что смысл, качество и читаемость ответа при этом не меняются.

Второй касается файлов. Сгенерированные SVG, PNG и JPG получают криптографически подписанные метаданные о происхождении по стандарту C2PA - той же схеме удостоверения контента, которую внедряют производители камер и редакторы изображений. Anthropic прямо пишет, что эти метаданные теряются при конвертации формата, пересохранении, скриншоте и подобных операциях, и это необычно честное признание о собственной защитной мере.

Охват широкий: пользовательское приложение, API, Claude Code и доступ через AWS, Google Cloud и Microsoft Foundry. Модели, выпущенные со 2 августа 2026 года, поддерживают метку сразу, для более старых компания обещает добавить поддержку.

Чего требует статья 50 европейского AI Act и во что обходится её игнорировать

Юридическая причина - статья 50 европейского AI Act, обязанности по прозрачности из которой вступили в силу 2 августа 2026 года. Она требует, чтобы системы, производящие синтетический контент, помечали свой вывод как искусственно созданный машиночитаемым способом. Регуляторы не рассчитывают, что эту задачу вытянет одна техника: ожидается многослойный подход, где подписанные метаданные сочетаются с незаметным водяным знаком, - именно потому, что каждый метод по отдельности отказывает по-своему.

Штраф по статьям о прозрачности достигает 15 миллионов евро или 3 процентов мирового годового оборота, смотря что больше. Эта цифра объясняет сроки лучше любого заявления об ответственном ИИ, а заодно объясняет, почему метка глобальная, а не региональная. Построить один конвейер, устраивающий Брюссель, дешевле, чем строить два и определять, кто из пользователей где находится. Брюссельский эффект работает ровно так, как задумано.

Что метка доказывает, а что нет

Здесь стоит быть точным, потому что разрыв между тем, что водяной знак определяет, и тем, что ему припишут, - и есть место, где возникает ущерб.

Обнаруженный водяной знак означает, что текст обработала модель Claude. Он не показывает, кто вводил запрос, не несёт ни аккаунта, ни сессии, ни адреса и не является отпечатком человека. И это не доказательство авторства ни в ту, ни в другую сторону: метка говорит, что модель прикасалась к этим словам, а не что она придумала стоящую за ними мысль.

Важно: отсутствие водяного знака тоже ничего не доказывает. Тяжёлая правка, перевод на другой язык, конвертация форматов или просто использование старой модели без поддержки маркировки оставляют настоящий вывод ИИ необнаружимым. Тот, кто считает чистую проверку доказательством, что текст написал человек, не понял, чем пользуется.

Проблема ложных срабатываний

По-настоящему больно людям сделает обратный сценарий. Если вы вставите собственный текст в Claude и попросите поправить грамматику, ужать абзац или составить конспект документа, то обратно придёт вывод модели, и он может нести метку. Слова ваши. Детектор об этом не знает.

Теперь поместите это в университет с политикой по ИИ, в компанию, прогоняющую присланное через детектор, или в редакцию, требующую написанного человеком. Студент, использовавший модель как корректора, и студент, которому она написала эссе, для сканера могут выглядеть одинаково. Технология и не заявляет, что различает их, но у институций долгая история отношения к положительному сигналу как к приговору, и вот здесь мера прозрачности тихо превращается в машину для обвинений.

Где остальная отрасль

Anthropic не первая. Google DeepMind уже некоторое время использует SynthID для текста, изображений и звука, а OpenAI обсуждала водяные знаки, внедряя их осторожнее. Направление движения сомнений не вызывает: маркировка происхождения становится инфраструктурой по умолчанию для сгенерированного контента - так же, как удостоверения контента встраивают в камеры и фоторедакторы.

Это разумный ответ на реальную проблему. Поточно сфабрикованные изображения и тексты разъедают доверие, и возможность проверить, откуда взялся файл, стоит иметь. Но это же неизбежно означает слой детекции, встроенный во всё подряд, а слои детекции редко используются только по первоначальному назначению.

Что это значит лично для вас

  • В метке нет ничего о вас: она фиксирует, что текст произвела модель, а не кто её просил. Если вы боялись, что вывод свяжут с вашим аккаунтом, - не свяжут.
  • Исходите из того, что текст с участием ИИ определяется: если правило на работе или в учебном заведении требует раскрывать - раскрывайте. Строить планы вокруг водяного знака - стратегия хуже, чем прямо сказать, как текст был сделан.
  • Помните про ловушку корректуры: прогон собственного текста через модель ради шлифовки может его пометить. Если в вашей ситуации это важно, правьте руками или не пускайте модель в финальный проход.
  • Не верьте вердикту детектора ни в одну сторону: срабатывание означает возможную машинную обработку, отсутствие срабатывания не означает ничего. Если обвиняют вас, это различие и есть ваш аргумент.
  • Храните черновики: история версий, заметки и правки по-прежнему единственное настоящее свидетельство того, как текст создавался, и сейчас они значат больше, а не меньше.

Почему VPN тут ни при чём

Скажу прямо, потому что вопрос обязательно возникнет: VPN здесь не меняет ничего. Метка живёт внутри текста и внутри файла, а не в соединении, которое их перенесло, поэтому выходной узел в другой стране никак не влияет на то, найдёт ли её сканер. Сетевые инструменты приватности закрывают окружающую поверхность, и на этой поверхности инциденты были настоящие: общие переписки, которые всплыли в выдаче Google, и агенты для кода, у которых сообщение на GitHub доезжало до секретов сборки. Вот этими рисками и стоит управлять. Водяной знак к ним не относится, и делать вид, что относится, значило бы вам что-то продавать.

Вывод

Вывод: сама маркировка ничем не примечательна и, пожалуй, запоздала. Внимания заслуживает словарь, который вокруг неё нарастает. Водяной знак отвечает на один узкий вопрос - трогала ли модель этот текст, - и отвечает на него неидеально в обе стороны. При этом цитировать его будут так, будто он ответил на куда больший вопрос о честности и авторстве. Именно в разрыве между этими двумя вопросами и пострадают студенты, работники и авторы, и виноват в этом будет не детектор.

anthropicclaudewatermarkc2paeu ai actarticle 50ai detectionsynthidgoogle deepmindopenaiprovenancetransparencyprivacydigital rightseuropean unionvpn

Читайте также