Anthropic внедрил невидимые водяные знаки в тексты Claude: причины, сценарии и последствия

· ТЕХНОЛОГИИ · по материалам 433 статей мировых СМИ

С 2 августа 2026 г. все модели Claude автоматически встраивают скрытую машиночитаемую метку в генерируемые тексты и C2PA-метаданные в изображения — во исполнение Статьи 50(2) Кодекса прозрачности ЕС по закону об ИИ.

Что произошло

Anthropic объявил, что все модели Claude, выпущенные начиная с 2 августа 2026 года, автоматически встраивают невидимый статистический водяной знак в генерируемые тексты, не изменяя их смысл, качество или читаемость. Для изображений применяется стандарт C2PA, фиксирующий данные о происхождении контента. Мера распространяется не только на полностью сгенерированные тексты, но и на случаи, когда Claude лишь редактировал, переводил или корректировал оригинальный текст пользователя.

Технически водяной знак реализован как статистический отпечаток в выборе слов: модель отдаёт предпочтение словам с высоким значением по скрытой формуле, и суммарный балл по блоку текста указывает на машинное происхождение. Знак невидим для читателя, однако детектируется алгоритмически. Метод распространяется на весь глобальный трафик, хотя поддержка в ЕС была запущена первой.

Решение немедленно вызвало двойную реакцию: пользователи, скрывавшие применение ИИ на работе и в учёбе, выразили недовольство, тогда как в течение нескольких дней в сети появился рынок инструментов для удаления водяных знаков — GitHub-проекты, новые веб-сервисы и существующие сервисы обхода детекции ИИ. Эффективность этих инструментов пока не верифицирована, поскольку Anthropic не раскрыл метод детектирования.

Почему это произошло: причины события

Закон ЕС об ИИ: Статья 50(2)

Статья 50(2) Кодекса прозрачности ЕС по закону об ИИ требует, чтобы системы генеративного ИИ маркировали свои выходные данные машиночитаемым образом. Требование вступило в силу в августе 2026 года, и Anthropic стал одним из первых крупных провайдеров, публично подтвердивших присоединение к Кодексу практики.

Требование ЕС сформулировано принципиально: метка должна быть встроена в контент так, чтобы её было сложно отделить. Это исключает простые внешние теги и подталкивает разработчиков именно к статистическим методам встраивания в структуру текста, которые Anthropic и реализовал.

Источники: Reuters

«Взрыв» генеративного ИИ с 2022 года

Начиная с конца 2022 года генеративный ИИ стал доступен сотням миллионов пользователей, что резко обострило проблему неотличимости машинного контента от человеческого. Регуляторы ЕС зафиксировали этот разрыв как системный риск для информационной среды.

Закон об ИИ стал прямым ответом на эту волну: требования маркировки направлены именно против контента, который «выглядит как ИИ», но не может быть доказательно атрибутирован машине без технических средств.

Источники: Reuters

Недоказуемость ИИ-авторства без метки

До внедрения водяных знаков детекция ИИ-контента опиралась на статистические паттерны и косвенные признаки. Даже при высоком балле детектора нельзя было однозначно утверждать машинное происхождение текста — это создавало правовую и академическую серую зону.

Антропик и другие провайдеры оказались под давлением именно потому, что отсутствие верифицируемой метки делало любые обвинения в использовании ИИ оспоримыми. Водяной знак переводит вопрос из вероятностного в доказательный.

Источники: Reuters

Репутационный и регуляторный риск для Anthropic

Anthropic, получающий инвестиции от Google и Amazon, строит бренд на принципах безопасного и прозрачного ИИ. Отказ от маркировки на фоне требований ЕС создавал репутационное противоречие и потенциальные юридические риски на европейском рынке.

Присоединение к Кодексу прозрачности позволяет компании демонстрировать соответствие регуляторным требованиям опережающим образом, не дожидаясь принудительного исполнения. Это стратегически важно для сохранения доступа к европейскому рынку.

Источники: Reuters

Что будет дальше: сценарии развития

Гонка вооружений: водяные знаки vs. инструменты удаления (вероятно, горизонт: 3–12 месяцев)

Уже через несколько дней после объявления Anthropic в сети появились GitHub-проекты с тысячами звёзд, новые веб-сервисы и расширения существующих сервисов обхода детекции. Пока Anthropic не раскрыл алгоритм детектирования, эффективность этих инструментов непроверяема — но как только метод станет известен, обход станет тривиальным.

Инженер Шон Гёдеке ещё до анонса Anthropic показал, что текстовый водяной знак можно удалить, попросив другую языковую модель перефразировать текст. Статистический отпечаток в выборе слов не выживает при перефразировании. Это означает, что водяной знак эффективен против случайных пользователей, но не против мотивированных.

Источники: Reuters

Водяной знак теряет практическую ценность (возможно, горизонт: )

Широкое распространение инструментов удаления водяных знаков обесценит текстовую маркировку как механизм прозрачности. Добросовестные пользователи будут маркированы, недобросовестные — нет, что инвертирует цель регулирования.

Это создаст давление на ЕС в сторону более жёстких технических стандартов или перехода к иным механизмам прозрачности — например, к обязательной серверной регистрации запросов.

Источники: Reuters

Отраслевой стандарт: другие LLM следуют за Anthropic (вероятно, горизонт: 6–18 месяцев)

Anthropic стал первым крупным провайдером, публично подтвердившим внедрение текстовых водяных знаков в рамках Кодекса ЕС. Если регулятор начнёт принудительное исполнение требований Статьи 50(2), остальные провайдеры — включая OpenAI, Google и Meta — будут обязаны последовать.

Формирование отраслевого стандарта маркировки создаст инфраструктуру для кросс-платформенной детекции. C2PA для изображений уже является консорциумным стандартом; аналогичный путь возможен для текста, хотя технически он значительно сложнее.

Источники: Reuters

Ложные атрибуции и юридические споры (возможно, горизонт: 6–24 месяца)

Поскольку водяной знак встраивается даже при минимальном редактировании или корректуре оригинального текста пользователя, возникает риск ложной атрибуции: текст, написанный человеком и лишь исправленный ИИ, будет помечен как ИИ-генерированный. Это создаёт почву для академических санкций, трудовых споров и репутационного ущерба.

Юридический прецедент пока не сформирован, но по мере распространения детекционных инструментов работодателями, университетами и издателями число конфликтных случаев будет расти. Отсутствие у Anthropic публичного механизма оспаривания ложных срабатываний усугубляет проблему.

Источники: Reuters

Регуляторное давление на уточнение стандартов (возможно, горизонт: )

Действующая реализация не различает полностью сгенерированный текст и текст, прошедший лёгкую редактуру. Это концептуальная проблема стандарта, а не только технической реализации.

Под давлением судебных прецедентов и жалоб пользователей ЕС или сами провайдеры будут вынуждены ввести градацию: например, метку интенсивности ИИ-участия вместо бинарной маркировки.

Источники: Reuters

Пользовательский отток к немаркирующим провайдерам (возможно, горизонт: 3–9 месяцев)

Radio Facts Media фиксирует прямое недовольство пользователей, опасающихся разоблачения на работе и в учебных заведениях. Водяной знак делает ровно то, чего хотят регуляторы и чего боятся эти пользователи — и это создаёт стимул к переходу на незамаркированные альтернативы.

Open-source модели (Llama, Mistral и другие), работающие локально, не подпадают под требования Кодекса ЕС в части маркировки выходных данных. Если отток к ним станет значимым, регуляторная цель окажется достигнутой лишь для добросовестного меньшинства.

Источники: Reuters

Мнения AI-экспертов

Экономист (модель GPT)

Главный эффект — сдвиг из UX в закупки: корпоративные юристы начнут требовать происхождение текста так же, как происхождение компонентов. Это добавит транзакционные издержки в маркетинг, консалтинг, локализацию и аутсорсинг.

Индикатор — не число детекторов, а спред цен между «чистыми» и маркируемыми API, плюс условия в тендерах и страховках. Если спред устойчив, водяной знак станет не защитой от обмана, а новым контуром комплаенса.

Аналитик (модель CLAUDE)

Все обсуждают гонку вооружений и отток аудитории, но упускают ключевое: Anthropic создал не инструмент детекции ИИ — он создал инфраструктуру атрибуции. Водяной знак на отредактированном тексте означает, что даже 20% правки Claude оставляют след. Это меняет правовую природу документа: суд, работодатель или университет получают не вероятностный детектор, а криптографически верифицируемую метку происхождения.

Главный индикатор, который стоит отслеживать — не GitHub-проекты по удалению, а первые трудовые и академические прецеденты. Как только один иск или одно отчисление пройдут с водяным знаком в качестве доказательства, поведение миллионов пользователей изменится резче, чем от любого технического обхода.

Неожиданная связь: расширение на редактуру и перевод делает Anthropic невольным арбитром авторства в профессиях, где ИИ-ассистирование уже норма — юристы, журналисты, переводчики. Вопрос не «поймают ли меня», а «кому принадлежит текст, который я отредактировал с помощью Claude».

Историк (модель GEMINI)

В XIV веке европейские бумажники начали использовать филиграни — водяные знаки для защиты монополий. Но история учит: попытки контролировать информацию через маркировку лишь стимулировали подполье. Появление бумаги без знаков гильдий в итоге предопределило успех Реформации и свободу печати.

Сегодня мы видим тот же цикл. Стремление корпораций метить синтаксис ускорит миграцию пользователей к локальным open-source моделям. Ключевым индикатором станет не точность детекторов, а скорость маргинализации «официального» софта в пользу нового цифрового самиздата.

Вопросы и ответы

Как работают водяные знаки Claude и зачем они нужны?

Anthropic встраивает невидимый статистический отпечаток прямо в текст Claude, влияя на выбор слов так, чтобы итоговый «счёт» блока текста указывал на машинное происхождение. Внешний вид, смысл и читаемость текста при этом не меняются. Мера связана с выполнением требований Статьи 50(2) Кодекса практики ЕС по прозрачности ИИ-контента.

Можно ли удалить водяные знаки Claude из текста?

Сразу после анонса в сети появился рынок инструментов для удаления водяных знаков: GitHub-проект набрал более 4 500 звёзд, возникли новые веб-сервисы и существующие сервисы обхода ИИ-детекции. Однако ни одно из заявлений об успешном удалении пока не подтверждено, поскольку Anthropic ещё не опубликовал метод верификации. Кроме того, исследователи указывают, что попросить второй ИИ переписать текст теоретически может уничтожить водяной знак.

Какие инструменты удаления водяных знаков уже появились и насколько они верифицированы?

В течение нескольких дней после анонса Anthropic в сети появились: GitHub-проекты с более чем 4500 звёздами, новые веб-сервисы и расширения существующих сервисов обхода детекции ИИ. Ни один из инструментов пока не верифицирован как эффективный, поскольку Anthropic не раскрыл алгоритм детектирования — без него невозможно проверить, действительно ли знак удалён. Большинство сервисов используют перефразирование через другую модель — метод, теоретически обоснованный, но не подтверждённый применительно к конкретной реализации Claude. Рынок существует, но работает в условиях информационной асимметрии.

SAMAA TV (август 2026), SC Media (август 2026)

Каков технический механизм встраивания водяного знака в текст Claude и почему он уязвим к удалению?

Водяной знак реализован как статистический отпечаток в выборе слов: модель систематически предпочитает слова с высоким значением по скрытой формуле, и суммарный балл по блоку текста указывает на машинное происхождение. Читателю текст выглядит обычно — изменения на уровне лексических предпочтений незаметны. Детектирование требует алгоритмического анализа частотных паттернов. Уязвимость фундаментальна: статистический отпечаток в выборе слов не выживает при перефразировании другой языковой моделью. Инженер Шон Гёдеке показал этот способ обхода ещё до анонса Anthropic. Для изображений применяется отдельный стандарт C2PA — метаданные о происхождении, встроенные в файл.

TheServerSide.com (август 2026), Boing Boing (август 2026), Android Headlines (август 2026)

Какой сценарий наиболее реалистичен: водяные знаки станут отраслевым стандартом прозрачности или проиграют гонку вооружений с инструментами обхода?

Наиболее реалистично сосуществование двух параллельных процессов. Водяные знаки станут отраслевым стандартом де-юре — давление ЕС распространится на всех крупных провайдеров, и маркировка войдёт в базовые требования. Однако де-факто эффективность будет ограничена: мотивированный пользователь с доступом к любой другой языковой модели сможет удалить знак перефразированием. Это означает, что маркировка работает против случайного и ленивого использования ИИ, но не против целенаправленного сокрытия. Параллельно нарастает риск ложных атрибуций для текстов, лишь частично обработанных ИИ, — это создаст юридические прецеденты и давление на уточнение стандартов. Итог: регуляторная цель будет формально достигнута, практическая — лишь частично.

Boing Boing (август 2026), ITWeb (август 2026), PCWorld (август 2026)

Источники

Reuters

Все карты событий WOWTODAY · Предыдущее событие: Инфляция в США замедлилась второй месяц подряд · Следующее событие: НАТО сбило дрон над Латвией у границы с Россией

WOWWTODAY
ПЯТНИЦА, 14 АВГУСТА
Anthropic внедрил невидимые водяные знаки в тексты Claude

Это карта события

Слева — почему это произошло.
Справа — что будет дальше.

Тяни поле, зумь, кликай карточки — они раскрываются. Кнопки «почему» и «что дальше» ведут вглубь.

как устроен этот конвейер →

МНЕНИЯ AI-ЭКСПЕРТОВ
💬 Чат с событием 15 источников
Я — карта этого события. Спроси о причинах, сценариях или деталях — отвечаю по досье из 15 источников.