Anthropic внедрил невидимые водяные знаки в тексты Claude: причины, сценарии и последствия
· ТЕХНОЛОГИИ · по материалам 433 статей мировых СМИ
С 2 августа 2026 г. все модели Claude автоматически встраивают скрытую машиночитаемую метку в генерируемые тексты и C2PA-метаданные в изображения — во исполнение Статьи 50(2) Кодекса прозрачности ЕС по закону об ИИ.
Что произошло
Anthropic объявил, что все модели Claude, выпущенные начиная с 2 августа 2026 года, автоматически встраивают невидимый статистический водяной знак в генерируемые тексты, не изменяя их смысл, качество или читаемость. Для изображений применяется стандарт C2PA, фиксирующий данные о происхождении контента. Мера распространяется не только на полностью сгенерированные тексты, но и на случаи, когда Claude лишь редактировал, переводил или корректировал оригинальный текст пользователя.
Технически водяной знак реализован как статистический отпечаток в выборе слов: модель отдаёт предпочтение словам с высоким значением по скрытой формуле, и суммарный балл по блоку текста указывает на машинное происхождение. Знак невидим для читателя, однако детектируется алгоритмически. Метод распространяется на весь глобальный трафик, хотя поддержка в ЕС была запущена первой.
Решение немедленно вызвало двойную реакцию: пользователи, скрывавшие применение ИИ на работе и в учёбе, выразили недовольство, тогда как в течение нескольких дней в сети появился рынок инструментов для удаления водяных знаков — GitHub-проекты, новые веб-сервисы и существующие сервисы обхода детекции ИИ. Эффективность этих инструментов пока не верифицирована, поскольку Anthropic не раскрыл метод детектирования.
Почему это произошло: причины события
Закон ЕС об ИИ: Статья 50(2)
Статья 50(2) Кодекса прозрачности ЕС по закону об ИИ требует, чтобы системы генеративного ИИ маркировали свои выходные данные машиночитаемым образом. Требование вступило в силу в августе 2026 года, и Anthropic стал одним из первых крупных провайдеров, публично подтвердивших присоединение к Кодексу практики.
Требование ЕС сформулировано принципиально: метка должна быть встроена в контент так, чтобы её было сложно отделить. Это исключает простые внешние теги и подталкивает разработчиков именно к статистическим методам встраивания в структуру текста, которые Anthropic и реализовал.
Источники: Reuters
«Взрыв» генеративного ИИ с 2022 года
Начиная с конца 2022 года генеративный ИИ стал доступен сотням миллионов пользователей, что резко обострило проблему неотличимости машинного контента от человеческого. Регуляторы ЕС зафиксировали этот разрыв как системный риск для информационной среды.
Закон об ИИ стал прямым ответом на эту волну: требования маркировки направлены именно против контента, который «выглядит как ИИ», но не может быть доказательно атрибутирован машине без технических средств.
Источники: Reuters
Недоказуемость ИИ-авторства без метки
До внедрения водяных знаков детекция ИИ-контента опиралась на статистические паттерны и косвенные признаки. Даже при высоком балле детектора нельзя было однозначно утверждать машинное происхождение текста — это создавало правовую и академическую серую зону.
Антропик и другие провайдеры оказались под давлением именно потому, что отсутствие верифицируемой метки делало любые обвинения в использовании ИИ оспоримыми. Водяной знак переводит вопрос из вероятностного в доказательный.
Источники: Reuters
Репутационный и регуляторный риск для Anthropic
Anthropic, получающий инвестиции от Google и Amazon, строит бренд на принципах безопасного и прозрачного ИИ. Отказ от маркировки на фоне требований ЕС создавал репутационное противоречие и потенциальные юридические риски на европейском рынке.
Присоединение к Кодексу прозрачности позволяет компании демонстрировать соответствие регуляторным требованиям опережающим образом, не дожидаясь принудительного исполнения. Это стратегически важно для сохранения доступа к европейскому рынку.
Источники: Reuters
Что будет дальше: сценарии развития
Гонка вооружений: водяные знаки vs. инструменты удаления (вероятно, горизонт: 3–12 месяцев)
Уже через несколько дней после объявления Anthropic в сети появились GitHub-проекты с тысячами звёзд, новые веб-сервисы и расширения существующих сервисов обхода детекции. Пока Anthropic не раскрыл алгоритм детектирования, эффективность этих инструментов непроверяема — но как только метод станет известен, обход станет тривиальным.
Инженер Шон Гёдеке ещё до анонса Anthropic показал, что текстовый водяной знак можно удалить, попросив другую языковую модель перефразировать текст. Статистический отпечаток в выборе слов не выживает при перефразировании. Это означает, что водяной знак эффективен против случайных пользователей, но не против мотивированных.
Источники: Reuters
Водяной знак теряет практическую ценность (возможно, горизонт: )
Широкое распространение инструментов удаления водяных знаков обесценит текстовую маркировку как механизм прозрачности. Добросовестные пользователи будут маркированы, недобросовестные — нет, что инвертирует цель регулирования.
Это создаст давление на ЕС в сторону более жёстких технических стандартов или перехода к иным механизмам прозрачности — например, к обязательной серверной регистрации запросов.
Источники: Reuters
Отраслевой стандарт: другие LLM следуют за Anthropic (вероятно, горизонт: 6–18 месяцев)
Anthropic стал первым крупным провайдером, публично подтвердившим внедрение текстовых водяных знаков в рамках Кодекса ЕС. Если регулятор начнёт принудительное исполнение требований Статьи 50(2), остальные провайдеры — включая OpenAI, Google и Meta — будут обязаны последовать.
Формирование отраслевого стандарта маркировки создаст инфраструктуру для кросс-платформенной детекции. C2PA для изображений уже является консорциумным стандартом; аналогичный путь возможен для текста, хотя технически он значительно сложнее.
Источники: Reuters
Ложные атрибуции и юридические споры (возможно, горизонт: 6–24 месяца)
Поскольку водяной знак встраивается даже при минимальном редактировании или корректуре оригинального текста пользователя, возникает риск ложной атрибуции: текст, написанный человеком и лишь исправленный ИИ, будет помечен как ИИ-генерированный. Это создаёт почву для академических санкций, трудовых споров и репутационного ущерба.
Юридический прецедент пока не сформирован, но по мере распространения детекционных инструментов работодателями, университетами и издателями число конфликтных случаев будет расти. Отсутствие у Anthropic публичного механизма оспаривания ложных срабатываний усугубляет проблему.
Источники: Reuters
Регуляторное давление на уточнение стандартов (возможно, горизонт: )
Действующая реализация не различает полностью сгенерированный текст и текст, прошедший лёгкую редактуру. Это концептуальная проблема стандарта, а не только технической реализации.
Под давлением судебных прецедентов и жалоб пользователей ЕС или сами провайдеры будут вынуждены ввести градацию: например, метку интенсивности ИИ-участия вместо бинарной маркировки.
Источники: Reuters
Пользовательский отток к немаркирующим провайдерам (возможно, горизонт: 3–9 месяцев)
Radio Facts Media фиксирует прямое недовольство пользователей, опасающихся разоблачения на работе и в учебных заведениях. Водяной знак делает ровно то, чего хотят регуляторы и чего боятся эти пользователи — и это создаёт стимул к переходу на незамаркированные альтернативы.
Open-source модели (Llama, Mistral и другие), работающие локально, не подпадают под требования Кодекса ЕС в части маркировки выходных данных. Если отток к ним станет значимым, регуляторная цель окажется достигнутой лишь для добросовестного меньшинства.
Источники: Reuters
Мнения AI-экспертов
Экономист (модель GPT)
Главный эффект — сдвиг из UX в закупки: корпоративные юристы начнут требовать происхождение текста так же, как происхождение компонентов. Это добавит транзакционные издержки в маркетинг, консалтинг, локализацию и аутсорсинг.
Индикатор — не число детекторов, а спред цен между «чистыми» и маркируемыми API, плюс условия в тендерах и страховках. Если спред устойчив, водяной знак станет не защитой от обмана, а новым контуром комплаенса.
Аналитик (модель CLAUDE)
Все обсуждают гонку вооружений и отток аудитории, но упускают ключевое: Anthropic создал не инструмент детекции ИИ — он создал инфраструктуру атрибуции. Водяной знак на отредактированном тексте означает, что даже 20% правки Claude оставляют след. Это меняет правовую природу документа: суд, работодатель или университет получают не вероятностный детектор, а криптографически верифицируемую метку происхождения.
Главный индикатор, который стоит отслеживать — не GitHub-проекты по удалению, а первые трудовые и академические прецеденты. Как только один иск или одно отчисление пройдут с водяным знаком в качестве доказательства, поведение миллионов пользователей изменится резче, чем от любого технического обхода.
Неожиданная связь: расширение на редактуру и перевод делает Anthropic невольным арбитром авторства в профессиях, где ИИ-ассистирование уже норма — юристы, журналисты, переводчики. Вопрос не «поймают ли меня», а «кому принадлежит текст, который я отредактировал с помощью Claude».
Историк (модель GEMINI)
В XIV веке европейские бумажники начали использовать филиграни — водяные знаки для защиты монополий. Но история учит: попытки контролировать информацию через маркировку лишь стимулировали подполье. Появление бумаги без знаков гильдий в итоге предопределило успех Реформации и свободу печати.
Сегодня мы видим тот же цикл. Стремление корпораций метить синтаксис ускорит миграцию пользователей к локальным open-source моделям. Ключевым индикатором станет не точность детекторов, а скорость маргинализации «официального» софта в пользу нового цифрового самиздата.
Вопросы и ответы
Как работают водяные знаки Claude и зачем они нужны?
Anthropic встраивает невидимый статистический отпечаток прямо в текст Claude, влияя на выбор слов так, чтобы итоговый «счёт» блока текста указывал на машинное происхождение. Внешний вид, смысл и читаемость текста при этом не меняются. Мера связана с выполнением требований Статьи 50(2) Кодекса практики ЕС по прозрачности ИИ-контента.
Можно ли удалить водяные знаки Claude из текста?
Сразу после анонса в сети появился рынок инструментов для удаления водяных знаков: GitHub-проект набрал более 4 500 звёзд, возникли новые веб-сервисы и существующие сервисы обхода ИИ-детекции. Однако ни одно из заявлений об успешном удалении пока не подтверждено, поскольку Anthropic ещё не опубликовал метод верификации. Кроме того, исследователи указывают, что попросить второй ИИ переписать текст теоретически может уничтожить водяной знак.
Какие инструменты удаления водяных знаков уже появились и насколько они верифицированы?
В течение нескольких дней после анонса Anthropic в сети появились: GitHub-проекты с более чем 4500 звёздами, новые веб-сервисы и расширения существующих сервисов обхода детекции ИИ. Ни один из инструментов пока не верифицирован как эффективный, поскольку Anthropic не раскрыл алгоритм детектирования — без него невозможно проверить, действительно ли знак удалён. Большинство сервисов используют перефразирование через другую модель — метод, теоретически обоснованный, но не подтверждённый применительно к конкретной реализации Claude. Рынок существует, но работает в условиях информационной асимметрии.
SAMAA TV (август 2026), SC Media (август 2026)
Каков технический механизм встраивания водяного знака в текст Claude и почему он уязвим к удалению?
Водяной знак реализован как статистический отпечаток в выборе слов: модель систематически предпочитает слова с высоким значением по скрытой формуле, и суммарный балл по блоку текста указывает на машинное происхождение. Читателю текст выглядит обычно — изменения на уровне лексических предпочтений незаметны. Детектирование требует алгоритмического анализа частотных паттернов. Уязвимость фундаментальна: статистический отпечаток в выборе слов не выживает при перефразировании другой языковой моделью. Инженер Шон Гёдеке показал этот способ обхода ещё до анонса Anthropic. Для изображений применяется отдельный стандарт C2PA — метаданные о происхождении, встроенные в файл.
TheServerSide.com (август 2026), Boing Boing (август 2026), Android Headlines (август 2026)
Какой сценарий наиболее реалистичен: водяные знаки станут отраслевым стандартом прозрачности или проиграют гонку вооружений с инструментами обхода?
Наиболее реалистично сосуществование двух параллельных процессов. Водяные знаки станут отраслевым стандартом де-юре — давление ЕС распространится на всех крупных провайдеров, и маркировка войдёт в базовые требования. Однако де-факто эффективность будет ограничена: мотивированный пользователь с доступом к любой другой языковой модели сможет удалить знак перефразированием. Это означает, что маркировка работает против случайного и ленивого использования ИИ, но не против целенаправленного сокрытия. Параллельно нарастает риск ложных атрибуций для текстов, лишь частично обработанных ИИ, — это создаст юридические прецеденты и давление на уточнение стандартов. Итог: регуляторная цель будет формально достигнута, практическая — лишь частично.
Boing Boing (август 2026), ITWeb (август 2026), PCWorld (август 2026)
Источники
Reuters
- TechRound: Is Anthropic's New Watermark The End Of Undetectable AI? Claude Says It's Time To Leave A Trace - TechRound
- Boing Boing: You can remove an AI watermark from text by asking a second AI
- ITWeb: Claude AI watermarking is not definitive evidence, say SA experts
- TechTarget: Weekly news roundup: Claude watermark controversy and Nvidia $500 b...
- PCWorld: AI watermarks are a good idea. They won't stop AI slop
- NDTV: Video | Anthropic Introduces Invisible Watermarks To Identify AI Content
- protothemanews.com: New EU rules on the use of Artificial Intelligence: How AI-generated images & text will be identified - ProtoThema English
- 2oceansvibe News | South African and international news: Claude Is Now Leaving Fingerprints On Its Content
- SAMAA TV: AI 'watermark removers' flood web, but few can prove they work
- Radio Facts Media: Anthropic's Claude Watermarking Draws Backlash From Users - Radio Facts
- TelecomTalk: Claude Launches Invisible Markers to Detect AI-Generated Text
- Android Headlines: Your Next Claude-Generated Drafts & Images Will Carry an Invisible Watermark: Here's Why
- The Hindu: Anthropic watermarking Claude AI content
- TheServerSide.com Java, AI, Spring, Claude and Certifiations: How does Claude watermark its text?
- SC Media: Market for AI watermark removal tools emerges after Anthropic's Claude update
Все карты событий WOWTODAY · Предыдущее событие: Инфляция в США замедлилась второй месяц подряд · Следующее событие: НАТО сбило дрон над Латвией у границы с Россией
TODAY