регулирование 1 мин

Anthropic раскрыла подробности водяных знаков в Claude: как работает, можно ли обойти и что с кодом

Anthropic опубликовала детали технологии водяных знаков для Claude (требование EU AI Act). Использует метод SynthID-Text от Google DeepMind, знаки незаметны для читателя, но детектируются специальным API. Лёгкое редактирование не убирает метку, полная переписывание — да. В коде меток меньше (нужна работающая логика), в тексте — больше свободы для маркировки.

Это первый массовый кейс внедрения обязательной маркировки ИИ-контента под давлением регуляторов. Показывает, как будет выглядеть рынок ИИ в ЕС — и какие лазейки в системе есть уже сейчас.

Что произошло

Anthropic опубликовала разъяснение по технологии водяных знаков для Claude — ответ на волну недовольства пользователей после анонса ранее на этой неделе. Компания обязана внедрить маркировку по требованию Transparency Code (EU AI Act): ИИ-контент должен быть идентифицируем.

Технология основана на методе SynthID-Text от Google DeepMind (2024). Суть: когда Claude выбирает между равноценными вариантами слов (например, «пасмурно» vs «серо»), он создаёт паттерн — невидимый читателю, но детектируемый через специальный ключ. Anthropic обещает публичный API для проверки.

Что с обходом? Лёгкое редактирование (правка пары слов) не убирает метку полностью. Полная переписывание каждого слова — да, но тогда это уже не ИИ-текст по сути. Если Claude только вычитал чужой текст — меток почти не будет (большинство слов от человека).

В коде меток минимум: модели нужен рабочий код, нет свободы для произвольного выбора. Метки могут быть в комментариях, но на сам код не влияют. Другие крупные модели тоже внедряют свои водяные знаки по тому же EU-регламенту.

Реакция пользователей — от конспирологии («заговор против честных юзеров») до отмены подписок. Business Insider сообщает о «десятках» отписок в X.

Автор: Ольга Ким · Источник: TechCrunch AI

Разработчикам. Если используешь Claude для генерации кода — водяные знаки почти не влияют на вывод (только в комментариях). Для текстовых задач (документация, тексты) — метки будут, лёгкое редактирование не спасёт. Планируется публичный API детекции — можно встроить в свои продукты для проверки контента.

Бизнесу. Компаниям, которые генерируют контент через Claude (маркетинг, поддержка, документы), стоит учесть: текст будет детектируем как ИИ-сгенерированный. Это риск для сценариев, где нужна полная «человечность» (продажи, PR). С другой стороны — возможность легально использовать ИИ в ЕС, соблюдая AI Act.

Инвесторам. EU AI Act заставляет всех крупных игроков внедрять водяные знаки — это стандарт рынка, не уникальная фича Anthropic. Растёт спрос на детекторы ИИ-контента (API, SaaS-сервисы). Риск оттока пользователей у моделей с жёсткой маркировкой — часть аудитории хочет «невидимости». Потенциал у инструментов обхода или легальных альтернатив без меток (вне ЕС).

Хайп35
Реальная польза60
Заработать55
  • Разработать SaaS-сервис на базе API детекции водяных знаков для корпораций (проверка контента сотрудников, студентов, подрядчиков)
  • Создать инструмент для «легального редактирования» ИИ-текстов — переписывание с сохранением смысла, но без меток (grey area, но спрос есть)
  • Запустить консалтинг для бизнеса: как использовать Claude в ЕС с соблюдением AI Act и избежать репутационных рисков
  • Инвестировать в стартапы, которые делают детекторы следующего поколения (не только водяные знаки, но и стилометрия, паттерны)
  • Разработать платформу для прозрачной генерации контента — с автоматической пометкой «создано с помощью ИИ» для маркетинга и медиа
  • Пользователи уходят к моделям без меток (OpenAI, локальные модели) — часть аудитории хочет анонимности использования ИИ
  • Технология обходима: полная переписывание убирает метки, появятся сервисы-«отмывки» ИИ-текстов
  • Код почти не маркируется — дыра в системе, разработчики могут свободно использовать Claude для программирования без детекции
  • EU AI Act создаёт фрагментацию рынка: модели для ЕС с метками, для остального мира — без. Издержки на разные версии продукта

Честно говоря, эта система больше похожа на галочку для регуляторов, чем на реальную защиту от злоупотреблений. Водяные знаки работают только если ты не особо стараешься их скрыть — лёгкое редактирование оставляет следы, но серьёзное переписывание всё стирает. А в коде меток почти нет, потому что модели нужна рабочая логика, а не художественная свобода. То есть программисты могут спокойно юзать Claude — детекция их не поймает.

С другой стороны, публичный API детекции — это реальная возможность для бизнеса. Корпорации и университеты уже ищут способы проверять, кто пишет сам, а кто копирует у ИИ. Кто первым запакует этот API в удобный SaaS с дашбордами и интеграциями — заработает на корпоративных контрактах. А паника пользователей про «конспирацию» — это просто непонимание масштаба: ЕС обязал всех крупных игроков, не только Anthropic. Рынок фрагментируется на «модели для ЕС» и «модели для остального мира», и это только начало.

Инструменты из статьи

AI-ассистент Anthropic. Сильнейший в работе с кодом, длинными документами и...

Доступ из РФ →

Ещё по теме

Комментарии