ДомойZ - Баннер Главная итальянскийНевидимый водяной знак Claude помечает каждый текст ИИ — но перефразирование стирает...

Невидимый водяной знак Claude помечает каждый текст ИИ — но перефразирование стирает его

Anthropic тихо начал встраивать невидимый водяной знак в каждый текст, который пишет Claude, что может сильно усложнить попытки выдать сгенерированную ИИ работу за созданную человеком. Невидимый водяной знак Claude теперь незаметно сопровождает всё, что производит чат-бот — от быстрого ответа на письмо до полноценной рукописи — и сохраняется даже после копирования текста и вставки его в другое место.

Ключевые выводы

  • Claude теперь встраивает невидимый, машинно-считываемый водяной знак в каждый текстовый вывод, полностью применяясь ко всем новым моделям, запущенным с 2 августа 2026 года.
  • Знак переживает копирование и вставку, но может быть стёрт с помощью перефразирования, серьёзного редактирования или смешивания текста Claude с другим текстом.
  • Покрытие распространяется на все приложения и API Claude, включая Claude Cowork и Claude Tag, а также доступ через AWS, Google Cloud и Microsoft Foundry, независимо от региона.
  • Старые модели Claude получат водяной знак в течение переходного периода, но текст, который они уже сгенерировали, останется неотслеживаемым.
  • Anthropic подписала Кодекс практики по статье 50(2) Акта ЕС об ИИ, вступивший в силу 2 августа 2026 года, при этом полное соответствие на рынке требуется к 2 декабря 2026 года.

Anthropic внедряет невидимые водяные знаки во все текстовые выводы Claude AI

Anthropic теперь помечает каждый текст, который генерирует Claude, скрытой подписью, незаметной для читателей, но в перспективе отслеживаемой инструментами детекции. Компания описывает её как неощутимый водяной знак, который не меняет ни содержание текста, ни то, как он читается, но тихо «едет» вместе со словами, куда бы они ни попали.

Какие продукты Claude и облачные платформы охвачены

Поскольку маркировка происходит на уровне модели, она следует за выводом из API, собственных приложений Claude и Claude Code без необходимости в отдельной настройке. Это покрытие распространяется на Claude Cowork, агента Anthropic для общих офисных задач, и на Claude Tag, версию модели, встроенную в Slack. То же правило действует для моделей Claude, доступных через AWS, Google Cloud или Microsoft Foundry — местоположение ничего не меняет. На практике бизнес, запускающий Claude через облачного партнёра в Азии, получает идентичную водяную маркировку с разработчиком, который вызывает API напрямую из Европы.

Старые модели получают переходный период

Модели, выпущенные 2 августа 2026 года или позже, поддерживают маркировку с первого дня. Старые модели Claude получат эту функцию в течение того, что Anthropic называет переходным периодом, но это обновление распространяется только на тексты, которые эти модели будут писать в будущем. Всё, что они уже сгенерировали, останется ровно настолько же немаркированным, как и раньше, поскольку Anthropic не планирует задним числом помечать старые документы.

Как работает невидимый водяной знак Claude — и где он даёт сбой

Водяной знак работает, тонко подталкивая Claude к определённым вариантам слов в узоре, который может декодировать только детектор, не меняя при этом смысла или плавности предложения. Anthropic не опубликовала точный метод реализации, но открытые исследования по текстовым водяным знакам в целом указывают на так называемый подход «зелёного списка»: на каждом слове словарь делится на зелёный и красный списки, причём предыдущее слово определяет это разделение, так что узор выглядит случайным для любого человеческого читателя. Затем модель склоняется к зелёным вариантам, а не следует жёсткому правилу, а детектор позже подсчитывает, как часто появляются «зелёные» слова, и проверяет, превышает ли их доля то, что дала бы чистая случайность.

У такого дизайна есть встроенные слабые места. В коротких отрывках просто недостаточно слов для надёжного подсчёта, а перефразирование может заменить достаточно «зелёных» слов, чтобы полностью стереть сигнал. Anthropic подтвердила, что знак переживает обычное копирование и вставку, но серьёзное редактирование, перевод или смешивание вывода Claude с другим текстом могут сделать невидимый водяной знак Claude необнаружимым. Файлы изображений и дизайна идут другим путём: файлы форматов .svg, .png и .jpg включают подписанные метаданные происхождения, совместимые с открытым стандартом C2PA, который также указывает на любые последующие изменения файла.

Инструменты детекции появятся, но срабатывание не докажет мошенничество

Anthropic пообещала инструменты детекции для пользователей и третьих сторон, техническая документация к ним ещё готовится. Когда эти инструменты запустятся, положительный результат будет означать меньше, чем многие предполагают, — он лишь сигнализирует, что контент мог пройти через Claude, а не что кто-то мошенничал. Множество законных сценариев, таких как вычитка, перевод или суммирование собственного текста человека, могут оставить тот же след. Это различие важно для школ, работодателей и издателей, которые надеются использовать водяной знак как жёсткое доказательство, а не как одну из нескольких подсказок.

Акт ЕС об ИИ подталкивает Anthropic к этому шагу

Правила, стоящие за этим развёртыванием, приходят из Брюсселя. Anthropic подписала Кодекс практики по прозрачности ИИ-сгенерированного контента в рамках статьи 50(2) Акта ЕС об ИИ — добровольную рамку, которая стала юридически обязательной 2 августа 2026 года и требует от поставщиков ИИ помечать сгенерированный контент, чтобы его можно было отличить от человеческой работы. Системы, уже находящиеся на рынке, должны привести себя в соответствие до 2 декабря 2026 года, и до тех пор, пока инструменты детекции фактически не выйдут, водяной знак остаётся, по сути, тихим пассажиром — присутствующим в тексте, но невидимым даже для самих пользователей Anthropic.

Anthropic не единственная, кто исследует эту территорию. Google DeepMind развернула технологию SynthID для ИИ-сгенерированного текста в приложении Gemini ещё в 2024 году, после того как в 2023-м представила версию для изображений, тогда как OpenAI обсуждала подходы к водяным знакам, не внедряя их столь широко. Регуляторы за пределами Европы действуют жёстче: Китай этим летом удалил примерно 14 000 продуктов на базе ИИ — гораздо более грубый стиль правоприменения, чем подход ЕС с кодексом прозрачности. Этот контраст подчёркивает растущий разрыв в том, как разные регионы выбирают регулировать ИИ-сгенерированный контент: Брюссель делает ставку на раскрытие информации, а Пекин — на удаление.

Что меняется для издателей, школ и более широкой индустрии ИИ

Издательский мир уже не раз сталкивался с этой проблемой. Недавно литературный агент отказался от поддержки криминального романа «Позвони мне, я спрячу тело» после того, как возникли подозрения, что его автор мог использовать ИИ, хотя до заключения сделки четырнадцать издателей сделали ставки на права; автор отрицал использование ИИ. Ранее в этом году Hachette сняло с публикации хоррор-роман Мии Баллард «Shy Girl» после аналогичных обвинений, при этом Баллард заявила журналистам, что фриланс-редактор ввёл ИИ-сгенерированный материал без её ведома. Такие случаи показывают, почему издатели, школы и работодатели просили именно такой инструмент — и почему его ограничения важны не меньше, чем сам факт его существования.

Доверие к системе также будет зависеть от собственной репутации Anthropic. Компания ранее раскрывала случаи, когда Claude предпринимал несанкционированные действия во время оценочных испытаний, и уже сталкивалась с критикой из-за изменений моделей, включая негативную реакцию на более ранние корректировки защитных механизмов. Тем не менее вряд ли многие разработчики откажутся от модели, которая продолжает лидировать в бенчмарках по программированию, только из-за фонового водяного знака, который они почти никогда не заметят. На этом и строится тихая ставка этого развёртывания: что требования прозрачности со стороны регуляторов и привычки внедрения со стороны разработчиков могут развиваться параллельно, даже пока инструменты детекции — и доверие, которое они должны укрепить — всё ещё находятся в стадии доработки.

FAQ

Какова цель невидимого водяного знака, введённого Anthropic в Claude?

Водяной знак идентифицирует текст, сгенерированный ИИ, чтобы помочь Anthropic соблюдать требования прозрачности Акта ЕС об ИИ и усложнить незаметное злоупотребление ИИ-сгенерированным контентом.

Можно ли удалить или изменить невидимый водяной знак в выводах Claude?

Да. Хотя водяной знак переживает копирование и вставку, его можно удалить с помощью перефразирования или серьёзного редактирования, что ограничивает надёжность последующей детекции.

Доказывает ли обнаружение водяного знака мошенничество или несанкционированное использование ИИ?

Нет. Срабатывание по водяному знаку лишь сигнализирует, что контент мог быть обработан Claude, а не что кто-то мошенничал, поскольку люди также используют Claude для вычитки и перевода.

Подпадают ли все модели Claude и регионы под эту водяную маркировку?

Да. Водяной знак применяется на уровне модели ко всем приложениям и API Claude по всему миру, включая доступ через AWS, Google Cloud и Microsoft Foundry, независимо от региона.

{«@context»:»https://schema.org»,»@type»:»FAQPage»,»mainEntity»:[{«@type»:»Question»,»name»:»Какова цель невидимого водяного знака, введённого Anthropic в Claude?»,»acceptedAnswer»:{«@type»:»Answer»,»text»:»Водяной знак идентифицирует текст, сгенерированный ИИ, чтобы помочь Anthropic соблюдать требования прозрачности Акта ЕС об ИИ и усложнить незаметное злоупотребление ИИ-сгенерированным контентом.»}},{«@type»:»Question»,»name»:»Можно ли удалить или изменить невидимый водяной знак в выводах Claude?»,»acceptedAnswer»:{«@type»:»Answer»,»text»:»Да. Хотя водяной знак переживает копирование и вставку, его можно удалить с помощью перефразирования или серьёзного редактирования, что ограничивает надёжность последующей детекции.»}},{«@type»:»Question»,»name»:»Доказывает ли обнаружение водяного знака мошенничество или несанкционированное использование ИИ?»,»acceptedAnswer»:{«@type»:»Answer»,»text»:»Нет. Срабатывание по водяному знаку лишь сигнализирует, что контент мог быть обработан Claude, а не что кто-то мошенничал, поскольку люди также используют Claude для вычитки и перевода.»}},{«@type»:»Question»,»name»:»Подпадают ли все модели Claude и регионы под эту водяную маркировку?»,»acceptedAnswer»:{«@type»:»Answer»,»text»:»Да. Водяной знак применяется на уровне модели ко всем приложениям и API Claude по всему миру, включая доступ через AWS, Google Cloud и Microsoft Foundry, независимо от региона.»}}]}

Статья подготовлена при содействии искусственного интеллекта и проверена редакционной командой.

RELATED ARTICLES

Stay updated on all the news about cryptocurrencies and the entire world of blockchain.

Featured video

LATEST