Арина Михална
Новости7 минобновлено 26 августа 2026 г.

Водяной знак Claude AI в тексте: находят в 2026

Anthropic научилась находить свои AI-тексты по водяному знаку в структуре токенов. Разбираю, как это работает и что делать тем, кто пишет с Claude.

Водяной знак Claude AI в тексте — схема скрытой метки в токенах
В этой статье
  1. Как именно Claude ставит водяной знак в тексте
  2. Что происходит с меткой, если текст редактировать
  3. Кому это реально грозит, а кому нет
  4. Что делать прямо сейчас, если ты пишешь с Claude
  5. Читайте также

Меня зовут Арина Михална, и я обращаю внимание, что Anthropic встроила в Claude технологию, которая помечает сгенерированный текст невидимым водяным знаком на уровне статистики токенов — и теперь официально объяснила, как именно эта метка работает и почему её сложно стереть простым копипастом. Для тех, кто пишет статьи, посты и рабочие письма с Claude, это не абстрактная новость про безопасность ИИ, а вопрос «а мой текст сейчас палится?».

0 символоввидимых следов метки в тексте
1-2 абзацаправки, чтобы сбить метку

Схема водяного знака в тексте Claude — невидимая метка в структуре токенов

Как именно Claude ставит водяной знак в тексте

Тут важно сразу разделить два принципиально разных подхода к маркировке ИИ-контента: файловый и текстовый. С картинками и видео всё довязано к стандарту C2PA — в метаданные файла зашивается подпись «сделано ИИ», и она либо есть, либо её вырезали при сохранении. С текстом так не сделаешь: у markdown-файла или сообщения в чате нет метаданных, которые прицепишь навечно.

Поэтому Anthropic пошла другим путём — через саму генерацию. Когда языковая модель выбирает следующее слово, у неё есть список кандидатов с вероятностями: «может быть это, а может то, с чуть меньшим шансом». Водяной знак — это скрытый паттерн, по которому модель слегка предпочитает одни варианты из этого списка другим, следуя ключу, известному только Anthropic. Разница в вероятностях крошечная, читателю она незаметна вообще. Но если у тебя есть ключ и достаточно текста для анализа — статистику можно распознать.

Разница с водяными знаками у других моделей — в деталях реализации, а не в идее:

Что мечено Способ Кто видит
Текст Claude скрытое смещение вероятностей токенов детектор Anthropic (закрытый доступ)
Изображения/видео (Nano Banana, Sora и другие) метаданные C2PA в файле любой инструмент, читающий C2PA
Текст ChatGPT/Gemini похожий принцип, свой алгоритм детектор соответствующей компании

Я когда это читала, вспомнила, как полгода назад пыталась объяснить клиенту, почему его «уникальный» рерайт с Claude в итоге спалил антиплагиат — тогда я думала, что дело в стиле фраз. Оказывается, дело было глубже: в самой статистике генерации, а не в узнаваемых оборотах.

Что происходит с меткой, если текст редактировать

Вот тут самое практичное. Метка держится на статистике, а статистика ломается от изменений. Anthropic прямо говорит: если человек переписывает текст своими словами, меняет структуру предложений, добавляет свои примеры — водяной знак слабеет и на достаточном объёме правок пропадает почти полностью.

Ты только разобралась, что метка держится на неизменном тексте — а значит, вопрос «как писать с ИИ, чтобы это оставалось твоим текстом» встаёт ребром прямо сейчас.

В канале я регулярно разбираю такие штуки на живых примерах — что реально происходит внутри моделей, а не то, что все пересказывают друг у друга.

Забрать разборы в канале

Практический вывод простой: если ты берёшь черновик от Claude и публикуешь его копипастом — метка живая. Если ты берёшь черновик, разбираешь его на кости, переписываешь абзацы своим языком, добавляешь личный опыт (как я делаю в каждой статье этого блога) — метки, скорее всего, уже нет, потому что нет и того самого неизменного куска текста.

Сравнение: копипаст текста от Claude против текста после ручной правки

Кому это реально грозит, а кому нет

Разложим честно: паника «теперь всех ИИ-авторов вычислят» — преждевременная. Публичного детектора, доступного любому редактору или SEO-специалисту, у Anthropic сейчас нет — доступ ограничен исследователями безопасности и, по всей видимости, отдельными партнёрами компании. Это не встроенная функция Google Search Console и не плагин для WordPress.

Но опыт с похожими историями (C2PA у картинок, детекторы плагиата у текстов) подсказывает закономерность: если технология существует и работает, она рано или поздно просачивается дальше — в модерацию площадок, в требования заказчиков, в условия конкурсов и грантов. Поэтому вопрос не «грозит ли мне это сегодня», а «стоит ли уже сейчас формировать привычку не публиковать сырой ИИ-текст».

Кому маркировка важна прямо сейчас:

Кому это почти не касается:

Итоговая схема: кто под риском детекции ИИ-текста, а кто нет

Кстати, если тебя интересует не только «спалят или нет», а сам вопрос «как сделать текст от Claude похожим на человеческий», у меня в блоге есть отдельный разбор про то, как убрать нейросетевой стиль текста в Claude — там про признаки ИИ-стиля, а не про водяные знаки, но вопросы соседние.

Что делать прямо сейчас, если ты пишешь с Claude

Никакой мистики. Три привычки, которые снимают риск независимо от того, доработает Anthropic публичный детектор или нет:

  1. Не публикуй первый вариант. Черновик от Claude — сырьё, а не готовый текст. Правка своими словами одновременно снимает метку и делает текст живым — то есть решает сразу две проблемы, а не только формальную.
  2. Добавляй то, чего у модели не было. Личный пример, цифру из своего опыта, спорное мнение — это одновременно ломает статистику генерации и делает текст ценнее для читателя.
  3. Проверяй правила площадки заранее. Если заказчик или издание требует раскрытия ИИ-контента — раскрывай. Это не про страх детектора, это про то, что вранье в договоре обычно вылезает по другой причине раньше, чем через водяной знак.

Про то, из-за чего вообще прилетают проблемы с аккаунтами и как их избежать при работе с Claude из России, я отдельно разбирала в посте канала — там не про водяные знаки, но про смежную тему рисков.

По материалам: Unite.AI, разбор механики водяного знака Claude, The Decoder.

Читайте также

Меня зовут Арина Михална, и если тема с маркировкой ИИ-текста тебя зацепила — в канале «А.М. решает вопросы» я разбираю такие новости раньше, чем они доходят до дзен-агрегаторов, и без пересказа чужих статей. Плюс там лежит гайд по установке Claude из России и разборы того, что реально происходит внутри моделей, а не что все друг у друга копируют. Забрать в канале

Чек-лист: что у тебя теперь есть

Частые вопросы

Как работает водяной знак Claude AI в тексте?

Anthropic слегка смещает статистику выбора токенов при генерации: определённые слова и конструкции чуть чаще получают приоритет по скрытому паттерну. Человек это не замечает, а детектор с ключом Anthropic — считает и опознаёт.

Можно ли убрать водяной знак из текста Claude?

Лёгкая правка своими словами (перефраз абзацев, замена канцелярита) сбивает метку почти полностью — она статистическая и держится на большом объёме неизменного текста. Копипаст без правок метку сохраняет.

Видно ли водяной знак глазами при чтении?

Нет, никаких символов, невидимых пробелов или странных букв в тексте нет. Метка живёт в распределении вероятностей токенов — она читается только программой-детектором.

Заметят ли водяной знак Claude поисковики или площадки?

Технически детектор Anthropic закрытый и официально не встроен в Google или Яндекс, но опыт с другими метками подсказывает: если инструмент существует, площадки рано или поздно получат к нему доступ.

Отличается ли водяной знак Claude от пометок ChatGPT и Gemini?

Принцип у всех похож — статистическое смещение токенов, а не видимый текст. Но у каждой компании свой закрытый алгоритм и свой детектор, так что текст Claude не поймает детектор OpenAI и наоборот.

Следующий шаг

Собери свой сайт за вечер

Свой сайт на Claude за один вечер — и продавай такие же от 30 000 ₽. 8 уроков в записи, без кода и без дизайнера.

Хочу сайт за вечер

Или просто следи

А.М. решает вопросы — 5 000+ подписчиков, разборы Claude каждый день.

Подписаться в Telegram

Источники