Водяной знак в обычном тексте выглядит невозможным: в тексте нет пикселей, а метаданные не переживают copy-paste. Но пометки существуют. Google помечает текст из Gemini app и веб-версии с 2024 года (API остаётся документированным исключением), а с августа 2026 новые модели Claude маркируют текст на уровне модели, и ранние модели получат это позже. Знак невидим, переживает копирование и живёт не в символах, а в выборе между словами.
Модель пишет так: на каждой развилке бросает взвешенные кости — у неё есть короткий список подходящих слов с разными шансами. Секретный ключ красит кандидатов в зелёные и красные, а потом слегка подталкивает кости к зелёному. Толчок слабый: красное слово может выиграть. Окраска зависит от короткого префикса перед словом, поэтому одно и то же слово после другого контекста может стать красным. Google SynthID использует более хитрую турнирную схему, а схема Ааронсона, построенная в OpenAI, вообще выводит случайность из ключа. Принцип один: метка прячется в выборе слов.
Детектор с ключом перекрашивает текст и просто считает зелёные слова. Без метки зелёных около половины, как при подбрасывании монеты. С меткой — статистически значимо больше. Чем длиннее текст, тем заметнее перекос; короткие тексты действительно трудно проверить.
Метка живёт только в нетронутых фрагментах: цвет каждого слова выводится из нескольких слов перед ним. Правка стирает метку ровно там, где ломает эту последовательность. Лёгкая редактура или пересказ в один проход разбавляют метку, но не убивают — даже человеческий пересказ снова детектится после примерно 800 токенов, то есть около 600 слов. Полный пересказ по смыслу, как full-rewrite от declaude, ломает метку: выживает примерно 0.5% окон, и точность детектора падает с почти стопроцентной до монетки. Эти цифры получены на открытых реализациях MarkLLM, схемы KGW и EXP. Продакшен-схема Anthropic не раскрыта, так что снаружи проверить метку Claude пока нельзя.
На практике проверить текст может только держатель ключа. Учитель, редактор или сайт-детектор не смогут запустить такой тест — нужен секретный ключ провайдера или его сервис проверки. Google уже даёт early-access портал для SynthID, Anthropic обещает инструменты детекции. Водяной знак — это не «AI-детектор» вроде GPTZero, а строгий статистический тест под ключом. Найденная метка означает «обработано», а не «написано»: даже текст, лишь вычитанный или переведённый Claude, получает метку. Отсутствие метки ничего не доказывает — старые модели или тяжёлая правка дают чистый результат на реальном AI-тексте. В коротких текстах с почти единственным правильным продолжением, например в коде или цитатах, метке просто негде спрятаться. Схемы, привязанные к самому слову, переживают пересказ лучше, но их можно восстановить по большому объёму вывода. Против меток, спрятанных в смысле, пока помогает только полная регенерация по плану.