Содержание
Водяные знаки Claude скоро появятся в текстах ИИ, но сервисы вроде GPTZero, Turnitin, Originality.ai и Copyleaks от этого не исчезнут. Они решают разные задачи: watermark ищет встроенный след модели, а детектор оценивает стиль и статистику текста.
Для пользователя это звучит как спор двух похожих технологий. На деле разница примерно как между серийным номером на устройстве и диагностикой по косвенным симптомам. Первый даёт жёсткий сигнал, если метка сохранилась. Вторая работает шире, но ошибается.
Водяной знак Claude работает как невидимый след
Anthropic готовит водяные знаки для Claude на базе технологии Google SynthID: модель будет слегка сдвигать выбор отдельных слов, а затем проверяющий инструмент сможет найти этот скрытый рисунок в достаточно длинном фрагменте.
Механика не похожа на банальную подпись в конце текста. Claude меняет распределение слов там, где у модели есть несколько равноправных вариантов. Обычно это слова с низким риском для смысла: формулировка меняется, но мысль остаётся той же.
Если таких микросдвигов набирается достаточно много, они складываются в невидимый паттерн. Anthropic указывает ориентир: примерно 150 слов или не меньше 200 токенов. Короткая фраза из пары предложений для такой проверки слабовата.
Компания планирует сначала включить watermark в новых моделях Claude. Старые модели получат поддержку позже. Инструменты для проверки Anthropic обещает выпустить отдельно; ожидается, что доступ к ним будет бесплатным.
Наличие водяного знака даст сильный ответ: Claude обрабатывал текст. Это может быть генерация с нуля или серьёзная редактура уже готового фрагмента. Лёгкая правка, по словам Anthropic, не должна включать watermark.
Отсутствие метки не очищает текст
Слабое место любого watermark простое: если метки нет, это ещё не доказывает человеческое авторство. Текст могли переписать руками, прогнать через другую модель или сильно отредактировать после Claude.
Прямое копирование, наоборот, водяной знак переживёт. Но тяжёлая редактура ломает скрытый рисунок. Для редакций, вузов и компаний это неприятный нюанс: проверка метки даёт уверенность только при положительном результате.
Есть и ограничение по охвату. Claude оставит след только в текстах, которые прошли через Claude. Если фрагмент создал ChatGPT, Gemini, локальная модель или любой ИИ без совместимого watermark, проверка Anthropic ничего не найдёт.
Другие разработчики могут внедрить похожие или совместимые схемы. Давление на такие механизмы растёт, в том числе из-за требований EU AI Act к маркировке ИИ-контента. Но единой универсальной метки для всех текстовых моделей пока нет.
Детекторы ИИ-текста останутся рядом
Детекторы ИИ-текста работают иначе: они не ищут встроенную метку, а оценивают вероятность машинного происхождения по стилю, ритму и повторяющимся языковым привычкам моделей.
Это ближе к полиграфу, чем к анализу ДНК. Полиграф не доказывает ложь, но ловит косвенные сигналы: дыхание, пульс, потоотделение, напряжение. Детектор текста так же смотрит на признаки, которые часто встречаются у нейросетей.
- Повторяемые словосочетания: фразы, которые часто выбирают языковые модели.
- Семантическое зацикливание: мысль возвращается к уже сказанному без новой информации.
- Ровный ритм: предложения похожи по длине и звучат слишком гладко.
- Шаблонные переходы: формальные связки вроде furthermore и in conclusion.
- Избыточные оговорки: конструкции вроде it is worth noting и it is clear that.
Проблема та же, что у любых вероятностных систем. Детектор может обвинить человеческий текст или пропустить машинный. Точность зависит от сервиса, языка, длины фрагмента и того, насколько автор или редактор отполировал результат.
Платные сервисы заинтересованы в том, чтобы рынок им верил. Но их аргумент не сводится к маркетингу. Даже после запуска watermark останутся тексты без меток: старые генерации, материалы от других моделей, сильно переписанные фрагменты и контент из локальных ИИ.
Поэтому водяные знаки Claude станут ещё одним слоем проверки, а не заменой старым инструментам. Жёсткий факт пока такой: Anthropic говорит о срабатывании watermark примерно от 150 слов или 200 токенов, а лёгкая редактура Claude не должна включать метку.