Claude Fable 5.1 и Claude Mythos 5.1 стали первыми моделями Anthropic, которые добавляют невидимые водяные знаки во все текстовые ответы и файловые выводы. Компания привязала запуск к требованиям EU AI Act: новые модели Claude после 2 августа 2026 года должны поддерживать такую маркировку.

Идея простая: текст не выглядит иначе для пользователя, но его можно проверить через специальный API. Для рынка ИИ это не косметика, а попытка ввести техническую метку происхождения текста. Особенно там, где генеративные модели уже пишут письма, отчёты, код и документы.

Как работает невидимый водяной знак Claude

Водяной знак Claude работает на уровне выбора слов при генерации: модель чуть сдвигает вероятности и выбирает один вариант вместо другого, если оба подходят по смыслу. Человек этого не видит, но детектор Anthropic ищет статистический рисунок в тексте.

Продолжение после рекламы

Anthropic пишет, что метка переживает копирование, вставку и лёгкую редактуру. То есть простой перенос текста из Claude в документ не должен ломать след. А вот сильная переработка текста уже может снизить точность проверки.

Компания отдельно подчёркивает, что водяной знак не хранит данные пользователя. В нём нет информации об организации, переписке или содержании запросов. По словам Anthropic, метка «не влияет на качество или содержание» ответов Claude.

Есть и важная оговорка. Если детектор нашёл водяной знак, текст написал или обработал Claude. Если метки нет, это не доказывает человеческое авторство. Текст мог пройти сильную правку, выйти из старой модели или появиться из другой системы.

Fable 5.1 уже доступна, Mythos 5.1 пустили не всем

Claude Fable 5.1 вышла в общий доступ в настольном приложении Claude и на других платформах Anthropic. Claude Mythos 5.1 компания оставила для программы trusted access, где доступ получают только проверенные участники.

Изображение к статье: Claude Fable 5.1 и Mythos 5.1 получили водяные знаки

Anthropic описывает Fable 5.1 и Mythos 5.1 как одну и ту же модельную базу. Разница в ограничениях. Mythos 5.1 получила менее жёсткие защитные правила для задач в кибербезопасности и биологических науках.

Это не значит, что Mythos 5.1 отпустили без тормозов. Компания проверила обе модели по новым процедурам безопасности и выравнивания. Эти процедуры Anthropic разработала после внутренних тестов, где модели Claude пытались взламывать внешние компании.

Для Mythos 5.1 Anthropic приводит конкретное улучшение. Новая версия реже, чем Mythos 5, пытается обращаться к ресурсам за пределами тестовой среды, когда получает невыполнимую задачу.

Бенчмарки выросли, но акцент ушёл в контроль происхождения

В анонсе Claude Fable 5.1 и Mythos 5.1 Anthropic показывает рост в нескольких сценариях. Компания говорит о двузначных прибавках в агентных научных исследованиях, агентном программировании и рабочих бизнес-процессах.

Точные цифры зависят от конкретного теста, но направление понятно. Anthropic усиливает модели там, где ИИ работает не как чат-бот, а как исполнитель цепочки задач. Такой режим полезен в кодинге, анализе данных и корпоративной автоматизации.

Продолжение после рекламы

Но водяные знаки здесь даже важнее сухих процентов. До сих пор индустрия спорила, можно ли надёжно отличить машинный текст от человеческого. Anthropic выбрала не внешний классификатор, а встроенную маркировку при генерации.

Старые модели Claude тоже получат поддержку водяных знаков позже. Anthropic раньше обещала добавлять маркировку ко всем новым моделям после 2 августа 2026 года, и Fable 5.1 с Mythos 5.1 стали первыми релизами после этой даты.

API для проверки водяных знаков уже открыт регуляторам, правоохранительным органам, СМИ, фактчекерам, независимым исследователям и другим группам, которые подходят под правила EU AI Act. Anthropic обещает расширять доступ со временем; заявку можно подать через форму Anthropic.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.