Anthropic представила Claude Sonnet 4.6 — обновлённую модель среднего уровня, которая стала стандартной в Claude для бесплатных пользователей и подписки Pro. Главные обещания простые: меньше «галлюцинаций», лучше код и уверенная работа с длинным контекстом.

Ключевая цифра тут — контекстное окно на 1 миллион токенов. Это вдвое больше, чем у предыдущей версии Sonnet. В компании говорят, что такого объёма хватает, чтобы держать в одном запросе целые кодовые базы, длинные договоры или десятки научных работ.

Sonnet 4.6 получила контекст на 1 млн токенов и лучше держит логику

Увеличить окно контекста — половина дела. Вторая половина — не «утонуть» в этом тексте и не начать путать факты. Anthropic подчёркивает, что Sonnet 4.6 не просто «помнит» больше, но и лучше выстраивает логические цепочки на большом объёме входных данных.

Продолжение после рекламы

Если вы часто кормите модель репозиторием или пачкой документов, это звучит прагматично. Раньше приходилось резать контент на куски и следить, чтобы модель не потеряла нить. Теперь шанс на цельный разбор выше, хотя качество всё равно упирается в структуру исходных данных.

По отзывам тестеров Sonnet 4.6 чаще выбирают вместо 4.5

По данным Anthropic, разработчики в раннем доступе в 70% случаев предпочли Sonnet 4.6 версии 4.5. В отзывах чаще всего хвалят работу с кодовым контекстом и следование инструкциям.

  • меньше дублирования логики в сгенерированном коде;
  • более последовательное выполнение требований;
  • снижение «галлюцинаций» и ложных заявлений об успехе.

Последний пункт для практики важнее всего. Когда модель уверенно сообщает «готово», а по факту ничего не работает, вы теряете время на перепроверку. Если таких ситуаций стало меньше, это прямой прирост продуктивности.

Модель лучше работает с компьютером без специальных API

Отдельный акцент Anthropic делает на «работе с компьютером» без специализированных API. Модель взаимодействует с программами как человек: кликает мышью в виртуальной среде и вводит текст с клавиатуры.

В бенчмарке OSWorld, который имитирует задачи в Chrome, LibreOffice и VS Code, Sonnet 4.6 заметно прибавила относительно прошлых версий. Компания говорит, что в ряде сценариев, вроде сложных таблиц или многошаговых веб-форм, модель приближается к уровню человека. Но уточняет: опытным пользователям ИИ всё ещё уступает, а реальная работа сложнее лабораторных тестов.

В кодинге Sonnet 4.6 подтянули до уровня старших моделей

Изображение к статье: Anthropic обновила Claude: Sonnet 4.6 с контекстом на 1 млн токенов

Anthropic заявляет, что Sonnet 4.6 заметно улучшили для программирования. В профильных бенчмарках модель оказалась сильнее Gemini 3 Pro и почти сравнялась с Opus 4.5.

Бета-тестеры отдельно отмечают прирост в задачах фронтенда и финансового анализа. И это логично: там много контекста, правил и мелких ограничений. А ещё там легко «сломаться» на одном неверном допущении.

ARC-AGI-2: 60,4% при высоком «усилии мышления»

Anthropic также раскрыла результат Sonnet 4.6 в тесте ARC-AGI-2, который проверяет абстрактное рассуждение и обобщение. Модель набрала 60,4% при высоком уровне «усилия мышления».

Этот результат ставит Sonnet 4.6 выше многих сопоставимых моделей, но ниже Opus 4.6, Gemini 3 Deep Think и одной из улучшенных версий GPT 5.2. Для «среднего класса» Sonnet это выглядит как попытка закрыть разрыв со старшими решениями без скачка по цене.

Продолжение после рекламы

Что это значит для пользователей Claude и разработчиков

Для обычных пользователей самое приятное — Sonnet 4.6 стала стандартной моделью в Claude даже на бесплатном тарифе. То есть улучшения по контексту, коду и аккуратности ответов доступны без доплаты.

Для разработчиков важнее другое: большой контекст и снижение «галлюцинаций» делают модель удобнее как «вторые руки» в проектах. Особенно там, где нужно держать в голове много файлов, требований и зависимостей. Но магии не будет: плохие спецификации и грязный код модель не вылечит.

Доступность и цена через API

Sonnet 4.6 уже доступна в Claude, в приложении и через API для сторонних сервисов. Anthropic сохранила стоимость на уровне Sonnet 4.5: $3 за миллион входных токенов и $15 за миллион выходных. По курсу около 92 рубля за доллар это примерно 276 рублей и 1380 рублей соответственно.

Подробнее о линейке моделей и доступах компания пишет на своём сайте: Anthropic.

Что ждать дальше

Релиз Sonnet 4.6 вышел всего через две недели после запуска Opus 4.6. На этом фоне логично ждать обновления Haiku в ближайшие недели. Если темп сохранится, 2026 год для Claude пройдёт под знаком частых итераций, где «средний класс» догоняет флагманы по реальным задачам, а не по красивым демо.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.