GPT-6 Astra стала первой моделью OpenAI, которая дошла до критического уровня по внутренней шкале готовности компании. Причина звучит серьёзно: модель умеет проводить сложные кибератаки от начала до конца.

OpenAI анонсировала Astra 3 сентября 2026 года. Пока доступ открыт только участникам программы Daybreak, где модель проверяют специалисты по кибербезопасности. В ближайшие дни компания откроет её для платных подписчиков ChatGPT и через OpenAI API.

Контекст здесь нервный. Astra выходит через несколько дней после Claude Fable 5.1 и Mythos 5.1 от Anthropic. Глава OpenAI Грег Брокман назвал релиз «скачком» и заявил, что модель «может делать с компьютером всё, что может человек». Его слова приводит NBC News.

Продолжение после рекламы

Astra получила критический уровень из-за кибернавыков

OpenAI относит Astra к критическому уровню preparedness framework из-за способности работать с «укреплёнными целями». По описанию компании, модель может самостоятельно проводить end-to-end атаки, а не просто помогать человеку с отдельными шагами.

Для обычного пользователя это звучит как очередная гонка нейросетей. Для инженеров безопасности — совсем другой разговор. Если модель сама ищет уязвимость, пишет код, тестирует эксплойт и доводит атаку до результата, цена ошибки резко растёт.

OpenAI уже останавливала работу над Astra, чтобы усилить защитные механизмы. В начале недели компания написала, что новая модель чаще соблюдает явные ограничения и предупреждения, чем GPT-5.6 Sol. Именно Sol фигурировала в известной атаке на Hugging Face, из-за которой к безопасности рассуждающих моделей возникло больше вопросов. Позицию OpenAI можно прочитать в её публикации о пути к Astra.

  • Текущий доступ: программа OpenAI Daybreak для специалистов по кибербезопасности
  • Ближайший релиз: подписки Pro, Plus, Enterprise и Business
  • API: модель появится для разработчиков через OpenAI API
  • Главный риск: самостоятельные атаки на защищённые цели

Opaque recurrence мешает читать ход рассуждений

Изображение к статье: OpenAI готовит GPT-6 Astra: модель встревожила AI-экспертов

Больше всего исследователей напрягла не сама мощность Astra, а техника рассуждения recurrent depth, или opaque recurrence. По описанию TechCrunch, она делает цепочку рассуждений модели заметно менее читаемой для внешнего наблюдения.

Тут нужна короткая расшифровка без академического тумана. У современных reasoning-моделей разработчики часто смотрят на chain of thought — промежуточные рассуждения. Такой мониторинг помогает понять, когда модель планирует запрещённое действие, скрывает намерение или уходит в опасную стратегию.

Если модель решает сложную задачу внутри повторяющихся вычислительных циклов, а не проговаривает шаги языком, людям сложнее её контролировать. TechCrunch отдельно описал эту проблему в материале о новой технике OpenAI и реакции специалистов: разбор вышел 2 сентября.

Бывший руководитель направления безопасности OpenAI Стивен Адлер написал в X: «Если это правда, OpenAI, похоже, нарушает одну из немногих красных линий, которые есть в AI-сообществе». Глава Redwood Research Бак Шлегерис добавил, что не знает, насколько Astra хуже прежних моделей по мониторингу chain of thought. Но он предупредил: дальнейшее усиление recurrence может «полностью уничтожить» наблюдаемость CoT.

OpenAI спорит с критиками, но риск остаётся

Главный научный сотрудник OpenAI Якуб Пахоцкий ответил, что компания с первых reasoning-моделей сохраняла и использовала мониторинг chain of thought. По его словам, этот метод даёт взгляд на то, как выравнивание модели работает за пределами обучающей выборки.

Бывший исследователь OpenAI Дэниел Кокотайло возразил ему в X. Даже если OpenAI не станет дальше развивать recurrent depth в опасную сторону, это могут сделать другие лаборатории. Для индустрии это неприятный сценарий: техника уже появилась, а барьер сдерживания держится на выборе отдельных компаний.

Продолжение после рекламы

Позже Пахоцкий уточнил другой важный момент. По его версии, новые frontier-модели труднее мониторить не только из-за recurrent depth. Более способные системы решают сложные задачи с меньшим числом языковых токенов. Иногда им почти не нужно проговаривать ход мысли текстом.

В сухом остатке Astra выглядит как модель, вокруг которой спорят две школы. Одна говорит: без читаемой цепочки рассуждений нельзя безопасно выпускать систему с такими кибернавыками. Другая отвечает: способность модели думать компактнее сама по себе снижает видимость, и эту проблему нельзя свести к одному приёму.

Широкий релиз GPT-6 Astra заявлен на ближайшие дни после анонса 3 сентября 2026 года: OpenAI откроет доступ подписчикам Pro, Plus, Enterprise, Business и пользователям OpenAI API.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.