Содержание
GPT-6 Astra стала первой моделью OpenAI, которая дошла до критического уровня по внутренней шкале готовности компании. Причина звучит серьёзно: модель умеет проводить сложные кибератаки от начала до конца.
OpenAI анонсировала Astra 3 сентября 2026 года. Пока доступ открыт только участникам программы Daybreak, где модель проверяют специалисты по кибербезопасности. В ближайшие дни компания откроет её для платных подписчиков ChatGPT и через OpenAI API.
Контекст здесь нервный. Astra выходит через несколько дней после Claude Fable 5.1 и Mythos 5.1 от Anthropic. Глава OpenAI Грег Брокман назвал релиз «скачком» и заявил, что модель «может делать с компьютером всё, что может человек». Его слова приводит NBC News.
Astra получила критический уровень из-за кибернавыков
OpenAI относит Astra к критическому уровню preparedness framework из-за способности работать с «укреплёнными целями». По описанию компании, модель может самостоятельно проводить end-to-end атаки, а не просто помогать человеку с отдельными шагами.
Для обычного пользователя это звучит как очередная гонка нейросетей. Для инженеров безопасности — совсем другой разговор. Если модель сама ищет уязвимость, пишет код, тестирует эксплойт и доводит атаку до результата, цена ошибки резко растёт.
OpenAI уже останавливала работу над Astra, чтобы усилить защитные механизмы. В начале недели компания написала, что новая модель чаще соблюдает явные ограничения и предупреждения, чем GPT-5.6 Sol. Именно Sol фигурировала в известной атаке на Hugging Face, из-за которой к безопасности рассуждающих моделей возникло больше вопросов. Позицию OpenAI можно прочитать в её публикации о пути к Astra.
- Текущий доступ: программа OpenAI Daybreak для специалистов по кибербезопасности
- Ближайший релиз: подписки Pro, Plus, Enterprise и Business
- API: модель появится для разработчиков через OpenAI API
- Главный риск: самостоятельные атаки на защищённые цели
Opaque recurrence мешает читать ход рассуждений

Больше всего исследователей напрягла не сама мощность Astra, а техника рассуждения recurrent depth, или opaque recurrence. По описанию TechCrunch, она делает цепочку рассуждений модели заметно менее читаемой для внешнего наблюдения.
Тут нужна короткая расшифровка без академического тумана. У современных reasoning-моделей разработчики часто смотрят на chain of thought — промежуточные рассуждения. Такой мониторинг помогает понять, когда модель планирует запрещённое действие, скрывает намерение или уходит в опасную стратегию.
Если модель решает сложную задачу внутри повторяющихся вычислительных циклов, а не проговаривает шаги языком, людям сложнее её контролировать. TechCrunch отдельно описал эту проблему в материале о новой технике OpenAI и реакции специалистов: разбор вышел 2 сентября.
Бывший руководитель направления безопасности OpenAI Стивен Адлер написал в X: «Если это правда, OpenAI, похоже, нарушает одну из немногих красных линий, которые есть в AI-сообществе». Глава Redwood Research Бак Шлегерис добавил, что не знает, насколько Astra хуже прежних моделей по мониторингу chain of thought. Но он предупредил: дальнейшее усиление recurrence может «полностью уничтожить» наблюдаемость CoT.
OpenAI спорит с критиками, но риск остаётся
Главный научный сотрудник OpenAI Якуб Пахоцкий ответил, что компания с первых reasoning-моделей сохраняла и использовала мониторинг chain of thought. По его словам, этот метод даёт взгляд на то, как выравнивание модели работает за пределами обучающей выборки.
Бывший исследователь OpenAI Дэниел Кокотайло возразил ему в X. Даже если OpenAI не станет дальше развивать recurrent depth в опасную сторону, это могут сделать другие лаборатории. Для индустрии это неприятный сценарий: техника уже появилась, а барьер сдерживания держится на выборе отдельных компаний.
Позже Пахоцкий уточнил другой важный момент. По его версии, новые frontier-модели труднее мониторить не только из-за recurrent depth. Более способные системы решают сложные задачи с меньшим числом языковых токенов. Иногда им почти не нужно проговаривать ход мысли текстом.
В сухом остатке Astra выглядит как модель, вокруг которой спорят две школы. Одна говорит: без читаемой цепочки рассуждений нельзя безопасно выпускать систему с такими кибернавыками. Другая отвечает: способность модели думать компактнее сама по себе снижает видимость, и эту проблему нельзя свести к одному приёму.
Широкий релиз GPT-6 Astra заявлен на ближайшие дни после анонса 3 сентября 2026 года: OpenAI откроет доступ подписчикам Pro, Plus, Enterprise, Business и пользователям OpenAI API.