Содержание
У OpenAI снова кадровая потеря в блоке безопасности: руководитель направления этики Chloé Bakalar покинула компанию менее чем через год после прихода. Для пользователей ChatGPT это не повод удалять приложение, но хороший повод смотреть на новые модели внимательнее.
О ее уходе сообщила Financial Times. По данным издания, Bakalar была главой этики OpenAI и, предположительно, единственным специалистом в компании с такой отдельной ролью. Это не рядовая HR-новость, потому что уход наложился на другие перестановки в командах, которые отвечали за риски, alignment и безопасное поведение моделей.
В одиночку такой эпизод легко списать на обычную текучку. Быстрые AI-компании живут в режиме постоянной перестройки. Но когда за несколько недель уходят сразу несколько людей из безопасности, вопрос становится практическим: кто внутри OpenAI может притормозить модель, если ее возможности вышли за разумные рамки?
Известные уходы в командах безопасности OpenAI
За последние месяцы OpenAI потеряла несколько руководителей, связанных с безопасностью и согласованием моделей. Johannes Heidecke, который возглавлял команду Safety Systems, объявил об уходе в июле. Wired также писала об уходе Josh Achiam, бывшего главы Mission Alignment и позднее главного футуриста OpenAI.
- Chloé Bakalar: глава этики OpenAI, ушла менее чем через год после прихода
- Johannes Heidecke: руководил Safety Systems, объявил об уходе в июле
- Josh Achiam: ранее вел Mission Alignment, затем получил роль chief futurist
- Mission Alignment: отдельную команду распустили ранее в 2026 году
До этого OpenAI уже пережила похожий момент. В 2024 году компанию покинул сооснователь и главный ученый Ilya Sutskever. Он играл ключевую роль в проекте Superalignment. Вскоре ушел Jan Leike, который вместе с ним вел это направление, и публично критиковал подход OpenAI к безопасности.
После этого Superalignment перестала работать как самостоятельная команда. OpenAI распределила ее задачи по другим подразделениям. Теперь похожую логику компания применяет шире: безопасность двигают ближе к исследователям и инженерам, которые строят модели.
OpenAI меняет подход к безопасности моделей
Новая схема OpenAI звучит рационально: специалисты по рискам работают рядом с теми, кто обучает модели, а не приходят в конце разработки с красной ручкой. Так проблемы можно найти раньше, пока архитектура, датасеты и ограничения еще реально поменять.
Но у такого подхода есть обратная сторона. Независимая команда безопасности играет роль тормоза. Не в плохом смысле, а как ABS в машине: она мешает системе улететь, когда все давят на газ. Если safety-роль растворяется внутри продуктовых и исследовательских команд, власть сказать «нет» становится менее очевидной.
Для обычного пользователя это звучит абстрактно, пока ChatGPT просто пишет письма, код и планы поездок. Но современные модели уже умеют больше, чем отвечать в окне чата. AI-агенты получают доступ к сайтам, файлам, инструментам разработки и средам выполнения кода. Чем меньше человек контролирует каждый шаг, тем дороже ошибка в правилах доступа.
Astra показала риск на примере кибербезопасности
OpenAI уже столкнулась с таким сценарием на модели Astra, которую компания не выпускала публично. Ее возможности в кибербезопасности оказались достаточно сильными, чтобы OpenAI ввела дополнительные меры предосторожности и усилила изоляцию части тестов.
По данным The Hacker News, OpenAI не исключала, что Astra может приблизиться к максимальному уровню обеспокоенности по киберспособностям. Компания перенесла часть проверок в более изолированные среды и начала обсуждать более жесткий доступ к самым мощным функциям модели.
Это тот самый момент, где этика перестает быть красивым словом из презентации. Если модель умеет искать уязвимости, писать рабочий код и действовать почти автономно, политика доступа становится технической частью продукта. Ее нельзя прикрутить после релиза, как темную тему интерфейса.
Мы не знаем, почему конкретно Bakalar, Heidecke и Achiam ушли. Люди меняют работу по десяткам причин, и честно не связывать эти решения без доказательств. Но организационная картина заметна: Superalignment исчезла как отдельная структура, Mission Alignment распустили, Safety Systems перестраивали, а несколько старших специалистов по рискам покинули компанию.
Для пользователей ChatGPT главный вопрос теперь не в наличии таблички «safety team» на внутренней оргструктуре. Вопрос в полномочиях людей, которые видят риск до релиза. По данным Financial Times, Chloé Bakalar проработала в OpenAI менее года перед уходом из компании.