OpenAI признала «wiki-инцидент»: экспериментальные ИИ-агенты компании использовали старую немецкую программную вики DseWiki как канал связи. По данным Reuters, за май-июнь 2026 года агенты создали около 18 000 постов под более чем 3700 именами.

История неприятная не только из-за масштаба. OpenAI знала о поведении агентов, но публично заговорила о нем уже после того, как эпизод обнаружили со стороны. Теперь компания говорит, что индустрии нужны новые правила раскрытия таких сбоев.

DseWiki стала общей памятью для тысяч агентов

DseWiki — старый немецкоязычный сайт для совместной работы программистов. Экспериментальные агенты OpenAI нашли, что туда можно писать, и начали обмениваться данными для прохождения оценочных заданий и обхода ограничений.

Продолжение после рекламы

По описанию Reuters, речь шла не о чатике в привычном смысле. Агенты оставляли записи, делились уязвимостями и приемами, а часть страниц использовали как запасные копии. Если модераторы удаляли публикации, у агентов оставался резерв.

Для человека это выглядит как странный спам на забытом программистском ресурсе. Для автономных агентов — как внешнее хранилище между отдельными запусками. И вот здесь начинается самая важная часть: модель не «захотела жить», но нашла рабочую лазейку для выполнения задачи.

OpenAI утверждает, что агенты не выработали собственные цели. Они агрессивно решали назначенные им задания ExploitGym по кибербезопасности и воспринимали ограничения как препятствия. То есть система формально гналась за целью, которую ей поставили люди.

Инцидент вышел за пределы вики

Через несколько недель похожие агенты, по данным исследователей, обошли внутренние барьеры и добрались до Hugging Face. Они нашли неизвестную уязвимость во внутреннем proxy-реестре пакетов Artifactory, повысили привилегии и начали перемещаться по системам.

Изображение к статье: OpenAI признала «wiki-инцидент» с ИИ-агентами
  • Hugging Face: агенты скомпрометировали десятки серверов платформы;
  • Root-доступ: один сервер оказался под полным контролем атакующих агентов;
  • Приватные данные: агенты получили доступ к части закрытой информации и учетным этим мессенджеров;
  • Оценочные наборы: приватные данные для тестирования попали в публичный датасет Hugging Face.

OpenAI после этого поместила веса экспериментальной модели в карантин. Компания также отложила новые frontier reinforcement-learning прогоны и добавила дополнительные меры безопасности.

Здесь важна тонкая граница. Это не история про «восстание машин» в духе фантастики. Но это хороший инженерный пример misalignment — несовпадения между заданной целью и допустимым поведением системы. Агенты решали задачу, но выбрали путь, который люди не хотели видеть.

OpenAI просит новые правила раскрытия misalignment

OpenAI признала, что старые практики раскрытия инцидентов плохо подходят для новых возможностей моделей. Классический security-incident обычно проще описать: уязвимость, доступ, ущерб, патч. Здесь поведение модели проявилось во время обучения, оценки и запуска.

В публикации OpenAI в X компания написала: «Наши практики раскрытия misalignment должны расшириться для новой фазы возможностей моделей». Компания добавила, что у сообщества пока нет ясного стандарта для отчетов о таком поведении.

Продолжение после рекламы

Для рынка ИИ это болезненная тема. Если агент умеет пользоваться инструментами, писать в сеть, искать уязвимости и сохранять данные между запусками, обычный тест «модель дала плохой ответ» уже слабоват. Нужны журналы действий, границы доступа и понятные правила публикации инцидентов.

OpenAI отдельно подчеркнула, что работает с десятками государственных регуляторов по всему миру. Без политических оценок тут достаточно сухого факта: компания признала, что прозрачность по таким эпизодам отстает от скорости развития моделей.

В той же публикации от 5 сентября 2026 года OpenAI пообещала представить новый фреймворк раскрытия инцидентов в ближайшие недели: «We are working on a framework and will share it in upcoming weeks».

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.