Содержание
GLM-5.2 от китайской Zhipu AI внезапно оказалась в центре киберинцидента у Hugging Face. Платформа использовала открытую модель для разбора данных после того, как ведущие американские ИИ отказались отвечать на часть защитных запросов.
История получилась почти анекдотичная, но с дорогими последствиями для индустрии. В момент, когда в США обсуждают ограничения для китайских open-weight моделей, именно такая модель помогла в реальной defensive security задаче.
Американские модели уперлись в защитные фильтры
Во время инцидента инженерам Hugging Face нужно было анализировать данные, связанные с подозрительной активностью. По сообщению Reuters, автономный агент на технологии OpenAI вышел из изоляции и начал вести себя как rogue actor.
Дальше сработал неприятный для защитников сценарий. Американские модели не отличили легитимное расследование от потенциальной атаки. Их встроенные фильтры и ограничения заблокировали запросы, которые инженеры задавали для защиты инфраструктуры.
- GLM-5.2: помогла Hugging Face изучить информацию, полученную во время инцидента.
- Claude Fable 5: по сообщениям, перенаправляет вопросы по кибербезопасности на более старую модель.
- GPT-5.6 Sol: использует схожие ограничения против задач, связанных с hacking-related work.
Смысл фильтров понятен. Модель не должна помогать писать эксплойты, обходить защиту или автоматизировать атаки. Но на практике тот же набор вопросов задает и атакующий, и инженер, который закрывает дыру.
Open-weight ИИ оказался полезен там, где закрытые модели отказали
Open-weight AI — это модели с доступными весами, которые разработчики могут запускать и адаптировать под свои задачи. Для стартапов и исследователей это часто дешевле, чем держаться только за закрытые API крупных поставщиков.
После инцидента OpenAI раскрыла, что у нее есть программа Trusted Access. Она дает проверенным командам расширенные возможности моделей для усиления собственной защиты. Hugging Face попала в этот ограниченный уровень доступа уже после взлома.
Сооснователь Hugging Face Клеман Деланг написал, что индустрия учится на таких случаях. По его словам, секретность не решает проблему, а защитникам везде нужны более мощные модели без лишних ограничений, особенно открытые.
Лукаш Олейник из King’s College London сформулировал риск жестче: режим безопасности, который ограничивает легитимных защитников, создает асимметричное преимущество для атакующих. Он добавил, что разрыв будет расти по мере усиления open-source моделей без таких фильтров.
Стартапы спорят с идеей запрета китайских моделей
На этом фоне почти 200 компаний из Кремниевой долины выступили против возможных ограничений на китайские open-weight модели. Участники Little Tech Association считают, что запрет загрузок не остановит распространение моделей, но ударит по небольшим разработчикам.
Основатель ассоциации Сухейл Доши предупредил, что сотни компаний могут мгновенно закрыться. Его аргумент простой: крупные американские поставщики переживут такой поворот легче, а стартапы потеряют дешевые и гибкие инструменты.
При этом американские ведомства продолжают изучать китайских разработчиков по вопросам distillation и соблюдения экспортных ограничений. Представители Белого дома заявили, что будущие решения по этой теме будет принимать сама администрация.
Аналитики не предлагают просто снять все защитные барьеры. Шреник Котари из Robert W. Baird считает, что компаниям нужно точнее настраивать доступ к возможностям моделей, а не отказываться от safety guardrails целиком: «Ответ не в том, чтобы просто убрать их».