Содержание
Microsoft Azure получит стоечные ИИ-ускорители AMD Helios «в масштабе»: в облаке появятся системы с Radeon Instinct MI455X и серверными процессорами Epyc Venice.
Сделка выглядит как крупная победа AMD в дата-центрах. Но есть важная оговорка: Microsoft и AMD не назвали объём закупки. Нет ни суммы контракта, ни мощности в ваттах, ни числа стоек.
AMD Helios придёт в Azure для обучения и инференса
Microsoft планирует использовать Helios в собственных дата-центрах и продавать доступ клиентам Azure. Речь идёт о задачах обучения больших моделей, инференса и managed compute для корпоративных ИИ-сценариев через Microsoft Foundry.
Для Azure это не косметическое обновление каталога виртуальных машин. Спрос на ИИ-вычисления растёт быстрее, чем облака успевают строить новые кластеры. Открытые модели frontier-класса вроде Kimi K3 дополнительно давят на рынок: их можно дообучать и обслуживать на собственной инфраструктуре или в облаке.
AMD здесь заходит в самый дорогой сегмент. Компания уже заключала крупные ИИ-сделки с OpenAI и Meta. В таких проектах счёт идёт не на отдельные серверы, а на гигаватты вычислительной мощности и многолетние обязательства.
Характеристики AMD Helios и сравнение с Nvidia Vera Rubin
AMD Helios — это rack-scale система, где вся стойка работает как единый ускоритель для больших ИИ-моделей. В одной конфигурации AMD объединяет 72 Instinct MI455X с общей памятью 31,1 ТБ HBM4.
По вычислениям AMD заявляет до 1,4 экзафлопс в FP8 и до 2,9 экзафлопс в FP4. Эти форматы используют в ИИ-нагрузках, где важна не классическая точность FP32, а плотность матричных операций и пропускная способность памяти.
Главный конкурент здесь — Nvidia Vera Rubin NVL72. Это тоже стоечная система для больших моделей. На бумаге Helios особенно агрессивно смотрится по scale-out каналу, то есть связи между стойками.
| Параметр | AMD Helios | Nvidia Vera Rubin NVL72 |
|---|---|---|
| GPU в стойке | 72 Instinct MI455X | 72 ускорителя в NVL72 |
| Память | 31,1 ТБ HBM4 | не раскрыто в этих данных |
| FP8 | до 1,4 экзафлопс | не раскрыто в этих данных |
| FP4 | до 2,9 экзафлопс | не раскрыто в этих данных |
| Scale-up внутри стойки | 260 ТБ/с | на сопоставимом уровне |
| Scale-out между стойками | 43 ТБ/с через UALink over Ethernet | примерно вдвое ниже по оценке AMD |
Цифры красивые, но один пункт пока требует осторожности. AMD делает ставку на UALink over Ethernet для связи между стойками. Как эта схема поведёт себя в реальных кластерах Azure, покажут только рабочие нагрузки клиентов.
Для обычного покупателя видеокарт это может звучать далёко. Но такие системы влияют на всё ИИ-железо. Чем больше AMD продаёт ускорителей в облака, тем сильнее давление на Nvidia по ценам, поставкам и экосистеме.
Azure получит новые VM на Epyc Venice
Вместе с Helios Microsoft добавит две серии виртуальных машин на AMD Epyc Venice. Это шестое поколение серверных процессоров Epyc, которое AMD готовит для тяжёлых дата-центровых задач.
- HDv2: серия для agentic AI и дата-пайплайнов
- HXv2: серия для задач проектирования полупроводников
- Azure Boost: Microsoft интегрирует AMD Pensando DPU для ускорения сети и хранилища
Здесь логика понятная. GPU считают матрицы, но вокруг них живёт вся инфраструктура: CPU, сеть, хранилище, изоляция клиентов. Если узкое место сидит в передаче данных, дорогая стойка с HBM4 простаивает.
Pensando DPU Microsoft уже использует в Azure. Теперь эти ускорители плотнее войдут в Azure Boost. Они снимают часть сетевых и storage-задач с центральных процессоров, чтобы CPU меньше тратили ресурсы на обвязку.
Microsoft и AMD не раскрыли размер развёртывания Helios в Azure. Компании не назвали ни бюджет контракта, ни число стоек, ни суммарное энергопотребление установки.