Microsoft Azure получит стоечные ИИ-ускорители AMD Helios «в масштабе»: в облаке появятся системы с Radeon Instinct MI455X и серверными процессорами Epyc Venice.

Сделка выглядит как крупная победа AMD в дата-центрах. Но есть важная оговорка: Microsoft и AMD не назвали объём закупки. Нет ни суммы контракта, ни мощности в ваттах, ни числа стоек.

AMD Helios придёт в Azure для обучения и инференса

Microsoft планирует использовать Helios в собственных дата-центрах и продавать доступ клиентам Azure. Речь идёт о задачах обучения больших моделей, инференса и managed compute для корпоративных ИИ-сценариев через Microsoft Foundry.

Продолжение после рекламы

Для Azure это не косметическое обновление каталога виртуальных машин. Спрос на ИИ-вычисления растёт быстрее, чем облака успевают строить новые кластеры. Открытые модели frontier-класса вроде Kimi K3 дополнительно давят на рынок: их можно дообучать и обслуживать на собственной инфраструктуре или в облаке.

AMD здесь заходит в самый дорогой сегмент. Компания уже заключала крупные ИИ-сделки с OpenAI и Meta. В таких проектах счёт идёт не на отдельные серверы, а на гигаватты вычислительной мощности и многолетние обязательства.

Характеристики AMD Helios и сравнение с Nvidia Vera Rubin

AMD Helios — это rack-scale система, где вся стойка работает как единый ускоритель для больших ИИ-моделей. В одной конфигурации AMD объединяет 72 Instinct MI455X с общей памятью 31,1 ТБ HBM4.

По вычислениям AMD заявляет до 1,4 экзафлопс в FP8 и до 2,9 экзафлопс в FP4. Эти форматы используют в ИИ-нагрузках, где важна не классическая точность FP32, а плотность матричных операций и пропускная способность памяти.

Изображение к статье: Microsoft добавит AMD Helios в Azure для ИИ-нагрузок

Главный конкурент здесь — Nvidia Vera Rubin NVL72. Это тоже стоечная система для больших моделей. На бумаге Helios особенно агрессивно смотрится по scale-out каналу, то есть связи между стойками.

Параметр AMD Helios Nvidia Vera Rubin NVL72
GPU в стойке 72 Instinct MI455X 72 ускорителя в NVL72
Память 31,1 ТБ HBM4 не раскрыто в этих данных
FP8 до 1,4 экзафлопс не раскрыто в этих данных
FP4 до 2,9 экзафлопс не раскрыто в этих данных
Scale-up внутри стойки 260 ТБ/с на сопоставимом уровне
Scale-out между стойками 43 ТБ/с через UALink over Ethernet примерно вдвое ниже по оценке AMD

Цифры красивые, но один пункт пока требует осторожности. AMD делает ставку на UALink over Ethernet для связи между стойками. Как эта схема поведёт себя в реальных кластерах Azure, покажут только рабочие нагрузки клиентов.

Для обычного покупателя видеокарт это может звучать далёко. Но такие системы влияют на всё ИИ-железо. Чем больше AMD продаёт ускорителей в облака, тем сильнее давление на Nvidia по ценам, поставкам и экосистеме.

Azure получит новые VM на Epyc Venice

Вместе с Helios Microsoft добавит две серии виртуальных машин на AMD Epyc Venice. Это шестое поколение серверных процессоров Epyc, которое AMD готовит для тяжёлых дата-центровых задач.

  • HDv2: серия для agentic AI и дата-пайплайнов
  • HXv2: серия для задач проектирования полупроводников
  • Azure Boost: Microsoft интегрирует AMD Pensando DPU для ускорения сети и хранилища

Здесь логика понятная. GPU считают матрицы, но вокруг них живёт вся инфраструктура: CPU, сеть, хранилище, изоляция клиентов. Если узкое место сидит в передаче данных, дорогая стойка с HBM4 простаивает.

Продолжение после рекламы

Pensando DPU Microsoft уже использует в Azure. Теперь эти ускорители плотнее войдут в Azure Boost. Они снимают часть сетевых и storage-задач с центральных процессоров, чтобы CPU меньше тратили ресурсы на обвязку.

Microsoft и AMD не раскрыли размер развёртывания Helios в Azure. Компании не назвали ни бюджет контракта, ни число стоек, ни суммарное энергопотребление установки.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.