Huawei Ascend 960 выходит раньше прежнего графика: компания сдвинула релиз Ascend 960DT на I квартал 2027 года, а Ascend 960PR — на III квартал 2027-го. Главная цифра анонса — 8 FP4 PFLOPS у Ascend 960PR для инференса, вдвое выше прошлых ожиданий Huawei.

Дорожную карту компания раскрыла на мероприятии Huawei Connect. Вместе с новыми ускорителями Huawei показала курс на годовой цикл поколений Ascend, рассказала о Peerium на базе UnifiedBus и подтвердила переход от старой SIMD-архитектуры к схеме SIMD + SIMT.

Ascend переходит на SIMD + SIMT

Ascend 950 стал первой платформой Huawei с новой архитектурой, где векторные вычисления SIMD дополнили потоковым параллелизмом SIMT. Простыми словами, чип должен лучше загружать вычислительные блоки в разных задачах ИИ: от ровных матричных операций до ветвистых нагрузок с разными путями выполнения.

Продолжение после рекламы

Huawei разделила линейку по сценариям. Ascend 950PR нацелен на prefill и рекомендательные системы. Ascend 950DT компания продвигает для decoding и обучения. По словам Huawei, системы Atlas 950 SuperPoD уже используют в крупных коммерческих проектах, но подробностей о заказчиках и конфигурациях компания не дала.

С поставками картина менее ровная. Huawei прямо признала, что производственных мощностей пока не хватает для внутреннего спроса. Для железа такого класса это не сноска мелким шрифтом, а ограничитель внедрения.

Изображение к статье: Huawei ускорила Ascend 960: FP4 у 960PR вырос вдвое
  • CPU: 2 048 Kunpeng 950
  • NPU: 8 192 Ascend 950DT
  • Стойки: 160 шкафов, включая 128 вычислительных и 32 коммуникационных
  • Производительность: 8 FP8 EFLOPS и 16 FP4 EFLOPS
  • Интерконнект: 16 ПБ/с суммарной пропускной способности

В июле 2026 года Huawei публично показала реализацию заметно скромнее: 256 CPU и 1 024 карты-ускорителя. Архитектура всё ещё масштабируется до 8 192 NPU, но такой вариант не фигурирует на сайте компании. Поэтому текущие коммерческие SuperPoD могут заметно отличаться от максимальной схемы.

Характеристики Ascend 960, 970 и 980

Ascend 960DT выйдет формально доступным в I квартале 2027 года, на три квартала раньше прежнего плана. Он получит 2 FP8 PFLOPS, 4 FP4 PFLOPS, 288 ГБ памяти, 9,6 ТБ/с пропускной способности памяти и интерконнект на 2,2 ТБ/с.

Ascend 960PR запланирован на III квартал 2027 года, на квартал раньше старого графика. Его FP8-производительность для обучения осталась на уровне 2 PFLOPS. А вот FP4 для инференса вырос до 8 PFLOPS. Такой скачок больше похож на переработку низкоточных вычислительных блоков, чем на простое повышение частот.

NPU Срок Архитектура FP8 FP4 Память Пропускная способность памяти Интерконнект
Ascend 910C I квартал 2025 SIMD — — 128 ГБ 3,2 ТБ/с 784 ГБ/с
Ascend 950PR I квартал 2026 SIMD + SIMT 1 PFLOPS 2 PFLOPS 128 ГБ HiBL 1.0 1,6 ТБ/с 2,0 ТБ/с
Ascend 950DT IV квартал 2026 SIMD + SIMT 1 PFLOPS 2 PFLOPS 144 ГБ HiZQ 2.0 4,0 ТБ/с 2,0 ТБ/с
Ascend 960DT I квартал 2027 SIMD + SIMT 2 PFLOPS 4 PFLOPS 288 ГБ 9,6 ТБ/с 2,2 ТБ/с
Ascend 960PR III квартал 2027 SIMD + SIMT 2 PFLOPS 8 PFLOPS 192 ГБ 2,4 ТБ/с 2,2 ТБ/с
Ascend 970 2028 SIMD + SIMT 3,6 PFLOPS 14 PFLOPS 288 ГБ 14,4 ТБ/с 4,4 ТБ/с
Ascend 980 2029 SIMD + SIMT 7,2 PFLOPS 28 PFLOPS 384 ГБ 38,4 ТБ/с 8,0 ТБ/с
Изображение к статье: Huawei ускорила Ascend 960: FP4 у 960PR вырос вдвое

Начиная с Ascend 960, Huawei добавляет поддержку HiF4 к уже заявленным FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8 и MXFP4. Для больших языковых моделей низкая точность давно стала рабочим инструментом, потому рост FP4 напрямую бьёт в стоимость и плотность инференса.

Сравнение с Nvidia VR200 показывает разный масштаб

Nvidia VR200, ожидаемая в IV квартале 2026 года, по заявленным цифрам остаётся сильно впереди одного Ascend 960PR. GPU Nvidia должен выдавать 35 NVFP4 PFLOPS для обучения и 50 NVFP4 PFLOPS для инференса, а также получить 288 ГБ HBM4.

Ускоритель Срок FP4 для обучения FP4 для инференса Память
Huawei Ascend 960PR III квартал 2027 не указано отдельно 8 PFLOPS 192 ГБ
Nvidia VR200 IV квартал 2026 35 NVFP4 PFLOPS 50 NVFP4 PFLOPS 288 ГБ HBM4

Но сравнение одного ускорителя не закрывает всю картину. Huawei делает ставку на вертикальную инфраструктуру: свои NPU, Kunpeng CPU, SuperPoD-кластеры, интерконнект и программный стек. Для покупателя таких систем важны не только PFLOPS на карточке, но и доступность стоек, софт под обучение, сеть между узлами и сроки поставки.

David Wang, заместитель председателя совета директоров и ротационный председатель Huawei, описал график так: «Мы развиваем серию Ascend с циклом одно поколение в год. В 2028 и 2029 годах мы выпустим Ascend 970 и 980 соответственно». Показатели Ascend 980 Huawei помечает как предварительные: 7,2 FP8 PFLOPS, 28 FP4 PFLOPS, 384 ГБ памяти, 38,4 ТБ/с по памяти и 8 ТБ/с интерконнекта.

Продолжение после рекламы

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.