Содержание
Huawei Ascend 960 выходит раньше прежнего графика: компания сдвинула релиз Ascend 960DT на I квартал 2027 года, а Ascend 960PR — на III квартал 2027-го. Главная цифра анонса — 8 FP4 PFLOPS у Ascend 960PR для инференса, вдвое выше прошлых ожиданий Huawei.
Дорожную карту компания раскрыла на мероприятии Huawei Connect. Вместе с новыми ускорителями Huawei показала курс на годовой цикл поколений Ascend, рассказала о Peerium на базе UnifiedBus и подтвердила переход от старой SIMD-архитектуры к схеме SIMD + SIMT.
Ascend переходит на SIMD + SIMT
Ascend 950 стал первой платформой Huawei с новой архитектурой, где векторные вычисления SIMD дополнили потоковым параллелизмом SIMT. Простыми словами, чип должен лучше загружать вычислительные блоки в разных задачах ИИ: от ровных матричных операций до ветвистых нагрузок с разными путями выполнения.
Huawei разделила линейку по сценариям. Ascend 950PR нацелен на prefill и рекомендательные системы. Ascend 950DT компания продвигает для decoding и обучения. По словам Huawei, системы Atlas 950 SuperPoD уже используют в крупных коммерческих проектах, но подробностей о заказчиках и конфигурациях компания не дала.
С поставками картина менее ровная. Huawei прямо признала, что производственных мощностей пока не хватает для внутреннего спроса. Для железа такого класса это не сноска мелким шрифтом, а ограничитель внедрения.
- CPU: 2 048 Kunpeng 950
- NPU: 8 192 Ascend 950DT
- Стойки: 160 шкафов, включая 128 вычислительных и 32 коммуникационных
- Производительность: 8 FP8 EFLOPS и 16 FP4 EFLOPS
- Интерконнект: 16 ПБ/с суммарной пропускной способности
В июле 2026 года Huawei публично показала реализацию заметно скромнее: 256 CPU и 1 024 карты-ускорителя. Архитектура всё ещё масштабируется до 8 192 NPU, но такой вариант не фигурирует на сайте компании. Поэтому текущие коммерческие SuperPoD могут заметно отличаться от максимальной схемы.
Характеристики Ascend 960, 970 и 980
Ascend 960DT выйдет формально доступным в I квартале 2027 года, на три квартала раньше прежнего плана. Он получит 2 FP8 PFLOPS, 4 FP4 PFLOPS, 288 ГБ памяти, 9,6 ТБ/с пропускной способности памяти и интерконнект на 2,2 ТБ/с.
Ascend 960PR запланирован на III квартал 2027 года, на квартал раньше старого графика. Его FP8-производительность для обучения осталась на уровне 2 PFLOPS. А вот FP4 для инференса вырос до 8 PFLOPS. Такой скачок больше похож на переработку низкоточных вычислительных блоков, чем на простое повышение частот.
| NPU | Срок | Архитектура | FP8 | FP4 | Память | Пропускная способность памяти | Интерконнект |
|---|---|---|---|---|---|---|---|
| Ascend 910C | I квартал 2025 | SIMD | — | — | 128 ГБ | 3,2 ТБ/с | 784 ГБ/с |
| Ascend 950PR | I квартал 2026 | SIMD + SIMT | 1 PFLOPS | 2 PFLOPS | 128 ГБ HiBL 1.0 | 1,6 ТБ/с | 2,0 ТБ/с |
| Ascend 950DT | IV квартал 2026 | SIMD + SIMT | 1 PFLOPS | 2 PFLOPS | 144 ГБ HiZQ 2.0 | 4,0 ТБ/с | 2,0 ТБ/с |
| Ascend 960DT | I квартал 2027 | SIMD + SIMT | 2 PFLOPS | 4 PFLOPS | 288 ГБ | 9,6 ТБ/с | 2,2 ТБ/с |
| Ascend 960PR | III квартал 2027 | SIMD + SIMT | 2 PFLOPS | 8 PFLOPS | 192 ГБ | 2,4 ТБ/с | 2,2 ТБ/с |
| Ascend 970 | 2028 | SIMD + SIMT | 3,6 PFLOPS | 14 PFLOPS | 288 ГБ | 14,4 ТБ/с | 4,4 ТБ/с |
| Ascend 980 | 2029 | SIMD + SIMT | 7,2 PFLOPS | 28 PFLOPS | 384 ГБ | 38,4 ТБ/с | 8,0 ТБ/с |

Начиная с Ascend 960, Huawei добавляет поддержку HiF4 к уже заявленным FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8 и MXFP4. Для больших языковых моделей низкая точность давно стала рабочим инструментом, потому рост FP4 напрямую бьёт в стоимость и плотность инференса.
Сравнение с Nvidia VR200 показывает разный масштаб
Nvidia VR200, ожидаемая в IV квартале 2026 года, по заявленным цифрам остаётся сильно впереди одного Ascend 960PR. GPU Nvidia должен выдавать 35 NVFP4 PFLOPS для обучения и 50 NVFP4 PFLOPS для инференса, а также получить 288 ГБ HBM4.
| Ускоритель | Срок | FP4 для обучения | FP4 для инференса | Память |
|---|---|---|---|---|
| Huawei Ascend 960PR | III квартал 2027 | не указано отдельно | 8 PFLOPS | 192 ГБ |
| Nvidia VR200 | IV квартал 2026 | 35 NVFP4 PFLOPS | 50 NVFP4 PFLOPS | 288 ГБ HBM4 |
Но сравнение одного ускорителя не закрывает всю картину. Huawei делает ставку на вертикальную инфраструктуру: свои NPU, Kunpeng CPU, SuperPoD-кластеры, интерконнект и программный стек. Для покупателя таких систем важны не только PFLOPS на карточке, но и доступность стоек, софт под обучение, сеть между узлами и сроки поставки.
David Wang, заместитель председателя совета директоров и ротационный председатель Huawei, описал график так: «Мы развиваем серию Ascend с циклом одно поколение в год. В 2028 и 2029 годах мы выпустим Ascend 970 и 980 соответственно». Показатели Ascend 980 Huawei помечает как предварительные: 7,2 FP8 PFLOPS, 28 FP4 PFLOPS, 384 ГБ памяти, 38,4 ТБ/с по памяти и 8 ТБ/с интерконнекта.