Содержание
LineShine занял первое место в 67-м списке TOP500 с результатом 2,198 экзафлопса в High Performance Linpack. Китайская система обошла американский El Capitan более чем на 20% и сделала это без единого GPU или ускорителя.
Машину установили в Национальном суперкомпьютерном центре в Шэньчжэне. Построил ее Shenzhen Cloud Computing Center. Для Китая это первый лидер TOP500 с 2017 года, когда список возглавлял Sunway TaihuLight.
Главная интрига здесь не только в первом месте. LineShine стал первой системой в TOP500, которая пробила планку двух экзафлопсов FP64 только на CPU. Для рейтинга, где верхние позиции давно держат гибридные машины с GPU и APU, это редкий поворот.
LineShine взял FP64 за счет миллионов CPU-ядер
LineShine построили на платформе LingKun с десятками тысяч узлов, процессорами LX2 на Armv9 и быстрой HBM-памятью прямо в корпусе CPU. Такая схема ближе к японскому Fugaku с Fujitsu A64FX, чем к обычному серверу x86 с отдельными ускорителями.
В карточке результата фигурируют 13 789 440 ядер отечественной разработки. При этом описание платформы LingKun говорит о 20 480 вычислительных узлах, где каждый узел несет два процессора LX2.
- Процессор: LX2 на Armv9
- Ядра на CPU: 304 ядра
- Частота: 1,55 ГГц
- Организация: 8 кластеров по 38 ядер
- Векторные блоки: Arm SVE и SME
- Форматы вычислений: FP64, FP32, BF16, FP16 и INT8
Каждый LX2 получил 32 ГБ HBM на подложке. Пропускная способность памяти доходит до 4 ТБ/с. К процессору можно добавить до 256 ГБ DDR5 вне корпуса.
Узлы связали фирменной сетью LingQi. Система работает под управлением Kylin OS. Это редкий случай, когда стек закрыли почти целиком: CPU, интерконнект и операционная система идут из одной технологической экосистемы.
Разработчика LX2 официально не назвали. Jon Peddie Research связывает чип с Huawei, а пилотная фаза проекта, по данным отраслевых публикаций, работала на серверах Huawei Kunpeng. Техпроцесс и фабрику тоже не раскрыли. В качестве возможного варианта называют 7-нм класс SMIC, но документации по этому чипу пока нет.
В AI-бенчмарке CPU-гигант уже не лидер
TOP500 ранжирует системы по FP64 Linpack, и именно здесь широкий CPU с HBM может ударить максимально сильно. Но в смешанной точности, где живут современные AI-нагрузки, GPU и APU быстро уходят вперед.
На HPCG, который сильнее нагружает память и обмен между узлами, LineShine тоже занял первое место. Его результат — 22,00 петафлопса. Этот тест обычно ближе к реальному научному коду, чем классический Linpack.
А вот HPL-MxP показал границу подхода. LineShine набрал 7,92 экзафлопса и занял только четвертое место. Прирост к FP64 составил 3,6 раза. Для CPU-only машины это прилично, но ускорители играют в другой лиге.
| Система | HPL FP64 | HPL-MxP | Комментарий |
|---|---|---|---|
| LineShine | 2,198 экзафлопса | 7,92 экзафлопса | CPU-only, без GPU |
| El Capitan | 1,809 экзафлопса | 16,7 экзафлопса | AMD, ускоренная архитектура |
| Frontier | 1,353 экзафлопса | многократный рост к FP64 | AMD, ускоренная архитектура |
| Aurora | 1,012 экзафлопса | многократный рост к FP64 | Intel, ускоренная архитектура |
| JUPITER Booster | 1,000 экзафлопса | не указано | первый европейский экзафлопсный комплекс |
У El Capitan результат HPL-MxP достигает 16,7 экзафлопса. Это в 9,2 раза выше его стандартного Linpack. У Aurora и Frontier TOP500 тоже фиксирует похожие множители.
По энергопотреблению LineShine тоже не выглядит безусловным победителем. Система потребляет 42 220 кВт и дает 52,07 гигафлопса на ватт в Linpack. El Capitan уступает по общему FP64-результату, но держит 60,94 гигафлопса на ватт.
Разница простая: LineShine выдает больше двойной точности, но тратит примерно на 42% больше энергии. Для научных расчетов FP64 это сильная заявка. Для обучения нейросетей такая архитектура уже менее убедительна.
AMD потеряла корону, но не верхний сегмент
Первое место ушло в Шэньчжэнь, но картина верхней части TOP500 почти не рухнула. США сохраняют три системы в первой пятерке: El Capitan, Frontier и Aurora. Европа держит один экзафлопсный комплекс — немецкий JUPITER Booster.
AMD по собственным этим теперь стоит в 191 системе TOP500. Это на 11% больше год к году. Компания также заняла 41% новых входов в этот выпуск списка.
В первой десятке у AMD три позиции: El Capitan, Frontier и HPC7 итальянской энергетической компании Eni. На эти системы приходится более 40% суммарной производительности Linpack среди топ-10.
В Green500 у AMD тоже сильные позиции. Ее чипы стоят в 56% из 50 самых энергоэффективных систем. Первые развертывания Instinct MI355X попали в список через два комплекса Cambridge Zenith в Великобритании, на местах 67 и 68.
Поэтому LineShine не отменяет тренд на ускорители. Он показывает другую вещь: FP64-рейтинг еще можно выиграть CPU-массивом, если дать процессорам HBM, много ядер и огромный бюджет по питанию.
Китай несколько лет не заявлял самые быстрые системы в TOP500. После 2021 года в списке не появлялись проекты уровня Sunway OceanLight и Tianhe-3, хотя они светились в научных работах Gordon Bell Prize. Для LineShine заявку подали публично, и это само по себе стало частью новости.
Глава аналитической фирмы Intersect360 Research Addison Snell сказал Reuters, что его удивила не производительность LineShine, а раскрытие результата: Китай хотел получить признание за эту систему.