SPEC выпустила новый серверный бенчмарк SPEC CPU 2026 и сразу показала первые результаты — в базе есть даже Raspberry Pi 5. Набор вырос до 52 тестов, а кодовая база стала больше чем вдвое по сравнению с SPEC CPU 2017.

Для нас, как для энтузиастов, это редкий случай. «Серверный» бенчмарк внезапно оказался применим к железу от одноплатников до Windows-on-ARM ноутбуков. И теперь можно сравнивать системы в одной методике, пусть и с оговорками.

Чем SPEC CPU 2026 отличается от SPEC CPU 2017

Главное изменение — масштаб и строгость методики. В SPEC CPU 2026 52 бенчмарка, это на девять больше, чем в SPEC CPU 2017. По данным SPEC, общий объём кода у набора теперь больше чем в 2 раза относительно версии 2017 года.

Продолжение после рекламы

SPEC берёт реальные приложения и дорабатывает их под требования набора. Ключевая цель — детерминированность. То есть тест должен делать одинаковый объём работы на любой совместимой системе и выдавать одинаковый результат в заданном допуске.

Пример из технического описания SPEC: в одном из случаев они заменили std::sort в C++ на std::stable_sort, чтобы убрать недетерминизм.

Ещё один принцип — переносимость и минимальная зависимость от ОС. SPEC приводит код к C, C++ или Fortran и старается, чтобы не менее 95% времени исполнения приходилось на user-space. Так влияние операционной системы на итоговый балл снижается.

Почему в набор не попали llama.cpp и whisper.cpp

SPEC собирала кандидатов для SPEC CPU 2026 больше трёх лет: с февраля 2020 по март 2023. На входе было 70 кандидатных приложений, до финального набора дошли 38, которые утвердил CPU-комитет SPEC.

Современные AI-нагрузки тоже пробовали. Но SPEC отдельно поясняет, почему не включила llama.cpp и whisper.cpp. Их ограничение до «чистых» переносимых C++-путей без intrinsics привело к расхождению с реальным поведением. В итоге такие тесты признали непригодными для набора.

SPEC также не стала включать кодеки AV1 и Opus. Причина — избежать потенциальных претензий к предвзятости, учитывая состав комитета. В нём есть представители Intel, AMD, IBM, Arm, Nvidia, Dell, HPE, Ampere и других компаний.

Как читаются результаты: SPECspeed и SPECrate

  • Integer speed: скорость целочисленных задач
  • Integer throughput: пропускная способность целочисленных задач
  • Floating point speed: скорость задач с плавающей точкой
  • Floating point throughput: пропускная способность FP-задач

Два «speed» показателя складываются в SPECspeed. Два «throughput» — в SPECrate.

Изображение к статье: SPEC CPU 2026 обновили: 52 теста и результаты даже для Raspberry Pi 5

SPECspeed ближе к тому, что привыкли видеть энтузиасты. Это один экземпляр приложения, который получает все ресурсы системы. SPECrate — серверная история. Там меряют суммарную производительность, когда одновременно запускают много копий одного теста.

Важно и то, как считают итоговый балл. SPEC использует геометрическое среднее отношений времени. Для каждого теста берут время на эталонной системе и делят на время на тестируемой системе.

Продолжение после рекламы

И ещё одна практическая деталь. SPEC CPU 2026 поставляется в виде исходников, а в результатах нужно раскрывать компилятор. В первых публикациях часто встречаются вендорские компиляторы, поэтому одинаковое железо может показывать разные цифры.

Первые результаты SPEC CPU 2026: от Raspberry Pi 5 до серверов на сотни потоков

В базе SPEC уже есть десятки результатов от производителей и интеграторов, включая AMD, Intel, Dell, Lenovo, Supermicro и HPE. Мы выделим несколько показательных примеров, чтобы понять разброс.

Во floating point throughput (SPECrate FP) в списке встречаются и «домашние» устройства. Например, Raspberry Pi 5 Model B Rev 1.1 с четырьмя копиями тестов показал 4.8 (base) и 4.89 (peak).

  • MINISFORUM EliteMini AI370 на AMD Ryzen AI 9 HX 370: base 5
  • Nvidia DGX Spark (GB10): base 5.97 при 1 копии и 66.6 при 20 копиях
  • MacBook Pro 16 (M5 Pro): base 82.7 при 18 копиях

На другом конце шкалы — серверы, где счёт идёт на сотни потоков. В integer throughput (SPECrate Integer) один из лидеров в выборке — Dell PowerEdge M7725 с двумя AMD EPYC 9965 и суммарно 768 потоками: base 1 270 и peak 1 270.

В FP throughput (SPECrate FP) среди самых высоких значений в приведённой выборке — HPE ProLiant Compute DL580 Gen12 с четырьмя Intel Xeon 6788P. У системы 688 потоков, результат base и peak — 1 180.

Если смотреть «speed» (один экземпляр задачи), картина меняется. В floating point speed максимальный результат в показанной группе у Dell PowerEdge M7725 с двумя AMD EPYC 9755: base 18.6 и peak 18.6. А в integer speed в этой же выборке лидирует Supermicro Hyper A+ Server AS -2126HS-TN с двумя AMD EPYC 9755: base 8.26 и peak 8.26.

Сроки публикаций и цены на SPEC CPU 2026

После релиза SPEC вводит «период охлаждения» перед следующей волной публикаций результатов. Следующая дата, когда компании смогут выкладывать новые результаты — 4 июня 2026.

Дальше SPEC начнёт выводить CPU 2017 из оборота. С 11 августа результаты SPEC CPU 2017 нужно будет публиковать только вместе с результатами по 2026. А 3 ноября SPEC полностью выведет CPU 2017 из программы.

По лицензиям тоже есть конкретика. До 3 ноября владельцы лицензии SPEC CPU 2017 могут обновиться до CPU 2026 за $2 000 (около 160 000 рублей). Новая лицензия стоит $3 000 (около 240 000 рублей). Для некоммерческих организаций цена — $750 (около 60 000 рублей), а некоторые учебные учреждения могут получить лицензию бесплатно.

По бенчмаркам Tom’s Hardware.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.