Alibaba представила AI-ускоритель Zhenwu M890 и модель Qwen3.7-Max для агентных сценариев. По заявлению компании, новый чип в инференсе даёт производительность в 3 раза выше NVIDIA H20, а по FP16-вычислениям выходит на уровень A100 — речь про 0,6 PFLOPs FP16.

Фокус здесь простой: не «ещё один GPU», а связка «железо + сеть + сервер + модель», заточенная под Agentic AI. То есть под задачи, где много параллельных агентов одновременно планируют, вызывают инструменты и гоняют длинные цепочки действий.

Zhenwu M890: упор на инференс и память

Zhenwu M890 построен на собственной архитектуре Alibaba — PPU (Parallel Processing Unit). Внутри заявлен Transformer core engine, то есть ускорение именно «трансформерной» математики, которая доминирует в LLM.

Продолжение после рекламы
Изображение к статье: Alibaba показала Zhenwu M890: 144 ГБ HBM3 и заявка на 3x H20

По форматам чисел чип закрывает широкий диапазон: FP32, FP16, FP8 и FP4. Alibaba прямо ставит это в один ряд с возможностями будущих поколений ускорителей, упоминая сопоставимость по «форматной» части с NVIDIA Rubin и Huawei Ascend 950.

  • Память: 144 ГБ HBM3 (у Zhenwu 810E было 96 ГБ, рост на 50%)
  • Пропускная способность интерконнекта: 800 ГБ/с (у 810E было 700 ГБ/с)
  • FP16-производительность: 0,6 PFLOPs, уровень NVIDIA A100 по заявлению компании

Экосистема: ICN Switch 1.0 и стойка на 128 ускорителей

Если смотреть на анонс глазами инженера, самый «облачный» кусок новости — это не один M890, а то, как Alibaba собирается масштабировать его в стойке. Компания показала interconnect-чип ICN Switch 1.0 с заявленной скоростью 25,6 Тбит/с и задержкой P2P менее 150 нс. Цель — держать высокую параллельность агентов, когда в кластере много одновременных запросов и взаимодействий.

Изображение к статье: Alibaba показала Zhenwu M890: 144 ГБ HBM3 и заявка на 3x H20

Под это Alibaba Cloud собирает железо в единый узел: хост-процессор Yitian (Arm), сетевые карты серии Panmai и сервер Panjiu AL128 Supernode. В одном rack компания обещает плотную интеграцию 128 AI-ускорителей и суммарную полосу на уровне PB/s.

По объёмам поставок Alibaba тоже дала редкую для таких анонсов цифру: T-Head сообщает, что всего отгрузили около 560 000 чипов Zhenwu, а внешних клиентов — более 400 в 20 отраслях.

Дорожная карта Zhenwu до 2028 года

Alibaba не ограничилась M890 и показала план обновлений до 2028 года. Судя по таблице компании, они держат темп «x3 по производительности» на поколение и параллельно наращивают память и полосу интерконнекта.

Изображение к статье: Alibaba показала Zhenwu M890: 144 ГБ HBM3 и заявка на 3x H20
Срок Модель Память Интерконнект Заявка по росту
2024 Q2 Zhenwu 810E 96 ГБ 700 ГБ/с Базовое поколение
2026 Q2 Zhenwu M890 144 ГБ 800 ГБ/с ~3x производительность
2027 Q3 Zhenwu V900 216 ГБ 1200 ГБ/с Ещё ~3x производительность
2028 Q3 Zhenwu J900 Не раскрыли Не раскрыли «Breakthrough innovation», без цифр

Qwen3.7-Max: ставка на агентное кодирование и длинные задачи

Вторая часть анонса — LLM Qwen3.7-Max, которую Alibaba позиционирует как модель для агентного кодинга, сложных рассуждений и длинных цепочек действий. Компания заявляет, что модель может автономно выполнять long-horizon задачи до 35 часов и делать более 1000 tool calls без деградации качества.

  • Terminal Bench 2.0-Terminus: 69,7
  • SWE-Verified: 80,4
  • SWE-Pro: 60,6
  • SWE-Multilingual: 78,3
  • SciCode: 53,5

Модель оптимизировали под популярные агентные фреймворки, которые Alibaba перечисляет в своём анонсе: OpenClaw, Hermes Agent, Claude Code, Qwen Paw и Qoder. Доступ для разработчиков компания обещает через Model Studio.

Подробности по продуктам Alibaba вынесла в отдельные публикации: Zhenwu M890 и Qwen3.7-Max.

Продолжение после рекламы

По срокам: в дорожной карте Alibaba указан запуск Zhenwu M890 во 2 квартале 2026 года, а следующий Zhenwu V900 компания планирует на 3 квартал 2027 года.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.