Содержание
Alibaba представила AI-ускоритель Zhenwu M890 и модель Qwen3.7-Max для агентных сценариев. По заявлению компании, новый чип в инференсе даёт производительность в 3 раза выше NVIDIA H20, а по FP16-вычислениям выходит на уровень A100 — речь про 0,6 PFLOPs FP16.
Фокус здесь простой: не «ещё один GPU», а связка «железо + сеть + сервер + модель», заточенная под Agentic AI. То есть под задачи, где много параллельных агентов одновременно планируют, вызывают инструменты и гоняют длинные цепочки действий.
Zhenwu M890: упор на инференс и память
Zhenwu M890 построен на собственной архитектуре Alibaba — PPU (Parallel Processing Unit). Внутри заявлен Transformer core engine, то есть ускорение именно «трансформерной» математики, которая доминирует в LLM.

По форматам чисел чип закрывает широкий диапазон: FP32, FP16, FP8 и FP4. Alibaba прямо ставит это в один ряд с возможностями будущих поколений ускорителей, упоминая сопоставимость по «форматной» части с NVIDIA Rubin и Huawei Ascend 950.
- Память: 144 ГБ HBM3 (у Zhenwu 810E было 96 ГБ, рост на 50%)
- Пропускная способность интерконнекта: 800 ГБ/с (у 810E было 700 ГБ/с)
- FP16-производительность: 0,6 PFLOPs, уровень NVIDIA A100 по заявлению компании
Экосистема: ICN Switch 1.0 и стойка на 128 ускорителей
Если смотреть на анонс глазами инженера, самый «облачный» кусок новости — это не один M890, а то, как Alibaba собирается масштабировать его в стойке. Компания показала interconnect-чип ICN Switch 1.0 с заявленной скоростью 25,6 Тбит/с и задержкой P2P менее 150 нс. Цель — держать высокую параллельность агентов, когда в кластере много одновременных запросов и взаимодействий.
Под это Alibaba Cloud собирает железо в единый узел: хост-процессор Yitian (Arm), сетевые карты серии Panmai и сервер Panjiu AL128 Supernode. В одном rack компания обещает плотную интеграцию 128 AI-ускорителей и суммарную полосу на уровне PB/s.
По объёмам поставок Alibaba тоже дала редкую для таких анонсов цифру: T-Head сообщает, что всего отгрузили около 560 000 чипов Zhenwu, а внешних клиентов — более 400 в 20 отраслях.
Дорожная карта Zhenwu до 2028 года
Alibaba не ограничилась M890 и показала план обновлений до 2028 года. Судя по таблице компании, они держат темп «x3 по производительности» на поколение и параллельно наращивают память и полосу интерконнекта.
| Срок | Модель | Память | Интерконнект | Заявка по росту |
|---|---|---|---|---|
| 2024 Q2 | Zhenwu 810E | 96 ГБ | 700 ГБ/с | Базовое поколение |
| 2026 Q2 | Zhenwu M890 | 144 ГБ | 800 ГБ/с | ~3x производительность |
| 2027 Q3 | Zhenwu V900 | 216 ГБ | 1200 ГБ/с | Ещё ~3x производительность |
| 2028 Q3 | Zhenwu J900 | Не раскрыли | Не раскрыли | «Breakthrough innovation», без цифр |
Qwen3.7-Max: ставка на агентное кодирование и длинные задачи
Вторая часть анонса — LLM Qwen3.7-Max, которую Alibaba позиционирует как модель для агентного кодинга, сложных рассуждений и длинных цепочек действий. Компания заявляет, что модель может автономно выполнять long-horizon задачи до 35 часов и делать более 1000 tool calls без деградации качества.
- Terminal Bench 2.0-Terminus: 69,7
- SWE-Verified: 80,4
- SWE-Pro: 60,6
- SWE-Multilingual: 78,3
- SciCode: 53,5
Модель оптимизировали под популярные агентные фреймворки, которые Alibaba перечисляет в своём анонсе: OpenClaw, Hermes Agent, Claude Code, Qwen Paw и Qoder. Доступ для разработчиков компания обещает через Model Studio.
Подробности по продуктам Alibaba вынесла в отдельные публикации: Zhenwu M890 и Qwen3.7-Max.
По срокам: в дорожной карте Alibaba указан запуск Zhenwu M890 во 2 квартале 2026 года, а следующий Zhenwu V900 компания планирует на 3 квартал 2027 года.