Содержание
Zyphra запустила в США открытую AI-платформу Zyphra Cloud, которая опирается на 15 МВт вычислений на ускорителях AMD Instinct MI355X. Компания говорит о сервисе как об инфраструктуре для инференса open-weight моделей уровня DeepSeek и планирует расширение на будущие GPU, включая MI450.
Платформа уже доступна публично. Описание и доступ к сервисам Zyphra вынесла на отдельную страницу: Zyphra Cloud.
Zyphra Cloud заточили под инференс и длинный контекст
Zyphra Cloud компания описывает как inference-оптимизированный сервис для «frontier» open-weight моделей. В списке прямо названы DeepSeek V3.2, Kimi K2.6 и GLM 5.1.
Технически Zyphra делает ставку на три вещи. Это кастомные kernels, новые алгоритмы инференса для длинного контекста и продвинутые техники параллелизма. Цель простая: высокий throughput и низкая задержка, чтобы тянуть агентные сценарии, «deep research» и длинные цепочки задач.
Железо: тысячи ускорителей AMD Instinct и 15 МВт от TensorWave
Железную часть Zyphra Cloud размещает у TensorWave. По описанию компании, там стоит инсталляция из тысяч ускорителей AMD Instinct, а суммарная доступная мощность вычислений под Zyphra Inference достигает 15 МВт за счет кластера на MI355X.
В Zyphra отдельно проговорили, что конфигурация масштабируется дальше. В планах — расширение на будущие ускорители, включая AMD Instinct MI450 и более поздние поколения.
Со стороны TensorWave партнерство прокомментировал Джефф Татарчук, сооснователь и Chief Growth Officer компании: «TensorWave exists to give AI-native companies like Zyphra the dedicated, high-performance AMD compute they need without compromise. Powering Zyphra Inference with our MI355X infrastructure is exactly the kind of partnership we built TensorWave for — enabling teams to ship production-ready AI on the latest AMD accelerators at scale.»
Ранее, в 2024 году, TensorWave уже объявляла планы собрать к 2025 году один из крупнейших кластеров на GPU AMD. В дорожной карте назывались MI300X, MI325X и MI350X, а также многогигаВаттная емкость вычислений.
Планы Zyphra: не только инференс, но и RL с fine-tuning
Хотя стартовый фокус Zyphra Cloud — инференс, компания говорит о расширении в сторону более «полной» платформы. В списке будущих возможностей названы reinforcement learning и fine-tuning, а в качестве основы для этого Zyphra упоминает свежие AMD EPYC и доступ к выделенным GPU-кластерам.
- ZAYA1-8B: reasoning-модель
- ZAYA1-74B: MoE-модель с числом параметров до 74B
- ZAYA1-VL: первая vision-language модель компании
Подробности о партнерстве Zyphra и AMD компания собрала в отдельной заметке: Zyphra and AMD partner to power Zyphra Cloud.
Zyphra Cloud доступна уже сегодня на странице сервиса: zyphra.com/cloud.