Zyphra запустила в США открытую AI-платформу Zyphra Cloud, которая опирается на 15 МВт вычислений на ускорителях AMD Instinct MI355X. Компания говорит о сервисе как об инфраструктуре для инференса open-weight моделей уровня DeepSeek и планирует расширение на будущие GPU, включая MI450.

Платформа уже доступна публично. Описание и доступ к сервисам Zyphra вынесла на отдельную страницу: Zyphra Cloud.

Zyphra Cloud заточили под инференс и длинный контекст

Zyphra Cloud компания описывает как inference-оптимизированный сервис для «frontier» open-weight моделей. В списке прямо названы DeepSeek V3.2, Kimi K2.6 и GLM 5.1.

Продолжение после рекламы

Технически Zyphra делает ставку на три вещи. Это кастомные kernels, новые алгоритмы инференса для длинного контекста и продвинутые техники параллелизма. Цель простая: высокий throughput и низкая задержка, чтобы тянуть агентные сценарии, «deep research» и длинные цепочки задач.

Железо: тысячи ускорителей AMD Instinct и 15 МВт от TensorWave

Железную часть Zyphra Cloud размещает у TensorWave. По описанию компании, там стоит инсталляция из тысяч ускорителей AMD Instinct, а суммарная доступная мощность вычислений под Zyphra Inference достигает 15 МВт за счет кластера на MI355X.

Изображение к статье: Zyphra запустила AI Cloud на 15 МВт MI355X и готовит апгрейд до MI450

В Zyphra отдельно проговорили, что конфигурация масштабируется дальше. В планах — расширение на будущие ускорители, включая AMD Instinct MI450 и более поздние поколения.

Со стороны TensorWave партнерство прокомментировал Джефф Татарчук, сооснователь и Chief Growth Officer компании: «TensorWave exists to give AI-native companies like Zyphra the dedicated, high-performance AMD compute they need without compromise. Powering Zyphra Inference with our MI355X infrastructure is exactly the kind of partnership we built TensorWave for — enabling teams to ship production-ready AI on the latest AMD accelerators at scale.»

Ранее, в 2024 году, TensorWave уже объявляла планы собрать к 2025 году один из крупнейших кластеров на GPU AMD. В дорожной карте назывались MI300X, MI325X и MI350X, а также многогигаВаттная емкость вычислений.

Планы Zyphra: не только инференс, но и RL с fine-tuning

Хотя стартовый фокус Zyphra Cloud — инференс, компания говорит о расширении в сторону более «полной» платформы. В списке будущих возможностей названы reinforcement learning и fine-tuning, а в качестве основы для этого Zyphra упоминает свежие AMD EPYC и доступ к выделенным GPU-кластерам.

  • ZAYA1-8B: reasoning-модель
  • ZAYA1-74B: MoE-модель с числом параметров до 74B
  • ZAYA1-VL: первая vision-language модель компании

Подробности о партнерстве Zyphra и AMD компания собрала в отдельной заметке: Zyphra and AMD partner to power Zyphra Cloud.

Zyphra Cloud доступна уже сегодня на странице сервиса: zyphra.com/cloud.

Продолжение после рекламы

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.