Содержание
Nvidia начала отгружать первые CPU Vera — это первый кастомный серверный процессор компании, который она проектировала под agentic AI. Первые стойки с Vera уже получили Anthropic, OpenAI, SpaceX и Oracle Cloud.
О поставках рассказал вице-президент Nvidia по hyperscale и HPC Иэн Бак (Ian Buck). По его словам, это первый момент, когда Vera вышел за пределы лабораторий Nvidia и попал к первым заказчикам.
Кому и когда Nvidia привезла первые Vera
Nvidia сделала поставку в формате «из рук в руки». Иэн Бак лично привёз несколько стоек с Vera в разные офисы компаний.
- Anthropic: стойки доставили в офис SoMa в Сан-Франциско.
- OpenAI: следующая точка — штаб-квартира Mission Bay.
- SpaceX: стойку доставили в офис в Пало-Альто, где Vera передали Илону Маску.
- Oracle: финальная доставка прошла в AI Customer Excellence Center.
Три стойки (для Anthropic, OpenAI и SpaceX) привезли в пятницу. В Oracle стойка приехала в понедельник.
Что умеет CPU Nvidia Vera и чем он отличается от Grace
Vera Nvidia называет преемником Grace и частью экосистемы под agentic AI. В компании прямо описывают роль CPU как «мозга» для оркестрации: он берёт на себя управление агентами, их состоянием и потоком данных, пока GPU заняты ускорением моделей.
В типовых задачах для agentic AI Nvidia выделяет несколько направлений, под которые и проектировали Vera.
- Оркестрация: управление пайплайнами и распределением задач между ускорителями.
- Tool-calling: вызовы внешних инструментов и сервисов агентами.
- RL-нагрузки: обучение с подкреплением и связанные вычисления.
- Песочницы агентов: изоляция окружений и контроль исполнения.
- Длинный контекст: хранение и управление long-context state.
- Аналитика данных: подготовка, обработка и выгрузка данных.
Ключевые характеристики Nvidia Vera
По спецификациям, которые Nvidia раскрыла для платформы, Vera строится на кастомной Arm-архитектуре Olympus и делает упор на пропускную способность памяти и энергоэффективность.
- CPU: 88 кастомных ядер Olympus.
- Потоки: 176 потоков за счёт NVIDIA Spatial Multi-Threading.
- Память: до 1,5 ТБ системной памяти (Nvidia заявляет, что это в 3 раза больше, чем у Grace).
- Память (тип): LPDDR5X в формате SOCAMM.
- Пропускная способность памяти: 1,2 ТБ/с.
- Интерконнект: 1,8 ТБ/с NVLink-C2C coherent memory interconnect.
- Производительность: Nvidia заявляет 50% прироста per-core под полной нагрузкой и 2-кратный рост для data processing, compression и CI/CD относительно Grace.
- Безопасность: rack-scale confidential compute.
Nvidia отдельно подчёркивает, что Vera — «первый и единственный» датацентровый CPU, который использует LPDDR5, и делает ставку на performance-per-watt. Компания также говорит о высокой однопоточной производительности и высоком «data output».
Vera пойдёт не только в стойки Rubin, но и как отдельный CPU
Nvidia интегрирует Vera в платформу Vera Rubin, но параллельно планирует продавать эти CPU и как самостоятельные решения. В компании ожидают, что это откроет для неё отдельное многомиллиардное направление бизнеса в датацентровых процессорах.
По плану Nvidia, Vera будет работать и как хост-процессор в стойках Vera Rubin NVL72, и в отдельных серверах формата standalone LPX.
Ещё один практический эффект — рост спроса на LPDDR5X для датацентров. Nvidia прямо говорит о риске ограничений по цепочке поставок, учитывая объём памяти до 1,5 ТБ на платформу и ожидаемые объёмы поставок в ближайшие кварталы.
По данным Nvidia, запуск платформы Vera Rubin намечен на вторую половину 2026 года, а массовое производство первых стоек должно стартовать «в ближайшее время». Детали о первых поставках компания описала в заметке very first Vera CPUs.