64-поточный ноутбук Sugon для ИИ засветился в тизере: китайская компания обещает локальный запуск 35B MoE-моделей со скоростью до 50 токенов в секунду. По классу это мобильная рабочая станция, но не чемодан с ручкой, а корпус толщиной 16,9 мм.

Новость любопытна не только цифрами. Sugon давно работает в сегменте суперкомпьютеров, а здесь пытается упаковать серверную идею в формат премиального ноутбука. Китайское издание ITHome пишет, что устройство получит отечественный CPU на 64 потока и дискретную графику с 16 ГБ видеопамяти.

Но пока перед нами именно тизер. Sugon раскрыла часть характеристик, но скрыла самые дорогие детали: точную модель процессора, производителя GPU, сроки продаж и цену.

Продолжение после рекламы

Известные характеристики мобильной рабочей станции Sugon

Мобильная рабочая станция Sugon выглядит ближе к обычному ноутбуку, чем к переносным рабочим станциям старой школы. Толщина корпуса составляет 0,665 дюйма, или 16,9 мм, так что устройство попадает в зону тонких премиальных моделей.

  • CPU: отечественный процессор с 64 потоками
  • GPU: дискретная видеокарта, модель не раскрыта
  • Видеопамять: 16 ГБ VRAM
  • ИИ-нагрузка: локальный запуск 35B MoE-моделей
  • Скорость: до 50 токенов в секунду
  • Корпус: 16,9 мм толщины

Для локального ИИ 16 ГБ VRAM — не роскошь, а нижняя граница серьёзной работы. Такой объём уже даёт пространство для крупных моделей, квантизации и более длинного контекста. Но без названия GPU мы не знаем ни архитектуру, ни пропускную способность памяти, ни реальную энергоэффективность.

Sugon заявляет, что связка 64-поточного CPU и дискретной графики работает в ИИ-задачах в 3-5 раз быстрее массовых продуктов на рынке. Формулировка широкая: компания не называет конкретные ноутбуки, тестовые настройки и версии моделей.

Процессор, скорее всего, связан с Hygon

Изображение к статье: Sugon готовит 64-поточный ноутбук для локальных ИИ

Sugon не выпускает процессоры сама, поэтому главный кандидат — Hygon, её давний партнёр. Компании тесно связаны: Sugon уже стала крупнейшим акционером Hygon, хотя прошлогодняя попытка объединить бизнесы не дошла до сделки.

У Hygon есть несколько вариантов, которые подходят под 64 потока. Старые серии C86-1G, C86-2G, C86-3G и C86-4G опирались на лицензированную IP AMD Zen. В линейке встречались решения до 32 ядер и 64 потоков.

Другой сценарий интереснее. Sugon может взять новые чипы Hygon C86-5G. Hygon описывает их как процессоры с собственной микроархитектурой, уже без прямой привязки к Zen. Эти CPU поддерживают AVX-512 и используют SMT4, то есть четыре потока на ядро.

Если в ноутбуке стоит C86-5G, 64 потока могут означать конфигурацию на 16 ядер. Для ИИ-инференса CPU здесь не заменяет GPU, но помогает с подготовкой данных, планированием запросов и обслуживанием модели.

50 токенов в секунду звучат сильно, но нужны тесты

Заявленные 50 токенов в секунду на локальной 35-миллиардной MoE-модели выглядят близко к облачному опыту. Для ориентира, типичные облачные API часто выдают примерно 30-80 токенов в секунду, хотя скорость зависит от модели, очереди, тарифа и длины ответа.

MoE-модели считают не все параметры на каждом токене. Они активируют часть экспертных блоков, поэтому 35B MoE не равна обычной dense-модели на 35 млрд параметров по нагрузке. Но для ноутбука это всё равно тяжёлая задача. Особенно если пользователь хочет работать локально, без отправки данных в облачный сервис.

Продолжение после рекламы

Здесь и начинается главный вопрос. Одной цифры tokens per second мало для оценки. Нужны данные по точности модели, квантизации, энергопотреблению, шуму, температуре корпуса и времени работы от батареи. В тонком корпусе 16,9 мм охлаждение решает почти всё.

Цена тоже пока за кадром. Sugon не назвала ни дату выхода, ни конфигурации памяти и накопителей. С учётом 16 ГБ VRAM, 64-поточного CPU и текущих цен на память такая мобильная рабочая станция почти наверняка уйдёт в дорогой профессиональный сегмент.

Официальных сроков продаж и цены у мобильной рабочей станции Sugon пока нет; подтверждены только 64 потока CPU, 16 ГБ VRAM, корпус 16,9 мм и заявка до 50 токенов в секунду на 35B MoE-модели.

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.