Radeon RX 7900 XT с 20 ГБ VRAM подключили к ноутбуку Lenovo Yoga через слот M.2 ради локальных ИИ-чатботов. Получился эффектный франкенштейн для LLM, который упёрся не в видеокарту, а в оперативную память ноутбука.
Проект собрал энтузиаст Alternative-Panic69, он же Panic, из Индии. Около месяца назад он купил Radeon RX 7900 XT за $550 — около 50 000 рублей. Для такой карты это хорошая цена даже по западным меркам, особенно если цель не игры, а модели с большим контекстом.
Изначально Panic хотел поставить видеокарту в компактный Lenovo M910Q. Этот офисный мини-ПК не подружился с картой, поэтому энтузиаст выбрал следующий по странности вариант — разобрать Lenovo Yoga и превратить ноутбук в основу внешней PCIe-системы.
Ноутбук превратили в стенд PCIe через слот M.2
Схема работала через адаптер ADT-Link, который вывели из M.2-разъёма ноутбука к полноразмерной видеокарте. Питание Radeon RX 7900 XT дал блок DeepCool PL750D, а нижнюю крышку Lenovo Yoga пришлось снять ради доступа к слоту.
Сам Panic описал идею с хорошей самоиронией. По его словам, он принял «полностью здравое решение провести операцию на ноутбуке». В другом месте он заметил, что Lenovo Yoga выглядел так, будто его превратили в плату для разработки PCIe.
Так как M.2-слот заняла внешняя видеокарта, загрузочный накопитель пришлось вынести на USB SSD. Картинка через Radeon RX 7900 XT завелась нормально. В Furmark система выдала около 500 FPS в 1080p, то есть сам канал и питание не развалились сразу после включения.
Но для локальных LLM такая конфигурация быстро показала неприятную мелочь. Если выводить изображение через дискретную карту, видеопамять съедают framebuffer и сопутствующие буферы. А 20 ГБ VRAM в задачах с большими моделями быстро перестают казаться бесконечными.
Поэтому Panic вернул вывод изображения на встроенную графику ноутбука. Radeon RX 7900 XT осталась под вычисления, где её память нужнее.
20 ГБ VRAM не спасли от нехватки RAM
Главная проблема возникла при запуске крупных моделей с длинным контекстом. Panic экспериментировал с Qwen 35B A3B и GLM-4.7 Flash, причём пытался держать 128K-token context window. Для локального ИИ это уже территория, где память важнее красивой сборки на столе.
Видеокарта справлялась не так плохо, как можно было ждать от ноутбучного M.2-франкенштейна. Узким местом стала системная DRAM. Большое окно контекста требует много связанных данных в оперативной памяти, а ноутбук быстро исчерпал доступный объём.
После этого система ушла в swap. Производительность просела до состояния, когда GPU почти простаивала и просыпалась короткими всплесками. Для LLM это неприятный сценарий: дорогая видеокарта есть, VRAM есть, но поток данных до неё задыхается раньше.
Другой участник обсуждения метко описал ситуацию как выбор двух пунктов из трёх. Для такой сборки одновременно трудно получить большую модель, длинный контекст и нормальную скорость, если базовая платформа ограничена ноутбучной памятью.
- Ноутбук: Lenovo Yoga с доступом к M.2-слоту
- Видеокарта: AMD Radeon RX 7900 XT с 20 ГБ VRAM
- Адаптер: ADT-Link для вывода PCIe из M.2
- Питание: DeepCool PL750D
- Загрузка: внешний USB SSD вместо занятого M.2-накопителя
История хорошо показывает разницу между «карта подходит по VRAM» и «вся система подходит под задачу». В играх пользователь чаще упирается в GPU, процессор или настройки графики. В локальных LLM рядом с видеопамятью внезапно встают RAM, накопитель, PCIe-канал и поведение swap.
Финал вышел приземлённым. Panic решил вернуть ноутбук к нормальной мобильной жизни и купить самый дешёвый AM4-компьютер, куда можно поставить Radeon RX 7900 XT и блок питания. Его собственная фраза тут лучше любого вывода: «Купить старый офисный tower было бы разумным решением. Но я пришёл сюда не за разумом».
Подробности проекта сам энтузиаст опубликовал в ; там же указаны модели Qwen 35B A3B, GLM-4.7 Flash и контекстное окно 128K токенов.