Microsoft адаптировала модель для программирования MAI Code 1.1 Flash для локального запуска на ПК с NVIDIA RTX Spark. Одновременно компания готовит для GitHub Copilot выбор между облачными моделями и моделью на компьютере: такая схема позволит выполнять часть задач без расхода облачных токенов, сообщает PC Watch.
У MAI Code 1.1 Flash 137 млрд параметров, но при обработке запроса задействуются 6,8 млрд. Microsoft использует трёхбитное представление данных модели, чтобы сократить её размер почти на 80%. При этом, по заявлению компании, модель сохраняет качество работы с кодом и поддерживает контекст до 256 тысяч токенов — объём текста и кода, который она может учитывать в одном запросе.
Выбирать модель под конкретную задачу будет система HydraFusion. Сейчас она распределяет запросы между облачными моделями, а после расширения сможет направлять их и на локальную. Пробную версию для приложения GitHub Copilot, его командной строки и Visual Studio Code планируют выпустить в октябре. Локальный запуск требует подходящего оборудования: Microsoft называет, в частности, ПК с RTX Spark.
Компания также объявила о запуске Microsoft Execution Containers (MXC) в Windows 11. Этот механизм ограничивает доступ ИИ-агента к файлам и сети по заранее заданным правилам. Он нужен для агентов, которые могут самостоятельно пользоваться инструментами, писать код и обращаться к данным на компьютере. Среди уже поддерживающих MXC продуктов Microsoft перечисляет GitHub Copilot и LM Studio.
В ближайшие месяцы Microsoft планирует постепенно добавить в приложение Copilot на компьютерах Copilot+ PC работу с локальными файлами с разрешения пользователя, а также выполнение отдельных задач на устройстве — например, упорядочивание файлов и диагностику неполадок.
Источник: PC Watch.