01 Что произошло
Microsoft готовит автоматический выбор между локальными и облачными моделями для GitHub Copilot. По словам компании, функция появится до конца октября 2026 года. Одновременно Microsoft AI описывает локальную квантованную версию MAI Code 1.1 Flash, модели для программирования, размер которой составляет 53 ГБ, то есть на 80% меньше облачного варианта в Bfloat16.
02 Ключевые детали
- По словам Microsoft, Copilot к концу октября 2026 года начнёт автоматически распределять задачи между устройством и облаком.
- Квантованная локальная MAI Code 1.1 Flash, по данным компании, занимает 53 ГБ. Пиковая память на Surface Laptop Ultra при контексте 256k составляет 75,5 ГБ.
- Результаты SWE-Bench Verified (70,80% на устройстве и 72,6% в облаке) приведены Microsoft и не проверены независимо.
- Локальный инференс не делает сессию Copilot офлайн. Встроенные файловые инструменты проверяются агентом по политике, но не изолируются средствами ОС.
03 Почему это важно
Для разработчиков на поддерживаемых Windows-ПК это значит, что часть задач может выполняться локально в пределах бюджета памяти, а часть в облаке, без ручного выбора инфраструктуры. Однако цифры размера и производительности пока остаются заявлениями поставщика.
04 Кому полезно
Разработчики программного обеспечения и команды, оценивающие локальные ИИ-инструменты для программирования.