01 Ce qui s’est passé

Microsoft prévoit que GitHub Copilot détermine automatiquement si une tâche doit être traitée par un modèle local ou par des modèles à grande échelle dans le cloud. Selon l'entreprise, cela arrivera d'ici fin octobre 2026. Microsoft AI décrit aussi une version locale quantifiée de MAI Code 1.1 Flash, indiquée à 53 Go, soit 80 % de moins que la variante cloud en Bfloat16.

02 Les points essentiels

  • Selon Microsoft, la répartition automatique des tâches entre l'appareil et le cloud doit arriver d'ici fin octobre 2026.
  • Selon l'entreprise, MAI Code 1.1 Flash quantifié occupe 53 Go. Sur Surface Laptop Ultra, la mémoire de pointe atteint 75,5 Go à 256k de contexte.
  • Les résultats SWE-Bench Verified (70,80 % en local, 72,6 % dans le cloud) sont ceux de Microsoft et ne sont pas vérifiés de façon indépendante.
  • L'inférence locale ne rend pas une session Copilot hors ligne. Les outils de fichiers intégrés sont contrôlés par le harnais selon la politique, sans isolation imposée par le système.

03 Pourquoi c’est important

Pour les développeurs sur du matériel Windows compatible, cela signifie que certaines tâches pourront tourner en local dans la limite de la mémoire disponible, et d'autres dans le cloud. Les performances et tailles annoncées restent toutefois des affirmations du fournisseur.

04 Pour qui c’est utile

Développeurs de logiciels et équipes évaluant les outils de programmation IA locaux.

Source originaleMicrosoft