01 Was passiert ist

Microsoft plant, dass GitHub Copilot automatisch entscheidet, ob eine Aufgabe auf einem lokalen Modell am Gerät oder auf großen Cloud-Modellen läuft. Laut Microsoft soll das bis Ende Oktober 2026 kommen. Außerdem beschreibt das Unternehmen eine lokale, quantisierte Version von MAI Code 1.1 Flash mit 53 GB, nach eigenen Angaben 80 Prozent kleiner als die Bfloat16-Cloud-Variante.

02 Die wichtigsten Details

  • Laut Microsoft soll die automatische Verteilung von Aufgaben auf Gerät und Cloud bis Ende Oktober 2026 starten.
  • Microsoft gibt an, dass die lokale quantisierte Version von MAI Code 1.1 Flash 53 GB groß ist. Laut Microsoft liegt der Spitzenspeicherbedarf auf einem Surface Laptop Ultra bei 256k Kontext bei 75,5 GB.
  • Die SWE-Bench-Verified-Werte (70,80 Prozent lokal, 72,6 Prozent in der Cloud) stammen von Microsoft und sind nicht unabhängig geprüft.
  • Lokale Inferenz macht eine Copilot-Sitzung nicht offline. Eingebaute Dateiwerkzeuge prüft das Agent-Harness nach Richtlinie, eine Isolation auf Betriebssystemebene gibt es dafür nicht.

03 Warum das wichtig ist

Für Entwickler auf unterstützten Windows-PCs heißt das, dass Aufgaben je nach Speicherbedarf lokal oder in der Cloud laufen können, ohne dass sie die Infrastruktur selbst wählen müssen. Die Größen- und Leistungsangaben sind bislang jedoch Herstellerangaben.

04 Für wen es relevant ist

Softwareentwickler und Teams, die lokale KI-Werkzeuge für die Programmierung bewerten.

OriginalquelleMicrosoft