Copilot: Microsoft verlagert Routine-Code auf lokales Modell MAI-Code-1.1-Flash
Veröffentlicht am: 11.10.2026 um 17:34 Uhr | Redaktion boerse-global.deMicrosoft hat angekündigt, reguläre Programmieraufgaben in Copilot künftig auf ein eigenes lokales Modell namens MAI-Code-1.1-Flash zu verlagern. Bisher kamen für diese Routineprozesse Modelle wie Claude Haiku 4.5 von Anthropic zum Einsatz. Ein integrierter Modell-Router soll Standardaufgaben künftig direkt auf Nvidia-PCs leiten, wodurch für diese lokalen Abfragen keine Inferenzgebühren anfallen.
Lokale Ausführung mit MoE-Architektur und 3-Bit-Quantisierung
Das Modell MAI-Code-1.1-Flash wurde am 7. Oktober 2026 als lokale PC-Version veröffentlicht, nachdem die Cloud-Variante bereits zuvor bereitstand. Die Architektur basiert auf einem Mixture-of-Experts-Ansatz (MoE) mit 137 Milliarden Parametern insgesamt und 6,8 Milliarden aktiven Parametern.
Durch den Einsatz einer 3-Bit-Quantisierung sowie spekulativer Dekodierung konnte der Speicherbedarf auf 53 Gigabyte reduziert werden, was einer Verkleinerung um rund 80 Prozent gegenüber dem BF16-Original entspricht.
In Leistungstests erreicht die lokale Fassung Werte, die nah an der Cloud-Variante liegen: Beim SWE-Bench Verified kommt die lokale Version auf 70,8 Prozent gegenüber 72,6 Prozent in der Cloud.
Beim Terminal-Bench 2.1 erzielt die lokale Ausführung 66,29 Prozent, während die Cloud-Version 62,9 Prozent erreicht. Zum Vergleich verzeichnete GPT OSS 120B in diesen Tests Werte von 32,0 Prozent und 23,6 Prozent.
Die Cloud-Version des Modells weist rund 138 Milliarden Gesamtparameter und 50 Milliarden aktive Parameter auf. Sie verarbeitet Text- sowie Bildeingaben, verfügt über ein Kontextfenster von 256.000 Tokens und basiert auf Trainingsdaten bis August 2026. Auch die Endgeräteversion unterstützt das volle Kontextfenster von 256.000 Tokens, stellt jedoch hohe Anforderungen an die Hardware.
Hohe Speicheranforderungen und neue Hardware
Laut einer technischen Offenlegung von Microsoft vom 7. Oktober 2026 beläuft sich der Speicherbedarf bei einem Kontext von 256.000 Tokens auf bis zu 75,5 Gigabyte Peak-Speicher auf dem Surface Laptop Ultra. Neben dem Basis-Footprint von 53 Gigabyte bedeutet dies einen zusätzlichen Bedarf von 22,5 Gigabyte beziehungsweise 42,5 Prozent. Microsoft empfiehlt für eine optimale Leistung mehr als 120 Gigabyte Arbeitsspeicher.
Wer sich mit der Einführung neuer Microsoft-Technologien befasst, sollte auch die rechtlichen Rahmenbedingungen für den Einsatz intelligenter Systeme im Blick behalten. Dieser kostenlose Leitfaden bietet Unternehmen eine kompakte Übersicht über Fristen, Pflichten und Risikoklassen der aktuellen Gesetzgebung. EU AI Act in 5 Schritten verstehen
Parallel dazu stellte der Konzern passende Hardwarelösungen vor. Das Surface Laptop Ultra mit Nvidia RTX Spark und bis zu 128 Gigabyte Unified Memory soll ab dem 16. Oktober 2026 zu einem Einstiegspreis von 2.599 US-Dollar erhältlich sein. Das 15-Zoll-Gerät ist in der Lage, Modelle mit mehr als 120 Milliarden Parametern lokal zu betreiben. Zudem kündigte Microsoft die Surface RTX Spark Dev Box an, die ebenfalls mit maximal 128 Gigabyte Arbeitsspeicher ausgestattet ist.
Integration in GitHub Copilot und Windows 11
Auf Softwareseite führte Microsoft am 7. Oktober 2026 MXC-Container (Microsoft Execution Containers) als allgemein verfügbar auf Windows 11 ein. GitHub Copilot soll bis Ende des Monats eine automatische Routing-Funktion zwischen lokaler Ausführung und der Cloud erhalten. Die Technologie GitHub HydraFusion soll das Routing in der Copilot-App, auf der Kommandozeile und in VS Code steuern und später im Oktober als experimentelle Vorschau starten.
Die Integration neuer KI-Anwendungen in bestehende IT-Infrastrukturen stellt viele Betriebe vor neue Herausforderungen bei der Compliance und Risikodokumentation. Erfahren Sie in diesem kostenlosen E-Book, welche konkreten Schritte jetzt notwendig sind, um technologische Innovationen rechtssicher zu nutzen. Kostenlosen Umsetzungsleitfaden zum EU AI Act herunterladen
Bereits mit der CLI-Version 1.0.94-0 erkennt die GitHub-Kommandozeile seit dem 7. Oktober 2026 unterstützte Modelle in bestehenden lokalen Ollama-Installationen. Neben MAI-Code-1.1-Flash umfasst das lokale Modellangebot im Windows-Ökosystem unter anderem Nvidia Nemotron und DeepSeek V4 Flash. Entwickler können künftig festlegen, ob Copilot Aufgaben automatisch zuweist oder nach individuellen Präferenzen entscheidet.

