LONDON (IT BOLTWISE) – Microsoft stellt mit MAI-Code-1.1-Flash ein neues Coding-Modell vor, das laut Hersteller die Betriebskosten um 75 Prozent senken soll. Das Modell nutzt eine Sparse-Mixture-of-Experts-Architektur mit 138 Milliarden Parametern, von denen im Betrieb 5 Milliarden aktiv sind. Gleichzeitig integriert Microsoft die neue Version direkt in GitHub Copilot und erweitert sie um Vision-Support bei passenden MAI-Modellen. Ergänzend dazu liefert der Patchday über 400 behobene Schwachstellen und kündigt weitere Sicherheitsupdates im September an.

MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent
MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Microsoft setzt bei der nächsten Generation seiner Coding-KI nicht nur auf höhere Benchmark-Werte, sondern vor allem auf eine deutlich effizientere Rechenleistung. Im Fokus steht MAI-Code-1.1-Flash, das im direkten Wettbewerb mit internationalen Modellen positioniert wird und die Vorgängerversion MAI-Code-1-Flash bereits nach einer Laufzeit von zehn Wochen ablöst. Der Hersteller verkauft das Update als Kostenhebel für den produktiven Betrieb: Die Betriebskosten sollen um 75 Prozent sinken, während die Modellleistung bei Tests wie Terminal-Bench 2.1 steigt. Für Unternehmen ist das relevant, weil Coding-Workloads typischerweise aus vielen kurzen, zeitkritischen Anfragen bestehen und sich Einsparungen bei Inferenzkosten bei hoher Nutzung schnell in ein belastbares Budget übersetzen lassen.

Technisch basiert MAI-Code-1.1-Flash auf einer Sparse Mixture of Experts (MoE)-Architektur. Microsoft nennt 138 Milliarden Parameter als Gesamtgröße des Modells, aktiviert im laufenden Betrieb jedoch jeweils nur 5 Milliarden Parameter. Genau dieser Mechanismus reduziert die Rechenlast pro Anfrage: Das Modell muss nicht jedes Mal die komplette Parameterbasis „durcharbeiten“, sondern routet Eingaben zu einem Teil der Experten. Der Kontextspeicher wird mit 256.000 Tokens angegeben, dazu kommen Herstellerangaben zum Training zwischen März und August 2026 mit zwei Millionen synthetischen Aufgaben sowie 150.000 Reinforcement-Learning-Umgebungen. In der Praxis wirkt sich so ein Setup auf zwei Aspekte aus: die Fähigkeit, längere Codekontexte zu berücksichtigen, und die Stabilität bei wiederholten Iterationen, wie sie etwa im Pair-Programming-Workflow mit Copilot üblich sind.

Microsoft kombiniert den Effizienzanspruch mit messbaren Verbesserungen in der Nutzerinteraktion. Gegenüber dem Vorgängermodell nennt das Unternehmen eine um 25 Prozent gesteigerte Geschwindigkeit beim Token-Streaming sowie eine Reduktion der benötigten Tokens um ebenfalls 25 Prozent. Diese beiden Faktoren greifen in der Kostenrechnung zusammen: Weniger Tokens bedeuten weniger Rechenaufwand, schnelleres Streaming senkt zudem die wahrgenommene Latenz, was insbesondere bei Tool-orientierten Coding-Aufgaben den „Wait Time“-Anteil reduziert. Zusätzlich unterstützt das Modell nun Bildeingaben (Vision-Support), was vor allem dann hilfreich wird, wenn Code-Entscheidungen an Screenshots, UI-Elemente oder Diagrammkontexte gekoppelt sind. In den von Microsoft genannten Leistungstests verbessert sich das Modell bei Terminal-Bench 2.1 von 51,7 Prozent auf 62,9 Prozent; beim SWE-Bench Verified erreicht es 72,6 Prozent.

Für die Marktpositionierung liefert Microsoft auch den direkten Vergleich in Preis- und Leistungsdimensionen. Branchenbeobachter ordnen das Modell dabei als Konkurrenz zu DeepSeek-V4-Flash-0731 ein, das beim Terminal-Bench 2.1 mit 82,7 Prozent aktuell vorne liegen soll. Preislich setzt MAI-Code-1.1-Flash allerdings einen eigenen Akzent: Microsoft kalkuliert 0,20 US-Dollar für Input, 0,02 US-Dollar für gecachten Input und 1,20 US-Dollar für Output pro einer Million Tokens. Damit liegt das Modell preislich über dem genannten Konkurrenzprodukt, das mit 0,14 US-Dollar für Input und 0,28 US-Dollar für den Output beziffert wird. Das ist ein typisches Spannungsfeld: Höhere Effizienz und bessere Interaktion können die Gesamtstückkosten trotz höherer Output-Tarife reduzieren, während sich bei bestimmten Workload-Profilen auch der reine Token-Preis stärker bemerkbar macht. Die Einstellung des Vorgängermodells ist für den 10. September 2026 vorgesehen, was Unternehmen in der Planung von Modellen, Caches und Zugriffskonzepten zeitlich einordnet.

Die technische Umsetzung schlägt Microsoft auch in den Produktfluss: Das neue Coding-Modell wird unmittelbar in GitHub Copilot ausgerollt und soll in verschiedenen Umgebungen verfügbar sein, darunter Visual Studio, VS Code, JetBrains und GitHub Mobile. Für Nutzer mit Jahresabonnements greift dabei ein reduzierter Multiplikator für Anfragen, während in Business- und Enterprise-Versionen Administratoren die Nutzung über Policies aktiv freischalten müssen, weil sie standardmäßig deaktiviert ist. Damit adressiert Microsoft ein zentrales Unternehmensrisiko: Ohne klare Freigabe bleiben KI-Funktionen häufig entweder ungenutzt oder sie laufen ohne Governance in produktive Prozesse. Zusätzlich verweist Microsoft auf interne Metriken, nach denen die Code-Akzeptanzrate durch das neue Modell um 4 Prozent gestiegen sein soll. Für Teams heißt das: Der Nutzen zeigt sich nicht nur in Benchmarks, sondern auch daran, dass vorgeschlagener Code schneller in den Entwicklungsfluss übernommen wird.

Parallel zur Modell- und Produktintegration verknüpft Microsoft die Effizienzarbeit mit einer eigenen Hardware-Strategie. Das Unternehmen verhandelt derzeit mit Anthropic über Serverkapazitäten, die mit dem hauseigenen Maia-200-KI-Chip ausgestattet sind. Der Chip befinde sich seit Anfang des Jahres in Produktion, und Microsoft erwartet eine Effizienzsteigerung pro US-Dollar um mehr als 30 Prozent. Die entsprechenden Rechenzentren sollen in Arizona und Iowa liegen. Solche Entscheidungen sind für die praktische Kostenrechnung entscheidend, weil die Inferenzkosten nicht nur aus „Modelltarifen“ bestehen, sondern aus einem Mix von Rechenzeit, Auslastung, Speicherkosten und Netzwerk-Overheads. Genau deshalb wirkt MoE-Design in Kombination mit eigener Hardware oft besonders stark: Eine effizientere Architektur lässt sich leichter in eine optimierte Serving-Infrastruktur übersetzen.

Damit rückt auch der Sicherheitsaspekt in den Vordergrund. Microsoft berichtet im Rahmen des aktuellen Patchday von über 400 behobenen Schwachstellen in Produkten wie Windows 11, Office und Azure, mit besonderem Augenmerk auf eine aktiv ausgenutzte Zero-Day-Lücke im Bereich der Privilegieneskalation. Weitere reguläre Sicherheitsupdates sind für den 9. September 2026 angekündigt. Für Betreiber von Entwicklungsumgebungen und Copilot-nahen Workflows ist das relevant, weil KI-gestützte Tools typischerweise in die Toolchain eingebunden sind und Angriffsflächen damit eher „seitlich“ wachsen: Nicht die KI selbst ist der einzige Angriffspunkt, sondern IDE-Plugins, Authentifizierung, Integrationen in Repositories und die sichere Ausführung von Zusatzdiensten. Genau hier treffen sich Effizienz- und Sicherheitsagenda, denn steigende Nutzung erhöht die Häufigkeit, mit der Systeme erreicht und beobachtet werden.

Unterm Strich ist MAI-Code-1.1-Flash ein Update, das auf Kosten senken, Latenz verbessern und die Interaktion mit Entwickler-Workflows beschleunigen zielt. Die Kombination aus Sparse-MoE-Routing (138 Milliarden Parameter, 5 Milliarden aktiv), Token-Streaming-Gewinn und einer klaren Preislogik schafft eine Grundlage, um Coding-Use-Cases in der Unternehmenspraxis wirtschaftlicher zu machen. Gleichzeitig bleibt die Architekturentscheidung bei Vision-Support und die Governance in GitHub Copilot ein Signal: Microsoft denkt KI nicht nur als Modell, sondern als Betriebsbaustein in einer vollständigen Produkt- und Sicherheitskette. Wer jetzt plant, sollte die Umstellung vom Vorgängermodell berücksichtigen, Policies für den Enterprise-Zugang sauber ausrollen und die Patch- und Update-Strategie mit Blick auf die Toolchain enger mit der KI-Nutzung verzahnen.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
1.501 Bewertungen
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
  • 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent".
Stichwörter AI Artificial Intelligence Azure Coding Github-copilot KI Künstliche Intelligenz Microsoft Moe Sicherheitsupdates Sparse-mixture-of-experts Token-streaming Vision Zero-Day
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »MAI-Code-1.1-Flash: Microsoft senkt KI-Kosten um 75 Prozent« bei Google Deutschland suchen, bei Bing oder Google News!


    933 Leser gerade online auf IT BOLTWISE
    KI-Jobs