Iemand typt code op een laptop.
Nieuws12 augustus · 08:224 min leestijd

Microsoft zet MAI-Code-1.1-Flash in GitHub Copilot, 73 procent goedkoper dan zijn voorganger

Microsoft zet MAI-Code-1.1-Flash in GitHub Copilot, met een listprijs die 73 procent onder die van zijn voorganger ligt. Wat het model kost, wat het kan, en waarom het bij Business en Enterprise standaard uit staat.

Microsoft zet MAI-Code-1.1-Flash in GitHub Copilot, een eigen codeermodel met een listprijs die 73 procent onder die van zijn voorganger ligt, meldt GitHub in zijn changelog van 11 augustus 2026.

Voor een ontwikkelteam dat op Copilot draait verandert daarmee de rekensom onder de modelkiezer. Copilot rekent dit model af tegen de listprijs van de aanbieder onder verbruiksfacturering, en voor wie een jaarabonnement heeft geldt een premium request multiplier van 0,25: vier verzoeken op MAI-Code-1.1-Flash tellen dan als één premium request. Het goedkoopste model in de picker komt daarmee van Microsoft zelf, niet van OpenAI of Anthropic.

De prijs, in cijfers

MAI-Code-1.1-Flash kost 0,20 dollar per miljoen invoertokens, 0,02 dollar voor gecachete invoer en 1,20 dollar per miljoen uitvoertokens, staat in het prijsoverzicht van GitHub. Bij MAI-Code-1-Flash, het model dat Microsoft in juni op Build lanceerde, is dat 0,75, 0,075 en 4,50 dollar. Aan de invoer- en de uitvoerkant komt het op hetzelfde neer: een kwart van de oude prijs.

Het effect stapelt, want het model verbruikt ook minder. Microsoft meet dat MAI-Code-1.1-Flash 25 procent minder tokens nodig heeft om een taak af te maken en tokens 25 procent sneller streamt in Copilot. Goedkopere tokens en minder tokens per taak landen allebei op dezelfde regel van je factuur.

De modelkiezer van GitHub Copilot met MAI-Code-1.1-Flash aangevinkt, tussen MAI-Code-1-Flash en Claude Haiku 4.5. Bron: GitHub
De modelkiezer van GitHub Copilot met MAI-Code-1.1-Flash aangevinkt, tussen MAI-Code-1-Flash en Claude Haiku 4.5. Bron: GitHub

Wat je ervoor terugkrijgt

Op SWE-Bench Verified haalt het model een slaagpercentage van 72,6 tegen 71,6 voor de voorganger, met 8,6 duizend tokens per taak in plaats van 10,8 duizend. Op Terminal Bench 2.1 is het gat groter: 62,9 tegen 51,7. In dezelfde tabel zet Microsoft Claude Haiku 4.5 op 69,8 en 49,4 en GPT 5.4 mini op 69,2 en 60,7.

Nieuw is dat het model beeld leest. Een screenshot van een kapot scherm, een diagram of een ontwerp kan er als invoer in. Onder de motorkap zit een Mixture-of-Experts-model met 138 miljard parameters, waarvan er 5 miljard per token actief zijn, een contextvenster van 256.000 tokens en een pretraining-grens van december 2025. Microsoft trainde het met dezelfde Copilot-opstelling die in productie draait, en meet daar dat code van het model 4 procent vaker blijft staan en dat gebruikers 9 procent vaker terugkomen. De modelkaart noemt Engels als enige ondersteunde taal.

Standaard uit bij Business en Enterprise

Copilot Free en Student krijgen het model via automatische modelkeuze. Pro, Pro+, Max, Business en Enterprise kunnen het ook handmatig kiezen, in Visual Studio Code, Visual Studio, JetBrains, Eclipse, Xcode, GitHub Mobile, de Copilot CLI, de cloud-agent en Copilot Chat op GitHub. Bij Business en Enterprise moet een beheerder de policy eerst aanzetten, want die staat standaard uit.

Dat aan-uit-patroon is inmiddels de norm voor nieuwe modellen in Copilot. Ook toen Kimi K2.7 Code als eerste open-weight model in de Copilot-modelkeuze belandde, stond het bij die abonnementen uit tot een beheerder het vrijgaf. Modelkeuze is daar geen voorkeur van een ontwikkelaar, maar een beleidsknop.

Waar dit naartoe wijst

Het is de zoveelste plek waar Microsoft zijn eigen modellen tussen de dure inkoop schuift. In Excel en Outlook namen de MAI-modellen begin juli werk over van OpenAI en Anthropic, goed voor tienduizenden AI-opdrachten per week, en intern kregen de eigen engineers een tokenbudget en het goedkopere GPT-5.6 als standaardmodel. Elke stap wijst dezelfde kant op: het duurste model is niet langer het vanzelfsprekende standaardmodel, ook niet bij de partij die AI-capaciteit verkoopt.

Voor wie Copilot-seats afneemt betekent dat vooral dat de goedkoopste optie in de kiezer sneller verschuift dan het abonnement eromheen. Het model dat vorige maand de beste prijs-kwaliteitverhouding had, is dat deze maand misschien niet meer, en het verschil zit inmiddels in een factor vier op de tokenprijs. Wie zijn AI-rekening wil drukken, kijkt dus niet één keer naar de modelkiezer, maar zet die controle op de kalender.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Modelkeuze die geld scheelt

Ik help je van meedenken tot realiseren de juiste modellen achter je eigen tools te zetten, en zo te bouwen dat je zonder verbouwing kunt wisselen als de prijs omslaat. Self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Kimi K2.7 Code nu kiesbaar in GitHub Copilot: eerste open-weight model in de modelkeuze
Nieuws
6 min

3 jul 04:10

Kimi K2.7 Code nu kiesbaar in GitHub Copilot: eerste open-weight model in de modelkeuze

GitHub heeft Kimi K2.7 Code algemeen beschikbaar gemaakt in de Copilot-modelkeuze. Het is het eerste open-weight model in de picker, fors goedkoper dan de frontier-modellen, en je devteam kan vandaag overstappen zonder tooling te wijzigen.

Onderzoekers lezen verborgen AI-redeneringen uit en vinden 182 credentials in publieke logs
Nieuws
5 min

11 aug 20:24

Onderzoekers lezen verborgen AI-redeneringen uit en vinden 182 credentials in publieke logs

Onderzoekers van de Universiteit Tübingen en Snyk ontcijferden de verborgen denkstappen van Claude, GPT en Gemini via de API's zelf. In publieke agent-logs vonden ze 62 API-sleutels en 33 wachtwoorden.

Agent Plugins 1.0 maakt agentuitbreidingen draagbaar tussen ChatGPT, Copilot en VS Code
Nieuws
4 min

7 aug 12:24

Agent Plugins 1.0 maakt agentuitbreidingen draagbaar tussen ChatGPT, Copilot en VS Code

Amazon, Cursor, Microsoft, OpenAI en Vercel publiceerden een open pakketformaat voor Agent Skills en MCP-servers. Google sluit aan als core maintainer. Je bouwt een agentuitbreiding voortaan een keer, niet per client.

Microsoft legt eigen engineers een tokenbudget op en zet goedkoper model als standaard
Nieuws
4 min

5 aug 00:39

Microsoft legt eigen engineers een tokenbudget op en zet goedkoper model als standaard

Microsoft legt zijn engineers een tokenbudget op en zet het goedkopere GPT-5.6 als standaardmodel. Uit de interne mail van EVP Jay Parikh blijkt ook hoeveel een engineer maandelijks aan tokens verstookt.

Microsoft overweegt eigen AI-modellen als open weights vrij te geven
Nieuws
4 min

30 jul 18:16

Microsoft overweegt eigen AI-modellen als open weights vrij te geven

Microsoft AI-baas Mustafa Suleyman zegt tegen Nikkei dat het bedrijf overweegt een deel van zijn eigen MAI-modellen als open weights uit te brengen, om Chinese open modellen te counteren en minder van OpenAI af te hangen.

Wiz lanceert Atlas, een AI-agent die elk lek met een werkende exploit bewijst
Nieuws
5 min

29 jul 10:26

Wiz lanceert Atlas, een AI-agent die elk lek met een werkende exploit bewijst

Wiz brengt Atlas uit, een autonome AI-agent die kwetsbaarheden opspoort en elke vondst met een werkende exploit bewijst. Op de openbare CyberGym-ranglijst van UC Berkeley staat het systeem bovenaan met 90,9 procent.