Google lanceert Gemini 3.7 Flash met een introductieprijs van 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens, de helft van wat zijn drie weken oude voorganger kost, meldt het bedrijf op zijn eigen blog.
Voor wie Flash in een codeerassistent of een agentworkflow draait, zakt de tokenrekening daarmee vandaag met de helft. Die prijs heeft alleen een einddatum. Google zet er zelf bij dat het introductietarief op 31 december 2026 vervalt en dat vanaf 1 januari 2027 weer 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens geldt. Bouw je je businesscase nu op 0,75 dollar, dan verdubbelt die post over vier en een halve maand vanzelf.
Dezelfde listprijs als drie weken geleden
Het reguliere tarief van 3.7 Flash is precies het tarief waarvoor Gemini 3.6 Flash op 21 juli verscheen: 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens. De structurele prijs beweegt dus niet. Wat je krijgt is een beter model voor hetzelfde geld, met vier en een halve maand halve prijs erbovenop.
Dat onderscheid telt bij het inkopen. Een agent die dag in dag uit draait is geen experiment van een maand, maar een vaste regel op je rekening. De vraag om nu te beantwoorden is niet of 0,75 dollar goedkoop is, maar of het werk dat je erop zet ook bij 1,50 dollar rendeert.
Wat het model beter doet
De winst zit in code en in langlopende taken. Op FrontierCode 1.1 Main, Googles eigen meting van productiecodekwaliteit, gaat 3.7 Flash van 34,4 naar 43,6 procent. Daarmee komt het boven Claude Sonnet 5 (42,7 procent) en GPT-5.6 Terra (41,3 procent) uit.
Op DeepSWE V1.1, dat langlopend software-engineeringwerk meet, springt de score van 48,6 naar 65,3 procent. Daar wint 3.7 Flash het wel van Claude Sonnet 5 met 53,8 procent, maar niet van GPT-5.6 Terra, dat op 69,6 procent blijft staan. Google noemt 3.7 Flash zelf zijn slimste werkpaardmodel voor code en agents, niet zijn beste model. Dat verschil is eerlijk en het is ook de kern van deze release: dit is het model dat je in volume draait, niet het model dat je bewaart voor de moeilijkste vraag.
Verder meldt Google 1588 Elo op WebDev Arena tegen 1538 voor 3.6 Flash, en 30,4 procent tegen 17,0 procent op AutomationBench, dat kantoortaken meet. De sprong komt niet van meer rekenkracht maar van algoritmische verbeteringen, doorgevoerd in drie weken tijd.
Waar je het model kunt draaien
Ontwikkelaars krijgen 3.7 Flash via de Gemini API, Google AI Studio, Android Studio en Google Antigravity. Organisaties kunnen erbij via het Gemini Enterprise Agent Platform en de Gemini Enterprise-app. Abonnees van Google AI Pro en Ultra zien het model in Gemini Spark, in ruim 160 landen.
Drie weken tussen twee generaties Flash is het eigenlijke nieuws onder die prijs. Het model dat je vorige maand koos is nu een generatie oud, en het tarief waarop je toen rekende is niet meer het tarief van vandaag. Dat patroon staat niet op zichzelf: Microsoft zette twee dagen geleden MAI-Code-1.1-Flash in GitHub Copilot met een listprijs die 73 procent onder die van zijn voorganger ligt, en op Vercels AI Gateway daalde de gemiddelde prijs per token in juli met 13,6 procent.
In zo'n markt is het duurste wat je kunt doen je software vastknopen aan één modelnaam. Wie de modelaanroepen achter een eigen laag houdt, pakt de volgende halvering mee zonder de applicatie open te breken. De korting van vandaag is tijdelijk. Het tempo waarin deze modellen elkaar opvolgen is dat niet.
Veelgestelde vragen
Bouw op modellen, niet op modelnamen
Prijzen halveren om de paar weken, dus ik zorg dat je software daar niet aan vastzit: ik denk mee over de opzet, ontwerp de laag tussen jouw applicatie en het model, en bouw en automatiseer hem ook. Self-hosted waar dat kan, zodat je van leverancier kunt wisselen zonder je product open te breken.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
