Werkplek van een softwareontwikkelaar met meerdere schermen vol code.
Nieuws13 augustus · 22:114 min leestijd

Google lanceert Gemini 3.7 Flash en halveert de tokenprijs tot 1 januari

Google brengt Gemini 3.7 Flash uit voor de helft van de prijs van zijn drie weken oude voorganger. Die korting vervalt op 31 december 2026, waarna het tarief weer verdubbelt.

Google lanceert Gemini 3.7 Flash met een introductieprijs van 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens, de helft van wat zijn drie weken oude voorganger kost, meldt het bedrijf op zijn eigen blog.

Voor wie Flash in een codeerassistent of een agentworkflow draait, zakt de tokenrekening daarmee vandaag met de helft. Die prijs heeft alleen een einddatum. Google zet er zelf bij dat het introductietarief op 31 december 2026 vervalt en dat vanaf 1 januari 2027 weer 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens geldt. Bouw je je businesscase nu op 0,75 dollar, dan verdubbelt die post over vier en een halve maand vanzelf.

Dezelfde listprijs als drie weken geleden

Het reguliere tarief van 3.7 Flash is precies het tarief waarvoor Gemini 3.6 Flash op 21 juli verscheen: 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens. De structurele prijs beweegt dus niet. Wat je krijgt is een beter model voor hetzelfde geld, met vier en een halve maand halve prijs erbovenop.

Dat onderscheid telt bij het inkopen. Een agent die dag in dag uit draait is geen experiment van een maand, maar een vaste regel op je rekening. De vraag om nu te beantwoorden is niet of 0,75 dollar goedkoop is, maar of het werk dat je erop zet ook bij 1,50 dollar rendeert.

Wat het model beter doet

De winst zit in code en in langlopende taken. Op FrontierCode 1.1 Main, Googles eigen meting van productiecodekwaliteit, gaat 3.7 Flash van 34,4 naar 43,6 procent. Daarmee komt het boven Claude Sonnet 5 (42,7 procent) en GPT-5.6 Terra (41,3 procent) uit.

Op DeepSWE V1.1, dat langlopend software-engineeringwerk meet, springt de score van 48,6 naar 65,3 procent. Daar wint 3.7 Flash het wel van Claude Sonnet 5 met 53,8 procent, maar niet van GPT-5.6 Terra, dat op 69,6 procent blijft staan. Google noemt 3.7 Flash zelf zijn slimste werkpaardmodel voor code en agents, niet zijn beste model. Dat verschil is eerlijk en het is ook de kern van deze release: dit is het model dat je in volume draait, niet het model dat je bewaart voor de moeilijkste vraag.

Verder meldt Google 1588 Elo op WebDev Arena tegen 1538 voor 3.6 Flash, en 30,4 procent tegen 17,0 procent op AutomationBench, dat kantoortaken meet. De sprong komt niet van meer rekenkracht maar van algoritmische verbeteringen, doorgevoerd in drie weken tijd.

Waar je het model kunt draaien

Ontwikkelaars krijgen 3.7 Flash via de Gemini API, Google AI Studio, Android Studio en Google Antigravity. Organisaties kunnen erbij via het Gemini Enterprise Agent Platform en de Gemini Enterprise-app. Abonnees van Google AI Pro en Ultra zien het model in Gemini Spark, in ruim 160 landen.

Drie weken tussen twee generaties Flash is het eigenlijke nieuws onder die prijs. Het model dat je vorige maand koos is nu een generatie oud, en het tarief waarop je toen rekende is niet meer het tarief van vandaag. Dat patroon staat niet op zichzelf: Microsoft zette twee dagen geleden MAI-Code-1.1-Flash in GitHub Copilot met een listprijs die 73 procent onder die van zijn voorganger ligt, en op Vercels AI Gateway daalde de gemiddelde prijs per token in juli met 13,6 procent.

In zo'n markt is het duurste wat je kunt doen je software vastknopen aan één modelnaam. Wie de modelaanroepen achter een eigen laag houdt, pakt de volgende halvering mee zonder de applicatie open te breken. De korting van vandaag is tijdelijk. Het tempo waarin deze modellen elkaar opvolgen is dat niet.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Bouw op modellen, niet op modelnamen

Prijzen halveren om de paar weken, dus ik zorg dat je software daar niet aan vastzit: ik denk mee over de opzet, ontwerp de laag tussen jouw applicatie en het model, en bouw en automatiseer hem ook. Self-hosted waar dat kan, zodat je van leverancier kunt wisselen zonder je product open te breken.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Google lanceert Gemini 3.8 Flash tegen dezelfde tokenprijs
Nieuws
5 min

2 sep 20:08

Google lanceert Gemini 3.8 Flash tegen dezelfde tokenprijs

Google brengt Gemini 3.8 Flash uit tegen exact dezelfde tokenprijs als 3.7 Flash. Het model scoort hoger op vrijwel elke benchmark, maar verbruikt meer tokens per taak, waardoor de rekening per opdracht juist oploopt.

Google lanceert goedkopere Gemini Flash-modellen en een AI die kwetsbaarheden zelf patcht
Nieuws
3 min

21 jul 18:10

Google lanceert goedkopere Gemini Flash-modellen en een AI die kwetsbaarheden zelf patcht

Google verlaagt met Gemini 3.6 Flash en 3.5 Flash-Lite de prijs van AI-code en lanceert 3.5 Flash Cyber, een model dat softwarelekken zelfstandig opspoort en patcht, voorlopig alleen voor overheden en vertrouwde partners.

Google laat Gemini zelf door video zoeken en bespaart tot 88 procent tokens
Nieuws
4 min

2 sep 12:19

Google laat Gemini zelf door video zoeken en bespaart tot 88 procent tokens

Gemini 3.7 Flash, 3.6 Flash en 3.5 Flash-Lite kiezen voortaan zelf welke videofragmenten ze bekijken. Google meet tot 88 procent minder tokens en tot 66 procent lagere analysekosten per vraag.

Google lanceert Gemini Omni 1.1 Flash, maar eigen video bewerken kan niet in de EER
Nieuws
5 min

28 aug 04:14

Google lanceert Gemini Omni 1.1 Flash, maar eigen video bewerken kan niet in de EER

Gemini Omni 1.1 Flash is algemeen beschikbaar via de Gemini API, met scenes tot veertig seconden, 4K en tarieven van 0,03 tot 0,30 dollar per seconde. Het bewerken van eigen geuploade video blijft in de EER uitgeschakeld.

Google lanceert Gemini 3.5 Transcribe met Nederlands in de API
Nieuws
5 min

27 aug 00:35

Google lanceert Gemini 3.5 Transcribe met Nederlands in de API

Google brengt Gemini 3.5 Transcribe uit, een spraak-naar-tekstmodel dat vulwoorden weghaalt en tekst opmaakt. Nederlands werkt via de API, de consumentenkanalen blijven voorlopig Engels. Kosten: ongeveer 30 dollarcent per uur audio.

Google's Gemini Spark landt op de Mac en mag nu aan je lokale bestanden
Nieuws
6 min

2 jul 18:09

Google's Gemini Spark landt op de Mac en mag nu aan je lokale bestanden

Google brengt zijn autonome AI-agent Gemini Spark naar macOS, waar hij voor het eerst lokale bestanden mag lezen en ordenen. Met MCP-ondersteuning, real-time tracking en een prijskaartje van 99 dollar per maand.