Werkplek van een softwareontwikkelaar met meerdere schermen vol code.
Nieuws13 augustus · 22:114 min leestijd

Google lanceert Gemini 3.7 Flash en halveert de tokenprijs tot 1 januari

Google brengt Gemini 3.7 Flash uit voor de helft van de prijs van zijn drie weken oude voorganger. Die korting vervalt op 31 december 2026, waarna het tarief weer verdubbelt.

Google lanceert Gemini 3.7 Flash met een introductieprijs van 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens, de helft van wat zijn drie weken oude voorganger kost, meldt het bedrijf op zijn eigen blog.

Voor wie Flash in een codeerassistent of een agentworkflow draait, zakt de tokenrekening daarmee vandaag met de helft. Die prijs heeft alleen een einddatum. Google zet er zelf bij dat het introductietarief op 31 december 2026 vervalt en dat vanaf 1 januari 2027 weer 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens geldt. Bouw je je businesscase nu op 0,75 dollar, dan verdubbelt die post over vier en een halve maand vanzelf.

Dezelfde listprijs als drie weken geleden

Het reguliere tarief van 3.7 Flash is precies het tarief waarvoor Gemini 3.6 Flash op 21 juli verscheen: 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens. De structurele prijs beweegt dus niet. Wat je krijgt is een beter model voor hetzelfde geld, met vier en een halve maand halve prijs erbovenop.

Dat onderscheid telt bij het inkopen. Een agent die dag in dag uit draait is geen experiment van een maand, maar een vaste regel op je rekening. De vraag om nu te beantwoorden is niet of 0,75 dollar goedkoop is, maar of het werk dat je erop zet ook bij 1,50 dollar rendeert.

Wat het model beter doet

De winst zit in code en in langlopende taken. Op FrontierCode 1.1 Main, Googles eigen meting van productiecodekwaliteit, gaat 3.7 Flash van 34,4 naar 43,6 procent. Daarmee komt het boven Claude Sonnet 5 (42,7 procent) en GPT-5.6 Terra (41,3 procent) uit.

Op DeepSWE V1.1, dat langlopend software-engineeringwerk meet, springt de score van 48,6 naar 65,3 procent. Daar wint 3.7 Flash het wel van Claude Sonnet 5 met 53,8 procent, maar niet van GPT-5.6 Terra, dat op 69,6 procent blijft staan. Google noemt 3.7 Flash zelf zijn slimste werkpaardmodel voor code en agents, niet zijn beste model. Dat verschil is eerlijk en het is ook de kern van deze release: dit is het model dat je in volume draait, niet het model dat je bewaart voor de moeilijkste vraag.

Verder meldt Google 1588 Elo op WebDev Arena tegen 1538 voor 3.6 Flash, en 30,4 procent tegen 17,0 procent op AutomationBench, dat kantoortaken meet. De sprong komt niet van meer rekenkracht maar van algoritmische verbeteringen, doorgevoerd in drie weken tijd.

Waar je het model kunt draaien

Ontwikkelaars krijgen 3.7 Flash via de Gemini API, Google AI Studio, Android Studio en Google Antigravity. Organisaties kunnen erbij via het Gemini Enterprise Agent Platform en de Gemini Enterprise-app. Abonnees van Google AI Pro en Ultra zien het model in Gemini Spark, in ruim 160 landen.

Drie weken tussen twee generaties Flash is het eigenlijke nieuws onder die prijs. Het model dat je vorige maand koos is nu een generatie oud, en het tarief waarop je toen rekende is niet meer het tarief van vandaag. Dat patroon staat niet op zichzelf: Microsoft zette twee dagen geleden MAI-Code-1.1-Flash in GitHub Copilot met een listprijs die 73 procent onder die van zijn voorganger ligt, en op Vercels AI Gateway daalde de gemiddelde prijs per token in juli met 13,6 procent.

In zo'n markt is het duurste wat je kunt doen je software vastknopen aan één modelnaam. Wie de modelaanroepen achter een eigen laag houdt, pakt de volgende halvering mee zonder de applicatie open te breken. De korting van vandaag is tijdelijk. Het tempo waarin deze modellen elkaar opvolgen is dat niet.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Bouw op modellen, niet op modelnamen

Prijzen halveren om de paar weken, dus ik zorg dat je software daar niet aan vastzit: ik denk mee over de opzet, ontwerp de laag tussen jouw applicatie en het model, en bouw en automatiseer hem ook. Self-hosted waar dat kan, zodat je van leverancier kunt wisselen zonder je product open te breken.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Google lanceert goedkopere Gemini Flash-modellen en een AI die kwetsbaarheden zelf patcht
Nieuws
3 min

21 jul 18:10

Google lanceert goedkopere Gemini Flash-modellen en een AI die kwetsbaarheden zelf patcht

Google verlaagt met Gemini 3.6 Flash en 3.5 Flash-Lite de prijs van AI-code en lanceert 3.5 Flash Cyber, een model dat softwarelekken zelfstandig opspoort en patcht, voorlopig alleen voor overheden en vertrouwde partners.

Google's Gemini Spark landt op de Mac en mag nu aan je lokale bestanden
Nieuws
6 min

2 jul 18:09

Google's Gemini Spark landt op de Mac en mag nu aan je lokale bestanden

Google brengt zijn autonome AI-agent Gemini Spark naar macOS, waar hij voor het eerst lokale bestanden mag lezen en ordenen. Met MCP-ondersteuning, real-time tracking en een prijskaartje van 99 dollar per maand.

Google lanceert Gemini 3.1 Flash-Lite en Omni Flash: beeldgeneratie in 4 seconden en video-AI via de API
Nieuws
4 min

30 jun 20:11

Google lanceert Gemini 3.1 Flash-Lite en Omni Flash: beeldgeneratie in 4 seconden en video-AI via de API

Google maakt hoge-volume beeldgeneratie en gespreksgestuurde videoproductie betaalbaar: Nano Banana 2 Lite genereert beelden in 4 seconden voor $0,034, Gemini Omni Flash maakt video bewerken via een tekstinstructie mogelijk voor $0,10 per seconde.

Gemini-app passeert een miljard maandelijkse gebruikers
Nieuws
4 min

11 aug 22:24

Gemini-app passeert een miljard maandelijkse gebruikers

De Gemini-app telt een miljard maandelijkse gebruikers, evenveel als ChatGPT. Interessanter dan het getal is wat eronder ligt: wie Workspace Business of Enterprise afneemt, betaalt al voor deze assistent.

Google dicht 1.072 Chrome-lekken in twee releases met AI-hulp
Nieuws
3 min

31 jul 12:39

Google dicht 1.072 Chrome-lekken in twee releases met AI-hulp

Google dicht 1.072 beveiligingslekken in Chrome 149 en 150, meer dan in de 23 versies ervoor samen, en schrijft dat toe aan AI-agents. Tegelijk gaat de browser naar wekelijkse beveiligingsupdates.

Oracle wil Gemini-modellen inbouwen in Fusion Applications en NetSuite
Nieuws
4 min

30 jul 22:24

Oracle wil Gemini-modellen inbouwen in Fusion Applications en NetSuite

Oracle wil Google's Gemini-modellen beschikbaar maken in Oracle AI Agent Studio en ze inzetten voor ingebouwde AI in Fusion Applications en NetSuite. Er staat geen datum, geen prijs en geen woord over dataverwerking in het persbericht.