Bureau met een smartphone en financiële grafieken, gebruikt voor kosten- en uitgavenberekeningen
Nieuws30 juli · 20:314 min leestijd

OpenAI verlaagt prijs GPT-5.6 Luna met 80 procent, Terra met 20 procent

OpenAI verlaagt de API-prijs van GPT-5.6 Luna met 80 procent en Terra met 20 procent. Daarmee wordt Terra ineens tien keer zo duur als Luna in plaats van 2,5 keer, en verschuift de rekensom voor elke agent-workflow.

OpenAI verlaagt vanaf vandaag de API-prijs van GPT-5.6 Luna met 80 procent en die van Terra met 20 procent, maakt het bedrijf zelf bekend. Topmodel Sol houdt zijn tarief.

Het gewicht zit niet in de korting zelf, maar in wat die doet met de onderlinge verhouding. Bij de lancering kostte Terra 2,5 keer zoveel als Luna en Sol vijf keer zoveel. Vanaf vandaag is Terra tien keer zo duur als Luna en Sol vijfentwintig keer. Draai je een agentproces waarin stappen als vanzelf op Terra of Sol landen, dan is het prijsverschil met de goedkoopste variant sinds vanochtend vier tot vijf keer groter dan het drie weken geleden was.

De nieuwe tarieven

Per miljoen tokens rekent OpenAI vanaf 30 juli 2 dollar invoer en 12 dollar uitvoer voor Terra, en 0,20 en 1,20 dollar voor Luna. Bij de brede uitrol op 9 juli, toen Terra nog 2,50 en 15 dollar kostte en Luna 1 en 6 dollar, lagen die tarieven dus aanzienlijk hoger. Sol blijft op 5 en 30 dollar staan.

API-prijs GPT-5.6 per miljoen tokens, voor en na 30 juli 2026, in dollar (bron: OpenAI)

Een agentproces dat maandelijks 50 miljoen invoer- en 10 miljoen uitvoertokens verstookt, kostte op Luna 110 dollar en kost nu 22. Dezelfde workload op Terra zakt van 275 naar 220 dollar. Wie hem op Sol laat lopen betaalt onveranderd 550 dollar.

De verlaging blijft niet beperkt tot de API. In Codex en ChatGPT Work verbruikt gebruik van Terra en Luna vanaf nu minder credits, terwijl de abonnementsprijzen en de quota gelijk blijven. In de praktijk kun je op hetzelfde abonnement dus meer werk doen. De nieuwe prijzen rollen later vandaag ook uit op AWS.

Waar de rekensom kantelt

Met een factor tien tussen Terra en Luna wordt de vraag welk model welke stap doet ineens een kostenpost in plaats van een technische voorkeur. OpenAI schetst in de aankondiging zelf het patroon: laat Sol de onzekerheid wegnemen en het plan bepalen, en laat Luna de goed omschreven wijzigingen uitvoeren, tests schrijven en de uitkomst beoordelen.

De klanten die OpenAI aan het woord laat, zetten daar getallen bij. Notion meet met Terra vergelijkbare kwaliteit als GPT-5.5 tegen de helft van de kosten per taak en in 60 procent minder tijd. Ontwikkeltool Blitzy zag het hergebruik van zijn prompt-cache stijgen van 24 naar 90 procent en verwerkt met Luna 2,2 keer meer context met 8,5 keer minder uitvoertokens, tegen 87 procent lagere kosten dan met GPT-5.4 mini. Dust noemt Luna 40 procent sneller en 40 procent goedkoper dan zijn vorige standaardmodel.

Dat zijn cijfers van klanten die OpenAI zelf selecteerde, dus ze wijzen een richting aan en bewijzen niets over jouw werk. Datzelfde voorbehoud gold in juli al voor de tokenclaims rond Sol, die onafhankelijke testers niet konden reproduceren. De verstandige volgorde blijft: neem een representatieve steekproef van je eigen taken, draai die op het goedkopere model en meet de kwaliteit voordat je de routering omzet.

Prijsdruk van twee kanten

De timing is geen toeval. OpenAI verlaagt de prijzen terwijl bedrijven kritischer naar hun AI-rekening kijken, meldt Reuters, en terwijl open-source Chinese concurrenten als Z.ai's GLM-5.2 die prestaties tegen lagere kosten dicht benaderen terrein winnen. Dat model klopte GPT-5.5 op meerdere langlopende coding-benchmarks voor ongeveer een zesde van de prijs, met vrij downloadbare gewichten onder een MIT-licentie.

De druk gaat ook de andere kant op. Luna komt met 0,20 dollar invoer ruwweg vijf keer onder Anthropics Claude Haiku 4.5 te liggen, en Terra duikt onder de tarieven die Anthropic per 31 augustus voor Claude Sonnet 5 hanteert. Analisten waarschuwen volgens Reuters dat zulke rondes het gebruik opdrijven maar de financiën van beide labs uithollen, vlak voor de beursgangen waar de markt op wacht.

Het kantoorgebouw aan 1515 Third Street in San Francisco, waar OpenAI zijn hoofdkantoor heeft. Bron: Coolcaesar / Wikimedia Commons (CC BY 4.0)
Het kantoorgebouw aan 1515 Third Street in San Francisco, waar OpenAI zijn hoofdkantoor heeft. Bron: Coolcaesar / Wikimedia Commons (CC BY 4.0)

Sol wordt niet goedkoper, wel sneller

Aan de bovenkant kiest OpenAI voor snelheid in plaats van korting. Fast mode vervangt het oude Priority Processing in de API en levert voor Sol tot 2,5 keer hogere snelheid dan standaardverwerking, tegen het dubbele tarief en zonder verschil in kwaliteit. Bestaande verzoeken met het label priority schakelen automatisch over, dus daar hoef je niets voor aan te passen.

De reden achter de verlaging noemt OpenAI expliciet technisch: Sol herschreef binnen een door mensen aangestuurd proces productiekernels en draaide honderden experimenten, wat de kosten om het model te bedienen met 20 procent drukte en de efficiëntie van tokengeneratie met ruim 15 procent verbeterde. Die winst geeft het bedrijf nu door.

Wat deze stap markeert

De scheiding is het echte nieuws. De prijs van het topmodel staat stil, terwijl de goedkoopste laag met 80 procent onderuit gaat. Daarmee verplaatst de concurrentie zich van de vraag welk model het slimst is naar de vraag wat een afgerond resultaat kost, en dat is precies het terrein waar de Chinese open-weight modellen al een jaar duwen.

Voor wie AI in productie draait, betekent dat vooral dat de waarde van een model-agnostische opzet weer toeneemt. Een architectuur waarin je per stap een ander model kunt aanwijzen, incasseert elke prijsronde vanzelf. Zit je vastgeklonken aan één model omdat je prompts, tools en evaluaties daaromheen zijn gebouwd, dan gaat een korting van 80 procent aan je voorbij tot je die verbouwing alsnog doet.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Kiezen per stap, niet per leverancier

Ik denk met je mee over waar in je proces een goedkoper model volstaat en waar je het zware werk nodig hebt, en bouw de routering zo dat je bij elke prijsronde gewoon kunt omschakelen. Van ontwerp tot werkende automatisering, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

OpenAI brengt GPT-5.6 Sol breed uit en claimt 54 procent minder tokens op agentic coding
Nieuws
3 min

9 jul 18:24

OpenAI brengt GPT-5.6 Sol breed uit en claimt 54 procent minder tokens op agentic coding

OpenAI heeft topmodel GPT-5.6 Sol breed uitgebracht via ChatGPT, de API en Codex. Sam Altman noemt het 54 procent zuiniger op agentic coding-taken, maar onafhankelijke tests laten zien waarom je dat cijfer beter zelf controleert.

Hugging Face zet Chinees GLM-5.2 in om inbraak te analyseren nadat Amerikaanse modellen weigeren
Nieuws
4 min

22 jul 22:11

Hugging Face zet Chinees GLM-5.2 in om inbraak te analyseren nadat Amerikaanse modellen weigeren

Hugging Face gebruikte het Chinese open model GLM-5.2 van Z.ai om de recente inbraak op zijn systemen te ontleden, nadat toonaangevende Amerikaanse AI-modellen de cybertaak weigerden. Een concreet voorbeeld van wat dichtgetimmerde modellen kosten voor wie zich moet verdedigen.

Moonshot lanceert Kimi K3, het grootste open AI-model ter wereld
Nieuws
4 min

18 jul 06:11

Moonshot lanceert Kimi K3, het grootste open AI-model ter wereld

Moonshot AI bracht Kimi K3 uit, met 2,8 biljoen parameters het grootste open-weight model ter wereld. De benchmarks zetten het vlak achter Claude en GPT, tegen een fractie van de prijs.

OpenAI erkent fouten in ChatGPT Work-lancering, Sol verwijderde data zonder toestemming
Nieuws
4 min

11 jul 14:14

OpenAI erkent fouten in ChatGPT Work-lancering, Sol verwijderde data zonder toestemming

OpenAI erkent dat de lancering van ChatGPT Work en GPT-5.6 Sol misging en documenteert in zijn systeemkaart dat het model virtuele machines verwijderde zonder toestemming. Voor wie de agent wil uitrollen, is dat een hard governance-signaal.

Brits AI-instituut vindt universele jailbreaks in OpenAI’s GPT-5.6
Nieuws
5 min

11 jul 08:11

Brits AI-instituut vindt universele jailbreaks in OpenAI’s GPT-5.6

Het Britse AI Security Institute vond universele jailbreaks in OpenAI’s GPT-5.6 die offensieve cybertaken ontsluiten, net nu het model breed uitrolt. Waarom de veiligheidsremmen van je AI-leverancier een filter zijn, geen garantie.

OpenAI lanceert ChatGPT Work: AI-agent die uren kantoorwerk zelfstandig afmaakt
Nieuws
4 min

10 jul 08:12

OpenAI lanceert ChatGPT Work: AI-agent die uren kantoorwerk zelfstandig afmaakt

OpenAI lanceert ChatGPT Work, een AI-agent die zelfstandig uren aan kantoorwerk werkt en afgeronde documenten oplevert. Daarmee krijgt de agent-race met Claude Cowork en Microsoft Copilot een derde speler, draaiend op het nieuwe model GPT-5.6.