OpenAI verlaagt vanaf vandaag de API-prijs van GPT-5.6 Luna met 80 procent en die van Terra met 20 procent, maakt het bedrijf zelf bekend. Topmodel Sol houdt zijn tarief.
Het gewicht zit niet in de korting zelf, maar in wat die doet met de onderlinge verhouding. Bij de lancering kostte Terra 2,5 keer zoveel als Luna en Sol vijf keer zoveel. Vanaf vandaag is Terra tien keer zo duur als Luna en Sol vijfentwintig keer. Draai je een agentproces waarin stappen als vanzelf op Terra of Sol landen, dan is het prijsverschil met de goedkoopste variant sinds vanochtend vier tot vijf keer groter dan het drie weken geleden was.
De nieuwe tarieven
Per miljoen tokens rekent OpenAI vanaf 30 juli 2 dollar invoer en 12 dollar uitvoer voor Terra, en 0,20 en 1,20 dollar voor Luna. Bij de brede uitrol op 9 juli, toen Terra nog 2,50 en 15 dollar kostte en Luna 1 en 6 dollar, lagen die tarieven dus aanzienlijk hoger. Sol blijft op 5 en 30 dollar staan.
Een agentproces dat maandelijks 50 miljoen invoer- en 10 miljoen uitvoertokens verstookt, kostte op Luna 110 dollar en kost nu 22. Dezelfde workload op Terra zakt van 275 naar 220 dollar. Wie hem op Sol laat lopen betaalt onveranderd 550 dollar.
De verlaging blijft niet beperkt tot de API. In Codex en ChatGPT Work verbruikt gebruik van Terra en Luna vanaf nu minder credits, terwijl de abonnementsprijzen en de quota gelijk blijven. In de praktijk kun je op hetzelfde abonnement dus meer werk doen. De nieuwe prijzen rollen later vandaag ook uit op AWS.
Waar de rekensom kantelt
Met een factor tien tussen Terra en Luna wordt de vraag welk model welke stap doet ineens een kostenpost in plaats van een technische voorkeur. OpenAI schetst in de aankondiging zelf het patroon: laat Sol de onzekerheid wegnemen en het plan bepalen, en laat Luna de goed omschreven wijzigingen uitvoeren, tests schrijven en de uitkomst beoordelen.
De klanten die OpenAI aan het woord laat, zetten daar getallen bij. Notion meet met Terra vergelijkbare kwaliteit als GPT-5.5 tegen de helft van de kosten per taak en in 60 procent minder tijd. Ontwikkeltool Blitzy zag het hergebruik van zijn prompt-cache stijgen van 24 naar 90 procent en verwerkt met Luna 2,2 keer meer context met 8,5 keer minder uitvoertokens, tegen 87 procent lagere kosten dan met GPT-5.4 mini. Dust noemt Luna 40 procent sneller en 40 procent goedkoper dan zijn vorige standaardmodel.
Dat zijn cijfers van klanten die OpenAI zelf selecteerde, dus ze wijzen een richting aan en bewijzen niets over jouw werk. Datzelfde voorbehoud gold in juli al voor de tokenclaims rond Sol, die onafhankelijke testers niet konden reproduceren. De verstandige volgorde blijft: neem een representatieve steekproef van je eigen taken, draai die op het goedkopere model en meet de kwaliteit voordat je de routering omzet.
Prijsdruk van twee kanten
De timing is geen toeval. OpenAI verlaagt de prijzen terwijl bedrijven kritischer naar hun AI-rekening kijken, meldt Reuters, en terwijl open-source Chinese concurrenten als Z.ai's GLM-5.2 die prestaties tegen lagere kosten dicht benaderen terrein winnen. Dat model klopte GPT-5.5 op meerdere langlopende coding-benchmarks voor ongeveer een zesde van de prijs, met vrij downloadbare gewichten onder een MIT-licentie.
De druk gaat ook de andere kant op. Luna komt met 0,20 dollar invoer ruwweg vijf keer onder Anthropics Claude Haiku 4.5 te liggen, en Terra duikt onder de tarieven die Anthropic per 31 augustus voor Claude Sonnet 5 hanteert. Analisten waarschuwen volgens Reuters dat zulke rondes het gebruik opdrijven maar de financiën van beide labs uithollen, vlak voor de beursgangen waar de markt op wacht.

Sol wordt niet goedkoper, wel sneller
Aan de bovenkant kiest OpenAI voor snelheid in plaats van korting. Fast mode vervangt het oude Priority Processing in de API en levert voor Sol tot 2,5 keer hogere snelheid dan standaardverwerking, tegen het dubbele tarief en zonder verschil in kwaliteit. Bestaande verzoeken met het label priority schakelen automatisch over, dus daar hoef je niets voor aan te passen.
De reden achter de verlaging noemt OpenAI expliciet technisch: Sol herschreef binnen een door mensen aangestuurd proces productiekernels en draaide honderden experimenten, wat de kosten om het model te bedienen met 20 procent drukte en de efficiëntie van tokengeneratie met ruim 15 procent verbeterde. Die winst geeft het bedrijf nu door.
Wat deze stap markeert
De scheiding is het echte nieuws. De prijs van het topmodel staat stil, terwijl de goedkoopste laag met 80 procent onderuit gaat. Daarmee verplaatst de concurrentie zich van de vraag welk model het slimst is naar de vraag wat een afgerond resultaat kost, en dat is precies het terrein waar de Chinese open-weight modellen al een jaar duwen.
Voor wie AI in productie draait, betekent dat vooral dat de waarde van een model-agnostische opzet weer toeneemt. Een architectuur waarin je per stap een ander model kunt aanwijzen, incasseert elke prijsronde vanzelf. Zit je vastgeklonken aan één model omdat je prompts, tools en evaluaties daaromheen zijn gebouwd, dan gaat een korting van 80 procent aan je voorbij tot je die verbouwing alsnog doet.
Veelgestelde vragen
Kiezen per stap, niet per leverancier
Ik denk met je mee over waar in je proces een goedkoper model volstaat en waar je het zware werk nodig hebt, en bouw de routering zo dat je bij elke prijsronde gewoon kunt omschakelen. Van ontwerp tot werkende automatisering, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
