OpenAI verlaagt de API-prijs van topmodel GPT-5.6 Sol drie maanden lang met ruim 20 procent, meldt Reuters: 4 dollar per miljoen invoertokens tegen eerder 5, en 20 dollar per miljoen uitvoertokens tegen eerder 30.
De grootste winst zit aan de uitvoerkant. Die zakt met een derde, terwijl invoer 20 procent goedkoper wordt. Voor een agentproces dat per maand 50 miljoen invoertokens en 10 miljoen uitvoertokens verbruikt, gaat de rekening van 550 naar 400 dollar. Dat scheelt 150 dollar per maand, en alleen zolang de actie loopt.
Wat er in de prijslijst staat
In de prijsdocumentatie van OpenAI staat gpt-5.6-sol nu op 4 dollar per miljoen invoertokens en 20 dollar per miljoen uitvoertokens bij standaardgebruik met korte context. Gecachete invoer kost 0,40 dollar, een cacheschrijfactie 5 dollar.
Wie over de grens van korte context heen gaat, betaalt 8 dollar invoer en 30 dollar uitvoer. Aan de uitvoerkant staat lange context daarmee op precies het bedrag dat tot deze week het gewone standaardtarief was. Batch en Flex halveren het standaardtarief naar 2 en 10 dollar, Fast mode verdubbelt het naar 8 en 40 dollar.
De korting heeft een einddatum
Reuters spreekt van drie maanden. OpenAI is preciezer en schrijft in zijn prijsdocumentatie dat het actietarief voor Sol ten minste tot 21 november 2026 geldt. Wat daarna gebeurt, staat er niet bij.
De verlaging raakt alleen de API. Abonnementen op Pro, Plus en Business houden hun prijs, en de korting rolt daarnaast uit als tegoed op in aanmerking komende plannen voor agentproduct ChatGPT Work en codeergereedschap Codex. Wie zijn AI-budget voor het najaar nu bijstelt, verwerkt dus een tarief dat over drie maanden weer kan zijn zoals het vorige week was. Voor een proef of een piekperiode is dat prima. Voor een jaarcontract of een businesscase die vijf jaar mee moet, is 5 en 30 dollar de eerlijker rekenbasis.
De top zakt nu ook
Tot vrijdag bleef de bovenkant van de catalogus buiten schot. Op 30 juli ging GPT-5.6 Luna 80 procent omlaag en Terra 20 procent, terwijl Sol op 5 en 30 dollar bleef staan. Toen de Amerikaanse tokenindex sinds midden juli met een kwart zakte, gebeurde dat in de middenklasse terwijl de duurste modellen hun tarief hielden. Mantas Lukauskas, AI tech lead bij Hostinger, vatte die beweging samen als het midden wegsnijden en de top verdedigen. Die stelling houdt sinds vrijdag niet meer.
Dat de uitvoerkant harder zakt dan de invoerkant is geen detail. Bij zakelijke OpenAI-klanten kwam in juni 64 procent van de gecombineerde uitvoertokens van Codex en ChatGPT uit de codeeragent. Een agent werkt in stappen en elke stap produceert uitvoer, dus een derde eraf landt precies op de post die bij agentwerk het snelst oploopt.
Naast Claude gelegd
Anthropic zet Claude Fable 5 op 10 en 50 dollar en Claude Opus 5 op 5 en 25 dollar per miljoen tokens. Met 4 en 20 dollar duikt Sol onder allebei.
Eén verschil telt bij lange runs. Anthropic rekent het volledige contextvenster van een miljoen tokens af tegen het standaardtarief, terwijl OpenAI voor lange context een apart tarief hanteert dat de invoerprijs verdubbelt. Laat je een agent een hele codebase of een documentenberg in één keer inlezen, dan kan het prijsvoordeel daar omslaan. De vergelijking die telt is dus niet het regeltarief maar wat één afgeronde taak in jouw eigen contextprofiel kost.
Wat dit signaleert
Deze korting is geen losse actie maar een tijdelijk tarief met een klok erop, hetzelfde patroon dat Google koos toen het Gemini 3.7 Flash uitbracht voor de helft van de prijs, met een introductietarief dat op 31 december 2026 vervalt. Twee van de drie grote aanbieders sturen hun scherpste tarief nu de markt in met een einddatum eraan vast. Dat drukt de marge per token in de hele API-markt en verschuift de concurrentie naar volumeafspraken en langere contracten, waar de looptijd het gesprek bepaalt in plaats van de listprijs.
Wat er verandert is dan ook niet zozeer de hoogte van de rekening als de houdbaarheid van de rekensom eronder. Een businesscase die alleen sluit op 4 en 20 dollar, staat op 22 november op losse schroeven. En een prijslijst die binnen drie weken twee keer beweegt, maakt van de modelnaam in je code een variabele in plaats van een aanname.
Veelgestelde vragen
Agentkosten die voorspelbaar blijven
Ik denk met je mee over welk model welk werk doet, ontwerp het proces eromheen en bouw en automatiseer het zo dat je van model kunt wisselen zonder je applicatie open te breken. Waar het kan self-hosted, zodat een tariefronde bij een leverancier niet je begroting stuurt.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
