OpenAI stelt de Decisions API sinds 6 oktober beschikbaar in publieke bèta voor alle ontwikkelaars, met drie vaste antwoordtypen voor classificatie en routering en een tarief van $0,10 per miljoen invoertokens.
Een supportteam kan hiermee een bericht indelen als facturering, bezorging of technisch probleem. Eén API-antwoord kan die categorie meteen naar de juiste wachtrij sturen. Bij vijf miljoen invoertokens per maand komt de Decisions-route uit op $0,50; uitvoertokens worden niet afgerekend. De openbare bèta maakt zo’n routeringsproef beschikbaar buiten de beperkte preview. Tegelijk moet een organisatie vastleggen wat er met twijfelgevallen gebeurt.

De bèta volgt op de preview
De API-wijzigingslog dateert de bètarelease op 6 oktober. De Decisions API heeft nu het aparte POST-pad /v1/decisions en draait alleen op GPT-6 Luna. De documentatie noemt de functie nog steeds een publieke bèta; algemene beschikbaarheid verwacht OpenAI in de komende weken. De Developer Community zegt dat de bèta openstaat voor alle ontwikkelaars, ook buiten de beperkte testgroep.
Op 29 september stond de Decisions API nog in beperkte preview naast de Codex- en Agents-aankondigingen; OpenAI verwachtte brede toegang binnen enkele dagen. OpenAI noemt geen exacte datum voor algemene beschikbaarheid.
Drie soorten antwoorden, vooraf afgebakend
Een verzoek bevat gedeelde invoer en een lijst vragen die de ontwikkelaar zelf opstelt. De invoer mag tekst of afbeeldingen bevatten. Het model geeft per vraag een getypeerd antwoord terug. Software kan dat antwoord gebruiken zonder eerst een vrij geschreven alinea uit elkaar te halen.
Een predicate geeft een kans tussen 0 en 1 dat een voorwaarde klopt, bijvoorbeeld of een productfoto zichtbare schade toont. Een choice kiest uit vaste opties, zoals facturering, bezorging of techniek, en geeft ook kansen per optie en een aparte confidence-score terug. Een score beoordeelt invoer op vooraf geordende niveaus, bijvoorbeeld de ernst van een storing. Die score is het gewogen gemiddelde van de niveaus en kan dus tussen twee ingestelde niveaus uitkomen.
Meerdere onafhankelijke vragen kunnen dezelfde invoer delen. Een webwinkel kan een retourbericht tegelijk laten indelen naar onderwerp en urgentie. Beide uitkomsten kunnen een andere regel in het klantensysteem activeren. Voor beeldvragen accepteert de API maximaal 128 afbeeldingen per aanvraag als inline base64-data-URL; externe afbeeldingslinks en file_id’s zijn niet toegestaan. Een weigering bij één vraag sluit antwoord op andere vragen niet uit. Voor een eigen JSON-schema of een model dat een functie moet aanroepen, verwijst OpenAI naar Structured Outputs en function calling in de Responses API.
De prijs is concreet, de snelheid nog niet
Op de Decisions-route kost één miljoen invoertokens $0,10. Cache-leesacties, cache-schrijfacties en uitvoertokens kosten volgens OpenAI niets. Bij vijf miljoen invoertokens per maand is de rekening dus $0,50, vóór eventuele toeslagen voor regionale verwerking of lange context. Voor een vergelijking: als een taak via GPT-6 Luna in Responses vijf miljoen invoertokens en één miljoen uitvoertokens gebruikt, komt die op $1,00 volgens de standaardtarieven. De Decisions-route kost bij dezelfde invoer $0,50, omdat de vaste antwoorden geen afzonderlijke uitvoertokens opleveren.
OpenAI bracht de vijf betaalde gebruiksniveaus die dag terug tot Build, Launch en Grow, met maandlimieten van $500, $5.000 en $200.000. Die organisatielimieten staan los van de prijs per miljoen tokens en van een eigen ingestelde bestedingslimiet.
OpenAI claimt dat de Decisions API ongeveer tien keer sneller antwoordt dan de Responses API. The Decoder schrijft dat OpenAI een factor tien claimt en verwijst voor die verhouding naar de documentatie, zonder een eigen meting te publiceren. De officiële documentatie noemt geen testopstelling, percentielen of gemeten milliseconden. De factor tien is daarmee een claim van OpenAI, niet een onafhankelijk geteste responstijd.
Cloudflare deelt modelgewichten onder Apache 2.0
Naast OpenAI bouwt Cloudflare een aparte beslislaag. Het bedrijf bracht op 1 oktober Clef en Clef-flash uit als beslismodellen voor classificatie en agentprocessen. Cloudflare host ze op Workers AI en publiceerde de gewichten en modelcode onder Apache 2.0. Zo kunnen organisaties Clef ook lokaal draaien, naast OpenAI’s beheerde API.
Cloudflare meldt dat Clef een test voor het ophalen, weergeven en classificeren van een website in 2,2 seconden uitvoerde. gpt-oss-120b deed volgens het bedrijf dezelfde samengestelde taak in 4,7 seconden. Dat zijn Cloudflares eigen cijfers voor één complete websiteclassificatie. Ze zijn niet rechtstreeks te vergelijken met OpenAI’s claim over de responstijd van een API-route. Bij beide releases krijgt classificatie een aparte plek tussen tekstgeneratie en de softwareactie die op een label volgt.
Voor een Nederlands team verandert vooral de toegang tot die bouwsteen. Decisions geeft een beheerde route met een vast tarief, maar nu alleen met GPT-6 Luna; Cloudflare biedt ook gewichten die lokaal te testen zijn. De uitkomsten zijn in beide gevallen kansen en categorieën, geen garantie dat elke invoer juist wordt ingedeeld.
OpenAI adviseert drempels te toetsen met voorbeelden uit de eigen toepassing en de kosten van fout-positieven en fout-negatieven mee te wegen. Een optie als “overig” kan twijfelgevallen naar een algemene beoordelingswachtrij sturen. Een pilot op eigen data laat zo de kosten én de foutmarge zien voordat een label een automatische actie activeert. OpenAI verwacht de algemene beschikbaarheid in de komende weken; tot die tijd blijft de API in publieke bèta.
Veelgestelde vragen
Van classificatie naar actie
Ik denk met je mee over welke keuzes software kan overnemen, ontwerp de route en breng die van eerste idee tot live proces. Waar het kan, houd ik de oplossing self-hosted.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.


