Een code-editor toont React-code op een computerscherm.
Nieuws7 oktober · 18:135 min leestijd

OpenAI opent Decisions API in publieke bèta

OpenAI stelt de Decisions API open voor ontwikkelaars. De vaste antwoorden geven kansen, categorieën of scores; invoer kost $0,10 per miljoen tokens. De snelheidsclaim van ongeveer tien keer heeft geen gepubliceerde testopzet.

OpenAI stelt de Decisions API sinds 6 oktober beschikbaar in publieke bèta voor alle ontwikkelaars, met drie vaste antwoordtypen voor classificatie en routering en een tarief van $0,10 per miljoen invoertokens.

Een supportteam kan hiermee een bericht indelen als facturering, bezorging of technisch probleem. Eén API-antwoord kan die categorie meteen naar de juiste wachtrij sturen. Bij vijf miljoen invoertokens per maand komt de Decisions-route uit op $0,50; uitvoertokens worden niet afgerekend. De openbare bèta maakt zo’n routeringsproef beschikbaar buiten de beperkte preview. Tegelijk moet een organisatie vastleggen wat er met twijfelgevallen gebeurt.

Twee mensen zitten achter laptops bij de aankondiging van de Decisions API. Bron: OpenAI Developer Community
Twee mensen zitten achter laptops bij de aankondiging van de Decisions API. Bron: OpenAI Developer Community

De bèta volgt op de preview

De API-wijzigingslog dateert de bètarelease op 6 oktober. De Decisions API heeft nu het aparte POST-pad /v1/decisions en draait alleen op GPT-6 Luna. De documentatie noemt de functie nog steeds een publieke bèta; algemene beschikbaarheid verwacht OpenAI in de komende weken. De Developer Community zegt dat de bèta openstaat voor alle ontwikkelaars, ook buiten de beperkte testgroep.

Op 29 september stond de Decisions API nog in beperkte preview naast de Codex- en Agents-aankondigingen; OpenAI verwachtte brede toegang binnen enkele dagen. OpenAI noemt geen exacte datum voor algemene beschikbaarheid.

Drie soorten antwoorden, vooraf afgebakend

Een verzoek bevat gedeelde invoer en een lijst vragen die de ontwikkelaar zelf opstelt. De invoer mag tekst of afbeeldingen bevatten. Het model geeft per vraag een getypeerd antwoord terug. Software kan dat antwoord gebruiken zonder eerst een vrij geschreven alinea uit elkaar te halen.

Een predicate geeft een kans tussen 0 en 1 dat een voorwaarde klopt, bijvoorbeeld of een productfoto zichtbare schade toont. Een choice kiest uit vaste opties, zoals facturering, bezorging of techniek, en geeft ook kansen per optie en een aparte confidence-score terug. Een score beoordeelt invoer op vooraf geordende niveaus, bijvoorbeeld de ernst van een storing. Die score is het gewogen gemiddelde van de niveaus en kan dus tussen twee ingestelde niveaus uitkomen.

Meerdere onafhankelijke vragen kunnen dezelfde invoer delen. Een webwinkel kan een retourbericht tegelijk laten indelen naar onderwerp en urgentie. Beide uitkomsten kunnen een andere regel in het klantensysteem activeren. Voor beeldvragen accepteert de API maximaal 128 afbeeldingen per aanvraag als inline base64-data-URL; externe afbeeldingslinks en file_id’s zijn niet toegestaan. Een weigering bij één vraag sluit antwoord op andere vragen niet uit. Voor een eigen JSON-schema of een model dat een functie moet aanroepen, verwijst OpenAI naar Structured Outputs en function calling in de Responses API.

De prijs is concreet, de snelheid nog niet

Op de Decisions-route kost één miljoen invoertokens $0,10. Cache-leesacties, cache-schrijfacties en uitvoertokens kosten volgens OpenAI niets. Bij vijf miljoen invoertokens per maand is de rekening dus $0,50, vóór eventuele toeslagen voor regionale verwerking of lange context. Voor een vergelijking: als een taak via GPT-6 Luna in Responses vijf miljoen invoertokens en één miljoen uitvoertokens gebruikt, komt die op $1,00 volgens de standaardtarieven. De Decisions-route kost bij dezelfde invoer $0,50, omdat de vaste antwoorden geen afzonderlijke uitvoertokens opleveren.

OpenAI bracht de vijf betaalde gebruiksniveaus die dag terug tot Build, Launch en Grow, met maandlimieten van $500, $5.000 en $200.000. Die organisatielimieten staan los van de prijs per miljoen tokens en van een eigen ingestelde bestedingslimiet.

OpenAI claimt dat de Decisions API ongeveer tien keer sneller antwoordt dan de Responses API. The Decoder schrijft dat OpenAI een factor tien claimt en verwijst voor die verhouding naar de documentatie, zonder een eigen meting te publiceren. De officiële documentatie noemt geen testopstelling, percentielen of gemeten milliseconden. De factor tien is daarmee een claim van OpenAI, niet een onafhankelijk geteste responstijd.

Cloudflare deelt modelgewichten onder Apache 2.0

Naast OpenAI bouwt Cloudflare een aparte beslislaag. Het bedrijf bracht op 1 oktober Clef en Clef-flash uit als beslismodellen voor classificatie en agentprocessen. Cloudflare host ze op Workers AI en publiceerde de gewichten en modelcode onder Apache 2.0. Zo kunnen organisaties Clef ook lokaal draaien, naast OpenAI’s beheerde API.

Cloudflare meldt dat Clef een test voor het ophalen, weergeven en classificeren van een website in 2,2 seconden uitvoerde. gpt-oss-120b deed volgens het bedrijf dezelfde samengestelde taak in 4,7 seconden. Dat zijn Cloudflares eigen cijfers voor één complete websiteclassificatie. Ze zijn niet rechtstreeks te vergelijken met OpenAI’s claim over de responstijd van een API-route. Bij beide releases krijgt classificatie een aparte plek tussen tekstgeneratie en de softwareactie die op een label volgt.

Voor een Nederlands team verandert vooral de toegang tot die bouwsteen. Decisions geeft een beheerde route met een vast tarief, maar nu alleen met GPT-6 Luna; Cloudflare biedt ook gewichten die lokaal te testen zijn. De uitkomsten zijn in beide gevallen kansen en categorieën, geen garantie dat elke invoer juist wordt ingedeeld.

OpenAI adviseert drempels te toetsen met voorbeelden uit de eigen toepassing en de kosten van fout-positieven en fout-negatieven mee te wegen. Een optie als “overig” kan twijfelgevallen naar een algemene beoordelingswachtrij sturen. Een pilot op eigen data laat zo de kosten én de foutmarge zien voordat een label een automatische actie activeert. OpenAI verwacht de algemene beschikbaarheid in de komende weken; tot die tijd blijft de API in publieke bèta.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van classificatie naar actie

Ik denk met je mee over welke keuzes software kan overnemen, ontwerp de route en breng die van eerste idee tot live proces. Waar het kan, houd ik de oplossing self-hosted.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

OpenAI maakt Codex-cloud herbruikbaar en voegt GitHub-scans toe
Nieuws
3 min

29 sep 21:14

OpenAI maakt Codex-cloud herbruikbaar en voegt GitHub-scans toe

OpenAI brengt Codex naar herbruikbare cloudomgevingen en voegt GitHub-scans, code review en nieuwe agentfuncties toe. Welke onderdelen al beschikbaar zijn, hangt af van het plan en de toegangsrechten per repository.

Cloudflare publiceert Clef-modellen voor agentbesluiten
Nieuws
3 min

1 okt 18:38

Cloudflare publiceert Clef-modellen voor agentbesluiten

Clef en Clef-flash geven agenten gestructureerde classificaties met kansen. Cloudflare publiceert de modelgewichten en modelcode onder Apache 2.0, terwijl de RL-finetuning voorlopig een begeleide dienst is.

OpenAI watermerkt geschikte ChatGPT- en Codex-tekst in de EU
Nieuws
5 min

5 okt 20:37

OpenAI watermerkt geschikte ChatGPT- en Codex-tekst in de EU

Geschikte ChatGPT- en Codex-tekst krijgt in de EU straks een onzichtbaar OpenAI-watermerk. API-markering blijft wereldwijd vrijwillig, terwijl de AI-verordening gebruikers alleen bij bepaalde publicaties zelf een label oplegt.

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging
Nieuws
3 minBijgewerkt om 14:47

1 okt 00:30

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging. De eerste uitrol gaat naar cyberverdedigers en vertrouwde testers; algemene toegang voor Nederlandse teams is nog niet aangekondigd.

OpenAI verlaagt API-prijzen voor GPT-6 Sol en Luna
Nieuws
4 min

22 sep 22:12

OpenAI verlaagt API-prijzen voor GPT-6 Sol en Luna

OpenAI brengt GPT-6 Sol en Luna uit met lagere API-tarieven: 2 en 10 dollar voor Sol, 0,10 en 0,50 dollar voor Luna per miljoen tokens. Voor Nederlandse teams wordt modelkeuze per taak belangrijker.

Microsoft begrenst MAI-modellen met conceptcode
Nieuws
4 min

14 sep 16:16

Microsoft begrenst MAI-modellen met conceptcode

Microsoft publiceert een conceptcode voor de eigen MAI-modellen. Die moet menselijke controle afdwingbaar maken met grenzen aan autonomie, scope en noodstoppen. De tekst staat zes weken open voor feedback en stuurt later modelontwikkeling.