Softwareontwikkelaar werkt achter een computer
Nieuws10 oktober · 06:245 min leestijd

Microsoft brengt Decision-1 uit voor AI-routering

Microsoft brengt Decision-1 uit voor routering, classificatie en controle van AI-workflows. Het model kost $0,042 per miljoen invoertokens, maar de claim van 35× hogere snelheid komt uit Microsofts eigen benchmark.

Microsoft brengt Decision-1 uit als model dat vaste antwoordopties scoort voor routering, classificatie en workflowcontrole, schrijft het bedrijf in een aankondiging van 9 oktober.

Voor een organisatie die klantvragen automatisch naar de juiste medewerker of afdeling stuurt, ontstaat een aparte optie voor besliswerk: een model dat vooraf bepaalde antwoorden beoordeelt. Bij tien miljoen invoertokens kost Decision-1 volgens het gepubliceerde tarief $0,42; uitvoer is bij beide beslismodellen gratis. OpenAI rekent $0,10 per miljoen invoertokens voor de Decisions API en ondersteunt dataresidentie in de EER en Zwitserland voor in aanmerking komende klanten, wat bij hetzelfde volume $1,00 is. Het verschil is 58 cent op de invoer, maar zegt niets over gelijke kwaliteit of foutkosten.

Een score stuurt de volgende stap

Een gewone taalmodelaanroep levert vaak vrije tekst op. Als een proces afhangt van een beperkt aantal uitkomsten, moet software dat antwoord nog omzetten naar een label of actie. Decision-1 krijgt vaste opties en retourneert een gekalibreerde kansscore per optie. Het ondersteunt ja/nee, meerkeuze, waarderingsscores en beoordeling van AI-antwoorden of agentacties aan de hand van vaste criteria.

De toepassing kan die scores gebruiken om door te gaan, opnieuw te proberen, een stap uit te stellen of een medewerker in te schakelen. Microsoft noemt onder meer prioritering, controle, modelroutering en incidentclassificatie als toepassingen. Het model is nu beschikbaar in Microsoft Foundry en via OpenRouter.

Decision-1 begint met Qwen3.5-9B

Microsoft bouwde Decision-1 door Qwen3.5-9B na te trainen voor besluitvorming in één doorgang. Het bedrijf zegt het model later ook op andere basismodellen te willen baseren, waaronder MAI en OpenAI. Dat volgt op de aankondiging in juni van zeven eigen MAI-modellen voor tekst, redeneren, code, beeld, spraak en transcriptie.

Voor nauwkeurigheid vergelijkt Microsoft het model op 36 benchmarksets met bijna 150.000 vragen die buiten de training zijn gehouden. Het bedrijf meldt daar de hoogste nauwkeurigheid. Voor snelheid rapporteert Microsoft een P50-meting: Decision-1 zou 35 keer sneller zijn dan GPT-6 Sol en 2,5 keer sneller dan H2O-Lightning-4B, de tweede in die vergelijking. P50 is de mediaan van de gemeten responstijden.

De voorbeelden uit Microsofts eigen teams geven de claim een werkcontext. Xbox Research liet ruim 10.000 open antwoorden en reviews indelen: vergelijkbare kwaliteit als GPT-6 Sol, ruim 14 keer sneller en ongeveer 200 keer goedkoper. Het Copilot-team vond de kwaliteit vergelijkbaar met GPT-5.6 Luna en rapporteerde een snelheid van 100 keer. Microsoft Discovery meldt scores die 46 keer consistenter zijn dan bij een LLM-aanpak, drie keer sneller scoren en bijna vier keer sneller herplannen.

OpenAI en Cloudflare kiezen een andere route

OpenAI opende op 6 oktober de Decisions API in publieke bèta met vaste antwoordtypen voor classificatie en routering. De huidige documentatie noemt GPT-6 Luna als ondersteund model. Microsoft biedt nu een eigen scoringsmodel via Foundry en OpenRouter, naast die API-route.

Cloudflare bracht Clef en Clef-flash uit als open beslismodellen die organisaties lokaal kunnen draaien. De modellen zijn onder Apache 2.0 gepubliceerd. Cloudflare rapporteert in zijn eigen evaluatie van 43 benchmarks mediane latenties van 209,3 milliseconden voor Clef en 38,8 milliseconden voor Clef-flash. Die cijfers komen uit een ander testprogramma dan Microsofts verhouding met GPT-6 Sol en zijn niet rechtstreeks naast elkaar te zetten.

Beheer en herbruikbaarheid verschillen per route. OpenAI koppelt de API aan GPT-6 Luna, Microsoft zet Decision-1 in zijn modelplatformen en Cloudflare publiceert gewichten die lokaal kunnen draaien. Voor Nederlandse teams tellen ook de plek waar invoer wordt verwerkt en de ruimte om een andere aanbieder te kiezen mee.

De snelheid is nog geen onafhankelijke vergelijking

De 35×-claim komt uit Microsofts eigen benchmark. De publicatie noemt de P50-uitkomst en de omvang van de nauwkeurigheidstest, maar geeft geen absolute responstijden, gebruikte hardware of volledige instellingen voor de snelheidsvergelijking. Een onafhankelijke meting op dezelfde verzoeken staat er niet bij. De bijna 150.000 vragen buiten de training tonen niet hoe Decision-1 presteert op Nederlandse klantmails met de eigen categorieën van een bedrijf.

Er is ook een verschil in de genoemde tweede plaats tussen Microsofts bijgewerkte aankondiging en een reprint. Microsoft noemt H2O-Lightning-4B als nummer twee en een voorsprong van 2,5 keer; 36Kr noemt Quyet-1.0-Large als nummer twee en een verschil van 4,5 keer. Microsoft vermeldt dat de pagina is bijgewerkt om benchmarkresultaten toe te voegen, maar legt dit verschil niet uit. De 35×-vergelijking met GPT-6 Sol blijft een leveranciersmeting.

Microsoft zegt dat het model bij acht varianten van hetzelfde verzoek gemiddeld in 1,3 procent van de gevallen van keuze veranderde. Bij herschreven optieomschrijvingen en een andere volgorde zag het bedrijf geen omslagen. De veiligheidstest omvatte 5.250 verzoeken op elf benchmarks. Microsoft zegt dat het schadelijke verzoeken weigerde en bruikbaarheid behield. Voor een live proces blijven de foutmarge op eigen voorbeelden en de route voor twijfelgevallen bepalend.

Decision-1 voegt een afzonderlijk model toe voor de stap tussen invoer en actie. De prijs maakt tests met veel classificaties betaalbaar, terwijl de gepubliceerde snelheidswinst voorlopig op Microsofts eigen meetopzet rust. Het bedrijf wil het model later op andere basismodellen overzetten, dus de versie onder een bestaande koppeling kan veranderen. Voor een organisatie wordt de vraag concreet: welke keuze mag software zelfstandig maken, en wanneer moet een score naar een mens worden doorgestuurd?

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van beslismodel naar werkend proces

Ik denk mee over welke beslissingen software kan nemen, ontwerp de route en bouw die end-to-end in je bestaande proces. Waar het kan houd ik de verwerking self-hosted, zodat je grip houdt op data en afhankelijkheden.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

OpenAI opent Decisions API in publieke bèta
Nieuws
5 min

7 okt 18:13

OpenAI opent Decisions API in publieke bèta

OpenAI stelt de Decisions API open voor ontwikkelaars. De vaste antwoorden geven kansen, categorieën of scores; invoer kost $0,10 per miljoen tokens. De snelheidsclaim van ongeveer tien keer heeft geen gepubliceerde testopzet.

OpenAI verlaagt API-prijzen voor GPT-6 Sol en Luna
Nieuws
4 min

22 sep 22:12

OpenAI verlaagt API-prijzen voor GPT-6 Sol en Luna

OpenAI brengt GPT-6 Sol en Luna uit met lagere API-tarieven: 2 en 10 dollar voor Sol, 0,10 en 0,50 dollar voor Luna per miljoen tokens. Voor Nederlandse teams wordt modelkeuze per taak belangrijker.

OpenAI publiceert promptgids voor GPT-6 Astra met blokkeerlijst
Nieuws
5 min

5 sep 16:20

OpenAI publiceert promptgids voor GPT-6 Astra met blokkeerlijst

OpenAI's promptgids voor GPT-6 Astra bevat een blokkeerlijst van slop-woorden, kant-en-klare instructies tegen onnodig doorvragen en een reeks API-parameters die vervallen. Wat teams die net overstapten concreet moeten herschrijven.

Gratis AI-model Ox Alpha komt van anonieme aanbieder die prompts bewaart
Nieuws
4 min

23 aug 00:07

Gratis AI-model Ox Alpha komt van anonieme aanbieder die prompts bewaart

Ox Alpha staat sinds 20 augustus gratis op OpenRouter en verslaat in losse tests duurdere modellen. De aanbieder blijft anoniem en bewaart volgens de voorwaarden elke prompt die je erin stopt.

Ramp lanceert modelrouter Router.com, voorlopig alleen in de VS
Nieuws
4 min

21 aug 02:09

Ramp lanceert modelrouter Router.com, voorlopig alleen in de VS

Ramp lanceert Router.com, een API die elk AI-verzoek naar het goedkoopste geschikte model stuurt en volgens het bedrijf 40 procent inferentiekosten scheelt. Alleen te gebruiken in de VS, op Amerikaanse infrastructuur.

SpaceXAI lanceert Grok 4.6 en houdt de tokenprijs gelijk
Nieuws
4 min

12 aug 22:09

SpaceXAI lanceert Grok 4.6 en houdt de tokenprijs gelijk

SpaceXAI brengt Grok 4.6 uit met 61 punten op de Artificial Analysis Intelligence Index, gelijk aan GPT-5.6 Sol, terwijl de tokenprijs op 2 en 6 dollar per miljoen blijft staan.