Persoon die code schrijft op een MacBook Pro aan een bureau
Nieuws12 augustus · 22:094 min leestijd

SpaceXAI lanceert Grok 4.6 en houdt de tokenprijs gelijk

SpaceXAI brengt Grok 4.6 uit met 61 punten op de Artificial Analysis Intelligence Index, gelijk aan GPT-5.6 Sol, terwijl de tokenprijs op 2 en 6 dollar per miljoen blijft staan.

SpaceXAI brengt Grok 4.6 uit, een model dat 61 punten haalt op de Artificial Analysis Intelligence Index en daarmee GPT-5.6 Sol evenaart, tegen dezelfde tokenprijs als zijn voorganger.

Dat maakt de afweging voor teams die agents lang laten doorwerken vooral een rekensom. Grok 4.5 stond op 56 punten en kostte 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens. Grok 4.6 wint vijf punten en houdt precies dat tarief. Claude Opus 5, dat met 63 punten de hoogste score op die index houdt, rekent 5 dollar input en 25 dollar output per miljoen tokens. Per miljoen outputtokens ligt Grok 4.6 daarmee ruim vier keer lager, voor twee indexpunten minder.

Vijf punten winst, vooral op agenttaken

Artificial Analysis Intelligence Index, hoogste testinstelling per model (bron: SpaceXAI en Artificial Analysis)

De winst zit geconcentreerd in de tests die meerstapswerk meten. Op DeepSWE 1.1 gaat Grok 4.6 van 54 naar 65,9 procent, op APEX-Agents van 47,1 naar 57,5 procent en op Terminal-Bench 3.0 van 15,7 naar 26 procent. SpaceXAI schrijft dat het model op langere trajecten vaker zijn eigen werk nakijkt voordat het verdergaat.

Het patroon dat zichtbaar werd bij Grok 4.5, dat voor 2 dollar per miljoen inputtokens tegen de Opus-klasse werd gezet maar op de zwaarste coding-benchmarks achterbleef, staat nog overeind. GPT-5.6 Sol haalt op DeepSWE 1.1 73 procent en Fable 5 70 procent, tegen 65,9 voor Grok 4.6. Op Terminal-Bench 3.0 zitten die twee rond de 34 procent, tegen 26. De inhaalslag is fors, de achterstand op de zwaarste agenttests is niet weg.

Het logo van xAI met de merknaam Grok (Bron: Grok AI (xAI) / Wikimedia Commons, publiek domein)
Het logo van xAI met de merknaam Grok (Bron: Grok AI (xAI) / Wikimedia Commons, publiek domein)

Waar de rekening alsnog oploopt

Het tarief van 2 en 6 dollar geldt tot 200.000 tokens context. De modeldocumentatie zet alles daarboven op 4 dollar input en 12 dollar output per miljoen tokens, binnen een venster van 500.000 tokens. Juist een agent die lang doorloopt sleept zijn context mee en groeit vanzelf over die grens heen. De prijs per token verdubbelt dan halverwege de klus, zonder dat iemand een instelling aanraakt. Gecachete inputtokens kosten 0,50 dollar per miljoen, wat het herhaald meesturen van dezelfde context wel goedkoper maakt.

Daar staat een efficiëntievoordeel tegenover. Grok 4.6 rondt complexe taken af in ongeveer 53 stappen, waar Claude Opus 5 er ruwweg 103 nodig heeft, tekent The Decoder aan bij de GDPval-AA-test, waarop Grok 4.6 met 1753 punten tweede staat achter Opus 5. Minder stappen betekent minder beurten en minder tokens, en dat drukt de kosten per afgeronde taak sterker dan het tarief alleen. Waar dat geld in zo'n loop precies weglekt en hoe je het meet, staat in de meetaanpak voor tokenkosten van agenten, die in productie harder oplopen dan een proof of concept doet vermoeden.

Het model draait op Amerikaanse clusters

Grok 4.6 is vanaf vandaag te gebruiken in Cursor, in Grok Build en via de SpaceXAI-API, met OpenRouter, Vercel en Cloudflare als partners en de eerste week dubbel inbegrepen verbruik in Grok Build en Cursor. Anders dan bij de lancering van 4.5, die in geen enkel SpaceXAI-product in de EU beschikbaar was, noemt de aankondiging nu geen regio die buiten de boot valt.

Eén beperking staat wel zwart op wit in de documentatie. Als draairegio's voor grok-4.6 zijn alleen us-east-1 en us-west-2 vermeld. Wie het model via de API in een proces hangt, stuurt zijn invoer dus naar Amerikaanse datacenters. Bij een dossier met persoonsgegevens of klantcontracten is dat een afweging die los staat van de prijs per token.

Van prijs per token naar verbruik per taak

Tussen Grok 4.5 en Grok 4.6 is de prijs het enige dat niet bewoog. Vijf weken geleden was die tokenprijs zelf het nieuws, nu is hij het uitgangspunt en gaat het over hoeveel stappen een model per euro volhoudt zonder vast te lopen. Dezelfde verschuiving zit in OpenAI's claim dat GPT-5.6 Sol op agentic coding 54 procent minder tokens verbruikt: niet goedkoper per token, maar zuiniger per taak. Voor wie agents inkoopt verschuift de vraag daarmee van het tarief op de prijslijst naar het verbruik van één echte opdracht, en dat cijfer staat op geen enkele leverancierspagina.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van modelkeuze naar werkend proces

Een scherpe tokenprijs zegt weinig zolang de agent zelf niet af is. Ik denk mee over welk model bij jouw taak past, ontwerp de workflow eromheen en bouw hem tot hij draait, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Astra blokkeert directe prompt-injecties, verstopte lukken in 8,5 procent
Nieuws
5 min

4 sep 20:10

Astra blokkeert directe prompt-injecties, verstopte lukken in 8,5 procent

Gray Swan kreeg GPT-6 Astra in 8,5 procent van de scenario's toch zover dat het instructies uitvoerde die in een document verstopt zaten, tegen 4,8 procent bij Claude Opus 5. Directe injecties blokkeert het model wel.

OpenAI sluit op 12 november de modeltoegang voor Cursor af
Nieuws
5 min

29 aug 06:10

OpenAI sluit op 12 november de modeltoegang voor Cursor af

OpenAI stopt op 12 november met het leveren van zijn modellen aan Cursor, omdat het eigenaar SpaceX niet vertrouwt. Wat een Nederlands ontwikkelteam verliest en welke routes er tot die datum openliggen.

OpenAI groeit harder dan Anthropic in zakelijke AI-uitgaven: 82 tegen 76 procent
Nieuws
5 min

21 aug 12:12

OpenAI groeit harder dan Anthropic in zakelijke AI-uitgaven: 82 tegen 76 procent

Tokendata van betaalbedrijf Ramp laten zien dat OpenAI dit kwartaal harder groeit in zakelijke AI-uitgaven dan Anthropic, 82 tegen 76 procent. In adoptie ligt Anthropic nog voor, maar de rangorde kantelt per modelrelease.

SpaceXAI lanceert Grok 4.5 tegen lagere prijs dan Opus
Nieuws
4

8 jul 22:10

SpaceXAI lanceert Grok 4.5 tegen lagere prijs dan Opus

SpaceXAI brengt Grok 4.5 uit voor 2 dollar per miljoen inputtokens, een fractie van de Opus-prijs. Het model mikt op de Opus-klasse, blijft op de zwaarste coding-tests achter en is nog niet beschikbaar in de EU.

Artificial Analysis herziet zijn AI-index en zet 40 procent op geheime tests
Nieuws
5 min

5 sep 22:07

Artificial Analysis herziet zijn AI-index en zet 40 procent op geheime tests

Artificial Analysis herziet zijn Intelligence Index naar v4.2. Veertig procent van de weging rust nu op geheime testsets. GPT-6 Astra en GPT-5.6 Sol stonden gelijk op 61 punten en staan nu vier punten uit elkaar.

OpenAI past benchmarkcijfers van GPT-6 Astra aan zonder correctiemelding
Nieuws
5 min

5 sep 14:21

OpenAI past benchmarkcijfers van GPT-6 Astra aan zonder correctiemelding

OpenAI paste na de lancering van GPT-6 Astra benchmarkscores op zijn eigen pagina aan zonder correctiemelding. Archiefopnames tonen wijzigingen op Terminal-Bench, HealthBench, GeneBench Pro en ExploitBench tussen 3 en 5 september.