bureau met smartphone en financiele grafieken
Nieuws25 juni · 06:224 min leestijd

Accenture zet AI-tokens op rantsoen: de tokenmaxxing-fase is voorbij

Grote werkgevers draaiden eerst de duimschroeven aan om AI-gebruik te verplichten. Nu remmen ze het juist af: uitgelekte audio van Accenture laat zien hoe het tokenverbruik de kosten opjaagt.

Een paar maanden geleden was de boodschap bij grote werkgevers nog simpel: gebruik AI, of blijf achter. Bij Accenture liepen senior medewerkers volgens uitgelekte audio zelfs hun promotie mis als ze de tools links lieten liggen. Nu draait dat beeld om. In een intern overleg waarvan 404 Media de audio in handen kreeg, zoekt het concern juist naar manieren om diezelfde medewerkers af te remmen, omdat het tokenverbruik de pan uit rijst. Welkom in wat de techpers nu het tijdperk van token rationing noemt.

Van tokenmaxxen naar rantsoeneren

De ommekeer is opvallend. Waar bedrijven een jaar lang gebruik aanjoegen, soms met interne ranglijsten, slaat de slinger nu de andere kant op. "We zitten op een omslagpunt waarop AI een materieel onderdeel van onze kostenstructuur wordt", zegt Justice Kwak, verantwoordelijk voor de agentic AI-strategie bij Accenture, in de uitgelekte opname die 404 Media publiceerde.

Het verrassende inzicht uit de interne data: niet de engineers stoken de meeste tokens, maar juist de niet-technische medewerkers. Veel verbruik zit in alledaagse klusjes, zoals het omzetten van een PDF naar presentatieslides. Accenture spreekt intern van "soaring token spend" in de hele sector. TechCrunch vat de kanteling bondig samen: de korte tokenmaxxing-fase maakt plaats voor token rationing.

Het is geen Accenture-probleem

De spanning speelt breder. GitHub stapte over van een vast abonnement naar afrekenen per token, en Uber zette een rem op het gebruik van tools als Claude Code en Cursor nadat het zijn complete AI-budget in vier maanden had opgebrand. Het patroon is steeds hetzelfde: de prijs per token daalt, maar de rekening stijgt omdat het verbruik harder groeit.

Dat is precies de paradox dat ondanks dalende tokenprijzen de AI-rekening juist oploopt doordat agenten steeds meer tokens verstoken, die eerder al zichtbaar werd bij namen als Uber en Meta. De Accenture-audio laat zien wat er gebeurt als een organisatie daar geen antwoord op heeft: paniekvoetbal in de vorm van een noodrem.

Waarom dichtdraaien het verkeerde antwoord is

Verplicht gebruik afdwingen met promotiedreigementen was een slecht idee. Maar het tegenovergestelde, AI breed dichtdraaien, is net zo bot. Wie de kraan helemaal sluit, ruilt de ene blinde vlek (ongeremd uitgeven) in voor de andere (AI uitzetten waar het wel rendeert).

Het voorbeeld van de PDF naar slides verraadt het echte probleem: een simpele taak werd naar een duur frontier-model gestuurd terwijl een goedkoper model of een vaste conversie volstond. De oplossing zit dus in proces, niet in een verbod. Meet eerst wie wat verbruikt, en stel harde budgetlimieten per gebruiker en agent in en route taken naar het juiste model. Dat OpenAI inmiddels ChatGPT Enterprise uitgavencontroles en verbruiksanalytics gaf, bewijst dat zelfs de leveranciers erkennen dat grip op verbruik onmisbaar is geworden.

Wat betekent dit voor jou

De echte vraag is niet of je team te veel AI gebruikt, maar of iemand kan zien wat elke euro oplevert. Een klein bedrijf voelt een ontspoord AI-abonnement net zo hard als een multinational, alleen zonder de buffer om het op te vangen. Koppel verbruik aan waarde, kies per taak bewust een model, en zet een limiet voordat de rekening je verrast. Dan hoef je niet te rantsoeneren, want dan weet je gewoon waar je geld heen gaat.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je AI-kosten

Ik help je AI niet uitzetten maar beheersbaar maken: ik denk mee over welke processen het waard zijn, ontwerp de routering naar het juiste model en automatiseer de boel end-to-end, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Tokenmaxxing is voorbij, maar rantsoeneren lost niets op
Inzicht
6 min

27 jun 23:03

Tokenmaxxing is voorbij, maar rantsoeneren lost niets op

Accenture zet AI-tokens op rantsoen en daarmee lijkt de tokenmaxxing-fase voorbij. Maar wie nu alleen de kraan dichtdraait, mist de echte verschuiving: de winnaars begroten hun AI rond aantoonbare output, niet rond verbruik.

1Password lanceert AI-kostenbeheer dat tokenverbruik van Cursor, OpenAI en Anthropic bundelt
Nieuws
5 min

15 jul 02:38

1Password lanceert AI-kostenbeheer dat tokenverbruik van Cursor, OpenAI en Anthropic bundelt

1Password bundelt in zijn SaaS Manager het tokenverbruik van Cursor, Anthropic en OpenAI in één dashboard, met budgetten en alerts per leverancier. De functie staat sinds 14 juli in publieke preview en waarschuwt voordat een budget op is.

OpenAI sluit op 12 november de modeltoegang voor Cursor af
Nieuws
5 min

29 aug 06:10

OpenAI sluit op 12 november de modeltoegang voor Cursor af

OpenAI stopt op 12 november met het leveren van zijn modellen aan Cursor, omdat het eigenaar SpaceX niet vertrouwt. Wat een Nederlands ontwikkelteam verliest en welke routes er tot die datum openliggen.

Island legt nep-AI-adtools bloot die inloggegevens stelen
Nieuws
5 min

6 okt 18:24

Island legt nep-AI-adtools bloot die inloggegevens stelen

Island vond nepportalen die AI-adtools nadoen en wachtwoorden en MFA-antwoorden van marketeers live onderscheppen. Eén beheerlogin kan gekoppelde klantaccounts en campagnebudgetten van Nederlandse bedrijven bereikbaar maken.

OpenAI maakt Codex-cloud herbruikbaar en voegt GitHub-scans toe
Nieuws
3 min

29 sep 21:14

OpenAI maakt Codex-cloud herbruikbaar en voegt GitHub-scans toe

OpenAI brengt Codex naar herbruikbare cloudomgevingen en voegt GitHub-scans, code review en nieuwe agentfuncties toe. Welke onderdelen al beschikbaar zijn, hangt af van het plan en de toegangsrechten per repository.

OpenAI verlaagt API-prijzen voor GPT-6 Sol en Luna
Nieuws
4 min

22 sep 22:12

OpenAI verlaagt API-prijzen voor GPT-6 Sol en Luna

OpenAI brengt GPT-6 Sol en Luna uit met lagere API-tarieven: 2 en 10 dollar voor Sol, 0,10 en 0,50 dollar voor Luna per miljoen tokens. Voor Nederlandse teams wordt modelkeuze per taak belangrijker.