Claude Haiku 5.5 kost vanaf 7 oktober $0,10 per miljoen invoertokens en $0,50 per miljoen uitvoertokens bij prompts tot 100.000 tokens, meldt Anthropic.
Bij 100.000 terugkerende taken per maand met elk 10.000 invoertokens en 1.000 uitvoertokens kost Haiku 4.5 volgens de lijstprijs $1.500. Haiku 5.5 komt uit op $150, een verschil van $1.350 als beide modellen evenveel tokens gebruiken en zonder extra tokens, herhalingen of correcties.

De laagste tarieven gelden tot 100.000 tokens
De 90 procent lagere tarieven gelden voor prompts tot en met 100.000 tokens. Daarboven stijgt Haiku 5.5 naar $0,50 invoer en $2,50 uitvoer per miljoen tokens. Haiku 4.5 kostte $1 en $5, ongeacht de promptlengte.
| Tarief per miljoen tokens | Haiku 4.5 | Haiku 5.5 tot 100.000 tokens | Haiku 5.5 boven 100.000 tokens |
|---|---|---|---|
| Invoer | $1,00 | $0,10 | $0,50 |
| Uitvoer | $5,00 | $0,50 | $2,50 |
| Cache lezen | $0,10 | $0,01 | $0,05 |
Anthropic zegt dat ongeveer 90 procent van de eerdere Haiku 4.5-verzoeken onder de grens viel. Batchverwerking halveert de invoer- en uitvoertarieven: $0,05/$0,25 bij korte prompts en $0,25/$1,25 bij langere. Cache schrijven kost per miljoen tokens $0,125 of $0,625 voor vijf minuten, en $0,20 of $1,00 voor een uur. De documentatie laat batch- en cachekortingen combineren.
Haiku vangt herhaalbare taken op
Anthropic richt het model op hoge aantallen en afgebakend werk: samenvatten, context inkorten, databasevragen en classificatie. Het is beschikbaar via de Claude API, AWS, Google Cloud en Microsoft Azure onder modelnaam claude-haiku-5-5. Haiku 5.5 is het eerste model in de reeks met instelbare inspanningsniveaus, van low tot max. De Python- en TypeScript-SDK’s krijgen in bèta ondersteuning voor computer- en browsergebruik.
Anthropic zet de tariefdaling op 90 procent voor korte prompts, 50 procent voor lange prompts en gemiddeld 75 procent lagere taakkosten. In de eigen tests haalt Haiku 5.5 72,4 procent op OSWorld 2.1 en 39,2 procent op Terminal-Bench 4.0. Haiku 4.5 scoort 15,7 en nul; GPT-6 Luna haalt 48,9 en 16,4. Sonnet 5.5 komt op Terminal-Bench uit op 70,6 procent. Dit zijn resultaten uit Anthropics eigen evaluaties, geen voorspelling van de kosten of kwaliteit op een Nederlands bedrijfsproces.
De prijsreeks schuift naar taakkosten
Bij Opus 5.5 verlaagde Anthropic de input- en outputprijs van $5/$25 naar $4/$20 per miljoen tokens en claimde het bedrijf 40 procent lagere kosten per typische taak. Opus 5.5 kostte $4 en $20 per miljoen tokens; Anthropic claimde 40 procent lagere taakkosten. Sonnet 5.5 hield de prijs op $2/$10 en kreeg een claim van tot 30 procent lagere taakkosten. Sonnet 5.5 hield dezelfde $2 en $10 per miljoen tokens, met een claim van tot 30 procent lagere taakkosten. De bredere prijsbeweging staat ook in de LLM-tokenprijsindex, die sinds midden juli bijna een kwart daalde.
GPT-6 Luna van OpenAI heeft hetzelfde basistarief als Haiku 5.5, $0,10 invoer en $0,50 uitvoer per miljoen tokens. De Luna-prijs blijft op dat niveau tot prompts boven 272.000 invoertokens komen. Alibaba’s Qwen3.7 Flash is op korte prompts goedkoper: Model Studio rekent $0,03/$0,13 tot en met 32.000 invoertokens en $0,10/$0,40 boven 32.000 en tot 256.000 tokens. The New Stack noemt Qwen als goedkopere optie naast Haiku. Deze tarieven vergelijken geen gelijke kwaliteit of slaagkans.
Anthropic verlaagt tegelijk de cacheprijs van Sonnet 5.5 van $0,20 naar $0,10 per miljoen tokens. Het bedrijf schat dat de meeste agentische taken daardoor ongeveer 20 procent goedkoper worden. Anthropic rolt de tegoeden in de week van 7 oktober uit: Max 5x-abonnees krijgen $100 per maand, Max 20x-abonnees $200 en Team-klanten maximaal $500, gedeeld over gebruikers. Het tegoed geldt voor elk Claude-model en is bedoeld voor experimenten met toepassingen en agents.
De rekening volgt het aantal geslaagde taken
Een lager tarief per token leidt niet automatisch tot een even grote daling van de maandrekening. De prijsdocumentatie meldt dat de nieuwere tokenizer, die tekst in tokens opdeelt, dezelfde tekst ongeveer 30 procent meer tokens kan laten opleveren. De precieze toename hangt af van inhoud en werklast. Anthropic verwerkt dit in de gemiddelde besparingsschatting van 75 procent, maar het resultaat verschilt per toepassing.
Een vergelijking begint bij dezelfde representatieve taken op twee modellen. Tel invoer, uitvoer, cachegebruik en herhalingen mee, en leg vast of iemand het antwoord moet herstellen of een groter model alsnog nodig is. Daarom berekenen teams de kosten per bruikbare afronding, inclusief het aantal verwerkte tokens.
Haiku 5.5 past volgens Anthropic bij korte, terugkerende bewerkingen; Sonnet en Opus blijven betere keuzes voor ingewikkelder programmeerwerk. Voor een Nederlandse organisatie met duizenden samenvattingen of classificaties kan Haiku een afgebakende stap in een workflow uitvoeren. De maandrekening volgt dan uit het tokengebruik en het aantal taken dat in één keer goed wordt afgerond.
Veelgestelde vragen
Van prijs naar passende workflow
Ik denk mee welke terugkerende taken bij een kleiner model passen, ontwerp de route en bouw de workflow end-to-end. Waar het kan, richt ik de oplossing self-hosted in, met de controles en koppelingen die je proces nodig heeft.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

