Een open MacBook met code op het scherm op een bureau.
Nieuws7 oktober · 22:294 min leestijd

Anthropic lanceert Haiku 5.5 met 90% lagere korte-prompttarieven

Anthropic brengt Claude Haiku 5.5 uit met 90 procent lagere API-tarieven voor prompts tot 100.000 tokens. De gemiddelde taakkosten dalen volgens het bedrijf met 75 procent, al telt de nieuwe tokenizer meer tokens.

Claude Haiku 5.5 kost vanaf 7 oktober $0,10 per miljoen invoertokens en $0,50 per miljoen uitvoertokens bij prompts tot 100.000 tokens, meldt Anthropic.

Bij 100.000 terugkerende taken per maand met elk 10.000 invoertokens en 1.000 uitvoertokens kost Haiku 4.5 volgens de lijstprijs $1.500. Haiku 5.5 komt uit op $150, een verschil van $1.350 als beide modellen evenveel tokens gebruiken en zonder extra tokens, herhalingen of correcties.

Officiële aankondigingsafbeelding met de naam Claude Haiku 5.5. Bron: Anthropic
Officiële aankondigingsafbeelding met de naam Claude Haiku 5.5. Bron: Anthropic

De laagste tarieven gelden tot 100.000 tokens

De 90 procent lagere tarieven gelden voor prompts tot en met 100.000 tokens. Daarboven stijgt Haiku 5.5 naar $0,50 invoer en $2,50 uitvoer per miljoen tokens. Haiku 4.5 kostte $1 en $5, ongeacht de promptlengte.

Tarief per miljoen tokensHaiku 4.5Haiku 5.5 tot 100.000 tokensHaiku 5.5 boven 100.000 tokens
Invoer$1,00$0,10$0,50
Uitvoer$5,00$0,50$2,50
Cache lezen$0,10$0,01$0,05

Anthropic zegt dat ongeveer 90 procent van de eerdere Haiku 4.5-verzoeken onder de grens viel. Batchverwerking halveert de invoer- en uitvoertarieven: $0,05/$0,25 bij korte prompts en $0,25/$1,25 bij langere. Cache schrijven kost per miljoen tokens $0,125 of $0,625 voor vijf minuten, en $0,20 of $1,00 voor een uur. De documentatie laat batch- en cachekortingen combineren.

Haiku vangt herhaalbare taken op

Anthropic richt het model op hoge aantallen en afgebakend werk: samenvatten, context inkorten, databasevragen en classificatie. Het is beschikbaar via de Claude API, AWS, Google Cloud en Microsoft Azure onder modelnaam claude-haiku-5-5. Haiku 5.5 is het eerste model in de reeks met instelbare inspanningsniveaus, van low tot max. De Python- en TypeScript-SDK’s krijgen in bèta ondersteuning voor computer- en browsergebruik.

Anthropic zet de tariefdaling op 90 procent voor korte prompts, 50 procent voor lange prompts en gemiddeld 75 procent lagere taakkosten. In de eigen tests haalt Haiku 5.5 72,4 procent op OSWorld 2.1 en 39,2 procent op Terminal-Bench 4.0. Haiku 4.5 scoort 15,7 en nul; GPT-6 Luna haalt 48,9 en 16,4. Sonnet 5.5 komt op Terminal-Bench uit op 70,6 procent. Dit zijn resultaten uit Anthropics eigen evaluaties, geen voorspelling van de kosten of kwaliteit op een Nederlands bedrijfsproces.

De prijsreeks schuift naar taakkosten

Bij Opus 5.5 verlaagde Anthropic de input- en outputprijs van $5/$25 naar $4/$20 per miljoen tokens en claimde het bedrijf 40 procent lagere kosten per typische taak. Opus 5.5 kostte $4 en $20 per miljoen tokens; Anthropic claimde 40 procent lagere taakkosten. Sonnet 5.5 hield de prijs op $2/$10 en kreeg een claim van tot 30 procent lagere taakkosten. Sonnet 5.5 hield dezelfde $2 en $10 per miljoen tokens, met een claim van tot 30 procent lagere taakkosten. De bredere prijsbeweging staat ook in de LLM-tokenprijsindex, die sinds midden juli bijna een kwart daalde.

GPT-6 Luna van OpenAI heeft hetzelfde basistarief als Haiku 5.5, $0,10 invoer en $0,50 uitvoer per miljoen tokens. De Luna-prijs blijft op dat niveau tot prompts boven 272.000 invoertokens komen. Alibaba’s Qwen3.7 Flash is op korte prompts goedkoper: Model Studio rekent $0,03/$0,13 tot en met 32.000 invoertokens en $0,10/$0,40 boven 32.000 en tot 256.000 tokens. The New Stack noemt Qwen als goedkopere optie naast Haiku. Deze tarieven vergelijken geen gelijke kwaliteit of slaagkans.

Anthropic verlaagt tegelijk de cacheprijs van Sonnet 5.5 van $0,20 naar $0,10 per miljoen tokens. Het bedrijf schat dat de meeste agentische taken daardoor ongeveer 20 procent goedkoper worden. Anthropic rolt de tegoeden in de week van 7 oktober uit: Max 5x-abonnees krijgen $100 per maand, Max 20x-abonnees $200 en Team-klanten maximaal $500, gedeeld over gebruikers. Het tegoed geldt voor elk Claude-model en is bedoeld voor experimenten met toepassingen en agents.

De rekening volgt het aantal geslaagde taken

Een lager tarief per token leidt niet automatisch tot een even grote daling van de maandrekening. De prijsdocumentatie meldt dat de nieuwere tokenizer, die tekst in tokens opdeelt, dezelfde tekst ongeveer 30 procent meer tokens kan laten opleveren. De precieze toename hangt af van inhoud en werklast. Anthropic verwerkt dit in de gemiddelde besparingsschatting van 75 procent, maar het resultaat verschilt per toepassing.

Een vergelijking begint bij dezelfde representatieve taken op twee modellen. Tel invoer, uitvoer, cachegebruik en herhalingen mee, en leg vast of iemand het antwoord moet herstellen of een groter model alsnog nodig is. Daarom berekenen teams de kosten per bruikbare afronding, inclusief het aantal verwerkte tokens.

Haiku 5.5 past volgens Anthropic bij korte, terugkerende bewerkingen; Sonnet en Opus blijven betere keuzes voor ingewikkelder programmeerwerk. Voor een Nederlandse organisatie met duizenden samenvattingen of classificaties kan Haiku een afgebakende stap in een workflow uitvoeren. De maandrekening volgt dan uit het tokengebruik en het aantal taken dat in één keer goed wordt afgerond.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van prijs naar passende workflow

Ik denk mee welke terugkerende taken bij een kleiner model passen, ontwerp de route en bouw de workflow end-to-end. Waar het kan, richt ik de oplossing self-hosted in, met de controles en koppelingen die je proces nodig heeft.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Anthropic lanceert Claude Opus 5.5 met lagere taakkosten
Nieuws
3 min

22 sep 20:15

Anthropic lanceert Claude Opus 5.5 met lagere taakkosten

Anthropic brengt Claude Opus 5.5 uit met 20 procent lagere input- en outputtarieven en volgens het bedrijf 40 procent lagere kosten per typische taak. Het verschil zit in tokens, niet alleen in de prijslijst.

Anthropic breidt Claude-cybertoegang uit met drie niveaus
Nieuws
4 min

7 okt 00:09

Anthropic breidt Claude-cybertoegang uit met drie niveaus

Anthropic geeft securityteams drie toegangsniveaus voor Claude-cybermodellen. Elk niveau biedt dezelfde modelreeks, maar verschilt in toegestane taken, verificatie, beveiliging en gegevensbewaring voor teams die kwetsbaarheden onderzoeken of systemen testen.

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging
Nieuws
3 minBijgewerkt om 14:47

1 okt 00:30

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging. De eerste uitrol gaat naar cyberverdedigers en vertrouwde testers; algemene toegang voor Nederlandse teams is nog niet aangekondigd.

AWS maakt Strands Harness open source voor modelonafhankelijke agenten
Nieuws
4 min

22 sep 02:49

AWS maakt Strands Harness open source voor modelonafhankelijke agenten

AWS maakt Strands Harness open source onder Apache 2.0. De agentlaag draait lokaal of in elke cloud, wisselt van model en gebruikt volgens AWS 28 procent minder tokens bij vergelijkbare scores.

ChatGPT, Claude en Grok vallen tegelijk uit, oorzaak onbekend
Nieuws
4 min

3 sep 20:19

ChatGPT, Claude en Grok vallen tegelijk uit, oorzaak onbekend

ChatGPT, Claude en Grok lagen donderdag ruim anderhalf uur tegelijk plat. Geen van de drie aanbieders noemt een oorzaak. Voor wie AI in een productieproces heeft, verliest een tweede leverancier als terugvaloptie daarmee zijn waarde.

Anthropic watermerkt alle tekst van Claude, wereldwijd
Nieuws
5 min

11 aug 02:10

Anthropic watermerkt alle tekst van Claude, wereldwijd

Anthropic weeft een onzichtbaar watermerk in alle tekst die Claude genereert, wereldwijd en op modelniveau, vanaf modellen van na 2 augustus 2026. Dat verandert de herkomst van je output, niet je eigen meldplicht als ondernemer.