Twee mensen werken aan code op monitors in een lichte kantoorruimte.
Nieuws1 september · 22:095 min leestijd

Anthropic verlaagt cache reads van Claude Fable 5.1 met 75 procent

Anthropic maakt cache reads voor Claude Fable 5.1 75 procent goedkoper, naar 0,25 dollar per miljoen tokens. Het tokentarief zelf blijft gelijk, dus je besparing hangt af van hoeveel context je herleest.

Claude Fable 5.1 leest gecachete tokens vanaf vandaag voor 0,25 dollar per miljoen, 75 procent minder dan bij Fable 5, meldt Anthropic bij de lancering van Fable 5.1 en het afgeschermde Mythos 5.1.

Voor een team dat Claude in productie draait, verandert daarmee de opbouw van de maandrekening en niet het bedrag op de prijslijst. Invoer en uitvoer kosten nog steeds 10 en 50 dollar per miljoen tokens. Alleen het herlezen van al verwerkte context wordt goedkoper, en juist dat is bij agents en codeerwerk de grootste post. Anthropic komt daardoor uit op ongeveer 25 procent lagere kosten voor een typische workload en tot ongeveer 45 procent voor sterk agentisch werk, gemeten over vier weken werkelijk gebruik in augustus 2026.

Officiële aankondigingskaart van Claude Fable 5.1 en Mythos 5.1. Bron: Anthropic
Officiële aankondigingskaart van Claude Fable 5.1 en Mythos 5.1. Bron: Anthropic

Waar de korting vandaan komt

Een cache read is het herlezen van invoer die het model al eerder verwerkte: je systeemprompt, de codebase die je meestuurt, de gesprekshistorie van een lange sessie. Bij Fable 5 kostte dat 1,00 dollar per miljoen tokens, tien procent van het invoertarief en de gebruikelijke verhouding bij Claude-modellen. Fable 5.1 rekent 0,25 dollar, oftewel 2,5 procent van het invoertarief, een uitzondering op die vaste verhouding.

Geïndexeerde kosten van dezelfde workload op Fable 5 en Fable 5.1, Fable 5 = 100 (bron: Anthropic)

Hoeveel je hiervan terugziet hangt af van je eigen verhouding tussen cache reads en overige tokens. Draait er een agent die bij elke stap dezelfde grote context opnieuw inleest, dan is dat het leeuwendeel van je rekening. Doe je vooral korte, losse aanroepen met weinig herhaalde invoer, dan blijft de winst klein. Anthropic baseert de twee percentages op gebruik binnen Claude Enterprise, Claude Code en de API.

Let ook op het effortniveau, want dat bepaalt hoeveel tokens een taak verbruikt. Fable 5.1 staat in Claude Code standaard op High, en in Claude Cowork en op Claude.ai op Medium.

Wat het model meetbaar beter doet

De grootste sprong zit in langlopend, agentisch werk. Op Terminal-Bench-Science 0.1, een test waarin het model zelfstandig wetenschappelijke taken in een terminal afmaakt, meer dan verdubbelt de score. Anthropic zet de cijfers naast zijn eigen vorige modellen en naast GPT-5.6 Sol.

BenchmarkFable 5.1Fable 5Opus 5
Terminal-Bench-Science 0.152,6%24,7%29,0%
Terminal-Bench 4.055,8%42,0%52,3%
AutomationBench31,4%17,1%26,9%
CursorBench 3.2.073,4%70,5%70,0%

GPT-5.6 Sol blijft in dezelfde tabel op 22,4 procent bij Terminal-Bench-Science en 37,3 procent bij Terminal-Bench 4.0. Het zwaarder toegankelijke Mythos 5.1 haalt op Terminal-Bench 4.0 60,9 procent, een verschil dat volgens Anthropic vooral komt doordat de oude cyberfilters bij Fable ingrepen op een deel van de taken.

Twee kanttekeningen horen erbij. De cijfers komen van de leverancier zelf en zijn geen onafhankelijke meting. En Anthropic geeft bij Terminal-Bench-Science een standaardfout van 3,5 tot 4,5 punt per model op, dus kleine verschillen in die kolom zeggen weinig. Het gat van 52,6 tegen 24,7 procent valt daar ruim buiten.

Minder valse weigeringen

De tweede verandering raakt iedereen die eerder tegen een filter aanliep. De nieuwe cyberfilters blokkeren volgens Anthropic 60 procent minder valse positieven, deels omdat Fable 5.1 nu wel softwarekwetsbaarheden mag opsporen, maar geen exploits mag bouwen. In de biologie bouwt de release voort op het versoepelde filter dat sinds augustus 85 procent minder vaak aanslaat op onschuldige vragen over elementaire biologie en medische onderwerpen.

Dat is geen detail voor wie weet wat zo'n filter kan aanrichten. Na de herlancering van Fable 5 in juli stuurde een nieuwe classifier negen van de twaalf debugtaken door naar het zwakkere Opus 4.8, waarna de gemeten debugscore met 70 procent kelderde. Wie een pijplijn bouwt op een model, wil weten hoe vaak hij stilletjes een ander model aan de lijn krijgt.

Op het punt van dataretentie kondigt Anthropic tegelijk Enterprise Frontier Safeguards aan, waarbij de monitoringdata in de eigen cloudomgeving van de klant blijft staan en die regeling komt vanaf dit najaar gefaseerd beschikbaar.

Hoe de prijs zich verhoudt tot de rest

Ook met goedkopere cache reads blijft Fable 5.1 het duurste model op de markt. Opus 5 rekent 5 en 25 dollar per miljoen tokens, GPT-5.6 Sol staat op een actietarief van 4 en 20 dollar en Gemini 3.7 Flash op 0,75 en 3,75 dollar. De korting maakt Fable dus niet goedkoop, maar verkleint het gat met de klasse eronder voor precies het werktype waarvoor je Fable inzet.

Voor abonnementen verandert er niets aan de spelregels. Op Pro en gewone Team-plekken gaat Fable 5.1 van je verbruikscredits af, terwijl het bij Max en premium-plekken tot de helft van je weeklimiet is inbegrepen. Fable 5.1 staat er meteen breed op: via de Claude API onder de naam claude-fable-5-1 en bij AWS, Google Cloud en Microsoft Azure. Mythos 5.1 blijft beperkt tot geverifieerde partners in cyberdefensie en life sciences, voorlopig alleen Amerikaanse organisaties.

Waar de prijs nu echt beweegt

De premie op het beste model verschuift van het tarief naar de context. In juli kwam de korting nog van een goedkoper model dat bijna hetzelfde kon: Opus 5 bleef op CursorBench binnen een half procent van Fable 5, tegen de helft van de kosten per taak. Nu komt hij van de andere kant, bij hetzelfde topmodel en hetzelfde tokentarief, doordat het herlezen van context vier keer goedkoper wordt.

Dat maakt de prijslijst een slechtere maatstaf dan hij was. Twee teams die evenveel tokens verstoken kunnen sinds vandaag een flink verschillende rekening krijgen, puur door hoeveel van hun invoer al eens gelezen is. De vraag die je begroting bepaalt is niet langer welk model je kiest, maar welk deel van je verkeer bestaat uit tekst die het model al kent.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je AI-rekening

Een tokenkorting helpt pas echt als je workflow erop is ingericht. Ik denk met je mee over waar AI in jouw proces werk overneemt, ontwerp het, bouw het en koppel het aan je bestaande systemen, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Anthropic lanceert Claude Opus 5: bijna Fable 5-niveau tegen het standaard Opus-tarief
Nieuws
4 min

24 jul 20:08

Anthropic lanceert Claude Opus 5: bijna Fable 5-niveau tegen het standaard Opus-tarief

Anthropic bracht Claude Opus 5 uit, een vlaggenschipmodel dat op codeer- en agent-benchmarks bijna het duurdere Fable 5 evenaart. De prijs per token blijft gelijk, maar de kosten per taak dalen fors.

Anthropic meet nul geslaagde prompt-injecties bij Opus 5 met browsertoegang
Nieuws
5 min

25 jul 14:24

Anthropic meet nul geslaagde prompt-injecties bij Opus 5 met browsertoegang

Claude Opus 5 laat in Anthropics eigen browsertest van 129 scenario's geen enkele prompt-injectie slagen met auto mode aan, en 3,7 procent zonder. Auto mode zit alleen in Anthropics eigen browserproducten.

Anthropic geeft Claude Cowork een eigen browser in de desktop-app
Nieuws
4 min

27 aug 14:23

Anthropic geeft Claude Cowork een eigen browser in de desktop-app

Claude Cowork heeft sinds 26 augustus een eigen browser in de desktop-app, los van je tabbladen, bookmarks en wachtwoorden. Logins gaan er per site heen, bank, mail en single sign-on standaard niet.

OpenAI sluit op 12 november de modeltoegang voor Cursor af
Nieuws
5 minBijgewerkt om 16:11

29 aug 06:10

OpenAI sluit op 12 november de modeltoegang voor Cursor af

OpenAI stopt op 12 november met het leveren van zijn modellen aan Cursor, omdat het eigenaar SpaceX niet vertrouwt. Wat een Nederlands ontwikkelteam verliest en welke routes er tot die datum openliggen.

OpenAI verlaagt prijs GPT-5.6 Sol tijdelijk naar 4 en 20 dollar per miljoen tokens
Nieuws
4 min

22 aug 00:10

OpenAI verlaagt prijs GPT-5.6 Sol tijdelijk naar 4 en 20 dollar per miljoen tokens

OpenAI zet GPT-5.6 Sol drie maanden lang op 4 dollar invoer en 20 dollar uitvoer per miljoen tokens. De uitvoerprijs zakt een derde, precies de post waar agentprocessen het meeste verbruiken.

OpenAI groeit harder dan Anthropic in zakelijke AI-uitgaven: 82 tegen 76 procent
Nieuws
5 min

21 aug 12:12

OpenAI groeit harder dan Anthropic in zakelijke AI-uitgaven: 82 tegen 76 procent

Tokendata van betaalbedrijf Ramp laten zien dat OpenAI dit kwartaal harder groeit in zakelijke AI-uitgaven dan Anthropic, 82 tegen 76 procent. In adoptie ligt Anthropic nog voor, maar de rangorde kantelt per modelrelease.