Claude Fable 5.1 leest gecachete tokens vanaf vandaag voor 0,25 dollar per miljoen, 75 procent minder dan bij Fable 5, meldt Anthropic bij de lancering van Fable 5.1 en het afgeschermde Mythos 5.1.
Voor een team dat Claude in productie draait, verandert daarmee de opbouw van de maandrekening en niet het bedrag op de prijslijst. Invoer en uitvoer kosten nog steeds 10 en 50 dollar per miljoen tokens. Alleen het herlezen van al verwerkte context wordt goedkoper, en juist dat is bij agents en codeerwerk de grootste post. Anthropic komt daardoor uit op ongeveer 25 procent lagere kosten voor een typische workload en tot ongeveer 45 procent voor sterk agentisch werk, gemeten over vier weken werkelijk gebruik in augustus 2026.

Waar de korting vandaan komt
Een cache read is het herlezen van invoer die het model al eerder verwerkte: je systeemprompt, de codebase die je meestuurt, de gesprekshistorie van een lange sessie. Bij Fable 5 kostte dat 1,00 dollar per miljoen tokens, tien procent van het invoertarief en de gebruikelijke verhouding bij Claude-modellen. Fable 5.1 rekent 0,25 dollar, oftewel 2,5 procent van het invoertarief, een uitzondering op die vaste verhouding.
Hoeveel je hiervan terugziet hangt af van je eigen verhouding tussen cache reads en overige tokens. Draait er een agent die bij elke stap dezelfde grote context opnieuw inleest, dan is dat het leeuwendeel van je rekening. Doe je vooral korte, losse aanroepen met weinig herhaalde invoer, dan blijft de winst klein. Anthropic baseert de twee percentages op gebruik binnen Claude Enterprise, Claude Code en de API.
Let ook op het effortniveau, want dat bepaalt hoeveel tokens een taak verbruikt. Fable 5.1 staat in Claude Code standaard op High, en in Claude Cowork en op Claude.ai op Medium.
Wat het model meetbaar beter doet
De grootste sprong zit in langlopend, agentisch werk. Op Terminal-Bench-Science 0.1, een test waarin het model zelfstandig wetenschappelijke taken in een terminal afmaakt, meer dan verdubbelt de score. Anthropic zet de cijfers naast zijn eigen vorige modellen en naast GPT-5.6 Sol.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% |
| Terminal-Bench 4.0 | 55,8% | 42,0% | 52,3% |
| AutomationBench | 31,4% | 17,1% | 26,9% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% |
GPT-5.6 Sol blijft in dezelfde tabel op 22,4 procent bij Terminal-Bench-Science en 37,3 procent bij Terminal-Bench 4.0. Het zwaarder toegankelijke Mythos 5.1 haalt op Terminal-Bench 4.0 60,9 procent, een verschil dat volgens Anthropic vooral komt doordat de oude cyberfilters bij Fable ingrepen op een deel van de taken.
Twee kanttekeningen horen erbij. De cijfers komen van de leverancier zelf en zijn geen onafhankelijke meting. En Anthropic geeft bij Terminal-Bench-Science een standaardfout van 3,5 tot 4,5 punt per model op, dus kleine verschillen in die kolom zeggen weinig. Het gat van 52,6 tegen 24,7 procent valt daar ruim buiten.
Minder valse weigeringen
De tweede verandering raakt iedereen die eerder tegen een filter aanliep. De nieuwe cyberfilters blokkeren volgens Anthropic 60 procent minder valse positieven, deels omdat Fable 5.1 nu wel softwarekwetsbaarheden mag opsporen, maar geen exploits mag bouwen. In de biologie bouwt de release voort op het versoepelde filter dat sinds augustus 85 procent minder vaak aanslaat op onschuldige vragen over elementaire biologie en medische onderwerpen.
Dat is geen detail voor wie weet wat zo'n filter kan aanrichten. Na de herlancering van Fable 5 in juli stuurde een nieuwe classifier negen van de twaalf debugtaken door naar het zwakkere Opus 4.8, waarna de gemeten debugscore met 70 procent kelderde. Wie een pijplijn bouwt op een model, wil weten hoe vaak hij stilletjes een ander model aan de lijn krijgt.
Op het punt van dataretentie kondigt Anthropic tegelijk Enterprise Frontier Safeguards aan, waarbij de monitoringdata in de eigen cloudomgeving van de klant blijft staan en die regeling komt vanaf dit najaar gefaseerd beschikbaar.
Hoe de prijs zich verhoudt tot de rest
Ook met goedkopere cache reads blijft Fable 5.1 het duurste model op de markt. Opus 5 rekent 5 en 25 dollar per miljoen tokens, GPT-5.6 Sol staat op een actietarief van 4 en 20 dollar en Gemini 3.7 Flash op 0,75 en 3,75 dollar. De korting maakt Fable dus niet goedkoop, maar verkleint het gat met de klasse eronder voor precies het werktype waarvoor je Fable inzet.
Voor abonnementen verandert er niets aan de spelregels. Op Pro en gewone Team-plekken gaat Fable 5.1 van je verbruikscredits af, terwijl het bij Max en premium-plekken tot de helft van je weeklimiet is inbegrepen. Fable 5.1 staat er meteen breed op: via de Claude API onder de naam claude-fable-5-1 en bij AWS, Google Cloud en Microsoft Azure. Mythos 5.1 blijft beperkt tot geverifieerde partners in cyberdefensie en life sciences, voorlopig alleen Amerikaanse organisaties.
Waar de prijs nu echt beweegt
De premie op het beste model verschuift van het tarief naar de context. In juli kwam de korting nog van een goedkoper model dat bijna hetzelfde kon: Opus 5 bleef op CursorBench binnen een half procent van Fable 5, tegen de helft van de kosten per taak. Nu komt hij van de andere kant, bij hetzelfde topmodel en hetzelfde tokentarief, doordat het herlezen van context vier keer goedkoper wordt.
Dat maakt de prijslijst een slechtere maatstaf dan hij was. Twee teams die evenveel tokens verstoken kunnen sinds vandaag een flink verschillende rekening krijgen, puur door hoeveel van hun invoer al eens gelezen is. De vraag die je begroting bepaalt is niet langer welk model je kiest, maar welk deel van je verkeer bestaat uit tekst die het model al kent.
Veelgestelde vragen
Grip op je AI-rekening
Een tokenkorting helpt pas echt als je workflow erop is ingericht. Ik denk met je mee over waar AI in jouw proces werk overneemt, ontwerp het, bouw het en koppel het aan je bestaande systemen, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
