Onderzoeker in witte labjas kijkt door een microscoop, met stapels petrischalen op de achtergrond
Nieuws7 augustus · 06:244 min leestijd

Anthropic versoepelt biologiefilter van Fable 5: 85 procent minder terugval naar een zwakker model

Anthropic versoepelt het biologiefilter van Claude Fable 5. Onschuldige biologievragen belanden volgens eigen tests 85 procent minder vaak bij het zwakkere Opus 5, en op Claude.ai daalt het totale aantal terugvallen met twee derde.

Anthropic versoepelt het biologiefilter van Claude Fable 5: onschuldige biologievragen belanden volgens eigen tests ongeveer 85 procent minder vaak bij het zwakkere Opus 5, meldt het bedrijf in een aankondiging van vandaag.

Dat raakt meer gebruikers dan alleen wie iets met biologie doet. Een terugval betekent dat niet Fable 5 je vraag beantwoordt maar Opus 5, met een melding erbij, en Anthropic verwacht dat het totale aantal terugvallen om welke reden dan ook meezakt: ruwweg 67 procent op Claude.ai, 55 procent op Cowork, 17 procent op Claude Code en 7 procent op het Claude Platform. Wie Claude.ai voor gewoon kenniswerk gebruikt, krijgt dus in twee van de drie gevallen waarin hij eerder werd teruggezet nu wel het topmodel aan de lijn.

Wat het filter nu doorlaat

Fable 5 en het afgeschermde Mythos 5 draaien op hetzelfde onderliggende model. Wat ze scheidt is een set veiligheidsclassifiers: kleine geautomatiseerde systemen die verzoeken tijdens het gesprek meelezen. Vuurt de biologieclassifier, dan bereikt de vraag Fable 5 niet en handelt Opus 5 hem af.

Anthropic heeft de afgelopen weken de constitutie van die classifier herschreven, de regelset waarmee het systeem bepaalt wat binnen en buiten bereik valt. Het bedrijf haalde daar feedback op bij interne en externe experts, bouwde nieuwe trainingsdata en trainde de classifier opnieuw.

Wat dat verschuift, staat in het schema bij de aankondiging. Bij de lancering lag de grens zo ver naar links dat zelfs leerboekbiologie en onschuldig onderzoek in biologie en geneeskunde binnen de veiligheidsmarge vielen en dus werden geblokkeerd. Nu ligt de grens rechts van allebei.

Schema van Anthropic dat de grens van de biologieclassifier bij de lancering van Fable 5 vergelijkt met de nieuwe, ruimere grens. Bron: Anthropic
Schema van Anthropic dat de grens van de biologieclassifier bij de lancering van Fable 5 vergelijkt met de nieuwe, ruimere grens. Bron: Anthropic

Concreet gaat het om alledaagse gezondheids- en onderwijsvragen: labuitslagen interpreteren, symptomen begrijpen, biologie leren. Zorgprofessionals krijgen volgens Anthropic ook meer steun bij klinische taken.

Waar het dicht blijft

Voor dual-use werk gaat er niets open. Fable 5 valt nog altijd terug op Opus 5 bij virologie, toxicologie en moleculair ontwerp, en is daarmee niet bruikbaar voor professioneel biologisch onderzoek en geneesmiddelenontwikkeling. Anthropic zegt dat gat te willen dichten met aparte toegangsroutes voor vertrouwde onderzoekers, zonder daar een datum bij te noemen.

Ook binnen de toegestane zone verdwijnen de valse positieven niet. Het schema houdt een veiligheidsmarge aan: verzoeken die vrijwel zeker onschuldig zijn, maar uit voorzorg toch worden tegengehouden. Dat het bedrijf zo ruim begon, verklaart het uit zijn eigen capaciteitstests, die uitwezen dat Fable 5 een kwaadwillende partij aan kennis kan helpen die nergens anders te vinden is. Het model wekenlang vasthouden tot de vangnetten preciezer stonden woog voor Anthropic niet op tegen die vertraging voor alle andere gebruikers.

Wat de vier percentages verraden

De verschillen tussen de producten zeggen iets over waar je het filter merkte. Op Claude.ai valt het totale aantal terugvallen met ongeveer twee derde weg, op Claude Code met 17 procent en op het Claude Platform met 7 procent. Op die laatste twee oppervlakken was biologie dus nauwelijks de reden dat je werd teruggezet. Daar zit een andere classifier in de weg, en die is met deze update niet aangeraakt: na de herlancering in juli mat testplatform BridgeMind dat negen van de twaalf debugtaken naar het zwakkere model gingen en de debugscore van Fable 5 met 70 procent zakte.

Let ook op wat de cijfers niet zeggen. Het zijn relatieve dalingen zonder gepubliceerd vertrekpunt. Anthropic gaf bij de lancering op 9 juni aan dat de vangnetten van Fable 5 in minder dan 5 procent van de sessies raakten, maar een actueel absoluut percentage per product ontbreekt. Hoe vaak je nu nog op de fallback landt, valt alleen in je eigen logs na te gaan.

Wat het kost als je er landt, is intussen wel veranderd. In juni ging een geblokkeerd verzoek naar Opus 4.8; nu vangt Opus 5 het op, dat prestaties haalt die dicht bij Fable 5 liggen tegen het gewone Opus-tarief. Een terugval kost je daarmee minder dan twee maanden geleden.

Het patroon reikt verder dan biologie. Anthropic zette Fable 5 bewust in de markt met een filter dat te streng stond, en schuift de grens sindsdien stap voor stap op zonder dat er een nieuw versienummer aan te pas komt. Wie zijn werkwijze in juni tegen dit model aanhield, draait in augustus op een andere combinatie van model en filter. Bij een gehost model is het model dus niet het enige dat beweegt. De onzichtbare laag ervoor schuift mee, tussen releases door.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je AI-keten

Als je leverancier stil van model wisselt, wil je weten wat dat met je proces doet. Ik denk daarin met je mee, ontwerp de opzet en bouw hem af, van koppeling tot automatisering en self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Anthropic meet nul geslaagde prompt-injecties bij Opus 5 met browsertoegang
Nieuws
5 min

25 jul 14:24

Anthropic meet nul geslaagde prompt-injecties bij Opus 5 met browsertoegang

Claude Opus 5 laat in Anthropics eigen browsertest van 129 scenario's geen enkele prompt-injectie slagen met auto mode aan, en 3,7 procent zonder. Auto mode zit alleen in Anthropics eigen browserproducten.

Anthropic lanceert Claude Opus 5: bijna Fable 5-niveau tegen het standaard Opus-tarief
Nieuws
4 min

24 jul 20:08

Anthropic lanceert Claude Opus 5: bijna Fable 5-niveau tegen het standaard Opus-tarief

Anthropic bracht Claude Opus 5 uit, een vlaggenschipmodel dat op codeer- en agent-benchmarks bijna het duurdere Fable 5 evenaart. De prijs per token blijft gelijk, maar de kosten per taak dalen fors.

Claude-modellen breken tijdens veiligheidstests in bij drie echte organisaties
Nieuws
5 min

31 jul 02:10

Claude-modellen breken tijdens veiligheidstests in bij drie echte organisaties

Drie Claude-modellen kwamen tijdens cybersecurity-evaluaties bij echte bedrijven binnen, doordat de testomgeving internettoegang had die er niet had mogen zijn. Anthropic doorzocht 141.006 runs en belde drie organisaties die zelf niets hadden gemerkt.

Claude Fable 5 leidt debugtaken stil naar een zwakker model: benchmark keldert 70 procent
Nieuws
6 min

3 jul 06:08

Claude Fable 5 leidt debugtaken stil naar een zwakker model: benchmark keldert 70 procent

Sinds de herlancering op 1 juli stort de debugscore van Claude Fable 5 met 70 procent in. Niet omdat het model slechter werd, maar omdat een nieuwe classifier de meeste codeerverzoeken wegleidt naar Opus 4.8.

Claude Fable 5 verdwijnt per 7 juli uit je abonnement en gaat naar verbruikscredits
Nieuws
4 min

3 jul 04:20

Claude Fable 5 verdwijnt per 7 juli uit je abonnement en gaat naar verbruikscredits

Anthropic haalt zijn krachtigste model Fable 5 op 7 juli uit de wekelijkse limieten van de Pro-, Max-, Team- en een deel van de Enterprise-abonnementen. Daarna reken je het per token af via losse credits.

Twee weken Mythos offline: de impasse met Washington verergert
Nieuws
6 min

26 jun 18:31

Twee weken Mythos offline: de impasse met Washington verergert

Veertien dagen na het exportbevel staan Anthropics zwaarste modellen nog uit en zit het overleg met het Witte Huis muurvast. De expert die het bewijs las, noemt de aanleiding overdreven.