Anthropic heeft Claude Fable 5.1 en Claude Mythos 5.1 gepresenteerd, twee versies van hetzelfde model gericht op programmeren, agenten, professionele taken en wetenschappelijk onderzoek, maar verschillen in beveiligingscontrole. Fable 5.1 is algemeen beschikbaar, terwijl Mythos 5.1 aanvankelijk beperkt is tot geverifieerde professionals in cybersecurity en de biowetenschappen.
De kernpunten van Claude Fable 5.1 in 30 seconden
- Fable 5.1 onderscheidt zich vooral in agentgebaseerd programmeren, wetenschappelijk onderzoek, automatisering en computergebruik.
- Anthropic schat dat de kosten ongeveer 25 % lager zijn bij reguliere belasting en tot 45 % bij intensieve processen met context en tools.
- Cache-oproepen dalen met 75 %, tot ongeveer €0,25 per miljoen tokens.
- Mythos 5.1 deelt hetzelfde model als Fable maar heeft verschillende controles voor geverifieerde professionals.
- Fable 5.1 maakt het mogelijk om software-kwetsbaarheden te zoeken, met beperkingen op de generatie van exploits en andere dual-use activiteiten.
De lancering toont ook de wervingsrichting van de concurrentie onder de meest geavanceerde modellen. Successen worden niet langer alleen gemeten aan correcte antwoorden of codegeneratie. Anthropic richt zich nu op langdurige taken, gebruik van tools, onderzoek, interactie met computers en vooral op de kosten van het langdurig laten werken van een agent.
Dit laatste punt verklaart een van de ogenschijnlijk kleine wijzigingen in Fable 5.1 die er in de praktijk grote impact kan hebben: de verlaging van de cachekosten.
Fable 5.1 is vooral voordeliger bij langere werktijden van de AI
Anthropic presenteert Fable 5.1 als een belangrijke evolutie ten opzichte van Fable 5 en ondersteunt dit met diverse testresultaten.
In Terminal-Bench-Science 0.1, een test voor wetenschappelijk onderzoek via agenten, behaalt Fable 5.1 een score van 52,6 %, tegenover 24,7 % voor Fable 5. In tests door Anthropic scoorden Opus 5 29,0 % en GPT-5.6 Sol 22,4 %.
Bij agentgericht programmeren met Terminal-Bench 4.0 behaalt Fable 5.1 55,8 %. Mythos 5.1 bereikt 60,9 %, terwijl Fable 5 42,0 % en Opus 5 52,3 % scoren.
De verschillen in andere tests zijn kleiner maar bevestigen verbeteringen ten opzichte van vorige generatie.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6 % | 24,7 % | 29,0 % | 22,4 % |
| Terminal-Bench 4.0 | 55,8 %* | 42,0 % | 52,3 % | 37,3 % |
| AutomationBench | 31,4 % | 17,1 % | 26,9 % | 19,6 % |
| CursorBench 3.2.0 | 73,4 % | 70,5 % | 70,0 % | 67,2 % |
* Mythos 5.1 behaalt 60,9 % in Terminal-Bench 4.0.
De resultaten zijn afkomstig uit door Anthropic gepubliceerde evaluaties en moeten worden geïnterpreteerd binnen de beschrijvingen van de gebruikte configuraties en methodologieën. Niet alle modellen werden in alle tests beoordeeld.
Wat mogelijk nog belangrijker is dan enkele punten verschil, is de prestatie tijdens langdurige processen.
Huidige programmeer-agenten kunnen bestanden openen, code aanpassen, testen uitvoeren, documentatie raadplegen en terugkeren op hun eigen veranderingen. Hoe langer het proces, des te groter de kans dat het model de draad verliest, een verkeerde weg inslaat of zich beperkt tot oppervlakkige oplossingen.
Anthropic beweert dat Fable 5.1 beter in staat is om de onderliggende oorzaak van een probleem te vinden. Als voorbeeld noemt het Millennium, waarbij het model de oorzaak vond van een zeldzaam intern systeemfoutje dat al jaren niet kon worden verklaard.
Hoewel dit geval door een klant met vroege toegang werd aangeleverd en geen onafhankelijk benchmark is, geeft het goed weer voor welk soort problemen deze modellen ontworpen worden.
De cache wordt een belangrijke kostenfactor voor agenten
Fable 5.1 behoudt dezelfde prijs als Fable 5: 10 dollar per miljoen invoertokens en 50 dollar per miljoen uitvoertokens.
Het verschil zit in hergebruik van eerder verwerkte context.
Anthropic verlaagt de prijs van cache-oproepen met 75 %, naar 0,25 dollar per miljoen tokens.
Dit lijkt misschien een kleine verandering, maar agents gebruiken vaak grote hoeveelheden informatie.
Een ontwikkelingsagent kan bijvoorbeeld in de context bestanden uit de repository, documentatie, instructies, eerdere resultaten, gesprekken en antwoorden van tools opnemen. Als die informatie herhaaldelijk geraadpleegd wordt over tientallen stappen, beïnvloedt een verlaging van de cachekosten het totale kostenplaatje aanzienlijk.
Volgens vier weken monitoring door Anthropic in augustus 2026, is Fable 5.1 ongeveer 25 % goedkoper dan Fable 5 bij typische workload.
Bij zeer agentgerichte, context- en toolsintensieve workflows wordt de kostenbesparing geschat op ongeveer 45 %.
Dit betekent niet dat het gebruik van Fable 5.1 automatisch 45 % goedkoper wordt. De werkelijke besparing hangt af van hoeveel context hergebruikt kan worden en de verhouding tussen tokens voor input, output en cache.
Wel benadrukt het een steeds crucialer wordende factor: om de kosten van een model als agent te beoordelen, is niet meer alleen de nominale prijs per miljoen tokens relevant.
Fable kan kwetsbaarheden opsporen; Mythos verbreedt defensieve toegang
Cybersecurity blijft een belangrijke onderscheidende factor bij deze generatie.
Anthropic stelt dat Claude Fable 5.1 gebruikt kan worden om software-kwetsbaarheden te identificeren, waardoor het defensieve taken kan uitvoeren zonder het systeem te activeren.
Het bedrijf beweert dat de veiligheidsmaatregelen verfijnder zijn en dat gebruikers van Claude Code ongeveer 60 % minder interventies nodig zullen hebben per sessie dan bij eerdere versies van Fable.
Dit sluit beperkingen niet uit.
Bepaalde dual-use activiteiten, zoals het genereren van exploits, sommige pentests en kwetsbaarheidsanalyses van binaries, blijven onder aanvullend toezicht.
Voor werkzaamheden die meer vrijheid vereisen, is er Claude Mythos 5.1.
Anthropic benadrukt dat Fable 5.1 en Mythos 5.1 hetzelfde model zijn, maar Mythos beschikt over aangepaste beveiligingen voor geverifieerde professionals.
Toegang wordt georganiseerd via het Cyber Verification Program en het Life Sciences Verification Program. In eerste instantie is Mythos 5.1 beschikbaar voor een selecte groep Amerikaanse organisaties, met plannen om het programma later uit te breiden.
Claude Security, de tool die systemen doorzoekt naar kwetsbaarheden en patches voorstelt, gebruikt nu Mythos 5.1.
Deze opsplitsing tussen technische capaciteit en gebruiksrechten kan een standaard worden voor frontier-modellen. Eenzelfde model kan verschillende gedragingen vertonen afhankelijk van de identiteit en het doel van de gebruiker, vooral bij dual-use toepassingen.
Anthropic richt zich op wetenschappelijk onderzoek met AI-agenten
Een andere belangrijke focus is de wetenschap.
Anthropic heeft Fable 5.1 en Mythos 5.1 getest op moleculair ontwerp, wetenschappelijke analyse en modeloptimalisatie in computational biology.
Bij een experiment genereerde Mythos 5.1 moleculaire bindingsontwerpen, die nadien extern werden gevalideerd. Anthropic beweert dat in drie doelstellingen affiniteiten werden bereikt die tien keer hoger waren dan de beste ontwerpen uit de competities van Adaptyv Bio, met een haalbaarheidsgraad van bijna 50 % voor 12 doelstellingen.
In een ander project trainde Fable 5.1 een neuraal netwerk om een hoogtekaart van ongeveer een derde van Venus te maken, gebaseerd op radarbeelden van NASA’s Magellan-missie van meer dan dertig jaar geleden.
De resolutie van de kaart bereikt volgens Anthropic details van 2 tot 3 kilometer, een verbetering ten opzichte van eerdere studies met 10-20 km, en de nauwkeurigheid van de hoogte schommelt tot 25 %.
Mythos 5.1 schreef ook aangepaste kernels voor GPU en paste cache-technieken toe om zeven open deep learning-modellen te versnellen die worden gebruikt in genomics en proteïnentechnologie. De verbeteringen variëren tussen 1,4 en 2,5 keer op een NVIDIA H100.
Anthropic schat dat deze optimalisaties de GPU-kosten voor bepaalde analyses met 30-60 % kunnen verminderen.
Hoewel het om specifieke experimenten gaat, illustreren ze dat deze modellen verder gaan dan de klassieke chatbot: ze kunnen complexe problemen aanpakken, gebruik maken van gespecialiseerde software en langdurige werkprocessen ondersteunen.
Bedrijfsprivacy en een onzichtbaar merkteken in teksten
Anthropic introduceert ook Enterprise Frontier Safeguards (EFS), een systeem dat controle op misbruik combineert met bedrijfsprivacy.
Met EFS worden gegevens opgeslagen in cloud-infrastructuur onder controle van de klant, niet bij Anthropic. Het bedrijf vergelijkt de privacyniveau met een zero-retentie-overeenkomst.
De implementatie start in de herfst in fasen. Anthropic werkte met meer dan 100 klanten aan dit systeem en zet het in op Claude Code, Claude Enterprise, Claude Platform en verschillende cloudplatformen.
Fable 5.1 bevat ook een bijzonder kenmerk: een onzichtbaar watermerk in de gegenereerde tekst.
Anthropic koppelt deze maatregel aan haar verplichtingen in de Code of Best Practices inzake Transparantie van door AI gegenereerde inhoud, in het kader van de Europese AI-verordening.
Het watermerk is niet zichtbaar in het document. Het is ontworpen om via een API te bepalen of Claude heeft bijgedragen aan de inhoud, zonder informatie over de gebruiker, organisatie of gesprekken te delen.
De detectie-API is momenteel in private preview voor selecte organisaties, waaronder toezichthouders, media, verificatoren, onderzoekers en instellingen die deze signalen willen controleren.
Fable 5.1 is beschikbaar via de platforms van Anthropic en als claude-fable-5-1 in hun API. Mythos 5.1 blijft aanvankelijk achter een gecontroleerd toegangssysteem.
Buiten de specifieke benchmarkresultaten laat de lancering zien dat drie trends in de volgende generatie modellen toenemen in belang: hoe lang ze autonoom kunnen werken, wat het kost om dat werk te onderhouden en welke functies zonder hetzelfde toegangsniveau kunnen worden aangeboden.
Veelgestelde vragen
Wat is het verschil tussen Claude Fable 5.1 en Mythos 5.1?
Anthropic bevestigt dat ze hetzelfde model gebruiken. Het belangrijkste verschil zit in de veiligheidsmaatregelen: Fable 5.1 is algemeen beschikbaar, Mythos 5.1 biedt meer permissieve controles voor geverifieerde professionals in cybersecurity en life sciences.
Hoeveel kost Claude Fable 5.1?
De basisprijs is 10 dollar per miljoen invoertokens en 50 dollar per miljoen uitvoertokens. Cache-oproepen kosten 0,25 dollar per miljoen, 75 % minder dan voorheen.
Kan Fable 5.1 kwetsbaarheden opsporen?
Ja. Anthropic stelt dat het gebruikt kan worden om software-kwetsbaarheden te identificeren voor defensieve doeleinden. Activiteiten zoals het genereren van exploits en bepaalde pentests blijven onder aanvullende restricties.
Waarom kan Fable 5.1 goedkoper zijn bij taken met agenten?
Agenten hergebruiken herhaaldelijk grote hoeveelheden context. Door de verlaging van cachekosten schat Anthropic dat de kosten ongeveer 25 % lager zijn bij typische workloads en kunnen oplopen tot circa 45 % bij zeer context- en toolintensieve processen.
