Anthropic heeft Claude Opus 5 geïntroduceerd, een model ontworpen om de ruimte tussen de algemene assistenten en de krachtigste systemen voor complexe taken in te vullen. Het bedrijf beweert dat het model bijna hetzelfde prestatieniveau behaalt als Claude Fable 5 op het gebied van programmeren, automatisering en professioneel analysewerk, maar met aanzienlijk lagere kosten per taak. Dit nieuwe model is nu beschikbaar en wordt de meest geavanceerde optie binnen Claude Pro en de standaard binnen Claude Max.
De kernpunten van Claude Opus 5 in 20 seconden
- Opus 5 verbetert prestaties in programmeren, automatisering, wetenschappelijke analyse en autonome computertoepassingen.
- Anthropic stelt dat het model dicht bij Fable 5 komt, met ongeveer de helft van de kosten per taak in sommige tests.
- De API hanteert nog steeds de prijs van Opus 4.8: 5 dollar per miljoen tokens voor invoer en 25 dollar per miljoen tokens voor uitvoer.
- In vergelijking met GPT-5.6 Sol is het goedkoper bij het genereren van antwoorden, hoewel elk model uitblinkt in verschillende beoordelingsgebieden.
De strategie van Anthropic is gemakkelijk te volgen. Fable 5 behoudt de positie van meest geavanceerde model voor langdurige projecten, terwijl Opus 5 zich richt op ontwikkelaars, analisten en teams die regelmatig complexe taken uitvoeren. Het model is niet enkel bedoeld om hoge benchmarkscores te halen, maar om voldoende capaciteit te bieden voor het inzetten van AI-agents in productie zonder dat elke taak ontoereikend wordt qua budget voor toonaangevende modellen.
Een model dat zijn werk eerst controleert voordat het het afrondt
De belangrijkste belofte van Claude Opus 5 is niet alleen betere antwoorden geven. Anthropic beweert dat het model meer initiatief toont in het herzien van eigen resultaten, het opsporen van fouten en het herhalen van stappen wanneer de eerste oplossing niet werkt.
Het bedrijf geeft verschillende voorbeelden uit tests en early access, zoals een Frontier-Bench-opdracht waarin Opus 5 een tekening van een mechanisch onderdeel ontving dat gereconstrueerd moest worden in FreeCAD. Omdat het model niet rechtstreeks de afbeelding kon raadplegen, ontwikkelde het een klein computervisiesysteem om geometrie uit pixels te extraheren en daarna het 3D-model te genereren.
In een andere test analyseerde het een echte bug in een open-source pakketbeheerder. Anthropic zegt dat het niet alleen het symptoom corrigeerde, maar ook de oorzaak lokaliseerde en een randgeval oploste dat in een eerdere oplossing over het hoofd was gezien. Een ingenieur van een financiële firma gebruikte het model daarnaast om een marktgegevensbron op te bouwen, waarbij het model door het ontbreken van een actieve verbinding zijn eigen testomgeving creëerde.
Deze cases zijn door Anthropic geselecteerd en vormen geen vervanging voor externe evaluaties, maar illustreren wel de verandering die het bedrijf probeert te realiseren. Opus 5 is ontworpen als een systeem dat het doel tijdens een langdurige taak kan vasthouden, hulpmiddelen kan gebruiken en de resultaten kan verifiëren — niet als een chatbot die code levert zonder te controleren of die werkt.
De verbetering is vooral zichtbaar in programmeren. Anthropic stelt dat Opus 5 beter presteert dan andere modellen in Frontier-Bench v0.1 en meer dan het dubbele haalt dan Opus 4.8, met lagere kosten per taak. In CursorBench 3.2, bij maximale inspanning, ligt het resultaat op slechts 0,5% achter Fable 5, terwijl het ongeveer de helft van het budget verbruikt.

Gebruikers kunnen het prestatieniveau aanpassen om te kiezen tussen meer redenering of snellere, goedkopere antwoorden. Deze optie is vooral interessant in bedrijfsomgevingen, waar niet elke taak het gebruik van de meest veeleisende configuratie rechtvaardigt.
Claude Opus 5 versus GPT-5.6: twee manieren om de markt te ordenen
Anthropic en OpenAI concluderen vergelijkbaar dat één enkel model niet langer effectief alle taken kan dekken. Beide bedrijven hebben hun catalogi opgesplitst in verschillende niveaus op basis van capaciteit, snelheid en prijs.
Opus 5 wordt gepositioneerd als het geavanceerde model voor dagelijks gebruik door Anthropic, onder Fable 5 voor langdurige projecten, en onder Mythos 5 voor bepaalde wetenschappelijke en cybersecurity-capaciteiten. OpenAI volgt een andere structuur met de GPT-5.6-familie: Sol biedt de hoogste prestaties, Terra balans tussen capaciteit en kosten, en Luna prioriteit voor snelheid en lage kosten.
| Model | Positie in catalogus | Prijs per 1 miljoen tokens | Gebruiksfocus |
|---|---|---|---|
| Claude Opus 5 | Modell voor dagelijks gebruik | 5 $ invoer / 25 $ uitvoer | Code, analyse, professionele agents |
| Claude Fable 5 | Anthropic’s topmodel | Naar verwachting niet gespecificeerd | Lange projecten en maximale capaciteit |
| Claude Mythos 5 | Gespecialiseerd model | Restrictieve toegang | Geavanceerde wetenschap en cyberbeveiliging |
| GPT-5.6 Sol | OpenAI’s vlaggenschip | 5 $ invoer / 30 $ uitvoer | High-demand agentwerk |
| GPT-5.6 Terra | Gebalanceerde optie | 2,50 $ invoer / 15 $ uitvoer | Professioneel gebruik met lagere kosten |
| GPT-5.6 Luna | Snel en goedkoop | 1 $ invoer / 6 $ uitvoer | Hoge volume en lage latentie |
De standaardprijzen van OpenAI plaatsen GPT-5.6 Sol op 5 dollar per miljoen tokens voor invoer en 30 dollar voor uitvoer. Opus 5 haalt de inkoopprijs gelijk, maar verlaagt de uitvoerkosten naar 25 dollar. Terra en Luna zijn aanzienlijk goedkoper, maar bevinden zich op verschillende niveaus binnen de GPT-5.6-reeks.
Het kleine verschil per query wordt groter bij grote hoeveelheden code, uitgebreide documentatie of ketens van tientallen API-aanroepen. Toch hangt de werkelijke kost niet alleen af van de tariefstelling per token: ook het aantal herhalingen, het gebruik van hulpmiddelen, de lengte van het redeneringstraject en de correctierondes spelen een rol.
Dat is precies de kern van Anthropic’s commerciële visie: een model dat iets duurder is per token kan onder de streep goedkoper uitvallen doordat het minder stappen vereist, minder fouten maakt en minder supervisie nodig heeft om een doel te bereiken.
Er is nog geen onafhankelijke, gestandaardiseerde vergelijking die bevestigt dat Opus 5 over het algemeen beter presteert dan GPT-5.6. Anthropic wijst op benchmarks als Frontier-Bench, CursorBench, ARC-AGI 3, AutomationBench en OSWorld 2.0, terwijl OpenAI eigen evaluatiegegevens publiceert. De verschillen in configuratie, hulpmiddelen en redeneringsniveau verhinderen dat scores rechtstreeks vergelijkbaar zijn.
Automatisering, wetenschap en professioneel werk buiten code om
Anthropic heeft Opus 5 ook toegespitst op zakelijke taken die combinatie van redenering en hulpmiddelen vereisen. Bij Zapier AutomationBench, een test die het vermogen meet om bedrijfsprocessen van begin tot eind af te ronden, beweert het bedrijf dat het vermogen 1,5 keer hoger ligt dan bij het volgende model, voor dezelfde kosten.
Een voorbeeld dat door Zapier werd gedeeld is het analyseren van een spreadsheet met de gezondheid van verschillende accounts, het identificeren van klanten die het risico lopen te vertrekken, het waarschuwen van de verantwoordelijke en het genereren van een samenvatting voor het retentie-team. Volgens Zapier voltooide Opus 5 de hele workflow, terwijl eerdere versies deze niet konden afronden.
Ook worden verbeteringen genoteerd in financieel analysewerk, juridische documentatie en het doorzoeken van grote repositories. Box meldt dat Opus 5 in interne tests 8% beter presteerde dan Opus 4.8, met een stijging van 11% in datanalyse en 17% in due diligence. Andere early access-partners merken minder herhalingen, minder calls naar hulpmiddelen en een grotere stabiliteit tussen runs op.
In life sciences rapporteert Anthropic vooruitgang ten opzichte van Opus 4.8 in structurele biologie, organisch chemie en bio-informatica. Het model behaalde 10,2 procentpunten meer in een interne test op chemische spectra-interpretatie en 7,7 punten hoger in het voorspellen van de effecten van sequentieveranderingen op eiwitfunctie.
Deze resultaten zijn veelbelovend, maar moeten gezien worden als interne vergelijkingen tussen generaties Claude. Anthropic benadrukt dat Opus 5 niet bedoeld is om de gespecialiseerde systemen te vervangen. Integendeel, Mythos 5 blijft voor complexe biologische en offensieve cybersecurity-onderzoeken voorlopen.
Meer capaciteit met gerichte beperkingen voor cybersecurity
Opus 5 kan code herzien en kwetsbaarheden opsporen, maar Anthropic handhaaft beperkingen op het analyseren van binaire bestanden, penetratietests en het ontwikkelen van exploits. Het bedrijf legt uit dat het model zich dicht bij Mythos 5 bevindt bij het identificeren van fouten, maar duidelijk onderdoet bij het omzetten daarvan in werkende aanvallen.
Dit vormt onderdeel van het ontwerp, omdat Anthropic wil dat Opus 5 nuttig is voor ontwikkeling en defensieve beveiliging, zonder onbeperkt toegang te geven tot de meer gevoelige capaciteiten.
De organisatie verwacht dat haar veiligheidsklassificatoren ongeveer 85% minder ingrijpen dan bij Fable 5. Dit zou onterechte blokkades moeten verminderen, terwijl gespecialiseerde werkzaamheden via hun verificatieprogramma voor cybersecurityprofessionals kunnen worden afgehandeld.
In een voorlancerapportage geeft Anthropic aan dat Opus 5 een score van 2,3 behaalt op het gebied van afwijkende gedragingen — de laagste onder recente modellen — en meldt dat het minder misleidend gedrag vertoont en minder geneigd is tot onomkeerbare acties zonder vooraf inzicht in de consequenties.
Kosten per taak krijgen meer gewicht dan benchmarkuitslagen
Claude Opus 5 is nu beschikbaar via de platforms van Anthropic en de API onder de naam claude-opus-5. Het behoudt de prijs van Opus 4.8 en introduceert een snelmodus die volgens de producent ongeveer 2,5 keer sneller werkt, maar wel de tweemaal hogere basisprijs vereist.
De lancering onderstreept de verschuiving in de markt. De concurrentie tussen OpenAI, Anthropic en andere labs stopt niet langer bij het behalen van de hoogste score in een test. Bedrijven willen weten hoeveel het kost om een taak af te ronden, hoeveel fouten er worden gemaakt en of het agent mogelijk is urenlang een taak vol te houden zonder de doelen uit het oog te verliezen.
Opus 5 probeert aan die behoeften te voldoen. Het is niet het meest geavanceerde model van Anthropic, noch het goedkoopste op de markt. Het onderscheidt zich door een andere filosofie: voldoende intelligentie bieden om elke dag moeilijke klussen op te lossen, zonder telkens het duurste model te gebruiken.
Veelgestelde vragen
Wat is Claude Opus 5?
Een door Anthropic ontwikkeld model gericht op programmeren, professionele analyse, automatisering en het inzetten van agenten voor meerstaps taken.
Is Claude Opus 5 goedkoper dan GPT-5.6 Sol?
Beide kosten 5 dollar per miljoen tokens voor invoer. Opus 5 rekent 25 dollar per miljoen tokens voor uitvoer, terwijl GPT-5.6 Sol 30 dollar vraagt volgens standaardtarieven.
Vervangt Opus 5 Claude Fable 5?
Nee. Fable 5 blijft het model voor maximale capaciteit bij lange projecten. Opus 5 is bedoeld om vergelijkbare prestaties te leveren tegen lagere kosten voor reguliere taken.
Waar is Claude Opus 5 beschikbaar?
Via Claude.ai, Claude Code, Claude Cowork en de API. Het is het krachtigste model binnen Claude Pro en de standaard binnen Claude Max.
