Claude Opus 5: nagenoeg Fable voor de helft van de prijs

Claude Opus 5: nagenoeg Fable voor de helft van de prijs

In navolging van Fable 5 en Sonnet 5 komt Anthropic met Opus 5, een LLm die nagenoeg dezelfde resultaten behaalt als Fable voor de helft van de prijs. Opvallend genoeg is het volgens Anthropics benchmarks sterker dan Fable als het om coderen en kenniswerk gaat.

Opus 5 is vanaf vandaag beschikbaar op alle platformen. De prijs blijft hetzelfde als die van Opus 4.8 en eerder. Je betaalt dus 5 dollar per miljoen input-tokens en 25 dollar per miljoen output-tokens. Daarmee vult het model het gat tussen het goedkopere Sonnet 5 en het duurdere Fable 5, dat met $10 en $50 per miljoen tokens fors prijziger is.

Anthropic ziet Opus 5 als het nieuwe standaardmodel op Claude Max en het sterkste model op Claude Pro. Het bedrijf noemt het een model voor dagelijks gebruik dat efficiënter werkt dan andere modellen. Aangezien Fable 5 niet meer voor Pro-gebruikers beschikbaar is en op de duurdere abonnementsniveaus al gauw de 5-uurslimieten passeert, klinkt Opus als een zinnigere ‘daily driver’ voor AI-taken.

Een ander zeer belangrijk voordeel voor grote organisaties is het gebrek aan de vrij draconische dataretentie die Fable 5 erop nahoudt. In tegenstelling tot bij Fable kiest Anthropic ervoor om prompts níét een maand op te slaan uit veiligheidsoverwegingen. Zoals we later bespreken is Opus 5 dan ook lang niet zo cybervaardig als Fable, dat is gebaseerd op Mythos.

Records op coderen en kenniswerk

Op het vlak software-engineering zou Opus 5 dus sterker zijn dan zelfs Fable 5, mogelijk door een volwassener reinforcement learning-proces. Fable, gebaseerd op Mythos dat al begin 2026 bij Anthropic intern draaide, laat daarin eigenlijk al zijn leeftijd zien. Op Frontier-Bench v0.1 overtreft Opus 5 alle andere modellen en verdubbelt het de score van Opus 4.8 tegen lagere kosten per taak. Op CursorBench 3.2 komt het bij maximale effort binnen 0,5 procent van de piekscore van Fable 5, maar tegen de helft van de kosten.

Belangrijker voor Anthropic zijn de prestaties ten opzichte van GPT-5.6 Sol. De cijfers ontlopen elkaar soms enorm (7,8 procent voor Sol op ARC-AGI-3 versus 30,2 procent bij Opus 5; Opus 4.8 had hierbij slechts 1,5 procent behaald). Echter is de algemene strekking vermoedelijk dat de keuze van Sol- en Opus-gebruikers vooral neerkomt op voorkeur. DeepSWE, een gerenommeerde benchmark voor agentic coderen, komt uit op 72,7 procent voor Sol tegenover 68,8 procent Opus 5.

Bewust zwak op cybersecurity

Net als bij Sonnet 5 kiest Anthropic er bewust voor om Opus 5 niet op cybertaken te trainen. Toch is het model hierin sterker geworden. Het vindt kwetsbaarheden bijna net zo goed als Mythos 5, maar blijft ver achter bij het schrijven van exploits. Op de OSS-Fuzz-test komt dat verschil duidelijk naar voren.

Volgens Anthropic is Opus 5 tegelijk het meest ‘aligned’ model tot nu toe, met een score van 2,3 op afwijkend gedrag. De cyber-classifiers grijpen naar verwachting 85 procent minder vaak in dan bij Fable 5. Geblokkeerde verzoeken vallen standaard terug op Opus 4.8.

Het model is er ook in Fast mode, die op ongeveer 2,5 keer de standaardsnelheid draait tegen het dubbele tarief. Daarnaast introduceert Anthropic twee bètafuncties: tool-wijzigingen midden in een gesprek en automatische fallbacks via de API. Ontwikkelaars kunnen aan de slag via claude-opus-5.