Anthropic heeft Fable 5.1 en Mythos 5.1 uitgebracht. Het is in veel opzichten iteratief: hogere scores, vergelijkbare functionaliteit en iets goedkoper dan de voorganger. Desondanks is dit de eerste keer dat een nieuwe state-of-the-art LLM onderworpen is aan uitgebreide EU AI Act-regelgeving, met alle gevolgen van dien.
Om met het gebruikelijke te beginnen: op zowel interne benchmarks als in de suite van de welbekende AI-testers Artificial Analysis blinkt Fable 5.1 uit. Hetzelfde geldt gedeeltelijk voor Mythos 5.1, de variant van hetzelfde model die slechts voor een selecte groep gevalideerde organisaties beschikbaar is voor securitydoeleinden. Daar waar Opus 5 de scores van Fable 5 overtrof maar in het werkelijk gebruik tekortschoot, zal Fable 5.1 voor velen daadwerkelijk als een betekenisvolle, doch kleine upgrade voelen. Artificial Analysis landt op een score van 66, tegenover 63 voor Opus 5 en 62 voor Fable 5.
Goedkoper, maar met een asterisk
In de praktijk kan Fable 5.1 bij agentic taken tot wel 45 procent goedkoper zijn dan Fable 5. Dit komt met name door 75 procent goedkopere cache reads, ofwel het lezen van informatie die al in het geheugen bij Anthropic zit. Aangezien langere prompts, chats en agentic sessies een grote hoeveelheid input moeten verwerken die al eerder is gebruikt, kan dit logischerwijs de kosten aardig drukken.
Daar staat tegenover dat de input- en outputprijs nog altijd respectievelijk 10 en 50 dollar is, significant meer dan geldt voor de concurrentie. Met opties als DeepSeek-V4 Pro, GLM 5.3 Flash en OpenAI’s abonnementen is prijs nog steeds niet een onderscheidend voordeel voor Anthropic.
Daarnaast: de EU AI Act heeft een impact op Fable 5.1 die pas later zal blijken. Zoals we bespraken in een recente Techzine Talks-aflevering gaan AI-watermerken de overwegingen rondom AI-gebruik veranderen. Wie bijvoorbeeld een scriptie, juridisch document of ander document enkel denkt te checken voor spellingsfouten, krijgt (volgens Anthropic) een output terug die traceerbaar door AI vervaardigd is. Dat blijkt niet door de tekst te lezen, maar door een geheime reeks overwegingen rondom de gekozen tokens in een algoritme die alleen Anthropic bezit.
Voor Fable 5 gold een dermate invasieve dataretentie dat menig groot bedrijf absoluut niet het gebruik ervan toestond. Elke sessie mocht namelijk tot wel 30 dagen zonder pardon worden bewaard, vanuit vermeende veiligheidsoverwegingen. Nu is er te kiezen voor een Enterprise Frontier Safeguard (EFS), waarbij grootzakelijke klanten hun data binnen hun eigen cloudinfrastructuur kunnen bewaren en niet op Anthropics systemen. 100 klanten hebben meegewerkt aan het nieuwe beleid.
Prestaties
We moeten zoals gebruikelijk een korrel zout nemen bij de benchmarks van Anthropic. Dit is niet omdat de scores van Fable 5.1, Mythos 5.1 en eerdere Claude-modellen in twijfel te trekken zijn. Eerder is het opvallend dat GPT 5.6 Sol van OpenAI zo vaak géén score behaalt. Dit komt veelal doordat Anthropic er ofwel voor kiest om de gekozen methode van het GPT-model niet te accepteren omdat het de test zou ondermijnen, of omdat het model zich niet houdt aan een andere basisvoorwaarde van de benchmark zonder dat expliciet verteld te krijgen.
Hoe dan ook is Fable/Mythos 5.1 volgens Anthropic opnieuw een doorbraak op sommige vlakken. Zo ontdekte investeringsbedrijf Millennium als vroege gebruiker van het model de oorzaak van een hardnekkig crashprobleem dat al jaren plaatsvond. In de andere diagrammen van Anthropic is te zien dat Fable 5.1 op een laag denkniveau het prestatieniveau van Fable 5 evenaart, en met ‘xhigh’ en ‘max’ inzet er zelfs grote afstand tot neemt.