Anthropic heeft Claude Fable 5.1 en Claude Mythos 5.1 uitgebracht. De twee modellen delen dezelfde technische basis, maar verschillen in hun veiligheidsbeperkingen en beschikbaarheid. Vooral Fable 5.1 moet een belangrijke stap vooruit zetten voor programmeren, kenniswerk en langdurige AI-agenttaken. Tegelijk verlaagt Anthropic de kosten van cachegebruik, waardoor typische workflows volgens het bedrijf ongeveer 25 procent goedkoper kunnen worden.
Voor de voorbereidingen van de inhoud en creatie van de visuals wordt (uiteraard) gebruikgemaakt van generatieve AI.
Het meest capabele model tot nu toe voor programmeren
Anthropic heeft amper enkele maanden na Claude Fable 5 alweer een verbeterde versie van zijn krachtigste breed beschikbare model gelanceerd. Claude Fable 5.1 is volgens het bedrijf zijn meest capabele model tot nu toe voor programmeren, kenniswerk en langdurige taken waarbij een AI-agent grotendeels zelfstandig moet kunnen werken.
Tegelijk verschijnt Claude Mythos 5.1. Beide modellen gebruiken dezelfde onderliggende technologie, maar krijgen verschillende veiligheidsbeperkingen. Fable 5.1 is bedoeld voor algemeen gebruik, terwijl Mythos 5.1 uitsluitend beschikbaar is voor geselecteerde organisaties die actief zijn in onder meer cybersecurity en biowetenschappen.
Zelfde tokenprijs, maar lagere kosten per taak
Opvallend is dat Anthropic de standaardprijzen voor Fable 5.1 niet verlaagt. Input blijft 10 dollar per miljoen tokens kosten en output 50 dollar per miljoen tokens. Toch verwacht het bedrijf dat het model in de praktijk goedkoper zal zijn.
Dat komt vooral door een forse prijsverlaging voor cache reads. Daarbij hoeft informatie die eerder al door het model werd verwerkt niet telkens opnieuw tegen de volledige inputprijs te worden ingelezen. De prijs daarvan daalt met 75 procent naar 0,25 dollar per miljoen tokens.
Volgens Anthropic maakt dit typische workloads gemiddeld ongeveer 25 procent goedkoper dan bij Fable 5. Bij sterk agentische toepassingen, waarin een model langdurig werkt en voortdurend dezelfde context gebruikt, kan de besparing oplopen tot ongeveer 45 procent.
Vooral gebouwd voor langdurige AI-taken
Fable 5.1 richt zich duidelijk op een generatie AI-systemen die meer doen dan één vraag beantwoorden. Anthropic positioneert het model voor opdrachten die uren kunnen duren en waarbij verschillende toepassingen en hulpmiddelen worden gebruikt.
Het model kan bijvoorbeeld zelfstandig door een softwareproject navigeren, tests schrijven, fouten opsporen, browseracties uitvoeren en na een mislukte stap een andere aanpak proberen. Anthropic stelt bovendien dat Fable 5.1 beter wordt in het achterhalen van de onderliggende oorzaak van softwareproblemen in plaats van alleen symptomen te corrigeren.
De eigen benchmarks van Anthropic tonen forse verbeteringen tegenover Fable 5. Zo stijgt de score op Terminal-Bench-Science van 24,7 naar 52,6 procent en op AutomationBench van 17,1 naar 31,4 procent. Zulke cijfers blijven vanzelfsprekend benchmarks van de fabrikant zelf en zullen de komende weken door onafhankelijke tests moeten worden bevestigd.
Minder blokkades voor legitieme toepassingen
Ook de veiligheidslaag werd aangepast. Fable 5.1 mag voortaan bijvoorbeeld kwetsbaarheden in broncode opsporen, terwijl het genereren van exploits en bepaalde offensieve cyberactiviteiten geblokkeerd blijven. Anthropic zegt dat zijn nieuwe cyberbeveiligingen 60 procent minder foutieve blokkeringen veroorzaken.
Voor gevoelige toepassingen gaat het bedrijf nog een stap verder met Mythos 5.1. Dat model krijgt minder beperkingen voor geverifieerde onderzoekers en organisaties, maar is daardoor niet algemeen beschikbaar.
Ook voor zakelijke klanten verandert het privacybeleid. Met de nieuwe Enterprise Frontier Safeguards wil Anthropic gevoelige gegevens opslaan in cloudinfrastructuur die volledig door de klant wordt beheerd. Tot die infrastructuur breder beschikbaar is, kunnen bepaalde ondernemingen Fable 5.1 met zero-data-retention gebruiken.
Claude Fable 5.1 is inmiddels beschikbaar voor Pro-, Max-, Team- en Enterprise-gebruikers en voor ontwikkelaars via de Claude API en ondersteunde cloudplatformen. De belangrijkste verschuiving zit daarbij niet alleen in hogere benchmarks, maar vooral in efficiëntie: Anthropic probeert zijn krachtigste AI steeds geschikter te maken voor autonome taken die uren in plaats van seconden duren.

