RSS
AI

Anthropic släpper Claude Fable 5.1 – dubbelt så stark på forskningsuppgifter

Tre månader efter Fable 5 mer än fördubblar uppföljaren resultaten på vetenskapliga uppgifter – och tar tillbaka tronen från Opus 5

2 september 20262 min läsning
Glödande nätverk av AI-noder som formar en uppåtstigande väg från blå skymning till gyllene ljus
Glödande nätverk av AI-noder som formar en uppåtstigande väg från blå skymning till gyllene ljus

Uppläsning av artikeln

Utskick

Claude Fable 5.1 når 52,6 procent på Terminal-Bench-Science – mot föregångarens 24,7. Samtidigt släpps Mythos 5.1 för granskade proffs inom cybersäkerhet och biovetenskap.

Anthropic har släppt Claude Fable 5.1 och Claude Mythos 5.1 – den första uppdateringen av Mythos-klassens modellinje sedan Fable 5 lanserades den 9 juni. Bolaget kallar de nya modellerna världens mest avancerade för kodning och kunskapsarbete.

Vad mäter man – och vad visar siffrorna?

Anthropics huvudnummer kommer från Terminal-Bench-Science, ett test som mäter om en AI-agent kan utföra vetenskapliga forskningsuppgifter i en kommandoradsmiljö. Där når Fable 5.1 52,6 procent – mot föregångaren Fable 5:s 24,7 procent och Opus 5:s 29,0 procent. Det är mer än en fördubbling på tre månader.

I Terminal-Bench 4.0, som testar agentdriven programmering genom flerstegssessioner i terminalen, landar Fable 5.1 på 55,8 procent, upp från Fable 5:s 42,0 och före Opus 5:s 52,3. Mythos 5.1 – som körs med lättare cybersäkerhetsfilter – når 60,9 procent på samma test.

På Humanity's Last Exam, ett mångdisciplinärt resonemangstest med frågor på expertnivå från dussintals akademiska fält, når Fable 5.1 60,9 procent utan externa verktyg och 65,0 procent med verktyg – bäst i Anthropics stall för akademiskt arbete.

Två syskon, två målgrupper

Fable 5.1 och Mythos 5.1 är enligt Anthropic samma underliggande modell med olika säkerhetsfilter. Fable 5.1 är allmänt tillgänglig för alla med ett Claude-konto, medan Mythos 5.1 är reserverad för granskade yrkesverksamma inom cybersäkerhet och biovetenskap genom bolagets verifieringsprogram.

Åtkomsten följer samma uppdelning som för Fable 5: på Pro- och standard Team/Enterprise-abonnemang dras Fable 5.1 från användningskrediter till API-taxa, medan Max-abonnenter och premiumplatser får modellen inkluderad för upp till 50 procent av den veckovisa användningen.

Flaggskeppet tar tillbaka tronen

När Opus 5 lanserades i juli till halva tokenpriset – och dessutom slog Fable 5 på de flesta stora tester – blev flaggskeppsmodellen i praktiken överflödig för de flesta betalande användare. Fable 5.1 vänder på det: modellen slår nu Opus 5 på samtliga publicerade benchmark, inklusive dem där Opus 5 tidigare ledde.

Priset ligger dock kvar på dubbla nivån mot Opus 5 (10 dollar in och 50 dollar ut per miljon tokens, mot 5 och 25). Anthropics eget argument lutar sig mot "effort levels": Fable 5.1 på låg eller medelhög resoneringsansträngning matchar eller slår Fable 5:s gamla resultat till betydligt lägre kostnad – medan de högsta nivåerna reserveras för problem som inget annat klarar.

Varför det här är en god nyhet

Utvecklingstakten är den verkliga storyn. Att en flaggskeppsmodell mer än fördubblar sin förmåga på vetenskapliga uppgifter på ett kvartal visar hur snabbt AI-verktygen mognar för forskning, utveckling och kunskapsarbete. För användare betyder det att det som krävde experthjälp i våras i dag kan lösas direkt i terminalen – och att nästa steg sannolikt kommer ännu fortare.

I denna artikel kan AI-teknik ha används helt eller delvis för text, bilder, ljud och film.

Läs sedan

Utvalt åt dig
Chefredaktör
Elin Holmberg

Elin har lett GOOD NEWS sedan starten och tror stenhårt på att bra journalistik kan förändra världen — men bara om den också sprider glädje.

Hur känns det efter läsningen?
Ämnen i artikeln — hitta fler liknande nyheter
Dela artikeln
Fråga AI:n om artikeln
Kontextuell läshjälp
Hej! Jag är GOOD NEWS läshjälp. Vi utgår från artikeln "Anthropic släpper Claude Fable 5.1 – dubbelt så stark på forskningsuppgifter" (AI). Fråga mig gärna om innehållet — jag sammanfattar, förklarar eller ger dig bakgrund.
Förslag på frågor om artikeln
AI:n svarar utifrån artikeln och allmän kunskap — alltid på svenska.

Kommentarer

Din kommentar granskas av redaktionen innan den publiceras.

0/2000

Laddar kommentarer…

Läs mer om ämnet

9 relaterade

Senaste i AI

Mest lästa i AI