Anthropic lanserar Claude Fable 5.1 för långkörande agentjobb
Den nya modellen är gjord för arbetsuppgifter som löper i timmar eller dagar, medan en mer tillåtande tvilling begränsas till granskade organisationer.
Anthropic lanserar Claude Fable 5.1 som sin mest kapabla allmänt tillgängliga modell för kodning, kvalificerat kunskapsarbete och långa agentkörningar. Den bygger på samma grundmodell som Claude Mythos 5.1, men Mythos-versionen har mer tillåtande skydd och är begränsad till granskade organisationer inom bland annat cybersäkerhet och livsvetenskap.
Fable 5.1 finns nu i Claude för Pro-, Max-, Team- och Enterprise-användare samt via Claude API och de stora molnplattformarna. Anthropic pekar ut uppgifter som löper i timmar eller dagar: större kodändringar över flera kodbaser, felsökning, webbarbete och forskningsjobb där modellen planerar, använder verktyg, återhämtar sig efter fel och fortsätter utan ständig tillsyn.
Störst lyft i agentisk forskning
I Anthropics egna tester nådde Fable 5.1 52,6 procent i Terminal-Bench-Science 0.1, jämfört med 24,7 procent för Fable 5. På Terminal-Bench 4.0 för agentisk kodning redovisar bolaget 55,8 procent för Fable 5.1 och 42,0 procent för föregångaren. Resultaten är leverantörstester, inte en oberoende verifiering, och Anthropic anger en standardavvikelse på ±3,5–4,5 procentenheter i vetenskapstestet.

Forskningsdelen är mer konkret än en vanlig benchmarktabell. Anthropic uppger att Mythos 5.1 designade proteinbindare som laboratorietestades av externa organisationer, medan Fable 5.1 byggde en högupplöst höjdmodell över en tredjedel av Venus från äldre radardata. Modellen är också tänkt att skriva och optimera forskningskod, men flera av optimeringarna ska släppas öppet först senare.
Lägre kostnad när kontexten återanvänds
Listpriset är 10 dollar per miljon indatatoken och 50 dollar per miljon utdatatoken. Den praktiska förändringen ligger i cacheläsningar, som sjunker till 0,25 dollar per miljon token. Anthropic uppskattar att typiska arbetslaster blir omkring 25 procent billigare och starkt agentiska flöden upp till cirka 45 procent billigare än med Fable 5.
Det gör 5.1 mest intressant som arbetsmotor, inte som en modell man bara byter in för enstaka chattfrågor. Nästa verifierbara hållpunkt blir därför användarnas egna utvärderingar av långa körningar: hur ofta agenten fastnar, hur väl den kan kontrollera sitt resultat och om kostnadsfördelen består utanför Anthropics testmiljö.
Anthropic har släppt Claude Fable 5.1 för bred användning och Claude Mythos 5.1 för granskade forsknings- och säkerhetsorganisationer. Bolaget redovisar tydliga lyft i agentisk kodning och vetenskapliga arbetsflöden, tillsammans med billigare cacheläsningar.
För utvecklare och forskare flyttar förbättringen fokus från korta prompts till arbetsuppgifter som kan pågå i timmar eller dagar. Om modellen kan hålla planen och verifiera delresultat minskar behovet av ständig mänsklig övervakning.
Det starkaste här är kombinationen av uthållighet, verktygsanvändning och lägre kostnad för återanvänd kontext. Men benchmarkdiagrammet är fortfarande Anthropics eget; en verklig förbättring syns först när team kan köra samma långa jobb igen och få stabila, granskningsbara resultat.




