ai-machine-learning

Claude Fable 5 vs Opus 4.8: Är det värt att byta? (Mythos-klass, benchmarkat)

Skriven av Mert Batur
Uppdaterad Jul 21, 2026
19 läsning
Claude Fable 5 vs Opus 4.8: Är det värt att byta? (Mythos-klass, benchmarkat)

Claude Fable 5 vs Opus 4.8: Är det värt att byta? (Mythos-klass, benchmarkat)

Anthropic lanserade Claude Fable 5 den 9 juni 2026, och de sex veckorna sedan dess har inte varit en rak linje: en statligt påtvingad avstängning, en fullständig återställning, en säkerhetsuppdatering och två nya konkurrentlanseringar. Modellen når fortfarande 80,3 % på SWE-Bench Pro — det agentiva kodnings-benchmark där Opus 4.8 stannar på 69,2 % och GPT-5.5 hamnar på 58,6 %. Det är ingen avrundningsfelsgap, även om GPT-5.5 inte längre är den enda modellen värd att jämföra med. Och det finns en twist: Fable 5 är den offentliga, skyddade halvan av en ny "Mythos-klass"-modell, med ett bevakat syskon kallat Claude Mythos 5 bakom ett begränsat åtkomstprogram. Här är vad som förändrades, vad som hänt sedan lanseringen, vad en riktig uppgift faktiskt kostar till $10/$50 per miljon tokens, och om du verkligen bör flytta din stack från Opus 4.8.

Kort svar

  • Fable 5 når 80,3 % på SWE-Bench Pro mot Opus 4.8:s 69,2 % och GPT-5.5:s 58,6 %, men Claude Sonnet 5 och GPT-5.6 Sol (båda lanserade efter Fable 5) tar in en del av det gapet på agentiva och terminalbaserade benchmark.
  • Priset är $10 input / $50 output per miljon tokens, mindre än hälften av Mythos Preview.
  • Fable 5 faller automatiskt tillbaka på Opus 4.8 vid högriskfrågor inom cyber/bio/kemi; en klassificerar-uppdatering den 1 juli blockerar också en prompt-teknik som Amazon-forskare hittade, i över 99 % av fallen.
  • Åtkomsten stängdes av för alla användare 12–30 juni 2026 enligt amerikanska exportkontroller, innan den återställdes fullt ut den 1 juli. Upplägget med gratis fram till ett visst datum är också borta: Max/Team Premium behåller Fable 5 inkluderat, Pro/Team Standard får en engångskredit på $100 och sedan API-priser, enligt TechTimes och XenoSpectrum (Anthropic har inte bekräftat detta på sin egen webbplats).

Vad som faktiskt lanserades: Fable 5, Mythos 5 och "Mythos-klassen"

Mythos-klass är Anthropics nya toppnivå för kapacitet, och den levereras som två modeller. Claude Fable 5 är den offentliga, skyddade versionen du kan anropa idag. Claude Mythos 5 är samma frontiermodell utan skydden, bakom bevakad åtkomst. Samma hjärna, två distributionslägen.

Uppdelningen är hela historien. Enligt Anthropics nyhetsrumskommuniké behåller Mythos 5 full frontierkapacitet — inklusive offensiva cyberförmågor som kan orsaka verklig skada — så Anthropic ger inte alla tillgång till den. Fable 5 tar samma modell och omsluter den med klassificerare som identifierar högriskförfrågningar och tyst dirigerar dem till Opus 4.8 istället.

Så när du anropar Fable 5 får du Mythos-klass-resonemang på allt som inte är farligt, och en säkrare reservmodell på den lilla andel som är det. CNBC beskrev det som att Anthropic lanserar en "Mythos-liknande AI för allmänheten", vilket stämmer — men den exakta mekaniken spelar större roll än rubriken.

Fable 5 och Mythos 5 är samma frontiermodell delad i två: en du kan använda idag, en som Anthropic håller bakom grindar. Kom du ihåg en sak om namngivningen — kom ihåg det. Mythos-klass är nivån; Fable och Mythos är de två dörrarna in i den.

Vad som förändrades jämfört med Opus 4.x-linjen

På alla kodnings- och resonemangsutvärderingar som täcks här slår Fable 5 Opus 4.8 — inte med en hårsbredd utan med tvåsiffriga marginaler. SWE-Bench Pro hoppar från 69,2 % till 80,3 %, ett tal Anthropic publicerat och som Vellum, llm-stats och Weights & Biases oberoende har bekräftat. FrontierCode Diamond går från 13,4 till 29,3, ett tal Anthropic själv inte publicerar; det kommer från Vellums och llm-stats mätningar. Priset sjönk också, och modellen skalerar med ett nytt reglage för resoneringsinsats. Det här är ett genuint frontierkliv över Opus 4.x-linjen, inte en punktuppdatering.

Claude Mythos 5 / Fable 5 benchmark-tabell mot Mythos Preview, Opus 4.8, GPT-5.5, Gemini 3.1 Pro över 13 utvärderingar
Claude Mythos 5 / Fable 5 över 13 benchmark mot Opus 4.8, GPT-5.5 och Gemini 3.1 Pro. Källa: Anthropic.

Genomgången av de 13 benchmarken ovan är översiktsversionen. Här är de viktigaste talen mot de tre modeller som de flesta team faktiskt jämför:

BenchmarkClaude Fable 5Claude Opus 4.8GPT-5.5
SWE-Bench Pro (agentiv kodning)80,3%69,2%58,6%
FrontierCode Diamond (svåraste kodning)29,313,45,7
Terminal-Bench 2.1 (agentivt skal)88,0%n/an/a
GPQA-AA (forskarresonemang, Elo)1932n/an/a
ExploitBench78,0%n/an/a

Jämförankermodellen här är Claude Opus 4.8, den modell Fable 5 ersätter vid frontiern — och samma modell Fable 5 faller tillbaka på vid högriskfrågor. Om du följt Opus 4.x-linjen under de senaste två releaserna var mönstret stegvisa vinster. Fable 5 bryter det mönstret.

Två saker att flagga innan du läser tabellen som evangelium. För det första är SWE-Bench Pro Anthropics egen publicerade utvärdering, oberoende bekräftad på andra håll; FrontierCode Diamond är inte ett Anthropic-publicerat tal alls — det är ett tredjepartsbenchmark som spåras av Vellum och llm-stats. För det andra döljer ett enda benchmark-nummer en kostnadskurva eftersom reglaget för resoneringsinsats varierar. Mer om det i prissektionen — det förändrar kalkylen.

De benchmark som spelar roll för byggare

Fyra tal bär den praktiska vikten: SWE-Bench Pro 80,3 %, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0 % och GPQA-AA 1932 Elo. Tillsammans täcker de verkligt repo-arbete, de svåraste syntetiska kodningsproblemen, agentiva skaluppgifter och forskarresonemang. Om din arbetsbelastning berör något av dessa är det här avsnittet som talar om huruvida siffrorna stämmer på ditt jobb.

Hjältediagrammet längst upp i det här inlägget är beviset: SWE-Bench Pro 80,3 mot 69,2 mot 58,6, och FrontierCode 29,3 mot 13,4 mot 5,7. Men vad mäter dessa egentligen?

  • SWE-Bench Pro testar om en modell kan skicka in en riktig pull request till ett riktigt repo: klona, förstå, patcha, klara tester. Fable 5 lyckas 8 av 10 gånger. Det här är den närmaste proxyn för "kan den göra mitt faktiska jobb."
  • Terminal-Bench 2.1 poängsätter agentiva skaluppgifter: köra kommandon, läsa utdata, återhämta sig från fel. 88,0 % spelar roll om du bygger AI-kodningsagenter som lever i en terminal.
  • FrontierCode Diamond är den svåraste nivån av kodningsproblem — de där de flesta modeller landar på ensiffriga tal. 29,3 är lågt i absoluta termer men mer än dubbelt Opus 4.8:s 13,4.
  • GPQA-AA är forskarresonemang inom vetenskap, poängsatt som ett Elo-betyg. 1932 signalerar starkt flerstegsresonemang bortom kod.

I våra Claude Code-arbetsflöden längs Opus 4.x-linjen var det återkommande taket långsiktiga agentiva uppgifter: modellen tappade tråden halvvägs igenom en ändring i flera filer. Fable 5:s Terminal-Bench och SWE-Bench Pro-siffror tyder på att det taket har flyttats. Om det flyttades för ditt repo är det enda test som räknas — men de publicerade siffrorna är rätt sorts siffror att bry sig om.

Verkliga testfall: Vad Fable 5 gör som tidigare modeller inte kunde

Anthropic publicerade tre konkreta exempel som visar klassen av problem Fable 5 nu kan hantera: en Stripe-kodbasmigration komprimerad från månader till en dag, ett videospel genomfört enbart på vision, och ett 3×-prestandahopp via självvalidering. Var och en pekar på en förmåga som tidigare modeller inte nådde upp till. Alla tre är Anthropic-sourced; vi citerar deras tillkännagivande, inte ett eget test.

Vad var och en bevisar:

  1. Stripe Ruby-migration. Anthropic rapporterar att Fable 5 komprimerade en Ruby-kodbasmigration från ungefär två månader till ungefär en dag. Det är klassen av långsiktig refaktor som brukade kräva ett mänskligt team som höll hela kodbasen i huvudet.

  2. Pokémon FireRed enbart på vision. Enligt Anthropic klarade Fable 5 Pokémon FireRed med enbart vision, där tidigare modeller behövde komplexa anpassade sele för att mata in spelläge som text. Det är ett hopp inom spatial och visuell resonemang: modellen läser skärmen och agerar — ingen scaffolding.

  3. Slay the Spire, 3×. Med maximal resoneringsinsats säger Anthropic att Fable 5 självvaliderar sina egna drag och nådde 3× bättre prestanda via persistent minne. Poängen är inte spelet; det är att modellen kan kontrollera sitt eget arbete över en lång planeringshorisont och förbättras av det.

Inget av detta ska du ta på tilltro för din arbetsbelastning. Men det kartlägger tydligt mot benchmark-hoppen i tabellen ovan: långsiktig kodning (SWE-Bench Pro), spatial resonemang (vision) och självvalidering (reglaget för resoneringsinsats). De kvalitativa vinsterna och de kvantitativa berättar samma historia.

Prissättning och kostnadsverkligheten per uppgift

Fable 5 kostar $10 per miljon input-tokens och $50 per miljon output-tokens. Anthropics inramning är "mindre än hälften av priset för Mythos Preview." Det är också ungefär 2× Opus 4.8 per token. Båda stämmer. Fångsten är att tokenpris är fel enhet. Det du faktiskt betalar för är en avslutad uppgift — och det är där Fable 5:s kalkyl blir intressant.

FrontierCode-noggrannhet mot kostnad per uppgift — Claude Fable 5 skalerar från låg till maximal resoneringsinsats och slår Opus 4.8 och GPT-5.5
FrontierCode-poäng mot genomsnittlig kostnad per uppgift när resoneringsinsatsen skalerar låg→max. Källa: Anthropic.

Resoneringsinsats är ett reglage du ställer in per förfrågan. Låg insats innebär färre interna resoneringstokens och ett billigare, snabbare svar; maximal insats innebär att modellen tänker längre, spenderar fler output-tokens och poängsätter högre. Diagrammet ovan visar Fable 5 klättra från ~11 % till ~31 % på FrontierCode när insatsen skalerar låg till max, medan Opus 4.8 toppar kring 13 % och GPT-5.5 ligger platt nära 5–6 %. Så kostnad per uppgift är inte ett enda tal; det är en kurva du väljer en punkt på.

Låt oss räkna ett konkret exempel från den publicerade prissättningen $10/$50. Det här är aritmetik från Anthropics publicerade priser, inte ett benchmarkat resultat.

Ta ett enda agentivt anrop med 50 000 input-tokens och 15 000 output-tokens vid hög insats:

text
Input:  50 000 / 1 000 000 × $10 = $0,50
Output: 15 000 / 1 000 000 × $50 = $0,75
Per anrop:                          $1,25

En riktig agentiv uppgift kedjar ihop många sådana anrop: läs repo, planera, redigera, kör tester, fixa, upprepa. Säg att loopen kör 12 anrop med den formen: ungefär $15 för den avslutade uppgiften. Med maximal resoneringsinsats och tyngre kontext placerar Anthropics egna kostnadskurva hårda FrontierCode-uppgifter närmare $20-per-uppgift-intervallet. Kör samma uppgift på GPT-5.5 och du betalar mindre per token. Men om den inte kan avsluta uppgiften vid någon insatsnivå är din kostnad-per-avslutad-uppgift oändlig. Fable 5 kostar mer per token än GPT-5.5 och vinner ändå på kostnad-per-avslutad-uppgift — för att den avslutar arbete GPT-5.5 inte kan.

Här är ett minimalt anrop. Modell-id:t är claude-fable-5 på API:et (anthropic.claude-fable-5 på Bedrock). Sedan generation 4.6 saknar Anthropics modell-id:n datum, vilket också bekräftas av Anthropics tillkännagivande; det finns alltså inget versionerat alias att leta efter, den här strängen är den fastlåsta snapshoten:

python
import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
    model="claude-fable-5",          # dateless id; this is the pinned snapshot
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 8000},  # reasoning effort
    messages=[
        {"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
    ],
)

print(message.content)

Ekonomitesen i en mening: du betalar mer per token än GPT-5.5, men du avslutar uppgifter GPT-5.5 inte kan avsluta till vilket pris som helst. För låginsats-högvolymarbete gynnar den kalkylen en billigare modell. För hård agentiv kodning gynnar den Fable 5.

Skyddsuppdelningen: Varför Fable faller tillbaka på Opus 4.8

Fable 5 kör klassificerare på varje förfrågan. När den identifierar en högriskfråga (offensiv cyber, bio, kemi eller modell-destillationsförsök) faller den tillbaka på Opus 4.8 istället för att svara med full Mythos-klass-kapacitet. Anthropic säger att detta utlöses på under 5 % av sessionerna, så de flesta användare stöter aldrig på det. Poängen är att hålla den farliga kapaciteten bakom grindar medan vardagligt arbete lämnas orört.

Det svårare talet är attack-framgångsprocent: hur ofta en automatiserad angripare kan jailbreaka modellen till att göra något den inte borde. Lägre är bättre. Gray Swan och UK AI Security Institute körde agent-red-teaming vid k=100 med tänkande aktiverat, och resultaten sätter ett verkligt tal på gapet:

ModellAttack-framgångsprocent
Claude Fable 54,8%
Claude Opus 4.89,6%
GPT-5.530,8%
Gemini 3.1 Pro45,5%

Fable 5 leder fortfarande fältet, men marginalen mot Opus 4.8 är ungefär 2x, inte den skillnad i storleksordning som ibland citeras. Mot GPT-5.5 och Gemini 3.1 Pro är gapet mycket bredare, 6–9x.

Varför spelar det roll? Om du driftsätter en agent med verktygsåtkomst (skal, filsystem, nätverk) är en jailbreak inte ett dåligt chattsvar — det är en modell som exekverar riktiga kommandon som en angripare styrde den in i. En attack-framgångsprocent under 5 %, ungefär hälften av Opus 4.8:s, är fortfarande värd bytet för allt som rör verktyg som körs live. IT Pros täckning inledde med reservmekaniken just av den anledningen: det är funktionen som gör en frontiermodell tillräckligt säker att ge allmänheten.

Avvägningen är latens. Om ditt arbetsflöde legitimt rör säkerhetsverktyg kan reservfunktionen utlösas mitt i en uppgift och byta modell på dig — något att planera runt.

Claude Mythos 5 och frågan om dual-use

Claude Mythos 5 är det bevakade syskonet — samma modell utan skyddsreserven. Den behåller offensiv cyberkapacitet som Fable 5 blockerar, vilket är precis varför Anthropic inte släpper den offentligt. Åtkomst går via Project Glasswing, ett granskat program för försvarare och forskare som behöver full kapacitet. Samma modell, två distributionslägen: en öppen, en bevakad.

Offensiva cyberutvärderingsresultat — Claude Mythos 5 hög kapacitet, Claude Fable returnerar 0,0 där skydden utlöses
Offensiva cyber-utvärderingar: Mythos 5 behåller kapacitet; Fable returnerar 0,0 där blockerande skydd utlöses. Källa: Anthropic.

Diagrammet synliggör grindningen. På offensiva cyber-utvärderingar (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) poängsätter Mythos 5 88,4, 24,0, 83,8 och 38,7. Fable 5 returnerar ett flatt 0,0 på alla fyra. På offensiva cyber-utvärderingar når Mythos 5 upp till 88,4 där Fable 5 returnerar ett flatt 0,0 — skyddsuppdelningen, gjord synlig.

Det nollan är inte en kapacitetslucka. Det är reservfunktionen som utlöses varje gång och blockerar förfrågan innan Mythos-klass-modellen svarar. TechCrunch noterade timingen: Anthropic lanserade detta dagar efter att ha varnat för att AI håller på att bli för farlig att släppa öppet. Fable/Mythos-uppdelningen är policyssvaret på den varningen — publicera kapaciteten, bevaka faran.

För de flesta utvecklare är Mythos 5 irrelevant. Du kommer aldrig att kvalificera dig för Project Glasswing och behöver inte göra det. Det som spelar roll är att veta att modellen du anropar är medvetet begränsad på ett smalt band av uppgifter — av design.

Vad som hände efter lanseringen: Två veckors avstängning, sedan en säkerhetsuppdatering

Fable 5:s första sex veckor var ingen rak linje. Tre dagar efter lanseringen den 9 juni införde den amerikanska regeringen exportkontroller för Anthropics nyaste modeller, och den 12 juni 2026 stängdes åtkomsten av för alla användare, överallt, eftersom Anthropic inte hade något sätt att verifiera vem som faktiskt anropade API:et. Myndighetsgodkännandet kom den 26 juni och återställde först Mythos 5 för en grupp granskade amerikanska organisationer (Anthropic har inte publicerat hur många). Fullständig återställning för alla landade den 1 juli 2026, samma dag som GitHub återaktiverade Fable 5 i Copilot. Se vår fullständiga tidslinje över avstängningen för alla turerna i detalj.

Den avstängningen var ett licensproblem, inte ett säkerhetsproblem. Separat, och orelaterat till exportkontrollfrysningen, hittade Amazon-forskare en prompt-metod som tog sig runt Fable 5:s skydd tillräckligt väl för att plocka ut mjukvarusårbarheter som klassificeraren skulle blockera. Anthropic drog inte tillbaka modellen för det här — man släppte en fix i samband med återställningen den 1 juli, en klassificerar-uppdatering som blockerar just den tekniken i över 99 % av fallen, med resterande fall som faller tillbaka på Opus 4.8 som tidigare. Två olika problem, två olika fixar, som landade samma kalendervecka, är inte samma sak som att det ena orsakade det andra.

Om du planerar kring Fable 5 för något kundvänt är den praktiska lärdomen att en frontiermodells lanseringsvillkor inte alltid håller sex veckor senare.

Konkurrensfältet har förändrats: GPT-5.6 och Claude Sonnet 5

Att bara jämföra Fable 5 mot GPT-5.5 var vettigt den 9 juni. Det är det inte längre. Två lanseringar sedan dess förändrar kalkylen, och den större kommer från Anthropics egen produktlinje, inte en konkurrent.

Claude Sonnet 5, lanserad den 30 juni 2026, är utelämnandet som spelar störst roll. Den prissätts till $3/$15 per miljon tokens som standard, $2/$10 som introduktionspris till och med 31 augusti 2026 — en bråkdel av Fable 5:s $10/$50. På SWE-Bench Pro får den 63,2 %, bakom Fable 5:s 80,3 % och bakom Opus 4.8:s 69,2 %. Men på Terminal-Bench 2.1 når den 80,4 %, vilket slår Opus 4.8:s 74,6 %, och dess OSWorld-Verified-poäng är 81,2 %. En modell från samma familj till en femtedel av Fable 5:s pris som slår föregångarens flaggskepp på ett agentivt benchmark är inte en detalj ett "bör du byta"-inlägg kan utelämna.

GPT-5.6, OpenAIs uppföljare lanserad den 9 juli 2026, kommer i tre nivåer: Sol, Terra och Luna. Sol prissätts till $5/$30, ungefär hälften av Fable 5:s input-kostnad, med Terra på $2,50/$15 och Luna på $1/$6. Sida vid sida, enligt Vellums benchmark-jämförelse från 9 juli:

BenchmarkGPT-5.6 SolFable 5
SWE-Bench Pro64,6%80,0%
Terminal-Bench 2.188,8%86,0%
Coding Agent Index8077,2
Agents' Last Exam53,640,5
OSWorld62,6% (2.0)85,0% (Verified)

Sol vinner på Terminal-Bench, Coding Agent Index och Agents' Last Exam, och använder enligt uppgift under hälften av output-tokens, under hälften av tiden och ungefär en tredjedel mindre kostnad per uppgift än Fable 5. Fable 5 vinner ändå avgörande på SWE-Bench Pro och OSWorld.

Lägger man ihop båda uppdateringarna skiftar den ärliga bedömningen från "Fable 5 sopar banan" till "Fable 5 vinner på riktigt repo-arbete och datoranvändning, förlorar mark på agentiva uppgifter, terminaluppgifter och kostnad, mot modeller som inte fanns när det här inlägget först publicerades." Om din arbetsbelastning är SWE-Bench-formad — riktiga pull requests mot riktiga repon — är Fable 5 fortfarande valet. Om den är terminal- och agent-formad, eller budgetbegränsad, kör igenom det nyare fältet innan du bestämmer dig. Anthropics egen nästa release är fortfarande en öppen fråga; se vårt inlägg om Claude Fable 6:s lanseringsdatum för vad namngivningsmönstret antyder.

För aktuell API-prissättning inom hela familjen: Fable 5 och Mythos 5 kostar båda $10/$50 per miljon tokens, Opus 4.8 kostar $5/$25, Sonnet 5 kostar $3/$15 ($2/$10 introduktionspris till och med 31 augusti 2026), och Haiku 4.5 kostar $1/$5.

Vad det betyder: Bör du byta?

Byt till Fable 5 för hård agentiv kodning, långsiktiga flerstegsuppgifter och vision eller spatial resonemang — överallt där att avsluta uppgiften slår att spara ören per token. Stanna på Opus 4.8 för kostnadsmedvetet högvolymarbete, eller för allt som utlöser reservfunktionen ändå. Det är hela ramverket. Resten handlar om att matcha din arbetsbelastning mot rätt sida av det.

När Fable 5 vinner:

  • Hård agentiv kodning där Opus 4.8 kör fast; SWE-Bench Pro-gapet är reellt
  • Långsiktiga uppgifter (flerfilsrefaktoreringar, migrationer) där självvalidering lönar sig
  • Vision och spatial resonemang
  • Varje jobb där en avslutad uppgift är värd mer än tokenpremien

När Opus 4.8 fortfarande vinner:

  • Högvolym, kostnadsmedvetet arbete där pris per token dominerar
  • Cyber/bio/kemi-arbetsbelastningar, där Fable 5 faller tillbaka på Opus 4.8 ändå — anropa den direkt
  • Latenskänsliga flöden som inte tål ett modellbyte mitt i en uppgift
AnvändningsfallRekommenderad modell
Hård agentiv kodning / migrationerClaude Fable 5
Vision / spatial resonemangClaude Fable 5
Högvolym billig klassificeringClaude Opus 4.8
Säkerhet / red-team-verktygClaude Opus 4.8 (direkt)

Om tillgänglighet: upplägget med gratis fram till ett visst datum, som gällde vid lanseringen, är borta. Prissättningsdeadlinen sköts upp fyra gånger, 22 juni → 7 juli → 12 juli → 19 juli 2026, och lösningen den 20 juli ersatte datumet med en nivådelning istället: Max och Team Premium behåller Fable 5 permanent inkluderat på 50 % av plangränserna, medan Pro och Team Standard flyttas till användningskrediter — en engångskredit på $100 följt av API-priser. Den delningen rapporteras av TechTimes, XenoSpectrum och Basic Tutorials; Anthropic har inte publicerat det på sin egen prissida, så behandla det som rapporterat, inte bekräftat. Fable 5 är generellt tillgänglig via Claude API, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (återaktiverad 1 juli 2026 enligt GitHub changelog; Business- och Enterprise-administratörer måste aktivt slå på det, eftersom policyn är avstängd som standard), och konsumentapparna Pro/Max/Team/Enterprise. Kontextfönstret är 1M tokens, max output 128k tokens, kunskapsavskärning januari 2026. Två detaljer värda att flagga för företagsköpare: Fable 5 och Mythos 5 är Covered Models under Anthropics obligatoriska 30-dagars datalagring, så de är inte tillgängliga med noll datalagring, och inferens som enbart körs i USA har ett prispåslag på 1,1x.

Om författaren

Mert Batur är medgrundare av Techsy.io, där teamet bygger AI-agenter, automationssystem och voice/SDR-pipelines för B2B-kunder. Han skriver om det LLM-verktygsstack som Techsy-teamet faktiskt använder i produktion. Kontakta honom på LinkedIn.

Medgrundare, Techsy.io

Vanliga frågor

Vad är Claude Fable 5?

Claude Fable 5 är Anthropics första offentligt tillgängliga Mythos-klass-modell, lanserad den 9 juni 2026. Den når 80,3 % på SWE-Bench Pro och kör skyddsklassificerare som faller tillbaka på Opus 4.8 vid högriskfrågor. Den kostar $10 input / $50 output per miljon tokens.

Vad är skillnaden mellan Fable 5 och Mythos 5?

De är samma frontiermodell med olika distributionslägen. Fable 5 är offentlig och skyddad — den faller tillbaka på Opus 4.8 vid farliga förfrågningar. Mythos 5 är den bevakade fullkapacitetsversionen, tillgänglig enbart via Anthropics Project Glasswing-program för granskade försvarare och forskare.

Är Claude Fable 5 verkligen bättre än Opus 4.8?

Ja, vid hård agentiv kodning, vision och spatial resonemang: Fable 5 når 80,3 % på SWE-Bench Pro mot Opus 4.8:s 69,2 %. Men Opus 4.8 vinner fortfarande vid kostnadsmedvetet högvolymarbete, och Fable 5 faller tillbaka på Opus 4.8 för högrisk-cyber/bio/kemi-ämnen ändå. "Bättre" beror på din arbetsbelastning.

Hur mycket kostar Claude Fable 5?

Claude Fable 5 kostar $10 per miljon input-tokens och $50 per miljon output-tokens. Anthropics inramning är "mindre än hälften av priset för Mythos Preview." Det är ungefär 2× Opus 4.8 per token, men värdefallet gäller per avslutad uppgift — eftersom Fable 5 avslutar arbete som billigare modeller inte kan.

Vad är en "Mythos-klass"-modell?

Mythos-klass är Anthropics nya toppnivå för kapacitet, lanserad med Fable 5 och Mythos 5. Den representerar ett frontierkliv över Opus 4.x-linjen på kodnings- och resonemangsbenchmark. Fable 5 och Mythos 5 är två distributionsversioner av samma Mythos-klass-modell: en offentlig och skyddad, en bevakad.

Varför faller Fable 5 tillbaka på Opus 4.8?

Fable 5 kör klassificerare som identifierar högriskförfrågningar (offensiv cyber, bio, kemi eller modell-destillation) och dirigerar dem till Opus 4.8 istället för att svara med full Mythos-klass-kapacitet. Det utlöses på under 5 % av sessionerna. I Gray Swan / UK AI Security Institutes agent-red-teaming ger den kombinationen Fable 5 en attack-framgångsprocent på 4,8 % mot Opus 4.8:s 9,6 %, båda klart före GPT-5.5:s 30,8 %.

Kan jag få tillgång till Claude Mythos 5?

Förmodligen inte. Mythos 5 är bevastad bakom Project Glasswing, Anthropics granskade åtkomstprogram för försvarare och säkerhetsforskare som behöver full offensiv cyberkapacitet som Fable 5 blockerar. De flesta utvecklare kvalificerar sig inte och behöver inte göra det, eftersom Fable 5 täcker vardagligt agentivt och kodningsarbete.

Var kan jag använda Claude Fable 5?

Claude Fable 5 är generellt tillgänglig via Claude API, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (återaktiverad 1 juli 2026, opt-in för Business-/Enterprise-administratörer) och konsumentapparna Pro/Max/Team/Enterprise. Prissättningen är inte längre gratis fram till ett visst datum: Max och Team Premium behåller det permanent inkluderat, medan Pro och Team Standard får en engångskredit på $100 och sedan API-priser, enligt uppgifter från TechTimes och XenoSpectrum.

Slutsats

Claude Fable 5 är ett reellt frontierkliv över Opus 4.8: 80,3 % mot 69,2 % på SWE-Bench Pro, dubbelt FrontierCode-poängen och en attack-framgångsprocent på 4,8 % mot Opus 4.8:s 9,6 % under Gray Swan / UK AISI:s red-teaming — fortfarande det säkrare valet för verktygsanvändande agenter, även om marginalen är ungefär 2x, inte den skillnad i storleksordning som ibland påstås. Byt för hård agentiv kodning, långsiktiga uppgifter och visionarbete; kolla Claude Sonnet 5 och GPT-5.6 Sol först om din arbetsbelastning är terminal- och agent-formad eller budgetbegränsad, eftersom båda lanserades efter Fable 5 och ingen av dem fanns att jämföra med vid lanseringen. Åtkomsten är inte heller längre gratis fram till ett visst datum: Max/Team Premium behåller den inkluderad, Pro/Team Standard får en engångskredit och sedan API-priser. Techsy-teamet bygger produktionsagenter på exakt den här stacken, så hör av dig om du vill ha hjälp.

Taggar

Claude Fable 5 och Claude Mythos 5Claude Opus 4.8SWE-Bench ProMythos-klassagentiv kodning

Dela denna artikel

Starta ditt projekt

Redo att bygga något utöver det vanliga?

Låt oss göra verklighet av din idé. Vårt team hjälper dig gärna att bygga mjukvara som gör skillnad.