ai-machine-learning

Claude Fable 5 vs Opus 4.8: Overstappen of niet? (Mythos-klasse, getest)

Geschreven door Mert Batur
Bijgewerkt Jul 21, 2026
20 leestijd
Claude Fable 5 vs Opus 4.8: Overstappen of niet? (Mythos-klasse, getest)

Claude Fable 5 vs Opus 4.8: Overstappen of niet? (Mythos-klasse, getest)

Anthropic bracht Claude Fable 5 uit op 9 juni 2026, en de zes weken sindsdien verliepen allesbehalve vlekkeloos: een door de overheid opgelegde schorsing, een volledig herstel, een beveiligingspatch en twee nieuwe concurrerende lanceringen. Het model scoort nog altijd 80,3% op SWE-Bench Pro, de benchmark voor agentisch coderen waarbij Opus 4.8 blijft steken op 69,2% en GPT-5.5 achterblijft op 58,6%. Dat is geen afrondingsfout, al is GPT-5.5 niet langer het enige model waartegen je het moet afzetten. En er zit een addertje onder het gras: Fable 5 is de publieke, beveiligde helft van een nieuw "Mythos-klasse"-model, met een bewaakt broertje genaamd Claude Mythos 5 achter een beperkt toegangsprogramma. Hier lees je wat er veranderd is, wat er sinds de lancering is gebeurd, wat een echte taak kost bij $10/$50 per miljoen tokens, en of je je stack daadwerkelijk van Opus 4.8 moet migreren.

Kort antwoord

  • Fable 5 scoort 80,3% op SWE-Bench Pro tegenover 69,2% van Opus 4.8 en 58,6% van GPT-5.5, maar Claude Sonnet 5 en GPT-5.6 Sol (beide na Fable 5 uitgebracht) dichten een deel van dat gat op agentische en terminal-benchmarks.
  • Prijs is $10 input / $50 output per miljoen tokens, minder dan de helft van Mythos Preview.
  • Fable 5 valt automatisch terug op Opus 4.8 bij hoog-risico cyber/bio/chem queries; een classifier-update van 1 juli blokkeert ook een prompttechniek die Amazon-onderzoekers vonden, in meer dan 99% van de gevallen.
  • Toegang werd voor iedereen geschorst van 12 tot 30 juni 2026 wegens Amerikaanse exportcontroles, en op 1 juli volledig hersteld. Ook de gratis-tot-een-datum-prijsstelling is verdwenen: Max/Team Premium behouden Fable 5 inbegrepen, Pro/Team Standard krijgen eenmalig $100 tegoed en daarna API-tarieven, volgens TechTimes en XenoSpectrum (Anthropic heeft dit zelf niet bevestigd op de eigen site).

Wat er precies uitgebracht is: Fable 5, Mythos 5 en de "Mythos-klasse"

Mythos-klasse is Anthropic's nieuwe topcapaciteitsniveau, en het wordt uitgebracht als twee modellen. Claude Fable 5 is de publieke, beveiligde versie die je vandaag kunt aanroepen. Claude Mythos 5 is hetzelfde frontiermodel zonder de beveiligingen, toegankelijk via bewaakt toegang. Zelfde brein, twee releasehoudingen.

De splitsing is het hele verhaal. Volgens de nieuwsaankondiging van Anthropic behoudt Mythos 5 de volledige frontiercapaciteit, inclusief offensieve cybermogelijkheden die echte schade kunnen aanrichten, dus Anthropic geeft het niet aan iedereen. Fable 5 neemt datzelfde model en omhult het met classificeerders die hoog-risico requests detecteren en ze stil doorsturen naar Opus 4.8 in plaats daarvan.

Dus wanneer je Fable 5 aanroept, krijg je Mythos-klasse redenering op alles wat niet gevaarlijk is, en een veiligheidsmodel op het kleine deel dat dat wel is. CNBC omschreef het als Anthropic dat een "Mythos-achtige AI aan het publiek" uitbrengt, wat accuraat is, maar het precieze mechanisme telt meer dan de kop.

Fable 5 en Mythos 5 zijn hetzelfde frontiermodel in twee stukken geknipt: één die je vandaag kunt gebruiken, één die Anthropic bewaakt houdt. Als je maar één ding onthoudt over de naamgeving, onthoud dan dat. Mythos-klasse is het niveau; Fable en Mythos zijn de twee deuren daartoe.

Wat veranderd is ten opzichte van de Opus 4.x-lijn

Op elke codeer- en redeneer-eval in dit artikel overtreft Fable 5 Opus 4.8, niet met een haartje maar met dubbele-cijfer marges. SWE-Bench Pro springt van 69,2% naar 80,3%, een cijfer dat Anthropic publiceerde en dat Vellum, llm-stats en Weights & Biases onafhankelijk bevestigd hebben. FrontierCode Diamond gaat van 13,4 naar 29,3, een cijfer dat Anthropic zelf niet publiceert; het komt van de tracking door Vellum en llm-stats. De prijs daalde ook, en het model schaalt met een nieuwe redeneerinspanning-knop. Dit is een echte frontierstap ten opzichte van de Opus 4.x-lijn, geen puntrelease.

Claude Mythos 5 / Fable 5 benchmarktabel vs Mythos Preview, Opus 4.8, GPT-5.5, Gemini 3.1 Pro over 13 evaluaties
Claude Mythos 5 / Fable 5 over 13 benchmarks vs Opus 4.8, GPT-5.5 en Gemini 3.1 Pro. Bron: Anthropic.

De 13-benchmark-vergelijking hierboven is de snelle samenvatting. Hier is de kern tegenover de drie modellen die de meeste teams daadwerkelijk vergelijken:

BenchmarkClaude Fable 5Claude Opus 4.8GPT-5.5
SWE-Bench Pro (agentisch coderen)80,3%69,2%58,6%
FrontierCode Diamond (zwaarste coding)29,313,45,7
Terminal-Bench 2.1 (agentische shell)88,0%n/vn/v
GPQA-AA (wetenschappelijk redeneren, Elo)1932n/vn/v
ExploitBench78,0%n/vn/v

De vergelijkingsanker hier is Claude Opus 4.8, het model dat Fable 5 vervangt aan de frontier — en hetzelfde model waar Fable 5 op terugvalt bij hoog-risico queries. Als je de Opus 4.x-lijn door de laatste twee releases hebt gevolgd, was het patroon incrementele winsten. Fable 5 breekt dat patroon.

Twee dingen om te melden voordat je de tabel als evangelie leest. Ten eerste is SWE-Bench Pro Anthropic's eigen gepubliceerde eval, elders onafhankelijk bevestigd; FrontierCode Diamond is helemaal geen door Anthropic gepubliceerd cijfer, het is een externe benchmark die door Vellum en llm-stats wordt bijgehouden. Ten tweede betekent de redeneerinspanning-knop dat één benchmarkcijfer een kostencurve verbergt. Meer daarover in de prijssectie, want dat verandert de rekensom.

De benchmarks die er toe doen voor bouwers

Vier cijfers dragen het praktische gewicht: SWE-Bench Pro 80,3%, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0%, en GPQA-AA 1932 Elo. Samen dekken ze echt repo-werk, de zwaarste synthetische codeerproblemen, agentische shelltaken en wetenschappelijk redeneren op masterniveau. Als je workload iets van dat aanraakt, is dit de sectie die je vertelt of het cijfer op jouw werk van toepassing is.

De hoofdgrafiek bovenaan deze post is het bewijs: SWE-Bench Pro 80,3 vs 69,2 vs 58,6, en FrontierCode 29,3 vs 13,4 vs 5,7. Maar wat meten die eigenlijk?

  • SWE-Bench Pro test of een model een echte pull request naar een echte repo kan sturen: klonen, begrijpen, patchen, tests laten slagen. Fable 5 scoort 8 op 10. Dit is de beste proxy voor "kan het mijn echte werk doen."
  • Terminal-Bench 2.1 beoordeelt agentische shelltaken: commando's uitvoeren, output lezen, fouten herstellen. 88,0% telt mee als je AI-coderingagenten bouwt die in een terminal leven.
  • FrontierCode Diamond is het zwaarste niveau van codeerproblemen, waarbij de meeste modellen enkelvoudige cijfers scoren. 29,3 is laag in absolute termen maar meer dan het dubbele van Opus 4.8's 13,4.
  • GPQA-AA is wetenschappelijk redeneren op masterniveau, beoordeeld als een Elo-rating. 1932 signaleert sterk meerstaps redeneren buiten code.

In onze Claude Code-werkstromen over de Opus 4.x-lijn was het terugkerende plafond langetermijn agentische taken: het model verloor de draad halverwege een wijziging over meerdere bestanden. Fable 5's Terminal-Bench en SWE-Bench Pro cijfers suggereren dat dat plafond verschoven is. Of het voor jouw repo verschoven is, is de enige test die telt, maar de gepubliceerde cijfers zijn het juiste soort cijfers om op te letten.

Concrete testcases: wat Fable 5 doet wat vorige modellen niet konden

Anthropic publiceerde drie concrete voorbeelden die de klasse van problemen laten zien die Fable 5 nu aankan: een Stripe-codebasemigratie samengeperst van maanden naar een dag, een videogame voltooid op puur vision, en een 3× prestatiesprong door zelfvalidatie. Elk wijst op een mogelijkheid die vorige modellen niet bereikten. Alle drie zijn afkomstig van Anthropic; we citeren hun aankondiging, niet onze eigen test.

Dit is wat elk aantoont:

  1. Stripe Ruby-migratie. Anthropic meldt dat Fable 5 een Ruby-codebasemigratie comprimeerde van ruwweg twee maanden naar ongeveer één dag. Stripe comprimeerde een Ruby-migratie van twee maanden naar één dag, en dat is de schaal van probleem die dit model verandert. Dit is de klasse van langetermijn-refactoring die vroeger een menselijk team vereiste dat de hele codebase in zijn hoofd hield.

  2. Pokémon FireRed op puur vision. Volgens Anthropic voltooide Fable 5 Pokémon FireRed met alleen vision, waar vorige modellen complexe aangepaste harnesses nodig hadden om de spelstatus als tekst in te voeren. Dat is een ruimtelijke- en visueel-redenerende sprong: het model leest het scherm en handelt, zonder steiger.

  3. Slay the Spire, 3×. Bij maximale redeneerinspanning zegt Anthropic dat Fable 5 zijn eigen zetten zelf valideert en 3× betere prestatie bereikte via persistent geheugen. De kern is niet het spel; het is dat het model zijn eigen werk over een lange planhorizon kan controleren en ervan kan verbeteren.

Niets van dit alles hoef je op geloof aan te nemen voor je workload. Maar ze koppelen netjes aan de benchmarksprongen in de tabel: langetermijn coderen (SWE-Bench Pro), ruimtelijk redeneren (vision) en zelfvalidatie (de redeneerinspanning-knop). De kwalitatieve en kwantitatieve winsten vertellen hetzelfde verhaal.

Prijs en de kosten-per-taak realiteit

Fable 5 kost $10 per miljoen input-tokens en $50 per miljoen output-tokens. Anthropic stelt dat als "minder dan de helft van de prijs van Claude Mythos Preview." Het is ook ruwweg 2× Opus 4.8 per token. Beide zijn waar. Het addertje is dat tokenprijs de verkeerde eenheid is. Wat je werkelijk betaalt voor is een voltooide taak, en daar wordt Fable 5's rekensommetje interessant.

FrontierCode nauwkeurigheid vs kosten per taak — Claude Fable 5 schaalt van lage naar maximale redeneerinspanning, verslaat Opus 4.8 en GPT-5.5
FrontierCode-score vs gemiddelde kosten per taak naarmate redeneerinspanning schaalt van laag naar max. Bron: Anthropic.

Redeneerinspanning is een knop die je per request instelt. Lage inspanning betekent minder interne redeneer-tokens en een goedkoper, sneller antwoord; maximale inspanning betekent dat het model langer nadenkt, meer output-tokens verbruikt en hoger scoort. De bovenstaande grafiek laat zien hoe Fable 5 klimt van ~11% naar ~31% op FrontierCode naarmate de inspanning schaalt van laag naar max, terwijl Opus 4.8 piekt rond 13% en GPT-5.5 vlak blijft rond 5-6%. Dus kosten per taak is niet één getal; het is een curve waarop je een punt kiest.

Laten we een concreet voorbeeld doorrekenen op basis van de gepubliceerde $10/$50-prijzen. Dit is rekenkunde op basis van Anthropic's gepubliceerde tarieven, geen benchmarkresultaat.

Neem één agentische aanroep met 50.000 input-tokens en 15.000 output-tokens bij hoge inspanning:

text
Input:  50.000 / 1.000.000 × $10 = $0,50
Output: 15.000 / 1.000.000 × $50 = $0,75
Per aanroep:                        $1,25

Een echte agentische taak koppelt veel van zulke aanroepen: repo lezen, plannen, bewerken, tests draaien, fixen, herhalen. Zeg dat de lus 12 aanroepen draait van die vorm: ruwweg $15 voor de voltooide taak. Bij maximale redeneerinspanning met zwaardere context plaatst Anthropic's eigen kostencurve zware FrontierCode-taken dichter bij de $20-per-taak-range. Voer dezelfde taak uit op GPT-5.5 en je betaalt minder per token. Maar als het de taak bij geen enkele inspanning kan afmaken, zijn je kosten-per-voltooide-taak oneindig. Fable 5 kost meer per token dan GPT-5.5 en wint toch op kosten-per-voltooide-taak, omdat het werk voltooit dat GPT-5.5 niet kan.

Hier is een minimale aanroep. Het model-id is claude-fable-5 op de API (anthropic.claude-fable-5 op Bedrock). Sinds de 4.6-generatie zijn Anthropic's model-id's dateloos, zoals ook blijkt uit de aankondiging van Anthropic; er is dus geen versie-alias meer om achteraan te jagen, deze string is de gepinde snapshot:

python
import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
    model="claude-fable-5",          # dateless id; this is the pinned snapshot
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 8000},  # reasoning effort
    messages=[
        {"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
    ],
)

print(message.content)

De economische these in één zin: je betaalt meer per token dan GPT-5.5, maar je voltooit taken die GPT-5.5 tegen geen enkele prijs kan voltooien. Voor goedkoop hoogvolumework heeft goedkoper de voorkeur. Voor zwaar agentisch coderen wint Fable 5.

De beveiligingssplitsing: waarom Fable terugvalt op Opus 4.8

Fable 5 draait classificeerders op elke request. Wanneer het een hoog-risico query detecteert (offensieve cyber, bio, chem of modelbestillatiepogingen), valt het terug op Opus 4.8 in plaats van te antwoorden met volledige Mythos-klasse capaciteit. Anthropic zegt dat deze terugval wordt geactiveerd op minder dan 5% van de sessies, dus de meeste gebruikers zullen het nooit triggeren. Het doel is de gevaarlijke capaciteit achter de poort te houden, terwijl alledaags werk onaangetast blijft.

Het hardere cijfer is het aanvalsuccespercentage: hoe vaak een geautomatiseerde aanvaller het model kan jailbreaken om iets te doen wat niet mag. Lager is beter. Gray Swan en het UK AI Security Institute voerden agent red-teaming uit bij k=100 met thinking aan, en de resultaten zetten een reëel cijfer op de kloof:

ModelAanvalsuccespercentage
Claude Fable 54,8%
Claude Opus 4.89,6%
GPT-5.530,8%
Gemini 3.1 Pro45,5%

Fable 5 blijft koploper, maar de marge ten opzichte van Opus 4.8 is ruwweg 2x, niet de orde-van-grootte-kloof die soms wordt aangehaald. Tegenover GPT-5.5 en Gemini 3.1 Pro is de kloof veel breder, 6-9x.

Waarom zou je dat interesseren? Als je een agent inzet met gereedschapstoegang (shell, bestandssysteem, netwerk), is een jailbreak geen slecht chatantwoord, het is een model dat echte commando's uitvoert die een aanvaller het heeft laten uitvoeren. Een aanvalsuccespercentage onder de 5%, ruwweg de helft van dat van Opus 4.8, is nog steeds de moeite waard voor alles wat live gereedschap aanraakt. IT Pro's berichtgeving opende met dit terugvalmechanisme om precies die reden: het is de functie die een frontiermodel veilig genoeg maakt om aan het publiek te geven.

De afweging is latentie. Als je workflow legitiem beveiligingsgereedschap aanraakt, kan de terugval midden in een taak vuren en van model wisselen, iets om rekening mee te houden.

Claude Mythos 5 en de dubbel-gebruik kwestie

Claude Mythos 5 is het bewaakte broertje, hetzelfde model zonder de beveiligingsterugval. Het behoudt offensieve cybercapaciteit die Fable 5 blokkeert, precies waarom Anthropic het niet publiek uitbrengt. Toegang verloopt via Project Glasswing, een doorgelicht programma voor verdedigers en onderzoekers die volledige capaciteit nodig hebben. Zelfde model, twee releasehoudingen: één open, één bewaakt.

Offensieve cyberevaluatieresultaten — Claude Mythos 5 hoge capaciteit, Claude Fable geeft 0,0 terug waar beveiligingen activeren
Offensieve-cyber-evals: Mythos 5 behoudt capaciteit; Fable geeft 0,0 terug waar blokkeringsbeveiligingen activeren. Bron: Anthropic.

De grafiek maakt de bewaking zichtbaar. Op offensieve-cyber-evals (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) scoort Mythos 5 88,4, 24,0, 83,8 en 38,7. Fable 5 geeft een vlakke 0,0 terug op alle vier. Op offensieve-cyber-evals scoort Mythos 5 tot 88,4 waar Fable 5 een vlakke 0,0 teruggeeft: de beveiligingssplitsing, zichtbaar gemaakt.

Die nul is geen capaciteitskloof. Het is de terugval die elke keer activeert en de request blokkeert voordat het Mythos-klasse model antwoordt. TechCrunch merkte op dat Anthropic dit uitbracht dagen nadat het waarschuwde dat AI te gevaarlijk wordt om openlijk vrij te geven. De Fable/Mythos-splitsing is het beleidsantwoord op die waarschuwing: publiceer de capaciteit, bewak het gevaar.

Voor de meeste ontwikkelaars is Mythos 5 niet relevant. Je kwalificeert nooit voor Project Glasswing en je hoeft dat ook niet. Wat telt is weten dat het model dat je aanroept opzettelijk begrensd is op een smalle band van taken, by design.

Wat er is gebeurd na de lancering: een schorsing van twee weken, gevolgd door een beveiligingspatch

De eerste zes weken van Fable 5 verliepen allesbehalve vlekkeloos. Drie dagen na de lancering op 9 juni legde de Amerikaanse overheid exportcontroles op aan Anthropic's nieuwste modellen, en op 12 juni 2026 werd de toegang voor elke gebruiker, overal, geschorst, omdat Anthropic geen manier had om te verifiëren wie de API daadwerkelijk aanriep. Overheidsgoedkeuring kwam op 26 juni, waarmee Mythos 5 eerst hersteld werd voor een groep doorgelichte Amerikaanse organisaties (Anthropic heeft niet gepubliceerd hoeveel). Volledig herstel voor iedereen kwam op 1 juli 2026, dezelfde dag waarop GitHub Fable 5 weer inschakelde in Copilot. Zie onze volledige tijdlijn van de schorsing voor het volledige verloop.

Die schorsing was een licentiekwestie, geen veiligheidskwestie. Los daarvan, en los van de exportcontrole-bevriezing, vonden Amazon-onderzoekers een prompttechniek die de beveiligingen van Fable 5 goed genoeg omzeilde om softwarekwetsbaarheden naar boven te halen die de classifier had moeten blokkeren. Anthropic haalde het model hier niet voor terug; het bracht een fix uit bij het herstel op 1 juli, een classifier-update die die specifieke techniek in meer dan 99% van de gevallen blokkeert, waarbij de rest zoals voorheen terugvalt op Opus 4.8. Twee verschillende problemen, twee verschillende oplossingen, die in dezelfde kalenderweek landden, is niet hetzelfde als dat het ene het andere veroorzaakte.

Als je iets klantgerichts plant rond Fable 5, is de praktische les dat de voorwaarden van de lanceringsdag van een frontiermodel zes weken later niet altijd nog gelden.

Het competitieve veld is verschoven: GPT-5.6 en Claude Sonnet 5

Fable 5 alleen vergelijken met GPT-5.5 was logisch op 9 juni. Dat is het niet meer. Twee lanceringen sindsdien veranderen de rekensom, en de belangrijkste komt uit Anthropic's eigen lijn, niet van een concurrent.

Claude Sonnet 5, uitgebracht op 30 juni 2026, is de belangrijkste ontbrekende schakel. Het kost $3/$15 per miljoen tokens standaard, $2/$10 als introductietarief tot en met 31 augustus 2026, een fractie van Fable 5's $10/$50. Op SWE-Bench Pro scoort het 63,2%, achter Fable 5's 80,3% en achter Opus 4.8's 69,2%. Maar op Terminal-Bench 2.1 haalt het 80,4%, wat Opus 4.8's 74,6% verslaat, en de OSWorld-Verified-score is 81,2%. Een model uit dezelfde familie dat tegen een vijfde van Fable 5's prijs de vorige vlaggenschip verslaat op een agentische benchmark, is geen detail dat een "moet je overstappen"-artikel kan weglaten.

GPT-5.6, OpenAI's opvolger uitgebracht op 9 juli 2026, komt in drie niveaus: Sol, Terra en Luna. Sol kost $5/$30, ruwweg de helft van Fable 5's inputkosten, met Terra op $2.50/$15 en Luna op $1/$6. Rechtstreeks tegenover elkaar, volgens Vellum's benchmarkvergelijking van 9 juli:

BenchmarkGPT-5.6 SolFable 5
SWE-Bench Pro64,6%80,0%
Terminal-Bench 2.188,8%86,0%
Coding Agent Index8077,2
Agents' Last Exam53,640,5
OSWorld62,6% (2.0)85,0% (Verified)

Sol wint op Terminal-Bench, de Coding Agent Index en Agents' Last Exam, en gebruikt naar verluidt minder dan de helft van de output-tokens, minder dan de helft van de tijd en zo'n derde minder kosten per taak dan Fable 5. Fable 5 wint nog altijd overtuigend op SWE-Bench Pro en OSWorld.

Zet beide ontwikkelingen naast elkaar en het eerlijke oordeel verschuift van "Fable 5 heerst over het hele veld" naar "Fable 5 wint op echt repo-werk en computer-use, verliest terrein op agentische en terminaltaken en kosten, aan modellen die nog niet bestonden toen dit artikel voor het eerst werd gepubliceerd." Als jouw workload SWE-Bench-vormig is, echte pull requests tegen echte repo's, is Fable 5 nog steeds de keuze. Is het terminal-en-agentgericht, of budgetgevoelig, test dan eerst het nieuwere veld voordat je kiest. Anthropic's eigen volgende release is nog een open vraag; zie ons artikel over de releasedatum van Claude Fable 6 voor wat het naampatroon suggereert.

Voor de actuele API-prijzen binnen de hele familie: Fable 5 en Mythos 5 kosten beide $10/$50 per miljoen tokens, Opus 4.8 is $5/$25, Sonnet 5 is $3/$15 ($2/$10 introductietarief tot en met 31 augustus 2026), en Haiku 4.5 is $1/$5.

Wat dit betekent: moet je overstappen?

Stap over naar Fable 5 voor zwaar agentisch coderen, langetermijn meerstappentaken, en vision- of ruimtelijk redeneren — overal waar het voltooien van de taak zwaarder weegt dan cent besparen per token. Blijf op Opus 4.8 voor kostenbesparend hoogvolumwerk, of voor alles wat toch al de terugval triggert. Dat is het hele kader. De rest is het matchen van je workload aan de juiste kant daarvan.

Wanneer Fable 5 wint:

  • Zwaar agentisch coderen waarbij Opus 4.8 vastloopt; de SWE-Bench Pro kloof is reëel
  • Langetermijntaken (refactoring over meerdere bestanden, migraties) waarbij zelfvalidatie zijn waarde bewijst
  • Vision- en ruimtelijk redeneren workloads
  • Elke klus waarbij één voltooide taak meer waard is dan de tokentoeslag

Wanneer Opus 4.8 nog steeds wint:

  • Hoogvolumewerk waarbij kostenbesparend per-token-prijs domineert
  • Cyber/bio/chem workloads, waarbij Fable 5 toch terugvalt op Opus 4.8 — roep het dan direct aan
  • Latentiegevoelige stromen die geen modelwissel midden in een taak verdragen
GebruiksscenarioAanbevolen model
Zwaar agentisch coderen / migratiesClaude Fable 5
Vision / ruimtelijk redenerenClaude Fable 5
Hoogvolume goedkope classificatieClaude Opus 4.8
Security / red-team gereedschapClaude Opus 4.8 (direct)

Over beschikbaarheid: de gratis-tot-een-datum-framing van de lancering is verdwenen. De prijsdeadline werd vier keer opgeschoven, 22 juni → 7 juli → 12 juli → 19 juli 2026, en de oplossing van 20 juli verving de datum door een niveausplitsing: Max en Team Premium behouden Fable 5 permanent inbegrepen tot 50% van de abonnementslimieten, terwijl Pro en Team Standard overstappen op gebruikstegoed, eenmalig $100 tegoed gevolgd door API-tarieven. Die splitsing wordt gerapporteerd door TechTimes, XenoSpectrum en Basic Tutorials; Anthropic heeft het niet gepubliceerd op de eigen prijspagina, dus behandel het als gerapporteerd, niet bevestigd. Fable 5 is algemeen beschikbaar op de Claude API, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (op 1 juli 2026 opnieuw ingeschakeld volgens de GitHub changelog; Business- en Enterprise-beheerders moeten zich actief aanmelden, want het beleid staat standaard uit), en de consumenten Pro/Max/Team/Enterprise-apps. Het contextvenster is 1M tokens, maximale output 128k tokens, kennisafkapping januari 2026. Twee details om te onthouden voor enterprise-kopers: Fable 5 en Mythos 5 zijn Covered Models onder Anthropic's verplichte 30-dagen gegevensbewaring, dus ze zijn niet beschikbaar onder zero data retention, en inference die uitsluitend in de VS draait, brengt een prijsmultiplier van 1,1x met zich mee.

Over de auteur

Mert Batur is mede-oprichter van Techsy.io, waar het team AI-agenten, automatiseringssystemen en voice/SDR-pipelines bouwt voor B2B-klanten. Hij schrijft over de LLM-toolingstack die het Techsy-team daadwerkelijk in productie gebruikt. Verbinden op LinkedIn.

Mede-oprichter, Techsy.io

Veelgestelde vragen

Wat is Claude Fable 5?

Claude Fable 5 is Anthropic's eerste publiek beschikbare Mythos-klasse model, uitgebracht op 9 juni 2026. Het scoort 80,3% op SWE-Bench Pro en draait beveiligingsclassificeerders die terugvallen op Opus 4.8 bij hoog-risico queries. Het kost $10 input / $50 output per miljoen tokens.

Wat is het verschil tussen Fable 5 en Mythos 5?

Ze zijn hetzelfde frontiermodel met verschillende releasehoudingen. Fable 5 is publiek en beveiligd; het valt terug op Opus 4.8 bij gevaarlijke queries. Mythos 5 is de bewaakte volledige-capaciteitsversie, alleen toegankelijk via Anthropic's Project Glasswing-programma voor doorgelichte verdedigers en onderzoekers.

Is Claude Fable 5 echt beter dan Opus 4.8?

Ja, bij zwaar agentisch coderen, vision en ruimtelijk redeneren: Fable 5 haalt 80,3% op SWE-Bench Pro vs Opus 4.8's 69,2%. Maar Opus 4.8 wint nog steeds bij kostengevoelig hoogvolumwerk, en Fable 5 valt toch terug op Opus 4.8 voor hoog-risico cyber/bio/chem topics. "Beter" hangt af van je workload.

Wat kost Claude Fable 5?

Claude Fable 5 kost $10 per miljoen input-tokens en $50 per miljoen output-tokens. Anthropic stelt het als "minder dan de helft van de prijs van Mythos Preview." Dat is ruwweg 2× Opus 4.8 per token, maar de waardepropositie zit in de kosten per voltooide taak, want Fable 5 voltooit werk dat goedkopere modellen niet kunnen.

Wat is een "Mythos-klasse"-model?

Mythos-klasse is Anthropic's nieuwe topcapaciteitsniveau, uitgebracht met Fable 5 en Mythos 5. Het vertegenwoordigt een frontierstap ten opzichte van de Opus 4.x-lijn op codeer- en redeneer-benchmarks. Fable 5 en Mythos 5 zijn twee releaseversies van hetzelfde Mythos-klasse model: één publiek en beveiligd, één bewaakt.

Waarom valt Fable 5 terug op Opus 4.8?

Fable 5 draait classificeerders die hoog-risico requests detecteren (offensieve cyber, bio, chem of modeldistillatie) en leidt ze door naar Opus 4.8 in plaats van te antwoorden met volledige Mythos-klasse capaciteit. Dit wordt geactiveerd op minder dan 5% van de sessies. In agent red-teaming door Gray Swan / het UK AI Security Institute geeft die combinatie Fable 5 een aanvalsuccespercentage van 4,8% tegenover 9,6% voor Opus 4.8, beide ruim voor op de 30,8% van GPT-5.5.

Kan ik Claude Mythos 5 gebruiken?

Waarschijnlijk niet. Mythos 5 is bewaakt achter Project Glasswing, Anthropic's doorgelicht toegangsprogramma voor verdedigers en beveiligingsonderzoekers die volledige offensieve-cybercapaciteit nodig hebben die Fable 5 blokkeert. De meeste ontwikkelaars kwalificeren niet en hoeven dat ook niet, want Fable 5 dekt alledaags agentisch en coderingwerk.

Waar kan ik Claude Fable 5 gebruiken?

Claude Fable 5 is algemeen beschikbaar op de Claude API, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (op 1 juli 2026 opnieuw ingeschakeld, opt-in voor Business/Enterprise-beheerders), en de consumenten Pro/Max/Team/Enterprise-apps. De prijsstelling is niet langer gratis-tot-een-datum: Max en Team Premium behouden het permanent inbegrepen, terwijl Pro en Team Standard eenmalig $100 tegoed krijgen, en daarna API-tarieven, zoals gerapporteerd door TechTimes en XenoSpectrum.

De conclusie

Claude Fable 5 is een echte frontierstap ten opzichte van Opus 4.8: 80,3% versus 69,2% op SWE-Bench Pro, dubbele FrontierCode-score, en een aanvalsuccespercentage van 4,8% tegenover 9,6% voor Opus 4.8 onder Gray Swan / UK AISI red-teaming, nog steeds de veiligere keuze voor agents die gereedschap gebruiken, al is de marge ruwweg 2x, niet de orde van grootte die soms wordt beweerd. Stap over voor zwaar agentisch coderen, langetermijntaken en vision-werk; check eerst Claude Sonnet 5 en GPT-5.6 Sol als jouw workload terminal-en-agentgericht is of budgetgevoelig, aangezien beide na Fable 5 zijn uitgebracht en er bij de lancering nog niet waren om tegen te vergelijken. Toegang is ook niet langer gratis-tot-een-datum: Max/Team Premium behouden het inbegrepen, Pro/Team Standard krijgen eenmalig tegoed en daarna API-tarieven. Het Techsy-team bouwt productieagenten op precies deze stack, dus neem contact op als je een handje hulp wilt.

Tags

Claude Fable 5 en Claude Mythos 5Claude Opus 4.8SWE-Bench ProMythos-klasseagentisch coderen

Dit artikel delen

Start je project

Klaar om iets buitengewoons te bouwen?

Laten we je idee werkelijkheid maken. Ons team staat klaar om software te bouwen die het verschil maakt.