
Claude Fable 5 vs Opus 4.8: Máte skutečně přejít? (Třída Mythos, s benchmarky)
Anthropic dnes, 9. června 2026, vydal Claude Fable 5. Na SWE-Bench Pro, benchmarku agentního programování, dosahuje 80,3 %, zatímco Opus 4.8 zvládá 69,2 % a GPT-5.5 zaostává s 58,6 %. To není rozdíl v řádu zaokrouhlovací chyby. A je tu zvrat: Fable 5 je veřejná, zabezpečená polovina nového modelu „třídy Mythos", která má gated sourozence jménem Claude Mythos 5 drženého v programu s omezeným přístupem. Tady je, co se změnilo, kolik reálně stojí úloha při 10/50 $ za milion tokenů a zda byste měli skutečně přesunout svůj stack z Opus 4.8.
Rychlá odpověď
- Fable 5 dosahuje 80,3 % na SWE-Bench Pro oproti 69,2 % u Opus 4.8 a 58,6 % u GPT-5.5.
- Cenovka je 10 $ vstup / 50 $ výstup za milion tokenů, méně než polovina ceny Mythos Preview.
- Fable 5 se automaticky vrací na Opus 4.8 u vysoce rizikových kyber/bio/chem dotazů (pod 5 % relací).
- Zdarma na plánech Pro/Max/Team/Enterprise do 22. června 2026; od 23. června se uplatňují kredity za využití.
Co se skutečně spustilo: Fable 5, Mythos 5 a řada „třídy Mythos"
Třída Mythos je nová nejvyšší výkonnostní úroveň Anthropic a přichází jako dva modely. Claude Fable 5 je veřejná, zabezpečená verze, kterou můžete volat už dnes. Claude Mythos 5 je stejný frontier model bez bezpečnostních pojistek, držený za branou omezeného přístupu. Stejný mozek, dva způsoby vydání.
Právě tohle rozdělení je celý příběh. Podle oznámení v newsroomu Anthropic si Mythos 5 zachovává plnou frontier výkonnost, včetně útočných kybernetických dovedností, které by mohly napáchat reálné škody, takže ho Anthropic nedává každému. Fable 5 vezme stejný model a zabalí ho do klasifikátorů, které detekují vysoce rizikové požadavky a tiše je směrují na Opus 4.8.
Takže když zavoláte Fable 5, dostanete uvažování třídy Mythos na vše, co není nebezpečné, a bezpečnější záložní model na tom malém výseku, který nebezpečný je. CNBC to zarámoval tak, že Anthropic vydává „AI podobnou Mythos veřejnosti", což je přesné, ale přesný mechanismus je důležitější než titulek.
Fable 5 a Mythos 5 jsou stejný frontier model rozdělený na dva: jeden můžete používat dnes, druhý Anthropic drží za branou. Pokud si z názvosloví máte zapamatovat jen jednu věc, zapamatujte si tohle. Třída Mythos je úroveň; Fable a Mythos jsou dvoje dveře do ní.
Co se změnilo oproti řadě Opus 4.x
Na každém codingovém a reasoningovém evaluačním testu, který Anthropic zveřejnil, Fable 5 překonává Opus 4.8, a to ne o vlasy, ale o dvouciferné rozdíly. SWE-Bench Pro skáče z 69,2 % na 80,3 %. FrontierCode Diamond jde z 13,4 na 29,3. Cena taky klesla a model se škáluje pomocí nového ovladače míry uvažování. Tohle je skutečný frontier skok oproti řadě Opus 4.x, ne jen bodový release.

Výše uvedený přehled 13 benchmarků je verze pro rychlý přehled. Tady je hlavní podmnožina proti třem modelům, které týmy reálně srovnávají:
| Benchmark | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (agentní coding) | 80,3 % | 69,2 % | 58,6 % |
| FrontierCode Diamond (nejtěžší coding) | 29,3 | 13,4 | 5,7 |
| Terminal-Bench 2.1 (agentní shell) | 88,0 % | n/a | n/a |
| GPQA-AA (absolventský reasoning, Elo) | 1932 | n/a | n/a |
| ExploitBench | 78,0 % | n/a | n/a |
Srovnávací kotva tady je Claude Opus 4.8, model, který Fable 5 nahrazuje na frontieru a zároveň model, na který se Fable 5 vrací u rizikových dotazů. Pokud jste sledovali řadu Opus 4.x přes poslední dva releasy, vzorec byl inkrementální. Fable 5 ten vzorec láme.
Dvě věci, než budete tabulku brát jako evangelium. Za prvé, jsou to vlastní publikované evaluace Anthropic, ne nezávislý test. Za druhé, ovladač míry uvažování znamená, že jedno číslo z benchmarku skrývá nákladovou křivku. O tom víc v sekci o cenách, protože to mění propočet.
Benchmarky, které jsou důležité pro buildery
Čtyři čísla nesou praktickou váhu: SWE-Bench Pro 80,3 %, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0 % a GPQA-AA 1932 Elo. Dohromady pokrývají práci na reálném repu, nejtěžší syntetické codingové úlohy, agentní shellové úkoly a reasoning na úrovni absolventa vysoké školy. Pokud se váš workload dotýká kteréhokoli z toho, tohle je sekce, která vám řekne, jestli to číslo odpovídá vaší práci.
Hlavní graf nahoře v článku je důkaz: SWE-Bench Pro 80,3 vs 69,2 vs 58,6 a FrontierCode 29,3 vs 13,4 vs 5,7. Co ale tyhle benchmarky vlastně měří?
- SWE-Bench Pro testuje, jestli model dokáže odevzdat reálný pull request do reálného repa: naklonovat, pochopit, opravit, projít testy. SWE-Bench Pro měří, zda model umí odevzdat reálný pull request do reálného repa, a Fable 5 zvládá 8 z 10. Tohle je nejbližší proxy k otázce „dokáže to moji skutečnou práci?"
- Terminal-Bench 2.1 hodnotí agentní shellové úkoly: spouštění příkazů, čtení výstupu, zotavení z chyb. 88,0 % je důležité, pokud stavíte AI coding agenty, kteří žijí v terminálu.
- FrontierCode Diamond je nejtěžší tier codingových úloh, ty, kde většina modelů skóruje jednociferně. 29,3 je v absolutním vyjádření málo, ale víc než dvojnásobek 13,4 u Opus 4.8.
- GPQA-AA je reasoning na úrovni absolventa přírodních věd, hodnocený jako Elo rating. 1932 signalizuje silné vícekrokové uvažování přesahující kód.
V našich workflotech s Claude Code napříč řadou Opus 4.x byl opakující se strop dlouhý horizont agentních úloh: model ztrácel nit uprostřed vícesouborové změny. Čísla Fable 5 na Terminal-Bench a SWE-Bench Pro naznačují, že se ten strop posunul. Jestli se posunul pro váš rep, je jediný test, na kterém záleží, ale publikovaná čísla jsou ten správný druh čísel, o které se zajímat.
Reálné testovací případy: Co Fable 5 umí a předchozí modely neuměly
Anthropic publikoval tři konkrétní příklady, které ukazují třídu problémů, jež Fable 5 teď zvládne: migraci kódové báze Stripe stlačenou z měsíců na den, videohru dokončenou pouze pomocí vizuálního vstupu a 3× výkonnostní skok díky sebevalidaci. Každý ukazuje na schopnost, na kterou předchozí modely nedosáhly. Všechny tři pocházejí od Anthropic; citujeme jejich oznámení, ne náš vlastní test.
Tady je, co každý z nich dokazuje:
-
Migrace Stripe Ruby. Anthropic uvádí, že Fable 5 stlačil migraci Ruby kódové báze z přibližně dvou měsíců na zhruba jeden den. Stripe stlačil migraci Ruby ze dvou měsíců na jediný den a to je velikost problému, kterou tenhle model mění. Tohle je třída dlouhého horizontu refaktoringu, která dřív potřebovala lidský tým držící celou kódovou bázi v hlavě.
-
Pokémon FireRed pouze přes vizuální vstup. Podle Anthropic dokončil Fable 5 Pokémon FireRed s využitím pouze zraku, kde předchozí modely potřebovaly složité vlastní harnessy, které krmily stav hry jako text. To je skok v prostorovém a vizuálním uvažování: model čte obrazovku a jedná, bez lešení.
-
Slay the Spire, 3×. Při maximální míře uvažování podle Anthropic Fable 5 validuje vlastní tahy a dosáhl 3× lepšího výkonu díky perzistentní paměti. Pointa není ta hra; je to, že model dokáže kontrolovat vlastní práci na dlouhém plánovacím horizontu a zlepšovat se na základě toho.
Nic z toho byste neměli brát jako víru pro svůj workload. Ale čistě to mapuje na skoky v benchmarkové tabulce výše: dlouhý horizont programování (SWE-Bench Pro), prostorové uvažování (vize) a sebevalidace (ovladač míry uvažování). Kvalitativní výhry a kvantitativní vyprávějí stejný příběh.
Ceny a realita nákladů na úlohu
Fable 5 stojí 10 $ za milion vstupních tokenů a 50 $ za milion výstupních tokenů. Anthropic to rámuje jako „méně než polovina ceny Claude Mythos Preview." Zároveň je to zhruba 2× Opus 4.8 za token. Obojí je pravda. Háček je v tom, že cena za token je špatná jednotka. To, co reálně platíte, je dokončená úloha, a tam se matematika Fable 5 stává zajímavou.

Míra uvažování je ovladač, který nastavujete pro každý požadavek. Nízká míra znamená méně interních reasoningových tokenů a levnější, rychlejší odpověď; maximální míra znamená, že model přemýšlí déle, utratí víc výstupních tokenů a skóruje výš. Graf výše ukazuje Fable 5 stoupat z ~11 % na ~31 % na FrontierCode při škálování od nízké po maximální míru, zatímco Opus 4.8 vrcholí kolem 13 % a GPT-5.5 sedí plocho poblíž 5–6 %. Takže náklady na úlohu nejsou jedno číslo; je to křivka, na které si vybíráte bod.
Pojďme si propočítat konkrétní příklad z publikovaných cen 10/50 $. Tohle je aritmetika z ceníku Anthropic, ne benchmarkový výsledek.
Vezměte jeden agentní volání s 50 000 vstupními tokeny a 15 000 výstupními tokeny při vysoké míře uvažování:
Input: 50,000 / 1,000,000 × $10 = $0.50
Output: 15,000 / 1,000,000 × $50 = $0.75
Per call: $1.25Reálná agentní úloha řetězí mnoho takových volání: čtení repa, plán, úprava, spuštění testů, oprava, opakování. Řekněme, že smyčka proběhne 12 voláními toho tvaru: zhruba 15 $ za dokončenou úlohu. Při maximální míře uvažování s těžším kontextem vlastní nákladová křivka Anthropic řadí těžké úlohy FrontierCode blíž k rozsahu 20 $ za úlohu. Spusťte stejnou úlohu na GPT-5.5 a zaplatíte míň za token. Ale pokud úlohu nedokáže dokončit na žádné míře uvažování, vaše náklady na dokončenou úlohu jsou nekonečné. Fable 5 stojí víc za token než GPT-5.5, a přesto vyhrává na nákladech na dokončenou úlohu, protože dokončí práci, kterou GPT-5.5 nezvládne.
Tady je minimální volání. Oznámení Anthropic uvádí claude-fable-5 jako id modelu; ověřte přesný verzovaný řetězec v dokumentaci API Anthropic, než to nasadíte, protože datované aliasy se někdy liší:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # verify exact dated id in API docs
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)Ekonomická teze jednou větou: platíte víc za token než u GPT-5.5, ale dokončíte úlohy, které GPT-5.5 nedokončí za žádnou cenu. Pro nízce rizikovou práci s vysokým objemem ta matematika favorizuje levnější model. Pro těžký agentní coding favorizuje Fable 5.
Rozdělení bezpečnostních pojistek: Proč se Fable vrací na Opus 4.8
Fable 5 spouští klasifikátory na každý požadavek. Když detekuje vysoce rizikový dotaz (útočný kyber, bio, chem nebo pokusy o destilaci modelu), vrátí se na Opus 4.8 místo odpovědi s plnou výkonností třídy Mythos. Anthropic uvádí, že tento fallback se spouští u méně než 5 % relací, takže většina uživatelů ho nikdy nespustí. Smyslem je udržet nebezpečnou schopnost za branou a přitom nechat každodenní práci nedotčenou.

Tvrdší číslo je míra úspěšnosti útoků: jak často automatizovaný útočník dokáže jailbreaknout model k něčemu, co by neměl. Nižší je lepší. Výsledky red-teamu Anthropic ukazují strmý pokles napříč releasy, od Opus 4.6 s 83,2 %, přes Opus 4.7 s 72,7 %, po Opus 4.8 s 56,6 %, dolů na Fable 5 s 5,4 %. Při automatizovaném red-teamingu útoky uspěly proti Fable 5 jen v 5,4 % případů, dolů z 56,6 % na Opus 4.8.
Proč by vás to mělo zajímat? Pokud nasadíte agenta s přístupem k nástrojům (shell, souborový systém, síť), jailbreak není špatná odpověď v chatu, je to model vykonávající reálné příkazy, ke kterým ho útočník navedl. Míra úspěšnosti útoků 5,4 % znamená, že je zhruba desetkrát těžší ho zneužít než Opus 4.8. Pokrytí IT Pro vedlo s fallback mechanismem přesně z tohoto důvodu: je to funkce, která dělá frontier model dostatečně bezpečný na to, aby se dal veřejnosti.
Kompromis je latence. Pokud se váš workflow legitimně dotýká bezpečnostního nástroje, fallback se může spustit uprostřed úlohy a vyměnit vám model pod rukama, s čímž je potřeba počítat.
Claude Mythos 5 a otázka dvojího použití
Claude Mythos 5 je gated sourozenec, stejný model bez bezpečnostního fallbacku. Zachovává si útočné kybernetické schopnosti, které Fable 5 blokuje, a právě proto ho Anthropic nevydává veřejně. Přístup běží přes Project Glasswing, prověřený program pro obránce a výzkumníky, kteří potřebují plnou výkonnost. Stejný model, dva způsoby vydání: jeden otevřený, jeden gated.

Graf dělá to gate viditelným. Na evaluacích útočného kyberprostoru (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 skóruje 88,4, 24,0, 83,8 a 38,7. Fable 5 vrací plochých 0,0 napříč všemi čtyřmi. Na evaluacích útočného kyberprostoru Mythos 5 skóruje až 88,4, kde Fable 5 vrací plochých 0,0: rozdělení pojistek, zviditelněné.
Ta nula není výkonnostní mezera. Je to fallback, který se spouští pokaždé a blokuje požadavek dřív, než model třídy Mythos odpoví. TechCrunch si všiml načasování: Anthropic to vydal pár dní po varování, že AI je příliš nebezpečná na otevřené vydání. Rozdělení Fable/Mythos je politická odpověď na to varování, publikuj schopnost, gate nebezpečí.
Pro většinu vývojářů je Mythos 5 irelevantní. Nikdy se nekvalifikujete do Project Glasswing a nepotřebujete to. Co je důležité, je vědět, že model, který voláte, je záměrně omezený na úzkém pásmu úloh, a to by design.
Co to znamená: Máte přejít?
Přejděte na Fable 5 pro těžký agentní coding, dlouhé vícekrokové úlohy a vizuální či prostorové uvažování, všude tam, kde dokončení úlohy přebije šetření haléřů za token. Zůstaňte na Opus 4.8 pro cenově citlivou práci s vysokým objemem nebo pro cokoli, co stejně spouští fallback. To je celý rámec. Zbytek je přiřazení vašeho workloadu ke správné straně.
Kdy Fable 5 vyhrává:
- Těžký agentní coding, kde Opus 4.8 vázne; mezera na SWE-Bench Pro je reálná
- Úlohy s dlouhým horizontem (vícesouborové refaktoringy, migrace), kde se sebevalidace vyplácí
- Workloady s vizuálním a prostorovým uvažováním
- Jakákoli práce, kde jedna dokončená úloha stojí víc než příplatek za token
Kdy Opus 4.8 stále vyhrává:
- Vysokoobjemová, cenově citlivá práce, kde dominuje cena za token
- Kyber/bio/chem workloady, kde se Fable 5 stejně vrací na Opus 4.8, takže ho volejte přímo
- Latenčně citlivé toky, které nesnesou výměnu modelu uprostřed úlohy
| Případ užití | Doporučený model |
|---|---|
| Těžký agentní coding / migrace | Claude Fable 5 |
| Vizuální / prostorové uvažování | Claude Fable 5 |
| Vysokoobjemová levná klasifikace | Claude Opus 4.8 |
| Bezpečnostní / red-team nástroje | Claude Opus 4.8 (přímo) |
Co se dostupnosti týče: Fable 5 je zdarma na plánech Pro/Max/Team/Enterprise do 22. června 2026, s kredity za využití od 23. června. Je obecně dostupný na API, AWS Bedrock, GitHub Copilot podle GitHub changelogu a Harvey. Takže přechod můžete otestovat v editoru ještě dnes, aniž byste měnili fakturaci.
O autorovi
Mert Batur Gurbuz je spoluzakladatelem Techsy.io, kde tým dodává AI agenty, automatizační systémy a hlasové/SDR pipeline pro B2B klienty. Studuje na University of Birmingham a píše o stacku nástrojů kolem LLM, který tým Techsy reálně používá v produkci. Spojte se na LinkedIn.
Spoluzakladatel, Techsy.io · University of Birmingham
Často kladené otázky
Co je Claude Fable 5?
Claude Fable 5 je první veřejně dostupný model třídy Mythos od Anthropic, spuštěný 9. června 2026. Na SWE-Bench Pro dosahuje 80,3 % a spouští bezpečnostní klasifikátory, které se u vysoce rizikových dotazů vracejí na Opus 4.8. Stojí 10 $ vstup / 50 $ výstup za milion tokenů.
Jaký je rozdíl mezi Fable 5 a Mythos 5?
Je to stejný frontier model s různými způsoby vydání. Fable 5 je veřejný a zabezpečený; u nebezpečných dotazů se vrací na Opus 4.8. Mythos 5 je gated verze s plnou výkonností, přístupná pouze přes program Anthropic Project Glasswing pro prověřené obránce a výzkumníky.
Je Claude Fable 5 skutečně lepší než Opus 4.8?
Ano, u těžkého agentního programování, vize a prostorového uvažování: Fable 5 dosahuje 80,3 % na SWE-Bench Pro oproti 69,2 % u Opus 4.8. Ale Opus 4.8 stále vyhrává u cenově citlivé vysokoobjemové práce a Fable 5 se u vysoce rizikových kyber/bio/chem témat stejně vrací na Opus 4.8. „Lepší" závisí na vašem workloadu.
Kolik stojí Claude Fable 5?
Claude Fable 5 stojí 10 $ za milion vstupních tokenů a 50 $ za milion výstupních tokenů. Rámování Anthropic je „méně než polovina ceny Mythos Preview." To je zhruba 2× Opus 4.8 za token, ale hodnotový argument je na dokončenou úlohu, protože Fable 5 dokončí práci, kterou levnější modely nezvládnou.
Co je model „třídy Mythos"?
Třída Mythos je nová nejvyšší výkonnostní úroveň Anthropic, spuštěná s Fable 5 a Mythos 5. Představuje frontier skok oproti řadě Opus 4.x na codingových a reasoningových benchmarcích. Fable 5 a Mythos 5 jsou dvě verze vydání stejného modelu třídy Mythos: jedna veřejná a zabezpečená, jedna gated.
Proč se Fable 5 vrací na Opus 4.8?
Fable 5 spouští klasifikátory, které detekují vysoce rizikové požadavky (útočný kyber, bio, chem nebo destilace modelu) a směrují je na Opus 4.8 místo odpovědi s plnou výkonností třídy Mythos. Spouští se to u méně než 5 % relací. Snížilo to úspěšnost adversariálních útoků z 56,6 % (Opus 4.8) na 5,4 %.
Mohu získat přístup k Claude Mythos 5?
Pravděpodobně ne. Mythos 5 je za branou Project Glasswing, prověřeného přístupového programu Anthropic pro obránce a bezpečnostní výzkumníky, kteří potřebují plnou výkonnost v útočném kyberprostoru, kterou Fable 5 blokuje. Většina vývojářů se nekvalifikuje a nepotřebuje to, protože Fable 5 pokrývá každodenní agentní a codingovou práci.
Kde mohu používat Claude Fable 5?
Claude Fable 5 je obecně dostupný na Anthropic API, AWS Bedrock, GitHub Copilot a Harvey. Je zdarma na plánech Pro, Max, Team a seat-based Enterprise do 22. června 2026; od 23. června se uplatňují kredity za využití. Můžete ho otestovat v editoru nebo přes API už dnes.
Shrnutí
Claude Fable 5 je skutečný frontier skok oproti Opus 4.8: 80,3 % vs 69,2 % na SWE-Bench Pro, dvojnásobné skóre FrontierCode a míra úspěšnosti útoků 5,4 %, díky které je mnohem bezpečnější ho nasadit s nástroji. Přejděte pro těžký agentní coding, úlohy s dlouhým horizontem a vizuální práci. Zůstaňte na Opus 4.8 pro cenově citlivý objem nebo cokoli, co stejně spouští fallback. Do 22. června je zdarma, takže přechod můžete otestovat, než vás bude cokoli stát. Tým Techsy staví produkční agenty přesně na tomhle stacku, takže se ozvěte, pokud chcete pomoct.