Techsy
Kontakt
Začít
Zpět na blog
ai-machine-learning

Claude Opus 5 je tady: Inteligence blízká Fable 5 za poloviční cenu

Napsal Mert Batur Gürbüz
Jul 24, 2026
12 minut čtení
Obsah
Claude Opus 5 je tady: Inteligence blízká Fable 5 za poloviční cenu

Claude Opus 5 je tady: Inteligence blízká Fable 5 za poloviční cenu

Anthropic vydal Claude Opus 5 24. července 2026 a sdělení je přímočaré: inteligence blízká frontier modelu Fable 5 za poloviční cenu. Hlavní důkaz je Frontier-Bench v0.1, kde Opus 5 dosahuje 43,3 % a více než zdvojnásobuje 21,1 % Opus 4.8. Háček — a nějaký tam je vždycky: nevyhrává ve všem. GPT-5.6 Sol ho stále těsně poráží v jednom testu agentního kódování a v oblasti zdraví a biologie patří koruna Mythos 5. Tady je, co se skutečně změnilo, kompletní tabulka benchmarků a zda byste měli ještě dnes přepnout svůj výchozí model.

Klíčové body:

  • Claude Opus 5 byl spuštěn 24. července 2026 na Claude API, Claude.ai, Claude Code a Claude Cowork, s ID modelu claude-opus-5.
  • Vede ve většině publikovaných benchmarků Anthropic (Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench), ale zaostává v několika testech kódování, práva a vědy.
  • Cena zůstává nezměněná oproti Opus 4.8: 5 $ / 25 $ za milion tokenů, s režimem Fast za přibližně dvojnásobnou cenu a zhruba 2,5× vyšší rychlost.

Co se dnes vydalo: Claude Opus 5 v jedné minutě

Claude Opus 5 je nový frontier model Anthropic, vydaný 24. července 2026 a dostupný stejný den na API, Claude.ai, Claude Code a Claude Cowork. ID modelu je claude-opus-5. Rámcování Anthropic podle oznámení zní, že se „blíží frontier inteligenci Claude Fable 5 za poloviční cenu." Standardní cena zůstává 5 $ vstup / 25 $ výstup za milion tokenů, stejně jako u Opus 4.8.

Toto je skutečný generační skok pro agentní práci, ne jen bodová aktualizace. Pokud přecházíte z Claude Opus 4.8, tvar API a integrace Claude Code zůstávají nezměněné, takže migrace je jen výměna ID modelu. Co je jiné, je strop: na Frontier-Bench v0.1 Anthropic uvádí, že Opus 5 více než zdvojnásobuje skóre 4.8 při nižších nákladech na úlohu a na GDPval-AA a ARC-AGI-3 dosahuje nejlepších výsledků.

Na pozicování záleží. Fable 5 je nejdražší frontier model Anthropic. Dostat se na dosah jeho výkonu za cenu Opus je celý příběh tohoto vydání a proto je fráze „za poloviční cenu" tou, kterou Anthropic vede.

Co je v Opus 5 oproti 4.8 skutečně nového?

Největší posun od 4.8 k 5 je v úsudku: Opus 5 je výrazně lepší v ověřování vlastní práce a iterování, dokud úloha není skutečně hotová, ne jen pravděpodobně dokončená. Anthropic také uvádí silnější softwarové inženýrství, znalostní práci a vědecký výzkum plus vylepšený vizuální výstup. Cena a základní API zůstaly beze změny.

Lepší úsudek a sebereflexe

Nejjasnější behaviorální změna je, že Opus 5 sám sebe kontroluje. Anthropic cituje Zimu Li, technického pracovníka, který model popisuje jako ten, který „ověřuje větve, kontroluje šablony", místo aby se hnal vpřed. Pro kohokoli, kdo se spoléhá na agenta, že odhalí vlastní chyby v produkci, je to vlastnost, která rozhoduje. Zároveň je to nejtěžší věc na prodej v tabulce benchmarků, takže to berte jako tvrzení, které si musíte otestovat na vlastních úlohách.

Frontier inteligence za cenu Opus

Sualeh Asif, spoluzakladatel Cursor, shrnul vydání jako „inteligence blízká Fable 5 při rychlosti a nákladech Opus." To je praktický výklad: týmy, které chtěly uvažování na úrovni Fable 5, ale nemohly ospravedlnit cenu, mají nyní střední variantu. Na OSWorld 2.0 Anthropic uvádí, že Opus 5 překonává Fable 5 za přibližně třetinové náklady, což je nejčistší jednotlivý příklad hodnotového argumentu.

Postoj k alignmentu a bezpečnosti

Anthropic uvádí, že Opus 5 má dosud nejnižší skóre nezarovnaného chování (2,3) a označuje ho za model nejvíce zarovnaný se svou Ústavou. Na bezpečnostní straně jsou kybernetické klasifikátory popsány jako přibližně o 85 % méně restriktivní než u Fable 5, s podnikovým programem Cyber Verification pro týmy, které ho potřebují. Jako u každého bezpečnostního tvrzení dodavatele — dobré vědět, ale stále stojí za ověření proti vlastním red-team případům.

Benchmarky Opus 5: Kde vyhrává (a kde prohrává)

Opus 5 vede ve většině publikovaných benchmarků Anthropic a výhry, které jsou důležité pro tvůrce agentů, jsou drtivé: Frontier-Bench v0.1 (43,3 %), GDPval-AA (1861 Elo), ARC-AGI-3 (30,2 %), OSWorld 2.0 (70,6 %) a AutomationBench od Zapier (26,0 %). Upřímné výjimky: GPT-5.6 Sol vyhrává DeepSWE v1.1, Fable 5 těsně poráží v FrontierCode a právních testech a Mythos 5 bere zdraví a biologii.

BenchmarkOpus 5Fable 5Opus 4.8GPT-5.6 Sol
Agentní terminálové kódování, Frontier-Bench v0.143,3 %33,7 %21,1 %34,4 %
Znalostní práce, GDPval-AA v2 (Elo)1861174715931736
Řešení nových problémů, ARC-AGI-330,2 %—1,5 %7,8 %
Agentní vyhledávání, BrowseComp90,8 %87,4 %84,3 %90,4 %
Multidisciplinární uvažování, Humanity's Last Exam (s nástroji)64,7 %63,9 %57,9 %—
Agentní ovládání počítače, OSWorld 2.070,6 %66,1 %55,7 %62,6 %
Agentní kódování, DeepSWE v1.168,8 %69,7 %59,0 %72,7 %
Agentní kódování, FrontierCode v1.1 (Main)53,4 %53,5 %46,5 %47,5 %
Business workflow, AutomationBench26,0 %17,4 %17,0 %18,1 %
Legal Agent Benchmark (held-out)11,7 %13,3 %10,4 %2,5 %
Zdraví, HealthBench Professional59,8 %66,0 %57,4 %60,5 %
Biologie, BioMysteryBench (hard)49,4 %46,5 %42,4 %—

Srovnání benchmarků Claude Opus 5 s Fable 5, Opus 4.8 a GPT-5.6 Sol napříč Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench a dalšími
Zdroj: Anthropic

Čtěte rozdíly, ne jen absolutní skóre. Frontier-Bench skočil o +22,2 bodu oproti Opus 4.8 (z 21,1 na 43,3), největší jednotlivý skok a důvod, proč Anthropic označuje toto vydání za zaměřené na kódování a agenty. GDPval-AA získal +268 Elo (z 1593 na 1861) a překonal každý model v tabulce v znalostní práci. ARC-AGI-3 je to, co přitahuje pozornost: 30,2 % oproti 7,8 % u GPT-5.6 Sol a 1,5 % u Opus 4.8, což Anthropic rámuje jako zhruba 3× lepší než další nejlepší veřejný model v řešení nových problémů. Na AutomationBench je 26,0 % přibližně 1,5× více než zbytek pole, přímý signál pro kohokoli, kdo staví agenty pro business procesy.

Dvě upřímné poznámky k prohrám. Za prvé, lídr ve sloupci Fable 5 v oblasti zdraví (66,0 %) a v biologickém testu řešeném lidmi je ve skutečnosti Mythos 5, vědecky specializovaný model Anthropic, ne Fable 5, takže to nejsou srovnatelné výhry obecného modelu. Za druhé, obraz kódování je skutečně rozdělený: GPT-5.6 Sol bere DeepSWE v1.1 (72,7 % vs 68,8 %) a Fable 5 vyhrává FrontierCode o vlas (53,5 % vs 53,4 %). Pokud je vaše práce čistě kódování ve stylu SWE-bench, nálepka „nejlepší celkově" automaticky nevybírá Opus 5.

Kolik stojí Opus 5? Cena a režim Fast

Standardní cena Opus 5 je 5 $ za milion vstupních tokenů a 25 $ za milion výstupních tokenů, identická s Opus 4.8 podle oficiálního ceníku Anthropic, takže za upgrade neplatíte nic navíc. Tvrzení „za poloviční cenu" je relativní k Fable 5, ne k 4.8: získáte inteligenci blízkou Fable 5, aniž byste platili sazby Fable 5. Režim Fast běží za přibližně dvojnásobnou základní cenu se zhruba 2,5× vyšší výchozí rychlostí a API podporuje záložní směrování.

Co to znamená na úlohu? Se standardní cenou neplatíte nic navíc oproti 4.8 a získáte velký skok ve schopnostech, což dělá upgrade téměř zdarma pro většinu zátěží. Režim Fast je páka pro interaktivní relace: vyměníte dvojnásobnou cenovou přirážku za výstup, který se streamuje přibližně 2,5× rychleji na stejném modelu, což se vyplatí, když tam sedíte a čekáte, a bolí to, když spouštíte noční dávkové úlohy, kde na čase nezáleží. Pokud jsou vaším skutečným omezením rate limity, náš průvodce limity použití Claude pokrývá, jak úrovně interagují s cenou.

bash
# Claude Code: point your default model at Opus 5
/model claude-opus-5

# API request body (model ID swap):
{
  "model": "claude-opus-5",
  "messages": [
    { "role": "user", "content": "Refactor this module and verify the tests pass." }
  ]
}

Kam Opus 5 zapadá pro produkční agenty

Zisky se shlukují přesně tam, kde žijí produkční agenti: terminálové kódování (Frontier-Bench), ovládání počítače (OSWorld 2.0), agentní vyhledávání (BrowseComp) a vícekrokové business workflow (AutomationBench). Tyto čtyři jsou zátěže, které se v reálných nasazeních kazí nejčastěji, takže model, který skočí na všech čtyřech najednou, mění, co je nasaditelné.

To je ta část, nad kterou stojí za to se zastavit. Benchmark jako AutomationBench měří, zda agent dokáže dokončit skutečný vícenástrojový workflow od začátku do konce, a 26,0 % Opus 5 oproti přibližně 17 % zbytku pole je rozdíl mezi „dobře se demonstruje" a „přežije kontakt s nepořádným CRM." Výsledek OSWorld 2.0 (70,6 %, poráží Fable 5 za třetinové náklady) říká totéž pro agenty ovládající počítač, kteří proklikávají skutečný software. Pro týmy nasazující AI agenty pro zákazníky jsou to čísla, která se překládají do méně selhání ve dvě ráno.

Také to snižuje náklady na návrhový vzor, na který se spoléháme: levná sebeověření. Když je model skutečně lepší v kontrole vlastních větví, můžete utratit méně tokenů za samostatný kritický průchod a přesto zachytit stejné chyby. To je skutečná rozpočtová položka pro kohokoli, kdo provozuje agenty ve velkém.

Jak nasazujeme Opus 5 do našeho stacku

V Techsy stavíme a provozujeme produkční AI agenty na stacku Claude, takže frontier vydání je pro nás evaluace ve stejný den, ne titulek, který si přečteme a jdeme dál. Tady je náš upřímný první dojem — kvalitativní tam, kde ještě nemáme čistá čísla před/po, konkrétní tam, kde je máme.

Samotná výměna je triviální, a to je ten point. Naše obsahové a automatizační pipeline mají výchozí model připnutý v konfiguraci; změna claude-opus-4-8 na claude-opus-5 a restart relace nevyžadovaly žádné další změny, stejně jako každý nedávný upgrade Opus. Pokud směrujete napříč poskytovateli a chcete A/B testovat Opus 5 proti Fable 5 nebo GPT-5.6 Sol na vlastních úlohách, proxy vám umožní přepínat modely bez přepisování aplikace.

Co sledujeme jako první, je tvrzení o sebeověření, protože je to jediné, co by skutečně změnilo naši architekturu. Naši aktuální agenti spouštějí explicitní kritický krok, aby zachytili špatné úpravy před jejich aplikováním; pokud Opus 5 spolehlivě označí vlastní slabé větve, můžeme tento krok ztenčit a ušetřit tokeny. Nepublikujeme číslo, dokud to nespustíme na opakovatelné sadě úloh — stejná disciplína, kterou bychom chtěli od kohokoli, kdo cituje metriky agentů. Pokud chcete metodu, je to ta z našeho průvodce evaluací AI agentů v produkci: stejné prompty, stejný stav repozitáře, počítejte špatné odbočky, ne dojmy.

Měli byste přepnout z Opus 4.8? (Přepnout / Počkat / Zůstat)

Zda přejít, závisí na vaší zátěži, ne na tom, který model „vyhrává" celkově. Skoky v agentní a znalostní práci jsou velké a reálné, takže většina týmů by měla přepnout. Čistě kódovací dílny s pipeline na GPT nebo Fable mají důvod testovat před závazkem a uživatelé blízko stropu na levných úlohách mohou zůstat, aniž by téměř cokoli ztratili.

Přepněte teď, pokud: vaše práce se opírá o agentní úlohy, ovládání počítače, automatizaci business procesů nebo znalostní práci. Frontier-Bench (+22,2 oproti 4.8), AutomationBench (~1,5× pole) a GDPval-AA (+268 Elo) jsou největší reálné zisky a cena se nezměnila, takže za upgrade neplatíte žádný cenový postih.

Počkejte, pokud: váš workflow je čistě agentní kódování a už na něj používáte GPT-5.6 Sol nebo Fable 5. GPT-5.6 Sol stále vede DeepSWE v1.1 a Fable 5 těsně vyhrává FrontierCode, takže spusťte vlastní eval kódování, než přepnete. Počkejte také, pokud jste uprostřed projektu a výměna modelu by rozmazala evaluaci, kterou už provádíte.

Zůstaňte na 4.8, pokud: jste citliví na náklady u úloh, které pro vás už byly blízko stropu, a nedotýkáte se agentních zátěží, kde Opus 5 výrazně vede. Platili byste náklady na přepnutí za rozdíl, který nepocítíte. Pro širší pole se podívejte, jak si modely stojí v našem rozboru Claude Sonnet 5 a přehledu Fable 5 a Mythos 5.

Každý týden vybíráme a zapojujeme modely pro klientské stavby agentů. Pokud se rozhodujete, který model standardizovat pro produkčního agenta, získejte bezplatnou konzultaci a pomůžeme vám sladit model se zátěží místo s marketingem.

O autorovi

Mert Batur Gurbuz je spoluzakladatel Techsy.io, kde tým nasazuje AI agenty, automatizační systémy a hlasové/SDR pipeline pro B2B klienty. Studuje na University of Birmingham a píše o stacku nástrojů pro LLM, který tým Techsy skutečně provozuje v produkci.

Spoluzakladatel, Techsy.io, University of Birmingham · LinkedIn

Často kladené otázky

Co je Claude Opus 5?

Claude Opus 5 je frontier model Anthropic, vydaný 24. července 2026, s ID modelu claude-opus-5. Anthropic ho pozicuje jako model blízký inteligenci Fable 5 za poloviční cenu a vede ve většině publikovaných benchmarků včetně Frontier-Bench, GDPval-AA a ARC-AGI-3. Je dostupný na Claude API, Claude.ai, Claude Code a Claude Cowork.

Kdy byl Claude Opus 5 vydán?

Claude Opus 5 byl vydán 24. července 2026. Spuštěn byl stejný den napříč Claude API, Claude.ai, Claude Code a Claude Cowork, bez postupného nasazování, takže svůj výchozí model můžete přepnout na claude-opus-5 okamžitě.

Je Claude Opus 5 lepší než Opus 4.8?

Pro většinu práce ano. Opus 5 více než zdvojnásobuje Opus 4.8 na Frontier-Bench v0.1 (43,3 % vs 21,1 %), získává 268 Elo na GDPval-AA a skáče z 1,5 % na 30,2 % na ARC-AGI-3. Cena je nezměněná, takže žádný cenový postih. Výjimky jsou některé testy kódování a vědy, kde stále vedou GPT-5.6 Sol, Fable 5 nebo Mythos 5.

Kolik stojí Claude Opus 5?

Standardní cena je 5 $ za milion vstupních tokenů a 25 $ za milion výstupních tokenů, identická s Opus 4.8. Fráze „za poloviční cenu" odkazuje na Fable 5, ne na 4.8: Opus 5 dodává inteligenci blízkou Fable 5 za sazby Opus. Režim Fast stojí přibližně dvojnásobek základní ceny a běží zhruba 2,5× rychleji na stejném modelu.

Poráží Claude Opus 5 Fable 5?

Ne ve všem. Opus 5 překonává Fable 5 na OSWorld 2.0, BrowseComp, GDPval-AA a Frontier-Bench, a to za zlomek ceny Fable 5. Ale Fable 5 stále těsně vyhrává FrontierCode a právní benchmark a Mythos 5 (vědecký model Anthropic) vede v zdraví a biologii. Sdělení je „blízký Fable 5 za poloviční cenu", ne „lepší než Fable 5 ve všem."

V čem Opus 5 prohrává?

GPT-5.6 Sol vyhrává agentní kódování na DeepSWE v1.1 (72,7 % vs 68,8 %), Fable 5 vyhrává FrontierCode v1.1 o 0,1 bodu a held-out právní benchmark (13,3 % vs 11,7 %) a Mythos 5 vede HealthBench Professional a biologické testy. Pokud vaše zátěž dominuje některý z nich, otestujte to před přepnutím.

Je Claude Opus 5 dobrý pro stavbu AI agentů?

Je pro to stvořený. Největší zisky přicházejí v agentním terminálovém kódování (Frontier-Bench), ovládání počítače (OSWorld 2.0), agentním vyhledávání (BrowseComp) a vícekrokových business workflow (AutomationBench), což jsou zátěže, které produkční agenti spouštějí. Jeho silnější sebeověření vám také umožňuje utratit méně tokenů za samostatný kritický průchod.

Jak přepnu na Opus 5 v Claude Code a API?

Nastavte model na claude-opus-5 (v Claude Code použijte /model claude-opus-5) a pro většinu týmů je hotovo. V API změňte pole model na claude-opus-5; tvar požadavku je nezměněný oproti Opus 4.8, takže nejsou potřeba žádné další změny kódu.

Co je režim Fast v Claude Opus 5?

Režim Fast je vyšší rychlostní úroveň, která spouští Opus 5 zhruba 2,5× výchozí rychlostí za přibližně dvojnásobnou standardní cenu. Udržuje vás na plném modelu claude-opus-5, místo aby vás směroval na menší, což ho dělá užitečným pro interaktivní relace, kde čekáte na výstup, a nehodí se pro dávkové úlohy, kde na latenci nezáleží.

Štítky

Claude Opus 5claude-opus-5anthropicopus 5 vs opus 4.8benchmarky opus 5

Sdílet článek

Související články

Více z kategorie ai-machine-learning

ai-machine-learning
Jul 20, 2026

8 nejlepších API pro AI web scraping v roce 2026 (otestováno na našem vlastním agentním stacku)

Otestovali jsme 8 API pro AI web scraping s reálnými cenami pro rok 2026 staženými přes náš vlastní agentní stack. Firecrawl, Bright Data, ScrapingBee a 5 dalších, seřazené podle výstupu připraveného pro LLM, anti-bot a podpory MCP.

9 min read minut čtení
Číst
ai-machine-learning
Jul 20, 2026

Prompt Engineering pro kódování: 7 vzorů, které denně používáme v Claude Code a Cursor (2026)

Většina článků o „promptech pro AI kódování“ vám nabídne 50 šablon ke kopírování. Tento článek učí 7 vzorů, které každý den používáme k provozu pipeline s 16 agenty v Claude Code, včetně skutečných příkladů před a po úpravě pro každý z nich, a ukazuje, kde se každý vzor nachází v nástrojích Claude Code, Cursor a Copilot v roce 2026.

11 min read minut čtení
Číst
ai-machine-learning
Jul 19, 2026

AI PoC do produkce: 12bodový kontrolní seznam před nasazením

Funkční AI demo není produkční systém. Tento 12bodový kontrolní seznam prochází tři fáze, které každá AI funkce před spuštěním potřebuje: zpevnit, stabilizovat a nasadit – s konkrétními prahy pro cenové stropy, omezení rychlosti, záložní řešení a spouštěče rollbacku.

10 min read minut čtení
Číst
Zobrazit všechny články
Začněte svůj projekt

Pojďme něco postavit nevšedního?

Proměňme vaši vizi ve skutečnost. Náš tým je připraven vám pomoct vytvořit software, který dělá rozdíl.

Rezervovat 30minutový úvodní hovorNaše projekty

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt

Právní informace

  • Zásady ochrany osobních údajů
  • Podmínky poskytování služeb
  • Zásady používání cookies

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt
Právní informaceZásady ochrany osobních údajůPodmínky poskytování služebZásady používání cookies
TECHSY
© 2026 Techsy. Všechna práva vyhrazena.