
Claude Sonnet 5: Co je nového a co skutečně stojí jeho provoz
Claude Sonnet 5 dnes dorazil, 30. června 2026, a Anthropic stanovil cenu úvodního tieru na 2 $ za milion vstupních tokenů. Tady většina pokrytí končí. Číslo, které skutečně hýbe vaším účtem, je ale jiné: kolik stojí kompletní běh agenta, když přičtete výstupní tokeny a tucet vzájemných kol? Anthropic tvrdí, že Sonnet 5 se dostává „blízko Opus 4.8" za zhruba třetinovou cenu. Skutečná otázka tedy není specifikace. Je to, jestli měsíční náklady vašeho agenta právě klesly, a o kolik.
Klíčové body:
- Claude Sonnet 5 byl spuštěn 30. června 2026 a nahradil Sonnet 4.6 jako střední agentní model Anthropic.
- Úvodní cena je 2 $/M vstup a 10 $/M výstup do 31. srpna 2026, poté 3 $/15 $.
- Anthropic uvádí, že výkon je „blízko Opus 4.8" za zhruba třetinové náklady oproti Opus.
- Je výchozí pro Claude Free a Pro a je dostupný přes API a Claude Code jako
claude-sonnet-5.
Co je Claude Sonnet 5? (odpověď za 30 sekund)
Claude Sonnet 5 je nový střední model Anthropic, spuštěný 30. června 2026 a ve spouštěcím příspěvku popsán jako dosud nejvíce agentní Sonnet. Umí plánovat, používat nástroje jako prohlížeče a terminály a běžet autonomně. Úvodní cena je 2 $/M vstup a 10 $/M výstup a nyní je výchozí pro Claude Free a Pro.
Ano, vyšel dnes, pro případ, že jste narazili na zmatek kolem otázky „byl už Claude Sonnet 5 vydán?". Vyberete ho řetězcem modelu claude-sonnet-5 v API nebo v Claude Code. Anthropic ho staví jako výrazný krok oproti Sonnet 4.6 a tvrdí, že kvalitou se blíží jeho vlajkové lodi, Opus 4.8, bez vlajkové cenovky.
A tady je sázka v pozadí: Claude Sonnet 5 je sázkou Anthropic, že většina agentní práce už nepotřebuje špičkový model. Pokud to platí, zajímavý příběh není skok ve schopnostech. Je to ekonomika.
Co je nového oproti Sonnet 4.6 a Opus 4.8
Anthropic označuje Sonnet 5 za „zásadní vylepšení oproti předchůdci, Sonnet 4.6" v uvažování, používání nástrojů, kódování a znalostní práci, s výkonem „blízkým Opus 4.8, ale za nižší ceny". Kontroluje vlastní výstup, aniž by o to byl požádán, a je silnější v dlouhém kódování, ladění a vícekrokovém používání nástrojů. To jsou formulace Anthropic, ne naše měření.
Agentní vylepšení
Hlavní změnou je autonomie. Sonnet 5 je navržen tak, aby naplánoval úlohu, chopil se nástrojů jako prohlížeče a terminály a odvedl dlouhé běhy bez vodění za ruku. Jak uvádí TechCrunch (s odkazem na Anthropic), model je prezentován jako levnější způsob, jak udržet agenty v běhu, s ranými signály od zákazníků, jako jsou týmy Zapier a Lovable. To je use case, o který Anthropic usiluje: agenti, kteří běží ve smyčce minuty či hodiny, kde každé kolo přidává tokeny.
Jak si stojí vůči Opus 4.8 na papíře
Tady je část důležitá pro rozpočtování. Cenový rozdíl ve schopnostech se zmenšil; cenový rozdíl ne.
| Model | Vstup $/M | Výstup $/M | Úvodní vs standardní | Pozicování |
|---|---|---|---|---|
| Claude Sonnet 5 | 2 $ (úvod) → 3 $ | 10 $ (úvod) → 15 $ | Úvodní do 31. 8. 2026 | Střední třída, nejvíce agentní Sonnet; „blízko Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | 3 $ | 15 $ | Standardní | Předchozí střední třída (únor 2026) |
| Claude Opus 4.8 | 5 $ (10 $ Fast Mode) | 25 $ (50 $ Fast Mode) | Standardní | Vlajková loď; nejtěžší dlouhé uvažování |
Všimněte si, že standardní cena Sonnet 5 (3 $/15 $) je shodná se Sonnet 4.6. Dostanete schopnější model za stejnou cenovku. A oproti 5 $/25 $ u Opus 4.8 běží standardní Sonnet 5 zhruba na 60 % vstupní i výstupní sazby. Během úvodního období je ještě levnější. Anthropic nezveřejnil žádné číslo, které by říkalo, že Sonnet 5 poráží Opus 4.8, takže to tak nečtěte: oficiální stanovisko je „blízko" a toho se držíme.
Kolik Claude Sonnet 5 skutečně stojí? (ekonomika tokenů)
Claude Sonnet 5 stojí 2 $/M vstup a 10 $/M výstup během úvodního období do 31. srpna 2026, poté stoupne na 3 $/M vstup a 15 $/M výstup. Tato standardní cena odpovídá Sonnet 4.6 za silnější model a vychází zhruba na třetinu standardní sazby Opus 4.8 (5 $/25 $). Pro vysoce objemnou agentní práci je tento poměr celým příběhem.
Co pro vás tedy „za milion tokenů" vlastně znamená? Token je zhruba tři čtvrtiny slova. Milion tokenů je spousta textu, možná 750 000 slov, ale agenti je spalují rychle, protože každé kolo znovu posílá kontext: systémový prompt, předchozí zprávy, obsah souborů, výstupy nástrojů. Jediný refaktoring přes více souborů dokáže spotřebovat stovky tisíc vstupních tokenů, než je hotovo.
Toto úvodní období je skutečným rozhodovacím bodem. Do 31. srpna platíte 2 $/10 $. Poté 3 $/15 $. Pokud stejně budete Sonnet 5 testovat, udělat to teď znamená, že vaše evaluace poběží se slevou, a zafixujete si návyky, dokud jsou počty nejpříznivější. Druhá strana mince: nestavte rozpočet na úvodní ceně, o kterou za dva měsíce přijdete.
Dvě funkce platformy mění skutečný účet víc než hlavní sazba. Prompt caching vám umožňuje znovu použít cachovaný kontext, místo abyste každé kolo platili plnou vstupní cenu, s úsporou až zhruba 90 % na cachované části. Dávkové zpracování snižuje náklady asi o 50 % u neodkladných úloh, které můžete spustit asynchronně. Obojí je zdokumentováno v ceníku platformy Anthropic. Pokud váš agent každé kolo znovu posílá stejný velký systémový prompt nebo codebase, prompt caching je největší páka na náklady, kterou máte. Více taktik rozebíráme v našem průvodci snížením nákladů na LLM API.

Při 2 $ za milion vstupních tokenů dělá Sonnet 5 vysoce objemné agentní smyčky dost levné na to, aby zůstaly běžet. To je ten posun. Otázka už není „můžu si dovolit spustit tohoto agenta?", ale „kolik jich dokážu spustit najednou?".
Co skutečně stojí reálný běh agenta na Sonnet 5 (reprodukovatelné)
Pojďme to vyčíslit. Nespouštěli jsme laboratorní benchmark a nebudeme předstírat, že ano. Následuje transparentní výpočet, který si můžete reprodukovat s vlastními počty tokenů, s použitím zveřejněných sazeb Anthropic za token. Uveďte své předpoklady, udělejte aritmetiku a účet vypadne.
Propočtený výpočet
Vezměte realistickou agentní úlohu: refaktoring přes více souborů, který běží asi 12 kol. Předpokládejme zhruba 40K vstupních tokenů a 8K výstupních tokenů na kolo (caching vypnutý), protože každé kolo znovu posílá rostoucí kontext. To je celkem asi 480K vstupních tokenů a 96K výstupních tokenů. Teď matematika:
- Sonnet 5 úvod: (0,48M × 2 $) + (0,096M × 10 $) = 0,96 $ + 0,96 $ = 1,92 $
- Sonnet 5 standard: (0,48M × 3 $) + (0,096M × 15 $) = 1,44 $ + 1,44 $ = 2,88 $
- Opus 4.8 standard: (0,48M × 5 $) + (0,096M × 25 $) = 2,40 $ + 2,40 $ = 4,80 $
Teď zapněte prompt caching. Pokud většina z oněch 480K vstupu je znovu použitý kontext (systémový prompt, strom souborů, předchozí kola) a dostanete se blízko dokumentované ~90% úspoře na cachované části, vstupní strana klesne z asi 0,96 $ na zhruba 0,10 $, zatímco výstup zůstává na 0,96 $.
| Scénář (12 kol, ~480K vstup / ~96K výstup, caching vypnutý, pokud není uvedeno) | Vstupní náklady | Výstupní náklady | Celkem |
|---|---|---|---|
| Sonnet 5 úvod (2 $/10 $) | 0,96 $ | 0,96 $ | 1,92 $ |
| Sonnet 5 standard (3 $/15 $) | 1,44 $ | 1,44 $ | 2,88 $ |
| Opus 4.8 standard (5 $/25 $) | 2,40 $ | 2,40 $ | 4,80 $ |
| Sonnet 5 úvod + prompt caching (~90% úspora vstupu) | ~0,10 $ | 0,96 $ | ~1,06 $ |
Jde o modelové odhady s použitím veřejných cen za token a uvedených předpokladů o tokenech, výpočet, který si můžete reprodukovat, ne benchmark, který jsme spustili. Dosaďte vlastní počet kol a velikosti tokenů a struktura platí. Spočítejte si to sami: stejná agentní úloha stojí zhruba 1,92 $ na Sonnet 5 úvod versus 4,80 $ na Opus 4.8 standard a caching může stáhnout běh na Sonnet 5 blízko 1,06 $. Napříč tisícovkou takových běhů měsíčně je to rozdíl mezi účtem ~1 900 $ a ~4 800 $.
Výběr modelu a měření vlastních nákladů
Nemusíte věřit našim předpokladům. Nasměrujte model na vlastní pracovní zátěž a přečtěte si skutečné počty tokenů. V Claude Code nastavte model příznakem nebo v nastavení projektu:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}Na API Anthropic je řetězec modelu stejný a každá odpověď vám předá přesné využití tokenů:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Vynásobte input_tokens svou vstupní sazbou, output_tokens svou výstupní sazbou, sečtěte napříč koly a máte skutečné náklady dané úlohy. Pole cache_read_input_tokens ukazuje, kolik vám caching skutečně ušetřil. Podle našich zkušeností se směrováním modelů pro klienty jsou náklady na úlohu tím, co hýbe měsíčním účtem, ne cenovka za token, a jediný poctivý způsob, jak je znát, je číst objekt usage na vlastním provozu.
Kde je Sonnet 5 správná volba (reálné use case)
Sonnet 5 je správná volba pro vysoce objemnou agentní a kódovací práci, kde náklady na úlohu rozhodují o účtu, což je většina produkční agentní práce. Po Opus 4.8 sáhněte, jen když je jeden chybný krok dost drahý na to, aby ospravedlnil příplatek. U všeho, co běží ve smyčce, opakuje se a znovu posílá kontext, se střední sazba sčítá ve váš prospěch.
Konkrétní volby:
- Kódovací agenti. Refaktoringy přes více souborů, generování testů a ladicí běhy požírají tokeny napříč mnoha koly, takže nižší sazba na kolo je tu nejdůležitější. Podívejte se na náš přehled AI kódovacích agentů, kam zapadá.
- Automatizace prohlížeče a terminálu. Dlouhé autonomní běhy jsou přesně to, pro co Anthropic agentní vylepšení budoval, a přesně tam, kde se náklady sčítají.
- Pipeline znalostní práce. Sumarizace, extrakce a výzkumné smyčky běžící ve velkém těží z cachingu a střední sazby.
- Agenti pro zákazníky. Vysoký objem požadavků mění malou úsporu na úlohu ve velkou měsíční.
Kde ho můžete spustit? Je výchozí v Claude Code, dostupný přes API a nasazuje se napříč velkými platformami. Pokud vybíráte nástroje, naše srovnání Cursor a Copilot s Claude Code pokrývá kompromisy.
Je Sonnet 5 lepší než Opus 4.8, a kdy se Opus stále vyplatí?
Ne, ne „lepší" podle formulace samotného Anthropic. Anthropic říká, že Sonnet 5 je „blízko Opus 4.8", ne před ním. Vyberte Sonnet 5 pro cenově citlivou, vysoce objemnou agentní a kódovací práci. Po Opus 4.8 sáhněte u nejtěžšího dlouhého uvažování, kde je jeden chybný krok drahý a extra přesnost si svůj příplatek zaslouží.
Rychlý rozcestník:
- Vysoce objemné agentní smyčky, cenově citlivé? Sonnet 5.
- Nejtěžší uvažování, jednorázová přesnost klíčová? Opus 4.8.
- Migrujete ze Sonnet 4.6 a hlídáte rozpočet? Sonnet 5 (stejná standardní cena, schopnější).
- Smíšená zátěž? Směrujte snadných 90 % na Sonnet 5 a eskalujte na Opus jen těžké případy.
Právě tento poslední vzor je místem, kde se vyplatí LLM gateway pro směrování modelů a kontrolu nákladů. Co se konkurence týče, některá média uvádějí, že Sonnet 5 podbízí GPT-5.5 cenou u agentního kódování, a Gemini 3.1 Pro hraje ve stejné lize. Otestujte na vlastní zátěži, než se rozhodnete, protože cena na úlohu a vhodnost pro úlohu se zřídkakdy shodují tak, jak naznačuje žebříček.
Sonnet 5 nenahrazuje Opus 4.8. Nahrazuje používání Opus 4.8 na všechno.
Na co se Claude Sonnet 5 nehodí? (upřímné limity)
Sonnet 5 je střední třída, takže není volbou pro špičkové uvažování, nejdelší autonomii nebo jednorázové úlohy s maximální přesností. U nich je Opus 4.8 stále sázkou na jistotu. Celá hodnotová nabídka zní „blízko vlajkové lodi za méně" a „blízko" v té větě odvádí skutečnou práci.
Jeden konkrétní limit, který stojí za to znát: Anthropic uvádí, že Sonnet 5 má „výrazně nižší schopnost plnit úlohy kybernetické bezpečnosti než naše současné modely Opus", a poznamenává, že při testování zranitelností Firefoxu nikdy nevytvořil funkční exploit. Pokud je bezpečnostní nástroj váš use case, jde o záměrnou designovou volbu, ne chybu, ale počítejte s tím.
A nepředpokládejte velikost kontextového okna. Spouštěcí příspěvek Anthropic ji neuvádí, což nás přivádí k fámám.
Fámy o „Fennec": co je skutečně potvrzeno (vyvrácení mýtů)
Spousta čísel kolujících o Sonnet 5 nepochází od Anthropic. Tady je hranice mezi potvrzeným spuštěním a narativem úniků, přičemž každá fáma je připsána agregátorům a stránkám s úniky, ne oficiálnímu příspěvku.
- Kódové jméno „Fennec". Nepotvrzeno. Tento identifikátor unikl z logu Vertex AI o měsíce dříve a historicky odpovídal Sonnet 4.6, ne Sonnet 5. Anthropic žádné kódové jméno neoznámil.
- „Kontextové okno 1M tokenů". Nikde v oficiálním spouštěcím příspěvku není uvedeno. Jakékoli konkrétní číslo kontextového okna považujte za neověřené, dokud Anthropic nějaké nezveřejní.
- „82,1 % / 92,4 % SWE-bench". Výmysly agregátorů. Citujte pouze údaje z oficiálního příspěvku nebo systémové karty; zbytek ignorujte.
- „Vydání 1. dubna", „trénováno na Google TPU", „Dev Team Mode". Nepravdivé nebo nepotvrzené. Spuštění je 30. června 2026 a žádná z těchto funkcí či tvrzení se v materiálech Anthropic neobjevuje.
Anthropic nikdy neoznámil kódové jméno „Fennec" pro Sonnet 5. Tento identifikátor unikl z logu Vertex AI o měsíce dříve a ukazoval na jiný model. Pokud stránka cituje přesný benchmark bez odkazu na systémovou kartu, považujte ji za šum.
Měli byste přejít ze Sonnet 4.6? (verdikt migrace)
Pokud jste na Sonnet 4.6, přechod na Sonnet 5 je nízkorizikový: dostanete schopnější model za stejnou standardní cenu (3 $/15 $) a úvodní období (2 $/10 $ do 31. srpna) dělá testování právě teď levným. The New Stack to popisuje jako zmenšování odstupu od Opus 4.8 při zachování nízké ceny do srpna, což je férové čtení pro vývojáře zvažující přesun.
Několik úskalí, než překlopíte produkční provoz:
- Změňte řetězec modelu na
claude-sonnet-5. To je jediná požadovaná změna kódu pro většinu nastavení. - Překontrolujte předpoklady o promptech či výstupech. Schopnější model může změnit tón, upovídanost nebo formátování způsoby, které dál po proudu záleží.
- Nejprve validujte na své evaluační sadě. Neměňte produkční provoz na základě pocitu.
- Hlídejte si cenový skok 31. srpna, pokud rozpočtujete za léto.
Verdikt: při stejné standardní ceně jako Sonnet 4.6 s lepším agentním výkonem je zůstat na 4.6 hůř obhájitelná volba. Přepněte teď, abyste zachytili úvodní cenu, počkejte, jen pokud máte zmrazený evaluační cyklus, a Opus 4.8 si nechte rezervovaný pro nejtěžší úlohy. Pokud váš tým směruje modely a potýká se s náklady na LLM v produkci, nabízíme konzultaci zdarma, abychom to zmapovali.
O autorovi
Mert Batur Gurbuz je spoluzakladatelem Techsy.io, kde tým dodává AI agenty, automatizační systémy a hlasové/SDR pipeline pro B2B klienty. Studuje na University of Birmingham a píše o stacku nástrojů pro LLM, který tým Techsy skutečně používá v produkci. Spojte se na LinkedIn.
Kredence: spoluzakladatel Techsy.io, University of Birmingham. Ceny ověřeny vůči spouštěcímu příspěvku Anthropic ze dne 30. 6. 2026.
Často kladené otázky
Byl Claude Sonnet 5 vydán?
Ano. Anthropic spustil Claude Sonnet 5 30. června 2026 jako výchozí model pro Claude Free a Pro a zpřístupnil ho uživatelům Max, Team a Enterprise. Dostanete se k němu také přes API Anthropic a Claude Code pomocí řetězce modelu claude-sonnet-5.
Kolik Claude Sonnet 5 stojí?
Úvodní cena je 2 $ za milion vstupních tokenů a 10 $ za milion výstupních tokenů do 31. srpna 2026. Poté přechází na standardní cenu 3 $ za milion vstupu a 15 $ za milion výstupu, stejná standardní sazba jako u Sonnet 4.6 za schopnější model.
Je Claude Sonnet 5 skutečně lepší než Opus 4.8?
Ne podle popisu samotného Anthropic. Anthropic říká, že výkon Sonnet 5 je „blízko Opus 4.8", ne lepší. U nejtěžšího dlouhého uvažování, kde je jeden chybný krok nákladný, je Opus 4.8 stále silnější volbou. Sonnet 5 vyhrává v nákladech na úlohu, běží zhruba za třetinu standardní ceny Opus.
Jaké je kontextové okno Claude Sonnet 5?
Spouštěcí příspěvek Anthropic velikost kontextového okna neuvádí. Tvrzení o „1M tokenech" kolující na stránkách agregátorů jsou nepotvrzená a nepocházejí od Anthropic. Dokud Anthropic nezveřejní oficiální číslo, považujte jakýkoli konkrétní údaj o kontextovém okně za neověřený.
Jak Claude Sonnet 5 používat?
Nastavte řetězec modelu na claude-sonnet-5 v API Anthropic, nebo ho vyberte v Claude Code pomocí claude --model claude-sonnet-5 či v nastavení projektu. Je také výchozím modelem pro Claude Free a Pro, takže tam není potřeba žádné nastavování. Čtěte objekt usage odpovědi pro sledování skutečných nákladů na tokeny.
Má Claude Sonnet 5 kódové jméno „Fennec"?
Neexistuje žádné potvrzení. „Fennec" je uniklý identifikátor, který historicky odpovídal Sonnet 4.6, a Anthropic pro Sonnet 5 žádné kódové jméno neoznámil. Identifikátor se objevil v logu Vertex AI měsíce před tímto spuštěním, takže jakékoli tvrzení „Fennec se rovná Sonnet 5" považujte za neověřenou fámu.
Měli bychom přejít ze Sonnet 4.6 na Sonnet 5?
Pravděpodobně ano. Sonnet 5 běží za stejnou standardní cenu jako Sonnet 4.6 (3 $/15 $) s lepším agentním výkonem a úvodní období dělá testování levným do 31. srpna. Změňte řetězec modelu, validujte na své evaluační sadě a překontrolujte chování před překlopením produkčního provozu.
Jak si Sonnet 5 stojí vůči GPT-5.5 v kódování?
Sonnet 5 je cenově konkurenceschopná možnost agentního kódování od Anthropic a některá média uvádějí, že podbízí GPT-5.5 cenou. Srovnání schopností závisí na pracovní zátěži, takže otestujte oba na vlastní codebase a mixu úloh, než se rozhodnete. Cena na úlohu a vhodnost pro úlohu se zřídkakdy shodují tak, jak naznačuje jediný žebříček.
Mohu spustit Claude Sonnet 5 na AWS Bedrock?
Anthropic zpřístupňuje modely Sonnet napříč velkými cloudovými platformami, takže dostupnost claude-sonnet-5 na Bedrock a Vertex by měla následovat po dokončení nasazení. Zkontrolujte aktuální stav platformy pro svůj region, protože spuštění ve stejný den často zasáhne API první strany a Claude Code dříve než každou platformu třetí strany.
Jak mohu snížit náklady na Claude Sonnet 5?
Použijte prompt caching pro úsporu až zhruba 90 % na znovu použitém kontextu a dávkové zpracování pro asi 50% úsporu u neodkladných úloh. Směrujte jen nejtěžší úlohy na Opus 4.8 a vysoce objemnou práci nechte na Sonnet 5. Čtěte objekt usage, abyste přesně viděli, kam vaše tokeny jdou.