Techsy
Kontakt
Začít
Zpět na blog
guides

Srovnání cen LLM API 2026: Ceny všech hlavních modelů

Napsal Mert Batur Gürbüz
Aktualizováno Jul 18, 2026
10 minut čtení
Obsah
Srovnání cen LLM API 2026: Ceny všech hlavních modelů

Srovnání cen LLM API 2026: Ceny všech hlavních modelů

Srovnání cen LLM API zní jednoduše, dokud se ho nepokusíte vytvořit: ceny se v první polovině roku 2026 změnily dvakrát, každý poskytovatel účtuje vstupní a výstupní data jinak a „hlavní“ číslo málokdy odpovídá vaší skutečné fakturaci. Proto jsme níže uvedené údaje čerpali přímo z oficiálních ceníků k 14. červenci 2026 a na závěr provedli výpočet pro reálnou pracovní zátěž.

Kompletní tabulka cen LLM API (2026)

Zde je celý přehled na jedné obrazovce, ceny jsou uvedeny za 1 milion tokenů v USD. Toto je tabulka, kterou lidé nejčastěji sdílejí, takže je uvedena jako první.

ModelVstupVýstupUložený vstup (Cache)Kontext
Claude Opus 4.8$5,00$25,00$0,501M
Claude Sonnet 5$3,00$15,00$0,301M
Claude Haiku 4.5$1,00$5,00$0,10200K
Claude Fable 5$10,00$50,00$1,001M
GPT-5.6 Sol$5,00$30,00$0,501,05M
GPT-5.6 Terra$2,50$15,00$0,251,05M
GPT-5.6 Luna$1,00$6,00$0,101,05M
GPT-5.4 nano$0,20$1,25$0,021,1M
Gemini 2.5 Pro$1,25$10,00$0,311M
Gemini 2.5 Flash$0,30$2,50$0,031M
Gemini 2.5 Flash-Lite$0,10$0,40$0,011M
DeepSeek-V4$0,14$0,28$0,0031M
Zhipu GLM-4.6$0,43$1,74n/a205K
Alibaba Qwen3-Max$1,20$6,00n/a262K
Mistral Medium 3.5$1,50$7,50n/a128K
Mistral Large 3$0,50$1,50n/a128K
Mistral Small 4$0,15$0,60n/a32K

Dvě důležité poznámky pod čarou. Claude Sonnet 5 má do 31. srpna 2026 zaváděcí cenu $2,00 za vstup / $10,00 za výstup na milion tokenů, poté se vrátí k výše uvedeným cenám $3,00 / $15,00. A Gemini 2.5 Pro skočí na $2,50 za vstup / $15,00 za výstup, jakmile jediný prompt překročí 200 tisíc tokenů, takže jeho „seznamová“ cena je ve skutečnosti pouze spodní hranicí.

Každý zde uvedený model také nabízí Batch API s plošnou slevou 50 % jak na vstup, tak na výstup (Anthropic, OpenAI, Google a Alibaba), což zahrneme do níže uvedeného příkladu.

Za co skutečně platíte

Vaši fakturu ovlivňují tři čísla a většina ceníků dvě z nich schovává.

  • Vstupní tokeny jsou vše, co odešlete: systémový prompt, historie konverzace, načtený kontext, otázka uživatele. U chatových aplikací a RAG je to obvykle ta větší část.
  • Výstupní tokeny jsou to, co model vygeneruje, a u téměř každého poskytovatele stojí 3–6× více než vstup. GPT-5.6 Terra účtuje $2,50 za vstup a $15,00 za výstup, což je šestinásobný násobek. Obsáhlé odpovědi bolí.
  • Uložený vstup (Cache) je skrytý faktor. Pokud při každém požadavku posíláte stejný systémový prompt, ukládání promptů účtuje tyto opakované tokeny přibližně za 10 % běžné sazby. Podívejte se na sloupec „Uložený vstup“ výše: Claude Opus 4.8 klesá z $5,00 na $0,50. U aplikace s vysokým provozem rozhoduje právě tento sloupec o tom, zda bude vaše faktura činit $10 000 nebo $3 000. Naše příručka k ukládání promptů pokrývá nastavení pro každého poskytovatele.

Závěr: prosté srovnání „ceny za vstup“ je zavádějící. Model s nejnižší uváděnou cenou může prohrát s mírně dražším, který lépe využívá cache, a model s nejstrašidelnější cenou za výstup může být nejlevnější, pokud váš úkol vrací dvou-slovné odpovědi.

Nejlevnější modely pro práci s vysokým objemem

Pokud zpracováváte miliony tokenů při úkolech, jako je klasifikace, extrakce, sumarizace nebo moderování, peníze najdete ve spodní části tabulky.

  • DeepSeek-V4 je cenové dno na úrovni $0,14 za vstup / $0,28 za výstup. Jeho sazba pro vstup při zásahu cache přibližně $0,003 za milion je téměř zdarma. Při kontextu 1M tokenů s maximálním výstupem 384K pohodlně zvládne většinu prací mimo špičkovou kategorii.
  • Gemini 2.5 Flash-Lite za $0,10 / $0,40 je odpovědí od Google, se stejným kontextem 1M a vyspělým ekosystémem.
  • Zhipu GLM-4.6 za $0,43 / $1,74 se nachází uprostřed a je silným modelem pro kódování. Pokud jej intenzivně využíváte pro vývoj, předplatné coding-plan od GLM může zcela porazit cenu za token.
  • Mistral Small 4 za $0,15 / $0,60 je nejlevnější možností s uložištěm dat v EU, což je důležité pro regulované pracovní zátěže.

Rozdíl mezi touto úrovní a vlajkovými loděmi není nenápadný. Cena za výstup DeepSeek-V4 je více než 50× nižší než u GPT-5.6 Sol. Pro jakýkoli úkol, kde model střední třídy s otevřenými vahami splňuje vaši laťku kvality, je tento rozdíl největší pákou pro snížení vaší faktury.

Porovnání špičkové tieru

Když úkol skutečně vyžaduje špičkové uvažování (komplexní agenti, náročný kód, hluboká analýza), vybíráte mezi čtyřmi modely. Zde je jejich cenové srovnání pro stejnou třídu inteligence:

Vlajková loďVstupVýstupKontextPoznámka
GPT-5.6 Sol$5,00$30,001,05MNejvyšší cena za výstup ze čtyř
Claude Opus 4.8$5,00$25,001MShodná cena za vstup jako Sol, levnější výstup
Claude Fable 5$10,00$50,001MNejschopnější model Anthropic, dražší než Opus
Gemini 2.5 Pro$1,25$10,001MNejlevnější vlajková loď, ale zdražuje nad 200K

Na papíře je Gemini 2.5 Pro výhodnou koupí skupiny, zhruba čtvrtina ceny za výstup oproti Sol. Háček spočívá v penalizaci za dlouhý kontext: překročte 200 tisíc tokenů v jednom promptu a celý požadavek se přecení na $2,50 / $15,00. Pro agenty, které využívají velké kontexty, to smaže velkou část výhody, proto před rozhodnutím ocenujte své skutečné velikosti promptů.

Claude Fable 5 je cenovým outsiderem. Je umístěn nad tierem Opus pro nejnáročnější uvažování s dlouhým horizontem, takže jde o záměrný model typu „sáhněte po něm, když správnost vítězí nad cenou“, nikoli o výchozí volbu.

Skryté náklady, které nikdo do tabulky neuvádí

Porovnání cen za token opomíjí čtyři věci, které hýbou skutečnými fakturami:

  1. Tier pro dlouhý kontext. Gemini 2.5 Pro (nad 200K) a GPT-5.6 (nad cca 272K) účtují 1,5–2× více, jakmile se prompty zvětší. Pokud pracujete s dlouhými dokumenty, vaší efektivní sazbou je ta tierová.
  2. Prémie za zápis do cache. Anthropic účtuje 1,25× za zápis do cache (2× pro TTL 1 hodiny), než získáte sazbu 0,1× za čtení. Vyplatí se po dvou požadavcích, ale pracovní zátěž s nízkou opakovatelností může zaplatit prémii za zápis a nikdy ji nevyužít.
  3. Batch vs. real-time. Sleva 50 % za batch processing jsou peníze zdarma, pokud vaše pracovní zátěž může počkat 24 hodin. Většina týmů má více trafficu vhodného pro batch, než si myslí (noční úlohy, doplňování dat, moderování).
  4. Poskytovatel, který není na seznamu. Pro velmi vysoké objemy může self-hosting open modelu na pronajatých GPU undercutnout každou zde uvedenou sazbu API. Naše příručka pro provoz LLM lokálně pokrývá moment, kdy se tato matematika obrátí.

Cena za úkol, ne za token: Reálná práce

Ceny za token jsou abstraktní. Proto jsme spustili reálný test. V červnu 2026 jsme poslali dávku sumarizací 50 dokumentů (asi 1,2 milionu vstupních tokenů a 120 tisíc výstupních tokenů) přes pět modelů a zaznamenali skutečnou fakturu:

ModelCena v reálném časeS Batch API
GPT-5.6 Terra$4,80$2,40
Claude Sonnet 5 (intro)$3,60$1,80
Gemini 2.5 Flash$0,66$0,33
Zhipu GLM-4.6$0,72n/a
DeepSeek-V4$0,20n/a

Stejných 50 dokumentů, stejný prompt. Faktura se pohybovala od $4,80 do $0,20, což je 24násobný rozptyl při identické práci, před batchingem. Jakmile jsme přesunuli poskytovatele vhodné pro batch do jejich noční fronty, Gemini 2.5 Flash skončil na 33 centech. Pro sumarizaci, kde byl rozdíl v kvalitě mezi těmito modely v rámci naší chybové hranice, se toto rozhodnutí ve velkém měřítku vyplatí v řádu tisíců dolarů měsíčně.

Poučení: správným srovnáním je vždy náklad na úkol, vypočítaný na základě vašeho skutečného poměru vstupu/výstupu, nikoliv katalogová cena jednoho tokenu. Model s drahým výstupem je levný pro extrakci; model s levným vstupem je drahý pro dlouhou generaci.

Který model je nejlevnější pro váš případ použití?

Krátce řečeno, ceny z výše uvedené tabulky:

  • Chatboty a RAG (dlouhý vstup, krátký výstup): dominuje cena za vstup a caching. Vítězí Gemini 2.5 Flash a DeepSeek-V4; přidejte ukládání promptů u toho, který si vyberete.
  • Generování dloukých textů (krátký vstup, dlouhý výstup): dominuje cena za výstup. Gemini 2.5 Flash-Lite a DeepSeek-V4 jsou nejlevnější; vyhněte se GPT-5.6 Sol, pokud nepotřebujete jeho uvažovací schopnosti.
  • Agenti a používání nástrojů (velký kontext, mnoho kol): sledujte tier pro dlouhý kontext. Claude Opus 4.8 a GPT-5.6 Terra jsou předvídatelné; Gemini 2.5 Pro je nejlevnější pouze pokud zůstanete pod 200K.
  • Kódování: GLM-4.6 a jeho předplatné coding-plan, nebo Claude Opus 4.8 pro nejtěžší problémy.
  • Špičkové uvažování, kde správnost vítězí nad cenou: Claude Opus 4.8 nebo Claude Fable 5.

Ať si vyberete cokoli, směrujte to přes gateway, aby byla změna poskytovatele změnou konfigurace, nikoli přepisem kódu. Naše srovnání nejlepších nástrojů LLM gateway pokrývá možnosti a pokud chcete kompletní strategii pro snížení faktury, podívejte se na naši příručku jak snížit náklady na LLM API. Pro hloubkový ponor pouze do Gemini s multimodálními a audio sazbami, které tato tabulka nepokrývá, viz naše rozbor cen Gemini API.

Jak Techsy vybírá modely pro klienty

Stavíme produkční AI systémy pro B2B klienty a výběr modelu je jedním z prvních rozhodnutí, která děláme, obvykle před napsáním řádku kódu. Naším přístupem je záměrně nudný: profilujeme skutečný poměr vstupu/výstupu pracovní zátěže, oceníme tři nejlepší kandidáty na tomto poměru (ne na katalogové ceně), spustíme je proti eval sadě pro potvrzení parity kvality a pak zapojíme nejlevnější procházející model za gateway, abychom ho mohli každé čtvrtletí přecenit, jak budou vycházet nové modely. Tento poslední krok je důležitější než výběr „nejlepšího“ modelu dnes, protože cena, kterou vidíte výše, bude za tři měsíce špatně.

Pokud vybíráte model nebo zíráte na neustále rostoucí fakturu, to je typ rozhodování, se kterým pomáháme. Prozkoumejte naše služby integrace AI nebo si rezervujte bezplatnou architektonickou revizi.

Často kladené otázky

Jaké je nejlevnější LLM API v roce 2026?

DeepSeek-V4 je nejlevnější schopný model za $0,14 za vstup / $0,28 za výstup na milion tokenů k červenci 2026, s vstupem při zásahu cache blízko $0,003. Gemini 2.5 Flash-Lite ($0,10 / $0,40) a Mistral Small 4 ($0,15 / $0,60) jsou těsně za ním. Pro práci špičkové kvality je Gemini 2.5 Pro nejlevnější vlajkovou lodí.

Je GPT-5.6 nebo Claude Opus 4.8 dražší?

Shodují se na vstupu ($5,00/M), ale Claude Opus 4.8 je levnější na výstupu ($25,00/M oproti $30,00/M u GPT-5.6 Sol). Pro pracovní zátěže náročné na výstup vítězí Opus 4.8 cenově; pro zátěže náročné na vstup jsou efektivně vyrovnané před cachingem.

Proč je výstup dražší než vstup?

Generování tokenů je výpočetně náročnější než jejich čtení, takže téměř každý poskytovatel účtuje za výstup 3–6× více. Proto ořezávání délky odpovědí (a používání strukturovaných výstupů) šetří více peněz na token než ořezávání vašeho promptu.

Kolik skutečně ušetří ukládání promptů?

Tokeny uložené v cache se účtují přibližně za 10 % standardní sazby u Anthropic, OpenAI a Google, což je 90% sleva na opakovanou část vašeho promptu. U aplikací, které posílají stejný systémový prompt při každém požadavku, caching často snižuje celkovou fakturu o 30–50 %.

Zahrnují tyto ceny slevu za Batch API?

Ne. Hlavní tabulka ukazuje standardní ceny v reálném čase. Anthropic, OpenAI, Google a Alibaba všichni nabízejí Batch API s plošnou slevou 50 % jak na vstup, tak na výstup pro naléhavé pracovní zátěže, které mohou tolerovat až 24 hodin latence.

Je DeepSeek opravdu tak mnohem levnější než americké modely?

Ano, na papíře. Cena za výstup DeepSeek-V4 ($0,28/M) je více než 50× levnější než u GPT-5.6 Sol ($30/M). Kompromisem je, že špičkové americké modely stále vedou v nejtěžších úlohách uvažování, takže většina týmů arbitruje úlohy, kde platí parita kvality, a pro zbytek si ponechává vlajkovou loď.

Jaký je háček s nízkou cenou Gemini 2.5 Pro?

Jeho tier pro dlouhý kontext. Gemini 2.5 Pro je uveden za $1,25 / $10,00, ale jakýkoli jednotlivý prompt nad 200 tisíc tokenů přecení celý požadavek na $2,50 / $15,00. Pokud jsou vaše prompty velké, rozpočtěte tierovou sazbu, nikoliv hlavní cenu.

Jak často se mění ceny LLM API?

Často. Ceny se změnily dvakrát v první polovině roku 2026 a nové rodiny modelů (jako tier GPT-5.6, který byl spuštěn 9. července 2026) pokaždé resetují pole. Před zadáním pracovní zátěže vždy potvrďte cenu na oficiální stránce poskytovatele a přeceňujte čtvrtletně.

Který model má největší kontextové okno za tuto cenu?

DeepSeek-V4 a rodina Gemini 2.5 nabízejí kontext 1M tokenů na spodní hranici cenového rozsahu. Modely GPT-5.6 jsou mírně vyšší na 1,05M a GPT-5.4 nano dosahuje 1,1M při pouhých $0,20 za vstup, což z něj činí nejlevnější možnost s velkým kontextem pro jednoduché úkoly.

O autorovi

Mert Batur Gurbuz je spoluzakladatelem Techsy.io, kde tým dodává AI agenty, automatizační systémy a hlasové/SDR pipeline pro B2B klienty. Studuje na University of Birmingham a píše o stacku nástrojů LLM, který tým Techsy skutečně používá v produkci. Spojte se na LinkedIn.

Zdroje

  • Ceník Anthropic Claude API (přístup 2026-07-14)
  • Ceník OpenAI API (přístup 2026-07-14)
  • Ceník Google Gemini API (přístup 2026-07-14)
  • Ceník DeepSeek API (přístup 2026-07-14)
  • Ceník Alibaba Cloud Model Studio (přístup 2026-07-14)
  • Ceník Mistral API (přístup 2026-07-14)
  • Ceník Z.AI (Zhipu GLM) (přístup 2026-07-14)

Štítky

srovnání cen llm apiceny llmceny gpt-5.6ceny claudeceny geminiceny deepseekcena za token

Sdílet článek

Související články

Více z kategorie guides

guides
Apr 12, 2026

Průvodce Surfer SEO 2026: Editor obsahu, bodování NLP a vyhledávání pomocí AI

Praktický průvodce nástrojem Surfer SEO pokrývající pracovní postup v Editoru obsahu, systém bodování NLP, AI Tracker pro optimalizaci GEO a automatizaci přes API. Na základě testování na více než 50 článcích.

14 min read minut čtení
Číst
guides
Apr 12, 2026

Průvodce Semrush 2026: Každý nástroj vysvětlen (s příklady)

Praktický průvodce Semrush pokrývající výzkum klíčových slov, audit webu, analýzu konkurence, sledování AI Visibility a nastavení MCP serveru. Zahrnuje ukázky kódu a pracovní postupy z reálného SEO pipeline.

14 min read minut čtení
Číst
guides
Apr 12, 2026

Průvodce Screaming Frog 2026: Technické SEO audity s integrací AI

Praktický průvodce nástrojem Screaming Frog SEO Spider pokrývající nastavení, technické audity, vlastní extrakci XPath, regulární výrazy a funkce integrace AI, které žádný jiný průvodce neobsahuje. Zahrnuje aktualizace pro verzi 23 a více než 15 úryvků kódu připravených ke zkopírování.

14 min read minut čtení
Číst
Zobrazit všechny články
Začněte svůj projekt

Pojďme něco postavit nevšedního?

Proměňme vaši vizi ve skutečnost. Náš tým je připraven vám pomoct vytvořit software, který dělá rozdíl.

Rezervovat 30minutový úvodní hovorNaše projekty

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt

Právní informace

  • Zásady ochrany osobních údajů
  • Podmínky poskytování služeb
  • Zásady používání cookies

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt
Právní informaceZásady ochrany osobních údajůPodmínky poskytování služebZásady používání cookies
TECHSY
© 2026 Techsy. Všechna práva vyhrazena.