Techsy
Kontakt
Začít
Zpět na blog
ai-machine-learning

Ceník Gemini Omni API: Co víme, co nahrazuje a kolik bude stát (květen 2026)

Napsal Techsy Editorial Team
May 19, 2026
16 minut čtení
Obsah
Ceník Gemini Omni API: Co víme, co nahrazuje a kolik bude stát (květen 2026)

Ceník Gemini Omni API: co víme, co nahrazuje a kolik bude stát (květen 2026)

Google představil Gemini Omni na I/O 2026 asi před pěti hodinami a řádek s cenami Gemini Omni API na vlastní ceníkové stránce Googlu je doslova prázdný. Níže najdete to, co víme dnes, propočty odhadovaných sazeb pro zítřek ukotvené o Veo 3.1 a Gemini 3.5 Flash a čtyřmodelový stack, který Omni slučuje do jediného volání. Naposledy ověřeno: 19. 5. 2026. Tento článek aktualizuji v den, kdy Google zveřejní sazby API.

Rychlá odpověď: Ceník Gemini Omni API zatím není veřejný (k 19. květnu 2026). Spotřebitelský přístup začíná na 20 $/měs. (AI Plus), 30 $/měs. (AI Pro) a 100 $/měs. (AI Ultra). Nasazení API ve Vertex AI se očekává v řádu týdnů. Při ukotvení o Veo 3.1 a Gemini 3.5 Flash vycházejí odhadované sazby API na 1,50–2,50 $ za 1 mil. vstupních tokenů a 0,20–0,60 $ za sekundu video výstupu.

Co je Gemini Omni?

Gemini Omni je první „any-to-any" multimodální model od Googlu, představený na I/O 2026 dne 19. května 2026. Jako vstup přijímá text, obrázek, zvuk a video a momentálně generuje video (výstup v podobě obrázků a zvuku je podle vlastních slov Googlu přislíben „postupem času"). Na startu se dodávají dvě varianty: Omni Flash pro rychlé 10sekundové klipy a Omni Pro pro delší výstup s vyšší věrností.

A právě tohle je z hlediska návrhu stacku zajímavé. Omni nepřidává do řady Gemini další funkci. Slučuje čtyři samostatné modely do jednoho volání API. To, co dřív bylo generování textu plus vidění plus převod řeči na text plus syntéza videa, se teď odehraje v jediném průchodu. Model stojí na video základu Veo 3.1, takže laťka kvality videa je už nastavená (a ano, každý výstup nese vodoznak SynthID, jak uvádí Google ve svém oznámení o uvedení Omni).

Než budete číst dál, stojí za to znát pár podrobností:

  • Desetisekundový limit klipů u Omni Flash je podle Googlu „rozhodnutí o nasazení, nikoli omezení modelu". Čti: nejspíš se prodlouží.
  • Modelová karta od DeepMind potvrzuje vstup text + obrázek + zvuk + video a dnešní výstup pouze video.
  • Rozbor TechCrunch i detail o uvedení od 9to5Google oba označují plán „další modality na výstup, později" za důležitější příběh.

Pokud jste sem přišli kvůli ceníku sazeb, následující sekce je ta upřímná část, kvůli které jste přišli. Pokud jste přišli kvůli projekční matematice, přeskočte o dvě sekce níž.

Kolik dnes stojí Gemini Omni API? (Spoiler: Zatím nic)

Ceny Gemini Omni API zatím nebyly zveřejněny. Oficiální ceník Google na adrese ai.google.dev/gemini-api/docs/pricing (ověřeno 19. května 2026) uvádí všechny modely Gemini KROMĚ Omni. Řádek je prázdný. Spotřebitelský přístup je dostupný přes úrovně aplikace Gemini; přístup k API přes Vertex AI „přijde v nadcházejících týdnech" podle samotného vyjádření Google při spuštění.

Ceník jsem zkontroloval v 8:00 ET a pak znovu ve 13:00 ET. Pokaždé stejný výsledek. Stránka uvádí 14 modelů Gemini. Omni mezi nimi není. Zatím.

ModelVstup ($/1M tokenů)Výstup ($/1M tokenů)Zvukový vstupPoznámky
Gemini 3.5 Flash$1.50$9.00$3.00Text/obrázek/zvuk na vstupu; text na výstupu
Gemini 3.1 Pro$2.00 / $4.00 (>200k)$12.00 / $18.00 (>200k)$3.002× sazba nad 200k kontextu
Gemini 3.1 Flash-Lite$0.10$0.40$0.30Nejlevnější produkční model
Gemini 2.5 Pro$1.25$10.00$3.00Starší, stále podporovaný
Veo 3.1 (video)n/a$0.40 / sn/aÚčtování výstupu po sekundách
Gemini OmniZatím nezveřejněnoZatím nezveřejněnon/aViz tabulka odhadů níže

Zdroj: ai.google.dev/gemini-api/docs/pricing, ověřeno 2026-05-19.

Jediná čísla pro Omni, která dnes existují, jsou spotřebitelská předplatná:

  • AI Plus: $20/měs.
  • AI Pro: $30/měs.
  • AI Ultra: $100/měs.

Blog Google o předplatných AI popisuje, co každá úroveň odemyká. Cesta k API je jako obvykle rozdělená: Vertex AI pro firemní závazky (pravděpodobně se spustí jako první) a AI Studio pro platby podle využití (typicky následuje s odstupem několika týdnů). Pro Omni zatím nebyl zveřejněn žádný signál o bezplatné úrovni. Rozbor pro firmy od VentureBeat potvrzuje rámec „nadcházejících týdnů". To je nejsilnější časový signál, který máme.

Takže pokud jste dnes hledali „Gemini Omni API pricing" a proklikali jste se pěti záložkami se zastaralými tabulkami Gemini 3.1 Pro, chyba není na vaší straně. Ceny doslova ještě nejsou venku.

Jaký vlastně bude ceník Gemini Omni API? (Matematika prognózy)

Prognózované ceny Gemini Omni API, interpolované z Veo 3.1 (0,05–0,60 $/s výstup) a Gemini 3.5 Flash (1,50 $/9 $ za 1M tokenů): nízký scénář vstup 1,50 $ / výstup 0,20 $/s, střední scénář vstup 2,00 $ / výstup 0,40 $/s, vysoký scénář vstup 2,50 $ / výstup 0,60 $/s za 1M tokenů. Vstup zvuku se odhaduje na 3–5 $ za 1M tokenů. Každé číslo zde je prognózované, nikoli potvrzené.

Takto jsme k tomu dospěli. Veo 3.1 dnes účtuje 0,40 $ za sekundu video výstupu a Omni Pro je postaven na stejném video základu. Sazba za sekundu u Omni Pro se tedy pravděpodobně pohybuje v pásmu Veo 3.1. Textový vstup/výstup Gemini 3.5 Flash činí 1,50 $/9 $ za milion tokenů; textový vstup/výstup Omni Flash se pravděpodobně pohybuje v rozmezí 0,7–1,5násobku této hodnoty, protože Google historicky oceňuje nové multimodální varianty Flash blízko jejich čistě textovým sourozencům.

ScénářVstup ($/1M)Výstupní text ($/1M)Výstupní video ($/s)Vstup zvuku ($/1M)Kotevní model
Nízký (prognóza)1,50 $7,00 $0,20 $3,00 $Gemini 3.5 Flash + Veo 3.1 Lite
Střední (prognóza)2,00 $10,00 $0,40 $4,00 $Smíšený Flash/Pro + Veo 3.1 standard
Vysoký (prognóza)2,50 $14,00 $0,60 $5,00 $Gemini 3.1 Pro + Veo 3.1 standard

Všechny sazby za milion tokenů, pokud není uvedeno jinak. Křížově ověřeno vůči ceníku OpenAI a ceníku Claude od Anthropic pro kontrolu rozumných mezí.

Několik věcí, které lze očekávat nad rámec základních sazeb:

  • Úrovně Batch / Flex / Priority. Nabízí je každý další model Gemini. Batch obvykle snižuje náklady přibližně o 50 %; Priority přidává záruky latence za příplatek. Omni tento vzor téměř jistě kopíruje.
  • Ceny podle kontextových úrovní. Gemini 3.1 Pro účtuje nad 200k tokeny dvojnásobek. Omni pravděpodobně přebírá stejné pravidlo, zejména vzhledem k tomu, že počty snímků videa rychle zvyšují celkové počty tokenů.
  • Tokenizace zvukového vstupu. Zvuk se účtuje po tokenech (kódovaných), nikoli po sekundách. Při současných sazbách Gemini jde přibližně o 32 tokenů za sekundu zvuku, takže s tím počítejte v rozpočtu. Vzhledem k ukotvení na modelech Veo 3.1 a Gemini 3.5 Flash bude Omni Flash pravděpodobně stát 1,50–2,50 USD za milion vstupních tokenů a 0,20–0,60 USD za sekundu výstupního videa. Výpočet jsme provedli dvakrát (jednou ukotvený pouze na Veo, jednou kombinovaný s Flash) a rozmezí se drží pod hranicí 0,50 USD/s na horním konci. Až Omni dorazí, budete chtít inteligentně směrovat požadavky a náš průvodce snížením nákladů na LLM API pokrývá směrování přes gateway a úrovně mezipaměti, které se vyplatí připravit předem.

"Projected per-1M-token cost (input + output blended)"

Tabulka dat
"Projected per-1M-token cost (input + output blended)"
"USD per 1M tokens"Série 1
"Gemini Omni (low projection)"3.5
"Gemini Omni (mid projection)"5.5
"Gemini Omni (high projection)"8
"Gemini 2.5 Pro"7
"GPT-4o"12.5
"Claude Sonnet 4.6"9

Prognózované cenové rozmezí Gemini Omni oproti kombinovaným vstupním/výstupním sazbám konkurence k 19. 5. 2026. Čísla pro Omni jsou interpolována z Veo 3.1 a Gemini 3.5 Flash; tento graf se aktualizuje v den, kdy Google zveřejní ceny.

Co Gemini Omni nahrazuje? Pracovní list kolapsu stacku

Omni nahrazuje vícemodelovou pipeline: GPT-4o pro text, GPT-4o Vision pro hodnocení obrázků, Whisper pro přepis zvuku a Veo 3.1 pro generování videa. Typický pracovní postup pro 30sekundové video s komentářem dnes vyjde přibližně na 12,27 $ napříč čtyřmi voláními API. Při projektovaných středních cenách Omni klesne stejný pracovní postup na 4–18 $ za klip v jediném volání (ano, horní okraj rozpětí je širší, než byste si přáli, ale čtěte dál).

V našich produkčních pipelineách aktuálně provozujeme přesně tento čtyřkrokový tvar pro klientské pracovní postupy s vysvětlujícími videi. Zde je přehled, kam putují peníze dnes a kam by putovaly u Omni Pro při projektovaných středních sazbách:

KrokDnešní modelDnešní cenaVolání OmniProjektovaná cena
Přepis vstupního zvukuWhisper0,006 $/minZahrnuto ve vstupu Omniv ceně
Hodnocení vstupního obrázkuGPT-4o Vision8 $ za 1 mil. vstupních tokenů (obrázek)Zahrnutov ceně
Generování titulku / scénářeGPT-4o2,50 $ / 10 $ za 1 mil. tokenůZahrnutov ceně
Generování 30s videaVeo 3.10,40 $/s × 30 = 12,00 $Omni Pro projektováno 0,20–0,60 $/s × 30projektováno 6–18 $
Celkem za klip~12,27 $projektováno 4–18 $ (rozpětí)

![Diagram znázorňující čtyři samostatná modelová API (GPT-4o, GPT-4o Vision, Whisper, Veo 3.1), která se hroutí do jediného volání API Gemini Omni|medium](inline-2.webp "Čtyři volání multimodální pipeline se zhroutí do jednoho volání Omni")

Zde je upřímná výhrada. Na horním okraji projektovaného rozpětí může být Omni Pro ve skutečnosti dražší za klip než současná pipeline se čtyřmi dodavateli. Výstup videa je dominantní nákladovou položkou, a pokud Google nacení Omni Pro na plných 0,40+ $/s jako u Veo 3.1 (plus přirážka za vstupní tokeny pro multimodální kontext), pracovní postupy s velkým objemem videa nemusí v první den přinést žádnou finanční úsporu.

Tak odkud tedy úspora skutečně pochází? Profesionální tip: pokud dnes platíte za Whisper + Vision + GPT-4o + Veo 3.1, vaší skutečnou výhrou od Omni nejsou vždy dolary. Je to zbavení se 3 dodavatelů, 3 SDK a 3 SLA v jediném volání. To je ta část, kterou CTO schválí, ne matematika kolem ceny za klip. Latence klesne, kód pro zpracování chyb se zmenší a vaše logika opakování se přestane větvit napříč čtyřmi taxonomiemi chyb. Až API vyjde, budete chtít Omni otestovat v A/B porovnání proti svému současnému stacku pomocí zrcadlení provozu, nikoli tvrdého přepnutí. Tutoriál k GPT-4o Responses API podrobně popisuje přesně ten multimodální stack, který má Omni nahradit, a LLM brána umožňuje přímočaré souběžné testování bez přepisování každého místa volání.

Vyplatí se Gemini Omni na automatizaci Instagramu?

Pro automatizaci Instagramu, kde jde jen o popisky, vychází GPT-4o-mini za 0,15 $/0,60 $ na 1 milion tokenů stále levněji než odhadované ceny Omni: přibližně 1,60 $ na 100 příspěvků oproti 4–10 $ na 100 příspěvků ve středním scénáři Omni. Omni vyhrává tam, kde váš workflow generuje také obrázek nebo video. Pro čistě textové popisky k existujícím fotkám zůstaňte u řetězce GPT-4o-mini. Neexistuje jedno univerzální řešení.

Workflow, které dnes většina indie hackerů používá, je šablona automatizace Instagramu n8n: n8n + generování popisků pomocí GPT-4o-mini + hodnocení obrázků přes GPT-4o Vision + generování hashtagů pomocí GPT-4o-mini + publikování přes Buffer. Reálná čísla na 100 příspěvků dnes:

  • Popisky (GPT-4o-mini, ~500 tokenů vstup / 100 výstup × 100 příspěvků): ~0,30 $
  • Hodnocení přes Vision (GPT-4o Vision, 1 obrázek × 100 příspěvků): ~1,20 $
  • Generování hashtagů (GPT-4o-mini, ~200 tokenů × 100): ~0,10 $
  • Celkem: ~1,60 $ na 100 příspěvků v čistých nákladech na API

Při odhadovaných cenách Omni ve středním scénáři (jedno multimodální volání na příspěvek: vstupní obrázek plus generování textu, výstup pouze text, u statických příspěvků na Instagramu není potřeba video) se dostanete někam do pásma 4–10 $ na 100 příspěvků. To je 2,5–6× dražší než řetězec GPT-4o-mini za naprosto stejný výstup.

Upřímný verdikt: pokud generujete instagramové Reels (video), je Omni jasná volba v okamžiku, kdy vyjde API, protože žádná z alternativ nedokáže vygenerovat 30sekundové video v jednom volání. Pokud publikujete statické obrázky s popisky od AI, GPT-4o-mini stále vyhrává v nákladech přibližně 3×. Nemigrujte jen kvůli migraci samotné.

"Cost per 100 Instagram posts (caption + image scoring + hashtags)"

Tabulka dat
"Cost per 100 Instagram posts (caption + image scoring + hashtags)"
"Stack"Série 1
"GPT-4o-mini chain (today)"1.6
"Gemini 2.5 Flash-Lite chain"1.2
"Gemini Omni (projected mid)"6
"GPT-4o full chain"11.4

U statických příspěvků na Instagramu stále vyhrává v nákladech GPT-4o-mini. Omni se dostává do vedení, pouze když je potřeba video výstup. Odhadované číslo pro Omni je založeno na cenách ve středním scénáři (kombinace Veo 3.1 + Gemini 3.5 Flash) k datu 19. 5. 2026. Pokud s těmito pipeline teprve začínáte, v návodu na AI agenty v n8n najdete základy. Pro agenturní workflow s vyšším objemem se vzory enterprise AI automatizace workflow věnují logice směrování, do které se Omni zapojí.

Gemini Omni vs GPT-4o vs Claude Sonnet 4.6: Upřímné srovnání

Srovnávat dnes Gemini Omni s GPT-4o a Claude Sonnet 4.6 není fér srovnání. Omni generuje video (ostatní ne), GPT-4o zvládá audio v reálném čase (Omni zatím ne) a Claude má největší kontextové okno pro práci s dlouhými dokumenty. Správná otázka zní, které silné stránky modelu odpovídají vaší pracovní zátěži, ne který je nejlevnější.

FunkceGemini Omni (odhad)GPT-4oClaude Sonnet 4.6
Vstupní modalitytext + obrázek + audio + videotext + obrázek + audiotext + obrázek
Výstupní modalityvideo (obrázek/audio později)text + audio (v reálném čase)text
Audio v reálném časeNeAnoNe
Kontextové okno1M (výchozí u rodiny Gemini)128k1M
Cena (vstup/výstup za 1M)odhad $1,50–$2,50 / $7–$14$2,50 / $10$3 / $15
Dostupnost API dnesNe (nadcházející týdny)AnoAno

Zdrojové sazby převzaty z ceníku OpenAI a ceníku Claude, ověřeno 19. 5. 2026.

Omni neporáží GPT-4o ani Claude cenou. Poráží je v pokrytí modalit. Pokud dnes potřebujete video na výstupu, Omni je jedinou možností z velké trojky (pro čistě video stále vítězí Veo 3.1, ale Omni přidává multimodální vstupní vrstvu). Pokud potřebujete hlas v reálném čase, tuto oblast stále ovládá GPT-4o. Pokud pro dokumentové workflow potřebujete kontextové okno o 1M tokenech, Claude Opus 4.7 to posunul ještě dál. A pro cenově citlivou dávkovou práci pokrývají stejnou oblast open-source multimodální alternativy s nulovými náklady na token (s vlastními kompromisy ohledně nastavení a výdajů za GPU).

Kdy Gemini Omni nepoužívat

Gemini Omni vynechte u čistě textových workflow (RAG, klasifikace, chat), u vysokokapacitních nízkomaržových pipeline (použijte Gemini 2.5 Flash-Lite nebo GPT-4o-mini s 10–50× nižšími náklady), u hlasových aplikací v reálném čase (tam stále kraluje GPT-4o Realtime) a u všeho, co vyžaduje fine-tuning. Omni je určený pro úlohy, kde je multimodalita samotnou hodnotovou nabídkou, nikoli levnějším způsobem provozování chatbota.

Konkrétně Omni vynechte, pokud:

  • Vaše zátěž je čistě textová a vysokokapacitní: použijte Gemini 2.5 Flash-Lite ($0.10/$0.40) nebo GPT-4o-mini ($0.15/$0.60)
  • Potřebujete hlas v reálném čase: GPT-4o Realtime je stále správná volba
  • Potřebujete fine-tuning: Veo 3.1 ho nepodporuje a Omni je postavený na stejném základu, takže při spuštění s fine-tuningem nepočítejte
  • Potřebujete výstup obrázků už dnes: Imagen 4 nebo DALL-E 3 (Omni při spuštění generuje video, nikoli obrázky)
  • Potřebujete zvukový výstup už dnes: ElevenLabs, OpenAI TTS nebo Gemini TTS, protože zvukový výstup Omni je naplánovaný na „později"
  • Potřebujete klipy delší než 10 sekund na variantě Flash: počkejte na úroveň Pro, nebo použijte přímo Veo 3.1
  • Vaše UX vyžaduje odezvu pod jednu sekundu: multimodální volání jsou pomalejší než čistě textová; počítejte s dodatečnou latencí

Než vyměníte jediné produkční volání, otestujte Omni vůči svému současnému stacku pomocí sdílené evaluační sady. Omni je špatná volba pro chatboty, klasifikaci a RAG. Je to model pro multimodální úlohy, nikoli model na levné tokeny.

Tahák pro migraci: Od více volání k jedinému volání Omni

Až API vyjde, migrace z pipeline se čtyřmi voláními na jediné volání Omni bude představovat změnu kódu zhruba o 15 řádcích. Podoba níže je pseudokód. Skutečné signatury SDK přijdou společně s API. Konvence pojmenování Google na základě vzoru Veo 3.1 naznačují gemini-omni-flash a gemini-omni-pro.

Dnes: čtyři samostatná volání napříč dvěma dodavateli.

python
# DNES: čtyři volání API, dva dodavatelé, čtyři taxonomie chyb
from openai import OpenAI
from google import genai

openai = OpenAI()
google = genai.Client()

transcript = openai.audio.transcriptions.create(model="whisper-1", file=audio)
vision = openai.chat.completions.create(model="gpt-4o", messages=[
    {"role": "user", "content": [{"type": "image_url", "image_url": image_url}]}])
caption = openai.chat.completions.create(model="gpt-4o", messages=[
    {"role": "user", "content": f"Caption for {vision.choices[0].message.content}"}])
video = google.models.generate_videos(model="veo-3.1", prompt=caption.choices[0].message.content)

Tomorrow (projected): one call to Omni.

python
# VÝHLED: jedno volání Omni (pseudokód — skutečné SDK dorazí s API)
from google import genai

client = genai.Client()
response = client.models.generate_content(
    model="gemini-omni-flash",  # or "gemini-omni-pro" for longer clips
    contents=[text_prompt, image, audio, video_reference],
    config={"output_modality": "video", "duration_seconds": 10}
)

Až API vyjde, migrace bude většinou jen mazání kódu. V den spuštění si pohlídejte název modelu a zafixujte ho do konstanty, abyste mohli podle úlohy přepínat mezi omni-flash a omni-pro, aniž byste museli sahat na místa volání. Aktuální vzor v Python SDK pro Gemini už multimodální obsah zvládá, takže výše uvedená struktura do něj hladce zapadne.

Jak Techsy přemýšlí o migraci na Omni

Když pro klienty hodnotíme jakoukoli výměnu modelového stacku, pokládáme tři otázky: jaký je rozpočet na latenci, pokrývá nový model modality, které vaše zátěž skutečně využívá, a existuje přínos konsolidace dodavatelů, který stojí za náklady na přestavbu? Dvě z nich se obvykle zodpoví samy; ta třetí je místo, kde většinu migrací někdo přemluví ke vzniku ze špatných důvodů.

Nedoporučujeme klientům, aby dnes přestavovali na Omni. API ještě není venku, ceny nejsou zveřejněné a odhadované rozpětí je plánovací nástroj, ne zelená k nasazení refaktoru. Co bychom udělali právě teď, je zapojit gateway vrstvu, která vám umožní A/B testovat Omni proti vašemu současnému stacku v okamžiku, kdy API vyjde. Agresivně cachujte multimodální volání (vstupy obrazu + zvuku jsou dostatečně deterministické, aby často zasáhly cache), a ponechte feature flag pro název modelu.

Budujete AI stack, který potřebuje absorbovat uvedení nových modelů bez přepisování každých šest týdnů? Získejte bezplatnou konzultaci a my prověříme, kam Omni zapadá (nebo ne).

Často kladené otázky

Kolik stojí Gemini Omni API?

K 19. květnu 2026 nebyl ceník Gemini Omni API zveřejněn. Na cenové stránce Googlu jsou uvedeny všechny modely Gemini kromě Omni. Na základě srovnání s modely Veo 3.1 a Gemini 3.5 Flash se odhadované sazby pohybují v rozmezí 1,50–2,50 $ za 1 milion vstupních tokenů a 0,20–0,60 $ za sekundu výstupního videa. Uvedené částky jsou odhady, nikoli potvrzené ceny.

Kdy bude spuštěno Gemini Omni API?

Google na konferenci I/O 2026 dne 19. května oznámil, že API bude zpřístupněno „v nadcházejících týdnech". Přístup přes Vertex AI se u nových modelů Gemini obvykle objevuje jako první, přičemž placené využití přes AI Studio následuje o několik týdnů později. Oficiální příspěvek o spuštění je oficiálním zdrojem informací o časovém plánu. Tento článek aktualizujeme v den, kdy budou ceny zveřejněny.

Je Gemini Omni levnější než GPT-4o?

Záleží na typu úlohy. Pro výstup videa je Omni jedinou možností z Big-3, která poskytuje generování v jednom volání, protože GPT-4o video negeneruje. Pro čistě textové úlohy GPT-4o-mini s cenou $0,15/$0,60 za 1 milion tokenů překonává předpokládané ceny Omni zhruba 3×. Vyberte model, který odpovídá modalitám, jež váš pipeline skutečně produkuje.

Co Gemini Omni nahradí v mém stacku?

V multimodálních video workflows Omni nahrazuje čtyři samostatná volání API: Whisper pro přepis, GPT-4o Vision pro porozumění obrázkům, GPT-4o pro generování textu a Veo 3.1 pro syntézu videa. Největší výhrou obvykle není přímá finanční úspora, ale odstranění tří SDK dodavatelů, tří SLA a tří taxonomií chyb. Výpočty pro jednotlivé klipy najdete v pracovním listu pro konsolidaci stacku výše.

Mohu dnes používat Gemini Omni prostřednictvím API?

Ne. K 19. květnu 2026 zatím není přístup k API k dispozici. Spotřebitelský přístup funguje prostřednictvím úrovní aplikace Gemini: AI Plus za 20 $/měs., AI Pro za 30 $/měs. a AI Ultra za 100 $/měs., podle blogu o předplatných AI od Googlu. Zpřístupnění API přes Vertex AI je podle vyjádření samotného Googlu „otázka týdnů".

Podporuje Gemini Omni jemné doladění?

K datu uvedení na trh nebylo oznámeno. Jemné doladění nepodporuje ani Veo 3.1 a Omni stojí na stejném video základu, takže při spuštění s jemným doladěním nepočítejte. Google v minulosti přidával jemné doladění u multimodálních modelů několik měsíců po obecné dostupnosti, takže časový horizont Q3 nebo Q4 2026 je pravděpodobný, ale nepotvrzený.

Jak funguje fakturace Gemini Omni?

Očekává se, že bude následovat standardní model Google: sazby za milion tokenů pro vstup (text, obrázky, zvuk, video snímky) plus fakturace po sekundách za výstup videa. U dalších modelů Gemini jsou pravděpodobně dostupné úrovně Batch (typicky sleva ~50 %), Flex a Priority. Vzhledem k tomu, že video snímky rychle navyšují počet tokenů, bude pravděpodobně platit cenová úroveň podle kontextu (dvojnásobná sazba nad 200 tisíc tokenů).

Jaký je rozdíl mezi Omni Flash a Omni Pro?

Omni Flash je rychlejší a levnější varianta omezená na 10sekundové klipy. Omni Pro zpracovává delší klipy s vyšší věrností při vyšších odhadovaných nákladech. Oba pokrývají stejnou matici modalit (vstup: text, obrázek, zvuk a video; výstup: zatím pouze video). Google označuje 10sekundový limit verze Flash za „rozhodnutí o nasazení, nikoli omezení modelu“, takže lze očekávat jeho prodloužení.

Nahradí Gemini Omni pro mou automatizaci Instagramu GPT-4o?

Záleží na tom, co generujete. Pro Reels (video výstup): ano, časem, protože Omni je jediná volba s jedním voláním pro syntézu 30sekundového videa. Pro statické příspěvky s AI popisky a hashtagy: pravděpodobně ne. GPT-4o-mini stále poráží odhadované ceny Omni zhruba 3× co do nákladů a řetězec n8n + GPT-4o-mini je již prověřený v produkčním prostředí.

Závěr

Tři věci, které si odnést:

  • Ceny Gemini Omni API nejsou zveřejněny k 19. květnu 2026. Řádek na ceníkové stránce je prázdný, spotřebitelské tarify běží za 20–100 $/měs. a přístup k API přes Vertex AI je „v řádu týdnů".
  • Rozmezí odhadu: 1,50–2,50 $ za 1 mil. vstupních tokenů a 0,20–0,60 $ za sekundu výstupního videa, ukotveno k Veo 3.1 a Gemini 3.5 Flash. Vstupní audio odhadováno na 3–5 $ za 1 mil. tokenů. Všechna čísla jsou odhady, nikoli fakta.
  • Úspora ze zhroucení stacku není vždy v dolarech. Jde o ztrátu 3 dodavatelů, 3 SDK a 3 SLA v jediném multimodálním volání. Plánujte migraci kolem konsolidace dodavatelů a latence, ne kolem surových $/klip.

Naposledy ověřeno: 2026-05-19 (SLA aktualizace: 24 hodin poté, co Google zveřejní sazby). Tento článek aktualizuji v den, kdy Google zveřejní sazby API. Přidejte si ho do záložek.

Editorial tým Techsy dodává multimodální pipeline na GPT-4o + Veo 3.1 + Whisper od roku 2024. Tento článek aktualizujeme, když Google zveřejní sazby Omni.

Štítky

gemini-omni-api-cenikgemini-omniceny-llmmultimodalni-aivertex-ai

Sdílet článek

Související články

Více z kategorie ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 je tady: Inteligence blízká Fable 5 za poloviční cenu

Anthropic vydal Claude Opus 5 24. července 2026. Na Frontier-Bench více než zdvojnásobuje Opus 4.8 a drží cenu Opus, ale v několika testech prohrává s Fable 5 a Mythos 5. Zde je tabulka benchmarků, ceník a doporučení: přepnout / počkat / zůstat.

10 min read minut čtení
Číst
ai-machine-learning
Jul 20, 2026

8 nejlepších API pro AI web scraping v roce 2026 (otestováno na našem vlastním agentním stacku)

Otestovali jsme 8 API pro AI web scraping s reálnými cenami pro rok 2026 staženými přes náš vlastní agentní stack. Firecrawl, Bright Data, ScrapingBee a 5 dalších, seřazené podle výstupu připraveného pro LLM, anti-bot a podpory MCP.

9 min read minut čtení
Číst
ai-machine-learning
Jul 20, 2026

Prompt Engineering pro kódování: 7 vzorů, které denně používáme v Claude Code a Cursor (2026)

Většina článků o „promptech pro AI kódování“ vám nabídne 50 šablon ke kopírování. Tento článek učí 7 vzorů, které každý den používáme k provozu pipeline s 16 agenty v Claude Code, včetně skutečných příkladů před a po úpravě pro každý z nich, a ukazuje, kde se každý vzor nachází v nástrojích Claude Code, Cursor a Copilot v roce 2026.

11 min read minut čtení
Číst
Zobrazit všechny články
Začněte svůj projekt

Pojďme něco postavit nevšedního?

Proměňme vaši vizi ve skutečnost. Náš tým je připraven vám pomoct vytvořit software, který dělá rozdíl.

Rezervovat 30minutový úvodní hovorNaše projekty

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt

Právní informace

  • Zásady ochrany osobních údajů
  • Podmínky poskytování služeb
  • Zásady používání cookies

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt
Právní informaceZásady ochrany osobních údajůPodmínky poskytování služebZásady používání cookies
TECHSY
© 2026 Techsy. Všechna práva vyhrazena.