
Prezzi API Gemini Omni: Cosa Sappiamo, Cosa Sostituisce e Quanto Costerà (Maggio 2026)
Google ha lanciato Gemini Omni all'I/O 2026 circa cinque ore fa, e la riga relativa ai prezzi API di Gemini Omni sulla pagina ufficiale di Google è letteralmente vuota. Di seguito trovi quello che sappiamo oggi, i calcoli proiettati per le tariffe di domani — ancorate a Veo 3.1 e Gemini 3.5 Flash — e lo stack a quattro modelli che Omni collassa in un'unica chiamata. Ultima verifica: 19 maggio 2026. Aggiornerò questo post il giorno in cui Google pubblicherà le tariffe API.
Risposta rapida: I prezzi API di Gemini Omni non sono ancora pubblici al 19 maggio 2026. L'accesso consumer parte da $20/mese (AI Plus), $30/mese (AI Pro) e $100/mese (AI Ultra). Il rilascio via Vertex AI è atteso nelle prossime settimane. Ancorati a Veo 3.1 e Gemini 3.5 Flash, i prezzi API proiettati si attestano a $1,50–$2,50 per milione di token in input e $0,20–$0,60 al secondo di output video.
Cos'è Gemini Omni?
Gemini Omni è il primo modello multimodale "qualsiasi-verso-qualsiasi" di Google, annunciato all'I/O 2026 il 19 maggio 2026. Accetta testo, immagine, audio e video come input e al momento produce video come output (immagini e audio in uscita sono promessi "a tempo debito" stando alle parole di Google). Al lancio arrivano due varianti: Omni Flash per clip veloci da 10 secondi, e Omni Pro per output più lunghi e di qualità superiore.
Dal punto di vista dell'architettura di sistema, Omni non aggiunge una funzione alla lineup Gemini — la ridisegna. Quello che prima richiedeva generazione di testo più visione più speech-to-text più sintesi video diventa un unico round trip. Il modello è costruito sulla base video Veo 3.1, quindi il livello qualitativo è già definito (e sì, ogni output porta una filigrana SynthID, stando all'annuncio di lancio di Omni).
Alcuni dettagli da sapere prima di continuare:
- Il limite di 10 secondi su Omni Flash è ciò che Google chiama "una scelta di deployment, non un vincolo del modello." Leggi: probabilmente crescerà.
- La model card di DeepMind conferma input di testo + immagine + audio + video, output solo video per ora.
- Il riepilogo di TechCrunch e i dettagli di lancio di 9to5Google segnalano entrambi la roadmap "più modalità in output, più avanti" come la storia più importante.
Se sei qui per un listino prezzi, la prossima sezione è la parte onesta che stai cercando. Se vuoi direttamente i calcoli proiettati, salta due sezioni.
Quanto Costa l'API Gemini Omni Oggi? (Spoiler: Niente, per Ora)
I prezzi API di Gemini Omni non sono ancora pubblicati. La pagina ufficiale di Google all'indirizzo ai.google.dev/gemini-api/docs/pricing (verificata il 19 maggio 2026) elenca tutti i modelli Gemini TRANNE Omni. La riga è vuota. L'accesso consumer è attivo tramite i piani dell'app Gemini; l'accesso API tramite Vertex AI è "in arrivo nelle prossime settimane" stando alle parole di Google al lancio.
Ho controllato la pagina dei prezzi alle 8:00 ET e di nuovo all'1:00 PM ET. Stesso risultato entrambe le volte. La pagina elenca 14 modelli Gemini. Omni non è tra loro. Ancora.
| Modello | Input ($/1M token) | Output ($/1M token) | Audio input | Note |
|---|---|---|---|---|
| Gemini 3.5 Flash | $1,50 | $9,00 | $3,00 | Testo/immagine/audio in; testo out |
| Gemini 3.1 Pro | $2,00 / $4,00 (>200k) | $12,00 / $18,00 (>200k) | $3,00 | Tariffa 2× oltre 200k contesto |
| Gemini 3.1 Flash-Lite | $0,10 | $0,40 | $0,30 | Modello di produzione più economico |
| Gemini 2.5 Pro | $1,25 | $10,00 | $3,00 | Legacy, ancora supportato |
| Veo 3.1 (video) | n/d | $0,40 / sec | n/d | Fatturazione per secondo di output |
| Gemini Omni | Non ancora pubblicato | Non ancora pubblicato | n/d | Vedi tabella proiezioni sotto |
Fonte: ai.google.dev/gemini-api/docs/pricing, verificato il 19 maggio 2026.
Gli unici numeri Omni che esistono oggi sono gli abbonamenti consumer:
- AI Plus: $20/mese
- AI Pro: $30/mese
- AI Ultra: $100/mese
Il blog sugli abbonamenti AI di Google spiega cosa sblocca ogni piano. Il percorso API è diviso come al solito: Vertex AI per i commit enterprise (probabilmente il primo a essere rilasciato) e AI Studio con pagamento a consumo (tipicamente segue qualche settimana dopo). Nessun segnale su una fascia gratuita per Omni è stato pubblicato finora. Il riepilogo enterprise di VentureBeat conferma la formulazione "nelle prossime settimane". È il segnale temporale più forte che abbiamo.
Quindi se hai cercato "prezzi API Gemini Omni" oggi e hai saltato tra cinque schede di tabelle Gemini 3.1 Pro obsolete, il problema non sei tu. I prezzi semplicemente non sono usciti.
Quanto Costerà Davvero l'API Gemini Omni? (I Calcoli Proiettati)
Prezzi API di Gemini Omni proiettati, interpolati da Veo 3.1 ($0,05–$0,60/sec di output) e Gemini 3.5 Flash ($1,50/$9 per milione di token): caso basso $1,50 input / $0,20/sec output, caso medio $2,00 input / $0,40/sec output, caso alto $2,50 input / $0,60/sec output per milione di token. L'audio in input è stimato a $3–$5 per milione di token. Ogni numero qui è proiettato, non confermato.
Ecco come siamo arrivati a queste cifre. Veo 3.1 addebita $0,40 al secondo di output video oggi, e Omni Pro è costruito sulla stessa base video. Quindi la tariffa al secondo di Omni Pro probabilmente si colloca nella banda di Veo 3.1. I token di testo I/O di Gemini 3.5 Flash costano $1,50/$9 per milione; i token testo I/O di Omni Flash probabilmente si aggirano tra 0,7× e 1,5× rispetto a quello, visto che Google storicamente prezza le nuove varianti Flash multimodali vicino al modello gemello solo testo.
| Caso | Input ($/1M) | Output testo ($/1M) | Output video ($/sec) | Audio input ($/1M) | Modello di ancoraggio |
|---|---|---|---|---|---|
| Basso (proiettato) | $1,50 | $7,00 | $0,20 | $3,00 | Gemini 3.5 Flash + Veo 3.1 Lite |
| Medio (proiettato) | $2,00 | $10,00 | $0,40 | $4,00 | Blend Flash/Pro + Veo 3.1 standard |
| Alto (proiettato) | $2,50 | $14,00 | $0,60 | $5,00 | Gemini 3.1 Pro + Veo 3.1 standard |
Tutte le tariffe per milione di token salvo diversa indicazione. Confrontate con i prezzi di OpenAI e i prezzi di Claude di Anthropic come limite di ragionevolezza.
Alcune voci di costo aggiuntive da aspettarsi:
- Livelli Batch / Flex / Priority. Ogni altro modello Gemini li offre. Il Batch riduce solitamente il costo del ~50%; Priority aggiunge garanzie di latenza a un costo superiore. Omni quasi certamente replica lo stesso schema.
- Prezzi per livello di contesto. Gemini 3.1 Pro addebita 2× oltre i 200k token. Omni probabilmente adotta la stessa regola, specialmente perché i frame video spingono rapidamente il conteggio dei token.
- Tokenizzazione audio in input. L'audio è fatturato per token (codificato), non al secondo. Circa 32 token per secondo di audio alle tariffe Gemini attuali, quindi pianifica di conseguenza.
Ancorati a Veo 3.1 e Gemini 3.5 Flash, Omni Flash probabilmente costerà $1,50–$2,50 per milione di token in input e $0,20–$0,60 al secondo di output video. Abbiamo eseguito i calcoli due volte (una volta ancorati solo a Veo, una volta mescolati con Flash) e le bande si sono mantenute entro $0,50/sec sull'estremo alto. Quando Omni arriverà vorrai instradare le richieste in modo intelligente — la nostra guida per ridurre i costi API LLM copre il routing via gateway e i livelli di cache che vale la pena configurare già adesso.
"Costo proiettato per 1M token (input + output combinato)"
Tabella dei dati
| "USD per 1M token" | Serie 1 |
|---|---|
| "Gemini Omni (proiezione bassa)" | 3.5 |
| "Gemini Omni (proiezione media)" | 5.5 |
| "Gemini Omni (proiezione alta)" | 8 |
| "Gemini 2.5 Pro" | 7 |
| "GPT-4o" | 12.5 |
| "Claude Sonnet 4.6" | 9 |
Banda di costo proiettata di Gemini Omni vs tariffe blended input/output dei concorrenti al 19 maggio 2026. I numeri Omni sono interpolati da Veo 3.1 e Gemini 3.5 Flash; questo grafico viene aggiornato il giorno in cui Google pubblica le tariffe.
Cosa Sostituisce Gemini Omni? Il Foglio di Calcolo Stack-Collasso
Omni sostituisce una pipeline multi-modello: GPT-4o per il testo, GPT-4o Vision per il punteggio immagini, Whisper per la trascrizione audio e Veo 3.1 per la generazione video. Un tipico flusso di lavoro video-con-narrazione da 30 secondi costa oggi circa $12,27 su quattro chiamate API. Con i prezzi Omni Pro al caso medio proiettato, lo stesso flusso scende a $4–$18 per clip in un'unica chiamata (sì, l'estremo alto è più ampio di quanto vorresti, ma continua a leggere).
Nelle nostre pipeline di produzione, eseguiamo attualmente questo esatto schema a quattro step per i flussi di lavoro di video-explainer dei clienti. Ecco dove va il denaro oggi rispetto a dove andrebbe con Omni Pro alle tariffe medie proiettate:
| Step | Modello attuale | Costo attuale | Chiamata Omni | Costo proiettato |
|---|---|---|---|---|
| Trascrivi audio in input | Whisper | $0,006/min | Assorbito in input Omni | incluso |
| Punteggia immagine in input | GPT-4o Vision | $8 per 1M token input (immagine) | Assorbito | incluso |
| Genera didascalia / script | GPT-4o | $2,50 / $10 per 1M token | Assorbito | incluso |
| Genera video 30s | Veo 3.1 | $0,40/sec × 30 = $12,00 | Omni Pro proiettato $0,20–$0,60/sec × 30 | proiettato $6–$18 |
| Totale per clip | ~$12,27 | proiettato $4–$18 (banda) |

Ecco la messa in guardia onesta. All'estremo alto della banda proiettata, Omni Pro potrebbe effettivamente essere più costoso per clip rispetto alla pipeline attuale a quattro fornitori. L'output video è la voce di costo dominante, e se Google prezza Omni Pro alla tariffa piena di Veo 3.1 di $0,40+/sec (più il markup dei token di input per il contesto multimodale), i flussi di lavoro pesanti in video potrebbero non vedere un risparmio in dollari nel primo giorno.
Quindi dove sta il risparmio reale? Il consiglio da tenere a mente è questo: se oggi stai pagando Whisper + Vision + GPT-4o + Veo 3.1, il vero guadagno da Omni non è sempre in dollari. È perdere 3 fornitori, 3 SDK e 3 SLA in un'unica chiamata. Questa è la parte che il CTO firmerà, non i calcoli per clip. La latenza scende, il codice di gestione degli errori si riduce e la logica di retry smette di ramificarsi su quattro tassonomie di errore diverse.
Quando l'API arriverà, vorrai fare A/B test tra Omni e il tuo stack attuale con traffic mirroring, non un taglio netto. Il tutorial dell'API Responses di OpenAI illustra lo stack multimodale esatto che Omni è progettato a collassare, e un LLM gateway rende il test comparativo semplice senza riscrivere ogni call site.
Vale la Pena Gemini Omni per l'Automazione Instagram?
Per l'automazione Instagram che genera solo didascalie, GPT-4o-mini a $0,15/$0,60 per milione di token rimane più economico delle tariffe Omni proiettate: circa $1,60 per 100 post vs $4–$10 per 100 post con Omni al caso medio. Omni vince quando il tuo flusso di lavoro genera anche l'immagine o il video. Per didascalie solo testo su foto già esistenti, resta con la catena GPT-4o-mini. Non è una risposta valida per tutti.
Il flusso di lavoro che la maggior parte degli indie hacker usa adesso è il template n8n per automazione Instagram: n8n + GPT-4o-mini per generare didascalie + GPT-4o Vision per il punteggio immagini + GPT-4o-mini per gli hashtag + Buffer per la pubblicazione. Numeri reali per 100 post oggi:
- Didascalie (GPT-4o-mini, ~500 token in / 100 out × 100 post): ~$0,30
- Punteggio visivo (GPT-4o Vision, 1 immagine × 100 post): ~$1,20
- Generazione hashtag (GPT-4o-mini, ~200 token × 100): ~$0,10
- Totale: ~$1,60 per 100 post in spesa API grezza
Con le tariffe Omni al caso medio proiettato (un'unica chiamata multimodale per post: immagine + testo in input, solo testo in output, nessun video necessario per i post statici su Instagram), si arriverebbe a qualcosa nella banda $4–$10 per 100 post. Questo significa 2,5–6 volte più costoso della catena GPT-4o-mini per lo stesso identico output.
Verdetto onesto: se generi Instagram Reels (video), Omni è la scelta ovvia non appena arriva l'API, perché nessuna alternativa produce un video da 30 secondi in un'unica chiamata. Se pubblichi immagini statiche con didascalie AI, GPT-4o-mini vince ancora sul costo di circa 3×. Non migrare solo per il gusto di farlo.
"Costo per 100 post Instagram (didascalie + punteggio immagini + hashtag)"
Tabella dei dati
| "Stack" | Serie 1 |
|---|---|
| "Catena GPT-4o-mini (oggi)" | 1.6 |
| "Catena Gemini 2.5 Flash-Lite" | 1.2 |
| "Gemini Omni (proiezione media)" | 6 |
| "Catena GPT-4o completa" | 11.4 |
Per i post Instagram statici, GPT-4o-mini vince ancora sul costo. Omni prende il vantaggio solo quando è richiesto l'output video. Il numero Omni proiettato è ancorato alle tariffe del caso medio (blend Veo 3.1 + Gemini 3.5 Flash) al 19 maggio 2026.
Se sei alle prime armi con questi flussi, il tutorial n8n con agenti AI copre le basi. Per flussi di lavoro ad alto volume in stile agenzia, i pattern di automazione enterprise con AI illustrano la logica di routing in cui Omni si inserirà.
Gemini Omni vs GPT-4o vs Claude Sonnet 4.6: Il Confronto Onesto
Confrontare Gemini Omni con GPT-4o e Claude Sonnet 4.6 oggi non è un confronto tra pari. Omni produce video (gli altri no), GPT-4o fa audio in tempo reale (Omni no, ancora), e Claude ha la finestra di contesto più ampia per i lavori su documenti lunghi. La domanda giusta è quale modello corrisponde meglio al tuo carico di lavoro, non quale sia il più economico.
| Funzionalità | Gemini Omni (proiettato) | GPT-4o | Claude Sonnet 4.6 |
|---|---|---|---|
| Modalità in input | testo + immagine + audio + video | testo + immagine + audio | testo + immagine |
| Modalità in output | video (immagine/audio più avanti) | testo + audio (in tempo reale) | testo |
| Audio in tempo reale | No | Sì | No |
| Finestra di contesto | 1M (default famiglia Gemini) | 128k | 1M |
| Prezzo (input/output per 1M) | proiettato $1,50–$2,50 / $7–$14 | $2,50 / $10 | $3 / $15 |
| Disponibilità API oggi | No (prossime settimane) | Sì | Sì |
Tariffe fonte estratte da OpenAI pricing e Claude pricing, verificate il 19 maggio 2026.
Omni non batte GPT-4o o Claude sul prezzo. Li batte sulla copertura delle modalità. Se hai bisogno di output video oggi, Omni è l'unica opzione del Big-3 (Veo 3.1 vince ancora per il video puro, ma Omni aggiunge il layer di input multimodale). Se hai bisogno di voce in tempo reale, GPT-4o domina ancora quella corsia. Se hai bisogno di una finestra di contesto da 1M token per flussi su documenti, Claude Opus 4.7 ha esteso ulteriormente le possibilità. E per i lavori batch cost-sensitive, le alternative open-source multimodali coprono la stessa corsia a costo per token zero (con i loro trade-off in termini di setup e spesa GPU).
Quando NON Usare Gemini Omni
Evita Gemini Omni per flussi di lavoro solo testo (RAG, classificazione, chat), pipeline ad alto volume e basso margine (usa Gemini 2.5 Flash-Lite o GPT-4o-mini a un costo 10–50× inferiore), app di voce in tempo reale (GPT-4o Realtime domina ancora questo spazio), o qualsiasi cosa richieda fine-tuning. Omni è per i lavori in cui il multimodale È la proposta di valore, non un modo più economico per far girare un chatbot.
In concreto, salta Omni se:
- Il tuo carico di lavoro è solo testo e ad alto volume: usa Gemini 2.5 Flash-Lite ($0,10/$0,40) o GPT-4o-mini ($0,15/$0,60)
- Hai bisogno di voce in tempo reale: GPT-4o Realtime è ancora la scelta giusta
- Hai bisogno di fine-tuning: Veo 3.1 non lo supporta, e Omni è costruito sulla stessa base, quindi presumi nessun fine-tuning al lancio
- Hai bisogno di output immagini oggi: Imagen 4 o DALL-E 3 (Omni produce video, non immagini, al lancio)
- Hai bisogno di output audio oggi: ElevenLabs, OpenAI TTS o Gemini TTS, poiché l'audio out di Omni è "più avanti"
- Hai bisogno di clip più lunghe di 10 secondi su Flash: aspetta il livello Pro o usa Veo 3.1 direttamente
- La tua UX richiede risposta sub-secondo: le chiamate multimodali sono più lente di quelle solo testo; prevedi latenza aggiuntiva
Prima di sostituire una singola chiamata in produzione, metti Omni a confronto con il tuo stack attuale usando una suite di valutazione condivisa. Omni è la scelta sbagliata per chatbot, classificazione e RAG. È un modello per lavori multimodali, non un modello per token economici.
Guida Rapida alla Migrazione: Dalla Pipeline Multi-Chiamata a Omni
Quando l'API arriverà, migrare da una pipeline a 4 chiamate a un'unica chiamata Omni è all'incirca una modifica di 15 righe di codice. Lo schema seguente è pseudocodice. Le firme SDK reali arriveranno con l'API. La convenzione di denominazione di Google suggerisce gemini-omni-flash e gemini-omni-pro basandosi sul pattern di Veo 3.1.
Oggi: quattro chiamate separate su due fornitori.
# OGGI: quattro chiamate API, due fornitori, quattro tassonomie di errore
from openai import OpenAI
from google import genai
openai = OpenAI()
google = genai.Client()
transcript = openai.audio.transcriptions.create(model="whisper-1", file=audio)
vision = openai.chat.completions.create(model="gpt-4o", messages=[
{"role": "user", "content": [{"type": "image_url", "image_url": image_url}]}])
caption = openai.chat.completions.create(model="gpt-4o", messages=[
{"role": "user", "content": f"Caption for {vision.choices[0].message.content}"}])
video = google.models.generate_videos(model="veo-3.1", prompt=caption.choices[0].message.content)Domani (proiettato): una sola chiamata a Omni.
# PROIETTATO: unica chiamata Omni (pseudocodice — SDK reale arriva con l'API)
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="gemini-omni-flash", # o "gemini-omni-pro" per clip più lunghe
contents=[text_prompt, image, audio, video_reference],
config={"output_modality": "video", "duration_seconds": 10}
)Quando l'API arriverà, la migrazione consiste principalmente nell'eliminare codice. Tieni d'occhio il nome del modello il giorno del lancio e fissalo in una costante così puoi passare tra omni-flash e omni-pro per carico di lavoro senza toccare i call site. Il pattern SDK Python attuale per Gemini gestisce già i contenuti multimodali, quindi lo schema sopra si inserisce senza problemi.
Come Techsy Pensa alla Migrazione su Omni
Quando valutiamo qualsiasi cambio di stack per i clienti, ci poniamo tre domande: qual è il budget di latenza, il nuovo modello copre le modalità che il tuo carico di lavoro usa davvero, e c'è un vantaggio di consolidamento dei fornitori che vale il costo della riscrittura? Due di queste di solito si rispondono da sole; la terza è quella in cui la maggior parte delle migrazioni si lascia convincere a esistere per il motivo sbagliato.
Non raccomandiamo ai clienti di ricostruire su Omni oggi. L'API non è uscita, i prezzi non sono pubblicati e una banda di proiezione è uno strumento di pianificazione, non un semaforo verde per spedire un refactor. Quello che faremmo adesso è cablare il layer gateway che ti permette di fare A/B test tra Omni e il tuo stack attuale nel momento in cui l'API arriva. Aggiungi una cache aggressiva sulle chiamate multimodali (gli input immagine + audio sono abbastanza deterministici da colpire spesso la cache) e tieni un feature flag per il nome del modello.
Stai costruendo uno stack AI che deve assorbire i lanci di modelli senza una riscrittura ogni sei settimane? Richiedi una consulenza gratuita e analizzeremo insieme dove Omni si adatta (o non si adatta).
Domande Frequenti
Quanto costa l'API di Gemini Omni?
Al 19 maggio 2026, i prezzi API di Gemini Omni non sono stati pubblicati. La pagina dei prezzi di Google elenca tutti i modelli Gemini tranne Omni. Ancorati a Veo 3.1 e Gemini 3.5 Flash, le tariffe proiettate si attestano a $1,50–$2,50 per milione di token in input e $0,20–$0,60 al secondo di output video. I numeri sono proiezioni, non tariffe confermate.
Quando sarà disponibile l'API di Gemini Omni?
Google ha dichiarato che l'API sarebbe arrivata "nelle prossime settimane" all'I/O 2026 del 19 maggio. L'accesso via Vertex AI solitamente arriva per primo sui nuovi modelli Gemini, con AI Studio pay-as-you-go che segue qualche settimana dopo. Il post di lancio ufficiale è la fonte canonica per la timeline. Aggiorneremo questo post il giorno in cui le tariffe vengono pubblicate.
Gemini Omni è più economico di GPT-4o?
Dipende dal carico di lavoro. Per l'output video, Omni è l'unica opzione del Big-3 che lo produce in una sola chiamata, poiché GPT-4o non genera video. Per il lavoro solo testo, GPT-4o-mini a $0,15/$0,60 per milione di token batte le tariffe Omni proiettate di circa 3×. Scegli il modello che corrisponde alle modalità che la tua pipeline produce davvero.
Cosa sostituisce Gemini Omni nel mio stack?
Per i flussi di lavoro video multimodali, Omni sostituisce quattro chiamate API separate: Whisper per la trascrizione, GPT-4o Vision per la comprensione delle immagini, GPT-4o per la generazione di testo e Veo 3.1 per la sintesi video. Il guadagno più grande di solito è perdere tre SDK di fornitori, tre SLA e tre tassonomie di errore, non il risparmio grezzo in dollari. Vedi il foglio di calcolo stack-collasso sopra per i calcoli per clip.
Posso usare Gemini Omni tramite API oggi?
No. Al 19 maggio 2026, l'accesso API non è ancora disponibile. L'accesso consumer è attivo tramite i piani dell'app Gemini: AI Plus a $20/mese, AI Pro a $30/mese e AI Ultra a $100/mese, stando al blog sugli abbonamenti AI di Google. Il rilascio API via Vertex AI è "nelle prossime settimane" stando alle parole di Google.
Gemini Omni supporta il fine-tuning?
Non annunciato al giorno del lancio. Veo 3.1 non supporta il fine-tuning, e Omni è costruito sulla stessa base video, quindi presumi nessun fine-tuning al lancio. Google ha storicamente aggiunto il fine-tuning ai modelli multimodali qualche mese dopo la disponibilità generale, quindi una timeline per Q3 o Q4 2026 è plausibile ma non confermata.
Come funziona la fatturazione di Gemini Omni?
Si prevede che segua il pattern standard di Google: tariffe per milione di token per l'input (testo, immagine, audio, frame video) più fatturazione al secondo per l'output video. I livelli Batch (solitamente ~50% di sconto), Flex e Priority sono probabilmente disponibili come per gli altri modelli Gemini. I prezzi per livello di contesto (tariffa 2× oltre i 200k token) si applicano probabilmente data la rapidità con cui i frame video aumentano i conteggi di token.
Qual è la differenza tra Omni Flash e Omni Pro?
Omni Flash è la variante più veloce ed economica, limitata a clip da 10 secondi. Omni Pro gestisce clip più lunghe con fedeltà superiore a un costo proiettato più alto. Entrambi coprono la stessa matrice di modalità (testo, immagine, audio, video in; video out oggi). Google chiama il limite di 10 secondi di Flash "una scelta di deployment, non un vincolo del modello", quindi aspettati che si estenda.
Gemini Omni sostituirà GPT-4o per la mia automazione Instagram?
Dipende da cosa generi. Per i Reels (output video): sì, alla fine, poiché Omni è l'unica opzione con una singola chiamata per la sintesi video da 30 secondi. Per i post statici con didascalie AI e hashtag: probabilmente no. GPT-4o-mini batte ancora le tariffe Omni proiettate di circa 3× sul costo, e la catena n8n + GPT-4o-mini è già collaudata in produzione.
In Conclusione
Tre cose da portare a casa:
- I prezzi API di Gemini Omni non sono pubblicati al 19 maggio 2026. La riga nella pagina dei prezzi è vuota, i piani consumer sono attivi a $20–$100/mese, e l'accesso API via Vertex AI è "nelle prossime settimane."
- Banda proiettata: $1,50–$2,50 per milione di token in input e $0,20–$0,60 al secondo di output video, ancorati a Veo 3.1 e Gemini 3.5 Flash. Audio in input stimato a $3–$5 per milione di token. Tutti i numeri sono proiezioni, non fatti.
- Il risparmio da stack-collasso non è sempre in dollari. È perdere 3 fornitori, 3 SDK e 3 SLA in un'unica chiamata multimodale. Pianifica la migrazione attorno al consolidamento dei fornitori e alla latenza, non al $/clip grezzo.
Ultima verifica: 19 maggio 2026 (SLA di aggiornamento: 24 ore dopo la pubblicazione delle tariffe da parte di Google). Aggiornerò questo post il giorno in cui Google pubblica le tariffe API. Aggiungilo ai segnalibri.
Il team editoriale di Techsy ha realizzato pipeline multimodali su GPT-4o + Veo 3.1 + Whisper dal 2024. Aggiorniamo questo post quando Google pubblica le tariffe Omni.