ai-machine-learning

Claude Sonnet 5: Cosa c'è di Nuovo e Quanto Costa Davvero

Scritto da Mert Batur
Aggiornato Jun 30, 2026
17 lettura
Claude Sonnet 5: Cosa c'è di Nuovo e Quanto Costa Davvero

Claude Sonnet 5: Cosa c'è di Nuovo e Quanto Costa Davvero

Claude Sonnet 5 è uscito oggi, 30 giugno 2026, e Anthropic ha fissato il prezzo del tier introduttivo a $2 per milione di token di input. La maggior parte degli articoli si ferma qui. Il numero che incide davvero sul tuo conto è un altro: quanto costa un'intera esecuzione di un agente, una volta aggiunti i token di output e una dozzina di scambi avanti e indietro? Anthropic afferma che Sonnet 5 arriva "vicino a Opus 4.8" per circa un terzo del prezzo. Quindi la vera domanda non è la scheda tecnica. È se il costo mensile del tuo agente è appena sceso, e di quanto.

Punti chiave:

  • Claude Sonnet 5 è stato lanciato il 30 giugno 2026, sostituendo Sonnet 4.6 come modello agente mid-tier di Anthropic.
  • Il prezzo introduttivo è $2/M input e $10/M output fino al 31 agosto 2026, poi $3/$15.
  • Anthropic dice che le prestazioni sono "vicine a Opus 4.8" a circa un terzo del costo di Opus.
  • È il modello predefinito per Claude Free e Pro, disponibile via API e Claude Code come claude-sonnet-5.

Cos'è Claude Sonnet 5? (risposta in 30 secondi)

Claude Sonnet 5 è il nuovo modello mid-tier di Anthropic, lanciato il 30 giugno 2026 e descritto nel suo post di lancio come il Sonnet più agente di sempre. Sa pianificare task, usare strumenti come browser e terminali e girare in autonomia. Il prezzo introduttivo è $2/M input e $10/M output, ed è ora il modello predefinito per Claude Free e Pro.

Sì, è uscito oggi, nel caso in cui tu abbia visto la confusione che circolava su "Claude Sonnet 5 è già stato rilasciato?". Lo selezioni con la stringa modello claude-sonnet-5 nell'API o in Claude Code. Anthropic lo posiziona come un passo significativo rispetto a Sonnet 4.6 e dice che la qualità è vicina al suo modello di punta, Opus 4.8, senza il prezzo del modello di punta.

La scommessa dietro tutto ciò: Claude Sonnet 5 è la puntata di Anthropic sul fatto che la maggior parte del lavoro agente non ha più bisogno di un modello frontier. Se questo regge, la storia interessante non è il salto di capacità. È l'economia.

Cosa c'è di Nuovo rispetto a Sonnet 4.6 e Opus 4.8

Anthropic definisce Sonnet 5 "un miglioramento sostanziale rispetto al predecessore, Sonnet 4.6" su reasoning, uso di strumenti, programmazione e knowledge work, con prestazioni "vicine a quelle di Opus 4.8, ma a prezzi più bassi". Verifica il proprio output senza che glielo si chieda, ed è più forte nel coding prolungato, nel debug e nell'uso di strumenti in più step. Queste sono le formulazioni di Anthropic, non le nostre misurazioni.

Aggiornamenti agentici

Il cambiamento principale è l'autonomia. Sonnet 5 è costruito per pianificare un task, raccogliere strumenti come browser e terminali e portare avanti esecuzioni lunghe senza bisogno di supervisione. Come riporta TechCrunch (citando Anthropic), il modello è presentato come un modo più economico di mantenere gli agenti in esecuzione, con segnali iniziali da parte di clienti come Zapier e Lovable. È il caso d'uso che Anthropic sta inseguendo: agenti che girano per minuti o ore, dove ogni turno aggiunge token.

Come si confronta con Opus 4.8 sulla carta

Questa è la parte che conta per il budget. Il gap di capacità si è ridotto; quello di prezzo no.

ModelloInput $/MOutput $/MIntro vs standardPosizionamento
Claude Sonnet 5$2 (intro) → $3$10 (intro) → $15Intro fino al 31 ago 2026Mid-tier, Sonnet più agente; "vicino a Opus 4.8" (Anthropic)
Claude Sonnet 4.6$3$15StandardMid-tier precedente (feb 2026)
Claude Opus 4.8$5 ($10 Fast Mode)$25 ($50 Fast Mode)StandardModello di punta; reasoning più difficile a lungo orizzonte

Nota il prezzo standard di Sonnet 5 ($3/$15): è identico a Sonnet 4.6. Ottieni un modello più capace allo stesso prezzo di listino. E rispetto ai $5/$25 di Opus 4.8, Sonnet 5 standard gira a circa il 60% della tariffa di input e output. Durante la finestra introduttiva è ancora più conveniente. Anthropic non ha pubblicato un numero che dica che Sonnet 5 supera Opus 4.8, quindi non leggerlo così: la dichiarazione ufficiale è "vicino a", e noi la teniamo per buona.

Quanto Costa Davvero Claude Sonnet 5? (economia dei token)

Claude Sonnet 5 costa $2/M input e $10/M output durante la finestra introduttiva fino al 31 agosto 2026, poi sale a $3/M input e $15/M output. Quel prezzo standard è uguale a Sonnet 4.6 per un modello più capace, e si attesta a circa un terzo della tariffa standard di Opus 4.8 ($5/$25). Per il lavoro agente ad alto volume, questo rapporto è tutto.

Allora cosa significa concretamente "per milione di token"? Un token è circa tre quarti di una parola. Un milione di token è molto testo, forse 750.000 parole, ma gli agenti li bruciano in fretta perché ogni turno rispedisce il contesto: il prompt di sistema, i messaggi precedenti, il contenuto dei file, gli output degli strumenti. Un singolo refactor multi-file può consumare centinaia di migliaia di token di input prima di finire.

Quella finestra introduttiva è un vero momento di decisione. Fino al 31 agosto paghi $2/$10. Dopo, $3/$15. Se hai intenzione di testare Sonnet 5 comunque, farlo adesso significa che le tue valutazioni girano con lo sconto, e consolidi le abitudini mentre la matematica è più favorevole. Il rovescio della medaglia: non costruire un budget sul prezzo introduttivo che perderai in due mesi.

Due funzionalità della piattaforma cambiano il conto reale più della tariffa di listino. Il prompt caching ti permette di riutilizzare un contesto già in cache invece di pagare il prezzo pieno di input a ogni turno, per un risparmio fino a circa il 90% sulla parte memorizzata. Il batch processing taglia i costi di circa il 50% per lavori non urgenti che puoi eseguire in modo asincrono. Entrambe sono documentate nei prezzi della piattaforma Anthropic. Se il tuo agente rispedisce lo stesso grande prompt di sistema o codebase a ogni turno, il prompt caching è la leva più efficace che hai sul costo. Approfondiremo altre tattiche nella nostra guida su come ridurre i costi dell'API LLM.

Confronto tra prestazioni di ricerca agente Claude Sonnet 5 e costo per task su BrowseComp, rispetto a Opus 4.8 e Sonnet 4.6
Prestazioni di ricerca agente vs costo per task (BrowseComp): Sonnet 5 si avvicina all'accuratezza di Opus 4.8 a una frazione del costo. Fonte: Anthropic

A $2 per milione di token di input, Sonnet 5 rende i loop agente ad alto volume abbastanza economici da lasciarli girare. Questo è il cambiamento. La domanda non è più "posso permettermi di eseguire questo agente?" ma "quanti ne posso eseguire contemporaneamente?"

Quanto Costa Davvero un'Esecuzione Reale con Sonnet 5 (riproducibile)

Mettiamoci un numero. Non abbiamo eseguito un benchmark in laboratorio, e non fingiamo di averlo fatto. Quello che segue è un calcolo trasparente che puoi riprodurre con i tuoi conteggi di token, utilizzando le tariffe per token pubblicate da Anthropic. Dichiara le tue assunzioni, fai l'aritmetica e il conto viene fuori.

Il calcolo passo per passo

Prendiamo un task agente realistico: un refactor multi-file che gira per circa 12 turni. Ipotizziamo circa 40K token di input e 8K di output per turno (caching disattivato), perché ogni turno rispedisce un contesto crescente. Sono circa 480K token di input e 96K di output in totale. Ecco la matematica:

  • Sonnet 5 intro: (0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
  • Sonnet 5 standard: (0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
  • Opus 4.8 standard: (0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80

Ora attiva il prompt caching. Se la maggior parte di quei 480K di input è un contesto riutilizzato (prompt di sistema, file tree, turni precedenti) e ottieni un risparmio vicino al ~90% documentato sulla parte memorizzata, la componente di input scende da circa $0.96 a circa $0.10, mentre l'output rimane a $0.96.

Scenario (12 turni, ~480K in / ~96K out, caching disattivato salvo indicazione)Costo inputCosto outputTotale
Sonnet 5 intro ($2/$10)$0.96$0.96$1.92
Sonnet 5 standard ($3/$15)$1.44$1.44$2.88
Opus 4.8 standard ($5/$25)$2.40$2.40$4.80
Sonnet 5 intro + prompt caching (~90% risparmio input)~$0.10$0.96~$1.06

Si tratta di stime modellate utilizzando i prezzi per token pubblici e le assunzioni sui token indicate, un calcolo che puoi riprodurre, non un benchmark che abbiamo eseguito noi. Sostituisci il numero di turni e le dimensioni dei token con i tuoi e la struttura tiene. Fai i conti tu stesso: lo stesso task agente costa circa $1.92 su Sonnet 5 intro contro $4.80 su Opus 4.8 standard, e il caching può far scendere l'esecuzione Sonnet 5 a circa $1.06. Su mille di quelle esecuzioni al mese, la differenza è tra un conto di circa $1,900 e uno di circa $4,800.

Selezionare il modello e misurare il proprio costo

Non devi fidarti delle nostre assunzioni. Punta il modello sul tuo workload reale e leggi i conteggi token effettivi. In Claude Code, imposta il modello con un flag o nelle impostazioni del progetto:

bash
# Una tantum
claude --model claude-sonnet-5

# Oppure fissalo in .claude/settings.json
{
  "model": "claude-sonnet-5"
}

Nell'API Anthropic, la stringa modello è la stessa, e ogni risposta ti restituisce l'utilizzo esatto dei token:

python
import anthropic

client = anthropic.Anthropic()

resp = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)

# Leggi i numeri reali per calcolare il tuo costo
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)

Moltiplica input_tokens per la tua tariffa di input, output_tokens per la tua tariffa di output, somma i turni e hai il costo reale di quel task. Il campo cache_read_input_tokens mostra quanto hai risparmiato davvero con il caching. Nella nostra esperienza di routing di modelli per i clienti, il costo per task è ciò che muove il conto mensile, non il prezzo per token di listino, e l'unico modo onesto di conoscerlo è leggere l'oggetto usage sul proprio traffico.

Quando Sonnet 5 è la Scelta Giusta (casi d'uso reali)

Sonnet 5 è la scelta giusta per il lavoro agente e di coding ad alto volume dove il costo per task decide il conto, che è la maggior parte del lavoro agente in produzione. Passa a Opus 4.8 solo quando un singolo passo sbagliato è abbastanza costoso da giustificare il premium. Per tutto ciò che cicla, riprova e rispedisce contesto, la tariffa mid-tier si accumula a tuo favore.

Scelte concrete:

  • Agenti di coding. I refactor multi-file, la generazione di test e le sessioni di debug consumano token su molti turni, quindi una tariffa per turno più bassa conta di più qui. Vedi il nostro roundup degli agenti AI di coding per capire come si posiziona.
  • Automazione browser e terminale. Le esecuzioni autonome lunghe sono esattamente ciò per cui Anthropic ha costruito gli aggiornamenti agentici, ed esattamente dove i costi si accumulano.
  • Pipeline di knowledge work. Summarization, estrazione e loop di ricerca che girano in scala beneficiano del caching più la tariffa mid-tier.
  • Agenti rivolti ai clienti. Un volume elevato di richieste trasforma un piccolo risparmio per task in uno grande su base mensile.

Dove puoi eseguirlo? È il modello predefinito in Claude Code, disponibile tramite API e in rollout sulle principali piattaforme. Se stai scegliendo i tool, il nostro confronto tra Cursor, Copilot e Claude Code copre i trade-off.

Sonnet 5 è Migliore di Opus 4.8, e Quando Vale Ancora Opus?

No, non "migliore" secondo la stessa formulazione di Anthropic. Anthropic dice che Sonnet 5 è "vicino a Opus 4.8", non davanti a esso. Scegli Sonnet 5 per il lavoro agente e di coding ad alto volume e sensibile ai costi. Passa a Opus 4.8 per il reasoning a lungo orizzonte più difficile, dove un passo sbagliato è costoso e l'accuratezza extra vale il premium.

Una rubrica rapida:

  • Loop agente ad alto volume, sensibile ai costi? Sonnet 5.
  • Reasoning più difficile, accuratezza single-shot critica? Opus 4.8.
  • Migrazione da Sonnet 4.6 e attenzione al budget? Sonnet 5 (stesso prezzo standard, più capace).
  • Workload misto? Indirizza il 90% più semplice a Sonnet 5 e scala solo i casi difficili a Opus.

Quell'ultimo schema è dove un LLM gateway per il routing dei modelli e il controllo dei costi paga. Sul fronte competitivo, alcuni outlet notano che Sonnet 5 è più economico di GPT-5.5 per il coding agente, e Gemini 3.1 Pro gioca nello stesso tier. Fai un benchmark sul tuo workload prima di impegnarti, perché il prezzo per task e l'idoneità al task raramente si allineano come suggerisce un leaderboard.

Sonnet 5 non sostituisce Opus 4.8. Sostituisce l'utilizzo di Opus 4.8 per tutto.

Per Cosa Claude Sonnet 5 NON è Indicato? (limiti onesti)

Sonnet 5 è mid-tier, quindi non è la scelta per il reasoning di livello frontier, l'autonomia a più lungo orizzonte o i task single-shot ad accuratezza massima. Per quelli, Opus 4.8 è ancora la scommessa più sicura. L'intera proposta di valore è "vicino al modello di punta per meno", e "vicino" fa davvero un lavoro importante in quella frase.

Un limite specifico da conoscere: Anthropic dice che Sonnet 5 ha "una capacità molto ridotta di eseguire task di cybersecurity rispetto ai nostri attuali modelli Opus", e nota che non ha mai sviluppato un exploit funzionante durante il testing delle vulnerabilità di Firefox. Se lo strumento di sicurezza è il tuo caso d'uso, questa è una scelta di design deliberata, non un bug, ma pianifica di conseguenza.

E non dare per scontato una dimensione della finestra di contesto. Il post di lancio di Anthropic non ne indica una, il che ci porta alle voci.

Le Voci su "Fennec": Cosa è Davvero Confermato (smontare i miti)

Molti numeri che circolano su Sonnet 5 non provengono da Anthropic. Ecco la linea tra il lancio confermato e la narrativa dei leak, con ogni voce attribuita a pagine di aggregatori e leak, non al post ufficiale.

  • Il codename "Fennec". Voce non confermata. Quell'identificatore è trapelato da un log di Vertex AI mesi prima e storicamente puntava a Sonnet 4.6, non a Sonnet 5. Anthropic non ha annunciato nessun codename.
  • "Finestra di contesto da 1M di token." Non indicata da nessuna parte nel post di lancio ufficiale. Tratta qualsiasi numero specifico sulla finestra di contesto come non verificato finché Anthropic non ne pubblica uno.
  • "82,1% / 92,4% SWE-bench." Invenzioni degli aggregatori. Cita solo le cifre dal post ufficiale o dalla system card; ignora il resto.
  • "Rilascio il 1° aprile", "addestrato su Google TPU", "Dev Team Mode". Falso o non confermato. Il lancio è il 30 giugno 2026 e nessuna di quelle funzionalità o affermazioni compare nei materiali di Anthropic.

Anthropic non ha mai annunciato il codename "Fennec" per Sonnet 5. Quell'identificatore è trapelato da un log di Vertex AI mesi prima e puntava a un modello diverso. Se una pagina cita un benchmark preciso senza link alla system card, trattalo come rumore.

Conviene Passare da Sonnet 4.6? (verdetto sulla migrazione)

Se sei su Sonnet 4.6, passare a Sonnet 5 è a basso rischio: ottieni un modello più capace allo stesso prezzo standard ($3/$15), e la finestra introduttiva ($2/$10 fino al 31 agosto) rende il testing economico proprio adesso. The New Stack inquadra la cosa come un avvicinamento a Opus 4.8 mantenendo prezzi bassi fino ad agosto, il che è una lettura corretta per i developer che valutano un passaggio.

Qualche avvertimento prima di spostare il traffico di produzione:

  • Cambia la stringa modello in claude-sonnet-5. È l'unica modifica al codice richiesta per la maggior parte delle configurazioni.
  • Ricontrolla le assunzioni su prompt e output. Un modello più capace può cambiare tono, verbosità o formattazione in modi rilevanti a valle.
  • Valida prima sul tuo eval set. Non spostare il traffico di produzione a occhi chiusi.
  • Tieni d'occhio lo step di prezzo del 31 agosto se stai pianificando il budget oltre l'estate.

Il verdetto: allo stesso prezzo standard di Sonnet 4.6 con migliori prestazioni agentiche, restare su 4.6 è la scelta più difficile da giustificare. Passa adesso per sfruttare il prezzo introduttivo, aspetta solo se hai un ciclo di valutazione congelato, e tieni Opus 4.8 riservato per i task più difficili. Se il tuo team sta facendo routing di modelli e gestisce i costi LLM in produzione, offriamo una consulenza gratuita per fare chiarezza.

Sull'Autore

Mert Batur è Co-Founder di Techsy.io, dove il team costruisce agenti AI, sistemi di automazione e pipeline voice/SDR per clienti B2B. Scrive dello stack di tooling LLM che il team di Techsy usa davvero in produzione. Connettiti su LinkedIn.

Credenziali: Co-Founder, Techsy.io. Prezzi verificati rispetto al post di lancio di Anthropic del 2026-06-30.

Domande Frequenti

Claude Sonnet 5 è già stato rilasciato?

Sì. Anthropic ha lanciato Claude Sonnet 5 il 30 giugno 2026 come modello predefinito per Claude Free e Pro, rendendolo disponibile anche agli utenti Max, Team ed Enterprise. Puoi raggiungerlo anche tramite l'API Anthropic e Claude Code usando la stringa modello claude-sonnet-5.

Quanto costa Claude Sonnet 5?

Il prezzo introduttivo è $2 per milione di token di input e $10 per milione di token di output fino al 31 agosto 2026. Dopo quella data, passa al prezzo standard di $3 per milione di input e $15 per milione di output, la stessa tariffa standard di Sonnet 4.6 per un modello più capace.

Claude Sonnet 5 è davvero migliore di Opus 4.8?

Non secondo la descrizione di Anthropic stessa. Anthropic dice che le prestazioni di Sonnet 5 sono "vicine a Opus 4.8", non superiori. Per il reasoning a lungo orizzonte più difficile, dove un singolo passo sbagliato è costoso, Opus 4.8 è ancora la scelta più solida. Sonnet 5 vince sul costo per task, girando a circa un terzo del prezzo standard di Opus.

Qual è la finestra di contesto di Claude Sonnet 5?

Il post di lancio di Anthropic non indica una dimensione della finestra di contesto. Le affermazioni di "1M di token" che circolano sulle pagine degli aggregatori non sono confermate e non provengono da Anthropic. Finché Anthropic non pubblica un numero ufficiale, tratta qualsiasi cifra specifica sulla finestra di contesto come non verificata.

Come si usa Claude Sonnet 5?

Imposta la stringa modello su claude-sonnet-5 nell'API Anthropic, oppure selezionalo in Claude Code con claude --model claude-sonnet-5 o nelle impostazioni del progetto. È anche il modello predefinito per Claude Free e Pro, quindi non è necessaria nessuna configurazione. Leggi l'oggetto usage della risposta per tracciare i costi token reali.

Il codename di Claude Sonnet 5 è "Fennec"?

Non c'è nessuna conferma. "Fennec" è un identificatore trapelato che storicamente puntava a Sonnet 4.6, e Anthropic non ha annunciato nessun codename per Sonnet 5. L'identificatore è emerso in un log di Vertex AI mesi prima di questo lancio, quindi tratta qualsiasi affermazione "Fennec uguale Sonnet 5" come una voce non confermata.

Conviene passare da Sonnet 4.6 a Sonnet 5?

Probabilmente sì. Sonnet 5 gira allo stesso prezzo standard di Sonnet 4.6 ($3/$15) con migliori prestazioni agentiche, e la finestra introduttiva rende il testing economico fino al 31 agosto. Cambia la stringa modello, valida sul tuo eval set e controlla il comportamento prima di spostare il traffico di produzione.

Come si confronta Sonnet 5 con GPT-5.5 per il coding?

Sonnet 5 è l'opzione di coding agente competitiva sui costi di Anthropic, e alcuni outlet riportano che è più economico di GPT-5.5. I confronti di capacità dipendono dal workload, quindi fai un benchmark di entrambi sul tuo codebase e mix di task prima di impegnarti. Il prezzo per task e l'idoneità al task raramente si allineano come implica un singolo leaderboard.

Posso eseguire Claude Sonnet 5 su AWS Bedrock?

Anthropic rende i modelli Sonnet disponibili sulle principali piattaforme cloud, quindi la disponibilità di claude-sonnet-5 su Bedrock e Vertex dovrebbe seguire man mano che il rollout si completa. Controlla lo stato attuale della piattaforma per la tua regione, poiché i lanci in giornata spesso raggiungono l'API first-party e Claude Code prima di ogni piattaforma di terze parti.

Come posso ridurre i costi di Claude Sonnet 5?

Usa il prompt caching per un risparmio fino a circa il 90% sul contesto riutilizzato, e il batch processing per circa il 50% di risparmio sui lavori non urgenti. Indirizza solo i task più difficili a Opus 4.8 e mantieni il lavoro ad alto volume su Sonnet 5. Leggi l'oggetto usage per vedere esattamente dove vanno i tuoi token.

Tag

claude sonnet 5claude sonnet 5 pricingclaude sonnet 5 vs opus 4.8llm costanthropic

Condividi questo articolo

Il Tuo Prossimo Passo

Hai un progetto in mente? Parliamone.

Prenota una call di 30 minuti. Ti ascoltiamo, capiamo il problema e ti diciamo se possiamo aiutarti.