
Claude Sonnet 5: Ce e nou și cât costă de fapt să-l rulezi
Claude Sonnet 5 a ajuns azi, 30 iunie 2026, iar Anthropic a stabilit prețul nivelului introductiv la 2$ per milion de tokeni de intrare. Aici se opresc majoritatea articolelor. Numărul care îți mișcă de fapt factura e altul: cât costă o rulare completă de agent, după ce adaugi tokenii de ieșire și o duzină de schimburi dus-întors? Anthropic spune că Sonnet 5 ajunge „aproape de Opus 4.8" pentru aproximativ o treime din preț. Așa că întrebarea reală nu e fișa tehnică. E dacă costul lunar al agentului tău tocmai a scăzut și cu cât.
Idei principale:
- Claude Sonnet 5 a fost lansat pe 30 iunie 2026, înlocuind Sonnet 4.6 ca model agentic de nivel mediu al Anthropic.
- Prețul introductiv e de 2$/M la intrare și 10$/M la ieșire până pe 31 august 2026, apoi 3$/15$.
- Anthropic spune că performanța e „aproape de Opus 4.8" la aproximativ o treime din costul Opus.
- E modelul implicit pentru Claude Free și Pro, disponibil prin API și Claude Code ca
claude-sonnet-5.
Ce e Claude Sonnet 5? (răspunsul în 30 de secunde)
Claude Sonnet 5 e noul model de nivel mediu al Anthropic, lansat pe 30 iunie 2026 și descris în postarea de lansare drept cel mai agentic Sonnet de până acum. Poate face planuri, poate folosi instrumente precum browsere și terminale și poate rula autonom. Prețul introductiv e de 2$/M la intrare și 10$/M la ieșire, iar acum e modelul implicit pentru Claude Free și Pro.
Da, a fost lansat azi, în caz că ai văzut confuzia „a fost lansat Claude Sonnet 5?" care circulă. Îl selectezi cu șirul de model claude-sonnet-5 în API sau în Claude Code. Anthropic îl poziționează ca un pas semnificativ față de Sonnet 4.6 și spune că calitatea e aproape de modelul său emblematic, Opus 4.8, fără prețul de model emblematic.
Iată pariul din spatele lui: Claude Sonnet 5 e miza Anthropic că majoritatea muncii de agent nu mai are nevoie de un model de frontieră. Dacă se confirmă, povestea interesantă nu e saltul de performanță. E economia.
Ce e nou față de Sonnet 4.6 și Opus 4.8
Anthropic numește Sonnet 5 „o îmbunătățire substanțială față de predecesorul său, Sonnet 4.6" la capitolul raționament, utilizarea instrumentelor, programare și muncă de cunoaștere, cu performanțe „aproape de cele ale Opus 4.8, dar la prețuri mai mici." Își verifică propriul output fără să i se ceară și e mai puternic la programare susținută, depanare și utilizarea instrumentelor în mai mulți pași. Acestea sunt formulările Anthropic, nu măsurătorile noastre.
Îmbunătățiri agentice
Schimbarea de titlu e autonomia. Sonnet 5 e construit să planifice o sarcină, să preia instrumente precum browsere și terminale și să ruleze prin execuții lungi fără supraveghere. După cum raportează TechCrunch (citând Anthropic), modelul e prezentat ca o modalitate mai ieftină de a ține agenții în funcțiune, cu semnale timpurii de la clienți precum echipele de la Zapier și Lovable. Acesta e cazul de utilizare pe care Anthropic îl urmărește: agenți care rulează în buclă minute sau ore întregi, unde fiecare tură adaugă tokeni.
Cum se compară cu Opus 4.8 pe hârtie
Iată partea care contează pentru bugetare. Decalajul de performanță s-a redus; decalajul de preț, nu.
| Model | Intrare $/M | Ieșire $/M | Introductiv vs standard | Poziționare |
|---|---|---|---|---|
| Claude Sonnet 5 | 2$ (introductiv) → 3$ | 10$ (introductiv) → 15$ | Introductiv până pe 31 aug 2026 | Nivel mediu, cel mai agentic Sonnet; „aproape de Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | 3$ | 15$ | Standard | Nivelul mediu anterior (feb 2026) |
| Claude Opus 4.8 | 5$ (10$ Fast Mode) | 25$ (50$ Fast Mode) | Standard | Model emblematic; cel mai dificil raționament pe termen lung |
Observă că prețul standard al Sonnet 5 (3$/15$) e identic cu cel al Sonnet 4.6. Primești un model mai capabil la același preț de listă. Iar față de cei 5$/25$ ai Opus 4.8, Sonnet 5 standard rulează la aproximativ 60% din tariful de intrare și din cel de ieșire. În fereastra introductivă e și mai ieftin. Anthropic nu a publicat niciun număr care să spună că Sonnet 5 bate Opus 4.8, așa că nu citi în acest fel: linia oficială e „aproape de" și ne ținem de ea.
Cât costă de fapt Claude Sonnet 5? (economia tokenilor)
Claude Sonnet 5 costă 2$/M la intrare și 10$/M la ieșire în fereastra introductivă, până pe 31 august 2026, apoi crește la 3$/M la intrare și 15$/M la ieșire. Prețul standard e identic cu al Sonnet 4.6 pentru un model mai puternic și ajunge la aproximativ o treime din tariful standard al Opus 4.8 (5$/25$). Pentru munca de agent la volum mare, acest raport e toată povestea.
Deci ce înseamnă de fapt „per milion de tokeni" pentru tine? Un token e aproximativ trei sferturi de cuvânt. Un milion de tokeni înseamnă mult text, poate 750.000 de cuvinte, dar agenții îi consumă rapid, pentru că fiecare tură retrimite contextul: promptul de sistem, mesajele anterioare, conținutul fișierelor, outputurile instrumentelor. O singură refactorizare pe mai multe fișiere poate consuma sute de mii de tokeni de intrare înainte să se termine.
Fereastra introductivă e un punct de decizie real. Până pe 31 august plătești 2$/10$. După aceea, 3$/15$. Dacă oricum ai de gând să testezi Sonnet 5, făcând-o acum înseamnă că evaluările tale rulează la reducere și îți fixezi obiceiurile cât timp calculele sunt cele mai favorabile. Cealaltă față: nu construi un buget pe prețuri introductive pe care le pierzi în două luni.
Două funcții ale platformei schimbă factura reală mai mult decât tariful de titlu. Prompt caching îți permite să reutilizezi un context memorat în cache în loc să plătești prețul complet de intrare la fiecare tură, cu economii de până la aproximativ 90% pe porțiunea din cache. Procesarea batch reduce costurile cu aproximativ 50% pentru sarcinile neurgente pe care le poți rula asincron. Ambele sunt documentate în prețurile platformei Anthropic. Dacă agentul tău retrimite același prompt de sistem mare sau aceeași bază de cod la fiecare tură, prompt caching e cea mai mare pârghie pe care o ai asupra costului. Intrăm în mai multe tactici în ghidul nostru despre reducerea costurilor API LLM.

La 2$ per milion de tokeni de intrare, Sonnet 5 face buclele de agent la volum mare suficient de ieftine încât să le lași să ruleze. Asta e schimbarea. Întrebarea nu mai e „îmi permit să rulez acest agent?", ci „câți dintre ei pot rula simultan?"
Cât costă de fapt o rulare reală de agent Sonnet 5 (reproductibil)
Hai să punem un număr pe asta. Nu am rulat un benchmark de laborator și nu vom pretinde că am făcut-o. Ce urmează e un calcul transparent pe care îl poți reproduce cu propriile tale numere de tokeni, folosind tarifele per token publicate de Anthropic. Îți declari ipotezele, faci aritmetica și factura rezultă.
Calculul detaliat
Ia o sarcină de agent realistă: o refactorizare pe mai multe fișiere care rulează aproximativ 12 ture. Presupunem aproximativ 40K tokeni de intrare și 8K tokeni de ieșire per tură (fără caching), pentru că fiecare tură retrimite un context în creștere. Asta înseamnă aproximativ 480K tokeni de intrare și 96K tokeni de ieșire în total. Acum matematica:
- Sonnet 5 introductiv: (0,48M × 2$) + (0,096M × 10$) = 0,96$ + 0,96$ = 1,92$
- Sonnet 5 standard: (0,48M × 3$) + (0,096M × 15$) = 1,44$ + 1,44$ = 2,88$
- Opus 4.8 standard: (0,48M × 5$) + (0,096M × 25$) = 2,40$ + 2,40$ = 4,80$
Acum activează prompt caching. Dacă mare parte din acei 480K de intrare e un context reutilizat (prompt de sistem, arborele de fișiere, turele anterioare) și obții aproape de economia documentată de ~90% pe porțiunea din cache, partea de intrare scade de la aproximativ 0,96$ la aproximativ 0,10$, în timp ce ieșirea rămâne la 0,96$.
| Scenariu (12 ture, ~480K intrare / ~96K ieșire, fără caching dacă nu se specifică) | Cost intrare | Cost ieșire | Total |
|---|---|---|---|
| Sonnet 5 introductiv (2$/10$) | 0,96$ | 0,96$ | 1,92$ |
| Sonnet 5 standard (3$/15$) | 1,44$ | 1,44$ | 2,88$ |
| Opus 4.8 standard (5$/25$) | 2,40$ | 2,40$ | 4,80$ |
| Sonnet 5 introductiv + prompt caching (~90% economie la intrare) | ~0,10$ | 0,96$ | ~1,06$ |
Acestea sunt estimări modelate folosind prețurile publice per token și ipotezele de tokeni declarate, un calcul pe care îl poți reproduce, nu un benchmark pe care l-am rulat. Înlocuiește cu propriul număr de ture și dimensiuni de tokeni și structura se menține. Fă calculele singur: aceeași sarcină de agent costă aproximativ 1,92$ pe Sonnet 5 introductiv versus 4,80$ pe Opus 4.8 standard, iar cachingul poate coborî rularea Sonnet 5 aproape de 1,06$. La o mie de astfel de rulări pe lună, asta e diferența dintre o factură de ~1.900$ și una de ~4.800$.
Selectarea modelului și măsurarea propriului cost
Nu trebuie să ai încredere în ipotezele noastre. Îndreaptă modelul spre propriul tău flux de lucru și citește numerele reale de tokeni. În Claude Code, setează modelul cu un flag sau în setările proiectului:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}Pe API-ul Anthropic, șirul de model e același și fiecare răspuns îți oferă utilizarea exactă a tokenilor:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Înmulțește input_tokens cu tariful tău de intrare, output_tokens cu tariful tău de ieșire, adună pe toate turele și ai costul real al acelei sarcini. Câmpul cache_read_input_tokens arată cât te-a economisit de fapt cachingul. Din experiența noastră în rutarea modelelor pentru clienți, costul per sarcină e cel care mișcă factura lunară, nu prețul de listă per token, iar singura modalitate sinceră de a-l afla e să citești obiectul usage pe propriul tău trafic.
Unde e Sonnet 5 alegerea potrivită (cazuri de utilizare reale)
Sonnet 5 e alegerea potrivită pentru munca agentică și de programare la volum mare, unde costul per sarcină decide factura, adică majoritatea muncii de agent în producție. Apelează la Opus 4.8 doar când un singur pas greșit e suficient de costisitor încât să justifice prima. Pentru tot ce rulează în buclă, reîncearcă și retrimite context, tariful de nivel mediu se compune în favoarea ta.
Alegeri concrete:
- Agenți de programare. Refactorizările pe mai multe fișiere, generarea de teste și rulările de depanare consumă tokeni pe parcursul multor ture, deci un tarif mai mic per tură contează cel mai mult aici. Vezi sinteza noastră despre agenții de programare AI pentru locul unde se încadrează.
- Automatizare de browser și terminal. Rulările autonome lungi sunt exact ceea ce a construit Anthropic pentru îmbunătățirile agentice și exact unde costul se adună.
- Pipeline-uri de muncă de cunoaștere. Sumarizarea, extragerea și buclele de cercetare care rulează la scară beneficiază de caching plus tariful de nivel mediu.
- Agenți orientați spre clienți. Volumul mare de cereri transformă o mică economie per sarcină într-una lunară mare.
Unde îl poți rula? E implicit în Claude Code, disponibil prin API și se lansează treptat pe platformele majore. Dacă alegi instrumentele, comparația noastră dintre Cursor și Copilot cu Claude Code acoperă compromisurile.
E Sonnet 5 mai bun decât Opus 4.8 și când mai merită Opus?
Nu, nu „mai bun" după propria formulare a Anthropic. Anthropic spune că Sonnet 5 e „aproape de Opus 4.8", nu înaintea lui. Alege Sonnet 5 pentru munca agentică și de programare la volum mare, sensibilă la cost. Apelează la Opus 4.8 pentru cel mai dificil raționament pe termen lung, unde un singur pas greșit e costisitor și acuratețea suplimentară își câștigă prima.
Un rubric rapid:
- Bucle de agent la volum mare, sensibil la cost? Sonnet 5.
- Cel mai dificil raționament, acuratețe critică dintr-o singură încercare? Opus 4.8.
- Migrezi de la Sonnet 4.6 și urmărești bugetul? Sonnet 5 (același preț standard, mai capabil).
- Flux de lucru mixt? Routează cei 90% ușori către Sonnet 5 și escalează doar cazurile dificile către Opus.
Acest ultim tipar e locul unde un gateway LLM pentru rutarea modelelor și controlul costului își merită banii. Pe cadrul competitiv, unele publicații observă că Sonnet 5 subcotă GPT-5.5 la preț pentru programare agentică, iar Gemini 3.1 Pro joacă în același nivel. Fă benchmark pe propriul tău flux de lucru înainte să te angajezi, pentru că prețul per sarcină și potrivirea pe sarcină rar se aliniază așa cum sugerează un clasament.
Sonnet 5 nu înlocuiește Opus 4.8. Înlocuiește folosirea Opus 4.8 pentru orice.
Pentru ce NU e bun Claude Sonnet 5? (limite sincere)
Sonnet 5 e de nivel mediu, deci nu e alegerea pentru raționament de nivel frontieră, cea mai lungă autonomie pe termen lung sau sarcini cu acuratețe maximă dintr-o singură încercare. Pentru acestea, Opus 4.8 e încă pariul mai sigur. Întreaga propunere de valoare e „aproape de modelul emblematic, pentru mai puțin", iar „aproape" face muncă reală în acea propoziție.
O limită specifică pe care merită să o știi: Anthropic spune că Sonnet 5 are „o capacitate mult mai scăzută de a îndeplini sarcini de securitate cibernetică decât modelele noastre Opus actuale" și observă că nu a dezvoltat niciodată un exploit funcțional în timpul testării vulnerabilităților Firefox. Dacă instrumentele de securitate sunt cazul tău de utilizare, asta e o alegere de design deliberată, nu un bug, dar planifică în consecință.
Și nu presupune o dimensiune a ferestrei de context. Postarea de lansare a Anthropic nu menționează una, ceea ce ne aduce la zvonuri.
Zvonurile „Fennec": ce e de fapt confirmat (demontarea miturilor)
O mulțime de numere care circulă despre Sonnet 5 nu au venit de la Anthropic. Iată linia dintre lansarea confirmată și narațiunea scurgerilor, cu fiecare zvon atribuit paginilor de agregare și de scurgeri, nu postării oficiale.
- Numele de cod „Fennec". Neconfirmat. Acel identificator a fost scurs dintr-un jurnal Vertex AI cu luni înainte și corespundea istoric lui Sonnet 4.6, nu Sonnet 5. Anthropic nu a anunțat niciun nume de cod.
- „Fereastră de context de 1M tokeni". Nu e menționată nicăieri în postarea oficială de lansare. Tratează orice număr specific de fereastră de context ca neverificat până când Anthropic publică unul.
- „82,1% / 92,4% SWE-bench". Fabricații ale agregatoarelor. Citează doar cifrele din postarea oficială sau din fișa de sistem; ignoră restul.
- „Lansare pe 1 aprilie", „antrenat pe TPU-uri Google", „Dev Team Mode". False sau neconfirmate. Lansarea e pe 30 iunie 2026 și niciuna dintre aceste funcții sau afirmații nu apare în materialele Anthropic.
Anthropic nu a anunțat niciodată un nume de cod „Fennec" pentru Sonnet 5. Acel identificator a fost scurs dintr-un jurnal Vertex AI cu luni înainte și indica un model diferit. Dacă o pagină citează un benchmark precis fără link către fișa de sistem, trateaz-o ca zgomot.
Ar trebui să treci de la Sonnet 4.6? (verdictul de migrare)
Dacă ești pe Sonnet 4.6, trecerea la Sonnet 5 e cu risc scăzut: primești un model mai capabil la același preț standard (3$/15$), iar fereastra introductivă (2$/10$ până pe 31 august) face testarea ieftină chiar acum. The New Stack o prezintă ca reducerea decalajului față de Opus 4.8, rămânând ieftin până în august, ceea ce e o lectură corectă pentru dezvoltatorii care cântăresc o mutare.
Câteva capcane înainte să comuți traficul de producție:
- Schimbă șirul de model în
claude-sonnet-5. Asta e singura modificare de cod necesară pentru majoritatea configurațiilor. - Reverifică orice ipoteză de prompt sau de output. Un model mai capabil poate schimba tonul, verbozitatea sau formatarea în moduri care contează în aval.
- Validează mai întâi pe setul tău de evaluare. Nu schimba traficul de producție pe baza intuiției.
- Urmărește creșterea de preț din 31 august dacă bugetezi dincolo de vară.
Verdictul: la același preț standard ca Sonnet 4.6, cu performanță agentică mai bună, rămânerea pe 4.6 e alegerea mai greu de justificat. Treci acum ca să prinzi prețul introductiv, așteaptă doar dacă ai un ciclu de evaluare înghețat și păstrează Opus 4.8 rezervat pentru cele mai dificile sarcini. Dacă echipa ta rutează modele și se luptă cu costul LLM în producție, oferim o consultație gratuită pentru a o planifica.
Despre autor
Mert Batur Gurbuz este cofondator al Techsy.io, unde echipa livrează agenți AI, sisteme de automatizare și pipeline-uri vocale/SDR pentru clienți B2B. Studiază la University of Birmingham și scrie despre stack-ul de instrumente LLM pe care echipa Techsy îl folosește de fapt în producție. Conectează-te pe LinkedIn.
Calificări: Cofondator, Techsy.io, University of Birmingham. Prețuri verificate față de postarea de lansare a Anthropic pe 30.06.2026.
Întrebări frecvente
A fost lansat Claude Sonnet 5?
Da. Anthropic a lansat Claude Sonnet 5 pe 30 iunie 2026, ca model implicit pentru Claude Free și Pro, și l-a pus la dispoziția utilizatorilor Max, Team și Enterprise. Îl poți accesa și prin API-ul Anthropic și Claude Code folosind șirul de model claude-sonnet-5.
Cât costă Claude Sonnet 5?
Prețul introductiv e de 2$ per milion de tokeni de intrare și 10$ per milion de tokeni de ieșire până pe 31 august 2026. După aceea, trece la prețul standard de 3$ per milion la intrare și 15$ per milion la ieșire, același tarif standard ca Sonnet 4.6 pentru un model mai capabil.
E Claude Sonnet 5 de fapt mai bun decât Opus 4.8?
Nu după propria descriere a Anthropic. Anthropic spune că performanța Sonnet 5 e „aproape de Opus 4.8", nu mai bună. Pentru cel mai dificil raționament pe termen lung, unde un singur pas greșit e costisitor, Opus 4.8 e încă alegerea mai puternică. Sonnet 5 câștigă la costul per sarcină, rulând la aproximativ o treime din prețul standard al Opus.
Care e fereastra de context a Claude Sonnet 5?
Postarea de lansare a Anthropic nu menționează o dimensiune a ferestrei de context. Afirmațiile de „1M tokeni" care circulă pe paginile de agregare sunt neconfirmate și nu au venit de la Anthropic. Până când Anthropic publică un număr oficial, tratează orice cifră specifică de fereastră de context ca neverificată.
Cum folosesc Claude Sonnet 5?
Setează șirul de model pe claude-sonnet-5 în API-ul Anthropic sau selectează-l în Claude Code cu claude --model claude-sonnet-5 sau în setările proiectului. E și modelul implicit pentru Claude Free și Pro, deci acolo nu e nevoie de configurare. Citește obiectul usage din răspuns pentru a urmări costurile reale ale tokenilor.
Are Claude Sonnet 5 numele de cod „Fennec"?
Nu există nicio confirmare. „Fennec" e un identificator scurs care corespundea istoric lui Sonnet 4.6, iar Anthropic nu a anunțat niciun nume de cod pentru Sonnet 5. Identificatorul a apărut într-un jurnal Vertex AI cu luni înainte de această lansare, deci tratează orice afirmație „Fennec egal Sonnet 5" ca un zvon neverificat.
Ar trebui să trec de la Sonnet 4.6 la Sonnet 5?
Probabil da. Sonnet 5 rulează la același preț standard ca Sonnet 4.6 (3$/15$) cu performanță agentică mai bună, iar fereastra introductivă face testarea ieftină până pe 31 august. Schimbă șirul de model, validează pe setul tău de evaluare și verifică comportamentul înainte să comuți traficul de producție.
Cum se compară Sonnet 5 cu GPT-5.5 pentru programare?
Sonnet 5 e opțiunea competitivă ca preț a Anthropic pentru programare agentică, iar unele publicații raportează că subcotă GPT-5.5 la preț. Comparațiile de performanță depind de fluxul de lucru, deci fă benchmark pe ambele cu propria ta bază de cod și propriul mix de sarcini înainte să te angajezi. Prețul per sarcină și potrivirea pe sarcină rar se aliniază așa cum sugerează un singur clasament.
Pot rula Claude Sonnet 5 pe AWS Bedrock?
Anthropic pune modelele Sonnet la dispoziție pe platformele cloud majore, deci disponibilitatea pe Bedrock și Vertex pentru claude-sonnet-5 ar trebui să urmeze pe măsură ce lansarea se finalizează. Verifică starea actuală a platformei pentru regiunea ta, deoarece lansările din aceeași zi ajung adesea mai întâi pe API-ul first-party și în Claude Code, înaintea fiecărei platforme terțe.
Cum pot reduce costurile Claude Sonnet 5?
Folosește prompt caching pentru economii de până la aproximativ 90% pe contextul reutilizat și procesare batch pentru aproximativ 50% economii pe sarcinile neurgente. Routează doar cele mai dificile sarcini către Opus 4.8 și ține munca la volum mare pe Sonnet 5. Citește obiectul usage pentru a vedea exact unde se duc tokenii tăi.