
Claude Sonnet 5: Hva er nytt, og hva koster det å kjøre?
Claude Sonnet 5 ble lansert i dag, 30. juni 2026, og Anthropic prissatte intro-nivået til $2 per million input-tokens. Der stopper de fleste artikler. Tallet som faktisk påvirker regningen din er et annet: hva koster en full agent-kjøring når du legger til output-tokens og et dusin frem-og-tilbake-runder? Anthropic sier Sonnet 5 kommer "nær Opus 4.8" for omtrent en tredjedel av prisen. Spørsmålet er ikke spesifikasjonsarket. Det er om agentens månedlige kostnad nettopp har falt, og med hvor mye.
Viktige punkter:
- Claude Sonnet 5 ble lansert 30. juni 2026 og erstatter Sonnet 4.6 som Anthropics mellomsjikt-modell for agentarbeid.
- Intro-prising er $2/M input og $10/M output frem til 31. august 2026, deretter $3/$15.
- Anthropic sier ytelsen er "nær Opus 4.8" til omtrent en tredjedel av Opus-prisen.
- Den er standard for Claude Free og Pro, og tilgjengelig via API og Claude Code som
claude-sonnet-5.
Hva er Claude Sonnet 5? (30-sekunders svar)
Claude Sonnet 5 er Anthropics nye mellomsjikt-modell, lansert 30. juni 2026, og omtalt i lanseringsposten som den mest agentiske Sonnet-modellen til nå. Den kan lage planer, bruke verktøy som nettlesere og terminaler, og kjøre autonomt. Intro-prising er $2/M input og $10/M output, og den er nå standardmodellen for Claude Free og Pro.
Ja, den er lansert i dag, i tilfelle du har sett forvirringen rundt "har Claude Sonnet 5 blitt lansert?". Du velger den med modellstrengen claude-sonnet-5 i API-et eller i Claude Code. Anthropic posisjonerer den som et tydelig steg over Sonnet 4.6, og sier at kvaliteten ligger nær flaggskipmodellen, Opus 4.8, uten flaggskipprisen.
Her er veddet under det hele: Claude Sonnet 5 er Anthropics satsing på at de fleste agent-oppgaver ikke lenger trenger en frontier-modell. Holder det stikk, er den interessante historien ikke kapasitetshoppet. Det er økonomien.
Hva er nytt sammenlignet med Sonnet 4.6 og Opus 4.8
Anthropic kaller Sonnet 5 en "vesentlig forbedring over sin forgjenger, Sonnet 4.6" innen resonering, verktøybruk, koding og kunnskapsarbeid, med ytelse "nær Opus 4.8, men til lavere priser." Den sjekker sin egen output uten å bli bedt om det, og er sterkere på vedvarende koding, feilsøking og bruk av verktøy over flere steg. Dette er Anthropics egne fremstillinger, ikke våre målinger.
Agentiske oppgraderinger
Nøkkelendringen er autonomi. Sonnet 5 er bygget for å planlegge en oppgave, ta i bruk verktøy som nettlesere og terminaler, og jobbe seg gjennom lange kjøringer uten å trenge håndholding. TechCrunch rapporterer (med henvisning til Anthropic) at modellen er posisjonert som en billigere måte å holde agenter i gang, med tidlige kundessignaler fra team hos Zapier og Lovable. Det er brukstilfellet Anthropic jakter: agenter som looper i minutter eller timer, der hvert trinn legger til tokens.
Slik stilles den mot Opus 4.8 på papiret
Her er det som betyr noe for budsjettering. Kapasitetsgapet ble mindre; prisdifferansen ble det ikke.
| Modell | Input $/M | Output $/M | Intro vs standard | Posisjonering |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (intro) → $3 | $10 (intro) → $15 | Intro frem til 31. aug. 2026 | Mellomsjikt, mest agentisk Sonnet; "nær Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Standard | Forrige mellomsjikt (feb. 2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Standard | Flaggskip; hardeste langtidsresonering |
Legg merke til at standardprisen for Sonnet 5 ($3/$15) er identisk med Sonnet 4.6. Du får en mer kapabel modell til samme pris. Mot Opus 4.8 sine $5/$25 kjører Sonnet 5 standard på omtrent 60 % av input-raten og output-raten. I intro-vinduet er den enda billigere. Anthropic har ikke publisert et tall som sier at Sonnet 5 slår Opus 4.8, så les det ikke slik: den offisielle linjen er "nær", og vi holder oss til den.
Hva koster Claude Sonnet 5 egentlig? (token-økonomi)
Claude Sonnet 5 koster $2/M input og $10/M output i intro-vinduet frem til 31. august 2026, deretter $3/M input og $15/M output. Den standardprisen matcher Sonnet 4.6 for en sterkere modell, og ligger på omtrent en tredjedel av Opus 4.8 sin standardrate ($5/$25). For høy-volum agentarbeid er det forholdet som er hele poenget.
Hva betyr egentlig "per million tokens" for deg? Et token er omtrent tre fjerdedeler av et ord. En million tokens er mye tekst, kanskje 750 000 ord, men agenter bruker dem fort fordi hvert trinn sender kontekst på nytt: systemprompt, tidligere meldinger, filinnhold, verktøyoutput. En enkelt flerf-fil-refaktor kan svelge hundretusenvis av input-tokens før den er ferdig.
Intro-vinduet er et reelt beslutningspunkt. Frem til 31. august betaler du $2/$10. Etter det, $3/$15. Hvis du uansett skal teste Sonnet 5, betyr det å gjøre det nå at evalueringene dine kjøres til rabattert pris, og du innarbeider vaner mens regnestykket er gunstigst. Baksiden: bygg ikke et budsjett på intro-prising du mister om to måneder.
To plattformfunksjoner endrer regningen mer enn listeprisen. Prompt-caching lar deg gjenbruke en bufret kontekst i stedet for å betale full input-pris for hvert trinn, med opptil omtrent 90 % sparing på den bufrede delen. Batchbehandling kutter kostnadene med omtrent 50 % for ikke-tidssensitive jobber du kan kjøre asynkront. Begge er dokumentert i Anthropics plattformprising. Hvis agenten din sender den samme store systemprompt eller kodebase for hvert trinn, er prompt-caching den enkeltfaktoren som påvirker kostnaden mest. Vi går gjennom flere taktikker i vår guide om å kutte LLM API-kostnader.

Til $2 per million input-tokens gjør Sonnet 5 høy-volum agent-looper billige nok til å la kjøre. Det er skiftet. Spørsmålet er ikke lenger "har jeg råd til å kjøre denne agenten?" men "hvor mange kan jeg kjøre på en gang?"
Hva koster en ekte Sonnet 5-agent-kjøring egentlig? (reproduserbar)
La oss sette et tall på det. Vi kjørte ikke et lab-benchmark, og vi later ikke som om vi gjorde det. Det som følger er et gjennomsiktig regnestykke du kan reprodusere med dine egne token-tellinger, ved å bruke Anthropics publiserte per-token-rater. Oppgi forutsetningene, gjør regningen, og kostnaden faller ut.
Den gjennomarbeidede beregningen
Ta en realistisk agent-oppgave: en flerf-fil-refaktor som kjører omtrent 12 runder. Anta omtrent 40 000 input-tokens og 8 000 output-tokens per runde (caching av), fordi hvert trinn sender voksende kontekst på nytt. Det er omtrent 480 000 input-tokens og 96 000 output-tokens totalt. Så regningen:
- Sonnet 5 intro: (0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
- Sonnet 5 standard: (0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
- Opus 4.8 standard: (0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80
Slå på prompt-caching nå. Hvis det meste av de 480 000 input-tokenene er gjenbrukt kontekst (systemprompt, filtre, tidligere runder) og du får nær den dokumenterte ~90 % besparelsen på den bufrede delen, faller input-siden fra omtrent $0.96 til rundt $0.10, mens output holder seg på $0.96.
| Scenario (12 runder, ~480K inn / ~96K ut, caching av med mindre angitt) | Input-kostnad | Output-kostnad | Totalt |
|---|---|---|---|
| Sonnet 5 intro ($2/$10) | $0.96 | $0.96 | $1.92 |
| Sonnet 5 standard ($3/$15) | $1.44 | $1.44 | $2.88 |
| Opus 4.8 standard ($5/$25) | $2.40 | $2.40 | $4.80 |
| Sonnet 5 intro + prompt-caching (~90 % input-sparing) | ~$0.10 | $0.96 | ~$1.06 |
Dette er modellerte estimater basert på offentlig per-token-prising og de angitte token-forutsetningene, et regnestykke du kan reprodusere, ikke et benchmark vi kjørte. Bytt inn dine egne runde-tellinger og token-størrelser, og strukturen holder. Kjør tallene selv: den samme agent-oppgaven koster omtrent $1.92 på Sonnet 5 intro versus $4.80 på Opus 4.8 standard, og caching kan trekke Sonnet 5-kjøringen ned mot $1.06. Over tusen slike kjøringer per måned er det forskjellen mellom en regning på ~$1,900 og ~$4,800.
Velge modellen og måle din egen kostnad
Du trenger ikke stole på våre forutsetninger. Pek modellen på din egen arbeidsbelastning og les de reelle token-tellingene tilbake. I Claude Code setter du modellen med et flagg eller i prosjektinnstillingene:
# Enkelt kjøring
claude --model claude-sonnet-5
# Eller fest den i .claude/settings.json
{
"model": "claude-sonnet-5"
}På Anthropic API er modellstrengen den samme, og hvert svar gir deg nøyaktig token-bruk:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Les de reelle tallene for dine egne kostnadsberegninger
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Gang input_tokens med input-raten din, output_tokens med output-raten din, summer over runder, og du har den sanne kostnaden for den oppgaven. Feltet cache_read_input_tokens viser deg hvor mye caching faktisk sparte deg. Etter vår erfaring med å rute modeller for klienter er kostnad-per-oppgave det som beveger månedlig regning, ikke per-token-prisen, og den eneste ærlige måten å vite det på er å lese usage-objektet på din egen trafikk.
Når er Sonnet 5 rett valg? (reelle brukstilfeller)
Sonnet 5 er rett valg for høy-volum agentisk og kodingsarbeid der kostnad-per-oppgave bestemmer regningen, noe som er de fleste produksjons-agentjobber. Velg Opus 4.8 bare når ett feil steg er dyrt nok til å rettferdiggjøre premiumet. For alt som looper, prøver på nytt og sender kontekst på nytt, jobber mellomsjikt-raten i din favør.
Konkrete valg:
- Kodingsagenter. Flerf-fil-refaktorer, testgenerering og feilsøkingskjøringer bruker tokens over mange runder, så en lavere per-runde-rate betyr mest her. Se vår oversikt over AI-kodingsagenter for hvor den passer inn.
- Nettleser- og terminalautomatisering. Lange autonome kjøringer er nøyaktig det Anthropic bygget de agentiske oppgraderingene for, og nøyaktig der kostnadene akkumuleres.
- Kunnskapsarbeid-pipelines. Oppsummering, ekstraksjon og forskningslooper som kjøres i stor skala drar nytte av caching pluss mellomsjikt-raten.
- Kundevendte agenter. Høy forespørselsmengde gjør en liten per-oppgave-sparing til en stor månedlig en.
Hvor kan du kjøre den? Den er standard i Claude Code, tilgjengelig via API, og rulles ut over store plattformer. Hvis du velger verktøy, dekker vår sammenligning av Cursor og Copilot mot Claude Code avveiingene.
Er Sonnet 5 bedre enn Opus 4.8, og når er Opus fremdeles verdt det?
Nei, ikke "bedre" etter Anthropics egne ord. Anthropic sier Sonnet 5 er "nær Opus 4.8", ikke foran den. Velg Sonnet 5 for kostnadssensitivt, høy-volum agentisk og kodingsarbeid. Bruk Opus 4.8 på den hardeste langtidsresoneringen, der ett feil steg er dyrt og ekstra nøyaktighet er premiumet verdt.
Et raskt valgrammeverk:
- Høy-volum agent-looper, kostnadssensitivt? Sonnet 5.
- Hardest resonering, enkeltstående nøyaktighet kritisk? Opus 4.8.
- Migrerer fra Sonnet 4.6 og følger med på budsjettet? Sonnet 5 (samme standardpris, mer kapabel).
- Blandet arbeidsbelastning? Rut de enkle 90 % til Sonnet 5 og eskaler bare de harde tilfellene til Opus.
Det siste mønsteret er der en LLM-gateway for å rute modeller og kontrollere kostnader lønner seg. I det konkurransemessige bildet merker noen medier at Sonnet 5 underbyr GPT-5.5 på pris for agentisk koding, og Gemini 3.1 Pro spiller i det samme sjiktet. Benchmark på din egen arbeidsbelastning før du forplikter deg, fordi pris-per-oppgave og oppgaveegnethet sjelden samsvarer med det et enkelt rangerings-brett antyder.
Sonnet 5 erstatter ikke Opus 4.8. Den erstatter bruken av Opus 4.8 til alt.
Hva er Claude Sonnet 5 IKKE bra for? (ærlige grenser)
Sonnet 5 er mellomsjikt, og er ikke valget for frontier-grad resonering, den lengste autonomien eller maksimal nøyaktighet på enkeltoppgaver. For det er Opus 4.8 fremdeles det tryggeste valget. Hele verdiskapingen er "nær flaggskipet for mindre", og "nær" gjør reelt arbeid i den setningen.
En spesifikk grense verdt å kjenne til: Anthropic sier Sonnet 5 har "en mye lavere evne til å utføre cybersikkerhetsoppgaver enn våre nåværende Opus-modeller", og merker at den aldri utviklet et fungerende exploit under Firefox-sårbarhetstesting. Hvis sikkerhetsverktøy er brukstilfellet ditt, er det et bevisst designvalg, ikke en feil, men planlegg rundt det.
Og ikke anta en kontekstvindu-størrelse. Anthropics lanseringspost oppgir ingen, noe som bringer oss til ryktene.
"Fennec"-ryktene: Hva er faktisk bekreftet (myte-avsløring)
Mange tall som sirkulerer om Sonnet 5 kom ikke fra Anthropic. Her er skillet mellom den bekreftede lanseringen og lekkasje-narrativet, med hvert rykte tilskrevet aggregator- og lekkasjesider, ikke det offisielle innlegget.
- "Fennec"-kodenavnet. Ubekreftet. Den identifikatoren lekket fra en Vertex AI-logg måneder tidligere og har historisk pekt på Sonnet 4.6, ikke Sonnet 5. Anthropic kunngjorde intet kodenavn.
- "1M token kontekstvindu." Ikke angitt noe sted i det offisielle lanseringsinnlegget. Behandle ethvert spesifikt kontekstvindu-tall som ubekreftet inntil Anthropic publiserer ett.
- "82,1 % / 92,4 % SWE-bench." Aggregatorfabrikasjoner. Henvis bare til tall fra det offisielle innlegget eller systemkortet; ignorer resten.
- "1. april-lansering", "trent på Google TPU-er", "Dev Team Mode." Feilaktig eller ubekreftet. Lanseringen er 30. juni 2026, og ingen av disse funksjonene eller påstandene fremgår av Anthropics materiale.
Anthropic kunngjorde aldri et "Fennec"-kodenavn for Sonnet 5. Den identifikatoren lekket fra en Vertex AI-logg måneder tidligere og pekte på en annen modell. Hvis en side siterer et presist benchmark uten lenke til systemkortet, behandle det som støy.
Bør du bytte fra Sonnet 4.6? (migrasjonsdom)
Kjører du Sonnet 4.6, er bytte til Sonnet 5 lav risiko: du får en mer kapabel modell til samme standardpris ($3/$15), og intro-vinduet ($2/$10 frem til 31. august) gjør testing billig akkurat nå. The New Stack fremstiller det som å lukke gapet mot Opus 4.8 mens det forblir billig frem til august, noe som er en rimelig lesning for utviklere som veier et bytte.
Noen ting å passe på før du veksler produksjonstrafikk:
- Endre modellstrengen til
claude-sonnet-5. Det er den eneste nødvendige kodeendringen for de fleste oppsett. - Sjekk eventuelle prompt- eller output-antagelser på nytt. En mer kapabel modell kan endre tone, ordrikdom eller formatering på måter som betyr noe nedstrøms.
- Valider på evalueringssettet ditt først. Ikke bytt produksjonstrafikk på magefølelse.
- Følg med på 31. august-pristrinn hvis du budsjetterer forbi sommeren.
Dommen: til samme standardpris som Sonnet 4.6 med bedre agentisk ytelse er det vanskeligere å rettferdiggjøre å bli på 4.6. Bytt nå for å ta intro-prisingen, vent bare hvis du har en fastlåst evalueringssyklus, og behold Opus 4.8 reservert for de hardeste oppgavene. Hvis teamet ditt ruter modeller og sliter med LLM-kostnader i produksjon, tilbyr vi en gratis konsultasjon for å kartlegge det.
Om forfatteren
Mert Batur Gürbüz er medgründer av Techsy.io, der teamet bygger AI-agenter, automatiseringssystemer og stemme/SDR-pipelines for B2B-klienter. Han studerer ved University of Birmingham og skriver om LLM-verktøystakken Techsy-teamet faktisk bruker i produksjon. Koble til på LinkedIn.
Legitimasjon: Medgründer, Techsy.io, University of Birmingham. Prising verifisert mot Anthropics lanseringsinnlegg den 2026-06-30.
Ofte stilte spørsmål
Er Claude Sonnet 5 lansert?
Ja. Anthropic lanserte Claude Sonnet 5 den 30. juni 2026 som standardmodellen for Claude Free og Pro, og gjorde den tilgjengelig for Max-, Team- og Enterprise-brukere. Du kan også nå den via Anthropic API og Claude Code med modellstrengen claude-sonnet-5.
Hva koster Claude Sonnet 5?
Intro-prising er $2 per million input-tokens og $10 per million output-tokens frem til 31. august 2026. Etter det går den til standardprising på $3 per million input og $15 per million output, samme standardrate som Sonnet 4.6 for en mer kapabel modell.
Er Claude Sonnet 5 faktisk bedre enn Opus 4.8?
Ikke etter Anthropics egne beskrivelse. Anthropic sier Sonnet 5 sin ytelse er "nær Opus 4.8", ikke bedre. For den hardeste langtidsresoneringen der ett feil steg er kostbart, er Opus 4.8 fremdeles det sterkere valget. Sonnet 5 vinner på kostnad-per-oppgave og kjører på omtrent en tredjedel av Opus standard-pris.
Hva er kontekstvinduet til Claude Sonnet 5?
Anthropics lanseringspost oppgir ikke en kontekstvindu-størrelse. Påstander om "1M tokens" som sirkulerer på aggregatorsider er ubekreftede og kom ikke fra Anthropic. Inntil Anthropic publiserer et offisielt tall, behandle ethvert spesifikt kontekstvindu-tall som ubekreftet.
Hvordan bruker jeg Claude Sonnet 5?
Sett modellstrengen til claude-sonnet-5 i Anthropic API, eller velg den i Claude Code med claude --model claude-sonnet-5 eller i prosjektinnstillingene. Den er også standardmodellen for Claude Free og Pro, så du trenger ikke gjøre noe der. Les svar-usage-objektet for å spore reelle token-kostnader.
Er Claude Sonnet 5 kodenavnet "Fennec"?
Det er ingen bekreftelse. "Fennec" er en lekket identifikator som historisk har pekt på Sonnet 4.6, og Anthropic kunngjorde intet kodenavn for Sonnet 5. Identifikatoren dukket opp i en Vertex AI-logg måneder før denne lanseringen, så behandle alle påstander om at "Fennec er Sonnet 5" som et ubekreftet rykte.
Bør jeg bytte fra Sonnet 4.6 til Sonnet 5?
Sannsynligvis ja. Sonnet 5 kjører til samme standardpris som Sonnet 4.6 ($3/$15) med bedre agentisk ytelse, og intro-vinduet gjør testing billig frem til 31. august. Endre modellstrengen, valider på evalueringssettet ditt, og sjekk atferd før du bytter produksjonstrafikk.
Hvordan sammenligner Sonnet 5 seg med GPT-5.5 for koding?
Sonnet 5 er Anthropics kostnadskonkurransedyktige alternativ for agentisk koding, og noen medier rapporterer at den underbyr GPT-5.5 på pris. Kapasitetssammenligninger avhenger av arbeidsbelastning, så benchmark begge på din egen kodebase og oppgavemiks før du forplikter deg. Pris-per-oppgave og oppgaveegnethet samsvarer sjelden med det et enkelt rangerings-brett antyder.
Kan jeg kjøre Claude Sonnet 5 på AWS Bedrock?
Anthropic gjør Sonnet-modeller tilgjengelige på store skyplattformer, så Bedrock- og Vertex-tilgjengelighet for claude-sonnet-5 bør følge etter hvert som utrullingen er fullført. Sjekk nåværende plattformstatus for din region, siden lanseringer på lanseringsdagen ofte når første-parts API og Claude Code før alle tredjeparts plattformer.
Hvordan kan jeg redusere Claude Sonnet 5-kostnader?
Bruk prompt-caching for opptil omtrent 90 % sparing på gjenbrukt kontekst, og batchbehandling for omtrent 50 % sparing på ikke-tidssensitive jobber. Rut bare de hardeste oppgavene til Opus 4.8 og behold høy-volum arbeid på Sonnet 5. Les usage-objektet for å se nøyaktig hvor tokenene dine går.