
Claude Sonnet 5: Hvad er nyt, og hvad koster det reelt at køre
Claude Sonnet 5 landede i dag, den 30. juni 2026, og Anthropic prissatte introtieret til $2 per million input-tokens. Det er her, det meste omtale stopper. Det tal, der faktisk flytter din regning, er et andet: Hvad koster en fuld agent-kørsel, når man lægger output-tokens og et dusin frem-og-tilbage-runder til? Anthropic siger, at Sonnet 5 kommer "tæt på Opus 4.8" til omtrent en tredjedel af prisen. Så det reelle spørgsmål er ikke specifikationsarket. Det er, om din agents månedlige omkostninger netop er faldet, og med hvor meget.
Nøglepointer:
- Claude Sonnet 5 blev lanceret den 30. juni 2026 og erstatter Sonnet 4.6 som Anthropics mellemklasse-agentmodel.
- Intreprisen er $2/M input og $10/M output frem til den 31. august 2026, derefter $3/$15.
- Anthropic siger, at ydelsen ligger "tæt på Opus 4.8" til omtrent en tredjedel af Opus' omkostninger.
- Den er standard for Claude Free og Pro og tilgængelig via API'et og Claude Code som
claude-sonnet-5.
Hvad er Claude Sonnet 5? (svaret på 30 sekunder)
Claude Sonnet 5 er Anthropics nye mellemklassemodel, lanceret den 30. juni 2026 og beskrevet i dens lanceringsopslag som den mest agentdrevne Sonnet hidtil. Den kan lægge planer, bruge værktøjer som browsere og terminaler og køre autonomt. Intreprisen er $2/M input og $10/M output, og den er nu standard for Claude Free og Pro.
Ja, den er udgivet i dag, hvis du har set forvirringen om "er Claude Sonnet 5 blevet udgivet?" florerer. Du vælger den med modelstrengen claude-sonnet-5 i API'et eller i Claude Code. Anthropic positionerer den som et markant skridt over Sonnet 4.6 og siger, at kvaliteten ligger tæt på deres flagskib, Opus 4.8, uden flagskibs-prisskiltet.
Her er satsningen bag: Claude Sonnet 5 er Anthropics væddemål om, at det meste agentarbejde ikke længere kræver en frontier-model. Hvis det holder, er den interessante historie ikke kapacitetsspringet. Det er økonomien.
Hvad er nyt i forhold til Sonnet 4.6 og Opus 4.8
Anthropic kalder Sonnet 5 en "markant forbedring i forhold til forgængeren Sonnet 4.6" inden for ræsonnement, værktøjsbrug, kodning og vidensarbejde, med en ydelse "tæt på Opus 4.8, men til lavere priser." Den tjekker sit eget output uden at blive bedt om det, og den er stærkere til vedvarende kodning, fejlfinding og flertrins værktøjsbrug. Det er Anthropics rammer, ikke vores målinger.
Agentopgraderinger
Den store ændring er autonomi. Sonnet 5 er bygget til at planlægge en opgave, tage værktøjer som browsere og terminaler i brug og køre lange forløb igennem uden håndholdning. Som TechCrunch rapporterer (med henvisning til Anthropic) præsenteres modellen som en billigere måde at holde agenter kørende på, med tidlige kundesignaler fra teams som Zapier og Lovable. Det er den use case, Anthropic jagter: Agenter, der kører i loop i minutter eller timer, hvor hver runde tilføjer tokens.
Hvordan den måler sig mod Opus 4.8 på papiret
Her er den del, der betyder noget for budgettet. Kapacitetskløften er skrumpet; priskløften er det ikke.
| Model | Input $/M | Output $/M | Intro vs. standard | Positionering |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (intro) → $3 | $10 (intro) → $15 | Intro frem til 31. aug. 2026 | Mellemklasse, mest agentdrevne Sonnet; "tæt på Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Standard | Foregående mellemklasse (feb. 2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Standard | Flagskib; sværeste langsigtede ræsonnement |
Bemærk, at standardprisen for Sonnet 5 ($3/$15) er identisk med Sonnet 4.6. Du får en mere kapabel model til den samme pris. Og over for Opus 4.8's $5/$25 kører Sonnet 5 standard på omtrent 60 % af input-prisen og output-prisen. I introperioden er den endnu billigere. Anthropic har ikke offentliggjort et tal, der siger, at Sonnet 5 slår Opus 4.8, så læs det ikke sådan: Den officielle linje er "tæt på", og det holder vi os til.
Hvad koster Claude Sonnet 5 reelt? (token-økonomi)
Claude Sonnet 5 koster $2/M input og $10/M output i introperioden frem til den 31. august 2026 og stiger derefter til $3/M input og $15/M output. Den standardpris matcher Sonnet 4.6 for en stærkere model, og den lander på omtrent en tredjedel af Opus 4.8's standardpris ($5/$25). For agentarbejde med høj volumen er det forhold hele historien.
Så hvad betyder "per million tokens" egentlig for dig? Et token er omtrent tre fjerdedele af et ord. En million tokens er en masse tekst, måske 750.000 ord, men agenter brænder hurtigt igennem dem, fordi hver runde gensender kontekst: systemprompten, tidligere beskeder, filindhold, værktøjsoutput. En enkelt refaktorering på tværs af flere filer kan æde hundredtusindvis af input-tokens, før den er færdig.
Den introperiode er et reelt beslutningspunkt. Frem til den 31. august betaler du $2/$10. Derefter $3/$15. Hvis du alligevel vil teste Sonnet 5, betyder det, at dine evalueringer kører med rabat, hvis du gør det nu, og du fastlægger vaner, mens regnestykket er mest fordelagtigt. Bagsiden: Lad være med at bygge et budget på en intropris, du mister om to måneder.
To platformfunktioner ændrer den reelle regning mere end den overskriftsvenlige pris gør. Prompt-caching lader dig genbruge en cachet kontekst i stedet for at betale fuld input-pris i hver runde, med op til omtrent 90 % besparelse på den cachede del. Batchbehandling skærer omkostningerne med cirka 50 % for ikke-akutte jobs, du kan køre asynkront. Begge er dokumenteret i Anthropics platformpriser. Hvis din agent gensender den samme store systemprompt eller kodebase i hver runde, er prompt-caching den enkelt største løftestang, du har på omkostningerne. Vi går i dybden med flere taktikker i vores guide til at skære dine LLM API-omkostninger.

Til $2 per million input-tokens gør Sonnet 5 agent-loops med høj volumen billige nok til at lade køre. Det er skiftet. Spørgsmålet er ikke længere "har jeg råd til at køre denne agent?", men "hvor mange af dem kan jeg køre på én gang?"
Hvad en virkelig Sonnet 5-agentkørsel reelt koster (reproducerbar)
Lad os sætte et tal på. Vi kørte ikke en laboratorie-benchmark, og vi lader ikke, som om vi gjorde. Det følgende er en transparent beregning, du kan reproducere med dine egne tokenantal ved hjælp af Anthropics offentliggjorte per-token-priser. Angiv dine antagelser, lav regnestykket, og regningen falder ud.
Det gennemregnede eksempel
Tag en realistisk agentopgave: en refaktorering på tværs af flere filer, der kører cirka 12 runder. Antag omtrent 40K input-tokens og 8K output-tokens per runde (caching slået fra), fordi hver runde gensender voksende kontekst. Det er cirka 480K input-tokens og 96K output-tokens i alt. Nu til regnestykket:
- Sonnet 5 intro: (0,48M × $2) + (0,096M × $10) = $0,96 + $0,96 = $1,92
- Sonnet 5 standard: (0,48M × $3) + (0,096M × $15) = $1,44 + $1,44 = $2,88
- Opus 4.8 standard: (0,48M × $5) + (0,096M × $25) = $2,40 + $2,40 = $4,80
Slå nu prompt-caching til. Hvis det meste af de 480K input er genbrugt kontekst (systemprompt, filtræ, tidligere runder), og du kommer tæt på den dokumenterede besparelse på ~90 % på den cachede del, falder inputsiden fra cirka $0,96 til omtrent $0,10, mens output bliver på $0,96.
| Scenarie (12 runder, ~480K ind / ~96K ud, caching fra medmindre andet angives) | Input-omkostninger | Output-omkostninger | I alt |
|---|---|---|---|
| Sonnet 5 intro ($2/$10) | $0,96 | $0,96 | $1,92 |
| Sonnet 5 standard ($3/$15) | $1,44 | $1,44 | $2,88 |
| Opus 4.8 standard ($5/$25) | $2,40 | $2,40 | $4,80 |
| Sonnet 5 intro + prompt-caching (~90 % input-besparelse) | ~$0,10 | $0,96 | ~$1,06 |
Det er modellerede estimater baseret på offentlige per-token-priser og de angivne tokenantagelser, en beregning du kan reproducere, ikke en benchmark vi kørte. Indsæt dit eget antal runder og tokenstørrelser, og strukturen holder. Kør tallene selv: den samme agentopgave koster omtrent $1,92 på Sonnet 5 intro mod $4,80 på Opus 4.8 standard, og caching kan trække Sonnet 5-kørslen ned nær $1,06. På tværs af tusind af den slags kørsler om måneden er det forskellen på en regning på ~$1.900 og en på ~$4.800.
Vælg modellen og mål dine egne omkostninger
Du behøver ikke stole på vores antagelser. Ret modellen mod din egen arbejdsbyrde og aflæs de reelle tokenantal. I Claude Code sætter du modellen med et flag eller i dine projektindstillinger:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}På Anthropic-API'et er modelstrengen den samme, og hvert svar giver dig det præcise tokenforbrug:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Gang input_tokens med din input-pris, output_tokens med din output-pris, summér på tværs af runder, og du har den reelle omkostning for den opgave. Feltet cache_read_input_tokens viser, hvor meget caching faktisk sparede dig. I vores erfaring med at rute modeller for kunder er det pris-per-opgave, der flytter den månedlige regning, ikke per-token-prisskiltet, og den eneste ærlige måde at kende den på er at aflæse usage-objektet på din egen trafik.
Hvor Sonnet 5 er det rigtige valg (reelle use cases)
Sonnet 5 er det rigtige valg til agent- og kodningsarbejde med høj volumen, hvor pris-per-opgave afgør regningen, hvilket er det meste produktionsagentarbejde. Ræk kun ud efter Opus 4.8, når et enkelt forkert skridt er dyrt nok til at retfærdiggøre merprisen. For alt, der kører i loop, forsøger igen og gensender kontekst, arbejder mellemklasseprisen i din favør.
Konkrete valg:
- Kodningsagenter. Refaktoreringer på tværs af flere filer, testgenerering og fejlfindingskørsler æder tokens over mange runder, så en lavere pris per runde betyder mest her. Se vores oversigt over AI-kodningsagenter for at se, hvor den passer ind.
- Browser- og terminalautomatisering. Lange autonome kørsler er præcis det, Anthropic byggede agentopgraderingerne til, og præcis der hvor omkostningerne løber op.
- Vidensarbejde-pipelines. Opsummering, ekstraktion og research-loops, der kører i stor skala, drager fordel af caching plus mellemklasseprisen.
- Kundevendte agenter. Høj anmodningsvolumen forvandler en lille besparelse per opgave til en stor månedlig besparelse.
Hvor kan du køre den? Den er standard i Claude Code, tilgængelig via API'et og er ved at blive rullet ud på tværs af store platforme. Hvis du vælger værktøjer, dækker vores sammenligning af Cursor og Copilot mod Claude Code afvejningerne.
Er Sonnet 5 bedre end Opus 4.8, og hvornår er Opus stadig det værd?
Nej, ikke "bedre" efter Anthropics egen ramme. Anthropic siger, at Sonnet 5 ligger "tæt på Opus 4.8", ikke foran den. Vælg Sonnet 5 til omkostningsfølsomt agent- og kodningsarbejde med høj volumen. Ræk ud efter Opus 4.8 til det sværeste langsigtede ræsonnement, hvor ét forkert skridt er dyrt, og den ekstra nøjagtighed tjener sin merpris.
En hurtig tommelfingerregel:
- Agent-loops med høj volumen, omkostningsfølsomt? Sonnet 5.
- Sværeste ræsonnement, single-shot-nøjagtighed afgørende? Opus 4.8.
- Migrerer fra Sonnet 4.6 og holder øje med budgettet? Sonnet 5 (samme standardpris, mere kapabel).
- Blandet arbejdsbyrde? Rut de nemme 90 % til Sonnet 5 og optrap kun de svære tilfælde til Opus.
Det sidste mønster er der, hvor en LLM-gateway til at rute modeller og styre omkostninger betaler sig. På den konkurrencemæssige ramme bemærker nogle medier, at Sonnet 5 underbyder GPT-5.5 på pris for agentkodning, og Gemini 3.1 Pro spiller i samme klasse. Kør en benchmark på din egen arbejdsbyrde, før du binder dig, for pris-per-opgave og opgavefit stemmer sjældent overens på den måde, et leaderboard antyder.
Sonnet 5 erstatter ikke Opus 4.8. Den erstatter at bruge Opus 4.8 til alt.
Hvad er Claude Sonnet 5 IKKE god til? (ærlige begrænsninger)
Sonnet 5 er mellemklasse, så det er ikke valget til ræsonnement på frontier-niveau, den længst sigtede autonomi eller single-shot-opgaver med maksimal nøjagtighed. Til det er Opus 4.8 stadig det sikrere valg. Hele værdipropositionen er "tæt på flagskibet for mindre", og "tæt på" gør et reelt stykke arbejde i den sætning.
Én specifik begrænsning, der er værd at kende: Anthropic siger, at Sonnet 5 har en "meget lavere evne til at udføre cybersikkerhedsopgaver end vores nuværende Opus-modeller", og bemærker, at den aldrig udviklede en fungerende exploit under sårbarhedstest af Firefox. Hvis sikkerhedsværktøjer er din use case, er det et bevidst designvalg, ikke en fejl, men planlæg efter det.
Og antag ikke en størrelse på kontekstvinduet. Anthropics lanceringsopslag angiver ikke nogen, hvilket bringer os til rygterne.
"Fennec"-rygterne: Hvad der faktisk er bekræftet (myteafkræftelse)
Masser af tal, der florerer om Sonnet 5, kom ikke fra Anthropic. Her er skillelinjen mellem den bekræftede lancering og læk-fortællingen, hvor hvert rygte tilskrives aggregator- og læksider, ikke det officielle opslag.
- "Fennec"-kodenavn. Ubekræftet. Den identifikator lækkede fra en Vertex AI-log måneder tidligere og blev historisk knyttet til Sonnet 4.6, ikke Sonnet 5. Anthropic annoncerede intet kodenavn.
- "1M token kontekstvindue." Ikke angivet nogen steder i det officielle lanceringsopslag. Behandl ethvert specifikt tal for kontekstvinduet som ubekræftet, indtil Anthropic offentliggør et.
- "82,1 % / 92,4 % SWE-bench." Aggregator-fabrikationer. Citér kun tal fra det officielle opslag eller systemkortet; ignorér resten.
- "Udgivelse 1. april", "trænet på Google TPU'er", "Dev Team Mode." Falsk eller ubekræftet. Lanceringen er den 30. juni 2026, og ingen af disse funktioner eller påstande optræder i Anthropics materiale.
Anthropic annoncerede aldrig et "Fennec"-kodenavn for Sonnet 5. Den identifikator lækkede fra en Vertex AI-log måneder tidligere og pegede på en anden model. Hvis en side citerer en præcis benchmark uden link til systemkortet, så behandl det som støj.
Bør du skifte fra Sonnet 4.6? (migrationsdom)
Hvis du er på Sonnet 4.6, er et skift til Sonnet 5 lavrisiko: du får en mere kapabel model til den samme standardpris ($3/$15), og introperioden ($2/$10 frem til den 31. august) gør test billigt lige nu. The New Stack rammer det som at lukke kløften til Opus 4.8, mens den forbliver billig frem til august, hvilket er en fair læsning for udviklere, der overvejer et skift.
Et par faldgruber, før du vender produktionstrafikken:
- Skift modelstrengen til
claude-sonnet-5. Det er den eneste nødvendige kodeændring for de fleste opsætninger. - Gentjek eventuelle antagelser om prompt eller output. En mere kapabel model kan ændre tone, ordmængde eller formatering på måder, der betyder noget nedstrøms.
- Validér på dit evalueringssæt først. Udskift ikke produktionstrafik på mavefornemmelser.
- Hold øje med prisstigningen den 31. august, hvis du budgetterer hen over sommeren.
dommen: til den samme standardpris som Sonnet 4.6 med bedre agentydelse er det sværere at retfærdiggøre at blive på 4.6. Skift nu for at fange introprisen, vent kun hvis du har en fastlåst evalueringscyklus, og hold Opus 4.8 reserveret til de sværeste opgaver. Hvis dit team ruter modeller og kæmper med LLM-omkostninger i produktion, tilbyder vi en gratis konsultation for at kortlægge det.
Om forfatteren
Mert Batur Gurbuz er medstifter af Techsy.io, hvor teamet leverer AI-agenter, automatiseringssystemer og voice/SDR-pipelines til B2B-kunder. Han studerer på University of Birmingham og skriver om det LLM-værktøjslag, Techsy-teamet faktisk bruger i produktion. Forbind på LinkedIn.
Kvalifikationer: Medstifter, Techsy.io, University of Birmingham. Priser bekræftet mod Anthropics lanceringsopslag den 30. juni 2026.
Ofte stillede spørgsmål
Er Claude Sonnet 5 blevet udgivet?
Ja. Anthropic lancerede Claude Sonnet 5 den 30. juni 2026 som standardmodel for Claude Free og Pro og gjorde den tilgængelig for Max-, Team- og Enterprise-brugere. Du kan også få adgang til den via Anthropic-API'et og Claude Code ved hjælp af modelstrengen claude-sonnet-5.
Hvor meget koster Claude Sonnet 5?
Intreprisen er $2 per million input-tokens og $10 per million output-tokens frem til den 31. august 2026. Derefter skifter den til standardpris på $3 per million input og $15 per million output, den samme standardpris som Sonnet 4.6 for en mere kapabel model.
Er Claude Sonnet 5 faktisk bedre end Opus 4.8?
Ikke efter Anthropics egen beskrivelse. Anthropic siger, at Sonnet 5's ydelse ligger "tæt på Opus 4.8", ikke bedre. Til det sværeste langsigtede ræsonnement, hvor et enkelt forkert skridt er dyrt, er Opus 4.8 stadig det stærkere valg. Sonnet 5 vinder på pris-per-opgave og kører på omtrent en tredjedel af Opus' standardpris.
Hvad er Claude Sonnet 5's kontekstvindue?
Anthropics lanceringsopslag angiver ikke en størrelse på kontekstvinduet. Påstande om "1M tokens", der florerer på aggregatorsider, er ubekræftede og kom ikke fra Anthropic. Indtil Anthropic offentliggør et officielt tal, skal du behandle ethvert specifikt tal for kontekstvinduet som ubekræftet.
Hvordan bruger jeg Claude Sonnet 5?
Sæt modelstrengen til claude-sonnet-5 i Anthropic-API'et, eller vælg den i Claude Code med claude --model claude-sonnet-5 eller dine projektindstillinger. Den er også standardmodel for Claude Free og Pro, så der kræves ingen opsætning der. Aflæs svarets usage-objekt for at spore de reelle tokenomkostninger.
Har Claude Sonnet 5 kodenavnet "Fennec"?
Der er ingen bekræftelse. "Fennec" er en lækket identifikator, der historisk blev knyttet til Sonnet 4.6, og Anthropic annoncerede intet kodenavn for Sonnet 5. Identifikatoren dukkede op i en Vertex AI-log måneder før denne lancering, så behandl enhver påstand om "Fennec lig med Sonnet 5" som et ubekræftet rygte.
Bør jeg skifte fra Sonnet 4.6 til Sonnet 5?
Sandsynligvis ja. Sonnet 5 kører til den samme standardpris som Sonnet 4.6 ($3/$15) med bedre agentydelse, og introperioden gør test billigt frem til den 31. august. Skift modelstrengen, validér på dit evalueringssæt, og tjek adfærden, før du udskifter produktionstrafikken.
Hvordan klarer Sonnet 5 sig mod GPT-5.5 til kodning?
Sonnet 5 er Anthropics omkostningskonkurrencedygtige agentkodningsmulighed, og nogle medier rapporterer, at den underbyder GPT-5.5 på pris. Kapacitetssammenligninger afhænger af arbejdsbyrden, så kør en benchmark af begge på din egen kodebase og opgavesammensætning, før du binder dig. Pris-per-opgave og opgavefit stemmer sjældent overens på den måde, et enkelt leaderboard antyder.
Kan jeg køre Claude Sonnet 5 på AWS Bedrock?
Anthropic gør Sonnet-modeller tilgængelige på tværs af store cloudplatforme, så tilgængelighed på Bedrock og Vertex for claude-sonnet-5 bør følge efter, efterhånden som udrulningen fuldføres. Tjek den aktuelle platformstatus for din region, da lanceringer samme dag ofte når førsteparts-API'et og Claude Code før alle tredjepartsplatforme.
Hvordan kan jeg reducere Claude Sonnet 5-omkostninger?
Brug prompt-caching til op til omtrent 90 % besparelse på genbrugt kontekst og batchbehandling til cirka 50 % besparelse på ikke-akutte jobs. Rut kun de sværeste opgaver til Opus 4.8, og hold arbejde med høj volumen på Sonnet 5. Aflæs usage-objektet for at se præcis, hvor dine tokens går hen.