
Claude Sonnet 5: wat is er nieuw en wat kost het echt?
Claude Sonnet 5 is vandaag, 30 juni 2026, uitgebracht. Anthropic prijst de intro-laag op $2 per miljoen input tokens. Daar houdt de meeste berichtgeving op. Het getal dat je rekening écht bepaalt is anders: wat kost een volledige agentrun als je output tokens en een stuk of twaalf heen-en-weer beurten meerekent? Anthropic stelt dat Sonnet 5 "dicht bij Opus 4.8" komt voor ongeveer een derde van de prijs. De echte vraag is dus niet het specblad. Het is of de maandelijkse kosten van je agent zojuist zijn gedaald, en met hoeveel.
Belangrijkste punten:
- Claude Sonnet 5 is gelanceerd op 30 juni 2026 en vervangt Sonnet 4.6 als Anthropic's mid-tier agentmodel.
- De intro-prijs is $2/M input en $10/M output tot en met 31 augustus 2026, daarna $3/$15.
- Anthropic stelt dat de prestaties "dicht bij Opus 4.8" liggen voor ongeveer een derde van de Opus-prijs.
- Het is de standaard voor Claude Free en Pro, en beschikbaar via de API en Claude Code als
claude-sonnet-5.
Wat is Claude Sonnet 5? (het antwoord in 30 seconden)
Claude Sonnet 5 is Anthropic's nieuwe mid-tier model, gelanceerd op 30 juni 2026, en omschreven in het lanceringsbericht als de meest agentische Sonnet tot nu toe. Het kan plannen opstellen, tools zoals browsers en terminals aansturen, en autonoom werken. De intro-prijs is $2/M input en $10/M output, en het is nu de standaard voor Claude Free en Pro.
Ja, het is vandaag uitgebracht, voor wie de vraag "is Claude Sonnet 5 al beschikbaar?" heeft zien rondgaan. Je selecteert het via de modelstring claude-sonnet-5 in de API of in Claude Code. Anthropic positioneert het als een betekenisvolle stap ten opzichte van Sonnet 4.6 en stelt dat de kwaliteit dicht bij die van het vlaggenschip Opus 4.8 ligt, zonder het vlaggenschipprijs-kaartje.
De onderliggende gok: Claude Sonnet 5 is Anthropic's weddenschap dat de meeste agentwerk geen frontier-model meer vereist. Als dat klopt, is het interessante verhaal niet de capabiliteitsstap. Het zijn de kosten.
Wat is er nieuw ten opzichte van Sonnet 4.6 en Opus 4.8
Anthropic noemt Sonnet 5 "een substantiële verbetering ten opzichte van zijn voorganger, Sonnet 4.6" op het gebied van redeneren, toolgebruik, codering en kenniswerk, met prestaties "dicht bij die van Opus 4.8, maar voor een lagere prijs." Het controleert zijn eigen output zonder daartoe gevraagd te worden, en het is sterker bij langdurige codering, debuggen en toolgebruik in meerdere stappen. Dat zijn Anthropic's eigen bewoordingen, niet onze metingen.
Agentische verbeteringen
De grootste verandering is autonomie. Sonnet 5 is gebouwd om een taak te plannen, tools zoals browsers en terminals op te pakken, en lange runs te doorlopen zonder tussenkomst. Zoals TechCrunch meldt (op basis van Anthropic), wordt het model gepositioneerd als een goedkopere manier om agents draaiende te houden, met vroege klantsignalen van teams zoals Zapier en Lovable. Dat is de use case die Anthropic najaagt: agents die minuten of uren in een loop draaien, waarbij elke beurt tokens kost.
Hoe het op papier afsteekt tegen Opus 4.8
Dit is het deel dat telt voor budgettering. Het capabiliteitsverschil is kleiner geworden; het prijsverschil niet.
| Model | Input $/M | Output $/M | Intro vs standaard | Positionering |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (intro) → $3 | $10 (intro) → $15 | Intro t/m 31 aug. 2026 | Mid-tier, meest agentisch; "dicht bij Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Standaard | Vorig mid-tier (feb. 2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Standaard | Vlaggenschip; zwaarste long-horizon redeneren |
Let op: de standaardprijs van Sonnet 5 ($3/$15) is identiek aan die van Sonnet 4.6. Je krijgt een capabeler model voor hetzelfde tarief. En tegenover Opus 4.8's $5/$25 draait Sonnet 5 standaard op ongeveer 60% van het input- en outputtarief. In het intro-venster is het zelfs nog goedkoper. Anthropic heeft geen getal gepubliceerd waaruit blijkt dat Sonnet 5 Opus 4.8 overtreft, dus lees het niet zo: de officiële lijn is "dicht bij," en dat houden we aan.
Wat kost Claude Sonnet 5 eigenlijk? (token-economie)
Claude Sonnet 5 kost $2/M input en $10/M output gedurende het intro-venster tot en met 31 augustus 2026, waarna het stijgt naar $3/M input en $15/M output. Die standaardprijs is gelijk aan Sonnet 4.6 voor een sterker model, en komt neer op ongeveer een derde van Opus 4.8's standaardtarief ($5/$25). Voor agentwerk op hoog volume is die verhouding het hele verhaal.
Wat betekent "per miljoen tokens" concreet voor jou? Een token is ruwweg driekwart van een woord. Een miljoen tokens is veel tekst, zo'n 750.000 woorden, maar agents verbranden ze snel omdat elke beurt context opnieuw verstuurt: de systeemprompt, eerdere berichten, bestandsinhoud, tool-output. Eén multi-bestand refactor kan honderdduizenden input tokens verbruiken voordat hij klaar is.
Dat intro-venster is een echte beslissing. Tot 31 augustus betaal je $2/$10. Daarna $3/$15. Als je Sonnet 5 toch wilt testen, is nu het moment: je evals draaien op de korting, en je bouwt gewoontes op terwijl de rekenkunde het gunstigst is. De keerzijde: bouw geen budget op intro-prijzen die je over twee maanden verliest.
Twee platformfeatures beïnvloeden je echte rekening meer dan het headline-tarief. Prompt caching laat je een gecachte context hergebruiken in plaats van elke beurt de volledige input te betalen, voor tot zo'n 90% besparing op het gecachte deel. Batch processing verlaagt de kosten met ongeveer 50% voor niet-urgente taken die je asynchroon kunt draaien. Beide staan in Anthropic's platformprijzen. Als je agent bij elke beurt dezelfde grote systeemprompt of codebase opnieuw verstuurt, is prompt caching de grootste kostenhendel die je hebt. We gaan dieper in op tactieken in onze gids over je LLM API-kosten verlagen.

Voor $2 per miljoen input tokens worden hoge-volume agentlussen goedkoop genoeg om te laten doordraaien. Dat is de verschuiving. De vraag is niet meer "kan ik me dit agent permitteren?" maar "hoeveel kan ik er tegelijk laten draaien?"
Wat een echte Sonnet 5-agentrun kost (reproduceerbaar)
Laten we het concreet maken. We hebben geen lab-benchmark gedraaid, en we doen ook niet alsof. Wat volgt is een transparante berekening die je met je eigen token-aantallen kunt reproduceren, met behulp van Anthropic's gepubliceerde per-token-tarieven. Stel je aannames vast, doe het rekenwerk, en de rekening volgt.
De uitgewerkte berekening
Neem een realistische agenttaak: een multi-bestand refactor die in ongeveer 12 beurten verloopt. Neem aan dat er per beurt zo'n 40K input tokens en 8K output tokens zijn (caching uit), omdat elke beurt groeiende context opnieuw verstuurt. Dat is zo'n 480K input tokens en 96K output tokens in totaal. De rekenkunde:
- Sonnet 5 intro: (0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
- Sonnet 5 standaard: (0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
- Opus 4.8 standaard: (0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80
Zet nu prompt caching aan. Als het leeuwendeel van die 480K input een hergebruikte context is (systeemprompt, bestandsstructuur, eerdere beurten) en je de gedocumenteerde ~90% besparing op het gecachte deel benadert, daalt de inputkant van ~$0.96 naar ~$0.10, terwijl de output op $0.96 blijft.
| Scenario (12 beurten, ~480K in / ~96K uit, caching uit tenzij vermeld) | Inputkosten | Outputkosten | Totaal |
|---|---|---|---|
| Sonnet 5 intro ($2/$10) | $0.96 | $0.96 | $1.92 |
| Sonnet 5 standaard ($3/$15) | $1.44 | $1.44 | $2.88 |
| Opus 4.8 standaard ($5/$25) | $2.40 | $2.40 | $4.80 |
| Sonnet 5 intro + prompt caching (~90% inputbesparing) | ~$0.10 | $0.96 | ~$1.06 |
Dit zijn modelschattingen op basis van publieke per-token-tarieven en de genoemde token-aannames, een berekening die je zelf kunt reproduceren. Vul je eigen beurtaantal en tokengroottes in en de structuur houdt stand. Doe de rekenkunde zelf: dezelfde agenttaak kost ~$1.92 op Sonnet 5 intro versus $4.80 op Opus 4.8 standaard, en caching kan de Sonnet 5-run naar ~$1.06 brengen. Over duizend van zulke runs per maand is het verschil tussen een rekening van ~$1.900 en een van ~$4.800.
Het model selecteren en je eigen kosten meten
Je hoeft onze aannames niet te vertrouwen. Richt het model op je eigen workload en lees de echte token-aantallen terug. In Claude Code stel je het model in via een flag of in je projectinstellingen:
# Eenmalig
claude --model claude-sonnet-5
# Of vastpinnen in .claude/settings.json
{
"model": "claude-sonnet-5"
}Via de Anthropic API is de modelstring hetzelfde, en elk antwoord geeft je het exacte tokengebruik terug:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Lees de echte getallen voor je eigen kostenberekening
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Vermenigvuldig input_tokens met je inputtarief, output_tokens met je outputtarief, tel op over alle beurten, en je hebt de werkelijke kosten van die taak. Het veld cache_read_input_tokens toont hoeveel caching je daadwerkelijk heeft bespaard. In onze ervaring met het routeren van modellen voor klanten zijn kosten per taak wat de maandrekening bepaalt, niet het per-token-tarief, en de enige eerlijke manier om dat te weten is het usage-object op je eigen verkeer uitlezen.
Wanneer Sonnet 5 de juiste keuze is (echte use cases)
Sonnet 5 is de juiste keuze voor hoog-volume agentisch en coderingswerk waarbij kosten per taak de rekening bepalen. Dat is het geval bij de meeste productiematige agentwerk. Grijp naar Opus 4.8 alleen wanneer één fout stap duur genoeg is om de meerprijs te rechtvaardigen. Voor alles dat loopt, opnieuw probeert, en context opnieuw verstuurt, werkt het mid-tier tarief in jouw voordeel.
Concrete keuzes:
- Coding agents. Multi-bestand refactors, testgeneratie en debugsessies verbranden tokens over vele beurten, dus een lager per-beurt-tarief telt hier het meest. Bekijk onze vergelijking van AI coding agents voor de context.
- Browser- en terminalautomatisering. Lange autonome runs zijn precies waarvoor Anthropic de agentische verbeteringen heeft gebouwd, en precies waar de kosten ophopen.
- Kenniswerk-pipelines. Samenvattingen, extractie en research-loops die op schaal draaien profiteren van caching gecombineerd met het mid-tier tarief.
- Klantgerichte agents. Een hoog aanvraagvolume zet een kleine besparing per taak om in een grote maandelijkse besparing.
Waar kun je het draaien? Het is de standaard in Claude Code, beschikbaar via de API, en wordt uitgerold op grote platforms. Als je toolingkeuzes maakt, behandelt onze vergelijking van Cursor en Copilot tegenover Claude Code de afwegingen.
Is Sonnet 5 beter dan Opus 4.8, en wanneer is Opus het nog waard?
Nee, niet "beter" volgens Anthropic's eigen omschrijving. Anthropic zegt dat Sonnet 5 "dicht bij Opus 4.8" komt, niet dat het er boven zit. Kies Sonnet 5 voor kostengevoelig, hoog-volume agentisch en coderingswerk. Kies Opus 4.8 voor het zwaarste long-horizon redeneren, waarbij één fout stap duur is en de extra nauwkeurigheid zijn meerprijs verdient.
Een korte richtlijn:
- Hoog-volume agentlussen, kostengevoelig? Sonnet 5.
- Zwaarste redeneren, single-shot nauwkeurigheid kritiek? Opus 4.8.
- Migreren van Sonnet 4.6 met oog op budget? Sonnet 5 (zelfde standaardprijs, capabeler).
- Gemengde workload? Stuur de makkelijke 90% naar Sonnet 5 en escaleer alleen de moeilijke gevallen naar Opus.
Dat laatste patroon is waar een LLM gateway om modellen te routeren en kosten te beheersen loont. Op het concurrentievlak merken sommige bronnen op dat Sonnet 5 GPT-5.5 onderbieds op prijs voor agentische codering, en Gemini 3.1 Pro speelt in dezelfde categorie. Benchmark op je eigen workload voordat je je vastlegt, want prijs-per-taak en taakfit lopen zelden gelijk zoals een leaderboard suggereert.
Sonnet 5 vervangt Opus 4.8 niet. Het vervangt het gebruik van Opus 4.8 voor alles.
Waar is Claude Sonnet 5 NIET goed voor? (eerlijke beperkingen)
Sonnet 5 is mid-tier, dus het is niet de keuze voor frontier-grade redeneren, de langste autonome taken, of taken waarbij maximale nauwkeurigheid in één poging vereist is. Voor die gevallen is Opus 4.8 nog steeds de veiligere keuze. De hele waardepropositie is "dicht bij het vlaggenschip voor minder," en "dicht bij" doet daar echt werk.
Eén specifieke beperking is het waard te kennen: Anthropic stelt dat Sonnet 5 een "veel lager vermogen heeft om cybersecurity-taken uit te voeren dan onze huidige Opus-modellen," en merkt op dat het tijdens het testen van Firefox-kwetsbaarheden nooit een werkende exploit heeft ontwikkeld. Als security-tooling jouw use case is, is dat een bewuste ontwerpkeuze, geen bug, maar plan er omheen.
En neem geen contextvenstergrootte voor lief. Anthropic's lanceringsbericht vermeldt er geen, wat ons bij de geruchten brengt.
De "Fennec"-geruchten: wat is eigenlijk bevestigd (mythbusting)
Veel getallen die circuleren over Sonnet 5 komen niet van Anthropic. Hier is de grens tussen de bevestigde lancering en het lekverhaal, waarbij elk gerucht wordt toegeschreven aan aggregator- en lekpagina's, niet aan het officiële bericht.
- Codenaam "Fennec". Onbevestigd. Die identifier lekte uit een Vertex AI-log maanden eerder en wees historisch naar Sonnet 4.6, niet Sonnet 5. Anthropic heeft geen codenaam aangekondigd.
- "Contextvenster van 1M tokens." Nergens vermeld in het officiële lanceringsbericht. Behandel elk specifiek contextvenstersgetal als onbevestigd totdat Anthropic er zelf een publiceert.
- "82,1% / 92,4% SWE-bench." Verzinsels van aggregators. Citeer alleen cijfers uit het officiële bericht of de systeemkaart; negeer de rest.
- "Lancering op 1 april," "getraind op Google TPU's," "Dev Team Mode." Onjuist of onbevestigd. De lancering is 30 juni 2026, en geen van die functies of claims verschijnt in Anthropic's materialen.
Anthropic heeft nooit een codenaam "Fennec" aangekondigd voor Sonnet 5. Die identifier lekte uit een Vertex AI-log maanden voor deze lancering en verwees naar een ander model. Als een pagina een precieze benchmark citeert zonder link naar de systeemkaart, behandel het dan als ruis.
Moet je overstappen van Sonnet 4.6? (migratieverdict)
Als je op Sonnet 4.6 zit, is overstappen naar Sonnet 5 laagrisico: je krijgt een capabeler model voor dezelfde standaardprijs ($3/$15), en het intro-venster ($2/$10 tot en met 31 augustus) maakt testen nu goedkoop. The New Stack omschrijft het als het dichten van de kloof met Opus 4.8 terwijl het goedkoop blijft tot augustus, wat een eerlijke lezing is voor ontwikkelaars die een overstap overwegen.
Paar aandachtspunten voordat je productieverkeer omzet:
- Verander de modelstring naar
claude-sonnet-5. Dat is de enige vereiste codewijziging voor de meeste setups. - Controleer prompt- of output-aannames opnieuw. Een capabeler model kan toon, breedsprakigheid of opmaak veranderen op manieren die downstream effect hebben.
- Valideer eerst op je eval-set. Wissel productieverkeer niet op gevoel.
- Let op de prijsstap van 31 augustus als je een budget opstelt voorbij de zomer.
Het verdict: tegen dezelfde standaardprijs als Sonnet 4.6 met betere agentische prestaties is blijven op 4.6 de moeilijkere keuze om te rechtvaardigen. Stap nu over om de intro-prijs te pakken, wacht alleen als je een bevroren eval-cyclus hebt, en reserveer Opus 4.8 voor de zwaarste taken. Als je team modellen routeert en worstelt met LLM-kosten in productie, bieden we een gratis consult aan om het samen in kaart te brengen.
Over de Auteur
Mert Batur is medeoprichter van Techsy.io, waar het team AI-agents, automatiseringssystemen en voice/SDR-pipelines bouwt voor B2B-klanten. Hij schrijft over de LLM-toolingstack die het Techsy-team daadwerkelijk in productie gebruikt. Verbinden via LinkedIn.
Credentials: medeoprichter, Techsy.io. Prijzen geverifieerd aan de hand van Anthropic's lanceringsbericht op 2026-06-30.
Veelgestelde Vragen
Is Claude Sonnet 5 al uitgebracht?
Ja. Anthropic lanceerde Claude Sonnet 5 op 30 juni 2026 als het standaardmodel voor Claude Free en Pro, en maakte het beschikbaar voor Max-, Team- en Enterprise-gebruikers. Je bereikt het ook via de Anthropic API en Claude Code met de modelstring claude-sonnet-5.
Hoeveel kost Claude Sonnet 5?
De intro-prijs is $2 per miljoen input tokens en $10 per miljoen output tokens tot en met 31 augustus 2026. Daarna gaat het naar de standaardprijs van $3 per miljoen input en $15 per miljoen output, hetzelfde standaardtarief als Sonnet 4.6 voor een capabeler model.
Is Claude Sonnet 5 daadwerkelijk beter dan Opus 4.8?
Niet volgens Anthropic's eigen omschrijving. Anthropic stelt dat de prestaties van Sonnet 5 "dicht bij Opus 4.8" liggen, niet er boven. Voor het zwaarste long-horizon redeneren waarbij één fout stap kostbaar is, is Opus 4.8 nog steeds de sterkere keuze. Sonnet 5 wint op kosten per taak: het draait op ongeveer een derde van Opus's standaardprijs.
Wat is het contextvenster van Claude Sonnet 5?
Anthropic's lanceringsbericht vermeldt geen contextvenstergrootte. Claims van "1M tokens" die circuleren op aggregatorpagina's zijn onbevestigd en komen niet van Anthropic. Totdat Anthropic een officieel getal publiceert, behandel elk specifiek contextvenstersgetal als onbevestigd.
Hoe gebruik ik Claude Sonnet 5?
Stel de modelstring in op claude-sonnet-5 in de Anthropic API, of selecteer het in Claude Code met claude --model claude-sonnet-5 of je projectinstellingen. Het is ook het standaardmodel voor Claude Free en Pro, dus daar is geen setup nodig. Lees het usage-object in het antwoord om werkelijke tokenkosten bij te houden.
Is Claude Sonnet 5 "Fennec" als codenaam gegeven?
Er is geen bevestiging. "Fennec" is een gelekte identifier die historisch naar Sonnet 4.6 verwees, en Anthropic heeft geen codenaam aangekondigd voor Sonnet 5. De identifier dook op in een Vertex AI-log maanden voor deze lancering, dus behandel elke claim dat "Fennec = Sonnet 5" als een onbevestigd gerucht.
Moet ik overstappen van Sonnet 4.6 naar Sonnet 5?
Waarschijnlijk wel. Sonnet 5 draait op dezelfde standaardprijs als Sonnet 4.6 ($3/$15) met betere agentische prestaties, en het intro-venster maakt testen goedkoop tot en met 31 augustus. Verander de modelstring, valideer op je eval-set, en controleer het gedrag voordat je productieverkeer omzet.
Hoe verhoudt Sonnet 5 zich tot GPT-5.5 voor codering?
Sonnet 5 is Anthropic's kosten-competitieve optie voor agentische codering, en sommige bronnen melden dat het GPT-5.5 onderbieds op prijs. Capabiliteitsvergelijkingen zijn workload-afhankelijk, dus benchmark beide op je eigen codebase en taakmix voordat je je vastlegt. Prijs-per-taak en taakfit lopen zelden gelijk zoals een enkel leaderboard suggereert.
Kan ik Claude Sonnet 5 op AWS Bedrock draaien?
Anthropic maakt Sonnet-modellen beschikbaar op grote cloudplatforms, dus Bedrock- en Vertex-beschikbaarheid voor claude-sonnet-5 zou moeten volgen zodra de uitrol is voltooid. Controleer de huidige platformstatus voor jouw regio, omdat lanceringen op dezelfde dag vaak de first-party API en Claude Code bereiken voordat elk derdepartijenplatform beschikbaar is.
Hoe verlaag ik de kosten van Claude Sonnet 5?
Gebruik prompt caching voor tot ~90% besparing op hergebruikte context, en batch processing voor ~50% besparing op niet-urgente taken. Stuur alleen de zwaarste taken naar Opus 4.8 en houd hoog-volume werk op Sonnet 5. Lees het usage-object om precies te zien waar je tokens naartoe gaan.