
Claude Opus 4.8 is er: wat veranderde, waar het wint (en de ene test die het verliest)
Anthropic bracht Claude Opus 4.8 uit op 28 mei 2026, slechts 41 dagen na 4.7. Dat is de snelste Opus-cyclus die we ooit hebben gezien. Het belangrijkste getal, 69,2% op SWE-Bench Pro, is echt, maar er is ook een eerlijke kanttekening: op één benchmark verliest het gewoon. Hier lees je wat er veranderde en of je je standaardmodel vandaag al moet omzetten of nog even kunt wachten.
Kernpunten:
- Claude Opus 4.8 is gelanceerd op 28 mei 2026, 41 dagen na 4.7, op Claude.ai, Claude Code en de API.
- Het leidt 6 van 7 Anthropic-benchmarks maar verliest Terminal-Bench 2.1 van GPT-5.5 (74,6% vs 78,2%).
- Prijzen zijn ongewijzigd op $5/$25 per miljoen tokens; de nieuwe Fast Mode draait ~2,5x sneller voor $10/$50.
Wat er vandaag verscheen: Claude Opus 4.8 in één minuut
Claude Opus 4.8 is Anthropic's frontiermodel, uitgebracht op 28 mei 2026 en vandaag beschikbaar op Claude.ai, Claude Code en de API. Het model-ID is claude-opus-4-8, met een 1M-tokenvariant claude-opus-4-8[1m]. De standaardprijzen zijn ongewijzigd ten opzichte van 4.7: $5/$25 per miljoen tokens. Kort oordeel: een echte upgrade voor coding en kenniswerk, met één eerlijke uitzondering.
Dit is een incrementele release, geen volledige herbouw. Als je komt van Claude Opus 4.7, geldt het meeste dat je al weet nog steeds: de API-structuur, het effort-control-concept, de Claude Code-integratie. Wat anders is, zijn het hogere benchmarkplafond, een goedkopere Fast Mode en een nieuwe research-preview-functie voor work op codebasisschaal.
Opus 4.8 arriveerde slechts 41 dagen na 4.7, de snelste Opus-cyclus die Anthropic ooit heeft uitgebracht. De 1M-tokenvariant is beschikbaar als claude-opus-4-8[1m], al kan de publieke Models-overzichtspagina nog even achterlopen. Volgens Anthropic's aankondiging is het hun "eerlijkste" model tot nu toe, een claim waar we later op terugkomen.
Wat is er echt nieuw in Opus 4.8 ten opzichte van 4.7?
De grootste veranderingen van 4.7 naar 4.8 zitten in alignment, efficiëntie van tool-calling en een nieuwe orchestratiefunctie. Anthropic zegt dat Opus 4.8 ruwweg 4x minder snel geneigd is dan 4.7 om een fout in eigen code ongemarkeerd door te laten, agentische taken afrondt in minder stappen en Dynamic Workflows introduceert voor grote migraties. Prijzen en de kern-API bleven hetzelfde.
Eerlijkheid en alignment
Volgens hun aankondiging is Opus 4.8 eerder geneigd om onzekerheid te benoemen, ongefundeerde claims te vermijden en problemen aan te kaarten in code die het zojuist zelf schreef. Anthropic zegt dat percentages voor misaligned gedrag "aanzienlijk lager zijn dan bij Opus 4.7" en noemt een Bridgewater-getuigenis over het model dat proactief problemen opmerkt. Voor iedereen die AI inzet voor het opsporen van fouten in code is dat "4x minder kans dat fouten erdoor glippen" de zin om op te letten. Behandel het als een vendorclaim totdat je het zelf op je eigen pull requests test.
Effort control en de Messages API-wijziging
Inspanningsniveaus zijn nu direct in te stellen op Claude.ai, zodat je tokenverbruik kunt uitruilen tegen diepgang zonder over te stappen naar een kleiner model. Er is ook een kleine maar praktisch relevante wijziging voor developers: de Messages API accepteert nu systeem-entries binnen de messages-array, niet alleen als top-level system-parameter. Als je agents bouwt, maakt dit tussentijdse systeeminstructies een stuk overzichtelijker.
Efficiëntere tool-calling
Anthropic omschrijft tool-calling als "betekenisvol efficiënter, minder stappen voor dezelfde intelligentie", gemeten op CursorBench over verschillende inspanningsniveaus. Op hun interne Super-Agent-benchmark zeggen ze dat Opus 4.8 als enige model elk geval end-to-end afsloot bij kostengelijkheid met GPT-5.5. Minder tool-aanroepen per taak is een directe kostenknop voor agentbouwers, dus dit is groter dan het klinkt.
Opus 4.8-benchmarks: waar het wint (en de ene verlies)
Opus 4.8 leidt 6 van 7 Anthropic-benchmarks, inclusief SWE-Bench Pro (69,2%) en GDPval-AA (1890 Elo). De uitzondering, en de eerlijke: GPT-5.5 wint nog steeds agentisch terminal-coderen op Terminal-Bench 2.1, met 78,2% tegenover Opus 4.8's 74,6%. Als je werk in de terminal leeft, is het best scorende model overall niet per se het beste model voor jou.
| Benchmark | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Agentisch coderen, SWE-Bench Pro | 69,2% | 64,3% | 58,6% | 54,2% |
| Agentisch terminal-coderen, Terminal-Bench 2.1 | 74,6% | 66,1% | 78,2% | 70,3% |
| Multidisciplinaire redenering, Humanity's Last Exam (zonder tools) | 49,8% | 46,9% | 41,4% | 44,4% |
| Multidisciplinaire redenering, Humanity's Last Exam (met tools) | 57,9% | 54,7% | 52,2% | 51,4% |
| Agentisch computergebruik, OSWorld-Verified | 83,4% | 82,8% | 78,7% | 76,2% |
| Kenniswerk, GDPval-AA (Elo) | 1890 | 1753 | 1769 | 1314 |
| Agentische financiële analyse, Finance Agent v2 | 53,9% | 51,5% | 51,8% | 43,0% |

Let op de delta's, niet alleen de absolute scores. SWE-Bench Pro steeg +4,9 punten (64,3 naar 69,2), de belangrijkste codingwinst. Terminal-Bench 2.1 ging +8,5 punten omhoog (66,1 naar 74,6), de grootste sprong van 4.7 naar 4.8, en toch blijft het achter op GPT-5.5. GDPval-AA won +137 Elo (1753 naar 1890), een grote sprong in kenniswerk die GPT-5.5 (1769) ook ruimschoots voorbijstreeft. OSWorld-Verified bewoog slechts +0,6 (82,8 naar 83,4); computergebruik lag al dicht bij het plafond in 4.7, dus verwacht daar geen merkbaar verschil. Finance Agent v2 steeg +2,4 punten.
De conclusie is helder: Opus 4.8 wint zes van zeven benchmarks, en de ene die het verliest — agentisch terminal-coderen — gaat nog steeds naar GPT-5.5. Cijfers bevestigd door Anthropic's aankondiging en de OfficeChai benchmark-samenvatting.
Wat is Fast Mode, en is het goedkoper?
Fast Mode laat Opus 4.8 zo'n 2,5x sneller draaien voor $10 input / $50 output per miljoen tokens, geactiveerd met /fast in Claude Code. Anthropic zegt dat het "drie keer goedkoper is dan voor vorige modellen." Standaardprijzen blijven op $5/$25 per Mtok, ongewijzigd ten opzichte van 4.7. Het kernpunt: Fast Mode houdt je op het volledige Opus-model, het downgradet je niet naar een kleiner model.
Wat betekent dat per taak? Je betaalt een 2x prijspremium voor ruwweg 2,5x de snelheid, op dezelfde modelintelligentie. Voor interactieve Claude Code-sessies waarbij je op output wacht, betaalt die afruil zichzelf vaak terug. Voor lange batch-jobs waar de kloktijd er niet toe doet, is de standaardprijs de goedkoopste keuze.
# Schakel in een Claude Code-sessie de huidige taak over naar Fast Mode:
/fast
# Output streamt ~2,5x sneller op hetzelfde claude-opus-4-8-model.
# Standaardprijzen ($5/$25) worden hervat bij je volgende gewone taak.Bredere API-toegang tot Fast Mode rolt uit via je accountmanager of een wachtlijst. Als je al tegen rate-limieten aanloopt, legt onze gids over Claude-gebruikslimieten uit hoe de lagen interageren met kosten. Eerlijk gezegd: "3x goedkoper dan voorheen" betekent dat Fast Mode zelf goedkoper is geworden ten opzichte van de oude Fast-tier, niet dat het goedkoper is dan standaard Opus-prijzen. Dat is het niet.
Dynamic Workflows: migraties op codebasisschaal met parallelle subagents
Dynamic Workflows is een research-preview-functie op Enterprise-, Team- en Max-abonnementen die "zwermen van subagents" coördineert — honderden parallelle subagents in één sessie. Gekoppeld aan Claude Code en Opus 4.8 zegt Anthropic dat het migraties op codebasisschaal kan uitvoeren over honderdduizenden regels, van start tot merge, met minimale begeleiding.
Dynamic Workflows laat één Claude Code-sessie uitwaaieren in honderden parallelle subagents om een hele codebase te migreren. Denk aan framework-upgrades, afhankelijkheidsoverzichten of repowijde refactors die normaal een week van een engineer kosten. Als je eerder hebt gewerkt met parallelle coding-agents, is dit dat idee opgeschaald en door het model zelf georchestreerd in plaats van door jou.
Twee eerlijke kanttekeningen. Ten eerste is het een research-preview, dus verwacht ruwe randjes en wijs het niet op productiekritische migraties zonder review. Ten tweede is het plan-gebonden: je hebt Enterprise-, Team- of Max-toegang nodig. TechCrunch fraamde Dynamic Workflows als Anthropic's antwoord op concurrentiedruk van andere labs, en die lezing klopt: het is de belangrijkste ontwikkelaarsfunctie van deze release.
We draaiden Opus 4.8 in Claude Code: dit maten we
We wezen de standaard van onze content-pipeline-repo om van claude-opus-4-7 naar claude-opus-4-8 en draaiden dezelfde agentische taken opnieuw die we dagelijks gebruiken. Dit is wat we eerlijk kunnen zeggen na vroeg hands-on gebruik — kwalitatief waar we geen harde voor/na-cijfers hebben, specifiek waar we die wel hebben.
Eerst: de overstap is echt makkelijk. Het model-ID wijzigen naar claude-opus-4-8 en een sessie starten werkte zonder ook maar één configuratiewijziging van onze kant. De 1M-contextvariant is adresseerbaar als claude-opus-4-8[1m] als je het grotere venster nodig hebt. We bevestigden dat Fast Mode met /fast je op het volledige Opus-model houdt in plaats van stil door te schakelen naar een kleiner, goedkoper model — het gedrag dat we wilden maar niet aannames.
Wat opviel in vroeg gebruik: Opus 4.8 is merkbaar bereidwilliger om terug te duwen. Bij een refactor-taak markeerde het een aanname in onze bestaande code als riskant, in plaats van er stil op voort te bouwen — precies het soort gedrag dat Anthropic's "4x minder kans op ongemarkeerde fouten" voorspelt. We gaan dat niet als benchmark opblazen; het is één observatie op één taak. Maar het is het eerste wat we opmerkten, en het sluit aan bij het alignment-verhaal.
De Fast Mode-versnelling was reëel en duidelijk zichtbaar in interactieve sessies — output begon sneller te streamen — al publiceren we geen precies latentiecijfer totdat we een schone, herhaalbare timingtest hebben gedraaid. Als je je eigen vergelijking wilt doen: zelfde prompt, zelfde repo-staat, standaardmodus dan /fast, en meet wall-clock én tokenkosten beide kanten op. We updaten dit gedeelte met harde cijfers zodra die test klaar is.
Moet je upgraden van 4.7? (Nu switchen / wachten / blijven)
Of je moet upgraden hangt volledig af van je werkbelasting, niet van welk model "overall wint". De sprongen op SWE-Bench Pro en GDPval-AA zijn groot en echt, dus codeer- en kenniswerkers kunnen meteen overstappen. Teams met zwaar terminal-gebruik hebben een echte reden om te wachten. Kostenbewuste gebruikers op taken die al dicht bij het plafond zitten, kunnen op 4.7 blijven en verliezen nauwelijks iets.
Switch nu als: je werk leunt op agentisch coderen (SWE-Bench Pro +4,9) of kennistaken (GDPval-AA +137 Elo). Dit zijn de grootste echte winsten, en in onze tests was de SWE-Bench-sprong merkbaar bij echte PR's als minder verkeerde afwijkingen. Prijzen veranderden niet, dus er is geen kostennadeel bij upgraden.
Wacht als: je workflow terminal-zwaar is — GPT-5.5 leidt Terminal-Bench 2.1 nog steeds (78,2% vs 74,6%), dus de "beste model"-framing geldt voor jou nog niet. Wacht ook als je midden in een project zit en een modelwissel je evaluatie zou vertroebelen.
Blijf op 4.7 als: je kostenbewust bent en je use case al dicht bij het plafond zit — zoals computergebruik, waar OSWorld-Verified slechts +0,6 bewoog. Je zou een omschakelkost betalen voor een delta die je toch niet voelt.
Als je werk leunt op SWE-Bench-stijl coderen of kennistaken, is 4.8 een duidelijke upgrade; bij terminal-zwaar werk kan GPT-5.5 het nog net een stapje voor zijn. Voor het bredere plaatje, zie waar Opus 4.8 staat tussen de beste AI coding-agents, en bekijk de 4.7-release voor het volledige delta-overzicht.
Hoe schakel ik over naar Opus 4.8 in Claude Code en de API?
Overstappen is een bijna triviale model-ID-wissel. Stel je standaardmodel in op claude-opus-4-8 (of claude-opus-4-8[1m] voor het 1M-contextvenster), kies een inspanningsniveau als je client dat biedt, en je bent klaar. Als je met de Messages API bouwt, kun je nu systeem-entries binnen de messages-array plaatsen in plaats van alleen in het top-level system-veld.
# Claude Code: stel het standaardmodel in
/model claude-opus-4-8
# API-aanvraagtekst (model-ID-wissel):
{
"model": "claude-opus-4-8",
"messages": [
{ "role": "system", "content": "You are a senior engineer." },
{ "role": "user", "content": "Refactor this module." }
]
}Dat is de hele migratie voor de meeste teams. Als je modellen over meerdere providers draait en 4.8 wilt afzetten tegen GPT-5.5 of Gemini 3.1 Pro op je eigen taken, laat een proxy je tussen modellen routeren zonder je app te herschrijven. Begin in de standaardmodus, bevestig de outputkwaliteit op je echte werkbelasting en beslis dan of de snelheid-voor-prijs-afruil van Fast Mode het waard is.
Wij bouwen productie-AI-agents op precies deze stack bij Techsy. Als je modellen kiest voor een agent-build, vraag een gratis consult aan en we helpen je het juiste model voor jouw werkbelasting te kiezen.
Over de auteur
Mert Batur is medeoprichter van Techsy.io, waar het team AI-agents, automatiseringssystemen en voice/SDR-pipelines bouwt voor B2B-klanten. Hij schrijft over de LLM-toolingstack die het Techsy-team echt in productie gebruikt.
Medeoprichter, Techsy.io · LinkedIn
Veelgestelde vragen
Wat is Claude Opus 4.8?
Claude Opus 4.8 is Anthropic's frontiermodel, uitgebracht op 28 mei 2026, met model-ID claude-opus-4-8 en een 1M-contextvariant claude-opus-4-8[1m]. Anthropic positioneert het als hun eerlijkste model tot nu toe, leidend in 6 van 7 gepubliceerde benchmarks en beschikbaar op Claude.ai, Claude Code en de API.
Wanneer is Claude Opus 4.8 uitgebracht?
Claude Opus 4.8 werd uitgebracht op 28 mei 2026, slechts 41 dagen na Opus 4.7, de snelste Opus-cyclus die Anthropic ooit heeft uitgebracht. Het ging live op dezelfde dag via Claude.ai, Claude Code en de Anthropic API, zonder gefaseerde uitrol — je kunt je standaardmodel dus direct omzetten.
Is Claude Opus 4.8 beter dan Opus 4.7?
Voor de meeste werkzaamheden: ja. Opus 4.8 leidt SWE-Bench Pro met 69,2% vs 64,3%, wint +137 Elo op GDPval-AA en wint 6 van 7 benchmarks ten opzichte van 4.7. De uitzondering is agentisch terminal-coderen, waar GPT-5.5 nog steeds beter scoort dan beide. Prijzen zijn ongewijzigd, dus er is geen kostennadeel bij upgraden.
Is het de moeite waard om van 4.7 naar Opus 4.8 te upgraden?
Dat hangt af van je werkbelasting. Switch nu als je agentisch coderen of kenniswerk doet, want daar zijn de winsten het grootst. Wacht als je werk terminal-zwaar is, want GPT-5.5 leidt daar nog steeds. Blijf op 4.7 als je kostenbewust bent op taken die al dicht bij het plafond zitten, zoals computergebruik, waar de delta slechts +0,6 punten bedraagt.
Hoeveel kost Claude Opus 4.8?
De standaardprijs is $5 per miljoen inputtokens en $25 per miljoen outputtokens, identiek aan Opus 4.7 — geen prijsverhoging. Fast Mode kost $10/$50 per miljoen tokens en draait zo'n 2,5x sneller op hetzelfde model. Anthropic zegt dat Fast Mode drie keer goedkoper is dan de vorige Fast Mode-tier.
Wat is Fast Mode in Claude Opus 4.8?
Fast Mode is een hogere-snelheidstier die Opus 4.8 zo'n 2,5x sneller laat draaien voor $10 input / $50 output per miljoen tokens, geactiveerd met /fast in Claude Code. Het cruciale punt: het houdt je op het volledige claude-opus-4-8-model in plaats van je te downgraden naar een kleiner model. Anthropic zegt dat het drie keer goedkoper is dan de vorige Fast Mode-tier.
Wat zijn Dynamic Workflows in Claude Code?
Dynamic Workflows is een research-preview-functie op Enterprise-, Team- en Max-abonnementen die honderden parallelle subagents in één sessie coördineert. Gekoppeld aan Claude Code en Opus 4.8 kan het migraties op codebasisschaal uitvoeren over honderdduizenden regels, van start tot merge. Verwacht ruwe randjes, want het is nog steeds een preview.
Ondersteunt Opus 4.8 een 1M-tokencontextvenster?
Ja, via de variant claude-opus-4-8[1m]. Je adresseert die via dat model-ID wanneer je het grotere contextvenster nodig hebt. Let op: de publieke Models-overzichtspagina kan nog even achterlopen en vermeldt het 4.8-item mogelijk nog niet, maar de variant is vandaag al adresseerbaar op runtime.
Verslaat Claude Opus 4.8 GPT-5.5 op alles?
Nee. GPT-5.5 wint nog steeds agentisch terminal-coderen op Terminal-Bench 2.1, met 78,2% tegenover Opus 4.8's 74,6%. Opus 4.8 leidt de andere zes gepubliceerde benchmarks, waaronder SWE-Bench Pro en GDPval-AA, maar als je workflow terminal-zwaar is, blijft GPT-5.5 de sterkere keuze voor die specifieke taak.
Hoe schakel ik over naar Opus 4.8 in Claude Code?
Stel je model in op claude-opus-4-8 (gebruik /model claude-opus-4-8 in Claude Code) en kies een inspanningsniveau als je client dat aanbiedt. Gebruik voor het 1M-contextvenster claude-opus-4-8[1m]. Het is een bijna triviale wissel zonder andere configuratiewijzigingen die voor de meeste teams nodig zijn.