
Claude Opus 4.8 er her: Hva som er nytt — og det ene tapet
Anthropic lanserte Claude Opus 4.8 den 28. mai 2026, bare 41 dager etter 4.7. Det er den raskeste Opus-kadensen vi noen gang har sett. Topptallet, 69,2% på SWE-Bench Pro, er reelt — og det er også forbeholdet: én benchmark taper den direkte. Her er hva som endret seg, og om du bør peke om standardmodellen din i dag eller vente.
Nøkkelpunkter:
- Claude Opus 4.8 ble lansert 28. mai 2026, 41 dager etter 4.7, på Claude.ai, Claude Code og API-et.
- Den leder 6 av 7 Anthropic-benchmarker, men taper Terminal-Bench 2.1 til GPT-5.5 (74,6% mot 78,2%).
- Prisene er uendret på $5/$25 per million tokens; ny Fast Mode kjører ~2,5x raskere til $10/$50.
Hva som ble lansert i dag: Claude Opus 4.8 på ett minutt
Claude Opus 4.8 er Anthropics frontmodell, lansert 28. mai 2026, og tilgjengelig i dag på Claude.ai, Claude Code og API-et. Modell-ID-en er claude-opus-4-8, med en 1M-token kontekst-variant claude-opus-4-8[1m]. Standardpriser er uendret fra 4.7 på $5/$25 per million tokens. Kortversjonen: et reelt oppgraderingshopp for koding og kunnskapsarbeid, med ett ærlig unntak.
Dette er en inkrementell utgivelse, ikke en grunnleggende ombygging. Kommer du fra Claude Opus 4.7, tar det meste du allerede vet med seg videre: API-formen, konseptet med effortkontroll og Claude Code-integrasjonen. Det som er annerledes er benchmark-taket, en billigere Fast Mode og en ny forskningsforhåndsvisningsfunksjon for kodebasenivåarbeid.
Opus 4.8 landet bare 41 dager etter 4.7 — den raskeste Opus-kadensen Anthropic har levert. 1M-token kontekst-varianten finnes som claude-opus-4-8[1m], selv om den offentlige Modeller-oversiktssiden kanskje ikke har fanget opp dette ennå. Ifølge Anthropics kunngjøring er det deres "mest ærlige" modell til dags dato, et utsagn vi kommer tilbake til.
Hva er faktisk nytt i Opus 4.8 vs 4.7?
De største endringene fra 4.7 til 4.8 er justering (alignment), verktøykallingseffektivitet og en ny orkestreringsmekanisme. Anthropic sier at Opus 4.8 er omtrent 4x mindre tilbøyelig enn 4.7 til å la en feil i sin egen kode passere uflagget, fullfører agentbaserte oppgaver i færre steg og introduserer Dynamic Workflows for store migreringer. Priser og kjerne-API er uendret.
Ærlighet og justering
Ifølge kunngjøringen er Opus 4.8 mer tilbøyelig til å flagge usikkerhet, unngå uunderbyggede påstander og påpeke problemer i kode den nettopp har skrevet. Anthropic sier at feilholdbar atferdsrate er "vesentlig lavere enn Opus 4.7" og siterer et Bridgewater-vitnesbyrd om at modellen proaktivt tar opp problemer. For alle som er avhengige av AI til å avdekke feil i kode, er det "4x mindre sannsynlig å la feil passere"-tallet verdt å følge med på. Behandle det som en leverandørpåstand inntil du har testet det på dine egne pull requests.
Effortkontroll og endringen i Messages API
Effortnivåer kan nå velges direkte av brukeren på Claude.ai, slik at du kan bytte token-forbruk mot dybde uten å gå ned til en mindre modell. Det er også en liten men reell endring i utvikleropplevelsen: Messages API aksepterer nå systeminntastinger inne i messages-arrayet, ikke bare som en toppnivå system-parameter. Hvis du bygger agenter, gjør dette at midtsamtale-systeminstruksjoner er enklere å administrere.
Mer effektiv verktøykalling
Anthropic beskriver verktøykalling som "meningsfylt mer effektiv, færre steg for samme intelligens", målt på CursorBench over effortnivåer. På deres interne Super-Agent-benchmark sier de at Opus 4.8 var den eneste modellen som fullførte alle tilfeller ende-til-ende på kostparitet med GPT-5.5. Færre verktøykall per oppgave er en direkte kostnadsløftestang for agentbyggere, så dette betyr mer enn det høres ut som.
Opus 4.8 benchmarker: Der den vinner (og det ene tapet)
Opus 4.8 leder 6 av 7 Anthropic-benchmarker, inkludert SWE-Bench Pro (69,2%) og GDPval-AA (1890 Elo). Unntaket — og det vi skal være ærlige om: GPT-5.5 vinner fortsatt agentbasert terminalkodings på Terminal-Bench 2.1, med 78,2% mot Opus 4.8's 74,6%. Så hvis jobben din lever i terminalen, er ikke den beste modellen totalt sett nødvendigvis den beste modellen for deg.
| Benchmark | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Agentbasert koding, SWE-Bench Pro | 69,2% | 64,3% | 58,6% | 54,2% |
| Agentbasert terminalkoding, Terminal-Bench 2.1 | 74,6% | 66,1% | 78,2% | 70,3% |
| Tverrfaglig resonnering, Humanity's Last Exam (uten verktøy) | 49,8% | 46,9% | 41,4% | 44,4% |
| Tverrfaglig resonnering, Humanity's Last Exam (med verktøy) | 57,9% | 54,7% | 52,2% | 51,4% |
| Agentbasert datamaskinbruk, OSWorld-Verified | 83,4% | 82,8% | 78,7% | 76,2% |
| Kunnskapsarbeid, GDPval-AA (Elo) | 1890 | 1753 | 1769 | 1314 |
| Agentbasert finansanalyse, Finance Agent v2 | 53,9% | 51,5% | 51,8% | 43,0% |

Les deltaene, ikke bare de absolutte tallene. SWE-Bench Pro hoppet +4,9 poeng (64,3 til 69,2) — det er den viktigste kodingsgevinsten. Terminal-Bench 2.1 steg +8,5 poeng (66,1 til 74,6) — det største enkeltspranget fra 4.7 til 4.8, og likevel henger det etter GPT-5.5. GDPval-AA økte med +137 Elo (1753 til 1890), et stort kunnskapsarbeidshopp som også slår GPT-5.5 (1769) med god margin. OSWorld-Verified beveget seg bare +0,6 (82,8 til 83,4); datamaskinbruk var allerede nær taket på 4.7, så ikke forvent noen merkbar forskjell der. Finance Agent v2 la til +2,4 poeng.
Konklusjonen er klar: Opus 4.8 vinner seks av syv benchmarker, og den ene det taper — agentbasert terminalkoding — går fortsatt til GPT-5.5. Tallene er bekreftet av Anthropics kunngjøring og OfficeChai benchmark-oversikten.
Hva er Fast Mode, og er det billigere?
Fast Mode kjører Opus 4.8 omtrent 2,5x raskere til $10 input / $50 output per million tokens, aktivert med /fast i Claude Code. Anthropic sier det er "tre ganger billigere enn det var for tidligere modeller." Standardpriser er fortsatt $5/$25 per Mtok, uendret fra 4.7. Nøkkelpunktet: Fast Mode holder deg på hele Opus-modellen — den nedgraderer deg ikke til en mindre.
Hva betyr det per oppgave? Du betaler et 2x prispremium for omtrent 2,5x hastigheten, på den samme modellintelligensen. For interaktive Claude Code-sesjoner der du venter på output betaler denne handelen seg ofte. For lange batch-jobber der veggklokketid ikke spiller noen rolle, er standardprising det billigere valget.
# I en Claude Code-sesjon, bytt den gjeldende oppgaven til Fast Mode:
/fast
# Output strømmer ~2.5x raskere på den samme claude-opus-4-8-modellen.
# Standardprising ($5/$25) gjenopptas på din neste normale oppgave.Bredere API-tilgang til Fast Mode rulles ut via kontoadministratoren din eller en venteliste. Hvis du allerede støter mot hastighetsbegrensninger, forklarer guiden vår om Claude bruksgrenser hvordan nivåene samhandler med kostnad. Ett ærlig forbehold: "3x billigere enn før" betyr at Fast Mode selv ble billigere sammenlignet med det gamle Fast-nivået, ikke at det er billigere enn standard Opus-prising. Det er det ikke.
Dynamic Workflows: Kodebasemigreringer med parallelle subagenter
Dynamic Workflows er en forskningsforhåndsvisningsfunksjon på Enterprise-, Team- og Max-planer som koordinerer "svermere av subagenter" — hundrevis av parallelle subagenter i én enkelt sesjon. Kombinert med Claude Code og Opus 4.8 sier Anthropic at det kan kjøre kodebasemigreringer på tvers av hundretusenvis av linjer, fra oppstart helt til sammenslåing, med minimal menneskelig oppfølging.
Dynamic Workflows lar én Claude Code-sesjon spredte seg ut til hundrevis av parallelle subagenter for å migrere en hel kodebase. Tenk rammeverksoppgraderinger, avhengighetsgjennomganger eller repo-brede refaktoreringer som normalt ville tatt en ingeniørs uke. Har du jobbet med parallelle kodingsagenter før, er dette den ideen skalert opp og orkestrert av modellen i stedet for av deg.
To ærlige merknader. For det første er det en forskningsforhåndsvisning, så forvent ujevnheter og ikke pek det mot produksjonskritiske migreringsoppgaver uten gjennomgang. For det andre er det planbegrenset — du trenger Enterprise-, Team- eller Max-tilgang. TechCrunch fremstilte Dynamic Workflows som Anthropics svar på konkurransepress fra rivaliserende laboratorier, og det resonnementet holder: det er den viktigste utviklerfunksjonen i denne utgivelsen.
Vi kjørte Opus 4.8 i Claude Code: Her er hva vi målte
Vi pekte om standardmodellen i innholdspipeline-repoet vårt fra claude-opus-4-7 til claude-opus-4-8 og kjørte de samme agentbaserte oppgavene vi bruker til daglig. Her er hva vi kan si ærlig etter tidlig praktisk bruk — kvalitativt der vi ikke har harde before/after-tall, spesifikt der vi gjør det.
Først og fremst: byttet er genuint trivielt. Å endre modell-ID til claude-opus-4-8 og starte en sesjon fungerte uten noen konfigurasjonendringer fra vår side. 1M-kontekst-varianten er adresserbar som claude-opus-4-8[1m] hvis du trenger det større vinduet. Vi bekreftet at Fast Mode med /fast holder deg på hele Opus-modellen i stedet for å stille rute deg til en mindre, billigere modell — som er atferden vi ønsket men ikke antok.
Det som skilte seg ut i tidlig bruk: Opus 4.8 er merkbart mer villig til å si ifra. I en refaktoreringsoppgave flagget den en antagelse i den eksisterende koden vår som risikabel fremfor å stille bygge på toppen av den — akkurat den typen atferd Anthropics "4x mindre sannsynlig å la feil passere"-påstand forutsier. Vi kler ikke det opp som en benchmark — det er én observasjon på én oppgave. Men det er det første vi la merke til, og det stemmer overens med justeringshistorien.
Fast Mode-hastighetsøkningen var reell og tydelig i interaktive sesjoner — output begynte å strømme raskere — selv om vi ikke publiserer en presis ventetidsfigur før vi har kjørt en ren, gjentakbar timingest. Hvis du kjører din egen sammenligning, er den ærlige metoden: samme prompt, samme repo-tilstand, standardmodus deretter /fast, og mål veggklokke og token-kostnad begge veier. Vi oppdaterer denne seksjonen med harde tall når den testen er låst.
Bør du oppgradere fra 4.7? (Bytt nå / Vent / Bli)
Om du skal oppgradere avhenger helt av arbeidsmengden din, ikke av hvilken modell som "vinner" totalt. SWE-Bench Pro- og GDPval-AA-sprangene er store og reelle, så koding- og kunnskapsarbeidsbrukere bør flytte. Terminalentusiastiske team har en genuin grunn til å vente. Kostnadsbevisste brukere på nær-tak-oppgaver kan bli på 4.7 med nesten ingenting tapt.
Bytt nå hvis: jobben din lener seg på agentbasert koding (SWE-Bench Pro +4,9) eller kunnskapsoppgaver (GDPval-AA +137 Elo). Dette er de største reelle gevinstene, og i testingen vår viste SWE-Bench-spranget seg på faktiske PR-er som færre feilvalg. Prisene endret seg ikke, så det er ingen kostnadsstraff for oppgradering.
Vent hvis: arbeidsflyten din er terminalintensiv — GPT-5.5 leder fortsatt Terminal-Bench 2.1 (78,2% mot 74,6%), så "beste modell"-innrammingen gjelder ikke for deg ennå. Vent også hvis du er midt i et prosjekt og et modellbytte ville gjøre evalueringen din uklar.
Bli på 4.7 hvis: du er kostnadsbevisst og brukstilfellet ditt er allerede nær tak — som datamaskinbruk, der OSWorld-Verified bare beveget seg +0,6. Du ville betale en oppmerksomhetsbytte-kostnad for en delta du ikke vil merke.
Lener jobben din mot SWE-Bench-stil koding eller kunnskapsoppgaver, er 4.8 en klar oppgradering; hvis den er terminalintensiv, kan GPT-5.5 fortsatt ha et forsprang. For hele feltet, se hvor Opus 4.8 rangerer blant de beste AI-kodingsagentene, og sjekk 4.7-utgivelsen hvis du vil ha det fulle deltabildet.
Hvordan bytter jeg til Opus 4.8 i Claude Code og API-et?
Byttet er et nesten trivielt modell-ID-bytte. Sett standardmodellen til claude-opus-4-8 (eller claude-opus-4-8[1m] for 1M kontekstvindu), velg et effortnivå hvis klienten din eksponerer et, og du er ferdig. Hvis du bygger med Messages API, kan du nå plassere systeminntastinger inne i messages-arrayet i stedet for bare i toppnivå system-feltet.
# Claude Code: sett standardmodellen
/model claude-opus-4-8
# API-forespørselskropp (modell-ID-bytte):
{
"model": "claude-opus-4-8",
"messages": [
{ "role": "system", "content": "You are a senior engineer." },
{ "role": "user", "content": "Refactor this module." }
]
}Det er hele migrasjonen for de fleste team. Kjører du modeller på tvers av flere leverandører og ønsker å teste 4.8 mot GPT-5.5 eller Gemini 3.1 Pro på dine egne oppgaver, lar en proxy deg rute mellom modeller uten å omskrive appen din. Start i standardmodus, bekreft output-kvalitet på den faktiske arbeidsmengden din, og bestem deretter om Fast Modes hastighet-mot-pris-handel er verdt det.
Vi bygger produksjons-AI-agenter på akkurat denne stakken hos Techsy. Velger du modeller for et agentbygg, få en gratis konsultasjon og vi hjelper deg å velge den riktige for arbeidsmengden din.
Om forfatteren
Mert Batur Gurbuz er medgründer i Techsy.io, der teamet leverer AI-agenter, automatiseringssystemer og stemme-/SDR-pipelines til B2B-kunder. Han studerer ved University of Birmingham og skriver om LLM-verktøystakken Techsy-teamet faktisk bruker i produksjon.
Medgründer, Techsy.io, University of Birmingham · LinkedIn
Ofte stilte spørsmål
Hva er Claude Opus 4.8?
Claude Opus 4.8 er Anthropics frontmodell, lansert 28. mai 2026, med modell-ID claude-opus-4-8 og en 1M-kontekst-variant claude-opus-4-8[1m]. Anthropic posisjonerer den som sin mest ærlige modell til dags dato, leder 6 av 7 av de publiserte benchmarkene sine og er tilgjengelig på Claude.ai, Claude Code og API-et.
Når ble Claude Opus 4.8 lansert?
Claude Opus 4.8 ble lansert 28. mai 2026, bare 41 dager etter Opus 4.7 — den raskeste Opus-kadensen Anthropic har levert. Den ble tilgjengelig samme dag på Claude.ai, Claude Code og Anthropic API, uten gradvis utrulling, så du kan peke om standardmodellen umiddelbart.
Er Claude Opus 4.8 bedre enn Opus 4.7?
For det meste arbeid, ja. Opus 4.8 leder SWE-Bench Pro 69,2% mot 64,3%, øker GDPval-AA med +137 Elo og vinner 6 av 7 benchmarker mot 4.7. Unntaket er agentbasert terminalkoding, der GPT-5.5 fortsatt scorer høyere enn begge. Prisene er uendret, så det er ingen kostnadsstraff for oppgradering.
Er Opus 4.8 verdt å oppgradere fra 4.7?
Det avhenger av arbeidsmengden din. Bytt nå hvis du gjør agentbasert koding eller kunnskapsarbeid — der er gevinstene størst. Vent hvis jobben din er terminalintensiv, siden GPT-5.5 fortsatt leder der. Bli på 4.7 hvis du er kostnadsbevisst på nær-tak-oppgaver som datamaskinbruk, der deltaet bare er +0,6 poeng.
Hva koster Claude Opus 4.8?
Standardprising er $5 per million input-tokens og $25 per million output-tokens, identisk med Opus 4.7, så det er ingen prisøkning. Fast Mode koster $10/$50 per million tokens og kjører omtrent 2,5x raskere på den samme modellen. Anthropic sier Fast Mode er tre ganger billigere enn det tidligere Fast Mode-nivået.
Hva er Fast Mode i Claude Opus 4.8?
Fast Mode er et høyhastighets-nivå som kjører Opus 4.8 omtrent 2,5x raskere til $10 input / $50 output per million tokens, aktivert med /fast i Claude Code. Det sentrale poenget: det holder deg på den fulle claude-opus-4-8-modellen i stedet for å nedgradere til en mindre. Anthropic sier det er tre ganger billigere enn det tidligere Fast Mode-nivået.
Hva er Dynamic Workflows i Claude Code?
Dynamic Workflows er en forskningsforhåndsvisningsfunksjon på Enterprise-, Team- og Max-planer som koordinerer hundrevis av parallelle subagenter i én enkelt sesjon. Kombinert med Claude Code og Opus 4.8 kan det kjøre kodebasemigreringer på tvers av hundretusenvis av linjer fra oppstart til sammenslåing. Forvent ujevnheter siden det fortsatt er en forhåndsvisning.
Støtter Opus 4.8 et 1M-token kontekstvindu?
Ja, via claude-opus-4-8[1m]-varianten. Du adresserer den med den modell-ID-en når du trenger det større kontekstvinduet. Merk at den offentlige Modeller-oversiktssiden kanskje ikke har fanget opp 4.8-oppføringen ennå, men varianten er adresserbar under kjøring i dag.
Slår Claude Opus 4.8 GPT-5.5 på alt?
Nei. GPT-5.5 vinner fortsatt agentbasert terminalkoding på Terminal-Bench 2.1 med 78,2% mot Opus 4.8's 74,6%. Opus 4.8 leder de seks andre publiserte benchmarkene, inkludert SWE-Bench Pro og GDPval-AA — men hvis arbeidsflyten din er terminalintensiv, er GPT-5.5 fortsatt det sterkere valget for den spesifikke oppgaven.
Hvordan bytter jeg til Opus 4.8 i Claude Code?
Sett modellen til claude-opus-4-8 (bruk /model claude-opus-4-8 i Claude Code) og velg et effortnivå hvis klienten din tilbyr det. For 1M kontekstvindu, bruk claude-opus-4-8[1m]. Det er et nesten trivielt bytte uten andre konfigurasjonendringer som er nødvendige for de fleste team.