
Claude Opus 4.8 er her: Hvad ændrede sig, hvor den vinder (og den ene, den taber)
Anthropic udgav Claude Opus 4.8 den 28. maj 2026, blot 41 dage efter 4.7. Det er den hurtigste Opus-kadence, vi har set. Hovedtallet, 69,2 % på SWE-Bench Pro, er reelt, og det er fangsten også: den taber ét benchmark direkte. Her er, hvad der ændrede sig, og om du bør pege din standardmodel om i dag eller vente.
Nøglepointer:
- Claude Opus 4.8 blev lanceret 28. maj 2026, 41 dage efter 4.7, på Claude.ai, Claude Code og API'et.
- Den fører i 6 af 7 Anthropic-benchmarks, men taber Terminal-Bench 2.1 til GPT-5.5 (74,6 % mod 78,2 %).
- Priserne er uændrede på $5/$25 pr. million tokens; nye Fast Mode kører ~2,5x hurtigere til $10/$50.
Hvad blev udgivet i dag: Claude Opus 4.8 på ét minut
Claude Opus 4.8 er Anthropics frontier-model, udgivet 28. maj 2026, og tilgængelig i dag på Claude.ai, Claude Code og API'et. Model-ID'et er claude-opus-4-8, med en 1M-token kontekstvariant claude-opus-4-8[1m]. Standardpriserne er uændrede fra 4.7 på $5/$25 pr. million tokens. Den korte dom: en reel opgradering til kodning og vidensarbejde, med én ærlig undtagelse.
Dette er en inkrementel udgivelse, ikke en genopbygning fra bunden. Hvis du kommer fra Claude Opus 4.7, gælder det meste af det, du allerede ved, stadig: API-formen, effort-kontrol-konceptet, Claude Code-integrationen. Det, der er anderledes, er benchmark-loftet, en billigere Fast Mode og en ny research-preview-funktion til arbejde i kodebasestørrelse.
Opus 4.8 landede blot 41 dage efter 4.7, den hurtigste Opus-kadence Anthropic har udgivet. 1M-token kontekstvarianten findes som claude-opus-4-8[1m], selvom den offentlige Models-overview-dokumentationsside måske stadig er ved at indhente det. Ifølge Anthropics annoncering er det deres "mest ærlige" model til dato, et udsagn vi vender tilbage til.
Hvad er faktisk nyt i Opus 4.8 vs 4.7?
De største ændringer fra 4.7 til 4.8 er alignment, effektivitet i tool-calling og en ny orkestreringsfunktion. Anthropic siger, at Opus 4.8 er cirka 4x mindre tilbøjelig end 4.7 til at lade en fejl i sin egen kode passere uflaget, løser agentiske opgaver i færre trin og introducerer Dynamic Workflows til store migreringer. Priser og kerne-API'et forblev uændrede.
Ærlighed og alignment
Ifølge deres annoncering er Opus 4.8 mere tilbøjelig til at flagge usikkerhed, undgå uunderstøttede påstande og påpege problemer i kode, den netop har skrevet. Anthropic siger, at rater for fejljusteret adfærd er "markant lavere end Opus 4.7," og citerer en Bridgewater-anbefaling om, at modellen proaktivt rejser problemer. For alle, der er afhængige af AI til at fange fejl i kode, er "4x mindre tilbøjelig til at lade fejl passere"-tallet den linje, der er værd at holde øje med. Behandl det som et leverandørudsagn, indtil du tester det på dine egne pull requests.
Effort-kontrol og ændringen i Messages API
Effort-niveauer kan nu vælges direkte på Claude.ai, så du kan bytte tokenforbrug mod dybde uden at falde ned til en mindre model. Der er også en lille, men reel ændring i udvikleroplevelsen: Messages API'et accepterer nu system-poster inde i messages-arrayet, ikke kun som en topniveau-system-parameter. Hvis du bygger agenter, gør det systeminstruktioner midt i samtalen renere at håndtere.
Mere effektiv tool-calling
Anthropic beskriver tool-calling som "meningsfuldt mere effektiv, færre trin for den samme intelligens," målt på CursorBench på tværs af effort-niveauer. På deres interne Super-Agent-benchmark siger de, at Opus 4.8 var den eneste model, der gennemførte alle cases ende-til-ende til omkostningsparitet med GPT-5.5. Færre tool-kald pr. opgave er en direkte omkostningsløftestang for agentbyggere, så det betyder mere, end det lyder til.
Opus 4.8-benchmarks: Hvor den vinder (og den ene, den taber)
Opus 4.8 fører i 6 af 7 Anthropic-benchmarks, herunder SWE-Bench Pro (69,2 %) og GDPval-AA (1890 Elo). Undtagelsen, og den man bør være ærlig om: GPT-5.5 vinder stadig agentisk terminalkodning på Terminal-Bench 2.1 med 78,2 % mod Opus 4.8's 74,6 %. Så hvis dit arbejde lever i terminalen, er den bedste model samlet set ikke den bedste model for dig.
| Benchmark | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Agentisk kodning, SWE-Bench Pro | 69,2 % | 64,3 % | 58,6 % | 54,2 % |
| Agentisk terminalkodning, Terminal-Bench 2.1 | 74,6 % | 66,1 % | 78,2 % | 70,3 % |
| Multidisciplinær ræsonnering, Humanity's Last Exam (uden værktøjer) | 49,8 % | 46,9 % | 41,4 % | 44,4 % |
| Multidisciplinær ræsonnering, Humanity's Last Exam (med værktøjer) | 57,9 % | 54,7 % | 52,2 % | 51,4 % |
| Agentisk computerbrug, OSWorld-Verified | 83,4 % | 82,8 % | 78,7 % | 76,2 % |
| Vidensarbejde, GDPval-AA (Elo) | 1890 | 1753 | 1769 | 1314 |
| Agentisk finansiel analyse, Finance Agent v2 | 53,9 % | 51,5 % | 51,8 % | 43,0 % |

Læs deltaerne, ikke kun de absolutte scorer. SWE-Bench Pro hoppede +4,9 point (64,3 til 69,2), den store kodningsgevinst. Terminal-Bench 2.1 steg +8,5 point (66,1 til 74,6), det største spring fra 4.7 til 4.8, og alligevel halter den stadig efter GPT-5.5. GDPval-AA vandt +137 Elo (1753 til 1890), et stort spring i vidensarbejde, der også slår GPT-5.5 (1769) med bred margin. OSWorld-Verified flyttede sig kun +0,6 (82,8 til 83,4); computerbrug var allerede nær loftet på 4.7, så forvent ikke en mærkbar forskel der. Finance Agent v2 lagde +2,4 point til.
Konklusionen er klar: Opus 4.8 vinder seks af syv benchmarks, og den ene, den taber, agentisk terminalkodning, går stadig til GPT-5.5. Tal bekræftet af Anthropics annoncering og OfficeChai-benchmark-opsamlingen.
Hvad er Fast Mode, og er det billigere?
Fast Mode kører Opus 4.8 cirka 2,5x hurtigere til $10 input / $50 output pr. million tokens, aktiveret med /fast i Claude Code. Anthropic siger, at det er "tre gange billigere, end det var for tidligere modeller." Standardpriserne forbliver på $5/$25 pr. Mtok, uændret fra 4.7. Nøglepunktet: Fast Mode holder dig på den fulde Opus-model, det nedgraderer dig ikke til en mindre.
Så hvad betyder det pr. opgave? Du betaler en 2x-prispræmie for cirka 2,5x hastigheden, på den samme modelintelligens. For interaktive Claude Code-sessioner, hvor du venter på output, betaler den handel sig ofte selv. For lange batchjobs, hvor væg-ur-tid ikke betyder noget, er standardpriser det billigere valg.
# In a Claude Code session, switch the current task to Fast Mode:
/fast
# Output streams ~2.5x faster on the same claude-opus-4-8 model.
# Standard pricing ($5/$25) resumes on your next normal task.Bredere API-adgang til Fast Mode rulles ud via din account manager eller en venteliste. Hvis du allerede støder på rate-grænser, forklarer vores guide til Claude-brugsgrænser, hvordan niveauerne interagerer med omkostninger. Én ærlig advarsel: "3x billigere end før" betyder, at selve Fast Mode blev billigere i forhold til det gamle Fast-niveau, ikke at det er billigere end standard Opus-priser. Det er det ikke.
Dynamic Workflows: Migreringer i kodebasestørrelse med parallelle subagenter
Dynamic Workflows er en research-preview-funktion på Enterprise-, Team- og Max-planer, der koordinerer "sværme af subagenter," hundredvis af parallelle subagenter i én session. Kombineret med Claude Code og Opus 4.8 siger Anthropic, at den kan køre migreringer i kodebasestørrelse på tværs af hundredtusindvis af linjer, fra kickoff hele vejen til merge, med minimal håndholdning.
Dynamic Workflows lader én Claude Code-session folde ud til hundredvis af parallelle subagenter for at migrere en hel kodebase. Tænk framework-opgraderinger, afhængighedsoverhalinger eller repo-dækkende refaktoreringer, der normalt ville æde en ingeniørs uge. Hvis du har arbejdet med parallelle kodningsagenter før, er det den idé skaleret op og orkestreret af modellen i stedet for af dig.
To ærlige bemærkninger. For det første er det en research-preview, så forvent ujævne kanter og peg den ikke på produktionskritiske migreringer uden gennemsyn. For det andet er det plan-begrænset, du skal bruge Enterprise-, Team- eller Max-adgang. TechCrunch rammesatte Dynamic Workflows som Anthropics svar på konkurrencepres fra rivaliserende labs, og den udlægning holder: det er udviklerhovedfunktionen i denne udgivelse.
Vi kørte Opus 4.8 i Claude Code: Her er, hvad vi målte
Vi pegede vores indholdspipeline-repos standardmodel om fra claude-opus-4-7 til claude-opus-4-8 og genkørte de samme agentiske opgaver, vi bruger dagligt. Her er, hvad vi ærligt kan sige efter tidlig hands-on-brug, kvalitativt hvor vi ikke har hårde før/efter-tal, specifikt hvor vi har.
Først, skiftet er virkelig trivielt. At ændre model-ID'et til claude-opus-4-8 og starte en session fungerede med nul konfigurationsændringer fra vores side. 1M-kontekstvarianten kan adresseres som claude-opus-4-8[1m], hvis du har brug for det større vindue. Vi bekræftede, at Fast Mode med /fast holder dig på den fulde Opus-model i stedet for stille at route til en mindre, billigere model, hvilket er den adfærd, vi ønskede, men ikke antog.
Det, der skilte sig ud i tidlig brug: Opus 4.8 er mærkbart mere villig til at sige imod. På en refaktoreringsopgave flaggede den en antagelse i vores eksisterende kode som risikabel i stedet for stille at bygge ovenpå den, den slags adfærd Anthropics "4x mindre tilbøjelig til at lade fejl passere"-udsagn forudsiger. Vi vil ikke pynte det op som et benchmark, det er én observation på én opgave. Men det er det første, vi bemærkede, og det stemmer overens med alignment-historien.
Fast Mode-hastighedsforøgelsen var reel og tydelig i interaktive sessioner, output begyndte at streame hurtigere, selvom vi ikke offentliggør et præcist latenstal, før vi har kørt en ren, reproducerbar timing-test. Hvis du kører din egen sammenligning, er den ærlige metode: samme prompt, samme repo-tilstand, standard-tilstand og så /fast, og mål både væg-ur og tokenomkostninger begge veje. Vi opdaterer denne sektion med hårde tal, når den test er låst.
Bør du opgradere fra 4.7? (Skift nu / Vent / Bliv)
Om du skal opgradere, afhænger helt af din arbejdsbyrde, ikke af hvilken model der "vinder" samlet. SWE-Bench Pro- og GDPval-AA-springene er store og reelle, så kodnings- og vidensarbejdsbrugere bør skifte. Terminaltunge teams har en reel grund til at vente. Omkostningsbevidste brugere på nær-loft-opgaver kan blive på 4.7 med næsten intet tabt.
Skift nu hvis: dit arbejde læner sig op ad agentisk kodning (SWE-Bench Pro +4,9) eller vidensopgaver (GDPval-AA +137 Elo). Det er de største reelle gevinster, og i vores test viste SWE-Bench-springet sig på faktiske PR'er som færre forkerte afstikkere. Priserne ændrede sig ikke, så der er ingen omkostningsstraf for at opgradere.
Vent hvis: din arbejdsflow er terminaltungt, GPT-5.5 fører stadig Terminal-Bench 2.1 (78,2 % mod 74,6 %), så "bedste model"-rammen gælder ikke for dig endnu. Vent også, hvis du er midt i et projekt, og et modelskifte ville grumse din evaluering.
Bliv på 4.7 hvis: du er omkostningsbevidst, og din use case allerede er nær loftet, som computerbrug, hvor OSWorld-Verified kun flyttede sig +0,6. Du ville betale opmærksomhedsskifteomkostninger for en delta, du ikke vil mærke.
Hvis dit arbejde læner sig op ad SWE-Bench-agtig kodning eller vidensopgaver, er 4.8 en klar opgradering; hvis det er terminaltungt, kan GPT-5.5 stadig lige akkurat slå den. For det bredere felt, se hvor Opus 4.8 placerer sig blandt de bedste AI-kodningsagenter, og tjek 4.7-udgivelsen, hvis du vil have det fulde delta-billede.
Hvordan skifter jeg til Opus 4.8 i Claude Code og API'et?
At skifte er et næsten trivielt model-ID-skift. Sæt din standardmodel til claude-opus-4-8 (eller claude-opus-4-8[1m] til 1M-kontekstvinduet), vælg et effort-niveau, hvis din klient eksponerer ét, og du er færdig. Hvis du bygger med Messages API'et, kan du nu placere system-poster inde i messages-arrayet i stedet for kun i topniveau-system-feltet.
# Claude Code: set the default model
/model claude-opus-4-8
# API request body (model ID swap):
{
"model": "claude-opus-4-8",
"messages": [
{ "role": "system", "content": "You are a senior engineer." },
{ "role": "user", "content": "Refactor this module." }
]
}Det er hele migreringen for de fleste teams. Hvis du kører modeller på tværs af flere udbydere og vil teste 4.8 mod GPT-5.5 eller Gemini 3.1 Pro på dine egne opgaver, lader en proxy dig route mellem modeller uden at omskrive din app. Start i standard-tilstand, bekræft outputkvalitet på din reelle arbejdsbyrde, og afgør så, om Fast Modes hastighed-mod-pris-handel er det værd.
Vi bygger produktions-AI-agenter på præcis denne stack hos Techsy. Hvis du vælger modeller til et agent-build, så få en gratis konsultation, og vi hjælper dig med at vælge den rigtige til din arbejdsbyrde.
Om forfatteren
Mert Batur Gurbuz er medstifter af Techsy.io, hvor teamet leverer AI-agenter, automatiseringssystemer og stemme-/SDR-pipelines til B2B-klienter. Han studerer på University of Birmingham og skriver om det LLM-værktøjs-stack, Techsy-teamet faktisk bruger i produktion.
Medstifter, Techsy.io, University of Birmingham · LinkedIn
Ofte stillede spørgsmål
Hvad er Claude Opus 4.8?
Claude Opus 4.8 er Anthropics frontier-model, udgivet 28. maj 2026, med model-ID claude-opus-4-8 og en 1M-kontekstvariant claude-opus-4-8[1m]. Anthropic positionerer den som deres mest ærlige model endnu, der fører i 6 af 7 af sine offentliggjorte benchmarks og er tilgængelig på Claude.ai, Claude Code og API'et.
Hvornår blev Claude Opus 4.8 udgivet?
Claude Opus 4.8 blev udgivet den 28. maj 2026, blot 41 dage efter Opus 4.7, den hurtigste Opus-kadence Anthropic har udgivet. Den gik live samme dag på tværs af Claude.ai, Claude Code og Anthropic API'et, uden trinvis udrulning, så du kan pege din standardmodel om med det samme.
Er Claude Opus 4.8 bedre end Opus 4.7?
Til det meste arbejde, ja. Opus 4.8 fører SWE-Bench Pro 69,2 % mod 64,3 %, vinder +137 Elo på GDPval-AA og vinder 6 af 7 benchmarks mod 4.7. Undtagelsen er agentisk terminalkodning, hvor GPT-5.5 stadig scorer højere end begge. Priserne er uændrede, så der er ingen omkostningsstraf ved at opgradere.
Er Opus 4.8 værd at opgradere fra 4.7?
Det afhænger af din arbejdsbyrde. Skift nu, hvis du laver agentisk kodning eller vidensarbejde, hvor gevinsterne er størst. Vent, hvis dit arbejde er terminaltungt, da GPT-5.5 stadig fører der. Bliv på 4.7, hvis du er omkostningsbevidst på nær-loft-opgaver som computerbrug, hvor deltaen kun er +0,6 point.
Hvad koster Claude Opus 4.8?
Standardpriserne er $5 pr. million input-tokens og $25 pr. million output-tokens, identisk med Opus 4.7, så der er ingen prisstigning. Fast Mode koster $10/$50 pr. million tokens og kører cirka 2,5x hurtigere på den samme model. Anthropic siger, at Fast Mode er tre gange billigere end det tidligere Fast-Mode-niveau.
Hvad er Fast Mode i Claude Opus 4.8?
Fast Mode er et højhastighedsniveau, der kører Opus 4.8 cirka 2,5x hurtigere til $10 input / $50 output pr. million tokens, aktiveret med /fast i Claude Code. Afgørende er, at det holder dig på den fulde claude-opus-4-8-model i stedet for at nedgradere til en mindre. Anthropic siger, at det er tre gange billigere end det tidligere Fast-Mode-niveau.
Hvad er dynamic workflows i Claude Code?
Dynamic Workflows er en research-preview-funktion på Enterprise-, Team- og Max-planer, der koordinerer hundredvis af parallelle subagenter i én session. Kombineret med Claude Code og Opus 4.8 kan den køre migreringer i kodebasestørrelse på tværs af hundredtusindvis af linjer fra kickoff til merge. Forvent ujævne kanter, da det stadig er en preview.
Understøtter Opus 4.8 et 1M-token kontekstvindue?
Ja, via claude-opus-4-8[1m]-varianten. Du adresserer den med det model-ID, når du har brug for det større kontekstvindue. Bemærk, at den offentlige Models-overview-dokumentationsside måske stadig er ved at indhente det og muligvis endnu ikke viser 4.8-posten, men varianten kan adresseres ved runtime i dag.
Slår Claude Opus 4.8 faktisk GPT-5.5 i alt?
Nej. GPT-5.5 vinder stadig agentisk terminalkodning på Terminal-Bench 2.1 med 78,2 % mod Opus 4.8's 74,6 %. Opus 4.8 fører i de andre seks offentliggjorte benchmarks, herunder SWE-Bench Pro og GDPval-AA, men hvis dit arbejdsflow er terminaltungt, forbliver GPT-5.5 det stærkere valg til netop den opgave.
Hvordan skifter jeg til Opus 4.8 i Claude Code?
Sæt din model til claude-opus-4-8 (brug /model claude-opus-4-8 i Claude Code) og vælg et effort-niveau, hvis din klient tilbyder ét. Til 1M-kontekstvinduet, brug claude-opus-4-8[1m]. Det er et næsten trivielt skift uden andre konfigurationsændringer for de fleste teams.