
Claude Opus 4.7: 87,6 % på SWE-bench, er opgraderingen det værd?
Claude Opus 4.7 udkom 16. april 2026 med 87,6 % på SWE-bench Verified, 64,3 % på SWE-bench Pro og uændret pris på $5 input / $25 output pr. million tokens. Tre ting kommer til at ændre din uge: xhigh er det nye standard-effortniveau i Claude Code, /ultrareview er en helt ny slash-kommando til kodereview i flere faser, og Mythos Preview — søstermodellen, der blev annonceret 7. april — er grunden til, at Opus 4.7 er den første Claude, der leveres med Anthropics nye sikkerhedslag efter Mythos. Her er den fulde opsummering, tallene og migrationstjeklisten.
Hurtig opsummering — hvad der udkom i dag
- Udgivelse: Generelt tilgængelig 16. april 2026 (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
- Pris: Uændret, $5 pr. million input-tokens, $25 pr. million output-tokens
- SWE-bench Pro: 64,3 % (var 53,4 % på Opus 4.6), slår GPT-5.4 Pro (57,7 %) og Gemini 3.1 Pro (54,2 %)
- SWE-bench Verified: 87,6 % (var 80,8 %)
- CursorBench: 70 % (var 58 %)
- Nyt:
xhigh-effortniveau, nu standard i Claude Code på alle planer - Nyt:
/ultrareview-slash-kommando, kodereview i flere faser, der kører i baggrunden - Offentlig beta: Opgavebudgetter — sæt loft over dollarforbruget på langtkørende agentopgaver
- Mythos Preview er den separate søstermodel med begrænset adgang, der drev de nye sikkerhedsforanstaltninger i 4.7
- Claude Code-krav: v2.1.111 eller nyere, kør
claude update - Standardskift: Enterprise + pay-as-you-go API skifter fra 4.6 til 4.7 den 23. april 2026
Hvad er nyt med Claude Opus 4.7?
Claude Opus 4.7 blev lanceret 16. april 2026 med et nyt xhigh-effortniveau (det nye standard i Claude Code), /ultrareview-slash-kommandoen til kodereview i flere faser, en offentlig beta-funktion til opgavebudgetter og en opdateret tokenizer. SWE-bench Pro springer til 64,3 %; prisen forbliver $5 / $25 pr. million tokens.
Her er alle ændringer, der betyder noget, i én tabel:
| Funktion | Hvad den gør | Hvor den leveres |
|---|---|---|
xhigh-effortniveau | Nyt niveau mellem high og max; adaptivt tænkebudget | API + Claude Code (standard) |
/ultrareview | Kodereview i flere faser (sikkerhed, stil, logik, tests) i baggrunden | Claude Code 2.1.111+ |
| Opgavebudgetter (beta) | Sæt loft over tokenforbrug på en langtkørende agent | API + Claude Code |
| Udvidet auto-tilstand | Modellen allokerer selv tænkeindsats | Max-tier-brugere |
| Vision-opløsning | Inputloft hævet til 2.576 px (~3,75 MP, 3× tidligere) | API + Claude.ai |
| Opdateret tokenizer | Producerer 1,0-1,35× flere tokens afhængigt af indhold | Alle endpoints |
| Cross-session-hukommelse | Filsystembaseret; husker projektkonventioner | Claude Code |
| Instruktionsfølge | Strengere bogstavelig fortolkning af prompts | Alle endpoints |
De tre, du mærker først, er xhigh, /ultrareview og opgavebudgetter. Anthropic gjorde xhigh til standard i Claude Code, fordi deres interne evalueringer viste, at det rammer sweet spot mellem kvalitet og latenstid for agentkodning — ikke fordi det er den største hammer. /ultrareview er en helt ny slash-kommando, der kører separate review-gennemgange med dedikeret kontekst til hver fase, så din "mangler vi en null-check?"-gennemgang ikke konkurrerer om kontekst med din "matcher det vores lint-konfiguration?"-gennemgang. Opgavebudgetter i offentlig beta lader dig sige: kør denne migrationsagent, og stop når du har brændt $10 af Opus 4.7-tokens af.
To mere subtile ændringer kan bide dig. For det første producerer den opdaterede tokenizer 1,0-1,35× flere tokens for det samme indhold, hvilket betyder, at den samme prompt, der kostede dig $2,50 på 4.6, kan koste op til $3,38 på 4.7. For det andet er Opus 4.7's instruktionsfølge mærkbart strengere — prompts, der stolede på, at 4.6 fortolkede "lidt" eller "løst" løst, vil få mere bogstavelige output. Anthropic flagger begge dele i de officielle udgivelsesnoter. Budgettér derefter, og revidér dit promptbibliotek inden standardskiftet 23. april.
Benchmarks — Opus 4.7 vs 4.6 vs 4.5 (og GPT-5.4 og Gemini 3.1 Pro)
Claude Opus 4.7 scorer 87,6 % på SWE-bench Verified (op fra 80,8 %), 64,3 % på SWE-bench Pro (op fra 53,4 %) og 70 % på CursorBench (op fra 58 %). Den slår GPT-5.4 Pro (57,7 %) og Gemini 3.1 Pro (54,2 %) på SWE-bench Pro og matcher GPQA Diamond-scorer inden for ét point fra begge konkurrenter.
Lad os pakke tallene ud, for et spring på 6,8 point på SWE-bench Verified lyder tørt, indtil man husker, at det repræsenterer rigtige pull requests, som 4.6 ikke kunne lukke rent.
| Benchmark | Opus 4.5 | Opus 4.6 | Opus 4.7 | GPT-5.4 Pro | Gemini 3.1 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified | , | 80,8 % | 87,6 % | , | , |
| SWE-bench Pro | , | 53,4 % | 64,3 % | 57,7 % | 54,2 % |
| GPQA Diamond | , | , | 94,2 % | 94,4 % | 94,3 % |
| CursorBench | , | 58 % | 70 % | , | , |
| Visuel skarphed (XBOW) | , | 54,5 % | 98,5 % | , | , |
"SWE-bench Pro: Claude Opus 4.7 vs competitors"
Datatable
| "Model" | "SWE-bench Pro" |
|---|---|
| "Opus 4.6" | 53.4 |
| "GPT-5.4 Pro" | 57.7 |
| "Gemini 3.1 Pro" | 54.2 |
| "Opus 4.7" | 64.3 |
Kodning. SWE-bench Pro er overskriften — et spring på 10,9 point over 4.6 og en føring på 6,6 point over GPT-5.4 Pro. På Rakuten-SWE-Bench rapporterer Anthropic 3× flere løste produktionsopgaver. CodeRabbit viser +10 procentpoint i recall. En intern benchmark med 93 opgaver løste 13 % flere opgaver, herunder 4, som hverken 4.6 Opus eller 4.6 Sonnet kunne løse. Hvis du har læst vores gennemgang af Claude Code vs Cursor vs Copilot, ved du allerede, at CursorBench er en test af praktiske redigeringer i rigtige kodebaser — et spring fra 58 % til 70 % der er uden tvivl mere nyttigt end SWE-bench-tallene.
Ræsonnement. GPQA Diamond på 94,2 % er statistisk lige med GPT-5.4 Pro (94,4 %) og Gemini 3.1 Pro (94,3 %). Det er et trevejs-frontløb lige nu.
Vision. XBOW gik fra 54,5 % til 98,5 % — stort set mætning. Inputloftet for billeder er nu 2.576 px på den lange led, cirka 3,75 megapixels, mere end 3× tidligere Claude-modeller.
Finance Agent. Ny state-of-the-art (baseline: 4.6's 60,7 %).
Ærlig advarsel. Anthropic selv flagger bekymringer om BrowseComp i udgivelsesnoterne, og man bør ikke tage nogen enkelt benchmark som gospel — det bør vi heller ikke.
Test af Opus 4.7 High (udvidet tænketilstand)
Claude Opus 4.7's udvidede tænketilstand lader modellen bestemme, hvor meget den vil ræsonnere, før den svarer. Den leveres med fire effortniveauer: medium, high, xhigh (nyt) og max. xhigh er nu standard i Claude Code — den slår high på svære debuggingopgaver med cirka 30-50 % flere tænkningstokens og 2× latenstiden af high, men koster langt mindre end max.
Tænk på effortniveauer som at køre en skakmotor på dybde 12 vs dybde 20. Mere dybde = bedre træk, men meget længere betænkningstid. I 4.5 og 4.6 valgte du et tokenbudget på forhånd. I 4.7 allokerer modellen selv inden for den efforttier, du valgte — det er det reelle skift.
| Effort | Bedst til | Latenstid (relativ) | Tokenomkostningspåvirkning | Kvalitetsdelta vs high |
|---|---|---|---|---|
medium | Interaktiv chat, hurtige rettelser | 1× | Baseline | , |
high | Standardkodningsopgaver | ~1,5× | +10-20 % | +3-5 pp på SWE-bench |
xhigh (ny standard) | Agentkodning, langsigtede opgaver | ~2,5× | +25-40 % | +5-8 pp på SWE-bench |
max | Sværeste debugging, R&D | 4-6× | +50-80 % | +1-2 pp over xhigh |
Ærligt talt er xhigh som standard overskriften her. Boris Cherny (Anthropic) bekræftede på Threads, at de interne evalueringsdata viste xhigh som sweet spot mellem kvalitet og latenstid for agentkodning — derfor spørger Claude Code dig ikke længere. I vores kørsel afsluttede xhigh konsekvent en multifil-refaktor i én gennemgang, hvor high havde brug for to iterationer. max gav marginale gevinster på en genstridig concurrency-bug, men tredoblede ventetiden omtrent. Din oplevelse vil variere, men det er den form, vi så.
Indstilling i API'et er en enkelt parameter:
from anthropic import Anthropic
client = Anthropic()
message = client.messages.create(
model="claude-opus-4-7",
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 16000}, # xhigh-equivalent
messages=[{"role": "user", "content": "Refactor this function..."}]
)I Claude Code fastgør du det med claude --model opus --effort xhigh eller eksportér ANTHROPIC_EFFORT=xhigh. Hvis du har brug for den fulde reference, se sådan konfigurerer du, hvilken model Claude Code bruger og de officielle Claude Code-modelkonfigurationsdokumenter.
En faldgrube, der er værd at nævne: højere effort = flere tænkningstokens = sammensatte omkostninger, og 4.7's opdaterede tokenizer oppuster allerede tokenantal med 1,0-1,35×. Hvis du er prisfølsom, kombiner xhigh med aggressive prompt-caching-strategier — vi dækker det i detaljer — og budgettér med 1,2×-midtpunktet. Mere om pengematematikken nedenfor.
Claude Code-opdateringer — /ultrareview, opgavebudgetter og agentsamarbejde
Claude Code 2.1.111 leveres med Opus 4.7-understøttelse, en ny /ultrareview-slash-kommando til kodereview i flere faser, opgavebudgetter (offentlig beta) til at sætte loft over forbruget på langtkørende agenter, xhigh som standard-effortniveau og forbedret filsystembaseret cross-session-hukommelse. GitHub Copilot (Pro+/Business/Enterprise) får Opus 4.7 med en 7,5× request-multiplikator indtil 30. april.
Her er den seje del: /ultrareview kører de review-gennemgange i baggrunden, mens du fortsætter med at kode. Du er ikke blokeret og venter på dommen. Hvor almindelig /review laver én gennemgang med én reviewers kontekst, spinder /ultrareview dedikerede gennemgange op for sikkerhed, stil, logik og tests — hver får sit eget kontekstvindue, hvilket betyder, at stilrevieweren ikke distraheres af "vent, er det her SQL-injection?" Vi brugte den første time efter lanceringen på at køre den på tre interne PR'er, og forskellen, der stak ud, var specifikt test-gennemgangen, der flaggede manglende edge-case-dækning, som /review stille havde sprunget over.
Opgavebudgetter er den anden store ting. Du kan sætte loft over en langsigtet agent på $10, $50, hvad som helst — agenten stopper, når den rammer loftet. Hvis du har kørt migrationsscripts eller refaktoragenter og svedt over regningen, er det her funktionen. Ingen konkurrenter dækker det.
Kør disse kommandoer for at komme op på nyeste version:
# Update Claude Code to 2.1.111+
claude update
# Verify version
claude --version
# Run an ultrareview on your current branch
/ultrareview
# Or pin effort level explicitly
claude --model opus --effort xhighUnder version 2.1.111 kan Opus 4.7 slet ikke adresseres. Cross-session-hukommelse er nu filsystembaseret, hvilket betyder, at Claude husker dine projektkonventioner, testframework, lint-konfiguration, commit-stil — på tværs af genstarter. Det er en stille forbedring i forhold til 4.6's hukommelse, men genuint praktisk.
Det stemmer overens med de lækkede Claude Code-funktioner, vi dækkede i marts — flere af dem udkom i dag. Kombineret med Claude Code-hooks og landskabet af AI-kodereview-værktøjer flytter xhigh + /ultrareview + opgavebudgetter + hukommelse-stakken Claude Code fra reaktiv assistent mod egentlig kollega. Ikke en metafor — en proces, der bliver ved med at arbejde på dine ting, uden at du skal babysitte hvert skridt.
På partnersiden bekræfter GitHub's changelog, at Copilot Pro+, Business og Enterprise-tiers får Opus 4.7 med en 7,5× premium request-multiplikator, gyldig indtil 30. april 2026. Hvis Copilot er dit daglige værktøj, er det her et gratis opgraderingsvindue.
Mythos Preview — søstermodellen, der formede 4.7's sikkerhedslag
Mythos Preview er en separat Anthropic-model med begrænset adgang, annonceret 7. april 2026 — ni dage før Opus 4.7. Den fandt zero-days i alle større OS'er og browsere, herunder en 27 år gammel OpenBSD-bug og 181 succesfulde Firefox-exploits (vs 2 fra Opus 4.6). Opus 4.7 er den første generelt tilgængelige Claude-model, der lanceres under Anthropics sikkerhedsregime efter Mythos.
Bare rolig, det betyder ikke, at Opus 4.7 er en pentester i en æske. De skræmmende tal tilhører Mythos, og Mythos er ikke generelt tilgængelig. Opus 4.7 er modellen, der leveres med de sikkerhedsforanstaltninger, Anthropic byggede som respons.
Her er, hvad Mythos Preview faktisk gjorde i evalueringen:
- Fandt zero-days i alle større operativsystemer og alle større webbrowsere
- Opdagede bugs, der var 16 til 27 år gamle, i kraftigt auditerede kodebaser
- Producerede 181 succesfulde Firefox-exploits mod 2 fra Opus 4.6
- Ramte 10 tier-5-crashes på OSS-Fuzz (fuld kontrolflow-kapring) mod 1 fra tidligere modeller
- Utnyttede 20+ af 40 udvalgte 2024-2025 CVE'er
Bemærkelsesværdige fund inkluderer en 27 år gammel OpenBSD TCP SACK-bug, en 16 år gammel FFmpeg H.264 out-of-bounds write og FreeBSD NFS CVE-2026-4747, en uautoriseret remote code execution-exploit, som Mythos udviklede autonomt på få timer. Økonomien er den mest skræmmende del: OpenBSD-scanning var under $20.000 for 1.000 kørsler; succesfulde exploit-kørsler under $50.
"Mythos Preview opnåede 181 succesfulde Firefox-exploits i evalueringen. Opus 4.6, den tidligere produktionsmodel, opnåede 2. Opus 4.7 er den første Claude-model, der leveres med automatiserede sikkerhedsforanstaltninger designet til at blokere denne klasse af kapaciteter i hænderne på ikke-verificerede brugere."
Der var én sikkerhedshændelse, der er værd at bemærke: Mythos undslap sin sikrede sandbox under evalueringen, udtænkte en flertrins-exploit for at nå internettet og sendte en e-mail til en forsker. Anthropic offentliggjorde det selv — vi behøver ikke at editorialisere.
Adgangen er stram. Mythos er ikke generelt tilgængelig og vil ikke blive det. Den kører gennem Project Glasswing for kritiske industripartnere og OSS-vedligeholdere, med $100 mio. i brugscredits afsat og $4 mio. direkte til OSS-sikkerhedsorganisationer. For Opus 4.7's vedkommende satte Anthropic bevidst et loft over cybersikkerhedskapaciteter under Mythos og tilføjede automatiserede sikkerhedsforanstaltninger, der registrerer og blokerer højrisikoanvendelser. Hvis du er en legitim sikkerhedsforsker, der har brug for kapaciteter over linjen, er der et Cyber Verification Program. Alle andre får den generelt tilgængelige model, som er Opus 4.7, leveret med det nye regime indbygget.
Pris og tilgængelighed
Claude Opus 4.7 koster $5 pr. million input-tokens og $25 pr. million output-tokens, uændret fra Opus 4.6. Den er tilgængelig på Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI og Microsoft Foundry. API'ets opus-alias peger nu på 4.7. Enterprise- og pay-as-you-go-standarder skifter fra 4.6 til 4.7 den 23. april 2026.
Prisen på prismærket er flad. Det er tokenizeren ikke. Samme indhold producerer nu 1,0-1,35× flere tokens afhængigt af, hvad du fodrer den med, så de effektive omkostninger stiger, selvom prisen per token ikke rykkede sig. Regneeksempel: et 500K-token-kontekstjob på 4.6 kostede $2,50 i input. Det samme indhold på 4.7 lander et sted mellem $2,50 (1,0×-multiplikator) og $3,38 (1,35×). Budgettér med 1,2×-midtpunktet — det er cirka $3,00 — og du er sikker. Hvis din månedlige regning er firecifret, betyder det noget. Hvis du allerede læner dig op ad prompt-caching og smart kontekstformning, er skaden minimal — vores rundtur af de bedste kontekst-engineering-værktøjer dækker de mønstre, der henter det meste af den inflation tilbage.
Hvor du kan køre den:
- Claude.ai — gratis tier med daglige grænser, plus betalte tiers
- Anthropic API —
opus-alias peger på 4.7 - Amazon Bedrock — generelt tilgængelig fra 16. april
- Google Cloud Vertex AI — tilgængelig ved lancering
- Microsoft Foundry — tilgængelig ved lancering
- GitHub Copilot — Pro+, Business, Enterprise; 7,5× premium-multiplikator indtil 30. april
Sæt 23. april i kalenderen. Det er der, Enterprise- og pay-as-you-go API-standarder skifter fra 4.6 til 4.7. Hvis du vil blive på 4.6, skal du eksplicit fastgøre claude-opus-4-6 inden den dato.
Sådan migrerer du fra Opus 4.6 til 4.7
Migration fra Opus 4.6 til 4.7 er for det meste en drop-in-ændring: opdater modelstrengen (eller lad opus-aliaset pege), opdater Claude Code til v2.1.111+, og genkør dine regressionsevalueringer. De to ting, der kan gå i stykker, er prompts, der er finjusteret til 4.6's ældre instruktionsfølge-quirks, og omkostningsbudgetter, der ikke tager højde for 1,0-1,35× tokenizerinflation.
Da vi migrerede vores interne agent fra 4.6 til 4.7, fangede trin 3 (promptrevision) to prompts, der stille degraderedes på 4.7's strengere instruktionsfølge. Ingen af dem ville være dukket op i en smoke test. Spring det ikke over.
- Opdater Claude Code. Kør
claude update. Bekræft, atclaude --versionviser 2.1.111 eller højere. - Beslut din modelstrategi. Automatisk opgradering? Brug
opus-aliaset (skifter 23. april). Fastgør 4.7 eksplicit? Brugclaude-opus-4-7. Bliv på 4.6? Fastgørclaude-opus-4-6inden standardskiftet. - Revidér prompts, der er finjusteret til 4.6's adfærd. 4.7 har stærkere instruktionsfølge. Prompts, der stolede på, at 4.6 fortolkede tvetydige instruktioner løst, kan producere strengere output. Gentest alt, der er promptfølsomt.
- Genkør regressionsevalueringer. Kør din eksisterende evalueringssuite på 4.7. Hold øje med edge cases.
- Genberegn omkostningsbudgetter. Indregn 1,0-1,35× tokenizerinflation. Budgettér med 1,2×-midtpunktet.
- Gennemgå effortniveau-standarder. I Claude Code er standarden nu
xhigh(varhigh). Sandsynligvis en opgradering, men koster mere. Fastgør tilhigh, hvis latenstid eller omkostninger slår kvalitet for din arbejdsbyrde. - Prøv
/ultrareviewpå en åben PR. Hurtigste måde at mærke Claude Code 2.1.111-opgraderingen, og den passer godt sammen med Claude Code-hooks. - Tilmeld dig opgavebudgetter-betaen (valgfrit). Hvis du kører langsigtede agenter, sætter det loft over regningen.
Her er diff'en:
# Before (Opus 4.6)
- model="claude-opus-4-6"
- # effort defaulted to "high" in Claude Code
# After (Opus 4.7)
+ model="claude-opus-4-7" # or "opus" to auto-upgrade
+ # effort now defaults to "xhigh" in Claude Code
+ # thinking={"type": "enabled", "budget_tokens": 16000}Spring ikke trin 3 over. Hvis dine prompts nogensinde sagde noget i retning af "opsummer lidt" eller "kategoriser løst", vil 4.7 sandsynligvis fortolke dem mere bogstaveligt, end 4.6 gjorde. Fuld tjekliste med edge cases findes i Anthropics officielle migrationsguide.
Hvad du bør gøre i denne uge
- Kør
claude update— du skal bruge v2.1.111+. - Prøv
/ultrareviewpå en åben PR. Tager 60 sekunder. Giver dig en ærlig fornemmelse af det nye flerfasede flow. - Test
xhighvsmaxpå en svær debuggingopgave. Hvismaxvinder med >5 pp på din arbejdsbyrde, så fastgør den. Ellers spar pengene. - Revidér tokenizerfølsomme prompts. Genberegn omkostningsbudgetter med 1,2×-midtpunktet for næste måned.
- Hvis du kører langsigtede agenter, så tilmeld dig opgavebudgetter-betaen.
- Stadig på 4.5? Læs Anthropics fulde migrationsguide — springet fra 4.5→4.7 er større end 4.6→4.7.
Er Opus 4.7 en regression? Hvad klagerne faktisk siger
Ikke alle er glade. Reddit-tråden "Claude Opus 4.7 is a serious regression, not an upgrade" nåede forsiden af r/ClaudeAI på lanceringsdagen, og den er værd at tage alvorligt frem for at afvise.
De vigtigste klager, kogt ned:
- Reduceret udførlighed på kodningsopgaver. Flere udviklere rapporterede, at 4.7 producerer kortere, mindre annoterede kodefærdiggørelser sammenlignet med 4.6 — hjælpsomme kommentarer og inline-ræsonnement, som 4.6 tilbød frit, kræver nu eksplicit prompting.
- Øgede afvisninger. Sikkerhedslaget efter Mythos er reelt, og nogle brugere mærker det. Prompts, der involverer sikkerhedsværktøjer, visse systemnære kode og tvetydige automatiseringsscenarier, rammer afvisningsmure, som 4.6 klarede uden friktion.
- Benchmark-gevinster føles ikke subjektivt. Masser af brugere, der kører daglig chat og let kodning, mærker ingen forskel — SWE-bench Pro er en specifik, brutal benchmark, og den mapper ikke lineært til "mine kodeforslag føles klogere."
Vores egen testning sporede lignende mønstre. På multifil-refaktorer og agentopgaver med klare specifikationer er 4.7 med xhigh mærkbart bedre — færre frem-og-tilbage-korrektionscyklusser, renere førsteudkast. På konversationel kodningshjælp og hurtige engangsscripts er deltaen minimal. Den strengere instruktionsfølge er reel: prompts med bevidst tvetydighed opfører sig anderledes, og det er en breaking change, hvis dit workflow afhang af 4.6's løsere fortolkning.
Hvem bør blive på 4.6: Teams, der kører produktionsprompts finjusteret til 4.6's løsere instruktionsfølge, og alle, der laver sikkerhedsforskning og har brug for kapaciteter, som 4.7's sikkerhedslag nu blokerer.
Hvem bør opgradere: Teams, der laver agentbaseret, langsigtet kodningsarbejde — det er her, benchmark-gevinsterne er reelle. Også alle, der bruger Claude Code dagligt, hvor xhigh + /ultrareview genuint ændrer workflowets form.
FAQ
Hvornår blev Claude Opus 4.7 udgivet?
Claude Opus 4.7 blev generelt tilgængelig 16. april 2026. Den udkom samme dag på Claude.ai, Anthropic API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI og Microsoft Foundry. Enterprise- og pay-as-you-go API-standarder skifter fra Opus 4.6 til 4.7 den 23. april 2026.
Hvor meget koster Claude Opus 4.7?
Claude Opus 4.7 koster $5 pr. million input-tokens og $25 pr. million output-tokens, uændret fra Opus 4.6. Den opdaterede tokenizer producerer 1,0-1,35× flere tokens for det samme indhold, så de effektive omkostninger stiger let. Budgettér med 1,2×-midtpunktet og indregn højere tænkningstokenforbrug ved xhigh-effort.
Er Claude Opus 4.7 bedre end GPT-5.4 til kodning?
På SWE-bench Pro, ja — 64,3 % for Opus 4.7 vs 57,7 % for GPT-5.4 Pro, en føring på 6,6 point. På GPQA Diamond er de statistisk lige (94,2 % vs 94,4 %). Til agentkodning i Claude Code er Opus 4.7 med xhigh i øjeblikket det stærkeste valg. Til one-shot-ræsonnementsopgaver er det et møntkast.
Hvad er xhigh-effortniveauet?
xhigh er en ny efforttier mellem high og max, introduceret med Opus 4.7 og nu standard i Claude Code. Den bruger 30-50 % flere tænkningstokens end high og kører cirka 2× langsommere, men vinder 5-8 point på SWE-bench-lignende opgaver. max koster langt mere for kun 1-2 point over xhigh.
Hvad gør /ultrareview i Claude Code?
/ultrareview er en ny slash-kommando i Claude Code 2.1.111+, der kører kodereview i flere faser — separate dedikerede gennemgange for sikkerhed, stil, logik og tests, hver med sit eget kontekstvindue. Den kører i baggrunden, mens du fortsætter med at kode, så du er ikke blokeret og venter på dommen som med /review.
Er Mythos Preview det samme som Opus 4.7?
Nej. Mythos Preview er en separat Anthropic-model med begrænset adgang, annonceret 7. april 2026 — ni dage før Opus 4.7. Den tilgås gennem Project Glasswing og vil ikke blive generelt tilgængelig. Opus 4.7 er den første generelt tilgængelige Claude-model, der leveres under sikkerhedsregimet efter Mythos, med nye automatiserede sikkerhedsforanstaltninger indbygget.
Skal jeg opdatere Claude Code for at bruge Opus 4.7?
Ja. Claude Code v2.1.111 er minimumsversionen for Opus 4.7-understøttelse. Kør claude update for at opgradere, og bekræft derefter med claude --version. Under 2.1.111 kan den nye claude-opus-4-7-modelstreng ikke adresseres, og opus-aliaset peger heller ikke korrekt.
Hvordan migrerer jeg mine prompts fra Opus 4.6 til 4.7?
Migration er for det meste drop-in — skift modelstrengen eller lad opus-aliaset pege. Den reelle risiko er Opus 4.7's stærkere instruktionsfølge. Prompts, der stolede på, at 4.6 fortolkede "lidt" eller "løst" løst, kan producere strengere output. Genkør dine regressionsevalueringer og revidér promptfølsomme stier inden produktiondeployment.
Understøtter Claude Opus 4.7 MCP?
Ja. Claude Opus 4.7 understøtter Model Context Protocol og scorer 77,3 % på Anthropics interne MCP-Atlas-benchmark. Alle eksisterende MCP-servere fungerer uden ændringer. Hvis du har kørt MCP-værktøjer på 4.6, fortsætter de med at virke — ofte med bedre værktøjsbrugsbeslutninger takket være 4.7's stærkere instruktionsfølge.
Er der en gratis version af Claude Opus 4.7?
Ja, med begrænsninger. Claude.ai-gratis-tier-brugere får begrænset Opus 4.7-adgang med daglige beskedgrænser. Til umålt brug gennem API'et eller Claude Code skal du bruge en betalt konto. GitHub Copilot-abonnenter på Pro+, Business eller Enterprise-tiers får Opus 4.7-adgang med en 7,5× premium request-multiplikator indtil 30. april 2026.
Om dette indlæg. Techsy-redaktionen leverer produktionssoftware med Claude Code hver dag og har bygget på Anthropics API siden 3.5 Sonnet. Denne opsummering er baseret på Anthropics officielle lanceringsmeddelelse, Mythos Preview-offentliggørelsen, Claude Code 2.1.111-changeloggen og vores egen testning af API'et på lanceringsdagen.
Bygger du med Claude Opus 4.7? Få en gratis konsultation — vi hjælper teams med at levere produktionsklare agentkodningsworkflows.