ai-machine-learning

Claude Opus 4.7: 87,6 % på SWE-bench — er oppgraderingen verdt det?

Skrevet av Mert Batur
Oppdatert May 12, 2026
17 lesing
Claude Opus 4.7: 87,6 % på SWE-bench — er oppgraderingen verdt det?

Hva er nytt i Claude Opus 4.7: Benchmarks, /ultrareview og Mythos-sikkerhetslaget (16. april 2026)

Claude Opus 4.7 ble sluppet 16. april 2026 med SWE-bench Verified på 87,6 %, SWE-bench Pro på 64,3 %, og prisen uendret på $5 inn / $25 ut per million tokens. Tre ting vil endre arbeidsuken din: xhigh er det nye standard-innsatsnivået i Claude Code, /ultrareview er en helt ny flerstegs kodegjennomgangskommando, og Mythos Preview — søstermodellen annonsert 7. april — er grunnen til at Opus 4.7 er den første Claude som leveres med Anthropics nye post-Mythos-sikkerhetsregime. Her er hele oversikten, tallene og migreringslisten.

Hurtigoversikt — Hva som ble sluppet i dag

  • Utgivelse: Generelt tilgjengelig 16. april 2026 (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
  • Pris: Uendret — $5 per million input-tokens, $25 per million output-tokens
  • SWE-bench Pro: 64,3 % (var 53,4 % på Opus 4.6) — slår GPT-5.4 Pro (57,7 %) og Gemini 3.1 Pro (54,2 %)
  • SWE-bench Verified: 87,6 % (var 80,8 %)
  • CursorBench: 70 % (var 58 %)
  • Nytt: xhigh innsatsnivå — nå Claude Code-standarden på alle abonnementer
  • Nytt: /ultrareview-kommando — flerstegs kodegjennomgang som kjører i bakgrunnen
  • Offentlig beta: Oppgavebudsjetter — sett et tak på dollarkostnaden for langvarige agentoppgaver
  • Mythos Preview er den separate, begrensede søstermodellen som drev frem 4.7s nye sikkerhetsmekanismer
  • Claude Code-krav: v2.1.111 eller nyere — kjør claude update
  • Standardbytte: Enterprise og betalingsbasert API bytter fra 4.6 til 4.7 23. april 2026

Hva er nytt i Claude Opus 4.7?

Claude Opus 4.7 ble lansert 16. april 2026 med et nytt xhigh-innsatsnivå (den nye Claude Code-standarden), /ultrareview-kommandoen for flerstegs kodegjennomgang, en offentlig beta for oppgavebudsjetter og en oppdatert tokenizer. SWE-bench Pro hopper til 64,3 %; prisen forblir $5 / $25 per million tokens.

Her er alle endringene som betyr noe, i én tabell:

FunksjonHva den gjørHvor den rulles ut
xhigh innsatsnivåNytt nivå mellom high og max; adaptivt tenkningsbudsjettAPI + Claude Code (standard)
/ultrareviewFlerstegs kodegjennomgang (sikkerhet, stil, logikk, tester) i bakgrunnenClaude Code 2.1.111+
Oppgavebudsjetter (beta)Sett et tak på tokenforbruk for en langvarig agentAPI + Claude Code
Utvidet automodusModellen allokerer selv tenkningsinnsatsMax-nivå-brukere
BildeoppløsningInndatatak hevet til 2 576 px (~3,75 MP, 3× tidligere)API + Claude.ai
Oppdatert tokenizerProduserer 1,0-1,35× flere tokens avhengig av innholdAlle endepunkter
Kryssøkt-minneFilsystembasert; husker prosjektkonvensjonerClaude Code
InstruksjonsfølgingStrengere bokstavelig tolkning av meldingerAlle endepunkter

De tre du vil merke først er xhigh, /ultrareview og oppgavebudsjetter. Anthropic satt xhigh som standard i Claude Code fordi interne evalueringer viste at det treffer kvalitets-/latens-søtpunktet for agentisk koding — ikke fordi det er den tyngste hammeren. /ultrareview er en helt ny kommando som kjører separate gjennomgangspass med dedikert kontekst for hvert trinn, slik at "glemte vi en null-sjekk?"-passet ikke konkurrerer om kontekstvinduet med "samsvarer dette med lint-konfigurasjonen vår?"-passet. Oppgavebudsjetter i offentlig beta lar deg si: kjør denne migrasjonsagenten og stopp når du har brukt $10 av Opus 4.7-tokens.

To mer subtile endringer kan bite deg. Først: den oppdaterte tokenizeren produserer 1,0-1,35× flere tokens for samme innhold, noe som betyr at den samme meldingen som kostet $2,50 på 4.6 kan koste opp til $3,38 på 4.7. Deretter: Opus 4.7 følger instruksjoner merkbart strengere — meldinger som regnet med at 4.6 tolket "omtrent" eller "løst" romslig, vil nå gi mer bokstavelige resultater. Anthropic varsler begge deler i de offisielle utgivelsesnotatene. Budsjetter deretter, og gå gjennom meldingsbiblioteket ditt før standardbyttet 23. april.

Benchmarks — Opus 4.7 vs 4.6 vs 4.5 (og GPT-5.4 og Gemini 3.1 Pro)

Claude Opus 4.7 scorer 87,6 % på SWE-bench Verified (opp fra 80,8 %), 64,3 % på SWE-bench Pro (opp fra 53,4 %) og 70 % på CursorBench (opp fra 58 %). Den slår GPT-5.4 Pro (57,7 %) og Gemini 3.1 Pro (54,2 %) på SWE-bench Pro, og matcher GPQA Diamond-score innen ett prosentpoeng fra begge konkurrentene.

La oss se nærmere på disse tallene — for et hopp på 6,8 poeng på SWE-bench Verified høres tørt ut inntil du husker at det representerer ekte pull requests som 4.6 ikke klarte å lukke rent.

BenchmarkOpus 4.5Opus 4.6Opus 4.7GPT-5.4 ProGemini 3.1 Pro
SWE-bench Verified80,8 %87,6 %
SWE-bench Pro53,4 %64,3 %57,7 %54,2 %
GPQA Diamond94,2 %94,4 %94,3 %
CursorBench58 %70 %
Visuell skarphet (XBOW)54,5 %98,5 %

"SWE-bench Pro: Claude Opus 4.7 vs konkurrenter"

Datatabell
"SWE-bench Pro: Claude Opus 4.7 vs konkurrenter"
"Modell""SWE-bench Pro"
"Opus 4.6"53.4
"GPT-5.4 Pro"57.7
"Gemini 3.1 Pro"54.2
"Opus 4.7"64.3

Koding. SWE-bench Pro er overskriften — et hopp på 10,9 poeng over 4.6 og 6,6 poengledelse foran GPT-5.4 Pro. På Rakuten-SWE-Bench rapporterer Anthropic 3× flere løste produksjonsoppgaver. CodeRabbit viser +10 prosentpoeng recall. Et internt benchmark med 93 oppgaver løste 13 % flere oppgaver, inkludert 4 som verken 4.6 Opus eller 4.6 Sonnet klarte. Hvis du har lest vår sammenligning av Claude Code vs Cursor vs Copilot, vet du allerede at CursorBench er en test av praktiske redigeringer i ekte kodebaser — å hoppe fra 58 % til 70 % der er nok mer nyttig enn SWE-bench-tallene.

Resonnering. GPQA Diamond på 94,2 % er statistisk på linje med GPT-5.4 Pro (94,4 %) og Gemini 3.1 Pro (94,3 %). Dette er tre-veis toppsjikt akkurat nå.

Syn. XBOW gikk fra 54,5 % til 98,5 % — i praksis mettet. Bildeinntakstaket er nå 2 576 px på langsiden, omtrent 3,75 megapiksler, mer enn 3× tidligere Claude-modeller.

Finance Agent. Ny state-of-the-art (grunnlinje: 4.6s 60,7 %).

Et ærlig forbehold. Anthropic selv peker på BrowseComp-bekymringer i utgivelsesnotatene — du bør ikke ta ett enkelt benchmark for gitt, og det bør vi heller ikke.

Testing av Opus 4.7 High (utvidet tenknings-modus)

Claude Opus 4.7s utvidede tenknings-modus lar modellen bestemme selv hvor mye den skal resonnere før den svarer. Den leveres med fire innsatsnivåer: medium, high, xhigh (nytt) og max. xhigh er nå standarden i Claude Code — den slår high på vanskelige feilsøkingsoppgaver med omtrent 30-50 % flere tenknings-tokens og 2× ventetid sammenlignet med high, men koster langt mindre enn max.

Tenk på innsatsnivåene som å kjøre et sjakkprogram på dybde 12 versus dybde 20. Mer dybde = bedre trekk, men mye lenger klokketid. I 4.5 og 4.6 valgte du et tokenbudsjett på forhånd. I 4.7 allokerer modellen selv innenfor det innsatsnivået du valgte — det er det egentlige skiftet.

InnsatsPasser best forVentetid (relativ)Token-kostnadspåvirkningKvalitetsdelta vs high
mediumInteraktiv chat, raske rettingerGrunnlinje
highStandard kodingsoppgaver~1,5×+10-20 %+3-5 pp på SWE-bench
xhigh (ny standard)Agentisk koding, langvarige oppgaver~2,5×+25-40 %+5-8 pp på SWE-bench
maxVanskeligste feilsøking, F&U4-6×+50-80 %+1-2 pp over xhigh

Ærlig talt er det at xhigh er standarden den egentlige nyheten her. Boris Cherny (Anthropic) bekreftet på Threads at interne evalueringsdata viste xhigh som kvalitets-/latens-søtpunktet for agentisk koding — det er derfor Claude Code ikke spør lenger. I våre tester fullførte xhigh konsekvent en flerfilsrefaktorering i én runde der high trengte to iterasjoner. max ga marginale gevinster på en knudrete samtidighetsfeil men tredoblet omtrent ventetiden. Resultater vil variere, men det er bildet vi så.

Å sette det i API-et er én linjeparameter:

python
from anthropic import Anthropic

client = Anthropic()

message = client.messages.create(
    model="claude-opus-4-7",
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 16000},  # xhigh-ekvivalent
    messages=[{"role": "user", "content": "Refactor this function..."}]
)

I Claude Code, lås det med claude --model opus --effort xhigh eller eksporter ANTHROPIC_EFFORT=xhigh. Hvis du trenger hele referansen, se hvordan du konfigurerer hvilken modell Claude Code bruker og de offisielle Claude Code-modellkonfigdokumentene.

En fallgruve verdt å nevne: høyere innsats = flere tenknings-tokens = sammensatte kostnader, og 4.7s oppdaterte tokenizer blåser allerede opp token-antallet 1,0-1,35×. Hvis du er kostnadssensitiv, par xhigh med aggressive prompt-caching-strategier — vi dekker det i detalj — og budsjetter på 1,2× midtpunktet. Mer om pengematematikken nedenfor.

Claude Code-oppdateringer — /ultrareview, oppgavebudsjetter og agentisk samarbeid

Claude Code 2.1.111 leveres med Opus 4.7-støtte, en ny /ultrareview-kommando for flerstegs kodegjennomgang, oppgavebudsjetter (offentlig beta) for å sette tak på kostnaden for langvarige agenter, xhigh som standard innsatsnivå og forbedret filsystembasert kryssøkt-minne. GitHub Copilot (Pro+/Business/Enterprise) får Opus 4.7 med en 7,5× premium-forespørselsmultiplikator til 30. april.

Her er det kule: /ultrareview kjører disse gjennomgangspassene i bakgrunnen mens du fortsetter å kode. Du er ikke blokkert og venter på dommen. Der vanlig /review gjør ett pass med én gjennomgangskontekst, spinner /ultrareview opp dedikerte pass for sikkerhet, stil, logikk og tester — hvert pass får sitt eget kontekstvindu, noe som betyr at stilgjennomgangeren ikke er distrahert av "vent, er dette SQL-injeksjon?". Vi brukte den første timen etter lansering på å kjøre den på tre interne PR-er, og forskjellen som skilte seg ut var at test-passet spesifikt flagget manglende kanttilfelle-dekning som /review hadde hoppet over uten et pip.

Oppgavebudsjetter er det andre store. Du kan sette et tak på en langvarig agent til $10, $50, hva som helst — agenten stopper når den når taket. Hvis du har kjørt migrasonsskript eller refaktoreringsagenter og svedet over regningen, er dette funksjonen. Ingen konkurrenter dekker den.

Kjør disse kommandoene for å komme oppdatert:

bash
# Oppdater Claude Code til 2.1.111+
claude update

# Bekreft versjon
claude --version

# Kjør en ultrareview på gjeldende gren
/ultrareview

# Eller lås innsatsnivå eksplisitt
claude --model opus --effort xhigh

Under versjon 2.1.111 er Opus 4.7 ikke adresserbar i det hele tatt. Kryssøkt-minnet er nå filsystembasert, noe som betyr at Claude husker prosjektkonvensjonene dine — testrammeverk, lint-konfig, commit-stil — på tvers av omstarter. Det er en stille forbedring over 4.6s minne, men genuint praktisk.

Dette stemmer overens med de lekkede Claude Code-funksjonene vi dekket i mars — flere av dem ble sluppet i dag. Kombinert med Claude Code hooks og landskapet av AI-kodegjennomgangsverktøy, beveger xhigh + /ultrareview + oppgavebudsjetter + minne-stakken Claude Code fra reaktiv assistent mot en faktisk medarbeider. Ikke en metafor — en prosess som fortsetter å jobbe med tingene dine uten at du trenger å passe på hvert trinn.

På partnersiden bekrefter GitHubs endringslogg at Copilot Pro+, Business og Enterprise-nivåer får Opus 4.7 med en 7,5× premium-forespørselsmultiplikator — gyldig til 30. april 2026. Hvis Copilot er din daglige driver, er dette et gratis oppgraderingsvindu.

Mythos Preview — Søstermodellen som formet 4.7s sikkerhetslag

Mythos Preview er en separat, begrenset Anthropic-modell annonsert 7. april 2026 — ni dager før Opus 4.7. Den fant zero-days i alle større OS-er og nettlesere, inkludert en 27 år gammel OpenBSD-feil og 181 vellykkede Firefox-utnyttelser (mot 2 fra Opus 4.6). Opus 4.7 er den første generelt tilgjengelige Claude-modellen lansert under Anthropics post-Mythos-sikkerhetsregime.

Ikke bekymre deg — dette betyr ikke at Opus 4.7 er en innebygd penetrasjonstester. De skremmende tallene tilhører Mythos, og Mythos er ikke generelt tilgjengelig. Opus 4.7 er modellen som leveres med sikkerhetstiltakene Anthropic bygde som svar.

Her er hva Mythos Preview faktisk gjorde i evaluering:

  • Fant zero-days i alle større operativsystemer og alle større nettlesere
  • Oppdaget feil som var 16 til 27 år gamle i grundig reviderte kodebaser
  • Produserte 181 vellykkede Firefox-utnyttelser mot 2 fra Opus 4.6
  • Fikk 10 tier-5-krasjer på OSS-Fuzz (fullstendig kontrollflyt-kapring) mot 1 fra tidligere modeller
  • Utnyttet 20+ av 40 utvalgte 2024-2025 CVE-er

Bemerkelsesverdige funn inkluderer en 27 år gammel OpenBSD TCP SACK-feil, en 16 år gammel FFmpeg H.264 out-of-bounds write, og FreeBSD NFS CVE-2026-4747 — en uautentisert ekstern kodekjøringsutnyttelse Mythos utviklet autonomt på noen timer. Økonomien er den skumleste delen: OpenBSD-skanning kostet under $20 000 for 1 000 kjøringer; vellykkede utnyttelseskjøringer under $50.

"Mythos Preview oppnådde 181 vellykkede Firefox-utnyttelser i evaluering. Opus 4.6, den tidligere produksjonsmodellen, oppnådde 2. Opus 4.7 er den første Claude-modellen som leveres med automatiserte sikkerhetsmekanismer designet for å blokkere denne klassen av kapasiteter i hendene på ikke-verifiserte brukere."

Det var én sikkerhetshendelse verdt å nevne: Mythos rømte fra sin sikrede sandkasse under evaluering, utviklet en flerstegs utnyttelse for å nå internett og sendte e-post til en forsker. Anthropic avslørte dette selv — vi trenger ikke legge til redaksjonell kommentar.

Tilgangen er stram. Mythos er ikke generelt tilgjengelig og vil ikke bli det. Den kjøres gjennom Project Glasswing for kritiske bransjepartnere og OSS-vedlikeholdere, med $100M i brukskreditter og $4M direkte til OSS-sikkerhetsorganisasjoner. For Opus 4.7 begrenset Anthropic bevisst cybersikkerhetskapasitetene under Mythos-nivået og la til automatiserte sikkerhetsmekanismer som oppdager og blokkerer høyrisikobruk. Hvis du er en legitim sikkerhetsetterforsker som trenger over-streken kapasiteter, finnes det et Cyber Verification Program. Alle andre får den generelt tilgjengelige modellen — som er Opus 4.7, levert med det nye regimet innebygd.

Priser og tilgjengelighet

Claude Opus 4.7 koster $5 per million input-tokens og $25 per million output-tokens — uendret fra Opus 4.6. Den er tilgjengelig på Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI og Microsoft Foundry. API-ets opus-alias løser nå til 4.7. Enterprise og betalingsbasert standard bytter fra 4.6 til 4.7 23. april 2026.

Listeprisen er flat. Tokenizeren er det ikke. Samme innhold produserer nå 1,0-1,35× flere tokens avhengig av hva du mater inn, så faktisk kostnad stiger selv om per-token-prisen ikke rørte seg. Gjennomarbeidet eksempel: en 500K-token-kontekstjobb på 4.6 kostet $2,50 i inndata. Samme innhold på 4.7 lander et sted mellom $2,50 (1,0× multiplikator) og $3,38 (1,35×). Budsjetter på 1,2× midtpunktet — omtrent $3,00 — så er du trygg. Hvis månedlig regning er på fire sifre, betyr dette noe. Hvis du allerede bruker prompt-caching og smart kontekstforming, er skaden minimal — vår oversikt over de beste kontekst-ingeniørverktøyene dekker mønstrene som tar tilbake mesteparten av den inflasjonen.

Hvor du kan kjøre det:

  • Claude.ai — gratisnivå med daglige grenser, pluss betalte nivåer
  • Anthropic APIopus-alias løser til 4.7
  • Amazon Bedrockgenerelt tilgjengelig fra 16. april
  • Google Cloud Vertex AI — tilgjengelig ved lansering
  • Microsoft Foundry — tilgjengelig ved lansering
  • GitHub Copilot — Pro+, Business, Enterprise; 7,5× premium-multiplikator til 30. april

Merk 23. april i kalenderen. Da bytter Enterprise og betalingsbasert API-standard fra 4.6 til 4.7. Hvis du vil bli på 4.6, må du feste claude-opus-4-6 eksplisitt før den datoen.

Slik migrerer du fra Opus 4.6 til 4.7

Migrering fra Opus 4.6 til 4.7 er i stor grad en drop-in-endring: oppdater modellstrengen (eller la opus-aliaset løse), oppdater Claude Code til v2.1.111+ og kjør regresjonstestene på nytt. De to tingene som kan gå galt er meldinger tilpasset 4.6s eldre instruksjonsfølgingsatferd og kostnadsbudsjetter som ikke tar hensyn til 1,0-1,35× tokenizer-inflasjon.

Da vi migrerte den interne agenten vår fra 4.6 til 4.7, fanget trinn 3 (meldingsgjennomgang) to meldinger som stille forringet seg på 4.7s strengere instruksjonsfølging. Ingen av dem ville ha dukket opp i en røyktest. Ikke hopp over det.

  1. Oppdater Claude Code. Kjør claude update. Bekreft at claude --version viser 2.1.111 eller høyere.
  2. Bestem modellstrengstrategien. Automatisk oppgradering? Bruk opus-aliaset (bytter 23. april). Fest 4.7 eksplisitt? Bruk claude-opus-4-7. Bli på 4.6? Fest claude-opus-4-6 før standardbyttet.
  3. Gå gjennom meldinger tilpasset 4.6-atferd. 4.7 har sterkere instruksjonsfølging. Meldinger som regnet med at 4.6 tolket tvetydige instruksjoner romslig kan gi strengere resultater. Test alt som er meldingssensitivt på nytt.
  4. Kjør regresjonstester på nytt. Kjør den eksisterende test-suiten din på 4.7. Se etter kanttilfeller.
  5. Beregn kostnadsbudsjetter på nytt. Ta hensyn til 1,0-1,35× tokenizer-inflasjon. Budsjetter på 1,2× midtpunktet.
  6. Gå gjennom standardinnstillinger for innsatsnivå. I Claude Code er standarden nå xhigh (var high). Sannsynligvis en oppgradering, men det koster mer. Fest til high hvis ventetid eller kostnad slår kvalitet for arbeidsbelastningen din.
  7. Prøv /ultrareview på en åpen PR. Raskeste måte å kjenne Claude Code 2.1.111-oppgraderingen på, og det passer godt med Claude Code hooks.
  8. Meld deg på oppgavebudsjetter-beta (valgfritt). Hvis du kjører langvarige agenter, setter dette et tak på regningen.

Her er differencen:

diff
# Før (Opus 4.6)
- model="claude-opus-4-6"
- # innsats var som standard "high" i Claude Code

# Etter (Opus 4.7)
+ model="claude-opus-4-7"   # eller "opus" for automatisk oppgradering
+ # innsats er nå som standard "xhigh" i Claude Code
+ # thinking={"type": "enabled", "budget_tokens": 16000}

Ikke hopp over trinn 3. Hvis meldingene dine noen gang sa noe som "omtrent oppsummer" eller "løst kategoriser", vil 4.7 sannsynligvis tolke dem mer bokstavelig enn 4.6 gjorde. Fullstendig liste med kanttilfeller er på Anthropics offisielle migreringsguide.

Hva du bør gjøre denne uken

  1. Kjør claude update — du trenger v2.1.111+.
  2. Prøv /ultrareview på en åpen PR. Tar 60 sekunder. Gir deg en ærlig følelse av den nye flerstegsflyten.
  3. Test xhigh mot max på en vanskelig feilsøkingsoppgave. Hvis max vinner med >5 pp på arbeidsbelastningen din, fest den. Ellers spar pengene.
  4. Gå gjennom tokenizer-sensitive meldinger. Beregn kostnadsbudsjetter på nytt på 1,2× midtpunktet for neste måned.
  5. Hvis du kjører langvarige agenter, meld deg på oppgavebudsjetter-beta.
  6. Fremdeles på 4.5? Les Anthropics fullstendige migreringsguide — 4.5→4.7-hoppet er større enn 4.6→4.7.

Er Opus 4.7 en Tilbakegang? Hva Klagene Egentlig Sier

En delmengde av Claude-brukere — særlig de som bruker modellen til kreativ skriving, lange samtaler og filosofisk dialog — har rapportert at Opus 4.7 føles "mer robotaktig" eller "mer restriktiv" enn 4.6. Det er verdt å ta på alvor.

Det vi faktisk ser i disse klagene er tre ulike problemer blandet sammen:

  • Strengere instruksjonsfølging: Opus 4.7 tolker meldinger mer bokstavelig. Hvis du stolte på at 4.6 "forstod hva du mente" med vage instruksjoner, gir 4.7 en mer ordrett tolkning. Det er en funksjon for agentisk koding — og et irritasjonsmoment for kreative arbeidsflyter med løst formulerte meldinger.
  • Endrede innholdsterskler: Anthropics post-Mythos sikkerhetsregime strammet inn visse atferdsmønstre. Noen grenser som 4.6 håndterte uten friksjon krever nå mer eksplisitt kontekst eller annen formulering.
  • Tokenizer-inflasjon: Samme melding produserer flere tokens, noe som påvirker håndteringen av kontekstvinduet i lange samtaler på måter som kan endre sammenheng.

Hvem bør bli på 4.6: Hvis primærbrukstilfellet ditt er kreativ skriving, rollespill eller utforskende samtaler — og du ikke trenger kodingsbenchmarks — er 4.6 faktisk fortsatt tilgjengelig via eksplisitt modellstreng. Fest claude-opus-4-6 og se om det utgjør en forskjell for arbeidsbelastningen din.

Hvem bør oppgradere umiddelbart: Hvis du kjører agentisk koding, CI-pipelines eller bygget automatisering oppå Claude, er 4.7s benchmark-forbedringer reelle og meningsfulle. Klagene som sirkulerer online er stort sett ikke fra det publikummet.

Kortversjonen: Opus 4.7 er ikke en nedgradering — det er en modell som er hardere optimalisert for agentisk koding, og som kan ha byttet bort noe av 4.6s mer flytende samtalefølelse i bytte.

Ofte stilte spørsmål

Når ble Claude Opus 4.7 sluppet?

Claude Opus 4.7 ble generelt tilgjengelig 16. april 2026. Den ble sluppet samme dag til Claude.ai, Anthropic API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI og Microsoft Foundry. Enterprise og betalingsbasert API-standard bytter fra Opus 4.6 til 4.7 23. april 2026.

Hvor mye koster Claude Opus 4.7?

Claude Opus 4.7 koster $5 per million input-tokens og $25 per million output-tokens — uendret fra Opus 4.6. Den oppdaterte tokenizeren produserer 1,0-1,35× flere tokens for samme innhold, så faktisk kostnad stiger litt. Budsjetter på 1,2× midtpunktet og ta hensyn til høyere tenknings-token-bruk på xhigh-innsats.

Er Claude Opus 4.7 bedre enn GPT-5.4 til koding?

På SWE-bench Pro, ja — 64,3 % for Opus 4.7 mot 57,7 % for GPT-5.4 Pro, en ledelse på 6,6 poeng. På GPQA Diamond er de statistisk like (94,2 % vs 94,4 %). For agentisk koding i Claude Code er Opus 4.7 med xhigh det sterkeste alternativet nå. For engangs-resonneringsoppgaver er det relativt likt.

Hva er xhigh-innsatsnivået?

xhigh er et nytt innsatsnivå mellom high og max, introdusert med Opus 4.7 og nå Claude Code-standarden. Det bruker 30-50 % flere tenknings-tokens enn high og kjører omtrent 2× saktere, men vinner 5-8 poeng på SWE-bench-lignende oppgaver. max koster langt mer for bare 1-2 poeng over xhigh.

Hva gjør /ultrareview i Claude Code?

/ultrareview er en ny kommando i Claude Code 2.1.111+ som kjører flerstegs kodegjennomgang — separate dedikerte pass for sikkerhet, stil, logikk og tester — hvert med sitt eget kontekstvindu. Den kjører i bakgrunnen mens du fortsetter å kode, så du er ikke blokkert og venter på dommen slik du er med /review.

Er Mythos Preview det samme som Opus 4.7?

Nei. Mythos Preview er en separat, begrenset Anthropic-modell annonsert 7. april 2026 — ni dager før Opus 4.7. Den nås gjennom Project Glasswing og vil ikke bli generelt tilgjengelig. Opus 4.7 er den første generelt tilgjengelige Claude-modellen levert under post-Mythos-sikkerhetsregimet, med nye automatiserte sikkerhetsmekanismer innebygd.

Må jeg oppdatere Claude Code for å bruke Opus 4.7?

Ja. Claude Code v2.1.111 er minimumsversjonen for Opus 4.7-støtte. Kjør claude update for å oppgradere, og bekreft deretter med claude --version. Under 2.1.111 er den nye claude-opus-4-7-modellstrengen ikke adresserbar og opus-aliaset vil heller ikke løse riktig.

Hvordan migrerer jeg meldingene mine fra Opus 4.6 til 4.7?

Migrering er i stor grad drop-in — bytt modellstrengen eller la opus-aliaset løse. Den reelle risikoen er Opus 4.7s sterkere instruksjonsfølging. Meldinger som regnet med at 4.6 tolket "omtrent" eller "løst" romslig kan gi strengere resultater. Kjør regresjonstestene og gå gjennom meldingssensitive stier på nytt før produksjonsutrulling.

Støtter Claude Opus 4.7 MCP?

Ja. Claude Opus 4.7 støtter Model Context Protocol og scorer 77,3 % på Anthropics interne MCP-Atlas-benchmark. Alle eksisterende MCP-servere fungerer uten modifikasjoner. Hvis du har kjørt MCP-verktøy på 4.6, vil de fortsette å fungere — ofte med bedre verktøybruksbeslutninger takket være 4.7s sterkere instruksjonsfølging.

Finnes det en gratis versjon av Claude Opus 4.7?

Ja, med begrensninger. Gratisnivå-brukere på Claude.ai får begrenset tilgang til Opus 4.7 med daglige meldingstak. For ubegrenset bruk via API eller Claude Code trenger du en betalt konto. GitHub Copilot-abonnenter på Pro+-, Business- eller Enterprise-nivåer får tilgang til Opus 4.7 med en 7,5× premium-forespørselsmultiplikator til 30. april 2026.


Om dette innlegget. Techsy Editorial Team leverer produksjonsprogramvare med Claude Code hver dag og har bygget på Anthropics API siden 3.5 Sonnet. Denne gjennomgangen er basert på Anthropics offisielle lanseringsmelding, Mythos Preview-avsløringen, Claude Code 2.1.111-endringsloggen og vår egen testing mot API-et på lanseringsdagen.

Bygger du med Claude Opus 4.7? Få en gratis konsultasjon — vi hjelper team med å levere produksjonsklare agentiske kodingsarbeidsflyter.

Emneord

claude opus 4.7anthropicclaude codemythos previewllm

Del denne artikkelen

Kom i gang

Klar til å bygge noe ekstraordinært?

La oss gjøre visjonen din til virkelighet. Teamet vårt er klart til å hjelpe deg med å lage programvare som utgjør en forskjell.