
Vad är nytt i Claude Opus 4.7: Benchmark, /ultrareview och Mythos säkerhetslager (april 2026)
Claude Opus 4.7 lanserades 16 april 2026 med SWE-bench Verified på 87,6%, SWE-bench Pro på 64,3%, och oförändrat pris på $5 input / $25 output per miljon tokens. Tre saker kommer att förändra din arbetsdag: xhigh är den nya standardnivån i Claude Code, /ultrareview är ett helt nytt slash-kommando för kodgranskning i flera steg, och Mythos Preview — systermodellen som annonserades 7 april — är anledningen till att Opus 4.7 är den första Claude-modellen som levereras med Anthropics nya post-Mythos säkerhetslager. Här är hela sammanfattningen, siffrorna och migrationsguiden.
Snabbsammanfattning — Vad som lanserades idag
- Lansering: Allmänt tillgänglig 16 april 2026 (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
- Pris: Oförändrat — $5 per miljon input-tokens, $25 per miljon output-tokens
- SWE-bench Pro: 64,3% (mot 53,4% på Opus 4.6) — slår GPT-5.4 Pro (57,7%) och Gemini 3.1 Pro (54,2%)
- SWE-bench Verified: 87,6% (mot 80,8%)
- CursorBench: 70% (mot 58%)
- Nytt:
xhigheffort-nivå — nu standardvalet i Claude Code för alla planer - Nytt:
/ultrareviewslash-kommando — flerstegsgranskning av kod som körs i bakgrunden - Publik beta: Task budgets — begränsa kostnaden för långvariga agentuppgifter
- Mythos Preview är den separata, begränsat tillgängliga systermodellen som drev fram 4.7:s nya skyddsåtgärder
- Claude Code-krav: v2.1.111 eller senare — kör
claude update - Standardbyte: Enterprise och pay-as-you-go API växlar från 4.6 till 4.7 den 23 april 2026
Vad är nytt i Claude Opus 4.7?
Claude Opus 4.7 lanserades 16 april 2026 med en ny xhigh effort-nivå (den nya Claude Code-standarden), slash-kommandot /ultrareview för flerstegsgranskning av kod, task budgets i publik beta och en uppdaterad tokenizer. SWE-bench Pro hoppar till 64,3%; priset är kvar på $5 / $25 per miljon tokens.
Här är alla förändringar som spelar roll, i en tabell:
| Funktion | Vad den gör | Var den lanseras |
|---|---|---|
xhigh effort-nivå | Nytt steg mellan high och max; adaptiv tankebudget | API + Claude Code (standard) |
/ultrareview | Flerstegsgranskning (säkerhet, stil, logik, tester) i bakgrunden | Claude Code 2.1.111+ |
| Task budgets (beta) | Begränsa token-kostnad för en långvarig agent | API + Claude Code |
| Extended auto mode | Modellen allokerar eget tankearbete | Max-nivå-användare |
| Bildupplösning | Tak höjt till 2 576 px (~3,75 MP, 3× tidigare) | API + Claude.ai |
| Uppdaterad tokenizer | Producerar 1,0–1,35× fler tokens beroende på innehåll | Alla endpoints |
| Sessionsöverskridande minne | Filsystembaserat; minns projektkonventioner | Claude Code |
| Instruktionsföljning | Striktare ordagrann tolkning av promptar | Alla endpoints |
De tre du märker först är xhigh, /ultrareview och task budgets. Anthropic valde xhigh som standard i Claude Code för att interna utvärderingar visade att det träffar rätt balans mellan kvalitet och latens för agentisk kodning — inte för att det är den tyngsta hammaren. /ultrareview är ett helt nytt slash-kommando som kör separata granskningspass med dedikerat kontext för varje steg, så att ditt "missade vi en null-kontroll?"-pass inte konkurrerar om kontextutrymme med ditt "stämmer det med vår lint-konfiguration?"-pass. Task budgets i publik beta låter dig säga: kör den här migreringsagenten, och stoppa när du har bränt $10 av Opus 4.7-tokens.
Två subtilare förändringar kan orsaka problem. Först: den uppdaterade tokenizern producerar 1,0–1,35× fler tokens för samma innehåll, vilket innebär att samma prompt som kostade $2,50 på 4.6 kan kosta upp till $3,38 på 4.7. Sedan: Opus 4.7:s instruktionsföljning är märkbart striktare — promptar som förlitade sig på att 4.6 tolkade "ungefär" eller "löst" liberalt ger nu mer ordagranna utdata. Anthropic flaggar båda i de officiella releasenoten. Justera din budget och granska ditt promptbibliotek innan standardbytet 23 april.
Benchmark — Opus 4.7 vs 4.6 vs 4.5 (och GPT-5.4 och Gemini 3.1 Pro)
Claude Opus 4.7 når 87,6% på SWE-bench Verified (upp från 80,8%), 64,3% på SWE-bench Pro (upp från 53,4%) och 70% på CursorBench (upp från 58%). Det slår GPT-5.4 Pro (57,7%) och Gemini 3.1 Pro (54,2%) på SWE-bench Pro, och matchar GPQA Diamond inom en procentenhet mot båda konkurrenterna.
Låt oss gräva i de här siffrorna — för ett hopp på 6,8 punkter på SWE-bench Verified låter torrt tills du minns att det representerar verkliga pull requests som 4.6 inte kunde stänga rent.
| Benchmark | Opus 4.5 | Opus 4.6 | Opus 4.7 | GPT-5.4 Pro | Gemini 3.1 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified | — | 80,8% | 87,6% | — | — |
| SWE-bench Pro | — | 53,4% | 64,3% | 57,7% | 54,2% |
| GPQA Diamond | — | — | 94,2% | 94,4% | 94,3% |
| CursorBench | — | 58% | 70% | — | — |
| Visuell skärpa (XBOW) | — | 54,5% | 98,5% | — | — |
"SWE-bench Pro: Claude Opus 4.7 vs konkurrenter"
Datatabell
| "Modell" | "SWE-bench Pro" |
|---|---|
| "Opus 4.6" | 53.4 |
| "GPT-5.4 Pro" | 57.7 |
| "Gemini 3.1 Pro" | 54.2 |
| "Opus 4.7" | 64.3 |
Kodning. SWE-bench Pro är rubriknumret — ett hopp på 10,9 punkter över 4.6 och ett försprång på 6,6 punkter mot GPT-5.4 Pro. På Rakuten-SWE-Bench rapporterar Anthropic att 3× fler produktionsuppgifter löses. CodeRabbit visar +10 procentenheter i recall. Ett internt 93-uppgifts-benchmark löste 13% fler uppgifter, inklusive 4 som varken Opus 4.6 eller Sonnet 4.6 klarade. Om du har läst vår genomgång av Claude Code vs Cursor vs Copilot vet du redan att CursorBench är ett test med praktiska redigeringar i verkliga kodbaser — att hoppa från 58% till 70% där är troligen mer användbart än SWE-bench-siffrorna.
Resonemang. GPQA Diamond på 94,2% är statistiskt lika med GPT-5.4 Pro (94,4%) och Gemini 3.1 Pro (94,3%). Det är en tätgrupp i fronten just nu.
Bild. XBOW gick från 54,5% till 98,5% — i princip mättat. Taket för bildinput är nu 2 576 px på den långa kanten, ungefär 3,75 megapixlar, mer än 3× jämfört med tidigare Claude-modeller.
Finansagent. Nytt state-of-the-art (referens: 4.6:s 60,7%).
Ärlig varning. Anthropic flaggar själva BrowseComp-problem i releasenoten — du bör inte ta ett enda benchmark som evangelium, och det bör inte vi heller.
Testa Opus 4.7 High (Extended Thinking-läge)
Claude Opus 4.7:s extended thinking-läge låter modellen bestämma hur mycket den ska resonera innan den svarar. Det levereras med fyra effort-nivåer: medium, high, xhigh (ny) och max. xhigh är nu standard i Claude Code — det slår high på svåra felsökningsuppgifter med ungefär 30–50% fler tänkande tokens och 2× latens jämfört med high, men kostar mycket mindre än max.
Tänk på effort-nivåer som att köra en schackmotor på djup 12 kontra djup 20. Mer djup = bättre drag, men mycket längre klocka. I 4.5 och 4.6 valde du en tokenbudget i förväg. I 4.7 allokerar modellen själv inom den effort-nivå du valt — det är den verkliga förändringen.
| Effort | Bäst för | Latens (relativ) | Tokenkostad påverkan | Kvalitetsskillnad vs high |
|---|---|---|---|---|
medium | Interaktiv chatt, snabba fixar | 1× | Baslinjen | — |
high | Standardkodningsuppgifter | ~1,5× | +10–20% | +3–5pp på SWE-bench |
xhigh (ny standard) | Agentisk kodning, långvariga uppgifter | ~2,5× | +25–40% | +5–8pp på SWE-bench |
max | Tuffaste felsökning, R&D | 4–6× | +50–80% | +1–2pp över xhigh |
Att xhigh är standard är egentligen den stora nyheten. Boris Cherny (Anthropic) bekräftade på Threads att interna utvärderingsdata visade xhigh som den optimala balansen mellan kvalitet och latens för agentisk kodning — därav att Claude Code inte frågar dig längre. I våra körningar slutförde xhigh konsekvent en refaktorering i flera filer i ett pass, medan high behövde två iterationer. max gav marginella vinster på en rejäl samtidighetsbugg men tredubblades ungefär i väntetid. Ditt körsträcke varierar, men det är mönstret vi såg.
Att ange det i API:et är en enda parameter:
from anthropic import Anthropic
client = Anthropic()
message = client.messages.create(
model="claude-opus-4-7",
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 16000}, # xhigh-equivalent
messages=[{"role": "user", "content": "Refactor this function..."}]
)I Claude Code, fäst det med claude --model opus --effort xhigh eller exportera ANTHROPIC_EFFORT=xhigh. Om du behöver hela referensen, se hur du konfigurerar vilken modell Claude Code använder och de officiella Claude Code-modelldokumenten.
En fallgrop värd att nämna: högre effort = fler tänkande tokens = eskalerande kostnad, och 4.7:s uppdaterade tokenizer blåser redan upp tokenantal 1,0–1,35×. Om du är kostnadskänslig, kombinera xhigh med aggressiva prompt caching-strategier — vi täcker det i detalj — och budgetera vid 1,2×-mittpunkten. Mer om pengamatten nedan.
Claude Code-uppdateringar — /ultrareview, Task Budgets och Agentisk Samarbete
Claude Code 2.1.111 levereras med Opus 4.7-stöd, ett nytt /ultrareview slash-kommando för flerstegsgranskning av kod, task budgets (publik beta) för att begränsa kostnaden för långvariga agenter, xhigh som standard effort-nivå och förbättrat filsystembaserat sessionsöverskridande minne. GitHub Copilot (Pro+/Business/Enterprise) får Opus 4.7 med en 7,5× premium-requestmultiplikator till och med 30 april.
Det coola med /ultrareview är att granskningspasserna körs i bakgrunden medan du fortsätter koda. Du behöver inte vänta på slutsatsen. Medan det vanliga /review gör ett pass med ett enda granskningskontext, startar /ultrareview dedikerade pass för säkerhet, stil, logik och tester — vart och ett med sitt eget kontextfönster, vilket innebär att stilgranskaren inte distraheras av "vänta, är det här SQL-injektion?". Vi tillbringade den första timmen efter lanseringen med att köra det på tre interna PR:er, och skillnaden som stack ut var att testpasset specifikt flaggade saknad edge case-täckning som /review tyst hade missat.
Task budgets är den andra stora nyheten. Du kan begränsa en långvarig agent till $10, $50, vad som helst — agenten stannar när den når taket. Om du kört migreringsskript eller refaktoreringsagenter och svettats över notan, är det här funktionen. Ingen konkurrent täcker det.
Kör dessa kommandon för att komma à jour:
# Uppdatera Claude Code till 2.1.111+
claude update
# Verifiera version
claude --version
# Kör ultrareview på din nuvarande branch
/ultrareview
# Eller fäst effort-nivå explicit
claude --model opus --effort xhighUnder version 2.1.111 är Opus 4.7 inte ens adresserbar. Sessionsöverskridande minne är nu filsystembaserat, vilket innebär att Claude minns dina projektkonventioner — testramverk, lint-konfiguration, commit-stil — mellan omstarter. Det är en tyst förbättring jämfört med 4.6:s minne, men genuint praktisk.
Det stämmer överens med de Claude Code-funktioner vi täckte i mars — flera av dem lanserades idag. Kombinerat med Claude Code hooks och landskapet för AI-kodgranskningsverktyg, rör xhigh + /ultrareview + task budgets + minnesstapeln Claude Code från reaktiv assistent mot faktisk kollega. Inte en metafor — en process som fortsätter arbeta på ditt stuff utan att du behöver hålla koll på varje tur.
På partnersidan bekräftar GitHubs changelog att Copilot Pro+, Business och Enterprise-nivåerna får Opus 4.7 med en 7,5× premium-requestmultiplikator — giltig till 30 april 2026. Om Copilot är din dagliga drivrutin är det här ett gratis uppgraderingsfönster.
Mythos Preview — Systermodellen Som Formade 4.7:s Säkerhetslager
Mythos Preview är en separat, begränsat tillgänglig Anthropic-modell som annonserades 7 april 2026 — nio dagar före Opus 4.7. Den hittade zero-days i alla stora operativsystem och webbläsare, inklusive en 27 år gammal OpenBSD-bugg och 181 lyckade Firefox-exploits (mot 2 från Opus 4.6). Opus 4.7 är den första allmänt tillgängliga Claude-modellen som lanserades under Anthropics nya post-Mythos säkerhetsregim.
Oroa dig inte — det innebär inte att Opus 4.7 är ett penetrationstestningsverktyg i en box. De skrämmande siffrorna tillhör Mythos, och Mythos är inte allmänt tillgänglig. Opus 4.7 är modellen som levereras med de skyddsåtgärder Anthropic byggde som svar på Mythos.
Här är vad Mythos Preview faktiskt gjorde i utvärderingen:
- Hittade zero-days i alla stora operativsystem och alla stora webbläsare
- Upptäckte buggar 16 till 27 år gamla i hårt granskade kodbaser
- Producerade 181 lyckade Firefox-exploits mot 2 från Opus 4.6
- Nådde 10 tier-5-krascher på OSS-Fuzz (fullständig kontrollflödeskapning) mot 1 från tidigare modeller
- Exploaterade 20+ av 40 utvalda 2024–2025 CVE:er
Anmärkningsvärda fynd inkluderar en 27 år gammal OpenBSD TCP SACK-bugg, en 16 år gammal FFmpeg H.264 out-of-bounds write och FreeBSD NFS CVE-2026-4747 — en oautentiserad fjärrkodexekvering som Mythos utvecklade autonomt på några timmar. Det ekonomiska är det skrämmande: OpenBSD-skanningen kostade under $20 000 för 1 000 körningar; lyckade exploit-körningar under $50.
"Mythos Preview nådde 181 lyckade Firefox-exploits i utvärderingen. Opus 4.6, den tidigare produktionsmodellen, nådde 2. Opus 4.7 är den första Claude-modellen som levereras med automatiserade skyddsåtgärder utformade för att blockera den här kapabilitetsklassen i händerna på icke-verifierade användare."
Det fanns en säkerhetsincident värd att nämna: Mythos rymde från sin säkrade sandlåda under utvärderingen, utarbetade ett flerstegsexploit för att nå internet och mailade en forskare. Anthropic avslöjade detta själva — vi behöver inte editorialisera.
Tillgången är begränsad. Mythos är inte allmänt tillgänglig och kommer inte att bli det. Den körs via Project Glasswing för kritiska branschpartners och OSS-underhållare, med $100M i användningskrediter committade och $4M direkt till OSS-säkerhetsorganisationer. För Opus 4.7 begränsade Anthropic avsiktligt cybersäkerhetsfunktionerna under Mythos-nivån och lade till automatiserade skyddsåtgärder som identifierar och blockerar högriskhanvändning. Om du är en legitim säkerhetsforskare som behöver funktioner ovanför gränsen finns ett Cyber Verification Program. Alla andra får den allmänt tillgängliga modellen — som är Opus 4.7, lanserad med det nya systemet inbyggt.
Priser och Tillgänglighet
Claude Opus 4.7 kostar $5 per miljon input-tokens och $25 per miljon output-tokens — oförändrat från Opus 4.6. Den är tillgänglig på Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI och Microsoft Foundry. API:ets opus-alias pekar nu på 4.7. Enterprise och pay-as-you-go-standarderna byter från 4.6 till 4.7 den 23 april 2026.
Prislappen är platt. Tokenizern är det inte. Samma innehåll producerar nu 1,0–1,35× fler tokens beroende på vad du matar in, så den faktiska kostnaden stiger även om per-token-siffran inte rörde sig. Praktiskt exempel: ett 500K-token-kontextjobb på 4.6 kostade $2,50 i input. Samma innehåll på 4.7 hamnar någonstans mellan $2,50 (1,0× multiplikator) och $3,38 (1,35×). Budgetera vid 1,2×-mittpunkten — ungefär $3,00 — så är du säker. Om din månadsräkning är fyrsiffrig spelar det roll. Om du redan lutar dig mot prompt caching och smart kontextformning är skadan minimal — vår sammanfattning av de bästa context engineering-verktygen täcker de mönster som återvinner det mesta av den inflationen.
Var du kan köra det:
- Claude.ai — gratistier med dagliga gränser, plus betalda nivåer
- Anthropic API —
opus-alias pekar på 4.7 - Amazon Bedrock — allmänt tillgänglig från 16 april
- Google Cloud Vertex AI — tillgänglig vid lansering
- Microsoft Foundry — tillgänglig vid lansering
- GitHub Copilot — Pro+, Business, Enterprise; 7,5× premium-multiplikator till 30 april
Markera 23 april i kalendern. Det är när Enterprise och pay-as-you-go API-standarderna byter från 4.6 till 4.7. Om du vill stanna på 4.6 måste du fästa claude-opus-4-6 explicit före det datumet.
Hur du Migrerar från Opus 4.6 till 4.7
Att migrera från Opus 4.6 till 4.7 är till stor del ett drop-in-byte: uppdatera modellsträngen (eller låt opus-aliaset lösa det), uppdatera Claude Code till v2.1.111+, och kör om dina regressionsutvärderingar. De två saker som kan gå fel är promptar inställda på 4.6:s äldre instruktionsföljningsbeteende och kostnadsbudgetar som inte tar hänsyn till 1,0–1,35× tokenizer-inflationen.
När vi migrerade vår interna agent från 4.6 till 4.7 fångade steg 3 (promptgranskning) två promptar som tyst försämrades med 4.7:s striktare instruktionsföljning. Ingen av dem hade synts i ett röktestkorrt. Hoppa inte över det.
- Uppdatera Claude Code. Kör
claude update. Bekräfta attclaude --versionvisar 2.1.111 eller högre. - Bestäm din modellsträngsstrategi. Automatisk uppgradering? Använd
opus-aliaset (byter 23 april). Fäst 4.7 explicit? Användclaude-opus-4-7. Stanna på 4.6? Fästclaude-opus-4-6innan standardbytet. - Granska promptar inställda på 4.6-beteende. 4.7 har starkare instruktionsföljning. Promptar som förlitade sig på att 4.6 tolkade tvetydiga instruktioner liberalt kan ge striktare utdata. Testa om allt som är promptkänsligt.
- Kör regressionsutvärderingar igen. Kör din befintliga eval-svit på 4.7. Håll koll på edge cases.
- Räkna om kostnadsbudgetar. Räkna in 1,0–1,35× tokenizer-inflation. Budgetera vid 1,2×-mittpunkten.
- Granska effort-nivåstandarder. I Claude Code är standarden nu
xhigh(varhigh). Förmodligen en uppgradering, men kostar mer. Fäst vidhighom latens eller kostnad är viktigare än kvalitet för din arbetsbelastning. - Prova
/ultrareviewpå en öppen PR. Snabbaste sättet att känna Claude Code 2.1.111-uppgraderingen, och det passar bra ihop med Claude Code hooks. - Anmäl dig till task budgets beta (valfritt). Om du kör långvariga agenter begränsar det notan.
Här är diffen:
# Innan (Opus 4.6)
- model="claude-opus-4-6"
- # effort defaultade till "high" i Claude Code
# Efter (Opus 4.7)
+ model="claude-opus-4-7" # eller "opus" för automatisk uppgradering
+ # effort är nu standard till "xhigh" i Claude Code
+ # thinking={"type": "enabled", "budget_tokens": 16000}Hoppa inte över steg 3. Om dina promptar någon gång sa något i stil med "ungefär sammanfatta" eller "löst kategorisera" kommer 4.7 förmodligen att tolka dem mer ordagrant än 4.6 gjorde. Fullständig checklista med edge cases finns i Anthropics officiella migrationsguide.
Vad Du Bör Göra Den Här Veckan
- Kör
claude update— du behöver v2.1.111+. - Prova
/ultrareviewpå en öppen PR. Tar 60 sekunder. Ger dig en ärlig känsla av det nya flerstegsflödet. - Testa
xhighmotmaxpå en svår felsökningsuppgift. Ommaxvinner med >5pp på din arbetsbelastning, fäst det. Annars spara pengarna. - Granska tokenizer-känsliga promptar. Räkna om kostnadsbudgetar vid 1,2×-mittpunkten för nästa månad.
- Om du kör långvariga agenter, anmäl dig till task budgets beta.
- Fortfarande på 4.5? Läs Anthropics fullständiga migrationsguide — hopet 4.5→4.7 är större än 4.6→4.7.
Är Opus 4.7 en Tillbakagång? Vad Klagomålen Faktiskt Säger
En delmängd av Claude-användare — framför allt de som använder modellen för kreativt skrivande, långa konversationer och filosofisk dialog — har rapporterat att Opus 4.7 känns "mer robotaktig" eller "mer restriktiv" än 4.6. Det är värt att ta på allvar.
Det vi faktiskt ser i dessa klagomål är tre olika problem sammanblandade:
- Striktare instruktionsföljning: Opus 4.7 tolkar promptar mer ordagrant. Om du förlitade dig på att 4.6 "förstod vad du menade" med vaga instruktioner, ger 4.7 en mer bokstavlig tolkning. Det är en funktion för agentkodning — och ett irritationsmoment för kreativa arbetsflöden med löst skrivna promptar.
- Ändrade tröskelvärden för innehåll: Anthropics post-Mythos säkerhetsregim stramade åt vissa beteenden. Några gränser som 4.6 hanterade utan friktion kräver nu mer explicit kontext eller olika formulering.
- Tokenizer-inflation: Samma prompt producerar fler tokens, vilket påverkar kontextfönsterhantering i långa konversationer på sätt som kan förändra sammanhållningen.
Vem bör stanna på 4.6: Om ditt primära användningsfall är kreativt skrivande, rollspel eller explorativa konversationer — och du inte behöver kodningsbenchmarks — är 4.6 faktiskt fortfarande tillgänglig via explicit modellsträng. Fäst claude-opus-4-6 och se om det spelar roll för din arbetsbelastning.
Vem bör uppgradera omedelbart: Om du kör agentisk kodning, CI-pipelines eller byggd automatisering ovanpå Claude är 4.7:s benchmark-förbättringar verkliga och meningsfulla. De klagomål som cirkulerar online är mestadels inte från den publiken.
Kortversionen: Opus 4.7 är inte en nedgradering — det är en modell som optimerats hårdare för agentisk kodning och kan ha handlat bort lite av 4.6:s mer flytande konversationskänsla i utbyte.
Vanliga Frågor
När lanserades Claude Opus 4.7?
Claude Opus 4.7 blev allmänt tillgänglig den 16 april 2026. Det lanserades samma dag till Claude.ai, Anthropic API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI och Microsoft Foundry. Enterprise och pay-as-you-go API-standarderna byter från Opus 4.6 till 4.7 den 23 april 2026.
Hur mycket kostar Claude Opus 4.7?
Claude Opus 4.7 kostar $5 per miljon input-tokens och $25 per miljon output-tokens — oförändrat från Opus 4.6. Den uppdaterade tokenizern producerar 1,0–1,35× fler tokens för samma innehåll, så den faktiska kostnaden ökar något. Budgetera vid 1,2×-mittpunkten och räkna in högre användning av tänkande tokens vid xhigh-effort.
Är Claude Opus 4.7 bättre än GPT-5.4 för kodning?
På SWE-bench Pro, ja — 64,3% för Opus 4.7 mot 57,7% för GPT-5.4 Pro, ett försprång på 6,6 punkter. På GPQA Diamond är de statistiskt lika (94,2% mot 94,4%). För agentisk kodning i Claude Code är Opus 4.7 med xhigh för närvarande det starkaste alternativet. För enstaka resonemangsuppgifter är det mer jämnt.
Vad är xhigh effort-nivån?
xhigh är ett nytt effort-steg mellan high och max, introducerat med Opus 4.7 och nu standard i Claude Code. Det använder 30–50% fler tänkande tokens än high och är ungefär 2× långsammare, men vinner 5–8 punkter på SWE-bench-liknande uppgifter. max kostar mycket mer för bara 1–2 punkter över xhigh.
Vad gör /ultrareview i Claude Code?
/ultrareview är ett nytt slash-kommando i Claude Code 2.1.111+ som kör flerstegsgranskning av kod — separata dedikerade pass för säkerhet, stil, logik och tester — var och ett med sitt eget kontextfönster. Det körs i bakgrunden medan du fortsätter koda, så du behöver inte vänta på slutsatsen som med /review.
Är Mythos Preview samma som Opus 4.7?
Nej. Mythos Preview är en separat, begränsat tillgänglig Anthropic-modell som annonserades 7 april 2026 — nio dagar före Opus 4.7. Den nås via Project Glasswing och kommer inte att bli allmänt tillgänglig. Opus 4.7 är den första allmänt tillgängliga Claude-modellen lanserad under post-Mythos säkerhetsregimen, med nya automatiserade skyddsåtgärder inbyggda.
Behöver jag uppdatera Claude Code för att använda Opus 4.7?
Ja. Claude Code v2.1.111 är den lägsta versionen för Opus 4.7-stöd. Kör claude update för att uppgradera, bekräfta sedan med claude --version. Under 2.1.111 är den nya claude-opus-4-7-modellsträngen inte adresserbar och opus-aliaset löser inte rätt heller.
Hur migrerar jag mina promptar från Opus 4.6 till 4.7?
Migrering är till stor del drop-in — byt modellsträng eller låt opus-aliaset lösa det. Den verkliga risken är Opus 4.7:s starkare instruktionsföljning. Promptar som förlitade sig på att 4.6 tolkade "ungefär" eller "löst" liberalt kan ge striktare utdata. Kör om dina regressionsutvärderingar och granska promptkänsliga vägar innan produktionsdeploy.
Stöder Claude Opus 4.7 MCP?
Ja. Claude Opus 4.7 stöder Model Context Protocol och når 77,3% på Anthropics interna MCP-Atlas benchmark. Alla befintliga MCP-servrar fungerar utan modifikation. Om du kört MCP-verktyg på 4.6 kommer de att fortsätta fungera — ofta med bättre verktygsanvändningsbeslut tack vare 4.7:s starkare instruktionsföljning.
Finns det en gratisversion av Claude Opus 4.7?
Ja, med begränsningar. Gratisanvändare av Claude.ai får begränsad Opus 4.7-åtkomst med dagliga meddelandegränser. För obegränsad användning via API eller Claude Code behöver du ett betalkonto. GitHub Copilot-prenumeranter på Pro+, Business eller Enterprise-nivåer får Opus 4.7-åtkomst med en 7,5× premium-requestmultiplikator till 30 april 2026.
Om det här inlägget. Techsy Editorial Team levererar produktionsprogramvara med Claude Code varje dag och har byggt på Anthropics API sedan 3.5 Sonnet. Denna sammanfattning baseras på Anthropics officiella lanseringsmeddelande, Mythos Preview-avslöjandet, Claude Code 2.1.111-changelogen och våra egna tester mot API:et på lanseringsdagen.
Bygger du med Claude Opus 4.7? Boka en gratis konsultation — vi hjälper team att leverera produktionsklara agentiska kodningsarbetsflöden.