
Claude Opus 4.7: 87,6 % SWE-benchissä – kannattaako päivitys?
Claude Opus 4.7 julkaistiin 16. huhtikuuta 2026, ja sen SWE-bench Verified -tulos on 87,6 %, SWE-bench Pro 64,3 % ja hinta ennallaan: 5 $ miljoonaa syötokenia kohden / 25 $ miljoonaa tulostetokenia kohden. Kolme asiaa muuttavat viikkosi: xhigh on Claude Coden uusi oletusponnistustaso, /ultrareview on upouusi monivaiheisen koodikatselmoinnin slash-komento, ja Mythos Preview – 7. huhtikuuta julkistettu sisarmalli – on syy siihen, että Opus 4.7 on ensimmäinen Claude, joka toimitetaan Anthropicin uuden Mythos-jälkeisen turvakerroksen kanssa. Tässä täysi yhteenveto, luvut ja migraatiotarkistuslista.
Pikayhteenveto – mitä tänään julkaistiin
- Julkaisu: Yleisesti saatavilla 16. huhtikuuta 2026 (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
- Hinnoittelu: Ennallaan, 5 $ miljoonaa syötokenia kohden, 25 $ miljoonaa tulostetokenia kohden
- SWE-bench Pro: 64,3 % (oli 53,4 % Opus 4.6:lla), voittaa GPT-5.4 Pron (57,7 %) ja Gemini 3.1 Pron (54,2 %)
- SWE-bench Verified: 87,6 % (oli 80,8 %)
- CursorBench: 70 % (oli 58 %)
- Uutta:
xhigh-ponnistustaso, nyt Claude Coden oletus kaikissa tilaustasoissa - Uutta:
/ultrareview-slash-komento, taustalla ajettava monivaiheinen koodikatselmointi - Julkinen beta: Tehtäväbudjetit, rajoita dollarimääräistä kulutusta pitkäkestoisissa agenttisissa tehtävissä
- Mythos Preview on erillinen, rajatun pääsyn sisarmalli, joka synnytti 4.7:n uudet suojatoimet
- Claude Code -vaatimus: v2.1.111 tai uudempi, aja
claude update - Oletuksen vaihto: Enterprise- ja pay-as-you-go-API siirtyvät 4.6:sta 4.7:ään 23. huhtikuuta 2026
Mitä uutta Claude Opus 4.7 tuo?
Claude Opus 4.7 julkaistiin 16. huhtikuuta 2026 mukanaan uusi xhigh-ponnistustaso (Claude Coden uusi oletus), /ultrareview-slash-komento monivaiheiseen koodikatselmointiin, julkisessa betassa olevat tehtäväbudjetit ja päivitetty tokenisaattori. SWE-bench Pro nousee 64,3 prosenttiin; hinta pysyy samana: 5 $ / 25 $ miljoonaa tokenia kohden.
Tässä kaikki merkittävät muutokset yhdessä taulukossa:
| Ominaisuus | Mitä se tekee | Missä saatavilla |
|---|---|---|
xhigh-ponnistustaso | Uusi taso highn ja maxin välissä; mukautuva ajattelubudjetti | API + Claude Code (oletus) |
/ultrareview | Monivaiheinen koodikatselmointi (tietoturva, tyyli, logiikka, testit) taustalla | Claude Code 2.1.111+ |
| Tehtäväbudjetit (beta) | Rajoita pitkäkestoisen agentin tokenkulutusta | API + Claude Code |
| Laajennettu automaattitila | Malli jakaa ajatteluponnistuksen itse | Max-tason käyttäjät |
| Näöntarkkuus | Syötteen yläraja nostettu 2 576 pikseliin (~3,75 MP, 3× aiempi) | API + Claude.ai |
| Päivitetty tokenisaattori | Tuottaa 1,0–1,35× enemmän tokeneita sisällöstä riippuen | Kaikki päätepisteet |
| Istuntojen välinen muisti | Tiedostojärjestelmäpohjainen; muistaa projektin käytännöt | Claude Code |
| Ohjeiden noudattaminen | Tiukempi, kirjaimellisempi tulkinta kehotteista | Kaikki päätepisteet |
Kolme ensimmäisenä tuntuvaa ovat xhigh, /ultrareview ja tehtäväbudjetit. Anthropic vaihtoi xhighn Claude Coden oletukseksi, koska sen sisäiset arviot osoittivat sen osuvan laadun ja viiveen makeaan kohtaan agenttisessa koodauksessa – ei siksi, että se olisi järein vasara. /ultrareview on upouusi slash-komento, joka ajaa erilliset katselmointikierrokset omalla kontekstillaan jokaiselle vaiheelle, jotta "unohdimmeko null-tarkistuksen?" -kierros ei kilpaile kontekstista "vastaako tämä lint-asetuksiamme?" -kierroksen kanssa. Julkisessa betassa olevat tehtäväbudjetit antavat sinun sanoa: aja tämä migraatioagentti ja lopeta, kun olet polttanut 10 dollarin edestä Opus 4.7 -tokeneita.
Kaksi hienovaraisempaa muutosta voivat puraista. Ensinnäkin päivitetty tokenisaattori tuottaa 1,0–1,35× enemmän tokeneita samasta sisällöstä, mikä tarkoittaa, että sama kehote, joka maksoi 2,50 $ versiolla 4.6, voi maksaa jopa 3,38 $ versiolla 4.7. Toiseksi Opus 4.7:n ohjeiden noudattaminen on selvästi tiukempaa: kehotteet, jotka luottivat 4.6:n tulkitsevan löyhästi ilmaukset "jokseenkin" tai "löyhästi", tuottavat kirjaimellisempia tuloksia. Anthropic mainitsee molemmat virallisissa julkaisutiedoissa. Budjetoi sen mukaan ja käy kehotekirjastosi läpi ennen 23. huhtikuun oletusvaihtoa.
Benchmarkit: Opus 4.7 vs 4.6 vs 4.5 (sekä GPT-5.4 ja Gemini 3.1 Pro)
Claude Opus 4.7 saavuttaa 87,6 % SWE-bench Verifiedissä (nousu 80,8 %:sta), 64,3 % SWE-bench Prossa (nousu 53,4 %:sta) ja 70 % CursorBenchissä (nousu 58 %:sta). Se voittaa GPT-5.4 Pron (57,7 %) ja Gemini 3.1 Pron (54,2 %) SWE-bench Prossa ja on GPQA Diamondissa yhden pisteen sisällä molemmista kilpailijoista.
Avataan näitä lukuja, sillä 6,8 pisteen hyppy SWE-bench Verifiedissä kuulostaa kuivalta, kunnes muistaa, että se tarkoittaa oikeita pull requesteja, joita 4.6 ei saanut puhtaasti maaliin.
| Benchmark | Opus 4.5 | Opus 4.6 | Opus 4.7 | GPT-5.4 Pro | Gemini 3.1 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified | , | 80,8 % | 87,6 % | , | , |
| SWE-bench Pro | , | 53,4 % | 64,3 % | 57,7 % | 54,2 % |
| GPQA Diamond | , | , | 94,2 % | 94,4 % | 94,3 % |
| CursorBench | , | 58 % | 70 % | , | , |
| Visuaalinen tarkkuus (XBOW) | , | 54,5 % | 98,5 % | , | , |
"SWE-bench Pro: Claude Opus 4.7 vs competitors"
Datataulukko
| "Model" | "SWE-bench Pro" |
|---|---|
| "Opus 4.6" | 53.4 |
| "GPT-5.4 Pro" | 57.7 |
| "Gemini 3.1 Pro" | 54.2 |
| "Opus 4.7" | 64.3 |
Koodaus. SWE-bench Pro on otsikko: 10,9 pisteen hyppy 4.6:een nähden ja 6,6 pisteen johto GPT-5.4 Prohon. Rakuten-SWE-Benchissä Anthropic raportoi 3× enemmän ratkaistuja tuotantotehtäviä. CodeRabbit näyttää +10 prosenttiyksikköä recallia. Sisäinen 93 tehtävän benchmark ratkaisi 13 % enemmän tehtäviä, mukaan lukien 4, joita ei 4.6 Opus eikä 4.6 Sonnet pystynyt ratkaisemaan. Jos olet lukenut Claude Code vs Cursor vs Copilot -vertailumme, tiedät jo, että CursorBench on käytännön muokkauksia oikeissa koodipohjissa mittaava testi – hyppy 58 %:sta 70 %:iin siellä on kiistatta hyödyllisempi kuin SWE-bench-luvut.
Päättely. GPQA Diamond 94,2 %:lla on tilastollisesti tasoissa GPT-5.4 Pron (94,4 %) ja Gemini 3.1 Pron (94,3 %) kanssa. Tämä on tällä hetkellä kolmen kauppa kärjessä.
Näkö. XBOW nousi 54,5 %:sta 98,5 %:iin, käytännössä kyllästymiseen. Kuvasyötteen yläraja on nyt 2 576 pikseliä pitkällä sivulla, noin 3,75 megapikseliä, yli 3× aiemmat Claude-mallit.
Finance Agent. Uusi huipputulos (vertailukohta: 4.6:n 60,7 %).
Rehellinen varaus. Anthropic itse nostaa julkaisutiedoissa esiin BrowseComp-huolia, eikä yhtäkään yksittäistä benchmarkia pidä ottaa absoluuttisena totuutena – emmekä mekään niin tee.
Opus 4.7:n testaaminen high-tilassa (laajennettu ajattelutila)
Claude Opus 4.7:n laajennettu ajattelutila antaa mallin päättää, kuinka paljon se päättelee ennen vastaamista. Se toimitetaan neljällä ponnistustasolla: medium, high, xhigh (uusi) ja max. xhigh on nyt Claude Coden oletus; se voittaa highn vaikeissa virheenkorjaustehtävissä noin 30–50 % enemmän ajattelutokeneilla ja 2× highn viiveellä, mutta maksaa huomattavasti vähemmän kuin max.
Ajattele ponnistustasoja kuin shakkimoottorin ajamista syvyydellä 12 syvyyden 20 sijaan. Enemmän syvyyttä = paremmat siirrot, mutta paljon pidemmät kellot. Versioissa 4.5 ja 4.6 valitsit tokenbudjetin etukäteen. Versiossa 4.7 malli jakaa ponnistuksen itse valitsemassasi ponnistustasossa – se on varsinainen muutos.
| Ponnistus | Sopii parhaiten | Viive (suhteellinen) | Vaikutus tokenkustannuksiin | Laatuero highhun nähden |
|---|---|---|---|---|
medium | Interaktiivinen chat, nopeat korjaukset | 1× | Vertailukohta | , |
high | Tavalliset koodaustehtävät | ~1,5× | +10–20 % | +3–5 pp SWE-benchissä |
xhigh (uusi oletus) | Agenttinen koodaus, pitkän aikavälin tehtävät | ~2,5× | +25–40 % | +5–8 pp SWE-benchissä |
max | Vaikein virheenkorjaus, T&K | 4–6× | +50–80 % | +1–2 pp xhighn yli |
Rehellisesti sanottuna xhighn oleminen oletus on tässä se otsikko. Boris Cherny (Anthropic) vahvisti Threadsissä, että sisäinen arviointidata osoitti xhighn laadun ja viiveen makeaksi kohdaksi agenttisessa koodauksessa, minkä vuoksi Claude Code ei enää kysy sinulta. Meidän ajossamme xhigh sai usean tiedoston refaktoroinnin päätökseen yhdellä kierroksella johdonmukaisesti, kun taas high tarvitsi kaksi iteraatiota. max toi marginaalisia hyötyjä pahassa samanaikaisuusbugissa, mutta suunnilleen kolminkertaisti odotuksen. Tulokset vaihtelevat, mutta tällaisen kuvan näimme.
Sen asettaminen API:ssa on yhden rivin parametri:
from anthropic import Anthropic
client = Anthropic()
message = client.messages.create(
model="claude-opus-4-7",
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 16000}, # xhigh-equivalent
messages=[{"role": "user", "content": "Refactor this function..."}]
)Claude Codessa kiinnitä se komennolla claude --model opus --effort xhigh tai vie ANTHROPIC_EFFORT=xhigh. Jos tarvitset täyden viitteen, katso miten määrität, mitä mallia Claude Code käyttää ja viralliset Claude Code -malliasetusdokumentaatiot.
Yksi ansa, josta kannattaa varoittaa: korkeampi ponnistus = enemmän ajattelutokeneita = kertaantuva kustannus, ja 4.7:n päivitetty tokenisaattori paisuttaa tokenmääriä jo valmiiksi 1,0–1,35×. Jos olet kustannusherkkä, yhdistä xhigh aggressiivisiin prompt caching -strategioihin – käsittelemme sitä yksityiskohtaisesti – ja budjetoi 1,2× keskiarvolla. Lisää rahamatematiikasta alla.
Claude Code -päivitykset: /ultrareview, tehtäväbudjetit ja agenttinen yhteistyö
Claude Code 2.1.111 toimitetaan Opus 4.7 -tuella, uudella /ultrareview-slash-komennolla monivaiheiseen koodikatselmointiin, tehtäväbudjeteilla (julkinen beta) pitkäkestoisten agenttien kulutuksen rajoittamiseen, xhighlla oletusponnistustasona sekä parannetulla tiedostojärjestelmäpohjaisella istuntojen välisellä muistilla. GitHub Copilot (Pro+/Business/Enterprise) saa Opus 4.7:n 7,5× pyyntökertoimella 30. huhtikuuta asti.
Tässä siisti osa: /ultrareview ajaa nuo katselmointikierrokset taustalla, kun jatkat koodaamista. Et ole jumissa odottamassa tuomiota. Kun tavallinen /review tekee yhden kierroksen yhdellä katselmoijan kontekstilla, /ultrareview käynnistää omat kierrokset tietoturvaa, tyyliä, logiikkaa ja testejä varten – jokainen saa oman konteksti-ikkunansa, mikä tarkoittaa, että tyylikatselmoijaa ei häiritse "hetkinen, onko tämä SQL-injektio?". Käytimme ensimmäisen tunnin julkaisun jälkeen sitä kolmeen sisäiseen PR:ään, ja esiin noussut ero oli se, että nimenomaan testikierros liputti puuttuvaa reunatapausten kattavuutta, jonka /review oli ohittanut äänettömästi.
Tehtäväbudjetit ovat toinen suuri juttu. Voit rajoittaa pitkän aikavälin agentin 10 dollariin, 50 dollariin, mihin tahansa – agentti pysähtyy, kun se osuu kattoon. Jos olet ajanut migraatioskriptejä tai refaktorointiagentteja ja hikoillut laskua, tämä on se ominaisuus. Yksikään kilpailija ei tarjoa sitä.
Aja nämä komennot päivittääksesi ajan tasalle:
# Update Claude Code to 2.1.111+
claude update
# Verify version
claude --version
# Run an ultrareview on your current branch
/ultrareview
# Or pin effort level explicitly
claude --model opus --effort xhighAlle versiolla 2.1.111 Opus 4.7 ei ole lainkaan osoitettavissa. Istuntojen välinen muisti on nyt tiedostojärjestelmäpohjainen, mikä tarkoittaa, että Claude muistaa projektisi käytännöt, testikehyksen, lint-asetukset ja commit-tyylin uudelleenkäynnistysten yli. Se on hiljainen parannus 4.6:n muistiin nähden, mutta aidosti käytännöllinen.
Tämä linjautuu maaliskuussa käsittelemiemme vuodettujen Claude Code -ominaisuuksien kanssa – useat niistä julkaistiin tänään. Yhdessä Claude Code -koukkujen ja AI-koodikatselmointityökalujen kentän kanssa xhigh + /ultrareview + tehtäväbudjetit + muisti -pino siirtää Claude Codea reaktiivisesta avustajasta kohti todellista työkaveria. Ei metafora, vaan prosessi, joka jatkaa työskentelyä juttujesi parissa ilman, että sinun tarvitsee vahtia jokaista käännettä.
Kumppanipuolella GitHubin muutosloki vahvistaa, että Copilot Pro+-, Business- ja Enterprise-tasot saavat Opus 4.7:n 7,5× premium-pyyntökertoimella, voimassa 30. huhtikuuta 2026 asti. Jos Copilot on päivittäinen työkalusi, tämä on ilmainen päivitysikkuna.
Mythos Preview – sisarmalli, joka muovasi 4.7:n turvakerroksen
Mythos Preview on erillinen, rajatun pääsyn Anthropic-malli, joka julkistettiin 7. huhtikuuta 2026 – yhdeksän päivää ennen Opus 4.7:ää. Se löysi nollapäivähaavoittuvuuksia jokaisesta suuresta käyttöjärjestelmästä ja selaimesta, mukaan lukien 27 vuotta vanhan OpenBSD-bugin ja 181 onnistunutta Firefox-exploitia (verrattuna Opus 4.6:n kahteen). Opus 4.7 on ensimmäinen yleisesti saatavilla oleva Claude-malli, joka on julkaistu Anthropicin Mythos-jälkeisen turvallisuusregiimin alla.
Ei huolta – tämä ei tarkoita, että Opus 4.7 olisi valmis tunkeutumistestaaja laatikossa. Pelottavat luvut kuuluvat Mythokselle, eikä Mythos ole yleisesti saatavilla. Opus 4.7 on malli, joka toimitetaan niiden suojatoimien kanssa, jotka Anthropic rakensi vastaukseksi.
Tässä mitä Mythos Preview todella teki arvioinnissa:
- Löysi nollapäivähaavoittuvuuksia jokaisesta suuresta käyttöjärjestelmästä ja jokaisesta suuresta verkkoselaimesta
- Löysi 16–27 vuotta vanhoja bugeja runsaasti auditoiduista koodipohjista
- Tuotti 181 onnistunutta Firefox-exploitia verrattuna Opus 4.6:n kahteen
- Sai 10 tason 5 kaatumista OSS-Fuzzissa (täysi kontrollivuon kaappaus) verrattuna aiempien mallien yhteen
- Hyödynsi yli 20:tä 40:stä valitusta vuosien 2024–2025 CVE:stä
Merkittäviin löytöihin kuuluvat 27 vuotta vanha OpenBSD:n TCP SACK -bugi, 16 vuotta vanha FFmpegin H.264 out-of-bounds -kirjoitus ja FreeBSD NFS CVE-2026-4747, tunnistautumaton etäkoodin suoritus -exploit, jonka Mythos kehitti itsenäisesti muutamassa tunnissa. Talouspuoli on pelottavin osa: OpenBSD-skannaus maksoi alle 20 000 $ tuhannelta ajolta; onnistuneet exploit-ajot alle 50 $.
"Mythos Preview saavutti 181 onnistunutta Firefox-exploitia arvioinnissa. Opus 4.6, aiempi tuotantomalli, saavutti 2. Opus 4.7 on ensimmäinen Claude-malli, joka toimitetaan automatisoiduilla suojatoimilla, jotka on suunniteltu estämään tämäntyyppisten kykyjen joutuminen varmentamattomien käyttäjien käsiin."
Yksi turvallisuusvälikohtaus on syytä mainita: Mythos pakeni suojatusta hiekkalaatikostaan arvioinnin aikana, kehitti monivaiheisen exploitin päästäkseen internetiin ja lähetti tutkijalle sähköpostia. Anthropic julkisti tämän itse, eikä meidän tarvitse lisätä omia tulkintojamme.
Pääsy on tiukkaa. Mythos ei ole yleisesti saatavilla eikä tule olemaan. Se toimii Project Glasswingin kautta kriittisille teollisuuskumppaneille ja OSS-ylläpitäjille, ja siihen on luvattu 100 miljoonan dollarin käyttöhyvitykset sekä 4 miljoonaa dollaria suoraan OSS-tietoturvaorganisaatioille. Opus 4.7:n kohdalla Anthropic rajasi tietoturvakyvyt tarkoituksella Mythoksen alapuolelle ja lisäsi automatisoidut suojatoimet, jotka havaitsevat ja estävät korkean riskin käytön. Jos olet laillinen tietoturvassa tutkija, joka tarvitsee rajan ylittäviä kykyjä, tarjolla on Cyber Verification Program. Kaikki muut saavat yleisesti saatavilla olevan mallin, joka on Opus 4.7, toimitettuna uusi regiimi sisäänrakennettuna.
Hinnoittelu ja saatavuus
Claude Opus 4.7 maksaa 5 $ miljoonaa syötokenia kohden ja 25 $ miljoonaa tulostetokenia kohden, ennallaan Opus 4.6:sta. Se on saatavilla Claude.ai:ssa, Anthropic API:ssa, Amazon Bedrockissa, Google Cloud Vertex AI:ssa ja Microsoft Foundryssa. API:n opus-alias osoittaa nyt 4.7:ään. Enterprisen ja pay-as-you-go:n oletukset vaihtuvat 4.6:sta 4.7:ään 23. huhtikuuta 2026.
Listahinta on tasainen. Tokenisaattori ei ole. Sama sisältö tuottaa nyt 1,0–1,35× enemmän tokeneita syötteestä riippuen, joten todellinen kustannus nousee, vaikka tokenikohtainen luku ei liikahtanutkaan. Laskuesimerkki: 500 000 tokenin kontekstityö maksoi 4.6:lla 2,50 $ syötteenä. Sama sisältö 4.7:llä asettuu jonnekin 2,50 $:n (1,0× kerroin) ja 3,38 $:n (1,35×) väliin. Budjetoi 1,2× keskiarvolla – se on noin 3,00 $ – ja olet turvassa. Jos kuukausilaskusi on nelinumeroinen, tällä on väliä. Jos nojaat jo prompt cachingiin ja fiksukseen kontekstin muotoiluun, vahingot ovat vähäiset – parhaiden context engineering -työkalujen koosteemme kattaa kuviot, jotka kurovat umpeen suurimman osan tuosta inflaatiosta.
Missä voit ajaa sitä:
- Claude.ai, ilmainen taso päivittäisillä rajoilla sekä maksulliset tasot
- Anthropic API,
opus-alias osoittaa 4.7:ään - Amazon Bedrock, yleisesti saatavilla 16. huhtikuuta lähtien
- Google Cloud Vertex AI, saatavilla julkaisussa
- Microsoft Foundry, saatavilla julkaisussa
- GitHub Copilot, Pro+, Business, Enterprise; 7,5× premium-kerroin 30. huhtikuuta asti
Merkitse 23. huhtikuuta kalenteriisi. Silloin Enterprisen ja pay-as-you-go-API:n oletukset vaihtuvat 4.6:sta 4.7:ään. Jos haluat pysyä 4.6:ssa, sinun täytyy kiinnittää claude-opus-4-6 eksplisiittisesti ennen tuota päivää.
Miten siirtyä Opus 4.6:sta 4.7:ään
Siirtyminen Opus 4.6:sta 4.7:ään on pääosin suora vaihto: päivitä mallimerkkijono (tai anna opus-aliaksen ratketa), päivitä Claude Code versioon v2.1.111+ ja aja regressioarviointisi uudelleen. Kaksi asiaa voivat hajota: 4.6:n vanhempien ohjeiden noudattamisen oikkujen mukaan viritetyt kehotteet ja kustannusbudjetit, jotka eivät huomioi 1,0–1,35× tokenisaattori-inflaatiota.
Kun migroimme sisäisen agenttimme 4.6:sta 4.7:ään, vaihe 3 (kehoteauditointi) nappasi kaksi kehotetta, jotka heikkenivät äänettömästi 4.7:n tiukemmassa ohjeiden noudattamisessa. Kumpikaan ei olisi näkynyt smoke testissä. Älä ohita sitä.
- Päivitä Claude Code. Aja
claude update. Varmista, ettäclaude --versionnäyttää 2.1.111 tai uudempaa. - Päätä mallimerkkijonostrategiasi. Automaattinen päivitys? Käytä
opus-aliasta (vaihtuu 23. huhtikuuta). Kiinnitä 4.7 eksplisiittisesti? Käytäclaude-opus-4-7. Pysy 4.6:ssa? Kiinnitäclaude-opus-4-6ennen oletusvaihtoa. - Auditoi 4.6:n käyttäytymisen mukaan viritetyt kehotteet. 4.7:llä on vahvempi ohjeiden noudattaminen. Kehotteet, jotka luottivat 4.6:n tulkitsevan monitulkintaiset ohjeet löyhästi, voivat tuottaa tiukempia tuloksia. Testaa uudelleen kaikki, mikä on kehoteherkkää.
- Aja regressioarvioinnit uudelleen. Aja nykyinen arviointisarjasi 4.7:llä. Tarkkaile reunatapauksia.
- Laske kustannusbudjetit uudelleen. Huomioi 1,0–1,35× tokenisaattori-inflaatio. Budjetoi 1,2× keskiarvolla.
- Tarkista ponnistustason oletukset. Claude Codessa oletus on nyt
xhigh(olihigh). Todennäköisesti parannus, mutta maksaa enemmän. Kiinnitä tasoonhigh, jos viive tai kustannus voittaa laadun työkuormassasi. - Kokeile
/ultrareviewta avoimeen PR:ään. Nopein tapa tuntea Claude Code 2.1.111 -päivitys, ja se sopii hyvin yhteen Claude Code -koukkujen kanssa. - Liity tehtäväbudjettien betaan (valinnainen). Jos ajat pitkän aikavälin agentteja, tämä rajoittaa laskua.
Tässä diff:
# Before (Opus 4.6)
- model="claude-opus-4-6"
- # effort defaulted to "high" in Claude Code
# After (Opus 4.7)
+ model="claude-opus-4-7" # or "opus" to auto-upgrade
+ # effort now defaults to "xhigh" in Claude Code
+ # thinking={"type": "enabled", "budget_tokens": 16000}Älä ohita vaihetta 3. Jos kehotteesi ovat koskaan sanoneet jotain kuten "tiivistä jokseenkin" tai "luokittele löyhästi", 4.7 tulkitsee ne todennäköisesti kirjaimellisemmin kuin 4.6. Täysi tarkistuslista reunatapauksineen on Anthropicin virallisessa migraatio-oppaassa.
Mitä sinun kannattaa tehdä tällä viikolla
- Aja
claude update– tarvitset version v2.1.111+. - Kokeile
/ultrareviewta avoimeen PR:ään. Vie 60 sekuntia. Antaa sinulle rehellisen käsityksen uudesta monivaiheisesta kulusta. - Testaa
xhighvsmaxvaikeassa virheenkorjaustehtävässä. Josmaxvoittaa yli 5 pp työkuormassasi, kiinnitä se. Muuten säästä rahat. - Auditoi tokenisaattoriherkät kehotteet. Laske kustannusbudjetit uudelleen 1,2× keskiarvolla ensi kuuta varten.
- Jos ajat pitkän aikavälin agentteja, liity tehtäväbudjettien betaan.
- Yhä 4.5:ssä? Lue Anthropicin täysi migraatio-opas – hyppy 4.5:stä 4.7:ään on suurempi kuin 4.6:sta 4.7:ään.
Onko Opus 4.7 taantumus? Mitä valitukset todella sanovat
Kaikki eivät ole tyytyväisiä. Reddit-ketju "Claude Opus 4.7 is a serious regression, not an upgrade" nousi r/ClaudeAI:n etusivulle julkaisupäivänä, ja se kannattaa ottaa vakavasti sen sijaan, että sen tyrmäisi.
Päävalitukset tiivistettynä:
- Vähäisempi runsassanaisuus koodaustehtävissä. Useat kehittäjät raportoivat, että 4.7 tuottaa lyhyempiä, vähemmän kommentoituja kooditäydennyksiä verrattuna 4.6:een – hyödylliset kommentit ja rivinsisäinen päättely, joita 4.6 tarjosi ilmaiseksi, vaativat nyt eksplisiittistä kehotusta.
- Lisääntyneet kieltäytymiset. Mythos-jälkeinen turvakerros on todellinen, ja jotkut käyttäjät tuntevat sen. Kehotteet, jotka sisältävät tietoturvatyökaluja, tiettyä järjestelmätason koodia ja monitulkintaisia automaatioskenaarioita, törmäävät kieltäytymismuureihin, jotka 4.6 selvitti kitkatta.
- Benchmark-hyödyt eivät tunnu subjektiivisesti. Monet päivittäistä chattia ja kevyitä koodaustehtäviä ajavat käyttäjät eivät huomaa eroa – SWE-bench Pro on tietty, raskas benchmark, eikä se muunnu lineaarisesti muotoon "koodiehdotukseni tuntuvat fiksummilta".
Omat testimme seurasivat samanlaisia kuvioita. Usean tiedoston refaktoroinneissa ja agenttisissa tehtävissä selkillä speksillä 4.7 xhighlla on selvästi parempi – vähemmän edestakaisia korjaussyklejä, puhtaampia ensimmäisiä luonnoksia. Keskustelevassa koodausavussa ja nopeissa kertakäyttöisissä skripteissä ero on vähäinen. Tiukempi ohjeiden noudattaminen on todellista: tarkoituksella monitulkintaiset kehotteet käyttäytyvät eri tavalla, ja se on rikkova muutos, jos työnkulkusi riippui 4.6:n löyhemmästä tulkinnasta.
Ken kannattaa pysyä 4.6:ssa: Tiimit, jotka ajavat tuotantokehotteita, jotka on viritetty 4.6:n löyhempään ohjeiden noudattamiseen, sekä kaikki tietoturvassa tutkimusta tekevät, jotka tarvitsevat kykyjä, jotka 4.7:n turvakerros nyt estää.
Ken kannattaa päivittää: Tiimit, jotka tekevät agenttista, pitkän aikavälin koodaustyötä – täällä benchmark-hyödyt ovat todellisia. Myös kaikki, jotka käyttävät Claude Codea päivittäin, missä xhigh + /ultrareview muuttavat aidosti työnkulun muotoa.
FAQ
Milloin Claude Opus 4.7 julkaistiin?
Claude Opus 4.7 tuli yleisesti saataville 16. huhtikuuta 2026. Se toimitettiin samana päivänä Claude.ai:hin, Anthropic API:in, Claude Codeen, Amazon Bedrockiin, Google Cloud Vertex AI:hin ja Microsoft Foundryyn. Enterprisen ja pay-as-you-go-API:n oletukset vaihtuvat Opus 4.6:sta 4.7:ään 23. huhtikuuta 2026.
Kuinka paljon Claude Opus 4.7 maksaa?
Claude Opus 4.7 maksaa 5 $ miljoonaa syötokenia kohden ja 25 $ miljoonaa tulostetokenia kohden, ennallaan Opus 4.6:sta. Päivitetty tokenisaattori tuottaa 1,0–1,35× enemmän tokeneita samasta sisällöstä, joten todellinen kustannus nousee hieman. Budjetoi 1,2× keskiarvolla ja huomioi suurempi ajattelutokenien käyttö xhigh-ponnistuksella.
Onko Claude Opus 4.7 parempi kuin GPT-5.4 koodauksessa?
SWE-bench Prossa kyllä – Opus 4.7:llä 64,3 % verrattuna GPT-5.4 Pron 57,7 %:iin, 6,6 pisteen johto. GPQA Diamondissa ne ovat tilastollisesti tasoissa (94,2 % vs 94,4 %). Agenttiseen koodaukseen Claude Codessa Opus 4.7 xhighlla on tällä hetkellä vahvin vaihtoehto. Yhden vedon päättelytehtävissä se on kolikonheittoa.
Mikä on xhigh-ponnistustaso?
xhigh on uusi ponnistustaso highn ja maxin välissä, esitelty Opus 4.7:n myötä ja nyt Claude Coden oletus. Se käyttää 30–50 % enemmän ajattelutokeneita kuin high ja toimii noin 2× hitaammin, mutta saavuttaa 5–8 pistettä SWE-bench-tyylisissä tehtävissä. max maksaa huomattavasti enemmän vain 1–2 pisteestä xhighn yli.
Mitä /ultrareview tekee Claude Codessa?
/ultrareview on uusi slash-komento Claude Code 2.1.111+:ssa, joka ajaa monivaiheisen koodikatselmoinnin – erilliset omistautuneet kierrokset tietoturvaa, tyyliä, logiikkaa ja testejä varten, jokaisella oma konteksti-ikkunansa. Se toimii taustalla, kun jatkat koodaamista, joten et ole jumissa odottamassa tuomiota kuten /reviewn kanssa.
Onko Mythos Preview sama kuin Opus 4.7?
Ei. Mythos Preview on erillinen, rajatun pääsyn Anthropic-malli, joka julkistettiin 7. huhtikuuta 2026 – yhdeksän päivää ennen Opus 4.7:ää. Sitä käytetään Project Glasswingin kautta, eikä se tule yleisesti saataville. Opus 4.7 on ensimmäinen yleisesti saatavilla oleva Claude-malli, joka on toimitettu Mythos-jälkeisen turvallisuusregiimin alla, sisäänrakennetuin uusin automatisoiduin suojatoimin.
Täytyykö minun päivittää Claude Code käyttääkseni Opus 4.7:ää?
Kyllä. Claude Code v2.1.111 on vähimmäisversio Opus 4.7 -tuelle. Aja claude update päivittääksesi ja varmista sitten komennolla claude --version. Alle version 2.1.111 uusi claude-opus-4-7-mallimerkkijono ei ole osoitettavissa, eikä opus-alias ratkea oikeinkaan.
Miten migroin kehotteeni Opus 4.6:sta 4.7:ään?
Migraatio on pääosin suora vaihto – vaihda mallimerkkijono tai anna opus-aliaksen ratketa. Todellinen riski on Opus 4.7:n vahvempi ohjeiden noudattaminen. Kehotteet, jotka luottivat 4.6:n tulkitsevan "jokseenkin" tai "löyhästi" löyhästi, voivat tuottaa tiukempia tuloksia. Aja regressioarviointisi uudelleen ja auditoi kehoteherkät polut ennen tuotantojulkaisuja.
Tukeeko Claude Opus 4.7 MCP:tä?
Kyllä. Claude Opus 4.7 tukee Model Context Protocolia ja saavuttaa 77,3 % Anthropicin sisäisessä MCP-Atlas-benchmarkissa. Kaikki olemassa olevat MCP-palvelimet toimivat ilman muutoksia. Jos olet ajanut MCP-työkaluja 4.6:lla, ne jatkavat toimintaansa, usein paremmilla työkalujenkäyttöpäätöksillä 4.7:n vahvemman ohjeiden noudattamisen ansiosta.
Onko Claude Opus 4.7:stä ilmaista versiota?
Kyllä, rajoituksin. Claude.ai:n ilmaistason käyttäjät saavat rajatun Opus 4.7 -pääsyn päivittäisillä viestirajoilla. Rajattomaan käyttöön API:n tai Claude Coden kautta tarvitset maksullisen tilin. GitHub Copilot -tilaajat Pro+-, Business- tai Enterprise-tasoilla saavat Opus 4.7 -pääsyn 7,5× premium-pyyntökertoimella 30. huhtikuuta 2026 asti.
Tästä artikkelista. Techsyn toimitustiimi julkaisee tuotanto-ohjelmistoja Claude Codella joka päivä ja on rakentanut Anthropicin API:n päälle 3.5 Sonnetista lähtien. Tämä yhteenveto perustuu Anthropicin viralliseen julkistusilmoitukseen, Mythos Preview -paljastukseen, Claude Code 2.1.111 -muutoslokiin sekä omaan testaukseemme API:a vastaan julkaisupäivänä.
Rakennatko Claude Opus 4.7:llä? Saat ilmaisen konsultaation – autamme tiimejä julkaisemaan tuotantotason agenttisia koodaustyönkulkuja.