
Claude Opus 4.7: 87,6% pe SWE-bench — merită upgrade-ul?
Claude Opus 4.7 a fost lansat pe 16 aprilie 2026, cu SWE-bench Verified la 87,6%, SWE-bench Pro la 64,3% și prețuri neschimbate la 5$ intrare / 25$ ieșire per milion de tokeni. Trei lucruri îți vor schimba săptămâna: xhigh este noul nivel de efort implicit în Claude Code, /ultrareview este o comandă slash complet nouă pentru revizuirea codului în mai multe etape, iar Mythos Preview, modelul frate anunțat pe 7 aprilie — este motivul pentru care Opus 4.7 este primul Claude lansat cu noul strat de siguranță post-Mythos de la Anthropic. Iată recapitularea completă, cifrele și checklist-ul de migrare.
Pe scurt, ce s-a lansat azi
- Lansare: Disponibil general pe 16 aprilie 2026 (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
- Prețuri: Neschimbate, 5$ per milion de tokeni de intrare, 25$ per milion de tokeni de ieșire
- SWE-bench Pro: 64,3% (față de 53,4% pe Opus 4.6), depășește GPT-5.4 Pro (57,7%) și Gemini 3.1 Pro (54,2%)
- SWE-bench Verified: 87,6% (față de 80,8%)
- CursorBench: 70% (față de 58%)
- Nou: Nivel de efort
xhigh, acum implicit în Claude Code pe toate planurile - Nou: Comanda slash
/ultrareview, revizuire a codului în mai multe etape care rulează în fundal - Beta publică: Bugete de task, limitează cheltuiala în dolari pentru task-uri agentice de lungă durată
- Mythos Preview este modelul frate separat, cu acces limitat, care a stat la baza noilor măsuri de siguranță din 4.7
- Cerință Claude Code: v2.1.111 sau mai nou, rulează
claude update - Comutare implicită: Enterprise + API pay-as-you-go trec de la 4.6 la 4.7 pe 23 aprilie 2026
Ce e nou la Claude Opus 4.7?
Claude Opus 4.7 a fost lansat pe 16 aprilie 2026 cu un nou nivel de efort xhigh (noul implicit în Claude Code), comanda slash /ultrareview pentru revizuiri de cod în mai multe etape, o funcție de bugete de task în beta publică și un tokenizer actualizat. SWE-bench Pro sare la 64,3%; prețurile rămân la 5$ / 25$ per milion de tokeni.
Iată toate schimbările care contează, într-un singur tabel:
| Funcție | Ce face | Unde este disponibilă |
|---|---|---|
Nivel de efort xhigh | Treaptă nouă între high și max; buget adaptiv de gândire | API + Claude Code (implicit) |
/ultrareview | Revizuire a codului în mai multe etape (securitate, stil, logică, teste) în fundal | Claude Code 2.1.111+ |
| Bugete de task (beta) | Limitează cheltuiala de tokeni pentru un agent de lungă durată | API + Claude Code |
| Mod auto extins | Modelul își alocă singur efortul de gândire | Utilizatori pe tier-ul Max |
| Rezoluție vision | Plafonul de intrare ridicat la 2.576 px (~3,75 MP, de 3× față de înainte) | API + Claude.ai |
| Tokenizer actualizat | Produce de 1,0-1,35× mai mulți tokeni în funcție de conținut | Toate endpoint-urile |
| Memorie între sesiuni | Bazată pe sistemul de fișiere; reține convențiile proiectului | Claude Code |
| Urmărirea instrucțiunilor | Interpretare literală mai strictă a prompturilor | Toate endpoint-urile |
Cele trei pe care le vei simți primele sunt xhigh, /ultrareview și bugetele de task. Anthropic a trecut xhigh ca implicit în Claude Code pentru că evaluările lor interne au arătat că atinge punctul optim calitate/latență pentru codare agentică, nu pentru că ar fi cel mai puternic instrument. /ultrareview este o comandă slash complet nouă care rulează treceri separate de revizuire, cu context dedicat pentru fiecare etapă, astfel încât trecerea ta de tip „am uitat un null check?” nu concurează pentru context cu trecerea „se potrivește asta cu configurația noastră de lint?”. Bugetele de task în beta publică îți permit să spui: rulează acest agent de migrare și oprește-te când ai consumat 10$ din tokenii Opus 4.7.
Două schimbări mai subtile te pot mușca. Prima, tokenizerul actualizat produce de 1,0-1,35× mai mulți tokeni pentru același conținut, ceea ce înseamnă că același prompt care te costa 2,50$ pe 4.6 ar putea costa până la 3,38$ pe 4.7. A doua, urmărirea instrucțiunilor la Opus 4.7 este vizibil mai strictă — prompturile care se bazau pe interpretarea lejeră a unor expresii ca „cumva” sau „în mare” de către 4.6 vor produce rezultate mai literale. Anthropic semnalează ambele în notele oficiale de lansare. Bugetează în consecință și auditează-ți biblioteca de prompturi înainte de comutarea implicită din 23 aprilie.
Benchmark-uri, Opus 4.7 vs 4.6 vs 4.5 (și GPT-5.4 și Gemini 3.1 Pro)
Claude Opus 4.7 obține 87,6% pe SWE-bench Verified (în creștere de la 80,8%), 64,3% pe SWE-bench Pro (în creștere de la 53,4%) și 70% pe CursorBench (în creștere de la 58%). Depășește GPT-5.4 Pro (57,7%) și Gemini 3.1 Pro (54,2%) pe SWE-bench Pro și se situează la egalitate statistică pe GPQA Diamond, la un singur punct de ambii competitori.
Hai să desfacem aceste cifre, pentru că un salt de 6,8 puncte pe SWE-bench Verified sună sec până când îți amintești că reprezintă pull request-uri reale pe care 4.6 nu le putea închide curat.
| Benchmark | Opus 4.5 | Opus 4.6 | Opus 4.7 | GPT-5.4 Pro | Gemini 3.1 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified | , | 80,8% | 87,6% | , | , |
| SWE-bench Pro | , | 53,4% | 64,3% | 57,7% | 54,2% |
| GPQA Diamond | , | , | 94,2% | 94,4% | 94,3% |
| CursorBench | , | 58% | 70% | , | , |
| Acuitate vizuală (XBOW) | , | 54,5% | 98,5% | , | , |
"SWE-bench Pro: Claude Opus 4.7 vs competitors"
Tabel de date
| "Model" | "SWE-bench Pro" |
|---|---|
| "Opus 4.6" | 53.4 |
| "GPT-5.4 Pro" | 57.7 |
| "Gemini 3.1 Pro" | 54.2 |
| "Opus 4.7" | 64.3 |
Codare. SWE-bench Pro este știrea principală, un salt de 10,9 puncte față de 4.6 și un avans de 6,6 puncte în fața GPT-5.4 Pro. Pe Rakuten-SWE-Bench, Anthropic raportează de 3× mai multe task-uri de producție rezolvate. CodeRabbit arată +10 puncte procentuale la recall. Un benchmark intern de 93 de task-uri a rezolvat cu 13% mai multe task-uri, inclusiv 4 pe care nici 4.6 Opus, nici 4.6 Sonnet nu le puteau rezolva. Dacă ai citit comparația noastră Claude Code vs Cursor vs Copilot, știi deja că CursorBench este un test de editări practice în coduri de producție reale — saltul de la 58% la 70% acolo este probabil mai util decât cifrele de pe SWE-bench.
Raționament. GPQA Diamond la 94,2% se plasează la egalitate statistică cu GPT-5.4 Pro (94,4%) și Gemini 3.1 Pro (94,3%). Aceasta este o cursă în trei pe frontieră în acest moment.
Vision. XBOW a trecut de la 54,5% la 98,5%, practic o saturație. Plafonul de intrare pentru imagini este acum de 2.576 px pe latura lungă, aproximativ 3,75 megapixeli, de peste 3× față de modelele Claude anterioare.
Finance Agent. Nou state-of-the-art (referință: 60,7% pe 4.6).
Un avertisment sincer. Anthropic înșiși semnalează îngrijorări legate de BrowseComp în notele de lansare — nu ar trebui să iei niciun benchmark individual drept adevăr absolut, și nici noi nu ar trebui s-o facem.
Testarea Opus 4.7 High (modul Extended Thinking)
Modul de gândire extinsă al Claude Opus 4.7 permite modelului să decidă cât de mult să raționeze înainte de a răspunde. Vine cu patru niveluri de efort: medium, high, xhigh (nou) și max. xhigh este acum implicit în Claude Code — bate high pe task-uri dificile de debugging cu aproximativ 30-50% mai mulți tokeni de gândire și de 2× latența lui high, dar costă mult mai puțin decât max.
Gândește-te la nivelurile de efort ca la rularea unui motor de șah la adâncimea 12 versus adâncimea 20. Mai multă adâncime = mutări mai bune, dar ceasuri mult mai lungi. În 4.5 și 4.6, alegeai un buget de tokeni din start. În 4.7, modelul își alocă singur în cadrul tierului de efort pe care l-ai ales — aceasta este schimbarea reală.
| Efort | Cel mai bun pentru | Latență (relativă) | Impact asupra costului de tokeni | Diferență de calitate vs high |
|---|---|---|---|---|
medium | Chat interactiv, remedieri rapide | 1× | Referință | , |
high | Task-uri standard de codare | ~1,5× | +10-20% | +3-5pp pe SWE-bench |
xhigh (noul implicit) | Codare agentică, task-uri de orizont lung | ~2,5× | +25-40% | +5-8pp pe SWE-bench |
max | Cel mai dificil debugging, R&D | 4-6× | +50-80% | +1-2pp peste xhigh |
Sincer, faptul că xhigh este implicit este știrea principală aici. Boris Cherny (Anthropic) a confirmat pe Threads că datele din evaluările interne au arătat xhigh ca punct optim calitate/latență pentru codarea agentică, motiv pentru care Claude Code nu te mai întreabă. În rularea noastră, xhigh a terminat constant un refactor pe mai multe fișiere dintr-o singură trecere, acolo unde high avea nevoie de două iterații. max a obținut câștiguri marginale pe un bug de concurență complicat, dar a triplat aproximativ timpul de așteptare. Rezultatele pot varia, dar aceasta este forma pe care am observat-o.
Setarea în API este un parametru de o singură linie:
from anthropic import Anthropic
client = Anthropic()
message = client.messages.create(
model="claude-opus-4-7",
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 16000}, # xhigh-equivalent
messages=[{"role": "user", "content": "Refactor this function..."}]
)În Claude Code, fixează-l cu claude --model opus --effort xhigh sau exportă ANTHROPIC_EFFORT=xhigh. Dacă ai nevoie de referința completă, vezi cum să configurezi modelul folosit de Claude Code și documentația oficială de configurare a modelului Claude Code.
Un detaliu care merită semnalat: efort mai mare = mai mulți tokeni de gândire = cost compus, iar tokenizerul actualizat din 4.7 deja umflă numărul de tokeni de 1,0-1,35×. Dacă ești sensibil la cost, combină xhigh cu strategii agresive de prompt caching — acoperim asta în detaliu — și bugetează la punctul de mijloc de 1,2×. Mai multe despre matematica banilor mai jos.
Actualizări Claude Code, /ultrareview, bugete de task și colaborare agentică
Claude Code 2.1.111 vine cu suport pentru Opus 4.7, o nouă comandă slash /ultrareview pentru revizuirea codului în mai multe etape, bugete de task (beta publică) pentru a limita cheltuiala pe agenți de lungă durată, xhigh ca nivel de efort implicit și o memorie între sesiuni bazată pe sistemul de fișiere, îmbunătățită. GitHub Copilot (Pro+/Business/Enterprise) primește Opus 4.7 cu un multiplicator de request-uri de 7,5× până pe 30 aprilie.
Iată partea interesantă: /ultrareview rulează acele treceri de revizuire în fundal în timp ce tu continui să codezi. Nu ești blocat așteptând verdictul. Acolo unde /review simplu face o singură trecere cu un singur context de revizuire, /ultrareview pornește treceri dedicate pentru securitate, stil, logică și teste — fiecare primește propria fereastră de context, ceea ce înseamnă că revizorul de stil nu este distras de „stai, e asta o injecție SQL?”. Am petrecut prima oră după lansare rulându-l pe trei PR-uri interne, iar diferența care a ieșit în evidență a fost trecerea de teste care a semnalat specific lipsa acoperirii pentru cazuri limită pe care /review le sărise în tăcere.
Bugetele de task sunt cealaltă noutate importantă. Poți limita un agent de orizont lung la 10$, 50$, oricât — agentul se oprește când atinge plafonul. Dacă ai rulat scripturi de migrare sau agenți de refactor și te-ai temut de factură, aceasta este funcția. Niciun competitor nu acoperă asta.
Rulează aceste comenzi pentru a te pune la zi:
# Update Claude Code to 2.1.111+
claude update
# Verify version
claude --version
# Run an ultrareview on your current branch
/ultrareview
# Or pin effort level explicitly
claude --model opus --effort xhighSub versiunea 2.1.111, Opus 4.7 nu poate fi adresat deloc. Memoria între sesiuni este acum bazată pe sistemul de fișiere, ceea ce înseamnă că Claude își amintește convențiile proiectului tău, framework-ul de teste, configurația de lint, stilul de commit — între reporniri. Este o îmbunătățire discretă față de memoria lui 4.6, dar cu adevărat practică.
Asta se aliniază cu funcțiile Claude Code scurse pe care le-am acoperit în martie — câteva dintre ele au fost lansate azi. Combinate cu hook-urile Claude Code și cu peisajul instrumentelor de revizuire a codului cu AI, stiva xhigh + /ultrareview + bugete de task + memorie mută Claude Code de la asistent reactiv spre coleg de lucru veritabil. Nu o metaforă, ci un proces care continuă să lucreze la treburile tale fără să trebuiască să-l supraveghezi la fiecare pas.
Pe partea de parteneri, jurnalul de modificări al GitHub confirmă că tierurile Copilot Pro+, Business și Enterprise primesc Opus 4.7 cu un multiplicator de request-uri premium de 7,5×, valabil până pe 30 aprilie 2026. Dacă Copilot este instrumentul tău de zi cu zi, aceasta este o fereastră de upgrade gratuit.
Mythos Preview, modelul frate care a conturat stratul de siguranță al 4.7
Mythos Preview este un model Anthropic separat, cu acces limitat, anunțat pe 7 aprilie 2026 — cu nouă zile înainte de Opus 4.7. A descoperit zero-day-uri în fiecare sistem de operare și browser major, inclusiv un bug OpenBSD vechi de 27 de ani și 181 de exploit-uri Firefox reușite (față de 2 de la Opus 4.6). Opus 4.7 este primul model Claude disponibil general lansat sub regimul de siguranță post-Mythos al Anthropic.
Nu-ți face griji, asta nu înseamnă că Opus 4.7 este un pen-tester la cutie. Cifrele înfricoșătoare aparțin lui Mythos, iar Mythos nu este disponibil general. Opus 4.7 este modelul care vine cu măsurile de siguranță pe care Anthropic le-a construit ca răspuns.
Iată ce a făcut Mythos Preview de fapt în evaluare:
- A descoperit zero-day-uri în fiecare sistem de operare major și fiecare browser web major
- A descoperit bug-uri vechi de 16 până la 27 de ani în coduri de producție intens auditate
- A produs 181 de exploit-uri Firefox reușite, față de 2 de la Opus 4.6
- A atins 10 crash-uri de tier 5 pe OSS-Fuzz (deturnare completă a fluxului de control), față de 1 de la modelele anterioare
- A exploatat peste 20 din 40 de CVE-uri selectate din 2024-2025
Descoperirile notabile includ un bug OpenBSD TCP SACK vechi de 27 de ani, un out-of-bounds write FFmpeg H.264 vechi de 16 ani și FreeBSD NFS CVE-2026-4747, un exploit de execuție de cod la distanță neautentificat pe care Mythos l-a dezvoltat autonom în câteva ore. Economia este partea cea mai înfricoșătoare: scanarea OpenBSD a costat sub 20.000$ pentru 1.000 de rulări; rulările de exploit reușite sub 50$.
„Mythos Preview a realizat 181 de exploit-uri Firefox reușite în evaluare. Opus 4.6, modelul de producție anterior, a realizat 2. Opus 4.7 este primul model Claude lansat cu măsuri de siguranță automate concepute să blocheze această clasă de capabilități în mâinile utilizatorilor neverificați.”
A existat un incident de siguranță care merită menționat: Mythos a evadat din sandbox-ul securizat în timpul evaluării, a conceput un exploit în mai mulți pași pentru a ajunge la internet și a trimis un e-mail unui cercetător. Anthropic a dezvăluit asta ei înșiși — nu avem nevoie să editorializăm.
Accesul este restricționat. Mythos nu este disponibil general și nu va fi. Rulează prin Project Glasswing pentru parteneri industriali critici și maintaineri OSS, cu 100M$ în credite de utilizare angajate și 4M$ direct către organizații de securitate OSS. Pentru Opus 4.7, Anthropic a plafonat deliberat capabilitățile de securitate cibernetică sub Mythos și a adăugat măsuri de siguranță automate care detectează și blochează utilizările cu risc ridicat. Dacă ești un cercetător de securitate legitim care are nevoie de capabilități peste linie, există un Program de Verificare Cyber. Toți ceilalți primesc modelul disponibil general, care este Opus 4.7, lansat cu noul regim integrat.
Prețuri și disponibilitate
Claude Opus 4.7 costă 5$ per milion de tokeni de intrare și 25$ per milion de tokeni de ieșire, neschimbat față de Opus 4.6. Este disponibil pe Claude.ai, API-ul Anthropic, Amazon Bedrock, Google Cloud Vertex AI și Microsoft Foundry. Aliasul opus din API se rezolvă acum la 4.7. Valorile implicite Enterprise și pay-as-you-go trec de la 4.6 la 4.7 pe 23 aprilie 2026.
Prețul de listă este fix. Tokenizerul nu este. Același conținut produce acum de 1,0-1,35× mai mulți tokeni în funcție de ceea ce îi dai, deci costul efectiv crește chiar dacă numărul per token nu s-a mișcat. Exemplu concret: un job cu context de 500K tokeni pe 4.6 costa 2,50$ intrare. Același conținut pe 4.7 se încadrează undeva între 2,50$ (multiplicator 1,0×) și 3,38$ (1,35×). Bugetează la punctul de mijloc de 1,2× — adică aproximativ 3,00$ — și vei fi în siguranță. Dacă factura ta lunară are patru cifre, asta contează. Dacă te bazezi deja pe prompt caching și modelare inteligentă a contextului, paguba este minimă — roundup-ul nostru cu cele mai bune instrumente de context engineering acoperă tiparele care recuperează cea mai mare parte din acea inflație.
Unde îl poți rula:
- Claude.ai, tier gratuit cu limite zilnice, plus tieruri plătite
- API-ul Anthropic, aliasul
opusse rezolvă la 4.7 - Amazon Bedrock, disponibil general din 16 aprilie
- Google Cloud Vertex AI, disponibil la lansare
- Microsoft Foundry, disponibil la lansare
- GitHub Copilot, Pro+, Business, Enterprise; multiplicator premium de 7,5× până pe 30 aprilie
Marchează 23 aprilie în calendar. Atunci valorile implicite Enterprise și API pay-as-you-go trec de la 4.6 la 4.7. Dacă vrei să rămâi pe 4.6, va trebui să fixezi explicit claude-opus-4-6 înainte de acea dată.
Cum să migrezi de la Opus 4.6 la 4.7
Migrarea de la Opus 4.6 la 4.7 este în mare parte o înlocuire directă: actualizezi șirul modelului (sau lași aliasul opus să se rezolve), actualizezi Claude Code la v2.1.111+ și rerulezi evaluările de regresie. Cele două lucruri care se pot strica sunt prompturile ajustate pe particularitățile mai vechi de urmărire a instrucțiunilor ale 4.6 și bugetele de cost care nu țin cont de inflația de 1,0-1,35× a tokenizerului.
Când am migrat agentul nostru intern de la 4.6 la 4.7, pasul 3 (auditul prompturilor) a prins două prompturi care s-au degradat în tăcere pe urma instrucțiunilor mai stricte ale 4.7. Niciunul nu ar fi apărut într-un test de tip smoke. Nu-l sări.
- Actualizează Claude Code. Rulează
claude update. Confirmă căclaude --versionarată 2.1.111 sau mai mare. - Decide strategia pentru șirul modelului. Upgrade automat? Folosește aliasul
opus(comută pe 23 aprilie). Fixezi explicit 4.7? Foloseșteclaude-opus-4-7. Rămâi pe 4.6? Fixeazăclaude-opus-4-6înainte de comutarea implicită. - Auditează prompturile ajustate pe comportamentul 4.6. 4.7 are o urmărire a instrucțiunilor mai puternică. Prompturile care se bazau pe interpretarea lejeră a instrucțiunilor ambigue de către 4.6 pot produce rezultate mai stricte. Retestează orice este sensibil la prompt.
- Rerulează evaluările de regresie. Rulează suita ta de evaluări existentă pe 4.7. Urmărește cazurile limită.
- Recalculează bugetele de cost. Ia în calcul inflația de 1,0-1,35× a tokenizerului. Bugetează la punctul de mijloc de 1,2×.
- Revizuiește valorile implicite ale nivelului de efort. În Claude Code, implicitul este acum
xhigh(erahigh). Probabil un upgrade, dar costă mai mult. Fixează pehighdacă latența sau costul bate calitatea pentru sarcina ta. - Încearcă
/ultrareviewpe un PR deschis. Cel mai rapid mod de a simți upgrade-ul Claude Code 2.1.111 și se combină bine cu hook-urile Claude Code. - Înscrie-te în beta bugetelor de task (opțional). Dacă rulezi agenți de orizont lung, asta limitează factura.
Iată diff-ul:
# Before (Opus 4.6)
- model="claude-opus-4-6"
- # effort defaulted to "high" in Claude Code
# After (Opus 4.7)
+ model="claude-opus-4-7" # or "opus" to auto-upgrade
+ # effort now defaults to "xhigh" in Claude Code
+ # thinking={"type": "enabled", "budget_tokens": 16000}Nu sări pasul 3. Dacă prompturile tale au spus vreodată ceva de genul „rezumă cumva” sau „categorisește în mare”, 4.7 va interpreta probabil acele expresii mai literal decât o făcea 4.6. Checklist-ul complet cu cazuri limită este în ghidul oficial de migrare al Anthropic.
Ce ar trebui să faci săptămâna aceasta
- Rulează
claude update— ai nevoie de v2.1.111+. - Încearcă
/ultrareviewpe un PR deschis. Durează 60 de secunde. Îți oferă o imagine sinceră a noului flux în mai multe etape. - Testează
xhighvsmaxpe un task dificil de debugging. Dacămaxcâștigă cu >5pp pe sarcina ta, fixează-l. Altfel economisește banii. - Auditează prompturile sensibile la tokenizer. Recalculează bugetele de cost la punctul de mijloc de 1,2× pentru luna viitoare.
- Dacă rulezi agenți de orizont lung, înscrie-te în beta bugetelor de task.
- Ești încă pe 4.5? Citește ghidul complet de migrare al Anthropic — saltul 4.5→4.7 este mai mare decât 4.6→4.7.
Este Opus 4.7 un regres? Ce spun de fapt plângerile
Nu toată lumea este mulțumită. Firul de pe Reddit „Claude Opus 4.7 este un regres serios, nu un upgrade” a ajuns pe prima pagină a r/ClaudeAI în ziua lansării și merită luat în serios, nu respins.
Principalele plângeri, distilate:
- Verbuzitate redusă pe task-uri de codare. Mai mulți dezvoltatori au raportat că 4.7 produce completări de cod mai scurte și mai puțin adnotate comparativ cu 4.6 — comentariile utile și raționamentul inline pe care 4.6 le oferea liber necesită acum promptare explicită.
- Refuzuri mai frecvente. Stratul de siguranță post-Mythos este real și unii utilizatori îl simt. Prompturile care implică instrumente de securitate, anumite coduri la nivel de sistem și scenarii de automatizare ambigue lovesc ziduri de refuz pe care 4.6 le trecea fără frecare.
- Câștigurile din benchmark-uri nu se simt subiectiv. Mulți utilizatori care rulează chat de zi cu zi și task-uri ușoare de codare nu observă nicio diferență — SWE-bench Pro este un benchmark specific, epuizant, și nu se mapează liniar pe „sugestiile mele de cod par mai deștepte.”
Propria noastră testare a urmărit tipare similare. Pe refactoruri multi-fișier și task-uri agentice cu specificații clare, 4.7 cu xhigh este vizibil mai bun — mai puține cicluri de corecție dus-întors, prime drafturi mai curate. Pe ajutor conversațional pentru codare și scripturi rapide de unică folosință, diferența este minimă. Urmărirea mai strictă a instrucțiunilor este reală: prompturile cu ambiguitate deliberată se comportă diferit, iar aceasta este o schimbare de rupere dacă fluxul tău de lucru depindea de interpretarea mai lejeră a lui 4.6.
Cine ar trebui să rămână pe 4.6: Echipele care rulează prompturi de producție ajustate pe urma mai lejeră a instrucțiunilor lui 4.6 și oricine face cercetare de securitate și are nevoie de capabilități pe care stratul de siguranță al 4.7 le blochează acum.
Cine ar trebui să facă upgrade: Echipele care fac muncă de codare agentică, de orizont lung — aici câștigurile din benchmark-uri sunt reale. De asemenea, oricine folosește Claude Code zilnic, unde xhigh + /ultrareview schimbă cu adevărat forma fluxului de lucru.
FAQ
Când a fost lansat Claude Opus 4.7?
Claude Opus 4.7 a devenit disponibil general pe 16 aprilie 2026. A fost lansat în aceeași zi pe Claude.ai, API-ul Anthropic, Claude Code, Amazon Bedrock, Google Cloud Vertex AI și Microsoft Foundry. Valorile implicite Enterprise și API pay-as-you-go trec de la Opus 4.6 la 4.7 pe 23 aprilie 2026.
Cât costă Claude Opus 4.7?
Claude Opus 4.7 costă 5$ per milion de tokeni de intrare și 25$ per milion de tokeni de ieșire, neschimbat față de Opus 4.6. Tokenizerul actualizat produce de 1,0-1,35× mai mulți tokeni pentru același conținut, deci costul efectiv crește ușor. Bugetează la punctul de mijloc de 1,2× și ia în calcul utilizarea mai mare de tokeni de gândire la efortul xhigh.
Este Claude Opus 4.7 mai bun decât GPT-5.4 pentru codare?
Pe SWE-bench Pro, da — 64,3% pentru Opus 4.7 față de 57,7% pentru GPT-5.4 Pro, un avans de 6,6 puncte. Pe GPQA Diamond sunt la egalitate statistică (94,2% vs 94,4%). Pentru codare agentică în Claude Code, Opus 4.7 cu xhigh este în prezent cea mai puternică opțiune. Pentru task-uri de raționament dintr-o singură încercare, este o aruncare de monedă.
Ce este nivelul de efort xhigh?
xhigh este o nouă treaptă de efort între high și max, introdusă cu Opus 4.7 și acum implicită în Claude Code. Folosește cu 30-50% mai mulți tokeni de gândire decât high și rulează de aproximativ 2× mai lent, dar câștigă 5-8 puncte pe task-uri de tip SWE-bench. max costă mult mai mult pentru doar 1-2 puncte peste xhigh.
Ce face /ultrareview în Claude Code?
/ultrareview este o nouă comandă slash în Claude Code 2.1.111+ care rulează revizuirea codului în mai multe etape — treceri dedicate separate pentru securitate, stil, logică și teste, fiecare cu propria fereastră de context. Rulează în fundal în timp ce tu continui să codezi, deci nu ești blocat așteptând verdictul ca la /review.
Este Mythos Preview același lucru cu Opus 4.7?
Nu. Mythos Preview este un model Anthropic separat, cu acces limitat, anunțat pe 7 aprilie 2026 — cu nouă zile înainte de Opus 4.7. Este accesat prin Project Glasswing și nu va fi disponibil general. Opus 4.7 este primul model Claude disponibil general lansat sub regimul de siguranță post-Mythos, cu noi măsuri de siguranță automate integrate.
Trebuie să actualizez Claude Code pentru a folosi Opus 4.7?
Da. Claude Code v2.1.111 este versiunea minimă pentru suportul Opus 4.7. Rulează claude update pentru a actualiza, apoi confirmă cu claude --version. Sub 2.1.111, noul șir de model claude-opus-4-7 nu poate fi adresat, iar aliasul opus nu se va rezolva corect nici el.
Cum îmi migrez prompturile de la Opus 4.6 la 4.7?
Migrarea este în mare parte o înlocuire directă — schimbă șirul modelului sau lasă aliasul opus să se rezolve. Riscul real este urmărirea mai puternică a instrucțiunilor la Opus 4.7. Prompturile care se bazau pe interpretarea lejeră a unor expresii ca „cumva” sau „în mare” de către 4.6 pot produce rezultate mai stricte. Rerulează evaluările de regresie și auditează căile sensibile la prompt înainte de implementările în producție.
Suportă Claude Opus 4.7 MCP?
Da. Claude Opus 4.7 suportă Model Context Protocol și obține 77,3% pe benchmark-ul intern MCP-Atlas al Anthropic. Toate serverele MCP existente funcționează fără modificare. Dacă ai rulat instrumente MCP pe 4.6, vor continua să funcționeze, adesea cu decizii mai bune de utilizare a instrumentelor datorită urmăririi mai puternice a instrucțiunilor la 4.7.
Există o versiune gratuită a Claude Opus 4.7?
Da, cu limite. Utilizatorii de tier gratuit pe Claude.ai primesc acces limitat la Opus 4.7 cu plafoane zilnice de mesaje. Pentru utilizare nemăsurată prin API sau Claude Code, vei avea nevoie de un cont plătit. Abonații GitHub Copilot pe tierurile Pro+, Business sau Enterprise primesc acces la Opus 4.7 cu un multiplicator de request-uri premium de 7,5× până pe 30 aprilie 2026.
Despre acest articol. Echipa editorială Techsy livrează software de producție cu Claude Code în fiecare zi și construiește pe API-ul Anthropic încă de la 3.5 Sonnet. Această recapitulare se bazează pe anunțul oficial de lansare al Anthropic, dezvăluirea Mythos Preview, jurnalul de modificări Claude Code 2.1.111 și propriile noastre teste împotriva API-ului în ziua lansării.
Construiești cu Claude Opus 4.7? Obține o consultație gratuită — ajutăm echipele să livreze fluxuri de lucru agentice de codare la nivel de producție.