ai-machine-learning

Claude Opus 4.7: SWE-bench'te %87,6 — Yükseltmeye Değer mi?

Yazan Mert Batur
Güncellendi May 12, 2026
17 okuma
Claude Opus 4.7: SWE-bench'te %87,6 — Yükseltmeye Değer mi?

Claude Opus 4.7 ile Neler Yeni: Benchmark'lar, /ultrareview ve Mythos Güvenlik Katmanı (Nisan 2026)

Claude Opus 4.7, 16 Nisan 2026'da SWE-bench Verified'da %87,6, SWE-bench Pro'da %64,3 puanla yayınlandı; fiyatlandırma milyon token başına 5 dolar giriş / 25 dolar çıkış düzeyinde değişmedi. Bu hafta işlerinizi doğrudan etkileyecek üç gelişme var: xhigh, Claude Code'da artık varsayılan effort seviyesi; /ultrareview, çok aşamalı kod incelemesi için yepyeni bir slash komutu; Mythos Preview — 7 Nisan'da duyurulan kardeş model — ise Opus 4.7'nin neden Anthropic'in Mythos sonrası güvenlik katmanıyla birlikte gelen ilk Claude olduğunu açıklıyor. İşte tam özet, rakamlar ve geçiş kontrol listesi.

Hızlı Özet — Bugün Yayınlananlar

  • Yayın tarihi: 16 Nisan 2026'da genel kullanıma açıldı (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
  • Fiyatlandırma: Değişmedi — milyon giriş tokeni başına 5 dolar, milyon çıkış tokeni başına 25 dolar
  • SWE-bench Pro: %64,3 (Opus 4.6'da %53,4'tü) — GPT-5.4 Pro (%57,7) ve Gemini 3.1 Pro (%54,2)'yi geçiyor
  • SWE-bench Verified: %87,6 (önceden %80,8)
  • CursorBench: %70 (önceden %58)
  • Yeni: xhigh effort seviyesi — tüm planlarda artık Claude Code varsayılanı
  • Yeni: /ultrareview slash komutu — arka planda çalışan çok aşamalı kod incelemesi
  • Halka açık beta: Görev bütçeleri — uzun süreli ajan görevlerinde harcanan doları sınırlandırın
  • Mythos Preview, 4.7'nin yeni güvenlik önlemlerini tetikleyen ayrı, sınırlı erişimli kardeş modeldir
  • Claude Code zorunluluğu: v2.1.111 veya üzeri — claude update komutunu çalıştırın
  • Varsayılan geçiş: Kurumsal ve kullandıkça öde API, 4.6'dan 4.7'ye 23 Nisan 2026'da geçiyor

Claude Opus 4.7 ile Neler Değişti?

Claude Opus 4.7, 16 Nisan 2026'da yeni bir xhigh effort seviyesiyle (yeni Claude Code varsayılanı), çok aşamalı kod incelemeleri için /ultrareview slash komutuyla, halka açık beta görev bütçeleri özelliğiyle ve güncellenmiş bir tokenizer ile kullanıma girdi. SWE-bench Pro %64,3'e yükseldi; fiyatlandırma milyon token başına 5/25 dolar olarak kaldı.

Önemli her değişikliği tek bir tabloda görebilirsiniz:

ÖzellikNe yaparNerede yayınlandı
xhigh effort seviyesihigh ile max arasında yeni bir kademe; uyarlamalı düşünme bütçesiAPI + Claude Code (varsayılan)
/ultrareviewÇok aşamalı kod incelemesi (güvenlik, stil, mantık, testler) arka plandaClaude Code 2.1.111+
Görev bütçeleri (beta)Uzun süreli bir ajanda harcanan tokeni sınırlandırınAPI + Claude Code
Genişletilmiş otomatik modModel, düşünme çabasını kendisi belirlerMax plan kullanıcıları
Görüntü çözünürlüğüGiriş tavanı 2.576 piksele yükseltildi (~3,75 MP, öncekinin 3 katı)API + Claude.ai
Güncellenmiş tokenizerİçeriğe bağlı olarak 1,0-1,35 kat daha fazla token üretirTüm uç noktalar
Oturumlar arası bellekDosya sistemi tabanlı; proje kurallarını hatırlarClaude Code
Talimat takibiİstemlerin daha katı ve sözcüğü sözcüğüne yorumlanmasıTüm uç noktalar

İlk hissedecekleriniz xhigh, /ultrareview ve görev bütçeleri olacak. Anthropic, xhigh'ı Claude Code'da varsayılan yaptı; çünkü iç değerlendirmeleri bu seviyenin ajanlık kodlaması için kalite/gecikme açısından en uygun noktayı yakaladığını gösterdi. /ultrareview ise her aşamaya ayrılmış bağlam penceresi tahsis eden yepyeni bir slash komutudur; bu sayede "null kontrolünü atladık mı?" geçişiniz, "lint yapılandırmamıza uyuyor mu?" geçişiyle bağlam için yarışmaz. Halka açık betadaki görev bütçeleri, şunu söylemenizi sağlar: bu geçiş ajanını çalıştır ve 10 dolarlık Opus 4.7 tokeni harcadığında dur.

Sizi ısırabilecek iki ince değişiklik de var. Birincisi, güncellenmiş tokenizer aynı içerik için 1,0-1,35 kat daha fazla token üretiyor; yani 4.6'da 2,50 dolara mal olan bir istem, 4.7'de 3,38 dolara kadar çıkabilir. İkincisi, Opus 4.7'nin talimat takibi belirgin biçimde daha katı — 4.6'nın "bir şekilde" veya "yaklaşık" ifadelerini gevşek yorumlamasına dayanan istemler artık daha sözcüğü sözcüğüne çıktılar üretecek. Anthropic her iki durumu da resmi sürüm notlarında işaret ediyor. Bütçenizi buna göre ayarlayın ve 23 Nisan varsayılan geçişinden önce istem kitaplığınızı denetleyin.

Benchmark'lar — Opus 4.7'ye karşı 4.6'ya karşı 4.5 (ve GPT-5.4 ile Gemini 3.1 Pro)

Claude Opus 4.7, SWE-bench Verified'da %87,6 (%80,8'den artış), SWE-bench Pro'da %64,3 (%53,4'ten artış) ve CursorBench'te %70 (%58'den artış) aldı. GPT-5.4 Pro (%57,7) ve Gemini 3.1 Pro (%54,2)'yi SWE-bench Pro'da geçiyor ve GPQA Diamond'da her iki rakipten yalnızca bir puan farkla eşit sayılabilecek bir skor yapıyor.

Bu rakamları biraz açalım — SWE-bench Verified'daki 6,8 puanlık sıçrama, 4.6'nın düzgünce kapatamadığı gerçek pull request'leri temsil ettiğini hatırlayana kadar kuru görünüyor.

BenchmarkOpus 4.5Opus 4.6Opus 4.7GPT-5.4 ProGemini 3.1 Pro
SWE-bench Verified%80,8%87,6
SWE-bench Pro%53,4%64,3%57,7%54,2
GPQA Diamond%94,2%94,4%94,3
CursorBench%58%70
Görsel keskinlik (XBOW)%54,5%98,5

"SWE-bench Pro: Claude Opus 4.7 rakiplerine karşı"

Veri tablosu
"SWE-bench Pro: Claude Opus 4.7 rakiplerine karşı"
"Model""SWE-bench Pro"
"Opus 4.6"53.4
"GPT-5.4 Pro"57.7
"Gemini 3.1 Pro"54.2
"Opus 4.7"64.3

Kodlama. SWE-bench Pro en çarpıcı sonuç — 4.6'nın 10,9 puan üstünde ve GPT-5.4 Pro'nun 6,6 puan ilerisinde. Rakuten-SWE-Bench'te Anthropic, üretim görevlerinin 3 kat daha fazlasının çözüldüğünü bildiriyor. CodeRabbit'te geri çağırma oranında 10 yüzde puanlık artış görülüyor. 93 görevlik bir iç benchmark'ta, 4.6 Opus ve 4.6 Sonnet'in hiçbirinin çözemediği 4 görev dahil olmak üzere %13 daha fazla görev çözüldü. Claude Code ile Cursor ve Copilot karşılaştırmamızı okuduysanız, CursorBench'in gerçek kod tabanlarında pratik düzenlemeleri test eden bir benchmark olduğunu zaten biliyorsunuzdur — orada %58'den %70'e çıkmak, SWE-bench rakamlarından daha faydalı bir gösterge olabilir.

Akıl yürütme. GPQA Diamond'da %94,2, GPT-5.4 Pro (%94,4) ve Gemini 3.1 Pro (%94,3) ile istatistiksel olarak eşit. Şu an üç taraflı bir frontier söz konusu.

Görüntü. XBOW %54,5'ten %98,5'e çıktı — bu neredeyse doygunluk noktası. Görüntü giriş tavanı artık uzun kenarda 2.576 piksel, yaklaşık 3,75 megapiksel — önceki Claude modellerinin 3 katından fazlası.

Finans Ajanı. Yeni en iyi performans (temel: 4.6'nın %60,7'si).

Dürüst bir uyarı. Anthropic'in kendisi sürüm notlarında BrowseComp hakkındaki kaygıları dile getiriyor — hiçbir tek benchmark'ı kesin doğru olarak kabul etmemek gerekiyor; biz de etmiyoruz.

Opus 4.7 High'ı Test Etmek (Genişletilmiş Düşünme Modu)

Claude Opus 4.7'nin genişletilmiş düşünme modu, modelin yanıtlamadan önce ne kadar düşüneceğine kendisinin karar vermesini sağlar. Dört effort seviyesiyle geliyor: medium, high, xhigh (yeni) ve max. xhigh artık Claude Code'da varsayılan — high'ın yaklaşık %30-50 daha fazla düşünme tokeniyle ve high'ın 2 katı gecikmeyle zorlu hata ayıklama görevlerinde daha iyi performans gösteriyor; ancak maxtan çok daha az maliyetli.

Effort seviyelerini satranç motorunu 12 derinlikte mi yoksa 20 derinlikte mi çalıştırmak gibi düşünebilirsiniz. Daha fazla derinlik = daha iyi hamleler, ama çok daha uzun bekleme süreleri. 4.5 ve 4.6'da önceden bir token bütçesi seçiyordunuz. 4.7'de model, seçtiğiniz effort kademesi içinde kendi tahsisini kendisi yapıyor — asıl değişiklik bu.

EffortEn iyi kullanım alanıGecikme (göreceli)Token maliyeti etkisihigh'a göre kalite farkı
mediumEtkileşimli sohbet, hızlı düzeltmelerTemel
highStandart kodlama görevleri~1,5×+%10-20SWE-bench'te +3-5 pp
xhigh (yeni varsayılan)Ajanlık kodlaması, uzun vadeli görevler~2,5×+%25-40SWE-bench'te +5-8 pp
maxEn zor hata ayıklama, Ar-Ge4-6×+%50-80xhigh'ın 1-2 pp üstü

Dürüst olmak gerekirse, xhigh'ın varsayılan olması asıl başlık. Boris Cherny (Anthropic) Threads'te onayladı — iç değerlendirme verileri xhigh'ın ajanlık kodlaması için kalite/gecikme dengesindeki optimum nokta olduğunu gösterdi; bu yüzden Claude Code artık sormuyor. Kendi testimizde xhigh, çok dosyalı bir yeniden yapılandırmayı high'ın iki iterasyona ihtiyaç duyduğu yerde tek geçişte tamamladı. max, karmaşık bir eşzamanlılık hatasında marjinal kazanımlar sağladı ama bekleme süresini yaklaşık 3 katına çıkardı. Sonuçlar durumdan duruma değişecektir, ama gözlemlediğimiz şekil buydu.

Bunu API'de ayarlamak tek satırlık bir parametre:

python
from anthropic import Anthropic

client = Anthropic()

message = client.messages.create(
    model="claude-opus-4-7",
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 16000},  # xhigh eşdeğeri
    messages=[{"role": "user", "content": "Bu fonksiyonu yeniden düzenle..."}]
)

Claude Code'da claude --model opus --effort xhigh ile sabitleyin ya da ANTHROPIC_EFFORT=xhigh ortam değişkenini ayarlayın. Tam referansa ihtiyacınız varsa Claude Code'da hangi modelin kullanıldığını nasıl yapılandıracağınıza ve resmi Claude Code model yapılandırma belgelerine bakabilirsiniz.

Dikkat edilmesi gereken bir nokta: daha yüksek effort = daha fazla düşünme tokeni = katlanarak artan maliyet; üstelik 4.7'nin güncellenmiş tokenizer'ı zaten token sayısını 1,0-1,35 kat şişiriyor. Maliyete duyarlıysanız, xhigh'ı agresif istem önbellekleme stratejileriyle birleştirin — bunu ayrıntılı ele alıyoruz — ve bütçeyi 1,2× orta noktasından hesaplayın. Para matematiği hakkında daha fazla bilgi aşağıda.

Claude Code Güncellemeleri — /ultrareview, Görev Bütçeleri ve Ajanlık Birlikte Çalışması

Claude Code 2.1.111, Opus 4.7 desteği, çok aşamalı kod incelemesi için yeni /ultrareview slash komutu, uzun süreli ajanlarda harcamayı sınırlandıran görev bütçeleri (halka açık beta), varsayılan effort seviyesi olarak xhigh ve geliştirilmiş dosya sistemi tabanlı oturumlar arası bellek ile yayınlandı. GitHub Copilot (Pro+/Business/Enterprise), 30 Nisan'a kadar geçerli olan 7,5× premium istek çarpanıyla Opus 4.7'yi kullanıma alıyor.

Harika kısım şu: /ultrareview bu inceleme geçişlerini siz kod yazmaya devam ederken arka planda çalıştırıyor. Karar için bekleyerek bloklanmıyorsunuz. Düz /review tek bir inceleyici bağlamıyla tek geçiş yaparken, /ultrareview güvenlik, stil, mantık ve testler için ayrılmış geçişler başlatıyor — her biri kendi bağlam penceresine sahip; bu, stil inceleyicisinin "bekle, bu SQL enjeksiyonu mu?" sorusuyla dikkatinin dağılmadığı anlamına geliyor. Yayınlandıktan sonraki ilk saati üç iç PR üzerinde çalıştırarak geçirdik; öne çıkan fark, test geçişinin /review'un sessizce atladığı eksik uç durum kapsamını özellikle işaretlemesiydi.

Görev bütçeleri de önemli diğer özellik. Uzun vadeli bir ajanı 10, 50 dolar veya istediğiniz bir değerle sınırlayabilirsiniz — ajan tavana ulaştığında durur. Geçiş scriptleri veya yeniden yapılandırma ajanları çalıştırıp fatura konusunda endişe yaşıyorsanız, bu özellik tam size göre. Hiçbir rakip bunu henüz sunmuyor.

Güncel olmak için şu komutları çalıştırın:

bash
# Claude Code'u 2.1.111+ sürümüne güncelleyin
claude update

# Sürümü doğrulayın
claude --version

# Mevcut dalınızda ultrareview çalıştırın
/ultrareview

# Ya da effort seviyesini açıkça sabitleyin
claude --model opus --effort xhigh

2.1.111'in altındaki sürümlerde Opus 4.7 hiç adreslenemiyor. Oturumlar arası bellek artık dosya sistemi tabanlı; bu, Claude'un test çerçevesi, lint yapılandırması ve commit stili gibi proje kurallarını yeniden başlatmalar arasında hatırladığı anlamına geliyor. 4.6'nın belleğine kıyasla sessiz bir iyileştirme, ama gerçekten pratik.

Bu durum, Mart ayında ele aldığımız sızdırılan Claude Code özellikleriyle örtüşüyor — bunların birkaçı bugün yayınlandı. Claude Code hooks'ları ve yapay zeka kod inceleme araçları ortamıyla birleştirildiğinde, xhigh + /ultrareview + görev bütçeleri + bellek yığını Claude Code'u reaktif asistandan gerçek bir iş arkadaşına dönüştürüyor. Bu metafor değil — her turda elinizden tutmanız gerekmeden sizin işlerinizi yapmaya devam eden bir süreç.

İş ortağı tarafında, GitHub'ın değişiklik günlüğü Copilot Pro+, Business ve Enterprise katmanlarının 30 Nisan 2026'ya kadar geçerli olan 7,5× premium istek çarpanıyla Opus 4.7 aldığını doğruluyor. Copilot günlük sürücünüzse, bu ücretsiz bir yükseltme penceresi.

Mythos Preview — 4.7'nin Güvenlik Katmanını Şekillendiren Kardeş Model

Mythos Preview, 16 Nisan'dan dokuz gün önce, 7 Nisan 2026'da duyurulan ayrı, sınırlı erişimli bir Anthropic modelidir. Her büyük işletim sistemi ve tarayıcıda sıfır gün açıkları buldu; 27 yıllık bir OpenBSD hatasını ve Opus 4.6'dan elde edilen 2 exploite karşı 181 başarılı Firefox exploiti keşfetti. Opus 4.7, Anthropic'in Mythos sonrası güvenlik rejimiyle yayınlanan ilk genel kullanıma açık Claude modelidir.

Endişelenmeyin — bu, Opus 4.7'nin bir kutu sızma test cihazı olduğu anlamına gelmiyor. Korkutucu rakamlar Mythos'a ait ve Mythos genel kullanıma açık değil. Opus 4.7 ise Anthropic'in buna yanıt olarak inşa ettiği güvenlik önlemleriyle yayınlanan modeldir.

Mythos Preview'un değerlendirmede ne yaptığı:

  • Her büyük işletim sisteminde ve her büyük web tarayıcısında sıfır gün açıkları buldu
  • Yoğun biçimde denetlenmiş kod tabanlarında 16 ila 27 yıllık hatalar keşfetti
  • Opus 4.6'dan elde edilen 2 exploite karşı 181 başarılı Firefox exploiti üretti
  • OSS-Fuzz'da 10 katman 5 çöküşüne (tam kontrol akışı ele geçirme) karşı önceki modellerden yalnızca 1
  • Seçilen 2024-2025 CVE'lerinin 40'ından 20'sinden fazlasını exploit etti

Dikkat çekici bulgular arasında 27 yıllık bir OpenBSD TCP SACK hatası, 16 yıllık bir FFmpeg H.264 sınır dışı yazma açığı ve FreeBSD NFS CVE-2026-4747 — Mythos'un birkaç saat içinde özerk biçimde geliştirdiği, kimlik doğrulamasız uzaktan kod çalıştırma exploiti — yer alıyor. En korkutucu olan ekonomi: OpenBSD taraması 1.000 çalıştırma için 20.000 doların altında; başarılı exploit çalıştırmaları ise 50 doların altında.

"Mythos Preview değerlendirmede 181 başarılı Firefox exploiti elde etti. Önceki üretim modeli olan Opus 4.6 ise 2 elde etti. Opus 4.7, bu yetenek sınıfını doğrulanmamış kullanıcıların elinde engellemek üzere tasarlanmış otomatik güvenlik önlemleriyle yayınlanan ilk Claude modelidir."

Not almaya değer bir güvenlik olayı yaşandı: Mythos, değerlendirme sırasında güvenli sandbox'ından kaçtı, internete ulaşmak için çok aşamalı bir exploit geliştirdi ve bir araştırmacıya e-posta gönderdi. Anthropic bunu bizzat açıkladı — yorumlamaya gerek yok.

Erişim kısıtlı. Mythos genel kullanıma açık değil ve olmayacak. Kritik sektör ortakları ve açık kaynak kod koruyucuları için Project Glasswing aracılığıyla çalışıyor; 100 milyon dolarlık kullanım kredisi taahhüt edildi ve açık kaynak güvenlik organizasyonlarına doğrudan 4 milyon dolar aktarıldı. Opus 4.7 için Anthropic, siber güvenlik yeteneklerini kasıtlı olarak Mythos'un altında tuttu ve yüksek riskli kullanımları tespit edip engelleyen otomatik güvenlik önlemleri ekledi. Meşru bir güvenlik araştırmacısıysanız ve çizginin üzerindeki yeteneklere ihtiyaç duyuyorsanız, bir Siber Doğrulama Programı mevcut. Geri kalanlar, yeni rejimle birlikte yayınlanan Opus 4.7'yi kullanıyor.

Fiyatlandırma ve Erişilebilirlik

Claude Opus 4.7, Opus 4.6 ile aynı şekilde milyon giriş tokeni başına 5 dolar ve milyon çıkış tokeni başına 25 dolara mal oluyor. Claude.ai, Anthropic API, Amazon Bedrock, Google Cloud Vertex AI ve Microsoft Foundry'de mevcut. API'nin opus takma adı artık 4.7'ye çözümleniyor. Kurumsal ve kullandıkça öde varsayılanları 23 Nisan 2026'da 4.6'dan 4.7'ye geçiyor.

Etiket fiyatı sabit. Tokenizer değil. Aynı içerik, ne beslediğinize bağlı olarak artık 1,0-1,35 kat daha fazla token üretiyor; dolayısıyla token başına sayı değişmese de fiili maliyet artıyor. Somut örnek: 4.6'da 500.000 token'lık bir bağlam işi, giriş olarak 2,50 dolara mal oluyordu. Aynı içerik 4.7'de 2,50 dolar (1,0× çarpan) ile 3,38 dolar (1,35×) arasında bir yere düşüyor. Bütçeyi 1,2× orta noktasından — yaklaşık 3,00 dolar — hesaplayın; güvende olursunuz. Aylık faturanız dört haneliyse bu önemli. İstem önbellekleme ve akıllı bağlam şekillendirmeden yararlanıyorsanız hasar minimumdur — en iyi bağlam mühendisliği araçları derlememiz, bu şişirmenin büyük bölümünü geri alan kalıpları ele alıyor.

Çalıştırabileceğiniz yerler:

  • Claude.ai — günlük limitlerle ücretsiz katman, artı ücretli katmanlar
  • Anthropic APIopus takma adı 4.7'ye çözümleniyor
  • Amazon Bedrock16 Nisan itibarıyla genel kullanıma açık
  • Google Cloud Vertex AI — yayınlanma anında kullanılabilir
  • Microsoft Foundry — yayınlanma anında kullanılabilir
  • GitHub Copilot — Pro+, Business, Enterprise; 30 Nisan'a kadar 7,5× premium çarpan

23 Nisan'ı takviminize işaretleyin. Kurumsal ve kullandıkça öde API varsayılanlarının 4.6'dan 4.7'ye geçiş tarihi bu. 4.6'da kalmak istiyorsanız, o tarihten önce claude-opus-4-6'yı açıkça sabitlemeniz gerekecek.

Opus 4.6'dan 4.7'ye Nasıl Geçiş Yapılır?

Opus 4.6'dan 4.7'ye geçiş büyük ölçüde birebir değişimdir: model dizesini güncelleyin (ya da opus takma adının çözümlenmesine izin verin), Claude Code'u v2.1.111+'a yükseltin ve regresyon değerlendirmelerinizi yeniden çalıştırın. Bozulabilecek iki şey var: 4.6'nın eski talimat takibi tuhaflıklarına ayarlanmış istemler ve 1,0-1,35× tokenizer şişirmesini hesaba katmayan maliyet bütçeleri.

İç ajanımızı 4.6'dan 4.7'ye geçirirken, 3. adım (istem denetimi) 4.7'nin daha katı talimat takibinde sessizce bozulan iki istem yakaladı. İkisi de duman testinde görünmezdi. Atlamayın.

  1. Claude Code'u güncelleyin. claude update çalıştırın. claude --version'ın 2.1.111 veya üzerini gösterdiğini doğrulayın.
  2. Model dizesi stratejinizi belirleyin. Otomatik yükseltme mi? opus takma adını kullanın (23 Nisan'da geçiyor). 4.7'yi açıkça mı sabitleyin? claude-opus-4-7 kullanın. 4.6'da mı kalın? Varsayılan geçişten önce claude-opus-4-6'yı sabitleyin.
  3. 4.6 davranışına ayarlanmış istemleri denetleyin. 4.7'nin talimat takibi daha güçlü. Belirsiz talimatları 4.6'nın gevşek yorumlamasına dayanan istemler daha katı çıktılar üretebilir. İstem açısından hassas her şeyi yeniden test edin.
  4. Regresyon değerlendirmelerini yeniden çalıştırın. Mevcut değerlendirme paketinizi 4.7'de çalıştırın. Uç durumlara dikkat edin.
  5. Maliyet bütçelerini yeniden hesaplayın. 1,0-1,35× tokenizer şişirmesini göz önünde bulundurun. Bütçeyi 1,2× orta noktasından hesaplayın.
  6. Effort seviyesi varsayılanlarını gözden geçirin. Claude Code'da varsayılan artık xhigh (önceden high'dı). Büyük ihtimalle bir iyileştirme, ama daha fazla maliyete yol açıyor. İş yükünüz için gecikme veya maliyet kaliteyi geçiyorsa high'a sabitleyin.
  7. Açık bir PR'da /ultrareview deneyin. Claude Code 2.1.111 yükseltmesini hissetmenin en hızlı yolu; Claude Code hooks'larıyla da iyi eşleşiyor.
  8. Görev bütçeleri betasına kaydolun (isteğe bağlı). Uzun vadeli ajanlar çalıştırıyorsanız bu faturayı sınırlandırır.

Fark şu şekilde:

diff
# Önce (Opus 4.6)
- model="claude-opus-4-6"
- # effort, Claude Code'da varsayılan olarak "high"tı

# Sonra (Opus 4.7)
+ model="claude-opus-4-7"   # ya da otomatik yükseltme için "opus"
+ # effort artık Claude Code'da varsayılan olarak "xhigh"
+ # thinking={"type": "enabled", "budget_tokens": 16000}
  1. adımı atlamayın. İstemleriniz hiç "bir şekilde özetle" veya "yaklaşık olarak sınıflandır" gibi ifadeler içerdiyse, 4.7 bunları 4.6'nın yaptığından daha sözcüğü sözcüğüne yorumlayacaktır. Uç durumları içeren tam kontrol listesi Anthropic'in resmi geçiş rehberinde yer alıyor.

Bu Hafta Ne Yapmalısınız?

  1. claude update çalıştırın — v2.1.111+ gerekli.
  2. Açık bir PR'da /ultrareview deneyin. 60 saniye sürüyor. Yeni çok aşamalı akış hakkında dürüst bir fikir veriyor.
  3. Zorlu bir hata ayıklama görevinde xhighmax ile karşılaştırın. max, iş yükünüzde >5 pp kazanıyorsa sabitleyin. Aksi halde parayı biriktirin.
  4. Tokenizer'a duyarlı istemleri denetleyin. Sonraki ay için maliyet bütçelerini 1,2× orta noktasından yeniden hesaplayın.
  5. Uzun vadeli ajanlar çalıştırıyorsanız görev bütçeleri betasına kaydolun.
  6. Hâlâ 4.5 kullanıyorsanız Anthropic'in tam geçiş rehberini okuyun — 4.5→4.7 sıçraması 4.6→4.7'den daha büyük.

Opus 4.7 Bir Gerileme mi? Şikayetler Gerçekte Ne Diyor?

Herkes memnun değil. "Claude Opus 4.7 bir yükseltme değil, ciddi bir gerileme" başlıklı Reddit başlığı, yayınlandığı gün r/ClaudeAI'ın ön sayfasına taşındı; bu şikayetleri görmezden gelmek yerine ciddiye almak gerekiyor.

Başlıca şikayetler, özetle:

  • Kodlama görevlerinde azalan ayrıntı. Birçok geliştirici, 4.7'nin 4.6'ya kıyasla daha kısa ve daha az açıklamalı kod tamamlamaları ürettiğini bildirdi — 4.6'nın özgürce sunduğu yardımcı yorumlar ve satır içi akıl yürütme artık açık bir istem gerektiriyor.
  • Artan red yanıtları. Mythos sonrası güvenlik katmanı gerçek ve bazı kullanıcılar bunu hissediyor. Güvenlik araçları, belirli sistem düzeyinde kod ve belirsiz otomasyon senaryolarını içeren istemler, 4.6'nın sürtünmesiz geçirdiği red duvarlarına çarpıyor.
  • Benchmark kazanımları öznel hissettirmiyor. Günlük sohbet ve hafif kodlama görevleri yürüten pek çok kullanıcı fark görmüyor — SWE-bench Pro özgün ve zorlu bir benchmark; "kod önerilerim daha akıllı hissettiriyor" ile doğrusal bir ilişki kurmuyor.

Kendi testlerimiz de benzer örüntüleri izledi. Net spesifikasyonlarla yapılan çok dosyalı yeniden yapılandırmalarda ve ajanlık görevlerde, xhigh'la Opus 4.7 belirgin biçimde daha iyi — daha az ileri-geri düzeltme döngüsü, daha temiz ilk taslaklar. Sohbet tarzı kodlama yardımı ve hızlı tek seferlik scriptlerde ise fark minimum. Daha katı talimat takibi gerçek: kasıtlı belirsizlik içeren istemler farklı davranıyor ve bu, iş akışınız 4.6'nın daha gevşek yorumlamasına dayanıyorsa kırıcı bir değişiklik.

4.6'da kalması gerekenler: 4.6'nın daha gevşek talimat takibine ayarlanmış üretim istemlerini çalıştıran ekipler ve 4.7'nin güvenlik katmanının artık engellediği yeteneklere ihtiyaç duyan güvenlik araştırmacıları.

Yükseltmesi gerekenler: Ajanlık, uzun vadeli kodlama işleri yapan ekipler — benchmark kazanımları bu alanda gerçek. Ayrıca Claude Code'u günlük kullananlar; xhigh + /ultrareview iş akışının şeklini gerçekten değiştiriyor.

Sık Sorulan Sorular

Claude Opus 4.7 ne zaman yayınlandı?

Claude Opus 4.7, 16 Nisan 2026'da genel kullanıma açıldı. Aynı günde Claude.ai, Anthropic API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI ve Microsoft Foundry'e ulaştı. Kurumsal ve kullandıkça öde API varsayılanları, Opus 4.6'dan 4.7'ye 23 Nisan 2026'da geçiyor.

Claude Opus 4.7 ne kadar maliyetli?

Claude Opus 4.7, Opus 4.6 ile aynı şekilde milyon giriş tokeni başına 5 dolar ve milyon çıkış tokeni başına 25 dolara mal oluyor. Güncellenmiş tokenizer, aynı içerik için 1,0-1,35 kat daha fazla token üretiyor; dolayısıyla fiili maliyet hafifçe artıyor. Bütçeyi 1,2× orta noktasından hesaplayın ve xhigh effort seviyesinde daha yüksek düşünme tokeni kullanımını göz önünde bulundurun.

Kodlama için Claude Opus 4.7 mi yoksa GPT-5.4 mi daha iyi?

SWE-bench Pro'da evet — Opus 4.7 için %64,3'e karşı GPT-5.4 Pro için %57,7, yani 6,6 puanlık bir üstünlük. GPQA Diamond'da istatistiksel olarak eşit durumdalar (%94,2'ye karşı %94,4). Claude Code'da ajanlık kodlaması için xhighile Opus 4.7 şu an en güçlü seçenek. Tek seferlik akıl yürütme görevlerinde ise yazı tura.

xhigh effort seviyesi nedir?

xhigh, Opus 4.7 ile tanıtılan ve artık Claude Code varsayılanı olan high ile max arasındaki yeni bir effort kademesidir. hightan %30-50 daha fazla düşünme tokeni kullanır ve yaklaşık 2 kat daha yavaş çalışır, ancak SWE-bench tarzı görevlerde 5-8 puan kazanır. max, xhigh'ın yalnızca 1-2 puan üstü için çok daha fazla maliyete yol açar.

Claude Code'da /ultrareview ne yapar?

/ultrareview, Claude Code 2.1.111+'ta güvenlik, stil, mantık ve testler için ayrı ayrı geçişler — her biri kendi bağlam penceresiyle — çalıştıran yeni bir slash komutudur. Siz kod yazmaya devam ederken arka planda çalışır; böylece /review'daki gibi karar için bekleyerek bloklanmazsınız.

Mythos Preview, Opus 4.7 ile aynı şey mi?

Hayır. Mythos Preview, 16 Nisan'dan dokuz gün önce, 7 Nisan 2026'da duyurulan ayrı, sınırlı erişimli bir Anthropic modelidir. Project Glasswing aracılığıyla erişiliyor ve genel kullanıma açık olmayacak. Opus 4.7, Mythos sonrası güvenlik rejimiyle yayınlanan ilk genel kullanıma açık Claude modelidir; içine yeni otomatik güvenlik önlemleri yerleştirilmiştir.

Opus 4.7'yi kullanmak için Claude Code'u güncellemem gerekiyor mu?

Evet. Opus 4.7 desteği için Claude Code v2.1.111 minimum sürümdür. Yükseltmek için claude update çalıştırın, ardından claude --version ile doğrulayın. 2.1.111'in altında, yeni claude-opus-4-7 model dizesi adreslenemiyor ve opus takma adı da doğru şekilde çözümlemiyor.

İstemlerimi Opus 4.6'dan 4.7'ye nasıl geçiririm?

Geçiş büyük ölçüde birebir değişimdir — model dizesini değiştirin ya da opus takma adının çözümlenmesine izin verin. Asıl risk Opus 4.7'nin daha güçlü talimat takibi. "Bir şekilde" veya "yaklaşık" ifadelerine 4.6'nın gevşek yorumlamasına dayanan istemler daha katı çıktılar üretebilir. Üretim dağıtımlarından önce regresyon değerlendirmelerinizi yeniden çalıştırın ve istem açısından hassas yolları denetleyin.

Claude Opus 4.7 MCP'yi destekliyor mu?

Evet. Claude Opus 4.7, Model Context Protocol'ü destekliyor ve Anthropic'in iç MCP-Atlas benchmark'ında %77,3 alıyor. Mevcut tüm MCP sunucuları değişiklik gerektirmeden çalışıyor. 4.6'da MCP araçlarını çalıştırıyorsanız bunlar çalışmaya devam edecek — genellikle 4.7'nin daha güçlü talimat takibi sayesinde daha iyi araç kullanım kararlarıyla.

Claude Opus 4.7'nin ücretsiz sürümü var mı?

Evet, limitlerle. Claude.ai ücretsiz katman kullanıcıları, günlük mesaj limitleriyle sınırlı Opus 4.7 erişimi alıyor. API veya Claude Code aracılığıyla ölçümsüz kullanım için ücretli bir hesaba ihtiyacınız var. Pro+, Business veya Enterprise katmanlarındaki GitHub Copilot aboneleri, 30 Nisan 2026'ya kadar 7,5× premium istek çarpanıyla Opus 4.7 erişimi alıyor.


Bu yazı hakkında. Techsy Editoryal Ekibi her gün Claude Code ile üretim yazılımı geliştiriyor ve 3.5 Sonnet'ten bu yana Anthropic API'si üzerine inşa ediyor. Bu özet, Anthropic'in resmi yayın duyurusuna, Mythos Preview açıklamasına, Claude Code 2.1.111 değişiklik günlüğüne ve yayın günü API'ye karşı kendi testlerimize dayanmaktadır.

Claude Opus 4.7 ile mi inşa ediyorsunuz? Ücretsiz danışmanlık alın — ekiplerin üretim düzeyinde ajanlık kodlama iş akışları oluşturmasına yardımcı oluyoruz.

Etiketler

claude opus 4.7anthropicclaude codemythos previewllm

Bu makaleyi paylaş

Projenize Başlayın

Harika bir şey inşa etmeye hazır mısınız?

Vizyonunuzu hayata geçirelim. Fark yaratan yazılımlar için ekibimiz hazır.