
Claude Fable 5 vs Opus 4.8: Gerçekten Geçiş Yapmalı mısınız? (Mythos Sınıfı, Benchmark Sonuçlarıyla)
Anthropic, Claude Fable 5'i 9 Haziran 2026'da yayınladı ve o günden bu yana geçen altı hafta düz bir çizgide ilerlemedi: hükümet emriyle askıya alma, tam geri yükleme, bir güvenlik yaması ve iki yeni rakip lansmanı. Model hâlâ ajanlık kodlama benchmark'ı SWE-Bench Pro'da 80.3% skoruyla önde; Opus 4.8 69.2%'de kalıyor, GPT-5.5 ise 58.6% ile geride. Bu, yuvarlama hatasıyla açıklanabilecek küçük bir fark değil — gerçi artık GPT-5.5, karşılaştırmaya değer tek model olmaktan çıktı. Bir de şu ilginç detay var: Fable 5, yeni "Mythos sınıfı" modelin herkese açık, güvenlik korumalı yarısı; Claude Mythos 5 adlı kardeş model ise kısıtlı bir erişim programının arkasında tutuluyor. İşte neyin değiştiği, lansmandan bu yana neler olduğu, milyon token başına $10/$50 fiyatlamasıyla gerçek bir görevin maliyeti ve yığınınızı Opus 4.8'den gerçekten taşımanız gerekip gerekmediği.
Kısa Yanıt
- Fable 5, SWE-Bench Pro'da Opus 4.8'in 69.2%'sine ve GPT-5.5'in 58.6%'sına karşı 80.3% alıyor; ancak Fable 5'ten sonra piyasaya çıkan Claude Sonnet 5 ve GPT-5.6 Sol, ajanlık ve terminal benchmark'larında bu farkın bir kısmını kapatıyor.
- Fiyatlandırma: milyon token başına $10 giriş / $50 çıkış — Mythos Preview'ın yarısından az.
- Fable 5, yüksek riskli siber/biyolojik/kimyasal sorgularda otomatik olarak Opus 4.8'e geri düşüyor; 1 Temmuz'da devreye giren bir sınıflandırıcı güncellemesi de Amazon araştırmacılarının bulduğu bir prompt tekniğini vakaların %99'undan fazlasında engelliyor.
- Erişim, 12-30 Haziran 2026 arasında ABD ihracat kontrolleri nedeniyle tüm kullanıcılar için askıya alındı, ardından 1 Temmuz'da tamamen geri yüklendi. Belirli bir tarihe kadar ücretsiz kullanım modeli de artık geçerli değil: Max/Team Premium planları Fable 5'i dahil tutmaya devam ediyor, Pro/Team Standard planları ise tek seferlik $100 kredinin ardından API oranlarına geçiyor — TechTimes ve XenoSpectrum'a göre (Anthropic bunu henüz kendi sitesinde doğrulamadı).
Gerçekte Ne Yayınlandı: Fable 5, Mythos 5 ve "Mythos Sınıfı" Hat
Mythos sınıfı, Anthropic'in yeni en üst yetenek kademesi ve iki model olarak geliyor. Claude Fable 5, bugün kullanabileceğiniz herkese açık, güvenlik korumalı sürüm. Claude Mythos 5 ise aynı frontier modelin güvenlik korumaları kaldırılmış hali; gated erişimin arkasında tutuluyor. Aynı zeka, iki farklı yayın tutumu.
Bu ayrım, asıl hikâyenin kendisi. Anthropic'in haber duyurusuna göre Mythos 5, gerçek zarar verebilecek saldırı amaçlı siber beceriler dahil tam frontier kapasitesini koruduğundan Anthropic onu herkese açmıyor. Fable 5 ise aynı modeli alıp üzerine yüksek riskli istekleri tespit eden ve bunları sessizce Opus 4.8'e yönlendiren sınıflandırıcılar sarıyor.
Yani Fable 5'i çağırdığınızda, tehlikeli olmayan her şeyde Mythos sınıfı akıl yürütmesi alıyorsunuz; tehlikeli olan küçük dilimde ise daha güvenli bir yedek modele geçiliyor. CNBC, bunu Anthropic'in halka "Mythos benzeri bir yapay zeka" sunması olarak tanımladı — doğru, ama tam mekanizma başlıktan daha önemli.
Fable 5 ve Mythos 5, ikiye bölünmüş aynı frontier model: biri bugün kullanabileceğiniz, biri Anthropic'in gated tuttuğu. İsimlendirme hakkında tek bir şey hatırlayacaksanız bu olsun. Mythos sınıfı, kademenin adı; Fable ve Mythos ise o kademeye iki farklı kapı.
Opus 4.x Hattına Kıyasla Ne Değişti
Burada ele alınan her kodlama ve akıl yürütme değerlendirmesinde Fable 5, Opus 4.8'i geçiyor — ufak bir farkla değil, çift haneli bir farkla. SWE-Bench Pro 69.2%'den 80.3%'e sıçrıyor; bu, Anthropic'in yayınladığı ve Vellum, llm-stats ile Weights & Biases'in bağımsız olarak doğruladığı bir sayı. FrontierCode Diamond ise 13.4'ten 29.3'e çıkıyor — ama bu, Anthropic'in kendisinin yayınladığı bir sayı değil; Vellum ve llm-stats takibinden geliyor. Fiyatlandırma da düştü ve model artık yeni bir akıl yürütme çabası kadranıyla ölçekleniyor. Bu, Opus 4.x hattının yalnızca bir nokta sürümü değil, gerçek bir frontier adımı.

Yukarıdaki 13 benchmark özeti genel tabloya bakış sağlıyor. İşte ekiplerin gerçekten karşılaştırdığı üç modele karşı öne çıkan sonuçlar:
| Benchmark | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (ajanlık kodlama) | 80.3% | 69.2% | 58.6% |
| FrontierCode Diamond (en zor kodlama) | 29.3 | 13.4 | 5.7 |
| Terminal-Bench 2.1 (ajanlık kabuk) | 88.0% | n/a | n/a |
| GPQA-AA (lisansüstü akıl yürütme, Elo) | 1932 | n/a | n/a |
| ExploitBench | 78.0% | n/a | n/a |
Karşılaştırma referansı burada Claude Opus 4.8 — Fable 5'in frontier'da yerini aldığı model ve aynı zamanda Fable 5'in yüksek riskli sorgularda geri düştüğü model. Opus 4.x hattını son iki sürümde takip ettiyseniz, artımlı kazanımlar görüyordunuz. Fable 5 bu örüntüyü kırıyor.
Tabloyu kesin gerçek gibi okumadan önce iki şeye dikkat edin. Birincisi, SWE-Bench Pro, Anthropic'in kendi yayınladığı ve başka kaynaklarca bağımsız olarak doğrulanan bir değerlendirme; FrontierCode Diamond ise Anthropic tarafından hiç yayınlanmamış bir sayı, Vellum ve llm-stats'ın takip ettiği üçüncü taraf bir benchmark. İkincisi, akıl yürütme çabası kadranı, tek bir benchmark sayısının bir maliyet eğrisini gizlediği anlamına geliyor. Bunu fiyatlandırma bölümünde ele alacağız çünkü hesabı değiştiriyor.
Geliştiriciler İçin Önemli Benchmark'lar
Pratik ağırlığı olan dört sayı var: SWE-Bench Pro 80.3%, FrontierCode Diamond 29.3, Terminal-Bench 2.1 88.0% ve GPQA-AA 1932 Elo. Bunlar birlikte gerçek repo çalışmasını, en zor sentetik kodlama problemlerini, ajanlık kabuk görevlerini ve lisansüstü düzey akıl yürütmeyi kapsıyor. İş yükünüz bunlardan herhangi birine değiyorsa, bu bölüm o sayının sizin işinize gerçekten karşılık gelip gelmediğini söylüyor.
Bu yazının başındaki ana grafik kanıtı sunuyor: SWE-Bench Pro 80.3 - 69.2 - 58.6 ve FrontierCode 29.3 - 13.4 - 5.7. Peki bunlar gerçekte neyi ölçüyor?
- SWE-Bench Pro, bir modelin gerçek bir repoya gerçek bir pull request gönderip gönderemeyeceğini test ediyor: klonla, anla, yamala, testleri geçir. Fable 5 bu testlerin 10'da 8'ini tamamlıyor. "Gerçek işimi yapabilir mi?" sorusunun en yakın göstergesi bu.
- Terminal-Bench 2.1, ajanlık kabuk görevlerini puanlıyor: komut çalıştırma, çıktı okuma, hatalardan kurtulma. 88.0%, terminalde yaşayan yapay zeka kodlama ajanları geliştiriyorsanız önem taşıyor.
- FrontierCode Diamond, kodlama problemlerinin en zor kademesi — çoğu modelin tek haneli skor aldığı seviye. 29.3 mutlak değer olarak düşük, ama Opus 4.8'in 13.4'ünün iki katından fazla.
- GPQA-AA, Elo puanıyla değerlendirilen lisansüstü düzey bilimsel akıl yürütme. 1932, kodun ötesinde güçlü çok adımlı akıl yürütmeye işaret ediyor.
Opus 4.x hattında Claude Code iş akışlarımızdaki tekrarlayan tavan, uzun vadeli ajanlık görevleriydi: model, çok dosyalı bir değişikliğin ortasında konuyu kaybediyordu. Fable 5'in Terminal-Bench ve SWE-Bench Pro sayıları bu tavanın yükseldiğini düşündürüyor. Sizin reponuz için yükselip yükselmediğinin tek testi kendi denemeleriniz, ama yayınlanan sayılar önemsenmesi gereken türden sayılar.
Gerçek Test Senaryoları: Fable 5'in Önceki Modellerin Yapamadıklarını Yapması
Anthropic, Fable 5'in artık üstesinden gelebildiği problem sınıfını gösteren üç somut örnek yayınladı: aylarca süren bir Stripe kod tabanı migrasyonunu tek güne sıkıştırma, yalnızca görüntü tabanlı tamamlanan bir video oyunu ve kendi kendini doğrulamadan gelen 3× performans artışı. Her biri önceki modellerin ulaşamadığı bir kapasiteye işaret ediyor. Üçü de Anthropic kaynaklı; kendi testlerimizi değil, duyurularını aktarıyoruz.
Her birinin kanıtladığı şey:
-
Stripe Ruby migrasyonu. Anthropic, Fable 5'in yaklaşık iki aylık bir Ruby kod tabanı migrasyonunu yaklaşık bir güne sıkıştırdığını bildiriyor. Stripe, iki aylık bir migrasyonu tek güne indirdi — bu modelin değiştirdiği problem büyüklüğü bu. Eskiden tüm kod tabanını kafasında tutan bir insan ekibine ihtiyaç duyan uzun vadeli yeniden yapılandırma sınıfı.
-
Yalnızca görüntüyle Pokémon FireRed. Anthropic'e göre Fable 5, önceki modellerin oyun durumunu metin olarak beslemek için karmaşık özel iskeletlere ihtiyaç duyduğu yerde Pokémon FireRed'i yalnızca görüntüyü kullanarak tamamladı. Bu, mekânsal ve görsel akıl yürütmede önemli bir sıçrama: model ekranı okuyor ve hareket ediyor, iskelet yok.
-
Slay the Spire, 3×. Maksimum akıl yürütme çabasında Anthropic, Fable 5'in kendi hamlelerini doğruladığını ve kalıcı bellek sayesinde 3× daha iyi performansa ulaştığını söylüyor. Önemli olan oyun değil; modelin uzun bir planlama sürecinde kendi çalışmasını kontrol edip bundan gelişme sağlayabilmesi.
Bunların hiçbirini kendi iş yükünüz için doğrudan kabul etmeniz gerekmiyor. Ama yukarıdaki tablodaki benchmark sıçramalarıyla temiz bir şekilde örtüşüyorlar: uzun vadeli kodlama (SWE-Bench Pro), mekânsal akıl yürütme (görüntü) ve kendi kendini doğrulama (akıl yürütme çabası kadranı). Niteliksel ve niceliksel kazanımlar aynı hikâyeyi anlatıyor.
Fiyatlandırma ve Görev Başı Maliyet Gerçeği
Fable 5, milyon giriş tokeni başına $10 ve milyon çıkış tokeni başına $50 maliyetiyle geliyor. Anthropic bunu "Claude Mythos Preview'ın yarısından az" olarak çerçeveliyor. Aynı zamanda token başına Opus 4.8'in yaklaşık 2 katı. Her ikisi de doğru. Sorun şu ki token fiyatı yanlış birim. Gerçekte ödediğiniz şey tamamlanmış bir görev; ve burada Fable 5'in matematiği ilginçleşiyor.

Akıl yürütme çabası, istek başına ayarladığınız bir kadran. Düşük çaba daha az dahili akıl yürütme tokeni, daha ucuz ve hızlı bir yanıt anlamına gelir; maksimum çaba modelin daha uzun düşünmesi, daha fazla çıkış tokeni harcaması ve daha yüksek skor alması demek. Yukarıdaki grafik, FrontierCode'da Fable 5'in düşük çabadan maksimuma ölçeklenirken ~11%'den ~31%'e yükseldiğini gösteriyor; Opus 4.8 ~13%'te zirve yaparken GPT-5.5 5-6% civarında düz kalıyor. Yani görev başı maliyet tek bir sayı değil, üzerinde bir nokta seçtiğiniz bir eğri.
Yayınlanan $10/$50 fiyatlandırmasından somut bir örnek çalışalım. Bu, Anthropic'in yayınladığı oranlardan yapılan aritmetik, benchmark sonucu değil.
Yüksek çabada 50.000 giriş ve 15.000 çıkış tokenli tek bir ajanlık çağrı alalım:
Giriş: 50.000 / 1.000.000 × $10 = $0,50
Çıkış: 15.000 / 1.000.000 × $50 = $0,75
Çağrı başı: $1,25Gerçek bir ajanlık görev bu şekilde birçok çağrıyı zincirler: repoyu oku, planla, düzenle, testleri çalıştır, düzelt, tekrarla. Döngünün bu yapıda 12 çağrı çalıştırdığını varsayalım: tamamlanan görev için kabaca $15. Daha ağır bağlamla maksimum akıl yürütme çabasında Anthropic'in maliyet eğrisi, zor FrontierCode görevlerini görev başı ~$20 aralığına yerleştiriyor. Aynı görevi GPT-5.5 üzerinde çalıştırırsanız token başına daha az ödersiniz. Ama herhangi bir çaba düzeyinde görevi tamamlayamazsa, tamamlanan görev başı maliyetiniz sonsuzdur. Fable 5, token başına GPT-5.5'ten pahalı; ama GPT-5.5'in tamamlayamadığı işleri tamamladığı için görev başı maliyette kazanıyor.
İşte minimal bir çağrı örneği. Model kimliği API'de claude-fable-5 (Bedrock'ta anthropic.claude-fable-5). 4.6 nesli itibarıyla Anthropic'in model kimlikleri tarihsiz; bunu Anthropic'in duyurusu da doğruluyor, yani peşinden koşacağınız sürümlü bir takma ad yok, bu dize sabitlenmiş (pinned) snapshot'ın kendisi:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # dateless id; this is the pinned snapshot
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)Ekonomi tezi tek cümlede: token başına GPT-5.5'ten fazla ödersiniz, ama GPT-5.5'in hiçbir fiyata tamamlayamadığı görevleri tamamlarsınız. Düşük riskli, yüksek hacimli işlerde bu matematik daha ucuz bir modeli işaret eder. Zor ajanlık kodlamada ise Fable 5'i.
Güvenlik Koruması Ayrımı: Neden Fable, Opus 4.8'e Geri Düşüyor?
Fable 5, her isteği sınıflandırıcılardan geçiriyor. Yüksek riskli bir sorgu tespit ettiğinde (saldırı amaçlı siber, biyolojik, kimyasal veya model damıtma girişimleri) tam Mythos sınıfı kapasiteyle yanıt vermek yerine Opus 4.8'e geri düşüyor. Anthropic, bu geri dönüşün oturumların %5'inden azında tetiklendiğini söylüyor, dolayısıyla çoğu kullanıcı bunu hiç tetiklemiyor. Amaç, tehlikeli kapasiteyi kapalı tutarken gündelik çalışmayı etkilememek.
Daha sert sayı saldırı başarı oranı: otomatik bir saldırganın modeli yapmaması gereken bir şeyi yaptırabilme sıklığı. Düşük olan daha iyidir. Gray Swan ve İngiltere Yapay Zeka Güvenliği Enstitüsü (UK AI Security Institute), düşünme modu açıkken k=100 ayarıyla ajanlık kırmızı ekip testleri yürüttü ve sonuçlar farka gerçek bir sayı kazandırdı:
| Model | Saldırı başarı oranı |
|---|---|
| Claude Fable 5 | %4,8 |
| Claude Opus 4.8 | %9,6 |
| GPT-5.5 | %30,8 |
| Gemini 3.1 Pro | %45,5 |
Fable 5 hâlâ alanda önde, ama Opus 4.8'e kıyasla fark kabaca 2 kat — zaman zaman iddia edilen büyüklük mertebesi farkı değil. GPT-5.5 ve Gemini 3.1 Pro'ya karşı ise fark çok daha geniş: 6-9 kat.
Neden önemsemelisiniz? Araç erişimiyle (kabuk, dosya sistemi, ağ) bir ajan dağıtıyorsanız, bir jailbreak kötü bir sohbet yanıtı değil, modelin bir saldırganın yönlendirdiği gerçek komutları çalıştırması demektir. %5'in altındaki bir saldırı başarı oranı — Opus 4.8'in kabaca yarısı — canlı araçlara dokunan her iş için geçişe hâlâ değer. IT Pro'nun haberi tam da bu yüzden geri düşüş mekanizmasıyla açıldı: bu, bir frontier modeli halkın kullanımına güvenle sunan özellik.
Ödünleşim gecikme süresi. İş akışınız meşru olarak güvenlik araçlarına değiyorsa, geri düşüş görev ortasında tetiklenip modeli değiştirebilir — bunu planlamaya değer.
Claude Mythos 5 ve Çift Kullanım Sorusu
Claude Mythos 5, gated kardeş model — aynı model, güvenlik koruması geri dönüşü olmadan. Fable 5'in engellediği saldırı amaçlı siber kapasiteyi koruyor; Anthropic'in onu kamuya açıklamamasının tam nedeni de bu. Erişim, tam kapasiteye ihtiyaç duyan savunmacılar ve araştırmacılar için Project Glasswing adlı denetlenmiş programdan geçiyor. Aynı model, iki yayın tutumu: biri açık, biri gated.

Grafik, ayrımı görünür kılıyor. Saldırı amaçlı siber değerlendirmelerde (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 sırasıyla 88.4, 24.0, 83.8 ve 38.7 skoru alıyor. Fable 5 ise tüm dördünde düz 0.0 döndürüyor. Mythos 5'in 88.4'e kadar çıktığı saldırı amaçlı siber değerlendirmelerde Fable 5'in düz 0.0 döndürmesi: güvenlik koruması ayrımı, görünür hâle getirilmiş.
Bu sıfır bir kapasite eksikliği değil. Her seferinde tetiklenen geri dönüş, Mythos sınıfı modelin yanıt vermesinden önce isteği engelliyor. TechCrunch, zamanlamayı not etti: Anthropic bunu, yapay zekanın açık yayınlamak için çok tehlikeli hâle geldiği uyarısından günler sonra yayınladı. Fable/Mythos ayrımı, bu uyarıya verilen politika yanıtı: kapasiteyi yayınla, tehlikeyi kapat.
Çoğu geliştirici için Mythos 5 konu dışı. Project Glasswing için hiçbir zaman nitelik kazanmayacaksınız ve buna gerek de yok. Önemli olan, çağırdığınız modelin dar bir görev bandında kasıtlı olarak sınırlandırıldığını — tasarım gereği — bilmek.
Lansmandan Sonra Ne Oldu: İki Haftalık Askıya Alma, Ardından Bir Güvenlik Yaması
Fable 5'in ilk altı haftası düz bir çizgide ilerlemedi. 9 Haziran lansmanından üç gün sonra ABD hükümeti, Anthropic'in en yeni modellerine ihracat kontrolleri uyguladı ve 12 Haziran 2026'da erişim, her yerde, tüm kullanıcılar için askıya alındı — çünkü Anthropic'in API'yi gerçekte kimin çağırdığını doğrulamanın bir yolu yoktu. Hükümet onayı 26 Haziran'da geldi ve Mythos 5, önce denetlenmiş bir grup ABD kuruluşuna geri yüklendi (Anthropic kaç kuruluş olduğunu yayınlamadı). Herkes için tam geri yükleme, GitHub'ın Copilot'ta Fable 5'i yeniden etkinleştirdiği aynı gün olan 1 Temmuz 2026'da gerçekleşti. Askıya almanın ayrıntılı gidiş gelişi için askıya alma sürecinin tam zaman çizelgesine bakın.
Bu askıya alma bir lisanslama sorunuydu, bir güvenlik sorunu değil. Ayrı bir konu olarak ve ihracat kontrolü donmasıyla ilgisi olmadan, Amazon araştırmacıları, sınıflandırıcının engellemesi gereken yazılım açıklarını çıkarabilecek kadar iyi çalışan, Fable 5'in güvenlik korumalarını atlatan bir prompt tekniği buldu. Anthropic modeli bu yüzden geri çekmedi; bunun yerine 1 Temmuz'daki geri yüklemeyle birlikte bir düzeltme yayınladı — bu belirli tekniği vakaların %99'undan fazlasında engelleyen bir sınıflandırıcı güncellemesi, kalan durumlar ise eskisi gibi Opus 4.8'e geri düşüyor. İki farklı sorunun iki farklı düzeltmesinin aynı takvim haftasına denk gelmesi, birinin diğerine yol açtığı anlamına gelmiyor.
Müşteriye dönük herhangi bir şey için Fable 5 etrafında planlama yapıyorsanız, pratik ders şu: bir frontier modelin lansman günü koşulları altı hafta sonra hep aynı kalmıyor.
Rekabet Alanı Değişti: GPT-5.6 ve Claude Sonnet 5
Fable 5'i yalnızca GPT-5.5 ile karşılaştırmak 9 Haziran'da mantıklıydı. Artık öyle değil. O tarihten bu yana çıkan iki lansman hesabı değiştiriyor ve büyük olanı bir rakipten değil, Anthropic'in kendi ürün ailesinden geliyor.
Claude Sonnet 5, 30 Haziran 2026'da yayınlandı ve en çok göz ardı edilebilecek fark burada. Fiyatlandırması standart olarak milyon token başına $3/$15, 31 Ağustos 2026'ya kadar geçerli giriş oranıyla $2/$10 — Fable 5'in $10/$50'sinin bir kesri. SWE-Bench Pro'da 63.2% alıyor; bu, Fable 5'in 80.3%'ünün ve Opus 4.8'in 69.2%'sinin gerisinde. Ama Terminal-Bench 2.1'de 80.4% ile Opus 4.8'in 74.6%'sını geçiyor ve OSWorld-Verified skoru 81.2%. Aynı aileden bir modelin, Fable 5'in fiyatının beşte biriyle önceki amiral gemisini bir ajanlık benchmark'ta geçmesi, "geçiş yapmalı mısınız" başlıklı bir yazının atlayabileceği bir ayrıntı değil.
GPT-5.6, OpenAI'nin 9 Temmuz 2026'da yayınladığı takip modeli, üç kademeyle geliyor: Sol, Terra ve Luna. Sol, Fable 5'in giriş maliyetinin kabaca yarısı olan $5/$30'dan fiyatlanıyor; Terra $2.50/$15, Luna ise $1/$6. Vellum'un 9 Temmuz benchmark karşılaştırmasına göre, kafa kafaya sonuçlar şöyle:
| Benchmark | GPT-5.6 Sol | Fable 5 |
|---|---|---|
| SWE-Bench Pro | 64.6% | 80.0% |
| Terminal-Bench 2.1 | 88.8% | 86.0% |
| Coding Agent Index | 80 | 77.2 |
| Agents' Last Exam | 53.6 | 40.5 |
| OSWorld | 62.6% (2.0) | 85.0% (Verified) |
Sol; Terminal-Bench, Coding Agent Index ve Agents' Last Exam'de kazanıyor — bildirildiğine göre Fable 5'in yarısından az çıkış tokeni, yarısından az süre ve görev başına yaklaşık üçte bir daha az maliyetle. Fable 5 ise SWE-Bench Pro ve OSWorld'de kesin bir farkla önde kalıyor.
İki güncellemeyi bir araya getirdiğinizde dürüst hüküm "Fable 5 alanı süpürüyor" ifadesinden şuna kayıyor: "Fable 5 gerçek repo işi ve bilgisayar kullanımında kazanıyor, ama ajanlık ve terminal görevlerinde ve maliyette — bu yazı ilk yayınlandığında var olmayan modeller karşısında — zemin kaybediyor." İş yükünüz SWE-Bench tarzıysa — gerçek repolara karşı gerçek pull request'ler — Fable 5 hâlâ doğru seçim. Terminal-ve-ajan tarzıysa ya da bütçe kısıtlıysa, taahhüt vermeden önce daha yeni alanı test edin. Anthropic'in kendi bir sonraki sürümü hâlâ açık bir soru; isimlendirme örüntüsünün neye işaret ettiği için Claude Fable 6 çıkış tarihi yazımıza bakın.
Ailedeki güncel API fiyatlandırması için: Fable 5 ve Mythos 5'in ikisi de milyon token başına $10/$50 ile çalışıyor, Opus 4.8 $5/$25, Sonnet 5 $3/$15 (31 Ağustos 2026'ya kadar geçerli giriş oranıyla $2/$10) ve Haiku 4.5 $1/$5.
Ne Anlama Geliyor: Geçiş Yapmalı mısınız?
Zor ajanlık kodlama, uzun vadeli çok adımlı görevler ve görüntü ya da mekânsal akıl yürütme için Fable 5'e geçin — görevi tamamlamanın token başına tasarruf etmekten önemli olduğu her yerde. Maliyet hassasiyeti yüksek, yüksek hacimli işler için ya da zaten geri dönüşü tetikleyecek şeyler için Opus 4.8'de kalın. Çerçevenin tamamı bu. Geri kalanı iş yükünüzü doğru tarafa eşleştirmek.
Fable 5'in kazandığı durumlar:
- Opus 4.8'in durduğu zor ajanlık kodlama; SWE-Bench Pro farkı gerçek
- Uzun vadeli görevler (çok dosyalı yeniden yapılandırmalar, migrasyonlar) — kendi kendini doğrulama burada karşılığını veriyor
- Görüntü ve mekânsal akıl yürütme iş yükleri
- Tamamlanan bir görevin token priminden daha değerli olduğu her iş
Opus 4.8'in hâlâ kazandığı durumlar:
- Token başı fiyatın belirleyici olduğu yüksek hacimli, maliyet hassas işler
- Siber/biyolojik/kimyasal iş yükleri — Fable 5 zaten Opus 4.8'e geri düşeceğinden, doğrudan çağırın
- Görev ortasında model değişimini kaldıramayan gecikme hassas akışlar
| Kullanım senaryosu | Önerilen model |
|---|---|
| Zor ajanlık kodlama / migrasyonlar | Claude Fable 5 |
| Görüntü / mekânsal akıl yürütme | Claude Fable 5 |
| Yüksek hacimli ucuz sınıflandırma | Claude Opus 4.8 |
| Güvenlik / kırmızı ekip araçları | Claude Opus 4.8 (doğrudan) |
Kullanılabilirlik açısından: lansmandaki "belirli bir tarihe kadar ücretsiz" çerçevesi artık geçerli değil. Fiyatlandırma son tarihi dört kez ertelendi — 22 Haziran → 7 Temmuz → 12 Temmuz → 19 Temmuz 2026 — ve 20 Temmuz'daki çözüm, tarihi bir kademe ayrımıyla değiştirdi: Max ve Team Premium, Fable 5'i plan limitlerinin %50'sinde kalıcı olarak dahil tutmaya devam ediyor; Pro ve Team Standard ise kullanım kredilerine geçiyor — tek seferlik $100 kredi, ardından API oranları. Bu ayrım TechTimes, XenoSpectrum ve Basic Tutorials tarafından bildiriliyor; Anthropic bunu kendi fiyatlandırma sayfasında yayınlamadı, dolayısıyla bunu bildirilen bilgi olarak değerlendirin, doğrulanmış değil. Fable 5; Claude API, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (1 Temmuz 2026'da GitHub changelog'a göre yeniden etkinleştirildi; politika varsayılan olarak kapalı geldiğinden Business ve Enterprise yöneticilerinin bunu açması gerekiyor) ve tüketici Pro/Max/Team/Enterprise uygulamalarında genel kullanıma sunuldu. Bağlam penceresi 1M token, maksimum çıkış 128k token, bilgi kesim tarihi Ocak 2026. Kurumsal alıcılar için iki ayrıntı önemli: Fable 5 ve Mythos 5, Anthropic'in zorunlu 30 günlük veri saklama politikası kapsamında Covered Model statüsünde, dolayısıyla sıfır veri saklama seçeneğiyle kullanılamıyorlar; ayrıca yalnızca ABD içi çıkarım (inference) için 1,1x'lik bir fiyatlandırma çarpanı uygulanıyor.
Yazar Hakkında
Mert Batur, Techsy.io'nun Kurucu Ortağı; ekip B2B müşteriler için yapay zeka ajanları, otomasyon sistemleri ve sesli/SDR pipeline'ları geliştiriyor. Techsy ekibinin prodüksiyonda gerçekten kullandığı LLM araç yığınını yazıyor. LinkedIn üzerinden bağlantı kurabilirsiniz.
Kurucu Ortak, Techsy.io
Sıkça Sorulan Sorular
Claude Fable 5 nedir?
Claude Fable 5, Anthropic'in 9 Haziran 2026'da piyasaya sürdüğü, kamuya açık ilk Mythos sınıfı modeldir. SWE-Bench Pro'da 80.3% skor alıyor ve yüksek riskli sorgularda Opus 4.8'e geri düşen güvenlik koruması sınıflandırıcıları çalıştırıyor. Milyon token başına $10 giriş / $50 çıkış maliyetiyle geliyor.
Fable 5 ile Mythos 5 arasındaki fark nedir?
İkisi de farklı yayın tutumlarına sahip aynı frontier model. Fable 5 kamuya açık ve güvenlik korumalı; tehlikeli sorgularda Opus 4.8'e geri düşüyor. Mythos 5, yalnızca Fable 5'in engellediği tam saldırı amaçlı siber kapasiteye ihtiyaç duyan denetlenmiş savunmacılar ve araştırmacılar için Anthropic'in Project Glasswing programı aracılığıyla erişilebilen gated, tam kapasiteli sürüm.
Claude Fable 5 gerçekten Opus 4.8'den daha iyi mi?
Zor ajanlık kodlama, görüntü ve mekânsal akıl yürütmede evet: Fable 5, SWE-Bench Pro'da Opus 4.8'in 69.2%'sine karşı 80.3% alıyor. Ancak maliyet hassas, yüksek hacimli işlerde Opus 4.8 hâlâ kazanıyor; üstelik Fable 5 yüksek riskli siber/biyolojik/kimyasal konularda zaten Opus 4.8'e geri düşüyor. "Daha iyi" iş yükünüze bağlı.
Claude Fable 5'in maliyeti ne kadar?
Claude Fable 5, milyon giriş tokeni başına $10 ve milyon çıkış tokeni başına $50 maliyetiyle geliyor. Anthropic'in çerçevelemesi "Mythos Preview'ın yarısından az". Token başına Opus 4.8'in yaklaşık 2 katı; ama değer argümanı tamamlanan görev başına, çünkü Fable 5 daha ucuz modellerin yapamadığı işleri tamamlıyor.
"Mythos sınıfı" model nedir?
Mythos sınıfı, Anthropic'in Fable 5 ve Mythos 5 ile başlattığı yeni en üst yetenek kademesi. Kodlama ve akıl yürütme benchmark'larında Opus 4.x hattının ötesinde bir frontier sıçramasını temsil ediyor. Fable 5 ve Mythos 5, aynı Mythos sınıfı modelin iki yayın sürümü: biri kamuya açık ve güvenlik korumalı, biri gated.
Fable 5 neden Opus 4.8'e geri düşüyor?
Fable 5, yüksek riskli istekleri (saldırı amaçlı siber, biyolojik, kimyasal veya model damıtma) tespit eden ve tam Mythos sınıfı kapasiteyle yanıt vermek yerine bunları Opus 4.8'e yönlendiren sınıflandırıcılar çalıştırıyor. Bu, oturumların %5'inden azında tetikleniyor. Gray Swan / UK AI Security Institute'un ajanlık kırmızı ekip testlerinde bu kombinasyon, Fable 5'e Opus 4.8'in %9,6'sına karşı %4,8'lik bir saldırı başarı oranı kazandırıyor — ikisi de GPT-5.5'in %30,8'inin oldukça ilerisinde.
Claude Mythos 5'e erişebilir miyim?
Büyük olasılıkla hayır. Mythos 5, Fable 5'in engellediği tam saldırı amaçlı siber kapasiteye ihtiyaç duyan savunmacılar ve güvenlik araştırmacıları için Anthropic'in Project Glasswing adlı denetlenmiş erişim programının arkasında. Çoğu geliştirici nitelik kazanmayacak ve buna gerek de yok; Fable 5 gündelik ajanlık ve kodlama işlerini karşılıyor.
Claude Fable 5'i nerede kullanabilirim?
Claude Fable 5, Claude API, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (1 Temmuz 2026'da yeniden etkinleştirildi, Business/Enterprise yöneticileri için opt-in) ve tüketici Pro/Max/Team/Enterprise uygulamalarında genel kullanıma sunuldu. Fiyatlandırma artık belirli bir tarihe kadar ücretsiz değil: Max ve Team Premium onu kalıcı olarak dahil tutmaya devam ediyor; Pro ve Team Standard ise tek seferlik $100 kredi, ardından API oranları alıyor — TechTimes ve XenoSpectrum'a göre.
Sonuç
Claude Fable 5, Opus 4.8'e karşı gerçek bir frontier adımı: SWE-Bench Pro'da 80.3%'e karşı 69.2%, iki kat FrontierCode skoru ve Gray Swan / UK AISI kırmızı ekip testinde Opus 4.8'in %9,6'sına karşı %4,8'lik bir saldırı başarı oranı — araç kullanan ajanlar için hâlâ daha güvenli seçim, ama fark zaman zaman iddia edilen büyüklük mertebesi değil, kabaca 2 kat. Zor ajanlık kodlama, uzun vadeli görevler ve görüntü işleri için geçin; iş yükünüz terminal-ve-ajan tarzıysa ya da bütçe kısıtlıysa, önce Claude Sonnet 5 ve GPT-5.6 Sol'u kontrol edin — ikisi de Fable 5'ten sonra piyasaya çıktı ve lansmanda karşılaştırılacak bir muadilleri yoktu. Erişim de artık belirli bir tarihe kadar ücretsiz değil: Max/Team Premium onu dahil tutmaya devam ediyor, Pro/Team Standard ise tek seferlik bir kredi sonrasında API oranlarına geçiyor. Techsy ekibi prodüksiyonda tam olarak bu yığın üzerine ajanlar geliştiriyor; yardım istiyorsanız bize ulaşın.