
Claude Fable 5 vs Opus 4.8: Gerçekten Geçiş Yapmalı mısınız? (Mythos Sınıfı, Benchmark Sonuçlarıyla)
Anthropic, Claude Fable 5'i bugün, 9 Haziran 2026'da yayınladı. Model, ajanlık kodlama benchmark'ı SWE-Bench Pro'da 80.3% skoru alırken Opus 4.8 69.2%'de kalıyor ve GPT-5.5 58.6% ile geride. Bu, yuvarlama hatasıyla açıklanabilecek küçük bir fark değil. Ayrıca ilginç bir detay var: Fable 5, yeni "Mythos sınıfı" modelin herkese açık, güvenlik korumalı yarısı; Claude Mythos 5 adlı kardeş model ise kısıtlı erişim programının arkasında tutuluyor. İşte neyin değiştiği, milyon token başına $10/$50 fiyatlamasıyla gerçek bir görevin maliyeti ve Opus 4.8'den geçiş yapıp yapmamanız gerektiği.
Kısa Yanıt
- Fable 5, SWE-Bench Pro'da 80.3% alıyor; Opus 4.8 69.2%, GPT-5.5 ise 58.6%.
- Fiyatlandırma: milyon token başına $10 giriş / $50 çıkış — Mythos Preview'ın yarısından az.
- Fable 5, yüksek riskli siber/biyolojik/kimyasal sorgularda otomatik olarak Opus 4.8'e geri düşüyor (oturumların %5'inden azında).
- Pro/Max/Team/Enterprise planlarında 22 Haziran 2026'ya kadar ücretsiz; kullanım kredileri 23 Haziran'dan itibaren geçerli.
Gerçekte Ne Yayınlandı: Fable 5, Mythos 5 ve "Mythos Sınıfı" Hat
Mythos sınıfı, Anthropic'in yeni en üst yetenek kademesi ve iki model olarak geliyor. Claude Fable 5, bugün kullanabileceğiniz herkese açık, güvenlik korumalı sürüm. Claude Mythos 5 ise aynı frontier modelin güvenlik korumaları kaldırılmış hali; gated erişimin arkasında tutuluyor. Aynı zeka, iki farklı yayın tutumu.
Bu ayrım, asıl hikâyenin kendisi. Anthropic'in haber duyurusuna göre Mythos 5, gerçek zarar verebilecek saldırı amaçlı siber beceriler dahil tam frontier kapasitesini koruduğundan Anthropic onu herkese açmıyor. Fable 5 ise aynı modeli alıp üzerine yüksek riskli istekleri tespit eden ve bunları sessizce Opus 4.8'e yönlendiren sınıflandırıcılar sarıyor.
Yani Fable 5'i çağırdığınızda, tehlikeli olmayan her şeyde Mythos sınıfı akıl yürütmesi alıyorsunuz; tehlikeli olan küçük dilimde ise daha güvenli bir yedek modele geçiliyor. CNBC, bunu Anthropic'in halka "Mythos benzeri bir yapay zeka" sunması olarak tanımladı — doğru, ama tam mekanizma başlıktan daha önemli.
Fable 5 ve Mythos 5, ikiye bölünmüş aynı frontier model: biri bugün kullanabileceğiniz, biri Anthropic'in gated tuttuğu. İsimlendirme hakkında tek bir şey hatırlayacaksanız bu olsun. Mythos sınıfı, kademenin adı; Fable ve Mythos ise o kademeye iki farklı kapı.
Opus 4.x Hattına Kıyasla Ne Değişti
Anthropic'in yayınladığı her kodlama ve akıl yürütme değerlendirmesinde Fable 5, Opus 4.8'i geçiyor — ufak farkla değil, çift haneli farkla. SWE-Bench Pro 69.2%'den 80.3%'e yükseliyor. FrontierCode Diamond 13.4'ten 29.3'e çıkıyor. Fiyatlandırma da düştü; model ayrıca yeni bir akıl yürütme çabası kadranıyla geliyor. Bu, Opus 4.x hattının yalnızca bir nokta sürümü değil, gerçek bir frontier adımı.

Yukarıdaki 13 benchmark özeti genel tabloya bakış sağlıyor. İşte ekiplerin gerçekten karşılaştırdığı üç modele karşı öne çıkan sonuçlar:
| Benchmark | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (ajanlık kodlama) | 80.3% | 69.2% | 58.6% |
| FrontierCode Diamond (en zor kodlama) | 29.3 | 13.4 | 5.7 |
| Terminal-Bench 2.1 (ajanlık kabuk) | 88.0% | n/a | n/a |
| GPQA-AA (lisansüstü akıl yürütme, Elo) | 1932 | n/a | n/a |
| ExploitBench | 78.0% | n/a | n/a |
Karşılaştırma referansı burada Claude Opus 4.8 — Fable 5'in frontier'da yerini aldığı model ve aynı zamanda Fable 5'in yüksek riskli sorgularda geri düştüğü model. Opus 4.x hattını son iki sürümde takip ettiyseniz, artımlı kazanımlar görüyordunuz. Fable 5 bu örüntüyü kırıyor.
Tabloyu kesin gerçek gibi okumadan önce iki şeye dikkat edin. Birincisi, bunlar bağımsız bir testin değil Anthropic'in kendi yayınladığı değerlendirmelerin sonuçları. İkincisi, akıl yürütme çabası kadranı, tek bir benchmark sayısının bir maliyet eğrisini gizlediği anlamına geliyor. Bunu fiyatlandırma bölümünde ele alacağız çünkü hesabı değiştiriyor.
Geliştiriciler İçin Önemli Benchmark'lar
Pratik ağırlığı olan dört sayı var: SWE-Bench Pro 80.3%, FrontierCode Diamond 29.3, Terminal-Bench 2.1 88.0% ve GPQA-AA 1932 Elo. Bunlar birlikte gerçek repo çalışmasını, en zor sentetik kodlama problemlerini, ajanlık kabuk görevlerini ve lisansüstü düzey akıl yürütmeyi kapsıyor. İş yükünüz bunlardan herhangi birine değiyorsa, bu bölüm o sayının sizin işinize gerçekten karşılık gelip gelmediğini söylüyor.
Bu yazının başındaki ana grafik kanıtı sunuyor: SWE-Bench Pro 80.3 - 69.2 - 58.6 ve FrontierCode 29.3 - 13.4 - 5.7. Peki bunlar gerçekte neyi ölçüyor?
- SWE-Bench Pro, bir modelin gerçek bir repoya gerçek bir pull request gönderip gönderemeyeceğini test ediyor: klonla, anla, yamala, testleri geçir. Fable 5 bu testlerin 10'da 8'ini tamamlıyor. "Gerçek işimi yapabilir mi?" sorusunun en yakın göstergesi bu.
- Terminal-Bench 2.1, ajanlık kabuk görevlerini puanlıyor: komut çalıştırma, çıktı okuma, hatalardan kurtulma. 88.0%, terminalde yaşayan yapay zeka kodlama ajanları geliştiriyorsanız önem taşıyor.
- FrontierCode Diamond, kodlama problemlerinin en zor kademesi — çoğu modelin tek haneli skor aldığı seviye. 29.3 mutlak değer olarak düşük, ama Opus 4.8'in 13.4'ünün iki katından fazla.
- GPQA-AA, Elo puanıyla değerlendirilen lisansüstü düzey bilimsel akıl yürütme. 1932, kodun ötesinde güçlü çok adımlı akıl yürütmeye işaret ediyor.
Opus 4.x hattında Claude Code iş akışlarımızdaki tekrarlayan tavan, uzun vadeli ajanlık görevleriydi: model, çok dosyalı bir değişikliğin ortasında konuyu kaybediyordu. Fable 5'in Terminal-Bench ve SWE-Bench Pro sayıları bu tavanın yükseldiğini düşündürüyor. Sizin reponuz için yükselip yükselmediğinin tek testi kendi denemeleriniz, ama yayınlanan sayılar önemsenmesi gereken türden sayılar.
Gerçek Test Senaryoları: Fable 5'in Önceki Modellerin Yapamadıklarını Yapması
Anthropic, Fable 5'in artık üstesinden gelebildiği problem sınıfını gösteren üç somut örnek yayınladı: aylarca süren bir Stripe kod tabanı migrasyonunu tek güne sıkıştırma, yalnızca görüntü tabanlı tamamlanan bir video oyunu ve kendi kendini doğrulamadan gelen 3× performans artışı. Her biri önceki modellerin ulaşamadığı bir kapasiteye işaret ediyor. Üçü de Anthropic kaynaklı; kendi testlerimizi değil, duyurularını aktarıyoruz.
Her birinin kanıtladığı şey:
-
Stripe Ruby migrasyonu. Anthropic, Fable 5'in yaklaşık iki aylık bir Ruby kod tabanı migrasyonunu yaklaşık bir güne sıkıştırdığını bildiriyor. Stripe, iki aylık bir migrasyonu tek güne indirdi — bu modelin değiştirdiği problem büyüklüğü bu. Eskiden tüm kod tabanını kafasında tutan bir insan ekibine ihtiyaç duyan uzun vadeli yeniden yapılandırma sınıfı.
-
Yalnızca görüntüyle Pokémon FireRed. Anthropic'e göre Fable 5, önceki modellerin oyun durumunu metin olarak beslemek için karmaşık özel iskeletlere ihtiyaç duyduğu yerde Pokémon FireRed'i yalnızca görüntüyü kullanarak tamamladı. Bu, mekânsal ve görsel akıl yürütmede önemli bir sıçrama: model ekranı okuyor ve hareket ediyor, iskelet yok.
-
Slay the Spire, 3×. Maksimum akıl yürütme çabasında Anthropic, Fable 5'in kendi hamlelerini doğruladığını ve kalıcı bellek sayesinde 3× daha iyi performansa ulaştığını söylüyor. Önemli olan oyun değil; modelin uzun bir planlama sürecinde kendi çalışmasını kontrol edip bundan gelişme sağlayabilmesi.
Bunların hiçbirini kendi iş yükünüz için doğrudan kabul etmeniz gerekmiyor. Ama yukarıdaki tablodaki benchmark sıçramalarıyla temiz bir şekilde örtüşüyorlar: uzun vadeli kodlama (SWE-Bench Pro), mekânsal akıl yürütme (görüntü) ve kendi kendini doğrulama (akıl yürütme çabası kadranı). Niteliksel ve niceliksel kazanımlar aynı hikâyeyi anlatıyor.
Fiyatlandırma ve Görev Başı Maliyet Gerçeği
Fable 5, milyon giriş tokeni başına $10 ve milyon çıkış tokeni başına $50 maliyetiyle geliyor. Anthropic bunu "Claude Mythos Preview'ın yarısından az" olarak çerçeveliyor. Aynı zamanda token başına Opus 4.8'in yaklaşık 2 katı. Her ikisi de doğru. Sorun şu ki token fiyatı yanlış birim. Gerçekte ödediğiniz şey tamamlanmış bir görev; ve burada Fable 5'in matematiği ilginçleşiyor.

Akıl yürütme çabası, istek başına ayarladığınız bir kadran. Düşük çaba daha az dahili akıl yürütme tokeni, daha ucuz ve hızlı bir yanıt anlamına gelir; maksimum çaba modelin daha uzun düşünmesi, daha fazla çıkış tokeni harcaması ve daha yüksek skor alması demek. Yukarıdaki grafik, FrontierCode'da Fable 5'in düşük çabadan maksimuma ölçeklenirken ~11%'den ~31%'e yükseldiğini gösteriyor; Opus 4.8 ~13%'te zirve yaparken GPT-5.5 5-6% civarında düz kalıyor. Yani görev başı maliyet tek bir sayı değil, üzerinde bir nokta seçtiğiniz bir eğri.
Yayınlanan $10/$50 fiyatlandırmasından somut bir örnek çalışalım. Bu, Anthropic'in yayınladığı oranlardan yapılan aritmetik, benchmark sonucu değil.
Yüksek çabada 50.000 giriş ve 15.000 çıkış tokenli tek bir ajanlık çağrı alalım:
Giriş: 50.000 / 1.000.000 × $10 = $0,50
Çıkış: 15.000 / 1.000.000 × $50 = $0,75
Çağrı başı: $1,25Gerçek bir ajanlık görev bu şekilde birçok çağrıyı zincirler: repoyu oku, planla, düzenle, testleri çalıştır, düzelt, tekrarla. Döngünün bu yapıda 12 çağrı çalıştırdığını varsayalım: tamamlanan görev için kabaca $15. Daha ağır bağlamla maksimum akıl yürütme çabasında Anthropic'in maliyet eğrisi, zor FrontierCode görevlerini görev başı ~$20 aralığına yerleştiriyor. Aynı görevi GPT-5.5 üzerinde çalıştırırsanız token başına daha az ödersiniz. Ama herhangi bir çaba düzeyinde görevi tamamlayamazsa, tamamlanan görev başı maliyetiniz sonsuzdur. Fable 5, token başına GPT-5.5'ten pahalı; ama GPT-5.5'in tamamlayamadığı işleri tamamladığı için görev başı maliyette kazanıyor.
İşte minimal bir çağrı örneği. Anthropic'in duyurusu model kimliği olarak claude-fable-5 veriyor; tarihli takma adlar zaman zaman farklılık gösterebileceğinden, yayına geçmeden önce tam sürümlü dizeyi Anthropic API belgelerinden doğrulayın:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # verify exact dated id in API docs
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)Ekonomi tezi tek cümlede: token başına GPT-5.5'ten fazla ödersiniz, ama GPT-5.5'in hiçbir fiyata tamamlayamadığı görevleri tamamlarsınız. Düşük riskli, yüksek hacimli işlerde bu matematik daha ucuz bir modeli işaret eder. Zor ajanlık kodlamada ise Fable 5'i.
Güvenlik Koruması Ayrımı: Neden Fable, Opus 4.8'e Geri Düşüyor?
Fable 5, her isteği sınıflandırıcılardan geçiriyor. Yüksek riskli bir sorgu tespit ettiğinde (saldırı amaçlı siber, biyolojik, kimyasal veya model damıtma girişimleri) tam Mythos sınıfı kapasiteyle yanıt vermek yerine Opus 4.8'e geri düşüyor. Anthropic bu geri dönüşün oturumların %5'inden azında tetiklendiğini söylüyor, dolayısıyla çoğu kullanıcı bunu hiç tetiklemiyor. Amaç, tehlikeli kapasiteyi gated tutarken gündelik çalışmayı etkilememek.

Daha sert sayı saldırı başarı oranı: otomatik bir saldırganın modeli yapmaması gereken bir şeyi yaptırabilme sıklığı. Düşük olan daha iyidir. Anthropic'in kırmızı ekip sonuçları, sürümler arasında dik bir düşüş gösteriyor: Opus 4.6'da 83.2%, Opus 4.7'de 72.7%, Opus 4.8'de 56.6%, Fable 5'te ise 5.4%. Otomatik kırmızı ekip testi altında saldırılar Fable 5'e karşı yalnızca %5.4 oranında başarılı oldu — Opus 4.8'deki 56.6%'dan çarpıcı bir düşüş.
Neden önemsemelisiniz? Araç erişimiyle (kabuk, dosya sistemi, ağ) bir ajan dağıtıyorsanız, bir jailbreak kötü bir sohbet yanıtı değil, modelin bir saldırganın yönlendirdiği gerçek komutları çalıştırması anlamına gelir. %5.4 saldırı başarı oranı, Opus 4.8'e kıyasla silah olarak kullanılmasının yaklaşık on kat daha zor olduğu anlamına geliyor. IT Pro'nun haberi tam da bu yüzden geri düşüş mekanizmasıyla açıldı: bu, bir frontier modeli halkın kullanımına güvenle sunan özellik.
Ödünleşim gecikme süresi. İş akışınız meşru olarak güvenlik araçlarına değiyorsa, geri düşüş görev ortasında tetiklenip modeli değiştirebilir — bunu planlamaya değer.
Claude Mythos 5 ve Çift Kullanım Sorusu
Claude Mythos 5, gated kardeş model — aynı model, güvenlik koruması geri dönüşü olmadan. Fable 5'in engellediği saldırı amaçlı siber kapasiteyi koruyor; Anthropic'in onu kamuya açıklamamasının tam nedeni de bu. Erişim, tam kapasiteye ihtiyaç duyan savunmacılar ve araştırmacılar için Project Glasswing adlı denetlenmiş programdan geçiyor. Aynı model, iki yayın tutumu: biri açık, biri gated.

Grafik, ayrımı görünür kılıyor. Saldırı amaçlı siber değerlendirmelerde (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 sırasıyla 88.4, 24.0, 83.8 ve 38.7 skoru alıyor. Fable 5 ise tüm dördünde düz 0.0 döndürüyor. Mythos 5'in 88.4'e kadar çıktığı saldırı amaçlı siber değerlendirmelerde Fable 5'in düz 0.0 döndürmesi: güvenlik koruması ayrımı, görünür hâle getirilmiş.
Bu sıfır bir kapasite eksikliği değil. Her seferinde tetiklenen geri dönüş, Mythos sınıfı modelin yanıt vermesinden önce isteği engelliyor. TechCrunch, zamanlamayı not etti: Anthropic bunu, yapay zekanın açık yayınlamak için çok tehlikeli hâle geldiği uyarısından günler sonra yayınladı. Fable/Mythos ayrımı, bu uyarıya verilen politika yanıtı: kapasiteyi yayınla, tehlikeyi kapat.
Çoğu geliştirici için Mythos 5 konu dışı. Project Glasswing için hiçbir zaman nitelik kazanmayacaksınız ve buna gerek de yok. Önemli olan, çağırdığınız modelin dar bir görev bandında kasıtlı olarak sınırlandırıldığını — tasarım gereği — bilmek.
Ne Anlama Geliyor: Geçiş Yapmalı mısınız?
Zor ajanlık kodlama, uzun vadeli çok adımlı görevler ve görüntü ya da mekânsal akıl yürütme için Fable 5'e geçin — görevi tamamlamanın token başına tasarruf etmekten önemli olduğu her yerde. Maliyet hassasiyeti yüksek, yüksek hacimli işler için ya da zaten geri dönüşü tetikleyecek şeyler için Opus 4.8'de kalın. Çerçevenin tamamı bu. Geri kalanı iş yükünüzü doğru tarafa eşleştirmek.
Fable 5'in kazandığı durumlar:
- Opus 4.8'in durduğu zor ajanlık kodlama; SWE-Bench Pro farkı gerçek
- Uzun vadeli görevler (çok dosyalı yeniden yapılandırmalar, migrasyonlar) — kendi kendini doğrulama burada karşılığını veriyor
- Görüntü ve mekânsal akıl yürütme iş yükleri
- Tamamlanan bir görevin token priminden daha değerli olduğu her iş
Opus 4.8'in hâlâ kazandığı durumlar:
- Token başı fiyatın belirleyici olduğu yüksek hacimli, maliyet hassas işler
- Siber/biyolojik/kimyasal iş yükleri — Fable 5 zaten Opus 4.8'e geri düşeceğinden, doğrudan çağırın
- Görev ortasında model değişimini kaldıramayan gecikme hassas akışlar
| Kullanım senaryosu | Önerilen model |
|---|---|
| Zor ajanlık kodlama / migrasyonlar | Claude Fable 5 |
| Görüntü / mekânsal akıl yürütme | Claude Fable 5 |
| Yüksek hacimli ucuz sınıflandırma | Claude Opus 4.8 |
| Güvenlik / kırmızı ekip araçları | Claude Opus 4.8 (doğrudan) |
Kullanılabilirlik açısından: Fable 5, Pro/Max/Team/Enterprise planlarında 22 Haziran 2026'ya kadar ücretsiz; kullanım kredileri 23 Haziran'dan itibaren geçerli. API, AWS Bedrock, GitHub Copilot üzerinden GitHub changelog aracılığıyla ve Harvey'de genel kullanıma sunuldu. Faturanızı değiştirmeden geçişi bugün editörünüzde test edebilirsiniz.
Yazar Hakkında
Mert Batur Gürbüz, Techsy.io'nun Kurucu Ortağı; ekip B2B müşteriler için yapay zeka ajanları, otomasyon sistemleri ve sesli/SDR pipeline'ları geliştiriyor. Birmingham Üniversitesi'nde öğrenim görüyor ve Techsy ekibinin prodüksiyonda gerçekten kullandığı LLM araç yığınını yazıyor. LinkedIn üzerinden bağlantı kurabilirsiniz.
Kurucu Ortak, Techsy.io · Birmingham Üniversitesi
Sıkça Sorulan Sorular
Claude Fable 5 nedir?
Claude Fable 5, Anthropic'in 9 Haziran 2026'da piyasaya sürdüğü, kamuya açık ilk Mythos sınıfı modeldir. SWE-Bench Pro'da 80.3% skor alıyor ve yüksek riskli sorgularda Opus 4.8'e geri düşen güvenlik koruması sınıflandırıcıları çalıştırıyor. Milyon token başına $10 giriş / $50 çıkış maliyetiyle geliyor.
Fable 5 ile Mythos 5 arasındaki fark nedir?
İkisi de farklı yayın tutumlarına sahip aynı frontier model. Fable 5 kamuya açık ve güvenlik korumalı; tehlikeli sorgularda Opus 4.8'e geri düşüyor. Mythos 5, yalnızca Fable 5'in engellediği tam saldırı amaçlı siber kapasiteye ihtiyaç duyan denetlenmiş savunmacılar ve araştırmacılar için Anthropic'in Project Glasswing programı aracılığıyla erişilebilen gated, tam kapasiteli sürüm.
Claude Fable 5 gerçekten Opus 4.8'den daha iyi mi?
Zor ajanlık kodlama, görüntü ve mekânsal akıl yürütmede evet: Fable 5, SWE-Bench Pro'da Opus 4.8'in 69.2%'sine karşı 80.3% alıyor. Ancak maliyet hassas, yüksek hacimli işlerde Opus 4.8 hâlâ kazanıyor; üstelik Fable 5 yüksek riskli siber/biyolojik/kimyasal konularda zaten Opus 4.8'e geri düşüyor. "Daha iyi" iş yükünüze bağlı.
Claude Fable 5'in maliyeti ne kadar?
Claude Fable 5, milyon giriş tokeni başına $10 ve milyon çıkış tokeni başına $50 maliyetiyle geliyor. Anthropic'in çerçevelemesi "Mythos Preview'ın yarısından az". Token başına Opus 4.8'in yaklaşık 2 katı; ama değer argümanı tamamlanan görev başına, çünkü Fable 5 daha ucuz modellerin yapamadığı işleri tamamlıyor.
"Mythos sınıfı" model nedir?
Mythos sınıfı, Anthropic'in Fable 5 ve Mythos 5 ile başlattığı yeni en üst yetenek kademesi. Kodlama ve akıl yürütme benchmark'larında Opus 4.x hattının ötesinde bir frontier sıçramasını temsil ediyor. Fable 5 ve Mythos 5, aynı Mythos sınıfı modelin iki yayın sürümü: biri kamuya açık ve güvenlik korumalı, biri gated.
Fable 5 neden Opus 4.8'e geri düşüyor?
Fable 5, yüksek riskli istekleri (saldırı amaçlı siber, biyolojik, kimyasal veya model damıtma) tespit eden ve tam Mythos sınıfı kapasiteyle yanıt vermek yerine bunları Opus 4.8'e yönlendiren sınıflandırıcılar çalıştırıyor. Bu, oturumların %5'inden azında tetikleniyor. Saldırı başarı oranını Opus 4.8'deki %56.6'dan %5.4'e indirdi.
Claude Mythos 5'e erişebilir miyim?
Büyük olasılıkla hayır. Mythos 5, Fable 5'in engellediği tam saldırı amaçlı siber kapasiteye ihtiyaç duyan savunmacılar ve güvenlik araştırmacıları için Anthropic'in Project Glasswing adlı denetlenmiş erişim programının arkasında. Çoğu geliştirici nitelik kazanmayacak ve buna gerek de yok; Fable 5 gündelik ajanlık ve kodlama işlerini karşılıyor.
Claude Fable 5'i nerede kullanabilirim?
Claude Fable 5, Anthropic API, AWS Bedrock, GitHub Copilot ve Harvey'de genel kullanıma sunuldu. Pro, Max, Team ve koltuk tabanlı Enterprise planlarında 22 Haziran 2026'ya kadar ücretsiz; kullanım kredileri 23 Haziran'dan itibaren geçerli. Bugün editörünüzde ya da API aracılığıyla test edebilirsiniz.
Sonuç
Claude Fable 5, Opus 4.8'in gerçek bir frontier adım ötesi: SWE-Bench Pro'da 80.3%'e karşı 69.2%, iki kat FrontierCode skoru ve araçlarla dağıtımı çok daha güvenli kılan %5.4 saldırı başarı oranı. Zor ajanlık kodlama, uzun vadeli görevler ve görüntü işleri için geçin. Maliyet hassas hacim ya da zaten geri dönüşü tetikleyecek her şey için Opus 4.8'de kalın. 22 Haziran'a kadar ücretsiz, bu yüzden size bir maliyeti olmadan geçişi test edebilirsiniz. Techsy ekibi prodüksiyonda tam olarak bu yığın üzerine ajanlar geliştiriyor; yardım istiyorsanız bize ulaşın.