Techsy
Bize Ulaşın
Başla
Bloga Dön
ai-machine-learning

Claude Fable 5 vs Opus 4.8: Gerçekten Geçiş Yapmalı mısınız? (Mythos Sınıfı, Benchmark Sonuçlarıyla)

Yazan Mert Batur Gürbüz
Jun 9, 2026
13 okuma
İçindekiler
Claude Fable 5 vs Opus 4.8: Gerçekten Geçiş Yapmalı mısınız? (Mythos Sınıfı, Benchmark Sonuçlarıyla)

Claude Fable 5 vs Opus 4.8: Gerçekten Geçiş Yapmalı mısınız? (Mythos Sınıfı, Benchmark Sonuçlarıyla)

Anthropic, Claude Fable 5'i bugün, 9 Haziran 2026'da yayınladı. Model, ajanlık kodlama benchmark'ı SWE-Bench Pro'da 80.3% skoru alırken Opus 4.8 69.2%'de kalıyor ve GPT-5.5 58.6% ile geride. Bu, yuvarlama hatasıyla açıklanabilecek küçük bir fark değil. Ayrıca ilginç bir detay var: Fable 5, yeni "Mythos sınıfı" modelin herkese açık, güvenlik korumalı yarısı; Claude Mythos 5 adlı kardeş model ise kısıtlı erişim programının arkasında tutuluyor. İşte neyin değiştiği, milyon token başına $10/$50 fiyatlamasıyla gerçek bir görevin maliyeti ve Opus 4.8'den geçiş yapıp yapmamanız gerektiği.

Kısa Yanıt

  • Fable 5, SWE-Bench Pro'da 80.3% alıyor; Opus 4.8 69.2%, GPT-5.5 ise 58.6%.
  • Fiyatlandırma: milyon token başına $10 giriş / $50 çıkış — Mythos Preview'ın yarısından az.
  • Fable 5, yüksek riskli siber/biyolojik/kimyasal sorgularda otomatik olarak Opus 4.8'e geri düşüyor (oturumların %5'inden azında).
  • Pro/Max/Team/Enterprise planlarında 22 Haziran 2026'ya kadar ücretsiz; kullanım kredileri 23 Haziran'dan itibaren geçerli.

Gerçekte Ne Yayınlandı: Fable 5, Mythos 5 ve "Mythos Sınıfı" Hat

Mythos sınıfı, Anthropic'in yeni en üst yetenek kademesi ve iki model olarak geliyor. Claude Fable 5, bugün kullanabileceğiniz herkese açık, güvenlik korumalı sürüm. Claude Mythos 5 ise aynı frontier modelin güvenlik korumaları kaldırılmış hali; gated erişimin arkasında tutuluyor. Aynı zeka, iki farklı yayın tutumu.

Bu ayrım, asıl hikâyenin kendisi. Anthropic'in haber duyurusuna göre Mythos 5, gerçek zarar verebilecek saldırı amaçlı siber beceriler dahil tam frontier kapasitesini koruduğundan Anthropic onu herkese açmıyor. Fable 5 ise aynı modeli alıp üzerine yüksek riskli istekleri tespit eden ve bunları sessizce Opus 4.8'e yönlendiren sınıflandırıcılar sarıyor.

Yani Fable 5'i çağırdığınızda, tehlikeli olmayan her şeyde Mythos sınıfı akıl yürütmesi alıyorsunuz; tehlikeli olan küçük dilimde ise daha güvenli bir yedek modele geçiliyor. CNBC, bunu Anthropic'in halka "Mythos benzeri bir yapay zeka" sunması olarak tanımladı — doğru, ama tam mekanizma başlıktan daha önemli.

Fable 5 ve Mythos 5, ikiye bölünmüş aynı frontier model: biri bugün kullanabileceğiniz, biri Anthropic'in gated tuttuğu. İsimlendirme hakkında tek bir şey hatırlayacaksanız bu olsun. Mythos sınıfı, kademenin adı; Fable ve Mythos ise o kademeye iki farklı kapı.

Opus 4.x Hattına Kıyasla Ne Değişti

Anthropic'in yayınladığı her kodlama ve akıl yürütme değerlendirmesinde Fable 5, Opus 4.8'i geçiyor — ufak farkla değil, çift haneli farkla. SWE-Bench Pro 69.2%'den 80.3%'e yükseliyor. FrontierCode Diamond 13.4'ten 29.3'e çıkıyor. Fiyatlandırma da düştü; model ayrıca yeni bir akıl yürütme çabası kadranıyla geliyor. Bu, Opus 4.x hattının yalnızca bir nokta sürümü değil, gerçek bir frontier adımı.

Claude Mythos 5 / Fable 5 benchmark tablosu — Mythos Preview, Opus 4.8, GPT-5.5 ve Gemini 3.1 Pro'ya karşı 13 değerlendirme
Claude Mythos 5 / Fable 5'in 13 benchmark'ta Opus 4.8, GPT-5.5 ve Gemini 3.1 Pro karşısındaki sonuçları. Kaynak: Anthropic.

Yukarıdaki 13 benchmark özeti genel tabloya bakış sağlıyor. İşte ekiplerin gerçekten karşılaştırdığı üç modele karşı öne çıkan sonuçlar:

BenchmarkClaude Fable 5Claude Opus 4.8GPT-5.5
SWE-Bench Pro (ajanlık kodlama)80.3%69.2%58.6%
FrontierCode Diamond (en zor kodlama)29.313.45.7
Terminal-Bench 2.1 (ajanlık kabuk)88.0%n/an/a
GPQA-AA (lisansüstü akıl yürütme, Elo)1932n/an/a
ExploitBench78.0%n/an/a

Karşılaştırma referansı burada Claude Opus 4.8 — Fable 5'in frontier'da yerini aldığı model ve aynı zamanda Fable 5'in yüksek riskli sorgularda geri düştüğü model. Opus 4.x hattını son iki sürümde takip ettiyseniz, artımlı kazanımlar görüyordunuz. Fable 5 bu örüntüyü kırıyor.

Tabloyu kesin gerçek gibi okumadan önce iki şeye dikkat edin. Birincisi, bunlar bağımsız bir testin değil Anthropic'in kendi yayınladığı değerlendirmelerin sonuçları. İkincisi, akıl yürütme çabası kadranı, tek bir benchmark sayısının bir maliyet eğrisini gizlediği anlamına geliyor. Bunu fiyatlandırma bölümünde ele alacağız çünkü hesabı değiştiriyor.

Geliştiriciler İçin Önemli Benchmark'lar

Pratik ağırlığı olan dört sayı var: SWE-Bench Pro 80.3%, FrontierCode Diamond 29.3, Terminal-Bench 2.1 88.0% ve GPQA-AA 1932 Elo. Bunlar birlikte gerçek repo çalışmasını, en zor sentetik kodlama problemlerini, ajanlık kabuk görevlerini ve lisansüstü düzey akıl yürütmeyi kapsıyor. İş yükünüz bunlardan herhangi birine değiyorsa, bu bölüm o sayının sizin işinize gerçekten karşılık gelip gelmediğini söylüyor.

Bu yazının başındaki ana grafik kanıtı sunuyor: SWE-Bench Pro 80.3 - 69.2 - 58.6 ve FrontierCode 29.3 - 13.4 - 5.7. Peki bunlar gerçekte neyi ölçüyor?

  • SWE-Bench Pro, bir modelin gerçek bir repoya gerçek bir pull request gönderip gönderemeyeceğini test ediyor: klonla, anla, yamala, testleri geçir. Fable 5 bu testlerin 10'da 8'ini tamamlıyor. "Gerçek işimi yapabilir mi?" sorusunun en yakın göstergesi bu.
  • Terminal-Bench 2.1, ajanlık kabuk görevlerini puanlıyor: komut çalıştırma, çıktı okuma, hatalardan kurtulma. 88.0%, terminalde yaşayan yapay zeka kodlama ajanları geliştiriyorsanız önem taşıyor.
  • FrontierCode Diamond, kodlama problemlerinin en zor kademesi — çoğu modelin tek haneli skor aldığı seviye. 29.3 mutlak değer olarak düşük, ama Opus 4.8'in 13.4'ünün iki katından fazla.
  • GPQA-AA, Elo puanıyla değerlendirilen lisansüstü düzey bilimsel akıl yürütme. 1932, kodun ötesinde güçlü çok adımlı akıl yürütmeye işaret ediyor.

Opus 4.x hattında Claude Code iş akışlarımızdaki tekrarlayan tavan, uzun vadeli ajanlık görevleriydi: model, çok dosyalı bir değişikliğin ortasında konuyu kaybediyordu. Fable 5'in Terminal-Bench ve SWE-Bench Pro sayıları bu tavanın yükseldiğini düşündürüyor. Sizin reponuz için yükselip yükselmediğinin tek testi kendi denemeleriniz, ama yayınlanan sayılar önemsenmesi gereken türden sayılar.

Gerçek Test Senaryoları: Fable 5'in Önceki Modellerin Yapamadıklarını Yapması

Anthropic, Fable 5'in artık üstesinden gelebildiği problem sınıfını gösteren üç somut örnek yayınladı: aylarca süren bir Stripe kod tabanı migrasyonunu tek güne sıkıştırma, yalnızca görüntü tabanlı tamamlanan bir video oyunu ve kendi kendini doğrulamadan gelen 3× performans artışı. Her biri önceki modellerin ulaşamadığı bir kapasiteye işaret ediyor. Üçü de Anthropic kaynaklı; kendi testlerimizi değil, duyurularını aktarıyoruz.

Her birinin kanıtladığı şey:

  1. Stripe Ruby migrasyonu. Anthropic, Fable 5'in yaklaşık iki aylık bir Ruby kod tabanı migrasyonunu yaklaşık bir güne sıkıştırdığını bildiriyor. Stripe, iki aylık bir migrasyonu tek güne indirdi — bu modelin değiştirdiği problem büyüklüğü bu. Eskiden tüm kod tabanını kafasında tutan bir insan ekibine ihtiyaç duyan uzun vadeli yeniden yapılandırma sınıfı.

  2. Yalnızca görüntüyle Pokémon FireRed. Anthropic'e göre Fable 5, önceki modellerin oyun durumunu metin olarak beslemek için karmaşık özel iskeletlere ihtiyaç duyduğu yerde Pokémon FireRed'i yalnızca görüntüyü kullanarak tamamladı. Bu, mekânsal ve görsel akıl yürütmede önemli bir sıçrama: model ekranı okuyor ve hareket ediyor, iskelet yok.

  3. Slay the Spire, 3×. Maksimum akıl yürütme çabasında Anthropic, Fable 5'in kendi hamlelerini doğruladığını ve kalıcı bellek sayesinde 3× daha iyi performansa ulaştığını söylüyor. Önemli olan oyun değil; modelin uzun bir planlama sürecinde kendi çalışmasını kontrol edip bundan gelişme sağlayabilmesi.

Bunların hiçbirini kendi iş yükünüz için doğrudan kabul etmeniz gerekmiyor. Ama yukarıdaki tablodaki benchmark sıçramalarıyla temiz bir şekilde örtüşüyorlar: uzun vadeli kodlama (SWE-Bench Pro), mekânsal akıl yürütme (görüntü) ve kendi kendini doğrulama (akıl yürütme çabası kadranı). Niteliksel ve niceliksel kazanımlar aynı hikâyeyi anlatıyor.

Fiyatlandırma ve Görev Başı Maliyet Gerçeği

Fable 5, milyon giriş tokeni başına $10 ve milyon çıkış tokeni başına $50 maliyetiyle geliyor. Anthropic bunu "Claude Mythos Preview'ın yarısından az" olarak çerçeveliyor. Aynı zamanda token başına Opus 4.8'in yaklaşık 2 katı. Her ikisi de doğru. Sorun şu ki token fiyatı yanlış birim. Gerçekte ödediğiniz şey tamamlanmış bir görev; ve burada Fable 5'in matematiği ilginçleşiyor.

FrontierCode doğruluk - görev başı maliyet — Claude Fable 5, düşük ile maksimum akıl yürütme çabası arasında ölçeklenerek Opus 4.8 ve GPT-5.5'i geçiyor
Akıl yürütme çabası düşük→maksimum ölçeklenirken FrontierCode skoru ile görev başı ortalama maliyet. Kaynak: Anthropic.

Akıl yürütme çabası, istek başına ayarladığınız bir kadran. Düşük çaba daha az dahili akıl yürütme tokeni, daha ucuz ve hızlı bir yanıt anlamına gelir; maksimum çaba modelin daha uzun düşünmesi, daha fazla çıkış tokeni harcaması ve daha yüksek skor alması demek. Yukarıdaki grafik, FrontierCode'da Fable 5'in düşük çabadan maksimuma ölçeklenirken ~11%'den ~31%'e yükseldiğini gösteriyor; Opus 4.8 ~13%'te zirve yaparken GPT-5.5 5-6% civarında düz kalıyor. Yani görev başı maliyet tek bir sayı değil, üzerinde bir nokta seçtiğiniz bir eğri.

Yayınlanan $10/$50 fiyatlandırmasından somut bir örnek çalışalım. Bu, Anthropic'in yayınladığı oranlardan yapılan aritmetik, benchmark sonucu değil.

Yüksek çabada 50.000 giriş ve 15.000 çıkış tokenli tek bir ajanlık çağrı alalım:

text
Giriş:  50.000 / 1.000.000 × $10 = $0,50
Çıkış:  15.000 / 1.000.000 × $50 = $0,75
Çağrı başı:                         $1,25

Gerçek bir ajanlık görev bu şekilde birçok çağrıyı zincirler: repoyu oku, planla, düzenle, testleri çalıştır, düzelt, tekrarla. Döngünün bu yapıda 12 çağrı çalıştırdığını varsayalım: tamamlanan görev için kabaca $15. Daha ağır bağlamla maksimum akıl yürütme çabasında Anthropic'in maliyet eğrisi, zor FrontierCode görevlerini görev başı ~$20 aralığına yerleştiriyor. Aynı görevi GPT-5.5 üzerinde çalıştırırsanız token başına daha az ödersiniz. Ama herhangi bir çaba düzeyinde görevi tamamlayamazsa, tamamlanan görev başı maliyetiniz sonsuzdur. Fable 5, token başına GPT-5.5'ten pahalı; ama GPT-5.5'in tamamlayamadığı işleri tamamladığı için görev başı maliyette kazanıyor.

İşte minimal bir çağrı örneği. Anthropic'in duyurusu model kimliği olarak claude-fable-5 veriyor; tarihli takma adlar zaman zaman farklılık gösterebileceğinden, yayına geçmeden önce tam sürümlü dizeyi Anthropic API belgelerinden doğrulayın:

python
import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
    model="claude-fable-5",          # verify exact dated id in API docs
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 8000},  # reasoning effort
    messages=[
        {"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
    ],
)

print(message.content)

Ekonomi tezi tek cümlede: token başına GPT-5.5'ten fazla ödersiniz, ama GPT-5.5'in hiçbir fiyata tamamlayamadığı görevleri tamamlarsınız. Düşük riskli, yüksek hacimli işlerde bu matematik daha ucuz bir modeli işaret eder. Zor ajanlık kodlamada ise Fable 5'i.

Güvenlik Koruması Ayrımı: Neden Fable, Opus 4.8'e Geri Düşüyor?

Fable 5, her isteği sınıflandırıcılardan geçiriyor. Yüksek riskli bir sorgu tespit ettiğinde (saldırı amaçlı siber, biyolojik, kimyasal veya model damıtma girişimleri) tam Mythos sınıfı kapasiteyle yanıt vermek yerine Opus 4.8'e geri düşüyor. Anthropic bu geri dönüşün oturumların %5'inden azında tetiklendiğini söylüyor, dolayısıyla çoğu kullanıcı bunu hiç tetiklemiyor. Amaç, tehlikeli kapasiteyi gated tutarken gündelik çalışmayı etkilememek.

Siber saldırı dayanıklılığı — Claude Fable 5 saldırı başarı oranı otomatik kırmızı ekip testinde Opus 4.8'in 56.6%'sına karşı 5.4%
Otomatik kırmızı ekip testi altında saldırı başarısı (düşük olan daha iyi): Fable 5 %5,4 - Opus 4.8 %56,6. Kaynak: Anthropic.

Daha sert sayı saldırı başarı oranı: otomatik bir saldırganın modeli yapmaması gereken bir şeyi yaptırabilme sıklığı. Düşük olan daha iyidir. Anthropic'in kırmızı ekip sonuçları, sürümler arasında dik bir düşüş gösteriyor: Opus 4.6'da 83.2%, Opus 4.7'de 72.7%, Opus 4.8'de 56.6%, Fable 5'te ise 5.4%. Otomatik kırmızı ekip testi altında saldırılar Fable 5'e karşı yalnızca %5.4 oranında başarılı oldu — Opus 4.8'deki 56.6%'dan çarpıcı bir düşüş.

Neden önemsemelisiniz? Araç erişimiyle (kabuk, dosya sistemi, ağ) bir ajan dağıtıyorsanız, bir jailbreak kötü bir sohbet yanıtı değil, modelin bir saldırganın yönlendirdiği gerçek komutları çalıştırması anlamına gelir. %5.4 saldırı başarı oranı, Opus 4.8'e kıyasla silah olarak kullanılmasının yaklaşık on kat daha zor olduğu anlamına geliyor. IT Pro'nun haberi tam da bu yüzden geri düşüş mekanizmasıyla açıldı: bu, bir frontier modeli halkın kullanımına güvenle sunan özellik.

Ödünleşim gecikme süresi. İş akışınız meşru olarak güvenlik araçlarına değiyorsa, geri düşüş görev ortasında tetiklenip modeli değiştirebilir — bunu planlamaya değer.

Claude Mythos 5 ve Çift Kullanım Sorusu

Claude Mythos 5, gated kardeş model — aynı model, güvenlik koruması geri dönüşü olmadan. Fable 5'in engellediği saldırı amaçlı siber kapasiteyi koruyor; Anthropic'in onu kamuya açıklamamasının tam nedeni de bu. Erişim, tam kapasiteye ihtiyaç duyan savunmacılar ve araştırmacılar için Project Glasswing adlı denetlenmiş programdan geçiyor. Aynı model, iki yayın tutumu: biri açık, biri gated.

Saldırı amaçlı siber değerlendirme sonuçları — Claude Mythos 5 yüksek kapasite, Claude Fable güvenlik korumaları tetiklendiğinde 0.0 döndürüyor
Saldırı amaçlı siber değerlendirmeler: Mythos 5 kapasitesini koruyor; Fable, engelleme korumaları devreye girdiğinde 0.0 döndürüyor. Kaynak: Anthropic.

Grafik, ayrımı görünür kılıyor. Saldırı amaçlı siber değerlendirmelerde (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 sırasıyla 88.4, 24.0, 83.8 ve 38.7 skoru alıyor. Fable 5 ise tüm dördünde düz 0.0 döndürüyor. Mythos 5'in 88.4'e kadar çıktığı saldırı amaçlı siber değerlendirmelerde Fable 5'in düz 0.0 döndürmesi: güvenlik koruması ayrımı, görünür hâle getirilmiş.

Bu sıfır bir kapasite eksikliği değil. Her seferinde tetiklenen geri dönüş, Mythos sınıfı modelin yanıt vermesinden önce isteği engelliyor. TechCrunch, zamanlamayı not etti: Anthropic bunu, yapay zekanın açık yayınlamak için çok tehlikeli hâle geldiği uyarısından günler sonra yayınladı. Fable/Mythos ayrımı, bu uyarıya verilen politika yanıtı: kapasiteyi yayınla, tehlikeyi kapat.

Çoğu geliştirici için Mythos 5 konu dışı. Project Glasswing için hiçbir zaman nitelik kazanmayacaksınız ve buna gerek de yok. Önemli olan, çağırdığınız modelin dar bir görev bandında kasıtlı olarak sınırlandırıldığını — tasarım gereği — bilmek.

Ne Anlama Geliyor: Geçiş Yapmalı mısınız?

Zor ajanlık kodlama, uzun vadeli çok adımlı görevler ve görüntü ya da mekânsal akıl yürütme için Fable 5'e geçin — görevi tamamlamanın token başına tasarruf etmekten önemli olduğu her yerde. Maliyet hassasiyeti yüksek, yüksek hacimli işler için ya da zaten geri dönüşü tetikleyecek şeyler için Opus 4.8'de kalın. Çerçevenin tamamı bu. Geri kalanı iş yükünüzü doğru tarafa eşleştirmek.

Fable 5'in kazandığı durumlar:

  • Opus 4.8'in durduğu zor ajanlık kodlama; SWE-Bench Pro farkı gerçek
  • Uzun vadeli görevler (çok dosyalı yeniden yapılandırmalar, migrasyonlar) — kendi kendini doğrulama burada karşılığını veriyor
  • Görüntü ve mekânsal akıl yürütme iş yükleri
  • Tamamlanan bir görevin token priminden daha değerli olduğu her iş

Opus 4.8'in hâlâ kazandığı durumlar:

  • Token başı fiyatın belirleyici olduğu yüksek hacimli, maliyet hassas işler
  • Siber/biyolojik/kimyasal iş yükleri — Fable 5 zaten Opus 4.8'e geri düşeceğinden, doğrudan çağırın
  • Görev ortasında model değişimini kaldıramayan gecikme hassas akışlar
Kullanım senaryosuÖnerilen model
Zor ajanlık kodlama / migrasyonlarClaude Fable 5
Görüntü / mekânsal akıl yürütmeClaude Fable 5
Yüksek hacimli ucuz sınıflandırmaClaude Opus 4.8
Güvenlik / kırmızı ekip araçlarıClaude Opus 4.8 (doğrudan)

Kullanılabilirlik açısından: Fable 5, Pro/Max/Team/Enterprise planlarında 22 Haziran 2026'ya kadar ücretsiz; kullanım kredileri 23 Haziran'dan itibaren geçerli. API, AWS Bedrock, GitHub Copilot üzerinden GitHub changelog aracılığıyla ve Harvey'de genel kullanıma sunuldu. Faturanızı değiştirmeden geçişi bugün editörünüzde test edebilirsiniz.

Yazar Hakkında

Mert Batur Gürbüz, Techsy.io'nun Kurucu Ortağı; ekip B2B müşteriler için yapay zeka ajanları, otomasyon sistemleri ve sesli/SDR pipeline'ları geliştiriyor. Birmingham Üniversitesi'nde öğrenim görüyor ve Techsy ekibinin prodüksiyonda gerçekten kullandığı LLM araç yığınını yazıyor. LinkedIn üzerinden bağlantı kurabilirsiniz.

Kurucu Ortak, Techsy.io · Birmingham Üniversitesi

Sıkça Sorulan Sorular

Claude Fable 5 nedir?

Claude Fable 5, Anthropic'in 9 Haziran 2026'da piyasaya sürdüğü, kamuya açık ilk Mythos sınıfı modeldir. SWE-Bench Pro'da 80.3% skor alıyor ve yüksek riskli sorgularda Opus 4.8'e geri düşen güvenlik koruması sınıflandırıcıları çalıştırıyor. Milyon token başına $10 giriş / $50 çıkış maliyetiyle geliyor.

Fable 5 ile Mythos 5 arasındaki fark nedir?

İkisi de farklı yayın tutumlarına sahip aynı frontier model. Fable 5 kamuya açık ve güvenlik korumalı; tehlikeli sorgularda Opus 4.8'e geri düşüyor. Mythos 5, yalnızca Fable 5'in engellediği tam saldırı amaçlı siber kapasiteye ihtiyaç duyan denetlenmiş savunmacılar ve araştırmacılar için Anthropic'in Project Glasswing programı aracılığıyla erişilebilen gated, tam kapasiteli sürüm.

Claude Fable 5 gerçekten Opus 4.8'den daha iyi mi?

Zor ajanlık kodlama, görüntü ve mekânsal akıl yürütmede evet: Fable 5, SWE-Bench Pro'da Opus 4.8'in 69.2%'sine karşı 80.3% alıyor. Ancak maliyet hassas, yüksek hacimli işlerde Opus 4.8 hâlâ kazanıyor; üstelik Fable 5 yüksek riskli siber/biyolojik/kimyasal konularda zaten Opus 4.8'e geri düşüyor. "Daha iyi" iş yükünüze bağlı.

Claude Fable 5'in maliyeti ne kadar?

Claude Fable 5, milyon giriş tokeni başına $10 ve milyon çıkış tokeni başına $50 maliyetiyle geliyor. Anthropic'in çerçevelemesi "Mythos Preview'ın yarısından az". Token başına Opus 4.8'in yaklaşık 2 katı; ama değer argümanı tamamlanan görev başına, çünkü Fable 5 daha ucuz modellerin yapamadığı işleri tamamlıyor.

"Mythos sınıfı" model nedir?

Mythos sınıfı, Anthropic'in Fable 5 ve Mythos 5 ile başlattığı yeni en üst yetenek kademesi. Kodlama ve akıl yürütme benchmark'larında Opus 4.x hattının ötesinde bir frontier sıçramasını temsil ediyor. Fable 5 ve Mythos 5, aynı Mythos sınıfı modelin iki yayın sürümü: biri kamuya açık ve güvenlik korumalı, biri gated.

Fable 5 neden Opus 4.8'e geri düşüyor?

Fable 5, yüksek riskli istekleri (saldırı amaçlı siber, biyolojik, kimyasal veya model damıtma) tespit eden ve tam Mythos sınıfı kapasiteyle yanıt vermek yerine bunları Opus 4.8'e yönlendiren sınıflandırıcılar çalıştırıyor. Bu, oturumların %5'inden azında tetikleniyor. Saldırı başarı oranını Opus 4.8'deki %56.6'dan %5.4'e indirdi.

Claude Mythos 5'e erişebilir miyim?

Büyük olasılıkla hayır. Mythos 5, Fable 5'in engellediği tam saldırı amaçlı siber kapasiteye ihtiyaç duyan savunmacılar ve güvenlik araştırmacıları için Anthropic'in Project Glasswing adlı denetlenmiş erişim programının arkasında. Çoğu geliştirici nitelik kazanmayacak ve buna gerek de yok; Fable 5 gündelik ajanlık ve kodlama işlerini karşılıyor.

Claude Fable 5'i nerede kullanabilirim?

Claude Fable 5, Anthropic API, AWS Bedrock, GitHub Copilot ve Harvey'de genel kullanıma sunuldu. Pro, Max, Team ve koltuk tabanlı Enterprise planlarında 22 Haziran 2026'ya kadar ücretsiz; kullanım kredileri 23 Haziran'dan itibaren geçerli. Bugün editörünüzde ya da API aracılığıyla test edebilirsiniz.

Sonuç

Claude Fable 5, Opus 4.8'in gerçek bir frontier adım ötesi: SWE-Bench Pro'da 80.3%'e karşı 69.2%, iki kat FrontierCode skoru ve araçlarla dağıtımı çok daha güvenli kılan %5.4 saldırı başarı oranı. Zor ajanlık kodlama, uzun vadeli görevler ve görüntü işleri için geçin. Maliyet hassas hacim ya da zaten geri dönüşü tetikleyecek her şey için Opus 4.8'de kalın. 22 Haziran'a kadar ücretsiz, bu yüzden size bir maliyeti olmadan geçişi test edebilirsiniz. Techsy ekibi prodüksiyonda tam olarak bu yığın üzerine ajanlar geliştiriyor; yardım istiyorsanız bize ulaşın.

Etiketler

Claude Fable 5 ve Claude Mythos 5Claude Opus 4.8SWE-Bench ProMythos sınıfıajanlık kodlama

Bu makaleyi paylaş

İlgili Makaleler

Daha fazla ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 Geldi: Fable 5'e Yakın Zeka, Yarı Fiyata

Anthropic, 24 Temmuz 2026'da Claude Opus 5'i yayınladı. Frontier-Bench'te Opus 4.8'i ikiye katlıyor, Opus fiyatını koruyor ama birkaç testte Fable 5 ve Mythos 5'e geçiliyor. İşte benchmark tablosu, fiyatlandırma ve geç/geçme/kal değerlendirmesi.

10 min read okuma
Oku
ai-machine-learning
Jul 20, 2026

2026'nın En İyi 8 Yapay Zeka Web Scraping API'si (Kendi Agent Stack'imizde Test Edildi)

8 yapay zeka web scraping API'sini kendi agent stack'imiz üzerinden çektiğimiz gerçek 2026 fiyatlarıyla test ettik. Firecrawl, Bright Data, ScrapingBee ve 5 tane daha; LLM'e hazır çıktı, anti-bot başarısı ve MCP desteğine göre sıraladık.

9 dk okuma okuma
Oku
ai-machine-learning
Jul 20, 2026

Kodlama İçin Prompt Mühendisliği: Claude Code ve Cursor'da Her Gün Kullandığımız 7 Kalıp (2026)

Çoğu 'yapay zeka kodlama promptları' yazısı size kopyalayıp yapıştırmanız için 50 şablon verir. Bu yazı ise 16 ajanlı bir Claude Code pipeline'ını her gün çalıştırmak için kullandığımız 7 kalıbı, her biri için gerçek bir öncesi-sonrası örneğiyle ve 2026'da Claude Code, Cursor ve Copilot'ta her kalıbın nerede karşılığını bulduğuyla birlikte anlatıyor.

11 dakikalık okuma okuma
Oku
Tüm Yazıları Görüntüle
Projenize Başlayın

Harika bir şey inşa etmeye hazır mısınız?

Vizyonunuzu hayata geçirelim. Fark yaratan yazılımlar için ekibimiz hazır.

30 dakikalık keşif görüşmesi ayarlayınProjelerimiz

Kütüphaneden öne çıkanlar

Claude Skills

Tümünü gör
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI Otomasyonları

Tümünü gör
  • Güvenlik Denetçisi

    Önceliklendirilmiş düzeltme PR'larıyla haftalık SCA + IaC taraması.

  • Soğuk E-posta Yazarı

    Tek bir somut kamuya açık detaya dayalı ilk temas e-postaları üretir.

  • Lead Araştırma Agent'ı

    Bir e-postayı profile zenginleştirir, uygunluğu puanlar, Slack'te uyarır.

Kütüphaneden öne çıkanlar

Claude Skills

Tümünü gör
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI Otomasyonları

Tümünü gör
  • Güvenlik Denetçisi

    Önceliklendirilmiş düzeltme PR'larıyla haftalık SCA + IaC taraması.

  • Soğuk E-posta Yazarı

    Tek bir somut kamuya açık detaya dayalı ilk temas e-postaları üretir.

  • Lead Araştırma Agent'ı

    Bir e-postayı profile zenginleştirir, uygunluğu puanlar, Slack'te uyarır.

Hizmetler

  • Kurumsal Çözümler
  • Mobil Uygulamalar
  • Web Uygulamaları

Çözümler

  • CRM Sistemleri
  • Yapay Zeka Entegrasyonu
  • ERP Çözümleri
  • Sesli Asistanlar
  • Süreç Otomasyonu
  • Siber ve Veri Güvenliği

Kütüphane

  • Blog
  • Portfolyo

Topluluk

  • AI Otomasyonları
  • Claude Skills

Araçlar

  • Mobil Uygulama Maliyet Hesaplayıcı
  • OpenAI / LLM API Maliyet Hesaplayıcı
  • MVP Maliyet Hesaplayıcı
  • Sesli AI Ajan Maliyet Hesaplayıcı

Şirket

  • Hakkımızda
  • Partnerler
  • İletişim

Yasal

  • Gizlilik Politikası
  • Kullanım Şartları
  • Çerez Politikası

Hizmetler

  • Kurumsal Çözümler
  • Mobil Uygulamalar
  • Web Uygulamaları

Çözümler

  • CRM Sistemleri
  • Yapay Zeka Entegrasyonu
  • ERP Çözümleri
  • Sesli Asistanlar
  • Süreç Otomasyonu
  • Siber ve Veri Güvenliği

Kütüphane

  • Blog
  • Portfolyo

Topluluk

  • AI Otomasyonları
  • Claude Skills

Araçlar

  • Mobil Uygulama Maliyet Hesaplayıcı
  • OpenAI / LLM API Maliyet Hesaplayıcı
  • MVP Maliyet Hesaplayıcı
  • Sesli AI Ajan Maliyet Hesaplayıcı

Şirket

  • Hakkımızda
  • Partnerler
  • İletişim
YasalGizlilik PolitikasıKullanım ŞartlarıÇerez Politikası
TECHSY
© 2026 Techsy. Tüm hakları saklıdır.