ai-machine-learning

Claude Fable 5.1 İnceleme: Fable 5 ve Opus 5 ile Ölçtük

Yazan Mert Batur
Sep 2, 2026
8 okuma
Claude Fable 5.1 İnceleme: Fable 5 ve Opus 5 ile Ölçtük

Claude Fable 5.1 İnceleme: Fable 5 ve Opus 5 ile Ölçtük

Claude Fable 5.1, 2026-09-01'de Fable 5 ile aynı $10/$50'da çıktı; cache okumaları $0.25'e indi. Ertesi sabah 08:55 UTC'de 14 eşleşmiş OpenRouter görevi çalıştırdık. Duyurulan %45 ajanlık tasarrufu o faturada yoktu: üç model de 14/14 geçti ve 5.1, Opus 5'in $0.080725'ine karşı $0.14693 yazdı.

Anthropic'in herkese açık frontier kimliği claude-fable-5-1, GA 2026-09-01, milyon token başına $10/$50, cache okuma $0.25. Mythos 5.1 aynı ağırlıklar, farklı (daha gevşek siber/biyo) korumalar; Glasswing'e özel. Bilgi kesimi Haz 2026. Thinking her zaman açık.

Claude Fable 5.1 vs Fable 5 vs Opus 5: geçiş tablosu

Bu 14 görevlik sette Opus 5'te kalın; Fable 5.1 doğrulukta bağladı ve Fable 5'e göre 1.11× maliyeti oldu.

GA'nın ertesi sabahı anthropic/claude-fable-5.1 çağırdık. Liste kartı kıpırdamadı: $10/$50, Fable 5 ile aynı. Claude Opus 5 $5/$25. Liste fiyatında tek değişiklik cache okuma ($0.25'e karşı $1.00) ve burada ateşlenmedi.

Opus 5, bu 14 görevlik sette Fable 5.1'den %45 daha ucuz; çünkü daha az token harcadığı için değil, liste fiyatı $5/$25'e karşı $10/$50 olduğu için.

Fable 5.1Fable 5Opus 5
Liste $ giriş/çıkış$10/$50$10/$50$5/$25
Cache okuma$0.25 / MTok$1.00 / MTokn/a
Varsayılan effortClaude Code'da High; claude.ai / Cowork'ta Mediumn/aHigh
Satıcı manşetiTerminal-Bench-Science 52.6%24.7%29.0%
Fatura (bizim sayaç)$0.14693, 14/14$0.13285, 14/14$0.080725, 14/14
Geçişcache-ağır ajanlarkısa cache'siz çağrılarsınırlı tek atış

Aynı ağırlıklar, iki kapı; biri yanıt vermiyor

Mythos 5.1 aynı ağırlıklar, daha gevşek siber/biyo korumalar; OpenRouter'da yok.

Anthropic'in lansman cümlesi birebir: "Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards." Fable GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos, Project Glasswing / CVP / LSVP arkasında claude-mythos-5-1; şu an bir dizi ABD kuruluşu. 1M bağlam, 128k max çıktı, Haz 2026 kesim (Fable 5'in Oca 2026'sına karşı). Deneyimiz $0.53795 tuttu. Mythos çağrılmadı.

python
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
    "anthropic/claude-fable-5.1",
    "anthropic/claude-fable-5",
    "anthropic/claude-opus-5",
    # claude-mythos-5-1: not listed / Glasswing only
]

Claude Fable 5.1'de hangi bench'ler gerçekten hareket etti?

Terminal-Bench-Science 0.1 sıçrama noktası: Fable 5.1'de 52.6%, Fable 5'te 24.7%.

Fable 5 24.7%'de, Opus 5 29.0%'da oturuyordu. Sıçrama, bizim 14 kısa çağrıdan çok ajanlık kodlama döngülerinin neden önemli olduğunu açıklıyor.

BenchFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8% (Mythos 5.1: 60.9%)42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial / strict77.9% / 41.7%72.9% / 36.1%75.4% / 39.6%n/a
HLE no tools / with tools60.9% / 65.0%57.8% / 63.8%56.6% / 63.6%n/a
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Kaynak: Anthropic duyurusu, 2026-09-01.

KaynakBulguKapsam
Artificial Analysis, 2026-09-01Intelligence Index max'ta 66Fable 5 max 62; Opus 5 max 63
Artificial Analysisgörev başı $3.76 vs Fable 5 $3.14 (+%20)~1.7× çıktı; indirimsiz ~$5.16; xhigh 65, $2.72
Snorkel, 2026-09-01%58 daha az token, %36 daha hızlıOpus 5 başarıları; 18 / 5 / 2 / 2; pass@1 %61,5; build/dep %18 vs %67

Snorkel'in %58 / %36'sı başarılı koşularda Opus 5'e karşı, Fable 5'e karşı değil. Opus hâlâ üç görev daha çözdü (18 ikisi / 5 Opus-only / 2 Fable-only).

  1. Terminal-Bench-Science SE ±3,5-4,5 puan. Genel liderlik tablosu (görev başına 3 deneme, Claude Code runner) Opus 5'i %30,0 ve Fable 5'i %21,4 gösteriyor; Anthropic'in kurulumu 29.0% ve 24.7%'yi yeniden üretiyor, ikisi de gürültü bandında.
  2. OSWorld 2.0, yazarların Ağustos 2026 görev sürümü; Fable 5 ve Opus 5 aynı koşullarda yeniden koşturuldu. Eski OSWorld sayılarına kıyaslanmaz.
  3. Üretim korumaları açıktı. Müdahaleler OSWorld'de (her iki Fable) ve AutomationBench'te (Fable 5) sıfır sayıldı. Diğer siber görevler Opus 4.8'e, biyoloji Opus 5'e düştü. Bu, ham kapasiteyi muhtemelen düşük gösteriyor.

Claude Fable 5.1'in %25 tasarrufu faturanızda mı?

Cache-read satırı 75.0% daha ucuz; kısa takip turunun tamamı %21 daha ucuzdu.

Anthropic'in lansman yazısı Fable 5'e karşı tipik ~%25 ve ajanlık ~%45 tasarruf tahmin ediyor. İkisi de cache okumalarının baskın olmasını ve çıktı token'larının fırlamamasını ister. Dokümantasyon fiyat kartı: cache yazma $12.50 / $20, çıktı $50, cache okuma $1.00 → $0.25 / MTok. İş yükü maliyet modelleri, bu indirimin token faturasını başka yerde keserken ayakta kalıp kalmadığına karar verir.

SenaryoEtiketFable 5Fable 5.1Fark
Satır A: 20 tur / ~1M (9,5M cache okuma, yazma $12.50, çıktı $50)liste-fiyat kimliği, bizim sayaç değil$72.00 ($9.50 cache)$64.88 ($2.38 cache)-%9,9
Satır B: Intelligence Index göreviArtificial Analysis, 2026-09-01$3.14$3.76 (indirimsiz ~$5.16)max'ta +%20 (~1.7× çıktı)
Satır C: 1,165-token önek, tur 2Techsy OpenRouter, 2026-09-02$0.005086$0.00402125turun tamamı %21 daha ucuz
Tur-2 satırı (Fatura, bizim sayaç)Fable 5.1Fable 5
Cache'lenen giriş token'ları1,1651,166
Cache-read satırı$0.000291$0.001166
OpenRouter usage.cost$0.00402125$0.005086

Cache-read satırı 75.0% daha ucuz ($0.000291'e karşı $0.001166). Turun tamamındaki tasarruf %21'de kalıyor çünkü çıktı hâlâ $50/M üzerinden faturalanıyor. Cache satırını 40 yeniden okuma × 200.000 token'a ölçekleyin: 5.1'de $2.00, 5'te $8.00.

AY Automate, 2026-09-01'de "Is Claude Fable 5.1 more expensive than Fable 5?" diye sordu ve "No." dedi. Liste fiyatı $10/$50'da değişmedi. Fatura değişti: Artificial Analysis max'ta +%20 ölçtü, THE DECODER aynı gün o +%20 ile güncelledi ve bizim 14 cache'siz çağrımız 1.11× yazdı.

HN kullanıcısı george_max (item 49525611, 2026-09-01) bunu "just cache reads" ve "15% more" diye niteledi; AA'nın max effort ölçümüyle örtüşüyor. Abonelik 5 saatlik pencereleri cache okumalarını API gibi fiyatlamaz.

Tek bir quiz, bench değil: Fable 5'in tur-2 cache cevabı, "on this model" diyen bir prompt'ta $2.00 / $2.50 (5.1 fiyatları) kullandı.

OpenRouter sayacımız Claude Fable 5.1'de ne gösterdi

Üç model de effort=low ile 14/14 geçti; Opus 5, Fable 5.1'den %45 daha ucuzdu.

14 prompt benchmark'ladık. Doğruluk berabere; Opus 5 yine de $5/$25'e karşı $10/$50 ile kazandı.

  1. Ne zaman: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Genel fiyatlar Fable 5.1 model sayfasında.
  2. Ne: anthropic/claude-fable-5.1 vs anthropic/claude-fable-5 vs anthropic/claude-opus-5.
  3. Nasıl: üç Fable 5.1 High kodlama çağrısı dışında reasoning.effort=low. temperature yok (5.1 varsayılan dışı örneklemeyi reddediyor).
  4. Değerlendiriciler: JSON-schema, birebir sayısal eşleşme, çalıştırılmış birim testleri. Artefaktlar: fable_bench.py, benchmark-raw.json, benchmark-aggregate.json. Benchmark'ımızdaki üç slug'ı test ettik: 49 çağrı, $0.53795.
Metrik (14 çağrı, effort=low)Fable 5.1Fable 5Opus 5
Geçen görev14/1414/1414/14
Medyan gecikme5.647 s5.383 s4.797 s
Medyan completion token9490103
Medyan reasoning token0823
Toplam completion token2,5472,2712,843
Toplam reasoning token0253380
Toplam maliyet$0.14693$0.13285$0.080725

Kodlama low'da her biri 6/6 geçti.

Görev (2 deneme)Fable 5.1 outFable 5 outOpus 5 out
merge_intervals175, 16896, 96155, 155
semver_satisfies414, 411405, 401493, 487
lru_ttl_cache387, 418395, 339469, 459
Kodlama medyan gecikme6.523 s5.389 s6.316 s
Kodlama toplam maliyet$0.11095$0.09878$0.06154

Anthropic'in "planlarda ve özetlerde daha öz" iddiasını ajan izleri hakkında bir iddia olarak okuyun, tek atış fonksiyon dökümleri hakkında değil. Fable 5.1, Fable 5'in 96 harcadığı merge_intervals'da ~175 token harcadı; ikisi de geçti.

Bunun ölçmediği şeyler:

  • Mythos 5.1 (bu hesaptan çağrılamıyor).
  • Çok saatlik ajanlar, Terminal-Bench, SWE-bench, bilgisayar kullanımı.
  • Varsayılan effort (3. tur dışında low sabitledik).
  • 5 dakikalık vs 1 saatlik TTL'de cache yazmaları.
  • Redler, Opus'a düşme, tool-loop batching.

Fable 5.1'de hangi üç istek 400 dönüyor?

tool_choice tipi any veya tool zorlaması, claude-fable-5-1'de HTTP 400 döndürüyor.

What's new in Fable 5.1 hatayı adlandırıyor: tool_choice: type "tool" and "any" are not supported for this model. Assistant turunu prefill etmek de 400. Varsayılan dışı temperature / top_p / top_k da 400; bu yüzden temperature göndermedik. Thinking blokları üreten modele bağlı (thinking-binding-controls-2026-08-01): 5.1 önceki blokları okur, önceki modeller 5.1'inkileri okuyamaz ve bir router fallback'i onları düşürür. 5.1 thinking bloğunun önündeki herhangi bir şeyi düzenlemek, 2026-08-31 veya sonrasında açılan hesaplarda hata verir ya da bloğu düşürür. Mythos 5.1 bu önek kontrolünü atlar.

python
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
    "model": "anthropic/claude-fable-5.1",
    "messages": [{"role": "user", "content": "Look up the cache rate."}],
    "tools": [{"type": "function", "function": {"name": "lookup"}}],
    "tool_choice": {"type": "tool", "name": "lookup"},  # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.
  1. tool_choiceauto yapın ve tool şemasında strict: true kullanın, ya da structured outputs'a geçin.
  2. Geçmişi append-only tutun; 5.1 thinking bloğunun önündeki bir öneki asla düzenlemeyin.
  3. Daha eski bir modele düştüğünüzde thinking bloklarını atın.
  4. temperature / top_p / top_k göndermeyin ve assistant turunu prefill etmeyin.

Claude Code neden Fable 5.1'i varsayılan High yapıyor?

Claude Code, Fable 5.1'i varsayılan High'a alır; lru_ttl_cache'de Low'da zaten geçen bir görevi 4×'ledi.

Anthropic duyurusu Claude Code'da High, claude.ai / Cowork'ta Medium koyuyor. Beş effort seviyesi: low / medium / high / xhigh / max. Thinking her zaman açık; thinking: disabled 400. Help Center Claude Code 2.1.250 veya sonrasını istiyor.

GörevLow (out / reason / cost)High (out / reason / cost / latency)
merge_intervals172 / 0 / $0.010175 / 0 / $0.01024 / 4.86 s
semver_satisfies413 / 0 / $0.023401 / 0 / $0.02238 / 7.60 s
lru_ttl_cache403 / 0 / $0.0221,713 / 1,150 / $0.08798 / 22.07 s

merge_intervals ve semver_satisfies Low gibi durdu. lru_ttl_cache durmadı. High, completion token'larının 4,25×'ini harcadı (1,713'e karşı 403), 1,150 reasoning token ekledi, ~7 s'ye karşı 22.07 s sürdü ve zaten elimizdeki testler için 4.0× fatura kesti ($0.08798'e karşı $0.022). Sınırlı fonksiyonlar için effort=low (veya claude.ai'de Medium) sabitleyin.

Simon Willison (2026-09-01, bizim pelican değil): effort kapatılamıyor; bir prompt'ta max, low çıktısının 33×'i oldu.

Fable 5'te mi, Opus 5'te mi kalmalı, yoksa geçmeli misiniz?

Sınırlı tek atış işler için Opus 5'te kalın; cache-ağır ajanları Fable 5.1'e taşıyın.

Dokümantasyon Opus 5 ile başlayıp High-effort eval'ler hâlâ yetmeyince Fable 5.1'e uzanmanızı söylüyor. Bizim eval, 14/14 sayaç: Opus 5 $0.0807'ye karşı $0.1469 (%45 daha ucuz). Kısa cache'siz çağrılar için Fable 5'ten 5.1'e geçmeyin: ikisi de 14/14, 5.1 burada 1.11× daha pahalı.

KuralTersine çevirin eğerFatura (bizim sayaç)
Sınırlı tek atış için Opus 5'te kalınHigh-effort eval'ler uzun ajan oturumlarını hâlâ kaçırıyorsa$0.080725, 14/14, $0.14693'ten %45 daha ucuz
Cache-ağır ajanları Fable 5.1'e taşıyınoturum büyük bir öneki hiç yeniden okumuyorsa75.0% daha ucuz cache-read satırı ($0.000291'e karşı $0.001166)
Low'da zaten geçen görevler için Claude Code'u varsayılan High'da bırakmayıniş Terminal-Bench-Science sınıfı bir döngüyselru_ttl_cache'de 4.0× ($0.08798'e karşı $0.022)
Kısa cache'siz çağrılar için Fable 5 → 5.1 geçmeyinScience sıçramasına veya $0.25 cache okumasına ihtiyacınız varsa1.11× ($0.14693'e karşı $0.13285), ikisi de 14/14

Fable 5.1, cache'siz 14/14'te $0.14693 (1.11×) yazdı; kazanç cache-read satırında. Fable 5, 1,165-token bir önek yeniden okunana kadar $0.13285 yazdı. Opus 5 $0.080725 yazdı, %45 daha ucuz, daha fazla token ile (2,843'e karşı 2,547).

Sınırlı tek atış iş Opus 5'te kalır. Cache-ağır ajanlar, testler zaten geçiyorsa effort Low'a sabitlenmiş halde Fable 5.1'e $0.25 cache-read satırı için taşınır. Kısa cache'siz Fable 5 çağrıları yerinde kalır.

Sıkça Sorulan Sorular

Claude Fable 5.1 API kimliği nedir?

Anthropic API'de claude-fable-5-1, Bedrock'ta anthropic.claude-fable-5-1, OpenRouter'da anthropic/claude-fable-5.1. Vertex, Foundry ve Claude Platform claude-fable-5-1 tutuyor. Mythos claude-mythos-5-1, Glasswing-only; yazabileceğiniz bir OpenRouter modeli değil ve 2026-09-02'de çağırmadık.

Cache-read indirimi Claude Code Max kotasına uygulanır mı?

Hayır. %75 indirim bir API cache-read fiyatı ($1.00 → $0.25 / MTok). Abonelik 5 saatlik pencereleri cache okumalarını o şekilde faturalamaz, bu yüzden tipik %25 tasarruf Max kotalarına uzamaz. r/ClaudeCode (2026-09-01), High varsayılanı geldikten sonra 5 saatlik pencereyi 20 dakikada yaktığını bildirdi.

Fable 5.1 hangi Claude Code sürümünü ister?

2026-09-01 tarihli Help Center'a göre 2.1.250 veya sonrası. Fable 5 2.1.170+'dı. Eski build'ler yeni kimliği, LRU görevimizi 4.0×'leyen High varsayılanını ve 5.1'in beklediği effort seçicisini kaçırır. Trafiği yönlendirmeden önce yükseltin.

Sırada Fable 6 mı var?

5.1, o yazının öngördüğü nokta sürümü. Fable 6 hâlâ duyurulmadı. 5.1 tarihi soran Polymarket thread'leri bayat: GA 2026-09-01'di ve duyuru Fable 6 takvimi vermiyor. Onu bekleyerek 5 vs 5.1 geçişini ertelemeyin.

Claude Fable 5.1 bir Covered Model mi?

Evet. 30 günlük veri saklama. Açıkça yetkilendirilmedikçe zero data retention altında yok. Enterprise Frontier Safeguards (müşteri bulutu depolama) bu sonbaharın ilerleyen döneminde geliyor; uygun müşteriler o zamana kadar ZDR kullanabilir. Tüm platformlarda istatistiksel metin filigranı var (AB Yapay Zekâ Yasası, 2026-08-02 sonrası modeller); detection API özel önizlemede.

Etiketler

claude-fable-5-1claude-mythos-5-1prompt-cachingclaude-opus-5openrouter

Bu makaleyi paylaş

Projenize Başlayın

Harika bir şey inşa etmeye hazır mısınız?

Vizyonunuzu hayata geçirelim. Fark yaratan yazılımlar için ekibimiz hazır.