
Claude Fable 5.1 İnceleme: Fable 5 ve Opus 5 ile Ölçtük
Claude Fable 5.1, 2026-09-01'de Fable 5 ile aynı $10/$50'da çıktı; cache okumaları $0.25'e indi. Ertesi sabah 08:55 UTC'de 14 eşleşmiş OpenRouter görevi çalıştırdık. Duyurulan %45 ajanlık tasarrufu o faturada yoktu: üç model de 14/14 geçti ve 5.1, Opus 5'in $0.080725'ine karşı $0.14693 yazdı.
Anthropic'in herkese açık frontier kimliği claude-fable-5-1, GA 2026-09-01, milyon token başına $10/$50, cache okuma $0.25. Mythos 5.1 aynı ağırlıklar, farklı (daha gevşek siber/biyo) korumalar; Glasswing'e özel. Bilgi kesimi Haz 2026. Thinking her zaman açık.
Claude Fable 5.1 vs Fable 5 vs Opus 5: geçiş tablosu
Bu 14 görevlik sette Opus 5'te kalın; Fable 5.1 doğrulukta bağladı ve Fable 5'e göre 1.11× maliyeti oldu.
GA'nın ertesi sabahı anthropic/claude-fable-5.1 çağırdık. Liste kartı kıpırdamadı: $10/$50, Fable 5 ile aynı. Claude Opus 5 $5/$25. Liste fiyatında tek değişiklik cache okuma ($0.25'e karşı $1.00) ve burada ateşlenmedi.
Opus 5, bu 14 görevlik sette Fable 5.1'den %45 daha ucuz; çünkü daha az token harcadığı için değil, liste fiyatı $5/$25'e karşı $10/$50 olduğu için.
| Fable 5.1 | Fable 5 | Opus 5 | |
|---|---|---|---|
| Liste $ giriş/çıkış | $10/$50 | $10/$50 | $5/$25 |
| Cache okuma | $0.25 / MTok | $1.00 / MTok | n/a |
| Varsayılan effort | Claude Code'da High; claude.ai / Cowork'ta Medium | n/a | High |
| Satıcı manşeti | Terminal-Bench-Science 52.6% | 24.7% | 29.0% |
| Fatura (bizim sayaç) | $0.14693, 14/14 | $0.13285, 14/14 | $0.080725, 14/14 |
| Geçiş | cache-ağır ajanlar | kısa cache'siz çağrılar | sınırlı tek atış |
Aynı ağırlıklar, iki kapı; biri yanıt vermiyor
Mythos 5.1 aynı ağırlıklar, daha gevşek siber/biyo korumalar; OpenRouter'da yok.
Anthropic'in lansman cümlesi birebir: "Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards." Fable GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos, Project Glasswing / CVP / LSVP arkasında claude-mythos-5-1; şu an bir dizi ABD kuruluşu. 1M bağlam, 128k max çıktı, Haz 2026 kesim (Fable 5'in Oca 2026'sına karşı). Deneyimiz $0.53795 tuttu. Mythos çağrılmadı.
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
"anthropic/claude-fable-5.1",
"anthropic/claude-fable-5",
"anthropic/claude-opus-5",
# claude-mythos-5-1: not listed / Glasswing only
]Claude Fable 5.1'de hangi bench'ler gerçekten hareket etti?
Terminal-Bench-Science 0.1 sıçrama noktası: Fable 5.1'de 52.6%, Fable 5'te 24.7%.
Fable 5 24.7%'de, Opus 5 29.0%'da oturuyordu. Sıçrama, bizim 14 kısa çağrıdan çok ajanlık kodlama döngülerinin neden önemli olduğunu açıklıyor.
| Bench | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% (Mythos 5.1: 60.9%) | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial / strict | 77.9% / 41.7% | 72.9% / 36.1% | 75.4% / 39.6% | n/a |
| HLE no tools / with tools | 60.9% / 65.0% | 57.8% / 63.8% | 56.6% / 63.6% | n/a |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Kaynak: Anthropic duyurusu, 2026-09-01.
| Kaynak | Bulgu | Kapsam |
|---|---|---|
| Artificial Analysis, 2026-09-01 | Intelligence Index max'ta 66 | Fable 5 max 62; Opus 5 max 63 |
| Artificial Analysis | görev başı $3.76 vs Fable 5 $3.14 (+%20) | ~1.7× çıktı; indirimsiz ~$5.16; xhigh 65, $2.72 |
| Snorkel, 2026-09-01 | %58 daha az token, %36 daha hızlı | Opus 5 başarıları; 18 / 5 / 2 / 2; pass@1 %61,5; build/dep %18 vs %67 |
Snorkel'in %58 / %36'sı başarılı koşularda Opus 5'e karşı, Fable 5'e karşı değil. Opus hâlâ üç görev daha çözdü (18 ikisi / 5 Opus-only / 2 Fable-only).
- Terminal-Bench-Science SE ±3,5-4,5 puan. Genel liderlik tablosu (görev başına 3 deneme, Claude Code runner) Opus 5'i %30,0 ve Fable 5'i %21,4 gösteriyor; Anthropic'in kurulumu 29.0% ve 24.7%'yi yeniden üretiyor, ikisi de gürültü bandında.
- OSWorld 2.0, yazarların Ağustos 2026 görev sürümü; Fable 5 ve Opus 5 aynı koşullarda yeniden koşturuldu. Eski OSWorld sayılarına kıyaslanmaz.
- Üretim korumaları açıktı. Müdahaleler OSWorld'de (her iki Fable) ve AutomationBench'te (Fable 5) sıfır sayıldı. Diğer siber görevler Opus 4.8'e, biyoloji Opus 5'e düştü. Bu, ham kapasiteyi muhtemelen düşük gösteriyor.
Claude Fable 5.1'in %25 tasarrufu faturanızda mı?
Cache-read satırı 75.0% daha ucuz; kısa takip turunun tamamı %21 daha ucuzdu.
Anthropic'in lansman yazısı Fable 5'e karşı tipik ~%25 ve ajanlık ~%45 tasarruf tahmin ediyor. İkisi de cache okumalarının baskın olmasını ve çıktı token'larının fırlamamasını ister. Dokümantasyon fiyat kartı: cache yazma $12.50 / $20, çıktı $50, cache okuma $1.00 → $0.25 / MTok. İş yükü maliyet modelleri, bu indirimin token faturasını başka yerde keserken ayakta kalıp kalmadığına karar verir.
| Senaryo | Etiket | Fable 5 | Fable 5.1 | Fark |
|---|---|---|---|---|
| Satır A: 20 tur / ~1M (9,5M cache okuma, yazma $12.50, çıktı $50) | liste-fiyat kimliği, bizim sayaç değil | $72.00 ($9.50 cache) | $64.88 ($2.38 cache) | -%9,9 |
| Satır B: Intelligence Index görevi | Artificial Analysis, 2026-09-01 | $3.14 | $3.76 (indirimsiz ~$5.16) | max'ta +%20 (~1.7× çıktı) |
| Satır C: 1,165-token önek, tur 2 | Techsy OpenRouter, 2026-09-02 | $0.005086 | $0.00402125 | turun tamamı %21 daha ucuz |
| Tur-2 satırı (Fatura, bizim sayaç) | Fable 5.1 | Fable 5 |
|---|---|---|
| Cache'lenen giriş token'ları | 1,165 | 1,166 |
| Cache-read satırı | $0.000291 | $0.001166 |
OpenRouter usage.cost | $0.00402125 | $0.005086 |
Cache-read satırı 75.0% daha ucuz ($0.000291'e karşı $0.001166). Turun tamamındaki tasarruf %21'de kalıyor çünkü çıktı hâlâ $50/M üzerinden faturalanıyor. Cache satırını 40 yeniden okuma × 200.000 token'a ölçekleyin: 5.1'de $2.00, 5'te $8.00.
AY Automate, 2026-09-01'de "Is Claude Fable 5.1 more expensive than Fable 5?" diye sordu ve "No." dedi. Liste fiyatı $10/$50'da değişmedi. Fatura değişti: Artificial Analysis max'ta +%20 ölçtü, THE DECODER aynı gün o +%20 ile güncelledi ve bizim 14 cache'siz çağrımız 1.11× yazdı.
HN kullanıcısı george_max (item 49525611, 2026-09-01) bunu "just cache reads" ve "15% more" diye niteledi; AA'nın max effort ölçümüyle örtüşüyor. Abonelik 5 saatlik pencereleri cache okumalarını API gibi fiyatlamaz.
Tek bir quiz, bench değil: Fable 5'in tur-2 cache cevabı, "on this model" diyen bir prompt'ta $2.00 / $2.50 (5.1 fiyatları) kullandı.
OpenRouter sayacımız Claude Fable 5.1'de ne gösterdi
Üç model de effort=low ile 14/14 geçti; Opus 5, Fable 5.1'den %45 daha ucuzdu.
14 prompt benchmark'ladık. Doğruluk berabere; Opus 5 yine de $5/$25'e karşı $10/$50 ile kazandı.
- Ne zaman: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Genel fiyatlar Fable 5.1 model sayfasında.
- Ne:
anthropic/claude-fable-5.1vsanthropic/claude-fable-5vsanthropic/claude-opus-5. - Nasıl: üç Fable 5.1 High kodlama çağrısı dışında
reasoning.effort=low.temperatureyok (5.1 varsayılan dışı örneklemeyi reddediyor). - Değerlendiriciler: JSON-schema, birebir sayısal eşleşme, çalıştırılmış birim testleri. Artefaktlar:
fable_bench.py,benchmark-raw.json,benchmark-aggregate.json. Benchmark'ımızdaki üç slug'ı test ettik: 49 çağrı, $0.53795.
| Metrik (14 çağrı, effort=low) | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Geçen görev | 14/14 | 14/14 | 14/14 |
| Medyan gecikme | 5.647 s | 5.383 s | 4.797 s |
| Medyan completion token | 94 | 90 | 103 |
| Medyan reasoning token | 0 | 8 | 23 |
| Toplam completion token | 2,547 | 2,271 | 2,843 |
| Toplam reasoning token | 0 | 253 | 380 |
| Toplam maliyet | $0.14693 | $0.13285 | $0.080725 |
Kodlama low'da her biri 6/6 geçti.
| Görev (2 deneme) | Fable 5.1 out | Fable 5 out | Opus 5 out |
|---|---|---|---|
merge_intervals | 175, 168 | 96, 96 | 155, 155 |
semver_satisfies | 414, 411 | 405, 401 | 493, 487 |
lru_ttl_cache | 387, 418 | 395, 339 | 469, 459 |
| Kodlama medyan gecikme | 6.523 s | 5.389 s | 6.316 s |
| Kodlama toplam maliyet | $0.11095 | $0.09878 | $0.06154 |
Anthropic'in "planlarda ve özetlerde daha öz" iddiasını ajan izleri hakkında bir iddia olarak okuyun, tek atış fonksiyon dökümleri hakkında değil. Fable 5.1, Fable 5'in 96 harcadığı merge_intervals'da ~175 token harcadı; ikisi de geçti.
Bunun ölçmediği şeyler:
- Mythos 5.1 (bu hesaptan çağrılamıyor).
- Çok saatlik ajanlar, Terminal-Bench, SWE-bench, bilgisayar kullanımı.
- Varsayılan effort (3. tur dışında
lowsabitledik). - 5 dakikalık vs 1 saatlik TTL'de cache yazmaları.
- Redler, Opus'a düşme, tool-loop batching.
Fable 5.1'de hangi üç istek 400 dönüyor?
tool_choice tipi any veya tool zorlaması, claude-fable-5-1'de HTTP 400 döndürüyor.
What's new in Fable 5.1 hatayı adlandırıyor: tool_choice: type "tool" and "any" are not supported for this model. Assistant turunu prefill etmek de 400. Varsayılan dışı temperature / top_p / top_k da 400; bu yüzden temperature göndermedik. Thinking blokları üreten modele bağlı (thinking-binding-controls-2026-08-01): 5.1 önceki blokları okur, önceki modeller 5.1'inkileri okuyamaz ve bir router fallback'i onları düşürür. 5.1 thinking bloğunun önündeki herhangi bir şeyi düzenlemek, 2026-08-31 veya sonrasında açılan hesaplarda hata verir ya da bloğu düşürür. Mythos 5.1 bu önek kontrolünü atlar.
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
"model": "anthropic/claude-fable-5.1",
"messages": [{"role": "user", "content": "Look up the cache rate."}],
"tools": [{"type": "function", "function": {"name": "lookup"}}],
"tool_choice": {"type": "tool", "name": "lookup"}, # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.tool_choice'ıautoyapın ve tool şemasındastrict: truekullanın, ya da structured outputs'a geçin.- Geçmişi append-only tutun; 5.1 thinking bloğunun önündeki bir öneki asla düzenlemeyin.
- Daha eski bir modele düştüğünüzde thinking bloklarını atın.
temperature/top_p/top_kgöndermeyin ve assistant turunu prefill etmeyin.
Claude Code neden Fable 5.1'i varsayılan High yapıyor?
Claude Code, Fable 5.1'i varsayılan High'a alır; lru_ttl_cache'de Low'da zaten geçen bir görevi 4×'ledi.
Anthropic duyurusu Claude Code'da High, claude.ai / Cowork'ta Medium koyuyor. Beş effort seviyesi: low / medium / high / xhigh / max. Thinking her zaman açık; thinking: disabled 400. Help Center Claude Code 2.1.250 veya sonrasını istiyor.
| Görev | Low (out / reason / cost) | High (out / reason / cost / latency) |
|---|---|---|
merge_intervals | 172 / 0 / $0.010 | 175 / 0 / $0.01024 / 4.86 s |
semver_satisfies | 413 / 0 / $0.023 | 401 / 0 / $0.02238 / 7.60 s |
lru_ttl_cache | 403 / 0 / $0.022 | 1,713 / 1,150 / $0.08798 / 22.07 s |
merge_intervals ve semver_satisfies Low gibi durdu. lru_ttl_cache durmadı. High, completion token'larının 4,25×'ini harcadı (1,713'e karşı 403), 1,150 reasoning token ekledi, ~7 s'ye karşı 22.07 s sürdü ve zaten elimizdeki testler için 4.0× fatura kesti ($0.08798'e karşı $0.022). Sınırlı fonksiyonlar için effort=low (veya claude.ai'de Medium) sabitleyin.
Simon Willison (2026-09-01, bizim pelican değil): effort kapatılamıyor; bir prompt'ta max, low çıktısının 33×'i oldu.
Fable 5'te mi, Opus 5'te mi kalmalı, yoksa geçmeli misiniz?
Sınırlı tek atış işler için Opus 5'te kalın; cache-ağır ajanları Fable 5.1'e taşıyın.
Dokümantasyon Opus 5 ile başlayıp High-effort eval'ler hâlâ yetmeyince Fable 5.1'e uzanmanızı söylüyor. Bizim eval, 14/14 sayaç: Opus 5 $0.0807'ye karşı $0.1469 (%45 daha ucuz). Kısa cache'siz çağrılar için Fable 5'ten 5.1'e geçmeyin: ikisi de 14/14, 5.1 burada 1.11× daha pahalı.
| Kural | Tersine çevirin eğer | Fatura (bizim sayaç) |
|---|---|---|
| Sınırlı tek atış için Opus 5'te kalın | High-effort eval'ler uzun ajan oturumlarını hâlâ kaçırıyorsa | $0.080725, 14/14, $0.14693'ten %45 daha ucuz |
| Cache-ağır ajanları Fable 5.1'e taşıyın | oturum büyük bir öneki hiç yeniden okumuyorsa | 75.0% daha ucuz cache-read satırı ($0.000291'e karşı $0.001166) |
| Low'da zaten geçen görevler için Claude Code'u varsayılan High'da bırakmayın | iş Terminal-Bench-Science sınıfı bir döngüyse | lru_ttl_cache'de 4.0× ($0.08798'e karşı $0.022) |
| Kısa cache'siz çağrılar için Fable 5 → 5.1 geçmeyin | Science sıçramasına veya $0.25 cache okumasına ihtiyacınız varsa | 1.11× ($0.14693'e karşı $0.13285), ikisi de 14/14 |
Fable 5.1, cache'siz 14/14'te $0.14693 (1.11×) yazdı; kazanç cache-read satırında. Fable 5, 1,165-token bir önek yeniden okunana kadar $0.13285 yazdı. Opus 5 $0.080725 yazdı, %45 daha ucuz, daha fazla token ile (2,843'e karşı 2,547).
- Fable 5 vs Opus 4.8 Haziran lansman yazısında duruyor.
- Claude Opus 5 Opus hattı fiyatlandırmasını taşıyor.
- 5.1, o yazının öngördüğü nokta sürümü; Fable 6 hâlâ duyurulmadı.
- Eski Fable 5 çekmesi için ihracat kontrolü Soru-Cevap.
- Sıralama omurgası olarak token verimliliği Grok 4.6 üzerinde.
- Üretimde Opus vs Fable yönlendirme.
Sınırlı tek atış iş Opus 5'te kalır. Cache-ağır ajanlar, testler zaten geçiyorsa effort Low'a sabitlenmiş halde Fable 5.1'e $0.25 cache-read satırı için taşınır. Kısa cache'siz Fable 5 çağrıları yerinde kalır.
Sıkça Sorulan Sorular
Claude Fable 5.1 API kimliği nedir?
Anthropic API'de claude-fable-5-1, Bedrock'ta anthropic.claude-fable-5-1, OpenRouter'da anthropic/claude-fable-5.1. Vertex, Foundry ve Claude Platform claude-fable-5-1 tutuyor. Mythos claude-mythos-5-1, Glasswing-only; yazabileceğiniz bir OpenRouter modeli değil ve 2026-09-02'de çağırmadık.
Cache-read indirimi Claude Code Max kotasına uygulanır mı?
Hayır. %75 indirim bir API cache-read fiyatı ($1.00 → $0.25 / MTok). Abonelik 5 saatlik pencereleri cache okumalarını o şekilde faturalamaz, bu yüzden tipik %25 tasarruf Max kotalarına uzamaz. r/ClaudeCode (2026-09-01), High varsayılanı geldikten sonra 5 saatlik pencereyi 20 dakikada yaktığını bildirdi.
Fable 5.1 hangi Claude Code sürümünü ister?
2026-09-01 tarihli Help Center'a göre 2.1.250 veya sonrası. Fable 5 2.1.170+'dı. Eski build'ler yeni kimliği, LRU görevimizi 4.0×'leyen High varsayılanını ve 5.1'in beklediği effort seçicisini kaçırır. Trafiği yönlendirmeden önce yükseltin.
Sırada Fable 6 mı var?
5.1, o yazının öngördüğü nokta sürümü. Fable 6 hâlâ duyurulmadı. 5.1 tarihi soran Polymarket thread'leri bayat: GA 2026-09-01'di ve duyuru Fable 6 takvimi vermiyor. Onu bekleyerek 5 vs 5.1 geçişini ertelemeyin.
Claude Fable 5.1 bir Covered Model mi?
Evet. 30 günlük veri saklama. Açıkça yetkilendirilmedikçe zero data retention altında yok. Enterprise Frontier Safeguards (müşteri bulutu depolama) bu sonbaharın ilerleyen döneminde geliyor; uygun müşteriler o zamana kadar ZDR kullanabilir. Tüm platformlarda istatistiksel metin filigranı var (AB Yapay Zekâ Yasası, 2026-08-02 sonrası modeller); detection API özel önizlemede.