
Claude Fable 5.1 Review: Gemeten tegen Fable 5 en Opus 5
Claude Fable 5.1 verscheen op 2026-09-01 tegen dezelfde $10/$50 als Fable 5, met cache reads verlaagd naar $0.25. De ochtend erna, 08:55 UTC, draaiden we 14 matched OpenRouter-taken. De 45% agentic besparing stond niet op die factuur: alle drie de modellen scoorden 14/14, en 5.1 factureerde $0.14693 tegenover Opus 5 op $0.080725.
Anthropic's algemeen beschikbare frontier-ID is claude-fable-5-1, GA 2026-09-01, $10/$50 per miljoen tokens, cache read $0.25. Mythos 5.1 zijn dezelfde gewichten met andere (lossere cyber/bio) beveiligingen, alleen Glasswing. Knowledge cutoff jun 2026. Thinking staat altijd aan.
Claude Fable 5.1 vs Fable 5 vs Opus 5: de overschakeltabel
Blijf op Opus 5 voor deze 14-takenset; Fable 5.1 evenaarde de nauwkeurigheid en kostte 1.11× Fable 5.
We riepen anthropic/claude-fable-5.1 aan de ochtend na GA. De prijslijst bewoog niet: $10/$50, hetzelfde als Fable 5. Claude Opus 5 staat op $5/$25. Cache read is de enige lijstprijswijziging ($0.25 vs $1.00), en die vuurde hier niet.
Opus 5 is 45% goedkoper dan Fable 5.1 op deze 14-takenset omdat de lijstprijs $5/$25 vs $10/$50 is, niet omdat het minder tokens gebruikte.
| Fable 5.1 | Fable 5 | Opus 5 | |
|---|---|---|---|
| Lijst $ in/out | $10/$50 | $10/$50 | $5/$25 |
| Cache read | $0.25 / MTok | $1.00 / MTok | n.v.t. |
| Standaard effort | High in Claude Code; Medium op claude.ai / Cowork | n.v.t. | High |
| Vendor-kop | Terminal-Bench-Science 52.6% | 24.7% | 29.0% |
| Factuur (onze meter) | $0.14693, 14/14 | $0.13285, 14/14 | $0.080725, 14/14 |
| Overschakelen | cache-zware agents | korte uncached calls | begrensde single-shot |
Dezelfde gewichten, twee deuren, en één ervan antwoordt niet
Mythos 5.1 zijn dezelfde gewichten met lossere cyber/bio-beveiligingen, en het staat niet op OpenRouter.
Anthropic's lanceerzin is letterlijk: “Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards.” Fable is GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos is claude-mythos-5-1 achter Project Glasswing / CVP / LSVP, momenteel een set Amerikaanse organisaties. 1M context, 128k max output, cutoff jun 2026 vs jan 2026 van Fable 5. Ons experiment kostte $0.53795. Mythos is niet aangeroepen.
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
"anthropic/claude-fable-5.1",
"anthropic/claude-fable-5",
"anthropic/claude-opus-5",
# claude-mythos-5-1: not listed / Glasswing only
]Welke Claude Fable 5.1-benchmarks zijn echt verschoven?
Terminal-Bench-Science 0.1 is de sprong: 52.6% op Fable 5.1 versus 24.7% op Fable 5.
Fable 5 zat op 24.7% en Opus 5 op 29.0%. Die sprong is waarom agentic coding-loops zwaarder wegen dan onze 14 korte calls.
| Bench | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22,4% |
| Terminal-Bench 4.0 | 55.8% (Mythos 5.1: 60.9%) | 42,0% | 52,3% | 37,3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial / strict | 77,9% / 41,7% | 72,9% / 36,1% | 75,4% / 39,6% | n.v.t. |
| HLE no tools / with tools | 60.9% / 65,0% | 57,8% / 63,8% | 56,6% / 63,6% | n.v.t. |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
Bron: Anthropic aankondiging, 2026-09-01.
| Bron | Bevinding | Scope |
|---|---|---|
| Artificial Analysis, 2026-09-01 | Intelligence Index 66 op max | Fable 5 max 62; Opus 5 max 63 |
| Artificial Analysis | $3.76 / taak vs Fable 5 $3.14 (+20%) | ~1,7× output; ~$5.16 zonder de korting; xhigh 65 bij $2.72 |
| Snorkel, 2026-09-01 | 58% minder tokens, 36% sneller | vs alleen Opus 5-successes; 18 / 5 / 2 / 2; pass@1 61,5%; build/dep 18% vs 67% |
Snorkels 58% / 36% is vs Opus 5 op alleen geslaagde runs, niet vs Fable 5. Opus loste nog drie taken meer op (18 beide / 5 alleen Opus / 2 alleen Fable).
- Terminal-Bench-Science SE ±3,5-4,5 pts. Het publieke leaderboard (3 trials/taak, Claude Code-runner) rapporteert Opus 5 30,0% en Fable 5 21,4%; Anthropic's setup reproduceert 29.0% en 24.7%, beide binnen de ruis.
- OSWorld 2.0 is de taakrelease van de auteurs uit augustus 2026; Fable 5 en Opus 5 zijn onder dezelfde voorwaarden opnieuw gedraaid. Niet vergelijkbaar met oudere OSWorld-cijfers.
- Productiebeveiligingen stonden aan. Interventies scoorden als nul op OSWorld (beide Fables) en op AutomationBench (Fable 5). Andere cyber-taken vielen terug op Opus 4.8; biologie op Opus 5. Dat onderschat waarschijnlijk de reële capaciteit.
Staat de 25%-besparing van Claude Fable 5.1 op je factuur?
De cache-read-regel is 75% goedkoper; de hele korte follow-up was maar 21% goedkoper.
Anthropic's lanceerpost schat ~25% typisch en ~45% agentic besparing vs Fable 5. Beide vereisen dat cache reads domineren, en dat output tokens niet omhoogschieten. De docs-prijskaart: cache write $12.50 / $20, output $50, cache read $1.00 → $0.25 / MTok. Workload-kostenmodellen bepalen of die korting overleeft als je elders de tokenrekening snijdt.
| Scenario | Label | Fable 5 | Fable 5.1 | Delta |
|---|---|---|---|---|
| Rij A: 20-turn / ~1M (9,5M cache reads, writes $12.50, output $50) | lijstprijs-identiteit, niet onze meter | $72.00 ($9.50 cache) | $64.88 ($2.38 cache) | -9,9% |
| Rij B: Intelligence Index-taak | Artificial Analysis, 2026-09-01 | $3.14 | $3.76 (~$5.16 zonder de korting) | +20% op max (~1,7× output) |
| Rij C: 1,165-token prefix, turn 2 | Techsy OpenRouter, 2026-09-02 | $0.005086 | $0.00402125 | hele turn 21% goedkoper |
| Turn-2-regel (factuur, onze meter) | Fable 5.1 | Fable 5 |
|---|---|---|
| Cached input tokens | 1,165 | 1,166 |
| Cache-read-regel | $0.000291 | $0.001166 |
OpenRouter usage.cost | $0.00402125 | $0.005086 |
De cache-read-regel is 75.0% goedkoper ($0.000291 vs $0.001166). Besparing over de hele turn stopt bij 21% omdat output nog steeds $50/M factureert. Schaal de cache-regel op naar 40 herrereads × 200.000 tokens: $2.00 op 5.1 vs $8.00 op 5.
AY Automate vroeg op 2026-09-01 “Is Claude Fable 5.1 more expensive than Fable 5?” en antwoordde “No.” De lijstprijs is ongewijzigd $10/$50. De factuur niet: Artificial Analysis mat +20% op max, THE DECODER actualiseerde diezelfde dag met die +20%, en onze 14 uncached calls factureerden 1.11×.
HN-gebruiker george_max (item 49525611, 2026-09-01) noemde het “just cache reads” en “15% more,” passend bij AA op max effort. Abonnement-ramen van 5 uur prijzen cache reads niet zoals de API.
Eén quiz, geen bench: het turn-2-cacheantwoord van Fable 5 gebruikte $2.00 / $2.50 (5.1-prijzen) op een prompt die zei “on this model.”
Wat onze OpenRouter-meter liet zien voor Claude Fable 5.1
Alle drie de modellen scoorden 14/14 bij effort=low; Opus 5 was 45% goedkoper dan Fable 5.1.
We benchmarkten 14 prompts. Nauwkeurigheid gelijk; Opus 5 won nog steeds op $5/$25 vs $10/$50.
- Wanneer: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Publieke tarieven op de Fable 5.1-modelpagina.
- Wat:
anthropic/claude-fable-5.1vsanthropic/claude-fable-5vsanthropic/claude-opus-5. - Hoe:
reasoning.effort=lowbehalve drie Fable 5.1 High coding-calls. Geentemperature(5.1 weigert non-default sampling). - Graders: JSON-schema, exacte numerieke match, uitgevoerde unit tests. Artefacten:
fable_bench.py,benchmark-raw.json,benchmark-aggregate.json. We testten de drie slugs in onze benchmark: 49 calls, $0.53795.
| Metric (14 calls, effort=low) | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Taken geslaagd | 14/14 | 14/14 | 14/14 |
| Mediane latency | 5.647 s | 5.383 s | 4.797 s |
| Mediane completion tokens | 94 | 90 | 103 |
| Mediane reasoning tokens | 0 | 8 | 23 |
| Totale completion tokens | 2,547 | 2,271 | 2,843 |
| Totale reasoning tokens | 0 | 253 | 380 |
| Totale kosten | $0.14693 | $0.13285 | $0.080725 |
Coding slaagde 6/6 elk op low.
| Task (2 trials) | Fable 5.1 out | Fable 5 out | Opus 5 out |
|---|---|---|---|
merge_intervals | 175, 168 | 96, 96 | 155, 155 |
semver_satisfies | 414, 411 | 405, 401 | 493, 487 |
lru_ttl_cache | 387, 418 | 395, 339 | 469, 459 |
| Coding mediane latency | 6,523 s | 5,389 s | 6,316 s |
| Coding totale kosten | $0.11095 | $0.09878 | $0.06154 |
Behandel Anthropic's “more concise in plans and summaries” als een claim over agent-traces, niet over single-shot function dumps. Fable 5.1 besteedde ~175 tokens aan merge_intervals waar Fable 5 96 gebruikte, beide geslaagd.
Wat dit niet meet:
- Mythos 5.1 (niet aanroepbaar vanaf dit account).
- Multi-uur agents, Terminal-Bench, SWE-bench, computer use.
- Standaard effort (we pinnten
lowbehalve ronde 3). - Cache writes op 5-minuten vs 1-uur TTL.
- Weigeringen, fallback naar Opus, tool-loop batching.
Welke drie requests geven 400 op Fable 5.1?
Gedwongen tool_choice van type any of tool geeft HTTP 400 op claude-fable-5-1.
What's new in Fable 5.1 noemt de fout: tool_choice: type "tool" and "any" are not supported for this model. Prefill van de assistant-turn is ook 400. Non-default temperature / top_p / top_k is ook 400; wij stuurden om die reden geen temperature. Thinking-blocks binden aan het producerende model (thinking-binding-controls-2026-08-01): 5.1 leest eerdere blocks, eerdere modellen kunnen die van 5.1 niet lezen, en een router-fallback gooit ze weg. Iets bewerken vóór een 5.1 thinking-block geeft een fout of gooit het weg voor accounts aangemaakt op/na 2026-08-31. Mythos 5.1 slaat die prefix-check over.
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
"model": "anthropic/claude-fable-5.1",
"messages": [{"role": "user", "content": "Look up the cache rate."}],
"tools": [{"type": "function", "function": {"name": "lookup"}}],
"tool_choice": {"type": "tool", "name": "lookup"}, # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.- Zet
tool_choiceopautoenstrict: trueop het tool-schema, of schakel over op structured outputs. - Houd history append-only; bewerk nooit een prefix vóór een 5.1 thinking-block.
- Gooi thinking-blocks weg wanneer je terugvalt op een eerder model.
- Laat
temperature/top_p/top_kweg, en prefill de assistant-turn niet.
Waarom zet Claude Code Fable 5.1 standaard op High?
Claude Code zet Fable 5.1 standaard op High; op lru_ttl_cache vermenigvuldigde dat een taak die al op Low slaagde met 4×.
Anthropic's aankondiging zet High in Claude Code en Medium op claude.ai / Cowork. Vijf effort-niveaus: low / medium / high / xhigh / max. Thinking staat altijd aan; thinking: disabled is 400. Het Help Center vereist Claude Code 2.1.250 of later.
| Task | Low (out / reason / cost) | High (out / reason / cost / latency) |
|---|---|---|
merge_intervals | 172 / 0 / $0.010 | 175 / 0 / $0.01024 / 4,86 s |
semver_satisfies | 413 / 0 / $0.023 | 401 / 0 / $0.02238 / 7,60 s |
lru_ttl_cache | 403 / 0 / $0.022 | 1,713 / 1,150 / $0.08798 / 22.07 s |
merge_intervals en semver_satisfies leken op Low. lru_ttl_cache niet. High besteedde 4,25× de completion tokens (1,713 vs 403), voegde 1,150 reasoning tokens toe, duurde 22.07 s vs ~7 s, en kostte een 4.0× factuur ($0.08798 vs $0.022) voor tests die we al hadden. Pin effort=low (of Medium op claude.ai) voor begrensde functies.
Simon Willison (2026-09-01, niet onze pelican): effort kan niet uit; max was 33× de output van low op één prompt.
Blijf je op Fable 5, blijf je op Opus 5, of stap je over?
Blijf op Opus 5 voor begrensd single-shot werk; verplaats cache-zware agents naar Fable 5.1.
De docs zeggen: begin met Opus 5 en grijp naar Fable 5.1 wanneer High-effort evals nog tekortschieten. Onze eval is de 14/14-meter: Opus 5 op $0.0807 vs $0.1469 (45% goedkoper). Schakel Fable 5 niet om naar 5.1 voor korte uncached calls: 14/14 beide, 5.1 kostte hier 1.11× meer.
| Regel | Flip als | Factuur (onze meter) |
|---|---|---|
| Blijf op Opus 5 voor begrensd single-shot | High-effort evals missen nog lange agent-sessies | $0.080725, 14/14, 45% goedkoper dan $0.14693 |
| Verplaats cache-zware agents naar Fable 5.1 | de sessie herleest nooit een groot prefix | 75.0% goedkopere cache-read-regel ($0.000291 vs $0.001166) |
| Laat Claude Code niet op standaard High voor taken die al op Low slagen | de job is een Terminal-Bench-Science-achtige loop | 4.0× op lru_ttl_cache ($0.08798 vs $0.022) |
| Schakel Fable 5 → 5.1 niet om voor korte uncached calls | je hebt de Science-sprong of de $0.25 cache read nodig | 1.11× ($0.14693 vs $0.13285), 14/14 beide |
Fable 5.1 factureerde $0.14693 (1.11×) op uncached 14/14; de winst zit in de cache-read-regel. Fable 5 factureerde $0.13285 tot een 1,165-token prefix opnieuw wordt gelezen. Opus 5 factureerde $0.080725, 45% goedkoper, met meer tokens (2,843 vs 2,547).
- Fable 5 vs Opus 4.8 staat op de juni-lanceerpost.
- Claude Opus 5 beheert de Opus-lijnprijzen.
- 5.1 is de point-release die die post voorspelde; Fable 6 is nog niet aangekondigd.
- Exportcontrol-Q&A voor de oudere Fable 5-terugtrekking.
- Token-efficiency als ranking-ruggengraat staat op Grok 4.6.
- Routeer Opus vs Fable in productie.
Begrensd single-shot werk blijft op Opus 5. Cache-zware agents gaan naar Fable 5.1 voor de $0.25 cache-read-regel, met effort gepind op Low wanneer tests al slagen. Korte uncached Fable 5-calls blijven staan.
Veelgestelde vragen
Wat is de Claude Fable 5.1 API-ID?
claude-fable-5-1 op de Anthropic API, anthropic.claude-fable-5-1 op Bedrock, en anthropic/claude-fable-5.1 op OpenRouter. Vertex, Foundry en Claude Platform houden claude-fable-5-1. Mythos is claude-mythos-5-1, alleen Glasswing; het is geen OpenRouter-model dat je kunt intypen, en we hebben het op 2026-09-02 niet aangeroepen.
Geldt de cache-read-korting ook voor Claude Code Max-quota's?
Nee. De 75%-korting is een API-cache-readprijs ($1.00 → $0.25 / MTok). Abonnement-ramen van 5 uur factureren cache reads niet zo, dus de typische 25%-besparing rekt Max-quota's niet op. r/ClaudeCode (2026-09-01) meldde dat het 5-uursraam in 20 minuten opbrandde nadat de High-default landde.
Welke Claude Code-versie heeft Fable 5.1 nodig?
2.1.250 of later, volgens het Help Center op 2026-09-01. Fable 5 was 2.1.170+. Oudere builds missen de nieuwe ID, de High-default die onze LRU-taak 4.0×'de, en de effort-picker die 5.1 verwacht. Upgrade voordat je verkeer ernaartoe stuurt.
Is Fable 6 de volgende?
5.1 is de point-release die die post voorspelde. Fable 6 is nog niet aangekondigd. Polymarket-threads die om een 5.1-datum vroegen zijn verouderd: GA was 2026-09-01, en de aankondiging noemt geen Fable 6-kalender. Stel een 5 vs 5.1-switch niet uit in afwachting ervan.
Is Claude Fable 5.1 een Covered Model?
Ja. 30 dagen dataretentie. Niet beschikbaar onder zero data retention tenzij uitdrukkelijk geautoriseerd. Enterprise Frontier Safeguards (opslag in de klantcloud) rollen later dit najaar uit; in aanmerking komende klanten kunnen tot die tijd ZDR gebruiken. Een statistisch tekstwatermerk vaart op alle platforms (EU AI Act, modellen na 2026-08-02); de detection API zit in private preview.