ai-machine-learning

Claude Fable 5.1 Review: Gemeten tegen Fable 5 en Opus 5

Geschreven door Mert Batur
Sep 2, 2026
9 leestijd
Claude Fable 5.1 Review: Gemeten tegen Fable 5 en Opus 5

Claude Fable 5.1 Review: Gemeten tegen Fable 5 en Opus 5

Claude Fable 5.1 verscheen op 2026-09-01 tegen dezelfde $10/$50 als Fable 5, met cache reads verlaagd naar $0.25. De ochtend erna, 08:55 UTC, draaiden we 14 matched OpenRouter-taken. De 45% agentic besparing stond niet op die factuur: alle drie de modellen scoorden 14/14, en 5.1 factureerde $0.14693 tegenover Opus 5 op $0.080725.

Anthropic's algemeen beschikbare frontier-ID is claude-fable-5-1, GA 2026-09-01, $10/$50 per miljoen tokens, cache read $0.25. Mythos 5.1 zijn dezelfde gewichten met andere (lossere cyber/bio) beveiligingen, alleen Glasswing. Knowledge cutoff jun 2026. Thinking staat altijd aan.

Claude Fable 5.1 vs Fable 5 vs Opus 5: de overschakeltabel

Blijf op Opus 5 voor deze 14-takenset; Fable 5.1 evenaarde de nauwkeurigheid en kostte 1.11× Fable 5.

We riepen anthropic/claude-fable-5.1 aan de ochtend na GA. De prijslijst bewoog niet: $10/$50, hetzelfde als Fable 5. Claude Opus 5 staat op $5/$25. Cache read is de enige lijstprijswijziging ($0.25 vs $1.00), en die vuurde hier niet.

Opus 5 is 45% goedkoper dan Fable 5.1 op deze 14-takenset omdat de lijstprijs $5/$25 vs $10/$50 is, niet omdat het minder tokens gebruikte.

Fable 5.1Fable 5Opus 5
Lijst $ in/out$10/$50$10/$50$5/$25
Cache read$0.25 / MTok$1.00 / MTokn.v.t.
Standaard effortHigh in Claude Code; Medium op claude.ai / Coworkn.v.t.High
Vendor-kopTerminal-Bench-Science 52.6%24.7%29.0%
Factuur (onze meter)$0.14693, 14/14$0.13285, 14/14$0.080725, 14/14
Overschakelencache-zware agentskorte uncached callsbegrensde single-shot

Dezelfde gewichten, twee deuren, en één ervan antwoordt niet

Mythos 5.1 zijn dezelfde gewichten met lossere cyber/bio-beveiligingen, en het staat niet op OpenRouter.

Anthropic's lanceerzin is letterlijk: “Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards.” Fable is GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos is claude-mythos-5-1 achter Project Glasswing / CVP / LSVP, momenteel een set Amerikaanse organisaties. 1M context, 128k max output, cutoff jun 2026 vs jan 2026 van Fable 5. Ons experiment kostte $0.53795. Mythos is niet aangeroepen.

python
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
    "anthropic/claude-fable-5.1",
    "anthropic/claude-fable-5",
    "anthropic/claude-opus-5",
    # claude-mythos-5-1: not listed / Glasswing only
]

Welke Claude Fable 5.1-benchmarks zijn echt verschoven?

Terminal-Bench-Science 0.1 is de sprong: 52.6% op Fable 5.1 versus 24.7% op Fable 5.

Fable 5 zat op 24.7% en Opus 5 op 29.0%. Die sprong is waarom agentic coding-loops zwaarder wegen dan onze 14 korte calls.

BenchFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22,4%
Terminal-Bench 4.055.8% (Mythos 5.1: 60.9%)42,0%52,3%37,3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial / strict77,9% / 41,7%72,9% / 36,1%75,4% / 39,6%n.v.t.
HLE no tools / with tools60.9% / 65,0%57,8% / 63,8%56,6% / 63,6%n.v.t.
AutomationBench31,4%17,1%26,9%19,6%
CursorBench 3.2.073,4%70,5%70,0%67,2%

Bron: Anthropic aankondiging, 2026-09-01.

BronBevindingScope
Artificial Analysis, 2026-09-01Intelligence Index 66 op maxFable 5 max 62; Opus 5 max 63
Artificial Analysis$3.76 / taak vs Fable 5 $3.14 (+20%)~1,7× output; ~$5.16 zonder de korting; xhigh 65 bij $2.72
Snorkel, 2026-09-0158% minder tokens, 36% snellervs alleen Opus 5-successes; 18 / 5 / 2 / 2; pass@1 61,5%; build/dep 18% vs 67%

Snorkels 58% / 36% is vs Opus 5 op alleen geslaagde runs, niet vs Fable 5. Opus loste nog drie taken meer op (18 beide / 5 alleen Opus / 2 alleen Fable).

  1. Terminal-Bench-Science SE ±3,5-4,5 pts. Het publieke leaderboard (3 trials/taak, Claude Code-runner) rapporteert Opus 5 30,0% en Fable 5 21,4%; Anthropic's setup reproduceert 29.0% en 24.7%, beide binnen de ruis.
  2. OSWorld 2.0 is de taakrelease van de auteurs uit augustus 2026; Fable 5 en Opus 5 zijn onder dezelfde voorwaarden opnieuw gedraaid. Niet vergelijkbaar met oudere OSWorld-cijfers.
  3. Productiebeveiligingen stonden aan. Interventies scoorden als nul op OSWorld (beide Fables) en op AutomationBench (Fable 5). Andere cyber-taken vielen terug op Opus 4.8; biologie op Opus 5. Dat onderschat waarschijnlijk de reële capaciteit.

Staat de 25%-besparing van Claude Fable 5.1 op je factuur?

De cache-read-regel is 75% goedkoper; de hele korte follow-up was maar 21% goedkoper.

Anthropic's lanceerpost schat ~25% typisch en ~45% agentic besparing vs Fable 5. Beide vereisen dat cache reads domineren, en dat output tokens niet omhoogschieten. De docs-prijskaart: cache write $12.50 / $20, output $50, cache read $1.00 → $0.25 / MTok. Workload-kostenmodellen bepalen of die korting overleeft als je elders de tokenrekening snijdt.

ScenarioLabelFable 5Fable 5.1Delta
Rij A: 20-turn / ~1M (9,5M cache reads, writes $12.50, output $50)lijstprijs-identiteit, niet onze meter$72.00 ($9.50 cache)$64.88 ($2.38 cache)-9,9%
Rij B: Intelligence Index-taakArtificial Analysis, 2026-09-01$3.14$3.76 (~$5.16 zonder de korting)+20% op max (~1,7× output)
Rij C: 1,165-token prefix, turn 2Techsy OpenRouter, 2026-09-02$0.005086$0.00402125hele turn 21% goedkoper
Turn-2-regel (factuur, onze meter)Fable 5.1Fable 5
Cached input tokens1,1651,166
Cache-read-regel$0.000291$0.001166
OpenRouter usage.cost$0.00402125$0.005086

De cache-read-regel is 75.0% goedkoper ($0.000291 vs $0.001166). Besparing over de hele turn stopt bij 21% omdat output nog steeds $50/M factureert. Schaal de cache-regel op naar 40 herrereads × 200.000 tokens: $2.00 op 5.1 vs $8.00 op 5.

AY Automate vroeg op 2026-09-01 “Is Claude Fable 5.1 more expensive than Fable 5?” en antwoordde “No.” De lijstprijs is ongewijzigd $10/$50. De factuur niet: Artificial Analysis mat +20% op max, THE DECODER actualiseerde diezelfde dag met die +20%, en onze 14 uncached calls factureerden 1.11×.

HN-gebruiker george_max (item 49525611, 2026-09-01) noemde het “just cache reads” en “15% more,” passend bij AA op max effort. Abonnement-ramen van 5 uur prijzen cache reads niet zoals de API.

Eén quiz, geen bench: het turn-2-cacheantwoord van Fable 5 gebruikte $2.00 / $2.50 (5.1-prijzen) op een prompt die zei “on this model.”

Wat onze OpenRouter-meter liet zien voor Claude Fable 5.1

Alle drie de modellen scoorden 14/14 bij effort=low; Opus 5 was 45% goedkoper dan Fable 5.1.

We benchmarkten 14 prompts. Nauwkeurigheid gelijk; Opus 5 won nog steeds op $5/$25 vs $10/$50.

  1. Wanneer: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Publieke tarieven op de Fable 5.1-modelpagina.
  2. Wat: anthropic/claude-fable-5.1 vs anthropic/claude-fable-5 vs anthropic/claude-opus-5.
  3. Hoe: reasoning.effort=low behalve drie Fable 5.1 High coding-calls. Geen temperature (5.1 weigert non-default sampling).
  4. Graders: JSON-schema, exacte numerieke match, uitgevoerde unit tests. Artefacten: fable_bench.py, benchmark-raw.json, benchmark-aggregate.json. We testten de drie slugs in onze benchmark: 49 calls, $0.53795.
Metric (14 calls, effort=low)Fable 5.1Fable 5Opus 5
Taken geslaagd14/1414/1414/14
Mediane latency5.647 s5.383 s4.797 s
Mediane completion tokens9490103
Mediane reasoning tokens0823
Totale completion tokens2,5472,2712,843
Totale reasoning tokens0253380
Totale kosten$0.14693$0.13285$0.080725

Coding slaagde 6/6 elk op low.

Task (2 trials)Fable 5.1 outFable 5 outOpus 5 out
merge_intervals175, 16896, 96155, 155
semver_satisfies414, 411405, 401493, 487
lru_ttl_cache387, 418395, 339469, 459
Coding mediane latency6,523 s5,389 s6,316 s
Coding totale kosten$0.11095$0.09878$0.06154

Behandel Anthropic's “more concise in plans and summaries” als een claim over agent-traces, niet over single-shot function dumps. Fable 5.1 besteedde ~175 tokens aan merge_intervals waar Fable 5 96 gebruikte, beide geslaagd.

Wat dit niet meet:

  • Mythos 5.1 (niet aanroepbaar vanaf dit account).
  • Multi-uur agents, Terminal-Bench, SWE-bench, computer use.
  • Standaard effort (we pinnten low behalve ronde 3).
  • Cache writes op 5-minuten vs 1-uur TTL.
  • Weigeringen, fallback naar Opus, tool-loop batching.

Welke drie requests geven 400 op Fable 5.1?

Gedwongen tool_choice van type any of tool geeft HTTP 400 op claude-fable-5-1.

What's new in Fable 5.1 noemt de fout: tool_choice: type "tool" and "any" are not supported for this model. Prefill van de assistant-turn is ook 400. Non-default temperature / top_p / top_k is ook 400; wij stuurden om die reden geen temperature. Thinking-blocks binden aan het producerende model (thinking-binding-controls-2026-08-01): 5.1 leest eerdere blocks, eerdere modellen kunnen die van 5.1 niet lezen, en een router-fallback gooit ze weg. Iets bewerken vóór een 5.1 thinking-block geeft een fout of gooit het weg voor accounts aangemaakt op/na 2026-08-31. Mythos 5.1 slaat die prefix-check over.

python
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
    "model": "anthropic/claude-fable-5.1",
    "messages": [{"role": "user", "content": "Look up the cache rate."}],
    "tools": [{"type": "function", "function": {"name": "lookup"}}],
    "tool_choice": {"type": "tool", "name": "lookup"},  # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.
  1. Zet tool_choice op auto en strict: true op het tool-schema, of schakel over op structured outputs.
  2. Houd history append-only; bewerk nooit een prefix vóór een 5.1 thinking-block.
  3. Gooi thinking-blocks weg wanneer je terugvalt op een eerder model.
  4. Laat temperature / top_p / top_k weg, en prefill de assistant-turn niet.

Waarom zet Claude Code Fable 5.1 standaard op High?

Claude Code zet Fable 5.1 standaard op High; op lru_ttl_cache vermenigvuldigde dat een taak die al op Low slaagde met 4×.

Anthropic's aankondiging zet High in Claude Code en Medium op claude.ai / Cowork. Vijf effort-niveaus: low / medium / high / xhigh / max. Thinking staat altijd aan; thinking: disabled is 400. Het Help Center vereist Claude Code 2.1.250 of later.

TaskLow (out / reason / cost)High (out / reason / cost / latency)
merge_intervals172 / 0 / $0.010175 / 0 / $0.01024 / 4,86 s
semver_satisfies413 / 0 / $0.023401 / 0 / $0.02238 / 7,60 s
lru_ttl_cache403 / 0 / $0.0221,713 / 1,150 / $0.08798 / 22.07 s

merge_intervals en semver_satisfies leken op Low. lru_ttl_cache niet. High besteedde 4,25× de completion tokens (1,713 vs 403), voegde 1,150 reasoning tokens toe, duurde 22.07 s vs ~7 s, en kostte een 4.0× factuur ($0.08798 vs $0.022) voor tests die we al hadden. Pin effort=low (of Medium op claude.ai) voor begrensde functies.

Simon Willison (2026-09-01, niet onze pelican): effort kan niet uit; max was 33× de output van low op één prompt.

Blijf je op Fable 5, blijf je op Opus 5, of stap je over?

Blijf op Opus 5 voor begrensd single-shot werk; verplaats cache-zware agents naar Fable 5.1.

De docs zeggen: begin met Opus 5 en grijp naar Fable 5.1 wanneer High-effort evals nog tekortschieten. Onze eval is de 14/14-meter: Opus 5 op $0.0807 vs $0.1469 (45% goedkoper). Schakel Fable 5 niet om naar 5.1 voor korte uncached calls: 14/14 beide, 5.1 kostte hier 1.11× meer.

RegelFlip alsFactuur (onze meter)
Blijf op Opus 5 voor begrensd single-shotHigh-effort evals missen nog lange agent-sessies$0.080725, 14/14, 45% goedkoper dan $0.14693
Verplaats cache-zware agents naar Fable 5.1de sessie herleest nooit een groot prefix75.0% goedkopere cache-read-regel ($0.000291 vs $0.001166)
Laat Claude Code niet op standaard High voor taken die al op Low slagende job is een Terminal-Bench-Science-achtige loop4.0× op lru_ttl_cache ($0.08798 vs $0.022)
Schakel Fable 5 → 5.1 niet om voor korte uncached callsje hebt de Science-sprong of de $0.25 cache read nodig1.11× ($0.14693 vs $0.13285), 14/14 beide

Fable 5.1 factureerde $0.14693 (1.11×) op uncached 14/14; de winst zit in de cache-read-regel. Fable 5 factureerde $0.13285 tot een 1,165-token prefix opnieuw wordt gelezen. Opus 5 factureerde $0.080725, 45% goedkoper, met meer tokens (2,843 vs 2,547).

Begrensd single-shot werk blijft op Opus 5. Cache-zware agents gaan naar Fable 5.1 voor de $0.25 cache-read-regel, met effort gepind op Low wanneer tests al slagen. Korte uncached Fable 5-calls blijven staan.

Veelgestelde vragen

Wat is de Claude Fable 5.1 API-ID?

claude-fable-5-1 op de Anthropic API, anthropic.claude-fable-5-1 op Bedrock, en anthropic/claude-fable-5.1 op OpenRouter. Vertex, Foundry en Claude Platform houden claude-fable-5-1. Mythos is claude-mythos-5-1, alleen Glasswing; het is geen OpenRouter-model dat je kunt intypen, en we hebben het op 2026-09-02 niet aangeroepen.

Geldt de cache-read-korting ook voor Claude Code Max-quota's?

Nee. De 75%-korting is een API-cache-readprijs ($1.00 → $0.25 / MTok). Abonnement-ramen van 5 uur factureren cache reads niet zo, dus de typische 25%-besparing rekt Max-quota's niet op. r/ClaudeCode (2026-09-01) meldde dat het 5-uursraam in 20 minuten opbrandde nadat de High-default landde.

Welke Claude Code-versie heeft Fable 5.1 nodig?

2.1.250 of later, volgens het Help Center op 2026-09-01. Fable 5 was 2.1.170+. Oudere builds missen de nieuwe ID, de High-default die onze LRU-taak 4.0×'de, en de effort-picker die 5.1 verwacht. Upgrade voordat je verkeer ernaartoe stuurt.

Is Fable 6 de volgende?

5.1 is de point-release die die post voorspelde. Fable 6 is nog niet aangekondigd. Polymarket-threads die om een 5.1-datum vroegen zijn verouderd: GA was 2026-09-01, en de aankondiging noemt geen Fable 6-kalender. Stel een 5 vs 5.1-switch niet uit in afwachting ervan.

Is Claude Fable 5.1 een Covered Model?

Ja. 30 dagen dataretentie. Niet beschikbaar onder zero data retention tenzij uitdrukkelijk geautoriseerd. Enterprise Frontier Safeguards (opslag in de klantcloud) rollen later dit najaar uit; in aanmerking komende klanten kunnen tot die tijd ZDR gebruiken. Een statistisch tekstwatermerk vaart op alle platforms (EU AI Act, modellen na 2026-08-02); de detection API zit in private preview.

Tags

claude-fable-5-1claude-mythos-5-1prompt-cachingclaude-opus-5openrouter

Dit artikel delen

Start je project

Klaar om iets buitengewoons te bouwen?

Laten we je idee werkelijkheid maken. Ons team staat klaar om software te bouwen die het verschil maakt.