ai-machine-learning

Claude Fable 5.1-recension: Vi mätte den mot Fable 5 och Opus 5

Skriven av Mert Batur
Sep 2, 2026
8 läsning
Claude Fable 5.1-recension: Vi mätte den mot Fable 5 och Opus 5

Claude Fable 5.1-recension: Vi mätte den mot Fable 5 och Opus 5

Claude Fable 5.1 släpptes 2026-09-01 till samma $10/$50 som Fable 5, med cache-läsning ned till $0.25. Vi körde 14 matchade OpenRouter-uppgifter morgonen efter kl. 08:55 UTC. Den agentiska 45 %-besparingen fanns inte på den fakturan: alla tre modellerna klarade 14/14, och 5.1 debiterade $0.14693 mot Opus 5 på $0.080725.

Anthropics allmänt tillgängliga frontier-ID är claude-fable-5-1, GA 2026-09-01, $10/$50 per miljon tokens, cache-läsning $0.25. Mythos 5.1 är samma vikter med andra (lösare cyber/bio) skyddsmekanismer, bara Glasswing. Knowledge cutoff juni 2026. Thinking alltid på.

Claude Fable 5.1 vs Fable 5 vs Opus 5: växlingstabellen

Stanna på Opus 5 för den här 14-uppgiftsserien; Fable 5.1 matchade träffsäkerheten och kostade 1.11× Fable 5.

Vi anropade anthropic/claude-fable-5.1 morgonen efter GA. Listpriset rörde sig inte: $10/$50, samma som Fable 5. Claude Opus 5 ligger på $5/$25. Cache-läsning är den enda listprisändringen ($0.25 mot $1.00), och den triggades inte här.

Opus 5 är 45 % billigare än Fable 5.1 på den här 14-uppgiftsserien för att listpriset är $5/$25 mot $10/$50, inte för att den använde färre tokens.

Fable 5.1Fable 5Opus 5
Listpris $ in/ut$10/$50$10/$50$5/$25
Cache-läsning$0.25 / MTok$1.00 / MTokn/a
Standard-effortHigh i Claude Code; Medium på claude.ai / Coworkn/aHigh
LeverantörsrubrikTerminal-Bench-Science 52.6%24.7%29.0%
Faktura (vår mätning)$0.14693, 14/14$0.13285, 14/14$0.080725, 14/14
Byt tillcache-tunga agenterkorta anrop utan cacheavgränsade single-shot

Samma vikter, två dörrar, och en av dem svarar inte

Mythos 5.1 är samma vikter med lösare cyber/bio-skydd, och den finns inte på OpenRouter.

Anthropics lanseringsmening är bokstavlig: ”Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards.” Fable är GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos är claude-mythos-5-1 bakom Project Glasswing / CVP / LSVP, just nu en uppsättning amerikanska organisationer. 1M kontext, 128k max output, cutoff juni 2026 mot Fable 5:s januari 2026. Vårt experiment kostade $0.53795. Mythos anropades inte.

python
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
    "anthropic/claude-fable-5.1",
    "anthropic/claude-fable-5",
    "anthropic/claude-opus-5",
    # claude-mythos-5-1: not listed / Glasswing only
]

Vilka Claude Fable 5.1-bänkar flyttade sig egentligen?

Terminal-Bench-Science 0.1 är hoppet: 52.6% på Fable 5.1 mot 24.7% på Fable 5.

Fable 5 låg på 24.7% och Opus 5 på 29.0%. Hoppet är skälet till att agentisk kodning-loopar väger tyngre än våra 14 korta anrop.

BenchFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8% (Mythos 5.1: 60.9%)42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial / strict77.9% / 41.7%72.9% / 36.1%75.4% / 39.6%n/a
HLE no tools / with tools60.9% / 65.0%57.8% / 63.8%56.6% / 63.6%n/a
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Källa: Anthropics announcement, 2026-09-01.

KällaFyndOmfattning
Artificial Analysis, 2026-09-01Intelligence Index 66 at maxFable 5 max 62; Opus 5 max 63
Artificial Analysis$3.76 / task vs Fable 5 $3.14 (+20 %)~1,7× output; ~$5.16 utan sänkningen; xhigh 65 till $2.72
Snorkel, 2026-09-0158 % färre tokens, 36 % snabbarevs bara Opus 5-lyckade körningar; 18 / 5 / 2 / 2; pass@1 61,5 %; build/dep 18 % vs 67 %

Snorkels 58 % / 36 % är mot Opus 5 på bara lyckade körningar, inte mot Fable 5. Opus löste ändå tre uppgifter mer (18 båda / 5 bara Opus / 2 bara Fable).

  1. Terminal-Bench-Science SE ±3,5–4,5 pts. Den publika leaderboarden (3 trials/task, Claude Code-runner) rapporterar Opus 5 30,0 % och Fable 5 21,4 %; Anthropics setup återskapar 29.0% och 24.7%, båda inom brus.
  2. OSWorld 2.0 är författarnas augusti 2026-uppgiftsrelease; Fable 5 och Opus 5 kördes om under samma villkor. Inte jämförbart med äldre OSWorld-siffror.
  3. Produktionsskydd var på. Interventioner poängsattes som noll på OSWorld (båda Fables) och på AutomationBench (Fable 5). Andra cyberuppgifter föll tillbaka till Opus 4.8; biologi till Opus 5. Det underskattar troligen rå kapacitet.

Syns Claude Fable 5.1:s 25 %-besparing på din faktura?

Cache-läsningsraden är 75 % billigare; hela den korta uppföljningen blev bara 21 % billigare.

Anthropics lanseringsinlägg uppskattar ~25 % typisk och ~45 % agentisk besparing mot Fable 5. Båda kräver att cache-läsningar dominerar, och att output-tokens inte skenar. Docs rate card: cache write $12.50 / $20, output $50, cache-läsning $1.00 → $0.25 / MTok. Arbetsbelastningens kostnadsmodeller avgör om sänkningen överlever när du kapar tokenfakturan någon annanstans.

ScenarioEtikettFable 5Fable 5.1Delta
Rad A: 20-turn / ~1M (9,5M cache-läsningar, writes $12.50, output $50)listpris-identitet, inte vår mätning$72.00 ($9.50 cache)$64.88 ($2.38 cache)−9,9 %
Rad B: Intelligence Index-uppgiftArtificial Analysis, 2026-09-01$3.14$3.76 (~$5.16 utan sänkningen)+20 % at max (~1,7× output)
Rad C: 1,165-token-prefix, turn 2Techsy OpenRouter, 2026-09-02$0.005086$0.00402125hela turnen 21 % billigare
Turn-2-rad (Faktura, vår mätning)Fable 5.1Fable 5
Cached input tokens1,1651,166
Cache-läsningsrad$0.000291$0.001166
OpenRouter usage.cost$0.00402125$0.005086

Cache-läsningsraden är 75.0% billigare ($0.000291 mot $0.001166). Helturn-besparingen stannar på 21 % eftersom output fortfarande debiteras till $50/M. Skala cache-raden till 40 omläsningar × 200 000 tokens: $2.00 på 5.1 mot $8.00 på 5.

AY Automate frågade ”Is Claude Fable 5.1 more expensive than Fable 5?” den 2026-09-01 och svarade ”No.” Listpriset är oförändrat på $10/$50. Fakturan är det inte: Artificial Analysis mätte +20 % at max, THE DECODER uppdaterade samma dag med den +20 %-siffran, och våra 14 anrop utan cache debiterade 1.11×.

HN-användaren george_max (item 49525611, 2026-09-01) kallade det ”just cache reads” och ”15% more,” vilket matchar AA at max effort. Prenumerationens 5-timmarsfönster prissätter inte cache-läsningar på API-sättet.

Ett quiz, ingen bänk: Fable 5:s turn-2-cachesvar använde $2.00 / $2.50 (5.1-priser) på en prompt som sa ”on this model.”

Vad vår OpenRouter-mätning visade på Claude Fable 5.1

Alla tre modellerna klarade 14/14 vid effort=low; Opus 5 var 45 % billigare än Fable 5.1.

Vi benchmarkade 14 prompts. Träffsäkerheten var lika; Opus 5 vann ändå på $5/$25 mot $10/$50.

  1. När: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Publika priser på Fable 5.1-modelsidan.
  2. Vad: anthropic/claude-fable-5.1 vs anthropic/claude-fable-5 vs anthropic/claude-opus-5.
  3. Hur: reasoning.effort=low utom tre Fable 5.1 High-kodningsanrop. Ingen temperature (5.1 avvisar icke-standard sampling).
  4. Graders: JSON-schema, exakt numerisk match, körda enhetstester. Artefakter: fable_bench.py, benchmark-raw.json, benchmark-aggregate.json. Vi testade de tre slugarna i vår bänk: 49 anrop, $0.53795.
Mått (14 anrop, effort=low)Fable 5.1Fable 5Opus 5
Uppgifter godkända14/1414/1414/14
Median latens5.647 s5.383 s4.797 s
Median completion tokens9490103
Median reasoning tokens0823
Totala completion tokens2,5472,2712,843
Totala reasoning tokens0253380
Totalkostnad$0.14693$0.13285$0.080725

Kodning klarade 6/6 vardera på low.

Uppgift (2 trials)Fable 5.1 utFable 5 utOpus 5 ut
merge_intervals175, 16896, 96155, 155
semver_satisfies414, 411405, 401493, 487
lru_ttl_cache387, 418395, 339469, 459
Kodningsmedian latens6.523 s5.389 s6.316 s
Kodning totalkostnad$0.11095$0.09878$0.06154

Behandla Anthropics ”more concise in plans and summaries” som ett påstående om agentspår, inte om single-shot-funktionsdumpar. Fable 5.1 spenderade ~175 tokens på merge_intervals där Fable 5 spenderade 96, båda godkända.

Vad det här inte mäter:

  • Mythos 5.1 (inte anropbar från det här kontot).
  • Flertimmarsagenter, Terminal-Bench, SWE-bench, computer use.
  • Standard-effort (vi låste low utom runda 3).
  • Cache writes vid 5-minuters vs 1-timmes TTL.
  • Avslag, fallback till Opus, tool-loop-batchning.

Vilka tre requests ger 400 på Fable 5.1?

Tvingad tool_choice av typ any eller tool ger HTTP 400 på claude-fable-5-1.

What's new in Fable 5.1 namnger felet: tool_choice: type "tool" and "any" are not supported for this model. Prefill av assistant-turen ger också 400. Icke-standard temperature / top_p / top_k ger också 400; vi skickade ingen temperature av just det skälet. Thinking-block binder till den producerande modellen (thinking-binding-controls-2026-08-01): 5.1 läser tidigare block, tidigare modeller kan inte läsa 5.1:s, och en router-fallback droppar dem. Att redigera något före ett 5.1-thinking-block ger fel eller droppar det för konton skapade 2026-08-31 eller senare. Mythos 5.1 hoppar över den prefixkontrollen.

python
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
    "model": "anthropic/claude-fable-5.1",
    "messages": [{"role": "user", "content": "Look up the cache rate."}],
    "tools": [{"type": "function", "function": {"name": "lookup"}}],
    "tool_choice": {"type": "tool", "name": "lookup"},  # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.
  1. Sätt tool_choice till auto och strict: true på tool-schemat, eller byt till structured outputs.
  2. Håll historiken append-only; redigera aldrig ett prefix framför ett 5.1-thinking-block.
  3. Droppa thinking-block när du faller tillbaka till en tidigare modell.
  4. Utelämna temperature / top_p / top_k, och prefilla inte assistant-turen.

Varför sätter Claude Code Fable 5.1 till High som standard?

Claude Code sätter Fable 5.1 till High som standard; på lru_ttl_cache blev det 4× på en uppgift som redan klarade Low.

Anthropics announcement sätter High i Claude Code och Medium på claude.ai / Cowork. Fem effort-nivåer: low / medium / high / xhigh / max. Thinking är alltid på; thinking: disabled ger 400. Help Center kräver Claude Code 2.1.250 eller senare.

UppgiftLow (ut / reason / kostnad)High (ut / reason / kostnad / latens)
merge_intervals172 / 0 / $0.010175 / 0 / $0.01024 / 4.86 s
semver_satisfies413 / 0 / $0.023401 / 0 / $0.02238 / 7.60 s
lru_ttl_cache403 / 0 / $0.0221,713 / 1,150 / $0.08798 / 22.07 s

merge_intervals och semver_satisfies såg ut som Low. lru_ttl_cache gjorde det inte. High spenderade 4,25× completion-tokens (1,713 mot 403), lade till 1,150 reasoning tokens, tog 22.07 s mot ~7 s, och kostade en 4.0×-faktura ($0.08798 mot $0.022) för tester vi redan hade. Lås effort=low (eller Medium på claude.ai) för avgränsade funktioner.

Simon Willison (2026-09-01, inte vår pelican): effort kan inte stängas av; max gav 33× output jämfört med low på en prompt.

Ska du stanna på Fable 5, stanna på Opus 5, eller byta?

Stanna på Opus 5 för avgränsat single-shot-arbete; flytta cache-tunga agenter till Fable 5.1.

Docs säger att du ska börja med Opus 5 och ta Fable 5.1 när High-effort-evals fortfarande faller kort. Vår eval är 14/14-mätaren: Opus 5 på $0.0807 mot $0.1469 (45 % billigare). Byt inte Fable 5 till 5.1 för korta anrop utan cache: 14/14 båda, 5.1 kostade 1.11× mer här.

RegelVänd omFaktura (vår mätning)
Stanna på Opus 5 för avgränsat single-shotHigh-effort-evals missar fortfarande långa agentsessioner$0.080725, 14/14, 45 % billigare än $0.14693
Flytta cache-tunga agenter till Fable 5.1sessionen aldrig omläser ett stort prefix75.0% billigare cache-läsningsrad ($0.000291 mot $0.001166)
Lämna inte Claude Code på standard-High för uppgifter som redan klarar Lowjobbet är en Terminal-Bench-Science-klassad loop4.0×lru_ttl_cache ($0.08798 mot $0.022)
Byt inte Fable 5 → 5.1 för korta anrop utan cachedu behöver Science-hoppet eller $0.25-cache-läsningen1.11× ($0.14693 mot $0.13285), 14/14 båda

Fable 5.1 debiterade $0.14693 (1.11×) på 14/14 utan cache; vinsten är cache-läsningsraden. Fable 5 debiterade $0.13285 tills ett 1,165-token-prefix omläses. Opus 5 debiterade $0.080725, 45 % billigare, med fler tokens (2,843 mot 2,547).

Avgränsat single-shot-arbete stannar på Opus 5. Cache-tunga agenter flyttar till Fable 5.1 för $0.25-cache-läsningsraden, med effort låst till Low när testerna redan klarar. Korta Fable 5-anrop utan cache stannar där de är.

Vanliga frågor

Vad är Claude Fable 5.1:s API-ID?

claude-fable-5-1 på Anthropic API, anthropic.claude-fable-5-1 på Bedrock, och anthropic/claude-fable-5.1 på OpenRouter. Vertex, Foundry och Claude Platform behåller claude-fable-5-1. Mythos är claude-mythos-5-1, bara Glasswing; det är inte en OpenRouter-modell du kan skriva in, och vi anropade den inte den 2026-09-02.

Gäller cache-läsningssänkningen Claude Code Max-kvoter?

Nej. Den 75 %-iga sänkningen är ett API-pris för cache-läsning ($1.00 → $0.25 / MTok). Prenumerationens 5-timmarsfönster debiterar inte cache-läsningar på det sättet, så den typiska 25 %-besparingen sträcker inte Max-kvoterna. r/ClaudeCode (2026-09-01) rapporterade att 5-timmarsfönstret brändes på 20 minuter efter att High-standarden landade.

Vilken Claude Code-version kräver Fable 5.1?

2.1.250 eller senare, enligt Help Center den 2026-09-01. Fable 5 var 2.1.170+. Äldre byggen missar det nya ID:t, High-standarden som 4.0×:ade vår LRU-uppgift, och effort-väljaren 5.1 förväntar sig. Uppgradera innan du pekar trafik dit.

Kommer Fable 6 härnäst?

5.1 är punktreleasen det inlägget förutspådde. Fable 6 är fortfarande otillkännagiven. Polymarket-trådar som frågar efter ett 5.1-datum är inaktuella: GA var 2026-09-01, och tillkännagivandet namnger ingen Fable 6-kalender. Parkera inte ett 5 vs 5.1-byte i väntan på den.

Är Claude Fable 5.1 en Covered Model?

Ja. 30 dagars dataretention. Inte tillgänglig under zero data retention om det inte uttryckligen godkänts. Enterprise Frontier Safeguards (kundmolnlagring) rullas ut senare i höst; berättigade kunder kan använda ZDR tills dess. En statistisk textvattenstämpel skeppas på alla plattformar (EU AI Act, modeller efter 2026-08-02); detection API:et är i private preview.

Taggar

claude-fable-5-1claude-mythos-5-1prompt-cachningclaude-opus-5openrouter

Dela denna artikel

Starta ditt projekt

Redo att bygga något utöver det vanliga?

Låt oss göra verklighet av din idé. Vårt team hjälper dig gärna att bygga mjukvara som gör skillnad.