
Claude Fable 5.1-recension: Vi mätte den mot Fable 5 och Opus 5
Claude Fable 5.1 släpptes 2026-09-01 till samma $10/$50 som Fable 5, med cache-läsning ned till $0.25. Vi körde 14 matchade OpenRouter-uppgifter morgonen efter kl. 08:55 UTC. Den agentiska 45 %-besparingen fanns inte på den fakturan: alla tre modellerna klarade 14/14, och 5.1 debiterade $0.14693 mot Opus 5 på $0.080725.
Anthropics allmänt tillgängliga frontier-ID är claude-fable-5-1, GA 2026-09-01, $10/$50 per miljon tokens, cache-läsning $0.25. Mythos 5.1 är samma vikter med andra (lösare cyber/bio) skyddsmekanismer, bara Glasswing. Knowledge cutoff juni 2026. Thinking alltid på.
Claude Fable 5.1 vs Fable 5 vs Opus 5: växlingstabellen
Stanna på Opus 5 för den här 14-uppgiftsserien; Fable 5.1 matchade träffsäkerheten och kostade 1.11× Fable 5.
Vi anropade anthropic/claude-fable-5.1 morgonen efter GA. Listpriset rörde sig inte: $10/$50, samma som Fable 5. Claude Opus 5 ligger på $5/$25. Cache-läsning är den enda listprisändringen ($0.25 mot $1.00), och den triggades inte här.
Opus 5 är 45 % billigare än Fable 5.1 på den här 14-uppgiftsserien för att listpriset är $5/$25 mot $10/$50, inte för att den använde färre tokens.
| Fable 5.1 | Fable 5 | Opus 5 | |
|---|---|---|---|
| Listpris $ in/ut | $10/$50 | $10/$50 | $5/$25 |
| Cache-läsning | $0.25 / MTok | $1.00 / MTok | n/a |
| Standard-effort | High i Claude Code; Medium på claude.ai / Cowork | n/a | High |
| Leverantörsrubrik | Terminal-Bench-Science 52.6% | 24.7% | 29.0% |
| Faktura (vår mätning) | $0.14693, 14/14 | $0.13285, 14/14 | $0.080725, 14/14 |
| Byt till | cache-tunga agenter | korta anrop utan cache | avgränsade single-shot |
Samma vikter, två dörrar, och en av dem svarar inte
Mythos 5.1 är samma vikter med lösare cyber/bio-skydd, och den finns inte på OpenRouter.
Anthropics lanseringsmening är bokstavlig: ”Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards.” Fable är GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos är claude-mythos-5-1 bakom Project Glasswing / CVP / LSVP, just nu en uppsättning amerikanska organisationer. 1M kontext, 128k max output, cutoff juni 2026 mot Fable 5:s januari 2026. Vårt experiment kostade $0.53795. Mythos anropades inte.
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
"anthropic/claude-fable-5.1",
"anthropic/claude-fable-5",
"anthropic/claude-opus-5",
# claude-mythos-5-1: not listed / Glasswing only
]Vilka Claude Fable 5.1-bänkar flyttade sig egentligen?
Terminal-Bench-Science 0.1 är hoppet: 52.6% på Fable 5.1 mot 24.7% på Fable 5.
Fable 5 låg på 24.7% och Opus 5 på 29.0%. Hoppet är skälet till att agentisk kodning-loopar väger tyngre än våra 14 korta anrop.
| Bench | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% (Mythos 5.1: 60.9%) | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial / strict | 77.9% / 41.7% | 72.9% / 36.1% | 75.4% / 39.6% | n/a |
| HLE no tools / with tools | 60.9% / 65.0% | 57.8% / 63.8% | 56.6% / 63.6% | n/a |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
Källa: Anthropics announcement, 2026-09-01.
| Källa | Fynd | Omfattning |
|---|---|---|
| Artificial Analysis, 2026-09-01 | Intelligence Index 66 at max | Fable 5 max 62; Opus 5 max 63 |
| Artificial Analysis | $3.76 / task vs Fable 5 $3.14 (+20 %) | ~1,7× output; ~$5.16 utan sänkningen; xhigh 65 till $2.72 |
| Snorkel, 2026-09-01 | 58 % färre tokens, 36 % snabbare | vs bara Opus 5-lyckade körningar; 18 / 5 / 2 / 2; pass@1 61,5 %; build/dep 18 % vs 67 % |
Snorkels 58 % / 36 % är mot Opus 5 på bara lyckade körningar, inte mot Fable 5. Opus löste ändå tre uppgifter mer (18 båda / 5 bara Opus / 2 bara Fable).
- Terminal-Bench-Science SE ±3,5–4,5 pts. Den publika leaderboarden (3 trials/task, Claude Code-runner) rapporterar Opus 5 30,0 % och Fable 5 21,4 %; Anthropics setup återskapar 29.0% och 24.7%, båda inom brus.
- OSWorld 2.0 är författarnas augusti 2026-uppgiftsrelease; Fable 5 och Opus 5 kördes om under samma villkor. Inte jämförbart med äldre OSWorld-siffror.
- Produktionsskydd var på. Interventioner poängsattes som noll på OSWorld (båda Fables) och på AutomationBench (Fable 5). Andra cyberuppgifter föll tillbaka till Opus 4.8; biologi till Opus 5. Det underskattar troligen rå kapacitet.
Syns Claude Fable 5.1:s 25 %-besparing på din faktura?
Cache-läsningsraden är 75 % billigare; hela den korta uppföljningen blev bara 21 % billigare.
Anthropics lanseringsinlägg uppskattar ~25 % typisk och ~45 % agentisk besparing mot Fable 5. Båda kräver att cache-läsningar dominerar, och att output-tokens inte skenar. Docs rate card: cache write $12.50 / $20, output $50, cache-läsning $1.00 → $0.25 / MTok. Arbetsbelastningens kostnadsmodeller avgör om sänkningen överlever när du kapar tokenfakturan någon annanstans.
| Scenario | Etikett | Fable 5 | Fable 5.1 | Delta |
|---|---|---|---|---|
| Rad A: 20-turn / ~1M (9,5M cache-läsningar, writes $12.50, output $50) | listpris-identitet, inte vår mätning | $72.00 ($9.50 cache) | $64.88 ($2.38 cache) | −9,9 % |
| Rad B: Intelligence Index-uppgift | Artificial Analysis, 2026-09-01 | $3.14 | $3.76 (~$5.16 utan sänkningen) | +20 % at max (~1,7× output) |
| Rad C: 1,165-token-prefix, turn 2 | Techsy OpenRouter, 2026-09-02 | $0.005086 | $0.00402125 | hela turnen 21 % billigare |
| Turn-2-rad (Faktura, vår mätning) | Fable 5.1 | Fable 5 |
|---|---|---|
| Cached input tokens | 1,165 | 1,166 |
| Cache-läsningsrad | $0.000291 | $0.001166 |
OpenRouter usage.cost | $0.00402125 | $0.005086 |
Cache-läsningsraden är 75.0% billigare ($0.000291 mot $0.001166). Helturn-besparingen stannar på 21 % eftersom output fortfarande debiteras till $50/M. Skala cache-raden till 40 omläsningar × 200 000 tokens: $2.00 på 5.1 mot $8.00 på 5.
AY Automate frågade ”Is Claude Fable 5.1 more expensive than Fable 5?” den 2026-09-01 och svarade ”No.” Listpriset är oförändrat på $10/$50. Fakturan är det inte: Artificial Analysis mätte +20 % at max, THE DECODER uppdaterade samma dag med den +20 %-siffran, och våra 14 anrop utan cache debiterade 1.11×.
HN-användaren george_max (item 49525611, 2026-09-01) kallade det ”just cache reads” och ”15% more,” vilket matchar AA at max effort. Prenumerationens 5-timmarsfönster prissätter inte cache-läsningar på API-sättet.
Ett quiz, ingen bänk: Fable 5:s turn-2-cachesvar använde $2.00 / $2.50 (5.1-priser) på en prompt som sa ”on this model.”
Vad vår OpenRouter-mätning visade på Claude Fable 5.1
Alla tre modellerna klarade 14/14 vid effort=low; Opus 5 var 45 % billigare än Fable 5.1.
Vi benchmarkade 14 prompts. Träffsäkerheten var lika; Opus 5 vann ändå på $5/$25 mot $10/$50.
- När: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Publika priser på Fable 5.1-modelsidan.
- Vad:
anthropic/claude-fable-5.1vsanthropic/claude-fable-5vsanthropic/claude-opus-5. - Hur:
reasoning.effort=lowutom tre Fable 5.1 High-kodningsanrop. Ingentemperature(5.1 avvisar icke-standard sampling). - Graders: JSON-schema, exakt numerisk match, körda enhetstester. Artefakter:
fable_bench.py,benchmark-raw.json,benchmark-aggregate.json. Vi testade de tre slugarna i vår bänk: 49 anrop, $0.53795.
| Mått (14 anrop, effort=low) | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Uppgifter godkända | 14/14 | 14/14 | 14/14 |
| Median latens | 5.647 s | 5.383 s | 4.797 s |
| Median completion tokens | 94 | 90 | 103 |
| Median reasoning tokens | 0 | 8 | 23 |
| Totala completion tokens | 2,547 | 2,271 | 2,843 |
| Totala reasoning tokens | 0 | 253 | 380 |
| Totalkostnad | $0.14693 | $0.13285 | $0.080725 |
Kodning klarade 6/6 vardera på low.
| Uppgift (2 trials) | Fable 5.1 ut | Fable 5 ut | Opus 5 ut |
|---|---|---|---|
merge_intervals | 175, 168 | 96, 96 | 155, 155 |
semver_satisfies | 414, 411 | 405, 401 | 493, 487 |
lru_ttl_cache | 387, 418 | 395, 339 | 469, 459 |
| Kodningsmedian latens | 6.523 s | 5.389 s | 6.316 s |
| Kodning totalkostnad | $0.11095 | $0.09878 | $0.06154 |
Behandla Anthropics ”more concise in plans and summaries” som ett påstående om agentspår, inte om single-shot-funktionsdumpar. Fable 5.1 spenderade ~175 tokens på merge_intervals där Fable 5 spenderade 96, båda godkända.
Vad det här inte mäter:
- Mythos 5.1 (inte anropbar från det här kontot).
- Flertimmarsagenter, Terminal-Bench, SWE-bench, computer use.
- Standard-effort (vi låste
lowutom runda 3). - Cache writes vid 5-minuters vs 1-timmes TTL.
- Avslag, fallback till Opus, tool-loop-batchning.
Vilka tre requests ger 400 på Fable 5.1?
Tvingad tool_choice av typ any eller tool ger HTTP 400 på claude-fable-5-1.
What's new in Fable 5.1 namnger felet: tool_choice: type "tool" and "any" are not supported for this model. Prefill av assistant-turen ger också 400. Icke-standard temperature / top_p / top_k ger också 400; vi skickade ingen temperature av just det skälet. Thinking-block binder till den producerande modellen (thinking-binding-controls-2026-08-01): 5.1 läser tidigare block, tidigare modeller kan inte läsa 5.1:s, och en router-fallback droppar dem. Att redigera något före ett 5.1-thinking-block ger fel eller droppar det för konton skapade 2026-08-31 eller senare. Mythos 5.1 hoppar över den prefixkontrollen.
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
"model": "anthropic/claude-fable-5.1",
"messages": [{"role": "user", "content": "Look up the cache rate."}],
"tools": [{"type": "function", "function": {"name": "lookup"}}],
"tool_choice": {"type": "tool", "name": "lookup"}, # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.- Sätt
tool_choicetillautoochstrict: truepå tool-schemat, eller byt till structured outputs. - Håll historiken append-only; redigera aldrig ett prefix framför ett 5.1-thinking-block.
- Droppa thinking-block när du faller tillbaka till en tidigare modell.
- Utelämna
temperature/top_p/top_k, och prefilla inte assistant-turen.
Varför sätter Claude Code Fable 5.1 till High som standard?
Claude Code sätter Fable 5.1 till High som standard; på lru_ttl_cache blev det 4× på en uppgift som redan klarade Low.
Anthropics announcement sätter High i Claude Code och Medium på claude.ai / Cowork. Fem effort-nivåer: low / medium / high / xhigh / max. Thinking är alltid på; thinking: disabled ger 400. Help Center kräver Claude Code 2.1.250 eller senare.
| Uppgift | Low (ut / reason / kostnad) | High (ut / reason / kostnad / latens) |
|---|---|---|
merge_intervals | 172 / 0 / $0.010 | 175 / 0 / $0.01024 / 4.86 s |
semver_satisfies | 413 / 0 / $0.023 | 401 / 0 / $0.02238 / 7.60 s |
lru_ttl_cache | 403 / 0 / $0.022 | 1,713 / 1,150 / $0.08798 / 22.07 s |
merge_intervals och semver_satisfies såg ut som Low. lru_ttl_cache gjorde det inte. High spenderade 4,25× completion-tokens (1,713 mot 403), lade till 1,150 reasoning tokens, tog 22.07 s mot ~7 s, och kostade en 4.0×-faktura ($0.08798 mot $0.022) för tester vi redan hade. Lås effort=low (eller Medium på claude.ai) för avgränsade funktioner.
Simon Willison (2026-09-01, inte vår pelican): effort kan inte stängas av; max gav 33× output jämfört med low på en prompt.
Ska du stanna på Fable 5, stanna på Opus 5, eller byta?
Stanna på Opus 5 för avgränsat single-shot-arbete; flytta cache-tunga agenter till Fable 5.1.
Docs säger att du ska börja med Opus 5 och ta Fable 5.1 när High-effort-evals fortfarande faller kort. Vår eval är 14/14-mätaren: Opus 5 på $0.0807 mot $0.1469 (45 % billigare). Byt inte Fable 5 till 5.1 för korta anrop utan cache: 14/14 båda, 5.1 kostade 1.11× mer här.
| Regel | Vänd om | Faktura (vår mätning) |
|---|---|---|
| Stanna på Opus 5 för avgränsat single-shot | High-effort-evals missar fortfarande långa agentsessioner | $0.080725, 14/14, 45 % billigare än $0.14693 |
| Flytta cache-tunga agenter till Fable 5.1 | sessionen aldrig omläser ett stort prefix | 75.0% billigare cache-läsningsrad ($0.000291 mot $0.001166) |
| Lämna inte Claude Code på standard-High för uppgifter som redan klarar Low | jobbet är en Terminal-Bench-Science-klassad loop | 4.0× på lru_ttl_cache ($0.08798 mot $0.022) |
| Byt inte Fable 5 → 5.1 för korta anrop utan cache | du behöver Science-hoppet eller $0.25-cache-läsningen | 1.11× ($0.14693 mot $0.13285), 14/14 båda |
Fable 5.1 debiterade $0.14693 (1.11×) på 14/14 utan cache; vinsten är cache-läsningsraden. Fable 5 debiterade $0.13285 tills ett 1,165-token-prefix omläses. Opus 5 debiterade $0.080725, 45 % billigare, med fler tokens (2,843 mot 2,547).
- Fable 5 vs Opus 4.8 ligger kvar på junilanseringsinlägget.
- Claude Opus 5 äger Opus-linjens prissättning.
- 5.1 är punktreleasen det inlägget förutspådde; Fable 6 är fortfarande otillkännagiven.
- Exportkontroll-Q&A för den äldre Fable 5-indragningen.
- Token-effektivitet som rankingryggrad ligger på Grok 4.6.
- Routa Opus vs Fable i produktion.
Avgränsat single-shot-arbete stannar på Opus 5. Cache-tunga agenter flyttar till Fable 5.1 för $0.25-cache-läsningsraden, med effort låst till Low när testerna redan klarar. Korta Fable 5-anrop utan cache stannar där de är.
Vanliga frågor
Vad är Claude Fable 5.1:s API-ID?
claude-fable-5-1 på Anthropic API, anthropic.claude-fable-5-1 på Bedrock, och anthropic/claude-fable-5.1 på OpenRouter. Vertex, Foundry och Claude Platform behåller claude-fable-5-1. Mythos är claude-mythos-5-1, bara Glasswing; det är inte en OpenRouter-modell du kan skriva in, och vi anropade den inte den 2026-09-02.
Gäller cache-läsningssänkningen Claude Code Max-kvoter?
Nej. Den 75 %-iga sänkningen är ett API-pris för cache-läsning ($1.00 → $0.25 / MTok). Prenumerationens 5-timmarsfönster debiterar inte cache-läsningar på det sättet, så den typiska 25 %-besparingen sträcker inte Max-kvoterna. r/ClaudeCode (2026-09-01) rapporterade att 5-timmarsfönstret brändes på 20 minuter efter att High-standarden landade.
Vilken Claude Code-version kräver Fable 5.1?
2.1.250 eller senare, enligt Help Center den 2026-09-01. Fable 5 var 2.1.170+. Äldre byggen missar det nya ID:t, High-standarden som 4.0×:ade vår LRU-uppgift, och effort-väljaren 5.1 förväntar sig. Uppgradera innan du pekar trafik dit.
Kommer Fable 6 härnäst?
5.1 är punktreleasen det inlägget förutspådde. Fable 6 är fortfarande otillkännagiven. Polymarket-trådar som frågar efter ett 5.1-datum är inaktuella: GA var 2026-09-01, och tillkännagivandet namnger ingen Fable 6-kalender. Parkera inte ett 5 vs 5.1-byte i väntan på den.
Är Claude Fable 5.1 en Covered Model?
Ja. 30 dagars dataretention. Inte tillgänglig under zero data retention om det inte uttryckligen godkänts. Enterprise Frontier Safeguards (kundmolnlagring) rullas ut senare i höst; berättigade kunder kan använda ZDR tills dess. En statistisk textvattenstämpel skeppas på alla plattformar (EU AI Act, modeller efter 2026-08-02); detection API:et är i private preview.