ai-machine-learning

Claude Fable 5.1-anmeldelse: vi målte den mot Fable 5 og Opus 5

Skrevet av Mert Batur
Sep 2, 2026
8 lesing
Claude Fable 5.1-anmeldelse: vi målte den mot Fable 5 og Opus 5

Claude Fable 5.1-anmeldelse: vi målte den mot Fable 5 og Opus 5

Claude Fable 5.1 kom 2026-09-01 til samme $10/$50 som Fable 5, med cache-read kuttet til $0.25. Vi kjørte 14 matchede OpenRouter-oppgaver neste morgen kl. 08:55 UTC. Den agentiske 45 %-besparelsen sto ikke på den fakturaen: alle tre modellene klarte 14/14, og 5.1 ble belastet $0.14693 mot Opus 5 på $0.080725.

Anthropics allment tilgjengelige frontier-ID er claude-fable-5-1, GA 2026-09-01, $10/$50 per million tokens, cache-read $0.25. Mythos 5.1 er samme vekter med andre (løsere cyber/bio) safeguards, bare Glasswing. Knowledge cutoff jun. 2026. Thinking alltid på.

Claude Fable 5.1 vs Fable 5 vs Opus 5: byttetabellen

Bli på Opus 5 for dette settet med 14 oppgaver; Fable 5.1 traff nøyaktigheten og kostet 1.11× Fable 5.

Vi kalte anthropic/claude-fable-5.1 morgenen etter GA. Listeprisen beveget seg ikke: $10/$50, samme som Fable 5. Claude Opus 5 er $5/$25. Cache-read er den eneste listeprisendringen ($0.25 vs $1.00), og den trigget ikke her.

Opus 5 er 45 % billigere enn Fable 5.1 på dette 14-oppgavesettet fordi listeprisen er $5/$25 mot $10/$50, ikke fordi den brukte færre tokens.

Fable 5.1Fable 5Opus 5
Liste $ inn/ut$10/$50$10/$50$5/$25
Cache-read$0.25 / MTok$1.00 / MTokn/a
Standard effortHigh i Claude Code; Medium på claude.ai / Coworkn/aHigh
Leverandørens overskriftTerminal-Bench-Science 52.6%24.7%29.0%
Faktura (vår måler)$0.14693, 14/14$0.13285, 14/14$0.080725, 14/14
Bytt tilcache-tunge agenterkorte kall uten cacheavgrenset single-shot

Samme vekter, to dører, og den ene svarer ikke

Mythos 5.1 er samme vekter med løsere cyber/bio-safeguards, og den ligger ikke på OpenRouter.

Anthropics lanseringssetning er bokstavelig: «Claude Fable 5.1 and Claude Mythos 5.1 are the same model, but with different levels of safeguards.» Fable er GA (claude-fable-5-1, Bedrock anthropic.claude-fable-5-1). Mythos er claude-mythos-5-1 bak Project Glasswing / CVP / LSVP, foreløpig et sett amerikanske organisasjoner. 1M kontekst, 128k maks output, cutoff jun. 2026 mot Fable 5s jan. 2026. Eksperimentet vårt kostet $0.53795. Mythos ble ikke kalt.

python
# OpenRouter slugs we actually sent on 2026-09-02
MODELS = [
    "anthropic/claude-fable-5.1",
    "anthropic/claude-fable-5",
    "anthropic/claude-opus-5",
    # claude-mythos-5-1: not listed / Glasswing only
]

Hvilke Claude Fable 5.1-benchmarks flyttet seg egentlig?

Terminal-Bench-Science 0.1 er hoppet: 52.6% på Fable 5.1 mot 24.7% på Fable 5.

Fable 5 satt på 24.7% og Opus 5 på 29.0%. Hoppet er grunnen til at agentisk koding-løkker betyr mer enn våre 14 korte kall.

BenchFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8% (Mythos 5.1: 60.9%)42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial / strict77.9% / 41.7%72.9% / 36.1%75.4% / 39.6%n/a
HLE no tools / with tools60.9% / 65.0%57.8% / 63.8%56.6% / 63.6%n/a
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Kilde: Anthropics kunngjøring, 2026-09-01.

KildeFunnOmfang
Artificial Analysis, 2026-09-01Intelligence Index 66 at maxFable 5 max 62; Opus 5 max 63
Artificial Analysis$3.76 / oppgave vs Fable 5 $3.14 (+20 %)~1.7× output; ~$5.16 uten kuttet; xhigh 65 til $2.72
Snorkel, 2026-09-0158 % færre tokens, 36 % raskerevs Opus 5 bare på vellykkede; 18 / 5 / 2 / 2; pass@1 61.5%; build/dep 18 % vs 67 %

Snorkels 58 % / 36 % er vs Opus 5 bare på vellykkede kjøringer, ikke vs Fable 5. Opus løste fortsatt tre oppgaver mer (18 begge / 5 bare Opus / 2 bare Fable).

  1. Terminal-Bench-Science SE ±3.5–4.5 pts. Offentlig leaderboard (3 trials/oppgave, Claude Code-runner) rapporterer Opus 5 30.0% og Fable 5 21.4%; Anthropics oppsett reproduserer 29.0% og 24.7%, begge innenfor støy.
  2. OSWorld 2.0 er forfatternes oppgaveutgivelse fra august 2026; Fable 5 og Opus 5 ble kjørt på nytt under samme betingelser. Ikke sammenlignbart med eldre OSWorld-tall.
  3. Produksjonssafeguards sto på. Intervensjoner ble scoret som null på OSWorld (begge Fable-modellene) og på AutomationBench (Fable 5). Andre cyber-oppgaver falt tilbake til Opus 4.8; biologi til Opus 5. Det underdriver sannsynligvis rå kapabilitet.

Ligger 25 %-besparelsen for Claude Fable 5.1 på fakturaen din?

Cache-read-linjen er 75 % billigere; hele den korte oppfølgingen var bare 21 % billigere.

Anthropics lanseringsinnlegg anslår ~25 % typisk og ~45 % agentisk besparelse vs Fable 5. Begge krever at cache-reads dominerer, og at output-tokens ikke hopper. Priskortet i docs: cache write $12.50 / $20, output $50, cache-read $1.00 → $0.25 / MTok. Kostnadsmodeller for workload avgjør om det kuttet overlever kutt i tokenregningen andre steder.

ScenarioEtikettFable 5Fable 5.1Delta
Rad A: 20-turn / ~1M (9.5M cache-reads, writes $12.50, output $50)listepris-identitet, ikke vår måler$72.00 ($9.50 cache)$64.88 ($2.38 cache)-9.9%
Rad B: Intelligence Index-oppgaveArtificial Analysis, 2026-09-01$3.14$3.76 (~$5.16 uten kuttet)+20 % at max (~1.7× output)
Rad C: 1,165-token prefix, turn 2Techsy OpenRouter, 2026-09-02$0.005086$0.00402125hele turen 21 % billigere
Turn-2-linje (faktura, vår måler)Fable 5.1Fable 5
Cached input-tokens1,1651,166
Cache-read-linje$0.000291$0.001166
OpenRouter usage.cost$0.00402125$0.005086

Cache-read-linjen er 75.0% billigere ($0.000291 vs $0.001166). Besparelsen for hele turen stopper på 21 % fordi output fortsatt belastes til $50/M. Skaler cache-linjen til 40 rereads × 200,000 tokens: $2.00 på 5.1 mot $8.00 på 5.

AY Automate spurte «Is Claude Fable 5.1 more expensive than Fable 5?» 2026-09-01 og svarte «No.» Listeprisen er uendret på $10/$50. Fakturaen er det ikke: Artificial Analysis målte +20 % at max, THE DECODER oppdaterte samme dag med det +20 %-tallet, og våre 14 kall uten cache ble belastet 1.11×.

HN-bruker george_max (item 49525611, 2026-09-01) kalte det «just cache reads» og «15% more», i tråd med AA at max effort. Abonnementets 5-timersvinduer priser ikke cache-reads på API-måten.

Én quiz, ikke en bench: Fable 5s turn-2 cache-svar brukte $2.00 / $2.50 (5.1-priser) på en prompt som sa «on this model.»

Hva OpenRouter-måleren vår viste for Claude Fable 5.1

Alle tre modellene klarte 14/14 ved effort=low; Opus 5 var 45 % billigere enn Fable 5.1.

Vi benchmarket 14 prompts. Nøyaktigheten ble lik; Opus 5 vant fortsatt på $5/$25 mot $10/$50.

  1. Når: 2026-09-02, 08:55 UTC, OpenRouter chat-completions. Offentlige priser på Fable 5.1-modelsiden.
  2. Hva: anthropic/claude-fable-5.1 vs anthropic/claude-fable-5 vs anthropic/claude-opus-5.
  3. Hvordan: reasoning.effort=low unntatt tre Fable 5.1 High coding-kall. Ingen temperature (5.1 avviser non-default sampling).
  4. Graders: JSON-schema, eksakt numerisk match, kjørte unit tests. Artefakter: fable_bench.py, benchmark-raw.json, benchmark-aggregate.json. Vi testet de tre slugene i benchmarken vår: 49 kall, $0.53795.
Metrikk (14 kall, effort=low)Fable 5.1Fable 5Opus 5
Oppgaver bestått14/1414/1414/14
Median latency5.647 s5.383 s4.797 s
Median completion tokens9490103
Median reasoning tokens0823
Totale completion tokens2,5472,2712,843
Totale reasoning tokens0253380
Total kostnad$0.14693$0.13285$0.080725

Coding klarte 6/6 hver på low.

Oppgave (2 trials)Fable 5.1 outFable 5 outOpus 5 out
merge_intervals175, 16896, 96155, 155
semver_satisfies414, 411405, 401493, 487
lru_ttl_cache387, 418395, 339469, 459
Coding median latency6.523 s5.389 s6.316 s
Coding total kostnad$0.11095$0.09878$0.06154

Behandle Anthropics «more concise in plans and summaries» som et krav om agentspor, ikke om single-shot funksjonsdumps. Fable 5.1 brukte ~175 tokens på merge_intervals der Fable 5 brukte 96, begge bestått.

Hva dette ikke måler:

  • Mythos 5.1 (ikke kallbar fra denne kontoen).
  • Fler-timers agenter, Terminal-Bench, SWE-bench, computer use.
  • Standard effort (vi pinnet low unntatt runde 3).
  • Cache writes ved 5-minutters vs 1-times TTL.
  • Refusals, fallback til Opus, tool-loop batching.

Hvilke tre requests gir 400 på Fable 5.1?

Tvungen tool_choice av type any eller tool returnerer HTTP 400 på claude-fable-5-1.

What's new in Fable 5.1 navngir feilen: tool_choice: type "tool" and "any" are not supported for this model. Prefill av assistant-turen er også 400. Non-default temperature / top_p / top_k er også 400; vi sendte ingen temperature av den grunn. Thinking-blokker binds til produserende modell (thinking-binding-controls-2026-08-01): 5.1 leser tidligere blokker, tidligere modeller kan ikke lese 5.1s, og en router-fallback dropper dem. Redigering av noe før en 5.1 thinking-blokk feiler eller dropper den for kontoer opprettet 2026-08-31 eller senere. Mythos 5.1 hopper over den prefix-sjekken.

python
# HTTP 400 invalid_request_error on anthropic/claude-fable-5.1
payload = {
    "model": "anthropic/claude-fable-5.1",
    "messages": [{"role": "user", "content": "Look up the cache rate."}],
    "tools": [{"type": "function", "function": {"name": "lookup"}}],
    "tool_choice": {"type": "tool", "name": "lookup"},  # type "any" 400s too
}
# error: tool_choice: type "tool" and "any" are not supported for this model.
  1. Sett tool_choice til auto og strict: true på tool-schemaet, eller bytt til structured outputs.
  2. Hold historikken append-only; aldri rediger et prefix foran en 5.1 thinking-blokk.
  3. Dropp thinking-blokker når du faller tilbake til en tidligere modell.
  4. Utelat temperature / top_p / top_k, og ikke prefill assistant-turen.

Hvorfor setter Claude Code Fable 5.1 til High som standard?

Claude Code setter Fable 5.1 til High; på lru_ttl_cache 4×-et det en oppgave som allerede besto på Low.

Anthropics kunngjøring setter High i Claude Code og Medium på claude.ai / Cowork. Fem effort-nivåer: low / medium / high / xhigh / max. Thinking er alltid på; thinking: disabled er 400. Help Center krever Claude Code 2.1.250 eller nyere.

OppgaveLow (out / reason / cost)High (out / reason / cost / latency)
merge_intervals172 / 0 / $0.010175 / 0 / $0.01024 / 4.86 s
semver_satisfies413 / 0 / $0.023401 / 0 / $0.02238 / 7.60 s
lru_ttl_cache403 / 0 / $0.0221,713 / 1,150 / $0.08798 / 22.07 s

merge_intervals og semver_satisfies så ut som Low. lru_ttl_cache gjorde det ikke. High brukte 4.25× completion tokens (1,713 vs 403), la til 1,150 reasoning tokens, tok 22.07 s mot ~7 s, og kostet en 4.0× regning ($0.08798 vs $0.022) for tester vi allerede hadde. Pinn effort=low (eller Medium på claude.ai) for avgrensede funksjoner.

Simon Willison (2026-09-01, ikke vår pelican): effort kan ikke skrus av; max var 33× outputen til low på én prompt.

Bør du bli på Fable 5, bli på Opus 5, eller flytte?

Bli på Opus 5 for avgrenset single-shot-arbeid; flytt cache-tunge agenter til Fable 5.1.

Docs sier start med Opus 5 og grip Fable 5.1 når High-effort evals fortsatt faller kort. Vår eval er 14/14-måleren: Opus 5 på $0.0807 mot $0.1469 (45 % billigere). Ikke bytt Fable 5 til 5.1 for korte kall uten cache: 14/14 begge, 5.1 kostet 1.11× mer her.

RegelSnu hvisFaktura (vår måler)
Bli på Opus 5 for avgrenset single-shotHigh-effort evals fortsatt bommer på lange agentsesjoner$0.080725, 14/14, 45 % billigere enn $0.14693
Flytt cache-tunge agenter til Fable 5.1sesjonen aldri leser et stort prefix på nytt75.0% billigere cache-read-linje ($0.000291 vs $0.001166)
Ikke la Claude Code stå på standard High for oppgaver som allerede består på Lowjobben er en Terminal-Bench-Science-klasse løkke4.0×lru_ttl_cache ($0.08798 vs $0.022)
Ikke bytt Fable 5 → 5.1 for korte kall uten cachedu trenger Science-hoppet eller $0.25 cache-read1.11× ($0.14693 vs $0.13285), 14/14 begge

Fable 5.1 ble belastet $0.14693 (1.11×) på 14/14 uten cache; gevinsten er cache-read-linjen. Fable 5 ble belastet $0.13285 til et 1,165-token prefix leses på nytt. Opus 5 ble belastet $0.080725, 45 % billigere, med flere tokens (2,843 vs 2,547).

Avgrenset single-shot-arbeid blir på Opus 5. Cache-tunge agenter flytter til Fable 5.1 for $0.25 cache-read-linjen, med effort pinnet til Low når testene allerede består. Korte Fable 5-kall uten cache blir stående.

Ofte stilte spørsmål

Hva er Claude Fable 5.1 API-ID-en?

claude-fable-5-1 på Anthropic API, anthropic.claude-fable-5-1 på Bedrock, og anthropic/claude-fable-5.1 på OpenRouter. Vertex, Foundry og Claude Platform beholder claude-fable-5-1. Mythos er claude-mythos-5-1, bare Glasswing; det er ikke en OpenRouter-modell du kan skrive inn, og vi kalte den ikke 2026-09-02.

Gjelder cache-read-kuttet Claude Code Max-kvoter?

Nei. 75 %-kuttet er en API cache-read-pris ($1.00 → $0.25 / MTok). Abonnementets 5-timersvinduer belaster ikke cache-reads slik, så den typiske 25 %-besparelsen strekker ikke Max-kvoter. r/ClaudeCode (2026-09-01) rapporterte å brenne 5-timersvinduet på 20 minutter etter at High-standarden landet.

Hvilken Claude Code-versjon trenger Fable 5.1?

2.1.250 eller nyere, ifølge Help Center 2026-09-01. Fable 5 var 2.1.170+. Eldre bygg mister den nye ID-en, High-standarden som 4.0×-et LRU-oppgaven vår, og effort-velgeren 5.1 forventer. Oppgrader før du peker trafikk dit.

Er Fable 6 neste?

5.1 er punktutgivelsen det innlegget forutså. Fable 6 er fortsatt ukjent. Polymarket-tråder som spør etter en 5.1-dato er utdaterte: GA var 2026-09-01, og kunngjøringen navngir ingen Fable 6-kalender. Ikke utsett et 5 vs 5.1-bytte mens du venter på den.

Er Claude Fable 5.1 en Covered Model?

Ja. 30 dagers dataretensjon. Ikke tilgjengelig under zero data retention med mindre det er uttrykkelig autorisert. Enterprise Frontier Safeguards (customer-cloud storage) ruller ut senere i høst; kvalifiserte kunder kan bruke ZDR til da. Et statistisk tekstvannmerke leveres på alle plattformer (EU AI Act, modeller etter 2026-08-02); detection API er i private preview.

Emneord

claude-fable-5-1claude-mythos-5-1prompt-cachingclaude-opus-5openrouter

Del denne artikkelen

Kom i gang

Klar til å bygge noe ekstraordinært?

La oss gjøre visjonen din til virkelighet. Teamet vårt er klart til å hjelpe deg med å lage programvare som utgjør en forskjell.