ai-machine-learning

Claude Fable 5 vs Opus 4.8: Vale la Pena Passare? (Mythos-Class, Testato)

Scritto da Mert Batur
Aggiornato Jul 21, 2026
22 lettura
Claude Fable 5 vs Opus 4.8: Vale la Pena Passare? (Mythos-Class, Testato)

Claude Fable 5 vs Opus 4.8: Vale la Pena Passare? (Mythos-Class, Testato)

Anthropic ha rilasciato Claude Fable 5 il 9 giugno 2026, e le sei settimane successive non sono state una linea retta: una sospensione imposta dal governo, un ripristino completo, una patch di sicurezza e due nuovi lanci concorrenti. Il modello segna comunque 80,3% su SWE-Bench Pro, il benchmark per l'agentic coding dove Opus 4.8 si ferma al 69,2% e GPT-5.5 rimane indietro al 58,6%. Non è un margine trascurabile, anche se GPT-5.5 non è più l'unico modello con cui confrontarlo. E c'è un colpo di scena: Fable 5 è la metà pubblica e con salvaguardie di un nuovo modello "Mythos-class", con un gemello ristretto chiamato Claude Mythos 5 tenuto dietro un programma di accesso riservato. Ecco cosa è cambiato, cosa è successo dal lancio in poi, quanto costa davvero un task a $10/$50 per milione di token, e se conviene davvero spostare il tuo stack da Opus 4.8.

Risposta Rapida

  • Fable 5 segna 80,3% su SWE-Bench Pro contro il 69,2% di Opus 4.8 e il 58,6% di GPT-5.5, ma Claude Sonnet 5 e GPT-5.6 Sol (entrambi usciti dopo Fable 5) recuperano parte di quel divario sui benchmark agentici e da terminale.
  • Il prezzo è $10 input / $50 output per milione di token, meno della metà di Mythos Preview.
  • Fable 5 passa automaticamente a Opus 4.8 per le query ad alto rischio (cyber/bio/chimica); un aggiornamento dei classificatori del 1° luglio blocca anche una tecnica di prompting scoperta dai ricercatori di Amazon, in oltre il 99% dei casi.
  • L'accesso è stato sospeso per tutti gli utenti dal 12 al 30 giugno 2026 a causa dei controlli sulle esportazioni statunitensi, poi ripristinato completamente il 1° luglio. Anche il prezzo gratuito-fino-a-una-data è sparito: Max/Team Premium mantengono Fable 5 incluso, Pro/Team Standard ottengono un credito una tantum di $100 e poi passano alle tariffe API, secondo TechTimes e XenoSpectrum (Anthropic non lo ha confermato sul proprio sito).

Cosa È Stato Lanciato: Fable 5, Mythos 5 e la Linea "Mythos-Class"

Mythos-class è il nuovo livello di capacità massima di Anthropic, e viene rilasciato come due modelli. Claude Fable 5 è la versione pubblica con salvaguardie che puoi chiamare oggi. Claude Mythos 5 è lo stesso modello frontier con le salvaguardie rimosse, accessibile solo tramite accesso ristretto. Stessa architettura, due posture di rilascio diverse.

Questa distinzione è il cuore della storia. Secondo l'annuncio di Anthropic, Mythos 5 conserva la piena capacità frontier, incluse competenze offensive nel campo informatico che potrebbero causare danni reali, quindi Anthropic non lo mette a disposizione di tutti. Fable 5 prende lo stesso modello e lo avvolge in classificatori che rilevano le richieste ad alto rischio e le instradano silenziosamente verso Opus 4.8 invece.

Quando chiami Fable 5, ottieni il ragionamento Mythos-class su tutto ciò che non è pericoloso, e un modello di fallback più sicuro sulla piccola fetta che lo è. CNBC ha descritto la situazione come Anthropic che rilascia "un'IA simile a Mythos al pubblico", il che è corretto, ma il meccanismo preciso conta più del titolo.

Fable 5 e Mythos 5 sono lo stesso modello frontier diviso in due: uno che puoi usare oggi, uno che Anthropic mantiene ristretto. Se devi ricordare una sola cosa sulla nomenclatura, ricorda questa. Mythos-class è il livello; Fable e Mythos sono le due porte di accesso.

Cosa È Cambiato Rispetto alla Linea Opus 4.x

Su ogni valutazione di coding e ragionamento qui trattata, Fable 5 supera Opus 4.8, non di poco ma con margini a due cifre. SWE-Bench Pro passa dal 69,2% all'80,3%, un numero pubblicato da Anthropic e confermato in modo indipendente da Vellum, llm-stats e Weights & Biases. FrontierCode Diamond va da 13,4 a 29,3, un numero che Anthropic stessa non pubblica: arriva dal tracking di Vellum e llm-stats. Anche il prezzo è sceso, e il modello scala con un nuovo dial per il livello di ragionamento. Si tratta di un genuino passo avanti rispetto alla linea Opus 4.x, non di un aggiornamento minore.

Tabella benchmark Claude Mythos 5 / Fable 5 rispetto a Mythos Preview, Opus 4.8, GPT-5.5, Gemini 3.1 Pro su 13 valutazioni
Claude Mythos 5 / Fable 5 su 13 benchmark rispetto a Opus 4.8, GPT-5.5 e Gemini 3.1 Pro. Fonte: Anthropic.

Il confronto sui 13 benchmark qui sopra è la panoramica rapida. Ecco i numeri principali rispetto ai tre modelli che la maggior parte dei team confronta davvero:

BenchmarkClaude Fable 5Claude Opus 4.8GPT-5.5
SWE-Bench Pro (agentic coding)80,3%69,2%58,6%
FrontierCode Diamond (coding più difficile)29,313,45,7
Terminal-Bench 2.1 (shell agentico)88,0%n/an/a
GPQA-AA (ragionamento di livello universitario, Elo)1932n/an/a
ExploitBench78,0%n/an/a

Il riferimento di confronto qui è Claude Opus 4.8, il modello che Fable 5 sostituisce al frontier, e lo stesso modello verso cui Fable 5 fa fallback per le query ad alto rischio. Se hai seguito la linea Opus 4.x nelle ultime due versioni, il pattern era di guadagni incrementali. Fable 5 rompe quel pattern.

Due cose da notare prima di prendere la tabella come vangelo. Primo, SWE-Bench Pro è una valutazione pubblicata direttamente da Anthropic e confermata in modo indipendente altrove; FrontierCode Diamond non è affatto un numero pubblicato da Anthropic, è un benchmark di terze parti tracciato da Vellum e llm-stats. Secondo, il dial del livello di ragionamento significa che un singolo numero di benchmark nasconde una curva di costo. Ne parliamo nella sezione prezzi, perché cambia i calcoli.

I Benchmark Che Contano per Chi Sviluppa

Quattro numeri portano il peso pratico: SWE-Bench Pro 80,3%, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0%, e GPQA-AA 1932 Elo. Insieme coprono il lavoro su repo reali, i problemi di coding sintetici più difficili, i task shell agentici e il ragionamento di livello universitario. Se il tuo carico di lavoro tocca uno di questi, questa è la sezione che ti dice se il numero si traduce nella tua realtà.

Il grafico principale in cima a questo articolo è la prova: SWE-Bench Pro 80,3 vs 69,2 vs 58,6, e FrontierCode 29,3 vs 13,4 vs 5,7. Ma cosa misurano davvero?

  • SWE-Bench Pro testa se un modello riesce a fare una pull request reale su un repo reale: clonare, capire, patchare, passare i test. Fable 5 ce la fa in 8 casi su 10. È il proxy più vicino al "riesce a fare il mio lavoro davvero."
  • Terminal-Bench 2.1 valuta i task shell agentici: eseguire comandi, leggere output, recuperare dagli errori. L'88,0% conta se stai costruendo agenti di coding AI che vivono in un terminale.
  • FrontierCode Diamond è il livello più difficile dei problemi di coding, quelli dove la maggior parte dei modelli segna cifre singole. 29,3 è basso in termini assoluti, ma più del doppio del 13,4 di Opus 4.8.
  • GPQA-AA è il ragionamento scientifico di livello universitario, misurato come punteggio Elo. 1932 segnala un ragionamento multi-step solido al di là del codice.

Nei nostri workflow Claude Code attraverso la linea Opus 4.x, il limite ricorrente erano i task agentici a lungo orizzonte: il modello perdeva il filo a metà di una modifica su più file. I numeri di Terminal-Bench e SWE-Bench Pro di Fable 5 suggeriscono che quel limite si è spostato. Se si è spostato per il tuo repo è l'unico test che conta, ma i numeri pubblicati sono il tipo giusto di numeri a cui prestare attenzione.

Casi Reali: Cosa Fa Fable 5 Che i Modelli Precedenti Non Potevano

Anthropic ha pubblicato tre esempi concreti che mostrano la classe di problemi che Fable 5 può ora gestire: una migrazione del codebase Stripe compressa da mesi a un giorno, un videogioco completato con la sola visione, e un salto di performance 3× grazie all'auto-validazione. Ognuno punta a una capacità che i modelli precedenti non potevano raggiungere. Tutti e tre provengono da Anthropic; citiamo il loro annuncio, non test nostri.

Ecco cosa dimostra ciascuno:

  1. Migrazione Ruby di Stripe. Anthropic riporta che Fable 5 ha compresso una migrazione di un codebase Ruby da circa due mesi a circa un giorno. Questa è la classe di refactor a lungo orizzonte che richiedeva un team umano con l'intero codebase in testa.

  2. Pokémon FireRed con la sola visione. Secondo Anthropic, Fable 5 ha completato Pokémon FireRed usando solo la visione, dove i modelli precedenti avevano bisogno di harness personalizzati complessi per passare lo stato del gioco come testo. È un salto nel ragionamento spaziale e visivo: il modello legge lo schermo e agisce, senza scaffolding.

  3. Slay the Spire, 3×. Al massimo sforzo di ragionamento, Anthropic dice che Fable 5 auto-valida le proprie mosse e ha raggiunto performance 3× migliori grazie alla memoria persistente. Il punto non è il gioco; è che il modello può verificare il proprio lavoro su un lungo orizzonte di pianificazione e migliorare da solo.

Nessuno di questi è qualcosa che dovresti prendere per buono riguardo al tuo carico di lavoro. Ma si mappano chiaramente sui salti nei benchmark della tabella: coding a lungo orizzonte (SWE-Bench Pro), ragionamento spaziale (visione) e auto-validazione (il dial del livello di ragionamento). I risultati qualitativi e quelli quantitativi raccontano la stessa storia.

Prezzi e la Realtà del Costo per Task

Fable 5 costa $10 per milione di token in input e $50 per milione di token in output. Anthropic lo presenta come "meno della metà del prezzo di Claude Mythos Preview." È anche circa 2× Opus 4.8 per token. Entrambe le cose sono vere. Il problema è che il prezzo per token è l'unità sbagliata. Quello che paghi davvero è un task completato, ed è lì che i calcoli di Fable 5 diventano interessanti.

Accuratezza FrontierCode vs costo per task — Claude Fable 5 scala dal basso al massimo sforzo di ragionamento, superando Opus 4.8 e GPT-5.5
Punteggio FrontierCode vs costo medio per task al variare dello sforzo di ragionamento da basso a massimo. Fonte: Anthropic.

Il livello di ragionamento è un dial che imposti per ogni richiesta. Basso sforzo significa meno token di ragionamento interno e una risposta più economica e veloce; massimo sforzo significa che il modello pensa di più, spende più token in output e segna più in alto. Il grafico sopra mostra Fable 5 che sale da circa l'11% al circa 31% su FrontierCode man mano che lo sforzo scala da basso a massimo, mentre Opus 4.8 si ferma intorno al 13% e GPT-5.5 rimane fermo vicino al 5-6%. Quindi il costo per task non è un numero fisso; è una curva su cui scegli un punto.

Facciamo un esempio concreto con i prezzi pubblicati di $10/$50. Questo è un calcolo aritmetico dalle tariffe postate da Anthropic, non un risultato di benchmark.

Prendi una singola chiamata agentica con 50.000 token in input e 15.000 token in output ad alto sforzo:

text
Input:  50.000 / 1.000.000 × $10 = $0,50
Output: 15.000 / 1.000.000 × $50 = $0,75
Per chiamata:                       $1,25

Un task agentico reale concatena molte chiamate di questo tipo: leggi il repo, pianifica, modifica, esegui i test, correggi, ripeti. Diciamo che il ciclo gira 12 volte con quella forma: circa $15 per il task completato. Al massimo sforzo di ragionamento con contesto più pesante, la curva di costo di Anthropic posiziona i task difficili su FrontierCode più vicino ai $20 per task. Esegui lo stesso task su GPT-5.5 e pagherai meno per token. Ma se non riesce a completare il task a nessun livello di sforzo, il tuo costo per task completato è infinito. Fable 5 costa più per token di GPT-5.5, eppure vince sul costo per task completato, perché porta a termine lavori che GPT-5.5 non riesce a fare.

Ecco una chiamata minimale. L'id del modello è claude-fable-5 sull'API (anthropic.claude-fable-5 su Bedrock). Dalla generazione 4.6, gli id dei modelli di Anthropic non hanno più data, come conferma anche l'annuncio di Anthropic, quindi non c'è nessun alias versionato da rincorrere, questa stringa è lo snapshot fissato:

python
import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
    model="claude-fable-5",          # dateless id; this is the pinned snapshot
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 8000},  # reasoning effort
    messages=[
        {"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
    ],
)

print(message.content)

La tesi economica in una riga: paghi più per token di GPT-5.5, ma completi task che GPT-5.5 non riesce a completare a nessun prezzo. Per lavoro ad alto volume e bassa criticità, i calcoli favoriscono un modello più economico. Per il coding agentico difficile, favoriscono Fable 5.

La Divisione delle Salvaguardie: Perché Fable Passa a Opus 4.8

Fable 5 esegue classificatori su ogni richiesta. Quando rileva una query ad alto rischio (cyber offensivo, bio, chimica o tentativi di distillazione del modello), passa a Opus 4.8 invece di rispondere con la piena capacità Mythos-class. Anthropic dice che questo fallback si attiva su meno del 5% delle sessioni, quindi la maggior parte degli utenti non lo incontra mai. Il punto è mantenere la capacità pericolosa dietro al cancello lasciando il lavoro quotidiano intatto.

Il numero più duro è il tasso di successo degli attacchi: quanto spesso un attaccante automatizzato riesce a fare il jailbreak del modello per fargli fare qualcosa che non dovrebbe. Più basso è meglio. Gray Swan e lo UK AI Security Institute hanno condotto red-teaming agentico a k=100 con il ragionamento attivo, e i risultati mettono un numero reale su questo divario:

ModelloTasso di successo degli attacchi
Claude Fable 54,8%
Claude Opus 4.89,6%
GPT-5.530,8%
Gemini 3.1 Pro45,5%

Fable 5 resta in testa al gruppo, ma il margine rispetto a Opus 4.8 è di circa 2 volte, non il divario di un ordine di grandezza citato a volte. Contro GPT-5.5 e Gemini 3.1 Pro, il divario è molto più ampio, 6-9 volte.

Perché dovrebbe importarti? Se deploi un agente con accesso agli strumenti (shell, file system, rete), un jailbreak non è una risposta in chat sbagliata: è il modello che esegue comandi reali che un attaccante gli ha fatto eseguire. Un tasso di successo degli attacchi sotto il 5%, circa la metà di quello di Opus 4.8, vale comunque il passaggio per tutto ciò che tocca strumenti live. La copertura di IT Pro ha aperto proprio con il meccanismo di fallback per questo motivo: è la feature che rende un modello frontier abbastanza sicuro da affidare al pubblico.

Il compromesso è la latenza. Se il tuo workflow tocca legittimamente strumenti di sicurezza informatica, il fallback può attivarsi a metà task e scambiare i modelli, qualcosa da pianificare.

Claude Mythos 5 e la Questione del Dual-Use

Claude Mythos 5 è il fratello ristretto, lo stesso modello senza il fallback delle salvaguardie. Mantiene la capacità cyber offensiva che Fable 5 blocca, che è esattamente il motivo per cui Anthropic non lo rilascia pubblicamente. L'accesso avviene tramite Project Glasswing, un programma verificato per difensori e ricercatori che necessitano della piena capacità. Stesso modello, due posture di rilascio: una aperta, una riservata.

Risultati delle valutazioni cyber offensive — Claude Mythos 5 alta capacità, Claude Fable restituisce 0,0 dove si attivano le salvaguardie
Valutazioni cyber offensive: Mythos 5 mantiene la capacità; Fable restituisce 0,0 dove scattano le salvaguardie di blocco. Fonte: Anthropic.

Il grafico rende visibile la divisione. Sulle valutazioni cyber offensive (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 segna 88,4, 24,0, 83,8 e 38,7. Fable 5 restituisce un piatto 0,0 su tutti e quattro. Sulle valutazioni cyber offensive, Mythos 5 segna fino a 88,4 dove Fable 5 restituisce un piatto 0,0: la divisione delle salvaguardie, resa visibile.

Quel zero non è un gap di capacità. È il fallback che scatta ogni volta, bloccando la richiesta prima che il modello Mythos-class risponda. TechCrunch ha notato il tempismo: Anthropic ha rilasciato questo pochi giorni dopo aver avvertito che l'AI sta diventando troppo pericolosa da rilasciare apertamente. La divisione Fable/Mythos è la risposta politica a quell'avvertimento: pubblica la capacità, metti al riparo il pericolo.

Per la maggior parte degli sviluppatori, Mythos 5 è irrilevante. Non ti qualificherai mai per Project Glasswing e non ne hai bisogno. Ciò che conta è sapere che il modello che stai chiamando è deliberatamente limitato su una stretta banda di task, per scelta.

Cosa È Successo Dopo il Lancio: Due Settimane di Sospensione, Poi una Patch di Sicurezza

Le prime sei settimane di Fable 5 non sono state una linea retta. Tre giorni dopo il lancio del 9 giugno, il governo statunitense ha applicato controlli sulle esportazioni ai modelli più recenti di Anthropic, e il 12 giugno 2026 l'accesso è stato sospeso per ogni utente, ovunque, perché Anthropic non aveva modo di verificare chi stesse effettivamente chiamando l'API. L'approvazione del governo è arrivata il 26 giugno, ripristinando per primo Mythos 5 per un gruppo di organizzazioni statunitensi verificate (Anthropic non ha reso pubblico quante). Il ripristino completo per tutti è arrivato il 1° luglio 2026, lo stesso giorno in cui GitHub ha riattivato Fable 5 in Copilot. Consulta la nostra cronologia completa della sospensione per tutti i dettagli.

Quella sospensione era un problema di licenze, non di sicurezza. Separatamente, e senza alcun legame con il blocco dei controlli sulle esportazioni, i ricercatori di Amazon hanno scoperto un metodo di prompting che aggirava le salvaguardie di Fable 5 abbastanza bene da estrarre vulnerabilità software che il classificatore avrebbe dovuto bloccare. Anthropic non ha ritirato il modello per questo: ha rilasciato una correzione insieme al ripristino del 1° luglio, un aggiornamento dei classificatori che blocca quella tecnica specifica in oltre il 99% dei casi, con il resto che passa a Opus 4.8 come prima. Due problemi diversi, due correzioni diverse, arrivate nella stessa settimana di calendario: non significa che uno abbia causato l'altro.

Se stai pianificando l'uso di Fable 5 per qualcosa rivolto ai clienti, la lezione pratica è che i termini del giorno di lancio di un modello frontier non reggono sempre sei settimane dopo.

Il Campo Competitivo Si È Mosso: GPT-5.6 e Claude Sonnet 5

Confrontare Fable 5 solo con GPT-5.5 aveva senso il 9 giugno. Non più. Due lanci successivi cambiano i calcoli, e il più significativo arriva dalla stessa gamma di Anthropic, non da un concorrente.

Claude Sonnet 5, uscito il 30 giugno 2026, è l'omissione che conta di più. Ha un prezzo di $3/$15 per milione di token standard, $2/$10 come tariffa introduttiva fino al 31 agosto 2026, una frazione dei $10/$50 di Fable 5. Su SWE-Bench Pro segna 63,2%, dietro all'80,3% di Fable 5 e al 69,2% di Opus 4.8. Ma su Terminal-Bench 2.1 raggiunge l'80,4%, che batte il 74,6% di Opus 4.8, e il suo punteggio OSWorld-Verified è 81,2%. Un modello della stessa famiglia a un quinto del prezzo di Fable 5 che batte il flagship precedente su un benchmark agentico non è un dettaglio che un articolo "conviene passare?" può omettere.

GPT-5.6, il seguito di OpenAI uscito il 9 luglio 2026, arriva in tre livelli: Sol, Terra e Luna. Sol ha un prezzo di $5/$30, circa la metà del costo in input di Fable 5, con Terra a $2,50/$15 e Luna a $1/$6. Testa a testa, secondo il confronto benchmark di Vellum del 9 luglio:

BenchmarkGPT-5.6 SolFable 5
SWE-Bench Pro64,6%80,0%
Terminal-Bench 2.188,8%86,0%
Coding Agent Index8077,2
Agents' Last Exam53,640,5
OSWorld62,6% (2.0)85,0% (Verified)

Sol vince su Terminal-Bench, sul Coding Agent Index e su Agents' Last Exam, usando a quanto pare meno della metà dei token in output, meno della metà del tempo, e circa un terzo in meno di costo per task rispetto a Fable 5. Fable 5 vince ancora nettamente su SWE-Bench Pro e OSWorld.

Mettendo insieme entrambi gli aggiornamenti, il verdetto onesto passa da "Fable 5 spazza via il campo" a "Fable 5 vince sul lavoro su repo reali e sul computer-use, perde terreno sui task agentici, da terminale e sul costo, contro modelli che non esistevano quando questo articolo è stato pubblicato per la prima volta." Se il tuo carico di lavoro è SWE-Bench-shaped, pull request reali su repo reali, Fable 5 resta la scelta giusta. Se è terminal-and-agent-shaped, o hai vincoli di budget, valuta il campo più recente prima di deciderti. Il prossimo rilascio di Anthropic resta una domanda aperta; vedi il nostro articolo sulla data di uscita di Claude Fable 6 per cosa suggerisce lo schema dei nomi.

Per i prezzi API attuali in tutta la famiglia: Fable 5 e Mythos 5 costano entrambi $10/$50 per milione di token, Opus 4.8 è a $5/$25, Sonnet 5 è a $3/$15 ($2/$10 come tariffa introduttiva fino al 31 agosto 2026), e Haiku 4.5 è a $1/$5.

Cosa Significa: Conviene Passare?

Passa a Fable 5 per il coding agentico difficile, i task multi-step a lungo orizzonte, e il ragionamento visivo o spaziale — ovunque completare il task valga più che risparmiare centesimi per token. Resta su Opus 4.8 per il lavoro ad alto volume e sensibile ai costi, o per qualsiasi cosa che attiva comunque il fallback. Questo è l'intero framework. Il resto è abbinare il tuo carico di lavoro al lato giusto.

Quando Fable 5 vince:

  • Coding agentico difficile dove Opus 4.8 si blocca; il gap su SWE-Bench Pro è reale
  • Task a lungo orizzonte (refactor su più file, migrazioni) dove l'auto-validazione paga
  • Carichi di lavoro con visione e ragionamento spaziale
  • Qualsiasi lavoro dove un task completato vale più del premium per token

Quando Opus 4.8 vince ancora:

  • Lavoro ad alto volume e sensibile ai costi dove il prezzo per token domina
  • Carichi di lavoro cyber/bio/chimica, dove Fable 5 passa comunque a Opus 4.8, quindi chiamalo direttamente
  • Flussi sensibili alla latenza che non possono tollerare uno scambio di modelli a metà task
Caso d'usoModello consigliato
Coding agentico difficile / migrazioniClaude Fable 5
Visione / ragionamento spazialeClaude Fable 5
Classificazione ad alto volume e basso costoClaude Opus 4.8
Strumenti di sicurezza / red-teamClaude Opus 4.8 (diretto)

Sulla disponibilità: l'impostazione gratuito-fino-a-una-data del lancio è sparita. La scadenza dei prezzi è stata rinviata quattro volte, 22 giugno → 7 luglio → 12 luglio → 19 luglio 2026, e la risoluzione del 20 luglio ha sostituito la data con una divisione per livelli: Max e Team Premium mantengono Fable 5 incluso in modo permanente al 50% dei limiti del piano, mentre Pro e Team Standard passano ai crediti d'uso, un credito una tantum di $100 seguito dalle tariffe API. Questa divisione è riportata da TechTimes, XenoSpectrum e Basic Tutorials; Anthropic non l'ha pubblicata sulla propria pagina dei prezzi, quindi trattala come riportata, non confermata. Fable 5 è generalmente disponibile sull'API Claude, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (riattivato il 1° luglio 2026 secondo il changelog di GitHub; gli amministratori Business ed Enterprise devono attivarlo esplicitamente, poiché la policy di default è disattivata), e le app consumer Pro/Max/Team/Enterprise. La finestra di contesto è di 1M token, l'output massimo è 128k token, il knowledge cutoff è gennaio 2026. Due dettagli da segnalare per gli acquirenti enterprise: Fable 5 e Mythos 5 sono Covered Models sotto la conservazione dati obbligatoria di 30 giorni di Anthropic, quindi non sono disponibili con zero data retention, e l'inferenza solo-USA comporta un moltiplicatore di prezzo di 1,1x.

Sull'Autore

Mert Batur è co-fondatore di Techsy.io, dove il team sviluppa agenti AI, sistemi di automazione e pipeline voice/SDR per clienti B2B. Scrive dello stack di strumenti LLM che il team Techsy usa davvero in produzione. Connettiti su LinkedIn.

Co-Founder, Techsy.io

Domande Frequenti

Cos'è Claude Fable 5?

Claude Fable 5 è il primo modello Mythos-class disponibile pubblicamente di Anthropic, lanciato il 9 giugno 2026. Segna 80,3% su SWE-Bench Pro e usa classificatori di salvaguardia che passano a Opus 4.8 per le query ad alto rischio. Costa $10 input / $50 output per milione di token.

Qual è la differenza tra Fable 5 e Mythos 5?

Sono lo stesso modello frontier con posture di rilascio diverse. Fable 5 è pubblico e con salvaguardie; passa a Opus 4.8 per le query pericolose. Mythos 5 è la versione a piena capacità con accesso ristretto, accessibile solo tramite il programma Project Glasswing di Anthropic per difensori e ricercatori verificati.

Claude Fable 5 è davvero migliore di Opus 4.8?

Sì sul coding agentico difficile, sulla visione e sul ragionamento spaziale: Fable 5 raggiunge l'80,3% su SWE-Bench Pro contro il 69,2% di Opus 4.8. Ma Opus 4.8 vince ancora sul lavoro ad alto volume e sensibile ai costi, e Fable 5 passa comunque a Opus 4.8 per gli argomenti ad alto rischio cyber/bio/chimica. "Migliore" dipende dal tuo carico di lavoro.

Quanto costa Claude Fable 5?

Claude Fable 5 costa $10 per milione di token in input e $50 per milione di token in output. Anthropic lo presenta come "meno della metà del prezzo di Mythos Preview." È circa 2× Opus 4.8 per token, ma il valore si misura per task completato, dato che Fable 5 porta a termine lavori che i modelli più economici non riescono a fare.

Cos'è un modello "Mythos-class"?

Mythos-class è il nuovo livello di capacità massima di Anthropic, lanciato con Fable 5 e Mythos 5. Rappresenta un salto frontier rispetto alla linea Opus 4.x sui benchmark di coding e ragionamento. Fable 5 e Mythos 5 sono due versioni di rilascio dello stesso modello Mythos-class: uno pubblico e con salvaguardie, uno ristretto.

Perché Fable 5 passa a Opus 4.8?

Fable 5 usa classificatori che rilevano le richieste ad alto rischio (cyber offensivo, bio, chimica o distillazione del modello) e le instrada verso Opus 4.8 invece di rispondere con la piena capacità Mythos-class. Questo si attiva su meno del 5% delle sessioni. Nel red-teaming agentico di Gray Swan / UK AI Security Institute, questa combinazione dà a Fable 5 un tasso di successo degli attacchi del 4,8% contro il 9,6% di Opus 4.8, entrambi ben avanti rispetto al 30,8% di GPT-5.5.

Posso accedere a Claude Mythos 5?

Probabilmente no. Mythos 5 è ristretto dietro Project Glasswing, il programma di accesso verificato di Anthropic per difensori e ricercatori della sicurezza che necessitano della piena capacità cyber offensiva che Fable 5 blocca. La maggior parte degli sviluppatori non si qualificherà e non ne ha bisogno, dato che Fable 5 copre il lavoro agentico e di coding quotidiano.

Dove posso usare Claude Fable 5?

Claude Fable 5 è generalmente disponibile sull'API Claude, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (riattivato il 1° luglio 2026, opt-in per gli amministratori Business/Enterprise), e le app consumer Pro/Max/Team/Enterprise. Il prezzo non è più gratuito-fino-a-una-data: Max e Team Premium lo mantengono incluso in modo permanente, mentre Pro e Team Standard ottengono un credito una tantum di $100, poi le tariffe API, secondo quanto riportato da TechTimes e XenoSpectrum.

Il Verdetto Finale

Claude Fable 5 è un vero passo avanti frontier rispetto a Opus 4.8: 80,3% vs 69,2% su SWE-Bench Pro, il doppio del punteggio su FrontierCode, e un tasso di successo degli attacchi del 4,8% contro il 9,6% di Opus 4.8 sotto il red-teaming di Gray Swan / UK AISI, ancora la scelta più sicura per gli agenti che usano strumenti, anche se il margine è di circa 2 volte, non l'ordine di grandezza a volte citato. Passa a Fable 5 per il coding agentico difficile, i task a lungo orizzonte e il lavoro con la visione; controlla prima Claude Sonnet 5 e GPT-5.6 Sol se il tuo carico di lavoro è terminal-and-agent-shaped o ha vincoli di budget, dato che entrambi sono usciti dopo Fable 5 e nessuno dei due esisteva per il confronto al lancio. Anche l'accesso non è più gratuito-fino-a-una-data: Max/Team Premium lo mantengono incluso, Pro/Team Standard ottengono un credito una tantum e poi le tariffe API. Il team Techsy sviluppa agenti in produzione esattamente su questo stack, quindi contattaci se vuoi una mano.

Tag

Claude Fable 5 e Claude Mythos 5Claude Opus 4.8SWE-Bench ProMythos-classagentic coding

Condividi questo articolo

Il Tuo Prossimo Passo

Hai un progetto in mente? Parliamone.

Prenota una call di 30 minuti. Ti ascoltiamo, capiamo il problema e ti diciamo se possiamo aiutarti.