ai-machine-learning

GPT-6 Astra è meglio di Fable?

Scritto da Mert Batur
Sep 4, 2026
8 lettura
GPT-6 Astra è meglio di Fable?

GPT-6 Astra è meglio di Fable?

GPT-6 Astra non è meglio di Claude Fable 5.1 sulla classifica indipendente che misura l'intelligenza generale.

Artificial Analysis ha messo Astra a 61 sull'Intelligence Index v4.1.1 il 3 settembre 2026, e Fable 5.1 a 66. La tabella di lancio di OpenAI stampa ancora quella riga 61,2 vs 65,7, poi apre con «il modello più intelligente al mondo».

Abbiamo lanciato un ping OpenRouter su openai/gpt-6-astra alle 14:40 UTC del 4 settembre 2026. Il gateway ha risposto HTTP 400: not a valid model ID. Fable 5.1 era già nella stessa lista. Il nostro setup è quel gateway, non una chiave OpenAI privata.

GPT-6 Astra vs Fable 5.1: quale tieni?

Tieni Fable 5.1 stamattina; Astra vince su computer-use e math nelle righe vendor, non sull'indice indipendente.

La recensione di Claude Fable 5.1 ha già la fattura 5.1 vs 5 vs Opus 5. Questa tabella è lo split tra laboratori.

PortaChiamabile su OpenRouter 2026-09-04AA Intelligence IndexAA Coding Agent IndexListino (in/out)Cache read
Claude Fable 5.1Sì (anthropic/claude-fable-5.1)6670$10 / $50$0.25
GPT-6 AstraNo (HTTP 400)6167$10 / $50$1.00
GPT-5.6 SolSì (openai/gpt-5.6-sol)6165$2 / $10 su OpenRouter; AA cita ancora $4 / $20 di listino$0.20 / 90% di sconto

Fonti: Artificial Analysis su Astra e Fable 5.1, 3 settembre e 1 settembre 2026; scheda modello OpenAI per il listino Astra; il test della colonna «chiamabile» è il ping OpenRouter.

Astra è la storia computer-use e FrontierMath. Fable 5.1 è la storia intelligence-index e cache-read.

Sol è il modello che puoi già chiamare a una frazione della scheda $10/$50. Tratta «meglio» come un workload. Non come un titolo.

Puoi già chiamare GPT-6 Astra oggi?

Da OpenRouter no. openai/gpt-6-astra ha restituito HTTP 400 alle 14:40 UTC del 2026-09-04.

Il post di lancio di OpenAI dice che un insieme limitato di organizzazioni l'ha ricevuto il 3 settembre, con ChatGPT Plus, Pro, Business, Enterprise, l'API, Azure e Bedrock in arrivo «nei prossimi giorni». L'accesso al piano gratuito non è stato annunciato. I workspace Enterprise partono con Astra spento.

anthropic/claude-fable-5.1 e openai/gpt-5.6-sol erano entrambi chiamabili su OpenRouter lo stesso pomeriggio.

Se il tuo stack sta già dietro un gateway, quel 400 è l'unico numero che conta finché l'ID non diventa valido.

bash
curl -sS https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400  {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37Z

Rilancia quel ping prima di riscrivere un router. Un post datato 4 settembre diventa stantio nell'ora in cui l'ID compare.

I bench indipendenti dicono che Astra è più intelligente?

No. Artificial Analysis mette Fable 5.1 a 66 e Astra a 61 sull'Intelligence Index v4.1.1.

OpenAI ha comunque scritto «il più intelligente al mondo» sopra una tabella che già contiene quella sconfitta. Sul coding succede la stessa cosa: OpenAI chiama Astra il miglior modello di software engineering finora; il Coding Agent Index di AA ha Fable 5.1 a 70 e Astra a 67.

Il titolo ARC-AGI-3 è uno split di runner. Non è un certificato AGI. OpenAI ha stampato 99,9%. ARC Prize ha eseguito lo stesso modello sul proprio runner Standard provider-neutral e ha ottenuto 62,7% a max effort per $26,098.

Il run al 99,9% usava un Provider Adapter che tiene lo stato di reasoning nascosto di OpenAI tra un turno e l'altro, a high effort, per $18,817. Claude Opus 5 sta al 30,2% su quella classifica Standard. GPT-5.6 Sol sta al 7,8%. Astra ha raddoppiato il SOTA Standard precedente. Non ha saturato il benchmark sul runner che ogni altro laboratorio può condividere.

BenchGPT-6 AstraClaude Fable 5.1Chi l'ha eseguito
AA Intelligence Index v4.1.16166Artificial Analysis
AA Coding Agent Index6770Artificial Analysis
Terminal-Bench 4.057,9%55,8%OpenAI
DeepSWE v1.174,1%67,4%OpenAI
AutomationBench41,4%31,4%OpenAI
Terminal-Bench Science 0.164,6%52,6%OpenAI
FrontierMath Tier 4 v297,6%87,8%OpenAI
GPQA Diamond96,0%93,7%OpenAI
Humanity's Last Exam (con tool)57,2%65,0%OpenAI
ARC-AGI-3 Standard62,7% ($26,098)non valutatoARC Prize
ARC-AGI-3 Provider Adapter99,9% ($18,817)non valutatoOpenAI / ARC Prize
Vals Index66,61% · $19.09/testnon recuperatoVals.ai, 4 settembre 2026

AA ha anche speso $3,020.82 per far passare Astra sull'Intelligence Index. Il risparmio di token rispetto a Sol è reale. Non sposta l'indice oltre Fable 5.1.

Le allucinazioni su AA-Omniscience sono scese dal 92% al 51% a max effort rispetto a Sol. È la vittoria indipendente più pulita che Astra abbia sull'affidabilità della conoscenza.

La riga «più intelligente» di OpenAI e il 62,7% Standard di ARC Prize non coincidono. Stampa tutti e due.

Cosa implica la fattura $10/$50 rispetto a Fable?

Stesso listino, cache read peggiori: Astra $1.00 vs Fable 5.1 $0.25 per milione.

La scheda modello di GPT-6 Astra elenca $10 in input, $50 in output, $1.00 di input in cache, $12.50 di cache write, una finestra da 1.050.000 token, 128.000 di output max e un knowledge cutoff al 30 aprile 2026. I prompt oltre 272k token in input fatturano 2× su input e cache e 1,5× sull'output. Fast mode è 2×. Batch e Flex stanno al 50%.

Fable 5.1 sta sulla stessa scheda $10/$50. Il post gemello ha già misurato il taglio cache-read a $0.25. Non rifare quella misura qui; cita la recensione di Fable 5.1 e usa i numeri di listino.

Un job di 30 giorni a 2,4 milioni di token in input e 380.000 in output al giorno, a $10/$50, fa:

text
2,400,000 × 30 × $10 / 1,000,000  = $720  input
  380,000 × 30 × $50 / 1,000,000  = $570  output
                                  = $1,290

Quel $1,290 è identico su Astra e Fable 5.1 prima della cache. Quaranta riletture di un prefisso in cache da 200.000 token no:

Riga cache-readTariffa40 × 200.000 token
Claude Fable 5.1$0.25 / MTok$2.00
GPT-6 Astra$1.00 / MTok$8.00

Quattro volte la riga cache, stessa scheda output.

Per il resto del modello di costo dell'inferenza, quel divario si accumula su qualsiasi agente che rilegge un prefisso di sistema. AA scrive che Astra costa circa il 75% in più per task dell'Intelligence Index rispetto a Sol a max effort, perché l'aumento di prezzo 2,5× mangia il taglio di token del ~10%.

Sol resta la porta OpenAI economica.

Per quali lavori reali serve davvero Astra?

OpenAI riporta che Astra chiude OSWorld 2.0 al 72,6% in circa 40 minuti, contro Sol al 65,7% in 75.

È l'affermazione sul computer-use, ed è un numero OpenAI, non nostro. ScreenSpot-Pro senza tool è 92,7% contro il 76,9% di Sol. Agents' Last Exam è 59,3% contro il 53,6% di Sol e il 48,7% di Fable 5 (OpenAI non ha stampato una riga Fable 5.1 lì).

Demo attribuite dal post di lancio, non dalla nostra scrivania:

  1. Agenti desktop e browser. OSWorld 2.0 partial, ~47% di wall time in meno di Sol. Abbinalo al tooling per coding-agent solo dopo che l'ID API diventa valido.
  2. Sessioni Codex lunghe. OpenAI sta rilasciando note che sopravvivono alla compaction, così il contesto di un fix fallito resta cercabile invece di essere riassunto via.
  3. Lavoro game e spaziale. Playco dice che Astra ha tagliato i fix manuali di circa il 50% su prototipi Unity/Godot. È Playco che parla, in un case study OpenAI.
  4. Cyber difensivo. Astra è il primo modello OpenAI classificato Critical sotto il Preparedness Framework. La build di produzione rifiuta gli exploit proof-of-concept. I workflow avanzati stanno dietro Daybreak / Trusted Access.
  5. Math che satura una classifica. FrontierMath Tier 4 v2 al 97,6% vs Fable 5.1 all'87,8%, eseguito dal vendor. Epoch AI finanzia parte di quella classifica; trattala come un board vicino a OpenAI.

A cosa non serve, oggi: uno swap drop-in di model= su OpenRouter, un Fable più economico, o un'affermazione secondo cui il 99,9% su ARC-AGI-3 significhi AGI.

Greg Brockman ha detto ai reporter «Welcome to the AGI era». WIRED ha stampato la citazione. ARC Prize, che ha costruito il benchmark, non sta dichiarando l'AGI.

Resti su Fable 5.1, aspetti Astra o tieni Sol?

Resta su Fable 5.1 finché l'ID di Astra non diventa valido sul tuo gateway e il tuo lavoro è computer-use o FrontierMath.

Fai il routing sul workload, non sul blog di lancio.

Se questo è veroTieniPassa quando
Ti serve un modello stamattina su OpenRouterFable 5.1 (o Sol se la scheda $10/$50 è il problema)openai/gpt-6-astra risponde 200 sul ping sopra
La tua eval è AA Intelligence Index / HLE-with-tools / agenti cache-heavyFable 5.1l'Index indipendente supera davvero 66, o la fattura cache-read non è la riga che conta
La tua eval è OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMathAspetta Astral'ID diventa valido e puoi misurare il job sulle tue trace
Sei ancora su GPT-5.6 Sol e il lavoro è strutturato, corto, economicoSol (Sol Ultra / Codex se sei già su quella linea)compare un job computer-use o math che il 7,8% Standard ARC e l'Index a 61 di Sol non reggono
Ti servono PoC cyber offensiviNessuno SKU pubblicoDaybreak / Trusted Access, mentre la build pubblica continua a rifiutare

Fable 5.1 è il default. Astra è l'upgrade computer-use che non puoi comprare sul gateway contro cui abbiamo lanciato questo ping.

Sol è lo SKU OpenAI che già risponde. Rilancia il curl, poi muoviti.

Domande frequenti

GPT-6 Astra è AGI?

No. Greg Brockman ha usato «AGI era» in una call con la stampa. È una battuta, non un dato misurato. ARC Prize ha valutato Astra al 62,7% sul runner Standard ARC-AGI-3 e ha detto che non sta dichiarando l'AGI. La cifra 99,9% di OpenAI usava un Provider Adapter che tiene lo stato di reasoning opaco tra un turno e l'altro. Un punteggio adapter che satura non è lo stesso test a cui gli altri modelli si sono sottoposti.

Gli utenti ChatGPT del piano gratuito possono usare GPT-6 Astra?

Non secondo il post di lancio. OpenAI ha nominato Plus, Pro, Business ed Enterprise, più l'API, Azure e Bedrock, per l'onda dei «prossimi giorni». L'accesso al piano gratuito non è stato annunciato. Gli admin Enterprise hanno un toggle che parte spento. Tratta «oggi» come Daybreak / Trusted Access, a meno che l'admin del tuo workspace non abbia già attivato il toggle.

Quando arriva GPT-6 Astra su OpenRouter?

Non lo sappiamo. Il nostro ping del 4 settembre 2026 alle 14:40 UTC ha restituito HTTP 400 per openai/gpt-6-astra. Rilancia il curl nella sezione sull'accesso. Non riscrivere un router sulla promessa di un blog di lancio. Nel momento in cui l'ID diventa valido, la colonna «chiamabile oggi» della prima tabella si capovolge.

Perché alcune pagine dicono 99,9% su ARC-AGI-3 e altre 62,7%?

Due runner. Il runner Standard di ARC Prize è provider-neutral e ha segnato 62,7% a max effort ($26,098). Il Provider Adapter conserva lo stato di reasoning opaco di OpenAI e ha segnato 99,9% a high effort ($18,817). OpenAI ha aperto con il numero dell'adapter. Stampa sempre la coppia.

GPT-6 Astra mi scrive exploit proof-of-concept?

La build pubblica rifiuterà quella classe di richieste. OpenAI ha classificato Astra Critical per la cybersecurity sotto il Preparedness Framework e ha limitato il lavoro avanzato sugli exploit a Daybreak / Trusted Access. ExploitBench al 100% è stato misurato senza le salvaguardie di produzione. Review difensiva e patching sono i job cyber pubblici previsti.

Tag

gpt-6-astraclaude-fable-5-1openaiartificial-analysisllm-benchmarks

Condividi questo articolo

Il Tuo Prossimo Passo

Hai un progetto in mente? Parliamone.

Prenota una call di 30 minuti. Ti ascoltiamo, capiamo il problema e ti diciamo se possiamo aiutarti.