ai-machine-learning

GPT-6 Astra est-il meilleur que Fable ?

Écrit par Mert Batur
Sep 4, 2026
9 lecture
GPT-6 Astra est-il meilleur que Fable ?

GPT-6 Astra est-il meilleur que Fable ?

GPT-6 Astra n'est pas meilleur que Claude Fable 5.1 sur le tableau de score indépendant qui classe vraiment l'intelligence générale.

Artificial Analysis a mis Astra à 61 sur l'Intelligence Index v4.1.1 le 3 septembre 2026, et Fable 5.1 à 66. Le tableau de lancement d'OpenAI affiche encore cette ligne 61,2 vs 65,7, puis ouvre avec « le modèle le plus intelligent du monde ».

On a envoyé un ping OpenRouter pour openai/gpt-6-astra à 14:40 UTC le 4 septembre 2026. La gateway a renvoyé HTTP 400 : not a valid model ID. Fable 5.1 était déjà sur la même liste. Notre setup, c'est cette gateway, pas une clé OpenAI privée.

GPT-6 Astra vs Fable 5.1 : lequel garder ?

Garde Fable 5.1 ce matin ; Astra gagne le computer-use et les maths sur les lignes vendeur, pas sur l'index indépendant.

La revue Claude Fable 5.1 porte déjà la facture 5.1 vs 5 vs Opus 5. Ce tableau, c'est l'écart entre labs.

PorteAppelable sur OpenRouter 2026-09-04AA Intelligence IndexAA Coding Agent IndexTarif catalogue (entrée/sortie)Cache read
Claude Fable 5.1Oui (anthropic/claude-fable-5.1)6670$10 / $50$0.25
GPT-6 AstraNon (HTTP 400)6167$10 / $50$1.00
GPT-5.6 SolOui (openai/gpt-5.6-sol)6165$2 / $10 sur OpenRouter ; AA cite encore $4 / $20 catalogue$0.20 / -90 %

Sources : Artificial Analysis Astra et Fable 5.1, 3 septembre et 1er septembre 2026 ; fiche modèle OpenAI pour le tarif catalogue Astra ; notre test de la colonne appelable, c'est le ping OpenRouter.

Astra, c'est l'histoire computer-use et FrontierMath. Fable 5.1, c'est l'histoire index d'intelligence et cache-read.

Sol est le modèle que tu peux déjà appeler pour une fraction de la carte $10/$50. Traite « meilleur » comme une charge de travail, pas un titre.

Peux-tu seulement appeler GPT-6 Astra aujourd'hui ?

Pas depuis OpenRouter. openai/gpt-6-astra a renvoyé HTTP 400 à 14:40 UTC le 2026-09-04.

Le post de lancement d'OpenAI dit qu'un ensemble limité d'organisations l'a reçu le 3 septembre, avec ChatGPT Plus, Pro, Business, Enterprise, l'API, Azure et Bedrock qui suivent « dans les jours qui viennent ». L'accès à l'offre gratuite n'est pas annoncé. Les workspaces Enterprise arrivent avec Astra off.

anthropic/claude-fable-5.1 et openai/gpt-5.6-sol étaient tous deux appelables sur OpenRouter le même après-midi.

Si ta stack passe déjà par une gateway, ce 400 est le seul chiffre qui compte jusqu'à ce que l'ID se résolve.

bash
curl -sS https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400  {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37Z

Relance ce ping avant de réécrire un routeur. Un article daté du 4 septembre sera périmé l'heure où l'ID atterrit.

Les benches indépendants disent-ils qu'Astra est plus intelligent ?

Non. Artificial Analysis met Fable 5.1 à 66 et Astra à 61 sur l'Intelligence Index v4.1.1.

OpenAI a quand même écrit « le plus intelligent du monde » au-dessus d'un tableau qui contient déjà cette défaite. Côté coding, même schéma : OpenAI dit qu'Astra est le meilleur modèle d'ingénierie logicielle à ce jour ; le Coding Agent Index d'AA place Fable 5.1 à 70 et Astra à 67.

Le titre ARC-AGI-3, c'est un écart de runner, pas un certificat AGI. OpenAI a publié 99,9%. ARC Prize a lancé le même modèle sur son runner Standard neutre vis-à-vis du fournisseur et a obtenu 62,7% à effort max pour $26,098.

Le run à 99,9% a utilisé un Provider Adapter qui conserve l'état de reasoning caché d'OpenAI entre les tours, à high effort, pour $18,817. Claude Opus 5 est à 30,2% sur ce tableau Standard. GPT-5.6 Sol est à 7,8%. Astra a doublé le SOTA Standard précédent. Il n'a pas saturé le benchmark sous le runner que tous les autres labs peuvent partager.

BenchGPT-6 AstraClaude Fable 5.1Source
AA Intelligence Index v4.1.16166Artificial Analysis
AA Coding Agent Index6770Artificial Analysis
Terminal-Bench 4.057,9%55,8%OpenAI
DeepSWE v1.174,1%67,4%OpenAI
AutomationBench41,4%31,4%OpenAI
Terminal-Bench Science 0.164,6%52,6%OpenAI
FrontierMath Tier 4 v297,6%87,8%OpenAI
GPQA Diamond96,0%93,7%OpenAI
Humanity's Last Exam (avec outils)57,2%65,0%OpenAI
ARC-AGI-3 Standard62,7% ($26,098)non notéARC Prize
ARC-AGI-3 Provider Adapter99,9% ($18,817)non notéOpenAI / ARC Prize
Vals Index66,61% · $19.09/testnon récupéréVals.ai, 4 septembre 2026

AA a aussi dépensé $3,020.82 pour faire tourner Astra sur l'Intelligence Index. L'économie de tokens face à Sol est réelle. Elle ne fait pas passer l'index au-dessus de Fable 5.1.

L'hallucination sur AA-Omniscience est passée de 92% à 51% à effort max contre Sol. C'est le gain indépendant le plus net d'Astra sur la fiabilité des connaissances.

La ligne « le plus intelligent » d'OpenAI et le score Standard 62,7% d'ARC Prize ne font pas, à eux deux, le tableau complet. Cite les deux.

Que fait la facture $10/$50 face à Fable ?

Même tarif catalogue, moins bonnes lectures cache : Astra $1.00 vs Fable 5.1 $0.25 par million.

La fiche modèle GPT-6 Astra liste $10 en entrée, $50 en sortie, $1.00 en entrée cachée, $12.50 en écritures cache, une fenêtre de contexte de 1 050 000 tokens, 128 000 en sortie max, et une coupure de connaissances au 30 avril 2026. Les prompts au-delà de 272k tokens d'entrée facturent 2× sur l'entrée et le cache, et 1,5× sur la sortie. Fast mode, 2×. Batch et Flex, 50%.

Fable 5.1 est sur la même carte $10/$50. L'article Fable 5.1 a déjà mesuré la baisse cache-read à $0.25. Ne reconstruis pas cette sonde ici ; cite la revue Fable 5.1 et utilise les chiffres catalogue.

Un job de 30 jours à 2,4 millions de tokens d'entrée et 380 000 tokens de sortie par jour, à $10/$50, ça donne :

text
2,400,000 × 30 × $10 / 1,000,000  = $720  input
  380,000 × 30 × $50 / 1,000,000  = $570  output
                                  = $1,290

Ces $1,290 sont identiques sur Astra et Fable 5.1 avant cache. Quarante relectures d'un préfixe mis en cache de 200 000 tokens, non :

Ligne cache-readTarif40 × 200 000 tokens
Claude Fable 5.1$0.25 / MTok$2.00
GPT-6 Astra$1.00 / MTok$8.00

Quatre fois la ligne cache, même carte de sortie.

Pour le reste du modèle de coût d'inférence, cet écart s'accumule sur tout agent qui relit un préfixe système. L'article d'AA dit qu'Astra coûte environ 75% plus cher par tâche Intelligence Index que Sol à effort max, parce que la hausse de prix 2,5× mange les ~10% de tokens en moins.

Sol reste la porte OpenAI pas chère.

Pour quels jobs réels Astra est-il vraiment fait ?

OpenAI rapporte qu'Astra termine OSWorld 2.0 à 72,6% en environ 40 minutes, contre Sol à 65,7% en 75.

C'est l'affirmation computer-use, et c'est le chiffre d'OpenAI, pas le nôtre. ScreenSpot-Pro sans outils est à 92,7% contre 76,9% pour Sol. Agents' Last Exam est à 59,3% contre 53,6% pour Sol et 48,7% pour Fable 5 (OpenAI n'a pas publié de ligne Fable 5.1 là).

Démos attribuées au post de lancement, pas reproduites ici :

  1. Agents desktop et navigateur. OSWorld 2.0 partiel, ~47% de temps d'horloge en moins que Sol. Branche-le sur les outils d'agents de codage seulement une fois l'ID API résolu.
  2. Longues sessions Codex. OpenAI livre des notes qui survivent à la compaction, donc le contexte d'un fix raté reste retrouvable au lieu d'être résumé et perdu.
  3. Jeux et spatial. Playco dit qu'Astra a réduit les correctifs manuels d'environ 50% sur des prototypes Unity/Godot. C'est Playco qui parle, dans une étude de cas OpenAI.
  4. Cyber défensif. Astra est le premier modèle OpenAI noté Critical sous le Preparedness Framework. Le build de production refuse les exploits proof-of-concept. Les workflows avancés restent derrière Daybreak / Trusted Access.
  5. Les maths qui saturent un tableau. FrontierMath Tier 4 v2 à 97,6% vs Fable 5.1 à 87,8%, mesuré par le vendeur. Epoch AI finance une partie de ce tableau ; traite-le comme adjacent à OpenAI.

Hors périmètre, aujourd'hui : un remplacement model= immédiat sur OpenRouter, un Fable moins cher, ou une affirmation que 99,9% sur ARC-AGI-3 veut dire AGI.

Greg Brockman a dit aux journalistes « Welcome to the AGI era. » WIRED a imprimé la citation. ARC Prize, qui a construit le benchmark, ne revendique pas l'AGI.

Tu restes sur Fable 5.1, tu attends Astra, ou tu restes sur Sol ?

Reste sur Fable 5.1 jusqu'à ce que l'ID de modèle d'Astra se résolve sur ta gateway et que ton travail soit du computer-use ou du FrontierMath.

Fais le routage selon la charge de travail, pas selon le blog de lancement.

Si c'est vraiGardeBascule quand
Tu as besoin d'un modèle ce matin sur OpenRouterFable 5.1 (ou Sol si la carte $10/$50 est le problème)openai/gpt-6-astra renvoie 200 sur le ping ci-dessus
Ton eval, c'est AA Intelligence Index / HLE-avec-outils / agents lourds en cacheFable 5.1L'Index indépendant passe vraiment au-dessus de 66, ou ta facture cache-read n'est pas la ligne qui compte
Ton eval, c'est OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMathAttendre AstraL'ID se résout et tu peux mesurer le job sur tes propres traces
Tu es encore sur GPT-5.6 Sol et le travail est structuré, court et pas cherSol (Sol Ultra / Codex si c'est déjà ta voie)Un job computer-use ou maths hors de portée du 7,8% Standard ARC et de l'Index 61 de Sol
Tu as besoin de PoC cyber offensifsAucun SKU publicDaybreak / Trusted Access, avec les refus toujours sur le build public

Fable 5.1 est le choix par défaut. Astra est l'upgrade computer-use que tu ne peux pas acheter sur la gateway contre laquelle on a lancé ce ping.

Sol est le SKU OpenAI qui répond déjà. Relance le curl, puis bascule.

Questions fréquentes

GPT-6 Astra est-il une AGI ?

Non. Greg Brockman a utilisé « AGI era » sur un appel presse. C'est une remarque, pas un constat mesuré. ARC Prize a noté Astra à 62,7% sur le runner Standard ARC-AGI-3 et a dit qu'il ne revendique pas l'AGI. Le chiffre 99,9% d'OpenAI a utilisé un Provider Adapter qui conserve l'état de reasoning opaque entre les tours. Un score d'adapter qui sature n'est pas le même test que celui passé par tous les autres modèles.

Les utilisateurs de ChatGPT gratuit peuvent-ils avoir GPT-6 Astra ?

Pas selon le post de lancement. OpenAI a nommé Plus, Pro, Business et Enterprise, plus l'API, Azure et Bedrock, pour la vague « dans les jours qui viennent ». L'accès à l'offre gratuite n'est pas annoncé. Les admins Enterprise ont un toggle qui démarre sur off. Traite « aujourd'hui » comme Daybreak / Trusted Access, sauf si l'admin de ton workspace a basculé ce switch.

Quand GPT-6 Astra arrivera-t-il sur OpenRouter ?

Inconnu. Notre ping du 4 septembre 2026 à 14:40 UTC a renvoyé HTTP 400 pour openai/gpt-6-astra. Relance le curl dans la section accès. Ne réécris pas un routeur sur une promesse de blog de lancement. Le moment où l'ID se résout, la colonne appelable du premier tableau bascule.

Pourquoi certaines pages disent 99,9% sur ARC-AGI-3 et d'autres 62,7% ?

Deux runners. Le runner Standard d'ARC Prize est neutre vis-à-vis du fournisseur et a marqué 62,7% à effort max ($26,098). Le Provider Adapter conserve l'état de reasoning opaque d'OpenAI et a marqué 99,9% à high effort ($18,817). OpenAI a mis en avant le chiffre de l'adapter. Cite toujours la paire.

GPT-6 Astra va-t-il m'écrire des exploits proof-of-concept ?

Le build public refusera cette classe de requête. OpenAI a noté Astra Critical pour la cybersécurité sous son Preparedness Framework et a limité le travail d'exploit avancé à Daybreak / Trusted Access. ExploitBench 100% a été mesuré sans les garde-fous de production. La revue défensive et le patching sont les jobs cyber publics visés.

Tags

gpt-6-astraclaude-fable-5-1openaiartificial-analysisbenchmarks-llm

Partager cet article

Démarrez Votre Projet

Prêt à construire quelque chose d'extraordinaire ?

Transformons votre vision en réalité. Notre équipe est prête à vous aider à créer un logiciel qui fait la différence.