ai-machine-learning

Is GPT-6 Astra beter dan Fable?

Geschreven door Mert Batur
Sep 4, 2026
7 leestijd
Is GPT-6 Astra beter dan Fable?

Is GPT-6 Astra beter dan Fable?

GPT-6 Astra is niet beter dan Claude Fable 5.1 op het onafhankelijke scorebord dat algemene intelligentie écht rangschikt.

Artificial Analysis zette Astra op 61 op Intelligence Index v4.1.1 op 3 september 2026, en Fable 5.1 op 66. OpenAI's eigen lanceringstabel drukt die rij 61,2 vs 65,7 nog steeds af en zet daarna “the world's most intelligent model” als kop.

We stuurden een OpenRouter-ping naar openai/gpt-6-astra om 14:40 UTC op 4 september 2026. De gateway gaf HTTP 400 terug: not a valid model ID. Fable 5.1 stond diezelfde middag al op de lijst. Onze setup is die gateway, geen private OpenAI-key.

GPT-6 Astra vs Fable 5.1: welke blijf je gebruiken?

Blijf vanochtend op Fable 5.1; Astra wint computer-use en wiskunde op vendorrijen, niet op de onafhankelijke index.

De Claude Fable 5.1-review heeft de 5.1 vs 5 vs Opus 5-factuur al. Deze tabel is de split tussen labs.

DeurAanroepbaar op OpenRouter 2026-09-04AA Intelligence IndexAA Coding Agent IndexLijstprijs (in/out)Cache read
Claude Fable 5.1Ja (anthropic/claude-fable-5.1)6670$10 / $50$0.25
GPT-6 AstraNee (HTTP 400)6167$10 / $50$1.00
GPT-5.6 SolJa (openai/gpt-5.6-sol)6165$2 / $10 op OpenRouter; AA citeert nog $4 / $20 lijst$0.20 / 90% korting

Bronnen: Artificial Analysis Astra en Fable 5.1, 3 september en 1 september 2026; OpenAI-modelkaart voor de Astra-lijstprijs; onze test van de aanroepbaar-kolom is de OpenRouter-ping.

Astra is het computer-use- en FrontierMath-verhaal. Fable 5.1 is het intelligence-index- en cache-read-verhaal.

Sol is het model dat je nu al kunt aanroepen voor een fractie van de $10/$50-kaart. Behandel “beter” als een workload, niet als een kop.

Kun je GPT-6 Astra vandaag überhaupt aanroepen?

Niet via OpenRouter. openai/gpt-6-astra gaf HTTP 400 terug om 14:40 UTC op 2026-09-04.

OpenAI's lanceerpost zegt dat een beperkt aantal organisaties het op 3 september kreeg, met ChatGPT Plus, Pro, Business, Enterprise, de API, Azure en Bedrock “over the coming days.” Toegang voor de free tier is niet aangekondigd. Enterprise-workspaces komen met Astra uit.

anthropic/claude-fable-5.1 en openai/gpt-5.6-sol waren allebei diezelfde middag aanroepbaar op OpenRouter.

Als je stack al achter een gateway hangt, is die 400 het enige getal dat telt tot de ID landt.

bash
curl -sS https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400  {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37Z

Draai die ping opnieuw voordat je een router herschrijft. Een blogpost van 4 september veroudert het uur dat de ID landt.

Zijn onafhankelijke benches het eens dat Astra slimmer is?

Nee. Artificial Analysis zet Fable 5.1 op 66 en Astra op 61 op Intelligence Index v4.1.1.

OpenAI schreef nog steeds “world's most intelligent” boven een tabel die dat verlies al bevat. Het codingverhaal heeft dezelfde vorm: OpenAI noemt Astra het beste software-engineeringmodel tot nu toe; AA's Coding Agent Index heeft Fable 5.1 op 70 en Astra op 67.

De ARC-AGI-3-kop is een runner-split, geen AGI-certificaat. OpenAI drukte 99,9% af. ARC Prize draaide hetzelfde model op de provider-neutrale Standard-runner en kreeg 62,7% op max effort voor $26,098.

De 99,9%-run gebruikte een Provider Adapter die OpenAI's verborgen reasoning-state tussen beurten bewaart, op high effort, voor $18,817. Claude Opus 5 staat op 30,2% op dat Standard-bord. GPT-5.6 Sol staat op 7,8%. Astra verdubbelde de vorige Standard-SOTA. Het verzadigde de benchmark niet onder de runner die elk ander lab kan delen.

BenchGPT-6 AstraClaude Fable 5.1Bron
AA Intelligence Index v4.1.16166Artificial Analysis
AA Coding Agent Index6770Artificial Analysis
Terminal-Bench 4.057,9%55,8%OpenAI
DeepSWE v1.174,1%67,4%OpenAI
AutomationBench41,4%31,4%OpenAI
Terminal-Bench Science 0.164,6%52,6%OpenAI
FrontierMath Tier 4 v297,6%87,8%OpenAI
GPQA Diamond96,0%93,7%OpenAI
Humanity's Last Exam (w/ tools)57,2%65,0%OpenAI
ARC-AGI-3 Standard62,7% ($26,098)niet gescoordARC Prize
ARC-AGI-3 Provider Adapter99,9% ($18,817)niet gescoordOpenAI / ARC Prize
Vals Index66,61% · $19.09/testniet opgehaaldVals.ai, 4 september 2026

AA gaf ook $3,020.82 uit om Astra door de Intelligence Index te halen. Tokenzuinigheid versus Sol is echt. Het duwt de index niet voorbij Fable 5.1.

Hallucinatie op AA-Omniscience daalde van 92% naar 51% op max effort versus Sol. Dat is de schoonste onafhankelijke winst die Astra heeft op kennisbetrouwbaarheid.

OpenAI's “most intelligent”-regel en de 62,7% Standard-score van ARC Prize kunnen niet allebei het hele verhaal zijn. Noem beide.

Wat doet de $10/$50-factuur vs Fable?

Zelfde lijstprijs, duurdere cache reads: Astra $1.00 vs Fable 5.1 $0.25 per miljoen.

De GPT-6 Astra-modelkaart noteert $10 input, $50 output, $1.00 cached input, $12.50 cache writes, een contextvenster van 1.050.000 tokens, 128.000 max output en een knowledge cutoff van 30 april 2026. Prompts boven 272k input-tokens factureren 2× op input en cache en 1,5× op output. Fast mode is 2×. Batch en Flex zijn 50%.

Fable 5.1 zit op dezelfde $10/$50-kaart. De Fable 5.1-review heeft de cache-read-verlaging naar $0.25 al gemeten. Bouw die probe hier niet opnieuw; citeer de Fable 5.1-review en gebruik de lijstcijfers.

Een 30-dagenjob van 2,4 miljoen input-tokens en 380.000 output-tokens per dag, tegen $10/$50, is:

text
2,400,000 × 30 × $10 / 1,000,000  = $720  input
  380,000 × 30 × $50 / 1,000,000  = $570  output
                                  = $1,290

Die $1,290 is identiek op Astra en Fable 5.1 vóór cache. Veertig herlezingen van een gecached prefix van 200.000 tokens zijn dat niet:

Cache-read-regelTarief40 × 200.000 tokens
Claude Fable 5.1$0.25 / MTok$2.00
GPT-6 Astra$1.00 / MTok$8.00

Vier keer de cacheregel, dezelfde outputkaart.

Voor de rest van het inference-kostenmodel stapelt dat gat zich op bij elke agent die een systemprefix herleest. AA's eigen artikel zegt dat Astra ongeveer 75% duurder is per Intelligence Index-taak dan Sol op max effort, omdat de 2,5×-prijsstijging de ~10% tokenbesparing opeet.

Sol blijft de goedkope OpenAI-deur.

Voor welke reële taken is Astra écht bedoeld?

OpenAI meldt dat Astra OSWorld 2.0 afrondt op 72,6% in ongeveer 40 minuten, versus Sol op 65,7% in 75.

Dat is de computer-use-claim, en het is OpenAI's cijfer, niet het onze. ScreenSpot-Pro zonder tools is 92,7% tegen 76,9% van Sol. Agents' Last Exam is 59,3% tegen 53,6% van Sol en 48,7% van Fable 5 (OpenAI drukte daar geen Fable 5.1-rij af).

Toegeschreven demo's uit de lanceerpost, niet zelf gedraaid:

  1. Desktop- en browseragents. OSWorld 2.0 partial, ~47% minder doorlooptijd dan Sol. Koppel het pas aan coding-agent-tooling nadat de API-ID landt.
  2. Lange Codex-sessies. OpenAI levert notes die compaction overleven, zodat context van mislukte fixes doorzoekbaar blijft in plaats van te verdwijnen in een samenvatting.
  3. Game- en spatial werk. Playco zegt dat Astra het aantal handmatige fixes op Unity/Godot-prototypes met ongeveer 50% terugbracht. Dat is Playco die praat, in een OpenAI-casestudy.
  4. Defensive cyber. Astra is het eerste OpenAI-model dat Critical scoort onder het Preparedness Framework. De productiebuild weigert proof-of-concept-exploits. Geavanceerde workflows zitten achter Daybreak / Trusted Access.
  5. Wiskunde die een bord verzadigt. FrontierMath Tier 4 v2 op 97,6% vs Fable 5.1 op 87,8%, vendor-run. Epoch AI financiert een deel van dat bord; behandel het als OpenAI-adjacent.

Waar het vandaag niet voor is: een naïeve model=-swap op OpenRouter, een goedkopere Fable, of de claim dat 99,9% op ARC-AGI-3 AGI betekent.

Greg Brockman zei tegen journalisten “Welcome to the AGI era.” WIRED drukte de quote af. ARC Prize, dat de benchmark bouwde, claimt geen AGI.

Blijf je op Fable 5.1, wacht je op Astra of blijf je op Sol?

Blijf op Fable 5.1 tot Astra's model-ID landt op je gateway en je werk computer-use of FrontierMath is.

Routeer op workload, niet op de lanceerblog.

Als dit kloptBlijven bijOverschakelen wanneer
Je hebt vanochtend een model nodig op OpenRouterFable 5.1 (of Sol als de $10/$50-kaart het probleem is)openai/gpt-6-astra geeft 200 terug op de ping hierboven
Je eval is AA Intelligence Index / HLE-with-tools / cache-zware agentsFable 5.1De onafhankelijke Index schuift écht voorbij 66, of je cache-read-rekening is niet de regel die telt
Je eval is OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMathWacht op AstraDe ID landt én je kunt de job meten op je eigen traces
Je zit nog op GPT-5.6 Sol en het werk is kort en goedkoop, met vaste structuurSol (Sol Ultra / Codex als dat al je lane is)Er duikt een computer-use- of wiskundejob op die de 7,8% Standard ARC en 61 Index van Sol niet tillen
Je hebt offensieve cyber-PoC's nodigGeen van beide publieke SKU'sDaybreak / Trusted Access, met de weigeringen nog op de publieke build

Fable 5.1 is de default. Astra is de computer-use-upgrade die je niet kunt kopen op de gateway waarop we deze ping draaiden.

Sol is de OpenAI-SKU die al antwoordt. Draai de curl opnieuw, en stap dan over.

Veelgestelde vragen

Is GPT-6 Astra AGI?

Nee. Greg Brockman gebruikte “AGI era” op een perscall. Dat is een opmerking, geen gemeten bevinding. ARC Prize scoorde Astra op 62,7% op de Standard ARC-AGI-3-runner en zei geen AGI te claimen. OpenAI's 99,9%-cijfer gebruikte een Provider Adapter die verborgen reasoning-state tussen beurten bewaart. Een verzadigende adapterscore is niet dezelfde test die elk ander model deed.

Krijgen gratis ChatGPT-gebruikers GPT-6 Astra?

Niet volgens de lanceerpost. OpenAI noemde Plus, Pro, Business en Enterprise, plus de API, Azure en Bedrock, voor de “coming days”-golf. Free-tier-toegang is niet aangekondigd. Enterprise-admins krijgen een toggle die standaard uit staat. Behandel “vandaag” als Daybreak / Trusted Access, tenzij je workspace-admin die schakelaar heeft omgezet.

Wanneer verschijnt GPT-6 Astra op OpenRouter?

Onbekend. Onze ping van 4 september 2026 om 14:40 UTC gaf HTTP 400 terug voor openai/gpt-6-astra. Draai de curl in de toegangssectie opnieuw. Herschrijf geen router op een belofte uit de lanceerblog. Zodra de ID landt, klapt de aanroepbaar-vandaag-kolom in de eerste tabel om.

Waarom zeggen sommige pagina's 99,9% op ARC-AGI-3 en andere 62,7%?

Twee runners. De Standard-runner van ARC Prize is provider-neutraal en scoorde 62,7% op max effort ($26,098). De Provider Adapter bewaart OpenAI's ondoorzichtige reasoning-state en scoorde 99,9% op high effort ($18,817). OpenAI opende met het adaptercijfer. Noem altijd het paar.

Schrijft GPT-6 Astra proof-of-concept-exploits voor me?

De publieke build weigert die klasse verzoeken. OpenAI beoordeelde Astra als Critical voor cybersecurity onder het Preparedness Framework en beperkte geavanceerd exploitwerk tot Daybreak / Trusted Access. ExploitBench 100% is gemeten zonder productiebeveiligingen. Defensive review en patchen zijn de bedoelde publieke cyberjobs.

Tags

gpt-6-astraclaude-fable-5-1openaiartificial-analysisllm-benchmarks

Dit artikel delen

Start je project

Klaar om iets buitengewoons te bouwen?

Laten we je idee werkelijkheid maken. Ons team staat klaar om software te bouwen die het verschil maakt.