
Is GPT-6 Astra beter dan Fable?
GPT-6 Astra is niet beter dan Claude Fable 5.1 op het onafhankelijke scorebord dat algemene intelligentie écht rangschikt.
Artificial Analysis zette Astra op 61 op Intelligence Index v4.1.1 op 3 september 2026, en Fable 5.1 op 66. OpenAI's eigen lanceringstabel drukt die rij 61,2 vs 65,7 nog steeds af en zet daarna “the world's most intelligent model” als kop.
We stuurden een OpenRouter-ping naar openai/gpt-6-astra om 14:40 UTC op 4 september 2026. De gateway gaf HTTP 400 terug: not a valid model ID. Fable 5.1 stond diezelfde middag al op de lijst. Onze setup is die gateway, geen private OpenAI-key.
GPT-6 Astra vs Fable 5.1: welke blijf je gebruiken?
Blijf vanochtend op Fable 5.1; Astra wint computer-use en wiskunde op vendorrijen, niet op de onafhankelijke index.
De Claude Fable 5.1-review heeft de 5.1 vs 5 vs Opus 5-factuur al. Deze tabel is de split tussen labs.
| Deur | Aanroepbaar op OpenRouter 2026-09-04 | AA Intelligence Index | AA Coding Agent Index | Lijstprijs (in/out) | Cache read |
|---|---|---|---|---|---|
| Claude Fable 5.1 | Ja (anthropic/claude-fable-5.1) | 66 | 70 | $10 / $50 | $0.25 |
| GPT-6 Astra | Nee (HTTP 400) | 61 | 67 | $10 / $50 | $1.00 |
| GPT-5.6 Sol | Ja (openai/gpt-5.6-sol) | 61 | 65 | $2 / $10 op OpenRouter; AA citeert nog $4 / $20 lijst | $0.20 / 90% korting |
Bronnen: Artificial Analysis Astra en Fable 5.1, 3 september en 1 september 2026; OpenAI-modelkaart voor de Astra-lijstprijs; onze test van de aanroepbaar-kolom is de OpenRouter-ping.
Astra is het computer-use- en FrontierMath-verhaal. Fable 5.1 is het intelligence-index- en cache-read-verhaal.
Sol is het model dat je nu al kunt aanroepen voor een fractie van de $10/$50-kaart. Behandel “beter” als een workload, niet als een kop.
Kun je GPT-6 Astra vandaag überhaupt aanroepen?
Niet via OpenRouter. openai/gpt-6-astra gaf HTTP 400 terug om 14:40 UTC op 2026-09-04.
OpenAI's lanceerpost zegt dat een beperkt aantal organisaties het op 3 september kreeg, met ChatGPT Plus, Pro, Business, Enterprise, de API, Azure en Bedrock “over the coming days.” Toegang voor de free tier is niet aangekondigd. Enterprise-workspaces komen met Astra uit.
anthropic/claude-fable-5.1 en openai/gpt-5.6-sol waren allebei diezelfde middag aanroepbaar op OpenRouter.
Als je stack al achter een gateway hangt, is die 400 het enige getal dat telt tot de ID landt.
curl -sS https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400 {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37ZDraai die ping opnieuw voordat je een router herschrijft. Een blogpost van 4 september veroudert het uur dat de ID landt.
Zijn onafhankelijke benches het eens dat Astra slimmer is?
Nee. Artificial Analysis zet Fable 5.1 op 66 en Astra op 61 op Intelligence Index v4.1.1.
OpenAI schreef nog steeds “world's most intelligent” boven een tabel die dat verlies al bevat. Het codingverhaal heeft dezelfde vorm: OpenAI noemt Astra het beste software-engineeringmodel tot nu toe; AA's Coding Agent Index heeft Fable 5.1 op 70 en Astra op 67.
De ARC-AGI-3-kop is een runner-split, geen AGI-certificaat. OpenAI drukte 99,9% af. ARC Prize draaide hetzelfde model op de provider-neutrale Standard-runner en kreeg 62,7% op max effort voor $26,098.
De 99,9%-run gebruikte een Provider Adapter die OpenAI's verborgen reasoning-state tussen beurten bewaart, op high effort, voor $18,817. Claude Opus 5 staat op 30,2% op dat Standard-bord. GPT-5.6 Sol staat op 7,8%. Astra verdubbelde de vorige Standard-SOTA. Het verzadigde de benchmark niet onder de runner die elk ander lab kan delen.
| Bench | GPT-6 Astra | Claude Fable 5.1 | Bron |
|---|---|---|---|
| AA Intelligence Index v4.1.1 | 61 | 66 | Artificial Analysis |
| AA Coding Agent Index | 67 | 70 | Artificial Analysis |
| Terminal-Bench 4.0 | 57,9% | 55,8% | OpenAI |
| DeepSWE v1.1 | 74,1% | 67,4% | OpenAI |
| AutomationBench | 41,4% | 31,4% | OpenAI |
| Terminal-Bench Science 0.1 | 64,6% | 52,6% | OpenAI |
| FrontierMath Tier 4 v2 | 97,6% | 87,8% | OpenAI |
| GPQA Diamond | 96,0% | 93,7% | OpenAI |
| Humanity's Last Exam (w/ tools) | 57,2% | 65,0% | OpenAI |
| ARC-AGI-3 Standard | 62,7% ($26,098) | niet gescoord | ARC Prize |
| ARC-AGI-3 Provider Adapter | 99,9% ($18,817) | niet gescoord | OpenAI / ARC Prize |
| Vals Index | 66,61% · $19.09/test | niet opgehaald | Vals.ai, 4 september 2026 |
AA gaf ook $3,020.82 uit om Astra door de Intelligence Index te halen. Tokenzuinigheid versus Sol is echt. Het duwt de index niet voorbij Fable 5.1.
Hallucinatie op AA-Omniscience daalde van 92% naar 51% op max effort versus Sol. Dat is de schoonste onafhankelijke winst die Astra heeft op kennisbetrouwbaarheid.
OpenAI's “most intelligent”-regel en de 62,7% Standard-score van ARC Prize kunnen niet allebei het hele verhaal zijn. Noem beide.
Wat doet de $10/$50-factuur vs Fable?
Zelfde lijstprijs, duurdere cache reads: Astra $1.00 vs Fable 5.1 $0.25 per miljoen.
De GPT-6 Astra-modelkaart noteert $10 input, $50 output, $1.00 cached input, $12.50 cache writes, een contextvenster van 1.050.000 tokens, 128.000 max output en een knowledge cutoff van 30 april 2026. Prompts boven 272k input-tokens factureren 2× op input en cache en 1,5× op output. Fast mode is 2×. Batch en Flex zijn 50%.
Fable 5.1 zit op dezelfde $10/$50-kaart. De Fable 5.1-review heeft de cache-read-verlaging naar $0.25 al gemeten. Bouw die probe hier niet opnieuw; citeer de Fable 5.1-review en gebruik de lijstcijfers.
Een 30-dagenjob van 2,4 miljoen input-tokens en 380.000 output-tokens per dag, tegen $10/$50, is:
2,400,000 × 30 × $10 / 1,000,000 = $720 input
380,000 × 30 × $50 / 1,000,000 = $570 output
= $1,290Die $1,290 is identiek op Astra en Fable 5.1 vóór cache. Veertig herlezingen van een gecached prefix van 200.000 tokens zijn dat niet:
| Cache-read-regel | Tarief | 40 × 200.000 tokens |
|---|---|---|
| Claude Fable 5.1 | $0.25 / MTok | $2.00 |
| GPT-6 Astra | $1.00 / MTok | $8.00 |
Vier keer de cacheregel, dezelfde outputkaart.
Voor de rest van het inference-kostenmodel stapelt dat gat zich op bij elke agent die een systemprefix herleest. AA's eigen artikel zegt dat Astra ongeveer 75% duurder is per Intelligence Index-taak dan Sol op max effort, omdat de 2,5×-prijsstijging de ~10% tokenbesparing opeet.
Sol blijft de goedkope OpenAI-deur.
Voor welke reële taken is Astra écht bedoeld?
OpenAI meldt dat Astra OSWorld 2.0 afrondt op 72,6% in ongeveer 40 minuten, versus Sol op 65,7% in 75.
Dat is de computer-use-claim, en het is OpenAI's cijfer, niet het onze. ScreenSpot-Pro zonder tools is 92,7% tegen 76,9% van Sol. Agents' Last Exam is 59,3% tegen 53,6% van Sol en 48,7% van Fable 5 (OpenAI drukte daar geen Fable 5.1-rij af).
Toegeschreven demo's uit de lanceerpost, niet zelf gedraaid:
- Desktop- en browseragents. OSWorld 2.0 partial, ~47% minder doorlooptijd dan Sol. Koppel het pas aan coding-agent-tooling nadat de API-ID landt.
- Lange Codex-sessies. OpenAI levert notes die compaction overleven, zodat context van mislukte fixes doorzoekbaar blijft in plaats van te verdwijnen in een samenvatting.
- Game- en spatial werk. Playco zegt dat Astra het aantal handmatige fixes op Unity/Godot-prototypes met ongeveer 50% terugbracht. Dat is Playco die praat, in een OpenAI-casestudy.
- Defensive cyber. Astra is het eerste OpenAI-model dat Critical scoort onder het Preparedness Framework. De productiebuild weigert proof-of-concept-exploits. Geavanceerde workflows zitten achter Daybreak / Trusted Access.
- Wiskunde die een bord verzadigt. FrontierMath Tier 4 v2 op 97,6% vs Fable 5.1 op 87,8%, vendor-run. Epoch AI financiert een deel van dat bord; behandel het als OpenAI-adjacent.
Waar het vandaag niet voor is: een naïeve model=-swap op OpenRouter, een goedkopere Fable, of de claim dat 99,9% op ARC-AGI-3 AGI betekent.
Greg Brockman zei tegen journalisten “Welcome to the AGI era.” WIRED drukte de quote af. ARC Prize, dat de benchmark bouwde, claimt geen AGI.
Blijf je op Fable 5.1, wacht je op Astra of blijf je op Sol?
Blijf op Fable 5.1 tot Astra's model-ID landt op je gateway en je werk computer-use of FrontierMath is.
Routeer op workload, niet op de lanceerblog.
| Als dit klopt | Blijven bij | Overschakelen wanneer |
|---|---|---|
| Je hebt vanochtend een model nodig op OpenRouter | Fable 5.1 (of Sol als de $10/$50-kaart het probleem is) | openai/gpt-6-astra geeft 200 terug op de ping hierboven |
| Je eval is AA Intelligence Index / HLE-with-tools / cache-zware agents | Fable 5.1 | De onafhankelijke Index schuift écht voorbij 66, of je cache-read-rekening is niet de regel die telt |
| Je eval is OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMath | Wacht op Astra | De ID landt én je kunt de job meten op je eigen traces |
| Je zit nog op GPT-5.6 Sol en het werk is kort en goedkoop, met vaste structuur | Sol (Sol Ultra / Codex als dat al je lane is) | Er duikt een computer-use- of wiskundejob op die de 7,8% Standard ARC en 61 Index van Sol niet tillen |
| Je hebt offensieve cyber-PoC's nodig | Geen van beide publieke SKU's | Daybreak / Trusted Access, met de weigeringen nog op de publieke build |
Fable 5.1 is de default. Astra is de computer-use-upgrade die je niet kunt kopen op de gateway waarop we deze ping draaiden.
Sol is de OpenAI-SKU die al antwoordt. Draai de curl opnieuw, en stap dan over.
Veelgestelde vragen
Is GPT-6 Astra AGI?
Nee. Greg Brockman gebruikte “AGI era” op een perscall. Dat is een opmerking, geen gemeten bevinding. ARC Prize scoorde Astra op 62,7% op de Standard ARC-AGI-3-runner en zei geen AGI te claimen. OpenAI's 99,9%-cijfer gebruikte een Provider Adapter die verborgen reasoning-state tussen beurten bewaart. Een verzadigende adapterscore is niet dezelfde test die elk ander model deed.
Krijgen gratis ChatGPT-gebruikers GPT-6 Astra?
Niet volgens de lanceerpost. OpenAI noemde Plus, Pro, Business en Enterprise, plus de API, Azure en Bedrock, voor de “coming days”-golf. Free-tier-toegang is niet aangekondigd. Enterprise-admins krijgen een toggle die standaard uit staat. Behandel “vandaag” als Daybreak / Trusted Access, tenzij je workspace-admin die schakelaar heeft omgezet.
Wanneer verschijnt GPT-6 Astra op OpenRouter?
Onbekend. Onze ping van 4 september 2026 om 14:40 UTC gaf HTTP 400 terug voor openai/gpt-6-astra. Draai de curl in de toegangssectie opnieuw. Herschrijf geen router op een belofte uit de lanceerblog. Zodra de ID landt, klapt de aanroepbaar-vandaag-kolom in de eerste tabel om.
Waarom zeggen sommige pagina's 99,9% op ARC-AGI-3 en andere 62,7%?
Twee runners. De Standard-runner van ARC Prize is provider-neutraal en scoorde 62,7% op max effort ($26,098). De Provider Adapter bewaart OpenAI's ondoorzichtige reasoning-state en scoorde 99,9% op high effort ($18,817). OpenAI opende met het adaptercijfer. Noem altijd het paar.
Schrijft GPT-6 Astra proof-of-concept-exploits voor me?
De publieke build weigert die klasse verzoeken. OpenAI beoordeelde Astra als Critical voor cybersecurity onder het Preparedness Framework en beperkte geavanceerd exploitwerk tot Daybreak / Trusted Access. ExploitBench 100% is gemeten zonder productiebeveiligingen. Defensive review en patchen zijn de bedoelde publieke cyberjobs.