ai-machine-learning

Er GPT-6 Astra bedre enn Fable?

Skrevet av Mert Batur
Sep 4, 2026
7 lesing
Er GPT-6 Astra bedre enn Fable?

Er GPT-6 Astra bedre enn Fable?

GPT-6 Astra er ikke bedre enn Claude Fable 5.1 på den uavhengige indeksen som faktisk rangerer generell intelligens.

Artificial Analysis ga Astra 61 på Intelligence Index v4.1.1 3. september 2026, og Fable 5.1 66. OpenAIs egen lanseringstabell har fortsatt raden 61,2 mot 65,7, og åpner med «verdens mest intelligente modell».

Vi pinget OpenRouter for openai/gpt-6-astra kl. 14:40 UTC 4. september 2026. Gatewayen returnerte HTTP 400: not a valid model ID. Fable 5.1 lå allerede på samme liste. Oppsettet vårt er den gatewayen, ikke en privat OpenAI-nøkkel.

GPT-6 Astra vs Fable 5.1: hvilken bør du beholde?

Behold Fable 5.1 i dag. Astra vinner computer-use og matte på OpenAIs egne rader, ikke på den uavhengige indeksen.

Claude Fable 5.1-anmeldelsen har allerede 5.1 vs 5 vs Opus 5-fakturaen. Denne tabellen er skillet mellom labene.

DørKallbar på OpenRouter 2026-09-04AA Intelligence IndexAA Coding Agent IndexListepris (inn/ut)Cache-read
Claude Fable 5.1Ja (anthropic/claude-fable-5.1)6670$10 / $50$0.25
GPT-6 AstraNei (HTTP 400)6167$10 / $50$1.00
GPT-5.6 SolJa (openai/gpt-5.6-sol)6165$2 / $10 på OpenRouter; AA siterer fortsatt $4 / $20 i listepris$0.20 / 90 % rabatt

Kilder: Artificial Analysis Astra og Fable 5.1, 3. september og 1. september 2026; OpenAIs model card for Astra-listepris; sjekken vår av kallbar-kolonnen er OpenRouter-pinget.

Astra er computer-use- og FrontierMath-historien. Fable 5.1 er intelligence-index- og cache-read-historien.

Sol er modellen du allerede kan kalle, til en brøkdel av $10/$50-kortet. Behandle «bedre» som en jobb, ikke som en overskrift.

Kan du i det hele tatt kalle GPT-6 Astra i dag?

Ikke fra OpenRouter. openai/gpt-6-astra returnerte HTTP 400 kl. 14:40 UTC 2026-09-04.

OpenAIs lanseringsinnlegg sier at et begrenset antall organisasjoner fikk den 3. september. ChatGPT Plus, Pro, Business, Enterprise, API-et, Azure og Bedrock følger «i løpet av de kommende dagene». Tilgang på gratislaget er ikke kunngjort. Enterprise-workspaces leveres med Astra av.

anthropic/claude-fable-5.1 og openai/gpt-5.6-sol var begge kallbare på OpenRouter samme ettermiddag.

Hvis stakken din allerede ligger bak en gateway, er den 400-en det eneste tallet som gjelder til ID-en går gjennom.

bash
curl -sS https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400  {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37Z

Kjør pinget på nytt før du skriver om en router. Et blogginnlegg datert 4. september blir gammelt den timen ID-en blir gyldig.

Er uavhengige tester enige i at Astra er smartere?

Nei. Artificial Analysis setter Fable 5.1 til 66 og Astra til 61 på Intelligence Index v4.1.1.

OpenAI skrev likevel «verdens mest intelligente» over en tabell som allerede inneholder det tapet. Samme mønster på koding: OpenAI kaller Astra den beste software engineering-modellen til nå. AAs Coding Agent Index har Fable 5.1 på 70 og Astra på 67.

ARC-AGI-3-overskriften er et skille mellom runnere, ikke et AGI-bevis. OpenAI oppga 99,9 %. ARC Prize kjørte samme modell på sin leverandørnøytrale Standard-runner og fikk 62,7 % på max effort for $26,098.

99,9 %-kjøringen brukte en Provider Adapter som beholder OpenAIs skjulte reasoning-state mellom turer, på high effort, for $18,817. Claude Opus 5 ligger på 30,2 % på den Standard-tavlen. GPT-5.6 Sol ligger på 7,8 %. Astra doblet den forrige Standard-SOTAen. Den mettet ikke benchmarken under runneren som alle andre laber kan dele.

BenchGPT-6 AstraClaude Fable 5.1Hvem kjørte
AA Intelligence Index v4.1.16166Artificial Analysis
AA Coding Agent Index6770Artificial Analysis
Terminal-Bench 4.057,9%55,8%OpenAI
DeepSWE v1.174,1%67,4%OpenAI
AutomationBench41,4%31,4%OpenAI
Terminal-Bench Science 0.164,6%52,6%OpenAI
FrontierMath Tier 4 v297,6%87,8%OpenAI
GPQA Diamond96,0%93,7%OpenAI
Humanity's Last Exam (med tools)57,2%65,0%OpenAI
ARC-AGI-3 Standard62,7% ($26,098)ikke scoretARC Prize
ARC-AGI-3 Provider Adapter99,9% ($18,817)ikke scoretOpenAI / ARC Prize
Vals Index66,61% · $19.09/testikke hentetVals.ai, 4. september 2026

AA brukte også $3,020.82 på å kjøre Astra gjennom Intelligence Index. Token-sparingen mot Sol er ekte. Den flytter ikke indeksen forbi Fable 5.1.

Hallusinasjonsraten på AA-Omniscience falt fra 92 % til 51 % på max effort mot Sol. Det er den reneste uavhengige seieren Astra har på kunnskapspålitelighet.

OpenAIs «mest intelligente»-linje og ARC Prizes 62,7 % Standard-score kan ikke begge være hele historien. Oppgi begge.

Hva gjør $10/$50-fakturaen vs Fable?

Samme listepris, dyrere cache-reads: Astra $1.00 mot Fable 5.1 $0.25 per million.

GPT-6 Astra-modellkortet oppgir $10 input, $50 output, $1.00 cached input, $12.50 cache writes, et kontekstvindu på 1 050 000 tokens, 128 000 max output, og knowledge cutoff 30. april 2026. Prompter over 272k input-tokens belastes 2× på input og cache og 1,5× på output. Fast mode er 2×. Batch og Flex er 50 %.

Fable 5.1 ligger på samme $10/$50-kort. Anmeldelsen har allerede målt cache-read-kuttet til $0.25. Ikke kjør den målingen på nytt her; se Fable 5.1-anmeldelsen og bruk listetallene.

En 30-dagers jobb på 2,4 millioner input-tokens og 380 000 output-tokens per dag, til $10/$50, er:

text
2,400,000 × 30 × $10 / 1,000,000  = $720  input
  380,000 × 30 × $50 / 1,000,000  = $570  output
                                  = $1,290

De $1,290 er identiske på Astra og Fable 5.1 før cache. Førti gjenlesninger av et cachet 200 000-token-prefiks er det ikke:

Cache-read-linjeSats40 × 200 000 tokens
Claude Fable 5.1$0.25 / MTok$2.00
GPT-6 Astra$1.00 / MTok$8.00

Fire ganger cache-linjen, samme output-kort.

For resten av inferenskostnadsmodellen vokser gapet på alle agenter som leser et systemprefiks på nytt. AAs egen gjennomgang sier at Astra er omtrent 75 % dyrere per Intelligence Index-oppgave enn Sol på max effort fordi 2,5×-prisøkningen spiser ~10 %-tokenkuttet.

Sol forblir den billige OpenAI-døren.

Hvilke reelle jobber er Astra faktisk for?

OpenAI rapporterer at Astra fullfører OSWorld 2.0 på 72,6 % på omtrent 40 minutter, mot Sol på 65,7 % på 75 minutter.

Det er computer-use-påstanden, og det er OpenAIs tall, ikke vårt. ScreenSpot-Pro uten tools er 92,7 % mot Sols 76,9 %. Agents' Last Exam er 59,3 % mot Sols 53,6 % og Fable 5s 48,7 % (OpenAI oppga ingen Fable 5.1-rad der).

Demoene under er fra lanseringsinnlegget, ikke fra oss:

  1. Desktop- og nettleseragenter. OSWorld 2.0 partial, ~47 % kortere kjøretid enn Sol. Koble den med kodeagent-verktøy først når API-ID-en går gjennom.
  2. Lange Codex-sesjoner. OpenAI leverer notater som overlever compaction, så kontekst fra mislykkede fiks er søkbar i stedet for å bli oppsummert vekk.
  3. Spill og romlig arbeid. Playco sier at Astra kuttet manuelle fiks med omtrent 50 % på Unity/Godot-prototyper. Det er Playco som snakker, i en OpenAI-casestudie.
  4. Defensiv cyber. Astra er den første OpenAI-modellen ratet Critical under Preparedness Framework. Produksjonsbygget avviser proof-of-concept-exploits. Avanserte workflows ligger bak Daybreak / Trusted Access.
  5. Matte som metter en tavle. FrontierMath Tier 4 v2 på 97,6 % mot Fable 5.1 på 87,8 %, kjørt av leverandøren. Epoch AI finansierer deler av den tavlen; behandle den som OpenAI-nær.

Hva den ikke er for i dag: et drop-in model=-bytte på OpenRouter, en billigere Fable, eller en påstand om at 99,9 % på ARC-AGI-3 betyr AGI.

Greg Brockman sa til journalister «Welcome to the AGI era.» WIRED publiserte sitatet. ARC Prize, som bygde benchmarken, hevder ikke AGI.

Bør du bli på Fable 5.1, vente på Astra, eller bli på Sol?

Bli på Fable 5.1 til Astras modell-ID går gjennom på gatewayen din og jobben din er computer-use eller FrontierMath.

Rute etter workload, ikke etter lanseringsbloggen.

Hvis dette stemmerBeholdBytt når
Du trenger en modell i dag på OpenRouterFable 5.1 (eller Sol hvis $10/$50-kortet er problemet)openai/gpt-6-astra returnerer 200 på pinget over
Evalen din er AA Intelligence Index / HLE-med-tools / cache-tunge agenterFable 5.1den uavhengige indeksen faktisk passerer 66, eller cache-read-regningen ikke er linjen som teller
Evalen din er OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMathVent på AstraID-en går gjennom og du kan måle jobben på egne traces
Du er fortsatt på GPT-5.6 Sol og jobben er strukturert, kort, billigSol (Sol Ultra / Codex hvis det allerede er banen)en computer-use- eller mattejobb dukker opp som Sols 7,8 % Standard ARC og 61-indeks ikke bærer
Du trenger offensive cyber-PoCerIngen offentlig SKUDaybreak / Trusted Access, med avvisningene fortsatt på det offentlige bygget

Fable 5.1 er standarden. Astra er computer-use-oppgraderingen du ikke kan kjøpe på gatewayen vi kjørte dette pinget mot.

Sol er OpenAI-SKUen som allerede svarer. Kjør curl på nytt, så flytt.

Ofte stilte spørsmål

Er GPT-6 Astra AGI?

Nei. Greg Brockman brukte «AGI era» på en pressesamtale. Det er en bemerkning, ikke et målt funn. ARC Prize scoret Astra til 62,7 % på Standard ARC-AGI-3-runneren og sa at de ikke hevder AGI. OpenAIs 99,9 %-tall brukte en Provider Adapter som beholder skjult reasoning-state mellom turer. En mettende adapter-score er ikke samme test som alle andre modeller tok.

Kan gratiskunder på ChatGPT få GPT-6 Astra?

Ikke ifølge lanseringsinnlegget. OpenAI oppga Plus, Pro, Business og Enterprise, pluss API-et, Azure og Bedrock, for «kommende dager»-bølgen. Tilgang på gratislaget er ikke kunngjort. Enterprise-admin får en bryter som står av som standard. Behandle «i dag» som Daybreak / Trusted Access med mindre workspace-adminen din har slått den på.

Når dukker GPT-6 Astra opp på OpenRouter?

Ukjent. Pinget vårt 4. september 2026 kl. 14:40 UTC returnerte HTTP 400 for openai/gpt-6-astra. Kjør curl i tilgangsseksjonen på nytt. Ikke skriv om en router på et løfte fra lanseringsbloggen. I det øyeblikket ID-en går gjennom, snur kallbar-i-dag-kolonnen i den første tabellen.

Hvorfor sier noen sider 99,9 % på ARC-AGI-3 og andre 62,7 %?

To runnere. ARC Prizes Standard-runner er leverandørnøytral og scoret 62,7 % på max effort ($26,098). Provider Adapteren bevarer OpenAIs ugjennomsiktige reasoning-state og scoret 99,9 % på high effort ($18,817). OpenAI åpnet med adapter-tallet. Oppgi alltid paret.

Vil GPT-6 Astra skrive proof-of-concept-exploits for meg?

Det offentlige bygget avviser den klassen av forespørsler. OpenAI ratet Astra Critical for cybersikkerhet under Preparedness Framework og begrenset avansert exploit-arbeid til Daybreak / Trusted Access. ExploitBench 100 % ble målt uten produksjonssafeguards. Defensiv gjennomgang og patching er de tiltenkte offentlige cyber-jobbene.

Emneord

gpt-6-astraclaude-fable-5-1openaiartificial-analysisllm-benchmarks

Del denne artikkelen

Kom i gang

Klar til å bygge noe ekstraordinært?

La oss gjøre visjonen din til virkelighet. Teamet vårt er klart til å hjelpe deg med å lage programvare som utgjør en forskjell.