ai-machine-learning

Är GPT-6 Astra bättre än Fable?

Skriven av Mert Batur
Sep 4, 2026
7 läsning
Är GPT-6 Astra bättre än Fable?

Är GPT-6 Astra bättre än Fable?

GPT-6 Astra är inte bättre än Claude Fable 5.1 på den oberoende resultattavlan som faktiskt rangordnar generell intelligens.

Artificial Analysis gav Astra 61 på Intelligence Index v4.1.1 den 3 september 2026, och Fable 5.1 66. OpenAI:s egen lanseringstabell har fortfarande raden 61,2 mot 65,7, och leder med ”the world's most intelligent model.”

Vi körde en OpenRouter-ping mot openai/gpt-6-astra kl. 14:40 UTC den 4 september 2026. Gatewayn returnerade HTTP 400: not a valid model ID. Fable 5.1 fanns redan på samma lista. Vi kör mot den gatewayn, inte mot en privat OpenAI-nyckel.

GPT-6 Astra vs Fable 5.1: vilken ska du behålla?

Behåll Fable 5.1 den här morgonen. Astra vinner computer use och matematik på leverantörsrader, inte på det oberoende indexet.

Claude Fable 5.1-recensionen har redan 5.1 vs 5 vs Opus 5-fakturan. Den här tabellen är klyftan mellan labben.

DörrAnropbar på OpenRouter 2026-09-04AA Intelligence IndexAA Coding Agent IndexListpris (in/ut)Cache-läsning
Claude Fable 5.1Ja (anthropic/claude-fable-5.1)6670$10 / $50$0.25
GPT-6 AstraNej (HTTP 400)6167$10 / $50$1.00
GPT-5.6 SolJa (openai/gpt-5.6-sol)6165$2 / $10 på OpenRouter; AA citerar fortfarande $4 / $20 i listpris$0.20 / 90 % rabatt

Källor: Artificial Analysis Astra och Fable 5.1, 3 september och 1 september 2026; OpenAI:s modellkort för Astras listpris; vårt test av den anropbara kolumnen är OpenRouter-pingen.

Astra är computer use- och FrontierMath-spåret. Fable 5.1 är Intelligence Index- och cache-läsningsspåret.

Sol är modellen du redan kan anropa till en bråkdel av $10/$50-kortet. Behandla ”bättre” som en arbetsbelastning, inte som en rubrik.

Kan du ens anropa GPT-6 Astra i dag?

Inte från OpenRouter. openai/gpt-6-astra returnerade HTTP 400 kl. 14:40 UTC den 2026-09-04.

OpenAI:s lanseringsinlägg säger att en begränsad uppsättning organisationer fick tillgång den 3 september. ChatGPT Plus, Pro, Business, Enterprise, API:et, Azure och Bedrock följer ”over the coming days.” Gratisnivån är inte utannonserad. Enterprise-arbetsytor skeppas med Astra av.

anthropic/claude-fable-5.1 och openai/gpt-5.6-sol gick båda att anropa på OpenRouter samma eftermiddag.

Om din stack redan sitter bakom en gateway är den 400:an den enda siffra som räknas tills ID:t blir giltigt.

bash
curl -sS https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400  {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37Z

Kör om den pingen innan du skriver om en router. Ett inlägg daterat 4 september blir inaktuellt den timme ID:t landar.

Håller oberoende bänkar med om att Astra är smartare?

Nej. Artificial Analysis sätter Fable 5.1 på 66 och Astra på 61 på Intelligence Index v4.1.1.

OpenAI skrev ändå ”world's most intelligent” ovanför en tabell som redan innehåller den förlusten. Samma sak på kodning: OpenAI kallar Astra den bästa modellen för mjukvaruutveckling hittills. AA:s Coding Agent Index har Fable 5.1 på 70 och Astra på 67.

ARC-AGI-3-rubriken är en klyfta mellan runners, inte ett AGI-intyg. OpenAI skrev 99,9 %. ARC Prize körde samma modell på sin leverantörsneutrala Standard-runner och fick 62,7 % vid max effort för $26,098.

99,9 %-körningen använde en Provider Adapter som behåller OpenAI:s dolda reasoning-state mellan turer, vid high effort, för $18,817. Claude Opus 5 ligger på 30,2 % på den Standard-tavlan. GPT-5.6 Sol ligger på 7,8 %. Astra dubblade den tidigare Standard-SOTA. Den mättade inte bänken under den runner som varje annat labb kan dela.

BänkGPT-6 AstraClaude Fable 5.1Vem körde
AA Intelligence Index v4.1.16166Artificial Analysis
AA Coding Agent Index6770Artificial Analysis
Terminal-Bench 4.057,9 %55,8 %OpenAI
DeepSWE v1.174,1 %67,4 %OpenAI
AutomationBench41,4 %31,4 %OpenAI
Terminal-Bench Science 0.164,6 %52,6 %OpenAI
FrontierMath Tier 4 v297,6 %87,8 %OpenAI
GPQA Diamond96,0 %93,7 %OpenAI
Humanity's Last Exam (w/ tools)57,2 %65,0 %OpenAI
ARC-AGI-3 Standard62,7 % ($26,098)inte poängsattARC Prize
ARC-AGI-3 Provider Adapter99,9 % ($18,817)inte poängsattOpenAI / ARC Prize
Vals Index66,61 % · $19.09/testinte hämtadVals.ai, 4 september 2026

AA la också $3,020.82 på att köra Astra genom Intelligence Index. Tokensnålheten mot Sol är verklig. Den flyttar inte indexet förbi Fable 5.1.

Hallucinationsfrekvensen på AA-Omniscience sjönk från 92 % till 51 % vid max effort mot Sol. Det är Astras renaste oberoende vinst på kunskapssäkerhet.

OpenAI:s rad om ”most intelligent” och ARC Prize 62,7 % på Standard kan inte båda vara hela historien. Skriv båda.

Vad gör $10/$50-fakturan mot Fable?

Samma listpris, sämre cache-läsning: Astra $1.00 mot Fable 5.1 $0.25 per miljon.

GPT-6 Astra-modellkortet listar $10 indata, $50 utdata, $1.00 cachad indata, $12.50 cache-skrivningar, ett fönster på 1 050 000 tokens, max 128 000 output och knowledge cutoff 30 april 2026. Prompts över 272 000 indata-tokens debiteras 2× på indata och cache och 1,5× på utdata. Fast-läge är 2×. Batch och Flex är 50 %.

Fable 5.1 sitter på samma $10/$50-kort. Fable-recensionen har redan mätt cache-läsningssänkningen till $0.25. Bygg inte om den sonden här; citera Fable 5.1-recensionen och använd listsiffrorna.

Ett 30-dagarsjobb på 2,4 miljoner indata-tokens och 380 000 utdata-tokens per dag, till $10/$50, blir:

text
2,400,000 × 30 × $10 / 1,000,000  = $720  input
  380,000 × 30 × $50 / 1,000,000  = $570  output
                                  = $1,290

De $1,290 är identiska på Astra och Fable 5.1 före cache. Fyrtio omläsningar av ett cachat prefix på 200 000 tokens är det inte:

Cache-läsningsradTaxa40 × 200 000 tokens
Claude Fable 5.1$0.25 / MTok$2.00
GPT-6 Astra$1.00 / MTok$8.00

Fyra gånger cache-raden, samma utdatakort.

I resten av inferenskostnadsmodellen växer det gapet på varje agent som omläser ett systemprefix. AA:s egen text säger att Astra är ungefär 75 % dyrare per Intelligence Index-uppgift än Sol vid max effort, eftersom 2,5×-prishöjningen äter upp den ungefär 10-procentiga tokenminskningen.

Sol är fortfarande den billiga OpenAI-dörren.

Vilka riktiga jobb är Astra egentligen till för?

OpenAI rapporterar att Astra klarar OSWorld 2.0 på 72,6 % på ungefär 40 minuter, mot Sol på 65,7 % på 75 minuter.

Det är påståendet om computer use, och det är OpenAI:s siffra, inte vår. ScreenSpot-Pro utan verktyg är 92,7 % mot Sols 76,9 %. Agents' Last Exam är 59,3 % mot Sols 53,6 % och Fable 5:s 48,7 % (OpenAI skrev ingen Fable 5.1-rad där).

Attribuerade demos från lanseringsinlägget, inte från vårt skrivbord:

  1. Skrivbords- och webbläsaragenter. OSWorld 2.0 partial, ~47 % kortare klocktid än Sol. Para ihop den med verktyg för kodningsagenter först när API-ID:t blir giltigt.
  2. Långa Codex-sessioner. OpenAI skeppar anteckningar som överlever compaction, så kontext från misslyckade fixar går att söka i stället för att sammanfattas bort.
  3. Spel och spatialt arbete. Playco säger att Astra kapade manuella fixar med ungefär 50 % på Unity/Godot-prototyper. Det är Playco som pratar, i en OpenAI-fallstudie.
  4. Defensiv cyber. Astra är den första OpenAI-modellen klassad som Critical under Preparedness Framework. Produktionsbygget vägrar proof-of-concept-exploits. Avancerade arbetsflöden sitter bakom Daybreak / Trusted Access.
  5. Matematik som mättar en tavla. FrontierMath Tier 4 v2 på 97,6 % mot Fable 5.1 på 87,8 %, enligt leverantörens körning. Epoch AI finansierar en del av den tavlan; behandla den som OpenAI-nära.

Vad den inte är till för i dag: ett drop-in-byte av model= på OpenRouter, en billigare Fable, eller ett påstående att 99,9 % på ARC-AGI-3 betyder AGI.

Greg Brockman sa till reportrar ”Welcome to the AGI era.” WIRED publicerade citatet. ARC Prize, som byggde bänken, hävdar inte AGI.

Ska du stanna på Fable 5.1, vänta på Astra eller stanna på Sol?

Stanna på Fable 5.1 tills Astras modell-ID blir giltigt på din gateway och ditt arbete är computer use eller FrontierMath.

Routa på arbetsbelastning, inte på lanseringsbloggen.

Om det här stämmerBehållByt när
Du behöver en modell den här morgonen på OpenRouterFable 5.1 (eller Sol om $10/$50-kortet är problemet)openai/gpt-6-astra returnerar 200 på pingen ovan
Din eval är AA Intelligence Index / HLE-with-tools / cache-tunga agenterFable 5.1det oberoende indexet faktiskt går förbi 66, eller cache-läsningsnotan inte är raden som räknas
Din eval är OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMathVänta på AstraID:t blir giltigt och du kan mäta jobbet på dina egna traces
Du är kvar på GPT-5.6 Sol och arbetet är strukturerat, kort, billigtSol (Sol Ultra / Codex om det redan är spåret)ett computer use- eller matematikjobb dyker upp som Sols 7,8 % Standard-ARC och 61 på Indexet inte bär
Du behöver offensiva cyber-PoCsIngen publik SKUDaybreak / Trusted Access, med vägran kvar på det publika bygget

Fable 5.1 är standardvalet. Astra är uppgraderingen för computer use som du inte kan köpa på den gateway vi körde den här pingen mot.

Sol är OpenAI-SKU:n som redan svarar. Kör om curl-kommandot, flytta sen.

Vanliga frågor

Är GPT-6 Astra AGI?

Nej. Greg Brockman använde ”AGI era” på ett pressamtal. Det är en kommentar, inte ett mätt fynd. ARC Prize poängsatte Astra till 62,7 % på Standard-ARC-AGI-3-runnern och sa att de inte hävdar AGI. OpenAI:s 99,9 %-siffra använde en Provider Adapter som behåller dolt reasoning-state mellan turer. En adapterpoäng som mättar bänken är inte samma test som varje annan modell tog.

Kan gratisanvändare av ChatGPT få GPT-6 Astra?

Inte enligt lanseringsinlägget. OpenAI namngav Plus, Pro, Business och Enterprise, plus API:et, Azure och Bedrock, för vågen ”coming days”. Gratisnivån är inte utannonserad. Enterprise-admins får en toggle som står på av som standard. Behandla ”i dag” som Daybreak / Trusted Access, om inte din workspace-admin har slagit om switchen.

När dyker GPT-6 Astra upp på OpenRouter?

Okänt. Vår ping den 4 september 2026 kl. 14:40 UTC returnerade HTTP 400 för openai/gpt-6-astra. Kör om curl-kommandot i åtkomstavsnittet. Skriv inte om en router på ett löfte i en lanseringsblogg. Samma ögonblick ID:t blir giltigt vänder kolumnen anropbar-i-dag i den första tabellen.

Varför säger vissa sidor 99,9 % på ARC-AGI-3 och andra 62,7 %?

Två runners. ARC Prize Standard-runner är leverantörsneutral och poängsatte 62,7 % vid max effort ($26,098). Provider Adapter bevarar OpenAI:s opaka reasoning-state och poängsatte 99,9 % vid high effort ($18,817). OpenAI ledde med adaptersiffran. Skriv alltid paret.

Skriver GPT-6 Astra proof-of-concept-exploits åt mig?

Det publika bygget vägrar den typen av förfrågan. OpenAI klassade Astra som Critical för cybersäkerhet under sitt Preparedness Framework och begränsade avancerat exploit-arbete till Daybreak / Trusted Access. ExploitBench 100 % mättes utan produktionsskydd. Defensiv granskning och patchning är de avsedda publika cyberjobben.

Taggar

gpt-6-astraclaude-fable-5-1openaiartificial-analysisllm-benchmarks

Dela denna artikel

Starta ditt projekt

Redo att bygga något utöver det vanliga?

Låt oss göra verklighet av din idé. Vårt team hjälper dig gärna att bygga mjukvara som gör skillnad.