
Ist GPT-6 Astra besser als Fable?
GPT-6 Astra ist auf der unabhängigen Rangliste für allgemeine Intelligenz nicht besser als Claude Fable 5.1.
Artificial Analysis hat Astra am 3. September 2026 im Intelligence Index v4.1.1 auf 61 gesetzt, Fable 5.1 auf 66. OpenAIs eigene Launch-Tabelle enthält weiter die Zeile 61,2 gegen 65,7 und stellt trotzdem „das intelligenteste Modell der Welt“ voran.
Wir haben am 4. September 2026 um 14:40 UTC einen OpenRouter-Ping für openai/gpt-6-astra geschickt. Das Gateway antwortete HTTP 400: keine gültige Modell-ID. Fable 5.1 stand schon auf derselben Liste. Unser Setup ist dieses Gateway, kein privater OpenAI-Key.
GPT-6 Astra vs Fable 5.1: Welches Modell behältst du?
Behalte Fable 5.1 heute Morgen. Astra gewinnt Computer-Use und Mathe auf den Vendor-Zeilen, nicht auf dem unabhängigen Index.
Die Claude-Fable-5.1-Review deckt die Rechnung 5.1 gegen 5 gegen Opus 5 schon ab. Diese Tabelle ist der Split zwischen den Labs.
| Tür | Aufrufbar auf OpenRouter 2026-09-04 | AA Intelligence Index | AA Coding Agent Index | Listenpreis (in/out) | Cache-Read |
|---|---|---|---|---|---|
| Claude Fable 5.1 | Ja (anthropic/claude-fable-5.1) | 66 | 70 | $10 / $50 | $0.25 |
| GPT-6 Astra | Nein (HTTP 400) | 61 | 67 | $10 / $50 | $1.00 |
| GPT-5.6 Sol | Ja (openai/gpt-5.6-sol) | 61 | 65 | $2 / $10 auf OpenRouter; AA zitiert weiter $4 / $20 Listenpreis | $0.20 / 90 % Rabatt |
Quellen: Artificial Analysis Astra und Fable 5.1, 3. September und 1. September 2026; OpenAI-Model-Card für Astras Listenpreis; unser Test der Aufrufbar-Spalte ist der OpenRouter-Ping.
Astra ist die Computer-Use- und FrontierMath-Geschichte. Fable 5.1 ist die Intelligence-Index- und Cache-Read-Geschichte.
Sol ist das Modell, das du schon aufrufen kannst, zu einem Bruchteil der $10/$50-Karte. Behandle „besser“ als Workload, nicht als Headline.
Kannst du GPT-6 Astra heute überhaupt aufrufen?
Nicht über OpenRouter. openai/gpt-6-astra lieferte HTTP 400 um 14:40 UTC am 2026-09-04.
OpenAIs Launch-Post sagt, eine begrenzte Gruppe von Organisationen hat es am 3. September bekommen. ChatGPT Plus, Pro, Business, Enterprise, die API, Azure und Bedrock folgen „in den kommenden Tagen“. Zugang im Gratis-Tarif ist nicht angekündigt. Enterprise-Workspaces kommen mit Astra standardmäßig aus.
anthropic/claude-fable-5.1 und openai/gpt-5.6-sol waren am selben Nachmittag beide auf OpenRouter aufrufbar.
Sitzt dein Stack schon hinter einem Gateway, ist diese 400 die einzige Zahl, die zählt, bis die ID greift.
curl -sS https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400 {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37ZFahr den Ping nochmal, bevor du einen Router umschreibst. Ein Blogpost vom 4. September ist in der Stunde veraltet, in der die ID landet.
Stimmen unabhängige Benches zu, dass Astra klüger ist?
Nein. Artificial Analysis setzt Fable 5.1 auf 66 und Astra auf 61 im Intelligence Index v4.1.1.
OpenAI schrieb trotzdem „intelligentestes Modell der Welt“ über eine Tabelle, die diesen Verlust schon enthält. Beim Coding dieselbe Form: OpenAI nennt Astra das bisher beste Software-Engineering-Modell. Der Coding Agent Index von AA hat Fable 5.1 bei 70 und Astra bei 67.
Die ARC-AGI-3-Headline ist ein Runner-Split, kein AGI-Zertifikat. OpenAI nannte 99,9 %. ARC Prize hat dasselbe Modell auf dem anbieterneutralen Standard-Runner laufen lassen und kam auf 62,7 % bei max Effort für $26,098.
Der 99,9-%-Lauf nutzte einen Provider Adapter, der OpenAIs versteckten Reasoning-State zwischen den Turns hält, bei high Effort, für $18,817. Claude Opus 5 steht auf diesem Standard-Board bei 30,2 %. GPT-5.6 Sol bei 7,8 %. Astra hat den vorherigen Standard-SOTA verdoppelt. Den Benchmark hat es unter dem Runner, den jedes andere Lab teilen kann, nicht gesättigt.
| Bench | GPT-6 Astra | Claude Fable 5.1 | Wer gemessen hat |
|---|---|---|---|
| AA Intelligence Index v4.1.1 | 61 | 66 | Artificial Analysis |
| AA Coding Agent Index | 67 | 70 | Artificial Analysis |
| Terminal-Bench 4.0 | 57,9 % | 55,8 % | OpenAI |
| DeepSWE v1.1 | 74,1 % | 67,4 % | OpenAI |
| AutomationBench | 41,4 % | 31,4 % | OpenAI |
| Terminal-Bench Science 0.1 | 64,6 % | 52,6 % | OpenAI |
| FrontierMath Tier 4 v2 | 97,6 % | 87,8 % | OpenAI |
| GPQA Diamond | 96,0 % | 93,7 % | OpenAI |
| Humanity's Last Exam (mit Tools) | 57,2 % | 65,0 % | OpenAI |
| ARC-AGI-3 Standard | 62,7 % ($26,098) | nicht bewertet | ARC Prize |
| ARC-AGI-3 Provider Adapter | 99,9 % ($18,817) | nicht bewertet | OpenAI / ARC Prize |
| Vals Index | 66,61 % · $19.09/Test | nicht abgerufen | Vals.ai, 4. September 2026 |
AA hat außerdem $3,020.82 ausgegeben, um Astra durch den Intelligence Index zu schicken. Die Token-Ersparnis gegen Sol ist real. Den Index schiebt das nicht an Fable 5.1 vorbei.
Die Halluzinationsrate auf AA-Omniscience fiel von 92 % auf 51 % bei max Effort gegen Sol. Das ist Astras sauberster unabhängiger Treffer bei der Wissenszuverlässigkeit.
OpenAIs Zeile „intelligentestes Modell“ und der Standard-Score 62,7 % von ARC Prize können nicht beide die ganze Geschichte sein. Nenn beide.
Was macht die $10/$50-Rechnung gegen Fable?
Gleicher Listenpreis, schlechtere Cache-Reads: Astra $1.00 gegen Fable 5.1 $0.25 pro Million.
Die GPT-6-Astra-Model-Card listet $10 Input, $50 Output, $1.00 cached Input, $12.50 Cache-Writes, ein 1.050.000-Token-Fenster, 128.000 max Output und einen Knowledge-Cutoff vom 30. April 2026. Prompts über 272.000 Input-Tokens werden bei Input und Cache 2× und bei Output 1,5× abgerechnet. Fast-Modus ist 2×. Batch und Flex liegen bei 50 %.
Fable 5.1 sitzt auf derselben $10/$50-Karte. Die Fable-5.1-Review hat den Cache-Read-Schnitt auf $0.25 schon gemessen. Bau diese Probe hier nicht nach; zitiere den Fable-5.1-Review und nimm die Listenpreise.
Ein 30-Tage-Job mit 2,4 Millionen Input-Tokens und 380.000 Output-Tokens pro Tag, zu $10/$50, ergibt:
2,400,000 × 30 × $10 / 1,000,000 = $720 input
380,000 × 30 × $50 / 1,000,000 = $570 output
= $1,290Diese $1,290 sind vor Cache auf Astra und Fable 5.1 identisch. Vierzig Rereads eines gecachten 200.000-Token-Prefix sind es nicht:
| Cache-Read-Zeile | Preis | 40 × 200.000 Tokens |
|---|---|---|
| Claude Fable 5.1 | $0.25 / MTok | $2.00 |
| GPT-6 Astra | $1.00 / MTok | $8.00 |
Die vierfache Cache-Zeile, dieselbe Output-Karte.
Beim restlichen Inferenz-Kostenmodell summiert sich diese Lücke bei jedem Agenten, der ein System-Prefix erneut liest. AAs eigener Text sagt, Astra ist bei max Effort pro Intelligence-Index-Task rund 75 % teurer als Sol, weil der 2,5×-Preissprung den ~10-%-Token-Schnitt auffrisst.
Sol bleibt die günstige OpenAI-Tür.
Für welche echten Jobs ist Astra wirklich gedacht?
OpenAI berichtet, Astra beendet OSWorld 2.0 mit 72,6 % in rund 40 Minuten, Sol mit 65,7 % in 75 Minuten.
Das ist der Computer-Use-Claim, und es ist OpenAIs Zahl, nicht unsere. ScreenSpot-Pro ohne Tools liegt bei 92,7 % gegen Sols 76,9 %. Agents' Last Exam bei 59,3 % gegen Sols 53,6 % und Fable 5 mit 48,7 % (OpenAI hat dort keine Fable-5.1-Zeile gedruckt).
Zugeschriebene Demos aus dem Launch-Post, nicht von unserem Schreibtisch:
- Desktop- und Browser-Agenten. OSWorld 2.0 partial, ~47 % weniger Wall-Time als Sol. Nimm Coding-Agent-Tooling erst dazu, wenn die API-ID greift.
- Lange Codex-Sessions. OpenAI liefert Notizen, die Compaction überleben, damit Context fehlgeschlagener Fixes durchsuchbar bleibt, statt in einer Zusammenfassung zu verschwinden.
- Game- und Spatial-Arbeit. Playco sagt, Astra habe manuelle Fixes auf Unity-/Godot-Prototypen um rund 50 % gesenkt. Das ist Playco, in einer OpenAI-Case-Study.
- Defensives Cyber. Astra ist das erste OpenAI-Modell mit der Bewertung Critical unter dem Preparedness Framework. Der Production-Build lehnt Proof-of-Concept-Exploits ab. Fortgeschrittene Workflows sitzen hinter Daybreak / Trusted Access.
- Mathe, die ein Board sättigt. FrontierMath Tier 4 v2 bei 97,6 % gegen Fable 5.1 bei 87,8 %, Vendor-Run. Epoch AI finanziert Teile dieses Boards; behandle es als OpenAI-nah.
Wofür es heute nicht taugt: ein Drop-in-Tausch der model=-ID auf OpenRouter, ein günstigeres Fable, oder die Behauptung, 99,9 % auf ARC-AGI-3 bedeute AGI.
Greg Brockman sagte Reportern „Willkommen in der AGI-Ära.“ WIRED hat das Zitat gedruckt. ARC Prize, das den Benchmark gebaut hat, behauptet kein AGI.
Bleibst du bei Fable 5.1, wartest du auf Astra, oder bleibst du bei Sol?
Bleib bei Fable 5.1, bis Astras Modell-ID auf deinem Gateway greift und deine Arbeit Computer-Use oder FrontierMath ist.
Routen nach Workload, nicht nach dem Launch-Blog.
| Wenn das stimmt | Behalten | Flip, wenn |
|---|---|---|
| Du brauchst heute Morgen ein Modell auf OpenRouter | Fable 5.1 (oder Sol, wenn die $10/$50-Karte das Problem ist) | openai/gpt-6-astra auf dem Ping oben 200 zurückgibt |
| Dein Eval ist AA Intelligence Index / HLE-with-tools / cache-schwere Agenten | Fable 5.1 | der unabhängige Index wirklich über 66 geht, oder deine Cache-Read-Rechnung nicht die Zeile ist, die zählt |
| Dein Eval ist OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMath | Auf Astra warten | die ID greift und du den Job auf eigenen Traces messen kannst |
| Du bist noch auf GPT-5.6 Sol und die Arbeit ist strukturiert, kurz, günstig | Sol (Sol Ultra / Codex, wenn das schon die Spur ist) | ein Computer-Use- oder Mathe-Job auftaucht, den Sols 7,8 % Standard-ARC und Index 61 nicht stemmen |
| Du brauchst offensive Cyber-PoCs | Keine öffentliche SKU | Daybreak / Trusted Access, mit den Ablehnungen weiter auf dem öffentlichen Build |
Fable 5.1 ist der Default. Astra ist das Computer-Use-Upgrade. Auf dem Gateway, gegen das wir diesen Ping gefahren haben, kannst du es nicht kaufen.
Sol ist die OpenAI-SKU, die schon antwortet. Fahr den curl nochmal, dann wechsle.
Häufig gestellte Fragen
Ist GPT-6 Astra AGI?
Nein. Greg Brockman hat „AGI-Ära“ in einem Pressegespräch benutzt. Das ist eine Bemerkung, kein gemessener Befund. ARC Prize hat Astra auf dem Standard-ARC-AGI-3-Runner mit 62,7 % bewertet und sagt, es behaupte kein AGI. OpenAIs 99,9-%-Zahl nutzte einen Provider Adapter, der versteckten Reasoning-State zwischen den Turns hält. Ein sättigender Adapter-Score ist nicht derselbe Test, den jedes andere Modell durchlaufen hat.
Bekommen ChatGPT-Nutzer im Gratis-Tarif GPT-6 Astra?
Laut Launch-Post nicht. OpenAI hat Plus, Pro, Business und Enterprise genannt, plus die API, Azure und Bedrock, für die Welle „in den kommenden Tagen“. Zugang im Gratis-Tarif ist nicht angekündigt. Enterprise-Admins bekommen einen Toggle, der standardmäßig aus ist. Behandle „heute“ als Daybreak / Trusted Access, außer dein Workspace-Admin hat den Schalter umgelegt.
Wann taucht GPT-6 Astra auf OpenRouter auf?
Unbekannt. Unser Ping am 4. September 2026 um 14:40 UTC lieferte HTTP 400 für openai/gpt-6-astra. Fahr den curl im Abschnitt zum Aufrufen nochmal. Schreib keinen Router auf ein Launch-Blog-Versprechen um. In dem Moment, in dem die ID greift, kippt die Aufrufbar-heute-Spalte in der ersten Tabelle.
Warum sagen manche Seiten 99,9 % auf ARC-AGI-3 und andere 62,7 %?
Zwei Runner. Der Standard-Runner von ARC Prize ist anbieterneutral und kam auf 62,7 % bei max Effort ($26,098). Der Provider Adapter hält OpenAIs opaken Reasoning-State und kam auf 99,9 % bei high Effort ($18,817). OpenAI ist mit der Adapter-Zahl vorangegangen. Nenn immer das Paar.
Schreibt GPT-6 Astra Proof-of-Concept-Exploits für mich?
Der öffentliche Build lehnt diese Klasse von Requests ab. OpenAI hat Astra unter dem Preparedness Framework für Cybersecurity mit Critical bewertet und fortgeschrittene Exploit-Arbeit auf Daybreak / Trusted Access beschränkt. ExploitBench 100 % wurde ohne Production-Safeguards gemessen. Defensives Review und Patchen sind die vorgesehenen öffentlichen Cyber-Jobs.