
¿Es GPT-6 Astra mejor que Fable?
GPT-6 Astra no es mejor que Claude Fable 5.1 en el marcador independiente que de verdad clasifica la inteligencia general.
Artificial Analysis situó a Astra en 61 del Intelligence Index v4.1.1 el 3 de septiembre de 2026, y a Fable 5.1 en 66. La propia tabla de lanzamiento de OpenAI sigue imprimiendo esa fila 61,2 vs 65,7, y encima encabeza con «el modelo más inteligente del mundo».
Hicimos un ping a OpenRouter para openai/gpt-6-astra a las 14:40 UTC del 4 de septiembre de 2026. El gateway devolvió HTTP 400: not a valid model ID. Fable 5.1 ya estaba en la misma lista. Nuestro setup es ese gateway, no una clave privada de OpenAI.
GPT-6 Astra vs Fable 5.1: ¿con cuál te quedas?
Quédate con Fable 5.1 esta mañana; Astra gana computer-use y matemáticas en las filas del vendor, no en el índice independiente.
El análisis de Claude Fable 5.1 ya cubre la factura 5.1 vs 5 vs Opus 5. Esta tabla es el corte entre laboratorios.
| Puerta | Invocable en OpenRouter 2026-09-04 | AA Intelligence Index | AA Coding Agent Index | Precio de lista (in/out) | Cache read |
|---|---|---|---|---|---|
| Claude Fable 5.1 | Sí (anthropic/claude-fable-5.1) | 66 | 70 | $10 / $50 | $0.25 |
| GPT-6 Astra | No (HTTP 400) | 61 | 67 | $10 / $50 | $1.00 |
| GPT-5.6 Sol | Sí (openai/gpt-5.6-sol) | 61 | 65 | $2 / $10 en OpenRouter; AA sigue citando $4 / $20 de lista | $0.20 / 90 % de descuento |
Fuentes: Artificial Analysis Astra y Fable 5.1, 3 y 1 de septiembre de 2026; ficha de modelo de OpenAI para el precio de lista de Astra; nuestra comprobación de la columna invocable es el ping a OpenRouter.
Astra es computer-use y FrontierMath. Fable 5.1 es Intelligence Index y cache-read.
Sol es el modelo que ya puedes llamar a una fracción de la tarjeta $10/$50. Trata «mejor» como una carga de trabajo, no como un titular.
¿Puedes llamar siquiera a GPT-6 Astra hoy?
Desde OpenRouter, no. openai/gpt-6-astra devolvió HTTP 400 a las 14:40 UTC del 2026-09-04.
El post de lanzamiento de OpenAI dice que un conjunto limitado de organizaciones lo recibió el 3 de septiembre, y que ChatGPT Plus, Pro, Business, Enterprise, la API, Azure y Bedrock llegan «en los próximos días». El acceso en el plan gratuito no está anunciado. Los workspaces Enterprise salen con Astra off.
anthropic/claude-fable-5.1 y openai/gpt-5.6-sol sí se podían llamar en OpenRouter esa misma tarde.
Si tu stack ya está detrás de un gateway, ese 400 es el único número que importa hasta que el ID se resuelva.
curl -sS https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-6-astra","messages":[{"role":"user","content":"PONG"}],"max_tokens":16}'
# HTTP 400 {"error":{"message":"openai/gpt-6-astra is not a valid model ID","code":400}}
# probed 2026-09-04T14:40:37ZVuelve a lanzar ese ping antes de reescribir un router. Un post con fecha 4 de septiembre queda obsoleto en cuanto aterriza el ID.
¿Los benches independientes coinciden en que Astra es más inteligente?
No. Artificial Analysis pone a Fable 5.1 en 66 y a Astra en 61 en el Intelligence Index v4.1.1.
OpenAI aun así escribió «el más inteligente del mundo» encima de una tabla que ya contiene esa derrota. En coding pasa lo mismo: OpenAI llama a Astra el mejor modelo de ingeniería de software hasta ahora; el Coding Agent Index de AA tiene a Fable 5.1 en 70 y a Astra en 67.
El titular de ARC-AGI-3 es un corte de runner, no un certificado de AGI. OpenAI imprimió 99,9 %. ARC Prize corrió el mismo modelo en su runner Standard, provider-neutral, y obtuvo 62,7 % a max effort por $26,098.
La pasada del 99,9 % usó un Provider Adapter que conserva el estado de reasoning oculto de OpenAI entre turnos, a high effort, por $18,817. Claude Opus 5 está en 30,2 % en ese tablero Standard. GPT-5.6 Sol está en 7,8 %. Astra duplicó el SOTA Standard anterior. No saturó el benchmark bajo el runner que cualquier otro lab puede compartir.
| Bench | GPT-6 Astra | Claude Fable 5.1 | Quién lo ejecutó |
|---|---|---|---|
| AA Intelligence Index v4.1.1 | 61 | 66 | Artificial Analysis |
| AA Coding Agent Index | 67 | 70 | Artificial Analysis |
| Terminal-Bench 4.0 | 57,9 % | 55,8 % | OpenAI |
| DeepSWE v1.1 | 74,1 % | 67,4 % | OpenAI |
| AutomationBench | 41,4 % | 31,4 % | OpenAI |
| Terminal-Bench Science 0.1 | 64,6 % | 52,6 % | OpenAI |
| FrontierMath Tier 4 v2 | 97,6 % | 87,8 % | OpenAI |
| GPQA Diamond | 96,0 % | 93,7 % | OpenAI |
| Humanity's Last Exam (w/ tools) | 57,2 % | 65,0 % | OpenAI |
| ARC-AGI-3 Standard | 62,7 % ($26,098) | sin puntuar | ARC Prize |
| ARC-AGI-3 Provider Adapter | 99,9 % ($18,817) | sin puntuar | OpenAI / ARC Prize |
| Vals Index | 66,61 % · $19.09/test | no consultado | Vals.ai, 4 de septiembre de 2026 |
AA también gastó $3,020.82 en evaluar Astra en el Intelligence Index. El ahorro de tokens frente a Sol es real. No mueve el índice por delante de Fable 5.1.
La tasa de alucinación en AA-Omniscience bajó del 92 % al 51 % a max effort frente a Sol. Es la victoria independiente más limpia que tiene Astra en fiabilidad de conocimiento.
La frase de «el más inteligente» de OpenAI y el 62,7 % Standard de ARC Prize no pueden ser las dos la historia completa. Imprime las dos.
¿Qué hace la factura $10/$50 frente a Fable?
Mismo precio de lista, peores lecturas de caché: Astra $1.00 vs Fable 5.1 $0.25 por millón.
La ficha de modelo de GPT-6 Astra lista $10 de input, $50 de output, $1.00 de input cacheado, $12.50 de escrituras de caché, una ventana de 1.050.000 tokens, 128.000 de salida máxima y un corte de conocimiento del 30 de abril de 2026. Los prompts de más de 272k tokens de input facturan 2× en input y caché y 1,5× en output. Fast mode cobra 2×. Batch y Flex, el 50 %.
Fable 5.1 está en la misma tarjeta $10/$50. El post hermano ya midió el recorte de cache-read a $0.25. No reconstruyas ese medidor aquí; cita el análisis de Fable 5.1 y usa los números de lista.
Un trabajo de 30 días a 2,4 millones de tokens de input y 380.000 de output al día, a $10/$50, sale:
2,400,000 × 30 × $10 / 1,000,000 = $720 input
380,000 × 30 × $50 / 1,000,000 = $570 output
= $1,290Esos $1,290 son idénticos en Astra y Fable 5.1 antes de caché. Cuarenta relecturas de un prefijo cacheado de 200.000 tokens, no:
| Línea cache-read | Tarifa | 40 × 200.000 tokens |
|---|---|---|
| Claude Fable 5.1 | $0.25 / MTok | $2.00 |
| GPT-6 Astra | $1.00 / MTok | $8.00 |
Cuatro veces la línea de caché, misma tarjeta de salida.
Para el resto del modelo de coste de inferencia, ese hueco se acumula en todo agente que relee un prefijo de sistema. El propio artículo de AA dice que Astra sale un 75 % más cara por tarea del Intelligence Index que Sol a max effort, porque la subida de precio de 2,5× se come el recorte de tokens del ~10 %.
Sol sigue siendo la puerta barata de OpenAI.
¿Para qué trabajos reales sirve Astra de verdad?
OpenAI reporta que Astra termina OSWorld 2.0 al 72,6 % en unos 40 minutos, frente a Sol al 65,7 % en 75.
Esa es la afirmación de computer-use, y es cifra de OpenAI, no nuestra. ScreenSpot-Pro sin herramientas está en 92,7 % contra el 76,9 % de Sol. Agents' Last Exam está en 59,3 % contra el 53,6 % de Sol y el 48,7 % de Fable 5 (OpenAI no imprimió una fila de Fable 5.1 ahí).
Demos del post de lanzamiento, no medidas aquí:
- Agentes de escritorio y navegador. OSWorld 2.0 parcial, ~47 % menos de tiempo de reloj que Sol. Enlázalo con herramientas de agentes de código solo cuando el ID de API se resuelva.
- Sesiones largas de Codex. OpenAI manda notas que sobreviven a la compactación, así que el contexto de un fix fallido se busca en vez de resumirse y perderse.
- Juegos y trabajo espacial. Playco dice que Astra recortó las correcciones manuales un 50 % en prototipos Unity/Godot. Lo dice Playco, en un estudio de caso de OpenAI.
- Ciberseguridad defensiva. Astra es el primer modelo de OpenAI calificado como Critical bajo el Preparedness Framework. El build de producción rechaza exploits proof-of-concept. Los workflows avanzados quedan detrás de Daybreak / Trusted Access.
- Matemáticas que saturan un tablero. FrontierMath Tier 4 v2 al 97,6 % vs Fable 5.1 al 87,8 %, corrido por el vendor. Epoch AI financia parte de ese tablero; trátalo como adyacente a OpenAI.
Para lo que no sirve, hoy: cambiar model= y listo en OpenRouter, un Fable más barato, ni una afirmación de que el 99,9 % en ARC-AGI-3 significa AGI.
Greg Brockman dijo a los reporteros «Welcome to the AGI era.» WIRED publicó la cita. ARC Prize, que construyó el benchmark, no está reclamando AGI.
¿Te quedas en Fable 5.1, esperas a Astra o te quedas en Sol?
Quédate en Fable 5.1 hasta que el model ID de Astra se resuelva en tu gateway y tu trabajo sea computer-use o FrontierMath.
Enruta por carga de trabajo, no por el blog de lanzamiento.
| Si esto es cierto | Quédate | Cambia cuando |
|---|---|---|
| Necesitas un modelo esta mañana en OpenRouter | Fable 5.1 (o Sol si la tarjeta $10/$50 es el problema) | openai/gpt-6-astra devuelve 200 en el ping de arriba |
| Tu eval es AA Intelligence Index / HLE-with-tools / agentes con mucha caché | Fable 5.1 | el Index independiente pase de 66 de verdad, o la factura de cache-read no sea la línea que te importa |
| Tu eval es OSWorld, ScreenSpot-Pro, AutomationBench, FrontierMath | Espera a Astra | El ID se resuelve y puedes medir el trabajo en tus propias trazas |
| Sigues en GPT-5.6 Sol y el trabajo es estructurado, corto, barato | Sol (Sol Ultra / Codex si esa es ya tu línea) | aparece un trabajo de computer-use o matemáticas que el 7,8 % Standard ARC y el Index 61 de Sol no pueden cargar |
| Necesitas PoCs de ciberseguridad ofensiva | Ningún SKU público | Daybreak / Trusted Access, con los rechazos todavía en el build público |
Fable 5.1 es la opción por defecto. Astra es el salto de computer-use que no puedes comprar en el gateway contra el que lanzamos este ping.
Sol es el SKU de OpenAI que ya responde. Relanza el curl y entonces muévete.
Preguntas frecuentes
¿Es GPT-6 Astra AGI?
No. Greg Brockman usó «AGI era» en una llamada con la prensa. Es un comentario, no un hallazgo medido. ARC Prize puntuó a Astra en 62,7 % en el runner Standard de ARC-AGI-3 y dijo que no está reclamando AGI. La cifra del 99,9 % de OpenAI usó un Provider Adapter que conserva el estado de reasoning oculto entre turnos. Una puntuación saturada del adapter no es el mismo test al que se sometió el resto de modelos.
¿Los usuarios de ChatGPT gratis pueden usar GPT-6 Astra?
Según el post de lanzamiento, no. OpenAI nombró Plus, Pro, Business y Enterprise, más la API, Azure y Bedrock, para la oleada de «los próximos días». El acceso en el plan gratuito no está anunciado. Los admins de Enterprise reciben un toggle que arranca en off. Trata «hoy» como Daybreak / Trusted Access salvo que el admin de tu workspace haya cambiado ese interruptor.
¿Cuándo aparecerá GPT-6 Astra en OpenRouter?
Se desconoce. Nuestro ping del 4 de septiembre de 2026 a las 14:40 UTC devolvió HTTP 400 para openai/gpt-6-astra. Relanza el curl de la sección de acceso. No reescribas un router sobre la promesa de un blog de lanzamiento. En el momento en que el ID se resuelva, la columna de invocable-hoy de la primera tabla cambia.
¿Por qué unas páginas dicen 99,9 % en ARC-AGI-3 y otras 62,7 %?
Dos runners. El runner Standard de ARC Prize es provider-neutral y puntuó 62,7 % a max effort ($26,098). El Provider Adapter conserva el estado de reasoning opaco de OpenAI y puntuó 99,9 % a high effort ($18,817). OpenAI encabezó con la cifra del adapter. Imprime siempre el par.
¿GPT-6 Astra me va a escribir exploits proof-of-concept?
El build público rechaza esa clase de petición. OpenAI calificó a Astra como Critical en ciberseguridad bajo su Preparedness Framework y limitó el trabajo avanzado de exploits a Daybreak / Trusted Access. ExploitBench 100 % se midió sin salvaguardas de producción. La revisión defensiva y el parcheo son los trabajos públicos de ciberseguridad previstos.