ai-machine-learning

Claude Fable 5 vs Opus 4.8: ¿Vale la pena cambiar? (Clase Mythos, con benchmarks)

Escrito por Mert Batur
Actualizado Jul 21, 2026
23 lectura
Claude Fable 5 vs Opus 4.8: ¿Vale la pena cambiar? (Clase Mythos, con benchmarks)

Claude Fable 5 vs Opus 4.8: ¿Vale la pena cambiar? (Clase Mythos, con benchmarks)

Anthropic lanzó Claude Fable 5 el 9 de junio de 2026, y las seis semanas transcurridas desde entonces no han sido un camino recto: una suspensión ordenada por el gobierno, una restauración completa, un parche de seguridad y dos lanzamientos rivales nuevos. Sigue anotando un 80.3% en SWE-Bench Pro, el benchmark de codificación agéntica donde Opus 4.8 llega al 69.2% y GPT-5.5 se queda atrás con un 58.6%. No es una diferencia de redondeo, aunque GPT-5.5 ya no es el único modelo con el que merece la pena compararlo. Y hay un giro: Fable 5 es la mitad pública y con salvaguardas de un nuevo modelo de "clase Mythos", con un hermano restringido llamado Claude Mythos 5 que se mantiene detrás de un programa de acceso controlado. Esto es lo que cambió, qué pasó desde el lanzamiento, cuánto cuesta una tarea real a $10/$50 por millón de tokens, y si realmente deberías mover tu stack fuera de Opus 4.8.

Respuesta rápida

  • Fable 5 obtiene 80.3% en SWE-Bench Pro frente al 69.2% de Opus 4.8 y el 58.6% de GPT-5.5, pero Claude Sonnet 5 y GPT-5.6 Sol (lanzados después de Fable 5) cierran parte de esa brecha en benchmarks agénticos y de terminal.
  • El precio es $10 de entrada / $50 de salida por millón de tokens, menos de la mitad de Mythos Preview.
  • Fable 5 cae automáticamente a Opus 4.8 en consultas de alto riesgo (cyber, bio, química); una actualización del clasificador del 1 de julio también bloquea, en más del 99% de los casos, una técnica de prompting que descubrieron investigadores de Amazon.
  • El acceso quedó suspendido para todos los usuarios del 12 al 30 de junio de 2026 por los controles de exportación de EE. UU., y se restauró por completo el 1 de julio. El precio gratuito hasta una fecha límite también desapareció: Max/Team Premium mantienen Fable 5 incluido, Pro/Team Standard reciben un crédito único de $100 y después pagan tarifas de API, según TechTimes y XenoSpectrum (Anthropic no lo ha confirmado en su propio sitio).

Qué se lanzó exactamente: Fable 5, Mythos 5 y la línea "clase Mythos"

Clase Mythos es el nuevo nivel de máxima capacidad de Anthropic, y se lanza como dos modelos. Claude Fable 5 es la versión pública y con salvaguardas que puedes usar hoy. Claude Mythos 5 es el mismo modelo frontier sin las salvaguardas, disponible solo bajo acceso controlado. El mismo cerebro, dos posturas de lanzamiento.

La división es la historia completa. Según el anuncio oficial de Anthropic, Mythos 5 conserva toda la capacidad frontier, incluidas habilidades de ciberataque ofensivo que podrían causar daño real, por lo que Anthropic no lo pone a disposición de todos. Fable 5 toma ese mismo modelo y lo envuelve en clasificadores que detectan solicitudes de alto riesgo y las redirigen silenciosamente a Opus 4.8 en su lugar.

Así que cuando llamas a Fable 5, obtienes razonamiento de clase Mythos en todo lo que no es peligroso, y un modelo de respaldo más seguro en la pequeña fracción que sí lo es. CNBC lo describió como Anthropic lanzando "una IA similar a Mythos al público", lo cual es correcto, pero el mecanismo preciso importa más que el titular.

Fable 5 y Mythos 5 son el mismo modelo frontier dividido en dos: uno disponible hoy, otro que Anthropic mantiene bajo llave. Si solo recuerdas una cosa del nombre, recuerda eso. Clase Mythos es el nivel; Fable y Mythos son las dos puertas hacia él.

Qué cambió respecto a la línea Opus 4.x

En todas las evaluaciones de codificación y razonamiento que cubre este artículo, Fable 5 supera a Opus 4.8, no por poco sino por márgenes de dos dígitos. SWE-Bench Pro salta del 69.2% al 80.3%, una cifra que publicó Anthropic y que Vellum, llm-stats y Weights & Biases han corroborado de forma independiente. FrontierCode Diamond pasa de 13.4 a 29.3, una cifra que el propio Anthropic no publica; proviene del seguimiento de Vellum y llm-stats. El precio también bajó, y el modelo escala con un nuevo dial de esfuerzo de razonamiento. Este es un salto frontier real sobre la línea Opus 4.x, no una versión menor.

Tabla de benchmarks de Claude Mythos 5 / Fable 5 frente a Mythos Preview, Opus 4.8, GPT-5.5, Gemini 3.1 Pro en 13 evaluaciones
Claude Mythos 5 / Fable 5 en 13 benchmarks frente a Opus 4.8, GPT-5.5 y Gemini 3.1 Pro. Fuente: Anthropic.

La comparación de los 13 benchmarks de arriba es la vista rápida. Aquí está el subconjunto principal contra los tres modelos que la mayoría de los equipos realmente comparan:

BenchmarkClaude Fable 5Claude Opus 4.8GPT-5.5
SWE-Bench Pro (codificación agéntica)80.3%69.2%58.6%
FrontierCode Diamond (codificación más difícil)29.313.45.7
Terminal-Bench 2.1 (shell agéntico)88.0%n/an/a
GPQA-AA (razonamiento de posgrado, Elo)1932n/an/a
ExploitBench78.0%n/an/a

El punto de comparación aquí es Claude Opus 4.8, el modelo al que Fable 5 reemplaza en la frontera, y el mismo al que Fable 5 recurre en consultas de alto riesgo. Si has seguido la línea Opus 4.x a lo largo de las dos últimas versiones, el patrón era de mejoras incrementales. Fable 5 rompe ese patrón.

Dos cosas hay que aclarar antes de leer la tabla como un evangelio. Primero, SWE-Bench Pro es una evaluación publicada por el propio Anthropic, corroborada de forma independiente en otros sitios; FrontierCode Diamond no es en absoluto una cifra publicada por Anthropic, es un benchmark de terceros que rastrean Vellum y llm-stats. Segundo, el dial de esfuerzo de razonamiento significa que un solo número de benchmark oculta una curva de costes. Más sobre eso en la sección de precios, porque cambia el cálculo.

Los benchmarks que importan a los desarrolladores

Cuatro números tienen el peso práctico real: SWE-Bench Pro 80.3%, FrontierCode Diamond 29.3, Terminal-Bench 2.1 88.0% y GPQA-AA 1932 Elo. Juntos cubren trabajo real en repositorios, los problemas de codificación sintéticos más difíciles, tareas de shell agéntico y razonamiento a nivel de posgrado. Si tu carga de trabajo toca alguno de esos, esta sección te dice si el número se aplica a tu trabajo.

El gráfico principal al inicio de este artículo es la prueba: SWE-Bench Pro 80.3 vs 69.2 vs 58.6, y FrontierCode 29.3 vs 13.4 vs 5.7. ¿Qué miden exactamente?

  • SWE-Bench Pro prueba si un modelo puede enviar un pull request real a un repositorio real: clonar, entender, parchear, pasar las pruebas. Fable 5 lo logra en 8 de cada 10 casos. Es el proxy más cercano a "¿puede hacer mi trabajo real?"
  • Terminal-Bench 2.1 puntúa tareas de shell agéntico: ejecutar comandos, leer la salida, recuperarse de errores. El 88.0% importa si estás construyendo agentes de codificación de IA que viven en una terminal.
  • FrontierCode Diamond es el nivel más difícil de problemas de codificación, los que la mayoría de los modelos apenas pasan de un dígito. 29.3 es bajo en términos absolutos pero más del doble del 13.4 de Opus 4.8.
  • GPQA-AA es razonamiento científico de nivel de posgrado, puntuado como un rating Elo. 1932 indica un razonamiento de múltiples pasos sólido, más allá del código.

En nuestros flujos de trabajo con Claude Code a lo largo de la línea Opus 4.x, el techo recurrente eran las tareas agénticas de largo alcance: el modelo perdía el hilo a mitad de un cambio en múltiples archivos. Los números de Terminal-Bench y SWE-Bench Pro de Fable 5 sugieren que ese techo se movió. Si se movió para tu repositorio es la única prueba que cuenta, pero los números publicados son exactamente del tipo que deberías tener en cuenta.

Casos de uso reales: qué puede hacer Fable 5 que los modelos anteriores no podían

Anthropic publicó tres ejemplos concretos que muestran la clase de problemas que Fable 5 puede resolver ahora: una migración del código base de Stripe comprimida de meses a un día, un videojuego completado solo con visión, y un salto de rendimiento de 3× gracias a la auto-validación. Cada uno apunta a una capacidad que los modelos anteriores no podían alcanzar. Los tres son de fuentes de Anthropic; citamos su anuncio, no una prueba propia.

Esto es lo que demuestra cada uno:

  1. Migración Ruby de Stripe. Anthropic informa que Fable 5 comprimió una migración de código base Ruby de aproximadamente dos meses a alrededor de un día. Ese es el tamaño de problema que este modelo cambia. Esta es la clase de refactorización de largo alcance que antes requería un equipo humano con todo el código base en la cabeza.

  2. Pokémon FireRed solo con visión. Según Anthropic, Fable 5 completó Pokémon FireRed usando solo visión, donde los modelos anteriores necesitaban complejos arneses personalizados para pasar el estado del juego como texto. Es un salto en razonamiento espacial y visual: el modelo lee la pantalla y actúa, sin andamiaje.

  3. Slay the Spire, 3×. Con el máximo esfuerzo de razonamiento, Anthropic dice que Fable 5 auto-valida sus propios movimientos y alcanzó un rendimiento 3× mejor mediante memoria persistente. La conclusión no es el juego; es que el modelo puede verificar su propio trabajo a lo largo de un horizonte de planificación largo y mejorar a partir de ello.

Ninguna de estas es algo que debas dar por sentado para tu carga de trabajo. Pero se mapean claramente con los saltos de benchmark en la tabla anterior: codificación de largo alcance (SWE-Bench Pro), razonamiento espacial (visión) y auto-validación (el dial de esfuerzo de razonamiento). Los logros cualitativos y los cuantitativos cuentan la misma historia.

Precios y la realidad del coste por tarea

Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Anthropic lo enmarca como "menos de la mitad del precio de Claude Mythos Preview". También es aproximadamente 2× Opus 4.8 por token. Ambas cosas son ciertas. El problema es que el precio por token es la unidad equivocada. Lo que realmente pagas es una tarea terminada, y ahí es donde el cálculo de Fable 5 se vuelve interesante.

Precisión en FrontierCode frente a coste por tarea — Claude Fable 5 escala de esfuerzo bajo a máximo, superando a Opus 4.8 y GPT-5.5
Puntuación en FrontierCode vs coste medio por tarea a medida que el esfuerzo de razonamiento escala de bajo a máximo. Fuente: Anthropic.

El esfuerzo de razonamiento es un dial que configuras por solicitud. El esfuerzo bajo significa menos tokens de razonamiento interno y una respuesta más barata y rápida; el esfuerzo máximo significa que el modelo piensa más, gasta más tokens de salida y puntúa más alto. El gráfico anterior muestra a Fable 5 escalando de ~11% a ~31% en FrontierCode a medida que el esfuerzo sube de bajo a máximo, mientras Opus 4.8 llega a alrededor del 13% y GPT-5.5 se mantiene plano cerca del 5-6%. Así que el coste por tarea no es un número único; es una curva en la que eliges un punto.

Trabajemos un ejemplo concreto con los precios publicados de $10/$50. Es aritmética de las tarifas publicadas por Anthropic, no un resultado de benchmark.

Toma una llamada agéntica individual con 50.000 tokens de entrada y 15.000 tokens de salida con esfuerzo alto:

text
Entrada:  50.000 / 1.000.000 × $10 = $0.50
Salida: 15.000 / 1.000.000 × $50 = $0.75
Por llamada:                          $1.25

Una tarea agéntica real encadena muchas llamadas así: leer el repositorio, planificar, editar, ejecutar pruebas, corregir, repetir. Supongamos que el bucle corre 12 llamadas con esa forma: aproximadamente $15 por la tarea terminada. Con el máximo esfuerzo de razonamiento y contexto más pesado, la propia curva de costes de Anthropic sitúa las tareas difíciles de FrontierCode cerca del rango de $20 por tarea. Ejecuta la misma tarea en GPT-5.5 y pagarás menos por token. Pero si no puede terminar la tarea a ningún nivel de esfuerzo, tu coste por tarea terminada es infinito. Fable 5 cuesta más por token que GPT-5.5, y aun así gana en coste por tarea terminada, porque completa trabajo que GPT-5.5 no puede.

Aquí tienes una llamada mínima. El id del modelo es claude-fable-5 en la API (anthropic.claude-fable-5 en Bedrock). Desde la generación 4.6, los ids de modelo de Anthropic no llevan fecha, tal como confirma el anuncio de Anthropic, así que no hay ningún alias versionado que rastrear, esta cadena es el snapshot fijado:

python
import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
    model="claude-fable-5",          # dateless id; this is the pinned snapshot
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 8000},  # reasoning effort
    messages=[
        {"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
    ],
)

print(message.content)

La tesis económica en una línea: pagas más por token que con GPT-5.5, pero terminas tareas que GPT-5.5 no puede terminar a ningún precio. Para trabajo de alto volumen y bajo riesgo, ese cálculo favorece un modelo más barato. Para codificación agéntica difícil, favorece a Fable 5.

La división de salvaguardas: por qué Fable recurre a Opus 4.8

Fable 5 ejecuta clasificadores en cada solicitud. Cuando detecta una consulta de alto riesgo (ciberataque ofensivo, bio, química o intentos de destilación del modelo), recurre a Opus 4.8 en lugar de responder con toda la capacidad de clase Mythos. Anthropic dice que este respaldo se activa en menos del 5% de las sesiones, por lo que la mayoría de los usuarios nunca lo desencadenan. El objetivo es mantener la capacidad peligrosa detrás de la barrera mientras se deja el trabajo cotidiano intacto.

El número más revelador es la tasa de éxito de ataques: con qué frecuencia un atacante automatizado puede hacer jailbreak al modelo para que haga algo que no debería. Menos es mejor. Gray Swan y el UK AI Security Institute realizaron pruebas de red-teaming de agentes con k=100 y razonamiento activado, y los resultados ponen una cifra real a la brecha:

ModeloTasa de éxito de ataques
Claude Fable 54.8%
Claude Opus 4.89.6%
GPT-5.530.8%
Gemini 3.1 Pro45.5%

Fable 5 sigue liderando el campo, pero el margen sobre Opus 4.8 es de aproximadamente 2x, no la brecha de un orden de magnitud que a veces se cita. Frente a GPT-5.5 y Gemini 3.1 Pro, la brecha es mucho mayor, de 6-9x.

¿Por qué debería importarte? Si despliegas un agente con acceso a herramientas (shell, sistema de archivos, red), un jailbreak no es una mala respuesta en el chat, es el modelo ejecutando comandos reales hacia donde un atacante lo dirigió. Una tasa de éxito de ataque por debajo del 5%, aproximadamente la mitad de la de Opus 4.8, sigue mereciendo la pena para cualquier cosa que toque herramientas en vivo. La cobertura de IT Pro destacó el mecanismo de respaldo exactamente por esta razón: es la función que hace que un modelo frontier sea lo suficientemente seguro para ponerlo en manos del público.

La contrapartida es la latencia. Si tu flujo de trabajo toca legítimamente herramientas de seguridad, el respaldo puede activarse a mitad de una tarea y cambiar de modelo, algo que hay que planificar.

Claude Mythos 5 y la pregunta del uso dual

Claude Mythos 5 es el hermano restringido: el mismo modelo sin el respaldo de salvaguardas. Conserva la capacidad de ciberataque ofensivo que Fable 5 bloquea, que es exactamente por qué Anthropic no lo lanza públicamente. El acceso se gestiona a través del Proyecto Glasswing, un programa evaluado para defensores e investigadores que necesitan capacidad completa. El mismo modelo, dos posturas de lanzamiento: uno abierto, otro restringido.

Resultados de evaluación cibernética ofensiva — Claude Mythos 5 con alta capacidad, Claude Fable devuelve 0.0 donde se activan las salvaguardas
Evaluaciones cibernéticas ofensivas: Mythos 5 conserva la capacidad; Fable devuelve 0.0 donde se activan las salvaguardas de bloqueo. Fuente: Anthropic.

El gráfico hace visible la restricción. En las evaluaciones de ciberataque ofensivo (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench), Mythos 5 obtiene 88.4, 24.0, 83.8 y 38.7. Fable 5 devuelve un plano 0.0 en los cuatro. En las evaluaciones de ciberataque ofensivo, Mythos 5 obtiene hasta 88.4 donde Fable 5 devuelve un plano 0.0: la división de salvaguardas, hecha visible.

Ese cero no es una brecha de capacidad. Es el respaldo activándose cada vez, bloqueando la solicitud antes de que el modelo de clase Mythos responda. TechCrunch señaló el momento: Anthropic lanzó esto días después de advertir que la IA se está volviendo demasiado peligrosa para lanzarse abiertamente. La división Fable/Mythos es la respuesta política a esa advertencia: publicar la capacidad, restringir el peligro.

Para la mayoría de los desarrolladores, Mythos 5 no es relevante. Nunca calificarás para el Proyecto Glasswing y no lo necesitas. Lo que importa es saber que el modelo que estás llamando está deliberadamente limitado en un rango estrecho de tareas, por diseño.

Qué pasó después del lanzamiento: dos semanas de suspensión y luego un parche de seguridad

Las primeras seis semanas de Fable 5 no fueron un camino recto. Tres días después del lanzamiento del 9 de junio, el gobierno de EE. UU. aplicó controles de exportación a los modelos más nuevos de Anthropic, y el 12 de junio de 2026 el acceso quedó suspendido para todos los usuarios, en todas partes, porque Anthropic no tenía forma de verificar quién estaba llamando realmente a la API. La aprobación del gobierno llegó el 26 de junio, restaurando primero Mythos 5 para un grupo de organizaciones estadounidenses evaluadas (Anthropic no ha publicado cuántas). La restauración completa para todos llegó el 1 de julio de 2026, el mismo día en que GitHub reactivó Fable 5 en Copilot. Consulta nuestra cronología completa de la suspensión para ver el ida y vuelta en detalle.

Esa suspensión fue un problema de licencias, no de seguridad. Por separado, y sin relación con la congelación por controles de exportación, investigadores de Amazon encontraron un método de prompting que sorteaba las salvaguardas de Fable 5 lo suficientemente bien como para extraer vulnerabilidades de software que el clasificador debía bloquear. Anthropic no retiró el modelo por esto; lanzó una solución junto con la restauración del 1 de julio, una actualización del clasificador que bloquea esa técnica específica en más del 99% de los casos, y el resto recurre a Opus 4.8 como antes. Dos problemas distintos, dos soluciones distintas, que caen en la misma semana del calendario, no es lo mismo que uno causando el otro.

Si estás planificando en torno a Fable 5 para algo de cara al cliente, la lección práctica es que los términos del día de lanzamiento de un modelo frontier no siempre se mantienen seis semanas después.

El campo competitivo ha cambiado: GPT-5.6 y Claude Sonnet 5

Comparar Fable 5 solo con GPT-5.5 tenía sentido el 9 de junio. Ya no. Dos lanzamientos desde entonces cambian el cálculo, y el más importante viene de la propia gama de Anthropic, no de un rival.

Claude Sonnet 5, lanzado el 30 de junio de 2026, es la omisión que más importa. Tiene un precio de $3/$15 por millón de tokens estándar, $2/$10 como tarifa de introducción hasta el 31 de agosto de 2026, una fracción de los $10/$50 de Fable 5. En SWE-Bench Pro obtiene un 63.2%, por detrás del 80.3% de Fable 5 y del 69.2% de Opus 4.8. Pero en Terminal-Bench 2.1 llega al 80.4%, que supera el 74.6% de Opus 4.8, y su puntuación en OSWorld-Verified es del 81.2%. Un modelo de la misma familia a una quinta parte del precio de Fable 5 superando al buque insignia anterior en un benchmark agéntico no es un detalle que un artículo de "¿deberías cambiar?" pueda omitir.

GPT-5.6, la continuación de OpenAI lanzada el 9 de julio de 2026, llega en tres niveles: Sol, Terra y Luna. Sol tiene un precio de $5/$30, aproximadamente la mitad del coste de entrada de Fable 5, con Terra a $2.50/$15 y Luna a $1/$6. Cara a cara, según la comparativa de benchmarks de Vellum del 9 de julio:

BenchmarkGPT-5.6 SolFable 5
SWE-Bench Pro64.6%80.0%
Terminal-Bench 2.188.8%86.0%
Coding Agent Index8077.2
Agents' Last Exam53.640.5
OSWorld62.6% (2.0)85.0% (Verified)

Sol gana en Terminal-Bench, el Coding Agent Index y Agents' Last Exam, usando supuestamente menos de la mitad de los tokens de salida, menos de la mitad del tiempo y alrededor de un tercio menos de coste por tarea que Fable 5. Fable 5 sigue ganando de forma decisiva en SWE-Bench Pro y OSWorld.

Si juntas ambas actualizaciones, el veredicto honesto pasa de "Fable 5 arrasa en el campo" a "Fable 5 gana en trabajo real sobre repositorios y en uso del ordenador, pero pierde terreno en tareas agénticas y de terminal, y en coste, frente a modelos que no existían cuando se publicó este artículo por primera vez". Si tu carga de trabajo tiene la forma de SWE-Bench, pull requests reales contra repositorios reales, Fable 5 sigue siendo la elección. Si tiene forma de terminal y agente, o tienes limitaciones de presupuesto, revisa el campo más nuevo antes de decidirte. El próximo lanzamiento del propio Anthropic sigue siendo una incógnita; consulta nuestro artículo sobre la fecha de lanzamiento de Claude Fable 6 para ver qué sugiere el patrón de nombres.

En cuanto a los precios actuales de la API en toda la familia: Fable 5 y Mythos 5 funcionan ambos a $10/$50 por millón de tokens, Opus 4.8 cuesta $5/$25, Sonnet 5 cuesta $3/$15 ($2/$10 de introducción hasta el 31 de agosto de 2026), y Haiku 4.5 cuesta $1/$5.

Qué significa todo esto: ¿deberías cambiar?

Cambia a Fable 5 para codificación agéntica difícil, tareas de múltiples pasos de largo alcance y razonamiento visual o espacial, donde terminar la tarea vale más que ahorrar centavos por token. Quédate en Opus 4.8 para trabajo de alto volumen sensible al coste, o para cualquier cosa que active el respaldo de todas formas. Ese es el marco completo. El resto es hacer coincidir tu carga de trabajo con el lado correcto de él.

Cuándo Fable 5 gana:

  • Codificación agéntica difícil donde Opus 4.8 se detiene; la brecha en SWE-Bench Pro es real
  • Tareas de largo alcance (refactorizaciones de múltiples archivos, migraciones) donde la auto-validación da resultados
  • Cargas de trabajo de visión y razonamiento espacial
  • Cualquier tarea donde una tarea terminada vale más que la prima por token

Cuándo Opus 4.8 sigue ganando:

  • Trabajo de alto volumen y coste sensible donde el precio por token domina
  • Cargas de trabajo de cyber/bio/química, donde Fable 5 recurre a Opus 4.8 de todas formas, así que llámalo directamente
  • Flujos sensibles a la latencia que no pueden tolerar un cambio de modelo a mitad de una tarea
Caso de usoModelo recomendado
Codificación agéntica difícil / migracionesClaude Fable 5
Visión / razonamiento espacialClaude Fable 5
Clasificación barata de alto volumenClaude Opus 4.8
Herramientas de seguridad / red-teamClaude Opus 4.8 (directo)

Sobre la disponibilidad: el planteamiento de "gratis hasta una fecha" del lanzamiento ha desaparecido. La fecha límite de precios se pospuso cuatro veces, del 22 de junio al 7 de julio, al 12 de julio, al 19 de julio de 2026, y la resolución del 20 de julio sustituyó la fecha por una división por niveles: Max y Team Premium mantienen Fable 5 incluido de forma permanente al 50% de los límites del plan, mientras que Pro y Team Standard pasan a créditos de uso, un crédito único de $100 seguido de tarifas de API. Esa división la reportan TechTimes, XenoSpectrum y Basic Tutorials; Anthropic no la ha publicado en su propia página de precios, así que trátala como reportada, no confirmada. Fable 5 está disponible de forma general en la API de Claude, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (reactivado el 1 de julio de 2026 según el registro de cambios de GitHub; los administradores de Business y Enterprise tienen que activarlo, ya que la política viene desactivada por defecto), y las aplicaciones de consumo Pro/Max/Team/Enterprise. La ventana de contexto es de 1M de tokens, la salida máxima es de 128k tokens, y el corte de conocimiento es enero de 2026. Dos detalles a tener en cuenta para compradores empresariales: Fable 5 y Mythos 5 son Modelos Cubiertos bajo la retención obligatoria de datos de 30 días de Anthropic, por lo que no están disponibles con retención cero de datos, y la inferencia exclusiva en EE. UU. conlleva un multiplicador de precio de 1.1x.

Sobre el autor

Mert Batur es cofundador de Techsy.io, donde el equipo desarrolla agentes de IA, sistemas de automatización y pipelines de voz/SDR para clientes B2B. Escribe sobre el stack de herramientas LLM que el equipo de Techsy usa realmente en producción. Conéctate en LinkedIn.

Cofundador, Techsy.io

Preguntas frecuentes

¿Qué es Claude Fable 5?

Claude Fable 5 es el primer modelo de clase Mythos disponible públicamente de Anthropic, lanzado el 9 de junio de 2026. Obtiene un 80.3% en SWE-Bench Pro y ejecuta clasificadores de salvaguarda que recurren a Opus 4.8 en consultas de alto riesgo. Cuesta $10 de entrada / $50 de salida por millón de tokens.

¿Cuál es la diferencia entre Fable 5 y Mythos 5?

Son el mismo modelo frontier con diferentes posturas de lanzamiento. Fable 5 es público y está protegido; recurre a Opus 4.8 en consultas peligrosas. Mythos 5 es la versión restringida de capacidad completa, accesible únicamente a través del programa Proyecto Glasswing de Anthropic para defensores e investigadores evaluados.

¿Es Claude Fable 5 realmente mejor que Opus 4.8?

Sí, en codificación agéntica difícil, visión y razonamiento espacial: Fable 5 llega al 80.3% en SWE-Bench Pro frente al 69.2% de Opus 4.8. Pero Opus 4.8 sigue ganando en trabajo de alto volumen sensible al coste, y Fable 5 recurre a Opus 4.8 para temas de alto riesgo de cyber/bio/química de todas formas. "Mejor" depende de tu carga de trabajo.

¿Cuánto cuesta Claude Fable 5?

Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Anthropic lo enmarca como "menos de la mitad del precio de Mythos Preview". Es aproximadamente 2× Opus 4.8 por token, pero el argumento de valor está en el coste por tarea terminada, ya que Fable 5 completa trabajo que los modelos más baratos no pueden.

¿Qué es un modelo de "clase Mythos"?

Clase Mythos es el nuevo nivel de máxima capacidad de Anthropic, lanzado con Fable 5 y Mythos 5. Representa un salto frontier sobre la línea Opus 4.x en benchmarks de codificación y razonamiento. Fable 5 y Mythos 5 son dos versiones de lanzamiento del mismo modelo de clase Mythos: uno público y con salvaguardas, otro restringido.

¿Por qué Fable 5 recurre a Opus 4.8?

Fable 5 ejecuta clasificadores que detectan solicitudes de alto riesgo (ciberataque ofensivo, bio, química o destilación de modelos) y las redirige a Opus 4.8 en lugar de responder con toda la capacidad de clase Mythos. Esto se activa en menos del 5% de las sesiones. En el red-teaming de agentes de Gray Swan / UK AI Security Institute, esa combinación le da a Fable 5 una tasa de éxito de ataques del 4.8% frente al 9.6% de Opus 4.8, ambos muy por delante del 30.8% de GPT-5.5.

¿Puedo acceder a Claude Mythos 5?

Probablemente no. Mythos 5 está restringido detrás del Proyecto Glasswing, el programa de acceso evaluado de Anthropic para defensores e investigadores de seguridad que necesitan la capacidad ofensiva completa que Fable 5 bloquea. La mayoría de los desarrolladores no calificarán y no lo necesitan, ya que Fable 5 cubre el trabajo agéntico y de codificación cotidiano.

¿Dónde puedo usar Claude Fable 5?

Claude Fable 5 está disponible de forma general en la API de Claude, Amazon Bedrock, Google Cloud/Vertex AI, Microsoft Foundry, GitHub Copilot (reactivado el 1 de julio de 2026, opcional para administradores de Business/Enterprise) y las aplicaciones de consumo Pro/Max/Team/Enterprise. El precio ya no es "gratis hasta una fecha": Max y Team Premium lo mantienen incluido de forma permanente, mientras que Pro y Team Standard reciben un crédito único de $100 y después pagan tarifas de API, según lo reportado por TechTimes y XenoSpectrum.

Conclusión

Claude Fable 5 es un salto frontier real sobre Opus 4.8: 80.3% frente a 69.2% en SWE-Bench Pro, el doble en la puntuación de FrontierCode, y una tasa de éxito de ataques del 4.8% frente al 9.6% de Opus 4.8 bajo el red-teaming de Gray Swan / UK AISI, lo que lo sigue haciendo la opción más segura para agentes que usan herramientas, aunque el margen es de aproximadamente 2x, no el orden de magnitud que a veces se afirma. Cambia para codificación agéntica difícil, tareas de largo alcance y trabajo con visión; revisa primero Claude Sonnet 5 y GPT-5.6 Sol si tu carga de trabajo tiene forma de terminal y agente o tienes limitaciones de presupuesto, ya que ambos se lanzaron después de Fable 5 y ninguno existía para compararlo en el lanzamiento. El acceso tampoco es ya gratis hasta una fecha: Max/Team Premium lo mantienen incluido, Pro/Team Standard reciben un crédito único y después pagan tarifas de API. El equipo de Techsy construye agentes de producción exactamente sobre este stack, así que escríbenos si quieres ayuda.

Etiquetas

Claude Fable 5 y Claude Mythos 5Claude Opus 4.8SWE-Bench Proclase Mythoscodificación agéntica

Compartir este artículo

Inicia Tu Proyecto

¿Listo para construir algo extraordinario?

Convirtamos tu visión en realidad. Nuestro equipo está listo para ayudarte a crear software que marque la diferencia.