ai-machine-learning

Claude Sonnet 5: Novedades y cuánto cuesta ejecutarlo de verdad

Escrito por Mert Batur
Actualizado Jun 30, 2026
18 lectura
Claude Sonnet 5: Novedades y cuánto cuesta ejecutarlo de verdad

Claude Sonnet 5: Novedades y cuánto cuesta ejecutarlo de verdad

Claude Sonnet 5 llegó hoy, 30 de junio de 2026, y Anthropic fijó el precio de la tarifa intro en $2 por millón de tokens de entrada. Ahí es donde la mayoría de los artículos se quedan. El número que de verdad mueve tu factura es otro: ¿cuánto cuesta una ejecución completa de agente cuando sumas tokens de salida y una docena de turnos de ida y vuelta? Anthropic dice que Sonnet 5 llega a estar "cerca de Opus 4.8" por aproximadamente un tercio del precio. Así que la pregunta real no es la ficha técnica. Es si el coste mensual de tu agente acaba de bajar, y cuánto.

Puntos clave:

  • Claude Sonnet 5 se lanzó el 30 de junio de 2026 y reemplaza a Sonnet 4.6 como el modelo agéntico de gama media de Anthropic.
  • La tarifa intro es de $2/M tokens de entrada y $10/M tokens de salida hasta el 31 de agosto de 2026, luego pasa a $3/$15.
  • Anthropic afirma que el rendimiento es "cercano a Opus 4.8" a aproximadamente un tercio del coste de Opus.
  • Es el modelo por defecto para Claude Free y Pro, y está disponible vía API y Claude Code como claude-sonnet-5.

¿Qué es Claude Sonnet 5? (la respuesta en 30 segundos)

Claude Sonnet 5 es el nuevo modelo de gama media de Anthropic, lanzado el 30 de junio de 2026 y descrito en su post de lanzamiento como el Sonnet más agéntico hasta la fecha. Puede elaborar planes, usar herramientas como navegadores y terminales, y ejecutar tareas de forma autónoma. La tarifa intro es de $2/M tokens de entrada y $10/M tokens de salida, y ya es el modelo por defecto para Claude Free y Pro.

Sí, se lanzó hoy, por si has visto la confusión de "¿ya está disponible Claude Sonnet 5?". Lo seleccionas con el identificador claude-sonnet-5 en la API o en Claude Code. Anthropic lo posiciona como un salto significativo sobre Sonnet 4.6 y dice que su calidad está cerca de su modelo insignia, Opus 4.8, sin el precio de modelo insignia.

La apuesta detrás de todo esto es clara: Claude Sonnet 5 es la jugada de Anthropic para afirmar que la mayoría del trabajo agéntico ya no necesita un modelo de frontera. Si eso se cumple, la historia interesante no es el salto de capacidades. Son los costes.

Qué hay de nuevo frente a Sonnet 4.6 y Opus 4.8

Anthropic describe a Sonnet 5 como "una mejora sustancial sobre su predecesor, Sonnet 4.6" en razonamiento, uso de herramientas, programación y trabajo del conocimiento, con un rendimiento "cercano al de Opus 4.8, pero a precios más bajos". Verifica su propio output sin que se lo pidan, y es más sólido en programación sostenida, depuración y uso de herramientas en múltiples pasos. Estos son los marcos de Anthropic, no nuestras mediciones.

Mejoras agénticas

El cambio principal es la autonomía. Sonnet 5 está diseñado para planificar una tarea, tomar herramientas como navegadores y terminales, y ejecutar series largas sin necesidad de supervisión. Según TechCrunch (citando a Anthropic), el modelo se presenta como una forma más económica de mantener agentes en marcha, con señales tempranas de clientes de equipos como Zapier y Lovable. Ese es el caso de uso que Anthropic persigue: agentes que ejecutan bucles durante minutos u horas, donde cada turno suma tokens.

Cómo se compara con Opus 4.8 sobre el papel

Esta es la parte que importa para presupuestar. La brecha de capacidades se redujo; la de precio, no.

ModeloEntrada $/MSalida $/MIntro vs estándarPosicionamiento
Claude Sonnet 5$2 (intro) → $3$10 (intro) → $15Intro hasta el 31 ago 2026Gama media, Sonnet más agéntico; "cercano a Opus 4.8" (Anthropic)
Claude Sonnet 4.6$3$15EstándarGama media anterior (feb 2026)
Claude Opus 4.8$5 ($10 Fast Mode)$25 ($50 Fast Mode)EstándarInsignia; razonamiento más exigente a largo plazo

Fíjate en que el precio estándar de Sonnet 5 ($3/$15) es idéntico al de Sonnet 4.6. Obtienes un modelo más capaz al mismo precio de etiqueta. Y frente a los $5/$25 de Opus 4.8, Sonnet 5 estándar opera al 60% aproximado de la tasa de entrada y salida. Durante la ventana intro es incluso más barato. Anthropic no ha publicado ningún dato que diga que Sonnet 5 supera a Opus 4.8, así que no lo leas así: la postura oficial es "cercano a", y nos ceñimos a ello.

¿Cuánto cuesta Claude Sonnet 5 de verdad? (economía de tokens)

Claude Sonnet 5 cuesta $2/M tokens de entrada y $10/M tokens de salida durante la ventana intro hasta el 31 de agosto de 2026, luego sube a $3/M de entrada y $15/M de salida. Ese precio estándar iguala el de Sonnet 4.6 para un modelo más capaz, y se sitúa en aproximadamente un tercio de la tarifa estándar de Opus 4.8 ($5/$25). Para trabajo agéntico de alto volumen, esa proporción lo es todo.

¿Y qué significa "por millón de tokens" en la práctica? Un token equivale aproximadamente a tres cuartos de una palabra. Un millón de tokens es mucho texto, quizás 750 000 palabras, pero los agentes los queman rápido porque cada turno reenvía el contexto completo: el prompt de sistema, los mensajes anteriores, los contenidos de archivos y los outputs de herramientas. Un refactor de varios archivos puede consumir cientos de miles de tokens de entrada antes de terminar.

La ventana intro es una decisión real. Hasta el 31 de agosto pagas $2/$10. Después, $3/$15. Si vas a probar Sonnet 5 de todas formas, hacerlo ahora significa que tus evaluaciones corren con el descuento, y consolidas hábitos mientras la matemática es más favorable. La otra cara: no construyas un presupuesto sobre una tarifa intro que perderás en dos meses.

Dos características de la plataforma cambian la factura real más de lo que lo hace la tarifa titular. El caché de prompts te permite reutilizar un contexto almacenado en caché en lugar de pagar el precio completo de entrada en cada turno, con hasta un ~90% de ahorro en la parte cacheada. El procesamiento en lote reduce los costes en torno a un 50% para trabajos no urgentes que puedes ejecutar de forma asíncrona. Ambos están documentados en los precios de la plataforma de Anthropic. Si tu agente reenvía el mismo prompt de sistema grande o base de código en cada turno, el caché de prompts es el mayor palanca de ahorro que tienes. Profundizamos en más tácticas en nuestra guía sobre cómo reducir los costes de la API de LLM.

Rendimiento de búsqueda agéntica de Claude Sonnet 5 frente al coste por tarea en BrowseComp, comparado con Opus 4.8 y Sonnet 4.6
Rendimiento de búsqueda agéntica frente al coste por tarea (BrowseComp): Sonnet 5 se aproxima a la precisión de Opus 4.8 a una fracción del coste. Fuente: Anthropic

A $2 por millón de tokens de entrada, Sonnet 5 hace que los bucles de agentes de alto volumen sean lo suficientemente baratos como para dejarlos correr. Ese es el cambio. La pregunta ya no es "¿puedo permitirme ejecutar este agente?" sino "¿cuántos puedo ejecutar al mismo tiempo?".

Cuánto cuesta de verdad una ejecución de agente con Sonnet 5 (reproducible)

Pongámosle un número. No hemos ejecutado un benchmark de laboratorio, y no vamos a fingir que sí. Lo que sigue es un cálculo transparente que puedes reproducir con tus propios recuentos de tokens, usando las tarifas por token publicadas por Anthropic. Declara tus supuestos, haz la aritmética, y la factura sale sola.

El cálculo explicado

Toma una tarea de agente realista: un refactor de varios archivos que dura unos 12 turnos. Asume aproximadamente 40 000 tokens de entrada y 8 000 tokens de salida por turno (sin caché), porque cada turno reenvía un contexto en crecimiento. Eso son unos 480 000 tokens de entrada y 96 000 tokens de salida en total. Ahora la matemática:

  • Sonnet 5 intro: (0,48M × $2) + (0,096M × $10) = $0,96 + $0,96 = $1,92
  • Sonnet 5 estándar: (0,48M × $3) + (0,096M × $15) = $1,44 + $1,44 = $2,88
  • Opus 4.8 estándar: (0,48M × $5) + (0,096M × $25) = $2,40 + $2,40 = $4,80

Ahora activa el caché de prompts. Si la mayor parte de esos 480 000 tokens de entrada es un contexto reutilizado (prompt de sistema, árbol de archivos, turnos anteriores) y obtienes un ahorro cercano al ~90% documentado en la parte cacheada, el lado de entrada baja de unos $0,96 a aproximadamente $0,10, mientras la salida se mantiene en $0,96.

Escenario (12 turnos, ~480K entrada / ~96K salida, sin caché salvo nota)Coste entradaCoste salidaTotal
Sonnet 5 intro ($2/$10)$0,96$0,96$1,92
Sonnet 5 estándar ($3/$15)$1,44$1,44$2,88
Opus 4.8 estándar ($5/$25)$2,40$2,40$4,80
Sonnet 5 intro + caché de prompts (~90% ahorro entrada)~$0,10$0,96~$1,06

Estas son estimaciones modeladas usando las tarifas por token públicas y los supuestos de tokens indicados, un cálculo que puedes reproducir, no un benchmark que hayamos ejecutado. Sustituye tu propio recuento de turnos y tamaños de token y la estructura se mantiene. Haz los números tú mismo: la misma tarea de agente cuesta aproximadamente $1,92 en Sonnet 5 intro frente a $4,80 en Opus 4.8 estándar, y el caché puede llevar la ejecución de Sonnet 5 cerca de $1,06. En mil de esas ejecuciones al mes, esa es la diferencia entre una factura de ~$1 900 y una de ~$4 800.

Seleccionar el modelo y medir tu propio coste

No tienes que fiarte de nuestros supuestos. Apunta el modelo a tu propio workload y lee los recuentos reales de tokens. En Claude Code, establece el modelo con un flag o en la configuración de tu proyecto:

bash
# Una sola vez
claude --model claude-sonnet-5

# O fíjalo en .claude/settings.json
{
  "model": "claude-sonnet-5"
}

En la API de Anthropic, el identificador de modelo es el mismo, y cada respuesta te devuelve el uso exacto de tokens:

python
import anthropic

client = anthropic.Anthropic()

resp = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)

# Lee los números reales para tu propio cálculo de coste
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)

Multiplica input_tokens por tu tarifa de entrada, output_tokens por tu tarifa de salida, súmalos a lo largo de los turnos, y tienes el coste real de esa tarea. El campo cache_read_input_tokens te muestra cuánto te ahorró el caché en realidad. En nuestra experiencia enrutando modelos para clientes, el coste por tarea es lo que mueve la factura mensual, no la tarifa por token de etiqueta, y la única forma honesta de conocerlo es leer el objeto usage en tu propio tráfico.

Cuándo Sonnet 5 es la opción correcta (casos de uso reales)

Sonnet 5 es la elección adecuada para trabajo agéntico y de programación de alto volumen donde el coste por tarea decide la factura, que es la mayor parte del trabajo de agentes en producción. Recurre a Opus 4.8 solo cuando un solo paso incorrecto sea lo suficientemente costoso como para justificar la prima. Para todo lo que hace bucles, reintenta y reenvía contexto, la tarifa de gama media juega a tu favor.

Casos concretos:

  • Agentes de programación. Los refactors de varios archivos, la generación de tests y las sesiones de depuración consumen tokens en muchos turnos, así que aquí más que en ningún sitio importa una tarifa por turno más baja. Consulta nuestro resumen de agentes de programación IA para saber dónde encaja.
  • Automatización de navegadores y terminales. Las ejecuciones autónomas largas son exactamente para lo que Anthropic diseñó las mejoras agénticas, y exactamente donde los costes se acumulan.
  • Pipelines de trabajo del conocimiento. Los bucles de resumen, extracción e investigación que se ejecutan a escala se benefician del caché más la tarifa de gama media.
  • Agentes orientados al cliente. El alto volumen de solicitudes convierte un pequeño ahorro por tarea en uno mensual considerable.

¿Dónde puedes ejecutarlo? Es el modelo por defecto en Claude Code, está disponible a través de la API y se está desplegando en las principales plataformas. Si estás eligiendo herramientas, nuestra comparativa de Cursor y Copilot frente a Claude Code cubre los pros y contras.

¿Es Sonnet 5 mejor que Opus 4.8, y cuándo sigue valiendo Opus?

No, no "mejor" según el propio planteamiento de Anthropic. Anthropic dice que Sonnet 5 está "cerca de Opus 4.8", no por delante. Elige Sonnet 5 para trabajo agéntico y de programación sensible al coste y de alto volumen. Recurre a Opus 4.8 en el razonamiento a largo plazo más exigente, donde un paso incorrecto es caro y la mayor precisión justifica su precio.

Un criterio rápido:

  • ¿Bucles de agentes de alto volumen, sensible al coste? Sonnet 5.
  • ¿Razonamiento más difícil, precisión en un solo intento crítica? Opus 4.8.
  • ¿Migrando desde Sonnet 4.6 y vigilando el presupuesto? Sonnet 5 (mismo precio estándar, más capaz).
  • ¿Workload mixto? Enruta el 90% más sencillo a Sonnet 5 y escala solo los casos difíciles a Opus.

Ese último patrón es donde un gateway de LLM para enrutar modelos y controlar costes resulta rentable. En el plano competitivo, algunos medios señalan que Sonnet 5 es más barato que GPT-5.5 para programación agéntica, y Gemini 3.1 Pro juega en el mismo nivel. Haz benchmark con tu propio workload antes de comprometerte, porque el precio por tarea y el ajuste a la tarea rara vez coinciden como sugiere un único ranking.

Sonnet 5 no reemplaza a Opus 4.8. Reemplaza usarlo para todo.

¿Para qué NO es bueno Claude Sonnet 5? (límites honestos)

Sonnet 5 es de gama media, así que no es la opción para razonamiento de frontera, la autonomía a más largo plazo o tareas de precisión máxima en un solo intento. Para esas, Opus 4.8 sigue siendo la apuesta más segura. Toda la propuesta de valor es "cerca del modelo insignia por menos", y "cerca" hace un trabajo real en esa frase.

Un límite concreto que conviene conocer: Anthropic dice que Sonnet 5 tiene "una capacidad mucho menor para realizar tareas de ciberseguridad que nuestros modelos Opus actuales", y señala que nunca desarrolló un exploit funcional durante las pruebas de vulnerabilidades de Firefox. Si tus herramientas de seguridad son tu caso de uso, esa es una elección de diseño deliberada, no un fallo, pero planifica en consecuencia.

Y no asumas un tamaño de ventana de contexto. El post de lanzamiento de Anthropic no indica ninguno, lo que nos lleva a los rumores.

Los rumores de "Fennec": qué está realmente confirmado (desmontando mitos)

Muchos números que circulan sobre Sonnet 5 no proceden de Anthropic. Aquí está la línea entre el lanzamiento confirmado y la narrativa del leak, con cada rumor atribuido a páginas agregadoras y de filtraciones, no al post oficial.

  • Nombre en clave "Fennec". Rumor no confirmado. Ese identificador filtrado de un log de Vertex AI meses antes apuntaba históricamente a Sonnet 4.6, no a Sonnet 5. Anthropic no anunció ningún nombre en clave.
  • "Ventana de contexto de 1M tokens". No se menciona en ningún lugar del post oficial de lanzamiento. Trata cualquier número específico de ventana de contexto como no verificado hasta que Anthropic publique uno.
  • "82,1% / 92,4% en SWE-bench". Fabricaciones de agregadores. Cita solo las cifras del post oficial o de la system card; ignora el resto.
  • "Lanzamiento el 1 de abril", "entrenado en TPUs de Google", "Dev Team Mode". Falso o no confirmado. El lanzamiento es el 30 de junio de 2026, y ninguna de esas características o afirmaciones aparece en los materiales de Anthropic.

Anthropic nunca anunció un nombre en clave "Fennec" para Sonnet 5. Ese identificador se filtró de un log de Vertex AI meses antes y apuntaba a un modelo diferente. Si una página cita un benchmark preciso sin enlazar a la system card, trátalo como ruido.

¿Deberías cambiar de Sonnet 4.6? (veredicto de migración)

Si estás en Sonnet 4.6, cambiar a Sonnet 5 es de bajo riesgo: obtienes un modelo más capaz al mismo precio estándar ($3/$15), y la ventana intro ($2/$10 hasta el 31 de agosto) hace que probar sea barato ahora mismo. The New Stack lo describe como cerrar la brecha con Opus 4.8 mientras se mantiene barato hasta agosto, una lectura justa para los desarrolladores que valoran el cambio.

Algunas advertencias antes de cambiar el tráfico en producción:

  • Cambia el identificador de modelo a claude-sonnet-5. Es el único cambio de código necesario para la mayoría de las configuraciones.
  • Revisa cualquier suposición sobre prompts o outputs. Un modelo más capaz puede cambiar el tono, la verbosidad o el formato de formas que importan más adelante.
  • Valida primero en tu conjunto de evaluación. No cambies el tráfico de producción por intuición.
  • Vigila el salto de precio del 31 de agosto si estás presupuestando más allá del verano.

El veredicto: al mismo precio estándar que Sonnet 4.6 con mejor rendimiento agéntico, quedarse en 4.6 es la opción más difícil de justificar. Cambia ahora para aprovechar la tarifa intro, espera solo si tienes un ciclo de evaluación congelado, y reserva Opus 4.8 para las tareas más difíciles. Si tu equipo está enrutando modelos y gestionando costes de LLM en producción, ofrecemos una consulta gratuita para orientaros.

Sobre el autor

Mert Batur es cofundador de Techsy.io, donde el equipo construye agentes de IA, sistemas de automatización y pipelines de voz/SDR para clientes B2B. Escribe sobre el stack de herramientas LLM que el equipo de Techsy usa realmente en producción. Conéctate en LinkedIn.

Credenciales: Cofundador, Techsy.io. Precios verificados frente al post de lanzamiento de Anthropic el 30 de junio de 2026.

Preguntas frecuentes

¿Se ha lanzado ya Claude Sonnet 5?

Sí. Anthropic lanzó Claude Sonnet 5 el 30 de junio de 2026 como modelo por defecto para Claude Free y Pro, y lo puso a disposición de usuarios Max, Team y Enterprise. También puedes acceder a él a través de la API de Anthropic y Claude Code usando el identificador claude-sonnet-5.

¿Cuánto cuesta Claude Sonnet 5?

La tarifa intro es de $2 por millón de tokens de entrada y $10 por millón de tokens de salida hasta el 31 de agosto de 2026. Después, pasa a la tarifa estándar de $3 por millón de entrada y $15 por millón de salida, la misma tarifa estándar que Sonnet 4.6 para un modelo más capaz.

¿Es Claude Sonnet 5 realmente mejor que Opus 4.8?

No según la propia descripción de Anthropic. Anthropic dice que el rendimiento de Sonnet 5 es "cercano a Opus 4.8", no superior. Para el razonamiento a largo plazo más exigente donde un solo paso incorrecto es costoso, Opus 4.8 sigue siendo la opción más sólida. Sonnet 5 gana en coste por tarea, ejecutándose a aproximadamente un tercio del precio estándar de Opus.

¿Cuál es la ventana de contexto de Claude Sonnet 5?

El post de lanzamiento de Anthropic no indica un tamaño de ventana de contexto. Las afirmaciones de "1M de tokens" que circulan en páginas agregadoras no están confirmadas y no provienen de Anthropic. Hasta que Anthropic publique un número oficial, trata cualquier cifra específica de ventana de contexto como no verificada.

¿Cómo uso Claude Sonnet 5?

Establece el identificador de modelo en claude-sonnet-5 en la API de Anthropic, o selecciónalo en Claude Code con claude --model claude-sonnet-5 o en la configuración de tu proyecto. También es el modelo por defecto para Claude Free y Pro, así que no necesitas ninguna configuración. Lee el objeto usage de la respuesta para hacer seguimiento de los costes reales de tokens.

¿El nombre en clave de Claude Sonnet 5 es "Fennec"?

No hay confirmación. "Fennec" es un identificador filtrado que históricamente apuntaba a Sonnet 4.6, y Anthropic no anunció ningún nombre en clave para Sonnet 5. El identificador apareció en un log de Vertex AI meses antes de este lanzamiento, así que trata cualquier afirmación de que "Fennec equivale a Sonnet 5" como un rumor no confirmado.

¿Debería cambiar de Sonnet 4.6 a Sonnet 5?

Probablemente sí. Sonnet 5 opera al mismo precio estándar que Sonnet 4.6 ($3/$15) con mejor rendimiento agéntico, y la ventana intro hace que probar sea barato hasta el 31 de agosto. Cambia el identificador de modelo, valida en tu conjunto de evaluación y comprueba el comportamiento antes de cambiar el tráfico de producción.

¿Cómo se compara Sonnet 5 con GPT-5.5 para programación?

Sonnet 5 es la opción agéntica de programación competitiva en costes de Anthropic, y algunos medios informan de que es más barato que GPT-5.5. Las comparativas de capacidades dependen del workload, así que haz benchmark con tu propia base de código y combinación de tareas antes de comprometerte. El precio por tarea y el ajuste a la tarea rara vez coinciden como sugiere un único ranking.

¿Puedo ejecutar Claude Sonnet 5 en AWS Bedrock?

Anthropic pone los modelos Sonnet a disposición en las principales plataformas cloud, así que la disponibilidad de claude-sonnet-5 en Bedrock y Vertex debería llegar a medida que el despliegue se complete. Comprueba el estado actual de la plataforma para tu región, ya que los lanzamientos del mismo día suelen llegar primero a la API de primer nivel y a Claude Code antes que a todas las plataformas de terceros.

¿Cómo puedo reducir los costes de Claude Sonnet 5?

Usa el caché de prompts para un ahorro de hasta aproximadamente el 90% en el contexto reutilizado, y el procesamiento en lote para un ahorro de aproximadamente el 50% en trabajos no urgentes. Enruta solo las tareas más difíciles a Opus 4.8 y mantén el trabajo de alto volumen en Sonnet 5. Lee el objeto usage para ver exactamente dónde van tus tokens.

Etiquetas

claude sonnet 5claude sonnet 5 preciosclaude sonnet 5 vs opus 4.8coste llmanthropic

Compartir este artículo

Inicia Tu Proyecto

¿Listo para construir algo extraordinario?

Convirtamos tu visión en realidad. Nuestro equipo está listo para ayudarte a crear software que marque la diferencia.