
Claude Sonnet 5 : nouveautés et coût réel d'exécution
Claude Sonnet 5 est arrivé aujourd'hui, 30 juin 2026, et Anthropic a fixé le tarif d'introduction à 2 dollars par million de tokens d'entrée. C'est là que s'arrête la plupart des articles. Le chiffre qui compte vraiment pour votre facture est différent : combien coûte réellement un run d'agent complet, une fois les tokens de sortie ajoutés et une dizaine d'allers-retours pris en compte ? Anthropic affirme que Sonnet 5 s'approche d'Opus 4.8 pour environ un tiers du prix. La vraie question n'est donc pas la fiche technique. C'est de savoir si le coût mensuel de vos agents vient de baisser, et de combien.
À retenir :
- Claude Sonnet 5 est lancé le 30 juin 2026 et remplace Sonnet 4.6 comme modèle agentique milieu de gamme d'Anthropic.
- Le tarif d'introduction est de 2 $/M de tokens d'entrée et 10 $/M de tokens de sortie jusqu'au 31 août 2026, puis 3 $/15 $.
- Anthropic dit que les performances sont "proches d'Opus 4.8" pour environ un tiers du prix d'Opus.
- C'est le modèle par défaut de Claude Free et Pro, disponible via l'API et Claude Code sous
claude-sonnet-5.
Qu'est-ce que Claude Sonnet 5 ? (30 secondes suffisent)
Claude Sonnet 5 est le nouveau modèle milieu de gamme d'Anthropic, lancé le 30 juin 2026 et décrit dans son article de lancement comme le Sonnet le plus agentique à ce jour. Il peut planifier des tâches, utiliser des outils comme des navigateurs et des terminaux, et s'exécuter de manière autonome. Le tarif d'introduction est de 2 $/M de tokens d'entrée et 10 $/M de sortie, et c'est désormais le modèle par défaut de Claude Free et Pro.
Oui, il est bien sorti aujourd'hui, en cas de doute après avoir vu traîner la question "Claude Sonnet 5 a-t-il été lancé ?". Vous le sélectionnez avec l'identifiant claude-sonnet-5 dans l'API ou dans Claude Code. Anthropic le positionne comme une avancée significative par rapport à Sonnet 4.6, avec une qualité proche de son modèle phare, Opus 4.8, sans le tarif phare.
Voilà le pari derrière tout ça : Claude Sonnet 5 est la mise d'Anthropic selon laquelle la plupart des tâches d'agents n'ont plus besoin d'un modèle de frontière. Si c'est juste, ce qui est intéressant n'est pas le gain de performance. Ce sont les économies.
Ce qui change par rapport à Sonnet 4.6 et Opus 4.8
Anthropic qualifie Sonnet 5 d'"amélioration substantielle par rapport à son prédécesseur, Sonnet 4.6" sur le raisonnement, l'utilisation d'outils, le codage et le travail de connaissance, avec des performances "proches de celles d'Opus 4.8, mais à des tarifs plus bas". Il vérifie ses propres sorties sans qu'on le lui demande, et il est plus fort pour le codage soutenu, le débogage et l'utilisation d'outils en plusieurs étapes. Ce sont les formulations d'Anthropic, pas nos mesures.
Améliorations agentiques
Le changement principal, c'est l'autonomie. Sonnet 5 est conçu pour planifier une tâche, saisir des outils comme des navigateurs et des terminaux, et tenir sur de longues exécutions sans intervention. Comme TechCrunch le rapporte (citant Anthropic), le modèle est présenté comme un moyen moins cher de faire tourner des agents, avec des signaux clients précoces d'équipes comme Zapier et Lovable. C'est le cas d'usage qu'Anthropic cible : des agents qui tournent en boucle pendant des minutes ou des heures, où chaque tour ajoute des tokens.
Comparaison avec Opus 4.8 sur le papier
Voilà la partie qui compte pour budgéter. L'écart de performance s'est réduit ; l'écart de prix, non.
| Modèle | Entrée $/M | Sortie $/M | Intro vs standard | Positionnement |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (intro) → $3 | $10 (intro) → $15 | Intro jusqu'au 31 août 2026 | Milieu de gamme, Sonnet le plus agentique ; "proche d'Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Standard | Ancien milieu de gamme (fév. 2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Standard | Phare ; raisonnement à long horizon le plus exigeant |
Notez que le prix standard de Sonnet 5 ($3/$15) est identique à celui de Sonnet 4.6. Un modèle plus performant au même tarif affiché. Et face aux $5/$25 d'Opus 4.8, Sonnet 5 standard tourne à environ 60 % du tarif d'entrée et de sortie. Pendant la fenêtre d'introduction, c'est encore moins cher. Anthropic n'a pas publié de chiffre indiquant que Sonnet 5 surpasse Opus 4.8 ; ne lisez pas ça : la formulation officielle est "proche de", et nous nous y tenons.
Combien coûte vraiment Claude Sonnet 5 ? (économie des tokens)
Claude Sonnet 5 coûte $2/M de tokens d'entrée et $10/M de tokens de sortie pendant la fenêtre d'introduction jusqu'au 31 août 2026, puis passe à $3/M d'entrée et $15/M de sortie. Ce prix standard correspond à celui de Sonnet 4.6 pour un modèle plus performant, et il se situe à environ un tiers du tarif standard d'Opus 4.8 ($5/$25). Pour les charges de travail agentiques à fort volume, c'est là que tout se joue.
Que représente concrètement "par million de tokens" ? Un token vaut à peu près trois quarts d'un mot. Un million de tokens représente beaucoup de texte, environ 750 000 mots, mais les agents les consomment vite parce que chaque tour renvoie tout le contexte : le prompt système, les messages précédents, le contenu des fichiers, les sorties des outils. Un seul refactoring multi-fichiers peut engloutir des centaines de milliers de tokens d'entrée avant d'être terminé.
Cette fenêtre d'introduction est un vrai moment de décision. Jusqu'au 31 août, vous payez $2/$10. Ensuite, $3/$15. Si vous comptez tester Sonnet 5 de toute façon, le faire maintenant signifie que vos évaluations tournent à tarif réduit, et vous ancrez vos habitudes quand le calcul est le plus favorable. L'inverse : ne construisez pas un budget sur une tarification d'introduction que vous perdrez dans deux mois.
Deux fonctionnalités plateforme changent la facture réelle plus que le tarif affiché. Le cache de prompt vous permet de réutiliser un contexte mis en cache au lieu de payer le plein tarif d'entrée à chaque tour, pour une économie pouvant atteindre environ 90 % sur la partie mise en cache. Le traitement par lot réduit les coûts d'environ 50 % pour les tâches non urgentes pouvant être exécutées en asynchrone. Les deux sont documentés dans la tarification plateforme d'Anthropic. Si votre agent renvoie le même grand prompt système ou base de code à chaque tour, le cache de prompt est le levier le plus puissant que vous avez sur le coût. Nous abordons d'autres tactiques dans notre guide pour réduire vos coûts d'API LLM.

À $2 par million de tokens d'entrée, Sonnet 5 rend les boucles d'agents à fort volume suffisamment bon marché pour les laisser tourner. C'est le changement. La question n'est plus "puis-je me permettre de faire tourner cet agent ?", mais "combien puis-je en faire tourner simultanément ?"
Le coût réel d'un run d'agent Sonnet 5 (calcul reproductible)
Mettons un chiffre dessus. Nous n'avons pas fait tourner un benchmark de laboratoire, et nous n'allons pas prétendre que oui. Ce qui suit est un calcul transparent que vous pouvez reproduire avec vos propres comptages de tokens, en utilisant les tarifs par token publiés par Anthropic. Posez vos hypothèses, faites l'arithmétique, et la facture en découle.
Le calcul détaillé
Prenons une tâche d'agent réaliste : un refactoring multi-fichiers qui s'exécute en environ 12 tours. Supposons environ 40 000 tokens d'entrée et 8 000 tokens de sortie par tour (sans cache), car chaque tour renvoie un contexte grandissant. Soit environ 480 000 tokens d'entrée et 96 000 tokens de sortie au total. Le calcul :
- Sonnet 5 intro : (0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
- Sonnet 5 standard : (0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
- Opus 4.8 standard : (0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80
Maintenant activons le cache de prompt. Si la plupart de ces 480 000 tokens d'entrée sont un contexte réutilisé (prompt système, arborescence de fichiers, tours précédents) et que vous obtenez une économie proche des ~90 % documentés sur la partie mise en cache, la partie entrée passe d'environ $0.96 à environ $0.10, tandis que la sortie reste à $0.96.
| Scénario (12 tours, ~480 000 entrée / ~96 000 sortie, sans cache sauf indication) | Coût entrée | Coût sortie | Total |
|---|---|---|---|
| Sonnet 5 intro ($2/$10) | $0.96 | $0.96 | $1.92 |
| Sonnet 5 standard ($3/$15) | $1.44 | $1.44 | $2.88 |
| Opus 4.8 standard ($5/$25) | $2.40 | $2.40 | $4.80 |
| Sonnet 5 intro + cache de prompt (~90 % d'économie entrée) | ~$0.10 | $0.96 | ~$1.06 |
Ce sont des estimations modélisées à partir des tarifs publics par token et des hypothèses de tokens indiquées, un calcul que vous pouvez reproduire, pas un benchmark que nous avons fait tourner. Remplacez par vos propres comptages de tours et de tokens, et la structure tient. Faites le calcul vous-même : la même tâche d'agent coûte environ $1.92 sur Sonnet 5 intro contre $4.80 sur Opus 4.8 standard, et le cache peut ramener le run Sonnet 5 à près de $1.06. Sur mille de ces runs par mois, c'est la différence entre une facture de ~$1,900 et une de ~$4,800.
Sélectionner le modèle et mesurer son propre coût
Vous n'avez pas à faire confiance à nos hypothèses. Pointez le modèle sur votre propre charge de travail et lisez les vrais comptages de tokens en retour. Dans Claude Code, définissez le modèle avec un flag ou dans les paramètres de votre projet :
# Une seule fois
claude --model claude-sonnet-5
# Ou le fixer dans .claude/settings.json
{
"model": "claude-sonnet-5"
}Sur l'API Anthropic, l'identifiant de modèle est le même, et chaque réponse vous donne l'utilisation exacte des tokens :
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Lisez les vrais chiffres pour votre propre calcul de coût
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Multipliez input_tokens par votre tarif d'entrée, output_tokens par votre tarif de sortie, sommez sur les tours, et vous avez le coût réel de cette tâche. Le champ cache_read_input_tokens montre combien le cache vous a réellement économisé. D'après notre expérience dans le routage de modèles pour des clients, c'est le coût par tâche qui fait bouger la facture mensuelle, pas le tarif affiché par token, et la seule façon honnête de le connaître est de lire l'objet usage sur votre propre trafic.
Pour quels projets Sonnet 5 est le bon choix
Sonnet 5 est le bon choix pour les charges de travail agentiques et de codage à fort volume où le coût par tâche décide de la facture, ce qui représente la majeure partie du travail d'agent en production. Faites appel à Opus 4.8 uniquement quand une seule erreur est suffisamment coûteuse pour justifier la prime. Pour tout ce qui boucle, réessaie et renvoie du contexte, le tarif milieu de gamme joue en votre faveur.
Choix concrets :
- Agents de codage. Les refactorings multi-fichiers, la génération de tests et les sessions de débogage consomment des tokens sur de nombreux tours, donc un tarif par tour plus bas compte surtout ici. Voir notre comparatif des agents de codage IA pour voir où il se place.
- Automatisation de navigateur et de terminal. Les longs runs autonomes sont exactement ce pour quoi Anthropic a développé les améliorations agentiques, et exactement là où le coût s'accumule.
- Pipelines de travail de connaissance. La résumation, l'extraction et les boucles de recherche à grande échelle bénéficient du cache plus du tarif milieu de gamme.
- Agents orientés client. Un fort volume de requêtes transforme une petite économie par tâche en une grande économie mensuelle.
Où peut-on le faire tourner ? C'est le modèle par défaut dans Claude Code, disponible via l'API, et en déploiement sur les principales plateformes. Si vous choisissez des outils, notre comparaison de Cursor et Copilot face à Claude Code couvre les compromis.
Sonnet 5 est-il meilleur qu'Opus 4.8, et quand Opus vaut-il encore son prix ?
Non, pas "meilleur" selon la formulation même d'Anthropic. Anthropic dit que Sonnet 5 est "proche d'Opus 4.8", pas devant lui. Choisissez Sonnet 5 pour les charges de travail agentiques et de codage à fort volume et sensibles aux coûts. Faites appel à Opus 4.8 pour le raisonnement à long horizon le plus difficile, où une seule erreur est coûteuse et où la précision supplémentaire mérite sa prime.
Un guide rapide :
- Fort volume d'agents en boucle, sensible aux coûts ? Sonnet 5.
- Raisonnement le plus difficile, précision en un coup critique ? Opus 4.8.
- Migration depuis Sonnet 4.6 en surveillant le budget ? Sonnet 5 (même prix standard, plus performant).
- Charge de travail mixte ? Routez les 90 % faciles vers Sonnet 5 et escaladez uniquement les cas difficiles vers Opus.
Ce dernier schéma est là où une passerelle LLM pour router les modèles et contrôler les coûts est rentabilisée. Sur le plan concurrentiel, certains médias notent que Sonnet 5 est moins cher que GPT-5.5 pour le codage agentique, et Gemini 3.1 Pro joue dans le même segment. Benchmarkez sur votre propre charge de travail avant de vous engager, parce que le prix par tâche et l'adéquation de la tâche s'alignent rarement comme un classement unique le suggère.
Sonnet 5 ne remplace pas Opus 4.8. Il remplace l'utilisation d'Opus 4.8 pour tout.
Ce pour quoi Claude Sonnet 5 ne convient pas (limites honnêtes)
Sonnet 5 est milieu de gamme, donc ce n'est pas le choix pour le raisonnement de niveau frontière, l'autonomie à très long horizon, ou les tâches en un coup à précision maximale. Pour celles-là, Opus 4.8 reste le pari plus sûr. Toute la proposition de valeur est "proche du modèle phare pour moins cher", et "proche" fait un vrai travail dans cette phrase.
Une limite spécifique à connaître : Anthropic dit que Sonnet 5 a une "capacité bien inférieure à exécuter des tâches de cybersécurité par rapport à nos modèles Opus actuels", et note qu'il n'a jamais développé d'exploit fonctionnel lors des tests de vulnérabilité Firefox. Si les outils de sécurité sont votre cas d'usage, c'est un choix de conception délibéré, pas un bug, mais planifiez en conséquence.
Et ne supposez pas une taille de fenêtre de contexte. L'article de lancement d'Anthropic n'en indique pas, ce qui nous amène aux rumeurs.
Les rumeurs "Fennec" : ce qui est réellement confirmé (démythification)
Beaucoup de chiffres qui circulent sur Sonnet 5 ne viennent pas d'Anthropic. Voici la ligne entre le lancement confirmé et le récit des fuites, chaque rumeur attribuée à des pages d'agrégateurs et de fuites, pas à l'article officiel.
- Nom de code "Fennec". Non confirmé. Cet identifiant a fuité depuis un log Vertex AI des mois plus tôt et pointait historiquement vers Sonnet 4.6, pas Sonnet 5. Anthropic n'a annoncé aucun nom de code.
- "Fenêtre de contexte d'1 M de tokens". Absent de l'article de lancement officiel. Traitez tout chiffre spécifique de fenêtre de contexte comme non vérifié jusqu'à ce qu'Anthropic en publie un.
- "82,1 % / 92,4 % SWE-bench". Fabrications d'agrégateurs. Ne citez que les chiffres de l'article officiel ou de la fiche système ; ignorez le reste.
- "Sortie le 1er avril", "entraîné sur des TPU Google", "Dev Team Mode". Faux ou non confirmé. Le lancement est le 30 juin 2026, et aucune de ces fonctionnalités ou affirmations ne figure dans les documents d'Anthropic.
Anthropic n'a jamais annoncé de nom de code "Fennec" pour Sonnet 5. Cet identifiant a fuité depuis un log Vertex AI des mois avant ce lancement et pointait vers un autre modèle. Si une page cite un benchmark précis sans lien vers la fiche système, traitez-la comme du bruit.
Faut-il passer de Sonnet 4.6 à Sonnet 5 ? (verdict de migration)
Si vous êtes sur Sonnet 4.6, passer à Sonnet 5 est peu risqué : vous obtenez un modèle plus performant au même prix standard ($3/$15), et la fenêtre d'introduction ($2/$10 jusqu'au 31 août) rend les tests bon marché maintenant. The New Stack le présente comme une réduction de l'écart avec Opus 4.8 tout en restant abordable jusqu'en août, ce qui est une lecture juste pour les développeurs qui pèsent un passage.
Quelques points d'attention avant de basculer le trafic de production :
- Changez l'identifiant de modèle en
claude-sonnet-5. C'est le seul changement de code requis pour la plupart des configurations. - Vérifiez les hypothèses sur vos prompts ou vos sorties. Un modèle plus performant peut changer le ton, la verbosité ou le formatage de façon significative en aval.
- Validez sur votre ensemble d'évaluation d'abord. Ne basculez pas le trafic de production sur une intuition.
- Surveillez l'augmentation de prix du 31 août si vous budgétez au-delà de l'été.
Le verdict : au même prix standard que Sonnet 4.6 avec de meilleures performances agentiques, rester sur 4.6 est le choix le plus difficile à justifier. Passez maintenant pour profiter du tarif d'introduction, attendez seulement si vous avez un cycle d'évaluation gelé, et gardez Opus 4.8 en réserve pour les tâches les plus difficiles. Si votre équipe route des modèles et gère les coûts LLM en production, nous proposons une consultation gratuite pour y voir clair.
À Propos de l'Auteur
Mert Batur est Co-Fondateur de Techsy.io, où l'équipe déploie des agents IA, des systèmes d'automatisation et des pipelines voix/SDR pour des clients B2B. Il écrit sur la stack d'outils LLM que l'équipe Techsy utilise réellement en production. À suivre sur LinkedIn.
Credentials : Co-Fondateur, Techsy.io. Tarification vérifiée à partir de l'article de lancement d'Anthropic le 30-06-2026.
Foire Aux Questions
Claude Sonnet 5 a-t-il été lancé ?
Oui. Anthropic a lancé Claude Sonnet 5 le 30 juin 2026 comme modèle par défaut de Claude Free et Pro, et l'a rendu disponible pour les utilisateurs Max, Team et Enterprise. Vous pouvez également y accéder via l'API Anthropic et Claude Code avec l'identifiant de modèle claude-sonnet-5.
Combien coûte Claude Sonnet 5 ?
Le tarif d'introduction est de $2 par million de tokens d'entrée et $10 par million de tokens de sortie jusqu'au 31 août 2026. Ensuite, il passe au tarif standard de $3 par million d'entrée et $15 par million de sortie, le même tarif standard que Sonnet 4.6 pour un modèle plus performant.
Claude Sonnet 5 est-il vraiment meilleur qu'Opus 4.8 ?
Pas selon la propre description d'Anthropic. Anthropic dit que les performances de Sonnet 5 sont "proches d'Opus 4.8", pas meilleures. Pour le raisonnement à long horizon le plus difficile où une seule erreur est coûteuse, Opus 4.8 reste le meilleur choix. Sonnet 5 gagne sur le coût par tâche, tournant à environ un tiers du prix standard d'Opus.
Quelle est la fenêtre de contexte de Claude Sonnet 5 ?
L'article de lancement d'Anthropic n'indique pas de taille de fenêtre de contexte. Les affirmations de "1 M de tokens" qui circulent sur des pages d'agrégateurs ne sont pas confirmées et ne viennent pas d'Anthropic. Jusqu'à ce qu'Anthropic publie un chiffre officiel, traitez tout chiffre spécifique de fenêtre de contexte comme non vérifié.
Comment utiliser Claude Sonnet 5 ?
Définissez l'identifiant de modèle sur claude-sonnet-5 dans l'API Anthropic, ou sélectionnez-le dans Claude Code avec claude --model claude-sonnet-5 ou vos paramètres de projet. C'est aussi le modèle par défaut de Claude Free et Pro, donc aucune configuration n'est nécessaire là. Lisez l'objet usage de la réponse pour suivre les coûts réels en tokens.
Le nom de code de Claude Sonnet 5 est-il "Fennec" ?
Aucune confirmation. "Fennec" est un identifiant ayant fuité qui pointait historiquement vers Sonnet 4.6, et Anthropic n'a annoncé aucun nom de code pour Sonnet 5. L'identifiant est apparu dans un log Vertex AI des mois avant ce lancement, alors traitez toute affirmation "Fennec = Sonnet 5" comme une rumeur non confirmée.
Dois-je passer de Sonnet 4.6 à Sonnet 5 ?
Probablement oui. Sonnet 5 tourne au même prix standard que Sonnet 4.6 ($3/$15) avec de meilleures performances agentiques, et la fenêtre d'introduction rend les tests bon marché jusqu'au 31 août. Changez l'identifiant de modèle, validez sur votre ensemble d'évaluation, et vérifiez le comportement avant de basculer le trafic de production.
Comment Sonnet 5 se compare-t-il à GPT-5.5 pour le codage ?
Sonnet 5 est l'option de codage agentique compétitive en termes de coût d'Anthropic, et certains médias rapportent qu'il est moins cher que GPT-5.5. Les comparaisons de performances dépendent de la charge de travail, alors benchmarkez les deux sur votre propre base de code et ensemble de tâches avant de vous engager. Le prix par tâche et l'adéquation de la tâche s'alignent rarement comme un seul classement le suggère.
Puis-je faire tourner Claude Sonnet 5 sur AWS Bedrock ?
Anthropic rend les modèles Sonnet disponibles sur les principales plateformes cloud, donc la disponibilité de claude-sonnet-5 sur Bedrock et Vertex devrait suivre au fur et à mesure du déploiement. Vérifiez l'état actuel de la plateforme pour votre région, car les lancements le jour même atteignent souvent l'API first-party et Claude Code avant chaque plateforme tierce.
Comment réduire les coûts de Claude Sonnet 5 ?
Utilisez le cache de prompt pour économiser jusqu'à environ 90 % sur le contexte réutilisé, et le traitement par lot pour environ 50 % d'économies sur les tâches non urgentes. Routez uniquement les tâches les plus difficiles vers Opus 4.8 et gardez le travail à fort volume sur Sonnet 5. Lisez l'objet usage pour voir exactement où vont vos tokens.