Prix de Claude Sonnet 5.5 : ce qui change, ce qui reste
Mis à jour September 28, 2026 · première publication September 27, 2026
Claude Sonnet 5.5 coûte $2 par million de tokens d'entrée et $10 par million de tokens de sortie sur l'API d'Anthropic, soit le même prix catalogue que Sonnet 5. Le changement économique tient à l'efficacité : Anthropic affirme que Sonnet 5.5 peut coûter jusqu'à 30 % de moins par tâche parce qu'il utilise moins de tokens, tout en générant la sortie plus de 30 % plus vite. C'est un maximum annoncé par le fournisseur, pas une remise garantie sur toutes les charges de travail.
Pour une prévision budgétaire, gardez les tarifs par token fixes et modélisez séparément la réduction possible du nombre de tokens et d'étapes de l'agent. Mesurez votre propre mix de tâches avant d'appliquer une hypothèse d'économie.
Prix de l'API Sonnet 5.5
| Type de token | Prix par million |
|---|---|
| Entrée | $2.00 |
| Sortie | $10.00 |
| Écriture en cache de 5 minutes | $2.50 |
| Écriture en cache de 1 heure | $4.00 |
| Lecture du cache | $0.20 |
Anthropic publie ces tarifs dans son annonce de lancement de Sonnet 5.5. N'interprétez pas « jusqu'à 30 % de moins par tâche » comme une baisse de 30 % des tarifs par token : les prix d'entrée et de sortie sont identiques à ceux de Sonnet 5. Le prix de $2/$10 de Sonnet 5 est d'ailleurs désormais le prix standard, Anthropic ayant annulé la hausse qu'elle prévoyait en septembre.
Exemple : efficacité en tokens contre changement de tarif
Prenons une tâche qui utilise 100,000 tokens d'entrée et 10,000 tokens de sortie, sans cache. Aux tarifs publiés de Sonnet 5.5, cela représente $0.20 pour l'entrée plus $0.10 pour la sortie, soit $0.30 par tâche. Si la même tâche utilisait 30 % de tokens en moins dans les deux catégories, son coût modélisé serait de $0.21. C'est une illustration du calcul, pas une promesse que chaque tâche utilisera 30 % de tokens en moins.
Pour une charge de 10,000 tâches de ce type par mois, la base est de $3,000. Une réduction de 30 % du volume de tokens économiserait $900 et ramènerait la facture mensuelle modélisée à $2,100. Les résultats réels varient selon la longueur des prompts, la réutilisation du cache, la longueur des sorties, l'effort de raisonnement, les nouvelles tentatives et les appels d'outils.
Ce que les benchmarks de lancement montrent et ne montrent pas
Anthropic fait état de progrès sur ses évaluations de code et de travail de connaissance, dont Terminal-Bench 4.0 et CursorBench. L'entreprise indique aussi que Sonnet 5.5 génère la sortie plus de 30 % plus vite que Sonnet 5 et que, dans plusieurs comparaisons, il atteint les scores précédents de Sonnet 5 pour une fraction du coût par tâche. Ces résultats sont de bonnes hypothèses pour un plan d'évaluation, mais ce sont des mesures publiées par le fournisseur, pas des données indépendantes de coût en production.
Une mise en garde pratique : un modèle plus rapide ne réduit pas automatiquement une facture d'API facturée au token. La facture baisse quand la consommation par tâche terminée diminue, ou quand moins de tâches exigent des nouvelles tentatives ou une escalade. Une génération plus rapide peut aussi améliorer le débit ou réduire la latence sans changer la dépense en tokens.
Une méthode sûre pour prévoir l'adoption
- Gardez la grille tarifaire constante. Utilisez $2/$10 par million de tokens d'entrée/sortie comme point de départ pour Sonnet 5 et 5.5.
- Mesurez le travail terminé. Comparez le coût par tâche acceptée, pas seulement les tokens par requête. Incluez les nouvelles tentatives, les appels d'outils et la reprise humaine lorsque c'est possible.
- Segmentez par charge de travail. Évaluez séparément le code, le support, l'extraction et les tâches à long contexte ; un taux d'économie moyen unique peut masquer des régressions.
- Utilisez une fourchette. Budgétez 0 % d'économie jusqu'à ce que les tests internes apportent des preuves, puis ajoutez des scénarios mesurés. Considérez le « jusqu'à 30 % » d'Anthropic comme une affirmation de borne haute, pas comme votre prévision.
- Revérifiez la qualité et la latence. Une facture de tokens plus basse n'est pas une économie si le taux d'acceptation chute ou si des modèles de repli plus chers deviennent nécessaires.
FAQ
Sonnet 5.5 est-il moins cher par token ?
Non. Anthropic indique les mêmes tarifs que Sonnet 5 : $2 en entrée et $10 en sortie par million de tokens. Son affirmation de coût par tâche vient de l'usage de moins de tokens pour un travail comparable.
Les 30 % d'économie sont-ils garantis ?
Non. Anthropic décrit des réductions de coût allant jusqu'à 30 % pour la plupart des tâches dans ses documents de lancement. Votre résultat dépend de la charge de travail, du prompt caching, des réglages d'effort et de la qualité d'achèvement des tâches.
Combien coûte une requête mise en cache ?
Anthropic indique les lectures du cache à $0.20 par million de tokens, les écritures de 5 minutes à $2.50 et celles de 1 heure à $4.00. Consultez la documentation tarifaire de l'API Claude à jour avant d'arrêter une prévision.
Faut-il basculer immédiatement le trafic de production ?
Lancez d'abord une évaluation représentative. Testez le modèle en shadow ou en canary, comparez le coût par résultat accepté et la latence, et gardez une voie de retour arrière pour les charges qui régressent.
Sources et lectures associées
- Anthropic : Introducing Claude Sonnet 5.5
- Documentation tarifaire de l'API Anthropic
- Modèle de coûts de Claude Opus 5.5
À lire aussi
Vous souhaitez appliquer cela à votre plateforme ? Transmettez vos factures fournisseurs, journaux de passerelle et principaux workflows ; nous cartographierons les coûts et les économies possibles. Demander un audit gratuit →