Claude Sonnet 5.5 : guide de routage des modèles par coût
Mis à jour September 28, 2026 · première publication September 28, 2026
Claude Sonnet 5.5 a été lancé le 28 septembre 2026 aux tarifs API de Sonnet 5 : 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie. Anthropic le positionne pour le travail quotidien bien cadré, la correction de bugs, le code et les documents soignés, tandis qu'Opus 5.5 vise les travaux plus complexes qui exigent un jugement attentif. Pour les équipes, la bonne question n'est pas de savoir quel modèle gagne un benchmark, mais lequel atteint l'objectif de qualité et de latence de chaque tâche au coût le plus bas par résultat accepté.
Anthropic indique que Sonnet 5.5 est plus de 30 % plus rapide que Sonnet 5 et peut coûter jusqu'à 30 % de moins par tâche. Ce sont des affirmations de lancement. Servez-vous-en pour choisir quoi évaluer, pas comme des réductions budgétaires automatiques.
Ce qu'Anthropic a annoncé
- Sonnet 5.5 conserve les prix catalogue API de Sonnet 5 : 2 $/MTok en entrée, 10 $/MTok en sortie, 2,50 $/MTok pour les écritures de cache de 5 minutes, 4 $/MTok pour les écritures de 1 heure et 0,20 $/MTok pour les lectures de cache.
- Anthropic annonce une génération de sortie plus de 30 % plus rapide que Sonnet 5 et jusqu'à 30 % de coût en moins par tâche pour la plupart des travaux grâce à l'efficacité en tokens.
- L'entreprise décrit Sonnet comme le plus performant sur les tâches quotidiennes bien cadrées ; Opus est conçu pour les tâches complexes qui exigent un jugement attentif.
- Anthropic indique que Haiku 5.5 est attendu dans les prochaines semaines. Il ne faisait pas partie du lancement d'aujourd'hui.
Consultez l'annonce de lancement d'Anthropic pour les descriptions complètes des benchmarks et leurs réserves.
Une politique de routage à tester
| Charge de travail | Candidat de départ | Ce qu'il faut mesurer |
|---|---|---|
| Modifications de code courantes, corrections de bugs, édition de documents | Sonnet 5.5 | Taux de modifications acceptées, nouvelles tentatives, tokens de sortie, temps écoulé |
| Travaux ambigus, à long horizon et à forte exigence de jugement | Comparer Sonnet 5.5 à Opus 5.5 | Qualité à chaque niveau d'effort, fréquence d'escalade, coût de bout en bout |
| Classification ou extraction simple à gros volume | Comparer Sonnet aux modèles moins chers déjà présents dans votre stack | Seuil de qualité, coût par enregistrement valide, gestion des exceptions |
| Travail interactif sensible à la latence | Tester Sonnet 5.5 au niveau d'effort qui atteint le seuil de qualité | Latence de queue, taux d'achèvement et coût par tâche terminée |
Il s'agit d'une matrice de tests, et non d'une affirmation qu'un modèle soit toujours le bon choix pour une catégorie de charge de travail. La forme du prompt, la longueur du contexte, l'environnement d'outils et les critères d'évaluation peuvent changer le résultat.
Pourquoi comparer les prix catalogue ne suffit pas
Le prix par token de Sonnet 5.5 n'a pas baissé au lancement. L'économie potentielle tient au nombre de tokens et d'étapes d'agent nécessaires pour terminer une tâche. Un modèle qui produit une réponse plus courte mais déclenche davantage d'appels d'outils peut coûter plus cher au total ; un modèle qui termine plus vite avec les mêmes tokens peut améliorer la réactivité sans changer la facture de tokens.
Pour un agent, calculez le total d'une tâche ainsi : tokens d'entrée × tarif d'entrée + tokens de sortie × tarif de sortie + écritures/lectures de cache + tout outil ou infrastructure facturé séparément. Ne comparez le total qu'après avoir confirmé que la tâche passe les mêmes contrôles d'acceptation.
Mesurez la migration avant de modifier votre budget
- Choisissez quelques centaines de tâches représentatives, y compris des échecs et des cas limites.
- Exécutez Sonnet 5 et 5.5 avec les mêmes outils, prompts, limites de contexte et niveaux d'effort dans la mesure du possible.
- Enregistrez les frais de tokens, les nouvelles tentatives, les appels d'outils, le temps d'achèvement et l'acceptation humaine.
- Comparez le coût par tâche acceptée et présentez les résultats par famille de tâches, pas seulement en moyenne globale.
- Déployez en canary les charges de travail qui franchissent vos seuils. Gardez une voie de retour vers le modèle précédent pendant que vous surveillez la qualité et les dépenses.
Démarrez les prévisions avec zéro économie supposée. Remplacez cette hypothèse par les écarts mesurés à mesure que l'évaluation produit des preuves. Pour les tarifs API et le prix du cache, consultez la documentation tarifaire d'Anthropic.
FAQ
Sonnet 5.5 est-il moins cher que Sonnet 5 ?
Ses tarifs par token affichés sont identiques. Anthropic indique qu'il peut coûter jusqu'à 30 % de moins par tâche parce qu'il utilise moins de tokens, mais les résultats dépendent de la charge de travail.
Sonnet 5.5 remplace-t-il Opus 5.5 ?
Non. Anthropic présente ces modèles pour des profils de tâches différents. Évaluez les deux lorsque la difficulté de la tâche, le coût d'un échec ou les exigences de qualité justifient la comparaison.
Est-il disponible sur AWS ?
AWS a annoncé sa disponibilité le 28 septembre via Amazon Bedrock et Claude Platform on AWS. Vérifiez la région, l'accès au modèle et les détails de tarification actuels de chaque service avant de planifier le déploiement.
Sources et lectures associées
- Anthropic: Introducing Claude Sonnet 5.5
- AWS: Claude Sonnet 5.5 now available on AWS
- Tarification de Sonnet 5.5 et modèle de coût par tâche
- Modèle de coût de Claude Opus 5.5
À lire aussi
Vous souhaitez appliquer cela à votre plateforme ? Transmettez vos factures fournisseurs, journaux de passerelle et principaux workflows ; nous cartographierons les coûts et les économies possibles. Demander un audit gratuit →