Aller au contenu

Claude Sonnet 5.5 : guide de routage des modèles par coût

Mis à jour September 28, 2026 · première publication September 28, 2026

Claude Sonnet 5.5 a été lancé le 28 septembre 2026 aux tarifs API de Sonnet 5 : 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie. Anthropic le positionne pour le travail quotidien bien cadré, la correction de bugs, le code et les documents soignés, tandis qu'Opus 5.5 vise les travaux plus complexes qui exigent un jugement attentif. Pour les équipes, la bonne question n'est pas de savoir quel modèle gagne un benchmark, mais lequel atteint l'objectif de qualité et de latence de chaque tâche au coût le plus bas par résultat accepté.

Anthropic indique que Sonnet 5.5 est plus de 30 % plus rapide que Sonnet 5 et peut coûter jusqu'à 30 % de moins par tâche. Ce sont des affirmations de lancement. Servez-vous-en pour choisir quoi évaluer, pas comme des réductions budgétaires automatiques.

Ce qu'Anthropic a annoncé

Consultez l'annonce de lancement d'Anthropic pour les descriptions complètes des benchmarks et leurs réserves.

Une politique de routage à tester

Charge de travailCandidat de départCe qu'il faut mesurer
Modifications de code courantes, corrections de bugs, édition de documentsSonnet 5.5Taux de modifications acceptées, nouvelles tentatives, tokens de sortie, temps écoulé
Travaux ambigus, à long horizon et à forte exigence de jugementComparer Sonnet 5.5 à Opus 5.5Qualité à chaque niveau d'effort, fréquence d'escalade, coût de bout en bout
Classification ou extraction simple à gros volumeComparer Sonnet aux modèles moins chers déjà présents dans votre stackSeuil de qualité, coût par enregistrement valide, gestion des exceptions
Travail interactif sensible à la latenceTester Sonnet 5.5 au niveau d'effort qui atteint le seuil de qualitéLatence de queue, taux d'achèvement et coût par tâche terminée

Il s'agit d'une matrice de tests, et non d'une affirmation qu'un modèle soit toujours le bon choix pour une catégorie de charge de travail. La forme du prompt, la longueur du contexte, l'environnement d'outils et les critères d'évaluation peuvent changer le résultat.

Pourquoi comparer les prix catalogue ne suffit pas

Le prix par token de Sonnet 5.5 n'a pas baissé au lancement. L'économie potentielle tient au nombre de tokens et d'étapes d'agent nécessaires pour terminer une tâche. Un modèle qui produit une réponse plus courte mais déclenche davantage d'appels d'outils peut coûter plus cher au total ; un modèle qui termine plus vite avec les mêmes tokens peut améliorer la réactivité sans changer la facture de tokens.

Pour un agent, calculez le total d'une tâche ainsi : tokens d'entrée × tarif d'entrée + tokens de sortie × tarif de sortie + écritures/lectures de cache + tout outil ou infrastructure facturé séparément. Ne comparez le total qu'après avoir confirmé que la tâche passe les mêmes contrôles d'acceptation.

Mesurez la migration avant de modifier votre budget

  1. Choisissez quelques centaines de tâches représentatives, y compris des échecs et des cas limites.
  2. Exécutez Sonnet 5 et 5.5 avec les mêmes outils, prompts, limites de contexte et niveaux d'effort dans la mesure du possible.
  3. Enregistrez les frais de tokens, les nouvelles tentatives, les appels d'outils, le temps d'achèvement et l'acceptation humaine.
  4. Comparez le coût par tâche acceptée et présentez les résultats par famille de tâches, pas seulement en moyenne globale.
  5. Déployez en canary les charges de travail qui franchissent vos seuils. Gardez une voie de retour vers le modèle précédent pendant que vous surveillez la qualité et les dépenses.

Démarrez les prévisions avec zéro économie supposée. Remplacez cette hypothèse par les écarts mesurés à mesure que l'évaluation produit des preuves. Pour les tarifs API et le prix du cache, consultez la documentation tarifaire d'Anthropic.

FAQ

Sonnet 5.5 est-il moins cher que Sonnet 5 ?

Ses tarifs par token affichés sont identiques. Anthropic indique qu'il peut coûter jusqu'à 30 % de moins par tâche parce qu'il utilise moins de tokens, mais les résultats dépendent de la charge de travail.

Sonnet 5.5 remplace-t-il Opus 5.5 ?

Non. Anthropic présente ces modèles pour des profils de tâches différents. Évaluez les deux lorsque la difficulté de la tâche, le coût d'un échec ou les exigences de qualité justifient la comparaison.

Est-il disponible sur AWS ?

AWS a annoncé sa disponibilité le 28 septembre via Amazon Bedrock et Claude Platform on AWS. Vérifiez la région, l'accès au modèle et les détails de tarification actuels de chaque service avant de planifier le déploiement.

Sources et lectures associées

À lire aussi


Vous souhaitez appliquer cela à votre plateforme ? Transmettez vos factures fournisseurs, journaux de passerelle et principaux workflows ; nous cartographierons les coûts et les économies possibles. Demander un audit gratuit →

Retour à finopsllm.com