Modèle de coût de Claude Opus 5.5

Updated September 22, 2026 · first published September 22, 2026

Anthropic a lancé Claude Opus 5.5 (claude-opus-5-5) le 22 septembre 2026. Le prix annoncé est $4 par million de tokens d'entrée et $20 par million de tokens de sortie, en baisse par rapport à $5 et $25 pour Opus 5. C'est une réduction de 20%. Pour la plupart des charges de travail de production, la réduction réelle est plus importante, car le taux qui a le plus bougé est celui que le titre omet.

Les taux qui comptent

Type de tokenOpus 5.5Opus 5Fable 5.1
Entrée (non cachée)$4.00 / MTok$5.00 / MTok$10.00 / MTok
Sortie$20.00 / MTok$25.00 / MTok$50.00 / MTok
Écriture en cache (5 min)$5.00 / MTok$6.25 / MTok$12.50 / MTok
Lecture de cache$0.20 / MTok$0.50 / MTok$0.25 / MTok
Mode rapide (entrée / sortie)$8 / $40

Chaque ligne est 20% moins élevée sauf la lecture de cache, qui est 60% moins cher. À $0.20, c'est maintenant moins cher que le $0.25 de Fable 5.1. Cela inverse la seule ligne où Fable avait l'habitude de gagner. Dans notre modèle de coût Fable 5.1, une charge de travail fortement cachée pouvait s'avérer moins chère sur Fable que sur Opus 5. Contre Opus 5.5, ce n'est plus le cas. Fable coûte plus cher sur chaque type de token.

Pourquoi une tâche typique coûte environ 40% moins cher

L'affirmation d'Anthropic est une baisse de 40% du coût pour un travail typique, pas 20%. Le supplément provient de l'efficacité des tokens. Anthropic dit qu'Opus 5.5 obtient le même résultat avec environ 20% moins de tokens d'entrée et de sortie et écrit une sortie environ 40% moins verbeuse. Un taux plus bas multiplié par moins de tokens se compose : 0.8 × 0.8 = 0.64, ce qui représente environ 36–40% de réduction selon le mélange.

Voici une étape d'agent : 200 000 tokens d'entrée, 90% servis depuis le cache, et 20 000 tokens de sortie.

LigneOpus 5Opus 5.5 (même tokens)Fable 5.1
20K entrée non cachée$0.100$0.080$0.200
180K entrée cachée$0.090$0.036$0.045
20K sortie$0.500$0.400$1.000
Total$0.690$0.516$1.245

Sur des tokens identiques, Opus 5.5 est 25% moins cher qu'Opus 5, pas 20%, en raison de la réduction du cache. Si la réduction de 20% des tokens se maintient pour votre charge de travail, l'étape tombe à environ $0.41, ce qui représente 40% sous Opus 5 et un tiers du coût Fable. La sortie représente toujours environ 80% de la facture dans cet exemple. C'est là que la réduction de verbosité porte ses fruits.

Coût par tâche face à GPT-6 Sol, GPT-6 Astra et Fable 5.1

Prix catalogue par million de tokens, et la même étape d'agent que plus haut (200K en entrée, 90 % en cache, 20K en sortie) calculée sur chaque modèle.

ModèleEntrée $/MTokSortie $/MTokLecture du cache $/MTokMême étape d'agent
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Coût par tâche mesuré sur l'Artificial Analysis Intelligence Index v4.3.2, consulté le 22 septembre 2026, trié par score. GPT-6 Sol est le moyen le moins cher d'atteindre tout score jusqu'à 47,5. Au-delà, Opus 5.5 est le moins cher à chaque niveau : Opus 5.5 high obtient 53,6 pour 1,82 $, alors que GPT-6 Astra max obtient 52,7 pour 3,26 $ et Fable 5.1 max 53,4 pour 7,63 $.

ModèleIntelligence IndexCoût par tâcheTokens de sortie par tâche
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

Tous les réglages de GPT-6 Astra au-dessus de low, tous ceux d'Opus 5 et tous ceux de Fable 5.1 coûtent plus qu'un réglage de Sol ou d'Opus 5.5 au score égal ou supérieur. Le coût par tâche dépend du mix de tâches du benchmark. Rejouez votre propre trafic avant de changer de modèle.

Est-ce assez bien pour remplacer Fable?

Anthropic positionne Opus 5.5 comme correspondant à Fable 5.1 sur la plupart des tâches. Les chiffres publiés le soutiennent pour le travail de codage et agentif :

Artificial Analysis l'a classé premier dans son Indice de Renseignement le jour du lancement. Anthropic dit aussi qu'au niveau d'effort par défaut (moyen), il surpasse GPT-6 Astra à l'effort maximum sur le travail de connaissance pour environ un cinquième du coût par tâche. C'est une comparaison du fournisseur, donc traitez-la comme une hypothèse à tester. Les mathématiques des coûts ci-dessus sont la partie que vous pouvez vérifier vous-même.

Le mode rapide coûte 2×

Le mode rapide coûte $8 en entrée et $40 en sortie, exactement le double du taux standard, pour jusqu'à 2.5× la vitesse. Le modèle standard est aussi environ 30% plus rapide qu'Opus 5. Utilisez le mode rapide pour les chemins interactifs liés à la latence où un utilisateur attend. Gardez-le désactivé pour les travaux par lots, les agents en arrière-plan et les évaluations. Quand le mode rapide est activé par défaut, le coût unitaire double et le tableau de bord ne montre rien d'inhabituel jusqu'à ce que la facture arrive.

Quoi faire cette semaine

  1. Épinglez l'ID du modèle. Pointez la production sur claude-opus-5-5 explicitement et enregistrez l'ID à chaque requête, pour que le coût par requête puisse être divisé par modèle après la migration.
  2. Redéfinissez la base de référence sur votre propre trafic. Relisez un exemple de demandes réelles sur les deux modèles et comparez les tokens par tâche terminée, pas par appel. La revendication d'efficacité des tokens de 20% est la partie la plus susceptible de varier selon la charge de travail.
  3. Revérifiez les paramètres d'effort. Si une charge de travail a été déplacée vers Fable ou vers l'effort maximal pour la qualité, testez Opus 5.5 d'abord au niveau moyen. C'est le paramètre contre lequel Anthropic fait des points de référence.
  4. Rexécutez la décision de routage Fable. Tout itinéraire qui a envoyé du trafic lourd en cache à Fable pour obtenir la lecture de cache moins chère doit être réévalué. Cet avantage de coût a disparu.
  5. Surveiller le taux de succès du cache. À $0.20 contre $4.00, une défaillance du cache coûte maintenant 20× un succès. Une modification du modèle d'invite qui casse le préfixe coûte plus cher que sur Opus 5.

Anthropic dit que Sonnet 5.5 et Haiku 5.5 suivront dans les prochaines semaines. Conservez le harnais de relecture à partir de l'étape 2 pour que chaque version puisse être rétablie en une après-midi.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research