Modèle de coût de Claude Opus 5.5
Updated September 22, 2026 · first published September 22, 2026
Anthropic a lancé Claude Opus 5.5 (claude-opus-5-5) le 22 septembre 2026. Le prix annoncé est $4 par million de tokens d'entrée et $20 par million de tokens de sortie, en baisse par rapport à $5 et $25 pour Opus 5. C'est une réduction de 20%. Pour la plupart des charges de travail de production, la réduction réelle est plus importante, car le taux qui a le plus bougé est celui que le titre omet.
Les taux qui comptent
| Type de token | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Entrée (non cachée) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| Sortie | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| Écriture en cache (5 min) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| Lecture de cache | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| Mode rapide (entrée / sortie) | $8 / $40 | — | — |
Chaque ligne est 20% moins élevée sauf la lecture de cache, qui est 60% moins cher. À $0.20, c'est maintenant moins cher que le $0.25 de Fable 5.1. Cela inverse la seule ligne où Fable avait l'habitude de gagner. Dans notre modèle de coût Fable 5.1, une charge de travail fortement cachée pouvait s'avérer moins chère sur Fable que sur Opus 5. Contre Opus 5.5, ce n'est plus le cas. Fable coûte plus cher sur chaque type de token.
Pourquoi une tâche typique coûte environ 40% moins cher
L'affirmation d'Anthropic est une baisse de 40% du coût pour un travail typique, pas 20%. Le supplément provient de l'efficacité des tokens. Anthropic dit qu'Opus 5.5 obtient le même résultat avec environ 20% moins de tokens d'entrée et de sortie et écrit une sortie environ 40% moins verbeuse. Un taux plus bas multiplié par moins de tokens se compose : 0.8 × 0.8 = 0.64, ce qui représente environ 36–40% de réduction selon le mélange.
Voici une étape d'agent : 200 000 tokens d'entrée, 90% servis depuis le cache, et 20 000 tokens de sortie.
| Ligne | Opus 5 | Opus 5.5 (même tokens) | Fable 5.1 |
|---|---|---|---|
| 20K entrée non cachée | $0.100 | $0.080 | $0.200 |
| 180K entrée cachée | $0.090 | $0.036 | $0.045 |
| 20K sortie | $0.500 | $0.400 | $1.000 |
| Total | $0.690 | $0.516 | $1.245 |
Sur des tokens identiques, Opus 5.5 est 25% moins cher qu'Opus 5, pas 20%, en raison de la réduction du cache. Si la réduction de 20% des tokens se maintient pour votre charge de travail, l'étape tombe à environ $0.41, ce qui représente 40% sous Opus 5 et un tiers du coût Fable. La sortie représente toujours environ 80% de la facture dans cet exemple. C'est là que la réduction de verbosité porte ses fruits.
Coût par tâche face à GPT-6 Sol, GPT-6 Astra et Fable 5.1
Prix catalogue par million de tokens, et la même étape d'agent que plus haut (200K en entrée, 90 % en cache, 20K en sortie) calculée sur chaque modèle.
| Modèle | Entrée $/MTok | Sortie $/MTok | Lecture du cache $/MTok | Même étape d'agent |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
Coût par tâche mesuré sur l'Artificial Analysis Intelligence Index v4.3.2, consulté le 22 septembre 2026, trié par score. GPT-6 Sol est le moyen le moins cher d'atteindre tout score jusqu'à 47,5. Au-delà, Opus 5.5 est le moins cher à chaque niveau : Opus 5.5 high obtient 53,6 pour 1,82 $, alors que GPT-6 Astra max obtient 52,7 pour 3,26 $ et Fable 5.1 max 53,4 pour 7,63 $.
| Modèle | Intelligence Index | Coût par tâche | Tokens de sortie par tâche |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
Tous les réglages de GPT-6 Astra au-dessus de low, tous ceux d'Opus 5 et tous ceux de Fable 5.1 coûtent plus qu'un réglage de Sol ou d'Opus 5.5 au score égal ou supérieur. Le coût par tâche dépend du mix de tâches du benchmark. Rejouez votre propre trafic avant de changer de modèle.
Est-ce assez bien pour remplacer Fable?
Anthropic positionne Opus 5.5 comme correspondant à Fable 5.1 sur la plupart des tâches. Les chiffres publiés le soutiennent pour le travail de codage et agentif :
- Terminal-Bench 4.0 : 66.4%, contre 52.3% pour Opus 5 et 55.8% pour Fable 5.1.
- FrontierCode v1.1 : 54.4%, contre 48.0% pour Opus 5 et 50.3% pour Fable 5.1.
- CursorBench 4.0 : 57.8%, contre 46.6% pour Opus 5.
- GDPval-AA v2.1 : 1846 Elo, contre 1708 pour Opus 5.
Artificial Analysis l'a classé premier dans son Indice de Renseignement le jour du lancement. Anthropic dit aussi qu'au niveau d'effort par défaut (moyen), il surpasse GPT-6 Astra à l'effort maximum sur le travail de connaissance pour environ un cinquième du coût par tâche. C'est une comparaison du fournisseur, donc traitez-la comme une hypothèse à tester. Les mathématiques des coûts ci-dessus sont la partie que vous pouvez vérifier vous-même.
Le mode rapide coûte 2×
Le mode rapide coûte $8 en entrée et $40 en sortie, exactement le double du taux standard, pour jusqu'à 2.5× la vitesse. Le modèle standard est aussi environ 30% plus rapide qu'Opus 5. Utilisez le mode rapide pour les chemins interactifs liés à la latence où un utilisateur attend. Gardez-le désactivé pour les travaux par lots, les agents en arrière-plan et les évaluations. Quand le mode rapide est activé par défaut, le coût unitaire double et le tableau de bord ne montre rien d'inhabituel jusqu'à ce que la facture arrive.
Quoi faire cette semaine
- Épinglez l'ID du modèle. Pointez la production sur
claude-opus-5-5explicitement et enregistrez l'ID à chaque requête, pour que le coût par requête puisse être divisé par modèle après la migration. - Redéfinissez la base de référence sur votre propre trafic. Relisez un exemple de demandes réelles sur les deux modèles et comparez les tokens par tâche terminée, pas par appel. La revendication d'efficacité des tokens de 20% est la partie la plus susceptible de varier selon la charge de travail.
- Revérifiez les paramètres d'effort. Si une charge de travail a été déplacée vers Fable ou vers l'effort maximal pour la qualité, testez Opus 5.5 d'abord au niveau moyen. C'est le paramètre contre lequel Anthropic fait des points de référence.
- Rexécutez la décision de routage Fable. Tout itinéraire qui a envoyé du trafic lourd en cache à Fable pour obtenir la lecture de cache moins chère doit être réévalué. Cet avantage de coût a disparu.
- Surveiller le taux de succès du cache. À $0.20 contre $4.00, une défaillance du cache coûte maintenant 20× un succès. Une modification du modèle d'invite qui casse le préfixe coûte plus cher que sur Opus 5.
Anthropic dit que Sonnet 5.5 et Haiku 5.5 suivront dans les prochaines semaines. Conservez le harnais de relecture à partir de l'étape 2 pour que chaque version puisse être rétablie en une après-midi.
Related
- Modèle de coût de Claude Fable 5.1
- Économie de la mise en cache d'invites
- Les niveaux d'effort Opus 5.5 sont le vrai prix
- Économie du mode rapide Opus 5.5
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →