Claude Opus 5.5 kostenmodel

Updated September 22, 2026 · first published September 22, 2026

Anthropic gaf Claude Opus 5.5 (claude-opus-5-5) vrij op 22 september 2026. De kopprijs is $4 per miljoen invoertokens en $20 per miljoen uitvoertokens, omlaag van $5 en $25 op Opus 5. Dat is een verlaging van 20%. Voor meeste productie-workloads is de werkelijke verlaging groter, omdat het tarief dat het meest bewogen is het tarief dat de kopprijs niet noemt.

De tarieven die ertoe doen

TokentypeOpus 5.5Opus 5Fable 5.1
Invoer (niet in cache)$4.00 / MTok$5.00 / MTok$10.00 / MTok
Uitvoer$20.00 / MTok$25.00 / MTok$50.00 / MTok
Cache schrijven (5 minuten)$5.00 / MTok$6.25 / MTok$12.50 / MTok
Cache lezen$0.20 / MTok$0.50 / MTok$0.25 / MTok
Snelle modus (invoer / uitvoer)$8 / $40

Elke rij is 20% lager behalve de cache read, wat 60% lager is. Bij $0.20 is het nu goedkoper dan Fable 5.1's $0.25. Dat keert de ene rij om waar Fable vroeger won. In onze Fable 5.1 kostenmodel, een sterk in cache opgeslagen workload kon goedkoper uitvallen op Fable dan op Opus 5. Tegen Opus 5.5 gebeurt dat niet meer. Fable kost meer op elk tokentype.

Waarom een typische taak ongeveer 40% minder kost

Anthropic's claim is een verlaging van 40% in kosten voor een typische job, niet 20%. De extra komt van token efficiency. Anthropic zegt dat Opus 5.5 hetzelfde resultaat bereikt met ongeveer 20% minder invoer- en uitvoertokens en schrijft ongeveer 40% minder uitgebreide uitvoer. Een lager tarief keer minder tokens samengesteld: 0.8 × 0.8 = 0.64, wat ruwweg 36–40% korting is afhankelijk van de mix.

Hier is één agent stap: 200.000 invoertokens, 90% bediend uit cache, en 20.000 uitvoertokens.

RegelOpus 5Opus 5.5 (dezelfde tokens)Fable 5.1
20K niet in cache invoer$0.100$0.080$0.200
180K invoer in cache$0.090$0.036$0.045
20K uitvoer$0.500$0.400$1.000
Totaal$0.690$0.516$1.245

Op identieke tokens is Opus 5.5 25% goedkoper dan Opus 5, niet 20%, vanwege de cache korting. Als de verlaging van 20% tokens voor uw workload geldt, daalt de stap tot ongeveer $0.41, wat 40% onder Opus 5 ligt en een derde van de Fable kosten. Uitvoer is nog steeds ongeveer 80% van de rekening in dit voorbeeld. Dat is waar de verbosity-reductie loont.

Kosten per taak tegenover GPT-6 Sol, GPT-6 Astra en Fable 5.1

Lijstprijzen per miljoen tokens, en dezelfde agentstap als hierboven (200K input, 90% uit cache, 20K output) berekend op elk model.

ModelInput $/MTokOutput $/MTokCache-read $/MTokZelfde agentstap
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Gemeten kosten per taak op de Artificial Analysis Intelligence Index v4.3.2, geraadpleegd op 22 september 2026, gesorteerd op score. GPT-6 Sol is de goedkoopste weg naar elke score tot 47,5. Daarboven is Opus 5.5 op elk niveau het goedkoopst: Opus 5.5 high scoort 53,6 voor $1,82, terwijl GPT-6 Astra max 52,7 scoort voor $3,26 en Fable 5.1 max 53,4 voor $7,63.

ModelIntelligence IndexKosten per taakOutput-tokens per taak
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

Elke GPT-6 Astra-instelling boven low, elke Opus 5-instelling en elke Fable 5.1-instelling kost meer dan een Sol- of Opus 5.5-instelling die even hoog of hoger scoort. Kosten per taak hangen af van de takenmix van de benchmark. Speel je eigen verkeer opnieuw af voordat je van model wisselt.

Is het goed genoeg om Fable te vervangen?

Anthropic positioneert Opus 5.5 als gelijk aan Fable 5.1 op meeste taken. De gepubliceerde getallen ondersteunen dat voor codering en agentic werk:

Artificial Analysis rangschikte het eerste op zijn Intelligence Index op lanceringsdag. Anthropic zegt ook dat op standaard (gemiddeld) effort het GPT-6 Astra op max effort slaat op kenniswerk voor ongeveer een vijfde van de kosten per taak. Dat is een leveranciersvergelijking, dus behandel het als een hypothese om te testen. De kostencalculatie hierboven is het deel dat u zelf kunt verifiëren.

Snelle modus kost 2×

Snelle modus kost $8 in en $40 uit, exact dubbel het standaardtarief, voor tot 2.5× de snelheid. Het standaardmodel is ook ongeveer 30% sneller dan Opus 5. Gebruik snelle modus voor latency-bound interactieve paden waar een gebruiker wacht. Hou het uit batch jobs, achtergrond agents en evals. Wanneer snelle modus standaard is ingeschakeld, verdubbelt de unit cost en toont het dashboard niets ongebruikelijks totdat de factuur aankomt.

Wat te doen deze week

  1. Pin de model-ID. Verwijs productie naar claude-opus-5-5 expliciet en registreer de ID op elk verzoek, zodat kosten per verzoek na migratie per model kunnen worden gesplitst.
  2. Herbaseer op uw eigen verkeer. Herhaal een voorbeeld van echte verzoeken op beide modellen en vergelijk tokens per voltooide taak, niet per gesprek. De claim van 20% token-efficiency is het deel dat het meest waarschijnlijk per workload varieert.
  3. Controleer effort-instellingen opnieuw. Als een workload naar Fable of naar max effort voor kwaliteit ging, test Opus 5.5 eerst op gemiddeld. Dat is de instelling die Anthropic tegen benchmarks.
  4. Voer de Fable routing decision opnieuw uit. Elke route die cache-zware verkeer naar Fable stuurde om de goedkopere cache read te krijgen, moet opnieuw worden geëvalueerd. Dit kostenvoordeel is weg.
  5. Let op cache hit ratio. Bij $0.20 tegen $4.00 kost een cache miss nu 20× een hit. Een wijziging van prompt-template die het prefix breekt kost meer dan het deed op Opus 5.

Anthropic zegt dat Sonnet 5.5 en Haiku 5.5 volgen in de komende weken. Houd de replay harnas van stap 2 zodat elke release in een middag opnieuw kan worden gebaseerd.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research