Claude Opus 5.5 Kostenmodell

Updated September 22, 2026 · first published September 22, 2026

Anthropic hat Claude Opus 5.5 (claude-opus-5-5) am 22. September 2026 veröffentlicht. Der angegebene Preis beträgt $4 pro Million Eingabe-Tokens und $20 pro Million Ausgabe-Tokens, gegenüber $5 und $25 bei Opus 5. Das ist eine Kürzung um 20%. Für die meisten produktiven Arbeitslasten ist die tatsächliche Kürzung größer, da der Satz, der sich am meisten bewegte, derjenige ist, den die Schlagzeile auslässt.

Die Sätze, die zählen

Token-TypOpus 5.5Opus 5Fable 5.1
Eingabe (nicht gecacht)$4.00 / MTok$5.00 / MTok$10.00 / MTok
Ausgabe$20.00 / MTok$25.00 / MTok$50.00 / MTok
Cache-Schreibvorgänge (5 Min)$5.00 / MTok$6.25 / MTok$12.50 / MTok
Cache-Lesevorgänge$0.20 / MTok$0.50 / MTok$0.25 / MTok
Schnellmodus (Eingabe / Ausgabe)$8 / $40

Jede Zeile ist 20% niedriger außer dem Cache-Lesevorgang, der 60% niedriger ist. Bei $0.20 ist es jetzt günstiger als Fable 5.1s $0.25. Das dreht die eine Zeile um, in der Fable früher gewann. In unserem Fable 5.1 Kostenmodell könnte eine stark gecachte Arbeitslast auf Fable günstiger ausfallen als auf Opus 5. Gegenüber Opus 5.5 passiert das nicht mehr. Fable kostet bei jedem Token-Typ mehr.

Warum eine typische Aufgabe etwa 40% weniger kostet

Anthropics Behauptung ist eine Kostensenkung von 40% für einen typischen Auftrag, nicht 20%. Das Extra kommt von der Token-Effizienz. Anthropic sagt, dass Opus 5.5 das gleiche Ergebnis mit etwa 20% weniger Ein- und Ausgabe-Tokens erreicht und etwa 40% weniger ausschweifende Ausgabe schreibt. Ein niedrigerer Satz mal weniger Tokens zusammengesetzt: 0.8 × 0.8 = 0.64, was je nach Mischung etwa 36–40% Rabatt ausmacht.

Hier ist ein Agentenschritt: 200.000 Eingabe-Tokens, 90% aus dem Cache bereitgestellt, und 20.000 Ausgabe-Tokens.

ZeileOpus 5Opus 5.5 (gleiche Tokens)Fable 5.1
20K Eingabe nicht gecacht$0.100$0.080$0.200
180K Eingabe gecacht$0.090$0.036$0.045
20K Ausgabe$0.500$0.400$1.000
Summe$0.690$0.516$1.245

Bei identischen Tokens ist Opus 5.5 25% günstiger als Opus 5, nicht 20%, wegen des Cache-Rabatts. Wenn die Token-Reduktion um 20% für Ihre Arbeitslast hält, sinkt der Schritt auf etwa $0.41, was 40% unter Opus 5 und ein Drittel der Fable-Kosten liegt. Die Ausgabe macht immer noch etwa 80% der Rechnung in diesem Beispiel aus. Dort zahlt sich die Verbositätsreduktion aus.

Kosten pro Aufgabe im Vergleich zu GPT-6 Sol, GPT-6 Astra und Fable 5.1

Listenpreise pro Million Token und derselbe Agentenschritt wie oben (200K Eingabe, 90 % aus dem Cache, 20K Ausgabe), auf jedem Modell berechnet.

ModellEingabe $/MTokAusgabe $/MTokCache-Lesen $/MTokGleicher Agentenschritt
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Gemessene Kosten pro Aufgabe im Artificial Analysis Intelligence Index v4.3.2, abgerufen am 22. September 2026, nach Score sortiert. GPT-6 Sol ist bis zu einem Score von 47,5 der günstigste Weg. Darüber ist Opus 5.5 auf jeder Stufe am günstigsten: Opus 5.5 high erreicht 53,6 für 1,82 $, GPT-6 Astra max dagegen 52,7 für 3,26 $ und Fable 5.1 max 53,4 für 7,63 $.

ModellIntelligence IndexKosten pro AufgabeAusgabe-Token pro Aufgabe
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

Jede GPT-6-Astra-Einstellung oberhalb von low, jede Opus-5- und jede Fable-5.1-Einstellung kostet mehr als eine Sol- oder Opus-5.5-Einstellung mit gleichem oder höherem Score. Die Kosten pro Aufgabe hängen vom Aufgabenmix des Benchmarks ab. Spielen Sie Ihren eigenen Traffic nach, bevor Sie das Modell wechseln.

Ist es gut genug, um Fable zu ersetzen?

Anthropic positioniert Opus 5.5 als Übereinstimmung mit Fable 5.1 bei den meisten Aufgaben. Die veröffentlichten Zahlen unterstützen das für Code- und agentengestützte Arbeiten:

Artificial Analysis ordnete es am Starttag auf seinem Intelligence Index an erster Stelle ein. Anthropic sagt auch, dass es auf Standardanstrengung (mittel) GPT-6 Astra bei maximaler Anstrengung bei Wissensarbeit für etwa ein Fünftel der Kosten pro Aufgabe schlägt. Das ist ein Anbietervergleich, also behandeln Sie ihn als Hypothese zum Testen. Die obige Kostenrechnung ist der Teil, den Sie selbst überprüfen können.

Der Schnellmodus kostet 2×

Der Schnellmodus kostet $8 bei der Eingabe und $40 bei der Ausgabe, genau das Doppelte des Standardsatzes, für bis zu 2.5× die Geschwindigkeit. Das Standardmodell ist auch etwa 30% schneller als Opus 5. Verwenden Sie den Schnellmodus für latenzgebundene interaktive Pfade, auf denen ein Benutzer wartet. Halten Sie ihn für Batch-Jobs, Hintergrund-Agenten und Evaluationen aus. Wenn der Schnellmodus standardmäßig aktiviert ist, verdoppelt sich die Einheitskosten und das Dashboard zeigt nichts Ungewöhnliches, bis die Rechnung ankommt.

Was diese Woche zu tun ist

  1. Pinnen Sie die Modell-ID. Zeigen Sie die Produktion explizit auf claude-opus-5-5 und notieren Sie die ID bei jeder Anforderung, damit die Kosten pro Anforderung nach der Migration nach Modell aufgeteilt werden können.
  2. Neu-Basis auf Ihrem eigenen Datenverkehr. Wiedergeben Sie eine Stichprobe echter Anforderungen auf beiden Modellen und vergleichen Sie Tokens pro abgeschlossener Aufgabe, nicht pro Aufruf. Die Behauptung der Token-Effizienz von 20% ist der Teil, der am wahrscheinlichsten nach Arbeitslast variiert.
  3. Überprüfen Sie die Einstellungen für Anstrengung erneut. Wenn eine Arbeitslast zu Fable oder maximaler Anstrengung wegen Qualität verschoben wurde, testen Sie Opus 5.5 zunächst auf mittlerem Niveau. Das ist die Einstellung, gegen die Anthropic Benchmarks durchführt.
  4. Treffen Sie die Fable-Routing-Entscheidung erneut. Jede Route, die Cache-schweren Datenverkehr zu Fable sendet, um das günstigere Cache-Lesen zu erhalten, sollte neu bewertet werden. Dieser Kosten-Vorteil ist weg.
  5. Überwachen Sie das Cache-Trefferverhältnis. Bei $0.20 gegen $4.00 kostet ein Cache-Fehlschlag jetzt 20× ein Treffer. Eine Umfrage-Vorlagenänderung, die das Präfix bricht, kostet mehr als auf Opus 5.

Anthropic sagt, dass Sonnet 5.5 und Haiku 5.5 in den kommenden Wochen folgen werden. Behalten Sie das Wiedergabe-Harness aus Schritt 2, damit jede Version in einem Nachmittag neu basiert werden kann.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research