Claude Opus 5.5 Kostenmodell
Updated September 22, 2026 · first published September 22, 2026
Anthropic hat Claude Opus 5.5 (claude-opus-5-5) am 22. September 2026 veröffentlicht. Der angegebene Preis beträgt $4 pro Million Eingabe-Tokens und $20 pro Million Ausgabe-Tokens, gegenüber $5 und $25 bei Opus 5. Das ist eine Kürzung um 20%. Für die meisten produktiven Arbeitslasten ist die tatsächliche Kürzung größer, da der Satz, der sich am meisten bewegte, derjenige ist, den die Schlagzeile auslässt.
Die Sätze, die zählen
| Token-Typ | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Eingabe (nicht gecacht) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| Ausgabe | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| Cache-Schreibvorgänge (5 Min) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| Cache-Lesevorgänge | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| Schnellmodus (Eingabe / Ausgabe) | $8 / $40 | — | — |
Jede Zeile ist 20% niedriger außer dem Cache-Lesevorgang, der 60% niedriger ist. Bei $0.20 ist es jetzt günstiger als Fable 5.1s $0.25. Das dreht die eine Zeile um, in der Fable früher gewann. In unserem Fable 5.1 Kostenmodell könnte eine stark gecachte Arbeitslast auf Fable günstiger ausfallen als auf Opus 5. Gegenüber Opus 5.5 passiert das nicht mehr. Fable kostet bei jedem Token-Typ mehr.
Warum eine typische Aufgabe etwa 40% weniger kostet
Anthropics Behauptung ist eine Kostensenkung von 40% für einen typischen Auftrag, nicht 20%. Das Extra kommt von der Token-Effizienz. Anthropic sagt, dass Opus 5.5 das gleiche Ergebnis mit etwa 20% weniger Ein- und Ausgabe-Tokens erreicht und etwa 40% weniger ausschweifende Ausgabe schreibt. Ein niedrigerer Satz mal weniger Tokens zusammengesetzt: 0.8 × 0.8 = 0.64, was je nach Mischung etwa 36–40% Rabatt ausmacht.
Hier ist ein Agentenschritt: 200.000 Eingabe-Tokens, 90% aus dem Cache bereitgestellt, und 20.000 Ausgabe-Tokens.
| Zeile | Opus 5 | Opus 5.5 (gleiche Tokens) | Fable 5.1 |
|---|---|---|---|
| 20K Eingabe nicht gecacht | $0.100 | $0.080 | $0.200 |
| 180K Eingabe gecacht | $0.090 | $0.036 | $0.045 |
| 20K Ausgabe | $0.500 | $0.400 | $1.000 |
| Summe | $0.690 | $0.516 | $1.245 |
Bei identischen Tokens ist Opus 5.5 25% günstiger als Opus 5, nicht 20%, wegen des Cache-Rabatts. Wenn die Token-Reduktion um 20% für Ihre Arbeitslast hält, sinkt der Schritt auf etwa $0.41, was 40% unter Opus 5 und ein Drittel der Fable-Kosten liegt. Die Ausgabe macht immer noch etwa 80% der Rechnung in diesem Beispiel aus. Dort zahlt sich die Verbositätsreduktion aus.
Kosten pro Aufgabe im Vergleich zu GPT-6 Sol, GPT-6 Astra und Fable 5.1
Listenpreise pro Million Token und derselbe Agentenschritt wie oben (200K Eingabe, 90 % aus dem Cache, 20K Ausgabe), auf jedem Modell berechnet.
| Modell | Eingabe $/MTok | Ausgabe $/MTok | Cache-Lesen $/MTok | Gleicher Agentenschritt |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
Gemessene Kosten pro Aufgabe im Artificial Analysis Intelligence Index v4.3.2, abgerufen am 22. September 2026, nach Score sortiert. GPT-6 Sol ist bis zu einem Score von 47,5 der günstigste Weg. Darüber ist Opus 5.5 auf jeder Stufe am günstigsten: Opus 5.5 high erreicht 53,6 für 1,82 $, GPT-6 Astra max dagegen 52,7 für 3,26 $ und Fable 5.1 max 53,4 für 7,63 $.
| Modell | Intelligence Index | Kosten pro Aufgabe | Ausgabe-Token pro Aufgabe |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
Jede GPT-6-Astra-Einstellung oberhalb von low, jede Opus-5- und jede Fable-5.1-Einstellung kostet mehr als eine Sol- oder Opus-5.5-Einstellung mit gleichem oder höherem Score. Die Kosten pro Aufgabe hängen vom Aufgabenmix des Benchmarks ab. Spielen Sie Ihren eigenen Traffic nach, bevor Sie das Modell wechseln.
Ist es gut genug, um Fable zu ersetzen?
Anthropic positioniert Opus 5.5 als Übereinstimmung mit Fable 5.1 bei den meisten Aufgaben. Die veröffentlichten Zahlen unterstützen das für Code- und agentengestützte Arbeiten:
- Terminal-Bench 4.0: 66.4%, gegen 52.3% für Opus 5 und 55.8% für Fable 5.1.
- FrontierCode v1.1: 54.4%, gegen 48.0% für Opus 5 und 50.3% für Fable 5.1.
- CursorBench 4.0: 57.8%, gegen 46.6% für Opus 5.
- GDPval-AA v2.1: 1846 Elo, gegen 1708 für Opus 5.
Artificial Analysis ordnete es am Starttag auf seinem Intelligence Index an erster Stelle ein. Anthropic sagt auch, dass es auf Standardanstrengung (mittel) GPT-6 Astra bei maximaler Anstrengung bei Wissensarbeit für etwa ein Fünftel der Kosten pro Aufgabe schlägt. Das ist ein Anbietervergleich, also behandeln Sie ihn als Hypothese zum Testen. Die obige Kostenrechnung ist der Teil, den Sie selbst überprüfen können.
Der Schnellmodus kostet 2×
Der Schnellmodus kostet $8 bei der Eingabe und $40 bei der Ausgabe, genau das Doppelte des Standardsatzes, für bis zu 2.5× die Geschwindigkeit. Das Standardmodell ist auch etwa 30% schneller als Opus 5. Verwenden Sie den Schnellmodus für latenzgebundene interaktive Pfade, auf denen ein Benutzer wartet. Halten Sie ihn für Batch-Jobs, Hintergrund-Agenten und Evaluationen aus. Wenn der Schnellmodus standardmäßig aktiviert ist, verdoppelt sich die Einheitskosten und das Dashboard zeigt nichts Ungewöhnliches, bis die Rechnung ankommt.
Was diese Woche zu tun ist
- Pinnen Sie die Modell-ID. Zeigen Sie die Produktion explizit auf
claude-opus-5-5und notieren Sie die ID bei jeder Anforderung, damit die Kosten pro Anforderung nach der Migration nach Modell aufgeteilt werden können. - Neu-Basis auf Ihrem eigenen Datenverkehr. Wiedergeben Sie eine Stichprobe echter Anforderungen auf beiden Modellen und vergleichen Sie Tokens pro abgeschlossener Aufgabe, nicht pro Aufruf. Die Behauptung der Token-Effizienz von 20% ist der Teil, der am wahrscheinlichsten nach Arbeitslast variiert.
- Überprüfen Sie die Einstellungen für Anstrengung erneut. Wenn eine Arbeitslast zu Fable oder maximaler Anstrengung wegen Qualität verschoben wurde, testen Sie Opus 5.5 zunächst auf mittlerem Niveau. Das ist die Einstellung, gegen die Anthropic Benchmarks durchführt.
- Treffen Sie die Fable-Routing-Entscheidung erneut. Jede Route, die Cache-schweren Datenverkehr zu Fable sendet, um das günstigere Cache-Lesen zu erhalten, sollte neu bewertet werden. Dieser Kosten-Vorteil ist weg.
- Überwachen Sie das Cache-Trefferverhältnis. Bei $0.20 gegen $4.00 kostet ein Cache-Fehlschlag jetzt 20× ein Treffer. Eine Umfrage-Vorlagenänderung, die das Präfix bricht, kostet mehr als auf Opus 5.
Anthropic sagt, dass Sonnet 5.5 und Haiku 5.5 in den kommenden Wochen folgen werden. Behalten Sie das Wiedergabe-Harness aus Schritt 2, damit jede Version in einem Nachmittag neu basiert werden kann.
Related
- Claude Fable 5.1 Kostenmodell
- Wirtschaft des Prompt-Cachings
- Opus 5.5 Anstrengungsstufen sind der echte Preis
- Opus 5.5 Schnellmodus-Wirtschaft
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →