Cennik i model kosztów Claude Opus 5.5
Zaktualizowano October 10, 2026 · pierwsza publikacja September 22, 2026
Anthropic wydało Claude Opus 5.5 (claude-opus-5-5) 22 września 2026. Nagłówkowa cena to $4 za milion tokenów wejścia i $20 za milion tokenów wyjścia, wobec $5 i $25 w Opus 5. To 20% obniżki. Przy większości produkcyjnych obciążeń rzeczywista obniżka jest jednak większa, bo najbardziej zmieniła się stawka, którą nagłówek pomija.
Cennik Opus 5.5: stawki, które mają znaczenie
| Rodzaj tokenów | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Wejście (bez cache) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| Wyjście | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| Zapis cache (5 minut) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| Odczyt cache | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| Tryb szybki (wejście / wyjście) | $8 / $40 | — | — |
Każdy wiersz jest o 20% tańszy poza odczytem z cache, który jest o 60% tańszy. Przy $0.20 jest teraz tańszy niż $0.25 w Fable 5.1. To odwraca jedyny wiersz, w którym Fable wygrywał. W naszym modelu kosztów Fable 5.1 mocno cache'owane obciążenie mogło wyjść taniej na Fable niż na Opus 5. Wobec Opus 5.5 to już nie zachodzi. Fable kosztuje więcej przy każdym rodzaju tokenów.
Dlaczego typowe zadanie kosztuje około 40% mniej
Anthropic twierdzi, że koszt typowego zadania spada o 40%, a nie o 20%. Dodatkowa różnica bierze się z efektywności tokenowej. Anthropic podaje, że Opus 5.5 osiąga ten sam wynik przy około 20% mniejszej liczbie tokenów wejścia i wyjścia oraz pisze około 40% mniej rozwlekłe odpowiedzi. Niższa stawka pomnożona przez mniej tokenów się składa: 0.8 × 0.8 = 0.64, czyli około 36–40% taniej, zależnie od miksu.
Oto jeden krok agenta: 200,000 tokenów wejścia, z czego 90% z cache, i 20,000 tokenów wyjścia.
| Pozycja | Opus 5 | Opus 5.5 (te same tokeny) | Fable 5.1 |
|---|---|---|---|
| 20K wejścia bez cache | $0.100 | $0.080 | $0.200 |
| 180K wejścia z cache | $0.090 | $0.036 | $0.045 |
| 20K wyjścia | $0.500 | $0.400 | $1.000 |
| Razem | $0.690 | $0.516 | $1.245 |
Przy identycznych tokenach Opus 5.5 jest o 25% tańszy niż Opus 5, a nie o 20%, z powodu zniżki za cache. Jeśli 20% redukcja tokenów utrzyma się w twoim obciążeniu, krok spada do około $0.41, czyli o 40% poniżej Opus 5 i w jednej trzeciej kosztu Fable. Wyjście to nadal około 80% rachunku w tym przykładzie. Właśnie tam zmniejszona rozwlekłość się opłaca.
Koszt zadania wobec GPT-6 Sol, GPT-6 Astra i Fable 5.1
Ceny katalogowe za milion tokenów oraz ten sam krok agenta co wyżej (200K wejścia, 90% z cache, 20K wyjścia) wycenione na każdym modelu.
| Model | Wejście $/MTok | Wyjście $/MTok | Odczyt cache $/MTok | Ten sam krok agenta |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
Zmierzony koszt zadania w Artificial Analysis Intelligence Index v4.3.2, odczytany 22 września 2026, posortowany według wyniku. GPT-6 Sol jest najtańszym sposobem na dowolny wynik do 47.5. Powyżej tego Opus 5.5 jest najtańszy na każdym poziomie: Opus 5.5 high uzyskuje 53.6 za $1.82, podczas gdy GPT-6 Astra max uzyskuje 52.7 za $3.26, a Fable 5.1 max 53.4 za $7.63.
| Model | Intelligence Index | Koszt zadania | Tokeny wyjścia na zadanie |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
Każde ustawienie GPT-6 Astra powyżej low, każde ustawienie Opus 5 i każde ustawienie Fable 5.1 kosztuje więcej niż ustawienie Sol lub Opus 5.5, które daje ten sam lub wyższy wynik. Koszt zadania zależy od miksu zadań w benchmarku. Przed zmianą modelu odtwórz własny ruch.
Czy wystarczy, żeby zastąpić Fable?
Anthropic pozycjonuje Opus 5.5 jako dorównujący Fable 5.1 w większości zadań. Opublikowane liczby to potwierdzają w kodowaniu i pracy agentowej:
- Terminal-Bench 4.0: 66.4%, wobec 52.3% dla Opus 5 i 55.8% dla Fable 5.1.
- FrontierCode v1.1: 54.4%, wobec 48.0% dla Opus 5 i 50.3% dla Fable 5.1.
- CursorBench 4.0: 57.8%, wobec 46.6% dla Opus 5.
- GDPval-AA v2.1: 1846 Elo, wobec 1708 dla Opus 5.
Artificial Analysis umieścił go pierwszy w swoim Intelligence Index w dniu premiery. Anthropic twierdzi też, że przy domyślnym (medium) wysiłku pokonuje GPT-6 Astra na poziomie max w pracy wiedzowej, kosztując około jednej piątej kosztu zadania. To porównanie producenta, więc traktuj je jako hipotezę do sprawdzenia. Część z kosztami powyżej możesz zweryfikować sam.
Tryb szybki kosztuje 2×
Tryb szybki kosztuje $8 na wejściu i $40 na wyjściu, dokładnie dwa razy więcej niż standardowa stawka, za do 2.5× większą szybkość. Standardowy model jest też około 30% szybszy niż Opus 5. Używaj trybu szybkiego w ścieżkach interaktywnych wrażliwych na opóźnienie, gdzie użytkownik czeka. Wyłączaj go w zadaniach wsadowych, agentach działających w tle i ewaluacjach. Gdy tryb szybki jest włączony domyślnie, koszt jednostkowy się podwaja, a pulpit nie pokazuje nic niezwykłego, dopóki nie przyjdzie faktura.
Co zrobić w tym tygodniu
-
Przypnij identyfikator modelu. Skieruj produkcję jawnie na
claude-opus-5-5i zapisuj identyfikator przy każdym żądaniu, żeby po migracji można było rozbić koszt na żądanie według modelu. - Ustaw nową linię bazową na własnym ruchu. Odtwórz próbkę prawdziwych żądań na obu modelach i porównaj tokeny na ukończone zadanie, a nie na wywołanie. Twierdzenie o 20% efektywności tokenowej najłatwiej może się różnić między obciążeniami.
- Sprawdź ponownie ustawienia wysiłku. Jeśli obciążenie przeszło na Fable lub na wysiłek max ze względu na jakość, najpierw przetestuj Opus 5.5 na medium. To ustawienie, względem którego Anthropic prowadzi benchmarki.
- Ponownie oceń decyzję o routingu do Fable. Każda trasa, która kierowała ruch silnie opierający się na cache do Fable, żeby uzyskać tańszy odczyt z cache, wymaga ponownej oceny. Ta przewaga kosztowa zniknęła.
- Obserwuj współczynnik trafień cache. Przy $0.20 wobec $4.00 chybienie cache kosztuje teraz 20× więcej niż trafienie. Zmiana szablonu promptu, która psuje prefiks, kosztuje więcej niż na Opus 5.
Anthropic zapowiada, że Sonnet 5.5 i Haiku 5.5 pojawią się w najbliższych tygodniach. Zachowaj harness do odtwarzania z kroku 2, żeby każde wydanie dało się ponownie zmierzyć w jedno popołudnie.
Powiązane
- Claude vs Codex w październiku 2026: który wygrywa za 100 dolarów
- Fable 5.1 vs Opus 5.5: czy 2.5x się opłaca?
- Model kosztów Claude Fable 5.1
- Ekonomia cache promptów
- Poziomy wysiłku Opus 5.5 to prawdziwa cena
- Ekonomia trybu szybkiego Opus 5.5
Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →