Przejdź do treści

Cennik i model kosztów Claude Opus 5.5

Zaktualizowano October 10, 2026 · pierwsza publikacja September 22, 2026

Anthropic wydało Claude Opus 5.5 (claude-opus-5-5) 22 września 2026. Nagłówkowa cena to $4 za milion tokenów wejścia i $20 za milion tokenów wyjścia, wobec $5 i $25 w Opus 5. To 20% obniżki. Przy większości produkcyjnych obciążeń rzeczywista obniżka jest jednak większa, bo najbardziej zmieniła się stawka, którą nagłówek pomija.

Cennik Opus 5.5: stawki, które mają znaczenie

Rodzaj tokenów Opus 5.5 Opus 5 Fable 5.1
Wejście (bez cache) $4.00 / MTok $5.00 / MTok $10.00 / MTok
Wyjście $20.00 / MTok $25.00 / MTok $50.00 / MTok
Zapis cache (5 minut) $5.00 / MTok $6.25 / MTok $12.50 / MTok
Odczyt cache $0.20 / MTok $0.50 / MTok $0.25 / MTok
Tryb szybki (wejście / wyjście) $8 / $40 — —

Każdy wiersz jest o 20% tańszy poza odczytem z cache, który jest o 60% tańszy. Przy $0.20 jest teraz tańszy niż $0.25 w Fable 5.1. To odwraca jedyny wiersz, w którym Fable wygrywał. W naszym modelu kosztów Fable 5.1 mocno cache'owane obciążenie mogło wyjść taniej na Fable niż na Opus 5. Wobec Opus 5.5 to już nie zachodzi. Fable kosztuje więcej przy każdym rodzaju tokenów.

Dlaczego typowe zadanie kosztuje około 40% mniej

Anthropic twierdzi, że koszt typowego zadania spada o 40%, a nie o 20%. Dodatkowa różnica bierze się z efektywności tokenowej. Anthropic podaje, że Opus 5.5 osiąga ten sam wynik przy około 20% mniejszej liczbie tokenów wejścia i wyjścia oraz pisze około 40% mniej rozwlekłe odpowiedzi. Niższa stawka pomnożona przez mniej tokenów się składa: 0.8 × 0.8 = 0.64, czyli około 36–40% taniej, zależnie od miksu.

Oto jeden krok agenta: 200,000 tokenów wejścia, z czego 90% z cache, i 20,000 tokenów wyjścia.

Pozycja Opus 5 Opus 5.5 (te same tokeny) Fable 5.1
20K wejścia bez cache $0.100 $0.080 $0.200
180K wejścia z cache $0.090 $0.036 $0.045
20K wyjścia $0.500 $0.400 $1.000
Razem $0.690 $0.516 $1.245

Przy identycznych tokenach Opus 5.5 jest o 25% tańszy niż Opus 5, a nie o 20%, z powodu zniżki za cache. Jeśli 20% redukcja tokenów utrzyma się w twoim obciążeniu, krok spada do około $0.41, czyli o 40% poniżej Opus 5 i w jednej trzeciej kosztu Fable. Wyjście to nadal około 80% rachunku w tym przykładzie. Właśnie tam zmniejszona rozwlekłość się opłaca.

Koszt zadania wobec GPT-6 Sol, GPT-6 Astra i Fable 5.1

Ceny katalogowe za milion tokenów oraz ten sam krok agenta co wyżej (200K wejścia, 90% z cache, 20K wyjścia) wycenione na każdym modelu.

Model Wejście $/MTok Wyjście $/MTok Odczyt cache $/MTok Ten sam krok agenta
GPT-6 Sol $2.00 $10.00 $0.20 $0.276
Claude Opus 5.5 $4.00 $20.00 $0.20 $0.516
Claude Opus 5 $5.00 $25.00 $0.50 $0.690
Claude Fable 5.1 $10.00 $50.00 $0.25 $1.245
GPT-6 Astra $10.00 $50.00 $1.00 $1.380

Zmierzony koszt zadania w Artificial Analysis Intelligence Index v4.3.2, odczytany 22 września 2026, posortowany według wyniku. GPT-6 Sol jest najtańszym sposobem na dowolny wynik do 47.5. Powyżej tego Opus 5.5 jest najtańszy na każdym poziomie: Opus 5.5 high uzyskuje 53.6 za $1.82, podczas gdy GPT-6 Astra max uzyskuje 52.7 za $3.26, a Fable 5.1 max 53.4 za $7.63.

Model Intelligence Index Koszt zadania Tokeny wyjścia na zadanie
GPT-6 Sol · medium 39.8 $0.25 6,500
GPT-6 Sol · xhigh 44.1 $0.53 16,000
GPT-6 Astra · low 45.8 $0.82 4,400
GPT-6 Sol · max 47.5 $1.06 31,200
Claude Opus 5 · high 48.1 $3.61 46,200
Claude Opus 5 · max 50.8 $5.86 72,500
Claude Opus 5.5 · medium 51.2 $1.34 25,700
Claude Fable 5.1 · high 51.2 $3.91 38,100
GPT-6 Astra · max 52.7 $3.26 27,200
Claude Fable 5.1 · max 53.4 $7.63 78,100
Claude Opus 5.5 · high 53.6 $1.82 35,600
Claude Opus 5.5 · max 57.6 $5.98 119,200

Każde ustawienie GPT-6 Astra powyżej low, każde ustawienie Opus 5 i każde ustawienie Fable 5.1 kosztuje więcej niż ustawienie Sol lub Opus 5.5, które daje ten sam lub wyższy wynik. Koszt zadania zależy od miksu zadań w benchmarku. Przed zmianą modelu odtwórz własny ruch.

Czy wystarczy, żeby zastąpić Fable?

Anthropic pozycjonuje Opus 5.5 jako dorównujący Fable 5.1 w większości zadań. Opublikowane liczby to potwierdzają w kodowaniu i pracy agentowej:

Artificial Analysis umieścił go pierwszy w swoim Intelligence Index w dniu premiery. Anthropic twierdzi też, że przy domyślnym (medium) wysiłku pokonuje GPT-6 Astra na poziomie max w pracy wiedzowej, kosztując około jednej piątej kosztu zadania. To porównanie producenta, więc traktuj je jako hipotezę do sprawdzenia. Część z kosztami powyżej możesz zweryfikować sam.

Tryb szybki kosztuje 2×

Tryb szybki kosztuje $8 na wejściu i $40 na wyjściu, dokładnie dwa razy więcej niż standardowa stawka, za do 2.5× większą szybkość. Standardowy model jest też około 30% szybszy niż Opus 5. Używaj trybu szybkiego w ścieżkach interaktywnych wrażliwych na opóźnienie, gdzie użytkownik czeka. Wyłączaj go w zadaniach wsadowych, agentach działających w tle i ewaluacjach. Gdy tryb szybki jest włączony domyślnie, koszt jednostkowy się podwaja, a pulpit nie pokazuje nic niezwykłego, dopóki nie przyjdzie faktura.

Co zrobić w tym tygodniu

  1. Przypnij identyfikator modelu. Skieruj produkcję jawnie na claude-opus-5-5 i zapisuj identyfikator przy każdym żądaniu, żeby po migracji można było rozbić koszt na żądanie według modelu.
  2. Ustaw nową linię bazową na własnym ruchu. Odtwórz próbkę prawdziwych żądań na obu modelach i porównaj tokeny na ukończone zadanie, a nie na wywołanie. Twierdzenie o 20% efektywności tokenowej najłatwiej może się różnić między obciążeniami.
  3. Sprawdź ponownie ustawienia wysiłku. Jeśli obciążenie przeszło na Fable lub na wysiłek max ze względu na jakość, najpierw przetestuj Opus 5.5 na medium. To ustawienie, względem którego Anthropic prowadzi benchmarki.
  4. Ponownie oceń decyzję o routingu do Fable. Każda trasa, która kierowała ruch silnie opierający się na cache do Fable, żeby uzyskać tańszy odczyt z cache, wymaga ponownej oceny. Ta przewaga kosztowa zniknęła.
  5. Obserwuj współczynnik trafień cache. Przy $0.20 wobec $4.00 chybienie cache kosztuje teraz 20× więcej niż trafienie. Zmiana szablonu promptu, która psuje prefiks, kosztuje więcej niż na Opus 5.

Anthropic zapowiada, że Sonnet 5.5 i Haiku 5.5 pojawią się w najbliższych tygodniach. Zachowaj harness do odtwarzania z kroku 2, żeby każde wydanie dało się ponownie zmierzyć w jedno popołudnie.

Powiązane


Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →

Wróć do finopsllm.com