Przejdź do treści

Cennik Claude Sonnet 5.5: co się zmienia, a co nie

Zaktualizowano September 28, 2026 · pierwsza publikacja September 27, 2026

Claude Sonnet 5.5 kosztuje $2 za milion tokenów wejściowych i $10 za milion tokenów wyjściowych w API Anthropic, czyli tyle samo co Sonnet 5. Zmiana ekonomiczna dotyczy efektywności: Anthropic twierdzi, że Sonnet 5.5 może kosztować nawet o 30% mniej za zadanie, bo zużywa mniej tokenów, a jednocześnie generuje wynik ponad 30% szybciej. To maksymalna wartość podana przez dostawcę, a nie gwarantowany rabat dla każdego obciążenia.

Przy prognozie budżetowej utrzymaj stawki za token bez zmian i osobno zamodeluj możliwą redukcję tokenów oraz kroków agenta. Zmierz własny miks zadań, zanim przyjmiesz jakiekolwiek założenie dotyczące oszczędności.

Ceny API Sonnet 5.5

Typ tokenaCena za milion
Wejście$2.00
Wyjście$10.00
Zapis do cache na 5 minut$2.50
Zapis do cache na 1 godzinę$4.00
Odczyt z cache$0.20

Anthropic podaje te stawki w ogłoszeniu premiery Sonnet 5.5. Nie traktuj „do 30% mniej za zadanie” jako 30-procentowego spadku stawek za token: ceny wejścia i wyjścia są takie same jak w Sonnet 5. Cena $2/$10 z Sonnet 5 jest zresztą teraz standardem, bo Anthropic anulował planowaną na wrzesień podwyżkę.

Przykład: efektywność tokenów a zmiana stawek

Weźmy zadanie zużywające 100,000 tokenów wejściowych i 10,000 wyjściowych, bez cache. Przy opublikowanych stawkach Sonnet 5.5 to $0.20 za wejście plus $0.10 za wyjście, czyli $0.30 za zadanie. Gdyby to samo zadanie zużywało o 30% mniej tokenów w obu kategoriach, zamodelowany koszt wyniósłby $0.21. To ilustracja rachunku, a nie obietnica, że każde zadanie zużyje o 30% mniej tokenów.

Przy 10,000 takich zadań miesięcznie bazą jest $3,000. 30-procentowe ograniczenie wolumenu tokenów oszczędziłoby $900 i obniżyło zamodelowany miesięczny rachunek do $2,100. Rzeczywiste wyniki zależą od długości promptu, wykorzystania cache, długości wyjścia, poziomu wysiłku rozumowania, ponownych prób i wywołań narzędzi.

Co pokazują benchmarki z premiery, a czego nie pokazują

Anthropic raportuje postęp w swoich ewaluacjach programistycznych i pracy umysłowej, w tym Terminal-Bench 4.0 i CursorBench. Firma podaje też, że Sonnet 5.5 generuje wynik ponad 30% szybciej niż Sonnet 5 i że w kilku porównaniach benchmarkowych osiąga wyniki poprzedniego Sonnet 5 za ułamek kosztu na zadanie. Te wyniki są dobrymi hipotezami do planu ewaluacji, ale to pomiary publikowane przez dostawcę, a nie niezależne dane kosztowe z produkcji.

Praktyczne zastrzeżenie: szybszy model sam z siebie nie obniża rachunku za API rozliczane za tokeny. Rachunek spada, gdy spada zużycie na ukończone zadanie albo gdy mniej zadań wymaga ponowień lub eskalacji. Szybsze generowanie może natomiast poprawić przepustowość lub zmniejszyć opóźnienie, zostawiając wydatki na tokeny bez zmian.

Bezpieczny sposób na prognozę wdrożenia

  1. Utrzymaj stałą tabelę stawek. Jako punkt wyjścia dla Sonnet 5 i 5.5 przyjmij $2/$10 za milion tokenów wejścia/wyjścia.
  2. Mierz ukończoną pracę. Porównuj koszt za zaakceptowane zadanie, a nie tylko tokeny na żądanie. Jeśli to możliwe, uwzględnij ponowienia, wywołania narzędzi i ręczne poprawki.
  3. Dziel według obciążenia. Oceniaj osobno kodowanie, obsługę klienta, ekstrakcję i zadania z długim kontekstem; jedna uśredniona stopa oszczędności może ukryć regresje.
  4. Używaj przedziału. Budżetuj z 0% oszczędności, dopóki testy wewnętrzne nie dostarczą dowodów, a dopiero potem dodawaj zmierzone scenariusze. Traktuj „do 30%” Anthropic jako górną granicę, a nie swoją prognozę.
  5. Sprawdź ponownie jakość i opóźnienie. Niższy rachunek za tokeny nie jest oszczędnością, jeśli spadnie odsetek akceptacji albo potrzebne będą droższe modele zapasowe.

FAQ

Czy Sonnet 5.5 jest tańszy za token?

Nie. Anthropic podaje te same stawki co dla Sonnet 5: $2 za milion tokenów wejścia i $10 za milion tokenów wyjścia. Twierdzenie o kosztach za zadanie wynika z użycia mniejszej liczby tokenów do wykonania porównywalnej pracy.

Czy 30% oszczędności jest gwarantowane?

Nie. Anthropic w materiałach premierowych opisuje redukcje kosztów do 30% dla większości pracy. Twój wynik zależy od obciążenia, prompt cachingu, ustawień wysiłku i jakości ukończenia zadań.

Ile kosztuje zapytanie z cache?

Anthropic podaje odczyty z cache po $0.20 za milion tokenów, zapisy na 5 minut po $2.50 i zapisy na 1 godzinę po $4.00. Zanim zatwierdzisz prognozę, sprawdź aktualną dokumentację cen API Claude.

Czy od razu przełączyć ruch produkcyjny?

Najpierw przeprowadź reprezentatywną ewaluację. Testuj model w trybie shadow lub canary, porównaj koszt za zaakceptowany wynik i opóźnienie, i zachowaj ścieżkę wycofania dla obciążeń, które się pogorszą.

Źródła i dalsza lektura

Powiązane


Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →

Wróć do finopsllm.com