Przejdź do treści

Analiza kosztów długo działającego agenta Opus 5.5

Zaktualizowano September 27, 2026 · pierwsza publikacja September 27, 2026

Pokaz wykazał, że Opus 5.5 pracował autonomicznie przez ~25 godzin, tworząc pełny klon Minecrafta: ~100K linii kodu gry, 26K linii testów, 1,000 zautomatyzowanych testów, 775 plików, 783 wygenerowane obrazy, 184 wygenerowane dźwięki oraz przewodnik w grze. To pierwszy publiczny wgląd w agenta do kodowania o długim horyzoncie na tak dużą skalę. Policzmy koszt.

Szacowanie wolumenu tokenów

Nie opublikowano oficjalnych liczb tokenów. Modelujemy je na podstawie artefaktów wyjściowych:

ArtefaktSzac. tokenówUwagi
100K linii kodu gry~3M wyjścia~30 tokenów/linia średnio
26K linii testów~0.8M wyjścia~30 tokenów/linia
775 plików (struktura, konfiguracja)~0.5M wyjściaSzablon + importy
783 obrazy (prompty + metadane)~1.5M wejścia~2K tokenów/prompt obrazu
184 dźwięki (prompty + metadane)~0.4M wejścia~2K tokenów/prompt dźwięku
Przewodnik w grze / dokumentacja~0.3M wyjściaMarkdown + fragmenty kodu
Kontekst / rozumowanie (25 h)~10M wejściaWywołania narzędzi, obserwacje, planowanie
Szacunek łączny~12.4M wejścia / ~4.6M wyjścia

Koszt według cen Opus 5.5

Typ tokenówWolumenStawkaKoszt
Wejście (bez cache, szac. 30%)3.7M$4.00/MTok$14.80
Wejście (z cache, szac. 70%)8.7M$0.20/MTok$1.74
Wyjście4.6M$20.00/MTok$92.00
Razem~$108.54

~$109 za 25-godzinne autonomiczne uruchomienie agenta, które tworzy gotową do wydania grę. To ~$4.36 za godzinę mocy obliczeniowej agenta.

Wrażliwość: najbardziej liczy się trafność cache

Trafność cacheKoszt wejściaKoszt łącznyKoszt/godzinę
50%$24.80$131.60$5.26
70% (bazowo)$16.54$108.54$4.34
90%$8.88$92.88$3.72

Przy 90% trafności cache (osiągalnej dzięki dobremu zarządzaniu kontekstem) uruchomienie spada do $93 łącznie / $3.72/h.

Porównanie: ludzki programista

Doświadczony programista budujący to samodzielnie: 3-6 tygodni (~120-240 godzin) przy $100-200/h = $12K-$48K. Uruchomienie agenta za $109 jest 100-400x tańsze, ale tylko wtedy, gdy jakość wyniku przechodzi Twoją bramkę wydania.

Co to oznacza dla budżetu na agentów

  1. Agenci o długim horyzoncie są przystępni cenowo. Poniżej $150 za złożoną 25-godzinną budowę zmienia rachunek ROI dla przepływów opartych na agentach.
  2. Cache to dźwignia. Inwestuj w infrastrukturę prompt cachingu. Każda poprawa trafności cache o 10% oszczędza ~$1.60 przy takim uruchomieniu.
  3. Tokeny wyjścia dominują. Przy $20/MTok wyjście to 85% rachunku. Modele bardziej zwięzłe (Anthropic twierdzi o 40% mniejszej rozwlekłości) bezpośrednio obniżają koszt.
  4. Monitoruj per uruchomienie, nie per miesiąc. Obciążenia agentów są nierówne. Śledź koszt na ukończone zadanie, a nie zbiorcze wydatki miesięczne.

Powiązane lektury

Zobacz model kosztów Claude Opus 5.5, ekonomię agentów, ekonomię prompt cachingu oraz koszt na udane zadanie.

Powiązane


Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →

Wróć do finopsllm.com