Zum Inhalt springen

Kostenanalyse eines lang laufenden Opus-5.5-Agenten

Aktualisiert September 27, 2026 · erstveröffentlicht September 27, 2026

Eine Demo zeigte Opus 5.5, wie es ~25 Stunden lang autonom arbeitete, um einen vollständigen Minecraft-Klon zu bauen: ~100K Zeilen Spielcode, 26K Zeilen Tests, 1,000 automatisierte Tests, 775 Dateien, 783 generierte Bilder, 184 generierte Sounds und eine Anleitung im Spiel. Das ist der erste öffentliche Einblick in einen Coding-Agenten mit langem Horizont im großen Maßstab. Modellieren wir die Kosten.

Schätzung des Token-Volumens

Es gibt keine offiziellen Token-Zahlen. Wir modellieren sie anhand der erzeugten Artefakte:

ArtefaktGeschätzte TokensHinweise
100K Zeilen Spielcode~3M Output~30 Tokens/Zeile im Schnitt
26K Zeilen Tests~0.8M Output~30 Tokens/Zeile
775 Dateien (Struktur, Konfiguration)~0.5M OutputBoilerplate + Imports
783 Bilder (Prompts + Metadaten)~1.5M Input~2K Tokens/Bild-Prompt
184 Sounds (Prompts + Metadaten)~0.4M Input~2K Tokens/Sound-Prompt
Anleitung im Spiel / Doku~0.3M OutputMarkdown + Code-Snippets
Kontext / Reasoning (25 Std.)~10M InputTool-Aufrufe, Beobachtungen, Planung
Gesamtschätzung~12.4M Input / ~4.6M Output

Kosten zu Opus-5.5-Preisen

Token-TypVolumenPreisKosten
Input (ohne Cache, geschätzt 30 %)3.7M$4.00/MTok$14.80
Input (aus dem Cache, geschätzt 70 %)8.7M$0.20/MTok$1.74
Output4.6M$20.00/MTok$92.00
Gesamt~$108.54

~$109 für einen autonomen Agentenlauf von 25 Stunden, der ein auslieferbares Spiel erzeugt. Das sind ~$4.36/Stunde Agenten-Rechenzeit.

Sensitivität: Die Cache-Trefferquote zählt am meisten

Cache-TrefferquoteInput-KostenGesamtkostenKosten/Stunde
50 %$24.80$131.60$5.26
70 % (Basis)$16.54$108.54$4.34
90 %$8.88$92.88$3.72

Bei 90 % Cache-Treffern (mit gutem Kontextmanagement erreichbar) sinkt der Lauf auf $93 gesamt / $3.72/Std..

Vergleich: menschlicher Entwickler

Ein Senior-Entwickler, der das allein baut: 3-6 Wochen (~120-240 Stunden) zu $100-200/Std. = $12K-$48K. Der Agentenlauf für $109 ist 100-400x günstiger — aber nur, wenn die Qualität des Ergebnisses Ihr Release-Gate besteht.

Was das für Ihr Agenten-Budget bedeutet

  1. Agenten mit langem Horizont sind bezahlbar. Unter $150 für einen komplexen 25-Stunden-Build verändert die ROI-Rechnung für Agent-first-Workflows.
  2. Der Cache ist der Hebel. Investieren Sie in Prompt-Caching-Infrastruktur — jede Verbesserung der Cache-Trefferquote um 10 % spart bei einem Lauf wie diesem ~$1.60.
  3. Output-Tokens dominieren. Bei $20/MTok macht der Output 85 % der Rechnung aus. Knappere Modelle (Anthropic behauptet 40 % weniger Wortreichtum) senken die Kosten direkt.
  4. Überwachen Sie pro Lauf, nicht pro Monat. Agenten-Workloads kommen in Schüben. Verfolgen Sie die Kosten pro abgeschlossener Aufgabe, nicht die aggregierten Monatsausgaben.

Weiterführende Lektüre

Siehe Kostenmodell für Claude Opus 5.5, Agenten-Ökonomie, Ökonomie des Prompt-Cachings und Kosten pro erfolgreichem Task.

Weiterführend


Möchten Sie das auf Ihren Stack anwenden? Bringen Sie Anbieterrechnungen, Gateway-Protokolle und die wichtigsten Workflows mit; wir ordnen Kostentreiber und Einsparpotenziale zu. Kostenlose Prüfung buchen →

Zurück zu finopsllm.com