Kostenanalyse eines lang laufenden Opus-5.5-Agenten
Aktualisiert September 27, 2026 · erstveröffentlicht September 27, 2026
Eine Demo zeigte Opus 5.5, wie es ~25 Stunden lang autonom arbeitete, um einen vollständigen Minecraft-Klon zu bauen: ~100K Zeilen Spielcode, 26K Zeilen Tests, 1,000 automatisierte Tests, 775 Dateien, 783 generierte Bilder, 184 generierte Sounds und eine Anleitung im Spiel. Das ist der erste öffentliche Einblick in einen Coding-Agenten mit langem Horizont im großen Maßstab. Modellieren wir die Kosten.
Schätzung des Token-Volumens
Es gibt keine offiziellen Token-Zahlen. Wir modellieren sie anhand der erzeugten Artefakte:
| Artefakt | Geschätzte Tokens | Hinweise |
|---|---|---|
| 100K Zeilen Spielcode | ~3M Output | ~30 Tokens/Zeile im Schnitt |
| 26K Zeilen Tests | ~0.8M Output | ~30 Tokens/Zeile |
| 775 Dateien (Struktur, Konfiguration) | ~0.5M Output | Boilerplate + Imports |
| 783 Bilder (Prompts + Metadaten) | ~1.5M Input | ~2K Tokens/Bild-Prompt |
| 184 Sounds (Prompts + Metadaten) | ~0.4M Input | ~2K Tokens/Sound-Prompt |
| Anleitung im Spiel / Doku | ~0.3M Output | Markdown + Code-Snippets |
| Kontext / Reasoning (25 Std.) | ~10M Input | Tool-Aufrufe, Beobachtungen, Planung |
| Gesamtschätzung | ~12.4M Input / ~4.6M Output |
Kosten zu Opus-5.5-Preisen
| Token-Typ | Volumen | Preis | Kosten |
|---|---|---|---|
| Input (ohne Cache, geschätzt 30 %) | 3.7M | $4.00/MTok | $14.80 |
| Input (aus dem Cache, geschätzt 70 %) | 8.7M | $0.20/MTok | $1.74 |
| Output | 4.6M | $20.00/MTok | $92.00 |
| Gesamt | ~$108.54 |
~$109 für einen autonomen Agentenlauf von 25 Stunden, der ein auslieferbares Spiel erzeugt. Das sind ~$4.36/Stunde Agenten-Rechenzeit.
Sensitivität: Die Cache-Trefferquote zählt am meisten
| Cache-Trefferquote | Input-Kosten | Gesamtkosten | Kosten/Stunde |
|---|---|---|---|
| 50 % | $24.80 | $131.60 | $5.26 |
| 70 % (Basis) | $16.54 | $108.54 | $4.34 |
| 90 % | $8.88 | $92.88 | $3.72 |
Bei 90 % Cache-Treffern (mit gutem Kontextmanagement erreichbar) sinkt der Lauf auf $93 gesamt / $3.72/Std..
Vergleich: menschlicher Entwickler
Ein Senior-Entwickler, der das allein baut: 3-6 Wochen (~120-240 Stunden) zu $100-200/Std. = $12K-$48K. Der Agentenlauf für $109 ist 100-400x günstiger — aber nur, wenn die Qualität des Ergebnisses Ihr Release-Gate besteht.
Was das für Ihr Agenten-Budget bedeutet
- Agenten mit langem Horizont sind bezahlbar. Unter $150 für einen komplexen 25-Stunden-Build verändert die ROI-Rechnung für Agent-first-Workflows.
- Der Cache ist der Hebel. Investieren Sie in Prompt-Caching-Infrastruktur — jede Verbesserung der Cache-Trefferquote um 10 % spart bei einem Lauf wie diesem ~$1.60.
- Output-Tokens dominieren. Bei $20/MTok macht der Output 85 % der Rechnung aus. Knappere Modelle (Anthropic behauptet 40 % weniger Wortreichtum) senken die Kosten direkt.
- Überwachen Sie pro Lauf, nicht pro Monat. Agenten-Workloads kommen in Schüben. Verfolgen Sie die Kosten pro abgeschlossener Aufgabe, nicht die aggregierten Monatsausgaben.
Weiterführende Lektüre
Siehe Kostenmodell für Claude Opus 5.5, Agenten-Ökonomie, Ökonomie des Prompt-Cachings und Kosten pro erfolgreichem Task.
Weiterführend
- Kostenmodell für Claude Opus 5.5
- Agenten-Ökonomie
- Ökonomie des Prompt-Cachings
- Kosten pro erfolgreichem Task
Möchten Sie das auf Ihren Stack anwenden? Bringen Sie Anbieterrechnungen, Gateway-Protokolle und die wichtigsten Workflows mit; wir ordnen Kostentreiber und Einsparpotenziale zu. Kostenlose Prüfung buchen →