Zum Inhalt springen

Claude Sonnet 5.5 Preise: was sich ändert, was nicht

Aktualisiert September 28, 2026 · erstveröffentlicht September 27, 2026

Claude Sonnet 5.5 kostet $2 pro Million Input-Tokens und $10 pro Million Output-Tokens in der Anthropic-API, also denselben Listenpreis wie Sonnet 5. Die wirtschaftliche Änderung liegt in der Effizienz: Anthropic sagt, Sonnet 5.5 könne pro Task bis zu 30 % weniger kosten, weil es weniger Tokens verbraucht, und erzeuge die Ausgabe mehr als 30 % schneller. Das ist ein vom Anbieter genannter Höchstwert, kein garantierter Rabatt für jede Workload.

Halten Sie für eine Budgetprognose die Token-Preise fest und modellieren Sie die mögliche Reduktion bei Tokens und Agent-Schritten getrennt. Messen Sie Ihren eigenen Task-Mix, bevor Sie eine Einsparungsannahme anwenden.

Sonnet 5.5 API-Preise

Token-TypPreis pro Million
Input$2.00
Output$10.00
Cache-Schreiben, 5 Minuten$2.50
Cache-Schreiben, 1 Stunde$4.00
Cache-Lesen$0.20

Anthropic nennt diese Preise in der Ankündigung zu Sonnet 5.5. Verstehen Sie „bis zu 30 % weniger pro Task“ nicht als 30 % niedrigere Token-Preise: Die Input- und Output-Preise sind gegenüber Sonnet 5 unverändert. Der Preis von $2/$10 für Sonnet 5 ist zudem jetzt der Standard, nachdem Anthropic die geplante Erhöhung im September abgesagt hat.

Beispiel: Token-Effizienz gegenüber Preisänderungen

Nehmen wir einen Task mit 100,000 Input-Tokens und 10,000 Output-Tokens, ohne Caching. Zu den veröffentlichten Preisen von Sonnet 5.5 sind das $0.20 für Input plus $0.10 für Output, also $0.30 pro Task. Würde derselbe Task in beiden Kategorien 30 % weniger Tokens verbrauchen, läge der modellierte Preis bei $0.21. Das ist eine Veranschaulichung der Rechnung, kein Versprechen, dass jeder Task 30 % weniger Tokens braucht.

Bei 10,000 solchen Tasks pro Monat beträgt die Basis $3,000. Eine Reduktion des Token-Volumens um 30 % würde $900 sparen und die modellierte Monatsrechnung auf $2,100 senken. Die tatsächlichen Ergebnisse schwanken je nach Prompt-Länge, Cache-Wiederverwendung, Output-Länge, Reasoning-Aufwand, Wiederholungen und Tool-Aufrufen.

Was die Launch-Benchmarks zeigen und was nicht

Anthropic berichtet über Verbesserungen bei seinen Coding- und Wissensarbeits-Evaluierungen, darunter Terminal-Bench 4.0 und CursorBench. Das Unternehmen gibt außerdem an, dass Sonnet 5.5 die Ausgabe mehr als 30 % schneller erzeugt als Sonnet 5 und in mehreren Benchmark-Vergleichen die früheren Sonnet-5-Werte zu einem Bruchteil der Kosten pro Task erreicht. Diese Ergebnisse sind nützliche Hypothesen für einen Evaluierungsplan, aber vom Anbieter veröffentlichte Messungen und keine unabhängigen Produktionskostendaten.

Ein praktischer Vorbehalt: Ein schnelleres Modell senkt eine tokenbasierte API-Rechnung nicht automatisch. Die Rechnung sinkt, wenn der Verbrauch pro abgeschlossenem Task sinkt oder wenn weniger Tasks Wiederholungen oder Eskalation brauchen. Schnellere Generierung kann stattdessen den Durchsatz verbessern oder die Latenz senken, ohne die Token-Ausgaben zu verändern.

Ein sicherer Weg zur Prognose der Einführung

  1. Halten Sie die Preisliste konstant. Nutzen Sie $2/$10 pro Million Input-/Output-Tokens als Ausgangspunkt für Sonnet 5 und 5.5.
  2. Messen Sie erledigte Arbeit. Vergleichen Sie die Kosten pro akzeptiertem Task, nicht nur Tokens pro Anfrage. Beziehen Sie Wiederholungen, Tool-Aufrufe und manuelle Nacharbeit ein, wo möglich.
  3. Teilen Sie nach Workload auf. Bewerten Sie Coding, Support, Extraktion und Long-Context-Tasks getrennt; eine einzige gemischte Einsparquote kann Rückschritte verbergen.
  4. Arbeiten Sie mit einer Spanne. Budgetieren Sie mit 0 % Einsparung, bis interne Tests Belege liefern, und ergänzen Sie dann gemessene Szenarien. Betrachten Sie Anthropics „bis zu 30 %“ als Obergrenzen-Aussage, nicht als Ihre Prognose.
  5. Prüfen Sie Qualität und Latenz erneut. Eine niedrigere Token-Rechnung ist keine Einsparung, wenn die Akzeptanzquote sinkt oder teurere Fallback-Modelle nötig werden.

FAQ

Ist Sonnet 5.5 pro Token günstiger geworden?

Nein. Anthropic nennt dieselben Preise wie bei Sonnet 5: $2 Input und $10 Output pro Million Tokens. Die Aussage zu den Kosten pro Task stammt daher, dass für vergleichbare Arbeit weniger Tokens verbraucht werden.

Sind 30 % Ersparnis garantiert?

Nein. Anthropic beschreibt in seinen Launch-Unterlagen Kostensenkungen von bis zu 30 % für die meiste Arbeit. Ihr Ergebnis hängt von Workload, Prompt Caching, Effort-Einstellungen und der Qualität der Task-Erledigung ab.

Was kostet eine gecachte Anfrage?

Anthropic nennt Cache-Lesen mit $0.20 pro Million Tokens, 5-Minuten-Schreiben mit $2.50 und 1-Stunden-Schreiben mit $4.00. Prüfen Sie die aktuelle Preisdokumentation der Claude-API, bevor Sie eine Prognose festschreiben.

Sollen wir den Produktionsverkehr sofort umstellen?

Führen Sie zuerst eine repräsentative Evaluierung durch. Testen Sie das Modell im Shadow- oder Canary-Betrieb, vergleichen Sie Kosten pro akzeptiertem Ergebnis und Latenz, und behalten Sie eine Rückfallroute für Workloads, die schlechter werden.

Quellen und weiterführende Lektüre

Weiterführend


Möchten Sie das auf Ihren Stack anwenden? Bringen Sie Anbieterrechnungen, Gateway-Protokolle und die wichtigsten Workflows mit; wir ordnen Kostentreiber und Einsparpotenziale zu. Kostenlose Prüfung buchen →

Zurück zu finopsllm.com