Zum Inhalt springen

Claude Haiku 5.5 und die Preisschwelle bei 100k Tokens

Aktualisiert October 8, 2026 · erstveröffentlicht October 8, 2026

Kurzantwort: Der Listenpreis von Claude Haiku 5.5 hängt von der Prompt-Länge ab. Anthropic hat das Modell am 7. Oktober 2026 veröffentlicht, für Aufgaben mit hohem Volumen wie Klassifizierung, Zusammenfassungen...

Der Listenpreis von Claude Haiku 5.5 hängt von der Prompt-Länge ab. Anthropic hat das Modell am 7. Oktober 2026 veröffentlicht, für Aufgaben mit hohem Volumen wie Klassifizierung, Zusammenfassungen und Subagenten-Aufgaben. Das Kontextfenster von 1 Million Tokens ist kein Versprechen, dass alle diese Tokens den Preis für kurze Prompts kosten: Ein Prompt mit mehr als 100,000 Tokens nutzt eine höhere Preisstufe. Damit wird die Größe der Anfrage zu einer Budgetentscheidung, besonders bei Agenten, die Dokumente und Tool-Ergebnisse ansammeln.

Die Preisliste hat zwei Seiten

Die folgenden Angaben sind die von Anthropic veröffentlichten Standardpreise der Claude API in US-Dollar pro Million Tokens, Stand 8. Oktober. Die Grenze verläuft zwischen bis zu 100,000 Prompt-Tokens und mehr als 100,000; der höhere Preis wird nicht nur auf die Tokens oberhalb der Schwelle berechnet. Prüfen Sie die aktuelle Preisdokumentation, bevor Sie die Zahlen in einer Prognose verwenden.

Token-KategoriePrompt bis 100kPrompt über 100k
Eingabe ohne Cache$0.10$0.50
Ausgabe$0.50$2.50
Cache-Schreiben (5 Minuten)$0.125$0.625
Cache-Schreiben (1 Stunde)$0.20$1.00
Cache-Lesen$0.01$0.05

Jeder aufgeführte Token-Preis ist oberhalb der Grenze fünfmal so hoch. Das bedeutet nicht, dass jede Anwendungsrechnung auf das Fünffache steigt: Viele Aufrufe bleiben womöglich kurz, und Ausgabevolumen, Caching, Tools, Batch-Verarbeitung, Wiederholungen und Aufgabenerfolg beeinflussen die Gesamtausgaben. Gecachter Kontext belegt weiterhin den Prompt; ein Cache-Treffer macht aus einer Anfrage mit 120k Tokens keinen kurzen Prompt.

Wie die Grenze bei einer einzelnen Anfrage aussieht

Betrachten Sie zwei Beispielaufrufe ohne Caching und ohne separat abgerechnete Tools, die jeweils 1,000 Ausgabe-Tokens erzeugen. Ein Prompt mit 99,000 Tokens kostet für Eingabe plus Ausgabe zu den Preisen für kurze Prompts etwa $0.0104. Ein Prompt mit 101,000 Tokens kostet zu den Preisen für lange Prompts etwa $0.0530. Das ist ungefähr das Fünffache für eine Anfrage, die nur 2,000 Eingabe-Tokens länger ist. Das Beispiel hält die Ausgabe konstant, um die Preisgrenze zu isolieren; es ist keine gemessene Einsparung im Produktivbetrieb. Echte Prompts enthalten außerdem Systemanweisungen, Gesprächsverlauf, Tool-Schemas und Tool-Ergebnisse.

Vor der Migration neu zählen

Die Migrationshinweise von Anthropic besagen, dass derselbe Text bei Haiku 5.5 ungefähr 30 % mehr Tokens erzeugt als bei Haiku 4.5, abhängig vom Inhalt. Ein Prompt, der nach den alten Token-Zahlen deutlich unter 100k lag, kann die neue Grenze überschreiten. Multiplizieren Sie nicht alle alten Zahlen mit 1.3 und behandeln das Ergebnis als Rechnungsprognose; zählen Sie repräsentative Anfragen mit claude-haiku-5-5 neu.

Der Token-Counting-Endpoint von Anthropic akzeptiert die strukturierte Nachricht, den System-Prompt und unterstützte Client-Tools, bevor die Generierungsanfrage gesendet wird. Zählen Sie mit dem Zielmodell und protokollieren Sie nach der Antwort die tatsächliche Nutzung. Die Zählung vorab ist eine Schätzung und kann geringfügig von der abgerechneten Eingabe abweichen; einige Server-Tools sowie URL- und Datei-Blöcke unterstützt der Zähler nicht. Verlassen Sie sich bei diesen Pfaden auf die beobachtete Nutzung der Anfragen und halten Sie nahe der Schwelle einen Sicherheitsabstand ein.

Eine Prompt-Budget-Regel für Subagenten

  1. Verteilung messen. Erfassen Sie die Prompt-Token-Zahlen von Haiku 5.5 nach Workload, Modell-ID und Aufgabenergebnis. Beobachten Sie, wie viele Aufrufe nahe an 100k liegen oder darüber, statt nur den Durchschnitt zu betrachten.
  2. Vor der Grenze warnen. Markieren Sie Anfragen nahe der Schwelle im Agenten-Orchestrator. Betrachten Sie die Warnstufe als Ihren eigenen betrieblichen Puffer, nicht als Preisregel von Anthropic.
  3. Die Ursache kürzen. Entfernen Sie doppelte Retrieval-Abschnitte, begrenzen Sie die Größe von Tool-Ergebnissen oder verdichten Sie veralteten Verlauf, wo Qualitätstests es zulassen. Verwerfen Sie keine Belege, die ein Agent braucht, nur um Tokens zu sparen.
  4. Den langen Schwanz vergleichen. Testen Sie bei unvermeidbar langen Prompts Haiku auf der höheren Stufe gegen eine andere Route mit denselben Aufgaben. Vergleichen Sie Kosten pro akzeptiertem Ergebnis, Latenz und Fallback-Häufigkeit, nicht nur Listenpreise.
  5. Mit der Rechnung abstimmen. Bewerten Sie tatsächliche Eingabe, Ausgabe sowie Cache-Lese- und Schreibvorgänge zur jeweils gültigen Stufe und addieren Sie dann Tools und Wiederholungen. Prüfen Sie Anbieter- oder Cloud-Plattform-Preise und etwaige Vertragsrabatte erneut.

Haiku 5.5 kann oberhalb von 100k weiterhin die beste Wahl sein, aber das sollte eine gemessene Routing-Entscheidung sein. Entscheidend ist zu wissen, welche Anfragen die Grenze überschreiten und warum.

Fragen, die Teams stellen

Gilt der höhere Preis nur für Tokens oberhalb von 100k?

Nein. Anthropic beschreibt Haiku 5.5 als nach Prompt-Länge bepreist: Ein Prompt mit mehr als 100,000 Tokens zahlt für diese Anfrage die höheren veröffentlichten Preise.

Kann Prompt Caching eine lange Anfrage in der günstigeren Stufe halten?

Nein. Wiederverwendete Tokens können einen Cache-Lesepreis erhalten, aber gecachter Kontext belegt weiterhin die Prompt-Länge. Zählen Sie bei der Prüfung der Schwelle den vollständigen Prompt.

Ist ein Tokenizer-Anstieg von 30 % garantiert?

Nein. Anthropic nennt ungefähr 30 % mehr Tokens für denselben Text als bei Haiku 4.5, abhängig vom Inhalt. Zählen Sie Ihre eigenen Prompts mit dem Zielmodell.

Weiterführend


Möchten Sie das auf Ihren Stack anwenden? Bringen Sie Anbieterrechnungen, Gateway-Protokolle und die wichtigsten Workflows mit; wir ordnen Kostentreiber und Einsparpotenziale zu. Kostenlose Prüfung buchen →

Zurück zu finopsllm.com