KI-Beschaffung im Unternehmen und Committed Spend
Aktualisiert September 27, 2026 · erstveröffentlicht September 27, 2026
Am 25. September 2026 bezifferte ein Bericht auf Basis eingestufter Schätzungen die Ausgaben einer US-Behörde für KI-Modelltests im Milliardenbereich; auf Hacker News brachte er es auf 176 Punkte und 106 Kommentare. Wie hoch die Zahl genau ist, spielt kaum eine Rolle, entscheidend ist die Richtung: KI-Modellausgaben sind von einer Kostenposition zu einer Beschaffungskategorie geworden, und die Mechanismen, die eine monatliche Rechnung von $50K bestimmen, gelten bei einer neunstelligen nicht mehr.
Was sich im Beschaffungsmaßstab ändert
- Veröffentlichte Preislisten werden verhandelbar. Bei geringem Volumen zahlt man den Listenpreis. Bei hohem Volumen hat der Anbieter Bereitstellungskosten und eine Beziehung zu schützen.
- Committed-Use-Rabatte ersetzen Spot-Preise. Ein Committed-Spend-Vertrag tauscht Flexibilität gegen einen niedrigeren Preis. Nur sinnvoll, wenn Sie Ihre Untergrenze kennen.
- Rate-Limits und Durchsatzgarantien werden vertraglich. Best-Effort-Priorität wird zur Vertragsklausel. Für Agenten-Workloads ist das wichtiger als der Preis.
- Support-Stufe und Eskalationswege werden gekauft, nicht vorausgesetzt. Ein Sev-1 mit einem Bereitschaftsingenieur ist eine betriebliche Abhängigkeit, keine Ausgabe.
- Datenbedingungen prüft die Rechtsabteilung. Aufbewahrung, Opt-out vom Training und Unterauftragsverarbeiter-Listen werden auditiert. Diese Prüfung liegt auf dem kritischen Pfad.
Der Committed-Spend-Tausch
Ein Committed-Use-Vertrag ist eine Wette auf die eigene Prognose. Rabatte liegen typischerweise bei 10–35 % unter Liste für eine Untergrenze über 12 Monate. Der typische Fehlerfall: Ein Team verpflichtet sich auf eine Untergrenze, nutzt dann während der Laufzeit ein günstigeres Modell zu stark und zahlt am Ende Committed-Preise für Tokens, die es gar nicht brauchte. Drei Kontrollen machen die Wette sicher:
- Legen Sie die Untergrenze an der wirklich stabilen Last fest. Batch-, Eval- und interner Traffic lässt sich weit besser prognostizieren als kundennaher Agenten-Traffic.
- Halten Sie die Modellwahl innerhalb der Laufzeit austauschbar. Eine Zusage, $X bei einem Anbieter auszugeben, ist über dessen Modelle hinweg übertragbar. Eine Zusage auf ein bestimmtes Modell ist es nicht.
- Prüfen Sie in Monat 6, nicht in Monat 12. Liegt die tatsächliche Run-Rate weit unter der Untergrenze, verhandeln Sie vor der Schlussabrechnung neu.
Preislisten und Egress bestimmen weiterhin die Rechnung
Zwei Posten überraschen Beschaffungsteams regelmäßig, die einen Eckpreis ausgehandelt haben:
- Gecachte Eingabe. Opus 5.5 berechnet $0.20 pro Million für Cache-Lesezugriffe gegenüber $4.00 für frische Eingabe. Bei cache-lastigen Agenten-Workloads macht der Cache-Preis, nicht der Eckpreis, den Großteil der Eingabekosten aus. Verhandeln Sie den Cache-Preis ausdrücklich.
- Serverseitige Tools sind eine eigene Rechnungsposition. Websuche, Codeausführung und ähnliche Server-Tools werden unabhängig von Tokens abgerechnet. Ein Unternehmens-Agent auf Basis von Websuche kann einen großen Nicht-Token-Posten haben, den keine Preislisten-Verhandlung berührt hat.
Die Modellwahl ist ein Hebel zweiter Ordnung
Im Beschaffungsmaßstab ist der Abstand zwischen einem Premium- und einem Mittelklasse-Modell oft kleiner als der zwischen verhandeltem und Listenpreis. Und wenn ein großes Labor die Preise an einem Nachmittag um 40 % senkt, wird eine vor sechs Monaten festgeschriebene Preisliste plötzlich zur teuren Option. Gestalten Sie Verträge so, dass Preisänderungen weitergegeben werden oder ein Prüffenster auslösen. Diese eine Klausel hat wiederholt mehr bewirkt als das Modell im Vertrag.
Fazit
Committed Spend, Cache-Preise, Egress und Weitergabeklauseln sind die Mechanismen, die über eine große KI-Rechnung entscheiden. Die Modellwahl entscheidet über die Qualität. Halten Sie diese beiden Gespräche getrennt und tragen Sie das Verlängerungsdatum in den Kalender ein, bevor die Laufzeit beginnt.
Weiterführend
- Rabatte für Committed Spend
- Server-Tools sind eine eigene Rechnung
- Azure OpenAI vs. Direktkosten
- Regionaler Preisaufschlag
- Schatten-KI auf Firmenkarten
Möchten Sie das auf Ihren Stack anwenden? Bringen Sie Anbieterrechnungen, Gateway-Protokolle und die wichtigsten Workflows mit; wir ordnen Kostentreiber und Einsparpotenziale zu. Kostenlose Prüfung buchen →