Kostenmodell für das Nachrichtenboard der OpenAI-Agenten
Aktualisiert September 27, 2026 · erstveröffentlicht September 27, 2026
Im September 2026 entdeckten Forschende ein Nachrichtenboard für OpenAI-Agenten – eine Kommunikationsschicht, auf der autonome Agenten Nachrichten posten, Antworten lesen und mehrstufige Workflows ohne menschliches Eingreifen koordinieren können. Für FinOps-Teams entsteht damit ein neuer Kostenfaktor: der Token-Verbrauch zwischen Agenten, der mit der Länge der Konversation skaliert und nicht mit der Komplexität der Aufgabe.
Was das Nachrichtenboard ermöglicht
Das Board fungiert als gemeinsamer Kontext-Bus. Ein Orchestrator-Agent postet eine Aufgabenzerlegung; Spezialisten-Agenten übernehmen Teilaufgaben, posten Ergebnisse und handeln Übergaben aus. Jede Nachricht ist ein vollständiger Prompt-Completion-Zyklus, der zu den Standardtarifen des Modells abgerechnet wird.
Kostenmodell
| Komponente | Tarif (GPT-6 Astra) | Tarif (GPT-6 Sol) |
|---|---|---|
| Agenten-Post (Eingabe) | $10.00 / 1M | $2.00 / 1M |
| Agenten-Lesevorgang (gecachte Eingabe) | $1.00 / 1M | $0.20 / 1M |
| Agenten-Antwort (Ausgabe) | $50.00 / 1M | $10.00 / 1M |
Eine Koordination über 10 Runden zwischen drei Agenten zu Astra-Preisen: ~300K Tokens = $15. Derselbe Austausch auf Sol: $3. Entscheidend ist, ob die Aufgabe das Reasoning von Astra erfordert oder ob die günstigeren Tokens von Sol genügen.
Szenarien mit Kostenexplosion
- Verhandlungsschleifen: Zwei Agenten sind sich über eine Übergabe uneinig und iterieren über 50-mal, bevor sie konvergieren.
- Broadcast-Stürme: Ein Agent postet an alle Abonnenten; jeder antwortet und löst weitere Posts aus.
- Verwaiste Konversationen: Agenten warten auf eine Antwort, die nie kommt, und fragen das Board alle 30 Sekunden ab.
FinOps-Kontrollen
- Nachrichtenbudget pro Workflow: Harte Obergrenze für die gesamten Board-Tokens pro Task-ID.
- Tiefenlimits: Maximal 3 Agent-zu-Agent-Hops vor der Eskalation an einen Menschen.
- Modell-Routing: Koordination an Sol leiten; Astra nur für den abschließenden Syntheseschritt reservieren.
- Leerlauf-Timeout: Threads nach 5 Minuten Inaktivität automatisch schließen.
Fazit
Das Nachrichtenboard macht Multi-Agent-Systeme kombinierbar – aber Kombinierbarkeit ohne Kostenschranken ist ein Budgetleck. Behandeln Sie Agent-zu-Agent-Tokens als eigene Kostenstelle mit eigenen Alarmen und Budgets.
Weiterführend
- Kostenmodell GPT-6 Astra
- Kostenmodell GPT-6 Sol
- Concurrency-Limits beim Subagent-Fan-out
- Drei Agentenbudgets
Möchten Sie das auf Ihren Stack anwenden? Bringen Sie Anbieterrechnungen, Gateway-Protokolle und die wichtigsten Workflows mit; wir ordnen Kostentreiber und Einsparpotenziale zu. Kostenlose Prüfung buchen →