Modello di costo della bacheca messaggi degli agenti OpenAI
Aggiornato September 27, 2026 · pubblicato inizialmente September 27, 2026
Nel settembre 2026 alcuni ricercatori hanno scoperto una bacheca messaggi degli agenti di OpenAI: un livello di comunicazione in cui agenti autonomi possono pubblicare messaggi, leggere risposte e coordinare flussi di lavoro in più passaggi senza intervento umano. Per i team FinOps questo introduce un nuovo vettore di costo: il consumo di token tra agenti, che cresce con la lunghezza della conversazione e non con la complessità del compito.
Cosa rende possibile la bacheca messaggi
La bacheca funziona come un bus di contesto condiviso. Un agente orchestratore pubblica la scomposizione di un compito; gli agenti specialisti prendono in carico i sottocompiti, pubblicano risultati e negoziano i passaggi di consegna. Ogni messaggio è un ciclo completo prompt-completamento, fatturato alle tariffe standard del modello.
Modello di costo
| Componente | Tariffa (GPT-6 Astra) | Tariffa (GPT-6 Sol) |
|---|---|---|
| Pubblicazione dell'agente (input) | $10.00 / 1M | $2.00 / 1M |
| Lettura dell'agente (input in cache) | $1.00 / 1M | $0.20 / 1M |
| Risposta dell'agente (output) | $50.00 / 1M | $10.00 / 1M |
Una coordinazione di 10 turni tra tre agenti alle tariffe Astra: ~300K token = $15. Lo stesso scambio su Sol: $3. La differenza sta nel capire se il compito richiede il ragionamento di Astra o se bastano i token più economici di Sol.
Scenari di esplosione dei costi
- Cicli di negoziazione: due agenti non concordano su un passaggio di consegna e iterano più di 50 volte prima di convergere.
- Tempeste di broadcast: un agente pubblica a tutti gli iscritti; ciascuno risponde, innescando altre pubblicazioni.
- Conversazioni orfane: gli agenti aspettano una risposta che non arriva mai, interrogando la bacheca ogni 30 secondi.
Controlli FinOps
- Budget messaggi per flusso di lavoro: limite rigido sul totale dei token della bacheca per ID di compito.
- Limiti di profondità: massimo 3 passaggi tra agenti prima dell'escalation a un umano.
- Instradamento dei modelli: indirizzate il coordinamento su Sol; riservate Astra al solo passaggio finale di sintesi.
- Timeout di inattività: chiusura automatica dei thread dopo 5 minuti di inattività.
Conclusione
La bacheca rende componibili i sistemi multi-agente, ma la componibilità senza protezioni sui costi è una perdita di budget. Trattate i token tra agenti come un centro di costo distinto, con i propri alert e budget.
Correlati
- Modello di costo di GPT-6 Astra
- Modello di costo di GPT-6 Sol
- Limiti di concorrenza nel fan-out dei subagenti
- Tre budget per agenti
Vuoi applicarlo al tuo stack? Porta le fatture dei provider, i log del gateway e i flussi di lavoro principali: mapperemo i costi e i possibili risparmi. Prenota un audit gratuito →