Vai al contenuto

Modello di costo della bacheca messaggi degli agenti OpenAI

Aggiornato September 27, 2026 · pubblicato inizialmente September 27, 2026

Nel settembre 2026 alcuni ricercatori hanno scoperto una bacheca messaggi degli agenti di OpenAI: un livello di comunicazione in cui agenti autonomi possono pubblicare messaggi, leggere risposte e coordinare flussi di lavoro in più passaggi senza intervento umano. Per i team FinOps questo introduce un nuovo vettore di costo: il consumo di token tra agenti, che cresce con la lunghezza della conversazione e non con la complessità del compito.

Cosa rende possibile la bacheca messaggi

La bacheca funziona come un bus di contesto condiviso. Un agente orchestratore pubblica la scomposizione di un compito; gli agenti specialisti prendono in carico i sottocompiti, pubblicano risultati e negoziano i passaggi di consegna. Ogni messaggio è un ciclo completo prompt-completamento, fatturato alle tariffe standard del modello.

Modello di costo

ComponenteTariffa (GPT-6 Astra)Tariffa (GPT-6 Sol)
Pubblicazione dell'agente (input)$10.00 / 1M$2.00 / 1M
Lettura dell'agente (input in cache)$1.00 / 1M$0.20 / 1M
Risposta dell'agente (output)$50.00 / 1M$10.00 / 1M

Una coordinazione di 10 turni tra tre agenti alle tariffe Astra: ~300K token = $15. Lo stesso scambio su Sol: $3. La differenza sta nel capire se il compito richiede il ragionamento di Astra o se bastano i token più economici di Sol.

Scenari di esplosione dei costi

Controlli FinOps

  1. Budget messaggi per flusso di lavoro: limite rigido sul totale dei token della bacheca per ID di compito.
  2. Limiti di profondità: massimo 3 passaggi tra agenti prima dell'escalation a un umano.
  3. Instradamento dei modelli: indirizzate il coordinamento su Sol; riservate Astra al solo passaggio finale di sintesi.
  4. Timeout di inattività: chiusura automatica dei thread dopo 5 minuti di inattività.

Conclusione

La bacheca rende componibili i sistemi multi-agente, ma la componibilità senza protezioni sui costi è una perdita di budget. Trattate i token tra agenti come un centro di costo distinto, con i propri alert e budget.

Correlati


Vuoi applicarlo al tuo stack? Porta le fatture dei provider, i log del gateway e i flussi di lavoro principali: mapperemo i costi e i possibili risparmi. Prenota un audit gratuito →

Torna a finopsllm.com