Modèle de coût du tableau de messages d'agents OpenAI
Mis à jour September 27, 2026 · première publication September 27, 2026
En septembre 2026, des chercheurs ont découvert un tableau de messages d'agents OpenAI : une couche de communication où des agents autonomes peuvent publier des messages, lire des réponses et coordonner des workflows en plusieurs étapes sans intervention humaine. Pour les équipes FinOps, cela introduit un nouveau vecteur de coût : la consommation de jetons d'agent à agent, qui croît avec la longueur de la conversation et non avec la complexité de la tâche.
Ce que permet le tableau de messages
Le tableau agit comme un bus de contexte partagé. Un agent orchestrateur publie la décomposition d'une tâche ; les agents spécialisés prennent des sous-tâches, publient leurs résultats et négocient les passations. Chaque message est un cycle complet prompt-complétion facturé aux tarifs standard du modèle.
Modèle de coût
| Composante | Tarif (GPT-6 Astra) | Tarif (GPT-6 Sol) |
|---|---|---|
| Publication de l'agent (entrée) | $10.00 / 1M | $2.00 / 1M |
| Lecture de l'agent (entrée en cache) | $1.00 / 1M | $0.20 / 1M |
| Réponse de l'agent (sortie) | $50.00 / 1M | $10.00 / 1M |
Une coordination de 10 tours entre trois agents au tarif Astra : ~300K jetons = $15. Le même échange sur Sol : $3. Tout dépend de savoir si la tâche exige le raisonnement d'Astra ou si les jetons moins chers de Sol suffisent.
Scénarios d'emballement
- Boucles de négociation : deux agents sont en désaccord sur une passation et itèrent plus de 50 fois avant de converger.
- Tempêtes de diffusion : un agent publie à tous les abonnés ; chacun répond, ce qui déclenche d'autres publications.
- Conversations orphelines : les agents attendent une réponse qui n'arrive jamais et interrogent le tableau toutes les 30 secondes.
Contrôles FinOps
- Budget de messages par workflow : plafond strict de jetons totaux du tableau par identifiant de tâche.
- Limites de profondeur : 3 sauts d'agent à agent au maximum avant escalade vers un humain.
- Routage de modèles : orientez la coordination vers Sol ; réservez Astra à la seule étape finale de synthèse.
- Délai d'inactivité : fermeture automatique des fils après 5 minutes d'inactivité.
En résumé
Le tableau de messages rend les systèmes multi-agents composables, mais la composabilité sans garde-fous de coût est une fuite budgétaire. Traitez les jetons d'agent à agent comme un centre de coût distinct, avec ses propres alertes et budgets.
À lire aussi
- Modèle de coût de GPT-6 Astra
- Modèle de coût de GPT-6 Sol
- Limites de concurrence du fan-out de sous-agents
- Trois budgets d'agents
Vous souhaitez appliquer cela à votre plateforme ? Transmettez vos factures fournisseurs, journaux de passerelle et principaux workflows ; nous cartographierons les coûts et les économies possibles. Demander un audit gratuit →