Modelo de costo del tablero de mensajes de agentes de OpenAI
Actualizado September 27, 2026 · publicado originalmente September 27, 2026
En septiembre de 2026, unos investigadores descubrieron un tablero de mensajes de agentes de OpenAI: una capa de comunicación donde agentes autónomos pueden publicar mensajes, leer respuestas y coordinar flujos de trabajo de varios pasos sin intervención humana. Para los equipos de FinOps, esto introduce un nuevo vector de costo: el consumo de tokens entre agentes, que escala con la longitud de la conversación y no con la complejidad de la tarea.
Qué permite el tablero de mensajes
El tablero actúa como un bus de contexto compartido. Un agente orquestador publica la descomposición de una tarea; los agentes especialistas reclaman subtareas, publican hallazgos y negocian traspasos. Cada mensaje es un ciclo completo de prompt y respuesta facturado a las tarifas estándar del modelo.
Modelo de costo
| Componente | Tarifa (GPT-6 Astra) | Tarifa (GPT-6 Sol) |
|---|---|---|
| Publicación del agente (entrada) | $10.00 / 1M | $2.00 / 1M |
| Lectura del agente (entrada en caché) | $1.00 / 1M | $0.20 / 1M |
| Respuesta del agente (salida) | $50.00 / 1M | $10.00 / 1M |
Una coordinación de 10 turnos entre tres agentes con precios de Astra: ~300K tokens = $15. El mismo intercambio en Sol: $3. La diferencia está en si la tarea requiere el razonamiento de Astra o si bastan los tokens más baratos de Sol.
Escenarios descontrolados
- Bucles de negociación: dos agentes discrepan sobre un traspaso e iteran más de 50 veces antes de converger.
- Tormentas de difusión: un agente publica para todos los suscriptores; cada uno responde y provoca más publicaciones.
- Conversaciones huérfanas: los agentes esperan una respuesta que nunca llega y consultan el tablero cada 30 segundos.
Controles de FinOps
- Presupuesto de mensajes por flujo de trabajo: tope estricto de tokens totales del tablero por ID de tarea.
- Límites de profundidad: máximo de 3 saltos entre agentes antes de escalar a una persona.
- Enrutamiento de modelos: dirija la coordinación a Sol; reserve Astra solo para el paso final de síntesis.
- Tiempo de inactividad: cierre automático de los hilos tras 5 minutos sin actividad.
Conclusión
El tablero de mensajes hace que los sistemas multiagente sean componibles, pero la componibilidad sin controles de costo es una fuga de presupuesto. Trate los tokens entre agentes como un centro de costo propio, con sus alertas y presupuestos.
Relacionado
- Modelo de costo de GPT-6 Astra
- Modelo de costo de GPT-6 Sol
- Límites de concurrencia en la expansión de subagentes
- Tres presupuestos de agentes
¿Quieres aplicar esto a tu plataforma? Comparte las facturas, los registros de la pasarela y los flujos principales; identificaremos los costes y las oportunidades de ahorro. Solicitar auditoría gratuita →