Atribución de costes de OpenAI
La atribución de costes de OpenAI comienza antes de que se envíe la solicitud. La respuesta de la API puede indicarte el uso de tokens, pero no puede saber qué superficie de producto, equipo, cliente o flujo de trabajo empresarial causó la llamada a menos que tu aplicación adjunte ese contexto.
La atribución debe combinar tres fuentes: metadatos de solicitud, registros de uso y datos de factura. Los metadatos de solicitud ofrecen propiedad. Los registros de uso ofrecen conteos de tokens y modelo. Los datos de factura ofrecen el total financiero autoritario.
Etiquetas a capturar
- Nombre de funcionalidad o punto de conexión.
- Propietario del equipo y entorno.
- Proyecto o cliente cuando sea permitido.
- Clase de carga de trabajo, como realtime, batch, eval, soporte o paso de agente.
- Versión de prompt, política de enrutamiento y estado de alternativa.
Brechas comunes en la atribución
Los equipos a menudo pierden reintentos y alternativas. Un usuario ve una respuesta, pero el sistema puede haber pagado por múltiples llamadas ascendentes. Otra brecha común es el trabajo en lote: los evals y trabajos de enriquecimiento deben etiquetarse por separado del tráfico orientado al usuario para que puedan moverse a carriles asincronos de menor coste.
Los mejores informes de atribución de OpenAI no se detienen en «qué modelo costó más». Muestran qué decisión de producto causó que se usara ese modelo, y qué propietario puede cambiarlo.
Relacionado
- Atribución de costes de LLM - principios generales de atribución.
- Atribución de costes de Anthropic - atribución para modelos de Anthropic.
- ¿Qué es LLM FinOps? - la disciplina operativa completa.
¿Quieres que se aplique a tu propio gasto en LLM? FinOps LLM ejecuta una auditoría gratuita de tus costes de IA y muestra dónde se encuentran los ahorros. Solicita tu auditoría gratuita →