Atribuição de custos da OpenAI
A atribuição de custos da OpenAI começa antes do envio da solicitação. A resposta da API pode indicar o uso de tokens, mas não consegue saber qual superfície de produto, equipe, cliente ou fluxo de trabalho empresarial causou a chamada a menos que sua aplicação anexe esse contexto.
A atribuição deve combinar três fontes: metadados de solicitação, registros de uso e dados de fatura. Os metadados de solicitação fornecem a propriedade. Os registros de uso fornecem contagens de tokens e modelo. Os dados de fatura fornecem o total financeiro autoritário.
Tags a capturar
- Nome da funcionalidade ou endpoint.
- Proprietário e ambiente da equipe.
- Cliente ou inquilino quando permitido.
- Classe de carga de trabalho, como realtime, batch, eval, suporte ou passo de agente.
- Versão do prompt, política de roteamento e status de fallback.
Lacunas comuns na atribuição
As equipes frequentemente perdem tentativas e fallbacks. Um usuário vê uma resposta, mas o sistema pode ter pago por várias chamadas upstream. Outra lacuna comum é o trabalho em lote: evals e trabalhos de enriquecimento devem ser marcados separadamente do tráfego voltado para o usuário para que possam ser movidos para faixas assincronizadas de menor custo.
Os melhores relatórios de atribuição da OpenAI não param em "qual modelo custou mais". Eles mostram qual decisão de produto causou o uso desse modelo e qual proprietário pode alterá-lo.
Relacionado
- Atribuição de custos de LLM - princípios gerais de atribuição.
- Atribuição de custos da Anthropic - atribuição para modelos da Anthropic.
- O que é FinOps de LLM? - a disciplina operacional completa.
Quer que isto seja aplicado ao seu próprio gasto em LLM? FinOps LLM executa uma auditoria gratuita dos seus custos de IA e mostra onde se encontram as economias. Solicite sua auditoria gratuita →