Quanto Custa GPT-5?
Atualizado em 15 de julho de 2026 · publicado inicialmente em 4 de julho de 2026
GPT-5 é o modelo de raciocínio insignia da OpenAI, lançado em 2026. Oferece desempenho substancialmente superior em tarefas complexas de raciocínio, programação e multimodais em comparação com GPT-4o - mas com um preço premium. Este guia detalha cada dimensão de custo: preços de API, níveis de assinatura do ChatGPT, comparação com GPT-4o e onde alternativas mais baratas como MiMO podem ser a escolha mais inteligente.
Preços de API do GPT-5
A OpenAI cobra pelo GPT-5 por milhão de tokens, com taxas separadas para entrada, saída e entrada em cache. As leituras de cache são significativamente mais baratas porque o modelo reutiliza um prefixo previamente calculado.
| Nível | Entrada $/1M | Saída $/1M | Leitura Cache $/1M | Janela de Contexto |
|---|---|---|---|---|
| GPT-5.6-Sol (máx) | $5.00 | $30.00 | $0.50 | 128K tokens |
| GPT-5.6-Terra (médio) | $2.50 | $15.00 | $0.25 | 128K tokens |
| GPT-5.6-Luna (econômico) | $1.00 | $6.00 | $0.10 | 128K tokens |
| GPT-5.5 (insignia) | $5.00 | $30.00 | $0.50 | 128K tokens |
| GPT-5.4 (faixa média) | $2.50 | $15.00 | $0.25 | 128K tokens |
A nova geração de julho de 2026 da OpenAI (GPT-5.6) introduz três níveis distintos: Sol para raciocínio de ponta, Terra para desempenho equilibrado e Luna para casos de uso conscientes de custos. Para comparação, os modelos mais antigos GPT-5.5 e 5.4 continuam disponíveis. GPT-5.6 e 5.5 a $5/$30 são significativamente mais capazes que GPT-4o ($2.50/$10), mas o custo efetivo depende da profundidade do raciocínio e eficiência de cache.
Custos de assinatura do ChatGPT
Se você usar GPT-5 através da interface ChatGPT em vez da API, o preço é baseado em assinatura:
| Plano | Preço Mensal | Acesso GPT-5 | Limites Principais |
|---|---|---|---|
| Free | $0 | Apenas GPT-5 mini | Mensagens limitadas/dia |
| Plus | $20/mês | GPT-5 com limites | ~80 mensagens GPT-5/3hrs |
| Pro | $200/mês | GPT-5 ilimitado | Sem limites de taxa, voz, pesquisa profunda |
| Team | $25/usuário/mês | GPT-5 com limites altos | Ferramentas admin, SSO, limites superiores |
| Enterprise | Personalizado | GPT-5 ilimitado | SLA, suporte dedicado, governança de dados |
O plano Pro a $200/mês só é rentável se você for um usuário intensivo diário. Para a maioria dos desenvolvedores e equipes, a API com gerenciamento cuidadoso de tokens é mais barata que uma assinatura Pro.
GPT-5 vs GPT-4o: quando a atualização faz sentido?
A diferença de preço é real, então a pergunta é se a vantagem de qualidade do GPT-5 se traduz em economia de custos em outros lugares:
- Use GPT-5 quando: a tarefa exigir raciocínio em múltiplas etapas, geração complexa de código, análise de documentos longos ou fluxos de trabalho agênticos onde uma única passagem de alta qualidade economiza múltiplos ciclos de nova tentativa.
- Use GPT-4o quando: a tarefa é direta - classificação, extração, resumo de textos curtos, chat simples ou processamento em lote de alto volume onde o rendimento importa mais que a inteligência por solicitação.
- Use GPT-5 mini ou nano quando: você precisar de seguimento de instruções em nível GPT-5 mas com custo menor, e pode aceitar profundidade de raciocínio ligeiramente reduzida.
Uma regra prática: se seus prompts GPT-4o incluem instruções de cadeia de pensamento ou loops de correção multi-turno, GPT-5 pode ser realmente mais barato porque faz esse raciocínio nativamente em uma única chamada.
Como reduzir custos com GPT-5
Várias estratégias podem reduzir sua conta de GPT-5 em 30–70% sem sacrificar a qualidade de saída:
- Aproveite o cache de prompts. A taxa de leitura de cache do GPT-5 ($2.50/1M) é 75% mais barata que a taxa de entrada completa. Estruture seus prompts com um prefixo estável (instruções do sistema, contexto) e sufixo variável (consulta do usuário) para maximizar acertos de cache.
- Use GPT-5 mini/nano para roteamento. Execute um modelo leve primeiro para classificar a intenção, depois escale para GPT-5 completo apenas para consultas complexas. Este é o padrão de roteamento de modelos.
- API em lote para trabalho não interativo. A API em lote da OpenAI oferece descontos de 50% em cargas de trabalho assíncronas - ideal para avaliação, enriquecimento e geração de relatórios.
- Dimensione adequadamente as janelas de contexto. Não envie 100K tokens de contexto quando 5K é suficiente. Cada token de entrada desnecessário custa 4× mais em GPT-5 que em GPT-4o.
- Considere alternativas. Para muitas tarefas de programação e raciocínio, modelos como MiMO, DeepSeek R1 ou Claude Sonnet entregam qualidade comparável por uma fração do custo. Use arbitragem de provedor para comparar.
Custos ocultos além do preço de etiqueta
A taxa por token é apenas parte do quadro. Orçamente estes fatores adicionais:
- Tokens de raciocínio. GPT-5 usa tokens de raciocínio interno para tarefas complexas. Estes são cobrados na taxa de saída ($30/1M) e podem multiplicar seu volume de saída efetivo por 2–5× em problemas difíceis.
- Custos de nova tentativa. Se seus prompts forem ambiguos ou sua análise for frágil, as tentativas falhadas ainda consomem tokens. A engenharia de prompt robusta compensa a si mesma.
- Gasto em avaliação. Testes e benchmarks durante o desenvolvimento podem facilmente exceder gastos de produção se não forem rastreados separadamente. Ver alocação de custos de avaliação.
Conclusão
GPT-5 é caro mas não uniformemente. A $10/$30 por milhão de tokens, uma chamada de API típica com 1.000 tokens de entrada e 500 de saída custa aproximadamente $0.025. Para aplicações de alto volume, a conta se acumula rapidamente - mas cache inteligente, roteamento e processamento em lote podem reduzir custos pela metade ou mais. Rastreie cada solicitação, atribua gasto a recursos e compare alternativas regularmente.
Relacionado
- Como os provedores de LLM cobram? - os modelos de preços por trás dos números.
- Roteamento de modelos - enviar a solicitação correta para o modelo correto.
- Arbitragem de provedor - encontrar o modelo mais barato que atenda seu limite de qualidade.
- Cache de prompts explicado - como obter acertos de cache reais.
Quer isso aplicado ao seu próprio gasto com LLM? FinOps LLM executa uma auditoria gratuita de seus custos com IA e mostra onde estão as economias. Agende auditoria gratuita →