Calculadora de Custos LLM
Atualizado em 15 de julho de 2026
Estime seu gasto mensal em LLMs entre modelos populares. Digite seu padrão de uso abaixo e compare os custos lado a lado. Todos os preços são por milhão de tokens a partir de julho de 2026.
Custos pré-calculados por nível de uso
Assim é o que cada nível de uso custa por mês em modelos populares, com base em padrões de requisição típicos:
| Modelo | Leve (1K req/mês) | Médio (10K req/mês) | Intensivo (100K req/mês) |
|---|---|---|---|
| GPT-5.6-Sol | $8.75 | $87.50 | $875.00 |
| GPT-5.6-Terra | $4.38 | $43.75 | $437.50 |
| GPT-5.6-Luna | $1.75 | $17.50 | $175.00 |
| Claude Fable 5 | $17.50 | $175.00 | $1,750.00 |
| Claude Opus 4.8 | $8.75 | $87.50 | $875.00 |
| Claude Sonnet 5 | $3.50 | $35.00 | $350.00 |
| Claude Haiku 4.5 | $1.75 | $17.50 | $175.00 |
| Gemini 3.5 Flash | $2.63 | $26.25 | $262.50 |
| Grok 4.5 | $4.00 | $40.00 | $400.00 |
| DeepSeek V4 Pro | $0.95 | $9.50 | $95.00 |
| Kimi K2.6 | $1.70 | $17.00 | $170.00 |
Leve: 1K requisições/mês, 500 entrada + 200 tokens de saída. Médio: 10K requisições/mês, 1.000 entrada + 500 tokens de saída. Intensivo: 100K requisições/mês, 2.000 entrada + 1.000 tokens de saída.
Calculadora interativa
Como usar esta calculadora
- Escolha seu modelo do menu suspenso. Os preços refletem as tarifas padrão de API a partir de julho de 2026.
- Digite seu volume de requisições - quantas chamadas de API você faz por mês.
- Estime a contagem de tokens - o número médio de tokens de entrada e saída por requisição. Se não tiver certeza, comece com 1.000 entrada / 500 saída para chat ou 3.000 entrada / 1.000 saída para geração de código.
- Clique em Calcular para ver seu custo mensal estimado dividido por entrada e saída.
Como reduzir sua estimativa
- Use cache de prompt. Se seus prompts têm um prefixo estável, as leituras do cache podem reduzir os custos de entrada em 50-90%. Consulte cache de prompt explicado.
- Altere o modelo por tarefa. Encaminhe consultas simples para modelos mais baratos e reserve os caros para tarefas complexas. Isto é roteamento de modelo.
- Use APIs em lote. Cargas de trabalho não urgentes podem usar preços em lote com 50% de desconto.
- Tente fornecedores mais baratos. MiMO e DeepSeek oferecem taxas significativamente mais baixas para qualidade comparável em muitas tarefas.
Relacionado
- Quanto custa GPT-5? - análise detalhada de preços do GPT-5.
- Como os provedores de LLM cobram? - entender o faturamento baseado em tokens.
- A forma mais barata de executar geração de código com IA - comparação de custos para ferramentas de codificação.
- Arbitragem de provedor - encontre o modelo mais barato que atende ao seu limite de qualidade.
Quer isso aplicado ao seu próprio gasto em LLM? O FinOps LLM executa uma auditoria gratuita de seus custos de IA e mostra onde estão as economias. Agende auditoria gratuita →