Calculadora de Costes LLM
Actualizado 15 de julio de 2026
Estima tu gasto mensual en LLMs entre modelos populares. Introduce tu patrón de uso a continuación y compara los costes lado a lado. Todos los precios son por millón de tokens a julio de 2026.
Costes precalculados por nivel de uso
Así es lo que cuesta cada nivel de uso por mes en modelos populares, basado en patrones de solicitud típicos:
| Modelo | Ligero (1K req/mes) | Medio (10K req/mes) | Intensivo (100K req/mes) |
|---|---|---|---|
| GPT-5.6-Sol | $8.75 | $87.50 | $875.00 |
| GPT-5.6-Terra | $4.38 | $43.75 | $437.50 |
| GPT-5.6-Luna | $1.75 | $17.50 | $175.00 |
| Claude Fable 5 | $17.50 | $175.00 | $1,750.00 |
| Claude Opus 4.8 | $8.75 | $87.50 | $875.00 |
| Claude Sonnet 5 | $3.50 | $35.00 | $350.00 |
| Claude Haiku 4.5 | $1.75 | $17.50 | $175.00 |
| Gemini 3.5 Flash | $2.63 | $26.25 | $262.50 |
| Grok 4.5 | $4.00 | $40.00 | $400.00 |
| DeepSeek V4 Pro | $0.95 | $9.50 | $95.00 |
| Kimi K2.6 | $1.70 | $17.00 | $170.00 |
Ligero: 1K solicitudes/mes, 500 entrada + 200 tokens de salida. Medio: 10K solicitudes/mes, 1,000 entrada + 500 tokens de salida. Intensivo: 100K solicitudes/mes, 2,000 entrada + 1,000 tokens de salida.
Calculadora interactiva
Cómo usar esta calculadora
- Elige tu modelo del desplegable. Los precios reflejan tarifas API estándar a julio de 2026.
- Introduce tu volumen de solicitudes - cuántas llamadas API haces al mes.
- Estima el recuento de tokens - el número promedio de tokens de entrada y salida por solicitud. Si no estás seguro, empieza con 1,000 entrada / 500 salida para chat, o 3,000 entrada / 1,000 salida para generación de código.
- Pulsa Calcular para ver tu coste mensual estimado dividido por entrada y salida.
Cómo reducir tu estimación
- Usa caché de prompts. Si tus prompts tienen un prefijo estable, las lecturas de caché pueden reducir los costes de entrada en un 50–90%. Ver caché de prompts explicada.
- Cambia de modelo por tarea. Encamina consultas simples a modelos más baratos y reserva los caros para tareas complejas. Esto es el enrutamiento de modelos.
- Usa APIs por lotes. Las cargas de trabajo no urgentes pueden usar precios por lotes con 50% de descuento.
- Prueba proveedores más baratos. MiMO y DeepSeek ofrecen tarifas significativamente más bajas para calidad comparable en muchas tareas.
Relacionado
- ¿Cuánto cuesta GPT-5? - desglose detallado de precios de GPT-5.
- ¿Cómo cobran los proveedores de LLM? - entender la facturación basada en tokens.
- La forma más barata de ejecutar generación de código con IA - comparación de costes para herramientas de codificación.
- Arbitraje de proveedores - encontrar el modelo más barato que cumple tu umbral de calidad.
¿Quieres esto aplicado a tu propio gasto en LLM? FinOps LLM ejecuta una auditoría gratuita de tus costes de IA y muestra dónde están los ahorros. Reserva auditoría gratuita →