¿Cuánto Cuesta GPT-5?
Actualizado 15 de julio de 2026 · publicado inicialmente el 4 de julio de 2026
GPT-5 es el modelo insignia de razonamiento de OpenAI, lanzado en 2026. Ofrece un rendimiento sustancialmente superior en tareas complejas de razonamiento, programación y multimodales respecto a GPT-4o - pero a un precio premium. Esta guía desglosa cada dimensión de coste: precios API, niveles de suscripción ChatGPT, comparación con GPT-4o y dónde alternativas más baratas como MiMO pueden ser la opción más inteligente.
Precios API de GPT-5
OpenAI factura GPT-5 por millón de tokens, con tarifas separadas para entrada, salida y entrada en caché. Las lecturas de caché son significativamente más baratas porque el modelo reutiliza un prefijo previamente calculado.
| Nivel | Entrada $/1M | Salida $/1M | Lectura Caché $/1M | Ventana de Contexto |
|---|---|---|---|---|
| GPT-5.6-Sol (máx) | $5.00 | $30.00 | $0.50 | 128K tokens |
| GPT-5.6-Terra (medio) | $2.50 | $15.00 | $0.25 | 128K tokens |
| GPT-5.6-Luna (económico) | $1.00 | $6.00 | $0.10 | 128K tokens |
| GPT-5.5 (insignia) | $5.00 | $30.00 | $0.50 | 128K tokens |
| GPT-5.4 (gama media) | $2.50 | $15.00 | $0.25 | 128K tokens |
La nueva generación de julio de 2026 de OpenAI (GPT-5.6) introduce tres niveles distintos: Sol para razonamiento de frontera, Terra para rendimiento equilibrado, y Luna para casos de uso conscientes del coste. Para comparar, los modelos más antiguos GPT-5.5 y 5.4 siguen disponibles. GPT-5.6 y 5.5 a $5/$30 son significativamente más capaces que GPT-4o ($2.50/$10), pero el coste efectivo depende de la profundidad del razonamiento y la eficiencia del caché.
Costes de suscripción ChatGPT
Si usas GPT-5 a través de la interfaz ChatGPT en lugar de la API, el precio es por suscripción:
| Plan | Precio Mensual | Acceso GPT-5 | Límites Clave |
|---|---|---|---|
| Free | $0 | Solo GPT-5 mini | Mensajes limitados/día |
| Plus | $20/mes | GPT-5 con límites | ~80 mensajes GPT-5/3hrs |
| Pro | $200/mes | GPT-5 ilimitado | Sin límites de tasa, voz, investigación profunda |
| Team | $25/usuario/mes | GPT-5 con límites altos | Herramientas admin, SSO, límites superiores |
| Enterprise | Personalizado | GPT-5 ilimitado | SLA, soporte dedicado, gobernanza de datos |
El plan Pro a $200/mes solo es rentable si eres un usuario intensivo diario. Para la mayoría de desarrolladores y equipos, la API con gestión cuidadosa de tokens es más barata que una suscripción Pro.
GPT-5 vs GPT-4o: ¿cuándo merece la pena el upgrade?
La diferencia de precio es real, así que la pregunta es si la ventaja de calidad de GPT-5 se traduce en ahorro de costes en otros aspectos:
- Usa GPT-5 cuando: la tarea requiera razonamiento multi-paso, generación compleja de código, análisis de documentos largos o flujos de trabajo agénticos donde un solo pase de alta calidad ahorra múltiples ciclos de reintento.
- Usa GPT-4o cuando: la tarea es directa - clasificación, extracción, resúmenes de textos cortos, chat simple o procesamiento por lotes de alto volumen donde el rendimiento importa más que la inteligencia por solicitud.
- Usa GPT-5 mini o nano cuando: necesitas seguimiento de instrucciones de nivel GPT-5 pero a menor coste, y puedes aceptar una profundidad de razonamiento ligeramente reducida.
Una regla práctica: si tus prompts de GPT-4o incluyen instrucciones de cadena de pensamiento o bucles de corrección multi-turno, GPT-5 puede ser realmente más barato porque realiza ese razonamiento de forma nativa en una sola llamada.
Cómo reducir los costes de GPT-5
Varias estrategias pueden reducir tu factura de GPT-5 en un 30–70% sin sacrificar la calidad de salida:
- Aprovecha el caché de prompts. La tasa de lectura de caché de GPT-5 ($2.50/1M) es un 75% más barata que la tasa de entrada completa. Estructura tus prompts con un prefijo estable (instrucciones del sistema, contexto) y un sufijo variable (consulta del usuario) para maximizar los aciertos de caché.
- Usa GPT-5 mini/nano para enrutamiento. Ejecuta un modelo ligero primero para clasificar la intención, luego escala a GPT-5 completo solo para consultas complejas. Este es el patrón de enrutamiento de modelos.
- API por lotes para trabajo no interactivo. La API por lotes de OpenAI ofrece descuentos del 50% en cargas de trabajo asíncronas - ideal para evaluación, enriquecimiento y generación de informes.
- Ajusta las ventanas de contexto. No envíes 100K tokens de contexto cuando 5K son suficientes. Cada token de entrada innecesario cuesta 4× más en GPT-5 que en GPT-4o.
- Considera alternativas. Para muchas tareas de programación y razonamiento, modelos como MiMO, DeepSeek R1 o Claude Sonnet ofrecen calidad comparable a una fracción del coste. Usa arbitraje de proveedores para comparar.
Costes ocultos más allá del precio nominal
La tarifa por token es solo parte del panorama. Presupuesta estos factores adicionales:
- Tokens de razonamiento. GPT-5 usa tokens de razonamiento internos para tareas complejas. Se facturan a la tasa de salida ($30/1M) y pueden multiplicar tu volumen efectivo de salida por 2–5× en problemas difíciles.
- Costes de reintento. Si tus prompts son ambiguos o tu análisis sintáctico es frágil, los intentos fallidos aún consumen tokens. Una ingeniería de prompts robusta se paga por sí misma.
- Gasto en evaluación. Las pruebas y benchmarks durante el desarrollo pueden fácilmente exceder el gasto en producción si no se rastrean por separado. Ver asignación de costes de evaluación.
Conclusión
GPT-5 es caro pero no uniformemente. A $10/$30 por millón de tokens, una llamada API típica con 1,000 tokens de entrada y 500 de salida cuesta aproximadamente $0.025. Para aplicaciones de alto volumen, la factura se acumula rápido - pero el caché inteligente, el enrutamiento y el procesamiento por lotes pueden reducir los costes a la mitad o más. Rastrea cada solicitud, atribuye el gasto a las características y compara alternativas regularmente.
Relacionado
- ¿Cómo cobran los proveedores de LLM? - los modelos de precios detrás de los números.
- Enrutamiento de modelos - enviar la solicitud correcta al modelo correcto.
- Arbitraje de proveedores - encontrar el modelo más barato que cumple tu umbral de calidad.
- Caché de prompts explicada - cómo conseguir aciertos de caché reales.
¿Quieres esto aplicado a tu propio gasto en LLM? FinOps LLM ejecuta una auditoría gratuita de tus costes de IA y muestra dónde están los ahorros. Reserva auditoría gratuita →