Quick answer: Claude Fable 5.1 (claude-fable-5-1) cuesta 10 dólares por millón de tokens de entrada y 50 por millón de salida. Opus 5 cuesta 5 y 25. Parece una prima fija del doble, pero es un modelo equivocado: la...

Modelo de coste de Claude Fable 5.1

Updated September 1, 2026 · first published September 1, 2026

Claude Fable 5.1 (claude-fable-5-1) cuesta 10 dólares por millón de tokens de entrada y 50 por millón de salida. Opus 5 cuesta 5 y 25. Parece una prima fija del doble, pero es un modelo equivocado: la tarifa de caché va en dirección contraria.

Las cuatro tarifas que importan

La escritura en caché cuesta 12,50 dólares por millón (TTL de 5 minutos) y 20,00 (TTL de una hora). La lectura de caché cuesta 0,25 por millón: el 2,5% de su propio precio de entrada y la mitad de lo que cuesta el mismo token cacheado en Opus 5. Todas las filas son 2×; esa única fila es 0,5×.

Qué ocurre con una carga real

Un prefijo de 100.000 tokens cuesta 1,00 dólar en frío con Fable y 0,50 con Opus 5. En caliente cuesta 0,025 con Fable y 0,05 con Opus 5. El proveedor más caro pasa a ser el más barato sin cambiar el prompt. El punto de equilibrio es una tasa de acierto de caché cercana al 50%, no una preferencia de modelo.

La salida no tiene tope

El contexto llega a un millón de tokens y la salida máxima a 128.000. A 50 dólares por millón, una sola respuesta de 128K cuesta 6,40. El razonamiento extendido siempre está activo y la configuración explícita devuelve un error 400: el control de coste es el parámetro effort, de bajo a máximo. Tampoco hay Priority Tier, así que la latencia se gestiona con concurrencia propia.

Qué instrumentar antes de enrutar tráfico

Mide la tasa de acierto de caché por función (no una media de cuenta), la amplificación de escrituras de caché y los tokens de salida por tarea exitosa. Después compara con tu modelo actual mediante un puente de variación que separe tarifa, volumen y mezcla; un promedio esconde los dos movimientos opuestos.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research