Modelo de costes de Claude Opus 5.5

Updated September 22, 2026 · first published September 22, 2026

Anthropic lanzó Claude Opus 5.5 (claude-opus-5-5) el 22 de septiembre de 2026. El precio anunciado es $4 por millón de tokens de entrada y $20 por millón de tokens de salida, reducido desde $5 y $25 en Opus 5. Eso es un corte del 20%. Para la mayoría de cargas de trabajo de producción el corte real es mayor, porque la tarifa que más se movió es la que el titular omite.

Las tarifas que importan

Tipo de tokenOpus 5.5Opus 5Fable 5.1
Entrada (no caché)$4.00 / MTok$5.00 / MTok$10.00 / MTok
Salida$20.00 / MTok$25.00 / MTok$50.00 / MTok
Escritura en caché (5 min)$5.00 / MTok$6.25 / MTok$12.50 / MTok
Lectura de caché$0.20 / MTok$0.50 / MTok$0.25 / MTok
Modo rápido (entrada / salida)$8 / $40

Cada fila es 20% más baja excepto la lectura de caché, que es 60% más baja. A $0.20 ahora es más barato que el $0.25 de Fable 5.1. Eso invierte la única fila donde Fable solía ganar. En nuestro modelo de costes de Fable 5.1, una carga de trabajo muy almacenada en caché podría salir más barata en Fable que en Opus 5. Contra Opus 5.5 eso ya no sucede. Fable cuesta más en cada tipo de token.

Por qué una tarea típica cuesta aproximadamente 40% menos

La afirmación de Anthropic es una caída del 40% en costes para un trabajo típico, no del 20%. Lo extra viene de la eficiencia de tokens. Anthropic dice que Opus 5.5 alcanza el mismo resultado con aproximadamente 20% menos tokens de entrada y salida y escribe aproximadamente 40% menos salida verbosa. Una tarifa más baja por menos tokens se compone: 0.8 × 0.8 = 0.64, que es aproximadamente 36–40% de descuento dependiendo de la mezcla.

Aquí está un paso del agente: 200,000 tokens de entrada, 90% servido desde caché, y 20,000 tokens de salida.

LíneaOpus 5Opus 5.5 (mismo tokens)Fable 5.1
20K entrada no caché$0.100$0.080$0.200
180K entrada caché$0.090$0.036$0.045
20K salida$0.500$0.400$1.000
Total$0.690$0.516$1.245

En tokens idénticos, Opus 5.5 es 25% más barato que Opus 5, no 20%, por el descuento de caché. Si la reducción del 20% de tokens se mantiene para tu carga de trabajo, el paso cae a aproximadamente $0.41, que es 40% por debajo de Opus 5 y un tercio del coste de Fable. La salida sigue siendo aproximadamente el 80% de la factura en este ejemplo. Ahí es donde el descuento de verbosidad paga.

Coste por tarea frente a GPT-6 Sol, GPT-6 Astra y Fable 5.1

Precios de lista por millón de tokens y el mismo paso de agente de arriba (200K de entrada, 90% en caché, 20K de salida) calculado en cada modelo.

ModeloEntrada $/MTokSalida $/MTokLectura de caché $/MTokMismo paso de agente
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Coste por tarea medido en el Artificial Analysis Intelligence Index v4.3.2, consultado el 22 de septiembre de 2026, ordenado por puntuación. GPT-6 Sol es la forma más barata de llegar a cualquier puntuación hasta 47,5. Por encima, Opus 5.5 es el más barato en todos los niveles: Opus 5.5 high puntúa 53,6 por 1,82 $, mientras que GPT-6 Astra max puntúa 52,7 por 3,26 $ y Fable 5.1 max puntúa 53,4 por 7,63 $.

ModeloIntelligence IndexCoste por tareaTokens de salida por tarea
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

Todos los ajustes de GPT-6 Astra por encima de low, todos los de Opus 5 y todos los de Fable 5.1 cuestan más que un ajuste de Sol u Opus 5.5 con la misma puntuación o mayor. El coste por tarea depende de la mezcla de tareas del benchmark. Reproduce tu propio tráfico antes de cambiar de modelo.

¿Es lo suficientemente bueno para reemplazar Fable?

Anthropic posiciona Opus 5.5 como coincidiendo con Fable 5.1 en la mayoría de tareas. Los números publicados apoyan eso para trabajo de codificación y agentivo:

Artificial Analysis lo clasificó primero en su Índice de Inteligencia el día del lanzamiento. Anthropic también dice que en nivel de esfuerzo predeterminado (medio) supera a GPT-6 Astra a máximo esfuerzo en trabajo de conocimiento por aproximadamente una quinta parte del coste por tarea. Eso es una comparación del proveedor, así que trátalo como una hipótesis a probar. Las matemáticas de costes arriba son la parte que puedes verificar tú mismo.

El modo rápido cuesta 2×

El modo rápido cuesta $8 de entrada y $40 de salida, exactamente el doble de la tarifa estándar, por hasta 2.5× la velocidad. El modelo estándar también es aproximadamente 30% más rápido que Opus 5. Usa el modo rápido para rutas interactivas vinculadas por latencia donde un usuario está esperando. Mantenlo apagado para trabajos por lotes, agentes en segundo plano y evaluaciones. Cuando el modo rápido está habilitado por defecto, el coste unitario se duplica y el panel de control no muestra nada inusual hasta que llega la factura.

Qué hacer esta semana

  1. Fija el ID del modelo. Apunta la producción a claude-opus-5-5 explícitamente y registra el ID en cada solicitud, para que el coste por solicitud pueda dividirse por modelo después de la migración.
  2. Vuelve a establecer la línea base en tu propio tráfico. Reproduce una muestra de solicitudes reales en ambos modelos y compara tokens por tarea completada, no por llamada. La afirmación de eficiencia del 20% de tokens es la parte más probable de variar por carga de trabajo.
  3. Vuelve a verificar los ajustes de esfuerzo. Si una carga de trabajo se movió a Fable o a máximo esfuerzo por calidad, prueba Opus 5.5 a nivel medio primero. Ese es el ajuste contra el que Anthropic hace puntos de referencia.
  4. Vuelve a ejecutar la decisión de enrutamiento de Fable. Cualquier ruta que envió tráfico pesado en caché a Fable para obtener la lectura de caché más barata debe ser reevaluada. Esa ventaja de coste se ha ido.
  5. Vigila la proporción de aciertos de caché. A $0.20 contra $4.00, una falta de caché ahora cuesta 20× un acierto. Un cambio de plantilla de indicativo que rompe el prefijo cuesta más que en Opus 5.

Anthropic dice que Sonnet 5.5 y Haiku 5.5 seguirán en las próximas semanas. Mantén el arnés de repetición del paso 2 para que cada lanzamiento pueda ser reestablecido en línea base en una tarde.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research