Saltar al contenido

Precio de Claude Sonnet 5.5: qué cambia y qué no

Actualizado September 28, 2026 · publicado originalmente September 27, 2026

Claude Sonnet 5.5 cuesta $2 por millón de tokens de entrada y $10 por millón de tokens de salida en la API de Anthropic, el mismo precio de lista que Sonnet 5. El cambio económico es la eficiencia: Anthropic afirma que Sonnet 5.5 puede costar hasta un 30% menos por tarea porque usa menos tokens, y que genera la salida más de un 30% más rápido. Es un máximo comunicado por el proveedor, no un descuento garantizado en todas las cargas de trabajo.

Para una previsión presupuestaria, mantén fijas las tarifas por token y modela por separado la posible reducción de tokens y de pasos del agente. Mide tu propia mezcla de tareas antes de aplicar cualquier supuesto de ahorro.

Precios de la API de Sonnet 5.5

Tipo de tokenPrecio por millón
Entrada$2.00
Salida$10.00
Escritura de caché de 5 minutos$2.50
Escritura de caché de 1 hora$4.00
Lectura de caché$0.20

Anthropic publica estas tarifas en su anuncio de lanzamiento de Sonnet 5.5. No interpretes «hasta un 30% menos por tarea» como una reducción del 30% en las tarifas por token: los precios de entrada y salida no cambian respecto a Sonnet 5. El precio de $2/$10 de Sonnet 5 es además el estándar ahora, después de que Anthropic cancelara la subida que tenía prevista para septiembre.

Ejemplo: eficiencia de tokens frente a cambios de tarifa

Imagina una tarea que usa 100,000 tokens de entrada y 10,000 de salida, sin caché. Con las tarifas publicadas de Sonnet 5.5, son $0.20 de entrada más $0.10 de salida, es decir, $0.30 por tarea. Si la misma tarea usara un 30% menos de tokens en ambas categorías, su coste modelado sería de $0.21. Es una ilustración de la aritmética, no una promesa de que todas las tareas usarán un 30% menos de tokens.

Para una carga de 10,000 tareas de este tipo al mes, la base es de $3,000. Una reducción del 30% en el volumen de tokens ahorraría $900 y dejaría la factura mensual modelada en $2,100. Los resultados reales varían según la longitud del prompt, la reutilización de caché, la longitud de la salida, el esfuerzo de razonamiento, los reintentos y las llamadas a herramientas.

Qué muestran y qué no muestran los benchmarks del lanzamiento

Anthropic informa de mejoras en sus evaluaciones de programación y trabajo del conocimiento, incluidas Terminal-Bench 4.0 y CursorBench. La compañía también indica que Sonnet 5.5 genera salida más de un 30% más rápido que Sonnet 5 y que, en varias comparativas, alcanza las puntuaciones anteriores de Sonnet 5 a una fracción del coste por tarea. Esos resultados son buenas hipótesis para un plan de evaluación, pero son mediciones publicadas por el proveedor, no datos independientes de coste en producción.

Una advertencia práctica: un modelo más rápido no reduce automáticamente una factura de API medida por tokens. La factura baja cuando baja el uso por tarea completada, o cuando menos tareas necesitan reintentos o escalado. La generación más rápida puede, en cambio, mejorar el rendimiento o reducir la latencia sin cambiar el gasto en tokens.

Una forma segura de prever la adopción

  1. Mantén constante la tarifa. Usa $2/$10 por millón de tokens de entrada/salida como punto de partida para Sonnet 5 y 5.5.
  2. Mide el trabajo completado. Compara el coste por tarea aceptada, no solo los tokens por solicitud. Incluye reintentos, llamadas a herramientas y retrabajo humano cuando puedas.
  3. Divide por carga de trabajo. Evalúa por separado programación, soporte, extracción y tareas de contexto largo; una única tasa de ahorro combinada puede ocultar regresiones.
  4. Usa un rango. Presupuesta con un 0% de ahorro hasta que las pruebas internas aporten evidencia y después añade escenarios medidos. Trata el «hasta un 30%» de Anthropic como una afirmación de límite superior, no como tu previsión.
  5. Vuelve a comprobar calidad y latencia. Una factura de tokens menor no es un ahorro si baja la tasa de aceptación o se necesitan modelos de respaldo más caros.

Preguntas frecuentes

¿Sonnet 5.5 es más barato por token?

No. Anthropic indica las mismas tarifas que Sonnet 5: $2 de entrada y $10 de salida por millón de tokens. Su afirmación de coste por tarea se debe a que usa menos tokens para hacer un trabajo comparable.

¿Está garantizado el ahorro del 30%?

No. Anthropic describe reducciones de coste de hasta el 30% para la mayoría del trabajo en sus materiales de lanzamiento. Tu resultado depende de la carga de trabajo, el prompt caching, los ajustes de esfuerzo y la calidad de finalización de las tareas.

¿Cuánto cuesta una solicitud con caché?

Anthropic indica lecturas de caché a $0.20 por millón de tokens, escrituras de 5 minutos a $2.50 y escrituras de 1 hora a $4.00. Consulta la documentación de precios de la API de Claude vigente antes de comprometer una previsión.

¿Debemos pasar el tráfico de producción de inmediato?

Primero ejecuta una evaluación representativa. Prueba el modelo en sombra o en canary, compara el coste por resultado aceptado y la latencia, y mantén una ruta de reversión para las cargas que empeoren.

Fuentes y lecturas relacionadas

Relacionado


¿Quieres aplicar esto a tu plataforma? Comparte las facturas, los registros de la pasarela y los flujos principales; identificaremos los costes y las oportunidades de ahorro. Solicitar auditoría gratuita →

Volver a finopsllm.com