Claude Sonnet 5.5: guía de enrutamiento de modelos por costo
Actualizado September 28, 2026 · publicado originalmente September 28, 2026
Claude Sonnet 5.5 se lanzó el 28 de septiembre de 2026 con las tarifas de API de Sonnet 5: $2 por millón de tokens de entrada y $10 por millón de tokens de salida. Anthropic lo posiciona para el trabajo cotidiano bien acotado, la corrección de errores, la programación y los documentos pulidos, mientras que Opus 5.5 está pensado para trabajo más complejo que requiere criterio cuidadoso. Para los equipos, la pregunta útil no es qué modelo gana un benchmark, sino cuál cumple el objetivo de calidad y latencia de cada tarea al menor costo por resultado aceptado.
Anthropic afirma que Sonnet 5.5 es más de un 30 % más rápido que Sonnet 5 y puede costar hasta un 30 % menos por tarea. Son afirmaciones del lanzamiento. Úselas para decidir qué evaluar, no como reducciones automáticas del presupuesto.
Qué anunció Anthropic
- Sonnet 5.5 mantiene los precios de lista de API de Sonnet 5: $2/MTok de entrada, $10/MTok de salida, $2,50/MTok por escrituras de caché de 5 minutos, $4/MTok por escrituras de 1 hora y $0,20/MTok por lecturas de caché.
- Anthropic informa de una generación de salida más de un 30 % más rápida que Sonnet 5 y de hasta un 30 % menos de costo por tarea en la mayoría del trabajo gracias a la eficiencia de tokens.
- La empresa describe a Sonnet como el más fuerte en tareas cotidianas bien acotadas; Opus está diseñado para tareas complejas que requieren criterio cuidadoso.
- Anthropic dice que Haiku 5.5 llegará en las próximas semanas. No formó parte del lanzamiento de hoy.
Consulte el anuncio de lanzamiento de Anthropic para ver las descripciones completas de los benchmarks y sus salvedades.
Una política de enrutamiento para probar
| Carga de trabajo | Candidato inicial | Qué medir |
|---|---|---|
| Cambios de código rutinarios, corrección de errores, edición de documentos | Sonnet 5.5 | Tasa de cambios aceptados, reintentos, tokens de salida, tiempo transcurrido |
| Trabajo ambiguo y de largo horizonte con altos requisitos de criterio | Comparar Sonnet 5.5 con Opus 5.5 | Calidad en cada nivel de esfuerzo, frecuencia de escalado, costo de extremo a extremo |
| Clasificación o extracción simple de alto volumen | Comparar Sonnet con modelos de menor costo que ya tenga en su stack | Umbral de calidad, costo por registro válido, gestión de excepciones |
| Trabajo interactivo sensible a la latencia | Probar Sonnet 5.5 con el nivel de esfuerzo que cumpla el estándar de calidad | Latencia en la cola, tasa de finalización y costo por tarea completada |
Esta es una matriz de pruebas, no una afirmación de que un modelo sea siempre la elección correcta para una categoría de carga de trabajo. La forma del prompt, la longitud del contexto, el entorno de herramientas y los criterios de evaluación pueden cambiar el resultado.
Por qué comparar solo el precio de lista es insuficiente
El precio por token de Sonnet 5.5 no bajó en el lanzamiento. El posible ahorro está en cuántos tokens y pasos de agente necesita para completar una tarea. Un modelo que genera una respuesta más corta pero desencadena más llamadas a herramientas puede costar más en total; uno que termina antes pero usa los mismos tokens puede mejorar la capacidad de respuesta sin cambiar la factura de tokens.
Para un agente, calcule el total de una tarea como tokens de entrada × tarifa de entrada + tokens de salida × tarifa de salida + escrituras/lecturas de caché + cualquier herramienta o infraestructura facturada por separado. Compare el total solo después de confirmar que la tarea supera las mismas comprobaciones de aceptación.
Mida la migración antes de cambiar su presupuesto
- Elija unos cientos de tareas representativas, incluidos fallos y casos límite.
- Ejecute Sonnet 5 y 5.5 con las mismas herramientas, prompts, límites de contexto y niveles de esfuerzo cuando sea posible.
- Registre los cargos por tokens, reintentos, llamadas a herramientas, tiempo hasta la finalización y aceptación humana.
- Compare el costo por tarea aceptada e informe los resultados por familia de tareas, no solo como promedio global.
- Haga un canary de las cargas de trabajo que cumplan sus umbrales. Mantenga una ruta de regreso al modelo anterior mientras monitorea la calidad y el gasto.
Empiece las proyecciones con cero ahorro supuesto. Sustituya esa suposición por diferencias medidas a medida que la evaluación produzca evidencia. Para las tarifas de API y los precios de caché, use la documentación de precios de Anthropic.
FAQ
¿Es Sonnet 5.5 más barato que Sonnet 5?
Sus tarifas por token de lista son las mismas. Anthropic dice que puede costar hasta un 30 % menos por tarea porque usa menos tokens, pero los resultados dependen de la carga de trabajo.
¿Sustituye Sonnet 5.5 a Opus 5.5?
No. Anthropic presenta los modelos para perfiles de tarea distintos. Evalúe ambos cuando la dificultad de la tarea, el costo de un fallo o los requisitos de calidad justifiquen la comparación.
¿Está disponible en AWS?
AWS anunció la disponibilidad el 28 de septiembre a través de Amazon Bedrock y Claude Platform on AWS. Compruebe la región, el acceso al modelo y los detalles de precios actuales de cada servicio antes de planificar el despliegue.
Fuentes y lecturas relacionadas
- Anthropic: Introducing Claude Sonnet 5.5
- AWS: Claude Sonnet 5.5 now available on AWS
- Precios de Sonnet 5.5 y modelo de costo por tarea
- Modelo de costo de Claude Opus 5.5
Relacionado
¿Quieres aplicar esto a tu plataforma? Comparte las facturas, los registros de la pasarela y los flujos principales; identificaremos los costes y las oportunidades de ahorro. Solicitar auditoría gratuita →