Saltar al contenido

Análisis de costes de un agente de larga duración con Opus 5.5

Actualizado September 27, 2026 · publicado originalmente September 27, 2026

Una demo mostró a Opus 5.5 trabajando de forma autónoma durante ~25 horas para construir un clon completo de Minecraft: ~100K líneas de código del juego, 26K líneas de tests, 1,000 tests automatizados, 775 archivos, 783 imágenes generadas, 184 sonidos generados y una guía dentro del juego. Es el primer vistazo público a un agente de programación de largo horizonte a escala. Vamos a modelar el coste.

Estimación del volumen de tokens

No hay recuentos oficiales de tokens. Lo modelaremos a partir de los artefactos de salida:

ArtefactoTokens est.Notas
100K líneas de código del juego~3M de salida~30 tokens/línea de media
26K líneas de tests~0.8M de salida~30 tokens/línea
775 archivos (estructura, configuración)~0.5M de salidaCódigo repetitivo + imports
783 imágenes (prompts + metadatos)~1.5M de entrada~2K tokens/prompt de imagen
184 sonidos (prompts + metadatos)~0.4M de entrada~2K tokens/prompt de sonido
Guía dentro del juego / documentación~0.3M de salidaMarkdown + fragmentos de código
Contexto / razonamiento (25 h)~10M de entradaLlamadas a herramientas, observaciones, planificación
Estimación total~12.4M de entrada / ~4.6M de salida

Coste con los precios de Opus 5.5

Tipo de tokenVolumenTarifaCoste
Entrada (sin caché, est. 30%)3.7M$4.00/MTok$14.80
Entrada (en caché, est. 70%)8.7M$0.20/MTok$1.74
Salida4.6M$20.00/MTok$92.00
Total~$108.54

~$109 por una ejecución autónoma de agente de 25 horas que produce un juego listo para publicar. Son ~$4.36/hora de cómputo del agente.

Sensibilidad: la tasa de aciertos de caché es lo que más pesa

Tasa de aciertos de cachéCoste de entradaCoste totalCoste/hora
50%$24.80$131.60$5.26
70% (base)$16.54$108.54$4.34
90%$8.88$92.88$3.72

Con un 90% de aciertos de caché (alcanzable con una buena gestión del contexto), la ejecución baja a $93 en total / $3.72/h.

Comparación: un desarrollador humano

Un desarrollador sénior construyendo esto en solitario: 3-6 semanas (~120-240 horas) a $100-200/h = $12K-$48K. La ejecución del agente, a $109, es 100-400x más barata, pero solo si la calidad del resultado supera tu barrera de lanzamiento.

Qué significa esto para el presupuesto de tus agentes

  1. Los agentes de largo horizonte son asequibles. Menos de $150 por una construcción compleja de 25 horas cambia el cálculo del ROI de los flujos de trabajo centrados en agentes.
  2. La caché es la palanca. Invierte en infraestructura de prompt caching: cada mejora de 10% en la tasa de aciertos de caché ahorra ~$1.60 en una ejecución como esta.
  3. Los tokens de salida dominan. A $20/MTok, la salida es el 85% de la factura. Los modelos más concisos (Anthropic afirma que un 40% menos verbosos) recortan el coste directamente.
  4. Monitoriza por ejecución, no por mes. Las cargas de trabajo de agentes son irregulares. Sigue el coste por tarea completada, no el gasto mensual agregado.

Lecturas relacionadas

Consulta el modelo de costes de Claude Opus 5.5, la economía de los agentes, la economía del prompt caching y el coste por tarea exitosa.

Relacionado


¿Quieres aplicar esto a tu plataforma? Comparte las facturas, los registros de la pasarela y los flujos principales; identificaremos los costes y las oportunidades de ahorro. Solicitar auditoría gratuita →

Volver a finopsllm.com