Análisis de costes de un agente de larga duración con Opus 5.5
Actualizado September 27, 2026 · publicado originalmente September 27, 2026
Una demo mostró a Opus 5.5 trabajando de forma autónoma durante ~25 horas para construir un clon completo de Minecraft: ~100K líneas de código del juego, 26K líneas de tests, 1,000 tests automatizados, 775 archivos, 783 imágenes generadas, 184 sonidos generados y una guía dentro del juego. Es el primer vistazo público a un agente de programación de largo horizonte a escala. Vamos a modelar el coste.
Estimación del volumen de tokens
No hay recuentos oficiales de tokens. Lo modelaremos a partir de los artefactos de salida:
| Artefacto | Tokens est. | Notas |
|---|---|---|
| 100K líneas de código del juego | ~3M de salida | ~30 tokens/línea de media |
| 26K líneas de tests | ~0.8M de salida | ~30 tokens/línea |
| 775 archivos (estructura, configuración) | ~0.5M de salida | Código repetitivo + imports |
| 783 imágenes (prompts + metadatos) | ~1.5M de entrada | ~2K tokens/prompt de imagen |
| 184 sonidos (prompts + metadatos) | ~0.4M de entrada | ~2K tokens/prompt de sonido |
| Guía dentro del juego / documentación | ~0.3M de salida | Markdown + fragmentos de código |
| Contexto / razonamiento (25 h) | ~10M de entrada | Llamadas a herramientas, observaciones, planificación |
| Estimación total | ~12.4M de entrada / ~4.6M de salida |
Coste con los precios de Opus 5.5
| Tipo de token | Volumen | Tarifa | Coste |
|---|---|---|---|
| Entrada (sin caché, est. 30%) | 3.7M | $4.00/MTok | $14.80 |
| Entrada (en caché, est. 70%) | 8.7M | $0.20/MTok | $1.74 |
| Salida | 4.6M | $20.00/MTok | $92.00 |
| Total | ~$108.54 |
~$109 por una ejecución autónoma de agente de 25 horas que produce un juego listo para publicar. Son ~$4.36/hora de cómputo del agente.
Sensibilidad: la tasa de aciertos de caché es lo que más pesa
| Tasa de aciertos de caché | Coste de entrada | Coste total | Coste/hora |
|---|---|---|---|
| 50% | $24.80 | $131.60 | $5.26 |
| 70% (base) | $16.54 | $108.54 | $4.34 |
| 90% | $8.88 | $92.88 | $3.72 |
Con un 90% de aciertos de caché (alcanzable con una buena gestión del contexto), la ejecución baja a $93 en total / $3.72/h.
Comparación: un desarrollador humano
Un desarrollador sénior construyendo esto en solitario: 3-6 semanas (~120-240 horas) a $100-200/h = $12K-$48K. La ejecución del agente, a $109, es 100-400x más barata, pero solo si la calidad del resultado supera tu barrera de lanzamiento.
Qué significa esto para el presupuesto de tus agentes
- Los agentes de largo horizonte son asequibles. Menos de $150 por una construcción compleja de 25 horas cambia el cálculo del ROI de los flujos de trabajo centrados en agentes.
- La caché es la palanca. Invierte en infraestructura de prompt caching: cada mejora de 10% en la tasa de aciertos de caché ahorra ~$1.60 en una ejecución como esta.
- Los tokens de salida dominan. A $20/MTok, la salida es el 85% de la factura. Los modelos más concisos (Anthropic afirma que un 40% menos verbosos) recortan el coste directamente.
- Monitoriza por ejecución, no por mes. Las cargas de trabajo de agentes son irregulares. Sigue el coste por tarea completada, no el gasto mensual agregado.
Lecturas relacionadas
Consulta el modelo de costes de Claude Opus 5.5, la economía de los agentes, la economía del prompt caching y el coste por tarea exitosa.
Relacionado
- Modelo de costes de Claude Opus 5.5
- Economía de los agentes
- Economía del prompt caching
- Coste por tarea exitosa
¿Quieres aplicar esto a tu plataforma? Comparte las facturas, los registros de la pasarela y los flujos principales; identificaremos los costes y las oportunidades de ahorro. Solicitar auditoría gratuita →