Cómo revisar y reducir el uso de tokens de Claude Code
Actualizado September 27, 2026 · publicado originalmente September 27, 2026
Ejecuta /usage para ver cuánto gasta Claude Code y /context para ver qué está llenando la ventana. Para gastar menos, mantén el contexto pequeño: limpia entre tareas, baja el nivel de esfuerzo y deja la salida extensa fuera de la conversación principal. El contexto importa más que cualquier otra cosa porque Claude Code reenvía toda la conversación con cada solicitud. En nuestros propios registros, el 96% de los tokens fueron el agente releyendo su contexto.
Esta página cubre los comandos que muestran tu uso, los ajustes que más lo mueven y adónde van realmente los tokens. Los consejos provienen de la documentación de costos de Anthropic. Las cifras provienen de nuestros propios registros de Claude Code y de benchmarks publicados.
¿Cómo reviso el uso de tokens de Claude Code?
/usage: muestra el conteo de tokens y un costo estimado de la sesión actual, una línea sobre la caché de prompts y, en los planes Pro, Max, Team y Enterprise, tus barras de uso del plan. También desglosa qué consume tu plan: skills, subagentes, plugins, servidores MCP y bucles programados, en las últimas 24 horas o 7 días./context: muestra qué ocupa ahora mismo la ventana de contexto, con sugerencias sobre qué recortar./insights: genera un informe HTML sobre tus sesiones recientes y dónde pierdes tiempo y tokens.- La línea de estado: un script puede mostrar el costo, el contexto usado y los porcentajes de tu plan de 5 horas y de 7 días en cada prompt. Consulta la documentación de la línea de estado.
- claude.ai Settings > Usage: límites del plan y gasto de créditos de uso, incluido el uso desde otros dispositivos.
En un plan Pro o Max, la cifra en dólares de /usage es lo que habría costado la sesión a precios de lista de la API, no lo que pagas. Aun así es la mejor medida única de lo pesada que es una sesión.
¿Adónde van realmente los tokens de Claude Code?
Sobre todo a releer contexto. Cada solicitud lleva la conversación completa, y cada llamada a una herramienta envía otra solicitud con los resultados. En nuestros registros de Claude Code, 7,0 mil millones de tokens de lectura de caché fueron el 96% de todos los tokens y la mitad de una factura equivalente en API de $6,986. Los tokens de salida, la parte que ves, fueron menos del 1% del volumen.
Por eso una pregunta de una línea en una sesión abierta todo el día no es barata. Arrastra el día entero. Nuestra página de tokens por plan tiene el desglose completo: unos 1,9 mil millones de tokens en una semana de Max 20x y unos 39 millones en una sesión de Max 5x.
¿Cómo reduzco el uso de tokens de Claude Code?
Estos son los cambios que más mueven el uso, en orden aproximado de efecto.
- Limpia entre tareas no relacionadas.
/clearinicia un contexto nuevo y no cuesta nada. Usa antes/renamesi quieres hacer/resumede la sesión anterior más tarde. - Baja el nivel de esfuerzo. En Opus 5.5, una tarea costó $5.98 con esfuerzo máximo y $1.34 con esfuerzo medio en las ejecuciones de Artificial Analysis, una diferencia de 4,5x por un solo ajuste. Usa
/effortpara cambiarlo. Detalles en nuestra página del costo por nivel de esfuerzo. - Ajusta el modelo al trabajo. Anthropic recomienda Sonnet para la mayoría del código y Opus para el trabajo arquitectónico difícil o de varios pasos. Cambia con
/modely configuramodel: haikuen los subagentes sencillos. - No hagas pausas largas a mitad de sesión. La caché de prompts dura una hora en una suscripción y cinco minutos con créditos de uso o una clave de API. Volver después de que caduque reprocesa todo tu contexto a precio completo.
- Mantén la salida ruidosa fuera del contexto principal. Envía las ejecuciones de pruebas, la lectura de registros y la obtención de documentación a subagentes para que solo vuelva un resumen. Un hook puede filtrar un registro de 10,000 líneas hasta dejar solo las líneas de error antes de que Claude lo vea.
- Recorta lo que se carga al inicio. Mantén CLAUDE.md por debajo de unas 200 líneas y mueve las instrucciones propias de un flujo de trabajo a skills, que se cargan solo cuando se usan. Desactiva los servidores MCP que no uses con
/mcp. Prefiere herramientas de CLI comoghcuando existan. - Escribe prompts específicos y planifica primero. «Mejora este código» hace que Claude escanee todo. El modo plan (Shift+Tab) detecta un enfoque equivocado antes de que cueste una implementación completa.
- Vigila el trabajo en segundo plano. Los bucles programados, los compañeros de equipo de agentes y los subagentes inactivos siguen enviando todo tu contexto. Los equipos de agentes usan unas 7x los tokens de una sesión normal cuando los compañeros funcionan en modo plan.
¿Ahorra tokens /compact?
Solo en las solicitudes posteriores, y compactar un contexto grande es en sí una solicitud grande. /compact lee toda la conversación para resumirla. Si no necesitas el historial, /clear es más barato. Si lo necesitas, /compact con instrucciones (por ejemplo /compact keep the API changes and failing tests) conserva lo que importa. También puedes fijar un umbral de autocompactación más temprano con /autocompact.
¿Cuánto cuesta Claude Code por desarrollador?
Anthropic indica unos $13 por desarrollador por día activo y de $150 a $250 al mes en despliegues empresariales, y menos de $30 al día para el 90% de los usuarios. Eso se factura a tarifas de API. En una suscripción, la pregunta pasa a ser los límites de qué plan alcanzas primero. Nuestra página del límite semanal de Claude Max valora una semana de Max 20x en unos $1.86k de uso equivalente en API.
¿Cómo siguen los equipos el uso de Claude Code?
- Planes Team y Enterprise: el informe de gasto en la analítica de la organización, con un CSV por usuario. Enterprise también tiene una API de analítica. Los límites de gasto se configuran en los ajustes de administración.
- API (Claude Console): la página de uso de la Console y los límites de gasto por workspace.
- Cualquier configuración: define
CLAUDE_CODE_ENABLE_TELEMETRY=1para exportar métricas de tokens y costo por usuario mediante OpenTelemetry a tu propio stack. Consulta la documentación de monitoreo.
Si pagas tarifas contratadas, el ajuste administrado modelPricing hace que las cifras de costo de /usage y de OpenTelemetry coincidan con tu contrato en lugar de con el precio de lista.
Fuentes
- Claude Code docs: Manage costs effectively
- Claude Code docs: Status line
- Claude Code docs: Monitoring usage
- Artificial Analysis: model benchmarks and cost per task
Relacionado
- Cuántos tokens te dan Claude Pro y Max
- Los niveles de esfuerzo de Opus 5.5 son el precio real
- Claude Max 20x vs 5x: el límite semanal, medido
¿Quieres aplicar esto a tu plataforma? Comparte las facturas, los registros de la pasarela y los flujos principales; identificaremos los costes y las oportunidades de ahorro. Solicitar auditoría gratuita →