Guía corta para gastar menos tokens

El coste sube con el tamaño del contexto que Claude procesa en cada mensaje. Mantén ese contexto pequeño y bien elegido, y el gasto baja solo.

Qué modelo para qué tarea

Qué no cargar en el contexto

Limpiar skills y conectores

Repartir trabajo entre agentes

Fuentes: code.claude.com/docs — «Manage costs effectively» (sección Reduce token usage), «Model configuration», «Skills».

No hace falta aplicar las cuatro cosas a la vez. Yo empiezo por /clear entre tareas y por no dejar Opus puesto por defecto para todo: con eso solo ya se nota.