El blog de Deska
Claude Code: Cómo reducir el consumo de tokens un 40% con mejores prácticas de contexto
Aprende estrategias de optimización del uso de tokens en Claude Code para reducir costos de API manteniendo la calidad en la generación de código y terminal.
· 10 min de lectura
La optimización del uso de tokens en Claude Code se está convirtiendo en una habilidad crítica para los desarrolladores que desean aprovechar los agentes de IA de alto rendimiento sin incurrir en facturas masivas de API. Al ser una herramienta basada en la terminal que interactúa directamente con tu sistema de archivos y entorno de ejecución, Claude Code puede consumir tokens rápidamente al ingerir grandes cantidades de contexto de archivos o salida de terminal. Al refinar cómo proporcionas el contexto y cómo estructuras tu espacio de trabajo, puedes reducir significativamente los gastos generales mientras mejoras la precisión de las respuestas del agente.
Entendiendo el costo de tokens del contexto
Cada vez que inicias un comando en una herramienta como Claude Code, el sistema evalúa el estado de tu proyecto para proporcionar una respuesta relevante. Este proceso implica enviar el contenido de los archivos, el historial de comandos recientes y las estructuras de directorios al modelo. Si estás trabajando en un monorepo grande o en un proyecto con muchos archivos de registro extensos, el comportamiento por defecto podría incluir miles de tokens innecesarios en cada turno de la conversación.
Los principales factores de costo en los agentes basados en CLI incluyen:
- Listados de directorios recursivos que exploran carpetas anidadas profundamente.
- Artefactos de compilación grandes o carpetas de dependencias como
node_modulesque no están ignoradas. - Salidas de terminal largas de ejecutores de pruebas o registros de compilación que se envían de vuelta al LLM.
- Contexto histórico excesivo de sesiones de larga duración.
Para mitigar esto, debes ser intencional con lo que el agente ve. En lugar de dejar que el agente explore libremente, deberías usar banderas específicas o archivos de proyecto estructurados para limitar el alcance de la búsqueda.
Estrategias para reducir los tokens de entrada
La forma más efectiva de lograr la optimización del uso de tokens en Claude Code es podar la entrada antes de que llegue a la API. La mayoría de los usuarios olvidan que el LLM presta atención a todo lo que está en el búfer actual.
Usa archivos de ignorar agresivamente
Al igual que usas .gitignore para mantener tu repositorio limpio, debes asegurarte de que Claude Code no esté leyendo archivos binarios, conjuntos de datos grandes o mapas de fuentes. Revisa tu configuración para ver si puedes excluir rutas específicas que el agente nunca necesita tocar. Esto evita que la herramienta indexe archivos que no contribuyen en nada a la generación de código pero añaden significativamente al tamaño del prompt.
Inyección de archivos específica
En lugar de hacer una pregunta general que obligue al agente a buscar en todo tu proyecto, identifica los archivos específicos relevantes para tu tarea. Mencionar explícitamente los archivos en tu prompt ayuda al agente a enfocarse. Si sabes que el error está en auth.ts, comienza tu sesión haciendo referencia solo a ese archivo. Esto limita el uso de la ventana de contexto y asegura que el modelo no se distraiga con lógica no relacionada en otros módulos.
Gestión de sesiones
Las sesiones largas acumulan tokens de forma natural. Cada nuevo mensaje incluye el historial de los mensajes anteriores para mantener el contexto. Para tareas distintas, a menudo es más económico comenzar una nueva sesión. Si has terminado de refactorizar un componente y ahora quieres trabajar en el CSS, cerrar el hilo actual y comenzar uno nuevo borrará los fragmentos de código anteriores del contexto activo, ahorrando miles de tokens a lo largo del día.
Usando Deska para la visibilidad del contexto
Al usar Claude Code, la visibilidad de lo que el agente está haciendo puede ayudarte a detectar el desperdicio de tokens. Deska proporciona un entorno donde puedes ejecutar Claude Code junto con otras herramientas en un espacio de trabajo unificado. Al colocar tu terminal en un panel y tu explorador de archivos o notas en otro, puedes coordinar mejor qué información estás alimentando al agente.
En Deska, el canvas te permite organizar múltiples agentes de codificación uno al lado del otro. Puedes tener una terminal ejecutando Claude Code con un filtro de contexto estricto, mientras otro panel muestra la documentación o el editor de código. Esta organización espacial te ayuda a realizar un seguimiento de qué archivos están actualmente activos en la memoria del agente.
La función Ask Deska también puede ayudar a manejar el espacio de trabajo sin quemar tokens en tu sesión principal de Claude Code. Puedes pedirle al asistente que abra terminales específicos o busque archivos, permitiéndote preparar el entorno antes de iniciar la costosa sesión del agente CLI.
Ingeniería de prompts efectiva para agentes CLI
La forma en que frases tus instrucciones determina cuánto pensamiento hace el modelo y cuánto código genera.
- Sé específico sobre el formato de salida. Pedir solo las líneas cambiadas en lugar de todo el archivo puede ahorrar tokens de salida.
- Usa pasos incrementales. En lugar de pedir una funcionalidad completa, pide primero la definición de la interfaz.
- Limita la profundidad de búsqueda. Cuando le pidas al agente que encuentre algo, especifica un directorio en lugar de la raíz.
Comparación técnica de enfoques de espacio de trabajo
Diferentes herramientas manejan el contexto de varias maneras. Las extensiones de IDE tradicionales a menudo indexan todo el proyecto en segundo plano, lo que podría generar costos ocultos si la lógica de indexación no es eficiente. Las herramientas CLI como Claude Code te dan un control más directo pero requieren más supervisión manual para mantener los costos bajos.
| Característica | Agentes CLI (Manual) | Extensiones IDE | Espacio de Trabajo Deska |
|---|---|---|---|
| Control de Contexto | Alto | Bajo | Alto |
| Supervisión Visual | Mínima | Moderada | Alta |
| Aislamiento de Sesión | Manual | Automático | Basado en Paneles |
| Uso Multi-Agente | Secuencial | Limitado | Lado a Lado |
Deska sigue un enfoque local-first donde tus archivos y sesiones permanecen en tu máquina. Esto significa que la sobrecarga de gestionar estos archivos no se suma a tus costos de la nube. Puedes gestionar tus datos y almacenamiento localmente y solo enviar lo necesario al proveedor de la API.
FAQ para la optimización de tokens
¿Cómo reviso mi consumo actual de tokens en Claude Code?
La mayoría de las herramientas CLI proporcionan un resumen al final de una sesión o mediante un comando específico. También debes monitorear tu panel de Anthropic para ver los datos de facturación en tiempo real. Integrar esta revisión en tu flujo de trabajo cada pocas horas ayuda a prevenir facturas sorpresa.
¿Puedo limitar el número de archivos que lee Claude Code?
Sí, puedes usar banderas específicas durante el inicio o crear un archivo de configuración que defina el alcance del agente. Restringir al agente a subdirectorios específicos es la forma más efectiva de asegurar que no ingiera todo tu código base.
¿El uso de una interfaz gráfica como Deska aumenta el consumo de tokens?
No, Deska es un espacio de trabajo que aloja las herramientas que ya usas. No añade tokens extra a tus sesiones de Claude Code. De hecho, al usar el cuaderno de notas para redactar tus prompts antes de enviarlos, puedes refinar tus instrucciones para que sean más eficientes en el uso de tokens.
Comienza con una codificación eficiente
Reducir tus costos de API no significa sacrificar el poder de la IA. Al ser consciente de tu contexto y usar un espacio de trabajo diseñado para la visibilidad, puedes mantener una alta velocidad a una fracción del costo.
Puedes descargar la aplicación Deska para Mac, Windows y Linux para comenzar a organizar tus agentes de IA de manera más efectiva. Ya sea que estés usando la aplicación móvil para monitorear tus compilaciones largas o gestionando tus claves de API para un nivel de por vida, tener un espacio de trabajo dedicado es el primer paso hacia una integración profesional de la IA.