
Claude Code es una de las herramientas más útiles para programar; sin embargo, en ciertas condiciones puede consumir tokens sin control. Si has usado la IA en desarrollo de software, seguramente te ha pasado que de repente se pone lenta y los agentes no responden con la misma rapidez de un comienzo. Esto se debe a un problema en cómo lee y procesa el código, aunque existe un truco que te ayudará a reducir el consumo de tokens y agilizar tus sesiones.
De acuerdo con Hacker Noon, un usuario detectó que Claude Code estaba llenando su contexto con resultados de búsqueda y lecturas de archivos que no necesitaba. Este comportamiento provocaba que el consumo de tokens se disparara, afectando la experiencia de uso. En unas cuantas sesiones, los límites de uso se agotaban sin que pudiera hacer algo para evitarlos.
Lo anterior lo motivó a revisar los registros de uso, en donde descubrió que el problema se debía a una acumulación de contexto innecesario. Según la publicación, el agente ejecutaba comandos grep sin límites, volcando miles de líneas de resultados en el chat. En otros casos, la IA usaba la herramienta Read para cargar archivos de hasta 2.000 líneas solamente para modificar una función aislada.

El detalle con Claude Code y otras herramientas de IA es que los modelos de lenguaje reenvían todo el historial de la conversación en cada turno. En caso de que hayas cometido un error en un mensaje anterior, esto se paga varias veces en los turnos posteriores, lo que termina multiplicando el coste de cada sesión.
El script de Claude Code que puede reducir el consumo de tokens de forma brutal
El autor probó añadir reglas a un archivo CLAUDE.md global, pidiendo al agente que limitara sus consultas. El problema es que esto no funciona en sesiones largas, puesto que los modelos tienden a perder esas indicaciones y vuelven a sus malos hábitos. De ahí que varios expertos recomienden iniciar una sesión de cero para evitar que la IA pierda el hilo o no siga instrucciones.
Tras varios intentos, el usuario construyó un plugin para Claude Code que actúa como filtro previo. Este script revisa los comandos que el agente ejecutará antes de que se lleven a cabo. En caso de que detecte un comando problemático, reescribirá la sintaxis correcta y se la entrega al modelo como una sugerencia automática, evitando caer en un ciclo de prueba y error que consumiría tokens de forma innecesaria.

El script, conocido como enforce-limits.sh, se encarga de gestionar tanto los volcados de grep como las lecturas de archivos extensos. Este se integra dentro de un plugin mediante un archivo de manifiesto JSON, que le permite aplicar las mismas reglas en cualquier proyecto en el que se use Claude Code.
Según las primeras pruebas, este script reduce entre un 75% y un 80% el consumo de tokens cuando se aplica en tareas de edición intensiva. El agente responde rápido y puede ajustarse al turno siguiente sin necesidad de repetir intentos fallidos. La IA ya no tiene que procesar esos bloques gigantescos de resultados del Terminal, por lo que las respuestas del agente serán más rápidas.
Anthropic ya optimizó el funcionamiento de Claude
Como complemento a este script, Anthropic confirmó recientemente que ya optimizaron el funcionamiento de Claude Code. En una publicación de su web, la compañía afirma que eliminó más del 80% del system prompt original sin alterar los resultados a la hora de programar. La compañía señala que los modelos actuales tienen mejor criterio propio y ya no requieren reglas explícitas para que funcionen de forma eficiente.
Seguir leyendo: Este simple truco está salvando a los usuarios de Claude Code de quedarse sin tokens