Muchas veces el problema no es la herramienta, sino cómo la estamos usando. Cuando entras en dinámica con Claude Code, es muy fácil acabar utilizándolo para absolutamente todo, incluso para tareas que no necesitan ese nivel.
Y ahí es cuando empiezan los problemas: demasiado contexto, sesiones largas, generación innecesaria de archivos y consumo de créditos sin control.
Yo cada vez soy más partidario de trabajar con una lógica híbrida: usar Claude Code como capa premium para las tareas de más valor y apoyarme en modelos locales para todo lo que no necesita tirar siempre de la capa más cara.
Por ejemplo, una forma muy útil de plantearlo es:
- Instalar Ollama en local.
- Descargar un modelo orientado a código, por ejemplo qwen2.5-coder:7b.
- Instalar Claude Code en el equipo.
- Configurarlo para que apunte a Ollama en local, en lugar de depender siempre de la API de pago.
- Y desde ahí, decidir qué tareas van a un modelo local y cuáles sí merece la pena dejar en Claude.
Para mí, la clave está justo ahí: no usar siempre la misma capa para todo.
Más que buscar trucos o parches, se trata de diseñar mejor el flujo de trabajo:
- separar tareas en sesiones pequeñas
- reducir contexto innecesario
- elegir mejor qué modelo usar en cada caso
- y reservar la capa premium para lo que realmente aporta valor
Claude Code no es caro. Lo caro es usarlo mal.
Si a alguien le interesa, puedo dejar en comentarios la configuración y los comandos básicos para montarlo.