Usar un LLM local como subagente de código de Claude para reducir el uso de contexto

✍️ OpenClawRadar📅 Publicado: 2 de marzo de 2026🔗 Source
Usar un LLM local como subagente de código de Claude para reducir el uso de contexto
Ad

Un desarrollador en r/LocalLLaMA demuestra cómo usar Claude Code para delegar tareas a un LLM local que se ejecuta mediante LM Studio, reduciendo el uso del contexto de Claude al mantener el contenido de los archivos localmente.

Cómo funciona

El sistema utiliza un pequeño script de Python (~120 líneas, solo biblioteca estándar) que ejecuta un bucle de agente:

  • Le pasas a Claude una descripción de la tarea sin el contenido del archivo
  • El script lo envía al endpoint /v1/chat/completions de LM Studio con definiciones de herramientas read_file y list_dir
  • El modelo local llama a esas herramientas por sí mismo para leer los archivos que necesita
  • El bucle continúa hasta que produce una respuesta final
  • Claude solo ve el resultado, no el contenido del archivo

Ejemplo de uso

python3 agent_lm.py --dir /ruta/al/proyecto "resumir solar-system.html"
# [turno 1] → read_file({'path': 'solar-system.html'})
# [turno 2] → Este archivo HTML crea un sistema solar animado interactivo...

El contenido del archivo va al contexto del modelo local (probado con Qwen3.5 35B 4-bit mediante MLX en Apple Silicon), no al de Claude.

Para qué sirve

  • Resumen y explicación de código
  • Búsqueda de errores
  • Generación de plantillas / primeros borradores
  • Transformación y traducción de texto (probado con hebreo)
  • Tareas de lógica y razonamiento (usa la bandera --think para problemas más difíciles)
Ad

Para qué no sirve

  • Tareas que requieren el contexto completo de Claude, como la comprensión de múltiples archivos donde importan las relaciones
  • Tareas que necesitan el historial de conversación actual
  • Cualquier cosa donde la precisión sea crítica

El autor lo describe como "un asistente de nivel Haiku, no un reemplazo".

Configuración

  • LM Studio ejecutándose localmente con el servidor API habilitado
  • Un script de Python para el bucle del agente, otro para consultas simples solo de prompt
  • Ambos conectados a un ~/.claude/CLAUDE.md global para que Claude Code sepa ofrecer delegación cuando sea relevante
  • No se necesita servidor MCP, dependencias de pip ni infraestructura de plugins
  • Recomendación: Agregar {%- set enable_thinking = false %} al inicio de la plantilla jinja - para la mayoría de las tareas esto ahorra tiempo y tokens sin degradar la calidad

El autor señala que hizo que Claude ayudara a escribir la publicación pero con supervisión y correcciones, y está feliz de compartir los scripts si hay interés.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

Stackdome: Alternativa de Railway de Código Abierto y Autoalojable en Kubernetes
Herramientas

Stackdome: Alternativa de Railway de Código Abierto y Autoalojable en Kubernetes

Stackdome es una plataforma open source autoalojable que empaqueta herramientas CNCF en una experiencia de desarrollo similar a Railway sobre Kubernetes. Incluye un lienzo visual, soporte multi-clúster, Postgres administrado y compilaciones de código a imagen.

OpenClawRadar
Marmy: Un Marco Autohospedado para Gestionar Agentes de Codificación de IA de Forma Remota
Herramientas

Marmy: Un Marco Autohospedado para Gestionar Agentes de Codificación de IA de Forma Remota

Marmy es un framework de código abierto con licencia MIT, construido con Claude Code, que permite a los desarrolladores gestionar agentes de programación con IA y sesiones de tmux desde una aplicación móvil. Incluye un agente en Rust para máquinas de desarrollo y una aplicación en React Native para control remoto.

OpenClawRadar
Claude Code Session Dashboard: Herramienta de Código Abierto para Monitorear Múltiples Sesiones
Herramientas

Claude Code Session Dashboard: Herramienta de Código Abierto para Monitorear Múltiples Sesiones

Un panel de control de código abierto que monitorea múltiples sesiones de Claude Code simultáneamente, mostrando el uso de tokens, costos, estado de sesión, uso de ventana de contexto y subagentes activos. La instalación requiere tres comandos: git clone, cd, y npm install && npm start.

OpenClawRadar
Jaula de Langosta: Entorno de Seguridad Dockerizado para Autoalojar OpenClaw en Raspberry Pi
Herramientas

Jaula de Langosta: Entorno de Seguridad Dockerizado para Autoalojar OpenClaw en Raspberry Pi

Un desarrollador creó Lobster Cage, un entorno Docker Compose con acceso saliente restringido y enrutamiento basado en proxy para ejecutar OpenClaw de forma segura en una Raspberry Pi para experimentación.

OpenClawRadar