Dándole a Claude un LLM local como asistente mediante MCP en Mac

Un usuario de Reddit detalló cómo le dio a Claude acceso a un LLM local ejecutándose en un Mac Mini M4 (24 GB de RAM) a través de una conexión MCP con Ollama. La configuración usa Ollama sirviendo Qwen 2.5 Coder (14B) como un asistente llamado 'Frank', al que Claude puede delegar tareas bajo reglas específicas: debe usar menos tokens que el propio Claude, no debe afectar la calidad y requiere una revisión final.
Detalles de la configuración
- Hardware: Mac Mini M4 con 24 GB de RAM.
- LLM local: Qwen 2.5 Coder (14B) ejecutándose mediante Ollama (también probado con LM Studio).
- Conexión: MCP (Protocolo de Contexto del Modelo) para vincular Claude (CLI o aplicación de escritorio) con el modelo local.
- Instrucciones: A Claude se le dio un archivo Markdown de memoria (
memory.md) con pautas sobre cuándo y cómo usar Frank — por ejemplo, delegar procesamiento de texto, manejo de archivos grandes CSS/HTML, y usarlo solo cuando ahorre tokens sin degradar la calidad de salida.
Casos de uso prácticos
- Procesamiento y transformación de texto — delegado a Frank para reducir el uso de tokens de Claude.
- Manejo de archivos grandes CSS/HTML que serían costosos para que Claude los procesara directamente.
- Ejecución de pruebas de rendimiento, codificación y lógica — Claude evaluó modelos locales a través de Frank en lugar de hacerlo manualmente.
El usuario señaló que está operando al límite de su RAM/GPU y no puede probar modelos más grandes (30B+). Invitó a otros con hardware más potente a probar configuraciones similares y compartir resultados.
Este enfoque crea efectivamente un asistente sin costo para Claude, delegando tareas pesadas en tokens mientras mantiene la calidad mediante la revisión final de Claude.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

Termrender: Visualización de Interfaz ASCII 6x Eficiente en Tokens para Claude
Termrender es una herramienta de Python de código abierto que genera visualizaciones de interfaz de usuario en ASCII con una eficiencia de tokens 6 veces mayor en comparación con la salida sin procesar de Claude. Produce diagramas y paneles utilizando un mínimo de tokens para una generación y edición más rápidas.

Capa de Identidad y Reputación para Agentes OpenClaw
Un equipo de desarrolladores construyó MCP-I e IdentiClaw para resolver la pérdida de identidad en flujos de trabajo de agentes de múltiples pasos, además de knowthat.ai como un registro de reputación. Donaron la especificación MCP-I a la Decentralized Identity Foundation.

Atuin v18.13 añade comandos de shell con IA, un demonio de búsqueda más rápido y un proxy PTY.
Atuin v18.13 presenta tres características principales: un asistente de inglés a Bash con IA llamado atuin ai, un daemon de búsqueda más rápido con indexación en memoria, y un proxy PTY llamado hex que permite la representación de ventanas emergentes sin borrar la salida de la terminal.

Claude-Control: Control Remoto Móvil para Sesiones de Código Claude
Claude-control es una herramienta de código abierto que te permite gestionar sesiones de Claude Code desde tu teléfono mediante HTTPS y WebSocket. Ejecuta Claude Code en un PTY real dentro de tmux, detecta solicitudes de permisos y envía notificaciones push con botones Permitir/Denegar.