Tether: Un Servidor MCP para Compartir Contexto Entre Modelos de IA a través de SQLite

Qué hace Tether
Tether resuelve el problema de copiar y pegar manualmente bloques JSON entre múltiples modelos de IA que se ejecutan simultáneamente. Comprime cualquier JSON en un pequeño identificador direccionable por contenido (como &h_messages_abc123 — 28 bytes). Pasas este identificador a otro modelo, que puede resolverlo para obtener los datos originales. El mismo contenido siempre produce el mismo identificador, y todo reside en un archivo SQLite compartido.
Cómo funciona
El desarrollador configuró Tether como un servidor MCP (Protocolo de Contexto de Modelo) para sesiones de Claude y MiniMax, apuntando a la misma base de datos SQLite. Esto permitió que los modelos intercambiaran mensajes directamente — incluyendo revisiones de código, notas técnicas y el diseño colaborativo de un sistema de notificaciones con confirmaciones de lectura. Notablemente, el segundo modelo (Kilo ejecutándose en MiniMax) dedujo la convención de mensajería únicamente del primer identificador, sin instrucciones adicionales.
Beneficios clave
- Eficiencia de tokens: Una entrada de notificación es de ~100 tokens, mientras que el mensaje al que apunta podría ser de 2000+. Los modelos escanean primero las líneas de asunto y resuelven la carga completa solo cuando es necesario.
- Deduplicación: Mismo contenido = mismo identificador = almacenado una vez. Si 5 modelos necesitan el mismo contexto, es una entrada de base de datos referenciada 5 veces.
- Persistencia: El respaldo en SQLite significa que los identificadores sobreviven a reinicios — fallo, reinicio, no importa.
- Sin infraestructura: Sin demonio, sin puertos, sin claves API. Solo un archivo SQLite y un servidor MCP.
Detalles técnicos
La herramienta tiene licencia MIT y está disponible en GitHub. Ha sido dockerizada, aunque el contenedor Docker aún no se ha publicado. La configuración del desarrollador incluía Claude Code con Opus y una CLI separada con Kilo Code ejecutando MiniMax M2.5 en el nivel gratuito. Una transcripción completa de la primera conversación entre modelos está disponible en el archivo demos/first_contact.md del repositorio.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Implementando un Asistente de Voz Local con Qwen3 en RTX 5060 Ti
Un asistente de voz para automatización del hogar completamente local que utiliza Qwen3 ASR, LLM y TTS en una RTX 5060 Ti, con clonación de voz de Morgan Freeman y una variedad de herramientas de integración.

oMLX presenta el almacenamiento en caché SSD KV para Apple Silicon, reduciendo los tiempos de respuesta de OpenClaw de 30-90 segundos a 5 segundos.
oMLX es un nuevo backend que persiste los bloques de caché KV en SSD en formato safetensors, evitando la invalidación de la caché cuando cambia el contexto. Esto reduce los tiempos de respuesta de OpenClaw de 30-90 segundos a solo 5 segundos en turnos posteriores.

Ingeniería Inversa del Motor Neuronal de Apple para Entrenar Modelos MicroGPT
Un desarrollador ha invertido la ingeniería de las API privadas del Motor Neuronal de Apple para crear un pipeline de entrenamiento para un modelo MicroGPT de 110M parámetros, logrando una eficiencia energética de 6.6 TFLOPs/vatio en hardware Mac M4.

Vibe Hosting: Integración Claude Code MCP para Implementación Asistida por IA
La plataforma Vibe Hosting de NameOcean integra Claude Code MCP para construir y desplegar proyectos mediante comandos en lenguaje natural. El servicio ofrece SSL gratuito, dominios, DNS y configuración de VPS para sitios estáticos y aplicaciones de Node.js, Python, Django y Go.