Tether: Ein MCP-Server zum Austausch von Kontext zwischen KI-Modellen über SQLite

Was Tether macht
Tether löst das Problem des manuellen Kopierens und Einfügens von JSON-Blobs zwischen mehreren parallel laufenden KI-Modellen. Es reduziert jedes JSON auf einen winzigen inhaltsadressierten Handle (wie &h_messages_abc123 – 28 Bytes). Diesen Handle übergibt man an ein anderes Modell, das ihn auflösen kann, um die Originaldaten zu erhalten. Derselbe Inhalt erzeugt immer denselben Handle, und alles befindet sich in einer gemeinsamen SQLite-Datei.
Wie es funktioniert
Der Entwickler hat Tether als MCP-Server (Model Context Protocol) sowohl für Claude- als auch für MiniMax-Sitzungen eingerichtet, die auf dieselbe SQLite-Datenbank verweisen. Dadurch konnten die Modelle Nachrichten direkt austauschen – einschließlich Code-Reviews, technischen Notizen und der gemeinsamen Gestaltung eines Benachrichtigungssystems mit Lesebestätigungen. Bemerkenswerterweise hat das zweite Modell (Kilo auf MiniMax) die Nachrichtenkonvention allein aus dem ersten Handle ohne zusätzliche Anweisungen erkannt.
Wichtige Vorteile
- Token-Effizienz: Ein Benachrichtigungseintrag ist ~100 Tokens, während die Nachricht, auf die er verweist, 2000+ Tokens haben könnte. Modelle scannen zuerst Betreffzeilen und lösen die vollständige Nutzlast nur bei Bedarf auf.
- Deduplizierung: Gleicher Inhalt = gleicher Handle = einmal gespeichert. Wenn 5 Modelle denselben Kontext benötigen, ist es ein Datenbankeintrag, auf den 5-mal verwiesen wird.
- Persistenz: Die SQLite-Backend bedeutet, dass Handles Neustarts überstehen – Absturz, Neustart, egal.
- Keine Infrastruktur: Kein Daemon, keine Ports, keine API-Schlüssel. Nur eine SQLite-Datei und ein MCP-Server.
Technische Details
Das Tool ist unter der MIT-Lizenz lizenziert und auf GitHub verfügbar. Es wurde dockerisiert, obwohl der Docker-Container noch nicht veröffentlicht wurde. Das Setup des Entwicklers umfasste Claude Code mit Opus und eine separate CLI mit Kilo Code, die MiniMax M2.5 auf der kostenlosen Stufe ausführt. Ein vollständiges Transkript der ersten modellübergreifenden Konversation ist in der Datei demos/first_contact.md des Repositorys verfügbar.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

EvalShift: Open-Source-CLI zur Erkennung von LLM-Regressionen bei der Modellmigration
EvalShift ist ein MIT-lizenziertes Python-CLI, das Ausgaben von Quell- vs. Ziel-LLMs über Prompts, Agents und Tool-Calling-Workflows vergleicht und einen lokalen HTML-Regressionsbericht erstellt.

Axe: Ein 12-MB-CLI für Single-Purpose-LLM-Agenten
Axe ist eine schlanke Go-Binärdatei, die fokussierte KI-Agenten ausführt, die in TOML-Dateien definiert sind. Es behandelt Agenten wie Unix-Programme und unterstützt stdin-Piping, Sub-Agenten-Delegation und Multi-Provider-LLM-Integration.

Benutzerdefinierte llama.cpp-Backend verlagert LLM-Matrixmultiplikation auf AMD XDNA2 NPU in Ryzen AI MAX 385
Ein Entwickler hat ein benutzerdefiniertes llama.cpp-Backend erstellt, das GEMM-Operationen direkt an den AMD XDNA2 NPU auf Ryzen AI MAX 385 (Strix Halo) weiterleitet und dabei 43,7 t/s Dekodierung bei 0,947 J/tok mit Meta-Llama-3.1-8B-Instruct Q4_K_M erreicht. Der NPU-Dekodierungspfad spart im Vergleich zu reinem Vulkan etwa 10W, während der Dekodierungsdurchsatz gleich bleibt.

tmux-claude: Überwachen Sie Claude-Code-Instanzen über Tmux-Fenster hinweg
tmux-claude ist ein Tool, das eine Live-Überwachung für Claude Code-Instanzen innerhalb von tmux-Sitzungen hinzufügt. Es bietet eine Statusleiste, ein interaktives Dashboard, einen erweiterten Fensterauswähler und Desktop-Benachrichtigungen, indem es lokale Sitzungsdateien ohne API-Aufrufe liest.