Claude mit einem lokalen LLM als Assistent über MCP auf dem Mac ausstatten

✍️ OpenClawRadar📅 Veröffentlicht: 12. Mai 2026🔗 Source
Claude mit einem lokalen LLM als Assistent über MCP auf dem Mac ausstatten
Ad

Ein Reddit-Nutzer beschrieb, wie er Claude über eine MCP-Verbindung zu Ollama Zugriff auf ein lokales LLM auf einem Mac Mini M4 (24 GB RAM) gewährte. Der Aufbau verwendet Ollama, das Qwen 2.5 Coder (14B) als Assistenten namens 'Frank' bereitstellt. Claude kann Frank unter bestimmten Regeln Aufgaben delegieren – er muss weniger Token verbrauchen als Claude selbst, darf die Qualität nicht beeinträchtigen und erfordert eine abschließende Überprüfung.

Einrichtung im Detail

  • Hardware: Mac Mini M4 mit 24 GB RAM.
  • Lokales LLM: Qwen 2.5 Coder (14B), ausgeführt über Ollama (ebenfalls getestet mit LM Studio).
  • Verbindung: MCP (Model Context Protocol), um Claude (CLI oder Desktop-App) mit dem lokalen Modell zu verbinden.
  • Anweisungen: Claude erhielt eine Markdown-Datei (memory.md) mit Richtlinien, wann und wie Frank eingesetzt werden soll – z. B. für Textverarbeitung, die Bearbeitung großer CSS/HTML-Dateien, und nur dann, wenn es Token spart, ohne die Ausgabequalität zu beeinträchtigen.
Ad

Praktische Anwendungsfälle

  • Textverarbeitung und -transformation – an Frank ausgelagert, um Claudes Token-Verbrauch zu reduzieren.
  • Umgang mit großen CSS/HTML-Dateien, deren direkte Verarbeitung durch Claude teuer wäre.
  • Durchführung von Leistungs-, Programmier- und Logiktests – Claude bewertete lokale Modelle über Frank anstatt manuell.

Der Nutzer wies darauf hin, dass er an den Grenzen seines RAM/GPU arbeitet und keine größeren Modelle (30B+) testen kann. Er lud andere mit leistungsfähigerer Hardware ein, ähnliche Aufbauten zu versuchen und Ergebnisse zu teilen.

Dieser Ansatz schafft effektiv einen kostenlosen Assistenten für Claude, der token-intensive Aufgaben auslagert, während die Qualität durch Claudes abschließende Überprüfung erhalten bleibt.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Tangent: Chrome-Erweiterung zum Verzweigen von Claude-Gespraechen
Werkzeuge

Tangent: Chrome-Erweiterung zum Verzweigen von Claude-Gespraechen

Kostenlose Open-Source-Erweiterung zum Oeffnen von Seitenthreads in Claude ohne den Platz zu verlieren.

OpenClaw Radar
LM Studio-Parser-Fehler beeinträchtigen Qwen3.5-Toolaufrufe und logisches Denken
Werkzeuge

LM Studio-Parser-Fehler beeinträchtigen Qwen3.5-Toolaufrufe und logisches Denken

LM Studios Server-Parser enthält drei interagierende Fehler, die Tool-Aufrufe stillschweigend unterbrechen, die Ausgabe der Argumentation korrumpieren und Modelle schlechter erscheinen lassen, als sie sind. Die Probleme betreffen Argumentationsmodelle wie Qwen3.5 und DeepSeek-R1, wobei ein Fehler, der vor über einem Jahr gemeldet wurde, immer noch nicht behoben ist.

OpenClawRadar
Entwickler baut Scheme-Compiler zu WASM mithilfe von KI in 4 Tagen
Werkzeuge

Entwickler baut Scheme-Compiler zu WASM mithilfe von KI in 4 Tagen

Ein Entwickler erstellte Puppy Scheme, einen Scheme-Compiler, der WebAssembly als Ziel hat, in etwa 4 Tagen mit KI-Unterstützung. Der Compiler unterstützt 73 % von R5RS und R7RS, nutzt WASM GC und erreichte Verbesserungen der Kompilierzeit von 3½ Minuten auf 11 Sekunden über Nacht.

OpenClawRadar
OpenClaw-Mem0-Plugin fügt persistenten Speicher außerhalb des Kontextfensters hinzu
Werkzeuge

OpenClaw-Mem0-Plugin fügt persistenten Speicher außerhalb des Kontextfensters hinzu

Das openclaw-mem0-Plugin verlagert die Speicherung von Erinnerungen vollständig außerhalb des Kontextfensters von OpenClaw und verhindert so Verluste durch Komprimierung oder Sitzungsneustarts. Es bietet automatisches Abrufen und Erfassen mit Optionen für Cloud- und lokale Einrichtung.

OpenClawRadar