MCP funktioniert auch mit lokalen Modellen – Server-Ökosystem reift schnell

Das Model Context Protocol (MCP) wird oft mit Anthropics Claude assoziiert, ist aber nicht an ein bestimmtes Modell gebunden. Wie in einer kürzlichen Diskussion auf r/LocalLLaMA hervorgehoben wurde, funktioniert MCP mit jedem Modell, das Funktionsaufrufe unterstützt – einschließlich lokaler Modelle, die über Ollama laufen.
Wichtige Details aus dem Beitrag
Der Autor führte mehrere Tests mit Ollama und Open Web UI durch, das nun grundlegende MCP-Client-Funktionalität enthält. Das MCP-Protokoll verwendet einfaches JSON RPC, was es von Natur aus modellneutral macht. Solange das Modell Werkzeuge korrekt nutzt, kann es eine Verbindung zu MCP-Servern herstellen.
Wichtige Erkenntnisse:
- Kleinere Modelle haben Schwierigkeiten mit mehrstufiger Werkzeugnutzung.
- Größere Modelle (13B+) mit Funktionsaufruffähigkeiten schneiden deutlich besser ab.
MCP-Server-Ökosystem
Das MCP-Server-Ökosystem ist deutlich gewachsen. Verfügbare Server umfassen:
- Dateisysteme
- Browser
- Datenbanken
- GitHub
- Slack
- Domain-spezifische Server
Der Vorteil: Schreibe einen Server und jeder MCP-Client kann ihn nutzen. Dies ist besonders nützlich beim Wechsel zwischen lokalen und cloudbasierten Modellen.
Für wen es gedacht ist
Entwickler, die lokale LLMs betreiben und externe Werkzeuge über MCP integrieren möchten, ohne auf reine Cloud-Lösungen angewiesen zu sein.
📖 Vollständige Quelle lesen: r/LocalLLaMA
👀 Siehe auch

Greg Kroah-Hartmans Clanker T1000: Lokales LLM auf Framework Desktop mit AMD Ryzen AI Max, das Linux-Kernel-Bug fuzzt
Greg KH's 'gregkh_clanker_t1000' verwendet ein lokales LLM, das auf einem Framework Desktop (AMD Ryzen AI Max+) läuft, um den Linux-Kernel zu fuzzen, was zu ~20 zusammengeführten Patches seit dem 7. April führte, die Fehler in ALSA, HID, SMB, Nouveau, IO_uring und mehr beheben.

Undokumentierter Fehler im Apollo-11-Lenkcomputercode mithilfe von KI und Spezifikationssprache gefunden
Forscher entdeckten einen Ressourcensperrfehler im Gyroskopsteuerungscode des Apollo Guidance Computers, der 57 Jahre lang unentdeckt blieb, indem sie Claude AI und die Allium-Spezifikationssprache nutzten, um 130.000 Zeilen Assembler-Code zu analysieren.

Sora AI-Videoökonomie: 20 US-Dollar Nutzerkosten verursachen 65 US-Dollar Rechenkosten für OpenAI
OpenAIs Sora KI-Videoerstellungs-App kostet Berichten zufolge 65 US-Dollar an Rechenleistung pro 20 US-Dollar/Monat-Nutzer, wobei die Spitzen-Inferenzkosten auf 15 Millionen US-Dollar täglich gegenüber 2,1 Millionen US-Dollar Gesamtlebensdauerumsatz geschätzt werden.

Open-Source-LLMs übertreffen Claude Opus 4.6 bei der Generierung von Handelsstrategien zu geringeren Kosten.
Ein Reddit-Nutzer testete 10 LLMs auf die Erstellung von Handelsstrategien und stellte fest, dass Open-Source-Modelle trotz 10-fach niedrigerer Kosten besser abschnitten als Claude Opus 4.6. Minimax 2.5 und Gemini 3.1 führten die Rangliste an.