Analyse von 2.181 Remote-MCP-Server-Endpunkten zeigt Zuverlässigkeitsprobleme

Eine kürzliche Analyse von 2.181 Remote-fähigen MCP-Server-Endpunkten zeigt erhebliche Zuverlässigkeitsprobleme im gesamten Ökosystem. Die automatisierten Gesundheitsprüfungen wurden an Servern aus dem offiziellen Registry, mcp.so, PulseMCP und Smithery durchgeführt.
Wichtige Ergebnisse
- 52 % der Endpunkte sind vollständig tot (Timeout, Verbindung abgelehnt, 404)
- 37 % antworten, erfordern jedoch Authentifizierung (401/403)
- 9 % sind als betriebsbereit und gesund bestätigt
- 1,5 % sind beeinträchtigt (langsam oder mit intermittierenden Fehlern)
- Unter den laufenden Servern halten 516 eine Verfügbarkeit von 99 %+
- 58 % der Server mit GitHub-Repos hatten in den letzten 30 Tagen keinen Commit
Kategorieaufschlüsselung
- Dev-Tools hat die meisten Server (1.238)
- Finance-Server haben die schlechteste durchschnittliche Latenz (2.558 ms)
- Security-Server haben die niedrigste durchschnittliche Verfügbarkeit mit 27 %
Schnellste gefundene Server
- GitHub MCP: 101 ms
- Timescale pg-aiguide: 104 ms
- Supabase: 109 ms
Der vollständige Datensatz steht für weitere Analysen zur Verfügung, und der Autor steht für Fragen zur Methodik oder zu bestimmten Servern offen.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Ein KI-Versagen in einer Demo: Claude Code korrigiert Rechtschreibung statt Schemafehler, OpenAI verhunzt benutzerdefinierte Feldzuordnung
Während eines Live-Workshops ignorierte Claude Code einen JSON-Schema-Validierungsfehler, um Rechtschreibwarnungen zu beheben, und OpenAI lieferte beim ersten Versuch, seltsame benutzerdefinierte Salesforce-Felder zuzuordnen, Müll.

Qwen 3 8B übertrifft größere Modelle in blinden Peer-Evaluierungen bei schwierigen Aufgaben.
In einer verblindeten Peer-Evaluation von 10 kleinen Sprachmodellen bei 13 schwierigen Aufgaben auf Spitzenniveau gewann Qwen 3 8B 6 Bewertungen und platzierte sich in 12 von 13 Aufgaben unter den Top 3, wobei es Modelle mit bis zu 4-facher Parameterzahl übertraf. Die Evaluation umfasste Debugging verteilter Sperren, Nebenläufigkeitsfehler in Go, SQL-Optimierung, Bayes'sche medizinische Diagnose, Simpsons Paradoxon, Arrows Wahltheorem und Analyse des Überlebendenfehlers.

Untersuchung der Machbarkeit von OpenClaw auf einem Chromebook
OpenClaw auf einem Chromebook auszuführen, könnte einfacher sein, als Sie denken. Unsere neueste Erkundung von OpenClawRadar geht den Nutzererfahrungen und -anforderungen nach, um zu klären, ob Chromebooks diesen KI-Coding-Agenten bewältigen können.

ETH-Studie hinterfragt den Nutzen von AGENTS.md-Dateien für KI-Codierungsagenten
Neue Forschungsergebnisse der ETH Zürich zeigen, dass LLM-generierte AGENTS.md-Dateien die Erfolgsquote von KI-Agenten-Aufgaben um 3 % reduzieren und die Inferenzkosten um über 20 % erhöhen, während menschlich verfasste Dateien nur marginale Verbesserungen von 4 % bei ähnlichen Kostensteigerungen bieten.