Claude-Skill-MCP-Checker: Deterministische Prüfung bahnbrechender Änderungen vom 28.07.2026

Mit der Ankunft der MCP-Überarbeitung von 2026-07-28, der größten bahnbrechenden Änderung des Protokolls – zustandsloser Transport, kein Mcp-Session-Id mehr, OAuth 2.1 – sind viele öffentliche Server stillschweigend defekt. Anstatt sich auf LLM-basiertes Rätselraten zu verlassen, hat ein Entwickler einen deterministischen Checker gebaut, der für dieselbe Eingabe dieselbe Ausgabe erzeugt und für jeden Befund die genaue Spezifikationsseite zitiert.
So funktioniert der Checker
Der Kern ist eine reine Regel-Engine mit 7 Regeln, die auf zwei Arten bereitgestellt wird:
- Web-Demo – Fügen Sie einen Endpunkt ein, erhalten Sie einen bewerteten Bericht. Keine Installation, nichts wird gespeichert.
- Claude-Skill – eine
SKILL.mdplus ein gebündelter, abhängigkeitsfreier Checker. In Claude Code übernimmt er Diagnose und Migration, aber Sie können ihn entpacken und den Checker mit jedem Agenten (Codex, Cursor) ausführen.
Das Repo (MIT, ~86 Tests) ist auf GitHub. Es gibt sogar einen README-Abschnitt mit dem Titel „A rule that was wrong“ (Eine Regel, die falsch war) mit Tests, die beide Fehler festhalten, damit sie nicht wieder auftreten können.
Was der Autor gelernt hat
Eine Regel war selbstbewusst falsch: Sie riet Benutzern, das SDK auf ^2 zu aktualisieren – eine Version, die es nicht gibt (es endet bei 1.30.0). Nachdem er sie mit dem Hinweis „no v2 exists“ (es gibt kein v2) gelöscht hatte, stellte sich heraus, dass v2 doch existiert, als Paket-Umbenennung. Die Lektion: „Das gibt es nicht“ und „Sie haben am falschen Ort gesucht“ erzeugen identische Beweise – eine Umbenennung sieht genauso aus wie eine Abwesenheit. Deterministisch ist nicht dasselbe wie korrekt.
Diese Fehlerart tritt überall auf, wo Agenten Code schreiben: selbstbewusste, plausible, intern konsistente Behauptungen, die einfach nicht wahr sind. Die Lösung ist nicht, „weniger zu vertrauen“, sondern Behauptungen überprüfbar zu machen und sie dann tatsächlich zu überprüfen.
Für wen es gedacht ist
Für alle, die MCP-Server betreiben oder zur Spezifikation von 2026-07-28 migrieren, sowie für Entwickler, die agentische Tools bauen, deren Ausgabe gegen die Spezifikation verifiziert werden muss.
📖 Lesen Sie die vollständige Quelle: r/ClaudeAI
👀 Siehe auch

Echte Einblicke in die Verwendung von OpenClaw mit LLMs: Herausforderungen und Einschränkungen
Ein OpenClaw-Nutzer beschreibt Integrationsprobleme mit LLMs und berichtet von unsinnigen Antworten eines Discord-Bots.

Browser-Harness: LLMs direkten CDP-Zugriff gewähren, um Browseraufgaben eigenständig zu korrigieren
Browser Harness entfernt Browser-Frameworks und gewährt LLMs direkten CDP-Websocket-Zugriff, sodass sie fehlende Tools während der Aufgabe selbst schreiben können. Demonstriert durch die selbstständige Erstellung einer upload_file()-Funktion.

SpecLock: MCP-Server zur Durchsetzung von KI-Codierungsbeschränkungen
SpecLock ist ein Open-Source-MCP-Server, der Projektbeschränkungen über Sitzungen hinweg speichert und KI-Codierungsagenten daran hindert, diese zu verletzen. Claude hat es unabhängig mit 100 adversarischen Tests geprüft und erzielte 100/100 Punkte mit null falsch-positiven Ergebnissen und 15,7 ms pro Prüfung.

Geschmacksknospengedächtnis: Reversible Agentenspeicherung mittels hyperdimensionaler Rechenvektoren
Hyperdimensionale Berechnung ersetzt die Vektorsuche für vollständige Wiederherstellung: Liste ALLE Tage, die ein Projekt berühren, erkenne unbenannte Arbeitsströme und zerlege tägliche Protokolle verlustfrei über Punktprodukte.