Selbstentwickelnde Fähigkeitsmuster-Validierung: Ergebnisse des 5-Runden-Experiments

Experimentaufbau und Ergebnisse
Ein Entwickler führte ein 5-Runden-Experiment durch, um das Self-Evolving Skill-Designmuster für Claude Code zu validieren, das zuvor geteilt wurde. Das Experiment verwendete eine MySQL-Datenbank mit 29 Tabellen und 590 MB Daten aus einem Smart-Building-Management-System.
Die Runden folgten diesem Verlauf: Strukturerkundung → Datenabfragen → Regelentdeckung → komplexe Untersuchung → Wiederholungsüberprüfung.
Wichtige Erkenntnisse
- Five-Gate-Ablehnungsrate: 63,6 % – die meisten Interaktionen führten zu keiner Wissensänderung
- Inkrementelle Konvergenz: +75 → +46 → +12 → +21 → +1
- Gate 2 Selbstkorrektur: Das Muster erkannte und korrigierte 2 fehlerhafte Regeln, die die Skill in früheren Runden geschrieben hatte
- Runde 5: Null Erkundungsschritte, direkte Wiederverwendung von Vorlagen
- Genauigkeit: 100 % – kein falsches Wissen überlebte den Prozess
Eine unerwartete Erkenntnis war, dass Fallstricke bei der Werkzeugnutzung als wertvolles Nebenprodukt erfasst wurden – Probleme, für die der Entwickler nicht geplant hatte, die aber von den Five Gates trotzdem erkannt wurden.
Der Entwickler hat ein zweites Experiment an einer größeren Telefonrechnungsdatenbank in Arbeit. Vollständige Daten mit pro Runde differenzierbaren Momentaufnahmen sind auf GitHub verfügbar.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Verwendung von Claude zur Automatisierung der Mobile-App-QA mit Capacitor WebViews
Ein Entwickler hat ein automatisiertes QA-System mit Claude erstellt, um eine auf Capacitor basierende mobile App auf Android und iOS zu testen. Der Ansatz nutzt das Chrome DevTools Protocol für Android WebViews und Screenshots für visuelle Analysen, wobei die Android-Einrichtung 90 Minuten dauert, verglichen mit 6+ Stunden für iOS.

Ultimativer Unreal Engine MCP: Claude Code kann jetzt Unreal Engine-Level mit 132 Tools erstellen und verifizieren
Open-Source-MCP-Server bietet 132 Tools in 26 Bereichen, mit denen Claude Akteure spawnen, UPROPERTY-Werte setzen, Viewport-Screenshots erstellen, Kameras navigieren und sich nach Mutationen selbst korrigieren kann.

Claude Tag: @Claude auf Slack für KI-Zusammenarbeit im Mehrspielermodus
Anthropic bringt Claude Tag auf Slack – tagge @Claude in Kanälen, gib ihm Tools und delegiere asynchrone Aufgaben. 65 % des Produktteam-Codes werden jetzt von Claude erstellt.

ToolLoop: Open-Source Agenten-Framework für Claude-ähnliche Tools mit beliebigen Modellen
ToolLoop ist ein Open-Source-Python-Framework mit 11 Tools für Dateioperationen, Codesuche, Shell-Zugriff und Sub-Agenten, das über LiteLLM mit jedem LLM funktioniert. Das 2.700-Zeilen-Framework ermöglicht den Wechsel von Modellen mitten im Gespräch mit gemeinsamem Kontext.