Phaselock: Ein KI-Agenten-Steuerungssystem inspiriert von Erziehungstechniken

Was Phaselock macht
Phaselock ist eine Open-Source-Agent-Skill, die Erziehungstechniken für autistische Kinder auf die Kontrolle von KI-Agenten anwendet. Der Entwickler hat es erstellt, nachdem er Parallelen zwischen vagen KI-Agent-Fehlern und der Art, wie autistische Kinder Anweisungen verarbeiten, bemerkt hat.
Kernkontrollmechanismen
Das System implementiert vier spezifische Kontrollmuster:
- Explizite Gates vor Aktionen: Verwendet einen BeforeToolUse-Hook, der nach einer genehmigten Gate-Datei auf der Festplatte sucht. Keine Datei, kein Schreiben. Die KI kann ohne vorherige architektonische Deklaration nicht fortfahren.
- Sofortiges Feedback bei Fehlern: Ein PostToolUse-Hook führt nach jedem Dateischreiben eine statische Analyse durch (PHPStan, PHPCS, ESLint, ruff oder sprachgerechte Tools) und injiziert strukturierte JSON-Ergebnisse zurück in den Kontext. Die KI sieht genau, was kaputt gegangen ist, und korrigiert sich selbst, bevor sie fortfährt.
- Eingeschränkte Auswahlmöglichkeiten statt offener Optionen: Komplexe Funktionen werden in abhängigkeitsgeordnete Scheiben aufgeteilt. Die KI arbeitet eine Scheibe nach der anderen ab, wobei jede Scheibe für eine menschliche Überprüfung anhält, bevor die nächste beginnt.
- Regeln, die nicht wegargumentiert werden können: Shell-Hooks erlauben oder blockieren Aktionen mechanisch. Die Meinung der KI über ihre eigene Ausgabe ist kein Beweis.
Technische Implementierung
Phaselock funktioniert mit Claude Code, Cursor, Windsurf und allem, was Hooks und Agent-Skills unterstützt. Das Domänenwissen ist auf Magento 2 und PHP ausgerichtet, aber die Durchsetzungsarchitektur ist sprachunabhängig.
Skalierungsherausforderung und Lösung
Phaselock hat ein Skalierungsproblem: Es lädt alle Regeln in jeden Kontext jeder Sitzung. Bei 80 Regeln ist es handhabbar, aber bei 500 Regeln verbrennt man Kontext, bevor die Aufgabe beginnt, und bei 10.000 Regeln ist es physisch unmöglich.
Der Entwickler baut Writ als Lösung: ein hybrides Retrieval-System, das herausfindet, welche Regeln gerade relevant sind, und nur diese zurückgibt. Es erreicht Retrieval in unter 10 ms mit einer 726-fachen Kontextreduktion bei 10.000 Regeln. Writ ist noch experimentell und wird Stresstests unterzogen.
Aktuelle offene Frage
Der Entwickler kämpft mit Evaluierungsherausforderungen. Ground-Truth-Abfragen sind bei 80 Regeln synthetisch, und sie wissen noch nicht, ob die Retrieval-Qualität bei echten Abfragen aus echten Sitzungen hält. Sie fragen: "Hat sich jemand mit RAG-Evaluierung bei kleinen Korpusgrößen befasst, bei denen synthetische Benchmarks möglicherweise nicht die tatsächliche Nutzung widerspiegeln? Was habt ihr gelernt?"
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Benutzerdefinierte PTC für Claude Code zeigt 40-65 % Token-Einsparungen bei Analyseaufgaben, nicht beim Code-Schreiben.
Ein Entwickler hat eine lokale PTC-Implementierung namens Thalamus für Claude Code erstellt und 79 reale Sitzungen analysiert. Dabei wurden 40-65 % Token-Einsparungen bei Analyseaufgaben festgestellt, jedoch nahezu keine Einsparungen bei Code-Schreibaufgaben. Der Agent nutzte execute() hauptsächlich für allgemeine Python-Berechnungen anstatt für gebündelte Tool-Aufrufe.

Führungs-App mit über 90 Lektionen aus mehr als 20 Büchern – läuft in Claude
Ein Entwickler hat eine Führungs-App erstellt, die innerhalb von Claude läuft und über 90 Lektionen aus mehr als 20 Büchern zu Führung, Gewohnheiten, Disziplin, Einfluss, Teamkultur und Wohlstandsdenken bietet. Die App bietet tägliche Lektionen mit konkreten Aktionen, Verfolgung von Erfolgsserien, Journaling und Suchfunktionen.

LoreConvo: MCP-Server fügt Claude Code persistenten Sitzungsspeicher hinzu
LoreConvo ist ein MCP-Server, der Claude Code mit persistenter Sitzungsspeicherung versorgt und automatisch Kontext zwischen Sitzungen speichert und lädt. Er spart 3.000–8.000 Token pro Sitzung, indem er den Aufwand für das erneute Kontextualisieren eliminiert.

ReasonDB: Open-Source-Dokumentendatenbank mit LLM-gesteuerter Baumnavigation anstelle von Vektorsuche
ReasonDB ist eine Open-Source-Dokumentendatenbank, die die Dokumentenstruktur als Hierarchie erhält und anstelle der Vektorsuche LLM-gesteuerte Baumtraversierung für die Abfrage verwendet. Sie nutzt BM25 für die anfängliche Suche, tree-grep für die Strukturfilterung und Beam-Search-Traversierung, bei der das LLM etwa 25 Knoten von Millionen besucht.