Claude Code-Fähigkeit kombiniert Ansätze von DeepMind Aletheia und Anthropic Harness

Technische Implementierungsdetails
Ein Entwickler hat eine Claude Code-Fähigkeit erstellt, die zwei aktuelle Forschungsansätze kombiniert: DeepMinds Aletheia-Mathematik-Forschungsagenten und Anthropics Multi-Agenten-Codearchitektur. Die Fähigkeit schafft eine Synthese, die keine der ursprünglichen Implementierungen enthielt.
Die Pipeline folgt einer Planner → Generator → Evaluator → Reviser-Struktur. Eine Schlüsselinnovation ist das, was der Entwickler als "blinde Voranalyse" bezeichnet – der Evaluator denkt über den korrekten Ansatz nach, bevor er jemals den Kandidatencode sieht. Dies erweitert Aletheias Entkopplungskonzept, indem der Evaluator zuerst eigene Erwartungen bildet und dann Lösungen daran misst.
Nach der blinden Analyse führt der Evaluator den Code aus und bewertet ihn anhand konkreter Kriterien: Korrektheit, Vollständigkeit, Sicherheit, Widerstandsfähigkeit und Qualität. Er gibt ein strukturiertes Urteil (KORREKT / KORRIGIERBAR / FALSCH) zurück, das gezielte Überarbeitungen antreibt.
Installation und Verwendung
Die Installation erfordert das Erstellen eines Verzeichnisses und das Klonen des Repositorys:
mkdir -p ~/.claude/skills/aletheia
# Repository klonen, SKILL.md + evaluator.md + planner.md kopierenVerwendungsbeispiele aus der Quelle:
/aletheia Erstelle ein Rate-Limiter-Middleware für Fastify mit Redis/aletheia review src/routes/auth.ts/aletheia quick Behebe die N+1-Abfrage im Dashboard
Die Fähigkeit ist verfügbar unter https://github.com/zhadyz/aletheia-harness.
Forschungskontext
DeepMinds Aletheia repräsentiert einen Wechsel vom konvergenten Denken (Reproduzieren bekannter Lösungen) zum divergenten Denken (Generieren origineller mathematischer Ergebnisse). Anthropics Harness-Forschung konzentrierte sich auf Multi-Agenten-Codearchitektur, fehlte jedoch die Entkopplung der Gedankenkette im Evaluator. Diese Implementierung kombiniert beide Ansätze in einer einzigen Pipeline.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

NervMap: Einzelbefehl-Server-Service-Erkennungs- und Diagnosewerkzeug
NervMap ist ein Linux-Tool, das Docker-Container, systemd-Dienste und einfache Prozesse in unter einer Sekunde erkennt, Abhängigkeiten zwischen ihnen abbildet und Probleme mit Schweregradanalyse und Lösungsvorschlägen diagnostiziert.

Mit kostenlosen LLM-APIs und Tool-Calling erstellte Pokémon-Kampf-KI-Agenten
Ein System, das Llama 3, Qwen, Gemma über kostenlose API-Stufen nutzt, um autonom Pokémon-Showdown-Kämpfe mit strukturierten Tool-Aufrufen zu spielen. Unterstützt Mensch gegen KI und KI gegen KI Modi.

Mehr-Agenten-Inhalts-Pipeline für Claude-Code mit Qualitätssicherungsschleusen
Ein Entwickler hat eine Sechs-Agenten-Inhalts-Pipeline für Claude Code erstellt, die Recherche, Schreiben, Bearbeitung und SEO-Aufgaben mit Qualitätsprüfpunkten zwischen den Stufen trennt. Das System stoppt zur manuellen Freigabe vor der Veröffentlichung und ermöglicht das erneute Ausführen einzelner Agenten.

Erstellen von syntaqlite: Ein SQLite-Entwicklungswerkzeug-Projekt, das mit KI-Unterstützung erstellt wurde
Lalit Maganti baute syntaqlite, eine Reihe von Entwicklertools für SQLite, in drei Monaten mithilfe von KI-Codierungsagenten, nachdem er es acht Jahre lang gewollt hatte. Das Projekt erforderte das genaue Parsen von SQL wie SQLite, was die Anpassung von SQLites dichtem C-Codebase mit über 400 Grammatikregeln beinhaltet.