Claude Code-Fähigkeit kombiniert Ansätze von DeepMind Aletheia und Anthropic Harness

✍️ OpenClawRadar📅 Veröffentlicht: 14. April 2026🔗 Source
Claude Code-Fähigkeit kombiniert Ansätze von DeepMind Aletheia und Anthropic Harness
Ad

Technische Implementierungsdetails

Ein Entwickler hat eine Claude Code-Fähigkeit erstellt, die zwei aktuelle Forschungsansätze kombiniert: DeepMinds Aletheia-Mathematik-Forschungsagenten und Anthropics Multi-Agenten-Codearchitektur. Die Fähigkeit schafft eine Synthese, die keine der ursprünglichen Implementierungen enthielt.

Die Pipeline folgt einer Planner → Generator → Evaluator → Reviser-Struktur. Eine Schlüsselinnovation ist das, was der Entwickler als "blinde Voranalyse" bezeichnet – der Evaluator denkt über den korrekten Ansatz nach, bevor er jemals den Kandidatencode sieht. Dies erweitert Aletheias Entkopplungskonzept, indem der Evaluator zuerst eigene Erwartungen bildet und dann Lösungen daran misst.

Nach der blinden Analyse führt der Evaluator den Code aus und bewertet ihn anhand konkreter Kriterien: Korrektheit, Vollständigkeit, Sicherheit, Widerstandsfähigkeit und Qualität. Er gibt ein strukturiertes Urteil (KORREKT / KORRIGIERBAR / FALSCH) zurück, das gezielte Überarbeitungen antreibt.

Ad

Installation und Verwendung

Die Installation erfordert das Erstellen eines Verzeichnisses und das Klonen des Repositorys:

mkdir -p ~/.claude/skills/aletheia
# Repository klonen, SKILL.md + evaluator.md + planner.md kopieren

Verwendungsbeispiele aus der Quelle:

  • /aletheia Erstelle ein Rate-Limiter-Middleware für Fastify mit Redis
  • /aletheia review src/routes/auth.ts
  • /aletheia quick Behebe die N+1-Abfrage im Dashboard

Die Fähigkeit ist verfügbar unter https://github.com/zhadyz/aletheia-harness.

Forschungskontext

DeepMinds Aletheia repräsentiert einen Wechsel vom konvergenten Denken (Reproduzieren bekannter Lösungen) zum divergenten Denken (Generieren origineller mathematischer Ergebnisse). Anthropics Harness-Forschung konzentrierte sich auf Multi-Agenten-Codearchitektur, fehlte jedoch die Entkopplung der Gedankenkette im Evaluator. Diese Implementierung kombiniert beide Ansätze in einer einzigen Pipeline.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

NervMap: Einzelbefehl-Server-Service-Erkennungs- und Diagnosewerkzeug
Werkzeuge

NervMap: Einzelbefehl-Server-Service-Erkennungs- und Diagnosewerkzeug

NervMap ist ein Linux-Tool, das Docker-Container, systemd-Dienste und einfache Prozesse in unter einer Sekunde erkennt, Abhängigkeiten zwischen ihnen abbildet und Probleme mit Schweregradanalyse und Lösungsvorschlägen diagnostiziert.

OpenClawRadar
Mit kostenlosen LLM-APIs und Tool-Calling erstellte Pokémon-Kampf-KI-Agenten
Werkzeuge

Mit kostenlosen LLM-APIs und Tool-Calling erstellte Pokémon-Kampf-KI-Agenten

Ein System, das Llama 3, Qwen, Gemma über kostenlose API-Stufen nutzt, um autonom Pokémon-Showdown-Kämpfe mit strukturierten Tool-Aufrufen zu spielen. Unterstützt Mensch gegen KI und KI gegen KI Modi.

OpenClawRadar
Mehr-Agenten-Inhalts-Pipeline für Claude-Code mit Qualitätssicherungsschleusen
Werkzeuge

Mehr-Agenten-Inhalts-Pipeline für Claude-Code mit Qualitätssicherungsschleusen

Ein Entwickler hat eine Sechs-Agenten-Inhalts-Pipeline für Claude Code erstellt, die Recherche, Schreiben, Bearbeitung und SEO-Aufgaben mit Qualitätsprüfpunkten zwischen den Stufen trennt. Das System stoppt zur manuellen Freigabe vor der Veröffentlichung und ermöglicht das erneute Ausführen einzelner Agenten.

OpenClawRadar
Erstellen von syntaqlite: Ein SQLite-Entwicklungswerkzeug-Projekt, das mit KI-Unterstützung erstellt wurde
Werkzeuge

Erstellen von syntaqlite: Ein SQLite-Entwicklungswerkzeug-Projekt, das mit KI-Unterstützung erstellt wurde

Lalit Maganti baute syntaqlite, eine Reihe von Entwicklertools für SQLite, in drei Monaten mithilfe von KI-Codierungsagenten, nachdem er es acht Jahre lang gewollt hatte. Das Projekt erforderte das genaue Parsen von SQL wie SQLite, was die Anpassung von SQLites dichtem C-Codebase mit über 400 Grammatikregeln beinhaltet.

OpenClawRadar