Claude Code-Fähigkeit kombiniert Ansätze von DeepMind Aletheia und Anthropic Harness

Technische Implementierungsdetails
Ein Entwickler hat eine Claude Code-Fähigkeit erstellt, die zwei aktuelle Forschungsansätze kombiniert: DeepMinds Aletheia-Mathematik-Forschungsagenten und Anthropics Multi-Agenten-Codearchitektur. Die Fähigkeit schafft eine Synthese, die keine der ursprünglichen Implementierungen enthielt.
Die Pipeline folgt einer Planner → Generator → Evaluator → Reviser-Struktur. Eine Schlüsselinnovation ist das, was der Entwickler als "blinde Voranalyse" bezeichnet – der Evaluator denkt über den korrekten Ansatz nach, bevor er jemals den Kandidatencode sieht. Dies erweitert Aletheias Entkopplungskonzept, indem der Evaluator zuerst eigene Erwartungen bildet und dann Lösungen daran misst.
Nach der blinden Analyse führt der Evaluator den Code aus und bewertet ihn anhand konkreter Kriterien: Korrektheit, Vollständigkeit, Sicherheit, Widerstandsfähigkeit und Qualität. Er gibt ein strukturiertes Urteil (KORREKT / KORRIGIERBAR / FALSCH) zurück, das gezielte Überarbeitungen antreibt.
Installation und Verwendung
Die Installation erfordert das Erstellen eines Verzeichnisses und das Klonen des Repositorys:
mkdir -p ~/.claude/skills/aletheia
# Repository klonen, SKILL.md + evaluator.md + planner.md kopierenVerwendungsbeispiele aus der Quelle:
/aletheia Erstelle ein Rate-Limiter-Middleware für Fastify mit Redis/aletheia review src/routes/auth.ts/aletheia quick Behebe die N+1-Abfrage im Dashboard
Die Fähigkeit ist verfügbar unter https://github.com/zhadyz/aletheia-harness.
Forschungskontext
DeepMinds Aletheia repräsentiert einen Wechsel vom konvergenten Denken (Reproduzieren bekannter Lösungen) zum divergenten Denken (Generieren origineller mathematischer Ergebnisse). Anthropics Harness-Forschung konzentrierte sich auf Multi-Agenten-Codearchitektur, fehlte jedoch die Entkopplung der Gedankenkette im Evaluator. Diese Implementierung kombiniert beide Ansätze in einer einzigen Pipeline.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Android CLI und Fähigkeiten für KI-Agenten-Entwicklungsworkflows
Google veröffentlichte Android CLI mit Befehlen wie android create und android sdk install, plus das Android Skills GitHub-Repository mit modularen Anleitungssätzen. Interne Benchmarks zeigen eine 70%ige Reduzierung der LLM-Token-Nutzung und eine 3-mal schnellere Aufgabenabwicklung.

GGUF-Modell-Zusammenführungs-Skript und Workflow für Qwen3.5-35B-Varianten
Ein Reddit-Nutzer hat ein Python-Skript zum Zusammenführen von GGUF-Modelldateien mit minimalem Verlust geteilt, das speziell HauhauCS' Qwen3.5-35B-A3B-Uncensored-Modell mit samuelcardillos Claude-4.6-Opus-Reasoning-Distilled-Version kombiniert. Das Skript läuft auf Google Colab Free Tier und beinhaltet Quantisierungsunterstützung via llama-quantize.

Agent-factory: Ein Claude-Code-Plugin für persistente KI-Sub-Agenten-Teams
Agent-factory ist ein Claude Code-Plugin, das persistente Sub-Agenten-Teams mit unterschiedlichen Persönlichkeiten und dateibasierter Erinnerung erstellt. Es erstellt für jedes Projekt 2-5 Agenten durch einen konversationellen Interviewprozess, wobei jeder Agent spezifische Rollen wie Code-Review, Tech-Debt-Tracking oder Strategie übernimmt.

10.33 t/s auf Qwen 3.5 35B mit einem 300-Dollar-Laptop: Vollständige Optimierungsaufschlüsselung
Ein Entwickler erreicht 10,33 t/s auf Qwen 3.5 35B Q4_K_S auf einem Lenovo Ideapad Slim 3i (300 $) mit ik_llama.cpp, Core-Pinning, MTP spekulativer Dekodierung und BIOS-Leistungsoptimierung.