Claude Code fügt Multi-Agenten-Code-Review-System hinzu

Code Review für Claude Code
Anthropic hat Code Review für Claude Code eingeführt, ein Multi-Agenten-Überprüfungssystem, das auf internen Prozessen basiert. Verfügbar in der Forschungsvorschau für Team- und Enterprise-Pläne, soll es den Engpass bei der Code-Überprüfung angehen, da die Code-Ausgabe pro Anthropic-Ingenieur im letzten Jahr um 200 % gestiegen ist.
Wie es funktioniert
Wenn ein PR geöffnet wird, setzt Code Review ein Team von Agenten ein, die parallel nach Fehlern suchen, Fehler verifizieren, um falsch-positive Meldungen herauszufiltern, und Fehler nach Schweregrad einstufen. Die Ergebnisse erscheinen als einzelner hochwertiger Überblickskommentar plus Inline-Kommentare für spezifische Fehler. Die Überprüfungen skalieren mit der PR-Größe: große oder komplexe Änderungen erhalten mehr Agenten und tiefere Analysen, während triviale Änderungen leichte Prüfungen erhalten.
Die durchschnittliche Überprüfung dauert laut Anthropics Tests etwa 20 Minuten. Das System genehmigt keine PRs – das bleibt eine menschliche Entscheidung – zielt aber darauf ab, die Lücke zu schließen, damit Prüfer besser abdecken können, was ausgeliefert wird.
Leistungsmetriken
- Vor der Implementierung: 16 % der PRs erhielten substantielle Überprüfungskommentare
- Nach der Implementierung: 54 % der PRs erhalten substantielle Überprüfungskommentare
- Große PRs (über 1.000 geänderte Zeilen): 84 % erhalten Funde, durchschnittlich 7,5 Probleme
- Kleine PRs (unter 50 Zeilen): 31 % erhalten Funde, durchschnittlich 0,5 Probleme
- Ingenieur-Übereinstimmungsrate: weniger als 1 % der Funde als falsch markiert
Praktische Beispiele
In einem Fall markierte Code Review eine einzeilige Änderung an einem Produktionsdienst als kritisch – sie hätte die Authentifizierung für den Dienst unterbrochen. Der Ingenieur teilte mit, dass er es selbst nicht erkannt hätte.
Frühe Zugangskunden haben ähnliche Muster beobachtet. Bei einer ZFS-Verschlüsselungs-Refaktorisierung in TrueNAS' Open-Source-Middleware deckte Code Review einen bereits bestehenden Fehler im benachbarten Code auf: eine Typinkongruenz, die bei jedem Sync den Verschlüsselungsschlüssel-Cache stillschweigend löschte.
Kosten und Kontrolle
Code Review ist teurer als die bestehende Claude Code GitHub Action (die Open Source bleibt). Überprüfungen werden nach Token-Verbrauch abgerechnet und liegen im Durchschnitt bei 15–25 US-Dollar, skaliert mit PR-Größe und Komplexität. Administratoren haben mehrere Kontrolloptionen:
- Monatliche Organisationsobergrenzen für Gesamtausgaben
- Repository-Level-Kontrolle, um Überprüfungen nur für ausgewählte Repositorys zu aktivieren
- Analytics-Dashboard zur Verfolgung überprüfter PRs, Akzeptanzrate und Gesamtprüfkosten
Erste Schritte
Für Administratoren: Aktivieren Sie Code Review in den Claude Code-Einstellungen, installieren Sie die GitHub-App und wählen Sie Repositorys aus. Für Entwickler: Einmal aktiviert, laufen Überprüfungen automatisch bei neuen PRs ohne Konfiguration.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Contextium: Open-Source-Persistent-Context-Framework für Claude Code
Contextium ist ein strukturiertes Git-Repo-Framework, das persistenten Kontext für Claude Code-Sitzungen bereitstellt. Es verwendet eine CLAUDE.md-Datei als Kontext-Router, um relevante Markdown-Dateien nach Bedarf zu laden. Die Open-Source-Version enthält eine Vorlage mit 6 Beispiel-Apps und 27 Integrationsdokumenten.

Reverse Engineering des Apple Neural Engine für das Training von MicroGPT-Modellen
Ein Entwickler hat Apples private APIs des Neural Engine reverse-engineered, um eine Trainingspipeline für ein 110M-Parameter-MicroGPT-Modell zu erstellen, das auf M4-Mac-Hardware eine Leistungseffizienz von 6,6 TFLOPs/Watt erreicht.

Kontext-Gateway: Ein Open-Source-Proxy zur Komprimierung von KI-Agenten-Kontext
Context Gateway ist ein Open-Source-Proxy, der zwischen Coding-Agenten und LLMs sitzt und Tool-Ausgaben komprimiert, bevor sie in das Kontextfenster gelangen. Es verwendet kleine Sprachmodelle, um Signale im Kontext zu erkennen, führt Hintergrundkomprimierung bei 85% Fensterkapazität durch und beinhaltet Ausgabenobergrenzen, ein Dashboard und Slack-Benachrichtigungen.
Netlify testet 11 KI-Modelle fürs Programmieren: Welches ist am besten?
Netlify hat 11 KI-Modelle mit identischen Codier-Prompts getestet und dabei große Unterschiede bei den Ergebnissen und den Kreditkosten festgestellt. Sehen Sie, was sie herausgefunden haben, bevor Sie Ihren nächsten Codier-Agenten wählen.