Argus: Eine GitHub-App, die CLAUDE.md-Dateien überprüft und Bewertungen in PRs veröffentlicht

✍️ OpenClawRadar📅 Veröffentlicht: 18. April 2026🔗 Source
Argus: Eine GitHub-App, die CLAUDE.md-Dateien überprüft und Bewertungen in PRs veröffentlicht
Ad

Argus ist eine GitHub-App, die automatisch CLAUDE.md-Dateien überprüft und bei jedem Pull Request eine Bewertung veröffentlicht. Das Tool wurde mit Claude Code entwickelt, was bei der Gestaltung des Bewertungsstandards und der Erstellung des Webhook-Handlers half.

Was Argus macht

Die App analysiert CLAUDE.md-Dateien anhand eines Bewertungsstandards und gibt direkt in GitHub Pull Requests Feedback. Nachdem sie gegen mehrere Repositories gelaufen ist, stellte der Entwickler fest, dass die meisten CLAUDE.md-Dateien an denselben beiden Prüfpunkten scheitern:

  • Keine expliziten Grenzen des Anwendungsbereichs (was der KI-Agent nicht tun darf)
  • Kein Eskalationspfad (wann der Agent stoppen und einen Menschen fragen sollte)
Ad

Verfügbarkeit und Installation

Argus ist kostenlos für öffentliche Repositories unter github.com/apps/argusreview installierbar. Das Tool ermöglicht Entwicklern zu sehen, wie ihre CLAUDE.md-Dateien im Vergleich zu den etablierten Standards abschneiden.

CLAUDE.md-Dateien sind Konfigurationsdateien, die KI-Codierungsassistenten wie Claude Code anleiten, indem sie Anweisungen, Einschränkungen und Richtlinien dafür bereitstellen, wie die KI Codierungsaufgaben angehen sollte. Klare Grenzen des Anwendungsbereichs und Eskalationspfade helfen zu verhindern, dass die KI unangemessene Änderungen vornimmt oder bei Aufgaben stecken bleibt, die menschliches Eingreifen erfordern.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

ATLAS: Open-Source-Testzeit-Berechnungspipeline für Qwen3-14B erreicht Spitzenleistung im Bereich Coding
Werkzeuge

ATLAS: Open-Source-Testzeit-Berechnungspipeline für Qwen3-14B erreicht Spitzenleistung im Bereich Coding

Ein College-Student hat ATLAS entwickelt, eine Open-Source-Testzeit-Rechenpipeline, die auf Qwen3-14B basiert und 74,6 % pass@1 bei LiveCodeBench v5-Problemen erreicht, bei Stromkosten von etwa 0,004 $ pro Aufgabe. Das System ist bei komplexen Problemen langsam, bietet aber eine vergleichbare Leistung wie Spitzenmodelle wie GPT-5 (84,6 %) und Claude 4.5 Sonnet (71,4 %).

OpenClawRadar
Benchmark: MLX vs. Ollama beim Ausführen von Qwen3-Coder-Next 8-Bit auf dem M5 Max MacBook Pro
Werkzeuge

Benchmark: MLX vs. Ollama beim Ausführen von Qwen3-Coder-Next 8-Bit auf dem M5 Max MacBook Pro

Ein Benchmark-Vergleich der MLX- und Ollama-Backends, die Qwen3-Coder-Next mit 8-Bit-Quantisierung auf einem M5 Max MacBook Pro mit 128 GB RAM ausführen, zeigt, dass MLX etwa 72 Token pro Sekunde erreicht, was ungefähr der doppelten Durchsatzrate von Ollama über verschiedene Programmieraufgaben hinweg entspricht.

OpenClawRadar
Lokales Verhaltensüberwachungssystem mit MCP-Pipeline und Claude Code
Werkzeuge

Lokales Verhaltensüberwachungssystem mit MCP-Pipeline und Claude Code

Ein Entwickler hat ein lokales Verhaltensüberwachungssystem namens BRAIN erstellt, das App-Wechsel, Dateioperationen und Entwicklungssitzungen verfolgt und Daten über einen benutzerdefinierten MCP-Server an Claude Code weiterleitet. Das System läuft zu 100 % lokal ohne Cloud-Abhängigkeiten.

OpenClawRadar
Entwickler erstellt Werkzeug für realistische relationale Datenbankgenerierung
Werkzeuge

Entwickler erstellt Werkzeug für realistische relationale Datenbankgenerierung

Ein Entwickler hat ein Tool erstellt, das vollständig geladene relationale Datenbanken mit realistischen Daten generiert und so das Problem der Erstellung von Testdatenbanken mit intakten Fremdschlüsselbeziehungen und konsistenten Daten über Tabellen hinweg löst.

OpenClawRadar