Implementierung von KI-Prüfungen mit Fortsetzung für quellengesteuerte PR-Überprüfungen

Continue ist ein Tool, das Entwicklern ermöglicht, KI-Prüfungen für Pull-Requests durchzusetzen, indem es Markdown-Dateien verwendet, die im .continue/checks/ Verzeichnis des Repositories gespeichert sind. Diese Prüfungen liefern Feedback als GitHub-Statusprüfungen: Sie werden grün, wenn der Code akzeptabel ist, und rot mit einem Verbesserungsvorschlag, wenn Probleme erkannt werden.
Jede Prüfung wird definiert, indem potenzielle Probleme benannt und beschrieben werden, auf die geachtet werden soll. Zum Beispiel können Sie eine Prüfung mit dem Namen Metrics Integrity erstellen, die als Erkennung von Änderungen beschrieben wird, die die Genauigkeit von Metriken beeinträchtigen könnten, wie z.B. Sitzungszahlen und Fehler beim Event-Tracking. Die Prüfungen sind in der Lage, Funktionen über einfache Diff-Analysen hinaus auszuführen: Sie können Dateien lesen/schreiben, Bash-Befehle ausführen und mit einem Browser interagieren.
Ein Beispiel für eine Prüfung der Metrik-Integrität könnte das Suchen nach Mustern wie engen 'Find or Create'-Abfragen umfassen, die zu Datenverdopplungen führen, oder Event-Tracking innerhalb von Schleifen, das zu mehrfachen, fehlerhaften Aufrufen führt. Dateien mit Schlüsselmustern wie posthog.capture oder trackEvent könnten für diese Überprüfung als kritisch eingestuft werden.
Die Prüfungen laufen automatisch bei jedem PR und erfassen potenzielle Datenprobleme, die traditionelle Tests möglicherweise übersehen, wie subtile Änderungen, die Dashboards betreffen, ohne sofort offensichtliche Fehler zu zeigen.
Um Ihre eigenen Prüfungen einzurichten, können Sie Ihren bevorzugten KI-Coding-Agenten nutzen, um Ihren Codebestand mithilfe des gh CLI zu erkunden und maßgeschneiderte Prüfungen zu erstellen, die auf Ihren Codierungsstandards basieren.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

Sechs Open-Source-Tools, die die Sicherheits-, Kosten- und Komplexitätsprobleme von OpenClaw angehen
Ein Entwickler testete sechs Community-Tools, um die von Cisco aufgedeckten Sicherheitslücken von OpenClaw, die explodierenden Kosten und die komplexe Einrichtung zu lösen. ClawSec bietet Sicherheitsscans und Integritätsprüfungen, Antfarm ermöglicht deterministische Multi-Agenten-Workflows und LanceDB Pro verbessert den Speicherzugriff mit hybrider Vektorsuche.

Alternative KI-Codierungseinrichtung nach der Preiserhöhung von Claude
Ein Entwickler teilt seine aktuelle KI-Codierungseinrichtung mit GPT 5.4 als primärem Modell, Codex als Backup inklusive im ChatGPT-Abonnement und Minimax 2.7 als zusätzliche Absicherung mit Coding-Plan-Preisen.

Pali v0.1: Open-Source-Gedächtnisinfrastruktur für LLMs mit reproduzierbaren Benchmarks
Pali ist eine Open-Source-Speicherinfrastruktur für LLMs, die in Go als einzelne Binärdatei mit Multi-Tenant-APIs, hybridem Retrieval und Plug-and-Play-Erweiterungen entwickelt wurde. Das Release v0.1 enthält einen Benchmark-Suite mit reproduzierbaren Ergebnissen, die Leistungsmetriken für verschiedene Konfigurationen zeigen.

Throttle Meter: Open-Source Claude Code-Nutzungszähler für macOS
Open-Source macOS-Menüleisten-App, die lokale Claude Code-Logs liest, um Echtzeit-Nutzung der letzten 5 Stunden und wöchentliche Nutzung mit Schwellenwertbenachrichtigungen und Token-sparenden Hooks anzuzeigen. Hat auch einen €19 kommerziellen Ableger mit Exact-Modus (liest claude.ais interne API über Safari).