MartinLoop: Open-Source-Steuerungsebene für KI-Coding-Agenten mit Budgetgrenzen und Prüfpfaden
MartinLoop ist eine Open-Source-Steuerungsebene für KI-Coding-Agenten, die häufige Fehlermodi adressiert: Wiederholen desselben fehlerhaften Ansatzes, Aufgaben ohne Nachweis übergeben, leise Token verbrennen, nicht nachvollziehbare Änderungen vornehmen und auf schwer klassifizierbare Weise scheitern. Es bietet harte Budgetstopps, JSONL-Laufaufzeichnungen, überprüfbare Audit-Trails, Fehlerklassifizierung, testverifizierte Fertigstellung und reproduzierbare Benchmark-Läufe.
Zu den Hauptfunktionen gehören:
- Harte Budgetstopps — Ausgaben für Agentenläufe automatisch begrenzen.
- JSONL-Laufaufzeichnungen — jeder Schritt in einem strukturierten Format protokolliert.
- Überprüfbare Audit-Trails — jeder Entwickler kann die Aktionen des Agenten einsehen.
- Fehlerklassifizierung — kategorisieren, warum ein Agent gescheitert ist (z. B. in einer Schleife feststeckend, falscher Ansatz).
- Testverifizierte Fertigstellung — Agenten müssen definierte Tests bestehen, bevor sie die Fertigstellung melden.
- Reproduzierbare Benchmark-Läufe — Bewertung über Agenten hinweg standardisieren.
Das Projekt wird als CI/CD für autonome Coding-Agenten positioniert. Der Kern ist Open Source auf GitHub: https://github.com/Keesan12/Martin-Loop. Eine Demo ist verfügbar unter https://martinloop.com/demo.
Nützlich für Teams, die Claude Code, Codex, Cursor, Devin-artige Agenten oder benutzerdefinierte Agenten-Schleifen verwenden und Governance, Budgets, Auswertungen und Überprüfbarkeit über ihre KI-Coding-Workflows benötigen.
📖 Vollständige Quelle lesen: r/ClaudeAI
👀 Siehe auch

Tredict MCP-Server ermöglicht es Claude, Trainingspläne zu erstellen und auf Sportuhren zu übertragen.
Ein Entwickler hat einen Tredict MCP Server für Claude.ai und Claude Code erstellt, der komplexe Ausdauertrainingspläne über Prompts erstellt und strukturierte Workouts automatisch auf Garmin-, Coros-, Suunto- und Wahoo-Uhren hochlädt. Der Server enthält eine MCP App für visuelles Feedback innerhalb des Claude-Chats.

Wichtige OpenClaw-Plugins für Entwickler, die KI-Codierungsagenten verwenden
Ein Entwickler testete OpenClaw-Plugins und identifizierte wesentliche Tools, darunter env-guard für Sicherheit, commit-guard zur Verhinderung schlechter Commits, composio für die Verbindung mit über 860 Tools, cortex-memory für lange Sitzungen, cost-tracker für Ausgabentransparenz und openclaw-better-gateway zur Behebung instabiler Verbindungen.

Open-Source-Buch Genesis: 20 Claude-Code-Fähigkeiten für autonomes Bücherschreiben
Book Genesis ist ein Open-Source-System aus 20 spezialisierten Claude Code-Fähigkeiten, das aus einer Buchidee ein vollständiges, veröffentlichungsfertiges Manuskript durch eine 14-Phasen-autonome Pipeline erstellt. Es beinhaltet eine 'Chaos Engine', um KI-Vorhersagemuster zu durchbrechen, und hat eine 68.000 Wörter umfassende Memoire erzeugt, die 9,0/10 auf dem Genesis Score erreichte.
Nadel: Ein 26M-Parameter-Funktionsaufrufmodell mit 6000 Tok/s auf Mobilgeräten
Cactus veröffentlicht Needle als Open Source, ein 26M-Parameter-Modell für einmaligen Funktionsaufruf, das 6000 tok/s Prefill und 1200 tok/s Decoding auf Verbrauchergeräten erreicht. Es basiert auf Simple Attention Networks (ohne FFNs) und übertrifft mehrere größere Modelle in Tool-Use-Benchmarks.