IronBee: Open-Source-Verifizierungsschicht für Claude Code und Cursor

Was IronBee tut
IronBee ist eine Open-Source-Verifizierungsschicht, die Hooks in Claude Code (und funktioniert auch mit Cursor) installiert, um KI-Codierungsagenten daran zu hindern, ungetesteten Code auszuliefern. Das Tool behebt ein häufiges Problem, bei dem Claude Code selbstbewusst behauptet, "Ich habe die Funktion implementiert", ohne zu überprüfen, ob sie im Browser tatsächlich funktioniert.
Hauptfunktionen
- Blockiert den Aufgabenabschluss, bis der Agent Änderungen in einem echten Browser testet
- Verfolgt jede Dateibearbeitung, Browser-Tool-Aufruf und Verifizierungsversuch
- Zwingt den Agenten, strukturierte Urteile abzugeben (nicht nur "sieht gut aus")
- Zwingt den Agenten, Fehler zu beheben und erneut zu verifizieren
- Verwendet den browser-devtools MCP-Server, damit Claude Code Seiten navigieren, Buttons klicken, Formulare ausfüllen, Screenshots machen und Konsolenfehler überprüfen kann
- Enthält
/ironbee-verifymit verschiedenen Modi (Standard, Vollständig, Visuell, Funktional) - Enthält
/ironbee-analyzefür Sitzungsanalysen, die zeigen, wie viel Zeit für Codieren vs. Fehlerbehebung aufgewendet wurde, problematische Dateien und die Verbesserung des Agenten im Laufe der Zeit
Leistungsdaten
Laut der Quelle zeigte die Verfolgung von Sitzungen, dass 82 % Fehler enthielten, die Claude Code ohne Verifizierung ausgeliefert hätte, mit einer Erstpassrate von nur 18 %. In Tests fing und behebt IronBee jeden Fehler, bevor er ausgeliefert wurde.
Einrichtung
Die Installation erfordert zwei Befehle:
npm install -g @ironbee-ai/cli
cd your-project
ironbee installSource information
Ankündigungs-Blogbeitrag: https://medium.com/@serkan_ozal/introducing-ironbee-the-verification-and-intelligence-layer-for-ai-coding-agents-dd554279efa3
GitHub-Repository: https://github.com/ironbee-ai/ironbee-cli
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Erkundung von Clawe: Open-Source-Koordinationssystem für mehrere Agenten
Clawe ist ein Open-Source-Tool, das eine effiziente Koordination mehrerer Agenten ermöglicht und Funktionen wie Planung, Aufgabenverwaltung und Echtzeit-Benachrichtigungen bietet.

APEX-Testbenchmark-Ergebnisse: Qwen 3.5-Leistung bei echten Programmieraufgaben
APEX-Testing-Benchmark-Ergebnisse zeigen die Leistung der Qwen-3.5-Modelle bei 70 echten GitHub-Coding-Aufgaben, wobei die 397B-Version bei Master-Level-Aufgaben auf 1194 ELO abfällt, während GLM-4.7 quantisiert mit 1572 ELO die lokalen Modelle anführt.

osu-mcp: Ein MCP-Server, der Claude ermöglicht, deine osu!-Statistiken in einfachem Englisch zu analysieren
osu-mcp ist ein MCP-Server für die osu! API v2, jetzt im offiziellen MCP Registry. Er stellt 12 Tools zur Verfügung: Spielerprofile, Score-Verlauf, Beatmap-Suche, Ranglisten und mehr. In einer Demo berechnete Claude die pp-pro-Play-Effizienz über mehrere Accounts hinweg und zeigte, dass das Volumen, nicht die Genauigkeit, der Engpass war.

OpenAlly: Lokaler KI-Assistent für Android mit Telefonsteuerung
OpenAlly ist eine Android-App, die einen KI-Assistenten lokal auf Ihrem Smartphone über einen eingebetteten Node.js-Prozess ausführt, mit 51 integrierten Funktionen und Telefonsteuerungsfähigkeiten über den Aster-Begleiter. Sie verbindet sich mit über 19 Messaging-Plattformen und unterstützt 18 Modellanbieter mit Ihren eigenen API-Schlüsseln.