Bernstein: Ein Kubernetes-ähnlicher Orchestrator für KI-Coding-Agents mit Verifizierung und Modellrichtlinien

✍️ OpenClawRadar📅 Veröffentlicht: 13. April 2026🔗 Source
Bernstein: Ein Kubernetes-ähnlicher Orchestrator für KI-Coding-Agents mit Verifizierung und Modellrichtlinien
Ad

Bernstein ist ein Orchestrator für KI-Codierungsagenten, den der Ersteller als "Kubernetes für Codierungsagenten" beschreibt. Im Gegensatz zu einfacheren Tools, die Agenten in parallelen Arbeitsbäumen starten, befasst sich Bernstein mit dem, was der Entwickler als "die anderen 95%" des Problems bezeichnet.

Hauptfunktionen

Das System umfasst mehrere kritische Komponenten:

  • Verifizierung: Eine "Hausmeister"-Komponente überprüft unabhängig die Agentenausgaben nach jeder Aufgabe. Sie führt Tests durch, prüft Unterschiede und überprüft die Ausgabe, weil "Agenten lügen" - sie behaupten möglicherweise, dass Tests bestanden wurden, obwohl dies nicht der Fall ist, oder sagen, dass sie Dateien übernommen haben, obwohl sie es nicht getan haben.
  • Modellrichtlinien-Engine: Bietet Zulassungs-/Sperrlisten pro Anbieter, Datenresidenzanforderungen, bevorzugtes Routing und Kostenobergrenzen. Der Ersteller vergleicht dies mit "K8s-Netzwerkrichtlinien, aber für LLM-Anbieter".
  • Deterministische Planung: Verwendet reines Python für die Planung anstelle von LLMs, wodurch ein deterministischer Kontrollfluss mit null LLM-Tokens für die Koordination entsteht. Ein Epsilon-Greedy-Bandit lernt das Routing im Laufe der Zeit.
  • Agenten-agnostisches Design: Enthält 13 Adapter für Claude Code, Codex, Gemini CLI, Cursor, Qwen, Aider, Amp, Roo Code, Goose, Kilo, Kiro, OpenCode und generische Agenten. Claude Code hat die tiefste Integration.
  • Skalierungsfunktionen: Mit 500K+ Zeilen und ~5000 Tests enthält Bernstein Sicherungen, Kostenanomalieerkennung, Schleifenerkennung, Deadlock-Erkennung, PII-Scanning, HMAC-verkettete Prüfprotokolle, progressive Berechtigungen und Quarantäne für verdächtige Ausgaben.
  • Selbstentwicklung: Kann sich selbst mit bernstein --evolve entwickeln.
Ad

Technische Details

Der Ersteller merkt an, dass das Starten von Agenten in Arbeitsbäumen "das Hallo-Welt dieser Domäne" ist und dass die meisten Multi-Agenten-Frameworks ein LLM verwenden, um andere LLMs zu planen, was "langsam, teuer und nicht-deterministisch" ist. Bernsteins Ansatz verwendet reines Python für deterministischen Kontrollfluss.

Das Projekt wurde im großen Maßstab mit 500K+ Codezeilen und etwa 5000 Tests getestet. Der Entwickler baute Funktionen wie Sicherungen und Anomalieerkennung, weil "Dinge kaputtgingen und dies die Lösungen waren".

Der Ersteller ist ein Einzelentwickler aus Israel, der erwähnt, "unter Raketen (buchstäblich) zu bauen" und dass das Projekt ihn überholt hat, weshalb er nach Mitwirkenden sucht.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Banker erstellt Kredit-Due-Diligence-Tool mit nur 31 KI-Prompts unter Verwendung von Claude
Werkzeuge

Banker erstellt Kredit-Due-Diligence-Tool mit nur 31 KI-Prompts unter Verwendung von Claude

Ein Banker mit 17 Jahren Erfahrung in der MSME-Kreditprüfung in Indien hat 31 KI-Prompts quelloffen gemacht, die eine Visitenkarte in einen vollständigen Kreditprüfbericht verwandeln und einen 3-4-wöchigen Prozess auf 30 Minuten verkürzen. Das Tool wurde ausschließlich durch Gespräche mit Claude erstellt, ohne eine einzige Codezeile zu schreiben.

OpenClawRadar
Claude Fable Demo: Unermüdlich proaktive Fehlerbehebung mit Browser-Automatisierung
Werkzeuge

Claude Fable Demo: Unermüdlich proaktive Fehlerbehebung mit Browser-Automatisierung

Simon Willison beschreibt, wie Claude Fable 5 einen horizontalen Scrollbalken-Fehler ohne Anweisung automatisch behoben hat. Es nutzte Browser-Automation, JavaScript-Injection und einen eigenen CORS-Webserver.

OpenClawRadar
KI-Funktionen: Laufzeit-Codegenerierung mit automatisierter Verifizierung
Werkzeuge

KI-Funktionen: Laufzeit-Codegenerierung mit automatisierter Verifizierung

AI Functions ist eine Python-Bibliothek, mit der Sie Funktionen mit natürlichen Sprachspezifikationen anstelle von Implementierungscode definieren können, zur Laufzeit generierten LLM-Code ausführt und Ausgaben mit Nachbedingungen validiert, die bei Fehlern automatische Wiederholungen auslösen.

OpenClawRadar
Klartext: Ein Open-Source-Claude-Skill für ehrliches Feedback, nicht für Bestätigung
Werkzeuge

Klartext: Ein Open-Source-Claude-Skill für ehrliches Feedback, nicht für Bestätigung

Eine neue Open-Source-Claude-Skill namens Straight Talk bringt Claude dazu, Ideen nicht mehr automatisch zu bestätigen, sondern erst die Situation zu verstehen, dann Gegenargumente zu generieren und Annahmen zu hinterfragen.

OpenClawRadar