Stagent: Open-Source-Ops-Layer für das Claude Agent SDK mit lokaler Governance und Workflow-Orchestrierung

Was Stagent leistet
Stagent ist ein Open-Source-Koordinationsarbeitsbereich mit lokalem Fokus, der auf dem Claude Agent SDK und der Claude API aufsetzt. Es standardisiert, wie Sie Agentenarbeit über beide Laufzeitumgebungen hinweg routen, überwachen und messen, ohne diese zu ersetzen. Das Kernproblem, das es löst: Sie sollten keine Tabelle benötigen, um zu verfolgen, was Ihre KI-Agenten tun, was sie kosten oder ob sie die Berechtigung haben, gefährliche Befehle auszuführen.
Wichtige Funktionen und Architektur
Das System umfasst 15 Produktoberflächen: Start-Dashboard, Ausführungsboard, Posteingang, Überwachung, Kostenbuch, Chat, Umgebungsscanner und mehr. Es bietet 6 Workflow-Orchestrierungsmuster: Sequenz, parallele Verzweigung/Zusammenführung, Kontrollpunkt, Planer-Ausführer, autonome Schleife und Multi-Agenten-Schwarm. Es gibt 52+ wiederverwendbare Agentenprofile, darunter Spezialistenrollen wie Code-Reviewer, Forscher, Dokumentenschreiber, Vermögensverwalter und Reiseplaner, die als Claude Code-Fähigkeiten mit Tool-Richtlinien und Verhaltensanweisungen gebündelt sind.
Die menschliche Governance umfasst Genehmigungen wie einmal erlauben, immer erlauben und verweigern. Jede Tool-Anfrage wird durch eine Benachrichtigungswarteschlange geleitet, wobei AskUserQuestion immer eine Aufforderung auslöst, unabhängig von gespeicherten Berechtigungen. Budgetgrenzen bieten tägliche/monatliche Ausgabenobergrenzen, die neue Provider-Aufrufe strikt stoppen, wenn sie überschritten werden, mit Warnungen bei 80% und ordnungsgemäßem Abschluss bereits laufender Arbeiten.
Das übergreifende Kostenbuch verfolgt Token-Geschwindigkeit, Modellkonzentration, Laufzeitanteil und Prüfpfade pro Aufgabe über Claude und Codex hinweg in einer Ansicht. Geplante Ausführungen unterstützen wiederkehrende oder einmalige Prompts mit Agentenprofil-Auswahl, Ausführungslimits und Ablaufzeitfenstern.
Technische Umsetzung
Das gesamte Produkt wurde mit Claude Code und Opus erstellt, vom Datenbankschema bis zu UI-Komponenten. Die Architektur ist lokal-fokussiert ohne externe Abhängigkeiten und verwendet SQLite im WAL-Modus mit Drizzle ORM (16+ Tabellen). Alles läuft auf Ihrem Rechner ohne Cloud oder Telemetrie.
Das Genehmigungssystem verwendet die Benachrichtigungstabelle als Nachrichtenwarteschlange. Wenn ein Agent ein gefährliches Tool anfordert, fragt canUseTool die Benachrichtigungstabelle ab, bis ein Mensch antwortet, was Governance ohne Websockets oder externe Warteschlangen ermöglicht.
Workflow-Muster umfassen autonome Schleifen, die Agenten iterativ ausführen, wobei jede Iteration vorherige Ausgaben sieht (inspiriert von Karpathys "One GPU Research Lab"-Konzept), Multi-Agenten-Schwärme mit einem Bürgermeister→Arbeiter→Raffinerie-Muster mit begrenzter Parallelität (2-5 Arbeiter) und Schritt-für-Schritt-Wiederholung, sowie parallele Verzweigung/Zusammenführung, die Forschungsfragen auf Zweige aufteilt und Ergebnisse synthetisiert.
Der Blaupausen-Katalog bedeutet, dass Sie Workflows nie manuell konfigurieren müssen. Sie wählen eine Vorlage (Code-Review, Forschungsvertiefung, Sprint-Planung), füllen Variablen aus, und die Blaupause löst Profile, Prompts und bedingte Schritte automatisch auf.
Der Umgebungsscanner entdeckt alle Ihre Claude Code- und Codex CLI-Artefakte – Fähigkeiten, Hooks, MCP-Server, Berechtigungen, Speicherdateien – und zeigt eine einheitliche Gesundheitsbewertung, wobei typische Scans 10-50 ms dauern.
Tech-Stack
Next.js 16, React 19, TypeScript, Tailwind v4, shadcn/ui, SQLite, Drizzle ORM, Claude Agent SDK, Codex App Server.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Lokale KI-Entwicklung mit Qwen3.6-27B und Opencode auf einer 5090
Ein Reddit-Nutzer berichtet über seinen Wechsel von cloudbasierten KI-Coding-Tools (Claude Code, Cursor) zu einem lokalen Setup mit Opencode + llama-server + Qwen3.6-27B bei 128K Kontext auf einer einzelnen RTX 5090 und hebt die Freiheit von Nutzungslimits und Account-Risiken hervor.

Code-Graph-MCP: Open-Source-MCP-Server reduziert Claude-Code-Token-Verbrauch um 40-60%
code-graph-mcp ist ein MCP-Server, der Codebasen in einen AST-Wissensgraphen indexiert und dabei mehrere grep/read-Aufrufe durch einzelne strukturierte Abfragen ersetzt. Der Entwickler berichtet von 40-60 % Einsparungen bei den gesamten Sitzungstokens und 80 % weniger Tool-Aufrufen pro Navigationsaufgabe.

Codex Chrome-Erweiterung fügt Hintergrund-Browserautomatisierung über Tabs hinzu
Codex neue Chrome-Erweiterung unter macOS/Windows ermöglicht parallele Browser-Task-Ausführung in Hintergrund-Tabs, ohne den Browser zu übernehmen – für Debugging-Abläufe, Dashboards, Recherchen und CRM-Updates.

MCP-Server fügt Claude Code persistenten Speicher mit Abruf-Bewertung hinzu
Ein Entwickler hat einen MCP-Server namens engram-mcp erstellt, der Claude Code persistenten Speicher über Sitzungen und Projekte hinweg ermöglicht, mit automatischer Abrufbewertung basierend auf Erfolgsergebnissen und Erkennung von Wissensverfall.