Garry Tans gstack: Ein Open-Source-AI-Agent-Framework für Claude Code

Was gstack ist
gstack ist Garry Tans Open-Source-Softwarefabrik, die Claude Code in ein verwaltetes virtuelles Engineering-Team verwandelt. Es ist unter der MIT-Lizenz verfügbar und auf GitHub zu finden. Laut Tan hat er in den letzten 60 Tagen über 600.000 Zeilen Produktionscode geschrieben (35 % Tests) und erledigt als Teil seiner CEO-Aufgaben bei Y Combinator 10.000–20.000 nutzbare Codezeilen pro Tag.
Wie es funktioniert
Das Framework bietet 13 spezialisierte Rollen als Slash-Befehle, die alle Markdown verwenden. Dazu gehören:
/plan-ceo-review– Überdenkt die Produktrichtung (z. B. erweitert „Foto-Upload“ zur automatischen Produkterkennung, zum Abruf von Spezifikationen und Vergleichen aus dem Web und zum automatischen Erstellen von Listings)/plan-design-review– Erkennt KI-Schludrigkeitsmuster, liefert Design-Bewertungen, exportiert DESIGN.md, markiert Muster wie Gradient-Hero, Icon-Grid, einheitliche Radien/plan-eng-review– Legt die Architektur mit ASCII-Diagrammen für Datenflüsse, Zustandsautomaten, Fehlerpfade sowie Testmatrizen und Sicherheitsbedenken fest/review– Findet Produktionsfehler, behebt automatisch Probleme wie verwaiste S3-Bereinigung, fehlende Indizes und markiert Race Conditions
Andere erwähnte Rollen sind QA-Lead (öffnet echten Browser und klickt sich durch Apps), Release-Engineer (veröffentlicht PR) und Designer.
Beispiel-Workflow
Aus der Quelle: Bei der Anfrage „Foto-Upload für Verkäufer“ antwortet /plan-ceo-review mit Erweiterungsvorschlägen, /plan-design-review liefert eine 80-Punkte-Prüfung und Design-System-Ableitung, /plan-eng-review erstellt ASCII-Diagramme und Testmatrizen. Nach Genehmigung schreibt Claude in etwa 8 Minuten 2.400 Zeilen über 11 Dateien (Modelle, Services, Controller, Views, Migrationen, Tests).
Technische Details
Das Repository enthält Verzeichnisse für Workflows, bin, design-consultation, docs, document-release, gstack-upgrade, Plan-Reviews, QA-Reviews, Retro, Review, Scripts, setup-browser-cookies, Ship und Test. Wichtige Dateien sind ARCHITECTURE.md, BROWSER.md, CLAUDE.md, conductor.json und package.json.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Canopy: Terminal-Dashboard zur Verwaltung mehrerer Claude-Code-Agents
Canopy ist eine Open-Source-Terminal-UI, die eine einzige Dashboard-Ansicht bietet, um mehrere KI-Coding-Agenten zu verfolgen, die über Git-Worktrees hinweg laufen. Sie zeigt Agentenstatus (laufend, inaktiv, wartend auf Eingabe, fertig, fehlerhaft) und ermöglicht es Ihnen, in Sitzungen zu springen oder Eingaben zu senden, ohne vollständig zu wechseln.

Freddy MCP Server verbindet Wearables mit KI-Agenten durch kopfloses Anmelden
Freddy ist ein persönlicher MCP-Server, der Wearables (Polar, Oura, Withings, Suunto, Intervals.icu, Hevy, plus WHOOP, Strava, Dexcom in der Beta) über OAuth mit KI-Clients wie Claude Code, ChatGPT und Notion AI verbindet. Das neue Headless-Sign-In ermöglicht geplante Workflows für autonome Agenten.

ThumbGate setzt Tsinghuas Natural-Language Agent Harness Pattern für KI-Sicherheit um
Das Open-Source-Tool ThumbGate implementiert das Natural-Language Agent Harness-Muster aus dem NLAH-Papier der Tsinghua-Universität und bildet vier Komponenten ab: Verträge zu Präventionsregeln aus negativem Feedback, Verifizierungstore zu PreToolUse-Hooks, dauerhafter Zustand zu SQLite+FTS5-Lerndatenbank und Adapter zu MCP-Serveradaptern für mehrere KI-Codierungsagenten.

LLM-Skirmish: Ein Benchmark für Echtzeit-Strategiespiele für KI-Code-Agenten
LLM Skirmish ist ein Benchmark, bei dem KI-Agenten Code schreiben, um 1-gegen-1-Echtzeitstrategiespiele gegeneinander zu spielen. Es verwendet eine modifizierte Screeps-API und testet In-Context-Lernen über fünf Turnierrunden.