Optio: Orchestrierung von KI-Codierungsagenten in Kubernetes vom Ticket bis zum PR

Optio ist ein Open-Source-Orchestrierungssystem für KI-Code-Agenten, das den gesamten Workflow von der Aufgabenaufnahme bis zum gemergten Pull Request verwaltet, ohne ständige menschliche Aufsicht zu erfordern. Es ist mit Fastify, Next.js, BullMQ und Drizzle auf Postgres aufgebaut und wird mit einem Helm-Chart für den Produktionseinsatz ausgeliefert.
So funktioniert es
Das System folgt einer dreistufigen Pipeline:
- Aufnahme – Holt Aufgaben aus GitHub Issues, Linear oder manueller Erstellung
- Ausführung – Startet isolierte Kubernetes-Pods pro Repository und führt Claude Code oder Codex in Git-Worktrees aus
- PR-Überwachung – Überwacht CI-Checks, Review-Status und Merge-Bereitschaft alle 30 Sekunden
Der entscheidende Unterschied ist die Feedback-Schleife. Wenn CI fehlschlägt, gibt Optio das Scheitern an den Agenten zurück. Wenn ein Reviewer Änderungen anfordert, werden die Kommentare zum nächsten Prompt des Agenten. Es läuft weiter, bis der PR gemergt wird oder Sie es manuell stoppen.
Architektur und Funktionen
Optio verwendet eine Pod-pro-Repository-Architektur mit einem langlebigen Kubernetes-Pod pro Repository. Jeder Pod hält Git-Worktree-Isolation für mehrere gleichzeitige Aufgaben aufrecht. Das System umfasst:
- Selbstheilung – Setzt den Agenten bei CI-Fehlern, Merge-Konflikten oder Reviewer-Änderungsanfragen automatisch fort
- Abschlussautomatisierung – Squash-merged den PR und schließt das verknüpfte Issue, wenn alle Checks bestehen
- Pro-Repository-Konfiguration – Modellauswahl, Prompt-Vorlagen, Container-Images, Parallelitätsgrenzen und Setup-Befehle pro Repository anpassbar
- Code-Review-Agent – Startet automatisch einen Review-Agent als Unteraufgabe mit separatem Prompt und Modell
- Echtzeit-Dashboard – Live-Log-Streaming, Pipeline-Fortschritt, Kostenanalysen und Cluster-Health-Monitoring
Technische Umsetzung
Die Architektur besteht aus drei Hauptkomponenten:
- Web-UI (Next.js auf Port 3100) mit Dashboard, Aufgabenverwaltung und Live-Streaming
- API-Server (Fastify) mit Workern für Task-Queue, PR-Watcher, Health-Monitoring und Ticket-Sync
- Kubernetes-Cluster mit Repository-Pods, die mehrere Worktrees mit laufenden KI-Agenten enthalten
Dienste umfassen Repository-Pool-Management, Review-Agent-Ausführung und Authentifizierung/Geheimnisverwaltung, alle mit Postgres für Aufgaben, Logs und Events.
📖 Read the full source: HN AI Agents
👀 Siehe auch

GrapeRoot MCP Tool reduziert Claude-Code-Token-Verbrauch um 50–70 %
Ein Entwickler hat GrapeRoot erstellt, ein MCP-Tool, das mit Claude Code entwickelt wurde und die ineffiziente Token-Nutzung in Claude Code-Plänen adressiert. Das Tool konzentriert sich auf besseres Kontext- und Zustandsmanagement, um unnötigen Token-Verbrauch zu reduzieren.

ThunderClaw: OpenClaw-Agenten in Thunderbird ausführen zum Umschreiben, Übersetzen und Zusammenfassen von E-Mails
ThunderClaw bringt OpenClaw-Agenten in Thunderbird und bietet Funktionen zum Umschreiben, Übersetzen und Zusammenfassen mit einem Generieren → Vorschau → Anwenden → Rückgängig machen Ablauf.

bad-ass-mcp: Kostenloses, Open-Source-MCP für native Desktop-GUI-Steuerung über Accessibility-API
bad-ass-mcp ist ein Open-Source-MCP-Server, der Claude und anderen KI-Agenten ermöglicht, macOS-, Windows- und Linux-Desktops über die native Barrierefreiheitsschicht zu steuern – ohne Screenshots, ohne Look-Move-Look-Schleifen. Kostenlose Alternative zu Computer Use, Operator oder UiPath.

Benchmark-Ergebnisse: 331 GGUF-Modelle auf Mac Mini M4 16GB getestet
Ein Benchmark von 331 GGUF-Modellen auf einem Mac Mini M4 mit 16 GB RAM zeigt nur 11 Pareto-optimale Modelle, allesamt Mixture-of-Experts-Architekturen. Mixture-of-Experts-Modelle dominieren die Leistung mit einem Median von 20,0 Token/Sekunde gegenüber 4,4 bei dichten Modellen.