Optio : Orchestration d'Agents d'IA de Codage dans Kubernetes du Ticket à la PR

Optio est un système d'orchestration open source pour les agents de codage IA qui gère le flux de travail complet, de la réception des tâches à la fusion des demandes de fusion (pull requests), sans nécessiter une supervision humaine constante. Développé avec Fastify, Next.js, BullMQ et Drizzle sur Postgres, il est livré avec un chart Helm pour le déploiement en production.
Fonctionnement
Le système suit un pipeline en trois étapes :
- Réception – Récupère les tâches depuis GitHub Issues, Linear ou une création manuelle
- Exécution – Lance des pods Kubernetes isolés par dépôt, exécute Claude Code ou Codex dans des arbres de travail git
- Surveillance des demandes de fusion – Surveille les vérifications d'intégration continue, l'état de la revue et la préparation à la fusion toutes les 30 secondes
Le principal différentiateur est la boucle de rétroaction. Lorsque l'intégration continue échoue, Optio transmet l'échec à l'agent. Lorsqu'un réviseur demande des modifications, les commentaires deviennent la prochaine instruction de l'agent. Il continue jusqu'à ce que la demande de fusion soit fusionnée ou que vous l'arrêtiez manuellement.
Architecture et fonctionnalités
Optio utilise une architecture de pod par dépôt avec un pod Kubernetes de longue durée par référentiel. Chaque pod maintient une isolation des arbres de travail git pour plusieurs tâches simultanées. Le système inclut :
- Auto-réparation – Redémarre automatiquement l'agent en cas d'échec d'intégration continue, de conflits de fusion ou de demandes de modifications des réviseurs
- Automatisation de la finalisation – Fusionne la demande de fusion par écrasement et ferme le problème lié lorsque toutes les vérifications sont réussies
- Configuration par dépôt – Sélection du modèle, modèles d'instructions, images de conteneur, limites de concurrence et commandes de configuration ajustables par référentiel
- Agent de revue de code – Lance automatiquement un agent de revue en tant que sous-tâche avec une instruction et un modèle séparés
- Tableau de bord en temps réel – Diffusion en direct des journaux, progression du pipeline, analyse des coûts et surveillance de l'état du cluster
Implémentation technique
L'architecture se compose de trois composants principaux :
- Interface web (Next.js sur le port 3100) avec tableau de bord, gestion des tâches et diffusion en direct
- Serveur API (Fastify) avec des workers pour la file d'attente des tâches, le surveillant de demandes de fusion, la surveillance de l'état et la synchronisation des tickets
- Cluster Kubernetes avec des pods de dépôt contenant plusieurs arbres de travail exécutant des agents IA
Les services incluent la gestion du pool de dépôts, l'exécution des agents de revue et la gestion de l'authentification et des secrets, tous soutenus par Postgres pour les tâches, journaux et événements.
📖 Read the full source: HN AI Agents
👀 See Also

Transloadit MCP Server Connecte les Agents IA au Pipeline de Traitement Média
Transloadit a développé un serveur MCP qui connecte Claude et d'autres agents d'IA à leur pipeline de traitement multimédia avec 86 Robots pour le traitement vidéo, audio, image et document. La configuration dans Claude Code nécessite une seule ligne : npx -y @transloadit/mcp-server stdio avec les variables d'environnement TRANSLOADIT_KEY et TRANSLOADIT_SECRET.
DashClaw : une couche d'approbation pour les agents OpenClaw
DashClaw est une couche d'approbation open source qui intercepte les appels d'outils destructeurs dans OpenClaw, Claude Code et d'autres agents, nécessitant une approbation humaine via Telegram avant l'exécution.

Backend personnalisé llama.cpp décharge la multiplication matricielle des LLM vers le NPU AMD XDNA2 sur Ryzen AI MAX 385
Un développeur a créé un backend personnalisé pour llama.cpp qui envoie directement les opérations GEMM vers le NPU AMD XDNA2 sur le Ryzen AI MAX 385 (Strix Halo), atteignant 43,7 t/s en décodage avec 0,947 J/tok pour Meta-Llama-3.1-8B-Instruct Q4_K_M. Le chemin de décodage via le NPU économise environ 10W par rapport au Vulkan seul tout en maintenant le débit de décodage.

Exécuter OpenClaw dans une Micro-VM Isolée avec Void-Box
OpenClaw peut être exécuté en tant que service au sein d'une micro-machine virtuelle isolée en utilisant Void-Box, un runtime à capacités limitées qui exécute des workflows dans des micro-machines virtuelles KVM, offrant une limite d'exécution propre sans intervention de runtime de conteneur.