Orchino : Système d'Orchestration Multi-Agents Local pour Windows avec Automatisation Parallèle de Navigateur et d'Interface Utilisateur

Orchino est un système d'orchestration multi-agents local pour Windows qui permet l'exécution parallèle de tâches de navigation et de tâches Windows sans interférer avec votre travail actuel. Le système fonctionne via l'automatisation de l'interface utilisateur Windows et le protocole CDP pur (Chrome DevTools Protocol), sans jamais toucher à la souris, au clavier ou au focus de l'écran, vous permettant de continuer à travailler pendant son exécution.
Détails clés
Le développeur a démontré le système avec cette commande : "Rechercher les écouteurs Sony sur Flipkart et Amazon, envoyer les résultats par email, sauvegarder dans le Bloc-notes." Le système a accompli cette tâche en 29,5 secondes en utilisant 4 agents avec une véritable exécution parallèle (et non séquentielle).
Flux d'exécution :
- Phase 1 (concurrente) : Agent de navigation → Flipkart et Agent de navigation → Amazon fonctionnant simultanément via des sessions CDP distinctes
- Phase 2 (concurrente, après la Phase 1) : Agent de navigation → Gmail et Agent Windows → Bloc-notes fonctionnant simultanément
- Les résultats de la Phase 1 sont automatiquement transmis à la Phase 2
Architecture
Le système présente :
- Orchestration parallèle avec des graphes de dépendance (éclatement, regroupement, séquentiel, indépendant — basé sur la décomposition des objectifs)
- Boucle OODA par agent (~1,2–1,9s par itération incluant l'appel LLM)
- 5 agents spécialisés par domaine : Navigation, Windows, Fichier, Terminal, Paramètres système
- Mémoire avec tableau noir + SQLite + ChromaDB
- Les agents fonctionnent localement, LLM via Cerebras
Le projet a été développé seul par un étudiant en informatique en dernière année sur une période de 6 mois.
📖 Read the full source: r/LocalLLaMA
👀 See Also

OpenMontage : Système de Production Vidéo Agentique Open-Source pour Assistants de Codage IA
OpenMontage est un système de production vidéo open-source qui transforme les assistants de codage IA comme Claude Code en studios de production complets. Il gère la recherche, la planification des scènes, l'écriture du scénario, la narration vocale, la sélection musicale, la génération de sous-titres et la validation via des pipelines automatisés.

Exécuter Google Gemma 4 26B-A4B en local avec LM Studio 0.4.0 en mode CLI sans interface
LM Studio 0.4.0 introduit llmster et le CLI lms pour l'inférence locale sans interface graphique. L'article détaille la configuration du modèle Gemma 4 26B-A4B MoE de Google sur un MacBook Pro M4 Pro, atteignant 51 tokens/seconde avec 48 Go de mémoire unifiée.

L'Agent Web TinyFish Surpasse les Concurrents dans les Tests de Performance de Tâches Web
L'agent web TinyFish a atteint un taux de réussite de 81,9 % sur des tâches web difficiles, surpassant nettement des concurrents comme OpenAI Operator à 43,2 %.

Claude 4.6 Opus raisonnement distillé à 14 Go pour Apple Silicon via la quantification MLX
Un développeur a quantifié un modèle Qwen 3.5 27B distillé à partir des trajectoires de raisonnement de Claude 4.6 Opus, réduisant sa taille de 55,6 Go à 14 Go en utilisant MLX pour Apple Silicon, atteignant environ 16 tokens/seconde sur un M4 Pro tout en conservant les capacités de raisonnement analytique du modèle.