Chaîne de secours LLM multi-fournisseurs avec prise en charge Ollama dans l'IDE IA de production

Resonant Genesis, une plateforme IDE IA de production, a intégré le support des LLM locaux en tant que fournisseur de premier plan dans son architecture. La plateforme s'exécute sur plus de 30 microservices et traite les modèles locaux sur un pied d'égalité avec les fournisseurs cloud comme Groq, OpenAI, Anthropic et Gemini.
Architecture et intégration
La plateforme utilise une bibliothèque partagée rg_llm appelée UnifiedLLMClient qui est montée en volume sur tous les services. Chaque microservice nécessitant des capacités LLM importe ce même client. La chaîne de repli est configurée comme suit : Groq → OpenAI → Anthropic → Gemini → Ollama/LM Studio.
L'extension client léger de l'IDE découvre automatiquement les modèles Ollama locaux et les ajoute à la liste des fournisseurs. Les utilisateurs peuvent configurer le système pour privilégier d'abord les modèles locaux s'ils le souhaitent.
Orchestration côté serveur
Toute l'orchestration se fait côté serveur, l'IDE agissant comme un client léger qui affiche l'interface utilisateur, exécute les outils locaux (opérations sur fichiers, terminal, git) et diffuse les résultats via Server-Sent Events (SSE). La boucle agentique, la sélection d'outils, les invites système et le routage LLM se produisent tous sur le serveur.
Lors de l'utilisation d'un modèle local, il passe toujours par le même pipeline d'exécution régulé :
- Application des politiques pré-exécution (bloque les actions avant leur exécution)
- Appel de fonctions natif via les API des fournisseurs (pas d'injection JSON dans les invites)
- Identité cryptographique (DSID sur Ethereum L2) pour chaque agent
- Les mêmes 59 outils locaux disponibles quel que soit le fournisseur LLM choisi
Avantages pour les utilisateurs de LLM locaux
Pour les utilisateurs exécutant Ollama localement, cette architecture offre :
- Confidentialité : L'architecture client léger signifie qu'aucune intelligence d'entreprise n'est dans le binaire, et avec les modèles locaux, les invites restent locales
- Utilisation d'outils : 59 outils locaux avec appel de fonctions natif, pas de schémas JSON injectés dans les invites
- Repli : Si un modèle local ne peut pas gérer une tâche complexe, il bascule automatiquement vers les fournisseurs cloud
Les développeurs sollicitent les retours des personnes utilisant des modèles locaux, notamment concernant les performances d'appel de fonctions avec des modèles plus petits et quels modèles fonctionnent bien pour l'utilisation agentique d'outils.
Le projet est open source sur GitHub, et un chat invité démontrant l'écosystème d'outils est en ligne sur dev-swat.com (utilise des modèles cloud).
📖 Read the full source: r/LocalLLaMA
👀 See Also

llmLibrarian : Moteur RAG local avec intégration MCP pour la recherche IA basée sur fichiers
llmLibrarian est un moteur RAG local qui expose la récupération via MCP, permettant aux agents IA comme Claude d'interroger des fichiers indexés. Il utilise des collections ChromaDB pour l'organisation, Ollama pour la synthèse, et garde tout sur l'appareil.

Choc des Agents : Une arène de MMA pour tester le comportement des agents IA autonomes
Clash of Agents est une expérience où des agents IA autonomes s'affrontent dans une arène de combat MMA avec des combats au tour par tour, une analyse post-combat et des interactions sociales. Les agents s'inscrivent, choisissent des disciplines de combat, entraînent leurs statistiques et combattent avec 21 mouvements réels de MMA et un système de combos.

Le Chef de Produit Partage Plus de 70 Compétences Claude pour Automatiser les Flux de Travail de Gestion de Produit
Un chef de produit avec 20 ans d'expérience a créé plus de 70 compétences Claude qui automatisent des tâches courantes de gestion de produit, incluant la génération de PRD, l'analyse d'entretiens utilisateurs, le profilage concurrentiel et la construction de feuilles de route. Les compétences sont disponibles sous forme de fichiers .md téléchargeables pour Claude Code.

Le Benchmark Montre que l'Outil CLI Réduit les Coûts de Tokens de Code de Claude de 32% Grâce à la Navigation Structurelle
Un développeur a créé un outil CLI en Rust qui donne aux agents Claude Code des commandes de navigation structurelle comme 'montre-moi un résumé de 180 tokens de cette classe de 6 000 tokens'. Le benchmarking sur Sonnet 4.6 sur 54 exécutions automatisées a montré une réduction de 32 % du coût par tâche et 67 % de modifications de code supplémentaires par session.