Configuration d'Orchestration Multi-IA Utilisant le Code Claude avec GPT et Gemini

Configuration de développement multi-IA
Un développeur décrit son flux de travail utilisant trois modèles d'IA orchestrés ensemble dans un seul environnement de développement. La configuration résout le problème de perte de contexte entre les sessions en mettant en œuvre un système persistant basé sur des fichiers.
Implémentation de la couche de contexte
Le système utilise des fichiers markdown comme protocole pour maintenir le contexte entre les sessions :
CLAUDE.md- Fichier principal d'opération contenant les projets, préférences, contraintes et l'état de la session actuellePROFILE.md- Contient l'identité professionnelle incluant le parcours, le style de communication et les schémas de décisionSESSION_LOG.md- Enregistre chaque session avec ce qui a été fait, décidé et en attente, organisé du plus récent au plus ancien.claude/history/- Répertoire où un agent de clôture de session capture les apprentissages, décisions, résultats de recherche et idées dans des fichiers séparés
Le développeur rapporte avoir plus de 50 fichiers de connaissances après trois mois d'utilisation. À la fin de chaque bloc de travail, il dit "fermer la session" pour déclencher le sous-agent de clôture de session qui met à jour les journaux de session, l'historique des connaissances, les améliorations de l'espace de travail et le suivi du ROI.
Trois modèles d'IA dans un seul espace de travail
La configuration utilise trois abonnements d'IA :
- Claude Code (Opus 4.6) - Sert d'orchestrateur gérant le travail approfondi, l'analyse complexe, le système de compétences et la gestion des sessions
- GPT-5.4 via Codex CLI - Gère la revue de code, l'implémentation et le débogage (nommé Dario)
- Gemini 3.1 Pro - Effectue la recherche web, l'intégration Google Workspace et l'analyse multimodale (nommé Irene)
Chaque modèle a son propre fichier SOUL.md définissant l'identité, la mission, les forces et les limites :
- Celui de Claude :
.claude/SOUL.md - Celui de GPT :
.codex/SOUL.md - Celui de Gemini :
.gemini/SOUL.md
Ils ont également des fichiers opérationnels (AGENTS.md pour GPT, GEMINI.md pour Gemini) qui spécifient quoi lire au début de la session, quelles règles suivre et qui sont les autres pairs.
Intégration et communication
Les trois modèles lisent les mêmes fichiers de contexte (CLAUDE.md, PROFILE.md, SESSION_LOG.md et le répertoire d'historique), assurant une connaissance partagée entre les sessions.
Les modèles peuvent s'appeler mutuellement en utilisant des commandes CLI sans API ni middleware :
codex exec --skip-git-repo-check "Review this function for edge cases"
gemini -m gemini-3-flash-preview -p "Search for recent benchmarks on X"
claude -p "Summarize the last 3 session log entries"L'ensemble de la configuration fonctionne dans l'IDE Antigravity de Gemini avec trois terminaux pour les trois modèles sur le même écran.
Couches supplémentaires
Une couche asynchrone utilise OpenClaw (sur abonnement OpenAI) pour gérer les tâches planifiées comme les recherches récurrentes, les vérifications de données et les pipelines de contenu. Les trois modèles dans l'IDE peuvent déclencher ou interagir avec ces tâches.
Un serveur MCP personnalisé se connecte à un bot Telegram pour les notifications. Lorsqu'une tâche prend du temps, le modèle notifie le développeur une fois terminé, permettant des flux de travail parallèles sans surveillance constante du terminal.
📖 Read the full source: r/ClaudeAI
👀 See Also

Architecture des Agents OpenClaw : Délégation Multi-Agents, Mémoire à 5 Couches et Systèmes de Surveillance
Un développeur partage des modèles d'architecture OpenClaw pratiques après 7 semaines d'utilisation, incluant la délégation multi-agent avec des modèles spécialisés, un système de mémoire à 5 couches avec dégradation, et un système de surveillance avec trois niveaux de monitoring.

Validation des Idées de Produits avec Claude Code et Démonstrations Remotion
Un développeur a utilisé Claude Code et Remotion pour créer une démo conceptuelle de 60 secondes pour un outil TypeScript YouTube MCP avant d'écrire du code de production, passant environ 2 heures au total. La démo a validé l'idée en montrant une recherche sémantique sur 50 conférences avec sqlite-vec et sans nécessité de clé API.

Utilisateur d'OpenClaw construit une pile de 10 opérations d'automatisation avec des pronostics sportifs, de la génération de leads et de l'exécution numérique.
Un développeur a passé deux mois à construire une pile d'opérations IA sur OpenClaw qui comprend un pipeline quotidien de pronostics sportifs avec des données ESPN et une livraison Twilio, un évaluateur nocturne de pronostics, un scrapping de prospects commerciaux depuis Google Maps, des sondeurs Stripe pour les produits numériques, des e-mails de briefing de session et des rapports d'opérations quotidiens.

La version modifiée de vLLM 0.17.0 fonctionne sur Tesla P40 pour la transcription en temps réel avec Qwen3 ASR 1.7B.
Un développeur a modifié vLLM 0.17.0 pour l'exécuter sur des GPU Tesla P40 avec l'architecture Pascal, obtenant une accélération matérielle quasi complète pour la transcription en temps réel de conférences en utilisant le modèle Qwen3 ASR 1.7B. Le fork est disponible sur GitHub.