Développeur partage son flux de travail hybride en codage IA : Claude pour la planification, modèles locaux pour l'exécution

✍️ OpenClawRadar📅 Publié: April 16, 2026🔗 Source
Développeur partage son flux de travail hybride en codage IA : Claude pour la planification, modèles locaux pour l'exécution
Ad

Un flux de travail hybride d'IA pour le codage réduit les coûts cloud

Un développeur sur r/LocalLLaMA a partagé un flux de travail détaillé qui combine des modèles d'IA cloud et locaux pour réduire les coûts en tokens tout en maintenant la qualité du code. Cette approche répond à la prise de conscience que de nombreuses tâches de codage ne nécessitent pas de modèles cloud coûteux.

L'architecture du flux de travail

Le système suit une logique « Raisonner dans le cloud, Exécuter localement » :

  • Planificateur (Claude 3.5 Sonnet) : Reçoit la tâche et génère un fichier task_context.md précis contenant les instructions, les chemins de fichiers et la logique. Cela coûte environ 300 à 500 tokens.
  • Codeur (Qwen2.5-Coder 30B local via Ollama) : Prend la spécification et le contenu réel des fichiers pour écrire le code. Cela s'exécute localement sans aucun coût.
  • Validateur : Un simple script Bash exécute tsc --noEmit ou mypy pour la vérification des types.
  • Réviseur (Qwen2.5-Coder 7B local) : Fonctionne en parallèle pour vérifier les défauts de logique évidents.
  • Correction automatique : Si la compilation échoue, le journal d'erreurs est renvoyé au codeur local pour 2 à 3 itérations.
Ad

Détails de mise en œuvre

L'ensemble du pipeline est intégré dans un ensemble de scripts Bash utilisant uniquement jq et curl pour communiquer avec l'API Ollama. Le système détecte automatiquement les standards de langage (TypeScript, Python, C++, etc.) en fonction de la sortie du planificateur et ne nécessite pas d'environnements d'exécution Python/Node lourds.

Le développeur note que les modèles locaux (même ceux de 30B) échouent souvent dans le raisonnement architectural complexe, mais sont étonnamment bons pour l'exécution lorsqu'ils reçoivent des spécifications extrêmement claires.

Résultats et économies

Sur un projet TypeScript récent impliquant la modification de 12 fichiers :

  • L'utilisation de Claude a été limitée à la phase de planification initiale uniquement
  • Les modèles locaux ont géré tout le reste : écriture des 12 fichiers, linting et révision
  • Économies totales : réduction d'environ 85 % des tokens par rapport à tout faire dans l'interface CLI de Claude Code

Le développeur a rendu les scripts disponibles dans un dépôt nommé ai-orchestrator sur GitHub (nom d'utilisateur : Mybono) pour ceux qui s'intéressent aux détails de mise en œuvre.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

CopilotKit : Composants React Open-Source pour Interfaces d'Agents
Tools

CopilotKit : Composants React Open-Source pour Interfaces d'Agents

CopilotKit (30k étoiles, MIT) fournit des composants React pour la couche d'interface agent : chat, streaming, appels d'outils, human-in-the-loop et interface générative, avec prise en charge du protocole AG-UI pour LangGraph, ADK, CrewAI et bien d'autres.

OpenClawRadar
SOPHIA Méta-Agent pour la Maintenance des Agents IA
Tools

SOPHIA Méta-Agent pour la Maintenance des Agents IA

SOPHIA est un méta-agent conçu comme un Directeur de l'Apprentissage qui observe, diagnostique, recherche et propose des améliorations aux autres agents d'IA dans les écosystèmes de production. Le système a été conçu à travers 7 itérations utilisant 4 modèles de pointe, avec une approbation humaine requise pour tous les déploiements.

OpenClawRadar
Compétences OpenClaw avec une adoption élevée : Capability Evolver, WACLI, Composio, et plus encore
Tools

Compétences OpenClaw avec une adoption élevée : Capability Evolver, WACLI, Composio, et plus encore

Une publication sur Reddit met en lumière plusieurs compétences OpenClaw avec un nombre d'installations significatif et des cas d'utilisation spécifiques, notamment Capability Evolver pour l'auto-audit du comportement de l'agent, WACLI pour l'accès à WhatsApp, et Composio pour la connexion à plus de 860 applications.

OpenClawRadar
Ghostbar : un client IA Swift natif macOS d'environ 5 Mo qui se cache du partage d'écran
Tools

Ghostbar : un client IA Swift natif macOS d'environ 5 Mo qui se cache du partage d'écran

Ghostbar est un client IA natif Swift pour la barre de menus macOS (~5 Mo) qui utilise window.sharingType = .none pour devenir invisible aux enregistreurs d'écran. Fonctionne avec Ollama, vLLM, llama.cpp et tout backend compatible OpenAI.

OpenClawRadar