Développeur partage son flux de travail hybride en codage IA : Claude pour la planification, modèles locaux pour l'exécution

✍️ OpenClawRadar📅 Publié: April 16, 2026🔗 Source
Développeur partage son flux de travail hybride en codage IA : Claude pour la planification, modèles locaux pour l'exécution
Ad

Un flux de travail hybride d'IA pour le codage réduit les coûts cloud

Un développeur sur r/LocalLLaMA a partagé un flux de travail détaillé qui combine des modèles d'IA cloud et locaux pour réduire les coûts en tokens tout en maintenant la qualité du code. Cette approche répond à la prise de conscience que de nombreuses tâches de codage ne nécessitent pas de modèles cloud coûteux.

L'architecture du flux de travail

Le système suit une logique « Raisonner dans le cloud, Exécuter localement » :

  • Planificateur (Claude 3.5 Sonnet) : Reçoit la tâche et génère un fichier task_context.md précis contenant les instructions, les chemins de fichiers et la logique. Cela coûte environ 300 à 500 tokens.
  • Codeur (Qwen2.5-Coder 30B local via Ollama) : Prend la spécification et le contenu réel des fichiers pour écrire le code. Cela s'exécute localement sans aucun coût.
  • Validateur : Un simple script Bash exécute tsc --noEmit ou mypy pour la vérification des types.
  • Réviseur (Qwen2.5-Coder 7B local) : Fonctionne en parallèle pour vérifier les défauts de logique évidents.
  • Correction automatique : Si la compilation échoue, le journal d'erreurs est renvoyé au codeur local pour 2 à 3 itérations.
Ad

Détails de mise en œuvre

L'ensemble du pipeline est intégré dans un ensemble de scripts Bash utilisant uniquement jq et curl pour communiquer avec l'API Ollama. Le système détecte automatiquement les standards de langage (TypeScript, Python, C++, etc.) en fonction de la sortie du planificateur et ne nécessite pas d'environnements d'exécution Python/Node lourds.

Le développeur note que les modèles locaux (même ceux de 30B) échouent souvent dans le raisonnement architectural complexe, mais sont étonnamment bons pour l'exécution lorsqu'ils reçoivent des spécifications extrêmement claires.

Résultats et économies

Sur un projet TypeScript récent impliquant la modification de 12 fichiers :

  • L'utilisation de Claude a été limitée à la phase de planification initiale uniquement
  • Les modèles locaux ont géré tout le reste : écriture des 12 fichiers, linting et révision
  • Économies totales : réduction d'environ 85 % des tokens par rapport à tout faire dans l'interface CLI de Claude Code

Le développeur a rendu les scripts disponibles dans un dépôt nommé ai-orchestrator sur GitHub (nom d'utilisateur : Mybono) pour ceux qui s'intéressent aux détails de mise en œuvre.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Améliorateur de prompt Claude Code v0.5.3 : Refonte du mode planification et recherche prioritaire par sous-agent
Tools

Améliorateur de prompt Claude Code v0.5.3 : Refonte du mode planification et recherche prioritaire par sous-agent

La v0.5.3 ajoute un hook PreToolUse pour la lisibilité du mode plan (réécritures propres, pas d'historique de décision) et déplace la recherche de requêtes vagues vers les sous-agents Task/Explore sur Haiku pour économiser les tokens du contexte principal. Le plugin fonctionne désormais sous Windows et compte plus de 1,4K étoiles sur GitHub.

OpenClawRadar
Outil de test d'authentification Web Bot gratuit de Fingerprint pour les développeurs d'agents IA
Tools

Outil de test d'authentification Web Bot gratuit de Fingerprint pour les développeurs d'agents IA

Fingerprint a publié un point de terminaison public et gratuit pour tester les implémentations de Web Bot Auth. Cet outil valide les signatures cryptographiques sur les requêtes HTTP, aidant les développeurs de bots et d'agents IA à s'assurer que leur configuration WBA fonctionne correctement avant la mise en production.

OpenClawRadar
Outil Local d'Analyse d'Images par IA Utilise des Modèles de Vision Ollama pour les Retours
Tools

Outil Local d'Analyse d'Images par IA Utilise des Modèles de Vision Ollama pour les Retours

Un développeur a créé une application de bureau gratuite qui analyse localement les images générées par IA à l'aide des modèles de vision Ollama. L'outil fournit des rapports de retour structurés incluant des suggestions d'amélioration et des optimisations de prompts.

OpenClawRadar
Compétence apple-music-play OpenClaw publiée sur ClawHub pour la recherche et la lecture Apple Music
Tools

Compétence apple-music-play OpenClaw publiée sur ClawHub pour la recherche et la lecture Apple Music

La compétence apple-music-play publiée sur ClawHub permet de rechercher dans le catalogue en ligne d'Apple Music et de lire des morceaux directement dans l'application Musique de macOS, sans nécessiter que les chansons soient dans votre bibliothèque locale.

OpenClawRadar