Open-source local hook bascule automatiquement entre les modèles Claude pour réduire les coûts d'IA

✍️ OpenClawRadar📅 Publié: March 7, 2026🔗 Source
Open-source local hook bascule automatiquement entre les modèles Claude pour réduire les coûts d'IA
Ad

Un développeur a open-sourcé un crochet local qui sélectionne automatiquement le modèle d'IA Claude le plus rentable en fonction du type de tâche de codage, réduisant potentiellement les coûts d'IA de 50 à 70 % sans perte de qualité.

Fonctionnement

L'outil s'exécute comme un crochet local dans Cursor et Claude Code (tous deux utilisent le même système de crochet) avant que chaque invite ne soit envoyée. Il se place à côté d'Opus/plan et agit comme un filtre frontal efficace qui empêche les mauvais appariements de modèles évidents avant qu'ils n'atteignent les modèles coûteux.

Fonctionnalités clés

  • Lit l'invite et la sélection de modèle actuelle
  • Utilise des règles de mots-clés simples pour classer les tâches (opérations git, travail sur les fonctionnalités, architecture/analyse approfondie)
  • Bloque si vous surpayez (par exemple, Opus pour un commit git) et suggère Haiku ou Sonnet
  • Bloque si vous êtes sous-équipé (Sonnet/Haiku pour l'architecture) et suggère Opus
  • Laisse passer tout le reste inchangé
  • Le préfixe ! contourne complètement le filtre si vous n'êtes pas d'accord avec sa suggestion
Ad

Détails techniques

  • 3 fichiers : bash + python3 + JSON
  • Pas de proxy, pas d'appels API, pas de services externes
  • Conception fail-open : en cas de blocage, Claude Code continue normalement
  • Open-sourcé à : https://github.com/coyvalyss1/model-matchmaker

Performance et tests

Le développeur a analysé plusieurs semaines de ses propres invites et a constaté :

  • 60-70 % étaient des travaux de fonctionnalités standard que Sonnet pouvait gérer
  • 5-20 % étaient du débogage/résolution de problèmes
  • Une part importante était des tâches purement git/renommage/mise en forme qu'Haiku gère de manière identique à 90 % de coût en moins

L'analyse rétrospective a montré que l'outil aurait réduit de 50 à 70 % les dépenses en IA sans baisse de qualité. Après ajustement, il a correctement traité 12/12 invites de test réelles.

Problème résolu

Le problème n'est pas la connaissance - les développeurs savent qu'ils doivent changer de modèle - mais la friction. En état de flow, les développeurs ne veulent pas penser aux menus déroulants. Cet outil automatise le processus de prise de décision.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Pepper MCP Serveur pour l'Interaction et le Débogage du Simulateur iOS
Tools

Pepper MCP Serveur pour l'Interaction et le Débogage du Simulateur iOS

Pepper est un serveur MCP qui injecte une bibliothèque dynamique (dylib) dans les applications du simulateur iOS via DYLD_INSERT_LIBRARIES, permettant une interaction en temps réel, la lecture d'écran, le clic de boutons, l'inspection de variables et la surveillance du trafic réseau via un pont WebSocket.

OpenClawRadar
Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent
Tools

Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent

Un développeur a publié un modèle de chat corrigé pour les modèles Qwen 3.5, résolvant 21 bogues, notamment des plantages lors des appels d'outils, la séparation des appels parallèles et la stabilité des boucles d'agents. Il s'agit d'un remplacement direct testé sur llama.cpp, Open WebUI, vLLM et d'autres plateformes.

OpenClawRadar
Commandant de Flotte : Tableau de bord open-source pour orchestrer plusieurs équipes d'agents Claude Code
Tools

Commandant de Flotte : Tableau de bord open-source pour orchestrer plusieurs équipes d'agents Claude Code

Fleet Commander est un tableau de bord web local qui exécute plusieurs équipes d'agents Claude Code en parallèle sur différentes problématiques. Il utilise une structure d'équipe 'Diamant' avec des agents Planificateur, Développeur et Relecteur qui communiquent en pair-à-pair via SendMessage.

OpenClawRadar
🦀
Tools

Interface utilisateur et serveur pour les autoencodeurs en langage naturel d'Anthropic sur llama.cpp

Un serveur llama.cpp personnalisé et une interface Mikupad pour les autoencodeurs en langage naturel à poids ouverts d'Anthropic, prenant en charge l'extraction d'activations, l'explication, la reconstruction et le guidage par édition d'explications.

OpenClawRadar