Claude Code prend désormais en charge plus de 240 modèles via la passerelle NVIDIA NIM — dont Nemotron-3 120B pour le codage agentique

Les utilisateurs de Claude Code ont découvert que la commande intégrée /model liste non seulement les modèles Claude standard (Opus, Sonnet, Haiku), mais aussi une section complète de passerelle NVIDIA NIM avec plus de 239 modèles supplémentaires qui peuvent être échangés en cours de session.
Modèles clés disponibles
nvidia/nemotron-3-super-120b-a12b(avec et sans mode réflexion)01-ai/yi-largeabacusai/dracarys-llama-3.1-70b-instruct- Des centaines d'autres dans la liste NIM
Nemotron-3 120B pour le codage agentique
La variante de réflexion Nemotron a été testée pour le refactoring multi-fichiers et, selon les rapports, raisonne à travers les modifications avant de toucher au code — idéal pour les tâches agentiques. La latence est plus élevée que Claude, mais elle peut économiser des crédits Claude lors de longues sessions.
Comment l'utiliser
- Ouvrez une session Claude Code
- Exécutez
/model - Défilez au-delà des quatre premières options Claude — les modèles NIM apparaissent en dessous
- Appuyez sur
dpour en définir un comme session par défaut, ou passez--model nvidia/nemotron-3-super-120b-a12bau lancement
Si vous brûlez vos crédits Opus sur de longues sessions, cela vaut la peine d'expérimenter — en particulier pour la génération de code Python ou Rust.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Codebase Memory MCP : Exploration de code basée sur des graphes pour Claude Code
Un développeur a créé un serveur MCP qui indexe des bases de code dans un graphe de connaissances persistant en utilisant Tree-sitter et SQLite, réduisant l'utilisation de tokens par 20x en moyenne pour les requêtes structurelles comme le traçage d'appels et la détection de code mort.

n8n-mcp-lite : Le serveur MCP réduit de 80 % l'utilisation de jetons pour Claude avec les workflows n8n
Un nouveau serveur de protocole de contexte de modèle open-source appelé n8n-mcp-lite aide Claude à raisonner sur les flux de travail d'automatisation n8n tout en réduisant l'utilisation de tokens d'environ 80%. L'outil aborde la nature gourmande en tokens des automatisations visuelles par nœuds en fournissant un balayage ciblé des flux de travail et des mises à jour chirurgicales.

Le serveur LocalSynapse MCP ajoute la prise en charge de macOS et des améliorations de la recherche
LocalSynapse, un serveur MCP hors ligne pour rechercher dans des documents locaux, prend désormais en charge macOS et inclut des corrections pour les requêtes de recherche à plusieurs mots. Le développeur a mis en œuvre des améliorations basées sur les retours, notamment un boost de clic ajusté à la position et une décroissance temporelle comme promotion.

wmux : Multiplexeur de Terminal Électronique pour Windows avec Contrôle Navigateur via MCP
wmux est un multiplexeur de terminal Electron open-source pour Windows 10/11 qui offre des divisions de style tmux, des sessions persistantes et un contrôle navigateur via le protocole Chrome DevTools pour les agents d'IA de codage comme Claude Code. Il s'enregistre automatiquement en tant que serveur MCP et permet aux agents d'interagir avec les navigateurs tout en exécutant plusieurs sessions côte à côte.