free-claude-code ajoute la prise en charge de GLM-5 via NVIDIA NIM, et s'étend à OpenRouter et Discord

free-claude-code, un proxy léger qui convertit les requêtes API Anthropic de Claude Code en formats d'autres fournisseurs, a été mis à jour avec la prise en charge de GLM-5 via NVIDIA NIM et plusieurs nouvelles fonctionnalités. L'outil permet aux développeurs d'utiliser l'interface de codage agentique de Claude Code sans abonnement Anthropic en acheminant les requêtes vers des backends alternatifs.
Principales mises à jour
NVIDIA a ajouté des corrections d'appel d'outils pour z-ai/glm5 à son inventaire NIM, et free-claude-code le prend désormais entièrement en charge. Le niveau gratuit de NVIDIA NIM offre 40 requêtes par minute sans carte de crédit requise.
- Prise en charge d'OpenRouter : Utilisez n'importe quel modèle de la plateforme OpenRouter comme backend, y compris leurs modèles gratuits
- Intégration de bot Discord : Contrôlez Claude Code à distance via Discord en plus de la prise en charge existante des bots Telegram
- Prise en charge du fournisseur local LMStudio : Exécutez des modèles entièrement localement
- Prise en charge de l'extension VSCode de Claude Code
Avantages techniques
- Options sans frais : Le niveau gratuit de NVIDIA NIM (40 reqs/min) et les modèles gratuits d'Open Router ne nécessitent aucun paiement
- Préservation de la pensée entrelacée : Les jetons de pensée entrelacée natifs sont préservés entre les tours, permettant à des modèles comme GLM-5 et Kimi-K2.5 de tirer parti du raisonnement des tours précédents
- 5 optimisations intégrées : Détection rapide des préfixes, saut de génération de titre, saut de mode suggestion et autres optimisations réduisent les appels LLM inutiles
- Contrôle à distance : Les bots Telegram et Discord permettent d'envoyer des tâches de codage depuis des appareils mobiles avec duplication et persistance de session
- Limiteur de débit configurable : Limitation de débit à fenêtre glissante pour les sessions simultanées
- Prise en charge facile des modèles : Les nouveaux modèles lancés sur NVIDIA NIM peuvent être utilisés sans modification de code
- Extensibilité : La structure de code modulaire facilite l'ajout de fournisseurs personnalisés ou de plateformes de messagerie
Modèles pris en charge
Les modèles populaires incluent z-ai/glm5, moonshotai/kimi-k2.5, minimaxai/minimax-m2.5, qwen/qwen3.5-397b-a17b, et stepfun-ai/step-3.5-flash. La liste complète est disponible dans nvidia_nim_models.json. Avec OpenRouter et LMStudio, pratiquement n'importe quel modèle peut être utilisé comme backend.
Le développeur travaille actuellement sur la sélection automatique de modèles basée sur la disponibilité et la qualité. Le projet est open source avec les problèmes et PR bienvenus.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Colony : Une couche de coordination locale qui réduit les jetons de transfert multi-agents de 30 000 à 400
Colony est un substrat de coordination local-first qui réduit les coûts de transfert multi-agents d'environ 30 000 jetons à environ 400 en remplaçant la relecture du contexte par des observations compactes stockées dans SQLite.

Beagle SCM : Un système de gestion de code source qui stocke des arbres AST
Beagle est un système expérimental de gestion de code source qui stocke des arbres de syntaxe abstraite au lieu de blobs binaires, utilisant un format de données de type CRDT appelé BASON et un stockage de support avec des bases de données clé-valeur comme RocksDB.

Développeur Construit un Compilateur Scheme vers WASM en 4 Jours avec l'IA
Un développeur a créé Puppy Scheme, un compilateur Scheme qui cible WebAssembly, en environ 4 jours avec l'aide de l'IA. Le compilateur prend en charge 73 % de R5RS et R7RS, utilise WASM GC, et a réalisé des améliorations du temps de compilation de 3 minutes et demie à 11 secondes en une nuit.

Doublure : Un Agent de Bureau Enseignable Qui Apprend les Tâches par Démonstration
Understudy est un environnement d'exécution d'agent de bureau local-first capable d'opérer des applications GUI, des navigateurs, des outils shell, des fichiers et de la messagerie en une seule session. Vous démontrez une tâche une fois, il enregistre une vidéo d'écran et des événements sémantiques, extrait l'intention plutôt que les coordonnées, et la transforme en une compétence réutilisable.