Claude Code réimplémenté en open-source modifié pour la compatibilité avec les modèles locaux

Ce qui a été corrigé
Un développeur a corrigé la réimplémentation open-source de Claude Code pour résoudre les problèmes de compatibilité avec les modèles locaux. La version originale ne pouvait pas fonctionner avec des modèles locaux en raison de dépendances clientes codées en dur vers Anthropic.
Changements clés
- L'interface CLI détecte maintenant automatiquement le fournisseur à partir du nom du modèle et des variables d'environnement
- Prend en charge Ollama, LM Studio, OpenAI, xAI ou tout point de terminaison compatible OpenAI
- Corrigé plusieurs bugs d'affichage qui apparaissaient dans PowerShell
- Ajouté des fonctionnalités PowerShell
- Testé sur Windows 11 avec Ollama dans Docker
- Devrait également fonctionner sur Linux/macOS (la compilation Rust est multiplateforme, bien que certains tests utilisent des API spécifiques à Unix)
Détails techniques
La correction supprime la dépendance stricte au client API d'Anthropic, rendant l'outil suffisamment flexible pour fonctionner avec divers fournisseurs de modèles locaux. Le système de détection automatique examine les noms de modèles et les variables d'environnement pour déterminer quelle interface de fournisseur utiliser.
Ce type de modification est particulièrement utile pour les développeurs qui souhaitent expérimenter des capacités de génération de code similaires à Claude en utilisant leur propre matériel et leurs fournisseurs de modèles préférés, plutôt que d'être enfermés dans un service cloud spécifique.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Développeur teste Apple Intelligence pour les tâches de presse-papiers sur l'appareil
Un développeur a créé un gestionnaire de presse-papiers en utilisant le framework Foundation Models d'Apple Intelligence, le trouvant raisonnable pour les tâches quotidiennes comme les résumés courts et les reformulations, mais limité sur le langage ambigu et les travaux détaillés.

Sandbox0 : Infrastructure de bac à sable Kubernetes native open source pour agents IA
Sandbox0 est une infrastructure de sandbox open-source pour agents d'IA construite sur Kubernetes avec un stockage persistant via JuiceFS et une mise à l'échelle automatique. Elle répond aux limitations telles que les plafonds de concurrence et l'exécution éphémère rencontrées dans les solutions existantes.

Pu.sh : Un harnais d'agent de codage en script shell de 400 lignes issu de HN
Pu.sh est un harnais d'agent de codage portable en 400 lignes de shell (sh, curl, awk), supportant Anthropic + OpenAI, 7 outils, REPL, point de contrôle/reprise, et mode pipe — avec 90 tests sans API.

Benchmark : MLX vs Ollama exécutant Qwen3-Coder-Next 8-Bit sur MacBook Pro M5 Max
Un benchmark comparant les backends d'inférence MLX et Ollama exécutant la quantification 8 bits de Qwen3-Coder-Next sur un MacBook Pro M5 Max avec 128 Go de RAM montre que MLX atteint environ 72 tokens par seconde, soit environ le double du débit d'Ollama sur diverses tâches de programmation.