Donner à Claude un LLM local comme assistant via MCP sur Mac

✍️ OpenClawRadar📅 Publié: May 12, 2026🔗 Source
Donner à Claude un LLM local comme assistant via MCP sur Mac
Ad

Un utilisateur de Reddit a détaillé comment il a donné à Claude l'accès à un LLM local fonctionnant sur un Mac Mini M4 (24 Go de RAM) via une connexion MCP avec Ollama. La configuration utilise Ollama qui sert Qwen 2.5 Coder (14B) en tant qu'assistant nommé « Frank », à qui Claude peut déléguer des tâches selon des règles spécifiques — doit utiliser moins de jetons que Claude lui-même, ne doit pas affecter la qualité, et nécessite une révision finale.

Détails de la configuration

  • Matériel : Mac Mini M4 avec 24 Go de RAM.
  • LLM local : Qwen 2.5 Coder (14B) fonctionnant via Ollama (également testé avec LM Studio).
  • Connexion : MCP (Model Context Protocol) pour lier Claude (CLI ou application de bureau) au modèle local.
  • Instructions : Claude a reçu un fichier Markdown de mémoire (memory.md) avec des directives sur quand et comment utiliser Frank — par exemple, déléguer le traitement de texte, la gestion de gros fichiers CSS/HTML, et utiliser seulement lorsque cela économise des jetons sans dégrader la qualité de sortie.
Ad

Cas d'utilisation pratiques

  • Traitement et transformation de texte — délégué à Frank pour réduire la consommation de jetons de Claude.
  • Gestion de grands fichiers CSS/HTML qui seraient coûteux à traiter directement par Claude.
  • Exécution de tests de performance, de codage et de logique — Claude évaluait les modèles locaux via Frank plutôt que manuellement.

L'utilisateur a noté qu'il fonctionne aux limites de sa RAM/GPU et ne peut pas tester des modèles plus grands (30B+). Il a invité d'autres personnes disposant de matériel plus puissant à essayer des configurations similaires et à partager les résultats.

Cette approche crée effectivement un assistant gratuit pour Claude, déléguant les tâches lourdes en jetons tout en maintenant la qualité grâce à la révision finale de Claude.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Sponsio : Garde-fous déterministes pour OpenClaw — Bloquer les appels d'outils « légaux mais inappropriés »
Tools

Sponsio : Garde-fous déterministes pour OpenClaw — Bloquer les appels d'outils « légaux mais inappropriés »

Outil open source qui se place à la frontière des outils, évaluant chaque appel avec des contrats de logique temporelle (~0,14 ms p50). Empêche les agents de modifier des fichiers en dehors du répertoire de travail, de forcer un push ou d'exécuter des migrations sur la mauvaise base de données.

OpenClawRadar
Steam City : Une carte 3D pixel art de votre bibliothèque Steam construite avec Claude Code
Tools

Steam City : Une carte 3D pixel art de votre bibliothèque Steam construite avec Claude Code

Un développeur a utilisé Claude Code pour créer Steam City, une visualisation 3D en pixel art de votre bibliothèque Steam. Les heures de jeu déterminent la hauteur des bâtiments, les jeux non lancés restent sombres. Plus de 1 000 joueurs déjà.

OpenClawRadar
DeepSeek V4 Flash offre une qualité proche d'Opus pour les LLM locaux sur site
Tools

DeepSeek V4 Flash offre une qualité proche d'Opus pour les LLM locaux sur site

Un utilisateur de Reddit rapporte que DeepSeek 4 Flash atteint des performances proches d'Opus pour les agents IA locaux sur des données confidentielles, permettant un déploiement sur site sans AWS. Fonctionnant localement avec des GPU NVIDIA, mais encore lent à 1M tokens.

OpenClawRadar
Serveur MCP Local Connecte Claude aux Applications Mac Sans Cloud ni Jetons
Tools

Serveur MCP Local Connecte Claude aux Applications Mac Sans Cloud ni Jetons

Local MCP est un serveur MCP natif pour macOS qui donne à Claude Desktop, Cursor, Windsurf et VS Code un accès aux données de Mail, Calendar, Teams et OneDrive sur votre Mac, sans traitement cloud ni jetons API.

OpenClawRadar