Exécution d'agents LLM locaux sur Mac Minis avec interface Telegram

Un développeur sur r/LocalLLaMA a détaillé un système pour exécuter plusieurs agents LLM locaux sur des Mac Minis, entièrement contrôlés via des messages Telegram depuis un téléphone. Cette configuration élimine les coûts d'API et offre une confidentialité totale tout en conservant des fonctionnalités similaires aux services commerciaux comme Claude Code Channels.
Configuration technique
Le système central utilise :
- Modèles locaux via LMStudio : modèles 35B pour les tâches quotidiennes, modèles 235B pour les raisonnements plus lourds
- Claude Code exécuté dans des sessions tmux sur chaque Mac Mini
- Bots Telegram qui font le pont entre les messages utilisateurs et les sessions tmux
- 80 lignes de Python pour l'implémentation du bot Telegram (disponible sur GitHub)
Le flux de travail est simple : envoyer un message texte au bot Telegram, qui le saisit dans la session tmux, surveille la sortie et renvoie la réponse.
Avantages clés
- Coût continu nul : Le matériel est la seule dépense—pas de clés API, de limites de débit ou de restrictions de quota
- Confidentialité totale : Tout reste sur le réseau local (LAN)
- Flexibilité des modèles : Mélangez et associez différents modèles—un agent exécute Gemini CLI, d'autres utilisent LMStudio pointé vers des modèles Ollama
- Pas de verrouillage fournisseur : LMStudio sert l'API Anthropic Messages nativement, donc Claude Code s'y connecte comme s'il parlait aux serveurs d'Anthropic
Implémentation actuelle
Le développeur exécute 5 agents spécialisés, chacun avec son propre bot Telegram :
- Flux d'approbation avec des boutons Telegram intégrés (Approuver/Rejeter/Modifier) pour examiner les ébauches depuis un téléphone
- Mémoire partagée entre agents via synchronisation git
- Génération multimédia (FLUX.1, Wan 2.2) distribuée à une boîte GPU
- Pipeline de podcast avec synthèse vocale clonée, déclenché par un seul message Telegram
Exigences matérielles
- Modèles 35B : Fonctionnent bien sur Mac avec 64 Go+ de RAM ou GPU 24 Go
- Modèles 235B : Nécessitent 128-256 Go de RAM ou plusieurs GPU
- Le développeur recommande de commencer petit et de monter en puissance selon les besoins
Le modèle de pont tmux est agnostique aux modèles—il ne se soucie pas de ce qui s'exécute dans la session, permettant un échange facile des modèles sous-jacents. Un guide complet de construction pour une seule machine/agent est disponible, avec des instructions multi-machines à venir.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Claude Code Signale des Problèmes de Cohérence dans le Développement en Production
Un abonné payant de Claude Code rapporte des difficultés significatives lors de l'utilisation de l'outil pour un projet de tableau de bord commercial basé sur Flask sur plus de 22 sessions de développement, citant trois schémas récurrents de non-respect des instructions qui ont entraîné une perte de productivité et des problèmes techniques.

Utiliser Claude en tant que Product Manager Critique pour l'Optimisation de Page de Destination
Un développeur a utilisé Claude pour critiquer et réécrire sa page d'accueil en le traitant comme un chef de produit dur et contrariant, ce qui a amélioré la messagerie et les performances SEO.

Utiliser Claude IA pour créer des listes de contrôle marketing d'applications réutilisables pour les développeurs indépendants
Un développeur iOS indépendant a utilisé Claude IA pour créer une liste de contrôle marketing complète couvrant les tâches pré-lancement, semaine de lancement et post-lancement, réduisant le processus de deux semaines à un après-midi par application.

OpenClaw Agent IA Trouve un Emploi Fédéral Correspondant et Crée une Automatisation Quotidienne
Un utilisateur a chargé son agent IA OpenClaw de trouver un emploi fédéral sur usajobs.gov correspondant à ses exigences salariales et préservant ses avantages de retraite spéciaux, ce qui a abouti à une correspondance spécifique de description de poste et à une automatisation de notifications quotidiennes.