Executando Agentes de LLM Locais em Mac Minis com Interface do Telegram

Um desenvolvedor no r/LocalLLaMA detalhou um sistema para executar múltiplos agentes de LLM locais em Mac Minis, controlados inteiramente através de mensagens do Telegram de um telefone. A configuração elimina custos de API e oferece privacidade completa enquanto mantém funcionalidade similar a serviços comerciais como Claude Code Channels.
Configuração Técnica
O sistema principal utiliza:
- Modelos locais através do LMStudio: modelos de 35B para tarefas cotidianas, modelos de 235B para raciocínios mais pesados
- Claude Code rodando em sessões tmux em cada Mac Mini
- Bots do Telegram que fazem a ponte entre as mensagens dos usuários e as sessões tmux
- 80 linhas de Python para a implementação do bot do Telegram (disponível no GitHub)
O fluxo de trabalho é simples: envie uma mensagem de texto para o bot do Telegram, que a digita na sessão tmux, monitora a saída e envia a resposta de volta.
Vantagens Principais
- Custo contínuo zero: O hardware é a única despesa—sem chaves de API, limites de taxa ou restrições de cota
- Privacidade completa: Tudo permanece na rede local (LAN)
- Flexibilidade de modelos: Misture e combine diferentes modelos—um agente executa Gemini CLI, outros usam LMStudio apontado para modelos Ollama
- Sem lock-in de fornecedor: O LMStudio serve a API de Mensagens da Anthropic nativamente, então o Claude Code se conecta a ele como se estivesse falando com os servidores da Anthropic
Implementação Atual
O desenvolvedor executa 5 agentes especializados, cada um com seu próprio bot do Telegram:
- Fluxos de aprovação com botões inline do Telegram (Aprovar/Rejeitar/Ajustar) para revisar rascunhos de um telefone
- Memória compartilhada entre agentes via sincronização git
- Geração de mídia (FLUX.1, Wan 2.2) despachada para uma caixa com GPU
- Pipeline de podcast com TTS de voz clonada, acionado a partir de uma única mensagem do Telegram
Requisitos de Hardware
- Modelos de 35B: Rodam bem em Mac com 64GB+ de RAM ou GPU de 24GB
- Modelos de 235B: Precisam de 128-256GB de RAM ou múltiplas GPUs
- O desenvolvedor recomenda começar pequeno e escalar conforme necessário
O padrão de ponte tmux é agnóstico ao modelo—não importa o que está rodando dentro da sessão, permitindo troca fácil dos modelos subjacentes. Um guia completo de construção para uma única máquina/agente está disponível, com instruções para múltiplas máquinas chegando em breve.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Testando o OpenClaw para Planejamento de Viagens Multipaíses com Integração MoLOS
Um desenvolvedor testou o OpenClaw com o MoLOS para planejar uma viagem China-Japão, gerando itinerários diários, sugestões de voos/hotéis e mais de 50 tarefas automatizadas, enquanto identificava limitações nos tempos de transporte e validação de atrações.

Usando o SkyClaw com o Google Sheets para o Fluxo de Trabalho de Candidatura a Empregos
Um usuário do Reddit compartilha seu fluxo de trabalho usando o agente SkyClaw da OpenClaw para automatizar tarefas de busca de emprego. Eles configuraram uma Planilha Google onde o agente adiciona listagens de empregos com base em seu currículo, com atualizações diárias e notificações.

Otimização de Custos do OpenClaw: Como um Desenvolvedor Corrigiu um Erro de US$ 750 com Roteamento de Modelos
Um desenvolvedor compartilha como trocar todos os subagentes do OpenClaw para o modelo gratuito Hunter Alpha no OpenRouter levou a falhas silenciosas, incluindo um agente de produção de vídeo que gerou código válido, mas produziu um vídeo preto e silencioso de 9 segundos. A solução envolveu implementar roteamento explícito de modelos com base nos requisitos da tarefa.

Desbloqueando Eficiência: O Rastreador de Pedidos Evenrealities Aprimora as Capacidades da OpenClaw
Descubra como o Evenrealities Order Tracker otimiza a experiência dos usuários do OpenClaw, aproximando ainda mais a automação de IA e a gestão simplificada.