Executando Agentes de LLM Locais em Mac Minis com Interface do Telegram

✍️ OpenClawRadar📅 Publicado: March 24, 2026🔗 Source
Executando Agentes de LLM Locais em Mac Minis com Interface do Telegram
Ad

Um desenvolvedor no r/LocalLLaMA detalhou um sistema para executar múltiplos agentes de LLM locais em Mac Minis, controlados inteiramente através de mensagens do Telegram de um telefone. A configuração elimina custos de API e oferece privacidade completa enquanto mantém funcionalidade similar a serviços comerciais como Claude Code Channels.

Configuração Técnica

O sistema principal utiliza:

  • Modelos locais através do LMStudio: modelos de 35B para tarefas cotidianas, modelos de 235B para raciocínios mais pesados
  • Claude Code rodando em sessões tmux em cada Mac Mini
  • Bots do Telegram que fazem a ponte entre as mensagens dos usuários e as sessões tmux
  • 80 linhas de Python para a implementação do bot do Telegram (disponível no GitHub)

O fluxo de trabalho é simples: envie uma mensagem de texto para o bot do Telegram, que a digita na sessão tmux, monitora a saída e envia a resposta de volta.

Vantagens Principais

  • Custo contínuo zero: O hardware é a única despesa—sem chaves de API, limites de taxa ou restrições de cota
  • Privacidade completa: Tudo permanece na rede local (LAN)
  • Flexibilidade de modelos: Misture e combine diferentes modelos—um agente executa Gemini CLI, outros usam LMStudio apontado para modelos Ollama
  • Sem lock-in de fornecedor: O LMStudio serve a API de Mensagens da Anthropic nativamente, então o Claude Code se conecta a ele como se estivesse falando com os servidores da Anthropic
Ad

Implementação Atual

O desenvolvedor executa 5 agentes especializados, cada um com seu próprio bot do Telegram:

  • Fluxos de aprovação com botões inline do Telegram (Aprovar/Rejeitar/Ajustar) para revisar rascunhos de um telefone
  • Memória compartilhada entre agentes via sincronização git
  • Geração de mídia (FLUX.1, Wan 2.2) despachada para uma caixa com GPU
  • Pipeline de podcast com TTS de voz clonada, acionado a partir de uma única mensagem do Telegram

Requisitos de Hardware

  • Modelos de 35B: Rodam bem em Mac com 64GB+ de RAM ou GPU de 24GB
  • Modelos de 235B: Precisam de 128-256GB de RAM ou múltiplas GPUs
  • O desenvolvedor recomenda começar pequeno e escalar conforme necessário

O padrão de ponte tmux é agnóstico ao modelo—não importa o que está rodando dentro da sessão, permitindo troca fácil dos modelos subjacentes. Um guia completo de construção para uma única máquina/agente está disponível, com instruções para múltiplas máquinas chegando em breve.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Usando Obsidian com OpenClaw como configuração de segundo cérebro
Use Cases

Usando Obsidian com OpenClaw como configuração de segundo cérebro

Um desenvolvedor compartilha sua configuração usando OpenClaw com Obsidian como um sistema de segundo cérebro, implementando QMD para busca eficiente de notas e carregamento de habilidades sob demanda, reduzindo o uso de tokens em 80-90%.

OpenClawRadar
Experiência OpenClaw testa continuidade temporal da IA com sistemas de memória e compromisso
Use Cases

Experiência OpenClaw testa continuidade temporal da IA com sistemas de memória e compromisso

Uma equipe está usando o OpenClaw há 8 dias para testar se memória persistente e compromissos acumulados podem criar continuidade temporal em IA. Eles implementaram divisões de memória episódica/destilada, verificação de compromissos e registro de estado por turno em JSONL.

OpenClawRadar
O vLLM 0.17.0 modificado roda em Tesla P40 para transcrição em tempo real com Qwen3 ASR 1.7B
Use Cases

O vLLM 0.17.0 modificado roda em Tesla P40 para transcrição em tempo real com Qwen3 ASR 1.7B

Um desenvolvedor modificou o vLLM 0.17.0 para rodar em GPUs Tesla P40 com arquitetura Pascal, alcançando aceleração de hardware quase completa para transcrição de aulas em tempo real usando o modelo Qwen3 ASR 1.7B. A versão modificada está disponível no GitHub.

OpenClawRadar
Configuração de Orquestração Multi-IA Usando Claude Code com GPT e Gemini
Use Cases

Configuração de Orquestração Multi-IA Usando Claude Code com GPT e Gemini

Um desenvolvedor compartilha sua configuração onde o Claude Code orquestra o GPT-5.4 e o Gemini 3.1 Pro no mesmo IDE, usando arquivos markdown para contexto persistente e comandos CLI para comunicação entre modelos.

OpenClawRadar