Pizza Bot: Caixa de entrada auto-hospedada para agentes de IA de longa duração, Apache 2.0
O Pizza Bot é um app desktop auto-hospedado para Mac, Windows e Linux que executa agentes de IA em segundo plano e os expõe por meio de uma interface parecida com e-mail: trabalhos concluídos se acumulam em Não lidas, e execuções aguardando sua aprovação ficam em Ação. É Apache 2.0, sem cadastro, sem telemetria, e você usa o provedor de modelo que quiser.
Arquitetura
O Pizza Bot é um servidor e um cliente. O app desktop empacota os dois, mas você pode apontar um cliente para um backend remoto — o autor auto-hospeda o servidor em uma rede doméstica e o acessa do celular via Tailscale. O servidor gerencia o ciclo de vida das threads e faz checkpoints de estado com DeepAgents e LangGraph, e os clientes se reidratam a partir dele conforme necessário. Isso significa que uma execução pode ser desconectada no meio do caminho e retomada de outro cliente. Pausas para aprovação sobrevivem à sessão que as criou, então você pode responder uma hora depois de outro dispositivo.
HTTP/SSE é o protocolo de comunicação. O app desktop, o app de navegador e a CLI de terminal falam todos com o mesmo api-server.
Subagentes, Skills e Memória
- O agente com quem você conversa tem um interpretador QuickJS em sandbox que só consegue acessar seu sistema de arquivos se você conceder uma pasta.
- Cada subagente é um mapeamento 1:1 de uma Skill, e uma barra de Atividades mostra o subagente e suas chamadas de ferramentas enquanto ele trabalha.
- Skills são arquivos
SKILL.mdcomuns com uma política de aprovação por ferramenta, então skills existentes que não precisam de um interpretador de código devem continuar funcionando. - A memória é opcional e armazenada como arquivos markdown simples na sua máquina. Toda chamada de ferramenta é explícita — incluindo consultas à memória.
- As ferramentas vêm de servidores MCP.
Configuração
npm install
npm run build
npm run dev
É necessário Node.js 24 ou mais recente. O npm run dev inicia o frontend Vite e o shell Electron, que cria e supervisiona seu próprio api-server. Instaladores para macOS (Intel e Apple silicon), Windows e Linux (x64 e arm64) são anexados a cada release, com um arquivo SHA256SUMS. Builds para macOS são assinados e notarizados; pacotes para Linux não são assinados.
Configure um modelo em Configurações > Provedores antes de iniciar uma execução ao vivo. Provedores suportados: Amazon Bedrock, Anthropic, Google Gemini, OpenAI, OpenRouter e Ollama. O Bedrock aceita um perfil AWS, chaves de acesso ou uma chave de API do Bedrock mais uma substituição opcional de região (o padrão é AWS_REGION ou us-west-2). OpenAI e Anthropic aceitam URLs base personalizadas; a OpenAI pode selecionar explicitamente Responses ou Chat Completions, e a Anthropic suporta x-api-key ou autenticação bearer.
Ressalvas
O projeto foi criado na Amazon, onde cresceu para mais de 2.000 usuários internos. O catálogo interno de skills e servidores MCP para os sistemas da própria Amazon não acompanhou o lançamento OSS, então ele chega mais enxuto do que aquela versão. É um projeto comunitário, não um serviço da AWS — sem suporte ou SLA. Pastas são adicionadas explicitamente em Configurações > Arquivos; o app não tem acesso padrão ao diretório home. Gatilhos podem ser cron ou webhook, então o trabalho pode começar sem uma conversa aberta.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also
Mesh LLM: Computação Distribuída de IA no Iroh – Execute LLMs em Suas Próprias GPUs
Mesh LLM agrupa GPUs que você já possui em várias máquinas e as expõe como uma única API compatível com OpenAI. Distribui modelos localmente, via roteamento entre pares ou como um pipeline em vários nós usando o transporte QUIC do iroh.

Usuário do Reddit Compartilha Ferramenta de IA para Coleta de Saldos de Contas Financeiras
Uma postagem no Reddit no r/openclaw apresenta um agente de IA projetado para otimizar a coleta de saldos de contas financeiras usando Python. Os usuários discutem o potencial de automação por meio de scripts personalizados que utilizam APIs como a Plaid.

Monitor de Uso do Claude: Aplicativo Gratuito para macOS na Barra de Menu para Acompanhar os Limites do Claude.ai
Um desenvolvedor criou o Claude Usage Monitor, um aplicativo gratuito para a barra de menus do macOS que exibe o uso do Claude.ai com ícones codificados por cores, contadores ao vivo e temporizadores de reinício. O aplicativo lê diretamente das sessões do Claude.ai sem exigir uma chave de API.

agentcache: Biblioteca Python para Cache de Prefixo de LLM Multi-Agente
agentcache é uma biblioteca Python que permite que frameworks de LLM multiagente compartilhem prefixos de prompt em cache, alcançando até 76% de taxas de acerto no cache e reduzindo o tempo de inferência pela metade em testes com GPT-4o-mini.