Mesh LLM: Computação Distribuída de IA no Iroh – Execute LLMs em Suas Próprias GPUs
Mesh LLM é uma plataforma de computação de IA distribuída que agrupa GPUs e memória de várias máquinas e expõe tudo como uma única API compatível com OpenAI em http://localhost:9337/v1. Você pode iniciar um nó, adicionar mais depois, e deixar a malha decidir se um modelo é executado localmente, roteado para um par que já o carregou, ou dividido entre várias máquinas.
Como Funciona
Por baixo dos panos, o Mesh LLM usa endpoints iroh para identidade (chave pública) e rede. Não há servidor central. O iroh lida com travessia NAT, furar firewall e fallback de relay via conexões QUIC. O protocolo define três ALPNs:
mesh-llm/1– malha principal (gossip, roteamento, túneis HTTP, canais de plugin)mesh-llm-control/1– plano de controle do proprietário (sincronização de configuração, atestação de propriedade)skippy-stage/2– transporte de ativação sensível a latência para modelos divididos
Dentro da conexão principal, toda comunicação é multiplexada em streams QUIC bidirecionais identificados por um único byte inicial:
0x01GOSSIP – anúncios de pares (modelos, GPU, RTT, capacidades)0x04TUNNEL_HTTP – requisições de inferência proxy para um par0x05ROUTE_REQUEST – consulta quais modelos um par hospeda0x06PEER_DOWN – notificação de par inativo0x07PEER_LEAVING – desligamento gracioso0x08PLUGIN_CHANNEL – RPC de plugin0x0eDIRECT_PATH_REQUEST – compartilha endereços diretos para travessia NAT
Modo Dividido ("Skippy")
Para modelos grandes demais para uma única GPU (por exemplo, 235B mixture-of-experts), o Mesh LLM tem um modo dividido que particiona um modelo por intervalos de camadas em estágios. Camadas 0–15 são executadas em um nó, 16–31 no próximo, e assim por diante. As ativações fluem de um estágio para o próximo via streams QUIC. Várias máquinas modestas podem juntas executar um modelo que nenhuma conseguiria segurar sozinha.
Arquitetura com Plugins
Plugins declaram suas capacidades em um manifesto. O runtime os inicia, roteia chamadas, e expõe suas capacidades via MCP, HTTP, inferência e eventos da malha. O catálogo vem com mais de 40 modelos — desde modelos de meio bilhão de parâmetros que cabem em um laptop até os gigantes de 235B.
Para Quem é
Equipes que querem controlar sua própria infraestrutura de IA: compartilhar computação GPU de forma privada ou pública, executar modelos maiores sem comprar hardware maior, e evitar dependência de fornecedor. Qualquer cliente OpenAI pode apontar para localhost:9337 e parar de se importar onde o trabalho realmente acontece.
📖 Leia o código-fonte completo: HN LLM Tools
👀 See Also

Motor de Contexto Agente: Loop de Melhoria Automatizada de Agentes com Ganho de Precisão de 34,2%
Uma ferramenta de código aberto automatiza todo o ciclo de melhoria de agentes, desde a análise de rastreamento até a implementação de correções, alcançando uma melhoria de 34,2% na precisão no Tau-2 Bench em uma única iteração. O sistema utiliza o Claude Code em um ambiente REPL para analisar falhas e decidir entre correções de prompt ou de código.

TEMM1E v3.0.0 Introduz Inteligência de Enxame para Coordenação de Agentes de IA
TEMM1E v3.0.0 adiciona 'Many Tems', uma inteligência de enxame que coordena trabalhadores de agentes de IA através de sinais de estigmergia em vez de chamadas de LLM, alcançando desempenho 5,86x mais rápido e custo 3,4x menor em tarefas complexas com zero tokens de coordenação.

sqlite-utils 4.0rc2: Escrito por Claude Fable, $149,25, Corrige Bug de Perda de Dados
Simon Willison lançou sqlite-utils 4.0rc2, majoritariamente escrito por Claude Fable por $149,25. Fable encontrou um bug de perda de dados em delete_where() e ajudou a reescrever o tratamento de transações.

mcp-india-stack: Servidor MCP de código aberto para APIs financeiras indianas
mcp-india-stack é um servidor MCP de código aberto que fornece ao Claude acesso nativo a sete ferramentas de API financeiras e governamentais indianas, incluindo validação de GSTIN, consulta de IFSC e validação de PAN. Não requer autenticação, é offline-first e está disponível via pip install.