Mole: Agente de Pesquisa Profunda com Orçamento Forçado e Citações Verificadas para o Seu Terminal
Mole é um agente de pesquisa profunda que roda no seu terminal. Ele decompõe uma pergunta, pesquisa na web, lê fontes, extrai afirmações, verifica cada afirmação contra o texto de onde veio e escreve uma resposta com citações. Ao contrário de agentes baseados em chat, ele impõe um orçamento rígido, verifica cada afirmação e mantém seus dados locais privados.
Orçamento Rigoroso
Cada chamada de modelo é reservada contra um orçamento antes de acontecer e liquidada depois, usando um livro-razão com restrições não negativas no esquema do banco de dados. A flag --usd 0.50 significa que a execução para em cinquenta centavos. O estouro medido no corpus de teste é de 0%.
Citações Verificadas
Cada afirmação carrega uma citação que aparece verbatim na página de origem. Afirmações que não passam nessa verificação são descartadas na extração. As afirmações sobreviventes podem ser relidas contra sua fonte, e as não suportadas são marcadas no relatório.
Privacidade de Dados Locais
Aponte o mole para um CSV ou pasta, e ele analisa os dados sem que o conteúdo saia da sua máquina. O modelo escolhe um modelo de hipótese e nomes de colunas; o mole executa o SQL localmente. Apenas agregados (contagens, médias, resultados de testes, buckets cobrindo pelo menos cinco registros) são permitidos de volta. mole crossings mostra exatamente o que saiu da sua máquina.
Instalação
Instale via script (Linux/macOS):
curl -fsSL https://raw.githubusercontent.com/lajosdeme/mole/main/install.sh | shOu via Homebrew:
brew install lajosdeme/mole/moleArch Linux (AUR): yay -S mole-research-bin ou mole-research. Debian/Ubuntu: baixe o .deb da página de releases. Do código-fonte (Go 1.25+): go install github.com/lajosdeme/mole/cmd/mole@latest.
Configuração
Você precisa de um provedor de busca e um provedor de modelo. As chaves ficam em ~/.config/mole/config.json com modo 0600 — nunca em variáveis de ambiente. O Mole suporta a maioria dos LLMs, incluindo agentes de codificação, assinaturas e modelos locais.
Suporte a MCP
Mole fala MCP, então um agente de codificação pode dirigi-lo — seja entregando uma pergunta ao mole e coletando a resposta, ou no modo toolkit, onde o agente faz o raciocínio enquanto o mole fornece as partes não-modelo.
É gratuito e de código aberto, roda como um único binário estático sem dependências de runtime.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Refletir Servidor MCP Implementa Documento de Reflexão para Memória Persistente de Agente de Codificação
Um desenvolvedor implementou o artigo Reflexion (Shinn et al., NeurIPS 2023) como um servidor MCP para dar aos agentes de codificação locais uma memória persistente de seus erros. O sistema usa correspondência de padrões baseada em regex em mensagens de erro e armazena as lições em SQLite com FTS5.

ClawCall adiciona chamadas recebidas — seu agente OpenClaw ganha seu próprio número
ClawCall agora suporta chamadas recebidas — seu agente OpenClaw ganha um número dedicado, atende em segundos e fala com seu tom. Configuração mais fácil de saudação e personalidade via linguagem natural.

SkyClaw: Runtime de Agente de IA Rust para VPS na Nuvem com Controle via Telegram
SkyClaw é um runtime de agente de IA baseado em Rust de 6,9 MB projetado para implantação em VPS na nuvem com o Telegram como única interface. Ele executa comandos shell, navega na web via Chrome headless, lê/escreve arquivos e busca URLs com encadeamento de ferramentas em múltiplas rodadas.
MTP + Memória Unificada Aumenta Inferência do llama.cpp em 30% na RTX 5090
Ativar a especulação MTP junto com GGML_CUDA_ENABLE_UNIFIED_MEMORY=1 eleva o Qwen3.6-27B Q8_0 de 49 para 64 tok/seg em uma RTX 5090 com 128 GB de RAM do sistema.