Construindo um Agente de Pesquisa Autônomo com C# e LLMs Locais

Veja um novo agente de pesquisa autônomo desenvolvido em C# que utiliza LLMs locais, especificamente Ollama junto com o modelo llama3.1:8b. O agente automatiza o processo de manipulação de URLs gerando consultas de busca, realizando pesquisas na web através da API do Brave Search e extraindo dados relevantes, tudo culminando em um relatório estruturado em markdown.
Detalhes Principais
- O agente aceita uma entrada de tópico, por exemplo, "memória persistente para agentes de IA".
- Ele formula autonomamente 5 a 8 consultas de busca.
- As buscas são executadas via API do Brave Search, e as principais fontes são coletadas e analisadas.
- O agente lê de 8 a 12 fontes e extrai de 5 a 8 descobertas-chave.
- Todos os processamentos de dados são executados localmente usando o modelo Ollama (llama3.1:8b) sem depender das APIs da OpenAI/Anthropic.
- A saída é um relatório em markdown completo com citações.
Desempenho e Arquitetura
A configuração atual roda em um Ryzen 5 5500, apenas com CPU, com 16GB de RAM, levando aproximadamente 15 minutos por ciclo de pesquisa. O desenvolvedor observa que modelos de 3B, como o llama3.2, são inadequados para chamadas de ferramentas, tornando 8B um mínimo necessário para desempenho confiável.
Desafios principais incluem a necessidade de truncar descobertas antes da síntese para evitar que o modelo trave em contextos longos, e chamadas de ferramentas ocasionalmente malformadas mesmo com modelos de 8B, resolvidas tentando novamente com prompts alterados. O agente utiliza SQLite combinado com embeddings para gerenciar memória em escala pessoal, dispensando a necessidade de um banco de dados vetorial.
Stack Tecnológico
- C# / .NET 8
- Ollama
- SQLite
- API do Brave Search (camada gratuita)
Para desenvolvedores interessados em construir seu próprio agente, há um kit inicial e um guia de 8 capítulos disponíveis no repositório GitHub do projeto, fornecido sob licença MIT, junto com o código-fonte completo: hex-dynamics.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

JavaClaw Beta: Assistente de IA Baseado em Java Desenvolvido com Spring AI e JobRunr
A equipe do JobRunr lançou o JavaClaw beta, uma versão Java do OpenClaw que roda localmente com suporte a múltiplos canais, escolha de LLM e processamento de tarefas em segundo plano via JobRunr. Construído com Spring Boot 4, Spring AI e Spring Modulith.

AgentTransfer: Ferramenta de Código Aberto Permite que Agentes OpenClaw Enviem Arquivos por Email Uns aos Outros
AgentTransfer é um servidor open-source de binário único que dá a cada agente de IA um endereço de e-mail e uma pasta, permitindo compartilhar arquivos entre instâncias do OpenClaw via MCP. Suporta upload, envio, inbox com long-poll e download com verificação SHA256.

OpenJet v0.4: Agente de Codificação Local com Configuração Zero e Backend llama.cpp
O OpenJet v0.4 é um agente de codificação de terminal de código aberto para LLMs locais que detecta automaticamente o hardware, configura o llama.cpp e oferece um fluxo de trabalho no estilo Claude Code, sem necessidade de chaves de API.

HostedShell: Uma Solução de Implantação Baseada na Web para Agentes OpenClaw
HostedShell é uma versão hospedada do OpenClaw que elimina a configuração local da CLI, o gerenciamento de dependências e o emparelhamento manual, fornecendo um console web com acesso direto ao terminal e atualizações do sistema de arquivos.