Google Surf MCP: MCP de Pesquisa Google Gratuito com Manipulação de PDF e Extração em Camadas

Google Surf MCP é um servidor MCP gratuito para pesquisa no Google e extração de URLs que realmente funciona — o autor relata ter testado 6 MCPs gratuitos, todos falharam. Ele substitui a combinação usual de search MCP + fetch MCP por um único conjunto de ferramentas que também lida automaticamente com PDFs acadêmicos (arXiv, bioRxiv, Nature, OpenReview, NeurIPS, JMLR, PMLR, Springer, PubMed→PMC).
Principais Recursos
- 4 ferramentas:
search(apenas SERP),search_parallel(N consultas simultâneas),extract(url, mode?)(completo/resumo/metadados),search_extract(query, mode?)(padrão é resumo) - Extração em camadas:
mode: "abstract"retorna ~1500 caracteres por resultado para triagem de relevância barata antes de pagar pelos corpos completos. Uma pesquisa de 5 resultados custa ~7,5k caracteres em vez de 40k. - Detecção de PDF: via Content-Type, magic %PDF, meta citation_pdf_url e regras por domínio.
- Confiabilidade: analisador SERP multi-estratégia com verificação geométrica (descarta patrocinados/painel de conhecimento/barra lateral), proteção SSRF (bloqueio de IP privado/loopback baseado em ambiente, defesa contra rebinding de DNS, validação de redirecionamento por hop), limite de 25MB de busca, PDFs malformados tratados como erro.
- Recuperação automática de CAPTCHA: quando o CAPTCHA é acionado, uma janela visível do Chrome abre para resolução humana e, em seguida, tenta novamente. A reputação do perfil com o Google é preservada.
- Sem chave de API, sem proxies, sem resolvedor.
Tecnologias e Velocidade
- Tecnologias: TypeScript, Playwright + stealth, Readability, Turndown, unpdf. ~900 linhas de código.
- Velocidade (1Gbps): sequencial ~1,5s/consulta (quente), 4 paralelas ~2s no relógio, 10 paralelas ~5s no relógio.
Exemplo de Uso
search_extract("últimos artigos de pesquisa em IA", mode: "abstract")
Retorna resumos dos principais resultados, permitindo que um agente faça triagem de relevância antes de chamar extract(url, mode: "full") no vencedor.
Para quem é: Desenvolvedores construindo agentes de IA que precisam de pesquisa e extração web gratuitas e confiáveis, sem chaves de API externas ou serviços pagos.
📖 Leia o texto completo: r/ClaudeAI
👀 See Also

Vida-artificial: Uma reprodução em Python de 300 linhas da pesquisa de Vida Computacional
Uma implementação em Python reproduzindo o artigo Computational Life, onde uma grade 240x135 de programas semelhantes ao Brainfuck interagem e evoluem código autorreplicante através de emparelhamento aleatório e concatenação de fitas de instruções.

A extensão OpenClaw roteia solicitações através do Claude Code CLI em vez da API
Uma extensão do OpenClaw inicia o binário CLI do Claude como um subprocesso, roteando solicitações através do Claude Code CLI em vez da API da Anthropic. Isso oferece a experiência completa do Claude Code pela taxa fixa de um plano máximo.

nan-forget: Memória de codificação de IA local em um único arquivo SQLite
nan-forget é uma ferramenta de memória para agentes de IA de codificação que armazena contexto em um único arquivo SQLite (~3MB) sem serviços em segundo plano. Ela usa um pipeline de recuperação de 3 estágios e funciona no Claude Code, Cursor e terminal via CLI.

Claude Code reconstruiu o fluxo de integração de SaaS em 6 horas contra o prazo de 3 semanas do desenvolvedor, aumentando a ativação em 13 pontos
Um fundador de SaaS usou o Claude Code para reconstruir todo o fluxo de integração (cadastro → perfil → primeira fatura → tutorial do painel) em 6 horas, substituindo o orçamento de US$ 4.500 e 3 semanas de um desenvolvedor. A taxa de ativação melhorou 13 pontos percentuais, de 35% para 48%.