Google Surf MCP : MCP de recherche Google gratuit avec gestion des PDF et extraction hiérarchisée

Google Surf MCP est un serveur MCP gratuit pour la recherche Google et l'extraction d'URL qui fonctionne réellement — l'auteur indique avoir testé 6 MCP gratuits, tous ayant échoué. Il remplace la combinaison habituelle search MCP + fetch MCP par un ensemble d'outils unique qui gère automatiquement les PDF académiques (arXiv, bioRxiv, Nature, OpenReview, NeurIPS, JMLR, PMLR, Springer, PubMed→PMC).
Fonctionnalités clés
- 4 outils :
search(SERP uniquement),search_parallel(N requêtes simultanées),extract(url, mode?)(intégral/résumé/métadonnées),search_extract(query, mode?)(par défaut résumé) - Extraction hiérarchisée :
mode: "abstract"renvoie ~1500 caractères par résultat pour un tri préliminaire peu coûteux avant de payer pour le contenu intégral. Une enquête de 5 résultats coûte ~7,5k caractères au lieu de 40k. - Détection PDF : via Content-Type, magic %PDF, métadonnée citation_pdf_url et règles par domaine.
- Fiabilité : analyseur SERP multi-stratégies avec vérification géométrique (suppression des annonces/panneaux de connaissance/barres latérales), protection SSRF (blocage des adresses privées/loopback verrouillées par environnement, défense contre le rebinding DNS, validation des redirections par saut), limite de récupération de 25 Mo, PDF malformés gérés comme erreur.
- Récupération automatique de CAPTCHA : lorsque le CAPTCHA se déclenche, une fenêtre Chrome visible s'ouvre pour résolution humaine, puis réessaye. La réputation du profil auprès de Google est préservée.
- Pas de clé API, pas de proxy, pas de solveur.
Stack et vitesse
- Stack : TypeScript, Playwright + stealth, Readability, Turndown, unpdf. ~900 lignes de code.
- Vitesse (1 Gbit/s) : séquentiel ~1,5 s/req (à chaud), 4 en parallèle ~2 s temps total, 10 en parallèle ~5 s temps total.
Exemple d'utilisation
search_extract("derniers articles de recherche en IA", mode: "abstract")
Renvoie les résumés des meilleurs résultats, permettant à un agent de trier la pertinence avant d'appeler extract(url, mode: "full") sur le gagnant.
À qui cela s'adresse : aux développeurs construisant des agents IA qui ont besoin d'une recherche et d'une extraction web fiables et gratuites, sans clés API externes ni services payants.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Manifest Ajoute des Plans de Jetons MiniMax avec Prise en Charge du Modèle M2.7
Manifest, une couche de routage open source pour OpenClaw, prend désormais en charge les forfaits de tokens MiniMax à partir de 10 $/mois. Le nouveau modèle MiniMax M2.7 est spécialement conçu pour les flux de travail OpenClaw et obtient 62,7 sur MM-ClawBench et 56,2 sur SWE-Bench Pro.

SlackClaw : Instance OpenClaw gérée pour l'intégration Slack
SlackClaw est un produit commercial basé sur OpenClaw qui fournit une instance gérée spécifiquement pour Slack. Il offre une installation en un clic, des connexions d'outils OAuth, des serveurs dédiés par espace de travail et une mémoire persistante.

Serveur MCP LocalSynapse Permet à Claude de Rechercher des Documents Locaux Hors Ligne
LocalSynapse est un serveur MCP qui indexe et recherche dans des documents locaux (Word, Excel, PowerPoint, PDF) en utilisant une recherche sémantique hybride BM25 + IA. Tout fonctionne localement, sans nécessiter de cloud ni de clés API.

Automatiser la revue des PR GitHub avec les agents Claude Code
Un développeur a créé un agent qui traite les mentions GitHub, lance des travailleurs Claude Code pour examiner ou corriger les PR, et ne remonte aux humains que les cas ambigus.