Google Surf MCP: Kostenlose Google-Suche MCP mit PDF-Verarbeitung und abgestufter Extraktion

Google Surf MCP ist ein kostenloser MCP-Server für Google-Suche und URL-Extraktion, der tatsächlich funktioniert – der Autor berichtet, dass er 6 kostenlose MCPs getestet hat, die alle versagten. Es ersetzt die übliche Kombination aus Such-MCP und Fetch-MCP durch ein einziges Toolset, das auch automatisch akademische PDFs (arXiv, bioRxiv, Nature, OpenReview, NeurIPS, JMLR, PMLR, Springer, PubMed→PMC) verarbeitet.
Hauptfunktionen
- 4 Tools:
search(nur SERP),search_parallel(N parallele Abfragen),extract(url, mode?)(voll/abstract/metadata),search_extract(query, mode?)(Standard: abstract) - Abgestufte Extraktion:
mode: "abstract"gibt ~1500 Zeichen pro Ergebnis zurück, für kostengünstige Relevanzprüfung, bevor man für den Volltext bezahlt. Eine Umfrage mit 5 Ergebnissen kostet ~7,5k Zeichen statt 40k. - PDF-Erkennung: via Content-Type, %PDF-Magic, citation_pdf_url-Meta und domain-spezifische Regeln.
- Zuverlässigkeit: Multi-Strategie-SERP-Parser mit geometrischer Verifikation (entfernt gesponserte/Wissenspanel/Seitenleiste), SSRF-Schutz (umgebungsabhängige private/Loopback-Sperre, DNS-Rebinding-Abwehr, Weiterleitungsvalidierung pro Hop), 25MB Fetch-Limit, fehlerhafte PDFs werden als Fehler behandelt.
- Automatische CAPTCHA-Wiederherstellung: Wenn CAPTCHA ausgelöst wird, öffnet sich ein sichtbares Chrome-Fenster zur menschlichen Lösung, dann erfolgt ein erneuter Versuch. Das Reputationsprofil bei Google bleibt erhalten.
- Kein API-Schlüssel, keine Proxys, kein Solver.
Stack und Geschwindigkeit
- Stack: TypeScript, Playwright + Stealth, Readability, Turndown, unpdf. ~900 LOC.
- Geschwindigkeit (1 Gbit/s): sequentiell ~1,5 s/Abfrage (warm), 4 parallel ~2 s Gesamtzeit, 10 parallel ~5 s Gesamtzeit.
Beispielverwendung
search_extract("neueste KI-Forschungspapiere", mode: "abstract")
Gibt Zusammenfassungen der besten Ergebnisse zurück, sodass ein Agent die Relevanz prüfen kann, bevor er extract(url, mode: "full") auf den Gewinner anwendet.
Für wen es geeignet ist: Entwickler, die KI-Agenten bauen, die zuverlässige, kostenlose Websuche und -extraktion benötigen, ohne externe API-Schlüssel oder kostenpflichtige Dienste.
📖 Quelltext lesen: r/ClaudeAI
👀 Siehe auch

Infracost reduziert Claude-Token-Nutzung um 79% durch Neugestaltung der CLI für KI-Agenten
Infracost hat sein CLI für KI-Agenten-Caller neu gestaltet und die Anzahl der Claude-Ausgabetokens um 79% sowie die API-Kosten um 67% im Vergleich zu einer reinen Claude-Baseline reduziert. Die wichtigsten Maßnahmen: Predicate Pushdown ins CLI und ein token-effizientes Ausgabeformat.

Lisp-Entwicklung mit KI-Agenten: Hohe Kosten und technische Herausforderungen
Ein DevOps-Ingenieur stellte fest, dass KI-Agenten mit der Lisp-Entwicklung kämpfen, was in Minuten 10–20 $ für minderwertigen Code kostet, während Python und Go effizient funktionieren. Er entwickelte tmux-repl-mcp, um die REPL-Interaktion zu verbessern, stieß aber weiterhin auf hohe Token-Kosten und Tooling-Probleme.

Claude Compact Guard Plugin verwendet neuen PostCompact-Hook, um Kontext zu erhalten
Ein Entwickler hat claude-compact-guard veröffentlicht, ein Plugin, das automatisch kritischen Kontext speichert, bevor Claudes /compact-Befehl ihn zerstört, und anschließend alles wieder einfügt. Es nutzt den vor 4 Tagen veröffentlichten PostCompact-Hook von Anthropic.

Marky: Ein schlanker Markdown-Viewer für agentengenerierte Dokumentation
Marky ist ein Desktop-Markdown-Viewer, der mit Tauri v2 und React erstellt wurde und .md-Dateien aus dem Terminal mit Live-Reload öffnet. Es bietet CLI-first-Nutzung, Syntaxhervorhebung mit Shiki, KaTeX-Mathematikunterstützung, Mermaid-Diagramme und Arbeitsbereiche für Ordner.