Offline-Web-Suche: Eine lokale Google-Suchalternative für KI-Agenten

Was das ist
offline-web-search ist eine vollständig lokale Google-Suche-Alternative, die speziell für KI-Agenten entwickelt wurde, die Offline-Websuche benötigen. Es wurde als direkter Ersatz für Claudes Web-Tools erstellt, sodass LLMs es ohne komplexe Prompting verwenden können.
Das Kernproblem, das gelöst wird
Der Entwickler stellte fest, dass bestehende Offline-Suchlösungen für KI-Agenten erhebliche Einschränkungen haben. Die meisten Tools werfen entweder rohe HTML-Dateien in das Kontextfenster oder haben grundlegende Suchfunktionen, die es Agenten unmöglich machen, spezifische Dokumentation zu finden. Dies ist besonders problematisch in abgeschotteten Umgebungen, bei der Verarbeitung sensibler Daten oder beim Aufbau vollständig lokaler Stacks.
Wichtige technische Funktionen
- Suchmaschinenverhalten: Anstatt Textdumps zu verwenden, indiziert es Inhalte in eine lokale SQLite FTS5-Datenbank mit BM25-Ranking, Titel-Boosting, Synonym-Erweiterung, Präfix-Matching und Nicht-Englisch-Abstufung.
- Inhaltsquellen: Unterstützt nativ Kiwix ZIM-Archive (mit Offline-Snapshots von Stack Overflow, Python-Dokumentation, DevDocs, Wikipedia) und enthält eine Indizierungs-API und einen Crawler für benutzerdefinierte Inhalte wie internes Confluence, Unternehmensdokumente oder zufällige HTML-Seiten.
- Architektur: Verwendet ein Client-Server-Modell mit einer HTTP-API. Der "schwere" Content-Server läuft zentral in Ihrem Netzwerk, während schlanke Clients über einen MCP-Server für Claude Desktop oder die native Claude Code-Fähigkeit verbinden.
- Verfügbare Tools: Bietet zwei Standard-Tools:
Google Searchfür BM25-basierte Suche undvisit_page, um sauberes Markdown vollständiger Seiten zurückzugeben.
Wie es funktioniert
Das Tool wurde durch Reverse-Engineering von Claudes Web-Fetch- und Web-Search-Tools, ihren System-Prompts und ihrer Funktionalität erstellt. Suchergebnisse liefern dem LLM hochrelevante, gerankte Ausschnitte, die dann das visit_page-Tool verwenden können, um saubere, lesbare Markdown-Versionen vollständiger Seiten abzurufen.
Für wen es gedacht ist
Entwickler, die Offline-KI-Agenten oder stark lokale Setups aufbauen und zuverlässige Suchfunktionen ohne Internetzugang benötigen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

BaseLayer: Open-Source Behavioral Compression Pipeline für KI-Gedächtnissysteme
BaseLayer ist eine Open-Source-Pipeline, die Überzeugungen, Verhaltensweisen, Spannungen und Widersprüche aus Gesprächen, Tagebüchern und veröffentlichten Texten extrahiert und sie in ein Identitätsprofil für KI-Modelle komprimiert. Sie wurde an Datensätzen getestet, die von 8 persönlichen Tagebucheinträgen bis hin zu großen Korpora wie den Aktionärsbriefen von Warren Buffett (350.000 Wörter) und den Investment-Memos von Howard Marks (600.000 Wörter) reichen.

3D-gedrucktes Clawd-Maskottchen mit ESP32-betriebenem Mochi-Bot
Ein Entwickler hat einen physischen 3D-Clawd gebaut, inspiriert vom Claude Code-Maskottchen, mit einem ESP32-gesteuerten Mochi-Bot, der ein kleines Display besitzt. Dateien und Code sind auf MakerWorld und GitHub verfügbar.

cstat: Eine native Rust-Statusleiste für Claude Code mit 2ms Leistung
cstat ist ein natives Rust-Binary, das die 62ms Statuszeile von claude-hud durch eine 2ms-Implementierung ersetzt, indem es 24 Subprozess-Starts pro Aufruf eliminiert. Es zeigt Modellinformationen, Ratenlimits, Git-Status, Kontextfensternutzung, aktive Tools, Subagenten und Aufgabenfortschritt an.

Persistente Indizes gegenüber Extraktion: Architektur für einen YouTube-MCP-Server
Ein Entwickler teilt Architektur-Notizen für den Aufbau eines YouTube-MCP-Servers, der anstelle des gängigen "Extrahieren-und-Vergessen"-Ansatzes auf persistente lokale Indizes setzt. Zu den Kernentscheidungen gehören ein dreistufiges Fallback-System, SQLite + sqlite-vec für die Vektorspeicherung, eine Abstraktion für Embedding-Provider und ein separater visueller Suchindex.