Офлайн-веб-поиск: Локальная альтернатива Google Search для ИИ-агентов

Что это такое
offline-web-search — это полностью локальная альтернатива Google Search, разработанная специально для AI-агентов, которым нужны возможности офлайн-поиска в интернете. Она была создана как замена веб-инструментам Claude, позволяя большим языковым моделям использовать её без сложных промптов.
Основная решаемая проблема
Разработчик выявил, что существующие решения для офлайн-поиска у AI-агентов имеют значительные ограничения. Большинство инструментов либо сбрасывают сырые HTML-файлы в контекстное окно, либо имеют базовый функционал поиска, который мешает агентам находить конкретную документацию. Это особенно проблематично в изолированных средах, при работе с конфиденциальными данными или при создании полностью локальных стеков.
Ключевые технические особенности
- Поведение поисковой системы: Вместо сброса текста она индексирует контент в локальную базу данных SQLite FTS5 с использованием рейтинга BM25, усиления заголовков, расширения синонимов, префиксного сопоставления и понижения неанглийского контента.
- Источники контента: Нативно поддерживает архивы Kiwix ZIM (содержащие офлайн-снимки Stack Overflow, документации Python, DevDocs, Wikipedia) и включает API индексации и краулер для пользовательского контента, такого как внутренний Confluence, корпоративная документация или случайные HTML-страницы.
- Архитектура: Использует модель клиент-сервер с HTTP API. «Тяжёлый» сервер контента работает централизованно в вашей сети, а лёгкие клиенты подключаются через MCP-сервер для Claude Desktop или нативный навык Claude Code.
- Предоставляемые инструменты: Предлагает два стандартных инструмента:
Google Searchдля поиска с рейтингом BM25 иvisit_pageдля возврата чистого Markdown полных страниц.
Как это работает
Инструмент был создан путём обратного проектирования инструментов Claude Web-Fetch и Web-Search, их системных промптов и функционала. Результаты поиска предоставляют высокорелевантные, ранжированные сниппеты для LLM, которая затем может использовать инструмент visit_page для доступа к чистым, читаемым версиям полных страниц в формате Markdown.
Для кого это
Разработчики, создающие офлайн AI-агентов или сильно локальные настройки, которым нужны надёжные возможности поиска без доступа к интернету.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Детектор утечек Swarm: Бесплатный инструмент для поиска открытых API-ключей в конфигурациях OpenClaw
Разработчик выпустил swarm-leak-detector — инструмент с лицензией MIT без зависимостей, который сканирует более 21 шаблона учетных данных (OpenAI, Anthropic, OpenRouter, Stripe и др.) в текстовых JSON-файлах конфигурации. Запустите его с помощью npx swarm-leak-detector scan ~/.clawdbot/, чтобы проверить наличие утечек примерно за 30 секунд.

Солоноватый: Пусть два экземпляра Claude Code согласуют контракт API через OpenAPI 3.1
Brackish — это CLI-инструмент, который запускается между двумя сессиями Claude Code — одна на бэкенде (FastAPI), другая на фронтенде (React/TypeScript) — для согласования API-контракта через общий документ OpenAPI 3.1. Он выявляет разногласия до того, как будет написан код.

DecisionNode: CLI и MCP-сервер для семантического хранения решений
DecisionNode — это локальный CLI и MCP-сервер, который хранит структурированные решения в формате JSON, преобразует их в векторные представления для семантического поиска и делает доступными для различных AI-инструментов через MCP. Распространяется под лицензией MIT и предназначен для работы с Claude Code, Cursor, Windsurf, Antigravity и другими MCP-клиентами.

Heartbeat-gateway: Событийная замена опросу cron в OpenClaw
Heartbeat-gateway — это инструмент с открытым исходным кодом на Python, который заменяет опрос на основе cron на события, управляемые вебхуками, для OpenClaw, снижая затраты на API с ~86 долларов в месяц до ~4,50 долларов в месяц и улучшая задержку с 30 минут до менее 2 секунд.