Внешний плагин реранкера для OpenClaw Memory-Core: возможность повторного использования старых видеокарт

Разработчик выпустил плагин для OpenClaw, который позволяет memory-core использовать внешний реранкер, вынося алгоритм MMR в отдельный плагин и добавляя новый плагин memory-external-reranker. Если у вас пылится старый GPU, это практичный способ задействовать его.
Как это работает
В рамках рефакторинга MMR вынесен в отдельный плагин memory-mmr, а memory-external-reranker добавлен как ещё один. Без изменений в openclaw.json новый плагин memory-mmr загружается автоматически, если включена гибридная память. Для включения внешнего реранкера следуйте документации в репозитории. Также предусмотрен откат к MMR, если реранкер недоступен.
Протестированная конфигурация
- Модель эмбеддингов:
Qwen/Qwen3-Embedding-4B-GGUF:Q8_0 - Модель реранкера:
mradermacher/Qwen3-Reranker-4B-GGUF:Q8_0 - Резервный вариант: MMR
- GPU: RTX 3060 (12GB VRAM) — обе модели работают вместе комфортно
Почему не QMD?
QMD работает локально без возможности выгрузки модели. Если вы запускаете OpenClaw в Docker на хосте без подходящего GPU (или не хотите использовать CPU для инференса), QMD снижает производительность. Этот плагин позволяет использовать внешний реранкинг с моделями, запущенными на другом сервере (включая тот самый бездействующий RTX 3060).
Стоит ли оно того?
Автор сообщает, что качество воспроизведения памяти улучшилось, хотя количественных метрик у него нет. Для систем с запасным GPU или отдельным сервером инференса этот плагин предлагает чистый способ выгрузки реранкинга без изменения поведения core memory-core.
Репозиторий и ветка
Плагин находится в ветке external-reranker форка: github.com/michmill1970/openclaw/tree/external-reranker. Автор держит форк близко к основной ветке, обновляя несколько раз в день.
📖 Читать полный источник: r/openclaw
👀 Смотрите также

Сяочжэнь: Навык Claude Code, который копает на три уровня вглубь для выявления корневых причин
Сяочжэнь (小真) — это навык Claude Code, который использует три механизма — Дар, Три уровня глубины и Прогноз — чтобы помочь пользователям выяснить, что на самом деле их беспокоит, вместо того чтобы давать прямые советы. Он устанавливается одной командой curl и активируется вводом /小真 в Claude Code.

Kstack: Набор навыков для Claude Code по мониторингу и устранению неполадок Kubernetes
Kstack — это набор навыков с открытым исходным кодом, который добавляет слеш-команды, такие как /investigate, /audit-security и /cluster-status, в Claude Code (и другие AI-агенты) для мониторинга и устранения неполадок кластеров K8s. За кулисами он использует kubectl, Kubetail, Trivy и Pluto.

UK Sovereign LLM Inference: Relax.ai публикует публичные документы
Relax.ai опубликовал документацию для UK sovereign LLM inference, перенаправляя на /docs/getting-started/introduction. Сервис был опубликован на HN с 104 баллами.

Навык "Движок текстовых приключений" для Claude Desktop
Движок текстовых приключенческих игр работает полностью внутри Claude Desktop как навык без серверов, приложений или кода для запуска. Включает полную RPG-механику, 3D-рендеринг кубиков, 19 модулей расширения и переносимые файлы сохранений.