Предоставление Клоду локальной LLM в качестве ассистента через MCP на Mac

Пользователь Reddit рассказал, как они предоставили Claude доступ к локальной LLM, работающей на Mac Mini M4 (24 ГБ ОЗУ), через MCP-соединение с Ollama. Настройка использует Ollama, обслуживающую Qwen 2.5 Coder (14B) в качестве ассистента по имени 'Frank', которому Claude может делегировать задачи по определенным правилам — использовать меньше токенов, чем сам Claude, не влиять на качество и требовать финальной проверки.
Детали настройки
- Оборудование: Mac Mini M4 с 24 ГБ ОЗУ.
- Локальная LLM: Qwen 2.5 Coder (14B), запущенная через Ollama (также тестировалась с LM Studio).
- Подключение: MCP (Model Context Protocol) для связи Claude (CLI или Desktop App) с локальной моделью.
- Инструкции: Claude получил файл памяти Markdown (
memory.md) с рекомендациями, когда и как использовать Frank — например, делегировать обработку текста, работу с большими CSS/HTML файлами, и использовать только когда это экономит токены без снижения качества вывода.
Практические сценарии использования
- Обработка и преобразование текста — передается Frank для снижения расхода токенов Claude.
- Работа с большими CSS/HTML файлами, которые было бы дорого обрабатывать Claude напрямую.
- Запуск тестов производительности, кодирования и логики — Claude оценивал локальные модели через Frank, а не вручную.
Пользователь отметил, что работает на пределе возможностей своей ОЗУ/GPU и не может тестировать более крупные модели (30B+). Они пригласили других с более мощным оборудованием попробовать аналогичные настройки и поделиться результатами.
Этот подход фактически создает бесплатного ассистента для Claude, перекладывая задачи, требующие много токенов, на локальную модель, сохраняя качество за счет финальной проверки Claude.
📖 Source: r/ClaudeAI
👀 Смотрите также

Расширение браузера Claude Pulse отображает количество токенов, таймеры кэша и лимиты скорости на Claude.ai
Claude Pulse — это клиентское расширение для Chrome, которое добавляет на Claude.ai информационную панель в реальном времени, показывающую количество токенов на сообщение, общий объём контекста, таймер истечения кэша подсказок и индикатор лимита запросов. Также включает экспорт чата в Markdown.

Представляем NetViews 2.3: надежный инструмент для диагностики сетей для macOS.
NetViews 2.3 объединяет обнаружение хостов, данные о Wi-Fi и мониторинг в реальном времени с упрощенным интерфейсом для лучшей диагностики сети на macOS.

HolyCode: Docker-контейнер для постоянных сред агентов кодирования с искусственным интеллектом
HolyCode — это Docker-контейнер, который предоставляет постоянную среду разработки для ИИ-агентов, сохраняя сессии, настройки и плагины при пересборках. Он включает предварительно настроенные инструменты браузера для рабочих процессов агентов и поддерживает Claude, OpenAI, Gemini и других провайдеров через OpenCode.

FlowBoard v5: Рабочее пространство проекта на основе событий для многолетних команд
FlowBoard v5 перестраивает слой контекста проекта на React с event-sourced хранилищем задач, обеспечивает координацию между несколькими агентами (OpenClaw, Claude Code, Cursor) и представляет конвейер от идей до спецификаций.