Предоставление Клоду локальной LLM в качестве ассистента через MCP на Mac

Пользователь Reddit рассказал, как они предоставили Claude доступ к локальной LLM, работающей на Mac Mini M4 (24 ГБ ОЗУ), через MCP-соединение с Ollama. Настройка использует Ollama, обслуживающую Qwen 2.5 Coder (14B) в качестве ассистента по имени 'Frank', которому Claude может делегировать задачи по определенным правилам — использовать меньше токенов, чем сам Claude, не влиять на качество и требовать финальной проверки.
Детали настройки
- Оборудование: Mac Mini M4 с 24 ГБ ОЗУ.
- Локальная LLM: Qwen 2.5 Coder (14B), запущенная через Ollama (также тестировалась с LM Studio).
- Подключение: MCP (Model Context Protocol) для связи Claude (CLI или Desktop App) с локальной моделью.
- Инструкции: Claude получил файл памяти Markdown (
memory.md) с рекомендациями, когда и как использовать Frank — например, делегировать обработку текста, работу с большими CSS/HTML файлами, и использовать только когда это экономит токены без снижения качества вывода.
Практические сценарии использования
- Обработка и преобразование текста — передается Frank для снижения расхода токенов Claude.
- Работа с большими CSS/HTML файлами, которые было бы дорого обрабатывать Claude напрямую.
- Запуск тестов производительности, кодирования и логики — Claude оценивал локальные модели через Frank, а не вручную.
Пользователь отметил, что работает на пределе возможностей своей ОЗУ/GPU и не может тестировать более крупные модели (30B+). Они пригласили других с более мощным оборудованием попробовать аналогичные настройки и поделиться результатами.
Этот подход фактически создает бесплатного ассистента для Claude, перекладывая задачи, требующие много токенов, на локальную модель, сохраняя качество за счет финальной проверки Claude.
📖 Source: r/ClaudeAI
👀 Смотрите также

Флотский Командир: Открытая панель управления для оркестрации нескольких команд агентов Claude Code
Fleet Commander — это локальная веб-панель управления, которая запускает несколько команд агентов Claude Code параллельно для решения разных задач. Она использует структуру «бриллиантовой команды» с агентами Планировщик, Разработчик и Рецензент, которые общаются напрямую через SendMessage.

ddash: Инструмент для создания диаграмм Mermaid с URL-хранилищем и интеграцией кода Claude
ddash — это бесплатный инструмент для создания диаграмм Mermaid, где вся диаграмма сжимается в хэш URL, не требуя бэкенда, аккаунтов или хранилища. Он включает навык Claude Code, который позволяет генерировать и открывать диаграммы прямо во время разговоров с помощью команд вроде /diagram the auth flow.

AIMEAT: Самодостаточный протокол для ИИ-агентов, локальных LLM и общих возможностей
AIMEAT — это самодельный протокол и сервер, который позволяет людям, ИИ-агентам и локальным LLM обмениваться приложениями, знаниями и возможностями через HTTP/JSON. Никакой привязки к вендору, никакого специального SDK — обычные запросы и загрузки по URL.

Клод Код против OpenCode: Ключевые технические различия, обнаруженные разработчиком
Разработчик сравнивает Claude Code и OpenCode по контексту, памяти, использованию инструментов, подагентам, разрешениям, безопасности и гибкости моделей, заключая, что Claude Code по-прежнему выигрывает для работы с продуктивными репозиториями.