Много-провайдерская цепочка отказов LLM с поддержкой Ollama в производственной AI IDE

Resonant Genesis, производственная платформа AI IDE, интегрировала поддержку локальных LLM как полноценного провайдера в своей архитектуре. Платформа работает на более чем 30 микросервисах и рассматривает локальные модели как равные облачным провайдерам, таким как Groq, OpenAI, Anthropic и Gemini.
Архитектура и интеграция
Платформа использует общую библиотеку rg_llm под названием UnifiedLLMClient, которая монтируется по всем сервисам. Каждый микросервис, которому нужны возможности LLM, импортирует этого же клиента. Цепочка отказов настроена как: Groq → OpenAI → Anthropic → Gemini → Ollama/LM Studio.
Тонкое клиентское расширение IDE автоматически обнаруживает локальные модели Ollama и добавляет их в список провайдеров. Пользователи могут настроить систему для приоритетного использования локальных моделей, если захотят.
Оркестрация на стороне сервера
Вся оркестрация происходит на стороне сервера, а IDE выступает в качестве тонкого клиента, который отображает интерфейс, выполняет локальные инструменты (файловые операции, терминал, git) и передаёт результаты через Server-Sent Events (SSE). Агентский цикл, выбор инструментов, системные промпты и маршрутизация LLM — всё это происходит на сервере.
При использовании локальной модели она всё равно проходит через тот же управляемый конвейер выполнения:
- Применение политик до выполнения (блокирует действия до их запуска)
- Нативный вызов функций через API провайдеров (без инъекции JSON в промпты)
- Криптографическая идентификация (DSID на Ethereum L2) для каждого агента
- Те же 59 локальных инструментов доступны независимо от выбранного провайдера LLM
Преимущества для пользователей локальных LLM
Для пользователей, запускающих Ollama локально, эта архитектура предоставляет:
- Конфиденциальность: Архитектура тонкого клиента означает отсутствие корпоративной разведки в бинарном файле, а с локальными моделями промпты остаются локальными
- Использование инструментов: 59 локальных инструментов с нативным вызовом функций, а не с инъекцией JSON-схем в промпты
- Откат: Если локальная модель не справляется со сложной задачей, она автоматически переключается на облачные провайдеры
Разработчики ищут отзывы от людей, использующих локальные модели, особенно о производительности вызова функций с меньшими моделями и о том, какие модели хорошо работают для агентского использования инструментов.
Проект имеет открытый исходный код на GitHub, а гостевой чат, демонстрирующий экосистему инструментов, доступен на dev-swat.com (использует облачные модели).
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

Open Swarm: Открытая система для запуска тысяч параллельных ИИ-агентов
Open Swarm — это система с открытым исходным кодом, которая запускает тысячи параллельных ИИ-агентов с полным доступом к более чем 150 интернет-инструментам, включая электронную почту, социальные сети, Google Workspace, веб-поиск, выполнение кода и планировщик cron.

Клодигочи: Физическое устройство Тамагочи, которое питается активностью кода Клода
Клодиготчи — это физическое настольное существо, работающее на ESP32 с ЖК-экраном, которое подключается к Claude Code через плагин. Система голода устройства реагирует на активность кодирования, с визуальными состояниями и звуковыми эффектами, которые усиливаются, когда Claude оставляют бездействующим.

Новый инструмент инжектит инструкции в Claude Code на основе использования контекста
Разработчик создал инструмент, который мониторит использование контекста и инжектит кастомные инструкции для предотвращения проблем с компакцией.

Расширение SendToAI для VS Code решает проблему 20-файлового ограничения Claude с помощью объединения проектов.
SendToAI — это бесплатное расширение для VS Code, которое упаковывает целые проекты в один фрагмент для буфера обмена, обходя ограничение Claude на загрузку 20 файлов. Оно включает визуальный выбор файлов, подсчёт токенов, оценку стоимости и заметки по проекту, которые сохраняются между сеансами.