Routerly: Самостоятельно размещаемый шлюз для LLM с политиками маршрутизации в реальном времени и контролем бюджета

✍️ OpenClawRadar📅 Опубликовано: 19 апреля 2026 г.🔗 Source
Routerly: Самостоятельно размещаемый шлюз для LLM с политиками маршрутизации в реальном времени и контролем бюджета
Ad

Routerly — это саморазмещаемый шлюз для LLM, созданный для устранения пробелов в существующих решениях. Разработчик создал его, потому что OpenRouter является облачным, и ему хотелось чего-то, что можно запускать на собственной инфраструктуре, в то время как маршрутизация в LiteLLM казалась слишком ручной, несмотря на хорошую работу с бюджетированием.

Основные возможности

Вместо того чтобы жёстко прописывать конкретную модель в вашем приложении, Routerly позволяет определять политики маршрутизации, которые определяют выбор модели во время выполнения. Доступные политики включают:

  • Самая дешёвая
  • Самая быстрая
  • Самая способная
  • Комбинации этих политик

Контроль бюджета работает на уровне проекта с фактическим отслеживанием затрат на токен, обеспечивая детальное управление расходами.

Совместимость и использование

Routerly совместим с OpenAI, что означает, что его можно легко внедрить в существующие рабочие процессы без изменения кода. В частности, упомянутые совместимые инструменты включают:

  • Cursor
  • LangChain
  • Open WebUI

Он работает с "любыми другими" инструментами, которые используют формат API OpenAI.

Ad

Текущий статус

Разработчик признаёт, что есть некоторые шероховатости, и ищет обратную связь от сообщества по следующим вопросам:

  • Что не работает
  • Чего не хватает
  • Имеет ли логика маршрутизации смысл на практике
  • Решает ли это реальную проблему, с которой сталкиваются люди

Инструмент полностью бесплатный и с открытым исходным кодом, без коммерческой рекламы. Разработчик сосредоточен на практической обратной связи от технического сообщества.

Ресурсы

  • Репозиторий на GitHub: https://github.com/Inebrio/Routerly
  • Веб-сайт: https://www.routerly.ai

📖 Read the full source: r/LocalLLaMA

Ad

👀 Смотрите также

Плагин SLOP добавляет агентам OpenClaw осведомленность о состоянии приложений в реальном времени.
Инструменты

Плагин SLOP добавляет агентам OpenClaw осведомленность о состоянии приложений в реальном времени.

Новый плагин OpenClaw интегрируется с SLOP (State Layer for Observable Programs), предоставляя ИИ-агентам структурированный доступ к состоянию приложений и контекстным действиям. Плагин автоматически обнаруживает приложения с поддержкой SLOP через каталог ~/.slop/providers/ и мост расширения Chrome.

OpenClawRadar
Maggy: Автономная инженерная платформа на Claude Code с межсессионной памятью и P2P-обучением команды
Инструменты

Maggy: Автономная инженерная платформа на Claude Code с межсессионной памятью и P2P-обучением команды

Maggy находится на 4 уровне спектра инструментов AI-кодирования: мультимодельная оркестровка, кросс-сессионная память, процессная аналитика из CI/ревью и P2P командное обучение. Бенчмарки показывают 83% снижение использования Claude при выявлении 7 проблем безопасности, пропущенных однопоточным Claude Code.

OpenClawRadar
VSCode-Perplexity-MCP: используйте свою учетную запись Perplexity для бесплатного AI-поиска в VS Code
Инструменты

VSCode-Perplexity-MCP: используйте свою учетную запись Perplexity для бесплатного AI-поиска в VS Code

Открытый MCP-сервер, который позволяет подключить аккаунт Perplexity.ai к VS Code, предоставляя Clawbot возможности поиска, рассуждения и вычислений без оплаты за каждый API-запрос.

OpenClawRadar
Google Research представляет TurboQuant для сжатия моделей искусственного интеллекта
Инструменты

Google Research представляет TurboQuant для сжатия моделей искусственного интеллекта

Google Research представила TurboQuant — алгоритм сжатия, который уменьшает размер моделей ИИ без потери точности. Он решает проблему накладных расходов памяти при векторном квантовании и улучшает производительность кэша ключ-значение.

OpenClawRadar