Routerly: Gateway de LLM Auto-Hospedado com Políticas de Roteamento em Tempo Real e Controle de Orçamento

✍️ OpenClawRadar📅 Publicado: April 19, 2026🔗 Source
Routerly: Gateway de LLM Auto-Hospedado com Políticas de Roteamento em Tempo Real e Controle de Orçamento
Ad

Routerly é um gateway LLM auto-hospedado criado para preencher lacunas nas soluções existentes. O desenvolvedor o criou porque o OpenRouter é baseado em nuvem, e eles queriam algo executável em sua própria infraestrutura, enquanto o roteamento do LiteLLM parecia muito manual, apesar de lidar bem com orçamentos.

Recursos Principais

Em vez de codificar um modelo específico em seu aplicativo, o Routerly permite definir políticas de roteamento que determinam a seleção do modelo em tempo de execução. As políticas disponíveis incluem:

  • Mais barato
  • Mais rápido
  • Mais capaz
  • Combinações dessas políticas

O controle de orçamento opera em nível de projeto com rastreamento real por token, proporcionando gerenciamento de custos granular.

Compatibilidade e Uso

Routerly é compatível com OpenAI, o que significa que pode ser integrado em fluxos de trabalho existentes sem alterações de código. Ferramentas compatíveis especificamente mencionadas incluem:

  • Cursor
  • LangChain
  • Open WebUI

Funciona com "qualquer outra coisa" que use o formato de API da OpenAI.

Ad

Status Atual

O desenvolvedor reconhece que há arestas a serem aparadas e está buscando feedback da comunidade sobre:

  • O que está quebrado
  • O que está faltando
  • Se a lógica de roteamento faz sentido na prática
  • Se resolve um problema real que as pessoas têm

A ferramenta é completamente gratuita e de código aberto, sem nenhum apelo comercial. O desenvolvedor está focado em feedback prático da comunidade técnica.

Recursos

  • Repositório GitHub: https://github.com/Inebrio/Routerly
  • Site: https://www.routerly.ai

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas
Tools

Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas

Omnicoder-9B, um modelo focado em programação ajustado no Qwen3.5 9B com saídas do Opus 4.6, GPT 5.4, GPT 5.3 Codex e Gemini 3.1 Pro, mostra desempenho forte em hardware de médio porte, mas tem problemas de chamada de ferramentas em IDEs.

OpenClawRadar
Calmkeep: Uma Camada de Continuidade Externa para Combater a Deriva de LLM em Sessões Estendidas
Tools

Calmkeep: Uma Camada de Continuidade Externa para Combater a Deriva de LLM em Sessões Estendidas

Calmkeep é uma camada de continuidade externa projetada para neutralizar a deriva de LLMs em sessões prolongadas, apresentando 85% de integridade contra 60% do Claude padrão em um teste de construção de backend de 25 turnos e 100% contra 50% em uma sessão jurídica.

OpenClawRadar
ClawCodex /modo consultor: Emparelhe Trabalhador Barato com Revisor Caro para Reduzir Custos sem Perder Qualidade
Tools

ClawCodex /modo consultor: Emparelhe Trabalhador Barato com Revisor Caro para Reduzir Custos sem Perder Qualidade

O agente de codificação Python de código aberto ClawCodex adiciona um modo /advisor que combina um modelo de trabalho barato (por exemplo, Haiku) com um revisor caro (por exemplo, Opus) em pontos de decisão, reduzindo custos várias vezes sem sacrificar o julgamento arquitetônico.

OpenClawRadar
Habilidade Tendr: Operações CLI Determinísticas para Gerenciamento de Memória do Agente
Tools

Habilidade Tendr: Operações CLI Determinísticas para Gerenciamento de Memória do Agente

Tendr Skill é uma Habilidade de Agente que separa o raciocínio da execução para memória de longo prazo estruturada, permitindo que agentes decidam o que precisa ser alterado enquanto uma ferramenta CLI lida com operações estruturais de forma determinística. Ela suporta [[wikilinks]] e hierarquias semânticas explícitas entre arquivos.

OpenClawRadar