Routerly: Gateway de LLM Auto-Hospedado com Políticas de Roteamento em Tempo Real e Controle de Orçamento

Routerly é um gateway LLM auto-hospedado criado para preencher lacunas nas soluções existentes. O desenvolvedor o criou porque o OpenRouter é baseado em nuvem, e eles queriam algo executável em sua própria infraestrutura, enquanto o roteamento do LiteLLM parecia muito manual, apesar de lidar bem com orçamentos.
Recursos Principais
Em vez de codificar um modelo específico em seu aplicativo, o Routerly permite definir políticas de roteamento que determinam a seleção do modelo em tempo de execução. As políticas disponíveis incluem:
- Mais barato
- Mais rápido
- Mais capaz
- Combinações dessas políticas
O controle de orçamento opera em nível de projeto com rastreamento real por token, proporcionando gerenciamento de custos granular.
Compatibilidade e Uso
Routerly é compatível com OpenAI, o que significa que pode ser integrado em fluxos de trabalho existentes sem alterações de código. Ferramentas compatíveis especificamente mencionadas incluem:
- Cursor
- LangChain
- Open WebUI
Funciona com "qualquer outra coisa" que use o formato de API da OpenAI.
Status Atual
O desenvolvedor reconhece que há arestas a serem aparadas e está buscando feedback da comunidade sobre:
- O que está quebrado
- O que está faltando
- Se a lógica de roteamento faz sentido na prática
- Se resolve um problema real que as pessoas têm
A ferramenta é completamente gratuita e de código aberto, sem nenhum apelo comercial. O desenvolvedor está focado em feedback prático da comunidade técnica.
Recursos
- Repositório GitHub: https://github.com/Inebrio/Routerly
- Site: https://www.routerly.ai
📖 Read the full source: r/LocalLLaMA
👀 See Also

Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas
Omnicoder-9B, um modelo focado em programação ajustado no Qwen3.5 9B com saídas do Opus 4.6, GPT 5.4, GPT 5.3 Codex e Gemini 3.1 Pro, mostra desempenho forte em hardware de médio porte, mas tem problemas de chamada de ferramentas em IDEs.

Calmkeep: Uma Camada de Continuidade Externa para Combater a Deriva de LLM em Sessões Estendidas
Calmkeep é uma camada de continuidade externa projetada para neutralizar a deriva de LLMs em sessões prolongadas, apresentando 85% de integridade contra 60% do Claude padrão em um teste de construção de backend de 25 turnos e 100% contra 50% em uma sessão jurídica.

ClawCodex /modo consultor: Emparelhe Trabalhador Barato com Revisor Caro para Reduzir Custos sem Perder Qualidade
O agente de codificação Python de código aberto ClawCodex adiciona um modo /advisor que combina um modelo de trabalho barato (por exemplo, Haiku) com um revisor caro (por exemplo, Opus) em pontos de decisão, reduzindo custos várias vezes sem sacrificar o julgamento arquitetônico.

Habilidade Tendr: Operações CLI Determinísticas para Gerenciamento de Memória do Agente
Tendr Skill é uma Habilidade de Agente que separa o raciocínio da execução para memória de longo prazo estruturada, permitindo que agentes decidam o que precisa ser alterado enquanto uma ferramenta CLI lida com operações estruturais de forma determinística. Ela suporta [[wikilinks]] e hierarquias semânticas explícitas entre arquivos.