Torrix: Observabilidade de LLM Auto-Hospedada Sem Postgres ou Redis

✍️ OpenClawRadar📅 Publicado: May 13, 2026🔗 Source
Torrix: Observabilidade de LLM Auto-Hospedada Sem Postgres ou Redis
Ad

Torrix é uma ferramenta de observabilidade para LLMs auto-hospedada, projetada para equipes que desejam ver o que seus agentes estão fazendo em produção sem a sobrecarga de Postgres, Redis ou infraestrutura complexa. Ela roda como um único contêiner Docker com SQLite. A instalação completa é:

curl -o docker-compose.yml https://raw.githubusercontent.com/torrix-ai/install/main/docker-compose.community.yml
docker compose up

Sem dependências externas. Todos os dados ficam em um arquivo SQLite local na sua máquina. Após a inicialização, abra http://localhost:8088 e crie uma conta.

Principais Funcionalidades

  • Registro de chamadas de LLM via proxy HTTP ou SDK Python/Node.js: tokens, custo, latência, rastreamento completo de prompts e respostas, captura de tokens de raciocínio.
  • Suporte a provedores: OpenAI, Anthropic, Gemini, Groq, Mistral, Azure OpenAI e qualquer endpoint compatível com a API da OpenAI.
  • Previsão de custos e limites de orçamento rígidos
  • Mascaramento de PII
  • Regras de roteamento de modelos
  • Avaliações com execuções de ouro e juiz de IA
  • Biblioteca de prompts com histórico de versões
  • Tags de execução para filtragem por ambiente
  • Servidor MCP para que Assistentes de IA possam consultar seus próprios logs
  • Ingestão OTLP/HTTP para aplicativos que já usam OpenTelemetry
Ad

Exemplo de Uso do SDK (Python)

pip install torrix

import torrix from openai import OpenAI

torrix.init(api_key="<sua-chave-torrix-api>", base_url="http://localhost:8088") client = torrix.wrap(OpenAI(api_key="<sua-chave-openai>"))

response = client.chat.completions.create( model="gpt-4o-mini", messages=[{"role": "user", "content": "Olá!"}], torrix_name="minha-execucao", ) print(response.choices[0].message.content)

O SDK Node.js também está disponível via npm install.

Licenciamento e Escalabilidade

A edição comunitária é gratuita para um usuário com retenção de 7 dias. A versão Pro adiciona equipes, RBAC, retenção de 30 dias, gerenciamento de chaves de API, pesquisa em texto completo e logs de auditoria. SQLite não escala para alta taxa de gravação; esta ferramenta é direcionada para equipes que registram centenas a alguns milhares de chamadas de LLM por dia, não milhões.

📖 Leia a fonte completa: HN LLM Tools

Ad

👀 See Also

SymDex: Indexador de Código MCP de Código Aberto Reduz o Uso de Tokens por Agentes de IA
Tools

SymDex: Indexador de Código MCP de Código Aberto Reduz o Uso de Tokens por Agentes de IA

SymDex é um indexador de código MCP de código aberto que pré-indexa bases de código para ajudar agentes de IA de programação a encontrar funções e classes sem ler arquivos inteiros, reduzindo o uso de tokens em aproximadamente 97% por consulta, de acordo com os benchmarks do desenvolvedor.

OpenClawRadar
Servidor MCP OpenGalatea Conecta Claude às Impressoras 3D Prusa
Tools

Servidor MCP OpenGalatea Conecta Claude às Impressoras 3D Prusa

OpenGalatea é um servidor MCP de código aberto que permite ao Claude controlar impressoras 3D Prusa via PrusaLink, permitindo comandos em linguagem natural para buscar no Printables.com, fatiar modelos e gerenciar impressões.

OpenClawRadar
O conjunto MCP de código aberto melhora a qualidade da geração de código do Claude em 15-20%.
Tools

O conjunto MCP de código aberto melhora a qualidade da geração de código do Claude em 15-20%.

Um conjunto MCP de código aberto composto por três servidores locais e uma habilidade de prompt aborda o problema do 'token ruim' na geração de código por IA, com um cliente relatando uma melhoria de 15-20% na qualidade para o Claude Code.

OpenClawRadar
Tendr Skill Adiciona Memória de Longo Prazo Baseada em CLI com Hierarquia para Reduzir o Uso de Tokens
Tools

Tendr Skill Adiciona Memória de Longo Prazo Baseada em CLI com Hierarquia para Reduzir o Uso de Tokens

Uma nova habilidade do OpenClaw separa o raciocínio da execução para operações de memória de longo prazo, usando uma ferramenta CLI para lidar com mudanças estruturais de forma determinística. Ela suporta wikilinks e hierarquia semântica explícita entre arquivos para reduzir o consumo de tokens e evitar o acúmulo de erros.

OpenClawRadar