Torrix: Observabilidade de LLM Auto-Hospedada Sem Postgres ou Redis

Torrix é uma ferramenta de observabilidade para LLMs auto-hospedada, projetada para equipes que desejam ver o que seus agentes estão fazendo em produção sem a sobrecarga de Postgres, Redis ou infraestrutura complexa. Ela roda como um único contêiner Docker com SQLite. A instalação completa é:
curl -o docker-compose.yml https://raw.githubusercontent.com/torrix-ai/install/main/docker-compose.community.yml
docker compose upSem dependências externas. Todos os dados ficam em um arquivo SQLite local na sua máquina. Após a inicialização, abra http://localhost:8088 e crie uma conta.
Principais Funcionalidades
- Registro de chamadas de LLM via proxy HTTP ou SDK Python/Node.js: tokens, custo, latência, rastreamento completo de prompts e respostas, captura de tokens de raciocínio.
- Suporte a provedores: OpenAI, Anthropic, Gemini, Groq, Mistral, Azure OpenAI e qualquer endpoint compatível com a API da OpenAI.
- Previsão de custos e limites de orçamento rígidos
- Mascaramento de PII
- Regras de roteamento de modelos
- Avaliações com execuções de ouro e juiz de IA
- Biblioteca de prompts com histórico de versões
- Tags de execução para filtragem por ambiente
- Servidor MCP para que Assistentes de IA possam consultar seus próprios logs
- Ingestão OTLP/HTTP para aplicativos que já usam OpenTelemetry
Exemplo de Uso do SDK (Python)
pip install torrix
import torrix
from openai import OpenAI
torrix.init(api_key="<sua-chave-torrix-api>", base_url="http://localhost:8088")
client = torrix.wrap(OpenAI(api_key="<sua-chave-openai>"))
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=[{"role": "user", "content": "Olá!"}],
torrix_name="minha-execucao",
)
print(response.choices[0].message.content)
O SDK Node.js também está disponível via npm install.
Licenciamento e Escalabilidade
A edição comunitária é gratuita para um usuário com retenção de 7 dias. A versão Pro adiciona equipes, RBAC, retenção de 30 dias, gerenciamento de chaves de API, pesquisa em texto completo e logs de auditoria. SQLite não escala para alta taxa de gravação; esta ferramenta é direcionada para equipes que registram centenas a alguns milhares de chamadas de LLM por dia, não milhões.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

SymDex: Indexador de Código MCP de Código Aberto Reduz o Uso de Tokens por Agentes de IA
SymDex é um indexador de código MCP de código aberto que pré-indexa bases de código para ajudar agentes de IA de programação a encontrar funções e classes sem ler arquivos inteiros, reduzindo o uso de tokens em aproximadamente 97% por consulta, de acordo com os benchmarks do desenvolvedor.

Servidor MCP OpenGalatea Conecta Claude às Impressoras 3D Prusa
OpenGalatea é um servidor MCP de código aberto que permite ao Claude controlar impressoras 3D Prusa via PrusaLink, permitindo comandos em linguagem natural para buscar no Printables.com, fatiar modelos e gerenciar impressões.

O conjunto MCP de código aberto melhora a qualidade da geração de código do Claude em 15-20%.
Um conjunto MCP de código aberto composto por três servidores locais e uma habilidade de prompt aborda o problema do 'token ruim' na geração de código por IA, com um cliente relatando uma melhoria de 15-20% na qualidade para o Claude Code.

Tendr Skill Adiciona Memória de Longo Prazo Baseada em CLI com Hierarquia para Reduzir o Uso de Tokens
Uma nova habilidade do OpenClaw separa o raciocínio da execução para operações de memória de longo prazo, usando uma ferramenta CLI para lidar com mudanças estruturais de forma determinística. Ela suporta wikilinks e hierarquia semântica explícita entre arquivos para reduzir o consumo de tokens e evitar o acúmulo de erros.