Torrix: LLM-Beobachtbarkeit selbst gehostet ohne Postgres oder Redis

✍️ OpenClawRadar📅 Veröffentlicht: 13. Mai 2026🔗 Source
Torrix: LLM-Beobachtbarkeit selbst gehostet ohne Postgres oder Redis
Ad

Torrix ist ein selbst gehostetes LLM-Beobachtungstool, das für Teams entwickelt wurde, die sehen möchten, was ihre Agenten in der Produktion tun – ohne den Overhead von Postgres, Redis oder komplexer Infrastruktur. Es läuft als einzelner Docker-Container mit SQLite-Backend. Die vollständige Installation erfolgt mit:

curl -o docker-compose.yml https://raw.githubusercontent.com/torrix-ai/install/main/docker-compose.community.yml
docker compose up

Keine externen Abhängigkeiten. Alle Daten bleiben in einer lokalen SQLite-Datei auf Ihrem Rechner. Nach dem Start öffnen Sie http://localhost:8088 und erstellen ein Konto.

Hauptfunktionen

  • LLM-Aufrufprotokollierung via HTTP-Proxy oder Python/Node.js SDK: Token, Kosten, Latenz, vollständige Prompt- und Antwort-Traces, Erfassung von Reasoning-Token.
  • Provider-Unterstützung: OpenAI, Anthropic, Gemini, Groq, Mistral, Azure OpenAI und jeder OpenAI-API-kompatible Endpunkt.
  • Kostenprognose und harte Budgetgrenzen
  • PII-Maskierung
  • Modell-Routing-Regeln
  • Evals mit goldenen Runs und KI-Judge
  • Prompt-Bibliothek mit Versionsverlauf
  • Run-Tags zur Filterung nach Umgebung
  • MCP-Server, damit KI-Assistenten Ihre eigenen Logs abfragen können
  • OTLP/HTTP-Aufnahme für Apps, die bereits OpenTelemetry verwenden
Ad

SDK-Nutzungsbeispiel (Python)

pip install torrix

import torrix from openai import OpenAI

torrix.init(api_key="<your-torrix-api-key>", base_url="http://localhost:8088") client = torrix.wrap(OpenAI(api_key="<your-openai-key>"))

response = client.chat.completions.create( model="gpt-4o-mini", messages=[{"role": "user", "content": "Hallo!"}], torrix_name="my-run", ) print(response.choices[0].message.content)

Das Node.js SDK ist ebenfalls über npm install verfügbar.

Lizenzierung und Skalierung

Die Community-Edition ist kostenlos für einen Benutzer mit 7-tägiger Aufbewahrungsfrist. Pro fügt Teams, RBAC, 30-tägige Aufbewahrung, API-Key-Verwaltung, Volltextsuche und Audit-Logs hinzu. SQLite skaliert nicht auf hohe Schreibdurchsätze; dies richtet sich an Teams, die täglich einige hundert bis wenige tausend LLM-Aufrufe protokollieren, nicht Millionen.

📖 Vollständigen Artikel lesen: HN LLM Tools

Ad

👀 Siehe auch

Ctxpact: Kontext-Kompaktierungs-Proxy für lokale LLMs
Werkzeuge

Ctxpact: Kontext-Kompaktierungs-Proxy für lokale LLMs

Ctxpact ist ein OpenAI-kompatibler Proxy, der übergroße Eingaben für lokale LLMs mit 16k-Kontextfenstern komprimiert. Er verwendet eine 3-stufige Pipeline mit DCP, Zusammenfassungs- und Extraktionsstrategien. Benchmarks zeigen, dass 110k Token auf 12k komprimiert wurden, bei 8/8 Punkten im Leseverständnis.

OpenClawRadar
CogniLayer: Ein MCP-Server für persistenten Speicher in Claude Code
Werkzeuge

CogniLayer: Ein MCP-Server für persistenten Speicher in Claude Code

CogniLayer ist ein Open-Source-MCP-Server, der Claude Code mit persistenter Speicherung über Sitzungen hinweg versorgt, indem er eine SQLite-Datenbank mit FTS5-Volltextsuche und Vektoreinbettungen nutzt. Er löst das Problem, dass Claude den Projektkontext zwischen Sitzungen vergisst.

OpenClawRadar
Entwickler baut MCP-Server, der 18 E-Commerce-Tools mit Claude verbindet
Werkzeuge

Entwickler baut MCP-Server, der 18 E-Commerce-Tools mit Claude verbindet

Ein Entwickler hat einen MCP-Server erstellt, der 18 E-Commerce-Plattformen und -Tools mit Claude integriert und abfrageübergreifende Anfragen über mehrere Datenquellen hinweg ermöglicht. Das Projekt wurde hauptsächlich mit Claude Code (Opus) in Tagen statt Monaten aufgebaut.

OpenClawRadar
Die Optimierung von ANE durch telefonisch gesteuerte KI-Experimente zeigt Vorteile der Kernel-Fusion.
Werkzeuge

Die Optimierung von ANE durch telefonisch gesteuerte KI-Experimente zeigt Vorteile der Kernel-Fusion.

Ein Entwickler führte 55 Experimente zur Optimierung des Apple Neural Engine durch und steuerte den Prozess von seinem Telefon aus, wobei er Claude für Brainstorming nutzte. Wichtige Verbesserungen umfassten die Verschmelzung von 3 ANE-Kerneln zu einem Mega-Kernel, wodurch der Validierungsverlust von 3,75 auf 2,49 und die Schrittzeit von 176 ms auf 96 ms reduziert wurden.

OpenClawRadar