LogClaw: Open-Source AI SRE für automatische Ticket-Erstellung aus Logs

LogClaw ist eine Open-Source-AI-SRE-Plattform, die in Ihrer VPC bereitgestellt wird und automatisch Incident-Tickets aus Log-Anomalien erstellt. Entwickelt von Robel nach Frustration über vage Alarme von Tools wie Datadog, konzentriert sie sich darauf, Log-Rauschen in handlungsorientierte Tickets ohne manuelles Eingreifen zu verwandeln.
Wie es funktioniert
Das System nimmt Logs über OpenTelemetry auf und erkennt Anomalien mithilfe signalbasierter zusammengesetzter Bewertung anstelle einfacher Schwellenwertalarme. Es extrahiert 8 Fehlertyp-Signale: OOM, Abstürze, Ressourcenerschöpfung, Abhängigkeitsfehler, DB-Deadlocks, Timeouts, Verbindungsfehler und Authentifizierungsfehler. Diese werden mit statistischer Z-Score-Analyse, Ausbreitungsradius, Fehlergeschwindigkeit und Wiederholungssignalen zu einem zusammengesetzten Score kombiniert.
Kritische Fehler (OOM, Panics) lösen sofortige Erkennung aus. Sobald eine Anomalie bestätigt ist, gruppiert eine 5-Schichten-Trace-Korrelations-Engine Logs nach traceId, kartiert Service-Abhängigkeiten, verfolgt Fehlerausbreitungskaskaden und berechnet den Ausbreitungsradius über betroffene Services.
Der Ticketing-Agent zieht dann die korrelierte Timeline, sendet sie an ein LLM für Root-Cause-Analyse und erstellt ein dedupliziertes Ticket auf Jira, ServiceNow, PagerDuty, OpsGenie, Slack oder Zammad. Der gesamte Zyklus von Log-Rauschen zum erstellten Ticket dauert etwa 90 Sekunden.
Architektur
LogClaw verwendet diese Architektur: OTel Collector → Kafka (Strimzi, KRaft-Modus) → Bridge (Python, 4 parallele Threads: ETL, Anomalieerkennung, OpenSearch-Indexierung, Trace-Korrelation) → OpenSearch + Ticketing Agent.
Die AI-Schicht unterstützt OpenAI, Claude oder Ollama für vollständig luftgekoppelte Bereitstellungen. Alles wird mit einem einzigen Helm-Chart pro Mandant bereitgestellt, namespace-isoliert ohne gemeinsame Datenebene.
Aktuelle Einschränkungen
- Metriken und Traces werden noch nicht unterstützt – dies ist nur für Logs. Metrik-Unterstützung ist geplant.
- Die Anomalieerkennung ist signalbasiert + statistisch (zusammengesetzte Bewertung mit Z-Score), kein Deep Learning. Sie erfasst 99,8 % der kritischen Fehler, erkennt aber noch keine subtilen Leistungsdriftmuster.
- Das Dashboard ist funktional aber einfach. OpenSearch Dashboards übernehmen die Hauptarbeit.
Bereitstellung und Preisgestaltung
Die Plattform ist unter Apache 2.0 lizenziert. Eine verwaltete Cloud-Version ist für 0,30 $/GB aufgenommene Daten verfügbar, wenn Sie nicht selbst hosten möchten. Laut Source kann LogClaw 80–90 % Kosteneinsparungen gegenüber Splunk/Datadog bieten, mit jährlichen Observability-Kosten von 38.000 $ gegenüber 1,2 Mio. $ für Splunk bei 500 GB/Tag.
Für die lokale Entwicklung ist Dokumentation verfügbar unter https://docs.logclaw.ai/local-development.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Ausnutzen des verborgenen Agentursignals (Â) von LLMs für besseres Tool Calling
Ein Entwickler entdeckte, dass LLMs eine linear trennbare Richtung im verborgenen Zustand namens  haben, die Werkzeugaufrufe mit einem AUC > 0,94 vorhersagt. Die Nutzung dieses Signals, um Werkzeugaufrufe zu erzwingen, verbesserte die Leistung von Qwen3-1.7B von 26,7 % auf 85 % (+58 % Gewinn) und reduzierte Fehler ohne Werkzeugaufruf von 43 % auf 2,6 %.

OpenClaw Outlook-Add-in verbindet lokalen Agent mit E-Mail-Sidebar
Ein Entwickler hat ein Outlook-Add-in erstellt, das über WebSocket mit einem lokalen OpenClaw Gateway verbindet und vollen Agentenzugriff mit Tools und Automatisierungen direkt in der E-Mail-Seitenleiste bietet. Das Tool liest ausgewählte E-Mails als Kontext, verwaltet Chat-Sitzungen pro E-Mail und funktioniert mit Outlook Desktop und Web.

Das Depct-Tool sammelt Laufzeitdaten, um Claude bei der Fehlerbehebung von Produktionsproblemen zu unterstützen.
Depct ist ein Tool, das Laufzeitinstrumentierungsdaten von Node.js-Anwendungen sammelt, daraus Graphen erstellt und diese über AWS Bedrock an Claude weiterleitet, um bei der Fehlersuche bei sporadischen Produktionsfehlern zu helfen. Es generiert auch Architekturdiagramme und Abhängigkeitskarten aus dem Laufzeitverhalten.

Claude Code Voice-Modus: Freihändige KI-Gespräche für Entwickler
Claudes Voice-Modus-Beta ermöglicht es Ihnen, mit der KI zu sprechen und Antworten zu hören, mit Freisprech- und Push-to-Talk-Optionen. Es funktioniert im Web und auf Mobilgeräten, zählt zu den regulären Nutzungslimits und ermöglicht das Wechseln zwischen Text und Sprache im selben Gespräch.