SmallClaw V1.0.3 fügt Webhooks, n8n-Automatisierung und MCP-Server-Unterstützung hinzu

Webhook-Integration
SmallClaw enthält nun einen integrierten Webhook-Server, der direkt im Gateway läuft. Jeder Dienst, der einen HTTP-POST senden kann, kann ihn ohne Middleware auslösen. Die Architektur folgt diesem Ablauf: Externer Dienst sendet ein Ereignis → SmallClaw empfängt es → Agent läuft im Hintergrund → Ergebnis kann an Ihre Chat-Sitzung und optional an Telegram zurückgegeben werden.
Zwei Hauptendpunkte sind verfügbar:
POST /hooks/agent- führt einen vollständigen Agent-Job aus und gibt sofort 202 zurück, während der Agent im Hintergrund läuft. Dies ermöglicht das Auslösen echter Arbeit von Diensten wie GitHub, Stripe, Shopify, Vercel, Home Assistant oder Überwachungsbenachrichtigungen.POST /hooks/wake- ein ressourcenschonender Anstoß für Ereignisbenachrichtigungen, der entweder sofort ausgeführt oder für den nächsten Herzschlagzyklus in die Warteschlange gestellt werden kann.
Sicherheitsfunktionen umfassen tokenbasierte Authentifizierung, gezielte Ablehnung von Query-String-Tokens und Sperrung nach wiederholten fehlgeschlagenen Versuchen.
n8n Lokale Automatisierung
Für Dienste, die ausgehende Webhooks nicht unterstützen, können Sie n8n lokal als Middleware-Workflow-Engine ausführen. Beispiel-Workflow: Google Sheets-Änderungsauslöser → n8n erkennt es → n8n ruft SmallClaw-Webhook auf → SmallClaw führt den Agent-Job aus → Antwort geht an Telegram oder Ihre letzte Sitzung. Dies schafft einen lokalen Automatisierungs-Stack mit n8n und SmallClaw auf Ihrem Rechner, der ein lokales Modell für die Arbeit verwendet.
MCP-Server-Verbindungen
SmallClaw unterstützt nun MCP (Model Context Protocol)-Server-Verbindungen, die als Standard-Plugin-System für KI dienen. Wenn ein Tool einen MCP-Server bereitstellt, kann SmallClaw sich damit verbinden und diese Tools ohne benutzerdefinierten Integrationscode pro Dienst nutzen. Dies ermöglicht dem Agent, Tools über das Protokoll von verschiedenen MCP-Servern zu entdecken und aufzurufen, einschließlich GitHub, Datenbanken (Postgres, SQLite), Suche, Dateisystem, Speicher und Browser-Servern.
Der Entwickler bittet um Vorschläge für MCP-Server-Integrationen von Nutzern, insbesondere erwähnt werden GitHub-Issues und PR-Workflows, Postgres-Datenbank-Assistent, Notion-Wissensbasis, Slack-Lesen und -Posten, Brave-Suche und Home Assistant-Aktionen.
Zusätzliche Updates
SmallClaw unterstützt nun Discord- und WhatsApp-Nachrichten, sodass Nutzer direkt über diese Plattformen mit ihrem Agent chatten können. Das Tool bleibt mit kleinen lokalen LLMs gebaut und getestet und behält seinen Zweck als lokaler Assistent bei, anstatt zu einem reinen Cloud-Betrieb überzugehen.
📖 Read the full source: r/openclaw
👀 Siehe auch

Lokale semantische Suche für KI-Gespräche mit fastembed und LanceDB
Ein Entwickler hat 368K KI-Konversationsnachrichten lokal mit fastembed für CPU-basierte Embeddings und LanceDB als serverlosen Vektorspeicher indiziert und dabei eine p50-Suchlatenz von 12ms ohne API-Schlüssel erreicht.

LM Studio-Parser-Fehler beeinträchtigen Qwen3.5-Toolaufrufe und logisches Denken
LM Studios Server-Parser enthält drei interagierende Fehler, die Tool-Aufrufe stillschweigend unterbrechen, die Ausgabe der Argumentation korrumpieren und Modelle schlechter erscheinen lassen, als sie sind. Die Probleme betreffen Argumentationsmodelle wie Qwen3.5 und DeepSeek-R1, wobei ein Fehler, der vor über einem Jahr gemeldet wurde, immer noch nicht behoben ist.

StarSteady: KI-gestützte Google-Bewertungsantworten und SMS-Anfragen für lokale Unternehmen
StarSteady ist ein von einer Einzelperson entwickeltes SaaS, das KI-generierte Antworten auf Google-/Yelp-Bewertungen erstellt und SMS-Bewertungsanfragen an Kunden sendet. Der Preis beginnt bei 39 $/Monat, mit einem kostenlosen Testangebot für 5 Antworten/5 SMS.

Benchmarking von Nemotron 3 Super 120B mit 1M Token-Kontext auf M1 Ultra
Ein Nutzer testete Nemotron 3 Super 120B mit einem Q4_K_M quantisierten Modell unter Verwendung von llama.cpp auf einem M1 Ultra und erreichte ein Kontextfenster von 1 Million Token, das etwa 90 GB VRAM verbrauchte. Leistungsbenchmarks zeigen Token-Generierungsgeschwindigkeiten von 255 t/s bei 512 Token Prompt-Verarbeitung bis hinab zu 22,37 t/s bei einem Kontext von 100.000 Token.