Aufbau eines Sprachassistenten mit OpenClaw, Alexa und lokalem LLM

Ein Entwickler teilte seine Implementierung eines sprachgesteuerten Assistenten, der OpenClaw als KI-Agenten-Backbone nutzt, mit Alexa für Sprachinteraktion und einem lokalen LLM für kosteneffiziente Anfragebearbeitung integriert.
Wie es funktioniert
Das System wird durch den Befehl "Alexa, öffne Lucy" zu einer benutzerdefinierten Alexa-Fähigkeit aktiviert. Anfragen werden durch ein vierstufiges Routing-System verarbeitet:
- Schnellpfad (0ms): Bearbeitet Zeit, Datum und fest codierte Antworten
- Ollama lokales LLM (<1s): Nutzt Qwen 2.5 3B für allgemeine Wissensanfragen, läuft auf einem Mac Mini mit Apple Silicon
- Claude-Agent (5-12s): Bearbeitet persönlichen Kontext, Erinnerung und komplexe Schlussfolgerungen
- Verzögert + Werkzeuge (bis zu 2min): Verwaltet E-Mail, Websuche und Datenbankabfragen über Home Assistant TTS
Antworten kehren zum selben Alexa-Gerät zurück, das die Anfrage initiiert hat, automatisch erkannt über Home Assistants last_called-Funktion. Das System nutzt Piper TTS auf Home Assistant für neuronale spanische Sprachausgabe auf Sonos-Lautsprechern und kann Morgenbriefings mit Marktdaten, Kalenderinformationen und Geschäftskennzahlen liefern.
Technischer Stack
- OpenClaw: KI-Agenten-Backbone mit Unterstützung für Telegram, Alexa und Sprachschnittstellen
- Alexa Custom Skill: Node.js-Proxy mit PIN-Authentifizierung und Sitzungsverkettung
- Ollama + Qwen 2.5 3B: Lokales LLM mit ~0,5s Antwortzeiten
- Home Assistant: Integriert Alexa Media Player, Piper TTS und Geräte-Routing
- Piper TTS: Neuronale spanische Stimme für Sonos-Lautsprecher
Wichtige Implementierungsdetails
Der Entwickler stellte fest, dass die Nutzung eines lokalen LLM etwa 80 % der API-Kosten für einfache Fragen einspart, die Claude nicht erfordern. Allerdings merkte er an, dass lokale Modelle "frei halluzinieren" und fügte einen Umgehungsfilter für Geschäfts- und Finanzanfragen hinzu.
Alexa-Spracherkennung wurde als Engpass identifiziert, wobei AMAZON.SearchQuery und mehrere Beispieläußerungen die Genauigkeit verbessern. Die Authentifizierung verwendet userId statt sessionId, da Alexa für jeden Aufruf neue Sitzungen generiert. Der Entwickler speichert Authentifizierung in einer Datei, da In-Memory-Maps Proxy-Neustarts nicht überstehen.
Der Proxy-Code ist als Open Source verfügbar: openclaw-alexa-voice. Zukünftige Pläne umfassen Wake-Word-Erkennung ("Hey Lucy"), Smart-Home-Steuerung und präsenzbasiertes Lautsprecher-Routing.
📖 Read the full source: r/openclaw
👀 Siehe auch

Vergleich der PRD-Ausführung: Bash-Schleife vs. Agententeams im Claude-Code
Ein Entwickler hat die Ausführung eines 14-Aufgaben-PRDs mit Claude Code sowohl mit einer Bash-Schleife als auch mit der Agenten Teams-Funktionalität getestet. Es stellte sich heraus, dass der Ansatz mit den Agenten Teams deutlich schneller war, obwohl er einige Koordinationsaufwände mit sich brachte.

Entwickler teilt Erfahrungen aus dem Aufbau einer Sport-App mit Base44 und Claude
Ein Entwickler hat eine Sport-App namens glanceplay.com auf Base44 für schnelle, casual-freundliche Spielzusammenfassungen erstellt, stellte jedoch fest, dass Base44-Guthaben für iterative Codeänderungen teuer sind. Sie empfehlen, Plattformen wie Base44 für das anfängliche Gerüst zu nutzen und sich dann auf Claude für inkrementelle Änderungen und Fehlerbehebung zu verlassen.

Wie Neil Kakkar Claude Code für die Automatisierung von Entwicklungs-Workflows nutzt
Neil Kakkar beschreibt die Automatisierung der Pull-Request-Erstellung mit einem /git-pr-Skill, den Wechsel zu SWC für Server-Neustarts in unter einer Sekunde und die Nutzung der Vorschaufunktion von Claude Code zur automatischen Überprüfung von UI-Änderungen.

Portieren von Linux auf FPGA-Soft-Cores mit Claude Code
Ein Entwickler portierte und bootete einen nommu Linux-Kernel (v6.6.83) auf dem NEORV32 Soft-Core unter Verwendung eines FPGA-Setups mit spezifischen Hardwarekonfigurationen und Open-Source-Patches.