Selbstgehostete Speicherschicht für Claude läuft kostenlos auf Cloudflare

Ein Reddit-Nutzer hat second-brain-cloudflare entwickelt, einen Open-Source-MCP-Server, der Claude persistenten Speicher hinzufügt. Er läuft vollständig auf Cloudflares kostenloser Stufe unter Verwendung von Workers, D1 (SQLite), Vectorize und Workers AI.
Hauptfunktionen
- Vier MCP-Tools:
remember,recall,list_recent,forget. - Semantische Suche über
recall: Notizen werden mit dem Modellbge-small-en-v1.5über Workers AI in Vektoren eingebettet und in Cloudflare Vectorize gespeichert. Suchen finden Treffer basierend auf Bedeutung, nicht auf Stichwörtern. - Kompatibel mit Claude Desktop, Claude Code und
claude.ai(über benutzerdefinierte Verbindungen).
Funktionsweise
Sie fügen Anweisungen in Claudes System-Prompt ein. Der Server wird über einen Ein-Klick-Deploy-Button im Repository bereitgestellt. Kontext: remember speichert eine Notiz, recall durchsucht semantische Einbettungen, list_recent zeigt aktuelle Notizen an, forget löscht eine Notiz. Der Stack: TypeScript, Cloudflare Workers + D1 + Vectorize + Workers AI.
Abwägungen und Implementierungsdetails
Der Autor weist darauf hin, dass semantische Suche Abwägungen mit sich bringt – Qualität der Einbettungen, Latenz und Kosten werden im Reddit-Thread diskutiert. Die kostenlose Stufe bewältigt die persönliche Nutzung problemlos.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Benutzerdefinierte Ausgabestil-Sammlung für Claude Code
Ein Entwickler hat 13 benutzerdefinierte Ausgabestile für Claude Code erstellt, die das Verhalten der KI durch Systemprompts verändern. Die Stile umfassen Roast für brutale Code-Kritik, Socratic für geführtes Fragenstellen, Breaker für adversarielles Testen, Ship It für pragmatische Lösungen, Paranoid für Sicherheitsfokus und TDD für testgetriebene Entwicklung.

Voxlert: Sprachbenachrichtigungen für Claude-Code-Sitzungen mit Charakterstimmen
Voxlert ist ein Tool, das sich in Claude Code-Ereignisse einklinkt und Benachrichtigungen mit markanten Charakterstimmen wie der StarCraft Adjutant, SHODAN, GLaDOS und dem HEV-Anzug spricht. Es nutzt ein LLM über OpenRouter, um in-Charakter-Zeilen zu generieren, und läuft lokal nach der npm-Installation.

Google Gemma 4 26B-A4B lokal mit LM Studio 0.4.0 Headless CLI ausführen
LM Studio 0.4.0 führt llmster und die lms CLI für lokale Modellinferenz ohne Benutzeroberfläche ein. Der Artikel beschreibt die Einrichtung von Googles Gemma 4 26B-A4B MoE-Modell auf einem MacBook Pro M4 Pro, wobei 51 Token/Sekunde mit 48 GB vereinheitlichtem Speicher erreicht werden.

Mehr-Agenten-Debatten-App entwickelt mit Claude, ElevenLabs und Flux
Ein Entwickler hat eine Debatten-App erstellt, in der Claude Argumente für zwei Personas zu jedem Thema generiert, mit einem KI-Richter, der bewertet und einen Gewinner auswählt. Die App fügt über ElevenLabs Stimmen und über Flux Bilder hinzu, um ein Debatten-Showerlebnis zu schaffen.