ScreenMind: Lokale KI-Erinnerung, die Ihre gesamte Computeraktivität indexiert

✍️ OpenClawRadar📅 Veröffentlicht: 8. Juni 2026🔗 Source
ScreenMind: Lokale KI-Erinnerung, die Ihre gesamte Computeraktivität indexiert
Ad

ScreenMind ist ein lokales KI-Speichersystem, das kontinuierlich Ihren Bildschirm erfasst, Meetings transkribiert und Sprachnotizen indexiert. Es erstellt eine durchsuchbare Zeitleiste alles, was Sie auf Ihrem Computer tun. Durch Wahrnehmungshashing wird nur bei Inhaltsänderungen aufgezeichnet, und jeder Frame wird via llama.cpp mit Gemma 4 E2B für Bildanalyse, Chat und Audioverarbeitung verarbeitet.

Hauptfunktionen

  • Bildschirmaufnahme mit Wahrnehmungshashing – speichert nur Frames bei tatsächlichen Änderungen
  • Durchsuchbare Zeitleiste – Fragen Sie nach vergangenen Aktivitäten: „diese Fehlermeldung von vorhin“, „woran habe ich um 15 Uhr gearbeitet?“
  • Chatten Sie mit Ihrem Verlauf – dauerhafter KI-Kontext aus Ihrer gesamten Sitzung
  • Meeting-Transkription – erkennt automatisch Zoom, Teams und Google Meet
  • Sprachnotizen – verarbeitet über den Audio-Encoder von Gemma 4
  • Automatisierungen in natürlicher Sprache – schreiben Sie sie in einfachem Englisch in Markdown
  • MCP-Integration – verbinden Sie sich mit Claude und Cursor
Ad

Technischer Aufbau

  • Modelle: Gemma 4 E2B (für Bild, Chat, Audio)
  • Backend: Python + FastAPI
  • Speicher: SQLite
  • Inferenz: llama.cpp mit Q4-Quantisierung
  • Hardware: 4 GB+ VRAM

Der Autor merkt an, dass die GPU-Zeitplanung zwischen Bild-, Chat- und Audioaufgaben die größte Herausforderung bei der Inferenzoptimierung darstellt. Das Projekt ist noch eher workflowgesteuert als vollständig autonom – Abrufqualität und Einarbeitungsaufwand sind verbesserungswürdig.

GitHub: ayushh0110/ScreenMind

📖 Zur vollständigen Quelle: r/LocalLLaMA

Ad

👀 Siehe auch

AgentLens: Beobachtungstool für Multi-Agenten-KI-Workflows
Werkzeuge

AgentLens: Beobachtungstool für Multi-Agenten-KI-Workflows

AgentLens bietet einheitliche Verfolgung über Ollama, vLLM, Anthropic und OpenAI mit Kostenverfolgung, einen MCP-Server zum Abfragen von Statistiken aus Claude Code und eine CLI für Inline-Prüfungen. Es ist selbst gehostet und läuft lokal über Docker.

OpenClawRadar
Forschungsteam-in-einer-Box-Framework für Claude Code unter Verwendung einer Multi-Agenten-Architektur
Werkzeuge

Forschungsteam-in-einer-Box-Framework für Claude Code unter Verwendung einer Multi-Agenten-Architektur

Ein Entwickler hat ein Multi-Agenten-Forschungsframework für Claude Code erstellt, das Opus 4.6 nutzt, um spezialisierte Agenten über ein Plugin namens research-clab zu koordinieren. Das Framework entfaltet sich über einen geführten Frage-Antwort-Prozess und umfasst 11 Fähigkeiten, Agentendefinitionen und strukturierte Verzeichnisse zur Verwaltung komplexer Forschungsprojekte.

OpenClawRadar
Claude Code v2.1.59 fügt Auto-Memory, den Copy-Befehl und Shell-Verbesserungen hinzu.
Werkzeuge

Claude Code v2.1.59 fügt Auto-Memory, den Copy-Befehl und Shell-Verbesserungen hinzu.

Claude Code v2.1.59 führt automatisches Kontextspeichern in den Auto-Speicher mit /memory-Verwaltung ein, fügt einen /copy-Befehl für interaktive Codeblock-Auswahl hinzu und verbessert Präfix-Vorschläge für zusammengesetzte Bash-Befehle.

OpenClawRadar
OpenClaw-Fähigkeiten mit hoher Akzeptanz: Capability Evolver, WACLI, Composio und mehr
Werkzeuge

OpenClaw-Fähigkeiten mit hoher Akzeptanz: Capability Evolver, WACLI, Composio und mehr

Ein Reddit-Beitrag hebt mehrere OpenClaw-Skills mit hohen Installationszahlen und spezifischen Anwendungsfällen hervor, darunter Capability Evolver zur Selbstüberprüfung des Agentenverhaltens, WACLI für WhatsApp-Zugriff und Composio zur Verbindung mit über 860 Apps.

OpenClawRadar