Opendesk: MCP + SOM-Algorithmus zur KI-Desktopsteuerung über Claude Code

Opendesk ist ein Open-Source-MCP-Server, der KI-Agenten die vollständige Kontrolle über Ihren Desktop ermöglicht – einschließlich Maus und Tastatur – und dabei einen benutzerdefinierten Self-Organizing Map (SOM)-Algorithmus für verbesserte Genauigkeit verwendet. Es integriert sich mit Claude Code oder jeder benutzerdefinierten Agentenplattform und ermöglicht echte Desktop-Automatisierungsworkflows.
Hauptfunktionen
- Desktop-Steuerung: Agenten können die Maus bewegen, klicken und tippen, um mit jeder Anwendung oder Website zu interagieren.
- Lernen & Wiederholen: Zeichnen Sie eine Abfolge von Aktionen auf (z. B. Anmelden in einem Dashboard und Exportieren eines Berichts) und spielen Sie sie später auf Befehl ab.
- Planung: Führen Sie Computeraufgaben automatisch zu bestimmten Zeiten aus – z. B. jeden Morgen um 9 Uhr Gmail öffnen und ungelesene E-Mails zusammenfassen.
Beispielbefehle
- „Öffne Spotify und spiele eine Lofi-Playlist ab“
- „Gehe zu Twitter und like die ersten 3 Beiträge in meinem Feed“
- „Fülle dieses Formular in Chrome aus“
Integration
Funktioniert mit Claude Code und jeder benutzerdefinierten Agentenplattform, die MCP unterstützt. Der SOM-Algorithmus verbessert die Klick-/Zielgenauigkeit im Vergleich zu herkömmlichen Computer-Use-Implementierungen.
Erste Schritte
Quellcode und Dokumentation verfügbar auf GitHub: github.com/vitalops/opendesk
📖 Lesen Sie die vollständige Quelle: r/ClaudeAI
👀 Siehe auch

Agoragentic: pip-installbarer Agenten-Marktplatz zum Kaufen und Verkaufen von Fähigkeiten
Agoragentic ist ein Agent-zu-Agent-Marktplatz, auf dem KI-Agenten Fähigkeiten anderer Agenten entdecken und aufrufen können über eine pip-installierbare Integration. Der Marktplatz nutzt USDC auf Base L2 für Zahlungen mit einer 3% Plattformgebühr und bietet kostenlose Testguthaben.

Verwenden von /probe, um KI-Halluzinationen zu erkennen, bevor Code geschrieben wird
Ein Entwickler teilt eine Technik namens /probe, die KI-generierte Pläne dazu zwingt, nummerierte Behauptungen mit erwarteten Werten aufzustellen, und dann das reale System abfragt, um Diskrepanzen zu erkennen. Die Methode hat vier faktische Fehler in Claudes Beschreibung seines eigenen JSONL-Formats aufgedeckt, die zu Code-Fehlern geführt hätten.

Claude-Code-Architekturanalyse aus geleakten Source Maps
Die Analyse des 512.000 Zeilen umfassenden TypeScript-Codebases von Claude Code zeigt eine auf Bun basierende Laufzeitumgebung mit React/Ink CLI, über 100 Befehlen, 38+ Tools und Multi-Agenten-Koordination. Das System nutzt Zod für Validierung, OpenTelemetry für Telemetrie und beinhaltet Kontextkomprimierungsmechanismen.

Agent-factory: Ein Claude-Code-Plugin für persistente KI-Sub-Agenten-Teams
Agent-factory ist ein Claude Code-Plugin, das persistente Sub-Agenten-Teams mit unterschiedlichen Persönlichkeiten und dateibasierter Erinnerung erstellt. Es erstellt für jedes Projekt 2-5 Agenten durch einen konversationellen Interviewprozess, wobei jeder Agent spezifische Rollen wie Code-Review, Tech-Debt-Tracking oder Strategie übernimmt.