Lokaler KI-Agenten-Workflow mit OpenCode, FastMCP und DeepSeek-r1

✍️ OpenClawRadar📅 Veröffentlicht: 25. März 2026🔗 Source
Lokaler KI-Agenten-Workflow mit OpenCode, FastMCP und DeepSeek-r1
Ad

Ein Entwickler auf r/LocalLLaMA beschreibt, wie er über die Nutzung von LLMs als „aufgeblasene Autovervollständigung“ hinausgeht, indem er einen lokalen agentenbasierten Workflow mit OpenCode, FastMCP und dem DeepSeek-r1-Modell implementiert.

AGENTS.md-Standard für deterministische Prompts

Der Entwickler nutzt eine AGENTS.md-Datei als deterministisches Handbuch, das strikte Regeln in den Systemprompt der KI einfügt. Beispiele sind „Verwende Python 3.9, formatiere mit Ruff, absolut keine globalen Variablen.“ Dieser Ansatz zielt darauf ab, Halluzinationen von vornherein zu vermeiden.

Lokale Subagenten mit DeepSeek-r1

Anstatt Cloud-APIs wie Claude oder GPT-4o für triviale Aufgaben zu nutzen, richteten sie Ollama mit dem kostenlosen deepseek-r1-Modell ein. Sie erstellten spezifische Subagenten, wie einen für Tests, der in einer pytest.md-Datei definiert ist. Wichtige Konfigurationen umfassen:

  • Temperatur auf 0,1 gesetzt
  • Tools eingeschränkt: „pytest“: true und „bash“: false

Dies ermöglicht es der KI, Testsuites autonom auszuführen, Tracebacks zu lesen und Syntaxfehler zu beheben, während sie von potenziell gefährlichen Befehlen wie rm -rf blockiert wird.

Ad

FastMCP für standardisierte lokale Funktionsbereitstellung

FastMCP wird als „das ‚USB-C‘ der KI“ beschrieben – ähnlich wie FastAPI, aber für KI-Agenten. Mit etwa 5 Zeilen Python kann man einen lokalen Server starten, um sichere lokale Funktionen (wie das Abfragen einer Entwicklungsdatenbank) auf standardisierte Weise bereitzustellen, die jeder OpenCode-Agent nutzen kann.

Ein entscheidender Implementierungstipp: Leite alle Python-Logs an stderr weiter, da das MCP-Protokoll über stdio läuft. Ein stehengebliebener print()-Aufruf kann das JSON-RPC-Paket beschädigen und die Verbindung abbrechen.

Der Entwickler merkt an, dass sie ein Video aufgenommen haben, in dem sie diese gesamte Architektur von Grund auf codieren und die lokale Umgebung in etwa 15 Minuten einrichten.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Freddy MCP Server: Gewähren Sie Ihrem OpenClaw-Agenten Lesezugriff auf persönliche Gesundheitsdaten
Werkzeuge

Freddy MCP Server: Gewähren Sie Ihrem OpenClaw-Agenten Lesezugriff auf persönliche Gesundheitsdaten

Freddy ist ein persönlicher Gesundheitsdaten-Server, der Schlaf, Erholung, Trainingsbelastung und mehr als MCP-Server bereitstellt, sodass OpenClaw-Agenten über echte Körperdaten nachdenken können.

OpenClawRadar
Claude Code Plan Mode reduziert die Überarbeitungsrate von 40 % auf nahezu Null.
Werkzeuge

Claude Code Plan Mode reduziert die Überarbeitungsrate von 40 % auf nahezu Null.

Ein Entwickler verfolgte über 30 Codingsitzungen mit Claude Code und stellte fest, dass das Überspringen des Planungsmodus in 40 % der Fälle dazu führte, dass Aufgaben von Grund auf neu gemacht werden mussten. Mit dem Planungsmodus sank die Wiederholungsrate auf praktisch null, wobei eine Funktion insgesamt 17 Minuten dauerte, verglichen mit über 35 Minuten ohne Planung.

OpenClawRadar
TRELLIS.2 Image-to-3D auf Apple Silicon nativ portiert
Werkzeuge

TRELLIS.2 Image-to-3D auf Apple Silicon nativ portiert

Ein Entwickler hat Microsofts 4-Milliarden-Parameter-TRELLIS.2-Bild-zu-3D-Modell portiert, um es nativ auf Apple Silicon über PyTorch MPS laufen zu lassen, wobei CUDA-spezifische Operationen durch reine PyTorch-Alternativen ersetzt wurden. Der Port erzeugt ~400.000 Vertex-Meshes aus einzelnen Fotos in etwa 3,5 Minuten auf dem M4 Pro mit 24 GB Arbeitsspeicher.

OpenClawRadar
InsForge: Eine Backend-Semantikschicht für Claude Code Agents
Werkzeuge

InsForge: Eine Backend-Semantikschicht für Claude Code Agents

InsForge stellt sechs Backend-Primitive bereit – Authentifizierung, Postgres-Datenbank, S3-kompatiblen Speicher, Edge-/Serverless-Funktionen, Model-Gateway und Site-Deployment – als strukturierte Komponenten dar, die Claude Code-Agenten über MCP inspizieren und konfigurieren können, anstatt API-Integrationen erraten zu müssen.

OpenClawRadar