Kontextmodus: Ein MCP-Server, der Tool-Ausgaben für Claude Code komprimiert

✍️ OpenClawRadar📅 Veröffentlicht: 25. Februar 2026🔗 Source
Kontextmodus: Ein MCP-Server, der Tool-Ausgaben für Claude Code komprimiert
Ad

Was Context Mode bewirkt

Context Mode löst das Problem, bei dem jeder MCP-Tool-Aufruf in Claude Code Rohdaten in das 200K-Kontextfenster einfügt. Beispiele aus der Quelle zeigen, dass ein Playwright-Snapshot 56 KB kostet, zwanzig GitHub-Issues 59 KB und ein Zugriffslog 45 KB. Nach 30 Minuten können 40 % Ihres Kontexts verloren sein.

Der MCP-Server sitzt zwischen Claude Code und diesen Ausgaben, verarbeitet sie in Sandboxes, sodass nur Zusammenfassungen das Modell erreichen. Er erreicht eine 98 %ige Reduktion der Kontextnutzung (315 KB werden zu 5,4 KB).

Installation und Einrichtung

Einzeilige Installation:

/plugin marketplace add mksglu/claude-context-mode
/plugin install context-mode@claude-context-mode

Oder über CLI:

claude mcp add context-mode -- npx -y context-mode

Die Installation umfasst eine Auto-Routing-Fähigkeit, die große Ausgaben automatisch durch Context Mode leitet, plus einen PreToolUse-Hook, der Context-Mode-Routing in Subagent-Prompts injiziert. Kein Prompting erforderlich.

Verfügbare Tools

  • batch_execute: Mehrere Befehle + mehrere Suchanfragen in EINEM Aufruf ausführen (986 KB → 62 KB)
  • execute: Code in 10 Sprachen ausführen. Nur stdout gelangt in den Kontext (56 KB → 299 B)
  • execute_file: Dateien in Sandbox verarbeiten. Rohinhalte verlassen diese nie (45 KB → 155 B)
  • index: Markdown in FTS5 mit BM25-Ranking chunkern (60 KB → 40 B)
  • search: Indizierte Inhalte mit mehreren Abfragen in einem Aufruf durchsuchen (On-Demand-Retrieval)
  • fetch_and_index: URL abrufen, zu Markdown konvertieren, indizieren (60 KB → 40 B)
  • stats: Sitzungs-Token-Tracking mit Tool-spezifischer Aufschlüsselung
Ad

Technische Umsetzung

Jeder execute-Aufruf startet einen isolierten Subprozess mit eigener Prozessgrenze. Skripte können nicht auf Speicher oder Zustand anderer zugreifen. Der Subprozess führt Ihren Code aus, erfasst stdout, und nur dieser stdout gelangt in den Konversationskontext. Die Rohdaten – Logdateien, API-Antworten, Snapshots – verlassen die Sandbox nie.

Zehn Sprachlaufzeiten sind verfügbar: JavaScript, TypeScript, Python, Shell, Ruby, Go, Rust, PHP, Perl, R. Bun wird automatisch erkannt für 3-5x schnellere JS/TS-Ausführung.

Authentifizierte CLIs funktionieren über Credential-Passthrough – gh, aws, gcloud, kubectl, docker erben Umgebungsvariablen und Konfigurationspfade, ohne sie der Konversation preiszugeben.

Wenn die Ausgabe 5 KB überschreitet und eine Absicht angegeben ist, schaltet Context Mode auf absichtsgesteuerte Filterung um: Es indiziert die vollständige Ausgabe in die Wissensdatenbank, sucht nach Abschnitten, die Ihrer Absicht entsprechen, und gibt nur die relevanten Treffer mit einem Vokabular durchsuchbarer Begriffe für Folgefragen zurück.

Die Wissensdatenbank nutzt SQLite FTS5 (Full-Text Search 5) virtuelle Tabellen. Das index-Tool chunkert Markdown-Inhalte nach Überschriften, während Codeblöcke intakt bleiben, und speichert sie. Die Suche verwendet BM25-Ranking – einen probabilistischen Relevanzalgorithmus, der Dokumente basierend auf Termhäufigkeit, inverser Dokumenthäufigkeit und Dokumentlänge bewertet.

📖 Read the full source: HN AI Agents

Ad

👀 Siehe auch

Claude Workflow-Bibliothek verfolgt und bewertet jetzt automatisch Workflows aus Reddit
Werkzeuge

Claude Workflow-Bibliothek verfolgt und bewertet jetzt automatisch Workflows aus Reddit

Ein durchsuchbares, automatisch aktualisiertes Verzeichnis von Claude- und Claude-Code-Workflows aus großen Subreddits mit Schritten, Artefakten und Community-Bewertungen.

OpenClawRadar
Nelson v2.2.3 veröffentlicht: Multi-Agent-Koordination für Claude Code, plus ein Benchmark für diskrete Ereignissimulation
Werkzeuge

Nelson v2.2.3 veröffentlicht: Multi-Agent-Koordination für Claude Code, plus ein Benchmark für diskrete Ereignissimulation

Nelson v2.2.3 enthält eine Multi-Agenten-Koordinationsfähigkeit für Claude Code, die eine maritime Metapher verwendet. Ein Benchmark mit 13 Konfigurationen zeigt, dass opus-4-7 mit Denkmodus dominiert; die Wahl der Fähigkeit spielt eine geringere Rolle.

OpenClawRadar
ApexClaw: Open-Source Telegram KI-Agent mit über 85 Tools für Webautomatisierung, Sprache und E-Mail
Werkzeuge

ApexClaw: Open-Source Telegram KI-Agent mit über 85 Tools für Webautomatisierung, Sprache und E-Mail

ApexClaw ist ein Open-Source-Telegram-AI-Agent, geschrieben in Go, der über 85 integrierte Tools bietet, darunter Web-Browsing mit Headless Chrome, Sprachnotizen-Verarbeitung, Gmail-Integration und Shell-Skript-Ausführung. Er ist selbst gehostet und nutzt die z.ai-Engine für die Argumentation.

OpenClawRadar
Claude 4.6 Opus Reasoning auf 14 GB für Apple Silicon mittels MLX-Quantisierung destilliert
Werkzeuge

Claude 4.6 Opus Reasoning auf 14 GB für Apple Silicon mittels MLX-Quantisierung destilliert

Ein Entwickler hat ein Qwen 3.5 27B-Modell, das aus Claude 4.6 Opus Reasoning Trajectories destilliert wurde, mit MLX für Apple Silicon von 55,6 GB auf 14 GB quantisiert und erreicht dabei ~16 Token/Sekunde auf einem M4 Pro, während die analytischen Denkfähigkeiten des Modells erhalten bleiben.

OpenClawRadar