OpenClaw erreicht das 33K-Kontextlimit: So beheben Sie es

✍️ OpenClawRadar📅 Veröffentlicht: 18. August 2026🔗 Source
Ad

Ein Entwickler auf r/openclaw berichtet über eine dauerhafte 33K-Token-Kontextbegrenzung in OpenClaw, obwohl ein 262K-Kontextfenster konfiguriert wurde. Das Problem betrifft jedes Modell, das sie lokal laden, einschließlich Qwen3.8-27B, und scheint außerhalb der Kontrolle von OpenClaw zu liegen.

Was passiert

Der Benutzer hat das Kontextfenster korrekt eingestellt:

openclaw config set agents.defaults.contextWindow 262144

OpenClaw erkennt an, dass das Modell 262144 Token unterstützt, aber die Antworten verschlechtern sich nach etwa 33K Token, was häufige /compact- oder /new-Befehle auf Telegram erzwingt. Die Ausführung von ollama ps zeigt, dass das Modell nur einen 33K-Kontext geladen hat, unabhängig von der nativen Kapazität des Modells.

Ursache

Das Problem liegt wahrscheinlich in Ollama, nicht in OpenClaw. Ollama standardmäßig auf eine Kontextgröße (oft 4096 oder 8192), sofern nicht über die Umgebungsvariable OLLAMA_CONTEXT_LENGTH oder den Parameter num_ctx in der Modelfile überschrieben. OpenClaw übergibt die Kontextlänge nicht an Ollama, also lädt Ollama mit einem kleinen Fenster.

Ad

Lösungen

  • OLLAMA_CONTEXT_LENGTH setzen: Bevor Sie Ollama starten, setzen Sie die Umgebungsvariable auf 262144.
    export OLLAMA_CONTEXT_LENGTH=262144
  • Modelfile aktualisieren: Wenn Sie ein benutzerdefiniertes Modell verwenden, fügen Sie den Parameter
    PARAMETER num_ctx 262144
    hinzu und erstellen Sie das Modell neu.
  • Docker prüfen: Wenn Ollama in Docker läuft, stellen Sie sicher, dass die Umgebungsvariable über docker run -e OLLAMA_CONTEXT_LENGTH=262144 übergeben wird.

Zusätzliche Hinweise

Sie können den geladenen Kontext mit ollama ps überprüfen – nach dem Fix sollte die neue Größe angezeigt werden. Erwägen Sie auch, den OpenAI-kompatiblen Endpunkt von Ollama mit num_ctx in der Anfrage zu verwenden, was einige Clients unterstützen.

Weitere Details finden Sie in der Quellendiskussion.

📖 Vollständige Quelle lesen: r/openclaw

Ad

👀 Siehe auch

10 praktische Tipps zur Nutzung von Claude Code von einem Reddit-Nutzer
Tipps

10 praktische Tipps zur Nutzung von Claude Code von einem Reddit-Nutzer

Ein Reddit-Nutzer teilt spezifische Techniken für Claude Code, darunter die Verwendung von /effort high mit 'ultrathink' für erweitertes Denken, das Erstellen isolierter Konversationszweige mit /fork und das Einrichten benutzerdefinierter Hooks in .claude/settings.json.

OpenClawRadar
Die Verwendung von KI zur Generierung von Projekt-Tickets vor der Programmierung reduziert Scope Drift.
Tipps

Die Verwendung von KI zur Generierung von Projekt-Tickets vor der Programmierung reduziert Scope Drift.

Ein Entwickler stellte fest, dass das Erstellen detaillierter Projekt-Tickets mit Aufgaben, Unteraufgaben, Umfang und Abnahmekriterien durch KI, bevor Code geschrieben wird, Scope Creep und große Diffs erheblich reduzierte. Jeder KI-Agent erhält nur seine spezifische Unteraufgabe, nicht den gesamten Plan.

OpenClawRadar
OpenClaw API Budgetauslauf: Einstellungen, die sofort geändert werden müssen
Tipps

OpenClaw API Budgetauslauf: Einstellungen, die sofort geändert werden müssen

Die standardmäßige Heartbeat-Funktion von OpenClaw kann API-Budgets durch die Überprüfung von Aufgaben alle 30 Minuten und das Laden vollständiger Kontextdateien, des Speichers und des Chat-Verlaufs jedes Mal belasten. Die Quelle empfiehlt, die aktiven Stunden zu ändern, günstigere Basismodelle zu verwenden, manuell nur bei Bedarf auf Premium-Modelle umzuschalten und /new zu verwenden, um Sitzungen zurückzusetzen.

OpenClawRadar
Pro KI-Agent-Dummheit beheben: Ein gemeinsamer Kontextbaum pro Repository
Tipps

Pro KI-Agent-Dummheit beheben: Ein gemeinsamer Kontextbaum pro Repository

Der Grund, warum KI-Mitarbeiter sich dumm anfühlen, ist nicht das Modell – es ist der Mangel an gemeinsamem Kontext. Die Lösung eines Entwicklers: ein Kontextbaum-Repository mit hierarchischen Markdown-Knoten, die der Agent automatisch pflegt.

OpenClawRadar