OpenClaw erreicht das 33K-Kontextlimit: So beheben Sie es
Ein Entwickler auf r/openclaw berichtet über eine dauerhafte 33K-Token-Kontextbegrenzung in OpenClaw, obwohl ein 262K-Kontextfenster konfiguriert wurde. Das Problem betrifft jedes Modell, das sie lokal laden, einschließlich Qwen3.8-27B, und scheint außerhalb der Kontrolle von OpenClaw zu liegen.
Was passiert
Der Benutzer hat das Kontextfenster korrekt eingestellt:
openclaw config set agents.defaults.contextWindow 262144OpenClaw erkennt an, dass das Modell 262144 Token unterstützt, aber die Antworten verschlechtern sich nach etwa 33K Token, was häufige /compact- oder /new-Befehle auf Telegram erzwingt. Die Ausführung von ollama ps zeigt, dass das Modell nur einen 33K-Kontext geladen hat, unabhängig von der nativen Kapazität des Modells.
Ursache
Das Problem liegt wahrscheinlich in Ollama, nicht in OpenClaw. Ollama standardmäßig auf eine Kontextgröße (oft 4096 oder 8192), sofern nicht über die Umgebungsvariable OLLAMA_CONTEXT_LENGTH oder den Parameter num_ctx in der Modelfile überschrieben. OpenClaw übergibt die Kontextlänge nicht an Ollama, also lädt Ollama mit einem kleinen Fenster.
Lösungen
- OLLAMA_CONTEXT_LENGTH setzen: Bevor Sie Ollama starten, setzen Sie die Umgebungsvariable auf 262144.
export OLLAMA_CONTEXT_LENGTH=262144 - Modelfile aktualisieren: Wenn Sie ein benutzerdefiniertes Modell verwenden, fügen Sie den Parameter
hinzu und erstellen Sie das Modell neu.PARAMETER num_ctx 262144 - Docker prüfen: Wenn Ollama in Docker läuft, stellen Sie sicher, dass die Umgebungsvariable über
docker run -e OLLAMA_CONTEXT_LENGTH=262144übergeben wird.
Zusätzliche Hinweise
Sie können den geladenen Kontext mit ollama ps überprüfen – nach dem Fix sollte die neue Größe angezeigt werden. Erwägen Sie auch, den OpenAI-kompatiblen Endpunkt von Ollama mit num_ctx in der Anfrage zu verwenden, was einige Clients unterstützen.
Weitere Details finden Sie in der Quellendiskussion.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

10 praktische Tipps zur Nutzung von Claude Code von einem Reddit-Nutzer
Ein Reddit-Nutzer teilt spezifische Techniken für Claude Code, darunter die Verwendung von /effort high mit 'ultrathink' für erweitertes Denken, das Erstellen isolierter Konversationszweige mit /fork und das Einrichten benutzerdefinierter Hooks in .claude/settings.json.

Die Verwendung von KI zur Generierung von Projekt-Tickets vor der Programmierung reduziert Scope Drift.
Ein Entwickler stellte fest, dass das Erstellen detaillierter Projekt-Tickets mit Aufgaben, Unteraufgaben, Umfang und Abnahmekriterien durch KI, bevor Code geschrieben wird, Scope Creep und große Diffs erheblich reduzierte. Jeder KI-Agent erhält nur seine spezifische Unteraufgabe, nicht den gesamten Plan.

OpenClaw API Budgetauslauf: Einstellungen, die sofort geändert werden müssen
Die standardmäßige Heartbeat-Funktion von OpenClaw kann API-Budgets durch die Überprüfung von Aufgaben alle 30 Minuten und das Laden vollständiger Kontextdateien, des Speichers und des Chat-Verlaufs jedes Mal belasten. Die Quelle empfiehlt, die aktiven Stunden zu ändern, günstigere Basismodelle zu verwenden, manuell nur bei Bedarf auf Premium-Modelle umzuschalten und /new zu verwenden, um Sitzungen zurückzusetzen.

Pro KI-Agent-Dummheit beheben: Ein gemeinsamer Kontextbaum pro Repository
Der Grund, warum KI-Mitarbeiter sich dumm anfühlen, ist nicht das Modell – es ist der Mangel an gemeinsamem Kontext. Die Lösung eines Entwicklers: ein Kontextbaum-Repository mit hierarchischen Markdown-Knoten, die der Agent automatisch pflegt.