OpenClaw erreicht das 33K-Kontextlimit: So beheben Sie es
Ein Entwickler auf r/openclaw berichtet über eine dauerhafte 33K-Token-Kontextbegrenzung in OpenClaw, obwohl ein 262K-Kontextfenster konfiguriert wurde. Das Problem betrifft jedes Modell, das sie lokal laden, einschließlich Qwen3.8-27B, und scheint außerhalb der Kontrolle von OpenClaw zu liegen.
Was passiert
Der Benutzer hat das Kontextfenster korrekt eingestellt:
openclaw config set agents.defaults.contextWindow 262144OpenClaw erkennt an, dass das Modell 262144 Token unterstützt, aber die Antworten verschlechtern sich nach etwa 33K Token, was häufige /compact- oder /new-Befehle auf Telegram erzwingt. Die Ausführung von ollama ps zeigt, dass das Modell nur einen 33K-Kontext geladen hat, unabhängig von der nativen Kapazität des Modells.
Ursache
Das Problem liegt wahrscheinlich in Ollama, nicht in OpenClaw. Ollama standardmäßig auf eine Kontextgröße (oft 4096 oder 8192), sofern nicht über die Umgebungsvariable OLLAMA_CONTEXT_LENGTH oder den Parameter num_ctx in der Modelfile überschrieben. OpenClaw übergibt die Kontextlänge nicht an Ollama, also lädt Ollama mit einem kleinen Fenster.
Lösungen
- OLLAMA_CONTEXT_LENGTH setzen: Bevor Sie Ollama starten, setzen Sie die Umgebungsvariable auf 262144.
export OLLAMA_CONTEXT_LENGTH=262144 - Modelfile aktualisieren: Wenn Sie ein benutzerdefiniertes Modell verwenden, fügen Sie den Parameter
hinzu und erstellen Sie das Modell neu.PARAMETER num_ctx 262144 - Docker prüfen: Wenn Ollama in Docker läuft, stellen Sie sicher, dass die Umgebungsvariable über
docker run -e OLLAMA_CONTEXT_LENGTH=262144übergeben wird.
Zusätzliche Hinweise
Sie können den geladenen Kontext mit ollama ps überprüfen – nach dem Fix sollte die neue Größe angezeigt werden. Erwägen Sie auch, den OpenAI-kompatiblen Endpunkt von Ollama mit num_ctx in der Anfrage zu verwenden, was einige Clients unterstützen.
Weitere Details finden Sie in der Quellendiskussion.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

Fordere KI auf, ihre eigenen Begriffe aus ersten Prinzipien zu definieren für bessere Ergebnisse und nachvollziehbare Begründungen
Ein Nutzer auf r/ClaudeAI hat herausgefunden, dass das Hinzufügen einer einzigen Anweisung, undefinierte Begriffe vor der weiteren Bearbeitung auf ihre atomare Bedeutung herunterzubrechen, spezifischere Ausgaben liefert und Debugging durch eine nachvollziehbare Argumentationskette ermöglicht.

Claudes Datenquellen: Wann Websuchen für aktuelle Informationen anzufordern sind
Claude verlässt sich manchmal auf interne Trainingsdaten statt Websuchen durchzuführen, was veraltete Informationen liefern kann. Nutzer können gezielt Websuchen anfordern, um aktuellere Ergebnisse zu erhalten.

Komprimieren Sie CLAUDE.md-Dateien, um die Systemaufforderungsaufblähung in Claude Code zu reduzieren
Eine Technik zum Komprimieren von CLAUDE.md-Dateien durch Entfernen menschenlesbarer Formatierungen wie Markdown-Überschriften und Fließtext, die durch kompakte Notationen wie pipe-getrennte Listen ersetzt werden, wodurch eine Reduzierung um 60-70 % der Zeichen erreicht wird, während die gleichen Informationen für Claude erhalten bleiben.

Automatisiertes QA und Testen mit KI: Eine neue Ära für Softwaretests
Antirez beschreibt den Einsatz von LLM-Agenten für automatisierte QA: Eine Markdown-Datei weist den Agenten an, manuelle Tests an neuen Releases durchzuführen. Angewendet auf DwarfStar und Redis Arrays hebt dieser Ansatz die Softwarequalität, ohne an Gründlichkeit einzubüßen.