OpenClaw atteint la limite de contexte de 33 000 : comment y remédier
Un développeur sur r/openclaw signale un plafond persistant de 33K jetons dans OpenClaw, malgré une configuration de fenêtre de contexte de 262K. Le problème affecte tous les modèles chargés localement, y compris Qwen3.8-27B, et semble échapper au contrôle d'OpenClaw.
Ce qui se passe
L'utilisateur a correctement défini la fenêtre de contexte :
openclaw config set agents.defaults.contextWindow 262144OpenClaw reconnaît que le modèle supporte 262144 jetons, mais les réponses se dégradent après environ 33K jetons, forçant des commandes /compact ou /new fréquentes sur Telegram. L'exécution de ollama ps révèle que le modèle n'a qu'un contexte de 33K chargé, quelle que soit la capacité native du modèle.
Cause racine
Le problème vient probablement d'Ollama, pas d'OpenClaw. Ollama utilise une taille de contexte par défaut (souvent 4096 ou 8192) à moins d'être remplacée via la variable d'environnement OLLAMA_CONTEXT_LENGTH ou le paramètre num_ctx dans le Modelfile. OpenClaw ne transmet pas la longueur de contexte à Ollama, donc Ollama se charge avec une petite fenêtre.
Solutions
- Définir OLLAMA_CONTEXT_LENGTH : Avant de démarrer Ollama, définissez la variable d'environnement à 262144.
export OLLAMA_CONTEXT_LENGTH=262144 - Mettre à jour le Modelfile : Si vous utilisez un modèle personnalisé, ajoutez le paramètre
et recréez le modèle.PARAMETER num_ctx 262144 - Vérifier Docker : Si Ollama fonctionne dans Docker, assurez-vous que la variable d'environnement est transmise via
docker run -e OLLAMA_CONTEXT_LENGTH=262144.
Notes supplémentaires
Vous pouvez vérifier le contexte chargé avec ollama ps — il devrait afficher la nouvelle taille après le correctif. Envisagez également d'utiliser le point de terminaison compatible OpenAI d'Ollama avec num_ctx dans la requête, ce que certains clients prennent en charge.
Pour plus de détails, consultez la discussion source.
📖 Lire la source complète : r/openclaw
👀 See Also

Acheminement des sous-tâches de l'agent vers des modèles moins chers : le coût est passé de 18 $ à 4 $ pour la même refonte
Un développeur a réduit le coût d'exécution d'un agent de 18 $ à 4 $ en routant les sous-tâches de routine (lint, renommage, modifications de configuration) vers des modèles bon marché comme DeepSeek V4 Pro et Tencent Hunyuan Hy3, réservant Opus 4.7 pour le raisonnement complexe.

Comment diviser le contexte en fichiers séparés a rendu Claude plus cohérent
Un utilisateur de Reddit partage une configuration pratique pour Claude : diviser le contexte en fichiers about-me.md, my-voice.md et my-rules.md ; utiliser un flux planifier-avant-exécuter ; changer de modèle par tâche ; et donner des retours plutôt que des prompts parfaits.

La compaction ne peut pas corriger un contexte qui n'a jamais été dans la transcription : diagnostiquer les débordements de contexte d'OpenClaw
Un rapport de bug révèle un piège courant d'OpenClaw : lorsque le prompt système seul dépasse le budget de tokens, la compaction—qui ne résume que l'historique de conversation—ne peut pas aider. Utilisez /context map et /context detail pour trouver le vrai coupable.

La structure de prompt qui a amélioré les résumés de rapports PDF volumineux par Claude AI
Un développeur explique comment le passage de « résume ceci » à des invites spécifiant le rôle, la décision et l'extraction a transformé les résumés génériques de Claude en indicateurs de risque exploitables et en actions concrètes.