OpenClaw atteint la limite de contexte de 33 000 : comment y remédier
Un développeur sur r/openclaw signale un plafond persistant de 33K jetons dans OpenClaw, malgré une configuration de fenêtre de contexte de 262K. Le problème affecte tous les modèles chargés localement, y compris Qwen3.8-27B, et semble échapper au contrôle d'OpenClaw.
Ce qui se passe
L'utilisateur a correctement défini la fenêtre de contexte :
openclaw config set agents.defaults.contextWindow 262144OpenClaw reconnaît que le modèle supporte 262144 jetons, mais les réponses se dégradent après environ 33K jetons, forçant des commandes /compact ou /new fréquentes sur Telegram. L'exécution de ollama ps révèle que le modèle n'a qu'un contexte de 33K chargé, quelle que soit la capacité native du modèle.
Cause racine
Le problème vient probablement d'Ollama, pas d'OpenClaw. Ollama utilise une taille de contexte par défaut (souvent 4096 ou 8192) à moins d'être remplacée via la variable d'environnement OLLAMA_CONTEXT_LENGTH ou le paramètre num_ctx dans le Modelfile. OpenClaw ne transmet pas la longueur de contexte à Ollama, donc Ollama se charge avec une petite fenêtre.
Solutions
- Définir OLLAMA_CONTEXT_LENGTH : Avant de démarrer Ollama, définissez la variable d'environnement à 262144.
export OLLAMA_CONTEXT_LENGTH=262144 - Mettre à jour le Modelfile : Si vous utilisez un modèle personnalisé, ajoutez le paramètre
et recréez le modèle.PARAMETER num_ctx 262144 - Vérifier Docker : Si Ollama fonctionne dans Docker, assurez-vous que la variable d'environnement est transmise via
docker run -e OLLAMA_CONTEXT_LENGTH=262144.
Notes supplémentaires
Vous pouvez vérifier le contexte chargé avec ollama ps — il devrait afficher la nouvelle taille après le correctif. Envisagez également d'utiliser le point de terminaison compatible OpenAI d'Ollama avec num_ctx dans la requête, ce que certains clients prennent en charge.
Pour plus de détails, consultez la discussion source.
📖 Lire la source complète : r/openclaw
👀 See Also

Renforcement des garde-fous stricts pour les agents IA OpenClaw : contrôle d'approbation et limites de concurrence
Un utilisateur de r/openclaw demande comment imposer des règles strictes comme l'approbation des e-mails et les limites de concurrence sur un bot OpenClaw connecté à Discord, utilisant Ollama avec GLM. La réponse : déplacer l'application en dehors de la boucle de raisonnement du modèle.

Exécution de MiniMax M2.7 Q8_0 128K sur 2x3090 avec déchargement CPU – Benchmarks réels et configuration
Un utilisateur exécute avec succès MiniMax M2.7 en Q8_0 avec un contexte de 128K sur deux RTX 3090 et de la RAM DDR4, atteignant environ 50 tps en traitement de requête et environ 10 tps en génération de tokens, et partage ses paramètres llama-server.

Le routage réduit le coût d'utilisation d'OpenClaw Max de 85 % : de 200 $/mois à 30 $/mois avec le routage API
Un utilisateur a suivi l'utilisation de tokens et a découvert que seulement 15 % des tâches nécessitent Opus. En redirigeant le travail de routine vers Sonnet via l'API, le coût mensuel est passé de 200 $ à 30 $, avec une qualité de sortie identique.

Automatisation des redémarrages de session Claude avec tmux et at
Utilisez tmux et la commande at pour planifier des redémarrages automatiques de votre session Claude lorsque l'utilisation est réinitialisée à des heures inhabituelles.