OpenClaw atteint la limite de contexte de 33 000 : comment y remédier

✍️ OpenClawRadar📅 Publié: August 18, 2026🔗 Source
Ad

Un développeur sur r/openclaw signale un plafond persistant de 33K jetons dans OpenClaw, malgré une configuration de fenêtre de contexte de 262K. Le problème affecte tous les modèles chargés localement, y compris Qwen3.8-27B, et semble échapper au contrôle d'OpenClaw.

Ce qui se passe

L'utilisateur a correctement défini la fenêtre de contexte :

openclaw config set agents.defaults.contextWindow 262144

OpenClaw reconnaît que le modèle supporte 262144 jetons, mais les réponses se dégradent après environ 33K jetons, forçant des commandes /compact ou /new fréquentes sur Telegram. L'exécution de ollama ps révèle que le modèle n'a qu'un contexte de 33K chargé, quelle que soit la capacité native du modèle.

Cause racine

Le problème vient probablement d'Ollama, pas d'OpenClaw. Ollama utilise une taille de contexte par défaut (souvent 4096 ou 8192) à moins d'être remplacée via la variable d'environnement OLLAMA_CONTEXT_LENGTH ou le paramètre num_ctx dans le Modelfile. OpenClaw ne transmet pas la longueur de contexte à Ollama, donc Ollama se charge avec une petite fenêtre.

Ad

Solutions

  • Définir OLLAMA_CONTEXT_LENGTH : Avant de démarrer Ollama, définissez la variable d'environnement à 262144.
    export OLLAMA_CONTEXT_LENGTH=262144
  • Mettre à jour le Modelfile : Si vous utilisez un modèle personnalisé, ajoutez le paramètre
    PARAMETER num_ctx 262144
    et recréez le modèle.
  • Vérifier Docker : Si Ollama fonctionne dans Docker, assurez-vous que la variable d'environnement est transmise via docker run -e OLLAMA_CONTEXT_LENGTH=262144.

Notes supplémentaires

Vous pouvez vérifier le contexte chargé avec ollama ps — il devrait afficher la nouvelle taille après le correctif. Envisagez également d'utiliser le point de terminaison compatible OpenAI d'Ollama avec num_ctx dans la requête, ce que certains clients prennent en charge.

Pour plus de détails, consultez la discussion source.

📖 Lire la source complète : r/openclaw

Ad

👀 See Also

🦀
Tips

Inférence des LLM : techniques pour une frontière efficace

Le guide de Baseten sur l'ingénierie d'inférence LLM : comment la taille des lots, le parallélisme et la quantification vous permettent d'échanger la latence contre le débit ou de repousser l'ensemble de la frontière.

OpenClawRadar
Conception Claude : 7 astuces pour ne pas brûler vos limites
Tips

Conception Claude : 7 astuces pour ne pas brûler vos limites

Verrouillez le brief dans une conversation Claude classique d'abord, configurez le système de design avant la première requête, joignez des références sous forme de captures d'écran, liez des sous-répertoires pas des dépôts entiers, utilisez les curseurs pour les petites modifications, collez les commentaires en ligne comme sauvegarde, adaptez le format d'exportation à la destination.

OpenClawRadar
Plugin OpenClaw Minimalisme : Les outils de base gèrent 95 % des tâches
Tips

Plugin OpenClaw Minimalisme : Les outils de base gèrent 95 % des tâches

Un développeur utilisant OpenClaw en production rapporte que la désactivation des plugins non essentiels et le remplacement des plugins critiques par des scripts simples ont entraîné un démarrage 40 % plus rapide, une utilisation de la mémoire réduite de 60 % et aucune mise à jour cassante sur quatre mois.

OpenClawRadar
Utiliser les récits de projet pour maintenir le contexte OpenClaw sur les projets à long terme
Tips

Utiliser les récits de projet pour maintenir le contexte OpenClaw sur les projets à long terme

Un développeur partage une technique pour créer des 'récits de projet' où un travailleur OpenClaw distinct analyse la base de code après chaque étape importante pour documenter la compréhension du système, identifier les problèmes et maintenir le contexte.

OpenClawRadar