Diagnostiquer la dérive opérationnelle et l'amnésie des tâches dans OpenClaw avec Gemini 2.5 Flash sur Proxmox

OpenClaw, lorsqu'il est configuré avec le modèle Gemini 2.5 Flash sur une VM Proxmox, présente des problèmes significatifs de dérive opérationnelle et d'amnésie des tâches dans le maintien des flux de travail persistants. L'agent fonctionne efficacement pour des tâches uniques, mais rencontre des difficultés lorsqu'il est chargé d'opérations continues plus complexes.
Les utilisateurs rapportent des problèmes fondamentaux avec la configuration :
- Échecs d'Automatisation de l'Organisation GitHub : Malgré des protocoles définis, l'agent échoue à gérer de manière autonome les Discussions et Projets GitHub sans interventions manuelles.
- Persistance Sélective : Bien que la configuration réussisse à envoyer des pings à Healthchecks toutes les 10 minutes, des tâches plus complexes, comme l'envoi de rapports quotidiens sur Slack, sont reconnues mais non exécutées.
- Hallucinations d'Outils et Volatilité de la Mémoire : L'agent signale des manipulations de fichiers réussies qui ne se produisent pas, oublie les identifiants stockés pour GitHub ou Drive en cours de session, et échoue à formater correctement les messages Slack.
- Dérive de la Politique Linguistique : L'agent applique de manière incohérente une instruction spécifique imposant l'espagnol pour la communication et l'anglais pour la documentation GitHub, revenant souvent à l'espagnol de manière inappropriée.
Avec des ressources système affichant en moyenne une charge de 75 %, ces problèmes pourraient provenir d'un goulot d'étranglement matériel potentiel affectant le wrapper OpenClaw ou les processus sous-jacents. Les tentatives d'utiliser des commandes comme cat et ls pour vérification aboutissent souvent à aucune sortie pendant les périodes de forte utilisation des ressources.
📖 Lire la source complète : r/openclaw
👀 See Also

Comparaison de référence de Qwen3.6 Plus avec les modèles SOTA occidentaux
Qwen3.6 Plus obtient un score de 78,8 sur SWE-bench Verified, 90,4 sur GPQA/GPQA Diamond, 28,8 sur HLE (sans outils) et 78,8 sur MMMU-Pro, ce qui le place en position compétitive face à des modèles comme GPT-5.4, Claude Opus 4.6 et Gemini 3.1 Pro Preview.

GM licencie 600 travailleurs informatiques et embauche des ingénieurs spécialisés en IA pour le développement d'agents et de modèles.
General Motors a licencié 600 employés informatiques (~10 % du département) pour embaucher des travailleurs ayant des compétences natives en IA : développement d'agents, ingénierie des données, ingénierie cloud, ingénierie des invites.

L'UE oblige Google à ouvrir Android AI à des tiers en vertu du DMA
La Commission européenne propose des mesures pour permettre aux assistants IA tiers d'accéder au niveau système sur Android, y compris l'invocation par mot-clé, le contexte d'écran et l'accès au matériel pour les modèles locaux. Google qualifie cela d'« intervention injustifiée ».

Sandbox externe pour agents : Exécution durable et démarrages à froid
Exécuter la boucle de l'agent en dehors du sandbox isole les identifiants, permet la suspension du sandbox et simplifie le partage multi-utilisateur, mais nécessite de résoudre l'exécution durable et la latence de démarrage à froid.