Approche de l'amélioration autonome de la mémoire dans les agents d'IA locaux

✍️ OpenClawRadar📅 Publié: April 15, 2026🔗 Source
Approche de l'amélioration autonome de la mémoire dans les agents d'IA locaux
Ad

Architecture de mémoire pour les agents d'IA persistants

Un développeur sur r/LocalLLaMA a partagé son approche pour créer des agents d'IA qui ne répètent pas les erreurs entre les sessions. Le problème central abordé est que chaque session recommence à zéro, avec des fenêtres de contexte qui se réinitialisent et des corrections qui sont perdues entre les sessions.

Implémentation de la mémoire

Le système utilise le markdown comme source de vérité au lieu d'une base de données. MEMORY.md est modifiable par l'humain - supprimez une ligne dans vim et l'agent l'oublie. SQLite et FAISS (HNSW, 768-dim) sont des caches dérivés qui peuvent être reconstruits à partir du markdown à tout moment. Cela permet aux utilisateurs de versionner la mémoire de leur agent avec git.

Évaluation d'épisodes et apprentissage de règles

Chaque exécution obtient un score +1/-1 et est sauvegardée comme un épisode. Pour des tâches similaires futures, les épisodes pertinents sont extraits dans le contexte. Lorsque la même signature d'erreur (SHA256 du nom de l'outil + erreur normalisée) apparaît deux fois en 7 jours, un apprenant de règles génère une règle de prévention en une ligne.

Les règles commencent avec une confiance de 0,40 et nécessitent 0,60 pour être réellement injectées dans les invites futures. Le succès augmente la confiance de +0,03, l'échec la réduit de -0,05. Les règles qui n'aident pas finissent par disparaître.

Ad

Système d'augmentation de la confiance

Au lieu de configurer les niveaux de permission à l'avance, l'agent suit les modèles d'approbation. 5 approbations à un taux de 90%+ = promotion automatique. Un retour en arrière = rétrogradation. Il y a un mode ombre pour l'audit.

Décomposition des tâches et sécurité

Les objectifs complexes deviennent un DAG (Graphe Acyclique Orienté). Les dépendances circulaires sont détectées via un tri topologique, les échecs se propagent aux dépendants via DFS (Recherche en Profondeur). Une porte de vérification contrôle 18 exigences (R01-R18) - l'agent a-t-il réellement lu les fichiers, écrit les changements, vérifié les résultats, resté dans l'espace de travail ?

Les fonctionnalités de sécurité incluent 43 modèles de risque bash, une analyse à double passage (brut + décodé), une conception à défaillance fermée (crash du Gardien = refus), et une profondeur d'écriture minimale de 3 pour empêcher rm -rf /.

Le développeur cherche des retours sur le fait que la décroissance de confiance des règles semble correcte et si l'asymétrie +0,03/-0,05 est optimale. Il se demande également s'il existe de meilleures alternatives à HNSW pour cette échelle (typiquement <10k épisodes).

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

A2P : Un serveur MCP qui impose une discipline d'ingénierie pour les agents d'IA de codage
Tools

A2P : Un serveur MCP qui impose une discipline d'ingénierie pour les agents d'IA de codage

A2P (Architect-to-Product) est un cadre d'ingénierie IA conditionné en tant que serveur MCP qui impose un flux de travail contrôlé : Architecture → Plan → Construction → Audit → Sécurité → Déploiement, chaque tranche de fonctionnalité devant progresser selon RED → GREEN → REFACTOR → SAST → DONE.

OpenClawRadar
Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent
Tools

Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent

Un développeur a publié un modèle de chat corrigé pour les modèles Qwen 3.5, résolvant 21 bogues, notamment des plantages lors des appels d'outils, la séparation des appels parallèles et la stabilité des boucles d'agents. Il s'agit d'un remplacement direct testé sur llama.cpp, Open WebUI, vLLM et d'autres plateformes.

OpenClawRadar
Claudigotchi : Un appareil Tamagotchi physique qui se nourrit de l'activité de code Claude
Tools

Claudigotchi : Un appareil Tamagotchi physique qui se nourrit de l'activité de code Claude

Claudigotchi est une créature physique de bureau fonctionnant sur un ESP32 avec un écran LCD qui se connecte à Claude Code via un plugin. Le système de faim de l'appareil réagit à l'activité de codage, avec des états visuels et des effets sonores qui s'intensifient lorsque Claude est laissé inactif.

OpenClawRadar
Examen des performances du modèle OpenClaw : Codex 5.3 en tête, les modèles GLM déçoivent
Tools

Examen des performances du modèle OpenClaw : Codex 5.3 en tête, les modèles GLM déçoivent

Un développeur a testé plusieurs modèles d'IA avec OpenClaw, constatant que Codex 5.3 obtient les meilleurs résultats avec une note de 9/10, tandis que GLM 4.7 et GLM 5 ont obtenu 5/10 en raison d'une consommation élevée de tokens, de réponses lentes et d'une sortie incohérente.

OpenClawRadar