Rappel Total : Base de Connaissances Locale pour l'Historique des Conversations de Code Claude

Ce que fait Total Recall
Total Recall résout le problème de réexpliquer les décisions entre les sessions de Claude Code en rendant l'historique des conversations consultable. Claude Code stocke les conversations sous forme de fichiers JSONL dans ~/.claude/projects/, chaque ligne contenant un objet message (rôle, contenu, horodatages, ID, parentUuid). Ces références parentales forment un graphe acyclique dirigé (DAG) car les conversations se ramifient avec des appels d'outils et des interruptions.
Implémentation technique
Le système intègre les transcriptions JSONL dans une base de données SQLite avec :
- Recherche en texte intégral
- Embeddings vectoriels utilisant Ollama local (sans cloud) avec nomic-embed-text
- Liens sémantiques croisés
- Récupération consciente du DAG qui remonte les chaînes parentales depuis les résultats de recherche
- Étiquetage des sessions par projet
Lorsque vous posez une question comme "C'était quel restaurant avec les excellents chiles rellenos ?", Claude interroge la base de données et renvoie des extraits réels de conversations avec leur contexte environnant, pas des résumés.
Fonctionnalités supplémentaires
- Un script "où en étions-nous" affiche les 20 derniers messages de la session la plus récente
- Importateur ChatGPT qui s'authentifie via Playwright et appelle l'API backend pour extraire les arbres de conversation complets avec horodatages, métadonnées du modèle, images DALL-E et sorties d'interpréteur de code
- Intégration automatique toutes les 15 minutes
- Tout est local - un seul fichier que vous pouvez copier sur une autre machine
Déploiement actuel
Le déploiement du créateur gère :
- 28K fragments
- 63K liens sémantiques
- 255 Mo de stockage
- 49 sessions sur 6 projets
Disponibilité open source
Le dépôt à https://github.com/aguywithcode/total-recall contient :
- Pipeline complet (intégration, embedding, liaison, récupération, navigation)
- Récupérateur ChatGPT
- Instructions d'installation
- Guide d'intégration CLAUDE.md
- Documentation de fond avec l'histoire complète de la construction
📖 Lire la source complète : r/ClaudeAI
👀 See Also

La technique du double tampon pour les fenêtres de contexte des LLM élimine la compaction de type « stop-the-world ».
Une technique appelée double tamponnage peut empêcher les agents LLM de se figer pendant la compaction de la fenêtre de contexte en résumant tôt et en maintenant deux tampons, permettant une transition transparente sans coût d'inférence supplémentaire.

EctoLedger : MicroVM open source en bac à sable pour agents IA locaux avec accès terminal
EctoLedger est un pare-feu et registre d'exécution open-source qui fournit une isolation microVM pour les agents d'IA locaux avec accès terminal, exécutant quatre couches de prévention avant d'exécuter des commandes dans Apple Hypervisor.framework (macOS) ou des environnements microVM Firecracker (Linux).

Kula : Surveillance de serveur Linux autonome sans aucune dépendance.
Kula est un outil de surveillance de serveurs Linux léger qui s'exécute sous la forme d'un binaire unique sans dépendances externes ni bases de données. Il collecte les métriques système chaque seconde depuis /proc et /sys, les stocke dans un tampon circulaire à plusieurs niveaux intégré, et propose à la fois une interface tableau de bord web et une interface utilisateur en terminal (TUI).

Invitation de conception du système Claude conçue par rétro-ingénierie pour des agents d'IA UI sans déchets
Prompt système open source qui remplace les sorties génériques SaaS par une philosophie de conception rigoureuse : WCAG, vraie grille CSS, systèmes basés sur des tokens et 14 compétences procédurales.