Latence zéro : une couche de mémoire persistante pour les agents IA via MCP

0Latency est un serveur MCP (Model Context Protocol) qui fournit une mémoire persistante pour les agents d'IA comme Claude, résolvant le problème courant de la perte de contexte entre les sessions. Le développeur l'a créé après avoir subi une compaction de contexte lors de travaux complexes de refactorisation, où Claude avait oublié des décisions prises 30 minutes plus tôt.
Fonctionnement
L'outil s'intègre directement à Claude Desktop, Claude Code et claude.ai sans enveloppeurs ni bidouilles. Il est compatible avec GPT, Gemini, Cursor et tout agent compatible MCP. Pendant que vous travaillez, votre agent stocke des souvenirs, puis les rappelle automatiquement lors des sessions suivantes, permettant au contexte de s'accumuler plutôt que de se réinitialiser.
Développement et tests
Le développeur a utilisé Claude Code avec 0Latency connecté pour construire le reste de 0Latency. Cette approche a permis de détecter un bug critique : un mode de défaillance où Claude disait "compris, je stocke ça" mais le souvenir ne persistait pas réellement dans l'API — un échec silencieux que les utilisateurs auraient interprété comme un produit défectueux.
Lors des tests, le système a géré une session de cinq heures avec plus de 15 tâches accomplies et deux compactions de contexte sans perdre aucun souvenir.
Tarification et disponibilité
- Niveau gratuit : 10 000 souvenirs, 3 agents, pas de carte de crédit requise
- Les plans payants incluent une garantie de remboursement de 30 jours
- Prime aux bugs : Trouvez un bug confirmé et obtenez 3 mois de Pro gratuitement (détails dans la section Construisez avec nous)
- Le développeur recherche 10 personnes pour des tests de résistance en échange d'un mois gratuit de Pro
Détails techniques
0Latency est disponible sur 0latency.ai avec le code source sur GitHub. Le développeur est disponible pour répondre aux questions sur l'architecture et les détails d'intégration MCP.
📖 Read the full source: r/ClaudeAI
👀 See Also

Réducteur de Tokens : Un Plugin Claude Code pour la Compression Intelligente du Contexte
Token Reducer est un plugin Claude Code qui traite le contexte du dépôt localement pour réduire l'utilisation de tokens de 90 à 98 % grâce au découpage basé sur AST, la récupération hybride et la compression TextRank. Il est sous licence MIT et disponible via la marketplace des plugins.

Audacity-MCP : Intégration de l'IA Claude pour l'édition audio locale avec 131 outils
Audacity-MCP connecte Claude à Audacity via une interface de communication par tube, permettant l'édition audio contrôlée par la voix avec 131 outils, 9 pipelines automatisés et une transcription locale Whisper sans dépendances cloud.

Warp Terminal devient open source avec un environnement de développement agentique
Warp est désormais open-source et se rebaptise en tant qu'environnement de développement agentique, avec un agent de codage intégré et la possibilité d'utiliser vos propres agents CLI comme Claude Code, Codex et Gemini CLI.

yburn : Outil pour auditer et remplacer les tâches cron inutiles des agents IA
yburn est un outil Python qui audite les tâches cron des agents d'IA et remplace celles qui n'ont pas besoin de LLM par des scripts Python autonomes. Le créateur a constaté que 58 % des 98 tâches cron étaient des tâches purement mécaniques comme des vérifications de santé système et des sauvegardes git.