Recordatorio: Un Servidor MCP de Memoria Persistente para Claude Code

Recall es un servidor MCP que proporciona a Claude Code memoria persistente entre sesiones, abordando el problema de que cada nueva sesión comienza desde cero. La herramienta se distribuye como un complemento nativo de Claude Code y está disponible mediante /plugin install recall@claude-plugins-official, con la configuración iniciada por /recall:setup para conectar una clave API.
Características Principales
El sistema implementa cuatro ganchos de ciclo de vida:
- session-start: Carga recuerdos y decisiones recientes
- observe: Captura silenciosamente cambios importantes después de ediciones de archivos, filtrando eventos de alta señal como commits de git, ejecuciones de pruebas y decisiones arquitectónicas para evitar ruido
- pre-compact: Guarda el estado crítico antes de la compactación de contexto para preservar razonamientos matizados que de otro modo se perderían (por ejemplo, "elegimos Redis sobre Postgres debido a X, Y, Z" convirtiéndose en solo "usa Redis")
- session-end: Escribe un resumen para la siguiente sesión
Implementación Técnica
Recall utiliza búsqueda semántica con embeddings, lo que significa que Claude no recibe un muro de texto, sino que obtiene recuerdos contextualmente relevantes para la tarea actual. El desarrollador señala que la captura automática es complicada: almacenar cada edición de archivo crea ruido, por lo que el gancho observe filtra eventos significativos.
Para uso en equipo, el sistema implementa un modelo de inquilino + espacio de trabajo para manejar el aislamiento del espacio de trabajo y el uso compartido selectivo entre múltiples sesiones de Claude. El gancho pre-compact se identifica como la característica más valiosa, ya que la compactación a menudo elimina decisiones matizadas.
El proyecto es de código abierto bajo licencia MIT en github.com/joseairosa/recall, con una versión alojada disponible en recallmcp.com que incluye un nivel gratuito.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Ollama Actualización Agrega Soporte de OpenClaw para el Modelo en la Nube Kimi k2.5
Ollama ha lanzado una actualización que integra soporte OpenClaw para modelos en la nube, incluyendo acceso gratuito al modelo Kimi k2.5 con funcionalidad de búsqueda web, ejecutándose en centros de datos de NVIDIA.

Desarrollador mide la frustración con la métrica 'P...s por cada mil indicaciones' en 44,212 registros de Claude Code
Un desarrollador rastreó 'fpk' (maldiciones por cada mil prompts) en 44,212 prompts de Claude Code durante 5 meses, descubriendo que la frustración disminuyó 3.4× desde Claude Opus 4-5 a 4-7, y que la mayoría de las maldiciones se dirigían a las herramientas del entorno, no al modelo.

Qwen 3.5 35B ejecutándose en 8GB de VRAM con configuración de llama.cpp
Un desarrollador comparte su configuración de llama.cpp para ejecutar Qwen 3.5 35B (Q4_K_M GGUF) en una RTX 4060m con 8 GB de VRAM, logrando 700 t/s de procesamiento de prompt y 42 t/s de generación, y comenta el uso de Cline en VSCode con los modos kat-coder-pro y qwen3.5.

Orion: Evadiendo CoreML para ejecutar y entrenar LLMs directamente en el Motor Neuronal de Apple
Orion es un sistema de código abierto en Objective-C que evita el CoreML de Apple para ejecutar y entrenar LLMs directamente en el Motor Neuronal de Apple (ANE), logrando más de 170 tokens/s para la decodificación de GPT-2 124M y un entrenamiento estable de múltiples pasos en un transformador de 110 millones de parámetros.