llm-hasher: Detección y Tokenización Local de PII para Flujos de Trabajo Híbridos de LLM

llm-hasher aborda una brecha de seguridad específica en flujos de trabajo híbridos de LLM: cuando ejecutas LLMs locales pero aún llamas a servicios externos como OpenAI, Claude o Gemini para ciertas tareas, tu PII aún sale de tu infraestructura en texto plano. Esta herramienta ejecuta la detección de PII completamente localmente usando Ollama, por lo que ningún dato sale de tus sistemas durante la fase de detección.
Cómo Funciona
El proceso sigue tres pasos: detectar PII localmente, tokenizarla antes de las llamadas a LLMs externos, luego restaurar los valores originales después del procesamiento. Esto evita que los datos sensibles se expongan a servicios de terceros.
Enfoque de Detección
El sistema de detección utiliza un enfoque híbrido:
- Patrones de expresiones regulares para tipos de datos estructurados: tarjetas de crédito, números IBAN, direcciones de correo electrónico y direcciones IPv4
- Ollama con llama3.2:3b (por defecto) para detección contextual de PII no estructurada: nombres, direcciones, identificaciones nacionales, pasaportes y fechas de nacimiento
Implementación Técnica
Los mapeos entre la PII original y los tokens se almacenan en una bóveda SQLite cifrada con AES-256-GCM. La implementación se simplifica con Docker Compose, que inicia tanto Ollama como el servicio llm-hasher con un solo comando.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Venda de Ojos: Un Complemento que Impide que Claude Code Lea Tus Archivos .env
Blindfold es un nuevo complemento que evita que Claude Code acceda a valores secretos reales en archivos .env manteniéndolos en el llavero del sistema operativo y usando marcadores de posición como {{STRIPE_KEY}}, con ganchos que bloquean intentos de acceso directo.

Explorando los riesgos del uso de la cuenta de Google con Gemini-Cli y la suscripción a Gemini Pro.
Gemini-Cli y tu suscripción a Gemini Pro pueden presentar algunos riesgos para tu cuenta de Google. Esto es lo que necesitas saber sobre las posibles vulnerabilidades al usar estas herramientas de IA.

Endo Familiar: Entorno Aislado de Capacidad de Objetos para Agentes de IA
Endo Familiar implementa seguridad de capacidades de objetos para agentes de IA: los agentes comienzan con cero autoridad ambiental, reciben solo referencias explícitas a archivos o directorios específicos, y pueden derivar capacidades más restringidas en código sandbox.

Extensión de Claude Code para VS Code filtra el estado de selección entre archivos cerrados y nuevas sesiones
Un error en la extensión de VS Code de Claude Code almacena en caché el estado de selección de archivos incluso después de cerrar el archivo, exponiendo datos sensibles (por ejemplo, claves de servicio de Supabase) a una nueva sesión de CLI. Pasos completos para reproducir y problema en GitHub #58886.