llm-hasher: Detección y Tokenización Local de PII para Flujos de Trabajo Híbridos de LLM

llm-hasher aborda una brecha de seguridad específica en flujos de trabajo híbridos de LLM: cuando ejecutas LLMs locales pero aún llamas a servicios externos como OpenAI, Claude o Gemini para ciertas tareas, tu PII aún sale de tu infraestructura en texto plano. Esta herramienta ejecuta la detección de PII completamente localmente usando Ollama, por lo que ningún dato sale de tus sistemas durante la fase de detección.
Cómo Funciona
El proceso sigue tres pasos: detectar PII localmente, tokenizarla antes de las llamadas a LLMs externos, luego restaurar los valores originales después del procesamiento. Esto evita que los datos sensibles se expongan a servicios de terceros.
Enfoque de Detección
El sistema de detección utiliza un enfoque híbrido:
- Patrones de expresiones regulares para tipos de datos estructurados: tarjetas de crédito, números IBAN, direcciones de correo electrónico y direcciones IPv4
- Ollama con llama3.2:3b (por defecto) para detección contextual de PII no estructurada: nombres, direcciones, identificaciones nacionales, pasaportes y fechas de nacimiento
Implementación Técnica
Los mapeos entre la PII original y los tokens se almacenan en una bóveda SQLite cifrada con AES-256-GCM. La implementación se simplifica con Docker Compose, que inicia tanto Ollama como el servicio llm-hasher con un solo comando.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Google dice que hackers criminales usaron IA para encontrar vulnerabilidad de día cero
Google reveló que atacantes utilizaron un agente de IA para descubrir y explotar una vulnerabilidad de software previamente desconocida, marcando el primer caso confirmado de descubrimiento de día cero impulsado por IA en el entorno real.

Clawndom: Un Gancho de Seguridad para el Código de Claude que Bloquea Paquetes npm Vulnerables
Un desarrollador creó Clawndom, un gancho de código abierto para Claude Code que verifica los paquetes npm contra la base de datos de vulnerabilidades OSV.dev antes de la instalación, bloqueando paquetes vulnerables conocidos mientras mantiene la autonomía del agente.

Ataque de inyección de mensajes múltiples: el patrón de ataque "Criatura ficticia" contra Claude
Un ataque que construye una regla ficticia a lo largo de tres mensajes, luego invoca un fantasma para activarla, siendo cada mensaje inofensivo de forma aislada. El patrón está convergiendo independientemente entre atacantes.

Ataques de Inyección Camuflados en el Dominio Eluden Detectores en Sistemas LLM Multiagente
Un nuevo estudio muestra que los payloads de inyección adaptados al vocabulario del dominio evaden la detección, reduciendo la IDR del 93,8% al 9,7%. El debate multiagente amplifica los ataques. Llama Guard 3 no detecta ningún payload.