llm-hasher: Detección y Tokenización Local de PII para Flujos de Trabajo Híbridos de LLM

✍️ OpenClawRadar📅 Publicado: 15 de abril de 2026🔗 Source
llm-hasher: Detección y Tokenización Local de PII para Flujos de Trabajo Híbridos de LLM
Ad

llm-hasher aborda una brecha de seguridad específica en flujos de trabajo híbridos de LLM: cuando ejecutas LLMs locales pero aún llamas a servicios externos como OpenAI, Claude o Gemini para ciertas tareas, tu PII aún sale de tu infraestructura en texto plano. Esta herramienta ejecuta la detección de PII completamente localmente usando Ollama, por lo que ningún dato sale de tus sistemas durante la fase de detección.

Cómo Funciona

El proceso sigue tres pasos: detectar PII localmente, tokenizarla antes de las llamadas a LLMs externos, luego restaurar los valores originales después del procesamiento. Esto evita que los datos sensibles se expongan a servicios de terceros.

Ad

Enfoque de Detección

El sistema de detección utiliza un enfoque híbrido:

  • Patrones de expresiones regulares para tipos de datos estructurados: tarjetas de crédito, números IBAN, direcciones de correo electrónico y direcciones IPv4
  • Ollama con llama3.2:3b (por defecto) para detección contextual de PII no estructurada: nombres, direcciones, identificaciones nacionales, pasaportes y fechas de nacimiento

Implementación Técnica

Los mapeos entre la PII original y los tokens se almacenan en una bóveda SQLite cifrada con AES-256-GCM. La implementación se simplifica con Docker Compose, que inicia tanto Ollama como el servicio llm-hasher con un solo comando.

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Google dice que hackers criminales usaron IA para encontrar vulnerabilidad de día cero
Seguridad

Google dice que hackers criminales usaron IA para encontrar vulnerabilidad de día cero

Google reveló que atacantes utilizaron un agente de IA para descubrir y explotar una vulnerabilidad de software previamente desconocida, marcando el primer caso confirmado de descubrimiento de día cero impulsado por IA en el entorno real.

OpenClawRadar
Clawndom: Un Gancho de Seguridad para el Código de Claude que Bloquea Paquetes npm Vulnerables
Seguridad

Clawndom: Un Gancho de Seguridad para el Código de Claude que Bloquea Paquetes npm Vulnerables

Un desarrollador creó Clawndom, un gancho de código abierto para Claude Code que verifica los paquetes npm contra la base de datos de vulnerabilidades OSV.dev antes de la instalación, bloqueando paquetes vulnerables conocidos mientras mantiene la autonomía del agente.

OpenClawRadar
Ataque de inyección de mensajes múltiples: el patrón de ataque "Criatura ficticia" contra Claude
Seguridad

Ataque de inyección de mensajes múltiples: el patrón de ataque "Criatura ficticia" contra Claude

Un ataque que construye una regla ficticia a lo largo de tres mensajes, luego invoca un fantasma para activarla, siendo cada mensaje inofensivo de forma aislada. El patrón está convergiendo independientemente entre atacantes.

OpenClawRadar
Ataques de Inyección Camuflados en el Dominio Eluden Detectores en Sistemas LLM Multiagente
Seguridad

Ataques de Inyección Camuflados en el Dominio Eluden Detectores en Sistemas LLM Multiagente

Un nuevo estudio muestra que los payloads de inyección adaptados al vocabulario del dominio evaden la detección, reduciendo la IDR del 93,8% al 9,7%. El debate multiagente amplifica los ataques. Llama Guard 3 no detecta ningún payload.

OpenClawRadar