llm-hasher: Локальное обнаружение PII и токенизация для гибридных LLM-процессов

llm-hasher решает конкретный пробел в безопасности гибридных LLM-воркфлоу: когда вы запускаете локальные LLM, но всё ещё обращаетесь к внешним сервисам, таким как OpenAI, Claude или Gemini, для определённых задач, ваши PII всё равно покидают вашу инфраструктуру в открытом виде. Этот инструмент выполняет обнаружение PII полностью локально с помощью Ollama, поэтому никакие данные не покидают ваши системы на этапе обнаружения.
Как это работает
Процесс состоит из трёх шагов: обнаружение PII локально, токенизация перед вызовами к внешним LLM, затем восстановление исходных значений после обработки. Это предотвращает раскрытие конфиденциальных данных сторонним сервисам.
Подход к обнаружению
Система обнаружения использует гибридный подход:
- Регулярные выражения для структурированных типов данных: кредитные карты, номера IBAN, адреса электронной почты и IPv4-адреса
- Ollama с llama3.2:3b (по умолчанию) для контекстного обнаружения неструктурированных PII: имён, адресов, национальных ID, паспортов и дат рождения
Техническая реализация
Сопоставления между исходными PII и токенами хранятся в зашифрованном SQLite-хранилище с использованием AES-256-GCM. Развёртывание упрощено с помощью Docker Compose, который запускает и Ollama, и сервис llm-hasher одной командой.
📖 Прочитать полный источник: r/LocalLLaMA
👀 Смотрите также

Пользователь Reddit сообщает о сохранении виртуальной машины OpenClaw и подозрительной активности.
Пользователь Reddit сообщает, что его виртуальная машина OpenClaw автоматически перезапускается после закрытия и демонстрирует подозрительное поведение, включая открытие Microsoft Store и попытки загрузки сомнительных файлов.

Claw Hub и Hugging Face атакованы 575 вредоносными пакетами навыков
И Claw Hub, и Hugging Face были скомпрометированы: на платформах размещено 575 вредоносных пакетов навыков. Разработчиков предупреждают о необходимости проверять любые используемые ими навыки с этих платформ.

В репозитории GitHub представлены документы, описывающие 16 методов инъекции промптов и стратегии защиты для публичных AI-чатов.
Разработчик опубликовал репозиторий на GitHub с описанием мер безопасности для публичных AI-чатов после того, как пользователи пытались использовать инъекцию промптов, атаки через ролевые игры, многоязычные уловки и полезные нагрузки в кодировке base64. Руководство включает навык кода Claude для тестирования всех 16 задокументированных техник инъекции.

Функция AI-поддержки Meta позволяет любому угнать аккаунты Instagram — подробности эксплойта внутри
Функция поддержки AI в Instagram, проходящая A/B-тестирование, позволяет злоумышленникам сбросить пароль, попросив агента отправить код на произвольный email. Уже взломано более 100 ценных аккаунтов.