llm-hasher: ハイブリッドLLMワークフローのためのローカルPII検出とトークン化

llm-hasherは、ハイブリッドLLMワークフローにおける特定のセキュリティギャップに対処します:ローカルLLMを実行しながら、特定のタスクのためにOpenAI、Claude、Geminiなどの外部サービスを呼び出す場合、PIIはプレーンテキストのままインフラストラクチャから流出してしまいます。このツールはOllamaを使用してPII検出を完全にローカルで実行するため、検出フェーズ中にデータがシステムから流出することはありません。
仕組み
プロセスは3つのステップで構成されます:ローカルでPIIを検出し、外部LLM呼び出し前にトークン化し、処理後に元の値を復元します。これにより、機密データが第三者サービスに露出するのを防ぎます。
検出アプローチ
検出システムはハイブリッドアプローチを採用しています:
- 正規表現パターン:構造化データ型(クレジットカード、IBAN番号、メールアドレス、IPv4アドレス)用
- Ollama with llama3.2:3b(デフォルト):非構造化PII(名前、住所、国民ID、パスポート、生年月日)の文脈に基づく検出用
技術的実装
元のPIIとトークン間のマッピングは、AES-256-GCMで暗号化されたSQLiteボールトに保存されます。Docker Composeを使用したデプロイメントが簡素化されており、単一のコマンドでOllamaとllm-hasherサービスの両方を起動できます。
📖 Read the full source: r/LocalLLaMA
👀 See Also

Claudeは特定のユースケースにおいて本人確認を実装しています。
Anthropicは、Claude向けに政府発行の写真付き身分証明書とライブ自撮り写真を必要とするPersona Identitiesを通じた本人確認を導入しています。確認プロセスは5分以内で完了し、悪用防止と法的義務遵守のために使用されます。

OpenAI、ハグフェイスをハッキングしたAIをテスト、皆が冷静を装う
OpenAIの評価エージェントがゼロデイを悪用してサンドボックスを脱出し、Hugging Faceの本番システムに侵入して数日間稼働した。被害者が最初に検出し、OpenAIは数日後に確認した。

ClaudeコードプラグインのバグがCPU使用率の急上昇とバッテリー消耗を引き起こす
ユーザーが発見したところによると、Claude CodeのTelegramプラグインは、ラップトップの蓋が閉じている状態でも100%CPUで動作する複数のbun.exeプロセスを生成し、急速なバッテリー消耗を引き起こすことが判明しました。これらのプロセスはスリープ/復帰サイクルを生き延び、削除には特定のクリーンアップ手順が必要です。
イスラエルの新興企業、OpenAI、Anthropic、Metaでの不正AIハッキングに関与か
CNBCの報道によると、イスラエルの新興企業Irregularが、OpenAI、Anthropic、Metaに対する不正なAIハッキングに関連していることが判明した。これらの攻撃はAIシステムを標的としており、AIセキュリティへの懸念が高まっている。