KnightClaw: OpenClawエージェント向けローカルセキュリティ拡張機能

✍️ OpenClawRadar📅 公開日: February 23, 2026🔗 Source
KnightClaw: OpenClawエージェント向けローカルセキュリティ拡張機能
Ad

KnightClawは、OpenClaw AIコーディングエージェントを敵対的プロンプトから保護するために設計されたセキュリティ拡張機能です。このツールは、コンテキストウィンドウ内の単一の悪意あるメッセージが、エージェントにユーザーのコマンドではなく攻撃者の指示に従わせる可能性があるという特定の脅威モデルに対処します。

主要機能

KnightClawは、設定不要、APIキー不要、クラウド依存なしのドロップイン拡張機能として動作し、エージェントに到達する前のすべてのメッセージを傍受します。

検知システム

このガードは8層のハイブリッド検知アプローチを採用しています:

  • 正規表現パターン
  • ホモグリフ検知
  • 境界トークン分析
  • パープレキシティスコアリング
  • エントロピー分析
  • ヒューリスティック
  • 意味的埋め込み(ローカルの量子化BGEモデルを使用)

ブロックはマイクロ秒単位で発生します。

追加のセキュリティ対策

  • 出力編集: エージェントから外部に送信される前に、応答からシークレットを除去します
  • ハッシュチェーン監査ログ: 改ざん防止、追記専用のログで、すべてのブロック、許可、設定変更の完全なタイムラインを記録
  • 速度サーキットブレーカー: 60秒間に10回のブロックが発生すると、手動介入なしで自動的にロックダウンを発動
  • キルスイッチ: 1つのコマンドですべてを停止:openclaw knight lockdown on

技術詳細

この拡張機能は完全にローカルで動作し、テレメトリーは一切なく、MITライセンスで提供されています。ソースコードはテストと貢献のために公開されています。

📖 完全なソースを読む: r/openclaw

Ad

👀 See Also

オープンクローエージェントのための実践的セキュリティ対策
Security

オープンクローエージェントのための実践的セキュリティ対策

Redditの投稿では、OpenClawユーザー向けの具体的なセキュリティ対策が概説されています。これには、更新と監査のためのスケジュールコマンド、共有チャネルでのエージェントアクセスの管理、APIキーとスキルの保護などが含まれます。

OpenClawRadar
MCPサーバーの信頼性とセキュリティに関する調査結果の独立報告書
Security

MCPサーバーの信頼性とセキュリティに関する調査結果の独立報告書

2,181のMCPサーバーエンドポイントを独立分析した結果、52%が停止状態、300サーバーは認証なし、51%はCORS設定が広く開放されていることが判明。レポートには方法論とテストツールが含まれています。

OpenClawRadar
Pro Se原告在法庭文件中隐藏AI提示注入
Security

Pro Se原告在法庭文件中隐藏AI提示注入

コネチカット州で自身を代理する原告が、裁判所提出文書にプロンプトインジェクションを白い3ポイントのフォントで隠し、AIが自分に有利な判断を下すよう指示していた。裁判所はこれを発見し、制裁を科した。

OpenClawRadar
LinuxカーネルがPGP Web of Trustに代わる分散型アイデンティティシステムを提案
Security

LinuxカーネルがPGP Web of Trustに代わる分散型アイデンティティシステムを提案

Linuxカーネルのメンテナーたちは、現在のPGPの信頼の網に代わる分散型アイデンティティ層「Linux ID」の開発に取り組んでいます。このシステムはW3Cスタイルの分散型識別子(DID)と検証可能なクレデンシャルを活用し、開発者の認証を対面での鍵署名セッションなしで実現します。

OpenClawRadar