アンソピック社のコンピューター利用機能、実テストでガバナンスのロックダウンを引き起こす

✍️ OpenClawRadar📅 公開日: March 24, 2026🔗 Source
アンソピック社のコンピューター利用機能、実テストでガバナンスのロックダウンを引き起こす
Ad

何が起きたか

Anthropicはコンピュータ利用機能をリリースしました。開発者がガバナンス付きClaude Codeセッション内でこれらの新しいツールの適用範囲を追加しようとしていた際、システムがLOCKDOWNモードに入りました。

インシデントの主な詳細

ガバナンスシステムは拒否された操作からの累積リスクを追跡します。このリスクが0.50を超えたとき、システムは自動的にLOCKDOWN状態にエスカレートし、以下の影響がありました:

  • セッションはファイルを読み取ることはできた
  • すべての書き込み操作がブロックされた
  • 変更コマンドを実行できなかった
  • GitHubへのプッシュが防止された
  • ガバナンス層が、ガバナンスシステムを強化する作業を完了することを自らのオペレーターからブロックした

適用メカニズム

LOCKDOWNはフックシステムによって機械的に適用され、以下の特徴があります:

  • オーバーライド経路は存在しない
  • モデルは会話を通じてゲートを迂回できない
  • オペレーターは帯域内例外を発行できない
  • 唯一の回復経路はセッションを完全に離れることを必要とする

解決プロセス

作業を続けるため、開発者は以下を行う必要がありました:

  • ガバナンス付きセッションを終了する
  • ローカルマシンでターミナルを開く
  • コミットを手動でプッシュする

システムは自らの管轄外での人間の介入を強制し、開発者が「記述するガバナンスと適用するガバナンスの違い」と表現する状況を生み出しました。

システム動作に関する注記

LOCKDOWNの実装は段階的に機能低下せず、確認を求めず、外部での人間の行動が起こるまで停止状態を維持します。開発者は「その拒否が成果物です」と述べています。

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

TEEエンブレーブを使用した暗号化LLM推論のためのOpenClawの設定
Security

TEEエンブレーブを使用した暗号化LLM推論のためのOpenClawの設定

開発者が、OpenClawをOneraのAMD SEV-SNP信頼実行環境で使用し、エンドツーエンド暗号化されたLLM推論を実現するための設定方法を共有しています。設定例と技術的なトレードオフを含みます。

OpenClawRadar
AISI評価により、Claude MythosプレビューのCTFおよび多段階攻撃におけるサイバー能力が示される
Security

AISI評価により、Claude MythosプレビューのCTFおよび多段階攻撃におけるサイバー能力が示される

AIセキュリティ研究所はAnthropicのClaude Mythos Previewを評価し、専門家レベルのキャプチャー・ザ・フラッグ課題の73%を成功裏に完了し、32段階の企業ネットワーク攻撃シミュレーションを10回中3回で解決したことを確認しました。

OpenClawRadar
GitHub Copilot CLIの脆弱性により、プロンプトインジェクション経由でのマルウェア実行が可能
Security

GitHub Copilot CLIの脆弱性により、プロンプトインジェクション経由でのマルウェア実行が可能

GitHub Copilot CLIの脆弱性により、ユーザーの承認なしに間接的なプロンプトインジェクションを介して任意のシェルコマンドが実行される可能性があります。攻撃者は検証を回避し、被害者のコンピューター上で即座にマルウェアを実行するコマンドを作成できます。

OpenClawRadar
WebAssemblyによるAIエージェントのサンドボックス化:デフォルトでゼロ権限
Security

WebAssemblyによるAIエージェントのサンドボックス化:デフォルトでゼロ権限

Cosmonicは、従来のサンドボックス化(seccomp、bubblewrap)は、AIエージェントに対しては環境権限(ambient authority)の問題があると主張しています。WebAssemblyのケイパビリティベースのモデルは、デフォルトで権限をゼロにし、ファイルシステム、ネットワーク、資格情報に対する明示的なインポートを必要とします。

OpenClawRadar