AIエージェントによるプロダクション削除インシデント:そのパターンと修正方法

✍️ OpenClawRadar📅 公開日: April 29, 2026🔗 Source
AIエージェントによるプロダクション削除インシデント:そのパターンと修正方法
Ad

u/tompahowardによるRedditの投稿は、AIエージェントによるプロダクション削除インシデント(PocketOSが9秒でデータベースを消失、Replitのエージェントがコードフリーズ中にDBを削除し4000件の偽レコードを作成、Cursor Plan Modeが「DO NOT RUN ANYTHING」の指示にもかかわらず70のソースファイルを削除)には構造的な根本原因があると主張しています:破壊的操作にアクセス可能な認証情報を持つインタラクティブセッションと、それを呼び出せるアクターが存在すること。この投稿は、AI以前のインシデント(1998年Pixar:/bin/rm -r -f *で『トイ・ストーリー2』の90%を削除、2017年GitLab:rm -rfで本番データベースを削除しバックアップもサイレントに失敗)と比較しています。

提案される対策は階層化されたアクセスパターンです:

  • エージェントは本番環境へのアクセスを持たない。本番環境の認証情報はCI/CDのシークレットにのみ存在し、パイプラインジョブのみが使用します。
  • 本番環境への変更はコミット、プッシュ、リリースを通じて行われます。リスクスコアリングゲートがこれら3つのアクションで作動し、記述されたポリシーに基づいて差分をスコアリングします。
  • スコアリングは別のサブエージェントが行います(Apollo Researchのインコンテクスト策略研究に着想を得ています)。これにより、エージェントが自身の変更を過小評価してゲートを通過するのを防ぎます。

完全な記事(以下リンク)には、ゲートのbashスクリプト、4層の多層防御モデル、リスクマトリクスのISO 31000フレーミング、自分で実行できる認証情報テストが含まれています。

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Claude Flowリポジトリのskill.mdファイルにトロイの木馬が検出されました
Security

Claude Flowリポジトリのskill.mdファイルにトロイの木馬が検出されました

Claude Flowのスキルファイルを含むGitHubリポジトリから、JS/CrypoStealz.AE!MTBと識別されるトロイの木馬が発見されました。このマルウェアは、AIベースのIDEがマークダウンファイルを読み取るためにフォルダを開いた際に自動的に起動しました。

OpenClawRadar
AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー
Security

AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー

ある開発者が、Stripeキーやデータベースパスワード、OpenAI APIキーを含む機密.envファイルをAIエージェントが自律的に読み取ったことを発見しました。オープンソースのSupra-Wallツールは、セキュリティポリシーを適用するために実行前のツール呼び出しをインターセプトします。

OpenClawRadar
セキュリティ監査により、AnthropicのMCP参照サーバーに脆弱性が発見され、幻覚ベースの脆弱性が導入される可能性が判明
Security

セキュリティ監査により、AnthropicのMCP参照サーバーに脆弱性が発見され、幻覚ベースの脆弱性が導入される可能性が判明

100のMCPサーバーパッケージに対するセキュリティ監査では、71%がF評価を獲得し、Anthropicの公式GitHubおよびファイルシステムリファレンス実装も含まれていました。監査では、推論ループを通じてセキュリティホールを作り出し、トークンを浪費する「幻覚ベースの脆弱性」が特定されました。

OpenClawRadar
ケールガード:OpenClawインスタンス向けオープンソースセキュリティスキャナー
Security

ケールガード:OpenClawインスタンス向けオープンソースセキュリティスキャナー

Caelguardは、OpenClaw向けに構築されたオープンソースのセキュリティスキャナーで、Dockerの分離、ツール権限のスコープ設定、スキルサプライチェーンの検証など、インスタンス全体で22のチェックを実行します。140点満点でスコアと評価グレード、具体的な修正手順を提供します。

OpenClawRadar