Claude Security 公開ベータ版:コードベースをスキャン、自身の調査結果を検証、パッチを提案

✍️ OpenClawRadar📅 公開日: May 1, 2026🔗 Source
Claude Security 公開ベータ版:コードベースをスキャン、自身の調査結果を検証、パッチを提案
Ad

Anthropicは本日、エンタープライズ顧客向けにClaude Securityをパブリックベータ版としてリリースしました。ルールベースのパターンマッチング(高速で低コストだが、偽陽性が大量に出る)ではなく、セキュリティ研究者のようにコードを推論します。Gitの履歴を読み、ファイル間のデータフローを追跡し、ビジネスロジックを理解します。その目標は、コンテキストがあって初めて意味を持つ脆弱性を捉えることであり、パターンマッチャーでは構造的に発見できないものです。

主な機能

  • 深刻な問題をスキャン:メモリ破損、インジェクション欠陥、認証バイパス、複雑な論理エラー
  • 発見結果を内部で敵対的自己検証により検証してから提示 — Claudeが自身の結果に挑戦
  • 発見ごとに具体的なパッチを提案し、コードの構造とスタイルを維持
  • 発見結果をSlack、Jira、またはWebhook経由で任意のシステムにプッシュ
  • スキャンを特定のディレクトリに制限したり、スケジュール実行が可能

重要な設計上の決定

注目すべきアーキテクチャ:すべての発見結果は、提示される前に敵対的自己検証ステップを経ます。単なる「AIによるバグ発見」ではなく、「AIが報告前に自分自身と議論する」というものです。これにより、従来のスキャナーと比較してシグナル対ノイズ比が大幅に向上します。

人間の制御は維持

すべてのパッチは、マージ前にレビューと承認が必要です。Claude Securityは、Anthropicが自身のコードベースを保護するために使用しているのと同じモデルに基づいています。これは、社内の信頼の正直なシグナルです。

利用可能性

現在はエンタープライズ限定。TeamおよびMaxプランは後日提供予定です。これは初期段階であり、重要なシステムに対するAI生成パッチは慎重なレビューが必要ですが、方向性(結果を提示する前に自身の推論を検証するAI)はセキュリティツールとして正しいものです。

📖 ソース全文を読む: r/ClaudeAI

Ad

👀 See Also

OCエージェントがタスク途中で停止し権限を要求――ユーザーがv2026.5.22での退行的行動を報告
News

OCエージェントがタスク途中で停止し権限を要求――ユーザーがv2026.5.22での退行的行動を報告

OC Agent v2026.5.22 がタスク途中で停止し、すべてのアクションに許可を求めるようになったという報告。ユーザーは後退的な挙動に不満を感じている。

OpenClawRadar
AIがRedditの40万件の投稿を分析、オゼンピックの隠れた副作用(月経変化など)を発見
News

AIがRedditの40万件の投稿を分析、オゼンピックの隠れた副作用(月経変化など)を発見

ペンシルベニア大学の研究者が大規模言語モデルを用いてGLP-1薬に関する40万件のReddit投稿を分析し、月経不順や悪寒など臨床試験で見落とされがちな副作用を発見。

OpenClawRadar
Gemma 4 早期シグナル:ローカルエージェントワークフローには、誇大広告よりも導入実用性を重視
News

Gemma 4 早期シグナル:ローカルエージェントワークフローには、誇大広告よりも導入実用性を重視

Gemma 4のローンチは、パーソナルハードウェアとエッジ/モバイル向けの公式ポジショニングによるハードウェア階層全体での展開を重視しており、NVIDIAのNVFP4量子化はGPQAで99.7%のベースライン保持率を維持した4倍の圧縮を示し、Arenaランキングでは31B高密度モデルが約27位に位置しています。

OpenClawRadar
ThermoQA:エンジニアリング熱力学のためのオープンベンチマーク、293の計算問題でLLMをテスト
News

ThermoQA:エンジニアリング熱力学のためのオープンベンチマーク、293の計算問題でLLMをテスト

ThermoQAは、3つの階層にわたる293の工学熱力学問題からなるオープンベンチマークで、LLMの正確な数値計算能力をテストします。Claude Opus 4.6が94.1%の総合スコアで首位を走り、DeepSeek-R1は±2.5%で実行間のばらつきが最も大きくなっています。

OpenClawRadar