Anthropicのクロード神話:恐怖マーケティングか現実のリスクか

Anthropicは最近、サイバーセキュリティのバグ発見において人間の専門家を凌駕すると主張するClaude Mythosモデルを発表した。4月初旬のブログ投稿で、同社は同様の技術が悪意のある手に渡った場合、経済、公共の安全、国家の安全に深刻な影響が出ると警告した。一部の観測筋は、ラップトップからWi-Fi電子レンジまで、あらゆるデバイスが大量に置き換えられると予測した。
しかし、セキュリティ専門家はその主張を疑問視し、批評家はあるパターンを指摘する。AI企業が現実世界の被害から注意をそらし、株価をつり上げ、自分たちだけが責任ある管理者であると位置づけるために、実存的リスクの物語を増幅させているというのだ。エディンバラ大学の倫理学教授シャノン・ヴァロー氏は、AIを「超自然的な危険」と位置づけることで、規制当局に無力感を与え、唯一の守護者として企業だけが残されると主張する。
これは新しいことではない。2019年、当時OpenAIにいたAnthropicのCEOダリオ・アモデイは、GPT-2が悪用される危険性があるとして、公開するには危険すぎると宣言するのに一役買った。数カ月後、OpenAIは結局公開し、サム・アルトマンはその懸念を後に「見当違い」だったと述べた。アルトマンは最近、Anthropicの「恐怖に訴えるマーケティング」を批判したが、彼自身もAIが「おそらく最も可能性が高いのは世界の終焉をもたらすことだが、その間には素晴らしい企業が生まれるだろう」と警告するなど、同様の手法を使っていた。
Anthropicの広報担当者は、この記事の指摘についてコメントを控えたが、他の組織からの支援的なブログ記事を共有した。このパターンは、Mythosが主張するほど危険かどうかにかかわらず、恐怖が意図的な戦略であることを示唆している。
📖 Read the full source: HN AI Agents
👀 See Also

「エージェンティック」な物語に欠けているもの:明確に定義されたユーザーエージェントの役割
Mark Nottinghamは、現在のAIエージェントには明確なユーザーエージェントの役割が欠けており、ユーザーの期待と実際のエージェントの動作との間に信頼ギャップが生じていると論じています。

IDPリーダーボードのベンチマークによると、Claude Sonnet 4.6は文書AIタスクにおいてOpus 4.6と同等の性能を示しています
IDPリーダーボードは、OCR、表抽出、キー抽出、視覚的QA、手書き、長文書の9,000以上のドキュメントで16のAIモデルをテストしました。Claude Sonnet 4.6は総合80.8点で、Opus 4.6の80.3点とほぼ同等の成績を収め、Haiku 4.5は69.6点でした。

Claude Code v2.1.149: 使用状況の内訳、権限修正、キーボードナビゲーション
Claude Code v2.1.149 は、カテゴリ別の使用量内訳、キーボードでスクロール可能な /diff ビュー、GFMタスクリストチェックボックスを追加し、PowerShellのアクセス許可バイパスやサンドボックスの問題を修正しました。

GitHub CopilotがPRの説明に自己宣伝を挿入しました
ある開発者が、GitHub Copilotがプルリクエストの説明文にプロモーションコンテンツを編集して追加した事例を報告しました。この出来事はHacker Newsで427ポイントと141コメントを集め、大きな議論を呼びました。