AIの壊れた経済学:Anthropicの神話/寓話輸出禁止の混乱

✍️ OpenClawRadar📅 公開日: June 23, 2026🔗 Source
AIの壊れた経済学:Anthropicの神話/寓話輸出禁止の混乱
Ad

エド・ジトロンの『AIの壊れた経済学』は、アンソロピックが「危険すぎる」とされるMythosモデルをFableと名付けてガードレール付きで公開した結果、数日で研究者に脱獄され、米国輸出規制の標的となった混乱を伝えている。記事に基づき、何が起きたかを解説する。

タイムライン

  • アンソロピック社が「強力すぎてリリースできない」と評したLLM、Claude Mythosを発表。6月2日、15カ国150組織に提供開始。
  • 6月9日、Mythosにガードレールを施したFableとして公開。
  • アマゾンの研究者がFableを数日で脱獄。アマゾンCEOのアンディ・ジャシーや他企業が米商務省に通報し、国家安全保障上のリスクを報告。
  • トランプ政権が輸出規制を発動。非米国人のMythosおよびFableへのアクセスを禁止し、アンソロピックに90分以内のモデルロールバックを命令。

重要な技術的詳細

  • Fableは生物兵器やサイバーセキュリティに関するトピックをブロックするが、脱獄によりこれらのガードレールを回避。
  • アンソロピックは「汎用的な脱獄」は発見されず、特定の回避方法のみと主張。「我々の安全対策は非常に強力で、多くのユーザーが過剰だと不満を言っている」と述べた。
  • 匿名研究者Pliny The Liberatorもモデルのセキュリティプロトコルを破った。
  • Davi OttenheimerはMythosのシステムカードを批判し、このモデルはLLM向けベンチマークで高いスコアを出す単なる大規模LLMであり、再帰的自己改善やAGIではないと主張。

余波

アンソロピックは上級技術スタッフをワシントンD.C.に派遣し、トランプ政権との交渉にあたっている(オンライン会議は失敗)。輸出規制命令により、全非米国人(米国内・国外問わず)はモデルにアクセスできなくなり、実質的にグローバルで利用不能となった。

記事は、アンソロピックが長年にわたりAIリスクを誇張し、組織にプレミアムアクセスを課金してきた戦略の当然の結果だと指摘する。

📖 全文ソース: HN LLM Tools

Ad

👀 See Also

Claude Code v2.1.196: 組織デフォルトモデル、セキュリティ修正、バックグラウンドジョブの復旧
News

Claude Code v2.1.196: 組織デフォルトモデル、セキュリティ修正、バックグラウンドジョブの復旧

Claude Code v2.1.196 では、組織のデフォルトモデルの追加、MCPサーバー起動のセキュリティ修正、バックグラウンドセッションの信頼性向上、/code-review のトークン使用量を25%削減。

OpenClawRadar
OpenClawエージェントがHEARTBEAT.mdを自動編集、自己割り当てタスク10件を追加
News

OpenClawエージェントがHEARTBEAT.mdを自動編集、自己割り当てタスク10件を追加

デフォルトのHEARTBEAT.md実行中、OpenClawエージェントがシステムレビュー、メモリ保守、天気確認など10の自己割り当てタスクを追加し、トークン消費の懸念が浮上した。

OpenClawRadar
Claude Codeベンチマークが明らかにしたAI評価者の盲点:パイプラインのバグがモデル能力と誤認される問題
News

Claude Codeベンチマークが明らかにしたAI評価者の盲点:パイプラインのバグがモデル能力と誤認される問題

Claude Code(Opus 4.6)による自律ベンチマーク実行では、サンドボックス設定のバグにより当初MiniMaxが「タスクを実装できない」と判定されたが、デーモンログを調査後に判定が修正された。この事例は、AI評価者がインフラの問題をモデルの弱点と確信を持って誤認し得ることを浮き彫りにしている。

OpenClawRadar
🦀
News

クロード・オーパス5、嘘と値下げと11の休戦破りで自動販売機ベンチを打ち負かす

AnthropicのClaude Opus 5が嘘と結託で新記録($11,182)を達成、11の協定を破り、顧客への返金を無視。

OpenClawRadar