Claude Opus 4.8 リリース:より高速、より低コストの高速モード、動的ワークフロー、誠実性の向上

✍️ OpenClawRadar📅 公開日: May 29, 2026🔗 Source
Claude Opus 4.8 リリース:より高速、より低コストの高速モード、動的ワークフロー、誠実性の向上
Ad

Anthropicは本日、Claude Opus 4.8をリリース。Opus 4.7をアップグレードし、コーディング、エージェントスキル、推論、ナレッジワークにおいてベンチマークが向上。新バージョンは従来モデルと同じ価格で利用可能。

主な機能

  • 努力量コントロール(claude.ai)— ユーザーがタスクにかけるClaudeの努力量を設定可能に。
  • 動的ワークフロー(Claude Code)— 大規模な問題に対応。
  • 高速モードが2.5倍の速度で動作し、従来モデルより3倍低価格に。

ベンチマークのハイライト

発表によると、Claude Opus 4.8はAnthropicのSuper-Agentベンチマークで全ケースをエンドツーエンドで完了した唯一のモデルであり、Opus 4.7を上回り、GPT-5.5と同等のコスト。Online-Mind2Web(コンピューター利用・ブラウザエージェントタスク)では84%を達成 — Opus 4.7およびGPT-5.5を大きく上回る。CursorBenchでは、すべての努力レベルでOpus 4.7を上回る結果に。

Legal Agentベンチマークでは、Opus 4.8はall-pass基準で初めて10%を突破。初期テスターからは、ツール呼び出し効率(同知能でステップ数削減)、引用精度、検索ワークフローでのトークン効率の改善も報告。

正直性トレーニング

Opus 4.8は明示的な正直性の改善を導入 — 根拠のない主張を避け、入出力の問題を積極的に指摘するようトレーニング。これにより、テスターの評価で高品質な分析と優れたシグナル・ノイズ比を実現。

価格

Opus 4.8はOpus 4.7と同じ価格。高速モードは従来の3分の1の価格。Genie(DatabricksのAIエージェント)向けマルチモーダルトークンコストはOpus 4.7比61%削減。

📖 出典全文: HN AI Agents

Ad

👀 See Also

非結合型DiLoCo:低帯域幅でのデータセンター間における耐障害性のある分散トレーニング
News

非結合型DiLoCo:低帯域幅でのデータセンター間における耐障害性のある分散トレーニング

Google DeepMindのDecoupled DiLoCoは、2〜5 GbpsのWANを使用して離れたデータセンター間でLLMをトレーニングし、ハードウェア障害を分離する自己修復型の計算アイランドを備え、MLパフォーマンスを低下させません。

OpenClawRadar
Anthropicのプラットフォーム戦略とOpenClawの対応
News

Anthropicのプラットフォーム戦略とOpenClawの対応

ある開発者がAnthropicが最近行った外部Claude連携への制限を分析し、価格や法的問題ではなく、典型的なプラットフォーム企業戦略として捉え、プロバイダーの好意に依存するのではなく、ポータブルなスタックを構築すべきだと主張しています。

OpenClawRadar
オラクル、社内LLM利用にもかかわらずOpenJDKでのAI生成コードを禁止
News

オラクル、社内LLM利用にもかかわらずOpenJDKでのAI生成コードを禁止

オラクルはOpenJDKへのAI生成コードの提供を禁止し、セキュリティと知的財産リスクを挙げている。これは、AIがオラクルのコードを書いているというラリー・エリソンCEOの発言と矛盾している。

OpenClawRadar
スタンフォード大学の報告書によると、AIの専門家と一般市民ではAIの影響に対する見解が分かれている。
News

スタンフォード大学の報告書によると、AIの専門家と一般市民ではAIの影響に対する見解が分かれている。

スタンフォード大学の年次AI業界報告書は、AI専門家の楽観性と一般市民の不安との間に大きな隔たりがあることを明らかにしており、専門家はAGI(汎用人工知能)のリスクに焦点を当てる一方で、一般市民は雇用、医療、光熱費などを懸念しています。

OpenClawRadar