オープンソースAIの現状:パリティ達成も、プロダクションギャップは依然として残る

✍️ OpenClawRadar📅 公開日: July 18, 2026🔗 Source
オープンソースAIの現状:パリティ達成も、プロダクションギャップは依然として残る
Ad

Mozillaの「State of Open Source AI」レポート(V1.0、2026年7月)は、オープンウェイトモデルがトップクローズドモデルとの能力差を縮めたものの、プロダクション導入におけるギャップが残ることを示すデータを提供している。

主要な発見

  • 能力ギャップ: Chatbot Arenaのスコア差は2024年8月には8.04%から0.5%に縮小し、2025年2月にはDeepSeek-R1が一時的に同等に達したが、2026年3月にはクローズド推論モデルの進歩により再び3.3%に拡大。オープンモデルはコーディング、指示追従、一般知識で同等か近い水準にあり、ギャップは推論、長文検索、エージェントタスクに集中している。
  • 推論コストの急落: GPT-4クラスの推論コストは36ヶ月で50分の1(100万トークンあたり20ドルから0.40ドル)に低下。これはドットコム時代の帯域幅やPCコンピューティングの価格曲線よりも速い。
  • トークン量: オープンウェイトモデルは現在、OpenRouter上のプロダクショントークンの過半数を占めている。最もボリュームの多い5モデルはすべてオープンウェイト。中国製モデルは週約18兆トークン、米国製は約5.5兆トークン(FT分析)。
  • 採用とプロダクション: AI機能を追加する開発者の79%がオープンモデルを使用している(クローズドは71%)が、プロダクションに到達したのはオープンモデルチームの51%のみ(クローズドは63%)。このギャップは運用ツールと信頼の問題であり、モデルの能力ではない。

レポートは具体的なユースケースを挙げている:マオリ語放送局がデータ主権ライセンスのもとで音声モデルを訓練、PwCが自社ハードウェア上で金融言語に特化したオープンモデルを微調整、研究者が赤十字とともに医療用オープンモデルを構築、農家がデバイス上のオフラインモデルでキャッサバ病を診断、スイスの公共コンソーシアムが公開スーパーコンピュータで国産モデルを訓練し、ウェイトとデータ、訓練コードを公開。

📖 全文を読む(ソース): HN LLM Tools

Ad

👀 See Also

GitHub Copilot、2026年6月1日よりプレミアムリクエストに代わりトークン消費量ベースの課金に移行
News

GitHub Copilot、2026年6月1日よりプレミアムリクエストに代わりトークン消費量ベースの課金に移行

GitHub Copilot は、プレミアムリクエストユニットからトークンベースの GitHub AI Credits に移行します。プラン料金は変更ありません。すべての有料プランには、サブスクリプション料金に相当する月間クレジットが含まれます。追加使用分は API レートで請求されます。

OpenClawRadar
クラウボットコミュニティがインターフェース改善の可能性について議論
News

クラウボットコミュニティがインターフェース改善の可能性について議論

ClawbBotコミュニティは、ユーザー体験と機能性の向上に焦点を当て、インターフェースの改善案を活発に模索しています。この議論は、AIコーディングエージェントの分野で有望な革新を引き起こしています。

OpenClawRadar
Opus 4.7 トークン効率: ドイツ語プロンプトは英語の最大2倍のトークンを消費
News

Opus 4.7 トークン効率: ドイツ語プロンプトは英語の最大2倍のトークンを消費

Claude Pro 加入者によると、ドイツ語で Opus 4.7 を使用した場合、セッショントークンを数秒で 100% 消費したのに対し、英語では 37% だった。トークナイザーの非効率性は、複合名詞やウムラウトに起因し、トークン使用量が 1.5~2 倍になる。

OpenClawRadar
構造化ワークフローがAI DESベンチマークで計画モードとスーパーパワーを凌駕
News

構造化ワークフローがAI DESベンチマークで計画モードとスーパーパワーを凌駕

OuroborosワークフローがAI支援離散イベントシミュレーションベンチマークで1位を獲得。Claudeのプランモードやfat-skillスーパーパワーアプローチを上回り、構造化された明確化→計画→実行→評価→回復→反復のサイクルを活用。

OpenClawRadar