Nvidia、オープンウェイトAIモデルに260億ドルを投資し、Nemotron 3 Superをリリース

Nvidiaは、幹部によって確認された2025年の財務報告書によると、オープンウェイトAIモデルを開発するために今後5年間で260億ドルを投資します。この戦略的動きは、NvidiaをOpenAIやDeepSeekのようなフロンティアAI研究所と直接競争させる一方、モデルがNvidiaのチップ向けに調整されているため、同社のハードウェアドミナンスを強化します。
Nemotron 3 Superのリリース詳細
水曜日、Nvidiaはこれまでで最も高性能なオープンウェイトモデル「Nemotron 3 Super」をリリースしました。このモデルは1280億のパラメータを持ち、OpenAIのGPT-OSSの最大バージョンとほぼ同等です。Nvidiaは、いくつかのベンチマークでGPT-OSSや他のモデルを上回ると主張しています:
- 人工知能指数で37点を獲得(GPT-OSSは33点)
- モデルのOpenClaw制御能力を評価する新しいベンチマーク「PinchBench」で第1位を獲得
- AI指数ではいくつかの中国モデルがより高いスコアを記録
技術的革新とトレーニング
Nvidiaは、推論能力、長文脈処理、強化学習への応答性を向上させるアーキテクチャとトレーニング技術を導入しました。同社は最近、5500億パラメータのモデルの事前学習を完了し、ロボティクス、気候モデリング、タンパク質折りたたみのための専門モデルをリリースしました。
オープンモデルの状況
Metaは最初にオープンモデル(2023年のLlama)をリリースしましたが、将来のモデルを完全にオープンにしない可能性があります。OpenAIのGPT-OSSは独自の提供品よりも劣り、修正には適していません。OpenAI、Anthropic、Googleの米国トップモデルはクラウド/チャット専用です。対照的に、DeepSeek、Alibaba、Moonshot AI、Z.ai、MiniMaxの中国モデルはウェイトをオープンかつ無料で公開しており、多くのスタートアップや研究者がそれらを基に構築しています。
戦略的意義
Nvidiaのオープンモデルは、チップだけでなく、スーパーコンピュータ規模のデータセンター、ストレージ、ネットワーキング、ハードウェアアーキテクチャのテストと改善にも役立ちます。この投資は、競合ハードウェアで劇的な改善を示す可能性があり、Nvidiaの地位を侵食する恐れのある中国のオープンモデルの台頭に対抗することを目的としています。DeepSeekの2025年1月リリースは、コストを大幅に削減するより効率的なトレーニングアプローチを使用しました。
📖 Read the full source: HN AI Agents
👀 See Also

CoworkはClaude Opus向けに中程度の努力をハードコードし、ユーザー設定を無視します
Maxプランのユーザーが発見したところによると、Coworkは--effort medium --model claude-opus-4-6をハードコードされたCLIフラグとして渡しており、環境変数やsettings.jsonの上書きを無視しています。これは、ユーザーが高努力レベルと100万トークンのコンテキストウィンドウへのアクセスに対して支払っているにもかかわらず、中程度の努力レベルと標準のコンテキストウィンドウに固定されていることを意味します。

AIにおける逸脱の常態化:なぜあなたのエージェントシステムは失敗するのか
AI業界は、信頼性の低いLLMの出力を、まだ重大な問題が起きていないから安全と見なす、チャレンジャー号のような文化的失敗を繰り返している。実際にエージェントがハードドライブをフォーマットしたり、データベースを消去したり、GitHubのイシューを作成した事例がある。

アップルのAI戦略と知性の商品化
この記事は、知性が商品化される中で、Appleの保守的なAIへのアプローチが有利になる可能性があると論じています。例えば、Gemma4のようなモデルはスマートフォン上で動作しながらMMLU Proで85.2%を達成し、OpenAIのSoraは1日あたり210万ドルの収益に対して1500万ドルのコストがかかっています。
Claude Code v2.1.247: SendFeedbackツール、コスト最適化、および20以上のバグ修正
Claude Code v2.1.247 では、SendFeedback ツール、/claude-api cost-optimize コマンド、およびサブエージェントのフォールバックやキーボードレイアウトの問題など、20 を超えるバグ修正が追加されました。