NVIDIA、Nemotron-3-Ultra-550Bをリリース:550億のアクティブパラメータ、100万トークンのコンテキスト、LatentMoEハイブリッド

NVIDIAはNemotron-3-Ultra-550B-A55B-BF16をリリースしました。これは、総パラメータ550B、アクティブパラメータ55Bのフロンティア級LLMです。このモデルは、Mamba-2、MoE、アテンション層をインターリーブし、さらにマルチトークン予測(MTP)による高速生成を実現する、ハイブリッドLatentMixture-of-Experts(LatentMoE)アーキテクチャを採用しています。コンテキスト長は最大100万トークンです。
主な仕様
- アーキテクチャ: LatentMoEハイブリッド – Mamba-2 + MoE + Attention + MTP
- パラメータ: 合計550B / アクティブ55B
- コンテキスト: 最大100万トークン
- 最低GPU: 8x GB200/B200/GB300/B300、16x H100、8x H200
- 対応言語: 英語、フランス語、スペイン語、イタリア語、ドイツ語、日本語、韓国語、ヒンディー語、ブラジルポルトガル語、中国語
- 推論: チャットテンプレートでオン/オフ設定可能(
enable_thinking=True/False) - ライセンス: OpenMDW License Agreement v1.1
このモデルは、最先端の推論、複雑なエージェントワークフロー、長文コンテキスト分析、ツール使用、多言語推論、重要度の高いRAG向けに構築されています。計算効率のためにNVFP4事前学習レシピでトレーニングされています。オープンウェイト、トレーニングデータ、レシピはOpenMDWライセンスで提供されます。ローカル推論には、少なくとも8x H200または同等のGPUが必要です。
📖 全文ソース: r/LocalLLaMA
👀 See Also

Claudeは、Pro、Max、Teamプランに追加の利用クレジットを提供します。
Claudeは、Pro、Max、Teamプランの加入者に対して、サブスクリプション料金と同額の一回限りの追加利用クレジットを提供しています。このクレジットは、Claude、Claude Code、Claude Cowork、およびサードパーティ製品で使用できます。

トランプ、米国テクノロジーの減速懸念からAI大統領令を撤回
トランプ大統領は、バイデン政権のAI大統領令を撤回し、競争力を優先。

Claude-Code v2.1.79は、リモート制御機能を追加し、サブプロセスのハングアップを修正、メモリ使用量を改善しました。
Claude-Code v2.1.79では、VSCode用の/remote-controlコマンドを導入し、セッションをclaude.ai/codeにブリッジ接続できるようになりました。また、サブプロセスでのclaude -pのハングアップを修正し、起動時のメモリ使用量を約18MB削減しました。さらに、Anthropic Console認証用の--consoleフラグを追加し、APIタイムアウト処理を改善しています。

アンソロピック、ユーザーフィードバック後にClaudeエージェントSDKのクレジット変更を一時停止
Anthropicは本日、Agent SDK、claude-p、サードパーティアプリをサブスクリプションのレート制限ではなく専用の月間クレジットに移行する予定の変更を一時停止すると、ユーザーにメールで通知しました。