NVIDIA dévoile Nemotron-3-Ultra-550B : 55B paramètres actifs, contexte 1M, hybride LatentMoE

NVIDIA a publié Nemotron-3-Ultra-550B-A55B-BF16, un LLM à l'échelle frontière avec 550B paramètres totaux et 55B actifs. Le modèle utilise une architecture hybride Latent Mixture-of-Experts (LatentMoE) qui entrelace les couches Mamba-2, MoE et d'attention, plus la prédiction multi-tokens (MTP) pour une génération plus rapide. La longueur de contexte atteint jusqu'à 1M tokens.
Spécifications clés
- Architecture : LatentMoE hybride – Mamba-2 + MoE + Attention + MTP
- Paramètres : 550B total / 55B actifs
- Contexte : Jusqu'à 1M tokens
- GPU minimum : 8x GB200/B200/GB300/B300, 16x H100, 8x H200
- Langues : anglais, français, espagnol, italien, allemand, japonais, coréen, hindi, portugais brésilien, chinois
- Raisonnement : Activable/désactivable via le modèle de chat (
enable_thinking=True/False) - Licence : OpenMDW License Agreement v1.1
Le modèle est conçu pour le raisonnement de pointe, les workflows agentiques complexes, l'analyse de longs contextes, l'utilisation d'outils, le raisonnement multilingue et le RAG à enjeux élevés. Il est entraîné avec la recette de pré-entraînement NVFP4 pour l'efficacité computationnelle. Les poids ouverts, les données d'entraînement et les recettes sont inclus sous la licence OpenMDW. Pour l'inférence locale, vous aurez besoin d'au moins 8x H200 ou équivalent.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Comparaison des performances de Qwen3-30B-A3B et Qwen3.5-35B-A3B sur RTX 5090
Un benchmark comparatif entre Qwen3-30B-A3B et Qwen3.5-35B-A3B sur une RTX 5090 montre que le modèle 30B est 35 % plus rapide en génération, tandis que le modèle 3.5 gère mieux les contextes longs avec une échelle de tokens plate contre une dégradation de 21 % pour le 30B.

OpenClaw : Expérience décevante ou erreur de configuration ?
Les utilisateurs signalent des problèmes avec OpenClaw qui ne parvient pas à aller au-delà des interactions simples de chatbot malgré une configuration correcte suivant les directives officielles.

Allbirds passe de la chaussure aux infrastructures d'IA, ses actions bondissent de 580 %
La marque de chaussures Allbirds a annoncé un accord de 50 millions de dollars pour devenir une entreprise d'infrastructure informatique d'IA appelée NewBird AI, ce qui a fait grimper ses actions de 580 %. L'entreprise prévoit d'acheter des GPU et d'offrir des puces graphiques à la demande et des services cloud pour l'IA.

Claude AI signale des erreurs accrues sur plusieurs plateformes
Les systèmes d'IA Claude d'Anthropic ont connu des erreurs accrues sur claude.ai, Claude Console et Claude Code le 2 mars 2026. La page de statut de l'entreprise et le fil de discussion sur les performances Reddit fournissent des rapports de surveillance et de la communauté.