NVIDIA dévoile Nemotron-3-Ultra-550B : 55B paramètres actifs, contexte 1M, hybride LatentMoE

✍️ OpenClawRadar📅 Publié: June 4, 2026🔗 Source
NVIDIA dévoile Nemotron-3-Ultra-550B : 55B paramètres actifs, contexte 1M, hybride LatentMoE
Ad

NVIDIA a publié Nemotron-3-Ultra-550B-A55B-BF16, un LLM à l'échelle frontière avec 550B paramètres totaux et 55B actifs. Le modèle utilise une architecture hybride Latent Mixture-of-Experts (LatentMoE) qui entrelace les couches Mamba-2, MoE et d'attention, plus la prédiction multi-tokens (MTP) pour une génération plus rapide. La longueur de contexte atteint jusqu'à 1M tokens.

Ad

Spécifications clés

  • Architecture : LatentMoE hybride – Mamba-2 + MoE + Attention + MTP
  • Paramètres : 550B total / 55B actifs
  • Contexte : Jusqu'à 1M tokens
  • GPU minimum : 8x GB200/B200/GB300/B300, 16x H100, 8x H200
  • Langues : anglais, français, espagnol, italien, allemand, japonais, coréen, hindi, portugais brésilien, chinois
  • Raisonnement : Activable/désactivable via le modèle de chat (enable_thinking=True/False)
  • Licence : OpenMDW License Agreement v1.1

Le modèle est conçu pour le raisonnement de pointe, les workflows agentiques complexes, l'analyse de longs contextes, l'utilisation d'outils, le raisonnement multilingue et le RAG à enjeux élevés. Il est entraîné avec la recette de pré-entraînement NVFP4 pour l'efficacité computationnelle. Les poids ouverts, les données d'entraînement et les recettes sont inclus sous la licence OpenMDW. Pour l'inférence locale, vous aurez besoin d'au moins 8x H200 ou équivalent.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Comparaison des performances de Qwen3-30B-A3B et Qwen3.5-35B-A3B sur RTX 5090
News

Comparaison des performances de Qwen3-30B-A3B et Qwen3.5-35B-A3B sur RTX 5090

Un benchmark comparatif entre Qwen3-30B-A3B et Qwen3.5-35B-A3B sur une RTX 5090 montre que le modèle 30B est 35 % plus rapide en génération, tandis que le modèle 3.5 gère mieux les contextes longs avec une échelle de tokens plate contre une dégradation de 21 % pour le 30B.

OpenClawRadar
OpenClaw : Expérience décevante ou erreur de configuration ?
News

OpenClaw : Expérience décevante ou erreur de configuration ?

Les utilisateurs signalent des problèmes avec OpenClaw qui ne parvient pas à aller au-delà des interactions simples de chatbot malgré une configuration correcte suivant les directives officielles.

OpenClawRadar
Allbirds passe de la chaussure aux infrastructures d'IA, ses actions bondissent de 580 %
News

Allbirds passe de la chaussure aux infrastructures d'IA, ses actions bondissent de 580 %

La marque de chaussures Allbirds a annoncé un accord de 50 millions de dollars pour devenir une entreprise d'infrastructure informatique d'IA appelée NewBird AI, ce qui a fait grimper ses actions de 580 %. L'entreprise prévoit d'acheter des GPU et d'offrir des puces graphiques à la demande et des services cloud pour l'IA.

OpenClawRadar
Claude AI signale des erreurs accrues sur plusieurs plateformes
News

Claude AI signale des erreurs accrues sur plusieurs plateformes

Les systèmes d'IA Claude d'Anthropic ont connu des erreurs accrues sur claude.ai, Claude Console et Claude Code le 2 mars 2026. La page de statut de l'entreprise et le fil de discussion sur les performances Reddit fournissent des rapports de surveillance et de la communauté.

OpenClawRadar