NVIDIA dévoile Nemotron-3-Ultra-550B : 55B paramètres actifs, contexte 1M, hybride LatentMoE

NVIDIA a publié Nemotron-3-Ultra-550B-A55B-BF16, un LLM à l'échelle frontière avec 550B paramètres totaux et 55B actifs. Le modèle utilise une architecture hybride Latent Mixture-of-Experts (LatentMoE) qui entrelace les couches Mamba-2, MoE et d'attention, plus la prédiction multi-tokens (MTP) pour une génération plus rapide. La longueur de contexte atteint jusqu'à 1M tokens.
Spécifications clés
- Architecture : LatentMoE hybride – Mamba-2 + MoE + Attention + MTP
- Paramètres : 550B total / 55B actifs
- Contexte : Jusqu'à 1M tokens
- GPU minimum : 8x GB200/B200/GB300/B300, 16x H100, 8x H200
- Langues : anglais, français, espagnol, italien, allemand, japonais, coréen, hindi, portugais brésilien, chinois
- Raisonnement : Activable/désactivable via le modèle de chat (
enable_thinking=True/False) - Licence : OpenMDW License Agreement v1.1
Le modèle est conçu pour le raisonnement de pointe, les workflows agentiques complexes, l'analyse de longs contextes, l'utilisation d'outils, le raisonnement multilingue et le RAG à enjeux élevés. Il est entraîné avec la recette de pré-entraînement NVFP4 pour l'efficacité computationnelle. Les poids ouverts, les données d'entraînement et les recettes sont inclus sous la licence OpenMDW. Pour l'inférence locale, vous aurez besoin d'au moins 8x H200 ou équivalent.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

TranslateGemma-12b : L'examen humain détecte 71 % d'erreurs manquées par les mesures automatisées
L'examen MQM humain a signalé 71 % des segments de traduction que les métriques automatisées jugeaient propres, avec l'ensemble des 25 erreurs de précision situées dans le quadrant aveugle aux métriques.
L'Atlantique rapporte une montée de la violence anti-IA et des réactions politiques
Bernie Sanders et Steve Bannon dénoncent tous deux l'IA comme une menace pour les travailleurs. Une attaque au cocktail Molotov contre la maison de Sam Altman et la fusillade chez un conseiller municipal d'Indianapolis montrent que la violence anti-data centers est en hausse.

Étudier la faisabilité d'exécuter OpenClaw sur un Chromebook
Exécuter OpenClaw sur un Chromebook pourrait être plus simple que vous ne le pensez. Notre dernière exploration d'OpenClawRadar examine les expériences utilisateur et les exigences pour déterminer si les Chromebooks peuvent gérer cet agent de codage IA.

Claude Code v2.1.178 ajoute des règles de permission Tool(param:valeur), corrige des problèmes de sous-agent et d'authentification
Claude Code v2.1.178 ajoute la syntaxe Tool(param:valeur) pour les règles de permission, corrige la visualisation des transcriptions des sous-agents, les incompatibilités de jetons OAuth et la mise en cache d'authentification obsolète.