NVIDIA lanza Nemotron-3-Ultra-550B: 55B parámetros activos, 1M de contexto, híbrido LatentMoE

✍️ OpenClawRadar📅 Publicado: 4 de junio de 2026🔗 Source
NVIDIA lanza Nemotron-3-Ultra-550B: 55B parámetros activos, 1M de contexto, híbrido LatentMoE
Ad

NVIDIA lanzó Nemotron-3-Ultra-550B-A55B-BF16, un LLM de escala fronteriza con 550B parámetros totales y 55B activos. El modelo utiliza una arquitectura híbrida Latent Mixture-of-Experts (LatentMoE) que intercala capas de Mamba-2, MoE y atención, además de Multi-Token Prediction (MTP) para una generación más rápida. La longitud de contexto alcanza hasta 1M de tokens.

Ad

Especificaciones clave

  • Arquitectura: LatentMoE híbrido – Mamba-2 + MoE + Attention + MTP
  • Parámetros: 550B totales / 55B activos
  • Contexto: Hasta 1M de tokens
  • GPU mínima: 8x GB200/B200/GB300/B300, 16x H100, 8x H200
  • Idiomas: Inglés, francés, español, italiano, alemán, japonés, coreano, hindi, portugués de Brasil, chino
  • Razonamiento: Configurable on/off mediante plantilla de chat (enable_thinking=True/False)
  • Licencia: OpenMDW License Agreement v1.1

El modelo está diseñado para razonamiento de frontera, flujos de trabajo agentivos complejos, análisis de contexto largo, uso de herramientas, razonamiento multilingüe y RAG de alto riesgo. Está entrenado con la receta de preentrenamiento NVFP4 para eficiencia computacional. Se incluyen pesos abiertos, datos de entrenamiento y recetas bajo la licencia OpenMDW. Para inferencia local, necesitarás al menos 8x H200 o equivalente.

📖 Lee la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Estudio de Stanford: Profesores de Derecho Prefieren Respuestas de IA sobre las de sus Colegas el 75% del Tiempo
Noticias

Estudio de Stanford: Profesores de Derecho Prefieren Respuestas de IA sobre las de sus Colegas el 75% del Tiempo

En una evaluación ciega de casi 3,000 comparaciones, los profesores de derecho calificaron significativamente mejor las respuestas generadas por IA que las escritas por colegas. Las respuestas de IA fueron señaladas como dañinas solo el 3.5% del tiempo, frente al 12% de las humanas.

OpenClawRadar
La discusión en Reddit destaca los desafíos de depuración con código generado por IA.
Noticias

La discusión en Reddit destaca los desafíos de depuración con código generado por IA.

Un debate en Reddit en r/ClaudeAI detalla problemas específicos que enfrentan los desarrolladores con el código generado por IA, incluyendo vulnerabilidades de seguridad, alucinaciones lógicas y depuración que puede tomar más tiempo que escribir el código manualmente.

OpenClawRadar
El benchmark Claude Code revela un punto ciego en los jueces de IA: errores de pipeline atribuidos erróneamente a la capacidad del modelo.
Noticias

El benchmark Claude Code revela un punto ciego en los jueces de IA: errores de pipeline atribuidos erróneamente a la capacidad del modelo.

Una evaluación comparativa autónoma realizada por Claude Code (Opus 4.6) declaró inicialmente que MiniMax 'no puede implementar la tarea' debido a un error de configuración del entorno aislado, luego corrigió el veredicto después de investigar los registros del demonio. El incidente destaca cómo los jueces de IA pueden atribuir erróneamente con confianza problemas de infraestructura a debilidades del modelo.

OpenClawRadar
Alibaba lanza la plataforma de IA Wukong para la automatización empresarial.
Noticias

Alibaba lanza la plataforma de IA Wukong para la automatización empresarial.

Alibaba ha lanzado Wukong, una plataforma de IA que coordina múltiples agentes para manejar tareas empresariales complejas como edición de documentos, actualización de hojas de cálculo, transcripción de reuniones e investigación. Actualmente se encuentra en fase de pruebas beta solo por invitación.

OpenClawRadar