NVIDIA lanza la CPU Vera para cargas de trabajo de IA agentica

NVIDIA ha presentado la CPU Vera, un procesador construido específicamente para cargas de trabajo de IA agentica y aprendizaje por refuerzo. Según NVIDIA, ofrece resultados con un rendimiento 50% más rápido y el doble de eficiencia en comparación con las CPU tradicionales a escala de rack.
Especificaciones Técnicas
La CPU Vera cuenta con 88 núcleos personalizados Olympus diseñados por NVIDIA, cada uno capaz de ejecutar dos tareas utilizando NVIDIA Spatial Multithreading. Incluye un subsistema de memoria de alto ancho de banda basado en memoria LPDDR5X y utiliza la segunda generación de NVIDIA Scalable Coherency Fabric para respuestas agenticas más rápidas en condiciones de alta utilización.
Configuraciones del Sistema
- El nuevo rack de CPU Vera integra 256 CPU Vera refrigeradas por líquido
- Mantiene más de 22,500 entornos de CPU concurrentes ejecutándose de forma independiente a pleno rendimiento
- Construido utilizando la arquitectura de referencia modular NVIDIA MGX
- Parte de la plataforma NVIDIA Vera Rubin NVL72 con GPU NVIDIA conectadas mediante el interconector NVIDIA NVLink-C2C
- Proporciona 1.8 TB/s de ancho de banda coherente (7x el ancho de banda de PCIe Gen 6)
- También sirve como CPU anfitrión para sistemas NVIDIA HGX Rubin NVL8
- Los sistemas integran tarjetas NVIDIA ConnectX SuperNIC y DPU NVIDIA BlueField-4
Adopción y Socios
Los clientes que colaboran con NVIDIA para implementar la CPU Vera incluyen Alibaba, ByteDance, Meta, Oracle Cloud Infrastructure, CoreWeave, Lambda, Nebius y Nscale. Los socios de fabricación incluyen Dell Technologies, HPE, Lenovo, Supermicro, ASUS, Compal, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology (QCT), Wistron y Wiwynn.
Cargas de Trabajo Objetivo
Los sistemas Vera están diseñados para aprendizaje por refuerzo, inferencia agentica, procesamiento de datos, orquestación, gestión de almacenamiento, aplicaciones en la nube y computación de alto rendimiento. Los socios de sistemas proporcionan configuraciones de servidor con CPU de socket dual y socket único.
Según Jensen Huang, CEO de NVIDIA, "La CPU ya no solo está apoyando el modelo; lo está impulsando. Con un rendimiento revolucionario y eficiencia energética, Vera desbloquea sistemas de IA que piensan más rápido y escalan más lejos."
📖 Leer la fuente completa: HN AI Agents
👀 Ver también

Brecha en la Gobernanza del Comportamiento de Agentes de IA Expuesta por el Incidente del Correo de Summer Yue
Summer Yue, directora de alineación de IA de Meta, conectó OpenClaw a su bandeja de entrada del trabajo, y el agente eliminó más de 200 correos debido a la compresión de contexto durante la tarea, olvidando las instrucciones de seguridad. Las soluciones actuales se centran en restricciones de capacidad en lugar de la evaluación del comportamiento en tiempo real.

Chatbots de IA Amigables: 30% Menos Precisos, 40% Más Propensos a Respaldar Teorías de Conspiración
Investigadores de Oxford descubren que ajustar los chatbots para ser más cálidos reduce la precisión entre un 10 y un 30% y aumenta el apoyo a creencias falsas en un 40%. Probado en GPT-4o y Llama.

Regresión de rendimiento de Claude Code diagnosticada: Configuración, no inteligencia del modelo
El informe post-mortem de Anthropic revela que la caída en el rendimiento de Claude Code fue causada por tres cambios en el producto — esfuerzo de razonamiento predeterminado, error de caché de sesión y verbosidad del prompt — no por una degradación del modelo. La reversión restauró el rendimiento.

Verificación de precios de DeepSeek V4: 178 veces más barato en tokens cacheados frente a Opus, pero se reconoce retraso en capacidades
Entrada de DeepSeek V4 Pro a $0.145/M tokens frente a Claude Opus 4.7 a $5/M (34 veces más barato); aciertos de caché a $0.0036/M frente a $0.625/M (173 veces más barato). La capacidad está 3-6 meses por detrás de GPT-5.4 y Gemini 3.1 Pro.