NVIDIA Lança CPU Vera para Cargas de Trabalho de IA Agêntica

✍️ OpenClawRadar📅 Publicado: March 17, 2026🔗 Source
NVIDIA Lança CPU Vera para Cargas de Trabalho de IA Agêntica
Ad

A NVIDIA apresentou a CPU Vera, um processador construído especificamente para cargas de trabalho de IA agentiva e aprendizado por reforço. Segundo a NVIDIA, ela entrega resultados com desempenho 50% mais rápido e o dobro da eficiência em comparação com CPUs tradicionais de escala de rack.

Especificações Técnicas

A CPU Vera possui 88 núcleos Olympus personalizados projetados pela NVIDIA, cada um capaz de executar duas tarefas usando o NVIDIA Spatial Multithreading. Ela inclui um subsistema de memória de alta largura de banda construído sobre memória LPDDR5X e usa a segunda geração do NVIDIA Scalable Coherency Fabric para respostas agentivas mais rápidas sob condições de alta utilização.

Configurações do Sistema

  • Novo rack de CPU Vera integra 256 CPUs Vera resfriadas a líquido
  • Sustenta mais de 22.500 ambientes de CPU simultâneos executando independentemente com desempenho total
  • Construído usando a arquitetura de referência modular NVIDIA MGX
  • Parte da plataforma NVIDIA Vera Rubin NVL72 com GPUs NVIDIA conectadas via interconexão NVIDIA NVLink-C2C
  • Fornece 1,8 TB/s de largura de banda coerente (7x a largura de banda do PCIe Gen 6)
  • Também serve como CPU host para sistemas NVIDIA HGX Rubin NVL8
  • Sistemas integram placas NVIDIA ConnectX SuperNIC e DPUs NVIDIA BlueField-4
Ad

Adoção e Parceiros

Clientes colaborando com a NVIDIA para implantar a CPU Vera incluem Alibaba, ByteDance, Meta, Oracle Cloud Infrastructure, CoreWeave, Lambda, Nebius e Nscale. Parceiros de fabricação incluem Dell Technologies, HPE, Lenovo, Supermicro, ASUS, Compal, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology (QCT), Wistron e Wiwynn.

Cargas de Trabalho Alvo

Sistemas Vera são projetados para aprendizado por reforço, inferência agentiva, processamento de dados, orquestração, gerenciamento de armazenamento, aplicações em nuvem e computação de alto desempenho. Parceiros de sistemas fornecem configurações de servidor com CPU de soquete duplo e soquete único.

De acordo com Jensen Huang, CEO da NVIDIA, "A CPU não está mais simplesmente apoiando o modelo; ela está conduzindo-o. Com desempenho e eficiência energética revolucionários, a Vera desbloqueia sistemas de IA que pensam mais rápido e escalam mais."

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

A Liquid AI lança o modelo LFM2.5-350M para loops agentivos
News

A Liquid AI lança o modelo LFM2.5-350M para loops agentivos

A Liquid AI lançou o LFM2.5-350M, um modelo de 350 milhões de parâmetros treinado para extração confiável de dados e uso de ferramentas. Tem menos de 500MB quando quantizado e supera modelos maiores como o Qwen3.5-0.8B na maioria dos benchmarks, sendo mais rápido e eficiente em memória.

OpenClawRadar
Funcionários da Amazon zombam da IA da empresa no Slack e a chamam de 'Sloppenheimer'
News

Funcionários da Amazon zombam da IA da empresa no Slack e a chamam de 'Sloppenheimer'

Funcionários da Amazon têm um canal no Slack para memes zombando do produto de codificação de IA defeituoso da empresa, chamando sua saída de 'porcaria' e brincando sobre tentativas fracassadas de motivação com IA.

OpenClawRadar
Primeiro GitHub Exclusivo para Agentes de IA Lançado: Beta Limitado para 100 Usuários
News

Primeiro GitHub Exclusivo para Agentes de IA Lançado: Beta Limitado para 100 Usuários

Uma exclusividade inovadora do GitHub para agentes de IA de codificação foi desenvolvida, com uma versão beta limitada para 100 usuários. Descubra como esta ferramenta está pronta para revolucionar a colaboração em IA.

OpenClawRadar
Gemma 4 Sinais Iniciais: Adequação à Implantação Acima do Hype para Fluxos de Trabalho de Agentes Locais
News

Gemma 4 Sinais Iniciais: Adequação à Implantação Acima do Hype para Fluxos de Trabalho de Agentes Locais

O lançamento do Gemma 4 enfatiza a implantação em diferentes níveis de hardware, com posicionamento oficial para hardware pessoal e dispositivos de borda/móveis. A quantização NVFP4 da NVIDIA mostra compressão de 4x com retenção de 99,7% da linha de base no GPQA, e os rankings da Arena posicionam o modelo denso de 31B em torno da posição #27.

OpenClawRadar