NVIDIA Lança CPU Vera para Cargas de Trabalho de IA Agêntica

A NVIDIA apresentou a CPU Vera, um processador construído especificamente para cargas de trabalho de IA agentiva e aprendizado por reforço. Segundo a NVIDIA, ela entrega resultados com desempenho 50% mais rápido e o dobro da eficiência em comparação com CPUs tradicionais de escala de rack.
Especificações Técnicas
A CPU Vera possui 88 núcleos Olympus personalizados projetados pela NVIDIA, cada um capaz de executar duas tarefas usando o NVIDIA Spatial Multithreading. Ela inclui um subsistema de memória de alta largura de banda construído sobre memória LPDDR5X e usa a segunda geração do NVIDIA Scalable Coherency Fabric para respostas agentivas mais rápidas sob condições de alta utilização.
Configurações do Sistema
- Novo rack de CPU Vera integra 256 CPUs Vera resfriadas a líquido
- Sustenta mais de 22.500 ambientes de CPU simultâneos executando independentemente com desempenho total
- Construído usando a arquitetura de referência modular NVIDIA MGX
- Parte da plataforma NVIDIA Vera Rubin NVL72 com GPUs NVIDIA conectadas via interconexão NVIDIA NVLink-C2C
- Fornece 1,8 TB/s de largura de banda coerente (7x a largura de banda do PCIe Gen 6)
- Também serve como CPU host para sistemas NVIDIA HGX Rubin NVL8
- Sistemas integram placas NVIDIA ConnectX SuperNIC e DPUs NVIDIA BlueField-4
Adoção e Parceiros
Clientes colaborando com a NVIDIA para implantar a CPU Vera incluem Alibaba, ByteDance, Meta, Oracle Cloud Infrastructure, CoreWeave, Lambda, Nebius e Nscale. Parceiros de fabricação incluem Dell Technologies, HPE, Lenovo, Supermicro, ASUS, Compal, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology (QCT), Wistron e Wiwynn.
Cargas de Trabalho Alvo
Sistemas Vera são projetados para aprendizado por reforço, inferência agentiva, processamento de dados, orquestração, gerenciamento de armazenamento, aplicações em nuvem e computação de alto desempenho. Parceiros de sistemas fornecem configurações de servidor com CPU de soquete duplo e soquete único.
De acordo com Jensen Huang, CEO da NVIDIA, "A CPU não está mais simplesmente apoiando o modelo; ela está conduzindo-o. Com desempenho e eficiência energética revolucionários, a Vera desbloqueia sistemas de IA que pensam mais rápido e escalam mais."
📖 Leia a fonte completa: HN AI Agents
👀 See Also

A Liquid AI lança o modelo LFM2.5-350M para loops agentivos
A Liquid AI lançou o LFM2.5-350M, um modelo de 350 milhões de parâmetros treinado para extração confiável de dados e uso de ferramentas. Tem menos de 500MB quando quantizado e supera modelos maiores como o Qwen3.5-0.8B na maioria dos benchmarks, sendo mais rápido e eficiente em memória.

Funcionários da Amazon zombam da IA da empresa no Slack e a chamam de 'Sloppenheimer'
Funcionários da Amazon têm um canal no Slack para memes zombando do produto de codificação de IA defeituoso da empresa, chamando sua saída de 'porcaria' e brincando sobre tentativas fracassadas de motivação com IA.

Primeiro GitHub Exclusivo para Agentes de IA Lançado: Beta Limitado para 100 Usuários
Uma exclusividade inovadora do GitHub para agentes de IA de codificação foi desenvolvida, com uma versão beta limitada para 100 usuários. Descubra como esta ferramenta está pronta para revolucionar a colaboração em IA.

Gemma 4 Sinais Iniciais: Adequação à Implantação Acima do Hype para Fluxos de Trabalho de Agentes Locais
O lançamento do Gemma 4 enfatiza a implantação em diferentes níveis de hardware, com posicionamento oficial para hardware pessoal e dispositivos de borda/móveis. A quantização NVFP4 da NVIDIA mostra compressão de 4x com retenção de 99,7% da linha de base no GPQA, e os rankings da Arena posicionam o modelo denso de 31B em torno da posição #27.