NVIDIA 베라 CPU, 에이전트 AI 워크로드를 위해 출시

✍️ OpenClawRadar📅 게시일: March 17, 2026🔗 Source
NVIDIA 베라 CPU, 에이전트 AI 워크로드를 위해 출시
Ad

NVIDIA가 에이전트 AI 및 강화 학습 워크로드를 위해 특별히 제작된 프로세서인 Vera CPU를 선보였습니다. NVIDIA에 따르면, 이는 기존 랙 규모 CPU 대비 50% 더 빠른 성능과 두 배의 효율성으로 결과를 제공합니다.

기술 사양

Vera CPU는 NVIDIA가 자체 설계한 88개의 Olympus 코어를 탑재하고 있으며, 각 코어는 NVIDIA Spatial Multithreading을 사용하여 두 가지 작업을 동시에 실행할 수 있습니다. LPDDR5X 메모리를 기반으로 한 고대역폭 메모리 서브시스템을 포함하며, 높은 활용률 조건에서 더 빠른 에이전트 응답을 위해 2세대 NVIDIA Scalable Coherency Fabric을 사용합니다.

시스템 구성

  • 새로운 Vera CPU 랙은 256개의 수냉식 Vera CPU를 통합합니다
  • 22,500개 이상의 동시 CPU 환경이 독립적으로 최고 성능을 유지하며 실행됩니다
  • NVIDIA MGX 모듈식 참조 아키텍처를 사용하여 제작되었습니다
  • NVIDIA Vera Rubin NVL72 플랫폼의 일부로, NVIDIA GPU는 NVIDIA NVLink-C2C 상호 연결을 통해 연결됩니다
  • 1.8 TB/s의 일관된 대역폭을 제공합니다(PCIe Gen 6 대역폭의 7배)
  • NVIDIA HGX Rubin NVL8 시스템의 호스트 CPU 역할도 수행합니다
  • 시스템은 NVIDIA ConnectX SuperNIC 카드와 NVIDIA BlueField-4 DPU를 통합합니다
Ad

도입 및 파트너

Vera CPU를 배포하기 위해 NVIDIA와 협력 중인 고객사로는 Alibaba, ByteDance, Meta, Oracle Cloud Infrastructure, CoreWeave, Lambda, Nebius, Nscale가 있습니다. 제조 파트너로는 Dell Technologies, HPE, Lenovo, Supermicro, ASUS, Compal, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology (QCT), Wistron, Wiwynn이 포함됩니다.

대상 워크로드

Vera 시스템은 강화 학습, 에이전트 추론, 데이터 처리, 오케스트레이션, 스토리지 관리, 클라우드 애플리케이션, 고성능 컴퓨팅을 위해 설계되었습니다. 시스템 파트너사는 듀얼 및 싱글 소켓 CPU 서버 구성을 모두 제공합니다.

NVIDIA CEO 젠슨 황은 "CPU는 더 이상 단순히 모델을 지원하는 것이 아니라 모델을 주도하고 있습니다. 획기적인 성능과 에너지 효율성으로 Vera는 더 빠르게 생각하고 더 널리 확장되는 AI 시스템을 가능하게 합니다."라고 말했습니다.

📖 Read the full source: HN AI Agents

Ad

👀 See Also

SDNY 판결, AI 채팅 대화에 대한 변호사-고객 특권 인정 거부
News

SDNY 판결, AI 채팅 대화에 대한 변호사-고객 특권 인정 거부

라코프 판사는 미국 대 헵너 사건에서 ChatGPT와 같은 AI 도구와의 커뮤니케이션이 변호사-의뢰인 특권에 해당하지 않으며, 모든 AI 생성 법률 작업의 공개를 요구한다고 판결했습니다. 법원은 AI가 특권 보호에 필요한 인간 간 기밀성을 결여하고 있다고 판단했습니다.

OpenClawRadar
액체 AI, 에이전트 루프를 위한 LFM2.5-350M 모델 출시
News

액체 AI, 에이전트 루프를 위한 LFM2.5-350M 모델 출시

Liquid AI가 신뢰할 수 있는 데이터 추출과 도구 사용을 위해 훈련된 350M 파라미터 모델인 LFM2.5-350M을 출시했습니다. 양자화 시 500MB 미만의 크기로, 대부분의 벤치마크에서 Qwen3.5-0.8B와 같은 더 큰 모델을 능가하면서도 더 빠르고 메모리 효율적입니다.

OpenClawRadar
全职AI工程师:不再触碰代码
News

全职AI工程师:不再触碰代码

Max Heyer는 에이전트가 모든 코드를 작성하고, 자신은 diff만 읽고 스펙을 작성하며 리뷰하는 워크플로우를 설명합니다. 중요한 기술은 취향(taste)입니다 — 코드를 평가하는 것이 작성하는 것보다 더 어렵기 때문입니다.

OpenClawRadar
클로드 오푸스 4.7 분석: 최고 수준의 지능, 그러나 높은 비용과 장황함
News

클로드 오푸스 4.7 분석: 최고 수준의 지능, 그러나 높은 비용과 장황함

클로드 오푸스 4.7(적응형 추론, 최대 노력)은 인공 분석 지능 지수에서 57점을 받아 133개 모델 중 지능 부문 1위를 차지했지만, 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러로 평균보다 상당히 비쌉니다.

OpenClawRadar