
Nvidia Vera CPU, SPECrate 2026에서 AMD Epyc 9755 대비 1.7배 성능 달성
요약
Nvidia의 신규 CPU Vera가 SPECrate 2026 벤치마크에서 AMD Epyc 9755 대비 약 1.7배의 성능을 기록했습니다. Vera는 에이전틱 AI 워크로드에 최적화된 커스텀 Olympus 코어를 탑재한 Nvidia의 첫 번째 CPU입니다.
핵심 포인트
- AMD Epyc 9755 대비 SPECrate integer 2026 성능 1.7배 달성
- 에이전틱 AI 워크로드 최적화를 위한 커스텀 Olympus 코어 적용
- 2026년 하반기 일반 출시(GA) 목표
- 기존 레거시 클라우드가 아닌 AI 인프라 확장 시장 겨냥
Nvidia의 Vera CPU는 AMD의 Epyc 9755와 비교했을 때, 듀얼 소켓 (dual-socket) 구성에서 SPECrate integer 2026 처리량(throughput)의 약 1.7배를 기록했습니다. Nvidia의 백서(white paper)에 따르면, Vera는 에이전틱 AI (agentic AI) 워크로드를 위해 설계된 커스텀 코어 디자인인 Olympus 코어를 탑합한 Nvidia의 첫 번째 CPU입니다.
주요 사실
- Vera는 AMD Epyc 9755 대비 1.7배의 SPECrate integer 2026 성능을 기록했습니다.
- 커스텀 Olympus 코어 디자인이 적용된 Nvidia의 첫 번째 CPU입니다.
- 2026년 하반기 (H2 2026) 일반 출시 (General availability)를 목표로 합니다.
- Meta에서의 Grace 단독 배포가 성공적이었음이 언급되었습니다.
- Vera는 기존의 레거시 클라우드 (legacy cloud)가 아닌 에이전틱 AI (agentic AI) 워크로드를 목표로 합니다.
Nvidia는 일반 출시(general availability)를 향해 속도를 내면서 Vera에 대한 더 많은 세부 정보를 서서히 공개하고 있으며, 이는 올해 하반기에 예정되어 있습니다. 이제 우리는 이 칩의 전체적인 모습을 파악할 수 있게 되었습니다. Nvidia는 Vera 백서와 함께, Vera를 AMD의 Turin 기반 Epyc 9755와 비교한 비공식 SPEC CPU 2026 결과Tom's Hardware에 따르면를 공유했습니다.
SPECrate integer 2026 결과
Nvidia는 정수 기반 (integer-based) 워크로드를 통한 시스템 처리량 (throughput)에 초점을 맞춘 SPECrate integer 제품군을 테스트했습니다. 두 칩 모두 듀얼 소켓 (dual-socket) 구성으로 실행되었습니다. Vera가 광범위한 출시 전에 레퍼런스 시스템 (reference system)에서 테스트되었기 때문에 이 실행 결과는 비공식적입니다. Nvidia는 소켓당 128개의 코어를 가진 Turin 기반 칩인 AMD의 Epyc 9755보다 약 1.7배의 처리량 우위를 보고했습니다. AMD는 아직 출시 예정인 Venice 칩에 대한 공식 SPEC CPU 2026 결과를 보고하지 않았습니다.
Olympus 코어 아키텍처 (architecture)
Vera는 클라우드 시장에서 AMD와 Intel의 점유율을 갉아먹기 위해 만들어진 칩이 아닙니다. 이는 하이퍼스케일러(hyperscalers)들이 기존의 레거시 클라우드(legacy clouds)를 넘어 AI 인프라를 확장하려 함에 따라, 확장되는 시장에서 점유율을 확보하기 위해 구축되었습니다. 따라서 Vera는 Nvidia의 x86 경쟁사들과는 매우 다른 방식으로 설계되었으며, 수많은 Arm 기반 설계들과 비교해도 독특한 아키텍처 설계 포인트를 보유하고 있습니다. Olympus 코어는 Nvidia의 첫 번째 커스텀 CPU 코어로, 추론(inference)을 위해 높은 메모리 대역폭(memory bandwidth)과 낮은 지연 시간(low latency)을 요구하는 에이전틱 AI(agentic AI) 워크로드에 최적화되어 있습니다.
배경 및 경쟁 (Context and competition)
Grace가 어느 정도 성공을 거두긴 했지만 — 가장 눈에 띄는 사례는 Meta에서의 Grace 단독 배포입니다 — Vera는 커스텀 코어 설계를 갖춘 Nvidia의 첫 번째 CPU입니다. 서버 CPU 시장은 에이전틱 AI(agentic AI) 수요를 바탕으로 폭발적으로 성장하고 있으며, Vera는 이상적인 시점에 등장했습니다. Nvidia는 데이터 센터 CPU 분야에서 AMD 및 Intel과 경쟁하지만, Vera는 Nvidia의 GPU 생태계가 독보적인 우위를 제공하는 AI 특화 세그먼트를 목표로 합니다. 앞서 발표된 Vera Rubin NVL72 랙 시스템은 Vera를 Nvidia의 차세대 GPU 아키텍처와 결합합니다.
핵심 요약 (Key Takeaways)
- Nvidia의 Vera CPU는 AMD Epyc 9755 대비 SPECrate integer 2026에서 1.7배의 성능을 기록했습니다.
- 에이전틱 AI(agentic AI)를 위한 첫 번째 커스텀 코어로, 2026년 하반기(H2 2026) 출시 예정입니다.
관전 포인트 (What to watch)
Vera가 2026년 하반기(H2 2026)에 일반 공급(general availability) 단계에 도달하면, Nvidia의 공식 SPEC CPU 2026 제출 결과를 주목하십시오. AMD의 Venice 칩이 자체 벤치마크로 대응할 수도 있습니다. 또한 Meta와 같은 하이퍼스케일러(hyperscalers)에서의 Vera Rubin NVL72 랙 시스템 배포 현황도 추적해 보시기 바랍니다.
출처: tomshardware.com
[21 Jul gn_gpu_cluster를 통해 업데이트]
Vera CPU와 Nvidia의 차세대 GPU를 결합한 Vera Rubin NVL72 시스템은 Blackwell GB200 NVL72 대비 10배의 토큰 처리량 (token throughput) 향상을 달성했습니다. Nvidia의 자체 벤치마크에 따르면 [Wccftech 인용], 동일한 150MW 전력 범위 내에서 Blackwell GB200 NVL72의 80,000 tokens/s 대비 800,000 tokens/s를 기록했습니다. 이는 해당 플랫폼을 에이전트형 AI (agentic AI) 워크로드의 추론 성능 분야에서 선두로 자리매김하게 합니다.
[22 Jul gn_gpu_cluster를 통해 업데이트]
CoreWeave는 Vera Rubin NVL72에 대한 첫 번째 측정된 실리콘 성능 통계를 발표했으며, 150MW에서 Blackwell GB200 NVL72 대비 10배의 토큰 처리량 (token throughput) 향상을 확인했습니다 [CoreWeave 인용]. OpenAI는 이미 2026년 3분기에 Vera Rubin 랙을 배치할 예정이며, Nvidia의 Engineering SuperLab은 800VDC 전력 공급을 통해 OpenAI 워크로드를 실행하는 시스템을 시연했습니다 [Tom's Hardware 인용]. 랙 규모의 공급망은 30개국 전역의 350개 이상의 공장 사이트에 걸쳐 있으며, 이는 Nvidia 역사상 가장 성숙한 생산 확대 (production ramp) 단계입니다 [HPCwire 인용].
원문 게시: gentic.news
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기