
AMD 임원, Nvidia의 Vera 성능 결과에 대해 '매우 기쁘다'고 언급 – '실제로는 우리가 더 적은 차이로 이기고 있다고 생각했다'
요약
AMD 임원이 Nvidia의 Vera CPU 성능 공개에 대해 환영하며, 자사의 차세대 Zen 6 'Venice' CPU가 SPEC 벤치마크에서 더 높은 우위를 점하고 있다고 주장했습니다. AMD는 Venice가 Vera 대비 처리량과 코어당 성능에서 앞선다는 분석을 내놓았습니다.
핵심 포인트
- AMD Venice CPU가 Nvidia Vera 대비 약 20%의 성능 우위를 점할 것으로 예상
- Venice는 Vera 대비 2.2배 높은 처리량과 1.2배 빠른 코어당 성능 주장
- 비교 데이터는 공식 SPEC 결과가 아닌 추정치(estimated) 기반임
- 코어 수와 TDP 차이로 인해 처리량 비교의 공정성 논란 가능성 존재
업계가 Nvidia라는 거대한 녹색 거인이 등장할 때 길을 비켜주는 법을 대체로 익혔지만, 한 AMD 임원은 Nvidia가 Advancing AI 2026 이벤트에 앞서 Vera CPU에 대한 SPEC CPU 2026 벤치마크 (benchmarks)를 공개한 것을 보고 “매우 기쁘다”고 말했습니다. AMD는 Nvidia의 백서(white paper)에 사용된 구성을 기반으로 자사의 새로운 Zen 6 ‘Venice’ CPU에서 SPEC을 실행했으며, 이를 통해 두 칩 간의 “동일 조건 (apples-to-apples)” 비교를 제공했습니다.
AMD의 컴퓨팅 및 엔터프라이즈 솔루션 부문 기업 부사장인 Ravi Kuppuswany는 “Nvidia가 자신들의 Vera 성능 [수치]를 공개하게 되어 매우 기쁩니다”라고 말했습니다. “우리는 사실 약간 보수적으로 접근하고 있었습니다. 실제로 저는 우리가 여기 있는 것보다 더 적은 차이로 그들을 이기고 있다고 생각했습니다... 우리는 최소 10%의 우위를 점할 것이라고 생각했습니다. 하지만 우리가 발견한 것은... 우리가 20%의 우위를 점하고 있으며, 아직 튜닝(tuning)을 완전히 마치지도 않았다는 것입니다.”

(이미지 출처: AMD)
Kuppuswany의 발언은 위에 보이는 슬라이드와 겹쳐져 있으며, Venice가 Vera와 비교했을 때 2.2배 더 높은 처리량(throughput)을 제공하고 코어당 성능(per-core performance)은 1.2배 더 빠르다고 주장합니다. AMD는 분명히 여기서 자신들에게 유리하게 상황을 설정했지만 (Nvidia가 처음 Vera 결과를 공개했을 때와 마찬가지로), 이 차트가 실제로 무엇을 의미하는지 살펴보겠습니다.
잠시 덧붙이자면, 위와 아래의 이미지에서 “추정치 (estimated)”라는 단어를 보게 될 것입니다. 이 수치들은 추측이 아니라 (실제 실행에 기반한 것이지만), SPEC은 “공식 (official)” 실행에 대해 엄격한 보고 가이드라인을 유지하고 있습니다. 그리고 이러한 실행 결과가 SPEC에 보고되지 않았고 따라서 공식적인 지위를 얻지 못했기 때문에, 반드시 “추정치 (estimated)”라는 면책 조항이 따라붙어야 합니다.
처리량 (throughput) 수치는 가장 명확하게 설명할 수 있는 부분입니다. AMD는 2P 구성에서 자사의 256코어, 600W Epyc 9996을 88코어 Vera와 비교했습니다. 네, 스레드 수가 두 배 이상 많고 TDP (열 설계 전력) 위에 150W가 추가된 CPU가 훨씬 더 높은 처리량을 보이는 것은 당연한 결과입니다.
AMD는 Nvidia가 Vera를 단일 88코어 SKU (Stock Keeping Unit)로만 제공한다는 점을 고려하면 공정한 비교라고 주장할 것입니다. 하지만 현실은 이 처리량 비교에서 Vera가 결코 이길 수 없다는 것이며, Nvidia는 256코어 Venice와의 경주에서 이기려는 것이 아니라고 주장할 것이고 (실제로 그렇게 주장해 왔습니다). Nvidia는 단일 목적을 위한 단일 CPU를 구축하고 있는 것입니다.
여기서 더 흥미롭고 중대한 수치는 코어당 성능 (per-core performance)입니다. SPECrate_int는 처리량 벤치마크 (throughput benchmark)입니다. 일반적인 실행 방식은 모든 스레드에 애플리케이션 복사본을 로드하고 정해진 시간 내에 얼마나 많은 작업이 수행되는지를 측정합니다. SPECspeed는 그 반대로, 단일 애플리케이션을 얼마나 빨리 실행할 수 있는지를 살펴봅니다. AMD는 전체 SPECrate_int 점수를 코어 수로 나누어 위의 수치들을 도출했습니다.

(이미지 출처: AMD)
Nvidia의 결과에 따르면 Vera는 전체 점수 925점을 달성했습니다. AMD는 96코어 High Frequency Epyc CPU가 1,210점을 달성했다고 말합니다. 하지만 이 프로세서는 존재하지 않는 것으로 보입니다. AMD에는 최대 5 GHz까지 부스트되는 96코어 Epyc 9686F가 있지만 (이는 제품군 전체의 표준 최대 주파수보다 훨씬 높습니다), 이 제품의 정격 TDP는 600W가 아니라 500W입니다.
어찌 되었든, AMD는 해당 점수를 코어 수로 나누었습니다. AMD는 약 6.3, Nvidia는 약 5.3입니다 (이것들이 2P 구성이라는 점을 기억하세요). AMD는 1.2배라고 말하는데, 이는 실제로 약 18.8%의 우위를 의미합니다. 이 정도 차이는 AMD가 악의적으로 자사의 수치를 부풀렸다고 말할 만큼 큰 차이는 아니지만, 주목할 만한 점입니다.
AMD가 여기서 두 개의 서로 다른 SKU를 사용하고 있다는 점을 고려하면 (또는 9686F의 불일치를 고려할 때 단 하나일 수도 있지만), 우리는 Epyc 9996을 Vera와 비교하여 동일한 코어당 산술 계산(napkin math)을 수행할 수 있습니다. 다시 한번, Nvidia는 925라는 전체 점수를 공유한 반면, Epyc 9996은 2,070의 점수를 달성했습니다. 이를 통해 AMD는 코어당 점수 4.04를 얻었습니다.
이 수치는 Nvidia와의 비교 지점으로서 중요한 것이 아니라 — 다시 말하지만, 우리는 256코어 CPU를 88코어 CPU와 비교하고 있습니다 — 그보다는 완전히 로드된 칩에서 코어당 성능으로 정규화했을 때 Venice가 어떻게 확장(scale)되는지를 확인하기 위한 지표로서 의미가 있습니다. 이는 성능을 높인 9686F의 코어당 점수보다 약 35% 낮습니다.
이러한 수치들을 분석하고 세계에서 가장 강력한 두 기업 간의 공방을 살펴보는 것은 흥미롭지만, 그것만으로는 많은 정보를 얻을 수 없습니다. SPEC이 엄격한 보고 요구 사항을 유지하는 데에는 이유가 있습니다. 공식적으로 보고된 실행 결과가 나오기 전까지는 이 칩들이 어떻게 맞붙는지 확실하게 말할 수 없습니다. 그리고 그 결과가 나온다 하더라도, 컴파일러 최적화(AMD와 Nvidia 모두 GCC 15.2를 사용함)라는 추가적인 요소와 이 칩들이 서비스하게 될 서버 및 워크로드(workload)라는 더 넓은 맥락이 존재합니다.
정수 기반 워크로드(integer-based workloads)를 기준으로 볼 때 전선은 이미 그어졌습니다. 벡터화된 성능(Vectorized performance) 또한 중요하며, 이는 현재 서버 CPU 시장에서 AMD가 강력한 위치를 점하고 있는 영역입니다. 아직 결론을 내릴 수 있는 부동 소수점(floating-point) 결과가 없기는 하지만, Vera가 나온다고 해서 이 상황이 바뀔 것 같지는 않습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Tom's Hardware의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기