기본 콘텐츠로 건너뛰기

베라 루빈 NVL72 시스템 성능 공개 - 토큰 생성량 10배 증가?






 (출처: 엔비디아)

엔비디아의 베라 루빈 시스템이 고객사에 전달되어 실제 가동에 들어가기 시작했다는 소식입니다. AI GPU 전문 클라우드 서비스 업체인 코어위브 (Coreweave)가 공개한 첫 번째 DeepSeek R1 테스트에서, 베라 루빈은 전작인 그레이스 블랙웰 대비 와트당 토큰 처리량을 10배 더 높이는 데 성공했습니다.

NVIDIA GB200 NVL72 Grace Blackwell 시스템은 150MW에서 초당 8만 토큰의 성능을 보인 반면 NVIDIA VR200 NVL72 Vera Rubin 플랫폼은 동일한 150MW 전력에서 초당 80만 토큰을 제공하여 MoE 워크로드에서 10배 빠른 성능 향상을 보였습니다.

베라 루빈은 단순한 CPU + GPU 조합이 아니리 포괄적인 AI 생태계를 구성하는 5단계 프레임워크를 구현한 다양한 하드웨어 및 소프트웨어 솔루션 세트입니다. 이 스택은 총 6개의 트레이로 구성되어 있으며, 세계에서 가장 진보된 칩들이 탑재되어 있습니다.

  • NVIDIA Vera Rubin NVL72 컴퓨트 트레이 (Rubin + Vera + Grace Bluefield + ConnectX-9)

  • NVIDIA Vera Rubin NVL72 NVLink 스위치 트레이(NVLink6 스위치)

  • NVIDIA Vera CPU 트레이(Vera)

  • NVIDIA Spectrum-6 SPX 스위치 트레이 (Spectrum-6 스위치)

  • NVIDIA Groq 3 LPX 트레이(Groq 3)

  • NVIDIA Vera Bluefield-4 STX 스토리지 트레이(Vera Bluefield)

베라 루빈 NVL72 시스템은 그레이스 블랙웰 GB200 NVL72 시스템보다 몇 배 고가이지만, (정확한 가격은 미공개) 대신 성능이 훨씬 우수해서 실제 서비스 비용을 크게 낮출 수 있습니다.

한편 엔비디아는 베라 루빈이 토큰 생성 뿐 아니라 에이전틱 AI 성능에서도 x86 서버 CPU를 압도한다고 주장했습니다. 엔비디아에 따르면 AMD 에픽 5세대 128코어 프로세서 대비 최대 6배 높은 성능과 40% 낮은 지연시간을 보여줍니다.

엔비디아는 베라 CPU를 Agentic AI(자율 에이전트 AI) 시대에 최적화된 CPU로 설계했습니다. 기존 x86 CPU(칩렛 기반)와 달리 모놀리식(monolithic) 디자인을 채택해 메모리 대역폭, 지연 시간, 코어 간 통신에서 큰 우위를 가집니다.

1. 주요 아키텍처 강점 (Olympus 마이크로아키텍처)

• IPC(Instructions Per Cycle): 최대 1.9배 향상 (싱글 스레드 성능이 Agentic AI에 매우 중요)

• Branch Prediction(분기 예측): 평균 2배, 최대 2.3배 빠름. Taken-branches per cycle은 3.5배 향상.

• Instruction Fetch / Decode: 최대 2.4배 향상.

• Backend Execution: 최대 4.3배 향상.

2. 메모리 및 지연 시간 성능

• 메모리 대역폭: 코어당 4배 이상 (Vera 88코어 기준, AMD EPYC 128코어보다도 우수)

• 메모리 지연 시간: 고부하 시 40배 낮은 피크 지연, 일관성도 훨씬 좋음.

• Core-to-Core Latency: 50% 낮음 (NUMA/칩렛 구조의 단점을 극복)

3. 실제 워크로드 벤치마크

• Python 실행: 최대 1.8배

• Graph Traversal: 2.6배

• Page Rank (그래프 알고리즘): 29.3배 (32코어 기준)

• ClickHouse (데이터 분석): 20% 향상

• 전체적으로 Agentic AI, RL(Reinforcement Learning), 그래프 처리, 데이터 분석 등에서 x86 대비 큰 우위를 보임.

NVIDIA는 AMD EPYC Turin(128코어)을 주 비교 대상으로 삼아, 코어 수가 적은 88코어 Vera가 오히려 더 나은 성능을 내는 점을 강조했습니다.

다만 이는 엔비디아의 주장인 만큼 실제 사용 환경에서 검증이 필요할 것으로 생각됩니다.

아무튼 올해 상반기에 생산에 들어간 베라 루빈이 이제 하나씩 고객사에 전달되어 실제 가동에 들어가고 있습니다. 그런데 이렇게 고성능 시스템이 대규모로 설치될 경우 공급 과잉에 대한 의구심이 다시 올라올 가능성이 있습니다. 실제 AI 서비스가 그만큼 수요가 있을지 앞으로 시장에서 검증을 거치게 될 것으로 생각합니다.

참고

https://wccftech.com/nvidia-vera-rubin-nvl72-enters-the-stage-with-a-monstrous-10x-uplift-in-ai-vs-blackwell/

https://wccftech.com/nvidia-vera-cpu-rolls-over-traditional-x86-chips-6x-faster-performance-in-agentic-ai/

댓글

이 블로그의 인기 게시물

벨 V-280 Valor 시험 비행 성공

( The V-280 Valor flew for the first time at Bell Helicopter's Amarillo Assembly Center in Texas(Credit: Bell Helicopter/YouTube) )  앞서 소개드린 V-280 발러가 첫 번째 비행 테스트에 성공했다는 소식입니다. V-22 오스프리의 소형화 버전이라고 할 수 있는 V-280 발러는  미 육군의 차세대 헬기 사업인 Future Vertical Lift (FVL)에 입찰을 시도하는 틸트로터기로 현재 미 육군이 주력으로 사용하는 블랙호크 헬기와 비슷한 체급입니다. 다만 틸트로터기인 만큼 최고 속도나 항속 거리면에서 더 유리합니다. 스펙은 이전 포스트를 참조해 주시기   이전 포스트:  https://blog.naver.com/jjy0501/221115245986  (동영상)   V-280 발러는 틸트로터기의 더 대중화 될 수 있을지를 검증하는 중요한 무대가 될 것입니다. V-22 오스프리의 경우 복잡한 구조로 인해 가격이 너무 비싸져서 사실 미국은 몰라도 그 동맹국에 널리 도입되기는 어려운 부분이 있습니다. V-280 역시 가격이 아주 저렴할 것 같지는 않지만, 좀 더 합리적인 대안은 될 수 있을 것 같습니다. 만약 성공적인 결과가 나오면 한국을 포함한 미국의 동맹국에서 도입을 검토할 수 있을지 모르겠다는 생각입니다.   참고  https://newatlas.com/bell-v-280-valor-maiden-flight/52663/

100 테슬라급 자기장 도달

 미국의 로스 알라모스 국립 연구소 (Los Alamos National Laboratory) 에서 과학자들이 지금까지 인간이 개발한 가장 강력한 자기장을 발생시키는 장치 개발에 도전하고 있습니다. 자기장의 세기를 나타내는 방법으로 자기력선의 밀도를 나타내기 위해 단위 면적당 자기력선의 수를 표시하는 단위인 테슬라 (T) 가 있습니다. (1T = 1Wb/㎡  웨버 (Wb) 는 자속의 단위)   의료용으로 사용되는 초전도체를 이용한 MRI 의 경우 1.5 - 3 테슬라급의 강력한 자기장으로 인체 내부를 볼 수 있게 만들지만 과학 연구용으로 이보다 더 강력한 자기장이 필요할 수 있습니다. 최근에 등장한 90 테슬라급 자기장에 이어 이번에 로스 알라모스 국립 연구소에서는 100 테슬라급인 100.75 T 를 실현 했다고 합니다.   이를 구현한 것은 18000 파운드 (8.16 톤 정도) 의 코일과 여기에 에너지를 공급할 1200 메가줄 (Megajoule) 급 모터 제네레이터등의 설비입니다.  (   The 1,200-megajoule motor generator that powers the magnetic pulse.  )  이와 같은 연구를 통해 알아내고자 하는 것은  Quantum Phase transitions and new ultra high field magnetic states Electronic Structure determination Topologically protected states of matter  로 요약할 수 있다고 합니다.   아무튼 수 T 급 MRI 만 해도 자기장의 힘이 엄청난데 100 T 라니 엄청난 자기장이네요. 이는 지구 자기장 세기보다 200만배 강력한 (물론 좁은 범위에서 작용하는 자기장이라 지구 전체...

고대 양서류 이야기 (2) - 악어를 닮은 거대 양서류들

  페름기에는 다양한 양막류가 진화해서 앞서 소개한 육상형 템노스폰딜리는 점차 설 자리를 잃게 됩니다. 하지만 양서류는 본래 자신의 서식지인 물과 습지에서 여전히 번성을 누렸습니다. 당시에는 악어류 같은 대형 양서형 파충류도 없던 시절이었기 때문에 이와 비슷한 생태학적 지위는 여전히 양서류의 몫이었습니다. 이들에 대한 이야기는 제 책인 포식자에서 비교적 간단히 다뤘는데, 오늘은 여기에 대한 보충 설명입니다.  책 정보:  http://book.naver.com/bookdb/book_detail.nhn?bid=13347200 Yes 24:  http://www.yes24.com/24/goods/58772859 11번가:  http://books.11st.co.kr/product/SellerProductDetail.tmall?method=getSellerProductDetail&prdNo=1977867160 알라딘:  http://www.aladin.co.kr/shop/wproduct.aspx?ItemId=134877825 교보문고:  http://www.kyobobook.co.kr/product/detailViewKor.laf?ejkGb=KOR&mallGb=KOR&barcode=9788970447988&orderClick=LAG&Kc= 인터파크 :  http://book.interpark.com/product/BookDisplay.do?_method=detail&sc.prdNo=279593764&sc.saNo=003002003&bid1=search_auto&bid2=detail&bid3=prd_img&bid4=001 영풍문고:  http://www.ypbooks.co.kr/book.yp?bookcd=100843205&gubun=NV ...