[원문 유형] 네이버 프리미엄 콘텐츠 [채널] 올바른 미국주식 by SAPIENS [게시일] 2026.06.03. 오후 3:22 [원문 URL] https://contents.premium.naver.com/sapiens/sapiensasset/contents/260603152236408hq [제목] 엔비디아 컴퓨텍스 2026 : 사람을 위한 CPU의 시대를 넘어, GPU를 굶기지 않는 CPU 'Vera' [수집 기준] 승인된 구독 열람권으로 실제 본문을 보존했다. 이미지·첨부는 별도 미디어 원장에 보관하며 시각적 의미 검토 여부를 구분한다. [구독 원문 본문] ​ 안녕하세요 올바른입니다. ​ 엔비디아 COMPUTEX 2026 리뷰입니다. 지금까지의 모든 CPU는 사람을 위한 것이었고, Vera는 에이전트를 위한 첫 CPU라는 데에 의의가 있습니다. ​ 이전의 소프트웨어들을 다루던 컴퓨팅 방식에서, 이제는 모든 소프트웨어가 Agentic AI 워크플로우를 잘 다루는 컴퓨팅으로 전환되어가고 있습니다. ​ Vera CPU가 가진 고유한 다섯 가지 강점: ⓐIPC와 단일 스레드 성능, ⓑ코어당 메모리 대역폭, ⓒ시스템 대역폭, ⓓ전성비, ⓔ생태계의 이점을 짚어봤습니다. ​ 큰 흐름 읽기 (Bird's-eye view) 2026-05-27 LLM 추론 토큰 가격의 비밀 : MoE의 시대, 엔비디아 NVL72가 중요한 이유 (바로가기) 2026-04-22 엔비디아 CEO 젠슨황 인터뷰 : 'TPU도 Trainium도, 그렇게 자신 있으면 공개적으로 붙자' (바로가기) 2026-03-27 앤스로픽 CEO 다리오 아모데이 인터뷰 : "Extremely fast, but not infinitely fast" (바로가기) 2026-03-05 AI 사이클 한 눈에 보기, SemiAnalysis 인터뷰 : "거품은 없다. ARR $100B가 온다" (바로가기) 2025-10-08 오픈AI 퇴사자의 글 #1 : 2027년 AGI가 온다 (바로가기) 엔비디아 (NVDA) 2026-05-21 엔비디아 1Q26 실적발표 : 젠슨황, "하이퍼스케일러 CapEx보다 '더' 빠르게 성장" (바로가기) 2026-03-17 엔비디아 GTC 2026 : 7개의 칩, 5개의 랙 시스템, 그리고 하나의 AI 슈퍼컴퓨터 (바로가기) 2026-02-26 엔비디아 4Q25 실적발표 : 담백한 실적발표, 핵심은 모두 그린라이트 (바로가기) 2026-01-02 엔비디아가 $20B를 주고 데려온 남자 : Groq 창업자 조나단 로스의 통찰 (바로가기) 광학 (Optics) 2026-04-17 '빛💡'의 시대 : 광학 밸류체인 한 눈에 보기 (바로가기) 2026-03-20 OFC 2026 : 광학이 중요해지고 있는 이유들, 태풍의 눈에 있는 두 가지 기업 분석 (바로가기) 2026-03-13 AI 인프라의 새로운 병목 '광학' : 앞으로의 2~3년 가파른 채택곡선 (트랜시버, OCS, CPO) (바로가기) 2026-03-06 비아비 솔루션스(VIAV) 기업분석 : 광학의 시대, 더 많은 테스트가 필요해 (바로가기) 메모리 (Memory) 2026-03-19 마이크론 1Q26 실적발표 : 흔들릴 이유가 없는 어닝서프라이즈, 구조적 성장주로 거듭나기 (바로가기) 2026-01-21 추론의 시대, 핵심이 된 메모리 : 메모리 쇼티지를 떠받치고 있는 힘 (바로가기) 2026-01-07 엔비디아 CES 2026 : Vera Rubin의 시대, ICMS가 불러올 메모리 지각변동 (바로가기) 네오클라우드 (Neocloud) 2026-02-22 네오클라우드 뜯어보기 #2 : 새로운 시대의 AI 계급도, 전력을 돈으로 바꾼 Powered Shell (바로가기) 2026-02-10 네오클라우드 뜯어보기 : GPU 임대의 경제학, 네오클라우드 BIG 4 비교분석 (바로가기) 투자자문 서비스에 따른 투자 시 원금 손실이 발생할 수 있으며, 투자 손익에 대한 책임은 전적으로 고객에게 귀속됩니다. 또한 과거의 투자수익이 미래의 수익률을 보장하지 않습니다. ​ 신규 구독 전에, 아래 투자자문계약 권유문서의 계약 관련 제반 사항을 반드시 읽으시고 충분히 검토하시기 바랍니다. ​ *투자자문계약 권유문서 : https://naver.me/5ZST47Qf 목차 Agentic AI의 시대 : Agent = LLM + Harness 토크노믹스 : Compute is Revenue Vera CPU : Agentic AI에 가장 잘 맞는 CPU Agentic AI의 시대 Agent = LLM + Harness 쓸모 있는 AI, 돈이 되는 AI의 시대 Agentic AI의 시대가 도래했습니다. 이젠 AI에게 무언가를 물었을 때 답하는 챗봇 수준을 넘어서 실제로 생산적인 일을 해내는 AI를 뜻합니다. 그 첫 번째 대표 사례가 바로 소프트웨어 코딩입니다. 깃허브(GitHub)는 전 세계 개발자 대부분이 코드를 올리고 공유하는 플랫폼입니다. ​ 위 차트를 보시면 두 가지가 핵심입니다. Pull requests는 코드를 내려받아 수정하는 것을 의미하고, Commits은 수정한 코드를 다시 올리는 것입니다. 얼마나 코드를 작성했느냐의 기준으로는 주로 이 Commit 수가 개발 활동량을 보여주는 지표입니다. ​ 2023년 : 3억 건 2024년 : 4억 건 2025년 : 5억 건 2026년 초 : 14억 건입니다. ​ 이러한 의미를 젠슨 황식 계산으로 보자면 이렇습니다. 전 세계의 소프트웨어 전문 개발자는 3~4천만 명입니다. 이들의 연봉을 합치면 약 연간 $3T 규모입니다. 그리고 이 $3T의 인건비는 다른 산업을 움직이는 IT 인프라로서 작동하여 전체 $100T 규모의 전 세계 산업에 영향을 줍니다. 그런데 이제 같은 $3T를 주는데 거의 3배의 결과물이 만들어지고 있습니다. $3T의 인건비로 사실상 $9T 규모의 생산물을 뽑아내는 셈입니다. ​ AI가 일자리를 뺏는다고 하지만 현실은 반대입니다. 소프트웨어 엔지니어는 오히려 늘고 있습니다. 논리는 단순합니다. 이제 엔지니어 한 명을 고용하면 이전보다 3배에 가까운 일을 할 수 있기에 더 많이 뽑고 싶어하는 것입니다. 생산성 곡선이 평평했다면 사람을 줄였겠지만 결과물이 워낙 가파르게 나오니 더 많은 인력을 원하게 되는 효과입니다. ​ 산업적인 시각으로 본다면 토큰 수요의 폭증을 의미합니다. 이제 토큰은 매출을 만드는 단위가 됐고 돈이 되기 때문에 더 많은 AI 팩토를 짓습니다. 컴퓨팅 수요가 치솟고 관련 기업이 호황을 누리는 이유입니다. ​ 새로운 컴퓨팅 방식 : 에이전트(Agent) 이 모든 변화의 밑바탕에는 완전히 새로운 방식의 컴퓨팅 구조가 있습니다. ​ 예전의 방식 : OS 위에서 애플리케이션이 돌아가고, 그 안에서 코드가 실행되는 구조 새로운 방식 : 하나 혹은 여러 개의 LLM이 하네스(Harness) 안에 들어가 있고, 하네스는 LLM이 생산적인 일을 잘 할 수 있게끔 전체를 오케스트레이션(조율)해주는 구조 ​ 무언가 요청이 들어오면 에이전트는 이해하고, 관찰하고, 추론하고, 행동하고, 도구를 사용합니다. 여기서 '도구'란 스프레드시트, 크롬 브라우저, 데이터처리 엔진, 데이터베이스 등입니다. ​ LLM은 모든 종류의 생각을 담당하고, 하네스는 마치 이전의 OS처럼 모든 것을 연결하고 오케스트레이션합니다. 구체적으로 보자면 하네스에서는 정보가 오갈 때마다 지금 무슨 상황인지를 파악하고, 무엇을 할지를 추론하고, 실행 계획을 수립하고, 실행하는 경로를 짭니다. 이러한 작업 구조를 에이전트라고 부릅니다. ​ 핵심은 컴퓨터를 다루는 방식 자체가 바뀐다는 것입니다. 예전에는 앱을 실행하고, 클릭하고, 타이핑했습니다. 이제는 AI에게 내가 어떤 작업물을 원하는지 의도를 설명하면 알아서 코드를 짜주고, 도구를 사용해 결과물을 만들어냅니다. 이것이 앞으로 인류가 컴퓨터와 함께 일하는 방식입니다. ​ 에이전트 = 궁극의 분산형 컴퓨팅 모델 그렇다면 Agentic AI로 인해 소프트웨어가 어떻게 작동하는지가 곧 앞으로의 컴퓨팅 시스템이 어떻게 바뀌느냐와도 같습니다. 그런데 이 에이전트는 컴퓨팅 패턴 자체가 다릅니다. 분산형 컴퓨팅(disaggregated) 모델의 시작입니다. 작업 하나를 처리하기 위해 수많은 서로 다른 유형의 컴퓨터가 동시에 작동해서 처리하는 모델입니다. ​ 에이전트는 ⓐ모델 ⓑ하네스 ⓒ도구 ⓓ런타임으로 이루어져 있습니다. 모델은 두뇌와 같고, 하니스는 두뇌의 지시를 실행에 옮기는 틀 느낌으로 몸통과 같으며, 도구와 런타임은 실제 일을 처리하는 공간과 도구입니다. 이 요소들은 AI 팩토리(=데이터센터) 안의 서로 다른 위치에서 따로따로 돌아갑니다. ​ LLM이 생각할 때 → GPU 도구를 사용할 때 → ​CPU, GPU 전체의 모든 작업 지휘/조율 → CPU ​ 그리고 이 구조에서 가장 까다로운 부분이 메모리입니다. 에이전트는 이 과정에서 사람처럼 단기기억(작업기억)과 장기기억을 함께 다루기에 메모리 관리 시스템이 대단히 중요합니다. KV cache를 ms 단위로 담아둘 HBM > 수 초 단위로 담아둘 DRAM > 몇 분 단위로 담아둘 SSD > 1시간 단위로 담아둘 HDD 구조에 맞춰서 어떤 것을 기억하고, 어떻게 압축할 것이며, 어떻게 다시 꺼내올 것인가를 생각해야 합니다. 토크노믹스 Compute is Revenue "Compute is Revenue" AI 시대에는 컴퓨팅 그 자체가 곧 매출입니다. AI 팩토리가 만들어내는 토큰이 하나하나 다 돈이 되기 때문입니다. 토큰을 많이, 빠르게, 효율적으로 뽑아낼수록 매출과 이익이 높아집니다. 반대로 놀고 있는 컴퓨팅, 멈춰있는 설비는 그대로 손실입니다. 요즘 말씀드리는 것처럼 이미 엄청난 산업이 됐기 때문에 이제부터는 무언가를 구현하느냐 못하느냐가 문제가 아니라 투자 대비 얼마나 회수하느냐가 가장 중요합니다. ​ AI 팩토리의 수익성은 네 가지로 결정됩니다: ​ 얼마나 빨리 가동되는가 → TTFI(Time-to-First-Inference) *요청 단위로는 TTFT를 더 많이 쓰긴 합니다* 와트당 토큰을 얼마나 뽑아내는가 → Token/Watt 멈추지 않고 안정적으로 돌아가는가 → MTBI(Mean Time Between Interruptions) 얼마나 오랫동안 쓸모있는가 → Useful Life ​ 가동 속도 - TTFI : 첫 추론까지 걸리는 시간 고객사 입장에서 AI 인프라는 장비를 들여놓는다고 끝나는 문제가 아닙니다. 실제로 중요한 것은 클러스터가 설치된 뒤, 훈련이나 추론 작업을 통해 첫 번째 Production Token이 나오기까지 얼마나 걸리느냐입니다. 즉, 하드웨어 구매 시점이 아니라 실제 매출과 서비스로 연결되는 시점까지의 시간이 핵심입니다. ​ 이 관점에서 엔비디아의 강점은 단순히 GPU를 잘 만드는 데 있지 않습니다. 엔비디아는 개별 칩을 판매하는 기업이라기보다 AI 데이터센터 전체를 하나의 시스템으로 설계한 뒤 이를 서버, 네트워킹, 전력, 냉각, 소프트웨어, 랙 단위 인프라로 분해해 공급망 기업들과 함께 제품화하는 기업입니다. ​ GPU가 실제 데이터센터 안에서 어떻게 연결되고, 어떻게 통신하고, 어떻게 냉각되고, 어떻게 스케줄링되며, 어떻게 대규모 클러스터로 작동하는지까지 통째로 공동 설계합니다. 그리고 이 구조를 실제로 수많은 고객사 환경에서 반복적으로 배포하고 검증해왔습니다. 데이터센터 투자 회수 기간과 직결되는 경제적 장점입니다. ​ *SemiAnalysis에 따르면, AMD의 첫 랙 스케일 제품인 MI450X(Helios 랙)은 출시 및 매출인식은 2H26이지만 사실 고객사 입장에서 가장 중요한 Production Token이 나오는 시점은 1Q27쯤 예정입니다. 이걸 공식적으로 말하진 못하지만 TTFI를 집어넣은 데에는 이것을 강조하고자 하는 함의가 있어 보입니다. ​ 전력 효율 - Token/Watt : 와트당 토큰이 곧 매출 AI 팩토리의 한계는 전력입니다. 1GW 데이터센터는 1GW가 전부입니다. 전력이 고정되어 있다면 같은 와트로 토큰을 얼마나 뽑아낼 수 있는가가 곧 매출을 결정합니다. 즉, 하이퍼스케일러 입장에서는 (ㄱ) 올해 온라인 가능한 GW x (ㄴ) Tokens per Watt = (ㄷ) 올해에 더해질 증분 매출입니다. ​ 고객사 입장에서는 단순히 칩이 싸다는 이유만으로 아키텍처를 선택하기 어렵습니다. 초기 장비 가격은 아끼지만 전력당 토큰 생산량이 낮으면 장기적으로는 오히려 손해가 될 수 있기 때문입니다. ​ 신뢰성 - MTBI : 얼마나 오래 멈추지 않고 돌릴 수 있는가 데이터센터 안에는 수백만 개의 케이블, 서버, 스위치, NIC, 전원장치, 냉각장치 등 수많은 부품이 동시에 맞물려 돌아갑니다. 개별 부품의 MTBF(평균 무고장 시간)을 높이는 것도 중요하지만, 현실적으로 모든 부품의 신뢰성을 무한정 끌어올릴 수는 없습니다. 일정 수준을 넘어가면 비용 대비 효과가 급격히 떨어지고, 설령 개별 부품의 신뢰성을 크게 높인다 해도 클러스터 전체 규모가 워낙 크기 때문에 전체 시스템이 1년 내내 아무 문제 없이 돌아가는 것은 사실상 불가능합니다. ​ 그래서 고객사 입장에서 더 중요한 지표는 개별 부품의 MTBF가 아니라, 클러스터 단위의 MTBI입니다. MTBI는 한 번 가동이 중단된 뒤 다음 중단이 발생하기까지 걸리는 평균 시간을 의미합니다. 다시 말해, 고객이 실제로 체감하는 신뢰성은 '부품 하나가 얼마나 오래 버티느냐'보다 '전체 AI 클러스터가 얼마나 오랫동안 의미 있는 중단 없이 계속 훈련/추론 작업을 수행할 수 있느냐'입니다. ​ 좋은 부품을 많이 넣는다고 해결되진 않습니다. 대규모 AI 클러스터에서는 GPU, 네트워크, 스토리지, 전력, 냉각, 스케줄링 소프트웨어, 장애 감지 및 복구 시스템이 모두 하나의 유기적인 시스템처럼 움직여야 합니다. 특정 노드나 링크에 문제가 생겼을 때 작업을 얼마나 빠르게 우회하고, 장애를 얼마나 빨리 감지하며, 전체 학습 작업을 얼마나 적은 손실로 재개할 수 있는지가 핵심입니다. ​ 이 영역에서는 엔비디아처럼 초대형 AI 클러스터를 오랫동안 운영해온 기업의 경험이 중요한 차별점이 됩니다. 하드웨어 설계, 네트워킹 구조, 시스템 소프트웨어, 클러스터 운영 노하우가 축적될수록 단순한 부품 성능을 넘어 멈추지 않고 계속 돌아가는 AI 인프라를 만들 수 있기 때문입니다. ​ 자산 수명 - Useful Life : 얼마나 오래 쓸모 있는가 AI 인프라에서 가장 판단하기 어려운 부분은 자산의 유효 수명입니다. GPU나 서버를 한 번 구매했다고 해서 그 설비가 내구연한 6년 동안 동일한 경제성을 유지한다는 보장이 없습니다. AI 소프트웨어와 모델 구조가 너무 빠르게 바뀌기 때문입니다. 앞으로 등장할 새로운 워크로드에도 얼마나 유연하게 대응할 수 있느냐도 중요하다는 의미입니다. 아키텍처가 폐쇄적이거나 소프트웨어 생태계가 빈약하다면 그 설비가 3년 뒤에도 충분히 쓸모 있을지 예측하기 어렵습니다. 특정 모델이나 특정 연산 방식에는 효율적이더라도 AI의 방향이 바뀌는 순간 활용도가 빠르게 떨어질 수 있기 때문입니다. ​ 엔비디아 시스템은 이미 전 세계 AI 인프라에 광범위하게 깔려 있고, 개발자 생태계도 CUDA를 중심으로 형성되어 있습니다. 새로운 모델, 라이브러리, 프레임워크, 최적화 기법이 나올 때도 대부분 엔비디아 환경을 우선적으로 지원합니다. 시장점유율의 문제가 아니라 자산이 오래 쓸모 있게 남을 가능성을 높여주는 구조적 장점입니다. ​ Vera CPU Agentic AI에 가장 잘 맞는 CPU 에이전트 시대를 위한 첫 CPU, "베라(Vera)" "지금까지의 모든 CPU는 사람을 위해 만들어졌다. Vera는 에이전트를 위해 만들어진 최초의 CPU이다" 젠슨 황, COMPUTEX 2026 Keynote 中 기존 데이터센터에서 CPU는 사람이 요청한 작업을 처리하고 여러 사용자가 나눠서 쓰는 범용 컴퓨팅 자원이었습니다. 서버 한 대에 최대한 많은 코어를 넣고, 이를 가상화해서 시간 단위로 임대하는 방식이 중요했습니다. ​ 하지만 Agentic AI는 에이전트가 스스로 도구를 호출하고, 데이터베이스에 접근하고, 코드를 실행하고, 외부 시스템을 확인하고, 여러 단계의 추론을 반복합니다. 이 과정에서 GPU는 토큰을 생성하지만 그 GPU가 쉬지 않고 일하게 만들기 위해서는 CPU가 뒤에서 모델 실행 흐름을 조율하고, KV cache를 관리하고, 데이터와 스토리지를 빠르게 연결하고, 수많은 툴 호출을 지연 없이 처리해야 합니다. ​ AI 팩토리의 경제성은 결국 단위 시간당 얼마나 많은 토큰을 생성할 수 있느냐에서 결정됩니다. 그리고 토큰은 GPU에서 만들어집니다. 따라서 CPU는 GPU 앞을 가로막으면 안 됩니다. CPU가 느리면 GPU가 대기하게 되고, GPU가 대기하면 토큰 생산량이 줄고, 토큰 생산량이 줄면 AI 팩토리의 ROI가 떨어집니다. 이 관점에서 CPU는 더 이상 부수적인 부품이 아니라 가장 비싼 자산인 GPU의 활용률을 결정하는 핵심 인프라입니다. ​ 이 배경에서 Vera를 정의하는 특성은 다섯 가지입니다: ​ 첫째, IPC와 단일 스레드 성능 Agentic AI에서는 지연시간이 매우 중요합니다. 에이전트가 툴을 호출하고, 코드를 실행하고, 데이터베이스를 조회하고, 다음 행동을 결정하는 과정은 짧은 작업이 연속적으로 이어지는 구조입니다. 이런 워크로드에서는 단순히 코어 수를 많이 늘리는 것만으로는 충분하지 않습니다. 각각의 작업을 빠르게 처리하는 단일 스레드 성능이 중요합니다. ​ Vera는 GPU 옆에서 즉각적으로 반응해야 하는 CPU이기에 클럭당 더 많은 명령어를 가져오고, 해독하고, 실행할 수 있도록 설계됐습니다. 젠슨 황은 이를 클럭당 10개의 명령어를 처리할 수 있는 구조라고 설명했습니다. ​ 둘째, 코어당 메모리 대역폭 CPU 코어가 아무리 빠르더라도 필요한 데이터가 제때 들어오지 않으면 성능은 나오지 않습니다. 에이전트는 메모리에 접근하고, 데이터베이스를 조회하고, 스토리지에서 문서를 불러오고, GPU와 데이터를 주고받고, 때로는 샌드박스 환경에서 코드를 실행합니다. ​ 이때 중요한 것은 단순한 총 대역폭이 아니라 각 CPU 코어가 실제로 사용할 수 있는 대역폭입니다. 코어 수만 많고 코어당 데이터 공급이 부족하면 많은 코어가 동시에 굶는 상황이 생깁니다. Vera CPU의 코어당 메모리 대역폭은 13.6GB/s입니다. 반면 AMD Turin은 3.2GB/s, Intel Granite Rapids는 6.6GB/s입니다. Vera는 코어당 메모리 접근 능력에서 AMD 대비 약 4.3배, Intel 대비 약 2.1배 높습니다. ​ 셋째, 전체 시스템의 대역폭 Agentic AI 시스템은 본질적으로 분산형입니다. 하나의 거대한 칩 안에서 모든 일이 끝나는 것이 아니라, CPU, GPU, 메모리, 스토리지, 네트워크, 데이터베이스, 외부 툴이 계속 연결됩니다. 컴퓨팅이 분산될수록 가장 큰 병목은 네트워크와 데이터 이동입니다. 내부와 외부의 대역폭이 매우 중요하단 의미입니다. ​ CPU 코어끼리 빠르게 통신해야 하고, CPU와 GPU 사이도 빠르게 연결돼야 하며, CPU와 스토리지 사이에서도 병목이 없어야 합니다. 에이전트가 여러 작업을 동시에 수행하고, 실시간 데이터를 처리하고, 긴 컨텍스트와 외부 데이터를 계속 참조하려면 CPU 주변의 데이터 이동 능력이 가장 중요합니다. ​ 넷째, 에너지 효율 전력이 고정되어 있는 데이터센터 클러스터 특성상 같은 전력 안에서 얼마나 많은 토큰을 생산하느냐가 경제성을 결정합니다. 구리를 광으로 바꾸고 CPO를 도입하는 것도 에너지 효율 차원에서 개선하기 위함이기도 합니다. 1GW에 네트워킹이 가져가는 전력의 점유율이 줄어들면 그만큼 컴퓨팅을 더 많이 넣을 수 있고 더 많은 토큰을 생산하여 ROI를 높일 수 있기 때문입니다. ​ Vera가 Arm 기반 CPU + LPDDR 메모리 조합을 쓰기에 전성비가 가장 좋습니다. x86에 비해서 ARM 조합이 전성비가 좋고, 일반적인 서버 CPU는 DDR 메모리를 중심으로 설계되지만 LPDDR은 모바일/저전력 환경에서 발전해온 메모리이기 때문에 전성비가 좋은 조합입니다. ​ 다섯째, 이미 검증된 생태계 성능만큼 중요한 것이 검증된 생태계입니다. 데이터센터 CPU는 단순히 성능이 좋다고 바로 대규모로 채택되는 제품이 아닙니다. 클라우드, 엔터프라이즈, 보안 스택, 운영체제, 가상화, 컨테이너, AI 프레임워크, 스토리지, 네트워킹까지 모두 검증을 거쳐야 합니다. ​ 엔비디아는 이미 중요한 전환을 한 번 성공시켰습니다. Grace Blackwell 전환 당시 가장 큰 리스크는 외부 x86 CPU에서 엔비디아의 Grace CPU로 넘어가는 것이었습니다. GPU는 엔비디아가 원래 강한 영역이었지만 CPU를 자체 플랫폼 안으로 끌어들이는 것은 훨씬 어려운 일입니다. 고객 입장에서는 소프트웨어 호환성, 보안 검증, 운영 안정성, 장애 대응, 기존 인프라와의 통합을 모두 다시 확인해야 하기 때문입니다. ​ 엔비디아는 이 전환을 상당 부분 완료했습니다. 그리고 Vera는 이 기반 위에서 출발합니다. 완전히 낯선 CPU 생태계를 처음부터 설득해야 하는 것이 아니라 이미 Grace를 통해 엔비디아 CPU를 검증한 고객들에게 다음 세대 CPU로 들어가는 구조입니다. 이 점이 Vera의 숨은 강점입니다. ​ 실제 성능 향상 사례 : SQL 3배, 실시간 데이터 스트리밍 6배 x86 CPU로 쓰이던 워크로드에서 의미 있는 성능 향상을 보였습니다. ​ SQL 3배 속도 향상 → SQL은 세계에서 가장 널리 쓰이는 데이터베이스의 엔진입니다. 기업 데이터베이스, 분석 시스템, 애플리케이션 백엔드, 금융 시스템, 클라우드 서비스 대부분이 SQL 기반 워크로드를 사용합니다. 매우 성숙한 영역이기 때문에 SQL 성능을 5%나 10% 개선하는 것도 쉽지 않습니다. 아마 3배 개선은 엔비디아가 제시한 특정 조건의 워크로드 기준으로 봐야 하겠지만 어쨌든 에이전트에 특화된 CPU임을 실질 지표로 확인해주는 값입니다. 에이전트가 기업의 업무를 자동화하려면 데이터베이스와 연결될 수밖에 없는데 이를 매우 빠르게 가져와주는 최적의 CPU가 Vera라는 게 주요 메시지입니다. ​ 데이터 실시간 처리 6배 향상 → 앞으로 AI는 저장해둔 문서만 읽는 게 아니라 공장이나 거래소에서 실시간으로 들어오는 데이터도 처리해야 합니다. 이런 실시간 데이터 처리도 Vera CPU가 우수하다는 것입니다. ​ 주요 구매자 목록 AI Labs : 오픈AI, 앤스로픽, 스페이스X(xAI) 클라우드 : 네비우스, 오라클, 코어위브, 엔스케일, 크루소, 람다 등