여러분, 혹시 최근에 AI에게 일을 시켜놓고 답답해서 결국 직접 처리하신 경험 있으신가요? 😅 2026년 6월, 타이베이 음악센터의 열기는 대만의 무더위보다 훨씬 뜨거웠는데요. 바로 컴퓨텍스 2026의 서막을 알리는 'NVIDIA GTC Taipei 2026' 기조연설 현장 때문이었습니다.
이 자리는 단순한 신제품 발표회가 아니었어요. 젠슨 황 CEO는 이제 AI가 묻는 말에 텍스트만 생성(Generative)하던 단계를 넘어, 스스로 도구를 사용하고 코드를 실행하며 결과를 평가하는 '유용한 AI(Useful AI)' 즉, '에이전틱(Agentic)' 시대로 완전히 전환되었음을 선포했습니다. 오늘 글에서는 The_Agentic_AI_Factory.pdf 백서와 발표 내용을 바탕으로, 우리의 일상을 통째로 바꿀 엔비디아의 엄청난 4가지 혁신을 살펴볼게요!
1. 인류가 아닌 'AI 에이전트'를 위한 최초의 CPU: NVIDIA Vera 🧠
지금까지 우리가 쓰던 CPU는 사람의 마우스 클릭이나 키보드 입력을 기다리도록 설계되어 있었어요. 하지만 AI 에이전트들은 수백만 번의 조건부 분기를 처리하고 샌드박스를 쉴 새 없이 돌려야 하죠. 12,000개의 GPU가 강화학습을 할 때 무려 400,000개의 CPU 코어가 필요할 정도로 'CPU 병목 현상'이 심각했습니다.
그래서 엔비디아는 백지상태에서 오직 에이전트만을 위한 프로세서, 'NVIDIA Vera'를 만들어버렸습니다! 자체 설계된 '올림푸스(Olympus)' 코어를 탑재해, 에이전트에게 독립적인 연산 자원을 배정하여 대기 시간을 획기적으로 줄인 것이 특징이에요.
| 구분 | NVIDIA Vera (Olympus 코어) | 기존 x86 하이엔드 CPU | 성능 향상도 |
|---|---|---|---|
| 코어 / 스레드 | 88코어 / 176스레드 | 모델별 상이 | 작업 완료 1.8배 빠름 |
| 메모리 대역폭 | 1.2 TB/s (LPDDR5X) | 약 0.4 TB/s 이하 | 코어당 대역폭 3배 증가 |
| 특화 기술 | 공간적 멀티스레딩 (결정론적 지연 시간) | 시분할 방식 SMT | 에이전트 샌드박스 최적화 |
이제 기업들은 서버를 구축할 때 칩의 가격이 아니라, '1달러당 토큰(Tokens per Dollar)'을 얼마나 효율적으로 뽑아낼 수 있는지를 기준으로 AI 팩토리를 평가하게 될 거예요.
2. 33년 만의 야망, 윈도우 PC 시장의 게임 체인저 'RTX Spark' 💻
이번 발표에서 제 눈을 가장 크게 의심하게 만든 소식입니다! 인텔과 AMD가 장악하고 있던 윈도우 PC 프로세서 시장에 엔비디아가 드디어 진출했어요. 미디어텍(MediaTek)과 손잡고 만든 'NVIDIA RTX Spark'가 그 주인공입니다.
젠슨 황이 "이 칩 하나를 완성하는 데 33년이 걸렸다"고 말할 정도로 기술의 집약체인데요. 20코어 Grace CPU와 최신 Blackwell RTX GPU를 하나로 묶어 무려 700억 개의 트랜지스터를 품고 있습니다[cite: 1]. 단순한 칩이 아니라, 내 곁에서 문서 작성부터 렌더링까지 자율적으로 수행하는 스타워즈의 'R2-D2' 같은 개인 에이전트가 내 컴퓨터 안으로 들어오는 것이죠!
3. 폭주하는 GPU의 식욕: 전력 공급의 한계를 돌파한 GaN ⚡
AI가 똑똑해질수록 전기를 어마어마하게 먹어 치운다는 사실, 다들 아시죠? 이제 서버 랙 하나당 필요 전력이 1MW(메가와트)까지 치솟을 전망입니다. 기존 실리콘 방식으로는 12kW 서버 보드에 필요한 250A의 엄청난 전류를 감당하다가 다 타버릴지도 모릅니다.
물리적 한계를 넘어선 마법, ISOP 컨버터 📝
- 문제점: 전류가 너무 세면 열이 발생하고 시스템이 녹아내립니다.
- 해결책: 전기차처럼 800V로 전압을 높여서 전류를 15A 수준으로 낮춥니다!
- 핵심 기술: EPC사의 저전압 질화갈륨(GaN) 기술을 적용해 800V를 12.5V로 직접 변환합니다.
이 기술 덕분에 97% 이상의 변환 효율을 달성하고도, 두께는 고작 8mm밖에 안 되는 컨버터를 만들 수 있게 되었어요. 좁은 서버 보드에도 쏙 들어가는 완벽한 공간 활용이죠!
4. AI 팩토리의 완성: 분업화와 파트너십 🤝
에이전트가 눈치 빠르게 일하려면 엄청난 양의 데이터를 지연 없이 읽고 써야 합니다. 이를 위해 마이크론(Micron)과 손을 잡았죠. HBM4 메모리는 대역폭을 2.8 TB/s 이상으로 늘리면서도 전력 효율은 20%나 개선했습니다.
그리고 추론 과정도 완벽한 분업화가 이루어집니다. 연산이 필요한 '어텐션(Attention)'은 GPU가 맡고, 극한의 대역폭이 필요한 '디코드(Decode)' 과정은 1,200 TB/s의 속도를 자랑하는 Groq LPU에 맡기는 식이죠. 개발자들은 Dynamo OS 위에서 복잡한 최적화 없이 이 거대한 하이브리드 인프라를 블랙박스처럼 쉽게 활용할 수 있게 되었습니다.
GTC 2026 에이전틱 AI 시대 요약
자주 묻는 질문 ❓
마무리: 새로운 시대의 동반자, 에이전틱 AI 📝
이번 GTC 2026 발표를 보면서, 저는 우리가 컴퓨터와 대화하고 일하는 방식이 완전히 새로운 차원으로 접어들었음을 확신하게 되었습니다.
단순히 질문에 답을 해주는 챗봇을 넘어, 내 의도를 파악하고 스스로 도구를 조합해 최종 결과물까지 뚝딱 만들어내는 '진짜 비서'가 생기는 셈이니까요.
특히 엔비디아가 PC의 두뇌부터 전원 공급의 물리적 한계까지 하드웨어의 모든 장벽을 깨부순 점은 정말 경이로울 정도입니다.
이제 우리의 책상 위에는 영화 속 R2-D2처럼 언제나 나를 돕기 위해 대기하는 든든한 파트너가 24시간 함께하게 될 것입니다.
만약 AI 에이전트가 여러분의 번거로운 문서 업무와 루틴을 완벽하게 대신해 준다면, 여러분은 그 남는 시간 동안 과연 어떤 새로운 것을 창조하시겠습니까?
여러분은 AI 비서에게 어떤 일을 가장 먼저 맡기고 싶으신가요? 글을 읽고 떠오른 재미있는 상상이나 궁금한 점이 있다면 언제든 댓글로 편하게 물어봐주세요~ 😊
ℹ️ 위 글은 투자 자문이나 투자 권유의 글이 아니며, 투자 판단의 최종 책임은 독자 본인에게 있음을 알려드립니다.



