AI 에이전트 시대에 접어들며 반도체 수요의 무게중심이 GPU에서 CPU로도 번지고 있습니다. 챗봇과는 다른 에이전트의 연산 구조를 확인된 숫자로 짚어봅니다.

GPU 랠리인데 왜 CPU 회사가 더 뛰었나
2026년 9월 21일(현지시간) 뉴욕 증시에서 메타가 11.43% 오른 741.24달러에 마감하는 동안, AMD는 9.95%, 인텔은 12.14%, Arm은 13% 뛰었습니다. 정작 GPU 대표 기업인 엔비디아는 2.3% 오르는 데 그쳤고, 반도체 ETF SOXX는 3% 상승했습니다. 5거래일 누적으로는 격차가 더 뚜렷합니다. Arm 24%, AMD 14%, 인텔 13%인 반면 엔비디아는 4.5%에 그쳤고, 다음 날 한국 증시에서도 삼성전자·SK하이닉스가 2% 이상 올랐습니다.
계기는 메타의 AI 에이전트 앱 '뮤즈'의 흥행이었습니다. 뮤즈 자체의 흥행 배경과 개인정보 논란은 이전 글에서 다뤘으므로 반복하지 않습니다. 이번 글의 질문은 다릅니다. 왜 GPU 회사가 아니라 CPU 회사들이 더 크게 올랐는가, 그 이유가 AI 에이전트라는 소프트웨어의 연산 구조 자체에 있는가입니다.
챗봇과 에이전트의 연산 흐름이 어떻게 다른가
챗봇에 질문을 던지면 GPU가 답을 생성하고 요청이 끝납니다. 초 단위로 끝나는 단발성 작업입니다. 반면 에이전트는 계획을 세우고, 도구를 호출하고, 결과를 확인하고, 필요하면 다시 시도하는 과정을 반복합니다. 이 순환은 분 단위, 길게는 시간 단위로 이어집니다.
메타 공식 리서치 블로그(2026-09-08)에 따르면 뮤즈는 사용자마다 격리된 클라우드 가상머신을 배정받고, 별도 에이전트 'Sentinel'이 외부 작업 승인을 전담합니다. 글로벌이코노믹(2026-09-22)은 앱을 닫아도 이 가상 환경이 계속 켜져 있으며, 배경 작업과 브라우저 자동화·API 호출은 GPU가 아니라 CPU의 영역이라고 설명했습니다.

| 단계 | 챗봇 | 에이전트 | 담당 자원 | 소요 시간대 |
| 요청 접수 | 질문 입력 | 목표 입력 | CPU | 즉시 |
| 핵심 처리 | 추론으로 답변 생성 | 계획 수립(추론) | GPU | 초 단위 |
| 실행 | 응답으로 종료 | 도구 호출(브라우저·API) | CPU | 초~분 |
| 확인 | 없음 | 결과 확인·오류 판단 | CPU | 초 단위 |
| 반복 | 없음 | 재시도·다음 단계로 순환 | GPU+CPU | 분~시간 |
| 대기 상태 | 세션 종료 | 가상머신 상시 유지 | CPU·메모리 | 지속 |
왜 CPU인가
에이전트가 하는 일 중 상당수는 사실 AI 모델의 추론이 아닙니다. 어떤 도구를 부를지 정한 다음에는 그 도구를 실제로 실행하고, 결과를 다음 단계로 넘기고, 오류가 나면 처리하는 오케스트레이션이 필요합니다. 이 오케스트레이션과 도구 실행, 상태 관리, 입출력(I/O)은 인공지능 연산이 아니라 전통적인 소프트웨어 실행이며 예전부터 CPU가 해온 일입니다.
즉 GPU는 '무엇을 할지 계획하는' 짧은 구간만 담당하고, 그 계획을 실제 세계(앱, 웹, API)로 옮기고 지켜보는 훨씬 긴 구간은 CPU가 맡습니다. 사용자가 늘수록 늘어나는 것은 GPU 연산량만이 아니라, 동시에 떠 있는 가상머신 수와 그 안에서 도는 CPU 작업량입니다.
숫자로 보는 신호
여러 기업의 발언이 같은 방향을 가리킵니다.
- Arm CEO 르네 하스는 올해 6월 컴퓨텍스 기조연설에서 에이전트 AI 확산 시 같은 전력 조건에서도 데이터센터 CPU 코어 수가 지금의 4배 이상으로 늘 수 있다고 말했습니다. 경쟁 기준이 칩 성능에서 전력당 연산 효율로 옮겨간다는 설명도 덧붙였습니다.
- AMD 리사 수 CEO는 올해 3월 "AI 애플리케이션 확대와 함께 서버 CPU 수요가 예상보다 훨씬 강하다"고 밝혔습니다.
- 인텔 립부 탄 이사회 의장은 "인텔은 선두 AI 모델 기업들의 CPU 수요 가운데 50%만 충족하고 있다"고 말했습니다.
- JP모건은 "에이전트가 늘어나면 컴퓨팅 수요가 늘어나지만, 그 증가분은 GPU보다 CPU 쪽으로 약간 기울 가능성이 있다"고 짚었습니다.
- 유진투자증권 박재환 연구원은 "워크로드 오케스트레이션을 담당하는 CPU의 수요는 구조적으로 확대되고, 이미 타이트한 CPU 공급 병목은 한층 더 심화될 가능성이 높다"고 밝혔습니다. 골드만삭스는 이 국면을 1990년대 웹브라우저 보급 확산에 비유했습니다.
각 사의 대응
에이전트 시대를 대비한 CPU 전략은 이미 구체적인 제품으로 나와 있습니다.
| 기업 | 대응 | 핵심 내용 |
| Arm | Arm AGI CPU(2026-03-24) | 최대 136코어 Neoverse V3, TSMC 3nm. 메타가 공동 개발 리드 파트너. x86 대비 랙당 2배 이상 성능 주장. OpenAI·클라우드플레어·SK텔레콤 등 채택 발표 |
| AMD | 공식 블로그 2편(2026-05-07, 2026-07-27) | 리사 수 CEO: 에이전트 AI로 GPU 대 CPU 비율이 1:4~1:8에서 1:1 가까이로 좁혀진다. 서버 CPU 시장 성장률 전망을 연 18%에서 35% 이상(2030년 1,200억 달러)으로 상향 |
| 인텔 | Hot Chips 2026(2026-08-24) 3계층 전략 | Diamond Rapids(최대 256코어, 엔터프라이즈 오케스트레이션), Crescent Island(GPU, 추론), Wildcat Lake(클라이언트 SoC) |
| 엔비디아 | 'Vera'(2026-05-31) | 에이전트를 위한 CPU로 소개, x86 대비 1.8배 빠른 작업 완료 제시. Anthropic·OpenAI·바이트댄스·오라클 클라우드 등 도입 계획 |
GPU 회사로 여겨지던 엔비디아까지 별도의 CPU를 내놓았다는 점이 상징적입니다. 젠슨 황은 Vera를 "하이퍼스케일에서 에이전트 AI를 실행하도록 만들어진 첫 번째 CPU"라고 소개했습니다.
메모리와 전력도 함께 움직인다
JP모건은 에이전트용 CPU의 메모리 탑재량이 일반 CPU보다 30~100% 많다고 밝혔습니다. 메모리 수요의 중심이 학습용 HBM에서 추론용 CPU·DRAM·SSD를 포함한 시스템 전체로 넓어지고 있다는 설명도 함께 내놨습니다.
카운터포인트리서치 집계로 2026년 2분기 HBM 점유율은 SK하이닉스 50%, 삼성전자 33%입니다. JP모건 코멘트대로 수요 중심이 시스템 전체로 넓어진다면, 에이전트 확산은 HBM 구도뿐 아니라 범용 서버 D램 수요에도 신호가 될 수 있습니다. 다만 조심스러운 해석입니다.
프로젝트를 이끌어 본 시각에서 본 에이전트 워크로드
소프트웨어 프로젝트를 오래 이끌어 온 시각에서 보면, 에이전트 워크플로가 왜 CPU를 필요로 하는지는 낯설지 않은 이야기입니다. 프로젝트에서 실제로 시간을 잡아먹는 구간은 대개 핵심 로직을 계산하는 순간이 아니라, 외부 시스템을 호출하고 응답을 기다리고 상태를 점검하는 구간입니다. 에이전트의 계획 수립은 모델이 짧게 답을 내는 구간이지만, 그 계획을 도구 호출로 옮기고 결과를 확인해 다음 단계를 판단하는 구간은 대기와 입출력, 상태 관리로 채워집니다. 이 구간이 전체 워크플로에서 차지하는 비중이 클수록, 병목은 연산 능력이 아니라 이런 일반 소프트웨어 실행 자원, 즉 CPU 쪽에서 먼저 나타납니다.
단서와 한계
이 글에서 다룬 수치는 대부분 소비자 신호에 대한 시장의 해석이지, 반도체 기업이 받은 확정 주문이 아닙니다. 24/7 Wall St가 짚었듯 이번 주가 반응의 근거는 뮤즈 같은 소비자용 에이전트가 실제로 쓰인다는 신호이지, 어느 기업의 공식 발표는 아닙니다. 에이전트가 대중적으로 계속 쓰이지 않으면 이 수요 전망의 전제 자체가 흔들립니다. 실제로 뮤즈를 둘러싸고는 개인정보 무단 열람, 인증 토큰 유출, 아마존의 접근 차단 같은 신뢰 문제도 함께 제기되고 있습니다. 자세한 내용은 이전 글에서 다뤘습니다. 이런 우려가 커져 에이전트 채택 속도가 늦어지면, CPU 수요 확대 시나리오도 그만큼 늦어질 수 있습니다.
자주 묻는 질문
Q. 에이전트는 왜 GPU만으로 부족한가요?
계획 수립은 GPU가 짧게 처리하지만, 도구 호출로 실행하고 결과를 확인해 다음 단계를 판단하는 구간은 일반 소프트웨어 실행이라 CPU가 담당합니다. 에이전트는 이 구간이 훨씬 길어 CPU 사용량도 함께 늘어납니다.
Q. CPU 수요 증가가 확정된 사실인가요?
아닙니다. 여러 기업의 발언과 시장 반응은 소비자용 에이전트가 확산될 경우를 가정한 신호이며, 공식 주문으로 확인된 수치는 아닙니다.
Q. 이 흐름이 한국 반도체 기업과 관련이 있나요?
있습니다. SK하이닉스·삼성전자가 강한 HBM뿐 아니라, JP모건이 언급한 것처럼 CPU와 함께 쓰이는 범용 서버 D램 수요도 함께 움직일 가능성이 있다는 해석이 나옵니다. 다만 아직 조심스러운 해석 단계입니다.
핵심 3줄 요약
- 챗봇은 GPU가 답을 만들고 끝나지만, 에이전트는 계획→도구 호출→결과 확인→재시도를 반복하며 이 구간 대부분을 CPU가 처리합니다.
- Arm·AMD·인텔·엔비디아 모두 에이전트를 겨냥한 CPU를 내놓았고, AMD는 GPU 대 CPU 비율이 1:4~1:8에서 1:1 가까이로 좁혀진다고 밝혔습니다.
- 다만 이 수요는 아직 확정 주문이 아니라 소비자 신호이며, 에이전트의 신뢰 문제가 채택 속도를 늦추면 전제 자체가 흔들릴 수 있습니다.
이 글은 투자 권유가 아니며, 기준 시점은 2026-09-25입니다.
참고 자료
- 아주경제, "반도체주 급등 이끈 메타 '뮤즈' 뭐길래…본격 AI 에이전트 시대 예고"(2026-09-22): https://www.ajunews.com/view/20260922082142756
- 한국경제, "엔비디아·삼전닉스보다 더 뛴 CPU株…메타 '뮤즈'가 깨운 것은"(2026-09-23): https://www.hankyung.com/article/202609232525i
- 24/7 Wall St, "Arm Surges 13% as Meta's Muse Agent Reignites CPU Demand Bet; Intel Jumps 12%, AMD Climbs 9%"(2026-09-21): https://247wallst.com/investing/2026/09/21/arm-surges-13-as-metas-muse-agent-reignites-cpu-demand-bet-intel-jumps-12-amd-climbs-9/
- 글로벌이코노믹, "앱을 닫아도 클라우드는 켜져 있다…AI 에이전트가 흔드는 반도체 판도"(2026-09-22): https://www.g-enews.com/article/Global-Biz/2026/09/202609220644084896fbbec65dfb_1
- 글로벌이코노믹, HBM 시장 점유율 관련 보도(2026-09-25, 카운터포인트리서치 집계 인용): https://www.g-enews.com/article/Global-Biz/2026/09/202609251658393730fbbec65dfb_1
- 디지털투데이, "Arm '에이전트 AI 확산 땐 데이터센터 CPU 코어 수요 4배 넘을 수도'"(2026-06): https://www.digitaltoday.co.kr/news/articleView.html?idxno=671581
- 이코노미트리뷴, "'GPU 다음은 CPU'…AI 에이전트 열풍에 CPU 수요 급증"(2026-03-12): https://www.economytribune.co.kr/news/articleView.html?idxno=3901978
- Meta Superintelligence Labs, "How We Built Safety Into Muse"(2026-09-08): https://research.meta.ai/blog/security-and-safety-for-ai-agents-our-approach-with-muse
- Arm Newsroom, "Arm AGI CPU" 발표(2026-03-24): https://newsroom.arm.com/news/arm-agi-cpu-launch
- AMD 공식 블로그, "Agentic AI Changes the CPU/GPU Equation"(2026-05-07): https://www.amd.com/en/blogs/2026/agentic-ai-changes-the-cpu-gpu-equation.html
- AMD 공식 블로그, "The Agentic Era Runs on a CPU Foundation... EPYC 9006"(2026-07-27): https://www.amd.com/en/blogs/2026/the-agentic-era-runs-on-a-cpu-foundation-and-it-s-called.html
- NVIDIA Newsroom, "NVIDIA Unveils Vera: The CPU for Agents"(2026-05-31): https://nvidianews.nvidia.com/news/nvidia-unveils-vera-the-cpu-for-agents
- Intel Newsroom, "Intel Outlines Architectures for Agentic AI at Hot Chips 2026"(2026-08-24): https://www.intel.com/content/www/us/en/newsroom/news/client-computing/intel-outlines-architectures-for-agentic-ai-at-hot-chips-2026.html
📌 함께 읽으면 좋은 글
- 메타 뮤즈는 왜 2주 만에 챗GPT를 제쳤나 — 사람들이 AI 에이전트를 좋아하는 이유, 남는 불안, 그리고 CPU
- 중국 반도체 추격 어디까지 왔나, 삼성·SK하이닉스 대응 전략 정리
블로그의 다른 글도 둘러보세요 → https://denmarkda.tistory.com/
'라이프 > 지식 쌓기' 카테고리의 다른 글
| 해인사 팔만대장경, 왜 만들었고 어떻게 800년을 지켰나 — 장경판전 설계와 관람·예약 정보까지 (0) | 2026.09.27 |
|---|---|
| 메타 뮤즈는 왜 2주 만에 챗GPT를 제쳤나 — 사람들이 AI 에이전트를 좋아하는 이유, 남는 불안, 그리고 CPU (0) | 2026.09.23 |
| 적자인데 왜 노선을 늘리나 — LCC 신규 노선 취항 경쟁과 돈 되는 노선의 조건 (0) | 2026.09.21 |
| 중국 자동차 수출 1000만 대 눈앞 — 저가 공세는 어떻게 가능했고 독일·일본·한국은 무엇으로 맞서나 (3) | 2026.09.20 |
| 미국도 일본도 금리를 올렸다 — 엔캐리 청산은 지금 일어나고 있는가 (0) | 2026.09.19 |