• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'cpu'통합검색 결과 입니다. (66건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[써보고서] '역대급 흥행' 갤Z폴드8, 중심엔 '스냅드래곤8 엘리트 5세대'

삼성전자 폴더블폰 갤럭시Z폴드8·울트라·플립8이 국내 사전판매에서 역대 갤럭시 스마트폰 최다 판매 기록을 세웠다. 지난달 28일부터 이달 3일까지 폴더블폰 3종 국내 사전판매량은 144만 대였다. 종전 기록인 2019년 갤럭시노트10의 138만 대를 웃돌았다. 모델별로 Z폴드8 판매 비중이 70%로 가장 높았다. 갤럭시Z폴드8 시리즈에는 퀄컴 모바일 애플리케이션 프로세서(AP) '스냅드래곤8 엘리트 5세대'를 탑재했다. 운영체제는 안드로이드17로, 이를 최초로 탑재한 스마트폰이기도 하다. 실제 기기로 벤치마크와 게임 구동 테스트 등으로 칩셋 성능을 확인했다. 긱벤치7 멀티코어 9500점대…GPU 컴퓨트 점수는 1만6451점 연산 성능 측정에는 지난 7월 정식 출시된 최신 버전인 긱벤치7(Geekbench 7)을 사용했다. 측정 결과 싱글코어 2946점, 멀티코어 9517점을 기록했다. 긱벤치7은 멀티코어 테스트 방식이 이전 버전인 긱벤치6과 다르게 설계돼, 동일 칩셋이라도 두 버전의 점수를 직접 비교하기는 어렵다. 같은 긱벤치7 기준 그래픽처리장치(GPU) 컴퓨트 점수는 1만 6451점이었다. 스냅드래곤8 엘리트 5세대는 퀄컴 오라이온(Oryon) 중앙처리장치(CPU) 기반 2+6 옥타코어 구조를 채택했다. 프라임 코어 2개와 퍼포먼스 코어 6개로 구성돼 고성능 작업과 다중 워크로드를 나눠 처리한다. GPU는 아드레노(Adreno) 840으로, 슬라이스드 아키텍처를 적용해 작업 부하에 따라 연산 유닛을 병렬로 활용하는 구조다. 3나노미터(nm) 공정으로 제조돼 성능과 전력 효율을 함께 확보했다는 게 퀄컴의 설명이다. 그래픽 성능 측정을 위해 3D마크 와일드 라이프 익스트림 테스트도 진행했다. 화면을 펼친 메인 디스플레이 상태에서는 6230점(평균 37.31프레임), 접은 커버 디스플레이 상태에서는 7164점(평균 42.96프레임)을 기록했다. 이는 접었을 때 기준 상위 2% 안에 들어가는 점수다. 배틀그라운드 모바일 90프레임 유지…점유율은 여유 있는 수준 실제 게임 구동 테스트는 고사양 3D 슈팅 게임 '배틀그라운드 모바일'로 진행했다. Z폴드8의 메인 디스플레이로 플레이한 결과 초당 프레임 수는 최고 수준인 90을 유지했다. CPU 점유율은 평상시 30%대에서, 화면 전환이나 액션이 몰리는 구간에서는 50%대까지 상승했다. GPU 점유율은 평소 30%대를 유지하다 대규모 전투 장면에서 40%대 초중반까지 올랐다. 램(RAM) 사용량은 테스트 시간 동안 65~67% 구간에서 유지됐다. 측정된 수치는 CPU·GPU 점유율 모두 최대치에 도달하지 않은 상태에서 유지됐음을 보여준다. 벤치마크 결과는 소프트웨어 버전과 주변 온도, 개별 기기 편차에 따라 달라질 수 있다. 스냅드래곤8 엘리트 5세대는 헥사곤(Hexagon) 신경망처리장치(NPU)를 탑재해 갤럭시Z폴드8의 온디바이스 AI(인공지능) 기능을 뒷받침한다. 실시간 번역, 생성형 편집 등 갤럭시 AI 기능 상당수가 이 NPU를 통해 처리된다. CPU 내 QMX(Qualcomm Matrix Extensions) 엔진은 경량 추론을 보조해, 대형 연산은 NPU가, 소규모 연산은 NPU와 QMX가 나눠 처리하는 구조다.

2026.09.14 17:03전화평 기자

애플, 아이폰용 첫 2나노급 SoC 'A20 프로' 공개

애플이 9일(현지시간) 새 아이폰 공개 행사 '깜짝 빛날 시간.'에서 아이폰용 새 시스템반도체(SoC)인 'A20 프로'를 공개했다. A20 프로는 애플이 아이폰용으로 설계한 첫 2나노급 SoC로 미세화된 트랜지스터를 더 높은 밀도로 집적하면서 CPU와 GPU, AI 연산 성능을 동시에 끌어올렸다. CPU는 고성능 '슈퍼코어' 2개, 저전력 '효율' 코어 4개 등 총 6코어로 구성됐다. 애플에 따르면 슈퍼코어 성능은 전 세대 대비 최대 20% 향상됐고 효율 코어 4개에는 뉴럴 엔진과 별도로 신경망 가속 엔진을 통합했다. 애플은 "효율 코어에 신경망 가속기를 통합해 일반적인 앱은 물론 기기에서 직접 AI 모델을 실행하는 온디바이스 AI 작업에서도 지연시간을 줄일 수 있다"고 밝혔다. GPU는 총 7코어로 지금까지 출시된 아이폰용 SoC 중 가장 많은 코어를 내장했다. 일반 그래픽 성능은 전 세대 대비 최대 40% 향상됐다. GPU에도 신경망 가속기를 내장해 FP8(실수, 8비트) 연산 성능을 최대 두 배 높였다. 각종 AI 처리를 저전력으로 전담하는 뉴럴 엔진은 최대 32코어로 구성됐다. 전 세대 대비 연산 성능은 두 배, 메모리 대역폭은 50% 늘어났다는 것이 애플 설명이다. 발열 관리 방식도 달라졌다. A20 프로는 애플 PC·아이패드 프로용 M 시리즈 SoC에 먼저 적용됐던 새로운 패키징 구조를 그대로 가져왔다. 실리콘 다이가 증기 챔버와 직접 연결되도록 하는 한편 증기 챔버 표면 면적도 아이폰17 프로 대비 최대 3배 늘렸다. 이를 통해 지속적인 부하가 가해지는 게임 등 실행시 성능을 높였다. A20 프로는 같은 날(9일) 공개된 아이폰18 프로/프로맥스, 애플 첫 폴더블 스마트폰인 아이폰 듀오에 탑재된다.

2026.09.10 07:33권봉석 기자

파네시아·메타, '원칩' 형태 차세대 AIDC 구조 제시

국내 팹리스 반도체 스타트업 파네시아가 글로벌 빅테크 메타와 협력해 데이터센터 전체를 하나의 거대한 반도체 칩처럼 구동시키는 차세대 인공지능 데이터센터(AIDC) 아키텍처를 제시했다. 파네시아는 메타와 공동 연구한 차세대 AI 인프라 구조 논문이 세계적인 과학 저널 네이처(Nature)의 전기전자 공학 학술지 'NREE(Nature Reviews Electrical Engineering)'에 초청 논문으로 정식 게재됐다고 8일 밝혔다. NREE가 전 세계 반도체 스타트업에 리뷰 논문 집필을 단독 초청해 게재한 것은 이번이 처음이다. 양사가 공개한 기술의 핵심은 개방형 국제 표준 규격인 CXL(컴퓨트 익스프레스 링크)을 활용해 랙(Rack)과 랙 사이의 네트워크 병목을 해소하는 것이다. 조 단위 매개변수(파라미터)를 다루는 초거대 AI 학습 환경에서는 수천 개의 가속기가 연동되는데, 기존 이더넷이나 인피니밴드 환경에서는 랙 간 통신 시 소프트웨어 조율 과정을 거치며 심각한 지연시간 편차가 발생했다. 파네시아와 메타는 CPU, 가속기, 메모리를 CXL 기반의 단일 도메인으로 묶어 캐시 일관성 유지 범위를 데이터센터 전반으로 확장했다. 이를 위해 하이 팬아웃 스위치, 패브릭 컨트롤러, 링크 가속 유닛 등 3종의 전용 하드웨어와 광통신 CXL 확장 기술을 결합했다. 구성 분석 결과, CPU 1개가 관리하는 가속기 수는 기존 2개에서 16개로 8배 늘었고, 하나의 도메인으로 묶이는 가속기 규모는 최대 960개로 13배 확대됐다. 랙 간 접근 지연시간은 기존 마이크로초(㎲) 수준에서 수백 나노초(㎱)대로 최대 10분의 1까지 단축됐다. 이를 통해 거대 AI 모델의 분산 학습 및 실시간 서비스 처리 효율을 비약적으로 끌어올릴 수 있다. 정명수 파네시아 대표는 “초거대 AI 시대에는 개별 가속기 성능 못지않게 수많은 자원을 어떻게 유기적으로 연결하느냐가 핵심”이라며 “CXL을 통해 데이터센터 전체를 하나의 고성능 컴퓨팅 시스템으로 동작시키는 차세대 인프라의 표준 방향을 입증했다”고 말했다.

2026.09.08 15:32전화평 기자

Arm, 서버 CPU용 IP '네오버스 CSS N4' 공개

영국 반도체 설계 전문기업 Arm이 8일 중국 상하이에서 진행되는 기술행사 'Arm 에브리웨어 차이나 2026'에서 서버와 데이터센터용 CPU IP(설계자산)인 '네오버스 CSS N4'를 공개했다. Arm은 고객사들이 필요에 따라 선택할 수 있도록 CPU IP를 두 가지로 구분해 공급중이다. N시리즈는 전력 효율에, V시리즈는 성능에 중점을 뒀다. 7일 진행된 사전 브리핑에서 모하메드 아와드 Arm 클라우드 AI 사업부문 총괄 수석부사장은 "네오버스 CSS N4는 코어 수와 캐시 용량, 입출력(I/O)과 연결성 면에서 가장 유연한 IP이며 한 다이당 최대 128코어를 탑재할 수 있다"고 밝혔다. 이어 "네오버스 CSS N3 대비 소켓 당 성능은 2배, 전력 효율은 1.25배, 메모리 대역폭은 1.75배 향상됐다. 이를 통해 파트너사가 AI 데이터센터에 효과적으로 진출할 수 있도록 도울 것"이라고 덧붙였다. 네오버스 CSS N4는 대만 TSMC N3/N3P 공정, 삼성 파운드리 SF2/SF2P 등 공정에 기반해 설계됐다. 주요 파트너사들은 이를 바탕으로 한 Arm 기반 프로세서를 설계해 도입할 수 있다. 모하메드 아와드 수석부사장은 이날 Arm 기반 네오버스 IP의 성장세에 대해 "Arm은 2018년 이후 지금까지 파트너사의 도움을 받아 네오버스 IP 기반 코어 15억 개를 데이터센터에 출하했다"고 설명했다. 이어 "에이전틱 AI 등장으로 CPU의 역할 자체가 바뀌면서 성장세는 더욱 빨라지고 있다. 올 초부터 현재까지 약 9개월간 5억 개의 네오버스 코어를 출하했다"고 덧붙였다. Arm은 반도체 IP와 이를 조합한 컴퓨트서브시스템(CSS)을 공급한 데 이어 지난 3월 미국 샌프란시스코 'Arm 에브리웨어' 행사에서 이를 바탕으로 한 AGI CPU를 공개했다. 모하메드 아와드 수석부사장은 "AGI CPU의 신규 고객사로 틱톡 운영사인 바이트댄스, 볼케이노와 레노버 등 신규 파트너사들이 합류했으며 구체적인 성과를 몇 개월 안에 볼 수 있을 것"이라고 밝혔다.

2026.09.08 11:10권봉석 기자

Arm, 모바일용 CSS 2 공개... 말리 GPU에 신경망 가속기 통합

영국 반도체 설계 전문기업 Arm이 8일 중국 상하이에서 진행되는 기술행사 'Arm 에브리웨어 차이나 2026'에서 프리미엄 스마트폰과 태블릿, PC 등 모바일 기기를 겨냥한 새 반도체 설계자산(IP) '모바일용 CSS 2'를 공개했다. 7일 진행된 사전 브리핑에서 크리스 버기 Arm 엣지 AI 사업부문 총괄 수석부사장(EVP)은 "과거 AI는 대부분의 작업을 클라우드에서 진행해야 했지만 앞으로는 AI가 이용자의 의중을 파악해야 한다"고 설명했다. 이어 "이런 작업을 지연시간을 단축하면서 경제적으로 수행하려면 많은 작업을 클라우드가 아닌 엣지로 배치해야 한다. 모바일용 CSS 2는 엣지에서 AI 응용프로그램을 효율적으로 구동할 수 있는 IP"라고 덧붙였다. 모바일용 CSS 2, C2 CPU·말리 G2 GPU로 구성 모바일용 CSS 2는 각종 연산작업을 수행하는 C2 CPU, 그리고 그래픽과 AI 가속을 처리하는 말리 G2 GPU 등 두 개 파트로 구분된다. Arm은 사전 브리핑에서 새로 탑재될 말리 G2-울트라 NX GPU 설명에 많은 부분을 할애했다. PC GPU는 이미 AI 가속기를 활용해 업스케일링과 프레임 생성에 활용해 왔다. 반면 Arm 계열 시스템반도체(SoC) 제조사는 그간 GPU에 조명효과를 처리하는 레이트레이싱 기술만 구현해 왔다. 과거 데스크톱용 GPU에서만 가능했던 기능을 모바일에서도 저전력으로 구현했다는 점에서는 여전히 의미가 있다. 그러나 레이트레이싱은 게임 화면 표현력을 더하는 기술일 뿐 GPU의 연산 부담을 덜어주지는 못한다. 모바일 환경에서 AI 기반 렌더링 지원 Arm은 지난 6월 게임 스튜디오 스모 디지털과 함께 제작한 게임 '뉴럴 던' 시연을 통해 신경망 가속기를 결합한 렌더링 기술을 일부 공개하기도 했다. 크리스 버기 총괄부사장은 "말리 G2-울트라 NX는 말리 GPU 사상 최초로 AI에 중점을 뒀다. 신경망 가속기를 GPU에 내장해 소비전력 1W 수준에서 구현했다"고 설명했다. 이어 "960×540 화소 화면을 두 배 수준인 1920×1080 화소로 끌어올리는 신경망 슈퍼샘플링(NSS), 초당 30프레임 화면을 두 배인 60프레임으로 높이는 신경망 프레임 업스케일링, 화면 노이즈를 줄이는 신경망 슈퍼샘플링·디노이징(NSSD) 등 기술을 지원한다"고 설명했다. 내부 처리 개선 더해 초당 프레임 수 최대 4배 향상 크리스 버기 총괄부사장은 "신경망 처리 기술과 함께 그래픽 명령어를 실행하는 '실행 엔진'도 7세대로 재설계됐고 레이트레이싱 처리 유닛도 업그레이드했다. 이를 통해 초당 프레임 수와 처리 효율은 최대 4배 높였다"고 설명했다. 이어 "게임 개발사는 과거 모바일용 게임 개발시 그래픽 수준을 최적화하느라 많은 시간을 보냈지만 이제는 게임의 스토리에 더 집중할 수 있게 됐다"고 자평했다. 말리 G2-울트라 NX의 신경망 렌더링은 언리얼엔진5와 유니티 등 상용 게임 엔진에서 지원될 예정이다. 크리스 버기 총괄부사장은 "이는 시작에 불과하며 더 많은 게임으로 지원을 확대해 최신 모바일 게임에서 유용성을 확인할 수 있을 것"이라고 말했다. C2 울트라 CPU, 단일코어 성능 최대 15% 향상 모바일용 CSS 2의 CPU는 최고 성능을 내는 C2 울트라 CPU, 전력 효율에 중점을 둔 C2 프로 CPU 등 총 두 종류를 포함한 'C2 CPU 클러스터'로 묶인다. C2 CPU도 이전 세대와 마찬가지로 AI 연산에 주로 쓰이는 행렬 곱셈 등 연산을 처리하기 위한 SME2 명령어 처리를 지원한다. 크리스 버기 총괄부사장은 "C2 울트라 CPU는 전작 대비 단일코어 처리 성능을 최대 15%, 다중작업 성능을 최대 12% 높여 에이전틱 AI가 요구하는 성능 향상에 부합했다"고 밝혔다. 이어 "'결혼기념일 저녁 식사를 계획하고 예약하라'는 작업을 C1 울트라 CPU 2개(듀얼코어) 처리시 1.8초가 걸렸다면 C2 울트라 CPU 2개는 이를 1.6초에 처리한다. 여기에 SME2까지 적용할 경우 처리 시간은 1.4초 가량으로 더 확실한 체감 속도 향상이 이뤄질 것"이라고 설명했다. 크리스 버기 총괄부사장은 "구글플레이에 등록된 AI 앱의 95%는 CPU를 주로 활용한다. SME2 생태계는 지속 확장 예정이며 이 과정에서 성능 향상에 큰 도움을 줄 것"이라고 설명했다. "말리 G2-울트라 NX, 실제 AI 성능은 20 TOPS 수렴할 것" 모바일용 CSS 2는 전 세대와 마찬가지로 NPU는 포함하지 않았다. 그러나 GPU의 신경망 처리 기능 추가로 AI 처리 성능을 크게 향상시켰다. 자체 개발 NPU를 추가하거나 외부 NPU IP를 추가하는 것은 파트너사의 몫이다. 제임스 맥니븐 Arm 엣지 AI 사업부문 클라이언트 컴퓨팅 부사장은 "C2 CPU 클러스터의 AI 연산 성능은 SME2 활용을 가정하면 약 5~7 TOPS이며 말리 G2-울트라 NX의 AI 성능은 이론적으로는 최대 50 TOPS 급도 구현 가능하다"고 설명했다. 이어 "말리 G2-울트라 NX GPU의 실제 AI 처리 성능은 실제 SoC를 설계하는 파트너사의 목적이나 역량에 따라 달라질 것이다. 실제로는 약 10~20 TOPS 가량이 될 것"이라고 설명했다. 모바일용 CSS 2는 대만 TSMC의 2나노급 공정인 N2에 최적화됐다. 이를 활용한 모바일용 SoC는 내년부터 주요 파트너사를 통해 시장에 공급될 전망이다.

2026.09.08 11:00권봉석 기자

[AI 고속도로] 델, AI 서버 주문 폭증에 '역대급 실적'…연간 매출 263조원 전망

델 테크놀로지스가 인공지능(AI) 서버 수요 급증에 힘입어 사상 최대 분기 매출을 기록했다. AI 서버 주문과 수주잔고가 역대 최대 수준으로 늘어난 가운데, 올해 AI 서버 매출 전망을 740억 달러(약 101조원)까지 끌어올리며 연간 실적 전망도 대폭 상향했다. 델은 2027 회계연도 2분기(5~7월) 매출이 전년 동기 대비 58% 증가한 469억 7100만 달러(약 64조원)를 기록했다고 1일(현지시간) 밝혔다. 순이익은 41억 3300만 달러(약 5조 6600억원)로 255% 증가했으며 희석 주당순이익(EPS)은 6.34달러로 273% 늘었다. 비일반회계기준(Non-GAAP) EPS는 7.04달러로 203% 증가해 런던증권거래소그룹(LSEG)이 집계한 예상치 4.92달러를 크게 웃돌았다. 이같은 실적 성장은 AI 서버를 중심으로 한 인프라 사업이 이끌었다. 델의 인프라솔루션그룹(ISG) 매출은 317억 8200만 달러(약 43조원)로 전년 동기 대비 89% 증가했다. 이 가운데 AI 특화 서버 매출은 164억 100만 달러(약 22조원)로 두 배 증가했으며 전통 서버·네트워킹 매출도 105억 3100만 달러(약 14조원)로 122% 늘었다. 스토리지 매출은 48억 5000만 달러(약 6조원)로 26% 증가했다. 장비 주문도 가파르게 증가하는 추세다. 델은 2분기 AI 서버 신규 주문이 사상 최대인 609억 달러(약 83조원)를 기록했다고 밝혔다. 최근 1년간 누적 주문은 1317억 달러(약 180조원)에 달하며 지난 7월 말 기준 AI 서버 수주잔고 역시 역대 최대인 950억 달러(약 130조원)를 기록했다. AI 확산은 델의 전통 서버 사업에도 긍정적인 영향을 미치고 있다. 기업들이 첨단 그래픽처리장치(GPU)가 탑재된 특화 서버 외에도 AI와 에이전틱 AI 운영에 필요한 중앙처리장치(CPU) 기반 컴퓨팅 자원을 함께 확충하면서 전통 서버 수요도 증가하는 상황이다. 제프 클라크 델 부회장 겸 최고운영책임자(COO)는 "AI와 에이전틱 워크플로우를 지원하기 위해 상당한 CPU 컴퓨팅 용량을 필요로 하는 기업 고객들이 늘고 있다"며 "이러한 워크로드가 우리의 전통 서버 수요도 증가시키고 있다"고 말했다. 델은 최근 지속 확대되는 AI 인프라 수요를 반영해 올해 실적 전망도 대폭 높였다. 2027 회계연도 전체 매출 전망을 기존 1670억 달러(약 229조원)에서 1920억 달러(약 263조원)로 250억 달러(약 34조원) 상향했으며 이는 전년 대비 69% 증가한 수준이다. 조정 EPS 전망도 기존 17.90달러에서 25.50달러로 높였다. 특히 연간 AI 최적화 서버 매출 전망은 기존 600억 달러(약 82조원)에서 740억 달러(약 101조원)로 상향했다. 전년 대비 약 3배에 달하는 규모다. 호실적과 전망치 상향에 주가는 시간외 거래에서 반등했다. 델 주가는 실적 발표를 앞두고 차익실현 등의 영향으로 1일(현지시간) 뉴욕증시 정규장에서 전 거래일보다 31.01달러(6.80%) 떨어진 425.00달러에 마감했다. 그러나 실적 발표 이후 시간외 거래에선 34.03달러(8.01%) 오른 459.03달러를 기록하며 정규장 낙폭을 만회했다. 클라크 COO는 "AI 확산으로 AI 서버뿐 아니라 기존 IT 인프라에 대한 수요도 함께 증가하고 있다"며 "기업들의 데이터센터 현대화 투자가 이어지면서 우리의 사업 기회도 확대되고 있다"고 밝혔다.

2026.09.02 15:36한정호 기자

퀄컴 "새 오라이언 CPU, 모바일 최초 작동클록 5GHz 돌파"

퀄컴이 25일(현지시간) 스마트폰용 차세대 스냅드래곤 시스템반도체(SoC)의 최대 작동 클록이 5GHz를 넘길 것이라고 밝혔다. 퀄컴이 작년 공개한 스마트폰용 SoC인 스냅드래곤8 엘리트 5세대의 최대 작동 클록은 4.6GHz였다. 삼성전자 스마트폰에만 공급되는 갤럭시용 스냅드래곤8 엘리트 5세대의 최대 작동 클록은 4.74GHz였다. 작년 11월 공개된 PC용 SoC인 스냅드래곤 X2 엘리트 익스트림에 내장된 오라이언 CPU 중 최고 성능을 내는 프라임 코어 2개는 이미 작동 클록 5GHz에 도달한 상태다. 퀄컴은 이날 공식 블로그를 통해 "모바일용 차세대 오라이언 CPU의 작동 클록은 최대 5GHz까지 향상됐고 이는 새로운 공정 기술 뿐만 아니라 마이크로아키텍처, 구현 방식, CPU 서브시스템까지 완전한 맞춤형 설계의 결과"라고 설명했다. 퀄컴에 따르면 새 오라이언 CPU는 5GHz로 작동하는 최고 성능 프라임 코어 2개, 일반 작업용 퍼포먼스 코어 6개 등 총 8개로 구성될 예정이다. 퀄컴은 5GHz 작동 속도와 함께 클록당 명령어 처리량(IPC)도 강조했다. 같은 작동 속도에서 더 많은 명령어를 처리해 앱 실행과 게임, 콘텐츠 제작, 온디바이스 AI 등 실제 사용 환경에서 성능 향상을 노린다는 전략이다. 퀄컴이 이날 함께 공개한 새로운 캐시 기술 '플렉스캐시'는 새로운 오라이언 CPU에 처음 도입된다. CPU 코어별로 캐시 공간을 따로 배정하는 것이 아니라 작업량에 따라 캐시 메모리를 유동적으로 배분한다. 퀄컴은 "고성능이 필요한 작업에서 5GHz로 작동하는 프라임(Prime) 코어가 전체 캐시 풀을 활용할 수 있어 필요한 데이터가 캐시에 더 오래 머물도록 설계됐다"고 설명했다. 이는 CPU가 상대적으로 느린 시스템 메모리에 접근하는 횟수를 줄이는 효과를 노린다. 작업 데이터가 캐시에서 밀려나 메모리로 이동하는 상황을 줄이면 코어가 데이터를 기다리며 발생하는 지연을 낮출 수 있기 때문이다. 퀄컴은 플렉스캐시의 용량과 5GHz 작동 속도 유지 조건 등은 별도로 공개하지 않았다. 보다 상세한 내용은 오는 9월 하순 연례 기술 행사 '스냅드래곤 서밋 2026'에서 공개될 전망이다.

2026.08.26 10:02권봉석 기자

델 "에이전틱 AI 시대, 비용·효율 고려한 분산처리 필요"

"에이전틱 AI가 보급되며 여러 기업이 에이전트 활용을 독려하고 있다. 하지만 모든 직원이 AI를 효율적으로 활용하는 것은 아니다. 가치 낮은 업무에 많은 양의 토큰을 쓰는 한편 가치 있는 업무를 매우 적은 토큰으로 수행하는 상황도 발생한다." 25일 오전 서울 삼성동 코엑스에서 진행된 '델테크놀로지 CSG 미디어 간담회'에서 유상모 델테크놀로지스 총괄사장이 이렇게 강조했다. 델테크놀로지스는 연례 행사 '델 테크놀로지스 포럼' 일부인 이날 행사에서 AI 처리를 클라우드에만 의존하는 것은 보안과 토큰당 비용 면에서 적합하지 않다고 지적했다. 이어 보완책으로 AI PC와 워크스테이션 등으로 AI 처리를 분산하는 '책상 옆(데스크사이드) AI'를 제시했다. 에이전틱 AI 대응 3대 전략 제시 "AI 토큰도 비용" 이날 델테크놀로지스는 에이전틱 AI 시대의 대처 방안을 ▲ AI 토큰경제 ▲ AI 네이티브 조직을 위한 AI PC ▲ AI 확산에 따른 엔드포인트 보안 등 세 가지 축으로 제시했다. 정재욱 델테크놀로지스 이사는 "클라우드는 대규모 연산이 일어나는 환경에, 데이터 소유권과 통제가 중요한 연산은 기업이나 조직 내 데이터센터가 적합하다. 반면 반복적인 추론이나 민감한 데이터는 데스크사이드에서 처리해 효율을 확보할 수 있다"고 설명했다. 이어 "엔비디아 GB10·GB300과 x86 CPU·엔비디아 GPU 등으로 구성된 워크스테이션은 로컬 AI 개발과 에이전트 개발·테스트에 적합하다. 개발된 모델이나 에이전트는 필요에 따라 델 파워엣지 서버로 확장할 수 있다"고 덧붙였다. "책상 위 AI PC로 효율·보안 강화" AI PC는 CPU·GPU·NPU를 활용해 일부 LLM 구동과 추론을 로컬에서 수행할 수 있어 클라우드 API 호출에 따른 토큰 비용을 줄이는 방안으로 활용할 수 있다. 개인정보나 고객정보, 대외비 등 민감한 데이터 외부 유출 가능성도 줄인다. 정재욱 이사는 "델은 인텔 코어 울트라 시리즈3와 AMD 라이젠 AI 400 등을 기반으로 한 '델 프로' 제품군을 업무 수준과 예산에 따라 세분화했다. 14·16형 업무용 노트북인 델 프로 5 이외에 최대 50 TOPS NPU를 내장한 델 프로5 마이크로 등을 공급한다"고 설명했다. 기기 내 저장된 데이터와 각종 모델을 외부 공격에서 방어하기 위한 보안의 중요성도 커지고 있다. 정재욱 이사는 "델테크놀로지스는 제품 조립 단계부터 공급망 보안, 바이오스와 펌웨어 무결성 검증, 마이크로소프트 인튠 등 기기 관리 솔루션과 연동한 텔레메트리 등으로 보안을 강화하고 있다"고 설명했다. "에이전틱 AI, 워크로드 분산 촉진할 것" 이날 델테크놀로지스는 AI PC와 데스크사이드 AI 전략을 소개하며 최근 CSG 사업 성장세도 강조했다. 이성민 델테크놀로지스 전무는 "회계연도 기준 올해 2~4월(1분기) CSG 매출은 146억 달러(약 20조 2049억원)로 전년 동기 대비 17% 증가했으며 이 중 기업용 PC 부문 매출은 130억 달러(약 18조 180억원)로 18% 성장했다"고 밝혔다. 델테크놀로지스는 반도체 수급난과 경기 불확실성으로 기업의 IT 비용 부담이 커지는 상황에서도 공급망 최적화와 운영 효율화를 통해 비용 상승 영향을 최소화한다는 방침이다. 정재욱 이사는 "AI가 프롬프트 중심에서 에이전틱 AI 중심으로 이동하고 있는 만큼 AI 처리를 분산하려는 흐름은 지속될 것이며 기업 역시 비용 부담을 고려하면서 어떤 AI를 어디에 배치할 지 선택하는 것이 중요해질 것"이라고 전망했다.

2026.08.25 15:40권봉석 기자

인텔, '핫칩스 2026'서 AI 특화 아키텍처 3종 공개

인텔이 매년 8월 하순 미국에서 열리는 반도체 업계 학술행사 '핫칩스 2026'에서 에이전틱 AI·엣지 컴퓨팅용 CPU와 GPU 아키텍처 3종을 공개했다. 차세대 제온 프로세서 '다이아몬드 래피즈'는 전력 효율과 성능이 향상된 1.8나노급 인텔 18A-P 공정을 시작으로 제품 생산과 패키징 등 모든 공정이 인텔 파운드리에서 이루어진다. 코어 수는 최대 256개이며 LLC(L3 캐시)는 1.28GB로 연산 효율을 높이는 동시에 16개 메모리 채널을 적용했다. GPU와 외부 저장장치 등이 밀집된 환경을 겨냥해 PCI 익스프레스 6.0 레인(lane, 데이터 전송 통로)은 총 128개로 확대했다. CPU 타일을 이어붙이는 데는 최신 패키징 기술인 포베로스 다이렉트 3D가 적용됐고 UCIe-S를 이용한 SoC 구성을 지원한다. 새로운 명령어인 APX와 함께 AI 연산을 지원하는 AMX 명령어를 개선했다. 크레센트 아일랜드는 실시간 추론 경제성에 중점을 둔 GPU로 Xe3P 기반 32코어 GPU와 LPDDR5X 480GB 메모리를 탑재했다. 전력 소모는 최대 350W로 기존 공랭식 데이터센터에서 추론 연산 역량 확장에 활용할 수 있다. 인텔 코어 시리즈3(와일드캣 레이크)는 보급형 노트북과 지능형 엣지 시스템에 필요한 AI 기능을 지원한다. 인텔 18A 공정 기반으로 최대 6코어 CPU, 17 TOPS NPU와 XMX 가속 가능한 GPU를 내장했다. UCIe를 적용해 다른 가속기나 SoC와 연결한 패키징 설계도 가능하다. 푸시카르 라나데 인텔 최고기술책임자(CTO)는 "에이전틱 AI는 트랜지스터와 패키지부터 전체 시스템 아키텍처에 이르기까지 컴퓨팅을 설계하고 제공하는 방식을 근본적으로 변화시키고 있다"고 설명했다. 이어 "미래는 범용 컴퓨팅과 용도별 가속 기술, 첨단 패키징, 오픈 칩렛 기술을 긴밀하게 통합하여 실제 전력, 비용, 배포 제약 조건 내에서 워크로드에 적응하고 확장할 수 있는 시스템을 구축하는 데 있다"고 말했다.

2026.08.25 09:52권봉석 기자

망고부스트, 글로벌 웹사이트 오픈…'AI 풀스택' 사업 힘준다

망고부스트가 글로벌 웹사이트를 새롭게 열고 인공지능(AI) 인프라 사업 확대에 나섰다. AI 데이터센터를 넘어 에이전트 운영까지 지원하는 AI 풀스택 기업으로 사업 영역을 넓힌다는 구상이다. 망고부스트는 새 비전과 사업 전략을 담은 글로벌 웹사이트를 공식 오픈했다고 10일 밝혔다. 웹사이트를 통해 '초지능 최적화가 시작되는 곳'이라는 비전과 '전 세계를 위한 엔드투엔드 에이전틱 AI 인프라 구축'이라는 미션을 글로벌 고객과 파트너에게 공개했다. 이날 AI 추론 플랫폼 '망고 인퍼런스' 출시 계획도 발표됐다. 망고 인퍼런스는 개발자가 API 키를 연동하면 서버리스 환경에서 오픈소스 AI 모델별로 최적화된 추론 성능을 이용할 수 있도록 지원하는 서비스다. 망고부스트는 망고 인퍼런스를 자체 시스템과 결합해 AI 추론 과정 비용 대비 성능을 높일 방침이다. 현재 공식 출시에 앞서 프리런칭 사전 등록을 진행하고 있다. 신청자에게 서비스 오픈 소식과 관련 혜택을 뉴스레터로 제공할 예정이다. 새 웹사이트는 '플랫폼'과 '제품' '솔루션' '회사' '자료' 등으로 구성됐다. 망고부스트는 '실리콘부터 시스템까지' 전략 중심으로 AI 데이터센터 구축 기술부터 산업별 솔루션과 핵심 기술 경쟁력·글로벌 파트너십을 소개했다. 망고부스트는 대규모 AI 학습과 추론을 지원하는 데이터센터 인프라를 넘어 자율적으로 판단하고 협업하는 AI 에이전트 운영 환경까지 지원하는 것을 목표로 하고 있다. 컴퓨팅과 네트워크·소프트웨어를 연결한 엔드투엔드 AI 인프라를 구축해 글로벌 시장 경쟁력 강화를 목표로 삼았다. 망고부스트는 데이터처리장치(DPU)와 시스템 소프트웨어를 비롯해 AI 데이터센터용 하드웨어와 소프트웨어를 자체 개발하고 있다. AI 가속기와 네트워크·시스템 소프트웨어를 통합 설계·최적화해 AI 워크로드를 위한 개방형 네트워크 패브릭 플랫폼을 제공하고 있다. 김장우 망고부스트 대표는 "이번 글로벌 웹사이트 오픈은 단순한 홈페이지 리뉴얼이 아니라 우리 새로운 비전과 글로벌 전략을 고객과 공유하는 중요한 출발점"이라며 "AI 데이터센터를 넘어 에이전틱 AI 시대를 뒷받침하는 AI 인프라를 구축하고 '실리콘부터 시스템까지' 전략을 기반으로 고객들에게 최적의 AI 서비스를 제공할 것"이라고 강조했다.

2026.08.10 08:30김미정 기자

AMD, 국산 NPU 생태계 힘 보탠다...한국에 R&D센터 설립

정부가 AMD와 AI반도체 분야에 맞손을 잡기로 했다. GPU 중심의 AI 컴퓨팅을 넘어 CPU, NPU 등 다양한 방식을 결합하는 이기종 컴퓨팅에 대비하기 위한 것이다. 27일 과학기술정보통신부에 따르면 배경훈 부총리 겸 과기정통부 장관이 리사 수 AMD 회장을 만나 AI 반도체와 컴퓨팅 분야 협력을 위한 양해각서를 체결했다. AMD는 CPU와 GPU를 아우르는 글로벌 반도체 기업으로 2025년 기준 연매출 346억 달러를 기록했으며, 특히 서버용 CPU와 GPU의 수요 증가에 힘입어 데이터센터 사업 매출도 166억 달러에 달하는 등 AI 컴퓨팅 시장의 주요 기업으로 자리매김하고 있다. 특히 오픈소스 소프트웨어 플랫폼인 ROCm과 개방형 표준을 기반으로 AI 컴퓨팅 생태계 확대를 추진하고 있다. 이를 통해 구글, 애플, 마이크로소프트 등 여러 글로벌 기업들과 함께 개방형 초고속 AI 반도체 연결 표준인 UALink 창립 멤버로 참여하는 등 개방형 AI 인프라 생태계 조성에도 적극 나서고 있다. 이기종 AI 컴퓨팅 대비...국산 NPU, AMD와 협력 최근 글로벌 AI 반도체 시장은 생성형 AI와 에이전틱 AI 확산에 따른 추론 수요 증가로, 단일 GPU 중심의 컴퓨팅 구조에서 벗어나 이기종 컴퓨팅 아키텍처로 빠르게 전환되고 있다. AI 서비스 제공 비용을 낮추고 성능과 전력 효율을 최적화하기 위해 워크로드별 최적의 연산자원을 활용하는 방향으로 AI 인프라 경쟁의 중심이 이동하고 있다는 뜻이다. 양해각서는 AI 컴퓨팅 아키텍처 변화에 대응해 AMD의 CPU, GPU와 추론 분야에 강점을 가진 국산 NPU를 연계하는 이기종 AI 컴퓨팅 인프라를 구축하고 국내 AI반도체 생태계의 글로벌 협력 기반을 확대하기 위해 체결됐다. 구체적으로 AMD CPU, GPU와 국산 NPU를 연계한 이기종 AI 컴퓨팅 인프라 구축과 실증을 추진한다. 이를 통해 AI 서비스별 특성에 맞춰 다양한 연산자원을 효율적으로 조합 활용하는 통합 컴퓨팅 환경을 구현하고 AI반도체 기업뿐 아니라 메모리, DPU, CXL, 네트워크, 서버, 오케스트레이션 소프트웨어 등 관련 국내 기업들이 함께 참여하는 개방형 AI 컴퓨팅 생태계를 조성한다. 이를 기반으로 국산 AI반도체가 글로벌 AI 컴퓨팅 공급망에 참여할 수 있도록 실질적인 레퍼런스 모델을 확보해 나갈 계획이다. AMD, 한국에 AI 연구센터 설립 양측은 국가과학AI연구센터(NAIS)를 중심으로 'AI for Science' 연구 협력을 추진한다. 첨단 과학기술 분야의 AI 기반 연구와 도전적 연구개발을 뒷받침하기 위해 AMD는 CPU와 GPU 등 고성능 컴퓨팅 자원과 AI 소프트웨어, 전문 인력 등을 제공할 계획이다. AMD는 국내에 인공지능 우수 연구센터(AI Center of Excellence) 설립을 추진한다. 인공지능 우수 연구센터는 AMD의 AI 컴퓨팅 자원과 소프트웨어 역량을 기반으로 국내 기업, 대학, 연구기관의 기술 협력을 비롯해 AI 반도체 소프트웨어 개발, 컴퓨팅 기술 검증 및 공동연구를 지원하는 협력 거점 역할을 수행할 예정이다. 이를 통해 AMD의 글로벌 네트워크와 국내 산학연 역량을 유기적으로 연계해 개방형 AI 생태계를 기반으로 한 다양한 협력 기회를 확대해 나갈 계획이다. AI 분야 우수 인재 양성을 위해서도 협력한다. AMD는 국내 주요 대학교와 대학원에 AI 컴퓨팅 플랫폼 기반의 교육 연구 프로그램과 컴퓨팅 자원을 지원하고, 국내 학생과 교수, 연구자들이 최신 AI 기술과 글로벌 개발 환경을 경험할 수 있는 기회를 확대해 나갈 예정이다. 이밖에 피지컬 AI 등 차세대 AI 분야의 공동연구와 기술 협력을 추진해 미래 AI 기술 경쟁력 확보를 위한 산학연 협력 기반을 확대해 나갈 예정이다. 과기정통부와 AMD 간 협력은 지난 3월 AMD 리사 수 회장의 방한으로 논의가 본격화됐으며, 이후 양측 간 긴밀한 협의를 거쳐 협력 분야와 실행 방안을 구체화해 왔다. 양해각서 체결식은 리사 수 회장의 초청으로 추진돼 글로벌 AI 생태계 변화에 대응하기 위한 양측의 전략적 협력 의지를 다시 한번 확인하는 계기가 됐다. 배경훈 부총리는 “글로벌 AI 경쟁은 CPU, GPU, NPU 등 다양한 연산자원을 결합하는 이기종 컴퓨팅과 개방형 생태계 중심으로 변화하고 있다”며 “대한민국이 AI 3대 강국으로 도약하기 위해서는 자립적이면서도 개방적인 AI 컴퓨팅 인프라 기반 확보가 중요하다”고 밝혔다. 이어 “AMD와의 협력을 통해 국내 AI반도체 생태계의 경쟁력을 높이고, 글로벌 AI 컴퓨팅 인프라 변화에 대응하는 새로운 협력 모델을 만들어 갈 수 있을 것”이라고 말했다. 한편, AMD의 리사 수 CEO는 "한국은 반도체와 AI, 첨단 연구, 피지컬 AI 분야에서 세계적인 경쟁력을 갖춘 AMD의 핵심 전략 시장"이라며, "AMD는 과학기술정보통신부와 협력해 고성능 컴퓨팅 기술과 개방형 소프트웨어 역량, 글로벌 생태계 파트너십을 결합함으로써 대한민국이 개방형·이기종 AI 인프라를 구축할 수 있도록 적극 지원할 것"이라고 말했다. 이어 "이번 협력은 단순한 하드웨어 지원을 넘어 기술 협력과 인재 양성, 긴밀한 공동 연구개발을 통해 대한민국의 AI 혁신과 경제 성장에 기여하겠다는 AMD의 장기적인 의지를 보여주는 것"이라고 밝혔다. 양 기관은 이번 협약의 실질적인 이행을 위해 공동 협의체를 구성하고, 분기별 실무회의를 통해 세부 협력 과제와 추진 방안을 지속적으로 협의해 나갈 예정이다.

2026.07.27 12:00박수형 기자

AMD, 첫 랙스케일 AI 솔루션 공개…앤트로픽·오픈AI 잡았다

AMD가 고성능 시스템반도체 기반의 첫 랙스케일 AI 솔루션 'AMD 헬리오스'를 선보였다. 경쟁 솔루션 대비 달러당 최대 30% 더 많은 AI 추론 토큰을 처리할 수 있는 것이 특징으로, 오픈AI·앤트로픽·메타·마이크로소프트 등 여러 빅테크가 해당 솔루션을 도입할 예정이거나 도입을 추진 중이다. AMD는 23일(현지시간) 미국 샌프란시스코 모스콘 웨스트에서 개최한 'AMD 어드밴싱 AI 2026'에서 차세대 AI 인프라 및 피지컬 AI 포트폴리오를 발표했다. 이날 AMD는 업계 최초이자 최고 수준의 성능을 제공하는 개방형 랙스케일 AI 플랫폼인 AMD 헬리오스를 공개했다. AMD 헬리오스는 72개의 고성능 AMD 인스팅트 MI455X GPU와 18개의 6세대 AMD 에픽 베니스 CPU, AMD 펜산도 프런트엔드, 스케일업 및 스케일아웃 네트워킹, AMD ROCm 오픈 소프트웨어를 하나로 최적화해 통합했다. 덕분에 AMD 헬리오스는 경쟁 솔루션 대비 달러당 최대 30% 더 많은 AI 추론 토큰을 처리할 수 있다. AMD 헬리오스는 현재 양산에 돌입했으며, 주요 AI 기업들이 기가와트급 규모의 AI 인프라 구축에 활용할 예정이다. 대표적인 고객사들로는 오픈AI, 앤트로픽, 메타, 마이크로소프트, 오라클, 휴메인, 텐서웨이브 등이 있다. 오픈AI는 올해 4분기부터 AMD 헬리오스를 도입하고, 2027년부터 본격적인 구축을 확대할 계획이다. 앤트로픽은 AMD 헬리오스 랙스케일 솔루션에 최대 2기가와트 규모의 AMD 인스팅트 MI455X GPU를 구축한다. 에이전틱 AI 시대를 위한 차세대 데이터센터 CPU 및 GPU 포트폴리오도 공개했다. 6세대 AMD 에픽 프로세서는 업계를 선도하는 코어당 성능과 최고 수준의 스레드 집적도를 바탕으로, 와트당, 달러당, 그리고 랙당 더 많은 AI 에이전트를 실행할 수 있도록 지원한다. AI 가속기를 지원하는 호스트 CPU로서는 AI 가속기가 최대 성능을 발휘할 수 있도록 충분한 연산 성능과 메모리 대역폭을 제공하며, 범용 서버 환경에서는 비즈니스 크리티컬 애플리케이션과 AI 지원 워크로드를 위한 뛰어난 성능과 전력 효율성을 제공한다. AMD 인스팅트 MI400 시리즈 GPU는 이전 세대인 MI355X 대비 최대 34배 높은 토큰 처리량을 제공한다. 고정밀 연산이 요구되는 워크로드를 위해 새롭게 공개된 AMD 인스팅트 MI430X 가속기는 과학기술 연산과 소버린 AI를 위한 AMD의 최고 성능 HPC 가속기로, 최대 288TFLOPS의 하드웨어 기반 FP64 성능을 제공한다. AMD 인스팅트 MI430X는 미국과 유럽의 차세대 엑사스케일 슈퍼컴퓨터 구축에도 적용될 예정이다. AMD 인스팅트 MI350P GPU는 기존 AI 인프라에서도 손쉽게 AI 가속 기능을 추가할 수 있도록 설계됐으며, 뛰어난 토큰 처리 경제성을 제공한다. AMD 인스팅트 MI350P GPU는 경쟁 제품 대비 달러당 최대 4.2배 높은 초당 토큰 처리 성능을 제공한다. 리사 수 AMD 최고경영자(CEO)는 "AMD는 생태계 전반의 다양한 파트너들과 협력해 업계를 선도하는 컴퓨팅 기술과 개방형 플랫폼을 제공함으로써, 고객들이 데이터센터부터 엣지까지 AI를 더욱 뛰어난 성능과 유연성, 그리고 폭넓은 선택지를 바탕으로 확장할 수 있도록 지원하고 있다"고 말했다.

2026.07.24 11:20장경윤 기자

인텔, 2분기 AI발 수요 광풍에 15년만 최고 매출 성장률

인텔이 인공지능(AI)발 컴퓨팅 수요 폭증에 힘입어 15년 만에 가장 높은 분기 매출 성장률을 기록했다. 고객들과 중앙처리장치(CPU) 장기 공급 계약을 체결해 이 같은 성장 흐름은 당분간 지속될 전망이다. 인텔은 지난 23일(현지시간) 2분기 실적발표를 통해 매출 161억3000만 달러를 기록했다고 밝혔다. 이는 전분기 대비 19%, 전년 동기 대비 25% 증가한 수치로 시장 예상치를 12% 웃돈 수치다. 매출총이익률(GPM)은 41.8%로 전분기 대비 2%포인트, 전년 동기 대비 12.1%포인트 개선됐다. 희석 주당순이익(EPS)은 0.42달러로 전분기 대비 45% 늘며 전년 동기 적자에서 흑자로 돌아섰다. CPU 장기 공급계약 체결…설비투자 200억 달러로 증액 립부 탄 인텔 최고경영자(CEO)는 "AI가 전례 없는 수준의 컴퓨팅 수요를 이끌고 있으며, 인텔은 전략을 차질 없이 실행해 CPU 사업, 맞춤형반도체(ASIC), 첨단 패키징, 광범위한 웨이퍼 파운드리 네트워크 전반에서 지속 가능한 성장을 실현할 수 있는 유리한 위치에 있다"며 "2분기 실적은 속도, 책임경영, 고객 중심 전략을 강화한 결과로, 지난 15년여 동안 가장 높은 매출 성장률을 기록다"고 말했다. AI가 CPU의 전례 없는 수요를 일으킨 가운데, 공장(팹) 수율 상승과 생산 리드타임 단축으로 생산량이 예상보다 늘어난 것이 시장 예상치 상회의 배경이다. 데이브 진스너 인텔 최고재무책임자(CFO)는 "인텔은 견조한 수요와 실행력 개선에 힘입어 2분기에 당초 제시한 실적 가이던스를 상회하는 성과를 거뒀다"며 "특히 공장 수율 향상과 생산 리드타임 단축으로 생산량이 예상보다 늘어난 것이 실적 개선에 기여했다"고 말했다. 그러면서 "AI가 이끄는 컴퓨팅 수요는 계속 강화되고 있으며, 올해와 내년 제품 및 파운드리 사업의 성장이 예상되는 만큼 장비, 클린룸 공간, 기판(서브스트레이트) 등에 대한 투자를 의미 있는 수준으로 확대하고 있다"고 강조했다. 인텔은 이번 분기 고객들과 CPU 장기 공급 계약을 체결했다고 밝혔다. AI 인프라 투자 확대 기조 속에 향후 수요에 대한 가시성을 확보한 셈이다. 수요 강세에 대응해 설비투자(CapEx)도 상향했다. 인텔은 올해 설비투자 규모를 기존 180억 달러에서 200억 달러로 증액하고, 2027년에는 이보다 의미 있는 수준으로 더 늘리겠다고 예고했다. 18A 기반 첫 서버 CPU '제온 6+' 출시…파운드리 리스크 생산 돌입 신제품 개발과 출시에서 진전도 잇따랐다. 인텔은 자체 최선단 공정인 '인텔 18A' 기반의 첫 서버급 제품인 차세대 데이터센터 CPU '제온(Xeon) 6+'를 출시했다. 파운드리 공정 로드맵도 순항 중이다. 차세대 CPU 제품인 '팬서레이크'의 일부 생산을 자사 파운드리 18A(1.8나노급) 공정에서 리스크 생산에 진입했다. 생산에는 ASML의 최첨단 극자외선(High-NA EUV) 노광 장비가 활용됐다. 인텔은 "50억 유로를 투자해 파운드리 생산능력을 확대하고, 인텔3(5나노급) 공정 기반의 제온6 및 차세대 제온 프로세서 생산을 늘릴 것"이라고 말했다.

2026.07.24 08:15진운용 기자

[AI 고속도로] 엔비디아, 베라 루빈 양산에 "AI 서버 경쟁판 바뀐다"

엔비디아가 차세대 인공지능(AI) 플랫폼 '베라 루빈' 기반 시스템의 양산과 고객사 구축에 들어가면서 AI 서버 시장의 경쟁 방식도 달라지고 있다. 그래픽처리장치(GPU)와 중앙처리장치(CPU), 네트워크를 개별 서버에 조립하던 방식에서 벗어나 랙 전체를 하나의 시스템으로 공급하는 구조가 확산되면서, 서버업체의 경쟁력도 자체 설계보다 생산 자동화와 액체냉각, 현장 구축 능력으로 이동하는 분위기다. 22일 블룸버그통신에 따르면 엔비디아는 베라 루빈 기반 시스템을 오픈AI와 구글 클라우드, 마이크로소프트(MS) 애저, 메타, 코어위브, 델테크놀로지스 등에 공급하고 있다. 오픈AI는 오는 3분기부터 베라 루빈을 대규모로 도입할 계획이다. 베라 루빈 NVL72는 루빈 GPU와 베라 CPU, 네트워크 칩 등을 하나의 랙에 통합한 AI 컴퓨팅 시스템이다. 개별 서버를 납품한 뒤 데이터센터에서 연결하는 방식과 달리 전력과 냉각, 네트워크까지 검증된 랙 단위로 공급해 설치 기간과 장애 위험을 줄이는 데 초점을 맞췄다. 서버 조립 방식도 달라졌다. 기존 제품은 GPU와 CPU, 네트워크 장비가 들어간 트레이를 작업자가 직접 케이블로 연결해 초기 생산 과정에서 조립 시간이 길고 불량률도 높았다. 반면 베라 루빈은 내부 케이블을 회로기판과 전용 연결장치로 대체해 사람이 수시간 동안 하던 작업을 로봇이 수분 만에 처리할 수 있도록 설계됐다. 주요 부품에 액체냉각을 적용하면서 팬과 공기 통로가 차지하던 공간도 줄였다. 같은 면적에 더 많은 연산 장치를 배치할 수 있게 되면서 서버업체의 공급 범위도 랙 조립에서 냉각수분배장치와 배관, 전력설비까지 넓어질 것으로 보인다. 이 같은 변화는 델과 슈퍼마이크로, HPE, 레노버 등 AI 서버업체의 사업 구조에도 영향을 줄 것으로 보인다. 엔비디아가 CPU와 GPU, 네트워크, 랙 구조를 표준화할수록 업체별 하드웨어 설계 차이는 줄고 생산량과 납기, 냉각 기술, 구축 서비스가 수주를 가르는 요소로 부상할 가능성이 있어서다. 특히 델은 대형 클라우드 사업자와 AI 전용 데이터센터 운영업체를 대상으로 랙 공급을 늘리는 동시에 기업용 AI 인프라 구축 사업을 확대할 여지가 커졌다. 서버와 스토리지, 네트워크, 유지관리 서비스를 함께 제공할 수 있어 단순 장비 판매보다 통합 프로젝트 수주에 유리할 수 있다. 슈퍼마이크로는 엔비디아 신형 GPU를 빠르게 서버 제품으로 내놓던 기존 강점에서 액체냉각과 랙 단위 구축 역량으로 경쟁 범위를 넓혀야 할 것으로 보인다. 제품 출시 속도만으로 차별화하기 어려워진 만큼 생산시설과 냉각설비, 현장 설치 능력이 실적에 미치는 영향도 커질 전망이다. 폭스콘과 콴타, 위윈 등 대만 전자제품위탁생산·설계 업체에는 대량 생산 기회가 늘어날 것으로 보인다. 엔비디아의 표준 설계에 따라 동일한 랙을 반복 생산하는 구조에선 자체 서버 브랜드보다 자동화 설비와 부품 조달, 생산 수율을 갖춘 제조업체가 유리해서다. HPE와 레노버는 국가 AI 인프라와 슈퍼컴퓨터, 기업 전용 AI 데이터센터 시장에서 냉각과 운영 서비스를 앞세울 가능성이 크다. AI 서버의 전력 밀도가 높아질수록 기존 데이터센터를 개조하고 시스템을 안정적으로 운영하는 기술의 중요성도 커질 것으로 보인다. 다만 서버업체의 매출 확대가 수익성 개선으로 곧바로 이어지지는 않을 것으로 예상된다. 핵심 칩과 네트워크, 시스템 설계를 엔비디아가 공급하는 구조에서 서버업체가 가져갈 수 있는 부가가치는 제조와 구축, 유지관리 영역에 집중될 수 있기 때문이다. 또 대형 클라우드 고객을 대상으로 한 가격 경쟁이 심해지면 출하량 증가에도 마진이 제한될 가능성이 있다. 경쟁사인 AMD도 분주히 움직이는 모양새다. AMD는 차세대 GPU와 CPU, 네트워크를 통합한 AI 랙 '헬리오스'를 앞세워 현재 랙 스케일 시장 공략을 강화하고 있다. 이에 클라우드 사업자들이 엔비디아 제품과 AMD 시스템, 자체 개발 칩을 함께 운용하는 멀티벤더 전략을 확대하면 서버업체의 설계·구축 부담도 커질 가능성이 있다. 이언 벅 엔비디아 부사장은 "우리는 완전한 양산 단계에 들어갔다"며 "현재 모든 주요 고객사에서 시스템(베라 루빈)을 구축하고 있다"고 말했다.

2026.07.22 15:46장유미 기자

[AI는 지금] "AI 칩도 직접 만든다"…바이트댄스, 퀄컴 손잡고 엔비디아 의존 낮추나

'틱톡' 모회사 바이트댄스가 자체 인공지능(AI) 인프라에 투입할 차세대 중앙처리장치(CPU) 개발에 속도를 내고 있다. AI 챗봇과 동영상 생성 모델 사용량이 빠르게 늘면서 엔비디아 그래픽처리장치(GPU) 중심 조달 구조를 보완하고 자체 데이터센터 운영 효율을 높이려는 움직임으로 풀이된다. 30일 사우스차이나모닝포스트(SCMP), 로이터 등 주요 외신에 따르면 바이트댄스는 차세대 자체 CPU 설계를 늦어도 내년 초까지 마무리하는 방안을 추진하고 있다. 오는 2027년 하반기 양산과 내부 AI 인프라 확대 적용을 목표로 하고 있으며 초기 버전의 자체 CPU는 지난해 말부터 내부에서 쓰인 것으로 전해졌다. 바이트댄스가 자체 반도체 투자를 늘리는 것은 내부 AI 수요가 빠르게 커지고 있어서다. 이 회사는 AI 챗봇 더우바오와 동영상 생성 모델 시댄스를 앞세워 중국 생성형 AI 시장에서 영향력을 키우고 있다. 그러나 서비스 사용량이 늘수록 추론 연산, 영상 처리, 작업 조율에 필요한 데이터센터 자원도 함께 증가한다는 점이 부담으로 작용하고 있다. AI 인프라용 CPU 개발은 에이전틱 AI 확산과도 관련이 있다. AI 워크로드가 단순 행렬 연산 중심에서 복잡한 작업 조율과 데이터 처리로 넓어지면서 고성능 CPU 역할이 다시 부각되고 있다. 바이트댄스가 자체 CPU를 개발하는 것도 AI 서비스 운영 단계에서 비용과 전력 효율을 높이려는 전략으로 읽힌다. 이 과정에서 퀄컴과의 협력 가능성도 거론된다. 로이터에 따르면 퀄컴은 바이트댄스에 맞춤형 반도체 설계 서비스를 제공하는 방안을 논의하고 있다. 논의 대상에는 주문형반도체(ASIC)가 포함됐으며 일부는 연말 양산을 목표로 한 비디오처리장치(VPU) 설계와 관련된 것으로 전해졌다. VPU는 동영상 처리에 특화된 반도체다. 틱톡과 더우인 등 대규모 영상 플랫폼을 운영하는 바이트댄스 입장에선 영상 처리 비용을 낮추는 데 활용할 수 있다. CPU와 ASIC, VPU를 함께 검토하는 것은 AI 서비스와 영상 플랫폼 운영에 맞춰 인프라 비용 구조를 세분화하려는 시도로 볼 수 있다. 퀄컴 입장에서도 바이트댄스 협력은 데이터센터 반도체 사업 확대의 계기가 될 수 있다. 퀄컴은 스마트폰용 애플리케이션프로세서(AP)와 통신칩을 주력으로 성장했지만 최근 AI 데이터센터 시장 진입을 본격화하고 있다. 메타는 퀄컴의 데이터센터 CPU '드래곤플라이 C1000'을 차세대 서버 인프라에 사용할 예정이다. 바이트댄스가 자체 칩 개발과 외부 협력을 병행하는 데는 공급망 부담도 있다. AI 반도체는 설계뿐 아니라 파운드리 생산능력과 첨단 패키징 확보가 실제 서비스 투입 시점을 좌우한다. 엔비디아 GPU와 구글 TPU 등 대형 AI 칩 수요가 TSMC 첨단 패키징 생산능력에 몰리면서 신규 맞춤형 칩을 설계하는 기업들의 물량 확보 경쟁도 커지고 있다. 중국 빅테크들은 미국의 첨단 AI 반도체 수출 통제 속에서 자체 칩 개발과 중국산 AI 반도체 조달을 병행하고 있다. 바이트댄스도 비런테크놀로지, 메타X, 일루바타 코어X, 무어스레드, 엔플레임테크놀로지 등 중국 반도체 기업 제품을 조달해 온 것으로 전해졌다. SCMP는 이달 초 바이트댄스가 상하이 일루바타로부터 AI 프로세서 수만 개를 구매했다고 보도했다. SCMP는 "바이트댄스가 자체 반도체 포트폴리오를 구축하고 AI 인프라에 자체 개발 하드웨어를 더 많이 통합하려는 움직임을 보이고 있다"며 "웨이퍼 제조부터 첨단 패키징까지 병목이 이어지는 상황에서 퀄컴과의 협력은 개발 속도를 높이고 파운드리 생산능력을 확보하기 위한 선택"이라고 짚었다.

2026.06.30 10:13장유미 기자

K-AI 모델 현장 확산 '속도'…방송 제작부터 공공행정·반도체까지

한국 기업이 독자 인공지능(AI) 모델 산업·공공 현장 적용 사례를 넓혀 K-AI 생태계 확산에 속도를 내고 있다. 과학기술정보통신부는 NC AI를 비롯한 업스테이지, KT, SK텔레콤이 방송 콘텐츠 제작부터 공공 업무 효율화, 지방자치단체 행정 AI 전환, 국산 AI 반도체 기반 모델 구동 분야에 K-AI를 적용한다고 29일 밝혔다. NC AI는 MBC 손잡고 방송 콘텐츠 후반 제작 과정에 멀티모달 AI 기술을 도입한다. 그동안 방송산업은 촬영 후 편집과 자막 삽입 등 포스트 프로덕션 과정을 수작업에 의존했다. 이에 NC AI는 시각언어모델 등 멀티모달 기술을 활용해 편집과 자막 삽입 업무의 비효율을 줄이고 전체 제작 공정을 단축할 계획이다. 방송 제작진이 기획과 연출 등 창의적 업무에 더 집중할 수 있도록 지원한다는 구상이다. 업스테이지는 조달청과 공공 업무용 생성형 AI 업무 지원 서비스 공급 계약을 맺고 조달청 공급사로 선정됐다. 업스테이지는 '솔라' 모델과 광학문자인식(OCR) 기반 문서처리 AI 기술을 에이전트로 통합한 '공공 AI 워크스페이스'를 조달청 디지털서비스몰에 등재했다. 공공 AI 워크스페이스는 한글 파일과 워드, PDF 등 문서 형식을 지원한다. 문서 작업 비중이 큰 공공 업무망에서도 안전하고 신속하게 AI를 적용해 업무 생산성과 효율성을 높이는 데 기여할 것으로 기대된다. KT는 경기도청 '경기 생성형 AI 플랫폼 구축' 사업을 통해 공공행정 AI 전환 기반을 마련하고 있다. 이 사업에는 KT가 독자 기술로 처음부터 개발한 AI 모델 '믿음 2.0'과 행정 분야 특화 데이터 체계 구축, 그래픽처리장치(GPU) 기반 AI 인프라 통합형 플랫폼 구현 등이 포함됐다. 경기 생성형 AI 플랫폼은 여러 AI 모델을 적용할 수 있는 개방형 플랫폼 구조로 구축된다. 행정문서를 비롯한 업무지침, 법령, 제도자료 등 행정 정보를 활용해 문서 작성, 자료 정리, 정보 검색, 분석 기능을 제공하고 행정업무 수행을 지원할 예정이다. 경기도는 우리 AI 모델 기반으로 '경기도 생성형 AI 플랫폼 v1.0'과 'AI 거버넌스'에 대한 한국정보통신기술협(TTA) 인증도 받았다. 이를 통해 AI 서비스 신뢰성·안전성과 운영체계에 대한 객관적 검증을 확보했다. SK텔레콤과 리벨리온은 독자 AI 파운데이션 모델 프로젝트 일환으로 SK텔레콤 AI 모델 'A.X K1'을 리벨리온 서버에서 구동했다. 해당 서버에는 국산 AI 반도체 '리벨100'이 탑재됐다. 두 기업은 5천억 파라미터 이상 초거대 모델도 국산 AI 반도체 인프라에서 운영 가능하다는 점을 확인했다. 양사는 지난해부터 에이닷 통화 녹음 요약과 엑스칼리버 등 SK텔레콤 대규모 AI 서비스를 리벨리온 신경망처리장치(NPU)로 운영해 왔다. 이번 사례는 독자 AI 모델과 국산 AI 반도체가 실제 서비스 환경에서 작동할 수 있음을 보여준 결과다. 나아가 SK텔레콤과 리벨리온은 글로벌 반도체 기업 Arm의 중앙처리장치(CPU)와 리벨리온 NPU를 결합한 AI 서버를 공동 개발하고 SK텔레콤 데이터센터에서 실전 검증하고 있다. 정부는 이를 통해 소버린 AI 인프라의 글로벌 표준 정립 가능성도 기대하고 있다. 고현웅 업스테이지 모델테크 매니저는 "AI는 이미 일하는 방식과 산업의 기준을 빠르게 바꾸고 있다"며 "앞으로 기술 경쟁력을 지속적으로 고도화해 우리나라 AI 기술이 다양한 산업 현장에서 실질적인 혁신과 가치를 만들어낼 수 있도록 노력할 것"이라고 밝혔다.

2026.06.29 09:29김미정 기자

퀄컴·메타, 데이터센터 CPU 분야서 협력 체제 구축

퀄컴과 메타는 24일(현지시간) 데이터센터용 CPU 분야에서 향후 수 년간 여러 세대에 걸쳐 협력하겠다고 밝혔다. 퀄컴이 같은 날 공개한 데이터센터 전용 CPU '드래곤플라이 C1000'이 메타 차세대 서버에 탑재된다. 드래곤플라이 C1000은 퀄컴이 공개한 데이터센터 전용 CPU다. 5GHz 이상으로 동작하는 오라이언 코어 250개 이상을 탑재하며 PCI 익스프레스 7.0, CXL, 2TB/s 이상의 입출력 대역폭을 지원한다. 크리스티아노 아몬 퀄컴 CEO는 "대규모 데이터센터 환경을 위해 코어당 성능과 전력 효율 모두에서 혁신적인 CPU를 설계했다"며 "메타와의 다세대 계약은 이러한 접근 방식이 옳았음을 입증하는 중요한 검증"이라고 밝혔다. 그는 이어 "모바일 기기 분야에서 이어온 메타와의 협력을 데이터센터까지 확대하게 됐다"며 "이번 계약은 시작에 불과하다"고 강조했다. 메타 역시 AI 시대의 인프라 경쟁력을 이번 협력의 핵심 배경으로 제시했다. 마크 저커버그 메타 CEO는 "퀄컴이 설계하는 차세대 CPU 개발 과정에서 협력을 이어가게 돼 기쁘다"며 "전 세계 모든 사람에게 '개인 초지능'을 제공하기 위한 인프라를 빠르게 구축하고 있다"고 덧붙였다. 퀄컴은 AI 추론에 최적화된 CPU와 AI 가속기, 고속 네트워크, 개방형 소프트웨어 플랫폼을 결합한 데이터센터 전략을 추진하고 있다. 메타는 이러한 로드맵에 초기 단계부터 참여함으로써 차세대 AI 데이터센터 아키텍처 구축 과정에서 영향력을 확보할 수 있게 됐다. 드래곤플라이 C1000 CPU는 2028년 하반기부터 양산 예정이다. 메타는 차세대 서버에 이를 탑재해 각종 서비스 등에 활용 예정이다.

2026.06.25 08:25권봉석 기자

[기고] 에이전틱 AI, CPU와 GPU의 공식을 바꾼다

최근 많은 기업의 AI 인프라 전략 회의에서는 비슷한 질문이 나온다. "에이전틱 AI가 확산되면 CPU와 GPU 비율이 바뀐다는데, GPU 서버에 CPU를 조금 더 추가하면 되는 것 아닌가?" 얼핏 합리적으로 들리지만, 바로 이 지점에서 많은 기업들이 중요한 부분을 놓치고 있다. 에이전틱 AI가 가져오는 변화는 단순히 GPU 서버에 CPU를 추가하는 수준이 아니다. 이는 데이터센터 아키텍처의 구조적 변화에 가깝다. 기업 IT 의사결정자들이 이해해야 할 점은 에이전틱 AI가 AI 인프라의 공식을 다시 쓰고 있다는 사실이다. AI 인프라의 공식이 바뀌고 있다 AMD는 이러한 변화를 면밀히 관찰해 왔다. AMD는 과거 서버 CPU 시장이 연평균 18% 성장할 것으로 전망했지만, 에이전트가 만들어내는 구조적인 연산 수요 증가는 기존 시장 전망의 계산법 자체를 바꾸고 있다. AMD는 현재 서버 CPU 시장이 연평균 35% 이상 성장해 2030년에는 1200억 달러 이상 규모로 확대될 것으로 전망하고 있다. 이는 단순히 AI 수요가 늘어나기 때문만이 아니다. 에이전틱 AI가 요구하는 컴퓨팅 방식 자체가 달라지고 있기 때문이다. 생성 AI의 첫 번째 물결: 질문과 답변 중심의 AI 생성 AI의 첫 번째 물결은 비교적 단순했다. 사용자가 질문을 입력하면 모델이 응답을 생성하고 결과를 반환하는 방식이었다. 이러한 환경에서는 하나의 CPU가 4~8개의 GPU를 관리하는 구성이 일반적이었다. CPU는 스케줄링과 입출력, 시스템 관리를 담당하고 GPU는 대규모 연산을 수행했다. 에이전틱 AI는 단순한 '챗봇+도구'가 아니다 하지만 에이전틱 AI는 다르다. 에이전틱 AI는 단순히 챗봇에 몇 가지 도구를 추가한 형태가 아니다. 에이전트는 단순히 질문에 답하는 데 그치지 않고 목표를 여러 단계로 나누고, 정보를 검색하고, 데이터베이스를 조회하고, API를 호출하며, 기업용 애플리케이션과 상호작용한다. 또한 결과를 검증하고 다음 행동을 결정하는 과정을 반복한다. 이는 기존의 '질문-응답' 중심 AI와는 전혀 다른 형태의 작업이다. AI가 답변을 생성하는 단계를 넘어 실제 업무를 수행하기 시작하면서 인프라에 요구되는 역할 역시 변화하고 있다. CPU-GPU 변화의 해답은 'CPU를 더 추가하는 것'이 아니다 GPU는 여전히 모델 실행에 필수적인 역할을 담당한다. 그러나 실제 운영 환경에서 증가하는 작업은 점점 더 CPU 중심으로 변하고 있다. CPU는 복잡한 목표를 실행 가능한 단계로 분해하고 이를 조율하는 엔진 역할을 한다. 또한 API와 기업용 애플리케이션을 호출해 에이전트가 실제 작업을 수행하도록 지원하며, 모든 자율적 행동이 정책과 보안 기준을 충족하는지 검증한다. 그 결과 기존 1:4 또는 1:8 수준이던 CPU와 GPU 비율은 1:1 수준으로 변화하고 있으며, 일부 환경에서는 CPU 비중이 더 높아지기도 한다. 중요한 점은 이러한 변화를 GPU 서버에 CPU를 몇 개 더 추가하는 방식만으로 해결할 수 없다는 것이다. 필요한 것은 에이전틱 AI를 위해 별도로 설계된 CPU 인프라 계층이다. AI 시스템은 하나의 서버가 아닌 분산형 시스템으로 진화한다 앞으로 기업들이 구축하게 될 AI 시스템은 하나의 거대한 AI 서버가 아닐 것이다. GPU는 고밀도 모델 연산을 담당하고, CPU는 에이전트 실행과 데이터 처리, 도구 활용을 담당하게 된다. 여기에 고성능 네트워킹과 소프트웨어가 결합돼 하나의 통합된 AI 환경을 구성하게 될 것이다. 이 과정에서 균형은 더욱 중요해진다. CPU 자원이 부족하면 GPU는 작업을 기다리게 되고, 네트워크가 병목이 되면 에이전트는 멈춘다. 데이터 흐름이 비효율적이면 지연시간은 증가하고, 동시에 많은 작업을 처리할 수 없다면 비용과 복잡성도 빠르게 높아진다. 에이전틱 AI 시대에는 어느 한 구성요소의 최고 성능보다 전체 시스템의 균형이 성능을 결정하게 된다. AMD의 접근 방식 AMD는 이러한 변화에 맞춰 다양한 AI 환경에 최적화된 에픽(EPYC) 프로세서 포트폴리오를 제공하고 있다. 지연시간에 민감한 환경을 위한 고클럭 프로세서부터 대규모 확장 환경을 위한 고밀도 코어 프로세서까지 폭넓은 선택지를 제공하며, 향후 베니스(Venice) 제품군을 포함한 로드맵을 통해 AI 최적화 CPU 포트폴리오를 지속적으로 확대해 나갈 계획이다. 기업 IT 의사결정자를 위한 제언 기업 IT 의사결정자들에게 전하고 싶은 메시지는 분명하다. 에이전틱 AI를 단순히 기존 챗봇 하나를 추가하는 프로젝트로 바라봐서는 안 된다. 대신 계획하고, 행동하고, 검증하고, 정보를 검색하며, 다양한 도구를 활용해 업무를 수행하는 새로운 디지털 노동력이 조직에 합류한다고 생각해야 한다. 이는 기업들이 기존 AI 인프라 구축 과정에서 예상했던 것보다 더 많은 CPU 자원을 계획해야 함을 의미한다. 또한 GPU 서버를 넘어 랙, 네트워크 패브릭, 소프트웨어, 그리고 시스템 전반의 균형까지 함께 고려해야 함을 의미한다. 에이전틱 AI 시대의 성능은 하나의 프로세서가 모든 것을 처리해서 얻어지는 것이 아니다. CPU와 GPU가 함께 작동해 AI를 답변 생성에서 실제 행동으로 발전시키는 올바른 아키텍처에서 나온다.

2026.06.19 10:39댄 맥나마라 컬럼니스트

슈퍼마이크로, 1GW급 'AI 팩토리' 청사진 공개…에이전틱 AI 인프라도 강화

슈퍼마이크로가 차세대 인공지능(AI) 데이터센터와 에이전틱 AI 인프라 시장 공략에 속도를 낸다. 엔비디아 차세대 AI 플랫폼 '베라 루빈' 기반 초대형 데이터센터 구축 청사진을 공개한 데 이어 Arm과 협력한 고효율 랙 스케일 인프라까지 선보이며 AI 인프라 경쟁력을 강화하는 모습이다. 슈퍼마이크로는 엔비디아 베라 루빈 NVL72 및 엔비디아 HGX 루빈 NVL8 플랫폼 기반 '데이터센터 빌딩 블록 솔루션(DCBBS)' 블루프린트를 공개했다고 4일 밝혔다. 이날 회사는 Arm AGI 중앙처리장치(CPU) 기반 엔터프라이즈 에이전틱 AI용 신규 랙 스케일 인프라도 함께 선보였다. 최근 AI 인프라 시장은 단순 그래픽처리장치(GPU) 공급 경쟁을 넘어 데이터센터 전체를 얼마나 빠르고 효율적으로 구축·운영할 수 있는지로 경쟁 축이 이동하고 있다. 특히 초거대 AI 모델 확산과 AI 에이전트 수요 증가로 컴퓨팅 성능뿐 아니라 전력·냉각·네트워크·스토리지·운영 소프트웨어를 통합 제공하는 'AI 팩토리' 구축 역량이 핵심 경쟁력으로 부상 중이다. 이번에 공개된 DCBBS 블루프린트는 5메가와트(MW)급 데이터센터부터 1기가와트(GW)급 초대형 AI 데이터센터까지 구축할 수 있도록 설계됐다. 엔비디아 최신 레퍼런스 아키텍처를 기반으로 1152개 GPU 규모 확장형 유닛을 제공하며 컴퓨팅과 스토리지, 네트워킹, 전력 인프라, 수냉식 냉각 시스템을 통합 지원한다. 이를 통해 슈퍼마이크로는 데이터센터 설계부터 구축, 운영까지 전 과정을 단일 체계로 지원한다는 목표다. 현장 시설 조사와 설계, 냉각 시스템 구성, 전력 인프라 구축, 랙 통합, 시운전, 소프트웨어 설치까지 일괄 제공해 구축 기간을 단축할 수 있다는 점을 강점을 내세우고 있다. 특히 엔비디아 베라 루빈 NVL72 플랫폼은 이전 세대 대비 GPU 메모리 대역폭과 GPU 간 연결 대역폭, 네트워크 성능이 향상돼 초거대 AI 모델 학습과 추론 환경에 최적화됐다. 슈퍼마이크로는 10만 개 이상 GPU가 적용된 대규모 수냉식 AI 데이터센터 구축 경험을 바탕으로 관련 시장 공략을 강화할 계획이다. 에이전틱 AI 시장을 겨냥한 신규 랙 스케일 인프라도 공개했다. Arm과 협력해 선보인 이번 솔루션은 Arm AGI CPU 기반으로 설계됐으며 기업 데이터센터의 AI 에이전트 워크로드 처리 효율을 높이는 데 중점을 뒀다. 신규 플랫폼은 공냉식 서버와 GPU 서버, 수냉식 멀티노드 서버 등으로 구성된다. Arm 네오버스 CSS V3 기반 CPU를 적용해 전력 효율과 컴퓨팅 집적도를 높였으며 단일 공냉식 랙 환경에서 6000개 이상의 CPU 코어를 구성할 수 있도록 설계됐다. 슈퍼마이크로는 Arm AGI CPU가 기존 아키텍처 대비 랙당 2배 이상의 성능을 제공할 수 있으며 AI 데이터센터 용량 1GW 기준 최대 100억 달러 규모 설비투자(CAPEX) 절감 효과를 지원할 수 있다고 설명했다. 이를 통해 에이전틱 AI 확산에 따른 전력과 공간 제약 문제를 해결하는 데 기여한다는 방침이다. 찰스 리앙 슈퍼마이크로 최고경영자(CEO)는 "엔비디아 베라 루빈 NVL72 플랫폼은 AI 팩토리 성능의 새로운 기준을 제시한다"며 "DCBBS 블루프린트는 5MW부터 1GW에 이르는 모든 규모의 환경을 구축할 수 있도록 검증된 엔드투엔드 구축 방식을 제공한다"고 말했다. 이어 "우리는 업계 초기부터 세계 최대 규모 수냉식 AI 팩토리를 구축해왔다"며 "이러한 경험과 노하우를 모든 블루프린트에 반영해 고객이 설계 단계부터 실제 운영 환경 구축까지 더욱 빠르게 전환할 것"이라고 덧붙였다.

2026.06.04 14:35한정호 기자

"엔비디아 RTX 스파크, Arm 윈도 PC의 전환점"

[타이베이(대만)=권봉석 기자] 엔비디아는 지난 1일(현지시간) 고성능 AI PC 'RTX 스파크'를 공개하고 Arm 기반 윈도 PC 시장에 본격 진출한다고 발표했다. RTX 스파크는 작년 출시된 AI 워크스테이션용 칩인 '블랙웰 GB10'을 바탕으로 미디어텍과 협업해 개발한 20코어 그레이스 CPU와 블랙웰 GPU까지 모든 요소를 엔비디아가 직접 설계했다. 주요 시장조사업체에 따르면 현재 Arm 기반 PC의 점유율은 최대 15% 수준이며 이 중 대부분은 애플 M시리즈 실리콘 기반 맥이 차지한다. 그러나 엔비디아의 'RTX 스파크'를 기점으로 이런 구도가 깨질 것으로 보인다. 1일 오후 대만 타이베이 르메르디앙호텔에서 만난 Arm 엣지 AI 사업부문 제임스 맥니븐 클라이언트 컴퓨팅 부사장과 파라그 비라카 컨슈머 컴퓨팅 시니어 디렉터는 "클라우드 서비스 시장에서 Arm의 급성장이 이제 PC 시장에서도 재현될 것"이라고 전망했다. "엔비디아 참가로 Arm 기반 PC 폼팩터 다양성 ↑" 주요 시장조사업체에 따르면 전체 PC 시장에서 Arm의 점유율은 최대 15% 수준으로 추산된다. 또 이 중 절대다수를 애플 M실리콘 기반 맥북에어/맥북프로 등이 차지하고 있다. 파라그 비라카 시니어 디렉터는 "클라우드 서비스 제공업체에서 Arm이 폭발적으로 성장했던 것처럼 이제 PC에서도 그 전환점이 왔다"며 "2년 전 퀄컴에 이어 엔비디아 합류로 Arm 기반 윈도 PC에서 더 다양한 폼팩터를 기대할 수 있게 됐다"고 설명했다. 제임스 맥니븐 부사장은 "더 많은 Arm 파트너사가 윈도 생태계에 합류하기를 기대해 왔고 엔비디아의 윈도 PC 시장 진출은 오래전부터 기대했던 순간"이라고 설명했다. 그는 "노트북부터 소형 워크스테이션, 타워형 시스템까지 다양한 폼팩터의 엔비디아 Arm PC 출시를 통해 Arm이 보급형 노트북부터 워크스테이션까지 전 영역을 커버할 수 있게 됐다"고 기대감을 드러냈다. "Arm, 엔비디아-미디어텍과 긴밀히 협력" 엔비디아 RTX 스파크는 고성능 Arm 코어텍스-X925와 저전력·고효율 Arm 코어텍스-A725를 각각 10코어씩 총 20코어로 구성한 그레이스 CPU를 탑재했다. Arm은 이 CPU 개발 과정에서 엔비디아, 미디어텍과 협력해 왔다. 제임스 맥니븐 부사장은 "양사와 수 년간 다양한 분야에서 협력했기 때문에 이번에도 20코어 CPU 시스템 구축이 원활하게 진행될 수 있었다"고 밝혔다. 파라그 비라카 디렉터도 "미디어텍과는 모바일 분야에서 10년 이상 협력해온 만큼 PC로의 확장은 자연스러운 흐름이었다"고 덧붙였다. "윈도 운영체제 '스케줄링' 최적화 위해 노력" 하드웨어(CPU)의 성능을 이끌어 내려면 운영체제 최적화가 반드시 필요하다. Arm은 수년간 Arm CPU의 마이크로소프트 윈도 운영체제 최적화를 지원했다. 파라그 비라카 디렉터는 "그레이스 CPU는 고성능 코어와 저전력·고효율 코어 등 두 종류 코어를 모두 갖췄다. 모든 CPU 코어에 알맞은 작업을 자동으로 분배하는 '스케줄링' 최적화가 핵심이었다"고 말했다. 이어 "이용자가 마이크로소프트 워드 등 생산성 앱을 이용할 때 작업 내용에 따라 자동으로 적절한 코어를 쓰도록 마이크로소프트와 함께 세밀하게 조정했다. 이것이 바로 진정한 하드웨어-소프트웨어 통합 최적화"라고 강조했다. "엔비디아 PC 진출, 퀄컴과 관계에 영향 못 미쳐" 퀄컴은 2016년 말부터 마이크로소프트와 협력하며 '올웨이즈 커넥티드 PC(ACPC)'라는 이름으로 Arm 기반 윈도 PC에 꾸준히 투자했다. 이런 노력이 결실을 본 것은 2024년 자체 개발 '오라이언(Oryon)' CPU를 탑재한 스냅드래곤 X 엘리트 출시 이후부터다. Arm과 퀄컴의 관계는 2020년 이후 약간의 변화를 겪었다. 오라이언 CPU 개발을 위해 퀄컴이 스타트업 '누비아(Nuvia)'를 인수하자 Arm은 라이선스 위반으로 소송을 제기했다. 그러나 2년에 걸친 소송 끝에 2024년 말 퀄컴이 판정승을 거뒀다. 이후 퀄컴은 오라이언 CPU를 설명하며 'Arm 기반'이라는 용어 대신 'Arm 호환'이라는 용어를 쓰고 있다. 일각에서는 이런 미묘한 역학관계 때문에 기존 Arm 기반 윈도 PC의 파트너였던 퀄컴과 관계 변화를 예상하기도 한다. 제임스 맥니븐 부사장은 "엔비디아의 PC 시장 진출이 퀄컴과 관계를 바꾸지 않는다. 모든 파트너의 성공이 곧 Arm의 성공이며, 모든 파트너와 지속적으로 협력할 것"이라고 원론적인 답을 내놨다. "윈도 환경의 오픈소스 AI 생태계 확대 위해 노력" 현재 오픈소스 AI 생태계는 리눅스와 맥OS(프리BSD)를 위주로 풍부하게 구성됐다. 상대적으로 열세에 있는 윈도 환경의 확장도 Arm의 주요 과제 중 하나다. 제임스 맥니븐 부사장은 "윈도 환경에서 'ONNX 런타임' 성능 최적화를 마이크로소프트와 함께 진행하고 있고 라이브러리, 가이드를 개발자에게 제공하고 있다"고 설명했다. 이어 "SME 가속화 기능을 여러 오픈소스 프레임워크에 통합했고, 텐센트와는 최신 AI 모델의 Arm 최적화 작업도 진행 중"이라고 소개했다. 향후 가장 큰 과제는 "써 보게 만드는 것" 제임스 맥니븐 부사장은 "앞으로 남은 가장 큰 도전 과제는 사람들이 Arm 기반 윈도 PC를 직접 써 보게 하는 것이다. RTX 스파크 기반 기기의 AI, 게이밍 성능과 배터리 지속시간을 체험해 봐야 인식이 바뀔 것"이라고 강조했다. 그는 "특히 아직도 매일 노트북과 충전기를 들고 다니는 사람들이 많은데, 이것이 얼마나 혁신적으로 바뀌었는지 직접 경험하는 것이 중요하다"고 말했다. 파라그 비라카 디렉터는 "Arm 내부에서도 윈도 PC를 대규모 도입해 쓰고 있다. 한국 기업에서도 Arm 윈도 PC를 업무 환경에 도입하면 예상보다 많은 영역에서 워크플로우를 개선하고 유용한 점을 발견할 수 있을 것"이라고 조언했다.

2026.06.03 11:37권봉석 기자

  Prev 1 2 3 4 Next  

지금 뜨는 기사

이시각 헤드라인

SK하이닉스 손자회사 솔리다임, 美 첫 낸드 공장 구축 추진

피지컬 AI, 너 내 동료가 돼라…HD현대가 그리는 미래 조선소

곰곰·코멧·탐사 PB상품 총출동…‘쿠팡 온리 페스타’ 가보니

DDI 부족...삼성, 갤Z폴드8 이달 부품 생산계획 10% 다음달로 이연

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.