• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
국감2026
AI페스타26
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'슈퍼팟'통합검색 결과 입니다. (2건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

슈퍼팟 1천세트 깔았다…화웨이 'AI 풀스택'의 힘

화웨이가 AI 컴퓨팅부터 스토리지와 네트워크, 전력과 냉각, 소프트웨어와 애플리케이션까지 아우르는 'AI 풀스택' 기술력을 과시했다. 산업 현장에서 실제 활용되는 서비스까지 직접 연결하며 AI 데이터센터 전 영역을 아우르는 모습이다. 화웨이는 서울 삼성동 코엑스에서 열린 'AI 페스타 2026'에서 AI 데이터센터를 구성하는 하드웨어와 소프트웨어, 산업별 솔루션을 공개했다. 화웨이의 AI 풀스택은 컴퓨팅과 AI 스토리지, 네트워크를 비롯해 전력·공랭·수랭 등 데이터센터 설비를 기반으로 클라우드와 AI 플랫폼, 애플리케이션까지 연결하는 구조다. CANN 규격의 오픈클라우드 기반으로 비용 부담을 줄일 수 있고 딥시크와 큐원 등 다양한 대규모언어모델(LLM)과 외부 플랫폼도 지원한다. 이같은 장점을 내세워 실제 상용화 규모도 상당 수준에 이르렀다. 화웨이 전시 담당자는 “여러 시리즈를 합쳐 슈퍼팟(SuperPoD)은 1천세트 이상 상용화됐다”고 설명했다. 애플리케이션 생태계에서는 300개 이상의 파트너와 410만명의 개발자가 참여해 700개 이상의 솔루션을 구축했다. 풀스택 컴퓨팅 기술이 실제 산업에 적용된 사례도 소개됐다. 부스에 전시된 '아틀라스(Atlas) 850E'는 여러 NPU를 연결해 대규모 AI 연산을 처리하는 서버다. 슈퍼팟으로 구성하면 32개에서 최대 1천24개의 NPU까지 확장할 수 있다. 전시 담당자는 아틀라스 850E가 중국 뤼진병원에서 19개 암종을 판단하는 데 활용된 것을 시작으로 현재 90개 병원에서 사용되고 있다고 설명했다. 단순히 대규모 AI 모델을 학습하는 컴퓨팅 인프라를 넘어 의료 현장의 AI 추론에도 실제 적용되고 있다는 것이다. AI 풀스택의 또 다른 경쟁력으로는 스토리지를 강조했다. AI 학습과 추론에서는 대규모 데이터를 저장하는 용량뿐 아니라 데이터에 빠르게 접근하는 성능과 서비스가 중단되지 않는 안정성이 중요하다. 특히 화웨이는 스토리지 신뢰성을 '에잇 나인(99.999999%)' 수준으로 설명했다. 전시 담당자는 “1년을 기준으로 장애 허용시간이 0.3초 미만인 수준”이라며 “사실상 미션크리티컬한 의료를 비롯해 금융과 같이 서비스 연속성이 중요한 분야에서 활용되는 제품”이라고 말했다. AI에 특화된 데이터 처리 성능도 함께 내세웠다. '오션스토어 퍼시픽 9928·9926'은 대규모 데이터를 통합 관리하면서 AI 학습에 필요한 데이터를 공급한다. 화웨이에 따르면 데이터 집적도는 기존 3PB/2U에서 최대 8PB/2U로 높였고, 100억개 이상 파일의 검색시간은 약 30초에서 3초로 줄였다. 추론에서는 '오션스토어 A800'과 '오션스토어 도라도' 등을 활용한 다계층 KV 캐시 기술을 적용한다. 화웨이는 이를 통해 첫 토큰 생성시간(TTFT)을 58초에서 3.8초로 줄이고 시스템 처리량은 초당 200토큰에서 600토큰으로 높일 수 있다고 설명했다.

2026.10.07 16:57박수형 기자

100조 파라미터 시대…화웨이, 수천개 칩 '한 대처럼' 묶는다

AI 모델이 5년 안에 100조개 파라미터 규모로 커지고 하루 처리하는 토큰도 100경개에 이를 것으로 예상된다. 화웨이는 개별 칩 성능을 높이거나 서버를 단순히 늘리는 방식으로는 이 같은 폭발적인 컴퓨팅 수요를 감당하기 어렵다고 보고, 수천~수만개의 가속기와 CPU, 메모리, 스토리지를 하나의 거대한 컴퓨터처럼 연결하는 방식으로 대응하고 있다. 브랜든 우 화웨이 아시아태평양(APAC) 최고기술책임자(CTO)는 7일 서울 삼성동 코엑스에서 열린 'AI 페스타 2026' 퓨처테크컨퍼런스에서 기조연설을 맡아 “대규모 모델과 AI 에이전트, 온디바이스 AI가 지속적으로 발전하면서 AI 인프라에 요구되는 규모와 성능, 안정성, 에너지 효율에 대한 기준도 높아지고 있다”고 밝혔다. 우 CTO는 “2020년 1750억개 수준이던 모델 파라미터가 앞으로 5년 안에 100조개까지 늘어날 것”이라며 “2년 전 하루 100억개 수준이던 토큰은 현재 5000억개로 늘었고, 5년 뒤에는 100경개에 이를 것으로 예상한다”고 말했다. 문제는 AI 모델이 커지는 만큼 컴퓨팅 자원을 늘리는 것만으로 성능이 따라오지 않는다는 점이다. 수만개의 가속기를 연결하면 실제 계산보다 장치끼리 데이터를 주고받는 데 상당한 시간이 쓰이기 때문이다. 우 CTO는 “수백조개 파라미터를 다룰 때는 거대한 시스템이 필요하고, 이런 호스팅 서비스를 전통적인 기술로 운영하면 문제에 직면하게 된다”며 “10조개 파라미터 모델에 10만개의 카드를 사용한다고 하면 실제 컴퓨팅에 사용되는 시간은 44% 수준”이라고 설명했다. 이어 “나머지는 통신을 위한 것”이라며 “학습 시간의 절반가량이 다른 장치 간 통신을 처리하는 데 소요된다”고 말했다. 수천개 칩을 하나의 컴퓨터처럼 화웨이가 이 같은 한계를 넘기 위해 제시한 것이 '슈퍼팟(SuperPoD)' 컴퓨팅 아키텍처다. NPU와 GPU, CPU, 메모리, 스토리지 등 서로 다른 컴퓨팅 자원을 고속으로 연결해 여러 장치가 하나의 거대한 시스템처럼 움직이도록 하는 것이 핵심이다. 우 CTO는 “슈퍼팟 아키텍처가 필요한 이유”라며 “서로 다른 이기종 컴퓨팅 자원의 통합과 피어투피어(P2P) 연결, 풀메시 통신, 통합 프로토콜과 메모리 어드레싱 등이 핵심 요건”이라고 말했다. 그는 “통일된 프로토콜로 통신해야 한다”며 “프로토콜을 변환하면서 발생하는 오버헤드를 막기 위해 하나의 언어로 소통해야 한다”고 말했다. 이어 “통합된 메모리 어드레싱이 필요하고, 노드가 추가되더라도 이런 구조를 유지해야 한다”며 “소규모 배포에서 대규모 배포까지 선형적으로 확장할 수 있는 시스템이 필요하다”고 설명했다. 장치 사이의 거리가 멀어질수록 광통신의 역할도 커진다. 우 CTO는 “장거리 연결을 위해서는 광 연결이 필요하다”며 데이터센터 내부의 서버와 랙뿐 아니라 더 큰 규모의 컴퓨팅 클러스터를 연결하기 위한 광 기반 상호연결 기술을 강조했다. 화웨이는 지난해 9월 첫 슈퍼팟 컴퓨팅 아키텍처를 선보인 뒤 시스템 규모를 확대하고 있다. 우 CTO는 수천개의 가속기를 하나의 시스템으로 묶는 '아틀라스 950' 수냉식 슈퍼팟을 소개하며, 대규모 환경에서 기존 방식보다 높은 컴퓨팅 효율을 확보할 수 있다고 설명했다. 그는 “5만개의 카드를 투입한다고 했을 때 슈퍼팟과 같은 시스템을 사용하면 전통적인 시스템보다 3배 높은 성능을 달성할 수 있다”고 말했다. 이 같은 접근법은 AI 가속기에만 적용되지 않는다. 범용 컴퓨팅에서도 여러 CPU를 하나의 거대한 CPU처럼 사용할 수 있도록 하는 '쿤펑(Kunpeng) 범용 슈퍼팟'을 적용한다. 우 CTO는 “AI 컴퓨팅도 그렇지만 일반 컴퓨팅도 똑같다”며 “마치 하나의 거대한 CPU처럼 작동할 수 있는 수천개의 CPU가 필요하다”고 설명했다. 메모리·스토리지까지 함께 바꾼다 모델 규모와 함께 컨텍스트 윈도가 길어지면서 메모리와 스토리지 역시 새로운 병목으로 떠오르고 있다. 특히 AI 추론 과정에서 이전 대화와 데이터를 기억하기 위한 KV 캐시가 빠르게 증가하고 있다. 우 CTO는 “이런 모델은 긴 컨텍스트 윈도를 사용하기 때문에 훨씬 큰 캐시가 필요하다”며 “적어도 페타바이트 규모를 이야기하고 있다”고 말했다. 모든 데이터를 고대역폭메모리(HBM)나 D램에 올려놓는 방식 대신 메모리와 고속 스토리지를 계층적으로 활용해야 한다는 설명이다. 화웨이는 이를 위해 '다중 계층 KV 캐싱' 구조를 도입했다. 우 CTO는 “단순히 모든 데이터를 HBM이나 D램에 저장하는 것이 아니라 새로운 대규모 고속 스토리지를 활용한다”며 대규모 추론 환경을 위한 '오션스토어(OceanStor) M900'을 소개했다. 그는 이 시스템을 통해 최대 64페타바이트(PB) 규모의 스토리지를 구성할 수 있다고 설명했다. 가속기 간 연결에는 NPO(Near-Packaged Optics) 방식의 광학 기술도 적용한다. 대규모 AI 클러스터에서 연결 효율을 높여 컴퓨팅 자원의 활용률을 끌어올리고 지연시간을 줄이기 위한 기술이다. 슈퍼팟 하나를 넘어 여러 시스템을 다시 연결하는 방안도 추진한다. 우 CTO는 “8천개나 10만개의 카드로도 충분하지 않다면 어떻게 해야 하느냐”며 “50만개의 GPU가 필요한 시스템을 구축할 수도 있다”고 말했다. 이어 2계층 교차 네트워킹을 활용하면 여러 슈퍼팟을 다시 연결해 시스템을 확장할 수 있다며 궁극적으로 100만개 이상의 가속기까지 늘릴 수 있는 구조를 제시했다. 화웨이가 강조하는 것은 특정 칩 하나의 성능보다 컴퓨팅과 네트워크, 메모리, 스토리지를 하나의 시스템으로 설계하는 방식이다. AI 모델과 서비스가 커질수록 개별 장비의 성능보다 전체 자원을 얼마나 효율적으로 묶어 사용할 수 있느냐가 중요해진다는 판단이다. 우 CTO는 “화웨이는 AI 인프라에 집중해 컴퓨팅, 네트워크, 스토리지 등 기술 혁신과 시스템 아키텍처 최적화를 통해 고객에게 다양한 컴퓨팅 파워 선택지와 유연한 온프레미스 배포 및 클라우드 서비스 방안을 제공하고 있다”고 말했다. 이어 “오픈소스 개방형 컴퓨팅 생태계 구축을 지속 추진하며 주요 모델 적용과 애플리케이션 혁신을 지원하고, 산업 파트너와 함께 다양한 시나리오에 맞는 AI 배포 방식을 모색하고 있다”고 덧붙였다. 그는 “한국 고객 및 파트너와의 기술 교류 협력을 강화해 AI 인프라가 실제 비즈니스 수요를 충족하고 각 산업의 지능화를 착실히 지원할 수 있기를 기대한다”고 밝혔다.

2026.10.07 16:14박수형 기자

  Prev 1 Next  

지금 뜨는 기사

이시각 헤드라인

누리호 군집위성 6호 교신 성공…큐브 1기는 '사망'

현대차 "로봇, 실험실에선 완성 못 한다"…양산 조건은 '현장 검증'

홈플러스, 희망퇴직…"미지급 급여·퇴직금 지급"

"글로벌 AI 협력 강화 최선"...류제명, 주한대사단과 한국 AI 생태계 탐방

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.