• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'Envidia'통합검색 결과 입니다. (5건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI는 지금] AMD 추격에 '쿠다' 더 세졌다…엔비디아, AI SW 주도권 강화 가속

엔비디아가 인공지능(AI) 가속기 시장의 주도권을 지키기 위해 소프트웨어 경쟁력을 한층 강화하고 있다. 차세대 그래픽처리장치(GPU)인 '루빈' 출하가 시작된 가운데 쿠다(CUDA)의 개발 지원을 확대하고 공유 GPU 관리와 AI 코딩 기능까지 고도화하면서 기업과 개발자를 자사 생태계에 더욱 깊숙이 끌어들이려는 모양새다. 엔비디아는 지난 9일 '쿠다 툴킷 13.4'를 공개했다고 10일 밝혔다. 이번 버전에는 차세대 GPU '루빈' 아키텍처 지원을 비롯해 공유 GPU 관리, 쿠다 파이썬과 C++ 라이브러리, AI 개발 도구 관련 기능이 추가됐다. 루빈 지원은 개발자 프리뷰 형태로 제공된다. 이에 따라 개발자들은 정식 지원에 앞서 기존 애플리케이션과 라이브러리를 루빈 환경에 맞게 점검하고 이전 작업을 준비할 수 있다. 최근 루빈 공급이 시작된 가운데 엔비디아는 하드웨어 도입과 함께 이번 일로 소프트웨어 전환 준비까지 앞당기려는 분위기다. 다만 루빈 지원 기능은 아직 개발자 프리뷰 단계로, 성능 벤치마크나 성능 분석, 실제 서비스 배포 용도로는 권장되지 않는다. 엔비디아는 이번에 기업들이 보유한 GPU를 효율적으로 활용하기 위한 기능도 강화했다. 특히 '멀티 프로세스 서비스(MPS) V3'는 기존 MPS의 제어 계층을 개편해 하나의 GPU를 여러 작업이 공유할 때 자원 배분을 보다 세밀하게 설정할 수 있도록 한 것이 특징이다. 이번 일로 기업들은 스트리밍 멀티프로세서(SM)를 나눠 사용하거나 컨테이너별 GPU 메모리 한도를 설정할 수 있으며 작업의 실행 우선순위도 관리할 수 있다. 또 여러 AI 모델과 에이전트를 동시에 운영하는 기업이나 클라우드 사업자가 GPU 사용률을 높이면서 워크로드별 자원을 구분하는 데도 활용할 수 있다. 이 같은 기능은 기업의 AI 투자가 모델 학습에서 실제 서비스 운영으로 확대되면서 중요성이 커지고 있다. 고가 GPU를 특정 작업이 독점하기보다 여러 워크로드를 공유할 수 있을수록 같은 인프라에서 처리할 수 있는 AI 서비스가 늘어나기 때문이다. 이에 엔비디아도 쿠다의 역할을 GPU 프로그래밍뿐 아니라 공유 자원 관리까지 지속적으로 넓히고 있다. 개발자가 쿠다를 사용하는 방식도 이번 일로 단순해졌다. 쿠다 파이썬은 공개 API에 타입 정보를 제공해 통합개발환경(IDE)이나 코딩 에이전트가 함수 구조와 반환형 등을 파악하기 쉽게 만들었다. 쿠다 C++에서는 카피 이프(copy_if), 파인드 이프(find_if), 리듀스(reduce), 트랜스폼(transform) 등 개발자가 익숙한 표준 라이브러리 방식으로 GPU 병렬 연산을 처리할 수 있게 했다. AI 코딩 에이전트를 활용한 개발 환경도 확대했다. 엔비디아는 '엔사이트 AI(Nsight AI)'를 통해 최신 쿠다 문서와 코드 예제를 지원되는 AI 코딩 에이전트에 연결하는 '쿠다 MCP 서버'를 제공한다. 개발자가 문서를 직접 검색하는 부담을 줄이고 AI의 도움을 받아 쿠다 소프트웨어를 개발할 수 있도록 한 것이다. 운영체제 지원 범위도 넓혔다. 쿠다 13.4는 RTX 스파크 기기를 대상으로 윈도 온 Arm을 새롭게 지원한다. Arm 환경에서 리눅스를 넘어 윈도까지 쿠다 개발 영역을 확대한 것이다. 엔비디아가 소프트웨어 생태계를 강화하는 사이 AMD도 추격에 속도를 내고 있다. AMD는 지난달 27일 'ROCm 10'과 AI 기반 개발 환경 'ROCm.AI'를 정식 출시했다. ROCm.AI는 개발자가 기존 AI 개발 도구를 이용해 AMD 하드웨어에서 워크로드를 구축하고 실행·최적화할 수 있도록 지원한다. 이처럼 AMD가 개발 편의성과 호환성 강화에 공을 들이는 것도 기업의 가속기 선택에서 소프트웨어가 차지하는 비중이 커지고 있어서다. 이미 사용 중인 모델과 라이브러리, 개발도구를 다른 GPU 환경에서도 그대로 활용하기 어렵다면, 별도 검증과 최적화가 필요해 전환 비용이 커질 수 있다. 업계 관계자는 "AI 가속기는 단순히 칩 성능만 보고 바꾸기 어렵다"며 "기존 소프트웨어와 개발 환경을 얼마나 적은 비용으로 옮길 수 있느냐가 실제 도입 결정에 큰 영향을 줄 것"이라고 말했다.

2026.09.10 18:46장유미 기자

[AI 고속도로] "네트워크만으론 부족"…시스코, AI 데이터센터 풀스택으로 영역 확대

시스코가 슈퍼마이크로와 손잡고 인공지능(AI) 데이터센터 사업을 네트워크 중심에서 랙스케일 풀스택 인프라로 확대한다. 엔비디아의 차세대 그래픽처리장치(GPU) 시스템에 서버·네트워크·액체냉각·보안·운영을 통합해 공급하면서 AI 데이터센터 시장의 경쟁도 개별 장비에서 통합 구축 역량 중심으로 빠르게 옮겨가는 모습이다. 시스코는 25일(현지시간) 공식 홈페이지를 통해 슈퍼마이크로와 손잡고 '엔비디아 기반 시스코 시큐어 AI 팩토리'를 랙스케일 AI 컴퓨팅 영역으로 확대한다고 발표했다. 슈퍼마이크로의 액체·공랭식 고밀도 서버를 자사 AI 인프라 포트폴리오에 포함하고 오는 10월부터 공급할 예정이다. 이번 협력으로 시스코는 기존 강점인 네트워크와 보안에 GPU 컴퓨팅과 냉각까지 결합한 통합 AI 인프라를 제공하게 됐다. 슈퍼마이크로는 고밀도 GPU 서버와 액체냉각 시스템을 맡고, 엔비디아는 GPU와 AI 소프트웨어를 공급하는 구조다. 지원 대상에는 엔비디아 '베라 루빈 NVL72'와 'HGX 루빈 NVL8'이 포함된다. 시스코는 자사 액체냉각 AI 네트워크 시스템과 슈퍼마이크로의 액체냉각 서버를 연결해 랙에서 네트워크 패브릭까지 아우르는 냉각 구조도 제공한다. 초거대 AI 모델 학습과 대규모 추론 환경에서 GPU뿐 아니라 전력과 냉각, 네트워크 효율이 성능과 비용을 좌우하는 상황을 겨냥한 구성이다. 시스코는 이번 확장을 통해 기업 고객뿐 아니라 네오클라우드와 소버린 클라우드 시장까지 공략한다. 엔비디아 클라우드 파트너(NCP) 규격에 맞춰 프런트엔드에는 시스코 '실리콘 원' 기반 스위치, 백엔드에는 엔비디아 '스펙트럼-X' 기반 시스코 스위치를 적용하고 이를 '넥서스 원'으로 통합한다. 시스코는 자사 스위치와 네트워크 운영체제를 활용해 NCP 규격을 충족하는 구조를 차별점으로 내세웠다. 시장에선 이번 협력이 AI 데이터센터 경쟁 구도를 한 단계 더 넓히는 계기가 될 것으로 보인다. 지금까지 델과 HPE, 레노버, 슈퍼마이크로 등이 GPU 서버를 중심으로 경쟁했다면, 앞으로는 서버와 네트워크, 냉각, 보안, 운영을 얼마나 빠르게 통합해 가동하느냐가 중요해질 가능성이 커졌다. 시스코도 직접 GPU 서버를 개발하기보다 슈퍼마이크로와 협력하는 방식을 택했다. 자사가 강점을 가진 네트워크와 보안, 운영 소프트웨어를 중심으로 전체 AI 인프라를 묶고 서버 전문 업체의 기술을 결합해 시장 진입 속도를 높이려는 전략으로 풀이된다. 이번 일은 슈퍼마이크로에도 긍정적인 효과가 있을 것으로 예상된다. 시스코의 글로벌 기업 고객과 판매망을 활용할 수 있는 데다 자사 고밀도 GPU 서버와 액체냉각 시스템이 시스코의 AI 인프라 포트폴리오에 포함되면서 판매 채널을 넓힐 수 있기 때문이다. 다만 양사는 구체적인 주문 규모와 매출 목표는 공개하지 않았다. 시스코는 인프라 구축 이후 운영 효율을 높이기 위한 서비스도 강화한다. 또 새 검증 서비스 'CVIS'를 통해 실제 구축된 시스템이 설계된 레퍼런스 아키텍처와 일치하는지 확인하고 대규모 AI 연구소를 통해 관련 도구와 소프트웨어 검증 역량도 확대할 계획이다. 더불어 엔비디아 AI 엔터프라이즈와 시스코 클라우드 컨트롤 기반 에이전틱옵스도 연계해 컴퓨팅과 네트워크 인터페이스 카드(NIC), 광통신, 네트워크 상태를 통합 관리하도록 지원한다. 지투 파텔 시스코 사장 겸 최고제품책임자(CPO)는 "우리는 역사상 가장 큰 데이터센터 구축 사이클 중 하나의 시작점에 있다"며 "모든 조직이 AI 확장을 서두르고 있지만 데이터 통제와 토큰 비용 관리, 실질적인 투자수익률을 함께 확보해야 한다"고 말했다.

2026.08.26 10:18장유미 기자

[AI는 지금] GPU만 빠르면 끝?…AI 에이전트 시대, '추론 SW'가 판 바꾼다

인공지능(AI) 에이전트 확산으로 AI 인프라 경쟁의 무게중심이 그래픽처리장치(GPU) 연산 성능에서 추론 소프트웨어와 서빙 시스템 전반으로 넓어지고 있다. 대화형 AI보다 훨씬 긴 컨텍스트를 유지하고 도구 호출과 반복 추론을 수행하는 AI 에이전트가 늘면서 KV 캐시 관리와 요청 스케줄링, 모델 병렬화 같은 소프트웨어 기술이 실제 서비스 성능과 비용을 좌우하는 요소로 떠오르고 있다. 26일 엔비디아에 따르면 차세대 AI 시스템 '베라 루빈 NVL72'는 세미애널리시스의 에이전틱 AI 벤치마크 '에이전트X'를 이용한 자체 시험에서 GB300 NVL72보다 메가와트당 AI 처리량이 최대 30배 높았다. 이번 수치는 엔비디아가 측정한 프리뷰 결과로, 현재 세미애널리시스의 검토를 기다리고 있다. 현재 세대인 GB300 NVL72에서도 성능 격차가 확인됐다. 딥시크 V4 프로 1.6T를 구동했을 때 H200 NVL8 대비 메가와트당 처리량이 최대 15배 높았으며, 키미 K3 2.8T에서는 비슷한 인터랙티브 성능을 기준으로 최대 80배까지 격차가 벌어졌다. 엔비디아는 GB300 NVL72를 사용할 경우 일부 조건에서 H200 NVL8보다 100만 토큰당 비용도 최대 10분의 1 수준으로 낮출 수 있다고 설명했다. 이번 결과에서 주목할 부분은 GPU 세대별 연산 성능 차이만은 아니다. 에이전트X가 기존 AI 벤치마크와 달리 실제 코딩 에이전트가 작동하는 방식을 재현하면서 AI 소프트웨어의 역할을 성능 평가에 본격적으로 끌어들였기 때문이다. 기존 추론 벤치마크는 8K 입력과 1K 출력처럼 길이가 정해진 요청을 반복해 GPU의 처리 성능을 측정하는 경우가 많았다. AI 에이전트는 이전 작업을 기억하면서 컨텍스트가 계속 길어지고 추론 도중 외부 도구를 호출하거나 다른 에이전트에 작업을 넘기기도 한다. 이를 두고 세미애널리시스는 "장문·멀티턴·높은 프리픽스 재사용과 서브에이전트 실행이 실제 AI 서비스 트래픽에서 중요해졌다"며 "그러면서 고정 길이 평가만으로 하드웨어와 소프트웨어 성능을 측정하기 어려워졌다"고 설명했다. 에이전트X는 이를 반영해 실제 클로드 코드 세션에서 발생한 요청 패턴을 재생한다. 턴이 진행될수록 컨텍스트가 누적되는 과정뿐 아니라 도구 호출로 모델이 대기하는 시간까지 반영하고 여러 에이전트가 동시에 작동할 때 처리량과 응답 속도가 어떻게 변하는지도 측정한다. 이에 따라 GPU 자체의 연산 속도뿐 아니라 추론 엔진과 캐시, 라우터가 얼마나 효율적으로 움직이는지가 결과에 영향을 미친다. 세미애널리시스는 에이전트X를 이용한 최적화 과정에서 vLLM의 프리픽스 캐시 적중률이 일부 조건에서 95%를 넘었으며 CPU로 KV 캐시를 오프로딩하는 방식에서는 재연산 대비 출력 처리량이 81.7% 높아진 사례도 공개했다. 세미애널리시스는 "실제 환경은 멀티턴·긴 컨텍스트와 높은 프리필 재사용, 서브에이전트 실행과 수많은 도구 호출로 구성된다"고 설명했다. 이번 일로 AI 소프트웨어 업체에도 향후 변화가 예상된다. 기존에는 쿠다(CUDA) 같은 GPU 프로그래밍 플랫폼과 vLLM·SGLang·텐서RT-LLM 등 추론 엔진의 연산 최적화가 주요 경쟁 영역이었다면, 에이전틱 AI에선 여러 소프트웨어 계층을 하나의 시스템으로 묶어 운영하는 능력이 중요해지고 있어서다. 특히 KV 캐시 관리가 핵심으로 부상하고 있다는 점은 눈여겨 볼 요소다. AI 에이전트가 작업을 수행할 때 이전 컨텍스트를 반복해서 다시 계산하지 않고 캐시에 저장된 데이터를 활용하면 GPU 연산량과 응답 시간을 줄일 수 있어서다. 반대로 동시에 많은 에이전트가 움직이면서 캐시를 제대로 관리하지 못하면 필요한 정보를 삭제하거나 같은 내용을 다시 계산하면서 GPU를 추가해도 성능이 충분히 나오지 않을 수 있다. 요청을 적절한 GPU로 배분하는 라우터와 스케줄러의 역할도 커지고 있다. 세미애널리시스의 에이전트X 시험에서는 엔비디아 추론 오케스트레이션 소프트웨어 '다이나모'의 라우팅 방식을 개선한 뒤 일부 조건에서 출력 처리량이 22.2% 증가했다. 다른 최적화에선 에이전트 세션 재생 시간이 20% 이상 단축됐다. 이는 하드웨어 교체 없이 소프트웨어 최적화만으로도 에이전틱 AI 추론 효율을 끌어올릴 수 있다는 점이 확인된 것으로 평가된다. 엔비디아도 이런 변화에 맞춰 하드웨어와 소프트웨어를 함께 묶는 전략을 강화하고 있다. GB300 NVL72의 72개 GPU를 NV링크로 연결하고 다이나모를 통해 프리필과 디코드 작업을 나누는 동시에 KV 캐시 상태와 서버 부하를 고려해 요청을 배분하는 방식이다. 이를 통해 엔비디아는 SGLang·vLLM·텐서RT-LLM과 MoE 최적화 기술까지 결합해 GPU 한 장의 성능보다 랙 단위 추론 효율을 높이는 데 초점을 두고 있다. 이에 따라 클라우드와 AI 서비스 사업자의 인프라 투자 기준도 달라질 가능성이 있다. 에이전트가 일반 챗봇보다 더 많은 토큰과 컴퓨팅 자원을 사용하는 만큼, GPU 도입 가격뿐 아니라 동일한 전력에서 얼마나 많은 사용자와 에이전트를 동시에 처리할 수 있는지가 서비스 비용을 좌우할 수 있어서다. 에이전트X도 초당 토큰 수에 더해 첫 토큰 생성 시간과 전체 지연시간, 사용자당 인터랙티브 성능, 메가와트당 처리량을 함께 평가하도록 설계됐다. 세미애널리시스는 추론 엔진과 라우터, KV 캐시 관리자, 데이터 전송 라이브러리, 클러스터 제어기가 서로 연동되는 구조를 새로운 AI 추론 환경의 핵심으로 보고 있다. 엔비디아 다이나모뿐 아니라 레드햇의 llm-d, AMD 인페라 등도 여러 추론 소프트웨어를 묶어 분산형 AI 시스템을 운영하는 방향으로 개발되고 있다. 세미애널리시스는 "에이전틱 추론은 칩이나 커널 수준의 문제가 아니라 시스템 전체의 문제"라고 강조했다.

2026.08.26 09:17장유미 기자

[AI는 지금] 오픈AI 떠난 '두뇌'에 베팅…엔비디아, 차세대 AI 주역 선점

엔비디아가 오픈AI의 기술과 제품 개발을 이끌다 독립한 핵심 인재들을 잇달아 자사 생태계로 끌어들이고 있다. 유력 연구진에 투자와 차세대 인공지능(AI) 시스템을 함께 제공하며 미래 연산 수요와 기술 주도권을 선점하려는 전략으로 풀이된다. 28일 파이낸셜타임스(FT) 등 주요 외신에 따르면 엔비디아는 일리야 수츠케버와 미라 무라티가 설립한 AI 스타트업에 대규모 자본과 차세대 '베라 루빈' 시스템을 제공했다. 챗GPT 개발에 참여한 리암 페더스가 세운 과학 AI 기업에도 투자하며 오픈AI 출신 인재들과의 접점을 넓히고 있다. 엔비디아는 수츠케버가 이끄는 세이프 슈퍼인텔리전스(SSI)에 약 50억 달러를 투자하고 장기 전략적 협력을 맺었다. SSI는 베라 루빈을 도입해 앞으로 12개월간 연산 능력을 10배 확대하고 엔비디아와 연구 시스템을 공동 최적화할 계획이다. SSI는 2024년 설립 이후 제품이나 연구 결과를 공개하지 않았지만 지난해 20억 달러를 조달하며 기업가치 320억 달러를 인정받았다. 수츠케버는 오픈AI 공동창업자이자 전 수석과학자로 GPT와 챗GPT 개발을 이끈 핵심 연구자다. 엔비디아는 지난 3월 오픈AI 최고기술책임자(CTO) 출신 무라티가 설립한 싱킹 머신스 랩에도 투자했다. 양사는 최소 1기가와트(GW) 규모의 베라 루빈 시스템을 구축하고 프런티어 모델의 학습·추론 인프라를 공동 설계하기로 했다. 수츠케버와 무라티는 오픈AI의 연구와 제품 개발을 이끈 핵심 인물이다. 엔비디아는 두 사람이 독립해 세운 기업에 잇달아 투자하고 차세대 그래픽처리장치(GPU)를 공급하며 초기 연구 단계부터 협력 관계를 구축하고 있다. 엔비디아의 투자 범위는 과학 AI로도 확대되고 있다. 엔비디아는 오픈AI 연구부문 부사장 출신 페더스가 공동 설립한 페리오딕 랩스의 3억 달러 규모 초기 투자에도 참여했다. 이 회사는 AI와 로봇 실험실을 결합해 신소재와 과학적 발견을 자동화하는 기술을 개발하고 있다. 이처럼 엔비디아는 투자와 함께 GPU·네트워크·소프트웨어를 공급하며 AI 스타트업과의 협력을 확대하고 있다. 이는 유망 기업을 차세대 플랫폼의 초기 고객으로 확보하는 동시에 실제 연구 현장의 요구를 제품 개발에 반영하려는 움직임으로 풀이된다. 이 같은 투자 방식은 AI 반도체 업계 전반으로 확산하고 있다. AMD는 최근 앤트로픽에 최대 50억 달러를 투자하고 최대 2GW 규모의 '인스팅트 MI450' 기반 시스템을 공급하기로 했다. 양사는 앤트로픽 모델을 AMD GPU에 최적화하고 소프트웨어 플랫폼 'ROCm' 개선에도 협력할 계획이다. 수츠케버는 "우리는 규모를 확대할 가치가 있는 연구 성과를 확보했다"며 "엔비디아의 대규모 컴퓨팅 시스템을 활용하면 이를 더 큰 규모로 확장할 수 있다"고 말했다.

2026.07.28 10:43장유미 기자

[인터뷰] "엔비디아 사로 잡은 비결, '델 AI 팩토리' 덕분"

"바이 델(Buy Dell·델 제품을 사세요), 바이 델, 바이 델!" 지난 달 18일. 미국 새너제이에서 열린 엔비디아 연례 개발자 회의 GTC 행사에 마련된 델 테크놀로지스 부스에선 '인공지능(AI) 대부'로 불리는 젠슨 황 엔비디아 최고경영자(CEO)가 목청을 높여 이처럼 외쳤다. 컴퓨터를 필요로 하는 이들이라면 누구나 알고 있는 '델'의 PC뿐 아니라 AI 인프라 경쟁력을 인정하며 엔비디아의 가장 최고 파트너라는 점을 치켜 세워준 것이다. AI 열풍이 한창이던 1년 전 엔비디아 GTC 행사에서도 황 CEO는 델 테크놀로지스를 공개 석상에서 언급하며 끈끈한 관계를 과시했다. 당시 황 CEO는 "정보기술(IT)과 관련해 무엇이든 필요한 것이 있다면 델에 전화하면 된다"고 밝혔다. 이는 델 테크놀로지스 주가에도 영향을 줘 지난해 5월 시가총액이 1천억 달러를 넘기도 했다. 이처럼 엔비디아의 두터운 신임을 받고 있는 델 테크놀로지스가 올해 AI 인프라를 전면 업그레이드하며 시장 강자의 면모를 다시 한 번 드러내고 있다. 엔비디아 기반 델 AI 팩토리의 최신 포트폴리오를 앞세워 최근 달궈지고 있는 글로벌 AI 인프라 시장에서 주도권 굳히기에 본격 나선 모습이다. 최근 지디넷코리아와 만난 양원석 델 테크놀로지스 인프라스트럭처 솔루션 사업부 전무는 "우리는 AI PC부터 엣지, 코어 데이터센터, 클라우드까지 엔드 투 엔드(end-to-end) AI 솔루션 포트폴리오를 가지고 있다는 것이 강점"이라며 "서버 자체 기술력, 공급망 관리 능력, 영업 능력, 기술 지원 능력 등을 갖추고 있는 덕분에 글로벌뿐 아니라 한국에서도 서버 부문 1위 업체로 인정 받고 있다"고 운을 뗐다. 그러면서 "글로벌뿐 아니라 한국 스토리지 하드웨어(HW) 및 소프트웨어(SW) 부문 1위 업체로서의 저력을 갖고 있는 만큼, 데이터 및 데이터관리에 대해 전 세계에서 제일 잘 알고 있는 기업이라고 자부할 수 있다"며 "젠슨 황 CEO가 엔비디아 GTC 현장에서 '델'을 언급한 것도 이런 점을 인정한 것이라고 볼 수 있다"고 덧붙였다. 실제로 델 테크놀로지스는 글로벌 AI 인프라 시장에서 경쟁력을 입증 받아 독보적인 점유율을 유지하며 꾸준한 성장세를 보이고 있다. 특히 슈퍼마이크로, HPE 등과 경쟁하고 있는 AI 서버 시장에선 다양한 포트폴리오를 앞세워 압도적인 우위에 올라서 있다는 평가를 받고 있다. 7일 시장조사업체 IDC에 따르면 델 테크놀로지스는 지난해 3분기 전 세계 X86 서버 시장 판매대수 기준으로 11.4%의 점유율을 차지하며 1위를 유지했다. 매출 기준 점유율도 12.4%로 1위를 차지했다. 델 테크놀로지스와 경쟁하고 있는 슈퍼마이크로와 HPE, IEIT 시스템즈, 레노버는 그 뒤를 이었다. 이처럼 델 테크놀로지스가 시장 우위를 견고히 하고 있는 상황에서 전체 서버 시장의 성장세가 높다는 점은 호재로 작용하고 있다. 지난해 4분기 서버 시장 매출은 전년 동기 대비 91% 증가한 733억 달러를 기록, 2019년 이후 두 번째로 높은 성장률을 보였다. 특히 GPU가 내장된 서버 매출은 전년 동기보다 192.6%나 성장해 전체 서버 시장 매출의 절반 이상을 차지할 정도로 급성장한 모습을 보였다. 엔비디아는 전체 출하량의 90% 이상을 차지하며 서버 GPU 분야에서 독주를 이어갔다. 지난해 전체 서버 시장 규모는 2020년 이후 두 배 이상 성장한 2천357억 달러에 달했다. 엔비디아와 밀접한 관계를 맺고 있는 델 테크놀로지스도 지난해 호실적을 기록했다. 특히 AI 서버 출하액은 98억 달러로, 사업을 시작한 지 2년도 채 안되는 기간에 급속도로 성장한 모습을 보였다. AI 관련 기업 고객 역시 2천 곳 이상을 확보한 상태로, 올해 고객사 수가 더 늘어나 AI 매출이 50% 성장할 것으로 예상됐다. 올해 AI 서버 출하액은 약 150억 달러에 달할 것으로 전망했다. 양 전무는 "지난해 엔비디아 GTC에서 처음 선보인 '델 AI 팩토리 위드 엔비디아(Dell AI Factory with NVIDIA)'를 통해 다양한 솔루션과 제품을 선보이며 엄청난 컴퓨팅 파워를 시장에 공급했다고 자부하고 있다"며 "해외뿐 아니라 국내에서도 AI 시장 수요가 점차 '엔터프라이즈 AI'로 이동하고 있는 만큼 올해도 수요는 더 많아질 것으로 보인다"고 설명했다. 이어 "지난해까진 클라우드 서비스 제공자(CSP), 특히 하이퍼스케일러 또는 코어위브 같은 NCP(NVIDIA Cloud Partner) 업체들이 주축이 돼 시장 성장을 주도했지만, 올해는 더 많은 대기업, 대학, 연구기관 등 다양한 분야에서 수요가 많을 듯 하다"며 "10대 미만~수십대 등 작은 규모에서부터 거대 규모에 이르기까지 서버 규모 면에서도 더 다양해질 듯 하다"고 덧붙였다. 양 전무는 최근 국내에서 sLM(small Language Model), 온프레미스에 AI 서버를 두고 API를 사용해 클라우드 업체가 제공하는 AI 서비스와 연결해 사용하는 활용 사례(Use Case)가 늘어나고 있다는 점도 주목했다. 또 엔비디아 'H100' 위주로 형성된 GPU 시장이 향후 블랙웰, 그레이스블랙웰, AMD, 인텔 등 다양한 실리콘으로 확대될 것으로 봤다. 하지만 국내 고객들이 생성형 AI를 도입, 활용할 때 걸림돌이 많아 아직 시장이 활성화 되지 못했다는 점에 대해선 아쉬워 했다. 양 전무는 "국내에선 생성형 AI 활용 시 거버넌스와 개인정보 보호, 법적 규제 등을 고려해야 해 적절한 데이터를 수집·준비하는 과정에 있어 많은 어려움이 있을 수 있다"며 "생성형 AI를 위한 인프라는 기존 데이터센터 인프라 기술과는 달라 이를 위해 내부 역량을 확보하거나, 외부 전문 인력 채용 등을 함께 추진해야 하는 데 쉽지 않은 것이 현실"이라고 분석했다. 이어 "이에 따라 AI와 관련해 데이터 준비, 전략 수립을 위한 컨설팅, 활용 사례 생성 및 구축 등에 있어 전문 서비스를 활용하는 것이 좀 더 안전하고 체계적일 수 있다"며 "비용 측면에서 고가의 GPU에 투자하거나 퍼블릭 클라우드 서비스 사용 시 높은 운영 비용을 감당하는 데 기업들이 부담을 느끼는 경우가 많다"고 덧붙였다. 이 같은 상황에서 양 전무는 델 테크놀로지스가 좋은 대안이 될 것이라고 강조했다. 또 엔터프라이즈 기업의 경우 생성형 AI를 위해 안정적이며 보안 측면에서 신뢰할 수 있고 관리하기 쉬운 데다 데이터와 가까운 곳에 위치한 고성능의 데이터센터 인프라를 구축해야 한다고 조언했다. 양 전무는 "자사 서버 제품들은 효율화 및 생산성 향상을 위한 라이프사이클 관리의 지능적 설계 및 제어가 가능하다"며 "클라우드 인프라의 대부분의 이점도 온프레미스에서 서비스 형태(As a Service)로 제공할 수 있다"고 설명했다. 그러면서 "'델 AI 솔루션'은 경쟁사들에 비해 AI PC부터 엣지, 코어 데이터센터, 클라우드까지 엔드 투 엔드(End-to-end) AI 솔루션 포트폴리오를 갖추고 있는 데다 자사가 국내외서 스토리지 HW 및 SW 부문 1위 업체로서 데이터 및 데이터 관리에 대해 전 세계에서 가장 잘 알고 있다는 것이 강점"이라며 "코로케이션 및 호스팅 공급업체부터 AI 모델의 기반이 되는 반도체 공급업체에 이르기까지 포괄적인 파트너 생태계 스택을 제공하고 있다는 것도 매력적인 요소"라고 덧붙였다. 또 그는 "엔비디아, 마이크로소프트, 퀄컴, AMD, 허깅페이스, 인텔, 메타, 레드햇 등 광범위한 에코시스템을 통해 협력 관계를 탄탄히 구축하고 있는 것도 장점"이라며 "공장 팩토리 레벨에서 준비된 솔루션을 공급할 수 있도록 엔지니어링 단계에서부터 엔비디아와 협력하고 있다는 것도 우리만의 경쟁력"이라고 강조했다. 이 같은 시스템을 바탕으로 델은 국내 서버 시장에서도 1위 자리를 굳건히 지키고 있다. 특히 서버 자체 기술력, 공급망 관리 능력, 영업 능력, 기술 지원 능력 등을 인정 받아 삼성SDS와 NHN클라우드, 엘리스 등 많은 기업들이 델의 서버를 앞 다퉈 도입하고 있다. 해외에서도 마찬가지다. 델 테크놀로지스에 따르면 현재 기업들은 ▲비용 통제 ▲데이터 관리 ▲기존 시스템과의 통합 ▲전문 인력 부족을 주요 도전 과제로 삼고 있다. 이에 전체 중 77%의 기업이 AI 인프라 구축을 위해 '단일 벤더'를 선호하고 있는데 델 테크놀로지스는 다양한 제품 및 시스템 덕에 기업들의 상당한 신뢰를 얻고 있는 것으로 나타났다. 양 전무는 "우리는 업계 최신 기술과 오픈·모듈러 아키텍처를 빠르고 적극적으로 수용해 고객들이 이미 투자한 자산을 보호할 수 있도록 지원하고 있다"며 "새로운 기술이 나왔을 때 기존의 장비·설비에서 손쉽게 업그레이드할 수 있도록 함으로써 기업들이 효율적으로 자사 제품을 활용할 수 있게 도울 것"이라고 밝혔다. 그러면서 "특히 곧 출시될 '델 파워엣지 XE8712' 서버는 고객들이 가장 기대해도 좋을 제품"이라며 "2개의 그레이스 CPU와 4개의 블랙웰 GPU를 통합한 엔비디아 GB200 그레이스 블랙웰 슈퍼칩을 탑재해 데이터센터 내 AI 성능을 극대화 함으로써 현존하는 AI 서버 중 가장 빠른 속도로 이용할 수 있을 것"이라고 설명했다. 또 델 테크놀로지스가 AI 데이터 관리 측면에서도 상당한 기술 발전을 이끌어 낼 것이라고 자신했다. 특히 기업들이 AI 데이터를 더 빠르게 처리하고 보다 안전하게 보호할 수 있도록 설계된 '델 AI 데이터 팩토리 위드 엔비디아'가 중추적 역할을 할 것으로 봤다. 이 플랫폼은 대량의 데이터를 실시간으로 받아들이는 데이터 인제스천 기능을 지원하며 GPU 가속 기반 '스파크 쿼리'를 활용해 기존 대비 최대 220% 향상된 속도로 데이터를 분석하고 처리할 수 있다. 더불어 델이 AI 소프트웨어 분야에서도 엔비디아와의 협력을 통해 기술 발전을 이끌어 냈다고 강조했다. 특히 '에이전트 AI' 시스템 개발을 지원하는 엔비디아의 AI 개발 프레임워크인 '에이전틱 AI'와 이를 위한 AI 최적화 도구를 AI 팩토리에 통합함으로써 AI를 통해 기업들이 의사 결정을 쉽게 내릴 수 있도록 지원에 나선 점을 피력했다. 양 전무는 "그동안에는 마이크로소프트 등 하이퍼스케일러들이 수십만 장의 GPU를 구매해 파운데이션 모델을 만드는 것이 대세였다면, 작년 말부턴 AI를 어떻게 잘 활용할 수 있을지에 대해 고민을 하는 기업들이 더 많아진 듯 하다"며 "점차 일반 기업들이 실제 비즈니스 도움이 될 수 있도록 AI를 사용하는 사례가 많아지고 있는 만큼, AI 인프라에 대한 시장의 관심도 더 커질 듯 하다"고 말했다. 그러면서 "AI 기술 발전으로 서버 신제품 발표 주기도 2년에 한 번 정도에서 최근에는 엔비디아의 움직임에 맞춰 6개월에 한 번으로 짧아질 정도로 빨라진 상황"이라며 "이에 따른 전력 소비, 냉각 등과 관련된 시스템을 잘 갖춰나가기 위해 노력 중인 만큼 많은 기업들이 우리 제품을 선택할 것으로 기대하고 있다"고 덧붙였다. 또 그는 "특히 국내에선 정부에서 국가 AI 컴퓨팅 센터를 추진하고 있는 만큼 실제 구체적인 사업을 진행할 때 우리 제품을 외면하지는 않을 것으로 보인다"며 "엔비디아뿐 아니라 AMD, 인텔 등 다양한 기업들의 GPU를 제공하며 고객들의 선택지를 많이 넓힌 만큼 '델 AI 팩토리'를 통해 시장 변화에 맞춰 탄력적으로 대응함으로써 시장 주도권을 유지하기 위해 더 노력할 것"이라고 강조했다.

2025.04.07 16:48장유미 기자

  Prev 1 Next  

지금 뜨는 기사

이시각 헤드라인

애플, 삼성과 폴더블 격돌…'아이폰 듀오'에 어떤 신기술 심었나

스마트폰 200만원 시대…혁신 사라진 곳에 가격만 남다

홍대 올리브영 가까이 맞붙은 ‘무신사 뷰티’ 매장 가보니

베일 벗은 아이폰 듀오…갤럭시Z폴드8과 비교했더니

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.