• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'엔비디아 GPU'통합검색 결과 입니다. (195건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

엔비디아, 12분기 연속 매출 신기록…AI 데이터센터 매출 92% 폭증

세계 인공지능(AI) 칩 시장을 장악하고 있는 엔비디아가 12분기 연속 역대 최대 매출 기록을 또 갈아치웠다. 지난주 기업공개(IPO)를 마친 세레브라스 시스템즈와 AMD 등 경쟁사 등장과 최근 AI 모델과 추론용 자체 개발 칩을 공개한 구글 등 경쟁이 격화하는 상황에서 호실적을 기록한 셈이다. 엔비디아는 20일(현지시간) 올 1분기(2~4월, 회계연도 기준 2027년 1분기) 매출은 816억 1500만 달러(약 122조 2503억원)로 전년 동기(440억 달러, 약 65조 9072억원) 대비 85% 증가했다고 발표했다. 지난 2월 자체 전망치인 780억 달러(약 116조 8354억원), 시장 전망치인 787억 달러(약 117조 8839원)를 30억 달러 이상 넘어섰다. 영업이익은 535억 달러(약 80조 1371억원)로 전년 동기(187억 달러, 약 28조 105억원) 대비 세 배 이상 증가했다. 엔비디아는 올 1분기부터 사업 실적을 '데이터센터'와 '엣지 컴퓨팅' 등 두 개 시장으로 구분해 발표한다. 현재와 미래 성장 동력을 보다 명확히 반영하기 위해서라는 것이다. 데이터센터 부문은 ▲ 글로벌 클라우드 기업과 대형 인터넷 기업 매출을 포함한 '하이퍼스케일(Hyperscale)' ▲ AI 클라우드, 산업, 기업 부문을 일컫는 'ACIE'로 구분된다. 데이터센터 부문 매출은 752억 달러(약 112조 6413억원)로 전년 동기(391억 달러, 약 58조 5675억원) 대비 두 배 가까운 92% 폭증했다. 또 1분기 전체 매출의 92%가 데이터센터 부문에서 나왔다. 엔비디아는 "블랙웰 GB300 생샨량 증가와 함께 NV링크, 스펙트럼-X 네트워킹 등 수요 증가에 따른 결과"라고 설명했다. 단 작년 1분기 대비 중국 시장에서 매출은 전혀 발생하지 않았다. 엣지 컴퓨팅 부문은 PC, 게임 콘솔, 워크스테이션, AI-RAN 기지국, 로보틱스, 오토모티브(자동차) 등 에이전틱 AI 및 피지컬 AI용 기기를 포함한다. 이 부문의 1분기 매출은 64억 달러(약 9조 5865억원)이며 전년 동기 대비 29% 늘어났다. 엔비디아는 "메모리와 완제품 가격 상승으로 일반 소비자용 PC 수요가 줄고 있지만 RTX 프로 6000 블랙웰 워크스테이션 등 강력한 수요로 달성한 결과"라고 밝혔다. 엔비디아는 오는 6월 26일 배당금을 주당 기존 1센트에서 25센트로 상향해 지급한다고 밝혔다. 배당락은 6월 4일이다. 엔비디아는 올해 2분기(5~7월) 910억 달러(약 136조 3080억원) 수준으로 예상했다. 다만 이는 중국 시장 매출을 전혀 반영하지 않은 수치다. 실적 발표 이후 주가는 시간 외 거래에서 종가(223.47달러) 대비 1% 내외로 등락을 이어가고 있다.

2026.05.21 07:33권봉석 기자

[유미's 픽] 2조 GPU 사업 '승자의 저주' 되나…네이버·삼성·엘리스 3파전 압축

정부의 2조원대 그래픽처리장치(GPU) 확충 사업이 막판 검증 국면에 들어갔다. 대규모 물량 확보보다 이를 한데 묶어 안정적으로 돌릴 수 있는 클러스터 운영 능력과 수익성이 최종 변수로 떠오르면서 사업자별 희비도 엇갈리고 있다. 14일 업계에 따르면 과학기술정보통신부와 정보통신산업진흥원(NIPA)은 현재 추진 중인 '2026년 AI컴퓨팅자원 활용기반 강화사업'의 발표 평가를 최근 마치고 지난 11일부터 차례대로 데이터센터 현장실사 단계에 들어갔다. 현장실사 대상에는 네이버클라우드, 삼성SDS, 엘리스그룹이 오른 것으로 파악됐다. 당초 제안서를 낸 쿠팡과 KT클라우드는 발표평가 단계에서 제외된 것으로 알려졌다. 이번 사업은 총 2조805억원을 투입해 최신 GPU와 관련 부대장비를 국내 데이터센터에 구축하고 연내 서비스 개시까지 추진하는 프로젝트다. 정부는 단순한 GPU 수량 확보를 넘어 대규모 클러스터링, 직접 구축·운용 역량, 최신 장비 도입, 연내 서비스 개시 등을 핵심 평가 요소로 제시했다. 또 동일 데이터센터 내 집적 구축과 전력·냉각·네트워크 설계 역량까지 요구되면서 사업 난도도 높아졌다. 정부는 지난해에도 약 1조4000억원을 투입해 GPU 1만3000여 장 확보를 추진했다. 당시 네이버클라우드와 NHN클라우드, 카카오가 최종 선정됐다. 업계 관계자는 "이번 사업은 제안 물량을 크게 쓰는 것만으로는 통과하기 어려운 구조"라며 "연내 구축 가능성, 동일 데이터센터 내 집적 구축, 전력·냉각 여건을 실제로 입증할 수 있느냐가 발표평가를 가른 것으로 보인다"고 말했다. GPU 물량 경쟁 속 클러스터 역량 부상 업계에선 네이버클라우드가 이번 사업에서 GPU 9000장 안팎을, 삼성SDS는 4000장 안팎을 제안한 것으로 보고 있다. 엘리스그룹은 2000장 수준의 물량을 배정받을 가능성이 거론되고 있다. 정부는 공모 과정에서 정부 활용분 최소 1개 클러스터를 256서버 이상으로 구성하도록 요구한 것으로 알려졌다. 통상 AI 서버 1대에 GPU 8장이 탑재되는 점을 감안하면 최소 2048장 규모의 클러스터를 구성해야 하는 셈이다. 이처럼 수천 장의 GPU를 하나의 클러스터로 묶어 성능을 내려면 단순 물량 확보를 넘어 서버 간 통신 지연을 줄일 네트워크 대역폭, 스토리지 성능, 전력·냉각 설계가 함께 뒷받침돼야 한다. 업계 관계자는 "이번 사업은 GPU 물량보다 이를 단일 클러스터로 안정적으로 묶어 운용할 수 있는지가 중요하다"며 "전력과 냉각, 네트워크 설계가 뒷받침되지 않으면 대규모 물량을 확보해도 효율을 내기 어렵다"고 말했다. 네이버 대규모 물량 유력…삼성SDS·엘리스도 추격 네이버클라우드는 공모 참여 기업 중 상면 확보에 가장 적극적으로 나서며 사업자 선정 의지를 드러내고 있다. 이를 위해 최근에는 LG CNS 삼송 데이터센터를 임차한 데 이어 내년 개소 예정인 KT클라우드 부천 데이터센터도 임차 계약을 맺은 것으로 알려졌다. 또 네이버클라우드가 지난해 1차 GPU 사업을 통해 H200 3056장을 직접 구축·운영한 경험이 있다는 점도 강점으로 꼽힌다. 정부가 대규모 클러스터링과 직접 구축·운용 역량을 핵심 평가 요소로 제시한 데다 외부 데이터센터 상면까지 추가로 확보하면서 이번에 대규모 물량을 배정받을 가능성이 높은 것으로 점쳐진다. 삼성SDS도 주요 후보로 꼽힌다. 삼성SDS는 삼성 클라우드 플랫폼(SCP)을 기반으로 공공·기업 AI 인프라 사업을 확대하고 있다. 국가AI컴퓨팅센터 구축 사업에서 컨소시엄 주관기관으로 참여한 바 있고, NIPA 고성능컴퓨팅(HPC) 지원 사업을 통해 최신 GPU 자원을 공급한 이력도 있다. 동탄 AI 전용 데이터센터 운영 경험과 기업 고객 기반도 강점으로 거론된다. 업계 관계자는 "삼성SDS는 제안 물량은 네이버클라우드보다 적지만 그룹 내 AI·클라우드 수요와 기업 고객 기반을 갖춘 점이 강점"이라며 "공공 공급 비중이 높은 사업 구조상 자체 활용과 외부 수요를 어떻게 결합하느냐가 수익성에 영향을 줄 것"이라고 말했다. 엘리스그룹은 이동형 모듈러 데이터센터(PMDC)를 앞세워 차별화한 제안을 낸 것으로 알려졌다. 엘리스그룹은 이미 베라 루빈을 지원하는 PMDC 개발을 완료한 상태로, 엔비디아 B300 기준 최대 1만368장 규모의 GPU 클러스터링이 가능하다는 입장이다. 다만 실제 배정 물량은 2000장 안팎이 거론된다. 정부가 최소 1개 클러스터를 256서버, GPU 기준 2048장 이상 규모로 구축하도록 요구한 만큼, 엘리스그룹이 이 기준을 충족할 수 있을지가 관건이다. 모듈러 방식은 부지 조성, 모듈 제작, IT 장비 설치를 병행할 수 있어 구축 기간을 줄일 수 있지만, 대규모 GPU 클러스터를 안정적으로 운영하려면 전력 인입과 냉각, 네트워크 설계가 함께 뒷받침돼야 한다. 업계 관계자는 "엘리스그룹은 2000장 수준의 물량을 배정받을 가능성이 있지만 전력 확보 여부가 관건이 될 것"이라며 "PMDC가 상면 확보에는 유리할 수 있어도 대규모 GPU 클러스터 운영에는 전력과 냉각 안정성이 중요하다"고 말했다. 쿠팡 재도전 불발…KT클라우드도 고배 쿠팡은 지난해 1차 사업에서 탈락한 뒤 올해 재도전에 나섰지만, 발표평가 이후 현장실사 대상에는 포함되지 않은 것으로 알려졌다. 쿠팡은 싱가포르 데이터센터 전문기업 엠피리온디지털의 서울 양재동 데이터센터를 활용해 GPU 인프라를 구축·운영하는 방안을 제안한 것으로 알려졌다. 양재 데이터센터는 서울 도심 입지와 액체냉각 설비를 갖춘 점에서 주목받았다. 일부 층에는 고밀도 랙을 지원하는 액체냉각 방식이 도입된 것으로 알려졌다. 서울 도심 입지 특성상 엔지니어 수급과 지연시간 측면의 장점도 거론됐다. 그러나 정부 사업은 상면 확보뿐 아니라 정부 활용분 클러스터 구성, 서비스형 GPU(GPUaaS) 운영 실적, 연내 서비스 개시, 공공 공급 안정성 등을 종합적으로 따진다. 쿠팡의 도심형 상면과 AI 인프라 투자 계획이 주목받았지만, 발표 평가는 통과하지 못한 것으로 보인다. KT클라우드 역시 발표평가 단계에서 제외된 것으로 알려졌다. KT클라우드는 그간 공공 클라우드 운영 경험과 다수 데이터센터 인프라를 보유한 사업자로 꼽혀 왔다. 또 가산 AI 데이터센터와 부천 삼정 데이터센터 등 AI 인프라 확장 계획도 추진해 왔다. 다만 이번 제안에서는 GPU 물량을 1000장 단위로 여러 상면에 나눠 배치하는 방안을 제시한 것으로 알려졌다. 여기에 최근 대표 교체와 조직 재정비, 대형 투자 의사결정 지연 등이 맞물리며 이번 수주전에서 성과를 내지 못한 것 아니냐는 분석도 나오고 있다. KT클라우드는 수주 불발 관측 이후 내부 분위기도 좋지 않은 것으로 알려졌다.업계 관계자는 "최신 GPU 서버는 무게와 전력 밀도, 냉각 요건이 까다로워 2000장급 클러스터를 한 곳에서 안정적으로 수용할 수 있는지가 중요하다"며 "1000장씩 분산 배치하는 방식은 동일 데이터센터 내 대규모 클러스터링을 요구한 이번 평가에서 불리하게 작용했을 가능성이 있다"고 말했다. 또 다른 관계자는 "KT클라우드가 독립 클라우드 사업자로서 AI 인프라 경쟁력을 보여줄 기회를 이번에 놓친 듯 하다"며 "향후 KT그룹 내에서 KT클라우드의 역할과 투자 방향에도 영향을 줄 수 있다"고 관측했다. GPU값 1억원대에 인피니밴드 수급난 우려…수익성 부담 클 듯 일각에선 이번 사업이 '승자의 저주'가 될 수 있다고 우려했다. GPU 가격이 1년 사이 크게 오른 데다 서버, 네트워크 장비, 전력 설비, 냉각 장치, 데이터센터 보강 비용까지 함께 부담해야 하기 때문이다. 또 중동전쟁 여파로 GPU 클러스터 구성에 필요한 네트워크 장비 수급난도 고민거리로 떠올랐다. 대규모 GPU를 하나의 클러스터로 묶으려면 데이터센터 내 서버 간 고속 통신을 담당하는 인피니밴드 장비가 필수적인데, 관련 장비 상당 부분을 이스라엘에서 공급받아야 해 조달 일정을 맞추기가 쉽지 않아졌기 때문이다. 이에 GPU를 확보하더라도 네트워크 장비와 전력·냉각 인프라가 제때 갖춰지지 않으면 연내 서비스 개시에 차질이 생길 수 있다. 정부 사업 구조도 변수다. 이번 사업은 정부 예산으로 GPU를 구매해 소유권이 NIPA에 귀속되는 방식이다. 사업자는 공공 공급 물량을 제외한 일부 자원을 자체 서비스나 고객 수요에 활용할 수 있지만, 공공 공급 비중을 높일수록 자체 활용 여지는 줄어든다. 지난해 사업에서도 참여사들은 평가 점수를 고려해 자체 활용 비중을 낮게 설정한 것으로 알려졌다. 올해는 GPU 가격과 부대장비 비용 부담까지 커진 만큼, 최종 협상에서 자체 활용 비중을 두고 사업자들의 셈법이 더 복잡해질 전망이다. 지난해 약 8000장 규모 GPU 물량을 확보한 NHN클라우드가 올해 공모에 참여하지 않은 것도 비용 부담과 수익성 등을 고려한 선택으로 풀이된다. 업계 관계자는 "지난해 GPU 가격은 1대당 6000만~7000만원 수준이었지만 올해는 1억원 수준으로 오른 것으로 안다"며 "네트워크 장비와 전력·냉각 비용까지 감안하면 이번 사업은 수익성 확보가 쉽지 않을 수 있다"고 말했다. 베라 루빈, 가점에도 연내 도입 난항…최종 물량 협상 변수 이번 사업에서는 대규모 클러스터링뿐 아니라 엔비디아의 차세대 GPU 플랫폼인 '베라 루빈' 구축 여부도 승부수로 떠오르고 있다. 정부가 베라 루빈 도입을 제안하는 사업자에게 평가상 우대 방침을 밝히면서, 현장실사 대상에 오른 사업자들도 관련 도입 계획을 제안서에 포함한 것으로 알려졌다. 그러나 업계에선 베라 루빈의 연내 국내 도입이 쉽지 않을 것으로 보고 있다. 초기 공급 물량이 제한적인 데다 고전력·고밀도 랙을 수용할 데이터센터 인프라도 갖춰야 하기 때문이다. 업계 관계자는 "베라 루빈은 올해 들어오기 어려울 것으로 보인다"며 "다만 내년 3월까지 들여오기만 하면 정부가 우대해주는 구조로 알고 있다"고 말했다. 현장실사 이후에도 최종 배정 물량은 유동적이다. 사업비 심의·조정과 협약 체결 과정에서 GPU 구매 기종과 수량, 클러스터 규모, 자체 활용 허용 비중, 베라 루빈 반입 시점 등이 조정될 수 있기 때문이다. 정부는 현장실사와 후속 검토를 거쳐 이달 중 최종 수행기관을 선정한다는 목표다. 이후 선정 사업자는 GPU 발주와 데이터센터 구축, 장비 설치 및 성능 검증 등에 착수하게 된다. 업계에서는 선정 시점이 늦어질수록 GPU 가격 상승 부담과 공급 불확실성이 커질 수 있다고 보고 있다. 업계 관계자는 "최종 협상에서는 도입 물량과 자체 활용 비중, 베라 루빈 반입 시점 등이 핵심 쟁점이 될 것"이라며 "수익성과 구축 안정성을 함께 따져야 하는 만큼 사업자별 물량은 조정될 가능성이 있다"고 말했다.

2026.05.14 16:12장유미 기자

메모리 수급난에 PC 메인보드도 흔들... 가격 상승 직격탄

작년 4분기부터 본격화된 D램·SSD 등 메모리 반도체 수급 불안이 완제 PC 시장을 넘어 핵심 부품인 메인보드 시장까지 흔들고 있다. PC 수요 둔화와 부품 가격 상승이 겹치면서 주요 메인보드 제조사들은 올해 판매 목표를 낮추거나 출하량 전망치를 잇따라 하향 조정하는 분위기다. 보급형 제품부터 고성능 게이밍 PC, 워크스테이션용 제품까지 폭넓게 공급해 온 업체들은 조립 PC 시장 위축의 직격탄을 맞고 있다. 업계 안팎에서는 현재 상황이 금융위기나 코로나19 범유행 초기보다 더 어렵다는 평가도 나온다. 일부 업체는 서버용 부품과 AI 인프라 시장으로 눈을 돌리며 돌파구 마련에 나서고 있다. 1분기 완제PC '반짝성장'... 얼어붙은 조립 PC 시장조사업체 IDC에 따르면 올 1분기 세계 완제PC 출하량은 전년 동기 대비 2.5% 늘어난 6560만 대로 집계됐다. 그러나 세계 모든 지역에서 출하량 증가세가 꺾였다. 중동과 아태지역 출하량 성장률이 작년 4분기 대비 절반 이하로 줄어들었다. 특히 북중남미(아메리카) 지역 출하량은 3.3% 순감소로 전환됐다. 대만 디지타임스는 7일 현지 공급망 관계자를 인용해 "완제PC 구매 수요도 줄어들었지만 조립 PC 시장 상황은 더욱 참담하다. 2008년 금융위기나 코로나19 범유행이 시작된 첫 해인 2020년보다 더 나쁘다"고 보도했다. 디지타임스 "주요 메인보드 제조사, 전망치 하향" 디지타임스는 "대만계 주요 메인보드 제조사들은 작년 말 세웠던 올해 출하량 목표를 모두 하향 조정했으며 사실상 '붕괴 상태'"라고 설명했다. 디지타임스에 따르면 대형 업체 중 한 곳인 에이수스는 작년에 메인보드를 1500만 장 출하했지만 올 상반기 출하량은 500만 장에 그칠 것으로 예상된다. 1000만 장을 넘기지 못할 가능성도 있다는 것이다. 2위 업체인 기가바이트는 작년 1150만 장을 출하했지만 올해는 이에 못 미치는 900만 장 규모를 출하할 것으로 보인다. 기가바이트는 "MSI 역시 올해 메인보드 출하량을 840만 장 수준으로 예상중"이라고 설명했다. 개별 부품 구매 하는 조립 PC 특성, 가격 상승에 더 취약 조립 PC는 프로세서(CPU)와 메모리, 그래픽카드와 SSD 등을 자신이 원하는 수준으로 자유롭게 조합해 주요 제조사 대비 저렴한 가격에 장만할 수 있다는 것이 가장 큰 장점이다. 그러나 주요 부품 중 한 부품이라도 품귀 현상이나 가격 상승을 겪는다면 일반 소비자가 더 큰 영향을 받는다. 대형 글로벌 PC 제조사 대비 협상력이 떨어지는 유통업체가 충분한 물량이나 적정한 가격을 확보할 수 없기 때문이다. 현재 시장 상황은 DDR5 메모리 모듈과 SSD 가격이 동반 상승해 프로세서나 메인보드 판매량까지 끌어내리고 있다. 현재는 DDR5 16GB 메모리 모듈 두 개 구입시 80만원이 들어 중간급 PC용 프로세서 두 개를 살 수 있는 상황까지 왔다. "엔비디아, GPU 세대 교체 미룰 가능성 ↑" 특히 메인보드는 프로세서, 메모리, 그래픽카드와 함께 업그레이드 시 동시에 구매가 일어나는 경우가 많다. 전체 PC 업그레이드 수요가 줄어들면 가장 먼저 타격을 받는 품목으로 꼽힌다. PC 업그레이드 수요를 견인하던 GPU 세대 교체 역시 정체될 것으로 보인다. TSMC의 파운드리 생산 총량에 한계가 있는 상황에서 수익이 더 뛰어난 데이터센터용 GPU를 우선할 수 밖에 없기 때문이다. 미국 IT매체 디인포메이션은 지난 2월 엔비디아 내 복수 관계자를 인용해 "엔비디아가 올해 성능을 강화한 '지포스 RTX 50 시리즈' GPU 신제품을 출시하지 않을 것"이라고 전망하기도 했다. 실제로 엔비디아는 지난 달 말 GDDR7 메모리 용량을 8GB에서 12GB로 늘린 RTX 5070 GPU 파생 모델을 공개하는 데 그쳤다. 국내 시장도 침체... "생존이 문제" 세계 메모리 반도체 생산량 중 70% 이상을 차지하는 삼성전자·SK하이닉스를 보유한 국내 조립 PC 시장 역시 침체에서 자유롭지 않다. 앞서 언급된 대만계 메인보드 제조사 중 한 곳의 국내 법인 관계자는 8일 "프로세서 제조사들이 2분기 국내 공급하는 프로세서 출하량 역시 예년 대비 크게 줄어들었다"고 설명했다. 일부 업체는 그간 주력하던 PC 제품에 더해 서버용 전원공급장치와 엔비디아 AI GPU 유통도 시도하고 있다. 한 업체 관계자는 "사실 성장은 기대할 수 없고 생존을 걱정해야 하는 상황"이라고 설명했다. 익명을 요구한 국내 핵심 부품 제조사 관계자는 8일 "주요 제품을 유통하던 총판 업체가 경영난으로 4월 말 폐업하는 등 상황이 극히 나쁘다"며 "하반기에도 이런 사례가 나타나지 않을까 걱정"이라고 우려했다.

2026.05.08 16:46권봉석 기자

에이수스, AI 엑스포서 GPU 서버·산업용 PC 시연

에이수스코리아 인프라솔루션그룹이 6일부터 8일까지 서울 코엑스에서 열리는 'AI 엑스포' 행사에 참가해 엔비디아 GPU 기반 AI 솔루션과 피지컬 AI를 위한 산업용 PC 제품군을 전시한다. 에이수스코리아는 국내 공식 대리점 코잇과 함께 엔비디아 HGX B300 기반 솔루션 'XA-NB3I-E12', 엔비디아 MGX 아키텍처를 적용한 고밀도 4U 서버 'ESC8000A-E13P', 범용 서버 'RS720-E12-RS12U' 등 AI와 범용 컴퓨팅 겨냥 서버 제품군을 전시한다. 산업 현장에서 컴퓨터 비전, 사물 인식 등 엣지 AI 구동을 위한 인텔 프로세서 기반 러기드 PC인 PE5101D, PE4000G와 팬리스 산업용 PC PE2200U, 고성능 소형 PC 'NUC 프로 16', 엔비디아 GB10 기반 개인용 AI 워크스테이션 '어센트 GX10'도 공개된다. 에이수스코리아 관계자는 "클라우드 AI 대비 지연 시간과 보안, 비용 효율 면에서 이점을 지닌 엣지 AI에 대한 관심이 커지고 있는 가운데, 에이수스는 클라우드와 엣지, 개발자 대상 다양한 포트폴리오로 국내 기업들의 AI 전환에 조력할 것"이라고 밝혔다. 에이수스코리아는 행사 기간 중 현장 상담을 진행한 고객과 기업에게 소정의 기념품을 제공한다. 또 일반 관람객 대상 이벤트로 각종 에이수스 제품을 경품으로 제공할 예정이다.

2026.05.06 17:32권봉석 기자

에이서 자회사 알토스컴퓨팅, AI 엑스포서 서버 제품 전시

글로벌 PC 제조사 에이서 자회사, 알토스컴퓨팅이 작년 국내 진출 이후 처음으로 국내 행사에 참가했다. 엔비디아 GPU 탑재 AI 서버와 솔루션, 웹 기반 모니터링 도구를 시연했다. 알토스컴퓨팅은 2017년 에이서 자회사로 설립돼 고성능컴퓨팅(HPC)과 AI 인프라 관련 서버 완제품과 소프트웨어, 솔루션을 공급중이다. 6일 오전 서울 삼성동 코엑스 'AI 엑스포' 행사장에는 GPU 서버 3종과 개인용 AI 워크스테이션, 모니터링 툴을 전시했다. 알토스 브레인스피어 R880 F7은 대규모 모델 학습, 생성 AI와 HPC 등 클라우드서비스제공자나 대기업의 온프레미스 환경을 위해 설계된 서버다. 8U 규격 서버로 엔비디아 HGX B200 기반 GPU를 최대 8개 탑재 가능하다. 알토스 브레인스피어 R680 F7은 인텔 제온 6700/6500 프로세서 기반 GPU 서버다. 4U 규격으로 엔비디아 H200이나 RTX 프로 6000 블랙웰 서버 에디션, L40S 등 예산에 맞는 GPU를 최대 8개 탑재 가능하다. 현장에서 만난 알토스컴퓨팅 대만 본사 엔지니어는 "국내 공공 연구기관 중 한 곳이 H200 GPU 8개를 탑재한 구성으로 제품 두 대를 도입 예정"이라고 설명했다. 알토스 브레인스피어 R380 F7은 2U 구성으로 엔비디아 RTX 프로 6000 맥스Q와 RTX 6000 에이다, L40s GPU를 최대 두 개 장착할 수 있다. 알토스컴퓨팅 관계자는 "중소/중견기업에 적합한 구성으로 GPU를 유연하게 선택할 수 있다"고 밝혔다. 알토스 브레인스피어 GB10 F1은 엔비디아가 개인 개발자와 전문가용으로 개발한 CPU·GPU 통합 SoC(시스템반도체) GB10 기반 AI 워크스테이션이다. 통합 메모리 용량(LPDDR5X 128GB)과 최대 구동 가능 모델(2천억 개 매개변수) 등 주요 제원은 타사 제품과 같다. 알토스컴퓨팅 관계자는 차별화 요소로 자체 개발한 소프트웨어인 'AI 지니(aiGeni)'를 들었다. 이 관계자는 "AI 지니는 CPU 점유율과 메모리 이용량 등 모니터링 기능과 함께 파이토치, 텐서플로 등 주요 AI 라이브러리 연동을 지원한다"고 설명했다. 알토스 서버 제품에는 웹 기반 통합 관리 솔루션 'AI웍스(aiWorks)'가 탑재된다. 다수의 서버 노드와 GPU 자원을 한 화면에서 통합 관리 가능하다. 알토스컴퓨팅 관계자는 "사용자별·조직별 그룹 별 권한 설정, 교사·연구실·팀 등 단위 계정 설정 기능에 더해 기간·사용자·그룹별 사용량 집계와 이에 따른 내부 정산 체계까지 구축 가능하다"고 설명했다. 알토스컴퓨팅 국내 지사 관계자는 "이번에 전시한 서버 3종과 솔루션을 시작으로 연내 포트폴리오를 확보해 국내 기업들이 AI를 실제 비즈니스 성과로 전환할 수 있도록 지원하고, 한국 시장 내 AI 혁신을 지원할 것"이라고 설명했다.

2026.05.06 17:05권봉석 기자

엔비디아 젠슨 황 "中에 최신 GPU 공급은 제한해야"

젠슨 황 엔비디아 CEO가 4일(현지시간) 중국 시장과 AI 반도체 수출 전략에 대해, 성능을 제한한 제품은 계속 공급하되 최신·고성능 제품 공급은 제한할 필요가 있다는 견해를 밝혔다. 젠슨 황 CEO는 로스앤젤레스에서 열린 밀컨연구소 글로벌 컨퍼런스 기간 중 대담 세션에 참여했다. 진행자가 "중국에는 H200 같은 칩은 공급해야 한다는 생각이냐"라고 묻자 젠슨 황 CEO 역시 이에 동의했다. 반면 "중국이 최신·최고사양 반도체를 가져야 하느냐"는 사회자 질문에는 "아니다"라고 즉답했다. 이는 중국을 완전히 배제하기보다 미국 기술 생태계 안에 묶어두는 방식이 더 효과적이라는 메시지로 해석된다. 그는 이어 "미국이 AI 분야에서 가장 뛰어난 최신 기술을 가장 먼저, 가장 많이 가져야 한다. 미국 기업들이 세계 시장에 AI 가속기를 판매하면 세수 확대와 경제 성장으로 이어지고, 이는 다시 국가 안보 강화에 기여한다"고 덧붙였다. 이번 발언은 젠슨 황 CEO가 작년 하반기 이후 실적발표 등 공개석상에서 지속적으로 강조한 메시지와도 일치한다. 엔비디아는 도널드 트럼프 2기 행정부 출범 이후 중국 시장 수출 규제가 강화되자 H200 등 중국 전용 저사양 AI 칩을 별도로 설계해 대응해 왔다. 그러나 양국 정부의 승인 절차가 지연이나 보류되며 엔비디아의 중국 시장 내 AI 가속기 점유율은 0% 수준까지 떨어졌다. 이번 발언은 미국 정부의 최첨단 제품 수출 제한은 수용하되, 성능이 한 단계 낮은 제품의 수출은 허가하고 미국 기업의 글로벌 경쟁력은 유지돼야 한다는 이중 전략을 내세운 것으로 보인다. 최첨단 제품은 미국 중심으로 묶어두되, 범용·하위 사양 제품 판매까지 전면 차단하는 방식은 오히려 중국 반도체 생태계를 키울 수 있다는 현실론이다.

2026.05.06 10:02권봉석 기자

GPU 넘은 엔비디아, 한국 데이터까지 손댔다…소버린 AI 속도전

엔비디아가 한국 사회 특성을 반영한 대규모 합성 데이터셋을 공개하며 국내 인공지능(AI) 생태계 공략에 속도를 내고 있다. 단순 기술 공개를 넘어 '소버린 AI' 흐름 속에서 데이터까지 포함한 AI 인프라 주도권을 확보하려는 전략으로 풀이된다. 엔비디아는 한국형 합성 데이터셋 '네모트론-페르소나-코리아(Nemotron-Personas-Korea)'가 글로벌 AI 플랫폼 허깅페이스(Hugging Face) 데이터셋 부문 1위를 기록했다고 28일 밝혔다. 해당 데이터셋은 600만 건 규모로, 한국의 인구통계학적·지리적·문화적 특성을 반영한 것이 특징이다. 국가통계포털(KOSIS), 대법원, 국민건강보험공단, 한국농촌경제연구원, 네이버클라우드 등 공공·민간 데이터를 기반으로 구축됐다. 이름, 성별, 연령, 혼인 상태, 교육 수준, 직업, 거주 지역 등 주요 속성은 실제 통계 분포를 따르도록 설계됐다. 존댓말 체계와 지역별 직업 패턴 등 한국어 문화 맥락도 반영했다. 고령층과 농촌 지역, 다양한 교육 및 직업군까지 포함해 데이터 다양성을 확보했다. 해당 데이터셋은 개인정보를 포함하지 않는 합성 데이터로 구성돼 개인정보보호법(PIPA)을 준수하도록 설계됐다. 오픈소스로 공개돼 국내외 개발자들이 자유롭게 활용할 수 있다. 이번 데이터셋 공개는 단순 기술 성과를 넘어 AI 인프라 경쟁 구도가 데이터 영역으로 확장되고 있음을 보여주는 사례로 해석된다. 그동안 그래픽처리장치(GPU) 등 컴퓨팅 자원이 핵심 경쟁력이었다면, 최근에는 학습 데이터 확보가 AI 성능과 직결되는 핵심 변수로 부상하고 있기 때문이다. 특히 국가별 언어·문화·규제를 반영하는 '소버린 AI' 수요가 확대되는 상황에서 한국형 데이터셋을 선제적으로 구축해 공개했다는 점도 주목된다. 글로벌 빅테크들이 각국 맞춤형 AI 전략을 강화하는 가운데 엔비디아가 데이터 레이어까지 영향력을 확대하려는 포석으로 읽힌다. 합성 데이터 활용 전략도 눈에 띈다. 개인정보 규제를 준수하면서도 데이터 활용도를 높일 수 있는 대안으로, 향후 금융·의료·공공 등 규제 산업에서 활용 가능성이 크다는 평가다. 국내 시장을 겨냥한 행보라는 해석도 나온다. 네이버, KT 등 주요 기업들이 한국형 AI 모델 개발에 나선 가운데 엔비디아가 데이터·모델·인프라를 결합한 생태계 확장에 나서며 영향력 확대를 시도하고 있다는 분석이다. 더불어 엔비디아는 최근 '네모트론 디벨로퍼 데이즈 서울 2026'을 개최하는 등 국내 개발자 및 기업과 협업을 강화하려는 모습도 보였다. 업계 관계자는 "엔비디아가 단순 GPU 공급을 넘어 데이터와 모델까지 포함한 AI 플랫폼 사업자로 빠르게 전환하고 있다"며 "소버린 AI 확산과 함께 국가별 데이터 확보 경쟁도 본격화될 것"이라고 말했다.

2026.04.28 17:43장유미 기자

AI 뜨니, 게이밍 GPU 소외…엔비디아 '지포스 홀대' 논란

인공지능(AI) 수요 급증으로 인한 메모리 부족 사태 속에서 엔비디아가 게이밍 GPU보다 인공지능(AI) 칩에 집중하면서 게이머들의 불만이 커지고 있다는 지적이 나왔다. 엔비디아가 최근 블랙웰, 루빈 등 데이터센터용 AI 칩셋 생산을 우선 추진하면서 소비자용 지포스 GPU가 상대적으로 소외되고 있다고 미국 경제매체 CNBC가 19일(현지시간) 보도했다. 엔비디아는 2000년대 초 GPU를 대중화하며 게임 산업 핵심 기업으로 자리 잡았다. 특히 1999년 '지포스 256' 출시 당시 위기 상황에 놓였던 회사는 게이머들의 적극적인 구매에 힘입어 반등에 성공했다. 하지만 지금은 상황이 크게 달라졌다. AI 시장이 폭발적으로 성장하면서 엔비디아의 매출 대부분이 데이터센터용 AI 칩에서 발생하고 있다. 번스타인 리서치의 스테이시 라스곤은 “게임 부문은 더 이상 회사의 핵심 성장 동력이 아니다”라고 평가했다. AI 칩 생산 확대는 메모리 수급에도 영향을 미치고 있다. 제한된 메모리 자원을 두고 우선순위를 정하는 과정에서 엔비디아는 수익성이 높은 AI GPU에 집중하고 있으며, 이로 인해 게이밍 GPU 생산은 상대적으로 줄어들고 있다는 분석이다. 실제로 업계에서는 최신 게이밍 GPU 생산량이 최대 40%까지 감소할 수 있다는 전망도 나오고 있다. 제품 출시 일정에도 변화가 감지된다. 분석가들은 올해가 엔비디아가 30년 만에 처음으로 차세대 지포스 GPU를 출시하지 않는 해가 될 가능성이 높다고 보고 있다. 현재 판매 중인 '지포스 RTX 50 시리즈'는 지난해 1월 공개됐지만, 올해 주요 행사에서는 후속 제품이 발표되지 않았다. 가격 구조 역시 이러한 전략 변화를 뒷받침한다. 업계에 따르면 블랙웰 GPU는 개당 최대 4만 달러(약 5900만 원), 베라 루빈 시스템은 최대 400만 달러(약 59억 원)에 이를 것으로 추정된다. 반면 지포스 RTX 50 시리즈는 299달러에서 1999달러 수준으로, 수익성 측면에서 큰 차이를 보인다. 한편, 최근 공개된 차세대 그래픽 기술 'DLSS 5'를 둘러싼 논란도 이어지고 있다. 젠슨 황 CEO는 지난 3월 연례 개발자 행사에서 해당 기술을 소개했지만, 일부 게이머들은 AI 기반 렌더링이 원작의 예술적 의도를 훼손할 수 있다고 비판하고 있다. 특히 시연 과정에서 게임 캐릭터 표현이 과도하게 보정된 것처럼 보인다는 지적이 제기되며 논쟁이 확산되고 있다. 엔비디아는 이에 대해 “게이머는 여전히 중요한 고객”이라며, 게임 기술 개발과 제품 출시를 지속하고 있다고 밝혔다.

2026.04.20 16:39이정현 미디어연구소

중부권 최대 민간 GPU센터 추진…"슈마컴 루빈급 32만장 공급 약속"

블랙웰 급 6만2,500장 이상을 수용할 중부권 최대 GPU 데이터 센터가 들어설 전망이다. 건물과 송전 및 냉각시설, GPU 랙 등을 설치할 시설비만 2조 2,500억원 규모다. 한남대학교는 16일 대전 본교에서 케빈 창 슈퍼마이크로컴퓨터 부사장과 정시우 BKB에너지 대표, 성제현 KT수도권강북법인고객본부장를 비롯한 황정아·장철민 의원 등 내외빈 150여 명이 참석한 가운데 'AX클러스터 & 고성능 GPU 거점센터' 기공식을 개최했다. 이 프로젝트에서 GPU 조달은 엔비디아 GPU 공급업체인 슈퍼마이크로컴퓨터가 맡기로 했다. 사업 주체는 슈퍼마이크로컴퓨터와 BKB에너지, KT, 터보스케일 등이다. 이들이 GPU 공급과 냉각시스템 등 시설 설치 일체를 맡는다. 이들 간에는 GPU가 필요할 땐 언제든 공급하기로 하는 협약(NDA, 비밀보호협정)도 체결했다는 것이 한남대 측 설명이다. 이준원 한남대학교 인공지능전략위원회 부위원장(자유전공학부 교수)은 "GPU를 총 32만장 정도 가져올 수 있는데, 당장은 블랙웰급으로 6만 2,500장부터 들여올 계획이다. 향후엔 최상급인 베라루빈 이상으로 언제든 원할 때 들여올 수 있는 계약을 체결했다"고 말했다. 이 부위원장은 "GPU와 관련해서 정부나 지자체 지원없이 순수 민간 자본으로 구축한다"며 "해외에서는 미국과 캐나다, 프랑스 자본이 투입되고, 국내에서는 메리츠화재, 우리투자증권, BKB에너지 자금이 유입될 것"이라고 말했다. 이 부위원장은 또 "GPU 80%정도는 수냉식으로 열관리할 계획"이라며 "물 공급 부분은 수자원공사에서 책임지기로 했고, 전기 공급은 한전측과 기술평가를 실시한 결과 우선 40MW부터 공급하기로 했다"고 말했다. 향후엔 ESS(에너지저장시스템)를 활용한 추가 전력 100MW 정도를 확보할 계획이다. 한남대는 우선 올해내 건물 설계를 모두 마친뒤 내년부터 본격 건립 작업에 들어갈 계획이다.

2026.04.16 15:25박희범 기자

[AI는 지금] 젠슨 황, AI 다음 패권 '양자' 낙점…오픈 모델로 QPU 표준 선점 본격화

엔비디아가 양자 컴퓨팅의 실용화를 앞당길 세계 최초의 오픈 인공지능(AI) 모델 '엔비디아 아이징(NVIDIA Ising)'을 전격 발표하며 양자 생태계 주도권 선점에 나섰다. AI를 양자 컴퓨터의 제어 계층으로 활용해 그간 하드웨어 제약으로 꼽혔던 양자 오류 문제를 소프트웨어로 정면 돌파하겠다는 전략이다. 16일 엔비디아에 따르면 아이징은 양자 프로세서의 보정(Calibration)과 오류 정정(Decoding)에 최적화된 모델군으로 구성됐다. 특히 AI 기반의 디코딩 모델은 기존 업계 표준 대비 속도는 2.5배 빠르고 정확도는 3배나 높다. 이는 취약한 큐비트 상태를 실시간으로 관리해 양자 컴퓨터를 실제 산업 현장에서 쓸 수 있는 '신뢰할 수 있는 컴퓨터'로 전환하는 핵심 기술이다. 핵심 모델인 '아이징 캘리브레이션'은 비전 언어 모델(VLM)을 활용해 며칠씩 걸리던 보정 작업을 단 몇 시간으로 단축한다. '아이징 디코딩'은 3D 합성곱 신경망(CNN)을 통해 양자 오류를 실시간으로 잡아낸다. 이는 하드웨어의 물리적 한계를 소프트웨어 지능으로 극복하겠다는 젠슨 황 최고경영자(CEO)의 의지가 투영된 결과물이다. 이번 발표는 엔비디아가 기존 GPU 중심 AI 인프라 주도권을 차세대 양자 데이터센터로 확장하려는 전략적 포석으로 읽힌다. 양자 상용화의 최대 병목으로 꼽히는 오류 정정과 보정 자동화 영역을 선점함으로써, 향후 QPU가 데이터센터의 새로운 연산 축으로 편입될 때 소프트웨어 런타임과 양자연산장치(QPU)-그래픽처리장치(GPU) 인터커넥트 표준까지 선점하려는 움직임으로 해석된다. 국내외 AI 인프라 시장에도 거센 파장이 예상된다. 엔비디아는 자사의 '쿠다-Q(CUDA-Q)' 플랫폼과 'NVQ링크(NVQLink)' 하드웨어를 아이징 모델과 통합해 GPU와 QPU가 공존하는 하이브리드 컴퓨팅 표준을 제시했다. 이는 향후 클라우드서비스제공업체(CSP)들이 양자 가속 서비스를 설계할 때 엔비디아의 쿠다-Q·NVQ링크 중심 스택을 사실상의 표준 레이어로 채택할 가능성을 높일 것으로 보인다. 결과적으로는 엔비디아의 플랫폼 영향력을 크게 확대할 수 있다는 분석도 나온다. 이미 아톰 컴퓨팅, 아이온큐(IonQ) 등 글로벌 양자 기업은 물론 연세대학교 등 국내외 주요 학계에선 아이징에 대한 검증·적용이 진행되고 있다. 엔비디아는 NIM 마이크로서비스와 쿡북(Cookbook)을 함께 제공해 개발자들이 특정 하드웨어 아키텍처에 맞춰 모델을 즉각 파인튜닝할 수 있도록 지원하며 양자 개발 스택 영향력을 높이고 있다. 황 CEO는 "AI는 양자 컴퓨팅을 실용화하기 위해 필수적"이라며 "아이징을 통해 AI는 제어 계층으로서 양자 기계의 운영체제 역할을 수행하고, 취약한 큐비트를 신뢰할 수 있는 양자-GPU 시스템으로 전환할 것"이라고 강조했다. 업계 관계자는 "이번 발표는 엔비디아가 단순한 가속기 제조사를 넘어 양자-클래식 하이브리드 컴퓨팅의 런타임 표준을 장악하겠다는 선언"이라며 "특히 복잡도가 높은 양자 오류 정정 코드를 고성능 GPU 기반의 신경망으로 해결하려는 시도는 향후 퀀텀 데이터센터 설계의 필수적인 레퍼런스가 될 가능성이 높다"고 분석했다.

2026.04.16 10:34장유미 기자

엔비디아 Arm PC 칩 'N1' 실물 포착...시장 진입 임박

엔비디아가 올해 Arm 기반 윈도 PC 시장에 진입할 가능성이 한층 더 커졌다. 2024년 하반기부터 대만 팹리스 미디어텍과 개발을 시작한 윈도 PC용 Arm 시스템반도체(SoC), N1 탑재 개발용 보드 실물 사진이 최근 중국 공급망을 통해 노출됐다. N1/N1X는 엔비디아 개인용 AI 워크스테이션 'DGX 스파크'에 적용된 GB10에서 작동 클록이나 메모리 대역폭, 코어 수 등을 노트북 환경에 맞게 조절한 제품으로 추정된다. 고성능 블랙웰 GPU 코어를 이용해 기존 Arm 윈도 노트북의 한계로 지적돼 온 고사양 게임 등에서도 활용 가능성이 커진다. 작년에는 지포스 GPU와 Arm CPU를 조합한 PC용 N1X 칩의 벤치마크 결과가 노출된 바 있다. 또 올 초에는 레노버의 고객지원 기술문서에 엔비디아 칩 내장 게임 PC로 예상되는 미출시 제품 모델명이 노출되기도 했다. Arm CPU·블랙웰 GPU로 게임·콘텐츠 제작 성능 강화 엔비디아가 대만 팹리스 미디어텍과 협력해 윈도 PC용 Arm 칩을 개발중이라는 루머는 2024년 하반기부터 지속적으로 흘러나왔다. 엔비디아가 개발중인 칩은 ▲ 고성능 Arm 코어텍스(Cortex)-X925 CPU 코어 10개, 저전력·고효율 코어텍스-A725 코어 10개와 블랙웰 GPU를 결합한 'N1X' ▲ 코어 수를 줄이고 GPU 성능도 낮춘 'N1' 등 두 개다. 작년 7월에는 N1X 칩 성능을 Arm용 윈도11에서 실행한 결과가 공개되기도 했다. CPU 성능은 인텔 14세대 코어 프로세서와, 내장 GPU 성능은 인텔 코어 울트라 시리즈3의 Xe3와 비슷할 것으로 예상된다. 젠슨 황, 작년 9월 'N1' 관련 내용 처음 언급 엔비디아는 작년 9월 인텔과 차세대 AI 인프라 및 개인용 컴퓨팅 제품 공동 개발 발표 자리에서 N1 칩 관련 내용을 처음 언급했다. 당시 젠슨 황 엔비디아 CEO는 "N1이라는 Arm 기반 제품이 있으며 이 칩이 DGX 스파크는 물론 유사한 제품에 탑재될 것이다. 인텔과 협업이 이들 로드맵에 영향을 미치지 않을 것"이라고 설명했다. 대만 디지타임스 역시 지난 1월 "엔비디아 N1X 칩 기반 노트북이 이르면 올 1분기 시장에 출시되고 2분기부터 본격적으로 시장에 공급될 것"이라고 보도했다. 그러나 3월 중순 진행된 GTC 2026에서도 N1/N1X 관련 내용은 공개되지 않았다. 中 중고거래 플랫폼에 N1 개발 보드 등장 최근 중국 알리바바가 운영하는 개인간 중고거래 플랫폼 '구피시(闲鱼)'에는 엔비디아 N1 칩을 내장한 것으로 추정되는 개발 보드가 매물로 올라왔다. N1 칩을 포함한 PC용 메인보드 실물이 공개된 것은 이번이 처음이다. 사진에 등장한 메인보드는 N1 칩으로 추정되는 실리콘 다이(Die) 주변에 SK하이닉스가 생산한 LPDDR5X 메모리 모듈 8개를 배치했다. 개발 보드 왼쪽에는 냉각팬과 방열판을 배치할 수 있는 빈 공간도 보인다. 이 제품 출품자가 매긴 가격은 9999위안(약 216만원)이다. 그러나 판매 글과 제품은 등록 3일만에 내려갔다. 실제 작동하는 제품인지, 혹은 어느 회사 제품에 탑재될 예정인지도 불분명하다. 6월 '컴퓨텍스 타이베이' 기간 중 출시 가능성 ↑ 엔비디아는 '컴퓨텍스 타이베이 2026'이 열리는 6월 1일부터 4일까지 개발자 대상 행사 'GTC 2026'을 진행한다. 이 기간을 전후해 진행되는 기조연설에서 N1/N1X를 공개할 가능성이 크다. 레노버와 델테크놀로지스 등 PC 제조사도 관련 제품 출시를 준비중이다. CPU 전력 효율과 GPU 성능을 강화한 인텔 코어 울트라 시리즈3, Arm 호환 오라이언 CPU를 내장한 퀄컴 스냅드래곤 X2 등과 CPU 성능, GPU 성능 면에서 경쟁이 예상된다. 특히 레노버는 지난 1월 게이밍 노트북 '리전'에 탑재되는 소프트웨어인 '리전 스페이스' 관련 기술지원 문서에 'Legion 7 15N1X11'이라는 미출시 제품 명칭을 표기했다. 이는 '15인치 디스플레이와 엔비디아 N1X를 탑재한 리전 7 노트북'으로 해석될 수 있다.

2026.04.15 15:22권봉석 기자

엔비디아, PC 제조사 인수설 부인..."사실 아니다"

엔비디아가 PC·서버 제조사 중 한 곳을 인수할 수 있다는 전망이 나왔지만 회사 측이 이를 즉각 부인했다. 미국 반도체·IT매체 세미어큐레이트는 13일(현지시각) "엔비디아가 PC·서버 관련 회사 중 한 곳을 사려고 한다"고 보도했다. 이 매체는 "엔비디아는 컴퓨터 발명 이래 유례없을 정도로 PC 및 서버 시장의 판도를 완전히 뒤바꿀 대규모 인수를 추진 중이다. 2024년 말부터 이 사안을 추적해 왔고 거래가 성립되거나 무산될 시기가 다가오고 있다"고 밝혔다. 업계 관계자들은 기사에서 언급된 업체를 델테크놀로지스나 HP로 추정했다. 그러나 엔비디아는 "해당 보도는 사실이 아니다. 엔비디아는 PC 제조사 인수를 위한 논의에 참여한 적이 없다"고 부인했다. 엔비디아는 최근 1년간 상당한 금액의 투자를 지속해 왔다. 작년 9월 인텔에 50억 달러(약 6조 9430억원)를 투자한 데 이어 AI 추론 전문 스타트업 '그록'과 200억 달러(약 30조 1300억원) 규모 라이선스 계약을 체결했다. 반도체 EDA 업체인 시높시스에는 20억 달러(2조 9470억원)를, NV링크 퓨전 기술 개발 파트너사인 마벨에도 20억 달러를 투자했다. 그러나 PC 제조사 전체를 인수하는 것은 부분적인 투자와 완전히 다른 이야기다. 중립적인 위치에서 여러 PC 제조사에 GPU를 공급하는 엔비디아의 포지션이 흔들리며 미국 연방거래위원회(FTC)를 시작으로 각국 경쟁당국의 심사를 거쳐야 한다. 엔비디아는 2020년 9월 400억 달러(약 47조 5000억원)를 투입해 일본 소프트뱅크 그룹이 보유한 Arm 인수를 시도했지만 영국 경쟁시장청, 미국 연방거래위원회(FTC) 등 각국 경쟁당국의 심사 단계에서 가로막혔다. 퀄컴과 구글, 마이크로소프트와 아마존, 삼성전자 등 Arm 설계자산을 라이선스해 반도체를 만드는 주요 기업들도 이를 반대했다. 결국 엔비디아와 소프트뱅크 그룹은 2022년 2월 인수-양도 계약을 중단해야 했다.

2026.04.15 08:28권봉석 기자

전라남도, 카카오엔터프라이즈 덕에 AX '탄력'…첨단 GPU 선점

카카오엔터프라이즈가 전라남도 지역 인공지능 전환(AX) 사업을 위해 첨단 그래픽처리장치(GPU)를 확보하며 공공·지역 기반 AI 인프라 구축에 속도를 낸다. 글로벌 공급난 속에서도 물량을 적기에 확보하며 사업 안정성을 확보했다는 평가다. 카카오엔터프라이즈는 중소벤처기업부와 전라남도가 추진하는 '지역 주도형 AI 대전환 사업'과 관련해 엔비디아의 최신 GPU 'B200(블랙웰)' 40장을 확보하고 구축을 진행 중이라고 14일 밝혔다. 지역 주도형 AI 대전환 사업은 AI 활용도가 낮은 지역 중소기업의 디지털 전환을 촉진하기 위해 산업 특성에 맞춘 맞춤형 AI 도입을 지원하는 프로그램이다. 전라남도는 화학·철강·세라믹 등 소재·부품·장비 산업과 제약·식품 등 바이오 산업, 신재생에너지 분야 기업을 중심으로 AI 도입을 확대할 계획이다. 최근 AI 반도체 수요 급증과 공급망 불안으로 GPU 확보가 어려운 상황에서 카카오엔터프라이즈는 글로벌 파트너십과 자체 구매 조달 역량을 기반으로 계획된 물량을 일정에 맞춰 확보했다고 밝혔다. GPU 수급 지연 시 사업 전반이 늦어질 수 있는 상황에서 이번 확보는 지역 기업의 AI 도입 시기를 앞당기는 계기가 될 전망이다. 카카오엔터프라이즈는 확보한 GPU를 기반으로 ▲고성능 AI 인프라 운영 ▲AI 오픈 플랫폼 설계 및 구축 ▲마이크로그리드 AI 솔루션 도입 및 실증 ▲AI 활용 인프라 관제 시스템 구축 등을 단계적으로 추진할 계획이다. 이를 통해 전라남도 내 중소기업이 실제 AI를 활용할 수 있는 환경을 조성하고 산업 경쟁력 강화로 이어지도록 지원한다는 방침이다. 이재한 카카오엔터프라이즈 사업부문장은 "GPU 대란 속에서도 계획된 물량을 적기에 조달한 것은 우리의 구매 조달 경쟁력을 증명하는 사례"라며 "확보된 첨단 GPU를 기반으로 전라남도 내 중소기업이 글로벌 수준의 AI 경쟁력을 갖출 수 있도록 사업 수행에 만전을 기할 것"이라고 말했다.

2026.04.14 16:04한정호 기자

[종합] 네이버·삼성 등 5개사, 2조원 정부 GPU 확충 도전장…AWS·MSP 불참 가닥

정부가 추진하는 2조원대 그래픽처리장치(GPU) 구축 사업에 네이버클라우드와 삼성SDS가 참여한 것으로 확인됐다. 양사는 대규모 데이터센터 상면과 전력, 운영 역량을 앞세워 사업 수주전에 뛰어든 반면, 클라우드 관리 서비스 기업(MSP)들은 이번 공모에 대부분 참여하지 않은 것으로 파악됐다. 13일 업계에 따르면 과학기술정보통신부의 '2026년 AI컴퓨팅자원 활용기반 강화사업(GPU 확보·구축·운용지원)' 공모가 이날 마감된 가운데, 네이버클라우드와 삼성SDS를 비롯한 5개 사가 제안서를 제출했다. 이번 사업은 총 2조 805억원을 투입해 최신 GPU와 관련 부대장비를 국내 데이터센터에 구축하고 연내 서비스 개시까지 추진하는 대형 프로젝트다. 정부는 단순한 GPU 수량 확보를 넘어 대규모 클러스터링, 직접 구축·운용 역량, 최신 장비 도입, 연내 서비스 개시 등을 핵심 평가 요소로 제시했다. 특히 동일 데이터센터 내 집적 구축과 전력·냉각·네트워크 설계 역량까지 요구하면서 사업 난도가 크게 높아졌다는 평가다. 업계에선 이번 사업이 사실상 인프라와 운영 역량을 동시에 갖춘 소수 사업자 중심의 경쟁으로 좁혀졌다고 보고 있다. 클라우드 업계 관계자는 "올해 사업은 GPU를 사오는 것만으로 끝나는 구조가 아니라 상면·전력·냉각·하중·운영 체계까지 모두 입증해야 한다"며 "대규모 인프라를 이미 확보했거나 빠르게 확충할 수 있는 사업자에게 유리한 구도"라고 설명했다. 이런 점에서 네이버클라우드는 이번 사업의 유력 후보로 꼽혀 왔다. 최근 LG CNS와 삼송 데이터센터 코로케이션 계약을 체결하며 상면 확충에 나선 데다, 복수 데이터센터를 활용한 확장 전략을 추진하고 있어서다. 회사는 자체 데이터센터 증축과 외부 상면 확보를 병행하며 대규모 GPU 클러스터 수용 기반을 선제적으로 마련해 왔다. 이미 작년도 사업에도 선정돼 GPU 클러스터를 운영해온 노하우가 있어 올해 사업에서도 유리하게 적용할 전망이다. 이번 사업은 지난해 GPU 확보 사업의 연장선에 있다. 정부는 지난해 약 1조 4000억원을 투입해 GPU 1만 3000여 장 확보를 추진했고 네이버클라우드와 NHN클라우드, 카카오가 최종 선정된 바 있다. 이번 공모는 기존 확보 물량에 추가 확장과 고도화를 더하는 2단계 사업이다. 올해 새롭게 참여한 삼성SDS도 핵심 사업자로 거론된다. 삼성 클라우드 플랫폼(SCP)을 기반으로 공공부문 AI 인프라 사업을 확대 중이고 '국가AI컴퓨팅센터' 구축 사업에서도 컨소시엄 주관기관으로 참여하며 인프라 구축 역량을 입증한 바 있다. 특히 동탄 데이터센터를 비롯한 국내 다양한 AI 인프라 전력·운영 체계를 동시에 확보하고 있다는 점에서 경쟁력이 높다는 평가다. 국가AI컴퓨팅센터 컨소시엄에 네이버클라우드도 참여한 것을 감안하면 양사가 국가 AI 인프라 시장에서 핵심 축으로 자리 잡았다는 분석도 나온다. 반면 지난해 정부 GPU 확보 사업에 참여했던 NHN클라우드는 이번 공모에 참여하지 않은 것으로 전해졌다. NHN클라우드 관계자는 "여러 상황을 종합 검토한 결과, 이번 사업에는 참여하지 않는 방향으로 결정했다"며 "지난해 수주해 현재 진행 중인 정부 1차 GPU 구축·운용 사업의 완성도를 높이고 실질적인 성과를 확보하는데 역량을 집중할 계획"이라고 밝혔다. 카카오 역시 이번 사업 참여 여부를 공식적으로 밝히지 않았으나, 업계에선 적극적인 움직임은 없는 것으로 보고 있다. GPU 운영 역량을 보유한 KT클라우드와 엘리스그룹는 신청 여부를 밝히지 않았다. 올해 공모에선 국내 주 사업장 요건이 완화되면서 외국계 클라우드 서비스 제공사(CSP)의 참여 문턱도 낮아졌다. 이에 지난해 공공부문 클라우드 보안인증(CSAP) 하등급을 취득한 아마존웹서비스(AWS) 등도 후보군으로 거론됐지만 실제 신청 여부는 확인되지 않았다. 아울러 최근 AI 인프라를 확장 중인 SK텔레콤은 추가 상면 확보가 어려워 이번 사업에 참여하지 않은 것으로 파악됐다. 현재 업계에 따르면 네이버클라우드와 삼성SDS의 참여는 확실한 상황이다. KT클라우드, 엘리스그룹은 참여가 유력한 것으로 전해졌다. 또 지난해 사업에서 선정되지 못했던 쿠팡이 재도전한 것으로 추정된다. 특히 눈에 띄는 대목은 MSP 기업들의 부재다. 메가존클라우드·베스핀글로벌·디딤 등 주요 MSP들은 이번 공모에 참여하지 않은 것으로 파악됐다. 정부는 지난해 GPU 공급 사업을 운영하면서 단순 인프라 구축보다 서비스 운영 안정성과 이용자 지원 체계, 서비스 수준 협약(SLA)의 중요성이 커졌다고 판단하고 MSP의 컨소시엄 참여를 기대해 왔다. MSP는 클라우드 운영과 관리 경험을 바탕으로 AI 워크로드 지원과 기술지원 체계를 보완할 수 있는 역할로 평가됐기 때문이다. 하지만 실제 공모에선 MSP 참여가 이뤄지지 않은 것으로 나타났다. MSP가 컨소시엄으로 참여하더라도 실질적으로는 인프라 구축이나 운영을 보조하는 용역 성격에 머물 가능성이 크다는 점이 부담으로 작용했다는 지적이다. GPU 자산을 직접 확보·운용하지 않는 구조에선 수익 배분 구조가 제한적일 수밖에 없다는 설명이다. MSP 업계 관계자는 "정부가 SLA 강화를 위해 작년과 달리 컨소시엄 구성과 MSP의 참여를 기대했지만, 실제로는 GPU를 직접 구축·운용하는 것이 사업 핵심이라 MSP가 수익을 낼 구조가 아니다"라며 "결국 지난해에 이어 올해도 CSP 중심으로 재편된 사업"이라고 말했다. 이번 사업의 또 다른 변수는 엔비디아 GPU 수급 일정과 비용이다. 고환율과 글로벌 공급망 불안으로 GPU와 메모리 가격이 상승하면서 당초 목표 물량 확보가 쉽지 않을 수 있다는 우려가 나온다. 실제 업계에선 환율 상승 영향으로 정부가 확보 가능한 GPU 수량이 줄어들 가능성도 거론되고 있다. 앞서 정부는 엔비디아 블랙웰급 이상 최신 GPU 도입을 기본으로 보고 사업 참여 기업이 차세대 베라 루빈 클러스터 구축 제안 시 우대한다는 방침을 제시한 바 있다. 다만 연내 공급 일정과 물량 확보 가능성은 여전히 변수로 꼽힌다. 이와 관련해 정소영 엔비디아코리아 대표는 지난 8일 '시스코 커넥트 2026 코리아' 행사에서 "한국 정부와 기업들의 AI 투자 확대에 맞춰 연내 공급을 준비하고 있다"고 밝힌 바 있다. 향후 일정도 빠듯하다. 정부는 서면·발표 평가를 포함한 선정평가와 함께 데이터센터 현장실사를 병행한 뒤, 다음 달 중 수행기관을 확정해 통보할 예정이다. 이후 협약 체결과 정부출연금 교부 절차를 거쳐 GPU 발주와 데이터센터 구축, 장비 설치 및 성능 검증을 순차적으로 진행한다. 중간 점검은 9월께 이뤄지며 최종적으로는 12월까지 구축과 테스트를 마치고 연내 서비스 개시를 목표로 하고 있다. 이번 사업으로 확보된 GPU 자원은 국가 AI 프로젝트를 비롯해 산학연 연구개발, 스타트업 및 기업 AI 서비스 고도화 등에 폭넓게 활용될 예정이다. 정부는 이를 통해 대규모 AI 학습·추론 환경을 조기에 구축하고 국내 AI 생태계 전반의 성장 기반을 마련한다는 목표다. 업계 관계자는 "사업 규모와 정부 요구 조건을 감안하면 지난해와 마찬가지로 단일 사업자보다는 복수 사업자가 선정될 가능성이 크다"며 "각 사업자가 역할을 나눠 대규모 클러스터를 구축하는 방식이 될 것으로 보인다"고 말했다.

2026.04.13 17:01한정호 기자

[유미's 픽] 2조 GPU 사업 오늘 마감…네이버·삼성 양강 속 AWS 참전하나

정부가 추진하는 2조원 규모의 '인공지능(AI) 컴퓨팅 인프라 구축 사업' 참여 기업들의 윤곽이 13일 드러난다. 우리나라 AI 주권과 직결되는 'AI 고속도로' 구축의 본게임이 또 다시 시작된 가운데 막대한 인프라를 갖춘 전통의 강자들과 신흥 세력 간의 수주 경쟁이 본격화된 양상이다. 과학기술정보통신부와 정보통신산업진흥원(NIPA)이 주관하는 이번 사업 공모는 이날 오후 3시 접수를 마감하고 본격적인 심사에 돌입한다. 총 사업비 2조800억원을 투입해 최신 그래픽처리장치(GPU) 1만5000장을 확보하는 이번 프로젝트는 장비 수급부터 데이터센터(IDC) 하중 설계, 전력 인프라 확보까지 고도의 기술력이 요구되는 고난도 과제로 평가받는다. 이번 사업에서 가장 까다로운 조건으로 꼽히는 것은 IDC 하중 진단 및 제출 요건이다. 엔비디아 최신 GPU가 수냉 기반 냉각 시스템을 기본 적용하면서 장비 무게가 기존보다 크게 늘었기 때문이다. 이에 일반적인 IDC 설계만으로는 이를 견디기 어려워 별도의 보강 공사가 사실상 필수다. 실제 지난해 최신 인프라를 도입하던 과정에서 일부 기업은 하중 문제에 따른 설비 보강으로 구축 일정이 수개월 이상 지연됐다. 이 경험은 올해 사업 요건 강화에 결정적인 영향을 미친 것으로 알려졌다.업계 관계자는 "단순히 장비를 확보하는 능력을 넘어 이를 버텨낼 물리적 상면과 설계 역량을 사전에 검증받아야 하는 구조가 이번에 형성됐다"며 "인프라를 미리 확보한 사업자들에게 유리한 지형이 만들어졌다"고 말했다. 업계에선 이번 GPU 1만5000장 구축의 유력 사업자로 네이버클라우드, 삼성SDS를 꼽았다. 경쟁사들에 비해 상면과 전력 확보 여력이 충분하다고 봐서다. 또 네이버클라우드는 가장 많은 GPU를 배정받을 것으로 관측됐고, 삼성SDS는 약 4000장 규모를 구축할 것으로 내다봤다. KT클라우드도 대표와 주요 임원 교체에 따른 조직 재정비 분위기 속에서도 이번 사업 참여 쪽으로 가닥을 잡는 분위기다. 당초 KT그룹 차원의 경영 재정비 영향으로 작년 말부터 신규 대형 투자 의사결정이 지연돼 이번 사업도 참여가 힘들 것으로 점쳐졌으나, 막판에 방향을 튼 것으로 전해졌다. 업계에선 KT클라우드가 공공 클라우드 운영 경험과 일정 수준의 상면을 기반으로 제안 작업에 참여하고 있는 것으로 보고 있다. 이 외에 엘리스그룹의 행보도 주목된다. 엘리스그룹은 이동형 모듈러 데이터센터 기술을 강점으로 내세워 대규모 GPU 클러스터링 시장에 도전장을 내밀었다. 다만 대규모 전력 확보와 클러스터링 운용 경험 면에서 네이버클라우드나 삼성SDS와 같은 대형 CSP(클라우드 서비스 제공사)들과 어떻게 차별화를 꾀할지는 관건이다. 업계 관계자는 "엘리스그룹은 컨테이너형 모듈러 데이터센터를 활용해 공간 제약은 상대적으로 덜하지만, 결국 전력 확보 여부가 당락을 가를 핵심 변수가 될 듯 하다"며 "특히 이번 심사 항목에 현장 실사가 포함된 만큼, 실제 신청에 나설 경우 일정 수준 이상의 전력과 상면을 사전 확보했을지가 주목할 부분"이라고 밝혔다. 반면 지난해 사업에서 괄목할 성과를 냈던 NHN클라우드는 내년 사업에 승부수를 띄울 가능성이 크다. 또 이번 공모에선 추가 확장보다 기존 인프라 운영 안정화에 무게를 두고 관망하는 분위기다. 업계에선 공공 물량 중심의 낮은 수익 구조를 감안할 때 무리한 추가 수주보다 기존 GPU 클러스터의 가동률과 수익성 개선에 집중하는 전략으로 해석하고 있다. 해외 CSP인 아마존웹서비스(AWS)의 상징적 참전 가능성이 높다는 점도 관점 포인트다. 올해 공모에서 '국내 주 사업장' 요건이 삭제되면서 외국계 기업의 문호가 열렸기 때문이다. 이에 AWS가 향후 공공 AI 인프라 시장 확대를 노리고 있다는 점을 감안하면, 초기 레퍼런스를 확보하고 정책 시장 내 입지를 선점하기 위해 전략적으로 이번 사업에 나설 것으로 관측된다.업계 관계자는 "실제 수주 여부와 별개로 AWS가 이번 사업에 참여할 가능성이 높다"며 "외국계 기업에 열린 문이 다시 닫히지 않도록 존재감을 보여주기 위해 나설 듯 하다"고 말했다. 이번 GPU 사업은 수익성과 공공성 사이의 '딜레마'도 주요 변수로 꼽힌다. 정부 예산으로 GPU를 구매하는 만큼 소유권은 국가에 귀속되고, 사업자는 저렴한 수수료로 자원을 공급해야 한다. 이 때문에 지난해와 달리 올해는 상징성보다 수익성 판단이 훨씬 중요해졌다는 게 업계 중론이다. 여기에 고환율과 글로벌 공급망 불안까지 겹치며 목표 물량 확보에도 빨간불이 켜졌다. 일각에선 지난해 사업 당시 1400원 안팎이던 원·달러 환율 기준이 최근 1500원선까지 오른 점을 감안하면 단순 계산으로도 확보 가능 물량이 약 10% 줄어 1만3500장 수준에 그칠 수 있다는 추산도 내놓고 있다. 이와 관련해 과기정통부 관계자는 "가격이 많이 오르긴 했지만 실제 공모에서는 경쟁이 붙는 부분도 있는 만큼 최대한 1만5000장 목표 달성을 위해 노력해보자는 상황"이라며 "GPU와 메모리 가격, 환율 부담으로 업계 상황이 어렵다는 점은 정부도 파악하고 있다"고 말했다.엔비디아의 차세대 GPU '베라루빈'의 출시 지연 가능성도 이번 사업의 변수로 꼽힌다. 정부는 이번 사업에서 베라루빈과 같은 차세대 하이엔드 GPU를 제안할 경우 평가에서 긍정적으로 반영할 것이란 입장을 내놨지만, 6세대 고대역폭메모리(HBM4)의 검증 병목으로 연내 양산 불확실성이 커지고 있어서다. 시장에서도 베라루빈의 올해 점유율 전망치를 대폭 낮췄다. 시장조사업체 트렌드포스에 따르면 올해 엔비디아의 하이엔드 GPU 출하 구조에서 블랙웰 시리즈가 차지하는 비중은 기존 전망치인 61%에서 71%로 대폭 상향 조정됐다. 반면 차세대 모델 베라루빈 시리즈의 비중은 기존 29%에서 22%로 하향됐다. 투자은행 키뱅크는 보고서를 통해 "SK하이닉스와 마이크론의 HBM4 승인 관련 문제로 루빈의 양산 일정이 늦춰지고 있다"며 "엔비디아가 올해 루빈 생산 목표를 기존 200만 개에서 150만 개로 하향 조정한 것으로 파악된다"고 밝혔다. 이에 대해 과기정통부는 별도 목표치를 두기보다 사업자 제안에 맡기되, 엔비디아와의 협의를 통해 국내 우선 배정을 지원한다는 계획이다. 과기정통부 관계자는 "엔비디아코리아 측에서도 베라루빈 물량이 국내에 우선 배정될 수 있도록 본사와 협상하고 있는 것으로 안다"며 "실제 도입 규모는 사업자들이 상면과 비용 등을 감안해 제안하게 될 것"이라고 설명했다. 그러나 업계에선 정부의 우선 배정 지원 의지와 별개로 실제 연내 대규모 물량 확보는 여전히 불확실하다는 시각이 우세하다. HBM4 검증 지연과 수냉 기반 전력·하중 설계 부담까지 겹치면서 사업자들도 현실적으로는 블랙웰 중심의 제안에 무게를 둘 가능성이 크다는 분석이다. 업계 관계자는 "베라루빈 수급 불안정은 최신 인프라를 조기에 구축하려던 정부 계획에 부담으로 작용할 듯 하다"며 "현실적으로는 이번 사업도 블랙웰 중심의 구축에 머물 수밖에 없을 것"이라고 우려했다. 그러면서 "수냉 기반 구조와 높은 전력 소비, IDC 하중 설계 요건 역시 사업 참여를 가로막는 진입 장벽이 됐다"며 "높은 환율과 중동전쟁 여파로 네트워크 장비 수급도 쉽지 않아 베라루빈은커녕 블랙웰도 정부가 목표한대로 1만5000장을 확보하지 못할 가능성이 높다"고 짚었다. 또 다른 관계자는 "GPU 수급 지연과 IDC 하중 리스크 등 사업 환경이 어느 때보다 가혹한 상황"이라며 "단순한 장비 확보 경쟁을 넘어 데이터센터의 물리적 한계를 극복할 수 있는 실질적인 운영 체력을 입증하는 것이 이번 수주전의 최대 관건이 될 것"이라고 말했다.

2026.04.13 11:16장유미 기자

[현장] 아태 AI 거점 된 한국…시스코-엔비디아, 인프라 판 키운다

시스코가 아시아·태평양 지역 가운데 한국을 핵심 거점으로 삼고 인공지능(AI) 인프라 고도화와 글로벌 생태계 협력을 강화하겠다는 비전을 제시했다. 벤 도슨 시스코 아시아태평양·일본·중국(APJC) 총괄 사장은 8일 서울 코엑스에서 개최한 '시스코 커넥트 2026 코리아'에서 "AI는 개인과 기업, 경제와 사회 전반을 바꾸는 가장 큰 전환이며 그 변화는 한국에서 가장 빠르게 일어나고 있다"고 강조했다. 그는 한국을 AI 혁신의 핵심 국가로 꼽았다. 반도체·제조·바이오 등 다양한 산업에서 AI가 실제 물리적 세계와 결합하며 글로벌 수준의 혁신을 만들어낼 수 있다는 평가다. 특히 고도화된 제조 기반과 ICT 인프라, 빠른 기술 수용 속도를 바탕으로 AI 산업 전반에서 경쟁력을 빠르게 끌어올리고 있다는 점에 주목했다. 도슨 사장은 "한국은 AI로 가치를 창출하며 세계에 가능성을 보여주고 있다"며 "AI가 실제 산업과 결합해 성과로 이어지는 대표적인 시장"이라고 말했다. AI 도입이 빠르게 확산되면서 이를 뒷받침할 인프라 전환 필요성도 함께 커지고 있다. 시스코는 이런 변화에 대응해 AI 시대 핵심 인프라 전략을 재정립하고 있다. 노후화된 기존 네트워크를 단순히 업그레이드하는 수준을 넘어 AI 워크로드에 최적화된 구조로 전환하는 것이 핵심이다. 특히 네트워크와 보안을 분리하지 않고 하나의 구조로 통합하는 접근을 강조했다. AI 시대에는 데이터 흐름과 공격 표면이 동시에 확대되는 만큼, 보안을 네트워크 중심에 내재화해야 한다는 설명이다. 벤 도슨 사장은 "보안은 별도의 기능이 아니라 네트워크 자체에 녹아 있어야 한다"며 "AI 시대 인프라 핵심은 안전한 네트워크"라고 강조했다. 시스코는 AI 전환(AX)을 위한 준비가 전 세계적으로 아직 충분하지 않다고도 진단했다. 자체 조사 결과, 전체 기업 중 약 30%만이 AI를 본격적으로 활용 가능한 상태로 나타났다. 기술뿐 아니라 거버넌스·보안·인력 등 전반적인 준비가 필요하다는 설명이다. 이에 시스코는 AI 데이터센터, 네트워크, 보안, 협업 등 핵심 영역을 통합한 'AI 레디 인프라' 구축을 지원하고 있다. 파트너 생태계를 강화하는 '시스코 360' 프로그램도 도입해 고객 맞춤형 기술 지원을 확대할 계획이다. 이날 행사에선 시스코의 핵심 파트너인 엔비디아와의 협력 전략도 주목받았다. 특히 AI 데이터센터와 컴퓨팅 인프라 수요가 급증하면서, 그래픽처리장치(GPU) 기반 인프라와 네트워크 기술의 결합이 중요해지고 있다는 점이 강조됐다. 발표를 맡은 정소영 엔비디아 코리아 대표는 AI 인프라가 'AI 팩토리' 개념으로 진화하고 있다고 설명했다. 그는 "AI 팩토리는 전기와 데이터를 입력받아 지능을 생산하는 구조로, 향후 모든 산업의 핵심 인프라가 될 것"이라고 말했다. 특히 한국 시장에서 정부의 소버린 AI 정책 확대에 따라 GPU 및 AI 인프라 수요가 빠르게 증가하고 있다고 짚었다. 이에 맞춰 엔비디아는 차세대 AI 슈퍼컴퓨팅 플랫폼 '베라 루빈'을 연내 공급할 방침이다. 정 대표는 "베라 루빈은 CPU와 GPU, 네트워크가 결합된 새로운 AI 슈퍼컴퓨팅 플랫폼으로 학습과 추론 모두에서 성능을 크게 향상시킨다"며 "한국 정부와 기업들의 AI 투자 확대에 맞춰 공급을 준비하고 있다"고 밝혔다. 엔비디아는 향후 로드맵도 공개했다. 베라 루빈 이후 '루빈 울트라', 차세대 아키텍처 '로사 파인만'까지 이어지는 AI 인프라 혁신을 지속할 계획이다. 또 시스코와의 협력을 통해 GPU 컴퓨팅과 네트워크 기술을 결합한 엔터프라이즈 AI 인프라 구축에도 속도를 낸다. 양사는 AI 팩토리 구현을 위한 핵심 파트너로서 협력 범위를 확대하고 있다. 정 대표는 "앞으로도 시스코와 협력을 지속하며 한국 시장에서 AI 인프라 혁신을 함께 만들어가겠다"고 강조했다.

2026.04.08 13:17한정호 기자

[유미's 픽] "GPU 넘는다"…삼성·LG·롯데·포스코 가세로 국산 NPU 확산 본격화

국산 신경망처리장치(NPU)를 중심으로 한 국내 인공지능(AI) 산업 재편이 본격화되고 있다. 정부가 50조원 규모의 'K-엔비디아' 육성 프로젝트를 추진하며 정책 드라이브를 강화하는 가운데 민간 기업들도 공공·제조·클라우드·서비스 등 각 영역에서 NPU 도입과 사업화를 서두르는 모습이다. 3일 업계에 따르면 최근 국내 주요 IT·산업 기업들은 그래픽처리장치(GPU) 중심 AI 인프라에서 벗어나 NPU를 기반으로 한 구조 전환을 추진하며 비용 효율과 전력 절감, 데이터 주권 확보를 동시에 노리고 있다. 기술 검증 단계를 넘어 실제 서비스와 인프라로 확산되고 있는 상황을 고려한 것으로, AI 서비스 확산에 따라 추론 수요가 급증하면서 전력 소비와 운영 비용 부담이 커진 점도 한 몫 했다. 정부도 이 같은 변화에 맞춰 정책 지원을 강화하고 있다. 실제 과학기술정보통신부와 금융위원회는 지난달 민관 합동 간담회를 통해 AI 반도체 시장이 범용 GPU 중심에서 저전력·고효율 중심 구조로 전환되고 있다고 진단하고 국산 NPU 산업 육성에 정책 역량을 집중하겠다고 밝혔다. 국민성장펀드를 통해 향후 5년간 50조원을 투입하는 'K-엔비디아' 프로젝트도 추진 중이다. 이에 따라 클라우드 인프라 영역에서도 국산 NPU 적용이 구체화되고 있다. 삼성SDS가 국산 NPU 기반 '서비스형 NPU(NPUaaS)'를 오는 7월 출시하는 것이 대표적 사례다. 삼성SDS는 기존 '서비스형 GPU(GPUaaS)' 중심 구조에서 벗어나 NPU를 포함한 하이브리드 인프라를 구축함으로써 기업들이 AI 워크로드 특성에 따라 연산 자원을 선택할 수 있도록 하겠다는 전략을 내세웠다. 클라우드에서 구독형으로 NPU를 제공함으로써 초기 투자 부담을 낮추고 도입 장벽을 줄인 점도 특징이다. NPU 도입은 공공과 산업 현장을 중심으로도 확대되는 흐름을 보이고 있다. 비용과 전력 효율이 중요한 공공 인프라를 중심으로 적용 검토가 이뤄지면서 초기 수요도 형성되는 분위기다. 특히 공공 및 유통 인프라 분야에서는 비용 경쟁력 확보를 중심으로 NPU 도입이 이뤄지고 있다. 롯데이노베이트는 딥엑스와 협력해 지능형 CCTV와 ITS에 NPU를 적용하며 GPU 대비 총소유비용(TCO) 절감을 추진 중이다. 업계에선 정책 인센티브가 구체화되기 전부터 국산 반도체 적용을 검토하는 등 선제 대응 성격이 강한 사례라고 봤다. 제조 분야에서는 포스코DX가 모빌린트 NPU를 산업용 제어 시스템에 탑재해 설비 단계에서 실시간 AI 분석과 제어가 가능한 구조를 구축하고 있다. 이는 클라우드 중심 AI에서 벗어나 현장 중심의 엣지 AI로 전환하는 흐름을 반영한 것으로, 보안성과 즉시성을 동시에 확보하려는 전략으로 풀이된다. 클라우드와 플랫폼 영역에서도 대응이 이어지고 있다. LG CNS는 NPU 기반 AI 인프라 구축을 확대하고 있으며, LG유플러스는 NPU와 대규모 언어모델(LLM), 인프라를 결합한 'AI 어플라이언스'를 통해 공공·금융 등 폐쇄망 시장을 겨냥하고 있다. 클라우드 의존 없이 자체 환경에서 AI를 구동할 수 있도록 한 점이 특징이다. AI 모델 영역에서는 LG AI연구원과 업스테이지가 중심 역할을 하고 있다. LG AI연구원은 '엑사원(EXAONE)'을 기반으로 국산 NPU와의 최적화를 추진하며 추론 중심 AI 환경에 대응하고 있으며, 업스테이지 역시 퓨리오사AI와 협력해 NPU 기반 생성형 AI 서비스 상용화를 추진 중이다. 이는 모델 단계에서도 GPU 의존도를 낮추려는 시도로 해석된다. 기업용 소프트웨어 분야에서도 변화가 나타나고 있다. 더존비즈온은 퓨리오사AI와 협력해 전사적자원관리(ERP) 등 핵심 업무 시스템에 NPU 기반 AI를 적용하며 공공·금융 시장 확대를 추진하고 있다. 기존 분석 중심 AI에서 벗어나 실제 업무 프로세스에 AI를 접목하려는 움직임이다. 유통 및 시스템통합(SI) 영역에서는 코오롱베니트가 리벨리온과 협력해 NPU 기반 'AI 엑셀러레이션 서비스'를 추진하며 기업 고객 접점을 확대하고 있다. 반도체 기술을 실제 비즈니스 환경에 적용하는 역할로, 시장 확산을 위한 유통 채널로 기능하고 있다. 클라우드 사업자들의 선행 움직임도 영향을 미쳤다. 네이버클라우드는 'AI반도체 팜' 사업을 통해 국산 NPU의 성능과 안정성을 산업 현장에서 검증하며 상용화 기반을 마련했다. 이후 기업들의 사업화 움직임도 이어지고 있다. 업계에선 현재 국산 NPU 사업을 두고 기술 검증 단계를 넘어 상용화 초기 단계로 보고 있다. 동시에 벤더 간 경쟁도 본격화되면서 기업들은 국산 NPU 도입을 전제로 협력 구조도 구축하는 모습이다. 업계 관계자는 "지금은 NPU 도입 여부를 논의하는 단계가 아니라 어떤 기술을 선택할지 경쟁이 시작된 단계"라며 "정부 정책과 민간 인프라가 맞물리면서 AI 반도체 생태계가 빠르게 확산될 것으로 기대된다"고 말했다.

2026.04.03 08:48장유미 기자

[유미's 픽] "GPU만 사오면 끝?"…정부, 1.5만장 구축 사업서 '설계 능력' 보는 까닭

정부의 대규모 그래픽처리장치(GPU) 인프라 사업 경쟁이 장비 확보에서 운용 능력 중심으로 재편되고 있다. 최신 GPU 도입 여부보다 이를 얼마나 효율적으로 설계·운영할 수 있는지가 올해 사업 선정의 핵심 변수로 떠오른 가운데, 정부가 국내 기업들의 인프라 경쟁력을 끌어올리기 위해 본격 나선 모양새다. 30일 업계에 따르면 과학기술정보통신부는 다음달 13일까지 GPU 1만5000장을 구축하기 위한 사업자 공모에 나선다. 총 2조800억원을 투입해 GPU 서버와 부대 장비를 구매한 후 산·학·연에 공급할 예정으로, 최신 GPU를 신속히 확보하고 이를 대규모로 묶어(클러스터링) 구축·운용할 수 있는 민간 기업을 선정한다는 방침이다. 앞서 정부는 지난해 추가경정예산 1조4000억원을 투입해 확보한 엔비디아 B200 등 첨단 GPU 1만3000장을 NHN클라우드, 네이버클라우드, 카카오엔터프라이즈 등을 통해 구축했다. 또 이 물량을 최근 산·학·연에 3000장, 국가 프로젝트에 4000장, 독자 AI 파운데이션 모델에 3000장씩 배분했다. 또 지난 25일부터 산학연을 대상으로 2000장에 대한 추가 공모에도 들어갔다. 올해 5월 중 선정될 사업자는 연내 GPU 1만5000장 구축 및 서비스를 개시해 2031년 12월 31일까지 운영하게 된다. 이 물량 역시 산·학·연 및 국가 프로젝트를 대상으로 자원 배분과 운영이 이어진다. 이병묵 NIPA AI인프라확충팀장은 "올해 블랙웰급 이상의 최신 GPU 1만5000장 확보를 목표로 한다"며 "고성능 GPU를 대규모로 공급할 수 있는 사업자가 높은 평가를 받을 것"이라고 말했다. 정부는 이번 사업을 통해 참여 기업들의 기술 경쟁력을 끌어올린다는 목표다. 그간 GPU 물량 싸움 중심으로 인프라 구축 사업을 펼친 결과 수행 과정에서 한계가 곳곳에서 드러났던 탓이다. 특히 지난해 처음 GPU 구축 사업에 나서면서 일부 기업들이 H100, B200급을 확보해두고도 소프트웨어, 구성 문제로 실제 성능 효율이 낮은 사례가 발생하자 정부가 이에 대해 문제의식을 크게 느낀 것으로 알려졌다. 대규모 GPU 클러스터는 데이터 흐름과 메모리 구조, 네트워크 구성에 따라 전체 성능이 좌우되는 만큼 단일 장비 성능만으로는 효율을 담보하기 어렵다.또 B200 도입에 따라 수냉식 등 최신 냉각 기술을 적용해야 함에도 불구하고 하중 보강 공사, 구조 변경 등이 빠르게 뒷받침 되지 못해 구축 일정이 지연되는 사례도 벌어지자 정부가 난감해 한 것으로 전해졌다. 업계 관계자는 "정부가 GPU 1만3000장 구축 사업을 진행하면서 GPU만 사오면 끝나면 사업이 아니란 점을 뼈저리게 느낀 듯 하다"며 "지난해엔 얼마나 GPU를 많이 확보하고 싸게 제안했는지를 중점적으로 들여다 본 탓에 정작 운용능력이 뒷받침되지 않아 정부도 속앓이를 많이 한 것으로 안다"고 지적했다. 이에 정부는 올해 사업 평가 기준을 대폭 수정했다. 단순한 장비 확보 능력보다 실제 운영 효율을 검증할 수 있는 요소들을 대거 평가 체계에 포함한 것이다. 실제 이번 사업의 주요 평가 항목 및 배점을 살펴보면 절반인 50점이 사업 준비도 및 경쟁력에 배정됐다. 이 중 인프라 준비도(18점)와 구축 계획의 구체성(32점)은 핵심 평가 항목으로 제시됐다. 특히 데이터센터 상면 확보 여부를 비롯해 전력·냉각 설비, 네트워크 구성, 자원 관리 체계 등 물리적·논리적 인프라를 종합적으로 검증하겠다는 방침을 내세웠다. 이는 단순 가격 경쟁이나 물량 확보보다 실제 대규모 GPU 클러스터를 구축해 안정적으로 운영할 수 있는 역량을 우선 보겠다는 의미다. 특히 32점이 배정된 구축계획 우수성은 정부가 이번 사업을 사실상 '설계 능력 평가'로 보고 있음을 보여준다. 어떤 GPU를 얼마나 들여오겠다는 수준을 넘어 이를 어떤 구조로 묶고 어떤 일정으로 구축하며 실제 서비스 단계까지 어떻게 연결할 것인지를 구체적으로 입증해야 높은 점수를 받을 수 있는 구조란 점에서다. 업계 관계자는 "GPU 활용 효율을 입증할 수 있는 성능 지표 제시가 요구되면서 사업자들의 부담이 한층 커진 상황"이라며 "실제 연산 효율을 얼마나 끌어올릴 수 있는지에 대한 구체적인 방법론과 결과를 함께 제시해야 하기 때문"이라고 말했다. 업계에선 이를 두고 정부가 사업 방향을 '물량 경쟁'에서 '효율 경쟁'으로 전환한 것으로 보고 있다. 동일한 GPU 환경에서도 메모리 활용 방식, 데이터 전송 구조, 추론 엔진 설계에 따라 처리 성능과 비용 효율이 크게 달라지기 때문이다. 이 과정에서 메모리 처리 구조와 데이터 흐름 최적화 등 소프트웨어 역량이 핵심 변수로 부상하고 있다. GPU 연산 성능이 높아도 메모리 대역폭이나 데이터 처리 구조가 이를 뒷받침하지 못할 경우 전체 성능이 제한되는 구조적 한계 때문이다. 이에 일부 기업들은 이러한 병목 현상을 해소하기 위해 추론 엔진 최적화, 모델 경량화, 데이터 처리 구조 개선 등 다양한 기술 경쟁을 벌이고 있다. 같은 GPU를 사용하더라도 운영 방식에 따라 처리 가능한 작업량이 크게 달라져서다. 업계 관계자는 "정부가 차세대 GPU인 '베라루빈' 제안 시 평가에 우대 조건으로 반영할 수 있도록 한 것도 이러한 흐름과 맞닿아 있다"며 "단순 도입 여부보다 고성능 장비를 안정적으로 운용할 수 있는 인프라 설계 능력을 함께 보겠다는 의미"라고 해석했다. 다만 베라루빈과 같은 차세대 GPU는 수냉 기반 구조 등으로 인해 기존 대비 장비 무게와 전력 요구 수준이 크게 높아지는 만큼, 일각에선 이를 수용할 수 있는 데이터센터 인프라 확보 여부가 새로운 변수가 될 것으로 봤다. 실제 올해 사업에서는 데이터센터 하중 구조를 사전에 점검해 제출하도록 하는 요건이 추가된 것으로 알려졌다. 지난해 일부 사업자가 수냉식 장비 도입 과정에서 구조 보강 문제로 일정 지연을 겪은 경험이 반영된 결과다. 업계 관계자는 "작년에는 장비 확보와 단가 경쟁이 중심이었다면, 올해는 성능 효율과 운영 구조까지 함께 검증하는 방향으로 완전히 바뀌었다"며 "실제 서비스를 돌릴 수 있는 수준의 설계 역량을 갖추지 않으면 사업 참여 자체가 쉽지 않은 구조"라고 밝혔다. 전문가들은 이번 사업이 국내 AI 인프라 경쟁 방식 자체를 바꾸는 계기가 될 것으로 보고 있다. 단순한 하드웨어 투자에서 벗어나 소프트웨어와 운영 기술까지 포함한 종합 경쟁력 확보가 요구되고 있기 때문이다. 또 다른 관계자는 "이제는 GPU를 얼마나 확보했는지가 아니라 같은 자원으로 얼마나 높은 효율을 내느냐가 경쟁력의 핵심"이라며 "이번 사업은 국내 기업들이 글로벌 수준의 인프라 운용 역량을 갖추도록 유도하는 전환점이 될 것"이라고 말했다.

2026.03.30 16:27장유미 기자

[유미's 픽] "연산보다 메모리"…구글 '터보퀀트' 등장에 엔비디아도 '긴장'

구글이 생성형 인공지능(AI) 운영의 핵심 병목으로 꼽혀온 '메모리 문제'를 소프트웨어 방식으로 풀어내는 기술을 공개하면서 AI 인프라 경쟁의 방향이 바뀌고 있다. 모델 규모 확대 중심이던 기존 경쟁 구도가 실행 효율과 메모리 최적화 중심으로 이동하고 있다는 분석이 나온다. 27일 업계에 따르면 최근 대규모언어모델(LLM) 운영에서는 연산 성능보다 메모리 처리 효율이 전체 성능을 좌우하는 사례가 늘고 있다. LLM은 답변 생성 과정에서 이전 정보를 반복적으로 참조하는 구조를 갖고 있어 데이터 접근 과정에서 발생하는 지연이 속도와 비용을 동시에 제한하는 요인으로 작용한다. 현재 엔비디아 H100 등 최신 그래픽처리장치(GPU) 도입으로 연산 성능은 크게 향상됐지만, 메모리 대역폭과 데이터 이동 효율은 상대적으로 제한돼 있다. 실제 서비스 환경에서는 GPU 연산보다 메모리 접근이 병목으로 작용하는 경우가 적지 않다. 이 같은 흐름 속에서 AI 추론 시스템을 구성하는 기술 구조에 대한 이해도 중요해지고 있다. AI 추론은 모델, 메모리 구조, 실행 소프트웨어, 하드웨어가 단계적으로 결합된 형태로 작동한다. 우선 모델은 연산 과정에서 생성된 정보를 메모리에 저장하고 이를 반복적으로 참조한다. 이 과정에서 메모리 사용량이 급격히 증가하며 병목이 발생한다. 이를 해결하기 위한 접근이 메모리 압축 기술로, 데이터 표현을 줄이는 양자화(Quantization) 방식과 데이터 구조를 효율적으로 인코딩하는 방식이 함께 발전하고 있다. 이 가운데 구글이 지난 24일 공개한 터보퀀트(TurboQuant)는 데이터 표현 방식을 재구성하는 양자화 기반 접근으로, 메모리 사용량을 줄이면서도 정확도를 유지하는 데 초점을 맞춘 기술로 평가받는다. 엔비디아 역시 같은 문제를 두고 다른 접근을 시도하고 있다. 특히 최근에는 KV 캐시를 효율적으로 저장하기 위한 'KV 캐시 트랜스폼 코딩(KV Cache Transform Coding)' 기반 기술을 앞세우고 있다. 이는 데이터를 단순히 제거하는 방식이 아닌, 정보 구조를 효율적으로 인코딩해 저장 효율을 높이는 접근에 가깝다. 다만 모델별 특성에 맞춘 보정 과정이 필요하다는 점에서 적용 방식에는 차이가 있다. 두 기술 모두 메모리 압축을 목표로 하지만 접근 방식에는 차이가 있다. 터보퀀트가 양자화를 기반으로 정확도 손실을 최소화하는 데 초점을 둔 반면, KV 캐시 트랜스폼 코딩은 인코딩 효율을 높여 압축률을 끌어올리는 기술로 분석된다. 두 기술은 기존 메모리 최적화 기술의 연장선에선 의미 있는 진전으로 평가된다. KV 캐시의 정밀도를 낮추는 양자화 기법은 GPTQ, AWQ 등 오픈소스 진영과 스타트업을 중심으로 확산돼 왔고, 중요도가 낮은 토큰을 선택적으로 제거하는 방식이나 슬라이딩 윈도우 기반 메모리 관리 기법도 일부 모델에 적용돼 왔다. 또 메모리 접근을 줄이는 어텐션 최적화 기술은 데이터 전송 횟수를 줄여 속도를 높이는 플래시어텐션(FlashAttention) 등으로 발전하며 주요 AI 기업과 연구 커뮤니티에서 활용되고 있다. 업계 관계자는 "양자화나 토큰 프루닝 같은 기법은 이미 널리 쓰이고 있지만, 실제 서비스에서는 정확도나 안정성 문제 때문에 적용 범위가 제한적인 경우가 많다"며 "KV 캐시 자체를 압축 대상으로 삼는 접근은 구현 난이도는 높지만, 제대로 적용되면 체감 성능을 크게 바꿀 수 있는 영역"이라고 밝혔다. 메모리 압축과 더불어 모델 실행 방식 자체를 개선하려는 소프트웨어 경쟁도 확대되고 있다. vLLM, 텐서RT-LLM(TensorRT-LLM)을 비롯해 라마(llama.cpp) 등 다양한 추론 엔진들이 등장하며 요청 처리 방식과 메모리 관리 효율을 높이는 방향으로 발전하고 있다. 특히 vLLM은 미국 UC버클리 연구진이 주도해 개발한 오픈소스 추론 엔진으로, 요청을 효율적으로 묶어 처리하고 페이지드어텐션(PagedAttention) 구조를 통해 메모리를 동적으로 관리하는 방식으로 처리 효율을 높인다. 엔비디아가 개발한 텐서RT-LLM(TensorRT-LLM) 역시 GPU 연산을 최적화해 추론 속도를 개선하는 소프트웨어로, 데이터센터 환경에서 널리 활용되고 있다. 추론 엔진은 모델 자체를 변경하지 않고도 실행 방식만으로 성능을 개선할 수 있다. 동일한 모델이라도 어떤 실행 소프트웨어를 사용하느냐에 따라 처리 속도와 비용이 달라지는 구조다. 업계 관계자는 "같은 모델이라도 vLLM이나 텐서RT 같은 추론 엔진 설정에 따라 처리량 차이가 크게 난다"며 "실제 서비스에서는 모델보다 실행 스택이 성능을 좌우하는 경우도 적지 않다"고 설명했다. 메모리 압축 기술과 추론 엔진이 결합된 뒤 최종 연산은 GPU에서 수행된다. 특히 최신 GPU 환경에서는 연산 성능보다 메모리 활용 효율이 전체 성능을 좌우하는 경우가 많아지면서 소프트웨어 기반 최적화의 중요성이 더욱 커지고 있다. 이와 함께 AI 경쟁의 방향도 변화하고 있다. 그동안 생성형 AI는 더 많은 데이터를 학습하고 더 큰 모델을 구축하는 데 집중해 왔지만, 최근에는 동일한 모델을 얼마나 빠르고 비용 효율적으로 운영할 수 있는지가 핵심 경쟁력으로 부상하고 있다. 업계 관계자는 "대규모 서비스에서는 모델 성능보다 추론 효율이 비용 구조를 좌우하는 경우가 더 많다"며 "메모리 구조와 추론 엔진을 함께 최적화하지 않으면 GPU를 늘려도 수익성을 맞추기 어려운 단계에 들어섰다"고 말했다.

2026.03.27 12:11장유미 기자

삼성SDS, 국내 최초 B300 GPU 서비스 출시…기업 AI 추론 시장 공략

삼성SDS가 국내 최초로 엔비디아 B300 GPU 기반 클라우드 서비스를 선보이며 기업 AI 추론 시장 공략에 나섰다. 삼성SDS는 클라우드 '삼성 클라우드 플랫폼(SCP)'을 통해 엔비디아 최신 GPU 'B300' 기반 GPU 구독형 서비스(GPUaaS)를 출시했다고 밝혔다. 이번 서비스는 AI 도입이 개발 단계를 넘어 실제 서비스 운영 단계로 확대되는 흐름에 맞춰 고성능 연산 수요를 대응하기 위해 마련됐다. B300 GPU는 고대역폭메모리(HBM3E)를 12단으로 구성해 GPU당 288GB 메모리와 초당 8TB 대역폭을 제공한다. 이는 기존 H100 대비 메모리 용량은 약 3배 이상, 대역폭은 2배 이상 향상된 수준이다. 특히 대규모 언어 모델 실행 과정에서 발생하는 데이터 전송 지연 문제를 줄이며, 연산 대비 메모리 속 이로 인해 AI 에이전트, 이미지 생성, 영상 처리, 코드 생성 등 고성능 연산이 필요한 서비스에서 응답 속도를 낮출 수 있다. 기업은 더 큰 규모의 AI 모델을 안정적으로 운영할 수 있고, 실시간 처리 요구가 높은 업무에도 적용 범위를 확대할 수 있다. 서비스는 구독형 구조로 제공된다. 기업은 필요한 만큼 GPU를 사용하고 비용을 지불하는 방식이다. 초기 인프라 투자 부담을 줄이고 자원 활용 효율을 높일 수 있다. GPU 수급이 어려운 상황에서도 최신 아키텍처를 즉시 활용할 수 있다는 점도 특징이다. 여기에 삼성SDS의 보안 기술이 결합돼 민감한 데이터도 안정적으로 처리할 수 있다. 삼성SDS는 GPUaaS 생태계를 지속적으로 확장해 왔다. 2021년 A100, 2023년 H100에 이어 이번 B300까지 선제적으로 도입하며 클라우드 기반 AI 인프라 경쟁력을 강화해 왔다. 이를 통해 기업 고객이 AI 인프라를 직접 구축하지 않고도 고성능 환경을 활용할 수 있도록 지원하고 있다. 향후 서비스도 확대한다. 삼성SDS는 별도 인프라 비용 없이 사용량 기반으로 과금하는 '서버리스 추론 서비스'와 자동 분산 학습 기능을 제공하는 'AI 학습 서비스'를 2026년 3분기 내 출시할 계획이다. 이호준 삼성SDS 클라우드서비스사업부장 부사장은 "자원 최적화와 에너지 절감 기술을 기반으로 GPU 활용 효율을 높여 왔다"며 "국내 최초 B300 GPU 서비스를 통해 기업의 AI 전환을 적극 지원하겠다"고 밝혔다. 한편 삼성SDS는 공공 클라우드 사업에서도 입지를 확대하고 있다. 대구 데이터센터에 H100 기반 GPU 서비스를 구축했으며, 범정부 초거대 AI 인프라와 지능형 업무 시스템 구축 사업에도 참여하고 있다. 과학기술정보통신부 고성능 컴퓨팅 지원 사업을 통해 중소기업, 스타트업, 연구기관, 대학 등 약 60여 곳에 GPU 자원을 제공하며 AI 생태계 확산에도 기여하고 있다.

2026.03.23 11:53남혁우 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

[ZD브리핑] 3대 메가프로젝트 2차 점검회의...독파모 국민평가단 참여

AI 학과 늘리기만으론 부족…"모든 전공에 AI 역량 심어야"

유니폼부터 AI 로봇 드로잉까지…무료 KT스포츠 팝업 가보니

AI규제는 풀고 OTT는 발목 잡고…'영화 6개월 홀드백' 논란

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.