• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'루빈'통합검색 결과 입니다. (57건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI 고속도로] "네트워크만으론 부족"…시스코, AI 데이터센터 풀스택으로 영역 확대

시스코가 슈퍼마이크로와 손잡고 인공지능(AI) 데이터센터 사업을 네트워크 중심에서 랙스케일 풀스택 인프라로 확대한다. 엔비디아의 차세대 그래픽처리장치(GPU) 시스템에 서버·네트워크·액체냉각·보안·운영을 통합해 공급하면서 AI 데이터센터 시장의 경쟁도 개별 장비에서 통합 구축 역량 중심으로 빠르게 옮겨가는 모습이다. 시스코는 25일(현지시간) 공식 홈페이지를 통해 슈퍼마이크로와 손잡고 '엔비디아 기반 시스코 시큐어 AI 팩토리'를 랙스케일 AI 컴퓨팅 영역으로 확대한다고 발표했다. 슈퍼마이크로의 액체·공랭식 고밀도 서버를 자사 AI 인프라 포트폴리오에 포함하고 오는 10월부터 공급할 예정이다. 이번 협력으로 시스코는 기존 강점인 네트워크와 보안에 GPU 컴퓨팅과 냉각까지 결합한 통합 AI 인프라를 제공하게 됐다. 슈퍼마이크로는 고밀도 GPU 서버와 액체냉각 시스템을 맡고, 엔비디아는 GPU와 AI 소프트웨어를 공급하는 구조다. 지원 대상에는 엔비디아 '베라 루빈 NVL72'와 'HGX 루빈 NVL8'이 포함된다. 시스코는 자사 액체냉각 AI 네트워크 시스템과 슈퍼마이크로의 액체냉각 서버를 연결해 랙에서 네트워크 패브릭까지 아우르는 냉각 구조도 제공한다. 초거대 AI 모델 학습과 대규모 추론 환경에서 GPU뿐 아니라 전력과 냉각, 네트워크 효율이 성능과 비용을 좌우하는 상황을 겨냥한 구성이다. 시스코는 이번 확장을 통해 기업 고객뿐 아니라 네오클라우드와 소버린 클라우드 시장까지 공략한다. 엔비디아 클라우드 파트너(NCP) 규격에 맞춰 프런트엔드에는 시스코 '실리콘 원' 기반 스위치, 백엔드에는 엔비디아 '스펙트럼-X' 기반 시스코 스위치를 적용하고 이를 '넥서스 원'으로 통합한다. 시스코는 자사 스위치와 네트워크 운영체제를 활용해 NCP 규격을 충족하는 구조를 차별점으로 내세웠다. 시장에선 이번 협력이 AI 데이터센터 경쟁 구도를 한 단계 더 넓히는 계기가 될 것으로 보인다. 지금까지 델과 HPE, 레노버, 슈퍼마이크로 등이 GPU 서버를 중심으로 경쟁했다면, 앞으로는 서버와 네트워크, 냉각, 보안, 운영을 얼마나 빠르게 통합해 가동하느냐가 중요해질 가능성이 커졌다. 시스코도 직접 GPU 서버를 개발하기보다 슈퍼마이크로와 협력하는 방식을 택했다. 자사가 강점을 가진 네트워크와 보안, 운영 소프트웨어를 중심으로 전체 AI 인프라를 묶고 서버 전문 업체의 기술을 결합해 시장 진입 속도를 높이려는 전략으로 풀이된다. 이번 일은 슈퍼마이크로에도 긍정적인 효과가 있을 것으로 예상된다. 시스코의 글로벌 기업 고객과 판매망을 활용할 수 있는 데다 자사 고밀도 GPU 서버와 액체냉각 시스템이 시스코의 AI 인프라 포트폴리오에 포함되면서 판매 채널을 넓힐 수 있기 때문이다. 다만 양사는 구체적인 주문 규모와 매출 목표는 공개하지 않았다. 시스코는 인프라 구축 이후 운영 효율을 높이기 위한 서비스도 강화한다. 또 새 검증 서비스 'CVIS'를 통해 실제 구축된 시스템이 설계된 레퍼런스 아키텍처와 일치하는지 확인하고 대규모 AI 연구소를 통해 관련 도구와 소프트웨어 검증 역량도 확대할 계획이다. 더불어 엔비디아 AI 엔터프라이즈와 시스코 클라우드 컨트롤 기반 에이전틱옵스도 연계해 컴퓨팅과 네트워크 인터페이스 카드(NIC), 광통신, 네트워크 상태를 통합 관리하도록 지원한다. 지투 파텔 시스코 사장 겸 최고제품책임자(CPO)는 "우리는 역사상 가장 큰 데이터센터 구축 사이클 중 하나의 시작점에 있다"며 "모든 조직이 AI 확장을 서두르고 있지만 데이터 통제와 토큰 비용 관리, 실질적인 투자수익률을 함께 확보해야 한다"고 말했다.

2026.08.26 10:18장유미 기자

LG CNS-네이버클라우드, 액체냉각 AI 인프라 구축한다…'베라 루빈' 고발열 대응

LG CNS가 인공지능(AI) 팩토리 인프라 시장 선점을 목표로 첨단 그래픽처리장치(GPU)의 고발열·고밀도 전력에 대응 가능한 액체냉각 적용에 앞장선다. LG CNS는 네이버클라우드와 손잡고 차세대 냉각 기술인 액체냉각 인프라 구축에 나선다고 26일 밝혔다. 생성형 AI 확산으로 고성능 GPU 전력소비와 발열이 늘어나는 가운데, 기존 공랭 방식을 보완하는 대규모 액체냉각 기술을 데이터센터에 선제적으로 적용한다는 방침이다. LG CNS는 네이버클라우드와 삼송 데이터센터에 액체냉각 기술 중 하나인 직접 칩 냉각(DTC)을 적용하고 고성능 AI 서비스 지원을 위한 기반을 마련할 계획이다. 앞서 LG CNS는 삼송 데이터센터의 위탁운영을 맡아 네이버클라우드와 삼송 데이터센터 코로케이션 계약을 체결했다. 이번 인프라는 과학기술정보통신부 산하 정보통신산업진흥원(NIPA) 소유의 엔비디아 차세대 초고성능 GPU '베라 루빈'을 네이버클라우드가 안정적으로 운영할 수 있도록 구축된다. 베라 루빈은 기존 '블랙웰 울트라' 대비 추론 성능이 약 3.3배 향상될 것으로 예상된다. 특히 베라 루빈이 액체냉각 인프라를 기반으로 국내 데이터센터에 본격 적용된다는 점에서 삼송 데이터센터는 AI 팩토리 구현을 위한 핵심 거점으로 평가된다. LG CNS는 총 수전 용량 80메가와트(MW)인 삼송 데이터센터가 국내 최대급 AI 팩토리로 자리매김할 것으로 내다봤다. 삼송 데이터센터에 적용하는 DTC는 냉각수가 흐르는 냉각판을 GPU 칩에 부착해 열을 흡수하는 액체냉각 방식이다. 공기 대비 열전달 효율이 높은 액체를 활용해 고집적 GPU 서버의 발열을 효율적으로 제어한다. 일반적으로 기존 공랭 방식으로 대응할 수 있는 냉각 용량의 한계는 랙당 20~30키로와트(kW) 수준이지만, 고성능 GPU 서버 랙은 전력 밀도가 200kW 이상으로 높아지고 있다. 이에 DTC와 같은 액체냉각은 AI 팩토리 구현을 위한 필수 기술로 주목받고 있다. 시장조사기관 마켓앤드마켓에 따르면 글로벌 데이터센터 액체냉각 시장은 올해 40억 7000만 달러(약 5조 6240억원)에서 2033년 276억 5000만 달러(약 38조원) 규모로 성장할 전망이다. 이에 대응해 LG CNS는 데이터센터 설계·구축·운영(DBO) 역량과 AI 인프라 기술을 결합해 ▲DTC 액체냉각 ▲GPU 서버 운영 환경 ▲전력 공급 체계 ▲AI 플랫폼 운영 기반까지 통합 구현한다는 목표다. 네이버클라우드는 AI 플랫폼 운영 역량과 대규모 GPU 서비스 경험을 바탕으로 국내 공공기관과 기업에 안정적인 고성능 AI 서비스를 제공할 계획이다. 양사는 내년까지 액체냉각 인프라 구축과 실증을 완료할 계획이다. 조헌혁 LG CNS 데이터센터사업담당 상무는 "데이터센터 냉각 기술이 AI 서비스 품질과 운영 효율의 핵심 경쟁력이 되고 있다"며 "네이버클라우드와 협력해 우리 강점인 데이터센터 DBO 역량과 차세대 냉각 기술을 기반으로 국내 AI 생태계 성장을 뒷받침하는 핵심 인프라를 지속 구축해 나가겠다"고 밝혔다.

2026.08.26 10:01한정호 기자

[AI는 지금] GPU만 빠르면 끝?…AI 에이전트 시대, '추론 SW'가 판 바꾼다

인공지능(AI) 에이전트 확산으로 AI 인프라 경쟁의 무게중심이 그래픽처리장치(GPU) 연산 성능에서 추론 소프트웨어와 서빙 시스템 전반으로 넓어지고 있다. 대화형 AI보다 훨씬 긴 컨텍스트를 유지하고 도구 호출과 반복 추론을 수행하는 AI 에이전트가 늘면서 KV 캐시 관리와 요청 스케줄링, 모델 병렬화 같은 소프트웨어 기술이 실제 서비스 성능과 비용을 좌우하는 요소로 떠오르고 있다. 26일 엔비디아에 따르면 차세대 AI 시스템 '베라 루빈 NVL72'는 세미애널리시스의 에이전틱 AI 벤치마크 '에이전트X'를 이용한 자체 시험에서 GB300 NVL72보다 메가와트당 AI 처리량이 최대 30배 높았다. 이번 수치는 엔비디아가 측정한 프리뷰 결과로, 현재 세미애널리시스의 검토를 기다리고 있다. 현재 세대인 GB300 NVL72에서도 성능 격차가 확인됐다. 딥시크 V4 프로 1.6T를 구동했을 때 H200 NVL8 대비 메가와트당 처리량이 최대 15배 높았으며, 키미 K3 2.8T에서는 비슷한 인터랙티브 성능을 기준으로 최대 80배까지 격차가 벌어졌다. 엔비디아는 GB300 NVL72를 사용할 경우 일부 조건에서 H200 NVL8보다 100만 토큰당 비용도 최대 10분의 1 수준으로 낮출 수 있다고 설명했다. 이번 결과에서 주목할 부분은 GPU 세대별 연산 성능 차이만은 아니다. 에이전트X가 기존 AI 벤치마크와 달리 실제 코딩 에이전트가 작동하는 방식을 재현하면서 AI 소프트웨어의 역할을 성능 평가에 본격적으로 끌어들였기 때문이다. 기존 추론 벤치마크는 8K 입력과 1K 출력처럼 길이가 정해진 요청을 반복해 GPU의 처리 성능을 측정하는 경우가 많았다. AI 에이전트는 이전 작업을 기억하면서 컨텍스트가 계속 길어지고 추론 도중 외부 도구를 호출하거나 다른 에이전트에 작업을 넘기기도 한다. 이를 두고 세미애널리시스는 "장문·멀티턴·높은 프리픽스 재사용과 서브에이전트 실행이 실제 AI 서비스 트래픽에서 중요해졌다"며 "그러면서 고정 길이 평가만으로 하드웨어와 소프트웨어 성능을 측정하기 어려워졌다"고 설명했다. 에이전트X는 이를 반영해 실제 클로드 코드 세션에서 발생한 요청 패턴을 재생한다. 턴이 진행될수록 컨텍스트가 누적되는 과정뿐 아니라 도구 호출로 모델이 대기하는 시간까지 반영하고 여러 에이전트가 동시에 작동할 때 처리량과 응답 속도가 어떻게 변하는지도 측정한다. 이에 따라 GPU 자체의 연산 속도뿐 아니라 추론 엔진과 캐시, 라우터가 얼마나 효율적으로 움직이는지가 결과에 영향을 미친다. 세미애널리시스는 에이전트X를 이용한 최적화 과정에서 vLLM의 프리픽스 캐시 적중률이 일부 조건에서 95%를 넘었으며 CPU로 KV 캐시를 오프로딩하는 방식에서는 재연산 대비 출력 처리량이 81.7% 높아진 사례도 공개했다. 세미애널리시스는 "실제 환경은 멀티턴·긴 컨텍스트와 높은 프리필 재사용, 서브에이전트 실행과 수많은 도구 호출로 구성된다"고 설명했다. 이번 일로 AI 소프트웨어 업체에도 향후 변화가 예상된다. 기존에는 쿠다(CUDA) 같은 GPU 프로그래밍 플랫폼과 vLLM·SGLang·텐서RT-LLM 등 추론 엔진의 연산 최적화가 주요 경쟁 영역이었다면, 에이전틱 AI에선 여러 소프트웨어 계층을 하나의 시스템으로 묶어 운영하는 능력이 중요해지고 있어서다. 특히 KV 캐시 관리가 핵심으로 부상하고 있다는 점은 눈여겨 볼 요소다. AI 에이전트가 작업을 수행할 때 이전 컨텍스트를 반복해서 다시 계산하지 않고 캐시에 저장된 데이터를 활용하면 GPU 연산량과 응답 시간을 줄일 수 있어서다. 반대로 동시에 많은 에이전트가 움직이면서 캐시를 제대로 관리하지 못하면 필요한 정보를 삭제하거나 같은 내용을 다시 계산하면서 GPU를 추가해도 성능이 충분히 나오지 않을 수 있다. 요청을 적절한 GPU로 배분하는 라우터와 스케줄러의 역할도 커지고 있다. 세미애널리시스의 에이전트X 시험에서는 엔비디아 추론 오케스트레이션 소프트웨어 '다이나모'의 라우팅 방식을 개선한 뒤 일부 조건에서 출력 처리량이 22.2% 증가했다. 다른 최적화에선 에이전트 세션 재생 시간이 20% 이상 단축됐다. 이는 하드웨어 교체 없이 소프트웨어 최적화만으로도 에이전틱 AI 추론 효율을 끌어올릴 수 있다는 점이 확인된 것으로 평가된다. 엔비디아도 이런 변화에 맞춰 하드웨어와 소프트웨어를 함께 묶는 전략을 강화하고 있다. GB300 NVL72의 72개 GPU를 NV링크로 연결하고 다이나모를 통해 프리필과 디코드 작업을 나누는 동시에 KV 캐시 상태와 서버 부하를 고려해 요청을 배분하는 방식이다. 이를 통해 엔비디아는 SGLang·vLLM·텐서RT-LLM과 MoE 최적화 기술까지 결합해 GPU 한 장의 성능보다 랙 단위 추론 효율을 높이는 데 초점을 두고 있다. 이에 따라 클라우드와 AI 서비스 사업자의 인프라 투자 기준도 달라질 가능성이 있다. 에이전트가 일반 챗봇보다 더 많은 토큰과 컴퓨팅 자원을 사용하는 만큼, GPU 도입 가격뿐 아니라 동일한 전력에서 얼마나 많은 사용자와 에이전트를 동시에 처리할 수 있는지가 서비스 비용을 좌우할 수 있어서다. 에이전트X도 초당 토큰 수에 더해 첫 토큰 생성 시간과 전체 지연시간, 사용자당 인터랙티브 성능, 메가와트당 처리량을 함께 평가하도록 설계됐다. 세미애널리시스는 추론 엔진과 라우터, KV 캐시 관리자, 데이터 전송 라이브러리, 클러스터 제어기가 서로 연동되는 구조를 새로운 AI 추론 환경의 핵심으로 보고 있다. 엔비디아 다이나모뿐 아니라 레드햇의 llm-d, AMD 인페라 등도 여러 추론 소프트웨어를 묶어 분산형 AI 시스템을 운영하는 방향으로 개발되고 있다. 세미애널리시스는 "에이전틱 추론은 칩이나 커널 수준의 문제가 아니라 시스템 전체의 문제"라고 강조했다.

2026.08.26 09:17장유미 기자

인도 데이터센터 회사, 엔비디아 루빈 GPU 9000개 발주

인도 데이터센터 기업 AM인텔리전스가 엔비디아 베라루빈 GPU 약 9000개를 발주했다. 이를 기반으로 인도 하이데라바드에 베라루빈 클러스터를 구축한다. 25일(현지시간) 모바일웓드라이브에 따르면 AM인텔리전스는 엔비디아 베라루빈 NVL72 랙스케일 시스템으로 구축해 30MW 규모 AI 데이터센터에 배치할 계획이라고 밝혔다. 데이터센터가동 목표 시점은 내년 1분기다. 새 데이터센터는 1조개 파라미터 규모의 초거대AI 모델과 에이전틱AI 애플리케이션을 구동할 수 있도록 설계된다. 클라우드 서비스 사업자와 AI 연구소, 소버린 AI 모델을 개발하는 기업과 기관 등이 주요 고객이다. AM인텔리전스는 베라루빈 플랫폼을 활용하면 이전 세대인 블랙웰과 비교해 AI 추론 과정의 토큰 처리 비용을 최대 10분의 1 수준으로 낮출 수 있다고 설명했다. AM인텔리전스는 인도 친환경 에너지 기술 기업 AM그룹의 AI 인프라 사업 부문이다. 재생에너지를 기반으로 대규모 AI 컴퓨팅 인프라와 데이터센터를 구축해 AI 모델 개발사와 클라우드 사업자, AI 연구소 등에 컴퓨팅 자원을 제공한다. 하이데라바드 데이터센터는 AM인텔리전스가 인도와 미국, 핀란드, 말레이시아에서 추진하는 총 1GW 규모 서비스형 컴퓨팅 인프라 구축 계획의 첫 단계다. 회사는 우선 200MW 규모의 컴퓨팅 인프라를 가동하고 전체 구축 사업에 80억 달러 이상을 투자할 계획이다. 2030년까지는 인도와 미국, 유럽에서 데이터센터 용량을 총 5GW까지 확대한다. 데이터센터는 고밀도 AI 컴퓨팅과 액체냉각 시스템을 지원하도록 설계된다.

2026.08.26 08:51박수형 기자

엔비디아, '그록 3 LPX' 대량 양산 돌입…삼성전자·전기 수혜

엔비디아의 최첨단 인공지능(AI) 추론 가속기 '그록(Groq) 3 LPX'가 상용화 궤도에 올랐다. 칩 위탁생산을 맡은 삼성전자와, 기판을 공급하는 삼성전기의 수혜 효과도 본격화할 것으로 기대된다. 엔비디아는 24일(현지시간) 공식 뉴스룸에서 그록 3 LPX가 대량 양산을 시작했다고 밝혔다. 그록 3 LPX는 256개의 그록 3 언어처리장치(LPU)를 탑재한 AI 추론 전용 랙이다. 그록은 엔비디아가 지난해 말 약 29조원을 들여 우회 인수한 팹리스 스타트업이다. 거대언어모델(LLM)의 추론 작업 속도를 높이는 LPU를 개발해 왔다. 본격 생산에 들어간 그록 3 LPX의 첫 고객사는 네덜란드에 본사를 둔 네오클라우드 업체 네비우스다. 네비우스는 자사 엔터프라이즈급 AI 추론 플랫폼 '네비우스 토큰 팩토리'에 그록 3 LPX를 도입하기로 했다. 엔비디아의 이번 발표로 삼성전자, 삼성전기 등 국내 주요 협력사도 수혜 효과를 기대하고 있다. 삼성전자 파운드리는 첨단 공정인 4나노(SF4X)로 그록 3 LPU를 양산하고 있다. 초기 삼성 파운드리가 설정한 그록3 LPU향 웨이퍼 투입량은 월 1만장 수준으로 추산된다. 반도체 업계 한 관계자는 "그록 LPU가 엔비디아 생태계에 편입되면서 물량이 크게 늘고 있고, 삼성 파운드리도 내년 웨이퍼 투입량을 월 1만 5000장 이상까지 확대할 계획획"이라며 "그록의 차세대 LPU로 추가 수주하는 것이 관건"이라고 설명했다. 삼성전기도 그록3 LPU용 플립칩-볼그레이드어레이(FC-BGA)를 올 2분기부터 양산에 들어간 것으로 파악된다. 앞서 삼성전기는 올해 초 삼성 파운드리와 연계해 그록 3 LPU용 FC-BGA에 대한 '퍼스트 벤더(공급량 1위 업체)' 지위를 확보한 바 있다. FC-BGA는 반도체 칩과 기판을 '플립칩 범프(칩을 뒤집는 방식)'로 연결하는 패키지 기판이다. 기존 와이어 본딩 대비 전기·열적 특성이 높아, AI 반도체에서 적극 채용되고 있다. 한편, 그록 3 LPX는 엔비디아가 올 하반기 공급을 시작한 최첨단 AI 플랫폼 '베라 루빈(Vera Rubin)'과 결합 가능한 확장형 제품이다. 엔비디아는 "그록 3 LPX는 차세대 에이전트형 AI를 위한 초고속 토큰 생성으로 베라 루빈의 추론 성능을 지원한다"며 "오픈소스 에이전트 모델 'Gemma 4 31B'를 사용한 벤치마킹에서 초당 3400개의 토큰 출력으로, 해당 모델서 최고 성능을 기록했다"고 밝혔다.

2026.08.25 09:12장경윤 기자

채정환 씨이랩 "베라루빈 구축·운영 국내 최고"

AIDC(AI Data Center,인공지능 데이터센터)가 대한민국의 새로운 성장동력으로 부상했다. AIDC는 AI를 비롯해 반도체·전력·통신·클라우드·서비스까지 아우르는 거대한 '산업 인프라'다. 정부가 최근 AIDC를 국가전략산업으로 육성하겠다고 천명한 이유다. AIDC 시대를 맞아 주목받는 기업 중 하나가 씨이랩이다. AI인프라 회사인 이 회사는 미국 엔비디아(NVIDIA)가 최근 주관한 글로벌 대회인 '2026 AI 시티 챌린지(AI City Challenge)'에서 텍스트 기반 인물 이상 탐색 부문에서 리더보드 1위를 기록하기도 했다. 과학기술정보통신부가 주도하는 민관 협의체인 'AIDC 얼라이언스'에도 참여하고 있다. 엔비디아의 우선 협력사이기도 한 씨이랩은 다가오는 '베라루빈(Vera Rubin)' 시대를 선도적으로 준비하고 있다. '베라루빈'은 GPU는 물론 CPU와 네트워크, 메모리 등을 하나로 묶은 차세대 AI 슈퍼컴퓨터 플랫폼이다. 10일 서울 강남구 언주로 본사에서 지디넷코리아와 인터뷰한 채정환 씨이랩 대표는 회사의 베라루빈 역량과 향후 AI 데이터센터 사업 비전을 들려주며 "지난 7월말 '베라 루빈 프로페셔널 서비스 팀(Vera Rubin Professional Service Team)'이라는 새로운 전문가팀을 결성했다"면서 "수년 전부터 우리가 운영하고 있는 엔비디아 기반 디지털트윈(옴니버스) 팀과 협력해 다가오는 베라루빈 기반 AIDC 시장을 선도하겠다"고 강조했다. 아래는 채 대표와 인터뷰 일문일답. 채 대표는 HPE 등 글로벌회사에서 30년 넘게 IT분야에 일하다 2022년 씨이랩에 합류했다. AI인프라 전문가로 현재 영업을 총괄하고 있다. -최근 결성한 '베라 루빈 프로페셔널 서비스 팀'에 대해 더 자세히 말해달라 "3개 분야 전문가들로 구성한 팀이다. 첫째, 베라 루빈 레퍼런스 아키텍처를 설계할 수 있는 경험 있는 솔루션 아키텍트(Solution Architect)와 둘째, HPC(High Performance Computing) 경험이 있는 성능 튜닝 전문가 셋째, GPU 오케스트레이션을 위한 개발자들이 주축을 이뤘다. 이 세 축의 전문가들을 하나의 팀으로 묶어 엔비디아(NVIDIA) 베라 루빈을 AI 데이터센터(AIDC)에 구축하고 운영 효율을 극대화해주려 한다. 전체 팀원은 8명이다. 특히 이 사업을 위해 최근 황순욱 전 한국과학기술정보연구원(KISTI) 국가슈퍼컴퓨팅본부장을 영입했다. 고성능컴퓨팅(HPC) 전문가인 황 박사는 약 30년간 HPC와 대규모 분산컴퓨팅, 클라우드, AI 슈퍼컴퓨팅 분야 연구개발 및 국가 프로젝트를 수행했다. 국가 슈퍼컴퓨터 5호기 '누리온' 구축과 운영도 총괄했다. 누리온은 2018년 세계 슈퍼컴퓨터 성능 순위에서 11위를 기록했다. 황 박사는 미국 로렌스버클리국립연구소 산하 국립에너지연구과학컴퓨팅센터(NERSC) 방문연구원으로도 일했다." -엔비디아의 차세대 GPU 아키텍처 '베라루빈'이 등장하면서 AI 인프라 업계도 큰 전환기를 맞을 전망이다. 이 변화를 어떻게 보나 "엔비디아의 AI 팩토리(AI Factory) 전략은 데이터센터를 '데이터를 보관하는 창고'에서 '데이터와 전기를 원료로 지능, 즉 토큰(Token)을 대량 생산하는 공장'으로 재정의했다. 이런 토크노믹스(Tokenomics) 중심의 효율성을 극대화하기 위해 우리는 엔비디아가 제시하는 '레퍼런스 아키텍처(Reference Architecture)'를 준수하는 시스템 오케스트레이션에 초점을 맞추고 있다. 베라루빈 이전의 GPU 시스템이 개별 서버나 랙 단위로 최적화하는 방식이었다면, 이번에 등장한 'NVIDIA DSX(datacenter scale-out platform)'는 데이터센터 건물, 전력망, 냉각 인프라, 소프트웨어, 반도체 스택 전체를 하나의 거대한 단일 컴퓨팅 단위, 즉 하나의 AI 팩토리로 묶어 공동 설계(Co-design)하는 체계를 의미한다. DSX는 AI 데이터센터를 서버들의 집합이 아니라 하나의 초대형 컴퓨터로 설계하기 위한 엔비디아의 통합 플랫폼이자 참조 아키텍처다. 베라 루빈과 달리 기존 칩(Hopper와 Blackwell)은 주로 서버 또는 랙 단위가 설계의 기준이었다. GPU 서버 구성, 랙 배치, 네트워크 연결, 전력 공급, 이 정도가 핵심이었다. 하지만 DSX는 설계 범위가 데이터센터 전체로 확대된다. AI 서버와 GPU·CPU, 네트워크, 스토리지, 전력망, 냉각 설비, 건물 구조, 운영 소프트웨어, 디지털 트윈(Omniverse) 등 이 모든 요소를 처음부터 하나의 시스템으로 함께(Co-design) 설계한다. 그래서 엔비디아는 "GPU만 설계하지 말고 데이터센터 전체를 하나의 AI팩토리(AI Factory)로 설계하자"고 했고, 이 개념이 DSX다. DSX 개념이 나온 이유는 베라 루빈 세대의 AI 클러스터가 수만~수십만 개 GPU를 동시에 동작하는 초대형 규모이기 때문이다. 이런 전환이 지금 AI 인프라 업계가 맞고 있는 가장 큰 변화다." -이런 시대 전환에 대응해 씨이랩은 구체적으로 어떤 준비를 하고 있나 "우리 회사는 엔비디아의 차세대 베라 루빈 레퍼런스 아키텍처(Vera Rubin Reference Architecture)를 구축할 수 있는 인력과 경험을 선제적으로 확보했다. 여기에 더해, 다년간 엔비디아와 함께해 온 디지털 트윈 구축 경험을 바탕으로 '엔비디아 옴니버스 DSX 블루프린트(NVIDIA Omniverse DSX 블루프린트)' 기반의 디지털 트윈 설계 프로세스를 전면에 도입, 이를 AI 데이터센터(AIDC) 구축 및 운영에 반영할 계획이다. 즉 레퍼런스 아키텍처를 준수하는 시스템 설계 및 구축과 운영 역량에 더해 이를 가상 환경에서 미리 검증하는 디지털 트윈 역량도 함께 갖춘 것이 우리의 차별점이자 핵심 경쟁력이다." -옴니버스 DSX(Omniverse DSX) 블루프린트 기반의 디지털 트윈 설계 프로세스는 실제로 어떤 효과를 만들어 내나 "'옴니버스 DSX 블루프린트'는 엔비디아가 만든 AI 데이터센터(AI Factory)를 디지털 트윈으로 설계·시뮬레이션하기 위한 표준 설계 프레임워크(블루프린트)다. AI 데이터센터를 가상공간에서 먼저 설계하고, 시험하고, 최적화할 수 있게 만든 설계 템플릿과 개발 플랫폼이다. 이를 통해 기가와트(GW)급 대규모 AI 워크로드를 실제 투입하기 전에 전력 및 냉각의 효율성을 물리적으로 검증할 수 있다. 설계 단계서부터 실제 가동 환경과 거의 동일한 조건으로 시뮬레이션을 돌려볼 수 있어 시행착오를 크게 줄일 수 있다. 즉, 구축 기간과 총소유비용(TCO)을 획기적으로 낮출 수 있다. 이는 단순히 비용 절감을 넘어 데이터센터가 지어지기 전에 그 성능과 효율을 증명할 수 있다는 의미다." -이런 기술 신뢰성이 사업적으로는 어떤 의미를 갖나 "설계 단계부터 GW급 워크로드의 전력·냉각 효율성을 물리적으로 검증할 수 있는 우리의 압도적인 기술 신뢰성은 글로벌 CSP 및 국내 대형 제조사를 앵커 테넌트(Anchor Tenant, 사업이나 시설의 성공을 이끌 핵심 고객 또는 대표 고객)로 조기에 확보하는 지렛대가 될 것이라고 확신한다." -지난 3월 'GTC 202'6에서 베라루빈의 구체적인 스펙이 공개됐다. 이전 세대인 '블랙웰'과 비교하면 어떤 도약이 있었나 "당시 공개한 베라루빈은 베라 CPU, 루빈 GPU, NVLink 6 스위치, ConnectX-9 슈 퍼NIC, BlueField-4 DPU, Spectrum-6 이더넷, Groq 3 LPU까지 7종의 신규 칩과 5종 의 랙으로 구성된 하나의 통합 AI 슈퍼컴퓨터다. 이전 세대인 블랙웰 대비 전문가 혼합(MoE) 모델 학습에 필요한 GPU 수량을 4분의 1로 줄였다. 또 추론 처리량과 와트당 성능은 10배 향상된 반면 토큰당 비용은 10분의 1 수준으로 절감됐다. 특히 알리바바, 바이트댄스, 메타, 오라클 클라우드, 코어위브, 람다 등 글로벌 클라우드·AI 기업들이 도입을 준비하고 있다는 점도 눈여겨볼 부분이다. 그만큼 씨이랩이 선제적으로 확보해온 레퍼런스 아키텍처 구축 역량의 가치도 함께 커질 것이다." -씨이랩의 '베라 루빈 프로페셔널 서비스 팀'이 고객에게 주고자하는 가치는 "우리는 이 전문가 집단을 통해 고객에게 엔비디어 DSX(NVIDIA DSX) 플랫폼의 핵심 목표인 첫째, 구축 기간 획기적 단축과 둘째, 토큰 생성 비용 최소화를 통한 성능 극대화를 실현해 줄 것이다. 이 두 가지 목표를 실제로 달성해줌으로써 고객이 AI 인프라를 운영하면서 얻는 마진, 즉 AI 인프라 운영 마진을 개선해 주는 것이 우리 팀의 최종 목표다." -마지막으로 AI 데이터센터 사업 비전을 말해준다면 "엔비디아 베라 루빈 레퍼런스 아키텍처(NVIDIA Vera Rubin Reference Architecture)를 시작으로 AIDC 인프라를 국내에서 가장 잘 설계하고 구축하며 운영하는 전문가 집단이 되고자 한다."

2026.08.11 06:00방은주 기자

엔비디아, 챗GPT 개발 주역에 대규모 베팅…AI 생태계 확장

엔비디아가 오픈AI 공동창업자이자 챗GPT 개발을 이끈 일리야 수츠케버의 인공지능(AI) 연구소 '세이프 슈퍼인텔리전스(SSI)'에 대규모 투자를 단행하며 차세대 AI 경쟁력 확보에 나섰다. 27일(현지시간) 월스트리트저널과 파이낸셜타임즈에 따르면 엔비디아는 SSI와 장기 전략적 제휴를 체결하고 50억 달러(약 7조원)를 투자하기로 했다. 이번 협력에는 차세대 엔비디아 AI 플랫폼 '베라 루빈' 공급이 포함됐다. SSI는 이 플랫폼을 활용해 현재보다 약 10배 많은 연산 자원을 확보하게 될 예정이다. 양사는 SSI 연구 시스템과 엔비디아의 현행·차세대 플랫폼을 함께 최적화하는 기술 협력도 병행할 계획이다. SSI는 그동안 구글 AI 가속기인 텐서처리장치(TPU)를 중심으로 연구를 진행해왔다. 이번 제휴를 계기로 구글 TPU와 함께 엔비디아 그래픽처리장치(GPU)까지 대규모로 활용하게 되면서 AI 모델 개발에 필요한 컴퓨팅 선택지가 넓어질 전망이다. 이번 투자는 엔비디아의 AI 생태계 확대 전략으로 풀이된다. AI 반도체 공급을 넘어 유망 AI 연구소에 직접 투자하고 컴퓨팅 인프라까지 제공함으로써 차세대 AI 개발 핵심 파트너로 자리매김하는 전략이다. 앞서 엔비디아는 올해 3월 오픈AI 최고기술책임자(CTO) 출신 미라 무라티가 설립한 싱킹 머신스 랩에도 투자와 연산 자원 공급을 결합한 협력 계약을 체결한 바 있다. 이 회사는 최근 엔비디아 장비로 학습한 첫 AI 모델을 공개하는 등 양사 협력 성과를 발표하고 있다. SSI는 수츠케버가 2024년 공동 설립한 AI 연구소다. 상업용 제품과 단기 수익보다 인간을 위협하지 않는 '안전한 초지능' 개발을 목표로 내세우며 연구를 이어가고 있다. 연구 내용은 대부분 비공개지만 미국 실리콘밸리에서 가장 주목받는 AI 스타트업 가운데 하나로 평가받는다. 회사는 지난해 안드리슨 호로위츠와 세쿼이아캐피털 등으로부터 약 20억 달러(약 2조 9300억원)를 투자받았으며 당시 기업가치는 약 300억 달러(약 44조원) 수준으로 평가됐다. 이후 추가 투자 유치가 이어지며 현재 기업가치는 약 320억 달러(약 46조원) 수준으로 거론된다. 젠슨 황 엔비디아 최고경영자(CEO)는 성명을 통해 "수츠케버는 이미 현대 AI의 기초를 뒤흔든 선구자"라며 "베라 루빈 플랫폼을 통해 SSI가 앞으로 이뤄낼 새로운 연구 성과가 기대된다"고 밝혔다.

2026.07.28 09:54한정호 기자

[AI 고속도로] 엔비디아, 베라 루빈 양산에 "AI 서버 경쟁판 바뀐다"

엔비디아가 차세대 인공지능(AI) 플랫폼 '베라 루빈' 기반 시스템의 양산과 고객사 구축에 들어가면서 AI 서버 시장의 경쟁 방식도 달라지고 있다. 그래픽처리장치(GPU)와 중앙처리장치(CPU), 네트워크를 개별 서버에 조립하던 방식에서 벗어나 랙 전체를 하나의 시스템으로 공급하는 구조가 확산되면서, 서버업체의 경쟁력도 자체 설계보다 생산 자동화와 액체냉각, 현장 구축 능력으로 이동하는 분위기다. 22일 블룸버그통신에 따르면 엔비디아는 베라 루빈 기반 시스템을 오픈AI와 구글 클라우드, 마이크로소프트(MS) 애저, 메타, 코어위브, 델테크놀로지스 등에 공급하고 있다. 오픈AI는 오는 3분기부터 베라 루빈을 대규모로 도입할 계획이다. 베라 루빈 NVL72는 루빈 GPU와 베라 CPU, 네트워크 칩 등을 하나의 랙에 통합한 AI 컴퓨팅 시스템이다. 개별 서버를 납품한 뒤 데이터센터에서 연결하는 방식과 달리 전력과 냉각, 네트워크까지 검증된 랙 단위로 공급해 설치 기간과 장애 위험을 줄이는 데 초점을 맞췄다. 서버 조립 방식도 달라졌다. 기존 제품은 GPU와 CPU, 네트워크 장비가 들어간 트레이를 작업자가 직접 케이블로 연결해 초기 생산 과정에서 조립 시간이 길고 불량률도 높았다. 반면 베라 루빈은 내부 케이블을 회로기판과 전용 연결장치로 대체해 사람이 수시간 동안 하던 작업을 로봇이 수분 만에 처리할 수 있도록 설계됐다. 주요 부품에 액체냉각을 적용하면서 팬과 공기 통로가 차지하던 공간도 줄였다. 같은 면적에 더 많은 연산 장치를 배치할 수 있게 되면서 서버업체의 공급 범위도 랙 조립에서 냉각수분배장치와 배관, 전력설비까지 넓어질 것으로 보인다. 이 같은 변화는 델과 슈퍼마이크로, HPE, 레노버 등 AI 서버업체의 사업 구조에도 영향을 줄 것으로 보인다. 엔비디아가 CPU와 GPU, 네트워크, 랙 구조를 표준화할수록 업체별 하드웨어 설계 차이는 줄고 생산량과 납기, 냉각 기술, 구축 서비스가 수주를 가르는 요소로 부상할 가능성이 있어서다. 특히 델은 대형 클라우드 사업자와 AI 전용 데이터센터 운영업체를 대상으로 랙 공급을 늘리는 동시에 기업용 AI 인프라 구축 사업을 확대할 여지가 커졌다. 서버와 스토리지, 네트워크, 유지관리 서비스를 함께 제공할 수 있어 단순 장비 판매보다 통합 프로젝트 수주에 유리할 수 있다. 슈퍼마이크로는 엔비디아 신형 GPU를 빠르게 서버 제품으로 내놓던 기존 강점에서 액체냉각과 랙 단위 구축 역량으로 경쟁 범위를 넓혀야 할 것으로 보인다. 제품 출시 속도만으로 차별화하기 어려워진 만큼 생산시설과 냉각설비, 현장 설치 능력이 실적에 미치는 영향도 커질 전망이다. 폭스콘과 콴타, 위윈 등 대만 전자제품위탁생산·설계 업체에는 대량 생산 기회가 늘어날 것으로 보인다. 엔비디아의 표준 설계에 따라 동일한 랙을 반복 생산하는 구조에선 자체 서버 브랜드보다 자동화 설비와 부품 조달, 생산 수율을 갖춘 제조업체가 유리해서다. HPE와 레노버는 국가 AI 인프라와 슈퍼컴퓨터, 기업 전용 AI 데이터센터 시장에서 냉각과 운영 서비스를 앞세울 가능성이 크다. AI 서버의 전력 밀도가 높아질수록 기존 데이터센터를 개조하고 시스템을 안정적으로 운영하는 기술의 중요성도 커질 것으로 보인다. 다만 서버업체의 매출 확대가 수익성 개선으로 곧바로 이어지지는 않을 것으로 예상된다. 핵심 칩과 네트워크, 시스템 설계를 엔비디아가 공급하는 구조에서 서버업체가 가져갈 수 있는 부가가치는 제조와 구축, 유지관리 영역에 집중될 수 있기 때문이다. 또 대형 클라우드 고객을 대상으로 한 가격 경쟁이 심해지면 출하량 증가에도 마진이 제한될 가능성이 있다. 경쟁사인 AMD도 분주히 움직이는 모양새다. AMD는 차세대 GPU와 CPU, 네트워크를 통합한 AI 랙 '헬리오스'를 앞세워 현재 랙 스케일 시장 공략을 강화하고 있다. 이에 클라우드 사업자들이 엔비디아 제품과 AMD 시스템, 자체 개발 칩을 함께 운용하는 멀티벤더 전략을 확대하면 서버업체의 설계·구축 부담도 커질 가능성이 있다. 이언 벅 엔비디아 부사장은 "우리는 완전한 양산 단계에 들어갔다"며 "현재 모든 주요 고객사에서 시스템(베라 루빈)을 구축하고 있다"고 말했다.

2026.07.22 15:46장유미 기자

범LG 뭉쳤다…LS일렉·LGU+, AI 데이터센터 전력 인프라 개발 맞손

인공지능(AI) 데이터센터의 전력 수요가 급증하는 가운데 LS일렉트릭과 LG유플러스가 직류(DC) 기반 전력 인프라 개발에 나선다. LS일렉트릭과 LG유플러스는 21일 서울 용산구 LS용산타워에서 관련 업무협약을 체결하고, 데이터센터 전력 공급 안정성과 효율을 높이는 기술 협력에 착수했다고 22일 밝혔다. 협력의 핵심은 엔비디아 차세대 AI 플랫폼 '베라루빈'에 대응하는 800V 직류 전원 인프라다. 서버 랙 가까이 고전압 직류 전력을 공급해 전류와 전력 손실을 낮추고, 전력 변환 설비와 배선 구성을 효율화하는 방식이다. LG유플러스는 데이터센터 운영 과정에서 축적한 전력 데이터와 기술검증 환경을 제공한다. LS일렉트릭은 이를 바탕으로 AI 데이터센터용 직류 전력 솔루션과 전력 데이터 분석·진단 기술을 개발한다. 양사는 실제 환경에서 성능, 안전성, 운영 효율을 확인한 뒤 이를 AI 데이터센터 전력 인프라의 표준 모델로 발전시킬 계획이다. LS일렉트릭은 초고압 변압기부터 고압·저압 배전반, 전력관리시스템까지 데이터센터 전력 설비 전반을 공급할 수 있는 역량을 갖추고 있다. 북미 빅테크 데이터센터 관련 수주 규모도 2025년 약 8000억원에서 2026년 상반기 약 1조 2000억원으로 확대됐다. 회사 측은 LG유플러스와의 협력을 기반으로 차세대 직류 배전 기술 경쟁력을 높이고, 글로벌 AI 데이터센터 전력 인프라 시장 공략을 본격화한다는 전략이다.

2026.07.22 09:16류은주 기자

'숨 가빴던 4박5일' 젠슨 황은 무엇을 남겼나

세계 AI 시장을 좌지우지하는 젠슨 황 엔비디아 최고경영자(CEO)가 숨가빴던 4박5일 방한 일정을 마치고 9일 오전 한국을 떠났다. 방한 전인 지난 1일(현지시간) 대만 타이베이에서 열린 '코리아 파트너 나이트'에서 그는 "짧은 휴가를 보낼 예정"이라고 말한 바 있다. 그러나 지난 5일 오후 김포공항 입국 이후 이어진 일정은 여유로운 휴가와는 거리가 멀었다. 삼성전자와 SK그룹, 현대차그룹, LG전자, 네이버 경영진은 물론 정부 관계자와 AI 스타트업 대표들을 잇달아 만나며 눈코 뜰새 없는 바쁜 일정을 소화했다. 입국 당시 그는 "한국을 위한 깜짝 선물이 준비돼 있다"는 발언으로 눈길을 끌었다. 실제로 젠슨 황 CEO는 입국 전 엔비디아 차세대 AI 플랫폼 '베라 루빈' 우선 공급, 네이버 AI 팩토리 구축 협력, 연례 개발자 행사인 GTC의 한국 개최 가능성 등을 언급했다. 그러나 방한 결과는 단순 이벤트성 선물이 아니었다. 반도체 공급망부터 AI팩토리, 로보틱스, 모빌리티, 데이터센터, 국가 AI 인프라, 스타트업 투자 생태계까지 그야말로 한국 AI 산업을 엔비디아의 AI 인프라 전략과 전방위적으로 연결하려는 미래 청사진에 가까웠다. 차세대 전략 제품 위한 HBM·LPDDR5 공급망 재점검 젠슨 황 CEO의 이번 방한 목적 중 가장 큰 하나를 꼽으라면 안정적인 메모리 공급망 확보를 꼽을 수 있다. 엔비디아 입장에서는 하반기 본격 출하될 차세대 AI 플랫폼 '베라 루빈'에 탑재될 HBM 확보가 핵심 과제였다. 여기에 'GTC 타이베이' 기조연설에서 공개된 개인용 AI 슈퍼컴퓨터 'RTX 스파크'에 적용될 저전력 LPDDR5 메모리 확보도 중요했다. RTX 스파크가 모바일용 메모리를 활용하는 만큼 관련 공급망 확보 역시 엔비디아 입장에서는 중요한 과제다. 젠슨 황 CEO가 최태원 SK그룹 회장을 만나 생산능력(CAPA) 확대 방안을 논의한 것도 이런 배경에서다. SK하이닉스는 이미 엔비디아 AI 가속기 공급망의 핵심 축으로 자리 잡고 있으며 향후 HBM4와 HBM4E, 이후 세대 제품 공급에서도 중요한 역할을 담당할 전망이다. 삼성전자 역시 단순한 대체 공급처 이상의 의미를 갖는다. 차세대 HBM 공급뿐 아니라 파운드리를 통한 맞춤형 반도체 생산 역량까지 갖췄기 때문이다. 엔비디아는 SK하이닉스와 삼성전자를 동시에 활용해 메모리와 파운드리 생산 능력을 모두 확보하는 일거양득의 전략적 동맹 관계를 구축한 셈이다. 한국 대상 AI 팩토리·AI 인프라 전략 본격화 이번 젠슨 황 CEO의 방한을 과거 HBM 확보나 한국 국민을 위한 팬 서비스로만 보는 것은 지나치게 단순한 해석일 수 있다는 게 중론이다. 엔비디아의 정체성 변화 때문이다. 엔비디아는 작년부터 자신을 더 이상 GPU 제조사로만 설명하지 않는다. 젠슨 황 CEO가 각종 기조연설 등에서 반복적으로 강조하는 단어와 표현은 'AI 팩토리'와 'AI 인프라'다. AI 모델을 학습하고 운영하는 데이터센터를 AI 토큰을 생산하는 공장(AI 팩토리)으로 정의하고, GPU·네트워크·저장장치·소프트웨어를 하나의 통합 플랫폼(AI 인프라)으로 공급하겠다는 전략이다. 이번 방한 일정 역시 이런 변화와 맞닿아 있다. 8일 오전 발표된 네이버와의 협력은 단순한 GPU 공급 계약이 아니다. 데이터센터 구축과 운영, AI 서비스 개발까지 포함하는 AI 팩토리 모델 구축에 가깝다. SK텔레콤, LG전자, 현대차그룹과의 만남도 각각 통신, 산업 자동화, 모빌리티 분야에서 AI 인프라 확산 가능성을 점검하는 성격이 강했다. 단순히 GPU 칩을 판매하는 것을 넘어 AI 산업 전체를 움직이고 헤게모니를 쥘 수 있는 기반 시설을 공급하겠다는 것이다. 기업 넘어 국가를 고객사로 만드는 엔비디아 최근 엔비디아는 기업을 넘어 국가를 고객으로 확보하는 전략을 추진하고 있다. 사우디아라비아, 아랍에미리트(UAE), 프랑스, 독일 등이 자국 AI 인프라 구축에 나서면서 엔비디아는 국가 단위 프로젝트의 핵심 파트너로 부상했다. 한국 역시 예외가 아니다. 정부가 추진하는 AI 3대 강국 전략과 국가 AI 컴퓨팅 인프라 구축 계획은 엔비디아에게 새로운 기회다. 국가 산업 구조적으로 반도체 공급망과 제조업, AI 서비스 역량을 동시에 갖춘 한국은 엔비디아 입장에서 드문 전략 거점이기 때문이다. 실제로 이번 방한 기간 동안 정부는 엔비디아와 베라 루빈 NVL72 우선 공급에 공감대를 형성했다고 밝혔다. 최신 GPU 공급, AI 연구센터 설립, 기술 협력 확대 논의는 엔비디아가 한국을 장기적인 AI 인프라 수요처로 보고 있음을 보여준다. 엔비디아가 남긴 선물와 숙제 작년 11월 이후 7개월 만에 이뤄진 젠슨 황 CEO의 방한은 한국 AI 산업에 새로운 기회와 가능성을 제시했다. 젠슨 황 CEO는 HBM 공급망을 점검하고 파트너십을 강화하기 위해 한국을 찾았지만, 실제로는 반도체와 통신, 인터넷, 로보틱스 등을 비롯해 정부, 스타트업을 하나의 AI 인프라 네트워크로 연결하는 그림을 제시했다. SK하이닉스는 HBM 시장 주도권 강화, 삼성전자는 차세대 메모리와 파운드리 협력 확대 가능성을 확인했다. 네이버와 국내 AI 기업들은 글로벌 AI 시장 진출을 위한 새로운 통로를 확보했다. 다만 국내 AI 산업 생태계가 엔비디아 기술과 플랫폼에 지나치게 의존하게 될 경우 종속에 따른 주도권 약화 등 여러 우려도 동시에 제기된다. 한국 AI 지도에 얼마만큼의 '엔비디아 그린'을 칠할 것인지는 국가 차원의 기술 자율성과 산업 경쟁력 측면에서 앞으로 풀어야 할 숙제로 남게 됐다.

2026.06.09 09:34권봉석 기자

[AI 고속도로] 정부 GPU 확충에 네이버·삼성·엘리스 선정…내년 베라루빈 도입

정부가 총 2조 805억원 규모 그래픽처리장치(GPU) 확충 사업 수행기관으로 네이버클라우드와 삼성SDS, 엘리스그룹을 최종 선정했다. 정부는 엔비디아 차세대 AI 플랫폼 '베라루빈'을 포함한 최신 GPU를 조기 확보해 연내 연구·산업계에 대규모 AI 컴퓨팅 자원을 공급한다는 목표다. 과학기술정보통신부는 8일 '2026년 AI컴퓨팅자원 활용기반 강화사업(GPU 확보·구축·운용지원)' 최종 수행기관으로 네이버클라우드·삼성SDS·엘리스그룹을 선정했다고 발표했다. 이번 사업은 최신 GPU와 인프라 부대장비를 국내 데이터센터에 구축해 연구기관과 대학, 기업 등에 AI 컴퓨팅 자원을 공급하기 위해 추진됐다. 총 사업비는 2조 805억원 규모로, 정부가 추진하는 대표적인 대규모 AI 인프라 사업이다. 이번에 선정된 3개 기업은 베라루빈과 B300 포함 총 9704장의 GPU를 구축할 예정이다. 사업자별 물량은 네이버클라우드 베라루빈 1008장과 B300 3112장, 삼성SDS 베라루빈 1008장과 B300 2016장, 엘리스그룹 B300 2560장이다. 정부는 확보한 GPU를 기반으로 독자 AI 모델 개발과 국가 AI 프로젝트, 산학연 연구개발 등에 활용할 계획이다. 첨단 GPU 9704장 확보…베라루빈 도입은 내년 상반기 이번 사업 공모는 지난 3월 12일부터 4월 13일까지 한달 간 진행됐고 총 5개 클라우드 기업이 응찰했다. 이후 과기정통부와 정보통신산업진흥원(NIPA)은 제안서 평가와 데이터센터 현장실사, 최종 협상 등을 거쳐 수행기관을 선정했다. 평가 과정에선 GPU 확보 능력뿐 아니라 대규모 클러스터 구축·운영 역량, 전력·냉각 인프라, 네트워크 설계 능력, 동일 데이터센터 내 집적 구축 여부 등을 종합적으로 검토했다. 엔비디아 차세대 아키텍처인 베라루빈 도입 계획과 연내 서비스 개시 가능성을 주요 평가 요소로 반영했다. 다만 당초 정부 계획과 달리 베라루빈의 경우 출시 일정을 고려해 내년 상반기 내 순차적으로 서비스를 개시할 예정이다. 정부는 지난해에도 추가경정예산을 바탕으로 1만 3000여 장에 달하는 GPU 확충 사업을 추진했고 네이버클라우드·NHN클라우드·카카오를 수행기관으로 선정했다. 올해 사업은 규모와 예산을 대폭 확대해 추진하는 후속 프로젝트로 진행된다. 특히 이번 사업에선 최근 메모리와 스토리지 가격 상승 등으로 인해 GPU 구축 비용이 상승했다. 그럼에도 정부는 당초 목표로 한 컴퓨팅 성능 이상을 달성할 수 있도록 가격 대비 성능이 우수한 베라루빈과 B300 등 최신 고성능 칩 도입을 추진했다고 밝혔다. 과기정통부에 따르면 당초 목표로 한 B200 기준 1만 5000장 대비 약 30% 상회하는 성능을 제공하는 GPU를 확보한 것으로 나타났다. 이번 확보한 총 GPU 9704장 중 베라루빈 2016장과 B300 4360장은 정부 AI 프로젝트에 활용된다. 이외의 B300 3328장은 사업자가 자체 활용할 예정이다. 정부는 이를 기반으로 한 국내 사업자의 클라우드 기반 GPU(GPUaaS) 역량 강화도 기대하고 있다. 배경훈-젠슨 황 면담…베라루빈 공급 빨라질까 특히 이날 배경훈 부총리 겸 과기정통부 장관은 방한 중인 젠슨 황 엔비디아 최고경영자(CEO)와 만나 국내 AI 컴퓨팅 인프라 구축 과정을 논의할 것으로 알려졌다. 이 자리에서 배 부총리는 지난해 아시아태평양경제협력체(APEC)를 계기로 추진 중인 엔비디아 GPU 26만 장 공급 로드맵 이행과 이번 사업의 연내 서비스 개시를 위한 조속한 베라루빈 도입 협력을 요청할 것으로 보인다. 이에 맞춰 정부가 이번 확충 사업에서 강조한 '베라루빈' 조기 확보에 힘이 실릴지 주목된다. 정부는 선정된 네이버클라우드·삼성SDS·엘리스그룹와 함께 이달 중 GPU 구매 발주 등을 추진해 입고·구축이 완료된 사업자를 통해 순차적으로 연내 B300 서비스를 우선 개시할 계획이다. 이후 내년 상반기 내 베라루빈 기반 서비스가 진행된다. 정부는 지난해와 올해 구축한 민간 인프라를 토대로 국내 AI 연구개발과 산업 현장에 대규모 AI 컴퓨팅 자원을 공급하고 대규모 AI 수요에 안정적으로 대응할 계획이다. 배 부총리는 "베라루빈 등 이번에 확보할 첨단 GPU가 AI 연구개발 속도와 기술 역량을 한 차원 끌어올리는 핵심 동력이 될 것"이라며 "세계 최고 수준 AI 인프라 역량을 확보해 국내 기업과 연구 기관 등의 AI 혁신과 성장을 지원하겠다"고 강조했다.

2026.06.08 16:58한정호 기자

정부, 엔비디아 GPU 9704장 확보…이달 구매 발주 진행

정부가 2조원대 규모 엔비디아 그래픽처리장치(GPU) 9704장을 확보했다. 과학기술정보통신부는 '첨단 GPU 확보·구축·운용지원 사업' 참여 기업으로 네이버클라우드와 삼성SDS, 엘리스그룹 등 3개 민간 클라우드 기업을 선정했다고 8일 밝혔다. 이번 사업 규모는 2026년 기준 2조800억원이다. 이번 사업은 정부가 추진 중인 'AI 고속도로 구축'의 핵심 인프라 사업이다. 과기정통부는 선정된 클라우드 서비스 기업과 협력해 첨단 GPU 총 9704장을 확보하고 민간·공공의 AI 혁신 수요에 필요한 GPU 자원을 지원할 계획이다. 확보 대상 GPU는 차세대 모델인 '베라루빈' 2016장과 'B300' 7688장이다. 네이버클라우드는 베라루빈 1008장과 B300 3112장을 받고, 삼성SDS는 베라루빈 1008장과 B300 2016장을 받는다. 엘리스그룹은 B300 2560장을 구축할 예정이다. 정부는 당초 B200 1만 5000장 규모를 목표로 했으나 최신 고성능 모델 도입을 통해 목표를 웃도는 성능을 확보하게 됐다고 설명했다. 과기정통부에 따르면 이번 확보 물량은 B200 약 1만 9000장 규모에 해당해 당초 목표 대비 약 30% 높은 성능을 제공한다. 베라루빈은 이번 사업에서 가장 주목되는 엔비디아의 차세대 GPU다. 과기정통부는 베라루빈이 기존 모델보다 대역폭과 연산 속도가 크게 향상돼 데이터 병목을 줄이고 동일 시간 안에 더 많은 사용자 요청을 처리할 수 있다고 설명했다. AI 모델 학습에 드는 시간과 비용도 줄어들 것으로 기대했다. 확보 물량 중 베라루빈 2016장과 B300 4360장은 정부 활용분으로 쓰인다. 이 자원은 독자 AI 파운데이션 모델 개발, 국가 AI 프로젝트, 산·학·연 AI 모델·서비스 개발과 고도화 지원에 투입된다. 나머지 B300 3328장은 민간 자체 활용분으로 배정된다. 선정된 클라우드 기업들은 이를 클라우드 기반 GPU 서비스 공급과 자체 AI 모델·서비스 고도화에 활용된다. 정부는 6월 중 선정된 3개 기업과 GPU 구매 발주 등을 추진한다. B300은 입고와 구축이 완료된 기업을 통해 연내 순차적으로 서비스를 시작하고 베라루빈은 출시 일정을 고려해 2027년 상반기 안에 순차적으로 서비스를 개시할 예정이다. 앞서 젠슨 황 엔비디아 최고경영자(CEO)는 지난 5일 방한해 삼성전자와 네이버, SK하이닉스, 현대자동차, LG그룹 등 국내 주요 기업 총수들과 잇따라 만났다. 젠슨 황 CEO는 이들과 AI 인프라 구축과 피지컬 AI 협력 방안 등을 논의한 것으로 알려졌다. 배경훈 부총리 겸 과기정통부 장관은 "베라루빈 등 이번에 확보할 첨단 GPU가 AI 연구 개발 속도와 기술 역량을 한 차원 끌어올리는 핵심 동력이 될 것"이라며 "세계 최고 수준의 AI 인프라 역량을 확보하여, 국내 기업과 연구 기관 등의 AI 혁신과 성장을 지원하겠다"고 밝혔다.

2026.06.08 16:39김미정 기자

슈퍼마이크로, 1GW급 'AI 팩토리' 청사진 공개…에이전틱 AI 인프라도 강화

슈퍼마이크로가 차세대 인공지능(AI) 데이터센터와 에이전틱 AI 인프라 시장 공략에 속도를 낸다. 엔비디아 차세대 AI 플랫폼 '베라 루빈' 기반 초대형 데이터센터 구축 청사진을 공개한 데 이어 Arm과 협력한 고효율 랙 스케일 인프라까지 선보이며 AI 인프라 경쟁력을 강화하는 모습이다. 슈퍼마이크로는 엔비디아 베라 루빈 NVL72 및 엔비디아 HGX 루빈 NVL8 플랫폼 기반 '데이터센터 빌딩 블록 솔루션(DCBBS)' 블루프린트를 공개했다고 4일 밝혔다. 이날 회사는 Arm AGI 중앙처리장치(CPU) 기반 엔터프라이즈 에이전틱 AI용 신규 랙 스케일 인프라도 함께 선보였다. 최근 AI 인프라 시장은 단순 그래픽처리장치(GPU) 공급 경쟁을 넘어 데이터센터 전체를 얼마나 빠르고 효율적으로 구축·운영할 수 있는지로 경쟁 축이 이동하고 있다. 특히 초거대 AI 모델 확산과 AI 에이전트 수요 증가로 컴퓨팅 성능뿐 아니라 전력·냉각·네트워크·스토리지·운영 소프트웨어를 통합 제공하는 'AI 팩토리' 구축 역량이 핵심 경쟁력으로 부상 중이다. 이번에 공개된 DCBBS 블루프린트는 5메가와트(MW)급 데이터센터부터 1기가와트(GW)급 초대형 AI 데이터센터까지 구축할 수 있도록 설계됐다. 엔비디아 최신 레퍼런스 아키텍처를 기반으로 1152개 GPU 규모 확장형 유닛을 제공하며 컴퓨팅과 스토리지, 네트워킹, 전력 인프라, 수냉식 냉각 시스템을 통합 지원한다. 이를 통해 슈퍼마이크로는 데이터센터 설계부터 구축, 운영까지 전 과정을 단일 체계로 지원한다는 목표다. 현장 시설 조사와 설계, 냉각 시스템 구성, 전력 인프라 구축, 랙 통합, 시운전, 소프트웨어 설치까지 일괄 제공해 구축 기간을 단축할 수 있다는 점을 강점을 내세우고 있다. 특히 엔비디아 베라 루빈 NVL72 플랫폼은 이전 세대 대비 GPU 메모리 대역폭과 GPU 간 연결 대역폭, 네트워크 성능이 향상돼 초거대 AI 모델 학습과 추론 환경에 최적화됐다. 슈퍼마이크로는 10만 개 이상 GPU가 적용된 대규모 수냉식 AI 데이터센터 구축 경험을 바탕으로 관련 시장 공략을 강화할 계획이다. 에이전틱 AI 시장을 겨냥한 신규 랙 스케일 인프라도 공개했다. Arm과 협력해 선보인 이번 솔루션은 Arm AGI CPU 기반으로 설계됐으며 기업 데이터센터의 AI 에이전트 워크로드 처리 효율을 높이는 데 중점을 뒀다. 신규 플랫폼은 공냉식 서버와 GPU 서버, 수냉식 멀티노드 서버 등으로 구성된다. Arm 네오버스 CSS V3 기반 CPU를 적용해 전력 효율과 컴퓨팅 집적도를 높였으며 단일 공냉식 랙 환경에서 6000개 이상의 CPU 코어를 구성할 수 있도록 설계됐다. 슈퍼마이크로는 Arm AGI CPU가 기존 아키텍처 대비 랙당 2배 이상의 성능을 제공할 수 있으며 AI 데이터센터 용량 1GW 기준 최대 100억 달러 규모 설비투자(CAPEX) 절감 효과를 지원할 수 있다고 설명했다. 이를 통해 에이전틱 AI 확산에 따른 전력과 공간 제약 문제를 해결하는 데 기여한다는 방침이다. 찰스 리앙 슈퍼마이크로 최고경영자(CEO)는 "엔비디아 베라 루빈 NVL72 플랫폼은 AI 팩토리 성능의 새로운 기준을 제시한다"며 "DCBBS 블루프린트는 5MW부터 1GW에 이르는 모든 규모의 환경을 구축할 수 있도록 검증된 엔드투엔드 구축 방식을 제공한다"고 말했다. 이어 "우리는 업계 초기부터 세계 최대 규모 수냉식 AI 팩토리를 구축해왔다"며 "이러한 경험과 노하우를 모든 블루프린트에 반영해 고객이 설계 단계부터 실제 운영 환경 구축까지 더욱 빠르게 전환할 것"이라고 덧붙였다.

2026.06.04 14:35한정호 기자

젠슨 황 "베라 루빈 본격 양산…삼성·SK·마이크론 HBM4 탑재"

엔비디아가 차세대 AI 가속기인 '베라 루빈(Vera Rubin)'이 본격적인 양산 체제에 돌입했다고 강조했다. 젠슨 황 엔비디아 최고경영자(CEO)는 1일 대만 타이베이에서 열린 '컴퓨텍스 2026' 기조연설에서 "컴퓨팅 수요는 믿을 수 없을 정도로 높다"며 "베라 루빈이 본격적인 양산에 들어갔다(Vera Rubin in Full Production)"고 강조했다. 베라 루빈은 엔비디아가 올 하반기 공식 출시할 예정인 차세대 AI 가속기다. 해당 칩은 엔비디아가 자체 설계한 베라 CPU와 루빈 GPU, NV링크 6 스위치, 블루필드-4 DPU, 그록3 LPU 등 7개 요소로 구성된다. 젠슨 황 CEO는 "베라 루빈을 위한 공급망은 이전 세대인 '그레이스 블랙웰' 대비 2배나 크다"며 "랙 조립 시간도 이전 2시간이 걸렸던 것에 비해, 이제는 5분밖에 걸리지 않는다"고 말했다. 베라 루빈 양산을 위한 파트너사들과의 협력도 강조했다. 젠슨 황 CEO는 연설 도중 재생한 영상을 통해 "베라 루빈은 TSMC의 3나노미터(nm) 공정과 2.5D 패키징을 거친다"며 "마이크론, SK하이닉스, 삼성전자의 7세대 고대역폭메모리(HBM4)가 탑재된다"고 설명했다.

2026.06.01 13:32장경윤 기자

젠슨 황 엔비디아 CEO, 7개월만에 다시 한국행

인공지능(AI) 인프라 기업으로 변신을 선언한 미국 반도체 기업 엔비디아의 젠슨 황 최고경영자(CEO)가 6월 초 한국을 방문한다. 지난해 10월 경주에서 열린 '아시아태평양경제협력체(APEC) CEO 서밋' 참석 이후 약 7개월 만의 방한이다. 다음 주는 동아시아 최대 규모 ICT 전시회인 '컴퓨텍스 타이베이 2026' 기간이다. 엔비디아는 행사 기간 중 대만 개발자와 학계·업계 관계자를 대상으로 기술 행사 'GTC 타이베이'도 진행한다. 대만대외무역발전협회(타이트라)와 엔비디아에 따르면, 젠슨 황 CEO는 컴퓨텍스 개막 전날인 6월 1일(현지시간) 오전 기조연설에 나선다. 다음날인 2일 오전에는 매트 머피 마벨 CEO 기조연설에 게스트로 참석할 예정이다. 이후 대만 일정을 소화한 뒤 6월 3일 전후 한국을 찾을 것으로 예상된다. 젠슨 황, 작년 APEC서 정재계 인사와 회동 젠슨 황 엔비디아 CEO는 지난해 10월 말 2010년 이후 15년 만에 한국을 찾았다. 당시 이재용 삼성전자 회장, 정의선 현대자동차그룹 회장과 서울 삼성동에서 '치맥 회동'을 가졌다. 이어 지포스 GPU 한국 진출 25주년 기념행사 '지포스 게이머 페스티벌 2025' 현장을 찾아 참가자들에게 감사 메시지를 전하고, 주요 그래픽카드 제조사 국내 법인 및 온라인 유통업체 관계자들을 격려했다. 다음날인 31일에는 경주 화백컨벤션센터에서 이재명 대통령과 만나 AI 협력 방안을 논의하고 기조연설도 진행했다. 당시 그는 삼성전자와는 HBM, SK그룹과는 AI 팩토리, 현대차그룹과는 자율주행·로보틱스 분야 협력을 각각 언급했다. 엔비디아는 이날 한국 정부와 삼성전자, SK그룹, 현대자동차그룹 등에 각각 최대 5만장, 네이버클라우드에 6만장 등 총 26만장의 블랙웰 GPU를 공급하겠다고 밝히기도 했다. '전략적 협업' 공언한 LG전자, 방문 가능성 주목 다음 주 한국을 찾는 젠슨 황 CEO의 가장 유력한 방문지로는 LG그룹이 거론된다. 구광모 LG그룹 회장을 비롯해 LG전자 등 주요 계열사 경영진과 회동할 가능성이 크다는 전망이 나온다. LG전자는 지난 달 29일 1분기 컨퍼런스콜에서 "엔비디아와 기존 협력을 넘어 피지컬 AI 분야 전략적 협업을 강화하고 있다"고 밝혔다. 당시 LG전자는 "가정용 로봇과 디지털 트윈, AI 데이터센터 냉각 등 다양한 분야에서 협력 방안을 논의하고 있다"고 설명했다. LG전자뿐 아니라 LG AI연구원의 초거대 AI 모델 '엑사원(EXAONE)', LG이노텍의 AI 반도체 기판·로봇 센싱 사업, LG유플러스의 AI 클라우드 사업 등 그룹 차원의 협력 가능성도 거론된다. SK하이닉스·삼성전자도 만나나 현행 GPU인 블랙웰과 올 하반기 공급 예정인 차세대 GPU '베라 루빈'의 안정적 공급을 위해서는 고대역폭메모리(HBM) 확보가 핵심이다. 현재 글로벌 HBM 시장에서 80%에 가까운 점유율을 확보한 SK하이닉스와 삼성전자 역시 유력한 방문지로 꼽힌다. 젠슨 황 CEO는 이번 방한 기간 양사 경영진과 만나 HBM4·HBM4E 로드맵과 생산 역량 등을 점검할 것으로 보인다. 삼성전자는 지난 2월 HBM4 양산과 출하에 성공한 데 이어 최근 차세대 제품인 HBM4E 12단 시제품도 출하했다. SK하이닉스 역시 지난 4월 말부터 엔비디아 베라 루빈에 최적화된 저전력 LPDDR5X 기반 차세대 메모리 모듈 'SOCAMM2' 192GB 제품 양산에 돌입했다. 1일 타이베이서 국내 주요 기업과 만찬 예정 젠슨 황 CEO의 이번 방한은 글로벌 AI 인프라 공급망 내 한국의 전략적 위상을 다시 확인하고, 핵심 파트너사들과의 협력을 더욱 강화하는 계기가 될 전망이다. 젠슨 황 CEO는 1일 저녁 타이베이 시내에서 국내 주요 기업 및 파트너사 관계자들이 참석하는 '코리아 파트너 나이트' 행사에도 참석한다. 이 자리에서 방한 목적과 주요 일정 등을 직접 언급할 가능성도 있다. 엔비디아는 "이 행사는 컴퓨텍스 기간 중 처음 열리는 행사로, 국내 파트너들과 협력 강화 측면에서 의미가 있다"고 설명했다.

2026.05.30 10:22권봉석 기자

'AI 거품설' 일축...엔비디아 "AI 투자 3조 달러 시대 온다"

"에이전틱 AI 시대에 접어들어 AI가 실제로 생산적이고 가치 있는 일을 수행하기 시작했다. 연산 역량이 매출과 영업이익에 직결되는 시대가 왔다. 토큰이 수익을 내고 주요 AI 기업들이 더 많은 서비스를 생산하기 위한 경쟁에 돌입했다." 20일(현지시간) 1분기(2~4월, 회계연도 기준 2027년 1분기) 실적 발표 이후 진행된 컨퍼런스콜에서 젠슨 황 엔비디아 CEO가 이렇게 강조했다. 이날 엔비디아가 공개한 1분기 매출은 816억 1500만 달러(약 122조 2503억원)로 전년 동기(440억 달러) 대비 85% 늘어났다. 영업이익은 535억 달러(약 80조 1371억원)로 전년 동기(187억 달러) 대비 세 배 이상 늘어났다. 젠슨 황 CEO는 "현재 AI 인프라 수요는 포물선 형태로 늘어나고 있다. 엔비디아는 모든 프론티어 AI 모델을 지원하는 유일한 플랫폼이며 하이퍼스케일 클라우드뿐 아니라 AI 네이티브 클라우드, 소버린 AI, 산업용 AI, 로보틱스까지 모두 지원한다"고 강조했다. "차세대 GPU '베라 루빈', 올 3분기부터 공급 시작" 이날 콜렛 크레스 엔비디아 최고재무책임자(CFO)는 "베라 루빈 출하는 올 3분기부터 시작해 4분기부터 대량 생산에 들어간다. 내년 1분기에는 큰 규모의 매출이 일어날 것"이라고 설명했다. 이어 "이미 주요 고객들의 주문 계획이 확정된 상태이며 수요 역시 충분히 확보됐다. 현재는 복잡한 시스템 조립과 생산 타이밍이 핵심 변수"라고 덧붙였다. 젠슨 황 CEO도 "모든 선도 AI 모델 기업이 베라 루빈을 도입할 것으로 예상된다. 베라 루빈은 블랙웰보다 더 성공적인 제품이 될 것"이라고 강조했다. 베라 루빈은 Arm 기반 88개 코어 탑재 CPU인 '베라'와 GPU '루빈'으로 구성된다. 엔비디아는 전 세대와 달리 올해부터는 베라 CPU를 별도로 분리해 공급할 예정이다. 젠슨 황 CEO는 "수십억 개 AI 에이전트가 등장하면 이들이 사용하는 도구와 오케스트레이션 작업은 CPU가 담당하게 된다. 올해 CPU에서 200억 달러 매출이 예상된다"고 설명했다. "AI 투자, 연 3조 달러 규모 간다" 젠슨 황 CEO는 글로벌 클라우드 업체와 하이퍼스케일러의 투자 규모에 대해서 낙관론을 내놨다. 그는 "애널리스트들은 하이퍼스케일러 투자가 내년 1조 달러에 달할 것이며 장기적으로는 3~4조 달러까지 지속 성장할 것"이라고 말했다. 그는 “AI 기업들은 과거 SaaS 기업들이 10년 걸려 달성했던 성장을 단 몇 달 만에 만들어내고 있다”며 “AI는 엄청난 수준의 컴퓨팅을 필요로 한다”고 설명했다. 특히 엔비디아는 향후 AI 데이터센터 시장이 단순 하이퍼스케일러를 넘어 산업·기업·국가 단위로 확대될 것으로 전망했다. 젠슨 황 CEO는 "현재 두 번째 시장군인 AI 네이티브 클라우드, 엔터프라이즈, 산업용 AI, 소버린 AI 시장이 매우 빠르게 성장하고 있다. 장기적으로 이 시장 규모가 하이퍼스케일러 시장보다 더 커질 가능성이 높다"고 말했다. "피지컬 AI와 로보틱스·추론 시장 확대 전망" 젠슨 황 CEO는 향후 AI 시장의 중심 축이 피지컬 AI와 로보틱스로 확장될 것으로 전망했다. "전 세계 수십만 개 기업들이 자체 AI 팩토리를 구축하게 될 것이며 특히 제조·산업 분야는 클라우드가 아닌 온프레미스 인프라가 필요하다"고 강조했다. 그는 "앞으로 수십억 개의 자율주행·로봇 시스템이 실제 세계에서 작동하는 시대가 올 것이며 엔비디아는 30년에 걸쳐 컴퓨팅 플랫폼을 구축해왔다"고 말했다. 젠슨 황 CEO는 추론 시장 점유율 확대도 전망했다. 그는 "올해 앤트로픽과 전략적 협력을 시작했고 AWS, 마이크로소프트 애저, 코어위브 등 다양한 클라우드 사업자를 통해 대규모 컴퓨팅 용량을 공급하고 있다"고 설명했다. "미국 정부 승인에도 중국 GPU 사업 여전히 불투명" 젠슨 황 CEO는 지난 주 미-중 정상회담 당시 도널드 트럼프 미국 대통령 전용기에 함께 탑승해 중국 베이징으로 향했다. 정상회담 직후 로이터통신은 "미국 상무부가 알리바바, 텐센트, 징둥닷컴 등 중국 기업 10여 곳에 H200 GPU 공급을 승인했다"고 보도했다. 그러나 콜렛 크레스 CFO는 "실제로 매출은 발생하지 않았다. 중국 정부의 수입 허가 여부도 불확실하다. 이 때문에 지난 분기와 마찬가지로 이번 가이던스에도 중국 시장 매출은 포함하지 않았다"고 설명했다.

2026.05.21 07:56권봉석 기자

[유미's 픽] 2조 GPU 사업 '승자의 저주' 되나…네이버·삼성·엘리스 3파전 압축

정부의 2조원대 그래픽처리장치(GPU) 확충 사업이 막판 검증 국면에 들어갔다. 대규모 물량 확보보다 이를 한데 묶어 안정적으로 돌릴 수 있는 클러스터 운영 능력과 수익성이 최종 변수로 떠오르면서 사업자별 희비도 엇갈리고 있다. 14일 업계에 따르면 과학기술정보통신부와 정보통신산업진흥원(NIPA)은 현재 추진 중인 '2026년 AI컴퓨팅자원 활용기반 강화사업'의 발표 평가를 최근 마치고 지난 11일부터 차례대로 데이터센터 현장실사 단계에 들어갔다. 현장실사 대상에는 네이버클라우드, 삼성SDS, 엘리스그룹이 오른 것으로 파악됐다. 당초 제안서를 낸 쿠팡과 KT클라우드는 발표평가 단계에서 제외된 것으로 알려졌다. 이번 사업은 총 2조805억원을 투입해 최신 GPU와 관련 부대장비를 국내 데이터센터에 구축하고 연내 서비스 개시까지 추진하는 프로젝트다. 정부는 단순한 GPU 수량 확보를 넘어 대규모 클러스터링, 직접 구축·운용 역량, 최신 장비 도입, 연내 서비스 개시 등을 핵심 평가 요소로 제시했다. 또 동일 데이터센터 내 집적 구축과 전력·냉각·네트워크 설계 역량까지 요구되면서 사업 난도도 높아졌다. 정부는 지난해에도 약 1조4000억원을 투입해 GPU 1만3000여 장 확보를 추진했다. 당시 네이버클라우드와 NHN클라우드, 카카오가 최종 선정됐다. 업계 관계자는 "이번 사업은 제안 물량을 크게 쓰는 것만으로는 통과하기 어려운 구조"라며 "연내 구축 가능성, 동일 데이터센터 내 집적 구축, 전력·냉각 여건을 실제로 입증할 수 있느냐가 발표평가를 가른 것으로 보인다"고 말했다. GPU 물량 경쟁 속 클러스터 역량 부상 업계에선 네이버클라우드가 이번 사업에서 GPU 9000장 안팎을, 삼성SDS는 4000장 안팎을 제안한 것으로 보고 있다. 엘리스그룹은 2000장 수준의 물량을 배정받을 가능성이 거론되고 있다. 정부는 공모 과정에서 정부 활용분 최소 1개 클러스터를 256서버 이상으로 구성하도록 요구한 것으로 알려졌다. 통상 AI 서버 1대에 GPU 8장이 탑재되는 점을 감안하면 최소 2048장 규모의 클러스터를 구성해야 하는 셈이다. 이처럼 수천 장의 GPU를 하나의 클러스터로 묶어 성능을 내려면 단순 물량 확보를 넘어 서버 간 통신 지연을 줄일 네트워크 대역폭, 스토리지 성능, 전력·냉각 설계가 함께 뒷받침돼야 한다. 업계 관계자는 "이번 사업은 GPU 물량보다 이를 단일 클러스터로 안정적으로 묶어 운용할 수 있는지가 중요하다"며 "전력과 냉각, 네트워크 설계가 뒷받침되지 않으면 대규모 물량을 확보해도 효율을 내기 어렵다"고 말했다. 네이버 대규모 물량 유력…삼성SDS·엘리스도 추격 네이버클라우드는 공모 참여 기업 중 상면 확보에 가장 적극적으로 나서며 사업자 선정 의지를 드러내고 있다. 이를 위해 최근에는 LG CNS 삼송 데이터센터를 임차한 데 이어 내년 개소 예정인 KT클라우드 부천 데이터센터도 임차 계약을 맺은 것으로 알려졌다. 또 네이버클라우드가 지난해 1차 GPU 사업을 통해 H200 3056장을 직접 구축·운영한 경험이 있다는 점도 강점으로 꼽힌다. 정부가 대규모 클러스터링과 직접 구축·운용 역량을 핵심 평가 요소로 제시한 데다 외부 데이터센터 상면까지 추가로 확보하면서 이번에 대규모 물량을 배정받을 가능성이 높은 것으로 점쳐진다. 삼성SDS도 주요 후보로 꼽힌다. 삼성SDS는 삼성 클라우드 플랫폼(SCP)을 기반으로 공공·기업 AI 인프라 사업을 확대하고 있다. 국가AI컴퓨팅센터 구축 사업에서 컨소시엄 주관기관으로 참여한 바 있고, NIPA 고성능컴퓨팅(HPC) 지원 사업을 통해 최신 GPU 자원을 공급한 이력도 있다. 동탄 AI 전용 데이터센터 운영 경험과 기업 고객 기반도 강점으로 거론된다. 업계 관계자는 "삼성SDS는 제안 물량은 네이버클라우드보다 적지만 그룹 내 AI·클라우드 수요와 기업 고객 기반을 갖춘 점이 강점"이라며 "공공 공급 비중이 높은 사업 구조상 자체 활용과 외부 수요를 어떻게 결합하느냐가 수익성에 영향을 줄 것"이라고 말했다. 엘리스그룹은 이동형 모듈러 데이터센터(PMDC)를 앞세워 차별화한 제안을 낸 것으로 알려졌다. 엘리스그룹은 이미 베라 루빈을 지원하는 PMDC 개발을 완료한 상태로, 엔비디아 B300 기준 최대 1만368장 규모의 GPU 클러스터링이 가능하다는 입장이다. 다만 실제 배정 물량은 2000장 안팎이 거론된다. 정부가 최소 1개 클러스터를 256서버, GPU 기준 2048장 이상 규모로 구축하도록 요구한 만큼, 엘리스그룹이 이 기준을 충족할 수 있을지가 관건이다. 모듈러 방식은 부지 조성, 모듈 제작, IT 장비 설치를 병행할 수 있어 구축 기간을 줄일 수 있지만, 대규모 GPU 클러스터를 안정적으로 운영하려면 전력 인입과 냉각, 네트워크 설계가 함께 뒷받침돼야 한다. 업계 관계자는 "엘리스그룹은 2000장 수준의 물량을 배정받을 가능성이 있지만 전력 확보 여부가 관건이 될 것"이라며 "PMDC가 상면 확보에는 유리할 수 있어도 대규모 GPU 클러스터 운영에는 전력과 냉각 안정성이 중요하다"고 말했다. 쿠팡 재도전 불발…KT클라우드도 고배 쿠팡은 지난해 1차 사업에서 탈락한 뒤 올해 재도전에 나섰지만, 발표평가 이후 현장실사 대상에는 포함되지 않은 것으로 알려졌다. 쿠팡은 싱가포르 데이터센터 전문기업 엠피리온디지털의 서울 양재동 데이터센터를 활용해 GPU 인프라를 구축·운영하는 방안을 제안한 것으로 알려졌다. 양재 데이터센터는 서울 도심 입지와 액체냉각 설비를 갖춘 점에서 주목받았다. 일부 층에는 고밀도 랙을 지원하는 액체냉각 방식이 도입된 것으로 알려졌다. 서울 도심 입지 특성상 엔지니어 수급과 지연시간 측면의 장점도 거론됐다. 그러나 정부 사업은 상면 확보뿐 아니라 정부 활용분 클러스터 구성, 서비스형 GPU(GPUaaS) 운영 실적, 연내 서비스 개시, 공공 공급 안정성 등을 종합적으로 따진다. 쿠팡의 도심형 상면과 AI 인프라 투자 계획이 주목받았지만, 발표 평가는 통과하지 못한 것으로 보인다. KT클라우드 역시 발표평가 단계에서 제외된 것으로 알려졌다. KT클라우드는 그간 공공 클라우드 운영 경험과 다수 데이터센터 인프라를 보유한 사업자로 꼽혀 왔다. 또 가산 AI 데이터센터와 부천 삼정 데이터센터 등 AI 인프라 확장 계획도 추진해 왔다. 다만 이번 제안에서는 GPU 물량을 1000장 단위로 여러 상면에 나눠 배치하는 방안을 제시한 것으로 알려졌다. 여기에 최근 대표 교체와 조직 재정비, 대형 투자 의사결정 지연 등이 맞물리며 이번 수주전에서 성과를 내지 못한 것 아니냐는 분석도 나오고 있다. KT클라우드는 수주 불발 관측 이후 내부 분위기도 좋지 않은 것으로 알려졌다.업계 관계자는 "최신 GPU 서버는 무게와 전력 밀도, 냉각 요건이 까다로워 2000장급 클러스터를 한 곳에서 안정적으로 수용할 수 있는지가 중요하다"며 "1000장씩 분산 배치하는 방식은 동일 데이터센터 내 대규모 클러스터링을 요구한 이번 평가에서 불리하게 작용했을 가능성이 있다"고 말했다. 또 다른 관계자는 "KT클라우드가 독립 클라우드 사업자로서 AI 인프라 경쟁력을 보여줄 기회를 이번에 놓친 듯 하다"며 "향후 KT그룹 내에서 KT클라우드의 역할과 투자 방향에도 영향을 줄 수 있다"고 관측했다. GPU값 1억원대에 인피니밴드 수급난 우려…수익성 부담 클 듯 일각에선 이번 사업이 '승자의 저주'가 될 수 있다고 우려했다. GPU 가격이 1년 사이 크게 오른 데다 서버, 네트워크 장비, 전력 설비, 냉각 장치, 데이터센터 보강 비용까지 함께 부담해야 하기 때문이다. 또 중동전쟁 여파로 GPU 클러스터 구성에 필요한 네트워크 장비 수급난도 고민거리로 떠올랐다. 대규모 GPU를 하나의 클러스터로 묶으려면 데이터센터 내 서버 간 고속 통신을 담당하는 인피니밴드 장비가 필수적인데, 관련 장비 상당 부분을 이스라엘에서 공급받아야 해 조달 일정을 맞추기가 쉽지 않아졌기 때문이다. 이에 GPU를 확보하더라도 네트워크 장비와 전력·냉각 인프라가 제때 갖춰지지 않으면 연내 서비스 개시에 차질이 생길 수 있다. 정부 사업 구조도 변수다. 이번 사업은 정부 예산으로 GPU를 구매해 소유권이 NIPA에 귀속되는 방식이다. 사업자는 공공 공급 물량을 제외한 일부 자원을 자체 서비스나 고객 수요에 활용할 수 있지만, 공공 공급 비중을 높일수록 자체 활용 여지는 줄어든다. 지난해 사업에서도 참여사들은 평가 점수를 고려해 자체 활용 비중을 낮게 설정한 것으로 알려졌다. 올해는 GPU 가격과 부대장비 비용 부담까지 커진 만큼, 최종 협상에서 자체 활용 비중을 두고 사업자들의 셈법이 더 복잡해질 전망이다. 지난해 약 8000장 규모 GPU 물량을 확보한 NHN클라우드가 올해 공모에 참여하지 않은 것도 비용 부담과 수익성 등을 고려한 선택으로 풀이된다. 업계 관계자는 "지난해 GPU 가격은 1대당 6000만~7000만원 수준이었지만 올해는 1억원 수준으로 오른 것으로 안다"며 "네트워크 장비와 전력·냉각 비용까지 감안하면 이번 사업은 수익성 확보가 쉽지 않을 수 있다"고 말했다. 베라 루빈, 가점에도 연내 도입 난항…최종 물량 협상 변수 이번 사업에서는 대규모 클러스터링뿐 아니라 엔비디아의 차세대 GPU 플랫폼인 '베라 루빈' 구축 여부도 승부수로 떠오르고 있다. 정부가 베라 루빈 도입을 제안하는 사업자에게 평가상 우대 방침을 밝히면서, 현장실사 대상에 오른 사업자들도 관련 도입 계획을 제안서에 포함한 것으로 알려졌다. 그러나 업계에선 베라 루빈의 연내 국내 도입이 쉽지 않을 것으로 보고 있다. 초기 공급 물량이 제한적인 데다 고전력·고밀도 랙을 수용할 데이터센터 인프라도 갖춰야 하기 때문이다. 업계 관계자는 "베라 루빈은 올해 들어오기 어려울 것으로 보인다"며 "다만 내년 3월까지 들여오기만 하면 정부가 우대해주는 구조로 알고 있다"고 말했다. 현장실사 이후에도 최종 배정 물량은 유동적이다. 사업비 심의·조정과 협약 체결 과정에서 GPU 구매 기종과 수량, 클러스터 규모, 자체 활용 허용 비중, 베라 루빈 반입 시점 등이 조정될 수 있기 때문이다. 정부는 현장실사와 후속 검토를 거쳐 이달 중 최종 수행기관을 선정한다는 목표다. 이후 선정 사업자는 GPU 발주와 데이터센터 구축, 장비 설치 및 성능 검증 등에 착수하게 된다. 업계에서는 선정 시점이 늦어질수록 GPU 가격 상승 부담과 공급 불확실성이 커질 수 있다고 보고 있다. 업계 관계자는 "최종 협상에서는 도입 물량과 자체 활용 비중, 베라 루빈 반입 시점 등이 핵심 쟁점이 될 것"이라며 "수익성과 구축 안정성을 함께 따져야 하는 만큼 사업자별 물량은 조정될 가능성이 있다"고 말했다.

2026.05.14 16:12장유미 기자

엔비디아 젠슨 황 "中에 최신 GPU 공급은 제한해야"

젠슨 황 엔비디아 CEO가 4일(현지시간) 중국 시장과 AI 반도체 수출 전략에 대해, 성능을 제한한 제품은 계속 공급하되 최신·고성능 제품 공급은 제한할 필요가 있다는 견해를 밝혔다. 젠슨 황 CEO는 로스앤젤레스에서 열린 밀컨연구소 글로벌 컨퍼런스 기간 중 대담 세션에 참여했다. 진행자가 "중국에는 H200 같은 칩은 공급해야 한다는 생각이냐"라고 묻자 젠슨 황 CEO 역시 이에 동의했다. 반면 "중국이 최신·최고사양 반도체를 가져야 하느냐"는 사회자 질문에는 "아니다"라고 즉답했다. 이는 중국을 완전히 배제하기보다 미국 기술 생태계 안에 묶어두는 방식이 더 효과적이라는 메시지로 해석된다. 그는 이어 "미국이 AI 분야에서 가장 뛰어난 최신 기술을 가장 먼저, 가장 많이 가져야 한다. 미국 기업들이 세계 시장에 AI 가속기를 판매하면 세수 확대와 경제 성장으로 이어지고, 이는 다시 국가 안보 강화에 기여한다"고 덧붙였다. 이번 발언은 젠슨 황 CEO가 작년 하반기 이후 실적발표 등 공개석상에서 지속적으로 강조한 메시지와도 일치한다. 엔비디아는 도널드 트럼프 2기 행정부 출범 이후 중국 시장 수출 규제가 강화되자 H200 등 중국 전용 저사양 AI 칩을 별도로 설계해 대응해 왔다. 그러나 양국 정부의 승인 절차가 지연이나 보류되며 엔비디아의 중국 시장 내 AI 가속기 점유율은 0% 수준까지 떨어졌다. 이번 발언은 미국 정부의 최첨단 제품 수출 제한은 수용하되, 성능이 한 단계 낮은 제품의 수출은 허가하고 미국 기업의 글로벌 경쟁력은 유지돼야 한다는 이중 전략을 내세운 것으로 보인다. 최첨단 제품은 미국 중심으로 묶어두되, 범용·하위 사양 제품 판매까지 전면 차단하는 방식은 오히려 중국 반도체 생태계를 키울 수 있다는 현실론이다.

2026.05.06 10:02권봉석 기자

AI 뜨니, 게이밍 GPU 소외…엔비디아 '지포스 홀대' 논란

인공지능(AI) 수요 급증으로 인한 메모리 부족 사태 속에서 엔비디아가 게이밍 GPU보다 인공지능(AI) 칩에 집중하면서 게이머들의 불만이 커지고 있다는 지적이 나왔다. 엔비디아가 최근 블랙웰, 루빈 등 데이터센터용 AI 칩셋 생산을 우선 추진하면서 소비자용 지포스 GPU가 상대적으로 소외되고 있다고 미국 경제매체 CNBC가 19일(현지시간) 보도했다. 엔비디아는 2000년대 초 GPU를 대중화하며 게임 산업 핵심 기업으로 자리 잡았다. 특히 1999년 '지포스 256' 출시 당시 위기 상황에 놓였던 회사는 게이머들의 적극적인 구매에 힘입어 반등에 성공했다. 하지만 지금은 상황이 크게 달라졌다. AI 시장이 폭발적으로 성장하면서 엔비디아의 매출 대부분이 데이터센터용 AI 칩에서 발생하고 있다. 번스타인 리서치의 스테이시 라스곤은 “게임 부문은 더 이상 회사의 핵심 성장 동력이 아니다”라고 평가했다. AI 칩 생산 확대는 메모리 수급에도 영향을 미치고 있다. 제한된 메모리 자원을 두고 우선순위를 정하는 과정에서 엔비디아는 수익성이 높은 AI GPU에 집중하고 있으며, 이로 인해 게이밍 GPU 생산은 상대적으로 줄어들고 있다는 분석이다. 실제로 업계에서는 최신 게이밍 GPU 생산량이 최대 40%까지 감소할 수 있다는 전망도 나오고 있다. 제품 출시 일정에도 변화가 감지된다. 분석가들은 올해가 엔비디아가 30년 만에 처음으로 차세대 지포스 GPU를 출시하지 않는 해가 될 가능성이 높다고 보고 있다. 현재 판매 중인 '지포스 RTX 50 시리즈'는 지난해 1월 공개됐지만, 올해 주요 행사에서는 후속 제품이 발표되지 않았다. 가격 구조 역시 이러한 전략 변화를 뒷받침한다. 업계에 따르면 블랙웰 GPU는 개당 최대 4만 달러(약 5900만 원), 베라 루빈 시스템은 최대 400만 달러(약 59억 원)에 이를 것으로 추정된다. 반면 지포스 RTX 50 시리즈는 299달러에서 1999달러 수준으로, 수익성 측면에서 큰 차이를 보인다. 한편, 최근 공개된 차세대 그래픽 기술 'DLSS 5'를 둘러싼 논란도 이어지고 있다. 젠슨 황 CEO는 지난 3월 연례 개발자 행사에서 해당 기술을 소개했지만, 일부 게이머들은 AI 기반 렌더링이 원작의 예술적 의도를 훼손할 수 있다고 비판하고 있다. 특히 시연 과정에서 게임 캐릭터 표현이 과도하게 보정된 것처럼 보인다는 지적이 제기되며 논쟁이 확산되고 있다. 엔비디아는 이에 대해 “게이머는 여전히 중요한 고객”이라며, 게임 기술 개발과 제품 출시를 지속하고 있다고 밝혔다.

2026.04.20 16:39이정현 미디어연구소

SK하이닉스, 엔비디아향 차세대 '소캠2' 본격 양산 개시

SK하이닉스가 10나노급 6세대(1c) LPDDR5X 저전력 D램 기반 차세대 메모리 모듈 규격인 소캠(SOCAMM)2 192GB(기가바이트) 제품을 본격 양산한다고 20일 밝혔다. 소캠2는 주로 스마트폰 등 모바일 제품에 사용되던 저전력 메모리를 서버 환경에 맞게 변형한 모듈로 차세대 AI 서버 등에 주력으로 활용된다. 기존 모듈 대비 얇은 두께와 높은 확장성을 갖췄으며, 압착식 커넥터를 통해 신호 무결성을 높이고 모듈 교체가 용이한 장점이 있다. SK하이닉스는 "1c 나노 공정을 적용한 소캠2 제품은 기존 RDIMM 대비 2배 이상의 대역폭과 75% 이상 개선된 에너지 효율을 실현해 고성능 AI 연산에 최적화된 설루션"이라고 강조했다. 특히 이번 소캠2 제품은 엔비디아의 베라 루빈(Vera Rubin)에 최적화 설계됐다. SK하이닉스는 "수천 억 개의 파라미터를 보유한 초거대 AI 모델의 학습과 추론 과정에서 발생하는 메모리 병목 현상을 근본적으로 해소함으로써 전체 시스템의 처리 속도를 비약적으로 높이는 데 기여할 것으로 기대된다"고 밝혔다. 회사는 이어 “AI 시장이 학습에서 추론 중심으로 본격 전환되면서, 거대언어모델을 저전력으로 구동할 수 있는 소캠2가 차세대 메모리 설루션으로 주목받고 있다”며 “글로벌 CSP 고객 수요에 발맞춰 양산 체제를 조기 안정화 했다”고 덧붙였다. 김주선 SK하이닉스 AI 인프라 사장(CMO)은 “소캠2 192GB 제품 공급으로 AI 메모리 성능의 새로운 기준을 세웠다”며 “글로벌 AI 고객과 긴밀한 협력을 바탕으로 고객이 가장 신뢰하는 AI 메모리 설루션 기업으로 자리매김하겠다”고 말했다.

2026.04.20 09:07장경윤 기자

  Prev 1 2 3 Next  

지금 뜨는 기사

이시각 헤드라인

오픈AI 첫 AI 추론칩 공개…전력 효율·응답 속도 엔비디아 앞서

비상시 문 안 열리는데…테슬라 '매립형 손잡이' 韓 안전기준은 공백

울산시 AX 시동…"AX, 기술 아니라 산업체계 바꾸는 것"

퀄컴 "새 오라이언 CPU, 모바일 최초 작동클록 5GHz 돌파"

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.