• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'엔비디아 GPU'통합검색 결과 입니다. (210건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

KISTI-엔비디아, 과학 AI 파운데이션 모델 공동개발 나선다

한국과학기술정보연구원(KISTI)이 엔비디아와 현재 설치 중인 슈퍼컴 6호기 GPU로 과학 AI파운데이션 모델을 개발하기로 했다. 슈퍼컴 6호기는 오는 7월 말 개통을 목표로 시스템 등 설치에 박차를 가하고 있다. 미국 산호세에서 열린 엔비디아(NVIDIA) 글로벌 인공지능(AI) 콘퍼런스 'GTC 2026'에 참석 중인 이식 KISTI 원장은 엔비디아 및 휴렛팩커드 엔터프라이즈(HPE)와 각각 업무협약을 체결하고 고성능컴퓨팅(HPC)과 AI 분야 협력을 본격 추진하기로 했다고 19일 밝혔다. KISTI는 18일(현지 시각) 미국 산호세에서 엔비디아와 업무협약을 체결했다. 강지훈 슈퍼컴퓨팅응용지원센터장은 전화통화에서 "지난해 10월 경주 APEC 정상회의 CEO 써밋에서 발표된 KISTI-엔비디아 간 전문센터(CoE) 협력 계획을 구체화하고, 슈퍼컴 6호기를 중심으로 한 과학 AI 연구와 GPU 가속 컴퓨팅 협력을 본격화할 것"이라고 말했다. 협약에 따라 양측은 슈퍼컴 6호기 GPU 환경을 활용해 대규모 과학 AI 모델과 도메인 특화 파운데이션 모델 개발을 공동 추진할 계획이다. 특히 바이오, 소재·화학, 지구과학, 반도체 등 전략 연구 분야에서 AI 기반 연구를 확대한다. 슈퍼컴 6호기와 양자컴퓨터 '템포(Tempo)'를 연계한 양자-HPC 하이브리드 컴퓨팅 환경을 통해 양자컴퓨팅 연구에도 매진할 계획이다. 이와함께 기존 슈퍼컴퓨터 주요 응용 소프트웨어를 GPU 환경에 최적화해 성능 향상을 검증하고, GPU 가속 기술을 활용한 계산과학 연구 협력도 추진한다. 이에 앞서 17일에는 HPE와 업무협약을 체결했다. KISTI는 HPE와 슈퍼컴 6호기 기반 AI·HPC 연구 협력을 위해 전략적 기술 협력체계를 구축할 계획이다. CoE 프로그램을 중심으로 슈퍼컴퓨팅 인프라 활용을 극대화하고 과학 난제 해결을 위한 통합 연구 환경을 고도화할 계획이다. 이식 원장은 "슈퍼컴 6호기는 대한민국 디지털 연구 인프라의 핵심 자산”이라며 “엔비디아와 HPE와의 협력을 통해 AI와 HPC 기술을 결합한 차세대 연구 환경을 구축하고, 국가 전략 연구 분야의 경쟁력을 높여 나갈 것"이라고 말했다.

2026.03.19 17:35박희범 기자

엔비디아, 오라클과 AI 데이터 '속도 혁신'…벡터 검색 기술 공개

엔비디아가 오라클과 협력해 기업 데이터 처리와 벡터 검색 성능을 대폭 끌어올리는 기술을 공개하며 인공지능(AI) 데이터 인프라 시장 공략에 속도를 낸다. 그래픽처리장치(GPU) 기반 가속 기술을 통해 방대한 비정형 데이터 처리 속도를 획기적으로 개선하고 실제 산업 현장 적용을 확대한다는 목표다. 엔비디아는 미국 새너제이에서 열린 'GTC 2026'에서 오라클과 협력 중인 GPU 가속 벡터 인덱스 구축 기술을 19일 발표했다. 이번 협력은 오라클의 '프라이빗 AI 서비스 컨테이너'와 'AI 데이터베이스 26ai'에 엔비디아 GPU 및 오픈소스 라이브러리 'cuVS'를 결합한 것이 핵심이다. 기존 중앙처리장치(CPU) 기반으로 처리되던 벡터 검색과 인덱스 생성 작업을 GPU로 오프로드해 처리 속도를 크게 높이는 방식이다. 기업들은 멀티모달·비정형 데이터가 급증하면서 대규모 데이터셋을 빠르게 검색하고 활용하는 데 어려움을 겪어왔다. 특히 벡터 인덱스 구축 과정은 시간이 오래 걸려 AI 서비스 확장에 걸림돌로 작용해왔다. 엔비디아와 오라클은 이번 기술을 통해 인덱스 생성 시간을 대폭 단축하고 AI 활용 효율을 높일 수 있도록 지원할 방침이다. 실제 적용 사례도 공개됐다. 엔비디아에 따르면 AI 헬스케어 기업 소피아는 약 3테라바이트(TB) 규모, 5억 개 이상의 벡터로 구성된 의료 데이터셋을 활용 중이다. 기존에는 인덱스 구축에 며칠이 소요됐지만, GPU 가속 기반 환경을 통해 해당 작업을 획기적으로 단축했다. 또 다른 헬스테크 기업 바이오피는 엔비디아 GPU가 탑재된 오라클 클라우드 인프라스트럭처(OCI)를 활용해 감염 질환 분석과 치료법 추천을 수행하고 있다. AI 기반 벡터 검색과 데이터베이스를 결합해 지연 시간을 줄이고 비용 효율적인 데이터 처리 환경을 구축했다. 엔비디아는 GPU 기반 벡터 검색 기술이 의료·바이오 분야뿐 아니라 다양한 산업에서 AI 분석 정확도와 처리 속도를 동시에 높이는 핵심 인프라라고 강조했다. 특히 실시간 데이터 처리와 대규모 AI 학습·추론 환경에서 중요성이 더욱 커지고 있다는 설명이다. 엔비디아는 "GPU 가속 벡터 인덱스 기술을 통해 기업들이 방대한 비정형 데이터를 보다 빠르고 효율적으로 활용할 수 있도록 지원하고 있다"며 "오라클과의 협력을 바탕으로 실제 산업 현장에서 AI 데이터 처리 성능과 확장성을 지속적으로 강화해 나갈 것"이라고 밝혔다.

2026.03.19 14:10한정호 기자

엔비디아 '깐부' AWS, AI 경쟁력 강화…클라우드 주도권 굳히기 박차

엔비디아가 아마존웹서비스(AWS)와 협력을 확대하며 클라우드 기반 AI 인프라 주도권 굳히기에 나섰다. 그래픽처리장치(GPU) 중심의 기존 우위를 바탕으로 데이터 처리와 AI 모델까지 영역을 넓히며 경쟁사들과의 격차 확대에 나선 모양새다.엔비디아는 17일(현지시간) 미국 새너제이에서 열린 'GTC 2026'에서 AWS와의 협력을 통해 GPU 가속 솔루션을 확대한다고 밝혔다. 양사는 AWS 환경에서 엔비디아 기반 데이터 처리 기능을 확장하고 네모트론(Nemotron) 오픈 모델 제품군 지원을 추가할 계획이다. 이번 협력은 단순 인프라 제공을 넘어 풀스택 AI 생태계 구축으로 이어진다는 점에서 주목된다. 엔비디아와 AWS는 2010년부터 협업을 이어오며 GPU 인프라, 소프트웨어, 서비스 전반을 통합한 솔루션을 제공해왔고 이를 통해 기업의 AI 구축 및 배포 시간을 단축해왔다. 특히 이번 발표에서 주목되는 부분은 최신 GPU의 클라우드 도입이다. 엔비디아의 'RTX 프로 4500 블랙웰 서버 에디션' GPU는 아마존 EC2 인스턴스를 통해 AWS에 처음 도입될 예정이다. AWS는 해당 GPU를 지원하는 최초의 클라우드 사업자로, 이를 통해 고객은 온프레미스 수준의 블랙웰 성능을 클라우드에서도 활용할 수 있게 된다. 해당 인스턴스는 AWS 니트로 시스템 기반으로 설계돼 보안성과 안정성을 강화했으며 아마존 EMR과 결합 시 대규모 데이터 처리 워크로드에 최적화된 성능을 제공한다. 이는 데이터 분석 및 AI 학습 환경에서 클라우드 활용도를 한층 끌어올릴 것으로 전망된다. AI 모델 측면에서도 협력 범위가 확대됐다. 엔비디아의 '네모트론 나노 3' 모델은 세일즈포스의 AI 플랫폼 '에이전트포스'에 아마존 베드록을 통해 제공된다. 해당 모델은 높은 처리량이 요구되는 B2C 애플리케이션 환경에서도 활용 가능하며 세일즈포스 벤치마크 기준 요약 및 생성 작업에서 높은 비용 효율성을 보인 것으로 평가된다. 또 AWS는 아마존 베드록에서 네모트론 모델을 위한 강화 학습 기반 파인튜닝(RFT) 기능을 지원할 예정이다. 이를 통해 개발자는 특정 산업에 맞춰 모델의 추론 방식과 응답 구조를 정밀하게 조정할 수 있다. 이는 법률, 헬스케어, 금융 등 고도화된 전문 영역에서 AI 활용도를 높이는 핵심 기능으로 꼽힌다. AWS 역시 이번 협력을 통해 AI 인프라 경쟁력 강화에 나선 것으로 해석된다. 기업들이 엔비디아 '쿠다(CUDA)' 생태계를 중심으로 AI를 개발하는 상황에서 최신 GPU를 선제 확보해 고객 이탈을 막고, 아마존 EMR과 베드록 등 자사 서비스와 결합해 AI 워크로드를 플랫폼 내부에 묶어두려는 전략이다. 업계에선 AWS가 자체 AI 칩과 엔비디아 GPU를 병행하는 '투트랙 전략'을 통해 성능과 비용 경쟁력을 동시에 확보하려는 행보로 보고 있다. 업계 관계자는 "AWS는 단순히 GPU를 도입하는 수준을 넘어 AI 인프라 전반을 자사 플랫폼 중심으로 재편하려는 듯 하다"며 "이번 일을 기점으로 향후 생성형 AI 서비스 경쟁에서 클라우드 사업자의 영향력이 더 커질 가능성이 있다"고 말했다.

2026.03.18 12:15장유미 기자

엔비디아, GTC 2026서 AI 준비형 워크스테이션 생태계 확장

엔비디아는 미국 캘리포니아 주 새너제이에서 진행중인 'GTC 2026' 컨퍼런스 중 주요 PC 제조사가 인텔 제온 600 프로세서와 RTX 프로 블랙웰 GPU를 탑재한 AI 준비형 워크스테이션 제품군을 공개했다고 밝혔다. 인텔 제온 600 프로세서(그래나이트래피즈-WS)는 2024년 8월 말 공개된 전세대 제품인 제온W 3500 프로세서 대비 최대 코어 수를 30% 가량 높이고 극자외선(EUV) 기반 인텔 3(Intel 3) 공정을 활용해 전력 효율성을 개선했다. 각종 AI GPU 가속기나 추론 모듈, SSD 등 고성능 입출력을 위해 PCI 익스프레스 5.0 레인(통로) 최대 128개를 지원한다. 메모리는 DDR5-6400MHz를 최대 8채널로 구성 가능하다. 최신 드라이버를 탑재한 RTX 프로 블랙웰 GPU는 엔비디아 네모트론 오픈 모델과 주요 커뮤니티 모델을 도입 즉시 실행 가능하다. 개발자와 팀이 AI 워크로드를 워크스테이션에서 즉시 실험하고 배포할 수 있도록 한다. 올라마, SG랭, LM스튜디오 등 주요 소프트웨어 제공 업체도 RTX 프로에 최적화된 모델과 도구를 제공한다. 오픈소스 기반 에이전틱 AI 모델인 오픈클로의 보안을 강화한 네모클로 구동도 가능하다. 행사 기간 중 레노버 씽크스테이션 P5 2세대, 델테크놀로지스 델 프로 프리시전 9 T2, T4, T6 등이 공개됐다. HP는 향후 출시될 엔비디아 GPU를 지원할 수 있도록 Z 워크스테이션을 미래 대비 사양으로 설계할 예정이다.

2026.03.18 09:39권봉석 기자

엔비디아 "H200 GPU 中 수출 재개, 미·중 양국 승인 확보"

엔비디아가 중국 시장 수출을 위해 별도 설계한 'H200' GPU의 수출을 재개할 예정이라고 미국 CNBC가 17일(이하 현지시간) 보도했다. 엔비디아의 중국 내 사업은 미국 정부 수출 규제로 많은 제약을 받고 있다. 지난 해 4월 도널드 트럼프 2기 행정부 출범 이후 고성능 GPU 수출 관련 별도 허가를 요구하면서 엔비디아는 큰 타격을 입었다. 이후 엔비디아는 연산 성능과 메모리 대역폭을 낮추는 등 미국 정부 수출 규제에 부합하는 H200을 별도 개발했다. 미국 정부가 수출을 허용했지만 반대로 중국 정부가 수입 허가를 내주지 않는 등 교착상태에 있었다. CNBC에 따르면, 젠슨 황 엔비디아 CEO는 17일 미국 캘리포니아 주 새너제이에서 진행중인 'GTC 2026' 컨퍼런스 중 기자들과 만나 "이미 중국의 구매 주문을 접수했고 생산 재개를 위해 공급망을 재가동중"이라고 밝혔다. 그는 이어 "이는 몇 주 전과는 다른 상황이며, 현재 미국과 중국 모두에게 (수입·수출) 승인을 받은 상태"라고 설명했다. 지난 2월 실적 발표 당시 콜렛 크레스 엔비디아 CFO는 "H200 소량 수출이 승인됐지만 매출로 이어지지 않았다"고 밝힌 바 있다. 승인 지연은 양국의 안보 심사와 규제 절차가 복합적으로 작용한 결과로 보인다. 과거 중국은 엔비디아 데이터센터 매출의 20% 이상을 차지하던 핵심 시장이었지만, 규제 이후 사실상 공급이 중단된 상태다. 엔비디아의 빈 자리를 화웨이 등 중국 기업들이 채우고 있다. 한편 엔비디아는 중국 매출이 사실상 없는 상황에서도 강력한 성장세를 유지하고 있다. 최근 분기 매출은 전년 대비 73% 증가했으며, 11분기 연속 55% 이상의 성장률을 기록했다.

2026.03.18 09:25권봉석 기자

[유미's 픽] GPU 공급 속도전 나선 정부…AI 인프라 확충 '완성도' 높였다

정부가 추진하는 그래픽처리장치(GPU) 인프라 확충 정책이 단순한 계획 단계를 넘어 실제 시장 수요를 기반으로 빠르게 확대되는 흐름을 보이고 있다. 초기 시범 성격의 지원에서 시작해 수요 확인, 1차 공급, 추가 공급으로 이어지면서 국내 AI 연산 인프라 정책이 단계적으로 진화하는 모습이다. 과학기술정보통신부는 지난 16일부터 국내 산·학·연의 인공지능(AI) 연구개발(R&D)를 지원하기 위해 ▲민간 GPU 임차 사업의 공급 클라우드 기업(CSP) 공모 ▲정부 GPU 2000여 장에 대한 산업계 사용자 모집 공모에 들어갔다. 이번 사업은 민간 GPU를 활용한 임차 방식과 정부가 확보한 GPU를 직접 배분하는 방식이 병행되는 구조란 점에서 주목 받고 있다. GPU 임차사업은 고성능컴퓨팅(HPC) 지원사업과 AI연구용컴퓨팅지원프로젝트 사업으로 나뉘며 국내에서 GPU 서비스를 제공할 수 있는 CSP를 대상으로 공급 사업자를 선정한다. HPC 지원사업은 산업계를 대상으로 1060장 이상의 GPU를 공급하는 사업이다. 중소기업과 스타트업이 GPU를 장 단위로 유연하게 사용할 수 있도록 하는 것이 핵심이다. 반면 AI 연구용 컴퓨팅 지원 사업은 학계와 연구기관을 대상으로 960장 이상의 GPU를 제공해 대규모 AI 연구 환경을 지원하는 데 초점이 맞춰져 있다. 정부는 이와 별도로 기존에 확보한 GPU를 활용한 추가 공급도 동시에 추진한다. 지난해 추가경정예산으로 확보한 GPU 가운데 이미 4000장을 배분한 데 이어 추가로 활용 가능한 2000여 장을 산업계에 배분하는 '첨단 GPU 활용 지원 사업' 2차 공모도 병행한다. 해당 물량은 단기 수요 중심으로 4개월 이내 활용을 전제로 공급된다. 이번 조치는 국가 AI 경쟁력을 결정짓는 전략 자산인 GPU 자원을 안정적으로 공급하기 위한 핵심 국정과제인 'AI 고속도로 구축'의 일환으로 추진된다. 정부는 장기적인 인프라 구축과 동시에 단기 수요를 해소하는 공급 정책을 병행하는 '속도 중심 전략'을 택했다. 실제 시장 수요는 이미 여러 차례 확인됐다. 정식 공모 이전 진행된 첨단 GPU 활용 지원 사업 베타테스트에서만 수요가 몰리며 현장 체감도가 빠르게 올라갔다. 업계에 따르면 해당 사업에는 4만 장이 넘는 GPU 사용 신청이 접수되며 공급 계획의 약 4배 수준 수요가 몰린 것으로 알려졌다. 이 같은 수요는 1차 공급 결과에서도 드러났다. 과기정통부가 3월 초 산·학·연에 GPU 4224장을 공급했지만 전체 신청 물량은 1만3712장에 달했다. 공급 대비 수요가 3배를 넘어서며 상당한 미충족 수요가 발생한 셈이다. 과기정통부 관계자는 "산업계에서만 4천 장이 넘는 GPU 신청이 들어왔지만 실제 공급은 약 1천200장 수준이었다"며 "3천 장 이상 수요가 충족되지 못했던 만큼 추가 공급 필요성이 명확히 확인됐다"고 말했다. 정부는 이에 따라 민간 자원을 적극 활용하는 방향으로 정책을 확장했다. 특히 GPU 구성에서도 목적별 차별화를 뒀다. 과기정통부 관계자는 "산업계 등에 배분되는 정부 GPU는 기본적으로 엔비디아 블랙웰(B200) 시리즈가 중심"이라며 "추가 확보 물량에 따라 다른 모델이 포함될 수 있다"고 설명했다. 반면 민간 임차 GPU는 다양한 수요를 반영한 구조다. 여기엔 고성능 대형 모델 학습부터 비용 부담이 큰 스타트업의 실험용 수요까지 포괄하기 위해 여러 세대 GPU를 혼합하는 방식이 적용됐다. 이를 통해 성능과 비용 효율을 동시에 고려한 공급 체계를 구축한다는 방침이다. 과기정통부 관계자는 "민간 임차 GPU는 H100이나 H200을 중심으로 확보하고 일부 수요를 고려해 A100 같은 이전 세대 GPU도 포함된다"며 "이용 비용 부담을 낮추기 위한 선택"이라고 설명했다. 공급 구조에서도 변화가 감지됐다. 정부는 GPU 공급 사업자 선정에서 국내외 구분을 두지 않기로 했다. 이는 국내 인프라만으로는 급증하는 수요를 감당하기 어렵다는 판단이 반영된 조치다. 동시에 글로벌 클라우드까지 포함한 경쟁 구조를 통해 공급 역량을 끌어올리겠다는 의도로도 풀이된다. 과기정통부 관계자는 "국내에서 GPU 서비스를 제공할 수 있는 사업자라면 해외 CSP도 참여 제한은 없다"며 "실제로 AI 연구용 컴퓨팅 사업은 지난해 AWS가 수행한 사례도 있다"고 말했다. 그러면서도 "다만 연구 데이터와 서비스 환경을 고려해 보안 관련 평가는 함께 진행하고 있다"고 덧붙였다. 업계에선 이번 공모안이 단순 자원 공급을 넘어 사업 구조 자체가 고도화됐다는 점에도 주목했다. 대형 AI 모델 수요 증가에 맞춰 GPU 요건이 강화되고 운영 수준까지 평가하는 방향으로 정책이 변화하고 있다는 분석이다. 업계 관계자는 "H100·H200 중심의 대규모 GPU 확보 요건이 제시되면서 전년 대비 요구 수준이 크게 높아졌다"며 "단순 인프라 제공이 아니라 SLA(서비스 수준 협약, Service Level Agreement) 기반 운영과 관리 역량까지 요구되는 구조로 바뀌면서 CSP 간 경쟁 강도와 부담이 모두 커지고 있다"고 지적했다. 일각에선 인프라 비용 측면의 부담도 지적했다. 대형 AI 모델을 지원할 경우 GPU뿐 아니라 네트워크와 스토리지 비용까지 함께 증가할 수밖에 없다고 봐서다. 또 다른 관계자는 "대규모 AI 모델 학습에서는 데이터 통신량이 크게 늘어나기 때문에 네트워크와 스토리지 부담이 상당한 수준이 될 수 있다"며 "GPU 지원 정책이지만 실제로는 전체 인프라 비용 구조를 함께 고려해야 한다"고 밝혔다. 이번 정책은 단순한 GPU 지원을 넘어 'AI 연산 자원을 얼마나 빠르게 공급하느냐'에 초점이 맞춰져 있다는 의견도 나왔다. 수요가 이미 공급을 크게 앞지른 상황에서 정책 효과는 실제 현장에서의 인프라 운영 부담과 비용 구조에 따라 좌우될 것이라고도 관측했다. 업계 관계자는 "정부의 GPU 인프라 구축 사업이 계획에 머무르지 않고 실제 사업으로 속도감 있게 진행되고 있다는 점은 긍정적"이라면서도 "다만 GPU 조달 비용과 인프라 운영 부담이 커지고 있는 만큼 공급사 입장에서는 비용과 리스크 관리가 중요한 변수로 작용할 것"이라고 말했다.

2026.03.17 16:22장유미 기자

"美 상무부, AI 칩 수출 강화안 폐기...새 규제 검토 지속"

미국 정부가 엔비디아와 AMD 등 자국에 본사를 둔 AI 기업들이 설계한 반도체를 수출할 경우 통제 절차를 강화하려던 계획에서 한 발 물러섰다. 로이터통신이 14일(현지시간) 미국 내 소식통을 인용해 이렇게 보도했다. 이달 초 액시오스 등 현지 언론에 따르면, 미국 정부는 자국 기업이 설계한 고성능 AI 반도체 해외 판매를 강화하는 새로운 규제 체계를 검토하고 있었다. 해외 기업이나 국가가 AI 반도체를 대량 구매할 경우 미국 정부 허가에 더해 미국 기업·정부 기관과 협력 등을 요구하는 추가 조건도 검토된 것으로 전해졌다. 미국 정부는 2022년 첨단 반도체와 AI 가속기 기술이 중국의 군사·첨단 산업 발전에 활용될 수 있다는 이유로 고성능 반도체와 관련 장비 수출을 제한했다. 이후 규제 범위는 점차 확대됐고 특정 국가가 아닌 AI 컴퓨팅 인프라 규모를 기준으로 통제하는 방안까지 검토된 것이다. 로이터통신에 따르면 미국 상무부는 이달 초부터 거론되던 AI 반도체 수출 강화안을 철회했다. 공식 법안이나 시행령 등으로 채택되기 전 단계인 초안을 내부 검토 과정에서 폐기했다. 다만 AI 칩 수출 통제 자체를 완화하는 것은 아니며, 새로운 규제 체계는 여전히 논의 중인 것으로 알려졌다. 로이터통신은 "AI 관련 반도체를 전략 기술로 간주하는 미국 정부의 입장에는 여전히 변함이 없으며, 앞으로는 대형 AI 컴퓨팅 인프라와 칩 공급을 연계한 새로운 통제 체계를 마련할 가능성이 있다"고 전했다.

2026.03.15 09:00권봉석 기자

엔비디아가 찜한 투게더 AI, 기업가치 1년 새 2.5배 껑충…10억 달러 투자 추진

인공지능(AI) 클라우드 스타트업 투게더 AI(Together AI)가 약 75억 달러(약 10조원) 기업가치를 기준으로 신규 투자 유치를 추진하고 있는 것으로 전해졌다. 6일 디인포메이션에 따르면 투게더 AI는 약 10억 달러 규모의 신규 투자 라운드를 논의 중이다. 투자 유치가 성사될 경우 기업가치는 약 75억 달러 수준으로 평가될 전망이다. 투게더 AI는 엔비디아 그래픽처리장치(GPU) 기반 AI 클라우드 인프라를 제공하는 스타트업으로, 기업과 개발자들이 대규모 AI 모델을 학습하거나 추론 작업을 수행할 수 있는 컴퓨팅 환경을 제공한다. 특히 메타의 라마 등 오픈소스 대형언어모델(LLM)을 운영할 수 있는 플랫폼을 지원하는 것이 특징이다. AI 산업이 급성장하면서 대규모 GPU 컴퓨팅 인프라에 대한 수요도 빠르게 늘어나고 있다. 이에 따라 투게더 AI를 비롯해 코어위브, 람다 등 AI 전용 클라우드 인프라 기업들이 빠르게 성장하는 추세다. 투게더 AI의 기업가치는 최근 몇 년 사이 급격히 상승했다. 이 회사는 2024년 약 12억 달러 수준에서 평가됐으나 이후 투자 유치 과정에서 30억 달러 이상으로 올라섰다. 이번 투자 논의에서는 75억 달러까지 확대될 가능성이 제기되고 있다. 업계에선 투게더 AI를 단순한 GPU 인프라 제공 기업이 아니라 AI 추론 소프트웨어와 클라우드 인프라를 결합한 사업 모델을 구축한 기업으로 평가하고 있다. 특히 엔비디아가 투자한 AI 인프라 스타트업이라는 점도 시장에서 긍정적인 요인으로 작용하고 있다는 분석이다. 일각에선 이번 투자 라운드가 기업가치를 크게 끌어올리는 후기 단계 투자라는 점에서 향후 기업공개(IPO)로 이어질 가능성에도 주목하고 있다. 또 이번 투자 유치가 성사될 경우 투게더 AI가 향후 상장을 준비하는 과정에서 중요한 전환점이 될 수 있다는 관측도 나온다. AI 인프라 시장이 빠르게 확대되면서 투게더 AI 같은 관련 기업들의 가치도 상승하는 분위기다. 특히 생성형 AI 확산으로 고성능 GPU 수요가 급증하면서 AI 인프라 기업들의 역할도 더욱 커질 것으로 예상된다. 업계 관계자는 "AI 모델 개발 경쟁이 치열해지면서 이를 뒷받침하는 GPU 기반 클라우드 인프라에 대한 수요도 급증하고 있다"며 "AI 인프라 기업들이 향후 AI 생태계에서 핵심 역할을 맡게 될 것"이라고 전망했다.

2026.03.06 15:43장유미 기자

"美 정부, AI 반도체 수출 통제 강화 검토"

미국 정부가 인공지능(AI) 반도체 수출 통제 강화를 검토중이다. 대규모 데이터센터 구축에 필수적인 GPU 공급을 통제헤 글로벌 AI 인프라 구축을 통제하겠다는 의도가 있다. 5일(현지시간) 로이터통신과 액시오스 등 현지 언론에 따르면, 미국 정부는 미국 기업이 설계한 고성능 AI 반도체 해외 판매를 강화하는 새로운 규제 체계를 검토하고 있다. 보도에 따르면 미국 정부는 해외 기업이나 국가가 AI 반도체를 대량 구매할 경우 정부 허가를 요구할 예정이다. 특히 일정 규모 이상 GPU를 구매할 경우 미국 정부와 협력 등 추가 조건을 요구하는 방안도 거론된다. 새로운 규제 대상에는 AI 처리를 위한 GPU 시장을 양분하고 있는 엔비디아와 AMD가 포함될 가능성이 크다. 미국 정부는 현재 중국 등 일부 국가에만 AI 반도체 수출을 제한했다. 그러나 새 규제는 이런 통제를 전 세계로 확대하려는 의도를 담고 있다. AI 데이터센터를 구축하려는 기업이나 국가가 미국 정부의 관계에 따라 GPU 확보에 실패할 가능성도 생긴다. 액시오스는 "새 규제는 현제 미국 정부 내부 검토 단계이며 구체적인 시행 시기나 최종 규정은 확정되지 않았다"고 설명했다.

2026.03.06 09:48권봉석 기자

에이수스코리아, AW2026에 엣지 AI 솔루션 출품

에이수스코리아 인프라 솔루션 사업 그룹은 국내 공식 공급사인 피앤티링크와 '2026 스마트공장·자동화산업전(AW2026)'에 엣지 AI 솔루션과 미니 PC를 출품한다고 밝혔다. AW2026은 AI·휴머노이드 기반 자율제조(AX) 산업을 주제로 4일부터 6일까지 서울 삼성동 코엑스에서 진행되며 24개국 500개 기업이 총 2300부스 규모로 참여한다. 에이수스코리아는 행사 기간 중 엔비디아 젯슨 T5000 기반 초소형 엣지 AI 컴퓨터 'PE3000N', 2U 폼팩터에 인텔 코어 울트라 200S 프로세서와 최대 600W GPU를 통합한 랙 단위 AI GPU 시스템 'RUC-1000G'를 전시한다. PE3000N은 컴퓨팅 성능을 전 세대 대비 최대 7.5배, 전력 효율성을 3.5배 높인 엔비디아 젯슨 T5000으로 2070 FP4 TFLOPS 연산 성능을 구현했다. 생성형 VLM/LLM 모델, 실시간 지능형 비디오 분석, 완전 자율 제어 애플리케이션을 엣지에서 실행한다. RUC-1000G는 PCI 익스프레스 5.0 인터페이스로 연결된 GPU로 데이터 전송/처리 속도를 높이는 한편 메인 시스템과 GPU 섀시를 분리하여 관리하는 냉각 시스템을 적용했다. 인텔 코어 울트라 X9 프로세서를 통합한 미니 PC인 NUC 16 프로, 4K AI 이미지 처리가 가능한 MDS M700 등 미니 PC를 포함해 산업용 마더보드, NUC 미니 PC 시리즈 등 산업 환경에 최적화된 하드웨어도 함께 전시된다. 에이수스코리아는 기간 중 참관객 대상으로 각종 행사와 경품을 제공 예정이다.

2026.03.04 12:10권봉석 기자

글로벌 AI 투자 몰리는 '네오클라우드'…한국 스타트업도 도전장

생성형 인공지능(AI) 확산과 함께 그래픽처리장치(GPU)를 중심으로 한 '네오클라우드'가 글로벌 인프라 시장의 새로운 축으로 부상하고 있다. 미국과 유럽에서 수십조원대 투자가 이어지는 가운데, 국내 스타트업들도 AI 전용 인프라 시장을 정조준하며 본격적인 경쟁에 뛰어드는 모습이다. 1일 업계에 따르면 네오클라우드는 기존 범용 클라우드와 달리 AI 학습·추론에 최적화된 고성능 GPU 자원을 서비스형(GPUaaS)으로 제공하는 사업 모델을 뜻한다. AI 모델 크기와 연산량이 급증하면서 하이퍼스케일러만으로는 수요를 감당하기 어려워지자 GPU 중심 인프라를 특화해 제공하는 사업자들이 빠르게 성장 중이다. 글로벌 시장에선 코어위브·람다랩스·네비우스 등이 대표적이다. 이들 기업은 엔비디아 GPU를 대규모로 확보해 AI 기업에 맞춤형 연산 자원을 제공하며 몸집을 키우고 있다. 특히 북미 기준 엔비디아 H100 GPU 임대 비용이 하이퍼스케일러 대비 3분의 1 수준에 불과하다는 조사 결과도 나오며 가격 경쟁력도 부각되고 있다. 금융권 자금도 네오클라우드로 몰리고 있다. 미국 주요 금융사는 네오클라우드 기업이 보유한 GPU를 담보로 대규모 대출을 실행하며 인프라 확장을 지원하고 있다. 시장조사기관 ABI리서치는 GPUaaS 기반 네오클라우드 시장이 2030년 약 90조원 규모로 성장할 것으로 내다봤다 . 이같은 흐름 속에 국내 스타트업들도 AI 전용 인프라 사업자로 정체성을 재정립하며 시장 공략에 속도를 내고 있다. 대표 사례가 베슬AI다. 이 회사는 자사 플랫폼 '베슬 클라우드'를 기반으로 AI 워크로드 운영에 특화된 네오클라우드 사업자로 입지를 강화하고 있다 . 베슬AI는 최근 GPU 클라우드 서비스를 공식 출시하고 연내 H200·B200·B300 등 최신 GPU 1만 장 규모 인프라를 구축하겠다는 계획을 밝혔다. 이미 미국·이스라엘·핀란드 등 6개 지역 데이터센터와 계약을 체결했으며 100여 개 기업과 연구기관이 서비스를 이용 중이다. 글로벌 대학과 연구기관 도입도 확대되며 지난해 매출은 전년 대비 3.4배 성장했다. 에너지 효율 측면에서도 차별화를 시도하고 있다. 베슬AI는 미국 데이터센터 기업과 협력해 전력망 상황에 따라 AI 워크로드를 자동 조정하는 그리드 인지형 머신러닝 운영관리(MLOps) 솔루션을 공동 개발 중이다. GPU 확보 경쟁을 넘어 운영 효율까지 아우르는 네오클라우드 전략이다. 몬드리안에이아이 역시 네오클라우드를 차세대 성장 축으로 내세웠다. 이 회사는 지난해부터 네오클라우드 사업 출사표를 던지며 최근 엔비디아 B300 GPU 클러스터 구축에 나섰다. 네오클라우드를 초고성능 연산이 필요한 특정 AI 워크로드에 최적화된 맞춤형 인프라 서비스로 정의하고 매니지드 서비스 역량까지 결합하겠다는 전략이다 . 특히 델 테크놀로지스 인프라와 자체 ML옵스 플랫폼 '예니퍼', AI 실행환경 패키지 '몬스택'을 결합한 어플라이언스 '몬박스'를 교육·연구 현장에서 빠르게 확산하고 있다. 서울과학기술대학교와 성균관대학교 등에서 도입 사례가 이어지며 복잡한 설정 없이 즉시 AI 연구가 가능한 환경을 제공하고 있다는 평가다. 몬드리안에이아이는 최근 150억원 규모 시리즈B 투자 유치에 나서며 GPU 인프라 확충과 글로벌 진출을 병행하겠다는 계획도 밝혔다. 단순 GPU 임대를 넘어 인프라·플랫폼·서비스를 아우르는 네오클라우드 그룹으로 도약하겠다는 구상이다 . 업계에선 네오클라우드가 하이퍼스케일러의 대체재라기보다 AI 특화 워크로드를 분리·보완하는 공존형 인프라로 자리 잡을 가능성에 무게를 둔다. 다만 GPU 확보 비용, 전력비 상승, 엔비디아 의존도 등은 장기 리스크로 꼽힌다. 그럼에도 AI 모델 고도화와 산업 전반의 AI 전환(AX)이 가속화되는 한 GPU 중심 인프라 수요는 지속 확대될 것이란 전망이 우세하다. 글로벌 자본이 몰리는 네오클라우드 시장에서 한국 스타트업들이 기술·운영 역량을 바탕으로 의미 있는 경쟁력을 확보할 수 있을지 주목된다. 박현규 몬드리안에이아이 부사장은 "네오클라우드는 단순히 GPU를 임대하는 사업이 아니라 AI 연구와 서비스가 바로 작동할 수 있는 환경을 패키지로 제공하는 모델"이라며 "국내 기업과 연구기관이 인프라 부담 없이 AI 혁신에 집중할 수 있도록 네오클라우드 역량을 지속적으로 고도화하겠다"고 밝혔다.

2026.03.01 08:47한정호 기자

게이밍 GPU 교체주기 장기화...AI 기능으로 '공백 메우기'

글로벌 빅테크 기업의 대규모 AI 인프라 투자 경쟁 속에서 데이터센터용 GPU 수요가 급증하면서, 게이머나 일반 소비자용 GPU의 신제품 투입 우선순위가 내려가고 있다. 엔비디아는 현행 블랙웰과 차기 제품인 루빈에 GPU 신제품 개발과 생산 역량을 집중하는 한편 일반 소비자용 신제품 투입 시기를 미루고 있다. 올해에서 내년까지 새 GPU 투입이 미뤄질 것이라는 전망도 나온 바 있다. 엔비디아는 AI 기반 소프트웨어 기술을 활용한 업스케일링·프레임 생성 등으로 신제품 공백을 메우고 있다. 올 초 CES에서 DLSS 4.5를 공개한 데 이어 올해 중 업데이트를 통해 이를 강화할 예정이다. 2024년 이후 데스크톱 PC용 GPU 신제품 출시가 없는 인텔 역시 AI 기반 프레임 생성 기능을 현행 최신 제품 뿐만 아니라 2022년 출시된 전 세대 GPU까지 확장했다. 그래픽카드 시장의 경쟁 축도 AI 알고리듬 경쟁으로 향하고 있다. 엔비디아, 게이밍 GPU 신제품 투입 연기 엔비디아는 일반 소비자용 GPU 출시 이후 일정 시간이 지나면 작동 클록을 높이고 메모리 탑재량을 늘린 '슈퍼' 시리즈를 추가 출시했다. 이는 제품 수명을 연장하고 최대 경쟁사인 AMD 대응력을 유지하기 위한 수단이다. 올 초 CES를 앞두고도 파생 제품 출시가 예상됐지만 이는 실현되지 않았다. 글로벌 빅테크가 AI 인프라 투자에 경쟁적으로 나서면서 일반 소비자용 GPU 추가 출시는 우선 순위에서 밀린 것으로 판단된다. 이달 초 미국 IT 매체 디인포메이션은 익명을 요구한 관계자를 인용해 "RTX 50 파생 제품의 설계는 이미 끝났지만 메모리 반도체 수급난과 공급 부족 때문에 출시가 보류됐다"고 설명했다. DLSS, AI 기반 프레임 생성으로 성능 강화 엔비디아가 CES에서 새 GPU 대신 내세운 기술은 AI를 활용해 게임 프레임 수를 향상시킬 수 있는 기능인 DLSS(딥러닝 슈퍼샘플링) 4.5다. DLSS는 AI를 이용해 저해상도 게임 화면을 고해상도로 처리한다. 그래픽칩셋 부하는 줄이고 화질 저하는 최소화하며 초당 프레임 수는 높일 수 있다. RTX 5090 등 최상위 GPU가 아니어도 충분히 높은 프레임을 뽑아낼 수 있다. DLSS 4.5는 지포스 RTX 40/50 시리즈 GPU에서 작동한다. 지난 해 초 CES 2025에서 공개된 DLSS 4를 보완했고 2세대 트랜스포머 모델을 이용해 화질 저하 현상을 개선했다. 인텔, 2022년 출시 GPU까지 XeSS 확장 인텔 역시 아크 A/B시리즈용 GPU의 AI 연산 기능을 활용한 XeSS(Xe 슈퍼샘플링) 기능을 구현한 상태다. 코어 울트라 시리즈3(팬서레이크)에 탑재된 아크 B390 GPU에는 기준 프레임 두 개로 최대 세 개 중간 프레임을 AI로 생성하는 XeSS-MFG(다프레임 생성) 기능이 추가됐다. 지난 13일 업데이트된 아크 GPU 드라이버는 XeSS-MFG 기능을 2022년 출시된 데스크톱 PC용 그래픽카드인 아크 A770, 코어 울트라 시리즈1(메테오레이크)/시리즈2(루나레이크)에 탑재된 아크 GPU까지 확장했다. 이를 이용하면 아크 A770 등 구형 그래픽카드에서도 초당 프레임을 최대 네 배까지 끌어올릴 수 있다. 그래픽카드 교체주기 연장... AI 기반 부가기능으로 보완 디인포메이션 등에 따르면 엔비디아는 새 GPU 아키텍처 '루빈(Rubin)'을 적용한 RTX 50 시리즈 후속 제품을 2027년 말 대량 생산하려던 계획도 연기한 것으로 추정된다. 올해 뿐만 아니라 내년까지 새 PC용 GPU가 등장하지 않을 수 있다는 의미다. HBM뿐 아니라 고성능 GDDR 메모리 확보도 점점 어려워지면서 소비자용 GPU 생산 일정이 영향을 받고 있다는 분석도 나온다. 일반 소비자용 그래픽카드 교체 주기가 길어지고 AI 기반 성능 개선 기술 의존도가 높아질 전망이다. 엔비디아는 지난 해 출시한 RTX 50 시리즈 GPU의 성능 향상을 위한 DLSS 4.5 추가 업데이트도 준비중이다. AI 생성 프레임을 6배로 늘리는 한편 모니터 최대 화면주사율에 맞춰 화질과 프레임의 균형을 자동으로 조절하는 기능이 포함될 예정이다.

2026.02.25 16:31권봉석 기자

[AI는 지금] 5000억 달러 '스타게이트' 제동…오픈AI 전략 차질에 반도체도 영향 받나

오픈AI와 소프트뱅크, 오라클이 추진해온 미국 초대형 인공지능(AI) 데이터센터 프로젝트 '스타게이트'가 1년 넘게 본격 가동되지 못한 것으로 알려졌다. 5000억 달러(약 720조원) 규모로 발표되며 글로벌 AI 인프라 경쟁의 상징으로 주목받았지만, 파트너십 구조를 둘러싼 이견과 자금 조달 문제 등이 겹치며 사실상 전략 수정 국면에 들어갔다는 평가가 나온다. 미국 IT 전문매체 디인포메이션은 23일(현지시간) 복수 소식통을 인용해 오픈AI·소프트뱅크·오라클이 프로젝트 발표 직후부터 역할 분담과 지배구조를 두고 의견 차이를 보여왔고, 이로 인해 사업이 실질적 진전을 이루지 못하고 있다고 보도했다. 스타게이트는 초기 1000억 달러를 투입해 10GW(기가와트) 규모의 AI 전용 컴퓨팅 인프라를 구축하는 것을 1단계 목표로 제시했다. 그러나 현재까지 핵심 인력 충원은 물론 오픈AI 주도의 데이터센터 개발도 착수 단계에 이르지 못한 것으로 전해졌다. 업계에선 초대형 인프라 사업 특성상 자산 소유권과 운영 통제권, 수익 배분 구조가 명확히 정리되지 않으면 금융 조달과 건설 일정이 동시에 지연될 수밖에 없다고 보고 있다. 특히 데이터센터 자산을 누가 보유할 것인지, 기술 통제권을 어디까지 인정할 것인지를 두고 3사 간 견해차가 컸던 것으로 알려졌다. 오픈AI는 한때 직접 데이터센터 구축을 추진했지만, 금융권이 상환 능력에 의문을 제기하면서 자금 조달이 보류된 것으로 전해졌다. AI 인프라는 선투자 규모가 막대하고 회수 기간이 긴데, 그래픽처리장치(GPU) 등 고가 연산 장비의 감가상각 부담과 기술 진화 속도까지 고려하면 금융기관 입장에서는 위험도가 높은 사업으로 분류된다. 결국 오픈AI는 3자 공동 추진 대신 소프트뱅크·오라클과 각각 개별 계약을 맺는 방식으로 방향을 틀었다. 오라클과는 미국 내 여러 지역에서 4.5GW 규모 데이터센터를 개발하고, 텍사스 밀럼 카운티 1GW 프로젝트는 소프트뱅크와 협력하는 구조다. 데이터센터 자산은 파트너가 보유하고, 오픈AI는 설계와 지식재산권(IP) 통제에 집중한다는 방침이다. 프로젝트 지연은 재무 부담으로도 이어졌다. 2030년까지의 컴퓨팅 비용 전망치는 기존 4500억 달러에서 6650억 달러로 상향 조정된 것으로 전해졌다. 한때 1조4000억 달러에 달했던 투자 계획도 최근에는 6000억 달러 수준으로 축소된 것으로 알려졌다. 공격적 확장에서 재무 안정성 중심 전략으로 기조가 이동하고 있는 것이다. 스타게이트 난항은 반도체 업계에도 영향을 미칠 수 있을 것으로 보인다. 초대형 AI 데이터센터 프로젝트는 대규모 GPU 발주와 이에 연동된 고대역폭메모리(HBM) 수요를 수반하기 때문이다. 프로젝트가 지연될 경우 관련 장비와 부품의 발주 일정 역시 조정될 가능성이 있다. 다만 업계에선 이를 AI 수요 위축으로 단정하기는 이르다는 분위기다. 스타게이트와 같은 초대형 단일 프로젝트가 지연될 경우 GPU 및 HBM 수요의 '총량'이 줄어들기보다는 대규모 발주의 집행 시점이 뒤로 밀리면서 시장 체감 성장 속도가 완만해질 가능성이 크다고 봤다. AI 인프라 투자가 중장기적으로 이어지는 흐름은 유지되더라도 데이터센터 건설 일정이 늦춰지면 반도체 업계의 실적 반영 시점 역시 후행할 수 있다는 의미다. 업계 관계자는 "스타게이트 사례는 AI 산업이 기술 경쟁을 넘어 자본 조달과 거버넌스 안정성이라는 현실적 과제에 직면했음을 보여주는 것"이라며 "인프라 확장의 방향성은 유지되지만, 속도와 방식은 조정되는 국면에 접어든 것으로 보인다"고 평가했다.

2026.02.24 10:41장유미 기자

클라우다이크 '브이픽', 엔비디아 AI스타트업 지원 프로그램 선정

클라우드 및 인공지능(AI) 솔루션 전문 기업 클라우다이크(대표 이선웅)는 AI 영상 분석 및 숏폼 제작 서비스 '브이픽(VPick)'이 엔비디아 스타트업 육성 프로그램인 '엔비디아 인셉션(NVIDIA Inception)'에 선정됐다고 23일 밝혔다. '엔비디아 인셉션'은 AI, 데이터 사이언스 등 혁신 기술을 보유한 전 세계 스타트업을 발굴, 지원하는 프로그램이다. 선정된 기업은 엔비디아 최신 GPU 기술 지원을 비롯한 클라우드 크레딧, 기술 교육 및 투자자 연결 등 기업 성장을 위한 다양한 혜택이 주어진다. 이선웅 대표는 이번 선정에 대해 "클라우다이크가 최근 출시한 브이픽의 AI 기술력을 인정받은 결과"라고 자평했다. 브이픽은 기업이 보유한 방대한 영상 데이터를 AI가 자동으로 분석, 마케팅에 즉시 활용 가능한 '숏폼(Short-form)' 영상으로 재가공해 주는 B2B SaaS(서비스형 소프트웨어)다. 브이픽은 단순히 영상을 이해하는 것을 넘어, 사용자가 클릭 몇 번으로 ▲자연어 명령을 통한 영상 검색 ▲AI를 통한 자동 숏폼 생성 ▲자동 자막 생성 등 고난도 영상 편집 작업을 수행할 수 있다. 이는 네이버클라우드 미디어 인텔리전스, 구글 제미나이(Gemini) 등 미디어 및 거대언어모델(LLM)을 결합한 '하이브리드 AI 아키텍처'를 적용했기 때문이다. 클라우다이크는 이번 엔비디아 인셉션 선정을 계기로 브이픽의 AI 기술 역량 고도화를 추진한다. 엔비디아의 고성능 GPU 인프라를 활용해 영상 처리 속도를 획기적으로 단축하고 서비스 운영 원가 절감 등을 통해 보다 합리적인 고객 서비스를 제공할 계획이다. 이선웅 대표는 “브이픽이 단순한 편집 도구를 넘어, GPU 가속 기술이 내재된 고도화된 AI 솔루션이라는 점을 글로벌 시장에 입증한 것"이라며 "향후 엔비디아 기술 지원을 바탕으로 영상 콘텐츠 제작 비효율 개선을 추진하며, 글로벌 AI 시장 진출에 박차를 가할 것"이라고 밝혔다.

2026.02.23 13:49박희범 기자

엔비디아, 메타에 AI칩 수백만개 공급 예정…장기 파트너십 체결

엔비디아가 글로벌 주요 클라우드서비스제공자(CSP) 메타와 장기간·대규모 AI 반도체 공급에 대한 계약을 체결했다. 17일(현지시간) 엔비디아는 메타와 온프레미스, 클라우드 및 AI 인프라에 대한 다년간의 전략적 파트너십을 맺었다고 밝혔다. 이번 협력으로 엔비디아는 메타에 수백만 개의 '블랙웰' 및 '루빈' GPU를 공급할 예정이다. 해당 GPU는 AI 데이터센터에 필요한 초고성능 칩이다. 특히 루빈의 경우, 올해 본격적인 상용화가 예상된다. 또한 메타는 자사 데이터센터에 엔비디아의 그레이스 CPU를 단독으로 도입하기로 했다. 주요 CSP 기업 중 엔비디아의 그레이스 CPU만을 채용한 사례는 이번이 처음이다. 그간 메타는 Arm 기반의 CPU를 자사 AI칩의 보조 프로세서로 활용해 왔다. 이와 관련해 로이터통신은 "고객사향 매출을 공개한 적은 없지만, 메타는 엔비디아의 최근 분기 매출의 61%를 차지하는 4대 CSP 중 하나"라며 "엔비디아가 이번 계약을 강조한 것은 메타와의 대규모 사업 관계 유지와 CPU 시장에서의 입지 강화를 보여주기 위한 것"이라고 평가했다. 젠슨 황 엔비디아 최고경영자(CEO)는 "엔비디아는 CPU, GPU, 네트워킹 및 소프트웨어 전반에 걸친 심층적인 공동 설계로 메타가 차세대 AI 인프라를 구축하는 데 필요한 모든 플랫폼을 제공할 것"이라고 말했다. 마크 저커버크 메타 CEO는 "엔비디아와의 파트너십 확대로 베라 루빈 플랫폼을 활용한 최첨단 클러스터를 구축하고, 전 세계 모든 사람에게 맞춤형 인공지능을 제공하게 돼 기쁘다"고 밝혔다.

2026.02.18 10:10장경윤 기자

엔비디아 "한국 반도체 업체와 피지컬 AI 협력 지속"

"한국은 삼성전자, SK하이닉스, 현대차그룹, LG전자 등 세계적 제조기업을 보유한 전략적 거점이다. 엔비디아가 추진하는 디지털 트윈과 피지컬 AI 기반 협력을 주도하는 전초기지 역햘을 수행하고 있다." 11일 서울 코엑스에서 열린 '세미콘 코리아 2026' 기조연설에서 정소영 엔비디아코리아 대표가 이렇게 설명했다. 이날 엔비디아는 반도체 설계부터 제조까지 산업 전반에 걸친 단계에서 생산성과 효율을 강화할 수 있는 AI 모델과 디지털 트윈 기술을 소개했다. 또 반도체 생태계를 넘어 산업 전반의 혁신 기업으로 역할을 확대해 나가겠다는 비전을 제시했다. 제품 대신 지능 생산하는 'AI 팩토리' 대두 이날 정소영 대표는 AI 시대 산업 패러다임의 전환이 'AI 팩토리'와 '피지컬 AI' 등 두 축을 중심으로 일어나고 있다고 설명했다. 정 대표는 "전통적인 공장은 사람과 자원을 투입해 제품을 생산한 반면 AI 시대의 공장은 데이터와 전기를 투입해 지능(인텔리전스)를 생산하는 공간"이라고 정의했다. 이어 "AI 팩토리에서 생성된 인텔리전스가 반도체·제조·자동차·통신 등 다양한 산업에 접목되며 실질적인 변화를 만들어내고 있다. 이미 글로벌 주요 산업 현장에서 AI 기반 혁신이 가속화되고 있다"고 덧붙였다. 그는 피지컬 AI에 대해 "이는 단순히 로봇을 움직이는 것이 아니라 현실 세계에 존재하는 다양한 물리적 개체(entity)에 지능을 결합해 우리 삶과 생산 현장 전반에 AI의 영향을 확장시키는 단계"라고 밝혔다. "엔비디아, AI 팩토리 구성 인프라 제공" 엔비디아는 2020년대 이후 AI 연산을 수행하는 GPU에 머무르던 것에서 벗어나 AI 처리 인프라를 제공하는 기업으로 포지션 변화를 시도하고 있다. 정소영 대표는 "AI 팩토리는 GPU를 시작으로 클라우드와 온프레미스 데이터센터, 그 위에서 구동되는 AI 모델과 고부가가치 소프트웨어·서비스로 구성된다. 엔비디아는 이런 가속 컴퓨팅 기반을 산업 전반에 제공하는 인프라 기업"이라고 말했다. 이어 "올 하반기 출시할 차세대 GPU 플랫폼 '베라 루빈'은 베라 CPU, 루빈 GPU와 네트워킹 칩, 스위치 등 6개 요소를 동시 개발하고 최적화하며 AI 플랫폼을 구현중"이라고 덧붙였다. "CPU 대신 GPU 활용해 소요시간 단축" 엔비디아는 CPU 대신 GPU를 활용하는 쿠다(CUDA)-X 라이브러리로 고성능·장시간 연산이 필요한 산업계 과제의 소요 시간 단축을 제공하고 있다. 2023년 엔비디아가 개발한 소프트웨어 라이브러리인 cu리소(cuLitho)는 반도체 식각 공정에 쓰이는 포토마스크 설계 시간을 크게 단축한다. 기존 CPU로 2주 이상 걸리던 연산 시간을 하루 내외로 줄였다. 정소영 대표는 "주요 반도체 소자를 시뮬레이션하는 TCAD, 리소그래피, 전자설계자동화(EDA) 등 반도체 전 분야에 AI 기반 모델이 적용된다. 삼성전자·SK하이닉스 등 국내 주요 업체도 설계 시간 단축, 시뮬레이션 고도화 등을 추진중"이라고 밝혔다. 시뮬레이션 플랫폼 '옴니버스', 반도체 생산 자동화 가속 엔비디아는 현실 세계 물리 법칙과 환경을 시뮬레이션 할 수 있는 플랫폼 '옴니버스'를 피지컬 AI 구현에 활용하고 있다. 자율주행차와 휴머노이드 로봇, 자율이동로봇(AMR) 등 다양한 장비 개발 소요 시간을 단축하고 정밀도를 높일 수 있다. 정소영 대표는 옴니버스 활용 사례로 "어플라이드 머티어리얼즈(AMAT)와는 디지털 트윈 기반 생산 공정 제어에 협력하고 있고 램리서치 및 LG디스플레이 등과도 협업을 확대하고 있다"고 설명했다. 정 대표는 "반도체 산업은 축적된 방대한 부품·공정 데이터를 보유하고 있어 AI 에이전트를 통한 자동화와 EDA 가속화에 유리하다. 실제로 아드반테스트와 AI 에이전트를 활용한 제품 테스트 자동화도 공동 개발 중"이라고 밝혔다.

2026.02.11 15:41권봉석 기자

[유미's 픽] 李 'AI 고속도로'가 바꾼 판…정부 GPU 지원, 스타트업 실험에 불 붙였다

'인공지능(AI) 고속도로' 구축을 위해 이재명 정부가 추진해온 고성능 그래픽처리장치(GPU) 지원 사업이 국내 AI 스타트업 생태계 조성에 실질적인 역할을 했다는 평가가 나오고 있다. 대규모 연산 자원이 필수적인 파운데이션 모델 개발과 차세대 AI 구조 연구에서 초기 자본이 부족한 스타트업들도 정부 덕에 기술 실험을 지속할 수 있는 토대가 마련됐다는 분석이다. 10일 업계에 따르면 트릴리온랩스는 지난해 9월부터 4개월여간 정부로부터 엔비디아 H200 GPU 80장 규모의 고성능 연산 자원을 지원받아 차세대 AI 구조 연구를 진행했다. 이를 통해 초거대 모델 학습뿐 아니라 기존 트랜스포머 구조의 연산 효율을 개선하기 위한 신규 아키텍처 실험과 대규모 검증을 병행할 수 있는 환경을 구축했다. 이 연산 인프라는 구체적인 기술 성과로도 이어졌다. 트릴리온랩스는 지원받은 GPU 자원을 활용해 지난 달 디퓨전 기반 대규모 언어 모델 '트리다(Trida)-7B'를 개발했다. '트리다-7B'는 단어를 하나씩 순차적으로 생성하는 기존 방식에서 벗어나 문장 전체를 병렬로 생성하는 확산(diffusion) 기법을 언어 모델에 적용한 것이 특징이다. 또 이미지 생성에 주로 활용되던 디퓨전 기술을 언어 모델 구조에 이식함으로써 추론 속도와 연산 효율을 동시에 끌어올렸다. 이와 함께 지난해 10월에는 소규모 프록시 모델을 활용해 대형 언어모델의 성능을 사전에 예측하는 '알브릿지(rBridge)' 기법도 개발했다. 실제 대형 모델을 반복 실행하지 않고도 성능을 가늠할 수 있는 구조로, 연산 효율을 최대 700배 이상 개선하고 거대언어모델(LLM) 개발 비용을 대폭 절감할 수 있는 가능성을 제시했다. 대규모 모델 학습에 앞서 시행착오를 줄일 수 있다는 점에서 파운데이션 모델 개발 방식 자체를 바꿀 수 있는 접근으로 평가된다. 업계에선 이러한 성과가 단순한 개별 기술 개발을 넘어 AI 연구·개발의 비용과 시간, 자원 구조를 근본적으로 재설계했다는 점에 주목하고 있다. 대형 모델을 '더 많이 돌리는 방식'이 아니라 '덜 돌리고도 더 많이 검증하는 방식'으로 전환할 수 있는 가능성을 보여줬다는 점에서다. 이는 스타트업이 제한된 자원 환경에서도 고난도 연구를 지속할 수 있는 실질적인 해법으로 꼽힌다. 이 같은 결과 뒤에는 과학기술정보통신부와 정보통신산업진흥원(NIPA)의 지원 방식도 한 몫 했다는 평가다. 앞서 정부는 삼성SDS·KT클라우드·엘리스클라우드를 '고성능컴퓨팅 지원사업' 공급사로 선정한 후 지난해 9월부터 12월까지 국내 민간 중소·중견·스타트업 기업과 대학·병원·연구기관 등에 총 1천 장의 GPU를 지원했다. 당시 삼성SDS와 엘리스그룹은 각각 H100 GPU 200장과 400장을, KT클라우드는 H200 GPU 400장 수준을 공급했다. 당시 정부에선 그간 단순히 GPU를 일괄 배분하는 데 그치지 않고 연구 단계와 실험 난이도에 맞춰 자원 활용 계획을 조정하며 과제 수행 전반을 관리했다. 또 개발 과정에서 발생하는 변수에 따라 지원 방식을 유연하게 조정하고 현장의 피드백을 즉각 반영하는 방식으로 연구 완성도를 높였다. 이 과정에서 정부는 단순한 예산 집행 기관을 넘어 프로젝트의 '내비게이터' 역할을 수행하며 실질적인 성과를 견인했다는 평가를 받았다. 또 단순히 규모가 큰 기업이 아닌, 독보적인 기술력과 성장 잠재력을 보유한 스타트업을 정밀하게 선별해 과제 수행 기업으로 낙점하려는 노력이 참여 기업으로부터 큰 호응을 얻었다. 업계 관계자는 "정부가 행정적 관리에 그치지 않고 모델 출시 과정에서 발생하는 변수에 맞춰 지원 체계를 업데이트했다"며 "현장의 목소리를 즉각 반영해 모델의 완성도를 높이는 실질적인 가이드도 제공해줬다"고 말했다.이어 "무한정한 지원 대신, 한정된 예산 내에서 최선의 결과물을 낼 수 있도록 목표 난이도를 정교하게 조정해준 점도 인상 깊었다"며 "이를 통해 자원의 낭비를 막고 효율적인 사용 위에 최대의 성과를 이끌어냈다"고 덧붙였다. 트릴리온랩스 역시 정부 인프라 지원을 발판 삼아 국내에서 시도된 적 없는 기술 실험을 진행할 수 있었다고 평가했다. 독자적인 모델 구조와 학습 기법을 실제 대규모 환경에서 반복 검증하며 스타트업이 겪는 컴퓨팅 파워 한계를 일정 부분 극복할 수 있었다는 것이다. 신재민 트릴리온랩스 대표는 "정부의 GPU 지원 사업이 단순한 인프라 제공을 넘어 기술 기업의 도전 방식을 바꿨다"며 "자본력보다 기술적 실험과 구조 혁신에 집중할 수 있는 조건을 마련했다는 점에서 국내 AI 생태계에 미친 영향이 적지 않다"고 강조했다. 이 같은 분위기 속에 정부가 추가경정예산으로 확보한 고성능 GPU 자원으로 어떤 AI 연구 기관, 기업들이 수혜를 받을지 관심이 쏠린다. 정부는 총 1만3천136장 규모의 GPU를 최대 12개월까지 이용할 수 있도록 한 사업을 공고한 후 지난 달 28일 마감했다. 이번에는 학계·연구기관은 무상으로, 산업계는 자부담 방식으로 지원받는 구조다. 구축·운영은 민간 클라우드 3사가 맡는다. 네이버클라우드는 세종 데이터센터에 H200 2296장을 안착시켰고, 카카오는 안산 데이터센터에 B200 2040장을 클러스터 형태로 구축했다. NHN클라우드는 3월께 B200 6120장을 갖출 계획이다. 정부는 이 사업에 예산 1조4590억원을 투입했다. 이번 프로젝트는 과제별로 H200, B200 중 하나만 신청할 수 있다. 신청은 서버 묶음 기준으로 이뤄진다. H200은 최소 서버 2대(16장)에서 최대 서버 32대(256장)까지, B200은 최소 서버 2대(16장)에서 최대 서버 16대(128장)까지다. 조만간 선정될 수요 기업은 원격 접속 방식인 GPUaaS(GPU as a Service)로 고성능 컴퓨팅 자원을 손쉽게 이용할 수 있다. 정부가 고수한 '1사 1지원' 원칙을 사실상 폐기해 중복 신청 문턱이 낮아진 점도 눈에 띈다. 이 일로 동일 기업 내 복수 부서도 각각 GPU 자원을 확보할 수 있게 됐다. 다만 연구 인력의 독립성과 과제 주제는 차별돼야 한다. 여기에 정부는 지난해 확보한 1만3000장에 이어 올해는 B200 기준 1만5000장을 투입해 지원 범위를 넓힐 계획이다. 이를 구축하기 위해 총 2조831억원(출연금)이 투입될 이번 사업 공고는 이달 중 나올 예정으로, 과기정통부 단일 사업 기준 최대 규모 프로젝트로 평가된다. 또 단일 사업자가 전체 물량을 감당하기 어려운 만큼, 사업 구조 자체를 어떻게 설계할지가 관건이 될 전망이다. 과기정통부 관계자는 "주요 클라우드 서비스 제공업체(CSP)들과 면담한 결과 데이터센터 상면(물리적 수용 공간) 확보는 어느 정도 가능한 수준으로 파악됐다"며 "최신 GPU를 확보하는 것이 유리한 만큼 엔비디아 차세대 AI 칩 '베라루빈'을 업체들이 제안할 경우 가점을 줄 지에 대한 방안에 대해선 고민 중"이라고 밝혔다. 업계에선 정부의 고성능 연산 인프라 지원이 일회성 사업에 그치지 않고 파운데이션 모델·신규 아키텍처·산업 특화 AI로 이어지는 연속적인 연구 생태계로 정착할 수 있을지가 향후 사업 성공 여부의 관건이 될 것이라고 전망했다. 업계 관계자는 "특히 연산 자원 접근성이 기술 경쟁력으로 직결되는 AI 산업 특성을 감안할 때 정부의 GPU 지원 정책이 국내 스타트업들의 글로벌 도전 여력을 좌우하는 핵심 변수로 작용할 것으로 예상된다"며 "단기 성과보다 중장기 연구 축적이 가능한 구조로 설계될 경우 정부 지원이 국내 AI 산업의 체질을 바꾸는 계기가 될 수 있다"고 말했다.

2026.02.10 11:43장유미 기자

엔비디아 GPU 의존 넘을까…정부에 발 맞춘 LG CNS, 국산 AI 반도체로 공공 AX 공략

LG CNS가 인공지능(AI) 반도체 기업 퓨리오사AI와 손잡고 신경망처리장치(NPU) 기반 AI 서비스를 개발해 공공 AX 시장 공략에 나선다. 정부가 국산 AI 반도체 육성을 핵심 과제로 내세운 가운데 대기업과 국내 AI 반도체 스타트업 간 협력이 본격화하는 모습이다.LG CNS는 서울 마곡 LG사이언스파크 본사에서 퓨리오사AI와 'AI 인프라 사업 협력 확대'를 위한 업무협약(MOU)을 체결했다고 5일 밝혔다. 협약식에는 LG CNS AI클라우드사업부 김태훈 부사장과 퓨리오사AI 백준호 대표 등 주요 경영진이 참석했다. 퓨리오사AI는 AI 연산에 특화된 반도체인 NPU를 설계·개발하는 AI 반도체 스타트업이다. 퓨리오사AI의 2세대 NPU 'RNGD(레니게이드)'는 대규모 AI 서비스에 필요한 고성능 요건을 충족하고, 그래픽처리장치(GPU) 대비 전력 소모와 운영 비용을 크게 줄일 수 있다. 퓨리오사AI는 지난 1월 TSMC로부터 RNGD 4000장을 인도받으며 양산에 성공, 글로벌 시장 공략 및 보급에 박차를 가하고 있다. 이번 협력을 통해 양사는 LG AI연구원 컨소시엄으로 참여 중인 '독자 AI 파운데이션 모델' 프로젝트 내 협력을 강화한다. LG CNS는 퓨리오사AI의 RNGD를 적용한 K-엑사원(EXAONE)을 기반으로 AI 서비스의 성능을 최적화하고, 상용화해 시너지를 극대화하는 역할을 맡는다. 퓨리오사AI는 안정적인 RNGD 공급과 함께 NPU 관련 기술 지원을 담당한다.이번 협력은 국산 AI 반도체가 실제 AI 서비스 환경에서 상용화 가능성을 검증하는 사례라는 점에서 업계의 관심을 받고 있다. 그동안 국내 AI 반도체는 기술력 대비 상용 레퍼런스 부족이 한계로 지적돼 왔는데, 이번 협력을 계기로 대기업 AI 서비스 인프라에 토종 NPU가 적용되는 실증 사례가 추가됐다는 평가다. 업계에선 이번 협력이 토종 AI 반도체가 엔비디아 중심의 GPU 생태계에 도전할 수 있는 가능성을 보여주는 사례이자, 국내 AI 반도체 기업들이 본격적으로 공급망에 참여할 수 있는 신호탄이라는 분석도 나온다. GPU 중심 인프라 구조에서 벗어나려는 시도라는 점도 이번 협력의 의미로 꼽힌다. 퓨리오사AI의 NPU는 GPU 대비 전력 효율과 추론 성능 측면에서 경쟁력을 갖췄다는 평가를 받아왔다. 이번 프로젝트를 통해 단순한 하드웨어 대체를 넘어 AI 서비스 특성에 맞춰 GPU와 NPU를 병행·최적화하는 인프라 구조의 가능성을 검증한다는 점에서 AI 인프라 생태계 확장으로 이어질 수 있다는 해석도 나온다. LG CNS 역시 협력 배경으로 GPU 중심 생태계에 대한 종속성을 줄이고, 국내 AI 기술과 인프라 경쟁력을 강화하려는 전략을 강조하고 있다. 특히 공공 AX 시장의 경우 비용 효율성과 안정성이 중요한 만큼, NPU 기반 인프라가 현실적인 대안이 될 수 있다는 판단이다. 퓨리오사AI 입장에서도 이번 협력은 성장의 중요한 분기점으로 평가된다. 국내 대기업의 AI 서비스 인프라에 자사 NPU가 채택되면서 기술력뿐 아니라 상용성과 안정성을 동시에 입증할 수 있는 레퍼런스를 확보하게 됐기 때문이다. 회사는 이를 바탕으로 글로벌 시장에서도 고객 확보에 나선다는 전략이다. 업계 관계자는 "LG CNS와의 협력이 특정 기업의 성과를 넘어 국내 팹리스 기업들이 AI 반도체 분야에서 자체 제품을 실제 서비스에 적용하는 사례를 늘리는 계기가 될 수 있을 것"이라며 "정부가 국산 AI 반도체 육성을 핵심 과제로 제시한 상황에서 민간 차원의 실질적인 상용화 사례가 등장하고 있다는 점에서 의미가 있다"고 분석했다. 양사는 이번 협력을 계기로 토종 AI 모델과 서비스, 인프라, AI반도체로 구성된 '소버린 AI 생태계'를 더욱 강화하고 공공 AX 시장에 최적화된 서비스를 제공한다는 전략이다. 공공 부문 특성상 보안성과 비용 효율, 안정성이 중요한 만큼, GPU 중심 인프라의 대안으로 NPU 기반 AI 인프라를 제시하겠다는 구상이다. 협력의 첫 단계로 LG CNS는 자체 개발한 기업용 에이전틱AI 플랫폼 '에이전틱웍스(AgenticWorks)' 구동 인프라에 퓨리오사AI NPU를 적용해 기술 검증을 진행한다. 에이전틱AI는 스스로 목표를 설정하고 복잡한 업무를 수행하는 만큼, 이를 뒷받침할 고성능·고효율 인프라가 필수적이다. LG CNS는 NPU 기반 인프라를 통해 에이전틱AI 서비스의 전력 효율과 운영 효율을 동시에 높일 계획이다. 양사는 NPU 기반 GPUaaS(GPU as a Service) 성능 최적화 기술도 실증한다. GPUaaS는 GPU를 가상화해서 제공하는 방식으로, 사용자는 실제 하드웨어를 구매하지 않고도 고성능 연산 환경을 활용할 수 있어 AI 시대의 핵심 모델로 각광받고 있다. 양사는 AI 학습과 AI 서비스 운영, 추론 등 모든 단계에 NPU를 적용해 전력 효율과 비용 경쟁력을 높일 수 있는 인프라 최적화에 나선다. 김태훈 LG CNS AI클라우드사업부 부사장은 "퓨리오사AI와의 협력을 통해 고객들이 에이전틱AI를 보다 효율적으로 사용할 수 있도록 NPU 기반 AI 인프라 기술력과 전문인력을 확보할 것"이라며 "LG AI연구원과 협력해 국가대표AI 모델 고도화를 지원하고 국내 AI 산업 발전에 기여할 것"이라고 밝혔다.

2026.02.05 10:05장유미 기자

엔비디아, 2028년 GPU '파인만' 생산에 인텔과 협력설

엔비디아가 차세대 GPU '파인만' 생산에 필요한 반도체 중 일부를 인텔 파운드리에서 만들 수 있다는 관측이 나왔다. 대만 디지타임스는 28일 "엔비디아가 도널드 트럼프 2기 행정부의 미국 투자 확대와 관세 등 정치적 압박을 피하기 위해 인텔 파운드리와 협력할 계획을 가지고 있다"고 전했다. 엔비디아는 모든 구성 요소를 한 파운드리에서 모두 생산해 왔다. 현재까지 대만 TSMC 중심으로 유지돼 온 엔비디아의 파운드리 전략이 변화할 수 있다는 점에서 눈길을 끈다. 다만 인텔의 첨단 공정 성숙도와 비용 구조, 미국 내 정치적 문제 등 여러 변수가 얽혀 있어 양사 협력이 실제 실현될 지는 미지수다. 디지타임스 "엔비디아, 파인만 I/O 다이 인텔에 맡긴다" 디지타임스에 따르면 엔비디아는 2028년 출시할 GPU 아키텍처 '파인만' 구성에 필요한 반도체 중 GPU간 통신, 메모리 입출력과 관련된 I/O 다이(Die)를 인텔에서 생산할 예정이다. 핵심 연산을 담당하는 GPU 다이는 기존처럼 TSMC 생산을 유지한다. 디지타임스는 I/O 다이를 생산할 후보 공정으로 1.8나노급 인텔 18A(Intel 18A)나 2028년 본격 가동될 1.4나노급 인텔 14A(Intel 14A)를 거론했다. 디지타임스는 "TSMC가 생산한 GPU와 인텔이 생산한 I/O 다이가 인텔 평면 반도체 연결 기술인 EMIB으로 연결된다. 또 파인만 최종 패키징 공정 중 25%는 인텔이 미국에서, 75%는 대만에서 TSMC가 처리할 것"이라고 주장했다. 1.8나노급 인텔 18A, 외부 고객사 비중은 미미 단 디지타임스가 거론한 인텔 18A 공정은 외부 고객사보다는 내부 고객사, 다시 말해 인텔 PC·서버 생산 용도에 치중한 공정이다. 인텔 역시 "인텔 18A 공정의 주된 고객사는 인텔 자신"이라고 설명해 왔다. 인텔 18A 공정을 거칠 PC용 프로세서로는 이 달부터 본격 공급에 들어간 코어 울트라 시리즈3(팬서레이크)를 포함해 올 하반기 공개될 데스크톱 PC·노트북용 노바레이크(Nova Lake) 등이 예정됐다. 서버용으로는 제온6+(클리어워터 포레스트)를 포함해 다이아몬드래피즈, 코랄래피즈 등이 인텔 18A를 활용할 예정이다. 반대로 인텔이 직접 밝힌 인텔 18A 공정 외부 고객사는 AWS(아마존웹서비스), Arm 등 극소수에 그친다. 1.4나노급 인텔 14A, 단가·수율 등 여전히 미지수 디지타임스가 후보로 거론한 또다른 공정인 인텔 14A 공정은 시작부터 외부 고객사 요구사항에 맞춘 공정이다. 그러나 단가나 비용 효율성, 수율 면에서 아직 충분히 검증되지 않았다. 인텔 역시 시설 투자 규모조차 결정하지 못한 상태다. 또 입출력을 관리하는 I/O 다이는 단가나 비용 효율성, 수율 등을 고려해 충분히 성숙된 공정을 활용하는 것이 일반적이다. 현재 엔비디아 주력 GPU인 블랙웰 역시 I/O 다이에 5나노급 N5 공정을 개량한 N4P 공정을 활용한다. 작년 9월 데이비드 진스너 인텔 최고재무책임자(CFO)는 "인텔 14A 공정 생산 단가는 고개구율(High-NA) 극자외선(EUV) 활용으로 비싸질 것"이라고 밝힌 바 있다. 엔비디아가 I/O 다이 생산에 인텔 14A 공정을 선택할 경우 원가 상승은 불가피하다. 단 엔비디아 GPU는 현재 사실상 과점 상태에 있으며 주요 기업들이 단가 상승을 감수할 요인도 분명하다. 트럼프 행정부 압박, 11월 이후 지속 여부 불투명 디지타임스는 엔비디아-인텔 협력설 배경으로 미국 정부의 정치적 압력을 들었다. 도널드 트럼프 2기 행정부는 작년 9월 인텔에 89억 달러(약 12조 3천247억원)를 투자하고 1대 주주로 올라선 한편 대만 등에는 미국 내 반도체 생산시설 투자를 종용하고 있다. 단 지난 해 초 취임 이후 47%로 시작한 트럼프 2기 행정부 지지율은 최근 최저치인 38%대까지 내려왔다. 미국 미네소타주 미니애폴리스에서 진행된 이민 단속 작전에서 민간인 희생자가 발생한 여파로 해석된다. 이는 오는 11월 미국 상/하원 의원, 주지사 등을 선출하는 중간선거에도 적지 않은 영향을 미칠 것으로 보인다. 중간 선거 결과에 따라 트럼프 2기 행정부의 기조가 바뀐다면 엔비디아가 굳이 비용 부담이 큰 선택을 할 이유도 줄어든다. 인텔 14A 고객사 윤곽, 올 하반기 확정 전망 디지타임스의 엔비디아-인텔 협력설 실현 여부는 올 하반기에 판가름날 것으로 보인다. 반도체 업계 통례에 따르면 제품 개발부터 출시까지는 평균 2년 가량 걸린다. 엔비디아 역시 올 상반기, 늦어도 올 3분기 안에는 차기 GPU 구성 요소 중 어느 부분을 어떤 파운드리에 맡길 지 선택해야 한다. 립부 탄 인텔 CEO는 지난주 2025년 4분기 실적발표 이후 컨퍼런스 콜에서 "외부 고객사가 인텔 14A의 성능, 수율, 설계자산(IP) 준비 상황을 종합적으로 평가하고 있으며 이 과정이 올 하반기까지 계속될 것"이라고 설명했다. 인텔 관계자는 29일 디지타임스발 보도 관련 실현 가능성, 논의 진척 사항 등 지디넷코리아 질의에 "시장의 루머에 답변하지 않는다"고 회신했다.

2026.01.29 10:05권봉석 기자

엔비디아, Arm 윈도 PC 칩 'N1X/N1' 상반기 출시하나

엔비디아가 2024년 하반기부터 대만 팹리스 미디어텍과 개발을 시작한 윈도 PC용 Arm 기반 시스템반도체(SoC)인 N1X/N1이 올 상반기 안에 정식 제품으로 등장할 수 있다는 전망이 나왔다. N1X/N1은 고성능 CPU 코어와 블랙웰 GPU를 결합한 SoC로, 엔비디아 개인용 AI 워크스테이션 'DGX 스파크' 등에 에 적용된 GB10과 유사한 구성이다. 기존 Arm 윈도 노트북의 한계로 지적돼 온 그래픽 성능을 대폭 끌어올릴 수 있다. 대만 디지타임스는 엔비디아가 오는 3월 'GTC 2026' 행사에서 N1X/N1을 정식 공개하고, 6월 '컴퓨텍스 타이베이 2026' 행사 중 실제 제품을 공개할 가능성이 높다고 짚었다. 그러나 게임과 안티치트 등을 포함한 소프트웨어 호환성이 최대 변수로 꼽힌다. 2024년 하반기부터 N1/N1X 개발설 흘러나와 엔비디아가 대만 팹리스 미디어텍과 협력해 윈도 PC용 Arm 칩을 개발중이라는 루머는 2024년 하반기부터 대만 내 공급망을 중심으로 간헐적으로 흘러나왔다. 엔비디아가 개발중인 칩은 ▲ Arm 코어텍스(Cortex)-X925 CPU 코어 10개, 저전력·고효율 코어텍스-A725 코어 10개와 블랙웰 GPU를 결합한 'N1X' ▲ 코어 수를 줄이고 GPU 성능도 낮춘 'N1' 등 두 개다. 이 중 CPU와 GPU는 지난해 4분기부터 우분투 리눅스 기반 'DGX OS'를 탑재하고 시장에 출시된 개인용 AI 워크스테이션 'DGX 스파크' 내장 GB10과 거의 구성이 같은 것으로 알려져 있다. 작년 컴퓨텍스 공개는 불발... 벤치마크 수치는 노출 작년 5월 '컴퓨텍스 타이베이 2025' 개최를 앞두고 엔비디아와 미디어텍 두 회사가 N1X/N1 칩을 공개할 수 있다는 전망도 나왔다. 그간 컴퓨텍스를 포함해 공개석상에 등장하지 않았던 차이리싱(蔡力行) 미디어텍 CEO가 기조연설에 나섰다는 사실 때문이다. 그러나 엔비디아 기조연설이나 미디어텍 기조연설에서 N1X나 N1 관련 내용은 등장하지 않았다. 차이리싱 미디어텍 CEO와 젠슨 황 엔비디아 CEO도 GB10 관련 내용만 소개하는 데 그쳤다. 이후 작년 7월에는 N1X 칩 성능을 Arm용 윈도11에서 실행한 결과가 공개되기도 했다. CPU 성능은 인텔 14세대급 프로세서와, 내장 GPU 성능은 인텔 코어 울트라 시리즈3의 Xe3와 비슷할 것으로 예상된다. 디지타임스 "2분기부터 실제 제품 등장 전망" 대만 디지타임스는 지난 19일 공급망 관계자를 인용해 "엔비디아 N1X 칩 기반 노트북이 이르면 올 1분기 시장에 출시되고 2분기부터 본격적으로 시장에 공급될 것"이라고 보도했다. 실제로 작년 11월 경 주요 PC 제조사인 델테크놀로지스가 엔비디아 N1X 기반 '델 16 프리미엄' 노트북 시제품을 운송했다는 기록이 드러나기도 했다. 또 레노버도 최근 게이밍 노트북 '리전'에 탑재되는 소프트웨어인 '리전 스페이스' 관련 기술지원 문서에 'Legion 7 15N1X11'이라는 미출시 제품 명칭을 표기했다. 이는 '15인치 디스플레이와 엔비디아 N1X를 탑재한 리전 7 노트북'으로 해석될 수 있다. 이를 종합하자면 엔비디아가 오는 3월 중순 미국 새너제이에서 진행될 컨퍼런스 'GTC 2026'에서 N1X/N1칩을 공개하고, 6월 초순 대만에서 진행될 '컴퓨텍스 타이베이 2026'에서 실제 제품을 출시하는 스케줄로 이어질 수 있다. 게임 호환성이 관건... 최근 Arm용 X박스 앱 공개 엔비디아 N1X/N1 SoC는 현재까지 출시된 노트북용 SoC 중 그래픽 성능 면에서 최상위에 있다. Arm 진영에서는 배터리 지속시간과 휴대성이 중요한 업무용 노트북 수요가 퀄컴 스냅드래곤 X 엘리트로, 게임용 고성능 노트북은 엔비디아 N1X로 양분될 가능성도 있다. 그러나 오히려 GPU 성능보다는 주로 게임이나 안티치트 등 소프트웨어 호환성이 더 큰 문제가 될 것으로 보인다. 엔비디아에 한 발 앞서 Arm 윈도 PC 시장에 참여한 퀄컴도 별도 조직을 만들고 호환성 문제를 해결하는 데 10여 년 가량을 투자했다. 특히 GPU 등에 직접 접근해야 하는 게임 특성상 여러 문제가 발생할 수 있다. 다만 지난 21일 마이크로소프트가 Arm용 X박스 앱을 공개했고 X박스 게임 패스 카탈로그에 등록된 게임 중 85% 가량이 현재 Arm용 윈도11을 지원한다. 엔비디아가 자체 운영하는 클라우드 게이밍인 '지포스 나우'를 Arm용으로 개발하는 방안도 있다.

2026.01.26 16:39권봉석 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

삼성전자, 차세대 D램 'D0a' 로드맵 수정…하이브리드 본딩 앞당긴다

기술전시 넘어 '돈 되는 AI'로…AI페스타, 역대급 사업기회 연다

[AI는 지금] 속도조절론 속 쏟아진 신모델…AI 3사 승부처는

검찰, 카카오 김범수 2심서도 징역 15년 구형..."불법·부정 지시 없었다"

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.