• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'AI GPU'통합검색 결과 입니다. (464건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

韓 AI반도체, '엔비디아 대항마' 넘어 실전으로

AI 시대의 개막과 함께 반도체 산업의 패러다임이 급변하고 있다. 인공지능 구현에 필수적인 고성능 반도체의 수요가 폭증함에 따라, 엔비디아의 GPU(그래픽처리장치)를 중심으로 한 글로벌 AI 생태계는 그 어느 때보다 공고한 성벽을 쌓아 올렸다. 그러나 최근 AI 시장의 무게추가 모델 학습에서 '추론(Inference)'으로 이동하며 GPU 중심의 시장 구조에 변화의 조짐이 나타나고 있다. 학습에서 추론으로, NPU 시장의 활성화 생성형 AI의 확산은 데이터센터부터 엣지, 온디바이스 전반에 걸쳐 막대한 연산 수요를 창출하고 있다. 초기 시장이 대규모 언어 모델을 학습시키기 위한 GPU 중심이었다면, 이제는 학습된 모델을 실무 서비스에 적용하는 추론 단계가 핵심 경쟁력으로 부상했다. 이 과정에서 AI 연산에 특화된 NPU(신경망처리장치) 시장이 본격적으로 활성화되고 있다. NPU는 범용성을 갖춘 GPU와 달리 AI 알고리즘 처리에 최적화돼 있어, 전력 효율성과 비용 측면에서 압도적인 강점을 가진다. 글로벌 테크 기업들이 효율적인 AI 인프라 구축을 위해 NPU로 눈을 돌리면서, NPU는 GPU의 대안을 넘어 차세대 반도체의 주역으로 자리매김하고 있다. 2026년, 대한민국 AI 반도체 '원년'의 선포 이러한 시장 변곡점에서 국내 AI 반도체 기업들은 글로벌 시장의 주도권을 잡기 위해 총력전을 펼치고 있다. 특히 2026년은 국내 주요 AI 반도체 스타트업들의 기술력이 담긴 칩들이 일제히 시장에 출시되는 시점으로, '한국 AI 반도체의 원년'이라 부르기에 부족함이 없다. 리벨리온, 퓨리오사AI, 딥엑스, 모빌린트 등 국내 기업들은 각기 다른 전략과 포지셔닝을 통해 글로벌 경쟁력 확보에 매진하고 있다. 이들은 단순한 기술 개발을 넘어 시제품(PoC) 단계를 통과하고 실제 양산 및 상용화 단계로 진입하며 실질적인 성과를 증명해야 하는 중요한 기로에 서 있는 셈이다. 생존 전략을 위한 SWOT 분석 [K-AI칩이 온다] 연재 기획은 국내 주요 AI 반도체 및 인프라 기업 7곳을 대상으로 이들의 기술력과 시장 생존 전략을 집중 조명한다. 각 기업의 주력 시장과 포지셔닝, 성능 및 전력 효율성, 그리고 소프트웨어(SW) 경쟁력을 다각도로 분석할 예정이다. 급변하는 글로벌 공급망 리스크와 양산 과제 속에서 국내 기업들이 가진 강점(Strength), 약점(Weakness), 기회(Opportunity), 위협(Threat) 요인을 면밀히 분석함으로써 대한민국 AI 반도체 산업의 현주소와 미래 가능성을 제시하고자 한다.

2026.02.18 16:00전화평 기자

엔비디아, 메타에 AI칩 수백만개 공급 예정…장기 파트너십 체결

엔비디아가 글로벌 주요 클라우드서비스제공자(CSP) 메타와 장기간·대규모 AI 반도체 공급에 대한 계약을 체결했다. 17일(현지시간) 엔비디아는 메타와 온프레미스, 클라우드 및 AI 인프라에 대한 다년간의 전략적 파트너십을 맺었다고 밝혔다. 이번 협력으로 엔비디아는 메타에 수백만 개의 '블랙웰' 및 '루빈' GPU를 공급할 예정이다. 해당 GPU는 AI 데이터센터에 필요한 초고성능 칩이다. 특히 루빈의 경우, 올해 본격적인 상용화가 예상된다. 또한 메타는 자사 데이터센터에 엔비디아의 그레이스 CPU를 단독으로 도입하기로 했다. 주요 CSP 기업 중 엔비디아의 그레이스 CPU만을 채용한 사례는 이번이 처음이다. 그간 메타는 Arm 기반의 CPU를 자사 AI칩의 보조 프로세서로 활용해 왔다. 이와 관련해 로이터통신은 "고객사향 매출을 공개한 적은 없지만, 메타는 엔비디아의 최근 분기 매출의 61%를 차지하는 4대 CSP 중 하나"라며 "엔비디아가 이번 계약을 강조한 것은 메타와의 대규모 사업 관계 유지와 CPU 시장에서의 입지 강화를 보여주기 위한 것"이라고 평가했다. 젠슨 황 엔비디아 최고경영자(CEO)는 "엔비디아는 CPU, GPU, 네트워킹 및 소프트웨어 전반에 걸친 심층적인 공동 설계로 메타가 차세대 AI 인프라를 구축하는 데 필요한 모든 플랫폼을 제공할 것"이라고 말했다. 마크 저커버크 메타 CEO는 "엔비디아와의 파트너십 확대로 베라 루빈 플랫폼을 활용한 최첨단 클러스터를 구축하고, 전 세계 모든 사람에게 맞춤형 인공지능을 제공하게 돼 기쁘다"고 밝혔다.

2026.02.18 10:10장경윤 기자

경남형 피지컬 AI 시동…엔비디아 B200 품은 제조AI센터 발주

제조 공정 데이터와 실물 설비를 연결하는 피지컬 인공지능(AI)이 차세대 국가 경쟁력으로 부상하는 가운데, 경상남도가 제조업 중심 산업 구조에 특화된 인프라 구축에 나섰다. 고성능 그래픽처리장치(GPU)를 기반으로 한 제조AI 데이터센터를 조성해 도내 중소 제조기업의 AI 전환(AX)을 지원하겠다는 구상이다. 14일 조달청 나라장터에 따르면 경남테크노파크는 경남 제조AI 데이터센터 구축 사업을 발주했다. 총 사업비는 약 56억원 규모로 책정됐다. 사업기간은 계약 체결일로부터 60일로, 비교적 단기간 내 구축을 완료한다는 계획이다. 이번 사업은 지역 주도형 AI 대전환 사업의 일환으로, 공용 GPU 자원을 집적한 데이터센터를 통해 제조 현장에 특화된 AI 학습·추론 환경을 마련하는 것이 핵심이다. 경남 지역 산업 특성과 여건에 맞는 맞춤형 AI센터를 구축하고 공용 GPU 서버 및 엣지컴퓨팅 기반 인프라를 도입해 제조 현장 중심의 AI 서비스를 구현할 전망이다. 특히 고성능 GPU 서버를 중심으로 한 AI 인프라 확충을 통해 도내 중소 제조기업의 AI 활용도를 높이고 서비스 신뢰성을 제고할 계획이다. 사업 범위는 제조AI 및 중소 제조기업 AI 대전환(AX)을 위한 인프라 도입과 데이터센터 구축 전반을 포함한다. 고성능 GPU 서버와 고용량 스토리지 도입, AI 운영 솔루션 구축, 전산실 기반 환경 조성 등이 주요 과업이다. 아울러 기존에 도입된 GPU 서버와 스토리지 등 관련 인프라를 신규 센터로 이전·재배치해 통합 운영 환경을 마련한다. GPU 서버는 10U 랙형 서버 5대로 구성되며 엔비디아 B200 HGX SXM 기반 GPU를 서버당 8개 이상 탑재하도록 요구됐다. 이는 대규모 모델 학습과 분산 연산을 고려한 구성으로, 제조 공정 데이터 분석과 AI 모델 고도화에 대응하기 위한 설계로 풀이된다. 소프트웨어 측면에선 GPU 자원 풀링과 컨테이너 기반 학습·추론 환경을 위한 AI 운영 솔루션이 도입된다. GPU 가상화와 분할 기능을 활용해 단일 대형 모델뿐 아니라 소규모 추론부터 다중 노드 분산 학습까지 폭넓은 워크로드를 소화하기 위한 구조다. 해당 데이터센터는 경남 창원시 의창구 기업연구관 3층에 조성된다. 제안요청서에는 전산실 배치, 이중마루 및 냉복도 컨테인먼트 구성 등 물리적 인프라 요건도 세부적으로 명시됐다. 사업은 계약 이후 세부 수행 계획 수립과 현황 조사, 기반 인프라 구축, 장비 납품·설치, 정보시스템 이전, 통합 시험운영을 거쳐 완료보고 및 검사·검수 단계로 이어진다. 시험운영과 이중화 테스트를 통해 요구 성능 충족 여부를 검증하며 문제 발생 시 교체·증설·보완을 요구할 수 있도록 했다. 특히 기술능력평가 90점, 가격평가 10점 비중으로 종합평가를 실시한다. 기술평가에서는 장비·운용환경 구축, 기반인프라 계획, 정보시스템 이전 방안, 시험 및 안정화, 유지관리 정책 등을 중점적으로 본다. 단순 장비 납품을 넘어 프로젝트 관리 역량과 보안·품질 관리 체계까지 종합 평가 대상이다. 장애 발생 시 4시간 이내 조치 착수, 8시간 이내 복구 등 구체적 대응 기준도 제시돼 운영 안정성을 확보하도록 했다. 업계에선 이번 사업에 GPU 서버·AI 인프라 구축 경험을 보유한 시스템통합(SI) 기업과 데이터센터 전문 업체, 클라우드·AI 플랫폼 기업 등이 관심을 보일 것으로 보고 있다. 특히 엔비디아 B200 HGX 기반 사양이 명시된 만큼 관련 공급 레퍼런스를 확보한 기업 중심의 경쟁이 예상된다. 제조 데이터 특화 AI 운영 역량과 전산실 기반 인프라 구축 경험이 기술평가에서 핵심 변수가 될 것이라는 분석도 나온다. 이번 경남 제조AI데이터센터 구축은 단순한 GPU 집적 사업을 넘어 제조 현장의 설비·공정 데이터와 AI를 연결하는 경남형 피지컬 AI 인프라의 출발점으로 평가된다. 지역 제조기업이 자체적으로 고가의 GPU 자원을 확보하기 어려운 상황에서 공용 데이터센터를 통해 연산·저장·운영 환경을 통합 제공함으로써 AX를 가속화하겠다는 전략이다. 경남테크노파크 측은 "고성능 GPU 기반 제조AI데이터센터를 구축해 도내 중소 제조기업의 AI 대전환을 지원할 계획"이라며 "연산·운용·저장 자원을 통합한 데이터 기반 환경을 조성해 경남 주력산업의 AX를 촉진하겠다"고 밝혔다.

2026.02.14 09:23한정호 기자

[종합] 한국 클라우드, AI 인프라·공공사업이 판 키웠다…2025년 나란히 실적 반등

국내 클라우드 산업이 인공지능(AI) 인프라 수요 확대를 발판으로 또 한 번의 분기 성장세를 기록했다. 네이버·KT·NHN 등 주요 클라우드 서비스 제공사(CSP)들은 그래픽처리장치(GPU) 기반 AI 인프라와 공공 클라우드 전환 수요를 양축으로 외형 확대와 수익성 개선을 동시에 모색한 것으로 나타났다. 12일 네이버·KT·NHN이 공시한 2025년 4분기 실적에 따르면 각 기업은 AI 인프라 고도화와 공공·산업별 디지털 전환 수요를 기반으로 엔터프라이즈·기술·클라우드 부문 매출을 끌어올렸다. GPU 확보 경쟁과 데이터센터 투자 확대가 실적에 본격 반영되며 그룹 내 존재감을 키웠고 단순 인프라 공급을 넘어 AI 중심 플랫폼 사업자로의 전환이 본격화됐다는 평가가 나온다. 먼저 네이버는 2025년 4분기 엔터프라이즈 부문에서 1718억원의 매출을 기록했다. 전년 동기 대비 3.2% 감소했지만, 전년도에 반영된 일회성 요인을 제외하면 16.6% 성장한 수치다. 직전 분기 대비로는 14.5% 증가하며 회복세를 보였고 연간 기준으로는 5878억원을 기록하며 전년 대비 4.3% 성장했다. 이번 실적은 서비스형 GPU(GPUaaS) 매출 반영과 사우디아라비아 슈퍼앱 구축, 디지털 트윈 등 글로벌 프로젝트 확대에 힘입은 결과다. 네이버는 AI·클라우드 사업을 이끄는 네이버클라우드를 주축으로 금융·공공·의료 등 고보안 영역 중심의 소버린 AI 전략을 강화 중이며 서울대학교병원·한국은행과의 협업을 통해 산업별 특화 AI 모델 구축을 확대하고 있다. 다만 네이버클라우드는 최근 과학기술정보통신부가 추진한 독자 AI 파운데이션 모델 프로젝트 1차 평가에서 다음 단계 진출에 실패하며 우려가 제기돼왔다. 이에 대해 최수연 네이버 대표는 지난 6일 실적발표 컨퍼런스콜에서 "정부 측 결과를 존중하나 이것이 네이버의 기술 경쟁력 부족을 의미하는 것은 아니다"라며 "B2B 매출에 큰 영향은 없을 것이며 연구개발(R&D)을 통해 기술 리더십을 공고히 하겠다"고 밝혔다. KT클라우드는 2025년 연간 매출 9975억원으로 전년 대비 27.4% 성장하며 1조원에 근접한 실적을 기록했다. 4분기 매출은 2779억원이다. 공공 AI 클라우드 수요 확대와 글로벌 고객 데이터센터 이용률 증가가 동시에 작용한 결과라는 게 회사 측 설명이다. KT클라우드는 지난해 11월 국내 최초로 액체 냉각 기술을 적용한 가산 AI 데이터센터를 개소하며 고성능 AI 연산 수요에 대응하고 있다. 앞서 2030년까지 320메가와트(MW) 규모 AI 데이터센터 전력 인프라를 확보한다는 중장기 로드맵도 제시한 바 있다. 이같은 GPU 기반 인프라 확장에 더해 국내외 소프트웨어(SW) 기업과 협력하는 AI 파운드리 전략을 바탕으로 인프라·플랫폼·파트너 생태계를 아우르는 구조를 구축한다는 전략이다. 장민 KT 최고재무책임자(CFO)는 "KT클라우드는 글로벌 고객의 데이터센터 이용률 증가와 공공 AI 클라우드 수요 확대에 힘입어 의미 있는 성과를 거뒀다"며 "이러한 성장 흐름은 올해도 이어질 것"이라고 말했다. 다음으로 NHN클라우드는 2025년 4분기 사상 첫 분기 흑자를 달성했다. NHN 기술 부문은 4분기 1391억원의 매출을 기록했으며 이 가운데 NHN클라우드는 전년 동기 대비 30.7%, 전 분기 대비 37.6% 증가하며 영업이익 기준 첫 흑자를 냈다. 연간 기술 부문 매출은 4609억원으로 전년 대비 11.3% 성장했다. NHN클라우드는 광주 국가AI데이터센터에서 GPU 서비스를 국내 기업과 공공기관, 대학 등에 제공하며 AI 수요 확대에 대응해왔다. 또 정부 'GPU 확보·구축·운용지원 사업'에서 다음 달 가동을 목표로 엔비디아 B200 7천656장을 서울 양평 리전에 구축 중이다. 4000장 이상 GPU를 단일 클러스터로 구성하고 수냉식 냉각 시스템 도입으로 대규모 AI 인프라 운영 역량을 강화했다. 민간 부문에서도 성과가 이어졌다. NHN클라우드는 최근 크래프톤의 초거대 GPU 클러스터 사업자로 선정되며 대형 민간 레퍼런스를 확보했다. 지난해 국가정보자원관리원 대전센터 화재 이후 공공 재해복구(DR) 수요 확대와 민간 GPU 매출 증가가 동시에 반영되며 수익 구조 개선에 속도가 붙었다는 분석이다. 정우진 NHN 대표는 "국정자원 대구센터를 통해 주요 공공기관의 클라우드 전환을 완료했고 지난해 화재로 영향을 받았던 주요 정보 시스템도 성공적으로 복구했다"며 "올해도 NHN클라우드는 GPU를 기반으로 확대되는 시장 기회를 선점해 더 높은 수준의 성장 국면에 진입할 것"이라고 강조했다. 아울러 또다른 국내 주요 CSP인 카카오엔터프라이즈는 아직 명확한 실적이 공개되진 않았으나, 업계에선 이원주 대표 선임 이후 비용 효율화를 단행한 만큼 적자 폭을 상당 부분 줄였을 것이라는 예상이 나온다. 클라우드 중심 조직 재편과 비핵심 사업 정리를 통해 체질 개선에 나선 영향이 지난해 실적에 반영됐을 것이라는 관측이다. 카카오엔터프라이즈 역시 다른 CSP와 마찬가지로 GPU 서비스를 강화하고 있다. 지난해 하이브리드 GPUaaS를 공개하며 온프레미스와 클라우드를 결합한 AI 인프라 전략을 제시했다. GPU 인프라 비용 절감과 유연성 확보를 동시에 내세우며 AI 스타트업 및 엔터프라이즈 시장을 겨냥 중이다. 한편 지난해 국정자원 대전센터 화재 이후 공공 디지털 인프라의 안정성과 재해 대응 체계에 대한 경각심이 높아지면서 정부의 민간 클라우드 도입 논의도 활성화되고 있다. 주요 정보시스템의 이중화와 DR 체계 고도화가 정책 과제로 부상하면서 공공기관의 클라우드 전환 및 민관 협력형 인프라 구축 사업이 본격화될 것이라는 전망이 나온다. 이에 공공 레퍼런스와 데이터센터 운영 역량을 확보한 국내 CSP들에게는 중장기적 사업 기회가 확대될 수 있다는 분석이다. 다만 지난해 하반기부터 공공 클라우드 보안인증(CSAP) 재편 논의가 업계 변수로 떠올랐다. CSAP와 국정원 보안 절차 간 조정 가능성이 거론되면서 공공 클라우드 시장의 제도 환경 변화가 기로에 선 상황이다. 이에 국내 CSP들은 변화에 대비하며 공공 레퍼런스 확보와 기술 내재화 전략을 동시에 강화하는 분위기다. 클라우드 업계 관계자는 "GPU 확보와 데이터센터 효율화, 공공 AI 전환 수요가 동시에 확대되며 국내 CSP 간 경쟁이 치열해지고 있다"며 "올해는 외형 성장뿐 아니라 AI 인프라 내재화와 수익성 구조 개선이 경쟁을 가르는 분기점이 될 것"이라고 전망했다.

2026.02.12 15:21한정호 기자

NHN클라우드, 2025년 4분기 첫 흑자…GPU·공공 전환 수혜

NHN클라우드가 그래픽처리장치(GPU) 기반 인공지능(AI) 인프라 사업 확대와 공공 클라우드 전환 수요 증가에 힘입어 2025년 4분기 사상 첫 분기 흑자를 달성했다. 국가정보자원관리원(국정자원) 화재 이후 재해복구(DR) 수요가 본격화되고 정부 GPU 구축 사업이 가시화되면서 외형 성장과 수익성 개선을 동시에 이뤄냈다는 평가다. NHN은 12일 진행한 2025년 4분기 실적발표 컨퍼런스콜을 통해 기술 부문이 전년 동기 대비 17.4%, 전 분기 대비 24.5% 증가한 1391억원의 매출을 기록했다고 발표했다. 이 가운데 NHN클라우드는 4분기 매출이 전년 동기 대비 30.7%, 전 분기 대비 37.6% 증가하며 영업이익 기준 최초 분기 흑자를 달성했다고 밝혔다. 연결 기준 기술 부문 연간 매출은 4609억원으로 전년 대비 11.3% 성장했다. 4분기에는 GPU 서비스 매출 증가와 공공 클라우드 전환 사업 확대가 본격 반영됐다. 특히 NHN클라우드는 광주 국가AI데이터센터에서 GPU 서비스를 국내 기업과 공공기관, 대학 등에 제공하며 AI 수요 확대에 대응했다. 동시에 행정안전부 '모바일전자정부시스템' 등 주요 공공 시스템의 클라우드 전환 및 복구 사업을 수행하며 공공 레퍼런스를 강화했다. 정우진 NHN 대표는 "국정자원 대구센터를 통해 주요 공공기관의 클라우드 전환을 완료했고 지난해 화재로 영향을 받았던 주요 정보 시스템도 성공적으로 복구했다"고 밝혔다. 국가정보자원관리원 화재 이후 DR 수요가 확대되며 공공 클라우드 전환 사업이 실적에 본격 반영됐다는 분석이다. AI 인프라 분야에서도 대형 프로젝트 성과가 이어졌다. NHN클라우드는 정부 'GPU 확보·구축·운용지원 사업'에서 엔비디아 B200 7656장을 서울 양평 리전에 구축 중이며 다음 달 본격 가동을 앞두고 있다. NHN클라우드는 이 사업의 최다 구축 기업으로, 4000장 이상 GPU를 단일 클러스터로 구성하고 수냉식 냉각 시스템을 도입해 국내 최고 수준 운영 역량 입증에 나섰다. 이같은 기술력을 기반으로 최근에는 크래프톤의 초거대 GPU 클러스터 사업자로도 선정됐다. 민간향 AI GPU 매출 확대와 함께 통합 메시지 플랫폼 '노티피케이션' 사용량 증가도 4분기 실적 개선에 힘을 보탰다. NHN은 올해도 GPU 기반 AI 인프라 수요 확대와 DR 사업에서의 지속 수혜를 전망하고 있다. 안현식 NHN 최고재무책임자(CFO)는 "올해 GPU 사업에서 괄목할 만한 성장이 예상되고 DR 사업 수요도 이어질 것"이라며 "올해 클라우드 부문에서 영업이익을 확실히 달성해 흑자 전환될 구조를 만들겠다"고 말했다. 정우진 NHN 대표는 "올해도 NHN 클라우드는 GPU 기반으로 확대되는 시장 기회를 선점해 더 높은 수준의 성장 국면에 진입할 것"이라고 밝혔다.

2026.02.12 10:46한정호 기자

카카오, 구글과 협력…차세대 AI 경험 선보인다

카카오가 차세대 인공지능(AI) 경험을 제공하고자 구글과 손 잡는다. 정신아 카카오 대표는 12일 지난해 4분기 실적 발표 컨퍼런스 콜에서 "올해부터 자사가 더 집중하고자 하는 디바이스 측면에서 차세대 AI 경험을 선보이기 위해 글로벌 협업을 본격적으로 시작하기로 합의했다"고 말했다. 이번 파트너십의 출발점으로 카카오는 자사 온디바이스 AI 서비스를 고도화하기 위해 구글 안드로이드와 협업을 시작한다. 안드로이드 개발팀과 직접 협업한다. 여기에 카카오는 AI 인프라에 대한 재무적 부담이 점진적으로 증가하고 있다는 점을 고려해 그래픽처리장치(GPU)에서 나아가 다양한 칩 라인업을 모델과 서비스별로 최적화해 배치함으로써 자본 효율적인 방식으로 AI 인프라를 강화하는 방안을 고민한다. 또 카카오는 구글클라우드와의 유의미한 규모의 중앙처리장치(CPU) 클라우드 운영에 대한 논의도 진행 중이다. 카카오는 향후 출시될 구글 AI 글래스에서의 협업에도 착수한다. 정 대표는 "앞으로 다양한 AI 폼팩터 환경에서 카카오 서비스가 더해질 때 이용자 경험이 어떻게 달라질 수 있을지에 대한 가설을 세우고 이를 바탕으로 하나씩 실험하며 새로운 AI 사용 경험을 만들어 가고자 한다"고 덧붙였다.

2026.02.12 09:32박서린 기자

삼성전자, AI 메모리 혁신 'PIM' 상용화 박차… "LPDDR6 표준 논의 중"

삼성전자가 AI 시대의 고질적인 문제인 '메모리 벽'을 허물기 위해 PIM(Process In Memory) 기술 상용화 로드맵을 구체화했다. 특히 온디바이스 AI 시장을 겨냥해 LPDDR6 기반의 PIM 표준 논의에 착수하며 차세대 시장 선점에 나선다. 손교민 삼성전자 마스터는 11일 삼성동 코엑스에서 열린 '세미콘 코리아 2026' 기조연설에서 "현재 AI 성능은 메모리 대역폭의 부족으로 인해 GPU의 성능을 100% 발휘하지 못하고 있다"며 PIM 기술의 필요성을 강조했다. PIM은 메모리 내부 뱅크(Bank) 레벨에 연산 유닛(ALU)을 배치하는 기술이다. 기존 방식이 데이터를 CPU나 GPU로 옮겨 연산했다면, PIM은 메모리 안에서 직접 연산을 수행한다. 이를 통해 대역폭에서 크게 이득을 얻으면서도, 전력 효율성 또한 크게 상승한다는 게 손 마스터의 설명이다. HBM에서 LPDDR로, 상용화 무게중심 이동 삼성전자는 그간 HBM-PIM 등을 통해 기술 검증(PoC)을 마쳤으며, 이제는 실제 양산이 가능한 커머셜 제품 단계로 진입하고 있다. 그 중심에는 스마트폰 및 온디바이스 AI 기기에 최적화된 LPDDR 시리즈가 있다. 손 마스터는 "LPDDR은 DDR 대비 스피드가 빠르게 발전하고 있으며, 온디바이스 AI에 가장 적합한 용처를 가지고 있다"며 상용화 로드맵을 공개했다. 발표에 따르면 삼성전자는 LPDDR5X에 PIM을 적용할 계획이다. LPDDR5X PIM은 현재 주요 고객사들과 협력해 개발 중이며, 올해 하반기 샘플링이 가능할 전망이다. 아울러 차세대 규격인 LPDDR6에 PIM을 적용하기 위한 스펙 논의가 현재 활발히 진행 중이다. "시스템 생태계와 협력해 '메모리 그 이상' 추구" PIM의 성공적인 안착을 위해서는 소프트웨어 및 시스템 생태계의 변화가 필수적이다. 손 마스터는 "PIM은 NPU나 GPU를 대체하는 것이 아니라, 이들과 협력해 시스템 전체의 성능을 높이는 솔루션"이라며 "과거에는 소프트웨어 지원 문제로 PIM이 어렵다는 인식이 있었으나, 현재는 많은 기업이 이를 도입하려는 의지를 가지고 있다"고 말했다. 삼성전자는 향후 하이브리드 본딩 등 고도의 패키징 기술을 결합하여, PIM이 AI 연산의 필수 요소로 자리 잡도록 개발을 지속할 계획이다.

2026.02.11 17:08전화평 기자

엔비디아 "한국 반도체 업체와 피지컬 AI 협력 지속"

"한국은 삼성전자, SK하이닉스, 현대차그룹, LG전자 등 세계적 제조기업을 보유한 전략적 거점이다. 엔비디아가 추진하는 디지털 트윈과 피지컬 AI 기반 협력을 주도하는 전초기지 역햘을 수행하고 있다." 11일 서울 코엑스에서 열린 '세미콘 코리아 2026' 기조연설에서 정소영 엔비디아코리아 대표가 이렇게 설명했다. 이날 엔비디아는 반도체 설계부터 제조까지 산업 전반에 걸친 단계에서 생산성과 효율을 강화할 수 있는 AI 모델과 디지털 트윈 기술을 소개했다. 또 반도체 생태계를 넘어 산업 전반의 혁신 기업으로 역할을 확대해 나가겠다는 비전을 제시했다. 제품 대신 지능 생산하는 'AI 팩토리' 대두 이날 정소영 대표는 AI 시대 산업 패러다임의 전환이 'AI 팩토리'와 '피지컬 AI' 등 두 축을 중심으로 일어나고 있다고 설명했다. 정 대표는 "전통적인 공장은 사람과 자원을 투입해 제품을 생산한 반면 AI 시대의 공장은 데이터와 전기를 투입해 지능(인텔리전스)를 생산하는 공간"이라고 정의했다. 이어 "AI 팩토리에서 생성된 인텔리전스가 반도체·제조·자동차·통신 등 다양한 산업에 접목되며 실질적인 변화를 만들어내고 있다. 이미 글로벌 주요 산업 현장에서 AI 기반 혁신이 가속화되고 있다"고 덧붙였다. 그는 피지컬 AI에 대해 "이는 단순히 로봇을 움직이는 것이 아니라 현실 세계에 존재하는 다양한 물리적 개체(entity)에 지능을 결합해 우리 삶과 생산 현장 전반에 AI의 영향을 확장시키는 단계"라고 밝혔다. "엔비디아, AI 팩토리 구성 인프라 제공" 엔비디아는 2020년대 이후 AI 연산을 수행하는 GPU에 머무르던 것에서 벗어나 AI 처리 인프라를 제공하는 기업으로 포지션 변화를 시도하고 있다. 정소영 대표는 "AI 팩토리는 GPU를 시작으로 클라우드와 온프레미스 데이터센터, 그 위에서 구동되는 AI 모델과 고부가가치 소프트웨어·서비스로 구성된다. 엔비디아는 이런 가속 컴퓨팅 기반을 산업 전반에 제공하는 인프라 기업"이라고 말했다. 이어 "올 하반기 출시할 차세대 GPU 플랫폼 '베라 루빈'은 베라 CPU, 루빈 GPU와 네트워킹 칩, 스위치 등 6개 요소를 동시 개발하고 최적화하며 AI 플랫폼을 구현중"이라고 덧붙였다. "CPU 대신 GPU 활용해 소요시간 단축" 엔비디아는 CPU 대신 GPU를 활용하는 쿠다(CUDA)-X 라이브러리로 고성능·장시간 연산이 필요한 산업계 과제의 소요 시간 단축을 제공하고 있다. 2023년 엔비디아가 개발한 소프트웨어 라이브러리인 cu리소(cuLitho)는 반도체 식각 공정에 쓰이는 포토마스크 설계 시간을 크게 단축한다. 기존 CPU로 2주 이상 걸리던 연산 시간을 하루 내외로 줄였다. 정소영 대표는 "주요 반도체 소자를 시뮬레이션하는 TCAD, 리소그래피, 전자설계자동화(EDA) 등 반도체 전 분야에 AI 기반 모델이 적용된다. 삼성전자·SK하이닉스 등 국내 주요 업체도 설계 시간 단축, 시뮬레이션 고도화 등을 추진중"이라고 밝혔다. 시뮬레이션 플랫폼 '옴니버스', 반도체 생산 자동화 가속 엔비디아는 현실 세계 물리 법칙과 환경을 시뮬레이션 할 수 있는 플랫폼 '옴니버스'를 피지컬 AI 구현에 활용하고 있다. 자율주행차와 휴머노이드 로봇, 자율이동로봇(AMR) 등 다양한 장비 개발 소요 시간을 단축하고 정밀도를 높일 수 있다. 정소영 대표는 옴니버스 활용 사례로 "어플라이드 머티어리얼즈(AMAT)와는 디지털 트윈 기반 생산 공정 제어에 협력하고 있고 램리서치 및 LG디스플레이 등과도 협업을 확대하고 있다"고 설명했다. 정 대표는 "반도체 산업은 축적된 방대한 부품·공정 데이터를 보유하고 있어 AI 에이전트를 통한 자동화와 EDA 가속화에 유리하다. 실제로 아드반테스트와 AI 에이전트를 활용한 제품 테스트 자동화도 공동 개발 중"이라고 밝혔다.

2026.02.11 15:41권봉석 기자

송재혁 삼성전자 CTO "커스텀 HBM으로 AI 메모리 벽 깬다"

삼성전자가 메모리와 파운드리, 패키징 역량을 총집결한 '커스텀 HBM(고대역폭메모리)을 앞세워 AI 반도체의 고질적 난제인 '메모리 벽' 돌파에 나선다. 메모리 칩 내부에 직접 연산 기능을 넣는 파격적인 설계와 최첨단 로직 공정을 결합해, 단순한 부품 공급자를 넘어 AI 아키텍처의 설계자로서 주도권을 잡겠다는 전략이다. 송재혁 삼성전자 CTO(사장)는 11일 서울 코엑스에서 열린 '세미콘 코리아 2026' 기조연설에서 '비욘드(Beyond) ZFLOPS: AI 시스템의 미래 아키텍팅'을 주제로 삼성의 차세대 반도체 로드맵을 발표했다. 송 사장은 "현재 GPU(그래픽처리장치) 성능은 비약적으로 성장하고 있지만, 메모리 대역폭의 증가 속도는 이를 따라가지 못해 AI 시스템 발전의 허들이 되고 있다"고 진단했다. 이러한 불균형을 해결할 삼성전자의 핵심 병기는 '커스텀 HBM'이다. 기존 HBM이 데이터를 전달하는 통로 역할에 충실했다면, 삼성의 커스텀 HBM은 메모리 하단부인 '베이스 다이' 내부에 '컴퓨트 코어'를 이식하는 '컴퓨트 인 베이스 다이' 아키텍처를 채택했다. 이 기술을 적용하면 GPU와 메모리 사이의 불필요한 데이터 이동이 최소화되어 연산 효율이 극대화된다. 삼성전자에 따르면 커스텀 HBM 기반 시스템은 기존 GPU 구조 대비 전력 대비 성능이 약 2.8배 향상되는 것으로 확인됐다. "메모리+파운드리" 원팀 시너지… "삼성만이 가능한 영역" 송 사장은 삼성 커스텀 HBM의 경쟁력을 뒷받침하는 핵심 동력으로 삼성전자의 '토탈 솔루션' 역량을 강조했다. 회사는 최첨단 D램, 초미세 로직 공정 파운드리(반도체 위탁생산), 어드밴스드 패키징 기술을 전 세계에서 유일하게 보유했다. 이러한 강점을 살려 시장 리더십을 차지하겠다는 계획이다. 송 사장은 "단일 기업 내에서 메모리와 로직의 시너지를 극대화함으로써 AI 시장이 요구하는 폭발적인 기능을 가장 효율적으로 지원할 것"이라고 자신했다. HBM4 넘어 'zHBM'으로…3D 메모리 시대 예고 삼성전자는 이날 기조연설에서 HBM4(6세대) 이후의 미래형 아키텍처인 'zHBM'의 세부 사양도 처음으로 공개했다. zHBM은 기존 평면적인 배치를 넘어 완전한 3D 적층 구조를 지향한다. 제품의 명칭이 zHBM인 것도, HBM을 패키징할 때 z축(수직)으로 쌓았기 때문이다. zHBM은 멀티 웨이퍼 투 웨이퍼 본딩 기술을 통해 수만 개의 I/O(입출력 단자)를 확보하며, 이를 통해 차세대 HBM 대비 대역폭은 4배 이상 높이고 전력 소비는 75% 절감하는 혁신적인 성능을 목표로 하고 있다. 또한 소자 레벨에서 혁신도 가속화한다. 삼성은 차세대 트랜지스터 구조인 CFET 연구 결과를 공유하며, 기존 구조 대비 채널 반응 속도가 20% 이상 빨라졌음을 확인했다고 밝혔다. 아울러 저전력 구현을 위한 산화물 반도체 채널 적용 등 미세 공정의 한계를 넘기 위한 기술 개발도 순항 중임을 시사했다. 송 사장은 "가상 세계를 넘어 현실을 인식하고 행동하는 '피지컬 AI(Physical AI)' 시대가 머지않았다"며 "삼성 반도체는 최적화된 시너지 솔루션을 통해 인류의 진화에 기여할 준비가 되어 있다"고 말했다.

2026.02.11 15:07전화평 기자

엔비디아 GPU 의존 넘을까…정부에 발 맞춘 LG CNS, 국산 AI 반도체로 공공 AX 공략

LG CNS가 인공지능(AI) 반도체 기업 퓨리오사AI와 손잡고 신경망처리장치(NPU) 기반 AI 서비스를 개발해 공공 AX 시장 공략에 나선다. 정부가 국산 AI 반도체 육성을 핵심 과제로 내세운 가운데 대기업과 국내 AI 반도체 스타트업 간 협력이 본격화하는 모습이다.LG CNS는 서울 마곡 LG사이언스파크 본사에서 퓨리오사AI와 'AI 인프라 사업 협력 확대'를 위한 업무협약(MOU)을 체결했다고 5일 밝혔다. 협약식에는 LG CNS AI클라우드사업부 김태훈 부사장과 퓨리오사AI 백준호 대표 등 주요 경영진이 참석했다. 퓨리오사AI는 AI 연산에 특화된 반도체인 NPU를 설계·개발하는 AI 반도체 스타트업이다. 퓨리오사AI의 2세대 NPU 'RNGD(레니게이드)'는 대규모 AI 서비스에 필요한 고성능 요건을 충족하고, 그래픽처리장치(GPU) 대비 전력 소모와 운영 비용을 크게 줄일 수 있다. 퓨리오사AI는 지난 1월 TSMC로부터 RNGD 4000장을 인도받으며 양산에 성공, 글로벌 시장 공략 및 보급에 박차를 가하고 있다. 이번 협력을 통해 양사는 LG AI연구원 컨소시엄으로 참여 중인 '독자 AI 파운데이션 모델' 프로젝트 내 협력을 강화한다. LG CNS는 퓨리오사AI의 RNGD를 적용한 K-엑사원(EXAONE)을 기반으로 AI 서비스의 성능을 최적화하고, 상용화해 시너지를 극대화하는 역할을 맡는다. 퓨리오사AI는 안정적인 RNGD 공급과 함께 NPU 관련 기술 지원을 담당한다.이번 협력은 국산 AI 반도체가 실제 AI 서비스 환경에서 상용화 가능성을 검증하는 사례라는 점에서 업계의 관심을 받고 있다. 그동안 국내 AI 반도체는 기술력 대비 상용 레퍼런스 부족이 한계로 지적돼 왔는데, 이번 협력을 계기로 대기업 AI 서비스 인프라에 토종 NPU가 적용되는 실증 사례가 추가됐다는 평가다. 업계에선 이번 협력이 토종 AI 반도체가 엔비디아 중심의 GPU 생태계에 도전할 수 있는 가능성을 보여주는 사례이자, 국내 AI 반도체 기업들이 본격적으로 공급망에 참여할 수 있는 신호탄이라는 분석도 나온다. GPU 중심 인프라 구조에서 벗어나려는 시도라는 점도 이번 협력의 의미로 꼽힌다. 퓨리오사AI의 NPU는 GPU 대비 전력 효율과 추론 성능 측면에서 경쟁력을 갖췄다는 평가를 받아왔다. 이번 프로젝트를 통해 단순한 하드웨어 대체를 넘어 AI 서비스 특성에 맞춰 GPU와 NPU를 병행·최적화하는 인프라 구조의 가능성을 검증한다는 점에서 AI 인프라 생태계 확장으로 이어질 수 있다는 해석도 나온다. LG CNS 역시 협력 배경으로 GPU 중심 생태계에 대한 종속성을 줄이고, 국내 AI 기술과 인프라 경쟁력을 강화하려는 전략을 강조하고 있다. 특히 공공 AX 시장의 경우 비용 효율성과 안정성이 중요한 만큼, NPU 기반 인프라가 현실적인 대안이 될 수 있다는 판단이다. 퓨리오사AI 입장에서도 이번 협력은 성장의 중요한 분기점으로 평가된다. 국내 대기업의 AI 서비스 인프라에 자사 NPU가 채택되면서 기술력뿐 아니라 상용성과 안정성을 동시에 입증할 수 있는 레퍼런스를 확보하게 됐기 때문이다. 회사는 이를 바탕으로 글로벌 시장에서도 고객 확보에 나선다는 전략이다. 업계 관계자는 "LG CNS와의 협력이 특정 기업의 성과를 넘어 국내 팹리스 기업들이 AI 반도체 분야에서 자체 제품을 실제 서비스에 적용하는 사례를 늘리는 계기가 될 수 있을 것"이라며 "정부가 국산 AI 반도체 육성을 핵심 과제로 제시한 상황에서 민간 차원의 실질적인 상용화 사례가 등장하고 있다는 점에서 의미가 있다"고 분석했다. 양사는 이번 협력을 계기로 토종 AI 모델과 서비스, 인프라, AI반도체로 구성된 '소버린 AI 생태계'를 더욱 강화하고 공공 AX 시장에 최적화된 서비스를 제공한다는 전략이다. 공공 부문 특성상 보안성과 비용 효율, 안정성이 중요한 만큼, GPU 중심 인프라의 대안으로 NPU 기반 AI 인프라를 제시하겠다는 구상이다. 협력의 첫 단계로 LG CNS는 자체 개발한 기업용 에이전틱AI 플랫폼 '에이전틱웍스(AgenticWorks)' 구동 인프라에 퓨리오사AI NPU를 적용해 기술 검증을 진행한다. 에이전틱AI는 스스로 목표를 설정하고 복잡한 업무를 수행하는 만큼, 이를 뒷받침할 고성능·고효율 인프라가 필수적이다. LG CNS는 NPU 기반 인프라를 통해 에이전틱AI 서비스의 전력 효율과 운영 효율을 동시에 높일 계획이다. 양사는 NPU 기반 GPUaaS(GPU as a Service) 성능 최적화 기술도 실증한다. GPUaaS는 GPU를 가상화해서 제공하는 방식으로, 사용자는 실제 하드웨어를 구매하지 않고도 고성능 연산 환경을 활용할 수 있어 AI 시대의 핵심 모델로 각광받고 있다. 양사는 AI 학습과 AI 서비스 운영, 추론 등 모든 단계에 NPU를 적용해 전력 효율과 비용 경쟁력을 높일 수 있는 인프라 최적화에 나선다. 김태훈 LG CNS AI클라우드사업부 부사장은 "퓨리오사AI와의 협력을 통해 고객들이 에이전틱AI를 보다 효율적으로 사용할 수 있도록 NPU 기반 AI 인프라 기술력과 전문인력을 확보할 것"이라며 "LG AI연구원과 협력해 국가대표AI 모델 고도화를 지원하고 국내 AI 산업 발전에 기여할 것"이라고 밝혔다.

2026.02.05 10:05장유미 기자

김장겸 의원, 'AI 데이터센터 지원' 패키지법 발의

AI 데이터센터(DC)를 국가 전략 인프라로 육성하고, 전력과 행정 전반의 병목을 해소하기 위한 입법이 추진된다. 국회 과학기술정보방송통신위원회 소속 김장겸 국민의힘 의원은 AIDC의 안정적인 구축을 지원하고 산업 진흥을 도모하기 위한 '인공지능 데이터센터 진흥 및 기반 조성에 관한 법률안'과 '분산에너지 활성화 특별법 일부개정법률안'을 4일 대표발의했다. 현재는 막대한 전력을 소비하는 AIDC를 위한 별도 지원법은 부재한 실정이다. 이로 인한 제도적 공백과 복잡한 행정절차, 중앙집중식 전력 공급 규제가 관련 산업 발전을 저해한다는 지적이 제기되고 있다. 김 의원이 발의한 법안엔 비수도권 AIDC 특화지역 지정, 세제 감면·부담금 면제·GPU 등 컴퓨팅 자원 지원 근거 마련, 국가와 지자체에 전력·용수·부지 등 기반 시설 확보 책무 부여, 다수 인허가를 동시에 심사하는 원스톱·일괄 처리 제도 도입 등 내용이 담겼다. 김장겸 의원은 "AI 데이터센터는 우리나라의 디지털 영토를 지키는 핵심 근간"이라며 "패키지 법안을 통해 전력 여유가 있는 비수도권으로 데이터센터의 분산을 유도하고, 전력 공급의 다양성과 효율성을 높여 AI 산업 전반의 경쟁력을 강화하겠다"고 말했다.

2026.02.04 17:41홍지후 기자

김정호 KAIST 교수 "차세대 AI 메모리 HBF, 10년 후 HBM 시장 넘을 것"

"HBF는 HBM을 제대로 해본 회사만 할 수 있는 기술입니다." 김정호 KAIST 전기전자공학부 교수는 3일 기자간담회에서 차세대 AI 메모리로 주목받는 HBF(고대역폭 플래시)에 대해 이같이 단언했다. 생성형 AI가 추론·멀티모달·장문 컨텍스트 시대로 진화하면서 메모리 용량 한계가 본격화되기 때문이다. HBF를 단순한 낸드플래시의 확장판이 아니라 HBM(고대역폭 메모리)을 통해 축적된 기술력이 전제돼야 가능한 영역으로 본 셈이다. 김 교수의 이 발언은 곧바로 한국 메모리 산업의 경쟁력으로 이어진다. 현재 HBM 시장을 주도하고 있는 삼성전자와 SK하이닉스가 HBF에서도 시장 리더십을 유지할 수 있는 것이다. 김 교수는 "HBM은 메모리 중에서도 가장 어려운 시스템 설계"라며 "HBM을 해봤다는 것은 이미 가장 복잡한 메모리 기술을 경험했다는 의미"라고 말했다. 이어 "이 경험을 가진 나라와 기업은 사실상 한국밖에 없다"며 "HBM을 잘하는 회사가 HBF에서도 유리할 수밖에 없는 구조"라고 강조했다. HBF는 낸드플래시 기반의 초대용량 메모리를 GPU 가까이에 배치해, 기존 HBM만으로는 감당하기 어려운 데이터를 처리하기 위한 새로운 메모리 반도체다. AI 추론 과정에서 폭증하는 KV 캐시, RAG(검색 증강 생성)를 위한 문서·영상·이미지 데이터, 멀티모달 AI의 장기 기억이 대표적인 대상이다. 김 교수는 "HBM이 GPU 옆 책상이라면, HBF는 바로 옆에 붙은 도서관"이라며 "당장 필요한 책은 책상에서 보고, 더 많은 자료는 도서관에서 꺼내오는 구조"라고 설명했다. "낸드가 아니라 연결이 성능을 결정" HBF 상용화 과정에서 제기되는 속도 문제는 메모리 제어 로직 설계를 통해 구조적으로 보완할 수 있다는 입장이다. 낸드플래시는 D램에 비해 용량이 큰 대신, 속도가 느리다는 특징을 갖고 있다. 낸드플래시를 집적해 만든 HBF의 속도가 HBM 대비 느린 이유다. 김 교수는 HBF의 성능을 좌우하는 핵심으로 낸드 자체가 아니라, 베이스 다이에 통합된 메모리 제어 로직을 꼽았다. 이 로직은 전통적인 SSD 컨트롤러와는 다르다. SSD처럼 낸드 옆에서 읽기·쓰기만 담당하는 방식이 아니라, GPU와 메모리 사이에 위치한 베이스 다이가 데이터 흐름을 직접 제어하는 구조다. 페이지 단위 병렬 읽기, 대량 데이터 묶음 전송, 버퍼링과 스케줄링을 통해 낸드의 물리적 한계를 구조적으로 보완한다는 설명이다. 김 교수는 "낸드는 느리지만, 한 번에 많이 읽어서 보내면 된다"며 "GPU와 연결되는 대역폭과 지연은 낸드 셀 자체가 아니라 베이스 다이와 인터포저, 인터커넥트 설계가 결정한다"고 말했다. 실제 시스템 기준으로는 HBM 대비 20~30% 수준의 성능 손실로 관리 가능하다는 게 그의 판단이다. HBF는 단독 메모리가 아니라 HBM과 결합된 계층형 구조로 진화할 가능성이 크다. 속도는 HBM, 대용량 데이터는 HBF가 맡는 구조다. 상용화 시점은 2027년 말에서 2028년으로 예상된다. 초기에는 AI 추론용으로 채택되며, 이후 HBM과 HBF를 결합한 메모리 구조가 표준으로 자리 잡을 가능성이 크다는 분석이다. 2038년에는 HBF의 비중이 HBM보다 커질 것으로 내다봤다. 김 교수는 기술 완성도보다 누가 먼저 실제 AI 서비스에 채택하느냐가 관건이라고 강조했다. HBF가 단순한 부품 성능 경쟁이 아니라, 실제 AI 서비스 환경에서 효과가 입증돼야 확산될 수 있는 구조적 기술이기 때문이다. 한 곳에서라도 HBF를 적용해 추론 속도나 동시 처리량 개선이 확인되면, 해당 사례가 곧바로 시장의 기준점이 된다는 설명이다. 그는 "기술 자체보다는 누가 먼저 쓰느냐가 더 중요하다"며 "어떤 서비스에 채택되느냐가 시장을 결정할 것"이라고 말했다.

2026.02.03 16:15전화평 기자

"우린 GPU에만 의존하지 않아"…AI 가속기 선택 SW로 효율·전력·비용 잡아

GPU와 NPU(AI 계산에 특화된 반도체), PIM(메모리 안에서 AI 연산을 처리하는 차세대 반도체) 등 다양한 AI 가속기를 선택적으로 사용, 효율과 전력·비용 세마리 토끼를 한 방에 잡을 수 있는 차세대 AI 인프라 소프트웨어가 개발됐다. KAIST는 이 기술 개발에 박종세 전산학부 교수와 권영진· 허재혁 교수가 참여하고, 쿤레 올루코툰(Kunle Olukotun) 미국 AI 반도체 시스템 스타트업 삼바노바(SambaNova) 공동창업자이자 스탠포드대학 교수가 자문을 수행했다고 1일 밝혔다. 이 기술은 최근 카카오가 주최한 '4대 과학기술원×카카오 AI 육성 프로젝트'에서 애니브릿지 AI 팀으로 참가, 대상을 수상하고 상금 2,000만원과 3,500만원 어치 카카오클라우드 크레딧을 받았다. 연구팀은 초대형언어모델(LLM) 서비스가 대부분 고가 GPU 인프라에 의존, 서비스 규모가 확대될수록 운영 비용과 전력 소모가 급격히 증가하는 구조적 한계가 있다는 점에 주목했다. 특히, 이 문제의 근본 원인이 특정 하드웨어 성능이 아니라, GPU나 NPU, PIM 등 다양한 AI 가속기를 효율적으로 연결·운용할 수 있는 시스템 소프트웨어 계층 부재에 있다고 봤다. 연구팀은 이에 가속기 종류와 관계없이 동일한 인터페이스와 런타임 환경에서 LLM을 서비스할 수 있는 통합 소프트웨어 스택을 개발한 것. 특히 GPU 중심으로 고착화된 기존 LLM 서빙 구조의 한계를 지적하고, 여러 종류의 AI 가속기를 하나의 시스템에서 함께 활용할 수 있는 '멀티 가속기 LLM 서빙 런타임 소프트웨어'를 핵심 기술로 제시했다. 이 기술은 특정 벤더나 하드웨어에 종속되지 않으면서도, 작업 특성에 따라 가장 적합한 AI 가속기를 선택·조합할 수 있는 유연한 AI 인프라 구조 구현이 가능하다. 이는 LLM 서비스 비용과 전력 소모를 줄이고, 확장성을 크게 높일 수 있는 장점이 있다. 박종세 교수는 "AI 시스템과 컴퓨터 아키텍처 분야에서 축적한 연구 성과를 바탕으로 산업 현장에서 활용 가능한 기술 개발을 통해 글로벌 시장으로 진출할 계획"이라고 말했다.

2026.02.01 01:16박희범 기자

인텔, 코어 울트라 시리즈3 본격 시동 "AI PC의 완성형"

"인텔 코어 울트라 시리즈3는 향상된 전력 효율과 그래픽 성능, x86의 호환성을 갖춘 AI PC의 완성형이다. 인텔은 이를 바탕으로 한국 파트너들과 협력하여 AI PC 생태계를 한 단계 더 높은 차원으로 도약시킬 것으로 기대한다" 28일 오전 서울 삼성동 웨스틴 파르나스에서 진행된 '2026 AI PC 쇼케이스 서울'에서 조쉬 뉴먼 인텔 컨수머 PC 부문 총괄이 이렇게 설명했다. 인텔은 1.8나노급 '인텔 18A' 공정에서 생산된 차세대 AI PC용 프로세서, 코어 울트라 시리즈3(팬서레이크)를 올 초 CES 2026에서 정식 출시했다. 주요 제조사도 27일을 기점으로 PC 신제품 출하에 나섰다. "코어 울트라 시리즈3, 모든 면에서 진보한 제품" 코어 울트라 시리즈3는 인텔 18A 공정의 양대 요소인 게이트올어라운드(GAA) 리본펫 트랜지스터와 반도체 후면 전력 전달 기술 '파워비아'를 적용한 첫 상용 제품이다(기술적 세부 내용은 관련기사 참조). 조쉬 뉴먼 총괄은 "코어 울트라 시리즈3는 코어 울트라 200V(루나레이크)의 전력효율성, 코어 울트라 200H(애로우레이크)의 고성능을 결합하는 것을 목표로 CPU, GPU, NPU 등 모든 면에서 진보를 달성한 제품"이라고 설명했다. 이어 "전력 효율성 향상으로 배터리 지속시간을 시간 단위에서 일 단위로 확장하는 한편 Xe3 12코어로 구성된 새 내장 GPU '아크 B390'은 초박형 노트북에서 그동안 불가능했던 게임 성능을 구현했다"고 강조했다. 삼성전자·LG전자, 27일 PC 신제품 국내 출시 삼성전자와 LG전자는 지난 27일 각각 '갤럭시북6 프로/울트라', 'LG 그램 프로 AI' 등 코어 울트라 시리즈3 탑재 신제품을 국내 출시했다. 이민철 삼성전자 MX사업부 갤럭시 에코비즈팀장(부사장)은 "갤럭시북6는 50년 이상 축적한 제조 경험과 갤럭시 생태계를 기반으로 성능과 배터리 지속시간, 안정성 등 PC 기본 요소 재정의에 집중한 완전히 새로운 제품"이라고 설명했다. 이어 "인텔의 PC 원격 관리기술 'v프로', 삼성전자의 보안 기술 '녹스'(KNOX)를 적용한 기업용 파생모델 '갤럭시북6 엔터프라이즈 에디션'도 5월경 추가 출시 예정"이라고 덧붙였다. 장진혁 LG전자 전무는 "LG 그램 프로 AI는 경량 합금 '에어로미늄' 소재를 기반으로 코어 울트라 시리즈3의 GPU·NPU를 활용해 클라우드 AI, 마이크로소프트 코파일럿+, LG가 자체 개발한 엑사원 3.5 기반 '그램 AI' 등 폭넓은 AI 기능을 제공한다"고 설명했다. 산업용 엣지 솔루션으로 포트폴리오 확장 인텔은 지난 해 9월 '인텔 테크투어 US' 행사 당시 코어 울트라 시리즈3에 적용된 모든 IP를 그대로 품은 산업용 엣지 솔루션도 동시에 시장에 공급할 것이라고 밝힌 바 있다. 이날 조쉬 뉴먼 총괄 역시 이를 재확인하고 "엣지용 코어 울트라 시리즈3는 극저온/고온 환경에서 정상 작동, 24시간 주 7일 구동되는 안정성과 긴 수명주기를 바탕으로 스마트시티, 헬스케어, 자동화 시스템의 엣지 AI 구현을 도울 것"이라고 설명했다. 인텔과 협력해온 LG이노텍, 삼성메디슨 등 국내 파트너사도 "AI 사물인식을 통한 결함 검출과 제조 현장 자동화, 의료 AI를 활용한 초음파 영상 진단 개선 등에 코어 울트라 시리즈3를 활용할 것"이라고 밝혔다. 인텔 "다양한 가격대 제품 출시 위해 노력" 립부 탄 인텔 CEO는 지난 주 실적발표 이후 컨퍼런스 콜에서 "웨이퍼 제약으로 PC용 프로세서 우선순위가 밀렸으며 고가 제품 위주로 공급한다"고 설명한 바 있다. 일부 업체도 Xe3 12코어 GPU를 내장한 고성능 제품을 우선 출시했다. 문제는 메모리 반도체 수급난이 가시화되며 올해 PC 신제품 가격이 크게 상승했다는 점이다. 가격 부담이 적은 제품을 찾는 소비자가 제품 구매를 꺼릴 것이라는 전망이 나오고 있다. 이날 현장에서 만난 한 외국계 제조사 국내법인 관계자는 "예정대로라면 이달 말 공급돼야 할 신제품이 다음 달 초 국내 들어오는 등 수급 관련 일부 차질이 있다"고 설명했다. 조쉬 뉴먼 총괄은 "다양한 가격대 제품군 출시를 위해 여러 제조사와 함께 시장 수요에 보다 정밀히 대응 예정"이라고 설명했다. 배태원 인텔코리아 대표이사 역시 "2분기부터는 공급 상황이 나아질 것"이라고 설명했다.

2026.01.28 17:10권봉석 기자

오케스트로, 여의도에 도심형 엣지 데이터센터 구축…소버린 AI 겨냥

오케스트로가 여의도 신사옥 부지에 도심형 엣지 인공지능(AI) 데이터센터를 구축해 고객의 소버린 AI 수요 대응에 나선다. 오케스트로는 DCK와 소버린 AI 클라우드 데이터센터 구축을 위한 업무협약(MOU)을 체결했다고 28일 밝혔다. 협약식은 지난 22일 서울 여의도 오케스트로 본사에서 열렸으며 양사 주요 관계자들이 참석했다. 생성형 AI 확산으로 그래픽처리장치(GPU) 기반 AI 인프라 수요가 빠르게 증가하는 가운데, 최근 데이터 주권과 보안, 비용 통제가 가능한 프라이빗 AI 환경에 대한 관심이 높아지고 있다. 특히 금융·공공·대기업을 중심으로 퍼블릭 클라우드의 제약을 벗어나 데이터와 운영 정책을 직접 통제할 수 있는 소버린 AI 환경을 도입하려는 움직임도 본격화된 상황이다. 이번 협약은 프라이빗 클라우드 기반 소버린 AI 클라우드 데이터센터를 구축하기 위해 추진됐다. 양사는 오케스트로 여의도 신사옥 부지를 활용해 도심형 엣지 AI 데이터센터를 조성하고 이를 고객 전용 소버린 AI 클라우드 데이터센터로 구현할 계획이다. 여의도에 조성될 이 센터는 5메가와트(MW)급 규모로, GPU 기반 대규모 AI 워크로드와 국산 AI 반도체(NPU), 국산 거대언어모델(LLM)까지 연계할 수 있도록 설계된다. 외부 클라우드나 공용 자원에 의존하지 않는 전용 환경을 통해 고객이 데이터와 운영 정책을 직접 설정하고 관리할 수 있는 안전한 프라이빗 소버린 AI 환경을 구현하는 것이 목표다. 특히 랙당 최대 30키로와트(kW)를 수용할 수 있는 고밀도 전력·냉각 설계와 수냉식 냉각 설비를 적용해 고성능 GPU 운영에 필요한 대규모 AI 전용 인프라를 구현하는 것이 강점이다. 랙 후면 도어 열교환기(RDHx) 방식을 적용해 공랭 기반 장비의 배기열을 수냉으로 제거하는 구조로 설계해 고밀도 GPU 환경에서도 열을 효과적으로 제어할 수 있다는 설명이다. 오케스트로는 해당 데이터센터에 자사 AI·클라우드 풀스택 솔루션을 적용해 AI 서비스부터 클라우드 인프라, 통합 운영 관리까지 하나의 아키텍처로 제공할 계획이다. 이를 통해 고객은 자체 데이터센터를 구축하거나 별도 운영 인력을 투입하지 않고도 통합된 소프트웨어·하드웨어·상면 서비스를 기반으로 프라이빗 AI 인프라를 운영할 수 있다. 해당 데이터센터의 설계·구축은 DCK가 전담한다. 양사는 개발·인허가부터 설계·조달·시공(EPC), 운영, 영업에 이르기까지 데이터센터 구축 전 과정에 걸쳐 협력한다. DCK는 전국 주요 거점에서 AI 특화 데이터센터 개발을 추진해 왔으며 최근 수도권 내 도심형 엣지 AI 데이터센터 인허가를 확보하는 등 데이터센터 설계·구축 역량을 보유 중이다. 오케스트로는 이번 협약을 통해 여의도 도심형 엣지 AI 데이터센터를 기반으로 한 소버린 AI 데이터센터 구축을 단계적으로 확대할 방침이다. DCK가 보유한 마곡·청담 AI 데이터센터에도 자사 AI·클라우드 풀스택 솔루션을 적용해 산업별 AI 인프라 수요에 대응할 계획이다. 김범재 오케스트로 대표는 "여의도 신사옥에 소버린 AI 클라우드 데이터센터를 구축하는 것은 우리 AI 인프라 전략을 구체화하는 중요한 과정"이라며 "고밀도 전력·냉각 설계를 통해 고성능 GPU를 안정적으로 운영할 수 있는 프라이빗 AI 데이터센터를 구축하고 주요 거점으로 단계적 확장해 소버린 AI 환경 구축을 본격화할 것"이라고 말했다.

2026.01.28 17:00한정호 기자

메가존클라우드, 하나은행과 디지털 혁신 금융 서비스 발굴 '맞손'

메가존클라우드가 하나은행과 인공지능(AI)·클라우드·데이터 사이언스 등 디지털 신기술을 접목한 혁신 금융 서비스 공동 발굴에 나선다. 메가존클라우드는 지난 23일 서울 중구 하나은행 을지로 본점에서 하나은행과 AI 클라우드 시장 내 상호 협업과 금융 서비스 지원을 위한 전략적 업무협약(MOU)을 체결했다고 26일 밝혔다. 이날 체결식에는 이주완 메가존클라우드 이사회 의장과 이호성 하나은행장이 참석했다. 이번 협약을 통해 양측은 정부의 글로벌 AI 3강 비전에 따른 AI 데이터센터 구축을 위해 메가존클라우드가 도입 예정인 대규모 그래픽처리장치(GPU)·신경망처리장치(NPU) 서버 수입과 관련한 하나은행의 수출입 금융 지원을 추진한다. 아울러 금융 서비스, 클라우드, AI 등 양사가 보유한 기술과 서비스를 활용한 융복합 비즈니스 모델 발굴 등에 지속 협력할 방침이다. 특히 하나은행은 GPU·NPU 서버 수입과 관련한 금융 지원과 별도로 직·간접 지분 투자도 추진할 계획이다. 이를 통해 메가존클라우드는 아시아 최대 클라우드 관리 서비스 기업(MSP) 입지와 기술 경쟁력을 강화한다는 목표다. 또 GPU 수급에 어려움을 겪고 있는 국내 빅테크·반도체 기업의 성장 촉진도 도모할 방침이다. 메가존클라우드 황인철 최고매출책임자(CRO)는 "우리 강점인 멀티·하이브리드 클라우드 운영 역량과 AI 특화 플랫폼을 하나은행의 금융 데이터들과 겹합해 AI 금융 특화 솔루션을 만들고 금융 특화 AI 데이터센터 활성화를 가속화할 예정"이라고 밝혔다.

2026.01.26 16:14한정호 기자

씨플랫폼, 스칼리움과 AI 인프라 운영 시장 선점 '박차'

씨플랫폼이 국내 인공지능(AI) 인프라 운영 시장을 선점하기 위해 파트너 생태계를 구축하고 박차를 가한다. 씨플랫폼 스칼리움과 국내 총판 파트너십을 강화하고 AI 프로덕션 레이어 시장 공략을 본격화한다고 21일 밝혔다. 이번 파트너십 강화는 스크림이 올해 사명을 스칼리움으로 변경함에 따라 추진됐다. 양사는 단순한 브랜드 전환을 넘어 개발된 AI 모델을 실제 서비스 환경에서 끊김 없이 구동시키고 데이터 수집부터 전처리·서빙·관측까지 전 과정을 안정적으로 연결하는 표준 운영 층인 AI 프로덕션 레이어 확산을 위해 협력한다. 이를 통해 지연 시간 단축 및 처리량 극대화는 물론 전력 대비 성능 등 엄격한 서비스 수준 협약(SLA)을 보장하는 최적의 운영 환경을 공급할 계획이다. 스칼리움은 데이터를 중간 단계에서 복사하거나 변환하지 않고 스토리지에서 그래픽처리장치(GPU) 메모리로 직접 전송해 CPU 병목과 불필요한 시스템 부하를 줄이는 제로 카피 방식을 구현한다. 엔비디아 GDS 기술을 활용한 이 방식은 GPU 유휴화 현상을 해소하고 와트당 처리량을 극대화해 기업 총소유비용(TCO) 절감에 기여한다. 씨플랫폼은 국내 독점 총판으로서 고객과 파트너사가 스칼리움의 기술력을 즉각적으로 체감할 수 있도록 다각적인 지원 프로그램을 가동한다. ▲산업별 특화 레퍼런스 패키지 구성 ▲기술·영업 역량 강화 ▲성능 검증(PoC) 프로그램 등을 단계적으로 제공해 브랜드 전환에 따른 시장 기대를 확신으로 바꾼다는 전략이다. 특히 원본 데이터를 AI 모델이 이해하기 쉬운 특징으로 변환·가공하는 '피처 엔지니어링' 단계를 포함해 대규모 분석(OLAP), 미니배치 추론 등 다양한 워크로드를 단일 운영 레이어에서 최적화할 수 있도록 지원할 예정이다. 이를 통해 온프레미스부터 클라우드, 엣지에 이르기까지 일관된 운영 모델을 제시하며 기업 하이브리드 AI 전략을 지원할 계획이다. 씨플랫폼은 이번 발표를 기점으로 ▲아키텍처 및 운영 가이드 제공 ▲데이터 레이크·웨어하우스 및 ML옵스 솔루션과의 개방형 통합 가속화 ▲하이브리드 전개 지원 등을 추진하며 국내외 산업별 주요 고객을 대상으로 상용화 프로젝트 협력을 확대해 나갈 예정이다. 배근태 씨플랫폼 대표는 "이제 국내 AI 시장의 관건은 단순 도입을 넘어 운영 단계에서의 실질적인 성과 도출에 있다"며 "스칼리움과의 강화된 파트너십을 통해 단순한 솔루션 공급을 넘어 차별화된 GPU 네이티브 AI 오퍼링을 선보임으로써 성능과 전력 효율, 비용 측면에서 고객에게 즉각적인 가치를 제공하겠다"고 강조했다. 박찬호 스칼리움 한국지사장은 "우리는 제로 카피 데이터 흐름과 GPU 병렬성을 통해 데이터를 가장 경제적인 비즈니스 가치로 전환하는 표준을 제시하고 있다"며 "씨플랫폼의 파트너 에코시스템과 전문성을 결합해 국내 AI·ML 데이터 분석 시장의 AI 프로덕션 레이어 표준을 함께 만들어가겠다"고 밝혔다.

2026.01.21 15:50한정호 기자

NHN클라우드, 크래프톤 GPU 클러스터 사업 수주…운영 기술력 입증

NHN클라우드가 대규모 그래픽처리장치(GPU) 클러스터를 서비스형 GPU(GPUaaS)로 구축·운영하는 기술력과 역량을 입증했다. NHN클라우드는 크래프톤이 발주한 GPU 클러스터 사업 최종 사업자로 선정돼 계약을 체결하고 GPUaaS 기반 인프라를 제공한다고 19일 밝혔다. 이번 사업은 크래프톤이 지난해 10월 인공지능(AI) 퍼스트를 경영 핵심 전략으로 선언한 이후 AI 활용을 본격 확대하는 과정에서 증가하는 AI 연산 수요에 대응하기 위해 추진됐다. GPU 클러스터는 AI 플랫폼과 데이터 통합·자동화 기반 고도화 등 중장기 AI 전략을 안정적으로 실행하기 위한 핵심 기반으로, NHN클라우드가 제공하는 GPUaaS를 활용해 인프라를 유연하게 확장하고 운영 효율을 높이는 데 초점을 맞췄다. NHN클라우드는 이번 사업에서 대규모 GPU 클러스터를 제공함으로써 크래프톤의 AI 전략 실행을 뒷받침한다. NHN클라우드가 광주 국가 AI 센터를 자체 설계·구축하고 2021년부터 현재까지 GPUaaS 서비스를 안정적으로 제공해 온 기술력을 보유한 점과 수년간 다수 공공·민간 고객을 대상으로 AI 인프라 서비스를 운영해 온 경험이 이번 사업 파트너로 선정된 배경으로 꼽힌다. 또 고객 요구사항을 면밀히 분석해 함께 시스템을 설계·구축해 온 컨설팅 및 사업 수행 역량도 강점으로 작용했다. NHN클라우드는 이번 사업에서 엔비디아 최신 GPU인 블랙웰 울트라 1천여 장으로 구성된 GPU 팜을 멀티 클러스터 구조로 구성해 대규모 AI 연산 환경을 구축한다. 여기에 XDR-800G급 초고속 인피니밴드 네트워크를 적용해 GPU 간 대용량 데이터를 저지연·고속으로 전송할 수 있도록 설계한다. 이를 통해 여러 GPU를 동시에 사용하는 환경에서도 데이터 전송 지연을 최소화하고 고성능 GPU를 효과적으로 활용해 AI 모델 학습 속도를 높이는 한편 전반적인 AI 작업을 안정적으로 운영할 수 있도록 할 계획이다. NHN클라우드는 GPU 클러스터 구성 요소를 효율적으로 조합해 동일 예산 대비 실제 활용 가능한 GPU 연산 자원을 극대화했으며 장기적인 운영 효율까지 고려한 구조로 설계했다. 특히 GPU를 여러 작업이 함께 사용할 수 있도록 동적 관리 구조를 적용한다. 이를 통해 AI 개발·학습·추론 등 다양한 작업이 동시에 진행되더라도 GPU 자원을 필요에 따라 유연하게 나눠 쓰고 조정할 수 있어 유휴 자원을 최소화하고 전체 클러스터 활용 효율을 높일 계획이다. 이같은 GPU 리소스 동적 관리 방식은 소규모 AI 개발 환경부터 대규모언어모델(LLM) 학습까지 AI 작업 규모와 특성에 맞춰 GPU 활용도를 탄력적으로 조정할 수 있다. 아울러 NHN클라우드는 맞춤형 GPUaaS로 AI 개발과 운영 전반에 유연한 환경을 제공한다. 대규모 AI 학습과 연산 특성에 맞춰 쿠버네티스와 고성능 컴퓨팅(HPC) 환경에 적합한 슬럼 기반 자원 관리 솔루션을 적용해 다양한 AI 작업이 동시에 진행되는 환경에서도 안정적인 운영이 가능하다. 이에 더해 다양한 AI 개발 도구와 외부 시스템을 연동할 수 있는 구조를 갖춰 AI 서비스 개발 속도와 전반적인 업무 효율을 함께 높일 수 있도록 지원할 계획이다. 이번 블랙웰 울트라 GPU 인프라는 NHN클라우드 판교 NCC 센터에 구축된다. 판교 NCC는 고집적 연산을 원활히 운영할 수 있는 전력·냉각 인프라와 우수한 네트워크 연결성을 갖춰 대규모 AI 워크로드 처리에 적합한 시설이다. 해당 인프라는 오는 7월 중 구축을 완료하고 본격 가동될 예정이다. 크래프톤 관계자는 "AI 퍼스트 전략을 추진하는 과정에서 GPU 클러스터는 전사 AI 운영 핵심 기반"이라며 "NHN클라우드의 우수한 GPUaaS 서비스를 통해 AI 연구와 서비스 전반의 확장성과 효율성을 강화할 수 있을 것으로 기대한다"고 말했다. NHN클라우드 관계자는 "이번 프로젝트는 대규모 GPU 클러스터를 GPUaaS 형태로 구축·운영할 수 있는 우리 기술력과 운영 역량을 입증한 사례"라며 "7월 가동을 시작으로 크래프톤의 AI 퍼스트 전략을 실질적으로 뒷받침할 수 있도록 안정적인 클러스터 제공과 운영 기술 지원에 집중하겠다"고 밝혔다.

2026.01.19 10:51한정호 기자

"엔비디아 中 AI 가속기 시장 점유율, 66%→8% 떨어질 것"

중국 내 AI 가속기 시장에서 엔비디아 점유율이 8%대까지 떨어질 수 있다는 전망이 나왔다. 미국 정부의 첨단 반도체 수출 규제와 중국 업체들이 자체 설계한 추론 반도체 성장으로 엔비디아 의존도가 떨어질 수 있다는 것이다. 16일 닛케이 아시아는 글로벌 투자은행 번스타인 보고서를 인용해 "과거 중국 내 AI 가속기 시장에서 엔비디아 점유율은 66%였지만 앞으로 수년 내 8%까지 떨어질 수 있다"고 보도했다. 번스타인 보고서에 따르면 중국 내 반도체 제조사들은 AI 관련 GPU와 각종 가속기를 자체 개발하고 있으며 자국산 업체들의 점유율이 80%를 넘어설 수 있다. 실제로 현재 중국 내에서는 화웨이와 함께 무어스레드 등 두 업체가 두각을 나타내고 있다. 최근 중국 내 대표적 AI 스타트업으로 꼽히는 지푸AI는 화웨이 어센드 칩만 활용해 멀티모달 AI 모델을 훈련하는 데 성공하기도 했다. 미국 정부는 2020년 이후 중국 시장 대상으로 AI 가속과 머신러닝, 딥러닝용 GPU 수출 규제를 지속적으로 강화하고 있다. 2022년 10월 조 바이든 행정부는 엔비디아 A100, H100 등 GPU를 포함해 AMD 제품까지 수출 규제 대상에 포함시켰다. 당시 조 바이든 행정부는 연산 성능이나 대역폭 등 성능을 낮추는 선에서 수출을 허용했지만 지난 해 초 출범한 도널드 트럼프 2기 행정부는 이를 한층 강화했다. 지난 13일 미국 정부는 블랙웰 아키텍처 기반 H200 칩의 중국 수출을 비 군사적 목적으로, 미국 내 고객사에 판매하는 물량 중 50%만 허용하기로 했다. 하지만 이번에는 중국 정부가 H200 구매를 제한하고 있다. 미국의 수출 제한 조치는 중국 시장에서 엔비디아의 경쟁력을 약화시키고 있다. 젠슨 황 엔비디아 CEO는 여러 공개 석상에서 기회가 있을 때마다 이와 관련된 발언을 내놓고 있다. 젠슨 황 CEO는 작년 5월 컴퓨텍스 타이베이 2025 기간 중 기자간담회에서 "중국은 세계 AI 연구자의 50%가 모여 있고, 세계 2위 컴퓨터 시장이지만 이를 다루는 미국 정부의 정책은 잘못됐다"고 비판했다. 지난 해 10월 진행된 컨퍼런스에서는 한 발 더 나아가 "미국의 반도체 수출 규제에 따라 중국 본토 기업에 첨단 제품을 판매할 수 없게 되면서, 중국 내 첨단 반도체 시장 점유율이 95%에서 0%로 떨어졌다. 현재 중국 사업은 개점휴업 상태"고 밝히기도 했다.

2026.01.18 12:20권봉석 기자

GS리테일이 선택한 '카카오클라우드'…AI 운영비 35%↓

카카오엔터프라이즈가 카카오클라우드를 기반으로 한 유통 현장의 실질적 비용 절감과 기술 고도화에 박차를 가한다. 카카오엔터프라이즈는 GS리테일이 운영하는 홈쇼핑 GS샵의 AI 검색·추천 시스템을 카카오클라우드 기반으로 지원 중이라고 15일 밝혔다. GS리테일은 GS샵을 비롯해 편의점 GS25, 슈퍼마켓 GS더프레시 등 주요 유통 채널을 운영하는 종합 유통기업이다. 이 가운데 GS샵은 데이터 파이프라인 구축부터 모델 서빙, 품질 모니터링까지 AI·머신러닝 운영(MLOps) 전반에 대한 자체 역량을 기반으로 검색·추천 시스템을 고도화해 왔다. GS리테일은 2024년부터 카카오클라우드 그래픽처리장치(GPU) 인스턴스와 쿠브플로우를 활용해 검색·추천 시스템과 분석 환경을 운영 중이다. 지난해 5월부터는 카카오클라우드에서 학습한 텍스트 임베딩 모델을 적용해 의미 기반 검색을 구현했으며 사용자 행동 데이터를 바탕으로 협업 필터링(CF)과 시퀀스 모델을 결합한 추천 모델을 통해 검색 품질을 개선했다. 이 같은 전환을 통해 GS리테일은 검색·추천 모델 학습과 운영 비용을 월평균 약 35% 절감하는 동시에 모델 실험 사례 수를 40% 이상 늘렸다. 기존 대비 약 5배 많은 GPU 메모리를 활용할 수 있게 되면서 다양한 실험이 가능해졌고 검색·추천 모델 성능 개선 속도도 빨라졌다. GS리테일은 유동적인 GPU 수요 대응과 환율 변동 리스크 최소화를 위해 카카오클라우드를 선택했다. 기존 글로벌 클라우드는 GPU 리소스를 사전에 예약 구매해야 해 유연성이 떨어졌고 환율 변동 시 예산 운용에 부담이 있었다. 반면 카카오클라우드는 GPU 리소스를 최소 단위로 구성해 필요에 따라 확장할 수 있어 비용 예측과 안정적인 예산 집행이 가능했다는 설명이다. GS리테일 김요한 AX본부 홈쇼핑AX부문장은 "기존 검색·추천 시스템에서 사용하던 쿠브플로우 기반 파이프라인을 그대로 카카오클라우드로 이전해 활용할 수 있었고 유연성과 확장성 측면에서 매우 만족스러웠다"며 "앞으로 검색·추천 분야에서 고객 여정 단계별 개선에 집중해 AI 에이전트 기반 대화형 쇼핑 서비스, 초개인화 추천과 고객별 맞춤형 동적 사용 경험을 제공하고자 노력을 다할 것"이라고 말했다. 카카오엔터프라이즈 이용민 클라우드부문장은 "GS리테일의 AI 검색·추천 시스템 혁신 사례는 유통 분야에서 카카오클라우드를 기반으로 비용 절감과 실험 수 증가라는 정량적인 성과를 동시에 달성한 모범 사례"라며 "고객 필요에 따라 세분화된 선택지를 제공하는 클라우드 전략 파트너로서 고객이 핵심 경쟁력에 집중할 수 있는 AI 인프라 환경을 조성하는 데 최선의 노력을 다할 것"이라고 강조했다.

2026.01.15 14:05한정호 기자

  Prev 11 12 13 14 15 16 17 18 19 20 Next  

지금 뜨는 기사

이시각 헤드라인

6년 만에 더 커지고 똑똑해진 신형 투싼…10월 국내 출격

트럼프 "'AI 군' 창설…인공지능 이름도 바꾸자"

전력기기 호황에 노조 생긴 효성重…내년 역대급 성과급 기대감↑

[ZD브리핑] 미중 정상회담·김범수 항소심 결심…추석 앞 산업·IT 이슈는

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.