• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'DGX-A100 GPU'통합검색 결과 입니다. (563건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

과기정통부, 내년 AI 예산 85% 증액…독자모델·산업·국민 AI 키운다

과학기술정보통신부가 내년 인공지능(AI) 예산을 9조원대로 끌어올리며 AI 경쟁력 확보에 재정 투입을 대폭 확대한다. 그래픽처리장치(GPU)와 데이터 등 기반 투자뿐 아니라 독자 AI 모델 개발, 산업·지역 인공지능 전환(AX), 국민 대상 AI 서비스까지 지원 범위를 넓히면서 AI 정책의 무게중심도 인프라 구축에서 산업·서비스 확산으로 한층 넓어지는 모습이다. 1일 과기정통부가 발표한 '2027년도 예산안'에 따르면 내년 과기정통부 AI 예산은 9조 4211억원으로, 올해 5조938억원보다 약 84.9% 늘어난다. 정부 전체 AI 예산 가운데 과기정통부가 담당하는 비중은 57%다. 과기정통부 전체 예산도 올해 23조8204억원에서 내년 29조6476억원으로 24.5% 증가한다. 지난해 편성한 2026년도 예산안에서는 첨단 GPU 1만5000장 추가 확보와 국가AI컴퓨팅센터 설립 등 연산 인프라 확충에 예산이 대거 투입됐다. 국산 신경망처리장치(NPU)와 피지컬 AI, 독자 AI 파운데이션 모델, 지역 AX 사업도 함께 추진했지만, 대규모 재정은 컴퓨팅 자원 확보에 집중됐다. 이에 과기정통부는 내년에 인프라 투자를 더 늘리면서 모델 개발과 데이터, 인재, 서비스 확산까지 투자 범위를 넓힐 방침이다. 가장 많은 예산이 배정된 분야는 '최상위 AI 모델·기술 확보'로, 관련 예산은 올해 2조6146억원에서 내년 5조5937억원으로 두 배 이상 증가한다. GPU 확충 예산은 올해 2조841억원에서 내년 3조8500억원으로 늘어난다. 특히 정부는 최상위급 독자 AI 모델 개발을 위해 엔비디아의 차세대 GPU '베라 루빈' 1만 장을 확보하는 데 주력할 계획이다. 데이터 투자 증가폭은 더 크다. 프론티어급 AI 개발을 위한 데이터 경쟁력 강화 지원 예산은 올해 300억원에서 내년 8000억원으로 확대된다. 생성AI 프론티어 인재 양성에도 250억원을 새로 편성했다. GPU 중심이던 AI 경쟁력 확보 정책을 데이터와 고급 인재까지 확장하는 것이다. 차세대 AI 기술 개발 투자도 확대한다. 경량·저전력 AI와 온디바이스 AI, 자율에이전트, 시계열 파운데이션 모델 등을 개발하고 AI 안전 기술과 차세대 범용 AI 연구도 강화한다. AI 안전 기술개발 예산은 79억원에서 152억원으로, 인간지향적 차세대 도전형 AI 기술개발은 70억원에서 160억원으로 각각 늘어난다. AI 보안 분야에는 신규 사업이 대거 포함됐다. 사이버보안 AI 학습 기반 구축에 500억원, 'AI 사이버 쉴드 돔' 기술개발에 550억원, 중소기업 AI 위협 대응 서비스 지원에 700억원을 투입한다. AI 생태계 보안 내재화 핵심기술 개발 예산도 36억원에서 72억원으로 확대한다. AI를 실제 서비스와 산업 현장에 적용하기 위한 투자도 늘어난다. AI 서비스·활용 분야 예산은 올해 1조2067억원에서 내년 1조8611억원으로 증가한다. 범용 AI 서비스부터 지역·산업 AX, 과학기술 분야 AI 적용까지 포괄한다. 대표 신규 사업은 '모두의 AI'다. 정부는 국내 AI 모델로 개발한 범용 AI 챗봇과 공공 AI 에이전트를 국민이 이용할 수 있도록 지원하고, 이용자가 필요한 AI 에이전트를 직접 활용하거나 만들 수 있는 환경도 구축한다. 전국민 AI 서비스 보편적 활용 지원 사업에는 내년에 2500억원을 신규 편성했다. 지역 AX 투자도 크게 늘어난다. 대경(대구-경북권)·서남(광주-전남)·전북·동남(부산-울산-경남) 등 4대 권역 AX 연구개발(R&D) 예산은 올해 1770억원에서 내년 3345억원으로 약 89% 증가한다. 대경은 바이오·로봇, 서남은 모빌리티·에너지, 전북은 AI 공장 플랫폼, 동남은 정밀제조를 중심으로 AI 적용을 확대한다. 의료와 제조 분야에서도 신규 사업을 시작한다. AI 통합 이동형 병원 진단 지원 고도화·실증에 35억원, 이차전지 특화 역설계 AI 에이전트 구축에 67억원을 투입한다. 에이전틱 AI 트윈 핵심기술 개발에는 40억원을 배정한다. 민간 AI 개발자를 채용해 행정과 국민 서비스를 개선하는 '국민AI서비스혁신추진단'에도 운영비 68억원을 편성했다. AI 인재와 국민 활용을 포함한 'AI 포용사회' 예산은 올해 9744억원에서 내년 1조1707억원으로 늘어난다. 글로벌 AI 협력과 고급 인재 양성, 국민 AI 역량 강화 등이 주요 사업이다. AI중심대학은 올해 18개에서 내년 67개로 확대한다. 관련 예산도 1180억원에서 1850억원으로 늘어난다. 인공지능융합혁신인재양성 사업은 210억원에서 936억원으로, AI 최고급 신진연구자 지원은 340억원에서 540억원으로 증가한다. 산학 협력 기반 AX대학원도 신설한다. 전 국민의 AI 활용을 지원하는 사업도 확대한다. 전국민 AI 활용 서비스 개발환경 조성 예산은 125억원에서 151억원으로, 스마트빌리지 보급·확산은 887억원에서 1064억원으로 늘어난다. 모두의 AI 경진대회에는 올해보다 60억원 늘어난 190억원을 투입한다. 이처럼 예산 규모가 빠르게 커지는 만큼 재정 집행 구조를 둘러싼 논란이 재발할 가능성도 있다. 앞서 올해 과기정통부 AI 예산 가운데 GPU 구매 지원에 2조원 이상이 배정되면서 정부 AI 투자가 해외 GPU 기업과 대규모 사업을 수행할 수 있는 일부 기업에 집중된다는 지적이 제기된 바 있다. 내년에도 GPU 투자가 대폭 확대되는 만큼, 재정 집행의 수혜가 특정 기업에 쏠리지 않도록 사업 구조를 설계할 필요성도 커질 것으로 보인다. 반면 글로벌 최상위 수준의 AI 모델을 개발하려면 대규모 연산 자원 확보가 선행돼야 한다는 시각도 있다. 정부가 추진하는 프론티어급 독자 AI 모델은 학습 단계부터 막대한 GPU가 필요한 만큼 국내 기업이 자체적으로 감당하기 어려운 비용을 재정으로 뒷받침할 필요가 있다는 것이다. 이에 정부도 모델 개발 속도를 높이기 위해 기존에 확보한 GPU 7000장을 우선 투입하고 산·학·연 민간 임차 물량 8000장을 추가 활용한 뒤 베라루빈 1만 장을 새로 확보할 계획이다. 동시에 내년에는 데이터와 AI 반도체, 피지컬 AI, 지역 AX, 중소기업 AI 보안 서비스 등으로도 지원 범위를 넓힐 예정이다. 또 예산 확대가 실제 국내 AI 기업의 사업 기회와 서비스 확산, 산업 생산성 향상으로 이어지도록 집행 구조를 설계하는 일도 중요해질 것으로 보인다. 업계 관계자는 "GPU와 데이터에 대한 대규모 투자는 프론티어 AI 경쟁을 위해 필요하지만, 실제 성과를 내려면 모델 개발 이후 서비스와 산업 적용까지 이어지는 생태계가 함께 커져야 한다"며 "중소 AI·소프트웨어 기업이 실증과 사업화 단계에서 참여할 수 있는 구조를 만드는 것이 중요하다"고 말했다.

2026.09.01 12:21장유미 기자

정부, 독자 AI에 5조6천억원 쏟는다…GPU 1만장 확충해 '프론티어' 도전

정부가 독자 인공지능(AI) 모델과 차세대 AI 기술 확보에 내년 약 5조 6000억원에 달하는 예산을 투입한다. 지난해부터 속도를 높여온 그래픽처리장치(GPU) 확충과 독자 AI 파운데이션 모델 개발을 발판으로 내년에는 첨단 GPU 1만 장과 대규모 학습 데이터를 추가 투입해 글로벌 최상위급 프론티어 AI 모델 개발에 도전한다는 목표다. 과학기술정보통신부는 2027년도 예산안 중 '최상위 AI모델·기술 확보' 분야에 5조 5937억원을 편성했다고 1일 발표했다. 올해 2조 6146억원보다 2조 9791억원 늘어난 규모로 1년 만에 두 배 이상으로 확대됐다. 가장 큰 비중을 차지하는 부문은 AI 컴퓨팅 인프라 확충이다. 정부는 독자 AI 모델 개발 등에 활용할 대규모 GPU 1만 장을 추가 확보하기 위해 'AI 컴퓨팅자원 활용기반 강화' 사업 내 GPU 확충 예산을 올해 2조 841억원에서 내년 3조 8500억원으로 늘릴 예정이다. 모델 성능을 좌우하는 데이터 투자도 크게 확대한다. 프론티어급 AI 개발을 위한 데이터 경쟁력 강화 지원 예산은 올해 300억원에서 내년 8000억원으로 약 27배 늘어난다. 글로벌 수준의 생성형 AI 연구를 이끌 인재를 확보하기 위한 '생성AI 프론티어 인재' 사업에도 신규로 250억원을 투입한다. GPU·데이터·인재를 묶어 독자 AI 모델 경쟁력을 끌어올리는 전략으로 풀이된다. 정부는 지난해부터 대규모 AI 컴퓨팅 인프라 확충 속도를 높여왔다. 지난해 약 1조 4600억원을 투입한 GPU 확보 사업을 통해 네이버클라우드와 NHN클라우드, 카카오가 총 1만 3136장의 고성능 GPU를 구축했다. 사업자 자체 활용분과 정부 활용분 GPU를 통해 국가 AI 프로젝트와 산학연을 지원하고 있다. 특히 올해 사업에선 2조 805억원을 투입해 엔비디아 차세대 AI 플랫폼 '베라루빈'을 포함한 최신 GPU 9704장 확보에 나섰다. 수행 사업자로는 네이버클라우드·삼성SDS·엘리스그룹을 선정했고 B300 서비스를 우선 개시한 후 내년 상반기부터 베라루빈 기반 컴퓨팅 자원을 공급할 예정이다. 확충한 GPU는 독자 AI 모델 개발에 투입되고 있다. 정부가 추진 중인 '독자 AI 파운데이션 모델(독파모)' 프로젝트에선 최근 2차 단계 평가를 거쳐 업스테이지·SK텔레콤·LG AI연구원 등 3개 팀이 다음 단계에 진출했다. 정부는 이들 팀에 엔비디아 B200 GPU를 각각 1000장씩 총 3000장을 지원해 모델 고도화를 뒷받침할 계획이다. 독파모 사업은 해외 AI 모델 의존도를 낮추고 국내에서 독자적으로 개발·고도화할 수 있는 AI 모델을 확보하기 위해 지난해 시작됐다. 정부는 국내 모델 성능이 아직 중국의 주요 개방형 AI 모델에 다소 못 미치는 것으로 보고 올 하반기 추가 학습과 고도화를 통해 격차를 좁힌 뒤 내년에는 글로벌 최상위 프론티어 모델 개발 단계로 올라선다는 목표다. 내년 예산은 모델 개발뿐 아니라 현재 AI 기술의 한계를 넘어설 차세대 기술에도 투입된다. 경량·저전력 AI 기술 개발 예산을 90억원에서 120억원으로 늘리고 자율행동체 온디바이스 핵심기술 개발에는 100억원을 투입한다. 시계열 파운데이션 모델 개발 사업도 신규 추진하며 AI 안전 기술 개발에는 올해 79억원보다 약 두 배 많은 152억원을 배정했다. AI를 활용한 사이버보안 기술 투자도 확대한다. 사이버보안 AI 학습 기반 구축에 500억원을 신규 투입하고 AI가 해킹을 탐지·방어하는 'AI 사이버 쉴드 돔' 기술 개발에 550억원, 중소기업 AI 위협 대응 서비스 지원에 새롭게 700억원을 편성했다. 최상위 AI 모델 확보와 함께 이를 안전하게 활용할 수 있는 기술 기반까지 구축한다는 구상이다. 업계 관계자는 "글로벌 AI 경쟁에선 GPU와 고품질 데이터에 얼마나 지속 투자할 수 있느냐가 중요한 만큼 정부가 관련 예산을 대폭 확대한 것은 긍정적"이라며 "확보한 컴퓨팅 자원을 실제 AI 모델 성능 향상으로 연결할 수 있도록 장기적인 지원과 효율적인 자원 배분이 함께 이뤄지길 기대한다"고 말했다. 정부는 내년 대규모 GPU와 데이터, 인재 투자를 바탕으로 독자 AI 모델의 글로벌 경쟁력을 끌어올린다는 방침이다. 그간 기업들이 독파모 프로젝트를 통해 축적한 모델 개발 경험에 정부의 컴퓨팅 인프라 지원을 더해 글로벌 최상위급 프론티어 모델 개발에 도전한다는 목표다. 배경훈 부총리 겸 과기정통부 장관은 지난달 25일 이재명 대통령 주재 국무회의에서 "현재는 중국의 개방형 AI 모델에 다소 못 미치는 상황이지만 올 하반기에는 이를 추격해 달성할 것"이라며 "내년에도 보다 많은 GPU와 데이터를 투입해 최상위급 프론티어 모델 개발에 도전하겠다"고 강조했다.

2026.09.01 12:20한정호 기자

엔비디아 RTX 스파크, 게임 호환성 높여 Arm PC 시장 공략

엔비디아가 이르면 9월부터 글로벌 시장에 공급할 Arm 기반 윈도용 플랫폼 'RTX 스파크' 출시를 앞두고 게임 개발사 지원 확보에 나섰다. 기존 Arm 기반 윈도 PC 시장에서 선점 효과를 누려온 퀄컴과 차별화하기 위해 지포스 GPU의 강점을 적극 활용하려는 시도다. 엔비디아는 최근 독일 쾰른에서 열린 '게임스컴 2026'을 통해 일렉트로닉 아츠(EA), 유비소프트, 엠바크 스튜디오 등이 RTX 스파크 플랫폼 지원에 합류했다고 밝혔다. F1 25, 아크레이더스 등 지원 대상 게임도 구체화됐다. 멀티플레이어 환경에서 핵(Hack) 등 부정행위를 차단하는 안티치트 기술도 RTX 스파크를 지원할 예정이다. RTX 스파크 강점 'GPU' 앞세워 게임 생태계 확보 RTX 스파크에 내장된 블랙웰 GPU의 강점을 살리려면 기존 출시 게임과 호환성 확보가 중요하다. 엔비디아는 국내외 주요 게임 개발사와 20년 넘게 긴밀히 협력하면서 PC 게임 시장에서 상당한 기반을 확보했다. 특히 AI 기반 프레임 생성 기술인 DLSS와 광원 효과를 실제에 가깝게 묘사하는 레이 트레이싱 등 엔비디아의 그래픽 기술을 그대로 활용할 수 있다는 점은 퀄컴 대비 차별화 요소가 될 수 있다. 엔비디아는 RTX 스파크를 AI와 콘텐츠 제작뿐 아니라 게임까지 아우르는 플랫폼으로 내세우고 있다. 2560×1440 화소에서 AAA 게임을 초당 100프레임 이상으로 구동 가능하다는 것이 엔비디아 설명이다. 게임 호환성 확대, 퀄컴에도 기회 엔비디아보다 한 발 앞서 Arm용 윈도 PC 플랫폼을 공급해 온 퀄컴 역시 게임 호환성 문제를 해결하기 위해 많은 노력을 기울였다. 퀄컴은 이미 작년 포트나이트를 개발하는 에픽게임스와 협업해 안티치트 솔루션 '이지 안티치트'의 Arm 호환성도 확보했다. 이지 안티치트는 에이밍 핵이나 맵핵 등 게임 내 부정행위를 탐지·차단하는 데 활용된다. 주요 게임사들이 엔비디아와 협력해 Arm 환경 지원을 늘리는 것은 퀄컴에도 이로운 일이다. 게임 호환성이 개선될수록 스냅드래곤 기반 윈도 PC의 활용 범위가 넓어지기 때문이다. 퀄컴, 아드레노 GPU 성능 향상 과제로 부상 다만 게임 호환성 확대가 퀄컴에 마냥 긍정적이지만은 않다. 스냅드래곤 X SoC에 내장되는 아드레노 GPU 성능을 높여야 한다는 과제가 생겼기 때문이다. 일례로 스냅드래곤 X2 엘리트 익스트림에 내장된 아드레노 X2 GPU는 전 세대보다 성능이 약 두 배 향상됐다. 그러나 인텔 Xe3, AMD 라데온 등 기존 x86 프로세서 제조사의 내장 GPU와 비교하면 절대적인 성능이 떨어진다는 평가를 받는다. 2012년부터 작년까지 퀄컴에서 수석부사장(SVP)으로 재직하며 아드레노 GPU 개발에 깊게 관여했던 에릭 데머스는 올 초 인텔로 이적했다. 아드레노 GPU 성능을 높여야 하는 퀄컴에는 상당한 부담 요인이다. "에이수스·MSI, 초기 공급 물량 예약 마감" RTX 스파크 기반 PC는 이르면 오는 9월을 시작으로 시장에 공급될 예정이다. 레노버, HP, 델테크놀로지스, 에이수스, 마이크로소프트 등 주요 업체가 노트북과 미니 PC 등을 공급할 예정이다. 대만 매체 경제일보는 31일 공급망 관계자를 인용해 "1차 출시 업체로 참여하는 에이수스와 MSI는 초기 공급 물량 예약을 마치고 엔비디아에 RTX 스파크 추가 공급을 요청했다"고 보도했다. 이어 "MSI 역시 중국 본토와 대만, 미국 고객들의 적극적인 주문으로 고급형 N1X 칩을 탑재한 노트북의 초도 물량 예약이 끝나 엔비디아에 추가 물량 공급을 요청중"이라고 설명했다.

2026.08.31 16:42권봉석 기자

NHN클라우드, 포항 AI 데이터센터 20MW 임차…GPU 사업 가속

NHN클라우드가 인공지능(AI) 그래픽처리장치(GPU) 사업 확대를 위해 경북 포항에 20메가와트(MW) 규모 데이터센터 인프라를 확보한다. GPU 수요 증가에 대응해 내년 말까지 총 30MW 규모 데이터센터 인프라를 추가 확보하고 국내외 AI 인프라 사업 확대에 속도를 낸다는 계획이다. 31일 금융감독원 전자공시시스템에 따르면 NHN은 자회사 NHN클라우드가 AI GPU 사업 확장을 위해 에이아이팩토리포항피에프브이와 포항 데이터센터 임대차확약서를 체결한다고 공시했다. 임차 대상은 데이터센터 내 20MW에 해당하는 공간과 부대시설이며 임대 기간은 임차 개시일로부터 60개월이다. 이번 계약은 NHN클라우드가 추진하는 AI 데이터센터 인프라 확충 계획의 일환이다. NHN클라우드는 AI·클라우드 인프라 경쟁력을 강화하기 위해 내년 말까지 총 30MW 규모의 데이터센터 인프라를 추가 확보할 계획이다. 포항에서 20MW를 확보하고 이 외의 10MW는 임대가 아닌 자체 구축할 예정으로, 현재 입지를 검토 중이다. NHN은 데이터센터 임차와 관련해 NHN클라우드가 부담하는 채무에 대한 보증도 제공한다. 보증금액은 1101억 1400만원으로, 회사 2025년 말 연결 기준 자기자본 1조 7708억원의 6.22%에 해당한다. 보증 기간은 지난 28일부터 2028년 2월 28일까지다. 다만 NHN클라우드가 임대차확약서에 따라 실제 부담할 채무액은 아직 확정되지 않았다. NHN은 임대 조건 등을 감안해 산정한 모회사 보증금액 1101억 1400만원을 채무금액으로 기재했다. 이번 보증을 포함한 NHN의 채무보증 잔액은 5184억여원이다. NHN은 NHN클라우드의 시설투자를 위한 금융 지원에도 나선다. NHN클라우드가 신한은행에서 차입하는 600억원에 대해 720억원 규모의 연대보증을 제공한다. 보증 기간은 다음 달 3일부터 2034년 9월 3일까지다. 앞서 NHN클라우드는 지난 3월 말 가동을 시작한 서울 양평 리전에서 엔비디아 B200 기반 서비스형 GPU(GPUaaS) 공급을 본격화했다. 이에 힘입어 올해 2분기 NHN클라우드 매출은 전년 동기 대비 85.3%, 전분기 대비 49% 증가했다. NHN클라우드는 데이터센터 인프라뿐 아니라 최신 GPU 확보와 AI 서비스 역량 강화도 병행 중이다. 지난 5월 AI 풀스택 브랜드 '팩토리X'를 공개하고 GPU 인프라 확보와 운영 최적화부터 AI 에이전트 실행 환경까지 아우르는 사업 체계를 구축하고 있다. 기존 데이터센터에는 엔비디아 B300 이상 최신 GPU 도입도 추진할 계획이다. NHN은 공시를 통해 "임대차 계약을 통해 NHN클라우드는 안정적인 데이터센터 인프라를 조기에 확보함으로써, 증가하는 GPUaaS 및 클라우드 서비스 수요에 대응할 수 있는 사업 기반을 강화하고 중장기 매출 성장에 기여할 것으로 기대된다"고 밝혔다. 장기적으로 해외 고객 AI 수요를 겨냥한 글로벌 사업 확대도 추진한다. 김동훈 NHN클라우드 대표는 앞서 2분기 실적 발표 컨퍼런스콜에서 "최근 해외 기업으로부터 GPU 수요가 증가하고 있으며 일부 고객은 조만간 계약할 예정"이라며 "일본 데이터센터 확보를 통해 글로벌 사업 확대를 준비 중"이라고 말했다.

2026.08.31 10:48한정호 기자

美 트럼프 행정부, 中 AI '원격 연산 우회' 차단 추진…태국·싱가포르 정조준

미국 트럼프 행정부가 중국 기업들이 제3국에 위치한 원격 서버를 통해 최첨단 인공지능(AI) 반도체 연산 자원에 접근하는 '규제 허점'을 원천 차단하기 위한 새로운 수출 통제 조치를 검토 중이다. 미국 IT 전문 매체 디인포메이션은 미 정부가 중국 대비 수출 규제 강도가 낮은 태국, 싱가포르 등의 데이터센터를 통한 중국 기업의 원격 연산 접근을 제한하는 신규 규제안을 준비하고 있다고 현지시간 28 보도했다. 미 상무부는 이르면 오는 9월 업계 관계자 및 무역 단체들과 초안을 공유하고 의견 수렴에 나설 것으로 전해졌다. 이번 규제 추진의 핵심 기폭제로는 중국 AI 스타트업 문샷이 최근 공개한 오픈소스 모델 '키미 K3(Kimi K3)'가 지목된다. 앞서 마이클 크라시오스 백악관 과학기술정책실장은 "문샷이 태국에 위치한 엔비디아 서버를 통해 미국의 최신 AI 모델을 증류 및 학습시켜 키미 K3를 개발했다"고 지적한 바 있다. 현재 미국의 대중국 반도체 수출 통제는 2022년 제정된 물리적 하드웨어 중심 규제에 머물러 있어, 해외 클라우드를 통한 원격 연산 자원 임대 행위를 직접 제재하기 어렵다는 맹점이 있었다. 트럼프 행정부는 출범 초기 바이든 정부 시절의 광범위한 'AI 확산 규칙(AI Diffusion Rule)' 집행을 유예한 이후, 산업계 반발로 계층형 라이선스 제도를 철회하는 등 규제 방향성을 두고 혼선을 빚어왔다. 다만 상무부의 신규 규제안이 현실화되더라도 법적 공방은 불가피할 전망이다. 전통적으로 물리적 상품의 수출입 운송을 감독해 온 상무부가 무형의 국경 간 클라우드 서비스까지 관할할 법적 권한이 있는지를 두고 논란이 일고 있기 때문이다. 한편, 대만 사법당국이 엔비디아 직원을 포함해 최첨단 AI 서버 밀반출 일당을 잇달아 기소하는 등 물리적 밀수 단속이 강화되는 가운데, 원격 우회로까지 차단하려는 미국의 이번 조치가 글로벌 AI 인프라 공급망에 미칠 파장에 이목이 집중되고 있다.

2026.08.29 09:30전화평 기자

[AI 고속도로] 엔비디아, AI 클라우드 금융지원 일부 중단…고객사 통제 논란

엔비디아가 인공지능(AI) 클라우드 기업의 인프라 투자를 지원하고 매출 일부를 공유받는 금융지원 사업의 일부 거래를 잠정 중단했다. AI 인프라 생태계 확대를 목표로 고객사 그래픽처리장치(GPU) 투자를 직접 뒷받침해온 가운데, 고객사 사업에 대한 과도한 개입과 반독점 규제 가능성을 둘러싼 우려가 제기된 영향으로 풀이된다. 27일(현지시간) 월스트리트저널에 따르면 엔비디아는 최근 'AI 컴퓨팅 파트너십'을 통해 추진하던 일부 신규 거래를 중단했다. 지난 7월 해당 사업을 공개한 지 두 달도 지나지 않은 시점이다. 정확한 중단 이유는 밝혀지지 않았다. AI 컴퓨팅 파트너십은 상대적으로 자금력이 부족한 AI 클라우드 업체(네오클라우드)가 대규모 GPU 인프라를 구축할 수 있도록 엔비디아가 신용을 지원하는 사업이다. 통상 네오클라우드 기업은 충분한 고객 계약을 확보하기 전부터 GPU와 데이터센터 등에 수십억 달러를 투자해야 해 자금 조달에 어려움을 겪는 경우가 많다. 엔비디아는 이들 업체가 GPU를 임대할 고객을 확보하지 못할 경우 남는 컴퓨팅 용량을 직접 빌리겠다고 약속하는 방식으로 신용을 보강했다. 이를 통해 클라우드 기업은 일정 수준 수익을 보장받고 금융기관에서 인프라 구축에 필요한 자금을 보다 쉽게 조달할 수 있었다. 엔비디아 입장에선 GPU 판매와 클라우드 매출 공유라는 두 가지 수익원을 동시에 확보하는 구조다. 엔비디아는 클라우드 업체에 GPU를 판매한 뒤 해당 GPU를 다른 고객에게 임대해 발생하는 매출 일부를 추가로 받도록 사업을 설계했다. 일부 거래에선 엔비디아가 가져가는 수익 비중도 상당했던 것으로 전해졌다. 엔비디아와 클라우드 업체가 GPU 운영비와 데이터센터 비용, 인건비 등을 고려해 기본 시간당 요금을 정하고 이를 초과해 발생한 매출의 50%를 엔비디아가 가져가는 방식이다. 하지만 사업 초기부터 엔비디아가 클라우드 업체의 영업 방식에 지나치게 관여한다는 지적이 제기됐다. 엔비디아는 일부 업체에 사전에 승인된 고객에게만 GPU를 임대하도록 요구한 것으로 알려졌다. GPU 용량 역시 단일 대형 고객에게 공급하기보다 여러 중소 AI 기업에 분산하도록 선호한다는 입장을 전달했다는 보도도 나왔다. 이에 일부 기업들은 고객을 자유롭게 선택할 수 있어야 한다며 반발한 것으로 알려졌다. 엔비디아 내부에서도 AI 가속기 시장을 주도하는 회사가 고객사 사업 방식까지 통제하는 것으로 비칠 경우 반독점 당국의 조사로 이어질 가능성을 우려한 것으로 전해졌다. AI 컴퓨팅 파트너십의 첫 번째 참여 업체는 호주 AI 클라우드 기업 샤론AI와 퍼머스테크놀로지스다. 샤론AI는 최대 4만 개, 퍼머스테크놀로지스는 최대 17만 개의 엔비디아 GPU를 배치할 계획으로 알려졌다. 이번 일부 거래 중단이 이들 업체와 이미 체결한 계약에 영향을 미치는지는 확인되지 않았다. 사업 규모도 상당하다. 엔비디아는 최근 분기 보고서를 통해 관련 계약에 따른 약정 규모가 360억 달러(약 49조원)에 달한다고 처음 공개했다. 계약 기간은 통상 6년이며 클라우드 업체가 다른 고객에게 GPU 용량을 판매할수록 엔비디아가 부담하는 약정 규모는 줄어드는 구조다. 엔비디아는 해당 사업을 완전히 폐기하기보다 구조를 개편하거나 다른 지원 프로그램에 통합하는 방안도 검토하는 것으로 알려졌다. 콜레트 크레스 엔비디아 최고재무책임자(CFO)는 최근 투자자 대상 컨퍼런스콜에서 수익 공유 사업이 중장기적으로 수십억 달러 규모의 새로운 매출을 창출할 수 있다고 설명했다. 이번 조치는 엔비디아가 자사 GPU 수요를 늘리기 위해 고객사 AI 인프라 투자까지 금융적으로 지원하는 이른바 '순환금융' 구조를 둘러싼 시장 우려가 커지는 가운데 나왔다. 회사는 최근 투자자들의 잠재적 재무 부담 우려에 따라 오픈AI의 미국 오하이오 데이터센터 프로젝트에 제공하려던 금융 보증 규모도 축소한 것으로 전해졌다. 엔비디아 대변인은 "빠르게 성장하는 AI 생태계의 컴퓨팅 접근성을 확대하기 위해 지난 7월 도입한 새로운 사업 모델은 여전히 유지되고 있다"며 "높은 수요에 힘입어 계속 발전하고 있다"고 밝혔다.

2026.08.28 16:06한정호 기자

아마존, 엔비디아 AI칩 200만개 더 산다…생성형AI 수요 대응

아마존이 향후 2년 동안 엔비디아의 인공지능(AI) 반도체 200만개를 추가로 데이터센터에 투입한다. 자체 AI 칩 개발에 막대한 자금을 쏟고 있지만 생성형 AI 수요에 대응하기 위해 엔비디아의 고성능 그래픽처리장치(GPU) 확보도 대폭 늘리는 모습이다. 26일(현지시간) 블룸버그통신 보도에 따르면 아마존과 엔비디아는 아마존이 2027년과 2028년에 엔비디아의 고성능 GPU 약 200만개를 도입한다고 밝혔다. 해당 칩들은 AI 모델을 학습하고 구동하는 데 사용된다. 이는 아마존이 지난 3월 발표한 엔비디아 칩 100만개 도입 계획과 별도다. 당시 아마존은 올해부터 아마존웹서비스(AWS) 데이터센터에 엔비디아 칩을 설치하겠다고 밝혔다. 외신에 따르면 아마존이 이번에 도입하는 제품에는 엔비디아의 블랙웰 울트라와 차세대 제품인 루빈, 루빈 울트라 GPU가 포함된다. 이들 제품의 정가는 개당 최소 수만 달러 수준이 될 것으로 예상된다고 외신은 설명했다. 대형 고객은 할인된 가격으로 공급받을 수 있지만 아마존과 엔비디아는 이번 계약의 구체적인 금액을 공개하지 않았다. 엔비디아 GPU는 생성형 AI 투자 확대의 핵심 인프라로 꼽힌다. 현재 대부분의 대규모언어모델(LLM)을 학습하고 실제 서비스에서 구동하는 데 엔비디아 GPU가 활용되고 있다. 다만 엔비디아의 주요 고객인 아마존과 마이크로소프트(MS), 구글 모회사 알파벳은 동시에 자체 AI 반도체 개발에도 나서고 있다. 각사의 데이터센터 환경에 맞춘 칩을 개발해 비용과 전력 효율을 높이고 이를 고객에게 제공하겠다는 전략이다. 아마존도 자체 반도체 개발 조직인 안나푸르나랩스에 최근 수년간 대규모 투자를 이어왔다. 안나푸르나랩스는 중앙처리장치(CPU)를 비롯해 엔비디아 GPU에 맞서기 위한 AI 가속기 트레이니엄을 개발하고 있다. 아마존은 차세대 트레이니엄 AI 칩에 엔비디아의 네트워킹 기술을 활용할 계획이라고 밝힌 바 있다. 외신은 아마존이 자체 AI 반도체 개발을 확대하면서도 엔비디아 GPU를 대규모로 추가 확보하기로 한 것은 AI 인프라 시장에서 엔비디아 제품에 대한 의존도가 여전히 높다는 점을 보여준다고 전했다.

2026.08.27 08:51류승현 기자

엔비디아, 분기 매출 133조 '예상치 훌쩍'...13분기 연속 기록 경신

엔비디아가 26일(현지시간) 올 2분기(5~7월, 회계연도 기준 2027년 2분기) 예상치를 뛰어넘는 실적을 발표했다. AI 데이터센터 수요 증가 지속으로 전체 매출이 962억 달러를 넘어선 데다 3분기(8~10월) 매출 역시 사상 최초로 1000억 달러(약 140조원)를 넘어설 것으로 전망된다. 엔비디아에 따르면 2분기 매출은 962억 2100만 달러(약 133조 1600억원)로 전년 동기(467억 4300만 달러, 약 64조 6900억원) 대비 두 배 이상 늘어났다. 이는 지난 5월 자체 전망치인 910억 달러(약 125조 9400억원), 시장 전망치인 920억 달러(약 127조 3300억원)를 40억 달러 이상 넘어선 수치다. 영업이익은 637억 3400만 달러(약 88조 2100억원)로 전년 동기(284억 4000만 달러, 약 39조 3600억원) 대비 두 배 이상 늘어났다. 젠슨 황 엔비디아 CEO는 "AI 관련 수요가 폭증하며 새로운 AI 연구소와 스타트업이 잇따라 등장하는 황금기가 열렸고, 여러 프런티어 연구소가 동시에 규모를 확대하고 있다"며 "미국을 포함한 전세계에서 강력한 성장세가 이어지고 있다"고 강조했다. 이어 "AI 인프라 구축은 전속력으로 진행되고 있다. 이제 완전한 생산 체제에 들어간 베라 루빈 AI GPU 시스템은 이런 시대를 뒷받침하기 위해 만들어졌다"고 덧붙였다. 엔비디아는 올 1분기부터 사업 실적을 '데이터센터'와 '엣지 컴퓨팅' 등 두 개 시장으로 구분해 발표한다. 현재와 미래 성장 동력을 보다 명확히 반영하기 위해서라는 것이다. 데이터센터 부문은 ▲글로벌 클라우드 기업과 대형 인터넷 기업 매출을 포함한 '하이퍼스케일(Hyperscale)' ▲AI 클라우드, 산업, 기업 부문을 일컫는 'ACIE'로 구분된다. 데이터센터 부문 매출은 890억 달러(약 12조 3180억원)로 전년 동기 대비 18% 늘어났다. 또 1분기와 마찬가지로 2분기 전체 매출의 92.5%가 데이터센터 부문에서 나왔다. 이 중 하이퍼스케일 부문 매출은 487억 달러(약 6조 7400억원), AICE 부문 매출은 403억 달러(약 5조 5780억원) 수준이었다. 엔비디아는 "블랙웰 울트라(GB300) 출하가 시작되며 하이퍼스케일 부문 매출이 전년 대비 두 배 이상 늘어났으며 H200 등 중국 시장 관련 매출은 데이터센터 부문 전체 매출의 1% 이하"라고 설명했다. 엣지 컴퓨팅 부문은 PC, 게임 콘솔, 워크스테이션, AI-RAN 기지국, 로보틱스, 오토모티브(자동차) 등 에이전틱 AI 및 피지컬 AI용 기기를 포함한다. 이 부문의 1분기 매출은 71억 9800만 달러(약 9962억원)이며 전년 동기(56억 4700만 달러, 약 7815억원) 대비 27% 늘어났다. 엔비디아는 "블랙웰 기반 워크스테이션 판매는 늘어났지만 PC 부문은 메모리 가격 상승으로 인한 영향으로 일부 감소했다"고 설명했다. 엔비디아는 오는 10월 1일 주당 25센트 배당금을 지급할 예정이다. 배당락은 9월 10일이다. 엔비디아는 올해 3분기(8~10월) 매출 1080억 달러(약 149조 4720억원)를 예상했다. 이는 2분기 매출보다 약 12% 증가한 수준으로, 엔비디아 분기 매출이 사상 처음으로 1000억 달러를 넘어설 것이라는 전망이다. 실적 발표 이후 주가는 시간 외 거래에서 종가(218.45달러) 대비 4%가량 오른 218달러 선에서 등락을 이어가고 있다.

2026.08.27 08:32권봉석 기자

[AI 리더스] 엘리스그룹 "GPU 확보 넘어 '잘 쓰는 기술'로…국가 AI 생태계 뒷받침할 것"

엘리스그룹이 교육·클라우드 기업을 넘어 인공지능(AI) 데이터센터 구축부터 그래픽처리장치(GPU) 운영, AI 서비스까지 직접 연결하는 'AI 풀스택 기업'으로 사업 영역을 확장한다. 정부의 대규모 GPU 확충 사업을 발판으로 AI 인프라 구축 경험을 쌓는 동시에, 자체 클라우드 인프라 소프트웨어(SW)와 모듈형 데이터센터 기술을 결합해 국내 AI 인프라 시장에서 입지를 넓힌다는 목표다. 박정국 엘리스그룹 최고기술책임자(CTO)는 26일 서울 강남구 본사에서 지디넷코리아와 만나 "앞으로는 GPU를 얼마나 많이 가지고 있느냐 자체가 경쟁력이 되기는 어렵다"며 "GPU와 AI 모델 사이를 얼마나 효율적으로 연결하고 자원을 활용해 결과물을 만들어내느냐가 인프라 경쟁의 핵심이 될 것"이라고 밝혔다. 회사는 이같은 시장 변화에 맞춰 데이터센터부터 AI 서비스까지 단일 기술 체계로 연결하는 전략을 추진 중이다. 데이터센터 구축과 GPU 서버 조달·운영, 네트워크·스토리지, 클라우드 운영 SW를 자체적으로 연결하고 실제 AI 모델 개발과 서비스 운영 경험까지 인프라 설계에 반영하는 방식이다. 인프라와 서비스 사업을 별개로 키우기보다 각 수요와 경험을 다시 기술 개발에 반영하는 선순환 구조를 만든다는 방침이다. 박 CTO는 "AI 서비스를 직접 개발하면 어떤 인프라가 필요한지 알 수 있고 반대로 인프라가 고도화되면 이를 기반으로 새로운 서비스를 개발할 수 있다"며 "우리 AI 서비스와 교육 사업에서 발생하는 수요가 인프라를 발전시키고 인프라의 발전이 다시 새로운 서비스를 만드는 구조를 만들고 있다"고 강조했다. GPU 운영 넘어 데이터센터 구축까지…정부 사업서 경험 축적 이러한 전략의 핵심 무대로는 정부 AI 인프라 사업이 꼽힌다. 엘리스그룹은 올해 과학기술정보통신부가 추진한 총 2조 805억원 규모 'AI컴퓨팅자원 활용기반 강화사업' 수행기관으로 선정돼 엔비디아 B300 GPU 2560장을 구축한다. 정부는 사업자 선정 과정에서 GPU 확보뿐 아니라 대규모 클러스터 구축·운영, 전력·냉각, 네트워크 설계 등 AI 인프라 전반의 역량을 평가했다. 엘리스그룹은 B300 2560장을 4개 모듈형 AI 데이터센터에 각각 640장씩 구축할 계획이다. 직접수랭식(DLC)에 40도 이상의 냉각수를 활용하는 온수 냉각과 외기 냉각을 적용하고 데이터센터 전력사용효율(PUE) 1.1 수준을 목표로 한다. 고집적·고전력 GPU 환경에 대응할 수 있도록 네트워크와 전력까지 함께 최적화할 계획이다. 박 CTO는 정부 사업에서 엘리스그룹이 보유한 경쟁력을 '엔드투엔드 AI 인프라'로 설명했다. 데이터센터 구축에서 시작해 GPU 서버 조달·설치·운영, 자원을 효율적으로 활용하기 위한 SW, 실제 모델 학습과 추론 서비스를 위한 기술 지원까지 전 영역을 연결할 수 있다는 것이다. 특히 이번 사업은 엘리스그룹이 AI 인프라 사업을 한 단계 확대하는 계기도 될 전망이다. 박 CTO는 "기존에는 GPU를 운영·공급하는 레퍼런스가 중심이었다면 이번에는 데이터센터 구축부터 시작한다는 점에서 새로운 경험과 노하우를 확보하게 될 것"이라고 말했다. 이어 "AI 인프라처럼 초기 비용이 큰 산업에선 새로운 시도를 한 기업이 실제로 구축하고 운영해본 경험을 확보하는 것이 중요하다"며 "정부가 새로운 기술을 시도하는 기업의 첫 고객이 돼주기에 이를 기반으로 민간과 해외 시장까지 확대할 수 있을 것"이라고 덧붙였다. PMDC·ECI 결합…"GPU 제대로 쓰는 기술이 경쟁력" 엘리스그룹의 AI 인프라 전략을 뒷받침하는 기술은 모듈형 AI 데이터센터 'AI PMDC'와 자체 클라우드 인프라 SW 'ECI'다. PMDC는 전력·냉각·IT 장비·관제 시스템을 하나의 모듈로 통합해 공장에서 제작한 뒤 현장에 설치하는 방식이다. 시설을 먼저 짓고 서버를 배치하는 기존 방식과 달리, 어떤 AI 워크로드와 GPU를 사용할지를 먼저 정하고 이에 맞춰 데이터센터를 종합적으로 설계한다는 점이 강점으로 평가된다. 또 최신 GPU 세대가 빠르게 바뀌는 만큼 모듈형 데이터센터로 빠르게 검증·도입하는 능력 자체도 경쟁력으로 꼽았다. 박 CTO는 "B200 GPU를 수용하는 수랭식 환경을 구축한 바 있으며 B300용 데이터센터도 설계·검증해왔다"며 "엔비디아 GPU뿐만 아니라 국산 신경망처리장치(NPU), AMD GPU 등 다양한 이기종 AI 가속기 환경 대응 역량도 갖춰왔고 앞으로도 관련 기술을 지속 고도화할 것"이라고 밝혔다. 구축된 GPU의 실제 활용 효율을 높이는 ECI도 회사 핵심 자산이다. 이는 GPU 스케줄링으로 유휴 시간을 줄이는 한편 네트워크와 스토리지를 GPU 특성에 맞춰 최적화해 고가의 GPU가 제 성능을 낼 수 있도록 지원한다. 범용 클라우드 인프라 관리보다 대규모 AI 학습과 GPU 클러스터 운영에 특화됐다는 설명이다. 엘리스그룹은 PMDC와 ECI를 결합해 데이터센터 구축과 GPU 운영을 단일 체계로 연결했다. ECI는 클라우드 서비스 보안인증(CSAP) 서비스형 인프라(IaaS) 인증을 확보했으며 엘리스클라우드를 통해 공급되는 GPU 자원에도 적용되고 있다. 향후 공공뿐 아니라 민간 AI 서비스까지 AI 인프라 사업 영역을 확대한다는 방침이다. 박 CTO는 "최신 GPU를 확보해도 기존 스토리지나 네트워크를 그대로 사용하면 데이터가 늦게 전달되면서 GPU 가동이 저조해지는 일이 생긴다"며 "GPU만 최신 기술을 도입하는 것이 아니라 전체 인프라를 효율적인 GPU 운영에 맞춰 설계해야 실제 성능을 끌어낼 수 있다"고 말했다. "AI 인프라는 '토큰 공장'…소버린 AI까지 연결한다" 박 CTO는 향후 AI 인프라 산업의 중심이 하드웨어(HW) 확보에서 '토큰 생산성'으로 옮겨갈 것으로 전망했다. AI 학습 중심이던 컴퓨팅 수요가 추론과 서비스 영역으로 이동하고 GPU와 각종 AI 가속기 공급도 늘면서 단순한 HW 보유량만으로는 차별화하기 어려워지고 있다는 판단이다. 그는 GPU와 데이터센터, 운영 SW 모두 궁극적으로 AI 서비스를 위한 토큰을 생산하는 기반 시설이라고 짚었다. GPU 숫자보다 얼마나 빠르고 효율적으로 인프라를 구축하고 적절한 모델을 배치하며 컴퓨팅 자원을 최대한 활용할 수 있는지가 AI 인프라 경쟁력을 평가하는 새로운 기준이 될 것으로 내다봤다. 이같은 전망은 엘리스그룹이 추진하는 소버린 AI 구상과도 연결된다. 박 CTO는 특정 GPU나 AI 반도체를 국산화하는 것만으로 소버린 AI를 구현했다고 보기는 어렵다고 밝혔다. 데이터센터 구축부터 SW 운영·개발, AI 모델 개발과 서빙, 실제 서비스 이용까지 전체 생태계를 통제하고 관리할 수 있는 역량이 필요하다는 것이다. 박 CTO는 "우리는 AI가 사회에서 더 널리 쓰이고 유용하게 활용되면서도 자원이 낭비되지 않도록 하기 위해 필요한 기술을 다각도로 지원한다"며 "AI 모델과 데이터센터의 효율화부터 최신 AI 인프라 기술, 소버린 AI까지 AI가 국가와 사회에서 제대로 활용될 수 있도록 뒷받침하는 기업으로 성장할 것"이라고 강조했다.

2026.08.26 11:00한정호 기자

통신사 새 먹거리는 'AI 네트워크'...GPU·엣지·피지컬AI 수익화 기대

통신사의 새로운 수익원으로 AI 네트워크가 부상하고 있다. 전 세계 통신 인프라 전문가 10명 중 9명은 향후 3~5년 내 AI 네트워크가 통신사의 매출 성장을 견인할 것으로 내다봤다. 최근 미국 네트워크 시스템 전문기업 시에나가 글로벌 리서치 기관 센서스와이드와 전 세계 12개국 1200명 이상의 통신·인프라 전문가를 대상으로 진행한 설문조사에 따르면, 응답자 90%가 AI 네트워크를 향후 매출 성장을 이끌 핵심 동력으로 꼽았다. AI 인프라 수요가 급증하면서 광네트워크와 데이터센터, 그래픽처리장치(GPU) 등 기존 통신사의 인프라 자산을 활용한 사업 기회도 확대될 전망이다. 응답자의 절반가량은 AI 기반 연결 서비스 수요에 대응하기 위해 관리형 광섬유 네트워크(MOFN) 서비스가 중요하다고 봤다. 통신사들은 데이터센터 상호연결(DCI)과 GPU 서비스 등으로도 새로운 수익원을 모색하고 있는 것으로 나타났다. 다. 특히 GPU 서비스에서는 다른 사업자와 협력이 핵심으로 꼽혔다. 응답자 94%는 클라우드 네오클라우드 사업자와의 전략적 파트너십이 GPU 사업 성공에 필수적이라고 답했다. 44%는 시장 진출 방식으로 수익 공유 모델을 채택할 계획이라고 밝혔다. AI 서비스 확산에 따른 소비자 시장의 성장 가능성도 높게 평가됐다. 응답자 95%는 AI 기반 엔터테인먼트가 향후 3년 내 새로운 수익원을 창출할 것으로 예상했다. 29%는 스마트 안경과 건강 추적기 등 AI 웨어러블 기기를 프리미엄 서비스 매출을 견인할 요인으로 지목했다. 네트워크 엣지도 주요 수익원으로 떠올랐다. 응답자 39%는 엣지 컴퓨팅과 서비스형 GPU(GPUaaS), 로컬 AI 추론 서비스가 향후 3년 내 기업 매출의 20% 이상을 차지할 것으로 전망했다. 88%는 이들 서비스가 기업 매출에서 최소 10% 이상의 비중을 차지할 것으로 내다봤다. 산업 현장에서는 피지컬 AI에 대한 기대가 높았다. 응답자 60%는 산업용 로봇 등 피지컬 AI가 5년 내 전체 기업 AI 매출의 15% 이상을 차지할 것으로 예상했다. 다만 AI를 실제 수익으로 연결하기 위해서는 네트워크 인프라 고도화가 선행돼야 한다는 점이 꼽혔다. 응답자 88%는 기업의 AI 서비스수준협약(SLA) 요구사항을 충족하기 위해 광네트워크 업그레이드가 시급하다고 답했다. 35%는 안정적이고 일관된 네트워크 성능을 프리미엄 AI 서비스의 핵심 요소로 꼽았다. AI 트래픽 증가에 대응하기 위한 네트워크 자동화 필요성도 커지고 있다. 응답자 96%는 AI 인프라와 트래픽을 효율적으로 제어하기 위해 에이전트 기반 AI 등을 활용한 네트워크 자동화가 필수적이라고 봤다.

2026.08.26 10:27홍지후 기자

[AI 고속도로] "네트워크만으론 부족"…시스코, AI 데이터센터 풀스택으로 영역 확대

시스코가 슈퍼마이크로와 손잡고 인공지능(AI) 데이터센터 사업을 네트워크 중심에서 랙스케일 풀스택 인프라로 확대한다. 엔비디아의 차세대 그래픽처리장치(GPU) 시스템에 서버·네트워크·액체냉각·보안·운영을 통합해 공급하면서 AI 데이터센터 시장의 경쟁도 개별 장비에서 통합 구축 역량 중심으로 빠르게 옮겨가는 모습이다. 시스코는 25일(현지시간) 공식 홈페이지를 통해 슈퍼마이크로와 손잡고 '엔비디아 기반 시스코 시큐어 AI 팩토리'를 랙스케일 AI 컴퓨팅 영역으로 확대한다고 발표했다. 슈퍼마이크로의 액체·공랭식 고밀도 서버를 자사 AI 인프라 포트폴리오에 포함하고 오는 10월부터 공급할 예정이다. 이번 협력으로 시스코는 기존 강점인 네트워크와 보안에 GPU 컴퓨팅과 냉각까지 결합한 통합 AI 인프라를 제공하게 됐다. 슈퍼마이크로는 고밀도 GPU 서버와 액체냉각 시스템을 맡고, 엔비디아는 GPU와 AI 소프트웨어를 공급하는 구조다. 지원 대상에는 엔비디아 '베라 루빈 NVL72'와 'HGX 루빈 NVL8'이 포함된다. 시스코는 자사 액체냉각 AI 네트워크 시스템과 슈퍼마이크로의 액체냉각 서버를 연결해 랙에서 네트워크 패브릭까지 아우르는 냉각 구조도 제공한다. 초거대 AI 모델 학습과 대규모 추론 환경에서 GPU뿐 아니라 전력과 냉각, 네트워크 효율이 성능과 비용을 좌우하는 상황을 겨냥한 구성이다. 시스코는 이번 확장을 통해 기업 고객뿐 아니라 네오클라우드와 소버린 클라우드 시장까지 공략한다. 엔비디아 클라우드 파트너(NCP) 규격에 맞춰 프런트엔드에는 시스코 '실리콘 원' 기반 스위치, 백엔드에는 엔비디아 '스펙트럼-X' 기반 시스코 스위치를 적용하고 이를 '넥서스 원'으로 통합한다. 시스코는 자사 스위치와 네트워크 운영체제를 활용해 NCP 규격을 충족하는 구조를 차별점으로 내세웠다. 시장에선 이번 협력이 AI 데이터센터 경쟁 구도를 한 단계 더 넓히는 계기가 될 것으로 보인다. 지금까지 델과 HPE, 레노버, 슈퍼마이크로 등이 GPU 서버를 중심으로 경쟁했다면, 앞으로는 서버와 네트워크, 냉각, 보안, 운영을 얼마나 빠르게 통합해 가동하느냐가 중요해질 가능성이 커졌다. 시스코도 직접 GPU 서버를 개발하기보다 슈퍼마이크로와 협력하는 방식을 택했다. 자사가 강점을 가진 네트워크와 보안, 운영 소프트웨어를 중심으로 전체 AI 인프라를 묶고 서버 전문 업체의 기술을 결합해 시장 진입 속도를 높이려는 전략으로 풀이된다. 이번 일은 슈퍼마이크로에도 긍정적인 효과가 있을 것으로 예상된다. 시스코의 글로벌 기업 고객과 판매망을 활용할 수 있는 데다 자사 고밀도 GPU 서버와 액체냉각 시스템이 시스코의 AI 인프라 포트폴리오에 포함되면서 판매 채널을 넓힐 수 있기 때문이다. 다만 양사는 구체적인 주문 규모와 매출 목표는 공개하지 않았다. 시스코는 인프라 구축 이후 운영 효율을 높이기 위한 서비스도 강화한다. 또 새 검증 서비스 'CVIS'를 통해 실제 구축된 시스템이 설계된 레퍼런스 아키텍처와 일치하는지 확인하고 대규모 AI 연구소를 통해 관련 도구와 소프트웨어 검증 역량도 확대할 계획이다. 더불어 엔비디아 AI 엔터프라이즈와 시스코 클라우드 컨트롤 기반 에이전틱옵스도 연계해 컴퓨팅과 네트워크 인터페이스 카드(NIC), 광통신, 네트워크 상태를 통합 관리하도록 지원한다. 지투 파텔 시스코 사장 겸 최고제품책임자(CPO)는 "우리는 역사상 가장 큰 데이터센터 구축 사이클 중 하나의 시작점에 있다"며 "모든 조직이 AI 확장을 서두르고 있지만 데이터 통제와 토큰 비용 관리, 실질적인 투자수익률을 함께 확보해야 한다"고 말했다.

2026.08.26 10:18장유미 기자

LG CNS-네이버클라우드, 액체냉각 AI 인프라 구축한다…'베라 루빈' 고발열 대응

LG CNS가 인공지능(AI) 팩토리 인프라 시장 선점을 목표로 첨단 그래픽처리장치(GPU)의 고발열·고밀도 전력에 대응 가능한 액체냉각 적용에 앞장선다. LG CNS는 네이버클라우드와 손잡고 차세대 냉각 기술인 액체냉각 인프라 구축에 나선다고 26일 밝혔다. 생성형 AI 확산으로 고성능 GPU 전력소비와 발열이 늘어나는 가운데, 기존 공랭 방식을 보완하는 대규모 액체냉각 기술을 데이터센터에 선제적으로 적용한다는 방침이다. LG CNS는 네이버클라우드와 삼송 데이터센터에 액체냉각 기술 중 하나인 직접 칩 냉각(DTC)을 적용하고 고성능 AI 서비스 지원을 위한 기반을 마련할 계획이다. 앞서 LG CNS는 삼송 데이터센터의 위탁운영을 맡아 네이버클라우드와 삼송 데이터센터 코로케이션 계약을 체결했다. 이번 인프라는 과학기술정보통신부 산하 정보통신산업진흥원(NIPA) 소유의 엔비디아 차세대 초고성능 GPU '베라 루빈'을 네이버클라우드가 안정적으로 운영할 수 있도록 구축된다. 베라 루빈은 기존 '블랙웰 울트라' 대비 추론 성능이 약 3.3배 향상될 것으로 예상된다. 특히 베라 루빈이 액체냉각 인프라를 기반으로 국내 데이터센터에 본격 적용된다는 점에서 삼송 데이터센터는 AI 팩토리 구현을 위한 핵심 거점으로 평가된다. LG CNS는 총 수전 용량 80메가와트(MW)인 삼송 데이터센터가 국내 최대급 AI 팩토리로 자리매김할 것으로 내다봤다. 삼송 데이터센터에 적용하는 DTC는 냉각수가 흐르는 냉각판을 GPU 칩에 부착해 열을 흡수하는 액체냉각 방식이다. 공기 대비 열전달 효율이 높은 액체를 활용해 고집적 GPU 서버의 발열을 효율적으로 제어한다. 일반적으로 기존 공랭 방식으로 대응할 수 있는 냉각 용량의 한계는 랙당 20~30키로와트(kW) 수준이지만, 고성능 GPU 서버 랙은 전력 밀도가 200kW 이상으로 높아지고 있다. 이에 DTC와 같은 액체냉각은 AI 팩토리 구현을 위한 필수 기술로 주목받고 있다. 시장조사기관 마켓앤드마켓에 따르면 글로벌 데이터센터 액체냉각 시장은 올해 40억 7000만 달러(약 5조 6240억원)에서 2033년 276억 5000만 달러(약 38조원) 규모로 성장할 전망이다. 이에 대응해 LG CNS는 데이터센터 설계·구축·운영(DBO) 역량과 AI 인프라 기술을 결합해 ▲DTC 액체냉각 ▲GPU 서버 운영 환경 ▲전력 공급 체계 ▲AI 플랫폼 운영 기반까지 통합 구현한다는 목표다. 네이버클라우드는 AI 플랫폼 운영 역량과 대규모 GPU 서비스 경험을 바탕으로 국내 공공기관과 기업에 안정적인 고성능 AI 서비스를 제공할 계획이다. 양사는 내년까지 액체냉각 인프라 구축과 실증을 완료할 계획이다. 조헌혁 LG CNS 데이터센터사업담당 상무는 "데이터센터 냉각 기술이 AI 서비스 품질과 운영 효율의 핵심 경쟁력이 되고 있다"며 "네이버클라우드와 협력해 우리 강점인 데이터센터 DBO 역량과 차세대 냉각 기술을 기반으로 국내 AI 생태계 성장을 뒷받침하는 핵심 인프라를 지속 구축해 나가겠다"고 밝혔다.

2026.08.26 10:01한정호 기자

[AI는 지금] GPU만 빠르면 끝?…AI 에이전트 시대, '추론 SW'가 판 바꾼다

인공지능(AI) 에이전트 확산으로 AI 인프라 경쟁의 무게중심이 그래픽처리장치(GPU) 연산 성능에서 추론 소프트웨어와 서빙 시스템 전반으로 넓어지고 있다. 대화형 AI보다 훨씬 긴 컨텍스트를 유지하고 도구 호출과 반복 추론을 수행하는 AI 에이전트가 늘면서 KV 캐시 관리와 요청 스케줄링, 모델 병렬화 같은 소프트웨어 기술이 실제 서비스 성능과 비용을 좌우하는 요소로 떠오르고 있다. 26일 엔비디아에 따르면 차세대 AI 시스템 '베라 루빈 NVL72'는 세미애널리시스의 에이전틱 AI 벤치마크 '에이전트X'를 이용한 자체 시험에서 GB300 NVL72보다 메가와트당 AI 처리량이 최대 30배 높았다. 이번 수치는 엔비디아가 측정한 프리뷰 결과로, 현재 세미애널리시스의 검토를 기다리고 있다. 현재 세대인 GB300 NVL72에서도 성능 격차가 확인됐다. 딥시크 V4 프로 1.6T를 구동했을 때 H200 NVL8 대비 메가와트당 처리량이 최대 15배 높았으며, 키미 K3 2.8T에서는 비슷한 인터랙티브 성능을 기준으로 최대 80배까지 격차가 벌어졌다. 엔비디아는 GB300 NVL72를 사용할 경우 일부 조건에서 H200 NVL8보다 100만 토큰당 비용도 최대 10분의 1 수준으로 낮출 수 있다고 설명했다. 이번 결과에서 주목할 부분은 GPU 세대별 연산 성능 차이만은 아니다. 에이전트X가 기존 AI 벤치마크와 달리 실제 코딩 에이전트가 작동하는 방식을 재현하면서 AI 소프트웨어의 역할을 성능 평가에 본격적으로 끌어들였기 때문이다. 기존 추론 벤치마크는 8K 입력과 1K 출력처럼 길이가 정해진 요청을 반복해 GPU의 처리 성능을 측정하는 경우가 많았다. AI 에이전트는 이전 작업을 기억하면서 컨텍스트가 계속 길어지고 추론 도중 외부 도구를 호출하거나 다른 에이전트에 작업을 넘기기도 한다. 이를 두고 세미애널리시스는 "장문·멀티턴·높은 프리픽스 재사용과 서브에이전트 실행이 실제 AI 서비스 트래픽에서 중요해졌다"며 "그러면서 고정 길이 평가만으로 하드웨어와 소프트웨어 성능을 측정하기 어려워졌다"고 설명했다. 에이전트X는 이를 반영해 실제 클로드 코드 세션에서 발생한 요청 패턴을 재생한다. 턴이 진행될수록 컨텍스트가 누적되는 과정뿐 아니라 도구 호출로 모델이 대기하는 시간까지 반영하고 여러 에이전트가 동시에 작동할 때 처리량과 응답 속도가 어떻게 변하는지도 측정한다. 이에 따라 GPU 자체의 연산 속도뿐 아니라 추론 엔진과 캐시, 라우터가 얼마나 효율적으로 움직이는지가 결과에 영향을 미친다. 세미애널리시스는 에이전트X를 이용한 최적화 과정에서 vLLM의 프리픽스 캐시 적중률이 일부 조건에서 95%를 넘었으며 CPU로 KV 캐시를 오프로딩하는 방식에서는 재연산 대비 출력 처리량이 81.7% 높아진 사례도 공개했다. 세미애널리시스는 "실제 환경은 멀티턴·긴 컨텍스트와 높은 프리필 재사용, 서브에이전트 실행과 수많은 도구 호출로 구성된다"고 설명했다. 이번 일로 AI 소프트웨어 업체에도 향후 변화가 예상된다. 기존에는 쿠다(CUDA) 같은 GPU 프로그래밍 플랫폼과 vLLM·SGLang·텐서RT-LLM 등 추론 엔진의 연산 최적화가 주요 경쟁 영역이었다면, 에이전틱 AI에선 여러 소프트웨어 계층을 하나의 시스템으로 묶어 운영하는 능력이 중요해지고 있어서다. 특히 KV 캐시 관리가 핵심으로 부상하고 있다는 점은 눈여겨 볼 요소다. AI 에이전트가 작업을 수행할 때 이전 컨텍스트를 반복해서 다시 계산하지 않고 캐시에 저장된 데이터를 활용하면 GPU 연산량과 응답 시간을 줄일 수 있어서다. 반대로 동시에 많은 에이전트가 움직이면서 캐시를 제대로 관리하지 못하면 필요한 정보를 삭제하거나 같은 내용을 다시 계산하면서 GPU를 추가해도 성능이 충분히 나오지 않을 수 있다. 요청을 적절한 GPU로 배분하는 라우터와 스케줄러의 역할도 커지고 있다. 세미애널리시스의 에이전트X 시험에서는 엔비디아 추론 오케스트레이션 소프트웨어 '다이나모'의 라우팅 방식을 개선한 뒤 일부 조건에서 출력 처리량이 22.2% 증가했다. 다른 최적화에선 에이전트 세션 재생 시간이 20% 이상 단축됐다. 이는 하드웨어 교체 없이 소프트웨어 최적화만으로도 에이전틱 AI 추론 효율을 끌어올릴 수 있다는 점이 확인된 것으로 평가된다. 엔비디아도 이런 변화에 맞춰 하드웨어와 소프트웨어를 함께 묶는 전략을 강화하고 있다. GB300 NVL72의 72개 GPU를 NV링크로 연결하고 다이나모를 통해 프리필과 디코드 작업을 나누는 동시에 KV 캐시 상태와 서버 부하를 고려해 요청을 배분하는 방식이다. 이를 통해 엔비디아는 SGLang·vLLM·텐서RT-LLM과 MoE 최적화 기술까지 결합해 GPU 한 장의 성능보다 랙 단위 추론 효율을 높이는 데 초점을 두고 있다. 이에 따라 클라우드와 AI 서비스 사업자의 인프라 투자 기준도 달라질 가능성이 있다. 에이전트가 일반 챗봇보다 더 많은 토큰과 컴퓨팅 자원을 사용하는 만큼, GPU 도입 가격뿐 아니라 동일한 전력에서 얼마나 많은 사용자와 에이전트를 동시에 처리할 수 있는지가 서비스 비용을 좌우할 수 있어서다. 에이전트X도 초당 토큰 수에 더해 첫 토큰 생성 시간과 전체 지연시간, 사용자당 인터랙티브 성능, 메가와트당 처리량을 함께 평가하도록 설계됐다. 세미애널리시스는 추론 엔진과 라우터, KV 캐시 관리자, 데이터 전송 라이브러리, 클러스터 제어기가 서로 연동되는 구조를 새로운 AI 추론 환경의 핵심으로 보고 있다. 엔비디아 다이나모뿐 아니라 레드햇의 llm-d, AMD 인페라 등도 여러 추론 소프트웨어를 묶어 분산형 AI 시스템을 운영하는 방향으로 개발되고 있다. 세미애널리시스는 "에이전틱 추론은 칩이나 커널 수준의 문제가 아니라 시스템 전체의 문제"라고 강조했다.

2026.08.26 09:17장유미 기자

델 "에이전틱 AI 시대, 비용·효율 고려한 분산처리 필요"

"에이전틱 AI가 보급되며 여러 기업이 에이전트 활용을 독려하고 있다. 하지만 모든 직원이 AI를 효율적으로 활용하는 것은 아니다. 가치 낮은 업무에 많은 양의 토큰을 쓰는 한편 가치 있는 업무를 매우 적은 토큰으로 수행하는 상황도 발생한다." 25일 오전 서울 삼성동 코엑스에서 진행된 '델테크놀로지 CSG 미디어 간담회'에서 유상모 델테크놀로지스 총괄사장이 이렇게 강조했다. 델테크놀로지스는 연례 행사 '델 테크놀로지스 포럼' 일부인 이날 행사에서 AI 처리를 클라우드에만 의존하는 것은 보안과 토큰당 비용 면에서 적합하지 않다고 지적했다. 이어 보완책으로 AI PC와 워크스테이션 등으로 AI 처리를 분산하는 '책상 옆(데스크사이드) AI'를 제시했다. 에이전틱 AI 대응 3대 전략 제시 "AI 토큰도 비용" 이날 델테크놀로지스는 에이전틱 AI 시대의 대처 방안을 ▲ AI 토큰경제 ▲ AI 네이티브 조직을 위한 AI PC ▲ AI 확산에 따른 엔드포인트 보안 등 세 가지 축으로 제시했다. 정재욱 델테크놀로지스 이사는 "클라우드는 대규모 연산이 일어나는 환경에, 데이터 소유권과 통제가 중요한 연산은 기업이나 조직 내 데이터센터가 적합하다. 반면 반복적인 추론이나 민감한 데이터는 데스크사이드에서 처리해 효율을 확보할 수 있다"고 설명했다. 이어 "엔비디아 GB10·GB300과 x86 CPU·엔비디아 GPU 등으로 구성된 워크스테이션은 로컬 AI 개발과 에이전트 개발·테스트에 적합하다. 개발된 모델이나 에이전트는 필요에 따라 델 파워엣지 서버로 확장할 수 있다"고 덧붙였다. "책상 위 AI PC로 효율·보안 강화" AI PC는 CPU·GPU·NPU를 활용해 일부 LLM 구동과 추론을 로컬에서 수행할 수 있어 클라우드 API 호출에 따른 토큰 비용을 줄이는 방안으로 활용할 수 있다. 개인정보나 고객정보, 대외비 등 민감한 데이터 외부 유출 가능성도 줄인다. 정재욱 이사는 "델은 인텔 코어 울트라 시리즈3와 AMD 라이젠 AI 400 등을 기반으로 한 '델 프로' 제품군을 업무 수준과 예산에 따라 세분화했다. 14·16형 업무용 노트북인 델 프로 5 이외에 최대 50 TOPS NPU를 내장한 델 프로5 마이크로 등을 공급한다"고 설명했다. 기기 내 저장된 데이터와 각종 모델을 외부 공격에서 방어하기 위한 보안의 중요성도 커지고 있다. 정재욱 이사는 "델테크놀로지스는 제품 조립 단계부터 공급망 보안, 바이오스와 펌웨어 무결성 검증, 마이크로소프트 인튠 등 기기 관리 솔루션과 연동한 텔레메트리 등으로 보안을 강화하고 있다"고 설명했다. "에이전틱 AI, 워크로드 분산 촉진할 것" 이날 델테크놀로지스는 AI PC와 데스크사이드 AI 전략을 소개하며 최근 CSG 사업 성장세도 강조했다. 이성민 델테크놀로지스 전무는 "회계연도 기준 올해 2~4월(1분기) CSG 매출은 146억 달러(약 20조 2049억원)로 전년 동기 대비 17% 증가했으며 이 중 기업용 PC 부문 매출은 130억 달러(약 18조 180억원)로 18% 성장했다"고 밝혔다. 델테크놀로지스는 반도체 수급난과 경기 불확실성으로 기업의 IT 비용 부담이 커지는 상황에서도 공급망 최적화와 운영 효율화를 통해 비용 상승 영향을 최소화한다는 방침이다. 정재욱 이사는 "AI가 프롬프트 중심에서 에이전틱 AI 중심으로 이동하고 있는 만큼 AI 처리를 분산하려는 흐름은 지속될 것이며 기업 역시 비용 부담을 고려하면서 어떤 AI를 어디에 배치할 지 선택하는 것이 중요해질 것"이라고 전망했다.

2026.08.25 15:40권봉석 기자

인텔, '핫칩스 2026'서 AI 특화 아키텍처 3종 공개

인텔이 매년 8월 하순 미국에서 열리는 반도체 업계 학술행사 '핫칩스 2026'에서 에이전틱 AI·엣지 컴퓨팅용 CPU와 GPU 아키텍처 3종을 공개했다. 차세대 제온 프로세서 '다이아몬드 래피즈'는 전력 효율과 성능이 향상된 1.8나노급 인텔 18A-P 공정을 시작으로 제품 생산과 패키징 등 모든 공정이 인텔 파운드리에서 이루어진다. 코어 수는 최대 256개이며 LLC(L3 캐시)는 1.28GB로 연산 효율을 높이는 동시에 16개 메모리 채널을 적용했다. GPU와 외부 저장장치 등이 밀집된 환경을 겨냥해 PCI 익스프레스 6.0 레인(lane, 데이터 전송 통로)은 총 128개로 확대했다. CPU 타일을 이어붙이는 데는 최신 패키징 기술인 포베로스 다이렉트 3D가 적용됐고 UCIe-S를 이용한 SoC 구성을 지원한다. 새로운 명령어인 APX와 함께 AI 연산을 지원하는 AMX 명령어를 개선했다. 크레센트 아일랜드는 실시간 추론 경제성에 중점을 둔 GPU로 Xe3P 기반 32코어 GPU와 LPDDR5X 480GB 메모리를 탑재했다. 전력 소모는 최대 350W로 기존 공랭식 데이터센터에서 추론 연산 역량 확장에 활용할 수 있다. 인텔 코어 시리즈3(와일드캣 레이크)는 보급형 노트북과 지능형 엣지 시스템에 필요한 AI 기능을 지원한다. 인텔 18A 공정 기반으로 최대 6코어 CPU, 17 TOPS NPU와 XMX 가속 가능한 GPU를 내장했다. UCIe를 적용해 다른 가속기나 SoC와 연결한 패키징 설계도 가능하다. 푸시카르 라나데 인텔 최고기술책임자(CTO)는 "에이전틱 AI는 트랜지스터와 패키지부터 전체 시스템 아키텍처에 이르기까지 컴퓨팅을 설계하고 제공하는 방식을 근본적으로 변화시키고 있다"고 설명했다. 이어 "미래는 범용 컴퓨팅과 용도별 가속 기술, 첨단 패키징, 오픈 칩렛 기술을 긴밀하게 통합하여 실제 전력, 비용, 배포 제약 조건 내에서 워크로드에 적응하고 확장할 수 있는 시스템을 구축하는 데 있다"고 말했다.

2026.08.25 09:52권봉석 기자

[AI인재강국] AI 경쟁의 다음 법칙, 크기가 아니라 지혜다

국가 AI 연구거점은 과학기술정보통신부와 정보통신기획평가원(IITP)의 지원을 받고 서울시와 서초구청이 뒷받침하는 AI 연구 컨소시엄으로, 카이스트·고려대·포스텍·연세대와 국내 기업들이 함께한다. 지디넷코리아는 격주마다 한국 AI 연구 생태계가 나아갈 방향을 국가 AI 연구거점의 생생한 이야기로 조망해 본다.[편집자주] "모델을 키우면 성능이 좋아진다." 지난 몇 년의 인공지능(AI) 도약을 이끈 것은 이 단순한 경험 법칙, 이른바 스케일링 법칙이었다. 모델의 크기와 데이터, 컴퓨팅을 늘릴수록 성능이 예측 가능하게 향상된다는 사실이 확인되자 세계는 더 큰 모델을 만드는 경쟁에 뛰어들었다. 오늘의 생성형 AI가 보여주는 놀라운 능력의 상당 부분은 이 법칙에 충실했던 결과다. 법칙이 있으니 길은 분명했다. 더 많은 데이터, 더 큰 모델, 더 많은 그래픽처리장치(GPU)였다. 그러나 이 길은 갈수록 가팔라지고 있다. 법칙이 틀렸다는 뜻이 아니다. 법칙을 계속 따르는 비용이 감당하기 어려운 수준으로 커지고 있다는 뜻이다. 최첨단 모델을 한 번 학습시키는 데 천문학적 비용과 전력이 들고, 인터넷에서 모을 수 있는 양질의 데이터도 바닥을 드러내고 있다. 그렇게 이 경쟁은 자본과 인프라를 가진 소수의 기업과 국가만 뛸 수 있는 게임이 되어 간다. 크기의 경쟁이 계속되는 한, 뒤늦게 출발한 쪽이 같은 트랙에서 역전하기는 어렵다. 실제로 경쟁의 무대는 벌써 옮겨 가고 있다. 최근에는 학습 단계를 넘어, 추론 시점에 연산을 더 투입해 성능을 끌어올리는 새로운 스케일링의 축이 열리고 있다. 그러나 축이 학습이든 추론이든 관건은 결국 같다. 한정된 자원을 얼마나 영리하게 쓰느냐다. 그래서 질문이 바뀌어야 한다. "얼마나 크게 만들 것인가"가 아니라 "같은 지능을 얼마나 적은 자원으로, 얼마나 믿을 수 있게 낼 것인가"다. 국가AI연구거점에서 필자가 책임을 맡은 세부과제의 이름이 '뉴럴 스케일링 법칙 초월 연구'인 이유가 여기에 있다. 여러 대학의 연구진이 저마다의 방법으로 이 하나의 질문을 붙잡고 있다. 벽은 하나지만 넘는 길은 여러 갈래다. 이미 학습된 거대 모델의 지식을 압축하고 증류해 작은 모델에 옮겨 담는 길, 같은 데이터에서 더 많이 배우는 학습 알고리즘의 길, 모든 입력에 똑같은 연산을 쏟는 대신 필요한 만큼만 계산하는 새로운 구조의 길, 데이터 자체를 정제하고 골라내 적은 데이터로 같은 효과를 내는 길이다. 필자의 연구실도 모델의 숫자 표현을 줄여 몸집을 낮추는 양자화, 여러 모델을 꼭 필요한 순간에만 결합해 비용을 아끼는 앙상블, 생성 과정의 잘못된 경로를 일찍 걸러내 속도를 몇 배로 끌어올리는 추론 가속 연구 등으로 힘을 보태고 있다. 이런 문제의식은 연구실 밖에서도 이어진다. 필자가 공동창업한 헬스케어 AI 기업 에이아이트릭스 역시 실제 병원 데이터와 임상 제약을 마주하며 비슷한 고민을 하고 있는데, 같은 자원 제약과 신뢰성 문제는 의료를 넘어 산업 현장 곳곳에서 반복되는 고민이기도 하다. 이 갈래들의 끝에는 결국 이해의 문제가 있다. 모델을 줄이려면 무엇을 버려도 되는지 알아야 하고, 그러려면 모델이 왜 그렇게 판단하는지 안을 들여다볼 수 있어야 한다. 그리고 이 '왜'에 답하는 능력은 비용을 아끼는 도구에 그치지 않는다. 오판 하나가 생명이나 큰 비용으로 이어지는 현장, 이를테면 환자의 상태 악화를 예측하는 일에 AI가 들어가려면 판단의 근거를 설명하고 검증할 수 있어야 한다. 시계열 데이터에서 판단의 근거를 짚어내는 설명가능성 연구, 모델의 추론 과정을 단계마다 검증하는 연구가 효율화와 한 몸으로 가는 이유다. 더 작게, 더 빠르게, 그리고 더 믿을 수 있게. 결국 하나의 목표, 현실에서 쓰이는 AI를 향한다. 이 전장은 한국에 불리하지 않다. 자본과 전력의 총량으로 겨루는 경쟁에서는 뒤질 수 있어도, 적은 자원으로 같은 지능을 내는 경쟁은 결국 아이디어와 사람이 결정하기 때문이다. 이론에 대한 이해와 정교한 알고리즘, 그것을 밀고 나가는 연구자의 집요함이 무기가 되는 영역이고, 한국은 세계 무대에서 검증된 연구자와 학생들을 갖고 있다. 세계가 "더 크게"의 관성에 묶여 있는 지금이야말로, 다음 법칙을 먼저 찾아내는 쪽이 판을 바꿀 수 있는 시간이다. 이런 연구는 분기 단위 성과로 환산되지 않는다. 법칙 하나를 넘는 일은 수많은 가설과 실패를 쌓아야 하는 일이고, 여기에도 법칙이 있다면 성과가 연구에 투입된 시간과 신뢰에 비례해 자란다는 것이다. 연구자가 몇 년 뒤를 내다보며 어려운 질문에 붙어 있을 수 있는 여건, 그 질문을 이어받을 학생들이 자라나는 환경은 그렇게 쌓인다. 스케일링 법칙 너머를 먼저 내다보는 나라가 다음 판의 규칙을 쓴다. 그리고 그 시야를 만드는 것은 결국, 오래 질문할 수 있는 사람들이다.

2026.08.21 11:10양은호 컬럼니스트

콴델라, 상온 광자기반 양자컴퓨팅 한국보급 나서

"양자컴퓨팅 관점에서 콴델라가 보는 한국시장 장점은 양자컴 제조공정이 반도체 제조공정과 80% 이상 같다는 것이다." 글로벌 광자 기반 양자컴퓨팅 기업 콴델라(Quandela)의 김유석 한국 지시장이 최근 한국의 퀀텀 AI 전문기업 큐에이아이(대표 임세만, QAI)와 전략적 업무협약을 체결하고 사업 확대에 함께 나서기로 한 배경이다. 콴델라 양자컴퓨터는 제조 공정이 반도체 칩 공정을 사용한다. 칩 안의 광학회로에서 빛의 양자 상태를 제어하고 계산하는 방식이어서 상온 제조가 가능한 특징이 있다. 이들 양사는 최근 업무협약에 서명했다. 목표는 국내 및 아시아 시장에서 고객 맞춤형 GPU–QPU 하이브리드 고성능컴퓨팅(HPC) 사업 확장이다. 콴델라의 광자 양자프로세서 및 양자 소프트웨어 기술과 QAI의 GPU·AI 인프라 설계·양자컴퓨팅 컨설팅 역량을 결합, 기업·대학·연구기관이 실제 업무 환경에서 활용 가능한 양자컴퓨팅 도입 경로를 마련하자는 취지다. 대규모 데이터 처리와 AI 모델 학습 등 고전 연산은 GPU가 전담하고, 최적화·샘플링·양자 머신러닝과 같은 특화 연산은 QPU가 수행하는 구조로 양사가 협력한다. 양사는 향후 ▲산업별 과제 및 기존 컴퓨팅 환경 분석 ▲맞춤형 GPU-QPU 하이브리드 아키텍처 설계 ▲양자 알고리즘 검토 및 기술검증(PoC) ▲도입 컨설팅 및 운영 지원 ▲공동 세미나 및 사업 기회 발굴 등 전 주기에 걸친 밀착 협력을 추진한다. 주요 타깃은 AI, 바이오·신약 개발, 신소재, 금융, 제조, 국방 등 대규모 데이터 분석과 고도의 복잡 연산이 필수적인 산업군이다. 특히, 고객 데이터를 바탕으로 적용 가능성을 진단하고 사업적 타당성을 사전 확인하는 공동 검증 프로그램도 운영할 예정이다. 김유석 콴델라 한국지사장은 “기업이 양자컴퓨팅을 실제 업무에 활용하려면 QPU의 성능만을 제시하는 것이 아니라 기존 GPU 및 AI 환경과 어떻게 연계할 것인지에 대한 구체적인 설계가 필요하다”며 “큐에이아이의 고객 맞춤형 컨설팅 역량과 콴델라의 광자 양자컴퓨팅 기술을 결합해 고객이 현실적으로 도입할 수 있는 GPU–QPU 활용 모델을 제공할 것”이라고 말했다. 김 지사장은 특히, "한국은 반도체 강국이다. 반도체 파운드리가 1,2,3차 모두 탄탄하다. 콴델라의 양자컴퓨터가 양산되면, 반도체 패키징 업체들하고 모두 협력해야 한다. 삼성이나 SK하이닉스는 물론 1,2,3차 협력업체까지 같이 가야한다"고 설명했다. 임세만 큐에이아이 대표는 “양자컴퓨팅은 기존 GPU 컴퓨팅을 일시에 대체하는 기술이 아니라, 고객의 문제와 연산 특성에 따라 GPU와 QPU를 적절히 결합해야 실질적인 가치를 만들 수 있다”며 “큐에이아이는 고객의 현재 인프라와 업무 과제를 기반으로 최적의 GPU–QPU 아키텍처를 설계하는 데 집중하고 있다”고 덧붙였다.

2026.08.21 10:02박희범 기자

GPU 천하 AI 시장에 '추론 강점' 국산 NPU 파고든다

글로벌 AI 시장이 학습에서 추론 중심으로 전환하면서 AI 반도체 경쟁도 개별 칩 성능을 넘어 하드웨어와 소프트웨어를 결합한 플랫폼 경쟁으로 확대되고 있다. 이에 정부는 국산 NPU를 중심으로 다양한 연산 자원을 결합하는 개방형 AI 컴퓨팅 생태계 구축에 나선다. 과학기술정보통신부는 20일 서울 광화문 HJ비즈니스센터에서 국내 AI 반도체 업계 관계자들과 '개방형 AI 컴퓨팅 인프라 생태계 구축을 위한 간담회'를 열어 국산 NPU 시장 확산과 글로벌 컴퓨팅 생태계 참여 방안을 논의했다. 이는 지난 7월 과기정통부와 AMD가 체결한 업무협약 후속 조치다. 최근 생성형 AI 서비스가 확산하면서 AI 컴퓨팅 시장의 무게중심은 대규모 모델을 만드는 학습에서 실제 서비스를 구동하는 추론으로 이동하고 있다. 이에 따라 연산 성능뿐 아니라 전력 효율과 비용 경쟁력이 AI 인프라의 주요 경쟁 요소로 부상하고 있다. AI 서비스마다 요구하는 연산 환경도 달라지면서 특정 반도체에 의존하기보다 CPU와 GPU, NPU를 메모리 네트워크 소프트웨어와 조합하는 개방형 컴퓨팅 구조의 중요성도 커지고 있다. 특히 정부와 업계는 글로벌 AI 반도체 경쟁이 개별 칩의 성능 경쟁에서 전체 시스템을 얼마나 효율적으로 구성하느냐를 겨루는 방향으로 바뀌고 있다고 봤다. 이날 퓨리오사AI는 개방형 AI 컴퓨팅 인프라의 글로벌 동향과 국내 AI 반도체 업계 대응 방향을 발표했다. AMD코리아는 과기정통부와 체결한 MoU의 주요 내용과 실행 계획을 공유했으며, 망고부스트와 모레는 AMD와 추진 중인 AI 컴퓨팅 최적화와 소프트웨어 협력 현황을 소개했다. 참석 기업들은 GPU 중심의 단일 구조에서 벗어나 AI 반도체와 메모리, 네트워크, 소프트웨어를 유기적으로 연결하는 생태계를 구축해야 한다는 데 의견을 모았다. 이를 위해 CPU, GPU 등 가속기와 메모리를 고속으로 연결하는 CXL과 네트워크 저장장치 등의 데이터 처리를 전담하는 DPU 등 차세대 인프라 기술 활용을 확대할 필요성이 제기됐다. 메모리 내부에서 연산을 수행하는 PIM과 인간의 뇌 구조를 모방한 뉴로모픽 반도체 등 미래 AI 반도체 원천기술에 대한 투자도 강화해야 한다는 의견이 나왔다. 하드웨어뿐 아니라 소프트웨어와 플랫폼을 아우르는 풀스택 경쟁력 확보도 과제로 꼽혔다. 개방형 인터페이스와 국제표준, 오픈소스를 기반으로 서로 다른 기업의 AI 반도체와 소프트웨어를 연결하고 이를 실제 환경에서 검증할 국가 차원의 실증 기반이 필요하다는 설명이다. AMD와의 협력을 실제 사업 성과로 연결해야 한다는 주문도 나왔다. 참석 기업들은 과기정통부와 AMD의 MoU가 국내 AI 반도체 기업의 글로벌 생태계 진입 기회를 넓혔다고 평가하면서도 구체적인 공동 과제 발굴과 후속 실행이 필요하다고 강조했다. 과기정통부는 국산 NPU가 실제 데이터센터와 AI 서비스에서 활용될 수 있도록 풀스택 실증 지원을 강화할 방침이다. 추론 시장 확대를 국산 AI 반도체의 시장 진입 기회로 활용하겠다는 전략이다. 배경훈 부총리 겸 과기정통부 장관은 “글로벌 AI 시장이 학습에서 추론 중심으로 전환되면서 AI 경쟁의 무대도 개별 칩 성능을 넘어 전력 비용 효율성을 갖춘 개방형 AI 컴퓨팅 생태계 경쟁으로 확대되고 있다”며 “이는 추론 효율성에 강점을 가진 국내 NPU 기업에 새로운 기회가 될 것”이라고 말했다. 이어 “국산 NPU가 실제 데이터센터와 AI 서비스 현장에서 활용되는 성공 사례를 조속히 확보할 수 있도록 풀스택 실증 지원을 강화하고 관련 생태계 구축에 노력하겠다”고 밝혔다.

2026.08.20 17:01박수형 기자

[AI 리더스] 권경민 이노그리드 CTO "AI 인프라 경쟁력, GPU보다 운영 기술에 달렸다"

"그래픽처리장치(GPU)를 많이 확보했느냐보다 자원을 얼마나 효율적으로 운영하느냐가 앞으로 AI 인프라 경쟁력을 결정할 것입니다." 권경민 이노그리드 최고기술책임자(CTO)는 20일 서울 중구 본사에서 지디넷코리아와 만나 AI 인프라 시장 변화와 운영 기술 전략에 대해 이같이 밝혔다. 최근 정부와 기업들은 대규모 AI 인프라 구축을 목표로 최신 GPU 확보에 나서고 있다. 하지만 고가의 최신 GPU를 확보한 것 자체보다 이 자원을 다양한 워크로드에 맞춰 효율적으로 운영할 수 있는지가 새로운 경쟁력으로 떠오르고 있다는 게 권 CTO의 진단이다. 이노그리드는 이 변화에 맞춰 GPU 운영 효율화 기술을 개발하는 국책 과제 'GRIM-GPU' 프로젝트를 수행 중이다. 단순한 GPU 공유 기술을 넘어 가상머신(VM)과 컨테이너가 혼재된 환경에서 GPU를 유연하게 분할·재구성하고 성능 간섭을 최소화하는 AI 인프라 운영 기술을 확보하는 것이 목표다. GPU 확보 경쟁 다음 단계는 '운영 효율화' 권 CTO는 최근 2~3년 동안 AI 인프라 시장이 급격하게 변화했다고 짚었다. 그는 "초기 AI 시장에선 GPU를 빨리 수급하는 것이 경쟁력이었지만 최근에는 공급 부족 현상이 다소 완화되고 있다"며 "이제는 GPU를 어떤 서비스와 워크로드에 배치하고 기존 장비를 어떻게 효율적으로 활용할 것인지가 더 중요한 시점"이라고 설명했다. 그러면서 글로벌 빅테크와 같은 방식의 AI 인프라 경쟁은 국내 기업이 선택할 수 있는 전략이 아니라고 강조했다. 그는 "국내 소프트웨어(SW) 기업이 글로벌 기업처럼 막대한 자본을 투입해 GPU를 확보하는 방식으로 경쟁하기는 쉽지 않다"며 "기업과 기관이 이미 보유한 GPU를 효율적으로 활용할 수 있도록 지원하는 운영 기술에 집중해야 한다"고 말했다. 이에 이노그리드는 과학기술정보통신부와 정보통신기획평가원(IITP)이 추진하는 GRIM-GPU 프로젝트에 주관기관으로 참여해 GPU 공유와 재구성 기술 연구에 앞장서고 있다. VM·컨테이너 혼재 환경 해결하는 'GRIM-GPU' GRIM-GPU는 정부가 추진하는 AI 클라우드 경쟁력 강화 기술개발 사업 가운데 하나로, VM과 컨테이너가 혼재된 단일 노드 환경에서 GPU를 유연하게 공유하는 기술을 개발하는 것이 주 목적이다. 현재 AI 인프라는 크게 VM 기반 환경과 컨테이너 기반 환경으로 나뉜다. 문제는 두 환경의 GPU 활용 방식이 다르다는 점이다. 공공·금융 분야는 보안성과 격리 수준이 높은 VM을 선호하는 반면, AI 학습과 추론 환경은 쿠버네티스 기반 컨테이너를 중심으로 운영되는 경우가 많은 것으로 알려졌다. 이에 대해 권 CTO는 "기존에는 GPU를 활용하기 위한 VM과 컨테이너 환경을 각각 별도로 구성해야 했지만, GRIM-GPU는 워크로드 특성에 따라 단일 환경에서 GPU를 동적으로 할당하는 기술을 목표로 하고 있다"고 밝혔다. 특히 동적 재구성 기술이 이번 과제의 핵심 연구 분야다. 통상 업무를 하는 주간에는 추론 서비스에 GPU를 사용하다가 야간에는 대규모 AI 학습에 활용하는 구조로 자원 활용 방식을 빠르게 전환할 수 있어야 한다는 관점이 담겼다. 성능 간섭을 최소화하는 스케줄링 기술도 함께 개발 중이다. GPU 메모리와 SM, L2 캐시 등 다양한 자원의 사용 패턴을 분석해 워크로드 간 충돌을 사전에 예측하고 이를 완화하는 방식이다. 권 CTO는 "기존의 엔비디아 MIG 기술을 활용하면 자원 격리 수준은 높일 수 있지만, 다양한 서비스 환경에서 GPU를 빠르게 재구성하는 것은 또 다른 문제"라며 "이번 과제에선 GPU 재구성을 5초 이내에 수행하는 것을 주요 성능 지표(KPI) 가운데 하나로 설정했다"고 말했다. 이어 "GPU 한 장을 하나의 작업에만 사용하는 방식에서 벗어나 여러 워크로드를 동시에 안정적으로 운영할 수 있도록 구성할 것"이라고 덧붙였다. GRIM-GPU는 정부 공개SW 연구개발 과제로 추진되고 있다. 이에 따라 과제 결과물은 오픈소스로 공개된다. 이노그리드는 프로젝트 컨소시엄 차원의 깃허브 저장소를 운영 중이며 올해 하반기에는 초기 기술 버전을 공개할 예정이다. 공개된 기술은 개발자와 연구기관, 기업 등이 자유롭게 활용할 수 있도록 개방할 계획이다. GPUaaS·AI 데이터센터까지…통합 AI 인프라 플랫폼 확장 이노그리드는 이번 연구개발 성과를 단순 국책과제로 끝내지 않고 서비스형 GPU(GPUaaS)와 AI 클라우드 관리 플랫폼(CMP) 등 자사 솔루션으로 확장할 계획이다. 권 CTO는 "GRIM-GPU를 통해 확보한 GPU 공유와 스케줄링, 경량 모니터링 기술을 실제 제품에 적용할 예정"이라며 "궁극적으로는 GPU를 서비스 형태로 제공하는 GPUaaS의 기술적 기반이 될 것"이라고 밝혔다. 최근 NHN인재아이엔씨 합병 이후 회사의 AI 인프라 전략도 더욱 구체화되고 있다. 이노그리드는 프라이빗 클라우드 구축 역량을, NHN은 대규모 인프라 운영 경험을 각각 보유하고 있는 만큼 양사 강점을 결합해 리전형·모듈형 AI 데이터센터 시장을 공략하겠다는 구상이다. 현재 이노그리드는 서비스형 인프라(IaaS)부터 플랫폼(PaaS), 거대언어모델 운영관리(LLM옵스) 등 AI 인프라를 구성하는 솔루션 라인업을 갖췄다. 향후에는 GPU를 비롯한 신경망처리장치(NPU), 양자처리장치(QPU) 등 다양한 연산자원 운영과 AI 에이전트 관리 역량도 키운다는 목표다. 권 CTO는 "3년 안에 AI 데이터센터의 클라우드 영역부터 AI 가속기, 데이터 관리, 에이전트 운영까지 모두 아우를 수 있는 특화 플랫폼을 구축할 것"이라고 강조했다. 끝으로 그는 "GRIM-GPU 국책과제를 통해 얻은 성과를 오픈소스로 공공에 다시 환원할 것"이라며 "국내 AI 개발자와 연구기관이 모두 활용할 수 있는 AI 인프라 생태계를 구축하겠다"고 덧붙였다.

2026.08.20 10:36한정호 기자

망고부스트 "에이전트 시대 DPU·SW 결합…'AI 인프라계 애플' 도약"

인공지능(AI) 기술이 단순 추론을 넘어 스스로 판단하고 복잡한 과업을 수행하는 'AI 에이전트' 시대로 진입하면서, 폭발하는 데이터센터(DC) 워크로드를 감당하기 위한 인프라 혁신이 화두로 떠올랐다. 이에 국내 AI 시스템 반도체 스타트업 망고부스트는 이기종 하드웨어를 유기적으로 연결하는 고성능 '데이터처리장치(DPU)' 설계 기술과 추론 최적화부터 다루는 풀스택 소프트웨어 솔루션을 융합해 글로벌 AI 인프라 시장의 판도를 바꾸겠다는 출사표를 던졌다. 회사는 특정 하드웨어 벤더에 종속되지 않는 개방형 생태계와 개발자 친화적인 환경을 무기로 'AI 데이터센터계의 애플'로 도약한다는 포부다. 망고부스트는 2022년 김장우 서울대 교수가 설립한 AI 시스템 반도체 딥테크 기업이다. DPU 설계 원천기술과 인프라 최적화 소프트웨어를 아우르는 '풀스택(Full-stack) 솔루션'을 앞세워 글로벌 시장을 공략하고 있다. "단일 서버 한계 직면…유기적 연결 가속하는 DPU 필수" 망고부스트는 단일 GPU 서버 중심의 데이터 처리 방식이 이미 물리적, 비용적 한계에 직면했다고 진단한다. 서로 다른 GPU 모델과 원격 저장공간(스토리지), CPU 등을 묶어 하나의 거대한 유기적 시스템으로 동작하게 만드는 과정에서 심각한 데이터 통신 병목이 발생하기 때문이다. 이원석 망고부스트 전략기획팀 팀장은 "추론만 하던 시대에서 본격적인 AI 에이전트 시대가 열리며 처리해야 할 워크로드 단위가 비약적으로 커졌다"며 "동일 기종의 GPU 서버만으로는 전체 성능을 감당할 수 없어 이기종 장치들을 필연적으로 연결해야 하는데, 이때 발생하는 네트워크 오버헤드를 전담 가속하는 DPU가 차세대 데이터센터의 핵심 인프라로 부상하고 있다"고 강조했다. 망고부스트의 DPU는 시장을 과점 중인 엔비디아의 '블루필드(BlueField)'와 대비되는 설계 철학을 지닌다. 이 팀장은 "엔비디아 DPU는 하드웨어 가속을 최소화하고 내부 CPU 중심으로 가동되는 반면, 망고부스트는 하드웨어 가속 비중을 극대화해 극한의 네트워크 성능 향상을 이끌어낸다"고 설명했다. 생태계의 확장성 측면에서도 궤를 달리한다. 이 팀장은 "엔비디아 DPU가 자사 GPU와 소프트웨어에 최적화된 폐쇄적 생태계에 갇혀 있다면, 우리는 특정 벤더에 종속되지 않는 '스위스' 같은 중립적 지위를 지향한다"며 "엔비디아와 AMD GPU는 물론 국내외 이기종 NPU, 다양한 네트워크 스위치 장비까지 완벽히 연결하는 개방형 솔루션을 제공한다"고 말했다. "시장 적기 대응 위해 FPGA 주력…차세대 승부처는 ASIC" 현재 망고부스트는 개발에만 수년이 소요되는 주문형 반도체(ASIC) 대신 필드 프로그래머블 게이트 어레이(FPGA) 기반 DPU 제품 공급에 주력하고 있다. 변화 무쌍한 AI 네트워크 표준에 즉각적으로 대응하기 위해서다. 한성철 망고부스트 HW개발 그룹장은 "AI 데이터센터용 네트워크 요구사항이 쉼 없이 변하는 상황에서, 하드웨어 구조를 유연하게 바꿀 수 있는 FPGA 제품이 신규 프로토콜을 가장 신속하게 지원할 수 있는 무기"라고 말했다. 비용 효율성에 대해서도 소신을 밝혔다. 한 그룹장은 "초기 매몰 비용 감안하면 대량 양산 전 적정 수량 단계에서는 FPGA가 훨씬 경제적이며, 전체 GPU 랙(Rack) 시스템 관점에서는 총소유비용(TCO) 절감 효과가 압도적"이라면서도 "데이터 전송량과 전력 효율 니즈가 극대화되는 시점에 맞춰 ASIC으로 승부하기 위해 철저하게 준비 단계를 거치고 있다"고 말했다. 실제로 보수적인 기준에서도 망고부스트의 솔루션은 동급 시스템 대비 약 30%의 TCO 절감 효과를 내는 것으로 파악됐다. 이러한 기술력은 대규모 투자와 글로벌 파트너십 확대로 이어지고 있다. 최근 AMD의 리사 수 최고경영자(CEO)가 직접 방문해 긴밀한 파트너십을 논의했으며, 해외 대형 하이퍼스케일러들과의 공동 솔루션 구축도 활발히 진행 중이다. 국내에서는 주요 K-클라우드 국책 사업 참여와 더불어 국산 NPU 기업들과의 시스템 연동을 강화하고 있다. 현재 누적 투자 유치액 1억 달러(약 1300억원)를 넘긴 상태로, 시리즈 B 펀딩 마무리도 눈앞에 뒀다. 미국 법인을 거점으로 글로벌 인재 확보에도 사활을 걸고 있다. 한 그룹장은 "단순히 DPU 반도체 부품이나 단품 소프트웨어를 파는 회사에 머물지 않겠다"며 "특정 하드웨어에 얽매이지 않고 모든 에코시스템을 유기적으로 엮어 최고 가성비의 시스템 최적화를 이끌어내는 리더, 즉 'AI 데이터센터계의 애플'로 도약할 것"이라고 포부를 밝혔다. '망고 LLM 부스트'로 추론 최적화…SDK로 DPU 문턱 낮춰 망고부스트는 AI 추론 소프트웨어 '망고 LLM 부스트'와 소프트웨어 개발 키트(SDK)를 앞세워 AI 인프라 영역을 넓히고 있다. DPU를 넘어 추론 최적화와 데이터 이동, AI 에이전트 라우팅까지 아우르는 SW 스택을 구축에 한창이다. 김창수 망고부스트 어드밴스드 AI 팀장은 망고 LLM 부스트가 가상거대언어모델(vLLM) 같은 일반 LLM 추론 프레임워크보다 넓은 범위를 다룬다고 강조했다. 기존 프레임워크가 GPU에서 LLM을 구동하는 데만 초점 맞춘다면, 망고 LLM 부스트는 여러 추론 작업을 관리하고 사용자 요청을 적절한 GPU로 보내는 기능까지 지원한다는 설명이다. 김 팀장은 AI 에이전트 시대에 망고 LLM 부스트 역할이 더 커질 것으로 봤다. 에이전트가 긴 대화와 복잡한 작업을 수행할수록 LLM이 앞서 계산한 내용을 임시 저장하는 'KV 캐시'도 덩달아 늘어나서다. 그는 "망고 LLM 부스트는 방대한 KV 캐시를 저장하고 재사용하거나, 필요한 GPU로 옮기는 과정을 관리한다"며 "한번 계산한 내용을 재활용하면 같은 연산을 반복하지 않아도 돼 추론 속도를 높일 수 있다"고 설명했다. 이어 "KV 캐시가 커져 GPU에 모두 보관하기 어려워지면 스토리지나 다른 GPU로 데이터를 옮겨야 한다"며 "이때 LLM 부스트가 캐시 저장 활용을 돕고, DPU가 실제 데이터 이동을 지원하는 양방향 구조로 작동한다"고 덧붙였다. 망고부스트는 SDK를 통해 DPU 사용 문턱도 낮추고 있다. 개발자가 DPU 구조나 복잡한 저수준 프로그래밍을 직접 익히지 않아도 주요 기능을 쓸 수 있도록 지원하는 방식이다. 김 팀장은 "DPU를 직접 프로그래밍하려면 새로운 개발 환경을 익혀야 해 부담이 크다"며 "개발자가 필요한 기능만 쉽게 가져다 쓸 수 있도록 만드는 것이 SDK 목표"라고 설명했다. 망고인퍼런스는 추론 환경에서 데이터 병목을 해결하는 DPU 부스트X(BoostX) 기술과 에이전트 운영체제(OS)를 효율화하는 'LLM 부스트'를 결합한 형태다. 개발자가 익숙한 API 형태로 AI 인프라 기능을 손쉽게 활용할 수 있도록 지원한다. 개발자와 스타트업 등은 HW 를 직접 제어하거나 복잡한 구현을 수행할 필요 없이 API 호출만으로 필요한 기능을 간편하게 활용할 수 있다. 망고인퍼런스는 올해 하반기 출시될 예정이다.

2026.08.19 14:57전화평 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

‘피지컬AI’ 예산 3배로 증액…과기정통부, 전 부처 CTO 역할

[르포] "단순 판매 아닌 브랜드 알리기"…카카오페이 '착한 팝업스토어' 가보니

[현장] 이수정 IBM 사장 "AI 경쟁, 핵심은 모델 아닌 운영"

과기정통부, 내년 AI 예산 85% 증액…독자모델·산업·국민 AI 키운다

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.