• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'DGX-A100 GPU'통합검색 결과 입니다. (526건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI 고속도로] 엔비디아·AMD 손잡은 韓…AI 인프라 생태계 다변화

정부가 엔비디아에 이어 AMD와도 인공지능(AI) 컴퓨팅 협력을 확대하면서 국내 AI 인프라 생태계가 다변화하고 있다. 특정 그래픽처리장치(GPU) 중심 구조에서 벗어나 중앙처리장치(CPU)·GPU·신경망처리장치(NPU)를 함께 활용하는 개방형 인프라 구축이 본격화되면서 데이터센터와 클라우드, AI 반도체, 시스템 소프트웨어(SW) 기업까지 참여하는 생태계 확장이 빨라질 것이란 전망이 나온다. 2일 업계에 따르면 최근 정부는 엔비디아와 GPU 협력에 이어 AMD와 AI 반도체 생태계 구축을 위한 협력을 본격화하고 있다. AI 컴퓨팅 경쟁의 중심이 단일 GPU 확보를 넘어 다양한 연산 자원을 효율적으로 조합하는 구조로 이동하면서 국내 AI 인프라 전략 역시 생태계 중심으로 확대되는 모습이다. 최근 정부가 AMD와 체결한 양해각서(MOU)의 핵심도 개방형 AI 컴퓨팅 생태계 구축이다. AMD CPU·GPU와 국산 NPU를 연계한 이기종 AI 컴퓨팅 인프라를 구축하고 메모리와 데이터처리장치(DPU), 컴퓨트익스프레스링크(CXL), 네트워크, 서버, 오케스트레이션 SW 등 국내 기업이 함께 참여하는 개방형 AI 컴퓨팅 생태계를 조성하는 데 초점을 맞췄다. 이는 최근 AI 인프라 경쟁 양상이 달라지고 있어서다. 대규모 AI 모델 학습 중심에서 AI 에이전트와 기업용 생성형 AI 서비스 확산으로 추론 수요가 빠르게 증가하면서 GPU 하나만으로 모든 연산을 처리하기보다 CPU와 GPU, NPU를 워크로드에 맞게 조합하는 방식이 효율성과 비용 측면에서 주목받고 있다. 실제 정부 역시 올해 AI 컴퓨팅 자원 확충 사업을 통해 엔비디아 차세대 GPU를 대규모 확보하는 동시에 국가AI컴퓨팅센터와 국산 NPU 생태계 육성을 병행 중이다. GPU 확보와 함께 다양한 AI 반도체가 함께 활용되는 환경을 구축해 국내 AI 인프라 경쟁력을 높인다는 구상이다. 민간 기업들의 움직임도 비슷하다. 최근 네이버는 엔비디아와 브룩필드로부터 대규모 투자를 유치해 글로벌 AI 팩토리 구축과 GPU 공급망 확보에 나섰다. 엔비디아와 긴밀한 파트너십을 기반으로 국내 데이터센터 확장을 추진하는 가운데, 올해 초 AMD와도 협력해 하이퍼클로바X 운영 환경에 AMD GPU를 적용하는 방안을 추진하는 등 AI 인프라 선택지를 확대한 모습이다. AI 스타트업들도 같은 흐름을 보이고 있다. 대표적으로 업스테이지는 국가대표 AI 모델 개발 과정에서 AMD GPU와 ROCm 생태계를 활용하기로 했으며 정부의 독자 AI 모델 프로젝트와도 연계해 개방형 AI 플랫폼 기반을 확대하고 있다. IT서비스·클라우드 업계 역시 변화 속도를 높이고 있다. 삼성SDS, LG CNS, KT클라우드 등은 국산 NPU를 활용한 서비스형 NPU(NPUaaS)와 관련 플랫폼을 잇달아 출시해왔다. GPU 중심 인프라에서 벗어나 고객이 AI 서비스 특성에 맞춰 GPU와 NPU를 선택할 수 있도록 하면서 AI 인프라 사업 영역을 확대한다는 방침이다. 이같은 변화는 AI 인프라 경쟁의 범위도 넓히고 있다. 과거에는 GPU 확보 자체가 경쟁력이었다면 최근에는 데이터센터와 전력, 냉각, 네트워크, 서버, 클라우드 플랫폼, AI 운영 SW까지 통합 제공할 수 있는 역량이 새로운 경쟁 요소로 부상 중이다. 정부 역시 AI 경쟁력을 반도체 공급에만 국한하지 않고 데이터센터와 AI 컴퓨팅 자원, 테스트베드, 산업 생태계를 모두 연결하는 종합 AI 인프라 전략으로 확대하고 있다. AI 생산기지와 데이터센터 허브를 구축하고 국내외 기업이 함께 참여하는 협력 구조를 강화하겠다는 목표다. 글로벌 빅테크들의 움직임도 이러한 흐름을 뒷받침한다. 엔비디아와 AMD는 최근 잇따라 국내 AI 연구센터 설립 계획을 발표하며 한국을 아시아 AI 거점으로 육성하겠다는 전략을 내놨다. 단순한 반도체 판매를 넘어 연구개발과 인재 양성, 생태계 확대까지 경쟁 환경이 넓어지고 있다는 평가다. 배경훈 부총리 겸 과학기술정보통신부 장관은 "대한민국이 AI 3대 강국으로 도약하기 위해서는 자립적이면서도 개방적인 AI 컴퓨팅 인프라 기반 확보가 중요하다"며 "AMD와의 협력을 통해 국내 AI 반도체 생태계 경쟁력을 높이고 글로벌 AI 컴퓨팅 인프라 변화에 대응하는 새로운 협력 모델을 만들어 갈 수 있을 것"이라고 밝혔다.

2026.08.02 10:25한정호 기자

"中 AI 유니콘 문샷 AI, 알리바바서 엔비디아 칩 2만대 제공받아"

최근 오픈소스 인공지능(AI) 모델 '키미 K3(Kimi K3)'를 공개하며 주목을 받은 중국 AI 스타트업 문샷 AI가 알리바바 그룹으로부터 엔비디아 칩 2만 대를 제공받아왔다고 보도됐다. 급성장 중인 중국 AI 기업의 미국 반도체 의존도가 여전히 높다는 분석이 나온다. 블룸버그 통신은 관련 비공개 계약 내용을 잘 아는 관계자들을 인용해 알리바바가 자사 클라우드 인프라를 통해 문샷 AI에 엔비디아 칩 기반의 연산 능력을 공급해 왔다고 지난달 31일(현지시간) 보도했다. 문샷 AI는 지난 7월 중순 일부 성능 지표에서 미국 오픈AI나 앤트로픽 최신 모델과 어깨를 견주는 키미 K3를 선보이며 파장을 일으켰다. 그러나 시장 관심은 문샷이 미국 정부의 전방위 제재 속에서 어떻게 고성능 컴퓨팅 자원을 확보했는지에 쏠렸다. 보도에 따르면 알리바바가 문샷 AI에 제공하는 연산능력 기반은 엔비디아의 호퍼 아키텍처 기반 칩 약 2만 대다. 복수 관계자들은 해당 칩이 호퍼 시리즈 중 가장 성능이 뛰어난 'H200'이라고 말했다. 알리바바 대변인은 "문샷 AI에 H200 칩을 공급했다는 주장은 전혀 사실무근"이라며 H200 제공 의혹을 부인했다. 하지만 실제 공급한 전체 엔비디아 칩 수량이나 구체적 모델명에 대해서는 말을 아꼈다. 미국 정부는 문샷 AI가 규제 허점을 이용해 엔비디아 최신 '블랙웰' 칩까지 활용했다는 의혹을 제기했다. 마이클 크라시오스 미 백악관 과학기술정책실장은 "문샷 AI가 태국에 위치한 제3자 업체를 통해 블랙웰 칩의 임대 연산 자원에 접근했고, 이를 '키미 K3' 학습에 활용했다"고 비판했다. 미국의 수출 규제법상 중국 기업이라도 해외 서버에 탑재된 최첨단 반도체 연산 능력을 임대하는 방식은 일부 허용되고 있어, 중국 기업들이 이를 우회 통로로 활용하고 있다는 지적이 나온다. 문샷 AI의 조달 사정에 정통한 관계자 역시 태국 등 동남아시아를 거쳐 블랙웰 연산 자원에 접근하는 채널이 존재한다고 인정했다. 한편, 이번 사태로 빅테크 기업과 스타트업 간 미묘한 경쟁 관계도 조명받고 있다. 알리바바는 문샷 AI의 주요 투자자 중 하나이지만, 알리바바 인프라를 바탕으로 개발된 문샷 AI의 키미 K3가 정작 알리바바 자체 AI 모델 '통이치엔원(Qwen)'의 성과를 앞지르면서 알리바바 내부에 복잡한 기류가 형성된 것으로 전해졌다.

2026.08.02 08:00전화평 기자

[기고] 인공지능의 수명

챗GPT 등장 이후 인공지능(AI)과 신기술, 혁신적인 서비스의 개발을 해하지 않으면서도 이용자의 권리와 개인정보를 보호하려면 어떤 것을 고려해야 할 지에 대한 논의가 최근 활발해진 분위기다. 급변하는 정보사회에서 AI와 개인정보 보호에 있어 우리 사회가 취해야 할 균형 잡힌 자세가 어떤 것인지에 대해 법무법인 태평양 AI팀에서 [AI 컨택]을 통해 2주 마다 다뤄보고자 한다. [편집자주] 사람은 영생하지 못한다. 그렇다면 사람이 아닌 인공지능은 영생할 수 있을까. 인공지능은 생물학적 몸을 가진 존재가 아니므로 늙어 죽지는 않지만 하드웨어인 그래픽처리장치(GPU) 수명, 소프트웨어 업데이트 주기, 학습 데이터 유효성에 따라 수명이 결정된다. GPU는 통상 2년에서 5년 주기로 교체되고 소프트웨어는 지속적으로 업데이트되지만 2년 정도면 모델 자체가 바뀐다고 한다. 학습에 사용되는 데이터 역시 세상의 정보와 이용자의 요구가 달라지면서 1~2년만 지나도 낡은 정보가 되어 그대로 쓰기 어렵다. 결국 인공지능 수명은 길게 잡아도 5년 남짓이라는 이야기가 된다. 그러나 조금 더 들여다보면 다르게 보인다. GPU가 5년 뒤에 교체되는 것은 작동할 수 없게 돼서가 아니다. 성능이 향상되고 전력 소모가 적은 새로운 하드웨어가 출시되고 소프트웨어가 요구하는 성능도 높아지면서 효율 측면에서 오래된 하드웨어가 밀려나는 것일 뿐이다. 교체 주기가 지났다고 GPU가 멈추는 것은 아니므로 원래 소프트웨어가 그대로라면 오래된 하드웨어 위에서도 인공지능은 계속 작동할 수 있다. 반대로 하드웨어가 바뀌더라도 인공지능을 움직이는 소프트웨어가 유지된다면 동일한 인공지능이 수명을 이어간다고 볼 수 있을 것이다. 인공지능의 수명을 짧게 만드는 것은 오히려 소프트웨어 쪽이다. 학습해야 할 세상의 정보가 달라지고 이용자의 요구가 달라지니 인공지능 모델도 바뀌어야 한다는 것이다. 2022년 11월 오픈AI가 GPT-3.5 기반 챗GPT를 내놓은 뒤 이듬해 3월에 GPT-4를 발표했고 다른 인공지능 기업들도 반년에서 1년 간격으로 새로운 모델을 내놓았다. 4년이 채 지나지 않은 현재 기업 간 경쟁 때문인지 새로운 버전의 인공지능이나 동영상 생성 같은 새로운 기능이 발표되는 간격이 두 달이 안 될 정도로 짧아졌다. 2024년 5월에 발표돼 선풍적인 인기를 끌었던 GPT-4o만 해도 현재는 일반 이용자가 선택해 쓸 수 없게 됐다. 챗GPT 서비스가 모두 GPT-5 모델로 대체된 영향이다. 경쟁 모델인 클로드나 제미나이도 사정은 비슷하다. 같은 인공지능 모델을 2년 넘게 쓰기 어려운 상황이니 스마트폰의 교체 주기보다도 짧은 셈이다. 이용자 입장에서는 모델이 바뀌어도 이전에 나눈 대화를 기억하고 답해 준다면 같은 인공지능이라고 여길 수도 있다. 그러나 그것이 다른 인공지능이라는 점은 부인하기 어렵다. 인공지능의 수명을 결정하는 것은 하드웨어보다 소프트웨어 영향이 크다. 그 소프트웨어는 사람들이 살아가며 끊임없이 만들어 내는 세상의 정보와 인공지능에 거는 기대가 달라지기 때문에 변한다. 인공지능의 수명을 정하는 것은 다름 아닌 사람들의 삶과 기대다. 지금과 같은 경쟁적 발전이 언제까지 이어질지 알기는 어렵다. 다만 오래도록 이용자와 함께 성장하고 의지가 되주는 인공지능이 나타나기를 바란다.

2026.07.31 16:52류광현 컬럼니스트

래블업, 코스닥 상장예심 통과…AI 인프라 해외 공략 속도

래블업이 코스닥 상장예비심사를 통과하고 기업공개 절차 추진에 시동 걸었다. 래블업은 지난 5월 21일 한국거래소에 상장예비심사를 청구한 뒤 약 두 달 만에 승인받았다고 31일 밝혔다. 대표 주관사는 NH투자증권이다. 래블업은 그래픽처리장치(GPU)를 비롯한 고성능 컴퓨팅 자원을 통합 운영하는 AI 인프라 플랫폼 기업이다. 주력 제품 '백엔드.AI'는 인공지능(AI) 모델 개발과 학습부터 배포·운영까지 필요한 컴퓨팅 자원을 통합 환경에서 관리한다. 백엔드.AI는 물리적 GPU를 논리적으로 나눠 여러 작업이 동시에 사용할 수 있도록 지원한다. 자체 개발한 '소코반 오케스트레이터'는 작업별 우선순위와 자원 수요에 따라 GPU를 자동 배분해 한정된 자원의 활용률을 높인다. 특정 제조사 장비에 종속되지 않는 범용성도 확보했다. 엔비디아와 AMD·인텔 GPU·AI 가속기를 비롯해 국내외 신경망처리장치(NPU)를 통합 관리하며 온프레미스와 퍼블릭 클라우드·하이브리드 환경을 모두 지원한다. 래블업은 정부 '독자 AI 파운데이션 모델 개발' 사업에서 업스테이지 컨소시엄의 인프라 파트너로 참여했다. 1차수에서 500여 장 이상과 2차수에서 880여 장 이상의 엔비디아 B200·H100 GPU 클러스터 운영을 지원하며 '솔라 오픈 100B'와 '솔라 오픈 2 250B' 학습을 뒷받침했다. 현재 국내외 120개 이상 사이트에 백엔드.AI를 공급하고 있다. KT와 삼성전자·신한은행·현대모비스·LG전자·대한민국 해군·삼성서울병원 등이 플랫폼을 활용하고 있으며 미국과 영국·브라질·태국에서도 고객을 확보했다. 글로벌 기술기업과 협력도 확대하고 있다. 아시아·태평양 지역에서 처음으로 엔비디아 'DGX-레디 소프트웨어 파트너'에 선정된 바 있다. 인텔과 델테크놀로지스·배스트데이터 등과 협력 관계를 구축했다. 래블업은 상장예비심사 청구에 앞서 한국거래소가 지정한 전문평가기관 두 곳으로부터 모두 A등급을 받았다. 상장으로 확보한 자금은 연구개발 고도화와 글로벌 시장 확대·인프라 확장에 투입할 계획이다. 해외 사업은 북미와 일본·동남아시아·유럽·중동을 중심으로 확대한다. 글로벌 AI 인프라 투자 증가와 각국의 소버린 AI 정책 강화에 대응해 현지 사업 기반을 넓힌다는 방침이다. 신정규 래블업 대표는 "우리가 축적한 AI 인프라 기술력과 사업화 역량을 인정받아 올해 코스닥 일반기업 가운데 가장 짧은 기간에 상장예비심사 승인을 받게 돼 매우 기쁘다"며 "이번 승인을 계기로 남은 공모 절차도 차질 없이 준비해 성공적인 코스닥 상장을 추진하겠다"고 말했다.

2026.07.31 15:20김미정 기자

[컨콜] 삼성SDS "하반기 공공·금융 AX 확대…IT서비스 영업이익률 12% 회복 목표"

삼성SDS가 하반기 공공과 금융 분야 인공지능 전환(AX) 사업 확대를 바탕으로 IT서비스 수익성을 지난해 수준으로 회복하겠다는 목표를 밝혔다. 김태호 삼성SDS 경영지원담당 부사장은 30일 2분기 실적 발표 컨퍼런스콜에서 "하반기에는 공공 및 금융 중심의 매출 증가와 지속적인 수익성 제고 활동을 통해 IT서비스 영업이익률을 지난해 수준인 12% 수준으로 회복할 것으로 보인다"고 말했다. 그는 "특히 2분기 클라우드 사업 매출은 7794억원으로 전년 동기 대비 17% 증가했고 대외 매출은 금융·공공·조선 등 다양한 업종의 고객 확보를 통해 전년 대비 75% 증가하며 성장을 견인했다"고 설명했다. 이어 "CSP 부문은 삼성 클라우드 플랫폼(SCP) 수요 증가와 해외 서비스형 GPU(GPUaaS) 확대로 성장했고 MSP는 금융 AX 사업과 글로벌 AI 서비스 도입 확산이 실적을 이끌었다"고 덧붙였다. 그러면서 "하반기에는 과학기술정보통신부 GPU 사업 등을 통해 GPUaaS 서비스를 확대하고 삼성 계열사의 글로벌 AI 서비스 도입과 금융·공공 고객 대상 AX 사업 신규 수주를 통해 성장을 이어갈 것"이라며 "서비스형 소프트웨어(SaaS) 부문은 범정부 지능형 플랫폼 사업에서 과반 이상의 고객을 확보해 구독 기반의 안정적인 매출을 확보할 것으로 기대한다"고 밝혔다. 끝으로 그는 "물류 사업은 블랙프라이데이 등 계절적 성수기 효과와 대외 사업 확대로 성장세가 예상되지만, 중동 정세 불안이 지속되고 있어 불확실성은 여전히 존재한다"고 설명했다.

2026.07.30 14:46한정호 기자

나무에이엑스, VM웨어 대체 시장 정조준…자체 플랫폼 '나무버트' 공개

나무에이엑스가 자체 개발한 서버 가상화 플랫폼을 선보이며 인공지능(AI) 인프라 포트폴리오 확대에 나선다. VM웨어 라이선스 정책 변경으로 대체 플랫폼 수요가 커지는 가운데 공공기관과 중소·중견기업을 중심으로 서버 가상화 시장 공략을 강화한다는 목표다. 나무에이엑스는 자체 서버 가상화 플랫폼 '나무버트(namuVIRT)'를 개발했다고 30일 밝혔다. 회사 측에 따르면 VM웨어 라이선스 정책 변경 이후 계약 갱신을 앞둔 기업들의 대체 플랫폼 검토가 이어지고 AI 학습·추론을 위한 그래픽처리장치(GPU) 활용이 확대되면서 서버 가상화 기술 중요성이 높아지고 있다. 나무에이엑스는 20년 이상 축적한 가상화 기술과 구축 경험을 바탕으로 자체 서버 가상화 기술을 확보해왔다. 나무버트는 컴퓨트·스토리지·네트워크 자원을 단일 콘솔에서 통합 관리하는 KVM 기반 서비스형 인프라(IaaS) 플랫폼이다. 대규모 가상머신(VM)을 안정적으로 운영할 수 있도록 설계됐으며 자원 활용도를 높여 기업의 인프라 운영 부담을 줄이는 것이 특징이다. 특히 VM웨어 환경에서 운영 중인 가상머신을 KVM 기반으로 이전하는 마이그레이션 기능을 제공한다. 이기종 하이퍼바이저 간 전환을 지원해 기존 인프라 자산을 유지하면서도 전환 부담을 줄일 수 있어 초기 구축 비용과 운영·유지보수 비용 절감에도 도움이 된다는 게 회사 측 설명이다. 고가용성(HA), 라이브 마이그레이션, GPU 및 가상 GPU(vGPU) 등 엔터프라이즈 환경에서 요구되는 핵심 기능도 지원한다. GPU 기반 AI 워크로드를 안정적으로 처리하도록 설계했으며 자체 개발한 '칵테일클라우드'의 GPU 옵티마이저와 연계해 AI 학습·추론 환경에서 GPU 자원을 효율적으로 운영할 수 있도록 구성했다. 나무에이엑스는 나무버트를 국내 인프라 환경에 최적화한 국산 서버 가상화 플랫폼으로 서버 자원 활용률을 높여 운영 효율과 비용 절감을 지원한다는 목표다. 구축부터 유지보수까지 전 과정을 아우르는 기술 서비스도 함께 제공할 방침이다. 나무에이엑스 측은 "나무버트를 추가하며 서버 가상화를 비롯해 AI 에이전트, 클라우드 네이티브 플랫폼(PaaS), 클라우드 관리 플랫폼(CMP), 디지털 워크스페이스를 아우르는 AI 인프라 포트폴리오를 완성했다"고 강조했다. 이어 "앞으로 VM웨어 전환 수요가 늘어나는 공공기관과 중소·중견기업을 중심으로 영업을 강화하고 비용 효율적인 서버 가상화와 AI 인프라 시장 공략을 본격화할 계획"이라고 덧붙였다.

2026.07.30 09:33한정호 기자

"두 달 만에 맞춤형 AIDC 지어 드려요"...바로AI, 모듈형 HACC 승부수

"바로AI는 30평 공간과 300kW 전력만 확보되면, 어느 건물이든 두 달 반 만에 고객이 원하는 사양의 데이터센터를 구축합니다." 이용덕 바로AI 대표는 최근 지디넷코리아와 인터뷰에서 바로AI의 모듈형 데이터센터 사업을 이같이 소개했다. 이 대표는 "AI 데이터센터 시장이 대형화 경쟁에 들어갔지만 모든 기업이 대규모 인프라가 필요한 것은 아니다"라며 "고성능 그래픽처리장치(GPU) 확산으로 전력과 발열 부담이 커지고 GPU 세대교체 주기도 빨라지는 만큼, 필요한 규모만큼 구축하고 수요가 늘어날 때 확장하는 방식이 효율적"이라고 설명했다. 바로AI가 개발한 모듈형 하이브리드 AI 컴퓨팅 센터(HACC)는 이 같은 전략을 구현한 제품이다. 지난해 평택 지식산업센터에 30평 규모 모듈 2개를 구축한 것이 첫 양산 모델이다. 기존 데이터센터처럼 대규모 시설을 먼저 짓고 GPU를 채우는 방식이 아니라 고객이 필요한 GPU 규모에 맞춰 인프라를 구축하고 이후 수요에 따라 모듈을 추가한다. 이 대표는 이를 '나만의 AI, 나만의 데이터센터' 전략이라고 설명했다. 기업마다 개발하는 AI 모델과 데이터 규모가 다른 만큼 획일적인 대규모 인프라보다 맞춤형 구축이 필요하다는 것이다. GPU 세대교체 빠른데…"처음부터 다 살 필요 없다" 바로AI가 모듈형 데이터센터를 강조하는 배경에는 GPU의 높은 가격과 빠른 세대교체가 있다. 데이터센터를 먼저 크게 구축한 뒤 GPU를 한꺼번에 채우면 초기 투자 부담이 커지는 데다, 2~3년 뒤에는 기존 GPU를 교체해야 할 위험도 있다는 설명이다. 바로AI는 한 고객사가 GPU 서버 40대 규모 프라이빗 클라우드를 요청했지만, 우선 20대만 구축하자고 역제안한 사례도 소개했다. 고객 연구개발 상황을 고려해 필요한 시점에 추가 증설하는 것이 총소유비용(TCO) 측면에서 유리하다고 판단했기 때문이다. HACC 기반에는 바로AI가 7년간 개발해온 수냉 GPU 서버 '포세이돈'이 있다. 바로AI는 GPU에서 발생하는 열을 서버 내부에서 직접 제어하는 수냉 기술을 적용해 별도 대규모 외부 냉각설비 의존도를 낮췄다. '인쇄회로기판(PCB) 냉각 블록 및 제조방법' 특허와 '수냉각 GPU 서버' 특허 등 등록 특허 2건도 확보했다. 이 대표는 "서버는 하드웨어와 소프트웨어의 결합체이고, 하드웨어는 수많은 경험과 문제 해결을 거치면서 향상된다"며 "바로AI 서버는 지난 7년간 끊임없이 열과 소음을 잡아온 결과물"이라고 말했다. 현재 포세이돈은 89개 대학의 350여개 연구실, 86개 B2B 기업, 7개 종합병원, 28개 정부기관 등에 공급됐다. 재구매율은 70%를 넘는다는 게 이 대표 설명이다. 회사는 해당 기술을 발전시켜 랙(Rack) 단에서 열을 잡는 수냉 시스템을 개발하고 있다. 바로AI는 GPU 서버에서 출발해 프라이빗 클라우드와 데이터센터까지 사업 영역을 넓혔다. 고객이 서버를 늘리면서 이를 묶어 관리할 클라우드가 필요해졌고, 이후 유지보수까지 직접 제공하는 풀스택 구조를 구축했다. 3년간 하드웨어·소프트웨어 보증을 제공하고 분기별 고객 방문을 통해 장비 상태를 점검하는 '디스턴스 제로(Distance Zero)' 전략도 운영한다. 고객과 거리를 '0'으로 만드는 걸 뜻한다. 이 대표는 "단순히 장비를 판매하는 데 그치지 않고 고객이 어떤 AI를 개발하는지 파악해 다음에 필요한 인프라까지 제안한다는 전략"이라고 말했다. "데이터센터보다 AI 도입 기업 늘려야"…산업 AX 정조준 바로AI가 정조준하는 시장은 제조·물류 등 전통 산업 현장에 AI를 적용하는 'AX'다. 이 대표는 대규모 데이터센터 숫자를 늘리는 것보다 AI를 실제 도입하고 개발하는 기업의 숫자를 늘리는 것이 중요하다고 강조했다. 그는 "전통 산업의 최고경영자(CEO)들을 만나면 AI를 하고 싶은데 무엇을 어떻게 해야 할지 모르겠다는 이야기를 많이 한다"며 "바로AI는 HACC와 온프레미스 기술을 기반으로 2·3차 산업과 공장에 AI를 접목해 이들의 비즈니스 모델 자체를 바꾸는 역할을 하고 싶다"고 말했다. 바로AI는 지난해 90억원의 매출을 기록했다. 창업 후 연평균성장률(CAGR)은 약 95%다. 매출의 최소 30%를 연구개발(R&D)에 투자하며 기술 개발에 집중해왔다. 이제 1차 플랫폼 개발을 마무리하고 시장 확산을 위한 외부 투자와 파트너십도 검토하고 있다. 이 대표는 "필요한 만큼 만들고 필요할 때 확장하는 AI 인프라가 앞으로 중요해질 것"이라며 "바로AI가 기업의 AI 도입을 돕고 산업별 AX 플랫폼으로 성장할 수 있는 기반을 만들겠다"고 강조했다. Who is | 이용덕 바로AI 대표 이용덕 대표는 AI 반도체와 GPU 인프라 분야에서 오랜 경험을 쌓은 기업인이다. 2002년부터 2006년까지 브로드컴 코리아 초대 지사장을 역임한 뒤, 2006년부터 2018년까지 엔비디아코리아 지사장으로 근무했다. 이후 2019년 바로AI를 창립하고 지금까지 대표로 회사를 운영 중이다.

2026.07.28 16:23전화평 기자

메가존클라우드, 국내 유일 '삼성 클라우드 플랫폼' 최상위 파트너 승격

메가존클라우드가 삼성SDS의 삼성 클라우드 플랫폼(SCP) 파트너 프로그램에서 최상위 등급인 '플래티넘 파트너'로 선정됐다. 공공 클라우드와 인공지능(AI)·그래픽처리장치(GPU) 클라우드 분야에서 쌓은 사업 수행 경험과 기술력을 인정받았다는 평가다. 메가존클라우드는 삼성SDS SCP 파트너 프로그램에서 최고 등급인 플래티넘 파트너로 승격됐다고 28일 밝혔다. 현재 SCP 플래티넘 파트너는 메가존클라우드가 유일하다. 회사는 지난해 8월 SCP '어드밴스드 파트너' 등급을 획득한 데 이어 약 1년 만에 최상위 등급으로 승격됐다. 이번 승격은 SCP 기반 클라우드 사업 수행 역량과 기술 전문성, 고객 지원 역량 등을 종합적으로 인정받은 결과라고 회사 측은 설명했다. SCP 파트너 등급은 신규 계약 건수와 사업 실적, 교육 과정 이수 인원, 자격 취득 현황 등을 종합 평가해 부여된다. 사업 실적은 최근 1년간의 성과를 기준으로 산정된다. 메가존클라우드는 공공 분야에서 다수의 SCP 기반 사업을 수행하는 한편 AI와 고성능컴퓨팅(HPC), 서비스형 GPU(GPUaaS) 등 고성능 인프라 분야에서도 사업 성과를 확보해 플래티넘 등급 요건을 충족했다고 밝혔다. 대표 사례로는 국민권익위원회 정부합동민원센터 통합콜센터와 국가나노인프라 통합정보시스템 구축 사업 등이 꼽힌다. 또 한국정보통신기술협회(TTA) AI 경진대회 컴퓨팅 자원 지원과 서울AI허브 고성능컴퓨팅 인프라 지원 사업 등을 수행하며 AI 연구·개발을 위한 GPU 인프라 구축 역량을 입증해왔다. 서민택 메가존클라우드 부사장은 "이번 선정은 SCP 기반의 다양한 공공사업 수행 경험과 AI·GPU 클라우드 분야에서 축적한 기술 역량을 인정받은 결과"라며 "K-클라우드를 아우르는 멀티클라우드 역량으로 소버린 AI 시대에 기관·기업이 요구하는 안전하고 유연한 AI·GPU 인프라를 구현하는 핵심 파트너로 자리매김할 것"이라고 말했다.

2026.07.28 11:04한정호 기자

슈퍼마이크로, 최신 AMD 에픽 시리즈 서버 공개…AI 데이터센터 겨냥

슈퍼마이크로가 최신 AMD 프로세서를 적용한 신규 서버 포트폴리오를 공개하며 기업 인공지능(AI) 인프라 시장 공략을 강화한다. 차세대 중앙처리장치(CPU)와 그래픽처리장치(GPU)를 결합한 데이터센터 플랫폼으로 AI 학습·추론·고성능컴퓨팅(HPC) 등 다양한 워크로드를 지원한다는 전략이다. 슈퍼마이크로는 6세대 AMD 에픽(EPYC) 9006 시리즈 CPU를 탑재한 차세대 H15 서버 포트폴리오를 출시했다고 27일 밝혔다. 신규 제품군은 AMD 인스팅트 GPU와 펜산도 네트워킹을 기반으로 AI와 클라우드, 엔터프라이즈 환경을 지원하도록 설계됐다. H15 서버는 최대 256코어·512스레드를 지원하며 클라우드와 엔터프라이즈, 스토리지, HPC, 에이전틱 AI 워크로드를 핵심 수요로 겨냥한다. 회사에 따르면 이전 세대 대비 CPU 성능은 최대 1.7배 향상됐으며 코어 수는 33%, PCIe 대역폭은 2배, 메모리 대역폭은 2.6배 확대됐다. 이를 통해 기존 데이터센터의 전력 환경을 유지하면서도 더 많은 AI 에이전트와 엔터프라이즈 애플리케이션을 동시에 운영할 수 있도록 지원한다는 목표다. 이번 포트폴리오는 ▲하이퍼 ▲클라우드DC ▲그랜드트윈 ▲플렉스트윈 ▲페타스케일 스토리지 ▲슈퍼블레이드 등 다양한 서버 제품군으로 구성됐다. 기업이 AI 추론부터 가상화, 클라우드 서비스, 스토리지, 대규모 HPC 환경까지 목적에 맞는 시스템을 선택할 수 있는 구조다. 슈퍼마이크로는 AMD GPU 기반 AI 인프라도 함께 확장했다. AMD 인스팅트 MI350P GPU를 지원하는 PCIe GPU 서버와 최대 72개의 GPU를 탑재하는 랙 스케일 'AMD 헬리오스 플랫폼'을 선보였다. 또 AMD 펜산도 폴라라 400 AI NIC를 적용해 AI 학습과 추론에 필요한 고대역폭 네트워크 환경 지원에도 나선다. 회사는 '데이터센터 빌딩 블록 솔루션(DCBBS)'을 통해 서버·GPU·네트워킹·냉각 기술을 통합 제공함으로써 기업이 개별 서버부터 데이터센터 규모 AI 인프라까지 효율적으로 구축할 수 있도록 지원한다는 방침이다. 빅 말얄라 슈퍼마이크로 최고비즈니스책임자는 "AMD 기반 신규 DCBBS 제품군은 고성능과 신속한 확장성, 최고 수준 효율성을 갖춘 차세대 AI 인프라를 제공한다"며 "글로벌 서비스팀과 탄탄한 공급망, 미국 AI 혁신에 대한 지속적인 투자를 바탕으로 고객이 보다 안정적으로 AI 인프라를 도입·확장할 수 있도록 지원하겠다"고 밝혔다. 댄 맥나마라 AMD 컴퓨트·엔터프라이즈 AI 사업부 수석부사장 겸 총괄은 "최신 에픽 CPU와 인스팅트 GPU, 펜산도 네트워킹을 슈퍼마이크로의 모듈형 서버 및 랙 스케일 설계와 결합한다"며 "고객은 시스템 활용률을 높이고 에너지 소비와 총소유비용(TCO)을 절감하는 동시에 AI 인프라를 더욱 빠르게 구축할 수 있을 것"이라고 말했다.

2026.07.27 15:05한정호 기자

AMD, 국산 NPU 생태계 힘 보탠다...한국에 R&D센터 설립

정부가 AMD와 AI반도체 분야에 맞손을 잡기로 했다. GPU 중심의 AI 컴퓨팅을 넘어 CPU, NPU 등 다양한 방식을 결합하는 이기종 컴퓨팅에 대비하기 위한 것이다. 27일 과학기술정보통신부에 따르면 배경훈 부총리 겸 과기정통부 장관이 리사 수 AMD 회장을 만나 AI 반도체와 컴퓨팅 분야 협력을 위한 양해각서를 체결했다. AMD는 CPU와 GPU를 아우르는 글로벌 반도체 기업으로 2025년 기준 연매출 346억 달러를 기록했으며, 특히 서버용 CPU와 GPU의 수요 증가에 힘입어 데이터센터 사업 매출도 166억 달러에 달하는 등 AI 컴퓨팅 시장의 주요 기업으로 자리매김하고 있다. 특히 오픈소스 소프트웨어 플랫폼인 ROCm과 개방형 표준을 기반으로 AI 컴퓨팅 생태계 확대를 추진하고 있다. 이를 통해 구글, 애플, 마이크로소프트 등 여러 글로벌 기업들과 함께 개방형 초고속 AI 반도체 연결 표준인 UALink 창립 멤버로 참여하는 등 개방형 AI 인프라 생태계 조성에도 적극 나서고 있다. 이기종 AI 컴퓨팅 대비...국산 NPU, AMD와 협력 최근 글로벌 AI 반도체 시장은 생성형 AI와 에이전틱 AI 확산에 따른 추론 수요 증가로, 단일 GPU 중심의 컴퓨팅 구조에서 벗어나 이기종 컴퓨팅 아키텍처로 빠르게 전환되고 있다. AI 서비스 제공 비용을 낮추고 성능과 전력 효율을 최적화하기 위해 워크로드별 최적의 연산자원을 활용하는 방향으로 AI 인프라 경쟁의 중심이 이동하고 있다는 뜻이다. 양해각서는 AI 컴퓨팅 아키텍처 변화에 대응해 AMD의 CPU, GPU와 추론 분야에 강점을 가진 국산 NPU를 연계하는 이기종 AI 컴퓨팅 인프라를 구축하고 국내 AI반도체 생태계의 글로벌 협력 기반을 확대하기 위해 체결됐다. 구체적으로 AMD CPU, GPU와 국산 NPU를 연계한 이기종 AI 컴퓨팅 인프라 구축과 실증을 추진한다. 이를 통해 AI 서비스별 특성에 맞춰 다양한 연산자원을 효율적으로 조합 활용하는 통합 컴퓨팅 환경을 구현하고 AI반도체 기업뿐 아니라 메모리, DPU, CXL, 네트워크, 서버, 오케스트레이션 소프트웨어 등 관련 국내 기업들이 함께 참여하는 개방형 AI 컴퓨팅 생태계를 조성한다. 이를 기반으로 국산 AI반도체가 글로벌 AI 컴퓨팅 공급망에 참여할 수 있도록 실질적인 레퍼런스 모델을 확보해 나갈 계획이다. AMD, 한국에 AI 연구센터 설립 양측은 국가과학AI연구센터(NAIS)를 중심으로 'AI for Science' 연구 협력을 추진한다. 첨단 과학기술 분야의 AI 기반 연구와 도전적 연구개발을 뒷받침하기 위해 AMD는 CPU와 GPU 등 고성능 컴퓨팅 자원과 AI 소프트웨어, 전문 인력 등을 제공할 계획이다. AMD는 국내에 인공지능 우수 연구센터(AI Center of Excellence) 설립을 추진한다. 인공지능 우수 연구센터는 AMD의 AI 컴퓨팅 자원과 소프트웨어 역량을 기반으로 국내 기업, 대학, 연구기관의 기술 협력을 비롯해 AI 반도체 소프트웨어 개발, 컴퓨팅 기술 검증 및 공동연구를 지원하는 협력 거점 역할을 수행할 예정이다. 이를 통해 AMD의 글로벌 네트워크와 국내 산학연 역량을 유기적으로 연계해 개방형 AI 생태계를 기반으로 한 다양한 협력 기회를 확대해 나갈 계획이다. AI 분야 우수 인재 양성을 위해서도 협력한다. AMD는 국내 주요 대학교와 대학원에 AI 컴퓨팅 플랫폼 기반의 교육 연구 프로그램과 컴퓨팅 자원을 지원하고, 국내 학생과 교수, 연구자들이 최신 AI 기술과 글로벌 개발 환경을 경험할 수 있는 기회를 확대해 나갈 예정이다. 이밖에 피지컬 AI 등 차세대 AI 분야의 공동연구와 기술 협력을 추진해 미래 AI 기술 경쟁력 확보를 위한 산학연 협력 기반을 확대해 나갈 예정이다. 과기정통부와 AMD 간 협력은 지난 3월 AMD 리사 수 회장의 방한으로 논의가 본격화됐으며, 이후 양측 간 긴밀한 협의를 거쳐 협력 분야와 실행 방안을 구체화해 왔다. 양해각서 체결식은 리사 수 회장의 초청으로 추진돼 글로벌 AI 생태계 변화에 대응하기 위한 양측의 전략적 협력 의지를 다시 한번 확인하는 계기가 됐다. 배경훈 부총리는 “글로벌 AI 경쟁은 CPU, GPU, NPU 등 다양한 연산자원을 결합하는 이기종 컴퓨팅과 개방형 생태계 중심으로 변화하고 있다”며 “대한민국이 AI 3대 강국으로 도약하기 위해서는 자립적이면서도 개방적인 AI 컴퓨팅 인프라 기반 확보가 중요하다”고 밝혔다. 이어 “AMD와의 협력을 통해 국내 AI반도체 생태계의 경쟁력을 높이고, 글로벌 AI 컴퓨팅 인프라 변화에 대응하는 새로운 협력 모델을 만들어 갈 수 있을 것”이라고 말했다. 한편, AMD의 리사 수 CEO는 "한국은 반도체와 AI, 첨단 연구, 피지컬 AI 분야에서 세계적인 경쟁력을 갖춘 AMD의 핵심 전략 시장"이라며, "AMD는 과학기술정보통신부와 협력해 고성능 컴퓨팅 기술과 개방형 소프트웨어 역량, 글로벌 생태계 파트너십을 결합함으로써 대한민국이 개방형·이기종 AI 인프라를 구축할 수 있도록 적극 지원할 것"이라고 말했다. 이어 "이번 협력은 단순한 하드웨어 지원을 넘어 기술 협력과 인재 양성, 긴밀한 공동 연구개발을 통해 대한민국의 AI 혁신과 경제 성장에 기여하겠다는 AMD의 장기적인 의지를 보여주는 것"이라고 밝혔다. 양 기관은 이번 협약의 실질적인 이행을 위해 공동 협의체를 구성하고, 분기별 실무회의를 통해 세부 협력 과제와 추진 방안을 지속적으로 협의해 나갈 예정이다.

2026.07.27 12:00박수형 기자

엔비디아·브룩필드가 베팅한 네이버…14.6兆 장비 등 인프라 투자

엔비디아와 브룩필드로부터 100억 달러(약 14조 6080억원) 자금을 조달한 네이버가 확보한 실탄을 그래픽처리장치(GPU)와 장비 등 인프라에 투자한다. 네이버는 엔비디아로부터 제3자 배정 유상증자를 통해 10억 달러(약 1조 4608억원) 규모의 전략적 투자를 체결했다고 27일 밝혔다. 90억 달러(약 13조 1472억원) 규모의 그래픽처리장치(GPU) 인프라 및 데이터센터 확보를 위해 글로벌 투자사 브룩필드를 독점적 우선 협상대상자로 선정했다. 이번 계약으로 네이버는 AI팩토리 사업의 핵심 축인 GPU 수급과 장비 조달이라는 선결 과제를 해결할 수 있게 됐다. 엔비디아의 이번 투자는 지난 6월 양사가 발표한 '기가와트(GW)급 초대형 글로벌 AI팩토리 구축 협약'의 후속 조치다. 네이버가 제3자 배정 유상증자에 나서는 것은 22년 만으로, 2008년 코스피 이전 상장 이후 처음이다. 엔비디아는 네이버 지분 4.5%(보통주 724만 1564주)를 취득하게 된다. 납입기한은 오는 10월 30일이다. 이와 함께 네이버는 주주가치 제고를 위한 대규모 자사주 소각도 병행한다. 네이버는 지난 24일 이사회에서 약 1조원 규모의 자사주 490만주를 내달 3일 소각하기로 결정했다고 공시했다. 네이버는 1조 달러(약 1461조 3000억원) 이상을 운용하는 브룩필드와의 사전계약을 통해 수백 MW(메가와트)의 AI팩토리 운용을 위한 최신 GPU와 데이터센터를 안정적으로 확보하게 된다. 브룩필드는 데이터센터와 신재생에너지 등 AI 인프라 분야의 프론티어 투자기업이다. 네이버는 협력을 통해 글로벌 GPU 공급 부족 상황에서도 대규모 컴퓨트 인프라를 선제적으로 확보할 수 있게 된다. 네이버의 자회사인 네이버클라우드는 엔비디아와 글로벌 AI팩토리 사업을 함께 추진하는 'AI 컴퓨트 파트너십' 계약을 긍정적으로 논의하고 있다. 기술 제휴를 포함해 수요와 자본까지 아우르는 통합 파트너십을 통해 엔비디아는 네이버클라우드의 공동 사업 주체로 참여할 것으로 전망된다. 엔비디아가 직접 투자를 결정한 배경에는 네이버가 보유한 세계 최고 수준의 '즉시 실행 가능한' 풀스택 AI 역량이 자리잡고 있다는 것이 회사 측 설명이다. 네이버는 데이터센터, GPU 클러스터, AI 플랫폼에 이어 자체 모델과 서비스까지 AI팩토리의 전 영역을 직접 운영해온 사업자다. 2019년 엔비디아의 슈퍼컴퓨팅 인프라를 전 세계 최초로 상용화한 네이버는 20여 년간 축적한 인프라 운영경험을 바탕으로, 냉각·전력·네트워크 등 데이터센터 핵심 기술을 AI 워크로드에 맞춰 모두 내재화했다. 이러한 완성형 인프라는 곧 속도로 이어진다. 네이버는 자체 데이터센터에 더해 전국 20여 곳에 GPU 상면을 선제적으로 확보·운영하고 있으며, 표준 사양의 서버 체계를 구축해 자원 확보부터 서비스 개시까지의 기간을 1개월 이내로 단축하는 것을 목표로 하고 있다. 나아가 네이버는 국내 최대 규모인 10만 장 수준의 GPU를 대규모 클러스터로 운영하며, 자원 관리·복구 자동화와 100% 수준의 모니터링을 통해 예측 가능하고 효율적인 인프라 운영을 실현하고 있다. 이러한 역량을 바탕으로 네이버는 이미 수십만 고객에게 기업용 서비스를 제공하고 있으며, 국내에서 유일하게 대규모 서비스형 GPU(GPUaaS)를 제공하는 사업자다. 빠르게 구축한 대규모 글로벌 협력을 기반으로, 네이버는 2027년부터 AI팩토리 사업을 통한 매출을 창출할 계획이다. 2027년 상반기 55MW 규모의 글로벌 AI팩토리 가동을 시작하고, 2028년 200MW 규모까지 본 궤도에 올린 후, 이를 발판 삼아 1GW급으로 빠르게 확장할 예정이다. 이를 통해 아시아·태평양, 유럽, 중동 시장의 소버린 AI 인프라 수요를 흡수하겠다는 전략이다. 최수연 대표는 “엔비디아와 브룩필드의 투자는 네이버 미래 성장에 중요한 전기가 될 것”이며 “이번 투자를 기점으로 네이버의 기술, 인프라를 통해 글로벌 AI인프라 시장에 빠르게 진출할 수 있는 계기를 마련하게 돼 매우 고무적”이라고 말했다. 이어 “AI팩토리 고객사 유치도 속도감 있게 마무리 해 네이버가 글로벌 AI인프라 분야의 주요한 기업으로 도약하는 분기점으로 삼겠다”고 말했다.

2026.07.27 09:48박서린 기자

메가존클라우드-아크릴, AI 인프라 사업 맞손…헬스케어·공공 공략

메가존클라우드가 아크릴과 손잡고 기업·공공기관 대상 AI 인프라 사업 확대에 나선다. 그래픽처리장치(GPU) 인프라 구축과 운영 최적화 기술을 결합해 산업별 AI 전환(AX) 사업을 공동 추진하고 글로벌 시장 진출도 모색한다는 구상이다. 메가존클라우드는 아크릴과 AI 인프라 사업 확대 및 글로벌 시장 진출을 위한 전략적 파트너십을 체결했다고 24일 밝혔다. 협약은 지난 23일 과천 메가존산학연센터에서 진행됐다. 양사는 이번 협력을 통해 대규모 GPU 인프라가 필요한 기업과 공공기관을 대상으로 AI 인프라 구축부터 운영, 모델 개발까지 아우르는 통합 AX 환경을 제공한다는 목표다. 메가존클라우드의 AI·클라우드 인프라 구축 역량과 아크릴의 AI 개발 및 인프라 최적화 기술을 결합해 고객 맞춤형 사업 모델을 공동 발굴할 계획이다. 메가존클라우드는 엔비디아 기반 GPU 서버와 클라우드 인프라를 공급·구축하고 고객 환경에 맞는 시스템 설계와 비용 효율화 방안을 지원한다. 아크릴은 AI 풀스택 플랫폼 '조나단'과 AI 인프라 운영·최적화 플랫폼 'GPU베이스'를 활용해 AI 모델 개발부터 GPU 자원 관리까지 담당한다. 조나단은 데이터 준비와 AI 모델 학습·검증, 배포, 서비스 적용까지 전 과정을 하나의 환경에서 지원하는 AI 풀스택 플랫폼이다. GPU베이스는 GPU·서버·스토리지·네트워크 자원을 통합 관리해 작업 스케줄링과 자원 할당, 가상화, 모니터링 등을 지원하는 AI 인프라 운영 솔루션이다. 우선 양사는 대규모 GPU 환경에서 성능 테스트를 진행한 뒤 기업과 공공기관 대상 공동 프로젝트를 단계적으로 추진할 예정이다. 향후에는 헬스케어·공공·보험 분야를 중심으로 산업별 특화 서비스를 발굴하고 양사가 보유한 파트너 및 고객 네트워크를 활용해 해외 시장 진출도 함께 추진할 계획이다. 염동훈 메가존클라우드 대표는 "AI 도입이 확대되면서 AI 인프라 수요도 빠르게 늘고 있는 만큼, 안정적이고 효율적인 GPU 인프라 운영 역량이 핵심 경쟁력으로 자리 잡고 있다"며 "우리의 AI·클라우드 인프라 구축 노하우와 아크릴의 GPU 최적화 기술을 바탕으로 산업별 특화 서비스를 발굴하고 국내외 파트너십을 기반으로 글로벌 사업 기회도 확대해 나갈 것"이라고 밝혔다. 박외진 아크릴 대표는 "이번 협력을 통해 고성능 AI 인프라 아키텍팅부터 자원 최적화, 모델 개발과 서비스 적용까지 연결되는 통합 사업 체계를 마련할 수 있게 됐다"며 "헬스케어와 공공 분야에서 성공 사례를 확보하고 국내외 시장에서 새로운 성장 기회를 창출해 나가겠다"고 말했다.

2026.07.24 17:56한정호 기자

AMD, 첫 랙스케일 AI 솔루션 공개…앤트로픽·오픈AI 잡았다

AMD가 고성능 시스템반도체 기반의 첫 랙스케일 AI 솔루션 'AMD 헬리오스'를 선보였다. 경쟁 솔루션 대비 달러당 최대 30% 더 많은 AI 추론 토큰을 처리할 수 있는 것이 특징으로, 오픈AI·앤트로픽·메타·마이크로소프트 등 여러 빅테크가 해당 솔루션을 도입할 예정이거나 도입을 추진 중이다. AMD는 23일(현지시간) 미국 샌프란시스코 모스콘 웨스트에서 개최한 'AMD 어드밴싱 AI 2026'에서 차세대 AI 인프라 및 피지컬 AI 포트폴리오를 발표했다. 이날 AMD는 업계 최초이자 최고 수준의 성능을 제공하는 개방형 랙스케일 AI 플랫폼인 AMD 헬리오스를 공개했다. AMD 헬리오스는 72개의 고성능 AMD 인스팅트 MI455X GPU와 18개의 6세대 AMD 에픽 베니스 CPU, AMD 펜산도 프런트엔드, 스케일업 및 스케일아웃 네트워킹, AMD ROCm 오픈 소프트웨어를 하나로 최적화해 통합했다. 덕분에 AMD 헬리오스는 경쟁 솔루션 대비 달러당 최대 30% 더 많은 AI 추론 토큰을 처리할 수 있다. AMD 헬리오스는 현재 양산에 돌입했으며, 주요 AI 기업들이 기가와트급 규모의 AI 인프라 구축에 활용할 예정이다. 대표적인 고객사들로는 오픈AI, 앤트로픽, 메타, 마이크로소프트, 오라클, 휴메인, 텐서웨이브 등이 있다. 오픈AI는 올해 4분기부터 AMD 헬리오스를 도입하고, 2027년부터 본격적인 구축을 확대할 계획이다. 앤트로픽은 AMD 헬리오스 랙스케일 솔루션에 최대 2기가와트 규모의 AMD 인스팅트 MI455X GPU를 구축한다. 에이전틱 AI 시대를 위한 차세대 데이터센터 CPU 및 GPU 포트폴리오도 공개했다. 6세대 AMD 에픽 프로세서는 업계를 선도하는 코어당 성능과 최고 수준의 스레드 집적도를 바탕으로, 와트당, 달러당, 그리고 랙당 더 많은 AI 에이전트를 실행할 수 있도록 지원한다. AI 가속기를 지원하는 호스트 CPU로서는 AI 가속기가 최대 성능을 발휘할 수 있도록 충분한 연산 성능과 메모리 대역폭을 제공하며, 범용 서버 환경에서는 비즈니스 크리티컬 애플리케이션과 AI 지원 워크로드를 위한 뛰어난 성능과 전력 효율성을 제공한다. AMD 인스팅트 MI400 시리즈 GPU는 이전 세대인 MI355X 대비 최대 34배 높은 토큰 처리량을 제공한다. 고정밀 연산이 요구되는 워크로드를 위해 새롭게 공개된 AMD 인스팅트 MI430X 가속기는 과학기술 연산과 소버린 AI를 위한 AMD의 최고 성능 HPC 가속기로, 최대 288TFLOPS의 하드웨어 기반 FP64 성능을 제공한다. AMD 인스팅트 MI430X는 미국과 유럽의 차세대 엑사스케일 슈퍼컴퓨터 구축에도 적용될 예정이다. AMD 인스팅트 MI350P GPU는 기존 AI 인프라에서도 손쉽게 AI 가속 기능을 추가할 수 있도록 설계됐으며, 뛰어난 토큰 처리 경제성을 제공한다. AMD 인스팅트 MI350P GPU는 경쟁 제품 대비 달러당 최대 4.2배 높은 초당 토큰 처리 성능을 제공한다. 리사 수 AMD 최고경영자(CEO)는 "AMD는 생태계 전반의 다양한 파트너들과 협력해 업계를 선도하는 컴퓨팅 기술과 개방형 플랫폼을 제공함으로써, 고객들이 데이터센터부터 엣지까지 AI를 더욱 뛰어난 성능과 유연성, 그리고 폭넓은 선택지를 바탕으로 확장할 수 있도록 지원하고 있다"고 말했다.

2026.07.24 11:20장경윤 기자

시스원, 공군 첫 AI 인프라 사업 나선다

시스원이 공군 인공지능(AI) 기반 임무 수행 체계 구축을 위한 첫 사업의 우선협상대상자로 선정됐다. 시스원은 공군 전력지원체계사업단이 발주한 '공군 실증목적 그래픽처리장치(GPU) 구축사업' 개찰 결과, 기술능력평가 최고점을 획득했다며 23일 이같이 밝혔다. 이번 사업은 총 66억원(리스) 규모로, 계룡 소재 A부대와 오산 소재 B부대 등 2개 부대를 대상으로 추진된다. 시스원은 엔비디아 B300 GPU 서버를 비롯해 항온항습기, 무정전전원공급장치(UPS) 등을 공급한다. 전력·냉각 등 최적의 기반 환경구축부터 통합시험, 검수, 사용자·관리자 교육까지 사업 전 과정을 수행할 예정이다. 시스원은 지난 2021년부터 공군 전산장비 통합 유지보수 사업을 수행해 왔다. 현재 '2025~2027년 공군 전산장비 통합 유지보수 용역'을 수행 중이다. 주요 공군 부대에 상주 인력을 배치해 전산장비 운영 및 유지보수 체계를 지원하고 있다. 시스원은 "안정적인 사업 수행을 통해 실증 성과를 확보하고 육군과 해군 등 전군 GPU 인프라 사업으로 영역을 확대하겠다"며 "퓨리오사AI 공공부문 총판으로 축적한 신경망처리장치(NPU) 공급 역량을 더해 소버린 AI 인프라 구축과 국산 AI 반도체 생태계 확산에도 기여하겠다"고 말했다.

2026.07.23 15:17이나연 기자

엘리스그룹, 전국 첫 산업단지 GPU·NPU 엣지 AI 데이터센터 구축 지원

엘리스그룹이 그래픽처리장치(GPU)와 국산 신경망처리장치(NPU)를 함께 활용하는 엣지 인공지능(AI) 데이터센터 구축 사업에 참여하며 제조업 AI 전환(AX) 지원에 앞장선다. 엘리스그룹은 산업통상자원부 '2026년 산업단지 엣지 AIDC 실증 시범사업'에 선정된 한국산업단지공단 부산본부의 '부산 조선·해양 엣지 AI 데이터센터 구축사업'에 참여한다고 23일 밝혔다. 이번 사업은 전국 산업단지 최초로 GPU와 국산 NPU 기반 엣지 AI 데이터센터를 구축해 제조기업의 AX를 지원하는 프로젝트로 평가된다. 사업 참여로 엘리스그룹은 자사 AI 클라우드 '엘리스클라우드'에서 검증한 모듈형 AI 데이터센터 'AI PMDC'와 AI 클라우드 인프라 가상화 솔루션 'ECI'를 통합한 패키지를 외부 고객에게 공급하는 첫 상용 레퍼런스를 확보하게 됐다. AI 인프라 하드웨어와 소프트웨어를 아우르는 AI 인프라 기업으로서 기술 역량을 입증했다는 게 회사 측 설명이다. 엘리스그룹은 이번 사업에서 고밀도 전력 설계 기술을 적용한 AI PMDC 2기를 구축하고 이를 통합 운영하는 ECI 플랫폼을 제공할 예정이다. GPU와 국산 NPU 등 서로 다른 AI 가속기 자원을 효율적으로 분배·운영하는 ECI 기술을 통해 연산 자원 활용도를 높이고 제조업 환경에 최적화된 저지연·고효율 AI 인프라를 구현할 계획이다. 해당 데이터센터에서 GPU는 제조 AI 모델 학습과 검증, 고성능 연산을 담당하고 국산 NPU는 AI 추론과 서비스형 소프트웨어(SaaS) 서비스를 처리한다. 안정적인 서비스 운영을 위한 재해복구(DR) 체계도 함께 구축한다. 엣지 AI 데이터센터를 엘리스클라우드와 연계해 무중단 전력 공급과 보안 이중화 체계를 마련함으로써 장애 발생 시에도 안정적인 AI 서비스를 제공할 수 있도록 지원할 예정이다. 이를 통해 엘리스그룹은 제조업 AI 서비스의 현장 적용을 지원하는 동시에 국산 AI 반도체 생태계 확산에도 기여한다는 목표다. 김재원 엘리스그룹 대표는 "이번 사업은 우리가 자체 AI 클라우드에서 검증한 AI PMDC와 ECI 통합 패키지를 산업 현장에 적용하는 첫 번째 사례"라며 "제조업 AI 전환은 물론 국산 AI 반도체 생태계 확산에도 기여하는 중요한 이정표가 될 것"이라고 말했다.

2026.07.23 11:39한정호 기자

[AI 고속도로] 엔비디아, 베라 루빈 양산에 "AI 서버 경쟁판 바뀐다"

엔비디아가 차세대 인공지능(AI) 플랫폼 '베라 루빈' 기반 시스템의 양산과 고객사 구축에 들어가면서 AI 서버 시장의 경쟁 방식도 달라지고 있다. 그래픽처리장치(GPU)와 중앙처리장치(CPU), 네트워크를 개별 서버에 조립하던 방식에서 벗어나 랙 전체를 하나의 시스템으로 공급하는 구조가 확산되면서, 서버업체의 경쟁력도 자체 설계보다 생산 자동화와 액체냉각, 현장 구축 능력으로 이동하는 분위기다. 22일 블룸버그통신에 따르면 엔비디아는 베라 루빈 기반 시스템을 오픈AI와 구글 클라우드, 마이크로소프트(MS) 애저, 메타, 코어위브, 델테크놀로지스 등에 공급하고 있다. 오픈AI는 오는 3분기부터 베라 루빈을 대규모로 도입할 계획이다. 베라 루빈 NVL72는 루빈 GPU와 베라 CPU, 네트워크 칩 등을 하나의 랙에 통합한 AI 컴퓨팅 시스템이다. 개별 서버를 납품한 뒤 데이터센터에서 연결하는 방식과 달리 전력과 냉각, 네트워크까지 검증된 랙 단위로 공급해 설치 기간과 장애 위험을 줄이는 데 초점을 맞췄다. 서버 조립 방식도 달라졌다. 기존 제품은 GPU와 CPU, 네트워크 장비가 들어간 트레이를 작업자가 직접 케이블로 연결해 초기 생산 과정에서 조립 시간이 길고 불량률도 높았다. 반면 베라 루빈은 내부 케이블을 회로기판과 전용 연결장치로 대체해 사람이 수시간 동안 하던 작업을 로봇이 수분 만에 처리할 수 있도록 설계됐다. 주요 부품에 액체냉각을 적용하면서 팬과 공기 통로가 차지하던 공간도 줄였다. 같은 면적에 더 많은 연산 장치를 배치할 수 있게 되면서 서버업체의 공급 범위도 랙 조립에서 냉각수분배장치와 배관, 전력설비까지 넓어질 것으로 보인다. 이 같은 변화는 델과 슈퍼마이크로, HPE, 레노버 등 AI 서버업체의 사업 구조에도 영향을 줄 것으로 보인다. 엔비디아가 CPU와 GPU, 네트워크, 랙 구조를 표준화할수록 업체별 하드웨어 설계 차이는 줄고 생산량과 납기, 냉각 기술, 구축 서비스가 수주를 가르는 요소로 부상할 가능성이 있어서다. 특히 델은 대형 클라우드 사업자와 AI 전용 데이터센터 운영업체를 대상으로 랙 공급을 늘리는 동시에 기업용 AI 인프라 구축 사업을 확대할 여지가 커졌다. 서버와 스토리지, 네트워크, 유지관리 서비스를 함께 제공할 수 있어 단순 장비 판매보다 통합 프로젝트 수주에 유리할 수 있다. 슈퍼마이크로는 엔비디아 신형 GPU를 빠르게 서버 제품으로 내놓던 기존 강점에서 액체냉각과 랙 단위 구축 역량으로 경쟁 범위를 넓혀야 할 것으로 보인다. 제품 출시 속도만으로 차별화하기 어려워진 만큼 생산시설과 냉각설비, 현장 설치 능력이 실적에 미치는 영향도 커질 전망이다. 폭스콘과 콴타, 위윈 등 대만 전자제품위탁생산·설계 업체에는 대량 생산 기회가 늘어날 것으로 보인다. 엔비디아의 표준 설계에 따라 동일한 랙을 반복 생산하는 구조에선 자체 서버 브랜드보다 자동화 설비와 부품 조달, 생산 수율을 갖춘 제조업체가 유리해서다. HPE와 레노버는 국가 AI 인프라와 슈퍼컴퓨터, 기업 전용 AI 데이터센터 시장에서 냉각과 운영 서비스를 앞세울 가능성이 크다. AI 서버의 전력 밀도가 높아질수록 기존 데이터센터를 개조하고 시스템을 안정적으로 운영하는 기술의 중요성도 커질 것으로 보인다. 다만 서버업체의 매출 확대가 수익성 개선으로 곧바로 이어지지는 않을 것으로 예상된다. 핵심 칩과 네트워크, 시스템 설계를 엔비디아가 공급하는 구조에서 서버업체가 가져갈 수 있는 부가가치는 제조와 구축, 유지관리 영역에 집중될 수 있기 때문이다. 또 대형 클라우드 고객을 대상으로 한 가격 경쟁이 심해지면 출하량 증가에도 마진이 제한될 가능성이 있다. 경쟁사인 AMD도 분주히 움직이는 모양새다. AMD는 차세대 GPU와 CPU, 네트워크를 통합한 AI 랙 '헬리오스'를 앞세워 현재 랙 스케일 시장 공략을 강화하고 있다. 이에 클라우드 사업자들이 엔비디아 제품과 AMD 시스템, 자체 개발 칩을 함께 운용하는 멀티벤더 전략을 확대하면 서버업체의 설계·구축 부담도 커질 가능성이 있다. 이언 벅 엔비디아 부사장은 "우리는 완전한 양산 단계에 들어갔다"며 "현재 모든 주요 고객사에서 시스템(베라 루빈)을 구축하고 있다"고 말했다.

2026.07.22 15:46장유미 기자

신진서가 꺾은 바둑 AI '카타고'…알파고와 무엇이 다른가

신진서 9단이 바둑 인공지능(AI) '카타고' 상대로 역전승을 거두면서 카타고와 알파고 기술 차이에 관심이 쏠리고 있다. 현재 카타고는 알파고보다 적은 연산으로 대국 능력뿐 아니라 형세 판단, 예상 집 차이, 영역 분석 기능을 빠르게 올린 것으로 나타났다. 신진서는 21일 서울 중구 한국경제TV 스튜디오에서 열린 '쎈수학·한경 기신전' 최종 3국에서 카타고를 상대로 승리했다. 1국을 내준 뒤 2·3국을 연달아 따내며 최종 전적 2승 1패로 대회를 마쳤다. 업계에서는 이세돌 9단이 구글 딥마인드의 알파고와 맞붙었던 10년 전보다 바둑 AI 기술이 한층 발전했다고 평가하고 있다. 카타고가 알파고보다 적은 연산으로 대국 능력을 비롯한 형세 판단, 예상 집 차이, 영역 분석 등 실전 활용 기능을 빠르게 높였다는 이유에서다. 10년 전 이세돌 9단과 대국한 알파고는 구글딥마인드가 AI의 학습과 추론 능력을 입증하기 위해 개발한 연구용 바둑 AI였다. 소스코드와 학습 모델이 공개되지 않아 이용자가 직접 내려받아 대국하거나 기보를 분석할 수 있는 형태는 아니었다. 당시 이 9단과 맞붙은 모델은 '알파고 리'였다. 알파고 리는 인간 프로기사들이 둔 기보를 먼저 학습한 뒤 스스로 반복 대국하며 실력을 높였다. 인간 바둑 토대로 기본기를 익힌 뒤 자기 학습을 추가한 식이다. 딥마인드는 이후 인간 기보를 전혀 사용하지 않고 바둑 규칙만으로 스스로 학습하는 '알파고 제로'를 내놨다. 당시 알파고 제로는 학습을 시작한 지 사흘 만에 알파고 리와의 내부 대국에서 100전 전승을 기록했다. 카타고, 알파고보다 가성비↑…집 차이·바둑판 영역 인식도 카타고는 미국 개발자 데이비드 우가 2019년 공개한 오픈소스 바둑 AI다. 알파고 제로가 사용한 자기 대국 기반 학습법을 토대로 하되, 더 적은 컴퓨팅 자원으로 빠르게 실력을 높일 수 있도록 학습 방식을 높인 것으로 알려졌다. 알파고 리가 주로 어떤 수를 둬야 승리할 가능성이 높은지 학습했다면, 카타고는 승패뿐 아니라 최종 집 차이와 바둑판의 영역까지 학습했다. 단순히 '이 수를 두면 이길 가능성이 높다'고 판단하는 데 그치지 않고 '해당 수를 두면 어느 쪽이 몇 집 정도 앞서는지' 또는 '각 공간을 누가 차지할 가능성이 높은지'까지 계산할 수 있는 셈이다. 이에 카타고는 알파고보다 여러 정보를 동시에 할 수 있다. 같은 대국에서도 더 많은 판단 기준을 얻을 수 있다. 단순히 승패 결과만 보고 시행착오를 반복하는 것보다 바둑판에서 무엇이 잘됐고 잘못됐는지를 세분화하는 식이다. 카타고는 비교적 적은 연산으로도 빠르게 강해질 수 있어 승률을 높일 수도 있다. 실제 카타고 개발 논문에 따르면 카타고는 당시 유사한 오픈소스 바둑 AI보다 약 50분의 1 수준 연산으로 학습 효율을 높였다. 데이비드 우는 "카타고는 30개 미만 그래픽처리장치(GPU)를 19일간 사용해 수천 개 GPU로 학습한 기존 오픈소스 모델 성능을 넘어섰다"고 논문을 통해 밝혔다. 신진서 9단은 카타고를 어떻게 이겼나..."AI 강점 무력화" 지난 21일 대회 전 바둑계에서는 신진서가 카타고 상대로 한 판만 이겨도 의미 있는 성과라는 평이 많았다. 그러나 신진서는 예상을 뛰어넘어 두 차례 승리를 거두며 최종 우승까지 차지했다. 신 9단은 AI 강점을 무력화한 것이 승리 비결이라고 밝혔다. 복잡한 전투를 피하고 쉽게 무너지지 않는 수비적인 바둑을 선택한 셈이다. 그는 "평소 스타일을 내려놓고 오직 승리를 위한 바둑을 두는 과정은 쉽지 않았다"며 "공격적으로 주도권을 잡기보다 불리한 조건을 견디면서 기회를 기다혔다"고 기자회견서 밝혔다. 신 9단은 카타고가 완벽한 수를 추구하는 특성이 오히려 약점으로 작용할 수 있다고 봤다. 그는 "바둑 AI는 형세가 불리해져도 승패를 뒤집기 위한 과감한 승부수보다 손해를 최소화하는 안정적인 수를 택한다"며 "인간 기사는 상황에 따라 정석에서 벗어난 승부수나 상대가 예상하지 못한 묘수를 던질 수 있거나, 상대를 흔들고 실수를 유도하는 선택을 할 수 있다"고 설명했다. 그는 "인간 기사의 매력은 불확실성과 창의성"이라며 "AI가 계산 능력과 정확성에서는 앞서지만 실제 승부에서는 심리와 전략, 상황 판단도 중요한 변수로 작용한다"고 말했다. 이어 "이번 대회를 통해 인간 기사도 AI를 상대로 충분히 견디고 경쟁할 수 있다는 걸 보여줬다"며 "AI의 수를 그대로 따라가기보다 특성을 분석하고 인간만의 승부 감각을 활용하면 맞설 여지가 있다"고 덧붙였다.

2026.07.22 10:26김미정 기자

[AI 고속도로] AI 데이터센터 돈줄 된 블랙록…메타에 120억 달러 조달 나선 까닭

인공지능(AI) 인프라 투자 경쟁이 그래픽처리장치(GPU) 확보를 넘어 대규모 자본 조달 능력을 겨루는 단계로 확대되고 있다. 기가와트(GW)급 데이터센터 건설에 수백억 달러가 필요해지면서 장기 자금을 안정적으로 끌어올 수 있는 금융 역량이 빅테크의 AI 인프라 확장 속도를 좌우하는 요소로 부상했다. 21일 블룸버그통신에 따르면 블랙록은 메타가 사용할 AI 데이터센터 건설 자금을 마련하기 위해 120억 달러가 넘는 채권 발행을 추진하고 있다. JP모건체이스와 모건스탠리는 지난 20일부터 투자자 모집에 착수했다. 이번 거래는 블랙록이 최근 인수한 글로벌인프라스트럭처파트너스(GIP)와 HPS인베스트먼트파트너스의 역량을 결합한 첫 대형 AI 인프라 금융 사례다. GIP는 인프라 지분 투자, HPS는 사모대출과 구조화 금융에 강점을 가진 회사로, 블랙록은 두 회사를 각각 125억 달러와 120억 달러에 인수했다. 메타와 블랙록은 데이터센터 건설을 위해 '프로젝트 소파이피야 홀딩스'라는 합작법인을 세웠다. GIP와 HPS가 운용하는 펀드가 합작사 지분 80%를 보유하고 메타가 나머지 20%를 갖는다. 120억 달러 이상의 채권도 메타가 아닌 합작사 측에서 조달한다. 메타는 데이터센터를 사용할 권리를 확보하면서 건설 자금의 직접 차입 부담을 합작사와 나눌 수 있다. 데이터센터는 기가와트급 규모로 2028년 가동될 예정이며 완공 후 300명 이상의 현장 인력을 고용할 것으로 예상된다. 이 같은 합작사 구조는 메타가 블루아울캐피털과 추진한 미국 루이지애나주 '하이페리온' 데이터센터 사업에도 적용됐다. 블루아울이 지분 80%, 메타가 20%를 보유하고 합작사가 건설 자금을 조달하는 방식이다. 이처럼 AI 데이터센터 투자비가 급증하자 빅테크들은 자체 현금과 회사채에만 의존하지 않고 사모펀드·인프라 운용사와 투자 부담을 나누고 있다. 자산운용사는 장기 운영 수익과 인프라 지분을 확보하고 빅테크는 재무 부담을 낮추면서 데이터센터 확충을 이어가는 구조다. 특히 블루아울과 블랙스톤이 주도해 온 AI 데이터센터 금융시장에 세계 최대 자산운용사인 블랙록까지 가세하면서 향후 경쟁도 치열해질 것으로 보인다. 블랙록은 지난해 10월 마이크로소프트, 엔비디아, 아랍에미리트(UAE) 투자 플랫폼 MGX 등과 함께 얼라인드데이터센터스를 400억 달러에 인수하기로 합의하는 등 AI 인프라 투자를 확대하고 있다. 블랙록은 앞으로도 GIP의 인프라 투자 역량과 HPS의 신용금융 역량을 디지털 인프라 거래에 함께 활용할 계획이다. 이를 통해 GPU와 전력 확보에 더해 초대형 프로젝트의 지분과 부채를 함께 설계하는 자본 조달 경쟁에서도 주도권을 확보하려는 모습이다. 래리 핑크 블랙록 최고경영자(CEO)는 최근 실적 발표에서 "GIP와 HPS가 거래 발굴 단계부터 함께 움직이고 있다"며 "통합 플랫폼에 대한 확신은 특히 디지털 인프라에서 커지고 있다"고 말했다.

2026.07.21 10:22장유미 기자

이동수 에이투시스 대표 "국가 AI 경쟁력, GPU 확보보다 통합 운영 역량"

국가 인공지능(AI) 컴퓨팅 전략이 그래픽처리장치(GPU) 확보에 치우져선 안 된다는 주장이 나왔다. 에이전틱 AI 환경에 맞는 AI 반도체와 메모리, 데이터센터, 소프트웨어(SW)를 통합 구축해야 된다는 설명이다. 이동수 에이투시스 대표는 20일 국가AI전략위원회가 서울스퀘어에서 개최한 '에이전틱 AI 시대 국가 컴퓨팅 전략' 세미나에서 이같이 밝혔다. 이 대표는 AI전략위에서 기술혁신·인프라 분과위원으로도 활동 중이다. 이 대표는 GPU 보유량보다 다양한 연산 자원을 효율적으로 배분·운영하는 역량이 중요하다고 진단했다. 에이전틱 AI 환경에서는 검색과 분석, 코딩 등에 특화된 여러 모델과 에이전트가 하나의 업무를 나눠 처리한다는 이유에서다. 이 과정에서 서로 다른 요청이 불규칙하게 들어오면, 특정 모델에 맞춰 구축한 GPU 활용률이 떨어질 가능성이 높다. 이 대표는 에이전틱 AI 시대에 메모리 기술 중요성이 높아질 것으로 내다봤다. 여러 에이전트가 작업 결과와 대화 맥락을 주고받으려면 메모리를 효율적으로 활용해야 한다는 이유에서다. 그는 "에이전트가 이미 처리한 정보를 케이브이(KV) 캐시에 저장해 다시 쓰면 같은 내용을 반복해서 계산하는 작업을 줄일 수 있다"고 설명했다. KV 캐시는 모델이 앞서 읽은 문맥을 임시 보관하는 단기 기억장치다. 에이전트가 외부 도구를 실행한 뒤 모델을 재호출할 때 기존 문맥을 캐시에서 불러오면 GPU 연산량과 응답 지연을 줄일 수 있다. 이 대표는 서비스 특성과 모델별 수요에 맞춰 연산과 메모리 자원을 탄력적으로 배분하는 운영 체계가 필요하다고 강조했다. GPU 성능뿐 아니라 고대역폭메모리(HBM)와 네트워크, 중앙처리장치(CPU), 캐시 관리 기술을 함께 최적화해야 하는 이유에서다. 그는 AI 인프라 평가 기준도 달라져야 한다고 주장했다. 기존 AI 팩토리는 가격이나 전력당 얼마나 많은 토큰을 생성하는지를 중심으로 평가했지만, 에이전틱 AI에서는 작업 완료까지 걸린 시간과 전체 비용, 전력 소비, 성공률을 함께 살펴야 한다는 것이다. 이 대표는 "토큰 가격이 저렴한 모델이라도 같은 작업을 여러 차례 반복하면 최종 비용이 더 커질 수 있다"며 "토큰 단가가 높은 모델이 적은 시행착오로 업무를 빠르게 끝내면 전체 비용은 낮아질 수 있어 토큰당 가격만으로 효율을 판단하기 어렵다"고 말했다. 그는 "결국 에이전틱 AI 시대 컴퓨팅 경쟁력은 GPU를 얼마나 많이 확보했는지보다 주어진 업무를 얼마나 적은 비용과 시간으로 끝내는지에 달렸다"고 덧붙였다.

2026.07.20 17:17김미정 기자

[AI 고속도로] 인프라 고객서 경쟁사된 메타…네오클라우드 업계 '긴장'

메타가 인공지능(AI) 인프라를 외부에 제공하는 자체 클라우드 사업을 추진하면서 AI 특화 클라우드(네오클라우드) 업계 긴장감이 커지고 있다. 그동안 대규모 그래픽처리장치(GPU)를 임대해온 핵심 고객 메타가 직접 인프라 공급자로 나설 가능성이 커지면서 향후 시장 경쟁 구도에도 변화가 예상된다. 17일 업계에 따르면 메타는 자체 데이터센터와 AI 연산 인프라를 활용해 외부 기업에 컴퓨팅 자원을 제공하는 '메타 컴퓨트' 프로젝트를 추진 중이다. 자체 AI 모델을 API 형태로 제공하는 것은 물론, 남는 GPU 연산 자원을 서비스형 인프라(IaaS) 방식으로 판매하는 방안도 함께 검토 중인 것으로 알려졌다. 메타의 움직임은 AI 인프라 투자에 투입한 자본을 새로운 수익원으로 연결하기 위한 전략으로 풀이된다. 회사는 올해 AI 인프라 투자 규모를 최대 1450억 달러까지 확대할 계획으로, 미국과 캐나다를 중심으로 초대형 데이터센터 구축도 잇달아 발표하고 있다. 최근 루이지애나주 '하이페리온' 데이터센터를 최소 5기가와트(GW) 규모로 확대하고 캐나다에도 1GW급 AI 데이터센터 건설 계획을 공개하는 등 자체 컴퓨팅 역량 확보에 속도를 내고 있다. 더불어 자체 AI 칩 개발과 데이터센터 확충도 병행하며 AI 인프라 자립을 추진 중이다. 여기에 남는 컴퓨팅 자원까지 외부에 공급할 경우 기존 AI 클라우드 시장에도 적지 않은 영향을 미칠 것이란 전망이 나온다. 업계가 주목하는 이유는 메타가 얼마 전까지 네오클라우드 기업들의 최대 고객 가운데 하나였기 때문이다. 메타는 생성형 AI 개발 과정에서 자체 데이터센터 구축 속도가 GPU 수요를 따라가지 못하자 네비우스와 코어위브 등 네오클라우드 기업으로부터 대규모 AI 컴퓨팅 자원을 임대해왔다. 특히 네비우스와는 최대 270억 달러 규모까지 확대 가능한 장기 인프라 계약을 체결했고 코어위브와도 수십억 달러 규모 계약을 맺으며 AI 연산 자원을 확보했다. 네오클라우드 기업들은 이같은 빅테크의 AI 투자 확대를 발판으로 빠르게 성장했다. 자체 데이터센터를 짓는 데 수년이 걸리는 빅테크 대신, 최신 GPU를 즉시 제공하는 역할을 맡으며 AI 인프라 시장의 새로운 사업 모델을 구축했다. 하지만 메타가 직접 AI 컴퓨팅 서비스 제공에 나서면서 시장 변화가 예상된다. 기존 네오클라우드 고객이 경쟁사로 바뀌는 것은 물론, 메타가 대규모 GPU 자원을 시장에 공급할 경우 AI 인프라 임대 가격에도 영향을 줄 수 있다는 우려가 제기된다. 실제 최근 시장에선 이런 우려가 주가에도 반영됐다. 메타의 클라우드 사업 확대 가능성이 알려진 이후 네비우스를 비롯한 주요 네오클라우드 기업들의 주가가 동반 약세를 보였다. 투자자들은 아마존웹서비스(AWS)·마이크로소프트(MS)·구글 등 3대 글로벌 클라우드 기업에 더해 메타까지 인프라 사업을 추진하면서 AI 시장 경쟁이 더 치열해질 것이라는 전망을 내놓고 있다. 다만 업계에선 메타가 당장 네오클라우드 기업들을 대체하기는 쉽지 않을 것이라는 분석도 나온다. 자체 AI 모델 개발과 서비스 운영에도 막대한 GPU가 필요한 만큼 상당 기간 외부 AI 컴퓨팅 자원을 병행 활용할 가능성이 높다는 이유에서다. 여전히 네비우스, 코어위브 등과 AI 인프라 계약이 유지되고 있으며 자체 AI 데이터센터 확장에도 수년이 소요될 전망이다. 업계 관계자는 "메타는 지금도 네오클라우드 기업들의 핵심 고객이지만 동시에 미래에는 가장 강력한 경쟁자가 될 가능성이 있다"고 말했다. 마크 저커버그 메타 최고경영자(CEO)는 지난 5월 실적 발표에서 "외부 기업들이 API 서비스 구축이나 컴퓨팅 구매를 거의 매주 문의하고 있다"며 "인프라 자원이 과잉 투자 상태라고 판단되는 시점이 오면 외부 판매도 충분히 가능한 선택지"라고 밝힌 바 있다.

2026.07.17 10:30한정호 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

"갤럭시Z플립8 193만원→78만원...제휴카드 필요없다" 예판기간 매장 가보니

'AI 음성 비서'의 배신...이용자 분통 왜

목소리를 넘어 연기까지…컴투스 '제우스: 오만의 신', 배우 박지현이 빚은 '판도라'

아마존, 오픈AI에 72조원 투자 완료…지분 5% 확보

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.