• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'퓨리오사 AI'통합검색 결과 입니다. (81건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

퓨리오사AI, 3세대 칩에 HBM 12개 탑재...HBM 물량 조달 어떻게

국내 인공지능(AI) 반도체 스타트업 퓨리오사AI가 차세대 3세대 칩에 고대역폭메모리(HBM) 12개를 탑재하는 승부수를 띄웠다. 단일 칩의 스케일링 한계를 깨고 글로벌 하이퍼스케일러 시장을 직접 겨냥하겠다는 포부다. 21일 업계에 따르면 조영진 퓨리오사AI 부사장은 최근 열린 반도체 설계자산 컨퍼런스 'IP-SoC 데이 코리아 2026'에 참석해 개발 중인 3세대 칩의 구체적인 사양을 공개했다. 퓨리오사AI의 3세대 칩은 TSMC 2nm(나노미터, 10억분의 1m) 선단 공정이 적용된다. 브로드컴과 공동 개발 중으로, 2028년 상용화를 목표로 하고 있다. 가장 눈에 띄는 지점은 메모리 탑재량이다. 차세대 제품에 탑재되는 HBM은 12개로, 용량은 576GB에 달한다. 이는 칩당 2개가 탑재되는 레니게이드(RNGD) 용량(48GB)의 12배 수준이다. 대역폭은 초당 48TB를 지원해 레니게이드 대비 32배 넓어졌다. 연산 성능은 레니게이드의 32배인 32PFLOPS(페타플롭스)로 예상된다. 퓨리오사AI는 빅다이(Big Die) 기술을 통해 해당 칩을 구현한다. 이를 위해 I/O(입출력) 다이와 중앙에 850mm² 육박하는 2개의 대형 다이가 대칭으로 배치되는 거대한 구조를 택했다. 조 부사장은 "3세대 칩은 2세대 대비 물리적으로 8배가량 커진 초대형 칩"이라며 "이를 통해 단일 칩의 물리적 스케일링 한계를 제거하고 시스템 레벨에서의 연산 및 메모리 확장을 가능하게 할 것"이라고 강조했다. 다만 업계 일각에서는 퓨리오사AI의 이 같은 칩 대형화 스펙을 두고 우려의 목소리도 나온다. HBM 공급난이 가중되는 상황에서, 스타트업이 한 칩당 12개에 달하는 막대한 HBM 물량을 어떻게 안정적으로 조달할 수 있겠느냐는 지적이다. AI반도체 업계 관계자는 “현재 HBM은 시장에서 씨가 마른 상황이라 구하기가 정말 어렵다”며 “대기업도 구하기 힘든데, 스타트업이 물량을 어떻게 조달하려는지 의문”이라고 말했다. 퓨리오사AI 관계자는 이와 관련해 "경쟁력 있는 아키텍처와 소프트웨어를 통해 성공적으로 상용화에 이르면 HBM 조달 문제는 자연스럽게 해결될 것"이라며 자신감을 내비쳤다. 업계 안팎에서는 퓨리오사AI가 막대한 비용 부담에도 불구하고 브로드컴의 턴키(일괄 수주) 서비스를 선택한 이유도 바로 이 '공급망 장악력'에 있다고 보고 있다. 최선단 파운드리 공정과 HBM 등 핵심 인프라를 대거 확보하고 있는 브로드컴울 지렛대 삼아 부품 조달 병목을 해결하려 한다는 분석이다. 반도체 업계 관계자는 "퓨리오사AI가 HBM 12개를 얹은 초대형 칩을 완성하기 위해, 브로드컴의 막강한 공급망을 지렛대로 삼은 걸로 보인다”고 평가했다.

2026.09.21 17:03전화평 기자

오케스트로-퓨리오사AI, 국산 NPU 상용화 맞손…공공·금융 시장 공략

오케스트로와 퓨리오사AI가 국산 신경망처리장치(NPU)를 기반으로 한 인공지능(AI) 인프라 상용화에 나선다. 실제 고객 실증을 거쳐 공공·금융·기업 시장에서 공동 사업을 확대한다는 전략이다. 오케스트로 그룹은 퓨리오사AI와 지난 18일 서울 강남구 퓨리오사AI 본사에서 NPU 기반 AI 인프라 및 플랫폼 기술·사업 협력을 위한 업무협약(MOU)을 체결했다고 21일 밝혔다. 양사는 올해 초부터 퓨리오사AI의 2세대 NPU '레니게이드(RNGD)'와 오케스트로의 AI 인프라 소프트웨어를 연계하는 기술 협력을 진행해왔다. 퓨리오사AI의 NXT RNGD 서버를 오케스트로 AI 인프라 환경에 구축해 호환성과 주요 기능을 검증하고 RNGD 기반 대규모언어모델(LLM)을 실제 서비스 환경에서 안정적으로 배포·서빙·운영하기 위한 기술을 단계적으로 구현했다. 이를 바탕으로 오케스트로는 기존 그래픽처리장치(GPU) 중심으로 제공해온 AI 추론 운영 플랫폼 '콘체르토 AI(CONCERTO A.I.)'의 지원 범위를 RNGD까지 확대했다. 콘체르토 AI는 AI 모델 배포와 서빙, 컴퓨팅 자원 관리, 서비스 모니터링 등을 통합 지원하는 AI 추론 인프라 플랫폼이다. 양사는 NPU 기반 LLM 서빙 환경을 직접 구성해야 하는 부담을 줄이고 NPU에서도 AI 서비스를 구축·운영할 수 있는 환경을 마련했다고 설명했다. GPU와 NPU를 함께 활용하는 이기종 AI 인프라 운영 기술도 강화한다. 콘체르토 AI는 요청 특성과 가속기 자원을 고려해 추론 경로를 구성하는 지능형 라우팅과 토폴로지 기반 스케줄링 기능을 지원한다. 이를 통해 GPU와 NPU 등 서로 다른 AI 가속기를 서비스와 워크로드 특성에 따라 활용할 수 있도록 한다. 향후 모델과 추론 런타임, AI 가속기를 아우르는 통합 운영·모니터링 기술도 고도화할 계획이다. 이번 협약을 계기로 양사는 기술 검증 중심의 협력을 실제 고객 사업으로 확대할 방침이다. 다양한 AI 모델과 워크로드를 대상으로 RNGD 기반 AI 인프라의 성능과 안정성을 검증하고 고객 대상 벤치마크테스트(BMT)와 실증을 진행해 실제 서비스 환경에 적합한 구축·운영 모델을 구체화할 계획이다. 공공·금융·기업 고객의 AI 서비스 요구와 워크로드 특성에 맞춰 RNGD 기반 인프라를 공동 설계·제안하고 BMT와 실증을 실제 구축 사업으로 연결한다는 방침이다. 공동 영업과 마케팅, 기술 지원을 통해 산업별 구축 사례를 확보하고 신규 사업 모델도 발굴한다. 오케스트로의 AI 인프라 풀스택 소프트웨어와의 연계도 확대한다. 서버 가상화 솔루션 '콘트라베이스', 클라우드 네이티브 운영 관리 플랫폼 '비올라', 멀티·하이브리드 클라우드 통합 관리 플랫폼 '오케스트로 CMP', 데브옵스 솔루션 '트럼본' 등을 활용해 AI 인프라 구축부터 플랫폼 운영과 통합 관리까지 지원한다. 양사는 국산 AI 모델과 가속기, AI 인프라 소프트웨어를 결합한 'K-AI 인프라' 생태계 확산에도 협력한다. RNGD와 오케스트로의 AI 인프라 기술을 기반으로 공공·금융·기업의 프라이빗 AI와 소버린 AI 구축 수요를 공략하고 국산 NPU 기반 AI 인프라의 적용 범위를 확대한다는 목표다. 백준호 퓨리오사AI 대표는 "AI가 실제 기업·공공 환경에 확산되면서 AI 가속기의 성능과 전력 효율뿐 아니라 다양한 AI 워크로드를 안정적으로 배포·운영할 수 있는 소프트웨어와 인프라 역량의 중요성이 더욱 커지고 있다"며 "오케스트로의 AI 인프라 소프트웨어 스택과 RNGD를 결합해 대규모 AI 데이터센터와 토큰 팩토리를 최적으로 운영할 수 있는 풀스택 솔루션을 구현하고 공공·금융·기업 고객의 실제 서비스 환경에서 상용 구축을 지속 확대해 나가겠다"고 말했다. 김민준 오케스트로 그룹 의장은 "올해 초부터 퓨리오사AI와 긴밀한 기술 협력을 이어오며 NPU에서도 AI 모델을 손쉽게 배포·서빙하고 운영할 수 있는 기술 기반을 마련하고 GPU와 NPU를 아우르는 AI 추론 인프라로 콘체르토 AI의 기술 범위를 확장해 왔다"며 "이번 협약을 계기로 기술 검증을 고객 실증과 사업화로 연결하고 양사 기술 경쟁력을 결합해 공공·금융·기업 시장에서 새로운 AI 인프라 레퍼런스를 만들어 나가겠다"고 밝혔다.

2026.09.21 15:05한정호 기자

[AI는 지금] AI 투자, 오픈AI·앤트로픽에 몰렸다…韓도 상위 10곳 74.5% 점유

인공지능(AI) 벤처투자 시장이 빠르게 커지고 있지만 자금은 소수 대형 기업으로 쏠리고 있는 것으로 나타났다. 글로벌 시장에선 오픈AI·앤트로픽 등 프론티어 AI 기업의 초대형 후속투자가 전체 시장을 끌어올렸고, 국내에서도 AI 반도체와 모델 기업을 중심으로 후기단계 투자가 늘면서 상위 기업의 자금 흡수력이 크게 높아진 것으로 드러났다. 19일 소프트웨어정책연구소(SPRi)가 발표한 '글로벌 AI 벤처투자 동향과 투자 집중구조 : 국내 현황과 시사점' 보고서에 따르면 올해 상반기 글로벌 벤처캐피털(VC) 투자액 가운데 AI가 차지한 비중은 75.9%에 달했다. 2021년 23.5%에서 52.4%포인트 상승한 수치로, 같은 기간 거래건수 비중은 20.4%에서 36.6%로 상대적으로 완만하게 늘었다. 이처럼 투자액 비중이 거래건수보다 훨씬 빠르게 늘면서 AI 투자시장 확대가 신규 투자 대상 증가보다 개별 거래의 대형화에 더 크게 영향을 받은 것으로 분석된다. 실제 AI VC의 건당 평균 투자액은 2021년 1350만 달러에서 올해 상반기 5550만 달러로 4배 이상 늘었다. 전체 VC 평균과 비교해도 격차가 커졌다. AI VC의 건당 투자규모는 2021년 전체 VC 평균의 1.15배 수준이었지만 올해 상반기에는 2.08배까지 높아졌다. 자금은 미국과 후기단계(시리즈 C 이상) 기업으로 빠르게 집중됐다. 올해 상반기 동안 미국은 글로벌 AI VC 투자액의 84.1%를 차지했다. 미국·중국·영국 등 상위 3개국 비중도 92.9%에 달했고 국가별 투자 집중도를 나타내는 허핀달-허시먼지수(HHI)는 2022년 3684에서 올해 상반기 7124로 상승했다. 투자 단계에서도 비슷한 흐름이 나타났다. 올해 상반기 시드(창업 초기)·초기단계(시리즈 A~B) 투자는 전체 거래건수의 92.8%를 차지했지만 투자액 기준 비중은 27.2%에 그쳤다. 후기단계는 거래건수 비중이 7.2%에 불과했지만 투자액의 72.8%를 차지했다. 또 지난 2023년 39.5%까지 떨어졌던 후기단계 투자액 비중은 2025년 61.8%로 올라선 뒤 올해 들어 더 높아졌다. 초대형 거래의 영향은 더 커졌다. 10억 달러 이상 AI 투자거래는 2021년 13건에서 2025년 22건으로 늘었고 올해 상반기에만 34건을 기록했다. 해당 거래들의 투자액은 올해 상반기 3167억 달러로 전체 AI VC 투자액의 약 74%를 차지했다. 기업별 집중도 역시 크게 높아졌다. 글로벌 AI VC 투자액 가운데 상위 3개 피투자기업이 차지하는 비중은 2021년 3.6%에서 올해 상반기 55.7%로 높아졌다. 상위 10개 기업 비중은 같은 기간 8.9%에서 67.5%로 확대됐다. 이는 오픈AI와 앤트로픽, xAI 등이 대규모 자금조달을 반복한 영향이 컸다. 투자 대상도 AI 서비스에서 기반 기술로 이동했다. 2500만 달러 이상 대형 투자에서 AI 모델 기업의 비중은 2021년 1.5%에 불과했지만 올해 상반기에 61.0%까지 상승했다. AI 서비스·애플리케이션 비중은 같은 기간 73.9%에서 18.7%로 낮아졌다. 국내 AI VC 시장은 투자액 자체가 크게 늘지 않았으나, 전체 VC 시장에서 차지하는 비중만 높아졌다. 국내 전체 VC 투자액에서 AI가 차지하는 비중은 2021년 19.9%에서 올해 상반기 44.3%로 상승했다. 반면 AI VC 투자액은 2021년 20억4800만 달러, 2025년 17억9500만 달러, 올해 상반기 18억5400만 달러로 큰 폭의 증가세를 보이지 않았다. 전체 VC 시장이 축소되면서 AI 투자의 상대적 비중이 커진 것이다. 다만 국내 자금도 후기단계와 일부 기업에 빠르게 몰리고 있는 것으로 나타났다. 올해 상반기 국내 AI VC 투자액 가운데 후기단계 비중은 72.3%로, 글로벌 72.8%와 비슷했다. 상위 3개 기업이 전체 투자액의 55.8%, 상위 10개 기업은 74.5%를 차지했다. 2021년 상위 10개 기업 비중이 31.0%였던 것과 비교하면 두 배 이상 높아졌다. 투자 분야에서도 글로벌 시장과 국내 시장은 차이를 보였다. 글로벌 대형 투자가 AI 모델에 집중된 반면, 국내에선 AI 반도체와 AI 모델이 양대 투자 분야로 부상했다. 실제 올해 상반기 국내 AI VC 투자액 가운데 AI 반도체 비중은 33.4%, AI 모델은 26.8%로, 두 분야를 합쳐 60.2%를 차지했다. 2021년 79.4%에 달했던 AI 서비스·애플리케이션 비중은 같은 기간 21.0%까지 낮아졌다. 이는 리벨리온과 퓨리오사AI, 엑시나 등 AI 반도체 기업과 업스테이지 등 AI 모델 기업의 대규모 후속투자가 이어진 영향이다. SPRi는 "투자금이 성장기업으로 몰리는 상황에서 초기 기업의 시장 진입 경로와 후속 자금조달 체계를 함께 확충할 필요가 있다"며 "특히 초기 AI 기업은 투자 이후에도 컴퓨팅 자원과 고객 확보, 기술 검증이 필요한 만큼 자본 공급만으로는 성장 과정의 자금 공백을 해소하기 어렵다"고 진단했다. 이어 "정책펀드 간 후속투자 연계와 컴퓨팅 지원, 민간 전략적 투자자의 사업협력을 함께 묶는 방안이 필요하다"며 "분야별로 필요한 자본 규모와 회수기간, 기술개발 기간이 다른 만큼 기술·산업 특성에 따라 투자체계를 달리 검토할 필요가 있다"고 덧붙였다.

2026.09.19 11:05장유미 기자

HS효성인포, 부산서 '데이터센터 현대화 컨퍼런스 2026' 개최

HS효성인포메이션시스템이 인공지능(AI) 시대에 대응하기 위한 데이터센터 현대화 전략을 공유하는 자리를 마련했다. HS효성인포메이션시스템은 15일 부산 롯데호텔 크리스탈볼룸에서 '데이터센터 현대화 컨퍼런스 2026'을 개최했다고 밝혔다. 데이터센터 현대화 컨퍼런스는 HS효성인포메이션시스템이 부산·경남 지역 IT 담당자들을 대상으로 10여 년간 이어온 연례 행사다. 회사는 매년 주요 기술 트렌드와 대응 전략을 공유하며 최근에는 AI 데이터센터 구축과 운영 혁신을 핵심 주제로 다루고 있다. 행사에서는 엔터프라이즈 AI 도입에 필요한 인프라 구축 전략부터 프라이빗 클라우드 운영, 데이터 보호 및 사이버 복원력 확보 방안까지 데이터센터 혁신을 위한 다양한 기술과 사례가 소개됐다. 최근 기업들의 AI 활용이 확대되면서 대규모 학습·추론 워크로드와 방대한 데이터를 안정적으로 처리할 수 있는 인프라의 중요성이 커지고 있다. 이에 따라 데이터센터 역시 단순한 서버 증설을 넘어 AI 인프라, 클라우드, 데이터 보호 체계를 통합적으로 운영하는 방향으로 진화하고 있다. 이번 행사에서는 엔터프라이즈 AI를 위한 데이터·인프라 구축 전략, AI 학습·추론 환경 현대화, 프라이빗 클라우드 운영 효율화, 보안 및 데이터 보호 등 데이터센터가 갖춰야 할 핵심 기술과 운영 방안이 집중적으로 다뤄졌다. HS효성인포메이션시스템은 40여 년간 축적한 인프라 구축 경험을 바탕으로 AI 인프라 도입부터 프라이빗 클라우드 구축, 데이터 보호, 운영 효율화에 이르는 데이터센터 현대화 로드맵을 제시했다. 기조 발표를 맡은 권동수 전문위원은 '2026 에이전틱 AI 시대, 엔터프라이즈 AI를 위한 데이터·인프라 구축 전략'을 주제로 AI 시대에 요구되는 인프라 방향성을 설명했다. 이어 정고훈 PM은 스마트시티 구축 사례를 통해 프라이빗 클라우드 구축 경험과 운영 전략을 소개했으며, 김동혁 팀장은 재해와 사이버 공격 상황에서도 서비스 연속성을 확보할 수 있는 데이터 보호 및 복구 체계를 발표했다. 기술 파트너사들도 최신 AI·데이터센터 기술을 선보였다. 퓨리오사AI는 AI 추론용 NPU 'RNGD'를 소개했고, 래블업은 AI 학습·추론 환경 효율화를 위한 플랫폼 전략을 발표했다. VM웨어 바이 브로드컴은 VM웨어 클라우드 파운데이션(VCF) 기반 데이터센터 운영 효율화 방안을 빔은 제로 트러스트 환경에 적합한 차세대 데이터 복구 전략을 공유했다. 팔로알토 네트웍스 코리아는 '프리시전 AI' 기반 보안 플랫폼을 활용한 데이터센터 보안 혁신 방안을 제시했다. 행사장에는 씨플랫폼, 오우션테크놀러지, 젠시스, 유니온바이오매트릭스 등 파트너사 전시 부스도 마련돼 참가자들이 최신 인프라 솔루션과 기술 동향을 직접 살펴볼 수 있도록 했다. 양정규 HS효성인포메이션시스템 대표는 "AI 활용이 확대될수록 이를 안정적으로 운영하고 확장할 수 있는 데이터센터 기반의 중요성이 더욱 커지고 있다"며 "고객들이 이번 행사를 통해 AI 시대에 필요한 인프라 과제를 점검하고 현실적인 현대화 전략을 수립하는 계기가 되길 바란다"고 말했다. 이어 "HS효성인포메이션시스템은 AI 도입부터 데이터 인프라 구축, 운영 최적화, 데이터 보호까지 고객의 디지털 전환 전 과정을 지원하는 파트너 역할을 지속해 나갈 것"이라고 밝혔다.

2026.09.15 17:05남혁우 기자

"현지 인프라가 경쟁력"…퓨리오사AI, 에퀴닉스와 유럽 공략

퓨리오사AI가 에퀴닉스 데이터센터 인프라를 기반으로 유럽 AI 추론 시장 공략에 나선다. 해외 AI 추론 사업에 필요한 현지 인프라와 고객 접점, 데이터센터 운영 역량을 동시에 확보하고, 데이터센터 운영 관리는 에퀴닉스에 맡긴 채 AI 칩과 서버 제품 개발에 집중하기 위한 전략이다. 윤지훈 퓨리오사AI 프로덕트 매니저는 15일 서울 여의도 에퀴닉스 사옥에서 열린 간담회에서 에퀴닉스와 협력해 유럽 시장에 진출한 배경을 설명했다. "운영 인프라는 에퀴닉스 전담"… 퓨리오사AI, AI 칩 개발 환경 집중 퓨리오사AI는 포르투갈 리스본에 위치한 에퀴닉스 LS2 데이터센터에 레니게이드(RNGD) 서버를 구축하고 유럽 AI 추론 시장 공략에 나선다. 유럽 기업이 실제 AI 모델과 워크로드를 기반으로 레니게이드의 성능, 전력 효율, 사용 편의성을 검증할 수 있는 평가 환경을 마련하는 것이 핵심이다. 검증 이후에는 고객 자체 인프라로 이전하거나 클라우드 파트너와 연계해 상용 환경으로 확장하는 모델을 추진한다. 현지에 서버를 설치하는 데 그치지 않고 고객 워크로드 검증, 서비스 운영, 상용화까지 이어지는 사업 기반을 구축하겠다는 전략이다. 퓨리오사AI는 텍스트 기반 생성형 AI는 물론 비전 AI 등 다양한 추론 워크로드 적용도 검토하고 있다. 윤지훈 퓨리오사AI 프로덕트 매니저는 "우리는 칩과 제품을 설계하는 데 전문성이 있고 그 뒤의 인프라를 운영하거나 다양한 엔드유저가 편하게 쓸 수 있도록 관리하는 부분은 전문 파트너와 협력하는 것이 중요하다고 판단해 에퀴닉스를 선택했다"고 밝혔다. 에퀴닉스는 콜로케이션뿐 아니라 피어링과 인터커넥션 서비스를 제공한다. 퓨리오사AI는 이를 활용해 현지 데이터센터와 클라우드, 고객 서비스 환경을 연결하고, 에퀴닉스 생태계 내 잠재 고객 접점도 확대할 수 있다. 고성능 AI 서버 운영에 필요한 전력과 냉각, 네트워크, 운영 안정성 측면에서도 글로벌 데이터센터 사업자의 전문성을 활용할 수 있다는 설명이다. 윤 PM은 "해외에서는 실제 해당 시장에 인프라가 있느냐가 매우 중요한 요인"이라며 "로컬 인프라가 중요한 고객이나 시장에서는 에퀴닉스와 협력해 추가적인 기반을 확보하고 있다"고 밝혔다. 이어 "에퀴닉스는 콜로케이션 외에도 인터커넥션과 피어링 등 다양한 서비스를 제공하고, 이를 통해 많은 고객을 소개받아 후속 대화도 이어가고 있다"고 덧붙였다. ■ "운영 인프라는 에퀴닉스 전담"… 퓨리오사AI, AI 칩 개발에 역량 집결 앤서니 호 에퀴닉스 아시아태평양 제품관리 디렉터는 에이전틱 AI 확산으로 복잡해지는 네트워크 운영 환경의 대안으로 에퀴닉스 패브릭 인텔리전스를 제시했다. 최근 에퀴닉스 호라이즌에서 공개한 패브릭 인텔리전스는 클라우드, 네오클라우드, 온프레미스, 데이터 플랫폼 등 분산된 AI 인프라를 연결·운영하는 AI 기반 연결성 플랫폼이다. AI 워크로드별로 컴퓨팅 자원, 데이터 위치, 보안 정책, 네트워크 성능 요건이 수시로 바뀌는 환경에서 기존의 수작업 중심 네트워크 운영 방식으로는 대응에 한계가 있다는 설명이다. 에퀴닉스는 패브릭 슈퍼 에이전트, MCP 서버, 패브릭 애플리케이션 커넥터를 통해 연결 구성과 운영 작업의 자동화를 지원한다. 자연어로 연결을 요청할 수 있고, AI 에이전트와 외부 시스템은 MCP 서버를 통해 패브릭 기능을 호출할 수 있다. 패브릭 인사이트는 연결 상태와 사용 현황을 분석·가시화한다. 앤서니 호 디렉터는 "기업은 AI 에이전트와 워크로드 요구에 맞춰 분산 인프라 간 연결을 신속히 구성하고, 운영·확장 과정의 수작업과 복잡성을 줄일 수 있다"고 말했다. 에퀴닉스는 퓨리오사AI와의 협력을 바탕으로 AI 반도체·서버, 데이터센터 인프라, 네트워크 연결성을 결합한 지원 체계도 강화한다. 유럽 현지 인프라를 통해 AI 워크로드 검증과 서비스 확장을 지원하고, 국내 AI 기업의 해외 진출을 위한 인프라 파트너 역할을 확대한다는 계획이다. 장혜덕 에퀴닉스코리아 지사장은 "반도체 성능뿐 아니라 데이터, 클라우드, 네트워크를 효율적으로 연결하는 역량이 AI 경쟁력을 좌우할 것"이라며 "퓨리오사AI를 비롯한 국내 기업의 글로벌 진출을 지원하겠다"고 밝혔다.

2026.09.15 11:59남혁우 기자

퓨리오사AI, 싱가포르 법인 설립…아·태 AI 추론 인프라 공략 가속

국내 인공지능(AI) 반도체 기업 퓨리오사AI가 싱가포르에 현지 법인을 설립하고 아시아·태평양(APAC) AI 추론 인프라 시장 공략에 본격 착수했다. 퓨리오사AI는 싱가포르 현지 법인 '퓨리오사AI 싱가포르'를 설립했다고 11일 밝혔다. 자체 개발한 2세대 AI 추론 가속기 'RNGD(레니게이드)'의 글로벌 상용 도입이 확대됨에 따라 현지 밀착형 지원을 강화하기 위한 전략이다. 이번 싱가포르 법인은 애디슨 치 APAC 영업 부사장이 총괄한다. 퓨리오사AI는 싱가포르를 거점으로 동남아시아를 포함한 아태 전역의 주요 기업과 공공기관, 클라우드 서비스 사업자(CSP), 인프라 파트너와의 제휴를 공격적으로 확대할 방침이다. 현지 인력 채용을 늘리고 초기 개념검증(PoC) 단계부터 대규모 상용화 구축까지 지원하는 기술 조직도 대폭 강화한다. 이로써 퓨리오사AI는 서울 본사를 비롯해 미국 실리콘밸리, 포르투갈 리스본에 이어 싱가포르까지 아우르는 글로벌 거점 네트워크를 완성했다. 이번 전략 거점 확장은 올해 1월 본격 양산에 돌입한 2세대 신경망처리장치(NPU) RNGD의 시장 안착에 따른 조치다. RNGD는 거대언어모델(LLM), 멀티모달, 에이전틱 AI 등 고난도 추론 연산에 특화된 데이터센터용 칩이다. 특히 카드 8장을 장착한 'NXT RNGD' 서버는 3킬로와트(kW) 수준의 저전력으로 구동돼 고가의 수랭식 냉각 설비 없이 기존 데이터센터의 공랭식 환경에서 그대로 대규모 확장이 가능한 것이 최대 강점이다. 현재 삼성SDS, LG AI연구원 등 국내외 주요 고객사 상용 환경에 공급되고 있다. 백준호 퓨리오사AI 대표는 “아시아·태평양은 데이터센터 전력과 물리적 인프라 제약 속에서 고도화된 AI를 도입하려는 수요가 집중되는 글로벌 요충지”라며 “싱가포르 거점을 통해 역내 고객들과 긴밀히 협력해 기술 검증부터 실제 양산 배치까지 빠르게 완수하겠다”고 말했다.

2026.09.11 09:45전화평 기자

"K-팹리스, 해외 PoC 감당 한계"…마중물 정책 호소

국내 인공지능(AI) 반도체 팹리스 기업들이 해외 진출 확대를 위해 정부 제도 지원을 요구했다. 연구실 단계 기술 검증을 넘어 상용화 단계에 진입했으나, 해외 고객 확보 과정에서 초기 실증 비용과 현지 기술 지원 부담이 크다는 이유다. 10일 서울 여의도 국회의원회관에서 열린 '국산 NPU 수출 확대 및 판로 다변화를 위한 국회 정책토론회'에서 국내 신경망처리장치(NPU) 기업 관계자들은 글로벌 시장 진입 과정에서 직면하는 비용과 신뢰성 문제를 집중 지적했다. 이들은 스타트업이 해외 현지 기술 지원과 장기 품질 보증 요구를 홀로 감당하기 어렵다고 설명했다. 조재홍 딥엑스 상무는 "상반기 기준 1300만 달러 규모 수출 실적을 올렸으나, 해외 대기업은 3년에서 10년에 이르는 품질 보증을 유지할 수 있는지 의구심을 가진다"고 밝혔다. 그는 "시차 대응을 위한 현지 엔지니어 채용과 해외 전시회 참가비 등 고정비 부담이 상당하다"며 "CES 부스 운영비만 12억원 수준"이라고 밝혔다. 초기 시장 진입 문턱을 낮추기 위한 지원 방안이 제안됐다. 딥엑스는 수요기업의 초기 구매 부담을 낮추는 'K-AI 반도체 수출 바우처' 신설을 촉구했다. 3억원 안팎의 초기 개념증명(PoC) 비용을 보조해 30억원대 이상 본 계약 체결로 유도하는 마중물 구조다. 현지 테스트베드 제공과 소프트웨어 개발 키트(SDK) 런타임 최적화 프로그램 신설도 건의했다. 양산 단계 검증과 생산 인프라 한계도 언급됐다. 김주영 하이퍼엑셀 대표(카이스트 전기및전자공학부 교수)는 "시제품 단계와 달리 월 1만장 규모 납품 요구에는 테스트 자동화 등 생산 인프라 한계가 나타난다"며 "글로벌 빅테크를 설득하려면 실제 운영실적(레퍼런스) 확보가 필수"라고 강조했다. 박성현 리벨리온 대표는 공공 AI 인프라 조달 평가기준을 '외산 그래픽처리장치(GPU)' 규격 맞추기에서 'AI 가속기' 단위 성능 중심 경쟁으로 전환해야 한다고 밝혔다. 박 대표는 "국가 AI 컴퓨팅 센터 등에서 실제 트래픽을 장기간 처리하는 기회가 보장돼야 한다"며 "안방에서 대규모 실서비스 레퍼런스가 선행돼야 해외 고객을 설득할 수 있다"고 설명했다. 선제적 공공 인프라 배치 요구도 이어졌다. 백준호 퓨리오사AI 대표는 "반도체는 타이밍 산업인 만큼 수요를 기다리지 않고 대규모 배치를 통해 시장을 창출해야 한다"고 말했다. 이어 "2030년까지 확대될 8.5기가와트(GW) 규모 신규 데이터센터에 국산 NPU 배치를 정책적으로 뒷받침해야 한다"며 "칩과 소프트웨어, 모델을 묶은 풀스택 인프라로 글로벌 소버린 AI 시장을 공략해야 한다"고 제안했다. 정책자금 연속성 확보도 과제다. 김주영 대표는 "AI 반도체는 매년 차세대 칩을 설계하고 양산해야 생존할 수 있는 구조"라며 "단발성 연구개발(R&D) 과제에 머물지 않고 국민성장펀드 등을 통해 팹리스를 향한 단계별 스케일업 자본 투입이 지속돼야 한다"고 요청했다. 정책토론회는 고동진 국민의힘 의원실 주관으로 열렸다. 고동진 의원은 인사말에서 "국산이라는 이유만으로 제품을 써달라는 논리는 시장에서 통하지 않는다"며 "엔비디아 대비 비용 효율이 확인된 만큼, 공공기관과 연구소 서버에서 국산 NPU를 선제 검증하고 안정화해야 수출길이 열린다"고 밝혔다.

2026.09.10 12:24전화평 기자

퓨리오사AI "에이수스와 NPU 카드 넘어 AI 인프라로 협력 확대"

"에이전틱 AI의 핵심은 결국 파운데이션 모델입니다. 최근 다양한 오픈소스 기반 프론티어 모델이 부상하고 있는 만큼, 퓨리오사AI는 이런 모델을 최대 성능과 효율로 구동할 수 있는 해결책을 제공하는 데 주력하고 있습니다." 지난 3일 서울 여의도 콘래드호텔에서 지디넷코리아와 만난 백준호 퓨리오사AI 대표는 에이전틱 AI 시대의 AI 인프라 경쟁력으로 '추론 효율성'을 꼽았다. 퓨리오사AI는 2017년 설립된 국내 1세대 NPU 기업이다. 자체 개발한 NPU와 소프트웨어 기술력을 바탕으로 데이터센터 AI 추론 시장을 공략하고 있으며, 2세대 NPU 레니게이드를 통해 국내외 고객사로 공급 범위를 확대하고 있다. 백준호 대표는 "2세대 NPU '레니게이드(RNGD)'는 에이전틱 AI로 늘어난 연산 비용을 낮출 수 있는 AI 추론 솔루션이며 에이수스와 고효율 AI 추론 인프라 공급을 위해 협력할 것"이라고 밝혔다. "레니게이드 NPU, GPU 대체할 고효율 솔루션" AI가 실험 단계를 넘어 실제 서비스에 대규모로 적용되면서 기업들이 가장 크게 직면한 문제는 비용이다. AI 서비스 이용량과 추론 규모가 급증하면서 GPU 중심의 인프라 비용과 전력 비용이 전체 서비스 비용에서 차지하는 비중도 커지고 있다. 퓨리오사AI는 이런 문제를 해결할 수 있는 대안으로 올해부터 공급에 들어간 2세대 NPU '레니게이드(RNGD)'를 내세웠다. 기존 GPU 대비 전력 및 인프라 비용을 낮추고, 동일한 AI 서비스를 보다 효율적으로 운영하는 것이 목표다. 백 대표는 "레니게이드는 GPU의 보완재가 아닌 대체재다. 자체 추산 결과 레니게이드는 비용 효율 면에서 엔비디아 H200(호퍼) 등 GPU 대비 약 1.3~2배 더 효과적"이라고 설명했다. 이어 "삼성SDS 클라우드 인스턴스에 레니게이드가 도입돼 기업 고객 대상 상용 서비스 중이며 업스테이지 등 AI 네이티브 기업도 활용중이다. LG 엑사원 등 프론티어 모델을 비롯해 공공·금융·발전소 등 다양한 산업 분야에서도 도입이 진행중"이라고 말했다. "긴 문맥·반복 추론 부담 더는 솔루션에 집중" 챗봇이나 거대언어모델(LLM) 등 기존 생성 AI는 이용자의 요청에 대한 응답을 생성하는 데 목적이 있다. 반면 에이전틱 AI는 목표를 달성할 때까지 여러 차례 추론을 반복하고, 긴 문맥을 유지하면서 지속적으로 토큰을 생성한다. 이 과정에서 긴 문맥을 유지하고 대규모 토큰을 생성하면서 추론 비용도 증가할 수 있다. 백준호 대표는 "에이전틱 AI 확산에 따라 추론 연산이 늘어나며 관련 비용이 급증하는 만큼 이를 효율적으로 처리할 수 있는 AI 반도체와 인프라가 반드시 필요하다"고 강조했다. 이어 "퓨리오사AI는 반복적인 추론 과정에서 발생하는 KV 캐시를 효율적으로 관리하고, 소프트웨어 스택 차원에서 전체 문맥을 효과적으로 유지·관리하는 하드웨어 및 소프트웨어 최적화에 집중하고 있다"고 설명했다. "1세대 NPU 상용화부터 에이수스와 협력" 퓨리오사AI는 1세대 '비전NPU' 상용화 단계부터 대만 컴퓨팅·인프라 기업인 에이수스와 협력해 왔다. 백준호 대표는 "레니게이드 NPU 탑재 카드의 상용화와 대량 생산 과정에서 에이수스의 역할이 컸다"고 말했다. 설계한 실리콘을 실제 서버에 탑재할 수 있는 복잡한 카드 제품으로 구현하고, 대량 생산 단계까지 안정적으로 연결하는 과정에서 에이수스가 보유한 제조·양산 경험과 노하우가 결정적인 역할을 했다는 것이다. 폴 주 에이수스 인프라 솔루션 비즈니스 그룹(ISG) 총괄 수석부사장은 "에이수스는 퓨리오사AI의 성장 가능성과 잠재력을 보고 협력에 나섰다"고 설명했다. 퓨리오사AI가 칩과 아키텍처 설계에 강점을 갖고 있다면 에이수스는 시스템 설계와 제조, 부품 조달 및 글로벌 공급망에서 강점을 갖고 있다. 양사는 서로 다른 역량을 결합해 실제 제품을 시장에 공급하는 데 초점을 맞췄다. 폴 주 부사장은 "에이수스는 시스템 레벨 특화, 퓨리오사AI는 칩 면에서 장점이 있다. 부품 선정 등에 있어서도 서로 장점을 결합할 수 있다고 판단했다"고 설명했다. "에이수스와 글로벌 AI 인프라 시장 공략 확대" 양사는 단순한 NPU 카드 제조와 공급을 넘어 서버와 시스템, 나아가 수백 MW(메가와트)에서 수 GW(기가와트) 급 AI 인프라 구축으로 협력 영역을 확대중이다. 폴 주 에이수스 수석부사장은 "글로벌 시장 확대에는 기술력뿐 아니라 현지 영업, 제품 공급, 판매 후 유지보수까지 고객이 요구하는 전체 공급망을 구축하는 것이 중요하다"고 설명했다. 이어 "1세대 협력에서는 에이수스가 크게 드러나지 않았지만 시스템과 랙 차원에서 강점이 있는 만큼 앞으로 더 많은 리소스를 제공하며 협력할 것"이라고 말했다. 에이수스는 이에 따라 글로벌 영업망과 제조·조달 역량을 활용해 레니게이드 기반 서버 솔루션의 시장 확대를 지원할 계획이다. 백준호 대표는 "양사 협력은 이제 시작 단계다. 2세대 레니게이드 NPU 탑재 카드 상용화를 시작으로 양사의 기술·제조·공급망 역량을 결합해 서버와 랙, 데이터센터 단위의 AI 인프라로 확장할 것"이라고 말했다.

2026.09.10 09:37권봉석 기자

한컴, 국산 인프라로 '에이전틱 OS' 개발…기업·공공 AX 지원

한컴이 국산 인프라를 활용해 기업·공공기관용 인공지능 전환(AX) 시장 공략에 나선다. 한컴은 한컴이노스트림, 퓨리오사AI와 AX 사업 협력을 위한 3자 업무협약을 체결했다고 8일 밝혔다. 세 회사는 AX 어플라이언스 개발과 전문인력 양성, 기술 검증, 공동 영업 분야에서 협력한다. 한컴은 에이전틱 OS와 퓨리오사AI의 2세대 AI 가속기 '레니게이드'를 결합한 개념검증용 AX 어플라이언스를 개발한다. 이후 기업과 공공기관이 내부 전산 환경에서 AI를 운영할 수 있는 온프레미스형 제품으로 상용화할 방침이다. 한컴은 에이전틱 OS 기반 솔루션 개발과 제품화를 주도한다. 퓨리오사AI 신경망처리장치(NPU) 환경에 맞춰 운영체제를 최적화하고 AI 에이전트의 추론 성능과 전력 효율, 운영 안정성을 높이기 위한 기술 검증도 진행한다. 퓨리오사AI는 레니게이드 하드웨어와 소프트웨어 스택을 제공한다. AX 어플라이언스 개발과 NPU 환경 최적화를 위한 기술 협력도 지원한다. 한컴이노스트림은 NPU 전문인력 양성과 교육을 통한 시장 수요 발굴을 담당한다. 퓨리오사AI의 NPU 공인 교육기관으로서 교육과정 기획부터 마케팅과 교육생 모집, 운영까지 맡고 상설 교육센터를 구축한다. 교육과정은 초급부터 최고 전문가 단계까지 수준별·직무별로 구성한다. 한컴이노스트림은 정부와 대학, 기업에서 교육 수요를 확보하고 교육 과정에서 확인한 NPU 도입 수요를 퓨리오사AI와 실제 사업 기회로 연결한다. 퓨리오사AI는 교육과 실습에 필요한 NPU 기술 표준과 소프트웨어 스택을 제공한다. 한컴이노스트림과 공인 교육 프로그램의 운영 계획과 교육과정을 개발하고 강사·수강생에게 발급하는 자격증과 인증서의 공신력 확보도 지원한다. 세 회사는 기업간거래와 공공시장을 대상으로 공동 마케팅과 사업 개발을 추진한다. 한컴은 교육과 컨설팅 과정에서 확보한 고객 수요를 에이전틱 OS 기반 AX 사업으로 확장할 계획이다. 협약 체결과 함께 실무 담당자로 구성한 협의회도 운영한다. 협의회는 AX 어플라이언스 개발과 제품화 등 구체적인 실행 방안을 조율한다. 김연수 한컴 대표는 "이번 협약은 에이전틱 OS와 국산 NPU 기술을 결합해 AX 사업 경쟁력을 높이는 계기가 될 것"이라며 "AI 전문인력 양성과 기술 검증, 제품화로 이어지는 긴밀한 협력을 바탕으로 기업과 공공기관의 AX 전환을 지원하고 시장 공략에 속도를 내겠다"고 말했다.

2026.09.08 10:50김미정 기자

에이수스 "AI 팩토리·인프라 수직계열화... 네오클라우드 구축 지원"

"AI가 연구실을 넘어 현실로 들어오며 AI 인프라와 AI 팩토리 시장도 빠르게 성장하고 있다. 그러나 AI 팩토리는 단순한 서버 집합이나 데이터센터가 아니라 전력과 냉각, 소프트웨어, 운영까지 다방면에서 접근해야 한다." 3일 오전 서울 여의도 콘래드 호텔에서 국내 기자단과 만난 폴 주 에이수스 인프라 솔루션 비즈니스 그룹(ISG) 총괄 수석부사장이 이같이 강조했다. 에이수스는 이날 오후 아태지역 IT 업계 관계자와 의사 결정권자 300여 명이 참여한 가운데 '에이수스 AI테크 서밋 서울'을 개최했다. 행사 참석차 한국을 찾은 폴 주 수석부사장은 이날 "향후 AI 인프라 시장은 국가별로 데이터와 전력, 모델, 데이터센터 등을 확보하는 소버린 AI로 많은 수요를 낳을 것"이라고 전망했다. "에이수스 경쟁력은 설계부터 제조까지 '수직계열화'" 현재 AI 서버 시장에서는 에이수스, 에이서(알토스컴퓨팅), 기가바이트(기가컴퓨팅) 등 대만계 제조사와 델테크놀로지스, HPE 등 미국계 제조사들이 치열한 경쟁을 벌이고 있다. 폴 주 수석부사장은 "같은 재료에서 출발한 음식이라도 제조사나 조리법에 따라 전혀 다른 음식이 되는 것처럼, AI 서버 역시 작은 기술적 차이가 서버 전체 품질을 좌우한다. AI 서버 역시 냉각과 신호 무결성 등 완성도가 중요하다"고 말했다. 그는 에이수스의 강점으로 수직계열화를 들었다. "일부 제조사는 제조 등 특정 영역을 다른 회사에 맡기기도 한다. 그러나 에이수스는 AI 인프라를 구성하는 여러 요소에 직접 투자하고 자체 기술을 확보해 설계부터 제조까지 연결하고 있다." 폴 주 수석부사장은 이어 "에이수스가 모든 부품이나 구성요소, 원천 기술을 직접 보유할 수 없다. 그러나 직접 수행할 수 없는 영역은 전문 파트너와 협력하되, 가장 뛰어난 업체의 역량을 전체 프로젝트에 연결하고 있다"고 덧붙였다. "네오클라우드 대상 AI 팩토리 구축 지원" 에이수스는 최근 AI 모델 학습과 추론에 필요한 GPU나 연산장치를 일정 시간별로 빌려주는 이른바 '네오클라우드' 업체에서 시장 확대 가능성을 보고 있다. "네오클라우드 업체는 AI 인프라 구축을 위한 맞춤형 설계를 원하지만 이를 충족하기 위한 내부 인력과 조직을 꾸리는 데는 한계가 있다. 에이수스는 이런 업체들 대상으로 건물과 냉각시스템, 자동화 등 AI 인프라 구축 과정을 지원하고 있다." 그는 이어 "에이수스는 AI 팩토리 설계와 구성, 유지보수 등 전 영역에 걸쳐 필요한 서비스를 제공할 수 있다. 단 고객사에 따라 특정 영역만 원할 수 있으며 이런 수요에도 대응할 수 있다"고 덧붙였다. 반면 마이크로소프트와 메타, 구글 등 글로벌 하이퍼스케일러는 서비스에 필요한 서버와 프로세서, 냉각솔루션 등 자원을 직접 설계한다. 폴 주 수석부사장은 "에이수스의 주된 고객사 역시 하이퍼스케일러가 아니다"라고 일정 부분 선을 그었다. "메모리·CPU·로직 반도체 부족, 서버 공급 지연 장기화" 작년 하반기부터 불어닥친 AI 인프라 투자 경쟁은 메모리 반도체와 프로세서, 저장장치 등 완제품과 기판, 캐패시터 등 각종 부품까지 공급망 전반에 영향을 끼치고 있다. PC와 서버 등 거의 모든 분야에서 출하량 감소와 원가 상승 문제를 겪고 있다. 폴 주 수석부사장은 "메모리 뿐만 아니라 CPU와 로직 반도체 등 다양한 부품의 공급이 부족하고 CPU와 GPU를 위탁생산하는 대만 TSMC 역시 공급 여력이 모자란다. 삼성전자와 SK하이닉스 등 메모리 반도체 생산 물량도 문제"라고 말했다. 각종 부품 공급과 함께 미국 정부의 AI 반도체 수출 규제도 영향을 미치는 요소 중 하나다. 여기에 모든 부품이 준비돼야 생산을 진행할 수 있어 공급망 관리도 변수로 부상했다. 폴 주 수석부사장은 "서버 공급이 수요를 못 따라가고 적체되는 현상은 적어도 2027년까지 해소되기 어렵다. 고객사에는 가능한 한 빠르게 구매 계획을 세우고 수요를 예측할 것을 권고하고 있는 상황"이라고 말했다. "국가마다 다른 소버린 AI…맞춤형 인프라로 대응" 각 국가가 자체 데이터와 인프라를 활용해 그 국가나 지역의 제도, 문화, 역사, 가치관을 정확히 이해하는 AI를 개발하자는 '소버린 AI' 관련 움직임도 일고 있다. 폴 주 수석부사장은 "각 국가마다 환경에 맞는 소버린 AI가 필요하다. 이를 뒷받침할 전력과 데이터센터도 필요하다. 다만 '소버린 AI'에 대한 정의는 제각각이다"라고 설명했다. 그는 "단순히 데이터센터를 국내에 둘지, 혹은 서버와 자체 개발 AI 모델 확보를 염두에 두는지 등등 정의가 모두 다르다. 에이수스는 다양한 국가와 기업별 요구에 맞춰 이를 제공하기 위해 여러 국가와 기업, 스타트업과 협력하고 있다"고 말했다. "삼성전자·퓨리오사AI와 협력해 AI 인프라 생태계 확대" AI 인프라 시장의 성장세가 이어질수록 서버 한 대의 성능보다 이를 안정적으로 구축하고 운영할 수 있는 통합 역량의 중요성도 커질 전망이다. 폴 주 수석부사장은 이를 위해 한국 기업과의 협력을 강조했다. 그는 "원활한 AI 인프라 구축을 위해서 글로벌 협력이 반드시 필요하며 특히 메모리 등 핵심 부품을 공급하는 한국 내 업체와 협력이 중요하다. 현재 삼성전자와 장기 계약(LTA)을 맺고 메모리 공급 안정성을 높이고 있다"고 밝혔다. 에이수스는 퓨리오사AI를 비롯해 국내외 AI 반도체 스타트업과의 협력도 확대하고 있다. "NPU를 생산하는 스타트업인 퓨리오사AI와도 관련 협력을 이어가고 있으며 미국과 일본의 소규모 스타트업과 파트너십을 확대하고 있다. 당장 성과로 연결되지 않더라도 다양한 기술과 제품을 확보하기 위한 차원이다." 폴 주 수석부사장은 에이수스의 AI 사업 전략을 특정 제품이나 매출 목표에 맞추지 않는다고 강조했다. 그는 "매출이 아니라 어떤 제품과 어떤 서비스를 고객사에 제공할 수 있는가에 집중해야 한다"며 "그것이 결국 매출로 이어진다"고 말했다.

2026.09.04 16:17권봉석 기자

KOSA, 사우디 '리프 2026'서 한국형 AI 연합 전면 배치

한국인공지능·소프트웨어산업협회(KOSA)가 사우디아라비아에서 열린 글로벌 정보기술(IT) 전시회 '리프(LEAP) 2026'에 참가해 국내 주요 AI 기업들과 함께 한국형 풀스택 AI 역량을 집중 소개했다. KOSA는 지난 8월 31일부터 9월 3일까지 사우디 리야드에서 개최된 리프 2026에서 '한국 풀스택 AI 공동관'을 운영했다고 4일 밝혔다. 공동관에는 메가존클라우드, 퓨리오사AI, 업스테이지, NC AI, 유라클 등 국내 AI·클라우드 기업 5곳이 참여했다. 이들 기업은 AI 반도체(NPU), 클라우드 인프라, 거대언어모델(LLM), 산업 특화 AI, 엔터프라이즈 AI 플랫폼 등 AI 밸류체인 전반에 걸친 기술과 서비스를 선보이며 중동 시장 공략에 나섰다. 이번 공동관은 개별 제품을 소개하는 수준을 넘어 국내 기업들의 기술을 하나의 통합 패키지로 묶어 제안한 것이 특징이다. KOSA가 주도하는 한국 풀스택 AI 컨소시엄은 AI 반도체부터 인프라, 모델, 응용서비스, 운영관리까지 전 영역을 아우르는 기업들로 구성됐다. 특히 메가존클라우드를 중심으로 현지 산업 수요에 맞춘 통합 구축 모델을 제시하며 차별화에 나섰다. 참여 기업들도 각자의 핵심 기술을 공개했다. 퓨리오사AI는 차세대 AI 반도체 '레니게이드(RNGD)'를 소개했으며, 업스테이지는 문서 구조화 솔루션 '도큐먼트 파스'와 LLM '솔라 프로 4'를 전시했다. NC AI는 산업 현장의 디지털 전환을 지원하는 피지컬 AI 기반 디지털 트윈 기술을 시연했고 유라클은 AI 오케스트레이션 플랫폼 '오르다'와 AI 에이전트 플랫폼 '아테나'를 선보였다. 메가존클라우드는 AI 반도체와 클라우드 인프라를 통합 운영하는 관리형서비스(MSP) 및 플랫폼 구축 역량을 소개했다. KOSA는 전시 기간 동안 사우디 정부 기관과 현지 기업 관계자들을 만나 산업별 디지털 전환 수요를 확인하고 협력 방안을 논의했다. 협회는 이번 전시회를 계기로 컨소시엄 참여 기업들의 현지 사업 기회를 확대하고 중동 지역 협력 네트워크를 강화해 나갈 계획이다. 조준희 KOSA 회장은 "AI 반도체와 모델, 인프라를 아우르는 풀스택 협력이 글로벌 시장에서 중요한 경쟁력으로 부상하고 있다"며 "국내 기업들의 기술력을 결집해 사우디를 비롯한 중동 시장에서 실질적인 사업 성과를 창출할 수 있도록 협력 기반 확대에 힘쓰겠다"고 말했다.

2026.09.04 11:28남혁우 기자

[유미's 픽] 코히어·미스트랄 선점한 사우디 AI…'K-풀스택'도 성과 낼까

사우디아라비아가 인공지능(AI)을 차세대 국가 산업으로 키우면서 국내 AI 기업들이 중동 시장 공략에 속도를 내고 있다. 코히어와 미스트랄AI 등 글로벌 AI 기업들이 최근 현지 연산 인프라와 아랍어 모델 개발 사업을 잇따라 확보한 가운데 한국 기업들도 AI 반도체부터 모델, 클라우드, 산업용 AI까지 묶은 '풀스택 AI'를 앞세워 사업 기회를 찾는 모습이다. 1일 업계에 따르면 메가존클라우드, 업스테이지, NC AI, 유라클, 퓨리오사AI 등 국내 AI 기업들은 지난달 31일 사우디아라비아 리야드에서 개막한 중동 최대 IT 전시회 'LEAP 2026'에 참가했다. 행사는 오는 3일까지 나흘간 열린다. 한국인공지능·소프트웨어산업협회(KOSA)가 주도하는 '한국 풀스택 AI 컨소시엄'은 이번에 개별 솔루션보다 국내 기업들의 AI 기술을 하나의 체계로 묶어 현지 시장 공략에 나섰다. 참여 기업들은 전시뿐 아니라 기술 발표와 현지 정부·기업 관계자들을 대상으로 한 비즈니스 협의에도 나설 예정으로, 사우디에서 실제 실증과 공급 계약으로 연결할 사업 기회를 확보하는 데 초점을 맞췄다. 이처럼 국내 기업들이 사우디에 공을 들이는 것은 중동 AI 시장이 빠르게 커지고 있어서다. 시장조사업체 그랜드뷰리서치(GVR)에 따르면 중동 AI 시장 규모는 지난해 156억3000만 달러에서 올해 229억8000만 달러로 확대될 전망이다. 이후 연평균 41.8% 성장해 2033년에는 2650억6000만 달러에 이를 것으로 예상된다. 사우디의 성장세도 가파르다. GVR은 사우디 AI 시장이 지난해 92억6390만 달러에서 올해 132억7170만 달러로 커질 것으로 전망했다. 또 올해부터 2033년까지 연평균 34.0% 성장해 2033년에는 1028억170만 달러 규모에 이를 것으로 봤다. 업계 관계자는 "사우디의 AI 투자는 데이터센터와 그래픽처리장치(GPU) 같은 인프라 확보를 넘어 현지 모델과 산업용 서비스 구축으로 확대되고 있다"며 "아랍어 AI 모델과 현지 데이터셋에 대한 투자 확대도 시장 성장 요인으로 꼽힌다"고 설명했다. 특히 사우디 국부펀드(PIF)가 설립한 AI 기업 휴메인은 글로벌 AI 기업들과 잇따라 손잡으며 소버린 AI 생태계 구축에 나서고 있어 주목받고 있다. 실제 캐나다 AI 기업 코히어는 지난 7월 휴메인과 최소 50메가와트(MW) 규모의 전용 AI 컴퓨팅 인프라를 구축하기로 했다. 오는 2027년 4분기 가동을 목표로 하며 향후 5년간 코히어의 연산 수요에 맞춰 규모를 확대할 수 있도록 설계된다. 양사는 연산 자원 공급에 그치지 않고 아랍어 파운데이션 모델과 사우디 산업 환경에 맞춘 AI도 공동 개발한다. 정부와 금융, 에너지, 통신 등에 적용할 도메인 특화 모델과 기업용 AI 솔루션까지 사업 범위를 넓힐 계획이다. 프랑스 미스트랄AI도 지난달 휴메인과 손잡았다. 협력 범위는 AI 인프라 구축부터 첨단 모델 개발, AI 솔루션 공급까지 포함하며 전체 규모는 수억 유로에 달하는 것으로 전해졌다. 이에 따라 미스트랄AI와 휴메인은 사이버보안과 음성을 시작으로 아랍어 처리 성능을 강화한 AI 모델을 공동 개발할 예정이다. 또 금융과 제조, 통신, 사이버보안, 공공 등 보안과 규제 준수가 중요한 산업을 대상으로 현지 AI 솔루션 공급도 추진한다. 업계 관계자는 "사우디의 소버린 AI 수요는 데이터를 현지에 보관하는 수준을 넘어 연산 인프라와 모델, 학습·추론 환경, 산업용 AI 서비스까지 직접 통제하려는 방향으로 확대되고 있다"며 "한국 기업들도 개별 기술보다 이를 묶어 제공할 수 있는 역량을 보여주는 것이 중요하다"고 밝혔다. 이 같은 분위기 속에 한국 기업들도 이번에 KOSA 주도로 개별 솔루션보다 풀스택을 앞세워 현지 수요에 적극 대응하고 나섰다. 특히 NC AI는 이번 행사에서 산업 특화 AI '배키(VAETKI)'를 중심으로 디지털트윈과 월드모델, 로봇 파운데이션 모델 등 피지컬 AI 기술을 선보였다. 또 국내 조선과 국방 등 산업 현장에서 확보한 경험을 토대로 사우디 제조 자율화와 국방 무인화 등으로 사업 확대를 노리고 있다. 이 외에도 퓨리오사AI는 AI 반도체를, 업스테이지는 AI 모델을 중심으로 현지 시장 공략에 나섰다. 메가존클라우드와 유라클 등은 각각 클라우드·인프라와 애플리케이션 영역에서 자사 기술 경쟁력을 앞세웠다. 다만 한국 기업들이 넘어야 할 경쟁 강도도 높아지고 있다. 코히어는 이미 최소 50MW 규모의 연산 인프라를 장기간 확보했고, 미스트랄AI 역시 휴메인과 인프라·모델·솔루션을 아우르는 사업 구조를 마련했다. AMD와 아마존웹서비스(AWS) 등 글로벌 반도체·클라우드 기업들도 대규모 투자를 앞세워 사우디 AI 시장을 공략하고 있다. 업계 관계자는 "이번 LEAP 참가가 기술 전시에 머무르지 않고 현지 실증과 공급 계약으로 이어지는지가 참여 기업들에게 중요할 듯 하다"며 "여러 국내 기업의 기술을 묶은 풀스택이 실제 현지 환경에서 안정적으로 작동하고 사우디가 요구하는 데이터·컴퓨팅·모델 주권과 산업별 수요까지 충족할 수 있는지도 입증해야 할 것"이라고 밝혔다. 이연수 NC AI 대표는 "이번 LEAP 2026 참여는 자사의 배키 솔루션 등 대한민국 산업 현장에서 검증된 혁신 기술을 글로벌 무대에 선보이는 중요한 자리"라며 "최고 수준의 한국형 풀스택 AI 역량을 글로벌 시장에 널리 알리고 현지 파트너들과 긴밀히 소통해 실질적인 비즈니스 성과를 창출해 내겠다"고 말했다.

2026.09.01 10:04장유미 기자

[독파모 2차 발표] 업스테이지 3차 진출…"국산 NPU로 실증·아시아권 공략"

업스테이지가 인공지능(AI) 모델 '솔라 오픈2' 개발 중심을 성능 경쟁에서 실제 서비스 확산으로 옮긴다. 포털 '다음'과 '타임리' 플랫폼에 모델을 연계해 성능과 안정성을 높이고, 퓨리오사AI 신경망처리장치(NPU)로 서비스 운영 비용을 낮추는 것이 핵심이다. 18일 정부 발표에 따르면 업스테이지 정예팀은 '독자 AI 파운데이션 모델 프로젝트' 2차 단계평가를 통과해 3차 단계에 진출했다. 업스테이지는 다음 단계에서 모델 벤치마크 점수를 높이는 데 그치지 않고 국민이 직접 이용할 수 있는 서비스로 전환하는 데 주력할 방침이다. 업스테이지 실사용 모델 고도화 전략은 크게 세 축으로 구성됐다. 다음·타임리를 통한 서비스 적용과 퓨리오사AI NPU 기반 비용 효율 검증, 아시아권 언어 지원 확대다. 솔라 오픈2는 전체 2500억개 매개변수 가운데 추론할 때 150억개를 활성화하는 '250B-A15B' 구조 에이전트 최적화 모델로 이뤄졌다. 대규모 모델 성능을 유지하면서 실제 연산에 사용하는 매개변수를 줄여 서비스 운영에 필요한 컴퓨팅 자원과 비용을 낮추도록 설계됐다. 모델은 엔비디아 H200 그래픽처리장치(GPU) 2장으로 구동할 수 있는 것으로 알려졌다. 업스테이지는 이러한 경량 구동 능력 바탕으로 대규모 GPU 인프라를 갖추지 않은 기업도 활용할 수 있는 서비스 모델을 구현한다는 구상이다. 모델 컨텍스트 윈도는 최대 100만(1M) 토큰이다. 한 번에 수백 페이지가 넘는 문서를 처리할 수 있는 셈이다. 업스테이지는 이 기능을 긴 문서 분석과 정보 검색, 보고서 작성 등 복잡한 업무를 수행하는 AI 에이전트 서비스에 활용할 계획이다. 실제 이용 환경 검증...해외 서비스 기반 마련 업스테이지는 솔라 오픈2를 포털 다음과 타임리 서비스에 연계해 실제 이용 환경에서 응답 성능과 안정성, 비용 효율성을 입증한다고 강조했다. 다음은 솔라 오픈2가 대규모 서비스 환경에서도 안정적으로 작동하는지 확인할 수 있는 시험대 역할을 맡는다. 모델 성능뿐 아니라 실제 서비스에 필요한 처리 효율과 운영 가능성을 함께 검증할 수 있다는 설명이다. 업스테이지는 2차 평가에서도 이러한 실증 전략을 강점으로 인정받았다. 평가진은 업스테이지 정예팀이 퓨리오사AI 손잡고 국산 NPU를 다음 서비스 환경에서 실증한 점을 높게 평했다. 업스테이지 관계자는 "외산 하드웨어(HW) 의존도를 낮출 것"이라며 "솔라 오픈2를 비용 효율적으로 운영할 수 있는 국산 AI 결합 모델을 구축할 것"이라고 밝혔다. 업스테이지는 솔라 오픈2 지원 언어를 아시아권으로 확대한다. 국내에서 검증한 서비스 운영 경험을 바탕으로 솔라 오픈2를 해외에서도 활용할 수 있는 모델로 키우기 위한 전략이다. 회사는 우선 정부 컴퓨팅 자원을 모델 고도화에 활용한다. 과학기술정보통신부는 3차 단계 진출팀에 대한 엔비디아 B200 GPU 지원 규모를 올해 상반기 약 768장에서 하반기 약 1000장으로 확대할 계획이다. 업스테이지는 추가 GPU를 활용해 솔라 오픈2의 성능과 서비스 안정성을 높일 방침이다. 장문 처리와 에이전트 기능을 강화하는 동시에 아시아 언어권 서비스에 필요한 모델 역량도 높일 방침이다. 현재 정부는 독파모 3차 단계 평가 방식과 배점을 아직 확정하지 않았다. 1·2차 평가 과정에서 확인한 보완 사항을 검토하고 업스테이지·LG AI연구원·SK텔레콤 등 3개 정예팀과 협의해 평가안을 확정·발표할 예정이다. 업스테이지 관계자는 "포털 다음과 컨소시엄 참여사 등을 통해 국민이 직접 체감할 수 있는 실사용 모델을 고도화하는 데 최선을 다할 것"이라며 "아시아권으로 지원 언어를 확대해 글로벌 확산 기반도 마련하겠다"고 말했다.

2026.08.18 14:16김미정 기자

노타, AI 인프라·에이전트 사업 '시동'…수주잔고 116억원 확보

노타가 인공지능(AI) 모델 경량화에 집중했던 최적화 사업을 AI 인프라와 에이전트 운영 영역으로 확대했다. 노타는 올해 상반기 연결 기준 매출 74억 1000만원을 기록했다고 14일 밝혔다. 기존 고객과의 계약에서 발생한 매출이 전체 약 60%를 차지했으며 상반기 말 수주잔고는 116억원을 넘어섰다. 상반기 수주잔고는 지난해 같은 기간보다 두 배 이상 늘었다. 신규 프로젝트와 기존 고객의 후속 계약이 이어지면서 반복 가능한 매출 기반도 강화돼서다. 노타는 AI 에이전트 기반 기업 인공지능 전환(AX)ㅊ 시장에도 진출했다. AI 컨택센터 기업 메타엠과 차세대 AI 상담체계를 공동으로 구축하는 계약을 체결했다. 이번 프로젝트는 노타의 기업 AX 시장 확대 전략을 적용한 첫 상용 사례다. 노타는 AI 에이전트를 구동하는 공통 AI 엔진과 오케스트레이션 기술을 개발하고 검색증강생성(RAG) 기반 시스템에 자체 최적화 기술을 적용한다. 이를 통해 AI 에이전트 운영에 필요한 연산량과 메모리 부담을 줄일 계획이다. 향후 제조와 금융 및 공공 분야로 관련 사업을 확대할 방침이다. 노타는 AI 모델 경량화·최적화 플랫폼 '넷츠프레소' 적용 범위를 모바일과 엣지에서 데이터센터로 넓혔다. 삼성전자 중심 모바일·엣지 AI 사업 경험 바탕으로 Arm과 퓨리오사AI, 모빌린트 등을 신규 고객으로 확보했다. 비전언어모델(VLM) 기반 영상 관제 솔루션 '노타 비전 에이전트'는 제조와 산업안전 및 교통·조선·자동차·모빌리티 분야로 공급 범위를 확대하고 있다. 플랫폼 사업은 글로벌 AI 반도체 생태계로 넓히고 솔루션 사업은 기업 AX 시장을 공략하는 구조다. 노타는 거대언어모델(LLM) 최적화에도 나섰다. 업스테이지 '솔라 오픈 2'와 문샷AI '키미 K3'로 최적화 범위를 확대했다. 노타는 매개변수가 2조 8000억개 이르는 키미 K3 구동에 필요한 그래픽처리장치(GPU) 수를 기존 8장에서 4장 수준으로 줄였다고 설명했다. 상반기에는 AI 인프라 효율화 기술과 차세대 AI 최적화 기술을 고도화하기 위한 연구개발(R&D) 투자도 확대했다. 채명수 노타 대표는 "올 상반기는 단순한 매출 성장보다 우리가 AI 모델 최적화를 넘어 AI 인프라 최적화로 사업을 확장한 전환점이었다"며 "기존 고객 기반으로 반복 매출 구조를 강화하는 동시에 플랫폼은 데이터센터와 글로벌 AI 반도체 생태계로 솔루션은 엔터프라이즈 AX 시장으로 확장해 AI 모델 최적화를 넘어 AI 에이전트 운영 최적화라는 새로운 성장축도 마련했다"고 말했다.

2026.08.14 16:55김미정 기자

빅테크는 ASIC, 범용은 엔비디아…좁아지는 K-NPU 입지

국내 인공지능(AI) 반도체 업체들이 잇따라 상용 칩을 내놓으며 시장 진입을 본격화하고 있다. 하지만 글로벌 빅테크 기업들이 자체 맞춤형 반도체(ASIC) 개발에 속도를 내면서, K-NPU(신경망처리장치) 업계가 넘어야 할 문턱은 오히려 높아지고 있다. 7일 복수의 업계 관계자는 국내 NPU 업체들이 직면한 가장 큰 장벽으로 '서비스 로드맵 부재'를 꼽았다. 구글, 아마존웹서비스(AWS), 메타 등 글로벌 하이퍼스케일러들이 자사 AI 서비스의 향후 발전 방향을 명확히 쥐고, 2~3년 뒤 자사 서비스에 딱 맞는 ASIC을 선제적으로 설계하고 있기 때문이다. 반면 자체 서비스가 없는 외부 NPU 업체들은 상황이 다르다. 고객사 장기 로드맵을 알 수 없기 때문에 범용 시장을 타깃으로 칩을 개발할 수밖에 없다. 문제는 현재 범용 AI 칩 시장 리더가 시장을 독점하다시피 한 '엔비디아'라는 점이다. 국내 업체 입장에서는 고객 맞춤형 ASIC 시장에도 들어가기 어렵고, 범용 시장에서는 이미 자리를 잡은 엔비디아와 정면 승부해야 하는 이중 부담을 안고 있다. 한 반도체 업계 관계자는 "국내 NPU 업체들이 사업을 시작할 당시부터 빅테크들의 칩 내재화 얘기가 나왔다"며 "서드파티 업체가 별로 없는 이유"라고 설명했다. 칩 개발만으로 경쟁력이 확보되진 않는다. AI 모델 발전 속도가 빠른 만큼 새로운 모델이 등장할 때마다 소프트웨어개발키트(SDK)를 업데이트하고 고객 서비스를 지원할 수 있는 소프트웨어 역량이 필수다. 결국 칩 경쟁력은 하드웨어 성능뿐 아니라 출시 후 지속적인 지원 능력에서 갈린다. 업계에서는 구조적 한계를 극복하기 위한 현실적 해법으로 '인력 확보'를 꼽는다. 어떤 새로운 AI 모델이 등장하더라도 최대한 빨리 대응하고 지원할 수 있는 기술 인력을 선제적으로 확보해야 한다는 주장이다. AI 반도체 업계 관계자는 "AI 칩 업체 입장에서 투자를 받아 자금 여유가 있는 지금 기술인력부터 확보해야 한다"며 "인력이 있어야 어떤 모델이 나오든 대응할 수 있다"고 말했다. 국내 업체들도 소프트웨어 경쟁력을 강화하기 위한 움직임에 나서고 있다. 최근 국내 팹리스 리벨리온이 AI 모델 경량화 및 최적화 스타트업 '스퀴즈비츠'를 합병한 것도 이러한 노력 일환으로 해석된다. 단품 하드웨어 설계를 넘어, 빠르고 유연한 소프트웨어 최적화 역량을 내재화하겠다는 전략이다. 나아가 전문가들은 K-NPU 생태계가 구조적 한계를 극복하기 위해 사업 패러다임 자체를 전환해야 한다고 지적한다. 김지훈 한양대학교 교수(융합전자공학부)는 "우선 정부 주도 사업을 통해 초기 레퍼런스를 확보하고 팹리스 업계 자체 기초체력을 길러야 한다"며 "이제는 하드웨어 칩 개발 자체에 머무는 것을 넘어, 실제 서비스와 연계되는 다음 단계를 모색해야 할 때"라고 강조했다.

2026.08.07 16:04전화평 기자

퓨리오사AI, 스웨덴 스톡홀름 AI 데이터센터 구축 참여…RNGD 8800장 공급

인공지능(AI) 반도체 기업 퓨리오사AI가 스웨덴 스톡홀름에서 추진되는 차세대 AI 데이터센터 구축 사업에 참여한다. 퓨리오사AI는 미국 AI 인프라 기업 I/ONX HPC, 데이터센터 개발·운영 기업 벨록스(Velox)와 함께 스톡홀름 AI 데이터센터 프로젝트에 참여한다고 5일 밝혔다. 이번 프로젝트는 총 15MW(메가와트) 규모로 조성한다. 2027년 초 2MW 규모 1단계 시설을 우선 가동하고 연내 8MW를 추가 구축한다. 이후 장기적으로 15MW까지 시설을 확대한다. 퓨리오사AI는 1단계 사업에 AI 추론 가속기 'RNGD(레니게이드)' 1800장을 공급한다. 향후 확장 단계를 포함해 총 8800장 이상 레니게이드를 순차 납품할 예정이다. 레니게이드는 I/ONX HPC의 AI 서버 플랫폼 '심포니 식스티포(Symphony SixtyFour)'에 탑재돼 그래픽처리장치(GPU)와 함께 이기종 컴퓨팅 환경을 구성한다. 레니게이드는 대규모 언어모델(LLM) 및 에이전틱 AI 추론 연산을 담당한다. 프로젝트에서 퓨리오사AI는 하드웨어와 소프트웨어 스택을 제공한다. 벨록스는 데이터센터 개발 및 운영을 맡으며, I/ONX HPC는 시스템 통합과 AI 플랫폼을 담당한다. 백준호 퓨리오사AI 대표는 "이번 프로젝트는 RNGD가 유럽 대규모 데이터센터에 도입되는 사례"라며 "글로벌 파트너들과 차세대 AI 추론 인프라 확산을 이어가겠다"라고 말했다.

2026.08.05 09:10전화평 기자

그록부터 헤일로까지…해외 AI 칩 스타트업 'M&A 도미노' 왜?

글로벌 인공지능(AI) 반도체 스타트업들의 독자 생존이 위협받고 있다. 막대한 칩 개발비와 양산 후 급증하는 소프트웨어(SDK) 유지보수 비용의 벽에 부딪혀 거대 반도체 기업에 잇따라 흡수되고 있다. 30일 반도체 업계에 따르면 글로벌 엣지 AI 칩 1위 업체 이스라엘 헤일로가 최근 미국 마이크로칩에 인수됐다. 헤일로의 누적 투자금은 3억 4000만달러(약 4880억원)에 달했지만, 칩 설계부터 제조, 소프트웨어 관리까지 전 과정에 발생하는 비용을 감당하지 못하고 매각을 택했다. 인수합병(M&A)은 글로벌 AI 반도체 생태계 전반으로 퍼지고 있다. 한때 엔비디아 대항마로 불렸던 영국 그래프코어는 수조원대 적자를 기록한 끝에 올해 일본 소프트뱅크에 넘어갔다. 이스라엘 하바나랩스는 2019년 20억달러에 인텔에 인수됐다. 언어처리장치(LPU)로 주목받은 그록은 지난해 12월 엔비디아에 흡수됐다. 반도체 전설 짐 켈러가 이끄는 텐스토렌트마저 최근 퀄컴 피인수설이 제기된다. 해외 주요 AI 반도체 스타트업 대부분 인수되는 셈이다. 업계에서는 스타트업 독자 생존이 어려워진 원인으로 막대한 투자비용을 꼽는다. 팹리스는 칩 설계 후 최선단 파운드리 공정을 쓰기 위해 마스크 제작 등 거액의 초기 비용을 지출한다. 출시 후에는 소프트웨어 고정비가 기하급수적으로 늘어난다. AI 모델 발전 속도가 빠른 만큼, 고객사가 칩을 실제 서비스에 활용하려면 소프트웨어 개발 키트(SDK)를 끊임없이 업데이트해야 한다. 새로운 모델이 등장할 때마다 소프트웨어를 전면 수정해야 하므로 하드웨어보다 소프트웨어 인력이 훨씬 더 많이 필요하다. 인건비 폭등은 자본력이 부족한 스타트업에 치명적이다. 헤일로 관계자는 "헤일로는 전체 직원이 350명 정도였는데, 이 중 대부분이 SDK 인력이었다"며 "그럼에도 결국 인수됐다. AI 칩 업체가 버티려면 막대한 인력과 대규모 자본이 필요하다"고 설명했다. 하이퍼스케일러와의 구조적 격차도 독자 생존을 가로막는다. 구글, AWS 등은 자체 AI 서비스와 모델 로드맵을 바탕으로 수년 뒤 필요한 주문형 반도체(ASIC)을 미리 설계한다. 반면 AI 칩 스타트업은 고객사의 장기 계획을 완벽히 예측하기 어렵다. 수요 기업들이 연산용 신경망처리장치(NPU) 단품보다 통합 솔루션을 원하는 점도 한계다. 스타트업은 설계 기술이 뛰어나도 글로벌 영업망과 통신·전력 칩 등을 아우르는 포트폴리오가 부족하다. 한 반도체 업계 관계자는 "구글 같은 기업은 자체 서비스 로드맵이 있어 장기적인 반도체 개발이 가능하지만, 외부 스타트업은 시장 흐름에 완벽히 올라타는 것이 구조적으로 힘들다"며 "NPU 단품만으로는 영업에 한계가 뚜렷해, 결국 독보적 기술을 검증받은 뒤 대기업과 인수합병을 추진하는 것이 AI 반도체 스타트업들의 유일한 생존 공식이 됐다"고 설명했다.

2026.07.30 16:48전화평 기자

삼성SDS, 퓨리오사AI 기반 'NPUaaS' 출시…인프라 선택권 확장

삼성SDS가 정부의 국산 인공지능(AI) 반도체 확산 기조에 발맞춰 클라우드 기반 서비스형 신경망처리장치(NPUaaS)를 선보이며 고객 인프라 선택권 확장에 나선다. 삼성SDS는 퓨리오사AI의 2세대 NPU '레니게이드(RNGD)'를 기반으로 한 NPUaaS를 삼성 클라우드 플랫폼(SCP)에 탑재·출시했다고 20일 밝혔다. 레니게이드는 AI 추론에 특화된 국산 NPU로, 이미 학습된 AI 모델을 실제 서비스에 적용해 답변 생성, 문서 분석, 이미지 판별 등을 처리하는 단계에서 GPU 대비 전력 효율성과 가성비가 뛰어난 것으로 평가된다. 삼성SDS의 NPUaaS 고객은 NPU 서버를 직접 구매하거나 자체 데이터센터에 구축하지 않고도 SCP를 통해 구독형으로 사용할 수 있다. 기업 수요와 데이터 규모에 따라 NPU를 원하는 장수 단위로 자유롭게 선택할 수 있도록 해 스타트업부터 대기업까지 AI 서비스 규모에 맞춰 활용할 수 있게 지원한다. 또 고성능 스토리지와 컴퓨트, 고속 네트워크 등 SCP의 다양한 상품들과 연계해 유연한 사용을 돕는다. 특히 삼성SDS는 이번 NPUaaS를 SCP의 소버린 클라우드 환경으로 제공해 엄격한 보안 규제를 적용받는 공공 고객도 안심하고 이용할 수 있도록 지원할 계획이다. 회사는 이번 NPUaaS 출시를 통해 기존 서비스형 그래픽처리장치(GPUaaS)는 물론 NPU 기반 연산 자원까지 확대하면서, 고객 AI 인프라 선택권 확대와 국산 NPU 기반 AI 인프라 확산 및 소버린 AI 구축에 앞장선다는 목표다. 이호준 삼성SDS 클라우드서비스사업부장은 "이번 NPUaaS 출시는 단순히 새로운 클라우드 상품을 선보이는 것을 넘어 고객이 고성능 AI 기술을 더 유연하고 가성비 높게 사용할 수 있다는 데 의의가 있다"며 "앞으로도 고객 니즈 해결을 위해 SCP 기반 상품을 다양화하고 클라우드 AI 기술 생태계를 지속 선도해 나갈 것"이라고 밝혔다.

2026.07.20 10:49한정호 기자

업스테이지·퓨리오사AI·AXZ, 검색 서비스 기반 AI 모델 고도화 나선다

업스테이지가 국산 인공지능(AI) 모델과 반도체, 검색 서비스를 연결한 풀스택 소버린 AI 상용화에 시동 걸었다. 업스테이지는 15일 온라인 대담을 열고 포털 '다음' 운영사 AXZ, AI 반도체 기업 퓨리오사AI와 이같은 계획을 추진한다고 밝혔다. 업스테이지는 한국어 특화 거대언어모델(LLM) '솔라'를 제공한다. 퓨리오사AI는 솔라의 추론 연산을 처리하는 레니게이드(RNGD)를 공급한다. AXZ는 솔라와 RNGD를 결합해 다음 검색 서비스 '다음 AI 요약'에 적용할 방침이다. 세 회사는 다음 AI 요약을 운영하며 얻은 결과를 모델과 반도체 개선에 활용할 방침이다. 다음에서 검색 질의와 서비스 처리 데이터가 쌓이면 업스테이지는 이를 바탕으로 솔라의 성능을 높일 수 있고, 퓨리오사AI도 실제 이용 환경에 맞춰 칩 처리량과 전력 효율을 개선할 수 있어서다. 다음 AI 요약은 사용자가 검색창에 질문이나 키워드를 입력하면 관련 문서를 찾아 핵심 내용을 요약해 보여주는 서비스다. 언론사 제휴 콘텐츠를 비롯한 카페, 티스토리 등에 올라온 문서를 검색에 활용된다. 이 서비스는 답변과 함께 근거도 제공하며, 새로운 정보가 나오면 요약 내용에 반영한다. 이건수 AXZ 대표는 "우리는 최신 정보와 검색어 연관성을 높이는 기술에 집중했다"고 밝혔다. 이어 "키워드 검색과 의미 기반 벡터 검색을 결합한 하이브리드 검색으로 관련 문서를 선별한다"며 "이후 솔라가 해당 문서를 바탕으로 답변을 생성하는 식으로 작동한다"고 설명했다. 그러면서 "사전 학습된 지식에 의존하거나 문서에 없는 내용을 만들어내는 환각을 줄이기 위해 하네스 엔지니어링도 적용했다"고 덧붙였다. 업스테이지는 솔라의 소형 모델 구조와 한국어 요약 성능을 다음 AI 요약에 활용할 방침이다. 대규모 범용 모델을 그대로 적용하기보다 검색 결과를 빠르게 읽고 정리하는 작업에 맞춰 모델을 운영할 계획이다. 김성훈 업스테이지 대표는 "실제 검색 서비스에서 축적한 결과는 솔라 요약 정확도와 응답 성능을 개선하는 데 활용할 것"이라고 밝혔다. 퓨리오사 "NPU,온프레미스에 유리…GPU 비용 대비 50%↓목표" 퓨리오사AI는 다음 AI 요약의 3개 서버 노드에 레니게이드 약 24개를 투입했다. 이를 통해 매일 약 5억개 토큰을 처리하고 있다. AI 모델을 가속기에 배치하는 컴파일러와 서비스 환경에 맞춰 추론을 처리하는 서빙 엔진도 적용했다. 백준호 퓨리오사AI 대표는 레니게이드 도입 시 엔비디아 그래픽처리장치(GPU) H200 기반 인프라와 비교해 추론 비용을 50% 이상 줄일 수 있다고 자신했다. 칩 가격과 전력 사용량, 서버 운영비를 포함하면 동일한 비용으로 최대 2배 수준의 연산을 처리할 수 있다는 주장이다. 백 대표는 "레니게이드는 GPU 전력·가격 대비 성능이 높다"며 "토큰 사용량이 많은 검색과 에이전틱 AI 서비스에 적합할 것"이라고 강조했다. 백 대표는 온프레미스 환경에서도 레니게이드 비용 경쟁력을 내세웠다. 기업이 내부에 AI 인프라를 구축할 경우 GPU와 비슷한 응답 속도를 유지하면서, 낮은 비용으로 동시 사용자와 토큰 처리량을 확보할 수 있다는 이유에서다. 현재 퓨리오사AI는 솔라를 비롯한 오픈소스 모델과 임베딩 모델 지원을 위해 소프트웨어 최적화를 확대할 계획이다. AXZ는 낮아진 추론 비용으로 AI 요약 노출을 확대할 계획이다. 현재 베타 서비스 중인 AI 요약은 전체 검색 질의 약 20%에 제공된다. 이 대표는 "향후 노출 비중을 절반 이상으로 높일 것"이라며 "쇼핑과 맛집 등 분야별 정보를 깊이 있게 제공하는 버티컬 AI 검색으로 확장할 것"이라고 말했다. 이어 "장기적으로 다음 이용자에게 1인 1 에이전트를 제공하는 플랫폼으로 성장할 것"이라고 목표를 밝혔다. 김성훈 대표는 "차세대 솔라 모델과 임베딩 모델에도 국산 NPU 적용을 확대할 계획"이라며 "소버린 AI와 소버린 인프라가 결합한 새로운 풀스택 구조에 최선을 다할 것"이라고 말했다.

2026.07.15 13:45김미정 기자

"엔비디아 '쿠다' 철벽 깬다"…K-NPU, 공공 마중물 타고 비상

글로벌 인공지능(AI) 패권 경쟁이 격화되는 가운데, 빅테크 소프트웨어 생태계 벽에 막혀 있던 국산 AI 반도체가 공공 부문이라는 '테스트베드'를 발판으로 도약의 날개를 단다. 레퍼런스와 생태계 부재로 고전하던 K-팹리스 업계를 위해 정부와 기업이 밸류체인을 구축할 예정이다. 퓨리오사AI가 14일 총판 시스원과 서울 중구 더 플라자 호텔에서 개최한 '2026 K-NPU 테크 웨이브'의 최대 화두는 생태계 자립이었다. 김은주 한국지능정보사회진흥원(NIA) 지능기술인프라본부장은 기조연설에서 한국 AI 반도체 현주소를 진단했다. 김 본부장은 "한국은 고대역폭메모리(HBM) 등 메모리 반도체 세계 1위 경쟁력과 우수한 팹리스 기업을 보유하고 있지만, 엔비디아의 '쿠다(CUDA)'를 중심으로 한 글로벌 소프트웨어 생태계 종속이 치명적인 약점"이라고 지적했다. 아무리 뛰어난 성능의 칩을 설계하더라도, 개발자들이 쉽게 쓸 수 있는 소프트웨어 환경과 이를 대규모로 운용해 본 실전 레퍼런스 없이는 시장 선택을 받을 수 없다는 분석이다. 쿠다 생태계 장벽을 돌파하기 위해 제시된 첫 번째 해법은 하드웨어 기업 스스로 기술 장벽을 낮추는 것이다. 강지훈 퓨리오사AI 최고연구책임자(CRO)는 2세대 NPU 'RNGD(레니게이드)'의 이식성을 해결책으로 내세웠다. 소프트웨어 이식성은 작성된 프로그램이 다른 하드웨어, 운영체제, 네트워크 환경에서도 거의 수정 없이 쉽게 동작할 수 있는 성질을 뜻한다. 강 CRO는 "RNGD는 파이토치(PyTorch), vLLM 등 오픈소스 프레임워크와 완벽히 호환된다"며 "개발자들이 기존 엔비디아 그래픽처리장치(GPU) 환경에서 구동하던 AI 모델과 코드를 번거로운 수정이나 최적화 과정 없이 국산 NPU로 즉각 이전할 수 있다"고 강조했다. 굳이 쿠다 생태계에 머물지 않아도 되는 우회로를 만든 셈이다. 두 번째 해법은 '공공 부문의 마중물 역할'이다. 대형 상용 레퍼런스가 부족해 글로벌 시장 진출을 하지 못하는 팹리스를 위해 공공기관이 기꺼이 첫 번째 대형 고객을 자처하는 것이다. NIA는 보안이 생명인 행정, 안전, 국방 분야부터 국산 NPU를 탑재한 온프레미스(구축형) 인프라를 선도적으로 도입할 계획이다. 막대한 예산이 드는 AI 모델 학습은 기존 GPU를 활용하더라도, 추론만큼은 전력 효율이 우수한 국산 NPU로 완벽히 대체하겠다는 '소버린 AI' 확보 전략이다. NIA 실증 결과 RNGD는 GPU(RTX 6000) 대비 2.25배 높은 전력당 성능을 기록하며 데이터센터 유지비용(TCO) 절감 효과를 입증했다. K-NPU의 실전 배치를 지원할 민간 기업도 합류한다. 삼성SDS는 16일 국산 NPU를 클라우드로 대여하는 'NPUaaS'를 출시하고, 와이즈넛은 공공 폐쇄망에 특화된 일체형 AI 장비(어플라이언스)를 선보였다. 시스원과 두다지는 인프라 설계 및 무중단 전환 솔루션으로 힘을 보탰다. 단일 칩 공급을 넘어 소프트웨어와 클라우드를 아우르는 거대한 연합군이 탄생한 셈이다. 백준호 퓨리오사AI 대표는 "스타트업으로 시작해 9년 반 동안 연구개발을 지속할 수 있었던 배경에는 한국 반도체의 우수한 인적 자원과 과감한 벤처 지원 생태계가 있었다"며 "이제는 공공과 민간이 끈끈하게 연대하는 완벽한 생태계를 통해, 전력난을 타개할 '지속 가능한 AI'로 글로벌 무대에서 승부하겠다"고 밝혔다.

2026.07.14 17:46전화평 기자

  Prev 1 2 3 4 5 Next  

지금 뜨는 기사

이시각 헤드라인

[단독] BOE, '15:1 종횡비' TGV 유리 코어 기판 첫 공개

모두의 AI, 현실이 되다…'AI페스타' 1년만에 확 달라진다

스마트폰 앱 가고 에이전틱AI 시대 온다

LG전자, '5K 미니 LED' 게이밍 모니터에 BOE 패널 탑재

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.