• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'NPU'통합검색 결과 입니다. (206건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

"K-팹리스, 해외 PoC 감당 한계"…마중물 정책 호소

국내 인공지능(AI) 반도체 팹리스 기업들이 해외 진출 확대를 위해 정부 제도 지원을 요구했다. 연구실 단계 기술 검증을 넘어 상용화 단계에 진입했으나, 해외 고객 확보 과정에서 초기 실증 비용과 현지 기술 지원 부담이 크다는 이유다. 10일 서울 여의도 국회의원회관에서 열린 '국산 NPU 수출 확대 및 판로 다변화를 위한 국회 정책토론회'에서 국내 신경망처리장치(NPU) 기업 관계자들은 글로벌 시장 진입 과정에서 직면하는 비용과 신뢰성 문제를 집중 지적했다. 이들은 스타트업이 해외 현지 기술 지원과 장기 품질 보증 요구를 홀로 감당하기 어렵다고 설명했다. 조재홍 딥엑스 상무는 "상반기 기준 1300만 달러 규모 수출 실적을 올렸으나, 해외 대기업은 3년에서 10년에 이르는 품질 보증을 유지할 수 있는지 의구심을 가진다"고 밝혔다. 그는 "시차 대응을 위한 현지 엔지니어 채용과 해외 전시회 참가비 등 고정비 부담이 상당하다"며 "CES 부스 운영비만 12억원 수준"이라고 밝혔다. 초기 시장 진입 문턱을 낮추기 위한 지원 방안이 제안됐다. 딥엑스는 수요기업의 초기 구매 부담을 낮추는 'K-AI 반도체 수출 바우처' 신설을 촉구했다. 3억원 안팎의 초기 개념증명(PoC) 비용을 보조해 30억원대 이상 본 계약 체결로 유도하는 마중물 구조다. 현지 테스트베드 제공과 소프트웨어 개발 키트(SDK) 런타임 최적화 프로그램 신설도 건의했다. 양산 단계 검증과 생산 인프라 한계도 언급됐다. 김주영 하이퍼엑셀 대표(카이스트 전기및전자공학부 교수)는 "시제품 단계와 달리 월 1만장 규모 납품 요구에는 테스트 자동화 등 생산 인프라 한계가 나타난다"며 "글로벌 빅테크를 설득하려면 실제 운영실적(레퍼런스) 확보가 필수"라고 강조했다. 박성현 리벨리온 대표는 공공 AI 인프라 조달 평가기준을 '외산 그래픽처리장치(GPU)' 규격 맞추기에서 'AI 가속기' 단위 성능 중심 경쟁으로 전환해야 한다고 밝혔다. 박 대표는 "국가 AI 컴퓨팅 센터 등에서 실제 트래픽을 장기간 처리하는 기회가 보장돼야 한다"며 "안방에서 대규모 실서비스 레퍼런스가 선행돼야 해외 고객을 설득할 수 있다"고 설명했다. 선제적 공공 인프라 배치 요구도 이어졌다. 백준호 퓨리오사AI 대표는 "반도체는 타이밍 산업인 만큼 수요를 기다리지 않고 대규모 배치를 통해 시장을 창출해야 한다"고 말했다. 이어 "2030년까지 확대될 8.5기가와트(GW) 규모 신규 데이터센터에 국산 NPU 배치를 정책적으로 뒷받침해야 한다"며 "칩과 소프트웨어, 모델을 묶은 풀스택 인프라로 글로벌 소버린 AI 시장을 공략해야 한다"고 제안했다. 정책자금 연속성 확보도 과제다. 김주영 대표는 "AI 반도체는 매년 차세대 칩을 설계하고 양산해야 생존할 수 있는 구조"라며 "단발성 연구개발(R&D) 과제에 머물지 않고 국민성장펀드 등을 통해 팹리스를 향한 단계별 스케일업 자본 투입이 지속돼야 한다"고 요청했다. 정책토론회는 고동진 국민의힘 의원실 주관으로 열렸다. 고동진 의원은 인사말에서 "국산이라는 이유만으로 제품을 써달라는 논리는 시장에서 통하지 않는다"며 "엔비디아 대비 비용 효율이 확인된 만큼, 공공기관과 연구소 서버에서 국산 NPU를 선제 검증하고 안정화해야 수출길이 열린다"고 밝혔다.

2026.09.10 12:24전화평 기자

퓨리오사AI "에이수스와 NPU 카드 넘어 AI 인프라로 협력 확대"

"에이전틱 AI의 핵심은 결국 파운데이션 모델입니다. 최근 다양한 오픈소스 기반 프론티어 모델이 부상하고 있는 만큼, 퓨리오사AI는 이런 모델을 최대 성능과 효율로 구동할 수 있는 해결책을 제공하는 데 주력하고 있습니다." 지난 3일 서울 여의도 콘래드호텔에서 지디넷코리아와 만난 백준호 퓨리오사AI 대표는 에이전틱 AI 시대의 AI 인프라 경쟁력으로 '추론 효율성'을 꼽았다. 퓨리오사AI는 2017년 설립된 국내 1세대 NPU 기업이다. 자체 개발한 NPU와 소프트웨어 기술력을 바탕으로 데이터센터 AI 추론 시장을 공략하고 있으며, 2세대 NPU 레니게이드를 통해 국내외 고객사로 공급 범위를 확대하고 있다. 백준호 대표는 "2세대 NPU '레니게이드(RNGD)'는 에이전틱 AI로 늘어난 연산 비용을 낮출 수 있는 AI 추론 솔루션이며 에이수스와 고효율 AI 추론 인프라 공급을 위해 협력할 것"이라고 밝혔다. "레니게이드 NPU, GPU 대체할 고효율 솔루션" AI가 실험 단계를 넘어 실제 서비스에 대규모로 적용되면서 기업들이 가장 크게 직면한 문제는 비용이다. AI 서비스 이용량과 추론 규모가 급증하면서 GPU 중심의 인프라 비용과 전력 비용이 전체 서비스 비용에서 차지하는 비중도 커지고 있다. 퓨리오사AI는 이런 문제를 해결할 수 있는 대안으로 올해부터 공급에 들어간 2세대 NPU '레니게이드(RNGD)'를 내세웠다. 기존 GPU 대비 전력 및 인프라 비용을 낮추고, 동일한 AI 서비스를 보다 효율적으로 운영하는 것이 목표다. 백 대표는 "레니게이드는 GPU의 보완재가 아닌 대체재다. 자체 추산 결과 레니게이드는 비용 효율 면에서 엔비디아 H200(호퍼) 등 GPU 대비 약 1.3~2배 더 효과적"이라고 설명했다. 이어 "삼성SDS 클라우드 인스턴스에 레니게이드가 도입돼 기업 고객 대상 상용 서비스 중이며 업스테이지 등 AI 네이티브 기업도 활용중이다. LG 엑사원 등 프론티어 모델을 비롯해 공공·금융·발전소 등 다양한 산업 분야에서도 도입이 진행중"이라고 말했다. "긴 문맥·반복 추론 부담 더는 솔루션에 집중" 챗봇이나 거대언어모델(LLM) 등 기존 생성 AI는 이용자의 요청에 대한 응답을 생성하는 데 목적이 있다. 반면 에이전틱 AI는 목표를 달성할 때까지 여러 차례 추론을 반복하고, 긴 문맥을 유지하면서 지속적으로 토큰을 생성한다. 이 과정에서 긴 문맥을 유지하고 대규모 토큰을 생성하면서 추론 비용도 증가할 수 있다. 백준호 대표는 "에이전틱 AI 확산에 따라 추론 연산이 늘어나며 관련 비용이 급증하는 만큼 이를 효율적으로 처리할 수 있는 AI 반도체와 인프라가 반드시 필요하다"고 강조했다. 이어 "퓨리오사AI는 반복적인 추론 과정에서 발생하는 KV 캐시를 효율적으로 관리하고, 소프트웨어 스택 차원에서 전체 문맥을 효과적으로 유지·관리하는 하드웨어 및 소프트웨어 최적화에 집중하고 있다"고 설명했다. "1세대 NPU 상용화부터 에이수스와 협력" 퓨리오사AI는 1세대 '비전NPU' 상용화 단계부터 대만 컴퓨팅·인프라 기업인 에이수스와 협력해 왔다. 백준호 대표는 "레니게이드 NPU 탑재 카드의 상용화와 대량 생산 과정에서 에이수스의 역할이 컸다"고 말했다. 설계한 실리콘을 실제 서버에 탑재할 수 있는 복잡한 카드 제품으로 구현하고, 대량 생산 단계까지 안정적으로 연결하는 과정에서 에이수스가 보유한 제조·양산 경험과 노하우가 결정적인 역할을 했다는 것이다. 폴 주 에이수스 인프라 솔루션 비즈니스 그룹(ISG) 총괄 수석부사장은 "에이수스는 퓨리오사AI의 성장 가능성과 잠재력을 보고 협력에 나섰다"고 설명했다. 퓨리오사AI가 칩과 아키텍처 설계에 강점을 갖고 있다면 에이수스는 시스템 설계와 제조, 부품 조달 및 글로벌 공급망에서 강점을 갖고 있다. 양사는 서로 다른 역량을 결합해 실제 제품을 시장에 공급하는 데 초점을 맞췄다. 폴 주 부사장은 "에이수스는 시스템 레벨 특화, 퓨리오사AI는 칩 면에서 장점이 있다. 부품 선정 등에 있어서도 서로 장점을 결합할 수 있다고 판단했다"고 설명했다. "에이수스와 글로벌 AI 인프라 시장 공략 확대" 양사는 단순한 NPU 카드 제조와 공급을 넘어 서버와 시스템, 나아가 수백 MW(메가와트)에서 수 GW(기가와트) 급 AI 인프라 구축으로 협력 영역을 확대중이다. 폴 주 에이수스 수석부사장은 "글로벌 시장 확대에는 기술력뿐 아니라 현지 영업, 제품 공급, 판매 후 유지보수까지 고객이 요구하는 전체 공급망을 구축하는 것이 중요하다"고 설명했다. 이어 "1세대 협력에서는 에이수스가 크게 드러나지 않았지만 시스템과 랙 차원에서 강점이 있는 만큼 앞으로 더 많은 리소스를 제공하며 협력할 것"이라고 말했다. 에이수스는 이에 따라 글로벌 영업망과 제조·조달 역량을 활용해 레니게이드 기반 서버 솔루션의 시장 확대를 지원할 계획이다. 백준호 대표는 "양사 협력은 이제 시작 단계다. 2세대 레니게이드 NPU 탑재 카드 상용화를 시작으로 양사의 기술·제조·공급망 역량을 결합해 서버와 랙, 데이터센터 단위의 AI 인프라로 확장할 것"이라고 말했다.

2026.09.10 09:37권봉석 기자

"GPU 부담 낮춘다"…HS효성인포, ARM·NPU 결합 AI 인프라 확대

생성형 인공지능(AI) 활용 확산 추세에 따라 HS효성인포메이션시스템이 저전력 ARM 서버와 신경망처리장치(NPU)를 결합한 AI 인프라 사업 확대에 나선다. HS효성인포메이션시스템은 자체 ARM 서버 브랜드 '그린코어(GreenCore)'와 국내외 NPU를 결합한 고효율 AI 추론 플랫폼을 앞세워 기업 및 공공기관 시장 공략을 강화한다고 9일 밝혔다. 최근 기업들은 챗봇, 문서 검색, 영상 분석 등 다양한 AI 서비스를 운영하면서 반복적으로 발생하는 추론 작업을 효율적으로 처리할 수 있는 인프라 구축에 관심을 보이고 있다. 특히 데이터센터 전력 사용량과 운영 비용 부담이 커지면서 GPU 중심 구조를 보완할 수 있는 NPU가 새로운 대안으로 부상하고 있다. NPU는 AI 추론 작업에 특화된 가속기로, 상대적으로 낮은 전력 소비와 비용 효율성을 강점으로 내세운다. 다만 제조사별로 지원하는 AI 모델과 워크로드 특성이 달라 실제 서비스 환경에 적합한 제품을 선택하는 것이 중요하다는 평가다. 이에 HS효성인포메이션시스템은 퀄컴을 비롯해 퓨리오사AI, 딥엑스, 모빌린트 등 국내외 주요 NPU 기업들과 협력 체계를 구축했다. 단순한 하드웨어 성능 비교를 넘어 고객이 운영할 AI 모델과 서비스 유형, 모델 규모, 동시 접속자 수, 응답 속도 요구사항, 데이터센터 전력 및 공간 여건 등을 종합적으로 분석해 적합한 NPU 구성을 제안한다. 회사는 이러한 NPU를 ARM 기반 서버인 그린코어와 결합해 차별화를 꾀하고 있다. 그린코어는 HS효성인포메이션시스템과 국내 ARM 서버 전문기업 엑세스랩이 공동 개발한 제품으로, 저전력·저발열 특성과 다수의 코어를 활용한 병렬 처리 성능을 갖춘 것이 특징이다. 특히 전력과 냉각 설비, 랙 공간 확보가 쉽지 않은 데이터센터 환경은 물론 보안과 데이터 주권 문제로 인해 온프레미스 AI 구축을 추진하는 기업과 공공기관에도 적합한 대안이 될 수 있다는 설명이다. HS효성인포메이션시스템은 고객이 선정한 NPU를 그린코어 서버에 직접 탑재해 하드웨어와 소프트웨어 호환성, AI 모델 구동 여부, 운영 안정성 등을 사전에 검증한다. 필요할 경우 AI 솔루션 기업과 협력해 실제 업무 환경을 반영한 개념검증(PoC)도 지원한다. 이를 통해 고객은 여러 NPU 제품과 개발 도구를 직접 비교·검증해야 하는 부담을 줄이고, 보다 빠르게 AI 서비스 도입 여부를 판단할 수 있다. 회사는 앞으로 고객 워크로드 분석부터 NPU 선정, 서버 구성, 통합 검증, AI 솔루션 연계, 구축 및 운영까지 AI 추론 인프라 전 과정을 지원할 계획이다. 또한 ARM 서버와 GPU, NPU, 고성능 스토리지, 데이터 레이크, AIOps 등을 결합한 'HS효성 AI 플랫폼' 포트폴리오도 지속 확대할 방침이다. 양정규 HS효성인포메이션시스템 대표는 "AI 경쟁력의 핵심이 모델 개발을 넘어 실제 비즈니스 환경에서 AI를 얼마나 안정적이고 효율적으로 운영하느냐로 옮겨가고 있다"며 "그린코어와 다양한 NPU를 결합한 추론 인프라를 통해 고객이 비용과 전력, 공간 제약 속에서도 최적의 AI 서비스를 구축할 수 있도록 지원하겠다"고 말했다.

2026.09.09 09:44남혁우 기자

노타, LG전자·모빌린트와 NPU 기반 휴머노이드 두뇌 최적화

노타가 LG전자, 모빌린트와 함께 국산 신경망처리장치(NPU) 기반 휴머노이드 개발에 나선다. 노타는 산업통상부와 한국산업기술기획평가원(KEIT)이 추진하는 'K-온디바이스 인공지능(AI) 반도체 기술개발 사업' 휴머노이드 분야 3세부 과제 주관기관으로 선정됐다고 8일 밝혔다. 이 사업은 국산 온디바이스 AI 반도체를 활용해 복잡한 일상 공간에서 주변 환경을 인식하고 인간 수준의 작업을 수행하는 자율형 휴머노이드를 개발하는 것이 목표다. LG전자가 전체 사업을 총괄하고 휴머노이드 시스템 개발을 맡는다. 모빌린트는 국산 NPU를 담당할 예정이다. 노타는 AI 모델을 NPU와 실제 로봇 환경에 맞춰 최적화하는 소프트웨어를 맡는다. 노타는 특히 휴머노이드에 탑재되는 비전언어행동모델(VLA)을 경량화하고 모빌린트 NPU에 맞춰 최적화해 로봇 내부에서 빠르고 효율적으로 구동되도록 하는 핵심 소프트웨어 기술을 담당한다. 토큰 압축과 양자화, 프루닝, 지식증류, 레이어별 최적화 등을 적용해 모델 성능 저하를 최소화하면서 크기와 연산량, 메모리 사용량을 줄일 계획이다. 채명수 노타 대표는 "모바일, 엣지, 데이터센터 등 다양한 환경에서 AI 모델과 하드웨어를 효율적으로 연결해 온 기술력을 바탕으로 로봇과 자동차, 산업장비 등 피지컬 AI 전반에 기술 적용과 사업 기회를 확대하겠다"고 말했다.

2026.09.08 15:56이나연 기자

한컴, 국산 인프라로 '에이전틱 OS' 개발…기업·공공 AX 지원

한컴이 국산 인프라를 활용해 기업·공공기관용 인공지능 전환(AX) 시장 공략에 나선다. 한컴은 한컴이노스트림, 퓨리오사AI와 AX 사업 협력을 위한 3자 업무협약을 체결했다고 8일 밝혔다. 세 회사는 AX 어플라이언스 개발과 전문인력 양성, 기술 검증, 공동 영업 분야에서 협력한다. 한컴은 에이전틱 OS와 퓨리오사AI의 2세대 AI 가속기 '레니게이드'를 결합한 개념검증용 AX 어플라이언스를 개발한다. 이후 기업과 공공기관이 내부 전산 환경에서 AI를 운영할 수 있는 온프레미스형 제품으로 상용화할 방침이다. 한컴은 에이전틱 OS 기반 솔루션 개발과 제품화를 주도한다. 퓨리오사AI 신경망처리장치(NPU) 환경에 맞춰 운영체제를 최적화하고 AI 에이전트의 추론 성능과 전력 효율, 운영 안정성을 높이기 위한 기술 검증도 진행한다. 퓨리오사AI는 레니게이드 하드웨어와 소프트웨어 스택을 제공한다. AX 어플라이언스 개발과 NPU 환경 최적화를 위한 기술 협력도 지원한다. 한컴이노스트림은 NPU 전문인력 양성과 교육을 통한 시장 수요 발굴을 담당한다. 퓨리오사AI의 NPU 공인 교육기관으로서 교육과정 기획부터 마케팅과 교육생 모집, 운영까지 맡고 상설 교육센터를 구축한다. 교육과정은 초급부터 최고 전문가 단계까지 수준별·직무별로 구성한다. 한컴이노스트림은 정부와 대학, 기업에서 교육 수요를 확보하고 교육 과정에서 확인한 NPU 도입 수요를 퓨리오사AI와 실제 사업 기회로 연결한다. 퓨리오사AI는 교육과 실습에 필요한 NPU 기술 표준과 소프트웨어 스택을 제공한다. 한컴이노스트림과 공인 교육 프로그램의 운영 계획과 교육과정을 개발하고 강사·수강생에게 발급하는 자격증과 인증서의 공신력 확보도 지원한다. 세 회사는 기업간거래와 공공시장을 대상으로 공동 마케팅과 사업 개발을 추진한다. 한컴은 교육과 컨설팅 과정에서 확보한 고객 수요를 에이전틱 OS 기반 AX 사업으로 확장할 계획이다. 협약 체결과 함께 실무 담당자로 구성한 협의회도 운영한다. 협의회는 AX 어플라이언스 개발과 제품화 등 구체적인 실행 방안을 조율한다. 김연수 한컴 대표는 "이번 협약은 에이전틱 OS와 국산 NPU 기술을 결합해 AX 사업 경쟁력을 높이는 계기가 될 것"이라며 "AI 전문인력 양성과 기술 검증, 제품화로 이어지는 긴밀한 협력을 바탕으로 기업과 공공기관의 AX 전환을 지원하고 시장 공략에 속도를 내겠다"고 말했다.

2026.09.08 10:50김미정 기자

[최홍석 칼럼] AI 에이전트가 달리려면 어떤 도로가 필요한가

"AI 추론은 '빠른 망'이 아니라 '예측 가능한 망'을 원한다. 지연이 작은 것보다 지연이 일정한 것이 AI 에이전트 서비스의 품질을 결정한다." 이 시리즈는 지금까지 망을 어떻게 만드는가, 즉 인프라의 언어로 이야기해 왔습니다. 4월 OpenROADM, 5월 SRv6·RON, 6월 소버린 AI, 7월 자율화 거점, 8월 6G 설계 철학, 이 모든 논의가 궁극적으로 수렴하는 질문이 바로 이것입니다. 그 망 위에서 무엇이 달리는가. 2026년, AI 에이전트 서비스가 본격화되면서 네트워크에 완전히 새로운 요구사항이 생겼습니다. 챗봇이 아닙니다. 스스로 계획하고, 도구를 호출하고, 결과를 판단해 다음 행동을 결정하는 에이전틱 AI가 실시간으로 서비스되기 시작했습니다. 이 에이전트들이 달리려면 지금까지와는 다른 종류의 도로가 필요합니다. 그 도로를 누가 깔 것인가, 통신사의 가장 현실적인 기회이자 도전이 여기 있습니다. AI 추론 트래픽은 기존 데이터와 무엇이 다른가 AI 에이전트 서비스가 네트워크에 요구하는 것은 단순한 대역폭 확대가 아닙니다. 트래픽의 성격 자체가 다릅니다. 세 가지 핵심 차이가 있습니다. 첫째, 예측 가능한 지연과 지터입니다. 음성 AI 에이전트처럼 대화형 서비스는 응답이 약 500ms를 넘으면 지연감을 줄 수 있어, 클라이언트 기준 time-to-first-token(TTFT)을 중요한 SLO로 둡니다. 원격 제어·협력 제어와 같은 안전 중요 서비스는 지연과 지터가 안전성에 영향을 줄 수 있으므로, 안전 기능을 원격망 품질에만 의존하지 않고 로컬 폐루프·이중화와 함께 설계해야 합니다. 일반 인터넷 트래픽은 평균 지연만으로도 충분한 경우가 많지만, 실시간 AI 서비스는 워크로드별로 P99 등 꼬리 지연 목표를 관리해야 합니다. 둘째, 버스트성(Burstiness)입니다. AI 에이전트 서비스는 동시 요청이 순간적으로 폭증하는 특성을 가집니다. 중앙 집중식 추론 클러스터는 이 버스트 구간에서 처리 용량이 포화되고, 지연이 급격히 증가합니다. 컴캐스트와 엔비디아의 GTC 2026 벤치마크는 이를 명확히 보여줍니다. 버스트 트래픽 조건(P99)에서 단일 중앙 집중식 클러스터는 오히려 처리량이 감소한 반면, 4개 엣지 사이트에 분산된 AI 그리드는 42,362 토큰/초 처리량을 유지했습니다. 셋째, 멀티-티어 분산 처리입니다. 일부 에이전틱 AI 서비스는 단일 모델만으로 처리되지 않으며, 디바이스·엣지·코어의 서로 다른 모델과 도구가 협력할 수 있습니다. 디바이스에서 경량 추론, 엣지에서 도메인 특화 모델, 코어에서 대형 모델을 선택적으로 활용하는 구조입니다. 다만 일반적인 에이전트 서비스가 계층 간 마이크로초 단위 동기화를 요구하는 것은 아니며, 엄격한 시간 동기는 TSN 기반 산업 제어 등 특정 워크로드의 요구사항입니다. NPU 서버와 AI Grid — 추론 인프라의 새 지형 NPU 서버란 무엇인가 GPU가 병렬 연산에 폭넓게 활용되는 반면, NPU(Neural Processing Unit)는 신경망 연산에 특화된 가속기입니다. 일부 추론 워크로드에서는 NPU가 GPU보다 전력 효율이나 비용 측면에서 이점을 낼 수 있지만, 실제 성능은 모델 구조·정밀도·메모리 구성·배치 크기·소프트웨어 생태계에 따라 달라집니다. CPU가 시스템 운용·데이터 처리를 맡고 NPU 또는 GPU가 AI 연산을 가속하는 이종 컴퓨팅 구조가 일반적입니다. AI Grid — 분산 추론 인프라 엔비디아는 GTC 2026에서 AI 그리드 레퍼런스 아키텍처를 발표했습니다. 핵심은 지역 PoP, 중앙국, 메트로 허브와 엣지 거점에 가속 컴퓨팅을 배치해 지리적으로 분산된 AI 추론 플랫폼을 구성하는 것입니다. 약 10만 개라는 수치는 개별 텔코의 자산이 아니라 전 세계 통신사와 분산 클라우드 사업자가 운영하는 분산 네트워크 데이터센터의 합산 추정치입니다. 기지국은 모든 곳에 추론 서버를 두기보다, 전력·냉각·경제성을 검토해 선택적으로 활용할 수 있는 미래 배치점으로 보는 편이 정확합니다. 한 가지 구현 방식은 코어 AI 팩토리, 지역 엣지 노드, 그리고 선택적 AI-RAN 거점으로 역할을 나누는 것입니다. 코어에서는 대형 모델 학습·파인튜닝과 광역 서비스가, 지역 엣지에서는 지연·데이터 주권·대역폭 요구가 높은 추론이 수행될 수 있습니다. AI-RAN은 RAN과 AI 워크로드의 컴퓨팅 자원 공유를 검증하는 단계이며, 모든 기지국이 사용자 추론을 처리한다는 뜻은 아닙니다. 사용자와 데이터에 가까운 곳에서 처리하면 왕복 구간을 줄일 수 있지만, 종단간 지연은 무선·전송·큐잉·모델 처리 시간을 함께 고려해야 합니다. 통신사가 설계해야 할 네 가지 네트워크 요건 AI 그리드가 제 성능을 발휘하려면 그것을 연결하는 네트워크가 AI 추론 트래픽의 특성을 수용할 수 있어야 합니다. 4개의 구체적 요건이 있습니다. ① SRv6 기반 결정론적 경로 제어 일반 IP 망에서는 혼잡이나 장애에 따라 경로와 지연이 변동할 수 있습니다. SRv6의 SR Policy는 소스에서 명시 경로를 지정하는 기반이 되어, 지연 민감 트래픽의 경로 변동을 줄이는 데 활용할 수 있습니다. 다만 SRv6만으로 결정론적 레이턴시가 보장되지는 않습니다. 보장형 지연을 위해서는 용량 설계, 자원 예약, 입장 제어, 큐잉·스케줄링과 필요 시 DetNet·TSN 같은 메커니즘을 함께 적용해야 합니다. 따라서 SRv6 단일 패브릭은 AI Grid 연결의 유용한 기반이지만, 그 자체가 충분조건은 아닙니다. ② 5G 네트워크 슬라이싱...AI 추론 전용 슬라이스 AI 추론·일반 데이터·IoT 센서 데이터는 서로 다른 QoS 요건을 가질 수 있습니다. 5G 네트워크 슬라이싱은 하나의 물리 인프라 위에서 용도별 논리 네트워크와 정책을 구성하는 기능이며, 실제 보장 범위는 RAN·전송·코어·애플리케이션을 포함한 종단간 설계와 SLA에 좌우됩니다. 노키아와 AWS는 MWC 2026에서 AI가 네트워크 KPI와 상황 정보를 바탕으로 슬라이싱 정책을 조정하고, SMO를 통해 RAN 정책을 적용하는 인텐트 기반 사례를 발표했습니다. 이는 기업 AI가 표준 API로 슬라이스를 직접 협상한 상용 구조라기보다, 자동화된 정책 운영을 향한 실증 사례로 보는 것이 적절합니다. ③ 엣지 UPF 분산 배치 5G 코어의 UPF(User Plane Function)를 엣지 가까이 분산 배치하면 사용자 트래픽을 중앙 코어까지 보내지 않고 인접한 서비스 거점으로 분기할 수 있습니다. 다만 UPF가 AI 추론을 직접 수행하는 것은 아닙니다. UPF는 로컬 브레이크아웃을 제공하고, 인접한 MEC 또는 AI 서버가 추론을 수행하는 구조가 일반적입니다. 지연 개선 효과는 배치 위치·무선 구간·전송망·모델 처리 시간에 따라 달라지며, sub-15ms와 같은 목표는 특정 서비스와 측정 범위를 명시해 검증해야 합니다. ④ gNMI 기반 실시간 레이턴시 가시성 AI 그리드에서는 네트워크 지연·손실·혼잡뿐 아니라 추론 지연, 처리량, 큐 깊이, 가속기 사용률 같은 애플리케이션·플랫폼 지표를 함께 관측하고, 오케스트레이터가 이를 바탕으로 요청을 적절한 노드에 배치하는 구조가 필요합니다. gNMI 스트리밍 텔레메트리는 네트워크 장비 상태를 수집하는 유용한 인터페이스이지만, 추론 성능 관측이나 동적 라우팅 전체를 대신하지는 않습니다. 애플리케이션 관측성, 용량 관리, 정책·트래픽 제어와 결합해야 합니다. 아카마이는 요청을 적절한 컴퓨팅 계층에 매칭해 비용과 레이턴시를 함께 최적화하는 접근을 제시했습니다. 글로벌 Telco의 실제 구현 사례 컴캐스트 × 엔비디아...AI 그리드 레퍼런스 검증 (2026.03) 컴캐스트는 엔비디아와 함께 깊은 분산 네트워크 아키텍처를 AI 그리드로 활용하는 협업을 발표했습니다. 엔비디아가 공개한 벤치마크에서 퍼스널l AI의 음성 소형 언어 모델을 RTX PRO 6000 GPU 기반의 4개 사이트 AI Grid에 분산 배치했을 때, 상관된 버스트 트래픽에서도 음성 상호작용의 종단간 지연을 500ms 목표 안에서 유지했습니다. 같은 시험 조건에서 중앙집중형 구성과 비교한 토큰당 비용 절감은 버스트 시 76.1%였습니다. 이는 특정 모델·하드웨어·트래픽 조건의 결과이며 일반적 비용 절감률로 해석해서는 안 됩니다. SKT × Arm × 리벨리온...국산 NPU 기반 AI 추론 인프라 (2026.04) SKT는 Arm·리벨리온과 3자 협약을 통해 Arm AGI CPU와 리벨리온 RebelCard NPU를 결합한 AI 추론 서버를 공동 개발하고, 자사 AI 데이터센터에서 성능·안정성을 실증하기로 했습니다. A.X K1 모델의 운영도 검토 대상이며, 현 시점에서는 상용 도입 완료가 아니라 개발·검증 단계로 표현하는 것이 정확합니다. SKT는 별도의 GPU 기반 AI 인프라 협력도 추진하고 있어, 향후 NPU와 GPU를 워크로드별로 병행 활용할 가능성이 있습니다. AT&T × 시스코 × 엔비디아...제로-트러스트 AI 추론 아키텍처 (2026.03) AT&T와 시스코는 달라스 디스커버리 디스트릭트에서 엔비디아 GPU와 시스코의 파일럿 플랫폼을 활용한 공개안전 사용사례를 시연했습니다. 이 협력은 전용 IoT 코어, 로컬 트래픽 분기, 엣지 컴퓨팅과 제로-트러스트 보안을 결합해 실시간 AI를 네트워크 가까이 제공하려는 접근입니다. 다만 이는 상용 전면 배치라기보다 시연·파일럿과 산업 적용 확대 단계로 보는 것이 정확합니다. 인도삿 × 노키아 × 엔비디아...소버린 AI 그리드 (2026.06) Indosat Ooredoo Hutchison는 2026년 3월 MWC에서 노키아·엔비디아와 함께 동남아시아 최초의 AI-RAN 기반 레이어3 5G 통화를 실증했습니다. 노키아 에어스케일 무선 장비와 RAN 소프트웨어가 엔비디아 GPU 가속 인프라 위에서 동작하며, AI와 RAN 워크로드를 동일한 컴퓨팅 자원에서 동시에 처리할 수 있음을 기능적으로 검증한 사례입니다. 이후 인도네시아 현장 시험과 망 현대화는 추진 단계이므로, AI 그리드와 AI-RAN의 전국 상용 구현 완료로 단정하지 않는 것이 적절합니다. 한국 통신사의 실행 과제...지금 무엇을 결정해야 하는가 영국 리서치 컨설팅 회사인 Analysys Mason에 따르면 통신사의 GPUaaS 수익은 2024년 1억 달러 미만에서 2030년 96억 달러로 성장할 전망이며, 전 세계 약 30개 사업자가 이미 GPUaaS를 출시했습니다. 다만 맥킨지의 잠재 시장 규모와 Analysys Mason의 Telco 수익 전망은 대상 범위와 산정 방법이 달라 이를 단순 점유율로 비교하기에는 한계가 있습니다. 핵심 메시지는 기회가 존재하되, 통신사가 하이퍼스케일러·네오클라우드와 직접 규모 경쟁하기보다 데이터 주권, 연결성, 지역 엣지, 산업별 통합 서비스처럼 차별화 가능한 영역을 선택해야 한다는 점입니다. 국내 통신사의 현실적 준비 순서는 다음과 같습니다. 결론 : 망이 추론 인프라가 되는 시대, 도로를 먼저 깔아야 한다 AI 에이전트 서비스에는 단순히 빠른 망보다 워크로드별로 예측 가능한 종단간 성능, 관측성, 보안과 비용 효율이 중요합니다. 이 시리즈가 다룬 SRv6 단일 패브릭, OpenROADM 개방 광전송, TM Forum L4 자율화 거점은 이러한 AI 추론 인프라의 기반이 될 수 있습니다. 다만 각각은 충분조건이 아니라, 컴퓨팅·오케스트레이션·보안·운영 설계와 결합돼야 합니다. 엔비디아의 AI 그리드 레퍼런스 설계, SKT의 NPU 기반 추론 서버 개발, 인도삿의 소버린 AI와 AI-RAN 추진은 통신사가 분산 추론 인프라의 유력한 제공자가 될 수 있음을 보여 줍니다. 그러나 CDN·분산 클라우드·엔터프라이즈 엣지 사업자도 경쟁과 협력의 대상입니다. 통신사의 강점은 광범위한 접속망과 지역 거점, QoS·보안·운영 역량을 결합해 특정 산업과 지역에 차별화된 서비스를 제공하는 데 있습니다. "AI 에이전트 시대에 통신사의 역할은 단순한 전송 제공을 넘어, 연결성과 분산 컴퓨팅을 결합한 서비스 운영자로 확장될 수 있습니다. 다만 이 역할은 단독 소유권이 아니라 클라우드·CDN·장비·애플리케이션 사업자와의 생태계 경쟁 및 협력 속에서 형성될 것입니다." 도로가 없으면 어떤 차도 달릴 수 없습니다. AI 에이전트 서비스의 시대에 그 도로를 먼저 깔기 시작하는 통신사가, 다음 10년의 AI 인프라 패권을 가져갑니다.

2026.09.04 11:18최홍석 컬럼니스트

삼성, 인텔 '코어 시리즈3' 업고 맥북네오 정조준

D램과 SSD 등 메모리 반도체 수급난으로 PC 가격 상승과 출하량 감소가 이어지고 있는 가운데 애플의 보급형 노트북 '맥북네오'가 국내외 시장에서 판매량을 늘리며 주목받고 있다. 인텔도 코어 시리즈3(와일드캣 레이크)를 앞세워 윈도 기반 보급형 노트북 시장 확대를 노린다. 국내외 주요 PC 제조사는 오는 4일(현지시간) 독일에서 개막하는 유럽 최대 가전 전시회 'IFA 2026'을 전후해 인텔 코어 시리즈3 탑재 노트북 신제품을 공개할 예정이다. 삼성전자가 한 발 앞선 1일 '뉴 갤럭시북6'를 출시한 가운데, 주요 제조사들은 국내 시장에 출시할 제품 가격 설정에 고심하고 있다. 삼성전자가 제시한 기본 모델 기준 출고가 119만원이 사실상 시장 하한선으로 작용하고 있기 때문이다. 코어 시리즈3, 보급형 노트북·산업 환경 겨냥 애플은 맥북네오에 아이폰16 프로(2024년)에 탑재된 A18 프로 칩을 활용했다. 반면 인텔 코어 시리즈3는 보급형 노트북 뿐만 아니라 산업용 기기, 키오스크 등 보다 다양한 기기 활용을 위해 설계됐다. CPU는 고성능 P(퍼포먼스) 코어 최대 2개, 저전력·고효율 E(에피션트) 코어 4개를 조합한 하이브리드 구조다. Xe3 GPU 코어는 최대 2개다. AI 성능은 15 TOPS급 NPU와 CPU·GPU를 합해 약 40 TOPS 수준이다. 메모리는 PC 메인보드에 직접 장착하는 LPDDR5X-7467MHz, 메모리 슬롯에 장착하는 DDR5-6400MHz 등 두 종류를 지원한다. 외부 모니터는 4K 60Hz 기준 최대 3개까지 지원하며 와이파이7(802.11be)과 블루투스 6.0 등 무선 기능도 지원한다. 삼성전자, 1일 '뉴 갤럭시북6' 119만원에 출시 삼성전자가 1일 국내 시장에 출시한 '뉴 갤럭시북6'는 인텔 코어 시리즈3 프로세서와 LPDDR5X 8GB 메모리, 14형 1920×1200 화소 IPS LCD 등을 탑재했다. 코어3 304(P1+E4 코어) 프로세서와 8GB 메모리, 256GB SSD를 탑재한 모델 출고가는 119만원이다. 메모리와 SSD 용량이 같은 애플 맥북네오와 동일한 가격이다. CPU 코어 수와 GPU·NPU 성능 등에서는 올 초 출시된 코어 울트라 시리즈3(팬서레이크) 탑재 노트북과 차이가 있지만, 윈도11의 일부 AI 기능은 지원한다. 윈도 스튜디오 효과 등 윈도11 내장 기능 일부에 더해 사진이나 그림 파일에서 배경을 날리는 'AI 컷아웃', 실시간 번역 등 갤럭시 AI 일부 기능도 활용할 수 있다. 삼성전자 가격 공세에 경쟁사 '막판 고심' 삼성전자 외에도 레노버, HP, 델테크놀로지스 등 주요 PC 제조사가 코어 시리즈3 탑재 노트북 70종 이상을 이 달부터 출시 예정이다. 이들 업체 중 상당수는 삼성전자의 공격적인 가격 설정에 막판 고심중이다. 2일 익명을 요구한 글로벌 제조사 국내 법인 관계자는 "핵심 부품인 메모리와 SSD(낸드 플래시메모리) 가격 상승이 예상돼 무작정 낮은 가격대로 설정할 수 없다"고 설명했다. 이 관계자는 "삼성전자는 제품 원가에 영향을 미치는 주요 부품인 메모리와 SSD를 DS부문에서 자체 조달할 수 있어 그나마 조금 사정이 나은 편이지만 여러 비용을 감안하면 거의 이득을 남기지 않는 수준"이라고 설명했다. "대부분 제품, 삼성전자 가격 따를 것" 전망 맥북네오가 100만원대 보급형 시장에서 존재감을 높이고 있지만 국내 PC 시장에서는 여전히 윈도 기반 제품의 비중이 높다. 시장조사업체 스탯카운터에 따르면 8월 국내 PC(데스크톱)용 운영체제 중 윈도 운영체제 점유율은 89.04%로 높다. 또 기존 업무·학습용 프로그램과 각종 드라이버 등 호환성 면에서는 맥북네오(맥OS)보다 윈도 운영체제가 더 유리하다. 출고 가격 설정에 따라서는 신규 수요를 이끌어 낼 여건이 갖춰진 셈이다. 다른 업체 관계자는 "국내 시장에서 가장 큰 영향력과 인지도를 가진 업체가 사실상 가격대를 정해준 것이나 마찬가지라 앞으로 출시되는 제품들도 이 범위를 벗어나기 어려울 것"이라고 전망했다. 이어 "가격이 150만원을 넘어서면 코어 울트라 시리즈2(루나레이크) 등을 탑재한 기존 출시 제품과 큰 차이가 없는 수준이라 의미가 없다"고 설명했다.

2026.09.02 17:25권봉석 기자

딥엑스, AWS와 '피지컬 AI' 배포 환경 구축… 글로벌 시장 공략 가속

인공지능(AI) 반도체 스타트업 딥엑스(대표 김녹원)가 아마존웹서비스(AWS)의 클라우드·IoT 인프라와 자사 신경망처리장치(NPU)를 연계한 피지컬 AI 배포 환경을 구축하고 글로벌 시장 진출을 본격화한다. 1일 딥엑스에 따르면 AWS는 최근 공식 기술 블로그를 통해 딥엑스의 온디바이스 NPU 'DX-M1'과 'AWS IoT 코어', 'AWS IoT 그린그래스'를 결합해 AI 모델을 준비하고 다수의 엣지 기기에 NPU 실행 환경을 원격 배포·관리하는 방식을 소개했다. 현재 AWS 마켓플레이스에서 제공 중인 '딥엑스 그린그래스 솔루션'을 활용하면, 표준 AI 모델 형식인 ONNX를 딥엑스 NPU 전용 형식(DXNN)으로 변환한 뒤 드라이버와 펌웨어, 런타임 환경을 현장 장비에 원격으로 자동 배포할 수 있다. 이에 따라 스마트팩토리, 물류센터, 리테일 매장, 로봇 등에 설치된 다수의 기기를 직접 방문하지 않고도 일괄 관리하고 최신 AI 모델로 상시 업데이트할 수 있게 된다. 최근 피지컬 AI가 로봇과 산업 장비로 빠르게 확산되면서 클라우드에서 모델을 개발·관리하고 현장 엣지 기기의 저전력 NPU가 실시간 추론을 맡는 '클라우드-엣지 연계'의 중요성이 부각되고 있다. 딥엑스는 이를 발전시켜 클라우드와 현장 기기가 역할을 분담하는 '센터-엣지 연합 AI' 구조를 구축할 방침이다. 김녹원 딥엑스 대표는 8월 31일부터 9월 1일까지 미국 샌프란시스코에서 열리는 'AWS 스타트업 파트너 서밋 2026'에 직접 참석해 글로벌 파트너십 확장에 나섰다. 하드웨어 반도체 기업으로는 이례적으로 참여해 클라우드와 엣지를 잇는 협력 모델을 제시하고 있다. 회사는 향후 북미 로보틱스, 산업용 비전 프로젝트뿐 아니라 차세대 AI 칩인 'DX-M2'로도 클라우드 연동을 확대할 계획이다. 딥엑스 관계자는 “피지컬 AI 확산을 위해서는 고효율 반도체와 더불어 현장 기기 배포 인프라가 필수적”이라며 “AWS와의 협력을 통해 산업 현장의 AI 도입 장벽을 낮춰가겠다”라고 말했다.

2026.09.01 16:25전화평 기자

리벨리온, 英칼로섬과 맞손…유럽 소버린 AI 인프라 시장 공략

인공지능(AI) 반도체 스타트업 리벨리온이 영국 이기종 AI 컴퓨팅 스타트업 칼로섬과 파트너십을 맺고 유럽 소버린 AI 인프라 시장 진출을 본격화한다. 리벨리온은 칼로섬의 '글로벌 이기종 컴퓨팅 통합' 비전 아시아 대표 파트너로 합류했다고 26일 밝혔다. 칼로섬은 케임브리지대 출신 연구진이 설립한 AI 인프라 스타트업이다. AI 모델과 칩을 동시 최적화해 작업을 적합한 하드웨어에 자동 배분하는 소프트웨어 레이어를 개발하고 있다. 특정 칩 종속성을 탈피해 비용과 전력 효율을 높이는 기술력을 인정받아 영국 정부 소버린 AI 펀드 1호 투자 기업으로 선정됐다. 최근 1억 달러 규모 시드 투자를 유치했다. 리벨리온은 이번 협력을 통해 이기종 컴퓨팅 중심으로 확대되는 유럽 소버린 AI 시장에 자사 랙 스케일 신경망처리장치(NPU) 제품을 본격 공급한다. 양사는 영국 정부 지원 AI 연구 클러스터에 100대 이상 NPU 기반 컴퓨팅 랙 공급을 추진할 계획이다. 양사는 이기종 아키텍처 내 추론 전담 레퍼런스 아키텍처를 공동 설계하고 있으며, 칼로섬 플랫폼과 통합을 통해 고객사들이 추가 최적화 과정 없이 NPU를 활용할 수 있는 환경을 구축하고 있다. 향후 유럽을 넘어 글로벌 시장으로 공동 진출 범위를 넓힐 방침이다. 다니얼 아카르카 칼로섬 대표는 "리벨리온 NPU는 칼로섬의 이기종 오케스트레이션 플랫폼에서 AI 추론 성능과 전력 효율을 극대화하는 핵심 축이 될 것"이라고 말했다. 박성현 리벨리온 대표는 "AI 인프라 다변화 흐름에서 칼로섬과 협력은 소버린 AI 시장 공략을 가속하는 전환점이 될 것"이라며 "성능과 전력 효율, 공급망 안정성을 갖춘 핵심 인프라 기업으로 도약하겠다"고 밝혔다.

2026.08.26 14:21전화평 기자

퀄컴 "새 오라이언 CPU, 모바일 최초 작동클록 5GHz 돌파"

퀄컴이 25일(현지시간) 스마트폰용 차세대 스냅드래곤 시스템반도체(SoC)의 최대 작동 클록이 5GHz를 넘길 것이라고 밝혔다. 퀄컴이 작년 공개한 스마트폰용 SoC인 스냅드래곤8 엘리트 5세대의 최대 작동 클록은 4.6GHz였다. 삼성전자 스마트폰에만 공급되는 갤럭시용 스냅드래곤8 엘리트 5세대의 최대 작동 클록은 4.74GHz였다. 작년 11월 공개된 PC용 SoC인 스냅드래곤 X2 엘리트 익스트림에 내장된 오라이언 CPU 중 최고 성능을 내는 프라임 코어 2개는 이미 작동 클록 5GHz에 도달한 상태다. 퀄컴은 이날 공식 블로그를 통해 "모바일용 차세대 오라이언 CPU의 작동 클록은 최대 5GHz까지 향상됐고 이는 새로운 공정 기술 뿐만 아니라 마이크로아키텍처, 구현 방식, CPU 서브시스템까지 완전한 맞춤형 설계의 결과"라고 설명했다. 퀄컴에 따르면 새 오라이언 CPU는 5GHz로 작동하는 최고 성능 프라임 코어 2개, 일반 작업용 퍼포먼스 코어 6개 등 총 8개로 구성될 예정이다. 퀄컴은 5GHz 작동 속도와 함께 클록당 명령어 처리량(IPC)도 강조했다. 같은 작동 속도에서 더 많은 명령어를 처리해 앱 실행과 게임, 콘텐츠 제작, 온디바이스 AI 등 실제 사용 환경에서 성능 향상을 노린다는 전략이다. 퀄컴이 이날 함께 공개한 새로운 캐시 기술 '플렉스캐시'는 새로운 오라이언 CPU에 처음 도입된다. CPU 코어별로 캐시 공간을 따로 배정하는 것이 아니라 작업량에 따라 캐시 메모리를 유동적으로 배분한다. 퀄컴은 "고성능이 필요한 작업에서 5GHz로 작동하는 프라임(Prime) 코어가 전체 캐시 풀을 활용할 수 있어 필요한 데이터가 캐시에 더 오래 머물도록 설계됐다"고 설명했다. 이는 CPU가 상대적으로 느린 시스템 메모리에 접근하는 횟수를 줄이는 효과를 노린다. 작업 데이터가 캐시에서 밀려나 메모리로 이동하는 상황을 줄이면 코어가 데이터를 기다리며 발생하는 지연을 낮출 수 있기 때문이다. 퀄컴은 플렉스캐시의 용량과 5GHz 작동 속도 유지 조건 등은 별도로 공개하지 않았다. 보다 상세한 내용은 오는 9월 하순 연례 기술 행사 '스냅드래곤 서밋 2026'에서 공개될 전망이다.

2026.08.26 10:02권봉석 기자

델 "에이전틱 AI 시대, 비용·효율 고려한 분산처리 필요"

"에이전틱 AI가 보급되며 여러 기업이 에이전트 활용을 독려하고 있다. 하지만 모든 직원이 AI를 효율적으로 활용하는 것은 아니다. 가치 낮은 업무에 많은 양의 토큰을 쓰는 한편 가치 있는 업무를 매우 적은 토큰으로 수행하는 상황도 발생한다." 25일 오전 서울 삼성동 코엑스에서 진행된 '델테크놀로지 CSG 미디어 간담회'에서 유상모 델테크놀로지스 총괄사장이 이렇게 강조했다. 델테크놀로지스는 연례 행사 '델 테크놀로지스 포럼' 일부인 이날 행사에서 AI 처리를 클라우드에만 의존하는 것은 보안과 토큰당 비용 면에서 적합하지 않다고 지적했다. 이어 보완책으로 AI PC와 워크스테이션 등으로 AI 처리를 분산하는 '책상 옆(데스크사이드) AI'를 제시했다. 에이전틱 AI 대응 3대 전략 제시 "AI 토큰도 비용" 이날 델테크놀로지스는 에이전틱 AI 시대의 대처 방안을 ▲ AI 토큰경제 ▲ AI 네이티브 조직을 위한 AI PC ▲ AI 확산에 따른 엔드포인트 보안 등 세 가지 축으로 제시했다. 정재욱 델테크놀로지스 이사는 "클라우드는 대규모 연산이 일어나는 환경에, 데이터 소유권과 통제가 중요한 연산은 기업이나 조직 내 데이터센터가 적합하다. 반면 반복적인 추론이나 민감한 데이터는 데스크사이드에서 처리해 효율을 확보할 수 있다"고 설명했다. 이어 "엔비디아 GB10·GB300과 x86 CPU·엔비디아 GPU 등으로 구성된 워크스테이션은 로컬 AI 개발과 에이전트 개발·테스트에 적합하다. 개발된 모델이나 에이전트는 필요에 따라 델 파워엣지 서버로 확장할 수 있다"고 덧붙였다. "책상 위 AI PC로 효율·보안 강화" AI PC는 CPU·GPU·NPU를 활용해 일부 LLM 구동과 추론을 로컬에서 수행할 수 있어 클라우드 API 호출에 따른 토큰 비용을 줄이는 방안으로 활용할 수 있다. 개인정보나 고객정보, 대외비 등 민감한 데이터 외부 유출 가능성도 줄인다. 정재욱 이사는 "델은 인텔 코어 울트라 시리즈3와 AMD 라이젠 AI 400 등을 기반으로 한 '델 프로' 제품군을 업무 수준과 예산에 따라 세분화했다. 14·16형 업무용 노트북인 델 프로 5 이외에 최대 50 TOPS NPU를 내장한 델 프로5 마이크로 등을 공급한다"고 설명했다. 기기 내 저장된 데이터와 각종 모델을 외부 공격에서 방어하기 위한 보안의 중요성도 커지고 있다. 정재욱 이사는 "델테크놀로지스는 제품 조립 단계부터 공급망 보안, 바이오스와 펌웨어 무결성 검증, 마이크로소프트 인튠 등 기기 관리 솔루션과 연동한 텔레메트리 등으로 보안을 강화하고 있다"고 설명했다. "에이전틱 AI, 워크로드 분산 촉진할 것" 이날 델테크놀로지스는 AI PC와 데스크사이드 AI 전략을 소개하며 최근 CSG 사업 성장세도 강조했다. 이성민 델테크놀로지스 전무는 "회계연도 기준 올해 2~4월(1분기) CSG 매출은 146억 달러(약 20조 2049억원)로 전년 동기 대비 17% 증가했으며 이 중 기업용 PC 부문 매출은 130억 달러(약 18조 180억원)로 18% 성장했다"고 밝혔다. 델테크놀로지스는 반도체 수급난과 경기 불확실성으로 기업의 IT 비용 부담이 커지는 상황에서도 공급망 최적화와 운영 효율화를 통해 비용 상승 영향을 최소화한다는 방침이다. 정재욱 이사는 "AI가 프롬프트 중심에서 에이전틱 AI 중심으로 이동하고 있는 만큼 AI 처리를 분산하려는 흐름은 지속될 것이며 기업 역시 비용 부담을 고려하면서 어떤 AI를 어디에 배치할 지 선택하는 것이 중요해질 것"이라고 전망했다.

2026.08.25 15:40권봉석 기자

GPU 천하 AI 시장에 '추론 강점' 국산 NPU 파고든다

글로벌 AI 시장이 학습에서 추론 중심으로 전환하면서 AI 반도체 경쟁도 개별 칩 성능을 넘어 하드웨어와 소프트웨어를 결합한 플랫폼 경쟁으로 확대되고 있다. 이에 정부는 국산 NPU를 중심으로 다양한 연산 자원을 결합하는 개방형 AI 컴퓨팅 생태계 구축에 나선다. 과학기술정보통신부는 20일 서울 광화문 HJ비즈니스센터에서 국내 AI 반도체 업계 관계자들과 '개방형 AI 컴퓨팅 인프라 생태계 구축을 위한 간담회'를 열어 국산 NPU 시장 확산과 글로벌 컴퓨팅 생태계 참여 방안을 논의했다. 이는 지난 7월 과기정통부와 AMD가 체결한 업무협약 후속 조치다. 최근 생성형 AI 서비스가 확산하면서 AI 컴퓨팅 시장의 무게중심은 대규모 모델을 만드는 학습에서 실제 서비스를 구동하는 추론으로 이동하고 있다. 이에 따라 연산 성능뿐 아니라 전력 효율과 비용 경쟁력이 AI 인프라의 주요 경쟁 요소로 부상하고 있다. AI 서비스마다 요구하는 연산 환경도 달라지면서 특정 반도체에 의존하기보다 CPU와 GPU, NPU를 메모리 네트워크 소프트웨어와 조합하는 개방형 컴퓨팅 구조의 중요성도 커지고 있다. 특히 정부와 업계는 글로벌 AI 반도체 경쟁이 개별 칩의 성능 경쟁에서 전체 시스템을 얼마나 효율적으로 구성하느냐를 겨루는 방향으로 바뀌고 있다고 봤다. 이날 퓨리오사AI는 개방형 AI 컴퓨팅 인프라의 글로벌 동향과 국내 AI 반도체 업계 대응 방향을 발표했다. AMD코리아는 과기정통부와 체결한 MoU의 주요 내용과 실행 계획을 공유했으며, 망고부스트와 모레는 AMD와 추진 중인 AI 컴퓨팅 최적화와 소프트웨어 협력 현황을 소개했다. 참석 기업들은 GPU 중심의 단일 구조에서 벗어나 AI 반도체와 메모리, 네트워크, 소프트웨어를 유기적으로 연결하는 생태계를 구축해야 한다는 데 의견을 모았다. 이를 위해 CPU, GPU 등 가속기와 메모리를 고속으로 연결하는 CXL과 네트워크 저장장치 등의 데이터 처리를 전담하는 DPU 등 차세대 인프라 기술 활용을 확대할 필요성이 제기됐다. 메모리 내부에서 연산을 수행하는 PIM과 인간의 뇌 구조를 모방한 뉴로모픽 반도체 등 미래 AI 반도체 원천기술에 대한 투자도 강화해야 한다는 의견이 나왔다. 하드웨어뿐 아니라 소프트웨어와 플랫폼을 아우르는 풀스택 경쟁력 확보도 과제로 꼽혔다. 개방형 인터페이스와 국제표준, 오픈소스를 기반으로 서로 다른 기업의 AI 반도체와 소프트웨어를 연결하고 이를 실제 환경에서 검증할 국가 차원의 실증 기반이 필요하다는 설명이다. AMD와의 협력을 실제 사업 성과로 연결해야 한다는 주문도 나왔다. 참석 기업들은 과기정통부와 AMD의 MoU가 국내 AI 반도체 기업의 글로벌 생태계 진입 기회를 넓혔다고 평가하면서도 구체적인 공동 과제 발굴과 후속 실행이 필요하다고 강조했다. 과기정통부는 국산 NPU가 실제 데이터센터와 AI 서비스에서 활용될 수 있도록 풀스택 실증 지원을 강화할 방침이다. 추론 시장 확대를 국산 AI 반도체의 시장 진입 기회로 활용하겠다는 전략이다. 배경훈 부총리 겸 과기정통부 장관은 “글로벌 AI 시장이 학습에서 추론 중심으로 전환되면서 AI 경쟁의 무대도 개별 칩 성능을 넘어 전력 비용 효율성을 갖춘 개방형 AI 컴퓨팅 생태계 경쟁으로 확대되고 있다”며 “이는 추론 효율성에 강점을 가진 국내 NPU 기업에 새로운 기회가 될 것”이라고 말했다. 이어 “국산 NPU가 실제 데이터센터와 AI 서비스 현장에서 활용되는 성공 사례를 조속히 확보할 수 있도록 풀스택 실증 지원을 강화하고 관련 생태계 구축에 노력하겠다”고 밝혔다.

2026.08.20 17:01박수형 기자

라이너-리벨리온, 'K-AI' 풀스택 수출 동맹

라이너와 리벨리온이 국산 인공지능(AI) 에이전트와 반도체 기술을 결합한 풀스택 솔루션으로 글로벌 시장을 두드린다. 라이너는 리벨리온과 AI 풀스택 솔루션 사업을 위한 업무협약(MOU)을 체결했다고 20일 밝혔다. 양사는 과학기술정보통신부 주도 '독자 AI 파운데이션 모델(독파모)' 개발 사업에서 3차수에 진출한 SK텔레콤 컨소시엄에서 협업해왔다. 이번 협약을 통해 실질적인 사업화 단계로 협력을 확대한다는 목표다. 외산 그래픽처리장치(GPU) 의존 구조에서 벗어나 국산 신경망처리장치(NPU)와 AI 에이전트 기술을 연동하는 것이 협력 골자다. 이를 통해 AI 서비스 운영 비용은 줄이고 데이터 주권과 보안 신뢰도는 높인다는 목표다. 양사는 해외 시장 파트너 발굴부터 기술 협의·수주까지 전 과정을 함께 추진할 계획이다. 전 세계 220여 개국 1300만명 사용자 기반을 확보한 라이너는 사우디 국부펀드(PIF) 산하 AI 기업 '휴메인' 플랫폼에 AI 검색 엔진을 독점 탑재한 성과를 냈다. 리벨리온도 미국·일본·중동 등 해외 주요 거점에서 글로벌 빅테크와 기술 동맹을 맺고 있다. 김진우 라이너 대표는 "우리 기술력에 리벨리온의 고효율 NPU가 더해지면 글로벌 시장에 성능과 비용 경쟁력을 동시에 갖춘 솔루션을 제시할 수 있다"며 "국내를 넘어 중동 등 글로벌 시장에서 K-AI의 저력을 증명하겠다"고 말했다.

2026.08.20 16:29이나연 기자

배경훈 "AI, 모델·인프라 넘어 산업·일상 활용 수준 돼야"

배경훈 부총리 겸 과학기술정보통신부 장관이 국내 AI 산업이 기술적 가능성을 증명하는 단계를 넘어 실제 산업과 생활 속에서 성과를 내는 단계로 전환해야 한다고 강조했다. 인공지능(AI) 모델 개발을 넘어, AI데이터센터와 같은 인프라 구축 단계를 거쳐 실제 AI를 활용하는 수준에 이르러야 한다는 뜻이다. 배경훈 부총리는 20일 서울 광화문에서 개방형 AI 컴퓨팅 인프라 생태계 간담회를 주재하며“(독자 AI 파운데이션 모델 프로젝트에서 탈락한) 모티프가 의미 있는 선전을 했다고 생각하고 스타트업의 가능성을 보여줬다”며 “이제 정부의 기본적인 AI 정책도 AI 고속도로 구축과 데이터센터 등 3대 메가프로젝트를 중심으로 방향이 정립됐고 달려가고 있다”고 말했다. 이어 “이제 해야 할 것은 독자 AI 파운데이션 모델도 지표 같은 숫자나 경쟁보다 실제적인 성과를 내면서 산업과 생활 속에서 모델을 잘 쓸 수 있도록 활용을 확산하는 것”이라며 “연말 진행될 '모두의 AI'를 통해 본격적인 확산이 이뤄지는 시점이 되지 않을까 생각한다”고 밝혔다. 과거 독자 AI 파운데이션 모델 프로젝트에 참여했던 기업들이 함께 참여하고 데이터센터 구축도 본격화하면서 국내 AI 활용을 확대할 수 있는 계기를 마련하자는 발언이다. 그는 또 AI 데이터센터 정책 역시 단순히 GPU를 확보하고 서버와 랙을 구축하는 데 그쳐서는 안 된다고도 강조했다. 배 부총리는 “AI 워크로드가 증가하면서 CPU, GPU, NPU를 효율적으로 관리하고 메모리를 비롯한 각종 자원을 최적화하는 기술의 중요성이 커지고 있다”면서 “프로세스 유닛 간 연결과 메모리 운영 효율화 등 실제 AI 인프라를 운영하고 연동하는 역량까지 확보해야 한다”고 강조했다. 파운데이션 모델을 실제 서비스로 연결하기 위한 에이전트 기술도 언급했다. AI 서비스가 학습에서 추론 중심으로 이동하고 에이전틱 AI 시대가 본격화하면 폭증하는 토큰 수요를 처리하기 위한 인프라와 에이전트 최적화 기술이 중요해질 것으로 내다봤다. 배 부총리는 “모델 개발뿐 아니라 실제적인 운영·연동 역량과 파운데이션 모델이 작동할 수 있는 에이전트 기능을 강화해야 한다”며 “추론이 활성화되고 에이전틱 시대를 맞아 토큰 수요를 어떻게 감당할 것인지, 에이전트 최적화 등을 많이 봐야 한다”고 말했다. 정부도 이 같은 변화에 맞춰 지원 범위를 확대할 방침이다. 내년 AI 관련 예산을 확대하고 국내 AI 모델과 소프트웨어를 비롯해 국산 AI 반도체 기업과 관련 개발사들이 실제 사업을 실행할 수 있도록 전방위적인 지원을 준비하고 있다는 설명이다. 배 부총리는 국내 AI 기업들에 기술적 가능성을 보여주는 데서 한발 더 나아가 사업적 성과를 증명해 달라고 주문했다. 그는 “국산 NPU가 실제 데이터센터와 AI 서비스 현장에서 활용되는 성공 사례를 조속히 확보할 수 있도록 풀스택 실증 지원을 강화하고 관련 생태계 구축에 노력하겠다”며 “여기 계신 분들이 산증인이 돼 가능성을 증명하는 시대를 넘어 매출과 수익을 일으켜 대한민국이 AI 산업의 중심이라는 것을 증명해 주시길 바란다”고 했다. 글로벌 AI 생태계 진출도 강조했다. 최근 AMD와 체결한 업무협약(MOU)을 언급하며 개방형 AI 인프라 생태계 구축을 통해 국내 NPU 기업을 비롯한 AI 기업들의 글로벌 진출 기반을 넓히겠다는 구상도 밝혔다. 배 부총리는 “AMD의 개방형 인프라 생태계에 정부도 함께하기로 했고 NPU 회사들도 참여하면서 전방위적으로 AI 생태계를 확장할 준비를 하는 시점”이라며 “글로벌 AI 생태계에 적극 참여하고 세계 시장에서 우리를 증명하는 것이 중요하다”고 강조했다. 그러면서 “많은 기업이 대한민국뿐 아니라 세계 시장의 문을 두드리고 있다”며 “정부도 최대한 지원하고 빠짐없이 생태계를 만들기 위해 노력하겠다”고 약속했다.

2026.08.20 10:55박수형 기자

中 휴머노이드 AI칩도 '자국우선주의' 확산...K-반도체에 불똥튀나

국가 간 인공지능(AI) 산업 경쟁이 치열한 가운데 중국이 휴머노이드 분야에서도 '자국산 우선(국산화)' 정책을 강조하면서 국내 AI 반도체 업계에 불똥이 튀고 있다. 국내 관련 기업들이 기술과 가격 경쟁력을 갖추고서도 자칫 현지 업체와의 공급 경쟁에서 발목을 잡힐 수 있기 때문이다. 중국 정부는 오래전부터 반도체 등 첨단산업 등에서 공급망 자립과 자국 산업 보호를 위해 이같은 정책을 지속하고 있다. 19일 반도체 업계에 따르면 국내 AI 연산을 수행하는 신경망처리장치(NPU) 개발업체 딥엑스는 최근 복수의 중국 주요 휴머노이드사가 진행한 반도체 샘플 성능 테스트에서 우수한 성적을 기록한 것으로 알려졌다. 그러나 현지 휴머노이드 기업들의 자국산 제품 채택 기조에 막혀 실제 수주까지 이어질지 미지수다. 이번 검증에는 중국 NPU 기업도 참여한 것으로 전해졌다. 국내 팹리스 업계 한 관계자는 "딥엑스가 최근 중국 휴머노이드 기업 여러군데에서 샘플 테스트를 진행했다"며 "저전력과 발열 제어 부문에서 인상적인 결과를 얻은 것으로 안다"고 말했다. 그러면서 "다만 중국 로봇 기업들이 자국산 제품을 먼저 써야 한다는 이유로 성능 검증 이후 도입 논의에 통상보다 시간이 걸리는 분위기다"고 전했다. 이번 복수의 중국 휴머노이드 기업에 제출된 제품은 지난해 8월 양산을 시작한 딥엑스의 첫 번째 칩 'DX-M1'이다. 5와트(W)의 전력으로 25TOPS(초당 최고 25조회 연산) 성능을 상대적 저온에서 구현한다. 딥엑스에 따르면 DX-M1은 인공지능(AI) 모델 'Yolo5s' 구동 시 표면 온도가 35.5℃에 그친 반면, 글로벌 경쟁사 제품은 60.7℃에 달한다. 이 사안에 대해 딥엑스는 "고객사 관련 사안은 확인이 어려우나 저전력·발열 제어에 경쟁력이 있는 딥엑스에 대한 글로벌 관심이 높아지고 있다"고 전했다. 현재 중국 휴머노이드 시장은 본격적인 대량 양산 단계에 진입하면서 현지 기업들이 로봇에 채용될 고효율 NPU 칩 구매를 확대하고 있다. 휴머노이드는 한정된 배터리 용량으로 수십개의 액추에이터를 구동시키고 복잡한 연산 작업을 수행해야 한다. 이 때문에 고효율 초저전력 반도체가 필수적이다. 데이터센터에서 로봇으로…번지는 자국산 우선주의 중국은 미국과 치열해지는 AI 경쟁에서 승리하기 위해 자국 기업 육성을 최우선에 두고 있다. 지난 6월 블룸버그통신은 중국 정부가 향후 5년간 전국 데이터센터 구축에 2조위안(419조원)을 투입할 계획이라고 보도했다. 알리바바나 텐센트 같은 민간 기업의 투자액은 포함되지 않은 금액이다. 블룸버그는 익명의 소식통을 인용해 "데이터센터에 들어갈 AI 칩의 최소 80%를 화웨이를 비롯한 자국 기업으로부터 공급 받아 엔비디아와 AMD를 사실상 배제하려는 구상"이라고 설명했다. 이 같은 기조가 피지컬 AI용 반도체로 확대되는 모양새다. 국내 팹리스 업계 관계자는 "중국 정부가 직접적으로 로봇 분야에서도 반드시 자국산 반도체를 쓸 것을 요구하지는 않는 것으로 안다"면서도 "그러나 중국 내에서 자국산을 우선 사용해야 한다는 기조가 워낙 강해 이를 무시하기 어려운 상황"이라고 말했다. 휴머노이드에 대한 중국의 정책 드라이브도 거세다. 중국은 15차 5개년 계획(2026~2030년)에서 휴머노이드를 최우선 기술로 지정했다. 이에 따라 베이징시는 100억위안(2조 1000억원) 규모의 전용 펀드를 조성했고, 상하이시는 선도 기업에 약 3000만위안(63억원)의 보조금을 지급하는 등 지원책을 쏟아내고 있다. 업계는 이 같은 기조가 AI칩 뿐만 아니라 로봇 핵심 부품인 액추에이터(구동기) 등 다른 분야로 확산되지 않을까 우려하고 있다. 업계 관계자는 "중국이 (미래 첨단산업 분야에서) 자국우선주의를 강조한 것은 어제, 오늘 일이 아니다"라며 "우리나라도 국산 AI 반도체를 육성하기 위해선 중국의 이러한 정책을 고민할 필요가 있다"고 주장했다.

2026.08.19 13:40진운용 기자

포스코DX, 제조 현장에 국산 AI 반도체 심는다…비전 AI 플랫폼 개발

포스코DX가 국산 인공지능(AI) 반도체를 활용한 비전 AI 플랫폼을 개발하며 산업 현장의 AI 자립화에 나섰다. 국산 신경망처리장치(NPU)를 활용해 제조 현장에 최적화된 AI 환경을 구축하고 인프라 비용과 전력 사용량을 줄인다는 구상이다. 포스코DX는 국산 AI 반도체를 활용한 산업 현장 비정형 데이터 분석 플랫폼을 개발했다고 18일 밝혔다. NPU는 딥러닝과 머신러닝 등 AI 연산에 특화된 반도체로, 그래픽처리장치(GPU)보다 AI 추론에 최적화된 것이 특징이다. 특히 현장 설비 제어 시스템에 직접 탑재하는 엣지 AI 구현에 적합해 제조 현장에서 데이터 외부 반출 없이 실시간 추론을 수행할 수 있다고 평가된다. 포스코DX는 이같은 기술적 장점을 자사 비전 AI 플랫폼에 적용했다. 새롭게 개발한 플랫폼은 산업 현장에서 수집한 다양한 영상 데이터를 단일 환경에서 학습 데이터로 관리하고 AI 모델과 성능 지표, 적용 이력 등을 통합 관리할 수 있도록 설계됐다. 또 비전 AI 서비스 구현 과정에서 반복적으로 필요한 기능을 표준화해 공통 컴포넌트 형태로 제공함으로써 신규 프로젝트 수행 기간을 단축하고 다양한 산업 현장으로 서비스를 확대할 수 있도록 했다. 이번 플랫폼의 핵심은 GPU와 NPU를 함께 활용하는 하이브리드 구조다. AI 모델 학습과 개발에는 GPU를 활용하고 산업 현장의 실시간 연산과 추론에는 국산 NPU를 적용했다. 연구·검증 단계에서도 NPU를 활용할 수 있는 환경을 마련해 실제 현장에 적용하기 전 추론 성능과 효과를 사전에 확인할 수 있도록 했다. 이를 통해 AI 모델의 정확도와 처리 속도, 전력 효율, 운영 비용 등을 미리 검증하고 현장 특성에 맞는 최적의 AI 모델을 도출할 수 있다는 게 회사 측 설명이다. 포스코DX는 딥엑스와 모빌린트 등 국내 NPU 개발사와 협력해 화재 감시와 작업자 안전 모니터링, 물류 환경의 상품 적재 상태 확인 등 다양한 분야에서 AI 국산화를 추진해왔다. 그 결과 동일한 AI 추론 성능을 기준으로 GPU 대비 인프라 구축·운영 비용은 약 50% 절감했고 전력 사용량은 약 90% 감소한 것으로 나타났다. 회사는 앞으로 비전 AI가 적용된 산업 현장을 국산 NPU 기반 플랫폼으로 단계적으로 전환하고 적용 범위를 확대할 계획이다. 포스코DX 관계자는 "NPU 기반 비전 AI 플랫폼은 산업 현장에 최적화된 AI를 보다 효율적으로 구현하는 기반이 될 것"이라며 "국산 NPU 활용 체계화와 산업 현장의 추론역량 향상에 기여하며 AI 반도체 생태계 활성화에 나설 것"이라고 밝혔다.

2026.08.18 16:20한정호 기자

'국산 AI 반도체' 리벨리온-딥엑스, 공공기관 수의계약·조달 채널 확보

국내 대표 AI 반도체 팹리스(반도체 설계전문) 기업인 리벨리온과 딥엑스가 과학기술정보통신부(과기정통부)의 '우수연구개발 혁신제품'으로 나란히 지정되며 공공 조달 시장 진출에 속도를 낸다. 리벨리온과 딥엑스는 18일 각사의 신경망처리장치(NPU) 기반 AI 솔루션이 과기정통부 주관 '우수연구개발 혁신제품'으로 지정됐다고 밝혔다. 지정 제품은 리벨리온의 '아톰맥스(ATOM-Max) 카드' 및 '아톰맥스 서버' 2종과 딥엑스의 엣지 컴퓨팅용 AI 추론 모듈인 'DX-M1·DX-H1 시리즈'다. 우수연구개발 혁신제품 지정 제도는 국가 R&D 성과물의 공공시장 진입을 지원하기 위해 마련됐다. 이번 지정에 따라 공공기관은 경쟁 입찰 없이 양사 제품과 직접 수의계약을 체결할 수 있다. 조달 소요 기간은 기존 60일에서 10일 이하로 대폭 단축되며, 구매 담당자에게는 고의·중과실이 없는 한 손실 책임을 면제하는 구매면책이 적용된다. 지정 효력은 기본 3년간 유지되며, 연장 시 최대 6년까지 공공 조달 혜택을 받는다. 리벨리온의 아톰맥스 서버는 자체 개발한 확장 설계(RSD) 기술을 적용해 8B급 소형부터 70B급 대형 언어·시각 모델까지 유연하게 처리할 수 있다. 오픈소스 프레임워크 vLLM과 레드햇 NPU 오퍼레이터를 지원해 기존 인프라와의 호환성을 높였다. 리벨리온은 최근 공공 AI CCTV 전환 사업을 통해 경남도청과 울산광역시에 아톰맥스 서버 납품을 시작하며 공공 레퍼런스를 확보했다. 딥엑스의 DX-M1·DX-H1 시리즈는 데이터 이동을 최소화하는 자체 '데이터 재사용' 아키텍처를 기반으로 저전력·고효율 추론 연산을 구현했다. 공인시험 결과 외산 GPU 대비 전력 소모를 최대 93% 절감하면서 동등한 수준의 고해상도 AI 객체 탐지 성능을 나타냈다. 딥엑스는 국방부의 '지능형 영상감시체계 시범 구축 사업'에 참여해 공군 기지 AI 경계감시체계에 NPU를 공급 중이며, 1세대 양산 1년 만에 글로벌 10여 개국에서 1300만 달러(약 183억원) 이상의 구매 주문을 확보했다. 김녹원 딥엑스 대표는 “이번 혁신제품 지정을 계기로 국내 공공 인프라에 국산 AI 반도체 적용을 확대하고, 실제 현장에서 경제성을 입증하는 소버린 AI 사례를 만들어 나가겠다”고 말했다. 박성현 리벨리온 대표는 "그간 일상 속 대국민 AI 서비스 상용화와 공공 AI CCTV 납품으로 기술력과 현장 적합성을 증명한 데 이어, 이번 혁신제품 지정으로 국산 NPU의 공공 확산이 본격화될 것"이라며 “앞으로 국내 최고 성능의 '리벨서버(RebelServer)'로도 소버린 AI를 구현할 국산 인프라의 범위와 규모를 한단계 넓혀가겠다”고 말했다.

2026.08.18 15:24전화평 기자

[독파모 2차 발표] 업스테이지 3차 진출…"국산 NPU로 실증·아시아권 공략"

업스테이지가 인공지능(AI) 모델 '솔라 오픈2' 개발 중심을 성능 경쟁에서 실제 서비스 확산으로 옮긴다. 포털 '다음'과 '타임리' 플랫폼에 모델을 연계해 성능과 안정성을 높이고, 퓨리오사AI 신경망처리장치(NPU)로 서비스 운영 비용을 낮추는 것이 핵심이다. 18일 정부 발표에 따르면 업스테이지 정예팀은 '독자 AI 파운데이션 모델 프로젝트' 2차 단계평가를 통과해 3차 단계에 진출했다. 업스테이지는 다음 단계에서 모델 벤치마크 점수를 높이는 데 그치지 않고 국민이 직접 이용할 수 있는 서비스로 전환하는 데 주력할 방침이다. 업스테이지 실사용 모델 고도화 전략은 크게 세 축으로 구성됐다. 다음·타임리를 통한 서비스 적용과 퓨리오사AI NPU 기반 비용 효율 검증, 아시아권 언어 지원 확대다. 솔라 오픈2는 전체 2500억개 매개변수 가운데 추론할 때 150억개를 활성화하는 '250B-A15B' 구조 에이전트 최적화 모델로 이뤄졌다. 대규모 모델 성능을 유지하면서 실제 연산에 사용하는 매개변수를 줄여 서비스 운영에 필요한 컴퓨팅 자원과 비용을 낮추도록 설계됐다. 모델은 엔비디아 H200 그래픽처리장치(GPU) 2장으로 구동할 수 있는 것으로 알려졌다. 업스테이지는 이러한 경량 구동 능력 바탕으로 대규모 GPU 인프라를 갖추지 않은 기업도 활용할 수 있는 서비스 모델을 구현한다는 구상이다. 모델 컨텍스트 윈도는 최대 100만(1M) 토큰이다. 한 번에 수백 페이지가 넘는 문서를 처리할 수 있는 셈이다. 업스테이지는 이 기능을 긴 문서 분석과 정보 검색, 보고서 작성 등 복잡한 업무를 수행하는 AI 에이전트 서비스에 활용할 계획이다. 실제 이용 환경 검증...해외 서비스 기반 마련 업스테이지는 솔라 오픈2를 포털 다음과 타임리 서비스에 연계해 실제 이용 환경에서 응답 성능과 안정성, 비용 효율성을 입증한다고 강조했다. 다음은 솔라 오픈2가 대규모 서비스 환경에서도 안정적으로 작동하는지 확인할 수 있는 시험대 역할을 맡는다. 모델 성능뿐 아니라 실제 서비스에 필요한 처리 효율과 운영 가능성을 함께 검증할 수 있다는 설명이다. 업스테이지는 2차 평가에서도 이러한 실증 전략을 강점으로 인정받았다. 평가진은 업스테이지 정예팀이 퓨리오사AI 손잡고 국산 NPU를 다음 서비스 환경에서 실증한 점을 높게 평했다. 업스테이지 관계자는 "외산 하드웨어(HW) 의존도를 낮출 것"이라며 "솔라 오픈2를 비용 효율적으로 운영할 수 있는 국산 AI 결합 모델을 구축할 것"이라고 밝혔다. 업스테이지는 솔라 오픈2 지원 언어를 아시아권으로 확대한다. 국내에서 검증한 서비스 운영 경험을 바탕으로 솔라 오픈2를 해외에서도 활용할 수 있는 모델로 키우기 위한 전략이다. 회사는 우선 정부 컴퓨팅 자원을 모델 고도화에 활용한다. 과학기술정보통신부는 3차 단계 진출팀에 대한 엔비디아 B200 GPU 지원 규모를 올해 상반기 약 768장에서 하반기 약 1000장으로 확대할 계획이다. 업스테이지는 추가 GPU를 활용해 솔라 오픈2의 성능과 서비스 안정성을 높일 방침이다. 장문 처리와 에이전트 기능을 강화하는 동시에 아시아 언어권 서비스에 필요한 모델 역량도 높일 방침이다. 현재 정부는 독파모 3차 단계 평가 방식과 배점을 아직 확정하지 않았다. 1·2차 평가 과정에서 확인한 보완 사항을 검토하고 업스테이지·LG AI연구원·SK텔레콤 등 3개 정예팀과 협의해 평가안을 확정·발표할 예정이다. 업스테이지 관계자는 "포털 다음과 컨소시엄 참여사 등을 통해 국민이 직접 체감할 수 있는 실사용 모델을 고도화하는 데 최선을 다할 것"이라며 "아시아권으로 지원 언어를 확대해 글로벌 확산 기반도 마련하겠다"고 말했다.

2026.08.18 14:16김미정 기자

딥엑스, NPU 양산 1년 만에 글로벌 77건 구매 수주

국내 인공지능(AI) 반도체 기업 딥엑스가 1세대 칩 양산 1년 만에 총 1300만달러(183억원) 이상의 구매주문(PO)을 확보했다. 18일 딥엑스에 따르면 자사 신경망처리장치(NPU) 칩인 'DX-M1'은 글로벌 10여개 국가·지역에서 총 77건의 구매주문(PO)을 수주했다. 딥엑스는 2025년 8월 삼성전자 5나노 공정 기반으로 DX-M1 양산을 시작한 이후 한국을 비롯해 미국, 중국, 유럽, 대만, 일본 등 주요 시장에서 수주를 이어왔다. 특히 전체 주문 77건 중 약 62%에 달하는 48건이 최근 4개월(2026년 4~7월) 사이에 집중 발생했다. 공급 제품은 DX-M1, DX-M1 M.2, DX-M1M, DX-M1M M.2 등 DX-M1 계열과 일부 DX-H1 제품으이다. DX-M1은 클라우드 연결 없이 디바이스 자체에서 AI 연산을 수행할 수 있도록 설계된 온디바이스용 NPU로, 삼성전자 5나노 공정에서 양산된다. 적용 대상은 저전력 환경에서 영상·비전 AI를 구동해야 하는 CCTV, 스마트팩토리, 로보틱스 등이다. 고객 기반도 글로벌로 확대 중이다. 중국에서는 바이두와 레노버에 제품을 공급하고 있으며 대만 산업용 컴퓨팅 기업 AAEON에도 딥엑스 칩이 들어가고 있다. 회사는 500건 이상의 특허와 90% 수준의 양산 수율을 바탕으로 공급 안정성을 확보하는 한편, 27개 글로벌 유통망과 50여 개 모듈 협력사를 연계해 해외 진출 기반을 다졌다. 아울러 삼성전자 2나노 공정을 적용한 차세대 반도체 'DX-M2'를 개발해 2027년 상반기 시제품을 선보인다는 방침이다. 김녹원 딥엑스 대표는 "양산 첫 1년 동안 가장 의미 있는 점은 특정 국가나 산업에 국한되지 않고 세계 여러 시장에서 반복 주문이 발생하고 있다는 점"이라고 말했다.

2026.08.18 11:26진운용 기자

리벨리온, '초기 투자사' KB증권과 IPO 완주한다…한투는 결별

인공지능(AI) 반도체 스타트업 리벨리온이 기업공개(IPO) 공동 주관사를 한국투자증권에서 KB증권으로 전격 교체했다. 기존 공동 주관사인 한국투자증권이 최근 기술 유출 혐의로 리벨리온과 법적 공방 중인 디노티시아의 상장 주관을 맡자 이해상충 위험을 막기 위한 조치다. 17일 반도체 업계에 따르면 리벨리온은 최근 IPO 공동 주관사를 한국투자증권에서 초기 투자자인 KB증권으로 변경하고 내년 상반기 상장을 준비 중인 것으로 파악됐다. 대표 주관사는 삼성증권이다. 리벨리온의 공동 주관사 교체 배경에는 디노티시아와 법적 갈등이 있다. 디노티시아는 리벨리온과 최근 합병한 사피온코리아의 전 최고기술책임자(CTO) 정무경 대표가 설립한 회사다. 현재 정무경 대표 등 디노티시아 임직원 3명은 사피온코리아 재직 시절 280억원 규모 AI 반도체 아키텍처 및 소스코드 등 핵심 기술을 유출한 혐의(산업기술보호법 위반 등)로 기소돼 재판을 받고 있다. 양사가 기술 유출 건으로 대립하는 가운데, 올해 초 한국투자증권이 디노티시아의 상장 대표 주관사로 선정됐다. 상장 주관사는 직무 특성상 기업 핵심 기술 정보와 재무, 사업계획 등 민감한 내부 데이터를 열람할 수 있다. 한 AI 반도체 업계 관계자는 "법적으로 예민한 관계인 두 기업을 동일한 증권사가 주관하는 것은 정보 유출과 이해상충 소지가 크다"며 "리벨리온 내부 법적 리스크 우려가 공동 주관사 교체의 주된 배경"이라고 설명했다. 새로운 공동 주관사로 낙점된 KB증권은 리벨리온의 초기 투자사다. 주관사 재정비를 마친 리벨리온은 내년 상반기 상장을 목표로 시장 상황을 예의주시하고 있다. 최근 금융 당국의 보수적 상장 심사 기조도 고려사항이다. 리벨리온은 차세대 반도체 '리벨(REBEL)' 상용화에 속도를 내고 있다. 앞선 관계자는 "최근 상장 시장에서 발생하는 각종 노이즈에 대해 당국이 보수적 기조를 보이고 있다"며 "리벨리온 역시 여러 사례를 분석하며 무리하게 추진하는 것보다 신중하고 보수적 접근을 택하고 있는 걸로 안다"고 말했다.

2026.08.17 06:00전화평 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

현대차 자율주행 '아트리아 AI' 공개…2029년 양산 적용

"스타크래프트 슈터, 2030년 출격…RTS 영광 잇는 패키지 게임"

네이버, 사우디 진출 3년 차…‘중동 결실’이냐 ‘가능성 확인’이냐

애플 아이폰17, 첫해 매출 230조원…삼성 MX 연매출의 1.8배

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.