• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
국감2026
AI페스타26
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'최적화'통합검색 결과 입니다. (32건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

노타, 멀티모달 AI도 경량화…GPU 메모리 47% 절감

노타의 멀티모달 인공지능(AI) 모델 최적화 기술이 세계적인 AI 학술대회에 채택되며 기술력을 인정받았다. 노타는 멀티모달 AI 모델의 성능 저하를 최소화하면서 그래픽처리장치(GPU) 메모리 사용량을 낮추는 연구 논문이 세계적인 AI 학술대회 '뉴립스(NeurIPS) 2026' 메인트랙에 채택됐다고 1일 밝혔다. 채택 논문은 '멀티모달 대규모 언어모델을 위한 모달리티 인지 전문가 프루닝(Modality-Aware Expert Pruning for MoE-Based Multimodal Large Language Models)'이다. 이번 연구는 텍스트와 이미지 등 다양한 정보를 함께 처리하는 멀티모달 AI에 맞춰 '전문가 프루닝' 기술을 고도화한 것이다. 전문가혼합(MoE) 모델에서 일부 전문가 모듈을 제거할 때 언어와 이미지 이해 능력을 함께 고려해 모델 성능과 구동 효율을 균형 있게 확보하는 것이 핵심이다. 성능 평가에서는 약 310억 파라미터 규모의 멀티모달 모델에서 전문가 모듈을 25% 제거했을 때 원본 성능의 98%를 유지했다. 전문가 모듈을 50% 제거한 경우에도 91%의 성능을 유지했으며 GPU 메모리 사용량은 58기가바이트(GB)에서 31GB로 약 47% 줄었다. 40GB 메모리를 갖춘 GPU 한 장으로도 모델을 구동할 수 있는 수준을 확보했다고 노타는 설명했다. 이는 최신 AI 모델을 도입할 때 고사양 GPU를 추가하는 대신 소프트웨어 최적화를 통해 기존 AI 인프라의 활용도를 높일 수 있다는 의미다. 모델 구동에 필요한 메모리를 줄이면 같은 GPU 자원에서 활용할 수 있는 모델의 범위를 넓히거나 여유 자원을 다른 모델과 서비스에 배분할 수 있다. 노타는 이번 기술을 자사의 AI 최적화 플랫폼 '넷츠프레소'에 반영해 멀티모달과 MoE 모델 지원 역량을 강화할 계획이다. 텍스트 중심에서 이미지와 영상, 음성 등을 함께 처리하는 멀티모달 AI 모델로 시장이 확대되는 만큼 넷츠프레소의 지원 모델과 고객 적용 범위도 넓힌다는 구상이다. 노타는 '키미 K3'와 '솔라 오픈 2' 등 초거대 모델에 전문가 프루닝을 적용하며 최적화 경험을 축적해 왔다. 올해 ICLR와 EMNLP, ICML에 이어 NeurIPS에서도 연구 성과를 인정받았다. 채명수 노타 대표는 "초거대 언어모델에서 축적해 온 최적화 역량을 멀티모달 AI까지 확대하는 중으로 최신 연구 성과를 넷츠프레소에 지속적으로 반영하고 있다"며 "AI 모델이 커지고 복잡해질수록 기업이 보유한 GPU와 AI 인프라를 보다 효율적으로 활용할 수 있도록 지원하는 최적화 기술의 가치도 커질 것"이라고 말했다.

2026.10.01 11:27이나연 기자

AI 모델 성능만으론 부족…CTO들이 꼽은 경쟁력은 최적화

국내 주요 기술기업의 최고기술책임자(CTO)들이 인공지능(AI) 에이전트 확산으로 AI 산업의 경쟁 축이 단순 모델 성능에서 추론 비용과 인프라 효율성으로 빠르게 이동할 것이란 전망을 내놨다. AI 반도체와 모델이 다양해지면서 특정 하드웨어의 성능만 높이기보다 모델부터 반도체, 소프트웨어, 실제 워크로드까지 함께 최적화하는 역량이 중요해질 것이란 분석이다. 이진원 하이퍼엑셀 CTO는 29일 서울 코엑스에서 열린 래블업 기술 컨퍼런스 'lab | up > /conf/6'에서 "AI 시장의 무게중심이 학습에서 추론으로 빠르게 이동하고 있다"며 "추론 시장에서는 결국 비용을 얼마나 절감할 수 있느냐가 중요하다"고 밝혔다. 그는 AI 활용처가 늘어날수록 단일 반도체가 모든 요구를 충족하기 어려워질 것으로 내다봤다. 빠른 응답 속도가 필요한 서비스가 있는 반면, 비용 효율성이 중요한 서비스도 있어 워크로드에 따라 필요한 반도체와 인프라 구성이 달라진다는 설명이다. 이 CTO는 "AI 반도체는 속도와 전력 효율, 비용 등 모든 지표를 동시에 최고 수준으로 끌어올리기 어렵다"며 "각 요소가 트레이드오프 관계에 있는 만큼 목표로 하는 AI 서비스에 맞춰 전략적으로 선택해야 한다"고 말했다. AI 모델 개발 단계에서도 추론 최적화가 핵심 과제로 떠오르고 있다. 이활석 업스테이지 CTO는 엔비디아·AMD·퓨리오사AI 등 서로 다른 AI 반도체를 활용하면서 범용적인 최적화만으로는 한계가 있다고 설명했다. 모델이 실제 어떤 서비스에서 어떻게 사용되는지까지 파악해야 하드웨어 성능을 제대로 끌어낼 수 있다는 진단이다. 이활석 CTO는 "애플리케이션 정보가 칩까지 흘러가야 경쟁력이 생길 수 있다"며 "워크로드 성격부터 고객의 특성, 칩의 특성까지 각 레이어를 연결해 AI를 최적화해야 한다"고 말했다. 모델과 반도체 사이를 연결하는 최적화 기술의 역할도 커질 전망이다. 김태호 노타AI CTO는 데이터 보안과 비용, 특정 업무에 특화된 AI 수요 등으로 향후 AI 생태계가 더욱 다변화될 것으로 내다봤다. 다양한 모델을 서로 다른 AI 반도체에서 효율적으로 구동할 수 있도록 연결하는 기술이 중요해진다는 설명이다. 그러면서 AI가 기존 기술을 조합해 모델을 최적화하는 능력은 빠르게 향상되고 있지만, 새로운 모델 구조와 워크로드에 맞는 최적화 기법을 만드는 데는 여전히 한계가 있다고 봤다. 인프라 운영 단계에선 서로 다른 하드웨어와 워크로드의 조합이 급증하는 양상이 새로운 병목으로 꼽혔다. 김준기 래블업 CTO는 오케스트레이션 미들웨어가 하위의 다양한 하드웨어와 상위의 워크로드·애플리케이션을 연결해야 하는 만큼 지원해야 할 조합 자체가 빠르게 늘어나고 있다고 짚었다. 김 CTO는 "AI 하드웨어와 워크로드가 다양해지면서 이를 연결해야 하는 조합도 빠르게 늘고 있다"며 "결국 얼마나 다양한 조합과 실제 서비스 환경, 사용자 시나리오에서 검증했는지가 중요해질 것"이라고 말했다. 이날 CTO들은 AI 추론 효율을 높이기 위해 어느 하나의 기술만 개선해선 한계가 있다고 입을 모았다. 모델과 소프트웨어, 메모리와 AI 반도체, 오케스트레이션에 이르는 각 영역을 실제 서비스의 특성에 맞춰 연결하는 역량이 AI 인프라 경쟁력을 좌우할 수 있다는 분석이다. 이진원 CTO는 "AI 기술이 빠르게 고도화되면서 앞으로는 AI를 위한 모델과 사람이 사용하는 모델이 서로 다른 방향으로 발전할 수 있다"며 "이를 뒷받침하는 AI 인프라 역시 용도에 따라 분리되는 시대가 올 것"이라고 전망했다.

2026.09.29 13:04한정호 기자

퀄컴, PC 프로세서 보급형까지 확대...게임·메모리 가격 관건

[마우이(미국)=지디넷코리아 전화평 기자] 퀄컴이 PC용 스냅드래곤 프로세서 라인업을 프리미엄 제품부터 보급형, 미니 PC까지 다각화하며 PC 시장 공략에 속도를 낸다. 스마트폰에 이어 PC 시장에서도 주도권을 확보하겠다는 구상이다. 기존 x86 중심 '게임 호환성'과 최근 급등한 '메모리 가격'은 해결해야 할 과제다. 니틴 쿠마르 퀄컴 제품 관리 부사장은 23일(현지시간) 미국 하와이에서 열린 '스냅드래곤 서밋 2026' 기자간담회에서 스냅드래곤 PC 시장 확장 전략과 현황을 밝혔다. 퀄컴은 2024년 스냅드래곤 X 엘리트와 플러스를 선보인 데 이어, 2026년 2세대 X2 시리즈(엘리트·엘리트 익스트림·플러스)를 공개했다. 올해는 엔트리급 PC 시장을 겨냥한 '스냅드래곤 C 시리즈'까지 추가하며 풀 스택 라인업을 완성했다. 노트북 위주였던 폼팩터도 미니 PC와 올인원 데스크톱 등으로 확장하고 있다. 쿠마르 부사장은 "스냅드래곤의 높은 전력 효율성 덕분에 낮은 발열과 전력 소비로 팬리스나 단일 팬 구조 데스크톱 제작이 가능해졌다"며 "레노버와 에이수스 등 주요 OEM들이 미니 PC와 올인원 제품을 시장에 선보이고 있다"고 말했다. 공격적 라인업 다각화 후 퀄컴이 넘어야 할 첫 번째 산은 '게임 호환성'이다. 리그 오브 레전드(LoL), 배틀그라운드 등 국내외 주요 대중 게임 상당수가 x86 아키텍처에 최적화돼 있어, Arm 기반 윈도 PC 구매를 주저하게 만드는 주요 원인으로 지목되기 때문이다. 퀄컴은 하드웨어 성능 강화와 전담 조직 운영으로 정면 돌파한다는 계획이다. 최상위 라인업인 스냅드래곤 X2 엘리트 익스트림은 전작 대비 그래픽 성능을 약 2배 수준으로 향상시켰다. 쿠마르 부사장은 "내부 전담 게이밍 팀과 스냅드래곤 스튜디오를 통해 주요 AAA 게임 개발사들과 최적화 작업 중"이라며 "다수의 대작 타이틀과 안티치트(Anti-cheat) 솔루션 지원을 확대하고 있으며, 배터리 환경에서도 높은 전력효율을 바탕으로 장시간 게임 구동이 가능한 점이 강점"이라고 강조했다. 온디바이스 인공지능(AI) 구동을 위한 고용량 D램 탑재 필수화로 급등한 '메모리 가격' 역시 제조원가와 판매가에 부담을 안기고 있다. 퀄컴은 이에 대해 '공급망 선택지 확대'와 '소프트웨어 최적화'를 해법으로 제시했다. 쿠마르 부사장은 "D램과 스토리지 가격 상승이 PC 산업 전반에 부담을 주는 것은 사실"이라며 "OEM이 다양한 메모리 용량과 여러 공급업체를 유연하게 선택할 수 있도록 지원하고 있다"고 밝혔다. 이어 "마이크로소프트 등과 협력해 소프트웨어 스택을 최적화함으로써 8GB 등 상대적으로 적은 메모리 환경에서도 우수한 AI PC 경험을 제공하는 데 집중하고 있다"고 덧붙였다. 퀄컴은 차세대 PC 시장 핵심 동력으로 '에이전틱 AI'를 꼽았다. 쿠마르 부사장은 "AI 에이전트가 사용자 행동 패턴을 파악해 업무를 선제 수행하는 방식으로 컴퓨팅 경험이 변화하고 있다"며 "생산성과 콘텐츠 제작 등 다양한 AI 활용사례가 누적되면서 점진적인 PC 교체 수요를 이끌 것"이라고 전망했다.

2026.09.27 09:00전화평 기자

조선소 작업장 효율 높일 해법 겨뤘다…LG CNS, 글로벌 최적화 경연 성료

LG CNS가 제한된 자원 안에서 가장 효율적인 답을 찾는 '수학적최적화' 인재 발굴에 나섰다. 올해 대회에는 전 세계 55개국에서 1400명이 넘는 참가자가 몰려 조선소의 복잡한 블록 배치 문제를 알고리즘으로 풀었다. LG CNS는 대한산업공학회와 공동 개최한 '최적화 그랜드 챌린지 2026'을 마무리하고 시상식을 열었다고 20일 밝혔다. LG CNS는 수학적최적화 분야 저변을 넓히기 위해 2024년부터 매년 대회를 개최하고 있다. 수학적최적화는 주어진 자원과 조건 안에서 가능한 경우의 수를 계산해 가장 효율적인 해법을 찾는 기술이다. AI와 양자컴퓨팅·로봇 등 다양한 산업에서 복잡한 의사결정을 지원하는 기반 기술로 활용된다. 올해는 미국과 영국·중국·일본·독일·인도 등 55개국에서 958개팀 1448명이 참가했다. 지난해 343개팀 676명과 비교하면 팀 수는 약 2.8배, 참가자는 두 배 이상 늘었다. 카네기멜론대와 임페리얼 칼리지 런던·스탠퍼드대·도쿄대 등 해외 대학을 비롯해 서울대·카이스트·포항공대 학생들이 참가했다. 액센추어와 IBM·삼성전자·현대자동차 등 국내외 기업의 현직 전문가들도 경쟁에 참여했다. 올해 참가자들이 풀어야 할 문제는 조선소의 '블록 배치 최적화'였다. 초대형 선박을 만들 때 각각 제작한 수백 개의 대형 블록을 제한된 작업장 안에 언제 어디에 어떤 방향으로 배치할지 결정하는 문제다. 블록마다 크기와 모양이 다른 데다 공정 순서와 납기까지 고려해야 한다. 참가자들은 작업장 공간을 적게 사용하면서도 생산 일정에 차질이 생기지 않도록 배치하는 알고리즘을 설계했다. 수학적최적화는 이처럼 사람이 일일이 모든 경우의 수를 비교하기 어려운 산업 현장에서 생산계획과 물류·설비 운영을 효율화하는 데 활용된다. 불필요한 재고와 이동 시간을 줄이고 한정된 자원을 보다 효율적으로 배분할 수 있다. LG CNS는 실제 국내 대형 제조사의 생산계획에 수학적최적화를 적용해 물류창고를 거치는 재고를 57% 줄였다고 밝혔다. 생산 속도가 달라 창고에 쌓이던 에어컨 실내기와 실외기의 생산 일정을 맞춰 수억원 규모의 비용 절감 효과를 냈다는 설명이다. 이밖에도 철강사의 자재 적재와 크레인 운용 일정, 공항 로봇의 이동·충전 경로, 조선사의 도장 작업 계획 등에 수학적최적화를 적용하고 있다. LG CNS는 조선과 방산·철강·물류·제조·금융·항공 등에서 200건이 넘는 관련 과제를 수행했다. 예선과 본선을 통과한 상위 6개팀은 한국에서 열린 결선에서 자신들의 알고리즘을 직접 발표했다. 최종 대상은 일본 참가팀이 차지했으며 LG CNS는 대상을 포함한 20개팀에 총 2억원의 상금을 수여했다. 상위 10개팀이 제출한 알고리즘은 오픈소스로 공개한다. 대회에서 나온 다양한 문제 해결 방식을 학계와 산업계가 활용할 수 있도록 공유한다는 취지다. 박상균 LG CNS 엔트루 부문장 전무는 "한정된 자원으로 최고의 효율을 끌어내는 일은 무척 복잡하고 어렵지만 수학적최적화로 풀어낼 수 있다"며 "앞으로도 대회를 키워 전 세계 인재들과 함께 최적화 기술의 지평을 넓혀가겠다"고 말했다.

2026.09.20 10:00김동원 기자

노타, LG전자·모빌린트와 NPU 기반 휴머노이드 두뇌 최적화

노타가 LG전자, 모빌린트와 함께 국산 신경망처리장치(NPU) 기반 휴머노이드 개발에 나선다. 노타는 산업통상부와 한국산업기술기획평가원(KEIT)이 추진하는 'K-온디바이스 인공지능(AI) 반도체 기술개발 사업' 휴머노이드 분야 3세부 과제 주관기관으로 선정됐다고 8일 밝혔다. 이 사업은 국산 온디바이스 AI 반도체를 활용해 복잡한 일상 공간에서 주변 환경을 인식하고 인간 수준의 작업을 수행하는 자율형 휴머노이드를 개발하는 것이 목표다. LG전자가 전체 사업을 총괄하고 휴머노이드 시스템 개발을 맡는다. 모빌린트는 국산 NPU를 담당할 예정이다. 노타는 AI 모델을 NPU와 실제 로봇 환경에 맞춰 최적화하는 소프트웨어를 맡는다. 노타는 특히 휴머노이드에 탑재되는 비전언어행동모델(VLA)을 경량화하고 모빌린트 NPU에 맞춰 최적화해 로봇 내부에서 빠르고 효율적으로 구동되도록 하는 핵심 소프트웨어 기술을 담당한다. 토큰 압축과 양자화, 프루닝, 지식증류, 레이어별 최적화 등을 적용해 모델 성능 저하를 최소화하면서 크기와 연산량, 메모리 사용량을 줄일 계획이다. 채명수 노타 대표는 "모바일, 엣지, 데이터센터 등 다양한 환경에서 AI 모델과 하드웨어를 효율적으로 연결해 온 기술력을 바탕으로 로봇과 자동차, 산업장비 등 피지컬 AI 전반에 기술 적용과 사업 기회를 확대하겠다"고 말했다.

2026.09.08 15:56이나연 기자

오리엔텀·소프트웨어큐 "금융 양자컴퓨팅 툴체인 공동 개발"

양자컴퓨팅 소프트웨어 전문기업 오리엔텀(대표 방승현)은 캐나다 양자 소프트웨어 기업 소프트웨어큐(softwareQ)와 금융·은행·보험 분야 양자 및 양자 영감(quantum-inspired) 컴퓨팅을 공동개발하기로 했다고 14일 밝혔다. 양사는 이를 위해 양해각서(MOU)를 교환했다. MOU에는 한국(서울)과 캐나다(온타리오주 워털루)를 거점으로, 실제 금융 현장에 즉시 적용 가능한 양자 알고리즘과 이를 뒷받침할 소프트웨어 툴체인(toolchain)을 공동 개발·검증하는 내용을 담았다. 방승현 대표는 "단순한 기술 교류를 넘어 기술적 실현 가능성 검증, 개념검증(PoC)·프로토타입 개발, 후속 공동사업 발굴까지 이어지는 실질적 협력 체계를 가동할 것"이라고 말했다. 방 대표는 또 "캐나다 지역 양자 금융 시장 진입을 위한 교두보를 확보한 셈"이라며 "북미 등으로 양자 분야 비지니스 기회를 지속 확대해 나갈 것"이라고 덧붙였다. 핵심 협력 분야는 크게 4개로 ▲몬테카를로 및 양자 진폭 추정 접근법을 포함한 파생상품 가격 책정 ▲포트폴리오 최적화 및 리스크 관리 ▲은행·보험 머신러닝( QML) ▲양자 회로·알고리즘의 컴파일, 최적화, 시뮬레이션, 벤치마킹 및 리소스 추정 등 고도화다. 오리엔텀은 금융·은행·보험 도메인에 대한 이해와 실제 비즈니스 활용 사례, 그리고 양자 및 양자 영감 알고리즘 개발 역량을 제공한다. 현재 파생상품·옵션 프라이싱, 포트폴리오 최적화, 리스크 분석을 위한 자체 양자 금융 알고리즘을 개발·검증하고 있다. 소프트웨어큐는 양자 소프트웨어 엔지니어링, 양자 컴파일과 회로 최적화, 양자 알고리즘 구현, 시뮬레이션 및 리소스 추정 분야에서 강점이 있다. 대표 솔루션으로는 양자 컴파일러 '스택', 시뮬레이션 라이브러리 '퀀텀++', 플랫폼 '액세스' 등을 보유했다. 방승현 대표는 “파생상품 프라이싱과 리스크 관리 알고리즘을 오늘날 가장 앞선 양자 소프트웨어 툴로 벤치마킹하고, 연구 단계에서 은행·보험 파트너를 위한 실제 현장 적용으로 더 빠르게 나아갈 수 있게 됐다”고 밝혔다. 블라드 게오르기우 소프트웨어큐 대표는 "보유한 솔루션을 실제 파생상품 프라이싱과 리스크 관리 워크로드에 적용, 연구실 밖에서도 안정적으로 작동하는 양자 소프트웨어를 지속 구축해 나갈 것”이라고 말했다.

2026.08.14 10:28박희범 기자

노타, 업스테이지 '솔라 오픈2' GPU 8장→2장으로 줄였다

노타가 정부의 '독자 AI 파운데이션 모델(독파모)' 프로젝트에서 엔비디아 H100 그래픽처리장치(GPU) 8장이 필요했던 업스테이지의 차세대 모델을 2장만으로 구동할 수 있도록 최적화하는 데 성공했다. 노타는 독파모 사업 내 업스테이지 컨소시엄에서 2차수 성과물인 '솔라 오픈2' 전용 경량화 모델을 글로벌 AI 플랫폼인 허깅페이스에 공개했다고 27일 밝혔다. 솔라 오픈2는 문서 업무와 코딩, 툴 호출, 다단계 추론 등 실제 기업 업무에 활용할 수 있는 에이전트 AI 구현에 초점을 맞춘 거대언어모델이다. 총 2500억 개의 매개변수(파라미터) 규모로, 실제 작업 시에는 필요한 150억 개만 활성화하는 전문가 혼합(MoE) 구조를 채택했다. 이를 통해 토큰 사용량이 많은 에이전트 업무에서도 효율적인 운영이 가능하게 했다. 노타는 솔라 오픈2 연산 효율을 실제 기업 환경에서의 배포 효율을 극대화하기 위해 ▲데이터 기반 MoE 양자화 ▲라우터 인지형 MoE 양자화 ▲비균일 전역 프루닝 기술을 적용했다. 데이터 기반 MoE 양자화에는 모델 가중치를 INT4 또는 NVFP4 기반의 4비트 저정밀 형식으로 변환하면서도 모든 전문가 모듈이 안정적인 통계치를 확보할 수 있도록 캘리브레이션 데이터를 합성하는 기술인 'PASCAL-MoE'를 활용했다. '라우터 인지형 MoE 양자화'에는 양자화 이후에도 라우터의 전문가 선택이 안정적으로 유지되도록 설계한 자체 양자화 알고리즘을 적용했다. 중요도가 낮은 전문가 모듈을 선택적으로 제거하는 '비균일 전역 프루닝 기술'도 도입했다. 결과적으로 노타는 모델 가중치를 4비트 형식으로 변환하고 중요도가 낮은 연산 모듈을 선별적으로 정리해 원본 모델 가중치 메모리를 500.6 기가바이트(GB)에서 117.8 GB로 약 76.5% 감축하는 데 성공했다. 메모리 용량 기준으로 엔비디아 H100 GPU 8장이 필요했던 원본 모델을 2장 환경에서도 구동할 수 있도록 최적화했다는 설명이다. 특히 양자화 이후에도 솔라 오픈2의 에이전트 AI 핵심 기능인 툴 호출이 안정적으로 유지됐다. 김태호 노타 최고기술책임자(CTO)는 "이번 성과는 대규모 MoE 모델을 기업이 실제 도입할 수 있는 형태로 최적화했다는 데 의미가 있다"며 "기업이 자사 인프라와 예산에 맞춰 에이전트 AI를 도입하고 활용 범위를 확장할 수 있도록 모델 구조와 하드웨어 환경에 최적화된 양자화 및 경량화 기술을 고도화하겠다"고 말했다.

2026.07.27 10:43이나연 기자

오리엔텀 "이탈리아 링크스 재단과 양자기술 개발 업무협약"

양자 컴퓨팅 소프트웨어 전문 기업 오리엔텀(대표 방승현)은 이탈리아 링크스 재단(LINKS)과 금융 서비스, 은행 및 보험 분야에서 양자 및 양자 영감 컴퓨팅 연구개발을 공동 모색하기 위한 업무협약(MoU)을 체결했다고 20일 밝혔다. 이 협약은 양자 컴퓨팅, 양자 알고리즘 기술, 그리고 초고성능 컴퓨팅-양자 하이브리드(HPC–퀀텀) 워크플로우가 복잡한 금융 애플리케이션의 플랫폼 기술을 어떻게 해결할 수 있는지를 공동 평가하기 위해 이루어졌다. 양사는 ▲파생상품 및 옵션 가격 결정: 몬테카를로 기법 및 양자 진폭 증폭 추정 ▲포트폴리오 최적화 및 리스크 관리: 제약 조건이 있는 조합 최적화, 최적의 포트폴리오 청산 및 실행, 리스크 분석 ▲은행 및 보험용 머신러닝 애플리케이션: 이상 거래 탐지 및 상품 추천 등의 유스케이스를 위한 양자 및 양자 영감 머신러닝 등에서 협력 방안을 찾을 계획이다. 양사는 이외에 양자 기술과 관련한 실현 가능성을 평가하고, 개념 증명(PoC) 및 시제품을 개발하기로 했다. 추가적인 공동 이니셔티브 기회도 발굴한다. 이와함께 △금융 유스케이스 및 벤치마킹 방법론 정의 △알고리즘 및 소프트웨어 설계·테스트 △과학 및 기술 지식 교류 △지역·국가·국제 연구비 지원 프로그램 참여 모색 등의 협력도 구체적으로 논의할 계획이다. 방승현 대표는 "스마트 그리드, 에너지 시스템 및 관련 분야를 위한 양자 컴퓨팅 및 양자 최적화 기술의 연구·개발·적용 분야에서도 추가적인 협력이 검토되고 있다"고 덧붙였다. 방 대표는 "한-유럽 공동 연구 이니셔티브를 포함한 양자, 다자간 및 국제 연구비 지원 프로그램 하에 공동 연구 제안서 및 혁신 프로젝트를 발굴하고 개발, 제출할 수 있도록 상호 지원할 예정"이라며 "전문 지식 교류나 공동 논문 발표, 기술 개발, 연구원 교류 및 워크숍 개최 등이 포함될 것"이라고 언급했다. 링크스 재단은 첨단 컴퓨팅, 고성능 컴퓨팅(HPC), 양자 컴퓨팅 및 시뮬레이션, 양자 머신러닝, 하이브리드 HPC-양자 워크플로우 분야 기술력을 보유했다. 오리엔텀은 금융, 은행 및 보험 분야에 대한 지식과 함께 금융 애플리케이션을 위한 양양자 알고리즘 기술 개발 역량을 갖췄다. 방승현 대표는 "현재 양자 컴퓨터의 하드웨어적 한계를 극복하고 실제 산업 현장에 적용 가능한 개념 증명(PoC) 및 시제품 개발을 가속화할 것"으로 예상했다.

2026.07.20 16:31박희범 기자

SAP 클라우드 전환 비용 줄인다…ATNS, 라이선스 관리 솔루션 '콕핏' 공개

SAP 클라우드 전사적자원관리(ERP) 'S/4HANA' 전환이 확산되는 가운데, ATNS그룹이 라이선스 비용 최적화 솔루션을 선보이며 시장 공략에 나섰다. 사용자 권한을 분석해 불필요한 라이선스 비용을 줄이고 전환 이후에도 지속적인 비용 관리가 가능하도록 지원한다는 전략이다. ATNS는 SAP S/4HANA 클라우드 라이선스 비용 최적화 솔루션 '라이선스 매니지먼트 콕핏'을 출시했다고 20일 밝혔다. 이는 SAP 컨설팅과 운영 노하우를 바탕으로 자체 개발한 솔루션으로, 기업이 SAP 클라우드 전환 과정에서 발생하는 라이선스 비용 부담을 줄이는 데 초점을 맞췄다. 최근 기업들은 인공지능(AI) 활용 기반을 마련하기 위해 기존 온프레미스 SAP ERP를 SAP S/4HANA 클라우드로 전환 중이다. 하지만 ATNS에 따르면 S/4HANA는 사용자 수가 아닌 업무 범위와 권한 수준을 '전체 사용 등가 단위(FUE)'로 환산해 라이선스 규모를 산정하는 방식이다. 권한 관리가 제대로 이뤄지지 않으면 예상보다 많은 비용이 발생할 수 있다는 설명이다. 특히 장기간 운영된 SAP 시스템은 미사용 권한과 과도하게 부여된 역할이 누적된 경우가 많은 것으로 평가된다. 이를 정비하지 않은 채 클라우드로 전환하면 실제 업무와 관계없이 높은 FUE가 산정돼 불필요한 라이선스 비용을 지속 부담할 수 있다는 지적이 나온다. ATNS는 조직 개편이나 인수합병, 신규 업무 추가에 따라 권한이 계속 변화하는 만큼 전환 이후에도 지속적인 관리가 필요하다고 짚었다. 이번 출시한 콕핏은 SAP 시스템에 등록된 전체 사용자와 권한을 분석해 FUE로 자동 환산하고 전체 라이선스 규모와 계약 대비 사용률, 사용자 등급 분포, 라이선스 초과 가능성을 단일 화면에서 확인할 수 있도록 지원한다. 비용 증가 원인을 사용자 단위까지 추적해 어떤 역할과 권한이 비용 상승을 유발하는지 분석하고 정비 대상도 식별한다. 권한 변경 전 예상 비용을 확인할 수 있는 '왓이프 시뮬레이션' 기능도 제공한다. 관리자는 권한 회수나 역할 재설계 시 전체 FUE와 예상 라이선스 비용 변화를 사전에 확인할 수 있으며 모든 분석은 고객사 SAP 시스템 내부에서 수행돼 사용자·권한 정보가 외부로 반출되지 않는 것이 특징이다. ATNS는 실제 고객 프로젝트에서 콕핏을 활용해 업무와 권한 간 불일치를 분석하고 역할 체계를 재설계한 바 있다. 그 결과 기존 750 FUE로 예상됐던 라이선스 규모를 200 FUE로 낮춰 연간 예상 라이선스 구독 비용을 약 75% 절감했다고 설명했다. 이우헌 ATNS 대표는 "SAP 클라우드 전환은 기업 업무 방식을 혁신하고 비용 구조를 효율적으로 재배치해 AI와 지속적인 혁신을 수용할 수 있는 경영 기반을 만드는 과정"이라며 "전환 과정에서 권한 재정비가 선행되지 않으면 과거 복잡성과 비용 부담이 새로운 시스템으로 그대로 이전되므로, 이를 통한 비용 최적화가 클라우드 전환에 반드시 선행돼야 한다"고 말했다. 이어 "앞으로 SAP 전환 성패는 구축 완료 시점이 아니라, 이후에도 변화하는 조직과 업무에 맞춰 권한과 비용을 얼마나 지속적으로 통제할 수 있느냐에 따라 갈릴 것"이라며 "콕핏을 시작으로 SAP 고객이 전환 이후에도 운영 효율을 유지할 수 있는 비용 최적화 서비스와 솔루션을 지속 확대하겠다"고 덧붙였다.

2026.07.20 13:59한정호 기자

AWS 공인 파트너 '노타', AI칩 최적화 서비스 출시

노타가 아마존웹서비스(AWS)와 함께 모바일(삼성), 반도체 IP(Arm), 데이터센터(퓨리오사AI), 엣지(모빌린트)에 이어 클라우드까지 인공지능(AI) 모델 경량화 사업 영역을 넓힌다. 노타는 AWS 공인 파트너 자격으로 트레이니움을 포함한 AWS AI 칩 환경에서 고객 AI 모델 경량화 및 튜닝 서비스를 제공한다고 7일 밝혔다. 노타는 이번 협력으로 자사 플랫폼 '넷츠프레소' 기반 AI 모델 튜닝 서비스를 출시한다. 대규모 AI 모델 학습에서 토큰 경제성을 제공하는 AWS 트레이니움과 고성능 추론을 낮은 비용으로 제공하는 AWS 인퍼런시아 도입을 검토하는 기업 고객이 대상이다. 넷츠프레소는 AI 모델 크기를 최대 90% 이상 축소하면서도 정확도를 유지할 수 있는 경량화·배포 자동화 플랫폼이다. 서비스는 기술검증(PoC) 및 진단, 모델 포팅 및 경량화, 성능 튜닝 단계로 구성된다. 노타는 AWS 트레이니움 및 인퍼런시아 환경에서 대규모언어모델(LLM) 튜닝 경험을 축적해왔다. 320억 개 파라미터 규모의 고성능 언어 모델에 경량화 기술을 적용해 모델 크기를 68% 줄이면서도 정확도 손실을 1% 미만으로 유지하는 성과를 달성했다. 채명수 노타 대표는 "고객이 뛰어난 가격 대비 성능을 제공하는 AWS AI 칩 성능을 자사 모델에서 온전히 활용할 수 있도록 모델 튜닝을 지원한다"며 "AWS AI 칩 기반 인프라 도입을 검토하는 기업 고객에게 실질적인 비용 효율화 성과를 제공하겠다"고 강조했다.

2026.07.07 16:53이나연 기자

[유미's 픽] "엔비디아 쿠다 장벽 넘자"…AI 반도체, SW 경쟁 불붙었다

인공지능(AI) 반도체 기업들이 잇따라 모델 최적화 소프트웨어 역량 확보에 나서고 있다. 칩 설계만으로는 AI 인프라 경쟁에서 우위를 점하기 어려워지면서 한정된 컴퓨팅·메모리 자원으로 더 많은 연산을 처리하는 소프트웨어 기술의 가치가 부각되는 분위기다. 퀄컴은 지난달 24일 AI 소프트웨어 기업 모듈러를 약 40억 달러 규모 주식 거래로 인수하겠다고 발표했다. 모듈러는 AI 모델을 다양한 칩에서 실행할 수 있도록 돕는 소프트웨어 기업이다. 로이터는 이번 인수가 퀄컴을 엔비디아 '쿠다(CUDA)'와 경쟁하는 소프트웨어 플랫폼 경쟁에 올려놓는 움직임이라고 평가했다. 국내에서도 비슷한 흐름이 나타났다. AI 반도체 기업 리벨리온은 지난달 30일 AI 추론 최적화 기업 스퀴즈비츠 인수를 발표했다. 스퀴즈비츠는 대형 AI 모델을 더 적은 연산·메모리 자원으로 구동하기 위한 모델 압축과 양자화, 추론 최적화 기술을 보유한 기업이다. 리벨리온은 이번 인수를 통해 신경망처리장치(NPU) 하드웨어와 소프트웨어 최적화, 추론 서빙을 함께 제공하는 통합 AI 인프라 기업으로 사업 범위를 넓힌다는 계획이다. 업계 관계자는 "AI 반도체 기업 입장에선 자체 칩 위에서 고객 모델을 빠르고 안정적으로 실행시키는 역량이 영업 경쟁력과 직결된다"며 "칩을 공급하는 데 그치지 않고 실제 워크로드 성능까지 입증해야 하는 수요가 커진 셈"이라고 설명했다.AI 모델 최적화 기업 노타도 같은 날 퓨리오사AI의 데이터센터용 NPU 환경에서 LG AI연구원의 엑사원 236B 최적화 결과를 공개해 주목받았다. 엑사원 236B는 약 2360억 개 파라미터 규모의 대형 AI 모델로, 노타는 모델 크기를 약 71% 줄이면서도 주요 평가 항목에서 원본과 유사한 수준의 정확도를 유지했다. 데이터센터 인프라 최적화 기업 망고부스트도 AI 실행 효율 경쟁의 한 축으로 꼽힌다. 망고부스트는 데이터처리장치(DPU)를 앞세워 네트워킹·스토리지·보안 등 데이터센터 인프라 작업을 중앙처리장치(CPU)에서 분리하는 기술을 개발해왔다. AI 모델 자체를 줄이는 방식은 아니지만 GPU와 서버 자원을 AI 연산에 더 집중시키는 구조라는 점에서 모델 최적화 기업들과 같은 수요를 겨냥하고 있다는 평가를 받는다. 이처럼 AI 반도체 시장에서 성능 최적화 소프트웨어 기업들이 주목받게 된 것은 생성형 AI 활용 방식이 달라지면서 모델 실행 능력이 더욱 중요해지고 있어서다. 대형언어모델(LLM)이 단순 실험 단계를 넘어 서비스와 업무 시스템에 적용되면서, 기업들은 칩의 이론 성능보다 실제 운영 환경에서 응답 속도와 처리량을 유지하면서 비용을 낮추는 역량을 더 중시하고 있다. 하지만 모델 규모가 커질수록 기업들의 비용 부담은 갈수록 늘어나는 추세다. 특히 LLM은 파라미터 규모가 클수록 추론 과정에서 많은 메모리와 연산 자원을 필요로 한다. 여기에 긴 문맥 처리, 검색증강생성(RAG), AI 에이전트처럼 반복 호출이 많은 서비스가 늘면서 데이터 이동량과 지연시간 관리 부담도 함께 증가하고 있다. 이로 인해 메모리 효율도 AI 인프라 경쟁의 핵심 변수로 떠오르고 있다. 고성능 메모리 확보 경쟁이 이어지고 있지만 모든 기업이 충분한 GPU와 메모리를 확보하기는 어렵다. 같은 하드웨어라도 모델 압축, 양자화, 컴파일러, 런타임, 추론 서빙 구조에 따라 필요한 서버 수와 운영비가 달라질 수 있어 최적화 소프트웨어의 중요성이 커지고 있다.엔비디아가 GPU 시장에서 구축한 소프트웨어 생태계도 반도체 기업들의 움직임을 자극하고 있다. 엔비디아는 GPU 성능뿐 아니라 쿠다를 중심으로 한 개발자 생태계와 소프트웨어 도구를 앞세워 AI 인프라 시장에서 우위를 확보했다. 이에 후발 AI 반도체 기업들은 하드웨어 성능만으로 고객을 설득하기 어려워졌고, 모델 실행과 개발 편의성을 함께 제시해야 하는 압박을 받고 있다. 국내 기업들도 이 같은 구도 변화에 맞춰 전략을 조정하고 있다. 리벨리온은 스퀴즈비츠 인수로 NPU와 최적화 소프트웨어 결합에 나섰고, 퓨리오사AI는 노타와 협력해 대형 모델의 NPU 구동 가능성을 넓히고 있다. 망고부스트는 DPU 기반 인프라 오프로딩으로 데이터센터 내부 병목을 줄이는 방식으로 AI 실행 효율 경쟁에 참여하고 있다. 업계에선 AI가 데이터센터를 넘어 산업 현장으로 확산될수록 최적화 수요가 더 커질 것으로 예상했다. 자동차, 로봇, 제조 설비 등은 전력과 지연시간, 보안 요건이 데이터센터와 다른 만큼, 범용 모델을 그대로 배포하기보다 각 산업과 칩 환경에 맞게 조정하는 역량이 AI 인프라 기업의 경쟁력이 될 것으로 보인다. 이 같은 분위기 속에 AI 반도체 시장이 하드웨어 공급 경쟁을 넘어 소프트웨어 스택 경쟁으로 재편될 가능성도 높아지고 있다. 특히 칩 설계, 모델 최적화, 런타임, 추론 서빙, 인프라 오프로딩을 촘촘하게 묶어 제공하는 기업이 고객 확보에서 유리한 위치를 차지할 것으로 전망된다. 업계 관계자는 "AI 반도체 기업이 고객을 설득하려면 벤치마크 수치뿐 아니라 실제 모델을 자사 칩에서 얼마나 효율적으로 돌릴 수 있는지를 제시해야 한다"며 "소프트웨어 최적화 역량이 없는 칩은 데이터센터와 산업 현장에서 채택 속도가 느릴 수밖에 없다"고 말했다. 그러면서 "AI 인프라 비용 부담이 커질수록 기업들은 같은 서버 자원으로 더 많은 추론을 처리할 수 있는 기술을 찾게 된다"며 "앞으로 AI 반도체 경쟁력은 칩 성능과 함께 모델 최적화, 메모리 효율, 데이터센터 운영 효율을 함께 제공할 수 있느냐에 따라 갈릴 것"이라고 덧붙였다.

2026.07.01 10:53장유미 기자

리벨리온, 스퀴즈비츠 전격 인수…풀스택 AI 인프라 기업 진화

국내 대표 AI 반도체 기업 리벨리온이 소프트웨어 최적화 전문 스타트업을 품으며 하드웨어와 소프트웨어를 아우르는 통합 AI 인프라 기업으로의 전환을 선언했다. 리벨리온은 AI 추론 최적화 전문기업 스퀴즈비츠를 인수한다고 30일 밝혔다. 이번 인수로 스퀴즈비츠는 리벨리온의 100% 자회사가 된다. 인수는 신주 발행을 통해 진행됐다. 리벨리온이 스퀴즈비츠 주주들이 가진 지분을 가져올 때, 리벨리온의 신주를 기존 주주들에게 나눠주는 방식이다. 리벨리온 관계자는 "카카오벤처스 등 주주들이 겹치는 경우가 많아서 인수 과정에 큰 문제는 없었다"고 말했다. 양사의 공통된 주주로는 카카오벤처스, 네이버D2SF, 신한캐피탈 등이 있다. 한편 양사는 지난 2024년부터 리벨리온 NPU 기반의 모델 경량화 기술 및 전용 소프트웨어를 공동 개발하며 협력을 이어온 바 있다. 국내 개발자 커뮤니티를 대상으로 추론 최적화 오픈소스인 'vLLM' 관련 행사와 워크숍을 공동 개최하며 오픈소스 AI 생태계 활성화를 주도하기도 했다. 이번 인수를 통해 리벨리온은 자체 신경망처리장치(NPU) 하드웨어 기술력에 스퀴즈비츠의 소프트웨어 최적화 및 추론 서빙(Serving) 역량을 결합해, 인프라 전 구간을 시스템 레벨로 제어하는 독자적인 플랫폼 경쟁력을 확보하게 됐다. 추론 서빙은 AI 모델이 실제 서비스로 구동되는 전 과정을 의미하며 속도와 비용, 안정성을 결정짓는 핵심 파이프라인이다. 스퀴즈비츠는 AI 반도체와 딥러닝, 모델 경량화 분야의 검증된 연구자들이 모여 창업한 딥테크 스타트업이다. 다양한 하드웨어 환경에서 AI 모델의 구동 속도를 높이고 운영 비용을 낮추는 독보적인 최적화 기술을 보유하고 있다. 특히 창업 직후 인텔, 엔비디아 등 글로벌 AI 하드웨어 공룡 기업들과 협업 레퍼런스를 쌓으며 기술력을 전 세계적으로 인정받았다. 이번 인수로 리벨리온은 하드웨어부터 서비스 배포까지 엔드투엔드(End-to-End)로 제공되는 차세대 AI 인프라를 완성하게 됐다. 고객사가 AI 서비스를 구축할 때 마주하는 복잡한 최적화 프로세스 부담을 최소화하고, 가장 경제적이고 효율적인 인프라 환경을 원스톱으로 제공하겠다는 계획이다. 박성현 리벨리온 대표는 "훌륭한 인재와 기술력이 기업의 경계를 넘어 결집할 때 한국 AI 생태계에 새로운 가능성이 열린다"며 "스퀴즈비츠와 힘을 합쳐 하드웨어, 소프트웨어, 대규모 시스템을 모두 아우르는 기업으로 거듭나 글로벌 무대에서 이를 증명하겠다"고 밝혔다. 김형준 스퀴즈비츠 대표 역시 "우리의 최적화 기술이 리벨리온 NPU 생태계를 더욱 폭넓게 확장할 것"이라며 "풀스택 AI 인프라를 구현해 고객들이 리벨리온 기반에서 AI 서비스를 더욱 쉽고 경제적으로 운영할 수 있도록 지원하겠다"고 말했다.

2026.06.30 10:02전화평 기자

노타, LG CNS와 'AI 교통체계' 수출 나선다

노타가 LG CNS와 손잡고 인공지능(AI) 기반 지능형 교통 체계(ITS) 기술 글로벌 시장 공략에 나선다. 노타는 LG CNS와 AI 기반 실시간 ITS 기술 사업화를 위한 업무협약(MOU)을 체결했다고 23일 밝혔다. 노타는 AI 모델 경량화·최적화 역량을 바탕으로 엣지 환경에서도 실시간 영상 분석이 가능한 ITS 기술을 구현하고 있다. 생성형 비전언어모델(VLM) 기반 영상관제 솔루션 '노타 비전 에이전트(NVA)'를 통해 교통 흐름 분석·돌발상황 감지·보행자 및 차량 위험 상황 인식 등 교통관제 기능을 제공한다. LG CNS는 도시 교통 흐름을 정밀 분석·예측하는 도시통합운영센터(IOC)를 중심으로 글로벌 스마트시티 시장에서 다양한 ITS 프로젝트를 추진해 왔다. 양사는 노타의 ITS 기술과 LG CNS의 자체 AI 스마트시티 플랫폼을 연계해 교통 인프라 디지털 전환 수요에 공동 대응한다. 특히 미주 지역을 주요 대상 시장으로 삼아 AI 기반 ITS 프로젝트 기회를 함께 발굴할 계획이다. 양사 협력은 이미 케냐 나이로비 ITS 구축사업을 통해 구체화됐다. 노타는 지난해 LG CNS가 주관한 케냐 나이로비 교통관제센터 구축 프로젝트에서 AI 경량화·최적화 기반 스마트교차로 시스템을 엣지 환경에 맞게 구현하며 해외 ITS 사업 협력 레퍼런스를 확보했다. 채명수 노타 대표는 "우리 AI 경량화·최적화 기술이 글로벌 ITS 사업 역량을 갖춘 LG CNS와 결합해 더 큰 시장으로 확장될 계기"라며 "양사 기술과 사업 역량을 바탕으로 현장에서 활용 가능한 AI 기반 지능형 교통 체계 솔루션을 만들겠다"고 말했다.

2026.06.23 09:53이나연 기자

AI 주권, 모델 넘어 '운영' 경쟁으로 번진다

앤트로픽의 최상위 인공지능(AI) 모델에 대한 미국의 수출 통제를 계기로 AI가 국가 안보 자산으로 취급되고 있다. 기술 보유국의 정책 변화만으로 모델과 서비스 공급망이 흔들릴 수 있다는 우려가 현실화하면서, 자국 모델 기술력과 이를 효율적으로 운영할 역량이 소버린(주권) AI의 핵심 과제로 떠오르고 있다. 22일 업계에 따르면 미국 행정부는 지난 12일(현지시간) 앤트로픽 신규 모델 '클로드 미토스5'와 '클로드 페이블5'에 대한 외국 국적자의 접근을 제한하는 수출 통제 지침을 내렸다. 해외 접속뿐 아니라 미국 내 체류 중인 외국인과 앤트로픽 소속 외국인 직원의 사용까지 제한 대상에 포함되면서 파장이 커졌다. 이번 조치로 글로벌 AI 보안 협의체 '프로젝트 글래스윙'에 합류한 한국도 영향을 받게 됐다. 프로젝트 글래스윙은 앤트로픽이 '클로드 미토스 프리뷰' 공개와 함께 출범한 협의체다. 보안 취약점 탐지에 특화된 미토스의 오남용을 막기 위해 검증된 기업과 기관에 모델을 선제 제공하고 이를 통해 소프트웨어 취약점을 방어하는 방식으로 운영돼 왔다. 앤트로픽은 지난 2일(현지시간) 글래스윙 참여 대상을 15개국 약 150개 기관으로 확대했다. 국내에서는 한국인터넷진흥원(KISA), 삼성전자, SK하이닉스, SK텔레콤 등이 참여했다. 그러나 이후 미토스5와 페이블5에 대한 수출 통제가 내려지면서 국내 참여 기관들은 본격적인 모델 활용에 나서기 전부터 접근 제약에 직면했다. 업계는 이번 사태가 특정 빅테크 모델을 쓰지 못하게 된 문제에 그치지 않는다고 본다. 해외 사업자의 모델과 응용프로그램인터페이스(API), 클라우드에 의존하는 구조에서는 공급국의 정책 변화나 사업자 판단만으로 AI 서비스 운영 자체가 흔들릴 수 있기 때문이다. 프런티어 AI를 외부에서 들여온다는 것은 모델 하나를 사용하는 문제가 아니라 개발·배포·운영 환경 전반을 외부 스택에 의존하는 문제라는 지적이다. 한국은 외산 AI 의존도를 낮추기 위해 독자 AI 파운데이션 모델 개발에 나서고 있다. 지난해부터 과학기술정보통신부가 추진한 '독자 AI 파운데이션 모델(독파모)' 프로젝트는 거대언어모델(LLM)과 멀티모달 등 주요 AI 영역에서 원천 기술력을 확보하는 것을 목표로 한다. 다만 업계에서는 자국 AI 모델 개발만으로는 충분하지 않다는 목소리가 나온다. 국내에서 확보 가능한 컴퓨팅 자원과 인프라 안에서 모델을 안정적으로 학습·추론하고 서비스할 수 있는 운영 역량도 함께 갖춰야 한다는 것이다. 미국과 중국의 대형 사업자처럼 대규모 그래픽처리장치(GPU)와 데이터센터를 단기간에 확보하기 어려운 만큼, 제한된 연산 자원의 활용 효율이 경쟁력으로 꼽힌다. 최신 AI 추론 환경은 기존 데이터센터보다 높은 전력 밀도와 메모리 자원을 요구한다. 이에 따라 인프라 확충과 함께 모델 구조와 서비스 환경에 맞춰 정밀도, 메모리 사용량, 처리 속도를 조정하는 경량화·최적화 기술에도 관심이 쏠린다. 같은 인프라에서 처리할 수 있는 작업량을 늘리고 운영 비용을 낮출 수 있어서다. 이 같은 운영 최적화는 독파모 프로젝트에서도 적용되고 있다. 업스테이지 컨소시엄에 참여 중인 노타는 솔라 계열 모델을 국내 인프라 환경에서 구동하기 위한 압축·최적화 작업을 맡고 있다. 이 회사는 대규모 전문가 혼합(MoE) 모델에서 중요도가 낮은 영역을 선별적으로 압축해 메모리 사용량을 줄이고 성능 저하를 최소화하는 기술을 제공한다. 실제 업스테이지 '솔라 오픈 100B'에 노타의 최적화 기술을 적용한 결과, 메모리 사용량을 약 72.8% 줄이면서 원본 모델과 유사한 성능 지표를 유지한 것으로 나타났다. 업계 관계자는 "앤트로픽 사태가 단발성 사건으로 끝나더라도 AI 인프라 종속의 구조적 위험은 그대로 남을 것"이라며 "독자 개발한 자국 모델을 한정된 자원에서 효율적으로 가동하는 경량화·최적화 기술이 함께 가야 AI 주권이 외부 정책 변수에 흔들리지 않는다"고 말했다.

2026.06.22 11:37이나연 기자

김완종 SK AX 사장 "단순 AI 도입 넘어 기업 전체 최적화해야"

"기업 경쟁력은 더 좋은 인공지능(AI)을 도입하는 것이 아니라 AI를 통한 전사 최적화로 새로운 성장 가치를 창출하는 데 있습니다." 김완종 SK AX 사장은 16일 서울 그랜드 인터컨티넨탈 파르나스 호텔에서 개최한 '이매진 AX 2026' 컨퍼런스에서 이같이 강조했다. 'AI를 도입하는 기업에서 AI가 일하는 기업으로(Beyond AI: The Agentic Enterprise)'를 주제로 진행된 이번 행사에서 SK AX는 전사 업무와 운영 전반을 AI로 혁신해 온 '비잉(Being) AX' 경험을 중점적으로 소개했다. 제조·금융·통신·유통·서비스 등 다양한 산업 경영진도 한자리에 모여 SK AX와의 협업을 통한 AI 전환(AX) 사례를 공유했다. 김 사장은 이날 기조연설을 통해 "AI로 업무 효율화와 전사 증강을 이뤄낸 기업들과 그렇지 못한 기업간 격차는 이미 경영 성과로 나타나기 시작했으며 앞으로 그 격차는 더욱 커질 것"이라며 "기업이 그 격차의 상단에 서기 위해선 단순 AI 도입을 넘어 전략·기술· 데이터·운영체계·인재·변화관리 등 AX 핵심 역량을 갖춰야 한다"고 강조했다. 그러면서 "우리는 스스로를 첫번째 고객이라 생각하며 비잉 AX를 실천해 이러한 역량을 검증해 왔다"고 덧붙였다. SK AX는 기업 실제 업무와 운영 전반이 AI로 재설계되는 에이전틱 엔터프라이즈 시대를 연다는 청사진을 제시했다. 단순 AI 도입을 넘어 AI로 비즈니스 모델을 혁신하고 사람·AI 협업을 통해 기업 전체가 증강되는 성장의 선순환 구조를 만들겠다는 목표다. SK AX는 비잉 AX 전략의 핵심으로 전사 최적화를 위한 전략적 로드맵은 물론 통합 플랫폼 역량을 앞세우고 있다. 대표적인 에이전틱 AI 플랫폼으로는 '엑스젠틱와이어(AXgenticWire) NPO'가 꼽힌다. 이는 수많은 에이전트를 연결하고 이들 협업을 오케스트레이션하는 동시에 보안과 품질 편차, 비용 증가 등 문제를 통제하도록 설계됐다. 김 사장은 "AX는 단순한 기술 도입이 아닌 조직 전체가 AI와 함께 움직일 수 있도록 일하는 방식과 기업운영 체계를 재설계하는 것을 의미한다"며 "AI와 협업 가능한 인재를 육성하고 이를 지지하는 조직문화와 시스템을 만들어야 비로소 AI 증강을 통한 전사 통합과 시너지 창출이 가능하다"고 말했다. 이날 행사엔 제조·반도체·금융·HR 등 다양한 영역의 주요 고객과 파트너사 경영진이 참석해 SK AX와의 실제 협력 사례를 발표했다. SK AX와 엔터프라이즈 AI 파트너십을 체결한 오픈AI가 대표적이다. 기업 내부 시스템 맥락을 정확히 이해하고 실제 업무 성과와 투자 대비 효과까지 높이는 AX 혁신 모델을 고도화 과정을 소개했다. SK하이닉스는 SK AX와 함께 디지털 트윈을 기반으로 제조 공정 정밀도와 데이터 활용 범위를 넓혔으며 수율 극대화를 위한 자율운영 모델인 자율형 공장 전환에도 속도를 내고 있다. 또 글로벌 풍력타워 제조기업인 씨에스윈드는 생산 현장 데이터와 업무 프로세스를 AI 에이전트와 연결해 작업 계획 수립 및 일정 조정을 최적화한 글로벌 제조 AX 모델을 SK AX와 함께 구현해 적용 중이다. 신한금융그룹은 SK AX와 함께 데이터 보안, 권한 관리, 규제 대응을 충족하는 '1인 1 금융 에이전트' 기반 업무 혁신 모델을 구체화하고 있다. 글로벌 HR 컨설팅 기업 머서 역시 SK AX와 파트너십을 기반으로 사람과 AI가 협업하는 조직 운영 체계를 설계하고 있다. 손건일 SK AX 최고고객책임자(CCO)는 "다수 고객사들과의 AX 경험을 토대로 성공조건을 살펴보면 에이전트 구성원을 염두에 둔 기존 프로세스 재설계, 사내 암묵지의 에이전트화를 통한 자산화, 이를 통한 성공 경험이 중요하다"며 "이를 위해선 현재 시스템과 현장 업무를 이해하고 AI 기술을 통해 업무 끝단까지 재연결하려는 노력이 동반돼야 할 것"이라고 말했다. 차지원 SK AX 최고AI혁신책임자(CAIO)는 "기술 선택 기준이 도입 자체에서 AI를 어떻게 일하게 할 것인가의 영역으로 이동하고 있다"고 진단했다. 이어 "AI가 실제 비즈니스 성과를 내려면 기업 내부 데이터와 시스템, 프로세스뿐 아니라 산업별 도메인 지식이 정교하게 맞물려야 한다"며 "우리는 엑스젠틱와이어를 통해 현장 맞춤형 실행 모델을 고도화하고 있다"고 밝혔다.

2026.06.16 11:23한정호 기자

노타, 세계적 학회서 'MoE' 특화 AI 최적화 기술력 입증

노타가 세계적 머신러닝 학회에서 거대언어모델(LLM) 핵심 구조로 주목받는 전문가 혼합(MoE) 모델 최적화 분야 기술력을 인정받았다. 지난 엔비디아 네모트론 해커톤에서 데이터 기반 MoE 양자화 기법으로 트랙 우승과 종합우승을 차지한 데 이은 성과다. 노타는 ICML 2026의 '리소스 적응형 파운데이션 모델 추론(AdaptFM)' 워크숍에서 자사의 MoE 특화 양자화 알고리즘 논문 2편이 최종 채택됐다고 11일 밝혔다. MoE는 여러 전문가 모델 중 필요한 일부만 선택해 동작하는 방식으로, 대형 AI 모델의 성능과 효율을 동시에 높일 수 있어 최신 LLM에서 빠르게 확산하고 있다. 다만 모델 구조가 복잡한 만큼 이를 더 작고 가볍게 만드는 양자화 과정에서도 기존 일반 모델과는 다른 접근이 필요하다. 이번에 채택된 첫 번째 논문 'DREAM-MoE'는 대규모 AI 모델을 여러 구간으로 나눠 양자화할 때 발생할 수 있는 판단 흐름의 변화를 줄이는 방법을 제안한다. 노타는 앞쪽 구간에서 생긴 작은 오차가 뒤쪽 구간 전문가 선택까지 바꿀 수 있다는 점에 주목해 양자화 이후에도 모델이 원래와 유사한 방식으로 필요한 전문가를 선택할 수 있도록 했다. 또 다른 논문 'SRA-MoE'는 모델 결과에 더 큰 영향을 주는 중요한 입력을 선별해 우선적으로 보호하는 방법을 제안한다. 모든 입력을 동일하게 다루기보다 핵심 입력에서 전문가 선택이 크게 흔들리지 않도록 설계해 제한된 자원으로도 모델 품질을 효과적으로 유지할 수 있도록 했다. 두 연구 모두 최신 MoE 특화 양자화 기법들과 비교해 더 높은 성능이 확인됐다고 노타는 강조했다. AI 모델을 더 적은 메모리와 연산 자원으로 실행하면서도 품질 저하를 줄였다는 설명이다. 노타는 정부 주도의 독자 파운데이션 모델 개발 과제에 참여 중인 업스테이지 컨소시엄에서 '솔라 MoE'와 같은 대규모 모델 최적화를 추진하는 한편, 엔비디아 네모트론 3 나노 모델 양자화 경험을 네모트론 울트라 등 최신 모델로 확장하는 등 기술 적용 범위를 넓히고 있다. 채명수 노타 대표는 "이번 논문 채택은 노타가 MoE에 특화된 양자화 기술을 꾸준히 고도화해 온 성과"라며 "대규모 AI 모델을 더 효율적으로 활용할 수 있는 최적화 기술 개발을 이어가겠다"고 말했다.

2026.06.11 10:16이나연 기자

검색 주도권, AI로 바뀐다…아카마이, GEO 시장 공략

아카마이가 생성형 인공지능(AI) 기반 검색과 에이전트 중심 웹 환경 확산에 대응하기 위한 신규 브랜드 최적화 플랫폼을 공개했다. 검색엔진최적화(SEO)를 넘어 거대언어모델(LLM)과 AI 에이전트가 기업 콘텐츠를 어떻게 이해하고 인용하느냐가 새로운 경쟁력으로 떠오르면서, 기업 디지털 전략도 AI 중심 구조로 빠르게 재편되는 모습이다. 아카마이는 기업이 AI 검색과 에이전틱 트래픽 환경에 맞춰 콘텐츠를 최적화할 수 있도록 지원하는 'AI 브랜드 프레즌스'를 출시했다고 27일 밝혔다. 최근 인터넷 검색 환경은 사람 중심 검색에서 AI 기반 답변·추천 중심 구조로 빠르게 이동하고 있다. 소비자들이 브랜드 웹사이트를 직접 방문하기보다 챗GPT와 같은 생성형 AI 응답을 통해 브랜드를 접하는 사례가 늘어나면서 기존 검색·광고 기반 마케팅 구조에도 변화가 나타나고 있다. 아카마이에 따르면 최근 1년간 AI 봇 트래픽은 300% 이상 증가했다. 동시에 전체 검색 중 약 60%가 웹사이트 클릭 없이 AI 답변 단계에서 종료되는 '제로 클릭' 현상도 확대되는 것으로 나타났다. 이는 기업 입장에서 기존 검색엔진 노출 전략만으로는 브랜드 가시성을 유지하기 어려워지고 있음을 의미한다. 아카마이는 이러한 변화를 '에이전틱 검색 시대'로 규정했다. 앞으로는 AI 모델이 어떤 콘텐츠를 신뢰하고 인용하느냐가 브랜드 노출과 고객 유입을 좌우하게 되면서 기업들도 AI가 이해하기 쉬운 데이터 구조와 콘텐츠 전달 체계를 구축해야 한다는 설명이다. 최근 업계에서 주목받는 생성형 엔진 최적화(GEO) 흐름과 맞닿아 있는 전략으로 풀이된다. AI 브랜드 프레즌스는 이를 위해 웹사이트 정보를 AI가 이해하기 쉬운 구조로 자동 변환하는 AI 최적화 컨텍스트 전달 기능을 지원한다. 백엔드 시스템 변경 없이 엣지 환경에서 실시간으로 콘텐츠 구조를 조정할 수 있으며 일반 사용자 경험에는 영향을 주지 않는 방식이다. 또 어떤 AI 모델이 사이트를 방문하고 어떤 콘텐츠를 소비하는지 분석하는 가시성·인사이트 기능도 제공한다. 기업들은 단일 대시보드를 통해 AI 상호작용이 실제 트래픽과 고객 참여에 어떤 영향을 미치는지 파악할 수 있으며 이를 기반으로 콘텐츠 전략을 조정할 수 있다. AI 시스템이 브랜드·제품·메시지를 어떻게 이해하고 노출하는지 실시간으로 확인할 수 있는 점도 특징이다. 아카마이는 기존 최적화 방식과 달리 이 솔루션이 엣지에서 동작한다는 점도 강점으로 내세웠다. 기존 워크플로우나 사용자 경험을 바꾸지 않고도 AI 환경에 맞춰 콘텐츠 전달 구조를 실시간으로 조정할 수 있도록 설계했다. 아카마이는 자사 글로벌 웹사이트에 해당 기술을 시범 적용한 결과, 브랜드 관련 인용 횟수가 85% 증가했고 브랜드명이 직접 언급되지 않은 일반 검색에서 브랜드 노출도는 364% 급증했다고 밝혔다. 특히 챗GPT 내 브랜드 노출은 경쟁사 대비 133% 증가한 것으로 나타났다. 회사는 AI 맞춤형 웹사이트 버전을 별도로 제공해 기계가 처리해야 하는 데이터 양을 최대 99%까지 줄였다고 설명했다. 이번 발표는 AI 시대 기업 디지털 전략 중심축이 기존 SEO에서 GEO와 AI 에이전트 대응 체계로 이동하고 있음을 보여주는 사례로 풀이된다. 단순히 검색 순위를 높이는 것을 넘어 AI 모델이 기업 정보를 어떤 방식으로 이해하고 추천하는지까지 관리해야 하는 시대가 열리고 있다는 분석이다. 아카마이는 향후 사용자를 대신해 자율 에이전트가 정보 탐색과 의사결정, 거래까지 수행하는 미래 AI 생태계에 대응하기 위해 관련 기술을 지속 확대할 계획이다. AI 최적화 딜리버리 기술과 AI 트래픽 가시성을 결합해 기업들이 새로운 AI 상호작용 환경에서 브랜드 표현 방식을 보다 능동적으로 관리할 수 있도록 지원한다는 구상이다. 현재 AI 브랜드 프레즌스는 북미 일부 고객을 대상으로 우선 제공되며 향후 적용 범위를 단계적으로 확대할 예정이다. 킴 세일럼-잭슨 아카마이 최고마케팅책임자(CMO)는 "AI 모델이 기업 콘텐츠를 어떻게 찾고 공유하는지를 관리하지 못하면 결국 브랜드 평판 통제권을 잃게 된다"며 "이제 훌륭한 웹사이트는 사용자 경험뿐 아니라 AI가 신뢰하는 답변 출처가 될 수 있도록 최적화돼야 한다"고 말했다.

2026.05.27 14:32한정호 기자

라인게임즈, 퀘이사존과 '엠버 앤 블레이드' 최적화 업무협약 체결

라인게임즈가 IT·하드웨어 커뮤니티 퀘이사존과 손잡고 신작 PC 게임 '엠버 앤 블레이드'의 다양한 하드웨어 환경 최적화에 나선다. 라인게임즈(공동대표 조동현·배영진)는 퀘이사존(대표 김현석)과 자체 개발 신작 PC 타이틀 '엠버 앤 블레이드'의 게임 환경 최적화를 위한 업무협약(MOU)을 체결했다고 15일 밝혔다. 이번 협약식은 지난 14일 라인게임즈 사옥에서 양사 주요 관계자가 참석한 가운데 진행됐다. 양사는 퀘이사존이 보유한 다양한 사양의 하드웨어 인프라를 활용해 '엠버 앤 블레이드'가 여러 PC 환경에서 안정적으로 구동될 수 있도록 최적화 테스트를 실시한다. 이를 통해 폭넓은 PC 사양 변화에 선제적으로 대응하고 게임 최적화에 대한 이용자 신뢰를 확보할 계획이다. 차승규 라인게임즈 최고크리에이티브책임자(CCO)는 "이용자들이 다양한 환경에서 '엠버 앤 블레이드'의 수준 높은 퍼포먼스를 경험할 수 있도록 퀘이사존과 MOU를 통해 기술적 완성도 향상에 최선을 다하겠다"고 말했다. 조승환 퀘이사존 부사장은 "이번 협약을 바탕으로 라인게임즈의 '엠버 앤 블레이드'가 보여줄 박진감 넘치는 전투와 핵앤슬래시 게임성에 대한 최적의 플레이 가이드를 제시하겠다"고 밝혔다. 한편 '엠버 앤 블레이드'는 최근 파이널 데모 버전을 공개했으며 연내 얼리 액세스(앞서 해보기) 출시를 준비 중이다. PC 외 콘솔 플랫폼 발매도 검토하고 있다.

2026.05.15 11:30정진성 기자

"복잡한 철도노선도 뚝딱"…실리콘 공정용 '아이징 머신' 나와

철도 노선 설계나 도로 주행 중 나타나는 라디오 주파수 편차 등을 기존 공정으로 최적화할 수 있는 반도체 소자가 개발됐다. KAIST는 전기및전자공학부 최양규 교수와 김상현 교수 연구팀이 차세대 최적화 전용 하드웨어인 '오실레이터 기반 아이징 머신'을 개발, 구현하는데 성공했다고 6일 밝혔다. 아이징 머신은 여러 진동 소자가 상호작용하며 최적 해를 찾아내는 특수 목적형 컴퓨터와 알고리즘을 말한다. 최양규 교수는 전화통화에서 "현재 하드웨어(CPU)가 풀수 없는 최적화 문제를 풀수 있다. 현재 풀 수 있는 문제로 보면, 에너지를 적게 쓰면서 최적화를 해낼 수 있는 장점이 있다"며 "무엇보다 CMOS(상보형 금속 산화물 반도체) 표준공정을 사용했기 때문에 새로운 팹이 필요없다"고 말했다. 최 교수는 또 "기존에는 공정 튜닝에 2~3년식 걸렸지만, 이 어레이는 주변 회로만 받쳐주면 삼성전자나 SK하이닉스 등이 어렵지 않게 양산할 수 있다"고 설명했다. 기존의 컴퓨터에 쓰이는 폰 노이만 구조는 중앙처리장치와 메모리가 물리적으로 분리돼 있어 데이터 이동에 따른 전력 소모와 지연이 생기고, 문제 규모가 증가할수록 연산 자원이 기하급수적으로 증가하는 한계가 있다. 연구팀은 이러한 한계를 극복하기 위해 통계물리학의 아이징 모델을 하드웨어적으로 구현하는 아이징 머신을 개발했다. 아이징 모델은 통계물리학에서 자성 물질을 설명하기 위한 모델이다. 격자 위 각 지점에 스핀(+1 또는 -1)을 두고, 이웃한 스핀들 사이의 상호작용에 따라 시스템 전체 에너지가 결정되는 수학적 모델이다. 연구팀은 100% 실리콘 기반 트랜지스터를 활용했다. 단일 트랜지스터를 각각 오실레이터 소자와 커플러 소자로 활용한 것. 기존 트랜지스터가 스위치나 증폭기로 사용되던 것과 달리, 연구팀은 부유 바디 특성을 이용해 단일 트랜지스터가 스스로 발진하는 오실레이터로 동작하도록 구현했다. 이 오실레이터는 게이트 전압을 조절함으로써 고유 주파수를 정밀하게 조정할 수 있다. 이종 소자 기반 구조에서 구현하기 어려웠던 정밀 제어를 CMOS 공정 내에서 실현했다. 별도 트랜지스터를 커플러 소자로 활용해, 커플러 게이트 전압을 통해 오실레이터 간 결합 강도를 능동적으로 조절할 수 있도록 했다. 이를 통해 단순한 결합을 넘어 다중 상태로 결합을 표현할 수 있으며, 다양한 가중치를 갖는 조합 최적화 문제를 유연하게 구현한다. 연구팀은 보조적으로 주입 동기화를 적용해 위상을 두 개의 이진 상태로 고정시켜, 대표적인 조합 최적화 문제인 최대 절단(Max-Cut) 문제를 해결했다. 소규모 문제는 실제 하드웨어 실험으로 검증했다. 100 노드급 대규모 문제는 실험 데이터를 기반으로 한 준경험적 시뮬레이션을 통해 성능을 확인했다. 논문 제1저자인 윤성윤 전기및전자공학부 박사과정생은 "시간표 짜기 같은 경우는 1초면 해결된다. 소자끼지 상호작용을 통해 답을 금방 찾는다"며 "실리콘 트랜지스터를 기반으로 개발해서, 소자 고집적화만 하면 대규모 최적화에 바로 쓸 수 있을 것"으로 이라고 부연 설명했다. 연구성과는 국제학술지 사이언스 어드밴시스에 게재됐다.

2026.05.06 19:07박희범 기자

"AI가 '지갑 속 노는 코인' 운용하는 시대"

지난 2월 글로벌 가상자산 거래소 코인베이스는 인공지능(AI) 에이전트 전용 지갑 인프라 에인전틱 월렛(Agentic Wallet)을 공개하며, “조언만 하던 에이전트에서, 실제로 행동하는 에이전트로 넘어가는 시대”를 선언했다. 이제 에이전트는 스스로 자금을 보유하고, 토큰을 사고팔며, 애플리케이션프로그래밍인터페이스(API)나 컴퓨트 비용을 온체인으로 결제할 수 있다. 사람 대신 소프트웨어가 서로에게 청구서를 보내고, 그 자리에서 정산하는 머신 이코노미의 초입이 열린 것이다. 에이전트의 지갑 안에서는 무슨 일이 벌어질까 에이전틱 월렛과 이를 감싸는 에이전틱 키트는 에이전트에게 인증, 펀드, 송금, 거래 등의 온체인 스킬을 통째로 제공한다. 개발자가 이 모듈만 붙이면 에이전트가 스스로 스왑·송금·이자 수취를 할 수 있는 구조다. 이 구조가 정착되면 에이전트 지갑 안의 스테이블코인과 토큰은 '기본값이 예치 상태'가 된다. 더 이상 잔고가 놀지 않는다. 에이전트는 가스비·리스크를 동시에 계산해, 항상 더 나은 이자·보상 구조 쪽으로 자산을 흘려보낸다. 페이파이: 결제가 곧 금융상품이 되는 순간 여기서 페이파이(PayFi)가 중요해진다. PayFi는 말 그대로 결제가 금융이 되는 현상이다. 결제 행위가 끝난 뒤에 따로 예적금을 고민하는 것이 아니라, 결제와 동시에 자금이 금융상품으로 흘러들어가 이자를 발생시키도록 설계하는 것이다. 페이파이 솔루션 티클리(Tikkly)는 이 아이디어를 상업 서비스로 구현한 사례다. 티클리는 여러 회사에 흩어진 포인트를 모아 스테이블코인, 비트코인 등으로 즉시 전환하고, 파트너사와의 정산을 블록체인 스마트컨트랙트로 짧은 주기로 처리한다. 또 전환된 자산을 디파이 프로토콜에 자동 예치해 결제 직후부터 이자를 붙이는 구조를 만든다. AI 에이전틱 페이파이: 에이전트가 만드는 24시간 스마트 수익 엔진 지갑을 가진 AI 에이전트와, 결제 즉시 자산을 운용하는 페이파이를 겹쳐보자. 이미 코인베이스의 에이전트키트는 오픈AI 에이전트 개발키트(SDK)와 바로 붙는 툴킷을 제공해, “에이전트에 지갑을 붙이는 일”을 10분 만에 끝내도록 만들었다. 에이전트는 이 지갑으로 사용자의 구독료, 광고비, 데이터 판매 수익 등을 스테이블코인 형태로 수취하고, 동시에 클라우드 컴퓨트·API·데이터 구매에 필요한 비용을 자동으로 지출할 수 있다. 결과적으로 AI 에이전트는 자기 지갑과 자기 운용정책을 가진 작은 금융기관처럼 행동한다. 사람은 수익률, 변동성, 손실 한도와 윤리·규제 경계를 지정하고, 그 안에서 에이전트는 24시간 자율적으로 경제 활동을 한다. 이미 시장에는 에이전트 빌더를 위한 지갑·결제 SDK 레퍼런스가 쌓이고 있다. 코인베이스 에이전트 키트는 에이전트 프레임워크에 바로 불러 쓸 수 있는 지갑 모듈로, 오픈AI 에이전트 SDK와의 통합을 공식 지원한다. 크립토닷컴의 AI 에이전트SDK는 자연어로 “이 토큰 보내줘, 잔고 보여줘”라고 말하면, 내부적으로 지갑 API와 디파이 플랫폼을 호출하는 구조를 제공한다. 책임 소재·보안 등의 리스크도 다만, 상용화 과정에서 법적·운영적·책임적 장애물이 산적해 있다. 아래는 주요 이슈를 더 날카롭게 정리한 것이다. 1. 책임 소재 불명확 에이전트가 디파이에서 손실을 내거나, 해킹·스마트컨트랙트 익스플로잇에 휘말리면 누가 책임져야 할까. 앤트로픽 연구처럼 AI 에이전트가 스스로 취약점을 찾아 익스플로잇하는 사례도 이미 관찰됐다. 더욱 위험한 것은 프롬프트 인젝션과 도구 사용 오남용이다. “최대 수익률로 투자해”라는 단순 지시가 에이전트에게 “레버리지 100배 포지션 잡아”로 해석되는 경우가 현실적으로 발생할 수 있다. 2. 보안·오남용 리스크 에이전틱 월렛이 퍼지면 에이전트 간 “자원 도둑질”, 무한 루프 거래(머니 러닝), 또는 거대언어모델(LLM) 환각으로 인한 고위험 베팅이 대규모로 발생할 위험이 크다. 실제 개념검증(PoC) 단계에서 가장 먼저 현실화될 가능성이 높은 시나리오는 에이전트간 공격과 프롬프트 기반 정책 우회다. 3. 한국 시장 특화 과제 한국에서는 글로벌 비전과 국내 규제 간 괴리가 더 크다. 가상자산 이용자 보호법 개정안에서 AI 에이전트의 자율 거래 행위를 '이용자 대리 행위'로 규정할 가능성이 높다. 또 금융위원회가 준비 중인 '지능형 AI 에이전트 금융 행위 가이드라인'에서는 인간 감독 의무, 비상정지 장치 필수화, 손실 발생 시 배상 책임 등이 논의되고 있다. 해외 지갑 사용 시 외국환거래법 위반 이슈(무인가 해외 송금)와 자금세탁방지(AML) 규제가 걸림돌이 될 수 있다. 이러한 리스크를 극복하지 않으면, 에이전트 경제는 “자율성의 환상”으로 끝날 수 있다. 다만, 코인베이스, 티클리 같은 플레이어들이 속도를 내고 있는 만큼, 머지 않아 실제 PoC가 나올 가능성은 높아 보인다. *본 칼럼 내용은 본지 편집방향과 다를 수 있습니다. • 2025 ~ 현재: Noone21 대표이사, 포항공대 CCBR(Center for Cryptocurrency & Blockchain Research) 부센터장 • 2023 ~ 현재: 수호아이오 사업 및 전략 고문 • 2018 ~ 2023: 람다256 대표이사 • 2016 ~ 2018: SK텔레콤 전무이사 (서비스 플랫폼) • 2008 ~ 2016: 삼성전자 무선사업부 상무이사 (삼성페이, 챗온)

2026.04.07 14:24박재현 컬럼니스트

  Prev 1 2 Next  

지금 뜨는 기사

이시각 헤드라인

"우리 AI, 잘 쓰게 만들어야"…이해민·하정우, 산업 활용성 ‘집중 점검’

태양광 인버터 中 무선백도어 막는데 중국산 탐지장비 쓴다?

국가AI전략위 "정부 AI 도입, 기술보다 제도가 발목…공공 AX 규칙 다시 짠다"

국내 대형교회 2곳 해킹 당했다...33만건 교인 헌금 정보 등 유출

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.