• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'노타 AI'통합검색 결과 입니다. (58건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

노타, 中 '키미 K3' 경량화…GPU 최대 절반 줄여

노타가 최근 업계 주목을 받는 중국 문샷AI의 초거대 인공지능(AI) 모델 '키미 K3'를 경량화해 구동에 필요한 그래픽처리장치(GPU)를 최대 절반으로 줄이는 데 성공했다. 노타는 전문가 모듈을 각각 25%·50% 줄인 키미 K3 경량화 모델 2종을 공개했다고 6일 밝혔다. 2조 8000억 개 매개변수를 갖춘 키미 K3는 입력값에 따라 필요한 모듈만 선택적으로 활성화하는 전문가 혼합(MoE) 구조를 채택한 오픈웨이트 모델이다. 이를 구동하려면 엔비디아 최신 고성능 GPU인 B300 8장이 필요해 기업·개발자가 활용하기에 비용과 인프라 부담이 컸다. 키미 K3는 학습 단계부터 가중치와 활성값을 각각 4비트와 8비트로 설계해 일반적인 양자화 방식만으로는 추가 압축 범위가 제한적이라는 문제도 있었다. 노타는 이를 자체 개발한 '비균일 전문가 프루닝' 기술로 해결했다. 모델 층별 특성과 모듈 중요도를 분석해 핵심 전문가는 보존하고 기여도가 낮은 모듈만 선별 제거하는 방식이다. 모든 층을 동일 비율로 줄이던 기존 방식과 달리 층별 제거 비율을 다르게 적용해 성능 저하를 최소화했다. 키미 K3 경량화 모델 2종은 구동에 필요한 GPU 수가 기존 8장에서 각각 6장·4장으로 줄었다. 노타 자체 평가 결과, 50% 경량화 모델은 층별 전문가를 동일한 비율로 제거하는 기존 방식(REAP)보다 대다수 벤치마크에서 더 높은 성능 보존율을 기록했다. 고난도 과학·추론 능력 평가(GPQA-Diamond)와 지시 수행 능력 평가(IFeval) 점수는 각각 2.52점, 2.22점 높았다. 김태호 노타 최고기술책임자(CTO)는 "다양한 프론티어급 AI 모델을 한정된 연산 자원에서도 효율적으로 활용할 수 있도록 기술 적용 범위를 확대하겠다"고 말했다.

2026.08.06 14:05이나연 기자

노타, 업스테이지 '솔라 오픈2' GPU 8장→2장으로 줄였다

노타가 정부의 '독자 AI 파운데이션 모델(독파모)' 프로젝트에서 엔비디아 H100 그래픽처리장치(GPU) 8장이 필요했던 업스테이지의 차세대 모델을 2장만으로 구동할 수 있도록 최적화하는 데 성공했다. 노타는 독파모 사업 내 업스테이지 컨소시엄에서 2차수 성과물인 '솔라 오픈2' 전용 경량화 모델을 글로벌 AI 플랫폼인 허깅페이스에 공개했다고 27일 밝혔다. 솔라 오픈2는 문서 업무와 코딩, 툴 호출, 다단계 추론 등 실제 기업 업무에 활용할 수 있는 에이전트 AI 구현에 초점을 맞춘 거대언어모델이다. 총 2500억 개의 매개변수(파라미터) 규모로, 실제 작업 시에는 필요한 150억 개만 활성화하는 전문가 혼합(MoE) 구조를 채택했다. 이를 통해 토큰 사용량이 많은 에이전트 업무에서도 효율적인 운영이 가능하게 했다. 노타는 솔라 오픈2 연산 효율을 실제 기업 환경에서의 배포 효율을 극대화하기 위해 ▲데이터 기반 MoE 양자화 ▲라우터 인지형 MoE 양자화 ▲비균일 전역 프루닝 기술을 적용했다. 데이터 기반 MoE 양자화에는 모델 가중치를 INT4 또는 NVFP4 기반의 4비트 저정밀 형식으로 변환하면서도 모든 전문가 모듈이 안정적인 통계치를 확보할 수 있도록 캘리브레이션 데이터를 합성하는 기술인 'PASCAL-MoE'를 활용했다. '라우터 인지형 MoE 양자화'에는 양자화 이후에도 라우터의 전문가 선택이 안정적으로 유지되도록 설계한 자체 양자화 알고리즘을 적용했다. 중요도가 낮은 전문가 모듈을 선택적으로 제거하는 '비균일 전역 프루닝 기술'도 도입했다. 결과적으로 노타는 모델 가중치를 4비트 형식으로 변환하고 중요도가 낮은 연산 모듈을 선별적으로 정리해 원본 모델 가중치 메모리를 500.6 기가바이트(GB)에서 117.8 GB로 약 76.5% 감축하는 데 성공했다. 메모리 용량 기준으로 엔비디아 H100 GPU 8장이 필요했던 원본 모델을 2장 환경에서도 구동할 수 있도록 최적화했다는 설명이다. 특히 양자화 이후에도 솔라 오픈2의 에이전트 AI 핵심 기능인 툴 호출이 안정적으로 유지됐다. 김태호 노타 최고기술책임자(CTO)는 "이번 성과는 대규모 MoE 모델을 기업이 실제 도입할 수 있는 형태로 최적화했다는 데 의미가 있다"며 "기업이 자사 인프라와 예산에 맞춰 에이전트 AI를 도입하고 활용 범위를 확장할 수 있도록 모델 구조와 하드웨어 환경에 최적화된 양자화 및 경량화 기술을 고도화하겠다"고 말했다.

2026.07.27 10:43이나연 기자

노타, AMD 로보틱스 생태계 합류…연산 환경 최적화 지원

노타AI가 인공지능(AI) 모델 최적화 사업 적용 범위를 로보틱스 분야로 넓힌다. 노타는 미국 샌프란시스코에서 열린 'AMD 어드밴싱 AI 2026'에서 AMD 로보틱스 파트너 네트워크에 참여했다고 24일 밝혔다. AMD 컴퓨팅 기술로 로봇용 AI 솔루션 개발과 상용화를 추진할 방침이다. AMD 로보틱스 파트너 네트워크는 임베디드와 엣지·클라우드 환경에서 로보틱스 솔루션 개발과 배포를 지원하는 개방형 생태계다. AMD 검증 플랫폼 중심으로 제조 전문기업과 독립 소프트웨어(SW) 공급업체, 센서 공급업체와 시스템 통합업체(SI) 등이 참여한다. 노타는 AI 모델 경량화와 하드웨어(HW) 맞춤형 최적화 기술을 로봇에 적용할 계획이다. 실제 로봇에 탑재되는 프로세서와 시스템 환경에 맞춰 모델 크기와 연산량·메모리 사용량을 줄일 방침이다. 로봇은 전력과 메모리·연산 자원이 제한된 환경에서 작동한다. AI 모델을 로봇 내부에서 직접 실행하려면 HW 성능에 맞게 모델 구조와 처리량을 조정하는 최적화 기술이 필요하다. 노타는 이를 통해 로봇이 외부 서버와 연결되지 않은 환경에서도 주변 상황을 인식하고 판단할 수 있도록 지원할 방침이다. 해당 기술은 로봇이 자율적으로 움직이는 피지컬 AI 구현의 기반으로 활용될 수 있다. 회사는 스마트시티와 산업 안전·모빌리티 분야에서 축적한 엣지 AI 최적화 경험도 로보틱스 사업에 적용한다. AMD 네트워크에 참여한 기업과 협력해 산업 현장에서 사용할 수 있는 피지컬 AI 솔루션을 확대할 계획이다. 채명수 노타 대표는 "피지컬 AI가 산업 현장에서 실질적인 가치를 제공하려면 AI 모델을 실제 로봇 연산·메모리 환경에 맞게 최적화하는 기술이 필수적"이라며 "AMD 로보틱스 파트너 네트워크 참여 기업과 산업 현장에서 활용 가능한 피지컬 AI 솔루션 확산에 기여하겠다"고 말했다.

2026.07.24 10:03김미정 기자

큐원 추론 7배 빠르게…노타, 글로벌 AI 학회 챌린지 3위

노타가 세계적인 머신러닝 학회 'ICML 2026'에서 열린 오픈소스 인공지능(AI) 모델 최적화 챌린지에서 추론 최적화 기술력을 입증했다. 노타는 ICML 2026 'AdaptFM(자원 적응형 파운데이션 모델 추론) 워크숍'에서 개최된 '이피션트 큐원 컴피티션(Efficient Qwen Competition)'에서 평균 6.978배 빠른 추론 성능을 기록해 최종 3위에 올랐다고 13일 밝혔다. 전 세계 40여 개 팀이 참가한 이번 대회는 단일 엔비디아 A10G 그래픽처리장치(GPU) 환경에서 큐원3.5-4B 모델 성능은 유지한 채 답변 생성 속도를 얼마나 높일 수 있는지를 평가했다. AdaptFM 워크숍은 제한된 컴퓨팅 자원에서 대규모 AI 모델을 효율적으로 실행하는 기술을 주제로, 아마존·메타 등 글로벌 기업 연구자들이 조직위원으로 참여한다. 노타는 양자화로 모델의 메모리 사용량과 연산량을 줄이고 추측적 디코딩 기술을 결합해 추론 속도를 높였다. 추측적 디코딩은 초안 모델이 답변 후보를 빠르게 생성한 뒤 본 모델이 이를 검증해 최종 답변을 만드는 방식이다. 여기에 슬라이딩 윈도우 어텐션 기법을 적용해 불필요한 연산을 추가로 줄였다. 노타는 이번 수상과 함께 AdaptFM 워크숍에서 혼합 전문가(MoE) 구조 대규모언어모델(LLM) 양자화 관련 논문 2편도 채택됐다. 노타는 엔비디아 네모트론 해커톤에서도 데이터 기반 MoE 양자화 기술로 트랙 우승과 종합우승을 차지한 바 있다. 김태호 노타 최고기술책임자(CTO) 겸 공동창업자는 "글로벌 AI 생태계에서 활용되는 대표적인 오픈소스 AI 모델인 큐원을 대상으로 우리 추론 최적화 기술력을 검증받은 사례"라며 "온디바이스·엣지 AI 환경에 최적화 기술을 확대 적용할 것"이라고 말했다.

2026.07.13 14:19이나연 기자

AWS 공인 파트너 '노타', AI칩 최적화 서비스 출시

노타가 아마존웹서비스(AWS)와 함께 모바일(삼성), 반도체 IP(Arm), 데이터센터(퓨리오사AI), 엣지(모빌린트)에 이어 클라우드까지 인공지능(AI) 모델 경량화 사업 영역을 넓힌다. 노타는 AWS 공인 파트너 자격으로 트레이니움을 포함한 AWS AI 칩 환경에서 고객 AI 모델 경량화 및 튜닝 서비스를 제공한다고 7일 밝혔다. 노타는 이번 협력으로 자사 플랫폼 '넷츠프레소' 기반 AI 모델 튜닝 서비스를 출시한다. 대규모 AI 모델 학습에서 토큰 경제성을 제공하는 AWS 트레이니움과 고성능 추론을 낮은 비용으로 제공하는 AWS 인퍼런시아 도입을 검토하는 기업 고객이 대상이다. 넷츠프레소는 AI 모델 크기를 최대 90% 이상 축소하면서도 정확도를 유지할 수 있는 경량화·배포 자동화 플랫폼이다. 서비스는 기술검증(PoC) 및 진단, 모델 포팅 및 경량화, 성능 튜닝 단계로 구성된다. 노타는 AWS 트레이니움 및 인퍼런시아 환경에서 대규모언어모델(LLM) 튜닝 경험을 축적해왔다. 320억 개 파라미터 규모의 고성능 언어 모델에 경량화 기술을 적용해 모델 크기를 68% 줄이면서도 정확도 손실을 1% 미만으로 유지하는 성과를 달성했다. 채명수 노타 대표는 "고객이 뛰어난 가격 대비 성능을 제공하는 AWS AI 칩 성능을 자사 모델에서 온전히 활용할 수 있도록 모델 튜닝을 지원한다"며 "AWS AI 칩 기반 인프라 도입을 검토하는 기업 고객에게 실질적인 비용 효율화 성과를 제공하겠다"고 강조했다.

2026.07.07 16:53이나연 기자

노타, 'NVA' 네이버클라우드 마켓플레이스 올려…"고객 접점 확대"

노타가 비전언어모델(VLM) 기반 영상 관제 솔루션의 클라우드 유통 채널을 확대했다. 노타는 영상 관제 솔루션 'NVA'를 네이버클라우드 마켓플레이스에 등재했다고 2일 밝혔다. 네이버클라우드 마켓플레이스는 기업·기관 고객이 네이버클라우드 플랫폼 기반 서비스를 확인·도입할 수 있게 돕는 온라인 스토어다. NVA는 기존 컴퓨터 비전 기반 객체 탐지를 넘어 영상 속 상황과 맥락을 이해하고 이상 상황을 분석·요약하는 영상 관제 솔루션이다. 복합적인 상황을 텍스트로 설명하고 의심 상황을 판단할 수 있는 것이 특징이다. 노타는 이번 등재 계기로 NVA 고객 접점과 매출 채널을 넓히는 계기가 될 것으로 보고 있다. 기존 산업별 프로젝트와 직접 영업 중심 도입 방식에서 나아가 네이버클라우드 고객 대상으로 클라우드 기반 신규 시장을 발굴할 수 있는 기반을 마련했다는 이유에서다. NVA는 지난해 출시 후 산업안전, 교통, 재난 대응, 미디어, 공공 선별관제 등 다양한 영상 모니터링 분야로 적용 범위를 넓혀왔다. 코오롱인더스트리와 대전지방국토관리청 등 다수 기업과 공공기관에서 활용되고 있다. 교통관제 분야에서는 중동과 케냐 등 해외 시장으로도 도입 사례를 확대하고 있다. 노타는 2026년 상반기 NVA 수주는 전년 동기 대비 1.8배 증가했다고 밝혔다. 산업 현장에서 즉각적인 상황 대응을 위해 VLM 기반 영상 분석을 온디바이스 환경에서 구현하려는 수요가 커지고 있는 것으로 전해졌다. 채명수 노타 대표는 "이번 네이버클라우드 마켓플레이스 등재를 통해 민간·금융·공공 고객 접점을 확대하고, 클라우드 기반 신규 매출 채널을 적극 발굴해 나가겠다"고 말했다.

2026.07.02 17:01김미정 기자

[유미's 픽] "엔비디아 쿠다 장벽 넘자"…AI 반도체, SW 경쟁 불붙었다

인공지능(AI) 반도체 기업들이 잇따라 모델 최적화 소프트웨어 역량 확보에 나서고 있다. 칩 설계만으로는 AI 인프라 경쟁에서 우위를 점하기 어려워지면서 한정된 컴퓨팅·메모리 자원으로 더 많은 연산을 처리하는 소프트웨어 기술의 가치가 부각되는 분위기다. 퀄컴은 지난달 24일 AI 소프트웨어 기업 모듈러를 약 40억 달러 규모 주식 거래로 인수하겠다고 발표했다. 모듈러는 AI 모델을 다양한 칩에서 실행할 수 있도록 돕는 소프트웨어 기업이다. 로이터는 이번 인수가 퀄컴을 엔비디아 '쿠다(CUDA)'와 경쟁하는 소프트웨어 플랫폼 경쟁에 올려놓는 움직임이라고 평가했다. 국내에서도 비슷한 흐름이 나타났다. AI 반도체 기업 리벨리온은 지난달 30일 AI 추론 최적화 기업 스퀴즈비츠 인수를 발표했다. 스퀴즈비츠는 대형 AI 모델을 더 적은 연산·메모리 자원으로 구동하기 위한 모델 압축과 양자화, 추론 최적화 기술을 보유한 기업이다. 리벨리온은 이번 인수를 통해 신경망처리장치(NPU) 하드웨어와 소프트웨어 최적화, 추론 서빙을 함께 제공하는 통합 AI 인프라 기업으로 사업 범위를 넓힌다는 계획이다. 업계 관계자는 "AI 반도체 기업 입장에선 자체 칩 위에서 고객 모델을 빠르고 안정적으로 실행시키는 역량이 영업 경쟁력과 직결된다"며 "칩을 공급하는 데 그치지 않고 실제 워크로드 성능까지 입증해야 하는 수요가 커진 셈"이라고 설명했다.AI 모델 최적화 기업 노타도 같은 날 퓨리오사AI의 데이터센터용 NPU 환경에서 LG AI연구원의 엑사원 236B 최적화 결과를 공개해 주목받았다. 엑사원 236B는 약 2360억 개 파라미터 규모의 대형 AI 모델로, 노타는 모델 크기를 약 71% 줄이면서도 주요 평가 항목에서 원본과 유사한 수준의 정확도를 유지했다. 데이터센터 인프라 최적화 기업 망고부스트도 AI 실행 효율 경쟁의 한 축으로 꼽힌다. 망고부스트는 데이터처리장치(DPU)를 앞세워 네트워킹·스토리지·보안 등 데이터센터 인프라 작업을 중앙처리장치(CPU)에서 분리하는 기술을 개발해왔다. AI 모델 자체를 줄이는 방식은 아니지만 GPU와 서버 자원을 AI 연산에 더 집중시키는 구조라는 점에서 모델 최적화 기업들과 같은 수요를 겨냥하고 있다는 평가를 받는다. 이처럼 AI 반도체 시장에서 성능 최적화 소프트웨어 기업들이 주목받게 된 것은 생성형 AI 활용 방식이 달라지면서 모델 실행 능력이 더욱 중요해지고 있어서다. 대형언어모델(LLM)이 단순 실험 단계를 넘어 서비스와 업무 시스템에 적용되면서, 기업들은 칩의 이론 성능보다 실제 운영 환경에서 응답 속도와 처리량을 유지하면서 비용을 낮추는 역량을 더 중시하고 있다. 하지만 모델 규모가 커질수록 기업들의 비용 부담은 갈수록 늘어나는 추세다. 특히 LLM은 파라미터 규모가 클수록 추론 과정에서 많은 메모리와 연산 자원을 필요로 한다. 여기에 긴 문맥 처리, 검색증강생성(RAG), AI 에이전트처럼 반복 호출이 많은 서비스가 늘면서 데이터 이동량과 지연시간 관리 부담도 함께 증가하고 있다. 이로 인해 메모리 효율도 AI 인프라 경쟁의 핵심 변수로 떠오르고 있다. 고성능 메모리 확보 경쟁이 이어지고 있지만 모든 기업이 충분한 GPU와 메모리를 확보하기는 어렵다. 같은 하드웨어라도 모델 압축, 양자화, 컴파일러, 런타임, 추론 서빙 구조에 따라 필요한 서버 수와 운영비가 달라질 수 있어 최적화 소프트웨어의 중요성이 커지고 있다.엔비디아가 GPU 시장에서 구축한 소프트웨어 생태계도 반도체 기업들의 움직임을 자극하고 있다. 엔비디아는 GPU 성능뿐 아니라 쿠다를 중심으로 한 개발자 생태계와 소프트웨어 도구를 앞세워 AI 인프라 시장에서 우위를 확보했다. 이에 후발 AI 반도체 기업들은 하드웨어 성능만으로 고객을 설득하기 어려워졌고, 모델 실행과 개발 편의성을 함께 제시해야 하는 압박을 받고 있다. 국내 기업들도 이 같은 구도 변화에 맞춰 전략을 조정하고 있다. 리벨리온은 스퀴즈비츠 인수로 NPU와 최적화 소프트웨어 결합에 나섰고, 퓨리오사AI는 노타와 협력해 대형 모델의 NPU 구동 가능성을 넓히고 있다. 망고부스트는 DPU 기반 인프라 오프로딩으로 데이터센터 내부 병목을 줄이는 방식으로 AI 실행 효율 경쟁에 참여하고 있다. 업계에선 AI가 데이터센터를 넘어 산업 현장으로 확산될수록 최적화 수요가 더 커질 것으로 예상했다. 자동차, 로봇, 제조 설비 등은 전력과 지연시간, 보안 요건이 데이터센터와 다른 만큼, 범용 모델을 그대로 배포하기보다 각 산업과 칩 환경에 맞게 조정하는 역량이 AI 인프라 기업의 경쟁력이 될 것으로 보인다. 이 같은 분위기 속에 AI 반도체 시장이 하드웨어 공급 경쟁을 넘어 소프트웨어 스택 경쟁으로 재편될 가능성도 높아지고 있다. 특히 칩 설계, 모델 최적화, 런타임, 추론 서빙, 인프라 오프로딩을 촘촘하게 묶어 제공하는 기업이 고객 확보에서 유리한 위치를 차지할 것으로 전망된다. 업계 관계자는 "AI 반도체 기업이 고객을 설득하려면 벤치마크 수치뿐 아니라 실제 모델을 자사 칩에서 얼마나 효율적으로 돌릴 수 있는지를 제시해야 한다"며 "소프트웨어 최적화 역량이 없는 칩은 데이터센터와 산업 현장에서 채택 속도가 느릴 수밖에 없다"고 말했다. 그러면서 "AI 인프라 비용 부담이 커질수록 기업들은 같은 서버 자원으로 더 많은 추론을 처리할 수 있는 기술을 찾게 된다"며 "앞으로 AI 반도체 경쟁력은 칩 성능과 함께 모델 최적화, 메모리 효율, 데이터센터 운영 효율을 함께 제공할 수 있느냐에 따라 갈릴 것"이라고 덧붙였다.

2026.07.01 10:53장유미 기자

[ZD SW 투데이] 에스넷그룹, 임직원 ESG 사회공헌 진행 外

지디넷코리아가 소프트웨어(SW) 업계의 다양한 소식을 한 눈에 볼 수 있는 'ZD SW 투데이'를 새롭게 마련했습니다. SW뿐 아니라 클라우드, 보안, 인공지능(AI) 등 여러 분야에서 활발히 활동하고 있는 기업들의 소식을 담은 만큼 좀 더 쉽고 편하게 이슈를 확인해 보시기 바랍니다. [편집자주] ◆에스넷그룹, 임직원 가족과 재사용 PC 정비…디지털 나눔 실천 에스넷그룹은 지난 27일 한국IT복지진흥원과 함께 임직원 가족 참여형 사회공헌 활동 '패밀리가 떴다!'를 진행했다. 이번 활동은 재사용 가능한 PC와 모니터 등 IT 자원을 정비·클리닝해 정보소외계층에 보급함으로써 디지털 격차 해소와 자원순환 가치를 실천하기 위해 마련됐다. 참여자들은 PC 본체 및 모니터 청소, 부품 점검, 물품 확인, 포장 작업 등에 직접 참여했으며, 임직원뿐 아니라 가족과 자녀들도 함께해 ESG와 자원순환의 중요성을 체험하는 시간을 가졌다. 이를 통해 나눔의 의미를 공유하고 환경·사회적 가치에 대한 인식을 높였다. 에스넷그룹은 IT 인프라 기업의 전문성을 활용해 디지털 접근성 향상과 자원순환 문화 확산에 기여하고 있으며, '지.구.빗 플로깅 캠페인', 아름다운가게 도서 기부, '사랑의 PC 보내기' 운동 등 다양한 ESG 활동을 지속적으로 전개하고 있다고 밝혔다. ◆마인드로직 "국내 생성형 AI, GPT 독주 끝"...클로드·제미나이 3강 구도 마인드로직은 멀티 AI 에이전트 플랫폼 '팩트챗'의 약 50만 명 이용자 데이터를 분석한 결과를 처음 공개했다. 분석에 따르면 생성형 AI 시장은 특정 모델 중심에서 벗어나 GPT, 클로드, 제미나이가 경쟁하는 '3강 구도'로 재편되고 있는 것으로 나타났다. 클로드는 지난해 9월 5.7%였던 사용 비중이 올해 5월 36%까지 상승하며 34.8%를 기록한 GPT를 처음으로 추월했다. 제미나이 역시 20% 이상의 점유율을 유지하며 존재감을 확대했다. 마인드로직은 이러한 변화가 이용자들의 AI 활용 역량 향상에 따른 결과로 목적과 업무 특성에 따라 다양한 거대언어모델(LLM)을 선택하는 '멀티 AI' 활용이 확산되고 있다고 분석했다. 또 여러 AI 모델을 자동 조합해 최적의 결과를 제공하는 '슈퍼 에이전트' 기능의 사용 비중도 지난 5월 2.3%에서 6월 11.6%로 급증하며 새로운 AI 이용 패러다임으로 부상하고 있다고 밝혔다. ◆리미니스트리트, 평화홀딩스 SAP·오라클 유지보수 혁신 지원 리미니스트리트는 평화홀딩스의 SAP ERP 및 오라클 환경에 대한 제3자 유지보수 서비스를 제공하며 유지보수 혁신과 디지털 전환 가속화를 지원하고 있다고 밝혔다. 평화홀딩스는 리미니스트리트 도입을 통해 기존 벤더 중심 유지보수 체계에서 벗어나 연간 유지보수 비용을 50% 이상 절감했으며 SAP HR 연말정산과 급여 처리 등 한국형 업무 환경에 최적화된 기술 지원과 그룹사 통합 시스템의 안정적인 운영 체계를 확보했다. ◆세이지-인천국제공항공사, AI-PORT 구현 상생협력 협약 체결 세이지는 인천국제공항공사와 '인천공항 AI-PORT 구현을 위한 상생협력 업무협약(MOU)'을 체결하고 인천공항 셔틀트레인에 적용할 '엣지 AI 기반 통합 안전 관제 시스템'의 현장 실증에 나선다. 우선 승강장 출입문 5개소에서 감지 정확도와 응답 속도를 검증한 뒤 제1터미널·탑승동·제2터미널 전 구간으로 확대 적용을 추진할 계획이다. ◆노타, KCC 2026서 온디바이스 AI 최적화 경진대회 성료 노타는 제주에서 열린 한국컴퓨터종합학술대회(KCC 2026)에서 AI 최적화 플랫폼 '넷츠프레소'를 활용한 '온디바이스 AI 최적화 경진대회'를 개최했다. 이번 대회는 제한된 하드웨어 환경에서도 AI 모델이 빠르고 효율적으로 동작할 수 있도록 최적화하는 역량을 겨루는 행사로, 참가자들은 노타가 제공한 환경을 기반으로 성능 개선에 도전했다. 대회에서는 중앙대학교 '에코프루너' 팀이 우승을 차지했으며, 해당 팀은 소형 디바이스에서 LLM을 효율적으로 구동할 수 있는 최적화 방안을 제안해 토큰당 응답 지연시간을 약 6.7배 개선하고 메모리 사용량을 85% 절감하는 성과를 거뒀다. ◆유닉스, 테크에이스와 헤어케어 콘텐츠·업무 혁신 기반 마련 유닉스는테크에이스와 협력해 내부 업무 프로세스 혁신과 헤어케어 콘텐츠 데이터 구조화에 나선다. 유닉스가 운영 중인 프로페셔널 헤어 디자이너 네트워크와 맞춤형 콘텐츠 서비스 '스타일 라이브러리'를 핵심 자산으로 삼아 전문가 경험과 소비자 니즈를 연결하는 콘텐츠 경쟁력을 강화한다는 전략이다. 양사는 분산된 내부 자료와 헤어케어 콘텐츠를 체계적인 데이터 자산으로 전환하고 이를 기반으로 AI 업무 지원 환경 구축과 콘텐츠 고도화를 단계적으로 추진할 예정이다. ◆스마일샤크, AWS와 법률산업박람회 참가 스마일샤크는 아마존웹서비스(AWS)와 함께 '법률 산업 박람회 2026'에 참가해 비용·운영·보안을 통합 관리하는 클라우드 리스크 관리 방안을 선보였다. 양사는 'AWS 기반 비용·운영·보안 리스크 관리'를 주제로 부스를 운영했으며 민감한 정보를 다루는 법률·재무·노무 분야를 중심으로 클라우드 운영 전반의 리스크를 통합 관리할 수 있는 파트너 모델을 소개했다. 또 AWS 신규 고객 지원, 기술검증(PoC) 및 생성형 AI 크레딧 제공 등 다양한 지원 프로그램도 함께 안내하며 클라우드 도입과 운영 과정의 부담을 줄일 수 있는 방안을 제시했다.

2026.06.29 17:00남혁우 기자

노타, 올 상반기 수주 174억원…"AI 추론 최적화 수요 늘어"

노타가 인공지능(AI) 추론 최적화 수요 확대에 힘입어 상반기 수주 성장을 이어간 것으로 나타났다. 노타는 올해 2분기 수주액 약 61억원을 기록했다고 26일 밝혔다. 이는 지난해 2분기 약 28억원보다 184% 증가한 규모다. 이로써 올해 상반기 누적 수주액은 약 174억원이다. 업계에서는 이번 성과가 피지컬 AI와 온디바이스 AI 확산으로 AI 모델 추론 효율성이 중요해진 데 따른 것이란 평가가 이어지고 있다. 최근 피지컬 AI와 온디바이스 AI 확산으로 클라우드에 의존하지 않고 현장에서 AI를 구동하려는 수요가 커지고 있다는 이유에서다. 현재 경량화 기술 활용 범위도 제조·교통·공공안전 전반으로 확대되고 있다. 이에 하드웨어(HW) 환경에 맞춰 AI를 빠르고 안정적으로 실행하려는 최적화 수요가 늘어난 점이 노타 사업 수주 확대에 영향을 줬다는 분석이 이어지고 있다. 넷츠프레소 플랫폼 부문 매출은 올해 전년 동기 대비 184% 올랐다. 노타는 모빌린트와 넷츠프레소 라이선스 계약을 체결하며 삼성전자, 퓨리오사AI, Arm에 이어 반도체와 HW 파트너 대상 공급 레퍼런스를 확대했다. 넷츠프레소는 AI 모델을 반도체와 HW 환경에 맞춰 경량화·최적화하는 플랫폼이다. 제한된 연산 자원에서도 AI가 안정적으로 구동되도록 지원한다. 노타는 온디바이스 AI뿐 아니라 데이터센터향 AI에서도 추론 효율화가 중요해지면서 넷츠프레소 사업 기회가 커지고 있다고 설명했다. 다양한 반도체 환경에서 AI 모델을 최적화하려는 수요가 확대되고 있다는 것이다. 노타 비전 에이전트 솔루션 부문도 성장세를 보였다. 이 부문은 올해 2분기 전년 동기 대비 약 3.2배 성장했다. 노타 비전 에이전트는 제조 현장 산업안전, 건설·플랜트 현장 안전관리, 영상감시, 도시·공공안전, 교통 인프라 등 실제 현장 기반 영역으로 확대되고 있다. 산업 현장과 도시 인프라에서 클라우드 의존도를 낮추고 현장 단말에서 AI를 바로 실행하려는 수요가 커진 영향이다. 도시·공공안전 분야에서는 교통 비전언어모델(VLM) 영상분석과 다중운집 분석 등 레퍼런스를 확보했다. 이를 통해 제조와 산업안전을 넘어 모빌리티, 교통, 공공안전 등 물리적 현장으로 적용 범위를 넓히고 있다. 채명수 노타 대표는 "AI가 다양한 디바이스와 산업 현장으로 확산할수록 제한된 자원 안에서 AI를 빠르고 안정적으로 실행하는 추론 최적화 기술의 중요성은 더욱 커지고 있다"며 "올해 2분기 수주 성과는 넷츠프레소를 중심으로 한 반도체향 사업 확대와 노타 비전 에이전트 기반 경량 AI 솔루션의 현장 적용성이 함께 입증된 결과"라고 말했다.

2026.06.26 14:24김미정 기자

노타, '극한의 엣지' 우주로 간다…온디바이스 AI 확대

노타가 스마트폰·자동차·로봇 등 지상 엣지 환경에서 축적한 온디바이스 인공지능(AI) 최적화 기술을 우주산업으로 확장한다. 노타는 우주의약 전문 기업 스페이스린텍이 주관하는 '딥테크 챌린지 프로젝트(DCP) 생태계혁신형' 과제에서 온디바이스 AI 최적화 기술 개발을 담당한다고 25일 밝혔다. 이번 과제는 중소벤처기업부와 중소기업기술정보진흥원(TIPA) 지원을 받아 4년간 최대 200억원 규모로 추진된다. DCP 생태계혁신형 과제는 국제우주정거장(ISS)과 저궤도 미세중력 환경에서 바이오의약품의 구조연구와 제조 가능성을 검증하고, 실험 과정을 자율 운영하는 의약 제조 플랫폼을 개발하는 게 핵심이다. 우주의약은 미세중력 환경을 활용해 단백질 구조연구와 바이오의약품 제조 공정의 새로운 가능성을 탐색하는 분야다. 이 과정에서 노타는 우주 실험 시스템이 현장에서 데이터를 분석하고 실험 상태를 판단할 수 있도록 하는 온디바이스 AI 기술 개발을 맡는다. 영상·센서 데이터를 기반으로 실험 상태를 인식하고 이상 상황을 탐지하며, 필요한 내용을 자연어로 요약해 지상에 보고할 수 있도록 AI 모델을 경량화·최적화할 계획이다. 채명수 노타 대표는 "우주는 통신·전력·연산 자원이 제한돼 AI가 현장에서 직접 작동해야 하는 극한의 엣지 환경"이라며 "우주 분야에서 요구되는 엣지 AI 기술 경쟁력을 강화하겠다"고 말했다.

2026.06.25 16:20이나연 기자

노타, LG CNS와 'AI 교통체계' 수출 나선다

노타가 LG CNS와 손잡고 인공지능(AI) 기반 지능형 교통 체계(ITS) 기술 글로벌 시장 공략에 나선다. 노타는 LG CNS와 AI 기반 실시간 ITS 기술 사업화를 위한 업무협약(MOU)을 체결했다고 23일 밝혔다. 노타는 AI 모델 경량화·최적화 역량을 바탕으로 엣지 환경에서도 실시간 영상 분석이 가능한 ITS 기술을 구현하고 있다. 생성형 비전언어모델(VLM) 기반 영상관제 솔루션 '노타 비전 에이전트(NVA)'를 통해 교통 흐름 분석·돌발상황 감지·보행자 및 차량 위험 상황 인식 등 교통관제 기능을 제공한다. LG CNS는 도시 교통 흐름을 정밀 분석·예측하는 도시통합운영센터(IOC)를 중심으로 글로벌 스마트시티 시장에서 다양한 ITS 프로젝트를 추진해 왔다. 양사는 노타의 ITS 기술과 LG CNS의 자체 AI 스마트시티 플랫폼을 연계해 교통 인프라 디지털 전환 수요에 공동 대응한다. 특히 미주 지역을 주요 대상 시장으로 삼아 AI 기반 ITS 프로젝트 기회를 함께 발굴할 계획이다. 양사 협력은 이미 케냐 나이로비 ITS 구축사업을 통해 구체화됐다. 노타는 지난해 LG CNS가 주관한 케냐 나이로비 교통관제센터 구축 프로젝트에서 AI 경량화·최적화 기반 스마트교차로 시스템을 엣지 환경에 맞게 구현하며 해외 ITS 사업 협력 레퍼런스를 확보했다. 채명수 노타 대표는 "우리 AI 경량화·최적화 기술이 글로벌 ITS 사업 역량을 갖춘 LG CNS와 결합해 더 큰 시장으로 확장될 계기"라며 "양사 기술과 사업 역량을 바탕으로 현장에서 활용 가능한 AI 기반 지능형 교통 체계 솔루션을 만들겠다"고 말했다.

2026.06.23 09:53이나연 기자

노타, 6109억 AI 특화 시범도시 핵심 기술 맡는다…천안·아산 K-AI 도시 구현 참여

6109억원 규모 국책 사업인 인공지능(AI) 특화 시범도시 사업이 본궤도에 오른다. 독자적인 K-AI 도시 표준 모델 구축을 목표로 온디바이스 AI 기술이 대거 투입된다. 국토교통부가 추진하는 AI 특화 시범도시 공모사업에서 천안·아산 컨소시엄이 충청권 최종 대상지로 선정됐다. 노타는 컨소시엄 내 핵심 기술 기업으로 참여한다고 22일 밝혔다. 이번 사업은 2026년부터 2030년까지 5년간 진행된다. 총사업비는 6109억원 규모다. 이번 사업은 데이터 고립을 넘어 AI가 도시 데이터를 자율 관리하는 프로젝트다. 천안·아산 컨소시엄은 자율형 AI 에이전트 서비스를 실증한다. 노타는 엣지 AI 경량화와 온디바이스 AI 응용 기술을 담당한다. 교통과 안전 등 현장 AI 모델을 최적화해 안정 구동을 지원한다. 거대언어모델(LLM) 기반 자동 보고 체계도 결합한다. 이번 프로젝트는 한국어 특화 언어모델과 엣지 실행 기술을 결합한 사례다. 업스테이지 언어모델을 기반으로 지역 맞춤형 AI 체계를 다진다. 노타는 해당 서비스가 현장 단말에서 구동되도록 최적화 기술을 제공한다. 소버린 AI를 실제 공공 서비스로 구현하는 실행 단계의 기술이다. 노타는 기술 적용 범위를 도시 인프라 영역으로 확장한다. 그동안 스마트폰과 자동차 등 하드웨어 환경에서 최적화 기술을 고도화했다. 이번 사업으로 확보한 모델은 향후 국내외 스마트시티와 교통 분야로 확장 가능하다. 채명수 노타 대표는 "AI 도시는 현장 데이터를 AI가 이해하고 필요한 대응으로 연결하는 도시"라며 "AI 모델 최적화와 온디바이스 AI 기술을 기반으로 천안·아산 AI 특화 시범도시가 대한민국 K-AI 도시의 대표 사례로 자리잡는 데 핵심적인 역할을 하겠다"고 말했다.

2026.06.22 15:36남혁우 기자

AI 주권, 모델 넘어 '운영' 경쟁으로 번진다

앤트로픽의 최상위 인공지능(AI) 모델에 대한 미국의 수출 통제를 계기로 AI가 국가 안보 자산으로 취급되고 있다. 기술 보유국의 정책 변화만으로 모델과 서비스 공급망이 흔들릴 수 있다는 우려가 현실화하면서, 자국 모델 기술력과 이를 효율적으로 운영할 역량이 소버린(주권) AI의 핵심 과제로 떠오르고 있다. 22일 업계에 따르면 미국 행정부는 지난 12일(현지시간) 앤트로픽 신규 모델 '클로드 미토스5'와 '클로드 페이블5'에 대한 외국 국적자의 접근을 제한하는 수출 통제 지침을 내렸다. 해외 접속뿐 아니라 미국 내 체류 중인 외국인과 앤트로픽 소속 외국인 직원의 사용까지 제한 대상에 포함되면서 파장이 커졌다. 이번 조치로 글로벌 AI 보안 협의체 '프로젝트 글래스윙'에 합류한 한국도 영향을 받게 됐다. 프로젝트 글래스윙은 앤트로픽이 '클로드 미토스 프리뷰' 공개와 함께 출범한 협의체다. 보안 취약점 탐지에 특화된 미토스의 오남용을 막기 위해 검증된 기업과 기관에 모델을 선제 제공하고 이를 통해 소프트웨어 취약점을 방어하는 방식으로 운영돼 왔다. 앤트로픽은 지난 2일(현지시간) 글래스윙 참여 대상을 15개국 약 150개 기관으로 확대했다. 국내에서는 한국인터넷진흥원(KISA), 삼성전자, SK하이닉스, SK텔레콤 등이 참여했다. 그러나 이후 미토스5와 페이블5에 대한 수출 통제가 내려지면서 국내 참여 기관들은 본격적인 모델 활용에 나서기 전부터 접근 제약에 직면했다. 업계는 이번 사태가 특정 빅테크 모델을 쓰지 못하게 된 문제에 그치지 않는다고 본다. 해외 사업자의 모델과 응용프로그램인터페이스(API), 클라우드에 의존하는 구조에서는 공급국의 정책 변화나 사업자 판단만으로 AI 서비스 운영 자체가 흔들릴 수 있기 때문이다. 프런티어 AI를 외부에서 들여온다는 것은 모델 하나를 사용하는 문제가 아니라 개발·배포·운영 환경 전반을 외부 스택에 의존하는 문제라는 지적이다. 한국은 외산 AI 의존도를 낮추기 위해 독자 AI 파운데이션 모델 개발에 나서고 있다. 지난해부터 과학기술정보통신부가 추진한 '독자 AI 파운데이션 모델(독파모)' 프로젝트는 거대언어모델(LLM)과 멀티모달 등 주요 AI 영역에서 원천 기술력을 확보하는 것을 목표로 한다. 다만 업계에서는 자국 AI 모델 개발만으로는 충분하지 않다는 목소리가 나온다. 국내에서 확보 가능한 컴퓨팅 자원과 인프라 안에서 모델을 안정적으로 학습·추론하고 서비스할 수 있는 운영 역량도 함께 갖춰야 한다는 것이다. 미국과 중국의 대형 사업자처럼 대규모 그래픽처리장치(GPU)와 데이터센터를 단기간에 확보하기 어려운 만큼, 제한된 연산 자원의 활용 효율이 경쟁력으로 꼽힌다. 최신 AI 추론 환경은 기존 데이터센터보다 높은 전력 밀도와 메모리 자원을 요구한다. 이에 따라 인프라 확충과 함께 모델 구조와 서비스 환경에 맞춰 정밀도, 메모리 사용량, 처리 속도를 조정하는 경량화·최적화 기술에도 관심이 쏠린다. 같은 인프라에서 처리할 수 있는 작업량을 늘리고 운영 비용을 낮출 수 있어서다. 이 같은 운영 최적화는 독파모 프로젝트에서도 적용되고 있다. 업스테이지 컨소시엄에 참여 중인 노타는 솔라 계열 모델을 국내 인프라 환경에서 구동하기 위한 압축·최적화 작업을 맡고 있다. 이 회사는 대규모 전문가 혼합(MoE) 모델에서 중요도가 낮은 영역을 선별적으로 압축해 메모리 사용량을 줄이고 성능 저하를 최소화하는 기술을 제공한다. 실제 업스테이지 '솔라 오픈 100B'에 노타의 최적화 기술을 적용한 결과, 메모리 사용량을 약 72.8% 줄이면서 원본 모델과 유사한 성능 지표를 유지한 것으로 나타났다. 업계 관계자는 "앤트로픽 사태가 단발성 사건으로 끝나더라도 AI 인프라 종속의 구조적 위험은 그대로 남을 것"이라며 "독자 개발한 자국 모델을 한정된 자원에서 효율적으로 가동하는 경량화·최적화 기술이 함께 가야 AI 주권이 외부 정책 변수에 흔들리지 않는다"고 말했다.

2026.06.22 11:37이나연 기자

[ZD SW 투데이] 노타, '2026 대한민국 AI산업대상' 부총리 겸 과기정통부 장관상 수상 外

지디넷코리아가 소프트웨어(SW) 업계의 다양한 소식을 한 눈에 볼 수 있는 'ZD SW 투데이'를 새롭게 마련했습니다. SW뿐 아니라 클라우드, 보안, 인공지능(AI) 등 여러 분야에서 활발히 활동하고 있는 기업들의 소식을 담은 만큼 좀 더 쉽고 편하게 이슈를 확인해 보시기 바랍니다. [편집자주] ◆아시아나IDT, AI 안전관리·저탄소 인증 동시 획득 아시아나IDT가 도시재생안전협회(CRSA)로부터 AI 안전관리 인증 및 저탄소 인증을 동시에 획득했다. 이번 인증은 아시아나IDT가 추진하고 있는 산업안전보건 플랫폼의 인공지능(AI) 기반 안전관리 역량 및 친환경 경영 성과를 종합적으로 평가한 결과다. 아시아나IDT는 자체 개발한 AI 산업안전보건 플랫폼 '플랜투두(Plan2Do)'를 제조, 물류, 공공기관 등 다양한 현장에 적용하며 산업 전반의 안전관리 디지털 전환을 지원하고 있다. 플랜투두는 중대재해처벌법 대응을 위한 안전보건관리체계 구축과 위험성 평가, 안전점검, 개선조치 관리 등을 통합 지원하는 서비스형 소프트웨어(SaaS 기반 플랫폼이다. AI 기반 위험요인 분석, 현장 이미지 안전점검, 위험성 평가 자동화, 모바일 현장관리 기능 등을 제공해 현장 중심의 선제적 안전관리 체계 구축을 지원한다. ◆뉴엔AI, 온톨로지 기반 AI 기술력 입증 뉴엔AI가 제15회 스마트테크 코리아(STK 2026)에 참가해 온톨로지 기반 AI 플랫폼 라인업을 선보였다. 이번 전시에서는 범용AI 분석 서비스 '퀘타아이(Quettai)'를 필두로, 온톨로지 기반으로 시장 변화를 선제 포착하는 플랫폼 '퀘타 K-마켓 렌즈 2.0'과 보건·의료 및 보험 시장 특화 리스크 탐지 플랫폼 '퀘타 페어 실드'가 시연됐다. 이밖에도 온톨로지 기반 패션 트렌드 분석 플랫폼과 푸드 분석 영역에서는 소비자 인식 데이터 기반 식자재 가격 예측 AI 모델을 선보이며 세부 산업별 특화 솔루션 기술력을 입증했다. ◆슈퍼브에이아이 "엔비디아와 협력 강화" 슈퍼브에이아이는 'GTC 타이베이(GTC Taipei) 2026'에 엔비디아 인셉션 부스 참가 기업으로 선정돼 행사에 참여했다. 슈퍼브에이아이는 행사 기간 동안 비전 AI 개발 전 과정을 지원하는 올인원 플랫폼 '슈퍼브 플랫폼(Superb Platform)'과 산업용 비전 파운데이션 모델 '제로(ZERO)', 영상 관제 솔루션 등을 선보였다. 이번 행사를 통해 슈퍼브에이아이는 엔비디아 인셉션 피지컬 AI 부문과 기술 협업 방안 및 조인트 공동 시장 공략(GTM) 기회를 구체적으로 논의했다. 추후 글로벌 무대는 물론 한국 시장에서도 엔비디아와의 협력을 본격화해 나갈 방침이다. ◆이안, 2026 대한민국 가상융합대상 수상 이안이 2026 대한민국 가상융합대상에서 대상을 수상했다. 과학기술정보통신부가 주최하고 한국가상융합디지털산업협회가 주관하는 대한민국 가상융합대상은 메타버스·디지털트윈 등 가상융합 기술을 활용해 산업 현장의 혁신과 디지털 전환을 이끌고 있는 우수 기업을 선정하는 시상이다. 이안은 산업시설 공사 현장에 디지털트윈과 증강현실(AR) 기술을 적용해 시공관리의 생산성과 정확성을 높인 공로를 인정받아 대상을 수상했다. ◆더존비즈온, 직장인 맞춤형 AI 리터러시 교육 더존비즈온이 기업 임직원을 위해 점심시간과 퇴근시간 등 다양한 시간대에 맞춘 AI 리터러시 교육 프로그램을 운영한다. 더존비즈온은 시간대별 맞춤형 실습 세미나인 점심 AI 클래스와 퇴근 후 AI 서밋을 기획했다. 서울 중구 더존을지타워 ATEC에서 사전 신청을 통해 상시 운영되며 위하고와 아마란스 10 세션으로 나누어 진행된다. 낮 12시 점심시간을 활용한 점심 AI 클래스는 보고서 작성, 업무 분석, 문서 자동화, 전사적자원관리(ERP) 연계 등 현장에서 즉시 적용 가능한 다양한 AI 활용법을 다룬다. 저녁 특화 세미나인 퇴근 후 AI 서밋은 종료 시간 제한 없이 자유로운 질의응답과 토론이 이어지는 것이 특징이다. ◆갤럭시코퍼레이션, 유럽 공영방송 집중 조명 갤럭시코퍼레이션이 이탈리아 최대 국영방송인 RAI의 시사 프로그램 '인 메초라(In Mezz'ora)'를 통해 소개되며 글로벌 시장에서 존재감을 확대하고 있다. 방송은 한국이 AI, 휴머노이드 로봇, 디지털 엔터테인먼트 산업을 중심으로 글로벌 기술 경쟁의 새로운 흐름을 주도하고 있다고 분석했으며 혁신을 이끌고 있는 기업으로 갤럭시코퍼레이션과 최용호 대표를 비중 있게 다뤘다. 갤럭시코퍼레이션은 향후 피지컬 AI, 휴머노이드 로봇, 글로벌 IP 비즈니스를 중심으로 인간과 로봇이 공존하는 미래 생태계 구축에 속도를 낼 계획이다. ◆노타, '2026 대한민국 AI산업대상' 부총리 겸 과기정통부 장관상 수상 노타가 2026 대한민국 인공지능산업대상에서 부총리 겸 과학기술정보통신부 장관상을 수상했다. 대한민국 인공지능산업대상은 국내 AI 기업의 사기 진작과 AI 산업 성장 및 활성화를 위해 우수 AI 기업을 선정해 시상하는 행사다. 노타는 온디바이스 AI 분야의 성장성과 혁신성을 높게 평가받아 최고 훈격인 부총리 겸 과학기술정보통신부 장관상을 수상했다. 특히 온디바이스 AI와 피지컬 AI 구현에 필요한 모델 최적화 기술을 고도화하고, 이를 실제 산업 현장과 상용 제품에 적용해온 점을 인정받았다.

2026.06.12 17:08남혁우 기자

노타, 세계적 학회서 'MoE' 특화 AI 최적화 기술력 입증

노타가 세계적 머신러닝 학회에서 거대언어모델(LLM) 핵심 구조로 주목받는 전문가 혼합(MoE) 모델 최적화 분야 기술력을 인정받았다. 지난 엔비디아 네모트론 해커톤에서 데이터 기반 MoE 양자화 기법으로 트랙 우승과 종합우승을 차지한 데 이은 성과다. 노타는 ICML 2026의 '리소스 적응형 파운데이션 모델 추론(AdaptFM)' 워크숍에서 자사의 MoE 특화 양자화 알고리즘 논문 2편이 최종 채택됐다고 11일 밝혔다. MoE는 여러 전문가 모델 중 필요한 일부만 선택해 동작하는 방식으로, 대형 AI 모델의 성능과 효율을 동시에 높일 수 있어 최신 LLM에서 빠르게 확산하고 있다. 다만 모델 구조가 복잡한 만큼 이를 더 작고 가볍게 만드는 양자화 과정에서도 기존 일반 모델과는 다른 접근이 필요하다. 이번에 채택된 첫 번째 논문 'DREAM-MoE'는 대규모 AI 모델을 여러 구간으로 나눠 양자화할 때 발생할 수 있는 판단 흐름의 변화를 줄이는 방법을 제안한다. 노타는 앞쪽 구간에서 생긴 작은 오차가 뒤쪽 구간 전문가 선택까지 바꿀 수 있다는 점에 주목해 양자화 이후에도 모델이 원래와 유사한 방식으로 필요한 전문가를 선택할 수 있도록 했다. 또 다른 논문 'SRA-MoE'는 모델 결과에 더 큰 영향을 주는 중요한 입력을 선별해 우선적으로 보호하는 방법을 제안한다. 모든 입력을 동일하게 다루기보다 핵심 입력에서 전문가 선택이 크게 흔들리지 않도록 설계해 제한된 자원으로도 모델 품질을 효과적으로 유지할 수 있도록 했다. 두 연구 모두 최신 MoE 특화 양자화 기법들과 비교해 더 높은 성능이 확인됐다고 노타는 강조했다. AI 모델을 더 적은 메모리와 연산 자원으로 실행하면서도 품질 저하를 줄였다는 설명이다. 노타는 정부 주도의 독자 파운데이션 모델 개발 과제에 참여 중인 업스테이지 컨소시엄에서 '솔라 MoE'와 같은 대규모 모델 최적화를 추진하는 한편, 엔비디아 네모트론 3 나노 모델 양자화 경험을 네모트론 울트라 등 최신 모델로 확장하는 등 기술 적용 범위를 넓히고 있다. 채명수 노타 대표는 "이번 논문 채택은 노타가 MoE에 특화된 양자화 기술을 꾸준히 고도화해 온 성과"라며 "대규모 AI 모델을 더 효율적으로 활용할 수 있는 최적화 기술 개발을 이어가겠다"고 말했다.

2026.06.11 10:16이나연 기자

노타, 천안시 하천·지하차도·우범지역에 온디바이스 AI 심는다

노타가 자사의 온디바이스 인공지능(AI) 최적화 기술로 지역 공공 안전 인프라 분야 재난안전 대응 모델 구축에 나선다. 과학기술정보통신부와 정보통신산업진흥원(NIPA)이 추진하는 2026년 온디바이스 AI 서비스 실증·확산 사업의 '환경적응형 다목적 온디바이스 AI 기반 도시안전망 실증·확산' 과제에 참여기업으로 최종 선정됐다고 8일 밝혔다. 이번 과제는 약 107억원 규모로 추진되며 충남테크노파크를 주관기관으로 노타는 충청남도, 천안시 등과 함께 컨소시엄을 구성해 참여한다. 사업 대상지는 천안시 하천, 지하차도, 하상도로, 우범지역 등 재난·치안 대응이 필요한 주요 공간이다. 각 장 센서 데이터와 CCTV 영상을 활용해 침수, 차량 진입, 이상행동 등 재난·생활안전 상황을 조기에 감지하는 것을 목표로 한다. 노타는 이번 과제에서 비전 언어 모델(VLM) 기반 복합 위험 검지 AI 모델 개발과 온디바이스 환경 최적화를 담당한다. 자사 AI 모델 경량화·최적화 플랫폼 넷츠프레소를 활용해 비전 언어 모델(VLM)을 모빌린트 신경망처리장치(NPU) 환경에 맞게 경량화하고, 도시 안전 현장의 다양한 위험 요소를 빠르게 인식할 수 있는 AI 솔루션을 구현할 예정이다. 이번 사업 핵심은 기존 중앙 서버와 관제 인력 중심 도시 관제 구조를 현장 중심 지능형 대응 체계로 확장하는 데 있다. AI 단말이 위험 상황을 직접 인지하고 차단기, 전광판, 스피커 등 현장 설비와 연계해 즉각적인 대응을 지원함으로써 재난 발생 시 골든타임 확보에 기여할 수 있다. CCTV 영상 등 민감 데이터를 현장에서 처리해 통신 지연과 네트워크 장애 영향을 줄이고 보안성과 개인정보 보호 수준도 높일 수 있다. 채명수 노타 대표는 "이번 사업은 온디바이스 AI가 시민 안전과 직결되는 공공 인프라에 적용되는 중요한 사례"라며 "온디바이스 AI 최적화 기술을 바탕으로 재난 상황을 현장에서 빠르게 인지하고 대응할 도시안전망 구현에 기여하겠다"고 말했다.

2026.06.08 09:51이나연 기자

노타, 인텔 AI PC 추론 효율 끌어올렸다

노타가 인공지능(AI) PC 환경에서 그래픽처리장치(GPU)와 신경망처리장치(NPU)를 동시에 활용하는 이기종 컴퓨팅 기반 거대언어모델(LLM) 추론 최적화 기술을 구현하며 온디바이스 AI 성능 개선에 나섰다. 노타는 인텔 루나 레이크 기반 AI PC에서 이기종 컴퓨팅 기반 LLM 추론 최적화 기술을 구현했다고 4일 밝혔다. 이기종 컴퓨팅은 서로 다른 장점을 가진 프로세서를 함께 활용하는 방식이다. 하나의 프로세서에 모든 일을 맡기는 대신 중앙처리장치(CPU)와 GPU, NPU처럼 역할이 다른 장치가 각자 잘하는 일을 나눠 맡도록 설계하는 것이 핵심이다. 노타는 인텔 루나 레이크 기반 AI PC에서 LLM 실행 과정을 입력 처리 단계와 답변 생성 단계로 나눠 분석하고 각 단계에 적합한 연산 장치를 배치하는 분리형 추론 방식을 적용했다. 이에 따라 입력 처리 연산은 GPU에서, 답변 생성 연산은 NPU에서 실행되도록 구성했다. 성능 평가에 따르면 노타의 분리형 추론 방식을 적용한 결과, 단일 GPU 실행 방식 대비 토큰당 에너지 소비를 약 32% 줄이고 생성 처리량을 약 12% 높였다. 또 단일 NPU 실행 방식 대비 첫 응답 지연시간을 약 89% 단축했다. 채명수 노타 대표는 "AI PC 시대엔 GPU, NPU 등 다양한 연산 장치를 모델 특성에 맞게 조합하는 최적화 역량이 실제 AI 경험을 좌우한다"며 "모델 경량화, 런타임 최적화, 하드웨어 최적화 기술을 결합해 AI PC 시대의 온디바이스 AI 실행 효율을 높이겠다"고 말했다.

2026.06.04 15:02이나연 기자

노타 "피지컬 AI 시대 핵심은 엣지 AI 최적화"

노타가 엔비디아 주최 아시아태평양(APAC) 로보틱스·엣지 인공지능(AI) 파트너 행사에 한국 기업 중 유일하게 패널로 참여했다. 이 자리에서 회사는 피지컬 AI 구현을 위한 엣지 AI 최적화 기술의 중요성을 강조했다. 노타는 김태호 최고기술책임자(CTO) 겸 공동창업자가 대만에서 열린 '엔비디아 APAC 로보틱스 앤 엣지 AI 파트너 데이'에서 패널 토크에 참여했다고 2일 밝혔다. 이번 행사는 대만 타이베이에서 열리는 글로벌 정보기술(IT) 박람회 '컴퓨텍스 2026' 기간 중 엔비디아가 개최한 APAC 지역 파트너 행사다. 로보틱스 및 엣지 AI 분야 주요 기업이 모여 피지컬 AI, 스마트시티, 산업 현장 지능화, 비전 AI 에이전트의 발전 방향을 논의하는 자리로 마련됐다. 김태호 CTO는 '피지컬 AI는 어떻게 스마트 공간을 변화시키는가'를 주제로 진행된 패널 토크에서 피지컬 AI 시대에 온디바이스 AI와 엣지 AI 최적화 기술이 갖는 의미를 공유했다. 도시와 산업 현장에서는 네트워크 환경, 비용, 개인정보 보호, 실시간성 등 다양한 제약이 존재하는 만큼, AI를 클라우드가 아닌 현장 단에서 실시간 구동하는 것이 중요하다고 강조했다. 노타는 이러한 환경에서 AI 모델을 효율적으로 구동하기 위한 최적화 기술이 피지컬 AI 구현의 핵심 기반이라고 설명했다. 또 스마트시티와 산업공간이 단순한 데이터 수집 공간을 넘어 AI가 상황을 이해하고 판단을 보조하는 '지능형 공간'으로 진화하고 있다고 부연했다. 앞서 노타는 엔비디아 커넥트 파트너로 선정되고 엔비디아 네모트론 해커톤에서 우승하는 등 엔비디아 생태계 안에서 AI 최적화 기술 역량을 선보여왔다. 노타는 이번 행사와 같은 기간 열린 '엔비디아 코리아 파트너 나이트'에도 참석해 젠슨 황 엔비디아 최고경영자(CEO)를 비롯해 국내 주요 기업 관계자와 교류했다. 김 CTO는 "피지컬 AI 시대에는 AI가 디지털 공간을 넘어 실제 물리 환경에서 상황을 인지하고 판단하며 대응하는 역량이 중요해지고 있다"며 "글로벌 파트너들과 함께 로보틱스와 엣지 AI 생태계 확산에 기여하겠다"고 말했다.

2026.06.02 11:20이나연 기자

엔비디아 커넥트 파트너 '노타', 산업 현장 위한 피지컬 AI 박차

노타가 엔비디아의 생성형 인공지능(AI) 기반 영상 검색·요약 기술을 바탕으로 AI 영상관제 시장 공략에 속도를 낸다. 노타는 엔비디아 VSS(Video Search and Summarization)를 기반으로 자사 영상관제 솔루션 노타 비전 에이전트(NVA)를 고도화하고, 산업안전·교통관제 등 실제 현장 적용을 확대한다고 1일 밝혔다. NVA는 비전언어모델(VLM)을 기반으로 영상 속 상황과 맥락을 이해하고, 관제자가 필요한 정보를 자연어 기반으로 검색·요약·보고할 수 있도록 지원하는 생성형 AI 영상관제 솔루션이다. 노타와 엔비디아는 영상 검색·요약·질의응답 같은 기본 기능을 넘어 산업안전·교통관제 각 도메인에서 영상 데이터가 실질적인 의사결정으로 연결되는 AI 전환(AX)을 현장에서 함께 실현할 방침이다. 우선 교통관제 분야에서 노타는 대전지방국토관리청에서 운영하는 교통 관제시스템에 NVA를 구축했다. 도로 위 CCTV를 통해 사고, 화재, 장애물 등 돌발상황을 실시간으로 검지하고 돌발 이벤트에 따른 차선별 교통정보, 대응 상황을 자동으로 요약하고 리포팅한다. 해당 시스템은 국토교통부 지능형교통체계(ITS) 기본 성능평가에서 99% 정확도(최상급)를 획득했다. 산업안전 분야에서도 엔비디아 VSS 기반 NVA 적용이 확대되고 있다. 노타는 코오롱베니트와 함께 코오롱인더스트리 김천2공장에 NVA를 적용했다. NVA는 작업자 안전, 위험 구역 모니터링, 안전 수칙 위반 가능성 선별 등 산업안전 목적의 영상관제에 활용된다. VSS 기반 영상 검색·요약 기능을 바탕으로 위험 상황을 빠르게 식별하고 관제자가 필요한 정보를 자연어 기반으로 요약·보고할 수 있도록 지원한다. 채명수 노타 대표는 "대전지방국토관리청과 코오롱베니트 산업안전 사례처럼 실제 현장에서 검증된 적용 사례를 확대해 엔비디아와 함께 글로벌 영상 AI 에이전트 시장을 넓히겠다"고 말했다.

2026.06.01 10:00이나연 기자

노타, 퀄컴 엣지 디바이스서 '피지컬 AI' 속도 7배 높였다

노타가 로봇 동작 생성에 필요한 시각언어행동(VLA) 모델을 엣지 디바이스에서 구동하고 추론 속도를 최대 7배 높이며 피지컬 인공지능(AI) 온디바이스 구현 가능성을 입증했다. 노타는 퀄컴 최신 엣지 AI 디바이스 '드래곤윙(Dragonwing) IQ-9075' 환경에서 VLA 모델 'SmolVLA 0.45B'를 최적화했다고 29일 밝혔다. 노타는 이번 최적화 과정에서 모델 전체를 줄이지 않고 속도 개선 효과가 크면서 정확도에 미치는 영향을 최소화할 부분을 선별했다. 노타는 로봇 동작을 생성하는 단계의 반복 연산을 줄이는 실시간 추론 최적화와 퀄컴 엣지 AI 디바이스 실행 환경에 맞춰 연산 흐름을 효율화하는 신경망처리장치(NPU) 기반 그래프 최적화를 적용했다. 그 결과 로봇 동작 생성 단계인 액션 헤드 처리 시간은 218ms에서 31ms로 약 85.8% 감소했으며 최대 7배 수준의 속도 개선을 달성했다. 전체 추론 시간도 505ms에서 310ms로 단축됐다. 작업 성공률은 기존 86%에서 85%로 유사한 수준을 유지해 속도를 높이면서도 안정성을 지켰다. 노타는 이번 성과를 미국 산타클라라에서 열린 임베디드 비전 서밋 2026에서 공개했다. 관람객이 직접 물품을 선택하면 최적화된 VLA 모델이 이를 인식하고 로봇팔 동작을 생성해 물품을 집어 바구니에 넣는 실시간 체험형 시연을 진행했다. 채명수 노타 대표는 "피지컬 AI가 산업 현장으로 확산하려면 AI가 실제 환경을 보고 이해하고 행동으로 연결하는 과정을 엣지 AI 디바이스에서 빠르고 안정적으로 처리할 수 있어야 한다"며 "이번 VLA 최적화 사례는 우리 AI 최적화 기술이 피지컬 AI 시대 핵심 기반 기술로 확장됐음을 보여준다"고 말했다.

2026.05.29 14:50이나연 기자

  Prev 1 2 3 Next  

지금 뜨는 기사

이시각 헤드라인

네카오 'AI 수익화' 시점 변했다...네이버는 시작, 카카오는 내년

AI 학과 늘리기만으론 부족…"모든 전공에 AI 역량 심어야"

유니폼부터 AI 로봇 드로잉까지…무료 KT스포츠 팝업 가보니

AI규제는 풀고 OTT는 발목 잡고…'영화 6개월 홀드백' 논란

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.