• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'로컬 AI'통합검색 결과 입니다. (12건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

엔비디아, 유휴 PC GPU로 AI 추론 분산하는 'PAIR' 공개

엔비디아가 4일 가정이나 사무실 내 PC GPU 자원을 이용해 AI 추론을 분산처리하는 '퍼스널 AI 라우터(PAIR)' 기술을 공개했다. 엔비디아는 "현재 미국 가정 중 절반 이상은 PC를 두 대 이상 이용하지만 상당한 연산 성능이 하루 중 대부분 쓰이지 않는 형태로 남아 있다"고 설명했다. 이어 "PAIR는 이처럼 사용되지 않는 PC의 컴퓨팅 자원을 로컬 AI에 활용할 수 있도록 지원하는 무료 오픈소스 소프트웨어"라고 설명했다. PAIR는 올라마와 LM스튜디오를 지원하며 에이전틱 AI 구현에 필요한 여러 개의 작은 작업을 내부 네트워크에 연결된 PC와 분산해 처리하는 방식으로 작동한다. 메인 PC에서 게임이나 콘텐츠 제작 등 다른 작업을 수행하는 동안 AI 워크로드를 상대적으로 여유가 있는 다른 시스템으로 이동하는 것도 가능하다. 다만 페어가 여러 PC의 GPU 메모리를 하나로 합쳐 하나의 대형 GPU처럼 사용하는 것은 아니다. 개별 추론 요청은 특정 시스템에서 처리되며, 여러 장치에 하나의 모델을 분할해 실행하는 방식과는 차이가 있다. 엔비디아는 "클라우드 서비스 대신 가정이나 기업 내 PC 자원을 로컬 AI 인프라로 전환해 로컬 AI와 멀티 에이전트 애플리케이션의 처리량을 높일 수 있다"고 설명했다. PAIR는 엔비디아 지포스 RTX 20 시리즈 이후 GPU와 엔비디아 RTX 프로 워크스테이션 GPU, DGX 스파크와 애플 M4 이후를 지원한다. 지원 운영체제는 윈도, 맥OS, 리눅스이며 그래픽 인터페이스와 터미널 인터페이스를 모두 지원한다.

2026.09.04 08:22권봉석 기자

퍼플렉시티, 맥에 '하이브리드 컴퓨트' 도입…클라우드·로컬 모델 나눠 쓴다

퍼플렉시티가 맥에서 인공지능(AI) 연산 일부를 직접 처리하는 '하이브리드 컴퓨트'를 도입한다. 민감한 개인정보가 포함된 작업은 이용자 기기 안에서 처리하고 고성능이 필요한 작업은 클라우드 모델에 맡겨 개인정보 보호와 비용 효율을 함께 높이겠다는 전략이다. 퍼플렉시티는 맥용 퍼플렉시티 앱 이용자 대상으로 하이브리드 컴퓨트 기능을 적용한다고 2일 공식 블로그에서 발표했다. 이에 따라 AI 에이전트 '컴퓨터'는 작업 성격에 맞춰 로컬 모델과 클라우드 모델을 선택해 활용한다. 혈액검사 결과나 세금 신고서 소송 관련 자료처럼 민감한 파일을 다루는 작업은 맥에서 구동되는 로컬 모델이 맡는 식이다. 퍼플렉시티는 기존 AI 에이전트 대부분이 클라우드 중심으로 작동한다는 점에 주목했다. 네이티브 환경에서 처리할 수 있는 작업과 웹을 거쳐야 하는 작업을 구분하지 않아 상당수 연산과 데이터가 클라우드로 전달되는 구조라는 설명이다. 아라빈드 스리니바스 퍼플렉시티 최고경영자(CEO)는 "우리는 맥 애플 실리콘을 활용해 작업 구조 보완에 나선 것"이라며 "기존 클라우드에서 처리하던 AI 연산 일부를 맥으로 옮겨 이용자 기기에서 직접 수행하도록 지원한다"고 링크드인을 통해 밝혔다. 이어 "로컬 모델이 사용하는 토큰에는 별도 비용도 발생하지 않는다"고 강조했다. 반면 클라우드 모델은 높은 성능이 필요한 작업을 맡는다. 조사와 추론 등 복잡한 작업에는 프론티어 모델을 활용하고, 개인정보 보호가 중요한 작업은 로컬 모델에서 처리하는 식이다. 퍼플렉시티는 두 환경 가운데 어느 쪽에서 작업을 처리할지 판단하기 위해 개인식별정보(PII) 분류기도 활용한다. 분류기가 개인정보 포함 여부를 판단하면 이를 토대로 민감한 작업을 로컬 모델로 보내기 위한 기술적 조치다. 하이브리드 컴퓨트에 활용하는 PII 분류기를 오픈소스로 공개할 예정이다. 스리니바스 CEO는 "하이브리드 컴퓨트는 클라우드 기반 프론티어 모델의 장점과 개인정보를 보호하는 로컬 실행 환경의 장점을 결합한다"고 밝혔다.

2026.09.02 16:57김미정 기자

몽고DB가 제시한 AI 시대 데이터 관리 전략은?

몽고DB가 국내 개발자와 기업 고객을 대상으로 인공지능(AI) 시대 데이터 플랫폼 전략과 주요 기술을 공유하는 자리를 마련했다. 몽고DB는 1일 서울 삼성동 파르나스에서 연례행사 '몽고DB닷로컬 서울'을 개최했다고 밝혔다. 이 행사는 전 세계 개발자와 업계 전문가가 최신 기술과 고객 혁신 사례를 공유하는 자리다. 올해 서울을 비롯해 뭄바이와 리야드, 뉴욕, 런던 등에서 열린다. 이번 행사에서는 AI 에이전트를 위한 지능형 데이터 플랫폼 비전과 최신 기능이 소개됐다. 고객 혁신 사례와 기술 세션, 라이브 데모도 진행됐다. 기조연설에는 장정욱 몽고DB 코리아 지사장과 프랭크 리우 몽고DB 보이지AI 리서치 매니저, 크리스토퍼 셤 몽고DB 제품 관리 총괄 디렉터가 참여했다. 이들은 AI 시대 데이터 플랫폼에 대한 몽고DB의 비전과 최신 AI·제품 관련 내용을 공유했다. 몽고DB는 기업이 AI 서비스를 실제 운영 환경으로 확대하려면 실시간 성능과 벡터 검색·임베딩 등 AI 기능을 데이터 플랫폼과 결합해야 한다고 강조했다. 기업용 거버넌스와 보안을 갖추고 퍼블릭 클라우드부터 프라이빗 데이터센터와 하이브리드 환경까지 지원하는 아키텍처도 필요하다고 주장했다. 행사에서는 국내 기업의 몽고DB 활용 사례도 공개됐다. BC카드와 스트라드비전, CJ ENM, 뤼튼테크놀로지스, 한전KDN 등이 몽고DB를 기반으로 구현한 사례를 발표했다. LG유플러스는 상담원 지원 AI 서비스 '상담 어드바이저' 고도화 과정에서 몽고DB 벡터 서치를 도입했다. 벡터 데이터와 운영 데이터를 단일 시스템에서 관리해 리소스 효율을 30% 높이고 통화당 평균 처리 시간을 7% 단축했다고 밝혔다. BC카드는 페이북 내 AI 핫딜 서비스 '잇플'을 몽고DB 아틀라스로 전환해 하이브리드 검색과 실시간 집계 환경을 구축했다. 한전KDN은 대규모 전력 계량 데이터를 처리하는 계량데이터관리시스템에 몽고DB 샤딩을 적용해 수천만 단위의 전력 데이터를 운영하고 있다고 설명했다. 쏘카는 숙박 예약 서비스 '쏘카스테이'에 몽고DB 서치를 도입해 텍스트 검색과 필터링, 랭킹을 결합한 검색 환경을 구현했다. 뤼튼은 월간 활성 사용자 700만명 넘는 AI 캐릭터 챗 서비스 '크랙'의 검색 기능을 몽고DB로 일원화했다. 장정욱 몽고DB 코리아 지사장은 "현재 한국 산업 전반적으로 기업들이 AI를 프로덕션 환경에 도입하는 과정에서 맞닥뜨리는 벽은 대부분 데이터 레이어"라며 "AI 애플리케이션은 실시간 데이터에 효율적으로 접근하고 처리할 수 있어야 하며, 이를 행동 기반으로 삼지 못한다면 성공하기 어렵다"고 밝혔다.

2026.09.01 14:30김미정 기자

엔비디아, '네모트론 3.5 라이트닝' 공개…로컬 AI 생태계 확장

엔비디아가 오픈모델과 소프트웨어·개발자 도구·하드웨어를 아우르는 로컬 인공지능(AI) 생태계 확대에 나섰다. 엔비디아는 30B 규모 오픈 전문가 혼합 모델 '네모트론 3.5 라이트닝'을 공개하고 여러 대 DGX 스파크를 연결하는 '엔비디아 싱크 클러스터 어시스턴트'를 선보였다고 12일 밝혔다. 메타의 '뮤즈 글리머'와 영상 생성 모델 'LTX-2.5' 등 신규 오픈모델에 대한 그래픽처리장치(GPU) 최적화 지원도 확대했다. 네모트론 3.5 라이트닝은 상시 작동하는 AI 에이전트에 특화된 오픈웨이트 모델이다. 엔비디아에 따르면 동급 오픈모델보다 토큰 생성 속도가 최대 4배 빠르고 작업 완료 시간은 30% 짧다. 개발자는 자체 데이터를 활용해 해당 모델을 파인튜닝할 수 있다. 이메일과 보고서 작성 방식부터 전문 분야 용어와 작업 절차, 코딩 규칙, 프레임워크까지 특정 업무 환경에 맞게 조정할 수 있다. 모델은 엔비디아 RTX PC와 DGX 스파크·젯슨에서 로컬로 실행할 수 있다. RTX 프로 워크스테이션과 DGX 스테이션·GB300 데스크사이드 시스템·데이터센터·클라우드로도 확장할 수 있다. 엔비디아는 원활한 로컬 배포를 위해 가상거대언어모델(vLLM)과 올라마(Ollama), 라마닷시피피(llama.cpp), LM 스튜디오 등 주요 추론·배포 도구 개발사와 협력했다. 개발자는 엔비디아의 저정밀 데이터 형식 'NVFP4'와 범용 양자화 모델 형식 'GGUF' 가운데 사용 환경에 적합한 방식을 선택할 수 있다. 에이전트 작업마다 적합한 AI 모델을 자동으로 선택하는 오픈소스 라우팅 라이브러리 '네모 스위치야드'도 제공된다. 정확도와 처리 속도·비용을 기준으로 각 작업 단계를 여러 모델과 서비스에 분산하는 방식이다. 엔비디아 내부 벤치마크에서는 네모 스위치야드가 프론티어 모델 수준의 작업 완료 성능을 유지하면서 비용을 '오퍼스 4.8'의 약 3분의 1로 낮춘 것으로 나타났다. 네모 스위치야드는 깃허브에서 이용할 수 있다. 엔비디아는 대규모 오픈모델을 로컬에서 실행하기 위한 시스템 연결 기능도 강화했다. 엔비디아 싱크의 클러스터 어시스턴트는 두 대 이상의 DGX 스파크를 하나의 고속 클러스터로 구성해 메모리와 추론·훈련 성능을 확장한다. 개발자가 엔비디아 커넥트엑스-7(NVIDIA ConnectX-7) 포트로 시스템을 연결하면 엔비디아 싱크가 네트워크 구성과 노드 간 작업 분배·시스템 상태 점검을 자동으로 수행한다. 윈도와 맥OS에서 연결된 시스템을 감지하고 테일스케일(Tailscale)을 이용한 비공개 원격 접속도 지원한다. 엔비디아는 이달 말 DGX 스파크에 구글 크롬의 네이티브 ARM64 리눅스 버전과 새로운 자원 모니터 기능을 추가할 예정이다. 사용자는 개별 시스템이나 전체 클러스터의 중앙처리장치와 그래픽처리장치 사용량을 실시간 또는 과거 데이터로 확인할 수 있다. 메타가 공개한 300억 파라미터 규모 오픈웨이트 모델 '뮤즈 글리머'에 대한 지원도 확대했다. 코딩과 로컬 에이전트 작업에 특화된 이 모델은 12만 토큰 이상의 컨텍스트 윈도우를 지원하며 RTX 5090에서 초당 200토큰 이상의 처리 성능을 제공한다. 뮤즈 글리머는 단일 소비자용 GPU에서도 실행할 수 있다. 로컬 파일과 이메일을 읽고 요약하거나 인증 정보를 활용해 작업을 수행하고 여러 단계의 도구 호출과 장시간 실행 작업을 처리하도록 설계됐다. 오픈 영상 생성 모델 'LTX-2.5'도 엔비디아 RTX GPU와 DGX 스파크·DGX 스테이션에 최적화됐다. 여러 장면으로 구성된 영상을 생성하면서 캐릭터와 장면·음성의 일관성을 유지하고 기존 영상의 세부 요소를 생성형 AI로 수정할 수 있다. 엔비디아에 따르면 LTX-2.5는 RTX 프로 6000 GPU에서 기존 대비 최대 20% 빠른 처리 성능과 40%의 메모리 절감 효과를 제공한다. 크리에이터는 컴피UI 기반 작업 환경을 이용해 텍스트와 이미지·영상 사이의 변환 작업을 로컬에서 수행할 수 있다.

2026.08.12 15:18김미정 기자

철도여행에 AI 연계…코레일유통, AI 관광 앱 'AI 로컬동행' 선보여

코레일유통(대표 박정현)은 철도여행 연계 인공지능(AI) 기반 관광 서비스 모바일 앱 'AI 로컬동행'을 선보였다고 5일 밝혔다. 'AI로컬동행'은 철도여행 과정에서 손쉽게 AI를 활용할 수 있도록 개발한 서비스다. 우선 대전 주요 관광지와 대전역사 매장을 대상으로 운영을 시작한다. 이번 프로젝트는 코레일유통이 지난 6월 우송대학교 산학협력단 및 청년 창업팀 '마코'와 업무협약을 체결하며 본격 추진됐다. 국내 중소기업·청년기업·지자체가 함께 참여해 AI 기술과 지역 관광 자원을 결합한 새로운 여행 서비스 모델을 구현했다. AI 로컬동행은 ▲이용자 취향을 반영한 AI 관광코스 추천 ▲대화형으로 관광지를 안내하는 AI 챗봇 ▲나만의 AI 캐릭터 제작 기능 등이 핵심이다. 여행 준비부터 현장 관광, 여행 이후 추억 관리까지 모든 과정을 하나의 앱으로 경험할 수 있다. 앱 이용자를 위한 다양한 혜택도 있다. 앱을 내려받으면 대전역 카페스토리웨이에서 사용할 수 있는 음료 20% 할인 쿠폰을 제공한다. 대전 주요 관광지를 방문하거나 역 내 매장을 이용하면 포인트가 적립된다. 현재 대전 엑스포 과학공원 등 대전 주요 관광지 100여 곳과 스토리웨이 편의점 등 대전역 내 36여 개 매장에서 인증 가능하다. 일정 포인트 이상 적립하면 매장 이용 상품권을 받을 수 있다. 대전역 내 스토리웨이 편의점에서 1만원 이상, 식음료 매장에서 3만원 이상 구매한 영수증을 앱에서 인증하면 철도 굿즈 교환권을 제공한다. 코레일유통은 앱 출시를 기념해 애니매이션 '안녕 자두야' 캐릭터와 대전의 상징 '꿈돌이' 캐릭터가 협업한 한정판 굿즈도 선보인다. 굿즈는 열쇠고리 형태 3종이다. 모두 수집하면 기차 모형이 완성된다. 교환권은 대전역 '안녕 자두야' 팝업스토어에서 교환할 수 있다. 박봉훈 코레일유통 AI혁신처장은 “AI 로컬동행을 통해 누구나 일상속에서 AI 기반 여행을 손쉽게 경험할 수 있도록 했다”며 “철도 이용객이 여행과 혜택을 동시에 누리는 것은 물론, 지역관광 활성화에도 기여할 수 있기를 기대한다”고 밝혔다.

2026.08.05 17:53주문정 기자

지역 AX 확산 돕는다…네이버 '로컬 그라운드' 부산서 첫 발

네이버가 보다 많은 사용자가 인공지능(AI)을 통해 지역의 다양성을 발견하고 경험할 수 있도록 지역 상권을 직접 찾아가는 '로컬 그라운드' 캠페인을 시작한다. 첫 번째 '로컬 그라운드'는 오는 13일 부산에서 진행된다. ▲전포동 ▲영도 ▲보수동 책방골목 등 주요 상권의 104개 중소상공인(SME) 상점이 참여한다. 네이버는 QR 오더와 오프라인 통합 단말기 'Npay 커넥트' 등 AI 기반 주문·결제 솔루션 도입 지원과 로컬 상점을 소개하는 숏폼 콘텐츠 제작 등을 돕는다. 캠페인 기간 중인 오는 12일부터 13일까지 부산에서 BTS 글로벌 콘서트가 열리는 만큼, 외국인 사용자의 편의도 강화한다. 외국인 사용자는 여권 기반 본인 인증을 통해 ▲네이버 지도 ▲예약 ▲주문 ▲결제 등을 이용할 수 있으며, 파파고 앱을 통해 상점 간판과 메뉴명을 다국어로 번역해 이용할 수 있다. 지난 10일에는 네이버 임직원과 부산 로컬 사업자 200여 명이 직접 만나 로컬의 다양성이 AI 생태계에서 갖는 의미를 논의하고, 네이버 ▲플레이스 ▲쇼핑 ▲광고 담당자들이 사업자 성장 사례와 AI 전환(AX) 전략을 공유하는 '로컬 밋업'도 열렸다. 또한 소규모 사업자들이 온라인 광고의 효율성과 편의성을 높이고, 사업 규모와 전략에 따라 다양한 광고 마케팅을 해볼 수 있도록 네이버 담당자들이 직접 컨설팅을 돕는 별도의 부스도 마련됐다. 네이버는 올해 최고인사책임자(CHRO) 직속으로 '임팩트 시너지' 그룹을 개편하고, 로컬 그라운드를 포함해 임직원이 참여하는 임파워먼트 중심의 파트너 성장 시너지 프로그램을 적극적으로 모색해 나갈 계획이다. 황순배 네이버 임팩트시너지 그룹장은 '로컬 밋업' 키노트에서 "로컬 그라운드의 첫 출발을 부산에서 시작하게 돼 뜻깊다"며 "네이버는 로컬이 가진 상품, 공간, 취향의 고유성이 디지털 플랫폼 위에서 보다 잘 발견되고, AI 기술을 통해 지역에서 전국으로, 나아가 글로벌로 성장할 수 있도록 지원을 아끼지 않겠다"고 약속했다.

2026.06.11 17:09박서린 기자

MS, '애저 로컬' 강화..."데이터 주권·대규모 확장 동시에"

마이크로소프트가 데이터 주권과 대규모 확장성을 동시에 확보할 수 있는 클라우드 기능을 공개했다. 마이크로소프트는 소버린 프라이빗 클라우드 인프라 '애저 로컬'에 이같은 기능을 강화했다고 2일 밝혔다. 해당 기능은 인터넷 연결이 분리된 환경에서도 유연한 배포를 지원하며, 보안과 컴플라이언스 설정에 대한 로컬 운영 제어권을 제공한다. 별도 아키텍처 재설계 없이도 서버 규모를 수백 대에서 수천 대까지 늘릴 수 있어 국가 기간 시설이나 규제 산업의 대규모 워크로드 수립에 적절하다. 마이크로소프트는 애저 로컬에 확장된 장애 도메인과 인프라 풀을 도입해 하드웨어 장애가 발생하더라도 서비스가 중단되지 않도록 복원력을 높였다. 이를 바탕으로 클라우드 연결 환경과 관계없이 핵심 서비스의 안정적인 운영을 돕고, 고성능 그래픽처리장치(GPU)를 활용한 데이터 집약적인 AI 추론·분석 업무를 자체 인프라에서 수행한다. 이미 미국 통신사 AT&T와 네덜란드 토지 등기소 등이 운영 제어권 확보와 민감 데이터 주권 통제를 위해 애저 로컬을 도입해 활용 중인 것으로 나타났다. 이탈리아 파이버콥은 전국 단위 소버린 클라우드와 AI 서비스를 제공하기 위해 전국 엣지 로케이션 전반에 해당 인프라를 구축하고 있다. 애저 로컬은 델 테크놀로지스, HPE, 레노버 등 검증된 파트너 생태계를 통해 제공돼 기존 스토리지 자산에 대한 투자 보호가 가능하다. 컴퓨팅 기반에는 인텔 제온 6 프로세서가 탑재돼 최신 워크로드 성능 요구사항을 충족한다. 특화 인프라 없이도 소버린 환경 내 AI 워크로드 실행을 지원한다. 마이크로소프트가 소버린 프라이빗 클라우드 인프라인 '애저 로컬'의 확장성을 대폭 강화하며 디지털 주권 확보에 나선 기업들을 위한 대규모 클라우드 환경을 공개했습니다. 이를 통해 조직은 데이터 통제권을 유지하면서도 단일 환경 내에서 수천 대의 서버를 운영할 수 있는 고도의 클라우드 전략을 수립할 수 있게 됐습니다. 30일 마이크로소프트에 따르면 애저 로컬은 인터넷 연결이 분리된 환경에서도 유연한 배포를 지원하며 보안과 컴플라이언스 설정에 대한 로컬 운영 제어권을 제공합니다. 별도의 아키텍처 재설계 없이도 서버 규모를 수백 대에서 수천 대까지 늘릴 수 있어 국가 기간 시설이나 규제 산업의 대규모 워크로드를 수용하기에 적합합니다. 특히 확장된 장애 도메인과 인프라 풀을 도입해 하드웨어 장애가 발생하더라도 서비스가 중단되지 않도록 복원력을 높였습니다. 이를 바탕으로 클라우드 연결 환경과 관계없이 핵심 서비스의 안정적인 운영을 돕고 고성능 GPU를 활용한 데이터 집약적인 AI 추론 및 분석 업무를 자체 인프라에서 수행합니다. 이미 미국 통신사 AT&T와 네덜란드 토지 등기소 등이 운영 제어권 확보와 민감 데이터 주권 통제를 위해 애저 로컬을 도입해 활용 중입니다. 이탈리아 파이버콥은 전국 단위의 소버린 클라우드와 AI 서비스를 제공하기 위해 전국 엣지 로케이션 전반에 해당 인프라를 구축하고 있습니다. 애저 로컬은 델 테크놀로지스, HPE, 레노버 등 검증된 파트너 생태계를 통해 제공돼 기존 스토리지 자산에 대한 투자 보호가 가능합니다. 컴퓨팅 기반에는 인텔 제온 6 프로세서가 탑재돼 최신 워크로드의 성능 요구사항을 충족하며 특화 인프라 없이도 소버린 환경 내 AI 워크로드 실행을 지원합니다. 마이크로소프트는 이번 대규모 소버린 클라우드 확장을 통해 공공·금융 등 규제 산업군이 보안 우려 없이 생성형 AI를 전격 도입할 수 있는 기술적 물꼬를 트며 하이브리드 클라우드 시장 패권을 한층 강화할 것으로 보인다. 더글라스 필립스 마이크로소프트 최고기술책임자(CTO)는 "애저 로컬과 검증된 컴퓨팅, 스토리지 플랫폼 결합은 소버린 인프라 배포를 지원하는 데이터센터 규모의 스택을 제공한다"며 "이를 통해 데이터와 모델 그리고 실행 과정이 조직의 통제 환경 내에 안전하게 유지될 수 있을 것"이라고 강조했다.

2026.05.02 09:58김미정 기자

AMD "AI PC, CPU·GPU·NPU 모두 활용 필요"

"마이크로소프트는 2024년 이후 신경망처리장치(NPU)를 활용한 스튜디오 효과, 이미지 편집, 카메라 영상 처리 등을 꾸준히 투입하고 있다. 40 TOPS(1초당 1조번 연산) 이상의 NPU가 없다면 이런 기능 활용은 불가능하다." 11일 오전 서울 삼성동에서 진행된 'AI PC 부트 캠프' 행사에서 김홍필 AMD 시니어 솔루션 아키텍트(이사)가 이렇게 설명했다. NPU는 AI 추론 연산에 특화된 프로세서로, GPU보다 전력 소모가 낮고 INT8 등 저정밀 연산에 효율적이다. AMD는 이날 AI PC용으로 설계된 라이젠 AI 300/400 시리즈 프로세서와 NPU의 활용 상황, GPU 대비 NPU가 가진 전력소모 등 이점과 향후 전망 등을 소개했다. 이날 김홍필 이사는 "시장조사업체 IDC 통계에 따르면 올해를 기점으로 전체 PC 출하량 중 NPU 탑재 제품 비율이 크게 늘어나고 있다. 특히 소형·경량 노트북에는 앞으로 NPU가 반드시 탑재되는 방향으로 갈 것"이라고 설명했다. AMD, 2024년부터 NPU 강화 나서 AMD가 2024년 10월부터 공급중인 노트북용 프로세서인 라이젠 AI 프로 300은 젠5(Zen 5) 기반 CPU, RDNA 3.5 기반 GPU와 XDNA 2 NPU(신경망처리장치)를 결합했다. 김홍필 이사는 "AI 초창기부터 현재까지 많은 AI 모델이 주로 GPU를 활용한다. GPU는 주로 FP32(부동소수점 32비트) 등 연산에 최적화된 반면, NPU는 INT8(정수 8비트) 처리에 최적화됐다. 특히 추론에서는 속도나 메모리 용량에 유리하다"고 설명했다. 올해부터 공급되는 라이젠 AI 400 시리즈는 전작 대비 작동 클록과 메모리 작동 속도 향상으로 CPU와 GPU, NPU 성능을 모두 강화했다. NPU 성능은 전작(50 TOPS) 대비 20% 향상된 60 TOPS까지 올라갔다. "코파일럿+ 시작으로 NPU 활용 S/W 증가 추세" 마이크로소프트 윈도11 코파일럿+ 기능은 2024년 6월 출시된 퀄컴 스냅드래곤 X 엘리트를 시작으로 같은 해 11월부터 인텔·AMD 등 x86 계열 프로세서까지 확장됐다. 주변 대화나 소리를 실시간으로 감지해 자막으로 띄우는 '라이브 캡션', PC 작동 내역을 실시간으로 추적했다 필요한 시점으로 돌아가 확인하는 '리콜' 등이 지원된다. 코파일럿+ 기능 이외에도 마이크로소프트 오피스, 어도비·블랙매직·사이버링크 등 콘텐츠 제작용 솔루션, 피싱이나 악성 코드를 실시간으로 감지하는 보안 솔루션까지 NPU 활용이 확장되는 상황이다. 김홍필 이사는 "현재는 각종 콘텐츠 제작에 AI가 가장 많이 쓰이지만 앞으로는 CPU와 GPU, NPU 3개를 모두 활용해 효율적으로 로컬 AI를 구동하는 것이 중요하다. AMD는 여러 회사와 함께 더 많은 활용 사례를 만들기 위해 노력하고 있다"고 설명했다. NPU 구동해 LLM 실행시 토큰 속도 향상 이날 AMD는 라이젠 AI 7 350 프로세서와 24GB 메모리를 탑재한 HP 엘리트북6 G1a를 이용해 NPU 활용시 전력 소모와 처리 시간을 비교했다. 첫 번째 시연에서는 클라우드 없이 PC에서 직접 거대언어모델(LLM)을 구동하는 오픈소스 소프트웨어 '레모네이드'를 활용했다. AMD CPU와 NPU에 최적화된 딥시크 R1 80억 매개변수 모델을 이용해 첫 토큰(단어) 소요 시간과 초당 토큰 출력 시간을 확인했다. CPU만 구동할 때 첫 토큰 출력까지 1.4초, 초당 토큰은 3.8토큰인 반면 NPU만 활용할 때는 첫 토큰 출력에 2.27초, 초당 토큰은 6.7토큰으로 향상됐다. 프로세서 전력 소모도 CPU만 활용시는 33.20W, NPU 활용시는 절반 가량인 16.59W로 전력 소모 면에서도 일정 부분 이점이 있었다. "NPU 최적화 일부 모델은 GPU 대비 더 빨라" 두 번째 시연은 사진과 영상 콘텐츠를 생성하는 AI 모델을 구동할 수 있는 '어뮤즈'를 활용했다. 스테이블 디퓨전 3.0을 AMD 실리콘에 최적화한 모델로 2048×2048 화소 이미지 생성시 소요 시간을 비교했다. '상자 안의 고양이(A cat in a box)'를 프롬프트로 주고 실행할 때 NPU를 활용하면 총 소요 시간은 127.5초 걸렸다. 반면 GPU만 활용시 소요시간은 296.8초로 2.5배 더 길어졌다. 프로세서 작동 온도에도 일부 차이가 있다. NPU 활용시 온도는 50도로 측정됐지만 GPU만 활용하면 전체 온도는 60도까지 상승한다. 또 과열을 막기 위해 일시적으로 성능을 끌어내리는 스로틀링이 작동해 오히려 더 처리 시간이 길어졌다. 김홍필 이사는 "NPU와 GPU의 연산 정밀도에는 차이가 있고 정밀도를 내릴 수록 처리 시간은 줄어든다. 아직 NPU에 특화된 모델이 드물지만 메모리 용량이나 성능에 일정한 제약이 있는 상황에서 NPU가 더 효율적인 선택지를 줄 수 있다는 의미"라고 설명했다. "NPU 수치보다는 AI 모델 최적화 여부가 관건" 현재 인텔, AMD, 퀄컴 등 주요 AI PC용 프로세서 제조사는 NPU 성능을 차별화 포인트 중 하나로 내세운다. 45 TOPS(퀄컴 헥사곤)로 시작해 50 TOPS(인텔 NPU5), 60 TOPS(AMD) 등 수치상으로는 계속 향상되고 있다. 김홍필 이사는 "실리콘 제조사가 이야기하는 TOPS는 행렬로 구성된 숫자를 서로 곱한 다음 더하는 MAC(곱셈 가산) 수치를 기준으로 한 것이다. 이를 측정하는 벤치마크 도구들이 있지만 정확한 값을 드러낸다고 볼 수 없다"고 설명했다. 이어 "마이크로소프트가 코파일럿+ 기준으로 제시한 40 TOPS는 하한선이다. TOPS 수치가 일종의 마케팅 수단이 됐지만 결국 전반적으로 NPU가 여러 AI 모델에 얼마나 최적화되고 많이 활용되느냐가 더 중요한 사안"이라고 덧붙였다.

2026.03.11 15:49권봉석 기자

"'카스2' 최적화 시켜줄 수 있어?"...엔비디아 AI 게이밍 시연해보니

[타이베이(대만)=권봉석 기자] 22일 오후(이하 현지시간) 타이베이 그랜드 하이라이 호텔 12층의 한 방. 일반 소비자를 위한 엔비디아 그래픽·AI 기술 시연을 보기 위해 아시아권 기자 여덞 명이 한 방에 모였다. 이들이 모니터에 비친 디지털 휴먼 '아키'를 바라보는 가운데 엔비디아 관계자가 마이크에 "AI 관련 재미있는 영어 슬로건을 만들고 한국어로 번역해서 말해줘"라고 영어로 말했다. 잠시 후 '아키'는 자연스런 억양으로 "미래를 만드는 AI"라고 말했다. 방 안의 유일한 한국어 화자인 기자는 왼손을 들어 다른 나라 기자들에게 '정확하다'는 의미로 OK 신호를 보냈다. 프로젝트 R2X, 코딩 없이 다양한 기능 추가 가능 시연을 진행한 엔비디아 관계자는 "이것은 다음 달 정식 공개될 디지털 휴먼 인터페이스 '프로젝트 R2X'다. 오픈AI 모델과 음성인식, 오디오 투 페이스 모델을 이용해 작동하며 PC에서 에이전틱 AI의 구현 사례를 보여준 것"이라고 설명했다. 프로젝트 R2X는 지난 1월 'CES 2025' 당시 엔비디아가 지포스 RTX 50 시리즈와 함께 공개한 디지털 AI 휴먼 비서다. 음성 인식과 번역은 오픈AI 모델을 활용했고 음성에 맞게 입모양을 맞추는 '오디오 투 페이스' 모델은 엔비디아 GPU로 실행된다. 그는 "이용자가 코딩 없이 다양한 서비스 항목을 드래그 앤 드롭으로 간편히 연결하고 기능을 확장할 수 있다. 현재는 외형을 바꿀 수 없지만 다음 달 정식 공개 이후 취향에 맞게 맞춤형 설정이 가능할 것"이라고 덧붙였다. 게임 실행부터 최적화까지 음성으로 처리하는 'G어시스트' 프로젝트 'G어시스트'(G-Assist)는 지난 해 컴퓨텍스에서 처음 공개된 AI 기반 게임 보조 기술이다. 40억 개 매개변수(패러미터)를 지닌 소형언어모델(SLM)을 엔비디아 그래픽카드에 올려 구동되며 지난 3월 정식 출시됐다. G어시스트가 구동 중인 PC에서 엔비디아 관계자가 "카운터 스트라이크 2를 최적화해줄 수 있어?"라고 말하자, AI가 즉시 게임 설정을 분석하고 최적화를 시작했다. 이어서 "그 게임을 해보자"라고 말하니, AI가 자동으로 게임을 실행했다. "초당 프레임 수를 띄워줘"라고 말하자 AI가 관련 수치를 자동으로 띄웠다. "지난 60초간 CPU와 GPU 사용률을 보여줘"라고 말하니, 실시간 그래프까지 생성해 보여줬다. 엔비디아 관계자는 "G어시스트 구동에 필요한 SLM 용량은 약 3GB이며 그래픽 메모리에 큰 부담을 주지 않는다. 12GB 메모리를 탑재한 지포스 RTX 4070 이상 GPU에서 구동하는 것을 권장한다"고 설명했다. "챗GPT로 플러그인 만들어 G어시스트 기능 확장 가능" G어시스트는 파이썬을 이용해 구동되는 플러그인을 이용해 여러가지 기능을 확장할 수 있다. 시연에 이용된 PC에는 디스코드 플러그인, 자동화 프로그램인 IFTTT 플러그인, 구글 제미나이 플러그인이 연결돼 있다. "디스코드에 5분 후 온라인 상태가 될 거라고 전해줘"라고 말하자 자동으로 메시지가 전송됐다. 구글 제미나이와 연결해 "다음 카운터 스트라이크 2 대회 일정이 언제야?"라고 묻자 최신 정보를 가져와 보여줬다. 엔비디아 관계자는 "파이썬 코딩 방법을 몰라도 챗GPT를 이용하면 G어시스트용 플러그인을 손쉽게 만들 수 있다. AI가 AI를 위한 도구를 만드는 셈"이라고 설명했다.

2025.05.23 08:54권봉석 기자

국립군산대, 새만금개발공사 손잡고 새만금에 '미래 해양도시' 청사진

국립군산대학교가 신재생에너지와 블루이코노미를 선도하는 글로컬대학으로 대전환하기 위해 새만금을 중심으로 연구·실증·글로컬 캠퍼스 등 기반 인프라 구축에 나섰다. 군산대는 이를 위해 지난 8일 새만금개발공사와 새만금지역 발전을 위한 연구·실증·인재 양성 등 기반시설 마련에 협력하는 내용을 담은 협약을 체결했다. 두 기관은 협약에 따라 새만금에 필요한 전문인력을 양성·활용하고 새만금 관련 사업을 공동연구하고 인적교류를 활성화하기로 했다. 또 새만금 발전을 위한 정보를 교류하고 지역발전과 상생 협력방안을 모색한다는 계획이다. 나경균 새만금개발공사 사장은 “군산대에는 해양바이오 산업 연구 데이터가 구축돼 있는 것으로 알고 있다”며 “협약을 계기로 새만금개발공사도 이 데이터를 활용해 공동연구하고 협력해 인재를 양성할 수 있기를 바란다”고 말했다. 엄기욱 군산대 총장 직무대리는 “새만금은 대한민국의 미래이자 청사진이라고 생각한다”며 “군산대가 가진 연구력과 그간의 연구성과들이 새만금개발공사의 경험과 함께 어우러진다면 다시 한번 새로운 장을 열 수 있는 기회가 될 것”이라고 밝혔다. 군산대는 새만금 지역 관광·레저용지에 글로벌 Co-캠퍼스를 구축해 신재생에너지와 블루이코노미 분야 해외 저명인사를 초빙하고 국내외 대학과 공동연구를 추진하는 등 전문인력을 양성할 계획이다. 해양수산분야는 미국 버지니아 해양과학연구소(VIMS)·서울대·목포대 등 국내외 연구소·대학과 협력해 해양생태·수산질병 등을 연구하고 국제물고기병원(가칭)을 통해 임상 실습을 지원한다. 스마트양식·인공지능(AI) 소프트웨어 분야는 독일 아헨공과대학교가 참여해 양식장 자동화·빅데이터 분석 등 AI 기반 스마트양식 기술을 공동으로 연구하고 개발한다. 해상풍력 분야는 네덜란드 델프트공과대학교와 풍력터빈 설계·운영과 해상풍력발전 운영·유지보수(O&M) 프로젝트를 추진한다. 오정근 국립군산대 기획처장(조선공학과 교수)관계자는 “분야별 전문기관이 참여하는 글로벌 Co-캠퍼스는 해양교육과 학문적·산업적 융합을 위한 핵심 거점이 될 것”이라고 밝혔다. 군산대는 글로벌 Co-캠퍼스와 해양 사파리·아쿠아리움이 결합해 지역 경제와 교육·연구를 동시에 성장시키는 지역 상생의 대표사례가 될 것으로 기대했다. 야광충 파운드리 기술과 해양생물 유전자 연구 등 고부가가치 해양 바이오 파운드리 산업은 지역 기업과 공동연구를 추진한다. 군산대가 운영 중인 요트·조정 등 실무 중심 커리큘럼인 명품스포츠 교육과정을 새만금 해양레저산업에 적용해 지역 해양레저산업과 상생한다는 계획이다. 또 관광객 유입으로 숙박·교통·문화시설 등 새만금 수변도시 지역의 인프라도 활성화해 지역민 고용과 삶의 질 상승으로 연계될 것으로 기대했다. 오정근 군산대 기획처장은 “새만금 관광·레저용지 일원에 해양 사파리와 아쿠아리움이 자리를 잡고 대학들이 교육과 연구의 축이 돼 산학연계와 지역 상생을 이끌어내는 모습은 한국형 해양 미래도시 모델을 잘 보여준다”며 “앞으로 글로컬 Co-캠퍼스가 본격 가동되면 이 대형 프로젝트가 해양 사파리·아쿠아리움이라는 관광 테마를 넘어 국내외 수산질병 연구와 해양치유·친환경 수산업 개발에서 국제적 경쟁력을 확보하는 초석이 될 것”으로 내다봤다.

2025.04.10 11:29주문정 기자

삼성전자, '유럽 테크 세미나' 개최…AI TV 혁신 기술 선봬

삼성전자는 18일부터 19일(현지시간)까지 독일 프랑크푸르트에서 2025년형 TV의 차별화된 기술과 AI TV 신기술을 소개하는 '2025 유럽 테크 세미나'를 개최한다고 18일 밝혔다. 테크 세미나는 2012년부터 전 세계 주요 지역에서 영상·음향 분야의 미디어와 전문가를 대상으로 삼성 TV의 최신 기술과 서비스를 소개하는 행사로, 업계 관계자들이 신제품을 직접 체험하고 의견을 나눌 수 있다. 올해 테크 세미나에서는 2025년형 Neo QLED·OLED·라이프스타일 TV뿐만 아니라 AI 기반 시청 경험 및 사운드 기술을 소개한다. 2025년형 Neo QLED 4K는 '로컬 디밍(Local Dimming)' 기능으로 우수한 블랙 표현력과 HDR 정확도를 구현한다. 또한 ▲'AI 업스케일링' ▲'모션 인핸서' 등 기존 8K 모델의 차별화 기술을 4K에도 확대 적용할 예정이다. 2025년형 OLED는 '글레어프리 2.0(Glare Free 2.0)'으로 빛 반사를 줄여 선명한 화면을 구현한다. 128개의 AI 뉴럴 네트워크가 적용된 3세대 4K AI 업스케일링을 통해 정교한 해상도를 제공한다. 여기에 'OLED HDR' 기술을 더해 전년 대비 밝기와 명암비를 업그레이드 시켰다. 향상된 시청 경험을 제공하는 '더 프레임 프로(The FRAME Pro)'는 Mini-LED 로컬디밍 기술을 적용해 일상적인 시청 환경에서도 선명한 화질을 제공한다. '더 프레임 프로' 사용자는 삼성 아트 스토어를 통해 약 3천점 이상의 디지털 아트를 감상할 수 있으며, '무선 원커넥트 박스'를 지원해 복잡한 케이블 없이도 간편한 설치가 가능하다. 콤팩트한 신규 디자인과 선명한 화질을 갖춘 '더 프리미어 5(The Premiere 5)'는 터치 솔루션을 탑재한 프로젝터로, 단순한 시청을 넘어 교육, 비즈니스, 가정 등 다양한 환경에서 활용할 수 있다. 이번 테크 세미나에서는 이를 활용한 게임 및 키즈 콘텐츠 등 직관적인 사용자 경험을 포함한 다양한 시나리오와 편의성을 시연한다. '비전 AI(Vision AI)'를 기반으로 AI 시청 경험과 CX-MDE(고객 중심의 멀티 디바이스 경험)도 소개했다. 주요 기능으로는 ▲재생 중인 영상과 관련된 정보를 제공하는 '클릭 투 서치(Click to Search)' ▲외국어를 사용자가 원하는 언어로 바꿔주는 '실시간 번역(Live Translate)' ▲스마트폰으로 간편하게 TV를 제어할 수 있는 '퀵 리모트(Quick Remote)' 등이 있다. 또한 구글과의 공동 개발을 통해 업계 최초로 적용한 '이클립사 오디오' 기술을 선보인다. '이클립사 오디오'는 IAMF(Immersive Audio Model and Formats) 기반의 차세대 3D 오디오 기술로, 콘텐츠에 최적화된 멀티채널 오디오를 통해 소비자에게 더욱 몰입감 있는 사운드 경험을 제공한다. 이번 행사에서는 해당 기술이 적용된 제품과 사운드바 연계 3D 사운드 효과를 직접 체험할 수 있다. 삼성전자는 유럽을 시작으로 동남아시아, 중남미 등 주요 지역에서도 테크 세미나를 순차적으로 개최할 예정이다. 한편 삼성 TV는 AI 기반 혁신 기술을 바탕으로 화질과 음향을 지속적으로 업그레이드하며, 19년 연속 글로벌 TV 시장 1위 자리를 지켜오고 있다.

2025.03.18 09:36장경윤 기자

"AI 튜터와 재미있게 대화"...하이로컬이 글로벌 150만명 사로잡은 비결

"외국인들과 실전대화를 하는 과정에서 영어 회화 실력은 빠르게 향상됩니다. 그런데 학원·과외 선생님과의 회화 수업은 재미가 없습니다. 하이로컬은 이 점에 주목했습니다." 최근 서울 성동구 하이로컬 본사에서 만난 윤정호 하이로컬 대표는 이같이 말했다. 타 영어 회화 교육 시스템과 하이로컬의 차이점을 강조하면서다. 하이로컬은 AI 기반 영어 회화 플랫폼이다. 이용자가 대화방을 만들거나, 혹은 이미 생성된 대화방에 참여해 외국인들과 대화를 나눌 수 있다. 이용자가 원하는 주제를 설정해두면 이에 맞춰 대화방을 추천하기도 한다. 대화 내용은 AI가 기록·분석해 문법, 발음 등 교정해야 할 부분을 알려준다. 윤 대표는 "영어 회화를 책상에서 공부하는 것보다는 사람과 대화하면서 배우는 게 훨씬 즐겁다"며 "이때 대화 상대가 영어에서 틀린 부분을 지적하면 기분이 나쁠 수 있으니까, 선생님 역할은 AI에게 맡기는 것"이라고 설명했다. 이용자는 AI 튜터와 영어로 대화를 나눌 수도 있다. 현재 하이로컬의 AI 튜터는 5가지가 존재한다. ▲발음(미국/영국) ▲성별(남성/여성) ▲대화 특성(짧은 문장 위주/긴 문장 위주) ▲성별(20대/30대) 등 5가지 AI 튜터는 각자 다른 페르소나를 갖고 있다. 윤 대표는 "다양한 성격을 지닌 사람들과 대화를 해야 연습이 더 재미있고 재미를 느껴야 연습량이 늘어난다"며 "이 때문에 AI 튜터에 다양한 페르소나를 불어넣었다"고 설명했다. 윤 대표의 예상은 적중했다. 하이로컬은 2020년 서비스 시작 후 2년 만에 글로벌 이용자 약 150만명을 확보했다. 코로나 시기 K-문화에 관심이 많은 외국인들 사이에서 입소문을 탔다. 이후 해외에서의 인기를 바탕으로 국내에서도 관심을 받기 시작했다. 성장세를 타고 지난해 3월에는 오픈 AI 협업프로그램에 선정됐다. 현재까지 카카오벤처스와 같은 투자회사로부터 총 15억 누적 투자를 유치한 상태다. 윤 대표는 하이로컬이 교육 평등을 확대하는 데 활용될 수 있을 것이라고 강조했다. 이 대표는 "하이로컬은 이용자가 어느 국가에 살든, 어떤 환경을 갖고 있든 장벽 없이 자유롭게 소통할 수 있도록 한다"며 "저개발 국가 등 양질의 외국어 교육이 필요한 곳에 교육을 제공할 수 있을 것이라 생각한다"고 말했다. 하이로컬은 다양한 기관·기업과 제휴를 맺으며 수익성을 확대하겠다는 목표다. 윤 대표는 "올해 목표는 매출 30억원을 달성하는 것"이라며 "지금까지는 B2C 분야에 집중했다면, B2B 분야로도 서비스 제공을 확대하며 편리하고 재미있는 언어 학습 환경을 조성해 나갈 것"이라고 했다. 실제로 하이로컬은 국내에서 일하는 외국인 근로자들에게 AI 튜터를 활용 한국어를 가르치는 시스템에 대한 기술검증(POC)을 진행 중이다. 윤 대표는 "제조업, 조선업, 건설업 등 국내 현장에 외국인 근로자들이 매우 많지만 한국어가 서툰 이들이 많다"며 "여러 기관·기업에서 AI 튜터를 도입해보고 싶다는 말을 전해왔고, 기업 8곳과 논의 중"이라고 밝혔다. 마지막으로 윤 대표는 "하이로컬의 목표인 '재미있게 연결하고, 어울리면서 배울 수 있도록 하겠다'를 이룰 수 있도록, 지속적으로 서비스를 꾸준히 개발·개선하겠다"고 말했다.

2025.01.15 16:56조수민 기자

  Prev 1 Next  

지금 뜨는 기사

이시각 헤드라인

"스마트폰 다음은 XR"…퀄컴·삼성·구글, 차세대 폼팩터 3자 연합 구축

LG전자, AI 데이터센터 냉각 솔루션 영토 확장

검찰, 카카오 김범수 2심서도 징역 15년 구형..."불법·부정 지시 없었다"

미중 정상회담 D-1…AI 개발 속도·안전관리 접점 찾을까

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.