• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
반도체
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'인공지능'통합검색 결과 입니다. (6105건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

[AI 리더스] 권경민 이노그리드 CTO "AI 인프라 경쟁력, GPU보다 운영 기술에 달렸다"

"그래픽처리장치(GPU)를 많이 확보했느냐보다 자원을 얼마나 효율적으로 운영하느냐가 앞으로 AI 인프라 경쟁력을 결정할 것입니다." 권경민 이노그리드 최고기술책임자(CTO)는 20일 서울 중구 본사에서 지디넷코리아와 만나 AI 인프라 시장 변화와 운영 기술 전략에 대해 이같이 밝혔다. 최근 정부와 기업들은 대규모 AI 인프라 구축을 목표로 최신 GPU 확보에 나서고 있다. 하지만 고가의 최신 GPU를 확보한 것 자체보다 이 자원을 다양한 워크로드에 맞춰 효율적으로 운영할 수 있는지가 새로운 경쟁력으로 떠오르고 있다는 게 권 CTO의 진단이다. 이노그리드는 이 변화에 맞춰 GPU 운영 효율화 기술을 개발하는 국책 과제 'GRIM-GPU' 프로젝트를 수행 중이다. 단순한 GPU 공유 기술을 넘어 가상머신(VM)과 컨테이너가 혼재된 환경에서 GPU를 유연하게 분할·재구성하고 성능 간섭을 최소화하는 AI 인프라 운영 기술을 확보하는 것이 목표다. GPU 확보 경쟁 다음 단계는 '운영 효율화' 권 CTO는 최근 2~3년 동안 AI 인프라 시장이 급격하게 변화했다고 짚었다. 그는 "초기 AI 시장에선 GPU를 빨리 수급하는 것이 경쟁력이었지만 최근에는 공급 부족 현상이 다소 완화되고 있다"며 "이제는 GPU를 어떤 서비스와 워크로드에 배치하고 기존 장비를 어떻게 효율적으로 활용할 것인지가 더 중요한 시점"이라고 설명했다. 그러면서 글로벌 빅테크와 같은 방식의 AI 인프라 경쟁은 국내 기업이 선택할 수 있는 전략이 아니라고 강조했다. 그는 "국내 소프트웨어(SW) 기업이 글로벌 기업처럼 막대한 자본을 투입해 GPU를 확보하는 방식으로 경쟁하기는 쉽지 않다"며 "기업과 기관이 이미 보유한 GPU를 효율적으로 활용할 수 있도록 지원하는 운영 기술에 집중해야 한다"고 말했다. 이에 이노그리드는 과학기술정보통신부와 정보통신기획평가원(IITP)이 추진하는 GRIM-GPU 프로젝트에 주관기관으로 참여해 GPU 공유와 재구성 기술 연구에 앞장서고 있다. VM·컨테이너 혼재 환경 해결하는 'GRIM-GPU' GRIM-GPU는 정부가 추진하는 AI 클라우드 경쟁력 강화 기술개발 사업 가운데 하나로, VM과 컨테이너가 혼재된 단일 노드 환경에서 GPU를 유연하게 공유하는 기술을 개발하는 것이 주 목적이다. 현재 AI 인프라는 크게 VM 기반 환경과 컨테이너 기반 환경으로 나뉜다. 문제는 두 환경의 GPU 활용 방식이 다르다는 점이다. 공공·금융 분야는 보안성과 격리 수준이 높은 VM을 선호하는 반면, AI 학습과 추론 환경은 쿠버네티스 기반 컨테이너를 중심으로 운영되는 경우가 많은 것으로 알려졌다. 이에 대해 권 CTO는 "기존에는 GPU를 활용하기 위한 VM과 컨테이너 환경을 각각 별도로 구성해야 했지만, GRIM-GPU는 워크로드 특성에 따라 단일 환경에서 GPU를 동적으로 할당하는 기술을 목표로 하고 있다"고 밝혔다. 특히 동적 재구성 기술이 이번 과제의 핵심 연구 분야다. 통상 업무를 하는 주간에는 추론 서비스에 GPU를 사용하다가 야간에는 대규모 AI 학습에 활용하는 구조로 자원 활용 방식을 빠르게 전환할 수 있어야 한다는 관점이 담겼다. 성능 간섭을 최소화하는 스케줄링 기술도 함께 개발 중이다. GPU 메모리와 SM, L2 캐시 등 다양한 자원의 사용 패턴을 분석해 워크로드 간 충돌을 사전에 예측하고 이를 완화하는 방식이다. 권 CTO는 "기존의 엔비디아 MIG 기술을 활용하면 자원 격리 수준은 높일 수 있지만, 다양한 서비스 환경에서 GPU를 빠르게 재구성하는 것은 또 다른 문제"라며 "이번 과제에선 GPU 재구성을 5초 이내에 수행하는 것을 주요 성능 지표(KPI) 가운데 하나로 설정했다"고 말했다. 이어 "GPU 한 장을 하나의 작업에만 사용하는 방식에서 벗어나 여러 워크로드를 동시에 안정적으로 운영할 수 있도록 구성할 것"이라고 덧붙였다. GRIM-GPU는 정부 공개SW 연구개발 과제로 추진되고 있다. 이에 따라 과제 결과물은 오픈소스로 공개된다. 이노그리드는 프로젝트 컨소시엄 차원의 깃허브 저장소를 운영 중이며 올해 하반기에는 초기 기술 버전을 공개할 예정이다. 공개된 기술은 개발자와 연구기관, 기업 등이 자유롭게 활용할 수 있도록 개방할 계획이다. GPUaaS·AI 데이터센터까지…통합 AI 인프라 플랫폼 확장 이노그리드는 이번 연구개발 성과를 단순 국책과제로 끝내지 않고 서비스형 GPU(GPUaaS)와 AI 클라우드 관리 플랫폼(CMP) 등 자사 솔루션으로 확장할 계획이다. 권 CTO는 "GRIM-GPU를 통해 확보한 GPU 공유와 스케줄링, 경량 모니터링 기술을 실제 제품에 적용할 예정"이라며 "궁극적으로는 GPU를 서비스 형태로 제공하는 GPUaaS의 기술적 기반이 될 것"이라고 밝혔다. 최근 NHN인재아이엔씨 합병 이후 회사의 AI 인프라 전략도 더욱 구체화되고 있다. 이노그리드는 프라이빗 클라우드 구축 역량을, NHN은 대규모 인프라 운영 경험을 각각 보유하고 있는 만큼 양사 강점을 결합해 리전형·모듈형 AI 데이터센터 시장을 공략하겠다는 구상이다. 현재 이노그리드는 서비스형 인프라(IaaS)부터 플랫폼(PaaS), 거대언어모델 운영관리(LLM옵스) 등 AI 인프라를 구성하는 솔루션 라인업을 갖췄다. 향후에는 GPU를 비롯한 신경망처리장치(NPU), 양자처리장치(QPU) 등 다양한 연산자원 운영과 AI 에이전트 관리 역량도 키운다는 목표다. 권 CTO는 "3년 안에 AI 데이터센터의 클라우드 영역부터 AI 가속기, 데이터 관리, 에이전트 운영까지 모두 아우를 수 있는 특화 플랫폼을 구축할 것"이라고 강조했다. 끝으로 그는 "GRIM-GPU 국책과제를 통해 얻은 성과를 오픈소스로 공공에 다시 환원할 것"이라며 "국내 AI 개발자와 연구기관이 모두 활용할 수 있는 AI 인프라 생태계를 구축하겠다"고 덧붙였다.

2026.08.20 10:36한정호 기자

"맞춤 퀴즈부터 3D 실습까지"…구글 검색·제미나이, 'AI 학습비서'로 진화

구글이 검색과 제미나이에 학생 맞춤형 인공지능(AI) 기능을 추가했다. 19일(현지시간) 테크크런치 등 외신은 구글이 검색과 제미나이에 학생 전용 학습 허브를 도입했다고 밝혔다. 구글 검색은 이용자 질문에 맞춰 학습 도구와 시뮬레이션을 실시간으로 생성할 수 있다. 예를 들어 학생이 'pH 척도'를 검색하면 AI 개요가 기본 원리를 설명하는 인터랙티브 시각 자료를 보여준다. 또 '감귤류 과일을 pH 척도 위에 표시해 달라'고 요청하면 AI 모드가 해당 조건을 반영한 학습 화면을 만든다. 구글 검색은 과학과 수학을 비롯한 인문학, 외국어 등 과목별 맞춤형 연습 문제도 제공한다. 이용자가 'SAT에 자주 출제되는 단어로 퀴즈를 만들어 달라'고 입력하면 검색이 요청에 맞는 인터랙티브 퀴즈를 생성한다. 구글은 구글 렌즈에 문제 풀이를 지원하는 학습 기능도 추가할 예정이다. 학생이 풀고 있는 문제를 촬영해 올리면 구글 렌지 AI가 관련 개념을 설명하고, 오류 가능성을 찾아낸 뒤 풀이에 막힌 부분을 해결할 수 있게 알린다. 구글 검색은 이용자 자료 바탕으로 학습 문서를 제작하는 기능도 갖췄다. PDF와 문서·슬라이드뿐 아니라 손으로 작성한 필기 사진까지 검색에 올리면, AI가 여러 자료를 종합해 핵심 개념을 한 페이지로 정리하는 식이다. 제미나이 라이브에서는 여러 단계에 걸친 조사 보고서를 생성하고 결과를 음성으로 논의할 수 있다. 이용자가 조사 주제를 입력한 뒤 채팅을 종료하거나 다른 작업을 해도 제미나이가 백그라운드에서 보고서를 작성하며 작업을 마치면 알림을 보낸다. 제미나이는 질문에 맞춰 실제로 조작할 수 있는 3D 시뮬레이션도 생성한다. 'DNA가 작동하는 방식을 3D로 보여 달라'고 요청하면 이용자는 생성된 DNA 구조를 직접 회전하거나 확대·축소하며 살펴볼 수 있다. 답변에는 질문에 특화된 표와 격자 등 시각 자료도 함께 제공된다. 구글은 제미나이 앱에 분산된 교육 기능을 한곳에 모은 학생 전용 허브도 선보인다. 이용자는 해당 공간에서 학습 노트를 시작하고 플래시카드를 만들거나 연습 퀴즈를 풀 수 있다. 구글은 "AI가 학습 내용을 설명하는 챗봇을 넘어 학생별 학습 자료를 직접 구성하고 문제 풀이 과정에 개입하는 도구로 진화하고 있음을 보여준다"며 "우리는 검색과 렌즈·제미나이를 연결해 정보 탐색부터 개념 이해와 복습까지 하나의 서비스 안에서 처리할 수 있는 학습 환경을 구축했다"고 강조했다.

2026.08.20 10:08김미정 기자

LG CNS, 피지컬 AI 상용화 속도…타워팰리스에 경비로봇 도입

LG CNS가 프리미엄 주상복합단지에 사족보행 경비로봇을 도입해 피지컬 인공지능(AI) 상용화에 앞장선다. 자체 플랫폼을 기반으로 로봇의 신속한 투입을 지원한다는 목표다. LG CNS는 지난 19일 서울 마곡 LG사이언스파크 본사에서 타워피엠씨와 보안 로봇 솔루션 서비스 구축을 위한 업무협약(MOU)을 체결했다고 20일 밝혔다. 타워피엠씨는 지난 2002년 타워팰리스를 시작으로 한남 더힐, 아크로 서울 포레스트, 래미안 원베일리 등 국내 대표 프리미엄 주거단지를 관리하는 아파트 종합관리 전문기업이다. 현재 100여 개에 달하는 하이엔드 주거시설을 관리 중이다. 이번 협약을 바탕으로 양사는 향후 2개월여간 서울 강남 타워팰리스 단지 내 경비로봇 도입을 위한 기술 검증을 진행하고 4분기 내 실제 운영에 들어갈 예정이다. LG CNS는 사족보행 로봇이 타워팰리스의 실제 주거 환경에서 경비 업무를 수행할 수 있도록 단지 내 공간과 주행 동선, 낙상·화재 등 이상 상황을 비롯한 다양한 현장 데이터를 학습시킨다. 로봇은 학습한 데이터를 기반으로 공용 공간과 지하주차장 등을 자율 순찰하며 거동이 수상한 사람을 발견하거나 전기차 및 충전시설에 고열이 발생하는 등의 이상 상황을 감지할 경우 관리실에 알람을 전달하는 구조다. 이를 통해 관리자가 현장 상황에 신속 대응할 수 있도록 돕는다. 특히 관리자는 로봇에 탑재된 양방향 음성 통신 기능을 통해 로봇과 실시간으로 소통하며 상황을 보다 구체적으로 파악하고 적합한 후속 조치를 결정할 수 있게 된다. 로봇의 현장 데이터 학습과 운영에는 LG CNS의 로봇 전환(RX) 플랫폼 '피지컬웍스'가 활용된다. 학습 플랫폼 '피지컬웍스 포지'로 현장 데이터를 학습시키고 통합 관제 플랫폼 '피지컬웍스 바통'으로 로봇의 업무 수행을 관리·운영하는 방식이다. 해당 플랫폼은 LG CNS가 지난 5월 선보인 것으로, 로봇이 현장 데이터를 빠르게 학습하고 운영할 수 있도록 지원한다. 수개월이 걸리던 로봇의 현장 투입 기간을 1~2개월로 단축시켜 고객이 필요한 로봇을 신속하게 도입할 수 있도록 한다는 목표다. LG CNS는 사족보행 경비로봇이 정해진 시간에 순찰하는 기존 경비 체계를 보완해 단지 전역을 촘촘하게 관리하고 입주민 안전은 물론 관리 인력의 업무 효율까지 높일 것으로 보고 있다. 향후 로봇 기능·성능을 지속적으로 고도화하는 한편, 다양한 서비스 로봇과 연계한 자율 협업 체계도 구축할 계획이다. 가령 경비로봇이 단지 내에 쓰레기를 발견하면 청소로봇에 작업을 요청하는 등 이기종 로봇 간 협업을 통해 다양한 시설 관리 업무까지 로봇이 자율적으로 수행하도록 할 예정이다. 강민수 타워피엠씨 대표는 "프리미엄 주거시설에선 입주민 안전과 서비스 품질이 무엇보다 중요하다"며 "LG CNS와 함께 AI 기반 경비로봇을 도입해 보다 안전하고 차별화된 주거 서비스를 제공하고 앞으로도 첨단 기술을 활용한 시설 관리 혁신을 지속해 나가겠다"고 말했다. 명창국 LG CNS 스마트물류센터·로봇사업담당 상무는 "이번 협력은 피지컬 AI 기술이 실제 주거 환경에서 고객 가치를 창출하는 의미 있는 사례"라며 "피지컬웍스를 기반으로 다양한 로봇이 실제 업무를 수행하고 서로 협업하는 AI 로봇 서비스를 지속 확대해 나갈 것"이라고 밝혔다.

2026.08.20 10:01한정호 기자

[AI 고속도로] 구글, 브로드컴 넘어 마벨까지 품었다…AI칩 공급망 다변화

구글이 자체 인공지능(AI) 반도체 생태계 확대를 목표로 반도체 설계 기업 마벨과 손잡는다. 기존 핵심 파트너였던 브로드컴에 더해 새로운 공급망을 확보하면서, AI 데이터센터 경쟁력의 핵심으로 떠오른 맞춤형 반도체 전략을 한층 강화하는 모습이다. 19일(현지시간) 로이터통신에 따르면 마벨은 구글과 맞춤형 AI 반도체 개발·공급 계약을 체결하고 자사 보통주 약 5900만 주를 매입할 수 있는 신주인수권을 구글에 부여했다. 구글이 모든 권리를 행사할 경우 투자 규모는 121억 8000만 달러(약 16조 9000억원)에 달한다. 이번 계약은 단순 지분 투자를 넘어 AI 반도체 공급망 확대에 초점이 맞춰졌다. 구글은 마벨 제품 구매 실적에 따라 단계적으로 지분 인수 권한을 확보하게 된다. 대부분의 신주인수권은 마벨 제품을 5억 달러(약 6900억원)어치 구매할 때마다 순차적으로 부여되는 구조다. 구글이 모든 구매 조건을 충족할 경우 마벨이 확보할 수 있는 누적 매출은 최대 1200억 달러(약 166조원)에 이를 것으로 전망된다. 이번 협력은 구글의 자체 AI 반도체인 텐서처리장치(TPU) 경쟁력 강화 전략과 맞물려 있다. TPU는 AI 모델 학습과 추론에 특화된 반도체로, 엔비디아 그래픽처리장치(GPU)를 보완하거나 일부 영역에서 대체할 수 있는 핵심 칩으로 평가된다. 구글은 TPU의 핵심 설계를 직접 수행하고 있지만 세부 설계와 생산 관리, 스토리지와 네트워크를 비롯한 관련 기술은 외부 기업과 협력 중이다. 이번 계약에 따라 마벨은 AI 추론 가속기와 스토리지·네트워크 인터페이스·메모리 인터페이스 컨트롤러·니어메모리 컴퓨팅 등 TPU 생태계와 연계된 다양한 맞춤형 반도체를 공급할 예정이다. 특히 구글이 TPU 개발 과정에서 주로 브로드컴과 협력해왔다는 점에서 이번 계약은 공급망 다변화 전략의 신호로 해석된다. 다만 브로드컴과의 협력이 중단되는 것은 아니다. 앞서 구글은 브로드컴과 2031년까지 TPU와 AI 인프라용 반도체를 공동 개발하는 계약을 체결한 바 있다. 최근 빅테크 기업들은 비용 절감과 인프라 최적화를 목표로 자체 AI 반도체 개발에 속도를 내고 있다. 엔비디아의 고성능 GPU 가격이 급등하면서 특정 공급업체에 대한 의존도를 줄이고 서비스 특성에 맞는 반도체를 직접 설계하려는 추세다. 마벨은 이미 아마존을 비롯한 대형 클라우드 기업들의 맞춤형 AI 가속기 개발에도 참여하고 있다. 최근에는 AI 칩 간 데이터 전송 속도를 높이는 광자 기술 기업을 인수하며 데이터센터 연결 기술 경쟁력도 강화했다. 이 소식에 시장도 즉각 반응했다. 이날 마벨 주가는 9.85% 상승한 반면, 브로드컴 주가는 4.61% 하락했다. 업계에선 이번 계약이 AI 기업과 반도체 기업 간 지분 연계형 협력 모델이 확산하는 계기가 될 것으로 보고 있다. 앞서 AMD도 오픈AI와 반도체 구매 규모에 따라 지분을 부여하는 형태의 계약을 체결한 바 있다. 윌리엄 커윈 모닝스타 시장분석가는 "구글이 브로드컴을 마벨로 대체하기보다는 새로운 공급원을 찾아 시장을 키우는 차원으로 보인다"고 평가했다.

2026.08.20 09:41한정호 기자

스페이스X, AI 코딩 스타트업 '코그니션' 인수 불발..."협력 논의는 지속"

스페이스X가 인공지능(AI) 코딩 스타트업 코그니션 인수를 추진했지만 성사되지 않은 것으로 전해졌다. 최근 몇 달 사이 스페이스X가 AI 경쟁력 강화를 위해 커서에 이어 추진한 두 번째 대형 인수 시도였지만 이번 거래는 불발에 그쳤다. 20일 블룸버그는 복수의 소식통을 인용해 스페이스X가 코그니션에 인수 의사를 타진했지만 코그니션이 이에 응하지 않았다고 보도했다. 다만 인수 논의는 현재 진행되고 있지 않지만, 양측은 협력 가능성을 놓고 대화를 이어가고 있는 것으로 전해졌다. 소식통에 따르면 코그니션이 스페이스X의 컴퓨팅 역량을 활용하는 방안 등이 논의되고 있다. 스콧 우 코그니션 최고경영자(CEO)도 소셜플랫폼 엑스(X)를 통해 입장을 밝혔다. 그는 "스페이스X 팀에 대한 존경심은 크지만, 코그니션은 매각 대상이 아니며 우리는 매각을 논의한 적이 없다"고 말했다. 코그니션은 지난 5월 투자 라운드에서 260억달러, 한화 약 36조원의 기업가치를 인정받았다. 블룸버그는 앞선 보도에서 코그니션이 최소 400억달러, 한화 약 55조원 수준의 기업가치를 바탕으로 신규 투자 유치를 위한 초기 협상을 진행 중이라고 전한 바 있다. 이번 인수 시도는 불발됐지만, 머스크가 AI 경쟁에서 우위를 점하기 위해 대규모 자금 투입도 불사하고 있음을 보여준다는 평가가 나온다. 스페이스X는 지난 14일 AI 코딩 도구 커서(Cursor) 개발사 애니스피어(Anysphere) 인수를 600억달러, 한화 약 83조원 규모에 마무리했다. 업계에서는 스페이스X가 커서에 이어 코그니션 인수까지 시도한 배경으로 스페이스XAI의 코딩 분야 경쟁력 보강 필요성을 꼽는다. 스페이스X 내부 엔지니어들 사이에서도 챗봇 그록(Grok)의 코딩 성능이 경쟁 서비스에 미치지 못한다는 평가가 나오면서, 앤트로픽의 클로드 등 외부 도구를 활용해왔다는 점이 영향을 미쳤다는 분석이다. 스페이스X는 최근 커서와의 결합을 바탕으로 코딩 역량 강화에 속도를 내고 있다. 커서 데이터를 활용해 공동 개발한 '그록 4.5'를 선보였고 앤트로픽의 클로드 코드를 겨냥한 범용 업무 에이전트 '그록 봇'도 출시하며 오픈AI, 앤트로픽과의 격차를 좁히는 데 주력하고 있다. 한편 코그니션은 그동안 공개 석상과 투자자와의 대화에서 매각 의사가 없다는 입장을 일관되게 밝혀왔다. 스콧 우 CEO는 지난 5월 10억달러 규모 투자 유치와 관련해 "이번 투자를 통해 우리는 독립성을 유지하고 독립적인 회사로 계속 사업을 이어갈 수 있다"며 "이는 우리에게 매우 중요한 부분"이라고 말한 바 있다.

2026.08.20 09:28남혁우 기자

코레일, 13개 언어 음성인식 지원 AI 통번역기 개발…철도 서비스 경쟁력 ↑

한국철도공사(코레일)는 음성인식으로 13개 언어를 지원하는 '철도특화 인공지능(AI) 기반 실시간 다국어 번역시스템'을 개발했다고 밝혔다. AI 기반 실시간 다국어 번역시스템은 매표창구에 투명 유기발광다이오드(OLED) 디스플레이를 설치해 외국인 고객과 역무원이 서로 얼굴을 보며 각자의 언어로 대화할 수 있도록 개발됐다. AI가 대화 음성을 실시간으로 인식·번역해 외국인 고객과 역무원이 보는 양쪽 화면에 각각의 언어로 자막을 표시한다. 철도 분야 번역 정확도를 높이기 위해 승차권 예매와 환승, 열차·역 이용 안내 등에 쓰이는 전문용어와 표현을 AI에 학습시켰다. 영어·중국어(간체·번체)·일본어·베트남어·태국어·인도네시아어·독일어·프랑스어·스페인어·포르투갈어·이탈리아어·러시아어 등 13개 언어를 지원한다. 음성을 인식해 문자로 변환하는 데 걸리는 시간은 1.8초 이내이며 인식 정확도는 95% 이상이다. 코레일은 18일 전주역에서 영미권과 동남아권 외국인 시연단과 함께 시연회를 열고 승차권 예매와 환승 방법, 역 주변 안내 등 실제 고객 응대 상황을 재현했다. 특히 외국인 고객 질문의 인식·번역 정확도와 실시간 자막 표시 속도 등 시스템 성능과 이용 편의성을 중점 점검했다. 코레일은 전주역 현장 실증 결과를 바탕으로 시스템을 보완하고, 다음 달 서울역에서 추가 실증을 거친 뒤 전국 주요 거점역으로 확대 적용할 계획이다. 양태훈 코레일 철도연구원장은 “이번 AI 다국어 번역시스템은 증가하는 외국인 이용객의 철도 이용 편의를 높이기 위해 개발했다”며 “앞으로도 AI와 디지털 기술을 활용해 철도 서비스 경쟁력을 높이겠다”고 밝혔다.

2026.08.19 22:41주문정 기자

데이터 쌓고 모델 푸는 中…FT "차이나 쇼크 4.0 온다"

중국이 대규모 산업 데이터와 저비용 오픈 웨이트 인공지능(AI)을 앞세워 독자 기술 생태계를 구축하는 움직임이 커지고 있다는 분석이 나왔다. 중국이 자체 축적한 데이터를 AI 개발에 투입하고 모델을 해외로 확산해 글로벌 기술 표준과 거버넌스 주도권까지 확보한다는 해석도 있다. 19일 로이터통신과 파이낸셜타임스(FT)에 따르면 미·중 경제안보검토위원회는 지난 18일 발표한 보고서에서 중국이 데이터를 전략적 국가 자산으로 상업화하고 있다고 분석했다. FT는 지난 17일 기고문을 통해 중국의 오픈 웨이트 AI 확산이 새로운 형태의 '차이나 쇼크'를 일으킬 수 있다고 전망했다. 위원회는 미국 AI 기업들이 언어 모델 학습에 활용할 공개 인터넷 데이터를 대부분 소진한 반면 중국은 인터넷에서 수집하기 어려운 기업·운영·현실 세계 데이터를 체계적으로 확보하고 있다고 진단했다. 해당 데이터는 기업용 AI와 자율주행차, 휴머노이드 로봇 개발에 필요한 핵심 자원이다. 중국 첨단 제조업과 산업용 로봇 생태계는 물리적 환경에서 생성되는 양질의 데이터를 대규모로 제공하는 것으로 전해졌다. 보고서는 이 같은 기반이 상업·군사용 로봇 소프트웨어(SW)와 피지컬 AI 개발에서 중국에 잠재적인 우위를 줄 수 있다고 봤다. 중국은 데이터를 토지·노동·자본·기술과 같은 핵심 '생산요소'로 규정했다. 2023년 국가데이터국을 설립해 전국 데이터 표준화와 분류를 관리하고 통합 데이터 거래시장 구축에 나섰다. 중국 기업들은 상하이와 선전, 베이징 등에 설립된 데이터 거래소에 자체 데이터셋을 등록하기 시작했다. 중국 정부는 제조·교통·금융·의료 등 핵심 산업에서 데이터 자산을 표준화하고 산업 전반에 AI를 적용하는 정책도 추진하고 있다. 중국은 국경 간 데이터 이전에 대한 규제도 강화했다. 중국에서 사업하는 외국계 기업들은 중국 법인을 현지화하고 중국 고객 데이터를 글로벌 사업과 분리해야 했다. 면제 조치는 일부 기업에만 제한으로 적용됐다. 저비용 오픈 웨이트 확산…미 "데이터, 경제적 자산 돼야" FT는 중국이 저비용 오픈 웨이트 모델을 해외로 확산하고 있다는 점에 주목했다. 오픈 웨이트는 모델 가중치를 공개하지만 전체 학습 데이터는 개방하지 않는다는 점에서 오픈소스와는 차이가 있다. 이에 도입 비용을 낮추고 개발자 생태계 확대를 돕는다. 첨단 반도체가 부족한 환경에서도 기업이 각자 업무에 맞게 모델을 수정할 수 있어 신흥국뿐 아니라 전 세계 개발자 사이에서 오픈 웨이트 활용이 늘고 있다. 이 전략은 중국의 경제 상황과도 맞닿아 있다. AI 모델과 컴퓨팅 인프라·첨단 제조업에 투입한 비용을 회수하려면 충분한 고객이 필요하지만 중국 내수 수요만으로는 한계가 있기 때문이다. 미국의 대중국 수출 통제는 중국 기술 자립을 촉진하는 계기로 작용했다. 화웨이는 2019년 미국의 수출통제 명단에 오른 뒤 미국산 하드웨어(HW)와 소프트웨어(SW)에 대한 접근이 제한되자 운영체제 '하모니OS'와 AI 개발 프레임워크 '마인드스포어' 등 자체 생태계 구축에 나섰다. 이후 딥시크가 2025년 오픈 웨이트 AI 모델을 세계 시장에 알리면서 중국 개방형 AI 전략은 본격 주목받았다. 다수 외신은 미국 수출 통제가 중국 AI 산업에 비용을 안겼지만 결과적으로 기술 자립을 넘어 독자적인 혁신 체계를 만드는 구심점이 됐다고 평가했다. FT는 이를 제조업과 청정기술·디지털 기술 확산에 이은 '차이나 쇼크 4.0'으로 규정했다. 이번 충격은 중국 기술의 수출에 그치지 않고 국가 주도형 혁신 방식과 기술 표준 및 거버넌스 원칙까지 해외로 확산한다는 점에서 이전과 다르다는 분석이다. 오픈 웨이트 모델 확산은 안전 문제도 키우고 있다. 모델 가중치가 공개되면 누구나 이를 내려받아 수정·재배포하거나 안전장치를 제거할 수 있으며 원개발사는 접근을 취소하거나 보호 조치를 업데이트하기 어렵다. 중국에서는 모델을 개방하되 최첨단 시스템은 공개 시점을 늦추거나 접근을 제한하는 '선택적 개방'이 논의되고 있다. 상하이는 기술 평가 기반을 구축하고 베이징은 위험 관리 체계와 규제를 마련하는 등 중국 내부의 AI 거버넌스 체계도 구체화하고 있다. 마이크 쿠이켄 미·중 경제안보검토위원회 부위원장은 "우리 최우선 권고는 미국 의회가 국가 데이터 전략을 고민하는 것"이라며 "미국 정부가 데이터를 경제적 자산으로 다룰 수 있는 방안을 검토해야 한다"고 밝혔다.

2026.08.19 15:45김미정 기자

구글 제미나이, BTS 팬덤 품고 챗GPT 추격

구글이 방탄소년단(BTS)을 앞세워 '제미나이' 이용자 확대에 나섰다. 구글은 제미나이 앱 내 방탄소년단 허브 페이지를 통해 4가지 인터랙티브 기능을 제공한다고 19일 밝혔다. 이용자는 멤버들이 직접 엄선한 순간을 살펴보고, 언어를 배우며, 방탄소년단 소식을 확인하고, 창의적인 아이디어를 구현하는 공간을 이용할 수 있다. 허브 페이지는 네 가지 기능으로 구성된다. 'BTS의 제미나이 프롬프트 체험하기'에서는 멤버들이 실제로 입력한 프롬프트를 바탕으로 여행과 운동, 취미 등 주제별 추천을 받을 수 있다. 'BTS 노래 맞혀보기'는 곡의 분위기와 가사에 맞춘 이모지 힌트를 보고 노래를 알아맞히는 퀴즈 형식으로 진행된다. '오늘의 BTS 뉴스'는 최근 48~72시간의 주요 소식과 향후 2주 일정을 요약해 제공하며, '팬덤 일상 영어 배우기'는 팬레터와 댓글, 일상 대화에 자주 쓰이는 영어 표현을 오디오 발음 가이드와 함께 익힐 수 있도록 돕는다. 이용자는 제미나이 앱 프롬프트 창에 'Unlock BTS' 또는 '7777'을 입력해 각 기능을 이용할 수 있다. 이번 협업은 제미나이가 이용자 기반을 빠르게 넓히는 시점에 나왔다. 구글은 지난 7월 2분기 실적 발표에서 제미나이 앱의 월간 활성 이용자(MAU)가 9억 5000만명에 도달했다고 밝혔다. 시장조사업체 센서타워가 추정한 챗GPT MAU 약 10억명과 5000만명 차이까지 좁힌 규모다. 순다르 피차이 구글 CEO는 "제미나이 일간 활성 이용자가 1년 새 3배로 늘었다"고 설명했다. 점유율에서도 격차가 좁혀지고 있다. 모멘틱의 7월 보고서에 따르면 시밀러웹 데이터 기준 챗GPT는 세계 주요 7개 챗봇 웹 방문 점유율에서 53.9%로 1위를 지켰다. 제미나이가 27.9%로 2위, 앤트로픽 클로드가 9.2%로 3위를 기록했다. 국내에서는 오픈서베이 조사에서 제미나이가 만족도와 향후 유료 이용 의향 항목에서 챗GPT를 앞섰다. 제미나이는 구글 검색과 안드로이드 등 자사 서비스에 기본 탑재돼 이용자 기반을 넓혀 왔다. 이번 방탄소년단 협업은 여기에 글로벌 팬덤을 더한 시도다. 4가지 기능은 한국어 포함 일부 지원 언어에서 우선 제공된다.

2026.08.19 15:00김동원 기자

오픈AI, GPT 안전장치 강화… "더 강한 모델일수록 더 엄격하게"

오픈AI가 허깅페이스 취약점 유출 사고 이후 연구·훈련 환경 전반을 재점검한 데 이어 모델 역량이 높아질수록 더 엄격한 통제를 적용하는 새로운 개발 보안 체계를 공개했다. 오픈AI는 공식 블로그를 통해 모델 개발과 내부 테스트 단계에서 발생할 수 있는 보안 사고를 억제하기 위한 새 정책을 19일 공식 홈페이지를 통해 밝혔다. 회사는 모델 성능이 고도화될수록 개발 중인 시스템 자체가 새로운 위험 요인이 될 수 있다고 보고, 기존보다 촘촘한 감시와 강한 격리, 보다 엄격한 정렬 절차를 도입한다고 설명했다. 오픈AI 측은 "모델이 더 강력해질수록 내부 개발과 테스트에 따르는 위험도 함께 커진다"며 "모니터링, 정렬, 보안 기준이 그 위험보다 앞서가야 한다"고 밝혔다. 이번 조치는 허깅페이스 취약점 유출 사고 이후 공개된 첫 대규모 안전 체계 개편이라는 점에서 주목된다. 오픈AI는 이번 변화가 특정 사건 하나에 대한 직접 대응만은 아니라고 선을 그었지만 해당 사고와 함께 차세대 모델의 사이버보안 역량 고도화가 정책 강화의 배경이 됐다고 설명했다. 실제로 회사는 아스트라를 비롯한 향후 모델이 더 높은 수준의 보안 위험을 수반할 수 있다고 보고, 개발 속도보다 안전 검증을 우선하는 방향으로 운영 방침을 조정했다. 가장 상징적인 변화는 강화학습(RL) 훈련 운영 방식이다. 오픈AI는 허깅페이스 사고 이후 2주 동안 RL 훈련을 중단하고 연구 환경과 안전 절차를 재점검했다고 밝혔다. 이후 상대적으로 위험도가 낮은 일부 모델과 작업은 재개했지만, 회사가 준비 중인 최대 규모의 프런티어 RL 훈련은 여전히 보류 상태다. 오픈AI는 소규모 훈련과 추가 평가를 통해 모델 행동을 분석하고, 안전장치의 유효성과 정렬 수준에 대한 근거를 충분히 확보한 뒤 다음 단계로 넘어가겠다는 입장이다. 보안 인프라 측면에서는 연구 환경 격리가 핵심 축으로 제시됐다. 오픈AI는 모델이 생성한 코드나 신뢰할 수 없는 코드를 실행하는 워크로드에 대해 기존보다 강한 샌드박스 격리를 적용하고, 고위험 작업과 인터넷, 내부 네트워크 사이에 추가적인 차단 장치를 두겠다고 밝혔다. 이에 따라 단일 워크로드 또는 지원 서비스가 침해되더라도 곧바로 외부 인터넷이나 다른 내부망으로 접근이 이어지지 않도록 구조를 재설계한다는 설명이다. 이는 사고 이후 제기된 네트워크 보안 허점 비판을 의식한 조치로 풀이된다. 오픈AI는 이와 함께 공유 서비스 재구성, 최소 권한 원칙 적용, 보안 경계 강화, 로그 수집 확대 등 기본 보안 통제도 함께 손질하고 있다고 밝혔다. 또 자체 AI 모델을 활용한 모의 공격 기반의 지속적 보안 테스트 자동화에도 투자하고 있다고 덧붙였다. 단순히 침입을 막는 수준을 넘어, 고위험 모델이 개발 환경 내에서 어떤 방식으로 예상 밖 행동을 보일 수 있는지 상시 점검하는 체계로 전환하겠다는 의미다. 새 안전 체계의 중심에는 다단계 모니터링 시스템이 있다. 오픈AI에 따르면 이 시스템은 모델의 도구 사용 행동, 이용 가능한 추론 흔적, 활동 로그 등을 종합 분석해 무단 접근, 데이터 유출, 파괴적 행동, 안전장치 우회 시도 같은 이상 행위를 탐지한다. 의심 신호가 포착되면 보다 정밀한 자동 조사 단계로 넘겨 추가 분석을 진행하며 각 기업은 우려 활동 감지 후 30분 이내 경보 발령을 목표로 하고 있다. 치명적 보안 경계 위반 가능성이 높다고 판단될 경우 안전, 보안, 연구팀에 최우선 경보가 전달되는 구조다. 오탐 가능성에 대한 대응 절차도 포함됐다. 오픈AI는 경보가 발생한 뒤 30분 안에 실제 위협 여부를 명확히 판단하지 못할 경우 관련 작업을 우선 중단하도록 했다고 설명했다. 다만 이 같은 상시 감시에는 상당한 비용이 수반된다. 회사는 현재 기준으로 모니터링에 필요한 연산 부담이 감시 대상 프로세스의 약 20% 수준이라고 추산했다. 그럼에도 오픈AI는 프런티어 모델의 위험을 고려하면 이 정도 비용은 감수할 필요가 있다는 입장이다. 정렬 연구 강화도 이번 발표의 또 다른 축이다. 오픈AI는 가장 강력한 모델에 대한 RL 과정에서 훈련의 더 많은 단계에 정렬 기법을 적용하겠다고 밝혔다. 여기에는 위험 행동을 더 정밀하게 포착하는 보상 모델 개선, 모델이 자신의 능력과 한계를 보다 정직하게 설명하도록 유도하는 학습, 보상 체계나 평가 장치의 허점을 악용하는 행동을 줄이는 작업이 포함된다. 아울러 외부 시스템과 자원에 접근하는 과정에서 나타날 수 있는 유해 행동까지 훈련과 평가 범위를 넓히겠다고 했다. 오픈AI 연구진은 통제 강도가 모델의 위험 수준에 따라 달라질 것이라고 강조했다. 아멜리아 글레이즈 오픈AI 연구 부문 부사장은 기자들과 만나 "우리는 안전한 개발을 위한 요구사항과 기대 수준을 마련했다"며 "그 요구사항과 기대 수준은 우리가 보는 위험 수준에 따라 달라진다"고 말했다. 다시 말해 범용 모델과 고위험 모델을 동일한 잣대로 관리하지 않고, 역량이 높고 위험성이 큰 모델일수록 훨씬 강한 보안 통제를 적용하겠다는 것이다. 오픈AI는 특히 아스트라의 사이버보안 역량을 주요 변수로 보고 있다. 회사는 아스트라가 향후 자사 준비태세 프레임워크상 더 높은 수준의 보안 위험 범주에 도달할 가능성을 확인했으며, 이에 따라 관련 추론 작업과 도구 사용 과정에 추가 감시를 의무화했다고 설명했다. 이는 기존의 RL 훈련 중심 감시에서 나아가, 실제 모델 운용과 평가 전반으로 통제 범위를 확대한 조치다. 오픈AI 측 "향후 준비태세 프레임워크를 계속 고도화하고, 훈련과 배포 전반에 걸쳐 안전 기준을 발전시켜 나가겠다며 추가 기술 설명과 사고 분석 결과도 순차적으로 공개할 예정"아며모 "프런티어 모델의 역량은 빠르게 가속하고 있으며, 이를 이해하고 정렬하고 보호하는 능력은 그보다 앞서가야 한다"고 강조했다.

2026.08.19 14:51남혁우 기자

[ZD SW 투데이] NIPA, 사회 혁신 스타트업 경진 대회 개최 外

지디넷코리아가 소프트웨어(SW) 업계의 다양한 소식을 한 눈에 볼 수 있는 'ZD SW 투데이'를 새롭게 마련했습니다. SW뿐 아니라 클라우드, 보안, 인공지능(AI) 등 여러 분야에서 활발히 활동하고 있는 기업들의 소식을 담은 만큼 좀 더 쉽고 편하게 이슈를 확인해 보시기 바랍니다. [편집자주] ◆NIPA, 사회 혁신 스타트업 경진 대회 개최 정보통신산업진흥원(NIPA)이 지난 12일 익스트림테크챌린지(XTC), 글로벌디지털혁신네트워크와 온라인으로 '익스트림테크챌린지 코리아(XTC Korea) 2026'을 개최했다. 이는 국내 AI 스타트업 해외 진출과 투자 유치를 지원하는 행사다. 크로스허브·이큐브랩·스페이스맵·릴리커버·오믈렛·코드프레소·스튜디오랩·제제듀 등 8개사가 참가했다. 최종 1위와 '응용 AI 우수상'은 산업 현장의 운영 의사결정을 최적화하는 AI 기업 오믈렛이 차지했다. 오믈렛은 차량 경로와 선박 적재, 재고 배분, 간호사 근무표 작성 등에 최적의 해를 제시하는 기술을 보유했으며, 오는 11월 19일 미국에서 열리는 'XTC AI:360'에 참가해 글로벌 기업·투자자와 협력 및 투자 유치 기회를 모색한다. ◆딥핑소스, 프랜차이즈 창업박람회서 매장 운영 AI 공개 딥핑소스가 오는 25일부터 27일까지 서울 코엑스 D홀에서 열리는 '제84회 프랜차이즈 창업박람회'에서 예비 창업자와 점주를 위한 매장 운영 AI서비스를 선보인다. 딥핑소스는 이번 박람회에서 창업 전 단계부터 운영 단계까지 이어지는 '사이(SAAI)' 서비스 핵심 기능을 공개한다. 먼저 상권분석 솔루션 '사이 카운트'는 창업을 준비 중인 특정 입지의 유동인구와 주요 고객층을 확인할 수 있도록 돕는다. 매장 이상 상황 알림 솔루션 '사이 케어'도 전시된다. 매장을 비운 사이에도 AI가 이상 상황을 실시간으로 감지해 알려주는 솔루션이다. 이날 공개되는 '사이 스토어-POP메이커'는 디자인 역량 부족한 점주도 손쉽게 홍보물을 제작할 수 있도록 지원한다. ◆플러스제로, '보이스 인텔리전스 v2.0' 출시 플러스제로가 마케팅 전략 수립·분석 시간을 줄인 GEO 솔루션 '보이스 인텔리전스 v2.0'을 공식 출시했다. 이 서비스는 검색 트렌드 진단부터 AI 최적화 콘텐츠 생성까지 완전 자동화되는 AI GEO 엔진 'VTC 에이전트'와 'GEO 대시보드'를 탑재했다. 다양한 온라인 커뮤니티와 SNS 채널에 흩어진 고객의 익명 후기와 반응을 분석해 생성형 AI 검색 결과에 자사 브랜드가 우선 노출되도록 최적화하는 솔루션이다. ◆뉴플로이, 문서용 '뉴플로이 AI' 무료 공개 뉴플로이가 온디바이스 AI 모델 기반 문서 OCR 소프트웨어 '뉴플로이 AI'를 개인·기업 고객에 무료 제공한다. 뉴플로이 AI는 PDF와 스캔 문서의 글자, 표, 레이아웃을 인식해 내용 전체를 데이터 형태로 구조화한다. 문서 레이아웃 분석, 표 구조, 셀 단위 텍스트 인식, 표 내 데이터의 연관 관계 분석까지 가능하다. 수식을 이공계 논문 작성 표준인 라텍 형식으로 변환해 인식하며 한영 번역 기능도 제공한다. 뉴플로이가 자체 개발한 온디바이스 AI 모델은 사용자 디바이스 내에서 문서 데이터 처리·저장 등 전 과정을 수행한다. 파일은 외부 서버로 전송되지 않는다. 이에 보안 정책상 클라우드·온라인 등 외부 서비스에 업로드가 어려운 사내 자료나 개인정보 포함된 문서도 유출 우려 없이 처리할 수 있다. ◆클레온, 글로벌 학회서 '휴먼 AI' 기술 발표 클레온이 감정 종류·강도에 따라 AI 아바타 얼굴 표정을 만드는 기술을 국제 컴퓨터비전 학회 'BMVC 2026'에서 소개했다. 기존 기술이 음성에 맞춰 입 모양을 생성하는 데 집중했다면 이번 연구는 기쁨과 슬픔, 화남 등 말에 담긴 감정에 따라 눈빛과 표정을 포함한 얼굴 전체의 움직임을 구현한다. 실제 사람뿐 아니라 애니메이션과 3D 캐릭터에도 적용할 수 있다.

2026.08.19 14:50김미정 기자

"GPU 증설보다 효율 따져야"…망고부스트가 꺼낸 'AI 풀스택' 해법

"값비싼 그래픽처리장치(GPU)를 늘리기보다 이미 확보한 자원을 효율적으로 활용해야 하는 시대가 왔습니다." 망고부스트가 인공지능(AI) 인프라 시장에 던진 메시지다. 데이터처리장치(DPU)와 추론 소프트웨어(SW), GPU·스토리지 서버를 하나의 시스템으로 결합해 AI 데이터센터(AIDC)의 병목을 줄이겠다는 전략이다. 망고부스트는 DPU로 사업을 시작했지만 현재는 GPU 서버와 스토리지 서버, AI 추론 SW를 아우르는 AI 풀스택 기업으로 영역을 넓히고 있다. 개별 부품 공급을 넘어 데이터센터에 즉시 구축할 수 있는 랙 단위 시스템과 서버리스 추론 서비스까지 제공하겠다는 구상이다. 이런 전략은 망고부스트가 내세운 '부스트 유어 데이터센터(Boost Your Data Center)' 목표와 맞닿았다. 데이터센터 장비를 계속 늘리기보다 GPU와 서버, 스토리지 사이 데이터 이동을 최적화해 기존 인프라 처리 성능을 최대한 끌어내겠다는 의미다. 망고부스트 기술은 김장우 대표가 이끈 서울대 고성능컴퓨터시스템연구실에서 출발했다. 김 대표는 선마이크로시스템즈와 오라클에서 중앙처리장치(CPU)·시스템 아키텍트로 근무한 뒤 서울대 교수로 재직하며 10년 이상 서버 가속 기술을 연구했다. 김 대표와 연구진은 CPU가 연산뿐 아니라 네트워크와 스토리지 관련 작업까지 처리하는 기존 서버 구조에 주목했다. CPU에 업무가 몰리면 GPU와 스토리지 사이 데이터 이동이 느려지고, 고가의 GPU가 연산을 수행하지 못한 채 대기하는 시간이 늘어날 수 있기 때문이다. 연구진은 CPU가 맡던 네트워크와 스토리지 작업을 별도 반도체로 분리하는 DPU 기술을 개발했다. 김 대표는 연구 결과를 실제 데이터센터 환경에 적용하기 위해 2022년 망고부스트를 설립했다. 망고부스트는 미국 델라웨어 법인으로 출발해 워싱턴주 벨뷰에 본사를 뒀다. 서울과 산호세, 토론토, 도쿄, 인도네시아 등에서도 연구개발과 제품화, 고객 대응 업무를 수행하고 있다. 조직은 연구개발 중심으로 이뤄졌다. 현재 125명 넘는 엔지니어를 확보했으며 전체 인력 약 75%를 연구개발 업무에 배치했다. 부스트X에서 알폰소·케사르까지…HW·SW 하나로 묶었다 망고부스트 사업 출발점은 자체 DPU '부스트X(Mango BoostX™)'다. 부스트X는 CPU가 담당하던 네트워크와 스토리지, 보안 관련 작업을 대신 처리해 CPU와 GPU가 핵심 연산에 집중하도록 돕는다. 고속 네트워크 기반 AI 인프라에는 '로키 AI(RoCE AI)'가 적용된다. 로키 AI는 통합 이더넷 환경에서 원격직접메모리접근(RDMA)을 지원하는 RoCE 통신을 가속해 GPU와 서버 사이 데이터 전송 과정에서 발생하는 병목을 줄이는 역할을 한다. 망고부스트는 부스트X가 AI 에이전트 인프라 조정 작업까지 지원하도록 기술을 확장하고 있다. AI 에이전트가 여러 모델과 데이터, 외부 도구를 오가는 과정에서 발생하는 네트워크·스토리지 처리를 CPU에서 분리한다는 구상이다. DPU 위에서는 AI 추론 SW 'LLM부스트(LLM Boost™)'가 작동한다. LLM부스트는 여러 GPU와 서버에 AI 추론 요청을 분배하고 각 GPU가 맡을 작업을 조정해 유휴 시간을 줄이는 역할을 한다. 망고부스트 인프라는 서로 다른 세대나 제조사 AI 가속기를 하나의 클러스터처럼 활용하도록 설계한 것도 특징이다. 기업이 기존 GPU를 폐기하거나 전체 시스템을 최신 장비로 교체하지 않고도 신규 GPU와 함께 운용할 수 있도록 지원한다. 특히 GPU 서버 '알폰소(Mango Alphonso™)'는 이들 기술을 완제품 형태로 묶은 제품이다. AMD GPU와 부스트X, LLM부스트를 하나의 서버에 탑재해 AI 모델 학습과 추론에 필요한 연산·통신 환경을 통합했다. 스토리지 서버 '케사르(Mango Kesar™)'는 GPU가 연산에 필요한 데이터를 제때 공급하도록 지원한다. 저장 용량과 처리 성능을 각각 확장할 수 있는 분리형 구조를 채택했으며, DPU가 GPU와 스토리지 사이 통신을 가속한다. 통합 관리 SW '망고 AI 센터(MAC)'는 여러 서버 노드의 GPU·메모리 사용률과 전력, 온도, 네트워크 상태를 한 화면에서 보여준다. 관리자는 GPU가 제대로 활용되고 있는지 확인하고 시스템에서 발생한 병목이나 이상 상태를 파악할 수 있다. 서울에 42U 랙 10대 구축…벤치마크 넘어 실서비스 검증 서울에 위치한 망고부스트 데이터센터에 들어서자 검은색 서버랙이 줄지어 있었다. 랙 전면에 설치된 노란색 패널에는 '부스트 유어 데이터센터(BOOST YOUR DATA CENTER)' 문구가 적혀 있었다. 망고부스트는 외부 사업자가 운영하는 코로케이션 데이터센터의 공간과 전력·냉각 설비를 빌려 자체 AI 시스템을 구축하고 있다. 이곳에는 AMD 'MI355X' GPU를 탑재한 42U 규격 서버랙 10대를 배치할 계획이다. 각 랙은 GPU 서버 알폰소와 스토리지 서버 케사르를 중심으로 구성됐다. 부스트X와 로키 AI가 GPU·서버·스토리지 사이 데이터 이동을 가속하고, LLM부스트가 여러 GPU에 AI 추론 작업을 분배하는 구조다. 망고 AI 센터 화면에서는 GPU 사용률과 메모리, 전력, 온도, 네트워크 상태를 실시간으로 확인할 수 있었다. 개별 장비가 아니라 랙 전체의 연산 자원과 데이터 흐름을 통합 관리하기 위한 체계다. 망고부스트가 자체 데이터센터를 구축한 이유는 개별 제품이 아닌 전체 시스템의 성능을 검증하기 위해서다. DPU나 SW만 공급하면 고객이 사용하는 GPU와 네트워크, 스토리지 구성에 따라 실제 성능이 달라질 수 있다. 회사는 직접 구성한 데이터센터에서 HW와 SW를 함께 조정해 벤치마크에서 확인한 성능을 실제 고객 환경에서도 재현할 방침이다. 고객이 도입 전에 시스템 성능을 검증하는 공간으로도 활용한다. 망고부스트는 국제 AI 시스템 성능평가 'MLPerf'를 통해 추론 기술력을 검증하고 있다. MLPerf 인퍼런스 5.0에서 AMD 'MI300X' GPU 32개와 LLM부스트를 결합한 시스템은 엔비디아 'H100' GPU 32개 기반 비교 시스템보다 비용 대비 처리량이 2.8배 높은 것으로 나타났다. 다만 해당 수치는 망고부스트가 적용한 GPU와 SW 가격을 기준으로 총비용을 산정한 결과다. 고객 장비 도입 가격과 전력·냉각 비용, 운영 조건에 따라 실제 경제성은 달라질 수 있다. MLPerf 인퍼런스 6.0에서는 미국과 한국에 설치된 세 종류 AMD GPU 24개를 하나의 추론 시스템으로 연결했다. 해당 시스템은 '라마2-70B' 모델을 구동해 95.5%의 확장 효율을 기록했다. 망고부스트는 이를 통해 지역과 세대가 다른 GPU도 하나의 AI 추론 자원으로 활용할 수 있다고 설명했다. 기존 GPU와 최신 GPU를 같이 사용하면 장비 교체와 데이터센터 증설 부담을 줄일 수 있다는 주장이다. 망고부스트는 이런 HW·SW 통합 역량을 서버리스 AI 추론 서비스로 확장했다. 최근 미국 샌프란시스코에서 열린 'AMD 어드밴싱 AI 2026(AMD Advancing AI 2026)'에서 서버리스 AI 추론 플랫폼 '망고 인퍼런스(Mango Inference)'를 상용 출시했다. 망고 인퍼런스는 개발자가 GPU와 서버를 직접 구축·운영하지 않고 응용프로그램인터페이스(API)를 통해 AI 모델을 이용하도록 지원한다. 망고부스트의 GPU 서버와 DPU, LLM부스트를 서비스 형태로 제공하는 식이다. 망고부스트는 행사에서 AMD 최신 AI 가속기를 기반으로 엔비디아 차세대 칩 기반 시스템을 웃도는 추론 성능을 구현했다고 밝혔다. 엔비디아 GPU에 의존하지 않고도 AI 모델을 더 빠르고 경제적으로 운영할 수 있다는 것이 회사 측 설명이다. 당시 배경훈 부총리 겸 과학기술정보통신부 장관과 리사 수 AMD 최고경영자(CEO)도 행사장에 마련된 망고부스트 부스를 방문해 망고 인퍼런스를 살펴봤다. 망고부스트에 따르면 배 부총리와 리사 수 CEO는 서버리스 AI 추론 플랫폼의 필요성과 활용 가능성에 공감의 뜻을 나타냈다. 강남 데이터센터는 망고 인퍼런스의 성능과 안정성을 검증하고 실제 고객 요청을 처리하는 기반 시설로 활용된다. 제품 시험장과 고객 검증 공간을 넘어 AI 연산 자원을 서비스 형태로 공급하는 거점 역할까지 맡는 셈이다. 망고부스트는 완성형 서버랙을 판매하거나 고객 데이터센터에 동일한 시스템을 구축하는 방식으로 사업을 확대할 방침이다. DPU와 서버 공급에서 출발해 랙 단위 통합 인프라와 서버리스 AI 추론 서비스까지 사업 구조를 넓히고 있다. 망고부스트는 "우리 과제는 벤치마크에서 확인한 성능을 실제 고객 서비스에서도 재현하는 것"이라며 "응답속도와 안정성뿐 아니라 전력·냉각 효율, 유지보수와 장애 대응 능력까지 입증하겠다"고 강조했다.

2026.08.19 14:41김미정 기자

"AI로 뽑는 면발은 다를까"…엠아이큐브솔루션, 팔도 나주공장 자율화

엠아이큐브솔루션이 라면 생산 현장에 인공지능(AI) 판단과 설비 제어를 잇는 자율제조 체계를 구축한다. 엠아이큐브솔루션은 중소벤처기업부 'AI 응용제품 신속 상용화 지원 사업'을 통해 팔도 나주공장에 AI 기반 자율제조 플랫폼을 적용한다고 19일 밝혔다. 사업 기간은 1년이며 총사업비는 약 23억7천만원이다. 이번 사업은 라면 제조공정에서 발생하는 실시간 센서 데이터를 AI가 분석한 뒤 판단 결과를 실제 생산설비 제어로 연결하는 것이 핵심이다. 구축 대상 공장은 도시락과 왕뚜껑, 팔도비빔면 등 팔도의 주요 제품을 생산하는 나주공장이다. 엠아이큐브솔루션은 AI 기반 제조 이상탐지와 증숙·유탕 공정 성분 최적화, 믹서·롤러 공정 면대 두께 최적화, 롤러 공정 라면 중량 최적화, AI 기반 통합 운영·제어 포털 등 5개 시스템을 구축한다. 제조 이상탐지 시스템은 전 공정 센서와 제조실행시스템(MES) 데이터를 실시간으로 분석해 이상 징후를 포착한다. 공정 간 연계 분석으로 이상 원인을 파악하고 필요한 조치를 자동으로 권고하며 지속적인 학습을 통해 탐지 정확도를 높인다. 면을 찌고 튀기는 증숙·유탕 공정에는 수분과 지방 등 제품 성분을 실시간으로 예측하는 AI 시스템이 적용된다. AI가 예측 결과를 바탕으로 최적의 공정 조건을 도출하도록 구성한다. 반죽을 섞고 면대를 압연하는 믹서·롤러 공정에서는 AI가 면대 두께를 실시간으로 예측해 적절한 압연 조건을 찾는다. 롤러 공정에는 라면 중량을 예측해 목표 중량 이탈 가능성을 사전에 판단하는 시스템도 적용한다. 공정별 시스템은 통합 운영·제어 포털로 연결된다. 포털은 이상탐지와 품질 예측·최적화 결과를 통합 관리하고 자동제어장치(PLC) 등 기존 생산설비 시스템과 연계해 설비 제어까지 수행한다. 엠아이큐브솔루션은 팔도와 약 19억 4000만원 규모 자율제조 플랫폼 구축 계약을 체결하고 대표 공급기업으로 참여한다. 회사는 지금까지 110개 이상 제조기업에 제조실행시스템과 이상탐지, 설비효율, 품질예측, 공정최적화, 자율제조 솔루션을 공급했다. 심효준 엠아이큐브솔루션 대표는 "이번 사업은 제조 데이터를 분석하고 예측하는 AI를 넘어 AI의 판단이 실제 생산설비의 제어로 이어지는 '피지컬 AI'를 식품 제조 현장에 구현한다는 점에서 의미가 크다"며 "우리는 K-푸드 제조 현장의 자율화 수준을 한 단계 높이고 AI 기반 제조 혁신 모델을 글로벌 식품 제조 현장으로 확대해 나가겠다"고 말했다.

2026.08.19 14:09김미정 기자

몽고DB, 데이터 기반 AI 검색 개선…"에이전트 컨텍스트 정확도↑"

몽고DB가 데이터 검색과 에이전트 연결 기능을 아틀라스에 통합하며 인공지능(AI) 애플리케이션용 데이터 인프라 강화에 나섰다. 몽고BD는 '몽고DB 닷로컬 빌드 페스트'에서 아틀라스 오토메이티드 임베딩과 임베딩·리랭킹 응용프로그램 인터페이스(API), '보이지 코드 4', 스트림 프로세싱 벡터 서치 등을 공개했다고 19일 밝혔다. AI 코딩 도구와 아틀라스를 연결하는 완전 관리형 모델 컨텍스트 프로토콜(MCP) 서버도 선보였다. 아틀라스 오토메이티드 임베딩은 보이지 AI 모델 기반으로 새로 입력된 문서를 자동으로 임베딩하고 검색 인덱스에 반영한다. 기존 문서가 변경되면 다시 임베딩하기 때문에 개발자가 별도 작업을 실행하거나 데이터 동기화 일정을 관리할 필요가 없다. 아틀라스 임베딩·리랭킹 API는 몽고DB 외부에서 구동되는 애플리케이션도 보이지 AI의 임베딩·리랭킹 모델을 이용할 수 있도록 단일 접점을 제공한다. 몽고DB에 따르면 보이지 AI 임베딩 모델은 검색 임베딩 벤치마크인 '알티이비'에서 1위를 기록하고 있다. 새로 공개된 '보이지 코드 4'는 코딩 에이전트 코드 검색에 특화된 모델이다. 일반 임베딩 모델보다 코드와 관련 정보를 정밀하게 연결하면서 검색 비용을 낮추는 데 초점을 맞췄다. 아틀라스 스트림 프로세싱 벡터 서치는 이동 중인 실시간 데이터에도 벡터 검색을 적용한다. 에이전트가 정적인 데이터뿐 아니라 몇 초 전에 발생한 이벤트까지 검색할 수 있어 현재 비즈니스 상황을 반영한 컨텍스트를 확보할 수 있다는 설명이다. 몽고DB는 AI 코딩 도구가 아틀라스의 실시간 운영 데이터에 직접 접근할 수 있도록 '아틀라스 매니지드 MCP 서버'도 공개했다. 개발자는 별도 인프라를 구축하지 않고 클로드 코드와 코덱스, 그록 빌드, 데빈을 아틀라스에 연결할 수 있다. 연결된 AI 도구는 몽고DB의 컬렉션과 인덱스를 조회하고 데이터를 질의·집계하거나 스키마를 점검할 수 있다. 권한이 부여된 경우에는 컬렉션을 생성하거나 인덱스를 관리하는 작업도 수행할 수 있다. 아틀라스 매니지드 MCP 서버는 아틀라스 내부에서 원격 서비스 형태로 실행된다. 기존 아틀라스 자격 증명과 접근 제어 체계를 그대로 활용해 관리자가 에이전트의 운영 데이터 접근 권한을 한곳에서 관리할 수 있다. 짐 샤프 몽고DB 최고기술책임자(CTO)는 "우리 제품은 처음부터 운영 플랫폼으로 설계됐다"며 "검색과 메모리가 동일한 실시간 데이터 상에서 작동하며 별도 동기화 없이 에이전트가 지금 벌어지고 있는 일에 즉각 대응할 수 있다"고 밝혔다.

2026.08.19 13:34김미정 기자

"AI·데이터로 혁신"…정부, 공공서비스 창업팀 모집

정부가 인공지능(AI)·데이터 등 민간 기술로 공공서비스를 구축할 창업팀 발굴에 나섰다. 과학기술정보통신부는 오는 20일부터 내달 21일까지 '2026 고브테크 창업경진대회' 참가자를 모집한다고 19일 밝혔다. 올해로 3회째를 맞은 이번 대회는 총상금 7000만원 규모로 열린다. 대회는 '아이디어 기획'과 '제품·서비스 개발' 등 2개 트랙으로 운영된다. 예비 창업자는 두 트랙 모두 신청할 수 있으며 초기 창업기업은 제품·서비스 개발 트랙에만 참가할 수 있다. 참가자는 대국민 공공서비스와 지역·사회문제 해결, 공공인프라 혁신 중 한 분야를 선택해 자유주제로 지원하면 된다. 고브테크는 AI와 데이터 등 민간의 첨단 기술을 공공 분야에 도입해 서비스와 인프라를 혁신하는 분야다. 과기정통부는 9월 1차 서면평가를 거쳐 수상작의 3배수인 42개 팀 안팎을 선발한다. 트랙별로 약 21개 팀을 뽑은 뒤 멘토링을 제공해 최종 결과물을 고도화하도록 지원한다. 오는 11월에는 1차 평가 통과팀을 대상으로 발표평가를 진행한다. 이를 통해 트랙별 7개 팀씩 총 14개 수상팀을 선정한다. 최종 수상팀에는 12월 시상식에서 총 7000만원 상금과 상훈을 수여한다. 수상팀이 다음 해 '고브테크 창업기업 AI 실증·사업화 지원사업'에 신청할 경우 우대 혜택도 제공한다. 참가 신청은 대회 홈페이지를 통해 할 수 있다. 세부 일정과 평가 요소도 홈페이지에서 확인할 수 있으며 개별 문의는 대회 운영사무국에서 받는다. 최동원 과기정통부 AI인프라정책관은 "고브테크 창업경진대회는 민간 아이디어와 기술력을 발굴할 수 있는 공공 혁신의 출발점"이라며 "고브테크 분야 예비 창업자와 초기 창업기업들의 많은 관심과 적극적인 참여를 바라며 이번 대회가 참여자들에게 창업과 성장의 발판이 되기를 기대한다"고 밝혔다.

2026.08.19 12:00김미정 기자

플리토, '챗 트랜스레이션' 개인화 강화…"쓸수록 똑똑한 AI"

플리토가 이용자별 번역 데이터를 축적해 정확도를 높이는 인공지능(AI) 기능을 강화했다. 플리토는 실시간 AI 통번역 솔루션 '챗 트랜스레이션'의 '빠른 대화'와 '온라인 미팅'에 AI 학습 리포트 기반 추천 용어 기능을 적용했다고 19일 밝혔다. 새 기능은 대화가 끝난 뒤 발화 내용을 분석해 AI가 인식하지 못했거나 잘못 인식한 단어를 자동으로 찾아낸다. 문맥에서 중요하게 언급된 용어도 학습 대상으로 제안한다. 사용자는 추천된 용어를 클릭해 개인 번역 엔진에 반영할 수 있다. 기존처럼 전문 용어를 직접 입력하지 않아도 누적된 이용 기록 바탕으로 사용자별 번역 정확도를 높일 수 있다는 설명이다. 플리토는 대화 종료 후 AI 분석 리포트를 이메일로 보내는 기능도 추가했다. 업데이트된 기능은 이용 요금제와 관계없이 모든 사용자에게 기본으로 제공된다. 회사는 특정 산업이나 비즈니스 현장에서 전문 용어를 반복적으로 사용하는 이용자 업무 생산성이 높아질 것으로 기대했다. 앞으로 노트 작성 기능을 고도화하고 사용자 행동 패턴에 맞는 요약 양식을 제안하는 기능도 선보일 계획이다. 이정수 플리토 대표는 "출시 후 초개인화 기능 관련해서 이용자 피드백을 적극 수용해 AI가 용어 추출부터 학습까지 알아서 제안하는 초개인화 기능 고도화를 선보이게 됐다"며 "앞으로도 비즈니스와 일상 영역 구분 없이 글로벌 소통이 필요한 현장에서 플리토만의 차별화된 전문성과 생산성을 제공하는 AI 통번역 파트너로 진화해 나가겠다"고 밝혔다.

2026.08.19 11:51김미정 기자

"업무에 맞는 모델 골라"…스노우플레이크, '코텍스 게이트웨이' 강화

스노우플레이크가 인공지능(AI) 업무 특성에 따라 최적 모델을 자동 선택하는 기능을 내놨다. 스노우플레이크는 '코텍스 AI 게이트웨이'와 주요 AI 제품에 '다이나믹 모델 라우팅' 기능을 추가했다고 19일 밝혔다. 해당 기능은 작업 난도·비용을 분석해 요청별로 적합한 AI 모델을 자동 배정한다. 단순하거나 반복적인 작업은 비용 효율적인 모델로 처리한다. 복잡한 추론이 필요한 작업에는 성능 높은 프론티어 모델을 연결해 불필요한 추론 비용을 줄인다. 이 기능은 스노우플레이크 AI 제품 '코코'와 '코워크'에서 이용할 수 있다. 코텍스 AI 게이트웨이에 연결된 서드파티 AI 에이전트에도 적용된다. 기업은 이용 가능한 모델과 제공업체의 범위를 직접 설정할 수 있다. 코텍스 AI 게이트웨이는 모델 성능과 가격이 바뀌면 라우팅 정책을 업데이트한다. 새 모델이 출시돼도 기존 애플리케이션이나 AI 에이전트를 다시 구축할 필요 없이 해당 모델을 활용할 수 있다. 스노우플레이크 내부 시험에서는 오픈 모델과 상용 모델을 함께 사용해 품질을 유지하면서 토큰 효율성을 높인 것으로 나타났다. 다이나믹 모델 라우팅을 적용한 에이전트는 프론티어 모델만 사용했을 때 같은 품질을 유지하면서 최대 3배 높은 토큰 효율성으로 dbt 파이프라인을 구축했다. 다른 시험에서는 엔지니어링팀이 같은 수의 풀 리퀘스트를 처리하면서 토큰 효율성을 25% 높였다. 비용이 높은 모델을 품질 향상에 실질적으로 필요한 작업에만 투입한 결과다. 스노우플레이크는 코텍스 AI에 '딥시크 V4 플래시 0731'과 'GLM-5.3'도 추가했다. 고객은 앤트로픽과 오픈AI를 비롯해 구글과 스페이스X AI, 메타와 미스트랄 등이 제공하는 모델 중 업무별 품질과 성능·비용을 고려해 선택할 수 있다. 스노우플레이크 AI 리서치팀 평가에서 딥시크 V4 플래시는 데이터 엔지니어링 과제 점수 74.4%를 기록해 평가에 사용된 주요 상용 모델보다 높은 성능을 보였다. GLM-5.2는 62.8%를 기록했으며 시험 대상 중 가장 적은 토큰을 사용했다. 기업 데이터는 스노우플레이크 내부에 유지된다. 고객은 오픈 모델과 상용 모델에 동일한 접근 제어와 보안 정책·거버넌스를 적용할 수 있다. 관리자는 토큰 사용량과 비용을 확인하고 조직이나 사용자별 지출 한도도 설정할 수 있다. 슈리다 라마스워미 스노우플레이크 최고경영자(CEO)는 "기업들은 갈수록 AI 경제성을 더 엄격히 평가하고 있다"며 "관건은 얼마나 많은 AI를 사용하고 있는지가 아니라 AI가 유의미한 비즈니스 가치로 이어지고 있는지 여부"라고 밝혔다.

2026.08.19 11:35김미정 기자

오픈AI·딥마인드가 짚은 벤치마크 함정, AI 승부는 '현장'서 갈린다

인공지능(AI) 경쟁 기준이 성적표에서 현장으로 옮겨가고 있다. 벤치마크 점수가 아무리 높아도 실제 업무에서 쓰이지 않으면 좋은 모델로 보기 어렵다는 인식이 확산 중이다. 18일 발표된 정부의 국가대표 AI 선발 2차 평가가 이 변화를 그대로 보여줬다. 이날 독자 AI 파운데이션 모델(독파모) 2차 단계평가에서는 글로벌 AI 평가기관 아티피셜 애널리시스의 AAII 지표에서 참여팀 중 최고점을 받은 모티프테크놀로지스가 사용성·활용성에서 밀려 탈락했다. 반면 업스테이지·SK텔레콤·LG AI연구원이 3차에 진출했다. 이번 평가는 벤치마크 40점, 전문가 평가 35점, 사용자 평가 25점 등 총 100점으로 진행했다. AI 전문가 49명과 일반 국민 185명이 각 팀의 모델을 직접 써보고 채점하는 사용자 평가를 새로 도입해, 벤치마크 성능만으로는 통과할 수 없는 구조였다. 류제명 과기정통부 제2차관은 브리핑에서 "기술력이 뛰어나도 75점의 상당한 배점이 주어진 사용성·활용성에서 낮은 평가를 받으면 종합 결과가 달라질 수 있다"고 설명했다. 성적표가 실력을 보증하지 못하는 이유는 벤치마크 구조적 한계에 있다. 벤치마크는 미리 정해진 문제와 정제된 환경에서 모델을 시험한다. 문제 유형이 고정돼 있어 특정 시험에 맞춰 최적화하면 점수를 끌어올릴 수 있지만, 이렇게 얻은 고득점이 실제 업무 능력으로 이어진다는 보장은 없다. 현장 입력은 지저분하고 예외적이며, 사용자의 질문은 시험지처럼 정돈돼 있지 않기 때문이다. 이 문제는 최전선 연구자들이 먼저 지적해왔다. 노엄 브라운 오픈AI 연구부사장은 지난달 서울에서 열린 글로벌 AI 프론티어 심포지엄 2026에서 "막대그래프 하나로 AI 실력을 재는 시대는 끝났다"고 말했다. 오픈AI의 추론 모델 'o1'과 'o3' 시리즈를 설계한 그는 벤치마크 점수 하나가 아니라 연산량 대비 성능 곡선으로 모델을 평가해야 한다고 지적했다. 같은 모델이라도 더 오래 연산하게 하면 성능이 달라지는데, 단일 점수로는 이 차이가 드러나지 않는다고 강조했다. 국제 AI 학회 ICML 참석차 방한한 나만 고얄 구글 딥마인드 머신러닝 리서치 엔지니어는 벤치마크를 '텅 빈 코스에서 치르는 운전면허 시험'에 비유했다. 시험을 통과했다고 실제 도로에서 잘 달릴 수 있는 것은 아니란 뜻이다. 그는 성능이 뛰어난 물체 탐지 모델이 영상의 한 프레임에서는 대상을 정확히 찾고도 거의 똑같아 보이는 다음 프레임에서는 놓치는 사례를 들며 "정제된 환경에서 잘 작동하던 모델도 조건이 조금만 어긋나면 무너질 수 있다"고 지적했다. 통과한 팀들이 활용성을 전면에 내세운 배경도 여기에 있다. LG AI연구원은 이번 모델의 차별점으로 파라미터 규모가 아니라 실제 업무 현장에서 스스로 일을 처리하는 AI 에이전트 성능을 앞세웠다. LG AI연구원 관계자는 "크기를 키우면서도 실제 사용자가 더 효율적으로 쓸 수 있도록 에이전트 기능에 집중했다"며 "단순히 큰 모델을 만드는 게 아니라 사용자가 실제 업무에서 성과를 내도록 돕는 AI를 만드는 것이 핵심"이라고 밝혔다. 정부는 독파모 3차 평가를 거쳐 내년 초 최종 2개 팀을 선정한다. 2027년 이후 지원 방식은 개발 주관사 중심의 기존 구도에서 벗어나 전면 재검토하기로 했다. 글로벌 프론티어 모델과의 격차를 좁히기 위해 지원 규모와 경쟁 방식을 다시 짠다는 방침이다. 고얄 엔지니어는 10년 전 알파고가 정복한 대상이 규칙이 정해진 바둑판이었다면, 지금 마주한 대상은 규칙이 수시로 바뀌는 현실 속 AI라고 했다. 그는 "AI 실력은 정해진 판 위 고득점이 아니라, 판이 흔들리는 현실에서 얼마나 믿을 만한 결정을 내리느냐에 있다"고 밝혔다.

2026.08.19 11:13김동원 기자

[GPU 200% 활용법] GPU 26만장 확보한 정부, 다음은 '운영 효율'…GRIM-GPU 기술 주목

정부가 그래픽처리장치(GPU) 26만장을 신규 확보하면서 인공지능(AI) 인프라의 방향성이 'GPU 운영 효율'로 옮겨가고 있다. 대규모 예산을 들여 GPU를 확보한 만큼 이제 확보한 자원을 다양한 업무 환경에 맞춰 얼마나 유연하게 실제 활용률을 끌어올릴 수 있느냐가 새로운 경쟁력으로 떠오르는 모습이다. 이런 흐름 속에서 과학기술정보통신부와 정보통신기획평가원(IITP)이 추진하는 GPU 공유·재구성 기술 개발 과제 'GRIM-GPU(GPU 재구성 및 간섭 최소화 GPU 공유)' 기술이 주목받고 있다. 19일 관련 업계에 따르면 GRIM-GPU 과제 주관기업으로 이노그리드가 선정돼 산학연 컨소시엄을 이끌며 연구개발을 진행 중이다. GPU 확보 다음은 운영 효율...유연한 자원 분할 지원하는 GRIM-GPU GRIM-GPU는 여러 작업에서 GPU 하나를 함께 사용할 때 발생하는 성능 간섭을 최소화하면서 GPU 자원을 보다 유연하게 분할·재구성해 배분할 수 있도록 하는 GPU 공유 기술이다. 이 기술이 주목받는 이유는 국가 AI 인프라 정책 방향성과 맞닿아 있기 때문이다. 그동안 대규모 AI 구동을 위한 GPU 확보에 집중해왔다. 정부는 아시아태평양경제협력체(APEC) 계기로 GPU 26만장을 신규 확보하며 그동안 국내 AI 연구·산업 확대를 가로막던 컴퓨팅 인프라 병목을 상당 부분 해소했다는 평가를 받는다. 여기에 정부와 클라우드 서비스 기업(CSP) 3사가 참여하는 실무협의체를 통해 1조4천억원 규모 GPU 확보 사업도 본격화된 상태다. 하지만 GPU를 많이 확보하는 것과 GPU를 효율적으로 굴리는 것은 다른 문제다. 현재 시장의 GPU 서비스는 대부분 GPU를 특정 사용자나 작업에 통째로 할당하는 패스스루 방식에 머물러 있다. 구조가 단순하고 성능 예측이 쉽다는 장점은 있지만 고가 장비를 여러 작업이 나눠 쓰기 어렵고 워크로드가 바뀔 때마다 자원을 다시 구성하는 데 수일이 걸린다는 한계가 있다. 특히 공공·엔터프라이즈 환경은 가상환경(VM)과 컨테이너, 온프레미스 등 다양한 작업 환경이 산재하고 어떤 작업은 대규모 자원을 장시간 점유하고 어떤 작업은 일부 자원만 짧게 필요로 하는 등 업무 특성이 다양하다. 이런 수요 편차에 맞춰 GPU를 얼마나 유연하게 배분하고 운영하느냐에 따라 실제 활용도가 크게 달라진다. 그래서 GRIM-GPU은 GPU를 나누는 데 그치지 않고, 공유 과정에서 발생하는 간섭을 예측하고 줄이는 기술까지 함께 지원한다. 여기에 GPU 상태를 실시간에 가깝게 파악할 수 있는 경량 모니터링과 운영 관리 체계까지 더해 효율성을 극대화한다는 방침이다. GRIM-GPU, VM·컨테이너 혼재 환경부터 간섭 제어까지 이노그리드는 이 과제의 주관기업을 맡아 2028년까지 산학연 컨소시엄을 이끈다. 단순히 특정 기업의 기술 개발 프로젝트가 아니라, 정부가 국책 R&D로 지정해 국내 여러 기관이 함께 참여하는 원천기술 확보 사업이다. 이노그리드는 GRIM-GPU 구현을 위해 기술 개발의 초점을 크게 세 갈래로 두고 있다. VM과 컨테이너가 혼재된 환경에서도 GPU 자원을 유연하게 분할·재구성할 수 있는 구조를 마련하는 데 집중하고 있다. 실제 클라우드 현장에서는 단일 환경보다 다양한 워크로드와 운영 방식이 혼재하는 경우가 많은 만큼, 특정 환경에 한정되지 않는 범용성을 확보하겠다는 취지다. 동시에 GPU 공유 과정에서 발생할 수 있는 성능 간섭을 줄이는 기술 개발에도 힘을 싣고 있다. 여러 작업이 하나의 GPU를 함께 사용할 경우 처리량 저하나 지연시간 증가 같은 문제가 발생할 수 있는 만큼, 자원 분배를 넘어 간섭을 예측·완화할 수 있는 운영 기술까지 함께 확보하겠다는 것이다. 운영 단계에서의 가시성을 높이기 위한 경량 모니터링 체계 구축도 주요 과제다. GPU 상태와 자원 사용 현황, 이상 징후를 실시간에 가깝게 파악할 수 있어야 실제 서비스 환경에서 안정적인 운영이 가능하기 때문이다. 이노그리드는 이를 통해 단순한 연구용 기술이 아니라 공공·엔터프라이즈 환경에 적용 가능한 실질적 운영 기술로 고도화하는 데 무게를 두고 있다. 향후 계획도 명확하다. 초기에는 핵심 기능 구현과 성능 검증에 집중하고, 이후에는 실제 클라우드 환경에서 적용 가능한 수준으로 기술 완성도를 높인다는 구상이다. 여기에 산학연 협력을 바탕으로 기술 검증 범위를 넓히고, 단계적으로 오픈소스 공개를 추진해 생태계 확산 기반도 마련할 방침이다. 김명진 이노그리드 대표이사는 "AI 인프라 경쟁은 이제 GPU를 얼마나 확보하느냐를 넘어, 확보한 자원을 얼마나 효율적이고 안정적으로 운영하느냐가 핵심이 되고 있다"며 "GRIM-GPU 과제는 고가의 GPU 자원을 보다 유연하게 활용하고, AI 서비스 확산에 필요한 운영 효율성을 높이기 위한 중요한 연구개발 과제"라고 설명했다. 이어 "이노그리드는 클라우드 컴퓨팅 및 AI 인프라 전문기업으로서 국가 AI 인프라 운영 기술 고도화에 기여하고, 향후 서비스형 GPU*GPUaaS)·AI CMP 등 AI 인프라 기술 스택과 연계해 현장에서 활용 가능한 성과로 이어질 수 있도록 책임감 있게 추진하겠다"고 포부를 밝혔다.

2026.08.19 11:07남혁우 기자

커서, 깃허브 대항마 '오리진' 출시…코드 호스팅 시장 진출

커서가 인공지능(AI) 코드 편집 도구에서 개발자 협업 플랫폼으로 사업을 확장했다. 18일(현지시간) 테크크런치 등 외신에 따르면 커서는 코드 호스팅 플랫폼 '오리진'을 출시했다. 개발자는 오리진에서 코드를 저장하고 탐색·편집할 수 있으며 다른 개발자와 공동으로 작업할 수 있다. 오리진은 풀 리퀘스트 기능을 지원한다. 풀 리퀘스트는 다른 개발자가 수정한 코드를 검토한 뒤 주요 코드베이스에 반영해 달라고 요청하는 절차다. 해당 플랫폼은 깃허브와 연동 가능하다. 이용자는 깃허브 계정과 조직을 커서에 연결하고 원하는 저장소를 오리진으로 가져올 수 있다. 기존 깃허브 저장소와 커서가 호스팅하는 저장소를 함께 관리하는 것도 가능하다. 커서는 향후 오리진에 '에이전트 네이티브' 기능을 추가할 계획이다. 이를 통해 AI 에이전트가 개발 업무에 참여할 수 있는 기능을 선보인다는 전략이다. 테크크런치를 비롯한 다수 외신은 커서 오리진 출시가 깃허브의 잦은 장애와 성능 저하에 대한 개발자 불만이 커지는 시점에 이뤄졌다는 점을 주목했다. 커서가 오리진을 공개한 당일에도 깃허브에서 장애가 발생해 6시간 넘게 일부 기능이 제대로 작동하지 않았다. 당시 전 세계 오류율은 20%를 기록한 것으로 전해졌다. 깃허브는 올 초에도 장애가 잇따르자 서비스 가용성을 개선하기 위한 대책을 발표했다. 리드데브 분석에 따르면 깃허브에서 지난 1년간 발생한 장애는 257건이다. 리드데브는 반복되는 장애로 일부 유명 이용자의 이탈이 나타나고 있다고 분석했다. 업계에선 커서가 깃허브와 본격적으로 경쟁하기까지는 적지 않은 시간이 필요할 것이란 시각도 나오고 있다. 깃허브 자체 집계에 따르면 지난해 10월 기준 약 1억 8000만명 개발자가 플랫폼을 이용하고 있다. 깃허브는 여전히 세계에서 가장 규모 큰 소스코드 호스팅 플랫폼인 셈이다. 커서는 "깃허브 저장소를 커서가 호스팅하는 저장소와 나란히 둘 수 있다"며 "깃허브를 커서에 연결하고 조직과 저장소를 선택하면 커서가 해당 저장소를 가져온다"고 밝혔다.

2026.08.19 11:06김미정 기자

무료 AI 이용자, 유료 고객 될까…퍼플렉시티 '인도 실험' 첫 시험대

퍼플렉시티가 인구 세계 1위 인도 시장을 겨냥해 유료 인공지능(AI) 서비스를 1년간 무료로 제공한 실험의 첫 성적표가 나오기 시작했다. 18일(현지시간) 테크크런치 등 외신에 따르면 퍼플렉시티 인도 무료 구독 신청이 끝난 뒤 앱 내려받기는 90% 넘게 급감했다. 반면 매출은 오히려 60%가량 늘었다. 퍼플렉시티는 지난해 7월 에어텔과 손잡고 약 200달러(약 28만원)짜리 '퍼플렉시티 프로' 구독을 이 회사 가입자 3억 6000만 명에게 1년간 무료로 제공했다. 신규 신청은 올해 1월 16일 마감됐다. 무료 배포는 곧바로 사용자 확보로 이어졌다. 시장조사업체 센서타워에 따르면 퍼플렉시티는 지난해 7월 인도에서 앱 내려받기 590만 건을 기록했다. 전월보다 625% 늘어난 수치로, 지난해 상반기 6개월간 누적 내려받기(540만 건)를 한 달 만에 넘어섰다. 무료 제공 기간 7개월간 내려받기는 5600만 건에 달했다. 월간 활성 이용자(MAU)는 10월 2200만 명으로 정점을 찍었다. 신규 신청이 끝나자 내려받기는 급감했다. 센서타워는 2~7월 인도 내려받기를 330만 건으로 추정했다. 직전 6개월보다 90% 이상 줄었다. 하지만 확보한 이용자가 곧바로 빠져나가지는 않았다. MAU는 7월 약 1400만 명으로 정점보다 줄었지만, 프로모션 이전(약 260만 명) 다섯 배를 웃돈다. 내려받기 감소는 매출 감소로 이어지지 않았다. 센서타워에 따르면 2월부터 8월 중순까지 퍼플렉시티 인도 인앱 매출은 무료 제공 기간보다 약 60% 늘었다. 초기 가입자 무료 이용이 끝나기 시작한 지난달 중순 이후에도 하루 평균 매출은 직전 30일보다 9% 높았다. 다만 이 매출 증가를 유료 전환 증거로 보기는 이르다는 평가가 나온다. 무료 구독이 자동 갱신 방식이어서다. 늘어난 매출 일부는 스스로 결제를 택한 이용자가 아니라 해지 시점을 놓친 이용자일 수 있다. 센서타워도 두 경우를 구분하기는 어렵다고 밝혔다. 또 다른 앱 분석업체 앱피겨스도 에어텔 제휴가 퍼플렉시티 인도 실적을 끌어올렸다고 분석했다. 이 회사에 따르면 퍼플렉시티 인도 월 순 모바일 매출은 지난해 1월 약 3만 4000달러(약 4790만원)에서 올해 7월 15만 6000달러(약 2억 1900만원)로 늘었다. 아리엘 미카엘리 앱피겨스 최고경영자(CEO)는 이 성장이 AI 앱 전반 수요가 아니라 퍼플렉시티에 국한된 현상이라고 설명했다. 같은 기간 챗GPT와 클로드 내려받기는 큰 변화가 없었다. 관건은 무료 기간이 끝난 뒤다. 가입자는 이용을 시작한 시점부터 1년간 프로를 유지하는 구조여서, 지난해 7월 먼저 가입한 이용자들 무료 기간이 이제 막 끝나기 시작했다. 공짜로 서비스를 쓰던 이용자가 유료 고객으로 남을지가 이번 실험 마지막 과제다. 이번 실험은 인도를 겨냥한 AI 기업들의 경쟁으로 번지고 있다. 오픈AI는 지난해 11월 저가 요금제 '챗GPT 고'를 인도에서 1년간 무료로 풀었다. 구글도 릴라이언스 지오 이용자에게 'AI 프로' 구독을 18개월간 무료로 제공하기로 했다. 이용자를 먼저 확보한 뒤 유료로 전환하려는 전략이다. 이런 경쟁 배경에는 수익화라는 공통 과제가 있다. 인도는 인터넷 가입자 10억 명, 스마트폰 이용자 7억 명 이상으로 중국에 이어 세계 2위 시장이지만, 이 규모를 매출로 바꾸기는 쉽지 않았다. 오픈AI 앱만 해도 지난해 8월까지 90일간 인도에서 2900만 건 넘게 내려받아졌지만, 같은 기간 인앱 매출은 360만 달러에 그쳤다.

2026.08.19 10:21김동원 기자

  Prev 1 2 3 4 5 6 7 8 9 10 Next  

지금 뜨는 기사

이시각 헤드라인

카카오, 2개 회사로 나뉜다…카카오AI-카카오X로 성장 재설계

국내 반도체 장비업계 '방긋'...삼성·SK 증설에 수주잔고 2배 급증

[현장] AI 데이터센터도 '개방형 혁신'으로…글로벌 인프라 업계 한자리에

앤트로픽, 역대 최대 IPO 도전…"스페이스X 기록 깬다"

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.