• ZDNet USA
  • ZDNet China
  • ZDNet Japan
  • English
  • 지디넷 웨비나
뉴스
  • 최신뉴스
  • 방송/통신
  • 컴퓨팅
  • 홈&모바일
  • 인터넷
  • 반도체/디스플레이
  • 카테크
  • 헬스케어
  • 게임
  • 중기&스타트업
  • 유통
  • 금융
  • 과학
  • 디지털경제
  • 취업/HR/교육
  • 생활/문화
  • 인사•부음
  • 글로벌뉴스
  • AI의 눈
ZDPick
인공지능
AI의 눈
IT'sight
칼럼•연재
포토•영상

ZDNet 검색 페이지

'AI 영상'통합검색 결과 입니다. (126건)

  • 태그
    • 제목
    • 제목 + 내용
    • 작성자
    • 태그
  • 기간
    • 3개월
    • 1년
    • 1년 이전

허드슨에이아이, 국제방송영상마켓에 실시간 AI 통번역 솔루션 공급

인공지능(AI) 음성 기술 기업 허드슨에이아이가 코엑스에서 개최된 '2026 국제방송영상마켓(BCWW)' 컨퍼런스와 워크숍에 실시간 AI 통번역 솔루션 '허드슨 라이브'를 제공했다. 16일 회사에 따르면, 허드슨 라이브는 행사 현장에서 발표자의 음성을 실시간 인식해 다국어로 번역하는 AI 통번역 솔루션이다. 문화체육관광부가 주최하고 한국콘텐츠진흥원·코엑스가 공동 주관해 사흘간 열린 올해 행사에서 영어·일본어·중국어·스페인어 등 총 6개 언어를 지원했다. 이번 BCWW는 17개국 403개 사가 참가해 역대 최대 규모를 기록했으며 방송사·제작사·온라인동영상서비스(OTT)·플랫폼 관계자 등이 결집했다. 허드슨 라이브는 단순한 텍스트 변환을 넘어 발화자의 감정과 어조까지 표현해 자연스러운 번역 자막과 음성을 동시에 제공하는 점이 특징이다. 여러 명이 참여하는 패널토크 세션에서는 발화자별 대화 흐름을 구분해 전달한다. 아울러 미디어 더빙 사업을 통해 구축한 음성 데이터를 바탕으로 방송·영상 분야의 작품명·기업명 등 고유명사와 전문용어도 정확히 인식한다. 해당 기술은 KTV 국무회의 생중계 실시간 한국어 자막에 적용되는 등 신뢰성을 검증받은 바 있다. 회사는 향후 국제 컨퍼런스로 적용 범위를 넓히며 사람·사람 및 사람·AI 간 보이스 인터랙션을 고도화할 계획이다. 신현진 허드슨에이아이 대표는 "누구나 언어의 장벽 없이 더 넓은 무대에 설 수 있도록, 가장 자신 있는 언어로 말해도 자연스럽게 소통할 수 있는 환경을 만드는 것이 허드슨 라이브의 목표"라며 “이를 위해 실시간 음성 기술을 고도화해 사람과 사람, 나아가 사람과 AI가 자연스럽게 대화하는 보이스 인터랙션으로 발전시켜 나가겠다"고 밝혔다.

2026.09.16 17:39백봉삼 기자

"사람이 좋아하는 영상, AI에겐 다르다"…비트리가 여는 피지컬 AI 시대

"사람이 좋아하는 영상과 인공지능(AI)이 좋아하는 영상은 다릅니다." 김희걸 비트리(BTREE) 대표는 최근 본지와의 인터뷰에서 피지컬 AI 시대를 맞은 영상처리 기술의 변화를 이같이 진단했다. 비트리는 2014년 설립된 국내 대표 영상처리 반도체 IP(설계자산) 기업이다. 카메라 인터페이스부터 영상신호처리(ISP), 비전 IP, 코덱, 디스플레이 프로세싱까지 영상 처리 전 구간의 IP를 자체 개발해 보유하고 있으며, 글로벌 시장에서는 Arm, 베리실리콘과 경쟁 중이다. 사람 눈에서 로봇의 눈으로 김 대표는 그동안 ISP 기술이 '사람이 보기 좋은 영상'을 만드는 데 집중해 왔다고 설명했다. 색 재현성이 좋고 노이즈가 없으며 윤곽이 또렷한 영상이 좋은 영상이라는 기준이 스마트폰 카메라 경쟁을 거치며 수십 년간 정립됐다는 것이다. 하지만 기계가 스스로 판단하고 움직이는 피지컬 AI 시대에는 이 기준이 통하지 않는다는 게 김 대표의 설명이다. 그는 "사람 눈에 선명해 보이도록 윤곽을 과도하게 강조하면 오히려 '링잉' 현상이 생겨 AI 인식률이 떨어진다"며 "AI에게는 색이 화려한 것보다 형태의 경계가 끊기지 않고 필요한 정보가 살아있는 영상이 더 중요하다"고 설명했다. 비트리가 개발 중인 초저조도 영상처리 솔루션이 대표적 사례다. 사람 눈으로는 사물을 구분할 수 없는 0.01럭스 수준의 어두운 환경에서도, 일반 이미지 센서와 자체 알고리즘만으로 AI가 인식 가능한 수준의 영상을 복원해낸다. 김 대표는 "특수 센서 없이 프레임을 누적시켜 밝기를 확보하는 방식"이라며 "AI가 못 보던 것을 보게 해주는 기술이 곧 경쟁력이 되는 시대"라고 말했다. 비트리는 자체 신경망처리장치(NPU)도 이런 관점에서 설계했다. 통상 1~2톱스(TOPS) 수준의 경량 NPU를 탑재해, 고성능 메인 AI 반도체를 상시 구동하는 대신 객체나 얼굴을 먼저 감지했을 때만 메인 칩을 깨우는 방식이다. 각 영상처리 블록이 연산 결과를 서로 넘겨받아 중복 연산을 줄이는 이른바 '어웨어(Aware)' 기술도 비트리가 자체 개발해 보유한 핵심 기술 중 하나다. 안전이 새로운 기준이 되는 시대 김 대표는 피지컬 AI 확산이 영상처리 기술에 '안전'이라는 새로운 잣대를 요구하고 있다고도 짚었다. 그는 자동차 반도체 시장에서 국제 기능안전 표준인 ISO 26262 인증이 사실상 필수 조건으로 자리 잡았다고 소개했다. 인증이 없으면 아예 고객사와의 협상 테이블에도 앉지 못한다는 것이다. 비트리는 2년 반 가량의 취득 과정을 거쳐 ISP IP에 대한 해당 인증을 확보했다. 그는 "자동차뿐 아니라 사람과 부딪힐 수 있는 로봇 분야로도 이런 안전 인증 요구가 확산될 것"이라며 "오작동이 곧 사고로 이어지는 물리적 AI 기기라면 어디든 검증된 영상처리 기술이 필요해질 것"이라고 전망했다. 김 대표는 장기적으로는 영상처리 플랫폼에 보안 기능까지 결합하겠다는 구상도 밝혔다. 그는 "앞으로는 사람의 조작이 아니라 영상 데이터 자체가 기계를 움직이는 명령이 되는 세상이 온다"며 "영상이 왜곡되거나 해킹당하면 곧바로 사고로 이어질 수 있는 만큼, 자체 보유한 양자난수생성(QRNG) 기술을 접목해 영상 보안까지 아우르는 회사로 나아가겠다"고 말했다.

2026.09.16 16:48전화평 기자

"전문가급 영상, 갤럭시 폴더블에 담아보세요"

삼성리서치(SR)와 삼성전자 모바일(MX) 사업부가 협업해 갤럭시 폴더블 신제품에 전문가급 영상 기술을 탑재했다. 16일 삼성전자 뉴스룸에 따르면 갤럭시 Z 폴드8 울트라·폴드8·플립8는 영상 촬영 시 자연스런 보케 효과를 보여준다. 보케 효과는 사진의 아웃 포커스 부분에 미적인 블러 효과를 만들어내는 사진 표현 방법으로, 렌즈가 빛의 아웃 포커스 지점을 표현하는 방식이다. 신제품에서는 피사체와 배경 사이 거리에 따라 흐림 정도가 자연스럽게 달라지고, 배경의 작은 광원도 전문가 렌즈로 촬영한 것처럼 빛방울로 표현된다. 촬영이 끝난 뒤에도 영상 속 초점 위치를 다른 피사체로 옮기거나 흐림 강도를 조절할 수 있다. 박상욱 MX사업부 프로는 "별도의 전문 장비 없이도 깊이감과 분위기가 살아 있는 영상을 간편하게 촬영할 수 있다"고 설명했다. 기술 개발의 출발점은 전문 카메라와 스마트폰 영상 간의 간극을 좁히자는 아이디어에서 비롯됐다. 김영걸 SR 프로가 스마트폰 영상에서 전문 렌즈 특유의 깊이감을 구현하자는 연구 아이디어를 제안했고, 일반 사용자의 전문 영상 촬영 환경을 고민하던 MX사업부가 제품화를 결정하면서 공동 개발을 착수했다. 양측 개발진은 상용화 수준의 화질을 확보하기 위해 수많은 환경에서 반복 검증을 진행했다. 연구진이 직접 모델로 나서 서로를 촬영하며 인물과 배경의 경계 처리, 거리별 흐림, 빛망울 형성 등을 점검했다. 기술적 난제는 머리카락이나 안경테처럼 경계가 복잡한 영역을 분리하는 작업이었다. AI가 추정한 거리 정보만으로는 미세한 경계를 완벽히 구분하기 어려워 자칫 피사체가 인위적으로 오려 붙여진 것처럼 보일 위험이 있다. 이에 개발진은 AI 추정 거리 정보에 원본 영상의 경계 정보를 결합하는 알고리즘을 적용해 경계선을 자연스럽게 분리해 냈다. 스마트폰 하드웨어 한계를 극복하기 위한 최적화도 병행됐다. 영상에서 실시간 렌즈 효과를 연산할 때 발생하는 발열과 전력 소모를 제어하기 위해, 화질에 결정적인 영향을 미치는 영역에 연산 자원을 집중하고 사용자가 체감하기 어려운 부분은 연산을 간소화했다. 박 프로는 "날씨와 광원, 피사체의 움직임과 거리 등 촬영 조건이 달라져도 안정적인 결과를 유지하는 것이 중요했다"며 "다양한 환경에서 반복적으로 촬영해 결과물을 확인했고, 소프트웨어 최적화와 AI 학습 데이터 보완을 통해 어색한 부분을 개선했다"고 설명했다.

2026.09.16 11:21진운용 기자

스튜디오메타케이, 더블제로와 전략적 파트너십…'AI 영상 제작 플랫폼' 개발 협력

방송과 영화, 광고 등 실제 제작 현장에서 활용할 수 있는 생성형 인공지능(AI) 기반 영상 제작 플랫폼이 공동 개발된다. 스튜디오메타케이는 AI 프로덕션 기술기업 더블제로(Shoty.ai)와 생성형 AI 영상 제작 플랫폼 분야 기술협력 및 공동 사업화를 위한 업무협약(MOU)을 체결했다고 16일 밝혔다. 양사는 AI 영상 제작 플랫폼의 기획·개발·고도화, 생성형 AI 기술 및 API 연동, 클라우드 기반 개발환경 검토, SaaS·방송·광고·콘텐츠 분야의 공동 사업개발 전반에서 협력할 방침이다. 이번 협약은 스튜디오메타케이의 상용 콘텐츠 제작 경험과 더블제로의 AI 플랫폼 기술력을 결합하기 위해 추진됐다. 스튜디오메타케이는 넷플릭스, MBC, KBS, JTBC 등 주요 방송·OTT 프로젝트에 생성형 AI 및 후반 제작 기술을 적용하며 현장 데이터를 축적해 왔다. 아울러 엔비디아 인셉션, 구글 스타트업 프로그램, 스케일업 TIPS 등에 선정되며 기술 경쟁력을 확보해 왔다. 스튜디오메타케이는 넷플릭스 '들쥐'와 '월간남친', MBC '신인감독 김연경', KBS '역사스페셜', ENA '금쪽같은 내 스타', JTBC '집 나가면 개호강', MBN '돌싱글즈7' 등 다수의 주요 방송·OTT 프로젝트에 AI 영상 및 후반 제작 기술을 적용하며 현장 검증을 진행해 왔다. 아울러 엔비디아 '엔업' 및 '인셉션', 중기부 스케일업 TIPS, 구글 'Google for Startups Cloud' 등에 선정되며 기술 경쟁력을 인정받았다. 더블제로는 영상 제작 파이프라인 맞춤형 AI 플랫폼 'Shoty'와 캐스팅 플랫폼을 운영하는 기술기업이다. Shoty는 정식 출시 전 글로벌 58개국에서 약 2800명의 이용자를 확보했으며, 영상 AI 분야에서 12건의 특허를 출원한 바 있다. 양사는 이번 MOU를 시작으로 기술·사업 분야의 협력 가능성을 지속적으로 검토하고, AI 영상 제작 생태계 확대와 국내외 콘텐츠 제작 현장의 생산성 향상을 위한 공동 사업기회를 모색할 계획이다. 김광집 스튜디오메타케이 대표는 "이번 협력을 계기로 더블제로와 서로의 강점을 활용해 생성형 AI 기술의 상용화와 플랫폼 경쟁력을 함께 높여 나가겠다"고 전했다.

2026.09.16 10:30진성우 기자

"사진 한 장으로 5초 광고 뚝딱”…비스킷AI, 클립·포스트 도구 탑재

커머스 인공지능(AI) 전문 기업 버즈니가 AI 숏폼 콘텐츠 제작 서비스 '비스킷AI'에 짧은 영상 클립을 손쉽게 제작할 수 있는 '클립 만들기' 기능을 새롭게 추가했다. 16일 회사에 따르면, 이번에 추가된 클립 만들기는 특정 형식의 짧은 영상이 필요한 사용자를 위해 마련된 맞춤형 도구다. 비스킷AI의 기존 대표 기능인 '숏폼 제작하기'가 완성형 숏폼 영상을 자동으로 생성해 준다면, 클립 만들기는 목적별 템플릿을 선택해 원하는 소재를 직접 제작하는 방식이다. 리듬 컷편집·아바타 클립·아바타 챌린지·앱 시연 등 11가지 세부 도구가 제공된다. 사진 한 장으로 5초 분량의 광고 클립을 제작하거나, 입력 대사를 말하는 AI 아바타 및 사회관계망서비스(SNS) 챌린지 동작을 구현할 수 있으며, 스마트폰 터치 동작을 합성한 앱 마케팅 영상 제작도 가능하다. 이와 함께 주요 장면만 숏폼으로 제작하는 '긴 영상 나누기' 기능도 고도화했다. AI가 상황과 맥락을 파악해 불길이나 화면 흔들림 등의 시각 효과를 입히는 'AI 연출 효과'와 대사를 분석해 자막을 자동 생성하는 'AI 자동 캡션'을 탑재했다. 기존 숏폼을 넘어 5분 내외 길이의 가로·세로형 미들폼 영상 제작도 지원한다. 아울러 이미지 기반 콘텐츠 제작 도구인 '포스트 만들기'도 새로 도입해 제품 소개·정보 전달·이벤트 홍보·브랜드 소개·채용 등 목적에 부합하는 카드뉴스 자동 생성 기능을 제공한다. 남상협 버즈니 대표는 "비스킷AI는 출시 이후 다양한 브랜드와 소상공인의 마케팅 콘텐츠 제작 도구로 자리잡아가고 있으며, 최근에는 여러 기업들과의 협업 제휴 논의도 활발히 이어지고 있다"며 "이번 클립 만들기와 포스트 만들기 등 기능 고도화로 콘텐츠 제작 범위를 한층 넓힌 만큼, 앞으로도 비스킷AI를 통해 더 많은 기업의 마케팅 효율화를 지원하겠다"고 말했다.

2026.09.16 10:05백봉삼 기자

카메라 사이 끊긴 동선 잇는다…영상 AI, '탐지' 넘어 '공간 추적'으로

인공지능(AI)이 영상에서 사람이나 차량을 찾아내는 데서 나아가 이동 경로까지 파악하는 단계로 발전했다. 여러 카메라에 흩어진 동일 객체를 연결하고 영상 속 위치를 실제 공간 좌표로 바꿔 촬영 공백이 생겨도 어디서 어디로 움직였는지 추적할 수 있게 됐다. 13일 AI 업계에 따르면 공간 AI 기업 오썸피아는 여러 카메라 영상에 등장하는 동일 객체의 이동 이력을 연결하는 '그리드맵 AI' 고도화 방향을 공개했다. 지난 8월 선보인 '객체 주소화' 기술을 카메라 간 추적과 다중 카메라 융합으로 확대했다. 기존 영상 AI는 화면 안에서 사람이나 차량, 연기 등을 찾아내는 데 강점을 보여왔다. 문제는 대상이 화면 밖으로 사라진 뒤다. 다른 카메라에 같은 사람이 다시 나타나도 각각의 영상으로 남기 때문에 이동 경로를 이어 보려면 별도 분석이 필요했다. 오썸피아는 이 단절을 객체 ID와 공간 좌표로 잇는다. 그리드맵 AI가 영상 속 사람이나 차량을 발견하면 고유 ID를 부여하고 화면 속 위치를 실제 공간 좌표로 변환한다. 여기에 시간과 촬영 카메라 정보를 함께 저장해 객체가 언제 어디에 있었는지를 데이터로 남긴다. 영상 속 객체마다 일종의 '주소'를 붙이는 셈이다. 이 기술은 사람이 A카메라에서 사라진 뒤 B카메라에 나타나면 AI가 외형 특징과 좌표 정보를 비교한다. 같은 객체라고 판단하면 기존 ID를 이어 붙여 이동 이력을 계속 기록한다. 여러 카메라가 같은 대상을 동시에 촬영할 때는 각 영상의 정보를 합친다. 한쪽 화면에서 객체 일부가 가려지거나 위치를 정확하게 파악하기 어려우면 다른 각도의 영상으로 보완하는 방식이다. 이렇게 쌓인 정보는 단순히 영상 속 객체를 찾아내는 데 그치지 않는다. 사람이 어느 방향으로 이동했는지, 특정 공간에 얼마나 머물렀는지, 위험구역에 들어갔는지 등을 시간과 위치를 기준으로 분석할 수 있다. 오썸피아는 현재 개발 중인 '그리드맵 2.0'에 다중 카메라 객체 추적과 행동 분석, 이상행동 탐지 기능을 순차적으로 적용할 계획이다. 이후에는 영상에서 만든 좌표를 드론과 디지털 트윈에도 연결한다는 구상이다. 영상 AI가 이처럼 '탐지'에서 '추적'으로 영역을 넓히는 데는 관제 환경의 변화가 자리한다. 행정안전부에 따르면 2024년 기준 지방자치단체 통합관제센터와 연계된 CCTV는 65만여대로, 관제요원 한 명이 평균 477대를 담당했다. 행안부는 이 가운데 AI 기술이 적용된 비율을 37.5%로 보고 있다. 카메라가 많아질수록 사람이 여러 영상을 번갈아 보면서 같은 사람이나 차량의 이동을 일일이 찾아내기 어렵다. AI가 한 화면에서 이상 상황을 발견하는 것뿐 아니라 서로 다른 영상의 정보를 연결해야 하는 이유다. 영상 AI 업계도 비슷한 방향으로 움직이고 있다. 한화비전은 여러 카메라 영상에서 동일하거나 유사한 인물을 찾아 이동 경로를 좁히는 '유사도 검색' 기술을 선보였고, 엔비디아는 여러 카메라에 잡힌 객체를 하나의 ID와 3차원 공간 좌표로 연결하는 다중 카메라 추적 기술을 공개했다. 오썸피아는 여기에 현장 대응까지 연결한다는 계획이다. 영상 AI가 산불이나 침입자 같은 위험 요소를 발견하면 실제 좌표를 생성하고 해당 위치로 드론을 보내 현장을 확인하는 방식이다. 드론 자동 유도와 디지털 트윈 연계 기능은 단계적으로 개발·검증할 예정이다. 적용 분야도 넓다. 관광시설에서는 방문객 동선과 체류시간을 분석하고 재난 현장에서는 위험 객체의 위치와 이동 경로를 확인할 수 있다. 국방과 공항·항만, 스마트시티에서는 여러 카메라와 센서가 수집한 정보를 하나의 공간 데이터로 연결하는 데 활용할 수 있다는 게 회사 측의 설명이다. 오썸피아는 장기적으로 영상에서 생성한 객체 ID와 좌표를 드론·로봇·디지털 트윈 등 다른 시스템이 함께 활용하는 공간 AI 플랫폼으로 확장한다는 목표다. 민문호 오썸피아 대표는 기자와 통화에서 "GPS가 현실 세계의 위치를 좌표화했다면 그리드맵 AI는 영상 속 객체의 위치와 이동 이력을 좌표화하는 기술"이라며 "서로 단절돼 있던 카메라 영상을 하나의 공간 데이터로 연결하고 탐지 이후의 판단과 현장 대응까지 이어지는 구조를 만들고 있다"고 말했다.

2026.09.13 14:30김동원 기자

AI가 찍은 스포츠 명장면, 진짜일까?…UNIST가 답 찾다

스포츠 경기 영상에서 하이라이트를 찾는 AI 모델의 성능을 평가할 때 사용하는 보다 정교한 벤치마크가 개발됐다. UNIST는 김태환 인공지능대학원 교수 연구팀이 대규모 벤치마크인 'SV하이라이트(SVHighlights)를 만들었다고 13일 밝혔다. 축구, 야구, 농구, 배구, 미식축구, 아이스하키, 럭비, 레이싱 등 8개 종목 영상을 각각 40편씩 320편으로 구성했다. 누적 640.18시간에 해당한다. 영상 한 편의 평균 길이는 2시간. 기존 데이터셋보다 30~60배나 길다. 김태환 교수는 "실제 스포츠 중계 길이와 비슷한 수준"이라고 말했다. 기존 벤치마크에 담긴 영상은 평균 2~4분 내외다. 이유는 시간과 비용 때문이다. 연구팀은 이미 편집돼 인터넷 등에 공개된 스포츠 공식 하이라이트 영상을 활용했다. 다만, 하이라이트 영상이 원본 어느 시점에 나오는지에 대한 타임 스탬프 정보가 없다는 문제는 이를 자동으로 찾아내는 매칭 알고리즘을 만들어 해결했다. 이 알고리즘은 원본 영상과 하이라이트 영상 프레임을 픽셀 단위(PSNR)로 비교해 가장 유사한 장면을 파악할 수 있다. 연구팀은 알고리즘을 설계할 때 화면 유사성뿐만 아니라 앞에서 찾은 장면과의 시간 순서까지 함께 따지도록 했다. 중계 영상에는 보통 득점 장면 등을 여러 번 리플레이하는 경우가 많아, 실제 경기 발생 시점 대신 시각적으로 동일한 리플레이 장면을 하이라이트로 잘못 매칭하는 오류를 방지하기 위해서다. 일반인 10명이 참여한 평가에서도 하이라이트 구간은 5점 만점에 평균 3.42점을 받았다. 비하이라이트 구간의 평균 점수인 1.94점과 1.97점보다 뚜렷하게 높아, 자동으로 만든 정답이 사람의 판단과도 대체로 일치함을 확인했다. 연구팀은 기존의 장면 분할 모델과 음성인식모델, 비전언어모델, 대규모 언어모델을 조합해 긴 영상에서도 하이라이트를 효과적으로 추출할 수 있는 'TF-셀렉터'라는 AI 모델도 함께 개발했다. 'TF-셀렉터'는 고른 장면이 실제 하이라이트인지를 평가하는 HIT@1은 2.50%포인트, 실제 하이라이트 수만큼 후보를 골랐을 때 얼마나 많이 찾아냈는지를 평가하는 HIT@K는 4.04%포인트 높았다. 예측 구간과 정답 구간 겹침을 나타내는 IoU(교집합 대비 합집합 비율)도 2.95점 높았다. 연구는 이동규 UNIST 석·박사통합과정생, 기영빈 석사가 제1저자로 참여 했다. 연구 결과는 지난달 9일 제주에서 열린 데이터마이닝분야 국제학회인 'ACM KDD'에 채택됐다. 김태환 교수는 “데이터를 계속 늘려갈 수 있어 장시간 영상 분석 모델을 객관적으로 평가하고 성능이 더 나은 모델을 개발하는 데 도움이 될 것”이라고 말했다. 김 교수는 또 "스포츠 하이라이트 자동 제작뿐 아니라 영화·드라마 요약, 회의 기록 정리, 장시간 관제 영상의 주요 장면 검색 등으로 확장 가능하다"고 덧붙였다.

2026.09.13 09:00박희범 기자

"후반전 페널티킥 찾아줘"…트웰브랩스, 아마존 베드록에 영상 검색 탑재

트웰브랩스가 아마존 베드록 관리형 지식 베이스에 영상 이해 인공지능(AI) 모델을 올리며 기업의 영상 데이터를 자연어로 검색할 수 있는 환경을 마련했다. 트웰브랩스는 영상 임베딩·검색 모델 '마렝고'를 아마존 베드록 관리형 지식 베이스에 등재했다고 11일 밝혔다. 영상 모델이 이곳에 탑재된 것은 마렝고가 처음이다. 관리형 지식 베이스는 기업 데이터를 AI가 활용할 수 있도록 수집부터 색인, 검색까지 대신 처리하는 서비스다. 고객은 아마존 심플 스토리지 서비스(S3) 같은 저장소를 연결하면 별도의 벡터 데이터베이스나 검색 파이프라인을 구축하지 않고 영상 검색을 시작할 수 있다. 마렝고는 영상 속 화면과 문자, 음성·소리를 함께 분석해 원하는 장면을 찾아준다. 예를 들어 '후반전 페널티킥 장면 보여줘'라고 입력하면 수천 시간 분량 영상에서도 해당 구간만 제시된다. 검색 시 날짜와 카테고리, 태그 조건을 함께 적용할 수도 있다. 모든 데이터는 고객의 아마존웹서비스(AWS) 계정 안에서 처리된다. 금융·의료·공공 등 데이터 규제가 까다로운 분야에서도 활용할 수 있다. 백라이트의 미디어 자산 관리 플랫폼 '아이코닉'은 마렝고를 도입해 트웰브랩스 AI 기반 의미 검색을 플랫폼 기본 기능으로 제공하고 있다. 트웰브랩스는 11일부터 14일(현지시간)까지 네덜란드 암스테르담에서 열리는 IBC 2026에서 마렝고와 아이코닉 연동 사례를 소개할 예정이다. 대니 니콜로풀로스 트웰브랩스 전략적 파트너십 총괄은 "AWS와 협력해 영상 검색 도입을 가로막던 가장 큰 걸림돌을 없앴다"며 "아마존 S3에 영상만 있으면 코드를 짜거나 벡터 검색 인프라를 세우지 않고도 마렝고 멀티모달 검색을 바로 쓸 수 있다"고 말했다.

2026.09.11 14:27이나연 기자

SKT, 달리는 차량으로 통신망 점검…AI가 이상징후 찾는다

SK텔레콤이 차량 장착 AI 카메라로 전국 통신 인프라를 자동 점검하는 '톺다' 솔루션을 상용화했다. 디지털트윈 기술 '비스타'와 함께 인력 중심 점검의 한계를 보완해 네트워크 운용의 안전성과 효율성을 높인다는 구상이다. SK텔레콤은 차량 주행 영상을 AI로 분석해 전국 통신 인프라 안전 점검을 자동화하는 톺다 솔루션을 상용화했다고 1일 밝혔다. 톺다는 지구 5바퀴 길이에 달하는 광케이블과 235만개의 전주 등 사람이 일일이 확인하기 어려운 통신 설비를 효율적으로 점검하기 위해 개발된 시스템이다. AI 카메라 달고 달리며 점검…탐지 정확도 88% 업무용 차량에 AI 카메라를 장착해 민원 처리나 고장 조치 등을 위해 이동하는 동안 통신 설비를 자동으로 점검하는 방식이다. 별도 점검 차량이나 인력을 투입하지 않고도 공사장과 중장비, 선로 시설물 불량 등 11개 유형의 점검 요소를 탐지한다. SK텔레콤은 지난 5년간 축적한 현장 사진을 AI로 학습시켜 2024년 65%였던 탐지 정확도를 올해 88%까지 끌어올렸다. 2027년에는 정확도를 95% 수준까지 높일 계획이다. 수도권 시범 운영에서는 기존 업무 차량의 이동 동선만 활용해 주요 유선 구간의 절반을 점검했다. 향후 투입 차량을 늘려 점검 구간을 2027년 70%, 2028년 90% 이상으로 확대할 예정이다. 위험도가 높은 터널 내 유선설비 점검에도 톺다를 활용한다. 올해 말 저조도 카메라를 탑재한 차량을 투입해 사람이 직접 수행하는 점검 업무를 줄일 방침이다. 촬영 과정에서 발생할 수 있는 개인정보 유출에도 대비했다. 차량에 탑재된 AI 모델이 얼굴과 차량 번호판을 즉시 모자이크 처리한 뒤 영상을 전송하는 방식으로, 원본 영상은 서버에 저장되지 않는다. 톺다에는 비전·맥락·공간 AI 기술이 활용된다. 비전 AI가 설비와 공사 장비를 인식하고, 맥락 AI는 단순 이동 중인 장비와 실제 공사 현장을 구분해 조치가 필요한 곳을 선별한다. 공간 AI는 2D 영상에 고정밀 위성 측위 정보를 결합해 점검 지점의 위치를 오차 1~2m 수준으로 추정하고 지도에 구현한다. 드론 띄워 철탑까지 점검…작업시간 60% 단축 SK텔레콤은 디지털트윈 기술 '비스타(VISTA)'를 활용한 드론 기반 통신 인프라 점검도 진행하고 있다. 현실 공간의 통신 설비를 가상 공간에 구현해 설비 상태를 확인하는 방식이다. 비스타 드론은 촬영한 영상을 바탕으로 철탑을 3차원 모델로 재구성하고 AI를 활용해 안테나의 위치와 각도, 크기는 물론 볼트와 너트까지 자동으로 인식한다. 기존에는 2인 1조가 철탑 최상단까지 직접 올라 설비를 확인해야 했지만 비스타 드론을 활용하면 점검 시간을 60%, 판독 시간을 85% 줄일 수 있다. SK텔레콤은 향후 카메라 품질과 AI 학습 파이프라인을 고도화해 현장 맞춤형 AI 모델을 발전시킬 계획이다. 가스와 전력, 송유관 등 설비 점검이 필요한 다른 산업으로 기술과 데이터 활용 범위를 확대하는 방안도 검토한다. 복재원 SK텔레콤 네트워크 운용담당은 “앞으로도 AI와 현장 데이터를 바탕으로 네트워크 운용 안전성과 효율을 높이고, 자율 네트워크 전환에 속도를 내겠다”고 말했다.

2026.09.01 17:56홍지후 기자

자격 취득부터 영상 제작까지...프롬, 9월 5개 AI 실무 코스 개강

AI 역량 평가 방식이 공인 자격과 실물 결과물 중심으로 재편되는 흐름에 맞춰, AI 스토리텔링 랩 '프롬'이 체계적인 실무 역량 강화 교육을 선보인다. 프롬은 9월 5일부터 13일까지 총 16시간 동안 진행되는 5개 대면 교육 코스를 운영한다고 밝혔다. 이번 교육은 앤트로픽의 공식 자격시험 대비와 현장 중심의 영상 제작 실습을 핵심으로 구성됐다. 앤트로픽이 지난 3월 12일 선보인 'CCA-F'는 프로덕션 수준의 클로드 애플리케이션 구축 능력을 검증하는 시험이다. 120분간 온라인 감독하에 60문항을 치르며, 1000점 중 720점 이상을 획득해야 합격한다. 평가 항목은 에이전트 아키텍처 및 오케스트레이션(27%), 클로드 코드 설정·워크플로우(20%), 프롬프트 엔지니어링·구조화 출력(20%), 툴 설계·MCP 통합(18%), 컨텍스트 관리·신뢰성(15%)으로 나뉜다. 해당 시험은 파트너 네트워크 가입 기관의 도메인 이메일이 있어야 응시할 수 있다. 이에 정식 가입 소속인 프롬은 소속 조직의 파트너 등록 절차와 응시 안내는 물론 시험 범위와 학습 순서를 함께 지원할 계획이다. 결과물 중심의 실습 강좌에서는 실제 방송에 적용된 풀 AI 제작 기법을 다룬다. 지난 7월 방영된 SBS 드라마 '김부장'(4회 시청률 21.6%, 넷플릭스 비영어 TV 1위)의 1·2회에 등장한 3분 분량의 시퀀스는 모피어스 스튜디오가 국산 AI 플랫폼 '에이크론'의 노드 기반 워크플로우만을 활용해 완성했다. 에이크론은 150개 이상의 상용 AI 모델을 단일 캔버스에서 조합하는 시스템이다. 프롬의 '에이크론 마스터 코스'에서는 해당 3분 시퀀스의 제작 과정을 확인하고 수강생이 동일한 엔진으로 3분 영상 작품을 제작하는 3시간 실습이 포함된다. 프롬의 김우정 디렉터는 AI 활용 능력이 공식 자격과 실물 결과라는 두 축으로 증명되는 시점에 도달했다며, 증폭과 증명이 핵심이 될 AI 시대의 두 번째 전환기에 발맞춰 이번 프로그램을 준비했다고 밝혔다.

2026.08.26 13:40백봉삼 기자

AI콘텐츠 기업 스튜디오메타케이, IPO 추진...대표주관사로 유진투자증권 선정

AI 기반 콘텐츠 IP 솔루션 기업 스튜디오메타케이(대표 김광집)는 기업공개(IPO)를 앞두고 대표주관사로 유진투자증권을 선정했다고 25일 밝혔다. 스튜디오메타케이는 이번 대표주관사 선정을 계기로 기업가치 제고와 사업 경쟁력 강화에 집중할 계획이다. 또 IPO를 위한 실무 절차를 단계적으로 추진할 계획이다. 구체적인 상장 일정과 공모 규모 등은 향후 관련 절차를 거쳐 확정한다. 2022년 설립된 스튜디오메타케이는 생성형 AI와 버추얼 휴먼 기술을 기반으로 콘텐츠 및 지식재산권(IP)을 창출하는 엔터테크 기업이다. AI 기술 기반의 콘텐츠 제작 역량과 콘텐츠 IP를 결합해 드라마, 영화, 애니메이션, 버추얼 아티스트, 미디어아트, 공연 콘텐츠 등으로 사업 영역을 확대하고 있다. 또한 방송·영상 콘텐츠에 AI 기술을 접목하며 사업 영역을 확장하고 있다. 넷플릭스 '월간남친', ENA '금쪽같은 내스타', MBC '신인감독 김연경', SBS플러스 '상남자의 여행법', KBS '역사스페셜', MBN '돌싱글즈7', 인스파이어 리조트의 미디어아트 등 다양한 콘텐츠에 AI 기술을 적용해 온 경험을 바탕으로 AI와 엔터테인먼트를 결합한 '엔터테크' 기업으로의 성장에 본격 나섰다. 스튜디오메타케이는 AI 기반 콘텐츠 제작 기술 고도화와 IP 사업 확장에 속도를 내고 있다. 지난 7월에는 문화체육관광부와 한국콘텐츠진흥원이 추진하는 '2026년 문화체육관광 연구개발사업'에서 2개 과제의 주관기관으로 선정됐다. 두 과제의 3년간 총사업비는 153억원 규모로, AI 기반 방송영상 제작 통합 엔진 및 실증 플랫폼과 롱폼(Long-Form) 비디오 생성·편집 솔루션 개발 등을 추진한다. 특히 이번 주관기관 선정은 스튜디오메타케이의 AI 콘텐츠 제작 기술력과 연구개발 역량이 국책 연구개발사업을 통해 공식적으로 인정받았다는 점에서 의미가 크다. 이를 바탕으로 AI를 활용한 콘텐츠 제작의 효율성과 완성도를 높이고, 방송·영상 산업 전반에 적용할 수 있는 기술 경쟁력을 확보한다는 전략이다. 스튜디오메타케이는 유명 웹툰 IP를 활용한 극장용 애니메이션 제작 사업에도 적극적으로 나서고 있다. 대표적인 IP인 영화 '서편제'를 비롯해 다수의 검증된 웹툰 및 콘텐츠 IP를 기반으로 극장용 애니메이션을 개발·제작하며, 원천 IP를 영상 콘텐츠로 확장하는 사업 역량을 강화하고 있다. 자체 AI 기술을 콘텐츠 제작 과정에 접목해 제작 효율성을 높이는 동시에, 웹툰·애니메이션·영화 등으로 IP의 확장성을 극대화한다는 전략이다. 이 회사는 향후 AI 콘텐츠 제작 기술과 자체 IP 경쟁력을 더욱 강화하고, 웹툰 등 검증된 원천 IP를 극장용 애니메이션과 영상 콘텐츠로 확장하는 사업을 적극 추진할 계획이다. 국내외 콘텐츠 사업자와의 협력을 확대해 AI를 기반으로 콘텐츠의 기획·제작·유통 전반을 혁신하고, 국내를 넘어 글로벌 시장에서 경쟁력을 갖춘 AI 콘텐츠 IP 기업으로 성장한다는 것이 목표다. 김광집 스튜디오메타케이 대표는 “IPO는 스튜디오메타케이가 AI와 콘텐츠를 결합한 새로운 산업의 대표 기업으로 도약하기 위한 중요한 전환점”이라며 “유진투자증권과 긴밀히 협력해 기업의 기술력과 성장성을 시장에서 제대로 평가받을 수 있도록 상장 준비에 최선을 다하겠다”고 전했다.

2026.08.25 09:55이도원 기자

숨랩스, 프리시드 투자 유치..."기업가치 200억원대"

숨랩스(대표 임도현)가 기업가치 200억원 이상을 인정받으며 프리시드 투자 유치를 완료했다고 25일 발표했다. 회사는 이번 투자 유치를 계기로 해외 기업들의 수준에 견주는 AI 서비스를 만들어 가겠다는 포부를 밝혔다. 숨랩스의 이번 프리시드 투자 라운드는 미국 실리콘밸리 기반의 벤처투자사파운더스인크와 국내에서는 카카오벤처스·퓨처플레이·베이스벤처스 등이 참여했다. 파운더스인크는 실리콘밸리 현지에서 초기 스타트업을 발굴·육성하는 액셀러레이터다. 숨랩스는 대량 마케팅 영상 제작에 특화된 자율형 AI 영상 에이전트 숨 에이전트를 지난 7월 출시했다. 출시 직후 빠르게 이용자 및 매출이 늘어났으며, API 공급 계약을 마쳐 억대 연 매출을 달성했다. 숨랩스가 지난 5월 출시한 숨광고의 경우에도 이용자 수가 출시 2주 만에 1만 명을 돌파하는 등 빠른 시장 반응을 이끌어낸 바 있으며, 숨 에이전트와하나의 웹사이트에서 서비스 된다. 숨 에이전트는 클라우드에서 구동되는 AI 영상 에이전트다. 이용자가 프롬프트·이미지·영상·제품 정보 등 자유 형식의자료를 한 번 전달하면, 숨랩스의 고도화된 하네스가 이를 구조화된 스킬 포맷으로 재현한다. 이어 과업에 맞는 AI 모델들을 스스로 선택·조합해 실행부터 최종 편집까지 완성한 영상을 결과물로 제공한다. 개발자뿐 아니라 누구나 활용할 수있다는 점이 특징이다. 브랜드와 마케터들은 특정 포맷의 영상을 빠르게 대량 제작하고 싶지만, 현재는 영상 생성·이미지·음성·아바타 등 여러모델을 직접 오가며 장면마다 수정과 재생성을 반복해야 한다. 포맷의 구성과 톤, 편집 규칙을 일관되게 유지하기 어려워대량 생산은 사실상 불가능하다. 숨랩스는 사용자가 원하는 영상 포맷을 스킬로 정의해 재사용할 수 있게 한다. 이후에는 제품 정보나 소재만 전달하면 에이전트가 해당 스킬에 맞춰 필요한 모델과 작업 순서를 판단하고, 생성·수정·편집까지수행해 같은 포맷의 게시 가능한 영상을 대량으로 제작한다. 숨랩스와 협업 중인 기업들은 수천 편 규모의 AI 영상을 자동으로 만들어내기 위해 숨 에이전트를 사용한다. 주 사용자는브랜드와 마케팅 에이전시로, 일정한 품질을 유지하면서 끊이지 않고 쏟아지는 대량의 영상을 제작하고 있다. 숏폼마케팅에서 무게중심이 대량 생산과 빠른 배포로 옮겨간 만큼, 숨랩스는 이 구간을 하나의 에이전트로 대체하는 것을 목표로 하고 있다. 임도현 숨랩스 대표는 "AI를 활용해도 대량의 영상을 만들기 위해서는 여전히 많은 비용과 품이 들어가는 것이 현재 상황"이라며 "숨 에이전트는 올해 수억대의 매출을 내는 서비스로 성장할 것이다. 지속적으로 영상 제작의 효율화 및 고도화를 통해 해외 기업들의 수준에 견주는 AI 서비스를 만들어 나갈 것"이라고 자신했다.

2026.08.25 09:20백봉삼 기자

"AI가 1차 차단, 맥락은 사람이 판단"…틱톡 TAC 가보니

[싱가포르=류승현 기자] 틱톡이 인공지능(AI) 기반 자동 심사와 현지 전문 인력을 결합해 유해 콘텐츠 확산을 차단하고 있다. 올해 1분기 국내에서 삭제한 영상 25만4399개 가운데 약 87%를 자동화 기술로 처리했고, 57.4%는 조회가 발생하기 전에 걸러냈다. 회사는 AI 탐지 범위를 넓히는 동시에 언어·문화적 맥락이 필요한 콘텐츠에 대한 인적 심사를 강화한다는 방침이다. 지난 11일 방문한 싱가포르 틱톡 아시아태평양 본사의 투명성·책임 센터(TAC)는 콘텐츠 심사와 추천 시스템의 작동 과정을 외부에 공개하는 공간이다. 현재 미국 워싱턴과 아일랜드 더블린, 싱가포르 등 세 곳에서 운영되며 아시아에서는 싱가포르가 유일하다. 모더레이션룸에서는 같은 물체도 사용되는 상황에 따라 판단이 달라지는 과정을 확인할 수 있었다. 음식을 자르는 조리용 칼에는 위험 표시가 붙지 않았지만, 사람을 위협하는 데 사용된 칼에는 경고가 떴다. 틱톡 관계자는 “위험한 물체가 등장했다는 이유만으로 콘텐츠를 제재하지는 않는다”며 “해당 물체가 어떤 행동에 사용되는지까지 함께 판단한다”고 밝혔다. 영상·음성·해시태그까지 분석…애매하면 사람에게 틱톡에 영상이 게시되면 머신러닝을 기반으로 한 1차 검수가 시작된다. 시스템은 영상과 음성, 화면 속 문구, 해시태그, 댓글, 외부 링크 등을 분석해 커뮤니티 가이드라인 위반 가능성을 분류한다. 위반 여부가 명확한 콘텐츠는 자동화 단계에서 삭제된다. 판단이 모호하거나 표현이 사용된 맥락을 살펴야 하는 콘텐츠는 전 세계 수천 명의 신뢰·안전 전문가에게 전달된다. 틱톡 관계자는 “모든 콘텐츠는 머신러닝 영역에서 1차 검수를 거친다”며 “문맥에 대한 이해와 사회·문화적 고려가 필요한 콘텐츠는 인적 심사로 넘어가고, 외부 전문가의 자문을 통해 심사 체계를 보완한다”고 설명했다. 기술만으로 모든 상황을 정확히 구분하기는 어렵다. 화면에 등장한 병이 술인지 콤부차인지, 흡연 장면 속 물체가 담배인지 대마인지에 따라 판단이 달라질 수 있다. 극단주의 단체의 상징과 일반적인 종교 문양처럼 형태가 비슷한 사례도 사람의 검토가 필요하다. 괴롭힘과 혐오 표현도 국가와 세대에 따라 의미가 달라질 수 있다. 틱톡은 전 세계에 동일한 커뮤니티 가이드라인을 적용하되 실제 심사에는 지역별 언어와 문화를 반영한다. 한국어 콘텐츠는 국내 언어와 문화에 대한 이해를 갖춘 인력이 검토한다. 올해 1분기 틱톡이 전 세계에서 삭제한 영상은 1억8401만개로 전체 게시물의 약 0.5%였다. 이 가운데 96.7%인 1억7801만개가 인적 심사 이전의 자동화 단계에서 탐지·삭제됐다. 이용자가 신고하기 전 삭제한 비율은 99.3%, 24시간 이내 삭제율은 94.4%로 집계됐다. 한국에서는 삭제 영상의 84.4%가 조회수 100회 이하일 때 내려갔다. 이용자 신고로 조치된 콘텐츠의 94.8%는 신고 후 2시간 안에 처리됐다. AI의 판단에 오류가 있다고 생각하면 앱에서 이의를 제기할 수 있다. 올해 1분기 재검토를 거쳐 복원된 영상은 전 세계 883만8710개, 한국 2만6847개였다. 이용자는 '계정 확인' 기능을 통해 최근 게시물 30개의 삭제·추천 제한 여부도 확인할 수 있다. 다만 자동 심사 시스템의 오탐률과 미탐지율은 공개하지 않고 있다. 틱톡 관계자는 “오탐률과 미탐지율은 별도로 집계·분석하는 지표가 아니어서 수치로 답변하기 어렵다”며 “복원 건수와 선제적 삭제율 등을 통해 집행 결과를 공개하고 있다”고 말했다. 추천도 안전심사부터…청소년 계정엔 50개 보호장치 콘텐츠 심사를 통과했다고 곧바로 이용자의 추천피드에 나타나는 것은 아니다. 추천 과정은 모더레이션과 큐레이션 등 두 단계로 나뉜다. 먼저 커뮤니티 가이드라인을 위반한 영상을 제외해 추천 가능 영상 풀을 만든다. 이후 시청 시간과 좋아요·댓글, 팔로우 여부, 영상의 문구·해시태그·음원, 이용자의 언어와 대략적인 위치 등을 바탕으로 영상과 이용자의 적합도를 계산한다. 추천피드는 정기적으로 갱신되는 8개 영상 묶음으로 구성된다. 기존 이용자에게는 과거 반응을 반영한 콘텐츠를 제공하고, 이용 기록이 없는 신규 가입자에게는 인기가 높으면서 안전성이 검증된 영상을 우선 노출한다. 틱톡 관계자는 “추천 알고리즘이 이용자의 취향을 정확히 알고 있는 것처럼 보이지만 사실은 수학”이라며 “시청 시간과 좋아요, 공유, 댓글 등 이용자의 반응을 수치로 바꿔 콘텐츠와 이용자의 적합도를 계산한다”고 강조했다. 필터버블을 막기 위한 장치도 적용된다. 시스템은 영상 간 유사도를 계산해 특정 주제나 크리에이터의 콘텐츠가 반복되면 다른 영상을 섞는다. 이용자는 '관심 없음'이나 키워드 필터를 통해 특정 유형의 영상 노출을 줄이고 추천 기록을 초기화할 수 있다. 청소년 계정에는 연령에 따라 50개 이상의 안전·개인정보 보호 설정이 자동으로 적용된다. 한국에서는 만 14세부터 가입할 수 있으며 14~15세 계정은 기본적으로 비공개로 설정된다. 다이렉트 메시지와 영상 다운로드를 이용할 수 없고, 본인이 제작한 콘텐츠도 추천피드에 노출되지 않는다. 만 18세 미만 이용자는 라이브 방송을 할 수 없으며 하루 60분의 스크린타임이 기본 적용된다. 오후 9시 또는 10시 이후에는 연령대별로 푸시 알림도 중단된다. 생성형 AI 콘텐츠에는 별도의 라벨을 붙인다. 틱톡은 콘텐츠 인증 기술과 보이지 않는 워터마크 등을 활용해 현재까지 30억개 이상의 영상에 AI 생성 표시를 적용했다. 올해 1분기 한국에서 삭제된 AI 생성 콘텐츠의 97.3%는 조회가 발생하기 전에 차단됐다. 회사 관계자는 “TAC는 외부 이해관계자가 안전 시스템이 작동하는 과정을 직접 들여다볼 수 있도록 설계한 공간”이라며 “정책과 기능을 공개하고 외부 피드백을 실제 개선 과정에 반영하는 것이 목적”이라고 밝혔다.

2026.08.24 06:00류승현 기자

누군가 내 글에 "AI 돌렸나봐요"라고 묻는다면

수개월전, AI 이미지 제작 교육을 들으러 간 적이 있다. 최신 프롬프트나 새 툴 모델을 소개하는 자리가 아니었다. 'AI가 만든 티를 덜 내는 법'이었다. 얼굴은 완벽한 좌우 대칭이면 안 됐다. 피부도 매끈하면 곤란하다. 모공을 살리고, 잔주름을 그려주고, 머리카락 몇 올은 일부러 흐트러뜨려야 했다. 지금도 유명 이미지 프롬프트 상당수에 'AI 느낌 제거', '사람이 촬영한 것처럼', '과도한 보정 금지' 같은 문장이 들어가는 이유다. 완벽을 만드는 건 AI인데, 그 완벽을 다시 깨뜨리는 건 사람 몫이라니. 여기엔 '불쾌한 골짜기'와 비슷한 심리가 숨어 있다. 완벽에 가까울수록 편안해지다가, 어느 지점을 넘어서면 거부감을 느낀다. AI 티가 나는 이미지 앞에서 느끼는 불편함도 그 골짜기에서 나온다. 그런데 이 불편함의 정체를 제대로 들여다본 적은 별로 없다. 이미지는 그렇다 쳐도, 같은 논리를 글에까지 그대로 적용하는 게 맞는 걸까. 상투적인 표현을 다듬는 거야 필요한 일이지만, 어느 순간부터 내용을 좋게 만드는 일보다 흔적을 지우는 일이 목적이 돼버린 것 같다. 단톡방에서 찔린 한마디 얼마 전 업무로 얽힌 한 단체방에서 어느 글로벌 기업의 경영 인사이트를 다룬 한 시간 반짜리 영상이 화제였다. 지금 몸담고 있는 업계에도 적용할 만한 지점이 눈에 들어왔다. 곧바로 휴대폰 음성 입력을 켜고 떠오르는 생각을 오랫동안 말로 남겼다. '이 부분은 우리 업계에도 적용할 수 있겠다.', '이 사례는 진행 중인 프로젝트와 연결된다.' AI는 그 음성을 문장으로 조리 있게 정리했다. 영상을 멈추고 다시 보고, 내 기억과 경험을 붙이고, 업계 관점에서 판단을 내린 건 전부 내 몫이었다. 우리 업계와 맞닿는 장면도 하나씩 캡처해 인사이트와 함께 붙였다. 한 시간 반짜리 영상에서 우리 업계가 가져가야 할 것을 한눈에 확인할 수 있도록, 결국 여덟 장의 이미지로 추려냈다. 그렇게 도출한 인사이트를 글과 이미지로 정리해 단체방에 올렸다. "AI 돌리셨나 봐요?" 가장 먼저 달린 댓글은 뜻밖이었다. 공들인 건 AI 사용 여부가 아니었다. 한 시간 반짜리 영상을 끝까지 보고, 우리 업계에 필요한 인사이트를 골라내고, 우리 일에 맞게 연결한 과정이었다. AI는 그걸 정리해준 도구다. 정작 사람들 눈에 들어온 건 하나, AI를 썼는지 여부였다. 가슴에 손을 얹고 생각해보자. 지금 쓰는 보고서, 기획서, 기사에 AI 도움이 정말 한 줄도 없었나. 맞춤법 검사기는, 자동 번역기는, 음성 받아쓰기는, 검색 AI는 어떤가. 결국 정도의 차이만 있을 뿐, 우리는 이미 AI 없이 일하지 않는다. 더 뾰족하게 물어보자. AI 활용 비중이 20%면 양심적인 콘텐츠고, 80%면 성의 없는 글인가. 더이상 비중이 문제가 아니다. 그 안에 내 경험과 판단이 살아 있으면 가치 있는 글이고, 없으면 비율과 무관하게 빈 글이다. 사람들이 세고 있는 건 AI의 지분율이지만, 실제로 갈리는 건 사람의 지분율이다. 하나의 토론회가 열 개의 콘텐츠로 얼마 전 대통령 부동산정책 국민대토론회를 보며 같은 생각을 했다. 불과 몇 시간 만에 하나의 토론회가 전혀 다른 얼굴로 쏟아졌다. 기사가 나오고, 카카오톡으로 공유용 요약본이 돌았다. 발표 내용을 한 장에 정리한 인포그래픽이 만들어지고, 이를 내러티브화한 웹툰 스타일이 등장했다. 방송 화면을 시간순으로 캡처한 큐레이션 이미지가 퍼지고, 숏폼과 SNS 스레드가 동시에 쏟아졌다. 같은 원본에서 나왔지만 각기 다른 콘텐츠였다. 긴 기사를 읽는 사람도, 카드뉴스만 보는 사람도, 인포그래픽 한 장으로 핵심만 확인하는 사람도 있었다. 하나의 원천 콘텐츠를 다양한 형태로, 얼마나 빠르게 변환하고 유통하느냐가 경쟁력이다. 홍보인의 역할도 '작성자'에서 '생산자', '큐레이터', '번역가', '유통자'로 넓어졌다. 그런데도 여전히 'AI로 만들었나요'라는 질문에 매몰돼 있다. 생산자의 노력을 깎아내리려는 건지, 정말 몰라서 확인이 필요한 건지는 알 수 없다. 다만 그 질문이 겨누는 지점이 빗나가고 있다는 것만은 분명하다. AI는 우리 생각을 증폭시킨다. '만들어 봐야지' 하고 결심하지 않고, 최종 콘텐츠를 판단하지 않는다. 안목을 만들지도 않는다. 이미 있는 안목에 스피커를 대줄 뿐이다. 무엇을 남기고 버릴지, 무얼 정보로 삼을지, 숏폼으로 자르고 무엇을 인포그래픽으로 옮길지 결정하는 눈. 도구는 평준화된다. 오늘의 최신 AI는 내일이면 '모두의 기본값'이다. 그 눈은 쉽게 복제되지 않는다. 경험과 관찰, 시행착오가 쌓여야 만들어지는 판단이기 때문이다. 남는 건 무엇으로 썼는가가 아니라, 무엇을 담아냈는가다.

2026.08.15 12:00문지형 컬럼니스트

자폐 개선 여부 객관화 가능한 AI 프레임워크 개발

KIST와 서울대, 호주 등의 국제공동연구팀이 자폐스펙트럼 장애 증상 치료 및 개선 여부를 객관적으로 판단할 수 있는 AI 프레임워크를 개발했다. 연구는 한경림 KIST 뇌과학연구소 책임연구원과 김붕년 서울대학교병원 소아청소년정신과 교수, 한소연 호주 멜버른대학교 교수 연구팀이 공동 진행했다. 한경림 책임연구원은 "현재도 자폐 문제 자체를 객관적으로 진단하는 기준이 없다. 이때문에 상당수 환자가 자폐 검사를 위해 병원을 전전하는 경우가 많다"며 "기능적 자기공명영상(fMRI)과 인공지능(AI)을 활용해 자폐가 얼마나 개선됐는지를 임상지표를 통해 알수 있게 됐다"고 설명했다. 연구성과는 지난 9일부터 오는 13칠까지 제주국제컨벤션센터에서 열리는 인공지능·데이터마이닝·데이터사이언스 분야 국제학회인 'ACM SIGKDD 2026'에서 발표된다. 자폐스펙트럼장애는 제한된 관심과 반복행동, 사회적 상호작용의 어려움을 특징으로 하는 신경발달장애다. 미국에서는 8세 아동 100명 중 3명 정도가 자폐스펙트럼 장애진단을 받는다. 또 국내 등록 자폐성장애인도 2023년 말 약 4만 3천 명으로 지난 10여 년간 두 배 이상 증가했다. 연구팀은 fMRI 분석을 통해 자폐스펙트럼장애 아동이 정상 발달 아동보다 두뇌의 기능적 연결성이 낮다는 사실을 확인했다. 분석결과 감각 정보를 통합하는 하두정소엽과 감각 중계 역할을 하는 시상을 중심으로 뇌 전반의 네트워크 연결이 감소한 것으로 나타났다. 연구팀은 임상에서 AI를 활용하기 위해서는 단순한 진단 정확도를 넘어 AI가 뇌의 생리·병리적 변화를 어떻게 반영하고 있는지 해석할 수 있는 모델이 필요하다는 판단에 따라 AI가 실제 두뇌 네트워크의 변화를 얼마나 잘 반영하는지 평가하는 '생성적 매니폴드 감사(GMA)' 프레임워크를 개발했다. 정상 발달군의 두뇌 연결 패턴을 학습한 AI에서 특정 뇌 영역의 연결을 차단해 변화를 분석하고, '민감도 격차' 지표를 통해 AI가 단순한 정보 손실이 아닌 실제 뇌 네트워크 구조의 변화를 포착하는지 평가했다. 연구팀은 대규모 다기관 자폐 뇌영상 데이터셋(ABIDE}과 서울대병원 자폐 아동 임상 코호트를 활용해 검증했다. 그 결과, 생성형 AI 모델이 비교 모델보다 뇌 네트워크 구조적 변화를 더 정확하게 구분하는 것으로 나타났다. 특히 임상 증상이 호전되더라도 뇌 기능 네트워크 변화 양상은 환자마다 다를 수 있음을 확인, 증상만으로는 확인하기 어려운 개인별 뇌 변화를 AI로 분석할 가능성을 제시했다. KIST는 향후 병원 임상 연구진과의 지속적인 협력을 바탕으로 정밀·맞춤 의학에 활용될 수 있는 뇌질환 원천기술을 고도화해 나갈 계획이다. 한경림 책임연구원은 KIST 박사는 “자폐스펙트럼장애 환자의 뇌 변화를 객관적으로 분석할 수 있는 가능성을 제시한 성과”라며, “앞으로 환자별 뇌 네트워크 특성을 정밀하게 분석해 조기 진단과 치료 경과 예측에 활용할 수 있는 바이오마커 개발로 이어갈 것"이라고 말했다.

2026.08.11 15:04박희범 기자

모빌린트, 인텔리빅스와 도로공사 공공 AI CCTV 전환 사업 참여

모빌린트가 공공 인공지능(AI) 관제 인프라 시장 공략을 본격화한다. AI 반도체 기업 모빌린트는 AI 영상분석 기업 인텔리빅스와 함께 한국도로공사 공공 AI CCTV 전환 사업에 참여한다고 10일 밝혔다. 한국지능정보사회진흥원(NIA)이 주관하는 이번 사업은 전국 고속도로에 설치된 4000여 대 CCTV를 AI 기반 지능형 관제 체계로 전환하는 프로젝트다. 기존 네트워크 인프라를 활용하면서 국산 AI 반도체 기반 AI 추론 서버와 영상분석 플랫폼을 결합해 교통사고, 정지 차량, 역주행 등 돌발상황을 탐지하고 검증하는 환경을 구축한다. 비전 AI와 비전언어모델(VLM)을 결합해 정밀도를 높인다. 비전 AI로 이상 상황을 탐지한 후, VLM을 활용해 탐지 영상의 전후 장면과 주변 도로 환경을 종합 분석해 실제 돌발상황 여부를 검증하는 방식이다. 모빌린트는 자사 AI 가속기 'MLA400'과 AI 서버를 공급해 대규모 영상 데이터를 저전력·고효율로 실시간 처리하는 추론 인프라를 담당한다. 기존 VMS 및 NVR 등 레거시 시스템과 연동이 가능해 대규모 시설 교체 없이 AI 기능을 도입할 수 있다. 양사는 앞서 국산 AI 반도체 기반 산불감시 프로젝트를 추진한 바 있다. 이번 사업을 통해 기술 협력을 전국 단위 교통안전 분야로 확대 적용하게 됐다. 김성모 모빌린트 사업개발본부장은 "국산 AI 반도체가 실제 공공 AI 인프라에 적용돼 대규모 관제 서비스를 구현하는 사례"라며 "교통·재난안전·스마트시티 등 다양한 공공 분야에서 국산 AI 반도체 활용을 확대하겠다"고 말했다.

2026.08.11 09:10전화평 기자

방송영상 AI 학습 데이터 117만 건, 국민에 개방

방송영상 이미지와 배경, 인물, 한글 서체와 자막 등 우리나라 정서와 문화적 요소를 반영한 방송영상 데이터 117만여 건이 국민에 개방된다. 방송미디어통신위원회와 한국전파진흥협회는 방송영상 AI 학습용 데이터 일부를 교육 연구용으로 국민 누구나 활용할 수 있도록 한국지능정보사회진흥원(NIA)의 '인공지능 허브 안심 구역'을 통해 정식 개방한다고 5일 밝혔다. 인공지능 허브 안심 구역은 관련 개발자와 국민이 제공된 데이터를 안전하게 사용할 수 있도록 제공된 보안 통제 환경으로, 사전에 안심 구역에 대한 이용 신청과 승인 절차를 거쳐 누구나 무료로 이용할 수 있다. 그간 AI 학습용 데이터로 방송영상에 대해 많은 수요가 있었으나 지식재산권, 초상권, 인접권 등의 문제로 이용이 어려웠는데 데이터 공개를 통해 개발자들이 걱정 없이 고품질의 영상 데이터를 활용해 다양한 인공지능 모델을 연구할 수 있게 됐다. 개방되는 데이터는 인공지능 허브 안심 구역 홈페이지에서 확인할 수 있다. 공개된 데이터는 ▲영상 이미지 이해 및 설명 ▲배경 및 인물, 객체 생성 ▲제작 환경 고도화 분야에서 배경, 인물, 객체, 서체, 자막 등 10개 유형으로 총 117만여 건이 제공된다. 천지현 방미통위 방송미디어진흥국장은 “방송영상은 한국적인 문화와 정서, 고도의 제작 기술과 전문성이 집약된 인공지능 산업의 핵심 자산”이라며 “앞으로도 다양한 산업 분야에서 방송영상이 활용될 수 있도록 고품질의 인공지능 학습데이터를 지속적으로 구축, 공개할 계획이다”라고 말했다.

2026.08.05 11:01박수형 기자

에이아이매틱스, 충청 국토안전관리원 업무용 차 안전운전 돕는다

에이아이매틱스가 국토안전관리원 충청지역본부 업무용 차량의 안전한 운행을 돕는다. 에이아이매틱스는 국토안전관리원 충청지역본부와 업무협약(MOU)을 체결했다고 30일 밝혔다. 이번 협약은 국토안전관리원 직원이 사용하는 업무용 차량의 사고를 선제적으로 예방하고, 데이터 마스킹과 영상 자동 블러 처리 등 개인정보 보호가 중요한 업무용 차량 환경에 맞춘 AI 안전관리 시스템을 구축하기 위해 추진됐다. 에이아이매틱스가 공급하는 솔루션은 차량용 온디바이스 AI 카메라와 안전운전 플랫폼으로 구성된다. AI 카메라는 주행 중 차량 내외부의 위험 상황을 실시간으로 감지해 운전자에게 즉시 경고를 보내고, 관리자는 해당 플랫폼이 제공하는 스코어링 리포트와 안전운전 통계로 운전자의 위험 운전 패턴을 분석하여 개선점을 찾을 수 있다. 또 사고나 긴급 상황으로 영상 확보가 필요할 때는 PC나 모바일 앱으로 원격에서도 영상을 바로 확인할 수 있다. 이훈 에이아이매틱스 대표는 "최근 공공기관과 기업의 차량 관리에서 가장 큰 화두는 안전 확보와 개인정보 보호의 균형"이라며 "이번에 공급하는 솔루션은 실시간 사고 예방이라는 본연의 기능에 더해, 공공기관의 특수성을 고려한 데이터 마스킹까지 담았다"고 말했다. 이어 "안전과 보안을 동시에 요구하는 B2B·B2G 업무용 차량 시장의 디지털 전환을 주도하겠다"고 덧붙였다.

2026.07.30 11:12백봉삼 기자

[AI인재강국] 인간을 이해하는 현실에 충실한 AI로

국가 AI 연구거점은 과학기술정보통신부와 정보통신기획평가원(IITP)의 지원을 받고 서울시와 서초구청이 뒷받침하는 AI 연구 컨소시엄으로, 카이스트·고려대·포스텍·연세대와 국내 기업들이 함께한다. 지디넷코리아는 격주마다 한국 AI 연구 생태계가 나아갈 방향을 국가 AI 연구거점의 생생한 이야기로 조망해 본다.[편집자주] 의료 영상 복원은 인공지능(AI)이 가장 먼저, 그리고 가장 깊이 들어온 분야 중 하나다. 딥러닝은 흐릿한 MRI와 CT 영상을 선명하게 되살리고, 적은 데이터로도 놀라운 복원을 해냈다. 그런데 성능이 좋아질수록 한 가지 질문이 따라왔다. 이 AI는 정말 인체를 이해하고 있는가, 아니면 그저 그럴듯한 그림을 그려내고 있는가. 이 질문은 생각보다 무겁다. 의료에서 '그럴듯함'은 위험하기 때문이다. 실제로는 없는 병변을 그럴듯하게 만들어내거나, 있는 병변을 매끄럽게 지워버리는 AI는 아무리 화질이 좋아도 쓸 수 없다. 필요한 것은 보기 좋은 영상이 아니라, 인체의 구조와 물리 법칙, 생물학적 원리에 충실한 영상이다. 이를 '충실한 AI'라 부를 수 있다. 통계적으로 그럴듯한 패턴을 넘어, 현실의 법칙을 따르는 지능이다. 이 문제의식은 의료를 넘어 확장된다. 영상뿐 아니라 시계열 신호, 분자 구조처럼 복잡한 고차원 데이터를 다룰 때도 똑같은 원리가 적용된다. 국가AI연구거점에서 연구하는 고차원 생성 파운데이션 모델이 바로 이 방향이다. 현실의 법칙을 반영하는 생성 AI는 의료 영상은 물론 소재 과학과 산업 검사까지, 정확성이 곧 안전과 직결되는 분야에서 폭넓게 쓰일 수 있다. 의료 AI 자체도 큰 전환기에 있다. 지금까지의 의료 AI가 영상 한 장에서 특정 질환을 찾아내는 도구였다면, 앞으로는 영상과 임상 기록, 유전체 정보를 종합해 환자의 미래를 내다보는 '의료 파운데이션 모델'로 나아간다. 진단을 넘어 예측과 예방, 맞춤형 치료로 향하는 것이다. 이미 대규모 의료 데이터로 수년 뒤의 질병 위험을 예측하는 연구들이 나오고 있다. 의사가 여러 정보를 종합해 판단하듯, AI도 그렇게 성장하고 있다. 이런 연구를 하다 보면 절실해지는 것들이 있다. 하나는 사람이다. 이 분야는 의학과 공학, 수학이 만나는 경계에 있어, 서로 다른 언어를 쓰는 연구자들이 한 팀에서 오래 호흡을 맞춰야 비로소 성과가 나온다. 그런 융합형 인재는 하루아침에 길러지지 않는다. 또 하나는 데이터다. 의료 데이터는 민감하고 흩어져 있어, 안전하게 활용할 제도적 기반이 없으면 뛰어난 모델도 배울 재료를 얻지 못한다. 그리고 무엇보다, 이 모든 것은 긴 시간을 필요로 한다. 파운데이션 모델 연구는 단기 성과로 환산되지 않으며, 안정적이고 지속적인 뒷받침 없이는 세계와 경쟁할 수 없다. 한국은 의료 영상과 신호 처리에서 이미 세계적 경쟁력을 갖고 있다. 이 강점을 다음 단계로 끌어올릴 토대가 지금 만들어지고 있다고 믿는다. 그럴듯한 AI를 넘어 현실에 충실한 AI로 가는 길, 그 길 위에 한국이 앞자리에 설 수 있기를 연구자의 한 사람으로서 바란다.

2026.07.24 10:05예종철 컬럼니스트

문체부, 영상·방송업계와 간담회 개최…'AI 문화강국 전략' 수립 박차

문화체육관광부(이하 문체부)가 영상 및 방송업계와 만나 '인공지능(AI) 문화강국' 도약을 위한 현장 목소리를 들었다. 문체부는 최근 최휘영 장관이 서울 마포구 CJ 4DPLEX와 한국문화정보원을 찾아 영상·방송업계 전문가들과 간담회를 열고 AI 시대 K-콘텐츠 경쟁력 강화 방안을 논의했다고 24일 밝혔다. 이날 현장에서는 영상 분야 AI 기술 도입 현황을 점검하고 업계의 애로사항과 제언을 수렴했다. 문체부는 이를 통해 '글로벌 AI 문화강국 전략(가칭)'에 적극 반영할 계획이다. CJ 4DPLEX는 '2025년 AI 혁신 선도 프로젝트 사업' 지원을 받아 'AI-시각특수효과(VFX) 제작 통합 플랫폼'을 구축한 바 있다. 해당 플랫폼은 생성형 AI를 활용한 영상 제작 및 수정·보완 기능을 갖춰 제작 기간과 비용을 절감하는 효과를 내고 있다. 최 장관은 플랫폼을 활용한 영화 제작 과정을 점검하고, 일반 상영관용 콘텐츠를 스크린엑스(ScreenX)용으로 변환하는 AI 기술 적용 현장을 확인했다. 이어 한국문화정보원에서 열린 간담회에서는 영화, 드라마, 방송, 애니메이션, VFX 등 주요 기업 관계자들이 참석해 AI 도입에 따른 창·제작 환경 변화와 현장 애로사항을 논의했다. 문체부는 이번 간담회에서 수렴된 의견과 한국콘텐츠진흥원의 조사 결과 등을 종합해 향후 발표할 AI 문화 정책 전략에 적극 반영할 방침이다.

2026.07.24 06:20진성우 기자

  Prev 1 2 3 4 5 6 7 Next  

지금 뜨는 기사

이시각 헤드라인

비트코인, 美 금리인상에도 강세…7만 6000달러선 유지

김윤지 콘진원장 "IP 키우는 '핵심 에이전시' 도약…장르 칸막이 허물 것"

피지컬 AI·반도체·보안·양자까지 한눈에...AI 대축제 열린다

이종석 국정원장 "보안, 혁신 지속 필수조건"

ZDNet Power Center

Connect with us

ZDNET Korea is operated by Money Today Group under license from Ziff Davis. Global family site >>    CNET.com | ZDNet.com
  • 회사소개
  • 광고문의
  • DB마케팅문의
  • 제휴문의
  • 개인정보취급방침
  • 이용약관
  • 청소년 보호정책
  • 회사명 : (주)메가뉴스
  • 제호 : 지디넷코리아
  • 등록번호 : 서울아00665
  • 등록연월일 : 2008년 9월 23일
  • 사업자 등록번호 : 220-8-44355
  • 주호 : 서울시 마포구 양화로111 지은빌딩 3층
  • 대표전화 : (02)330-0100
  • 발행인 : 김경묵
  • 편집인 : 김태진
  • 개인정보관리 책임자·청소년보호책입자 : 김익현
  • COPYRIGHT © ZDNETKOREA ALL RIGHTS RESERVED.