방송영상 AI 학습 데이터 117만 건, 국민에 개방
방송영상 이미지와 배경, 인물, 한글 서체와 자막 등 우리나라 정서와 문화적 요소를 반영한 방송영상 데이터 117만여 건이 국민에 개방된다. 방송미디어통신위원회와 한국전파진흥협회는 방송영상 AI 학습용 데이터 일부를 교육 연구용으로 국민 누구나 활용할 수 있도록 한국지능정보사회진흥원(NIA)의 '인공지능 허브 안심 구역'을 통해 정식 개방한다고 5일 밝혔다. 인공지능 허브 안심 구역은 관련 개발자와 국민이 제공된 데이터를 안전하게 사용할 수 있도록 제공된 보안 통제 환경으로, 사전에 안심 구역에 대한 이용 신청과 승인 절차를 거쳐 누구나 무료로 이용할 수 있다. 그간 AI 학습용 데이터로 방송영상에 대해 많은 수요가 있었으나 지식재산권, 초상권, 인접권 등의 문제로 이용이 어려웠는데 데이터 공개를 통해 개발자들이 걱정 없이 고품질의 영상 데이터를 활용해 다양한 인공지능 모델을 연구할 수 있게 됐다. 개방되는 데이터는 인공지능 허브 안심 구역 홈페이지에서 확인할 수 있다. 공개된 데이터는 ▲영상 이미지 이해 및 설명 ▲배경 및 인물, 객체 생성 ▲제작 환경 고도화 분야에서 배경, 인물, 객체, 서체, 자막 등 10개 유형으로 총 117만여 건이 제공된다. 천지현 방미통위 방송미디어진흥국장은 “방송영상은 한국적인 문화와 정서, 고도의 제작 기술과 전문성이 집약된 인공지능 산업의 핵심 자산”이라며 “앞으로도 다양한 산업 분야에서 방송영상이 활용될 수 있도록 고품질의 인공지능 학습데이터를 지속적으로 구축, 공개할 계획이다”라고 말했다.