
방송영상 데이터 117만여건이 AI 학습용으로 국민에 개방된다. 방송영상 이미지와 배경 및 인물, 한글 서체와 자막 등 우리나라 정서와 문화적 요소가 반영된 데이터를 개발자들이 활용할 수 있게 되면서 AI 모델 연구에 기여할 수 있을 것으로 기대된다.
방송미디어통신위원회와 한국전파진흥협회는 방송영상 인공지능 학습용 데이터 일부를 교육·연구용으로 국민 누구나 활용할 수 있도록 한국지능정보사회진흥원(NIA)의 ‘인공지능 허브 안심 구역’을 통해 정식 개방한다고 5일 밝혔다.
인공지능 허브 안심 구역은 관련 개발자와 국민이 제공된 데이터를 안전하게 사용할 수 있도록 제공된 보안 통제 환경이다. 사전에 안심 구역에 대한 이용 신청 및 승인 절차를 거쳐 누구나 무료로 이용할 수 있다.
그동안 최적의 AI 학습용 데이터로 평가받는 방송영상에 대해 수요가 많았지만 지식재산권, 초상권, 인접권 등의 문제로 이용이 어려웠다. 이번 데이터 공개를 통해 개발자들이 걱정 없이 고품질의 영상 데이터를 활용해 다양한 AI 모델을 연구할 수 있게 됐다.
개방되는 데이터는 인공지능 허브 안심 구역 누리집을 통해 확인 가능하다. △영상·이미지 이해 및 설명 △배경 및 인물, 객체 생성 △제작 환경 고도화 분야에서 배경, 인물, 객체, 서체, 자막 등 10개 유형으로 총 117만여 건이 제공된다.
천지현 방송미디어진흥국장은 “방송영상은 한국적인 문화와 정서, 고도의 제작 기술과 전문성이 집약된 인공지능 산업의 핵심 자산”이라며 “앞으로도 다양한 산업 분야에서 방송영상이 활용될 수 있도록 고품질의 인공지능 학습데이터를 지속적으로 구축하고 공개할 계획”이라고 말했다.




