방송영상 117만건, AI 연구 자원으로 풀린다
핵심 요약
방송영상 AI 학습데이터 117만여 건이 교육·연구용으로 개방된다. 데이터는 AI 허브 안심구역에서 신청과 승인 후 무료로 이용할 수 있다. 한국 문화와 정서를 반영한 자료가 10개 유형으로 제공된다.
방송미디어통신위원회와 한국전파진흥협회가 인공지능 학습에 활용할 수 있는 방송영상 데이터 117만여 건을 교육·연구 목적으로 개방한다. 국민은 이용 신청과 승인 절차를 거쳐 별도의 비용 없이 데이터를 사용할 수 있으며, 공개 창구는 한국지능정보사회진흥원이 운영하는 ‘AI 허브 안심구역’이다.
공개 데이터는 영상·이미지의 이해와 설명, 배경·인물·객체 생성, 제작환경 고도화 등을 포함해 모두 10개 유형으로 구성됐다. 방송영상 이미지뿐 아니라 배경과 인물, 객체, 한글 서체, 자막 등 한국의 문화와 정서를 담은 자료가 포함돼 다양한 AI 모델의 학습과 연구·개발에 활용할 수 있도록 했다.
방송영상은 AI 학습에 적합한 고품질 자료로 평가됐지만, 지식재산권과 초상권, 저작인접권 등이 얽혀 실제 이용에는 제약이 있었다. 이번 개방은 개발자와 연구자가 이런 권리 문제에 대한 부담을 덜고 방송 분야 데이터를 AI 모델 연구와 개발에 활용할 수 있도록 이용 기반을 마련했다는 데 의미가 있다.
AI 허브 안심구역은 보안 통제가 적용된 환경에서 AI 학습데이터를 제공하는 서비스다. 천지현 방송미디어진흥국장은 방송영상이 한국 문화와 정서, 제작 기술이 집약된 AI 산업의 핵심 자산이라는 점을 강조했다. 방송미디어통신위원회는 앞으로도 여러 산업 분야에서 활용할 수 있는 고품질 AI 학습데이터를 지속적으로 구축해 공개할 계획이다.