방송영상 데이터 117만 건 개방…한국형 AI 연구 기반 넓어진다
방송미디어통신위원회와 한국전파진흥협회가 한국의 문화와 정서가 반영된 방송영상 인공지능 학습용 데이터 117만5,800건을 국민에게 개방한다. 데이터는 한국지능정보사회진흥원의 ‘AI-Hub 안심 구역’을 통해 교육·연구 목적으로 무료 이용할 수 있다.
이번에 공개되는 자료는 방송영상 이미지·비디오 설명, K-콘텐츠 영상 이해, 한국적 배경·객체·인물 생성, 한글 서체와 방송 자막 등 10개 유형이다. 주요 규모는 이미지 캡셔닝 29만4,906건, 비디오 캡셔닝 21만7,587건, K-콘텐츠 서체 생성 데이터 15만1,334건 등이다.
기존에는 지식재산권과 초상권, 인접권 문제로 방송영상을 AI 학습에 활용하기 어려웠지만, 보안 통제 환경인 AI-Hub 안심 구역을 통해 연구자가 안전하게 데이터를 이용할 수 있게 됐다. 이용자는 사전 신청과 승인 절차를 거쳐야 한다.
최근 해외 AI 기업들이 자국 언어와 문화에 특화된 데이터를 경쟁적으로 확보하는 것처럼, 이번 개방은 한국형 멀티모달·생성형 AI 개발을 뒷받침하는 기반이 될 것으로 기대된다.
다만 승인 절차와 외부 반출 제한이 실제 활용성을 떨어뜨릴 수 있다는 점은 우려된다. 향후에는 권리 보호를 유지하면서도 이용 절차를 간소화하고, 산업 현장에서 활용 가능한 데이터 유형과 공개 범위를 단계적으로 확대할 필요가 있다.
출처: 「방송영상 데이터 117만 건, 국민에 개방」, 방송미디어통신위원회·한국전파진흥협회, 2026년 8월 5일

Congratulations!
Your post has been selected and upvoted by the SteemPro Team 🚀
Explore more on SteemPro:
🌐 https://www.steempro.com
🎮 Play SteemHeights: https://www.steempro.com/games/steem-heights
💬 Join our Discord: https://discord.gg/Bsf98vMg6U
💪 Supporting the growth of the Steem ecosystem together.
🟩 Vote for witness faisalamin:
https://steemitwallet.com/~witnesses
https://www.steempro.com/witnesses#faisalamin
This is an automated message.