LAION이 AI 연구용 오픈 비디오 데이터셋 중 최대 규모인 '빅 비디오 데이터셋(BVD)'을 공개했다. 영상 8000만개, 총 재생시간 1000만시간, 자동 생성된 캡션이 달린 클립 5500만개로 구성됐다. BVD로 학습한 모델은 기존 벤치마크였던 인턴비드(InternVid)를 최대 2.1%포인트 앞섰다. 저작권 측면에서는 비영리 연구 목적의 저작물 수집을 허용한 2024년 함부르크 법원 판결을 법적 근거로 삼을 수 있을 것으로 보인다.
- •LAION, 영상 8000만개·재생시간 1000만시간·자동 캐션 클립 5500만개 규모의 오픈 비디오 데이터셋 BVD 공개
- •BVD로 학습한 모델, 기존 벤치마크 인턴비드 대비 최대 2.1%포인트 성능 우위
- •2024년 함부르크 법원의 비영리 연구 목적 저작물 수집 허용 판결을 법적 근거로 원용 가능
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
LAION drops massive open video dataset with 10 million hours of footage for AI research

- 1.LAION이 영상 8000만 개, 러닝타임 1000만 시간 규모의 오픈 비디오 데이터셋 'BVD' 공개
- 2.자동 설명이 달린 클립 5500만 개 포함, AI 영상 연구용으로는 최대급 규모
- 3.BVD로 학습한 모델이 기존 벤치마크 InternVid 대비 최대 2.1%p 성능 우위
- 4.2024년 함부르크 법원 판결(비상업 연구 목적 저작물 수집 허용)을 법적 근거로 활용
왜 중요한가?
비상업 연구용 오픈 비디오 데이터셋 부족 문제를 해소하며, 저작권 있는 영상도 비상업 연구 목적이면 수집 가능하다는 법적 근거를 실제로 활용한 사례라는 점에서 향후 유사 데이터셋 구축에 참고가 된다.
본문 미리보기
LAION's Big Video Dataset (BVD) is one of the largest open video datasets for AI research, with 80 million videos, 10 million hours of runtime, and 55 million auto-described clips. Models trained on BVD beat the previous benchmark, InternVid, by up to 2.1 percentage points. Legally, LAION can likely point to a 2024 Hamburg court ruling that allows collecting copyrighted content for non-commercial research. The article LAION drops massive open video dataset with 10 million hours of footage for AI
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
