CourionAI
ES
Boletín
← Glosario Término

Gran conjunto de datos de vídeo

Colección abierta de capacitación en videos de LAION de agosto de 2026, que cubre aproximadamente 10 millones de horas de metraje con subtítulos escritos a máquina para imagen y sonido.

Big Video Dataset es una colección de formación abierta publicada por la organización sin fines de lucro LAION. El equipo partió de 1.300 millones de enlaces de vídeo encontrados en Common Crawl, descargó 80 millones de ellos en un total de alrededor de 10 millones de horas y los cortó en 55 millones de clips más 300 millones de imágenes fijas. La mayor parte del material proviene de YouTube y la mayor parte está en inglés, lo que le dice algo útil sobre el sesgo que heredará cualquier modelo entrenado en él.

Lo que lo hace valioso para la investigación es el etiquetado. En lugar de depender de la descripción que escribió un humano, el equipo generó subtítulos tanto para las imágenes como para el audio automáticamente, de modo que un modelo pueda aprender qué imágenes van con qué palabras y qué sonidos, todo a la vez. Se publica únicamente para investigación no comercial y se basa en la misma exención de investigación alemana en la que se basa LAION para sus conjuntos de datos de imágenes.