CourionAI
IT
Newsletter
← Glossario Termine

Set di dati video di grandi dimensioni

La raccolta di formazione video aperta di LAION dell'agosto 2026, che copre circa 10 milioni di ore di riprese con didascalie scritte automaticamente per immagini e suoni.

Il Big Video Dataset è una raccolta di formazione aperta pubblicata dall’organizzazione no-profit LAION. Il team è partito da 1,3 miliardi di collegamenti video trovati in Common Crawl, ne ha scaricati 80 milioni per un totale di circa 10 milioni di ore e li ha suddivisi in 55 milioni di clip più 300 milioni di immagini fisse. La maggior parte del materiale proviene da YouTube e la maggior parte è in inglese, il che ti dice qualcosa di utile sui pregiudizi che erediterà qualsiasi modello addestrato su di esso.

Ciò che lo rende prezioso per la ricerca è l’etichettatura. Invece di dipendere dalla descrizione che un essere umano ha scritto, il team ha generato automaticamente didascalie sia per le immagini che per l’audio, in modo che un modello possa imparare quali immagini vanno con quali parole e quali suoni tutto in una volta. Viene rilasciato solo per la ricerca non commerciale, basandosi sulla stessa esenzione di ricerca tedesca su cui si basa LAION per i suoi set di dati di immagini.