CourionAI
DE
Newsletter
← Glossar Begriff

Großer Videodatensatz

Die offene Videoschulungssammlung von LAION vom August 2026 umfasst rund 10 Millionen Stunden Filmmaterial mit maschinell geschriebenen Untertiteln für Bild und Ton.

Der Big Video Dataset ist eine offene Schulungssammlung, die von der gemeinnützigen LAION veröffentlicht wird. Das Team begann mit 1,3 Milliarden in Common Crawl gefundenen Videolinks, lud 80 Millionen davon mit einer Gesamtlänge von etwa 10 Millionen Stunden herunter und schnitt diese in 55 Millionen Clips plus 300 Millionen Standbilder. Das meiste Material stammt von YouTube und ist größtenteils auf Englisch, was Ihnen etwas Nützliches über die Voreingenommenheit verrät, die jedes darauf trainierte Modell übernehmen wird.

Was es für die Forschung wertvoll macht, ist die Kennzeichnung. Anstatt sich darauf zu verlassen, welche Beschreibung ein Mensch gerade geschrieben hat, erstellte das Team automatisch Bild- und Tonuntertitel, sodass ein Modell auf einmal lernen kann, welche Bilder zu welchen Wörtern und zu welchen Tönen passen. Es ist ausschließlich für nichtkommerzielle Forschungszwecke freigegeben und basiert auf der gleichen deutschen Forschungsausnahme, auf die sich LAION für seine Bilddatensätze stützt.