CourionAI
FR
Newsletter
← Toutes les actus
ai-basics 2 min de lecture

Nvidia a créé un outil qui tente de repérer les vidéos générées par IA en quelques millisecondes

Le nouveau Synthetic Video Detector de Nvidia revendique jusqu’à 92 % de précision pour signaler des vidéos faites par IA, assez vite pour les diffusions en direct. C’est une idée réellement utile, avec des limites à comprendre avant de s’y fier.

Une pellicule et une loupe révèlent une fine grille de pixels cachée et un motif d’empreinte sous une image vidéo, avec un petit bouclier protecteur

Nvidia a publié un outil visant l’un des effets les plus troublants du boom de l’IA : des vidéos auxquelles on ne peut pas se fier. Appelé Synthetic Video Detector et présenté à la conférence graphique SIGGRAPH, il cherche à dire si un clip a été généré par IA et le fait rapidement, en traitant une vidéo 1080p en seulement 22 millisecondes. Nvidia annonce jusqu’à 92 % de précision sur de la vidéo propre et non compressée. Une démonstration est disponible aujourd’hui sur build.nvidia.com, même si la version cloud gratuite est lente, limite les fichiers à 100 Mo et expire souvent.

Voici l’idée astucieuse, en termes simples. Beaucoup pensent qu’on attrape un faux en repérant des erreurs flagrantes : six doigts, texte déformé, visage qui scintille. Cet outil ne cherche pas cela. Il traque plutôt les empreintes statistiques laissées par les générateurs vidéo d’IA : de subtils motifs de pixels issus de la façon dont ces modèles construisent une image, invisibles à l’œil mais détectables par un autre modèle. Techniquement, il utilise un « vision transformer », un type d’IA conçu pour analyser les images, bâti sur des modèles ouverts connus appelés DINOv2 et DINOv3. Il n’est pas nécessaire de connaître ces noms pour saisir l’idée : c’est de l’IA utilisée pour surveiller l’IA.

Ce cadrage raconte toute l’histoire. À mesure que des outils comme Sora et ses concurrents rendent triviale la production de vidéos convaincantes, la défense n’est pas un humain plissant les yeux devant un écran, mais des détecteurs automatiques qui tournent discrètement en arrière-plan. Nvidia prévoit de livrer celui-ci via la boîte à outils d’une entreprise de streaming afin que les rédactions et plateformes puissent attribuer une probabilité « synthétique » à la vidéo en direct, sur site ou même dans des environnements isolés qui ne touchent jamais Internet.

Ce que cela signifie pour vous: Pour l’instant, cela vise les diffuseurs et les plateformes, pas vous personnellement ; n’attendez donc pas demain un bouton « faux ou vrai » dans votre application vidéo. Mais la direction est rassurante : ceux qui déplacent la vidéo à grande échelle obtiennent des instruments pour signaler les clips manipulés avant leur propagation. La réserve est essentielle, et Nvidia l’indique clairement. La précision baisse avec la compression, à environ 87 % pour une compression légère et 82 % pour une forte compression, et presque tout ce que vous regardez sur les réseaux sociaux est fortement compressé. Un détecteur de ce type est donc un signal utile, pas un verdict. La meilleure habitude reste l’ancienne : considérez un clip choquant provenant d’une source inconnue comme non confirmé tant qu’un nom de confiance ne s’en porte pas garant.

Sources

Sources: https://build.nvidia.com/nvidia/synthetic-video-detector

Article suivant

Les prochaines puces d’IA de Nvidia tireraient dix fois plus de travail de la même énergie

CoreWeave affirme que les nouveaux systèmes Vera Rubin de Nvidia ont produit, dans un premier benchmark, environ dix fois plus de tokens par mégawatt que la génération Blackwell. Ce que signifie « tokens par mégawatt » et pourquoi cela décide de la capacité de croissance de l’IA.

Un éclair alimente une baie de serveurs près d’une petite flèche et d’une flèche beaucoup plus grande, avec un compteur de vitesse monté haut à côté d’une feuille de sauge