Le ministère américain de la Justice déclare à un tribunal que la formation de l'IA sur des livres protégés par le droit d'auteur est une utilisation équitable
Dans l'affaire consolidée du New York Times contre OpenAI et Microsoft, le DOJ s'est rangé du côté des sociétés d'IA et a directement contredit le rapport du US Copyright Office dont l'auteur a été licencié l'année dernière.
Le ministère américain de la Justice a déposé la semaine dernière un mémoire dans l’affaire consolidée des droits d’auteur intentée par le New York Times et d’autres titulaires de droits contre OpenAI et Microsoft, et il s’est prononcé du côté des sociétés d’IA. Selon le ministère, la formation d’un grand modèle linguistique sur un texte protégé par le droit d’auteur est une utilisation équitable.
L’utilisation équitable est la doctrine juridique américaine qui vous permet d’utiliser du matériel protégé par le droit d’auteur sans autorisation dans des circonstances limitées, comme citer un livre dans une critique. Qu’il s’agisse d’aspirer des millions d’articles pour former un modèle, c’est la question sur laquelle les tribunaux réfléchissent depuis que le Times a intenté une action en justice fin 2023, exigeant des milliards de dommages et intérêts et la destruction des modèles formés sur son travail.
L’argument du DOJ repose sur une ligne de démarcation entre la formation et la production. Au cours de la formation, des œuvres entières sont copiées, mais ces copies ne sont jamais publiées, et ce que le modèle produit par la suite manque « souvent, sinon toujours », de similitude substantielle avec les originaux. Selon le ministère, traiter les deux comme une seule loi est juridiquement erroné. Son analogie est Joan Didion, qui, adolescente, a réécrit les histoires d’Hemingway pour comprendre le fonctionnement de ses phrases. Selon la logique des plaignants, suggère le DOJ, Didion aurait dû de l’argent à quelqu’un à chaque fois qu’elle publiait par la suite.
Qu’est-ce qu’il y a derrière ça
Le dossier est remarquable surtout par les personnes qu’il contredit. En 2025, le Bureau américain du droit d’auteur a publié un rapport concluant que l’utilisation équitable ne couvre pas la formation à l’IA à grande échelle, arguant que les modèles fonctionnent à partir de copies parfaites et génèrent du contenu concurrent beaucoup plus rapidement que n’importe quel humain. Le DOJ affirme maintenant que ce rapport n’a aucune autorité juridique contraignante et a mal interprété la jurisprudence. Shira Perlmutter a été licenciée peu de temps après la publication du rapport et conteste actuellement son licenciement, un fait que le DOJ note dans une note de bas de page.
L’objection d’échelle n’a pas disparu. Une personne copiant un livre pour en tirer des leçons n’est pas la même chose qu’une entreprise transformant ce contenu en un produit grand public qui concurrence la source. Ailleurs, les tribunaux ont statué différemment : un tribunal allemand a statué contre Suno sur les données d’entraînement et a rejeté d’emblée la défense d’utilisation équitable. Le mémoire du ministère constitue une opinion et non une décision, et le juge est libre de l’ignorer.
Ce que cela signifie pour vous : Si vous écrivez, dessinez, codez ou faites de la musique pour gagner votre vie, il s’agit de savoir si votre travail publié peut être utilisé pour former les systèmes avec lesquels vous êtes en concurrence, et le gouvernement américain vient de dire à un tribunal que c’est possible. Si vous utilisez uniquement des outils d’IA, n’attendez aucun changement immédiat. Mais la façon dont cette affaire aboutira déterminera ce dont les modèles sont autorisés à tirer des leçons, et donc ce qu’ils peuvent faire. Si vous êtes en Europe, notez que les règles de l’UE et les décisions allemandes vont dans le sens inverse, la réponse peut donc dépendre de l’endroit où vous vous trouvez.
Sources
Mistral lève 3 milliards d'euros, le plus grand tour de table jamais réalisé par une entreprise technologique européenne
Samsung Electronics a mené une série D qui valorise le laboratoire français à plus de 21 milliards d'euros. L'argumentaire adressé aux investisseurs n'était pas un meilleur chatbot mais un meilleur contrôle : des pondérations ouvertes, une infrastructure propre et pas de dépendance vis-à-vis d'un fournisseur.