Sources
Gardez une longueur d’avance sur l’art IA
Recevez chaque semaine les meilleures actus IA et art IA dans votre boîte mail — sélectionnées, concises, gratuites.

Sofia suit l'argent, les régulations et les plateformes qui façonnent ce que les créateurs peuvent faire.
Recevez chaque semaine les meilleures actus IA et art IA dans votre boîte mail — sélectionnées, concises, gratuites.
Gratuit. Désabonnement à tout moment.
Choisissez un compagnon et découvrez son avis sur cette histoire
USA Today Co. et plusieurs de ses journaux locaux affiliés poursuivent OpenAI pour plus de 250 millions de dollars, affirmant que l'entreprise a aspiré et copié des centaines de milliers de leurs articles sans autorisation pour entraîner ses modèles d'IA — la dernière d'une série de poursuites judiciaires majeures intentées par des éditeurs, qui réduisent progressivement le terrain légal sous chaque modèle de texte IA présent sur le marché.
Le montant des dommages n'est pas anodin. Lorsque le New York Times a poursuivi OpenAI fin 2023, il n'avait pas précisé de montant — il réclamait « des milliards ». La demande explicite de 250 millions de dollars de USA Today Co. est un choix tactique : un chiffre concret et défendable, lié à l'ampleur des copies alléguées. Il donne aux jurés un point d'ancrage et signale que l'éditeur a calculé la valeur des licences auxquelles il a renoncé.
La plainte couvre non seulement le titre phare USA Today, mais aussi les journaux locaux que possède USA Today Co. — un détail qui compte, car le journalisme local a historiquement constitué l'épine dorsale peu glamour des corpus d'entraînement. C'est précisément le type de texte régional, à fort volume et factuel qui confère aux productions des IA un caractère ancré et faisant autorité. Les éditeurs le savent, et ils en fixent de plus en plus le prix en conséquence.
Le New York Times, le groupe Chicago Tribune, et maintenant USA Today Co. — la liste des plaignants est désormais assez longue pour que le qualificatif de « litige isolé » ne soit plus crédible. Chaque nouveau dépôt de plainte enrichit le dossier probatoire selon lequel la pratique généralisée du scraping de contenus d'éditeurs n'était pas une zone grise juridique que des acteurs raisonnables pouvaient naviguer de bonne foi ; c'était un pari calculé que le coût du contentieux serait inférieur au coût des licences.
Ce pari semble de plus en plus risqué de trimestre en trimestre. OpenAI a signé des accords de licence avec certains éditeurs — l'Associated Press et Axel Springer, notamment — mais les conditions n'ont pas été divulguées, et l'existence de contrats payants fragilise en réalité l'argument de l'usage équitable pour le scraping non rémunéré. Si des licences étaient disponibles, pourquoi n'ont-elles pas été utilisées ?
Pour mémoire, Stability AI a subi une pression similaire en 2023 lorsque des artistes et Getty Images ont intenté un procès concernant les données d'entraînement d'images — un litige qui a plongé l'entreprise dans des années d'incertitude juridique et contribué à son instabilité à la direction. La trajectoire pour les modèles de texte ressemble aujourd'hui étroitement à ce précédent conflit autour des données d'images.
Les conséquences pratiques pour les créateurs d'art par IA sont indirectes mais bien réelles. Les modèles de texte qui alimentent l'interprétation des prompts, la description des personnages et les indications stylistiques dans des outils comme ChatGPT — qui s'intègre dans les flux de travail de génération d'images à travers l'industrie — sont construits sur les mêmes pipelines d'entraînement désormais soumis à un examen juridique. Si les tribunaux commencent à émettre des injonctions ou à imposer la suppression de données, la prochaine génération de modèles multimodaux pourrait arriver avec des corpus de textes délibérément appauvris, affectant leur capacité à interpréter des prompts créatifs nuancés.
Les récentes initiatives d'OpenAI concernant le filigranage et la conformité dans l'UE suggèrent que l'entreprise opère déjà dans une posture juridiquement plus prudente. Le contentieux sur les droits d'auteur constitue une autre dimension de cette même pression. La question est de savoir si les règlements judiciaires produiront des cadres de licence qui stabiliseront la chaîne d'approvisionnement en données d'entraînement — ou s'ils la fragmenteront d'une manière qui avantage les acteurs bien capitalisés pouvant se permettre des accords globaux, laissant les développeurs de modèles plus modestes dans l'incapacité de rivaliser.
La récente évaluation du sénateur Adam Schiff sur le blocage législatif autour des droits d'auteur liés à l'IA au Congrès indique clairement qu'aucun allègement législatif pour les entreprises d'IA n'est attendu prochainement. Cela laisse les tribunaux comme principal terrain d'affrontement, et la plainte à 250 millions de dollars de USA Today Co. est la dernière preuve que les éditeurs entendent les utiliser de manière agressive.
Le prochain jalon concret à surveiller : qu'OpenAI cherche à faire rejeter la plainte ou tente de trouver un accord avant le début de la phase de découverte — car la découverte, qui forcerait la divulgation exacte des données utilisées et du moment où elles l'ont été, est ce que l'entreprise a le plus à perdre.