Tech • IA • Robotique • Jeu

VIDÉO
ENFR

Article complet du Daily Podcast

USA TODAY poursuit OpenAI pour 19 publications et les réponses de ChatGPT

USA TODAY Co. a déposé une plainte fédérale pour droit d’auteur contre OpenAI, accusant l’entreprise d’avoir utilisé sans autorisation les reportages de 19 publications du réseau USA TODAY pour entraîner et exploiter ses modèles d’IA, dans un dossier qui dépasse la seule question des données d’entraînement et vise aussi les résumés et reformulations générés par les produits.

Généré le 9 octobre 2026 à 12:171581 mots
Illustration générée par IA

Une nouvelle plainte d’éditeur, avec une cible plus large

USA TODAY Co. et 13 entités affiliées ont poursuivi OpenAI le 8 octobre 2026 devant le tribunal fédéral du district sud de New York, en affirmant que l’entreprise aurait copié sans autorisation des contenus issus de 19 publications et les aurait utilisés dans des produits fondés sur GPT, dont ChatGPT . La plainte cite USA TODAY, The Tennessean, Indy Star, The Bergen Record, The Enquirer, Asbury Park Press, Democrat & Chronicle, The Knoxville News-Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post et Star News .

Les plaignants réclament plus de 250 millions de dollars de dommages et intérêts, ainsi que des mesures d’injonction et la destruction, au titre du droit d’auteur, de modèles GPT ou d’autres grands modèles de langage et jeux d’entraînement qui intégreraient leurs contenus . Cette demande est significative parce qu’elle ne vise pas seulement une réparation financière: elle demande aussi au tribunal de limiter l’usage futur des œuvres contestées et de traiter les systèmes déjà construits avec ces contenus présumés .

OpenAI n’a pas été jugée responsable à ce stade. Le document est une plainte, non une décision de justice, et ses affirmations les plus fortes restent des allégations des plaignants. The Verge a indiqué qu’OpenAI n’avait pas immédiatement répondu à sa demande de commentaire, tandis que Bloomberg Law a présenté l’affaire comme une nouvelle extension du conflit sur l’utilisation de contenus journalistiques par OpenAI .

Ce que USA TODAY reproche à OpenAI

Le cœur du dossier tient à l’idée qu’OpenAI aurait utilisé du journalisme protégé à plusieurs étapes: acquisition ou scraping des sites des publications, entraînement et ajustement des modèles, puis exploitation de produits qui reproduiraient ou reconditionneraient des articles pour les utilisateurs . La plainte affirme que les modèles d’OpenAI ont été entraînés sur des contenus protégés récupérés sur le web sans autorisation, y compris des contenus soumis à des restrictions d’accès, et que des informations de gestion des droits, comme les titres, les signatures d’auteurs et les mentions de copyright, auraient été supprimées .

Les éditeurs tentent aussi de mesurer la présence de leurs contenus dans des jeux de données connus. La plainte affirme que les publications de USA TODAY représentent plus de 160 000 entrées dans WebText, dont 83 266 provenant de usatoday.com, et que leurs domaines totalisent plus de 122 millions de tokens dans C4, un sous-ensemble filtré de Common Crawl . Ces chiffres sont importants, car les litiges de droit d’auteur liés à l’IA dépendent souvent de la preuve: les plaignants doivent relier leurs œuvres aux données d’entraînement, aux sorties générées, ou aux deux.

La plainte repose principalement sur trois fondements: violation directe du droit d’auteur, violation par responsabilité indirecte et suppression d’informations de gestion des droits au titre du Digital Millennium Copyright Act . USA TODAY soutient également que les dommages statutaires pourraient atteindre 150 000 dollars pour chaque violation volontaire du droit d’auteur et 25 000 dollars par infraction liée à la suppression d’informations de gestion des droits .

Pourquoi ce dossier ne concerne pas seulement l’entraînement

La partie la plus importante de l’affaire pourrait être son attention portée au comportement actuel des produits. De nombreuses actions d’éditeurs contre des entreprises d’IA se concentrent sur l’entraînement: la copie de livres, articles ou pages web dans des jeux de données relève-t-elle du fair use? La plainte de USA TODAY va plus loin en visant l’exploitation des produits, notamment les réponses de type moteur de recherche ou génération augmentée par récupération qui résumeraient des articles précis de manière si complète que l’utilisateur n’aurait plus besoin de cliquer vers la source .

La plainte décrit la génération augmentée par récupération, ou RAG, comme un processus dans lequel un modèle reçoit une requête, récupère des documents pertinents, les combine avec la question de l’utilisateur, puis produit une réponse en langage naturel . Les éditeurs soutiennent que ce processus peut générer des réponses qui paraphrasent de près ou copient largement des œuvres, même lorsque le modèle lui-même n’a pas mémorisé l’article . En termes pratiques, USA TODAY affirme que le préjudice ne se limite pas à un acte passé d’entraînement: il se poursuivrait chaque fois qu’un produit transforme un reportage en réponse de substitution.

Cette distinction pourrait peser sur les recours. Si le tribunal voit le litige uniquement comme une question passée de données d’entraînement, les dommages et la gouvernance future des jeux de données seront au premier plan. S’il accepte l’idée que les sorties et les résumés peuvent constituer des actes d’infraction distincts, le dossier pourrait aussi toucher la conception des produits, les interfaces de recherche, les liens vers les sources, les filtres de sortie et les licences liées à l’actualité.

Les exemples autour de GPT-5.6

La plainte de USA TODAY inclut des exemples de prompts adressés à GPT-5.6 demandant au système de trouver et résumer des articles identifiés par leur titre . Le document affirme que GPT-5.6 a généré des résumés détaillés d’articles provenant notamment d’Indy Star, Detroit Free Press, The Knoxville News-Sentinel, The Palm Beach Post, The Tennessean, The Enquirer, The Des Moines Register, The Courier-Journal, Naples Daily News, Asbury Park Press, Milwaukee Journal Sentinel, The Columbus Dispatch, The Oklahoman, Democrat & Chronicle, The Bergen Record, The Detroit News, USA TODAY et The Arizona Republic .

Les plaignants décrivent ces sorties comme des résumés en plusieurs sections qui préserveraient la structure, la séquence ou le contenu substantiel des articles originaux . Pour les éditeurs, c’est le lien juridique entre l’« entraînement » et l’« exploitation »: si un utilisateur peut demander un résumé approfondi d’un article nommé et recevoir un substitut détaillé, le préjudice allégué concerne la perte de trafic, la perte d’abonnements et l’affaiblissement de la valeur des licences .

The Verge a souligné la demande de plus de 250 millions de dollars et a repris l’argument de la plainte selon lequel l’utilisation non autorisée par OpenAI aurait causé un préjudice « réel et continu » aux titres concernés . Bloomberg Law a également rapporté que les plaignants détiennent des droits sur des contenus publiés dans 19 publications et que la plainte affirme qu’OpenAI aurait ciblé les contenus d’actualité .

Conditions d’utilisation, robots.txt et pression sur les licences

USA TODAY invoque aussi ses propres restrictions. La plainte indique que les conditions d’utilisation des publications interdisent d’utiliser les contenus des sites pour développer ou améliorer des systèmes d’IA, y compris pour l’entraînement, le réentraînement, l’ajustement, l’ancrage et la génération augmentée par récupération, et que les publications bloquent les robots d’OpenAI via robots.txt . Elle affirme également que les robots d’IA détectés sont redirigés vers une page indiquant que le crawling et le scraping ne sont pas autorisés .

Cet argument vise à affaiblir toute thèse selon laquelle OpenAI aurait pu croire raisonnablement que l’usage était permis. Il illustre aussi une évolution plus large du secteur: les éditeurs transforment les signaux techniques, les conditions de site et l’historique des licences en éléments de preuve. La plainte note qu’OpenAI a signé des accords de licence avec plus d’une douzaine d’organisations de presse et de médias, dont Associated Press, Axel Springer, The Atlantic et Vox Media, et soutient que ces accords montrent qu’OpenAI comprend la valeur commerciale du journalisme et la nécessité d’obtenir une autorisation .

Pour OpenAI et les autres développeurs d’IA, c’est le problème de la provenance des données sous une forme plus aiguë. Il ne suffit plus de dire que les données d’entraînement venaient du web ouvert. Les tribunaux, les éditeurs et les clients professionnels veulent de plus en plus savoir quels domaines ont été utilisés, sous quelles conditions, si des contenus étaient derrière des paywalls, si les exclusions robots.txt ont été respectées et si les sorties peuvent reproduire ou remplacer l’œuvre originale.

La suite du dossier

Sur le plan procédural, l’affaire commence comme une nouvelle action de droit d’auteur contre OpenAI devant le district sud de New York. Unite.AI a rapporté que le dossier comprenait la plainte, des éléments de registration de copyright et des exemples de sorties GPT-5.6, ainsi qu’une déclaration de connexité demandant que l’action soit traitée comme liée à un contentieux consolidé contre OpenAI déjà pendant devant le même tribunal .

Les prochaines étapes devraient inclure la notification, l’intervention des avocats d’OpenAI, puis soit une réponse, soit une requête contestant la plainte. Le débat juridique central portera probablement sur le fair use, la causalité, la preuve de la copie, le statut juridique des résumés et la possibilité de démontrer à grande échelle la suppression d’informations de gestion des droits.

Pour les éditeurs, cette action est une nouvelle tentative de transformer les archives et les reportages en levier de négociation pour des licences. Pour les entreprises d’IA, elle augmente le coût de l’ambiguïté: si des contenus d’actualité apparaissent dans les jeux d’entraînement et si les produits peuvent produire des substituts article par article, « nous avons aspiré le web » risque de ne plus suffire comme réponse factuelle. L’affaire en est encore au stade des allégations, mais sa théorie est claire: la plainte traite le journalisme non comme un simple carburant historique pour l’entraînement, mais comme une infrastructure de produit vivante que les éditeurs disent avoir été utilisée sans paiement.

Commentaires

Sois le premier à commenter.

Sources des dernières 72 heures

  1. [1]Complaint, USA Today Co., Inc. v. OpenAI Foundation, No. 1:26-cv-08892 (S.D.N.Y.)8 oct. 2026, 02:00
  2. [2]USA Today becomes the latest publisher to sue OpenAI8 oct. 2026, 19:58
  3. [3]USA Today, News Outlets Join OpenAI Copyright Infringement Fight8 oct. 2026, 19:59
  4. [4]USA TODAY Sues OpenAI Over Copyrighted News Content in AI Training8 oct. 2026, 02:00

Article généré par IA à partir d’une recherche web récente, puis conservé comme instantané éditorial daté.