Le conflit sur le droit d’auteur entre Microsoft et OpenAI s’étend alors que le Seattle Times et Newsday portent plainte
Microsoft et OpenAI font désormais face à une nouvelle action en justice intentée par des éditeurs, malgré des années de financement d’expériences destinées à aider les rédactions locales à adopter l’intelligence artificielle. The Seattle Times et Newsday ont déposé leur plainte le 4 septembre 2026. Ils allèguent que les entreprises ont copié leur travail journalistique sans autorisation afin de développer et d’exploiter des produits d’IA commerciaux.
La plainte vise plus que l’entraînement des modèles. Elle affirme que les fonctionnalités de ChatGPT, Microsoft Copilot et Bing peuvent reproduire ou paraphraser de très près des reportages protégés. Ces réponses concurrenceraient les éditeurs pour les lecteurs, les revenus publicitaires, les abonnements et les revenus de licence.
Le différend entre Microsoft et OpenAI devient ainsi plus complexe qu’un conflit familier entre entreprises technologiques et titulaires de droits d’auteur. Les deux éditeurs ont participé à un programme de bourses consacré à l’IA et financé par les défendeurs. Ils ne rejettent pas l’IA dans son ensemble. Ils soutiennent que la collaboration n’autorise pas la copie non rémunérée ni des produits qui se substituent à leurs reportages.
L’affaire survient également à une phase décisive du conflit plus large sur le droit d’auteur. The New York Times et d’autres éditeurs plaident déjà des demandes connexes à Manhattan. Entre-temps, le ministère américain de la Justice a soutenu une défense large fondée sur le fair use pour l’entraînement de l’IA. Les nouveaux plaignants doivent donc distinguer la copie alléguée utilisée pour entraîner les modèles des sorties susceptibles d’exposer des œuvres protégées aux utilisateurs.
La plainte vise l’entraînement, la récupération et les réponses de l’IA
Les éditeurs contestent l’ensemble de la chaîne de contenu, du scraping de sites web aux réponses affichées aux utilisateurs.
The Seattle Times Company et Newsday LLC ont déposé leur plainte de 38 pages devant le tribunal fédéral de district des États-Unis pour le district sud de New York. Parmi les défendeurs nommés figurent Microsoft et plusieurs entités de la structure d’entreprise d’OpenAI.
Les éditeurs allèguent que des systèmes automatisés ont copié des centaines de milliers de leurs articles. Selon la plainte, certains contenus se trouvaient derrière des paywalls conçus pour restreindre l’accès aux abonnés. Les défendeurs n’ont pas reconnu ces allégations, et le tribunal n’a pas conclu que les copies avaient eu lieu comme décrit.
La plainte identifie plusieurs utilisations alléguées de ces contenus. Elle affirme que des copies ont été intégrées à des jeux de données utilisés pour entraîner et affiner de grands modèles de langage. Elle allègue également que du contenu a été stocké pour la génération augmentée par récupération, communément appelée RAG. Ce processus récupère des contenus externes lorsqu’un utilisateur pose une question et les fournit à un modèle lors de la production d’une réponse.
Cette distinction importe, car l’entraînement et la récupération soulèvent des questions factuelles différentes. L’entraînement modifie les paramètres d’un modèle en l’exposant à des motifs présents dans de vastes collections de données. La récupération peut introduire un document précis dans le processus de génération lorsqu’un utilisateur soumet une requête pertinente.
Les éditeurs accusent aussi les entreprises d’avoir supprimé ou modifié des informations de gestion des droits d’auteur. Ces informations peuvent inclure des titres, des noms d’auteurs et des mentions de droit d’auteur. Leurs demandes vont au-delà de la violation directe du droit d’auteur et incluent des fondements connexes relevant du droit fédéral et du droit des États, notamment la dilution de marque.
Les allégations les plus concrètes concernent les sorties des modèles. La plainte présente des exemples dans lesquels ChatGPT aurait renvoyé des passages ressemblant au travail des éditeurs. Un test aurait produit un extrait de 88 mots du reportage récompensé par un Pulitzer de The Seattle Times sur le Boeing 737 MAX, après réception d’un titre d’article et d’une adresse web.
Cet exemple n’établit pas la fréquence à laquelle des sorties similaires se produisent. Il montre toutefois pourquoi l’affaire ne peut être réduite à un débat abstrait sur des machines apprenant des schémas statistiques. Les éditeurs mettent en regard un comportement précis des sorties et leurs allégations de copie en amont.
Les recours demandés sont donc très larges. Les journaux réclament des dommages-intérêts et une injonction contre la poursuite des violations. Ils demandent également la destruction des copies non autorisées, des jeux de données d’entraînement concernés et des modèles intégrant leurs travaux, selon la plainte pour violation du droit d’auteur déposée.
Une ordonnance de destruction soulèverait d’importantes questions techniques et juridiques. Un modèle moderne reflète un entraînement effectué sur un vaste jeu de données plutôt qu’il ne conserve une simple bibliothèque d’articles lisibles. Les tribunaux devraient disposer d’éléments reliant des œuvres précises, des jeux de données, des versions de modèles et des utilisations prétendument contrefaisantes avant d’envisager un tel recours.
Pour l’instant, toutes les affirmations centrales restent des allégations. Les défendeurs n’ont pas déposé leurs réponses détaillées, et aucun juge n’a statué que les œuvres des éditeurs avaient été intégrées illégalement aux produits. Le dépôt de la plainte modifie le différend en créant une nouvelle affaire, non en tranchant les faits contestés.
La défense de Microsoft et OpenAI face au test de l’information locale
Le conflit central porte sur la question de savoir si l’entraînement de l’IA crée un nouvel outil d’analyse ou un substitut fondé sur le même journalisme qu’il concurrence.
OpenAI affirme que ses modèles sont entraînés sur des données accessibles au public et que cette pratique repose sur le fair use. Le fair use est une doctrine juridique qui autorise certaines utilisations non concédées sous licence après examen de la finalité, de la transformation, des effets sur le marché et d’autres facteurs.
Microsoft n’a pas proposé de défense juridique détaillée lorsque la plainte est devenue publique. Un porte-parole de l’entreprise a déclaré que Microsoft avait été surpris par le dépôt et restait disposé à discuter de solutions possibles. Cette réponse laisse sans réponse les allégations techniques de la plainte à ce stade précoce.
Les éditeurs présentent la même activité différemment. Ils affirment que les défendeurs ont copié des œuvres expressives afin de créer des services répondant aux mêmes questions que celles auxquelles ces œuvres avaient été écrites pour répondre. Selon eux, ChatGPT et Copilot ne se contentent pas d’analyser le journalisme. Ils peuvent fournir des informations qui privent le lecteur d’une raison de visiter la publication d’origine.
Cette substitution alléguée est importante, car le préjudice au marché fait partie de l’analyse du fair use. Un tribunal pourrait considérer l’entraînement des modèles, leurs sorties et les systèmes de récupération comme des utilisations distinctes. Une activité jugée transformative à un stade ne protège pas automatiquement chaque sortie en aval.
Le ministère de la Justice a plaidé en faveur de cette séparation dans un contentieux connexe. Dans un dépôt de septembre 2026, le gouvernement a décrit l’entraînement des LLM comme hautement transformatif. Il a comparé le processus à l’utilisation de contenus existants pour construire un système qui reconnaît des relations et répond à de nouvelles informations.
Toutefois, le mémoire sur le fair use du gouvernement a également distingué l’entraînement des sorties qui reconstruisent et distribuent des œuvres protégées. Il a soutenu que les sorties potentiellement contrefaisantes devraient faire l’objet d’une évaluation utilisation par utilisation plutôt que de déterminer la légalité de l’entraînement dans son ensemble.
Cette position donne aux deux parties des arguments à exploiter. OpenAI et Microsoft peuvent soutenir que l’entraînement poursuit une finalité différente de la publication d’informations. Les journaux peuvent se concentrer sur la récupération, la mémorisation, les passages répétés et les réponses qui remplaceraient prétendument les visites d’articles.
La charge de la preuve pèsera fortement sur les éléments produits. Les plaignants doivent relier des œuvres enregistrées à des actes de copie précis ou à des sorties susceptibles d’engager la responsabilité. Les défendeurs peuvent contester que des reproductions obtenues par sollicitation représentent un comportement normal du produit, des tests exceptionnels ou des tentatives conçues pour faire apparaître du texte protégé.
La nouvelle affaire soulève également une dimension liée à l’information locale. Les éditeurs nationaux disposent d’audiences et d’activités d’abonnement diversifiées, bien qu’ils subissent les mêmes pressions sur les renvois. Les organisations régionales dépendent davantage des lecteurs à la recherche d’informations sur les administrations locales, les transports, les écoles, la météo et la sécurité publique.
Ces requêtes se prêtent bien à des réponses résumées. Un utilisateur peut interroger un assistant sur la fermeture d’une ligne de transport et recevoir les détails essentiels sans ouvrir l’article publié. Lorsque cette réponse provient d’un reportage local original, l’éditeur supporte le coût du reportage tandis qu’une autre interface contrôle la relation avec l’audience.
La plainte cite des données sectorielles affirmant que les renvois depuis les moteurs de recherche vers les éditeurs régionaux et métropolitains de taille moyenne ont chuté de 47 % entre décembre 2024 et décembre 2025. Elle compare ce chiffre à une baisse de 22 % pour les grands éditeurs nationaux.
Ces chiffres apportent du contexte, mais ne démontrent pas un lien de causalité dans cette affaire. Le trafic de renvoi évolue pour de nombreuses raisons, notamment les mises à jour du classement des recherches, le comportement des consommateurs, la conception des plateformes et la concurrence entre éditeurs. Les plaignants devront fournir des éléments plus précis pour relier leurs pertes aux produits des défendeurs.
La question juridique est donc plus étroite que celle de savoir si l’IA affecte le journalisme. Elle consiste à déterminer si les défendeurs ont fait des usages légalement protégés, produit des sorties contrefaisantes ou porté atteinte à des marchés reconnus par le droit d’auteur. Cette distinction déterminera si l’affaire devient un précédent pour l’entraînement ou un dossier centré sur des chaînes de contenu particulières.
Le financement de l’IA n’a pas réglé la question de l’autorisation
Le revirement le plus saisissant est que les deux journaux ont accepté un soutien au développement de l’IA tout en maintenant que l’adoption ne vaut pas consentement.
En 2024, Microsoft et OpenAI ont soutenu une initiative collaborative sur l’IA organisée par le Lenfest Institute for Journalism. Chaque entreprise a engagé un financement direct et des crédits logiciels. Le programme combiné était évalué jusqu’à 10 millions de dollars et incluait huit organisations d’information métropolitaines indépendantes.
The Seattle Times et Newsday y participaient tous deux. L’initiative visait à aider les éditeurs locaux à tester des produits soutenus par l’IA et à développer des modèles économiques plus durables. Elle présentait l’IA comme un outil que les organisations d’information pouvaient utiliser, et non simplement comme une menace à bloquer.
The Seattle Times prévoyait d’explorer la publicité, la formation commerciale et l’analytique. Newsday prévoyait des outils de synthèse de données publiques destinés à sa rédaction, à ses lecteurs et à ses clients professionnels. Les plans de bourses publiés plaçaient les deux organisations au cœur de l’expérimentation du secteur avec l’IA générative.
The Seattle Times a également indiqué que sa rédaction autorise des usages limités après une évaluation des risques. Ces usages peuvent inclure la transcription et l’analyse de données. L’organisation affirme ne pas utiliser l’IA pour générer ses articles publiés et signaler les usages importants lorsque cela est approprié.
Cet historique affaiblit toute présentation simpliste de la plainte comme une résistance à la nouvelle technologie. Les plaignants tracent une frontière entre l’utilisation d’outils sous licence et l’autorisation d’utiliser leur journalisme pour l’entraînement, la récupération ou des sorties concurrentes.
Il soulève également une question inconfortable pour Microsoft et OpenAI. Leurs investissements dans l’information locale présentaient l’IA comme une voie vers la durabilité. La plainte affirme que les mêmes entreprises ont compromis cet objectif en utilisant des reportages sans compensation.
Le président-directeur général de Seattle Times, Alan Fisco, a déclaré aux employés que le dépôt de la plainte avait été difficile. Il a indiqué que l’organisation dépense chaque année des millions de dollars pour produire son contenu et doit le défendre contre toute utilisation non approuvée et non rémunérée.
Fisco a également déclaré que l’action n’avait pas pour objectif d’entraver l’innovation en IA. Sa préoccupation exprimée était que l’innovation ne devrait pas se faire aux dépens du modèle économique du journal. Cette position oriente le conflit vers les licences et la conception des marchés plutôt que vers une interdiction totale de l’IA.
Une réponse syndicale ajoute une couche supplémentaire. Le Seattle Times Union, qui représente plus de 160 employés, a soutenu l’action en justice pour atteinte au droit d’auteur. Il a également reproché à l’éditeur de refuser de garantir, lors des négociations contractuelles, que l’IA ne remplacerait pas les postes non journalistiques de la rédaction.
La position du syndicat met en évidence une deuxième frontière. Un éditeur peut défendre sa propriété intellectuelle tout en étant soumis à l’examen de la manière dont il déploie l’IA auprès de ses propres salariés. Le procès ne tranche pas la question de savoir si l’adoption de l’IA dans les rédactions protège l’emploi, améliore la productivité ou transfère des tâches auparavant assurées par le personnel.
Pour les travailleurs du savoir, ce différend illustre l’importance de la provenance. La provenance consiste à savoir d’où vient une information et quelles autorisations encadrent son utilisation. Une réponse générée par l’IA peut sembler utile tout en dissimulant le travail de reportage, les documents et le travail humain qui l’ont rendue possible.
Les organisations qui construisent une base de connaissances IA sont confrontées à une question opérationnelle connexe. Elles doivent définir des règles concernant les contenus intégrés au système, les utilisateurs qui peuvent y accéder et la capacité des réponses générées à préserver le contexte des sources.
Le conflit n’oppose pas la collaboration au contentieux. Il oppose une collaboration sous licence à une extraction présumée non rémunérée. Une subvention, une licence produit ou un programme d’innovation ne confère pas nécessairement l’autorisation de droit d’auteur requise pour des usages sans rapport.
Cette distinction comptera au-delà du journalisme. Les entreprises combinent de plus en plus des modèles de fournisseurs avec des documents internes, des bases de données sous licence et des contenus web publics. Les acheteurs ont besoin de réponses contractuelles claires sur les droits d’entraînement, les sources de récupération, l’attribution, la conservation des données et la responsabilité liée aux contenus générés.
Les accords de licence rendent l’argument du préjudice de marché plus difficile à ignorer
Les accords existants avec des éditeurs montrent que les contenus d’actualité constituent un marché de licences pour l’IA, mais ils ne prouvent pas automatiquement que chaque utilisation sans licence est illégale.
OpenAI a conclu des accords avec des éditeurs qui ont choisi la négociation plutôt que le contentieux. Ces arrangements contribuent à établir que les archives et les contenus d’actualité récents ont une valeur commerciale pour les développeurs d’IA.
The Associated Press a annoncé un accord autorisant OpenAI à concéder sous licence une partie de ses archives textuelles. Les entreprises prévoyaient également d’explorer des utilisations potentielles de l’IA générative dans les produits d’information. L’accord sur les archives n’a pas révélé l’intégralité des conditions commerciales.
News Corp a ensuite annoncé un partenariat pluriannuel couvrant des contenus actuels et archivés provenant de publications sur plusieurs marchés. OpenAI a reçu l’autorisation d’afficher ces contenus dans ses produits, tandis que News Corp a obtenu une relation commerciale formelle autour de cet usage.
Le partenariat avec l’éditeur démontre l’existence d’une voie praticable fondée sur l’autorisation. Il renforce également l’argument des plaignants selon lequel une copie non autorisée peut contourner un marché dans lequel d’autres éditeurs reçoivent une compensation.
Toutefois, l’existence de licences ne tranche pas la question du fair use. Les défendeurs dans les affaires de droit d’auteur soutiennent souvent que les titulaires de droits ne peuvent pas transformer chaque usage transformateur en marché contrôlé simplement en proposant des licences. Sinon, la décision de vendre une autorisation pourrait prédéterminer la nécessité juridique de cette autorisation.
Les journaux doivent démontrer davantage qu’un manque à gagner hypothétique. Ils doivent expliquer comment les usages contestés affectent les marchés établis ou raisonnablement prévisibles pour leurs œuvres. Les éléments relatifs aux négociations de licences, à la substitution de produits, aux pertes de trafic de renvoi et au comportement des abonnés deviendront importants.
OpenAI et Microsoft souligneront probablement la différence entre un arrangement commercial volontaire et une obligation légale. Ils pourront faire valoir que certaines entreprises concèdent des licences de contenu pour améliorer leurs produits, obtenir des flux fiables ou afficher des contenus attribués, même lorsque l’entraînement lui-même demeure un fair use.
Les allégations concernant les résultats générés pourraient une fois encore s’avérer plus déterminantes que l’existence de copies utilisées pour l’entraînement. Un modèle qui exploite des schémas appris à partir du journalisme soulève une question de marché. Un service qui renvoie des passages reconnaissables, résume une enquête réservée aux abonnés ou attribue à tort un contenu inventé en soulève une autre.
La fausse attribution fait également sortir le différend du seul cadre des clics perdus. La plainte affirme que du contenu généré a été associé au Seattle Times ou à Newsday alors même que les éditeurs ne l’avaient pas créé. Ce comportement allégué menace la confiance dans la marque, que les organisations de presse locale construisent grâce à l’exactitude et à la responsabilité.
Le rôle de Microsoft fera l’objet d’une attention particulière. L’entreprise n’est pas un simple investisseur extérieur. Elle a intégré les modèles d’OpenAI dans les produits Copilot et Bing, fourni l’infrastructure et conservé un intérêt économique substantiel dans ce partenariat.
La plainte indique que Microsoft a engagé environ 13 milliards de dollars dans OpenAI à partir de 2019. Elle cite également l’annonce des entreprises d’octobre 2025 selon laquelle Microsoft détenait un investissement évalué à environ 135 milliards de dollars, représentant près de 27 % sur une base diluée.
Ces chiffres proviennent du dépôt des plaignants et des communications d’entreprise qu’il cite. Ils expliquent pourquoi Microsoft figure parmi les défendeurs, mais l’investissement seul n’établit pas la responsabilité. Les éditeurs doivent relier Microsoft aux copies alléguées, au contrôle, au fonctionnement des produits ou aux résultats contrefaisants au regard de chaque théorie juridique.
Les plaignants cherchent à présenter les produits Microsoft OpenAI comme un système commercial intégré. Microsoft peut contester cette caractérisation en distinguant les entités juridiques, les responsabilités techniques et le comportement propre à chaque produit. La phase de communication des preuves devrait préciser qui a constitué les jeux de données, qui contrôlait le crawling et quels systèmes ont généré les réponses citées.
Ces éléments façonneront également toute réparation. Détruire un article stocké est plus simple que retirer son influence d’un modèle entraîné. Si plusieurs jeux de données, générations de modèles et couches de produits sont concernés, les plaignants devront identifier quels actifs contiennent des copies susceptibles de recours et pourquoi des contrôles plus ciblés seraient insuffisants.
Le paysage des licences joue donc dans les deux sens. Il soutient l’argument selon lequel le contenu journalistique possède une valeur commerciale mesurable. Il souligne aussi la nécessité d’analyser chaque usage plutôt que de traiter tout accès à du contenu publié comme juridiquement identique.
Trois signaux indiqueront si l’affaire transforme l’édition à l’ère de l’IA
La prochaine phase dépendra du regroupement des procédures, des preuves techniques et de la distinction opérée par le tribunal entre l’entraînement et les résultats visibles par les utilisateurs.
Le premier signal sera de savoir si cette action rejoint les procédures multidistrict existantes impliquant The New York Times et d’autres éditeurs. Des affaires connexes ont déjà été coordonnées devant le juge fédéral Sidney Stein, à Manhattan.
Le regroupement peut réduire la duplication de la phase de communication des preuves et les décisions contradictoires. Il peut également placer les nouveaux plaignants au sein d’un litige déjà mûr, dans lequel les deux parties ont développé des arguments sur les jeux de données, les résultats, le fair use et le préjudice de marché.
Une procédure coordonnée renforcerait l’idée qu’il s’agit d’un affrontement juridique à l’échelle du secteur. Une procédure distincte laisserait davantage de place aux faits propres aux éditeurs régionaux, aux paywalls, à l’économie de l’information locale et à la relation de Microsoft avec son journal local.
Le deuxième signal sera ce que la communication des preuves révélera sur la provenance des contenus. La plainte allègue que des contenus du Seattle Times figuraient parmi les domaines les plus importants utilisés pour un ancien jeu de données d’OpenAI. Elle affirme également que des modèles ultérieurs ont intégré le travail des deux éditeurs via des jeux de données web, des index de recherche et d’autres sources.
OpenAI a divulgué davantage d’informations sur les jeux de données de ses premiers modèles que sur ses systèmes récents. Cette opacité rend la provenance difficile à établir à partir des seuls documents publics. Les dossiers internes pourraient montrer si les articles des éditeurs ont été intégrés à des jeux de données précis, comment les copies ont été traitées et si des systèmes ultérieurs les récupéraient directement.
La communication des preuves pourrait également tester l’importance de l’exemple de 88 mots. Les parties examineront si des requêtes ordinaires produisent des passages similaires, si des garde-fous empêchent les répétitions et si le résultat provenait de données d’entraînement mémorisées ou de contenus récupérés.
Des reproductions fréquentes et faciles à obtenir renforceraient l’argument des éditeurs sur la substitution. Des résultats rares, créés par des requêtes inhabituellement ciblées, étayeraient l’argument de la défense selon lequel un comportement exceptionnel ne devrait pas déterminer la légalité d’une technologie entière.
Le troisième signal sera la manière dont le tribunal dissociera la copie des données d’entrée du résultat public. La position du ministère de la Justice privilégie une forte protection au titre du fair use pour l’entraînement tout en laissant la place à des réclamations portant sur des œuvres reconstituées. Une décision adoptant cette distinction réduirait les possibilités des éditeurs sans les éliminer.
Un tel résultat déplacerait l’attention vers les filtres de sortie, les autorisations de récupération, l’attribution des sources et la rémunération des contenus affichés. Il pourrait encourager les développeurs à maintenir des frontières plus solides entre l’entraînement des modèles et les systèmes qui récupèrent ou citent des documents en direct.
Une décision traitant l’entraînement et les résultats concurrentiels comme un seul processus commercial intégré créerait un risque accru pour les entreprises d’IA. Elle renforcerait également la position des éditeurs cherchant à obtenir des licences à la fois pour les données archivées et pour un accès continu.
La demande de destruction reste la mesure réparatrice la plus lourde d’enjeux. Les tribunaux adaptent généralement les injonctions aux violations prouvées. Exiger le retrait de modèles complets nécessiterait de démontrer que des mesures plus limitées ne peuvent pas offrir une réparation adéquate.
Cela rend une fermeture immédiate peu probable au stade initial. Parmi les résultats plus réalistes à court terme figurent une phase de communication des preuves contestée, des garde-fous au niveau des produits, des discussions de licence ou des ordonnances visant des copies et résultats identifiables. La réparation finale dépend de faits qui ne sont pas encore publics.
Les développeurs devraient surveiller si l’affaire produit des normes plus claires pour le suivi des sources. Les acheteurs d’entreprise devraient demander aux fournisseurs comment des contenus protégés parviennent jusqu’aux réponses générées. Les éditeurs devraient distinguer les négociations portant sur l’entraînement, la récupération, la citation, l’attribution et le trafic de renvoi, plutôt que de les traiter comme une seule autorisation.
Les travailleurs du savoir disposent d’un test plus simple. Lorsqu’une réponse générée par l’IA remplace une source, l’utilisateur peut-il encore identifier et évaluer le travail de reportage qui la sous-tend ? Si ce n’est pas le cas, la commodité a supprimé les informations nécessaires pour juger de l’exactitude, de la propriété et du contexte.
Le procès Microsoft OpenAI comptera surtout s’il oblige les tribunaux à tracer des frontières applicables entre ces étapes. D’ici là, ni les affirmations générales de vol ni les affirmations générales de fair use ne répondent à toutes les questions.
Surveillez le dossier judiciaire, les éléments produits lors de la communication des preuves et toute discussion de licence au cours des trois prochains mois. Ensemble, ces signaux montreront si cette affaire modifie les règles de l’entraînement de l’IA ou concentre la responsabilité sur des résultats précis. Les lecteurs devraient également continuer à consulter et à évaluer les reportages originaux lorsqu’un système d’IA résume une actualité locale importante.



