Le procès de Naver sur les droits d’auteur liés à l’IA dépend de ce que ses contrats d’information autorisaient réellement
Naver a défendu devant les tribunaux ses pratiques d’entraînement de l’IA, malgré les accusations de trois chaînes de télévision selon lesquelles leurs articles auraient été utilisés sans autorisation. Le procès de Naver sur les droits d’auteur liés à l’IA porte désormais sur la question de savoir si d’anciens contrats de partage d’actualités autorisaient des usages que les éditeurs affirment n’avoir jamais consciemment approuvés.
KBS, MBC et SBS ont poursuivi Naver en janvier 2025 pour des contenus qui auraient servi à entraîner HyperCLOVA et HyperCLOVA X. Elles demandent des dommages-intérêts et une décision interdisant tout entraînement ultérieur à partir de leurs contenus d’actualité.
Naver a déclaré au tribunal central de Séoul que des clauses contractuelles couvrant la recherche, le développement de services et l’extraction de phrases autorisaient cet usage. Selon une couverture du 8 septembre, l’entreprise soutient que ces accords la protègent contre les demandes des chaînes.
Cette défense crée un litige plus précis que l’argument habituel sur la qualification de l’apprentissage automatique au regard de l’usage équitable. Le tribunal doit aussi déterminer ce que les parties avaient concédé sous licence avant que l’IA générative ne devienne une catégorie commerciale définie.
Les chaînes estiment qu’une autorisation de diffuser des actualités via Naver ne valait pas permission de construire un modèle de langage commercial. Naver affirme que les contrats prévoyaient un traitement technique plus large, même s’ils ne mentionnaient pas les grands modèles de langage.
La distinction dépasse le cadre d’un seul procès sud-coréen. Les entreprises technologiques détiennent souvent des années de contenus sous licence, obtenus dans le cadre d’accords rédigés avant l’apparition des systèmes d’IA actuels. Si de larges clauses de développement couvrent l’entraînement des modèles, ces contrats deviennent des moyens de défense précieux. Si un consentement éclairé était requis, les entreprises font face à de nouveaux coûts de licence et à d’éventuelles restrictions.
Naver affirme que ses contrats couvraient l’entraînement de l’IA
Le changement immédiat n’est pas un nouveau procès, mais une défense contractuelle plus détaillée de Naver après des mois d’examen judiciaire.
MLex a rapporté le 8 septembre 2026 que Naver avait de nouveau déclaré au tribunal sud-coréen que son usage était conforme aux contrats de partage de contenus. L’audience faisait suite à une importante procédure en août, centrée sur la négociation de ces accords.
Le litige a commencé lorsque KBS, MBC et SBS ont accusé Naver d’avoir utilisé leurs articles d’actualité pour entraîner HyperCLOVA et HyperCLOVA X. Les chaînes ont engagé des actions pour violation de droits d’auteur, concurrence déloyale et d’autres griefs connexes devant le tribunal central de Séoul.
Selon la presse coréenne, les chaînes réclamaient initialement 200 millions de wons chacune, soit 600 millions de wons au total. Elles demandent également une injonction interdisant l’entraînement à partir des contenus contestés.
Ces montants ne reflètent pas toute l’importance commerciale de l’affaire. Une injonction ou une interprétation restrictive pourrait affecter les données déjà intégrées au processus de développement des modèles de Naver.
Les chaînes représentent les trois principaux réseaux de télévision terrestre sud-coréens. La Korean Broadcasters Association, qui représente 39 diffuseurs, a soutenu l’action et avait auparavant demandé l’ouverture de discussions distinctes sur une compensation liée à l’IA.
Selon le dépôt initial de la plainte, l’association avait informé Naver, Kakao et Google Korea de sa position en décembre 2023. Elle affirmait que les contenus d’actualité exigeaient une autorisation et une compensation distinctes lorsqu’ils étaient utilisés pour l’apprentissage de l’IA.
Le groupe de travail de l’association a ensuite demandé des informations sur les sources de Naver, ses matériaux d’entraînement et ses méthodes d’acquisition. Il a déclaré que Naver n’avait pas fourni d’explication claire.
Naver avait d’abord indiqué devoir examiner la plainte avant de présenter une position détaillée. Sa défense devant le tribunal est depuis devenue plus précise.
Naver invoque des dispositions de ses accords relatives à la recherche, au développement de nouveaux services et au traitement technique. L’entreprise cite également des références contractuelles à une plateforme d’IA et à l’extraction de phrases.
L’extraction de phrases peut désigner le prélèvement de passages individuels dans des documents plus vastes à des fins d’indexation, d’analyse ou d’un autre processus informatique. Naver affirme que ce terme visait un traitement de données associé à l’apprentissage automatique.
Les chaînes rejettent cette interprétation. Elles soutiennent que l’extraction de texte pour un service d’actualité existant diffère de la copie d’articles dans un corpus d’entraînement de modèle.
Cette différence crée la question contractuelle centrale. L’autorisation de traiter des contenus ne répond pas automatiquement à la question des finalités de traitement acceptées par les parties.
Naver affirme aussi que certains reportages factuels ne bénéficient pas d’une protection complète au titre du droit d’auteur sud-coréen. L’entreprise a demandé aux chaînes d’identifier les expressions protégées et les œuvres précises sur lesquelles reposent leurs demandes.
Les chaînes répondent que leurs articles ont une valeur économique et comportent des choix, une structure et une expression protégeables. Elles qualifient la copie présumée par Naver d’usage commercial systématique, et non de référence accessoire à des faits isolés.
Aucune décision définitive n’a établi quelle interprétation prévaut. L’audience de septembre a prolongé un différend en cours, sans trancher la responsabilité de Naver.
Le procès de Naver sur les droits d’auteur liés à l’IA met les deux parties sous pression
Les chaînes doivent démontrer que les droits ordinaires de diffusion d’actualités s’arrêtent avant l’entraînement des modèles, tandis que Naver doit justifier une lecture plus large d’anciens contrats.
Pour Naver, la pression immédiate porte sur le fondement juridique de son programme d’IA en langue coréenne. HyperCLOVA X dépend d’importantes collections de contenus en coréen, en anglais et de code.
Naver n’a pas identifié publiquement les articles contestés présents dans son corpus d’entraînement. La documentation publiée sur ses modèles décrit les catégories de données à un niveau plus général.
Le rapport technique de l’entreprise publié en 2024 indique que HyperCLOVA X a utilisé un mélange équilibré de données coréennes, anglaises et de code. Il ne recense pas publiquement chaque publication représentée dans ce mélange.
Ce manque de transparence pose un problème concret aux chaînes. Elles doivent établir une atteinte sans disposer d’un accès complet aux registres d’entraînement de Naver.
Elles auraient présenté des réponses générées par HyperCLOVA X comme preuve que des contenus de diffuseurs avaient été utilisés. Naver a contesté cette méthode, car les modèles de langage peuvent produire des déclarations peu fiables sur leur propre entraînement.
La réponse d’un modèle concernant ses sources de données ne constitue pas une trace d’audit fiable. Les grands modèles de langage génèrent du texte probable plutôt qu’ils ne récupèrent un inventaire vérifié de leurs documents d’entraînement.
Le tribunal fait donc face à un défi probatoire, parallèlement au différend juridique. Il doit déterminer comment les plaignants peuvent identifier les œuvres copiées lorsque le défendeur contrôle les registres de données pertinents.
Naver a soutenu que les chaînes n’avaient pas suffisamment précisé quelles œuvres avaient été enfreintes. Les chaînes affirment que l’ampleur inhabituelle et l’opacité de l’entraînement de l’IA rendent une plus grande précision difficile.
Il ne s’agit pas seulement d’un désaccord procédural. La partie qui contrôle les registres d’entraînement peut détenir un avantage probatoire décisif avant qu’un tribunal n’ordonne leur divulgation.
Les chaînes subissent elles aussi leur propre pression. Elles ont distribué leurs contenus via Naver pendant des années et accepté des accords autorisant des usages techniques allant au-delà du simple affichage.
Un tribunal pourrait conclure qu’un libellé large relatif au développement couvrait l’apprentissage automatique tel qu’il existait au moment de la signature des contrats. Les chaînes devraient alors s’appuyer sur une autre théorie juridique pour distinguer l’entraînement génératif du développement sous licence de la plateforme.
Leur position exige aussi de distinguer différents types d’actualités. Le droit d’auteur sud-coréen exclut de la protection certains comptes rendus d’événements d’actualité constitués d’une simple communication de faits.
Cette exclusion ne signifie pas que tout article d’actualité est dépourvu de protection. Le reportage peut comporter une expression originale, une analyse, une organisation, des photographies et d’autres éléments créatifs.
Naver a insisté sur cette distinction en demandant aux plaignants d’identifier les éléments protégeables. Cette approche peut réduire une demande de masse à des questions examinées article par article.
Les chaînes mettent plutôt l’accent sur la valeur commerciale du corpus constitué. Leur demande considère l’ensemble de données comme une ressource assemblée grâce à l’investissement des rédactions, et non comme une simple liste de faits publics.
Le résultat met les deux parties sous pression pour produire des preuves qu’elles n’ont pas entièrement divulguées publiquement. Naver doit relier le libellé contractuel à l’activité d’entraînement précise. Les chaînes doivent relier les œuvres protégées aux modèles.
D’anciens contrats face à un nouveau type d’usage commercial
L’affaire dépend de la question de savoir si une vaste autorisation technique peut s’étendre de l’amélioration d’une plateforme d’actualité à l’entraînement d’un modèle génératif réutilisable.
Les accords concernés ne sont pas nés à l’ère de ChatGPT. Les témoignages ont examiné des dispositions et des conditions particulières négociées entre 2017 et 2020.
Naver affirme que les références à Clova, aux plateformes d’IA, à la recherche et à l’extraction de phrases avaient informé les chaînes. L’entreprise soutient que l’apprentissage automatique était déjà bien connu lorsque les parties ont négocié ces conditions.
Un salarié de Naver impliqué dans les partenariats d’information entre 2016 et 2023 a témoigné lors de la sixième audience. Il a déclaré que les discussions avaient eu lieu par e-mail, lors de réunions et par téléphone.
Le témoin a maintenu que Naver avait suffisamment expliqué la nature particulière de sa plateforme d’IA. Il a également déclaré que les équipes juridiques des chaînes avaient examiné de près le libellé contractuel et soulevé des questions lorsque les conditions n’étaient pas claires.
Les chaînes ont contesté que ces discussions aient porté sur l’entraînement de modèles génératifs. Elles ont souligné que des termes tels que grand modèle de langage et IA générative n’apparaissaient pas dans les accords.
Le compte rendu de l’audience d’août décrit une clause de 2020 autorisant Naver à utiliser les informations pour la recherche, l’amélioration des services et le développement de nouveaux services. Les organisations médiatiques se sont opposées à son caractère étendu, et Naver a par la suite ajouté une exigence de consentement préalable.
Cette révision complique les deux récits. Naver peut invoquer un processus contractuel établi concernant l’usage technique. Les chaînes peuvent soutenir que l’exigence de consentement ajoutée ultérieurement montre qu’un usage sans restriction était inacceptable.
Naver aurait également affirmé que des droits plus étendus avaient entraîné des paiements plus élevés aux chaînes. Lors d’une audience antérieure, l’entreprise a déclaré que les paiements avaient augmenté de 50 % et atteint plusieurs centaines de millions de wons sur cinq ans.
Ces chiffres restent des éléments de la position défendue par Naver devant le tribunal, et non une constatation judiciaire sur ce que les paiements achetaient. Un paiement plus important ne prouve pas un consentement à l’IA, sauf si le contrat ou les archives de négociation établissent le lien entre les deux.
Les chaînes se concentrent sur le contexte technologique et commercial. Elles affirment que les discussions antérieures à 2020 ont eu lieu avant que ChatGPT ne fasse des systèmes génératifs à usage général un marché identifiable.
L’apprentissage automatique était certes déjà établi à cette époque. Toutefois, classifier des articles ou améliorer la recherche diffère économiquement de l’entraînement d’un modèle capable de générer de nouveaux textes dans de nombreux services.
C’est le compromis central du procès. Le libellé contractuel doit rester suffisamment souple pour couvrir l’évolution technique normale, tout en étant assez précis pour préserver des limites significatives.
Un accord énumérant chaque future méthode informatique deviendrait rapidement obsolète. Une clause de développement illimitée pourrait également transférer des droits imprévus sans que l’éditeur ne comprenne la contrepartie.
Les tribunaux interprètent souvent les contrats à partir de leur texte, de leur objet, de l’historique des négociations et du comportement des parties. Le litige Naver concentre ces quatre examens autour d’une technologie dont le rôle sur le marché a rapidement évolué.
Naver relie les contrats à Clova et à des travaux établis dans le domaine de l’IA. Les diffuseurs les relient à la distribution d’informations et à l’amélioration des services, non au développement de modèles généralistes.
Les commentaires de la cour en août ont accru l’incertitude pour Naver. Après avoir entendu les témoignages, les juges ont indiqué que l’entraînement d’IA générative n’avait probablement pas été expliqué spécifiquement aux diffuseurs.
Cette observation ne constituait pas une décision définitive. Elle affaiblit néanmoins toute affirmation simple selon laquelle les contrats avaient clairement réglé la question.
La défense présentée en septembre semble conçue pour maintenir les accords écrits au centre du débat. Naver soutient qu’une autorisation contractuelle peut exister sans explication détaillée de chaque architecture de modèle future.
Les diffuseurs doivent amener la cour à adopter une frontière plus restrictive. Leur argument repose sur l’idée que l’entraînement des modèles est suffisamment distinct pour exiger une autorisation séparée et éclairée.
Les défenses fondées sur le droit d’auteur et les contrats remplissent des fonctions différentes
Même si Naver perd son argument contractuel, l’entreprise peut encore contester la protection par le droit d’auteur, la copie, l’usage loyal et la concurrence déloyale.
Le débat public réduit souvent les affaires de droit d’auteur liées à l’IA à une seule question : l’entraînement relève-t-il de l’usage loyal ? Cette procédure comporte plusieurs questions qui fonctionnent indépendamment les unes des autres.
Premièrement, la cour doit déterminer si les diffuseurs détiennent les droits d’auteur sur les œuvres qu’ils identifient. Les faits bruts et les reportages élémentaires sur l’actualité bénéficient d’un traitement différent des reportages originaux exprimant une créativité propre.
Deuxièmement, les diffuseurs doivent établir que des éléments protégés ont intégré le processus d’entraînement de Naver. Cette question dépend d’éléments de preuve concernant les jeux de données, le prétraitement, la conservation et le développement des modèles.
Troisièmement, la cour doit interpréter les contrats de partage de contenu. Si ces accords autorisaient l’usage concerné, les demandes pour violation du droit d’auteur peuvent échouer sans qu’une décision générale sur l’entraînement de l’IA soit nécessaire.
Quatrièmement, la cour peut examiner les limitations légales telles que l’usage loyal. La disposition sur l’usage loyal de la Corée du Sud prend en compte la finalité de l’usage, la nature de l’œuvre, la quantité utilisée et les effets sur le marché.
Ces facteurs empêchent toute réponse automatique. L’entraînement peut transformer le texte en paramètres statistiques de modèle, mais il nécessite aussi de copier des éléments lors de la préparation des données et des calculs.
Une finalité commerciale n’exclut pas automatiquement l’usage loyal. Elle peut peser contre un défendeur lorsqu’elle s’ajoute à une copie étendue et à une atteinte à un marché de licences.
Les diffuseurs mettront probablement l’accent sur la substitution et les opportunités de licence perdues. Ils affirment que les développeurs d’IA devraient négocier une rémunération distincte pour accéder à la production des rédactions.
Naver peut soutenir que l’entraînement produit un modèle linguistique général plutôt qu’une base de données fournissant des copies d’articles. L’entreprise peut également distinguer le traitement fonctionnel de la publication des œuvres sources.
Le comportement des résultats demeure pertinent. Un système qui reproduit des passages protégés présente un risque différent de celui qui utilise le contenu sans restituer une expression reconnaissable.
Les éléments publics ne permettent pas d’établir à quelle fréquence HyperCLOVA X reproduit des articles de diffuseurs. Ils ne révèlent pas non plus la quantité de contenu qui aurait été incluse.
Cette incertitude limite les conclusions catégoriques sur le préjudice au marché. Elle explique aussi pourquoi l’interprétation contractuelle est devenue une défense si attractive pour Naver.
Un contrat peut offrir une voie plus claire que la définition de l’usage loyal pour une technologie entière. La cour pourrait rendre une décision étroite fondée sur les accords de ces parties.
Toutefois, même une décision contractuelle limitée influencerait d’autres négociations. Les plateformes et les éditeurs examineraient des clauses similaires à la recherche de références à la recherche, à l’extraction, au développement de services et à l’apprentissage automatique.
Naver reconnaît elle-même que le litige comporte un risque significatif. Sa circulaire d’offre de 2026 mentionne l’action engagée par les diffuseurs et indique que son issue demeure incertaine.
Le document indique que les plaignants allèguent une utilisation non autorisée de contenus d’actualité pour l’entraînement d’IA générative. Il consigne leurs demandes de dommages-intérêts et de mesures injonctives.
Naver avertit également les investisseurs que des décisions défavorables en matière de propriété intellectuelle peuvent entraîner des dommages-intérêts, des obligations de licence, des changements de pratiques commerciales ou l’arrêt de services. Cette formulation constitue une information générale sur les risques, non une prédiction concernant cette affaire.
Elle contredit néanmoins toute impression selon laquelle la défense contractuelle aurait déjà éliminé toute exposition. Naver a présenté une défense, et les diffuseurs la contestent activement.
Les éditeurs mettent à l’épreuve leur pouvoir de négociation de licences, pas seulement la propriété
L’enjeu plus large concerne la capacité à fixer les conditions d’accès à des données d’entraînement de grande valeur après des années de distribution par les plateformes.
KBS, MBC et SBS sont à la fois propriétaires de contenus et participants de longue date à la plateforme d’actualités de Naver. Cette relation distingue le litige des affaires portant sur des contenus collectés sur le web ouvert.
Les diffuseurs n’ont pas simplement découvert leurs articles sur un service sans lien avec eux. Ils disposaient de contrats régissant la fourniture, l’affichage, le traitement technique et la rémunération.
Ces accords donnaient à Naver un accès légal aux contenus. La question non résolue est de savoir si un accès légal à une fin donnée s’est transformé en autorisation pour une autre.
Ce schéma se reproduira partout où des entreprises technologiques entretiennent des partenariats approfondis avec des détenteurs de contenus. Les moteurs de recherche, agrégateurs, fournisseurs cloud et plateformes d’entreprise possèdent souvent des archives sous licence collectées selon des conditions plus anciennes.
L’IA générative accroît la valeur de ces archives. Un langage cohérent et professionnellement édité peut servir à l’entraînement, aux systèmes de recherche, à l’évaluation et au développement de produits.
Les éditeurs cherchent désormais à séparer ces usages de la distribution ordinaire. Leur objectif de négociation ne se limite pas à obtenir des dommages-intérêts pour des copies passées.
Une décision exigeant une autorisation spécifique pour l’IA renforcerait les demandes de nouvelles licences. Elle encouragerait aussi des clauses détaillées couvrant l’entraînement, l’ajustement fin, la recherche, l’évaluation, la conservation et les résultats générés.
Une décision favorable à Naver offrirait une autre voie aux plateformes. Les entreprises pourraient s’appuyer sur de larges clauses de recherche ou de développement de services lorsque ces termes et les négociations qui les entourent étayent leur interprétation.
Aucune de ces issues ne créerait une règle universelle. La rédaction des contrats varie, tout comme les modalités de paiement et les communications entre partenaires.
L’affaire recoupe également les efforts continus de la Corée du Sud pour clarifier sa politique de droit d’auteur appliquée à l’IA. Les travaux gouvernementaux ont envisagé des règles sur la fouille de textes et de données, la divulgation des données d’entraînement et les systèmes d’identification des informations relatives aux droits.
En février 2026, le ministère de la Culture, des Sports et du Tourisme a publié des orientations sur l’usage loyal dans l’entraînement d’IA générative. Ces orientations peuvent structurer l’analyse, mais les tribunaux déterminent toujours comment la loi s’applique aux faits contestés.
Le litige coréen présente également des parallèles internationaux. Des organisations de presse ont poursuivi OpenAI et Microsoft aux États-Unis, tandis que d’autres éditeurs ont signé des accords de licence avec des entreprises d’IA.
Ces stratégies poursuivent le même actif rare par des voies différentes. Le contentieux cherche à établir un contrôle après un usage allégué, tandis que les licences transforment l’accès en relation commerciale négociée.
La position de Naver est inhabituelle, car l’entreprise affirme que la négociation a déjà eu lieu. Les diffuseurs répondent que l’accord n’a jamais inclus l’usage aujourd’hui en cause.
Ce désaccord rend le processus de contractualisation aussi important que la formulation finale. Les éléments de preuve relatifs aux présentations, e-mails, révisions, questions et paiements peuvent montrer ce que chaque partie comprenait raisonnablement.
La cour avait précédemment refusé de convoquer un haut dirigeant de Naver demandé par les diffuseurs. Elle a plutôt entendu un employé impliqué dans les partenariats d’actualité.
Lors de l’audience d’août, la cour a indiqué que les diffuseurs pouvaient poursuivre en partant du principe que l’entraînement de modèles génératifs n’avait pas été expliqué spécifiquement. Elle a laissé ouverte la possibilité de témoignages supplémentaires d’employés impliqués dans l’accord SBS de 2020.
Ce choix procédural maintient un débat resserré. Les juges semblent s’intéresser à ce que les équipes chargées des contrats ont communiqué, et non aux déclarations publiques générales sur l’IA.
Naver affirme que les diffuseurs suivaient de près la technologie et comprenaient l’importance croissante de l’apprentissage automatique après le match d’AlphaGo en 2016. Les diffuseurs soutiennent qu’une connaissance générale de l’IA ne peut se substituer à une autorisation.
La différence est fondamentale. Savoir qu’un partenaire développe de l’IA ne signifie pas nécessairement accorder une licence de contenu aux fins d’entraînement.
L’inverse est également vrai. Un contrat ne devient pas inopérant simplement parce qu’une technologie ultérieure commercialise plus efficacement un usage technique anticipé.
La cour doit situer les faits entre ces deux pôles. Cette tâche fait de l’affaire un litige contractuel aux conséquences en matière de droit d’auteur, et non un simple nouveau référendum sur l’IA.
Trois signaux indiqueront quel argument l’emporte
La prochaine phase devrait montrer si la cour privilégie le texte contractuel, le consentement éclairé ou les éléments de preuve provenant du pipeline d’entraînement réel de Naver.
Le premier signal sera constitué par d’éventuels témoignages supplémentaires ou éléments documentaires relatifs aux négociations du contrat de 2020. La cour avait auparavant évoqué la possibilité d’entendre deux employés de SBS impliqués dans ce processus.
Des e-mails ou projets établissant explicitement un lien entre des clauses de recherche et l’entraînement de modèles renforceraient la défense de Naver. Des documents montrant l’absence d’une telle discussion étayeraient l’interprétation plus restrictive des diffuseurs.
Le deuxième signal sera de savoir si la cour ordonne ou reçoit des éléments plus détaillés sur les données d’entraînement. Les plaignants ont besoin d’un lien crédible entre leurs œuvres protégées et des modèles précis de Naver.
Un inventaire des jeux de données, un enregistrement du prétraitement ou une description de l’usage interne aurait plus de poids que la réponse d’un modèle sur son propre entraînement. L’absence de tels éléments préserverait la contestation par Naver de la preuve apportée par les diffuseurs.
Le troisième signal résidera dans la manière dont les juges ordonnent l’interprétation du contrat et l’usage loyal. Une décision fondée sur le contrat pourrait résoudre une grande partie du litige sans établir de règle générale sur l’entraînement de l’IA.
Une analyse plus large de l’usage loyal intéresserait les entreprises ne disposant pas d’accords de partage de contenus. Elle influencerait également les éditeurs sud-coréens envisageant des actions contre d’autres fournisseurs technologiques.
Les lecteurs devraient éviter de considérer la position de Naver en septembre comme une victoire. L’entreprise affirme que ses contrats constituent une autorisation, mais la cour n’a pas accepté cette conclusion.
La procédure d’août a révélé une faiblesse dans le récit de Naver. Les juges ont semblé peu convaincus que l’entraînement d’IA générative avait été spécifiquement expliqué lors de la conclusion des accords.
Cette faiblesse n’invalide pas automatiquement une autorisation contractuelle large. Elle rend toutefois l’historique des négociations et le libellé exact plus importants.
Le procès Naver sur le droit d’auteur appliqué à l’IA deviendra particulièrement déterminant si la cour sépare l’accès de l’autorisation. Une entreprise peut recevoir légalement un contenu tout en dépassant l’objectif autorisé pour son utilisation.
Les développeurs et acheteurs d’entreprise devraient surveiller cette distinction dans leurs propres accords relatifs aux données. Un droit général d’analyser ou d’améliorer un service peut ne pas couvrir clairement l’entraînement de modèles fondamentaux.
Les éditeurs devraient examiner les mêmes clauses avant de supposer qu’ils ont conservé tous les droits liés à l’IA. Les définitions existantes, annexes techniques, avenants et modalités de paiement peuvent modifier l’analyse.
La réponse pratique consiste à assurer une conservation rigoureuse des dossiers. Les équipes ont besoin de jeux de données traçables, d’autorisations documentées, d’usages définis et d’un processus permettant de respecter les restrictions ultérieures.
Pour toute personne évaluant des systèmes d’IA, la question finale est concrète : le fournisseur peut-il montrer d’où proviennent ses droits d’entraînement et ce qu’ils autorisaient réellement ? Naver affirme que sa réponse se trouve dans des contrats signés il y a des années. Les diffuseurs soutiennent que ces accords n’ont jamais autorisé l’usage commercial actuellement examiné par la cour. Les documents, l’historique des négociations et les éléments de preuve relatifs à l’entraînement détermineront quelle version prévaut.



