La demanda de copyright contra la IA de Naver depende de lo que realmente permitían sus contratos de noticias
Naver defendió sus prácticas de entrenamiento de IA ante los tribunales, pese a que tres cadenas afirman que sus artículos se utilizaron sin permiso. La demanda de copyright contra la IA de Naver se centra ahora en si antiguos contratos de distribución de noticias autorizaron usos que, según los editores, nunca aprobaron de forma consciente.
KBS, MBC y SBS demandaron a Naver en enero de 2025 por material presuntamente utilizado para entrenar HyperCLOVA y HyperCLOVA X. Solicitan daños y perjuicios y una orden que detenga futuros entrenamientos con su contenido informativo.
Naver declaró ante el Tribunal Central de Distrito de Seúl que el lenguaje contractual relativo a investigación, desarrollo de servicios y extracción de frases permitía su uso. Según la cobertura del 8 de septiembre, la empresa sostuvo que estos acuerdos la protegen frente a las reclamaciones de las cadenas.
Esa defensa crea una disputa más precisa que el conocido debate sobre si el aprendizaje automático puede considerarse uso legítimo. El tribunal también debe decidir qué licenciaron las partes antes de que la IA generativa se convirtiera en una categoría comercial definida.
Las cadenas sostienen que la autorización para distribuir noticias a través de Naver no equivalía a permiso para construir un modelo lingüístico comercial. Naver argumenta que los contratos anticipaban un procesamiento técnico más amplio, aunque no mencionaran los grandes modelos de lenguaje.
La distinción importa más allá de una sola demanda coreana. Las empresas tecnológicas suelen poseer años de material licenciado bajo acuerdos redactados antes de que existieran los sistemas actuales de IA. Si cláusulas amplias de desarrollo cubren el entrenamiento de modelos, esos contratos se convierten en defensas valiosas. Si se requería consentimiento informado, las empresas afrontan nuevos costes de licencias y posibles restricciones.
Naver afirma que sus contratos cubrían el entrenamiento de IA
El cambio inmediato no es una nueva demanda, sino una defensa contractual más desarrollada por parte de Naver tras meses de escrutinio judicial.
MLex informó el 8 de septiembre de 2026 que Naver volvió a decir al tribunal surcoreano que su uso cumplía los contratos de distribución de contenido. La audiencia siguió a un importante procedimiento de agosto centrado en cómo se negociaron esos acuerdos.
El litigio comenzó cuando KBS, MBC y SBS acusaron a Naver de utilizar sus artículos de noticias para entrenar HyperCLOVA y HyperCLOVA X. Las cadenas presentaron reclamaciones por copyright, competencia desleal y asuntos relacionados ante el Tribunal Central de Distrito de Seúl.
Las cadenas solicitaron originalmente 200 millones de wones cada una, o 600 millones de wones en total, según la prensa coreana. La reparación solicitada también incluye una medida cautelar contra el entrenamiento con el material en disputa.
Esas cantidades no reflejan toda la importancia comercial del caso. Una medida cautelar o una interpretación restrictiva podría afectar a datos ya incorporados en el proceso de desarrollo de modelos de Naver.
Las cadenas representan las tres principales redes de televisión terrestre de Corea del Sur. La Korean Broadcasters Association, que representa a 39 emisoras, apoyó la acción y ya había exigido conversaciones separadas sobre compensación por IA.
Según la demanda inicial, la asociación notificó a Naver, Kakao y Google Korea sobre su postura en diciembre de 2023. Afirmó que el contenido informativo requería permiso y compensación separados cuando se utilizaba para aprendizaje de IA.
Posteriormente, el grupo de trabajo de la asociación solicitó información sobre las fuentes, el material de entrenamiento y los métodos de adquisición de Naver. Afirmó que Naver no ofreció una divulgación clara.
Naver dijo inicialmente que necesitaba revisar la demanda antes de presentar una posición detallada. Desde entonces, su defensa ante el tribunal se ha vuelto más específica.
Naver señala disposiciones de sus acuerdos relativas a investigación, desarrollo de nuevos servicios y procesamiento técnico. También cita referencias contractuales a una plataforma de IA y a la extracción de frases.
La extracción de frases puede describir la toma de pasajes individuales de documentos más extensos para indexación, análisis u otro proceso computacional. Naver sostiene que el término reflejaba un procesamiento de datos asociado al aprendizaje automático.
Las cadenas rechazan esa interpretación. Afirman que extraer texto para un servicio de noticias existente es distinto de copiar artículos a un corpus de entrenamiento de modelos.
Esa diferencia plantea la cuestión contractual central. El permiso para procesar contenido no responde automáticamente qué fines de procesamiento aceptaron las partes.
Naver también sostiene que determinados reportajes factuales no reúnen los requisitos para una protección plena de copyright conforme a la ley coreana. Ha instado a las cadenas a identificar la expresión protegida y las obras específicas que sustentan sus reclamaciones.
Las cadenas responden que sus artículos tienen valor económico y contienen selección, estructura y expresión protegibles. Caracterizan la presunta copia de Naver como un uso comercial sistemático, no como una referencia incidental a hechos aislados.
Ninguna resolución definitiva ha establecido qué interpretación prevalece. La audiencia de septiembre prolongó una disputa activa en lugar de resolver la responsabilidad de Naver.
La demanda de copyright contra la IA de Naver presiona a ambas partes
Las cadenas deben demostrar que los derechos ordinarios de distribución de noticias terminan antes del entrenamiento de modelos, mientras Naver debe justificar una interpretación más amplia de contratos antiguos.
Para Naver, la presión inmediata recae sobre la base jurídica de su programa de IA en coreano. HyperCLOVA X depende de grandes colecciones de material en coreano, inglés y código.
Naver no ha identificado públicamente los artículos en disputa dentro de su corpus de entrenamiento. La documentación publicada de su modelo describe las categorías de datos a un nivel más general.
El informe técnico de la empresa de 2024 dice que HyperCLOVA X utilizó una mezcla equilibrada de datos en coreano, inglés y código. No enumera públicamente todas las publicaciones representadas en esa mezcla.
Esa falta de divulgación plantea un problema práctico para las cadenas. Deben identificar la infracción sin acceso completo a los registros de entrenamiento de Naver.
Según se informa, presentaron respuestas generadas por HyperCLOVA X como prueba de que se había utilizado contenido de las cadenas. Naver cuestionó ese método porque los modelos lingüísticos pueden producir declaraciones poco fiables sobre su propio entrenamiento.
La respuesta de un modelo sobre sus fuentes de datos no es un registro de auditoría fiable. Los grandes modelos de lenguaje generan texto probable en lugar de recuperar un inventario verificado de sus documentos de entrenamiento.
Por tanto, el tribunal se enfrenta a un desafío probatorio junto con la disputa jurídica. Debe determinar cómo pueden los demandantes identificar obras copiadas cuando el demandado controla los registros de datos pertinentes.
Naver ha argumentado que las cadenas no especificaron adecuadamente qué obras fueron infringidas. Las cadenas sostienen que la escala inusual y la opacidad del entrenamiento de IA dificultan una mayor precisión.
Esto es más que un desacuerdo procesal. La parte que controla los registros de entrenamiento puede tener una ventaja probatoria decisiva antes de que un tribunal ordene la divulgación.
Las cadenas también enfrentan presión propia. Distribuyeron contenido a través de Naver durante años y aceptaron acuerdos que permitían usos técnicos más allá de la simple visualización.
Un tribunal podría concluir que un lenguaje amplio sobre desarrollo cubría el aprendizaje automático tal como existía cuando se firmaron los contratos. Entonces, las cadenas necesitarían otra teoría jurídica para separar el entrenamiento generativo del desarrollo licenciado de la plataforma.
Su posición también requiere distinguir entre diferentes tipos de noticias. La ley coreana de copyright excluye de protección determinados informes de actualidad que consisten en una simple comunicación de hechos.
Esa exclusión no significa que todos los artículos de noticias estén desprotegidos. Los reportajes pueden incluir expresión original, análisis, organización, fotografía y otros elementos creativos.
Naver ha insistido en esta distinción al pedir a los demandantes que identifiquen material protegible. Ese enfoque puede reducir una reclamación masiva a cuestiones artículo por artículo.
Las cadenas, en cambio, enfatizan el valor comercial del corpus recopilado. Su reclamación trata el conjunto de datos como un recurso reunido mediante la inversión de las redacciones, no simplemente como una lista de hechos públicos.
El resultado presiona a ambas partes hacia pruebas que no han divulgado plenamente de forma pública. Naver debe conectar el lenguaje contractual con la actividad específica de entrenamiento. Las cadenas deben conectar obras protegidas con los modelos.
Los contratos antiguos se enfrentan a una nueva forma de uso comercial
El caso depende de si un permiso técnico amplio puede extenderse desde la mejora de una plataforma de noticias hasta el entrenamiento de un modelo generativo reutilizable.
Los acuerdos pertinentes no surgieron en la era de ChatGPT. Los testimonios examinaron disposiciones y condiciones especiales negociadas entre 2017 y 2020.
Naver afirma que las referencias a Clova, plataformas de IA, investigación y extracción de frases avisaron a las cadenas. Argumenta que el aprendizaje automático ya era conocido cuando las partes negociaron esas condiciones.
Un empleado de Naver implicado en alianzas de noticias entre 2016 y 2023 declaró durante la sexta audiencia. El empleado dijo que las conversaciones se llevaron a cabo por correo electrónico, reuniones y llamadas telefónicas.
El testigo sostuvo que Naver había explicado adecuadamente la naturaleza especial de su plataforma de IA. También afirmó que los equipos jurídicos de las cadenas revisaron de cerca el lenguaje contractual y plantearon preguntas cuando las condiciones no estaban claras.
Las cadenas cuestionaron que esas conversaciones cubrieran el entrenamiento de modelos generativos. Subrayaron que términos como gran modelo de lenguaje e IA generativa no aparecían en los acuerdos.
El registro de la audiencia de agosto describe una cláusula de 2020 que permitía a Naver utilizar información para investigación, mejora de servicios y desarrollo de nuevos servicios. Las organizaciones de medios objetaron su amplitud, y Naver añadió posteriormente un requisito de consentimiento previo.
Esa revisión complica ambas narrativas. Naver puede señalar un proceso contractual establecido en torno al uso técnico. Las cadenas pueden argumentar que el requisito posterior de consentimiento demuestra que el uso sin restricciones era inaceptable.
Según se informa, Naver también argumentó que derechos más amplios produjeron pagos más elevados a las cadenas. Durante una audiencia anterior, afirmó que los pagos aumentaron un 50 % y alcanzaron cientos de millones de wones durante cinco años.
Esas cifras siguen formando parte de la posición de Naver ante el tribunal, no de una conclusión judicial sobre lo que compraron los pagos. Un pago mayor no establece consentimiento para IA salvo que el contrato o el registro de negociación vincule ambos elementos.
Las cadenas se centran en el contexto tecnológico y comercial. Afirman que las conversaciones previas a 2020 tuvieron lugar antes de que ChatGPT convirtiera los sistemas generativos de propósito general en un mercado reconocible.
El aprendizaje automático ya estaba claramente establecido entonces. Sin embargo, clasificar artículos o mejorar la búsqueda difiere económicamente de entrenar un modelo que puede generar texto nuevo en muchos servicios.
Este es el equilibrio central de la demanda. El lenguaje contractual debe ser lo bastante flexible para cubrir el desarrollo técnico normal, pero también lo bastante específico para preservar límites significativos.
Un acuerdo que enumerara cada futuro método computacional quedaría obsoleto rápidamente. Una cláusula de desarrollo ilimitado también podría transferir derechos imprevistos sin que un editor comprendiera el intercambio.
Los tribunales suelen interpretar los contratos según su texto, finalidad, historial de negociación y conducta de las partes. La disputa de Naver concentra las cuatro cuestiones en torno a una tecnología cuyo papel comercial cambió rápidamente.
Naver vincula los contratos a Clova y al trabajo establecido en IA. Las cadenas los vinculan a la distribución de noticias y la mejora del servicio, no al desarrollo de modelos de propósito general.
Los comentarios del tribunal en agosto aumentaron la incertidumbre para Naver. Tras escuchar los testimonios, los jueces indicaron que probablemente no se había explicado específicamente a las cadenas el entrenamiento de IA generativa.
Esa observación no fue una decisión definitiva. Aun así, debilita cualquier afirmación simple de que los contratos resolvieran claramente la cuestión.
La defensa presentada en septiembre parece diseñada para mantener los acuerdos escritos en el centro del caso. Naver sostiene que puede existir autorización contractual sin una explicación detallada de cada arquitectura de modelo futura.
Las cadenas necesitan que el tribunal adopte un límite más estrecho. Su caso depende de que el entrenamiento de modelos sea lo bastante distinto como para requerir un permiso independiente e informado.
Las defensas de derechos de autor y contrato cumplen funciones distintas
Incluso si Naver pierde el argumento contractual, aún puede cuestionar la protección de derechos de autor, la copia, el uso legítimo y la competencia desleal.
El debate público suele reducir los casos de derechos de autor sobre IA a una sola pregunta: ¿es el entrenamiento un uso legítimo? Esta demanda contiene varias cuestiones que operan de forma independiente.
Primero, el tribunal debe determinar si las cadenas poseen derechos de autor sobre las obras que identifican. Los hechos puros y la información básica sobre acontecimientos actuales reciben un tratamiento distinto al del periodismo original y expresivo.
Segundo, las cadenas deben establecer que material protegido entró en el proceso de entrenamiento de Naver. Esa cuestión depende de pruebas sobre conjuntos de datos, preprocesamiento, conservación y desarrollo de modelos.
Tercero, el tribunal debe interpretar los contratos de intercambio de contenido. Si esos acuerdos autorizaron el uso pertinente, las reclamaciones por infracción de derechos de autor pueden fracasar sin una decisión amplia sobre el entrenamiento de IA.
Cuarto, el tribunal puede examinar limitaciones legales como el uso legítimo. La disposición sobre uso legítimo de Corea del Sur considera la finalidad de un uso, la naturaleza de la obra, la cantidad utilizada y los efectos en el mercado.
Esos factores impiden una respuesta automática. El entrenamiento puede transformar texto en parámetros estadísticos de un modelo, pero también requiere copiar material durante la preparación de datos y el procesamiento.
La finalidad comercial no invalida automáticamente el uso legítimo. Puede pesar en contra de un demandado cuando se combina con una copia extensa y perjuicio a un mercado de licencias.
Las cadenas probablemente harán hincapié en la sustitución y las oportunidades de licencias perdidas. Sostienen que los desarrolladores de IA deberían negociar una compensación independiente por el acceso a la producción de las redacciones.
Naver puede argumentar que el entrenamiento produce un modelo lingüístico general, en lugar de una base de datos que ofrece copias de artículos. También puede diferenciar el procesamiento funcional de la publicación de las obras fuente.
El comportamiento de las respuestas sigue siendo relevante. Un sistema que reproduce pasajes protegidos genera un riesgo distinto al de otro que utiliza material sin devolver una expresión reconocible.
El registro público no establece con qué frecuencia HyperCLOVA X reproduce artículos de las cadenas. Tampoco revela la cantidad de material presuntamente incluida.
Esa incertidumbre limita las conclusiones contundentes sobre el perjuicio de mercado. También explica por qué la interpretación contractual se ha convertido en una defensa tan atractiva para Naver.
Un contrato puede ofrecer una vía más clara que definir el uso legítimo para toda una tecnología. El tribunal podría decidir de manera limitada basándose en los acuerdos entre estas partes.
Sin embargo, incluso una decisión contractual limitada influiría en otras negociaciones. Las plataformas y los editores examinarían cláusulas similares en busca de referencias a investigación, extracción, desarrollo de servicios y aprendizaje automático.
La propia Naver reconoce que el litigio implica un riesgo significativo. Su circular de oferta de 2026 identifica la acción de las cadenas y afirma que su resultado sigue siendo incierto.
La presentación indica que los demandantes alegan un uso no autorizado de contenido informativo para el entrenamiento de IA generativa. Registra sus solicitudes de indemnización monetaria y medidas cautelares.
Naver también advierte a los inversores de que decisiones adversas sobre propiedad intelectual pueden generar indemnizaciones, obligaciones de licencia, cambios en las prácticas empresariales o la discontinuación de servicios. Ese lenguaje es una divulgación general de riesgos, no una predicción sobre este caso.
Aun así, contradice cualquier impresión de que la defensa contractual ya haya eliminado la exposición. Naver ha presentado una defensa y las cadenas la están impugnando activamente.
Los editores están poniendo a prueba el poder de las licencias, no solo la titularidad
La disputa más amplia se refiere a quién puede fijar las condiciones para datos de entrenamiento de alto valor tras años de distribución a través de plataformas.
KBS, MBC y SBS son tanto propietarios de contenido como participantes de larga trayectoria en la plataforma de noticias de Naver. Esa relación distingue esta disputa de los casos que involucran material recopilado de la web abierta.
Las cadenas no se limitaron a descubrir sus artículos en un servicio no relacionado. Tenían contratos que regulaban la entrega, la visualización, el manejo técnico y la compensación.
Esos acuerdos otorgaron a Naver acceso legal al contenido. La cuestión sin resolver es si el acceso legal para un propósito se convirtió en autorización para otro.
Este patrón se repetirá allí donde las empresas tecnológicas mantengan profundas alianzas de contenido. Los motores de búsqueda, agregadores, proveedores de nube y plataformas empresariales suelen poseer archivos bajo licencia recopilados en virtud de condiciones anteriores.
La IA generativa aumenta el valor de esos archivos. Un lenguaje coherente y editado profesionalmente puede respaldar el entrenamiento, los sistemas de recuperación, la evaluación y el desarrollo de productos.
Ahora los editores quieren separar esos usos de la distribución ordinaria. Su objetivo de negociación no se limita a obtener daños por copias pasadas.
Una decisión que exija permiso específico para IA reforzaría las demandas de nuevas licencias. También fomentaría cláusulas detalladas que cubran entrenamiento, ajuste fino, recuperación, evaluación, conservación y resultados generados.
Una decisión favorable a Naver daría a las plataformas otra vía. Las empresas podrían basarse en cláusulas amplias de investigación o desarrollo de servicios cuando esos términos y las negociaciones circundantes respalden su interpretación.
Ninguno de los resultados crearía una regla universal. La redacción contractual varía, al igual que los acuerdos de pago y las comunicaciones entre socios.
El caso también se cruza con el esfuerzo continuo de Corea del Sur por aclarar la política de derechos de autor para la IA. El trabajo gubernamental ha considerado normas sobre minería de texto y datos, divulgación de datos de entrenamiento y sistemas para identificar información sobre derechos.
En febrero de 2026, el Ministerio de Cultura, Deportes y Turismo publicó orientaciones sobre el uso legítimo en el entrenamiento de IA generativa. Las orientaciones pueden organizar el análisis, pero los tribunales aún determinan cómo se aplica la ley a hechos controvertidos.
La disputa coreana también tiene paralelismos internacionales. Organizaciones de noticias han demandado a OpenAI y Microsoft en Estados Unidos, mientras otros editores han firmado acuerdos de licencia con empresas de IA.
Esas estrategias persiguen el mismo activo escaso por vías diferentes. El litigio intenta establecer control después del uso presuntamente realizado, mientras que las licencias convierten el acceso en una relación comercial negociada.
La posición de Naver es inusual porque afirma que la negociación ya tuvo lugar. Las cadenas responden que el acuerdo nunca incluyó el uso actualmente en cuestión.
Ese desacuerdo hace que el proceso de contratación sea tan importante como la redacción final. Las pruebas sobre presentaciones, correos electrónicos, revisiones, preguntas y pagos pueden mostrar qué entendió razonablemente cada parte.
El tribunal rechazó anteriormente citar a un alto ejecutivo de Naver solicitado por las cadenas. En su lugar, escuchó a un empleado involucrado en el trabajo de alianzas informativas.
En la audiencia de agosto, el tribunal indicó que las cadenas podían proceder bajo la premisa de que el entrenamiento de modelos generativos no se había explicado específicamente. Dejó abierta la posibilidad de testimonios adicionales de empleados involucrados en el acuerdo de SBS de 2020.
Esa decisión procesal mantiene el foco estrecho. Los jueces parecen interesados en lo que comunicaron los equipos de contratación, no en declaraciones públicas generales sobre IA.
Naver afirma que las cadenas siguieron de cerca la tecnología y comprendieron la creciente importancia del aprendizaje automático después de la partida de AlphaGo de 2016. Las cadenas sostienen que la conciencia general sobre la IA no puede sustituir al permiso.
La diferencia es fundamental. Saber que un socio desarrolla IA no significa necesariamente conceder licencia sobre contenido para entrenamiento.
Lo contrario también es cierto. Un contrato no se vuelve ineficaz simplemente porque una tecnología posterior comercialice con mayor éxito un uso técnico previsto.
El tribunal debe situar los hechos entre esos polos. Esa tarea convierte este asunto en un caso contractual con consecuencias de derechos de autor, no simplemente en otro referéndum sobre la IA.
Tres señales mostrarán qué argumento está ganando
La próxima fase debería revelar si el tribunal prioriza el texto contractual, el consentimiento informado o las pruebas sobre el proceso real de entrenamiento de Naver.
La primera señal es el testimonio adicional o la prueba documental de las negociaciones contractuales de 2020. El tribunal planteó anteriormente la posibilidad de escuchar a dos empleados de SBS involucrados en ese proceso.
Los correos electrónicos o borradores que vinculen explícitamente cláusulas de investigación con el entrenamiento de modelos reforzarían la defensa de Naver. Los registros que muestren que no hubo tal discusión respaldarían la interpretación más estrecha de las cadenas.
La segunda señal es si el tribunal ordena o recibe pruebas más detalladas sobre los datos de entrenamiento. Los demandantes necesitan un vínculo creíble entre sus obras protegidas y modelos específicos de Naver.
Un inventario de conjuntos de datos, un registro de preprocesamiento o una descripción del uso interno tendría más peso que la respuesta de un modelo sobre su propio entrenamiento. La ausencia de esas pruebas mantendría la impugnación de Naver a la prueba de las cadenas.
La tercera señal es cómo los jueces ordenan la interpretación contractual y el uso legítimo. Una decisión basada en el contrato podría resolver gran parte de la disputa sin establecer una regla general sobre el entrenamiento de IA.
Un análisis más amplio del uso legítimo importaría a las empresas sin acuerdos de intercambio de contenido. También influiría en los editores surcoreanos que consideren reclamaciones contra otros proveedores tecnológicos.
Los lectores deberían resistirse a tratar la postura de Naver de septiembre como una victoria. La empresa afirma que sus contratos proporcionan autorización, pero el tribunal no ha aceptado esa conclusión.
El procedimiento de agosto expuso una debilidad en la narrativa de Naver. Los jueces parecieron no estar convencidos de que el entrenamiento de IA generativa se hubiera explicado específicamente cuando se celebraron los acuerdos.
Esa debilidad no invalida automáticamente un permiso contractual amplio. Sí hace más importantes la historia de la negociación y el lenguaje exacto.
La demanda de derechos de autor sobre IA contra Naver será especialmente relevante si el tribunal separa el acceso de la autorización. Una empresa puede recibir contenido legalmente y, aun así, exceder la finalidad permitida para utilizarlo.
Los desarrolladores y compradores empresariales deberían vigilar esa distinción en sus propios acuerdos de datos. Un derecho general a analizar o mejorar un servicio puede no cubrir claramente el entrenamiento de modelos fundacionales.
Los editores deberían examinar las mismas cláusulas antes de asumir que conservaron todos los derechos relacionados con la IA. Las definiciones existentes, los anexos técnicos, las modificaciones y las condiciones de pago pueden cambiar el análisis.
La respuesta práctica es mantener registros cuidadosos. Los equipos necesitan conjuntos de datos rastreables, permisos documentados, usos definidos y un proceso para respetar restricciones posteriores.
Para cualquiera que evalúe sistemas de IA, la pregunta final es concreta: ¿puede el proveedor demostrar de dónde procedían sus derechos de entrenamiento y qué permitían realmente esos derechos? Naver afirma que su respuesta se encuentra en contratos firmados hace años. Las cadenas sostienen que esos acuerdos nunca autorizaron el uso comercial que ahora está ante el tribunal. Los documentos, el registro de negociación y las pruebas de entrenamiento decidirán qué versión prevalece.



