Pozew o prawa autorskie przeciwko Naver w związku z AI zależy od tego, na co faktycznie pozwalały umowy dotyczące wiadomości
Naver bronił w sądzie swoich praktyk trenowania AI, mimo że trzy stacje telewizyjne twierdzą, iż ich artykuły wykorzystano bez zgody. Pozew o prawa autorskie przeciwko Naver w związku z AI koncentruje się obecnie na tym, czy starsze umowy o udostępnianiu wiadomości zezwalały na wykorzystanie treści, którego wydawcy — jak twierdzą — nigdy świadomie nie zaakceptowali.
KBS, MBC i SBS pozwały Naver w styczniu 2025 roku w związku z materiałami rzekomo użytymi do trenowania HyperCLOVA i HyperCLOVA X. Domagają się odszkodowania oraz nakazu zaprzestania dalszego trenowania na ich treściach informacyjnych.
Naver oświadczył przed Centralnym Sądem Okręgowym w Seulu, że postanowienia umowne dotyczące badań, rozwoju usług i ekstrakcji zdań zezwalały na takie wykorzystanie. Według relacji z 8 września firma utrzymuje, że umowy te chronią ją przed roszczeniami nadawców.
Ta linia obrony tworzy bardziej precyzyjny spór niż znana debata o tym, czy uczenie maszynowe można uznać za dozwolony użytek. Sąd musi również ustalić, co strony objęły licencją, zanim generatywna AI stała się wyraźnie zdefiniowaną kategorią komercyjną.
Nadawcy twierdzą, że zgoda na dystrybucję wiadomości przez Naver nie oznaczała pozwolenia na budowę komercyjnego modelu językowego. Naver argumentuje, że umowy przewidywały szersze przetwarzanie techniczne, nawet jeśli nie wymieniały dużych modeli językowych.
Rozróżnienie to ma znaczenie wykraczające poza jeden koreański pozew. Firmy technologiczne często dysponują wieloletnimi zbiorami licencjonowanych materiałów na podstawie umów sporządzonych przed powstaniem obecnych systemów AI. Jeśli szerokie klauzule rozwojowe obejmują trenowanie modeli, takie umowy stają się cenną linią obrony. Jeśli wymagana była świadoma zgoda, firmy staną przed nowymi kosztami licencjonowania i możliwymi ograniczeniami.
Naver twierdzi, że jego umowy obejmowały trenowanie AI
Bezpośrednią zmianą nie jest nowy pozew, lecz bardziej rozwinięta obrona umowna Naver po miesiącach sądowej analizy.
MLex poinformował 8 września 2026 roku, że Naver ponownie przekazał południowokoreańskiemu sądowi, iż jego działania były zgodne z umowami o udostępnianiu treści. Rozprawa nastąpiła po istotnym sierpniowym postępowaniu skupionym na sposobie negocjowania tych umów.
Spór sądowy rozpoczął się, gdy KBS, MBC i SBS oskarżyły Naver o wykorzystanie ich artykułów informacyjnych do trenowania HyperCLOVA i HyperCLOVA X. Nadawcy wnieśli przed Centralnym Sądem Okręgowym w Seulu roszczenia dotyczące praw autorskich, nieuczciwej konkurencji i kwestii powiązanych.
Według koreańskich doniesień nadawcy początkowo żądali po 200 milionów wonów każdy, czyli łącznie 600 milionów wonów. Wnioskowane środki obejmują również nakaz zakazujący trenowania na spornych materiałach.
Kwoty te nie oddają pełnego komercyjnego znaczenia sprawy. Nakaz sądowy lub restrykcyjna interpretacja mogłyby wpłynąć na dane już włączone do procesu rozwoju modeli Naver.
Nadawcy reprezentują trzy największe naziemne sieci telewizyjne Korei Południowej. Korean Broadcasters Association, reprezentujące 39 nadawców, poparło działania prawne i wcześniej domagało się odrębnych rozmów o wynagrodzeniu za wykorzystanie treści przez AI.
Według pierwotnego pozwu stowarzyszenie poinformowało Naver, Kakao i Google Korea o swoim stanowisku w grudniu 2023 roku. Stwierdziło, że wykorzystywanie treści informacyjnych do uczenia AI wymaga odrębnej zgody i wynagrodzenia.
Grupa zadaniowa stowarzyszenia później zażądała informacji o źródłach Naver, materiałach treningowych i metodach ich pozyskania. Według niej Naver nie przedstawił jasnych informacji.
Naver początkowo oświadczył, że musi przeanalizować skargę, zanim przedstawi szczegółowe stanowisko. Od tego czasu jego obrona sądowa stała się bardziej konkretna.
Naver wskazuje na postanowienia swoich umów dotyczące badań, rozwoju nowych usług i przetwarzania technicznego. Przywołuje również umowne odniesienia do platformy AI i ekstrakcji zdań.
Ekstrakcja zdań może oznaczać pobieranie pojedynczych fragmentów z większych dokumentów na potrzeby indeksowania, analizy lub innego procesu obliczeniowego. Naver argumentuje, że termin ten odzwierciedlał przetwarzanie danych związane z uczeniem maszynowym.
Nadawcy odrzucają tę interpretację. Twierdzą, że wyodrębnianie tekstu na potrzeby istniejącej usługi informacyjnej różni się od kopiowania artykułów do zbioru danych służącego trenowaniu modelu.
Różnica ta tworzy centralne pytanie umowne. Zgoda na przetwarzanie treści nie przesądza automatycznie, jakie cele przetwarzania zaakceptowały strony.
Naver argumentuje również, że niektóre faktograficzne relacje prasowe nie kwalifikują się do pełnej ochrony prawnoautorskiej na gruncie prawa koreańskiego. Wezwał nadawców do wskazania chronionej formy wyrazu oraz konkretnych utworów stanowiących podstawę ich roszczeń.
Nadawcy odpowiadają, że ich artykuły mają wartość ekonomiczną i zawierają chroniony dobór, strukturę oraz sposób wyrażenia treści. Opisują rzekome kopiowanie przez Naver jako systematyczne wykorzystanie komercyjne, a nie incydentalne odwołanie do pojedynczych faktów.
Żadne ostateczne orzeczenie nie ustaliło jeszcze, która interpretacja obowiązuje. Wrześniowa rozprawa kontynuowała aktywny spór, zamiast rozstrzygać odpowiedzialność Naver.
Pozew o prawa autorskie przeciwko Naver w związku z AI wywiera presję na obie strony
Nadawcy muszą wykazać, że zwykłe prawa do dystrybucji wiadomości nie obejmują trenowania modeli, podczas gdy Naver musi uzasadnić szerszą interpretację starszych umów.
W przypadku Naver bezpośrednia presja dotyczy prawnego fundamentu programu AI w języku koreańskim. HyperCLOVA X opiera się na dużych zbiorach materiałów w języku koreańskim, angielskim i kodzie.
Naver nie wskazał publicznie spornych artykułów znajdujących się w jego zbiorze treningowym. Opublikowana dokumentacja modelu opisuje kategorie danych na wyższym poziomie ogólności.
Raport techniczny firmy z 2024 roku technical report wskazuje, że HyperCLOVA X wykorzystywał zrównoważoną mieszankę danych w języku koreańskim, angielskim oraz kodu. Nie wymienia publicznie wszystkich publikacji uwzględnionych w tej mieszance.
Ta luka informacyjna stwarza nadawcom praktyczny problem. Muszą wykazać naruszenie bez pełnego dostępu do dokumentacji treningowej Naver.
Według doniesień przedstawili odpowiedzi wygenerowane przez HyperCLOVA X jako dowód wykorzystania treści nadawców. Naver zakwestionował tę metodę, ponieważ modele językowe mogą generować niewiarygodne stwierdzenia dotyczące własnego treningu.
Odpowiedź modelu na temat źródeł jego danych nie stanowi wiarygodnego rejestru audytowego. Duże modele językowe generują prawdopodobny tekst, zamiast odtwarzać zweryfikowany spis dokumentów użytych do ich treningu.
Sąd staje zatem wobec problemu dowodowego obok samego sporu prawnego. Musi ustalić, w jaki sposób powodowie mogą zidentyfikować skopiowane utwory, gdy pozwany kontroluje istotne rejestry danych.
Naver argumentuje, że nadawcy nie określili dostatecznie, które utwory zostały naruszone. Nadawcy twierdzą, że nietypowa skala i nieprzejrzystość treningu AI utrudniają większą szczegółowość.
To coś więcej niż spór proceduralny. Strona kontrolująca rejestry treningowe może dysponować decydującą przewagą dowodową, zanim sąd nakaże ujawnienie informacji.
Nadawcy również znajdują się pod presją. Przez lata dystrybuowali treści za pośrednictwem Naver i akceptowali umowy zezwalające na techniczne zastosowania wykraczające poza proste wyświetlanie.
Sąd może uznać, że szerokie sformułowania dotyczące rozwoju obejmowały uczenie maszynowe w formie istniejącej w chwili podpisywania umów. Nadawcy musieliby wówczas oprzeć się na innej teorii prawnej, aby oddzielić generatywne trenowanie od licencjonowanego rozwoju platformy.
Ich stanowisko wymaga także rozróżnienia różnych rodzajów wiadomości. Koreańskie prawo autorskie wyłącza spod ochrony określone relacje o bieżących wydarzeniach, ograniczające się do prostego przekazywania faktów.
Wyłączenie to nie oznacza, że każdy artykuł informacyjny jest niechroniony. Materiał reporterski może zawierać oryginalną formę wyrazu, analizę, organizację treści, fotografie i inne elementy twórcze.
Naver podkreśla to rozróżnienie, żądając od powodów wskazania materiału podlegającego ochronie. Takie podejście może zawęzić masowe roszczenie do pytań rozpatrywanych artykuł po artykule.
Nadawcy zamiast tego podkreślają komercyjną wartość zgromadzonego korpusu. Ich roszczenie traktuje zbiór danych jako zasób stworzony dzięki inwestycjom redakcji, a nie jedynie listę publicznie dostępnych faktów.
W rezultacie obie strony są zmuszone przedstawić dowody, których nie ujawniły w pełni publicznie. Naver musi powiązać język umów z konkretną działalnością treningową. Nadawcy muszą powiązać chronione utwory z modelami.
Stare umowy spotykają nowy rodzaj wykorzystania komercyjnego
Sprawa zależy od tego, czy szeroka zgoda techniczna może rozciągać się od ulepszania platformy informacyjnej po trenowanie uniwersalnego modelu generatywnego.
Istotne umowy nie powstały w erze ChatGPT. Zeznania dotyczyły postanowień i warunków szczególnych negocjowanych między 2017 a 2020 rokiem.
Naver twierdzi, że odniesienia do Clova, platform AI, badań i ekstrakcji zdań informowały nadawców o tym wykorzystaniu. Argumentuje, że uczenie maszynowe było już znane, gdy strony negocjowały te warunki.
Pracownik Naver zaangażowany w partnerstwa informacyjne w latach 2016–2023 zeznawał podczas szóstej rozprawy. Pracownik stwierdził, że rozmowy odbywały się za pośrednictwem e-maili, spotkań i rozmów telefonicznych.
Świadek utrzymywał, że Naver odpowiednio wyjaśnił szczególny charakter swojej platformy AI. Dodał również, że zespoły prawne nadawców dokładnie analizowały język umów i zgłaszały pytania, gdy warunki były niejasne.
Nadawcy zakwestionowali, czy rozmowy te obejmowały trenowanie generatywnych modeli. Podkreślili, że w umowach nie pojawiały się terminy takie jak duży model językowy i generatywna AI.
Zapis rozprawy z sierpnia opisuje klauzulę z 2020 roku, która zezwalała Naver na wykorzystywanie informacji do badań, ulepszania usług i rozwoju nowych usług. Organizacje medialne sprzeciwiły się jej szerokiemu zakresowi, a Naver później dodał wymóg uprzedniej zgody.
Ta zmiana komplikuje obie narracje. Naver może wskazywać na utrwalony proces umowny dotyczący wykorzystania technicznego. Nadawcy mogą argumentować, że późniejszy wymóg zgody pokazuje, iż nieograniczone wykorzystanie było nie do przyjęcia.
Według doniesień Naver argumentował także, że szersze prawa wiązały się z wyższymi płatnościami dla nadawców. Podczas wcześniejszej rozprawy firma stwierdziła, że płatności wzrosły o 50 procent i przez pięć lat osiągnęły setki milionów wonów.
Liczby te pozostają elementem stanowiska procesowego Naver, a nie sądowym ustaleniem dotyczącym tego, co nabywały płatności. Wyższa płatność nie potwierdza zgody na AI, chyba że umowa lub zapis negocjacji łączy te dwie kwestie.
Nadawcy koncentrują się na kontekście technologicznym i komercyjnym. Twierdzą, że rozmowy sprzed 2020 roku odbywały się, zanim ChatGPT uczynił generatywne systemy ogólnego przeznaczenia rozpoznawalnym rynkiem.
Uczenie maszynowe z pewnością było już wtedy ugruntowane. Jednak klasyfikowanie artykułów lub ulepszanie wyszukiwania różni się ekonomicznie od trenowania modelu, który może generować nowy tekst w wielu usługach.
To kluczowy kompromis w tym pozwie. Język umowy musi pozostawać wystarczająco elastyczny, aby obejmować zwykły rozwój techniczny, a jednocześnie dostatecznie konkretny, aby zachować znaczące ograniczenia.
Umowa wymieniająca każdą przyszłą metodę obliczeniową szybko stałaby się przestarzała. Nieograniczona klauzula rozwojowa mogłaby również przenieść nieprzewidziane prawa, nie zapewniając wydawcy zrozumienia warunków tej wymiany.
Sądy często interpretują umowy na podstawie ich tekstu, celu, historii negocjacji i zachowania stron. Spór Naver skupia wszystkie cztery kwestie wokół technologii, której rola rynkowa szybko się zmieniła.
Naver wiąże te umowy z Clova i wcześniej prowadzonymi pracami nad AI. Nadawcy wiążą je z dystrybucją wiadomości i ulepszaniem usług, a nie z rozwojem modeli ogólnego przeznaczenia.
Sierpniowe uwagi sądu zwiększyły niepewność Naver. Po wysłuchaniu zeznań sędziowie wskazali, że szkolenie generatywnej AI prawdopodobnie nie zostało nadawcom szczegółowo wyjaśnione.
To spostrzeżenie nie było ostatecznym orzeczeniem. Mimo to osłabia prostą tezę, że umowy jednoznacznie rozstrzygnęły tę kwestię.
Wrześniowa linia obrony wydaje się mieć na celu utrzymanie pisemnych umów w centrum sprawy. Naver utrzymuje, że upoważnienie umowne może istnieć bez szczegółowego wyjaśniania każdej przyszłej architektury modelu.
Nadawcy muszą przekonać sąd do przyjęcia węższej granicy. Ich sprawa zależy od uznania, że szkolenie modeli jest na tyle odrębne, iż wymaga osobnej, świadomej zgody.
Obrona oparta na prawie autorskim i umowach pełni różne funkcje
Nawet jeśli Naver przegra argument umowny, nadal może kwestionować ochronę prawnoautorską, kopiowanie, dozwolony użytek i nieuczciwą konkurencję.
Debata publiczna często sprowadza sprawy o prawa autorskie i AI do jednego pytania: czy szkolenie stanowi dozwolony użytek? Ten pozew obejmuje kilka niezależnie działających kwestii.
Po pierwsze, sąd musi ustalić, czy nadawcy posiadają prawa autorskie do wskazanych przez siebie utworów. Czyste fakty i podstawowe relacje z bieżących wydarzeń są traktowane inaczej niż oryginalne, ekspresyjne materiały reporterskie.
Po drugie, nadawcy muszą wykazać, że chroniony materiał trafił do procesu szkoleniowego Naver. Kwestia ta zależy od dowodów dotyczących zbiorów danych, wstępnego przetwarzania, przechowywania i rozwoju modeli.
Po trzecie, sąd musi zinterpretować umowy o udostępnianiu treści. Jeśli porozumienia te zezwalały na dane wykorzystanie, roszczenia z tytułu naruszenia praw autorskich mogą upaść bez szerokiego orzeczenia dotyczącego szkolenia AI.
Po czwarte, sąd może zbadać ustawowe ograniczenia, takie jak dozwolony użytek. Koreański przepis o dozwolonym użytku uwzględnia cel wykorzystania, charakter utworu, zakres użycia oraz wpływ na rynek.
Czynniki te wykluczają automatyczną odpowiedź. Szkolenie może przekształcać tekst w statystyczne parametry modelu, lecz wymaga też kopiowania materiału podczas przygotowywania danych i obliczeń.
Cel komercyjny nie przekreśla automatycznie dozwolonego użytku. Może przemawiać przeciwko pozwanemu, jeśli łączy się z szeroko zakrojonym kopiowaniem i szkodą dla rynku licencjonowania.
Nadawcy prawdopodobnie podkreślą substytucję i utracone możliwości licencyjne. Twierdzą, że twórcy AI powinni negocjować odrębne wynagrodzenie za dostęp do treści redakcyjnych.
Naver może argumentować, że szkolenie tworzy ogólny model językowy, a nie bazę danych udostępniającą kopie artykułów. Może też odróżniać przetwarzanie funkcjonalne od publikowania utworów źródłowych.
Zachowanie wyników pozostaje istotne. System, który odtwarza chronione fragmenty, stwarza inne ryzyko niż taki, który wykorzystuje materiał bez zwracania rozpoznawalnej ekspresji.
Publicznie dostępne informacje nie ustalają, jak często HyperCLOVA X odtwarza artykuły nadawców. Nie ujawniają też ilości materiału rzekomo uwzględnionego w szkoleniu.
Ta niepewność ogranicza możliwość wyciągania stanowczych wniosków dotyczących szkody rynkowej. Wyjaśnia także, dlaczego interpretacja umów stała się dla Naver tak atrakcyjną linią obrony.
Umowa może oferować prostszą drogę niż definiowanie dozwolonego użytku dla całej technologii. Sąd mógłby orzec wąsko, opierając się na porozumieniach tych stron.
Jednak nawet wąskie rozstrzygnięcie umowne wpłynęłoby na inne negocjacje. Platformy i wydawcy analizowaliby podobne klauzule pod kątem odniesień do badań, ekstrakcji, rozwoju usług i uczenia maszynowego.
Naver sam przyznaje, że spór sądowy wiąże się z istotnym ryzykiem. Jego memorandum ofertowe z 2026 r. wskazuje na pozew nadawców i stwierdza, że jego wynik pozostaje niepewny.
W dokumencie wskazano, że powodowie zarzucają nieuprawnione wykorzystanie treści informacyjnych do szkolenia generatywnej AI. Odnotowano ich żądania odszkodowania pieniężnego i środków zabezpieczających.
Naver ostrzega również inwestorów, że niekorzystne rozstrzygnięcia dotyczące własności intelektualnej mogą prowadzić do odszkodowań, obowiązków licencyjnych, zmian praktyk biznesowych lub wycofania usług. To ogólne ujawnienie ryzyka, a nie prognoza dotycząca tej sprawy.
Mimo to przeczy ono wrażeniu, że obrona umowna już wyeliminowała ryzyko. Naver przedstawił obronę, a nadawcy aktywnie ją kwestionują.
Wydawcy testują siłę licencjonowania, a nie tylko własność
Szerszy spór dotyczy tego, kto może ustalać warunki korzystania z wartościowych danych szkoleniowych po latach dystrybucji platformowej.
KBS, MBC i SBS są zarówno właścicielami treści, jak i wieloletnimi uczestnikami platformy informacyjnej Naver. Ta relacja odróżnia spór od spraw dotyczących materiałów zebranych z otwartego internetu.
Nadawcy nie odkryli po prostu swoich artykułów w niezwiązanej z nimi usłudze. Mieli umowy regulujące dostarczanie, wyświetlanie, obsługę techniczną i wynagrodzenie.
Porozumienia te zapewniały Naver zgodny z prawem dostęp do treści. Nierozstrzygnięte pozostaje pytanie, czy zgodny z prawem dostęp w jednym celu stał się upoważnieniem do innego.
Ten wzorzec będzie się powtarzał wszędzie tam, gdzie firmy technologiczne mają głębokie partnerstwa dotyczące treści. Wyszukiwarki, agregatory, dostawcy usług chmurowych i platformy korporacyjne często posiadają licencjonowane archiwa zgromadzone na podstawie starszych warunków.
Generatywna AI zwiększa wartość tych archiwów. Spójny, profesjonalnie redagowany język może wspierać szkolenie, systemy wyszukiwania, ewaluację i rozwój produktów.
Wydawcy chcą teraz oddzielić te zastosowania od zwykłej dystrybucji. Ich cel negocjacyjny nie ogranicza się do odszkodowania za wcześniejsze kopiowanie.
Orzeczenie wymagające konkretnego zezwolenia na AI wzmocniłoby żądania nowych licencji. Zachęciłoby też do szczegółowych klauzul dotyczących szkolenia, dostrajania, wyszukiwania, ewaluacji, przechowywania i generowanych wyników.
Orzeczenie korzystne dla Naver dałoby platformom inną ścieżkę. Firmy mogłyby opierać się na szerokich klauzulach dotyczących badań lub rozwoju usług, gdy ich brzmienie i otaczające je negocjacje wspierają taką interpretację.
Żaden z tych wyników nie stworzyłby uniwersalnej reguły. Brzmienie umów jest różne, podobnie jak ustalenia dotyczące płatności i komunikacja między partnerami.
Sprawa łączy się również z trwającymi wysiłkami Korei Południowej na rzecz doprecyzowania polityki prawnoautorskiej wobec AI. Prace rządowe rozważały zasady eksploracji tekstu i danych, ujawnianie danych szkoleniowych oraz systemy identyfikowania informacji o prawach.
W lutym 2026 r. Ministerstwo Kultury, Sportu i Turystyki opublikowało wytyczne dotyczące dozwolonego użytku w szkoleniu generatywnej AI. Wytyczne mogą porządkować analizę, lecz to sądy nadal decydują, jak ustawa ma zastosowanie do spornych faktów.
Koreański spór ma również międzynarodowe odpowiedniki. Organizacje informacyjne pozwały OpenAI i Microsoft w Stanach Zjednoczonych, podczas gdy inni wydawcy zawarli umowy licencyjne z firmami AI.
Strategie te dążą do pozyskania tego samego ograniczonego zasobu różnymi drogami. Postępowanie sądowe próbuje ustanowić kontrolę po rzekomym wykorzystaniu, a licencjonowanie przekształca dostęp w wynegocjowaną relację handlową.
Stanowisko Naver jest nietypowe, ponieważ firma twierdzi, że negocjacje już się odbyły. Nadawcy odpowiadają, że porozumienie nigdy nie obejmowało obecnie kwestionowanego wykorzystania.
Ten spór sprawia, że proces zawierania umowy jest równie istotny jak jej ostateczne brzmienie. Dowody dotyczące prezentacji, e-maili, zmian, pytań i płatności mogą pokazać, co każda ze stron rozsądnie rozumiała.
Sąd wcześniej odmówił wezwania wysokiego rangą dyrektora Naver, o którego przesłuchanie wnioskowali nadawcy. Zamiast tego wysłuchał pracownika zaangażowanego w partnerstwa informacyjne.
Podczas sierpniowej rozprawy sąd wskazał, że nadawcy mogą procedować przy założeniu, iż szkolenie modeli generatywnych nie zostało szczegółowo wyjaśnione. Pozostawił otwartą możliwość dodatkowych zeznań pracowników zaangażowanych w umowę z SBS z 2020 r.
Ten wybór proceduralny utrzymuje wąski zakres sprawy. Sędziowie wydają się zainteresowani tym, co komunikowały zespoły kontraktowe, a nie szerokimi publicznymi oświadczeniami na temat AI.
Naver twierdzi, że nadawcy uważnie śledzili technologię i rozumieli rosnące znaczenie uczenia maszynowego po meczu AlphaGo w 2016 r. Nadawcy odpowiadają, że ogólna świadomość AI nie może zastąpić zezwolenia.
Różnica ma fundamentalne znaczenie. Wiedza o tym, że partner rozwija AI, nie oznacza koniecznie udzielenia licencji na szkolenie modeli z użyciem treści.
Odwrotność również jest prawdziwa. Umowa nie staje się nieskuteczna tylko dlatego, że późniejsza technologia skuteczniej komercjalizuje przewidywane zastosowanie techniczne.
Sąd musi umiejscowić fakty między tymi skrajnymi stanowiskami. To zadanie czyni z tej sprawy spór umowny z konsekwencjami prawnoautorskimi, a nie jedynie kolejne referendum w sprawie AI.
Trzy sygnały pokażą, który argument zyskuje przewagę
Kolejny etap powinien ujawnić, czy sąd priorytetowo potraktuje tekst umowy, świadomą zgodę czy dowody z rzeczywistego procesu szkoleniowego Naver.
Pierwszym sygnałem będą dodatkowe zeznania lub dowody dokumentacyjne z negocjacji umowy z 2020 r. Sąd wcześniej rozważał możliwość wysłuchania dwóch pracowników SBS zaangażowanych w ten proces.
E-maile lub projekty wyraźnie łączące klauzule badawcze ze szkoleniem modeli wzmocniłyby obronę Naver. Dokumenty pokazujące brak takiej dyskusji wsparłyby węższą interpretację nadawców.
Drugim sygnałem będzie to, czy sąd nakaże przedstawienie lub otrzyma bardziej szczegółowe dowody dotyczące danych szkoleniowych. Powodowie potrzebują wiarygodnego związku między swoimi chronionymi utworami a konkretnymi modelami Naver.
Inwentaryzacja zbiorów danych, zapis wstępnego przetwarzania lub wewnętrzny opis wykorzystania miałyby większą wagę niż odpowiedź modelu na temat jego własnego szkolenia. Brak takich dowodów podtrzymałby zakwestionowanie przez Naver materiału dowodowego nadawców.
Trzecim sygnałem jest sposób, w jaki sędziowie uporządkują interpretację umów i dozwolony użytek. Rozstrzygnięcie oparte na umowie mogłoby rozwiązać znaczną część sporu bez ustanawiania ogólnej reguły dotyczącej szkolenia AI.
Szersza analiza dozwolonego użytku miałaby znaczenie dla firm bez umów o udostępnianiu treści. Wpłynęłaby też na południowokoreańskich wydawców rozważających roszczenia wobec innych dostawców technologii.
Czytelnicy nie powinni traktować wrześniowego stanowiska Naver jako zwycięstwa. Firma twierdzi, że jej umowy zapewniają upoważnienie, lecz sąd nie zaakceptował jeszcze tego wniosku.
Sierpniowe postępowanie ujawniło słabość w narracji Naver. Sędziowie najwyraźniej nie byli przekonani, że szkolenie generatywnej AI zostało szczegółowo wyjaśnione przy zawieraniu umów.
Ta słabość nie unieważnia automatycznie szerokiego zezwolenia umownego. Sprawia jednak, że historia negocjacji i dokładne brzmienie umowy stają się ważniejsze.
Pozew dotyczący praw autorskich i AI przeciwko Naver stanie się szczególnie istotny, jeśli sąd oddzieli dostęp od upoważnienia. Firma może zgodnie z prawem otrzymać treść, a mimo to wyjść poza dozwolony cel jej wykorzystania.
Twórcy systemów i nabywcy korporacyjni powinni obserwować to rozróżnienie we własnych umowach dotyczących danych. Ogólne prawo do analizowania lub ulepszania usługi może nie obejmować w sposób jednoznaczny szkolenia modeli bazowych.
Wydawcy powinni przeanalizować te same klauzule, zanim założą, że zachowali wszelkie prawa związane z AI. Istniejące definicje, harmonogramy techniczne, aneksy i warunki płatności mogą zmienić ocenę.
Praktyczną odpowiedzią jest staranne prowadzenie dokumentacji. Zespoły potrzebują możliwych do prześledzenia zbiorów danych, udokumentowanych zezwoleń, określonych zastosowań oraz procesu respektowania późniejszych ograniczeń.
Dla każdego, kto ocenia systemy AI, końcowe pytanie jest konkretne: czy dostawca potrafi wykazać, skąd wynikają jego prawa do szkolenia i na co dokładnie pozwalały? Naver twierdzi, że odpowiedź znajduje się w umowach podpisanych wiele lat temu. Nadawcy twierdzą, że porozumienia te nigdy nie zezwalały na komercyjne wykorzystanie rozpatrywane obecnie przez sąd. Dokumenty, zapis negocjacji i dowody dotyczące szkolenia rozstrzygną, która wersja się utrzyma.



