NaverのAI著作権訴訟、ニュース契約で実際に何が許可されていたかが焦点に
Naverは、3つの放送局が記事を無許可で利用されたと主張するなか、法廷でAI学習の実務を擁護した。NaverのAI著作権訴訟は現在、過去のニュース共有契約が、出版社側が意図的に承認した覚えのない利用を認めていたかどうかを中心に展開している。
KBS、MBC、SBSは2025年1月、HyperCLOVAおよびHyperCLOVA Xの学習に使われたとされる素材を巡り、Naverを提訴した。放送局側は損害賠償に加え、自社ニュースコンテンツを用いた今後の学習の停止を命じるよう求めている。
Naverはソウル中央地裁に対し、研究、サービス開発、文章抽出を対象とする契約文言がその利用を許可していたと説明した。9月8日の報道によると、同社はこれらの契約が放送局側の請求から同社を保護すると主張している。
この抗弁は、機械学習がフェアユースに当たるかという一般的な論点よりも、争点をより明確にする。裁判所は、生成AIが明確な商業カテゴリーとなる前に、当事者が何をライセンスしていたのかも判断しなければならない。
放送局側は、Naverを通じたニュース配信の許可は、商用言語モデルの構築を認めるものではなかったと主張する。Naverは、大規模言語モデルを明示していなくても、契約はより広範な技術的処理を想定していたと反論している。
この区別は、韓国の一件の訴訟にとどまらず重要だ。テクノロジー企業は、現在のAIシステムが存在する前に作成された契約に基づき、長年にわたるライセンス済み素材を保有していることが多い。広範な開発条項がモデル学習を含むなら、そうした契約は有力な抗弁となる。十分な情報に基づく同意が必要だったなら、企業は新たなライセンス費用や制約に直面する。
Naver、契約がAI学習をカバーしていたと主張
直近の変化は新たな訴訟ではなく、数カ月にわたる裁判所の精査を経てNaverが提示した、より具体的な契約上の抗弁である。
MLexは2026年9月8日、Naverが韓国の裁判所に対し、コンテンツ共有契約に沿った利用だったと改めて説明したと報じた。この審理は、契約がどのように交渉されたかに焦点を当てた8月の重要な手続きに続くものだった。
訴訟は、KBS、MBC、SBSが、Naverが自社ニュース記事をHyperCLOVAおよびHyperCLOVA Xの学習に利用したと非難したことから始まった。放送局側はソウル中央地裁で、著作権、不正競争などに関する請求を提起した。
韓国メディアの報道によると、放送局側は当初、各社2億ウォン、合計6億ウォンを請求していた。求める救済には、係争中の素材による学習を禁じる差止めも含まれる。
ただし、この金額だけでは事件の商業的重要性を十分に表していない。差止めや制限的な解釈が示されれば、すでにNaverのモデル開発プロセスに組み込まれたデータにも影響し得る。
放送局側は、韓国の主要な地上波テレビネットワーク3社に当たる。39の放送事業者を代表する韓国放送協会はこの訴訟を支持し、以前からAI利用に関する別個の補償協議を求めていた。
当初の訴状によると、同協会は2023年12月にNaver、Kakao、Google Koreaへ立場を通知していた。AI学習にニュースコンテンツを使うには、別途の許可と補償が必要だとした。
協会のタスクフォースは後に、Naverの情報源、学習素材、取得方法に関する情報を要請した。Naverは明確な開示を行わなかったと同協会は述べている。
Naverは当初、詳細な立場を示す前に訴状を検討する必要があるとしていた。その後、法廷での抗弁はより具体化している。
Naverは、研究、新サービス開発、技術的処理に関する契約条項を指摘している。また、AIプラットフォームと文章抽出に言及する契約上の文言も引用している。
文章抽出とは、索引化、分析、その他の計算処理のために、大きな文書から個別の文章を取り出すことを指し得る。Naverは、この用語が機械学習に関連するデータ処理を表していたと主張する。
放送局側はその解釈を退ける。既存のニュースサービスのためにテキストを抽出することと、記事をモデル学習コーパスに複製することは異なると主張している。
この相違が、中心となる契約上の問いを生む。コンテンツ処理の許可があっても、当事者が受け入れた処理目的が何かまでは自動的に決まらない。
Naverはまた、一部の事実報道は韓国法の下で完全な著作権保護の対象にならないと主張している。同社は放送局側に対し、保護される表現と請求の根拠となる具体的な著作物を特定するよう求めた。
放送局側は、記事には経済的価値があり、保護可能な選択、構成、表現が含まれると答える。Naverによるとされる複製は、孤立した事実への偶発的な参照ではなく、組織的な商業利用だと位置付けている。
どの解釈が適用されるかについて、最終判断はまだ示されていない。9月の審理は、Naverの責任を解決するものではなく、継続中の争いを前進させるものだった。
NaverのAI著作権訴訟は双方に圧力をかける
放送局側は通常のニュース配信権がモデル学習の手前で終わることを示す必要があり、Naverは過去の契約をより広く読む正当性を示さなければならない。
Naverにとって、直近の圧力は韓国語AIプログラムを支える法的基盤にかかっている。HyperCLOVA Xは、韓国語、英語、コードの大規模コレクションに依存している。
Naverは、学習コーパス内の係争対象記事を公表していない。同社が公開したモデル文書は、データのカテゴリーをより高い粒度で説明している。
同社の2024年の技術報告書によると、HyperCLOVA Xは韓国語、英語、コードのデータをバランスよく混合して使用した。その混合に含まれるすべての媒体を公に列挙してはいない。
この開示不足は放送局側に実務上の問題をもたらす。Naverの学習記録に完全にアクセスできないまま、侵害を特定しなければならないためだ。
報道によると、放送局側はHyperCLOVA Xが生成した回答を、自社コンテンツが利用された証拠として提出した。Naverは、言語モデルは自らの学習について信頼できない説明を生成し得るとして、この手法に異議を唱えた。
モデルによるデータソースに関する回答は、信頼できる監査記録ではない。大規模言語モデルは、学習文書の検証済み一覧を取得するのではなく、もっともらしいテキストを生成する。
そのため裁判所は、法的争点と並行して証拠開示上の課題にも直面する。被告が関連するデータ記録を管理する状況で、原告が複製された著作物をどのように特定できるかを判断しなければならない。
Naverは、放送局側がどの著作物が侵害されたのかを十分に特定していないと主張している。放送局側は、AI学習の異例の規模と不透明性ゆえに、より高い特定性を求めることは難しいと述べる。
これは単なる手続き上の対立ではない。学習記録を管理する当事者は、裁判所が開示を命じる前から決定的な証拠上の優位を持ち得る。
放送局側にも独自の圧力がある。放送局側は長年にわたりNaverを通じてコンテンツを配信し、単純な表示を超える技術的利用を認める契約を受け入れてきた。
裁判所は、広範な開発文言が、契約締結時に存在した機械学習をカバーしていたと結論付ける可能性がある。その場合、放送局側は生成AI学習をライセンス済みのプラットフォーム開発から分ける別の法理を必要とする。
放送局側の立場では、異なる種類のニュースを区別する必要もある。韓国の著作権法は、単純な事実伝達から成る一定の時事報道を保護の対象外としている。
ただし、この除外はすべてのニュース記事が保護されないことを意味しない。報道には、独自の表現、分析、構成、写真、その他の創作的要素が含まれ得る。
Naverは、原告に保護可能な素材を特定するよう求めることで、この区別を強調している。このアプローチは、大規模な請求を記事ごとの問題へと絞り込む可能性がある。
一方、放送局側は収集されたコーパスの商業的価値を強調する。放送局側の請求は、このデータセットを単なる公的事実の一覧ではなく、報道機関の投資によって構築された資源として扱う。
その結果、双方は公には十分に開示していない証拠を示すよう迫られている。Naverは契約文言を具体的な学習活動に結び付ける必要があり、放送局側は保護された著作物をモデルに結び付ける必要がある。
過去の契約が新しい商業利用と交わる
この訴訟は、広範な技術的許可がニュースプラットフォームの改善から、再利用可能な生成モデルの学習まで拡張し得るかどうかにかかっている。
関連する契約はChatGPT時代に生まれたものではない。証言では、2017年から2020年にかけて交渉された条項と特約が検討された。
Naverは、Clova、AIプラットフォーム、研究、文章抽出への言及により、放送局側は認識していたと主張する。当事者がこうした条件を交渉した時点で、機械学習はすでによく知られていたと論じている。
2016年から2023年にかけてニュース提携に関与したNaverの社員が、第6回審理で証言した。この社員は、協議がメール、会議、電話を通じて行われたと述べた。
証人は、NaverがAIプラットフォームの特別な性質を十分に説明していたと主張した。また、放送局側の法務チームは契約文言を綿密に確認し、条項が不明確な場合には質問していたと述べた。
放送局側は、こうした協議が生成モデルの学習を対象としていたかどうかを争った。大規模言語モデルや生成AIといった用語は契約に登場しないことを強調した。
8月の審理記録は、Naverが研究、サービス改善、新サービス開発のために情報を利用できるとする2020年の条項を記載している。メディア組織はその広範さに異議を唱え、Naverは後に事前同意要件を追加した。
この改定は双方の説明を複雑にする。Naverは技術的利用を巡る確立した契約プロセスを指摘できる。放送局側は、後の同意要件が無制限の利用を受け入れ難いものと示していると主張できる。
Naverはまた、より広範な権利によって放送局への支払い額が増えたとも主張したとされる。以前の審理では、支払いは50%増加し、5年間で数億ウォンに達したと説明した。
これらの数字は、支払いによって何が購入されたかに関する司法判断ではなく、Naverの法廷での立場の一部にとどまる。契約または交渉記録が両者を結び付けない限り、より大きな支払いがAI利用への同意を示すわけではない。
放送局側は技術的・商業的文脈に焦点を当てる。2020年以前の協議は、ChatGPTによって汎用的な生成システムが認識可能な市場となる前に行われたと主張する。
機械学習が当時すでに確立されていたことは確かだ。しかし、記事を分類したり検索を改善したりすることは、多様なサービスで新しいテキストを生成できるモデルの学習とは、経済的に異なる。
これが訴訟の中心的なトレードオフである。契約文言は通常の技術開発をカバーできるだけの柔軟性を保ちつつ、有意義な制限を維持できるだけの具体性も備えなければならない。
将来のすべての計算手法を列挙する契約は、すぐに時代遅れになる。他方、無制限の開発条項は、出版社がその対価を理解しないまま、予見できなかった権利を移転しかねない。
裁判所は通常、契約文言、目的、交渉経緯、当事者の行動を用いて契約を解釈する。Naverを巡る争いは、市場での役割が急速に変化した技術を軸に、これら4つの検討をすべて集中させている。
Naverは、これらの契約をClovaおよび既存のAI関連業務と結び付けている。放送局側は、契約が対象とするのはニュース配信とサービス改善であり、汎用モデルの開発ではないと主張している。
8月の裁判所のコメントは、Naverにとって不確実性を高めた。証言を聴取した後、裁判官らは、生成AIの学習について放送局側に具体的な説明がなされていなかった可能性が高いとの見解を示した。
この見解は最終判断ではない。それでも、契約が問題を明確に解決していたという単純な主張を弱めるものだ。
9月のNaver側の弁論は、書面による契約を争点の中心に据え続ける狙いがあるように見える。Naverは、将来のあらゆるモデルアーキテクチャを詳細に説明しなくても、契約上の許諾は成立し得ると主張している。
放送局側は、裁判所がより狭い境界線を採用する必要がある。彼らの訴えは、モデル学習が十分に異なる利用であり、個別かつ十分な情報に基づく許可を要するという点に依拠している。
著作権と契約上の抗弁は異なる役割を果たす
Naverが契約に関する主張で敗れても、著作権保護、複製、フェアユース、不正競争について争う余地は残る。
AI著作権訴訟をめぐる公開討論では、しばしば一つの問いに集約される。学習はフェアユースなのか。この訴訟には、独立して機能する複数の論点がある。
まず、裁判所は放送局側が特定する著作物について、放送局側が著作権を有するかを判断しなければならない。純粋な事実や基本的な時事報道は、独創的な表現を伴う報道とは異なる扱いを受ける。
次に、放送局側は保護対象の素材がNaverの学習プロセスに入ったことを立証する必要がある。この点は、データセット、前処理、保存、モデル開発に関する証拠に左右される。
第三に、裁判所はコンテンツ共有契約を解釈しなければならない。それらの契約が問題の利用を許諾していたなら、AI学習に関する広範な判断を下さなくても著作権侵害の請求は退けられ得る。
第四に、裁判所はフェアユースなどの法定上の制限を検討できる。韓国のフェアユース規定は、利用の目的、著作物の性質、利用量、市場への影響を考慮する。
これらの要素により、自動的な結論は導かれない。学習はテキストを統計的なモデルパラメータへ変換し得る一方、データ準備や計算の過程で素材を複製することも必要とする。
商業目的であることだけで、フェアユースが自動的に否定されるわけではない。ただし、大規模な複製やライセンス市場への損害と組み合わさる場合、被告に不利に働く可能性がある。
放送局側は、代替利用と失われたライセンス機会を強調する可能性が高い。AI開発者はニュースルームのコンテンツにアクセスするため、別途の対価を交渉すべきだと主張している。
Naverは、学習によって生まれるのは記事の複製を提供するデータベースではなく、汎用言語モデルだと反論できる。また、機能的な処理と原著作物の公開を区別することも可能だ。
出力の挙動も依然として重要である。保護された文章を再現するシステムは、認識可能な表現を返さずに素材を利用するシステムとは異なるリスクを生む。
公開記録からは、HyperCLOVA Xが放送局の記事をどの程度の頻度で再現するかは明らかでない。また、問題とされる素材がどれほど含まれていたかも示されていない。
この不確実性は、市場への損害について強い結論を下すことを難しくする。同時に、契約解釈がNaverにとってこれほど魅力的な抗弁となった理由でもある。
契約は、技術全体に対するフェアユースを定義するよりも明確な解決経路を提供し得る。裁判所は、当事者間の契約に基づいて限定的な判断を下すことができる。
ただし、限定的な契約判断であっても、他の交渉に影響を与えるだろう。プラットフォームと出版社は、研究、抽出、サービス開発、機械学習への言及を含む類似条項を精査することになる。
Naver自身も、この訴訟には意味のあるリスクが伴うことを認めている。同社の2026年offering circularは放送局側の訴訟に言及し、その結果は依然として不確実だとしている。
提出書類には、原告が生成AI学習のためのニュースコンテンツの無断利用を主張していると記載されている。また、原告による金銭賠償および差止め救済の請求も記録されている。
Naverはさらに、知的財産に関する不利な判断が、損害賠償、ライセンス義務、事業慣行の変更、サービス停止につながる可能性があると投資家に警告している。この文言は一般的なリスク開示であり、本件についての予測ではない。
それでも、契約上の抗弁がすでにリスクを完全に取り除いたという印象とは矛盾する。Naverは抗弁を示しており、放送局側はこれに積極的に異議を唱えている。
出版社が試しているのは所有権だけでなくライセンス交渉力だ
より大きな争いは、長年のプラットフォーム配信を経た後、高価値な学習データの条件を誰が定められるのかに関わる。
KBS、MBC、SBSはコンテンツの所有者であると同時に、Naverのニュースプラットフォームに長年参加してきた事業者でもある。この関係は、オープンウェブから収集された素材をめぐる事案とは本件を区別する。
放送局側は、無関係なサービス上で自社の記事を偶然発見したわけではない。配信、表示、技術的取扱い、対価を規律する契約を結んでいた。
これらの契約により、Naverはコンテンツへ適法にアクセスできた。未解決の問題は、ある目的のための適法なアクセスが、別の目的への許諾となったかどうかである。
この構図は、テクノロジー企業が深いコンテンツ提携を結んでいる場面で繰り返し現れるだろう。検索エンジン、アグリゲーター、クラウド事業者、エンタープライズプラットフォームは、古い条件のもとで収集されたライセンス済みアーカイブを保有していることが多い。
生成AIは、それらのアーカイブの価値を高める。一貫性があり専門的に編集された言語は、学習、検索システム、評価、製品開発を支え得る。
出版社は現在、こうした利用を通常の配信から切り分けようとしている。彼らの交渉目標は、過去の複製に対する損害賠償に限定されない。
AIに関する具体的な許可を求める判決は、新たなライセンスへの要求を強めるだろう。また、学習、ファインチューニング、検索、評価、保存、生成出力を対象とする詳細な条項を促すことにもなる。
Naverに有利な判決は、プラットフォームに別の道を与える。企業は、文言や周辺の交渉経緯がその解釈を支持する場合、広範な研究またはサービス開発条項に依拠できる。
いずれの結果も普遍的なルールを生むわけではない。契約文言は異なり、支払条件やパートナー間のやり取りも異なるためだ。
本件は、韓国で進むAI著作権政策の明確化の取り組みとも交差する。政府は、テキスト・データマイニング規則、学習データの開示、権利情報を識別する仕組みを検討してきた。
2026年2月、文化体育観光部は生成AI学習におけるフェアユースを扱うガイダンスを公表した。ガイダンスは分析を整理できるが、争いのある事実に法令をどう適用するかは、なお裁判所が決める。
韓国の紛争には国際的な類似例もある。米国では報道機関がOpenAIとMicrosoftを提訴しており、一方で他の出版社はAI企業とライセンス契約を締結している。
こうした戦略は、異なる経路を通じて同じ希少な資産を追求している。訴訟は利用疑惑の後に支配権を確立しようとするのに対し、ライセンスはアクセスを交渉による商業関係へと変換する。
Naverの立場が異例なのは、交渉はすでに行われたと主張している点だ。放送局側は、現在争点となっている利用は取引に含まれていなかったと反論する。
この対立により、契約締結のプロセスは最終的な文言と同じくらい重要になる。プレゼンテーション、メール、改訂、質問、支払いに関する証拠は、各当事者が何を合理的に理解していたかを示し得る。
裁判所は以前、放送局側が求めたNaverの上級幹部の証人尋問を認めなかった。代わりに、ニュース提携業務に関わった従業員から証言を聴取した。
8月の審理で裁判所は、生成モデルの学習が具体的に説明されていなかったという前提で放送局側が手続きを進められると示した。2020年のSBSとの契約に関わった従業員による追加証言の可能性は残した。
この手続上の選択は焦点を狭く保つ。裁判官らは、AIに関する幅広い公的発言ではなく、契約担当チームが何を伝えたかに関心を持っているようだ。
Naverは、放送局側は技術を継続的に追っており、AlphaGoの2016年の対局以降、機械学習の重要性が高まっていることを理解していたと述べる。放送局側は、AIについて一般的な認識があっても許可の代わりにはならないと主張する。
この違いは根本的だ。パートナーがAIを開発していると知っていても、必ずしも学習用にコンテンツをライセンスしたことにはならない。
逆もまた真である。後の技術が予想されていた技術的利用をより成功裏に商業化したからといって、契約が無効になるわけではない。
裁判所は、これら両極の間に事実を位置付けなければならない。この課題により、本件は単なるAIをめぐる国民投票ではなく、著作権上の帰結を伴う契約事件となっている。
どの主張が優勢かを示す三つのシグナル
次の段階では、裁判所が契約文言、十分な情報に基づく同意、Naverの実際の学習パイプラインに関する証拠のいずれを優先するかが明らかになるはずだ。
第一のシグナルは、2020年の契約交渉に関する追加証言または文書証拠である。裁判所は以前、このプロセスに関与したSBS従業員2人からの証言を聴取する可能性を示していた。
研究条項とモデル学習を明示的に結び付けるメールや草案は、Naverの抗弁を強めるだろう。そのような議論がなかったことを示す記録は、放送局側のより狭い解釈を支えることになる。
第二のシグナルは、裁判所がより詳細な学習データの証拠を命じるか、あるいは受け入れるかである。原告は、自らの保護対象著作物と特定のNaverモデルの間に信頼できるつながりを示す必要がある。
データセットの目録、前処理記録、内部利用の説明は、モデル自身による学習内容についての回答よりも重みを持つ。こうした証拠がなければ、放送局側の立証に対するNaverの反論は維持される。
第三のシグナルは、裁判官らが契約解釈とフェアユースをどのような順序で扱うかである。契約に基づく判断は、一般的なAI学習ルールを確立せずに紛争の大部分を解決し得る。
より広範なフェアユース分析は、コンテンツ共有契約を持たない企業にとって重要となる。他のテクノロジー事業者に対する請求を検討する韓国の出版社にも影響を与えるだろう。
読者は、Naverの9月の立場を勝利として扱うべきではない。同社は契約が許諾を与えていると述べているが、裁判所はその結論を受け入れていない。
8月の手続きは、Naverの説明における弱点を露呈させた。裁判官らは、契約締結時に生成AI学習が具体的に説明されていたという点に納得していないように見えた。
この弱点は、広範な契約上の許諾を自動的に無効にするものではない。しかし、交渉経緯と正確な文言の重要性を高める。
裁判所がアクセスと許諾を分けて扱うなら、NaverのAI著作権訴訟は特に重要な意味を持つことになる。企業はコンテンツを適法に受け取っていても、その利用目的として許された範囲を超える可能性がある。
開発者や企業の購入担当者は、自らのデータ契約においてこの区別を注視すべきだ。分析またはサービス改善に関する一般的な権利は、基盤モデルの学習を明確に含んでいない可能性がある。
出版社も、AI関連の権利をすべて保持していると考える前に同じ条項を検討すべきである。既存の定義、技術的な別紙、改訂、支払条件が分析を変え得る。
実務上の対応は、慎重な記録管理である。チームには追跡可能なデータセット、文書化された許諾、定義された利用目的、後から加えられる制限を尊重するプロセスが必要となる。
AIシステムを評価する人にとって、最終的な問いは具体的である。提供者は、学習権限がどこから来たのか、そしてその権限が実際に何を許していたのかを示せるのか。Naverは、その答えは何年も前に締結された契約にあると述べる。放送局側は、これらの契約が現在裁判所で問題となっている商業利用を決して許諾していなかったと主張する。どちらの説明が成り立つかは、文書、交渉記録、学習に関する証拠によって決まる。



