주메뉴바로가기본문바로가기
비즈한국 비즈한국

米国「実物書籍のスキャン」AI学習に「適法」判決、韓国出版業界は衝撃

この記事はAIによって自動翻訳されました。原文(韓国語)と異なる部分がある場合があります。  Read original in Korean →

[비즈한국] 人工知能(AI)チャットボット「Claude(クロード)」の開発元であるAnthropicが、数百万冊の中古本をスキャンして学習に利用した行為に対し、米国の裁判所が適法との判決を下した。今回の判決は、AI企業が実物の書籍を購入してデジタル化する方式が著作権法上の「フェアユース(公正利用)」に該当する可能性があるという先例を残した。これにより、著作権の保護と適切なデータ価値の補償を主張する韓国の出版市場にも少なからず波紋が広がることが予想される。

米裁判所は、Anthropicが数百万冊の書籍をスキャンしてAI学習に活用した行為は「変容的利用」に該当し適法であると判決した。写真=生成AI
米裁判所は、Anthropicが数百万冊の書籍をスキャンしてAI学習に活用した行為は「変容的利用」に該当し適法であると判決した。写真=生成AI

Anthropic、中古本をスキャンして学習データとして使用

1月27日(現地時間)、ワシントン・ポストの報道を通じてAnthropicの「プロジェクト・パナマ(Project Panama)」の全容が明らかになった。Anthropicは2023年から生成AIモデルの性能を高めるためには、高品質なデータである「書籍」の学習が不可欠だと判断した。しかし、出版社や作家一人ひとりに同意を得ることは現実的に不可能であると考え、中古本を大量購入してデジタル化するという迂回戦略を立てた。

彼らは中古書店や経営難に陥った図書館などを通じて数百万冊の書籍を確保した。その後、外部業者を雇って油圧式切断機で本を裁断し、高速スキャナーでデジタル化した上でAI学習に投入した。学習を終えた書籍はリサイクル業者に引き渡された。

米国カリフォルニア州北部連邦地方裁判所は昨年6月、Anthropicのこのような行為に法的な問題はないと判決した。裁判部は、Anthropicが書籍を学習に活用したことを「本質的に革新的な行為」と評価した。特に、作家を目指す読者が本を読むのと同様に、AIモデルも新しい何かを創造するために学習したのであり、これは著作権法で保護される「変容的利用(Transformative use)」に該当すると判断した。

裁判部は、Anthropicが実物の書籍を直接購入することで出版市場に直接的な収益をもたらした点に注目した。これはフェアユースの重要な判断基準の一つである「原著作物の市場価値に与える否定的な影響」を最小化したとみなしたものである。

ただし、裁判所がAnthropicの全ての学習プロセスを容認したわけではない。Anthropicが「LibGen」や「海賊図書館ミラー」のような違法な海賊版サイトから数百万冊のコンテンツを無断ダウンロードして学習に活用したことは著作権侵害と規定した。Anthropicは作家や出版社側に15億ドル(約2兆1000億ウォン)の和解金を支払い、訴訟を終結させた。

韓国にはまだ判例なし…地上波3社対NAVER035420の訴訟に注目

今回の判決により、著作権者がAI企業に対して「学習そのものをしないでほしい」と要求することが法的にさらに難しくなったとの懸念が出ている。韓国の出版界は緊張の面持ちだ。一部の出版社は海外への版権輸出契約時に「機械学習使用禁止」条項を挿入するなど個別の対応に乗り出しているが、技術的・法的な強制力には疑問が呈されている。

韓国の出版界は、クリエイターが正当な対価を得られない構造が固定化されれば知識エコシステムが崩壊することを懸念している。写真はソウル中区「私の友人ソウル・ソウルギャラリー」内にあるソウルブックストア。写真=チェ・ジュンピル記者
韓国の出版界は、クリエイターが正当な対価を得られない構造が固定化されれば知識エコシステムが崩壊することを懸念している。写真はソウル中区「私の友人ソウル・ソウルギャラリー」内にあるソウルブックストア。写真=チェ・ジュンピル記者

大韓出版文化協会(出版協会)は昨年9月、会員社に公文書を送り、共同対応を要請したことがある。出版協会は、個別の出版社がAI企業と不利な条件で契約することを警戒し、データ資産の価値を守るために協会に交渉権を委任する覚書(MOU)の締結を推進している。出版協会は現在、相当数の出版社から委任を受けたと明らかにした。

現在、韓国のAI企業の多くは学習データを確保するために出版社と契約を結んでいる。しかし、交渉過程でデータの価値に対する認識に大きな開きがあるのが現状だ。そのため、今回の判決が出版社の保有する知的財産価値を損ない、出版産業全体のデータ資産価値を過小評価する結果を招きかねないとの懸念が出ている。

特に、クリエイターが正当に補償されない構造が固定化された場合、創作意欲が削がれ、良質な書籍が生産されなくなる「知識エコシステムの崩壊」につながる可能性があるという点が最も危惧されている。Anthropicの事例のように、実物の書籍を購入したという理由だけでスキャンと学習が正当化されるなら、クリエイターの権利を保護する道は閉ざされてしまうという批判だ。

出版協会の著作権政策担当常務理事であるキム・シヨル氏は、「書籍のデータが、1冊分の価格で使い放題のAIのための安価な貯水池となってしまえば、誰が自身の知識の成果物を本にしようと思うだろうか」と問いかけ、「知識エコシステムが崩壊すれば、良質なデータが重要なAIも停滞する可能性がある」と懸念を示した。

韓国国内法では、まだAI学習のための「変容的利用」について明確な法理や判例が確立されていない。これに関連し、現在進行中の地上波3社とNAVERの生成AI著作権訴訟が重要な指標になると見込まれている。放送局側は、ニュースコンテンツはポータルサイトでの公開用であり、AI学習用ではないと主張する。一方、NAVERは、AI学習用のデータとしてニュースコンテンツを活用したとしても、利用規約上の「新しいサービスの開発研究」に該当すると主張している。事実を伝える報道は著作権保護の対象外だとも反論している。

法務法人ミンフの代表弁護士、キム・ギョンファン氏は「韓国国内法には変容的利用に関する判例がないため、韓国で(米国と)同じように適用されるかどうかは関連訴訟の行方を見守る必要がある」とし、「産業発展という側面だけを考慮しているとクリエイターの権利が損なわれる可能性があるため、それに見合った補償が必要だ」と述べた。

この記事はAIによって自動翻訳されました。原文(韓国語)と異なる部分がある場合があります。
김민호 기자

중화학공업·에너지 분야를 담당하고 있습니다. 지속가능한 사회와 삶에 관심이 많습니다.

goldmino@bizhankook.com
저작권자 ⓒ 비즈한국 무단전재 및 재배포 금지