OpenAIは、ニューヨーク・タイムズによる著作権訴訟において、同社のフェアユース(公正利用)の抗弁を支持する20ページの法廷助言者意見書(amicus brief)を米国司法省が提出したことで、稀に見る追い風を受けた。ニューヨーク州南部地区連邦地方裁判所に提出されたこの書面は、連邦政府がAIの学習プロセスを単なる民間の法的紛争ではなく、国家利益に関わる問題と見なしていることを示唆している。

なぜ政府が介入するのか

この意見書は、本件を地政学的な観点から捉えている。米国はAI産業の競争力を維持することに「強い関心」を持っており、AIにおけるリーダーシップは経済的繁栄と国家安全保障の両方に結びついていると主張している。OpenAIを支持することで、政権は、著作権法の狭い解釈が、米国企業を海外の競合他社より優位に保っている研究開発サイクルを鈍化させる可能性があることを示唆している。この立場は、AIの標準化とガバナンスに対して「米国第一」のアプローチを求める、これまでの大統領令とも呼応するものだ。

中心となる法的論点:変容的利用か、それとも著作権侵害か?

争点は、膨大な著作権保護されたコーパス(言語データ群)を大規模言語モデル(LLM)に投入することが「フェアユース」に該当するかどうかである。フェアユースは、「変容的(transformative)」な利用、つまり単に元の著作物を複製するのではなく、異なる目的を持って新しい要素を加える利用を保護するものである。政府の意見書でも繰り返されているOpenAIの主張は、LLMはパターンを学習して新しいテキストを生成するものであり、そのプロセスはコピー&ペースト作業というよりも、人間が情報を吸収する読書に近いというものだ。

意見書は、「フェアユースの教義に対する誤解に基づいてLLMの開発を制限すること」は、米国の経済的流動性を損なうだろうと警告している。この表現は、別の訴訟における判事のコメントを反映したものだ。その判事は、LLMの学習を、元のクリエイターに取って代わるためのツールではなく、本から学んで新しいアイデアを生み出す読者のプロセスになぞらえた。

先行事例が議論に与える影響

この意見書は裁判所の判決としての効力を持つものではないが、許容される学習と違法なデータ取得の境界線を定義する上で役立つ最近の訴訟を指し示している。Anthropicが関与したケースでは、同社は15億ドルの和解金に直面したが、それはモデルが著作権で保護された作品から学習したからではなく、その資料を「違法なシャドウ・ライブラリ(実質的には海賊版データベース)」から入手したためであった。この和解は、たとえ学習プロセス自体が変容的であるとみなされたとしても、データの取得方法が巨額の法的責任を引き起こす可能性があることを強調している。

ウィリアム・アルスップ判事の以前の所見も、さらなる文脈を提供している。彼は、LLMの学習は直接的なコピーよりも人間の学習プロセスに似ていると強調し、裁判所がより広いフェアユースの解釈を受け入れる可能性があることを示唆した。しかし、Anthropicの事例は、その後の利用方法にかかわらず、裁判所が違法な調達に対しては厳しい一線を画すことを示している。

誰が得をし、誰がリスクを負うのか

AI開発者は、大規模なデータ取り込みをフェアユースとして扱う法的環境から利益を得る立場にある。有利な判決が出れば、Claude、Gemini、あるいは将来のGPT-5といった次世代モデルの構築コストを下げることができる。なぜなら、企業は取り込むすべてのテキストに対してライセンス交渉を行う必要がなくなるからだ。これによりイノベーションが加速し、米国企業が世界のAI競争の最前線に留まり続ける可能性がある。

コンテンツクリエイターや出版社は、依然として最も声高な反対派である。彼らは、無制限なスクレイピングが作品の価値を損ない、収益を奪うものだと主張している。ニューヨーク・タイムズの訴訟はこの懸念を反映したものだ。同紙は、OpenAIが許可なく記事を使用することは著作権を侵害していると主張している。もし裁判所が新聞社側に立った場合、AI研究所は差し止め命令や損害賠償、あるいは数十億語に及ぶ言葉のライセンスを遡及的に取得する必要性に迫られる可能性がある。これは、小規模なプレイヤーを窒息させかねない財務的・物流的な負担となる。

政府は、これらの勢力のバランスを取るという利害関係を持っている。意見書はAIの成長を支持している一方で、明確な法的枠組みの必要性も暗に認めている。あまりに寛容すぎる判決はクリエイティブ部門からの反発を招き、現在の紛争よりも制限の強い新しい立法を促す可能性がある。

反論:クリエイティブな権利の保護

政府の立場に対する批判的な人々は、フェアユースの原則が、業界全体のデータ慣行を一律に適用することを意図したものでは決してなかったと指摘している。彼らは、あらゆる大規模なテキストの取り込みを「変容的」なものとして扱うことは、著作権制度のインセンティブ構造を損なう前例となり得ると警告している。さらに、Anthropicの和解は、たとえ学習プロセスが許容されるものであっても、データの取得手段が違法となる可能性があることを示している。この二面性は、AI開発者が単にフェアユースの抗弁に頼ることはできず、データパイプラインがクリーンであることを保証しなければならないことを意味している。

今後の注目点

  • 裁判所の判決: ニューヨーク州南部地区連邦地方裁判所は、最終的にニューヨーク・タイムズの主張に対する判断を下すことになる。その判決は、将来のAI関連の著作権訴訟における参照点となる可能性が高い。
  • 立法措置: 立法者たちは、AIにおける許容されるデータ利用慣行を明確にする法律を起草することで、裁判所の方向に呼応する可能性があり、それによって現在のグレーゾーンが強化、あるいは緩和される可能性がある。
  • 業界の対応: AI企業は、より広範なライセンス契約を模索するか、あるいは著作権物を完全に回避した内部データセットを構築するかによって、データ収集戦略を調整する可能性がある。

結論

司法省のアミカス・ブリーフは、OpenAIの著作権争いを、アメリカのAIの未来をめぐる代理戦争へと変貌させている。LLMの学習を国家競争力に不可欠なフェアユース活動として位置づけることで、政府は、制限的な著作権解釈が戦略的な足かせになり得るというシグナルを送っている。しかし、クリエイターの権利と開発者のニーズとの間で続く緊張関係は、裁判所、そしておそらく議会が、イノベーションと創造的な著作物の保護とのバランスをとる境界線を引かなければならないことを意味している。