OpenAI는 미국 법무부가 New York Times와의 저작권 소송에서 회사의 공정 이용(fair-use) 방어를 지지하는 20페이지 분량의 법정 조언자 의견서(amicus brief)를 제출함에 따라 드문 지원을 얻었습니다. New York의 남부 연방법원에 제출된 이 의견서는 연방 정부가 AI 학습 관행을 단순한 사적 법적 분쟁이 아닌 국가적 이익의 문제로 보고 있음을 시사합니다.
정부가 개입하는 이유
이 의견서는 이번 사건을 지정학적 관점에서 다룹니다. 미국이 AI 산업의 경쟁력을 유지하는 데 "강한 이해관계"가 있다고 주장하며, AI 리더십을 경제적 번영 및 국가 안보와 연결 짓습니다. OpenAI를 지지함으로써, 행정부는 저작권법을 좁게 해석하는 것이 미국 기업들을 해외 경쟁사들보다 앞서게 만드는 연구 개발 주기를 늦출 수 있다고 시사합니다. 이러한 입장은 AI 표준 및 거버넌스에 대해 미국 우선주의 접근 방식을 요구하는 이전의 행정 명령들과 맥을 같이 합니다.
핵심 법적 쟁점: 변형적 이용인가, 침해인가?
관건은 방대한 저작권 말뭉치(corpora)를 거대 언어 모델(LLM)에 입력하는 것이 "공정 이용"에 해당하는지 여부입니다. 공정 이용은 단순히 원본 저작물을 복제하는 것이 아니라, 다른 목적을 가지고 새로운 것을 추가하는 "변형적(transformative)" 이용을 보호합니다. 정부 의견서에서도 언급된 OpenAI의 방어 논리는 LLM이 패턴을 학습하고 새로운 텍스트를 생성하며, 이 과정이 복사 및 붙여넣기 작업보다는 인간 독자가 정보를 흡수하는 방식에 더 가깝다는 것입니다.
의견서는 "공정 이용 원칙에 대한 오해로 인해 LLM 개발을 제한하는 것"이 미국의 경제적 유동성에 타격을 줄 것이라고 경고합니다. 이 문구는 LLM 학습을 원본 창작자를 대체하기 위한 도구가 아니라, 독자가 책을 통해 새로운 아이디어를 배우는 과정에 비유한 별개의 사건에서의 판사 발언을 반영하고 있습니다.
이전 판례가 논쟁에 미치는 영향
이 의견서가 법원의 판결과 같은 구속력을 갖는 것은 아니지만, 허용 가능한 학습과 불법적인 데이터 수집 사이의 경계를 정의하는 데 도움이 되는 최근의 소송들을 지목하고 있습니다. Anthropic과 관련된 사건에서, 이 회사는 모델이 저작권이 있는 저작물로부터 학습했기 때문이 아니라, 해당 자료를 "불법 섀도우 라이브러리(shadow libraries)" – 즉 기본적으로 해적판 데이터베이스 – 에서 가져왔기 때문에 15억 달러의 합의금을 지불해야 했습니다. 이 합의는 학습 과정 자체가 변형적이라고 간주될 수 있더라도, 데이터를 획득하는 방식에 따라 막대한 법적 책임을 질 수 있음을 강조합니다.
William Alsup 판사의 이전 관찰은 추가적인 맥락을 제공합니다. 그는 LLM 학습이 직접적인 복제보다는 인간의 학습 과정에 더 가깝다고 강조하며, 법원이 더 넓은 공정 이용 해석에 열려 있을 수 있음을 시사했습니다. 그러나 Anthropic의 결과는 법원이 사후 활용 방식과 관계없이 불법적인 조달에 대해서는 엄격한 선을 긋는다는 것을 보여줍니다.
누가 이득을 보고 누가 위험에 처하는가
AI 개발자들은 대규모 데이터 수집을 공정 이용으로 취급하는 법적 환경으로부터 이익을 얻을 수 있습니다. 유리한 판결이 내려지면 Claude, Gemini 또는 미래의 GPT-5와 같은 차세대 모델을 구축하는 비용이 낮아질 수 있는데, 기업들이 수집하는 모든 텍스트에 대해 일일이 라이선스를 협상할 필요가 없어지기 때문입니다. 이는 혁신을 가속화하고 미국 기업들이 글로벌 AI 경쟁의 선두를 유지하게 할 수 있습니다.
콘텐츠 창작자 및 출판사들은 여전히 가장 강력한 반대 세력입니다. 이들은 무분별한 스크레이핑(scraping)이 자신들의 저작물 가치를 훼손하고 수익을 박탈한다고 주장합니다. New York Times의 소송은 이러한 우려를 반영합니다. 해당 신문사는 OpenAI가 허가 없이 기사를 사용하는 것이 저작권을 침해한다고 주장합니다. 만약 법원이 신문사의 손을 들어준다면, AI 연구소들은 금지 명령, 손해 배상 또는 수십억 개의 단어에 대해 소급하여 라이선스를 체결해야 하는 상황에 직면할 수 있으며, 이는 소규모 업체들에게는 감당하기 힘든 재정적, 물류적 부담이 될 수 있습니다.
정부는 이러한 힘 사이의 균형을 맞추는 데 이해관계가 걸려 있습니다. 의견서는 AI 성장을 옹호하면서도, 명확한 법적 프레임워크의 필요성을 암묵적으로 인정하고 있습니다. 지나치게 허용적인 판결은 창작 부문의 반발을 불러일으킬 수 있으며, 이는 현재의 분쟁보다 더 제한적인 새로운 입법을 촉발할 가능성이 있습니다.
반론: 창작 권리 보호
정부의 입장에 반대하는 비판론자들은 공정 이용(fair-use) 원칙이 산업 전체의 데이터 관행을 포괄하도록 설계된 것이 아니라고 지적합니다. 이들은 대규모 텍스트 수집을 모두 변형적(transformative) 이용으로 간주하는 것이 저작권 시스템의 인센티브 구조를 약화시키는 선례가 될 수 있다고 경고합니다. 또한, Anthric의 합의 사례는 학습 과정이 허용될지라도 데이터 획득 방식은 여전히 불법일 수 있음을 보여줍니다. 이러한 이중성은 AI 개발자들이 단순히 공정 이용 방어에만 의존할 수 없으며, 데이터 파이프라인의 정당성 또한 반드시 확보해야 함을 의미합니다.
향후 주목해야 할 점
- 법원 판결: 뉴욕 남부 연방법원은 결국 New York Times의 청구에 대한 결정을 내릴 것입니다. 이 판결은 향후 AI 관련 저작권 사건의 기준점이 될 가능성이 높습니다.
- 입법 움직임: 입법가들은 AI를 위한 허용 가능한 데이터 사용 관행을 명확히 하는 법안을 마련함으로써 법원의 방향에 대응할 수 있으며, 이는 현재의 회색 지대를 강화하거나 완화할 수 있습니다.
- 업계의 대응: AI 기업들은 더 광범위한 라이선스 계약을 추진하거나, 저작권이 있는 자료를 완전히 배제한 자체 데이터셋을 구축하는 방식으로 데이터 수집 전략을 조정할 수 있습니다.
핵심 요약
법무부의 법정 조언자(amicus brief) 의견서는 OpenAI의 저작권 분쟁을 미국의 AI 미래를 둘러싼 대리전으로 변모시켰습니다. 정부는 LLM 학습을 국가 경쟁력에 필수적인 공정 이용 활동으로 규정함으로써, 제한적인 저작권 해석이 전략적 부담이 될 수 있다는 신호를 보내고 있습니다. 그러나 창작자의 권리와 개발자의 요구 사이의 지속적인 긴장은 법원, 그리고 어쩌면 의회가 혁신과 창작물 보호 사이의 균형을 맞추는 선을 그어야 함을 의미합니다.
