OpenAI отримала рідкісну підтримку від Міністерства юстиції США, коли відомство подало 20-сторінкову заяву amicus brief на підтримку захисту компанії на основі доктрини добросовісного використання (fair use) у позові The New York Times про порушення авторських прав. Подання, внесене до Південного округу Нью-Йорка, свідчить про те, що федеральний уряд розглядає методи навчання ШІ як питання національного інтересу, а не просто як приватний юридичний спір.

Чому в це втручається уряд

У заяві справу розглядається в геополітичному контексті. У ній стверджується, що Сполучені Штати мають «сильний інтерес» у підтримці конкурентоспроможності своєї індустрії ШІ, пов'язуючи лідерство в галузі ШІ як з економічним процвітанням, так і з національною безпекою. Підтримуючи OpenAI, адміністрація припускає, що вузьке тлумачення закону про авторське право може сповільнити цикл досліджень і розробок, який дозволяє американським фірмам випереджати закордонних конкурентів. Ця позиція перегукується з попередніми указами президента, які закликають до підходу «США понад усе» щодо стандартів і управління ШІ.

Основне юридичне питання: трансформаційне використання чи порушення?

На кону стоїть питання: чи вважається подача масивних корпусів текстів, захищених авторським правом, у велику мовну модель (LLM) «добросовісним використанням» (fair use). Добросовісне використання захищає види використання, які є «трансформаційними» — тобто такими, що додають щось нове, мають іншу мету, а не просто відтворюють оригінальний твір. Захист OpenAI, який підтримується у заяві уряду, полягає в тому, що LLM вивчають закономірності та генерують новий текст — процес, який більше схожий на те, як людина засвоює інформацію, ніж на операцію копіювання та вставки.

У заяві попереджається, що «обмеження розвитку LLM через неправильне розуміння доктрини добросовісного використання» зашкодить економічній мобільності Америки. Ці слова перегукуються з коментарем у межах окремої справи, де суддя порівняв навчання LLM із читачем, який вчиться з книг, щоб створювати нові ідеї, а не з інструментом, призначеним для заміни оригінального автора.

Як попередні справи формують дискусію

Заява не має сили судового рішення, але вона вказує на нещодавні судові процеси, які допомагають визначити межу між дозволеним навчанням і незаконним отриманням даних. У справі за участю Anthropic компанія була змушена виплатити компенсацію в розмірі 1,5 мільярда доларів не тому, що її модель навчалася на творах, захищених авторським правом, а тому, що вона отримувала ці матеріали з «незаконних тіньових бібліотек» — фактично піратських баз даних. Ця угода підкреслює, що метод отримання даних може спричинити величезну відповідальність, навіть якщо сам процес навчання може вважатися трансформаційним.

Попередні спостереження судді Вільяма Алсупа надають додатковий контекст. Він наголосив, що навчання LLM більше схоже на процес людського навчання, ніж на пряме копіювання, припускаючи, що суди можуть бути відкриті до ширшого тлумачення доктрини добросовісного використання. Проте результат справи Anthropic показує, що суди проводять чітку межу на незаконному отриманні даних, незалежно від подальшого використання.

Хто виграє, а хто ризикує

Розробники ШІ можуть отримати вигоду від правового середовища, яке розглядає масштабне поглинання даних як добросовісне використання. Сприятливе рішення могло б знизити вартість створення моделей наступного покоління, таких як Claude, Gemini або майбутньої GPT-5, оскільки фірмам більше не потрібно було б узгоджувати ліцензії на кожен фрагмент тексту, який вони використовують. Це могло б прискорити інновації та утримувати американські компанії в авангарді глобальної гонки ШІ.

Автори контенту та видавці залишаються найбільш рішучими опонентами. Вони стверджують, що необмежений скрейпінг підриває цінність їхньої роботи та позбавляє їх доходів. Позов The New York Times відображає цю стурбованість: газета стверджує, що використання OpenAI її статей без дозволу порушує її авторські права. Якщо суди стануть на бік газети, лабораторії ШІ можуть зіткнутися з судовими заборонами, відшкодуванням збитків або необхідністю ретроактивно ліцензувати мільярди слів — фінансовим і логістичним тягарем, який може придушити менших гравців.

Уряд зацікавлений у балансуванні цих сил. Хоча заява підтримує розвиток ШІ, вона також опосередковано визнає потребу в чіткій правовій базі. Занадто лояльні рішення можуть спровокувати негативну реакцію з боку креативного сектору, що потенційно призведе до прийняття нового законодавства, яке може бути більш суворим, ніж поточний спір.

Контраргумент: захист творчих прав

Критики позиції уряду зазначають, що доктрина добросовісного використання (fair-use doctrine) ніколи не мала на меті охоплювати всі практики роботи з даними в цілій галузі. Вони попереджають, що трактування будь-якого масштабного поглинання текстів як трансформаційного може створити прецедент, який підірве систему стимулювання авторського права. Більше того, врегулювання спору з Anthropic демонструє, що навіть якщо процес навчання є допустимим, методи отримання даних все одно можуть бути незаконними. Ця двоякість означає, що розробники ШІ не можуть просто покладатися на захист на основі добросовісного використання; вони також повинні гарантувати, що їхні конвеєри даних є «чистими».

На що варто звернути увагу далі

  • Судові рішення: Південний округ Нью-Йорка зрештою винесе рішення щодо позову New York Times. Це рішення, ймовірно, стане орієнтиром для майбутніх справ щодо авторського права, пов'язаних із ШІ.
  • Законодавчі ініціативи: Законодавці можуть відреагувати на напрям суду, розробивши статути, які роз'яснюють дозволені практики використання даних для ШІ, що потенційно може звузити або розширити поточну «сіру зону».
  • Реакція галузі: Компанії у сфері ШІ можуть змінити свої стратегії збору даних, або шукаючи ширші ліцензійні угоди, або створюючи внутрішні набори даних, які взагалі не містять об'єктів авторського права.

Підсумок

Заява amicus curiae Міністерства юстиції перетворює боротьбу за авторські права Open AI на проксі-битву за майбутнє американського ШІ. Визначаючи навчання LLM як діяльність у межах добросовісного використання, необхідну для національної конкурентоспроможності, уряд сигналізує, що обмежені інтерпретації авторського права можуть стати стратегічним тягарем. Проте триваюча напруженість між правами творців та потребами розробників означає, що суди, а можливо й Конгрес, мають будуть провести межу, яка збалансує інновації із захистом творчої праці.