Департамент юстиції США подав офіційну позицію на підтримку аргументу fair use у справі про використання захищеного авторським правом контенту для навчання AI-моделей — це один з наймасштабніших копірайтних позовів у сфері AI, який точиться між The New York Times та OpenAI і Microsoft. За даними The Decoder, це перший випадок, коли федеральний уряд США публічно й формально підтримав позицію технологічних компаній у суперечці про те, чи є навчання нейромереж на статтях, книгах та інших текстах «добросовісним використанням» (fair use) за законом про авторське право.

Справа NYT проти OpenAI триває з грудня 2023 року й вважається одним з ключових прецедентів для всієї індустрії: якщо суд визнає навчання на новинних матеріалах порушенням копірайту, компаніям доведеться або ліцензувати мільйони джерел, або повністю переглядати датасети. Позиція DOJ не є юридично обов'язковою для суду, але має вагу — вона сигналізує, як виконавча влада бачить баланс між захистом креативної індустрії та розвитком AI-технологій.

Що саме заявив Мін'юст?

DOJ офіційно підтримав аргумент, що тренування AI-моделей на текстах з інтернету підпадає під доктрину fair use — тобто виняток з авторського права, який дозволяє використовувати захищений контент без дозволу власника за певних умов (трансформативність використання, обсяг запозиченого матеріалу, вплив на ринок оригіналу). Це узгоджується з позицією, яку раніше публічно займали OpenAI, Google та Meta у власних судових справах.

Формально позиція оформлена як заява про зацікавленість (statement of interest) — механізм, яким федеральні органи можуть висловити свою думку в приватному судовому спорі, навіть не будучи стороною процесу. Такі заяви суди зазвичай враховують, хоч і не зобов'язані слідувати їм буквально.

Чому це рішення виходить за межі одного позову?

Fair use в американському праві визначається через чотири фактори: мету використання, природу оригінального твору, обсяг запозиченого матеріалу та вплив на ринок правовласника. Суди по всій країні зараз одночасно розглядають десятки подібних справ — проти Anthropic, Meta, Stability AI та інших — і жодна з них ще не дійшла до фінального рішення Верховного суду. Позиція DOJ у справі NYT де-факто стає орієнтиром для того, як федеральна влада інтерпретує ці чотири фактори стосовно машинного навчання.

Якщо позиція DOJ вплине на рішення суду, це може:

Як це вплине на позов NYT проти OpenAI?

Пряме продовження позову не стане автоматичним — суд все одно самостійно оцінюватиме факти справи, зокрема твердження NYT про те, що ChatGPT відтворює цілі уривки її статей майже дослівно. Це ключовий контраргумент видавця: якщо модель здатна репродукувати оригінальний текст, а не лише навчатися на його патернах, класичний тест на трансформативність використання може не спрацювати на користь OpenAI. Позиція DOJ підтримує лише загальний принцип «тренування = fair use», а не конкретні факти цієї справи.

Ми вже розбирали перебіг цього спору між NYT та OpenAI — і ключова інтрига залишається тією ж: суд має розділити питання «чи законне саме навчання» і «чи законний конкретний вивід моделі», а це дві різні юридичні площини.

Висновок AiiN

За нашою оцінкою, найважливіший ефект цієї заяви — не юридичний, а сигнальний: федеральна влада США публічно визнала, що масове навчання на відкритих текстах ближче до fair use, ніж до порушення копірайту, і це знижує тиск на компанії, які будують моделі на великих неліцензованих корпусах. Для команд, що розробляють власні LLM або fine-tune моделі на скрейпнутих даних, це не означає «можна все» — рішення суду в конкретній справі NYT все одно вирішальне, і воно ще попереду. Але сама позиція DOJ дає орієнтир: ризик судового переслідування за сам факт навчання (на відміну від дослівного відтворення контенту) в американській юрисдикції знижується.

Що таке fair use у контексті AI-навчання?

Fair use — це норма американського законодавства про авторське право (17 U.S.C. § 107), яка дозволяє обмежене використання захищених творів без дозволу власника, якщо використання є достатньо трансформативним і не шкодить ринку оригіналу. Для AI-моделей аргумент полягає в тому, що модель не копіює текст, а вчиться на статистичних патернах мови — подібно до того, як людина вчиться писати, читаючи книги.

Чи стосується це українських AI-стартапів?

Безпосередньо ні — рішення американського суду діє в юрисдикції США і не має прямої сили в Україні чи ЄС, де діють інші норми (зокрема Directive on Copyright in the Digital Single Market з окремим режимом text-and-data mining). Але непрямо це впливає на всіх: більшість базових моделей (GPT, Claude, Gemini, Llama), на яких будують продукти команди по всьому світу, тренуються саме американськими компаніями під юрисдикцією США.

Що буде далі зі справою NYT проти OpenAI?

Судовий процес продовжується, і остаточне рішення першої інстанції ще не ухвалене. Позиція DOJ додається до матеріалів справи, і сторони отримають можливість відповісти на неї до наступних слухань.