Sony Music Group та Warner Chappell Music подали позов проти Anthropic, звинувативши компанію у систематичному використанні текстів пісень без ліцензії для тренування моделей Claude. За даними The Decoder, позивачі називають це одним із наймасштабніших і найбільш очевидних випадків систематичного порушення авторських прав в історії індустрії.
Це не перший конфлікт музичної індустрії з Anthropic: ще у 2023 році Universal Music Group разом з іншими видавцями подавали окремий позов через те, що Claude відтворював тексти пісень у відповідях користувачам. Новий позов Sony Music та Warner Chappell розширює коло позивачів до двох інших мейджор-лейблів і показує, що претензії до Anthropic не обмежилися одним ізольованим інцидентом.
Для AI-індустрії суть спору проста: чи можна законно тренувати мовну модель на захищених авторським правом текстах без окремої ліцензії від правовласника. Від відповіді на це питання залежить, наскільки дорожчим і повільнішим стане процес збору тренувальних даних для всіх розробників LLM, не лише для Anthropic.
У чому саме звинувачують Anthropic?
Sony Music та Warner Chappell стверджують, що Anthropic використала тексти пісень, права на які належать лейблам, для тренування моделей сімейства Claude без згоди правовласників і без виплати роялті. Позивачі описують дії компанії як системне копіювання захищеного контенту у масштабі, який характеризують як умисне порушення, а не поодинокий технічний збіг.
- Позов стосується текстів пісень (lyrics), а не аудіозаписів — тобто йдеться про порушення прав музичних видавців, а не звукозаписувальних компаній у класичному розумінні.
- Формулювання позивачів навмисно жорстке — вони описують ситуацію як «один із найбільших і найбільш очевидних випадків крадіжки інтелектуальної власності», закладаючи риторичну основу для вимоги посилених компенсацій.
Чому цей позов важливіший за попередні суперечки з AI-компаніями?
Тому що він приходить не сам: Anthropic вже перебуває під тиском схожих претензій з боку музичної індустрії з 2023 року, і поява Sony Music та Warner Chappell як окремих позивачів сигналізує про скоординовану стратегію мейджор-лейблів, а не разові спроби окремих видавців. Коли до справи долучаються кілька найбільших правовласників одночасно, суд отримує ширшу доказову базу, а сама компанія — довший і дорожчий судовий процес.
Паралельно музична індустрія вже судиться з AI-стартапами, що генерують музику, — Suno та Udio отримали подібні позови раніше. Anthropic у цьому контексті цікавий тим, що сама компанія позиціонує себе як «безпечнішу» альтернативу серед розробників LLM, і позов від музичних гігантів б'є саме по цій репутаційній ставці.
Що це означає для того, які дані взагалі можна використовувати для тренування LLM?
Це і є ключова ставка справи, за нашою оцінкою: рішення суду фактично встановить прецедент — чи достатньо просто мати доступ до тексту в інтернеті, щоб законно тренувати на ньому модель, чи потрібна окрема ліцензія від правовласника незалежно від способу отримання даних. Якщо суд стане на бік лейблів, розробникам LLM доведеться або ліцензувати корпуси текстів заздалегідь, або ризикувати мільйонними позовами постфактум.
Це напряму продовжує лінію, яку ми вже розбирали в матеріалі чому позов Sony Music і Warner проти Anthropic змінює правила гри: судова практика щодо тренувальних даних формується саме зараз, і кожен новий позов додає прецедентів, на які спиратимуться майбутні справи проти інших лабораторій.
Висновок AiiN
Наша теза: для AI-білдерів цей позов важливий не через суму можливої компенсації, а через те, що він тестує саму легальність підходу «тренуємось на всьому, що знайшли в інтернеті». Якщо мейджор-лейбли доб'ються визнання системного порушення, дешевий доступ до великих текстових корпусів для тренування LLM закінчиться для всієї індустрії, а не лише для Anthropic — і компанії, які вже інвестували в ліцензійні угоди з видавцями, отримають конкурентну перевагу.
Чи стосується цей позов лише Anthropic, чи й інших розробників LLM?
Формально позов подано проти Anthropic, але прецедент, який може встановити суд щодо законності тренування на захищених текстах без ліцензії, вплине на весь ринок — від OpenAI до Google та Meta, які тренують моделі на подібних за походженням даних.
Чим цей позов відрізняється від справ проти Suno чи Udio?
Suno та Udio звинувачують у генерації аудіозаписів, схожих на оригінальні треки, тобто йдеться про звукозаписи. Позов Sony Music та Warner Chappell проти Anthropic стосується текстів пісень і того, як мовна модель їх відтворює чи використовує в тренуванні — це інший тип контенту й інший клас правовласників.