Amazon оновила умови використання Twitch так, що контент стримерів — прямі трансляції, записи ефірів (VOD) і кліпи — за замовчуванням потрапляє до масиву даних для тренування ШІ-моделей компанії, а відмовитися від цього можна лише вручну, у налаштуваннях приватності акаунта. За даними TechCrunch, зміна торкнеться практично всіх творців на платформі одночасно, і більшість із них дізнається про новий стан речей лише якщо самостійно перевірить налаштування.

Twitch належить Amazon з 2014 року, і для материнської компанії це не просто медіаактив, а джерело живого відео, голосу й неформального спілкування — того типу даних, якого бракує текстовим датасетам, на яких зазвичай тренують мовні моделі. Модель «opt-out за замовчуванням» дозволяє Amazon почати збір даних одразу для всієї бази користувачів, не чекаючи, поки кожен окремо натисне «погоджуюсь».

Для стрімінгової індустрії це прецедент: якщо Amazon проведе зміну без помітного відтоку авторів, схожі механізми, ймовірно, з'являться і в інших продуктах компанії, включно з Alexa та рекомендаційними системами самого Twitch.

Що саме змінилося в правилах Twitch?

Суть зміни — у зміщенні дефолту: раніше використання контенту стримера для тренування ШІ вимагало окремої згоди, тепер ця згода вважається наданою автоматично в момент, коли людина продовжує стрімити на платформі. У таких політиках творець зазвичай формально лишається власником свого контенту, а змінюється лише обсяг ліцензії, яку він видає платформі, — вона за замовчуванням починає включати і право на використання для машинного навчання. Подібний перехід від opt-in до opt-out, за нашими спостереженнями, вже траплявся в політиках інших великих платформ із користувацьким контентом, тож рішення Amazon радше підтверджує загальний тренд, ніж створює його.

Чому Amazon потрібні саме дані зі стрімів?

Живі трансляції — це синхронізовані відео, голос, текстовий чат і реакції аудиторії в одному потоці, тобто саме той тип мультимодальних даних, яких критично бракує розробникам моделей для розпізнавання мовлення, аналізу відео та генерації діалогів. Якість і різноманітність навчальних даних тут напряму визначає, наскільки добре модель розумітиме природну, неструктуровану поведінку людей — тему, яку ми розбирали в матеріалі про те, чому довірені дані визначають масштаб ШІ-агентів. Для Amazon, яка одночасно розвиває голосового асистента Alexa й хмарні ШІ-сервіси через AWS, доступ до мільйонів годин живого відео та розмовної мови — це прямий шлях здешевити збір такого контенту порівняно з ліцензуванням чи найманням акторів для запису розмовних датасетів.

Як стримеру відмовитися від тренування на власному контенті?

Опція відмови існує, але, за інформацією джерела, вимагає активної дії від самого автора — вона не вмикається сама. Практично це означає:

Для каналів із командою модерації чи менеджером варто внести цю перевірку в стандартний чекліст налаштування акаунта — так само, як перевірку монетизації чи прав на музику в трансляціях.

Висновок AiiN: чому це важливо не лише для стримерів

За нашою оцінкою, головний ефект цієї зміни — не сама наявність тренування на контенті Twitch, а те, що Amazon нормалізує opt-out як стандартний шлях отримання даних для великих платформ. Коли дефолт працює на компанію, а не на користувача, реальний відсоток людей, які свідомо погодилися на використання свого контенту, стає майже неможливо оцінити — і це проблема довіри, яка з часом торкнеться не лише стрімерів, а й будь-якого творця контенту на платформах великих техкомпаній. Для AI-білдерів це також сигнал: датасети з відео великих платформ найближчими роками ставатимуть доступнішими й дешевшими, але водночас юридично вразливішими, якщо політики згоди у постачальників даних лишатимуться настільки непрозорими.

Чи стосується відмова вже наявних трансляцій?

Судячи з формулювання політики, механізм opt-out діє на майбутнє: вимкнення опції зупиняє подальший збір, але не гарантує видалення контенту, який уже потрапив у навчальні дані раніше.

Чи означає це, що Amazon забирає права на контент стримерів?

Ймовірно, ні в буквальному сенсі: подібні політики зазвичай зберігають авторські права за творцем контенту, а розширюють лише ліцензію на використання для тренування ШІ — точний обсяг цієї ліцензії Amazon публічно не деталізувала.