Amazon оновила умови використання Twitch так, що контент стримерів — прямі трансляції, записи ефірів (VOD) і кліпи — за замовчуванням потрапляє до масиву даних для тренування ШІ-моделей компанії, а відмовитися від цього можна лише вручну, у налаштуваннях приватності акаунта. За даними TechCrunch, зміна торкнеться практично всіх творців на платформі одночасно, і більшість із них дізнається про новий стан речей лише якщо самостійно перевірить налаштування.
Twitch належить Amazon з 2014 року, і для материнської компанії це не просто медіаактив, а джерело живого відео, голосу й неформального спілкування — того типу даних, якого бракує текстовим датасетам, на яких зазвичай тренують мовні моделі. Модель «opt-out за замовчуванням» дозволяє Amazon почати збір даних одразу для всієї бази користувачів, не чекаючи, поки кожен окремо натисне «погоджуюсь».
Для стрімінгової індустрії це прецедент: якщо Amazon проведе зміну без помітного відтоку авторів, схожі механізми, ймовірно, з'являться і в інших продуктах компанії, включно з Alexa та рекомендаційними системами самого Twitch.
Що саме змінилося в правилах Twitch?
Суть зміни — у зміщенні дефолту: раніше використання контенту стримера для тренування ШІ вимагало окремої згоди, тепер ця згода вважається наданою автоматично в момент, коли людина продовжує стрімити на платформі. У таких політиках творець зазвичай формально лишається власником свого контенту, а змінюється лише обсяг ліцензії, яку він видає платформі, — вона за замовчуванням починає включати і право на використання для машинного навчання. Подібний перехід від opt-in до opt-out, за нашими спостереженнями, вже траплявся в політиках інших великих платформ із користувацьким контентом, тож рішення Amazon радше підтверджує загальний тренд, ніж створює його.
Чому Amazon потрібні саме дані зі стрімів?
Живі трансляції — це синхронізовані відео, голос, текстовий чат і реакції аудиторії в одному потоці, тобто саме той тип мультимодальних даних, яких критично бракує розробникам моделей для розпізнавання мовлення, аналізу відео та генерації діалогів. Якість і різноманітність навчальних даних тут напряму визначає, наскільки добре модель розумітиме природну, неструктуровану поведінку людей — тему, яку ми розбирали в матеріалі про те, чому довірені дані визначають масштаб ШІ-агентів. Для Amazon, яка одночасно розвиває голосового асистента Alexa й хмарні ШІ-сервіси через AWS, доступ до мільйонів годин живого відео та розмовної мови — це прямий шлях здешевити збір такого контенту порівняно з ліцензуванням чи найманням акторів для запису розмовних датасетів.
Як стримеру відмовитися від тренування на власному контенті?
Опція відмови існує, але, за інформацією джерела, вимагає активної дії від самого автора — вона не вмикається сама. Практично це означає:
- перевірити розділ приватності або дозволів у налаштуваннях акаунта Twitch;
- знайти пункт, що стосується використання контенту для тренування ШІ-моделей, і вимкнути його вручну;
- мати на увазі, що відмова, ймовірно, діє лише на майбутнє, а не заднім числом — контент, зібраний до вимкнення опції, могли вже додати до навчальних масивів.
Для каналів із командою модерації чи менеджером варто внести цю перевірку в стандартний чекліст налаштування акаунта — так само, як перевірку монетизації чи прав на музику в трансляціях.
Висновок AiiN: чому це важливо не лише для стримерів
За нашою оцінкою, головний ефект цієї зміни — не сама наявність тренування на контенті Twitch, а те, що Amazon нормалізує opt-out як стандартний шлях отримання даних для великих платформ. Коли дефолт працює на компанію, а не на користувача, реальний відсоток людей, які свідомо погодилися на використання свого контенту, стає майже неможливо оцінити — і це проблема довіри, яка з часом торкнеться не лише стрімерів, а й будь-якого творця контенту на платформах великих техкомпаній. Для AI-білдерів це також сигнал: датасети з відео великих платформ найближчими роками ставатимуть доступнішими й дешевшими, але водночас юридично вразливішими, якщо політики згоди у постачальників даних лишатимуться настільки непрозорими.
Чи стосується відмова вже наявних трансляцій?
Судячи з формулювання політики, механізм opt-out діє на майбутнє: вимкнення опції зупиняє подальший збір, але не гарантує видалення контенту, який уже потрапив у навчальні дані раніше.
Чи означає це, що Amazon забирає права на контент стримерів?
Ймовірно, ні в буквальному сенсі: подібні політики зазвичай зберігають авторські права за творцем контенту, а розширюють лише ліцензію на використання для тренування ШІ — точний обсяг цієї ліцензії Amazon публічно не деталізувала.