Стартап Mirage провів 24-годинну пряму трансляцію на X із фотореалістичними AI-ведучими, витративши на неї $50 тис. — і продукт весь час псував собі ефект, бо аватари раз у раз затиналися, губили нитку розмови й ламали діалог просто в кадрі. За даними Techmeme, компанія позиціонувала шоу як демонстрацію технології live-генерації відео, здатної замінити традиційний ньюзрум.

Ідея сама по собі не нова: генеративні аватари вже кілька років обіцяють дешевий контент 24/7 без операторів, гримерів і втоми ведучих. Але одна справа — заздалегідь відрендерений рекламний ролик на 30 секунд, і зовсім інша — 24 години безперервного ефіру, де кожна репліка генерується наживо і немає можливості перезняти дубль. Реальний ефір натомість вимагає витримувати години непередбачуваного контексту без монтажу — і саме тут технологія поки програє власним рекламним обіцянкам.

Саме цей розрив між демо-роликом і реальним ефіром і став головним висновком з експерименту Mirage.

Що саме показав Mirage у своєму ефірі?

Компанія запустила добову трансляцію новин на платформі X, де роль ведучих виконували реалістичні AI-аватари, що зачитували новини й вели між собою подобу діалогу. За задумом, це мало виглядати як повноцінна студія мовлення без живих людей у кадрі. Витрати на постановку склали $50 тис. — сума, порівнянна з бюджетом невеликого регіонального ньюзруму на місяць, тільки тут вона пішла на один тестовий ефір.

На практиці аватари регулярно зависали посеред фрази, повторювали чи обривали репліки і втрачали логічний зв'язок між сусідніми сегментами діалогу. Такі збої особливо помітні саме у форматі новин, де глядач очікує зв'язності мовлення, а не творчого відхилення від сценарію, як буває в розважальному контенті. Для глядача, що зайшов у трансляцію випадково, це виглядало не як «новини майбутнього», а як помітний технічний збій у прямому ефірі.

Чому AI-аватари ламаються саме в реальному часі?

Різниця між офлайн-генерацією відео і live-режимом — не косметична. Коли ролик рендериться заздалегідь, модель може прораховувати кожен кадр по кілька разів, а редактор — вирізати невдалі дублі. У прямому ефірі такої можливості немає: система повинна одночасно тримати контекст діалогу, синхронізувати міміку з мовленням і генерувати відео зі стабільною частотою кадрів — і все це без права на помилку чи паузу.

Ймовірно, саме накопичення похибки в довгому контексті — коли модель поступово «забуває» попередні репліки або плутає чергу говоріння — і призводить до зривів діалогу, які й помітили глядачі ефіру Mirage. Це узгоджується з тим, що подібні збої повторювалися протягом усіх 24 годин, а не лише на старті.

Чи виправдані $50 тисяч на такий експеримент?

З погляду піару експеримент спрацював: про 24-годинний ефір Mirage заговорили саме через його недоліки, а не завдяки бездоганній картинці. Але як демонстрація готового продукту для медіакомпаній результат вийшов протилежним до заявленого — він показав межі технології, а не її готовність.

Висновок AiiN

Головний урок тут — не в тому, що AI-аватари «ще сирі», а в тому, що ринок плутає переконливий кадр із переконливим ефіром. Компанії, що будують продукти на live avatar generation, наразі продають глядачеві якість статичного демо, а постачають якість безперервного продакшену — і саме на цьому стику з'являються збої на кшталт тих, що показав Mirage. Для AI-білдерів, які розглядають подібні рішення для власних стрімів чи клієнтських презентацій, розумніше зараз орієнтуватися на короткі, заздалегідь підготовлені сегменти з AI-аватарами, а не на цілодобовий безперервний ефір без страховки у вигляді людини-редактора.

Що таке AI-аватар у контексті новинного мовлення?

Це фотореалістична цифрова модель ведучого, яку генеративна система анімує в реальному часі під згенерований або записаний голос і текст. На відміну від традиційної CGI-анімації, такий аватар не має заздалегідь прорахованих рухів — кожен кадр система домальовує на льоту.

Чи означає збій Mirage, що AI-ведучі новин — це глухий кут?

Ні, це радше сигнал про поточну межу технології для формату 24/7, а не вирок напрямку загалом. Короткі новинні ролики чи персоналізовані відеозведення з AI-аватарами вже працюють стабільніше саме тому, що не вимагають годин безперервної генерації без права на помилку.