Засновник ByteDance Чжан Їмін особисто очолює розробку моделі генерації просторового відео в реальному часі, а реліз продукту компанія планує вже наступного місяця — про це з посиланням на власні джерела повідомив Bloomberg. За даними Techmeme, точна архітектура моделі та дата виходу поки не розкриті, але сама участь засновника в конкретному технічному проєкті — сигнал, що ByteDance розглядає просторове відео як стратегічний напрямок, а не лабораторний експеримент.
Компанія вже має досвід у генеративному відео: модель Seedance від ByteDance конкурує з Sora від OpenAI та Veo від Google DeepMind на ринку text-to-video. Новий продукт іде далі — мова не про плоский відеоряд, а про просторовий (spatial) контент, який рендериться в реальному часі й потенційно сумісний із форматами перегляду на VR- та AR-гарнітурах.
Гонка за генеративне відео у 2026 році змістилася від питання «чи виглядає це реалістично» до питання «чи можна цим керувати в реальному часі і в трьох вимірах». ByteDance ставить особисту репутацію засновника на цю ставку раніше за конкурентів.
Що саме відомо про новий продукт?
Офіційного анонсу поки немає — інформація походить від Bloomberg через джерела, знайомі з розробкою. З відомого:
- модель генерує «просторове» відео, а не звичайний плоский кадр;
- рендер відбувається в реальному часі, а не пакетно, як у більшості поточних відео-моделей;
- проєктом особисто керує Чжан Їмін, засновник і колишній CEO ByteDance;
- орієнтовний реліз — жовтень 2026 року.
Реальний час тут ключове слово. Sora та Veo генерують відео пакетно: запит іде в чергу, рендер триває від десятків секунд до кількох хвилин, а результат — фіксований файл. Модель, що генерує кадри в реальному часі, натомість ближча до ігрового рушія: вона потенційно здатна реагувати на дії користувача — наприклад, зміну ракурсу камери — просто під час генерації.
Чим просторове відео відрізняється від звичайної генерації?
Просторове відео кодує не лише кольори пікселів, а й геометрію сцени — глибину, ракурси, паралакс при зміні точки перегляду. Apple вже впровадила формат spatial video для Vision Pro, а Meta — для Quest-гарнітур, але в обох випадках це запис реальною камерою, а не генерація. ByteDance, за даними Bloomberg, працює над тим, щоб такий контент можна було створювати генеративно — без камери, лише з текстового чи графічного промпту.
Поєднання «просторове» плюс «реальний час» технічно складніше за звичайний text-to-video: модель має тримати консистентність геометрії сцени між кадрами і встигати робити це зі швидкістю, достатньою для інтерактивного перегляду. Конкретних цифр продуктивності Bloomberg не наводить.
Навіщо в це особисто вкладається Чжан Їмін?
Особиста участь засновника в конкретному технічному проєкті — рідкість для компанії масштабу ByteDance, материнської структури TikTok. Чжан Їмін відійшов від операційного управління ByteDance ще кілька років тому, залишившись головою ради директорів, тому його повернення до кураторства окремого AI-продукту сигналізує про пріоритетність напрямку всередині компанії.
За нашою оцінкою, ставка на просторове відео в реальному часі — спроба ByteDance застовпити нішу до того, як туди зайдуть Google, OpenAI чи Meta: жоден із великих гравців поки публічно не анонсував генеративну модель саме такого класу, хоча всі троє розвивають суміжні напрямки — від інтерактивних світових моделей до 2D-генерації відео.
Що з цього робити AI-білдерам вже зараз?
Продукту ще немає, тож конкретних API чи SDK для інтеграції поки не існує. Але напрямок вартий уваги, якщо ви працюєте з:
- VR/AR-контентом — генеративний spatial video потенційно закриє дефіцит нативного 3D-відео для Vision Pro та Quest-гарнітур;
- інтерактивними AI-агентами та світовими моделями — рушій, здатний генерувати простір у реальному часі, за архітектурою близький до world models, які застосовують для навчання роботів і агентів;
- відеопродакшеном — якщо реліз відбудеться і компанія відкриє доступ через API, це стане першим комерційним інструментом такого класу, і рання інтеграція дасть перевагу перед конкурентами.
Висновок AiiN
Наша теза: перехід від «згенерувати відео» до «згенерувати простір, яким можна керувати в реальному часі» — не косметичне покращення, а зміна категорії продукту, ближча до ігрових рушіїв і симуляторів, ніж до відеогенераторів. Якщо ByteDance справді випустить робочу версію вже в жовтні 2026 року, компанія на кілька місяців випередить Google та OpenAI в ніші, де поки що взагалі немає комерційних гравців — і це дасть їй перевагу першопрохідця не лише в контенті для TikTok, а й у потенційній ліцензії технології для VR-індустрії.
Чи можна вже протестувати модель ByteDance?
Ні. За даними Bloomberg, проєкт ще в розробці, публічної бета-версії чи документації API немає. Найраніше доступ можна очікувати після анонсованого релізу, орієнтовно в жовтні 2026 року.
Чим це відрізняється від Seedance та Sora?
Seedance від ByteDance та Sora від OpenAI генерують плоске 2D-відео пакетним рендером за запитом. Нова модель, за наявною інформацією, додає просторову геометрію сцени і рендерить її в реальному часі, а не як фіксований відеофайл.