Владелец TikTok создаст ИИ для генерации пространственного видео


Китайская компания ByteDance готовит модель искусственного интеллекта для создания пространственного видео в реальном времени. Разработка будет конкурировать с решениями от Meta и Google в сфере робототехники, игр и беспилотного транспорта.

Об этом сообщает Dilo со ссылкой на данные Bloomberg.

Разработку лично контролирует основатель корпорации Чжан Имин. Запуск могут произвести уже в следующем месяце, хотя график еще может сместиться. Основатель подключил к проекту разные команды и направил на него главные вычислительные мощности.

В основу легла фирменная модель Seedance, которую компания уже использует для видео в сервисе CapCut и чат-боте Doubao. Новая система позволит создавать трехмерные миры для трансляций, коротких сериалов и игр. По логике она похожа на платформу Genie от Google, которая моделирует физическую среду вживую.

По данным источников, задержка при создании картинки составит около 0,05 секунды при частоте 20 кадров в секунду, а изображение будет реагировать на голос и движения пользователя в шлеме Pico.

Как разработка поможет удешевить VR-устройства

Главная цель проекта – уменьшить стоимость гарнитур виртуальной реальности. Сложные вычисления планируют перенести на удаленные серверы, поэтому очкам больше не понадобятся дорогие мощные чипы.

Благодаря облачной генерации производители смогут выпускать более простые и доступные устройства. Это даст ByteDance преимущество над гарнитурами Quest от Meta и Vision Pro от Apple, производители которых все еще пытаются сделать свои гаджеты массовыми.

Напомним, ранее владелец TikTok привлек рекордный кредит на $29,6 млрд для развития искусственного интеллекта. Китайский технологический гигант ByteDance привлек синдицированный заем от почти 30 банков для наращивания вычислительной инфраструктуры, расширения центров обработки данных и разработки моделей искусственного интеллекта.