Google Vids: персональные аватары и модель Gemini Omni для создания видео
Похоже, Google полагает, что интерес к инструментам, позволяющим пользователям выступать в собственных AI-видео, сохраняется, несмотря на прекращение работы сервиса Sora от OpenAI. В четверг технологический гигант объявил о обновлении Google Vids, которое позволит создавать пользовательские цифровые аватары, внешность и голос которых соответствуют данным пользователя, на основе загруженного селфи и аудиозаписи голоса.
Кроме того, в сервис интегрируется мультимодальная AI-модель Gemini Omni. Это позволит пользователям создавать видео, используя комбинацию текстового запроса и загруженных референсных изображений. Модель объединяет эти входные данные для генерации итогового видеоролика. Инструмент также можно применять для замены фона или коррекции освещения в видео, снятом на смартфон, а также для добавления визуальных эффектов.
Модель Omni теперь поддерживает пошаговое редактирование. Это означает возможность вносить изменения в видео по мере работы над ним, без необходимости начинать создание контента заново с нуля.
Данные обновления расширяют возможности Google Vids за рамки первоначального назначения инструмента как помощника для рабочих презентаций, превращая его в универсальную платформу для создания видеоконтента. Интеграция сервиса в пакет Google Workspace указывает на его позиционирование как корпоративного инструмента для таких задач, как внутренние новости компаний или обучающие видео. Однако наличие персонализированных аватаров и возможности диалогового редактирования выводит сервис в прямую конкуренцию с другими стартапами и инструментами для AI-видео, такими как HeyGen, Synthesia, Captions, D-ID и другими.
Google отмечает, что новые AI-аватары будут привязаны к внешности владельца аккаунта и связаны с его учетной записью Google. Также они будут содержать невидимую водяную метку SynthID. Компания ограничивает доступ к созданию персональных аватаров пользователями старше 18 лет из определенных регионов.


