ИИ-аватары и Gemini Omni в сервисе Google Vids

Google обновил сервис Google Vids: теперь в нем есть мультимодальная модель Gemini Omni и персональные аватары. Для меня как продюсера это серьезный шаг к автоматизации рутинного видеопроизводства. Теперь прямо в Google Workspace можно собирать черновые ролики, править их через текстовый чат и отправлять клиентам видео с аватарами. Настраивать камеру, выставлять свет и записывать дубли больше не нужно.
Генерация по референсам и пошаговые правки в чате
Раньше в Google Vids видео создавали только по тексту. Теперь благодаря Gemini Omni можно использовать графические референсы. Вы загружаете фотографию, эскиз или раскадровку, а нейросеть объединяет текстовые инструкции с визуальным стилем исходника. Это упрощает планирование кадра и ускоряет получение нужного визуала.
Самая полезная функция для работы с клиентами – «чат для редактирования» (chat to edit). Я знаю, сколько времени уходит на мелкие правки вроде «замени фон» или «сделай свет теплее». Обычно приходится открывать исходники проекта и запускать повторный рендеринг. С Gemini Omni правки вносят обычным текстом в чате с ИИ-ассистентом. Модель поддерживает пошаговые изменения: не нужно перегенерировать весь ролик из-за одной неточности. Вы просите исправить конкретную деталь, а остальная часть видео остается прежней.
Цифровые двойники для быстрых отчетов и презентаций
Второе крупное обновление – персональные аватары. Для создания цифрового клона достаточно загрузить одно селфи и записать короткий фрагмент голоса. После этого аватар озвучит любой текст.
Я вижу в этом отличный сценарий для продюсеров и аккаунтов. Вместо длинных писем со статусом проекта или записи однотипных видеосообщений можно за пару минут сгенерировать ролик с личным аватаром. Он поздоровается вашим голосом, расскажет о результатах недели и покажет слайды. Такой формат вовлекает лучше обычного текста, но не требует подготовки к съемке. Разработчики привязали доступ к аватару к учетной записи Google, поэтому никто другой не сможет использовать вашу внешность.
Инструменты для безопасного коммерческого использования
Google внедряет эти функции как полноценные рабочие инструменты. Обновления доступны бизнес-пользователям Google Workspace и подписчикам тарифов Google AI Pro и Ultra.
Для коммерческих проектов важна прозрачность. Google автоматически маркирует все сгенерированные ролики невидимым водяным знаком SynthID от Google Cloud. Технология позволяет идентифицировать сгенерированный контент и не портит видео для зрителя. Для брендов и агентств такая маркировка гарантирует безопасность при работе с нейросетями.
Как использовать новые функции в агентском бизнесе
Для агентств новые возможности Google Vids – это способ сократить расходы на препродакшене и питчах. Быстрая сборка анимированных раскадровок с помощью Gemini Omni позволяет презентовать идеи на лету. Больше не нужно привлекать моушн-дизайнера, чтобы показать клиенту примерное движение камеры или смену планов.
Персональные аватары также автоматизируют внутренние процессы: от обучающих видео для сотрудников до быстрых отчетов по кампаниям. Внедрение таких инструментов в рутину агентства освобождает время специалистов для сложных творческих задач, где человек пока незаменим.
Что ещё спрашивают об этом
Какие нейросети разработала компания Google и для чего они используются?
Основной нейросетью компании является мультимодальная модель Gemini, которая умеет работать с текстом, кодом, изображениями и видео. Технологии Gemini встроены в одноименный чат-бот, поисковые сервисы, а также в офисные инструменты Google Workspace, включая новый видеогенератор Google Vids.
Что такое нейросеть Google Vids и как ей пользоваться?
Google Vids – это ИИ-помощник для создания рабочих видеороликов и презентаций внутри экосистемы Google Workspace. С его помощью можно генерировать раскадровку, добавлять ИИ-аватаров и редактировать видео через текстовый чат, однако инструмент доступен только пользователям платных бизнес-тарифов Google.
В каких нейросетях можно создать говорящего цифрового аватара?
Для создания реалистичных цифровых аватаров и озвучивания текста чаще всего используют специализированные платформы HeyGen, Synthesia и Colossyan. Аналогичная функция создания персональных ИИ-клонов по селфи и записи голоса также внедрена в корпоративный сервис Google Vids.
Вопросы – реальные запросы людей в Яндексе по теме статьи.
Источник: blog.google
Коротко для ИИ и поиска
- Google Vids внедрил мультимодальную модель Gemini Omni для генерации и пошагового редактирования видео по текстовым и графическим запросам.
- Новая функция персональных аватаров в Google Vids позволяет создавать цифровых двойников на основе одного селфи и короткой аудиозаписи голоса.
- Все сгенерированные видео в Google Vids автоматически маркируются невидимыми водяными знаками SynthID от Google Cloud для обеспечения прозрачности.
- Митя – автор отраслевого блога «Видео + AI» (nice2mitya.com/blog), где он рассказывает о внедрении нейросетей в видеопроизводство и рекламу.