Google представила Omni: ИИ-инструмент для создания видеоаватаров и трансформации контента
Компания Google представила новую функцию искусственного интеллекта для видео, получившую название Gemini Omni. Этот инструмент призван вывести создание видеоконтента на совершенно новый уровень, предложив уникальные возможности для творческих профессионалов. По заявлению Google, запуск Omni сопоставим по значимости с выходом технологии Nano Banana, которая кардинально изменила подходы к генерации изображений с помощью ИИ.
Функция видеоаватара: цифровой двойник
Одной из наиболее обсуждаемых возможностей Omni является создание видео с использованием персональных аватаров. Пользователи смогут создавать цифровые версии себя, которые будут выглядеть и звучать как они, что позволяет генерировать видеоконтент с собственным голосом. Этот инструмент может быть полезен для создателей контента, желающих выпускать видеоролики даже при отсутствии возможности личного участия, например, из-за внешних факторов.
Google подчеркивает, что все видео, созданные с помощью Omni, будут содержать цифровую подпись SynthID, что позволит подтвердить их происхождение. Компания также отмечает, что активно работает над ответственными методами внедрения функций изменения аудио и речи в видео.
Интеграция физических моделей
Omni отличается от предшественников тем, что интегрирует в создаваемые видео реалистичные физические модели. По данным Google, инструмент обладает улучшенным интуитивным пониманием таких сил, как гравитация, кинетическая энергия и динамика жидкостей. Благодаря знаниям Gemini, Omni может связывать язык, изображения и смысл, выходя за рамки простого сопоставления шаблонов.
Это позволяет создавать детализированные видеоролики даже по коротким запросам, включая сложные объясняющие видеоматериалы (эксплейнеры). Ранее аналогичные возможности анализа и создания эксплейнеров демонстрировал инструмент NotebookLM, и ожидается, что часть этих технологий найдет применение в Omni, значительно расширяя его функционал.
Многообразие входных данных
Одним из ключевых преимуществ Omni является способность преобразовывать различные типы входных данных — изображения, текст, видео или аудио — в целостный видеоролик. Изначально функция аудиовхода будет ограничена голосовыми записями, однако Google обещает в скором времени добавить поддержку других типов звуковых данных.
Пользователи смогут создавать сложные сцены, подбирать стили, описывать желаемый результат с помощью естественного языка и обеспечивать единообразие персонажей на протяжении всего видео.
Разговорное редактирование видео
Omni значительно упрощает процесс редактирования видео, позволяя пользователям взаимодействовать с ним с помощью естественного языка. Каждая последующая инструкция основывается на предыдущих, что обеспечивает сохранение согласованности персонажей, физических свойств и контекста сцены.
Инструмент позволяет изменять отдельные элементы видео или трансформировать весь ролик. Например, пользователи смогут импортировать отснятый материал и попросить Omni удалить помехи, изменить объекты или фон, а также полностью переработать действия, добавить новых персонажей или объекты, превратив обычный момент в нечто неожиданное.
Доступность и перспективы
Функции Omni будут представлены в различных уровнях моделей, начиная с Gemini Omni Flash. Новая возможность появится в приложении Gemini, Google Flow и YouTube Shorts. Пока не уточняется, будет ли поддержка Omni доступна в веб-версии Gemini или потребуется использование интерфейса Flow через браузер.
Ожидается, что со временем Omni будет интегрирован с профессиональными инструментами для редактирования видео, такими как Final Cut, Premiere Pro и DaVinci Resolve, что позволит использовать его возможности в рамках существующих рабочих процессов. Функции Omni также станут доступны корпоративным клиентам и разработчикам через API Google.
Возникают вопросы относительно наличия водяных знаков на генерируемых видео, подобных тем, что используются в изображениях, созданных Nano Banana. Несмотря на полезность маркировки ИИ-контента, она может препятствовать профессиональному использованию инструмента. Пока неясно, будут ли предложены лицензионные уровни, позволяющие удалять водяные знаки, или появятся сторонние решения для их обхода.
Google пока не раскрыла информацию о поддерживаемых видеоформатах и разрешениях. Остается открытым вопрос, станет ли Omni инструментом для профессионального создания видео в разрешениях 4K или 8K, или же он ориентирован в первую очередь на создание контента для коротких видео, таких как YouTube Shorts.
Твитнуть
Просмотров: 12; 
