Google запустил новую видеомодель Gemini Omni, которая позволяет редактировать видео на основе текстовых команд. Это важно для создателей контента, так как облегчает процесс редактирования, позволяя изменять сцену и персонажей в реальном времени.
Что нового в Gemini Omni
На конференции I/O 2026 глава Google DeepMind Демис Хассабис представил Gemini Omni Flash — первую модель нового семейства Omni. Эта модель не просто генерирует видео, как прежняя Veo, но и вносит изменения в уже существующие ролики. Теперь пользователи могут передавать текстовые команды и получать результат сразу же.
Одна из ключевых особенностей — возможность изменять любые элементы видео, включая персонажей и объекты, на что не влияют предыдущие действия. Более того, модель корректно обрабатывает физику, что позволяет, например, создавать научные видео с учетом динамики жидкостей и других физических законов.
Безопасность и контроль
Google внедрила ввод цифрового водяного знака SynthID в каждое видео, что позволяет проверить его происхождение через приложение Gemini или браузер Chrome. Модель позволяет использовать персонализированные аватары, но изменять чужую речь на старте нельзя — думать о безопасности важно, поскольку иначе Omni могла бы стать инструментом для распространения дипфейков.
Что это значит для создателей контента
Для российских пользователей Gemini Omni открывает новые горизонты в контенте. В условиях быстро развивающейся индустрии AI это упрощает создание видеоматериалов и удовлетворяет растущий спрос на информационные продукты. Инструменты генерации будут доступны подписчикам Google AI Plus, Pro и Ultra, а также в приложениях YouTube без оплаты в течение первой недели, что расширяет аудиторию.
Следующий шаг — развитие модели Omni Pro, детали о которой Google обещает раскрыть позже. В будущем Omni может начать генерировать не только видео, но и изображения с звуком, что потенциально изменит подходы к созданию мультимедийного контента.