Google представила Gemini Omni 1.1 Flash для генерации и редактирования видео
Новая модель поддерживает текст, изображения, звук и видео, позволяя задавать начальные и конечные кадры, а также расширять существующие сцены.
27 августа 2026 года Google официально выпустила Gemini Omni 1.1 Flash в общий доступ. Мультимодальная модель предназначена для генерации и редактирования видео с помощью ИИ.
Ключевая функция — Scene Extension (расширение сцены). Она анализирует до 10 секунд контекста исходного видео для бесшовного продолжения видеоряда, сохраняя атмосферу и композицию. Пользователи также могут задавать начальный и конечный кадры для контроля направления и плавности переходов.
Модель поддерживает разрешение до 4K, а также режим черновиков Draft в 360p для быстрой проверки идей и экономии ресурсов при тестировании промптов. В качестве входных данных поддерживаются текст, изображения, аудио и видео, что позволяет комбинировать различные модальности для точного управления результатом.
Gemini Omni 1.1 Flash доступна через Google AI Studio, Gemini Enterprise Agent Platform и Google Flow. Этот релиз знаменует переход ИИ-инструментов от простой генерации роликов по тексту к точному покадровому контролю и редактированию контента. Впрочем, итоговое качество по-прежнему зависит от специфики видео, промптов и последующей доработки.
У разработчиков и создателей контента появился новый инструмент для прототипирования, продления сцен и настройки темпа видео с помощью ИИ. Режим 360p позволяет быстро тестировать идеи перед ресурсоемким финальным рендерингом в 4K.