Google представила Gemini Omni 1.1 Flash — новый набор инструментов творческого контроля и возможностей генеративного видео для разработчиков. Gemini Omni ранее принесла в генеративное создание контента рассуждения, основанные на реальном мире, а сегодняшнее обновление делает Omni 1.1 готовой к промышленному использованию через Gemini API в Google AI Studio.

Независимо от того, строятся ли на базе модели workflow для генеративного видео, творческие инструменты или ПО для монтажа медиа, новые возможности делают генеративное видео более управляемым, ускоряют итерации и доводят результат до уровня, пригодного для реального внедрения. Разберём, что изменилось.

Расширение сцен для более длинных историй

Расширение сцены позволяет взять существующее видео и бесшовно продолжить генерацию с того места, где оно закончилось.

В Omni 1.1 модель теперь может анализировать до 10 секунд предшествующего контекста — существенный скачок по сравнению с предыдущими версиями, которые опирались только на последнюю секунду видео. Это повышает визуальную согласованность и соответствие повествованию, позволяя выстраивать более длинные истории или уходить в новые творческие направления. Видео можно расширять шагами по 10 секунд вплоть до суммарной длины в 40 секунд.

Расширить сцену через Gemini API можно так:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    previous_interaction_id=previous_video_interaction.id,
    input=[
        {"type": "text", "text": "Continue the scene."}
    ],
    response_format={
        "resolution": "360p",
    },
)

Задание первого и последнего кадра

Плавные переходы и движения камеры теперь достигаются заданием начального и конечного кадра сцены. Omni 1.1 генерирует непрерывное видео между двумя ключевыми кадрами, что подходит для сложных орбитальных проездов камеры, зум-переходов или бесшовных зацикленных клипов.

Более эффективная работа с черновиками в 360p

Модель позволяет генерировать облегчённые превью в разрешении 360p — до 60% быстрее и втрое дешевле по сравнению со стандартным разрешением 720p в Omni 1.1. Это удобно для быстрого прототипирования, итераций по раскадровке и оперативного рендеринга на платформах разработчиков.

*Ускорение генерации до 60% основано на сравнении пропускной способности системы для 360p и 720p.

Апскейлинг до 4K

Omni 1.1 позволяет получать готовый к профессиональному производству результат в разрешении 1080p или 4K.

Видеоссылки в мультимодальном вводе

При построении сцены теперь можно ссылаться на до трёх секунд видео, что помогает сохранять визуальный контекст и согласованность персонажей на основе видеореференсов.

Идеи для того, что можно построить

Ниже — несколько примеров того, как разработчики уже применяют новые возможности в собственных инструментах и творческих workflow.

Одно из приложений позволяет задать первый и последний кадр и сгенерировать переход между ними с помощью пресетов или текстового запроса — благодаря полноконтекстным рассуждениям Omni движения камеры выглядят как настоящие.

Другое приложение проводит камеру через комнаты дома: она делает дуги, наезды и отъезды, показывая жильё в наиболее выигрышном состоянии и при идеальном освещении, не добавляя мебель или детали, которых не существует в реальности.

Ещё один сценарий — «черновая комната»: создатели контента обычно генерируют несколько вариантов видео, прежде чем остановиться на подходящем. Такой инструмент делает этот процесс дешёвым и структурированным — можно сгенерировать 3–4 черновых варианта в 360p, меняя за раз один параметр, и сравнить их между собой.

Как клиенты уже используют Omni Flash в production

Через Agent Platform API клиенты Google уже используют Gemini Omni Flash в реальных производственных процессах.

Adobe встроила Gemini Omni Flash в Adobe Firefly, продемонстрировав возможности модели по монтажу видео.

«Gemini Omni Flash — одна из самых сильных видеомоделей, доступных в Figma Weave, где холст помогает творческим командам развивать каждую генерацию: прикреплять референсы, ветвить разные версии и создавать что-то уникальное. Благодаря расширениям, более богатому референсному материалу и разрешению 4K Gemini Omni Flash выводит команды за рамки простой генерации видео — к его настоящей режиссуре», — Итай Шифф, креативный директор Figma Weave.
«В GMI Cloud мы даём создателям контента централизованный доступ к самым мощным моделям в мире. Что выделяет Gemini Omni Flash — это точность: детали выдерживают самую придирчивую проверку. Для клиентов, создающих образовательный и разъяснительный контент, где важна достоверность, эта надёжность значит больше, чем любая отдельная функция. Omni сделала AI-видео жизнеспособным вариантом для сегмента, который раньше не мог на него полагаться», — Луиза Гуо, вице-президент по маркетингу GMI Cloud.
«Omni Flash органично вписывается в то, как люди уже пользуются Runway: начать с текстового запроса, изображения или видео, а затем генерировать или редактировать дальше. Это ещё один способ для наших пользователей быстро переходить от одной идеи к другой», — Джейми Амферсон, директор по креативу Runway.

Начать работу с Gemini Omni 1.1 Flash уже сегодня

Таблица с ценами на Gemini Omni 1.1 Flash

Omni 1.1 постепенно становится доступной во всей экосистеме разработчиков Google:

Omni 1.1 также уже доступна всем подписчикам Google AI Plus, Pro и Ultra по всему миру в Google Flow. Функция расширения сцен доступна всем подписчикам Google AI Plus, Pro и Ultra по всему миру в приложении Gemini.