Gemini Omni 1.1 Flash — мультимодальная модель Google для генерации и редактирования видео. В Gemini Developer API её официальный идентификатор — gemini-omni-1.1-flash. Модель принимает текст, изображения, аудио и видео как контекст, создаёт видео со звуком и поддерживает последовательные правки через Interactions API.
Главная ошибка при старте — взять название из одного продукта Google и вставить его в другой. У Cloud есть отдельный preview-ID, а Flow и приложение Gemini вообще не требуют модели в конфигурации.
Один продуктовый бренд — несколько разных маршрутов
| Где вы работаете | Что искать | Статус решения |
|---|---|---|
| Gemini API или Google AI Studio | gemini-omni-1.1-flash | Документированный API для генерации и диалогового редактирования |
| Gemini Enterprise Agent Platform | gemini-omni-1.1-flash-preview | Отдельное Preview-предложение с условиями Pre-GA |
| Google Flow | Gemini Omni 1.1 внутри интерфейса | Доступ по подписке, а не API ID |
| Приложение Gemini | Функция продолжения сцены | Наличие зависит от аккаунта и текущего развёртывания |

В официальном анонсе Google называет маршрут Gemini API production-ready для разработчиков. Страница модели в Cloud одновременно помечает gemini-omni-1.1-flash-preview как Preview. Противоречия нет: это разные поверхности с разными договорами и жизненными циклами.
Что действительно изменилось в 1.1
Обновление делает видеопроцесс более управляемым. Можно задать первый и последний кадр, а модель построит движение между ними. Можно использовать короткие видео как референс движения или внешнего вида. Можно сначала получить дешёвый черновик 360p, а выбранный вариант затем увеличить до 1080p или 4K.
Важно точно понимать два рекламно заметных числа.
4K — это апскейл. Документация Gemini API прямо обозначает 1080p и 4K как upscaled output. Высокое разрешение не гарантирует, что модель добавит правдоподобные исходные детали.
40 секунд — это накопленное продолжение. Omni 1.1 анализирует до 10 секунд предыдущего контекста и добавляет видео шагами по 10 секунд, пока общая длина не достигнет 40 секунд. Это не обещание одной 40-секундной генерации по любому запросу.
Такой подход полезен для истории из нескольких продолжений, но у него есть чёткая геометрия: новое содержимое добавляется только в конец. Вставить сцену в середину или дополнить начало нельзя.

Первый запрос к Gemini API
Официальный Python SDK возвращает видео в удобном поле output_video. Минимальный запрос может выглядеть так:
pythonimport base64 from google import genai client = genai.Client() result = client.interactions.create( model="gemini-omni-1.1-flash", input=( "Один непрерывный кадр: бумажный город просыпается на рассвете, " "в окнах по очереди загорается свет. Без диалога." ), response_format={ "type": "video", "aspect_ratio": "16:9", "resolution": "720p", }, ) with open("city.mp4", "wb") as file: file.write(base64.b64decode(result.output_video.data))
В чистом REST ответ устроен иначе: видео находится в массиве steps, поэтому код чтения результата из SDK нельзя переносить дословно. Для вертикального ролика используйте 9:16; 720p — разрешение по умолчанию.
После первой генерации сохраняйте interaction, если хотите править ролик. Короткое указание вроде «сделай свет вечерним, всё остальное оставь без изменений» обычно безопаснее длинного нового описания, которое фактически просит пересоздать сцену.
Ограничения, которые меняют сценарий
Загруженное видео для редактирования или продолжения обычно должно быть не длиннее 10 секунд. Если в нём уже говорит человек, нельзя продолжить этот загруженный ролик и добавить ему новую реплику. Voice editing и отдельные аудиореференсы не поддерживаются.
Для видеореференсов действует другой предел: до трёх роликов, каждый до трёх секунд. Их звук игнорируется. Это способ передать движение и внешний контекст, а не инструмент рассуждения по нескольким полноценным видео.
В Европейской экономической зоне, Швейцарии и Великобритании редактирование или продолжение загруженного пользователем видео сейчас недоступно. Продолжение ролика, ранее созданного самой моделью, рассматривается отдельно и поддерживается в доступных регионах.
Есть ограничения на редактирование изображений с несовершеннолетними и некоторыми узнаваемыми людьми. Все сгенерированные видео получают невидимую маркировку SynthID, а вход и выход проходят фильтры безопасности. Английский язык официально полностью поддерживается; другие языки, по словам Google, ещё не получили равную оценку, поэтому качество русских инструкций может колебаться.
Сколько стоит Gemini Omni 1.1
Точную цену нужно проверять по конкретной поверхности и ID. На 29 августа 2026 года страница цен Gemini Developer API всё ещё показывала читаемую строку старого gemini-omni-flash-preview: примерно 0,10 доллара за секунду видео 720p. В этой строке не был однозначно указан 1.1.
Поэтому старую цифру нельзя выдавать за подтверждённый тариф gemini-omni-1.1-flash. Перед расчётом бюджета проверьте текущую консоль, единицу биллинга, разрешение, квоту и правила оплаты неуспешных запросов. Cloud Preview имеет отдельный ID и собственную модель потребления; стоимость Developer API к нему автоматически не переносится.
Когда выбирать Omni, а когда другую ветку
Gemini API подходит, если приложению нужен цикл «создать — оценить — изменить — продолжить» и ограничения на загрузки допустимы. Flow и Gemini удобнее для ручного процесса внутри подписки. Cloud Preview имеет смысл только тогда, когда проект принимает Pre-GA условия и фиксированную квоту.
Если задача — сравнить более зрелые видеомодели и их стоимость, следующим шагом будет разбор цены Veo 3. Если неясны ключ, бесплатный уровень и биллинг, начните с руководства по Gemini API Free Tier.
Перед production сохраните рядом с конфигурацией точный model ID, название поверхности Google, регион, дату проверки и резервный маршрут. Это защищает интеграцию от ситуации, когда имя из приложения, Cloud Preview и Developer API ошибочно превращаются в один и тот же «Gemini Omni».



