AI

Google открыла доступ к Gemini Omni 1.1 Flash для генерации и редактирования видео

Google открыла доступ к Gemini Omni 1.1 Flash для генерации и редактирования видео

выпустила Omni 1.1 Flash — стабильную версию модели для генерации и редактирования видео через Gemini API. Она пришла на смену предварительной версии Gemini Omni Flash.

Модель умеет продолжать ролик, строить видео между первым и последним кадрами и повышать разрешение результата до 4K. Она доступна разработчикам через Gemini API в Google AI Studio.

Читайте также: Подписка Google AI Pro (Gemini/One): что входит, как купить и оплатить из России

Gemini Omni 1.1 Flash — что изменилось

Gemini Omni 1.1 Flash анализирует до 10 секунд а исходного видео и может продолжать сцену фрагментами по 10 секунд. Общая длина такой цепочки — до 40 секунд.

Google открыла доступ к Gemini Omni 1.1 Flash для генерации и редактирования видео

Google открыла доступ к Gemini Omni 1.1 Flash для генерации и редактирования видео

В модели также появились интерполяция между двумя ключевыми кадрами и управление разрешением. Для быстрых черновиков доступен режим 360p; базовое разрешение — 720p. Результат в 1080p и 4K модель получает через апскейл. В запрос можно добавить до трёх секунд видео как референс для сохранения визуального контекста и согласованности персонажей.

Как пользоваться Gemini Omni 1.1 Flash

Откройте Google AI Studio и создайте запрос к Gemini API с моделью gemini-omni-1.1-flash. Для продолжения сцены передайте идентификатор предыдущего взаимодействия и текстовое указание. Для видео между ключевыми кадрами добавьте до двух изображений; разрешение результата задаётся параметром video_config.

Google открыла доступ к Gemini Omni 1.1 Flash для генерации и редактирования видео

Google открыла доступ к Gemini Omni 1.1 Flash для генерации и редактирования видео

Предварительная версия gemini-omni-flash-preview останется доступна до 30 сентября 2026 года, после чего Google её отключит.

Стоимость видео в Gemini API для платного тарифа составляет $17,50 за 1 млн выходных токенов, что соответствует примерно $0,10 за секунду видео. Входные данные тарифицируются по $1,50 за 1 млн токенов.

Почему это важно? Разработчики могут использовать одну стабильную модель для создания видео, продолжения готовой сцены, перехода между кадрами и повышения разрешения результата.

Ранее Google представила Gemini 3.5 Transcribe — модель для распознавания речи и расшифровки аудиозаписей.

Итог: Gemini Omni 1.1 Flash стала стабильной видеомоделью Google с продолжением сцен, интерполяцией кадров и генерацией видео с разрешением до 4K.

Источник

Добавить комментарий

Кнопка «Наверх»