Google представила Gemini Omni Flash, первую модель в своем семействе Omni, предназначенную для создания и редактирования мультимодального видео. Модель предназначена для того, чтобы пользователи могли создавать и совершенствовать видео посредством разговора, используя входные данные, которые могут включать текст...
Google представила Gemini Omni Flash, первую модель в своем семействе Omni, предназначенную для создания и редактирования мультимодального видео. Модель предназначена для того, чтобы пользователи могли создавать и совершенствовать видео посредством разговора, используя входные данные, которые могут включать текст, изображения, видео и аудио. Он распространяется через приложение Gemini и Google Flow для подписчиков Google AI Plus, Pro и Ultra, при этом для разработчиков запланирована поддержка YouTube Shorts и доступ к API.
Важным отличием является то, что в общедоступных материалах Google запуск описывается как Gemini Omni Flash, а не как пронумерованный релиз Gemini Omni 1.1 Flash. Google также не задокументировал публично заявлений о масштабировании до 4K, управлении первым и последним кадром или режиме рисования 360p. Для команд, оценивающих технологию, доступная информация о продукте указывает на диалоговое создание, многоэтапное редактирование и способность сохранять связность сцены при внесении изменений.
Что Gemini Omni Flash добавляет в видеоинструменты Google
Согласно официальному заявлению Google Gemini Omni, Omni Flash может создавать и редактировать видео посредством диалогового рабочего процесса. Вместо того, чтобы требовать от пользователя создания окончательного запроса за одну попытку, модель поддерживает многоходовую повторную настройку.