Gemini Omni 1.1 Flash: Google обновила ИИ для видео с продолжением сцен до 40 секунд
Google представила Gemini Omni 1.1 Flash — стабильную версию мультимодальной модели для генерации и редактирования видео. Главная новинка не в создании одного длинного клипа, а в управляемом продолжении сцены: модель анализирует до 10 секунд ранее созданного ролика, сохраняет контекст и позволяет наращивать историю десятисекундными фрагментами до суммарных 40 секунд.
Исходное название Gemini Omni 1.1 Flash оказалось верным. Google анонсировала обновление 27 августа 2026 года, а в Gemini API стабильная модель получила ID gemini-omni-1.1-flash. Это развитие прежнего Gemini Omni Flash Preview, который будет выведен из эксплуатации 30 сентября 2026 года.
- Дата релиза
- 27 августа 2026
- Один клип
- от 3 до 10 секунд
- Длинная сцена
- до 40 секунд
- Контекст продолжения
- до 10 секунд видео
Что умеет Gemini Omni 1.1 Flash
Google позиционирует Gemini Omni 1.1 Flash как модель для быстрых разговорных сценариев генерации и редактирования видео. Она принимает текст, изображения и видео, а на выходе создаёт видео. Через Interactions API можно последовательно уточнять результат обычными текстовыми инструкциями — например, изменить движение камеры, продолжить действие или построить новую вариацию сцены.
| Возможность | Как она работает |
|---|---|
| Text-to-video | Создание видео по текстовому описанию |
| Image-to-video | Использование изображения как основы для сцены |
| Scene Extension | Продолжение созданной сцены новыми десятисекундными фрагментами |
| First and last frame | Создание непрерывного движения между заданным первым и последним кадрами |
| Video references | Использование до трёх секунд видео-референса для движения, визуального контекста и согласованности персонажей |
| Conversation-based editing | Правка и развитие ролика через следующие текстовые указания |
| 360p Draft | Быстрые черновики для проверки идеи и промпта |
| 4K upscaling | Масштабирование готового результата до 4K |
Самая заметная функция — управление начальным и финальным кадрами. Пользователь может передать модели две ключевые точки, а Gemini Omni 1.1 Flash создаст видео между ними. Google предлагает использовать этот режим для непрерывных пролётов камеры, сложных переходов с приближением и отдалением, круговых движений вокруг объекта и бесшовных зацикленных роликов.
Ещё одна новая возможность — короткие видео-референсы. Модель принимает до трёх секунд исходного видео и использует его для переноса движения, сохранения визуального контекста и более стабильного образа персонажа. Это не означает автоматическое точное копирование любого человека или клипа: итог зависит от промпта, входных материалов и действующих правил Google для генеративных инструментов.
40 секунд, 4K и звук: что означают цифры
Три числа из анонса требуют точной формулировки. Обычный вывод модели ограничен роликами длиной от трёх до десяти секунд и работает с разрешениями 360p, 720p, 1080p и 4K при 24 кадрах в секунду. Продолжительность до 40 секунд относится к цепочке связанных фрагментов, собранных функцией Scene Extension.
Google прямо называет 4K функцией upscaling. Корректно писать, что Omni 1.1 Flash позволяет получить или масштабировать результат до 4K, а не утверждать, что каждый ролик создаётся нативно в 4K. Для быстрых проверок доступен режим 360p: по оценке Google, он работает до 60 процентов быстрее стандартного 720p и стоит втрое дешевле.
Документация указывает ограничение до 10 секунд как для видео с аудио, так и без него. Официальные примеры Google содержат диалоги, звуковое сопровождение и музыку в промптах, а техническая документация разделяет лимиты видео с аудио и без него. При этом Google не публикует отдельный подробный список поддерживаемых типов звукового дизайна, языков речи или средств контроля голоса.
Где модель доступна и сколько стоит
Gemini Omni 1.1 Flash уже доступна разработчикам через Gemini API и Google AI Studio. Стабильный API ID — gemini-omni-1.1-flash. Для корпоративных сценариев модель разворачивается через Gemini Enterprise Agent Platform и её API; в документации Google Cloud этот путь всё ещё помечен как Preview.
Для пользователей без кода Google открыла модель в Flow. Omni 1.1 Flash доступна глобально подписчикам Google AI Plus, Pro и Ultra. В приложении Gemini этим же категориям подписчиков открыли Scene Extension. Google отдельно не заявляет, что весь набор профессиональных функций Omni 1.1 полностью повторяется внутри обычного приложения Gemini: подтверждена именно возможность продления сцен.
| Способ доступа | Статус и условия |
|---|---|
| Gemini API | Доступна стабильная модель gemini-omni-1.1-flash на платном тарифе |
| Google AI Studio | Доступна для работы с Gemini API и прототипирования |
| Gemini Enterprise Agent Platform | Доступна корпоративным клиентам через Agent Platform API; в Cloud-документации указан Preview |
| Google Flow | Доступна глобально подписчикам Google AI Plus, Pro и Ultra |
| Приложение Gemini | Scene Extension доступен глобально подписчикам Google AI Plus, Pro и Ultra |
| Бесплатный Gemini API tier | Для Gemini Omni 1.1 Flash не заявлен |
Google публикует API-тариф для стандартного режима: входные текст, изображения, видео и аудио стоят 1,50 доллара за миллион токенов, текстовый вывод — 9 долларов за миллион токенов, а видео — 17,50 доллара за миллион токенов. Для 720p Google оценивает видео примерно в 0,10 доллара за секунду: десятисекундный фрагмент ориентировочно обойдётся в 1 доллар без учёта входных данных и возможных особенностей конкретного запроса.
Чем Omni 1.1 отличается от предыдущей версии
Google называет Omni 1.1 производственно готовым обновлением Gemini Omni. Главное улучшение — не новая базовая задача, а более управляемая работа с уже созданным видео: модель анализирует больше контекста для продолжений, поддерживает первый и последний кадры, короткие видеореференсы, быстрые 360p-черновики и 4K-апскейлинг.
Первые официальные примеры акцентируют кинематографические переходы камеры, сохранение внешности персонажа и последовательную работу над серией дублей. Независимых подробных тестов качества от крупных технических редакций в первые дни после запуска пока немного, поэтому заявленные Google улучшения согласованности сцены стоит воспринимать как позиционирование разработчика до появления масштабных сравнений.
Кому пригодится обновление
Gemini Omni 1.1 Flash рассчитана прежде всего на разработчиков творческих инструментов, команды, работающие с рекламными и продуктовыми роликами, дизайнеров, создателей раскадровок и авторов, которым важнее управляемый итеративный процесс, чем один случайный видеоклип. Сначала можно быстро проверить идею в 360p, затем закрепить удачный вариант через ключевые кадры или видеореференс и вывести финальную версию в высоком разрешении.
Для обычного пользователя самый простой вход — Flow с подходящей Google AI-подпиской. Разработчикам интереснее Gemini API: Scene Extension, первые и последние кадры, референсы и апскейлинг можно встроить в собственный редактор, сервис для генерации рекламы или корпоративный медиапроцесс.













