Google DeepMind запускает Gemini Omni 1.1 Flash с расширением сцен, управлением ключевыми кадрами и масштабированием до 4K
Ключевые выводы
- •Gemini Omni 1.1 Flash может расширять видеосцены с шагом 10 секунд до суммарного максимума 40 секунд, анализируя до 10 секунд предыдущего контекста вместо одной секунды в ранних моделях.
- •Разработчики могут задавать первый и последний ключевые кадры, а модель генерирует непрерывное видео между ними для орбит камеры, зум-переходов и бесшовных циклов.
- •Черновые предпросмотры в 360p генерируются до 60% быстрее и в три раза дешевле стандартного 720p, по данным сравнения пропускной способности Google, а финальные проекты можно рендерить в 1080p или 4K.
- •Adobe интегрировала Gemini Omni Flash в Adobe Firefly, а партнёры, включая Figma Weave, GMI Cloud и Runway, сообщают об использовании модели в производственных творческих рабочих процессах.
- •Модель доступна разработчикам через Google AI Studio и Gemini Enterprise Agent Platform, а также распространяется среди подписчиков Google AI Plus, Pro и Ultra по всему миру в Google Flow; расширение сцен доступно в приложении Gemini.

Google DeepMind запускает Gemini Omni 1.1 Flash с расширением сцен, управлением ключевыми кадрами и масштабированием до 4K
Google DeepMind, подразделение Google по исследованиям в области ИИ, стоящее за семейством моделей Gemini, представило Gemini Omni 1.1 Flash — готовое к производству обновление, которое даёт разработчикам более точный контроль над генеративным видео. Объявленный 27 августа 2026 года Product Managers Google DeepMind Anish Nangia и Alisa Fortin релиз предлагает возможности видеопроизводства студийного уровня, включая расширение сцены, интерполяцию первого и последнего кадра, чёткое масштабирование до 4K и более быстрое прототипирование. Начать работу можно уже сегодня, получив доступ к модели через Google AI Studio или Gemini Enterprise Agent Platform.
По словам Google, Gemini Omni привнесла в генеративное создание способность к рассуждению в реальных сценариях, а новые обновления делают Omni 1.1 готовой к производственному использованию в профессиональной среде через Gemini API в Google AI Studio. Независимо от того, создают ли разработчики рабочие процессы генеративного видео, творческие инструменты или ПО для редактирования медиа, обновление призвано сделать генеративное видео более управляемым, ускорить итерации и обеспечить более высокий уровень готовности для реального применения. Набор функций нацелен на практический разрыв между сырой генерацией и финальной продакшен-работой: сохранение согласованности материала на больших промежутках, осознанное управление камерой и дешёвые итерации до перехода к финальному рендеру.
Ключевые возможности:
- Расширение сцен до 40 секунд с улучшенной визуальной согласованностью и развитием повествования.
- Задание начального и конечного кадров для плавных, профессиональных движений камеры и переходов.
- Использование предпросмотров 360p для более быстрых итераций и экономии средств в творческом процессе.
- Масштабирование финальных проектов до 4K для полированного, профессионального вида.
Расширение сцен для более длинного повествования
Расширение сцены позволяет взять существующее видео и продолжить генерацию кадров бесшовно с того места, где оно остановилось. В Omni 1.1 модель теперь может анализировать до 10 секунд предыдущего контекста — это серьёзный шаг вперёд по сравнению с предыдущими моделями, которые опирались только на последнюю секунду. По словам Google, результатом стали лучшая визуальная согласованность и более точное следование повествованию, что позволяет строить более длинные истории или уходить в новые творческие направления. Видео можно расширять с шагом 10 секунд до общей суммарной длины 40 секунд. Сохранение согласованности на более длинных отрезках — одна из самых сложных задач в генеративном видео, где модели обычно создают короткие клипы, визуально «уплывающие» при растяжении за пределы исходной длины.
Опубликованные вместе с анонсом примерные цепочки промптов иллюстрируют эту функцию:
- Prompt 1: Camera slightly pans and we now see she is talking to a man with curly hair, we see man's back, he says "I see it too" dramatic music score
- Prompt 2: Camera slowly pulls out, forgotten dusty catacombs, dramatic music score.
- Prompt 3: Camera slowly pulls out, a vast library where shelves and books float weightlessly in a dusty void, dramatic music score.
Вторая последовательность демонстрирует кинематографическое продолжение движения камеры:
- Prompt 1: Continue the video. Execute a cinematic optical dolly-zoom shot. The camera dollies forward while simultaneously zooming out, keeping the character's frozen shocked face locked at the exact same size. The long corridor of stone pillars in the background dramatically stretches and deepens with intense optical perspective distortion. Clean architecture, continuous unbroken shot.
- Prompt 2: Continue the video. The camera executes a fast mechanical snap-zoom directly into the character's wide eyes. Stylized cinematic camera control.
- Prompt 3: Continue the video. Time completely freezes into a static moment: the character, their windblown coat. The camera performs a smooth, high-speed 360-degree orbital rotation around the frozen character, showcasing dramatic 3D depth and parallax across the colonnade. Flawless continuity.
Дополнительные примеры показывают продолжения на основе диалога:
- Prompt 1: The man in the blue sweater replies: "Did your father go out on the boat too?"
- Prompt 2: The camera pulls back in one continuous movement as he continues his story: "He used to say that this harbour had a soul. And that the boats were a part of us." The music swells.
Ещё одна пара промптов описывает продолжения в стиле ведущего:
- Prompt 1: The looks directly at the camera and talks about what the final chapter will end with!
- Prompt 2: He then stands up walks around the desk to the camera and says "what would you choose?"
Google также описывает, как расширять сцену с помощью Gemini API.
Задание первого и последнего кадров
Разработчики могут добиваться плавных переходов и движений камеры, задавая начальный и конечный кадры сцены. Omni 1.1 генерирует непрерывное видео между двумя ключевыми кадрами, что делает его подходящим для сложных орбит камеры, зум-переходов или бесшовных циклических клипов. Примеры промптов:
- Prompt 1: A close-up low-angle shot of a stylish drummer in a beige suit playing a red drum kit in a grand hall transitions as the camera whip-pans to the side, revealing an older saxophonist playing alongside a ballet dancer spinning in a white outfit under soft purple stage lights. One continuous shot, no jump cuts.
- Prompt 2: The camera zooms into the TV screen, where we see the same woman and the same scene from the beginning. Seamless video. One continuous shot, no jump cuts.
Более эффективная подготовка черновиков в 360p
Omni 1.1 может создавать лёгкие предпросмотры в разрешении 360p до 60% быстрее и в три раза дешевле по сравнению со стандартным разрешением модели 720p. Google отмечает, что это полезно для быстрого прототипирования, итераций над раскадровкой и оперативного рендеринга в платформах для разработчиков. Компания также указывает сноску: показатель «до 60% быстрее» основан на системной пропускной способности для 360p по сравнению с 720p.
Один из примеров промпта звучит так: A microscopic view of iridescent marine diatoms, displaying intricate, glass-like silica shells with breathtaking natural symmetry. The colors range from deep volcanic amber and warm copper to vibrant turquoise and violet, mimicking the rich palette of earth and ocean. Tiny, delicate structures glow softly against a clean dark field background. High-fidelity scientific imaging, sharp details, organic textures, micro-photography. Maintain the microscope lens effect throughout the entire video.
Масштабирование до разрешения 4K
Модель создаёт отшлифованные высококачественные выходные материалы в 1080p или 4K, готовые для профессионального производства. Примеры промптов:
- Prompt 1: Fish swimming, tracking shot
- Prompt 2: A little chipmunk darting out of the woods from the left side of the screen and sniffing the air inquisitively before darting out of frame on the right side
- Prompt 3: Cinematic macro close-up of vibrant golden-orange Japanese maple leaves on a delicate branch, gently rustling and swaying in a soft, rhythmic autumn breeze. Sunlight filters through the translucent foliage, creating a warm, glowing effect. Shallow depth of field, dreamy bokeh background, hyper-detailed textures, photorealistic, 4k.
Ссылки на видео во входных мультимодальных данных
Разработчики могут использовать до трёх секунд видео при создании сцены, чтобы сохранять визуальный контекст и согласованность персонажей на основе видеоссылок; этот подход привязывает генерацию к предоставленному материалу, а не только к текстовым промптам. Пример промпта:
Use the three uploaded videos of dancers and replace them with the provided characters. Have them perform their individual dances from the reference videos, all together in the large, open space from the provided image. The dog character dog.png should do the classical dance from dance3.mp4. The octopus octo.png should do the hip hop dance from dance1.mp4, and the bear bear.png should do the breakdance from dance2.mp4. The final result should be one continuous shot with no scene cuts.
Идеи того, что можно построить
Google представила несколько идей, показывающих, как новые возможности можно применять в собственных инструментах и творческих рабочих процессах:
- Приложение для перехода между ключевыми кадрами, в котором пользователь загружает первый и последний кадры и генерирует переход между ними с помощью пресетов или поля промпта; полноконтекстное рассуждение Omni позволяет получать движения камеры, которые воспринимаются как реальные.
- Приложение для показа дома, которое ведёт камеру по комнатам — с дугой, приближением и отъездом — показывая дом в желаемом состоянии в идеальное время суток и не добавляя несуществующую мебель или детали.
- Draft Room, который делает творческий поиск дешёвым и структурированным: создавайте 3-4 черновых варианта в 360p, меняя по одному элементу за раз, и сравнивайте их рядом. Google отмечает, что создатели и так обычно генерируют несколько видео, прежде чем выбирают подходящее.
Клиенты, использующие Omni Flash в продакшене
По словам Google, клиенты уже используют Gemini Omni Flash в реальных производственных сценариях через Agent Platform API. Adobe интегрировала Gemini Omni Flash в Adobe Firefly, семейство генеративных креативных инструментов Adobe, и компания указывает на видео, демонстрирующее возможности редактирования видео. Партнёрский список — охватывающий дизайнерские инструменты, креативные платформы и облачную инфраструктуру — показывает, как генеративное видео встраивается в существующие профессиональные рабочие процессы, а не предлагается только как отдельная модель.
Партнёры рассказали, как используют модель:
"Gemini Omni Flash is one of the strongest video models available in Figma Weave, where the canvas helps creative teams build on every generation — attaching references, branching different versions, and shaping something unique. With extensions, richer reference material, and 4K resolution, Gemini Omni Flash takes teams beyond generating videos to truly directing them." — Itay Schiff, Creative Director, Figma Weave.
"At GMI Cloud, we give creators centralized access to the world's most capable models. What stands out about Gemini Omni Flash is its accuracy: the details hold up under scrutiny. For customers creating educational and explanatory content, where getting things right is essential, that reliability matters more than any single feature. Omni has made AI video viable for a segment that previously couldn't rely on it." — Louisa Guo, VP of Marketing, GMI Cloud.
"Omni Flash fits naturally into how people already use Runway: start with a prompt, an image or a video, then generate or edit from there. It's another way for our users to move quickly between ideas." — Jamie Umpherson, Chief Creative Officer, Runway.
Доступность и цены
Omni 1.1 постепенно становится доступной во всей экосистеме Google для разработчиков:
- Начать работу в Google AI Studio: разработчики могут опробовать Omni 1.1 прямо в Google AI Studio.
- Развернуть на Gemini Enterprise Agent Platform: корпоративные разработчики могут развернуть Omni 1.1 на платформе.
- Изучить документацию для разработчиков: official documentation, cookbook и prompting guides описывают, как интегрировать расширение сцен, видеоссылки и upscaling в приложения.
Omni 1.1 также доступна всем подписчикам Google AI Plus, Pro и Ultra по всему миру в Google Flow, начиная с сегодняшнего дня. Расширение сцен доступно всем подписчикам Google AI Plus, Pro и Ultra по всему миру в приложении Gemini. Одновременный запуск для разработчиков и потребительских подписчиков продолжает практику Google по выпуску генеративных моделей как через API, так и через приложения.
Дополнительные сведения, включая таблицу цен, доступны в оригинальном анонсе в блоге Google DeepMind и на странице модели Gemini Omni.