Google DeepMind lanceert Gemini Omni 1.1 Flash met scène-uitbreiding, keyframe-bediening en 4K-upscaling
Belangrijkste punten
- •Gemini Omni 1.1 Flash kan videoscènes uitbreiden in stappen van 10 seconden tot een cumulatieve maximale lengte van 40 seconden, met analyse van tot 10 seconden aan eerdere context, tegenover de ene seconde waar eerdere modellen naar verwezen.
- •Ontwikkelaars kunnen eerste en laatste keyframes specificeren, waarna het model doorlopende video tussen die twee punten genereert voor camera-orbits, zoomovergangen en naadloze loops.
- •Draft-previews in 360p genereren tot 60% sneller en tegen een derde van de kosten van standaard 720p-resolutie, op basis van Google’s vergelijking van systeemthroughput, terwijl eindprojecten in 1080p of 4K kunnen worden gerenderd.
- •Adobe heeft Gemini Omni Flash geïntegreerd in Adobe Firefly, en partners zoals Figma Weave, GMI Cloud en Runway melden dat zij het model inzetten in productiegerichte creatieve workflows.
- •Het model is beschikbaar voor ontwikkelaars via Google AI Studio en het Gemini Enterprise Agent Platform, en wordt ook wereldwijd uitgerold naar Google AI Plus-, Pro- en Ultra-abonnees in Google Flow, met scène-uitbreiding beschikbaar in de Gemini-app.

Google DeepMind lanceert Gemini Omni 1.1 Flash met scène-uitbreiding, keyframe-bediening en 4K-upscaling
Google DeepMind, de AI-onderzoekstak van Google achter de Gemini-modelfamilie, heeft Gemini Omni 1.1 Flash geïntroduceerd, een productieklare update die ontwikkelaars meer controle geeft over generatieve video. De release, aangekondigd op 27 augustus 2026 door Anish Nangia en Alisa Fortin, Product Managers bij Google DeepMind, biedt videoproductie van studiokwaliteit, waaronder de mogelijkheid om een scène uit te breiden, interpolatie van eerste en laatste frames, scherpe 4K-upscaling en sneller prototypen. Ontwikkelaars kunnen vandaag al aan de slag door het model te gebruiken via Google AI Studio of het Gemini Enterprise Agent Platform.
Volgens Google bracht Gemini Omni redeneren in de echte wereld naar generatieve creatie, en maken de nieuwe updates Omni 1.1 productiegeschikt voor professioneel gebruik via de Gemini API in Google AI Studio. Of ontwikkelaars nu generatieve videoworkflows, creatieve tools of software voor media-editing bouwen, de update is bedoeld om generatieve video beter bestuurbaar te maken, sneller te laten itereren en gepolijst te maken voor inzet in de praktijk. De functies zijn gericht op de praktische kloof tussen ruwe generatie en afgewerkt productiewerk: footage coherent houden over langere duur, de camera doelbewust sturen en goedkoop itereren voordat wordt gekozen voor eindrenders.
De belangrijkste mogelijkheden zijn:
- Breid scènes uit tot 40 seconden met verbeterde visuele consistentie en narratieve flow.
- Stel start- en eindframes in om vloeiende, professionele camerabewegingen en overgangen te creëren.
- Gebruik 360p-previews om sneller te itereren en kosten te besparen tijdens het creatieve proces.
- Schaal eindprojecten op naar 4K-resolutie voor een gepolijste, professionele uitstraling.
Scène-uitbreiding voor langere verhaallijnen
Scène-uitbreiding neemt een bestaande video en gaat naadloos verder met het genereren van footage vanaf het punt waar deze eindigde. In Omni 1.1 kan het model nu tot 10 seconden aan eerdere context analyseren — een sprong ten opzichte van eerdere modellen die alleen naar de laatste seconde verwezen. Google zegt dat dit resulteert in verbeterde visuele consistentie en betere trouw aan het verhaal, waardoor ontwikkelaars langere verhalen kunnen maken of kunnen uitwijken naar nieuwe creatieve richtingen. Video’s kunnen worden uitgebreid in stappen van 10 seconden tot een totale cumulatieve lengte van 40 seconden. Aanhoudende coherentie over langere reeksen is een van de lastigere problemen in generatieve video, waar modellen doorgaans korte clips produceren die visueel afwijken wanneer footage verder wordt uitgerekt dan de oorspronkelijke lengte.
Voorbeeldpromptreeksen die met de aankondiging zijn gepubliceerd, illustreren de functie:
- Prompt 1: Camera slightly pans and we now see she is talking to a man with curly hair, we see man's back, he says "I see it too" dramatic music score
- Prompt 2: Camera slowly pulls out, forgotten dusty catacombs, dramatic music score.
- Prompt 3: Camera slowly pulls out, a vast library where shelves and books float weightlessly in a dusty void, dramatic music score.
Een tweede reeks toont cinematografische cameracontinuïteit:
- Prompt 1: Continue the video. Execute a cinematic optical dolly-zoom shot. The camera dollies forward while simultaneously zooming out, keeping the character's frozen shocked face locked at the exact same size. The long corridor of stone pillars in the background dramatically stretches and deepens with intense optical perspective distortion. Clean architecture, continuous unbroken shot.
- Prompt 2: Continue the video. The camera executes a fast mechanical snap-zoom directly into the character's wide eyes. Stylized cinematic camera control.
- Prompt 3: Continue the video. Time completely freezes into a static moment: the character, their windblown coat. The camera performs a smooth, high-speed 360-degree orbital rotation around the frozen character, showcasing dramatic 3D depth and parallax across the colonnade. Flawless continuity.
Verdere voorbeelden laten dialooggestuurde uitbreidingen zien:
- Prompt 1: The man in the blue sweater replies: "Did your father go out on the boat too?"
- Prompt 2: The camera pulls back in one continuous movement as he continues his story: "He used to say that this harbour had a soul. And that the boats were a part of us." The music swells.
Een andere set prompts behandelt presentatorachtige voortzettingen:
- Prompt 1: The looks directly at the camera and talks about what the final chapter will end with!
- Prompt 2: He then stands up walks around the desk to the camera and says "what would you choose?"
Google documenteert ook hoe een scène kan worden uitgebreid met de Gemini API.
Eerste en laatste frames specificeren
Ontwikkelaars kunnen vloeiende overgangen en camerabewegingen realiseren door de start- en eindframes van een shot te specificeren. Omni 1.1 genereert doorlopende video tussen twee keyframes, waardoor het geschikt is voor complexe camera-orbits, zoomovergangen of naadloze looping-clips. Voorbeeldprompts zijn onder meer:
- Prompt 1: A close-up low-angle shot of a stylish drummer in a beige suit playing a red drum kit in a grand hall transitions as the camera whip-pans to the side, revealing an older saxophonist playing alongside a ballet dancer spinning in a white outfit under soft purple stage lights. One continuous shot, no jump cuts.
- Prompt 2: The camera zooms into the TV screen, where we see the same woman and the same scene from the beginning. Seamless video. One continuous shot, no jump cuts.
Efficiënter drafts maken in 360p
Omni 1.1 kan lichte previews genereren in 360p-resolutie tot 60% sneller en tegen een derde van de kosten vergeleken met de standaard 720p-resolutie van het model. Volgens Google is dit nuttig voor snelle prototyping, storyboard-iteratie en snelle rendering in ontwikkelaarsplatforms. Het bedrijf voegt een voetnoot toe: de claim van tot 60% snellere generatie is gebaseerd op systeemthroughput van 360p versus 720p-resolutie.
Een voorbeeldprompt luidt: A microscopic view of iridescent marine diatoms, displaying intricate, glass-like silica shells with breathtaking natural symmetry. The colors range from deep volcanic amber and warm copper to vibrant turquoise and violet, mimicking the rich palette of earth and ocean. Tiny, delicate structures glow softly against a clean dark field background. High-fidelity scientific imaging, sharp details, organic textures, micro-photography. Maintain the microscope lens effect throughout the entire video.
Opschalen naar 4K-resolutie
Het model genereert gepolijste, high-resolution 1080p- of 4K-uitvoer die klaar is voor professionele productie. Voorbeeldprompts zijn onder meer:
- Prompt 1: Fish swimming, tracking shot
- Prompt 2: A little chipmunk darting out of the woods from the left side of the screen and sniffing the air inquisitively before darting out of frame on the right side
- Prompt 3: Cinematic macro close-up of vibrant golden-orange Japanese maple leaves on a delicate branch, gently rustling and swaying in a soft, rhythmic autumn breeze. Sunlight filters through the translucent foliage, creating a warm, glowing effect. Shallow depth of field, dreamy bokeh background, hyper-detailed textures, photorealistic, 4k.
Videoreferenties in multimodale input toevoegen
Ontwikkelaars kunnen bij het maken van een scène verwijzen naar maximaal drie seconden video, waardoor ze visuele context en karakterconsistentie kunnen behouden op basis van videoreferenties. Daarmee wordt generatie verankerd in aangeleverde footage in plaats van alleen in tekstprompts. Een voorbeeldprompt:
Use the three uploaded videos of dancers and replace them with the provided characters. Have them perform their individual dances from the reference videos, all together in the large, open space from the provided image. The dog character dog.png should do the classical dance from dance3.mp4. The octopus octo.png should do the hip hop dance from dance1.mp4, and the bear bear.png should do the breakdance from dance2.mp4. The final result should be one continuous shot with no scene cuts.
Ideeën voor wat ontwikkelaars kunnen bouwen
Google deelde verschillende concepten die laten zien hoe de nieuwe mogelijkheden in aangepaste tools en creatieve workflows kunnen worden toegepast:
- Een app voor keyframe-overgangen waarin gebruikers een eerste en laatste frame toevoegen en de overgang ertussen genereren met presets of een promptveld, waarbij Omni’s full-context redenering camerabewegingen oplevert die realistisch aanvoelen.
- Een app voor een rondleiding door een huis die de camera door de kamers beweegt — bochten makend, inzoomend en terugtrekkend — en een woning toont in een aspirerende staat op het perfecte moment van de dag, zonder meubels of details toe te voegen die niet bestaan.
- The Draft Room, dat creatieve verkenning goedkoop en gestructureerd maakt: genereer 3-4 draftvarianten in 360p, verander telkens één ding en vergelijk ze naast elkaar. Google merkt op dat makers vaak al meerdere video’s genereren voordat ze op de juiste uitkomen.
Klanten die Omni Flash in productie gebruiken
Google zegt dat klanten via de Agent Platform API al in de praktijk productie draaien met Gemini Omni Flash. Adobe integreerde Gemini Omni Flash in Adobe Firefly, Adobe’s familie van generatieve AI-creatietools, en het bedrijf verwijst naar een video die de videobewerkingsmogelijkheden laat zien. Het partnerbestand — met ontwerpsoftware, creatieve platforms en cloudinfrastructuur — laat zien hoe generatieve video wordt ingebed in bestaande professionele workflows in plaats van alleen als losstaand model te worden aangeboden.
Partners beschreven hoe zij het model gebruiken:
"Gemini Omni Flash is one of the strongest video models available in Figma Weave, where the canvas helps creative teams build on every generation — attaching references, branching different versions, and shaping something unique. With extensions, richer reference material, and 4K resolution, Gemini Omni Flash takes teams beyond generating videos to truly directing them." — Itay Schiff, Creative Director, Figma Weave.
"At GMI Cloud, we give creators centralized access to the world's most capable models. What stands out about Gemini Omni Flash is its accuracy: the details hold up under scrutiny. For customers creating educational and explanatory content, where getting things right is essential, that reliability matters more than any single feature. Omni has made AI video viable for a segment that previously couldn't rely on it." — Louisa Guo, VP of Marketing, GMI Cloud.
"Omni Flash fits naturally into how people already use Runway: start with a prompt, an image or a video, then generate or edit from there. It's another way for our users to move quickly between ideas." — Jamie Umpherson, Chief Creative Officer, Runway.
Beschikbaarheid en prijzen
Omni 1.1 wordt uitgerold in het Google-developersecosysteem:
- Begin met bouwen in Google AI Studio: ontwikkelaars kunnen Omni 1.1 direct uitproberen in Google AI Studio.
- Implementeren op het Gemini Enterprise Agent Platform: enterprise-ontwikkelaars kunnen Omni 1.1 op het platform uitrollen.
- Verken de ontwikkelaarsdocumentatie: de officiële documentatie, de cookbook en promptinggidsen leggen uit hoe scène-uitbreidingen, videoreferenties en upscaling in toepassingen kunnen worden geïntegreerd.
Omni 1.1 is vanaf vandaag ook wereldwijd beschikbaar voor alle Google AI Plus-, Pro- en Ultra-abonnees in Google Flow. Scène-uitbreiding is wereldwijd beschikbaar voor alle Google AI Plus-, Pro- en Ultra-abonnees in de Gemini-app. Het gelijktijdig uitrollen naar ontwikkelaars en consumentenabonnees sluit aan bij Google’s gebruikelijke patroon om zijn generatieve modellen zowel via API’s als via apps uit te brengen.
Meer details, inclusief de prijstabel, zijn beschikbaar in de oorspronkelijke aankondiging op de Google DeepMind-blog en op de Gemini Omni-modelpagina.