Google rozšiřuje AI režim vyhledávání o sledování cen letenek a rezervace hotelů
01. 09. 2026
Google DeepMind představil 27. srpna 2026 novou verzi svého generativního video nástroje s názvem Gemini Omni 1.1 Flash. Model navazuje na předchozí verze rodiny Gemini Omni a přináší několik funkcí zaměřených především na vývojáře video softwaru, kteří s generativní tvorbou videí pracují v produkčním prostředí.
Hlavní novinkou je možnost prodloužit generované scény až na 40 sekund, což představuje výrazný posun oproti dřívějším omezením na kratší klipy. Vývojáři nyní mohou také přesně specifikovat počáteční a koncový snímek scény, což umožňuje vytvářet plynulejší přechody mezi jednotlivými segmenty videa a lépe kontrolovat celkovou strukturu vznikajícího obsahu. Model dokáže generovat videa ve finálním rozlišení 4K, což odpovídá požadavkům na produkci určenou pro profesionální nasazení.
Kromě práce s vysokým rozlišením klade nová verze důraz i na rychlejší fázi prototypování. Vývojáři mohou generovat lehké náhledy v rozlišení 360p, což jim umožňuje rychle testovat nápady a upravovat zadání ještě předtím, než přejdou k nákladnější a časově náročnější tvorbě finálního videa ve vysokém rozlišení. Podle Google DeepMind je tento přístup až o 60 % rychlejší a zároveň levnější — náhledy lze vytvořit za přibližně třetinu nákladů ve srovnání se standardním rozlišením 720p, které se dosud pro rychlé testování běžně používalo.
Za vývojem modelu stojí produktoví manažeři Google DeepMind Anish Nangia a Alisa Fortin. Podle nich Gemini Omni 1.1 Flash dává vývojářům lepší kontrolu nad generativními video projekty, a to díky kombinaci přesnějšího řízení scén a rychlejšího iteračního cyklu při návrhu obsahu.
Google zároveň zdůrazňuje, že nová verze přináší i celkové zlepšení vizuální konzistence a narativního toku generovaných videí. To znamená, že jednotlivé scény by měly na sebe lépe navazovat jak z hlediska vzhledu postav a prostředí, tak z hlediska logické návaznosti děje – což je klíčové zejména při tvorbě delších sekvencí, kde dosud generativní modely často ztrácely konzistenci mezi jednotlivými snímky.
Gemini Omni 1.1 Flash je dostupný na platformách Google AI Studio a Gemini Enterprise Agent Platform, tedy v prostředích, která Google primárně cílí na vývojářskou a firemní komunitu. Integrace do těchto nástrojů naznačuje, že model je určen spíše pro budování aplikací a produkčních řešení než pro běžné koncové uživatele, kteří by chtěli generovat videa příležitostně.
Rozšíření možnosti délky scén na 40 sekund reaguje na dlouhodobý požadavek vývojářů, kteří potřebují vytvářet souvislejší a obsahově bohatší video sekvence bez nutnosti složitého skládání kratších klipů. Specifikace počátečních a koncových snímků pak řeší problém plynulosti přechodů, který byl u předchozích generací generativních video modelů jedním z častěji zmiňovaných nedostatků.
Kombinace rychlých náhledů v nízkém rozlišení a finálního výstupu ve 4K odpovídá běžnému pracovnímu postupu ve video produkci, kde se nejprve testují koncepty a teprve poté se investuje čas a výpočetní výkon do finální verze. Nižší náklady na fázi prototypování mohou být pro vývojáře přínosné zejména při práci na projektech s omezeným rozpočtem nebo při potřebě rychle iterovat mezi různými variantami scén.
Google dosud nezveřejnil podrobnější technické parametry modelu ani konkrétní ceník za generování videa ve vysokém rozlišení. Společnost nicméně pokračuje v postupném rozšiřování rodiny modelů Gemini Omni, přičemž se zaměřuje na segment profesionálních a firemních uživatelů, kteří potřebují spolehlivé nástroje pro škálovatelnou tvorbu video obsahu.
Vydání Gemini Omni 1.1 Flash tak zapadá do širšího trendu, kdy velké technologické firmy postupně vylepšují generativní nástroje pro video s ohledem na praktické potřeby vývojářského publika – tedy nejen na kvalitu výsledného obrazu, ale i na efektivitu a náklady celého produkčního procesu.