Co je Gemini Omni a v čem se liší od Vea nebo Sory
Když se řekne „model na video“, většina lidí si představí nástroj typu Sora od OpenAI nebo Veo, které Google nabízel dosud. Obojí funguje jako chytrý kameraman: dostane zadání a „natočí“ záběr. Gemini Omni je ale podle Googlu něco jiného — Google DeepMind ho popisuje jako takzvaný světový model (world model).
Prakticky to má znamenat, že model nepracuje pouze s pixely podle popisu, ale pokouší se odhadnout, co by se mělo stát dál. Když mu zadáte, aby nechal mramorovou kuličku řítit se po dráze s řetězovou reakcí, má podle ukázek zohlednit vztahy spojené s gravitací a pohybem. Když požádáte o video s abecedou, kde „C“ zastupuje kapybara, „D“ disco koule a „L“ lávová lampa, má propojit jazykové zadání s obrazem.
Jinými slovy: Veo je nástroj na generování. Omni je pokus o model, který má podle Googlu lépe zachytit souvislosti ve scéně — a teprve na základě toho tvořit. CEO Google DeepMind Demis Hassabis to na keynote označil za krok směrem k obecné umělé inteligenci (AGI). Jde o jeho interpretaci směru vývoje, nikoli o ověřený důkaz dosažení AGI; praktický rozdíl mezi přístupy ukážou až další testy a používání.
Stříhá se konverzací, ne časovou osou
Největší popisovanou novinkou je, jak se má Omni ovládat. Žádný timeline, žádné kličky na klíčové snímky — jen normální věty, které na sebe navazují. Řeknete „proměň sochu v bubliny“ a model má upravit scénu. Pak přidáte „změň úhel kamery tak, aby byl za houslistou“ a podle ukázky si má pamatovat předchozí záběr, postavy i světlo.
Představte si to jako rozhovor se střihačem, který má podle ukázky pracovat s předchozím kontextem. V klasickém editoru byste každou změnu řešili klíčovými snímky a rotoskopií. Tady stačí popsat, co chcete jinak. Google na oficiálním blogu ukazuje celou sérii úprav: houslista na pódiu, přenesení do jiného prostředí, neviditelné housle a nakonec změna úhlu kamery — všechno navazující instrukce, přičemž postava má zůstat konzistentní.
Tahle konverzační úprava může Omni odlišit od nástrojů, které generují jednotlivé záběry. Zda si model skutečně udrží konzistenci napříč více úpravami i mimo předváděné ukázky, ale zatím nelze z dostupného oznámení spolehlivě potvrdit.
Fyzika, která se nehroutí po dvou sekundách
Každý, kdo zkoušel generovat video, zná ten moment: postava projde skrz zeď nebo se tekutina chová jako želé. Google u Omni uvádí lepší zacházení se scénami, v nichž hraje roli pohyb a fyzika — například s gravitací, pohybem nebo kapalinami. Neznamená to, že fyziku simuluje přesně jako herní engine, a samotné tvrzení zatím nelze zaměňovat za výsledek nezávislého testu.
Pro běžného uživatele by to mohlo znamenat méně pokusů a omylů. Když necháte kuličku projet řetězovou dráhou, model má podle ukázek lépe zachovat návaznost pohybu. Z dostupných podkladů však nelze slíbit, že každý výsledek bude fyzikálně správný nebo že odpadne nutnost opakovaného generování.
Kde si to vyzkoušíte a kolik to stojí
První model rodiny, Gemini Omni Flash, Google podle oznámení Google DeepMind z 20. května 2026, zveřejněného v rámci konference Google I/O 2026, zpřístupňuje postupně. Plné funkce mají být dostupné předplatitelům Google AI Plus, Pro a Ultra v aplikaci Gemini a v novém nástroji Google Flow, ovšem konkrétní podmínky a dostupnost se mohou lišit podle regionu a účtu.
Pojďme si ceny přepočítat na koruny (při kurzu zhruba 22 Kč za dolar):
- AI Plus — 4,99 $, tedy zhruba 110 Kč/měsíc
- AI Pro — 19,99 $, tedy zhruba 440 Kč/měsíc
- AI Ultra — v dostupném oznámení není jednoznačně uvedeno, zda částka 99,99 až 199,99 $ označuje běžnou cenu, úvodní nabídku, nebo odlišné regionální ceny; jednotnou ověřenou cenu proto nelze spolehlivě uvést
České přepočty jsou pouze orientační výpočty při kurzu zhruba 22 Kč za dolar, nikoli český ceník. U AI Ultra se v podkladech objevuje rozmezí 99,99 až 199,99 $, ale bez jasného označení regionu, období a případné úvodní nabídky; proto z něj nelze odvodit přesnou měsíční cenu ani odpovídající přepočet. Google také uvádí přístup k funkcím prostřednictvím YouTube Shorts a aplikace YouTube Create, není ale doloženo, že je v této podobě a bezplatně dostupný každému uživateli v Česku. Přístup pro vývojáře a firmy přes API Google avizuje na později, konkrétní termín ani podmínky zde potvrzené nejsou.
Český úhel a limity
Google v popisu neuvádí úplný seznam regionů ani podrobný harmonogram, takže nelze potvrdit, že je rollout globální nebo že se ve stejné chvíli týká i Česka. Aplikace Gemini češtinu podporuje, to však samo o sobě neznamená dostupnost všech funkcí Gemini Omni na českém účtu. U záběrů má Google používat neviditelný vodoznak SynthID; z dostupného oznámení ale nevyplývá, že lze u každého videa jednoduše a veřejně zpětně ověřit jeho původ. Vztah k požadavkům na transparentnost v rámci EU AI Act proto nelze popsat jako automaticky vyřešený.
Limity zatím zůstávají znát. První verze Flash má podle popisu generovat krátké klipy, řádově okolo deseti sekund, a jde o spotřebitelský produkt, ne o profesionální postprodukci. Audio může zatím sloužit jako vstupní hlasová reference; generování zvukových výstupů nebo hudby má podle oznámení přijít později. Google zmiňuje hlasové reference přes funkci Avatary, která má z uživatele vytvořit digitální dvojník. A kdo čeká hodinové filmové záběry, musí si počkat — podle současného popisu je nástroj zaměřený na krátká videa, ne na náhradu kamery pro celovečerní film.
Co si z toho odnést
Gemini Omni je podle dosavadního představení ukázkou směru, kterým Google chce jít: k modelu, který má při tvorbě zohledňovat vztahy ve scéně, nikoli pouze napodobovat viditelné vzory. Pro českého uživatele je podstatné, že Google zmiňuje napojení na YouTube Shorts a čeština je v aplikaci Gemini podporována; z toho ale nelze vyvodit okamžitou dostupnost všech funkcí ani bezplatný přístup v Česku. Jestli se konverzační střih a práce s pohybem osvědčí i v praxi, rozhodnou až nezávislé zkušenosti a výsledky mimo předváděné ukázky.
Je Gemini Omni dostupný zadarmo?
Google zmiňuje jeho zapojení do YouTube Shorts a aplikace YouTube Create, ale dostupnost i případné limity se mohou lišit podle země a účtu. Plné funkce v aplikaci Gemini a Google Flow mají být spojeny s předplatným Google AI Plus nebo vyšším; uvedené částky nejsou potvrzeným českým ceníkem a u AI Ultra není z podkladů jasné, která cena platí.
Pozná se, že video vytvořila AI?
Google uvádí použití neviditelného vodoznaku SynthID. Z dostupného popisu ale nelze potvrdit, že u každého videa existuje jednoduché veřejné ověření původu nebo že výsledek spolehlivě odhalí každý nástroj.
Zvládne Omni i zvuk a hudbu?
Audio může podle současného popisu sloužit jako vstupní hlasová reference. Generování zvukových výstupů nebo hudby má přijít později; Google zmiňuje funkci Avatary, podrobné podmínky však nejsou v textu potvrzené.