Obrázek
Gemini nově prohledá celé video. U dlouhých záznamů šetří až 88 % tokenů
Gemini už video pouze „neprohlíží“ od začátku do konce podle předem daného vzorku. Nový agentický přístup umožňuje modelu samostatně procházet časovou osu, vyhledávat důležité momenty a podle potřeby si vyžádat konkrétní snímky, zvuk nebo přepis. U dlouhých záznamů tak Google uvádí až 88% úsporu tokenů, nižší náklady a přesnější odpovědi.
Video už není jen dlouhý pás snímků
Analýza videa bývala z pohledu jazykového modelu poměrně mechanická.