Gemini 3.6 Flash: Nový tahoun s nižší spotřebou tokenů
Model Gemini 3.6 Flash staví na přímé zpětné vazbě od vývojářů, kteří používali předchozí verzi 3.5 Flash. Google se u této verze zaměřil na kritický aspekt provozu AI agentů – na takzvanou tokenovou efektivitu. V praxi to znamená, že model dokáže vyřešit složité úkoly s menším množstvím vygenerovaného textu (tokenů), což přímo snižuje náklady a zrychluje odezvu.
Podle nezávislého benchmarku Artificial Analysis spotřebuje Gemini 3.6 Flash o 17 % méně výstupních tokenů než jeho předchůdce. V extrémních případech, jako je softwarové inženýrství testované v benchmarku DeepSWE od Datacurve, dosahuje úspora tokenů dokonce až 65 %. Model zkrátka potřebuje méně kroků uvažování a méně volání externích nástrojů k tomu, aby dosáhl správného výsledku.
Vyšší výkon a nižší cena
Navzdory vyšší efektivitě došlo k poklesu ceny. Provozní náklady pro vývojáře jsou nastaveny následovně:
- Vstupní tokeny (Input): 1,50 USD za 1 milion tokenů
- Výstupní tokeny (Output): 7,50 USD za 1 milion tokenů
Z hlediska schopností vykazuje Gemini 3.6 Flash výrazná zlepšení napříč klíčovými oblastmi:
- Programování a výzkum: V benchmarku MLE Bench (zaměřeném na strojové učení) model dosáhl úspěšnosti 63,9 % (oproti 49,7 % u verze 3.5 Flash).
- Ovládání počítače (Computer Use): Schopnost interagovat s operačním systémem se zlepšila na 83,0 % v testu OSWorld-Verified. Tato funkce je nyní integrována jako vestavěný nástroj v Gemini API a Gemini Enterprise.
- Zpracování dokumentů: V testu GDPval-AA v2 model překonal předchůdce skórem 1421 ku 1349. Firemní zákazníci jako Hebbia nebo Harvey potvrzují excelentní výsledky při analýze grafů, tabulek a tvorbě reportů.
Gemini 3.5 Flash-Lite: Rychlostní šampion pro masové nasazení
Pokud potřebujete extrémně rychlou odezvu a zpracováváte obrovské objemy dat, Google přichází s modelem Gemini 3.5 Flash-Lite. Jedná se o nejrychlejší model v celé řadě 3.5, který podle měření Artificial Analysis dokáže generovat neuvěřitelných 350 výstupních tokenů za sekundu.
Tento model je navržen pro úkoly s vysokou propustností, jako je sémantické vyhledávání, rychlé zpracování dokumentů nebo koordinace podřízených AI sub-agentů. Vývojáři mohou flexibilně konfigurovat úroveň "přemýšlení" modelu (thinking levels) – od bleskové odezvy s minimálními náklady až po hlubší analýzu pro složitější úkoly.
Cenová politika pro Gemini 3.5 Flash-Lite je nastavena velmi agresivně:
- Vstupní tokeny (Input): 0,30 USD za 1 milion tokenů
- Výstupní tokeny (Output): 2,50 USD za 1 milion tokenů
V benchmarku SWE-Bench Pro (zaměřeném na reálné programování) model 3.5 Flash-Lite s úspěšností 54,2 % dokonce překonává standardní model Gemini 3 Flash (49,6 %), což z něj činí vysoce atraktivní volbu pro vývojářské nástroje.
Gemini 3.5 Flash Cyber: Specialista na kybernetickou bezpečnost
Třetím představeným modelem je Gemini 3.5 Flash Cyber. Google reaguje na fakt, že AI dokáže odhalovat bezpečnostní chyby rychleji, než je lidé stíhají opravovat. Tento model je úzce specializován na detekci, validaci a opravu zranitelností v kódu.
Model funguje v rámci orchestračního systému CodeMender, kde spolupracuje několik specializovaných kybernetických agentů na vytvoření jedné ucelené bezpečnostní zprávy. Vzhledem k citlivosti této technologie (tzv. dual-use technologie, kterou lze zneužít k obraně i útoku) zvolil Google velmi opatrný přístup. Model Gemini 3.5 Flash Cyber v rámci CodeMender bude exkluzivně dostupný pouze vládním institucím a prověřeným partnerům.
Co to znamená pro český trh, vývojáře a evropskou regulaci?
Pro české startupy a softwarové domy, které integrují AI do svých produktů, znamenají nové modely především drastické snížení provozních nákladů. Nižší ceny za tokeny v kombinaci s vyšší efektivitou (kdy model k vyřešení úkolu potřebuje méně kroků) umožní stavět životaschopné komerční aplikace bez obřích rozpočtů.
Z hlediska lokalizace podporují modely Gemini 3.6 Flash a 3.5 Flash-Lite češtinu na vynikající úrovni, což platí pro celou rodinu modelů Gemini. U pokročilých funkcí, jako je "computer use" (ovládání počítače), je však nutné počítat s tím, že pro optimální výsledky bude systém vyžadovat interakci v anglickém prostředí.
Důležitým aspektem pro evropský trh je soulad s přísnou legislativou EU o umělé inteligenci (AI Act). Google deklaruje, že Gemini 3.6 Flash přichází s posílenými bezpečnostními protokoly v rámci své iniciativy Frontier Safety. Modely mají implementované robustní ochrany proti zneužití v oblasti chemických, biologických, radiologických a jaderných hrozeb (CBRN) a kybernetických útoků. Zároveň byly natrénovány tak, aby minimalizovaly falešná odmítnutí u legitimních požadavků uživatelů.
Srovnání s konkurencí a pohled do budoucna
Google těmito modely přímo útočí na konkurenční "odlehčené" modely, jako jsou GPT-4o-mini od OpenAI či Claude 3.5 Haiku od Anthropicu. Zatímco Anthropic sází na hluboké analytické schopnosti, Google u řady Flash dominuje v rychlosti generování (350 tokenů/s u Flash-Lite je v oboru špičková hodnota) a v nativní integraci multimodálních funkcí a nástrojů pro ovládání rozhraní.
Google na závěr svého oznámení na oficiálním blogu poodhalil i další plány. V současné době již partneři testují očekávaný model Gemini 3.5 Pro, který bude široce dostupný, jakmile projde finálním laděním. Vývojový tým navíc již zahájil trénování zcela nové generace – Gemini 4 – což naznačuje, že tempo inovací v oblasti AI rozhodně nezpomaluje.
Kde si mohu nové modely Gemini 3.6 Flash a 3.5 Flash-Lite vyzkoušet?
Modely jsou od dnešního dne dostupné pro vývojáře v platformách Google AI Studio a Vertex AI. Běžní uživatelé se s nimi postupně setkají v rámci aktualizací služeb Google Workspace a předplatného Gemini Advanced.
Jak funguje funkce "computer use" u modelu Gemini 3.6 Flash?
Tato funkce umožňuje modelu interagovat s obrazovkou počítače podobně jako člověk. AI dokáže analyzovat vizuální vstupy z monitoru, emulovat pohyby myši, klikání a psaní na klávesnici. V modelech 3.6 Flash a 3.5 Flash-Lite je tato schopnost dostupná jako vestavěný klientský nástroj přes API.
Proč není model Gemini 3.5 Flash Cyber dostupný veřejnosti?
Vzhledem k tomu, že model dokáže velmi efektivně vyhledávat zranitelnosti v softwaru, existuje riziko jeho zneužití k tvorbě kybernetických útoků (tzv. dual-use riziko). Google se proto z bezpečnostních důvodů a v souladu s mezinárodními regulacemi rozhodl poskytnout tento model výhradně vládám a prověřeným bezpečnostním institucím.