Co je Gemini 3.6 Flash a proč na něm záleží
Gemini 3.6 Flash je nejnovější model z rodiny Gemini 3.5, kterou Google DeepMind představil jako odpověď na novou vlnu modelů od OpenAI (GPT-5.6 Luna), xAI (Grok 4.5) a Anthropicu (Claude Sonnet 5). Jde o evoluci staršího Gemini 3.5 Flash — žádný zcela nový model od nuly, ale vyladěná verze, která přináší vyšší kvalitu výstupu za nižší provozní náklady. Podle JetBrains, kteří model testovali v produktu Junie, 3.6 Flash zlepšil výkon v nízko-úrovňovém kódování o 10–20 % oproti předchozí generaci. Právnická platforma Harvey zase uvádí, že model dokončuje úkoly v průměru o 12 % rychleji.
Model je optimalizovaný pro tři hlavní oblasti: agentní programování (coding agents), znalostní práci (výzkum, analýza dokumentů, finanční modelování) a multimodální úlohy (práce s textem, obrazem, videem i zvukem současně). Dostupný je přes Google AI Studio, Gemini API i v rámci Gemini Enterprise Agent Platform — podnikové platformy, která v dubnu 2026 nahradila dosavadní Vertex AI.
Ceny tokenů: Kolik ušetříte oproti předchůdci i konkurenci
Nejviditelnější změnou je snížení ceny výstupních tokenů. Vstup zůstává beze změny, ale za každý milion tokenů, které model vygeneruje, zaplatíte méně:
| Model | Vstup ($/1M tokenů) | Výstup ($/1M tokenů) | Výstup (Kč/1M tokenů)* |
|---|---|---|---|
| Gemini 3.6 Flash | $1,50 | $7,50 | ~169 Kč |
| Gemini 3.5 Flash (předchozí) | $1,50 | $9,00 | ~203 Kč |
| GPT-5.6 Luna | $1,00 | $6,00 | ~135 Kč |
| Grok 4.5 | $2,00 | $6,00 | ~135 Kč |
| Claude Sonnet 5 | $3,00 | $15,00 | ~338 Kč |
| Gemini 3.1 Pro | $2,00 | $12,00 | ~270 Kč |
* Přepočet kurzem ~22,50 Kč/USD (červenec 2026). Skutečná cena závisí na aktuálním kurzu a platební metodě.
Výstupní cena klesla oproti 3.5 Flash o 16,7 %. Proti Claude Sonnet 5 je Gemini 3.6 Flash dokonce dvakrát levnější na výstupu. OpenAI GPT-5.6 Luna zůstává cenovým šampionem ($6 za milion výstupních tokenů), ale — jak ukážeme dál — v řadě disciplín za Gemini 3.6 Flash zaostává.
Benchmarky: Gemini 3.6 Flash vs konkurence
Google DeepMind na oficiální stránce modelu zveřejnil kompletní srovnání napříč devíti benchmarky. Výsledky jsou pozoruhodné — 3.6 Flash překonává předchozí 3.5 Flash ve všech testech a v několika z nich drtí i dražší konkurenci:
| Benchmark | Gemini 3.6 Flash | 3.5 Flash | GPT-5.6 Luna | Claude Sonnet 5 |
|---|---|---|---|---|
| SWE-Bench Pro (agentní kódování) | 58,7 % | 55,1 % | 62,7 % | 63,2 % |
| MLE-Bench (strojové učení) | 63,9 % | 49,7 % | 47,6 % | 66,9 % |
| OSWorld-Verified (ovládání počítače) | 83,0 % | 78,4 % | 72,6 % | 81,2 % |
| CharXiv (analýza grafů, s nástroji) | 89,4 % | 84,9 % | — | 88,3 % |
| GDM-MRCR v2, 128k (dlouhý kontext) | 91,8 % | 77,3 % | 74,8 % | 71,6 % |
| GDM-MRCR v2, 1M (extrémní kontext) | 54,0 % | 26,6 % | — | — |
| DeepSWE v1.1 (dlouhodobé SW inženýrství) | 49 % | 37 % | 67 % | 54 % |
| GDPVal-AA v2 (znalostní práce, Elo) | 1421 | 1349 | 1584 | 1607 |
Zdroj: Google DeepMind — Gemini 3.5 family. Tmavě zelená = nejlepší výsledek v řádku.
Klíčová zjištění: Gemini 3.6 Flash exceluje v úlohách vyžadujících porozumění dlouhému kontextu — v GDM-MRCR testu na 128 tisících tokenech dosahuje 91,8 %, zatímco Claude Sonnet 5 jen 71,6 %. Na milionu tokenů (asi 750 000 slov, tedy zhruba tři obsáhlé knihy) si 3.6 Flash drží 54% přesnost oproti mizivým 26,6 % u předchozí verze. Pro firmy pracující s rozsáhlou dokumentací, smlouvami nebo technickou specifikací je to zásadní rozdíl.
V MLE-Bench (testování schopností strojového učení) skok z 49,7 % na 63,9 % řadí 3.6 Flash těsně za Claude Sonnet 5 a daleko před GPT-5.6 Luna. V OSWorld-Verified — testu, kde model musí samostatně ovládat počítačové rozhraní — je 3.6 Flash s 83 % suverénně nejlepší.
Tokenová efektivita: Méně plýtvání, nižší účet
Google DeepMind u 3.6 Flash explicitně zdůrazňuje token efficiency — schopnost produkovat kratší, ale stejně kvalitní výstupy. V praxi to znamená, že model „neplácá" zbytečně dlouhé odpovědi tam, kde stačí kratší. Když k tomu přičtete nižší cenu za výstupní token, reálná úspora může být výrazně vyšší než papírových 16,7 %. Pro české startupy a vývojářské týmy, které platí za API podle spotřeby, může rozdíl mezi „upovídaným" a „efektivním" modelem znamenat desítky procent nákladů měsíčně navíc — nebo úsporu.
Pro srovnání: při generování odpovědi o délce 2 000 tokenů (asi 1 500 slov) zaplatíte s 3.6 Flash zhruba 0,34 Kč, s 3.5 Flash 0,41 Kč a s Claude Sonnet 5 dokonce 0,68 Kč. Rozdíl v řádu haléřů na jednu odpověď se při tisících dotazů denně promění v tisíce korun měsíčně.
Dostupnost pro české uživatele a firmy
Gemini 3.6 Flash je dostupný hned několika kanály, které fungují i z České republiky:
- Gemini API — přímé volání přes Google AI Studio nebo REST API. Fakturace v dolarech, pro české firmy standardní platební brána Google Cloud.
- Gemini Enterprise Agent Platform — podniková platforma (dříve Vertex AI) pro budování, škálování a správu AI agentů. Nabízí pokročilou správu identit agentů (Agent Identity), centrální bezpečnostní bránu (Agent Gateway) a certifikaci ISO 42001 — mezinárodní standard pro systémy řízení AI. Pro firmy podléhající EU AI Act (zejména vysoce rizikové aplikace) je tato certifikace podstatná.
- Gemini aplikace — koncová aplikace Gemini (web i mobil) model zpřístupňuje běžným uživatelům zdarma, s limity. Čeština je plně podporována — Gemini rozumí česky, odpovídá česky a kvalita českých odpovědí je na velmi dobré úrovni.
Co se týče EU AI Act: platforma Gemini Enterprise nabízí regionální kontrolu nad umístěním dat (data residency), což firmám umožňuje splnit požadavky GDPR i článku 10 AI Actu o správě dat. Certifikace ISO 42001 navíc znamená, že governance procesy Googlu prošly nezávislým auditem — v době, kdy každý vendor tvrdí „enterprise-grade security", je nezávislé ověření jediným způsobem, jak oddělit realitu od marketingu.
Co si z toho odnést
Gemini 3.6 Flash není revoluční model, který by přepsal pravidla hry. Je to ale mimořádně povedená evoluce, která za méně peněz dává více výkonu. Pro vývojáře a firmy, které provozují agenty nebo zpracovávají velké objemy textu přes API, je to jednoznačně dobrá zpráva — náklady klesají a kvalita roste.
Pokud váš use-case zahrnuje práci s dlouhými dokumenty (smlouvy, právní analýzy, technická dokumentace), agentní ovládání počítače (RPA, automatizace UI) nebo strojové učení, je Gemini 3.6 Flash aktuálně jedním z nejlepších poměrů cena/výkon na trhu. V disciplínách, kde dominuje Claude Sonnet 5 (obecná znalostní práce, SWE-Bench), je rozdíl malý — ale Sonnet 5 stojí dvojnásobek.
Pro české firmy, které zvažují nasazení AI agentů do produkce, přidává Gemini Enterprise Agent Platform další rozměr: infrastrukturní governance s kryptografickou identitou agentů a jednotným bezpečnostním bodem. V kontextu EU AI Act, který od srpna 2026 zavádí první povinnosti pro vysoce rizikové AI systémy, je schopnost doložit, kdo, kdy a k jakým datům přistupoval, klíčová.
Je Gemini 3.6 Flash lepší než GPT-5.6 Luna od OpenAI?
Záleží na úloze. GPT-5.6 Luna je levnější ($6 vs $7,50 za milion výstupních tokenů) a vítězí v DeepSWE (67 % vs 49 %). Gemini 3.6 Flash naopak drtivě poráží Lunu v MLE-Bench (63,9 % vs 47,6 %), OSWorld (83 % vs 72,6 %) a v práci s dlouhým kontextem. Pro většinu běžných úloh jsou rozdíly malé — doporučujeme vyzkoušet oba modely na konkrétním use-case a porovnat nejen kvalitu, ale i celkové náklady při reálném provozu.
Umí Gemini 3.6 Flash česky?
Ano, Gemini 3.6 Flash rozumí češtině a odpovídá česky na velmi dobré úrovni. Všechny modely rodiny Gemini 3.5 podporují češtinu jak pro porozumění, tak pro generování textu. Kvalita českých odpovědí je plně srovnatelná s ChatGPT nebo Claude — v některých případech (například při překladu technických textů) může být dokonce přesnější.
Je Gemini 3.6 Flash vhodný pro nasazení v regulovaném prostředí (bankovnictví, zdravotnictví)?
Přes Gemini Enterprise Agent Platform ano. Platforma nabízí kryptografickou identitu agentů (Agent Identity), jednotnou bezpečnostní bránu (Agent Gateway), regionální kontrolu nad daty (data residency) a certifikaci ISO 42001. To umožňuje nasazení i v prostředích podléhajících GDPR, HIPAA, NIS2 nebo EU AI Act. Pro méně regulované použití lze model volat přes veřejné Gemini API, které ale výše uvedené governance funkce nenabízí.