Přejít k hlavnímu obsahu

Gemini 3.6 Flash přináší nižší ceny tokenů a lepší výsledky napříč všemi benchmarky

Ilustrační obrázek
Google DeepMind potichu vypustil Gemini 3.6 Flash — nový model z rodiny Gemini 3.5, který za stejné peníze na vstupu nabízí o 17 % nižší cenu výstupních tokenů a vyšší skóre v každém jednotlivém benchmarku. Nejde o žádnou marketingovou mlhu: tabulka od Googlu ukazuje zlepšení u všech devíti testovaných metrik včetně MLE-Bench (+29 %), DeepSWE (+32 %) a porozumění dlouhému kontextu (až dvojnásobek na milionu tokenů). Pro české vývojáře a firmy to znamená, že za méně peněz dostanou citelně schopnější model — a že Google DeepMind bere konkurenci od OpenAI GPT-5.6 Luna, Grok 4.5 a Claude Sonnet 5 smrtelně vážně.

Co je Gemini 3.6 Flash a proč na něm záleží

Gemini 3.6 Flash je nejnovější model z rodiny Gemini 3.5, kterou Google DeepMind představil jako odpověď na novou vlnu modelů od OpenAI (GPT-5.6 Luna), xAI (Grok 4.5) a Anthropicu (Claude Sonnet 5). Jde o evoluci staršího Gemini 3.5 Flash — žádný zcela nový model od nuly, ale vyladěná verze, která přináší vyšší kvalitu výstupu za nižší provozní náklady. Podle JetBrains, kteří model testovali v produktu Junie, 3.6 Flash zlepšil výkon v nízko-úrovňovém kódování o 10–20 % oproti předchozí generaci. Právnická platforma Harvey zase uvádí, že model dokončuje úkoly v průměru o 12 % rychleji.

Model je optimalizovaný pro tři hlavní oblasti: agentní programování (coding agents), znalostní práci (výzkum, analýza dokumentů, finanční modelování) a multimodální úlohy (práce s textem, obrazem, videem i zvukem současně). Dostupný je přes Google AI Studio, Gemini API i v rámci Gemini Enterprise Agent Platform — podnikové platformy, která v dubnu 2026 nahradila dosavadní Vertex AI.

Ceny tokenů: Kolik ušetříte oproti předchůdci i konkurenci

Nejviditelnější změnou je snížení ceny výstupních tokenů. Vstup zůstává beze změny, ale za každý milion tokenů, které model vygeneruje, zaplatíte méně:

Model Vstup ($/1M tokenů) Výstup ($/1M tokenů) Výstup (Kč/1M tokenů)*
Gemini 3.6 Flash $1,50 $7,50 ~169 Kč
Gemini 3.5 Flash (předchozí) $1,50 $9,00 ~203 Kč
GPT-5.6 Luna $1,00 $6,00 ~135 Kč
Grok 4.5 $2,00 $6,00 ~135 Kč
Claude Sonnet 5 $3,00 $15,00 ~338 Kč
Gemini 3.1 Pro $2,00 $12,00 ~270 Kč

* Přepočet kurzem ~22,50 Kč/USD (červenec 2026). Skutečná cena závisí na aktuálním kurzu a platební metodě.

Výstupní cena klesla oproti 3.5 Flash o 16,7 %. Proti Claude Sonnet 5 je Gemini 3.6 Flash dokonce dvakrát levnější na výstupu. OpenAI GPT-5.6 Luna zůstává cenovým šampionem ($6 za milion výstupních tokenů), ale — jak ukážeme dál — v řadě disciplín za Gemini 3.6 Flash zaostává.

Benchmarky: Gemini 3.6 Flash vs konkurence

Google DeepMind na oficiální stránce modelu zveřejnil kompletní srovnání napříč devíti benchmarky. Výsledky jsou pozoruhodné — 3.6 Flash překonává předchozí 3.5 Flash ve všech testech a v několika z nich drtí i dražší konkurenci:

Benchmark Gemini 3.6 Flash 3.5 Flash GPT-5.6 Luna Claude Sonnet 5
SWE-Bench Pro (agentní kódování) 58,7 % 55,1 % 62,7 % 63,2 %
MLE-Bench (strojové učení) 63,9 % 49,7 % 47,6 % 66,9 %
OSWorld-Verified (ovládání počítače) 83,0 % 78,4 % 72,6 % 81,2 %
CharXiv (analýza grafů, s nástroji) 89,4 % 84,9 % 88,3 %
GDM-MRCR v2, 128k (dlouhý kontext) 91,8 % 77,3 % 74,8 % 71,6 %
GDM-MRCR v2, 1M (extrémní kontext) 54,0 % 26,6 %
DeepSWE v1.1 (dlouhodobé SW inženýrství) 49 % 37 % 67 % 54 %
GDPVal-AA v2 (znalostní práce, Elo) 1421 1349 1584 1607

Zdroj: Google DeepMind — Gemini 3.5 family. Tmavě zelená = nejlepší výsledek v řádku.

Klíčová zjištění: Gemini 3.6 Flash exceluje v úlohách vyžadujících porozumění dlouhému kontextu — v GDM-MRCR testu na 128 tisících tokenech dosahuje 91,8 %, zatímco Claude Sonnet 5 jen 71,6 %. Na milionu tokenů (asi 750 000 slov, tedy zhruba tři obsáhlé knihy) si 3.6 Flash drží 54% přesnost oproti mizivým 26,6 % u předchozí verze. Pro firmy pracující s rozsáhlou dokumentací, smlouvami nebo technickou specifikací je to zásadní rozdíl.

V MLE-Bench (testování schopností strojového učení) skok z 49,7 % na 63,9 % řadí 3.6 Flash těsně za Claude Sonnet 5 a daleko před GPT-5.6 Luna. V OSWorld-Verified — testu, kde model musí samostatně ovládat počítačové rozhraní — je 3.6 Flash s 83 % suverénně nejlepší.

Tokenová efektivita: Méně plýtvání, nižší účet

Google DeepMind u 3.6 Flash explicitně zdůrazňuje token efficiency — schopnost produkovat kratší, ale stejně kvalitní výstupy. V praxi to znamená, že model „neplácá" zbytečně dlouhé odpovědi tam, kde stačí kratší. Když k tomu přičtete nižší cenu za výstupní token, reálná úspora může být výrazně vyšší než papírových 16,7 %. Pro české startupy a vývojářské týmy, které platí za API podle spotřeby, může rozdíl mezi „upovídaným" a „efektivním" modelem znamenat desítky procent nákladů měsíčně navíc — nebo úsporu.

Pro srovnání: při generování odpovědi o délce 2 000 tokenů (asi 1 500 slov) zaplatíte s 3.6 Flash zhruba 0,34 Kč, s 3.5 Flash 0,41 Kč a s Claude Sonnet 5 dokonce 0,68 Kč. Rozdíl v řádu haléřů na jednu odpověď se při tisících dotazů denně promění v tisíce korun měsíčně.

Dostupnost pro české uživatele a firmy

Gemini 3.6 Flash je dostupný hned několika kanály, které fungují i z České republiky:

  • Gemini API — přímé volání přes Google AI Studio nebo REST API. Fakturace v dolarech, pro české firmy standardní platební brána Google Cloud.
  • Gemini Enterprise Agent Platform — podniková platforma (dříve Vertex AI) pro budování, škálování a správu AI agentů. Nabízí pokročilou správu identit agentů (Agent Identity), centrální bezpečnostní bránu (Agent Gateway) a certifikaci ISO 42001 — mezinárodní standard pro systémy řízení AI. Pro firmy podléhající EU AI Act (zejména vysoce rizikové aplikace) je tato certifikace podstatná.
  • Gemini aplikace — koncová aplikace Gemini (web i mobil) model zpřístupňuje běžným uživatelům zdarma, s limity. Čeština je plně podporována — Gemini rozumí česky, odpovídá česky a kvalita českých odpovědí je na velmi dobré úrovni.

Co se týče EU AI Act: platforma Gemini Enterprise nabízí regionální kontrolu nad umístěním dat (data residency), což firmám umožňuje splnit požadavky GDPR i článku 10 AI Actu o správě dat. Certifikace ISO 42001 navíc znamená, že governance procesy Googlu prošly nezávislým auditem — v době, kdy každý vendor tvrdí „enterprise-grade security", je nezávislé ověření jediným způsobem, jak oddělit realitu od marketingu.

Co si z toho odnést

Gemini 3.6 Flash není revoluční model, který by přepsal pravidla hry. Je to ale mimořádně povedená evoluce, která za méně peněz dává více výkonu. Pro vývojáře a firmy, které provozují agenty nebo zpracovávají velké objemy textu přes API, je to jednoznačně dobrá zpráva — náklady klesají a kvalita roste.

Pokud váš use-case zahrnuje práci s dlouhými dokumenty (smlouvy, právní analýzy, technická dokumentace), agentní ovládání počítače (RPA, automatizace UI) nebo strojové učení, je Gemini 3.6 Flash aktuálně jedním z nejlepších poměrů cena/výkon na trhu. V disciplínách, kde dominuje Claude Sonnet 5 (obecná znalostní práce, SWE-Bench), je rozdíl malý — ale Sonnet 5 stojí dvojnásobek.

Pro české firmy, které zvažují nasazení AI agentů do produkce, přidává Gemini Enterprise Agent Platform další rozměr: infrastrukturní governance s kryptografickou identitou agentů a jednotným bezpečnostním bodem. V kontextu EU AI Act, který od srpna 2026 zavádí první povinnosti pro vysoce rizikové AI systémy, je schopnost doložit, kdo, kdy a k jakým datům přistupoval, klíčová.

Je Gemini 3.6 Flash lepší než GPT-5.6 Luna od OpenAI?

Záleží na úloze. GPT-5.6 Luna je levnější ($6 vs $7,50 za milion výstupních tokenů) a vítězí v DeepSWE (67 % vs 49 %). Gemini 3.6 Flash naopak drtivě poráží Lunu v MLE-Bench (63,9 % vs 47,6 %), OSWorld (83 % vs 72,6 %) a v práci s dlouhým kontextem. Pro většinu běžných úloh jsou rozdíly malé — doporučujeme vyzkoušet oba modely na konkrétním use-case a porovnat nejen kvalitu, ale i celkové náklady při reálném provozu.

Umí Gemini 3.6 Flash česky?

Ano, Gemini 3.6 Flash rozumí češtině a odpovídá česky na velmi dobré úrovni. Všechny modely rodiny Gemini 3.5 podporují češtinu jak pro porozumění, tak pro generování textu. Kvalita českých odpovědí je plně srovnatelná s ChatGPT nebo Claude — v některých případech (například při překladu technických textů) může být dokonce přesnější.

Je Gemini 3.6 Flash vhodný pro nasazení v regulovaném prostředí (bankovnictví, zdravotnictví)?

Přes Gemini Enterprise Agent Platform ano. Platforma nabízí kryptografickou identitu agentů (Agent Identity), jednotnou bezpečnostní bránu (Agent Gateway), regionální kontrolu nad daty (data residency) a certifikaci ISO 42001. To umožňuje nasazení i v prostředích podléhajících GDPR, HIPAA, NIS2 nebo EU AI Act. Pro méně regulované použití lze model volat přes veřejné Gemini API, které ale výše uvedené governance funkce nenabízí.

X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.