Přejít k hlavnímu obsahu

Gemini 3.6 Flash přináší nižší ceny tokenů a lepší výsledky napříč všemi benchmarky

Ilustrační obrázek
Google DeepMind potichu vypustil Gemini 3.6 Flash — nový model z rodiny Gemini 3.5, který za stejné peníze na vstupu nabízí o 17 % nižší cenu výstupních tokenů a vyšší skóre v každém jednotlivém benchmarku. Nejde o žádnou marketingovou mlhu: tabulka od Googlu ukazuje zlepšení u všech devíti testovaných metrik včetně MLE-Bench (+29 %), DeepSWE (+32 %) a porozumění dlouhému kontextu (až dvojnásobek na milionu tokenů). Pro české vývojáře a firmy to znamená, že za méně peněz dostanou citelně schopnější model — a že Google DeepMind bere konkurenci od OpenAI GPT-5.6 Luna, Grok 4.5 a Claude Sonnet 5 smrtelně vážně.

Co je Gemini 3.6 Flash a proč na něm záleží

Gemini 3.6 Flash je nejnovější model z rodiny Gemini 3.5, kterou Google DeepMind představil jako odpověď na novou vlnu modelů od OpenAI (GPT-5.6 Luna), xAI (Grok 4.5) a Anthropicu (Claude Sonnet 5). Jde o evoluci staršího Gemini 3.5 Flash — žádný zcela nový model od nuly, ale vyladěná verze, která přináší vyšší kvalitu výstupu za nižší provozní náklady. Podle JetBrains, kteří model testovali v produktu Junie, 3.6 Flash zlepšil výkon v nízko-úrovňovém kódování o 10–20 % oproti předchozí generaci. Právnická platforma Harvey zase uvádí, že model dokončuje úkoly v průměru o 12 % rychleji.

Model je optimalizovaný pro tři hlavní oblasti: agentní programování (coding agents), znalostní práci (výzkum, analýza dokumentů, finanční modelování) a multimodální úlohy (práce s textem, obrazem, videem i zvukem současně). Dostupný je přes Google AI Studio, Gemini API i v rámci Gemini Enterprise Agent Platform — podnikové platformy, která v dubnu 2026 nahradila dosavadní Vertex AI.

Ceny tokenů: Kolik ušetříte oproti předchůdci i konkurenci

Nejviditelnější změnou je snížení ceny výstupních tokenů. Vstup zůstává beze změny, ale za každý milion tokenů, které model vygeneruje, zaplatíte méně:

Model Vstup ($/1M tokenů) Výstup ($/1M tokenů) Výstup (Kč/1M tokenů)*
Gemini 3.6 Flash $1,50 $7,50 ~169 Kč
Gemini 3.5 Flash (předchozí) $1,50 $9,00 ~203 Kč
GPT-5.6 Luna $1,00 $6,00 ~135 Kč
Grok 4.5 $2,00 $6,00 ~135 Kč
Claude Sonnet 5 $3,00 $15,00 ~338 Kč
Gemini 3.1 Pro $2,00 $12,00 ~270 Kč

* Přepočet kurzem ~22,50 Kč/USD (červenec 2026). Skutečná cena závisí na aktuálním kurzu a platební metodě.

Výstupní cena klesla oproti 3.5 Flash o 16,7 %. Proti Claude Sonnet 5 je Gemini 3.6 Flash dokonce dvakrát levnější na výstupu. OpenAI GPT-5.6 Luna zůstává cenovým šampionem ($6 za milion výstupních tokenů), ale — jak ukážeme dál — v řadě disciplín za Gemini 3.6 Flash zaostává.

Benchmarky: Gemini 3.6 Flash vs konkurence

Google DeepMind na oficiální stránce modelu zveřejnil kompletní srovnání napříč devíti benchmarky. Výsledky jsou pozoruhodné — 3.6 Flash překonává předchozí 3.5 Flash ve všech testech a v několika z nich drtí i dražší konkurenci:

Benchmark Gemini 3.6 Flash 3.5 Flash GPT-5.6 Luna Claude Sonnet 5
SWE-Bench Pro (agentní kódování) 58,7 % 55,1 % 62,7 % 63,2 %
MLE-Bench (strojové učení) 63,9 % 49,7 % 47,6 % 66,9 %
OSWorld-Verified (ovládání počítače) 83,0 % 78,4 % 72,6 % 81,2 %
CharXiv (analýza grafů, s nástroji) 89,4 % 84,9 % 88,3 %
GDM-MRCR v2, 128k (dlouhý kontext) 91,8 % 77,3 % 74,8 % 71,6 %
GDM-MRCR v2, 1M (extrémní kontext) 54,0 % 26,6 %
DeepSWE v1.1 (dlouhodobé SW inženýrství) 49 % 37 % 67 % 54 %
GDPVal-AA v2 (znalostní práce, Elo) 1421 1349 1584 1607

Zdroj: Google DeepMind — Gemini 3.5 family. Tmavě zelená = nejlepší výsledek v řádku.

Klíčová zjištění: Gemini 3.6 Flash exceluje v úlohách vyžadujících porozumění dlouhému kontextu — v GDM-MRCR testu na 128 tisících tokenech dosahuje 91,8 %, zatímco Claude Sonnet 5 jen 71,6 %. Na milionu tokenů (asi 750 000 slov, tedy zhruba tři obsáhlé knihy) si 3.6 Flash drží 54% přesnost oproti mizivým 26,6 % u předchozí verze. Pro firmy pracující s rozsáhlou dokumentací, smlouvami nebo technickou specifikací je to zásadní rozdíl.

V MLE-Bench (testování schopností strojového učení) skok z 49,7 % na 63,9 % řadí 3.6 Flash těsně za Claude Sonnet 5 a daleko před GPT-5.6 Luna. V OSWorld-Verified — testu, kde model musí samostatně ovládat počítačové rozhraní — je 3.6 Flash s 83 % suverénně nejlepší.

Tokenová efektivita: Méně plýtvání, nižší účet

Google DeepMind u 3.6 Flash explicitně zdůrazňuje token efficiency — schopnost produkovat kratší, ale stejně kvalitní výstupy. V praxi to znamená, že model „neplácá" zbytečně dlouhé odpovědi tam, kde stačí kratší. Když k tomu přičtete nižší cenu za výstupní token, reálná úspora může být výrazně vyšší než papírových 16,7 %. Pro české startupy a vývojářské týmy, které platí za API podle spotřeby, může rozdíl mezi „upovídaným" a „efektivním" modelem znamenat desítky procent nákladů měsíčně navíc — nebo úsporu.

Pro srovnání: při generování odpovědi o délce 2 000 tokenů (asi 1 500 slov) zaplatíte s 3.6 Flash zhruba 0,34 Kč, s 3.5 Flash 0,41 Kč a s Claude Sonnet 5 dokonce 0,68 Kč. Rozdíl v řádu haléřů na jednu odpověď se při tisících dotazů denně promění v tisíce korun měsíčně.

Dostupnost pro české uživatele a firmy

Gemini 3.6 Flash je dostupný hned několika kanály, které fungují i z České republiky:

  • Gemini API — přímé volání přes Google AI Studio nebo REST API. Fakturace v dolarech, pro české firmy standardní platební brána Google Cloud.
  • Gemini Enterprise Agent Platform — podniková platforma (dříve Vertex AI) pro budování, škálování a správu AI agentů. Nabízí pokročilou správu identit agentů (Agent Identity), centrální bezpečnostní bránu (Agent Gateway) a certifikaci ISO 42001 — mezinárodní standard pro systémy řízení AI. Pro firmy podléhající EU AI Act (zejména vysoce rizikové aplikace) je tato certifikace podstatná.
  • Gemini aplikace — koncová aplikace Gemini (web i mobil) model zpřístupňuje běžným uživatelům zdarma, s limity. Čeština je plně podporována — Gemini rozumí česky, odpovídá česky a kvalita českých odpovědí je na velmi dobré úrovni.

Co se týče EU AI Act: platforma Gemini Enterprise nabízí regionální kontrolu nad umístěním dat (data residency), což firmám umožňuje splnit požadavky GDPR i článku 10 AI Actu o správě dat. Certifikace ISO 42001 navíc znamená, že governance procesy Googlu prošly nezávislým auditem — v době, kdy každý vendor tvrdí „enterprise-grade security", je nezávislé ověření jediným způsobem, jak oddělit realitu od marketingu.

Co si z toho odnést

Gemini 3.6 Flash není revoluční model, který by přepsal pravidla hry. Je to ale mimořádně povedená evoluce, která za méně peněz dává více výkonu. Pro vývojáře a firmy, které provozují agenty nebo zpracovávají velké objemy textu přes API, je to jednoznačně dobrá zpráva — náklady klesají a kvalita roste.

Pokud váš use-case zahrnuje práci s dlouhými dokumenty (smlouvy, právní analýzy, technická dokumentace), agentní ovládání počítače (RPA, automatizace UI) nebo strojové učení, je Gemini 3.6 Flash aktuálně jedním z nejlepších poměrů cena/výkon na trhu. V disciplínách, kde dominuje Claude Sonnet 5 (obecná znalostní práce, SWE-Bench), je rozdíl malý — ale Sonnet 5 stojí dvojnásobek.

Pro české firmy, které zvažují nasazení AI agentů do produkce, přidává Gemini Enterprise Agent Platform další rozměr: infrastrukturní governance s kryptografickou identitou agentů a jednotným bezpečnostním bodem. V kontextu EU AI Act, který od srpna 2026 zavádí první povinnosti pro vysoce rizikové AI systémy, je schopnost doložit, kdo, kdy a k jakým datům přistupoval, klíčová.

Je Gemini 3.6 Flash lepší než GPT-5.6 Luna od OpenAI?

Záleží na úloze. GPT-5.6 Luna je levnější ($6 vs $7,50 za milion výstupních tokenů) a vítězí v DeepSWE (67 % vs 49 %). Gemini 3.6 Flash naopak drtivě poráží Lunu v MLE-Bench (63,9 % vs 47,6 %), OSWorld (83 % vs 72,6 %) a v práci s dlouhým kontextem. Pro většinu běžných úloh jsou rozdíly malé — doporučujeme vyzkoušet oba modely na konkrétním use-case a porovnat nejen kvalitu, ale i celkové náklady při reálném provozu.

Umí Gemini 3.6 Flash česky?

Ano, Gemini 3.6 Flash rozumí češtině a odpovídá česky na velmi dobré úrovni. Všechny modely rodiny Gemini 3.5 podporují češtinu jak pro porozumění, tak pro generování textu. Kvalita českých odpovědí je plně srovnatelná s ChatGPT nebo Claude — v některých případech (například při překladu technických textů) může být dokonce přesnější.

Je Gemini 3.6 Flash vhodný pro nasazení v regulovaném prostředí (bankovnictví, zdravotnictví)?

Přes Gemini Enterprise Agent Platform ano. Platforma nabízí kryptografickou identitu agentů (Agent Identity), jednotnou bezpečnostní bránu (Agent Gateway), regionální kontrolu nad daty (data residency) a certifikaci ISO 42001. To umožňuje nasazení i v prostředích podléhajících GDPR, HIPAA, NIS2 nebo EU AI Act. Pro méně regulované použití lze model volat přes veřejné Gemini API, které ale výše uvedené governance funkce nenabízí.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.