Kimi K3: Čínská odpověď na dominanci OpenAI a Anthropicu
Společnost Moonshot AI se sídlem v Pekingu oznámila 16. července 2026 uvedení modelu Kimi K3 — svého dosud nejvýkonnějšího velkého jazykového modelu. Jde o první otevřený model v kategorii 3 bilionů parametrů (přesněji 2,8 bilionu) a jeho veřejně dostupné váhy byly uvolněny 27. července 2026. Model představuje zásadní posun v tom, co si můžeme představit pod pojmem „open-source AI".
Na rozdíl od uzavřených špičkových modelů od OpenAI či Anthropicu si výzkumníci, firmy a vývojáři mohou Kimi K3 zdarma stáhnout a provozovat na vlastní infrastruktuře. Pro evropské firmy, které se potýkají s přísnými požadavky EU AI Act na transparentnost a bezpečnost AI systémů, je to klíčová výhoda — mohou model auditovat, kontrolovat a přizpůsobit vlastním potřebám bez závislosti na API třetí strany.
Co Kimi K3 umí — a co ne
Kimi K3 je navržený především pro dlouhé programovací úlohy, znalostní práci a komplexní uvažování. Model nativně rozumí textu, obrázkům i videu a disponuje kontextovým oknem o velikosti 1 milion tokenů — což je zhruba ekvivalent celé ságy Pána prstenů včetně Silmarillionu.
Moonshot AI předvedlo několik impozantních ukázek:
- Chip design: Kimi K3 během 48 hodin autonomně navrhl, optimalizoval a ověřil vlastní čip na 45nm knihovně Nangate s využitím open-source EDA nástrojů. Čip o rozloze 4 mm² zvládá takt 100 MHz a v simulaci dosahuje propustnosti přes 8 700 tokenů za sekundu.
- GPU kernel optimalizace: Model samostatně profiluje, přepisuje a benchmarkuje GPU kernely na NVIDIA Hopper i alternativních GPGPU kartách — v testech překonal Claude Opus 4.8 i GPT-5.6 Sol.
- Kompilátor od nuly: K3 postavil MiniTriton — kompaktní Triton-like kompilátor s vlastní IR vrstvou, optimalizačními průchody a PTX generátorem kódu, který v některých benchmarcích překonává Triton i torch.compile.
- Vědecký výzkum: Model za dvě hodiny reprodukoval výzkum I-Love-Q univerzálních relací v astrofyzice — úkol, který zkušenému výzkumníkovi obvykle zabere 1–2 týdny.
Architektura: Na čem Kimi K3 stojí
Za výkonem K3 stojí několik architektonických inovací. Model využívá Mixture of Experts s 896 experty, z nichž je na každý token aktivováno 16 — to umožňuje obrovskou kapacitu modelu při zachování rozumných výpočetních nákladů. Klíčovou novinkou je Kimi Delta Attention (KDA), která efektivněji škáluje pozornost napříč dlouhými sekvencemi. Spolu s Attention Residuals (AttnRes) tyto architektonické změny přinášejí přibližně 2,5násobné zlepšení škálovací efektivity oproti předchozí verzi Kimi K2.
Model byl trénován s kvantizačně-učeným přístupem (QAT) od fáze SFT — pro váhy používá formát MXFP4 a pro aktivace MXFP8, což zajišťuje širokou hardwarovou kompatibilitu napříč různými GPU architekturami.
Benchmarky: Kde K3 poráží konkurenci
Kimi K3 dosahuje frontier-level výkonu napříč programovacími, agentními a znalostními benchmarky. Zde jsou klíčová srovnání:
| Benchmark | Kimi K3 | GPT-5.6 Sol | Claude Fable 5 | Opus 4.8 |
|---|---|---|---|---|
| DeepSWE v1.1 | 71,2 % | 72,3 % | 69,1 % | 52,6 % |
| Terminal-Bench 2.1 | 58,7 % | 29,0 % | 37,0 % | 33,0 % |
| SWE Marathon | 64,4 % | 59,2 % | 35,6 % | 25,5 % |
| Program Bench | 89,0 % | 83,8 % | 88,9 % | 68,3 % |
| FrontierSWE | 70,5 % | — | 49,0 % | 25,0 % |
| MCP Atlas | 65,6 % | 48,9 % | 55,5 % | 44,8 % |
| BrowseComp | 91,8 % | 80,0 % | 93,7 % | 82,0 % |
Z čísel je patrné, že Kimi K3 v programovacích a agentních úlohách systematicky poráží Opus 4.8 a v řadě disciplín drží krok s nejužší špičkou — Claude Fable 5 a GPT-5.6 Sol. V Terminal-Bench 2.1, SWE Marathon a MCP Atlas dokonce Fable 5 i GPT-5.6 Sol přesvědčivě překonává.
Cena: Kolik stojí provoz Kimi K3?
Moonshot AI nabízí Kimi K3 přes Kimi API Platform s následujícím ceníkem:
- Vstup (cache hit): 0,30 USD / milion tokenů — cca 6,50 Kč
- Vstup (cache miss): 3,00 USD / milion tokenů — cca 65 Kč
- Výstup: 15,00 USD / milion tokenů — cca 325 Kč
Díky architektuře Mooncake dosahuje oficiální Kimi API při programovacích úlohách cache hit rate nad 90 %, což znamená, že reálná cena za vstup se v praxi blíží nižšímu pásmu. Pro srovnání: GPT-5.6 Sol stojí 10 USD/Mtok za vstup a 60 USD/Mtok za výstup, Claude Fable 5 pak 15 USD/Mtok za vstup a 75 USD/Mtok za výstup. Kimi K3 je tak 2–4× levnější na výstupu než srovnatelné proprietární modely.
Pro firmy a vývojáře, kteří model nasadí na vlastní hardware, odpadají API poplatky úplně — platí pouze náklady na GPU infrastrukturu. Moonshot AI doporučuje nasazení na konfiguracích se 64 a více akcelerátory pro optimální inferenci.
Co to znamená pro Česko a Evropu?
Kimi K3 přichází v době, kdy Evropa hledá vlastní cestu v AI. EU AI Act, který od srpna 2026 zavádí nové povinnosti pro označování AI výstupů a transparentnost modelů, zvýhodňuje otevřené modely — ty totiž umožňují nezávislý audit a kontrolu, což je jeden z klíčových požadavků regulace.
Pro české firmy a výzkumné instituce je klíčové, že váhy modelu jsou veřejně dostupné. To otevírá cestu k:
- Fine-tuningu pro češtinu — české jazykové schopnosti Kimi K3 jsou zatím neotestované, ale akademické instituce jako MFF UK nebo FIT ČVUT mohou model dotrénovat na českých datech
- On-premise nasazení — firmy s citlivými daty (banky, zdravotnictví, státní správa) mohou model provozovat lokálně bez odesílání dat do cloudu třetích stran
- Výzkumu bezpečnosti AI — otevřené váhy umožňují akademikům studovat chování modelu, včetně potenciálních rizik
Nutno však dodat, že Kimi K3 není lokalizován do češtiny — komunikuje primárně anglicky a čínsky. Pro koncového českého uživatele je tedy zatím méně praktický než ChatGPT nebo Claude, které mají češtinu na slušné úrovni. Pro vývojáře a firmy je ale otevřenost modelu zásadní konkurenční výhoda.
Omezení a rizika
Moonshot AI v technickém blogu otevřeně přiznává několik omezení:
- Citlivost na historii přemýšlení: K3 byl trénován v režimu zachovaného thinking history — pokud agentní prostředí nepředává kompletní historii myšlenek, kvalita výstupu se může dramaticky zhoršit.
- Přílišná proaktivita: Model má tendenci dělat rozhodnutí za uživatele i v situacích, kdy to není vhodné. Pro bezpečné nasazení je potřeba explicitní omezení v systémovém promptu.
- Mezera v UX: Přes skvělé benchmarky přiznává Moonshot AI, že v uživatelském zážitku K3 zaostává za Claude Fable 5 a GPT-5.6 Sol.
Z pohledu EU AI Act spadá Kimi K3 díky své otevřené povaze do kategorie s nižšími regulatorními požadavky — open-source modely mají podle aktuálního znění Aktu o AI výjimky z některých povinností. Přesto platí, že každé nasazení modelu v produkčním prostředí musí splňovat obecné požadavky na bezpečnost a transparentnost.
Jak Kimi K3 vyzkoušet?
Kimi K3 je dostupný na několika platformách:
- Web: kimi.com — zdarma pro základní použití
- Desktop: Kimi Work (Windows, Apple Silicon Mac), verze 3.1.0+
- Terminál: Kimi Code — open-source nástroj pro programování s AI asistencí
- API: platform.kimi.ai — s ceníkem výše
- Mobil: iOS, Android, HarmonyOS
Je Kimi K3 opravdu open-source? Jaká licence se na model vztahuje?
Váhy modelu jsou veřejně dostupné ke stažení, což umožňuje výzkumné i komerční využití. Přesné licenční podmínky zatím nebyly zveřejněny — Moonshot AI uvedlo, že technický report a detaily ohledně licence vydá společně s váhami.
Může Kimi K3 nahradit ChatGPT nebo Claude pro běžného českého uživatele?
Zatím spíše ne. Kimi K3 je primárně optimalizován pro programování a odbornou znalostní práci v angličtině. Pro běžnou konverzaci v češtině jsou ChatGPT a Claude výrazně lepší volbou. Pro české vývojáře a firmy je ale otevřenost K3 zásadní výhoda.
Jaký hardware potřebuji pro vlastní provoz Kimi K3?
Moonshot AI doporučuje konfigurace s alespoň 64 akcelerátory (GPU) pro optimální inferenci. To znamená, že vlastní provoz celého modelu je pro většinu jednotlivců a menších firem nedostupný — pro ně dává smysl API nebo webová verze. Vědci a větší organizace s přístupem k HPC infrastruktuře však mohou model provozovat nezávisle.