Přejít k hlavnímu obsahu

Kimi K3 od Moonshot AI: První otevřený model s 2,8 bilionu parametrů

Ilustrační obrázek
Čínské Moonshot AI právě vypustilo Kimi K3 — první otevřený model s 2,8 bilionu parametrů. V benchmarcích nejenže drtí vše open-source, ale v několika disciplínách poráží i GPT-5.6 Sol a Claude Fable 5. A to všechno s veřejně dostupnými váhami.

Kimi K3: Čínská odpověď na dominanci OpenAI a Anthropicu

Společnost Moonshot AI se sídlem v Pekingu oznámila 16. července 2026 uvedení modelu Kimi K3 — svého dosud nejvýkonnějšího velkého jazykového modelu. Jde o první otevřený model v kategorii 3 bilionů parametrů (přesněji 2,8 bilionu) a jeho veřejně dostupné váhy byly uvolněny 27. července 2026. Model představuje zásadní posun v tom, co si můžeme představit pod pojmem „open-source AI".

Na rozdíl od uzavřených špičkových modelů od OpenAI či Anthropicu si výzkumníci, firmy a vývojáři mohou Kimi K3 zdarma stáhnout a provozovat na vlastní infrastruktuře. Pro evropské firmy, které se potýkají s přísnými požadavky EU AI Act na transparentnost a bezpečnost AI systémů, je to klíčová výhoda — mohou model auditovat, kontrolovat a přizpůsobit vlastním potřebám bez závislosti na API třetí strany.

Co Kimi K3 umí — a co ne

Kimi K3 je navržený především pro dlouhé programovací úlohy, znalostní práci a komplexní uvažování. Model nativně rozumí textu, obrázkům i videu a disponuje kontextovým oknem o velikosti 1 milion tokenů — což je zhruba ekvivalent celé ságy Pána prstenů včetně Silmarillionu.

Moonshot AI předvedlo několik impozantních ukázek:

  • Chip design: Kimi K3 během 48 hodin autonomně navrhl, optimalizoval a ověřil vlastní čip na 45nm knihovně Nangate s využitím open-source EDA nástrojů. Čip o rozloze 4 mm² zvládá takt 100 MHz a v simulaci dosahuje propustnosti přes 8 700 tokenů za sekundu.
  • GPU kernel optimalizace: Model samostatně profiluje, přepisuje a benchmarkuje GPU kernely na NVIDIA Hopper i alternativních GPGPU kartách — v testech překonal Claude Opus 4.8 i GPT-5.6 Sol.
  • Kompilátor od nuly: K3 postavil MiniTriton — kompaktní Triton-like kompilátor s vlastní IR vrstvou, optimalizačními průchody a PTX generátorem kódu, který v některých benchmarcích překonává Triton i torch.compile.
  • Vědecký výzkum: Model za dvě hodiny reprodukoval výzkum I-Love-Q univerzálních relací v astrofyzice — úkol, který zkušenému výzkumníkovi obvykle zabere 1–2 týdny.

Architektura: Na čem Kimi K3 stojí

Za výkonem K3 stojí několik architektonických inovací. Model využívá Mixture of Experts s 896 experty, z nichž je na každý token aktivováno 16 — to umožňuje obrovskou kapacitu modelu při zachování rozumných výpočetních nákladů. Klíčovou novinkou je Kimi Delta Attention (KDA), která efektivněji škáluje pozornost napříč dlouhými sekvencemi. Spolu s Attention Residuals (AttnRes) tyto architektonické změny přinášejí přibližně 2,5násobné zlepšení škálovací efektivity oproti předchozí verzi Kimi K2.

Model byl trénován s kvantizačně-učeným přístupem (QAT) od fáze SFT — pro váhy používá formát MXFP4 a pro aktivace MXFP8, což zajišťuje širokou hardwarovou kompatibilitu napříč různými GPU architekturami.

Benchmarky: Kde K3 poráží konkurenci

Kimi K3 dosahuje frontier-level výkonu napříč programovacími, agentními a znalostními benchmarky. Zde jsou klíčová srovnání:

Benchmark Kimi K3 GPT-5.6 Sol Claude Fable 5 Opus 4.8
DeepSWE v1.1 71,2 % 72,3 % 69,1 % 52,6 %
Terminal-Bench 2.1 58,7 % 29,0 % 37,0 % 33,0 %
SWE Marathon 64,4 % 59,2 % 35,6 % 25,5 %
Program Bench 89,0 % 83,8 % 88,9 % 68,3 %
FrontierSWE 70,5 % 49,0 % 25,0 %
MCP Atlas 65,6 % 48,9 % 55,5 % 44,8 %
BrowseComp 91,8 % 80,0 % 93,7 % 82,0 %

Z čísel je patrné, že Kimi K3 v programovacích a agentních úlohách systematicky poráží Opus 4.8 a v řadě disciplín drží krok s nejužší špičkou — Claude Fable 5 a GPT-5.6 Sol. V Terminal-Bench 2.1, SWE Marathon a MCP Atlas dokonce Fable 5 i GPT-5.6 Sol přesvědčivě překonává.

Cena: Kolik stojí provoz Kimi K3?

Moonshot AI nabízí Kimi K3 přes Kimi API Platform s následujícím ceníkem:

  • Vstup (cache hit): 0,30 USD / milion tokenů — cca 6,50 Kč
  • Vstup (cache miss): 3,00 USD / milion tokenů — cca 65 Kč
  • Výstup: 15,00 USD / milion tokenů — cca 325 Kč

Díky architektuře Mooncake dosahuje oficiální Kimi API při programovacích úlohách cache hit rate nad 90 %, což znamená, že reálná cena za vstup se v praxi blíží nižšímu pásmu. Pro srovnání: GPT-5.6 Sol stojí 10 USD/Mtok za vstup a 60 USD/Mtok za výstup, Claude Fable 5 pak 15 USD/Mtok za vstup a 75 USD/Mtok za výstup. Kimi K3 je tak 2–4× levnější na výstupu než srovnatelné proprietární modely.

Pro firmy a vývojáře, kteří model nasadí na vlastní hardware, odpadají API poplatky úplně — platí pouze náklady na GPU infrastrukturu. Moonshot AI doporučuje nasazení na konfiguracích se 64 a více akcelerátory pro optimální inferenci.

Co to znamená pro Česko a Evropu?

Kimi K3 přichází v době, kdy Evropa hledá vlastní cestu v AI. EU AI Act, který od srpna 2026 zavádí nové povinnosti pro označování AI výstupů a transparentnost modelů, zvýhodňuje otevřené modely — ty totiž umožňují nezávislý audit a kontrolu, což je jeden z klíčových požadavků regulace.

Pro české firmy a výzkumné instituce je klíčové, že váhy modelu jsou veřejně dostupné. To otevírá cestu k:

  • Fine-tuningu pro češtinu — české jazykové schopnosti Kimi K3 jsou zatím neotestované, ale akademické instituce jako MFF UK nebo FIT ČVUT mohou model dotrénovat na českých datech
  • On-premise nasazení — firmy s citlivými daty (banky, zdravotnictví, státní správa) mohou model provozovat lokálně bez odesílání dat do cloudu třetích stran
  • Výzkumu bezpečnosti AI — otevřené váhy umožňují akademikům studovat chování modelu, včetně potenciálních rizik

Nutno však dodat, že Kimi K3 není lokalizován do češtiny — komunikuje primárně anglicky a čínsky. Pro koncového českého uživatele je tedy zatím méně praktický než ChatGPT nebo Claude, které mají češtinu na slušné úrovni. Pro vývojáře a firmy je ale otevřenost modelu zásadní konkurenční výhoda.

Omezení a rizika

Moonshot AI v technickém blogu otevřeně přiznává několik omezení:

  • Citlivost na historii přemýšlení: K3 byl trénován v režimu zachovaného thinking history — pokud agentní prostředí nepředává kompletní historii myšlenek, kvalita výstupu se může dramaticky zhoršit.
  • Přílišná proaktivita: Model má tendenci dělat rozhodnutí za uživatele i v situacích, kdy to není vhodné. Pro bezpečné nasazení je potřeba explicitní omezení v systémovém promptu.
  • Mezera v UX: Přes skvělé benchmarky přiznává Moonshot AI, že v uživatelském zážitku K3 zaostává za Claude Fable 5 a GPT-5.6 Sol.

Z pohledu EU AI Act spadá Kimi K3 díky své otevřené povaze do kategorie s nižšími regulatorními požadavky — open-source modely mají podle aktuálního znění Aktu o AI výjimky z některých povinností. Přesto platí, že každé nasazení modelu v produkčním prostředí musí splňovat obecné požadavky na bezpečnost a transparentnost.

Jak Kimi K3 vyzkoušet?

Kimi K3 je dostupný na několika platformách:

  • Web: kimi.com — zdarma pro základní použití
  • Desktop: Kimi Work (Windows, Apple Silicon Mac), verze 3.1.0+
  • Terminál: Kimi Code — open-source nástroj pro programování s AI asistencí
  • API: platform.kimi.ai — s ceníkem výše
  • Mobil: iOS, Android, HarmonyOS

Je Kimi K3 opravdu open-source? Jaká licence se na model vztahuje?

Váhy modelu jsou veřejně dostupné ke stažení, což umožňuje výzkumné i komerční využití. Přesné licenční podmínky zatím nebyly zveřejněny — Moonshot AI uvedlo, že technický report a detaily ohledně licence vydá společně s váhami.

Může Kimi K3 nahradit ChatGPT nebo Claude pro běžného českého uživatele?

Zatím spíše ne. Kimi K3 je primárně optimalizován pro programování a odbornou znalostní práci v angličtině. Pro běžnou konverzaci v češtině jsou ChatGPT a Claude výrazně lepší volbou. Pro české vývojáře a firmy je ale otevřenost K3 zásadní výhoda.

Jaký hardware potřebuji pro vlastní provoz Kimi K3?

Moonshot AI doporučuje konfigurace s alespoň 64 akcelerátory (GPU) pro optimální inferenci. To znamená, že vlastní provoz celého modelu je pro většinu jednotlivců a menších firem nedostupný — pro ně dává smysl API nebo webová verze. Vědci a větší organizace s přístupem k HPC infrastruktuře však mohou model provozovat nezávisle.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.