Přejít k hlavnímu obsahu

Záhadný model Ox Alpha má jméno. Přiznala se k němu čínská Z.ai

Ilustrační obrázek pro jarvis-ai.cz
Šest dní se tvůrce nejžádanějšího nového modelu posledních týdnů nechal slyšet jen tichem. Ox Alpha dorazil 20. srpna na OpenRouter bez loga, bez autora a zdarma, přičemž zvládal milion tokenů kontextu a na vstupu přijímal i video. Ve středu 26. srpna mlčení skončilo. Čínská Z.ai potvrdila agentuře Bloomberg, že je autorem, a jde o novou iteraci její řady GLM. Váhy chce zveřejnit ještě dnes v noci.

Neznámý hráč, který se prodral nahoru

Ve čtvrtek 20. srpna se Ox Alpha objevil na OpenRouteru i v nástroji OpenCode pod označením „stealth“. Popis byl strohý: reasoning model pro programování, dlouhé agentní úlohy a produkční nasazení. Kontextové okno 1 048 576 tokenů, vstup text, obrázky, video. Kdo stojí za projektem, karta neřekla. Poskytovatel se ukryl za formulku o třetí straně, která si během testovací fáze nepřeje prozradit identitu.

Zbytek udělala čísla. Vývojář Ben Davis pustil model přes deset úloh benchmarku DeepSWE a naměřil 80 procent úspěšnosti na první pokus. Claude Fable 5 se zastavila na 65 procentech, GPT-5.6 Sol na 52. Nezávislé měření to není, ale na pozornost to stačilo. Ox Alpha ukončil 56denní vládu DeepSeeku na vrcholu žebříčku OpenCode a podle Bloomberga nakonec usedl i na první příčku OpenRouteru, kde vygeneroval více než dvojnásobný provoz oproti DeepSeeku.

Všechno bez poplatků. OpenCode sliboval kapacitu 100 bilionů tokenů denně, Nous Research mluvila o kvadrilionu přes vlastní bránu. Štědřejší podmínky nenabídl nikdo. Anonymní nováček se tak během pár dní vyšvihl mezi nejvíce používané modely vůbec.

Komunitní detektivka dopadla přesně

Kdo četl náš předchozí článek o Ox Alpha, věděl, že právě tohle potvrzení komunita čekala. Vývojáři model rozebrali na díly už dřív. Tokenizer se hlásil k rodině GLM ve všech testech. Dax porovnal 25 promptů a počty tokenů seděly s GLM. Pozdější měření dospěla k poměru 11 ku 11, další výzkumníci dokonce k 30 ku 30.

Koncem týdne přišel důkaz ještě tvrdší. Výzkumník publikující jako Chetaslua donutil obslužnou vrstvu, aby při chybném dotazu vypsala interní stack trace. Názvy tříd patřily infrastruktuře Z.ai a chybový kód 1214 odpovídal tomu, jak reagují modely GLM hostované touto firmou. Sedla i práce s videem: spotřeba video tokenů byla napříč vzorky shodná s modelem GLM-5V-Turbo. Tip na „GLM 5.3 Flash“ tedy nebyl zas tak od věci.

Co Z.ai prozradila a co si drží pro sebe

Na dotazy Bloombergu odpověděla Z.ai dvěma sděleními: Ox Alpha je nová iterace řady GLM a váhy se objeví dnes v noci. Na dosud anonymní model to je nečekaně velkorysé, přesto detaily chybí. Konkrétní označení varianty firma nezveřejnila. Analytici tipovali GLM-5.3 Flash nebo multimodální upgrade této linie; původní GLM-5.3 z 14. srpna uměl jen text, kdežto Ox Alpha pracuje i s videem. Rozhodnout má právě dnešní vydání vah.

Nejasná zůstává i cena. Oficiální benchmarky zatím chybí, kolovaly jen komunitní testy. Bezplatné okno má své hranice a po jeho konci bude muset Z.ai říct, kolik si za model účtuje. Předchůdce GLM-5.3 stojí 1,40 dolaru za milion vstupních a 4,40 dolaru za milion výstupních tokenů, cache přitom zlevňuje vstup o 81 procent. Podle těchto hladin lze cenovku tušit, ale potvrzeno není nic.

Anonymní start je u čínských laboratoří už zvyk

Není to poprvé, co čínská laboratoř pustí model do světa bez jména. Ox Alpha je pátým anonymním vydáním za poslední půl roku a všechny předchozí skončily stejným odhalením:

  • Pony Alpha (únor 2026) se po pěti dnech přiznal k identitě GLM-5, vlajkové lodi Z.ai.
  • Hunter Alpha (březen) byl trilionový Xiaomi MiMo-V2-Pro, společně s ním vyšel Healer Alpha jako MiMo-V2-Omni.
  • Elephant Alpha (duben) patřil společnosti Ant Group, šlo o Lingxi Ling-2.6-flash.
  • Owl Alpha (konec dubna) se ukázal jako LongCat-2.0 od Meituanu, trilionový model natrénovaný jen na čínských čipech.

Logika je prostá. Bez jména sbírá model skutečnou provozní zátěž a upřímné ohlasy na neutrální půdě. Nebrzdí ho pověst značky ani slevový narativ, který doprovází každé oznámení čínského open-weight modelu. Až pak přichází formální reveal s daty a cenami.

Co to znamená pro vývojáře a evropské firmy

Pro evropskou scénu je dnešní zveřejnění vah zajímavější než samotné potvrzení autorství. Pokud Z.ai setrvá u praxe posledních generací, model dorazí pod licencí MIT. Kdokoli si ho pak může provozovat na vlastním hardwaru. Firmy, které z obav o data nechtějí posílat kód do čínského cloudu, dostávají cestu k lokálnímu nasazení mimo externí servery. O hardwarových nárocích firma zatím mlčí, takže se čeká na oficiální specifikaci.

V Česku je model dostupný zdarma hned teď, a to přes OpenRouter nebo OpenCode, standardní cestou místních vývojářů. Na ověření kvality češtiny bychom ale měli počkat. Z.ai tradičně uvádí primární jazyky čínštinu a angličtinu a u starších verzí GLM nikdo český výstup nezávisle netestoval. Pro kódování, které žije převážně v angličtině, to problém nedělalo. U dlouhých českých textů platilo opatrnější hodnocení.

Zaslouží pozornost i bezpečnostní rovina. Podle dosavadních měření Ox Alpha zvládá úlohy, které dřív patřily placeným špičkám. Jakmile váhy vyjdou, schopnost se rozšíří na každého, kdo si je stáhne. Přesně v ten moment přestává debata o otevřených modelech a kybernetické bezpečnosti točit jen kolem západních firem.

Kdy a kde půjde váhy Ox Alpha stáhnout?

Z.ai slibuje vydání dnes v noci, místo publikace ale nespecifikovala. Podle dosavadní praxe firmy lze čekat repozitář typu Hugging Face a licenci MIT. S váhami bývají do pár dní venku i kvantované verze od komunity.

Kolik bude Ox Alpha stát po skončení bezplatného okna?

Ceník neexistuje. Předchozí GLM-5.3 na vlastním API stojí 1,40 dolaru za milion vstupních a 4,40 dolaru za milion výstupních tokenů; podobnou hladinu lze čekat i u novinky, jde ale jen o odhad. Dokud ceny nezveřejní, nelze na aktuální nulu stavět produkční rozpočet.

Půjde Ox Alpha provozovat lokálně na vlastním hardwaru?

Po vydání vah v principu ano, parametry a nároky na hardware firma zatím neoznámila. Řada GLM patří k velkým MoE modelům se stovkami miliard parametrů, plná verze proto bude chtít robustní server. Dostupnější mohou být menší nebo zkomprimované varianty, ale ty teprve uvidíme.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.