Model, který nemá jméno ani tvář
Ox Alpha se 20. srpna nečekaně objevil na platformě OpenRouter, přes kterou si vývojáři objednávají desítky různých jazykových modelů pod jednou API. V nabídce stojí pod štítkem „stealth model“ s poznámkou, že ho vyvinul a provozuje poskytovatel třetí strany, který si během testovací fáze nepřeje odhalit identitu.
Technické parametry přitom nejsou nijak skromné. Model je popisovaný jako systém pro uvažování určený pro kódování, dlouhodobou agentní práci a produkční nasazení. Zvládne kontextové okno přes milion tokenů (přesně 1 048 576) a umí generovat až 131 072 tokenů odpovědi. Na vstupu přijímá text, obrázky i video. V době psaní článku je na OpenRouteru dostupný zdarma.
Pro představu: milion tokenů je velmi rozsáhlé kontextové okno, které může v závislosti na jazyce a tokenizaci odpovídat objemu několika knih nebo velké části kódové báze projektu. Neznamená to ale, že si model obsah doslova „pamatuje“ jako člověk. Skutečná využitelnost takto dlouhého kontextu závisí na tom, jak kvalitně v něm dokáže vyhledávat, udržovat souvislosti a pracovat s relevantními částmi. U běžných placených modelů by vám podobná délka kontextu rychle provětrala účet.
Proč Ox Alpha zaujal vývojáře
Zájem nastartoval oficiální oznámení Stripe o akvizici OpenRouteru, o kterém informoval také TechCrunch. Patrick Collison, šéf platební firmy Stripe, na síti X napsal o Ox Alpha jediné slovní spojení: „very impressive“. Jeho komentář přispěl k pozornosti, kterou model mezi vývojáři získal, sám o sobě však nepředstavuje nezávislé hodnocení výkonu.
K tomu se přidala čísla, která působí neobvykle. Server Wccftech uvádí, že karta modelu na OpenRouteru deklaruje kapacitu zpracovat až 100 bilionů tokenů denně, a to po dobu týdne zdarma. Jde o údaj uvedený v kartě modelu, nikoli o nezávisle ověřené měření.
Údaje z karty modelu na OpenRouteru uvádějí odezvu kolem 4,5 sekundy, propustnost zhruba 24 tokenů za sekundu a dostupnost prakticky 100 procent. OpenRouter zároveň mezi aplikacemi, které přes něj posílají provoz, uvádí nástroje jako Claude Code, OpenCode nebo agent Hermes. Tyto údaje popisují stav a provoz na platformě, nikoli obecný výkon modelu ve všech podmínkách.
Co tokenizer naznačuje o možném původu
Tady se dostáváme k tomu nejzajímavějšímu. Když model odmítne říct, kdo ho postavil, komunita se podívá pod kapotu. Každý velký jazykový model používá takzvaný tokenizer — součást, která převádí text na čísla, se kterými model počítá. Tokenizer může být užitečnou indicií, ale sám o sobě není spolehlivým důkazem autorství, protože stejnou technologii může převzít nebo napodobit více týmů.
Analýza serveru Wccftech a komunitní rozbory ukázaly, že Ox Alpha používá tokenizer označovaný jako cl100k_base, který původně vyvinulo OpenAI. Tato shoda může pomoci zúžit okruh hypotéz, samotný tokenizer však původ modelu nepotvrzuje ani spolehlivě nevylučuje. Wccftech v této souvislosti zmiňuje jako možné kandidáty modely Phi a MAI od Microsoftu, případně jako outsidera IBM Granite. Jde o hypotézy převzaté ze zdroje a komunitních úvah: tokenizer podle této interpretace ukazuje na možné vazby k modelům Microsoftu, nikoli na potvrzený původ Ox Alpha.
Současně existuje konkurenční hypotéza založená na benchmarkových výsledcích, která mířila na Čínu a modely GLM od firmy Z.ai (Zhipu). Podle údajů citovaných serverem Wccftech dosáhl Ox Alpha v komunitně či třetí stranou uváděném testu Kingbench 87,5 procenta, těsně za tehdejším GLM-5.3 s výsledkem 91,25 procenta. Tato čísla nejsou výsledkem oficiálního ani nezávisle reprodukovaného benchmarku. Srovnání s GLM-5.3 může vysvětlovat směr spekulací, není však důkazem identity modelu. Samotné skóre ani použitý tokenizer původ modelu definitivně neurčují.
Proč si nikdo nebyl jistý
Nejistotu posílily příklady experimentálních označení s příponou „Alpha“, jako jsou v komunitních debatách zmiňované názvy Pony Alpha a Hunter Alpha. Tyto příklady mohly přispět k tomu, že se po objevení dalšího modelu s označením „Alpha“ začalo spekulovat o čínském původu. Samy o sobě ho však nepotvrzují.
Jenže dostupné indicie se ne vždy shodují. Zhipu by na takovou propustnost podle dostupných úvah mohla mít výpočetní výkon — provozuje klastry s desítkami tisíc GPU a nedávno zprovoznila obří datacentrum. DeepSeek oproti tomu v poslední době řeší spíš nedostatek kapacity a jeho tokenizace navíc podle dostupné analýzy Ox Alpha neodpovídá. U SpaceXAI (xAI) dostupné podklady samy o sobě neposkytují dostatečný základ pro závěr o původu modelu. Zkrátka — každá teorie má trhlinu a žádná zatím není potvrzená.
Co si z toho vzít jako vývojář v Česku
Pro českého vývojáře je Ox Alpha dostupný hned, a to bez kreditní karty, přes OpenRouter API. Má to ale háček, na který se snadno zapomene. Podmínky OpenRouteru u tohoto konkrétního „stealth modelu“ uvádějí, že provider si uchovává dotazy i odpovědi — byť se zavazuje, že je nepoužije k tréninku. Jde o podmínku vztahující se k danému stealth providerovi, nikoli o obecnou vlastnost všech modelů dostupných na OpenRouteru, ani o závazné bezpečnostní hodnocení modelu nebo poskytovatele. Pro experimentování s modelovým příkladem to může být přijatelné. Pro firemní kód, do kterého byste mu vložili API klíče nebo duševní vlastnictví, to už není lhostejné.
Zajímavější je ale širší obrázek. Že se model dá přes OpenRouter okamžitě zapojit do nástrojů jako Claude Code, je ukázka toho, jak se agentní kódování postupně odděluje od jediného modelu: provoz lze v některých nástrojích přesměrovat změnou konfigurace. Když se objeví nový model, nemusíte nutně čekat na samostatný oficiální nástroj — pokud ho daná služba podporuje, stačí ho napojit.
Anonymita kolem Ox Alpha přitom může skončit, ale dostupné informace zatím neříkají kdy ani zda k oficiálnímu odhalení dojde. U podobných testovacích modelů laboratoře někdy nejprve zveřejní anonymní verzi a teprve později představí produkt pod vlastním jménem, není to však pravidlo. Pro nás je důležité především to, že původ modelu zůstává nepotvrzený a že tokenizer, benchmarky i provozní údaje je třeba číst jako dílčí indicie, nikoli jako definitivní identifikaci.
Mohu Ox Alpha používat s češtinou?
Model je primárně zaměřený na kódování a technickou práci, takže čeština u něj není prioritou, ale jako u většiny velkých modelů by měl rozumět i českým zadáním. Oficiální informace o podpoře češtiny k dispozici nejsou, takže je rozumné to vyzkoušet spíš jako doplněk k anglickému promptu.
Jak dlouho bude Ox Alpha zdarma?
Bezplatný provoz s deklarovanou kapacitou je podle dostupných informací ohraničený testovací fází, v níž se zmiňuje jeden týden. Jde o testovací náhled, takže nelze předpokládat, že zůstane zdarma natrvalo.
Je bezpečné pouštět přes anonymní model firemní kód?
Podmínky OpenRouteru u tohoto stealth modelu uvádějí, že provider uchovává dotazy i odpovědi, i když je nepoužívá k tréninku. Nejde o závazné bezpečnostní hodnocení, ale pro citlivý kód, přihlašovací údaje nebo interní duševní vlastnictví to znamená důvod k opatrnosti. V takovém případě je lepší používat anonymizovaná data a řídit se interními bezpečnostními pravidly.