Přejít k hlavnímu obsahu

Meta se vrací k volně dostupné AI. Její nový model má pohánět osobní asistenty

Ilustrační obrázek pro jarvis-ai.cz
Meta v pondělí zveřejnila nový AI model Muse Glimmer. Je postavený tak, aby běžel přímo na vašem počítači — nepotřebuje cloud, nepřipojuje se k internetu. Všechna data zůstávají u uživatele. Model má 30 miliard parametrů, licenci Apache 2.0 a stáhnete si ho zdarma z Hugging Face. Silnější verze Muse Spark 1.2 dorazí v řádu týdnů.

Co je Muse Glimmer a proč běží lokálně

Zatímco konkurence v čele s OpenAI a Anthropicem účtuje měsíční poplatky za přístup ke cloudovým modelům, Meta jde opačným směrem. Muse Glimmer je kompaktní 30miliardový model (přesně ~29,6 miliardy parametrů), který se vejde na běžný herní počítač s 24GB grafickou kartou. V kvantizované 4bitové verzi zabere zhruba 17 GB VRAM — dost na to, aby vedle modelu zbylo místo pro zpracování obrázků, pracovní paměť i speciální „drafter" zrychlující generování textu.

Klíčový rozdíl oproti ChatGPT nebo Claude: Muse Glimmer běží kompletně offline. Žádná data neopouštějí počítač. To má zásadní dopady pro firmy řešící GDPR, pro uživatele pracující s citlivými dokumenty i pro kohokoliv, komu nevyhovuje posílat obsah své komunikace na servery třetích stran.

Model je multimodální — rozumí textu i obrázkům (snímky obrazovky, grafy, dokumenty). Funguje jako agent: umí plánovat vícestupňové úlohy, volat externí nástroje a při selhání se sám opraví a zkusí to znovu, místo aby „spadl" do chybové hlášky.

Rychlost: od 38 do 233 tokenů za sekundu

Local AI má pověst pomalého rozvážeče. Meta to řeší technologií DFlash — malý doprovodný model, který v jednom průchodu navrhne celý blok 16 tokenů a hlavní model je pak paralelně ověří. Výsledkem je 1,5× až 3,1× zrychlení oproti běžnému generování:

  • Nvidia RTX 5090: 233 tokenů/s (3,1× zrychlení)
  • Apple M5 Max: 50 tokenů/s (1,8× zrychlení)
  • Apple M4 Max: 38 tokenů/s (1,5× zrychlení)

Pro představu: 50 tokenů za sekundu znamená plynulou konverzaci v reálném čase. Člověk přečte zhruba 5–10 tokenů za sekundu — model tedy generuje text výrazně rychleji, než ho stíháte číst.

Benchmarky: jak si stojí proti konkurenci ve své váhové třídě

Meta model srovnala se dvěma nejbližšími konkurenty podobné velikosti: Gemma4-31B od Googlu a Qwen3.6-27B od Alibaby. Ve většině testů agentních úloh vychází Muse Glimmer na prvním místě:

Benchmark Muse Glimmer Gemma4 31B Qwen3.6 27B
MCP Atlas (agentní úlohy) 75,5 54,2 62,5
DeepSearch QA 74,6 61,7 71,1
SWE-Bench Pro (programování) 51,2 36,9 50,2
SWE-Bench Verified 76,0 66,6 77,2
AIME 2026 (matematika) 94,7 89,2 94,1
GAIA2 (hledání informací) 43,3 36,4 40,0
WildClawBench (otevřené agentní úlohy) 47,6 37,6 43,2

Muse Glimmer vyhrává v 6 ze 7 testů agentních a rešeršních úloh. Qwen ho těsně poráží jen v SWE-Bench Verified, tedy v opravách reálných chyb z GitHub repozitářů. V obecném matematickém uvažování (AIME 2026) dosáhl model téměř 95% úspěšnosti — výrazně nad očekáváním pro svou velikost.

Cena za AI: kolik ušetříte, když model běží u vás

Rozeberme si to prakticky. Cloudové AI služby stojí dnes běžného uživatele:

  • ChatGPT Plus (OpenAI): 20 USD/měsíc ≈ 460 Kč
  • Claude Pro (Anthropic): 20 USD/měsíc ≈ 460 Kč
  • Gemini Advanced (Google): 22 EUR/měsíc ≈ 550 Kč

Za rok platíte 5 500–6 600 Kč za přístup k modelům, jejichž data zpracovávají cizí servery. Muse Glimmer stojí 0 Kč. Jediným nákladem je počáteční investice do hardware — grafická karta s 24+ GB VRAM vyjde na 15 000–30 000 Kč (např. použitá RTX 3090/4090), ale pokud už doma výkonný počítač máte, neplatíte nic navíc.

Český a evropský kontext: GDPR na prvním místě

Pro české firmy a instituce má Muse Glimmer zásadní výhodu: vše běží na jejich hardware. Žádné přenosy osobních údajů na servery v USA, žádné nejasnosti ohledně toho, kdo má přístup k firemním dokumentům. To je zásadní při zpracovávání citlivých dat — smlouvy, personální dokumentace, zdravotní záznamy — kde cloudové AI často naráží na limity GDPR a interních bezpečnostních politik.

Model je trénovaný na datech z více než 100 jazyků — češtinu tedy zvládá již v základu, i když výkon v méně zastoupených jazycích může být slabší než v angličtině. Pro nasazení v českých firmách je klíčová i licence Apache 2.0, která umožňuje komerční využití bez omezení.

Tah Mety zapadá i do kontextu EU AI Actu, který od 2. srpna 2026 zpřísňuje regulaci vysoce rizikových AI systémů. Lokálně běžící open-source model, který neodesílá data mimo zařízení uživatele, představuje z regulatorního hlediska výrazně jednodušší pozici než cloudové služby operující napříč jurisdikcemi.

Zuckerbergova sázka na otevřenost

Šéf Mety Mark Zuckerberg se v prohlášení ostře opřel do konkurence. „Pokud budou směr udávat laboratoře stavějící AI pro firmy a vlády, převáží moc institucí nad menšími hráči," napsal. Meta dlouhodobě razí filozofii otevřených modelů — od prvních verzí Llama až po aktuální rodinu Muse.

Zuckerberg zároveň tlačí na změnu americké regulace. Tvrdí, že zahraniční laboratoře — zejména čínské — mají výhodu, protože nemusí dodržovat tak přísná omezení ohledně trénovacích dat jako americké firmy. V čele závodu o volně dostupnou AI jsou podle něj čínské modely: Kimi K3 od Moonshot AI, Qwen3.8-Max od Alibaby a DeepSeek V4-Flash.

Zajímavým detailem je, že vývojářský web Hugging Face minulý měsíc uvedl, že se proti kybernetickému útoku bránil právě čínským otevřeným modelem — uzavřené komerční systémy totiž omezují použití v kyberbezpečnosti. Pro Mety je to další argument, proč by open-source AI neměla být omezována.

Co přijde dál: Muse Spark 1.2

Muse Glimmer není posledním slovem. Meta oznámila, že v řádu týdnů zveřejní i silnější model Muse Spark 1.2, opět zdarma a s otevřenou licencí. Spark je „velký bratr" modelu Glimmer — používá se jako učitel, ze kterého se menší model destiluje. Jeho schopnosti by měly výrazně převyšovat nejen Glimmer, ale i současné cloudové modely střední třídy.

Pro uživatele to znamená konkrétní příslib: do Vánoc 2026 byste mohli mít v počítači AI asistenta, který zvládne vše od správy kalendáře přes programování až po analýzu dokumentů — a nepošle o vás jediný bajt na internet.

Model je ke stažení na Hugging Face pod licencí Apache 2.0. K dispozici jsou plné váhy pro výzkum i kvantizované verze pro okamžité nasazení na spotřebitelském hardware.

Zvládne Muse Glimmer češtinu?

Ano. Muse Glimmer je trénovaný na datech z více než 100 jazyků. Češtinu v základu podporuje, nicméně výkon v méně frekventovaných jazycích může být slabší než v angličtině — to je vlastnost sdílená napříč všemi modely této velikosti. Pro každodenní konverzaci a běžné úkoly v češtině by měl být plně použitelný.

Jaký hardware potřebuji pro spuštění Muse Glimmer?

Minimálně 24 GB VRAM pro kvantizovanou verzi (K-Quant-17GB). V praxi to znamená grafickou kartu Nvidia RTX 3090/4090/5090 nebo novější MacBooky s čipy M4 Max/M5 Max. Na 32GB kartě poběží pohodlně i s vyrovnávací pamětí. Pro plnou přesnost je potřeba 64 GB VRAM — to je už spíše doména serverových GPU.

V čem se Muse Glimmer liší od ChatGPT nebo Claude?

Zásadní rozdíl je v architektuře nasazení. ChatGPT a Claude běží výhradně v cloudu — váš požadavek putuje na server OpenAI nebo Anthropicu a tam ho zpracuje masivní model s biliony parametrů. Muse Glimmer běží lokálně, takže (a) nepotřebujete internet, (b) data neopouštějí váš počítač, (c) neplatíte měsíční předplatné. Cenou za toto soukromí je nižší celkový výkon — 30 miliard parametrů vs. stovky miliard u cloudových gigantů. Na druhou stranu, pro úlohy jako správa souborů, psaní e-mailů nebo základní programování je výkon plně dostačující.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.