Přejít k hlavnímu obsahu

Grok Imagine Image 2.0: nový obrazový model xAI míří na světovou špičku

Ilustrační obrázek pro jarvis-ai.cz
xAI představilo Imagine Image 2.0 — novou generaci obrazového modelu, která má být konečně použitelná pro skutečnou práci: přesná editace vybraných oblastí, ostrý text na obrázcích, chytrý ořez do libovolného poměru stran a šablony pro produktové fotky, ikony nebo herní grafiku. Model se hned při debutu vyšvihl na druhé místo světových žebříčků Arena v generování i editaci obrázků. Zatím je ale dostupný jen v aplikaci Grok, API přijde později.

Grok Imagine Image 2.0: co je nového

Společnost xAI oznámila Imagine Image 2.0 jako nástupce své generativní obrazové řady. Nový model je ode dneška obecně dostupný jako takzvaný Quality Mode na stránce grok.com/imagine a v mobilních aplikacích Grok pro iOS i Android. Podle oficiálního oznámení byl model postavený kolem jediného cíle: „dělat obrázky, které využijete při skutečné práci."

V praxi to znamená tři hlavní vylepšení oproti minulé generaci. Model lépe následuje instrukce a drží se detailů zadání, plánuje typografii a rozvržení jako grafik — takže složitější víceprvkové vizuály drží pohromadě a drobný text zůstává ostrý — a zachovává konzistenci napříč generacemi i editacemi. Slibuje také lepší faktualitu, tedy menší sklon k vymýšlení nesmyslných detailů, které u starších modelů kazily dojem z výsledku.

Editace, která změní jen to, co chcete

Největší pozornost si zaslouží nástroje pro precizní editaci. xAI je staví na principu, že první vygenerovaný obrázek málokdy bývá finálním assetem, a proto přidává čtyři funkce:

  • Magic Wand (kouzelná hůlka) — edituje pouze oblast, na kterou ukážete, zbytek obrázku nechá beze změny.
  • Segmentation — přesný výběr konkrétních částí obrázku, které chcete upravit.
  • Background removal — odstranění pozadí a export objektu s průhledným pozadím, připraveného k vložení do jiné práce.
  • Multi-ref editing — v jedné generaci lze použít až pět referenčních obrázků, takže odpadá ruční skládání výsledku.

K tomu přibyl Smart Resize: jeden obrázek lze nechat překomponovat do devíti poměrů stran — od vertikálního banneru 1:2 přes čtverec 1:1 až po širokoúhlé 16:9 a 2:1. Model přitom sám domaluje okraje, takže výsledek nevypadá jako useknutý, ale jako by byl v daném formátu vygenerovaný od začátku. To je praktická funkce pro sociální sítě, e-shopy i tisk.

Šablony a konzistentní světy pro video

xAI zároveň představilo šablony, které balí běžné pracovní postupy do hotových startovacích bodů. Patří mezi ně úprava fotek, změna barvy produktu, e-commerce fotografie, UGC fotky, profesionální portréty, generátor ikon, herní sprite postavy, sady rekvizit a UI prvků, tvůrce emoji nebo motivy na merch. Stačí dodat vstupy a model vrátí hotový výsledek.

Zajímavý je i koncept „postav svět pro video": jednu postavu, její lokace a rekvizity lze generovat samostatně a model drží jednotný styl napříč obrázky. Jde o stejný princip, který filmaři a herní studia potřebují při přípravě assetů — konzistentní look, na který se pak naváže animace nebo video generátor.

Druhé místo na světě podle Areny

Hned při debutu se model umístil na druhé příčce světového žebříčku Arena jak v generování text-to-image, tak v editaci obrázků — oficiálně potvrzeno týmem Arena.ai. V žebříčku Text-to-Image získal 1320 bodů Elo, v Image Edit Arena pak 1439 bodů. Pro srovnání: předchozí model Grok Imagine Image Quality se v generování pohyboval až na 14. místě, takže jde o výrazný skok.

Po kategoriích je model dvojkou v umění, portrétech, renderování textu, kresleném a anime stylu i fotorealistických záběrech, a trojkou v produktovém a komerčním designu. V editaci se umístil na druhém místě ve všech hodnocených kategoriích. Je ovšem třeba dodat drobnost: Arena testovala verzi Grok Imagine Image 2.0 (Low), která je zatím dostupná pouze v aplikaci — ne přes API.

Dostupnost a cena

Imagine Image 2.0 je ode dneška součástí aplikace Grok. Základní účet zdarma nabízí omezené generování, plný přístup k obrazové tvorbě (i videu) je součástí předplatného SuperGrok za 30 dolarů měsíčně (zhruba 700 Kč), dražší varianta SuperGrok Heavy pak cílí na náročnější uživatele a vývojáře. Konkrétní počty generací na free účtu xAI nezveřejňuje.

Vývojáře bude zajímat, že API přístup „přijde brzy" — zatím bez konkrétního data a ceníku. To znamená, že si model zatím nelze předplatit přes API jako konkurenční GPT Image 2 od OpenAI, Gemini od Googlu nebo Luma. Pro české uživatele je důležité, že Grok funguje v Česku bez omezení a webové rozhraní grok.com/imagine je dostupné i bez předplatného, takže si nový model může vyzkoušet každý.

Co to znamená pro české tvůrce

Pro české grafiky, marketéry a e-shopaře je hlavní přínos v tom, že konkurence v generování obrázků tlačí ceny dolů a kvalitu nahoru. Imagine Image 2.0 míří přesně na úkoly, které firmy denně řeší — úprava produktových fotek, tvorba bannerů v různých formátech, ikony, emoji nebo konzistentní vizuály pro sociální sítě. Funkce jako Smart Resize nebo odstranění pozadí znamenají, že část práce, kterou dřív dělal grafik v editoru, zvládne zadání v přirozeném jazyce. Text na obrázcích přitom býval slabinou generativních modelů — pokud xAI skutečně vyřešilo ostré a správně napsané popisky, půjde o jednu z nejpraktičtějších funkcí pro lokální marketing. Stejně jako u jiných generativních modelů platí, že v EU je třeba počítat s pravidly AI Actu, tedy označováním AI generovaného obsahu.

Je Grok Imagine Image 2.0 dostupný přes API?

Zatím ne. Model je dostupný pouze v aplikaci Grok (web, iOS, Android) jako nový Quality Mode. xAI oficiálně potvrdilo, že API přístup „přijde brzy", ale bez konkrétního termínu a ceníku. Verze hodnocená v Areně (2.0 Low) rovněž není přes API dostupná.

Kolik stojí používání Imagine Image 2.0?

Základní účet Grok zdarma nabízí omezené generování obrázků. Plný přístup k obrazové i video tvorbě je součástí předplatného SuperGrok za 30 dolarů měsíčně (přibližně 700 Kč). xAI neuvádí přesné počty generací na free účtu.

Jak si Imagine Image 2.0 stojí ve srovnání s konkurencí?

Podle žebříčků Arena (stav k 7. srpnu 2026) je model druhý na světě v generování text-to-image (1320 bodů Elo) i v editaci obrázků (1439 bodů). Po kategoriích vede v portrétech, textovém renderování, anime stylu a fotorealistických záběrech; v produktovém designu je třetí. Hlavní konkurenti jsou GPT Image 2 od OpenAI, modely Google a Luma.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.