Přejít k hlavnímu obsahu

Grok 4.3 vs Claude Opus 4.8: Desetkrát dražší výstupní tokeny — vyplatí se připlatit?

Ilustrační obrázek pro jarvis-ai.cz
Osm dní od sebe. Duben a květen 2026. Dva technologičtí giganti — Elon Musk se svou xAI a Anthropic bratří Amodeiových — vypustili do světa své vlajkové modely. Na papíře podobné: milion tokenů kontextu, schopnost uvažovat, agentní workflow. Jenže pak přijde řeč na cenu. A tady se příběh láme: Claude Opus 4.8 stojí za výstupní tokeny přesně desetkrát tolik co Grok 4.3. Pojďme se podívat, jestli ten rozdíl dává smysl — a hlavně co to znamená pro české vývojáře a firmy.

Dva modely, dvě filozofie

Grok 4.3 od xAI (dříve SpaceXAI) dorazil do plné API 30. dubna 2026 — beta verze běžela od 17. dubna pro předplatitele SuperGrok Heavy. Kontextové okno má 1 milion tokenů, přijímá text, obrázky a podle dokumentace xAI i nativní video. Ceník? $1,25 za milion vstupních tokenů a $2,50 za milion výstupních — data podle nezávislých trackerů OpenRouter a Artificial Analysis.

Grok 4.3 je přímým potomkem spojení xAI se sociální sítí X (dříve Twitter). To není jen marketing — znamená to, že model má strukturální přístup k živému sociálnímu feedu, což žádný uzavřený konkurent (včetně Clauda) nenabízí bez externího napojení na vyhledávání.

Claude Opus 4.8 od Anthropicu vyšel 28. května 2026. Staví na Opus 4.7, ale podle oficiálního oznámení přináší výrazné zlepšení v „upřímnosti“ — je zhruba čtyřikrát méně pravděpodobné, že nechá projít chybu v kódu bez povšimnutí. Cena zůstala stejná jako u předchůdce: $5 za milion vstupních tokenů a $25 za milion výstupních. Kontextové okno je rovněž 1 milion tokenů a Anthropic jako jediný uvádí pevný strop výstupu na 128 000 tokenů.

Zatímco xAI sází na rychlost, nízkou cenu a napojení na živá data, Anthropic prodává spolehlivost, bezpečnost a ověřené výsledky v kódování. Jsou to dvě různé odpovědi na stejnou otázku — a obě dávají v určitých situacích smysl.

Cenová propast v číslech: 4× vstup, 10× výstup

Základní srovnání cen vypadá takto (přepočet na koruny kurzem 1 USD = 22 Kč, aktuální k červenci 2026):

Model Vstup (za 1M tokenů) Výstup (za 1M tokenů) Kontext
Grok 4.3 $1,25 (27,50 Kč) $2,50 (55 Kč) 1M tokenů
Claude Opus 4.8 $5,00 (110 Kč) $25,00 (550 Kč) 1M tokenů
Násobek (Claude / Grok) 10× shodné

Desetinásobek za výstupní token. To je číslo, které při rutinním provozu bolí. Ale reálný násobek závisí na tom, jak moc je vaše aplikace výstupně náročná. Projděme si čtyři typické scénáře.

Co reálně zaplatíte: čtyři scénáře v korunách

Následující tabulka modeluje měsíční provoz čtyř různých workloadů. Všechny ceny přepočítávám na koruny — protože právě v nich bude váš finanční šéf hodnotit návratnost.

Scénář Grok 4.3 (měsíčně) Claude Opus 4.8 (měsíčně) Násobek
Chatbot zákaznické podpory
20M vstup / 2M výstup tokenů
$30 (~660 Kč) $150 (~3 300 Kč)
Kódovací agent
10M vstup / 10M výstup tokenů
$37,50 (~825 Kč) $300 (~6 600 Kč)
RAG analýza dokumentů
100M vstup / 5M výstup tokenů
$137,50 (~3 025 Kč) $625 (~13 750 Kč) 4,5×
Generování obsahu ve velkém
5M vstup / 50M výstup tokenů
$131,25 (~2 888 Kč) $1 275 (~28 050 Kč) 9,7×

Násobek není fixních 10× — pohybuje se od 4,5× po 9,7× podle toho, jak moc je váš workload výstupně náročný. Kódovací agent, který generuje hodně kódu, pocítí téměř plnou desetinásobnou přirážku. Naopak dokumentová analytika, která hlavně čte, zaplatí „jen“ 4,5× víc.

Pro představu o celkových nákladech: u kódovacího agenta s 10M/10M tokeny měsíčně vyjde roční provoz na Grok 4.3 na zhruba 9 900 Kč, zatímco Claude Opus 4.8 na 79 200 Kč. Rozdíl téměř 70 tisíc korun ročně za jeden agentní nástroj. Máte-li takových agentů v produkci deset, bavíme se o statisících.

Benchmarky: Claude vítězí v kódování, Grok mlží

Nejde jen o cenu — jde o to, co za ni dostanete. A tady je obrázek méně jednostranný, než by se podle cen mohlo zdát.

Podle Artificial Analysis Intelligence Index v4.1 (kompozit devíti evaluací zahrnující kódování, vědecké uvažování, znalosti a agentní úkoly) skóroval Claude Opus 4.8 na úrovni, která ho řadí mezi nejvýkonnější modely na trhu. Grok 4.3 dosahuje solidního nadprůměru, ale za Claudem zaostává.

Klíčový benchmark pro vývojáře — SWE-bench Verified — ukazuje, kde je Anthropic nejsilnější. Claude Opus 4.8 dosáhl 88,6 % na testu postaveném z reálných GitHub issues, kde model musí opravit skutečné bugy v reálných repozitářích. To není syntetický kvíz — to je simulace práce vývojáře. Pro srovnání: xAI žádné SWE-bench skóre pro Grok 4.3 dosud nezveřejnila, což je pro kohokoli, kdo model zvažuje na kódování, podstatná mezera v datech.

V oblasti rychlosti generuje Grok 4.3 podle nezávislých měření zhruba 117 tokenů za sekundu (nad průměrem kategorie kolem 76 t/s). Anthropic srovnatelná čísla pro Opus 4.8 nezveřejnil, takže přímé srovnání není možné. Grok má ale i slabinu: čas do prvního tokenu (TTFT) činí přibližně 22 sekund — to je při interaktivním chatu znát.

Co na to český vývojář a firma

Oba modely jsou z České republiky dostupné přes standardní API — buď přímo od výrobců (xAI API, Anthropic API), nebo přes agregátory jako OpenRouter, který oba nabízí s jednotným rozhraním kompatibilním s OpenAI SDK.

Ani jeden z modelů nemá oficiální českou lokalizaci, ale oba češtinu zvládají na velmi slušné úrovni — Grok 4.3 díky tréninku na vícejazyčných datech z X, Claude Opus 4.8 díky Anthropicem deklarovanému důrazu na mnohojazyčnost. Pro produkční nasazení v češtině doporučuji otestovat oba na konkrétních promptech — rozdíly v kvalitě výstupu se mohou lišit podle domény.

Z hlediska EU AI Act, který od srpna 2026 zavádí povinnosti pro poskytovatele a nasazovatele vysoce rizikových AI systémů, je Anthropic díky své transparentnosti (system card, alignment assessment) v mírné výhodě — firma zveřejňuje detailní bezpečnostní testování, což usnadňuje compliance. xAI je v tomto ohledu uzavřenější, což může být pro firmy podléhající regulaci problém.

Pro české startupy a malé týmy je klíčový ekonomický argument: s Grok 4.3 můžete při stejném rozpočtu provozovat zhruba 5× až 10× větší objem požadavků. To znamená víc iterací, víc testování a delší runway, než začnete potřebovat platící zákazníky. Pro vývojový tým o třech lidech, který staví MVP AI agenta, může být rozdíl mezi 800 Kč a 6 600 Kč měsíčně zásadní.

Praktický verdikt: Hybrid je cesta

Odpověď není „Grok, nebo Claude“ — je to „Grok, a Claude. Čím dál víc týmů nasazuje oba modely současně a směruje úkoly podle jejich silných stránek. Tady je rozhodovací tabulka pro výběr:

Pokud potřebujete… Vítěz Proč
Nejnižší cenu za token Grok 4.3 4× levnější vstup, 10× levnější výstup
Spolehlivé kódování a opravy bugů Claude Opus 4.8 88,6 % SWE-bench Verified, 4× méně přehlédnutých chyb
Živý kontext ze sociálních sítí Grok 4.3 Nativní napojení na X data
Enterprise spolehlivost a bezpečnost Claude Opus 4.8 Dokumentovaný strop výstupu, system card, alignment testy
Nativní zpracování videa Grok 4.3 Claude Opus 4.8 video vstup nepodporuje
Dlouhé autonomní agentní běhy Claude Opus 4.8 Ověřené výsledky na multi-step úlohách, menší odchylky

Nejlepší výsledky v praxi přináší hybridní architektura: plánování a kontrolní kroky nechte na Claudovi (kde chyba stojí hodně), vysokorychlostní exekuci a levné iterace předejte Grokovi. Jeden model na všechno je v polovině roku 2026 zbytečný kompromis.

Aktuální čísla v tomto článku odrážejí data k červenci 2026. Oba výrobci vydávají nové verze v řádu týdnů, nikoli měsíců — xAI už má v nabídce Grok 4.5, Anthropic avizuje modely třídy Mythos. Než se zavážete k jednomu vendorovi, ověřte si aktuální ceník Anthropicu a Grok na OpenRouteru — ceny i benchmarky se mění rychleji, než to stihne kterýkoli srovnávací článek.

Je Grok 4.3 opravdu 10× levnější než Claude Opus 4.8?

Ano, pokud jde o výstupní tokeny: $2,50 za milion (Grok) versus $25,00 za milion (Claude). U vstupních tokenů je rozdíl menší — 4× ($1,25 vs $5,00). V praxi se násobek celkových nákladů pohybuje od 4,5× do 9,7× podle poměru vstupních a výstupních tokenů ve vašem konkrétním workloadu.

Můžu Grok 4.3 a Claude Opus 4.8 používat z Česka?

Ano. Oba jsou dostupné přes standardní REST API přímo od výrobců nebo přes agregátory jako OpenRouter. Ani jeden nemá oficiální českou lokalizaci, ale oba zvládají češtinu na dobré úrovni. Pro produkční nasazení doporučujeme otestovat výstupy v češtině na konkrétních promptech.

Proč xAI nezveřejnila SWE-bench skóre pro Grok 4.3?

Není to oficiálně vysvětleno. xAI jednoduše nezahrnula SWE-bench Verified do svého reportingu. To neznamená, že je Grok 4.3 v kódování slabý — jen to znamená, že nemáme nezávisle ověřitelná data pro přímé srovnání. Pokud je pro vás kódování klíčové, nechte si vlastní evaluační sadu a otestujte oba modely na reálných úlohách.

Dá se přejít z jednoho modelu na druhý bez přepisování kódu?

Do značné míry ano. Oba používají podobný formát požadavků (chat-completion JSON). Liší se endpointy (api.x.ai vs api.anthropic.com), názvy parametrů a chování při ořezávání dlouhých odpovědí. Claude má pevný strop 128 000 výstupních tokenů, Grok žádný limit nedokumentuje — což je třeba ošetřit vlastní logikou.

X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.