Otevřený model, který provozujeme lokálně na RTX 5060 Ti 16 GB. V našem měření v AI Aréně dává 27 tokenů za sekundu (průměr pěti testů) a data neopouštějí stroj — proto je zajímavý pro firmy, které nemohou posílat dokumenty do cloudu.
Základní údaje
| Výrobce | Alibaba (Qwen) (Qwen3.8) |
|---|---|
| Vydáno | 2026-08-05 |
| Kontextové okno | 131 072 tokenů |
| Max. výstup | 32 768 tokenů |
| Parametry | 27.00 mld. |
| Vstup | text,image |
| Výstup | text |
| Provoz | local |
Ceny a licence
Model se neprodává přes API — k dispozici jsou váhy ke stažení, cena je tedy jen za vlastní hardware.
Licence: apache-2.0 komerční použití povoleno · licenční text
Naše měření v AI Aréně
Tohle jsou naše vlastní naměřené hodnoty, ne údaje výrobce. Měřeno na jednom konkrétním hardwaru a s konkrétní kvantizací, proto se čísla nedají přenášet na jiný stroj.
| Dokončených testů | 5 |
|---|---|
| Rychlost (Ø) | 27.2 tokenů/s |
| Špička VRAM | 14,7 GB |
| Ø skóre kvality | 5.6 |
Co to znamená pro vás
Qwen3.8-27B je otevřený model s licencí Apache 2.0, takže se dá nasadit i komerčně a bez jednání s výrobcem. Zveřejněn byl na Hugging Face 5. srpna 2026. Kontextové okno je 131 072 tokenů, model zvládá text, kód i obrázky na vstupu. Provozujeme ho lokálně v kvantizaci UD-Q3_K_XL na grafice RTX 5060 Ti s 16 GB paměti; naměřené hodnoty (rychlost, špička VRAM, skóre v testech) najdete v AI Aréně a jsou to naše vlastní měření na konkrétním hardwaru, ne údaje výrobce. Pro českou firmu je hlavní argument to, že žádná data neopouštějí její infrastrukturu — u dokumentů s osobními údaji nebo obchodním tajemstvím to bývá podmínka, kterou cloudové API nesplní.
Model se dá provozovat i lokálně. Spočítejte si potřebnou VRAM v naší kalkulačce →
Alternativy
- Qwen3-32B — Alibaba (Qwen), váhy ke stažení
- Gemma 4 12B — Google, váhy ke stažení
- Qwen3.8 Max — Alibaba Cloud, vstup 2,0000 USD/1M
Články o tomto modelu
- Qwen3.8-Max-0902 vede Code Arena: za webové AI porazil Claude i Kimi
- Otestovali jsme: Qwen3.8 zvládne 128 tisíc tokenů i na 16GB grafice
- Otestovali jsme: Qwen3.8 běží o 69 % rychleji po zapnutí jediného parametru
- Qwen3.8-27B: otestovali jsme 27miliardový model na 16GB grafice. Vejde se jen s druhou kartou
- Nová noční můra velkých hráčů: Otevřený Qwen3.8 drtí konkurenci v reálném kódování
Časté otázky
Můžu model nasadit komerčně?
Ano. Licence Apache 2.0 komerční použití umožňuje bez dalšího jednání s výrobcem.
Je 27 tokenů za sekundu použitelné?
Na dávkové zpracování a asistenty ano, na plynulý chat to je pomalejší. Jde o naše měření na RTX 5060 Ti 16 GB v konkrétní kvantizaci, na jiném hardwaru budou čísla jiná. Naměřené hodnoty najdete v naší AI Aréně, včetně skóre kvality u jednotlivých testů.
Údaje o modelu pocházejí z dokumentace výrobce; ceny z oficiálního ceníku (odkaz výše, datum ověření uvedeno). Naměřené hodnoty jsou naše vlastní měření v AI Aréně na konkrétním hardwaru — u každého testu je uvedena metodika. Našli jste chybu nebo změnu ceny? Napište nám.