Přejít k hlavnímu obsahu
Obrázek
Ilustrační obrázek pro jarvis-ai.cz

Otestovali jsme: Qwen3.8 běží o 69 % rychleji po zapnutí jediného parametru

V llama.cpp je u modelu Qwen3.8-27B ukrytá funkce, která umí předvídat další tokeny dopředu. Většina lidí ji ale nikdy nezapne, protože ji knihovna bez explicitního přepínače tiše ignoruje. Přicházejí tak o třetinu až dvě třetiny rychlosti zadarmo. Při ověření na dvou grafických kartách se rychlost generování po zapnutí jediného parametru zvedla o 69 procent — z 15,9 na 26,8 tokenu za sekundu. Žádný nový model, žádná konverze, žádný poplatek.
17. 8. 2026 Daniel Česák
Obrázek
Ilustrační foto

Qwen3.8-27B: otestovali jsme 27miliardový model na 16GB grafice. Vejde se jen s druhou kartou

Qwen3.8-27B je nový 27miliardový model od Alibaby, který v sobě spojuje dvě věci najednou: rozumí obrázkům i videu a zároveň je laděný na programování a dlouhé agentní úlohy. My jsme ho otestovali na vlastním hardwaru — na 16GB grafice se v této konfiguraci nevešel, ale s druhou, starší kartou už běžel rychlostí 15 tokenů za sekundu. Změřili jsme reálný výkon konkrétní sestavy, ne obecnou rychlost modelu ani marketingové slajdy.
17. 8. 2026 Daniel Česák
Obrázek
Ilustrační obrázek

Nová noční můra velkých hráčů: Otevřený Qwen3.8 drtí konkurenci v reálném kódování

Qwen3.8 není zajímavý pouze jako další otevřený model. Jeho hlavní přínos pro vývojáře spočívá v kombinaci licence Apache 2.0, multimodální práce a výsledků v praktických programátorských a agentních úlohách. Model Qwen3.8-27B se podle zveřejněných testů v některých disciplínách dostává před větší Qwen3.7-Plus, přestože v odborných znalostech nezaostává za konkurencí vždy. Pro české firmy tak představuje především stavebnici pro vlastní nasazení, ne další hotovou chatbotovou aplikaci.

Qwen patří mezi nejaktivnější modelové týmy společnosti Alibaba.

15. 8. 2026 Daniel Česák
Subscribe to Qwen
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.