Mistral Small 4
Otevřený hybridní model Mistralu: 119 miliard parametrů celkem a 6,5 miliardy aktivních, kontext 256 tisíc tokenů a cena 0,15 dolaru za milion vstupních a 0,6 dolaru za výstupní tokeny.
Porovnat tento model s jinými →
Základní údaje
| Výrobce | Mistral (Mistral Small) |
|---|---|
| Vydáno | 2026-03-16 |
| Kontextové okno | 256 000 tokenů |
| Parametry | 119.00 mld. |
| Vstup | text,image |
| Výstup | text |
| Provoz | both |
Ceny a licence
| Vstup | 0,15 USD za 1 milion tokenů |
|---|---|
| Výstup | 0,6 USD za 1 milion tokenů |
| Ověřeno k | 2026-09-30 |
Váhy pod Apache 2.0 na Hugging Face, přes API pod identifikátorem mistral-small-2603. Cena za milion tokenů platí bez ohledu na délku zadání; cache ani batch Mistral u tohoto modelu v ceníku neuvádí.
Přepočet podle kurzu ČNB 29. 9. 2026: 21,501 Kč/USD.
Zdroj ceny: oficiální ceník Mistral
Licence: apache-2.0 komerční použití povoleno · licenční text
Co to znamená pro vás
Mistral Small 4 vyšel 16. března 2026 a je největším modelem řady Small: 119 miliard parametrů v architektuře mixture-of-experts, z toho 6,5 miliardy aktivních při každém průchodu. V jednom modelu spojuje instrukční, uvažovací a kódovací režim, takže nahrazuje dřívější samostatné řady Instruct, Magistral a Devstral. Zvládá multimodální vstup a kontextové okno 256 tisíc tokenů. Váhy jsou ke stažení na Hugging Face pod licencí Apache 2.0, tedy i pro komerční nasazení; pro lokální provoz Mistral doporučuje jeden H100 s 80 GB paměti v přesnosti FP8, na 24GB kartě model poběží jen ve čtyřbitové kvantizaci a s kratším kontextem. Přes API se platí 0,15 dolaru za milion vstupních a 0,6 dolaru za výstupní tokeny bez ohledu na délku zadání.
Model se dá provozovat i lokálně. Spočítejte si potřebnou VRAM v naší kalkulačce →
Alternativy
- GLM-5.3-Flash — Z.ai, cena 0,15 USD za 1 milion tokenů
- DeepSeek V4.1 Flash — DeepSeek, cena 0,3 USD za 1 milion tokenů
- Qwen3.8-27B — Alibaba (Qwen), váhy ke stažení
Časté otázky
Dá se Mistral Small 4 provozovat lokálně?
Ano, váhy jsou pod licencí Apache 2.0, tedy i pro komerční použití. Mistral doporučuje jeden H100 80 GB v přesnosti FP8 pro delší kontext; na 24GB kartě poběží jen ve čtyřbitové kvantizaci.
Proč se model jmenuje Small, když má 119 miliard parametrů?
Rozhoduje počet aktivních parametrů, ne celkových. Při každém průchodu se počítá jen 6,5 miliardy a zbytek zůstává vypnutý, proto je model rychlý a levný.
Údaje o modelu pocházejí z dokumentace výrobce; ceny z oficiálního ceníku (odkaz výše, datum ověření uvedeno). Naměřené hodnoty jsou naše vlastní měření v AI Aréně na konkrétním hardwaru — u každého testu je uvedena metodika. Našli jste chybu nebo změnu ceny? Napište nám.