Suno začalo veřejně testovat funkci Speech, která dokáže z textového zadání vytvořit mluvené audio a odpovídající hudební doprovod v jedné zvukové stopě. Uživatel může zadat vlastní scénář, báseň nebo krátký příběh a popsat hlas i styl hudby. Výsledek má podobu hotové nahrávky, nikoli samostatného hlasu a hudební stopy určených k ručnímu skládání.
Suno rozšiřuje generování hudby o mluvené slovo
Suno je známé hlavně jako služba pro tvorbu hudby z textového zadání. Nová funkce Speech posouvá stejný princip směrem k mluvenému audiu. Uživatel napíše, co má vzniknout, případně vloží vlastní text, a doplní požadovaný typ hlasu a hudebního doprovodu. Výsledkem je jedna zvuková stopa, ve které se hlas a hudba generují společně. To je rozdíl proti běžnému převodu textu na řeč. Klasické nástroje pro syntézu hlasu se soustředí hlavně na přirozenou výslovnost a práci s intonací. Hudbu pak musí uživatel přidat zvlášť v editoru. Suno se pokouší obě části vytvořit v jednom kroku. Podle oficiálního oznámení Suno lze funkci použít například pro básně, meditace, motivační proslovy nebo pohádky před spaním. Společnost ji zatím označuje jako beta verzi. ([suno.com](https://suno.com/blog/introducing-speech-beta)) Suno zveřejnilo funkci Speech 1. října 2026. O den později o ní informoval také The Decoder. Veřejnému spuštění předcházel měsíc uzavřeného testování s menší skupinou uživatelů. ([the-decoder.com](https://the-decoder.com/ai-music-generator-suno-can-now-create-spoken-audio-with-matching-background-music/))Jak Speech funguje v praxi
Použití je podobné jako u ostatních funkcí Suno. Člověk může napsat stručný popis záměru, například že chce klidnou večerní meditaci s hlubším hlasem a pomalou ambientní hudbou. Druhou možností je vložit konkrétní scénář, který má být namluvený. Model potom generuje řeč a hudební podkres současně. Hudbu lze podle dostupných informací také vypnout, takže Speech nemusí sloužit výhradně k tvorbě dramatických audioverzí textu. To se hodí třeba pro krátké hlasové doprovody, čtení scénářů nebo jednoduché mluvené nahrávky. Maximální délka generovaného zvuku je 8 minut. Pro krátkou meditaci, pohádku nebo komentář k videu jde o použitelný limit. Delší podcast nebo audioknihu by bylo nutné rozdělit na více částí a následně spojit v externím programu. Důležitá je také míra kontroly. Uživatel zadává text a popis stylu, ale nemá k dispozici stejné množství detailních nastavení jako v klasickém audioeditoru. Z oznámení Suno není patrné, že by Speech nabízelo přesné řízení tempa, jednotlivých pauz nebo hlasitosti hudby v konkrétních pasážích. V tomto směru je funkce blíže automatickému kreativnímu nástroji než studiovému řešení. Vstupem je nápad nebo scénář, výstupem hotový návrh. Pokud potřebujete přesně načasovat každou větu, upravit dech nebo zachovat stejný hlas napříč desítkami kapitol, bude stále praktičtější specializovaný nástroj pro syntézu řeči a samostatný editor.Beta verze má problémy s přízvukem
Suno samo upozorňuje, že Speech je skutečně ve fázi beta. Mezi popsané chyby patří například záměna britského přízvuku za australský. Pro posluchače, který chce konkrétní regionální výslovnost, to může být nepříjemné překvapení. Objevit se mohou také příliš výrazné dramatické pauzy. U básně nebo filmového monologu mohou působit záměrně. U návodu, firemního oznámení nebo vzdělávacího audia budou spíše rušit. Suno zatím nezveřejnilo podrobnosti o trénovacích datech modelu. To je citlivé téma, protože společnosti zabývající se generováním hudby čelí sporům s nahrávacími firmami. Majoritní hudební vydavatelství Suno zažalovala a mnichovský soud podle informací The Decoder odmítl obhajobu založenou na principu fair use v jednom z případů týkajících se použití chráněných dat. Více podrobností k právnímu sporu uvádí tento článek o žalobách nahrávacích společností a zpráva o rozhodnutí mnichovského soudu. ([the-decoder.com](https://the-decoder.com/ai-music-generator-suno-can-now-create-spoken-audio-with-matching-background-music/)) To neznamená, že každá nahrávka vytvořená Speech automaticky porušuje autorská práva. Praktický problém je jinde. Uživatel by měl vědět, jaká pravidla platí pro použití výsledného audia, zejména pokud ho chce zveřejnit, monetizovat nebo použít v reklamě. U beta funkce navíc nemusí být vždy jasné, jak se liší podmínky pro osobní a komerční využití.Dostupnost a cena pro české uživatele
Speech je podle Suno dostupné jako veřejná beta verze na webu i v mobilní aplikaci. Z oznámení není potvrzeno, že by funkce měla plnohodnotnou podporu češtiny nebo českého přízvuku. České texty lze teoreticky zadat jako vlastní skript, ale kvalita výslovnosti a intonace v češtině není v dostupných materiálech popsána. Pro uživatele v Česku tedy platí jednoduché doporučení. Pokud chcete vytvořit krátké experimentální audio, pohádku nebo hudební podkres k mluvenému textu, Speech dává smysl vyzkoušet. U českého scénáře je ale nutné výsledek poslechnout celý, protože samotná možnost vložit český text ještě nezaručuje přirozenou výslovnost. Suno nabízí také bezplatné používání s limitem 10 skladeb denně. Z dostupných podkladů ale není jasně uvedeno, zda se tento limit vztahuje na Speech stejným způsobem jako na běžné generování hudby. Cenu placených tarifů ani přesné podmínky pro komerční použití nelze z uvedených zdrojů spolehlivě doplnit. Podle údajů uvedených v aktuální rešerši má Suno přes 2 miliony předplatitelů a roční opakované příjmy přes 300 milionů dolarů. Firma tak Speech nepřidává do malého experimentu bez uživatelské základny. Současně ale zůstává u beta označení a otevřeně přiznává chyby ve výsledcích.Pro koho má funkce smysl
Speech může být zajímavé pro tvůrce krátkých videí, autory pohádek, učitele, hobby podcastery nebo uživatele, kteří chtějí rychle převést vlastní text do působivější zvukové podoby. Výhodou je spojení hlasu a hudby v jednom generování. Odpadá první hledání vhodného podkresu a základní synchronizace. Pro profesionální dabing, audioknihy nebo firemní hlasové výstupy je situace opatrnější. Chybné přízvuky, nečekané pauzy a nejasná podpora češtiny mohou znamenat další kontrolu a úpravy. U důležitých nahrávek proto Speech zatím dává větší smysl jako nástroj pro návrh než jako automatická náhrada lidského hlasového studia. Zajímavé je hlavně propojení dvou dosud oddělených úloh. Suno nevytváří pouze hlas a k němu náhodně přidanou hudbu. Snaží se řídit obě složky jako jeden výstup. Jak dobře to funguje u různých jazyků, dlouhých scénářů a přesně zadaných pokynů, ukáže až delší používání mimo omezený test. Zatím je potvrzené především to, že Speech existuje jako veřejná beta funkce, generuje až osmiminutové audio a může mít chyby v přízvuku i frázování. Podrobnosti o trénovacích datech a přesné podpoře češtiny Suno ve svém oznámení neuvedlo. ([suno.com](https://suno.com/blog/introducing-speech-beta))FAQ
Umí Suno Speech mluvit česky?
Suno umožňuje vložit vlastní text, ale v dostupném oznámení nepotvrdilo plnohodnotnou podporu češtiny ani kvalitu českého přízvuku. Český výsledek je proto nutné před použitím celý zkontrolovat.
Lze u Speech vypnout hudební doprovod?
Ano. Podle dostupných informací lze hudební podkres vypnout, takže funkce může sloužit také k tvorbě samotného mluveného audia.
Je možné výsledek ze Suno Speech použít komerčně?
Z uvedených podkladů nelze spolehlivě určit přesné podmínky komerčního použití. Před zveřejněním reklamy, podcastu nebo placeného obsahu je nutné zkontrolovat aktuální licenční podmínky konkrétního tarifu Suno.