Přejít k hlavnímu obsahu

Yandex zjednodušil doporučování hudby. Sona nahradila celou kaskádu

Ilustrační obrázek
Yandex nasadil v hudební službě Yandex Music generativní doporučovací model Sona. Ten nahrazuje dosavadní systém složený z více než 15 generátorů kandidátů, předběžného řazení a finálního rankingu. V sedmidenním A/B testu na chytrých reproduktorech zvýšil počet aktivních uživatelů o 4,53 procenta, celkový čas poslechu doporučených skladeb o 6,30 procenta a počet lajků o 11,42 procenta.

Jeden model místo několika fází

Doporučovací systémy velkých služeb obvykle nefungují jako jeden algoritmus, který uživateli jednoduše vybere několik skladeb. Výběr probíhá v několika krocích. Nejprve systém z rozsáhlého katalogu vytáhne kandidáty, potom je zúží předběžné řazení a nakonec další model rozhodne, co se zobrazí nebo přehraje jako první.

Yandex dosavadní postup označuje jako produkční kaskádu. Tvořilo ji více než 15 generátorů kandidátů, model pro pre-ranking a finální ranking. Jednotlivé části pracovaly s rozsáhlou sadou ručně navržených příznaků. Mohlo jít například o historii poslechu, čas od posledního přehrání nebo vztah mezi uživatelem a konkrétní skladbou.

Sona tyto kroky spojuje. Podle technické zprávy publikované na arXivu model zpracuje časovou posloupnost událostí uživatele a vytvoří společnou reprezentaci jeho chování. Z ní následně vychází jak generování kandidátů, tak jejich pořadí.

Pro běžného uživatele se tím nemění ovládání Yandex Music. Změna probíhá uvnitř služby. Posluchač dál dostává doporučení v rozhraní My Vibe, které je dostupné také na chytrých reproduktorech Yandexu.

Jak Sona pracuje

Architektura modelu má tři hlavní části. Enkodér nejprve zpracuje historii událostí uživatele. Nejde jen o seznam skladeb, které si pustil. Systém pracuje s chronologickými interakcemi, tedy s tím, co uživatel poslouchal, přeskočil nebo ohodnotil.

Na enkodér navazuje autoregresivní dekodér. Ten generuje kandidáty postupně pomocí takzvaných sémantických ID. Sémantické ID je naučené označení položky, které modelu pomáhá pracovat s významovými vztahy mezi skladbami. Nejde tedy pouze o náhodné katalogové číslo. Model se učí, které položky mají podobné vlastnosti nebo se objevují v podobných posluchačských situacích.

Třetí částí je ranking modul. Ten vygenerované kandidáty seřadí podle očekávané relevance pro konkrétního uživatele. Důležitá je společná reprezentace uživatele. Sona nemusí jeho historii zpracovávat znovu v každé oddělené fázi, protože enkodér poskytuje stejný stav dekodéru i ranking modulu.

Model se podle autorů učí přímo z logovaných událostí a naučených reprezentací položek. Nepotřebuje ručně vytvořené příznaky. To zjednodušuje datové potrubí, i když samotný trénink a provoz takového systému zůstávají technicky náročné.

Výsledky z provozu Yandex Music

Nejdůležitější výsledky nepocházejí z laboratorního benchmarku. Yandex Sona testoval na živém provozu služby Yandex Music, konkrétně na ploše My Vibe pro chytré reproduktory. Test trval sedm dní a měl podobu online A/B experimentu.

Ve srovnání s dosavadním produkčním systémem vzrostl počet aktivních uživatelů o 4,53 procenta. Jde o primární metriku experimentu. Celkový čas poslechu doporučených skladeb se zvýšil o 6,30 procenta a počet udělených lajků o 11,42 procenta.

Yandex uvádí, že nárůst aktivních uživatelů byl 2,35krát vyšší než přírůstek, který na stejné ploše dříve přinesl model Argus. To je srovnání s předchozím produkčním systémem Yandexu, nikoli s veřejnými jazykovými modely jako GPT, Gemini nebo Claude.

U Sona proto nedává smysl hledat výsledky z testů GPQA Diamond, SWE-bench Verified nebo Humanity's Last Exam. Tyto benchmarky měří schopnosti jazykových modelů při řešení odborných, programovacích nebo znalostních úloh. Sona je doporučovací systém pro hudební katalog. Její výkon se posuzuje podle chování posluchačů v provozu.

Od výzkumu k nasazení

Technická zpráva o modelu Sona vyšla v srpnu 2026. Autoři v ní popsali architekturu i online A/B test, ve kterém jediný model nahradil celou doporučovací kaskádu. Na začátku října Yandex podle zveřejněných informací oznámil nasazení Sona v živém provozu Yandex Music.

Vývoj navazuje na předchozí práci týmu Yandexu. Studie Gryphon-v2 popsala podobný směr, ve kterém jeden systém spojuje generování kandidátů a jejich řazení. V online experimentu tehdy došlo k nárůstu počtu aktivních uživatelů o 1,41 procenta při latenci srovnatelné s původní kaskádou.

Sona jde podle zveřejněných výsledků dál. Spojuje generování a ranking kolem jedné uživatelské reprezentace a v nasazené konfiguraci ponechává větší učitelský ranker pouze ve fázi tréninku. Do obsluhy uživatele se tento učitel nepřidává, takže produkční systém tvoří enkodér, dekodér a ranking modul.

Co novinka znamená pro české uživatele

Sona není samostatná aplikace ani model, který by si mohl stáhnout český vývojář. Jde o interní doporučovací technologii používanou v Yandex Music. Zdrojové materiály neuvádějí českou lokalizaci, dostupnost v Česku ani samostatnou cenu API.

Samotná služba Yandex Music navíc není v každém regionu dostupná. Její web v aktuálně kontrolované lokalizaci uvádí omezení dostupnosti podle regionu. Yandex Music proto nelze automaticky považovat za službu dostupnou českým uživatelům za stejných podmínek jako Spotify nebo YouTube Music.

Pro firmy, které provozují obsahové platformy, je zajímavá hlavně architektura. Doporučování se může přesouvat od mnoha specializovaných modelů k jednomu společně trénovanému systému. To však neznamená, že jeden model bude automaticky vhodnější pro každý katalog. Výsledky Sona se týkají konkrétní služby, konkrétního rozhraní a konkrétního sedmidenního experimentu.

Yandex zároveň uvádí, že doporučovací systémy používají data o chování uživatelů. Podrobnosti o správě těchto dat popisuje ve svých pravidlech pro doporučovací technologie. U podobných systémů proto zůstává důležitá nejen přesnost výběru, ale také práce s historií poslechu a možnost uživatele ovlivnit, jaká data služba využívá.

Omezení výsledků

Výsledky Sona jsou silné, ale jejich rozsah je přesně vymezený. Test proběhl na jedné doporučovací ploše Yandex Music, na chytrých reproduktorech a po dobu sedmi dní. Z čísel proto nelze vyvozovat, že stejný model dosáhne totožného zlepšení v jiné hudební službě, u videa nebo v internetovém obchodě.

Také není k dispozici veřejný ceník, který by umožnil porovnat provozní náklady Sona s cenou jiných doporučovacích systémů. Yandex zveřejnil hlavně architekturu a výsledky nasazení. Konkrétní rozpočet na trénink, infrastrukturu ani latenci Sona v dostupných materiálech uveden není.

Jisté je to, že generativní doporučování se v tomto případě neposuzovalo podle marketingového popisu modelu, ale podle chování skutečných posluchačů. Sona v testu nahradila kaskádu s více než 15 generátory a dosáhla uvedených zlepšení na ploše My Vibe v Yandex Music.

FAQ

Je Sona dostupná ke stažení nebo přes veřejné API?

Ne. Sona je interní doporučovací model nasazený v Yandex Music. Ve zveřejněných materiálech není uvedena veřejná verze ke stažení, API ani samostatný ceník.

Nahrazuje Sona jazykové modely jako GPT, Gemini nebo Claude?

Ne. Sona řeší doporučování položek z katalogu Yandex Music. Není určena pro chat, psaní textu, programování ani obecné uvažování. Její výsledky se proto porovnávají s předchozími doporučovacími modely, například s Argusem.

Proběhl test Sona také v Česku?

Dostupné informace uvádějí test na živém provozu Yandex Music v rozhraní My Vibe na chytrých reproduktorech. Český trh ani českou lokalizaci výsledky konkrétně neuvádějí.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.