Přejít k hlavnímu obsahu

Sony a Warner žalují Anthropic. Spor o texty písní může stát miliardy

Ilustrační obrázek
Sony Music Publishing a Warner Chappell Music zažalovaly Anthropic u federálního soudu v Severní Kalifornii. Tvrdí, že společnost nelegálně stahovala, scrapovala a používala desetitisíce autorsky chráněných hudebních děl, především textů písní, při trénování modelů Claude. Žaloba z 28. srpna 2026 míří také osobně na šéfa Anthropic Daria Amodeiho a spoluzakladatele Benjamina Manna.

Hudební vydavatelství v žalobě používají mimořádně ostrý slovník. Jednání Anthropic označují za „jeden z největších a nejbezošivějších pokračujících krádeží duševního vlastnictví v historii“. To je tvrzení žalobců, nikoli pravomocný závěr soudu. Anthropic obvinění odmítá a oznámila, že se bude aktivně bránit.

Jádro případu je ale důležitější než samotná dramatická formulace. Spor se netýká pouze toho, zda chatbot někdy vygeneroval část známého textu písně. Žalobci útočí hlavně na způsob, jakým měla Anthropic získávat trénovací data, a také na to, jak široce firma chápe pojem „trénování modelu“.

Žaloba míří na desítky tisíc skladeb

Podle zveřejněných informací o žalobě se případ týká především hudebních kompozic, textů písní, notových materiálů a odvozených děl. Mezi uváděnými skladbami jsou například „Eye of the Tiger“, „Hallelujah“ nebo „September“. Žalobci zmiňují také díla spojená s autory a interprety, jako jsou Taylor Swift a Mariah Carey.

Vydavatelství tvrdí, že Anthropic využívala pirátské databáze Library Genesis, známé jako LibGen, a Pirate Library Mirror, tedy PiLiMi. Tyto zdroje se v případu objevují už dříve, zejména ve sporu autorů knih proti Anthropic. Podle žalobců firma získávala obsah torrentováním, tedy stahováním souborů z distribuovaných sítí, kde data často neposkytuje jeden centrální server, ale více uživatelů najednou.

Žaloba má 48 stran a jmenuje Daria Amodeiho a Benjamina Manna jako individuální žalované. Dokument tvrdí, že Amodei měl některé postupy řídit, schvalovat nebo kontrolovat. O tom, zda za jednotlivé kroky skutečně nesou osobní právní odpovědnost, ale teprve rozhodne soud.

Proč nestačí říct, že data nebyla v komerčním modelu

Anthropic v minulosti odmítala, že by pirátské knihy z LibGen a PiLiMi přímo použila k trénování komerčních modelů Claude. Nová žaloba se pokouší tuto obranu obejít technickým argumentem: podle žalobců není rozhodující pouze to, zda se konkrétní soubor dostal přímo do finálního trénovacího běhu.

V dokumentu se údajně tvrdí, že nejméně jeden komerční model mohl být trénován na syntetických datech vytvořených nekomerčním modelem. Ten měl přitom být dříve natrénován na obsahu z pirátských zdrojů. Laicky řečeno: firma by netvrdila, že do modelu vložila konkrétní pirátskou knihu, ale že využila výstupy jiného modelu, který se k takovému obsahu dostal předtím.

Syntetická data fungují podobně jako poznámky studenta, který si přečetl cizí učebnice a následně z nich vytvořil vlastní shrnutí. To ale samo o sobě neřeší otázku původu znalostí. Pokud byly původní materiály získány nelegálně, může se spor přesunout od přímého kopírování k otázce, zda se takto vytvořená data nestala pouze prostředníkem.

Žaloba dále tvrdí, že Anthropic mohla takový model využít také k poskytování zpětné vazby komerčnímu modelu. Úplný rozsah těchto tvrzení se ukáže až v dokazování. V současné fázi je proto přesnější mluvit o obviněních a právní teorii žalobců než o prokázaném technickém postupu.

Navazuje na urovnání za 1,5 miliardy dolarů

Případ přichází po sporu Bartz v. Anthropic, který se týkal pirátských kopií knih. Anthropic se v roce 2025 dohodla na urovnání ve výši 1,5 miliardy dolarů. Podle dostupných informací se spor týkal přibližně sedmi milionů pirátsky stažených knih a částka vycházela z odškodnění přibližně 3 000 dolarů za zahrnutý knižní titul. Podrobnosti k urovnání shrnuje také dokument Association of American Publishers.

Právně důležitý rozdíl spočívá v tom, že problémem nebylo pouze samotné použití autorsky chráněných knih při vývoji AI. Velkou roli hrálo údajně nelegální získání dat torrentováním. Právě tento bod nyní hudební vydavatelství znovu staví do středu sporu.

Žalobci v nové věci požadují až 150 000 dolarů za každé porušené dílo. Dalších až 25 000 dolarů může připadat na jednotlivá porušení pravidel týkajících se odstranění informací o správě autorských práv, například copyrightových upozornění a identifikačních údajů. Pokud se potvrdí, že šlo o desetitisíce skladeb, může se teoretická výše nároků dostat do miliard dolarů. To však neznamená, že soud automaticky přizná maximální sazbu u každého díla.

Hudební průmysl už nechce řešit jen výstupy chatbotů

Žaloba se podle dostupných informací netýká jen pirátských knih. Vydavatelství tvrdí, že Anthropic získávala texty písní také ze služeb jako Musixmatch a LyricFind bez souhlasu držitelů práv a v rozporu s podmínkami těchto platforem. Zmíněny jsou rovněž datasety Books3, The Pile a Common Crawl, které mohou obsahovat neoprávněně zveřejněný obsah.

Další tvrzení se týká skenování a následného ničení použitých zpěvníků a sbírek not. Pokud se tato část prokáže, může mít pro spor význam odlišný od otázky běžného webového scrapování. Nejde totiž pouze o automatické zpracování veřejně dostupných stránek, ale o fyzické kopírování konkrétních publikací.

Hudební vydavatelství tím dávají najevo, že nechtějí řešit pouze případy, kdy chatbot vygeneruje známý text na přímý dotaz. Zajímají je celé dodavatelské řetězce trénovacích dat: odkud pocházejí, kdo je stáhl, jak byly zpracovány a zda se jejich obsah dostal do dalších modelů prostřednictvím syntetických dat nebo zpětné vazby.

Evropský kontext: text písně může být problém i uvnitř modelu

Významný evropský kontext přineslo rozhodnutí Zemského soudu v Mnichově z 11. listopadu 2025. Soud v případu GEMA proti OpenAI dospěl podle shrnutí Úřadu Evropské unie pro duševní vlastnictví k závěru, že zapamatování a reprodukce chráněných textů v jazykovém modelu mohou představovat porušení autorských práv.

Rozhodnutí se týkalo OpenAI, nikoli Anthropic, a nejde o automatický rozsudek v novém americkém sporu. Ukazuje ale, že evropské soudy mohou posuzovat jako relevantní nejen samotný výstup, ale také to, zda model chráněné dílo uchovává a dokáže ho na jednoduchý požadavek reprodukovat.

Pro české uživatele je podstatné, že Claude je podle podpory Anthropic dostupný také v České republice. Žaloba sama o sobě neoznámila žádné omezení služby pro český nebo evropský trh. Neřeší ani cenu předplatného či dostupnost jednotlivých modelů. Její význam je především právní: může ovlivnit, jak budou AI firmy v budoucnu dokumentovat původ dat a jak budou nakládat s obsahem, který používají při vývoji svých systémů.

Co bude rozhodovat

Nejdůležitější otázkou nebude jen to, zda Anthropic někdy pracovala s chráněným obsahem. To ostatně u moderních jazykových modelů není výjimečná otázka. Rozhodovat bude zejména jakým způsobem byl obsah získán, kdo nákup nebo stažení schválil, zda byl použit v trénování a zda se k němu komerční model dostal přímo, nebo přes mezistupeň.

Anthropic bude mít prostor zpochybnit skutková tvrzení, rozsah údajného porušení i právní výklad žalobců. Sony a Warner naopak potřebují doložit konkrétní díla, způsob jejich získání a vazbu na postupy Anthropic. Bez toho zůstane i velmi vysoký teoretický nárok pouze součtem maximálních sazeb na papíře.

Pro celý obor je ale signál jasný už nyní. Vývoj AI se stále více přesouvá od otázky „co model umí“ k otázce „z čeho vznikl“. Firmy, které staví komerční systémy na obrovských datových archivech, budou muset stále přesněji dokazovat původ materiálů. Jinak může být levné stažení dat na začátku vývoje výrazně dražší na konci. A tentokrát se účet neposílá v tokenech.

Může žaloba okamžitě změnit dostupnost Claude v Česku?

Ne. K 30. srpnu 2026 žaloba neoznámila žádné omezení Claude pro české uživatele. Případ se týká právní odpovědnosti Anthropic a údajného nakládání s trénovacími daty, nikoli okamžitého zákazu služby.

Znamená urovnání za 1,5 miliardy dolarů, že Anthropic už v tomto sporu prohrála?

Ne. Urovnání se týkalo předchozího sporu autorů knih a neznamená automatické přiznání odpovědnosti v nové žalobě hudebních vydavatelství. Sony a Warner musí svá tvrzení v aktuálním řízení teprve prokázat.

Je používání autorsky chráněných děl k trénování AI vždy nelegální?

Neexistuje jedna univerzální odpověď pro všechny země a situace. Rozhoduje mimo jiné způsob získání díla, účel použití, licence, místní autorské právo a to, zda model dokáže chráněný obsah reprodukovat. Nová žaloba se výrazně soustředí právě na údajné pirátské získání dat.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.