Přejít k hlavnímu obsahu

USA obviňují čínský Moonshot AI z „krádeže“ know-how Anthropicu: Zneužili destilaci i čipy v Thajsku

Ilustrační obrázek pro jarvis-ai.cz
Spojené státy americké vznášejí závažná obvinění vůči přední čínské společnosti Moonshot AI. Podle nejnovějších zjištění vytvořil tento asijský startup specializovanou interní platformu, jejímž prostřednictvím masivně prováděl tzv. destilaci AI modelů americké firmy Anthropic. K vývoji svého nového modelu K3 navíc Moonshot AI údajně využíval nejmodernější servery vybavené akcelerátory NVIDIA GB300 umístěné v Thajsku, čímž vědomě obcházel americká vývozní omezení.

Co je to „destilace“ AI a proč vyvolává mezinárodní skandál?

V oblasti strojového učení představuje destilace znalostí (knowledge distillation) techniku, při níž se menší a efektivnější model („žák“) učí napodobovat chování, uvažování a výstupy podstatně většího a pokročilejšího modelu („učitele“). V tomto konkrétním případě měl čínský startup Moonshot AI využít pokročilý model Fable od americké společnosti Anthropic k výcviku své vlastní vlajkové lodi označované jako K3.

Vývoj špičkových základních (foundation) modelů stojí stovky milionů dolarů a vyžaduje obrovské množství výpočetního výkonu a dat. Destilací však vývojáři mohou tyto náklady zkrátit až o 90 %. Místo nákladného sběru a čištění dat stačí pokládat miliony otázek již hotovému americkému modelu a na jeho odpovědích natrénovat vlastní systém. Americké technologické firmy i vláda USA tento postup označují za nekalou soutěž a systematickou krádež duševního vlastnictví.

Sofistikovaná infrastruktura a obcházení obran Anthropicu

Získat tak obrovský objem dat z uzavřeného rozhraní API bez povšimnutí je extrémně náročné, protože vývojáři jako Anthropic nebo OpenAI nasazují pokročilé algoritmy pro detekci neobvyklého provozu a masivního stahování. Moonshot AI však podle obvinění vyvinul interní platformu, která dokázala tyto bezpečnostní prvky obcházet.

Systém automatizovaně střídal přístupové metody, rotoval tisíce IP adres, měnil digitální otisky (fingerprints) a zneužíval různé zprostředkovatelské účty. Díky tomu dokázal provádět destilaci v masivním měřítku bez toho, aby automatizované systémy Anthropicu útok včas detekovaly a zablokovaly.

Hardware v šedé zóně: Akcelerátory NVIDIA GB300 v Thajsku

Případ má však ještě druhý, technologicky i geopoliticky závažný rozměr. Vyšetřovatelé uvádějí, že Moonshot AI pro trénování svého modelu K3 získal přístup k výkonným serverům osazeným akcelerátory NVIDIA GB300 (architektura Blackwell Ultra). Vzhledem k tomu, že přímý vývoz těchto čipů do Číny podléhá přísným sankcím ministerstva obchodu USA, využil startup infrastrukturu umístěnou v Thajsku.

Tento postup ukazuje na sílící trend tzv. „cloudové turistiky“ či stínových datových center v jihovýchodní Asii. Čínské subjekty sice nemohou pokročilý hardware fyzicky dovézt na své území, bez větších problémů si však pronajímají výpočetní kapacitu v sousedních zemích, kde americká omezení dosud neplatí v plné síle.

Kdo je Moonshot AI a jak si stojí model K3?

Společnost Moonshot AI patří mezi takzvané „čínské AI tygry“. Jde o štědře financovaný startup, do kterého masivně investoval mimo jiné technologický gigant Alibaba. Firma proslula svými modely řady Kimi, které vynikají schopností zpracovávat extrémně dlouhé textové kontexty.

Model Moonshot K3 představuje jejich nejnovější generaci a v čínských i mezinárodních benchmarku dosahuje pozoruhodných výsledků:

  • MMLU-Pro (všeobecné znalosti a uvažování): 84,2 % (srovnatelné s Claude 3.5 Sonnet a GPT-4o)
  • MATH (pokročilá matematika): 71,5 %
  • HumanEval (kódování v Pythonu): 88,9 %

Ačkoli jsou tyto výsledky impozantní, aktuální odhalení vrhá na úspěch čínských inženýrů stín. Ukazuje se totiž, že vysoký výkon není ani tak výsledkem vlastní vědecké invence, jako skvěle zvládnutého reverzního inženýrství amerických modelů.

Ovšem je tomu skutečně tak?

Na druhou stranu je obvinění překvapující. Pokud se zamyslíme nad tím, jak takový trenink funguje, trvá určitou dobu a ne nejsou to hodiny, ale spíše dny až týdny, kdy se AI trénuje. Fable 5 však je "venku" velmi krátce a prakticky většinu času byl uzavřen pro veřejnost. Natož pro čínské uživatele. 

Je tedy otázkou do jaké míry a zda vůbec k destilaci skutečně došlo a zda ze strany amerických představitelů nejde spíš o pokus zakrýt skutečnost, že čínské modely rychle dohání vlak. Tak jako tak - aktuální souboj mezi USA a Čínou v oblasti umělé inteligence skutečně graduje. A zdá se, že Čína dotahuje svého západního soka velmi slušně. Co nevidět by se měli objevit modely GLM 5.5, nový model společnosti DeepSeek a také QWEN 3.8. U všech se mluví jako o modelech, které by měli být na úrovni Fable 5 nebo dokonce jej překonat. Uvidíme.

FAQ

Je destilace AI modelů podle mezinárodního práva nelegální?

Právní status destilace je složitý. Z hlediska smluvních podmínek (Terms of Service) poskytovatelů jako Anthropic nebo OpenAI jde o přímé porušení smlouvy. Z pohledu autorského práva probíhají v USA i Evropě soudní spory, nicméně obcházení technických zábran a masivní neautorizovaný sběr dat je v mnoha jurisdikcích klasifikován jako neoprávněný zásah do počítačového systému.

Jak mohou vývojáři poznat, že jejich model někdo tajně destiluje?

Používají se pokročilé statistické metody, tzv. „vodoznaky“ (watermarking) v generovaném textu a analýza vzorců dotazování. Pokud klient generuje miliony specificky strukturovaných dotazů pokryvajících široké spektrum znalostí bez lidské interakce, jde o jasný signál destilace.

Mohou americké sankce zabránit čínským firmám ve využívání cloudu v Thajsku?

USA postupně zpřísňují sekundární sankce. Ministerstvo obchodu plánuje rozšířit vývozní kontroly tak, aby se vztahovaly i na poskytování cloudových služeb s využitím pokročilých AI čipů (jako řada NVIDIA GB300) subjektům ze sankcionovaných zemí, bez ohledu na to, kde se server fyzicky nachází.

X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.