Přejít k hlavnímu obsahu

Perplexity spustila lokální AI pro Windows. Vaše data neopustí disk

Ilustrační obrázek
Pokud jste dosud chtěli, aby vám autonomní AI agenti prohledávali firemní dokumenty, psali kód nebo plánovali úkoly, museli jste všechna citlivá data posílat do vzdálených cloudů. To se právě mění. Vyhledávací a agentní platforma Perplexity přináší svůj systém Portable Computer na operační systém Windows s akcelerací přes grafické karty NVIDIA RTX. Veškeré zpracování, uvažování agentů i spouštění kódu probíhá kompletně na vašem lokálním hardwaru.

Bezpečný přístav pro vaše data i firemní tajemství

Když společnost Perplexity koncem srpna uvedla architekturu Portable Computer na vývojářských stanicích NVIDIA DGX Spark, šlo o zajímavou ukázku toho, co dokáže speciální kompaktní hardware zařídit na operačním systému Linux. Nyní, k 15. září 2026, však přichází krok, který má zásadní dopad pro praxi: plná podpora pro operační systém Windows. Jak potvrzuje oficiální blog společnosti NVIDIA, celá agentní architektura se tím dostává na stoly běžných vývojářů, analytiků a náročných uživatelů.

Princip je v zásadě jednoduchý. Místo toho, aby se váš dotaz zabalil a odcestoval na servery v USA, kde by nad ním přemýšlely obří cloudové modely, proběhne celá agentní smyčka přímo v pískovišti (sandboxu) vaší grafické karty. Dřívější koncept čisté predikce následujícího tokenu byl v oboru už dávno nahrazen autonomními AI agenty, kteří sami plánují kroky, používají nástroje a opravují vlastní chyby. Dosud k tomu ale potřebovali masivní výpočetní výkon cloudu. Spojení Perplexity a akcelerace přes rozhraní NVIDIA TensorRT však umožňuje tento autonomní cyklus spustit lokálně bez toho, aby jediný bajt soukromých dat opustil váš počítač.

Jak Portable Computer na Windows funguje v praxi

Když v aplikaci Perplexity pro Windows zadáte složitější úkol — například analýzu rozsáhlého finančního výkazu nebo kontrolu zdrojového kódu — systém nesáhne hned po API. Využije lokálně spuštěné modely o velikosti 27 miliard parametrů, jako jsou Qwen 3.8 27B nebo PPLX 27B. Na cestě je navíc model NVIDIA Nemotron 3.5 Lightning s 30 miliardami parametrů. Tyto modely si stáhnete do počítače přímo v aplikaci na jedno kliknutí.

Agent si vytvoří lokální chráněné prostředí, ve kterém dokáže procházet vaše soubory, spouštět skripty v Pythonu a propojovat informace. K dispozici má konektory pro klíčové pracovní nástroje: Microsoft Outlook, OneDrive, Word, Google Drive, Gmail, Slack a GitHub. Současně verze pro Windows přináší dvě podstatné novinky: možnost plánovat opakované lokální úlohy (například pravidelnou ranní sumarizaci souborů ve složce) a plnou podporu pro lokální MCP servery (Model Context Protocol), což je dnešní standard pro bezpečné propojování AI modelů s externími datovými zdroji.

Pokud agent narazí na úlohu, která překračuje schopnosti lokálního 27B modelu, vyzve vás k potvrzení. Teprve po vašem výslovném souhlasu předá konkrétní podúlohu do cloudu špičkovým modelům typu GPT-6 Astra, Claude Fable 5.1 nebo Gemini 3.8 Flash. Bez vašeho kliknutí ale z počítače neododejde vůbec nic.

Hardware za branou: 24 GB VRAM jako nekompromisní síto

Tato technologická nezávislost však nemá nic společného s charitou a rozhodně neběží na jakémkoliv kancelářském notebooku. Aby aplikace mohla plynule udržet v paměti 27miliardový model společně s agentním pískovištěm a kontextem vašich dokumentů, vyžaduje nekompromisní hardwarový základ: grafickou kartu NVIDIA GeForce RTX nebo RTX PRO s minimálně 24 GB VRAM.

V praxi to znamená, že se neobejdete bez špičkových karet řady RTX 3090, RTX 4090 nebo profesionálních pracovních stanic. Pro uživatele, kteří takový hardware vlastní, přináší tento přístup zásadní ekonomickou výhodu: lokální zpracování má nulové tokenové poplatky ($0) a nespotřebovává žádné cloudové kredity z vašeho přídělu v rámci služby Perplexity Computer. Služba je přístupná všem uživatelům s předplatným Perplexity Pro nebo Perplexity Max.

Pro srovnání: zatímco spouštění náročných dotazů přes cloudová API u špičkových reasoning modelů může při velkých objemech dat stát desítky dolarů denně, u lokálního běhu platíte výhradně elektřinu, kterou si vaše grafická karta vezme ze zásuvky. Rychlost odezvy je přitom u lokální RTX akcelerace blesková, protože odpadá veškerá latence sítě.

Co to znamená pro české vývojáře a firmy

Pro český a evropský trh je tento posun důležitější, než by se na první pohled mohl zdát. Evropské firmy dlouhodobě narážejí na přísná pravidla ochrany osobních údajů (GDPR) i požadavky legislativy EU AI Act. Mnoho advokátních kanceláří, finančních institucí nebo vývojářských domů v Česku mělo striktní zákaz vkládat interní dokumenty, zdrojové kódy či klientská data do cloudových AI rozhraní.

Možnost spustit autonomního agenta kompletně offline na vlastní pracovní stanici s kartou RTX tento problém elegantně řeší. Můžete nechat agenta prohledat tisíce stránek interních smluv v češtině, provázat je přes MCP konektory s lokálním úložištěm a připravit podklady bez rizika, že by vaše know-how sloužilo k trénování cizích modelů. Použitý model Qwen 3.8 navíc díky rozsáhlému vícejazyčnému tréninku zvládá češtinu na velmi dobré úrovni, což z lokálního Portable Computeru dělá mimořádně praktický nástroj pro každodenní nasazení v tuzemském firemním prostředí.

Jaké jsou minimální hardwarové požadavky pro spuštění Portable Computer na Windows?

Vyžadována je grafická karta NVIDIA GeForce RTX nebo RTX PRO s minimální kapacitou 24 GB VRAM (např. RTX 3090, RTX 4090 nebo stanice řady RTX PRO). Dále je nutná instalace oficiální aplikace Perplexity pro Windows a aktivní předplatné Perplexity Pro nebo Perplexity Max.

Platí se za lokální zpracování dotazů nějaké tokenové poplatky?

Ne. Veškeré úlohy zpracované lokálně na vaší grafické kartě mají $0 tokenové poplatky a neodečítají žádné kredity z vašeho cloudového účtu Perplexity Computer. Platíte pouze standardní měsíční předplatné Perplexity Pro/Max.

Může lokální agent odeslat moje data do cloudu bez mého vědomí?

Nemůže. Architektura je navržena s prioritou ochrany soukromí. Pokud lokální model vyhodnotí, že na daný úkol nestačí a potřebuje pomoc cloudového modelu, systém vyžaduje váš výslovný souhlas předtím, než jakákoliv data opustí vaše zařízení.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.