Přejít k hlavnímu obsahu

Návod pro AI agenta zkrátil vývoj aplikace o třetinu a ušetřil skoro polovinu nákladů

Ilustrační obrázek
Když dáte šikovnému asistentovi volné ruce, výsledek závisí hlavně na tom, jak dobře mu zadáte práci. NVIDIA to teď ukázala na skutečném projektu: nechala AI agenta postavit aplikaci, která v reálném čase rozpoznává chirurgické nástroje v endoskopickém videu. Klíčový rozdíl nedělal výkon samotného modelu, ale to, jestli agent dostal srozumitelný „návod". S ním trvala první verze 40 minut, bez něj se práce natáhla na 65 minut a spotřeba se vyšplhala z 11 na 20 milionů tokenů.

AI, která umí programovat, ale potřebuje dobré zadání

Nejde o další zprávu o tom, jak je umělá inteligence chytřejší než lidé. Spíš naopak. Tým z NVIDIA vzal obecného programovacího asistenta (konkrétně Codex s modelem GPT-5.6 Sol) a pustil ho do práce na reálném úkolu — aplikaci pro NVIDIA Holoscan, platformu pro AI aplikace běžící v reálném čase na takzvané „hraně", tedy přímo u zařízení, ať už jde o medicínské zobrazování, nebo robotiku.

Pro představu: Holoscan je stavebnice pro vývojáře, kteří potřebují, aby AI zpracovávala obraz okamžitě, bez zdržení. Její doprovodné úložiště HoloHub je sbírka vzorových aplikací, z nichž se dá vycházet. Tým chtěl zjistit jednoduchou věc: zvládne běžný AI agent postavit novou aplikaci jen z té dokumentace, příkladů a nástrojů, které by měl k dispozici každý inženýr?

Jak vypadala spolupráce člověka a agenta

Nepočítalo se s tím, že by agent pracoval sám od sebe. Vývoj probíhal v kolečkách, která se pořád opakují, a právě to je na celém experimentu nejzajímavější:

  • Inženýr definuje cíl a hranice, co smí a nesmí agent měnit.
  • Agent si prostuduje podobné příklady, napíše kód a spustí ho přes jednotné příkazové rozhraní Holoscan CLI.
  • Inženýr si výsledek zkontroluje — kód, výstup, testy — a zadá další kolo.

Důležité je, že člověk a agent používají ty samé příkazy. Inženýr vidí přesně to, co viděl agent, a může každý krok zopakovat. Místo aby agenta nahradil, posouvá se jeho role k tomu, že rozhoduje, co je ještě dobré a co už ne.

Čtyřicet, nebo pětašedesát minut? Rozhodl návod

Nejcennější částí celého článku je srovnání, kterému se odborně říká ablační studie. Tým totiž zopakoval stejný úkol třikrát, pokaždé s jinou výbavou, kterou agent dostal:

  • CLI + dovednosti + dokumentace: první verze za 40 minut, spotřeba 11 milionů tokenů, výsledek bez nutnosti přepracování.
  • CLI + dokumentace (bez dovedností): 65 minut a 20 milionů tokenů. Agent výsledku dosáhl, ale zbytečně „ťapal" — zkoušel věci metodou pokus–omyl, instaloval závislosti tam, kde neměl.
  • Jen dokumentace: 40 minut a 15 milionů tokenů, ale horší kvalita. Aplikace sice vznikla, jenže agent obešel hotové optimalizované komponenty, takže běžela 2,6krát pomaleji než verze z prvního scénáře.

Čísla mluví jasně. Když agent dostal takzvané dovednosti (anglicky „skills") — tedy sadu návodů, které mu krok za krokem říkají, jak se v projektu pohybovat a co zkontrolovat — ušetřil 25 minut a 9 milionů tokenů. To je zhruba o třetinu kratší čas a téměř o polovinu nižší spotřeba.

Co z toho plyne pro běžnou práci s AI

Tahle lekce přesahuje svět medicínského softwaru. I když s Holoscanem nikdy nepřijdete do styku, princip platí obecně: kvalita zadání určuje kvalitu výsledku. AI model není „hloupý", ale bez jasných instrukcí a kontextu ztrácí čas hledáním cesty, kterou by mu zkušený kolega ukázal za minutu.

Prakticky to znamená, že se vyplatí investovat do toho, co AI „nakrmíte". Místo jednoho dlouhého příkazu „udělej to celé" se osvědčilo rozkrájet práci na menší, ověřitelné kroky. Každý krok pak někdo zkontroluje, než se pokračuje. Pro grafika, copywritera nebo drobného podnikatele to v praxi znamená to samé: konkrétní zadání s příklady a jasně řečenými hranicemi přinese lepší výstup než vágní požadavek.

Zkušenost z praxe: Proč AI nenahradí specialistu, ale znásobí jeho schopnosti

Závěry inženýrů z NVIDIA plně potvrzují i naše dlouhodobé praktické zkušenosti z vývoje. V redakci i technické praxi denně sledujeme, že umělá inteligence dosahuje dramaticky lepších výsledků právě tehdy, když za klávesnicí sedí člověk, který danému oboru do hloubky rozumí. To je také hlavní důvod, proč kvalitní odborníci kvůli AI o práci nepřijdou — naopak se stávají ještě žádanějšími.

Je propastný rozdíl v tom, zda webovou stránku nebo aplikaci pomocí AI staví naprostý laik, nebo zkušený vývojář:

  • Neznalý uživatel často zadá pouze povrchní prompt typu: „Chci hezký web s těmito barvami, mým logem a textem, který přitáhne zákazníky." AI sice vygeneruje vizuálně funkční šablonu, pod kapotou se však skrývá křehký, neefektivní kód plný chyb, bezpečnostních děr a zbytečného balastu. Na první pohled to laik nemusí poznat, v reálném provozu však web rychle narazí.
  • Zkušený odborník přesně ví, na co se ptát a co od modelu vyžadovat. AI pro něj funguje jako bleskový asistent, kterého ale vede pevnou rukou. Specialista zajistí, že výsledný web je bezpečný, skutečně funkční, snadno udržovatelný, připravený na budoucí škálování a technicky precizně optimalizovaný pro vyhledávače (SEO) i výkonnostní metriky.

AI sama o sobě know-how nenahradí. Dokáže neuvěřitelně zrychlit psaní kódu, rutinní refaktoring a tvorbu boilerplate komponent, ale strategická rozhodnutí o architektuře, bezpečnosti a smysluplnosti celého řešení musí vždy držet v rukou člověk s reálnými zkušenostmi.

Proč na tom záleží zrovna v Evropě

Volba příkladu není náhodná. Aplikace pro rozpoznávání nástrojů při endoskopii míří do zdravotnictví, a to je v Evropě silně regulované odvětví. Zdravotnické prostředky tu podléhají nařízení MDR (Medical Device Regulation), které po výrobcích vyžaduje mimo jiné dohledatelnost a opakovatelnost výsledků.

Zajímavé je, že popsaný postup s tím ladí. Agent po dokončení uložil nejen kód, ale i záznamy o výkonu, číslo verze kódu a verze všech závislostí — tedy přesně to, co chtějí auditoři a regulační orgány vidět. Schopnost doložit, kdy a proč se něco změnilo, není v tomto oboru kosmetická, ale povinná. Pro české a evropské firmy, které vyvíjejí medicínské nebo robotické systémy, tak může mít kombinace „člověk řídí + agent provádí + vše je zaznamenané" reálnou hodnotu.

Co se vlastně podařilo postavit

Výsledkem tří kol byla aplikace, která v endoskopickém videu v reálném čase zvýrazňuje chirurgický nástroj a k tomu zobrazuje užitečné statistiky. Po optimalizaci stoupla rychlost zpracování z 204 na 307 snímků za sekundu (o 50,5 procenta) a průměrné zpoždění kleslo z 4,89 na 3,25 milisekundy (o třetinu). Čísla nejsou to hlavní, ale dobře ukazují, že poslední kolo — zrychlení — by bez předchozího měření ani nešlo smysluplně provést.

Pro běžného čtenáře z toho plyne jedno praktické doporučení: pokud dnes AI používáte jen „na jedno kliknutí" a divíte se průměrným výsledkům, zkuste jí dát lepší kontext. A pokud vyvíjíte software, stojí za to naučit AI, ať dělá přesně to, co byste naučili i nového kolegu — krok po kroku a s kontrolou.

Je NVIDIA Holoscan něco, co si může vyzkoušet i běžný uživatel?

Ne tak docela. Holoscan i úložiště HoloHub jsou volně dostupné nástroje, ale míří na vývojáře, kteří staví AI aplikace běžící v reálném čase, a předpokládají znalost programování v Pythonu či C++. Bez technického základu si je jen tak „nevyzkoušíte", na rozdíl od běžných chatovacích asistentů.

Co přesně jsou ty „dovednosti" (skills), které agentovi tolik pomohly?

Jsou to textové návody, které agentovi popisují osvědčený postup práce v projektu — jak aplikaci založit, sestavit, spustit a odladit. Fungují podobně jako manuál pro nového zaměstnance. Právě ony dělají rozdíl mezi tím, když agent ví, kam se podívat, a tím, když slepě zkouší, co funguje.

Znamená to, že AI agenti nahradí vývojáře a webdesignery?

Z popsaného experimentu i praxe vyplývá pravý opak. Nejlepší a nejbezpečnější výsledky vznikají tehdy, když odborník přesně ví, co po AI požadovat, definuje bezpečnostní i architektonické standardy a výstupy pečlivě kontroluje. AI urychlí rutinu, ale expertizu nenahradí.

X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.