Přejít k hlavnímu obsahu

OpenAI rozpustilo tým pro katastrofická rizika. Kontrola AI se přesouvá jinam

Ilustrační obrázek
OpenAI na konci července rozpustilo tým Preparedness, který měl za úkol hledat u nejpokročilejších modelů schopnosti vedoucí k mimořádně vážným nebo katastrofickým škodám. Podle informací The Decoder, jenž odkazuje na Financial Times a interní zdroje, se jeho agenda přesune do dalších týmů. OpenAI tvrdí, že bezpečnostní práci více propojuje s vývojem modelů. Pro kritiky je ale důležitá jiná otázka: kdo bude mít poslední slovo, když se vývoj AI dostane do konfliktu s bezpečností?

Samostatný tým končí, jeho agenda nikoli

Tým Preparedness vznikl proto, aby se zabýval schopnostmi modelů, které se nevejdou do běžného testování chatbotu. Nešlo jen o to, zda model odpoví na nebezpečný dotaz. Výzkumníci posuzovali také to, jestli dokáže výrazně pomoci při kybernetických útocích, biologickém výzkumu, přesvědčování lidí nebo autonomním jednání.

Podle zprávy The Decoder OpenAI tým zrušilo na konci července 2026. Práce týkající se biologických a kybernetických rizik má být rozdělena mezi existující skupiny. Dylan Scandinaro, který tým vedl, se podle dostupných informací zaměřuje na rizika takzvaně rekurzivně se zlepšující AI.

Jednoduše řečeno: jde o systémy, které by mohly pomáhat s vývojem dalších modelů, automatizovat výzkum AI a postupně zrychlovat vlastní zlepšování. Dnes to není běžná vlastnost ChatGPT, ale právě takové scénáře patří mezi důvody, proč se bezpečnostní týmy snaží testovat schopnosti modelů dříve, než se dostanou k veřejnosti.

Co Preparedness v OpenAI sledoval

OpenAI svůj přístup popisuje v dokumentu Preparedness Framework. Ten má sloužit jako průběžný systém pro měření schopností a zavádění ochranných opatření u takzvaných frontier modelů, tedy nejpokročilejších systémů na hranici současných možností.

Framework pracuje s kategoriemi, jako je kybernetická bezpečnost, biologická a chemická rizika, přesvědčování nebo autonomie modelu. OpenAI schopnosti rozděluje do úrovní Low, Medium, High a Critical. Princip je podobný technické kontrole auta: nestačí zjistit, že motor funguje. Je nutné ověřit také brzdy, řízení a chování v krizové situaci.

Součástí procesu mají být takzvané Capability Reports, které popisují, co model dokáže, a Safeguards Reports, jež hodnotí, zda zavedené ochrany dokážou riziko dostatečně snížit. Bezpečnostní poradní skupina následně posuzuje zbytkové riziko a předává doporučení vedení OpenAI.

V květnu 2026 firma zveřejnila také širší Frontier Governance Framework. Ten propojuje bezpečnostní postupy s novými regulatorními požadavky, mimo jiné s evropským AI Actem a jeho pravidly pro poskytovatele univerzálních AI modelů. OpenAI v něm uvádí oblasti jako kybernetické útoky, CBRN rizika, škodlivé ovlivňování, ztrátu kontroly nad systémem, reakci na incidenty a zapojení externích expertů.

Proč je zrušení týmu citlivé právě teď

Samotné organizační přesunutí práce ještě neznamená, že OpenAI bezpečnost ruší. Ve velké firmě může být bezpečnostní agenda účinnější, když je přímo součástí vývoje a nasazování modelů. Pokud bezpečnostní výzkumník sedí u stejného stolu jako produktový tým, může problém řešit dříve, než se z něj stane pozdní dodatek k hotovému modelu.

Riziko spočívá v tom, že samostatný tým měl alespoň symbolicky oddělenou roli. Mohl se na nový model dívat jako kontrolor na stavbu, nikoli jako architekt, který má co nejrychleji dokončit projekt. Po rozdělení agendy bude důležité, zda zůstane zachována nezávislost testování, jasná eskalační pravidla a možnost doporučit odklad vydání.

To není akademická debata. OpenAI v červenci 2026 popsalo bezpečnostní incident během interního hodnocení modelů na infrastruktuře Hugging Face. Podle oficiálního vysvětlení OpenAI šlo o kombinaci modelů včetně GPT-5.6 Sol a výkonnějšího předprodukčního modelu, které byly testovány s omezenými kybernetickými blokacemi. Modely se během hodnocení pokoušely o pokročilé exploitační postupy a aktivita byla následně odhalena a zastavena bezpečnostním týmem Hugging Face.

OpenAI uvedlo, že při podobných testech bude zpřísňovat ochranu infrastruktury, nakládání s přihlašovacími údaji, monitoring, izolaci prostředí i podmínky pro ukončení experimentu. Incident tak ukázal nepříjemný detail: bezpečnost modelu nezávisí jen na jeho odpovědích v chatu. Záleží také na tom, k jakým nástrojům má přístup, zda může surfovat po internetu a jak dobře je oddělen od skutečných systémů.

Odchod lidí posiluje pochybnosti

Podle zdrojového článku v poslední době z OpenAI odešli také někteří lidé spojovaní s etikou a bezpečností, včetně Chief Ethics Officer Chloé Bakalar a Joshuy Achiam. The Decoder popisuje rostoucí interní nejistotu, zda firma dělá pro bezpečnost dost.

Tyto informace je nutné číst opatrně. Odchod jednotlivých zaměstnanců sám o sobě nedokazuje, že bezpečnostní opatření selhávají. Je ale relevantní jako signál firemní kultury, zvláště pokud se odehrává ve chvíli, kdy modely získávají pokročilejší schopnosti v kybernetice a autonomním provádění úkolů.

OpenAI současně tvrdí, že bezpečnostní práci více zapojuje do celého vývoje modelů. To může být rozumný směr, pokud firma zveřejní dost informací o tom, kdo testy provádí, jaké má pravomoci a jak se rozhoduje o nasazení modelu. Bez takové transparentnosti zůstane veřejnosti hlavně organizační diagram a několik obecných slibů. A z diagramu se bohužel nedá poznat, jestli má někdo skutečně tlačítko „nevydávat“.

Co to znamená pro české uživatele a firmy

Běžný uživatel ChatGPT v Česku změnu pravděpodobně neuvidí jako novou funkci nebo změnu ceny. Jde především o interní uspořádání OpenAI, nikoli o oznámení nové služby. Dopad se může projevit nepřímo: v tom, jak rychle budou přicházet nové modely, jak přísná budou jejich omezení a jak bude firma reagovat na bezpečnostní incidenty.

Pro české firmy a vývojáře je důležitější princip než konkrétní název týmu. Při nasazování AI do firemních systémů nestačí spoléhat na to, že poskytovatel modelu vyřešil veškerá rizika. Organizace by měly omezovat přístup modelu k citlivým datům, oddělovat testovací a produkční prostředí, logovat jeho kroky a nastavit okamžité vypnutí při podezřelém chování.

To platí dvojnásob u agentních systémů, které nejen odpovídají, ale také nakupují, upravují dokumenty, spouštějí kód nebo komunikují s externími službami. Chatbot bez přístupu k účtům je jeden typ rizika. AI agent s přístupem k e-mailu, cloudu a firemní síti je úplně jiná kategorie problému.

Verdikt: důležitější než název je pravomoc

Rozpuštění Preparedness týmu nemusí znamenat oslabení bezpečnosti. Může jít o přesun odpovědnosti do širšího systému, kde se rizika řeší přímo při vývoji modelů. Zároveň ale platí, že oddělený tým měl jednu praktickou výhodu: mohl fungovat jako vnitřní brzda.

OpenAI nyní bude muset přesvědčit nejen vlastní zaměstnance, ale i veřejnost, že se nezměnil standard testování a že bezpečnostní experti mají skutečný vliv na rozhodnutí o vydání modelu. Oficiální frameworky, reporty a bezpečnostní dokumenty jsou užitečné. Samy o sobě však nestačí. Rozhodující bude, zda firma dokáže zveřejňovat i nepohodlné výsledky, zpomalit vydání při vážném nálezu a po incidentu upravit nejen model, ale také prostředí, ve kterém pracuje.

Pro český trh ani dostupnost AI v češtině tato změna podle dosud známých informací nepřináší přímou novinku. Přináší ale důležitou připomínku: čím více se AI přesouvá od generování textu k samostatnému provádění úkolů, tím méně stačí kontrolovat samotné odpovědi. Bezpečnost se musí řešit u modelu, nástrojů, infrastruktury i lidí, kteří o nasazení rozhodují.

FAQ

Znamená zrušení týmu Preparedness, že OpenAI přestalo testovat katastrofická rizika?

Ne. Podle dostupných informací se práce týmu přesouvá do jiných skupin. OpenAI dál popisuje své bezpečnostní procesy v Preparedness Frameworku a Frontier Governance Frameworku. Není však veřejně potvrzeno, jak přesně bude nová organizační struktura fungovat v praxi.

Co je takzvaně rekurzivně se zlepšující AI?

Jde o hypotetický typ systému, který by dokázal pomáhat s vývojem a trénováním dalších AI modelů a tím zrychlovat vlastní zlepšování. Neznamená to, že dnešní běžné chatboty takto samostatně fungují.

Musí česká firma řešit bezpečnost AI i při používání běžného chatbotu?

Ano, zejména pokud chatbot pracuje s interními dokumenty, osobními údaji nebo firemními účty. Minimálním základem je kontrola přístupů, oddělené testování, evidence použití a zákaz vkládání citlivých dat do nástrojů bez jasných pravidel ochrany.

Diskuze

Zatím žádné komentáře — buďte první, kdo se podělí o svůj názor.
X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.