Černý čtvrtek pro generativní AI: Co přesně selhalo
Kolem 15:00 našeho času (13:00 UTC) začaly monitorovací služby a sociální sítě zaznamenávat strmý nárůst chybových hlášení. Uživatelé se nejprve nemohli dovolat modelů Claude od společnosti Anthropic. Během následující půlhodiny se lavina rozšířila na ChatGPT a vývojářskou platformu Codex od OpenAI, přičemž výpadky a degradaci výkonu potvrdili i uživatelé systému Grok provozovaného společností xAI.
Příznaky byly na straně koncových uživatelů pestré, ale nepříjemně konzistentní. Webová rozhraní chatbotů hlásila interní chyby serveru (HTTP 500 a 503), generování textu se zastavovalo uprostřed prvních vět nebo se systém tvářil, že odeslaná zpráva vůbec nedorazila. Řada vývojářů používajících API navíc zaznamenala nezvyklé chování, kdy rozhraní místo standardní JSON odpovědi vracelo poškozené datové proudy nebo nutilo prohlížeč stahovat prázdné binární soubory.
Oficiální status: OpenAI monitoruje opravu, Anthropic hlásí vyřešeno
Zatímco sociální sítě spekulovaly o masivním kybernetickém útoku nebo kolapsu centrálních datových center, oficiální stavové stránky poskytovatelů odkrývají postupný průběh nápravy:
OpenAI: Provozovatel ChatGPT potvrdil incident pod názvem vysoké chybovosti napříč službami (High error rates across ChatGPT and Codex). Podle oficiálních záznamů začalo šetření incidentu v 16:58 SELČ (14:58 UTC). V 17:22 SELČ společnost nasadila nápravná opatření (mitigation) a přešla do fáze monitorování obnovy. Postiženy byly zejména komponenty webového vyhledávání (Search), agentní funkce, Deep Research, nahrávání souborů a kódovací integrace Codex ve webu, desktopu i rozšíření pro VS Code. K 18:40 SELČ stavový systém stále eviduje částečnou degradaci služeb (Partial System Degradation), i když dostupnost pro většinu uživatelů postupně nabíhá.
Anthropic: Společnost Anthropic zaznamenala masivní vlnu chyb začínající již ve 15:26 SELČ (13:26 UTC). Postižena byla celá rodina pokročilých modelů včetně Claude Opus 5, Opus 4.8 a nově oznámených modelů řady Mythos a Fable 5.1. V 17:25 SELČ inženýři potvrdili, že se potíže podařilo lokalizovat a omezit pouze na největší reasoning modely Opus 4.8 a Opus 5. V 18:23 SELČ (16:23 UTC) Anthropic oficiálně označil incident za kompletně vyřešený a všechny systémy se vrátily do plného provozu.
xAI (Grok): Také uživatelé sítě X a platformy Grok naráželi na nedostupnost generování odpovědí. Podle zpráv agentury Bloomberg zástupci xAI potvrdili rozsáhlé narušení provozu, přičemž situace se stabilizovala až po restartu a odklonění zátěže na záložní kapacity.
Hledání viníka: Společná infrastruktura, nebo lavinový efekt?
Žádná z postižených společností dosud nepotvrdila přímou společnou příčinu. V technologické komunitě se však okamžitě rozběhla debata o tom, co mohlo způsobit takřka simultánní výpadek rivalů, kteří provozují vlastní modely a zdánlivě nezávislá datová centra.
V úvahu přichází několik technických scénářů, které v minulosti podobné krize již způsobily:
1. Kaskádový přesun zátěže (Failover Cascade): Když ve 15:26 SELČ vypadl Anthropic, statisíce programátorů a firemních uživatelů okamžitě přepnuly své automatizace a dotazy na ChatGPT a Codex. Tento náhlý náraz požadavků mohl během desítek minut přetížit inference servery OpenAI a vyvolat sekundární kolaps. Následný přesun k dalším alternativám (Grok) pak dominový efekt dokonal.
2. Skrytá závislost na cloudové vrstvě a CDN: Ačkoliv OpenAI staví na Microsoft Azure a Anthropic využívá primárně Amazon Web Services (AWS) a Google Cloud, celá řada podpůrných služeb sdílí stejnou páteřní infrastrukturu. Ať už jde o DNS směrování, CDN sítě jako Cloudflare, DDoS ochranu nebo tranzitní optické trasy mezi datacentry v severní Virginii, výpadek jediného síťového uzlu dokáže paralyzovat několik poskytovatelů současně.
3. Společné hardwarové a ovladačové závislosti: Všichni tři giganti využívají masivní GPU klastry Nvidia. Selhání v distribuovaných orchestrátorech nebo chybné synchronizace v softwarovém stacku pro obsluhu velkých modelů mohou v čase špičky způsobit lokální výpadky paměti a pády uzlů.
Fungují již ChatGPT a Claude v Česku normálně?
Ano, Anthropic ohlásil kompletní vyřešení incidentu v 18:23 SELČ a jeho modely Claude jsou plně funkční. OpenAI v 18:40 SELČ hlásí úspěšné nasazení nápravy a stav přechází do běžného provozu, i když některé pokročilé funkce (např. vyhledávání na webu nebo nahrávání souborů) mohou ještě krátkodobě vykazovat vyšší odezvy.
Byl výpadek způsobený hackerským útokem?
Žádná ze společností (OpenAI, Anthropic, xAI) hackerský ani DDoS útok nepotvrdila. Nejčastěji se hovoří o kombinaci problémů na páteřní síťové infrastruktuře a lavinovém efektu, kdy uživatelé po výpadku jedné služby přetížili servery konkurence.
Jak předejít ztrátě dat při náhlém výpadku AI?
Nepoužívejte chatovací okno jako primární úložiště. Důležité prompty a vygenerované texty si průběžně ukládejte do lokálních dokumentů a pro kritické firemní procesy implementujte API routery s podporou automatického přepnutí mezi různými poskytovateli (např. OpenAI, Anthropic a Google).