Přejít k hlavnímu obsahu

AI jako klíč k minulosti: Jak technologie dekódují zapomenuté jazyky a chrání světové památky

Ilustrační obrázek
Stojíme na prahu éry, kdy umělá inteligence přestává být pouze generátorem textů a stává se strážcem lidského dědictví. Zatímco ve Vietnamu vědci využívají pokročilé modely k dekódování komplexního písma Han Nom, francouzští odborníci nasazují počítačové vidění k ochraně památek před klimatickými změnami. Tato technologie nám umožňuje nejen porozumět minulosti, ale i aktivně ji chránit pro budoucnost.

Dlouhá staletí byla určita část lidského vědění skryta za nečitelnými znaky a fyzickým rozpadem materiálů. Dnes však díky pokrokům v oblasti velkých jazykových modelů (LLM) a počítačového vidění (Computer Vision) se tyto bariéry začínají hroutit. Aktuální výzkumy z Vietnamu a Francie ukazují, že AI se stává mostem mezi moderní vědou a tisíciletou historií.

Dekódování Han Nom: Když algoritmy čtou historii

Jedním z největších technologických úspěchů současnosti je práce na zpřístupnění písma Han Nom. Toto logografické písmo, používané po staletí ve Vietnamu, představuje pro běžné překladače i standardní AI modely obrovskou výzvu. Na rozdíl od moderních jazyků, kde mají modely k dispozici miliardy stran textu, je Han Nom považováno za tzv. low-resource language (jazyk s nízkým množstvím dostupných dat).

Projekt realizovaný na Přírodovědecké fakultě VNU-HCM využívá specializované techniky fine-tuningu (doladění). Namísto spoléhání se na obecné znalosti, jsou modely trénovány na specifických sadách historických dokumentů, což jim umožňuje rozpoznat nuance znaků, které by běžný model jako GPT-4o nebo Gemini 1.5 Pro bez specifického tréninku pravděpodobně zamítl nebo interpretoval chybně.

Srovnání: Obecné modely vs. Specializovaná AI

Pro lepší pochopení rozdílu je důležité porovnat schopnosti běžných nástrojů s těmito výzkumnými modely:

  • ChatGPT (GPT-4o): Exceluje v kontextu a moderních jazycích, ale při pokusu o hlubokou analýzu Han Nom bez externího kontextu často halucinuje nebo používá nejbližší podobné znaky z čínštiny.
  • Google Gemini: Nabízí vynikající multimodální schopnosti (analýza obrázků), což je skvělé pro základní OCR, ale postrádá hloubkovou lingvistickou znalost historických dialektů.
  • Specializované výzkumné modely: Jsou trénovány přímo na historických korpusech. Jejich přesnost v dekódování starých rukopisů je o desítky procent vyšší než u obecných modelů, i když nejsou dostupné pro širokou veřejnost jako placené předplatné (např. ChatGPT Plus za 20 USD/měsíc).

Ochrana památek: Předpovídání degradace pomocí dat

Zatímco ve Vietnamu jde o interpretaci textu, ve Francii se AI soustředí na fyzickou integritu monumentů. Pod vedením odborníků jako Ann Bourgèsová probíhají projekty, které využívají prediktivní analytiku k boji proti klimatickým změnám. Cílem je odpovědět na otázku: „Jak moc se trhlina v pískovci rozšíří za příštích 50 let?“

Tento přístup využívá algoritmy, které neustále analyzují vizuální data z detailních snímků památek. AI dokáže detekovat mikroskopické změny v textuře materiálu, které jsou pro lidské oko nepostřehnutelné. Tím umožní preventivní restaurování dříve, než dojde k nevratnému poškození, jako je například u Štrasburské katedrály.

Praktický dopad: Co to znamená pro nás?

Možná si říkáte, že Vietnam nebo Francie jsou daleko od českých hranic. Skutečnost je však taková, že technologie používané v těchto projektech mají přímý dopad i na naše prostředí:

  1. Digitalizace českých archivů: Podobné techniky pro dekódování Han Nom mohou být aplikovány na staročeštinu nebo středověké rukopisy v českých archivech. To by umožnilo automatizovanou analýzu historických dokumentů, což by bylo nesmírně přínosné pro historiky i výzkumníky v rámci EU.
  2. Ochrana evropského dědictví: Vzhledem k tomu, že Evropa čelí podobným klimatickým výzvám jako Francie, implementace těchto AI systémů do správy českých památek (např. pod Národní památkový ústav) by byla logickým krokem pro modernizaci ochrany našich hradů a kostelů.
  3. Regulace a etika: V rámci EU AI Act bude kladen velký důraz na to, jak jsou využívána kulturní data. Výzkumy v této oblasti nám pomáhají definovat standardy pro „etickou AI“, která chrání integritu historických dat a nepředělává historii podle aktuálních trendů.

Pro běžného uživatele to zatím znamená, že tyto nástroje nejsou přímo k dispozici v aplikacích jako je Canva nebo ChatGPT, ale jejich vývoj formuje budoucí schopnosti všech multimodálních modelů, které používáme denně. Schopnost „vidět“ a „číst“ složitější struktury se postupně stává standardem.

Mohu použít ChatGPT k překladu starých rukopisů?

Standardní verze ChatGPT může poskytnout základní odhad, ale pro historicky přesný překlad (jako je Han Nom nebo stará čeština) není vhodná. Je náchylná k halucinacím a chybám v interpretaci neobvyklých znaků. K tomu slouží výše zmíněné specializované modely.

Jsou tyto AI nástroje pro ochranu památek dostupné komerčním firmám?

V současné době jde primárně o akademické a státní projekty. Komerční využití v podobě softwaru pro správce nemovitostí nebo restaurátory se však očekává v blízké budoucnosti, zejména s nástupem pokročilého počítačového vidění.

Jaký je vztah mezi AI a ochranou soukromí při digitalizaci archivů?

Při práci s historickými datami v EU musí být dodržováno nařízení GDPR, i když se jedná o stará dokumenty. AI systémy musí být navrženy tak, aby při analýze textu neporušovaly integritu osobních údajů osob, které jsou stále chráněny zákonem.

X

Nezmeškejte novinky!

Přihlaste se k odběru novinek a aktualit.