Analysis of Knowledge in Sentences
Aleš Horák · 2008
Prace popisuje implementaci efektivniho syntaktickeho analyzatoru ceských vět, který je založen na pravděpodobnostni analýze typu head-corner chart parsing (tabulkový analyzator s řidicim prvkem) s přidanými kontextovými akcemi a testy pro zajistěni gramaticke shody a generovani výstupu ve tvaru stromu zavislosti. Velice důležitou casti analyzatoru je gramatika ceskeho jazyka s vice než 90% pokrytim spravných vět z korpusu. V teoretických kapitolach představime nejcastěji použivane gramaticke formalismy a techniky syntakticke analýzy. Analýza syntaxe zde slouži jako rozhrani v přirozenem jazyce pro Algoritmus normalni translace (NTA), jenž poskytuje prostředek pro překlad vět na konstrukce transparentni intenzionalni logiky (TIL), ktere representuji význam vět. TIL je temporalni logika vyssiho řadu s hierarchii typů s konstrukcemi ve tvaru formuli lambda-kalkulu. V ramci prace implementujeme NTA pro vybranou podmnožinu ceských vět. Výstup NTA může být nasledně předan inferencnimu stroji (TIM), který představuje vyvozovaci mechanismus pro dedukci nových faktů ze zadaných vstupnich konstrukci. V praci popisujeme strukturu baze znalosti, jak je uložena v TIMu, ve srovnani s jinými teoriemi reprezentace znalosti.