Národní úložiště šedé literatury Nalezeno 1 záznamů.  Hledání trvalo 0.01 vteřin. 

Normalisation of data in fulltext system
Kapusta, Matúš ; Knap, Tomáš (oponent) ; Lánský, Jan (vedoucí práce)
Cieľom tejto práce je návrh a implementácia programu v jazyku Java pre spracovanie dát fulltextového systému do výslednej podoby dobre formovaného XML podľa špecifikácie XML 1.0. Vstupné dáta sú vo forme ľubovolného zle formovaného XML súboru ako napríklad HTML dáta. Dôležitými kritériami pri úpravách vstupných dát sú zachovať vernosť štruktúre a obsahu vstupného súboru v čo najvyššej miere. Program kontroluje správnosť menných priestorov a umožňuje nahradenie špeciálnych HTML entít skutočnými Unicode znakmi. Výstupný súbor musí byť možné spracovať použitím štandardných parserov. Sekundárnym cieľom je preskúmať a implementovať vhodnú metódu pre identifikáciu jazyka textového obsahu výsledného XML dokumentu ako celku, obsahu jednotlivých elementov alebo jednoduchého textového súboru.

Chcete být upozorněni, pokud se objeví nové záznamy odpovídající tomuto dotazu?
Přihlásit se k odběru RSS.