Automatic punctuation annotation in czech broadcast news speech

Jáchym Kolář, Ján Švec, Josef Psutka · Digital Library (University of West Bohemia) · 2004

Tento článek se zabývá našimi počátečními experimenty s automatickou anotací interpunkce v mluvené češtině. Použili jsme 2 statistické modely - prozodický a jazykový. Byly otestovány 2 implementace prozodického modelu - CART a MLP. Pro jazykové modelováni byl použit N-gramový model se skrytými událostmi. Kombinovaný model dosáhl na referenčních přepisech přesnosti 95.2% a F-measure 78.2%.

Read the paper · More papers on PaperTik