Bilingual Word and Chunk Alignment: A Hybrid System for Amharic and English

Saba Amsalu Teserra · PUB – Publications at Bielefeld University (Bielefeld University) · 2007

In dieser Arbeit werden effiziente Wort- und Wortteil-Alignmentalgorithmen von satzweise alignierten Parallelkorpora vorgestellt. Es werden hauptsächlich Verfahren der statistischen Übersetzungsmodellierung verwendet, die Termverteilungsmatrizen nutzen, um Korrelationen zwischen Termen zu identifizieren. Des Weiteren werden linguistische Regeln der Morphologie und Syntax genutzt, um die statistischen Methoden zu ergänzen. Es werden zwei Modelle entwickelt: Modell I ist ein Modell, das in einem Zieldokument die Übersetzung eines Ausgangswortes sucht, während Modell II die Worte eines Ausgangssatzes und die Worte des übersetzten Zielsatzes aligniert. Beide Modelle werden anhand von amharisch-englischen Parallelkorpora evaluiert. Außerdem wird Modell II mit der Implementierung des IBM Alignment-Modells (GIZA++) verglichen.

Read the paper · More papers on PaperTik