Coreference resolution for Italian: Assessing the impact of linguistic components

Olga Uryupina, Alessandro Moschitti · Pisa University Press eBooks · 2014

English. This paper presents a system-atic evaluation of linguistic components required to build a coreference resolution system: mention detection and mention description. We compare gold standard annotations against the output of the mod-ules based on the state-of-the-art NLP for Italian. Our experiments suggest the most promising direction for future work on coreference in Italian: we show that, while automatic mention description affects the performance only mildly, the mention de-tection module plays a crucial role for the end-to-end coreference performance. We also show that, while a considerable number of mentions in Italian are zero pronouns, their omission doesn’t affect a general-purpose coreference resolver, sug-gesting that more specialized algorithms are needed for this subtask. Italiano. Questo articolo presenta una valutazione sistematica delle componenti linguistiche necessarie per costruire un sistema di risoluzione delle coreference: selezione automatica delle menzioni ad entita ́ e la loro descrizione. A questo scopo si confrontano le annotazioni gold standard contro l’output dei moduli basati sul NLP, che sono lo stato dell’arte per l’italiano. Questi esperimenti sug-geriscono le direzione di ricerca piú promettenti per i futuri lavori su coref-erenza in italiano: infatti, si dimostra che, mentre la descrizione automatica delle menzioni influisce sulle prestazioni solo leggermente, il modulo di selezione delle menzioni svolge un ruolo fondamentale per la prestazione del risolutore di coref-erence (end-to-end). Si dimostra anche che, mentre un numero considerevole di menzioni in italiano sono zero-pronouns, la loro omissione non pregiudica il risul-tato di coreferenza. Questo suggerisce che algoritmi piu ́ specializzati sono necessari per questa sottoattivitá. 1

Read the paper · More papers on PaperTik