RESOLUCIÓN DE CORREFERENCIAS PARA LA CAPTURA DE EVENTOS
Lucía Cantamutto, Joseba K. Abaitua, David Buján, Jesús Luis Díaz Labrador, Josu Bermúdez · Revista de Lengua y Literatura (National University of Comahue) · 2015
El algoritmo Stanford Multi Sieve Pass (propuesto por Raghunathan et al. 2010) realiza secuencialmente una serie de pasos de reconocimiento que de manera incremental terminanproponiendo correferencias entre las entidades candidatas identificadas en el texto. En esteartículo, presentamos brevemente los trabajos de adaptación de este algoritmo y de otrasherramientas de análisis (p. e., OpeNER) a textos en español (Agerri et al. 2013; Bermúdez 2013). A fin de avanzar en el desarrollo de estas herramientas para el Procesamiento del Lenguaje Natural (PLN), aplicamos estas directrices manualmente sobre un corpus experimental extraído de Wikipedia, con los que se pueden configurar textos breves (como por ejemplo tuits u otro tipo de microcontenidos) con sentido pleno. Como resultado, se ofrece un ejemplo de análisis manual que será automatizado en etapas posteriores de la investigación.