TempoWordNet : a Lexical Knowledge-base for Temporal Information Retrievale

Mohammed Hasanuzzaman · 2016

La capacite a capturer l’information temporelle dans le langage naturel, qu’elle soit exprimee de maniere explicite, implicite, ou par connotation, est essentielle pour de nombreuses applications telles l’extraction d’information, les systemes de question-reponse, le resume automatique. Associer une orientation temporelle au sens des mots pour capter l’information temporelle en langue est une tâche relativement directe pour les humains utilisant leurs connaissances sur le monde. Une base de connaissances lexicales associant automatiquement cette orientation au sens des mots serait de fait cruciale pour les tâches automatiques visant a interpreter la temporalite dans les textes. Dans cette recherche, nous presentons une ontologie temporelle, TempoWordNet, ou les synsets de WordNet sont enrichis avec une information sur leur temporalite intrinseque : atemporel, passe, present et futur. Nous etudions et experimentons differentes strategies de construction, lexico-semantique, probabiliste et hybride. TempoWordNet est evalue de maniere intrinseque et extrinseque, une ressource fiable devant a la fois contenir un etiquetage temporel de haute qualite et ameliorer les performances de certaines tâches externes. Les deux types d’evaluations montrent la qualite et l’interet de la ressource. Pour completer nos travaux, nous etudions aussi comment une application de recherche telle un moteur de recherche peut tirer parti de cette ressource. Le retour des utilisateurs de TempoWordNet a encourage a ameliorer encore la ressource. Nous terminons donc en proposant une nouvelle strategie de construction permettant d’ameliorer de maniere consequente TempoWordNet.

Read the paper · More papers on PaperTik