Basic architecture, methods and algorithms of system for temporal information extraction from natural language texts

Юрий Петрович Сердюк · Program systems theory and applications · 2015

Ю. П. Сердюк Базовая архитектура, методы и алгоритмы системы извлечения темпоральной информации из текстов на естественном языке Аннотация.В данной статье представляется базовая архитектура системы извлечения темпоральной информации из текстов на естественном языке.Определяются основные структурные компоненты такой архитектуры, а также методы и алгоритмы, которые в них реализуются.В частности, выделяется этап извлечения информации о темпоральных элементах -событиях и темпоральных ссылках в тексте.Подчеркивается необходимость использования синтаксических зависимостей между словами обрабатываемого предложения, а также семантических ролей групп слов для установления отношений порядка между темпоральными элементами, извлеченными из текста.Отдельной важной компонентой предлагаемой архитектуры является модуль логического вывода, использующего статистическую информацию.Соответственно, показывается необходимость использования методов машинного обучения и различных корпусов лингвистических данных (аналогичных WordNet, SemCor, TimeBank и др.) для успешного решения общей задачи.Ключевые слова и фразы: Извлечение информации

Read the paper · More papers on PaperTik