An initial study on text summarisation in film stories
Yan Lei Xu, Michael Oakes · RUA, Repositorio Institucional de la Universidad de Alicante (Universidad de Alicante) · 2010
El objetivo de nuestra investigación es el de generar resúmenes de películas a partir de textos colaterales, capturando el contenido semántico, estructura narrativa y líneas clave de los diálogos de la película. Nuestra hipótesis es que se pueden generar de forma eficiente resúmenes en texto de películas mediante el empleo de técnicas de resumen automático sobre textos colaterales: subtítulos, descripciones del audio y guiones de postproducción. En caso de disponer de códigos de tiempo, entonces podemos generar también resúmenes en vídeo a partir de dichos resúmenes en texto. En este estudio inicial construimos los resúmenes seleccionando las diez tomas de la película original que contienen la mayor proporción de palabras clave. Definimos las palabras clave de dos formas: como palabras de frecuencia media, ya que son las palabras de frecuencia media en un texto las que contienen la mayor parte de la información acerca del contenido de dicho texto; y como entidades nombradas derivadas del reparto de la película. Ye et al. (2007) sostienen que la calidad de un resumen puede evaluarse en base a cuántos de los conceptos principales del texto original se conservar en el resumen. Hemos comprobado que esta aproximación a la evaluación de resúmenes obtiene resultados más favorables que la aproximación ROUGE (Lin and Franz, 2004) basada en comparar el número de correspondencias de secuencias de caracteres entre los resúmenes generados automática y manualmente.