La compresión de frases: un recurso para la optimización de resumen automático de documentos

  • Alejandro Molina Laboratoire Informatique d'Avignon - UAPV
  • Iria da Cunha IULA - UPF
  • Juan-Manuel Torres-Moreno Laboratoire Informatique d'Avignon - UAPV
  • Patricia Velazquez-Morales VM Labs
Palabras clave: compression de frases, resumen automatico, corpus especializados, busqueda de informacion

Resumen

El objetivo de este trabajo de investigación es confirmar si es adecuado emplear la compresión de frases como recurso para la optimización de sistemas de resumen automático de documentos. Para ello, en primer lugar, creamos un corpus de resúmenes de documentos especializados (artículos médicos) producidos por diversos sistemas de resumen automático.  Posteriormente realizamos dos tipos de compresiones de estos resúmenes.  Por un lado, llevamos a cabo una compresión manual, siguiendo dos estrategias: la compresión mediante la eliminación intuitiva de algunos elementos de la oración y la compresión mediante la eliminación de ciertos elementos discursivos en el marco de la Rhetorical Structure Theory (RST).  Por otro lado, realizamos una compresión automática por medio de varias estrategias, basadas en la eliminación de palabras de ciertas categorías gramaticales (adjetivos y adverbios) y una baseline de eliminación aleatoria de palabras.  Finalmente, comparamos los resúmenes originales con los resúmenes comprimidos, mediante el sistema de evaluación Rouge. Los resultados muestran que, en ciertas condiciones, utilizar la compresión de frases puede ser beneficioso para mejorar el resumen automático de documentos.

Biografía del autor/a

Alejandro Molina, Laboratoire Informatique d'Avignon - UAPV
Responsable del Equipo de Procesamiento de Lenguaje Natural (TALNE - LIA)
Juan-Manuel Torres-Moreno, Laboratoire Informatique d'Avignon - UAPV
Responsable del equipo PLN/LIA-UAPV
Publicado
2011-01-06
Cómo citar
Molina, A., da Cunha, I., Torres-Moreno, J.-M., & Velazquez-Morales, P. (2011). La compresión de frases: un recurso para la optimización de resumen automático de documentos. Linguamática, 2(3), 13-27. Recuperado a partir de https://linguamatica.com/index.php/linguamatica/article/view/72
Sección
Artículos de investigación