Avaliação da anotação semântica do PALAVRAS e sua pós-edição manual para o Corpus Summ-it

  • Élen Cátia Tomazela Universidade Federal de São Carlos
  • Cláudia Dias de Barros Universidade Federal de São Carlos
  • Lucia Helena Machado Rino Universidade Federal de São Carlos

Resumen

Este artigo apresenta uma avaliação da anotação semântica automática do parser PALAVRAS e sua pós-edição manual para um corpus de textos em português – o Corpus Summ-it. Essa pós-edição visou ao aprimoramento de um modelo linguístico para a sumarização automática de textos e buscou atribuir  etiquetas semânticas mais adequadas aos itens lexicais, comparadas às empregadas pelo parser. Essa tarefa foi realizada por linguistas e os casos problemáticos são apresentados neste artigo, os quais levam a considerações sobre o próprio modelo de etiquetagem do PALAVRAS. O corpus revisado estará disponível para a comunidade e poderá ser útil para várias aplicações de Processamento de Línguas Naturais.

Publicado
2011-01-09
Cómo citar
Tomazela, Élen C., Dias de Barros, C., & Machado Rino, L. H. (2011). Avaliação da anotação semântica do PALAVRAS e sua pós-edição manual para o Corpus Summ-it. Linguamática, 2(3), 29-42. Recuperado a partir de https://linguamatica.com/index.php/linguamatica/article/view/74
Sección
Artículos de investigación