Análise Morfossintáctica para Português Europeu e Galego: Problemas, Soluções e Avaliação

  • Marcos Garcia Grupo ProLNat - Universidade de Santiago de Compostela
  • Pablo Gamallo Grupo ProLNat - Universidade de Santiago de Compostela
Keywords: part-of-speech tagging, superficial analysis

Abstract

As diferentes tarefas de análise morfossintáctica têm muita importância para posteriores níveis do processamento da linguagem natural. Por isso, estes processos devem ser realizados com ferramentas que garantam bons desempenhos em relação à cobertura, precisão e robustez na análise. FreeLing é uma suite com licença GPL desenvolvida pelo Grupo TALP da Universitat Politècnica de Catalunya. Este software contém -entre outros- módulos de tokenização, segmentação de orações, reconhecimento de entidades e anotação morfossintáctica. Com o fim de obtermos ferramentas que nos sirvam de base para a análise sintáctica, bem como para disponibilizar software livre para o processamento de superfície de Português Europeu e Galego, adaptámos FreeLing para estas variedades. A primeira delas foi desenvolvida com ajuda de recursos linguísticos disponíveis on-line, enquanto os ficheiros do Galego tiveram como base a versão anterior de FreeLing (criados pelo Seminario de Lingüística Informática da Universidade de Vigo), que já realizava a análise desta língua. O presente trabalho descreve os principais aspectos do desenvolvimento das ferramentas, com ênfase nos problemas encontrados e nas soluções adoptadas em cada caso. Além disso, são apresentados os resultados de avaliação do módulo PoS-tagger.

Published
2010-05-29
How to Cite
Garcia, M., & Gamallo, P. (2010). Análise Morfossintáctica para Português Europeu e Galego: Problemas, Soluções e Avaliação. Linguamática, 2(2), 59-67. Retrieved from https://linguamatica.com/index.php/linguamatica/article/view/56
Section
Research Articles