Avaliação de recursos computacionais para o português

Autores/as

  • Matilde Gonçalves
  • Luisa Coheur INESC-ID/Instituto Superior Técnico
  • Jorge Baptista
  • Ana Mineiro

DOI:

https://doi.org/10.21814/lm.12.2.331

Palabras clave:

processamento da linguagem natural, avaliação de recursos, língua portuguesa, análise morfosintática, reconhecimento de entidades mencionadas, análise de dependências

Resumen

 Têm sido desenvolvidas várias ferramentas para o processamento da língua portuguesa. No entanto, devido a escolhas variadas na base dos comportamentos destas ferramentas (diferentes opções de pré-processamento, diferentes conjuntos de etiquetas morfossintáticas e de dependências, etc.), torna-se difícil ter uma ideia do desempenho comparativo de cada uma. Neste trabalho, avaliamos um conjunto de ferramentas gratuitas e publicamente disponíveis, que realizam as tarefas de Etiquetação Morfossintática e de Reconhecimento de Entidades Mencionadas, para a língua portuguesa. São tidos em conta doze modelos diferentes para a primeira tarefa e oito para a segunda. Todos os recursos usados nesta avaliação (tabelas de mapeamento de etiquetas, corpora de referência, etc.) são disponibilizados, permitindo replicar/afinar os resultados. Apresentamos ainda um estudo qualitativo de dois analisadores de dependências. Não temos conhecimento de nenhum trabalho similar recente, isto é, que tenha em conta as ferramentas atuais disponíveis, realizado para a língua portuguesa.

Referencias

Publicado

2020-12-31

Número

Sección

Artículos de investigación

Cómo citar

Avaliação de recursos computacionais para o português. (2020). Linguamática, 12(2), 51-68. https://doi.org/10.21814/lm.12.2.331