LinguaKit: uma ferramenta multilingue para a análise linguística e a extração de informação

  • Pablo Gamallo Universidade de Santiago de Compostela
  • Marcos Garcia Universidade de A Corunha
Palavras-chave: Processamento da Linguagem Natural, Extração de Informação, Tecnologia Linguística

Resumo

Este artigo apresenta LinguaKit, uma suite multilingue de ferramentas de análise, extração, anotação e correção linguísticas. LinguaKit permite realizar tarefas tão diversas como a lematização, a etiquetagem morfossintática ou a análise sintática (entre outras), incluindo também aplicações para a análise de sentimentos (ou minaria de opiniões), a extração de termos multipalavra, ou a anotação concetual e ligação a recursos enciclopédicos tais como a DBpedia. A maior parte dos módulos funcionam para quatro variedades linguísticas: português, espanhol, inglês e galego. A linguagem de programação de LinguaKit é Perl, e o código está disponível sob a licença livre GPLv3.

Publicado
2017-07-01
Como Citar
Gamallo, P., & Garcia, M. (2017). LinguaKit: uma ferramenta multilingue para a análise linguística e a extração de informação. Linguamática, 9(1), 19-28. https://doi.org/10.21814/lm.9.1.243
Edição
Secção
Artigos de Investigação