文章基本信息

标题：Avaliação de recursos computacionais para o português
本地全文：下载
作者：Matilde Gonçalves ; Luisa Coheur ; Jorge Baptista 等
期刊名称：Linguamática
电子版ISSN：1647-0818
出版年度：2020
卷号：12
期号：2
页码：51-68
DOI：10.21814/lm.12.2.331
出版社：Universidade do Minho & Universidade de Vigo
摘要：Têm sido desenvolvidas várias ferramentas para o processamento da língua portuguesa. No entanto, devido a escolhas variadas na base dos comportamentos destas ferramentas (diferentes opções de pré-processamento, diferentes conjuntos de etiquetas morfossintáticas e de dependências, etc.), torna-se difícil ter uma ideia do desempenho comparativo de cada uma. Neste trabalho, avaliamos um conjunto de ferramentas gratuitas e publicamente disponíveis, que realizam as tarefas de Etiquetação Morfossintática e de Reconhecimento de Entidades Mencionadas, para a língua portuguesa. São tidos em conta doze modelos diferentes para a primeira tarefa e oito para a segunda. Todos os recursos usados nesta avaliação (tabelas de mapeamento de etiquetas, corpora de referência, etc.) são disponibilizados, permitindo replicar/afinar os resultados. Apresentamos ainda um estudo qualitativo de dois analisadores de dependências. Não temos conhecimento de nenhum trabalho similar recente, isto é, que tenha em conta as ferramentas atuais disponíveis, realizado para a língua portuguesa.
关键词：processamento da linguagem natural;avaliação de recursos;língua portuguesa;análise morfosintática;reconhecimento de entidades mencionadas;análise de dependências