Identificação de expressões multipalavra em domínios específicos
dc.contributor.author | Villavicencio, Aline | pt_BR |
dc.contributor.author | Ramisch, Carlos Eduardo | pt_BR |
dc.contributor.author | Machado, André | pt_BR |
dc.contributor.author | Caseli, Helena de Medeiros | pt_BR |
dc.contributor.author | Finatto, Maria José Bocorny | pt_BR |
dc.date.accessioned | 2017-09-27T02:25:16Z | pt_BR |
dc.date.issued | 2010 | pt_BR |
dc.identifier.issn | 1647-0818 | pt_BR |
dc.identifier.uri | http://hdl.handle.net/10183/168908 | pt_BR |
dc.description.abstract | Expressões Multipalavra (EM) são uns dos grandes obstáculos para a obtenção de sistemas mais precisos de Processamento de Linguagem Natural (PLN). A cobertura limitada de EM em recursos linguísticos pode impactar negativamente o desempenho de tarefas e aplicações de PLN e pode levar à perda de informação ou a problemas de comunicação, especialmente em domnínios técnicos, em que EM são particularmente frequentes. Este trabalho investiga algumas abordagens para a identificação de EM em corpora técnicos com base em medidas de associação, informações morfossintáticas e de alinhamento lexical. Primeiramente, examina-se a influêencia de alguns fatores sobre o seu desempenho, tais como fontes de informação para a identificação e avaliação. Se, por um lado, as medidas de associação enfatizam revocaçã, por outro, o método de alinhamento centra-se em precisão. Neste trabalho, porpõe-se uma abordagem combinada que une os pontos fortes das diferentes abordagens e fontes de informação utilizando um algoritmo de aprendizado de máquina para produzir resultados mais robustos e precisos. A avaliação automática dos resultados mostra que o desempenho do método combinado é superior aos resultados individuais das abordagens associativa e baseada em alinhamento para a extração de EM em português e inglês. Além disso, é discutida com efetividade de cada um desses métodos para a identificação de EM específicas em comparação com EM de domínio genérico. O método proposto pode ser usado para auxiliar o trabalho lexicográfico, fornecendo um lista de candidatos a EM. | pt_BR |
dc.format.mimetype | application/pdf | |
dc.language.iso | por | pt_BR |
dc.relation.ispartof | Linguamática. Portugal. Vol. 2, n. 1 (abr. 2010), p. 15-34 | pt_BR |
dc.rights | Open Access | en |
dc.subject | Linguagem natural : Processamento de textos | pt_BR |
dc.subject | Expressão multipalavra | pt_BR |
dc.title | Identificação de expressões multipalavra em domínios específicos | pt_BR |
dc.type | Artigo de periódico | pt_BR |
dc.identifier.nrb | 000756230 | pt_BR |
dc.type.origin | Estrangeiro | pt_BR |
Este item está licenciado na Creative Commons License
-
Artigos de Periódicos (40977)Linguística, Letras e Artes (2806)
-
Artigos de Periódicos (40977)Ciências Exatas e da Terra (6198)