Repository logo
 
Publication

Classificação de documentos com processamento de linguagem natural

dc.contributor.advisorPereira, Carlos Manuel Jorge da Silva
dc.contributor.authorSantos, Cedric Michael dos
dc.date.accessioned2016-11-04T16:37:30Z
dc.date.available2016-11-04T16:37:30Z
dc.date.issued2015
dc.description.abstractA quantidade de informação tem vindo a crescer ao longo dos anos, e a sua sobrecarga Ć© hoje, um dos grandes problemas que as empresas e instituiƧƵes enfrentam. A classificação dos documentos de forma automĆ”tica surge entĆ£o como uma necessidade, visto um sistema automĆ”tico ser capaz de classificar milhares de documentos em apenas alguns segundos, o que seria impraticĆ”vel de ser realizado por um ser humano. O maior desafio nesta Ć”rea Ć© obter os melhores resultados, maior eficiĆŖncia computacional e maior capacidade de auto-aprendizagem, atravĆ©s nomeadamente da implementação de tĆ©cnicas para a melhor seleção de features. Este trabalho analisa e compara tĆ©cnicas de classificação com processamento de linguagem natural, atravĆ©s da linguagem Python e com apoio da biblioteca para processamento de linguagem natural Natural Language Toolkit (NLTK). Neste projeto, foram implementados algoritmos para classificação de documentos, com tĆ©cnicas de Text Mining e NLP, utilizando classificadores como Redes Neuronais, SVM’s e Redes Bayesianas. Foram avaliados em vĆ”rios casos de estudo e os resultados obtidos nos diferentes estudos atingiram valores mĆ©dios acima de 90% de accuracy. Um dos principais objetivos deste projeto Ć© aplicar os classificadores implementados na classificação de literatura na Ć”rea das proteĆ­nas. Como resultado deste projeto, foi tambĆ©m implementada uma aplicação web para classificação de documentos, disponibilizando os algoritmos implementados.pt_PT
dc.identifier.tid201332477
dc.identifier.urihttp://hdl.handle.net/10400.26/15293
dc.language.isoporpt_PT
dc.subjectClassificação de textospt_PT
dc.subjectText miningpt_PT
dc.subjectRedes neuronaispt_PT
dc.titleClassificação de documentos com processamento de linguagem naturalpt_PT
dc.typemaster thesis
dspace.entity.typePublication
rcaap.rightsopenAccesspt_PT
rcaap.typemasterThesispt_PT

Files

Original bundle
Now showing 1 - 1 of 1
Loading...
Thumbnail Image
Name:
Cedric-Michael-Santos.pdf
Size:
4.94 MB
Format:
Adobe Portable Document Format
License bundle
Now showing 1 - 1 of 1
No Thumbnail Available
Name:
license.txt
Size:
1.85 KB
Format:
Item-specific license agreed upon to submission
Description: