Return to search

Classificação com exemplos de uma única classe baseada na busca pelos limites das características do problema

Submitted by Nayara Passos (nayara.passos@ufpe.br) on 2015-03-11T19:52:28Z
No. of bitstreams: 2
TESE George Gomes Cabral.pdf: 3153073 bytes, checksum: 0d149ea3bf3d88d754b81befbafa8b70 (MD5)
license_rdf: 1232 bytes, checksum: 66e71c371cc565284e70f40736c94386 (MD5) / Made available in DSpace on 2015-03-11T19:52:28Z (GMT). No. of bitstreams: 2
TESE George Gomes Cabral.pdf: 3153073 bytes, checksum: 0d149ea3bf3d88d754b81befbafa8b70 (MD5)
license_rdf: 1232 bytes, checksum: 66e71c371cc565284e70f40736c94386 (MD5)
Previous issue date: 2014 / FACEPE / A detecção de novidades é um problema com um grande número de aplicações. Em
algumas aplicações, o foco está na prevenção ou detecção de estados indesejados. Em alguns
casos, esses estados não são conhecidos durante o treinamento do modelo de classificador; em
outros, como monitoramento de máquinas, por exemplo, uma quebra da máquina pode ser bem
rara e exemplos desse caso podem ser bastante raros. Nestes casos, a abordagem mais aceita
consiste em se modelar o comportamento normal do sistema de forma a, no futuro, se detectar
eventos desconhecidos. Esse é o conceito básico de Classificação com Exemplos de uma Única
Classe (One-Class Classification - OCC).
Esta tese introduz duas versões de um método simples e efetivo para OCC, chamado de
FBDOCC (Feature Boundaries Detector for One-Class Classification). O FBDOCC funciona
analisando cada característica (dimensão) do problema e criando uma representação sintética da
classe novidade (desconhecida a priori) que engloba os dados da classe normal. Esse trabalho
também considera o uso do algoritmo Particle Swarm Optimization (PSO) na busca da melhor
configuração dos parâmetros do método proposto. Além disso, o presente trabalho introduz
também um procedimento para a melhoria do custo computacional durante o treinamento, da
técnica proposta, sem que haja a degradação na qualidade da classificação. Entre as motivações
por trás deste trabalho, estão a criação de um método com baixo custo computacional e com a
mesma ou melhor precisão na classificação que métodos para detecção de novidades do estado
da arte.
Vários experimentos foram executados com bases de dados do mundo real e artificiais
no intuito de comparar as duas versões desenvolvidas do método proposto com alguns dos
mais recentes e efetivos métodos OCC, são eles: Support Vector Data Description (SVDD),
One-Class SVM (OCSVM), Least Squares One-class SVM (LSOCSVM), Kernel Principal
Component Analysis (KPCA), Gaussian Process Prior OCC (GP-OCC), Condensed Nearest
Neighbor Data Description (CNNDD) e One-class Random Forests (OCRF). As métricas de
desempenho consideradas nos experimentos foram: (i) a area sob a curva ROC (Area Under the
Curve - AUC); (ii) o coeficiente de correlação deMatthews (Matthews Correlation Coefficient
- MCC); (iii) o tempo de treinamento; e (iv) a taxa de redução de protótipos. Em relação às
métricas AUC e MCC, a primeira versão do método FBDOCC apresentou a melhor média
global entre todos os métodos enquanto que a segunda versão do método proposto, FBDOCC2,
obteve resultados comparáveis aosmelhoresmétodos em experimentos onde o FBDOCC obteve
um baixo desempenho. O FBDOCC obteve os melhores resultados considerando o tempo de
treinamento em todas as bases de dados, exceto uma. Em adição, o FBDOCC foi bem mais
rápido que todos os métodos baseados em Máquinas de Vetores de Suporte.
Além disso, um estudo de caso foi realizado utilizando dados adquiridos em um hospital
local de renome. Estes dados são compostos de informações não-invasivas sobre as crianças
que compareceram ao hospital com sintomas de sopro no coração. Informações como idade,
peso, altura, etc., foram usadas para prever se a criança é ou cardiopata. Devido ao elevado
grau de desequilíbrio entre as classes (ou seja, o número de pacientes saudáveis foi consideravelmente
mais elevado), a abordagem adotada foi a de construir uma descrição dos casos
saudáveis deixando casos desconhecidos fora desta descrição. Os resultados mostram que dois
dos classificadores OCC aplicados (FBDOCC e OCSVM) obtiveram êxito nesta tarefa, resultando
na melhor taxa, entre os métodos investigados, de detecção baseada exclusivamente em
dados não-invasivo

Identiferoai:union.ndltd.org:IBICT/oai:repositorio.ufpe.br:123456789/12097
Date31 January 2014
CreatorsCABRAL, George Gomes
ContributorsOLIVEIRA, Adriano Lorena Inácio de
PublisherUniversidade Federal de Pernambuco
Source SetsIBICT Brazilian ETDs
LanguageBreton
Detected LanguagePortuguese
Typeinfo:eu-repo/semantics/publishedVersion, info:eu-repo/semantics/doctoralThesis
Sourcereponame:Repositório Institucional da UFPE, instname:Universidade Federal de Pernambuco, instacron:UFPE
RightsAttribution-NonCommercial-NoDerivs 3.0 Brazil, http://creativecommons.org/licenses/by-nc-nd/3.0/br/, info:eu-repo/semantics/openAccess

Page generated in 0.0018 seconds