A novel cooperative algorithm for clustering large databases with sampling

dc.contributor.advisorVarejão, Flávio Miguel
dc.contributor.refereeAlvarenga, Arlindo Gomes de
dc.contributor.refereeBarbosa, Hélio José Corrêa
dc.contributor.refereeRodrigues, Alexandre Loureiro
dc.date.accessioned2016-08-29T15:33:17Z
dc.date.available2016-07-11
dc.date.available2016-08-29T15:33:17Z
dc.identifier.citationFABRIS, Fábio. A novel cooperative algorithm for clustering large databases with sampling. 2012. 99 f. Dissertação (Mestrado em Informática) - Universidade Federal do Espírito Santo, Centro Tecnológico, Vitória, 2012.por
dc.identifier.urihttp://repositorio.ufes.br/handle/10/4256
dc.publisherUniversidade Federal do Espírito Santopor
dc.publisher.countryBRpor
dc.publisher.courseMestrado em Informáticapor
dc.publisher.initialsUFESpor
dc.publisher.programPrograma de Pós-Graduação em Informáticapor
dc.subject.br-rjbnEstatísticapor
dc.subject.br-rjbnAmostragem (Estatística)por
dc.subject.br-rjbnAnálise por agrupamentopor
dc.subject.br-rjbnProgramação heurísticapor
dc.subject.br-rjbnAlgoritmos de computadorpor
dc.subject.cnpqCiência da Computaçãopor
dc.subject.udc004
dc.titleA novel cooperative algorithm for clustering large databases with samplingen
dc.typemasterThesisen
dcterms.abstractAgrupamento de dados é uma tarefa recorrente em mineração de dados. Com o passar do tempo, vem se tornando mais importante o agrupamento de bases cada vez maiores. Contudo, aplicar heurísticas de agrupamento tradicionais em grandes bases não é uma tarefa fácil. Essas técnicas geralmente possuem complexidades pelo menos quadráticas no número de pontos da base, tornando o seu uso inviável pelo alto tempo de resposta ou pela baixa qualidade da solução final. A solução mais comumente utilizada para resolver o problema de agrupamento em bases de dados grandes é usar algoritmos especiais, mais fracos no ponto de vista da qualidade. Este trabalho propõe uma abordagem diferente para resolver esse problema: o uso de algoritmos tradicionais, mais fortes, em um sub-conjunto dos dados originais. Esse sub-conjunto dos dados originais é obtido com uso de um algoritmo co-evolutivo que seleciona um sub-conjunto de pontos difícil de agrupar.por
dcterms.abstractClustering is a recurrent task in data mining. The application of traditional heuristics techniques in large sets of data is not easy. They tend to have at least quadratic complexity with respect to the number of points, yielding prohibitive run times or low quality solutions. The most common approach to tackle this problem is to use weaker, more randomized algorithms with lower complexities to solve the clustering problem. This work proposes a novel approach for performing this task, allowing traditional, stronger algorithms to work on a sample of the data, chosen in such a way that the overall clustering is considered good.en
dcterms.creatorFabris, Fábio
dcterms.formatTexten
dcterms.issued2012-07-30
dcterms.languageenen
Arquivos
Pacote Original
Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
Dissertação_5121_.pdf
Tamanho:
718.73 KB
Formato:
Adobe Portable Document Format
Descrição: