Please use this identifier to cite or link to this item: https://repositorio.ufjf.br/jspui/handle/ufjf/21388
Files in This Item:
File Description SizeFormat 
arthurmarchitoleite.pdfTCC Graduação Curso: Estatística - Arthur Marchito Leite13.8 MBAdobe PDFView/Open
Type: Trabalho de Conclusão de Curso
Title: Comparação de Técnicas de Agrupamento: K-means, Método Hierárquico de Ward e Misturas de Gaussianas Aplicadas a Dados Reais
Author: Leite, Arthur Marchito
First Advisor: Zeller, Camilla Borelli
Referee Member: Dias, Bárbara da Costa Campos
Referee Member: Bessegato, Lupercio França
Resumo: No aprendizado não supervisionado, os métodos de agrupamento são fundamentais para a análise de dados, organizando elementos em grupos (ou clusters) com características semelhantes. Este estudo explora e compara três técnicas amplamente usadas: K-means, método de Ward e misturas de gaussianas. Apesar de compartilharem o objetivo de formar clusters, esses métodos diferem em suas abordagens e pressupostos. O K-means busca minimizar a variabilidade interna dos clusters, enquanto o método de Ward constrói um dendrograma, possibilitando a escolha flexível do número de grupos. As misturas de gaussianas oferecem uma abordagem probabilística, atribuindo probabilidades de pertencimento a cada cluster. Utilizando dados reais, avaliamos o desempenho de cada técnica, concluindo que a escolha do método depende das propriedades dos dados e do objetivo da análise. Este estudo fornece diretrizes práticas para a aplicação dos métodos em diferentes contextos analíticos.
Abstract: In the context of unsupervised learning, clustering methods are essential for data analysis, allowing the organization of elements into groups (or clusters) based on similar characteristics. This study aims to explore and compare three widely used clustering methods in the statistical literature: K-means, Ward’s method, and Gaussian mixtures. Although all methods share the goal of cluster formation, they differ significantly in their approaches and underlying assumptions. Using real datasets, we applied each of the aforementioned methods, evaluating their performance and effectiveness in group formation. We concluded that the choice of clustering method should consider the intrinsic properties of the data and the analysis objectives. This study contributes to the understanding of the differences and similarities between these methods, providing practical guidelines for applications in various data analysis scenarios.
Keywords: Agrupamento
Clustering
Método K-means
K-means
Método de Ward
Ward's method
Misturas de gaussianas
Gaussian mixtures
Dados reais
Real Data
CNPq: Estatística e Probabilidade
Language: por
Country: Brasil
Publisher: Universidade Federal de Juiz de Fora (UFJF)
Institution Initials: UFJF
Department: ICE – Instituto de Ciências Exatas
Access Type: Acesso Aberto
Attribution-NonCommercial-NoDerivs 3.0 Brazil
Creative Commons License: http://creativecommons.org/licenses/by-nc-nd/3.0/br/
URI: https://repositorio.ufjf.br/jspui/handle/ufjf/21388
Issue Date: 18-Dec-2025
Appears in Collections:Estatística - TCC Graduação



This item is licensed under a Creative Commons License Creative Commons