Questão de Banco de Dados — Data Mining — CESGRANRIO 2018
Banco de DadosData Mining
- Código
- cg013999
- Banca
- CESGRANRIO
- Órgão
- Transpetro
- Ano
- 2018
- Nível
- Superior
- Cargo
- Analista de Sistemas Júnior - SAP
Em agrupamento de dados, o algoritmo k-means é aplicado por várias aplicações que demandam a criação de clusters. Sua abordagem heurística, progressivamente refina a qualidade dos grupos formados, buscando a estabilidade em um ótimo local.Uma das características desse algoritmo é a de
- Aapresentar complexidade de O(nkt), onde n é o número total de objetos, k, o total de clusters, e t, o número de interações.
- Bapresentar sua similaridade intragrupo maximizada e intergrupos minimizada pela sua função-objetivo.
- Cser especialmente adequada à existência de outliers, sobretudo quando utilizada a distância euclidiana como critério de cálculo de similaridade.
- Dser um algoritmo hierárquico, o qual cria uma decomposição do conjunto de dados, a partir de um critério definido.
- Eter a capacidade de autodeterminar o valor de k, a partir da amostra inicial de dados prévios do algoritmo Apriori.