☆ 4.2 Article

Comparison of Similarity Measures for Categorical Data in Hierarchical Clustering

JOURNAL OF CLASSIFICATION (2019)

Journal

JOURNAL OF CLASSIFICATION

Volume 36, Issue 1, Pages 58-72

Publisher

SPRINGER

DOI: 10.1007/s00357-019-09317-5

Keywords

Similarity measures; Nominal variables; Hierarchical cluster analysis; Comparison; Evaluation

Funding

University of Economics, Prague under the IGA [F4/41/2016]

Ask authors/readers for more resources

Protocol

Community support

Reagent

Community support

Abstract

This paper deals with similarity measures for categorical data in hierarchical clustering, which can deal with variables with more than two categories, and which aspire to replace the simple matching approach standardly used in this area. These similarity measures consider additional characteristics of a dataset, such as a frequency distribution of categories or the number of categories of a given variable. The paper recognizes two main aims. First, to compare and evaluate the selected similarity measures regarding the quality of produced clusters in hierarchical clustering. Second, to propose new similarity measures for nominal variables. All the examined similarity measures are compared regarding the quality of the produced clusters using the mean ranked scores of two internal evaluation coefficients. The analysis is performed on the generated datasets, and thus, it allows determining in which particular situations a certain similarity measure is recommended for use.

Comparison of Similarity Measures for Categorical Data in Hierarchical Clustering

Journal

JOURNAL OF CLASSIFICATION

Publisher

SPRINGER

Keywords

Categories

Funding

Ask authors/readers for more resources

Protocol

Reagent

Authors

I am an author on this paper

Reviews

Primary Rating

Secondary Ratings

Novelty

Significance

Scientific rigor

Rate this paper

Recommended

Comparison of Similarity Measures for Categorical Data in Hierarchical Clustering

Journal

JOURNAL OF CLASSIFICATION

Publisher

SPRINGER

Keywords

Categories

Funding

Ask authors/readers for more resources

Protocol

Reagent

Authors

I am an author on this paper

Reviews

Primary Rating

Secondary Ratings

Novelty

Significance

Scientific rigor

Rate this paper

Recommended

Export Citation

Share Paper