聚类是把一个数据集划分成多个子集的过程,每一个子集称作一个簇(Cluster),聚类使得簇内的对象具有很高的相似性,但与其他簇中的对象很不相似,由聚类分析产生的簇的集合称作一个聚类.在相同的数据集上,不同的聚类算法可能产生不同的聚类. 聚类分析用于洞察数据的分布,观察每个簇的特征,进一步分析特定簇的特征.由于簇是数据对象的子集合,簇内的对象彼此相似,而与其他簇的对象不相似,因此,簇可以看作数据集的“隐性”分类,聚类分析可能会发现数据集的未知分组. 聚类通过观察学习,不需要提供每个训练元素的隶属关