k-means聚类算法一定要指定聚类个数吗

如题所述

推荐答案推荐于2016-04-23

一,K-Means聚类算法原理
k-means 算法接受参数 k
；然后将事先输入的n个数据对象划分为
k个聚类以便使得所获得的聚类满足：同一聚类中的对象相似度较高；而不同聚类中的对象相似度较小.聚类相似度是利用各聚类中对象的均值所获得一个“中心对
象”（引力中心）来进行计算的.
　　K-means算法是最为经典的基于划分的聚类方法,是十大经典数据挖掘算法之一.K-means算法的基本思想是：以空间中k个点为中心进行聚类,对最靠近他们的对象归类.通过迭代的方法,逐次更新各聚类中心的值,直至得到最好的聚类结果.
　　假设要把样本集分为c个类别,算法描述如下：
　　（1）适当选择c个类的初始中心；
　　（2）在第k次迭代中,对任意一个样本,求其到c个中心的距离,将该样本归到距离最短的中心所在的类；
　　（3）利用均值等方法更新该类的中心值；
　　（4）对于所有的c个聚类中心,如果利用（2）（3）的迭代法更新后,值保持不变,则迭代结束,否则继续迭代.
　　该算法的最大优势在于简洁和快速.算法的关键在于初始中心的选择和距离公式.

温馨提示：答案为网友推荐，仅供参考

当前网址：http://77.wendadaohang.com/zd/3pqNN3833INpYY883W.html

其他回答

第1个回答推荐于2018-05-13

其实我猜你想问的是怎么改进k-means算法，可以摆脱手工指定k值。实质上通过算距离达到聚类的算法是必须要手工指定一个值的，也就是说需要一个参照。
不需要制定聚类个数的聚类算法，例如：DBSCAN

第2个回答 2018-10-14

需要的
from sklearn.cluster import KMeans
est = KMeans(n_clusters=10)
clusters = est.fit(digits.data)

相似回答

k-means聚类算法一定要指定聚类个数吗答：K-means算法是最为经典的基于划分的聚类方法,是十大经典数据挖掘算法之一.K-means算法的基本思想是：以空间中k个点为中心进行聚类,对最靠近他们的对象归类.通过迭代的方法,逐次更新各聚类中心的值,直至得到最好的聚类结果.假设要把样本集分为c个类别,算法描述如下：（1）适当选择c个类的初始中心；（2...

K-meansk-means 算法缺点答：K-means 算法的一个主要缺点是聚类数目 K 的确定。通常，K 值需要预先设定，但确定一个合适的数据集类别数并非易事。许多研究者尝试通过自动方法，如 ISODATA 算法，通过类的合并和分裂来找到更理想的 K 值。文献中提到的方法，如使用混合 F 统计量和模糊划分熵，以及结合全协方差矩阵的 RPCL 算法...

聚类个数是什么意思?答：确定聚类个数是一个关键问题，对于不同的数据集和不同的聚类算法，采用的方法也是不同的。有的算法可以根据数据的特征自动确定聚类个数，例如层次聚类算法和基于密度的聚类算法。而另一些算法则需要我们手动设定聚类个数，例如k-means聚类算法。在确定聚类个数的过程中，我们需要遵循一个基本原则：聚类的个...

kmeans中的k的含义是什么?答：kmeans中的k的含义：聚类的个数。K-means算法是硬聚类算法，是典型的基于原型的目标函数聚类方法的代表，它是数据点到原型的某种距离作为优化的目标函数，利用函数求极值的方法得到迭代运算的调整规则。K-means算法以欧式距离作为相似度测度，它是求对应某一初始聚类中心向量V最优分类，使得评价指标J最小...

Kmeans聚类算法简介(有点枯燥)答：k必须是一个比训练集样本数小的正整数。有时,类的数量是由问题内容指定的。例如,一个鞋厂有三种新款式,它想知道每种新款式都有哪些潜在客户,于是它调研客户,然后从数据里找出三类。也有一些问题没有指定聚类的数量,最优的聚类数量是不确定的。后面我将会详细介绍一些方法来估计最优聚类数量。 Kmeans的参数是类...

怎样对数据进行聚类分析?答：聚类个数：聚类个数设置为几类主要以研究者的研究思路为标准，如果不进行设置，SPSSAU默认聚类个数为3，通常情况下，建议设置聚类数量介于3~6个之间。标准化：聚类算法是根据距离进行判断类别，因此一般需要在聚类之前进行标准化处理，SPSSAU默认是选中进行标准化处理。数据标准化之后，数据的相对大小意义还在...

K均值聚类法和系统聚类法有什么区别,这两种聚类方法的适用条件都是什么...答：一、指代不同 1、K均值聚类法：是一种迭代求解的聚类分析算法。2、系统聚类法：又叫分层聚类法，聚类分析的一种方法。二、步骤不同 1、K均值聚类法：步骤是随机选取K个对象作为初始的聚类中心，然后计算每个对象与各个种子聚类中心之间的距离，把每个对象分配给距离它最近的聚类中心。2、系统聚类法：...

大家正在搜

kmeans聚类算法matlab kmeans聚类个数 kmeans聚类算法步骤 kmeans聚类算法应用 kmeans聚类算法原理 kmeans聚类算法代码 kmeans聚类算法例题 spsskmeans聚类分析 kmeans对数据进行聚类