
发布时间:2021-09-23 15: 14: 10
K均值聚类、分层聚类、二阶聚类是SPSS聚类分析中常用的三种聚类方法。K均值聚类使用的是欧式距离的测量方法;分层聚类是根据度量的距离远近,构建谱系分析;二阶聚类是利用距离测量得到分类树,然后再利用BIC或AIC准则判别最佳聚类。
除了以上聚类原理的不同外,三种聚类方法还有哪些不同点呢?接下来,我们从参数设置与结果解读两方面进行详细解读。
一、参数设置
K均值聚类仅可用于连续变量的聚类分析,因此,如图1所示,其参数设置面板仅提供了一个变量选项。另外,K均值聚类主要是采用了迭代计算的方法。
虽然系统聚类分析也仅提供了一个变量选项,但其变量选项可添加分类变量或连续变量。但要注意的是,单次只能分析同一种类型的变量,也就是说,不能将分类变量与连续变量同时添加到变量选项框,只能添加其中一种类型。
另外,与K均值聚类仅可分析个案聚类不同,系统聚类可分析个案或变量的聚类。
而且,系统聚类分析可指定解的范围。
相对于其他两种聚类方法,二阶聚类的变量选项更为自由,可同时添加分类与连续变量。
二、结果解读
从结果解读来看,K均值聚类可简单快速地得到最终聚类的中心,但由于其测量计算主要是依靠“直线式”的欧式距离,因此,对异常值较为敏感。
而不同于K均值聚类清晰而简单的聚类结果,系统聚类主要是依靠如图7所示的谱系图解读聚类结果。
通过在谱系图中绘制竖线并向左观察,可得到聚类数据以及其包含的个案信息。
二阶聚类分析除了能通过BIC或AIC准则获得最佳的聚类数目外,还可进一步得到聚类的质量评分。
以及通过聚类预测重要性、聚类特征图等得到影响聚类的重要变量,以及各个聚类的变量特征。
三、小结
综上所述,K均值聚类、分层聚类、二阶聚类这三种SPSS的聚类方法各具优点与缺点。
K均值聚类简单快速,但无法分析分类变量、容易受异常值影响;系统聚类,可对个案与变量聚类,可对连续与分类变量聚类,但依靠谱系图分析,当数据量大时,分析速度慢;二阶聚类,自动程度高,可同时分析分类与连续变量,但容易受到分类变量的影响。
作者:泽洋
展开阅读全文
︾
微信公众号
读者也喜欢这些内容:
SPSS交互作用分析怎么做 SPSS交互作用分析结果怎么看
在数据统计领域,如果要对数据组多类变量的关系进行研究,我们可以使用SPSS主体间效应分析和交互作用图绘制的功能。当运用了SPSS交互作用的图片绘制和数据测算,我们能够直观清晰地看出不同变量对因变量的影响。今天,我们以SPSS交互作用分析怎么做,SPSS交互作用分析结果怎么看这两个问题为例,带大家了解一下SPSS交互作用的知识。...
阅读全文 >
SPSS二阶聚类总报错 SPSS二阶聚类分析步骤
SPSS是一款功能齐全的数据分析软件,它被广泛的应用在了数学建模、市场调查、消费者行为等方面的研究,我们通过SPSS可以轻松的进行数据清洗、整理,并得到准确的统计分析结果。接下来,我给大家介绍SPSS二阶聚类总报错,SPSS二阶聚类分析步骤的内容。...
阅读全文 >
SPSS比较多组数据差异分析方法 SPSS比较多组数据差异怎么算
SPSS是一款数据统计分析软件,在工作中可以帮助我们对庞大的数据集进行多种数据方法分析,获取科学有效的分析结果,完成对数据集的分析。例如对于多组数据的分析,在SPSS中就有多种分析方法,不同的分析方法计算方法也会略有不同,下面给大家介绍的是有关,SPSS比较多组数据差异分析方法,以及SPSS比较多组数据差异怎么算的相关内容。...
阅读全文 >
SPSS配对样本t检验怎么做 SPSS配对样本t检验p值怎么看
说到SPSS配对样本t检验,很多人可能都有点迷糊。其实,它就是用来对比同一个人或同一件事情在两种不同情况下的表现差异。举个简单的例子,比如一个学生的期中和期末成绩,这两个成绩就是“配对样本”。今天,我们就用简单的方式来说说“SPSS配对样本t检验怎么做 SPSS配对样本t检验p值怎么看”,让大家轻松搞懂。...
阅读全文 >