发布时间:2022-05-06 14: 18: 21
SPSS的最近邻元素分析是一种分类模型,它是根据个案间的相似性来对个案进行分类。简单来说就是相同个案相互靠近,不同个案相互远离。因此,可以通过判断样本距离哪个离中心点更近,进而判断样本数据属于哪个类别。本篇教程将教大家使用SPSS的最近邻元素模型对汽车行业数据进行数据分析,相信通过学习SPSS的最近邻元素模型,你将能够对各个领域数据分析。
一、 数据准备与数据预处理
为了用最近邻元素模型给大家演示数据分析,这里使用Kaggle实验室的car_sales数据集。主要通过添加两款新研制的车型进行数据分析,这两款预研车型技术指标主要包括Model、Priceinthousands、enginesize、horsepower、width、length、curbweight、fuelcapacity、fueleffciency等。
为了对这款新研发的车型进行分析,这里在原数据添加这两个车型的新记录。
为了对新记录添加特别关注的标记,因此这里将添加一个名为focal的新变量。点击SPSS顶部菜单栏“转换”-“计算变量”,打开计算变量窗口,目标变量命名为focal,并在数字表达式输入any(Model,'newCar','newTruck')。这个函数表达式意思是Model变量值为'newCar'或者'newTruck',则focal为1,否则为0.
同样通过计算变量方式添加变量partition,用于区分训练数据集和测试数据集,表达式为1-any(Model,'newCar','newTruck')。Partition>0,则为训练数据,否则为测试数据。
二、最近邻元素模型分析
由于篇幅有限,这里仅展示预估汽车类型。点击SPSS顶部菜单栏“分析”-“分类”-“最小邻元素”。点击顶部“变量”项目进行设置,将vehicletype加载到目标文本框,9个指标加载到特征文本框,focal加载到焦点个案,Model加载到个案标签。
点击最近邻元素分析顶部“邻元素”,将k值设置为3,并且勾选计算距离时按重要性对特征进行加权。
点击最近邻元素分析顶部“分区”,训练和坚持分区选择使用变量来分配个案,并且将partition加载到分区变量文本框。
三、结果分析
可以看到对于预估汽车类型结果,数据添加了一个预测值的变量,可以看到对新车的预测比较准确,并且生成了一个预估变量空间图型。
四、小结
以上是利用SPSS最近邻元素模型对汽车行业数据进行分析,相信通过从数据准备和预处理,再到利用最近邻元素模型分析,最后到结果分析,你已经对该模型有一定了解,并且能够简单使用到各个领域。
作者:独行侠
展开阅读全文
︾
读者也喜欢这些内容:
spss双因素分析步骤 spss双因素分析显著性差异
SPSS双因素分析是一种统计分析方法,用于研究两个或以上的自变量对因变量的影响。在实际应用中,该方法常被用于比较两种或以上的处理方法,以及研究两个或以上的因素对实验结果的影响。本文将详细介绍SPSS双因素分析步骤和SPSS双因素分析显著性差异。...
阅读全文 >
spss双因素分析法差异 spss双因素分析结果怎么看
SPSS双因素分析是一种常用的数据分析方法,它能够帮助研究者了解不同因素对研究结果的影响,并确定这些因素之间的关系。本文将介绍SPSS双因素分析法的差异以及SPSS双因素分析结果怎么看。...
阅读全文 >
spss随机分组需要降序吗 spss随机分组不均匀怎么办
在进行数据分析时,我们经常需要对数据进行随机分组,以便进行进一步的研究和比较。在使用SPSS软件进行随机分组时,我们可能会遇到一些问题,如是否需要对数据进行降序排序以及如何处理分组不均匀的情况。在本文中,我们将深入探讨SPSS随机分组需要降序吗?SPSS随机分组不均匀怎么办?并提供一些解决方法。...
阅读全文 >
SPSS效度检验怎么做 SPSS效度检验结果分析方法
效度检验是一种数据分析方法,其主要目的是明确获取到的数据能否得到想要的结论,能否反映在分析的问题,同时,判断量化变量是否合理和正确。下面就通过SPSS具体讲解,SPSS效度检验怎么做,以及SPSS效度检验结果分析方法相关内容。...
阅读全文 >