发布时间:2021-06-01 11: 33: 16
“分箱法”相信学过统计学的小伙伴们都不会陌生,它的主要作用就在于对噪音数据进行剔除,同时将连续型数据进行离散处理。在模型分析开始前,我们经常需要使用到分箱法来处理和清洗数据。
作为一款功能全面、专业性强的统计分析软件,IBM SPSS Statistic同样具备分箱功能,下面我们一起来通过一篇教程了解一下。
图1是我们准备要分箱的数据,我们将对年龄列进行分箱,按照每10岁为一个标准进行分箱。

点击“转换”中的“可视分箱”,进入分箱设置界面。

将“年龄”拉入到“要分箱的变量”中,然后点击“继续”。

在图4所示界面,我们可以看到要扫描的个案数共34个,其中最大的变量值为67,最小为22,也就是说要分箱的数据年龄段在22到67岁之间。
我们在“分箱化变量”中,填入“年龄段”,作为一个之后新生成的变量,随后点击“生成分割点”按钮。

按照我们的分箱目的,我们要每隔10岁分组一次,最小的年龄为22岁,则我们需要在第一个分割点位置填写“20”,然后在宽度填写“10”,此时点击键盘Tap键,SPSS会自动生成分割点数的值为“5”,如图5所示。
这样子SPSS会自动帮我们将20到30、30到40、40到50、50到60、60到70的年龄段进行分组,一共5组。

点击“应用”按钮后,回到“可视分箱”界面中,我们可以在图6红框位置看到后续的分箱值,标签栏默认是空值,我们可以进行自定义填写,如设置20的分箱标签为2。

最后点击“确定”按钮,开始进行数据分箱,分箱后的新数据结果如图7所示,生成了新的“年龄段”列,数据也非常正确地进行了分箱,如年龄为27的那行数据,被正确地设置到了标签为2的分箱中。

以上就是使用IBM SPSS Statistic对演示数据中的年龄指标,按照每隔10岁的标准,进行分箱的全部教程,上述演示的是等距分箱,小伙伴也可以自己动手在IBM SPSS Statistic中尝试一下不等距分箱哦。
作者:包纸
展开阅读全文
︾
微信公众号
读者也喜欢这些内容:
SPSS缺失值多重插补步骤 SPSS缺失值插补后验证方法
我们在进行数据分析时,如果发现原始信息存在缺失的现象,可以使用多重插补的方式对缺失的信息进行填充。今天我就以SPSS缺失值多重插补步骤,SPSS缺失值插补后验证方法这两个问题为例,来向大家讲解一下SPSS当中有关缺失值插补的相关操作技巧。...
阅读全文 >
SPSS可视化分组在哪 SPSS可视化分析怎么做
在数据统计领域,SPSS可视化分箱的功能设置不仅对复杂数据进行区间划分,还可以通过条形图和分割线结合的图像方式清晰呈现数据信息。如果研究者想要对多组连续数据进行可视化分析,那么SPSS数据分箱的功能模块是比较重要的学习领域。今天,我们以SPSS可视化分组在哪,SPSS可视化分析怎么做这两个问题为例,带大家了解SPSS数据分箱的相关知识。...
阅读全文 >
SPSS可视化分箱是什么意思 SPSS可视化分箱点了不显示
当需要对繁杂数据组进行分类且可视化的图表呈现,我们可以使用SPSS可视化分箱的功能应用来实现上述需求,这样既能获取清晰直观的数据示例图,还可以便利后续的研究数据分析。今天,我们以SPSS可视化分箱是什么意思,SPSS可视化分箱点了不显示这两个问题为例,带大家了解SPSS可视化分箱的相关知识。...
阅读全文 >
SPSS可视化分箱是什么意思 SPSS可视化分箱不能用
在数据收集阶段,如果遇到样本量较大的繁杂数据,我们可以使用SPSS可视化分箱来进行数据处理和分类,这样不仅可以将数据处理成不同等级的新数据列,还可以便利后续的数据测量和分析。今天,我们以SPSS可视化分箱是什么意思,SPSS可视化分箱不能用这两个问题为例,带大家了解一下SPSS可视化分箱的知识。...
阅读全文 >