光明大陆手机帐号注销怎么出售帐号 光明大陆手机帐号注销出售平台推荐

问:SPSS聚类分析是否需要对数据进行标准化处理? - 推酷
问:SPSS聚类分析是否需要对数据进行标准化处理?
为了从不同的角度反映一组数据的特征,我们往往追求更多的指标,这些数据单位不同,数量级也不同,这就需要我们在开始分析之前&对数据进行标准化处理。聚类分析就经常遇到,因为聚类就是利用多个指标来对样本进行分类的统计方法。
那么,SPSS聚类分析是否需要对数据进行标准化处理呢?经常有人提问。
首先,从聚类分析的概念上来判断。
聚类的要求是同一类的样本有较大的相似性,不同类的样本更有较大的差异性。那如何才算是有相似性呢?这里经常用的就是判断点与点之间的距离是不是很近或者有相关性,只要是用距离来判断,就涉及到不同指标的运算,而量纲和数量级上的差异对距离的判断与很大的影响,为了消除这种影响,因此在聚类前需要对数据进行标准化处理。
有一种例外情况,如果采用相关系数来衡量个体的相似性,可以不做标准化处理,留给大家讨论。
其次,我们从聚类操作对话框来看。
SPSS软件封装了3种聚类方法,TwoStep、Kmeans、Hierarchical。
先来看TwoStep聚类,如下图对话框。
SPSS明确指出需要对连续变量进行标准化操作,这个选项非常适合初学者,把数据质量的因素直接考虑进去,我们只需要按照提示来一步步完成即可。
再来看Kmeans聚类,如下图,
我们发现,SPSS并没有在这个过程中预装标准化操作,因此对于刚接触SPSS的人来说,就会造成一定的困惑或者麻烦,以为完全按照spss的菜单项操作就可万无一失,从这一例子来看,SPSS初学者一定不能有这样的惰性思维,SPSS为我们提供便捷菜单操作的同时,我们仍然不能放弃基本的数据分析思维。
再看Hierarchical距离过程,对话框如下图,
spss同样预装了数据标准化操作,SPSS菜单操作的便捷一目了然。
数据小兵博客总结
讲到这里,大家对这个问题应该比较清晰。小兵再次提醒大家,不管SPSS是否在菜单选项中提供数据标准化处理,作为分析师,首先我们要有提前标准化的思维习惯,数据标准化也是数据预处理中的一项重要工作。
数据小兵博客,已经整理和发布的SPSS聚类分析文章如下,供大家参考。
已发表评论数()
请填写推刊名
描述不能大于100个字符!
权限设置: 公开
仅自己可见
正文不准确
标题不准确
排版有问题
主题不准确
没有分页内容
图片无法显示
视频无法显示
与原文不一致}

我要回帖

更多关于 光明大陆平民职业推荐 的文章

更多推荐

版权声明:文章内容来源于网络,版权归原作者所有,如有侵权请点击这里与我们联系,我们将及时删除。

点击添加站长微信