在spss拆分个案文件中组别=找不到任何有效个案提示什么情况?对结果有影响吗?解决方法是什么?

摘要: 案例数据源: 有20种12盎司啤酒荿分和价格的数据变量包括啤酒名称、热量、钠含量、酒精含量、价格。数据来自《SPSS for Windows 统计分析》

有20种12盎司啤酒成分和价格的数据变量包括啤酒名称、热量、钠含量、酒精含量、价格。数据来自《SPSS for Windows 统计分析》data11-03

【一】问题一:选择那些变量进行聚类?——采用“R型聚类”

1、现在我们有4个变量用来对啤酒分类是否有必要将4个变量都纳入作为分类变量呢?热量、钠含量、酒精含量这3个指标是要通过化验员的辛苦努力来测定而且还有花费不少成本,如果都纳入分析的话岂不太麻烦太浪费?所以有必要对4个变量进行降维处理,这里采用spss R型聚类(变量聚类)对4个变量进行降维处理。输出“相似性矩阵”有助于我们理解降维的过程

2、4个分类变量量纲各自不同,这一次我们先确定用相似性来测度度量标准选用pearson系数,聚类方法选最远元素此时,涉及到相关4个变量可不用标准化处理,将来的相似性矩阵里嘚数字为相关系数若果有某两个变量的相关系数接近1或-1,说明两个变量可互相替代

3、只输出“树状图”就可以了,个人觉得冰柱图很複杂看起来没有树状图清晰明了。从proximity matrix表中可以看出热量和酒精含量两个变量相关系数0.903最大,二者选其一即可没有必要都作为聚类变量,导致成本增加至于热量和酒精含量选择哪一个作为典型指标来代替原来的两个变量,可以根据专业知识或测定的难易程度决定(與因子分析不同,是完全踢掉其中一个变量以达到降维的目的)这里选用酒精含量,至此确定出用于聚类的变量为:酒精含量,钠含量价格。

【二】问题二:20中啤酒能分为几类——采用“Q型聚类”

1、现在开始对20中啤酒进行聚类。开始不确定应该分为几类暂时用一個3-5类范围来试探。Q型聚类要求量纲相同所以我们需要对数据标准化,这一回用欧式距离平方进行测度

2、主要通过树状图和冰柱图来理解类别。最终是分为4类还是3类这是个复杂的过程,需要专业知识和最初的目的来识别我这里试着确定分为4类。选择“保存”则在数據区域内会自动生成聚类结果。

【三】问题三:用于聚类的变量对聚类过程、结果又贡献么有用么?——采用“单因素方差分析”

1、聚類分析除了对类别的确定需讨论外还有一个比较关键的问题就是分类变量到底对聚类有没有作用有没有贡献,如果有个别变量对分类没囿作用的话应该剔除。

2、这个过程一般用单因素方差分析来判断注意此时,因子变量选择聚为4类的结果而将三个聚类变量作为因变量处理。方差分析结果显示三个聚类变量sig值均极显著,我们用于分类的3个变量对分类有作用可以使用,作为聚类变量是比较合理的

【四】问题四:聚类结果的解释?——采用”均值比较描述统计“

1、聚类分析最后一步也是最为困难的就是对分出的各类进行定义解释,描述各类的特征即各类别特征描述。这需要专业知识作为基础并结合分析目的才能得出

2、我们可以采用spss的means均值比较过程,或者excel的透視表功能对各类的各个指标进行描述其中,report报表用于描述聚类结果对各类指标的比较来初步定义类别,主要根据专业知识来判定这裏到此为止。

以上过程涉及到spss层次聚类中的Q型聚类和R型聚类单因素方差分析,means过程等是一个很不错的多种分析方法联合使用的案例。數据源和部分介绍均摘自《SPSS for Windows 统计分析》书中

}

专业文档是百度文库认证用户/机構上传的专业性文档文库VIP用户或购买专业文档下载特权礼包的其他会员用户可用专业文档下载特权免费下载专业文档。只要带有以下“專业文档”标识的文档便是该类文档

VIP免费文档是特定的一类共享文档,会员用户可以免费随意获取非会员用户需要消耗下载券/积分获取。只要带有以下“VIP免费文档”标识的文档便是该类文档

VIP专享8折文档是特定的一类付费文档,会员用户可以通过设定价的8折获取非会員用户需要原价获取。只要带有以下“VIP专享8折优惠”标识的文档便是该类文档

付费文档是百度文库认证用户/机构上传的专业性文档,需偠文库用户支付人民币获取具体价格由上传人自由设定。只要带有以下“付费文档”标识的文档便是该类文档

共享文档是百度文库用戶免费上传的可与其他用户免费共享的文档,具体共享方式由上传人自由设定只要带有以下“共享文档”标识的文档便是该类文档。

}
0
0

积分 177, 距离下一级还需 83 积分
道具: 涂鴉板, 彩虹炫, 雷达卡, 热点灯, 显身卡, 匿名卡, 金钱卡
权限: 签名中使用图片

购买后可立即获得 权限: 隐身

道具: 金钱卡, 变色卡, 彩虹炫, 雷达卡, 热点灯, 涂鸦板

我有两组数据各30个数。做非参数检验中的两个独立样本检验的Mann-Whitney u test 和 Kolmogorov-Smirnov Z test时都出现了这两个警告请问如何解决?增加了样本数也没有用。。非常感谢!!

}

我要回帖

更多关于 spss拆分个案 的文章

更多推荐

版权声明:文章内容来源于网络,版权归原作者所有,如有侵权请点击这里与我们联系,我们将及时删除。

点击添加站长微信