0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

spss聚类分析步骤

倩倩 来源:网络整理 2018-02-24 08:56 次阅读

spss是一个非常好用的统计分析软件,spss有一个聚类分析的功能哦,但是很多人不知道spss聚类分析功能怎么使用?spss聚类分析是一个将case分析的数据的功能哦

spss聚类分析使用步骤教程

1、依次点击:analyse--classify--hierarchical cluster,打开分层聚类对话框。如图1所示

spss聚类分析步骤

2、在聚类分析对话框中,将聚类用到的变量都放到variables中。如图2所示

spss聚类分析步骤

3、将地区变量放入case标签中,他的意思是每一个数据都用地区这个值来命名。如图3所示

spss聚类分析步骤

4、点击plot按钮,打开对话框,设置要输出的图。如图4所示

spss聚类分析步骤

5、在打开的对话框中,勾选dendrogram,然后点击continue按钮。这个dendrogram是层次聚类谱系图,最后我们还会分析这个图。如图5所示

spss聚类分析步骤

6、点击method按钮,设置聚类的方法。如图6所示

spss聚类分析步骤

7、通常我们用到的聚类方法是wards method,接着我们需要把变量转换成z分数,点击continue按钮。如图7所示

spss聚类分析步骤

8、点击save按钮,填写希望保存的聚类类别数范围3--8,据此选项,spss将在数据编辑窗口中添加7个变量,分别标明聚类数位3--8类情况下各省市所属的类。如图8所示

spss聚类分析步骤

9、设置输出的聚类类别数范围3--8,点击continue按钮。如图9所示

spss聚类分析步骤

10、点击ok按钮,开始输出数据处理的结果。如图10所示

spss聚类分析步骤

11、你看到的下面的这个表格叫做聚类过程表,其内容并不是经常被关注,因为大部分实际应用中,聚类的具体过程是被忽略的。但是聚类系数可以帮助我们判断将数据分为几类最合适,判断的方法是,相邻的两个数据变化的幅度显著大于前面的系数的变化范围,这时候分类在这里就是最好的。如图11所示

spss聚类分析步骤

12、最后是层次聚类谱系图,从这个图中可看到聚类的过程,根据你的需求选择分类的组数。如图12所示

spss聚类分析步骤

以上就是spss聚类分析功能的使用方法哦,大家安装步骤一步步来就会操作了呢!

案例数据源:

有20种12盎司啤酒成分和价格的数据,变量包括啤酒名称、热量、钠含量、酒精含量、价格。数据来自《SPSS for Windows 统计分析》data11-03。点击下载

spss聚类分析步骤

【一】问题一:选择那些变量进行聚类?——采用“R型聚类”

1、现在我们有4个变量用来对啤酒分类,是否有必要将4个变量都纳入作为分类变量呢?热量、钠含量、酒精含量这3个指标是要通过化验员的辛苦努力来测定,而且还有花费不少成本,如果都纳入分析的话,岂不太麻烦太浪费?所以,有必要对4个变量进行降维处理,这里采用spss R型聚类(变量聚类),对4个变量进行降维处理。输出“相似性矩阵”有助于我们理解降维的过程。

spss聚类分析步骤

2、4个分类变量量纲各自不同,这一次我们先确定用相似性来测度,度量标准选用pearson系数,聚类方法选最远元素,此时,涉及到相关,4个变量可不用标准化处理,将来的相似性矩阵里的数字为相关系数。若果有某两个变量的相关系数接近1或-1,说明两个变量可互相替代。

spss聚类分析步骤

3、只输出“树状图”就可以了,个人觉得冰柱图很复杂,看起来没有树状图清晰明了。从proximity matrix表中可以看出热量和酒精含量两个变量相关系数0.903,最大,二者选其一即可,没有必要都作为聚类变量,导致成本增加。至于热量和酒精含量选择哪一个作为典型指标来代替原来的两个变量,可以根据专业知识或测定的难易程度决定。(与因子分析不同,是完全踢掉其中一个变量以达到降维的目的。)这里选用酒精含量,至此,确定出用于聚类的变量为:酒精含量,钠含量,价格。

spss聚类分析步骤

【二】问题二:20中啤酒能分为几类?——采用“Q型聚类”

1、现在开始对20中啤酒进行聚类。开始不确定应该分为几类,暂时用一个3-5类范围来试探。Q型聚类要求量纲相同,所以我们需要对数据标准化,这一回用欧式距离平方进行测度。

spss聚类分析步骤

2、主要通过树状图和冰柱图来理解类别。最终是分为4类还是3类,这是个复杂的过程,需要专业知识和最初的目的来识别。我这里试着确定分为4类。选择“保存”,则在数据区域内会自动生成聚类结果。

spss聚类分析步骤

【三】问题三:用于聚类的变量对聚类过程、结果又贡献么,有用么?——采用“单因素方差分析”

1、聚类分析除了对类别的确定需讨论外,还有一个比较关键的问题就是分类变量到底对聚类有没有作用有没有贡献,如果有个别变量对分类没有作用的话,应该剔除。

2、这个过程一般用单因素方差分析来判断。注意此时,因子变量选择聚为4类的结果,而将三个聚类变量作为因变量处理。方差分析结果显示,三个聚类变量sig值均极显著,我们用于分类的3个变量对分类有作用,可以使用,作为聚类变量是比较合理的。

spss聚类分析步骤

【四】问题四:聚类结果的解释?——采用”均值比较描述统计“

1、聚类分析最后一步,也是最为困难的就是对分出的各类进行定义解释,描述各类的特征,即各类别特征描述。这需要专业知识作为基础并结合分析目的才能得出。

2、我们可以采用spss的means均值比较过程,或者excel的透视表功能对各类的各个指标进行描述。其中,report报表用于描述聚类结果。对各类指标的比较来初步定义类别,主要根据专业知识来判定。这里到此为止。

spss聚类分析步骤

以上过程涉及到spss层次聚类中的Q型聚类和R型聚类,单因素方差分析,means过程等,是一个很不错的多种分析方法联合使用的案例。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • SPSS
    +关注

    关注

    1

    文章

    10

    浏览量

    9891
收藏 人收藏

    评论

    相关推荐

    labview可不可以与SPSS进行连接通信呢

    在网上看到LABview可以和origin进行通信了,想问一下labview能不能喝spss进行通信呢,将得到的数据直接进行聚类分析
    发表于 09-18 15:49

    LabVIEW与SPSS有接口吗?

    想用SPSS分析数据,然后利用LabVIEW的显示界面来显示,如何让他们两个建立联系啊?求助大神!
    发表于 10-21 09:07

    Matlab提供的两种聚类分析

    Matlab提供的两种聚类分析提供源程序代码
    发表于 04-29 11:21

    SPSS统计分析软件在气、水层识别中的应用

    SPSS 统计分析软件在气、水层识别中的应用:本文结合测井、录井、完井测试等资料的气、水显示情况,选取新场地区某气藏典型井,使用统计软件SPSS进行逐步判别分析,建立该地区
    发表于 10-19 21:04 18次下载

    技术资料:IBM SPSS Modeler: 强大的预测性分析

    技术资料:IBM SPSS Modeler: 强大的预测性分析平台
    发表于 12-28 11:13 0次下载

    基于主动学习的微博聚类分析

    基于主动学习的微博聚类分析_朱丽
    发表于 01-07 16:24 0次下载

    基于Hadoop与聚类分析的网络日志分析模型

    针对海量web日志数据在存储和计算方面存在的问题,结合当前的大数据技术,提出一种基于Hadoop与聚类分析的网络日志分析模型。利用Hadoop中的MapReduce编程模型对海量Web日志进行处理
    发表于 12-07 15:40 0次下载
    基于Hadoop与<b class='flag-5'>聚类分析</b>的网络日志<b class='flag-5'>分析</b>模型

    R与SPSS、SAS相比较_Python 在数据分析工作中的地位与R语言、SAS、SPSS 比较如何?

    能够用来做统计分析的软件和程序很多,目前应用比较广泛的包括:SPSS, SAS、R语言,Matlab,S-PLUS,S-Miner等。R与SPSS、SAS相比较,拥有非常突出的优势,如下所述
    发表于 01-05 17:07 4.9w次阅读
    R与<b class='flag-5'>SPSS</b>、SAS相比较_Python 在数据<b class='flag-5'>分析</b>工作中的地位与R语言、SAS、<b class='flag-5'>SPSS</b> 比较如何?

    spss聚类分析树状图

    要的分类效果。SPSS软件可以在不知道最终类别个数的情况下,画出完整的聚类分析谱系图,因此下面用SPSS软件对河南省18个市进行聚类分析
    的头像 发表于 02-12 15:59 4.7w次阅读

    聚类分析的简单案例

    聚类分析经常和有监督分类相混淆,有监督分类是为定义的分类响应变量预测分组或者类别关系。而聚类分析,从另一方面考虑,它是一种无监督分类技术。它能够在所有输入变量的基础上识别出数据集中的分组和类别信息
    的头像 发表于 02-23 10:00 7.5w次阅读
    <b class='flag-5'>聚类分析</b>的简单案例

    聚类分析方法有什么好处

    近些年来,数值分类学逐渐形成了一个新的分支,称为聚类分析聚类分析适用于很多不同类型的数据集合,很多研究领域,如工程、生物、医药、语言、人类学、心理学和市场学等,都对聚类技术的发展和应用起到了推动作用。
    的头像 发表于 02-23 11:16 3.4w次阅读

    数据挖掘技术之聚类分析教程资料ppt下载

    数据挖掘技术之聚类分析教程资料ppt下载
    发表于 04-08 11:41 6次下载

    基于Python的聚类分析及其应用简介

    基于Python的聚类分析及其应用简介。
    发表于 05-28 10:54 8次下载

    机器学习之分类分析聚类分析

    数据挖掘中应用较多的技术机器学习。机器学习主流算法包括三种:关联分析、分类分析聚类分析
    的头像 发表于 03-27 14:13 4166次阅读

    数据分析除了spss还有什么

    数据分析是当今世界中一个非常重要的领域,它涉及到从大量数据中提取有用信息、发现模式和趋势,并为决策提供支持。SPSS(Statistical Package for the Social
    的头像 发表于 07-05 15:01 343次阅读